options

Help is available by moving the cursor above any symbol or by checking MAQAO website.

Global Metrics

Metricr0r1r2r3r4r5r6r7
Total Time (s)9.3823.173.693.748.929.374.564.84
Max (Thread Active Time) (s)9.3723.163.693.738.919.374.554.84
Average Active Time (s)9.3723.163.693.738.919.374.554.84
Activity Ratio (%)99.9100.099.999.8100.0100.099.999.9
Average number of active threads0.9991.0000.9990.9981.0001.0000.9990.999
Affinity Stability (%)99.999.999.899.799.999.999.899.8
GFLOPS21.0328.50449.52348.99222.11521.05441.91339.511
Time in analyzed loops (%)100.0100.099.9100.0100.0100.0100.0100.0
Time in analyzed innermost loops (%)98.999.588.690.196.998.561.467.4
Time in user code (%)100100100100100100100100
Compilation Options Score (%)75.075.010010075.075.0100100
Array Access Efficiency (%)99.599.810010098.599.3100100
Potential Speedups
Perfect Flow Complexity1.001.001.001.001.001.001.001.00
Perfect OpenMP/MPI/Pthread/TBB1.001.001.001.001.001.001.001.00
Perfect OpenMP/MPI/Pthread/TBB + Perfect Load Distribution1.001.001.001.001.001.001.001.00
No Scalar IntegerPotential Speedup1.001.001.091.081.021.011.571.47
Nb Loops to get 80%11221122
FP VectorisedPotential Speedup1.581.591.551.541.121.121.001.00
Nb Loops to get 80%22321111
Fully VectorisedPotential Speedup7.407.082.182.165.645.881.581.45
Nb Loops to get 80%22331122
Only FP ArithmeticPotential Speedup1.011.001.091.081.031.011.581.48
Nb Loops to get 80%12221122

FLOPS Breakdown

Cumulated Speedup If No Scalar Integer

Cumulated Speedup If FP Vectorized

Cumulated Speedup If Fully Vectorized

Cumulated Speedup If Only FP Arithmetic

Loop Based Profiles

Innermost / Single Loops

Inbetween Loops

Outermost Loops

Cumulated Coverage With All Loops

Innermost Loop Based Profiles

Coverage

Count

Application Categorization

Time

Coverage

Compilation Options

Source ObjectIssue
kernel_ftz_nooutput
kernel.c
-funroll-loops is missing.

Path Count Profiles

Coverage

Count

Low Iteration Count Profiles

Coverage

Count

Average Number of Active Threads

Run 0 - gcc_GNR_ftz

Enable log scale

Run 1 - gcc_GNR_noftz

Enable log scale

Run 2 - icx_GNR_ftz

Enable log scale

Run 3 - icx_GNR_noftz

Enable log scale

Run 4 - gcc_ZEN5_ftz

Enable log scale

Run 5 - gcc_ZEN5_noftz

Enable log scale

Run 6 - aocc_ZEN5_ftz

Enable log scale

Run 7 - aocc_ZEN5_noftz

Enable log scale

Experiment Summaries

r0r1r2r3r4r5r6r7
Experiment Name
Application./gcc_GNR/kernel_ftz_nooutput./gcc_GNR/kernel_nooutput./icx_GNR/kernel_ftz_nooutput./icx_GNR/kernel_nooutput./gcc_ZEN5/kernel_ftz_nooutput./gcc_ZEN5/kernel_nooutput./aocc_ZEN5/kernel_ftz_nooutput./aocc_ZEN5/kernel_nooutput
Timestamp2026-08-14 18:10:222026-08-14 18:09:102026-08-14 18:07:562026-08-14 18:08:282026-08-14 18:24:432026-08-14 18:24:192026-08-14 18:32:302026-08-14 18:32:02
Experiment TypeSequentialsame as r0same as r0same as r0same as r0same as r0same as r0same as r0
Machineisix06.benchmarkcenter.megware.comsame as r0same as r0same as r0gmz12.benchmarkcenter.megware.comsame as r4same as r4same as r4
Architecturex86_64same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Micro ArchitectureGRANITE_RAPIDSsame as r0same as r0same as r0ZEN_V5same as r4same as r4same as r4
Model NameIntel(R) Xeon(R) 6972Psame as r0same as r0same as r0AMD EPYC 9655 96-Core Processorsame as r4same as r4same as r4
Cache Size491520 KBsame as r0same as r0same as r01024 KBsame as r4same as r4same as r4
Number of Cores96same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Maximal Frequency3.90 GHzsame as r0same as r0same as r04.51 GHzsame as r4same as r4same as r4
OS VersionLinux 5.14.0-687.31.1.el9_8.x86_64 #1 SMP PREEMPT_DYNAMIC Sat Aug 1 05:38:01 EDT 2026same as r0same as r0same as r0Linux 5.14.0-687.29.1.el9_8.x86_64 #1 SMP PREEMPT_DYNAMIC Thu Jul 23 16:18:48 EDT 2026same as r4same as r4same as r4
Architecture used during static analysisx86_64same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Micro Architecture used during static analysisGRANITE_RAPIDSsame as r0same as r0same as r0ZEN_V5same as r4same as r4same as r4
Compilation Options kernel_ftz_nooutput: GNU C23 15.1.0 -march=graniterapids -mmmx -mpopcnt -msse -msse2 -msse3 -mssse3 -msse4.1 -msse4.2 -mavx -mavx2 -mno-sse4a -mno-fma4 -mno-xop -mfma -mavx512f -mbmi -mbmi2 -maes -mpclmul -mavx512vl -mavx512bw -mavx512dq -mavx512cd -mavx512vbmi -mavx512ifma -mavx512vpopcntdq -mavx512vbmi2 -mgfni -mvpclmulqdq -mavx512vnni -mavx512bitalg -mavx512bf16 -mno-avx512vp2intersect -mno-3dnow -madx -mabm -mcldemote -mclflushopt -mclwb -mno-clzero -mcx16 -menqcmd -mf16c -mfsgsbase -mfxsr -mno-hle -msahf -mno-lwp -mlzcnt -mmovbe -mmovdir64b -mmovdiri -mno-mwaitx -mpconfig -mpku -mprfchw -mptwrite -mrdpid -mrdrnd -mrdseed -mno-rtm -mserialize -msgx -msha -mshstk -mno-tbm -mtsxldtrk -mvaes -mwaitpkg -mwbnoinvd -mxsave -mxsavec -mxsaveopt -mxsaves -mamx-tile -mamx-int8 -mamx-bf16 -muintr -mhreset -mno-kl -mno-widekl -mavxvnni -mavx512fp16 -mno-avxifma -mno-avxvnniint8 -mno-avxneconvert -mno-cmpccxadd -mamx-fp16 -mprefetchi -mno-raoint -mno-amx-complex -mno-avxvnniint16 -mno-sm3 -mno-sha512 -mno-sm4 -mno-apxf -mno-usermsr -mavx10.1-256 -mavx10.1-512 -mno-avx10.2 -mno-amx-avx512 -mno-amx-tf32 -mno-amx-transpose -mno-amx-fp8 -mno-movrs -mno-amx-movrs --param=l1-cache-size=48 --param=l1-cache-line-size=64 --param=l2-cache-size=491520 -mtune=graniterapids -mdaz-ftz -g -O3 kernel_nooutput: GNU C23 15.1.0 -march=graniterapids -mmmx -mpopcnt -msse -msse2 -msse3 -mssse3 -msse4.1 -msse4.2 -mavx -mavx2 -mno-sse4a -mno-fma4 -mno-xop -mfma -mavx512f -mbmi -mbmi2 -maes -mpclmul -mavx512vl -mavx512bw -mavx512dq -mavx512cd -mavx512vbmi -mavx512ifma -mavx512vpopcntdq -mavx512vbmi2 -mgfni -mvpclmulqdq -mavx512vnni -mavx512bitalg -mavx512bf16 -mno-avx512vp2intersect -mno-3dnow -madx -mabm -mcldemote -mclflushopt -mclwb -mno-clzero -mcx16 -menqcmd -mf16c -mfsgsbase -mfxsr -mno-hle -msahf -mno-lwp -mlzcnt -mmovbe -mmovdir64b -mmovdiri -mno-mwaitx -mpconfig -mpku -mprfchw -mptwrite -mrdpid -mrdrnd -mrdseed -mno-rtm -mserialize -msgx -msha -mshstk -mno-tbm -mtsxldtrk -mvaes -mwaitpkg -mwbnoinvd -mxsave -mxsavec -mxsaveopt -mxsaves -mamx-tile -mamx-int8 -mamx-bf16 -muintr -mhreset -mno-kl -mno-widekl -mavxvnni -mavx512fp16 -mno-avxifma -mno-avxvnniint8 -mno-avxneconvert -mno-cmpccxadd -mamx-fp16 -mprefetchi -mno-raoint -mno-amx-complex -mno-avxvnniint16 -mno-sm3 -mno-sha512 -mno-sm4 -mno-apxf -mno-usermsr -mavx10.1-256 -mavx10.1-512 -mno-avx10.2 -mno-amx-avx512 -mno-amx-tf32 -mno-amx-transpose -mno-amx-fp8 -mno-movrs -mno-amx-movrs --param=l1-cache-size=48 --param=l1-cache-line-size=64 --param=l2-cache-size=491520 -mtune=graniterapids -mno-daz-ftz -g -O3 kernel_ftz_nooutput: --intel -O3 -march=native -Wall -g -mdaz-ftz -D FTZ -o kernel_ftz_nooutput kernel.c -fveclib=SVML -dumpdir kernel_ftz_nooutput- kernel_nooutput: --intel -O3 -march=native -Wall -g -mno-daz-ftz -o kernel_nooutput kernel.c -fveclib=SVML -dumpdir kernel_nooutput- kernel_ftz_nooutput: GNU C23 15.1.0 -march=znver5 -mmmx -mpopcnt -msse -msse2 -msse3 -mssse3 -msse4.1 -msse4.2 -mavx -mavx2 -msse4a -mno-fma4 -mno-xop -mfma -mavx512f -mbmi -mbmi2 -maes -mpclmul -mavx512vl -mavx512bw -mavx512dq -mavx512cd -mavx512vbmi -mavx512ifma -mavx512vpopcntdq -mavx512vbmi2 -mgfni -mvpclmulqdq -mavx512vnni -mavx512bitalg -mavx512bf16 -mavx512vp2intersect -mno-3dnow -madx -mabm -mno-cldemote -mclflushopt -mclwb -mclzero -mcx16 -mno-enqcmd -mf16c -mfsgsbase -mfxsr -mno-hle -msahf -mno-lwp -mlzcnt -mmovbe -mmovdir64b -mmovdiri -mmwaitx -mno-pconfig -mpku -mprfchw -mno-ptwrite -mrdpid -mrdrnd -mrdseed -mno-rtm -mno-serialize -mno-sgx -msha -mshstk -mno-tbm -mno-tsxldtrk -mvaes -mno-waitpkg -mwbnoinvd -mxsave -mxsavec -mxsaveopt -mxsaves -mno-amx-tile -mno-amx-int8 -mno-amx-bf16 -mno-uintr -mno-hreset -mno-kl -mno-widekl -mavxvnni -mno-avx512fp16 -mno-avxifma -mno-avxvnniint8 -mno-avxneconvert -mno-cmpccxadd -mno-amx-fp16 -mno-prefetchi -mno-raoint -mno-amx-complex -mno-avxvnniint16 -mno-sm3 -mno-sha512 -mno-sm4 -mno-apxf -mno-usermsr -mno-avx10.2 -mno-amx-avx512 -mno-amx-tf32 -mno-amx-transpose -mno-amx-fp8 -mno-movrs -mno-amx-movrs --param=l1-cache-size=48 --param=l1-cache-line-size=64 --param=l2-cache-size=1024 -mtune=znver5 -mdaz-ftz -g -O3 kernel_nooutput: GNU C23 15.1.0 -march=znver5 -mmmx -mpopcnt -msse -msse2 -msse3 -mssse3 -msse4.1 -msse4.2 -mavx -mavx2 -msse4a -mno-fma4 -mno-xop -mfma -mavx512f -mbmi -mbmi2 -maes -mpclmul -mavx512vl -mavx512bw -mavx512dq -mavx512cd -mavx512vbmi -mavx512ifma -mavx512vpopcntdq -mavx512vbmi2 -mgfni -mvpclmulqdq -mavx512vnni -mavx512bitalg -mavx512bf16 -mavx512vp2intersect -mno-3dnow -madx -mabm -mno-cldemote -mclflushopt -mclwb -mclzero -mcx16 -mno-enqcmd -mf16c -mfsgsbase -mfxsr -mno-hle -msahf -mno-lwp -mlzcnt -mmovbe -mmovdir64b -mmovdiri -mmwaitx -mno-pconfig -mpku -mprfchw -mno-ptwrite -mrdpid -mrdrnd -mrdseed -mno-rtm -mno-serialize -mno-sgx -msha -mshstk -mno-tbm -mno-tsxldtrk -mvaes -mno-waitpkg -mwbnoinvd -mxsave -mxsavec -mxsaveopt -mxsaves -mno-amx-tile -mno-amx-int8 -mno-amx-bf16 -mno-uintr -mno-hreset -mno-kl -mno-widekl -mavxvnni -mno-avx512fp16 -mno-avxifma -mno-avxvnniint8 -mno-avxneconvert -mno-cmpccxadd -mno-amx-fp16 -mno-prefetchi -mno-raoint -mno-amx-complex -mno-avxvnniint16 -mno-sm3 -mno-sha512 -mno-sm4 -mno-apxf -mno-usermsr -mno-avx10.2 -mno-amx-avx512 -mno-amx-tf32 -mno-amx-transpose -mno-amx-fp8 -mno-movrs -mno-amx-movrs --param=l1-cache-size=48 --param=l1-cache-line-size=64 --param=l2-cache-size=1024 -mtune=znver5 -mno-daz-ftz -g -O3 kernel_ftz_nooutput: AMD clang version 17.0.6 (CLANG: AOCC_5.1.0-Build#1994 2025_12_23) /cluster/comp/aocc/5.1.0/bin/clang-17 -O3 -march=native -Wall -g -grecord-command-line -D FTZ -o kernel_ftz_nooutput kernel.c -dumpdir kernel_ftz_nooutput- kernel_nooutput: AMD clang version 17.0.6 (CLANG: AOCC_5.1.0-Build#1994 2025_12_23) /cluster/comp/aocc/5.1.0/bin/clang-17 -O3 -march=native -Wall -g -grecord-command-line -o kernel_nooutput kernel.c -dumpdir kernel_nooutput-
Number of processes observed1same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Number of threads observed1same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Frequency Driverintel_pstatesame as r0same as r0same as r0amd-pstate-eppsame as r4same as r4same as r4
Frequency Governorperformancesame as r0same as r0same as r0same as r0same as r0same as r0same as r0
Huge Pagesalwayssame as r0same as r0same as r0same as r0same as r0same as r0same as r0
Hyperthreadingonsame as r0same as r0same as r0same as r0same as r0same as r0same as r0
Number of sockets2same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Number of cores per socket96same as r0same as r0same as r0same as r0same as r0same as r0same as r0
MAQAO version2026.1.0same as r0same as r0same as r0same as r0same as r0same as r0same as r0
MAQAO build6d1be1d51c1e63266254997eb301734a7264775d::20260810-150026same as r0same as r0same as r0same as r0same as r0same as r0same as r0
Commentssame as r0same as r0same as r0same as r0same as r0same as r0same as r0

×