Help is available by moving the cursor above any
symbol or by checking MAQAO website.
| Metric | r0 | r1 | r2 | r3 | r4 | r5 | r6 | r7 | |
|---|---|---|---|---|---|---|---|---|---|
| Total Time (s) | 257.71 | 133.92 | 93.89 | 68.19 | 61.28 | 62.89 | 63.81 | 57.95 | |
| Max (Thread Active Time) (s) | 257.55 | 133.06 | 93.16 | 67.59 | 60.77 | 62.41 | 58.38 | 57.50 | |
| Average Active Time (s) | 257.51 | 129.97 | 81.73 | 60.50 | 55.88 | 54.37 | 53.25 | 52.38 | |
| Activity Ratio (%) | 99.9 | 97.1 | 87.2 | 88.9 | 91.4 | 86.7 | 83.7 | 90.7 | |
| Average number of active threads | 7.994 | 15.528 | 27.855 | 56.775 | 87.539 | 110.648 | 133.517 | 173.548 | |
| Affinity Stability (%) | 99.9 | 99.9 | 99.8 | 99.8 | 99.8 | 99.8 | 99.8 | 99.8 | |
| GFLOPS | 17.809 | 33.931 | 48.622 | 67.041 | 74.635 | 72.509 | 77.605 | 78.809 | |
| Time in analyzed loops (%) | 96.9 | 96.0 | 95.1 | 94.3 | 94.0 | 92.7 | 91.9 | 92.7 | |
| Time in analyzed innermost loops (%) | 67.5 | 57.7 | 60.3 | 62.9 | 64.5 | 65.0 | 65.0 | 66.1 | |
| Time in user code (%) | 97.3 | 96.4 | 95.3 | 94.6 | 94.2 | 93.0 | 92.1 | 92.9 | |
| Compilation Options Score (%) | 100 | 100 | 100 | 100 | 100 | 100 | 100 | 100 | |
| Array Access Efficiency (%) | 56.5 | 56.1 | 55.9 | 56.1 | 56.2 | 56.2 | 56.2 | 56.2 | |
| Potential Speedups | |||||||||
| Perfect Flow Complexity | 1.10 | 1.10 | 1.08 | 1.06 | 1.04 | 1.04 | 1.03 | 1.03 | |
| Perfect OpenMP/MPI/Pthread/TBB | 1.00 | 1.01 | 1.01 | 1.01 | 1.02 | 1.01 | 1.01 | 1.02 | |
| Perfect OpenMP/MPI/Pthread/TBB + Perfect Load Distribution | 1.01 | 1.04 | 1.17 | 1.14 | 1.11 | 1.18 | 1.14 | 1.12 | |
| Scalability - Gap | 1.00 | 0.52 | 0.36 | 0.26 | 0.24 | 0.24 | 0.25 | 0.22 | |
| No Scalar Integer | Potential Speedup | 1.18 | 1.22 | 1.19 | 1.16 | 1.15 | 1.14 | 1.13 | 1.13 |
| Nb Loops to get 80% | 17 | 16 | 16 | 14 | 13 | 13 | 12 | 12 | |
| FP Vectorised | Potential Speedup | 1.42 | 1.39 | 1.46 | 1.57 | 1.63 | 1.66 | 1.67 | 1.70 |
| Nb Loops to get 80% | 5 | 6 | 5 | 4 | 4 | 4 | 4 | 4 | |
| Fully Vectorised | Potential Speedup | 4.78 | 5.00 | 4.70 | 4.43 | 4.31 | 4.10 | 3.98 | 4.06 |
| Nb Loops to get 80% | 34 | 37 | 34 | 29 | 26 | 25 | 24 | 24 | |
| Only FP Arithmetic | Potential Speedup | 1.37 | 1.45 | 1.39 | 1.33 | 1.29 | 1.27 | 1.26 | 1.25 |
| Nb Loops to get 80% | 24 | 22 | 21 | 21 | 20 | 19 | 18 | 18 | |
| Source Object | Issue |
|---|---|
| ▼exec | |
| ▼IJVector_parcsr.c | |
| ○ | |
| ▼par_strength.c | |
| ○ | |
| ▼par_lr_interp.c | |
| ○ | |
| ▼csr_matrix.c | |
| ○ | |
| ▼csr_matvec.c | |
| ○ | |
| ▼par_coarse_parms.c | |
| ○ | |
| ▼par_multi_interp.c | |
| ○ | |
| ▼random.c | |
| ○ | |
| ▼binsearch.c | |
| ○ | |
| ▼vector.c | |
| ○ | |
| ▼hypre_qsort.c | |
| ○ | |
| ▼par_csr_matvec.c | |
| ○ | |
| ▼IJMatrix_parcsr.c | |
| ○ | |
| ▼amg.c | |
| ○ | |
| ▼csr_matop.c | |
| ○ | |
| ▼par_csr_matop.c | |
| ○ | |
| ▼par_coarsen.c | |
| ○ | |
| ▼par_interp.c | |
| ○ | |
| ▼ams.c | |
| ○ |
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
Enable log scale
| r0 | r1 | r2 | r3 | r4 | r5 | r6 | r7 | |
|---|---|---|---|---|---|---|---|---|
| Application | /beegfs/hackathon/users/eoseret/qaas_runs_test/178-668-9699/intel/AMG/run/base_runs/defaults/gcc/exec | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Timestamp | 2026-08-14 11:23:21 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Experiment Type | MPI; | MPI; OpenMP; | same as r1 | same as r1 | same as r1 | same as r1 | same as r1 | same as r1 |
| Machine | gmz17.benchmarkcenter.megware.com | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture | ZEN_V5 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Model Name | AMD EPYC 9655 96-Core Processor | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Cache Size | 1024 KB | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of Cores | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Maximal Frequency | 4.51 GHz | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| OS Version | Linux 5.14.0-687.29.1.el9_8.x86_64 #1 SMP PREEMPT_DYNAMIC Thu Jul 23 16:18:48 EDT 2026 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Architecture used during static analysis | x86_64 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Micro Architecture used during static analysis | ZEN_V5 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Compilation Options | exec: GNU C89 15.1.0 -march=znver5 -mmmx -mpopcnt -msse -msse2 -msse3 -mssse3 -msse4.1 -msse4.2 -mavx -mavx2 -msse4a -mno-fma4 -mno-xop -mfma -mavx512f -mbmi -mbmi2 -maes -mpclmul -mavx512vl -mavx512bw -mavx512dq -mavx512cd -mavx512vbmi -mavx512ifma -mavx512vpopcntdq -mavx512vbmi2 -mgfni -mvpclmulqdq -mavx512vnni -mavx512bitalg -mavx512bf16 -mavx512vp2intersect -mno-3dnow -madx -mabm -mno-cldemote -mclflushopt -mclwb -mclzero -mcx16 -mno-enqcmd -mf16c -mfsgsbase -mfxsr -mno-hle -msahf -mno-lwp -mlzcnt -mmovbe -mmovdir64b -mmovdiri -mmwaitx -mno-pconfig -mpku -mprfchw -mno-ptwrite -mrdpid -mrdrnd -mrdseed -mno-rtm -mno-serialize -mno-sgx -msha -mshstk -mno-tbm -mno-tsxldtrk -mvaes -mno-waitpkg -mwbnoinvd -mxsave -mxsavec -mxsaveopt -mxsaves -mno-amx-tile -mno-amx-int8 -mno-amx-bf16 -mno-uintr -mno-hreset -mno-kl -mno-widekl -mavxvnni -mno-avx512fp16 -mno-avxifma -mno-avxvnniint8 -mno-avxneconvert -mno-cmpccxadd -mno-amx-fp16 -mno-prefetchi -mno-raoint -mno-amx-complex -mno-avxvnniint16 -mno-sm3 -mno-sha512 -mno-sm4 -mno-apxf -mno-usermsr -mno-avx10.2 -mno-amx-avx512 -mno-amx-tf32 -mno-amx-transpose -mno-amx-fp8 -mno-movrs -mno-amx-movrs --param=l1-cache-size=48 --param=l1-cache-line-size=64 --param=l2-cache-size=1024 -mtune=znver5 -g -O3 -std=gnu90 -fno-omit-frame-pointer -fcf-protection=none -fopenmp -funroll-loops | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of processes observed | 8 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of threads observed | 8 | 16 | 32 | 64 | 96 | 128 | 160 | 192 |
| Frequency Driver | amd-pstate-epp | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Frequency Governor | performance | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Huge Pages | always | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Hyperthreading | on | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of sockets | 2 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Number of cores per socket | 96 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO version | 2026.1.0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| MAQAO build | 6d1be1d51c1e63266254997eb301734a7264775d::20260810-150026 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |
| Comments | OV scalability run using gcc | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 | same as r0 |