|
Loop Id: 1594 |
Module: exec |
Source: par_multi_interp.c:399-400 |
Coverage: 0.01% |
|
Show groups analysis
0x4308e0 STR X0, [X9, X18,LSL #3] [1] |
0x4308e4 SUB X18, X18, #1 |
0x4308e8 LDR X0, [SP, #560] [2] |
/home/hbollore/qaas-runs/171-233-5044/intel/AMG/build/AMG/AMG/parcsr_ls/par_multi_interp.c: 399 - 400 |
-------------------------------------------------------------------------------- |
|
399: pass_array[p_cnt--] = i; |
400: P_diag_i[i+1] = 0; |
| Coverage (%) | Name | Source Location | Module |
|
|
|
|
| Metric | Value |
| CQA speedup if no scalar integer | NA |
| CQA speedup if FP arith vectorized | NA |
| CQA speedup if fully vectorized | NA |
| CQA speedup if no inter-iteration dependency | NA |
| CQA speedup if next bottleneck killed | NA |
| Bottlenecks | NA |
| Function | hypre_BoomerAMGBuildMultipass |
| Source | par_multi_interp.c:399-400 |
| Source loop unroll info | NA |
| Source loop unroll confidence level | NA |
| Unroll/vectorization loop type | NA |
| Unroll factor | NA |
| CQA cycles | NA |
| CQA cycles if no scalar integer | NA |
| CQA cycles if FP arith vectorized | NA |
| CQA cycles if fully vectorized | NA |
| Front-end cycles | NA |
| DIV/SQRT cycles | NA |
| P0 cycles | NA |
| P1 cycles | NA |
| P2 cycles | NA |
| P3 cycles | NA |
| P4 cycles | NA |
| P5 cycles | NA |
| P6 cycles | NA |
| P7 cycles | NA |
| P8 cycles | NA |
| P9 cycles | NA |
| P10 cycles | NA |
| P11 cycles | NA |
| P12 cycles | NA |
| P13 cycles | NA |
| P14 cycles | NA |
| Inter-iter dependencies cycles | NA |
| FE+BE cycles (UFS) | NA |
| Stall cycles (UFS) | NA |
| Nb insns | NA |
| Nb uops | NA |
| Nb loads | NA |
| Nb stores | NA |
| Nb stack references | NA |
| FLOP/cycle | NA |
| Nb FLOP add-sub | NA |
| Nb FLOP mul | NA |
| Nb FLOP fma | NA |
| Nb FLOP div | NA |
| Nb FLOP rcp | NA |
| Nb FLOP sqrt | NA |
| Nb FLOP rsqrt | NA |
| Bytes/cycle | NA |
| Bytes prefetched | NA |
| Bytes loaded | NA |
| Bytes stored | NA |
| Stride 0 | NA |
| Stride 1 | NA |
| Stride n | NA |
| Stride unknown | NA |
| Stride indirect | NA |
| Vectorization ratio all | NA |
| Vectorization ratio load | NA |
| Vectorization ratio store | NA |
| Vectorization ratio mul | NA |
| Vectorization ratio add_sub | NA |
| Vectorization ratio fma | NA |
| Vectorization ratio div_sqrt | NA |
| Vectorization ratio other | NA |
| Vector-efficiency ratio all | NA |
| Vector-efficiency ratio load | NA |
| Vector-efficiency ratio store | NA |
| Vector-efficiency ratio mul | NA |
| Vector-efficiency ratio add_sub | NA |
| Vector-efficiency ratio fma | NA |
| Vector-efficiency ratio div_sqrt | NA |
| Vector-efficiency ratio other | NA |
The loop is defined in /home/hbollore/qaas-runs/171-233-5044/intel/AMG/build/AMG/AMG/parcsr_ls/par_multi_interp.c:399-400.
This loop cannot be analyzed: no jump instruction (loop probably badly detected).