|
Python build
bench.compile.python
|
build_time
primary
|
10.3 s |
↓ better |
|
xz compression
bench.compress.xz
|
comp_speed
primary
|
241 MB/s |
↑ better |
|
zstd compression
bench.compress.zstd
|
comp_speed_l19
|
309 MB/s |
↑ better |
|
zstd compression
bench.compress.zstd
|
comp_speed_l3
primary
|
5,952 MB/s |
↑ better |
|
zstd compression
bench.compress.zstd
|
decomp_speed_l19
|
8,532 MB/s |
↑ better |
|
zstd compression
bench.compress.zstd
|
decomp_speed_l3
|
8,466 MB/s |
↑ better |
|
CPU matrix math
bench.cpu.stressng-matrix
|
bogo_ops_per_sec
primary
|
133,937 bogo-ops/s |
↑ better |
|
CPU, all cores
bench.cpu.sysbench-multi
|
events_per_sec
primary
|
103,452 events/s |
↑ better |
|
CPU, single core
bench.cpu.sysbench-single
|
events_per_sec
primary
|
4,018 events/s |
↑ better |
|
AES-256-GCM
bench.crypto.openssl-aes256gcm
|
throughput
primary
|
9,354 MB/s |
↑ better |
|
RSA-4096 signing
bench.crypto.openssl-rsa4096
|
signs_per_sec
primary
|
454 ops/s |
↑ better |
|
RSA-4096 signing
bench.crypto.openssl-rsa4096
|
verifies_per_sec
|
25,004 ops/s |
↑ better |
|
SHA-256
bench.crypto.openssl-sha256
|
throughput
primary
|
4,951 MB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Single precision
opencl_single_precision_compute
Intel Graphics
|
1,926 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Single precision
opencl_single_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
46,514 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Double precision
opencl_double_precision_compute
Intel Graphics
|
60.5 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Double precision
opencl_double_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
926 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Half precision
opencl_half_precision_compute
Intel Graphics
|
3,825 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Mixed precision
opencl_mixed_precision_compute
Intel Graphics
|
1,926 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Integer
opencl_integer_compute
Intel Graphics
|
642 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Compute · Integer
opencl_integer_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
19,787 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Global memory
opencl_global_memory_bandwidth
Intel Graphics
|
50.4 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Global memory
opencl_global_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
604 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Local memory
opencl_local_memory_bandwidth
Intel Graphics
|
697 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Local memory
opencl_local_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
17,731 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Image memory
opencl_image_memory_bandwidth
Intel Graphics
|
42.2 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Image memory
opencl_image_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
537 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Host transfer
opencl_transfer_bandwidth
Intel Graphics
|
24.8 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Bandwidth · Host transfer
opencl_transfer_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
42.3 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Latency · Kernel launch
opencl_kernel_launch_latency
Intel Graphics
|
85.9 us |
↓ better |
|
GPU compute
bench.gpu.clpeak
|
OpenCL
Latency · Kernel launch
opencl_kernel_launch_latency
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
14.4 us |
↓ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Single precision
cuda_single_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
44,430 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Double precision
cuda_double_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
925 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Half precision
cuda_half_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
47,530 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Mixed precision
cuda_mixed_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
35,765 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · bfloat16
cuda_bfloat16_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
36,797 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Integer
cuda_integer_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
19,361 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Compute · Integer, int8 dot product
cuda_integer_compute_int8_dp
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
75,525 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Bandwidth · Global memory
cuda_global_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
693 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Bandwidth · Local memory
cuda_local_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
17,268 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Bandwidth · Image memory
cuda_image_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
514 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Bandwidth · Host transfer
cuda_transfer_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
42.4 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
CUDA
Latency · Kernel launch
cuda_kernel_launch_latency
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
5.85 us |
↓ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Single precision
vulkan_single_precision_compute
Intel Graphics (ARL)
|
1,888 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Single precision
vulkan_single_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
primary
|
47,321 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Double precision
vulkan_double_precision_compute
Intel Graphics (ARL)
|
59.9 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Double precision
vulkan_double_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
924 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Half precision
vulkan_half_precision_compute
Intel Graphics (ARL)
|
3,732 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Half precision
vulkan_half_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
48,673 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Mixed precision
vulkan_mixed_precision_compute
Intel Graphics (ARL)
|
1,900 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Mixed precision
vulkan_mixed_precision_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
40,472 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · bfloat16
vulkan_bfloat16_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
37,061 GFLOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Integer
vulkan_integer_compute
Intel Graphics (ARL)
|
476 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Integer
vulkan_integer_compute
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
20,753 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Integer, int8 dot product
vulkan_integer_compute_int8_dp
Intel Graphics (ARL)
|
7,026 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Compute · Integer, int8 dot product
vulkan_integer_compute_int8_dp
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
52,186 GOPS |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Global memory
vulkan_global_memory_bandwidth
Intel Graphics (ARL)
|
50.9 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Global memory
vulkan_global_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
690 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Local memory
vulkan_local_memory_bandwidth
Intel Graphics (ARL)
|
575 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Local memory
vulkan_local_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
18,398 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Image memory
vulkan_image_memory_bandwidth
Intel Graphics (ARL)
|
31.4 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Image memory
vulkan_image_memory_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
549 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Host transfer
vulkan_transfer_bandwidth
Intel Graphics (ARL)
|
24.1 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Bandwidth · Host transfer
vulkan_transfer_bandwidth
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
42.8 GB/s |
↑ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Latency · Kernel launch
vulkan_kernel_launch_latency
Intel Graphics (ARL)
|
77.4 us |
↓ better |
|
GPU compute
bench.gpu.clpeak
|
Vulkan
Latency · Kernel launch
vulkan_kernel_launch_latency
NVIDIA RTX PRO 5000 Blackwell Generation Laptop GPU
|
45.4 us |
↓ better |
|
GPU transfer
bench.gpu.cuda-bandwidth
|
device_to_device
|
244 GiB/s |
↑ better |
|
GPU transfer
bench.gpu.cuda-bandwidth
|
device_to_host
|
32.5 GiB/s |
↑ better |
|
GPU transfer
bench.gpu.cuda-bandwidth
|
host_to_device
primary
|
39.6 GiB/s |
↑ better |
|
Memory bandwidth
bench.mem.bandwidth
|
add_bandwidth
|
38,005 MB/s |
↑ better |
|
Memory bandwidth
bench.mem.bandwidth
|
copy_bandwidth
|
34,629 MB/s |
↑ better |
|
Memory bandwidth
bench.mem.bandwidth
|
scale_bandwidth
|
33,978 MB/s |
↑ better |
|
Memory bandwidth
bench.mem.bandwidth
|
triad_bandwidth
primary
|
38,164 MB/s |
↑ better |
|
Memory latency
bench.mem.latency
|
latency_64m
primary
|
79.7 ns |
↓ better |
|
Memory stream
bench.mem.stressng-stream
|
compute_rate
|
81.4 Mflop/s |
↑ better |
|
Memory stream
bench.mem.stressng-stream
|
memory_read_rate
primary
|
932 MB/s |
↑ better |
|
Memory stream
bench.mem.stressng-stream
|
memory_write_rate
|
621 MB/s |
↑ better |
|
Context switching
bench.sched.stressng-switch
|
ctx_switch_latency
|
1,594 ns |
↓ better |
|
Context switching
bench.sched.stressng-switch
|
ctx_switch_rate
primary
|
15,054,322 ops/s |
↑ better |