KITT STT · 2026-09-17
平台效能測試 每個平台分成「時間測試」與「記憶體測試」。先選平台,再在同一平台內比較 CUDA、Online TRT、Offline TRT;C-X1 為預設畫面。
C-X1 RTX 4090 Thor AGX Orin AGX
Online TRT/Offline TRT 未列數值。 libonnxruntime_providers_tensorrt.so has unresolved libnvinfer.so.10 and libnvonnxparser.so.10; no TensorRT library was present in the image.
時間測試 記憶體測試
時間測試 完整服務 3 輪、每輪一條 WebSocket、固定 3/6/15 秒 WAV,warmup=0;bulk 與 realtime 分開執行。 完整服務 18/18 final ASR 成功。僅在同一平台內比較後端;不同版本與硬體不做絕對毫秒排名。
0 47 94 141 187 3s 6s 15s ms CUDA CUDA · 3s:65.74 ms;CUDA 基準 CUDA · 6s:78.40 ms;CUDA 基準 CUDA · 15s:162.90 ms;CUDA 基準 3 秒 · 相對 CUDA ● CUDA 65.74 ms CUDA 基準6 秒 · 相對 CUDA ● CUDA 78.40 ms CUDA 基準15 秒 · 相對 CUDA ● CUDA 162.90 ms CUDA 基準bulk 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 0 39 78 118 157 3s 6s 15s ms CUDA CUDA · 3s:64.86 ms;CUDA 基準 CUDA · 6s:73.88 ms;CUDA 基準 CUDA · 15s:136.33 ms;CUDA 基準 3 秒 · 相對 CUDA ● CUDA 64.86 ms CUDA 基準6 秒 · 相對 CUDA ● CUDA 73.88 ms CUDA 基準15 秒 · 相對 CUDA ● CUDA 136.33 ms CUDA 基準realtime 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 完整服務精確數值 送音 音長 後端 中位數 ms 範圍 ms 相對 CUDA bulk 3s CUDA 65.74 57.07–69.67 基準 bulk 6s CUDA 78.40 71.46–79.79 基準 bulk 15s CUDA 162.90 149.57–165.02 基準 realtime 3s CUDA 64.86 56.73–66.05 基準 realtime 6s CUDA 73.88 66.02–84.12 基準 realtime 15s CUDA 136.33 133.95–150.27 基準
Direct recognizer 與 graph Direct recognizer 量 accept_waveform + decode_stream,與完整服務 final ASR 的計時範圍不同。
音長 後端 recognizer p50 ms p95 ms 載入 s 3s CUDA 35.05 41.84 1.867 6s CUDA 43.81 44.44 1.688 15s CUDA 70.90 77.27 1.604
後端 graph p50 ms p95 ms CUDA T=50 35.61 35.95 CUDA T=100 37.14 42.24 CUDA T=250 58.53 61.69
CUDA:providers: ['CUDAExecutionProvider', 'CPUExecutionProvider'];node provider counts: {'CUDAExecutionProvider': 523440, 'CPUExecutionProvider': 141300}。
記憶體測試 容量主指標 CUDA · 3107 MiB 完整服務推論後 cgroup current
量測內容 RAM cgroup、PSS、RSS、VmHWM、peak
VRAM 不另拆 共用記憶體或容器未提供逐程序指標
MiB CUDA CUDA:3107.21 MiB 3107 完整服務推論後 cgroup current;同一平台內可直接比較後端。The direct graph/recognizer child processes are included in this cgroup peak; use after_service for the service footprint. 完整服務 RAM 指標 後端 時點 cgroup current PSS RSS VmHWM cgroup peak CUDA 完整服務推論後 3107.21 1818.35 3013.12 3045.12 3132.18 CUDA direct 測試後 4782.59 1766.72 2960.89 3045.12 8489.22
指標與量測手法 指標 意思/讀取方式 cgroup current 容器目前被計帳的 RAM,包含檔案快取;從 /sys/fs/cgroup/memory.current 讀取,容量決策優先看這個。 PSS 程序按比例分攤共享頁;從 PID 1 smaps_rollup 讀取。 RSS / VmHWM 程序常駐 RAM/程序啟動後最高 RSS;從 PID 1 status 讀取。 cgroup peak 容器歷史最高計帳 RAM;可能包含 direct 測試的暫用子程序。
資料:完整原始資料
時間測試 記憶體測試
時間測試 完整服務各後端 3 輪、每輪一條 WebSocket、固定 3/6/15 秒 WAV,warmup=0;bulk 與 realtime 分開執行。Direct recognizer 使用新程序。 完整服務 54/54 final ASR 成功。僅在同一平台內比較後端;不同版本與硬體不做絕對毫秒排名。
0 24 47 71 95 3s 6s 15s ms CUDA CUDA · 3s:31.71 ms;CUDA 基準 CUDA · 6s:42.17 ms;CUDA 基準 CUDA · 15s:82.45 ms;CUDA 基準 Online TRT Online TRT · 3s:23.24 ms;相對 CUDA -26.7% · 1.36× Online TRT · 6s:32.44 ms;相對 CUDA -23.1% · 1.30× Online TRT · 15s:75.49 ms;相對 CUDA -8.4% · 1.09× Offline TRT Offline TRT · 3s:21.50 ms;相對 CUDA -32.2% · 1.47× Offline TRT · 6s:34.56 ms;相對 CUDA -18.0% · 1.22× Offline TRT · 15s:77.84 ms;相對 CUDA -5.6% · 1.06× 3 秒 · 相對 CUDA ● CUDA 31.71 ms CUDA 基準● Online TRT 23.24 ms -26.7% · 1.36×● Offline TRT 21.50 ms -32.2% · 1.47×6 秒 · 相對 CUDA ● CUDA 42.17 ms CUDA 基準● Online TRT 32.44 ms -23.1% · 1.30×● Offline TRT 34.56 ms -18.0% · 1.22×15 秒 · 相對 CUDA ● CUDA 82.45 ms CUDA 基準● Online TRT 75.49 ms -8.4% · 1.09×● Offline TRT 77.84 ms -5.6% · 1.06×bulk 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 0 20 41 61 82 3s 6s 15s ms CUDA CUDA · 3s:38.60 ms;CUDA 基準 CUDA · 6s:49.53 ms;CUDA 基準 CUDA · 15s:70.24 ms;CUDA 基準 Online TRT Online TRT · 3s:28.92 ms;相對 CUDA -25.1% · 1.33× Online TRT · 6s:34.59 ms;相對 CUDA -30.2% · 1.43× Online TRT · 15s:71.21 ms;相對 CUDA +1.4% · 0.99× Offline TRT Offline TRT · 3s:26.75 ms;相對 CUDA -30.7% · 1.44× Offline TRT · 6s:42.81 ms;相對 CUDA -13.6% · 1.16× Offline TRT · 15s:67.04 ms;相對 CUDA -4.6% · 1.05× 3 秒 · 相對 CUDA ● CUDA 38.60 ms CUDA 基準● Online TRT 28.92 ms -25.1% · 1.33×● Offline TRT 26.75 ms -30.7% · 1.44×6 秒 · 相對 CUDA ● CUDA 49.53 ms CUDA 基準● Online TRT 34.59 ms -30.2% · 1.43×● Offline TRT 42.81 ms -13.6% · 1.16×15 秒 · 相對 CUDA ● CUDA 70.24 ms CUDA 基準● Online TRT 71.21 ms +1.4% · 0.99×● Offline TRT 67.04 ms -4.6% · 1.05×realtime 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 完整服務精確數值 送音 音長 後端 中位數 ms 範圍 ms 相對 CUDA bulk 3s CUDA 31.71 30.42–35.40 基準 bulk 3s Online TRT 23.24 22.02–25.36 -26.7% bulk 3s Offline TRT 21.50 21.28–24.46 -32.2% bulk 6s CUDA 42.17 42.06–46.23 基準 bulk 6s Online TRT 32.44 32.32–34.89 -23.1% bulk 6s Offline TRT 34.56 33.07–35.88 -18.0% bulk 15s CUDA 82.45 79.73–88.65 基準 bulk 15s Online TRT 75.49 75.09–83.16 -8.4% bulk 15s Offline TRT 77.84 74.93–102.36 -5.6% realtime 3s CUDA 38.60 31.54–45.38 基準 realtime 3s Online TRT 28.92 25.20–30.20 -25.1% realtime 3s Offline TRT 26.75 20.02–36.02 -30.7% realtime 6s CUDA 49.53 44.10–49.96 基準 realtime 6s Online TRT 34.59 32.39–46.54 -30.2% realtime 6s Offline TRT 42.81 39.86–51.43 -13.6% realtime 15s CUDA 70.24 69.04–75.13 基準 realtime 15s Online TRT 71.21 69.04–75.40 +1.4% realtime 15s Offline TRT 67.04 65.81–68.36 -4.6%
Direct recognizer 與 graph Direct recognizer 量 accept_waveform + decode_stream,與完整服務 final ASR 的計時範圍不同。
音長 後端 recognizer p50 ms p95 ms 載入 s 3s CUDA 12.36 12.43 1.989 6s CUDA 16.92 24.30 1.319 15s CUDA 33.49 45.21 2.254 3s Online TRT 16.44 16.56 47.980 6s Online TRT 21.71 29.88 11.307 15s Online TRT 29.02 34.47 10.720 3s Offline TRT 16.32 16.54 2.708 6s Offline TRT 17.04 23.52 2.531 15s Offline TRT 46.47 62.50 1.777
後端 graph p50 ms p95 ms CUDA T=50 8.54 9.07 CUDA T=100 8.94 9.47 CUDA T=250 11.34 11.89 Online TRT T=50 9.02 9.65 Online TRT T=100 6.14 6.45 Online TRT T=250 10.23 10.61 Offline TRT T=50 6.09 6.19 Offline TRT T=100 5.83 6.02 Offline TRT T=250 9.76 13.66
CUDA:{'CUDAExecutionProvider': 2908, 'CPUExecutionProvider': 785} Online TRT:{'TensorrtExecutionProvider': 1} Offline TRT:{'TensorrtExecutionProvider': 1}
4090 上一輪與本輪差異 主畫面使用本輪重測;這張表只保留歷史比對。
後端 送音 音長 上一輪 ms 本輪 ms 差異 CUDA bulk 3s 22.45 31.71 +41.2% CUDA bulk 6s 26.83 42.17 +57.2% CUDA bulk 15s 72.64 82.45 +13.5% CUDA realtime 3s 28.21 38.60 +36.8% CUDA realtime 6s 30.55 49.53 +62.1% CUDA realtime 15s 74.55 70.24 -5.8% Online TRT bulk 3s 13.34 23.24 +74.2% Online TRT bulk 6s 17.97 32.44 +80.5% Online TRT bulk 15s 75.10 75.49 +0.5% Online TRT realtime 3s 17.98 28.92 +60.8% Online TRT realtime 6s 13.37 34.59 +158.7% Online TRT realtime 15s 54.44 71.21 +30.8%
記憶體測試 容量主指標 CUDA · 2014 MiB 完整服務推論後 cgroup current
量測內容 RAM cgroup、PSS、RSS、VmHWM、peak
VRAM 4090 有 整卡 nvidia-smi 快照
MiB CUDA CUDA:2014.01 MiB 2014 Online TRT Online TRT:7643.71 MiB 7644 Offline TRT Offline TRT:3058.70 MiB 3059 完整服務推論後 cgroup current;同一平台內可直接比較後端。容量判讀以完整服務推論後的 cgroup current 為主;PSS、RSS、VmHWM 與 cgroup peak 放在詳細表。 完整服務 RAM 指標 後端 時點 cgroup current PSS RSS VmHWM cgroup peak CUDA 載入完成 1901.11 2258.27 2265.41 2359.09 2001.46 CUDA 完整服務推論後 2014.01 2371.13 2378.18 2411.01 2411.02 Online TRT 載入完成 7540.01 8955.07 8962.12 9638.14 8225.70 Online TRT 完整服務推論後 7643.71 9057.88 9065.01 9638.14 8225.70 Offline TRT 載入完成 2949.81 1994.22 2001.32 2917.75 3875.99 Offline TRT 完整服務推論後 3058.70 2102.94 2110.12 2917.75 3875.99
Direct recognizer RAM 中位數 後端 cgroup current PSS RSS VmHWM CUDA 1104.79 1318.78 1323.22 1354.52 Online TRT 5834.54 7532.29 7537.36 9411.94 Offline TRT 588.89 963.31 968.43 1571.82
RTX 4090 整卡 VRAM 整卡 VRAM 包含背景程序,僅以同測項前後差作近似增量。
後端 測前 MiB 推論後 MiB 增量 MiB CUDA 2540 5035 +2495 Online TRT 2540 5199 +2659 Offline TRT 2540 5193 +2653
指標與量測手法 指標 意思/讀取方式 cgroup current 容器目前被計帳的 RAM,包含檔案快取;從 /sys/fs/cgroup/memory.current 讀取,容量決策優先看這個。 PSS 程序按比例分攤共享頁;從 PID 1 smaps_rollup 讀取。 RSS / VmHWM 程序常駐 RAM/程序啟動後最高 RSS;從 PID 1 status 讀取。 cgroup peak 容器歷史最高計帳 RAM;可能包含 direct 測試的暫用子程序。
資料:本輪完整資料 · 早期重測原始資料 · 部署重測原始資料
Online TRT/Offline TRT 未列數值。 libonnxruntime_providers_tensorrt.so resolves libnvinfer.so.10 and libnvonnxparser.so.10 as not found. A TensorRT EP session falls back to CPU, so no Online/Offline TRT latency is reported.
時間測試 記憶體測試
時間測試 完整服務 3 輪、每輪一條 WebSocket、固定 3/6/15 秒 WAV,warmup=0;bulk 與 realtime 分開執行。 完整服務 18/18 final ASR 成功。僅在同一平台內比較後端;不同版本與硬體不做絕對毫秒排名。
0 61 121 182 242 3s 6s 15s ms CUDA CUDA · 3s:78.46 ms;CUDA 基準 CUDA · 6s:122.45 ms;CUDA 基準 CUDA · 15s:210.71 ms;CUDA 基準 3 秒 · 相對 CUDA ● CUDA 78.46 ms CUDA 基準6 秒 · 相對 CUDA ● CUDA 122.45 ms CUDA 基準15 秒 · 相對 CUDA ● CUDA 210.71 ms CUDA 基準bulk 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 0 42 84 126 168 3s 6s 15s ms CUDA CUDA · 3s:79.65 ms;CUDA 基準 CUDA · 6s:89.87 ms;CUDA 基準 CUDA · 15s:145.97 ms;CUDA 基準 3 秒 · 相對 CUDA ● CUDA 79.65 ms CUDA 基準6 秒 · 相對 CUDA ● CUDA 89.87 ms CUDA 基準15 秒 · 相對 CUDA ● CUDA 145.97 ms CUDA 基準realtime 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 完整服務精確數值 送音 音長 後端 中位數 ms 範圍 ms 相對 CUDA bulk 3s CUDA 78.46 75.76–84.61 基準 bulk 6s CUDA 122.45 118.16–136.35 基準 bulk 15s CUDA 210.71 192.25–211.00 基準 realtime 3s CUDA 79.65 78.36–83.68 基準 realtime 6s CUDA 89.87 80.21–91.35 基準 realtime 15s CUDA 145.97 127.90–147.93 基準
Direct recognizer 與 graph Direct recognizer 量 accept_waveform + decode_stream,與完整服務 final ASR 的計時範圍不同。
音長 後端 recognizer p50 ms p95 ms 載入 s 3s CUDA 23.91 24.26 1.667 6s CUDA 30.97 31.40 1.539 15s CUDA 53.84 55.10 1.507
後端 graph p50 ms p95 ms CUDA T=50 35.10 37.37 CUDA T=100 35.74 38.20 CUDA T=250 41.07 41.79
CUDA:CUDA only;此輪 JSON 未保留 provider node 計數。
記憶體測試 容量主指標 CUDA · 1368 MiB 完整服務推論後 cgroup current
量測內容 RAM cgroup、PSS、RSS、VmHWM、peak
VRAM 不另拆 共用記憶體或容器未提供逐程序指標
MiB CUDA CUDA:1368.30 MiB 1368 完整服務推論後 cgroup current;同一平台內可直接比較後端。cgroup_peak includes temporary direct graph/recognizer processes. Use after_inference.cgroup_current for the steady service footprint after those processes exited. Thor uses shared LPDDR; no separate per-process VRAM metric exists. 完整服務 RAM 指標 後端 時點 cgroup current PSS RSS VmHWM cgroup peak CUDA 服務 ready 1368.30 1438.17 1460.63 1497.40 1410.16 CUDA 完整服務推論後 2216.83 1887.51 1909.70 1945.24 6495.59
指標與量測手法 指標 意思/讀取方式 cgroup current 容器目前被計帳的 RAM,包含檔案快取;從 /sys/fs/cgroup/memory.current 讀取,容量決策優先看這個。 PSS 程序按比例分攤共享頁;從 PID 1 smaps_rollup 讀取。 RSS / VmHWM 程序常駐 RAM/程序啟動後最高 RSS;從 PID 1 status 讀取。 cgroup peak 容器歷史最高計帳 RAM;可能包含 direct 測試的暫用子程序。
資料:完整原始資料
時間測試 記憶體測試
時間測試 完整服務各後端 3 輪、每輪一條 WebSocket、固定 3/6/15 秒 WAV,warmup=0;bulk 與 realtime 分開執行。Direct recognizer 使用新程序。 完整服務 54/54 final ASR 成功。僅在同一平台內比較後端;不同版本與硬體不做絕對毫秒排名。
0 70 140 210 280 3s 6s 15s ms CUDA CUDA · 3s:126.92 ms;CUDA 基準 CUDA · 6s:152.80 ms;CUDA 基準 CUDA · 15s:243.12 ms;CUDA 基準 Online TRT Online TRT · 3s:84.60 ms;相對 CUDA -33.3% · 1.50× Online TRT · 6s:103.63 ms;相對 CUDA -32.2% · 1.47× Online TRT · 15s:220.80 ms;相對 CUDA -9.2% · 1.10× Offline TRT Offline TRT · 3s:84.44 ms;相對 CUDA -33.5% · 1.50× Offline TRT · 6s:110.24 ms;相對 CUDA -27.9% · 1.39× Offline TRT · 15s:219.64 ms;相對 CUDA -9.7% · 1.11× 3 秒 · 相對 CUDA ● CUDA 126.92 ms CUDA 基準● Online TRT 84.60 ms -33.3% · 1.50×● Offline TRT 84.44 ms -33.5% · 1.50×6 秒 · 相對 CUDA ● CUDA 152.80 ms CUDA 基準● Online TRT 103.63 ms -32.2% · 1.47×● Offline TRT 110.24 ms -27.9% · 1.39×15 秒 · 相對 CUDA ● CUDA 243.12 ms CUDA 基準● Online TRT 220.80 ms -9.2% · 1.10×● Offline TRT 219.64 ms -9.7% · 1.11×bulk 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 0 64 129 193 258 3s 6s 15s ms CUDA CUDA · 3s:123.29 ms;CUDA 基準 CUDA · 6s:133.25 ms;CUDA 基準 CUDA · 15s:208.59 ms;CUDA 基準 Online TRT Online TRT · 3s:68.59 ms;相對 CUDA -44.4% · 1.80× Online TRT · 6s:90.65 ms;相對 CUDA -32.0% · 1.47× Online TRT · 15s:180.86 ms;相對 CUDA -13.3% · 1.15× Offline TRT Offline TRT · 3s:68.73 ms;相對 CUDA -44.3% · 1.79× Offline TRT · 6s:91.40 ms;相對 CUDA -31.4% · 1.46× Offline TRT · 15s:223.92 ms;相對 CUDA +7.3% · 0.93× 3 秒 · 相對 CUDA ● CUDA 123.29 ms CUDA 基準● Online TRT 68.59 ms -44.4% · 1.80×● Offline TRT 68.73 ms -44.3% · 1.79×6 秒 · 相對 CUDA ● CUDA 133.25 ms CUDA 基準● Online TRT 90.65 ms -32.0% · 1.47×● Offline TRT 91.40 ms -31.4% · 1.46×15 秒 · 相對 CUDA ● CUDA 208.59 ms CUDA 基準● Online TRT 180.86 ms -13.3% · 1.15×● Offline TRT 223.92 ms +7.3% · 0.93×realtime 三輪中位數;點上 hover 可看後端、毫秒與相對 CUDA。 完整服務精確數值 送音 音長 後端 中位數 ms 範圍 ms 相對 CUDA bulk 3s CUDA 126.92 124.69–127.40 基準 bulk 3s Online TRT 84.60 84.25–84.77 -33.3% bulk 3s Offline TRT 84.44 77.04–85.09 -33.5% bulk 6s CUDA 152.80 152.50–158.44 基準 bulk 6s Online TRT 103.63 103.50–109.73 -32.2% bulk 6s Offline TRT 110.24 105.21–110.66 -27.9% bulk 15s CUDA 243.12 241.65–252.72 基準 bulk 15s Online TRT 220.80 219.67–235.42 -9.2% bulk 15s Offline TRT 219.64 218.08–233.67 -9.7% realtime 3s CUDA 123.29 121.53–135.33 基準 realtime 3s Online TRT 68.59 64.88–72.12 -44.4% realtime 3s Offline TRT 68.73 68.22–69.53 -44.3% realtime 6s CUDA 133.25 133.20–153.32 基準 realtime 6s Online TRT 90.65 90.14–91.05 -32.0% realtime 6s Offline TRT 91.40 91.19–91.54 -31.4% realtime 15s CUDA 208.59 208.51–247.52 基準 realtime 15s Online TRT 180.86 179.69–224.94 -13.3% realtime 15s Offline TRT 223.92 179.19–225.47 +7.3%
Direct recognizer 與 graph Direct recognizer 量 accept_waveform + decode_stream,與完整服務 final ASR 的計時範圍不同。
音長 後端 recognizer p50 ms p95 ms 載入 s 3s CUDA 45.15 45.20 3.309 6s CUDA 54.48 79.44 3.000 15s CUDA 88.11 106.34 2.992 3s Online TRT 28.66 28.83 69.029 6s Online TRT 40.08 55.03 16.752 15s Online TRT 81.25 88.91 16.424 3s Offline TRT 27.78 28.05 8.038 6s Offline TRT 39.62 52.00 7.964 15s Offline TRT 80.49 85.62 7.950
後端 graph p50 ms p95 ms CUDA T=50 36.72 37.76 CUDA T=100 37.36 37.90 CUDA T=250 44.94 45.02 Online TRT T=50 20.35 20.43 Online TRT T=100 20.98 21.20 Online TRT T=250 40.21 40.36 Offline TRT T=50 19.26 19.35 Offline TRT T=100 20.18 20.24 Offline TRT T=250 37.88 38.16
CUDA:{'CUDAExecutionProvider': 2908, 'CPUExecutionProvider': 785} Online TRT:{'TensorrtExecutionProvider': 1} Offline TRT:{'TensorrtExecutionProvider': 1}
記憶體測試 容量主指標 Offline TRT · 3841 MiB 完整服務推論後 cgroup current
量測內容 RAM cgroup、PSS、RSS、VmHWM、peak
VRAM 不另拆 共用記憶體或容器未提供逐程序指標
MiB CUDA CUDA:3912.67 MiB 3913 Online TRT Online TRT:8629.85 MiB 8630 Offline TRT Offline TRT:3840.65 MiB 3841 完整服務推論後 cgroup current;同一平台內可直接比較後端。容量判讀以完整服務推論後的 cgroup current 為主;PSS、RSS、VmHWM 與 cgroup peak 放在詳細表。 完整服務 RAM 指標 後端 時點 cgroup current PSS RSS VmHWM cgroup peak CUDA 載入完成 3788.12 1640.82 3884.71 3908.00 — CUDA 完整服務推論後 3912.67 1744.22 4010.12 4053.75 — Online TRT 載入完成 8453.74 6309.40 8726.87 9447.70 — Online TRT 完整服務推論後 8629.85 6412.33 8905.12 9447.70 — Offline TRT 載入完成 3653.68 1457.86 3803.24 4286.32 — Offline TRT 完整服務推論後 3840.65 1570.06 3990.62 4286.32 —
Direct recognizer RAM 中位數 後端 cgroup current PSS RSS VmHWM CUDA 2187.54 1097.73 2299.20 2348.36 Online TRT 7759.07 5522.38 7027.82 8613.00 Offline TRT 850.67 864.86 2174.70 2280.00
指標與量測手法 指標 意思/讀取方式 cgroup current 容器目前被計帳的 RAM,包含檔案快取;從 /sys/fs/cgroup/memory.current 讀取,容量決策優先看這個。 PSS 程序按比例分攤共享頁;從 PID 1 smaps_rollup 讀取。 RSS / VmHWM 程序常駐 RAM/程序啟動後最高 RSS;從 PID 1 status 讀取。 cgroup peak 容器歷史最高計帳 RAM;可能包含 direct 測試的暫用子程序。
資料:本輪完整資料 · 早期重測原始資料 · 部署重測原始資料