資料月份 2026-08

「AI 可觀測與評測」工具排行榜

截至 2026年8月,AlphaMoat 收錄帶「AI 可觀測與評測」標籤的 AI 網站產品 367 個。其中訪問量最高的是 Arena,月訪問 2994萬(環比 -7%)。按最新月訪問量排行,每月更新。

#產品公司行業月訪問量環比
1
Arena
由社群投票產生的大模型公開榜單
LMArena資訊分析2994萬-7%
2
Artificial Analysis
獨立比較 AI 模型與介面提供商表現
Artificial Analysis通用 AI768.8萬+25.8%
3
Datadog
面向任意技術棧的 AI 可觀測與安全平台
Datadog程式設計開發570.7萬-6.2%
4
PostHog
自動診斷產品問題、修復錯誤並生成程式碼變更
PostHog程式設計開發335.6萬+3.5%
5
Sentry
幫助開發團隊發現錯誤並監控應用效能
Sentry程式設計開發299.8萬-8.4%
6
Toloka
融合人類專家與技術的智慧體和大模型訓練資料平台
Toloka通用 AI238.8萬-9.2%
7
Prompts
跟蹤、視覺化並改進機器學習實驗流程
Weights & Biases通用 AI198.8萬-4.6%
8
Design Arena
用多個不同 AI 模型生成並對比設計作品的競技平台
Design Arena通用 AI127.4萬-11.3%
9
LLM Stats
按智慧、速度和價格比較主流 AI 模型排名
LLM Stats通用 AI115.5萬+5.6%
10
Grafana Labs
統一觀測指標、日誌與鏈路並輔助排障的雲平台
Grafana程式設計開發114.8萬-9.6%
11
CodexRadar
聚合 Codex 等 AI 程式設計賬號眾測資料與社群經驗的雷達站
CodexRadar通用 AI94.6萬+3.2%
12
Harness
覆蓋交付、測試、安全與成本最佳化的 AI DevOps 平台
Harness程式設計開發87.2萬-2.2%
13
OrcaRouter
面向生產的 OpenAI 相容 AI 閘道器,統一排程多模型
OrcaRouter通用 AI83.3萬+931.4%
14
Langfuse
開源追蹤、評測並持續改進生產中的 AI 智慧體
Langfuse通用 AI82.9萬-13.4%
15
Epoch AI
研究智慧算力模型能力和行業發展趨勢
Epoch AI資訊分析60.9萬+12.3%
16
Scale
提供訓練資料評測與全棧技術構建可靠智慧系統
Scale通用 AI57萬-4.3%
17
Better Stack
統一事故響應、值班與日誌指標追蹤的 AI SRE
Better Stack程式設計開發55萬+2.7%
18
Pydantic
端到端的AI工程化技術棧
Pydantic程式設計開發45.4萬-15.3%
19
METR
獨立評估前沿 AI 能力風險與真實工作影響
METR通用 AI44.7萬+76.2%
20
Comet
追蹤評測除錯並持續改進智慧應用和代理
Comet ML通用 AI28.3萬-30.7%
21
lmsys
孵化開放可訪問且可擴充套件的大模型系統
LMSYS通用 AI26.8萬-7.4%
22
Honeycomb
為 AI 時代軟體提供統一遙測與快速可觀測查詢
Hound Technology通用 AI24萬-19.1%
23
Braintrust
即時追蹤評測並定位 AI 智慧體退化問題
Braintrust通用 AI23.9萬-16.2%
24
WakaTime
量化個人與團隊的 AI 程式設計活動和成本
WakaTime程式設計開發23.6萬-20.2%
25
Arize AI
持續追蹤、評估和實驗以改進生產環境中的 AI 代理
Arize AI通用 AI23.5萬-8%
26
Portkey
為生成式 AI 應用提供閘道器、路由、日誌與提示管理
Portkey通用 AI22.6萬-15%
27
Hume AI
為語音與對話 AI 收集真人反饋並持續評估表現
Hume AI音訊21.1萬-20.4%
28
Mlflow
開源管理評測監控智慧體大模型和機器學習
MLflow通用 AI18.6萬-19.2%
29
Label Studio
為多模態訓練資料、代理軌跡和 LLM 評估提供開源標註
HumanSignal通用 AI18.6萬-3.7%
30
Snorkel AI
面向前沿大模型的資料開發與評測基礎設施
Snorkel AI通用 AI18.5萬-6.9%
31
Vectra
跨網路身份雲和 AI 環境發現即時攻擊訊號
Vectra程式設計開發17.6萬+1.7%
32
Galileo
AI 可觀測與評估工程平台
Galileo通用 AI17.3萬-8.1%
33
Vals
AI獨立評測基準平台
Vals通用 AI16.7萬-11.3%
34
Getmaxim
模擬評測並即時觀察生成式 AI 智慧體
H3 Labs通用 AI16.2萬+38.6%
35
PromptQuorum
把同一提示傳送給 25 個模型做共識比對的工具
PromptQuorum通用 AI16.1萬+20.2%
36
Promptfoo
開源評測和紅隊測試大模型應用與智慧體
Promptfoo通用 AI15.8萬-13.7%
37
Evidentlyai
開源評測和監控大模型檢索與機器學習系統
Evidently AI通用 AI15.7萬-5.8%
38
PromptLayer
記錄評測並管理大模型提示詞版本
PromptLayer通用 AI11.9萬-10.9%
39
Future AGI
模擬評測監控並改善生產環境 AI 智慧體
Future AGI通用 AI11.7萬+43.3%
40
Confident Ai
為企業統一大模型評測、追蹤與生產可觀測性
Confident AI通用 AI11.5萬-1.3%
41
Voxel51
面向物理 AI 的多模態資料整理平台
Voxel51通用 AI10.8萬-17.7%
42
Latitude
開源 AI 智慧體可觀測性平台,定位生產失敗並派編碼智慧體修復
Latitude通用 AI10.1萬-18.6%
43
Respan
觀測評測並管理生產 AI 模型與提示詞
Keywords AI通用 AI8.9萬+28.8%
44
Helicone
統一路由並監控大模型請求的 LLMOps 平台
Helicone通用 AI8.5萬-17.3%
45
Opper AI
歐盟託管並統一接入多家模型的 AI 智慧體閘道器
Opper通用 AI8.2萬+5.2%
46
Yourpersonalai
企業級AI資料與實施服務,覆蓋多模態採集、標註與評測
YPAI通用 AI8萬+7.2%
47
Stanford Agentic Reviewer
斯坦福出品的免費AI論文評審工具
Stanford Agentic Reviewer教育科研7.1萬-42.8%
48
Orq.ai
主權級 AI 閘道器與智慧體平台
Orq.ai通用 AI7萬+0.8%
49
Cekura
面向語音與對話智慧體的自動化測試平台
Cekura通用 AI6.6萬+35.5%
50
World of AI Bench
真實編碼任務的 AI 模型評測基準
World of AI Bench通用 AI6.4萬+50.8%
瀏覽全部 367 個「AI 可觀測與評測」產品 →

相關標籤

常見問題

「AI 可觀測與評測」相關網站哪個排名第一?

2026年8月,按月訪問量計,「AI 可觀測與評測」相關網站排名第一的是 Arena(月訪問 2994萬);其後是 Artificial Analysis(月訪問 768.8萬)、Datadog(月訪問 570.7萬)。

「AI 可觀測與評測」相關網站前 10 名有哪些?

按月訪問量從高到低,前 10 名依次為:1. Arena、2. Artificial Analysis、3. Datadog、4. PostHog、5. Sentry、6. Toloka、7. Prompts、8. Design Arena、9. LLM Stats、10. Grafana Labs。

AlphaMoat 收錄了多少個「AI 可觀測與評測」相關網站?資料從哪裡來?

AlphaMoat 共收錄 367 個「AI 可觀測與評測」相關網站,按月訪問量排名。訪問量為第三方流量估算,按月聚合,同一產品的多個域名已合併統計。資料每月更新,當前為 2026年8月 資料。

資料月份:2026-08 · 訪問量為第三方流量估算,按月聚合更新,適合看量級與趨勢。同一產品的多個域名已合併統計。口徑說明見資料方法。