截至 2026年8月,AlphaMoat 收錄帶「AI 可觀測與評測」標籤的 AI 網站產品 367 個。其中訪問量最高的是 Arena,月訪問 2994萬(環比 -7%)。按最新月訪問量排行,每月更新。
| # | 產品 | 公司 | 行業 | 月訪問量 | 環比 |
|---|---|---|---|---|---|
| 1 | LMArena | 資訊分析 | 2994萬 | -7% | |
| 2 | 獨立比較 AI 模型與介面提供商表現 | Artificial Analysis | 通用 AI | 768.8萬 | +25.8% |
| 3 | 面向任意技術棧的 AI 可觀測與安全平台 | Datadog | 程式設計開發 | 570.7萬 | -6.2% |
| 4 | 自動診斷產品問題、修復錯誤並生成程式碼變更 | PostHog | 程式設計開發 | 335.6萬 | +3.5% |
| 5 | 幫助開發團隊發現錯誤並監控應用效能 | Sentry | 程式設計開發 | 299.8萬 | -8.4% |
| 6 | Toloka | 通用 AI | 238.8萬 | -9.2% | |
| 7 | Weights & Biases | 通用 AI | 198.8萬 | -4.6% | |
| 8 | 用多個不同 AI 模型生成並對比設計作品的競技平台 | Design Arena | 通用 AI | 127.4萬 | -11.3% |
| 9 | LLM Stats | 通用 AI | 115.5萬 | +5.6% | |
| 10 | 統一觀測指標、日誌與鏈路並輔助排障的雲平台 | Grafana | 程式設計開發 | 114.8萬 | -9.6% |
| 11 | 聚合 Codex 等 AI 程式設計賬號眾測資料與社群經驗的雷達站 | CodexRadar | 通用 AI | 94.6萬 | +3.2% |
| 12 | Harness | 程式設計開發 | 87.2萬 | -2.2% | |
| 13 | 面向生產的 OpenAI 相容 AI 閘道器,統一排程多模型 | OrcaRouter | 通用 AI | 83.3萬 | +931.4% |
| 14 | 開源追蹤、評測並持續改進生產中的 AI 智慧體 | Langfuse | 通用 AI | 82.9萬 | -13.4% |
| 15 | Epoch AI | 資訊分析 | 60.9萬 | +12.3% | |
| 16 | Scale | 通用 AI | 57萬 | -4.3% | |
| 17 | 統一事故響應、值班與日誌指標追蹤的 AI SRE | Better Stack | 程式設計開發 | 55萬 | +2.7% |
| 18 | 端到端的AI工程化技術棧 | Pydantic | 程式設計開發 | 45.4萬 | -15.3% |
| 19 | METR | 通用 AI | 44.7萬 | +76.2% | |
| 20 | Comet ML | 通用 AI | 28.3萬 | -30.7% | |
| 21 | LMSYS | 通用 AI | 26.8萬 | -7.4% | |
| 22 | 為 AI 時代軟體提供統一遙測與快速可觀測查詢 | Hound Technology | 通用 AI | 24萬 | -19.1% |
| 23 | 即時追蹤評測並定位 AI 智慧體退化問題 | Braintrust | 通用 AI | 23.9萬 | -16.2% |
| 24 | WakaTime | 程式設計開發 | 23.6萬 | -20.2% | |
| 25 | Arize AI | 通用 AI | 23.5萬 | -8% | |
| 26 | 為生成式 AI 應用提供閘道器、路由、日誌與提示管理 | Portkey | 通用 AI | 22.6萬 | -15% |
| 27 | 為語音與對話 AI 收集真人反饋並持續評估表現 | Hume AI | 音訊 | 21.1萬 | -20.4% |
| 28 | MLflow | 通用 AI | 18.6萬 | -19.2% | |
| 29 | 為多模態訓練資料、代理軌跡和 LLM 評估提供開源標註 | HumanSignal | 通用 AI | 18.6萬 | -3.7% |
| 30 | 面向前沿大模型的資料開發與評測基礎設施 | Snorkel AI | 通用 AI | 18.5萬 | -6.9% |
| 31 | Vectra | 程式設計開發 | 17.6萬 | +1.7% | |
| 32 | Galileo | 通用 AI | 17.3萬 | -8.1% | |
| 33 | Vals | 通用 AI | 16.7萬 | -11.3% | |
| 34 | H3 Labs | 通用 AI | 16.2萬 | +38.6% | |
| 35 | 把同一提示傳送給 25 個模型做共識比對的工具 | PromptQuorum | 通用 AI | 16.1萬 | +20.2% |
| 36 | 開源評測和紅隊測試大模型應用與智慧體 | Promptfoo | 通用 AI | 15.8萬 | -13.7% |
| 37 | 開源評測和監控大模型檢索與機器學習系統 | Evidently AI | 通用 AI | 15.7萬 | -5.8% |
| 38 | 記錄評測並管理大模型提示詞版本 | PromptLayer | 通用 AI | 11.9萬 | -10.9% |
| 39 | 模擬評測監控並改善生產環境 AI 智慧體 | Future AGI | 通用 AI | 11.7萬 | +43.3% |
| 40 | 為企業統一大模型評測、追蹤與生產可觀測性 | Confident AI | 通用 AI | 11.5萬 | -1.3% |
| 41 | Voxel51 | 通用 AI | 10.8萬 | -17.7% | |
| 42 | Latitude | 通用 AI | 10.1萬 | -18.6% | |
| 43 | 觀測評測並管理生產 AI 模型與提示詞 | Keywords AI | 通用 AI | 8.9萬 | +28.8% |
| 44 | 統一路由並監控大模型請求的 LLMOps 平台 | Helicone | 通用 AI | 8.5萬 | -17.3% |
| 45 | 歐盟託管並統一接入多家模型的 AI 智慧體閘道器 | Opper | 通用 AI | 8.2萬 | +5.2% |
| 46 | 企業級AI資料與實施服務,覆蓋多模態採集、標註與評測 | YPAI | 通用 AI | 8萬 | +7.2% |
| 47 | 斯坦福出品的免費AI論文評審工具 | Stanford Agentic Reviewer | 教育科研 | 7.1萬 | -42.8% |
| 48 | 主權級 AI 閘道器與智慧體平台 | Orq.ai | 通用 AI | 7萬 | +0.8% |
| 49 | Cekura | 通用 AI | 6.6萬 | +35.5% | |
| 50 | 真實編碼任務的 AI 模型評測基準 | World of AI Bench | 通用 AI | 6.4萬 | +50.8% |
2026年8月,按月訪問量計,「AI 可觀測與評測」相關網站排名第一的是 Arena(月訪問 2994萬);其後是 Artificial Analysis(月訪問 768.8萬)、Datadog(月訪問 570.7萬)。
按月訪問量從高到低,前 10 名依次為:1. Arena、2. Artificial Analysis、3. Datadog、4. PostHog、5. Sentry、6. Toloka、7. Prompts、8. Design Arena、9. LLM Stats、10. Grafana Labs。
AlphaMoat 共收錄 367 個「AI 可觀測與評測」相關網站,按月訪問量排名。訪問量為第三方流量估算,按月聚合,同一產品的多個域名已合併統計。資料每月更新,當前為 2026年8月 資料。
資料月份:2026-08 · 訪問量為第三方流量估算,按月聚合更新,適合看量級與趨勢。同一產品的多個域名已合併統計。口徑說明見資料方法。