LLM Latency Tracker
Measured latency, time to first token and uptime for ~45 AI inference APIs, by region.
使うべきか
品質と安全性
A
ツール定義とプロトコルへの準拠に関する自動分析に基づいています。
コンテキストコスト
~183トークン数(ツール定義)
~422 B一般的なレスポンスサイズ
注意への影響は最小限(128k コンテキストの 0.14%)
これは、サーバーのツールがモデルのコンテキストに読み込まれるたびに消費されるおおよそのトークン数です。数が多いほど、ほかのタスクに使える注意が減ります。
インストール
ワンクリックインストール
これを `claude_desktop_config.json` ファイルに追加してください:
{
"mcpServers": {
"llm-latency-tracker": {
"url": "https://llmlatency.dev/mcp"
}
}
}リモートエンドポイント
https://llmlatency.dev/mcpstreamable-httpできること
ツール一覧
ツール(2)
🟢 読み取り専用🟡 書き込み🔴 削除⚪ 不明
🟢get_ai_api_latency(region)
Measured latency (TTFB p50/p95) and uptime rankings of AI inference API providers by region, from llmlatency.dev.
入力スキーマ
{
"type": "object",
"properties": {
"region": {
"type": "string",
"description": "eu-hetzner, us-central, ap-tokyo or sa-east; omit for all"
}
}
}🟢get_model_deprecations(provider)
AI model deprecation calendar: announced and shutdown dates, replacement models, and how many days of migration notice each provider actually gives (median/min/max). Every entry is verified against the provider own deprecation page.
入力スキーマ
{
"type": "object",
"properties": {
"provider": {
"type": "string",
"description": "openai, anthropic, google, mistral, cohere, azure-openai; omit for all"
}
}
}コミュニティ
エビデンス
最近の観測
検証済みバージョンは記録されていませんツール 2 件
検証済みバージョンは記録されていませんツール 2 件