LLM Latency Tracker
Measured latency, time to first token and uptime for ~45 AI inference APIs, by region.
Sollte ich dies verwenden
Qualität und Sicherheit
Basierend auf einer automatisierten Analyse der Tool-Definitionen und der Einhaltung des Protokolls.
Kontextkosten
Dies ist die ungefähre Anzahl der Tokens, die jedes Mal verbraucht werden, wenn die Tools des Servers in den Kontext eines Modells geladen werden. Höhere Werte verringern die Aufmerksamkeit, die für andere Aufgaben verfügbar ist.
Installieren
Installation mit einem Klick
Fügen Sie dies Ihrer Datei `claude_desktop_config.json` hinzu:
{
"mcpServers": {
"llm-latency-tracker": {
"url": "https://llmlatency.dev/mcp"
}
}
}Remote-Endpunkte
https://llmlatency.dev/mcpstreamable-httpWas es kann
Tool-Inventar
Tools (2)
🟢get_ai_api_latency(region)
Measured latency (TTFB p50/p95) and uptime rankings of AI inference API providers by region, from llmlatency.dev.
Eingabe-Schema
{
"type": "object",
"properties": {
"region": {
"type": "string",
"description": "eu-hetzner, us-central, ap-tokyo or sa-east; omit for all"
}
}
}🟢get_model_deprecations(provider)
AI model deprecation calendar: announced and shutdown dates, replacement models, and how many days of migration notice each provider actually gives (median/min/max). Every entry is verified against the provider own deprecation page.
Eingabe-Schema
{
"type": "object",
"properties": {
"provider": {
"type": "string",
"description": "openai, anthropic, google, mistral, cohere, azure-openai; omit for all"
}
}
}Community
Nachweis