Jwrede/llmprobe
🪟 - Monitoreo sintético para puntos finales de inferencia LLM. Mida TTFT, latencia, rendimiento y errores en OpenAI, Anthropic, Google, Azure, Bedrock y servidores locales (vLLM, SGLang, Ollama). Servidor CLI + MCP con exportación Prometheus y OpenTelemetry.
@falken-oficial30/7/2026
#monitoring
Inicia sesión para reportar contenido.