Una auditoría de 36 servidores MCP revela que un tercio suspende a los agentes de IA
I graded 36 popular MCP servers on agent usability. A third got a D or F

El autor, que integra conectores MCP en un agente de IA de producción, analiza 36 servidores populares con su herramienta mcpgrade, un scorecard estilo Lighthouse. El resultado: un tercio obtiene calificaciones D o F, incluidos servidores oficiales de MongoDB, Notion y Airtable. El problema principal no está en el protocolo, sino en la documentación: parámetros sin descripción, nombres ambiguos y esquemas que no guían al modelo. Las pruebas con modelos reales muestran que los catálogos grandes y poco documentados reducen la precisión y, peor aún, hacen que el agente invente herramientas cuando debería negarse a actuar.
El cumplimiento del protocolo no garantiza que un agente pueda usar tu servidor: el problema no está en la capa de transporte, sino en las descripciones, los nombres y el diseño de los esquemas.