
Mapa de capacidades verificadas de Hermes Agent
Memoria entre sesiones, skills procedurales, herramientas y gateways: un punto de entrada basado en documentación primaria.
AGENTES · MODELOS · INTELIGENCIA ABIERTA
Agéntico Hoy analiza agentes de inteligencia artificial, modelos abiertos, herramientas y tendencias para comprender y construir el futuro desde Latinoamérica.

SEÑALES VERIFICADAS / 003
Noticias, lanzamientos, herramientas, modelos y señales que vale la pena seguir. Cuando no hay actualidad verificada, publicamos contexto que no caduca.

Memoria entre sesiones, skills procedurales, herramientas y gateways: un punto de entrada basado en documentación primaria.

La documentación de seguridad aclara qué controles son heurísticos y dónde siguen estando los límites de confianza.

Una nota permanente para leer licencias, condiciones de uso, código disponible y datos de entrenamiento por separado.
MODELOS (CEREBROS) / VERIFICADO
Capacidades, licencias y compatibilidad con agentes, registradas solo cuando una fuente primaria permite confirmarlas.
| # | MODELO | CREADOR | INTEL.?Intelligence Index Score compuesto que mide capacidad general. Escala 0–100. | CODING?Coding Index Score compuesto de capacidad de código. Escala 0–100. | TERMINALBENCH?TerminalBench Hard Tareas reales en terminal: instalar dependencias, editar código, correr tests. La métrica más agéntica. | TAU2?Tau2 Tareas multi-turno con herramientas. Mide retención, uso de tools y razonamiento en cadena. | IN $/M?Precio entrada Costo por millón de tokens de entrada (input). | OUT $/M?Precio salida Costo por millón de tokens de salida (output). | VEL.?Velocidad Tokens de salida por segundo. Más alto = respuestas más rápidas. | |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | GPT-5.6 Sol (max) | OpenAI | 59 | 77 | 65.9% | 85.1% | $5 | $30 | 78 | ↗ |
| 2 | GPT-5.6 Sol (medium) | OpenAI | 54 | 76 | 62.9% | 81.0% | $5 | $30 | 70 | ↗ |
| 3 | GPT-5.6 Terra (xhigh) | OpenAI | 52 | 71 | 62.9% | 80.4% | $2 | $12 | 121 | ↗ |
| 4 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) | Anthropic | 60 | 77 | 62.9% | 98.5% | $10 | $50 | 71 | ↗ |
| 5 | GPT-5.6 Sol (high) | OpenAI | 56 | 77 | 62.1% | 83.3% | $5 | $30 | 74 | ↗ |
| 6 | GPT-5.6 Sol (xhigh) | OpenAI | 58 | 78 | 61.4% | 84.8% | $5 | $30 | 73 | ↗ |
| 7 | GPT-5.6 Sol (low) | OpenAI | 49 | 70 | 60.6% | 76.0% | $5 | $30 | 70 | ↗ |
| 8 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) | Anthropic | 56 | 74 | 58.3% | 94.4% | $5 | $25 | 0 | ↗ |
| 9 | Claude Opus 4.7 (Non-reasoning, High Effort) | Anthropic | 43 | — | 54.5% | 74.0% | $5 | $25 | 0 | ↗ |
| 10 | Gemini 3.1 Pro Preview | 47 | 69 | 53.8% | 95.6% | $2 | $12 | 130 | ↗ |
ENTORNOS AGÉNTICOS / APRENDER HACIENDO
Guías para instalar, construir, conectar, asegurar y operar tus propios agentes.
Objetivos, límites y pruebas que puedan revisarse.
Continuidad y procedimientos sin perder control.
Local, servidor, nube y diseños híbridos.
Permisos mínimos, aislamiento y trazabilidad.
ENTORNOS AGÉNTICOS / DIRECTORIO
Perfiles verificados de agentes multipropósito y entornos de programación (coding harnesses) que conectan modelos con contexto, herramientas y permisos.
Anthropic · nivel intermedio
Entorno comercial de programación de Anthropic para comprender repositorios, editar archivos, ejecutar herramientas y trabajar desde terminal o superficies conectadas.
OpenAI · nivel intermedio
Agente de programación de OpenAI disponible en terminal y otras superficies, con ejecución local del cliente, herramientas, aprobaciones y sandbox.
Agentic AI Foundation · nivel intermedio
Agente local y extensible, originado en Block, que trabaja con distintos modelos y amplía sus acciones mediante extensiones MCP.
Nous Research · nivel intermedio
Entorno agéntico open source con memoria persistente, skills, herramientas, automatizaciones e integraciones.
CASOS DE USO / TERRITORIO
La oportunidad no es “reemplazar equipos”. Es reducir trabajo repetitivo, ampliar capacidad de investigación y preservar conocimiento operativo con supervisión.
Clasificar solicitudes y preparar borradores con revisión humana.
Investigar, probar y documentar cambios en repositorios.
Organizar fuentes, hipótesis y evidencia trazable.
Coordinar tareas repetibles con permisos acotados.
Crear recorridos de estudio y práctica adaptativa.
Mantener control sobre datos, modelos y ejecución.
PROTOCOLO EDITORIAL