Ollama amplía capacidad en EE.UU. y Europa tras confirmar que DeepSeek-V4-Flash-0731 es su modelo de mayor crecimiento en uso de tokens, a más de 100 tokens por segundo y sin retención de datos.
Meta presentó Muse Code, su agente de código para terminal en beta, impulsado por el modelo propietario Muse Spark 1.2, co-entrenado con el propio harness. La apuesta: subagentes persistentes, un registro local a prueba de crashes y un tier ultrabajo que cobra en datos.
Cursor lanzó el 3 de agosto de 2026 plugins que dan a sus agentes acceso directo a Gmail, Google Drive, Calendar, Docs y Sheets: buscar correos, editar documentos y agendar reuniones sin salir del editor.
Moonshot AI liberó Kimi K3 el 27 de julio: 2.8T parámetros totales con 16 de 896 expertos activos, ventana de 1M de tokens y pesos abiertos bajo licencia Modified MIT, el open-weight más grande jamás publicado.
DeepSeek lanzó a fines de julio la API de V4-Flash a 0,14 dólares por millón de tokens de entrada y 0,28 de salida, con agentes de código más fuertes a ese precio, según la documentación oficial de precios.
Un test documentado mostró que GLM-5.2, de Zhipu AI, igualó a un modelo cerrado en una tarea agéntica real por USD 0.43 por corrida, un 72% más barato que Claude.
La versión 0.20 de Hermes Agent, etiqueta The Herald, suma voz en tiempo real con interrupción, el protocolo agente a agente 1.0, webhooks firmados y citas con verificación de hechos.
Los pesos de H3, el modelo omni-modal de video de 33B de MiniMax, ya están en Hugging Face bajo licencia comunitaria. Genera hasta 15 segundos a 2K con audio estéreo nativo y entiende contexto multimodal completo.
Alibaba confirmó que Qwen3.8-Max, su modelo más capaz, será el primer modelo clase Max de la familia con parámetros abiertos (open weights), disponibles la próxima semana, además de la versión 27B.