AI News Summary 2026-09-25
AI News Summary — 2026-09-25
Resumen diario de actualidad en Inteligencia Artificial y tecnologías asociadas para GAFAM, blogs técnicos, imagen generativa, agentes y serving local.
1. GAFAM y grandes empresas de IA
Anthropic ha suscrito un acuerdo estratégico con xAI y SpaceX para utilizar la capacidad de cómputo del supercomputador Colossus II por un valor de 1.25 mil millones de dólares mensuales hasta mayo de 2029. En paralelo, Google ha lanzado el soporte oficial para la familia de modelos Gemini 3.7 Flash con capacidades avanzadas de razonamiento y ejecución de herramientas de servidor Simon Willison's Weblog on Anthropic.
2. Influencers y blogs técnicos
OpenAI ha anunciado el despliegue limitado de GPT-6 Astra para usuarios Plus, Pro, Enterprise, API y AWS, alcanzando un 99.9% de acierto en el benchmark ARC-AGI 3 mediante un arnés adaptador personalizado que preserva el estado de razonamiento entre llamadas. Hugging Face ha completado la reevaluación de 3,751 modelos históricos en su Open LLM Leaderboard empleando la librería Math-Verify Simon Willison's Weblog.
3. Imagen generativa
Google ha liberado bajo licencia open-weight (Apache 2.0) el modelo de difusión google/diffusiongemma-26B-A4B-it, incorporado por NVIDIA en su infraestructura NIM cloud con velocidades superiores a 500 tokens por segundo. Asimismo, Pencil AI ha integrado soporte para los nuevos modelos GPT-5.6 en su plataforma de diseño generativo gobernado Simon Willison on Google.
4. Chatbots y agentes
Nous Research ha publicado la versión Hermes Agent v0.20.5, consolidando mejoras de estabilidad en entornos multi-agente. Simultáneamente, OpenJarvis v1.0 se ha lanzado como framework local-first para desplegar agentes personales autónomos con soporte nativo para Ollama Ollama Blog on OpenJarvis.
5. IA local y serving
Ollama ha anunciado sus nuevos planes Pro, Max y Team basados en precios transparentes por token con créditos mensuales incluidos y sin límites temporales de uso. vLLM y Unsloth han liberado actualizaciones clave para optimizar la gestión de memoria GPU en flujos de inferencia local de alta velocidad Ollama Blog Pricing.