ai-news-summary-2026-07-15

AI News Summary 2026-07-15

Hoy el hilo conductor fue claro: las empresas están tratando AI como una capa operativa con métricas, gobernanza y despliegue real; al mismo tiempo, los agentes salen del chat y se acercan al sistema operativo, y el serving local sigue afinándose para cargas de baja latencia.

GAFAM y grandes empresas de IA

How to manage AI investments in the agentic era

OpenAI publicó una guía para invertir con más confianza en la era agentic y afirma que el precio por millón de tokens cayó un 97% desde GPT-4 hasta GPT-5.4; además, GPT-5.6 mejora el Artificial Analysis Coding Agent Index con 54% menos tokens de salida y 57% menos tiempo por tarea. OpenAI article · OpenAI news

How Gemini is speaking the language of Southeast Asia

Google dice que los usuarios activos de Gemini en el Sudeste Asiático se han más que duplicado en el último año y que Gemini Spark se está desplegando en idiomas locales para suscriptores de Gemini Advanced. Google article · Innovation & AI

Influencers y blogs técnicos

TIL: Using uvx in GitHub Actions in a cache-friendly way

Simon Willison comparte un patrón práctico para cachear uvx en GitHub Actions usando UV_EXCLUDE_NEWER, con el objetivo de evitar descargas repetidas desde PyPI en cada ejecución. post · Atom feed

Imagen generativa

Introducing Muse Image and Muse Video

Meta presentó Muse Image para seguimiento de instrucciones, edición y composición con múltiples referencias, y Muse Video con soporte nativo de audio. Aunque no es la novedad más fresca del día, sigue siendo el ancla más sólida que apareció en la revisión de fuentes para imagen generativa. Meta AI · blog

Chatbots y agentes

Personal Computer Is Here

Perplexity ha empezado a desplegar Personal Computer, una expansión de Perplexity Computer que lleva la orquestación multimodelo a archivos locales, apps nativas, conectores y la web, manteniendo al usuario al mando de las acciones sensibles. Perplexity blog · hub

IA local y serving

vLLM x TileRT: Specialized Decode for Latency-Critical Serving

vLLM introduce una ruta de decode enchufable con TileRT para cargas de baja latencia, manteniendo el prefill y el resto del stack de vLLM intactos. vLLM article · blog