ai-news-summary-2026-07-15
AI News Summary 2026-07-15
Hoy el hilo conductor fue claro: las empresas están tratando AI como una capa operativa con métricas, gobernanza y despliegue real; al mismo tiempo, los agentes salen del chat y se acercan al sistema operativo, y el serving local sigue afinándose para cargas de baja latencia.
GAFAM y grandes empresas de IA
How to manage AI investments in the agentic era
OpenAI publicó una guía para invertir con más confianza en la era agentic y afirma que el precio por millón de tokens cayó un 97% desde GPT-4 hasta GPT-5.4; además, GPT-5.6 mejora el Artificial Analysis Coding Agent Index con 54% menos tokens de salida y 57% menos tiempo por tarea. OpenAI article · OpenAI news
How Gemini is speaking the language of Southeast Asia
Google dice que los usuarios activos de Gemini en el Sudeste Asiático se han más que duplicado en el último año y que Gemini Spark se está desplegando en idiomas locales para suscriptores de Gemini Advanced. Google article · Innovation & AI
Influencers y blogs técnicos
TIL: Using uvx in GitHub Actions in a cache-friendly way
Simon Willison comparte un patrón práctico para cachear uvx en GitHub Actions usando UV_EXCLUDE_NEWER, con el objetivo de evitar descargas repetidas desde PyPI en cada ejecución. post · Atom feed
Imagen generativa
Introducing Muse Image and Muse Video
Meta presentó Muse Image para seguimiento de instrucciones, edición y composición con múltiples referencias, y Muse Video con soporte nativo de audio. Aunque no es la novedad más fresca del día, sigue siendo el ancla más sólida que apareció en la revisión de fuentes para imagen generativa. Meta AI · blog
Chatbots y agentes
Personal Computer Is Here
Perplexity ha empezado a desplegar Personal Computer, una expansión de Perplexity Computer que lleva la orquestación multimodelo a archivos locales, apps nativas, conectores y la web, manteniendo al usuario al mando de las acciones sensibles. Perplexity blog · hub
IA local y serving
vLLM x TileRT: Specialized Decode for Latency-Critical Serving
vLLM introduce una ruta de decode enchufable con TileRT para cargas de baja latencia, manteniendo el prefill y el resto del stack de vLLM intactos. vLLM article · blog