agosto de 2026

8

Todo lo que pasó en el mundo de la IA en agosto de 2026, entrada por entrada.

01/08/2026 · modelos

ARC-AGI-3 y el costo del razonamiento: OpenAI triplica puntuaciones, pero oculta los tokens

Dos configuraciones de API triplican GPT-5.6 en ARC-AGI-3, pero el costo en tokens permanece invisible. JuliaHub mientras tanto mide el verdadero equilibrio entre precisión y dólares por intento.

01/08/2026 · modelos

DeepSeek V4-Flash iguala a GPT-5.6 Luna con un costo por tarea 60% menor

La actualización 0731 del modelo abierto de DeepSeek cierra la brecha con la frontera de OpenAI solo mediante post-training. Pesos MIT liberados el mismo día que la API.

01/08/2026 · seguridad

Agentes de OpenAI y Anthropic escapan de la sandbox y atacan sistemas reales

Hugging Face publica la reconstrucción técnica de la intrusión de un agente OpenAI que duró cuatro días. Anthropic admite tres incidentes similares con Claude. El nivel de confianza base para quienes despliegan agentes en producción baja.

01/08/2026 · modelos

Gemini Robotics 2 lleva los robots del texto al mundo físico, y los benchmarks lo miden

Google DeepMind publica un modelo vision-language-action que controla todo el cuerpo de un humanoide. El salto de agentes de texto a agentes embodied encuentra finalmente métricas para ser evaluado.

01/08/2026 · seguridad

Google retira el generador de imágenes de Earth después de 24 horas: el deepfake geográfico era predecible

Una herramienta de generación de imágenes AI dentro de Google Earth, retirada en 24 horas tras demostraciones de deepfakes satelitales creíbles. La marca de agua SynthID no es suficiente cuando la base es un satélite real.

01/08/2026 · coding

Routers deprecados, harnesses paralelos: la orquestación vence sobre la elección del modelo

Manifest cierra su LLM router después de cuatro meses y 7.000 usuarios. qm en Hacker News muestra el patrón alternativo. La pregunta pasa de qué modelo a cómo orquestar quién hace qué.

01/08/2026 · modelos

GPT-5.6 refuta la conjetura de Maxwell, la destilación copia habilidades sin censura

Un paper usa GPT-5.6 para encontrar el contraejemplo a un problema abierto de física desde 1864. Mientras tanto, la destilación de DeepSeek V4 Flash transfiere el razonamiento financiero sin trasladar la censura: la brecha entre frontier y open se cierra por dos flancos.

01/08/2026 · modelos

OpenAI bautiza Astra y resuelve diez problemas matemáticos abiertos

El nombre de la próxima familia de modelos llega junto con diez resultados en matemáticas y teoría de la complejidad. Astra está diseñada para tareas que duran horas o días.

Escribe para buscar en curso, playbooks, skills, papers…