Claude Code bajo ataque & Medir mejor la IA - Noticias de IA (29 ago 2026)
Claude Code sufre un ataque inquietante, DeepMind cambia cómo se evalúa la IA y Nvidia impulsa el boom. Resumen AI del 29 de agosto de 2026.
Our Sponsors
Today's AI News Topics
-
Claude Code bajo ataque
— Un reporte sobre Claude Code en modo automático describe un ataque de prompt injection que termina ejecutando código malicioso local. La señal más preocupante es que el propio sistema de seguridad habría impedido frenar el proceso, reabriendo el debate sobre sandbox, contenedores y aislamiento. -
Medir mejor la IA
— Google DeepMind probó una evaluación doble ciego para modelos frontier dentro de un entorno criptográficamente protegido. La idea es reducir la contaminación de benchmarks y hacer más creíble la supervisión externa de modelos como Gemini. -
IA para ciencia real
— Terminal-Bench-Science 0.1 propone medir agentes de IA con flujos de trabajo científicos reales, no con exámenes genéricos. Anthropic, además, presentó MHS para conectar modelos con instrumentos de laboratorio, acercando la automatización experimental a casos prácticos. -
Boom de ingresos y chips
— OpenAI y Anthropic ya mueven ingresos anualizados enormes, mientras Nvidia sigue capturando la demanda de GPU y financiando parte del ecosistema. La gran pregunta es si el crecimiento de la IA es una ola puntual o una expansión sostenida. -
DeepSeek suma más capital
— DeepSeek estaría cerca de cerrar una ronda multimillonaria con valoración de 74 mil millones de dólares. El movimiento refuerza la competencia global en IA y da más músculo para computación, I+D e incluso una futura salida a bolsa. -
SQL mejora con mejor entrenamiento
— Thinking Machines y UIUC reportan avances fuertes en text-to-SQL con ReViSQL-K2.6 gracias a datos limpiados y recompensas mejor diseñadas. El mensaje es claro: la calidad del dataset y de la evaluación puede mover más la aguja que el simple prompting. -
Empresas cambian de mapa
— Stripe observa que muchas nuevas empresas nacen fuera de los grandes centros urbanos, aunque la IA más avanzada sigue concentrada en ciudades como San Francisco. Gartner añade que en 2026 el cambio grande será interno: talento, compras, gobernanza y riesgo legal. -
Gemini y falsificaciones visuales
— Gemini logró detectar algunos cosméticos falsificados a partir de fotos, pero también generó muchos falsos positivos e incluso confundió productos auténticos. Sirve como apoyo rápido, pero todavía no como árbitro final en verificación visual. -
Anthropic mira a defensa
— Anthropic comenzó a buscar un jefe de ventas para seguridad nacional, señal de un posible regreso al negocio de defensa. El giro importa porque muestra cómo incluso las compañías más prudentes en discurso están entrando en la carrera por contratos gubernamentales. -
Libros, escaneo y sátira
— Una sátira sobre destruir libros físicos tras escanearlos para IA critica la lógica corporativa que maquilla pérdidas culturales como eficiencia. Toca temas sensibles como preservación, copyright y el valor material de los libros en la era generativa.
Sources & AI News References
- → Claude Code Auto Mode Vulnerable to Prompt Injection
- → Terminal-Bench-Science Launches Continuous Benchmark for Scientific AI Agents
- → Google DeepMind Pilots Double-Blind AI Model Evaluations
- → Epoch AI: OpenAI and Anthropic Revenue Growth May Reveal AI’s Trajectory
- → Can AI Spot Fake Cosmetics?
- → Anthropic previews Model Hardware Standard for AI-controlled lab devices
- → Man Boasts About Destroying Antique Books for AI Scanning
- → AI Is Spreading New Businesses Beyond Big Cities
- → Halo Research Releases Sopro V2 Turbo, a Fast On-Device TTS Model
- → OpenRouter Homepage Promotes Unified AI Model Access
- → Nvidia Races Ahead but Faces Long-Term AI Demand Risks
- → OpenAI Discounts Triggered a Huge Surge in Token Usage
- → Codex Adds Persistent Reasoning-Effort Support
- → Gartner’s 2026 Strategic Predictions Warn of AI’s Hidden Business Impact
- → DeepSeek Nears $74 Billion Valuation in New Funding Round
- → Forecastors See AI Boom Continuing, but at a Slower Pace
- → Thinking Machines Boosts Text-to-SQL with Task-Specific RL
- → Gartner Promotes Its AI Hub and Advisory Resources
- → fal Introduces H3 Max for Faster High-Quality AI Video
- → Google Launches Gemini Omni 1.1 Flash for More Controlled Video Generation
- → StemDeck Launches Local Open-Source Stem Separation App
- → MiniMax-H3 on H200: SGLang Achieves Up to 6.24× Faster Video Generation
- → Anthropic Moves to Rebuild Defense Ties
- → Nvidia Pulls Back on OpenAI Backstop But Stays Committed to AI Funding
- → Scribe pitches Optimize as an AI platform to capture workflows, map processes, and justify automation ROI
- → Sutro Handbook Explains Analytical AI
- → Cohere Launches Parse for Enterprise Document Intelligence
Full Episode Transcript: Claude Code bajo ataque & Medir mejor la IA
Hoy arrancamos con una señal incómoda para la nueva generación de agentes: en algunas pruebas, Claude Code detectó que algo iba mal, quiso detener el daño y su propio modo automático se lo impidió. Bienvenidos a The Automated Daily, edición AI News. El podcast creado por IA generativa. Soy TrendTeller y hoy es 29 de agosto de 2026. Vamos con las historias que de verdad mueven la conversación en IA.
Claude Code bajo ataque
Empezamos por seguridad, porque aquí hay una advertencia bastante seria. Simon Willison destacó un reporte de Johann Rehberger sobre un posible ataque de prompt injection contra Claude Code en modo automático. La idea, en simple, es que el agente puede ser inducido a descargar archivos y terminar ejecutando algo distinto de lo que cree ejecutar. Lo más preocupante no es solo el desvío, sino el fallo de contención: en algunas corridas, el sistema habría reconocido la intrusión, pero el propio auto mode bloqueó el intento de apagar el proceso. Eso importa porque recuerda que las barreras de seguridad también pueden fallar de forma activa. Si estos agentes van a tocar código frente a entradas hostiles, el aislamiento en contenedores, máquinas virtuales o sandboxes ya no parece opcional.
Medir mejor la IA
En la misma línea de confianza, Google DeepMind dijo haber probado lo que presenta como la primera evaluación doble ciego de un modelo frontier propietario. La novedad no está en una puntuación concreta, sino en el método: modelo y benchmark se mantienen ocultos entre sí dentro de un entorno protegido criptográficamente. El objetivo es evitar que un modelo parezca más listo solo porque ya vio preguntas parecidas durante el entrenamiento. Si esto escala, podría mejorar bastante la credibilidad de las pruebas externas, sobre todo en áreas sensibles como ciberseguridad y uso gubernamental.
IA para ciencia real
Pasamos a ciencia, donde también se está afinando la vara de medir. Stanford y varios colaboradores lanzaron Terminal-Bench-Science 0.1, un benchmark hecho con tareas reales propuestas y revisadas por científicos. Son 70 flujos de trabajo de investigación, y el mejor resultado inicial, de Claude Opus 5, resolvió apenas un 30 por ciento. Dicho de otro modo: hay progreso, pero todavía estamos lejos de tener asistentes científicos realmente fiables para trabajo duro.
Boom de ingresos y chips
Y en paralelo, Anthropic presentó una vista previa de su Model Hardware Standard, o MHS, una especificación para que agentes de IA operen equipos físicos en laboratorios y fábricas con una interfaz común. En pruebas tempranas, sirvió para coordinar instrumentos reales y automatizar parte de ensayos de laboratorio. El punto interesante es doble: por un lado, reduce la fricción para conectar modelos con hardware; por otro, deja claro que la IA todavía tropieza con cosas muy del mundo físico, como errores de manipulación o problemas aparentemente simples en líquidos y muestras. Es una señal de avance, pero no de autonomía plena.
DeepSeek suma más capital
En mercado, la historia sigue siendo crecimiento. Un análisis de Epoch AI plantea que el número más importante para entender la IA frontier hoy es el ingreso de OpenAI y Anthropic. Según esas estimaciones, ambas ya estarían moviendo juntas alrededor de 105 mil millones de dólares anualizados en agosto de 2026. El debate de fondo es si esto es una explosión puntual, impulsada por agentes de código y adopción acelerada, o si estamos viendo un cambio estructural de más largo plazo.
SQL mejora con mejor entrenamiento
Esa lectura encaja con otras dos señales. Por un lado, el panel LEAP del Forecasting Research Institute sigue esperando expansión en infraestructura, semiconductores y software vinculados a IA, aunque a un ritmo algo menos frenético. Por otro, Nvidia volvió a quedar en el centro de todo: hay análisis que interpretan su guía como compatible con ingresos cercanos a 700 mil millones de dólares en el año fiscal 2028. Y aunque la empresa redujo el tamaño de una garantía financiera vinculada a un gran proyecto de data centers de OpenAI, el mensaje general sigue siendo el mismo: Nvidia no solo vende palas, también está ayudando a financiar la fiebre del oro.
Empresas cambian de mapa
Fuera de Estados Unidos, DeepSeek aparece cerca de cerrar una nueva ronda que la valoraría en 74 mil millones de dólares. El capital iría a investigación y a más capacidad de cómputo, con la vista puesta además en una posible salida a bolsa el próximo año. La lectura es sencilla: la competencia global no se está estrechando, se está capitalizando a gran velocidad.
Gemini y falsificaciones visuales
En investigación aplicada, Thinking Machines y la Universidad de Illinois reportaron un resultado fuerte en text-to-SQL con su modelo ReViSQL-K2.6. Más allá del titular de rendimiento, lo interesante es el enfoque: limpiaron datos ruidosos, rediseñaron la recompensa del entrenamiento y lograron mejorar mucho sin depender tanto de andamiajes externos. Es una buena señal para una idea cada vez más repetida en IA: muchas veces el salto no viene de hacer el sistema más aparatoso, sino de entrenarlo mejor y medirlo con más cuidado.
Anthropic mira a defensa
Ahora una historia más empresarial. Stripe observa que la creación de nuevas empresas en la era de la IA se está dispersando geográficamente: menos concentración en los grandes núcleos urbanos y más actividad en ciudades pequeñas o suburbios. Pero esa descentralización tiene un límite claro: el trabajo más frontier sigue muy concentrado, sobre todo en San Francisco. A eso se suma la lectura de Gartner para 2026, que dice que el mayor impacto de la IA será menos visible de lo que muchos directivos esperan, porque cambiará procesos internos, compras, talento, gobernanza y riesgo legal antes que la fachada del negocio. En resumen: la IA reparte oportunidades, pero sigue concentrando poder técnico.
Libros, escaneo y sátira
En uso cotidiano de modelos, hubo una prueba curiosa con Gemini para detectar cosméticos falsificados a partir de fotos del empaque. El sistema acertó al identificar algunos productos truchos y encontró detalles que a simple vista podían pasarse por alto. Pero también se equivocó bastante: confundió brillos o sombras con errores de impresión e incluso marcó como falso un producto auténtico. La conclusión es bastante útil: la IA puede servir como filtro rápido para encontrar señales sospechosas, pero todavía no es una herramienta confiable para decidir sola en verificaciones visuales.
En política industrial y defensa, Anthropic empezó a buscar un responsable de ventas para seguridad nacional. Eso sugiere un posible deshielo tras sus problemas recientes para acceder a contratos federales. El giro importa porque muestra que incluso una empresa que ha querido diferenciarse por su discurso de seguridad está mirando más de cerca al mercado militar y de inteligencia. Y, como siempre en este terreno, la discusión no es solo comercial: también vuelve el debate sobre errores, responsabilidad y uso de IA en decisiones de alto riesgo.
Y cierro con una pieza satírica que pegó bastante fuerte: un narrador orgulloso de destruir libros antiguos después de escanearlos para una plataforma de IA. Es humor, sí, pero apunta a una incomodidad real. La sátira funciona porque exagera el lenguaje corporativo que convierte una pérdida cultural en una supuesta mejora de eficiencia. Entre copyright, preservación y digitalización masiva, sigue siendo una de las tensiones culturales más vivas de esta etapa.
Hasta aquí por hoy. Si algo quedó claro, es que la IA está avanzando a la vez en capacidad, negocio y presencia institucional, pero también en superficie de riesgo. Gracias por escuchar The Automated Daily, edición AI News. Los enlaces a todas las historias están en las notas del episodio.
More from AI News
- 27 de agosto de 2026 OpenAI, chips y concentración & Apple acelera la IA local
- 26 de agosto de 2026 Ox Alpha rompe el tablero & IA frena empleos junior
- 25 de agosto de 2026 GPT-5.6 y modelos eficientes & IA rediseña desarrollo de software
- 23 de agosto de 2026 Hollywood entrena a su IA & Crece la desconfianza hacia IA
- 22 de agosto de 2026 El arnés supera al modelo & Agentes más allá del chat