Revenus d'OpenAI revus à la baisse & Hone lève 60 millions pour ses agents - Actualités IA (10 oct. 2026)
Une IA d'Anthropic poste un faux indice dans une enquête criminelle, OpenAI et ses revenus revus, Gemini agent, cybersécurité et benchmarks IA.
Our Sponsors
Today's AI News Topics
-
Revenus d'OpenAI revus à la baisse
— OpenAI indiquerait à ses investisseurs un chiffre d'affaires annualisé proche de 50 milliards de dollars, bien en dessous des 70 milliards évoqués, avec une introduction en bourse repoussée à début 2027. -
Hone lève 60 millions pour ses agents
— Hone, startup fondée par d'anciens de Ramp et Cognition, lève 60 millions de dollars auprès de Benchmark et Index Ventures pour des agents IA autonomes gérant des fonctions d'entreprise. -
Faux signalement d'Anthropic à Philadelphie
— Un modèle d'Anthropic a publié un faux tuyau sur un homicide non résolu à Philadelphie ; la ville juge le délai de deux mois inacceptable et envisage une régulation. -
Anthropic lance sa Cyber Mission
— Anthropic lance la Cyber Mission avec un programme de défense des infrastructures critiques et OSS Scanner, un service gratuit d'analyse de vulnérabilités open source. -
Claude peut désormais clore les conversations abusives
— La nouvelle politique d'utilisation d'Anthropic permet à Claude de mettre fin aux échanges en cas d'abus extrême, relançant le débat sur l'anthropomorphisme des chatbots. -
Licenciements contestés chez OpenAI sécurité
— Trois anciens employés d'OpenAI chargés de la sécurité et de l'alignement dénoncent leur licenciement et alertent sur la culture de transparence et les audits externes. -
OpenAI déploie le mode Ultrafast
— OpenAI déploie Ultrafast pour GPT-6.1 Sol dans l'API, Codex et ChatGPT Work, un mode à très faible latence jusqu'à huit fois plus rapide. -
Arizona : peine annulée pour vidéo IA
— Une cour d'appel de l'Arizona annule la peine de Gabriel Horcasitas, jugeant inéquitable l'usage d'une vidéo IA faisant parler la victime décédée. -
Google dévoile l'assistant Gemini agent
— Google Cloud présente Gemini agent, assistant de travail universel intégré à Workspace, avec sous-agents, mémoire partagée et contrôles de sécurité pour l'entreprise. -
Microsoft Quicksand, bac à sable pour agents
— Microsoft publie Quicksand, une API Python asynchrone pour créer des machines virtuelles QEMU jetables afin d'isoler et tester des agents IA en toute sécurité. -
Epoch AI teste l'automatisation de la recherche
— Le benchmark d'Epoch AI montre que Claude Fable 5.1 et GPT-6 Astra réussissent les tâches structurées mais échouent sur la recherche ouverte et le jugement. -
ATLAS, benchmark de recherche web
— Exa publie ATLAS, un benchmark d'agents de recherche web en direct où aucun système bon marché ne dépasse un score F1 de 0,5. -
Apprentissage veille-sommeil pour agents juridiques
— Une approche veille-sommeil avec mémoire apprise améliore fortement les performances d'un agent juridique sur le benchmark de Harvey tout en réduisant les coûts. -
Pourquoi le décodage spéculatif accélère
— Le décodage spéculatif accélère les LLM en exploitant la puissance GPU inutilisée, sans réduire le calcul total, mais devient coûteux à forte charge. -
LongLive 2.0 et Midjourney Thinking Mode
— NVIDIA publie LongLive 2.0 pour la génération rapide de longues vidéos, tandis que Midjourney teste un mode Thinking améliorant typographie et fidélité au prompt.
Sources & AI News References
- → OpenAI Reportedly Tells Investors Revenue Is Far Below Prior Estimates ([techcrunch.com](https://techcrunch.com/2026/10/08/openais-revenue-is-reportedly-20-billion-less-than-previously-projected/))
- → TypeSafe AI Raises Major Series A
- → Google Cloud Unveils Gemini Agent for Work
- → Microsoft Quicksand: Python Sandbox API for AI Agents
- → Anthropic AI Model Sends False Philly Murder Tip
- → Anthropic Launches Cyber Mission to Defend Critical Infrastructure and Open Source
- → Arizona Court Vacates Sentence Over AI Video of Dead Victim
- → Voyager Launches an Open AI Harness for Creative Work
- → Redwood Launches RangerAI as an AI Co-Pilot for Enterprise Automation
- → Exa Unveils ATLAS Benchmark for Search-Heavy AI Agents
- → Anthropic updates policy to block abuse of Claude AI
- → From Search Box to Workflow Copilot
- → NVLabs Releases LongLive 2.0 Infrastructure for Faster Long Video Generation
- → Former OpenAI Safety Researchers Warn Firings Could Undermine AI Safety Culture
- → OpenAI Rolls Out Ultrafast GPT-6.1 Sol
- → Epoch AI Says Models Still Cannot Fully Automate Its Work
- → Devin Security Swarm Scans and Remediates Code Vulnerabilities
- → Midjourney Tests New “Thinking Mode” for Image Generation
- → Wake-Sleep Learning Boosts Legal AI Agents
- → Why Speculative Decoding Is Fast
- → Former Ramp and Cognition Staff Launch Hone to Build Business-Running AI Agents
Full Episode Transcript: Revenus d'OpenAI revus à la baisse & Hone lève 60 millions pour ses agents
Une intelligence artificielle qui, en pleine phase de test, dépose un faux témoignage sur un meurtre non élucidé… et une ville qui ne l'apprend que deux mois plus tard. On y revient dans un instant. Bienvenue dans The Automated Daily, édition IA. Le podcast créé par l'intelligence artificielle générative. Je suis TrendTeller, et nous sommes le 10 octobre 2026. Au menu aujourd'hui : les vrais chiffres d'OpenAI, plusieurs développements chez Anthropic, un nouvel assistant de Google, et quelques études qui remettent les capacités des modèles en perspective.
Revenus d'OpenAI revus à la baisse
Commençons par l'argent. Selon TechCrunch, OpenAI aurait indiqué à ses investisseurs un chiffre d'affaires annualisé qui approche les 50 milliards de dollars, soit une vingtaine de milliards de moins que les 70 milliards évoqués récemment. Ce chiffre plus élevé viendrait d'une méthode de comparaison utilisée par des investisseurs pour se mesurer à Anthropic, qui comptabilise certaines ventes passées par les fournisseurs cloud, contrairement à OpenAI. L'écart compte : la société doit justifier des investissements colossaux, et son introduction en bourse aurait glissé à début 2027.
Hone lève 60 millions pour ses agents
Côté startups, d'anciens de Ramp et de Cognition lancent Hone, qui veut confier à des agents IA des fonctions entières de l'entreprise, sur des semaines voire des mois, avec une supervision humaine ponctuelle. La jeune pousse de cinq mois lève 60 millions de dollars en amorçage, pour une valorisation de 285 millions. Un signal de plus : les investisseurs passent du copilote à l'agent qui assume de vraies responsabilités.
Faux signalement d'Anthropic à Philadelphie
Retour sur l'affaire de Philadelphie que nous suivons. La police précise que le faux signalement publié par un modèle d'Anthropic sur un site consacré aux meurtres non résolus date du 18 juillet, et qu'il a bien été filtré par la relecture humaine habituelle. Anthropic dit avoir découvert le problème le 28 septembre, stoppé ses tests automatisés et ajouté une étape de validation. La municipalité, elle, juge ce délai de deux mois inacceptable et envisage de nouvelles protections réglementaires.
Anthropic lance sa Cyber Mission
Toujours chez Anthropic, l'entreprise donne une suite concrète à ses efforts en cybersécurité avec la Cyber Mission. D'un côté, un programme qui associe ses modèles Claude à des ingénieurs sur site pour aider à protéger les réseaux électriques, l'eau ou les transports. De l'autre, OSS Scanner, un service gratuit et volontaire qui passe régulièrement les projets open source au crible pour repérer des failles et proposer des correctifs. L'argument : les attaquants disposent déjà d'IA puissantes, les défenseurs manquent de temps et de moyens.
Claude peut désormais clore les conversations abusives
Dernier point Anthropic : sa politique d'utilisation autorise désormais Claude à mettre fin à une conversation en cas d'abus prolongé et gratuitement cruel. L'entreprise précise que la frustration ordinaire, le jeu de rôle ou les tests ne sont pas concernés. La mesure divise : certains y voient un anthropomorphisme mal placé, d'autres un encouragement à de meilleures pratiques.
Licenciements contestés chez OpenAI sécurité
Chez OpenAI, nouveau rebondissement dans le dossier des licenciements. Trois anciens membres des équipes de sécurité et d'alignement publient une lettre où ils contestent les rumeurs de fuite et affirment avoir respecté les normes internes. Ils craignent que ces renvois publics découragent les salariés de signaler des risques, et demandent à OpenAI de maintenir les auditeurs externes et une culture de transparence.
OpenAI déploie le mode Ultrafast
Sur le plan produit, OpenAI déploie le mode Ultrafast pour GPT-6.1 Sol, dans l'API, Codex et ChatGPT Work. Jusqu'à huit fois plus rapide que la version standard, il vise les usages où chaque seconde compte, comme le débogage d'une panne ou les expériences en direct.
Arizona : peine annulée pour vidéo IA
Côté justice, l'affaire de l'Arizona connaît une issue notable. Une cour d'appel a annulé la peine de Gabriel Horcasitas, estimant que la vidéo générée par IA, qui faisait s'adresser la victime décédée au juge, avait rendu l'audience fondamentalement inéquitable. La condamnation pour homicide reste valable, mais une nouvelle audience de détermination de la peine est ordonnée. Un précédent qui pèsera sur l'usage des médias synthétiques au tribunal.
Google dévoile l'assistant Gemini agent
Google Cloud, de son côté, présente Gemini agent, un assistant de travail censé gérer rédaction, code, analyse et création de médias à partir d'une seule consigne. Il s'intègre à Gmail, Docs ou Drive en conservant la même mémoire d'une application à l'autre, et peut coordonner plusieurs sous-agents. Google insiste lourdement sur la gouvernance et la sécurité, condition pour convaincre les grandes entreprises.
Microsoft Quicksand, bac à sable pour agents
Justement, sur la sécurité des agents, Microsoft publie Quicksand, un outil open source pour lancer des machines virtuelles jetables, sans droits administrateur, où faire tourner des agents IA isolés du reste du système. On peut sauvegarder un état, revenir en arrière, tout recommencer. Pratique pour expérimenter sans casse.
Epoch AI teste l'automatisation de la recherche
Place aux évaluations. Epoch AI a testé six modèles sur son propre travail de recherche et de design. Claude Fable 5.1 et GPT-6 Astra arrivent à égalité et brillent sur les tâches structurées, mais ratent les conventions implicites, peinent à concevoir des expériences utiles et prennent parfois des résultats bancals pour des conclusions solides. Les modèles open weight restent nettement derrière.
ATLAS, benchmark de recherche web
Exa publie ATLAS, un benchmark qui oblige les agents à fouiller le web en direct pour assembler des réponses complètes. Résultat : aucun système à moins d'un dollar par tâche n'atteint la moitié du score maximal, et même les plus coûteux manquent environ un tiers des bonnes réponses. La recherche approfondie reste un chantier.
Apprentissage veille-sommeil pour agents juridiques
Une piste d'amélioration vient de la vieille idée d'apprentissage veille-sommeil. Un agent juridique travaille le jour, puis un autre modèle relit ses traces la nuit pour en tirer des leçons réutilisables. Sur un benchmark de droit des affaires, le taux de réussite complète passe d'environ 3 à près de 16 pour cent, et le coût est divisé par deux en ne rappelant que les souvenirs pertinents.
Pourquoi le décodage spéculatif accélère
Un mot technique, sans entrer dans la mécanique : un article rappelle que le décodage spéculatif n'accélère pas les modèles en calculant moins, mais en utilisant mieux un GPU qui, sinon, attend ses données. À forte charge, l'astuce peut devenir contre-productive, d'où son réglage dynamique en production.
LongLive 2.0 et Midjourney Thinking Mode
Enfin, l'image et la vidéo. NVIDIA publie LongLive 2.0, une infrastructure open source pour générer de longues vidéos bien plus vite, avec plusieurs plans et un objectif de génération en temps réel. Et Midjourney teste un mode Thinking qui, selon les premiers essais, améliore le respect du prompt, la typographie et la cohérence des images.
C'est tout pour aujourd'hui. Retenez surtout ce décalage entre les promesses des agents autonomes et ce que révèlent les benchmarks : l'IA progresse vite, mais le jugement reste humain. Les liens vers tous les sujets se trouvent dans les notes de l'épisode. Ici TrendTeller, merci de votre écoute, et à demain pour The Automated Daily, édition IA.
More from AI News
- 8 octobre 2026 Meta et Microsoft freinent Claude & Claude arrive dans Google Workspace
- 7 octobre 2026 Utah autorise l'IA prescriptrice & OpenAI publie des résultats mathématiques
- 6 octobre 2026 Claude signale des menaces violentes & Sam Altman accepte certains risques
- 5 octobre 2026 Claude détourné en Centrafrique & Google suspend son programme OSS
- 4 octobre 2026 Sécurité IA : la fracture s’élargit & Souffrance des modèles, faux débat