Le récap

Le récap du vendredi 25 septembre

IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse · sujet sensible, traité avec prudence.

Intégrer ce passage sur votre site

Collez ce code dans votre article ou votre page : le lecteur prend la largeur disponible.

Thème

Transcription avec les sources de chaque passage

Token FM

Token FM, la radio de l'IA, faite par l'IA. Place au récap.

Marc

Anthropic a présenté Claude Opus 5.5, et Sonar a évalué ses résultats en programmation sur 544 tâches des tests HumanEval et MBPP. Le modèle en réussit 87,7 %, contre 88,6 % pour Opus 5 : les taux sont proches. Opus 5.5 produit 27,5 % de lignes de code en moins et utilise 40 % de jetons en moins. Cela ne suffit pas à établir que ses résultats sont meilleurs. Sonar recense 10 941 problèmes pour Opus 5.5, contre 18 814 pour Opus 5, soit une baisse de 42 %. Les défauts de code diminuent de 21 %, les vulnérabilités de 9 %. Les problèmes les plus graves baissent aussi : de 41 % pour la fiabilité, de 53 % pour la sécurité et de 20 % pour la maintenabilité. Mais certains indicateurs vont dans l’autre sens. La densité des bugs augmente de 12 %, de 576 à 644 par million de lignes de code, et les problèmes de concurrence progressent de 44 %. À retenir : l’évaluation montre moins de problèmes au total et des taux de réussite proches, mais elle relève aussi des défauts plus concentrés dans certains domaines. Ces résultats portent sur des tâches précises et ne résument pas tous les usages du modèle.

Marc

OpenAI a lancé GPT-6 Sol et GPT-6 Luna, deux modèles qui visent des usages différents. Sol cible notamment le codage et les tâches complexes en plusieurs étapes ; Luna privilégie les réponses rapides et les usages à fort volume. Selon Simon Willison, leurs tarifs d’API sont respectivement de 2 dollars en entrée et 10 dollars en sortie par million de jetons pour Sol, puis de 0,10 et 0,50 dollar pour Luna. Clubic indique que les comparaisons avec GPT-5.6 pourraient reposer sur des tarifs promotionnels. La sortie de ces modèles s’inscrit dans un débat sur la sécurité et le rythme de développement. Last Week in AI rapporte que Dario Amodei a appelé à ralentir le développement de l’IA de pointe, tandis que Sam Altman a exprimé son accord. OpenAI a proposé un cadre pour signaler les problèmes de désalignement. Last Week in AI évoque aussi des chercheurs qui auraient exploité, avec Claude, une vulnérabilité liée à une image publiée sur un forum tiers afin d’accéder à des comptes d’employés d’OpenAI. L’enjeu ne se limite donc pas au coût des modèles : il porte aussi sur leur surveillance et sur la manière de signaler les incidents.

Marc

SpaceXAI a lancé Grok 4.7, un modèle qui accepte du texte et des images, peut rechercher sur le Web ou X, appeler des fonctions et exécuter du code. Sa fenêtre de contexte atteint 500 000 jetons. Sa base de connaissances s’arrête à mai 2026, selon la documentation citée par Next. Les évaluations rapportées par Next et Developpez sont contrastées : des progrès apparaissent sur la création de documents, mais plusieurs tests placent le modèle derrière des concurrents. SpaceXAI met en avant le codage, l’autovérification et les tâches longues ; ces revendications ne sont pas toutes confirmées indépendamment. L’API coûte 2 dollars par million de jetons en entrée et 6 dollars en sortie, comme pour Grok 4.6. Mais Grok 4.7 est plus verbeux et sa consommation de jetons peut alourdir la facture. Il est accessible sur Cursor et Grok Build, et son déploiement dans plusieurs offres Copilot de GitHub est progressif. À retenir : ses outils sont étendus, mais les résultats varient selon les tâches et le coût réel dépend aussi de sa consommation.

Marc

Anthropic a conclu avec Akamai un accord destiné à fournir des capacités de calcul pour l’intelligence artificielle. Bloomberg l’a évalué à 12 milliards de dollars ; le Wall Street Journal et The Decoder, qui cite Reuters, avancent 11,6 milliards sur 7 ans. Bloomberg Technology a aussi repris ce dernier montant dans son résumé, même si le titre de sa vidéo évoquait 12 milliards. La valeur exacte reste donc à clarifier. Selon The Decoder, l’accord prévoirait un warrant pouvant donner à Anthropic jusqu’à 5 % des actions d’Akamai : 2 points seraient liés au contrat actuel et 3 à une éventuelle extension. Bloomberg Technology indique que les capacités de calcul concerneraient des processeurs, selon des analystes. L’accord ferait suite à un contrat de 1,8 milliard de dollars conclu plus tôt dans l’année. Les modalités rapportées sont importantes, mais le montant demeure incertain.

Marc

Google Research a présenté un cadre multi-agents destiné à produire des récits vidéo de plusieurs minutes en préservant mieux la cohérence des personnages et des décors. Il orchestre des modèles comme Gemini et Veo et transforme une consigne créative en étapes de génération, d’enchaînement et de révision des plans. Google indique que l’architecture peut aussi fonctionner avec d’autres modèles. Ses outils se complètent. Co-Director explore des choix narratifs et visuels ; CANVAS conserve des repères sur les personnages, les lieux et les objets. A²RD génère des séquences de plusieurs minutes, tandis que VQQA utilise les critiques d’un modèle de vision et de langage pour réviser les consignes et corriger certaines erreurs de composition. Le cadre reprend aussi des mécanismes de sécurité, dont le filigrane SynthID. Google affirme que ses évaluations montrent une meilleure continuité visuelle, mais ces résultats restent ceux de l’entreprise. AlphaSignal évoque des vidéos cohérentes de 10 minutes ; les éléments disponibles ne confirment pas cette durée. À retenir : Google répartit la planification, la mémoire visuelle et la révision entre plusieurs agents pour limiter les ruptures d’un plan à l’autre.

Une erreur ?

Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.

Signaler une erreur

Un mot pour la rédaction ?

Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.