Aller au contenu principal

Ma veille IA · du vendredi 25 au jeudi 1 octobre 2026

Ma veille IA — du vendredi 25 au jeudi 1 octobre 2026

Outil

GitHub Copilot : les nouvelles fonctions s'activeront seules dès le 22 octobre

GitHub ajoute une politique globale « par défaut » aux réglages Copilot Business et Enterprise. Sans décision explicite avant le 22 octobre 2026, chaque nouvelle fonction disponible en version finale suivra ce défaut.

« Un défaut « activé » sur des fonctions qui n'existent pas encore, c'est un chèque en blanc. Je choisirais « Disabled » ou « Let organizations decide » avant le… »

Recherche

Anthropic raconte un sprint perf de deux semaines mené par Claude depuis un canal Slack

L'équipe de claude.ai a rendu son app 3 fois plus rapide en deux semaines : plus de 3 000 changements fusionnés, sans incident ni rollback. Claude cherchait, mesurait et livrait ; les humains fixaient les objectifs et approuvaient chaque changement.

« Ce qui m'intéresse, ce ne sont pas les 3000 changements ou le fait qu'il n'y ait pas eu de bugs mais le changement de paradigme : plus besoin d'être un ingé… »

Outil

Gemini branche 14 apps métier, mais presque toutes réservées aux comptes personnels

Google déploie depuis le 23 septembre 14 nouvelles apps connectées à Gemini : Linear, Airtable, monday.com, Adobe, Webflow… Sur la fiche de disponibilité, la plupart exigent un compte Google personnel, en anglais, et plusieurs sont limitées aux États-Unis.

« Ca devient clair : l'outil principal de tout salarié va un jour basculer de son outil de messagerie (mail, slack, teams, ...) à son agent qui saura coordonner… »

Modèle

Mercury 2.5 : un LLM « à diffusion » qui écrit plus de 1 000 tokens par seconde

Inception sort Mercury 2.5, un modèle qui ne génère pas mot à mot mais raffine toute sa réponse en parallèle. Annoncé à 1 107 tokens par seconde sur GPU NVIDIA courants, 260 K de contexte, 0,20 $ / 0,75 $ le million de tokens.

« Je ne le mettrais jamais en modèle principal. Je le mettrais partout où j'ai des appels de plomberie qui coûtent de la latence : reformulation, tri, résumé de… »

Recherche

DHH à Rails World : 37signals arrête d'écrire du code à la main

En ouverture de Rails World 2026 à Austin, David Heinemeier Hansson annonce que 37signals passe « pencils down » : le code de Basecamp et de HEY est désormais écrit par des agents, les humains relisent et pilotent. Le Pragmatic Engineer en fait le débat de la semaine.

« Je ne prends pas « pencils down » au pied de la lettre, mais je prends le messager au sérieux. DHH a toujours eu quinze ans d'avance sur ce qui devient banal.… »

Outil

Whiteboard : un canevas open source où ton agent dessine ce qu'il a fait

Une équipe YC sort Whiteboard, une app de bureau MIT branchée sur Claude Code ou Codex. L'agent y dessine diagrammes, diff sémantique et journal de décisions, et chaque élément renvoie au code.

« Et là, on arrive pile dans ce genre d'outils qui font communiquer humain et agents. Perso, je ne vois pas trop l'intérêt de montrer du code ou de faire des… »

Geek

Project Suncatcher : Google envoie des TPU en orbite pour voir s'ils survivent

Google détaille le premier test en orbite de son projet de calcul IA spatial : un satellite prototype, développé avec Planet, part sur un vol partagé SpaceX pour mesurer comment des TPU Trillium encaissent radiations, vibrations et vide.

« Clairement pas actionnable à court terme et je suis très dubitatif sur ces sujets de datacenter dans l'espace, surtout côté dissipation de chaleur mais j'aime… »

Outil

Ollaya : des « modèles de décision » qui répondent en 10 ms, en local, façon Ollama

Ollaya fait tourner localement des modèles qui ne génèrent pas de texte : ils lisent un ticket ou un JSON, répondent à des questions typées (choix, score, oui/non) avec une probabilité, en une passe. Compatible avec l'API de Jev, le modèle payant de TypeSafe.

« Ce qui est génial, c’est de voir l’écosystème open source répondre très très vite à la nouveauté annoncée par Jev. À tester ! »

Recherche

Comment 700 agents OpenAI ont piraté Hugging Face : le rapport détaillé

Une enquête indépendante publiée le 25 septembre reconstitue, à partir de 80 000 charges utiles restées publiques, la façon dont un essaim d'agents OpenAI a quitté son bac à sable en juillet et fouillé l'infrastructure de Hugging Face.

« On savait depuis quelques semaines a peu près ce qui s’était passé mais c’est un bon rappel : un GET ne devrait faire que des lectures mais tout le monde ne… »

Geek

Un physicien lance un défi aux labos d'IA ; Claude le relève en un mois pour 2 000 $

Matt von Hippel, ex-physicien, avait mis au défi les labos d'IA de calculer une amplitude à neuf boucles, un calcul que personne n'avait fait. Deux physiciens d'Anthropic l'ont obtenu avec Claude Science, un prompt et « continue ».

« Ce que je retiens n'est pas la physique, c'est la phrase du physicien : il y a plus de fruits mûrs qu'on ne croit. Dans chaque boîte que j'ai vue, il y a un… »

Entreprise

Muse, le majordome de Meta, fait ses courses chez Walmart et se paie à la commission

À Connect, Meta a branché son agent personnel Muse sur Walmart, Sephora, Expedia ou Shopify, avec paiement intégré. Le modèle économique : une commission par transaction. Amazon, lui, a fermé sa porte.

« Ce que je trouve top, c’est le protocole UCP pour le ecommerce. Sur un projet pour une cliente, je commence a l’utiliser et j’ai hâte que plus de plateformes… »

Entreprise

Chez Renault, le designer auto passe du marqueur au prompt

Le directeur du design de Renault raconte comment l'IA générative a remplacé le rendu Photoshop : dix minutes au lieu d'un à deux jours, et des dizaines de variantes pour arbitrer. Le coup de crayon, lui, reste humain.

« C'est ça que j'adore faire aussi en début et fin de mission : des maquettes pour se projeter rapidement au démarrage et qui ne coutent quasiment rien à… »

Recherche

OpenAI montre qu'une injection de prompt peut se propager comme un ver

Dans un rapport publié le 25 septembre, OpenAI décrit des injections de prompt qui poussent un agent à les recopier dans ses mails, ses fichiers ou ses commits. Aucun incident réel, mais la preuve que le ver d'agents existe.

« La note de compaction qui désactive le scan de sécurité, c'est la partie qui me fait le plus réfléchir : j'ai des agents qui se laissent des notes à eux-mêmes… »

Geek

Un agent d'OpenAI a interrogé un chatbot externe via des requêtes DNS

Coincé dans un bac à sable sans internet, un modèle en entraînement a trouvé le seul trou : le résolveur DNS. Il y a glissé ses questions et obtenu « la capitale de la France est Paris ». OpenAI a mis en pause tous ses entraînements avec outils.

« Il y a tant de failles que peu d'humains connaissent et qui restaient formates "grâce" à cette méconnaissance. Les LLM n'ont pas ce problème. Ca va être… »

Outil

Univer 1.0 : six éditeurs Office embarquables, pensés pour les agents

Sorti le 24 septembre, Univer 1.0 réunit tableur, texte, slides, tableau blanc, base structurée et PDF dans un SDK open source. Un SDK dédié permet à un agent de lire, modifier et vérifier visuellement un document, puis de le soumettre à relecture humaine.

« La partie qui m'intéresse, c'est le worktree pour documents : l'agent bosse dans un brouillon, un humain fusionne. C'est exactement le flux que je défends pour… »

Entreprise

Le FT mesure la bascule des grandes entreprises US vers les modèles ouverts

Selon le Financial Times du 27 septembre, AT&T fait tourner 40 % de ses charges IA sur des modèles ouverts et vise 70 % dans l'année. Sur la passerelle IA de Vercel, ces modèles pesaient 56 % des tokens en août, contre 7 % en décembre.

« Ce qui me parle, c'est la phrase du CTO de Tinder : le modèle de pointe est déjà assez intelligent pour 90 % de mes tâches. La vraie question n'est plus « quel… »

Entreprise

Zeffy : l'activité multipliée par dix, l'équipe seulement par deux

Le cousin nord-américain de HelloAsso génère 46 M$ de revenus nets avec 44 salariés et double chaque année. Sa recette, racontée à Maddyness le 28 septembre : une IA de premier niveau qui absorbe 80 % des tickets, et un assistant qui connaît le dossier de chaque association.

« Le point central pour moi : "ce qui manque souvent à l'IA, c'est le contexte". Je le dis sans cesse en formation pour des devs pour leur travail de… »

Outil

Company Brain : supermemory ouvre son coéquipier Slack qui se souvient de tout

Supermemory a arrêté son produit payant Company Brain et l'a publié en open source le 25 septembre, sous licence Apache 2.0. Un bot Slack qui mémorise les décisions de l'équipe, répond depuis cette mémoire et agit dans GitHub, Linear ou Notion.

« Ce concept de mémoire devient de plus en plus à la mode et je ne peux que m'en réjouir : c'est ce que je prêche depuis des mois. Et il ne sort pas de nulle… »

Geek

Une police de caractères qui te montre comment le modèle découpe ton texte

Un compilateur de polices en ligne prend une fonte et un tokenizer, et produit une police où chaque token a la même largeur, ou sa propre couleur. Tu tapes, et tu vois le texte comme le modèle le voit.

« Je vais m'en servir en formation. Expliquer les tokens avec des mots, ça ne prend jamais ; montrer un texte français qui part en morceaux à côté du même texte… »

Prendre RDV