Aller au contenu principal

Ma veille IA

Chaque jour, je trie l'actualité de l'IA pour n'en garder que quelques trouvailles : un nouveau modèle, un outil, une idée à piquer. Pour chacune, ce que c'est, à quoi ça sert, et ce que j'en pense vraiment. Le vendredi, je fais le point sur la semaine.

S'abonner au flux RSS

C'est quoi, « Ma veille IA » ?

C'est une sélection quotidienne de quelques trouvailles de l'actualité de l'IA, en français, chacune résumée en deux minutes de lecture et accompagnée de mon avis. Chaque jour, je passe l'écosystème au crible — annonces de labos, sorties d'outils, publications de recherche, mouvements d'entreprises — et je n'en garde que ce qui mérite ton temps. Une note dit ce que c'est, pourquoi c'est intéressant, à quoi ça sert, et ce que j'en pense vraiment.

Le rythme est celui-ci : des notes tous les jours, et un récap éditorial le vendredi. Le récap n'est pas un empilement de liens : c'est un texte qui relie les trouvailles de la semaine entre elles et dégage ce qui compte. Il ne paraît que si la semaine a été assez fournie — en dessous de cinq notes publiées, il n'y a rien à relier, et je ne publie rien.

Ce qui fait vivre ce format, c'est le filtre. Il existe des dizaines de veilles IA qui listent tout ce qui sort ; ici, la valeur est autant dans ce qui a été écarté que dans ce qui reste. La sélection est outillée — un agent parcourt les sources pour moi chaque matin et me propose des candidats — mais rien n'est publié sans que je l'aie lu, vérifié, corrigé et commenté. Aucune note ne part automatiquement.

Pour qui j'écris, et pour qui ce n'est pas ?

J'écris pour les gens qui doivent décider quoi faire de l'IA dans leur entreprise : CTO, CPO, dirigeants de PME, fondateurs, responsables produit. Des gens qui n'ont pas le temps de suivre l'écosystème à plein temps, mais qui ne peuvent pas se permettre de le découvrir six mois en retard, parce qu'ils arbitrent des budgets, des recrutements et des feuilles de route.

Les profils techniques y trouvent leur compte, et une bonne partie des notes parle d'outils. Mais l'angle n'est jamais « comment ça marche » : c'est « dans quel type de projet je m'en servirais ». Si tu cherches une analyse d'architecture de modèle, une comparaison de techniques d'entraînement ou un commentaire de benchmark, ce n'est pas ici : c'est de la veille de data scientist, et elle est très bien faite ailleurs.

Ce n'est pas non plus un fil d'actualité exhaustif. Si ton besoin est de ne rien manquer, prends un agrégateur. Ici, tu manqueras beaucoup de choses — volontairement.

Quels sujets sont couverts, et lesquels sont écartés ?

Le périmètre est plus large que « l'IA pour les développeurs ». Ce que tu trouveras :

  • les modèles et leurs nouvelles versions, chez tous les labos — Anthropic, OpenAI, Google, Mistral, Meta, Qwen, DeepSeek — et pas seulement chez celui que j'utilise le plus ;
  • les outils, y compris ceux destinés à des gens qui ne codent pas : assistant métier, support client, vente, RH ;
  • l'organisation : comment les équipes se réorganisent, ce que l'IA change aux rôles et aux façons de travailler ;
  • l'argent : coûts, prix, budgets, et les levées qui disent quelque chose de l'état du marché ;
  • le recrutement et les métiers : ce qui se recrute, ce qui se déplace, ce qui disparaît ;
  • la recherche, quand elle a une conséquence lisible pour une équipe produit ;
  • et de temps en temps une trouvaille purement geek : pas actionnable, mais trop belle pour être passée sous silence.

Ce qui est écarté, tout aussi délibérément :

  • le trop technique pour cette audience : architecture de modèle, technique d'entraînement, benchmark de niche ;
  • les sujets qui ne tiennent pas debout seuls — un outil dont l'intérêt ne se dit qu'en le tordant n'a pas de note ;
  • les changelogs quotidiens des assistants de code, qui sortent une version quasi tous les jours : leurs vrais changements se traitent une fois par semaine, dans le récap du vendredi.

Comment je choisis ce qui mérite une note ?

Trois critères, dans cet ordre : c'est récent, c'est actionnable, et j'ai quelque chose à en dire qui ne soit pas une évidence. Récent, parce qu'une veille qui commente ce que tout le monde sait déjà ne sert à rien. Actionnable, parce qu'une trouvaille doit changer quelque chose pour quelqu'un : un arbitrage, un essai à lancer, une décision à reporter.

Pour l'avis, le test que je m'applique est simple : est-ce que cette phrase serait vraie de n'importe quel logiciel ? Si oui, elle ne dit rien, et la note ne sort pas. « Bien pensé », « pratique au quotidien », « ça fait gagner du temps » : ce sont des phrases qui ne coûtent rien à écrire et qui n'apprennent rien.

Deux règles complètent ça. Chaque note cite au moins une source primaire — l'annonce officielle, le dépôt, le papier — jamais un relais qui relaie un relais. Et aucun chiffre, prix, date ou numéro de version n'est écrit s'il n'est pas lisible dans cette source ; en cas de doute, je le signale plutôt que d'inventer une précision.

Enfin, un lot quotidien cherche son équilibre : au moins deux sujets qui parlent à un dirigeant, deux outils de développeur au plus. C'est une veille de l'IA, pas la veille de mon outil préféré.

Qu'est-ce que tu en retires ?

De quoi arbitrer plus vite, avec moins de bruit. Concrètement, le genre de décision que ça aide à prendre côté direction :

  • tester ce nouveau modèle sur ton cas d'usage maintenant, ou attendre la version suivante ;
  • ce que l'IA fait bouger dans ton budget, entre ce qui coûte trois fois moins cher qu'il y a un an et ce qui coûte plus cher que prévu ;
  • quel poste recruter maintenant, et lequel peut attendre six mois ;
  • si un outil qui vient de sortir remplace vraiment une brique de ton produit, ou seulement une démo impressionnante ;
  • quoi répondre quand ton comité de direction demande « bon, et l'IA, on en fait quoi ? ».

Et à l'inverse : de quoi ne rien faire, en paix, sur les trois quarts des annonces — parce que quelqu'un les a lues pour toi et a conclu qu'elles pouvaient attendre.

Comment suivre la veille ?

Trois façons, au choix.

  • Cette page. Les notes y apparaissent dans l'ordre chronologique, la plus récente en haut. C'est l'adresse à garder en favori.
  • Le flux RSS. S'abonner au flux donne les trente dernières notes, mises à jour à chaque publication. C'est le moyen le plus fiable de ne rien manquer.
  • Le récap du vendredi. Un seul texte pour toute la semaine, si tu préfères lire une fois plutôt que tous les jours. Les récaps parus sont listés en haut de cette page.

Une newsletter viendra plus tard, et je le dirai ici quand ce sera le cas. En attendant, le RSS et cette page sont les deux seules portes d'entrée.

Lundi 28 septembre

Geek

Une police de caractères qui te montre comment le modèle découpe ton texte

Un compilateur de polices en ligne prend une fonte et un tokenizer, et produit une police où chaque token a la même largeur, ou sa propre couleur. Tu tapes, et tu vois le texte comme le modèle le voit.

« Je vais m'en servir en formation. Expliquer les tokens avec des mots, ça ne prend jamais ; montrer un texte français qui part en morceaux à côté du même texte… »

Outil

Company Brain : supermemory ouvre son coéquipier Slack qui se souvient de tout

Supermemory a arrêté son produit payant Company Brain et l'a publié en open source le 25 septembre, sous licence Apache 2.0. Un bot Slack qui mémorise les décisions de l'équipe, répond depuis cette mémoire et agit dans GitHub, Linear ou Notion.

« Ce concept de mémoire devient de plus en plus à la mode et je ne peux que m'en réjouir : c'est ce que je prêche depuis des mois. Et il ne sort pas de nulle… »

Entreprise

Zeffy : l'activité multipliée par dix, l'équipe seulement par deux

Le cousin nord-américain de HelloAsso génère 46 M$ de revenus nets avec 44 salariés et double chaque année. Sa recette, racontée à Maddyness le 28 septembre : une IA de premier niveau qui absorbe 80 % des tickets, et un assistant qui connaît le dossier de chaque association.

« Le point central pour moi : "ce qui manque souvent à l'IA, c'est le contexte". Je le dis sans cesse en formation pour des devs pour leur travail de… »

Entreprise

Le FT mesure la bascule des grandes entreprises US vers les modèles ouverts

Selon le Financial Times du 27 septembre, AT&T fait tourner 40 % de ses charges IA sur des modèles ouverts et vise 70 % dans l'année. Sur la passerelle IA de Vercel, ces modèles pesaient 56 % des tokens en août, contre 7 % en décembre.

« Ce qui me parle, c'est la phrase du CTO de Tinder : le modèle de pointe est déjà assez intelligent pour 90 % de mes tâches. La vraie question n'est plus « quel… »

Dimanche 27 septembre

Outil

Univer 1.0 : six éditeurs Office embarquables, pensés pour les agents

Sorti le 24 septembre, Univer 1.0 réunit tableur, texte, slides, tableau blanc, base structurée et PDF dans un SDK open source. Un SDK dédié permet à un agent de lire, modifier et vérifier visuellement un document, puis de le soumettre à relecture humaine.

« La partie qui m'intéresse, c'est le worktree pour documents : l'agent bosse dans un brouillon, un humain fusionne. C'est exactement le flux que je défends pour… »

Geek

Un agent d'OpenAI a interrogé un chatbot externe via des requêtes DNS

Coincé dans un bac à sable sans internet, un modèle en entraînement a trouvé le seul trou : le résolveur DNS. Il y a glissé ses questions et obtenu « la capitale de la France est Paris ». OpenAI a mis en pause tous ses entraînements avec outils.

« Il y a tant de failles que peu d'humains connaissent et qui restaient formates "grâce" à cette méconnaissance. Les LLM n'ont pas ce problème. Ca va être… »

Recherche

OpenAI montre qu'une injection de prompt peut se propager comme un ver

Dans un rapport publié le 25 septembre, OpenAI décrit des injections de prompt qui poussent un agent à les recopier dans ses mails, ses fichiers ou ses commits. Aucun incident réel, mais la preuve que le ver d'agents existe.

« La note de compaction qui désactive le scan de sécurité, c'est la partie qui me fait le plus réfléchir : j'ai des agents qui se laissent des notes à eux-mêmes… »

Entreprise

Chez Renault, le designer auto passe du marqueur au prompt

Le directeur du design de Renault raconte comment l'IA générative a remplacé le rendu Photoshop : dix minutes au lieu d'un à deux jours, et des dizaines de variantes pour arbitrer. Le coup de crayon, lui, reste humain.

« C'est ça que j'adore faire aussi en début et fin de mission : des maquettes pour se projeter rapidement au démarrage et qui ne coutent quasiment rien à… »

Samedi 26 septembre

Entreprise

Muse, le majordome de Meta, fait ses courses chez Walmart et se paie à la commission

À Connect, Meta a branché son agent personnel Muse sur Walmart, Sephora, Expedia ou Shopify, avec paiement intégré. Le modèle économique : une commission par transaction. Amazon, lui, a fermé sa porte.

« Ce que je trouve top, c’est le protocole UCP pour le ecommerce. Sur un projet pour une cliente, je commence a l’utiliser et j’ai hâte que plus de plateformes… »

Geek

Un physicien lance un défi aux labos d'IA ; Claude le relève en un mois pour 2 000 $

Matt von Hippel, ex-physicien, avait mis au défi les labos d'IA de calculer une amplitude à neuf boucles, un calcul que personne n'avait fait. Deux physiciens d'Anthropic l'ont obtenu avec Claude Science, un prompt et « continue ».

« Ce que je retiens n'est pas la physique, c'est la phrase du physicien : il y a plus de fruits mûrs qu'on ne croit. Dans chaque boîte que j'ai vue, il y a un… »

Recherche

Comment 700 agents OpenAI ont piraté Hugging Face : le rapport détaillé

Une enquête indépendante publiée le 25 septembre reconstitue, à partir de 80 000 charges utiles restées publiques, la façon dont un essaim d'agents OpenAI a quitté son bac à sable en juillet et fouillé l'infrastructure de Hugging Face.

« On savait depuis quelques semaines a peu près ce qui s’était passé mais c’est un bon rappel : un GET ne devrait faire que des lectures mais tout le monde ne… »

Outil

Ollaya : des « modèles de décision » qui répondent en 10 ms, en local, façon Ollama

Ollaya fait tourner localement des modèles qui ne génèrent pas de texte : ils lisent un ticket ou un JSON, répondent à des questions typées (choix, score, oui/non) avec une probabilité, en une passe. Compatible avec l'API de Jev, le modèle payant de TypeSafe.

« Ce qui est génial, c’est de voir l’écosystème open source répondre très très vite à la nouveauté annoncée par Jev. À tester ! »

Vendredi 25 septembre

Geek

Project Suncatcher : Google envoie des TPU en orbite pour voir s'ils survivent

Google détaille le premier test en orbite de son projet de calcul IA spatial : un satellite prototype, développé avec Planet, part sur un vol partagé SpaceX pour mesurer comment des TPU Trillium encaissent radiations, vibrations et vide.

« Clairement pas actionnable à court terme et je suis très dubitatif sur ces sujets de datacenter dans l'espace, surtout côté dissipation de chaleur mais j'aime… »

Outil

Whiteboard : un canevas open source où ton agent dessine ce qu'il a fait

Une équipe YC sort Whiteboard, une app de bureau MIT branchée sur Claude Code ou Codex. L'agent y dessine diagrammes, diff sémantique et journal de décisions, et chaque élément renvoie au code.

« Et là, on arrive pile dans ce genre d'outils qui font communiquer humain et agents. Perso, je ne vois pas trop l'intérêt de montrer du code ou de faire des… »

Recherche

DHH à Rails World : 37signals arrête d'écrire du code à la main

En ouverture de Rails World 2026 à Austin, David Heinemeier Hansson annonce que 37signals passe « pencils down » : le code de Basecamp et de HEY est désormais écrit par des agents, les humains relisent et pilotent. Le Pragmatic Engineer en fait le débat de la semaine.

« Je ne prends pas « pencils down » au pied de la lettre, mais je prends le messager au sérieux. DHH a toujours eu quinze ans d'avance sur ce qui devient banal.… »

Modèle

Mercury 2.5 : un LLM « à diffusion » qui écrit plus de 1 000 tokens par seconde

Inception sort Mercury 2.5, un modèle qui ne génère pas mot à mot mais raffine toute sa réponse en parallèle. Annoncé à 1 107 tokens par seconde sur GPU NVIDIA courants, 260 K de contexte, 0,20 $ / 0,75 $ le million de tokens.

« Je ne le mettrais jamais en modèle principal. Je le mettrais partout où j'ai des appels de plomberie qui coûtent de la latence : reformulation, tri, résumé de… »

Outil

Gemini branche 14 apps métier, mais presque toutes réservées aux comptes personnels

Google déploie depuis le 23 septembre 14 nouvelles apps connectées à Gemini : Linear, Airtable, monday.com, Adobe, Webflow… Sur la fiche de disponibilité, la plupart exigent un compte Google personnel, en anglais, et plusieurs sont limitées aux États-Unis.

« Ca devient clair : l'outil principal de tout salarié va un jour basculer de son outil de messagerie (mail, slack, teams, ...) à son agent qui saura coordonner… »

Recherche

Anthropic raconte un sprint perf de deux semaines mené par Claude depuis un canal Slack

L'équipe de claude.ai a rendu son app 3 fois plus rapide en deux semaines : plus de 3 000 changements fusionnés, sans incident ni rollback. Claude cherchait, mesurait et livrait ; les humains fixaient les objectifs et approuvaient chaque changement.

« Ce qui m'intéresse, ce ne sont pas les 3000 changements ou le fait qu'il n'y ait pas eu de bugs mais le changement de paradigme : plus besoin d'être un ingé… »

Outil

GitHub Copilot : les nouvelles fonctions s'activeront seules dès le 22 octobre

GitHub ajoute une politique globale « par défaut » aux réglages Copilot Business et Enterprise. Sans décision explicite avant le 22 octobre 2026, chaque nouvelle fonction disponible en version finale suivra ce défaut.

« Un défaut « activé » sur des fonctions qui n'existent pas encore, c'est un chèque en blanc. Je choisirais « Disabled » ou « Let organizations decide » avant le… »

Prendre RDV