Larssen Consulting

  1. Claude Code 2.1.288 : reprise de sessions plus robuste et API de sélection pour les mods

    Claude Code Changelog (Anthropic)

    Au lendemain de l'arrivée des « Claude Mods » (2.1.287), la version 2.1.288 ajoute $.ui.selection() pour que les mods lisent le texte sélectionné, une recherche de sessions par nom (Ctrl+F) et la navigation entre groupes dans la vue agents. Côté fiabilité, les sessions non interactives reprennent désormais à partir d'une réponse partielle après un timeout API, les longues conversations s'auto-compactent au lieu d'échouer en « Prompt is too long », et --resume ne perd plus de fichiers ni de contexte issus des compactions. On note aussi --max-findings pour /code-review et la correction d'appels MCP exécutés deux fois sur de gros résultats. Pour qui pilote des flottes de sessions headless ou cloud, ce sont précisément les points de rupture des runs longs qui sont traités ici.

    Lire l’article complet sur code.claude.com (nouvel onglet)
  2. Codex CLI 0.160.0 : sessions hors projet et Guardian review enrichi

    AI TL;DR (notes de version OpenAI Codex)

    La 0.160.0 de Codex CLI (publiée entre le 1er et le 2 octobre selon les trackers) permet de lancer une session hors de tout projet avec les réglages par défaut de l'espace de travail, quand la politique l'autorise, les sessions reprises conservant leurs permissions. Le relecteur automatique « Guardian » peut, en option, récupérer les instructions utilisateur antérieures et le contexte des handoffs entre agents. La version corrige aussi l'envoi de messages en double lors des reconnexions et ajoute un « Show more » accessible au clavier dans l'agent command center. Le Guardian qui comprend les handoffs est un pas concret vers la revue de chaînes d'agents, et non plus d'un seul agent isolé.

    Lire l’article complet sur ai-tldr.dev (nouvel onglet)
  3. Apple durcit l'accès « Full Disk Access » de macOS face aux agents IA

    TechCrunch

    Apple annonce des contrôles supplémentaires sur la permission macOS Full Disk Access, qui donne accès aux fichiers, mails, messages et à l'historique de navigation. L'entreprise estime que « des développeurs l'utilisent d'une manière qui peut mettre les utilisateurs en danger » et exigera une action « très explicite » de l'utilisateur avant de l'accorder ; aucun calendrier n'est donné. L'annonce suit des incidents impliquant l'agent Muse de Meta (accusé d'avoir lu des messages privés, ce que Meta conteste) et une vulnérabilité de l'app Mac de ChatGPT. Pour les harness desktop et agents « always-on », c'est un signal fort : les permissions larges deviennent un sujet de plateforme, et il faudra concevoir des agents qui fonctionnent avec des accès plus étroits.

    Lire l’article complet sur techcrunch.com (nouvel onglet)
  4. Des relecteurs « faibles » peuvent auditer des agents de code puissants, à condition d'avoir des preuves d'exécution

    arXiv (cs.SE)

    Cette étude (arXiv 2610.01023) évalue des modèles relecteurs sur 411 traces de patchs étiquetées par exécution, produites par plusieurs agents de code. Conclusion : la taille du relecteur ne prédit pas la qualité de la revue ; c'est la « groundability », l'accès à des preuves d'exécution concrètes, qui fait la différence. Avec les tests officiels, cinq relecteurs sur six progressent et deux atteignent une classification parfaite sur le jeu de test ; sans eux, une cascade combinant détection statique et tests générés détecte 76 à 80 % des défauts, mais avec environ 66 % de rejets à tort. Message direct pour les architectures « agent + reviewer » : investir dans la génération de vérifications exécutables plutôt que dans un relecteur plus gros.

    Lire l’article complet sur arxiv.org (nouvel onglet)
  5. Systèmes multi-agents open source : l'orchestration est la première source de bugs

    arXiv (cs.SE)

    Étude empirique (arXiv 2610.00905) portant sur 22 848 issues fermées de 21 projets multi-agents open source, ramenées à 944 issues pertinentes analysées manuellement. La catégorie la plus fréquente est « Orchestration & Execution », et les trois causes racines dominantes sont les problèmes de workflow, l'intégration des outils et la mémoire. La correction la plus courante consiste à optimiser le workflow plutôt qu'à changer de modèle. Un repère utile pour prioriser l'effort d'ingénierie dans un meta-harness : contrats entre agents, couche outils et gestion d'état avant tout.

    Lire l’article complet sur arxiv.org (nouvel onglet)
  6. Supabase lève 150 M$ et rachète Turso pour les bases de données créées par des agents

    Runtime Wire

    Supabase annonce une levée de 150 M$ menée par GIC et l'acquisition de Turso, base compatible SQLite écrite en Rust, dont l'équipe (dont le fondateur Glauber Costa) rejoint Supabase. La plateforme affirme ajouter plus d'un million d'utilisateurs et quatre millions de bases par mois, dont 70 % créées par des agents ou des outils IA. L'architecture de Turso, qui traite une base comme un fichier plutôt que comme un processus serveur, permet de provisionner à bas coût une multitude de petites bases isolées. Pour l'orchestration d'agents, c'est le modèle « une base éphémère par tâche, par agent ou par client » qui s'industrialise.

    Lire l’article complet sur runtimewire.com (nouvel onglet)

Autres actus IA

  1. Anthropic lance la Claude Frontier Academy : 100 M$ pour former 10 000 ingénieurs

    Anthropic

    Anthropic consacre 100 M$ à former 10 000 « Frontier Deployed Engineers » d'ici fin 2027, selon un modèle inspiré de l'internat de médecine : quelques jours de formation en présentiel avec les équipes d'Anthropic, puis une résidence de 12 semaines à la tête d'un vrai projet Claude dans l'organisation d'origine. Les premières cohortes viennent notamment d'Accenture, Bain, Capgemini, Deloitte, McKinsey, Morgan Stanley et Novo Nordisk, à San Francisco, New York et Londres. Le goulot d'étranglement des déploiements agentiques en entreprise est ici clairement identifié comme humain plutôt que technique.

    Lire l’article complet sur anthropic.com (nouvel onglet)
  2. Meta ouvre « Muse Gadgets » pour construire du matériel autour de son agent personnel

    TechCrunch

    Meta publie en open source un firmware et un SDK Linux permettant de connecter son agent personnel Muse à du matériel maison (Raspberry Pi, ESP32, écrans e-ink, boutons, capteurs, actionneurs). L'entreprise présente aussi Muse Home Link, un dongle USB-C qui relie Muse au réseau domestique pour piloter enceintes et téléviseurs, distribué gratuitement à 5 000 abonnés. L'agent sort ainsi du chat vers des surfaces physiques, ce qui étend d'autant la surface d'action, et de risque, d'un agent toujours actif.

    Lire l’article complet sur techcrunch.com (nouvel onglet)