IA

Prime Agent : le premier harnais de code auto-améliorant open-source

Publié le 7 août 2026

IA - 07/08/2026

Prime Agent : le premier harnais de code auto-améliorant open-source

  • Date : 06/08/2026
  • Catégorie : agent IA / outil / méthode
  • Résumé technique : Prime Intellect a open-sourcé Prime Agent, un harnais de développement conçu autour de deux abstractions : le Recursive Language Model (RLM) et le Continual Harness 29. Contrairement aux agents classiques limités par des schémas d'outils fixes, Prime Agent remplace le scaffolding par un kernel IPython persistant. L'agent peut créer, lire, modifier ou supprimer ses propres prompts, compétences, mémoire et sous-agents via la commande /refine, qui analyse sa propre trajectoire pour appliquer des corrections ciblées sans bloquer l'exécution. Il atteint 95,5 % sur ARC-AGI-3, dépassant le baseline humain expert de 95,4 %.
  • Pourquoi c’est intéressant : Brise le paradigme des agents statiques en permettant une auto-réfection en temps réel. Idéal pour les équipes ingénierie, labs IA et devs solaires cherchant un outil MIT, déployable en une commande, compatible subscriptions/API/self-hosted, et capable de refactoring nocturne ou de génération de kernels GPU vérifiés.
  • Angle possible pour une vidéo YouTube : "Comment cet agent IA réécrit son propre code, bat les experts humains et révolutionne le scaffolding LLM"
  • Source originale : MarkTechPost / Prime Intellect
  • URL directe :

Kitesurf : le navigateur stateless ultra-léger dédié aux agents IA

  • Date : 06/08/2026
  • Catégorie : outil / automatisation / agent IA
  • Résumé technique : Cloudflare a lancé Kitesurf, un moteur de navigation sans état exécuté entièrement dans des isolats V8 sur Cloudflare Workers, sans Chromium sous-jacent 30. Il élimine le surplus UI (onglets, extensions, rendu 60fps) pour ne garder que le contenu machine-readable. Benchmarks : 3,1 à 3,8× moins de CPU et 4,7 à 7,0× moins de mémoire qu'un navigateur classique par session agent, avec une compatibilité native Puppeteer/Playwright via un seul paramètre browser=kitesurf.
  • Pourquoi c’est intéressant : Résout le goulot d'étranglement économique et mémoire de l'automatisation web par IA. Permet de scaler des flottes d'agents d'extraction, de RAG ou d'actions Quick Actions sans exploser la facture cloud. Déjà en bêta gratuite via Browser Run.
  • Angle possible pour une vidéo YouTube : "Adieu Chromium : Cloudflare lance un navigateur 7× plus léger pour scaler vos agents IA sans faillite"
  • Source originale : MarkTechPost / Cloudflare
  • URL directe :

SDK Channels de CopilotKit : déployez un agent existant dans Slack/Teams sans réécrire

  • Date : 06/08/2026
  • Catégorie : outil / automatisation / agent IA
  • Résumé technique : CopilotKit publie le Channels SDK (MIT), une librairie qui agit comme un transport et un rendu natif pour vos agents 31. Elle utilise le protocole AG-UI pour acheminer les événements Slack ou Teams vers votre agent (LangGraph, CrewAI, Pydantic AI, etc.), exécuter les outils, et rendre l'UI en Block Kit ou Adaptive Cards sans passer par un blob texte. Intègre nativement l'approbation humaine-in-the-loop et la persistance cross-platform.
  • Pourquoi c’est intéressant : Décolle le dernier kilomètre du déploiement agent. Plus besoin de developper un webhook par plateforme. Un seul composant JSX sert de source de vérité, l'adaptateur gère la sérialisation et le binding des actions. Nécessite un runner Node.js long-évitant (pas compatible serverless pur).
  • Angle possible pour une vidéo YouTube : "Intégrez vos agents IA dans Slack et Teams en 5 minutes, sans toucher à votre logique business"
  • Source originale : MarkTechPost / CopilotKit
  • URL directe :

Environnements auto-hébergés pour Claude Code (Anthropic)

  • Date : 06/08/2026
  • Catégorie : agent IA / automatisation / outil
  • Résumé technique : Anthropic ouvre la bêta publique des environnements self-hosted pour Claude Code 34. Les sessions s'exécutent sur des runners internes à l'entreprise, gardant les checkout repo, artifacts, secrets et fichiers modifiés sur infrastructure client. Seuls les prompts, réponses et résultats d'outils transitent vers l'API Anthropic pour l'inférence. Deux modes de runners : fixed (capacité statique) et on-demand (orchestration élastique).
  • Pourquoi c’est intéressant : Répond aux contraintes de conformité stricte et de souveraineté du code. Permet aux agents de toucher aux toolchains internes, registres et bases de données sans exposition internet. Le modèle de billing reste identique, mais l'opérationnel (image runner, réseau, scaling) est transféré à l'équipe plateforme client.
  • Angle possible pour une vidéo YouTube : "Claude Code 100% privé : comment exécuter l'agent de Anthropic sur vos propres serveurs sans fuite de code"
  • Source originale : Unite.ai / Anthropic
  • URL directe :

LFM2.5-2.6B de Liquid AI : l'agent IA optimisé pour l'exécution on-device

  • Date : 06/08/2026
  • Catégorie : LLM / outil / méthode
  • Résumé technique : Liquid AI diffuse LFM2.5-2.6B, un modèle agencé de 2,69B paramètres architecturé autour de 22 blocs convolutifs courts double-gated et 8 blocs GQA 32. Fenêtre de contexte de 131K tokens, vocabulaire étendu à 128K. Entraîné sur ~34T tokens avec 4 phases de post-training incluant GRPO dans des harnais réels. Décodage à 220 tok/s sur M5 Max, <2,5 Go RAM, compétitif avec des modèles 4× plus gros sur ToolSandbox et IFStruct.
  • Pourquoi c’est intéressant : Valide la viabilité économique des agents locaux : coût marginal quasi nul, zéro latence réseau, confidentialité garantie. Formats GGUF/MLX/ONNX prêts pour llama.cpp/vLLM. Idéal pour l'automatisation interne, l'extraction de documents longue-contexte ou les robots industriels hors-ligne.
  • Angle possible pour une vidéo YouTube : "Un agent IA de 2,6 milliards de paramètres qui tourne entièrement sur votre MacBook sans internet"
  • Source originale : MarkTechPost / Liquid AI
  • URL directe : https://www.marktechpost.com/2026/08/06/liquid-ai-lfm2-5-2-6b-on-device-agentic-model/

NemoClaw + Nemotron 3 Ultra : la pile ouverte LangChain/NVIDIA pour agents souverains

  • Date : 06/08/2026
  • Catégorie : agent IA / outil / méthode
  • Résumé technique : NVIDIA publie NemoClaw for LangChain Deep Agents, un blueprint open-source combinant le harnais LangChain Deep Agents (optimisé pour le profil Nemotron 3 Ultra) et le runtime sécurisé NVIDIA OpenShell 26. Le package permet aux entreprises de construire, tuner et exécuter des systèmes d'agents multi-modèles, outils et runtime sans dépendance cloud forcée.
  • Pourquoi c’est intéressant : Offre une stack end-to-end propriétaire mais open, permettant la gouvernance complète, le tuning sur données métier et le déploiement on-prem/cloud hybride. Réduit les risques de vendor lock-in et de fuite de données critiques pour les secteurs régulés ou industrialisés.
  • Angle possible pour une vidéo YouTube : "NVIDIA et LangChain unissent leurs forces : comment déployer des agents IA souverains 100% open-source"
  • Source originale : NVIDIA AI Blog / LangChain
  • URL directe :