Un laboratoire d’intelligence artificielle relativement peu connu vient de lancer un modèle capable de gérer 150 tâches simultanément, en s’exécutant sur du matériel que vous pourriez posséder. Apodex 1.1, publié le 24 août 2026, repose sur une thèse apparemment simple : le véritable goulot d’étranglement pour les agents d’IA n’est pas leur intelligence brute, mais l’environnement dans lequel ils s’exécutent.
La famille de modèles, détaillée dans un article arXiv (2608.23283), positionne les environnements exécutables comme la principale surface d'évolution pour les agents IA à long terme.
Modèle plus petit, chiffres compétitifs
Apodex 1.1 a obtenu des scores de référence qui le placent en concurrence directe avec des modèles provenant de laboratoires disposant de ressources bien plus importantes. Il a obtenu 38,5 sur APEX-Agents et 78,8 sur GDPVal, deux benchmarks conçus pour mesurer la réalisation de tâches agentes et le raisonnement général dans des conditions réalistes.
Sur les évaluations spécifiques au domaine, les résultats se sont maintenus. FrontierFinance a obtenu 54,3, tandis que FrontierScience-Research a atteint 63,3. Selon l'équipe Apodex, ces chiffres placent le modèle au même niveau ou au-dessus des systèmes plus volumineux d'Anthropic et d'OpenAI, notamment Claude et les variantes GPT-5.x.
La variante Apodex 1.1 Mini fonctionne avec 35 milliards de paramètres, une fraction du nombre de paramètres associés aux modèles de pointe des grands laboratoires. L'équipe a publié des poids ouverts pour cette variante, ce qui permet aux chercheurs et aux entreprises de la déployer localement sans transmettre chaque requête via une API cloud.
AgentOS et le problème de coordination
Le titre architectural désigne ce que l'équipe appelle le cadre d'exécution partagé et AgentOS. Ce sont des composants au niveau de l'infrastructure qui permettent à plusieurs agents IA de travailler simultanément sur différentes parties d'une tâche complexe, tout en conservant un registre cohérent des actions et des raisons de chaque agent.
Le système prend en charge jusqu'à 150 sous-agents exécutés en parallèle sur les tâches de récupération et de synthèse. La traçabilité de la provenance est intégrée, ce qui signifie que chaque étape effectuée par un agent est enregistrée et attribuable.
Le système de coordination utilise ce que l'équipe décrit comme des équipes d'agents asynchrones. Plutôt que d'obliger les agents à attendre dans une file d'attente, les tâches sont décomposées et réparties entre plusieurs clusters d'agents pouvant opérer indépendamment et réconcilier leurs résultats ultérieurement.
Outils open-source et la dimension recherche
Aux côtés du modèle lui-même, l'équipe Apodex a rendu FrontierAgent open source, une plateforme d'exécution et de recherche conçue pour soutenir les workflows de type ReAct. ReAct, qui signifie Reasoning and Acting, est un cadre dans lequel les modèles d'IA alternent entre la réflexion sur un problème et l'accomplissement d'actions concrètes dans un environnement.
La version représente une amélioration notable par rapport au travail précédent de l'équipe. Apodex 1.0 Mini, le modèle précédent, semblait éprouver des difficultés avec les tâches chevauchantes, ce type de travail où plusieurs processus doivent partager un contexte et éviter de se chevaucher dans leurs sorties. Apodex 1.1 cible spécifiquement cette faiblesse.
