# Red Queen Gödel Machine : des agents et leurs évaluateurs évoluent ensemble

> Un nouveau cadre évolutif permet aux agents d’IA et à leurs évaluateurs appris de progresser de concert, faisant passer le taux de réussite en programmation de 75 % à 82 % sur un benchmark.

Oossa · 2026-10-09 · https://oossa.com/fr/red-queen-godel-machine-lets-agents-and-evaluators-evolve-together

Des chercheurs dirigés par Alex Iacob ont publié Red Queen Gödel Machine (RQGM) sur arXiv. Le système associe un agent de programmation à un évaluateur qui évolue avec lui et note ses correctifs. Sur le benchmark DeepSWE, l’agent de RQGM résout 82.1 % des tâches mises de côté pour l’évaluation, contre 75.0 % pour une référence dotée d’un évaluateur statique. Avec davantage de calcul, ses performances se rapprochent de celles du modèle GPT‑6 Astra. Le cadre réduit aussi d’un facteur trois le coût de la recherche pour des tâches de rédaction scientifique et de notation de preuves.

## Les faits

- Article publié sur arXiv le 2026-10-09 (« Fri Oct 09 2026 »).
- L’agent réussit 82.1 % des tâches contre 75.0 % pour la référence sur DeepSWE.

## Pourquoi c'est important

Les développeurs pourraient disposer d’assistants de programmation par IA qui s’améliorent en continu sans dépendre d’une métrique d’évaluation fixe conçue par des humains.

## Sources et références

1. [The Red Queen G\"odel Machine: Co-Evolving Agents and Their Evaluators](https://arxiv.org/abs/2606.26294) – arXiv cs.MA, 2026-10-09

Dernière mise à jour: 2026-10-09
