# Exa lanceert ATLAS-benchmark voor agentisch zoeken op het web

> De nieuwe ATLAS-benchmark beoordeelt hoe goed AI-agents volledige en nauwkeurige resultaten vinden met echte zoekopdrachten op het web, en maakt duidelijk waar het nog schort aan kosten en prestaties.

Oossa · 2026-10-08 · https://oossa.com/nl/exa-launches-atlas-benchmark-for-agentic-web-search

Exa AI heeft ATLAS aangekondigd, een benchmark die de nauwkeurigheid en volledigheid meet van AI-agents die op webzoekopdrachten vertrouwen. De benchmark omvat 547 onderzoekstaken uit de praktijk, gebaseerd op geanonimiseerde zoekvragen. Hieruit blijkt dat zelfs de duurste agents ongeveer een derde van de juiste resultaten missen en dat geen enkel systeem dat minder dan $1 per taak kost een row F1-score boven de 0.5 haalt.

## De feiten

- 547 taken voor diepgaand en breed onderzoek
- Agents die minder dan $1 per taak kosten, halen nooit een row F1-score boven de 0.5

## Waarom het ertoe doet

Ontwikkelaars kunnen ATLAS gebruiken om te bepalen welke zoekbackends en agentconfiguraties de meeste waar voor hun geld bieden. Zo kunnen ze betrouwbaardere AI-tools voor onderzoek bouwen.

## Bronnen en referenties

1. [Introducing ATLAS: A new benchmark for agentic search](https://exa.ai/blog/atlas-benchmark) – Exa

Laatst bijgewerkt: 2026-10-08
