MWS AI, входящая в МТС Web Services, добавила в открытый бенчмарк MWS AI Vision Bench экспериментальный тест на выявление поддельных документов. Модели должны были определить категорию изображения и назвать подозрительные элементы.
В набор вошли 430 изображений: исходные, вручную изменённые и пересозданные генеративной моделью. По данным MWS AI, GPT-6.1 Sol заняла первое место в общей оценке, но третье — в поиске подмен; в этой задаче лидировала Claude Opus 5.5. Компания подчёркивает, что открытый набор не вполне похож на реальные документы, поэтому результаты опубликованы отдельно от общего балла.
Почему это важно
Командам, выбирающим модель для обработки документов, тест даёт способ предварительно сравнить её ответы, но MWS AI рекомендует для защиты от мошенничества использовать специализированные решения.