# Aleph Alpha 训练模型用德语推理

> Aleph Alpha 表示，约 80 万条德语训练样本帮助一款小型 AI 模型生成德语推理过程。这项工作也揭示了一种取舍：模型的德语基准测试成绩起初下滑，部分原因是它会反复重复自己的想法。

Oossa · 2026-09-29 · https://oossa.com/zh/aleph-alpha-trains-a-model-to-reason-in-german

Aleph Alpha 研究人员 Niklas Finken 和 Simon Thel 介绍了一种训练 AI 模型用德语推理、而不只是用德语作答的方法。他们通过提示其他模型用德语开始推理，生成约 80 万条训练样本，再用这些样本对一款拥有 30 亿活跃参数的模型进行微调。

该公司表示，模型的英语表现保持不变，但德语数学成绩起初有所下滑：在 German AIME 2026 中，成绩从 70.2 降至 48.3，随后在数学数据最充分的一轮训练中回升至 67.3。研究人员称，加入同一学科领域的德语数据，比笼统地增加德语数据更有帮助；目前，这种方法还无法可靠地阻止模型陷入循环。

## 事实

- 研究人员生成了约 80 万条用于德语监督微调的样本。
- German AIME 2026 成绩：调整前为 70.2，初期降至 48.3，在数学数据最充分的一轮训练中升至 67.3。

## 为什么重要

对德语用户而言，这项工作让他们看到了用自己的语言阅读 AI 推理过程的可能性，但也表明，提升语言一致性可能要付出准确性和可靠性方面的代价。

## 来源与参考

1. [Through the Valley of Tears: Cold Starting German Reasoning in LLMs](https://www.aleph-alpha.com/en/blog/through-the-valley-of-tears-cold-starting-german-reasoning-in-llms/) – Aleph Alpha, 2026-09-29

最后更新: 2026-09-29
