So steuern Sie den Denkaufwand in LLMs

Controlling Reasoning Effort in LLMs

So steuern Sie den Denkaufwand in LLMs

Fast zwei Jahre nach OpenAI o1 sind Reasoning-Modelle Standard. Sebastian Raschka erklärt, wie man ein Reasoning-Modell mit mehreren Effort-Stufen trainiert, wie GPT-5.6 sie nutzt. Er zeigt, dass `<think>`-Tokens nur kosmetisch sind und dass Reasoning auch ohne sie funktioniert. Der Artikel behandelt RLVR, Inference-Scaling und die Implementierung von Reasoning-Effort-Reglern – von Qwen3s Thinking-Mode bis zu den fünf Stufen in GPT-5.6.

Diese `<think>`-Tags sind kosmetischer Natur in Bezug auf die Reasoning-Fähigkeit. Sie bringen das Modell nicht zum Denken und sind nicht erforderlich, um eine gute Reasoning-Leistung zu erzielen.

Mehr von diesem Tag

2026-07-20