タグ: #test-time-compute
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 2 件
もっと考えれば正解に近づく、とは限らない: テストタイム計算と過剰思考
2026年4月、Shu Zhou ら6名は "When More Thinking Hurts" で、推論トークンをただ増やし続ける流れに正面から問いを立てます。著者らの報告によれば、計算予算が大きくなるほど追加の推論トークンの限界効用は大きく減り、ある地点からモデルは「過剰思考」に陥って、いったん正解していた答えを自ら覆します。最適な思考の長さは問題の難易度ごとに異なるため、すべてに同じ予算を与える方式は無駄が多い、というわけです。ア
2026-07-11 · 13 分で読めます #ai#llm#reasoning#inference#test-time-compute推論モデル(reasoning models) 2026年ガイド — o3·o4·DeepSeek R1·Claude Thinking·Gemini Deep Think·QwQ 徹底比較
2024年9月のo1がtest-time computeという新しい軸を開いてから1年半。2026年現在、『推論モデル(reasoning model)』はもはや別の系統ではなく、すべてのフロンティアモデルが入れる『状態(mode)』になった。OpenAI o3·o3-pro·o4、DeepSeek R1·R1-0528·V3.1 reasoner、Anthropic Claude Sonnet 4.5·Opus 4.5のextende
2026-05-14 · 30 分で読めます #reasoning-models#o3#o4#deepseek-r1#claude-thinking