跳到正文
原文
Sebastian Raschka· Sebastian Raschka, PhD·· 2026-01-24AI 评分59

改进 LLM 推理的推理时扩展方法分类

Categories of Inference-Time Scaling for Improved LLM Reasoning

AI 导读

Sebastian Raschka 将推理时扩展方法归为 Chain-of-Thought Prompting、Self-Consistency、Best-of-N Ranking、带验证器的拒绝采样和路径搜索等类别,并讨论它们的组合。该文聚焦不改变模型权重的推理阶段计算;作者表示,相关实验将基础模型准确率从约 15% 提升至约 52%。

来源:Sebastian Raschka · magazine.sebastianraschka.com