标签: 推理模型
所有带有"推理模型"标签的文章。
-
学习笔记:DeepSeek-R1 等推理大模型是如何进行“深度思考”(Reasoning)的?
发布于:DeepSeek-R1 等推理大模型是如何进行「深度思考」的?本文整理自一堂公开课的学习笔记:从 Test-Time Compute 的本质讲起,梳理打造推理能力的四大技术路径(提示词 CoT、搜索工作流、模仿学习、结果导向强化学习),并深入解密 R1 的完整训练链路与过度思考的挑战。
所有带有"推理模型"标签的文章。
DeepSeek-R1 等推理大模型是如何进行「深度思考」的?本文整理自一堂公开课的学习笔记:从 Test-Time Compute 的本质讲起,梳理打造推理能力的四大技术路径(提示词 CoT、搜索工作流、模仿学习、结果导向强化学习),并深入解密 R1 的完整训练链路与过度思考的挑战。