Skip to main content
推理模型是一类新型的大型语言模型,它们通过强化学习进行训练,以便在回答问题前进行思考。它们在响应前会产生一个长链的内部思考过程。推理模型的例子包括:
  • OpenAI o1-pro 和 o3-mini
  • Claude 3.7 sonnet 的扩展思考模式
  • Gemini 2.0 闪电思考
  • DeepSeek-R1
推理模型在采取行动前会深入思考并制定计划。关键在于模型在开始生成响应之前做了什么。推理模型非常擅长单次使用的用例。它们非常适合解决不需要多轮对话的难题(编码、数学、物理),或者按顺序调用工具。

示例

o3-mini

o3_mini.py

o3-mini 配合工具使用

o3_mini_with_tools.py

o3-mini 配合推理

o3_mini_with_reasoning_effort.py

使用 Groq 的 DeepSeek-R1

deepseek_r1_using_groq.py

推理模型 + 响应模型

当您运行上面的 DeepSeek-R1 Agent 时,您会注意到响应效果并不理想。这是因为 DeepSeek-R1 擅长解决问题,但不擅长以自然的方式(如 claude sonnet 或 gpt-4.5)进行响应。 如果我们想使用一个推理模型进行推理,但使用另一个模型来生成响应呢? 好消息!Agno 允许您同时使用推理模型和不同的响应模型。通过为推理和响应使用不同的模型,我们可以兼得两者之长。

DeepSeek-R1 + Claude Sonnet

deepseek_plus_claude.py

开发者资源