o3的核心突破

OpenAI o3在MATH、GSM8K、Codeforces等推理基准上达到前所未有的水平。关键变化:

  • 推理时间更长(思考链可达数万token)
  • 更好的工具使用
  • 更强的多步规划

实际体验

简单问答和o5差别不大,但复杂推理题、数学证明、代码调试有质的飞跃。

代价

  • 速度慢了(思考时间长)
  • 成本高了(推理token多)
  • 简单任务用它是浪费

建议

日常对话用小模型,复杂推理才调o3。