
今年年初DeepSeek R1刷屏的时候,很多人第一次听说「推理模型」这个词。其实这东西解决了一个特别实在的问题:以前的AI答数学题像抢答,题目还没读完就张嘴说答案,错得理直气壮。推理模型不一样,它会先打草稿。
推理模型到底多了什么
核心就三个东西。第一是思维链,让模型把推理过程一步步写出来,而不是直接蹦结论,相当于考试时要求写出解题步骤。第二是推理时计算,通俗说就是允许多算一会儿,用更多的计算量换更高的准确率。第三是训练方式变了,用强化学习让模型学会「想」,而不是死记答案。
效果很直观。GPT-4o在AIME数学竞赛上只能答对一两成,同系列推理模型直接干到七成以上。我做了一次实测,让普通模式和深度思考模式各解十道高考数学压轴题,深度思考对八道,普通模式对三道,差距就是这么明显。
代价也摆在这
慢。一道中等难度的题要思考十秒到一分钟,屏幕上字一个个蹦出来,急性子受不了。贵,输出token翻了好几倍,API账单肉眼可见地涨。所以别什么事都开深度思考,问个天气、写段文案、翻译几句话,普通模式就够了,杀鸡不用牛刀。
2026年的情况是,各家都上了类似功能,豆包、DeepSeek、Kimi都有思考模式可以切换,成本也在往下走。蒸馏技术让小模型也能干部分推理的活,手机上已经能跑简化版。
给你一个实用建议:用AI之前先想清楚这单活需不需要「慢思考」。代码报错、数学计算、复杂逻辑判断,开深度思考;日常聊天、写文案、翻译,普通模式又快又省。现在很多App默认就是混合模式,你反而要会把它关掉。
标签: 推理模型 思维链 DeepSeek R1 大模型科普
还木有评论哦,快来抢沙发吧~