关闭广告

研究人员提出OThink-R1,让大模型自行决定是否需要深度思考

DeepTech深科技835人阅读

近日,浙江大学硕士生张盛佳和所在团队发现:深度推理模型的部分推理过程是不必要的。一方面,目前的深度推理模型在面对一些例如“1+1=?”的简单问题时,也需要大费周章地进行深度思考。而人类在面对诸如此类的简单问题时,往往能够凭直觉给出答案;另一方面,在一些简单任务上(例如,常识问答和小学生数学题),即使不具有深度推理能力的大模型也能取得较好的效果。本次研究基于所观察到的现象提出了一种解决方案,使得深度推理大模型在解决问题时,能够自行决定是否进行深度思考,有利于计算资源更加合理的分配,提升大模型的推理效率。


图 | 张盛佳(来源:张盛佳)

据介绍,受限于数据与算力的规模,预训练以 Transformer 为基础架构的大模型所带来的收益正在不断式微。那么,该如何进一步提升大模型的能力?近来,以 DeepSeek-R1、OpenAI o1 为代表的深度推理大模型突破了预训练 Scaling Law 的限制,通过增加测试时计算资源的投入,在多种复杂任务上取得了优异的效果。与非深度推理大模型相比,深度推理大模型通过模仿人类进行深度思考,能够更加准确地理解用户的需求,更加深入地分析用户提出的问题。

然而,目前的深度推理

上一页 下一页
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

售19.98万元起 方程豹钛7 EV闪充版上市

网易汽车 浏览 444

微软亚研院突破:强化学习赋予语言模型规划能力

科技行者 浏览 696

王楚钦:1-3落后时我都想着拎包回去了,确实到了极限

懂球帝 浏览 651

175款智慧康养机器人产品将亮相成都!记者提前探馆带你体验

红星新闻 浏览 687

细菌对抗生素的两种生存机制被揭示

财闻 浏览 579

好没素质!30岁日本女星放任女儿超市舔瓶子,碰到嘴巴还放回去

萌神木木 浏览 883

郑丽文赴美前表态:不当"麻烦制造者" 不会拖美国下水

海峡导报社 浏览 435

《寒战1994》票房大爆,四位演员被赞,演技才是真正的颜值滤镜

娱乐圈笔娱君 浏览 428

成都通报“50升油箱加67.96升汽油”事件调查结果

界面新闻 浏览 927

23分钟11中10轰21+8!王哲林打出赛季最强一战 上海八连胜稳头名

颜小白的篮球梦 浏览 723

辛巴退圈,直播行业的“震中时刻” 他退播了?

陈意小可爱 浏览 819

通勤路上,也有忒Panda的陪伴!

时尚COSMO 浏览 757

福建籍女网红流落柬埔寨街头 毒品检测呈阳性

中国新闻周刊 浏览 638

返利吸存罚30万违规揽储罚160万、行长也被警告,监管剑指花式揽储

湘财Plus 浏览 12916

中国最牛医美巨头,跌懵了

财经锐眼 浏览 2831

燃烧等离子体国际科学计划项目启动及研究计划发布

中安在线 浏览 673

苹果股价创历史新高

都市快报橙柿互动 浏览 728

岁月不败美人!贾静雯、杨谨华、林心如,她们的40岁比20岁更美

LinkFashion 浏览 730

南加大团队揭秘:让AI做数学题更聪明的"长度感知"训练法

科技行者 浏览 664

2025年,记住她们的名字!

时尚COSMO 浏览 547

文班亚马:我真的不在乎个人荣誉,若拿到DPOY说明我帮到球队了

懂球帝 浏览 706
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
闽ICP备16027347号-4