关闭广告

研究人员提出OThink-R1,让大模型自行决定是否需要深度思考

DeepTech深科技773人阅读

近日,浙江大学硕士生张盛佳和所在团队发现:深度推理模型的部分推理过程是不必要的。一方面,目前的深度推理模型在面对一些例如“1+1=?”的简单问题时,也需要大费周章地进行深度思考。而人类在面对诸如此类的简单问题时,往往能够凭直觉给出答案;另一方面,在一些简单任务上(例如,常识问答和小学生数学题),即使不具有深度推理能力的大模型也能取得较好的效果。本次研究基于所观察到的现象提出了一种解决方案,使得深度推理大模型在解决问题时,能够自行决定是否进行深度思考,有利于计算资源更加合理的分配,提升大模型的推理效率。


图 | 张盛佳(来源:张盛佳)

据介绍,受限于数据与算力的规模,预训练以 Transformer 为基础架构的大模型所带来的收益正在不断式微。那么,该如何进一步提升大模型的能力?近来,以 DeepSeek-R1、OpenAI o1 为代表的深度推理大模型突破了预训练 Scaling Law 的限制,通过增加测试时计算资源的投入,在多种复杂任务上取得了优异的效果。与非深度推理大模型相比,深度推理大模型通过模仿人类进行深度思考,能够更加准确地理解用户的需求,更加深入地分析用户提出的问题。

然而,目前的深度推理

上一页 下一页
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

E句话| 她也遇到过阴阳剧本?

仙女事件簿 浏览 627

弗里克:来巴萨后我变了,我也不希望孙子看到爷爷是这样的

懂球帝 浏览 635

周受资,晋升一位90后女将

华尔街见闻官方 浏览 672

官方:陕西联合签下前国安U21门将李宸、前江西庐山门将陈俊旭

懂球帝 浏览 1031

马景涛女友称不在乎26岁年龄差,“硬刚”前任?

文娱没有圈 浏览 851

调研 | 从陪伴“小巨人”企业A+H股上市,看宁波银行服务硬科技范式转变

券商中国 浏览 2992

鸿蒙智行鹭岛首家尚界专网用户中心开业

Report汽车 浏览 612

金球奖红毯:小李子越老越有味

娱乐圈笔娱君 浏览 541

秋季穿衣别太复杂,提前准备好这几件单品,百搭经典又不挑人

静儿时尚达人 浏览 664

三星首发2nm移动芯片:为拔头筹,不惜“开倒车”

雷科技 浏览 580

大S墓碑没自己名字,且一个中文都没有,具俊晔立深情人设引热议

扒虾侃娱 浏览 510

算法工程师想在女友面前秀技术“养龙虾”,结果文件夹被全删 周鸿祎称“龙虾”更像个实习生

红星新闻 浏览 505

购置税从“免征”到“减半”,新能源车企将迎来一场考验!

百姓评车 浏览 723

燃油A级SUV再进化 瑞虎7双车上市 限时6.99万起

网易汽车 浏览 415

18岁少年鳌太线失联超10天 搜救队再次进山展开搜救

红星新闻 浏览 666

“打童工”还是先“练内功”:具身机器人被商业化裹挟了吗?

南方都市报 浏览 297

中法两国元首举行会谈 马克龙提出"力争每年访华一次"

环球网资讯 浏览 602

科技巨头AI竞赛转向表外融资,万亿债务定时炸弹成危机前兆?

华尔街见闻官方 浏览 2701

马杜罗怒斥美“南方之矛”行动:国际法终将被维护

国际在线 浏览 601

王鸥独立养娃,女明星为何纷纷跳过婚姻当妈?

仙女事件簿 浏览 17

东西卖出去钱却没进账 几个月后店长发现银行卡有问题

1818黄金眼 浏览 570
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
闽ICP备16027347号-4