关闭广告

研究人员提出OThink-R1,让大模型自行决定是否需要深度思考

DeepTech深科技591人阅读

近日,浙江大学硕士生张盛佳和所在团队发现:深度推理模型的部分推理过程是不必要的。一方面,目前的深度推理模型在面对一些例如“1+1=?”的简单问题时,也需要大费周章地进行深度思考。而人类在面对诸如此类的简单问题时,往往能够凭直觉给出答案;另一方面,在一些简单任务上(例如,常识问答和小学生数学题),即使不具有深度推理能力的大模型也能取得较好的效果。本次研究基于所观察到的现象提出了一种解决方案,使得深度推理大模型在解决问题时,能够自行决定是否进行深度思考,有利于计算资源更加合理的分配,提升大模型的推理效率。


图 | 张盛佳(来源:张盛佳)

据介绍,受限于数据与算力的规模,预训练以 Transformer 为基础架构的大模型所带来的收益正在不断式微。那么,该如何进一步提升大模型的能力?近来,以 DeepSeek-R1、OpenAI o1 为代表的深度推理大模型突破了预训练 Scaling Law 的限制,通过增加测试时计算资源的投入,在多种复杂任务上取得了优异的效果。与非深度推理大模型相比,深度推理大模型通过模仿人类进行深度思考,能够更加准确地理解用户的需求,更加深入地分析用户提出的问题。

然而,目前的深度推理

上一页 下一页
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

杭州,居然是一个巨大的真人寻宝游戏!

时尚COSMO 浏览 577

皱着眉头在看《诉讼女王》......

时尚COSMO 浏览 390

DO:热刺若降级,绝大多数球员薪资将被削减约50%

懂球帝 浏览 278

女生因"不当行为"被实名公告拟开除 校方涉嫌侵犯隐私

封面新闻 浏览 824

轰24+8遭逆转:哈登27000分吞里程悲 末节连丢关键三分结束三连胜

颜小白的篮球梦 浏览 837

俄军出动“榛树”导弹袭击乌克兰

上观新闻 浏览 167

丰田新款Land Cruiser FJ最新消息曝光

乐选爱车 浏览 469

女人“会穿衣”才更美,看看这些穿搭就知道,穿对了真显气质

静儿时尚达人 浏览 325

安理会爆发激烈争吵,中方罕见寸步不让

浏览 841

古巴称特朗普发出“明确且直接的军事侵略威胁”

上观新闻 浏览 194

从50天4场到21天0场!34岁张水华被处分后静悄悄 为工作牺牲爱好

风过乡 浏览 355

反诈老陈终究是输了,直播间刚开播就被封

胖松松与瘦二毛 浏览 583

媒体:民进党为突破僵局推动"绿白合" 柯文哲不能犯浑

海峡导报社 浏览 388

香港政务司司长:涉案人员处心积虑犯罪 害死这么多人

南方都市报 浏览 448

弗兰克:球队的进攻还需要提升;希望在所有赛事都具有竞争力

懂球帝 浏览 461

伊姐周六热推:《长安二十四计》;电视剧《唐诡奇谭》......

伊周潮流 浏览 396

坐劳斯莱斯里,偶遇粤B88888,网友:有比这更狠的宾利吗?

总李谈车 浏览 456

韩国时尚杂志《W,Korea》为活动道歉

悠悠说世界 浏览 473

意大利总理反对向乌克兰派遣军队:俄罗斯有130万士兵

上观新闻 浏览 722

郭芙蓉自由了,我却还留在同福客栈

时尚COSMO 浏览 384

袁悦苦战182分钟惨胜后遭调侃打球兼项马拉松,吴易昺疑似又伤了

网球之家 浏览 389
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
闽ICP备16027347号-4