关闭广告

研究人员提出OThink-R1,让大模型自行决定是否需要深度思考

DeepTech深科技778人阅读

近日,浙江大学硕士生张盛佳和所在团队发现:深度推理模型的部分推理过程是不必要的。一方面,目前的深度推理模型在面对一些例如“1+1=?”的简单问题时,也需要大费周章地进行深度思考。而人类在面对诸如此类的简单问题时,往往能够凭直觉给出答案;另一方面,在一些简单任务上(例如,常识问答和小学生数学题),即使不具有深度推理能力的大模型也能取得较好的效果。本次研究基于所观察到的现象提出了一种解决方案,使得深度推理大模型在解决问题时,能够自行决定是否进行深度思考,有利于计算资源更加合理的分配,提升大模型的推理效率。


图 | 张盛佳(来源:张盛佳)

据介绍,受限于数据与算力的规模,预训练以 Transformer 为基础架构的大模型所带来的收益正在不断式微。那么,该如何进一步提升大模型的能力?近来,以 DeepSeek-R1、OpenAI o1 为代表的深度推理大模型突破了预训练 Scaling Law 的限制,通过增加测试时计算资源的投入,在多种复杂任务上取得了优异的效果。与非深度推理大模型相比,深度推理大模型通过模仿人类进行深度思考,能够更加准确地理解用户的需求,更加深入地分析用户提出的问题。

然而,目前的深度推理

上一页 下一页
版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

世体:拉波尔塔率队访问布鲁日,参加接待仪式并漫步市中心

懂球帝 浏览 684

美军曾复刻马杜罗住宅进行破门演练 动手第一步是断电

红星新闻 浏览 654

ELLE盛典红毯状况百出,有人摔倒、有人背手像逛大街,秒变菜市场

萌神木木 浏览 701

登场2分钟轰世界波!25岁国安边缘人险落泪 亚冠曾35秒闪击创纪录

我爱英超 浏览 805

在韩遇难女留学生家属:克服万难也要将凶手引渡回国

扬子晚报 浏览 34

中国农村,挤满了花钱干农活的外国佬

她刊 浏览 23

继续引援脚步,记者:北京首钢目前正在接触前NBA球员麦基

懂球帝 浏览 560

西媒:索莱尔将在关窗前离开巴黎,马竞和皇社对其感兴趣

懂球帝 浏览 797

向太儿子向佑近照流出 威胁父母“不给钱我就去借”

鲁中晨报 浏览 685

“这条裙子”今年春天又火了!配这4双鞋减龄又好看

LinkFashion 浏览 539

躲在流量后面的人,被监管点名了

钛媒体APP 浏览 554

定位大型旗舰SUV 零跑D19预告图发布

车质网 浏览 739

巨星李连杰病倒,网友抓抛妻弃女不放

包饺子ai剪辑 浏览 903

全智贤风波升级,雪花秘扇时期表现被审判,此前曾多次翻车

扒虾侃娱 浏览 761

市场监管总局发文禁止亏本卖车!比亚迪北汽响应

明镜pro 浏览 548

独行侠内线再多也不够?浓眉小腿拉伤至少缺阵两场

体坛周报 浏览 658

申万宏源:2025年科技牛只是小菜,2026年下半年将迎来全面牛

金石随笔 浏览 7660

撕开铁幕裂缝:国产手术机器人的千亿逆袭

钛媒体APP 浏览 707

今晚空降!傅东育又一力作来袭

娱乐圈笔娱君 浏览 567

全新岚图知音预售22万元起 配齐华为全家桶

网易汽车 浏览 757

美国同意提供安全保障 美乌“和平计划”将提交俄方

环球网资讯 浏览 580
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除
闽ICP备16027347号-4