当前位置: 首页 > news >正文

大模型推理为什么又长又啰嗦?更多thinking≠更好结果,精准thinking可砍掉一半长度

前言

大模型推理为什么又长又啰嗦?

想象一下让学霸解题:明明第一步就得出答案,却非要反复验算十遍,还写满整张草稿纸——这就是当前大模型(如GPT-4、DeepSeek)的痛点!

论文:Optimizing Length Compression in Large Reasoning Models
链接:https://arxiv.org/pdf/2506.14755

论文发现:模型在简单题目上过度推理,生成大量无关步骤。比如解方程时,答案早出现了,后面全是"让我再检查一下…"的废话。

如图对比:普通模型像写小作文,LC-R1训练后像发微博

关键发现:模型在"无效思考"上浪费45%时间!

作者提出 **“无效思考”(Invalid Thinking)**概念:

定义:模型得出正确答案后继续的冗余验证步骤
量化指标 VT率:有效推理长度 ÷ 总推理长度

惊人数据:当前顶尖模型的平均VT率仅58-65%,意味着35-45%的计算资源在空转

好比打车去3公里外吃饭,司机绕路开了6公里

解决原则:"简短"和"够用"的平衡术

传统方法粗暴砍长度可能误伤关键步骤。本文提出两大原则:

  • Brevity(简短):只保留必要推理,答案一出立刻停笔
  • Sufficiency(够用):确保关键逻辑步骤不丢失

类比烹饪:

  • 普通厨师:煮面10分钟,再煮5分钟"确保熟透" →冗余
  • 智能厨师:煮面10分钟,筷子一夹就关火 →Brevity+Sufficiency

LC-R1方法:双奖励机制的训练魔法

核心方法:用强化学习给模型"植入条件反射"

  • 长度奖励:整体输出越短,奖励越大(防啰嗦)
  • 压缩奖励:精准识别"无效思考"并删除(防过度检查)

关键操作
当模型首次输出正确答案时,立刻给</think>标记发"红包"(奖励),训练它养成答完即停的习惯!

公式示意:
压缩奖励 = 1 - (有效长度 / 原始长度)
提前终止时罚分 -1(避免偷工减料)

效果验证:砍掉一半长度,精度只掉2%

在7大测试集(数学/编程/逻辑题)中,LC-R1碾压其他压缩方法:

  • 平均缩短50%长度:从1万token→5千token
  • 精度仅下降1.8-2.1%(其他方法降幅4-12%)
  • VT率飙升至97%(原模型仅58%)

如图:LC-R1稳居帕累托前沿最优位置

案例对比:同一道数学题

  • 原始模型:写1600字小作文(43%是废话)
  • LC-R1:500字搞定,逻辑完整

彩蛋:压缩后模型反而更"专注"?

  • 不影响探索能力:多次尝试解题的成功率不变
  • 通杀难易题目:从小学数学到奥赛题,压缩率稳定

“删掉的真是纯废话,留着的全是干货!”

结语

LC-R1的价值不仅是技术突破,更揭示了模型推理的本质规律
更多步骤≠更好结果,精准思考才是王道

最后

为什么要学AI大模型

当下,⼈⼯智能市场迎来了爆发期,并逐渐进⼊以⼈⼯通⽤智能(AGI)为主导的新时代。企业纷纷官宣“ AI+ ”战略,为新兴技术⼈才创造丰富的就业机会,⼈才缺⼝将达 400 万!

DeepSeek问世以来,生成式AI和大模型技术爆发式增长,让很多岗位重新成了炙手可热的新星,岗位薪资远超很多后端岗位,在程序员中稳居前列。

与此同时AI与各行各业深度融合,飞速发展,成为炙手可热的新风口,企业非常需要了解AI、懂AI、会用AI的员工,纷纷开出高薪招聘AI大模型相关岗位。

最近很多程序员朋友都已经学习或者准备学习 AI 大模型,后台也经常会有小伙伴咨询学习路线和学习资料,我特别拜托北京清华大学学士和美国加州理工学院博士学位的鲁为民老师给大家这里给大家准备了一份涵盖了AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频全系列的学习资料,这些学习资料不仅深入浅出,而且非常实用,让大家系统而高效地掌握AI大模型的各个知识点。

这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费

AI大模型系统学习路线

在面对AI大模型开发领域的复杂与深入,精准学习显得尤为重要。一份系统的技术路线图,不仅能够帮助开发者清晰地了解从入门到精通所需掌握的知识点,还能提供一条高效、有序的学习路径。

但知道是一回事,做又是另一回事,初学者最常遇到的问题主要是理论知识缺乏、资源和工具的限制、模型理解和调试的复杂性,在这基础上,找到高质量的学习资源,不浪费时间、不走弯路,又是重中之重。

AI大模型入门到实战的视频教程+项目包

看视频学习是一种高效、直观、灵活且富有吸引力的学习方式,可以更直观地展示过程,能有效提升学习兴趣和理解力,是现在获取知识的重要途径


光学理论是没用的,要学会跟着一起敲,要动手实操,才能将自己的所学运用到实际当中去,这时候可以搞点实战案例来学习。

海量AI大模型必读的经典书籍(PDF)

阅读AI大模型经典书籍可以帮助读者提高技术水平,开拓视野,掌握核心技术,提高解决问题的能力,同时也可以借鉴他人的经验。对于想要深入学习AI大模型开发的读者来说,阅读经典书籍是非常有必要的。

600+AI大模型报告(实时更新)

这套包含640份报告的合集,涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示。

AI大模型面试真题+答案解析

我们学习AI大模型必然是想找到高薪的工作,下面这些面试题都是总结当前最新、最热、最高频的面试题,并且每道题都有详细的答案,面试前刷完这套面试题资料,小小offer,不在话下

这份完整版的大模型 AI 学习资料已经上传CSDN,朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费

http://www.cnnetsun.cn/news/4248033.html

相关文章:

  • 收藏!小白也能学会!LangChain.js智能体开发指南:10大编排模式详解与实战应用
  • Jeff Dean押注AI4S:从分布式系统到科学发现的基础设施革命
  • IntelliJ IDEA快捷键
  • 【AI大模型】腾讯屠榜MTEB,嵌入模型告别BERT,拥抱LLM
  • 智能体Agent:怎样用自然语言重构数据开发?看完这一篇你就懂了!!
  • 水下鱼类实例分割实战:从COCO数据集到YOLOv8训练全流程
  • 【大模型必备】位置编码终极指南:收藏学习RoPE如何改变Transformer架构
  • 7B扩散LLM,居然能跟671B的DeepSeek V3掰手腕,扩散vs自回归,谁才是未来?
  • C指针进阶:Beej‘s Guide to C指针运算与数组本质完整指南
  • WinDiskWriter:macOS上3步做出Windows启动盘
  • UUIDv1秒变v6的位运算魔法:uuid-creator TimeOrderedCodec源码剖析
  • 极简语言编年史:milliForth、sectorForth 与 sectorLISP 深度对比
  • 大模型应用开发全流程:从初始构思到实验、效果评估和产品化!
  • C语言内存管理
  • 多传感器模块设计指南:从选型到固件的可穿戴实践
  • 什么是Transformer?什么是视觉Transformer?与CNN的比较谁更胜一筹?
  • 【AI大模型】一文讲透 AI Agent 与 AI Workflow 的区别和深度解析:从自动化到智能化的演进
  • 2026北京GEO优化服务商推荐:企业出海如何同步布局AI搜索品牌资产
  • AI Agent工具调用安全加固:Pyshackle预执行门控实战
  • YOLO手语识别实战:开箱即用数据集与模型训练全流程
  • Qwen 2.5 Max与DeepSeek R1测试对比,看到就是赚到!!
  • 基于LoRA的Qwen-VL视觉语言模型指令微调实战指南
  • 商业园林机器人:智能运维才是核心,而非割草本身
  • AgentX与InferenceX:智能体推理基准如何评估多步推理与工具调用
  • 最新盘点:五大厂开源GitHub项目,开发者不容错过的技术宝藏!
  • RAG技术完全指南:从零开始构建大模型知识库问答系统!大模型应用开发实战
  • 2024 人工智能最前沿:分享几个大模型(LLMs)的热门研究方向
  • i.MX6ULZ无头嵌入式计算方案:DART模块开发实践
  • 2026年UI/UX设计界震撼!AI工具崛起,传统设计岗位需求锐减30%,AI体验设计师薪资却飙升50%!
  • GPT-4+GraphRAG:知识图谱如何让RAG系统更智能?