发布时间:2024-11-19
点击次数: ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

AIxiv专栏是本站发布学术、技术内容的栏目。过去数年,本站AIxiv专栏接收报道了2000多篇内容,覆盖全球各大高校与企业的顶级实验室,有效促进了学术交流与传播。如果您有优秀的工作想要分享,欢迎投稿或者联系报道。投稿邮箱:liyazhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com
自我纠错(Self Correction)能力,传统上被视为人类特有的特征,正越来越多地在人工智能领域,尤其是大型语言模型(LLMs)中得到广泛应用,最近爆火的OpenAI o1模型[1]和Reflection 70B模型[2]都采取了自我纠正的方法。
传统的大语言模型,因为在输出答案的时候是逐个Token输出,当输出长度较长时,中间某些Token出错是必然发生。但即使LLM后来知道前面输出的Token错了,它也得用更多错误来“圆谎”,因为没有机制让它去修正前面的错误。
而OpenAI o1在“慢思考”也就是生成Hidden COT的过程中,通过分析OpenAI官网给出的Hidden COT例子可以发现,在解决字谜问题的思考过程中,o1首先发现了每两个连续的明文字母会映射到一个秘文字母,于是便尝试使用奇数字母来构建明文,但是经过验证发现并不合理(Not directly);接着又重新修正答案最终成功解出字谜。

图1 OpenAI o1 官网示例(部分Hidden CoT)
Reflection 70B的关键技术也包括错误识别和错误纠正。他们用到了一种名为 Reflection-Tuning(反思微调) 的技术,使得模型能够在最终确定回复之前,先检测自身推理的错误并纠正。在实际的执行过程中,这会用到一种名为思考标签(thinking tag)的机制。模型会在这个标签内部进行反思,直到它得到正确答案或认为自己得到了正确答案。
Remover
几秒钟去除图中不需要的元素
304
查看详情
频频应用于大语言模型的自我纠错技术为何有效?为什么纠错过程可以让模型把原本答错的问题重新答对?
为了探究这一问题,北大王奕森团队与MIT合作,从理论上分析了大语言模型自我纠错能力背后的工作机理。

论文题目:A Theoretical Understanding of Self-Correction through In-context Alignment
作者团队将自我纠错的过程抽象为对齐任务,从上下文学习(In-context learning)的角度对自我纠错进行了理论分析。值得一提的是,他们并没有使用线性注意力机制下的线性回归任务进行理论分析,而是使用真实世界LLM在用的softmax多头注意力机制的transformer结构,并利用Bradley-Terry 模型和 Plackett-Luce 模型(LLM对齐的实际选择,用于RLHF和DPO)设计对齐任务进行研究。受理论启发,他们提出了一种简单的自我纠错策略--上下文检查(Check as Context),并通过实验,在消除大语言模型中存在的潜在偏见以及防御越狱攻击中效果显著。
理论分析:自我纠错实际上是一种上下文对齐?











以上就是NeurIPS 2025 | 自我纠错如何使OpenAI o1推理能力大大加强?北大、MIT团队给出理论解释的详细内容,更多请关注其它相关文章!
# 更高
# 兰州seo怎么入职
# 宁波整站营销推广推荐
# 海口seo顾问
# 黄埔优化网站
# 气态seo3带电吗
# 柳州网络营销推广对接平台
# 网站建设找实体还是淘宝
# 巩义网站seo地址
# 西安网站整合营销推广
# 安徽搜狗关键词排名
# 的是
# 官网
# 理论上
# 很重要
# 工程
# 前向
# 最优
# 过程中
# 编辑器
# 北大
# type
# fig
# llama
# 为什么
# 邮箱
# ai
# git
# 自我纠错
相关栏目:
【
行业新闻62819 】
【
科技资讯67470 】
相关推荐:
深圳人工智能企业超1900家
如何用AI重塑你的工作流(一)
Goodnotes 6推出,带来多项全新AI功能,让电子笔记更智能
世界人工智能大会中西部县域数字就业中心组团亮相
陈根教授:离人形机器人时代还有10年吗?
站在社会的高度理解人工智能
AI在教育中的角色:AI如何改变我们的学习方式
麦肯锡:到 2045 年左右,将有 50% 工作被 AI 接管
李开复:未来几年,人工智能会革了所有人的命,除非你这么做
工业机器人及非标自动化设备集成服务提供商
图灵奖得主Hinton:我已经老了,如何控制比人类更聪明的AI交给你们了
揭示经济学论文写作中提高效率与质量的AI助手应用策略
对Hugging Face开源模型精准投毒!LLM切脑后变身PoisonGPT,用虚假事实洗脑60亿人
借力AI!PCB全球巨头,有爆发潜质吗?
引领AI变革,九章云极DataCanvas公司重磅发布AIFS+DataPilot
OpenAI宣布组建新团队 以控制“超级智能”人工智能
Vision Pro头显重磅发布;苹果收购AR厂商Mira
科技赋能司法执行 阿里资产免费为全国法院升级VR新服务
人工智能“Aria”现身 Opera浏览器100版本更新:新功能“标签岛”
OpenAI 引入个性化指令功能,消除对话中的重复偏好与信息
2025世界人工智能大会成功召开
周鸿祎:用超级AI实现室温超导和核聚变,实现能源自由
AI生成新闻网站数量激增,正在疯狂赚取广告收入
IBM和NASA合作发布可追踪碳排放的开源AI基础模型
SnapFusion技术大幅提升AI图像生成速度
生成式人工智能来了,如何保护未成年人? | 社会科学报
视觉中国推出AI灵感绘图功能,付费后可在“合法合规前提下使用”
MiracleVision视觉大模型
特斯拉机器人面世 未来将大幅提振磁材需求,引领人工智能时代
研究预测HPC支持的人工智能增长迅速
“踩油门,也要会踩刹车” 互联网企业高管谈人工智能发展
搭载星火认知大模型 讯飞听见智慧屏开启AI办公新体验
如何利用AI工具写好本科论文:科技助你一臂之力
微软必应聊天现已在Chrome和Safari浏览器上可用,但仍有许多限制存在
清华系面壁智能开源中文多模态大模型VisCPM :支持对话文图双向生成,吟诗作画能力惊艳
学界业界大咖探讨:AI对数字艺术创新的推动力
利用AI探索抗体“钥匙”、加速药物研发——访百图生科团队
如布科技发布新产品AI口袋学习机S12
微软推出 LLaVA-Med AI 模型,可对医学病理案例进行分析
大疆 DJI Mini 4 Pro 无人机曝光:流线设计,有望迎来功能性提升
套娃不可取:研究人员证实用AI生成的结果训练AI将导致模型退化
Intel酷睿Ultra发布会官宣!迈向全新的AI时代
特斯拉 Optimus 人形机器人入驻北美门店,帮助提升汽车销量
BLIP-2、InstructBLIP稳居前三!十二大模型,十六份榜单,全面测评「多模态大语言模型」
DeepMind用AI重写排序算法;将33B大模型塞进单个消费级GPU
【机智云物联网低功耗转接板】远程环境数据采集探索
第二届光合组织AI解决方案大赛赛果揭晓
消息称字节机器人团队已有约50人,计划年底扩充到上百人
出门问问亮相2025世界人工智能大会,展示AI CoPilot解决方案
云鲸发布全新的扫拖机器人J4系列