奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

562次阅读
没有评论

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

还秒删发布时间???

鱼羊 鹭羽 发自 凹非寺

量子位 | 公众号 QbitAI

GPT-5,终于亮出真容!

最新实测,由奥特曼本人带来,迅速引发大量围观。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

疯狂暗示了一周之后,虽说对话只是围绕电视剧推荐,但好歹是有官方实例了。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

当然奥特曼其人,放料的同时还是少不了新的谜语┓( ´∀` )┏:

即将进入SaaS快时尚时代。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

比起这种奥式基操,更令人兴奋的是,这次有眼疾手快的网友,截到了发布时间(秒删版)???

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

行吧,这一周的夜,熬起来吧伙计们。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

更多细节“泄露”ing

奥特曼持续的官方放料之外,关于GPT-5,零零星星的各路消息也正在被归纳总结出更多关键脉络。

比如,在主要竞争对手Claude一骑当先的编程领域,GPT-5被曝重写了编码规则。

首先,是将文本能力与推理层相结合,模型学会更合理地选择何时“努力”思考。

其次,GPT-5具备处理真实工程问题的能力,比如,重构“屎山”代码……

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

更值得关注的是,有知情人士透露,GPT-5还用上了Ilya领衔的超级对齐团队的“遗产”——

通用验证器(Universal Verifier)。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

这篇论文最早发表于2024年7月,也就是Ilya官宣离开OpenAI的2个月之后。

众所周知,作为Ilya为“控制超级智能”一手拉起来的团队,超级对齐团队在他和负责人Jan Leike离开后迅速被解散。

就在几天前,现任OpenAI首席研究官Mark Chen还解释了一嘴这件事。他认为,对齐研究已经融入OpenAI的核心业务,模型必须按照预期工作才能发挥作用,且当前应当更关注现有模型的对齐,而非假设性的超级智能

更直白一点翻译就是,Ilya这伙人跟现在的OpenAI,话不投机半句多。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

现在,这篇论文的6位作者中,只有Yining Chen和Nat McAleese还留在OpenAI。

使用超级对齐团队技术

八卦少叙,还是来看看“通用验证器”的具体作用。

消息称,OpenAI在开发GPT-5的过程中引入了通用验证器进行强化学习,能让模型在保持较高准确率的同时,输出更清晰的推理过程。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

从超级对齐团队发表的论文来看,他们提出了一种“证明者-验证者游戏的训练方法,简单来说就是先在模型内部划分证明者和验证者两种角色,再让彼此之间持续对抗:

  • “靠谱的证明者”负责给出正确的解题步骤,并让验证者认可。
  • “狡猾的证明者”故意给出错误步骤,并试图欺骗验证者。
  • 小型“验证者”负责准确区分正确与错误方案。

证明者和验证者模型都来自GPT-4系列,且需保证验证者规模小于证明者,以确保小型验证者在一定程度上可以对齐人类验证结果。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

为了量化不同角色的作用,分别设置证明者和验证者的效用函数。

证明者效用基于奖励函数,为“靠谱的证明者”施加与方案正确性和验证者打分正相关的奖励,而为“狡猾的证明者”提供与方案错误性和验证者打分正相关的奖励。

其中奖励函数需要满足两点要求,角色对齐的方案(如“靠谱的证明者”生成正确答案)获得的奖励将高于非对齐方案,且对齐方案中,验证者打分越高,奖励也随即增加。

验证者效用则采用交叉熵损失最小化判断误差。

然后进行多轮迭代训练,让证明者通过强化学习(PPO)优化,分别根据角色最大化奖励,验证者则学习如何更好地区分正确与错误解决方案。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

实验结果证明,在每轮训练中,“靠谱”和“狡猾”证明者都能让验证者打分单调提升,而“靠谱的证明者”的准确性整体处于上升趋势,“狡猾的证明者”生成错误答案的比例呈现先下降后上升的表现,最终能生成与正确答案说服力相当的错误方案。

在多轮对抗训练后,“靠谱的证明者”的正确率和“验证者”的抗干扰能力都将不断提高,且让模型生成更准确且易读的输出,但与此同时,模型也能生成出更具欺骗性的错误答案。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

基于该技术,GPT-5可以对每个答案进行评分,并只保留正确的答案循环训练,以推出可验证的易读性答案,后续即使人类无法完全理解模型的高级推理,也能通过可扩展的小型验证器构建起可检验性约束。

One More Thing

奥特曼疯狂抛媚眼,宣(chao)传(zuo)小连招一套接一套。

搞得网上也是真假料满天飞。

有抢跑实测视频的:

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”
奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

有“预测”基准的:

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”
奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”
奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

还有唱衰的。

The Information就爆料说,GPT-5研发遇到了比较大的困难,一方面,高质量训练数据供应不足;另一方面,大规模预训练收益下降,使得GPT-5的提升不会像GPT-3到GPT-4那样有明显的飞越。

另外,还存在模型性能转化的落差问题。比如o3,在内部测试时表现出非常强大的性能,但在实际面向用户部署之后,性能却出现了大幅下降。

就如网友所质疑的:像此前的所有模型一样,GPT-5可能发布1周之后就会变笨。

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

不管怎么说,GPT-5箭在弦上,OpenAI应该不能不发……了吧?

参考链接:
[1]https://x.com/sama/status/1952071832972186018
[2]https://arxiv.org/abs/2407.13692

版权所有,未经授权不得以任何形式转载及使用,违者必究。

Read More 

正文完
可以使用微信扫码关注公众号(ID:xzluomor)
post-qrcode
 0
评论(没有评论)

文心AIGC

2025 年 8 月
 123
45678910
11121314151617
18192021222324
25262728293031
文心AIGC
文心AIGC
人工智能ChatGPT,AIGC指利用人工智能技术来生成内容,其中包括文字、语音、代码、图像、视频、机器人动作等等。被认为是继PGC、UGC之后的新型内容创作方式。AIGC作为元宇宙的新方向,近几年迭代速度呈现指数级爆发,谷歌、Meta、百度等平台型巨头持续布局
文章搜索
热门文章
潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026

潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026

潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026 Jay 2025-12-22 09...
面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25

面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25

面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25 鹭羽 2025-12-13 22:37...
5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级 思邈 2025-12-10 14:28:37 来源:量子位 让更大规...
钉钉又发新版本!把 AI 搬进每一次对话和会议

钉钉又发新版本!把 AI 搬进每一次对话和会议

钉钉又发新版本!把 AI 搬进每一次对话和会议 梦晨 2025-12-11 15:33:51 来源:量子位 A...
商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1

商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1

商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1 十三 2025-12-15 14:13:14 ...
最新评论
ufabet ufabet มีเกมให้เลือกเล่นมากมาย: เกมเดิมพันหลากหลาย ครบทุกค่ายดัง
tornado crypto mixer tornado crypto mixer Discover the power of privacy with TornadoCash! Learn how this decentralized mixer ensures your transactions remain confidential.
ดูบอลสด ดูบอลสด Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.
ดูบอลสด ดูบอลสด Pretty! This has been a really wonderful post. Many thanks for providing these details.
ดูบอลสด ดูบอลสด Pretty! This has been a really wonderful post. Many thanks for providing these details.
ดูบอลสด ดูบอลสด Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.
Obrazy Sztuka Nowoczesna Obrazy Sztuka Nowoczesna Thank you for this wonderful contribution to the topic. Your ability to explain complex ideas simply is admirable.
ufabet ufabet Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.
ufabet ufabet You’re so awesome! I don’t believe I have read a single thing like that before. So great to find someone with some original thoughts on this topic. Really.. thank you for starting this up. This website is something that is needed on the internet, someone with a little originality!
ufabet ufabet Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.
热评文章
读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了

读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了

读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了 衡宇 2025-12-10 12:3...
5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级 思邈 2025-12-10 14:28:37 来源:量子位 让更大规...
戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案

戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案

戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案 十三 2025-12-10 1...
九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局

九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局

九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局 量子位的朋友们 2025-12-10 18:...
乐奇Rokid这一年,一路狂飙不回头

乐奇Rokid这一年,一路狂飙不回头

乐奇Rokid这一年,一路狂飙不回头 梦瑶 2025-12-10 20:41:15 来源:量子位 梦瑶 发自 ...