OpenAI成立AI安全“特种部队”:前沿风险和准备

1,140次阅读
没有评论

OpenAI与其他领先的 AI 实验室一道,做出了一系列自愿承诺,以促进 AI 的安全、保障和信任。这些承诺涵盖了多个风险领域,其中心内容包括是 UK AI Safety Summit关注的前沿风险。

OpenAI成立AI安全“特种部队”:前沿风险和准备

1)OpenAI 的准备方针 

他们相信,前沿 AI 模型将超越现有最先进模型的能力,有潜力造福全人类。但它们也带来了日益严重的风险。要管理来自前沿 AI 的灾难性风险,就需要回答如下问题:

当前和未来,将前沿 AI 系统用于不当目的有多危险? 我们如何构建一个健壮的框架,以监控、评估、预测和防范前沿 AI 系统的危险能力? 如果他们的前沿AI 模型权重被盗,恶意行为者可能如何利用它们?

我们需要确保我们拥有高性能人工智能系统安全所需的理解和基础设施,以保障高能力 AI 系统的安全。

2)OpenAI 成立安全“特种部队”

为了在 AI 模型不断进步的同时降低这些风险,他们正在组建一个名为“准备”的新团队。在 Aleksander Madry 的领导下,“准备”团队将紧密连接前沿模型的能力评估、评价和内部红队测试,从他们在不久的将来开发的模型,到具有 AGI 级别能力的模型。该团队将协助跟踪、评估、预测和防范多个类别的灾难性风险,包括:

“准备”团队的使命还包括制定和维护风险通知开发政策(RDP)。他们的 RDP 将详细介绍如何进行严格的前沿模型能力评估和监控,创建保护行动的范围,以及在开发过程中建立责任和监督的治理结构。RDP 旨在补充和扩展他们现有的风险缓解工作,以促进新的、高能力系统在部署前后的安全与对齐。

3)准备挑战 

为了识别不太明显的安全关注领域(并组建团队!),他们还将推出针对灾难性滥用预防的 AI 准备挑战。他们将为最多 10 个顶级提交提供 25,000 美元的 API 积分,发布新颖的想法和参赛作品,并在本次挑战的顶尖竞争者中寻找AI安全特种部队“准备”的候选人。

 

Read More 

正文完
可以使用微信扫码关注公众号(ID:xzluomor)
post-qrcode
 0
评论(没有评论)

文心AIGC

2023 年 10 月
 1
2345678
9101112131415
16171819202122
23242526272829
3031  
文心AIGC
文心AIGC
人工智能ChatGPT,AIGC指利用人工智能技术来生成内容,其中包括文字、语音、代码、图像、视频、机器人动作等等。被认为是继PGC、UGC之后的新型内容创作方式。AIGC作为元宇宙的新方向,近几年迭代速度呈现指数级爆发,谷歌、Meta、百度等平台型巨头持续布局
文章搜索
热门文章
潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026

潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026

潞晨尤洋:日常办公没必要上私有模型,这三类企业才需要 | MEET2026 Jay 2025-12-22 09...
面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25

面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25

面向「空天具身智能」,北航团队提出星座规划新基准丨NeurIPS’25 鹭羽 2025-12-13 22:37...
5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级 思邈 2025-12-10 14:28:37 来源:量子位 让更大规...
钉钉又发新版本!把 AI 搬进每一次对话和会议

钉钉又发新版本!把 AI 搬进每一次对话和会议

钉钉又发新版本!把 AI 搬进每一次对话和会议 梦晨 2025-12-11 15:33:51 来源:量子位 A...
商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1

商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1

商汤Seko2.0重磅发布,合作短剧登顶抖音AI短剧榜No.1 十三 2025-12-15 14:13:14 ...
最新评论
ufabet ufabet มีเกมให้เลือกเล่นมากมาย: เกมเดิมพันหลากหลาย ครบทุกค่ายดัง
tornado crypto mixer tornado crypto mixer Discover the power of privacy with TornadoCash! Learn how this decentralized mixer ensures your transactions remain confidential.
ดูบอลสด ดูบอลสด Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.
ดูบอลสด ดูบอลสด Pretty! This has been a really wonderful post. Many thanks for providing these details.
ดูบอลสด ดูบอลสด Pretty! This has been a really wonderful post. Many thanks for providing these details.
ดูบอลสด ดูบอลสด Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.
Obrazy Sztuka Nowoczesna Obrazy Sztuka Nowoczesna Thank you for this wonderful contribution to the topic. Your ability to explain complex ideas simply is admirable.
ufabet ufabet Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.
ufabet ufabet You’re so awesome! I don’t believe I have read a single thing like that before. So great to find someone with some original thoughts on this topic. Really.. thank you for starting this up. This website is something that is needed on the internet, someone with a little originality!
ufabet ufabet Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.
热评文章
读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了

读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了

读懂2025中国AI走向!公司×产品×人物×方案,最值得关注的都在这里了 衡宇 2025-12-10 12:3...
5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级

5天连更5次,可灵AI年末“狂飙式”升级 思邈 2025-12-10 14:28:37 来源:量子位 让更大规...
戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案

戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案

戴尔 x OpenCSG,推出⾯向智能初创企业的⼀体化 IT 基础架构解决方案 十三 2025-12-10 1...
九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局

九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局

九章云极独揽量子位三项大奖:以“一度算力”重构AI基础设施云格局 量子位的朋友们 2025-12-10 18:...
乐奇Rokid这一年,一路狂飙不回头

乐奇Rokid这一年,一路狂飙不回头

乐奇Rokid这一年,一路狂飙不回头 梦瑶 2025-12-10 20:41:15 来源:量子位 梦瑶 发自 ...