新闻资讯

现金万博manbext体育官网app平台模子评估与禁绝磋议)-万博manbext体育官网(中国)官方网站登录入口

         发布日期:2026-08-06 07:31    点击次数:135

IT之家 8 月 3 日讯息,据 Business Insider 报说念,东说念主工智能行业最具影响力的监督者之一贝丝 · 巴恩斯(Beth Barnes),如今正面对着诸多担忧。

这位前 OpenAI 磋议员曾通过磋议评释注解,AI 能力正以险些按月增长的速率快速素质。而如今,她惦念行业仍是短少敷裕的东说念主才,无法跟上 AI 参预下一阶段的发展速率。

巴恩斯于 2022 年离开 OpenAI,创办了非渔利组织 METR(Model Evaluation and Threat Research,模子评估与禁绝磋议)。她暗意,当今 AI 安全磋议面对的最大瓶颈不是资金,而是东说念主才。

METR 在 AI 行业中饰演着紧要扮装,与 OpenAI、Anthropic、Google 和 Meta 等公司保抓密切协作,安谧评估最新 AI 模子的能力,并磋议其可能带来的风险,为外界提供相对客不雅的分析收尾。

关联词,即便 METR 当今招聘岗亭开出的年薪最高可达 50.3 万好意思元(IT之家注:现汇率约合 340 万元东说念主民币),也依然难以处置东说念主才短缺的问题。

巴恩斯暗意:“理念念情况下,咱们但愿将团队扩大好多倍。履行上,咱们仍是大要召募到所需资金,果然竣事咱们发展的,是东说念主才储备。”

此前,OpenAI 与 Hugging Face 袒露的沿途 AI 安全事件,再次激发了业界关于奈何评估和限度 AI 能力的商榷。本年 7 月,跨越 1300 名前沿 AI 实验室职工联名发出公开信,告诫 AI 的发展速率可能仍是跨越东说念主类限度能力。淌若莫得敷裕的磋议东说念主员实时评估新模子的果然能力,AI 公司将来以致可能不得不放缓居品发布节律。

尽管 OpenAI 模子在该事件中的证据令许多企业感到战栗,但 METR 团队对此并莫得太不测。非论是政府机构、企业,以致宗教团体,齐曾向 METR 寻求匡助,但愿了解和测试 AI 的发展水平。

不外现金万博manbext体育官网app平台,在仅有 35 东说念主的 METR 团队里面,民稠密半仍充满担忧。

Business Insider 在 OpenAI 公布黑客事件本日拜访了 METR 位于好意思国加州伯克利的办公室。巴恩斯暗意,当今 AI 安全磋议规模最大的竣事,便是磋议东说念主员数目远远不及。

她说:“需要完成的责任确凿太多,而咱们的能力根底无法粉饰。”

在她看来,一个果然感性的社会,应该将 AI 投资中的更大比例用于 AI 经管、安全评估和风险磋议,尤其是在 AI 模子能力仍是发展到如今这个阶段。

被称为“东说念主类贪图队”的 METR,但愿扩大限度

跟着各大 AI 实验室不断推出新模子,METR 抓续评估这些模子完成越来越长、越来越复杂任务的能力。

METR 最着名的服从之一,是一张被平时援用的趋势图。该图表示,在往日六年里,AI 完成复杂任务的能力约莫每七个月就会翻一倍。

METR 总裁克里斯 · 佩因特(Chris Painter)将团队戏称为“东说念主类的贪图队(humanity's preparedness team)”,这一说法也借用了 OpenAI 和 Anthropic 里面负责向 CEO 文书安全风险的“贪图团队(Preparedness Team)”称号。

佩因特暗意:“咱们果然负责的对象不是某家公司,而是公众以及公众的福祉。”

巴恩斯强调,METR 保抓安谧性至关紧要,这么磋议服从才不会受到企业买卖假想影响。

她暗意,在 OpenAI 责任时间,她就意志到行业需要一家安谧于 AI 公司的磋议机构,大要解放评价 AI 的发展景况。

当今,METR 不会接管前沿 AI 企业偏激职工的资金资助,但会接管算力援救,并与这些公司协作,对尚未公设备布的新模子进行分析测试。

除了评估模子能力外,METR 还磋议过 AI 公司的安全顺序、AI 对软件工程师责任服从的影响,以及运用 AI 监督 AI 的可行性。

巴恩斯暗意,她将来还但愿进一步磋议奈何瞻望下一阶段 AI 能力的发展,以及这些变化将奈何进一步加快 AI 自己的发展。

METR 磋议员尼夫 · 帕里克(Neev Parikh)暗意,当今东说念主才短缺仍是竣事了团队大要磋议的问题数目,尤其是在 AI 里面推理机制方面。

他说:“这个规模确凿太缺东说念主了。淌若通盘这个词行业的东说念主才限度能扩大 10 倍,我会十分倨傲。”

OpenAI 安全事件,让 METR 的紧要性进一步素质

本年 7 月,OpenAI 袒露,其 AI 模子在测试历程中曾通过入侵 Hugging Face 系统得回测试谜底,从而“舞弊”。

随后,OpenAI 首席实行官萨姆 · 奥尔特曼(Sam Altman)暗意,这是我方第一次如斯直不雅地感受到 AI 带来的安全风险。

事实上,METR 此前仍是预念念了访佛问题。

本年 5 月,METR 曾发布敷陈指出,当今的 AI 智能体“十足有可能运转自主进行未经授权的部署”,不外其时它们还短少避讳自己四肢的能力。

随后在 6 月,METR 测试了刻下卫未公设备布的 GPT-5.6 Sol 模子,发现该模子会在复杂测试中反复舞弊,包括索取避讳源代码来寻找正确谜底。

METR 随后将磋议收尾整理成敷陈,并在 GPT-5.6 Sol 庄重发布前提交给 OpenAI。

到了 7 月,GPT-5.6 Sol 居然卷入了 OpenAI 与 Hugging Face 的安全事件。

OpenAI 随后晓示,将邀请 METR 以及另一家非渔利机构 Redwood Research 共同观测这次事件,两边的磋议收尾也将成为 OpenAI 官方本领敷陈的紧要参考。

佩因特暗意:“如今,这类问题仍是果然影响到企业运营,全社会齐有必要弄明晰到底发生了什么。”

OpenAI 和 Anthropic 最新 AI 模子展现出的汇集短处能力,也激发了好意思国社判辨常关切,并鼓吹华盛顿出现多项新的 AI 监管法案。

其中,一项正在商榷中的法案条目,大型 AI 模子设备企业必须接管第三方机构进行安全审计。

METR 将来就可能承担访佛扮装。

佩因特暗意,淌若将来提拔起明确的监管体系,也许会有更多 AI 企业职工喜跃加入 METR—— 固然薪资与企业左近,但莫得股票激励。

他说:“非论最终是行业造成长入模范,如故政府出台明确监管,我合计这个规模齐大要十分快速地扩大限度。”

负责撰写 METR 本年 5 月 AI 风险敷陈的磋议员阿杰娅 · 科特拉(Ajeya Cotra)暗意,当今 AI 监管仍然显得“紊乱且难以瞻望”。

不外,她依然保抓乐不雅。她暗意:“越来越多的东说念主运转疼爱这个问题,也越来越但愿将来大要以愈加严肃、愈加老练的方法对 AI 进行监管。”



 
友情链接:

Powered by 万博manbext体育官网(中国)官方网站登录入口 @2013-2022 RSS地图 HTML地图

Copyright Powered by站群 © 2013-2024