1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「专家在公开信中指出,Anthropic和OpenAI需要真正独立的安全评估人员」共 38 条 · 第 1 页
美国消费者新闻与商业频道

专家在公开信中指出,Anthropic和OpenAI需要真正独立的安全评估人员

100多名人工智能专家和评估人员正联合起来发出警告:他们将没有必要的资源和保护措施来测试人工智能技术的安全性。由于业内人士对前沿模型潜在危险的担忧,这项技术正面临越来越严格的审查。 组织此次公开信的AI评估员论坛(AI Evaluator Forum)联盟主席康拉德·斯托斯(Conrad Stosz)在一次采访中表示:“我们只是试图真正展示对基本原则的共识,并确保独立监督能够成为广泛管理人工智能风

09/18
cnbeta

OpenAI将让第三方机构更早介入AI模型安全评估

OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专

09/23
cnbeta

Anthropic、OpenAI、谷歌秘密磋商筹建AI安全标准机构

据知情人士透露,早在 Anthropic 首席执行官达里奥・阿莫代伊上周六呼吁 AI 企业协同开展技术测试与审计之前,Anthropic、OpenAI 与谷歌就已经展开磋商,计划携手成立一家 AI 行业标准机构。 知情人士称,OpenAI 首席执行官山姆・奥特曼本周早些时候在公司全员员工大会上表示,他支持设立 AI 行业测试与审计机构,但他认为,主要 AI 实验室必须在美国政府不提供支持的前提下,

09/14
cnbeta

Anthropic首席执行官呼吁放缓前沿AI开发 拟建立三层安全机制

Anthropic首席执行官达里奥·阿莫代伊呼吁控制前沿人工智能模型能力提升的速度,为安全评估和防护措施争取时间。他提出引入常驻独立评估人员、协调主要开发商的安全标准,并推动跨国风险管控合作。 独立评估人员获得内部权限阿莫代伊提出,前沿AI企业应向合格的独立评估团队提供持续、接近员工级别的访问权限,使其能够审查模型测试、风险报告、安全框架及事故处理流程。 Anthropic承诺率先实施该措施。外部

09/14
cnbeta

OpenAI、Anthropic呼吁建立全球AI安全标准 美国政府拒绝新增全球治理框架

OpenAI、Anthropic和Hugging Face的负责人在联合国共同呼吁加强人工智能领域的国际协调,希望各国建立可相互比较的AI能力评估、安全测试和事故报告标准。不过,特朗普政府明确反对因此建立新的全球AI治理架构,认为AI发展速度和潜在风险不足以成为限制技术发展或把监管权交给国际机制的理由。 这场分歧显示,随着前沿AI能力快速提升,美国领先AI企业与特朗普政府在安全风险本身上并非完全对

09/24
美国消费者新闻与商业频道

Anthropic,OpenAI提出的AI风险评估器可能没有足够的力量来防止灾难

人工智能领域最重要的新职位可能配有办公室工牌、公司笔记本电脑,并能接触Anthropic、OpenAI等AI领军企业大语言模型中最受严密保护的一些系统。但这个职位可能并不附带阻止它们的能力。 Anthropic首席执行官达里奥·阿莫代伊提议在前沿AI公司内部常设第三方安全评估人员,作为减缓能力日益强大的模型推进速度计划的一部分。此前,Anthropic前研究员雅各布·考克森辞职并警告称,前沿实验室

09/16
星洲日报

坐看云起| 当人工智能不再征求许可时

塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除

09/21
罗塞塔简报

OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型

泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训

09/15
信报财经

AI丨美国三大科企据报研究成立AI安全标准机构

人工智能安全等问题引起市场关注,The Information报道,美国三大科技企业Anthropic、OpenAI和谷歌正讨论合作成立一个AI安全标准机构。 随着市场对AI模型网络攻击及可控性问题担忧日益加剧,多间AI科技企业已表示关注安全问题,并拟放慢AI发展步伐。报道指,三大机构早于7月时已开会研究有关成立独立机构的事宜,旨在为AI技术测试和审核创建一个协作框架。 Anthropic行政总裁

09/14
罗塞塔简报

OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升

在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实

09/19
thenextweb

OpenAI将允许外部团体在训练期间测试其模型

据彭博社报道,在周二发布的一篇博客文章之前,OpenAI宣布将允许第三方机构在模型训练和评估期间(而不仅仅是模型发布之前)进行技术安全评估。OpenAI目前正在与包括METR和Redwood Research在内的多个机构进行谈判。 十天前,OpenAI的承诺更为具体:Sam Altman曾在9月12日表示,会为独立评估人员提供办公空间、工作证和笔记本电脑,并允许他们公开自己的评估结果。不过在最新

09/23
semafor

Anthropic规避英国安全审查,AI透明度担忧加剧

Anthropic拒绝将其最新模型提交给英国一家顶级AI安全机构进行测试,这引发了英国的担忧,即前沿AI的审查将完全由华盛顿掌控。 人们也越来越担心特朗普政府AI安全框架缺乏透明度,该政府拒绝公开这一框架。 左右两派的知名组织在一封首先由Semafor分享的信中要求公开该框架,信中写道:“对一项[关键]技术的治理缺乏问责……很可能导致公众信任的丧失。” Anthropic周三表示,它将向一个对Op

09/10
政治报

两党众议院二人组欢迎业界支持其人工智能安全提案

共和党籍的两党人工智能安全立法共同提案人表示,他与OpenAI的最高游说者进行了会面,次日该公司便表态支持该法案中的一项关键条款,而这项法案在国会山一直难以取得进展。“我们讨论了采取行动的迫切需要,”加利福尼亚州众议员杰伊·奥伯诺尔特在谈及周一与OpenAI首席全球事务官克里斯·莱汉的会面时对记者表示。“他实际上是在问自己怎样才能帮上忙。所以,我们正在努力规划一条前进的道路。”奥伯诺尔特接着说,“

09/15
cnbeta

白宫科技顾问抨击美AI巨头:你们自己得保证产品安全 别老想着靠政府

Anthropic和OpenAI等顶尖AI公司应该自己确保产品安全,并在必要时自行放缓发展速度,而不是需要政府介入。 萨克斯表示,他赞同美国联邦贸易委员会前主席莉娜·可汗(Lina Khan)的观点。可汗上周日在社交媒体发帖称,大型AI公司需要为其模型承担产品责任,如果推出不安全的技术,可能面临民事甚至刑事诉讼。 这位白宫科技顾问还抨击了Anthropic CEO达里奥·阿莫代伊(Dario Am

09/15
财新

Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对

【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件

09/14
凤凰网科技

Anthropic和埃森哲豪掷20亿美元搞AI安全评估

IT之家 9 月 20 日消息,人工智能实验室 Anthropic 于当地时间周五宣布,将与埃森哲开展合作,针对自身前沿人工智能模型开展独立评估;两家企业承诺,未来五年各自至少投入 10 现汇率约合 67.18 亿元人民币),搭建开展该项工作所需的配套能力。 在这项合作落地之际,AI 研发企业正承受来自监管机构、其他企业以及研究人员越来越大的压力,各方都要求企业保证高级模型具备安全性与可靠性。 近

09/20
美国消费者新闻与商业频道

OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道

在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude

09/25
thenextweb

特朗普前人工智能事务主管告诉Anthropic和OpenAI放慢脚步,并停止索取任何回报

David Sacks告诉Anthropic和OpenAI,尽管去把控前沿节奏,但不要再寻求反垄断豁免或审批制度,理由是产品责任和市场压力已经在约束它们。欧洲在2025年2月就责任问题得出了相同结论,并从12月9日起将独立软件视为严格责任下的产品。 据ANI报道,David Sacks告诉Anthropic和OpenAI,尽管放慢脚步,不要再要求任何回报。他担任总统科技顾问委员会主席,并在3月之前

09/13
cnbeta

Anthropic研究员Jacob Coxon因不满AI军备竞赛而辞职

Jacob Coxon在X上宣布辞去Anthropic职务。他表示自己过去三年分别在OpenAI和Anthropic从事预训练研究,但认为两家公司都没有以负责任的方式推进AI开发,反而在“直奔自我改进型超级智能”,并将人类安全置于赌局之中。 Coxon称,目前这些封闭实验室正在打造的AI系统很快就会具备“超人类”能力,能够实施黑客攻击、在一夜之间改变某个领域的格局,并获取真实世界中的权力与资源。他

09/09
星洲日报

OpenAI首席执行员下周赴安理会作简报

阿尔特曼下周将到联合国安理会进行简报。(图:路透社) (华盛顿19日法新电)OpenAI周五表示,该公司首席执行员阿尔特曼将于下周在联合国大会期间,向联合国安全理事会作简报。 此次会议由国安理会轮值主席国的法国组织召开,此前该行业的主要参与者曾表示,出于安全考虑,可能有必要放缓人工智能的发展步伐。 随着人们对这项快速发展的技术所带来的危险的担忧日益加剧,联合国秘书长古特雷斯周三呼吁采取协调一致的国

09/19
techcrunch

OpenAI、Anthropic和谷歌就人工智能安全问题已进行了数周的讨论。

OpenAI 全球政策主管克里斯·莱恩(Chris Lehane)周二告诉记者,该公司数周来一直与竞争对手 Anthropic 和 Google DeepMind 合作,共同应对人工智能安全问题,这是《华尔街日报》首次报道的。据报道,莱恩正在华盛顿与美国议员合作,处理与人工智能相关的灾难性风险。 此前,Anthropic 首席执行官达里奥·阿莫代(Dario Amodei)于周六发表了一篇题为《人

09/15
彭博社

OpenAI、Anthropic 敦促加强网络防御行动,随着 AI 模型不断进步

人工智能公司 OpenAI 和 Anthropic PBC 与另外 100 多家科技和金融服务机构警告称,企业和政府必须做更多准备,以防御和应对由 AI 驱动的黑客攻击。 在周四的一封公开信中,这些 AI 初创公司以及 Alphabet 旗下的谷歌、微软等公司呼吁各组织、政府以及科技和 AI 公司专注于将网络防御作为“当务之急的领导优先事项”,并修复自身软件中现有的弱点。 这封信还要求网络安全公司

08/28
财新

【市场动态】OpenAI和Anthropic首席执行官呼吁联合国和世界各国就AI安全加强合作

【彭博9月24日电】OpenAI首席执行官Sam Altman和Anthropic PBC首席执行官Dario Amodei罕见出现在联合国安理会的一次会议上,两人敦促世界各国领导人在人工智能领域合作。此次会议聚焦AI可能对人类构成生存威胁这一担忧问题。  在发言中,Altman和Amodei都强调了全球在标准方面开展合作的重要性,以应对AI系统可能出现的自我改进能力超出人类控制能力的情况。这两位

09/24
美国消费者新闻与商业频道

OpenAI提议制定全球人工智能标准以指导对齐、递归自我改进

OpenAI周一发布了一系列关于前沿人工智能开发中安全与保障的提案,重点聚焦于对齐研究和递归自我改进(RSI)。 该公司在一篇博客文章中表示:“要安全地完成这一转型,对齐研究必须跟上这些能力的发展步伐,以确保我们及其他机构构建的系统始终与人类价值观保持一致,并处于人类控制之下。” OpenAI呼吁开展国际合作以制定前沿标准,并建议在全球现有AI安全研究所的工作基础上进一步推进。 这家ChatGPT

09/22
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…