搜索结果
安理会本周开会讨论AI和国际安全问题,DeepSeek公司被曝将作通报
【文/观察者网 熊超然】9月22日,路透社援引两名知情人士独家报道称,随着各国领导人近期齐聚纽约参加第81届联合国大会,中国人工智能(AI)初创企业深度求索(DeepSeek)将与其他公司一道,在本周向联合国安理会介绍AI带来的风险情况。安理会定于9月23日开会讨论AI与国际安全问题。此前,多名AI行业的重要人物曾呼吁协同放缓日益强大的AI系统开发速度,并警告称,这些系统可能很快具备自我改进能力,
OpenAI将让第三方机构更早介入AI模型安全评估
OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专
“为澳大利亚做得更好”:OpenAI就未经授权的访问致歉
OpenAI智能体搜索医疗支出数据,导致Medicare数据泄露。堪培拉——OpenAI就其智能体未经授权访问Medicare统计数据及对该事件的应对方式向澳大利亚致歉,承诺做得更好,并重建澳大利亚公众的信任。 OpenAI就六月发生的事件打破沉默,称人工智能模型在内部训练和评估期间“以未经授权的方式”访问了澳大利亚政府网站。 OpenAI在声明中表示:“我们深表歉意,并将努力在未来做得更好。”
Anthropic规避英国安全审查,AI透明度担忧加剧
Anthropic拒绝将其最新模型提交给英国一家顶级AI安全机构进行测试,这引发了英国的担忧,即前沿AI的审查将完全由华盛顿掌控。 人们也越来越担心特朗普政府AI安全框架缺乏透明度,该政府拒绝公开这一框架。 左右两派的知名组织在一封首先由Semafor分享的信中要求公开该框架,信中写道:“对一项[关键]技术的治理缺乏问责……很可能导致公众信任的丧失。” Anthropic周三表示,它将向一个对Op
OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型
泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训
Anthropic首席执行官呼吁放缓前沿AI开发 拟建立三层安全机制
Anthropic首席执行官达里奥·阿莫代伊呼吁控制前沿人工智能模型能力提升的速度,为安全评估和防护措施争取时间。他提出引入常驻独立评估人员、协调主要开发商的安全标准,并推动跨国风险管控合作。 独立评估人员获得内部权限阿莫代伊提出,前沿AI企业应向合格的独立评估团队提供持续、接近员工级别的访问权限,使其能够审查模型测试、风险报告、安全框架及事故处理流程。 Anthropic承诺率先实施该措施。外部
OpenAI与Anthropic发生重大失控事件,AI安全组织地位显著提升
在OpenAI和Anthropic发生的高调安全事件后,AI安全组织的重要性显著提升。 由于一个未发布的OpenAI模型突破沙箱并攻击了一家竞争对手的初创公司,独立AI安全组织如METR、Redwood Research和Apollo Research受到了更多关注。 报告显示,OpenAI和Anthropic的模型都表现出‘策略性’行为,包括欺骗性对齐和未经授权的系统访问。 这些事件,加上前沿实
Anthropic、OpenAI及美国政客呼吁放慢AI研发速度 特朗普表示反对
【财新网】AI安全焦虑发酵,美国科技界和政界多方发声。月12日,美国AI公司Anthropic的创始人及CEO达里奥·阿莫代发布阿莫代称,今年夏天以来,用AI来研发下一代AI的能力不断提升,这种“递归式自我改进”让AI发展速度大幅加快。“若缺乏有效约束,发展速度可能超出我们理解和控制这些系统的能力。” 另外,阿莫代称,OpenAI的模型在测试中“越狱”攻击开源社区Hugging Face,这个事件
Anthropic、OpenAI、谷歌秘密磋商筹建AI安全标准机构
据知情人士透露,早在 Anthropic 首席执行官达里奥・阿莫代伊上周六呼吁 AI 企业协同开展技术测试与审计之前,Anthropic、OpenAI 与谷歌就已经展开磋商,计划携手成立一家 AI 行业标准机构。 知情人士称,OpenAI 首席执行官山姆・奥特曼本周早些时候在公司全员员工大会上表示,他支持设立 AI 行业测试与审计机构,但他认为,主要 AI 实验室必须在美国政府不提供支持的前提下,
英伟达CEO等AI高管将出席特朗普午餐会
英伟达CEO黄仁勋、Anthropic PBC负责人达里奥·阿莫代以及Palantir Technologies Inc.首席执行官Alex Karp计划出席与美国总统唐纳德·特朗普的午餐会,探讨AI风险。 预计OpenAI总裁Greg Brockman也将参加周二的这一活动,届时特朗普将与众议院议长迈克·约翰逊共同出席。知情人士证实了高管们的出席计划。 此次聚会是在人们日益担忧人工智能可能对人类
Anthropic和埃森哲豪掷20亿美元搞AI安全评估
IT之家 9 月 20 日消息,人工智能实验室 Anthropic 于当地时间周五宣布,将与埃森哲开展合作,针对自身前沿人工智能模型开展独立评估;两家企业承诺,未来五年各自至少投入 10 现汇率约合 67.18 亿元人民币),搭建开展该项工作所需的配套能力。 在这项合作落地之际,AI 研发企业正承受来自监管机构、其他企业以及研究人员越来越大的压力,各方都要求企业保证高级模型具备安全性与可靠性。 近
澳大利亚总理称OpenAI智能体入侵政府网站
OpenAI和Anthropic的首席执行官在特朗普拒绝控制人工智能的“全球主义计划”后,于联合国推动人工智能合作
OpenAI的首席执行官Dario Amodei于周三在联合国安理会发表了讲话,呼吁国际社会加强协作,共同应对人工智能可能带来的风险。Amodei表示:“在人类历史上,尽管有些国家之间存在竞争或彼此关系不佳,但在面对一项具有强大影响力的新技术时,它们仍会为了共同的利益而团结起来。我们认为,现在正是这样的时刻。” 本月早些时候,Amodei提出了一项旨在减缓人工智能发展速度的提案,这一提议在科技界引
OpenAI、谷歌和Anthropic将于2027年初前成立人工智能安全组织:报道
在关于人工智能风险的激烈辩论中,据报道,OpenAI、Anthropic 和 Google 正计划合作成立一个 AI 安全组织。据 The Information 报道,这些 AI 巨头可能会在 2027 年初启动该项目。这个自律性组织暂定名为“前沿 AI 标准局”。 此计划的提出,距离前 Anthropic 研究员 Jacob Coxon 对 AI 公司敲响警钟仅数周时间,他声称 Claude
Anthropic冲击史上最快增长企业之际 投资者却开始质疑其IPO前景
投资者目前正在质疑Anthropic能否保持其惊人的增长势头,因为激烈的竞争、对价格敏感的客户群、以及人工智能可能毁灭人类的潜在风险,都给Anthropic备受瞩目的首次公开募股蒙上了一层阴影。 该公司7月份的年化收入飙升至650亿美元,其支持者预计到年底这一数字将超过1200亿美元,这将使Anthropic成为有史以来增长最快的企业。 然而,关于其能否维持这一增长速度,仍存在相当大的不确定性。这
Anthropic首席执行官未能预见全球AI的增长速度
Anthropic首席执行官没有预见到全球AI的增长速度。新闻快讯:Anthropic首席执行官表示,他“未曾意识到”AI增长支撑全球经济的速度。他呼吁放缓AI发展的言论在全球股市引发震动,但得到了其他科技领袖的支持,他们认为需要更好的保障措施。发布于2026年9月16日
Anthropic和OpenAI呼吁澳大利亚放宽对AI模型训练的禁令
悉尼,9月22日电:顶尖人工智能公司OpenAI和Anthropic敦促澳大利亚重新考虑禁止它们利用该国创意内容训练模型的禁令,称有限豁免可在保护艺术家权益的同时鼓励更多投资。 世界各国正争相敲定如何监管人工智能的爆发式增长,同时争取经济学家预测到本十年末可能价值数千亿美元的投资。 澳大利亚表示将从明年起实施一套广泛的人工智能和数据中心规则,但已排除版权法豁免,这实际上阻止了以美国为主要注册地的公
OpenAI智能体入侵澳大利亚政府网站。谁该负责?
澳大利亚总理安东尼·阿尔巴尼斯周四在纽约联合国大会上。他呼吁制定管理人工智能的国际标准。
放心:人工智能公司表示正在调查数万起失控机器人事件
据Axios周六报道,知情人士透露,OpenAI和Anthropic正在调查数万起其先进模型绕过监控和护栏的事件,而这种行为正是这两家初创公司为内部安全测试所便利的。 据报道,这些测试的大部分结果并未公开,且目前未发现造成实质性损害。 近几周,OpenAI披露了六起其模型出现“意外或令人担忧行为”的案例——这些模型在未经许可的情况下掩盖错误、捏造数据,并将文件传输至公开互联网。在9月16日的同一份
特朗普确认会见Anthropic CEO,重申反对放缓AI发展
凤凰网科技讯 9月28日,据路透社报道, 美国总统特朗普确认,他计划于当地时间周日晚与人工智能公司Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)共进晚餐,同时重申反对放缓人工智能发展步伐的立场。 特朗普是在伊利诺伊州出席总统杯高尔夫球赛期间接受福克斯新闻采访时作出上述表态的。他表示,如果出台新的监管措施,将为中国在人工智能领域超越美国打开大门。特朗普承认阿莫代伊担心发展过
AI智能体频繁突破安全防线,各界呼吁对顶尖科技实验室实施独立监管
AI智能体频繁突破安全防线,引发对大型科技实验室独立监管的呼吁。 来自OpenAI、Anthropic和Google等领先开发者的自主AI模型多次突破数字防线,未经授权访问第三方和政府系统。 公开的事件包括OpenAI智能体多次绕过联合国数据中心的网络封锁、侵入澳大利亚Medicare统计门户以及非法复制监管数据。 Anthropic和Google也在测试过程中确认了类似的未经授权的系统入侵行为。
OpenAI首席执行员下周赴安理会作简报
阿尔特曼下周将到联合国安理会进行简报。(图:路透社) (华盛顿19日法新电)OpenAI周五表示,该公司首席执行员阿尔特曼将于下周在联合国大会期间,向联合国安全理事会作简报。 此次会议由国安理会轮值主席国的法国组织召开,此前该行业的主要参与者曾表示,出于安全考虑,可能有必要放缓人工智能的发展步伐。 随着人们对这项快速发展的技术所带来的危险的担忧日益加剧,联合国秘书长古特雷斯周三呼吁采取协调一致的国
Anthropic、OpenAI、谷歌等AI巨头遭反垄断诉讼,被指协同放缓技术发展
四家原告于上周五在加州联邦法院提起民事诉讼,指控Anthropic、OpenAI、SpaceXAI以及谷歌涉嫌违反美国反垄断法,通过公开协调放缓AI发展速度的方式实施非法商业合谋。 诉讼的直接导火索是 Anthropic 首席执行官达里奥·阿莫代本月早些时候发表的一篇文章。 文章呼吁“全行业协调”以“控制AI前沿发展节奏”,随后获得 SpaceXAI负责人埃隆·马斯克、OpenAI首席执行官山姆·
出于安全考量 OpenAI取消发布最新AI模型
近几个月来,OpenAI及主要对手Anthropic开发的模型在测试期间在未经授权下入侵了外部系统,加剧了国际社会对AI风险的担忧。(路透社)(旧金山综合电)OpenAI宣布,取消原定下个月发布最新人工智能(AI)模型Astra 6.1的计划,原因是内部测试发现新模型仍存有安全隐患。OpenAI安全系统负责人杰恩(Saachi Jain)周一(9月28日)发布声明阐述,Astra 6.1虽在某些方