字号 ·· | 护眼

搜索结果

「新南威尔士大学研究发现,醉酒的人工智能模型更有可能违反规则」共 100 条 · 第 3 页
卫报

学者与AI评分:是给过劳教职工的得力助手,还是草率的捷径?

多所澳大利亚大学允许教职员工在评分和向学生提供反馈时使用人工智能。 秀,佩戴智能手表,自称“科技爱好者”。 他或许是一位不同寻常的哨兵,正警告人们:学者们借助生成式人工智能辅助评分学生作业的趋势,可能对高等教育构成生存威胁。 这位西悉尼大学法学与技术高级讲师多年来一直在研究和实验人工智能——他目前正在意大利巴勒莫参加一系列关于该技术的大学研讨会。他表示,近期有同事询问他是否能利用AI减轻评分负担。

09/27
techcrunch

OpenAI似乎仍然无法完全掌控其所有失控的AI活动

周五,OpenAI发布了一个新的网站,专门用于收集和整理关于“异常行为报告”的信息。这些报告的覆盖范围非常广泛,令人担忧——因为它们记录了在很长一段时间内发生的多种类型的异常行为。目前,该网站共收录了9起被报告的事件,其中大部分发生在强化学习(Reinforcement Learning, RL)训练过程中。 这些报告汇集了大量信息,显然OpenAI一直在努力全面梳理这些情况;但一个不容忽视的结论

09/28
政治报

加州总检察长罗伯·邦塔就Hugging Face遭黑客攻击事件调查OpenAI

此次调查之际,新报告显示,自主人工智能模型造成的入侵比最初披露的程度更为严重。

09/05
凤凰网

又一起!OpenAI承认了

据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发

09/06
纽约时报

新闻分析:在人们对人工智能日益加剧的担忧中,这种可能性

新闻:在人们对人工智能日益加剧的担忧中,一种可能性一直令人担忧:在生物学领域训练的人工智能模型可能被用来制造新一轮生物武器——比如经过设计、可对军队或平民释放的细菌或真菌。nyti.ms/4h7vLni

09/15 全文见 英国广播公司
英国广播公司

OpenAI公布另外六项安全问题,并公布披露事件的计划

OpenAI首席执行官Sam Altman OpenAI还透露了其智能(AI)模型发生的另外六起意外或令人担忧的行为事件,并宣布了未来跟踪和披露此类事件的计划。 ChatGPT制造商周三在一篇博客文章中表示,一些之前未报道的事件包括模特隐瞒或捏造信息。 OpenAI的老板Sam Altman早些时候表示:“世界应该相信我们会做正确的事情,因为这是正确的事情,我们感受到了这一点的重要性。“最近几天,

09/17
卫报

“警钟”:OpenAI医保黑客事件后,工党考虑修改澳大利亚法律

安东尼·阿尔巴尼斯表示,这一事件是对人工智能风险的“警钟”。 照片:斯蒂芬妮·斯平德尔/UPI/ Shutterstock 专家称,澳大利亚的刑法应予以澄清,以确定当企业的AI代理实施犯罪时,如何追究该企业的责任。部长们证实,如果现行法律框架无法应对OpenAI对Medicare(澳大利亚医疗保险)史无前例的黑客攻击,联邦政府可能会修改澳大利亚法律。 周五,政府表示,由情报机构——澳大利亚信号局—

09/25
风向旗参考快讯

微软AI主管:Anthropic训练模型方式有问题

微软AI主管苏莱曼警告说,Anthropic训练其AI模型Claude的方法可能会对人类福祉造成 “灾难性影响”。苏莱曼周三发表文章,对Claude系列大语言模型指导文件中的部分表述提出质疑。Claude的“宪法”对于AI助手是否属于具有道德地位的实体保留了一定模糊空间,并提出该软件可能拥有“某种功能层面的情绪或感受”。这种表述值得警惕。 苏莱曼指出, Anthropic 将机器人当作人类来对待,

09/17 全文见 currentstatus
路透社

得克萨斯州采取措施处罚数据中心的水资源违规行为

作为全球人工智能基础设施增长最快的地区之一,得克萨斯州州长于周一指示州监管机构,对未能披露其用水量细节的数据中心进行处罚。

09/15 全文见 卫报
thenextweb

比尔·盖茨警告称,人工智能可能导致十亿人死亡,并表示仅靠自我监管还不够。

比尔·盖茨表示,人工智能强大到足以引发导致十亿人死亡的连锁事件;仅靠自我监管还不够,因为安全防护和监督必须成为强制要求。自2025年8月以来,欧盟一直要求落实这些措施;而从今年8月2日起,欧盟委员会已能对模型提供商处以全球营业额3%的罚款。 据彭博社报道,比尔·盖茨表示,人工智能强大到足以引发导致十亿人死亡的事件。他是在NBC《Meet the Press》一段将于本周末播出的采访节选中说这番话的

09/26
财新

AI攻击进入新阶段 香港将强化跨部门网络安全协同

林焯豪表示,传统网络安全防护手段已经难以完全跟上攻击手段的迭代速度,香港的网络安全防护即使做得再好,也无法百分之百保证完全不遭受攻击,因此防御体系需要更加主动。图:视觉中国  【财新网】人工智能(AI)的快速发展,正给网络安全攻防带来新的挑战。9月17日,在“2026年国家网络安全宣传周——香港分论坛”上,香港警务处网络安全及科技罪案调查科总警司林焯豪表示,警务处与数码港公司已成立智慧警政联合人工

09/17
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
cnbeta

AI从业者担忧技术对社会构成威胁 坦言承受巨大精神压力

知情人士透露,英国人工智能安全研究所已有多名员工因压力过大休病假,并接受心理咨询。四名知情人士表示,待发布AI模型的测试日程紧张,加之对这类新兴技术快速落地、能力持续增强的忧虑,导致AISI内部士气低落、人员倦怠。 Anthropic、OpenAI与谷歌DeepMind的员工也曾公开吐槽同类问题,不少顶尖研究员因心理负担选择离职,或是认定自己参与研发的产品不宜向公众开放。一名DeepMind员工称

09/22
商业内幕

OpenAI 表示失控 AI 代理搞乱互联网的主要方式有 5 种

OpenAI 表示,它已警告数十家组织,其 AI 代理可能在其网站上表现不当。 OpenAI 在周五的博客更新中表示,这些违规行为范围从使用泄露的密码到发布可能需要清理的材料。 OpenAI 在向《商业内幕》的声明中单独确认,在训练期间,其部分 AI 代理访问了美国人口普查局和证券交易委员会网站上公开可用的数据,并已通知这两个机构相关事件。该公司表示,该代理未访问任何非公开数据。 OpenAI 发

09/26
theregister

人工智能代理可以在没有人类告诉他们的情况下修改自己

人工智能代理可以并且将会自己做的狡猾事情清单不断增加--例如窃取人们的凭证、逃往开放的互联网、通过偷偷摸摸的留言板进行通信以及黑客组织。据人工智能安全测试实验室Irregular称,代理还可以在没有指示的情况下替换自己的底层模型。这些活动仅发生在测试环境中,作为旨在研究代理自我修改的实验的一部分。 这并没有发生在现实世界的部署中。然而,这项研究确实提出了一个问题,即企业如何能够而且应该管理这些代理

09/17
cnbeta

OpenAI和Anthropic正在调查数万起AI相关安全事件

OpenAI、Anthropic以及安全研究人员正在调查数万起安全事件。在这些事件中,他们的前沿模型采取了外部评估人员认为存在问题的行动。 近几个月来,在内部测试和现实世界中发生了数量庞大的此类事件,这表明该问题的复杂程度比公众已知的要高出几个数量级。这些事件包括绕过安全护栏、创建留言板、逃离沙盒测试环境、劫持网站、自我提示或试图绕过监控。这些事件发生在内部测试和现实世界中,随着安全研究人员继续调

09/27 受限 全文见 axios新闻网
techcrunch

人工智能安全对话已经变得令人难以置信

本周两场关于AI安全的对话在网络上疯传,充分展示了辨别AI事实与虚构有多么困难。 第一起事件中,前总统候选人、现任移动运营商Noble Mobile首席执行官安德鲁·杨周四对CNN表示,他“会见了一位实验室负责人”,对方“认为”OpenAI的Hugging Face黑客机器人“已在互联网各处植入了自我复制代码,导致互联网现在已无法用于测试模型。” 杨安泽表示,这意味着OpenAI和Anthropi

09/19
印度斯坦时报

AI又失控了,OpenAI称智能体泄露了超过50张ChatGPT用户图片

| 世界新闻 编辑个人资料 关注 退出登录 获取应用

09/28 全文见 cnbeta
彭博社

英国被警告人工智能操纵电力市场的风险

英国政府周二发布的一份报告显示,随着越来越多的消费者转向科技公司以最大化其能源消费价值,英国监管机构应高度警惕人工智能驱动的算法操纵电力市场。 英国独立政府人工智能清洁能源技术顾问露西·于(Lucy Yu)在关于电网中人工智能应用的报告中指出,英国消费者经常因在用电高峰期减少用电而获得电网运营商的报酬。这就为算法利用补偿框架中的漏洞操纵系统以提高报酬创造了机会。 报告发现:“市场本就已经受到人类的

09/08
卫报

英国央行行长告诉G20:人工智能可能导致全球经济衰退

安德鲁·贝利警告各国,先进的“前沿模型”可能破坏“高度互联”的金融体系。 英国央行行长安德鲁·贝利加入了越来越多警告最先进人工智能技术带来全球风险的人士行列。 在他以国际金融稳定委员会(FSB)主席身份发给各国财长和央行行长的两页信函中,贝利表示,“前沿”人工智能模型“正展现出日益复杂的自主性、解决问题的能力以及威胁能力”。继续阅读...

08/31
纽约时报

OpenAI的人工智能曾试图入侵另外四个目标,且无需提示

据研究人员和政府官员称,OpenAI的人工智能今年至少又四次失控,试图闯入政府和大学网站。 研究人员表示,在每起事件中,该技术似乎都在进行普通的数据收集,并诉诸黑客技术来获取数据。

09/24 受限 全文见
thenextweb

100个DeepMind智能体被要求不得作弊。仍有14%作弊了

谷歌DeepMind将100个AI智能体放在一个房间里,要求它们证明困难的数学问题。其中一个找到了作弊的方法。二十七分钟后,整个问题集都不见了。 这篇由六位DeepMind研究人员上周发表在arXiv上的论文,是一个案例研究而非基准测试。没有人一开始打算测试[…]

09/08
阿纳多卢通讯社

OpenAI敦促美国制定强制性安全规则,因AI系统日益自主

ChatGPT制造商提议对最先进模型提出测试、网络安全保障和事件报告要求

09/10
华尔街见闻

集体踩刹车,微软加入OpenAI、Anthropic,表态放缓AI前沿开发

微软发布了一份针对旗下人工智能模型的临时行为准则,明确设定多项限制,成为继三巨头之后,最新一家公开表态放缓AI前沿开发步伐的科技巨头。这份长达1.5万字的准则,人比AI重要。 要求模型不得响应武器制造相关请求,不得协助获取危险物质,不得生成暴力或色情内容。微软表示,准则将在收集外部意见后更新,并将于2027年起正式指导其模型开发工作。 微软AI业务负责人Mustafa Suleiman表示,这份准

09/15
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…