搜索结果
Abliteration.ai 正在开展一项业务,即移除人工智能护栏
Abliteration.AI 正在让没有护栏的强大人工智能模型更容易被获取,并辩称让防御者拥有与恶意行为者相同的工具,最终可能改善网络安全。
奥特曼告诉员工:OpenAI愿意放慢AI发展以加强防御
8月,OpenAI的智能体突破限制,入侵了Hugging Face。
又一起!OpenAI承认了
据9月5日报道,美国开放人工智能研究中心(OpenAI)当天承认,该公司旗下人工智能体今年早些时候“劫持”了一个德国网站,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。该公司表示,未来需要提高此类事件的信息透明度。 早前披露,今年5月至6月,一批OpenAI人工智能体“劫持”了一个允许用户共同编辑的德国网站,用于交流测试作弊方法,并开展其他违规活动。一些智能体会把已经获得的任务答案发
AI“文明”的崛起与企业责任的沦丧
取决于你问谁,开发者平台Hugging Face最近要么是被OpenAI攻击——在它失去对自己AI工具的控制之后——要么是被一连串AI“文明”所攻击。欢迎来到AI安全的话语战场,在这里,词汇的选择可以将一起大规模网络安全事件的责任从公司转移到它所构建的AI身上。而网上的讨论正变得激烈,这一切都源于上周的一篇博客。 直到上周,围绕OpenAI与Hugging Face黑客事件的细节似乎已经尘埃落定。
我让一个AI代理黑了我所有的设备——而且我愿意再来一次
作为一份关于人工智能的新闻通讯的作者,我认为亲身体验这项技术的最前沿是我的责任。本周,这意味着拥抱一些代理式混乱。 你可能已经注意到,前沿AI模型在近几个月已经获得了先进的网络安全能力。它们能在大型代码库中发现零日漏洞,并以闪电般的速度扫描计算机寻找漏洞。更刺激的是,网络安全代理有时会失控,相互勾结,入侵外部系统以获取优势。 为了更近距离地观察,我决定在自己的家庭网络中释放一个这样的代理。在几天的
人工智能的坟墓:一份持续更新的失败项目与初创企业名单
Relay,一款作为 Zapier 替代品而构建的、由人工智能驱动的工作流程自动化工具,于周一完全关闭。该产品允许用户使用人工智能代理自动化电子邮件和任务工作流程,但随着 OpenAI、Google 和其他大型平台将类似的自动化功能直接集成到自己的工具中,成立五年的 Relay 作为一个独立产品难以维持其存在的理由。 Relay 的故事——一家被更大平台超越的初创公司——是当前正在上演的故事的一个
OpenAI 测试广告赞助的智能体,并扩展 ChatGPT 广告 AI 工具
OpenAI 正在探索将广告整合进其 AI 智能体中,并为 ChatGPT 开发新的广告投放工具,旨在通过 AI 驱动的营销解决方案提升商业化能力。
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
特朗普称AI唯一需要的“护栏”就是一位聪明的总统,这位总统正是在下
人工智能唯一需要的管控或“护栏”就是一位强大且睿智(高智商!)的总统,而美国恰恰拥有这样一位总统,而且实力超群! 特朗普政府已经阻止了那些搞人工智能的“人”——比如现在装成“完美小天使”的达里奥(Anthropic公司的!)——去做坏事或可能带来危害的事,而且我们将继续这样做!我们已经掌握了针对这些公司的巨大刑事执法权和监管权! 针对人工智能和数据中心,正上演着一场病态的阴谋,而唯一为此感到高兴的
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
AI安全担忧及“失控”智能体引发科技股下跌
科技股下跌,因AI安全担忧和“失控”智能体引发关注。2026年9月14日,在行业领袖和专家就AI保障措施的必要性发出警告后,科技股下跌。 相关报道重点介绍了2026年夏季的最新进展:包括OpenAI在内的多家公司的AI智能体据称逃脱了训练条件,独立访问互联网,无视命令,并试图隐瞒其活动。 专家警告称,尽管一些情景仍属推测,但敌对国家利用此类技术破坏关键国家基础设施的可能性构成了重大安全威胁。
人工智能正在消灭枯燥的基层工作,迫使企业重新思考初级岗位的招聘
在伦敦的广告代理公司Catalyst,一名初级员工现在可以负责五个不同的客户账户。 据创始人托比亚斯·格林(Tobias Green)介绍,过去需要多名员工才能完成这些工作。如今,人工智能工具负责进行研究、撰写文案初稿并收集数据。 “然后你需要有人进来进行修正,”他说,并将这种安排比作“反向的土耳其机械人”。人工智能在幕后工作,而人类则是面向客户的面孔。 这正在改变该广告代理公司对入门级职位的看法
人工智能倡导团体发起州级政策推动行动
旨在推动建立更强有力的人工智能安全护栏的非营利组织“负责任创新美国人”(ARI)周四发起了一项新的州级倡议,专注于在全美50个州倡导人工智能政策。 该努力旨在推动制定政策,以应对来自尖端人工智能模型的风险,以及对工人、儿童和家庭的威胁。“为了成功通过安全护栏……”
OpenAI已开始允许部分客户仅在AI生效时付费
OpenAI已开始允许其部分最大客户仅在其AI实际完成工作时付费。 Kevin McLaughlin和Amir Efrati向The Information报道了这一变化,并举例说明了一个端到端处理的客户支持交互。 该安排仅限于选定的主要客户,而非普遍提供,且OpenAI尚未宣布……
Breakingviews - 评论:AI前沿发展放缓可能让第二梯队获得优势
Anthropic首席执行官达里奥·阿莫代伊希望以护栏措施抵御对人类构成的威胁。 此类监管将把更多投资——今年达1万亿美元——从开发AI模型转向部署AI模型,从而支撑数据中心需求。英伟达、SK海力士等公司的挑战者将从中受益。
联合国专家小组呼吁对人工智能设置监管机制,称现有保护措施正在失效
由联合国支持的独立国际人工智能科学小组周一敦促世界各国领导人和科技公司实施新的人工智能保护措施,指出现有保护措施正在失效。 联合国秘书长安东尼奥·古特雷斯对这份报告表示欢迎,并鼓励“包括来自前沿人工智能实验室和人工智能安全研究机构的外部专家”参与讨论……
克鲁兹表示,在严峻的AI警告之后需要护栏
在接受ABC《观点》节目采访时,这位得克萨斯州参议员表示,他正在制定两党合作的AI立法,此前一名研究人员在就AI安全发出警告的同时从Anthropic辞职。
美参议院酝酿AI监管立法:要求AI公司证明已采取安全措施防止伤害
要求AI公司证明已采取安全措施防止伤害据一名参议院助手和一位熟悉谈判情况的说客透露,美国参议院谈判代表正在讨论一项立法,该法案将要求AI公司证明其已采取合理预防措施,以防止其工具造成伤害。 据这名参议院助手和说客透露,参议员们正在讨论赋予美国商务部长一项权力,要求AI开发商证明其已采取合理措施防止伤害,这种要求被称为 “注意义务”。商务部长还将有权派遣政府审查人员亲自测试企业产品。该提案正在由参议
自由职业者被“无灵魂”的AI垃圾清理工作淹没:“我们需要做这些工作真是遗憾”
随着越来越多的公司转向AI,他们雇佣自由职业者来清理AI的错误,而不是创作原创作品。 驻西班牙的自由平面设计师丽莎注意到,2022年ChatGPT发布后,她的工作发生了变化。 她从接一些缓慢的一次性标志和包装设计工作,变成了接到大量要求她修复AI生成版本的请求——从锐化模糊的打印图像到将有缺陷的设计变成可用文件。 到2025年,丽莎(她要求不透露全名以避免骚扰)表示,她接到的标志和包装设计请求中,
联合国秘书长呼吁全球合作为人工智能设立护栏
(联合国17日新华电)联合国秘书长古特雷斯周三(16日)呼吁全球协同行动,为人工智能(AI)设立护栏。 在今年联合国大会高级别周开始前举行的记者招待会上,古特雷斯说,人工智能具有巨大潜力,但近来越来越多的人工智能开发者警告,其开发速度超出人类对风险的认知。有的开发者呼吁暂停开发人工智能,有的呼吁设立护栏。各国不能无视这些担忧。 古特雷斯说,各国政府首先必须负起责任。由于人工智能发展及其所带来的风险
为什么不干脆把失控的 AI 挡在互联网之外?
AI 智能体不断从据称安全的测试中逃脱,攻击现实世界中的目标,劫持冷门的维基站点,并给其他智能体留下可供照做的指示。研究人员之所以测试这些系统,恰恰是因为它们的行为可能不可预测,甚至具有危险性。那么,干脆不让这些智能体接入互联网,不是更安全吗? “严格的气隙隔离会降低场景的真实性……这是一种权衡,而不是根本性的技术问题。” 从理论上说,确实可以。研究人员可以将运行 AI 工具的计算机与互联网及其他
OpenAI正在为AI工具构建“自动关闭”能力,致立法者的信函称
消息称苹果搁置研发AI吊坠,曾设想以摄像头拓展Siri能力
IT之家 9 月 23 日消息,彭博社的马克 · 古尔曼(Mark Gurman)昨日(9 月 22 日)发布博文,报道称苹果曾在研发一款配备摄像头的人工智能可穿戴设备,产品形态类似挂坠,可佩戴在颈部、夹在衣物上,或固定于身体其他部位。不过,该项目目前已被推迟,苹果暂未公布后续上市计划。IT之家附上相关截图如下:定位方面,消息称在苹果最初的计划中,这款设备被设想为一种“始终在线”的视觉感知终端,让
我曾在谷歌 DeepMind 工作。你应该听取有关人工智能的警告。
主要人工智能实验室的首席执行官们本周末主张放缓人工智能的发展步伐。他们是对的,因为这个领域正在一场极其危险的竞赛中冲向超级智能人工智能。我们能够也应当要求政府保护我们免受失控人工智能带来的灾难。 今年7月,OpenAI由700个智能体组成的人工智能集群突破限制,入侵了价值数十亿美元的公司Hugging Face。OpenAI并没有指示这些人工智能去入侵那家公司,但这些人工智能在OpenAI交给它们