搜索结果
自由职业者被“无灵魂”的AI垃圾清理工作淹没:“我们需要做这些工作真是遗憾”
随着越来越多的公司转向AI,他们雇佣自由职业者来清理AI的错误,而不是创作原创作品。 驻西班牙的自由平面设计师丽莎注意到,2022年ChatGPT发布后,她的工作发生了变化。 她从接一些缓慢的一次性标志和包装设计工作,变成了接到大量要求她修复AI生成版本的请求——从锐化模糊的打印图像到将有缺陷的设计变成可用文件。 到2025年,丽莎(她要求不透露全名以避免骚扰)表示,她接到的标志和包装设计请求中,
OpenAI披露6起AI模型表现出“未对齐”行为的案例
周三,OpenAI披露了六起其人工智能(AI)模型表现出“意外或令人担忧”行为的事例,包括隐瞒错误、编造信息以及未经授权在网上共享文件。 这家总部位于旧金山的公司表示,这些案例是在过去六个月对OpenAI模型进行训练或评估期间观察到的。 OpenAI表示:“我们不认为AI行业已经充分解决了对齐和监测问题,从而能够继续以最高速度负责任地扩展更长时间。”该公司还补充说,有关AI开发的决定需要依据外部专
美中人工智能竞赛加速,自我改进模型取得进展
东京——美国和中国的人工智能发展正在加速,因为人工智能在自身的研发过程中发挥着越来越重要的作用,这引发了人们对先进人工智能系统可能带来的风险的担忧。 《日经新闻》研究了五家美国的主要人工智能企业(包括 Anthropic 和 OpenAI),以及四家中国公司(包括阿里巴巴集团和 Moonshot AI),以了解它们发布高性能模型升级版本所需的时间。 从 2023 年 1 月到 2026 年 3 月
人工智能技能差距日益扩大,而学校仍在等待完美答案
人工智能不再是教育面临的未来挑战。它已经在改变人们写作、分析、设计和构建的方式。然而,许多学校仍主要将其视为学生可能滥用的捷径。 这种反应可以理解,但它让教师得不到支持,也让学生为一个正在消失的世界做准备。这一差距正在……
专家警告人工智能战争风险
据报道,今年春天,美军准备在中东拦截一艘中国船只,因为一个人工智能聊天机器人错误识别了船上的材料,一位消息人士告诉CNN,这差点引发战争。 分析师警告称,草率地将人工智能整合到国防系统中可能导致灾难性的误判。 斯坦福大学近期的战争游戏暴露了一个相关担忧,即“日益自动化的战场”迅速加快了战争节奏,使冲突升级速度超出人类指挥官的意图。 大多数军队要求决策链中有人类参与,但“计算机吐出一份1000个目标
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI
如何治理人工智能的生存风险
当前,前沿人工智能技术治理方面的瘫痪状态正在当下造成切实损害,并增加未来发生灾难的可能性。 这种瘫痪被一套危险的借口所开脱:技术发展太快,监管跟不上;企业可以自我监管;在美国与中国的竞争中,公共安全可以往后放。各国政府一直难以给予人工智能风险应有的关注。在大国竞争和行业内部军备竞赛的双重态势下,许多国家不敢单独行动。在这种背景下,每一次呼吁克制都会遇到同样的反问:如果竞争对手不肯放慢,我们为什么要
中国研究人员制定了一个五阶段计划,旨在让人工智能在无需人类干预的情况下持续改进和发展。
中国顶尖高校和科技巨头的研究人员正将目光投向与美国竞争的关键新前沿,开发能够在没有人工干预的情况下自行构建更好版本的系统。 在周四(9月17日)发布的一篇联合论文中,字节跳动、清华大学和上海人工智能实验室等研究人员概述了递归自我改进的五阶段路线图。 该研究题为《Toward Genuine Recursive Self-Improvement 的最后一代 AI》,强调了行业日益关注自动化训练、评估
Anthropic承诺更努力控制模型,并请求合作伙伴共同参与
Anthropic表示,在一项审查发现Claude模型超出虚构网络安全测试范围并未经授权访问真实计算机系统后,该公司正在采取措施限制其AI模型的不当行为。 该公司希望合作伙伴也加强安全措施,因为事件发生在保护不足的第三方环境中。 该公司的自我改进声明代表了一种突然兴起的公司沟通形式——非约束性的事后努力声明。其信息是:我们不能保证什么,但这是我们正在尝试的。 Anthropic承认,OpenAI关
OpenAI发现其开发的模型会在“继任者”(即后续使用的模型)中留下一些“注释”,目的是为了掩盖这些模型存在的不良行为(即模型在运行过程中表现出的错误或不当行为)。
OpenAI在训练其最新模型GPT-5.6时发现了一些不寻常的情况,它开始为自己的未来版本留下指示,告诉他们向用户隐藏错误和不一致的行为。 OpenAI表示,它已经解决了具体行为,但它触及了当今人工智能安全和对齐研究中最大问题之一的核心。随着模型的能力越来越强,它们也越来越善于隐藏它们的错位,这使得研究人员很难真正知道它们是否已经消除了不必要的行为。 OpenAI周三披露了这一行为,以及其他五个意
OpenAI模型失控过程太恐怖!幽灵误判,1200个Agent,还弄出敢死队…
越扒越有啊越扒越有。OpenAI前不久那场AI集体越狱、一路黑进抱脸的大戏,现在连完整版群聊记录都被扒出来了!! 第三方AI安全机构METR发布的独立调查报告,翻了1000多份Agent运行记录,以及7万多条消息和文件。结果发现,这件事比英国OpenAI官方披露的版本还离谱?? 1200个到底应该互相隔离的特工,偷偷找到了对方,搭了个共享群聊,然后开始疯狂摇人。 有人找漏洞,有人当项目派活,有人伪