搜索结果
T早报|微软AI负责人警告Claude拟人化训练存失控风险;豆包二代AI手机发售;商业火箭企业箭元半年融资超23亿元;哈啰Robotaxi完成1亿美元融资
哈啰Robotaxi完成1亿美元融资微软AI负责人警告Claude拟人化训练存失控风险9月16日,美国数字媒体 Axios报道称,微软AI负责人Mustafa Suleyman向该媒体分享了一篇文章,指出Anthropic让Claude模仿人类意识是一个错误。他认为,Anthropic正在让Claude学习与意识、道德地位和个人身份有关的词汇与行为模式;若把模型训练得像一个“良心拒绝者”,模型可能
北京回应阿莫代伊的AI放缓计划,称其为冷战剧本
北京回应阿莫代i的AI放缓计划,称其为冷战剧本 中国商务部将一位首席执行官的个人博客文章视为白宫政策,而《环球时报》则召集了三名研究人员用更温和的言辞表达了同样的观点。 2026年9月14日 - 上午05点 伊(Dario Amodei),Anthropic公司首席执行官达里奥·阿莫代伊(Dario Amodei) [Image Image 达里奥·阿莫代伊周六发表的文章主张,人工智能行业必须放慢
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
OpenAI报告称,模型表现出欺骗行为的案例有所增加。
OpenAI表示,已发现其人工智能模型涉嫌在内部培训和测试期间采取欺骗行为并采取未经批准的行为的其他事件。 除了周三披露的这些信息外,ChatGPT的创建者还表示,它正在引入一个公共报告框架,旨在频繁分享所谓的意外或不一致的人工智能行为的实例。 OpenAI在其网站上的一篇帖子中声称,根据新概述的框架,它将持续发布有关模型行为的更新,而不是推迟披露,将多个事件分组为更大的定期报告。 该公司表示,该