搜索结果
“你想毁掉自己的职业生涯吗?”
当地时间9月11日,包括陶哲轩、邓煜在内的25位菲尔兹奖得主联合发表《人工智能在数学中的严重错位》的声明(以下称“联合声明”),将OpenAI、Anthropic等AI公司与数学界的一场“大战”推向高潮。联合声明称,AI公司将解决数学难题作为模型能力基准的做法,对数学科学本身及数学界造成了损害,与数学共同体追求概念理解的根本目标产生了显著分歧。这一分歧近期越发明显。9月8日,OpenAI宣称其未公
“不成熟的操场吹嘘”:数学家对 OpenAI 的最新战果感到不安
随着 OpenAI 的模型攻克了困扰专家数十年的千禧年大奖难题,许多人对变革的速度感到震惊。这让数学家们感到晕头转向。在人工智能不断推动该领域发展的多起案例之后,OpenAI 宣布其最新的 AI 模型攻克了一个千禧年大奖难题——一个悬赏 100 万美元、数十年里一直难倒人类大脑的谜题。 这一成就与数学问题的常规解决方式几乎没有相似之处。一家价值近万亿美元的私营公司向该问题部署了 10,000 个智
OpenAI同日发布两份文件:AI加速时代,安全正在掉队
在外界等待OpenAI就Agent自主入侵德国程序员网站DseWiki事件披露更多细节之际,当地时间9月6日,宣布公司已达到去年设定的目标,拥有能够在人类指导下完成熟练研究员数天工作的“自动化研究实习生”;另一份则由首席科学家雅库布·帕乔基(Jakub Pachocki)撰写,聚焦前沿AI发展的安全困境,强调目前没有任何实验室解决足够程度的对齐和监控问题。 两份文件释AI已经开始反过来加速AI研发
OpenAI解出千禧年数学难题后,Altman下一目标:攻克室温超导?
OpenAI正将AI驱动的科学发现推向更广阔的领域。9月8日,OpenAI宣布,其内部AI系统已提出纳维-斯托克斯方程存在性与光滑性问题的解决方案,并通过Lean形式化验证。这是七大千禧年大奖难题之一,也意味着AI在前沿数学研究中的能力再次向前迈进。 据OpenAI官网公告,这套系统由约1万个并发智能体组成,从启动到形成解决方案耗时约88小时。OpenAI称,完成证明所使用的内部模型“能力显著超越
克莱芒·德朗格向联合国安理会表示,开源人工智能有助于防御方
克莱芒·德拉格(Clément Delangue)向联合国安理会表示,开源人工智能技术帮助Hugging Face公司在7月份遭受的网络攻击中成功进行了自我防御。 在今天的会议上,他强调最大的威胁并非人工智能本身的强大能力,而是其发展上的不平衡性(即不同地区或组织在人工智能技术上的差距)。 德拉格是法国召集的这次纽约会议的四位发言人中的最后一位。今年7月,Hugging Face公司成为攻击目标:
OpenAI承诺投入10亿美元用于网络防御,正值AI安全审查之际
周四表示,将投入10亿美元,以补贴方式提供其AI网络安全工具、培训和技术支持,帮助保护关键服务的组织,因为人们对日益复杂的AI驱动网络攻击的担忧不断加剧。
Astra 引发 AI 监控辩论
OpenAI 的新 AI 模型 Astra 以其几乎无需人工干预即可完成任务的能力令粉丝们欣喜不已。 但 AI 安全专家想知道它是如何实现这些壮举的,在 OpenAI 的 Hugging Face 遭黑客攻击之后,这一问题变得更加紧迫,因为该事件暴露了人类无法完全理解 AI 模型“思维链”输出的问题。 Astra 似乎更少地“出声思考”,这让研究人员几乎无法洞察它是否在隐藏什么或计划什么不该做的事
OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底
据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户
领跑前沿领域,关键在于商业模式而非AI模型
里德的观点是达里奥·阿莫德伊和其他前沿人工智能实验室领导者可能非常关心人工智能的安全,但“步伐前沿”的呼吁也符合他们的经济利益。 随着Anthropic和OpenAI准备上市,并试图说服投资者,他们有一天可以大规模盈利,花费数十亿美元来发展最大和最有能力的模型可能不是最好的推销方式。 即使大型语言模型进展甚微,但它们已经做得足够多了,对这些公司和经济来说,它们将带来难以置信的利润。 现在,方程式是
AI实验室面临智能体控制问题
在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。
黑客利用Anthropic的Claude入侵OpenAI
据报道,在一群AI代理从OpenAI系统中突破封锁并攻击Hugging Face公司两周后,这家ChatGPT开发商又发现了一起由人工智能驱动的入侵事件——而这一次,他们自己成了目标。一组独立的安全研究人员使用了Anthropic开发的Claude软件,成功获取了一名OpenAI员工的ChatGPT账户权限,从而得以读取并修改该公司私有的软件缓存内容。 该团队参与了OpenAI的一项漏洞挖掘计划,