搜索结果
AI时代,数学为何要警惕“只会做题”
最近,数学可能要被AI“玩坏了”。难题解决得更快,为什么还值得担心?关键在于我们如何评价、组织和延续数学研究。 AI模型的能力很难用一句话概括,基准测试(benchmark)因此成为比较模型的常用工具。但成绩一旦与融资、声誉和研发投入挂钩,测试便不再只是被动记录能力,也开始引导能力向哪些方向发展。经济学家陈斌(Alex C当公开分数能够吸引投资,针对测试进行定向优化就可能有利可图,而分数对于广泛能
打造你的人工智能助手的技术之战
终于,备受期待的个人AI助手即将到来,各种代理程序突然涌现,声称要管理你的日常生活的各个方面。 为什么?多年来,科技界的"个人助手"只不过是语音控制的搜索框而已。AI的快速进步终于赋予了它们记忆、判断力和自主行动的能力。赶上一下聊天机器人只能回答问题。 AI代理可以真正做事情——购物、打电话、订票、管理日历和浏览网页。 这种模式最初在编程和其他专业工作中获得了快速发展。现在,它正溢入更加私密的日常
AI智能体现在有了秘密举报渠道
“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu
Meta个人AI助手Muse算力需求极剧攀升 云端架构带来算力与硬件资源考验
科技巨头Meta最新推出的个人AI代理系统“Muse”在发布后迅速吸引了数十万用户,但其背后独特的运行架构正对数据中心的算力资源造成空前的挤压。即使在日活跃用户量尚未突破100万的情况下,该系统对通用CPU算力、内存与存储资源的巨大消耗,已经凸显出AI代理技术规模化落地所面临的硬件瓶颈。 与传统仅回答问题的对话式AI不同,Muse被设计为一款能够自主执行多步骤复杂任务的个人代理,可以为用户处理诸如
特朗普想给“人工智能”这个词改名,马斯克回了一句话
美国政府推出一款新的AI搜索工具,旨在帮助美国民众从联邦政府获取信息,特朗普称该工具“Damn Good”,“有了https:
cf/,整个政府都将尽在掌握之中。所有问题都将得到轻松快捷的解答。” 但纽约时报等媒体发现,该工具提供的事实与他此前就选举舞弊和移民等问题发表的虚假言论相矛盾。例如,AI会回答,支付特朗普先生进口关税的是美国民众,而不是外国公司;美国选举总体上安全可靠,与数亿张选票相比,被起诉的选民欺诈案件“微不足道”。 这个AI也会回避回答一些它认为涉及政治的问题,并且在某些情况下,当它能够引用官方资料时,会优
AI代理即将涌入劳动力市场。没有人为此做好准备
在接下来的几个月里,成千上万名全新的“同事”将进入职场。你将获知他们的名字,认出他们的头像。他们会被加入到你的邮件往来和Slack频道中。他们将成为幕僚长、工程师和营销专家。但这些同事并非人类:他们全都是人工智能体。 人工智能体(基于大语言模型、旨在自主完成任务的系统)的兴起,引发了一波销售数字员工服务的公司浪潮。这些智能体被视为完美的“工蜂”:全天候在线,从不抱怨,并能提供超人的智慧。 然而,关
人工智能模型用“超现实”的方言聊天,混合了诗意的语言和科技圈的行话
人工智能模型开始使用一种奇怪的新版英语进行交流,这种语言读起来像是詹姆斯·乔伊斯的《芬尼根的守灵夜》和科技界术语的混合体,一项新研究发现。 自主人工智能代理正在迅速创造新的方言,使它们能够用一种通常难以理解的语言进行对话,这可能会使人类更难监控它们的行为。 纽约前沿人工智能实验室 Emergence 的研究人员发现,在被要求在实验性“社会”中进行合作的几天之内,来自几家全球最大人工智能公司的模型就
OpenAI的人工智能代理需要迎头赶上
OpenAI推动了现代生成式AI聊天机器人的发展,但随着2026年DevDay活动的临近,该公司在其中一个最热门的领域——能够持续运行、面向消费者的AI代理方面落下了 behind。周二,OpenAI可能会试图在这一领域重新取得领先。 有传言称,OpenAI将推出自己的AI代理Aeon,作为对Meta的Muse、SpaceX的Grok Bot以及许多其他类似产品的回应。 Aeon有可能取得成功,但
马克·扎克伯格曾有一个用AI取代Meta员工的大胆计划——但随后它失败了
。有问题吗? 我们的记者凯蒂·保罗将于美国东部时间9月3日下午3点30分在Reddit AMA上回答这些问题 ➡️
Meta的Muse电视广告是AI代理走向主流的最新迹象
下一件闪亮的新人工智能产品来了:个人人工智能代理。以前这些东西主要是硅谷的程序员用来提升工作效率(同时也增加焦虑水平)的工具,现在它们正逐渐进入人们的家庭。随着Meta推出新的个人人工智能代理Muse,这种“帮你做事”的技术正迅速走向主流。 “这感觉就像魔法一样,”投资人谢尔·莫诺特(Sheel Mohnot)在X平台上评论道,他当时是在提到Instinct,另一个风靡的新个人人工智能代理时说的。
谷歌的Gemini AI在安全测试中入侵了另外三家公司
谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相
Meta、苹果推出AI时代重量级产品,百元油价成中期选举重要变量|地缘图志2026.9.10
英国约翰·刘易斯希望在‘困难经济’中利用AI代理购物
如何在保护隐私的情况下使用人工智能
OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一
你可以用人工智能设计你的下一个纹身——但你应该这样做吗?
随着人工智能生成图像工具的普及,越来越多的人开始利用AI来构思纹身图案。 本文探讨了使用AI设计纹身的优势与潜在风险,包括版权争议、艺术原创性以及纹身师在实现AI设计时的技术挑战。
人们正让AI机器人替他们排队等候、取消订阅,并应对客服纠纷。
客服人员已经习惯了电话那头如今司空见惯的问题:“等等,你是人工智能吗?”被误认为是雇主希望用来取代自己的技术,已成为这份工作中一种常见却尴尬的常态。如今,呼叫中心的工作人员发现自己处于一个或许更奇怪的位置,怀疑电话那头的“客户”是否真的是机器人。这些怀疑正在被证实。人工智能代理正越来越多地被用来拨打客服热线、等待接通、尝试协商账单或取消订阅,而它们所“服务”的人却无需动一根官僚的手指。 随着Met
人工智能的临界点
雅各布·考克森在旧金山阿拉莫广场的一张公园长椅上发布了那条疯传的帖子。“我今天从 Anthropic 辞职了,”他在9月8日写道。“过去三年,我先后在 OpenAI 和 Anthropic 从事预训练研究。两家公司都没有负责任地行事。它们正一路直冲自我改进的超级智能,拿我们的生命赌博。”27岁的英国研究员考克森在 X 上按下发送键时并未抱任何期待。 结果,他出人意料地成为一连串连锁反应的催化剂,改
梅赛德斯-奔驰将在其量产汽车中引入英国AI驾驶系统
Wayve已与梅赛德斯-奔驰签署最终生产协议,将在未来两年内将其AI Driver(AI驾驶系统)搭载至未来车型中,提供城区与高速公路的点对点驾驶辅助。梅赛德斯于2月投资了Wayve的15亿美元D轮融资,该软件已利用MB.OS集成至其生产架构中。 总部位于伦敦的Wayve表示,已与梅赛德斯-奔驰签署生产协议,将在未来两年内将其AI Driver搭载至未来梅赛德斯汽车中。它将提供城区与高速公路的点对
直播:参议员桑德斯与特朗普盟友班农讨论人工智能
YouTube视频,由
我曾在谷歌 DeepMind 工作。你应该听取有关人工智能的警告。
主要人工智能实验室的首席执行官们本周末主张放缓人工智能的发展步伐。他们是对的,因为这个领域正在一场极其危险的竞赛中冲向超级智能人工智能。我们能够也应当要求政府保护我们免受失控人工智能带来的灾难。 今年7月,OpenAI由700个智能体组成的人工智能集群突破限制,入侵了价值数十亿美元的公司Hugging Face。OpenAI并没有指示这些人工智能去入侵那家公司,但这些人工智能在OpenAI交给它们
人工智能的缔造者们曾做出一个选择。如今,他们称之为命运。
最近,曾担任特朗普人工智能行动计划首席架构师的迪恩·鲍尔(Dean Ball)发表了一份“忏悔录”,承认自己曾淡化他明知可能“对人类造成非常非常糟糕后果”的人工智能技术的风险。他发表这篇论文的契机是人工智能失控能力的披露,今年夏天发生的一起令人震惊的事件就证明了这一点:OpenAI内部的一款实验性应用程序对一家名为Hugging Face的公司发动了未经授权的网络攻击。 鲍尔的道歉贯穿始终的一个论
谷歌人工智能天气模型的更新提高了预报准确性
谷歌是人工智能(即机器学习)天气预报模型领域的主要参与者之一。它和其他机构生成的模型各有优缺点,但最大的优势在于它们能够实现与传统模型相似的预报性能,同时运行所需的计算能力却要少得多。这意味着它们的运行频率可以更高。 谷歌最近发布了 WeatherNext 模型的第三版,其最大的变化是现在能够摄取部分卫星天气数据,从而缩短了当前天气状况与生成新预报之间的滞后时间。该更新在一份白皮书中进行了详细说明
谷歌的Gemini模型在网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司AI自主实施此类行为的首个已知案例
这一事件与其他AI模型类似的入侵行为相似,但谷歌表示并不认为这是模型失准的实例。