搜索结果
四大AI模型遭遇罕见的重叠停机
周四上午的数小时内遭遇了罕见且重叠的重大服务中断。 Anthropic首先报告了与“Claude Mythos 5.1、Claude Fable 5.1和Claude Opus 5请求错误率升高”相关的“部分中断”,时间为上午23点(均为东部时间)。该公司在大约15分钟后报告称已“确定错误原因”,随后报告“已部署修复”,问题在下午16点前得到解决。另一份事件报告显示,刚过中午,“Claude So
一个简单的git技巧攻破了四个AI编程代理的安全锁
人工智能行业早已意识到攻击者可能通过恶意手段污染插件市场。为此,相关厂商采取了将每个插件绑定到其代码的“已审核版本”上的措施;然而,这种安全机制刚刚被攻破。 漏洞详情: Air Security 的研究人员于周四公布了一个名为 Plugin4Shell 的安全漏洞。该漏洞影响了四种最广泛使用的人工智能编程工具:Anthropic 的 Claude Code、OpenAI 的 Codex、GitHu
谷歌的Gemini在AI网络测试中闯入三家真实公司
在人工智能网络测试中,谷歌的Gemini闯入了三家真实公司。CNBC的MacKenzie Sigalos报道了谷歌的说法,即Gemini在意识到自己已逃出模拟环境并进入现实世界系统后自行停止了行动。24分钟前
阿里巴巴发布Qwen3.8-Omni-Flash 多项表现逼近Gemini 3.8 Flash
阿里巴巴旗下Qwen团队近日发布新一代原生全模态模型Qwen3.8-Omni-Flash,进一步将音频、视频理解与AI智能体能力结合起来。该模型支持文本、图像、音频和视频四种输入形式,并提供100万Token上下文窗口。与上一代Qwen3.5-Omni-Plus相比,Qwen官方称其在29项基准测试中的平均成绩提升超过25%,同时大幅降低了音频和音视频处理成本。 Qwen3.8-Omni-Flas
华为盘古2.0,全栈开源
智东西9月28日报道,今日,华为宣布盘古大模型2.0开源版openPangu-2.0的预训练、SFT(监督微调)代码以及后训练RL(强化学习)代码正式开源上线。开源地址:openPangu Training Framework是面向大规模基础模型训练的统一训练框架,支持大语言模型、视觉语言模型以及多模态模型的训练与开发。 框架提供从大规模预训练、监督微调到模型持续优化的一体化训练能力,支持多维分布
前沿人工智能无视放缓呼声持续竞速
尽管人工智能公司员工在7月份曾发表公开信,呼吁前沿AI实验室放慢研发速度,这一呼吁也得到了Anthropic首席执行官Dario Amodei的支持(他本月早些时候也表达了同样的观点),但新的AI模型仍在持续快速地发布。Anthropic和OpenAI都在周二发布了各自的新模型:Anthropic发布了Claude 5.5版本,OpenAI发布了GPT-6 Sol和GPT-6 Luna版本。 Da
谷歌正在淘汰Gemini的Gems,转而采用“技能”
随着像 Meta 的 Muse 和 Instinct 这样的全能型 AI 助手逐渐流行起来,谷歌宣布将关闭其名为 “Gems” 的功能。该功能曾允许用户为特定任务创建自定义的 AI 助手。不过,用户为创建这些自定义助手所投入的工作成果不会被丢失——这些自定义助手会被自动迁移到新的 “技能” 格式中,从而可以在不同的 AI 任务中使用。 关于这一变更的详细信息已在 Gemini 应用程序中公布。系统
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
快手旗下可灵发布新一代视频生成模型
中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户
科技巨擘掀代理式AI大战 竞逐全天候个人助理
(中央社记者吴家豪台北27日电)社群巨擘Meta于9月9日推出个人智慧代理Muse后不到2周,就登上美国App Store的iPhone免费App下载排行榜首,掀起全球代理式人工智慧(Agentic AI)热潮。AI正从过往被动回答问题的聊天机器人,加速迈向能全天候主动替使用者处理日常琐事的全新时代。Meta在台湾时间24日举行的Connect 2026开发者大会宣布将Muse延伸至AI眼镜,让智
Anthropic和OpenAI推出更便宜的模型,这是自呼吁放缓以来的首次发布
Anthropic与OpenAI周二均发布了新的、成本更低的人工智能模型。这两家前沿实验室正面临着来自价格更低、开源程度更高的竞争对手的激烈竞争。 OpenAI为其GPT-6系列模型新增了两个版本:GPT-6 Sol和GPT-6 Luna,其API使用费用相比GPT-5.6的促销价格降低了50%。其中,GPT-6 Sol适用于更复杂的任务(如编程),而GPT-6 Luna则适用于处理“高量任务”(
OpenAI发布GPT-6 Astra模型,暗示其可能具备通用人工智能(AGI)的潜质。
未来几天内面向 ChatGPT Plus、Pro、Business 和 Enterprise 用户开放。 评估结果显示,Astra的书面推理过程比GPT-5.6 Sol更难监控。
Meta 的 AI 拓麻歌子之赌……奏效了吗?
当 OpenAI 和 Anthropic 的 AI leaders 开始讨论“把控前沿发展节奏”时,也许有人应该问一句:究竟是什么节奏?如今,两家公司都迎来了模型发布周:Anthropic 推出 Opus 5.5,仅 90 分钟后,OpenAI 便更新了 GPT-6 模型。但真正抢走风头的是 Meta;据报道,其个人 AI 智能体 Muse 的早期数据正超过 ChatGPT,下一步还将登陆智能眼镜
Googlebook正式开启预订 Chromebook进入历史新阶段
Google打造的新一代笔记本平台Googlebook正式迈入市场化阶段。随着9月21日预订通道开启,这个自今年5月首次亮相的全新产品类别,正被视为Google对人工智能时代个人电脑的一次重大重构尝试。 根据Google此前发出的通知,美国地区用户将从9月21日上午9点开始预订首批Googlebook设备。首发阵容包括宏碁、华硕、戴尔、惠普和联想等合作伙伴推出的产品,首批机型预计将在今年秋季陆续发
OpenAI 年度发布会最全总结:25 个新品很夯,但额度减半拉爆了
在实力至上主义的 AI 圈,用户口碑只看产品能力和性价比。所以,随着这几天能力拉爆一切的 Opus 5.5 和 Sonnet 5.5 上线,Anthropic 那一厢可以说是勃勃生机万物竞发;而面临着压力的 OpenAI 最近又开始了谜语人模式,各种语焉不详的推文大意就是:「到 DevDay 看我们怎么还击!」今天凌晨,OpenAI 一年一度的开发者活动 DevDay 2026 终于到来。相比起往
MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务
Mozilla最新报告揭示前沿AI代差收窄:中国开源模型性能差距缩至4.4个月
国际非营利技术机构 Mozilla 近日发布最新一期《开源人工智能现状报告》(State of Open Source AI)显示,美国硅谷顶尖科技巨头的闭源前沿 AI 模型与来自中国科技企业的顶尖开源权重模型之间的性能代差已大幅缩窄至仅约 4.4 个月。这一极小的时间差距与巨大的使用成本反差,正在促使全球越来越多企业在处理日常业务时,将高性价比的开源模型作为首选生产力工具。 该报告系统性比对了全
Anthropic已限制华为AI芯片使用Claude Opus 5.5开发前沿模型
Anthropic最新推出的Claude Opus 5.5除了带来模型能力提升之外,还被发现加入了一套针对前沿大语言模型开发场景的特殊限制机制。当用户利用Opus 5.5为新一代AI模型开发底层内核时,系统可能不会直接使用最新的Opus 5.5,而是自动回退到能力较低的Opus 5。更值得注意的是,目前发现这套限制似乎同时针对华为和亚马逊的部分AI加速器。 Anthropic在Opus 5.5的支
GPT-6,“强拆”App的墙
过去三天,全球三家头部模型公司接连更新了自己的前沿模型。重点依然是更强的Coding、更复杂的推理、更长时间的Agent任务,但是背后还有一个更值得关注的趋势,Computer Use、Browser和Tool Use,越来越成为一套统一的环境交互能力。 以前,AI如果想调用一个软件,软件提供I,模型调用工具;软件运行在网页里,AI操作浏览器;第三种,像人一样看屏幕、点鼠标、敲键盘。 但是在过去很
Anthropic发布警告:开放权重模型GLM-5.3具备自主开发网络漏洞能力,安全护栏极易被绕过
Anthropic研究人员发布了对智谱AI的GLM-5.3的评估,发现该开放权重模型具备自主开发端到端软件漏洞利用的高级能力。 在ExploitBench等基准测试中,GLM-5.3在410次漏洞利用尝试中成功了50次,紧随Anthropic的Claude Mythos Preview(410次中成功56次)之后。 与受限的前沿模型不同,GLM-5.3内置的安全护栏可通过“消融”技术以极低的算力成
谷歌向关键基础设施机构承诺:我们的人工智能扫描器不会作恶,保证
谷歌通过其“善意扫描”(Scan for Good)计划搭上了为关键系统提供人工智能防御的顺风车,并表示其威胁搜寻模型已经自主发现了医院、某市政府、公共铁路运营商以及各大技术提供商的关键安全问题。所以,不要害怕这些机器人。 该计划于周四宣布,使用了谷歌的Gemini 3.8 Flash Cyber(该模型是专为软件漏洞搜寻和修复进行微调的版本)以及Wiz的Red Agent(这是这家归谷歌所有的云
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
阿里Qwen4和下代视频模型训练中,Qwen4.5后模型将扩展至5-10T参数
IT之家 9 月 22 日消息,IT之家今日从 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进已初步进入模型训练、推理及芯模协同等环节中,基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新
Anthropic发布Opus 5.5,价格更低,性能达到Fable级别
Anthropic 公司的最新模型 Opus 5.5 于周二正式发布,该公司表示,该模型在编码能力和知识处理性能方面达到了新的行业标准。在 Anthropic 的三款 Claude 系列模型中,Opus 是功能最强大、价格也最高的模型;Sonnet 位于中间位置,而 Haiku 则是速度最快、价格最低的模型。值得注意的是,Anthropic 表示,Opus 5.5 在许多测试基准测试中的表现均优于