搜索结果
小米刷新AI大模型斩杀线,罗福莉:技术难度超过DeepSeek R1
就在刚刚,小米正式发布并开源 MiMo-V2.6 系列模型。 此次发布包含两款原生全模态模型。MiMo-V2.6-Pro 面向复杂编程、Agent 和专业任务,MiMo-V2.6-Flash 更强调性能、效率与成本之间的平衡。 小米还同步推出 MiMo-V2.6-Pro-UltraSpeed,官方称其在保持模型质量的前提下,输出速度最高可达到 Pro 版本的 20 倍。 而除了版本更新,APPSO
罗福莉带小米登顶全球开源榜首!大规模RL立功,斩杀Grok 4.7
大模型江湖变天了。MiMo V2.6 Pro在Artificial Analysis智能指数(AA Intelligence Index v4.3)中拿下 46 分,超过Kimi K3和Qwen3.8 Max。全球开源模型第一、国产模型第一! 拉出AA榜单横着看:Fable 5.1得分53,GPT-6 Astra得分52.8,Opus 5得分50.7。 MiMo V2.6 Pro虽然还没追平这几位
罗福莉也学雷军玩直播!小米新模型训练首次公开,一小时狂烧20万
就在刚刚,小米 MiMo 团队公布了最新进展。小米 MiMo 负责人罗福莉在 X 平台发文表示,强化学习(RL)还能扩展到什么程度。 她透露,目前 MiMo-V2.6 正处于 RL 训练过程中,团队正在扩大三个方向的规模,包括计算资源、训练环境与任务体系,以及奖励评估机制。未来几周,小米 MiMo 团队将陆续公开更多技术细节。 与此同时,罗福莉还分享了 MiMo-V2.6 的实时训练页面,让外界首
深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3
深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)
【市场洞察】瑞银:中国AI模型性价比突出 中美差距缩窄至3到6个月
【财新数据专稿】“中国模型在成本优势上面展现出的全球竞争力。中国的模型无论是前期的训练研发阶段,还是后期的推理、使用阶段,展现出来的性价比或者绝对的成本都还是比国外的竞品是显著低的。”瑞银互联网分析师熊玮在瑞银近期举办的2026年A股研讨会上表示。熊玮对中国模型在全球市场获取更多份额保持乐观。 模型能力持续提升,中美差距缩窄至3至6个月过去两三个月间,国内多家领先模型厂商密集发布了新一代产品。其中
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
【周刊提前读】AI竞争白热化、模型超速迭代 “Kimi时刻”已来
从2月到8月底,中国AI(人工智能)大模型公司月之暗面(Kimi)在私募市场的投前估值从100亿美元涨了4倍至500亿美元;而其7月末开始的350亿美元估值的上轮融资刚刚交割,募资额35亿美元——这意味着,仅仅一个月,月之暗面的估值又涨了150亿美元。 另一家中国大模型公司DeepSeek(深度求索)更是抢手,其在7、8月间启动的第二轮融资谈判,放出的投前估值接近5000亿元人民币。“一级市场能投
中国AI加码价格竞争
中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
小米开源MiMo-V2.6:融合3D空间推理、多模态感知能力
凤凰网科技讯 9月22日,小米正式发布并开源Xiaomi MiMo-V2.6系列,包含Pro与Flash两个原生全模态模型。官方称这是其探索RSI(递归自我改进)路径的关键一步,通过规模化扩展强化学习算力,让模型在持续探索与反馈中拓展智能边界。 跑分方面,MiMo-V2.6-Pro在Artificial Analysis综合智能指数中取得46分,超过Kimi K3和Qwen3.8 Max,成为当前
DeepSeek涨价不足1月又宣布最高降价6成
| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调
小米发布 MiMo-V2.6,Pro 与 Flash 双模型全面开源
9 月 22 日,小米 MiMo 团队正式发布并开源 MiMo-V2.6 系列,包括 Pro 和 Flash 两款原生全模态模型。本次升级重点扩大强化学习规模,并加强代码、Agent、多模态和计算机操作能力。 小米公布的数据显示,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index 上取得 46 分。经过近 6 天的强化学习训练,Pro 在
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘
RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号
AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
9 月的大模型战场之激烈,没有谁能稳坐钓鱼台。除了榜单上的排名厮杀,各家还要比拼的,还有「庖丁解牛」般的实战功夫。 模型能否处理越来越复杂的真实任务,响应能否满足真实场景的即时需求,成本能否支撑大规模调用,以及能力能否真正进入手机、汽车等终端设备,正在成为衡量一家基模公司的行业金线。 今天,旗舰模型又杀出一匹黑马。阶跃星辰发布了新一代开源旗舰基础模型 Step 5 Preview。 在全球权威的
Meta推出带有增强AI功能的订阅服务
平均6天一个新旗舰 大模型更新快到人类跟不上了
太疯狂了,短短两天,竟然冒出了4个新模型!前脚,老马的xAI才刚发完Grok 4.7。紧接着,OpenAI突然甩出GPT-6 Sol和Luna,价格直接腰斩。同一天,Anthropic也把Claude Opus 5.5拍在了桌上,比上一代硬生生便宜40%。9月22日,一张动图在X上被转疯,浏览量狂飙近百万。 2023年,大模型73天一更,到了2026年,18天一更。从ChatGPT上线算起,Ope
Meta发布更强大AI模型,逼近竞争对手
Meta Platforms Inc.发布了其迄今最强大的人工智能模型,其首席AI官表示,该模型的能力正日益接近顶尖竞争对手。
华尔街见闻早餐FM-Radio | 2026年9月8日
中国央行连续22个月增持黄金,8月购金节奏进一步加快。 适时启动6G商用,到2030年智能算力规模达9800 EFLOPS。 小米推出首款“中折叠”旗舰手机小米18 Fold,10999元起售,披露造芯累计投入210亿元。华为发布首款“韬定律”逻辑折叠芯片手机Mate XT 2三折叠手机,起售19999元。长鑫LPDDR6芯片率先实现旗舰手机端首发量产,首发搭载小米18 Fold。 摩尔线程20%
马斯克提出AI安全新思路:与其等政府出手,不如让竞争对手互相"找茬"
AI安全风险正在从实验室讨论走向现实世界。随着模型能力不断提升,AI不仅能够生成文本和代码,也开始具备自主执行任务、调用工具,甚至发起网络攻击的能力。 让主要AI公司在模型发布前相互测试彼此的模型。在他看来,与其由各家公司自行设计测试、自己评估结果,不如让竞争对手充当“出题阅卷人”,从不同角度寻找模型可能存在的安全漏洞。 近期AI安全风险不断成为市场关注焦点,马斯克此前在社交媒体上曾直言“Dari
DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片
快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参
一家手机制造商如今拥有了全球顶尖的开源权重AI模型
关键信息:这款名为 MiMo-V2.6 的模型采用了“开放权重”(open-weight)架构,其所有源代码均已公开。 小米的发布声明:周二,小米在发布 MiMo-V2.6 时强调了这一关键特性。这家手机和电动汽车制造商基于 MIT 的许可协议,推出了两款基于该模型的产品:Pro 和 Flash。这些模型的源代码托管在 Hugging Face 平台上。 性能评估:根据基准测试机构 Artific
88小时抵一个人思考4000年!OpenAI核心研究员:除了自我进化,更可怕的是AI正学会“隐藏自己”
AI正在把过去需要数千年完成的认知劳动压缩到数天。真正的问题已经不只是模型能否变得更聪明,而是实验能否跟上、人类能否在模型继续自我改进前确认它仍然安全。 近日,在Dwarkesh Podcast的一场长篇访谈中,主持人Dwarkesh Patel与OpenAI研究员Noam Brown围绕多智能体、递归式自我改进(RSI)和AI对齐展开讨论。访谈的直接背景,是OpenAI让约1万个AI智能体连续运
Anthropic CEO谈放缓AI研发:这个行业撒谎太久了,AI风险是真实的,但也无需“把一切都关掉”
就在全球AI三大巨头罕见联手呼吁“放缓AI研发”的同一个周末,Anthropic CEO Dario Amodei坐到了CBS的镜头前,说出了AI可能对人类带来的风险。 Amodei表示,已有人尝试利用AI研发生物武器、增强病毒传染性,这是他每天醒来都要面对的事情。 就在两天前,我们发布了一份报告,内容是关于有人滥用AI模型来研发生物武器。我每天早上醒来都会读到这类威胁报告——有人试图用我们的模型