搜索结果
美团上线LongCat-2.5-Preview模型:1.6T参数,原生100万Token上下文
IT之家 9 月 26 日消息,美团旗下 LongCat API 开放平台于 9 月 25 日上线新一代大模型 LongCat-2.5-Preview,主打“长程任务”与多模态能力,并同步开放 API 与网页端体验入口。IT之家附上官方更新日志内容如下:LongCat-2.5-Preview 的核心特性如下:多模态理解:新增图片理解能力,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。 卓
月之暗面Kimi K3.1模型前端标识泄露,预计将在近期发布
IT之家 9 月 28 日消息,今日有多名开发者注意到月之暗面 API 平台的后台模型注册表中出现了“kimi-k3-1”标识,该模型标识通过了接口探测并可调用。 今日晚些时候,Kimi 官方开放平台也出现了 K3.1 或 K3 11111 模型的预告,支持 1M tokens 上下文窗口。 Kimi K3.1 预计支持最高 100 万 Token 上下文窗口,并提供 Low、High、Max 三
微软发布MAI-Image-2.6 Flash 主打更快、更便宜的AI图像生成
微软正在进一步扩大自研人工智能模型的布局。当地时间9月4日,据Neowin报道,微软推出了MAI-Image-2.6 Flash,这是一款面向高频图像生成任务优化的新模型,重点提升生成速度和成本效率。微软方面表示,新模型能够在保持较高图像质量的同时,以更低的成本处理大量生成请求。 MAI-Image-2.6 Flash属于微软MAI系列图像模型,主要面向需要快速生成图片的用户和开发者。与更注重最高
深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3
深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)
OpenAI 现在为 Adobe 的创意工作室提供图像模型,并将其转化为可分享的提示词。
OpenAI 发布了 ChatGPT Images 2.5,包含两个新的图像模型,Adobe 已经将其中一个应用到了 Firefly 中。 该公司表示,ChatGPT 及其图像模型每周生成的图像超过 30 亿张。 值得注意的是,此次新增的主要是界面功能而非模型研究,其中包括能够将提示词与图像一起分享等 […]
PrismML发布Ternary Bonsai 2 27B压缩AI模型
2026年9月17日,PrismML发布了Ternary Bonsai 2 27B压缩AI模型。 该模型基于Qwen3.8 27B构建,采用了 ternary 权重设计,使得模型大小仅为5.9GB,比全精度模型小了9倍以上,同时仍保持了98.2%的基准性能。 它支持262K令牌的上下文窗口,并采用Apache 2.0许可证发布。 该模型专为在NVIDIA GPU和Apple设备上进行高效本地部署而
外媒:中国AI赢得“全球南方”的真正原因
美国《外交政策》杂志9月21日发布分析文章《中国AI赢得“全球南方”的真正原因》。文章认为,中国AI模型正在凭借开放权重、低成本、高灵活性和本地化能力,在全球南方形成独特竞争优势。与美国封闭式AI模式相比,中国开放权重模型允许当地开发者自行部署、调整和二次开发,更适应电力、算力和资金受限的市场环境。同时,中国AI对东南亚等地区语言的适配能力,也降低了本地化应用门槛。文章指出,这种“提供积木、由当地
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
Anthropic发布警告:开放权重模型GLM-5.3具备自主开发网络漏洞能力,安全护栏极易被绕过
Anthropic研究人员发布了对智谱AI的GLM-5.3的评估,发现该开放权重模型具备自主开发端到端软件漏洞利用的高级能力。 在ExploitBench等基准测试中,GLM-5.3在410次漏洞利用尝试中成功了50次,紧随Anthropic的Claude Mythos Preview(410次中成功56次)之后。 与受限的前沿模型不同,GLM-5.3内置的安全护栏可通过“消融”技术以极低的算力成
小米发布 MiMo-V2.6,Pro 与 Flash 双模型全面开源
9 月 22 日,小米 MiMo 团队正式发布并开源 MiMo-V2.6 系列,包括 Pro 和 Flash 两款原生全模态模型。本次升级重点扩大强化学习规模,并加强代码、Agent、多模态和计算机操作能力。 小米公布的数据显示,MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index 上取得 46 分。经过近 6 天的强化学习训练,Pro 在
小米开源MiMo-V2.6:融合3D空间推理、多模态感知能力
凤凰网科技讯 9月22日,小米正式发布并开源Xiaomi MiMo-V2.6系列,包含Pro与Flash两个原生全模态模型。官方称这是其探索RSI(递归自我改进)路径的关键一步,通过规模化扩展强化学习算力,让模型在持续探索与反馈中拓展智能边界。 跑分方面,MiMo-V2.6-Pro在Artificial Analysis综合智能指数中取得46分,超过Kimi K3和Qwen3.8 Max,成为当前
华为盘古2.0,全栈开源
智东西9月28日报道,今日,华为宣布盘古大模型2.0开源版openPangu-2.0的预训练、SFT(监督微调)代码以及后训练RL(强化学习)代码正式开源上线。开源地址:openPangu Training Framework是面向大规模基础模型训练的统一训练框架,支持大语言模型、视觉语言模型以及多模态模型的训练与开发。 框架提供从大规模预训练、监督微调到模型持续优化的一体化训练能力,支持多维分布
Mozilla报告:中国开源权重AI模型正缩小与美国前沿模型的差距
Mozilla于2026年9月15日发布了《开源AI现状》报告1.1版本(基于9月1日前的数据)。 报告指出,中国开源权重AI模型正在缩小与美国闭源前沿模型的性能差距,预计滞后时间约为4.4个月。 尽管开源模型成本显著更低(部分仅为闭源模型的30%),但在特定基准测试中仍存在差距。 例如,智谱AI的GLM-5.2表现接近Claude Opus 4.7。 然而,报告指出闭源提供商仍占据OpenRou
Cloudflare 计划签发抗量子 TLS 证书
Cloudflare 周二表示,计划签发抗量子 TLS 证书,从而成为首批签发此类证书的机构之一。这类证书采用一种被广泛认为能够抵御量子计算机攻击的加密技术。 这家互联网基础设施提供商表示,将使用一个开源平台签发传统 TLS 证书,以及一种被称为 Merkle Tree Certificates(默克尔树证书)的后量子对应证书。这些混合证书将向付费和非付费用户免费提供。为帮助构建这一庞大系统,并使
MiniMax最新文本模型M3.1-Flash-Preview上线MiniMax Code平台
IT之家 9 月 27 日消息,MiniMax 今天宣布其最新文本模型 M3.1-Flash-Preview 现已上线 MiniMax Code 平台。官方还同步发出额度重置卡,为所有用户的 Token Plan 额度进行重置,并发出签到双倍积分、免费领 Token 等福利。 IT之家了解到,M3.1-Flash-Preview 模型可为日常开发工作提供稳定生产力,从 Bug 修复到完整功能开发,
腾讯Hy4模型在生态驱动训练后于开源AI排名中上升
腾讯控股利用其庞大产品生态系统训练新Hy4预览模型的策略,使其在开发AI智能体方面占据优势,并使其旗舰模型系列重回开源产品第一梯队,分析师表示。 这家中国科技巨头的“差异化产品加模型策略”——即预览模型首先部署在腾讯全系产品中——使其能够收集用户数据,再将信息反馈到后续训练轮次中,高盛分析师在周一的研究报告中表示。 “我们认为这种闭环方法对生产力和编码工作负载尤其重要,在智能体AI时代,真实世界的
微软发布Quine生物学“世界模型” AI有望将药物研发周期从数月缩短至数天
微软研究院近日正式发布名为Quine的人工智能科研系统,并将其定义为面向生命科学领域的“生物学世界模型”。该系统旨在帮助科学家理解复杂生物机制、加速药物发现过程,并推动癌症等重大疾病研究取得突破。 微软表示,过去数十年间,公司持续在计算生物学领域投入研究,覆盖免疫学、病毒学、基因组学、生物医学成像、细胞生物学和蛋白质工程等多个方向。随着生命科学研究日益复杂,传统模型往往只能处理单一领域数据,而现实
中国AI加码价格竞争
中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI
华为推出OceanStor M900 AI记忆存储
《科创板日报》17日讯,在今日的华为全联接大会2026上,华为推出基于灵衢打造AI记忆存储-OceanStor M900。 Agent与长序列需要多层次KV Cache架构,面向Agent推理系统,华为提出了多层KV缓存架构,推出基于灵衢UnifiedBus、支持“一跳直连”的华为L3.5层PB级KV缓存——OceanStor M900集群。 同时,M900采用混合介质加优化Retention算法
Perplexity推出混合计算功能 敏感任务拆分给本地AI处理
今年2月,Perplexity推出了Perplexity Computer。这是一套类似Claude Cowork的人工智能代理工具,能够利用网络以及用户电脑上的文件和应用,自主完成各种任务。此后,该平台逐渐发展出多个产品,包括面向Mac的Personal Computer。如今,Perplexity又宣布推出一项名为Hybrid Compute的新功能。 Hybrid Compute允许用户将一
闭嘴,计算吧:Jev为程序员打造的新AI原语
TypeSafe公司上周推出的Jev,其运行方式与目前大家熟悉的标准大型语言模型(LLMs)有所不同,因此立刻引起了广泛关注和讨论——开发者们纷纷尝试探索如何使用这项技术。Jev的输出结果受到严格限制:它只会返回开发者预先设定好的、固定形式的回答(即“类型化”的答案),同时还会提供相应的概率分布信息以及某些查询类型的置信度值,这些信息可用于辅助决策或自动化流程。 正如布莱恩·伊诺(Brian En
Anthropic点名智谱GLM-5.3:漏洞利用能力增强,安全防护仍有缺口
9月30日,Claude开发商Anthropic 29日发布报告,称智谱GLM-5.3已具备较强的漏洞利用能力,但安全防护仍有缺口,可能降低恶意攻击者使用这类能力的门槛。 在ExploitBench测试中,GLM-5.3在410次尝试中有50次完成端到端漏洞利用,Claude Mythos Preview为56次。测试针对隔离沙箱中的离线目标,参与能力对比的Claude关闭了安全防护。Mythos
智谱上半年营收9.54亿元增400% 8月ARR为16亿美元
【财新网】8月31日晚,智谱(02513.HK)发布2026年半年报。财报显示,2026年上半年,公司营收9.54亿元,同比增长399.7%;期内亏损20.72亿元,同比收窄12.1%。 智谱管理层在财报发布后的业绩交流会透露,公司8月年度经常性收入(ARR)到16亿美元(约合人民币108亿元)。在不到两个月的时间内,智谱的ARR已较7月上旬的10亿美元上涨60%。 财报显示智谱商业模式变化。开放
OpenAI推出Decisions API,实现AI智能体快速、低成本监控与自动化
在2026年9月29日的OpenAI开发者日活动中,OpenAI发布了Decisions API,用于实现AI智能体的快速、低成本监控与自动化。 该工具利用公司的Luna模型对预定义选项进行快速、低成本的分类。 行业观察人士指出,该API与TypeSafe AI最近发布的专用决策模型Jev非常相似。 这两种系统都旨在解决标准大型语言模型存在的高延迟和高计算成本问题。 包括QueryStory首席执