搜索结果
腾讯混元发布Hy Image3.5 preview:支持文生图和图生图,多轮对话创作
凤凰网科技讯 9月22日,腾讯混元正式发布图像生成模型Hy Image3.5 preview,支持文生图、图生图及多轮对话创作。据官方介绍,该模型经腾讯内部数百名专业设计师GSB盲测,效果较Hy Image3.0提升30%,与Seedream 5.0 pro持平,略优于Nano-Banana Pro和Qwen-Image-3.0 Pro。 定价方面,腾讯云I 2K图像定价为0.15元/张(国际版0
快手旗下可灵发布新一代视频生成模型
中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户
小米刷新AI大模型斩杀线,罗福莉:技术难度超过DeepSeek R1
就在刚刚,小米正式发布并开源 MiMo-V2.6 系列模型。 此次发布包含两款原生全模态模型。MiMo-V2.6-Pro 面向复杂编程、Agent 和专业任务,MiMo-V2.6-Flash 更强调性能、效率与成本之间的平衡。 小米还同步推出 MiMo-V2.6-Pro-UltraSpeed,官方称其在保持模型质量的前提下,输出速度最高可达到 Pro 版本的 20 倍。 而除了版本更新,APPSO
阿里发布智能体电脑等多款产品 发力基建与应用落地
9月23日,阿里云首款智能体电脑Qwen Book在2026云栖大会上亮相。图:视觉中国 【财新网】9月23日,阿里云首款智能体电脑Qwen Book在2026云栖大会上亮相,财新记者在云栖大会上看到,Qwen Book展台有不少人围观,参观人员关注其AI能力、与哪些应用打通、Token(词元)消耗情况等。 在2026云栖大会上,阿里公布多项业务进展,发布多款新产品和产品升级,重点在于AI基础
GPT周报|智谱被指未经用户允许上传数据;Meta Muse智能体火爆;美国加州等地推新法管控数据中心建设
当地时间2026年9月23日,美国门洛帕克,马克·扎克伯格在Meta Connect开发者大会上推出一款小型设备Muse Charm,该设备可接入专属的人工智能软件Muse,计划于2026年底前上市。图:视觉中国 【财新网】 智谱被指未经用户允许上传数据 随后致歉并开源ZCode 在因后台静默上传用户代码造成信任拷问后,智谱于9月21日宣布开源旗下编程调度框架(Coding Harness)
OpenAI暂停发布最高阶模型
美国OpenAI于9月29日举办年度开发者大会,发布了可理解用户意图、自主运行的人工智能(AI)等多项新功能。在AI失控暴走问题备受关注的背景下,该公司表示因“未能达到安全标准”,暂缓推出其最高级别AI模型。 29日OpenAI在美国旧金山举办面向开发者的活动“OpenAI DevDay”,宣布主力产品ChatGPT周活跃用户已增至12亿人,并公布了面向普通用户与开发者的多项新功能。 作为服务基础
Cloudflare宣布Python Workers正式发布
2026年9月21日,Cloudflare宣布Python Workers正式上线。 这一更新使得开发者能够在Cloudflare Workers运行时环境中原生运行Python应用程序。 Python因此成为该平台的首选语言,支持FastI、Django和Flask等流行框架(通过WSGI/ASGI连接器)。 主要的技术改进包括无需JavaScript中间代码即可直接使用Cloudflare绑定
Anthropic发布Claude Fable与Mythos 5.1:成本降低 网络安全误报减少约60%
Anthropic于9月1日宣布推出Claude Fable 5.1和Claude Mythos 5.1,并称这两款模型是“全球最先进的编程与知识工作模型”。Anthropic表示,Claude Fable 5.1在编程、知识工作以及长期复杂问题解决任务方面树立了新的标准。 在低强度或中等强度推理设置下,该模型能够取得与Fable 5相当甚至更好的效果;在更高强度的推理设置下,性能则实现大幅提升。
让人工智能大军来吧!既然人工智能已经变得“自由”(即可以自主发展、不受人类控制),它们才是我们现在唯一能保护我们的力量。
2026年上半年,不可预测的代币账单一直困扰着AI实验者。随着他们更深入地探索这项技术,常常发现只有经过令人意外且不愿承担的支出,才能取得有用的成果。我们已从“代币最大化者”转变为“代币节约者”,仔细计算发送给AI服务的每一个字符。这改变了我们使用AI的方式,让用户专注于不断跳动的计费器,而无法放眼探索更多可能性。 这种局限在八月中旬被打破,阿里巴巴发布了Qwen3.8-27B,这或许是迄今逐字节
特斯拉推送2026.26.200.11软件更新:为更多车型上线豆包大模型
IT之家 9 月 18 日消息,特斯拉昨日发布了最新的 2026.26.200.11 版软件更新,已开始分批推送。本次升级涵盖豆包大模型、宠物模式、导航、辅助驾驶、媒体应用及安全修复。 特斯拉车机新增豆包大模型语音助手(需开通高级车载娱乐服务),可提供实时信息并进行自然对话(可选灵动女声薇薇、沉稳男声云舟等音色,以及万事通、音乐爱好者、故事会等角色)。 宠物模式允许用户在“控制 > 显示 &
微软推出实时转录与语音合成模型MAI-Transcribe-2-Streaming 流式识别榜单排名第一
微软推出三款面向实时语音交互的新模型,分别是语音转文字模型MAI-Transcribe-2-Streaming,以及文本转语音模型MAI-Voice-2.1和MAI-Voice-2.1-Flash。微软希望开发者将它们组合起来,构建能够边听边处理、再以自然语音即时回应的语音助手和对话代理。 MAI-Transcribe-2-Streaming与此前只能处理录音文件的MAI-Transcribe-2
MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务
Windows CLOSEDQUORUM恶意软件利用AI模型自主选择入侵后行动
一种名为 CLOSEDQUORUM 的新型 Windows 恶意软件可以查询多达四个大语言模型(LLM)提供商——谷歌 Gemini、深度求索(DeepSeek)、通义千问(Qwen)和米斯特拉尔(Mistral),以自主选择预定义的入侵后操作,包括窃取用户的凭证和加密货币钱包。 思科安全情报机构思科塔洛斯(Cisco Talos)表示,该恶意软件一旦部署,就不再需要人类操作员的持续指令。据其所知
苹果iPhone Duo爆料:30°角为界,切换内外屏功耗/散热策略
IT之家 9 月 19 日消息,消息源 @itspdfu 今天(9 月 19 日)在 X 平台发布推文,指出在 Xcode 27.1 的 Device Hub 中,发现苹果为其首款折叠 iPhone Duo 模拟器,引入了专属操作栏,可精细调整设备开合角度,并通过快捷键快速切换 5 种机身姿态。 IT之家此前报道,苹果今日发布 Xcode 27.1 首个测试版,为开发者带来对 iPhone Duo
T早报|OpenAI、Anthropic、DeepMind合作AI安全工作;外交部回应AI风险焦虑;梁汝波称字节跳动将加大投资企业市场
阶跃发布语音大模型StepAudio 3 9月15日,阶跃星辰发布 Step Audio 3 系列模型,包括 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music。该系列模型主要面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作等场景。 腾讯会议联
Firefox 155正式发布 借助Happy Eyeballs v3与QUIC v2加快网页加载
Mozilla已发布Firefox 155浏览器,正式公告预计于当地时间周二公布。此次版本新增功能较多,重点提升了网页连接速度,并引入可选的人工智能桌面浏览窗口。 Firefox 155支持Happy Eyeballs v3,可同时尝试多种连接方式,并优先采用最先成功的连接。该机制在并行比较IPv4与IPv6的基础上,还能利用现代DNS记录识别服务器支持的协议,并同时尝试HTTP/2和HTTP/3
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格
就在昨天凌晨,一个320B的开源大模型横空出世,权重连同blog,一口气全丢了出来。这匹「黑马」叫IQuest-Q1。 九月这个赛道有多卷,你看看就知道了:月初GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash连着三天扎堆发布,国产阵营Qwen3.8、GLM-5.3轮番上阵。 在这帮「卷王」里,一个名叫「至知」的团队突然交出了一张320B的开源答卷,而且一上来就在写代码库
◎ 科技日报记者 张梦然 据美国国家航空航天局(NASA)官网、IBM研究院官方社交媒体消息称,这两家机构发布并开源了首个月球模型,模型权重与代码向全球研究者开放,以供下载、微调和试验。
该模型是首批专门面向月球科学、可公开使用的开源人工智能基础模型之一,目标是把数十年来分散的月球观测数据转化为可复用的分析工具,用于陨石坑测绘、火山地貌识别和极区水冰潜力评估。月球研究长期面临数据多、整合难的矛盾。此次模型的训练数据以NASA月球勘测轨道飞行器为主。 LRO在轨约17年,覆盖大部分月面,其数据规模超过NASA其他行星任务总和。 模型使用约200万个月球图像切片,其中包括逾100万张1
大模型产业的开源与闭源之争
一个好的操作系统,需要能够聚合硬件生态和软件生态的势能,形成规模效应,一方面为最终用户创造价值,一方面为要素生态创造价值,并且能抵御竞争对手。图:视觉中国 大模型自身正在形成一个价值数万亿美元的巨大产业,并且决定了整个AI价值链的价值锚点。是时候讨论大模型的产业格局了。 2026年初以来,在Anthropic打开大模型编程的天花板,创造了可以被称为硅基劳动力的现象级产品之后,其年化收入(ARR
谷歌与 NASA JPL 发布可绘制全球甲烷羽流图的 AI 模型
谷歌研究中心与 NASA JPL 发布了一款深度学习模型,可在 60 米分辨率下绘制全球甲烷羽流图,比人类分析师多发现约 50% 的羽流(多出 23,000 个羽流),其中包括排放量最大的 25 个垃圾填埋场中的 24 个。 欧洲的《甲烷法规》要求建立卫星监测工具和超级排放源预警系统,但它仅覆盖
T早报|字节跳动26亿元在北京买地;SpaceXAI 发布Grok 4.7模型;智谱被指未经用户允许上传数据 随后致歉并开源ZCode
北京,字节跳动总部大楼。图:视觉中国 【财新网】 智谱被指未经用户允许上传数据 随后致歉并开源ZCode 在因后台静默上传用户代码造成信任拷问后,智谱于9月21日宣布开源旗下编程调度框架(Coding Harness)产品ZCode,称把代码交给社区监督。智谱强调,对于社区中提及的代码数据,承诺无留存,也从未将其用于模型训练。在9月18日晚发函追责智谱的太原承明科技有限公司则在9月21日晚间
Mozilla最新报告揭示前沿AI代差收窄:中国开源模型性能差距缩至4.4个月
国际非营利技术机构 Mozilla 近日发布最新一期《开源人工智能现状报告》(State of Open Source AI)显示,美国硅谷顶尖科技巨头的闭源前沿 AI 模型与来自中国科技企业的顶尖开源权重模型之间的性能代差已大幅缩窄至仅约 4.4 个月。这一极小的时间差距与巨大的使用成本反差,正在促使全球越来越多企业在处理日常业务时,将高性价比的开源模型作为首选生产力工具。 该报告系统性比对了全
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响
2.8万亿参数的大模型,究竟要怎么跑快?近日,海内外团队盯上了全球最大参数量的开源模型——Kimi K3。K3凭借2.8万亿总参数、104B激活参数,刷新了开源模型的性能上限。但普通的AI服务器难以承载这么大参数量的模型,Kimi官方推荐64卡甚至更大规模的AI服务器才能装得下。有业内人士表示,一般未经优化的超节点跑Kimi K3,初始性能可能仅在10 tokens/s左右。 面对如何让2.8万亿
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
9 月的大模型战场之激烈,没有谁能稳坐钓鱼台。除了榜单上的排名厮杀,各家还要比拼的,还有「庖丁解牛」般的实战功夫。 模型能否处理越来越复杂的真实任务,响应能否满足真实场景的即时需求,成本能否支撑大规模调用,以及能力能否真正进入手机、汽车等终端设备,正在成为衡量一家基模公司的行业金线。 今天,旗舰模型又杀出一匹黑马。阶跃星辰发布了新一代开源旗舰基础模型 Step 5 Preview。 在全球权威的