搜索结果
阿里Qwen4和下代视频模型训练中,Qwen4.5后模型将扩展至5-10T参数
IT之家 9 月 22 日消息,IT之家今日从 2026 年云栖大会现场获悉,阿里巴巴公布了大模型一系列进展,大模型递归自我改进已初步进入模型训练、推理及芯模协同等环节中,基于新一代架构的 Qwen4 已在训练中,未来 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数。 同时,阿里的视频生成模型、语音模型、图像模型、世界模型、音乐模型以及全模态模型等均在当天或近期推出新版本。 阿里全新
10岁小孩姐,都能轻松给机器人编程!稚晖君连发两款万元级机器人
robot_pro)机器人前瞻9月20日报道,今天下午,启元机器人在上海一口气发布了两款面向家庭场景的个人机器人——Q1和T1。 两款产品已经正式开放购买,将于10月1日起按订单顺序陆续发货。价格方面,Q1标准版售价19999元;探索版Q1拥有开放SDK&HDK、硬件拓展接口,支持全栈二次开发、支持技能应用开发,为26999元。 T1标准版售价19999元;Pro版T1具备0rin高算力芯
亮源新创发布全身智能基础模型Light-O1:让机器人从人类视频中学会全身动作
凤凰网科技讯 9月21日,亮源新创今日发布全身智能基础模型Light-O1。该模型通过学习互联网视频中的人类动作,并结合语言和视觉信息,将人类动作知识迁移到机器人,以提升机器人全身协调与任务执行能力。官方称,该模用于预训练的人类动作数据越多,模型在适配不同机器人本体和视角后,动作预测越准确。 当前,机器人动作模型主要依赖遥操作、UMI等方式专门采集数据,成本高、周期长,覆盖不同任务还需定制采集流程
DeepSeek V4.1 Pro或为2万亿参数:未来还有8万亿版、押注国产芯片
快科技9月21日消息,此前我们分析了中秋国庆双节前后国内外要发的10多款大模型,其中最受期待的还得是DeepSeek V4.1 Pro。 跑得比较快的Theinformation网站又爆料了新的消息,DeepSeek正在训练2万亿参数量的大模型,未来还会扩展到8万亿参数量。 而且DeepSeek的大模型训练未来会押注国产AI芯片,尤其是华为的升腾系列,不过具体情况就没有细节流出了。 未来的8万亿参
中国AI大模型调用量连续十九周领跑 环比增长379%
根据OpenRouter最新数据测算,上周(8月31日至9月6日)全球AI大模型总调用量为115万亿Token,环比增长1.77%。其中,上榜的AI大模型中,中国AI大模型周调用量达56.72万亿Token,环比增长2.83%;同期美国AI大模型周调用量为16.54万亿Token,环比下滑3.1%。中国大模型周调用量连续十九周超过美国,稳居全球首位。 《每日经济新闻》注意到,上周,全球调用量排名前
T早报|OpenAI、Anthropic、DeepMind合作AI安全工作;外交部回应AI风险焦虑;梁汝波称字节跳动将加大投资企业市场
阶跃发布语音大模型StepAudio 3 9月15日,阶跃星辰发布 Step Audio 3 系列模型,包括 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music。该系列模型主要面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作等场景。 腾讯会议联
GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地
DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为