搜索结果
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
刷屏全球的AI新顶流Jev,一句话都不说,到底怎么玩?
爱范儿下载客户端 独家抢先看2026年09月20日 17:49:34 来自北京 各类新模型层出不穷,恨不得向全世界证明自己能写、能聊。然而,近期风头最劲、刷屏全网的顶流,却是 Jev。它并不说话。 Diogo Almeida 是 OpenAI 的研究员,他参与了 ChatGPT 的研发工作,后来又提出了基于人类反馈的强化学习算法(RLHF)。这在某种程度上定义了过去几年大语言模型的走向。可是就在这
GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地
DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为
DeepSeek被曝冲刺5000亿元估值!年化营收达67亿
智东西9月24日消息,据外媒The Information今日报道,两名直接知情人士透露,DeepSeek目前的年化营收运行率已经达到10亿美元(约合人民币67.13亿元),较几个月前不足5亿美元的水平翻了一倍以上。 这一最新数据被曝是由DeepSeek创始人兼CEO梁文锋在近期一次投资者会议上披露。近期模型涨价叠加持续增长的市场需求,共同推动了DeepSeek营收提升。 与此同时在敲定新一轮融资
果蝇大脑成功接上了ChatGPT
“我闻到醋和酵母的味道。我尝到糖。又暖又亮。我该怎么做?”这句话,来自一颗果蝇大脑的放电。13.8万个神经元一齐发出的脉冲,被一个翻译器逐个解码成词,拼成句子,一字不改,发给了ChatGPT。就在昨天,开发者@chetaslua宣布,他把一整颗果蝇大脑模拟接上了ChatGPT。1500万个连接,一次一个脉冲地跑完,在一台MacBook上。 没有神经芯片,也没有GPU。工具只有NumPy和一份连接组
Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔
Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv
特斯拉推送2026.26.200.11软件更新:为更多车型上线豆包大模型
IT之家 9 月 18 日消息,特斯拉昨日发布了最新的 2026.26.200.11 版软件更新,已开始分批推送。本次升级涵盖豆包大模型、宠物模式、导航、辅助驾驶、媒体应用及安全修复。 特斯拉车机新增豆包大模型语音助手(需开通高级车载娱乐服务),可提供实时信息并进行自然对话(可选灵动女声薇薇、沉稳男声云舟等音色,以及万事通、音乐爱好者、故事会等角色)。 宠物模式允许用户在“控制 > 显示 &
深度求索称新款 Flash 人工智能模型在网络安全和编程基准测试中击败 Kimi K3
深度求索(DeepSeek)发布了 V4.1 Flash 模型,宣称其性能超越了上一代旗舰产品,同时降低了推理成本并提升了运行速度——这是中国激烈的价格与性能大战中的又一最新举措。 这家中国人工智能开发商周四表示,V4.1 Flash 采用了全新的“因果-编码器-解码器”(Causal-Encoder-Decoder)架构。尽管它构建于 5520 亿参数的大规模框架之上,但采用了混合专家(MoE)
谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步
谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
DeepSeek披露智能体训练平台 提升效率并降低失控风险
中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新