搜索结果
口语转录,一步到位!全国产算力语音识别模型,听得懂上下文了
智东西9月24日报道,昨日,科大讯飞推出最新语音识别大模型Spark-ASR-2.0。该模型基于讯飞语音基座大模型Spark-Audio-1.0-Preview构建,重点提升通用识别、复杂声学场景识别、上下文识别和文本流畅规范性。 值得注意的是,语音基座大模型Spark-Audio-1.0-Preview和语音识别模型Spark-ASR-2.0均基于全国产算力展开训练。讯飞正在以多年积累的智能语音
千问同声传译大模型Qwen3.8-LiveTranslate正式发布
凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;
阿里千问发布Qwen-Audio-3.1系列语音大模型,全线降价最高达95%
千问今日正式发布Qwen-Audio-3.1系列语音大模型,对语音识别、语音合成和实时语音交互三大核心模型进行全面升级同时推出全新的音频创作模型Qwen-Audio-3.1-TTS-Next和音频理解模型Qwen-Audio-3.1-ASR-Next。官方称,五款新模型形成覆盖“理解-生成-交互-创作”的完整音频能力栈。为进一步降低使用成本,Qwen-Audio全线语音模型价格均下调,其中TTS降
【周刊提前读】中国AI应用催生海量算力需求 国产芯片你追我赶崛起中
人工智能(AI)算力需求暴增,中国产AI芯片则迎来一轮发展红利,“得产能者得客户”。 “今年全国算力需求爆发式增长,高端卡一卡难求,变成完全的卖方市场,价格不断抬升,涨幅十分惊人。”杭州市算力资源调度服务平台浙江算力科技有限公司(下称“浙江算力科技”)业务负责人告诉财新,其平台算力已租赁一空,大集群算力产品出现多家客户排队等候的情况。 浙江算力科技为杭州国资企业,通过自建和集中社会闲置算力,统一管
DeepSeek 开口说话了:灰度测试上线,支持四种音色
同时,DeepSeek的设置页面语音栏里会出现“朗读音色”的选项,贝壳(百变活泼)、白浪(明朗坚定)、海星(俏皮甜美)、暗潮(低沉浑厚)。 另据DeepSeek消息,DeepSeek V4.1 Flash模型于9月10日正式发布。这是DeepSeek全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek称, De
谁拿走了国产算力的利润?
中国算力产业正经历一场深层次的利润重分配。随着全国一体化算力网升格为国家级基础设施,计费逻辑从"卖机柜"转向"卖词元",产业价值链的利润重心正加速从上游硬件制造商向中游调度运营商和下游应用服务商迁移,传统以机柜规模和GPU库存为核心的竞争逻辑正在失效。 国金证券在最新产业研究报告中指出,中国日均词元调用量从2024年初的1000亿跃升至2026年3月的140万亿,两年增长超1000倍;三大运营商已
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
智谱上半年营收9.54亿元增400% 8月ARR为16亿美元
【财新网】8月31日晚,智谱(02513.HK)发布2026年半年报。财报显示,2026年上半年,公司营收9.54亿元,同比增长399.7%;期内亏损20.72亿元,同比收窄12.1%。 智谱管理层在财报发布后的业绩交流会透露,公司8月年度经常性收入(ARR)到16亿美元(约合人民币108亿元)。在不到两个月的时间内,智谱的ARR已较7月上旬的10亿美元上涨60%。 财报显示智谱商业模式变化。开放
千问办公押注的企业上下文,是 Agent 时代的组织语言
在大模型在拼命刷 Benchmark 卷编程的时候,「不能说话」的 Jev 却意外成了 AI 圈的新顶流,究其原因,大模型应用的价值正在从「生成什么」,进一步延伸到「能否理解复杂信息,并据此做出可靠判断」。放到企业办公场景里,这个问题尤为明显。 员工的一句「帮我整理报价」,背后可能同时牵涉客户历史、库存状态、折扣规则、审批权限和部门协作。AI 如果只会生成文档,却不了解这些业务背景,输出再完整,也
【市场洞察】瑞银:中国AI模型性价比突出 中美差距缩窄至3到6个月
【财新数据专稿】“中国模型在成本优势上面展现出的全球竞争力。中国的模型无论是前期的训练研发阶段,还是后期的推理、使用阶段,展现出来的性价比或者绝对的成本都还是比国外的竞品是显著低的。”瑞银互联网分析师熊玮在瑞银近期举办的2026年A股研讨会上表示。熊玮对中国模型在全球市场获取更多份额保持乐观。 模型能力持续提升,中美差距缩窄至3至6个月过去两三个月间,国内多家领先模型厂商密集发布了新一代产品。其中
腾讯元宝鸿蒙版正式上线:搭载混元Hy4 preview,支持专家模式
凤凰网科技讯 9月25日,腾讯元宝官方宣布,元宝鸿蒙版正式登陆鸿蒙应用市场。首个版本即搭载最新的混元Hy4 preview模型,并支持切换到“专家模式”,全量开放AI写作、语音通话、精准识图、拍照翻译、文档精读等核心功能,同时接入微信公众号与视频号等腾讯生态信源。 据官方介绍,混元Hy4 preview是混元系列生产力方向的最新预览版,具备较强的长链条任务理解与逻辑规划能力,专为高强度复杂办公与学
阿里巴巴发布Qwen3.8-Omni-Flash 多项表现逼近Gemini 3.8 Flash
阿里巴巴旗下Qwen团队近日发布新一代原生全模态模型Qwen3.8-Omni-Flash,进一步将音频、视频理解与AI智能体能力结合起来。该模型支持文本、图像、音频和视频四种输入形式,并提供100万Token上下文窗口。与上一代Qwen3.5-Omni-Plus相比,Qwen官方称其在29项基准测试中的平均成绩提升超过25%,同时大幅降低了音频和音视频处理成本。 Qwen3.8-Omni-Flas
云端商业化提速,智谱上半年营收同比增近400%,开放平台及API收入暴增2736%|财报见闻
北京智谱华章科技股份有限公司8月31日发布上市后首份中期业绩公告。截至2026年6月30日止六个月,公司实现总收入9.54亿元,同比增长399.7%;同期净亏损收窄至20.7亿元。 收入高速增长的同时,公司业务结构也发生明显变化。报告期内,开放平台及I业务收入达到8.25亿元,同比增长2735.7%,占总收入的比例由去年同期的15.2%提升至86.5%;同期,企业级通用大模型(本地化部署)收入由1
谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题
IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf
中国算力崛起.二|每秒5000P的算力——算多还是少?算强还是弱?
近年国家智算产业全面崛起——论资源,西部有源源不绝的绿电与建设算力中心所需的优越自然条件,撑起「东数西算」大布局;论产业生态,主打创科的城市早已孕育出月之暗面、DeepSeek等成熟大模型企业。反观香港,不仅缺乏成熟的AI产业链,更面临昂贵电价与成本负担。尽管如此,刚刚发表的《「一五」规划》和《2026年施政报告》表明将会「强化算力基础设施」,「打造香港成为区域先进数据及算力枢纽」。那么,香港的智