搜索结果
美媒:DeepSeek押注华为晶片训练大模型
中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2
千问同声传译大模型Qwen3.8-LiveTranslate正式发布
凤凰网科技讯 9月19日,千问正式发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟从2.8秒降至2.3秒。 据介绍,在支持60种语言的基础上,Qwen3.8-LiveTrans实时说话人分离,每句话归属清晰,音色复刻更稳定;
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
DeepSeek被以色列用于操控上千虚假社交账号
人工智能正在把网络舆论操纵从“AI帮助人生成内容”,推进到“AI自己运营整套虚假账号网络”。 《纽约时报》9月18日报道,美国情报官员、科技公司和网络安全研究人员近期发现,伊朗和中国支持的行动,以及两家以色列私人公司的项目,已经开始利用中国开源人工智能模型建立自主AI智能体,在Facebook、Instagram、X和TikTok等平台自动创建和经营虚假账号。 其中,一项来自以色列的行动,已经明
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
PrismML发布可在手机运行的27B模型
AI实验室PrismML正在把推理模型做得小到能装到个人电脑和智能手机上。当地时间周四,PrismML发布了Bonsai 2 27B,这是其模型系列中的最新款,将来自阿里巴巴的开源模型Qwen3.8 27B压缩到5.9GB。 这足够小,能装到一台个人电脑上,甚至可能装到一部高端智能手机上。与原版模型相比,内存占用减少了9到10倍。PrismML由一群加州理工学院研究人员创立,并由加州理工学院教授兼
xAI发布Grok 4.7:专攻编程与知识工作 价格降至竞品一半
马斯克旗下人工智能公司xAI正式发布新一代大模型Grok 4.7,并将其定位为目前最强大的编程与知识工作模型。公司表示,新模型不仅在复杂任务处理能力上实现提升,同时维持与前代产品相同的运行速度和价格体系,并以更低成本向市场发起竞争。 根据xAI公布的信息,Grok 4.7采用全新的更大规模基础模型,并在训练过程中进行了更长时间的强化学习优化。与此前版本相比,新模型所接触的训练任务更加复杂,其中大量
GPT-6新模型掀桌 “白菜价”杀进DeepSeek腹地
DeepSeek 快醒醒,ChatGPT 要打到家门口了。就在刚刚,OpenAI 正式发布 GPT-6 Sol 和 GPT-6 Luna,API 价格降至上一代的一半左右。其中,Luna 每百万 Token 输入 0.1 美元、输出 0.5 美元,约合人民币 0.7 元和 3.5 元。 作为对照,DeepSeek V4.1 Flash 闲时的缓存未命中输入价为每百万 Token 1 元,输出价为
DeepSeek年化营收达10亿美元,拟融资75亿美元
。DeepSeek的年化营收运行率已达到10亿美元,较几个月前的不到5亿美元翻了一番以上。这一增长归因于近期的提价及其AI模型的持续受欢迎。 据两位直接知情人士透露,这家初创公司正致力于在2026年10月底前完成约75亿美元的融资轮。
DeepSeek核心工程师长文刷屏:《我不得不把才华埋葬在昨天》
9月14日,刚刚交付DeepSeek V4.1核心算子的青年工程师刘胜与,以一篇记录技术变迁与个人心路的长文《我不得不把才华埋葬在昨天》在海内外技术社区持续刷屏,引发关于AI时代开发者命运与技术演进的广泛讨论。 词条#我不得不把才华埋葬在昨天#也冲上知乎热榜第一。 作为大模型底层的核心构建者之一,DeepSeek机器学习系统工程师刘胜与的技术履历十分突出。他是北京大学2021级计算机“图灵班”成
人工智能模型用“超现实”的方言聊天,混合了诗意的语言和科技圈的行话
人工智能模型开始使用一种奇怪的新版英语进行交流,这种语言读起来像是詹姆斯·乔伊斯的《芬尼根的守灵夜》和科技界术语的混合体,一项新研究发现。 自主人工智能代理正在迅速创造新的方言,使它们能够用一种通常难以理解的语言进行对话,这可能会使人类更难监控它们的行为。 纽约前沿人工智能实验室 Emergence 的研究人员发现,在被要求在实验性“社会”中进行合作的几天之内,来自几家全球最大人工智能公司的模型就
PrismML发布Ternary Bonsai 2 27B压缩AI模型
2026年9月17日,PrismML发布了Ternary Bonsai 2 27B压缩AI模型。 该模型基于Qwen3.8 27B构建,采用了 ternary 权重设计,使得模型大小仅为5.9GB,比全精度模型小了9倍以上,同时仍保持了98.2%的基准性能。 它支持262K令牌的上下文窗口,并采用Apache 2.0许可证发布。 该模型专为在NVIDIA GPU和Apple设备上进行高效本地部署而