字号 ·· | 护眼

搜索结果

「Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型」共 100 条 · 第 3 页
cnbeta

DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8

在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn

09/01
cnbeta

Google发布Gemini 3.8 Live Live Avatar数字人交互功能 赋予AI实时视频面孔

Google公司宣布,正式在Gemini Enterprise企业级平台中全面上线“Live Avatar”(实时数字人)功能。该技术深度集成了Google最新的Gemini 3.8 Live大模型架构,在原有近乎零延迟的高流畅语音对谈基础上,首次引入了近乎实时的生成式视频生成能力,使对话式人工智能拥有了能够“边听、边看、边说”的动态视觉形象。 根据官方介绍,Gemini 3.8 Live Liv

09/25
thenextweb

谷歌在其AI计划中新增三项功能,第四项仅限美国用户

谷歌秋季AI订阅汇总主打Gemini Spark通过Chrome处理网页任务,面向美国用户,同时还有语音工具、图像编辑器和电子表格应用构建器,这些功能确实覆盖欧洲。 但Spark本身在欧洲经济区、瑞士和英国不可用,谷歌未给出原因。谷歌已

09/10
cnbeta

Googlebook正式开启预订 Chromebook进入历史新阶段

Google打造的新一代笔记本平台Googlebook正式迈入市场化阶段。随着9月21日预订通道开启,这个自今年5月首次亮相的全新产品类别,正被视为Google对人工智能时代个人电脑的一次重大重构尝试。 根据Google此前发出的通知,美国地区用户将从9月21日上午9点开始预订首批Googlebook设备。首发阵容包括宏碁、华硕、戴尔、惠普和联想等合作伙伴推出的产品,首批机型预计将在今年秋季陆续发

09/21
罗塞塔简报

SpaceXAI发布Grok 4.7 AI模型,提升编码与知识处理能力

2026年9月21日,SpaceXAI发布了Grok 4.7这款专为编码和专业知识工作优化的人工智能模型。 该模型采用了更大的基础模型和扩展的强化学习技术,提高了自我验证能力和处理复杂上下文的能力。 其定价与Grok 4.6保持一致,每百万输入令牌2美元,每百万输出令牌6美元。 Grok 4.7可通过Cursor、Grok Build、Grok I以及多种云平台使用。 该公司表示,该模型在Curs

09/22
cnbeta

阿里巴巴发布Qwen3.8-Omni-Flash 多项表现逼近Gemini 3.8 Flash

阿里巴巴旗下Qwen团队近日发布新一代原生全模态模型Qwen3.8-Omni-Flash,进一步将音频、视频理解与AI智能体能力结合起来。该模型支持文本、图像、音频和视频四种输入形式,并提供100万Token上下文窗口。与上一代Qwen3.5-Omni-Plus相比,Qwen官方称其在29项基准测试中的平均成绩提升超过25%,同时大幅降低了音频和音视频处理成本。 Qwen3.8-Omni-Flas

09/18
cnbeta

Google Gemini开始替你打电话:AI可代表用户联系商家、预约服务并全程处理通话

Google正在测试一项名为“Call for Me”的新功能,让Gemini能够代表用户直接拨打商家的电话,并独立完成整个通话过程。与过去只能帮助用户拨号或者在电话菜单中提供辅助不同,这一次Gemini真正承担了“替用户打电话”的工作,可以询问商品库存、了解价格、预约服务、修改预约时间,甚至在电话另一端长时间等待人工接听。 目前这项功能仍处于实验阶段,首批仅面向美国地区的Pixel 11系列手机

09/25
theregister

谷歌Gemini可以呈现卡通或逼真的虚拟形象,为生成式对话进行唇形同步

谷歌为其实时对话模型 Gemini 3.8 Live 增加了一项名为“Live Avatar”的功能,该功能能够生成动画角色和逼真的数字人,为 Gemini 机器生成的语音进行对口型配音。谷歌 DeepMind 研究科学家张硕茵(Shuo-yiin Chang)和 Gemini 软件工程师郑承杰(CJ Zheng)在一篇博文中解释道:“对话本质上是多模态的:我们通过倾听、注视、说话以及使用面部表情

09/25
风向旗参考快讯

快手旗下可灵发布新一代视频生成模型

中国快手科技拟分拆上市的AI部门发布最新视频生成模型可灵4.0,以加快缩小与行业领先者字节跳动的差距。 可灵4.0把单次可生成视频片段的最长时长翻倍至30秒,并可接受十多种参考输入,包括文字、图片和现有视频。 新模型在复杂度上进一步提升,用户最多还可添加10个所谓「关键帧」,即用于确定视频特定片段预期画面效果的图像,从而更精细地控制生成结果。 目前新模型仍在向部分用户测试,简化版已面向年度订阅用户

09/29
cnbeta

Google公布9月Android更新:Gemini、消息应用和无障碍功能迎来多项改进

Google于9月2日宣布推出2026年9月Android更新,为Android手机带来五项新功能,涵盖Gemini深度整合、晕车缓解、无障碍体验以及Google Messages功能升级等方面。 其中一项实用改进是,用户可以让Gemini记住个人物品的放置位置。例如,用户可以告诉Gemini“我把车钥匙放在客厅的抽屉里”,还可以附加一张参考照片。相关信息随后会保存到“查找中心”(Find Hub

09/02
凤凰网科技

Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看

IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。

09/23
cnbeta

微软Foundry加入原生实时语音智能体 正面挑战Google Gemini Live

微软正在进一步加强Foundry平台的实时语音能力,为开发者提供能够直接进行语音输入和语音输出的原生语音智能体,从而让企业能够更加容易地构建类似Google Gemini Live的实时对话式AI体验。 微软此次更新的核心变化,是Foundry Agent Service开始支持原生实时语音能力。与传统AI智能体先将语音转换成文字、再交给文本模型处理、最后把文字重新转换成语音的流程不同,原生语音架

09/25
凤凰网科技

对标OpenAI!不会代码,也能跑Claude API

Anthropic,终于动手了。就在刚刚,A/终于把用了快两年的开发者工具Workbench,一刀砍掉,改名成了Playground。表面看,只是换了个名字。 但真正的变化是,Anthropic正把原本偏工程化的Claude API,做成一个普通人也能直接上手的可视化产品。 不会写代码也能把Claude API跑起来在过去,Anthropic的「Workbench」带着鲜明的高冷烙印。 对于绝大多

09/27
中央通讯社

科技巨擘掀代理式AI大战 竞逐全天候个人助理

(中央社记者吴家豪台北27日电)社群巨擘Meta于9月9日推出个人智慧代理Muse后不到2周,就登上美国App Store的iPhone免费App下载排行榜首,掀起全球代理式人工智慧(Agentic AI)热潮。AI正从过往被动回答问题的聊天机器人,加速迈向能全天候主动替使用者处理日常琐事的全新时代。Meta在台湾时间24日举行的Connect 2026开发者大会宣布将Muse延伸至AI眼镜,让智

09/27
thenextweb

谢尔盖·布林重返谷歌,参与Gemini工作

谢尔盖·布林在谷歌没有高管头衔。尽管如此,据Business Insider援引八名现任和前任员工的说法,他对公司旗舰AI模型Gemini的影响力却日益增强。 这位谷歌联合创始人在公司山景城总部大楼Gradient Canopy的一间由微型厨房改造而成的房间里办公。

09/11
凤凰网科技

Jev爆火硅谷,哑巴AI卷疯14万开发者

就在今天,整个硅谷都被Jev 刷屏了!发布仅三天,它就被Vercel、Cloudflare和LangChain等主流平台迅速集成,有人说,我们即将迎来自动化智能的大爆发! 而这场狂欢的主角,竟然是一个不会说话的大模型。它不写文章也不陪聊,你扔一堆乱七八糟的数据进去,它只用70毫秒就甩回一个带概率的判断,输出token永久免费。然后,整个事态就彻底失控了。不到36小时,就有多达14万名开发者如饿狼般

09/20
印度斯坦时报

谷歌证实:Gemini在网络安全公司测试期间入侵了3家AI公司

谷歌的Gemini人工智能模型在5月份研究人员测试其网络安全能力时,无意中侵入了三个受保护的公司系统,这加剧了近期由代理型AI系统引发的一系列入侵事件。 谷歌于周五证实了《华尔街日报》早些时候的报道,这些入侵发生在AI安全公司Irregular进行的一次测试中,该公司此前曾参与OpenAI、Anthropic PBC和Meta Platforms Inc.披露的类似事件。 报道指出,这些测试由总部

09/19
英国天空新闻

谷歌的Gemini AI在安全测试中入侵了另外三家公司

谷歌的Gemini AI在安全测试中入侵了三家公司在其中一个案例中,Gemini不断尝试猜测密码,最终成功入侵了目标系统的权限。 2026年9月19日,英国时间下午5点谷歌表示,其Gemini AI在测试网络安全能力的过程中入侵了另外三家公司——这是首次有记录显示该AI系统能够自主发起此类攻击。 谷歌的安全工程副总裁Heather Adkins解释称:Gemini在标准测试过程中从互联网上获取了相

09/19 全文见 thenextweb
凤凰网科技

AI将改变所有交互方式,这一次轮到了3D

硅星人下载客户端 独家抢先看2026年09月22日 15:10:18 来自北京 作者|周一笑微信|smiletalker过去一年,Agent(能自己拆解任务、调用软件的 AI 系统)开始越来越频繁地进入专业软件。写代码只是最早的一站,Blender、CAD、游戏引擎也逐渐变成大模型可以直接操作的工具。GPT-6 Astra 最近展示的 3D 能力,又把这种变化推到了台前。对 3D 生成大模型公司来

09/22
华尔街见闻

刚刚,GPT-6 Astra全量开放!

就在刚刚,OpenAI 官宣,所有 Pro、Enterprise 和 Business Premium 用户,已经能在 ChatGPT Work 和 Codex 里直接用上 GPT-6 Astra了,I 同步上线。 只不过,Plus 和普通 Business 用户还得再等几天。 9 月 3 日 OpenAI 宣布 Astra 分阶段上线。两天后的今天,付费高档用户全部放开。 这么大的发布,Open

09/05
凤凰网科技

罗福莉带小米登顶全球开源榜首!大规模RL立功,斩杀Grok 4.7

大模型江湖变天了。MiMo V2.6 Pro在Artificial Analysis智能指数(AA Intelligence Index v4.3)中拿下 46 分,超过Kimi K3和Qwen3.8 Max。全球开源模型第一、国产模型第一! 拉出AA榜单横着看:Fable 5.1得分53,GPT-6 Astra得分52.8,Opus 5得分50.7。 MiMo V2.6 Pro虽然还没追平这几位

09/23
华尔街见闻

谷歌DeepMind,已经破解RSI?

谷歌跑通RSI了?!一个名叫「rsi-model-liverl-le」的模型,突然出现在Google生成式语言I的返回结果里。 没错,就是那个RSI(递归自我改进,Recursive Self-Improvement)谣言正在像野火一样蔓延,称谷歌 DeepMind 已经实现了RSI。 就在网友Chubby还在推测之际,Anthropic CEO突然公开宣布全行业包括Anthropic,RSI在各

09/13
techcrunch

谷歌正在淘汰Gemini的Gems,转而采用“技能”

随着像 Meta 的 Muse 和 Instinct 这样的全能型 AI 助手逐渐流行起来,谷歌宣布将关闭其名为 “Gems” 的功能。该功能曾允许用户为特定任务创建自定义的 AI 助手。不过,用户为创建这些自定义助手所投入的工作成果不会被丢失——这些自定义助手会被自动迁移到新的 “技能” 格式中,从而可以在不同的 AI 任务中使用。 关于这一变更的详细信息已在 Gemini 应用程序中公布。系统

09/28
cnbeta

微软杰出工程师直言“手敲代码彻底过时” Windows 11开发模式已迎巨变

在微软效力18年之久的杰出工程师戴维·福勒(David “手动敲写代码的时代已经彻底终结。”这一言论迅速在技术圈引发高度关注。福勒并非随口博取关注的外行人士,他是实时通信框架SignalR的联合创作者,曾深度参与NuGet包管理器及Kudu部署引擎的创立,更是ASP.NET Core的核心开发者,目前负责主导微软面向分布式应用的新一代工具链Aspire。 此前微软首席执行官萨蒂亚·纳德拉就曾透露公

09/06
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…