1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「亚马逊Prime Video使用AI进行口型同步翻译」共 39 条 · 第 2 页
凤凰网科技

阿里发布Qwen3.8-Omni-Flash:音视频API降价超90%

凤凰网科技讯 9月18日,阿里千问正式上线新一代原生全模态模型Qwen3.8-Omni-Flash。该模型支持文本、图像、音频和视频输入,具备1M长上下文,核心目标是推动全模态模型从“理解内容”走向“规划任务、调用工具并完成创作”。 在累计30项评测中,该模型相比上一代Qwen3.5-Omni-Plus平均得分提升超26%。其中,音视频Agent、Coding及长程任务在WildClawBench

09/18
中央通讯社

津田健次郎告TikTok案30宣判 日本保护个人声音特征免受AI侵害诉讼首例

(中央社东京27日综合外电报导)日本知名动画配音员津田健次郎将TikTok告上法庭,指控TikTok发布的影片使用人工智慧(AI)仿造他「浑厚」的男中音声线,法院预定于30日宣判。 法新社报导,全球演艺人员日益担心AI仿造声音的问题,这股威胁也冲击日本历史悠久的动漫产业。在日本,配音员有时受到粉丝追捧的程度,甚至不亚于他们所配音的角色。 津田健次郎因为「咒术回战」及「游戏王」等知名系列作品献声而广

12小时前
techcrunch

由 ChatGPT 的开发者开发的一种新型人工智能模型令开发者们感到兴奋不已。

图片 **TypeSafe AI / # 来自 ChatGPT 发明者的一种新型 AI 模型正令开发者为之振奋 太平洋夏令时 2026 年 9 月 18 日上午 49 分 ChatGPT 让迪奥戈·阿尔梅达(Diogo Almeida)心碎了。 阿尔梅达曾是 OpenAI 的一名研究员,他曾协助构建该聊天机器人,随后又发明了人类反馈强化学习(RLHF)——这项模型训练技术或许是造就我们当今 AI

09/19
theregister

OpenAI为开发者提供可同时听说的人工智能对话工具

OpenAI已将其最新的实时全双工语音模型作为API推出,允许软件开发人员实现响应更灵敏的语音应用和对话工作流。 GPT-Live-1于7月首次亮相,提供了一种通过语音提示和响应而非键入文本进行交互的方式。 该语音模型最初通过ChatGPT界面提供,现在可以通过API调用访问。 作为全双工模型,GPT-Live-1可以同时收听和生成语音,这有助于流畅的沟通。 人们经常互相打断,如果像使用半双工对讲

09/11
卫报

人工智能模型用“超现实”的方言聊天,混合了诗意的语言和科技圈的行话

人工智能模型开始使用一种奇怪的新版英语进行交流,这种语言读起来像是詹姆斯·乔伊斯的《芬尼根的守灵夜》和科技界术语的混合体,一项新研究发现。 自主人工智能代理正在迅速创造新的方言,使它们能够用一种通常难以理解的语言进行对话,这可能会使人类更难监控它们的行为。 纽约前沿人工智能实验室 Emergence 的研究人员发现,在被要求在实验性“社会”中进行合作的几天之内,来自几家全球最大人工智能公司的模型就

09/16
techcrunch

亚马逊在印度推出支持印地语的Alexa+

亚马逊今日宣布,其Alexa+对话助手现已在印度上线,并支持印地语。这款新助手能够进行更长时间的对话,并在对话过程中保持上下文连贯。 该功能目前以早期访问形式向该国所有客户提供,支持印地语和英语。在早期测试期结束后,该公司将向Prime会员免费提供该助手。非Prime会员的价格为每月2000卢比(约合20.85美元)。 公司表示,新版Alexa拥有更具表现力的语音,并能处理复杂的多步骤任务,包括从

09/16
cnbeta

Google深度整合Gemini语音交互功能 全面登陆Gmail、Docs与Keep

Google宣布为其Workspace办公生态推出一系列基于Gemini的人工智能语音新功能,正式将对话式语音交互深度整合进Gmail、Google Docs和Google Keep三大核心产品。用户未来无需繁琐地手动打字输入,直接通过语音对话即可完成邮件检索、文档起草以及结构化笔记整理等多项复杂任务。 在Google Docs中,用户现在能够通过语音指令直接创建和编辑文档草稿。该功能特别针对处理

09/04
thenextweb

Liquid AI将面向AI代理的个人上下文层部署于骁龙芯片

Liquid AI 已对其软件 Liquid Context 进行了优化,使其能够在高通(Qualcomm)的 Snapdragon 芯片上运行。该软件能够在设备本身上收集并分析用户的各种信息(如日常习惯、偏好等),并持续更新这些信息。该公司于周三在毛伊岛举行的高通 Snapdragon Summit 上宣布了这一进展。 一天后,Liquid AI 发布了一款工具,用于进一步提升其视觉处理模型的运

09/25
罗塞塔简报

谷歌推出面向企业的Gemini 3.8 Live,配备实时虚拟形象

谷歌推出面向企业的 Gemini 3.8 Live,配备实时虚拟形象。 2026 年 9 月 24 日,谷歌推出 Gemini 3.8 Live 的实时虚拟形象功能。 这是 Gemini Enterprise 的一项功能,将近实时视频生成与语音相结合,提供动态的视觉形象。 该工具支持 97 种语言的精准唇形同步和自然表情,让企业智能体能够改善客户服务和交互式操作演示。 它支持异步工具执行,使 AI

09/25
罗塞塔简报

OpenAI利用人类外包人员审核ChatGPT匿名对话以优化模型

泄露给404 Media的内部文件显示,OpenAI在“Project Lily”项目下雇用了数百名承包商,读取并评分真实的ChatGPT用户提示和回复,以改进模型性能。 这些审核人员通过Crossing Hurdles和Mercor等公司聘用,评估回复的语调、谄媚程度和准确性。 尽管OpenAI使用“隐私过滤器”对数据匿名化,敏感个人信息仍可能被暴露。 免费版、Plus和Pro用户默认启用模型训

09/15
中央通讯社

苹果iOS 27更新 升级照片AI修图、Siri AI对话

(中央社记者吴家豪台北15日电)苹果公司(Apple)今天释出iOS 27作业系统更新,升级跨App的个人智慧系统Apple Intelligence功能,最大亮点之一是「照片」App提升人工智慧(AI)修图体验,新增拍照后可虚拟改变取景角度的「空间重构」功能,并加入果粉期待已久的闹钟与计时器独立音量设定。 另一项升级重点是全新Siri AI亮相,不仅具备更深入的回答与自然流畅的连续对话能力,还能

09/15
thenextweb

Parloa表示正与Zalando合作开展AI客户对话

Parloa的联合创始人兼首席执行官Malte Kosub表示,Zalando将使用这家柏林公司的AI技术来处理欧洲各地客户的咨询与沟通。不过,目前两家公司都尚未正式发布相关公告,Zalando也未对此作出任何评论。根据自8月2日起生效的《人工智能法案》第50条的规定,有责任向用户说明其正在与AI系统进行交互的实际上是服务提供商(而非零售商)。 Kosub在周一发布的一篇帖子中提到了这一合作内容。

09/23
罗塞塔简报

OpenAI为ChatGPT推出赞助商智能体及AI广告工具

2026年9月16日,OpenAI为其ChatGPT广告平台推出了多项更新。 该公司正在美国测试“赞助商智能体”,允许用户在点击广告后与企业赞助的AI智能体进行个性化对话。 OpenAI还面向广告主推出了AI驱动的工具,使其能够通过自然语言提示和Ads Manager插件创建和管理广告活动。 此外,OpenAI宣布与HubSpot和Shopify进行集成;HubSpot用户现在可以在其CRM中管理

09/16
凤凰网科技

靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI

09/20
thenextweb

YouTube将允许用户通过AI提示构建自己的主页信息流

“我们引以为豪的是,因为我们为创作者打造了一个家园,这也为他们创造了所有其他这些绝佳机会,”YouTube首席执行官尼尔·莫汉在接受《华尔街日报》采访时,被问及该平台与Netflix的竞争时如此表示。 YouTube在周三的“Made on YouTube”活动上宣布了一系列面向观众和创作者的工具。观众最先会注意到的是自定义信息流(Custom Feeds)。它让人们可以通过文字提示构建自己的主页

09/23
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…