字号 ·· | 护眼

搜索结果

「聊聊天就能调GPU!英伟达AI新专利:自动写脚本定位性能问题」共 99 条 · 第 1 页
凤凰网科技

聊聊天就能调GPU!英伟达AI新专利:自动写脚本定位性能问题

快科技9月27日消息,近日英伟达提交了一项专利申请,计划打造一个AI助手,让开发者能够用自然语言询问GPU性能问题。 该系统可以读取性能报告、生成脚本提取所需数据,进而解释程序在哪些环节浪费了GPU资源,或为何运行速度低于预期。 根据专利描述,这是一套基于大语言模型的“聊天界面”,与GPU性能分析工具相连接。开发者可以直接询问某个工作负载为何运行缓慢、哪一部分构成了性能瓶颈,或者同一程序两个版本的

09/27
凤凰网科技

英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%

IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据

09/17
cnbeta

索尼公布主机自修复专利 可用大语言模型生成固件修复代码

最近索尼公布了一项硬件自修复系统专利,计划利用大语言模型为PlayStation等设备生成定制固件代码,自动诊断并处理软件故障。该方案旨在减少送修、客服处理及人工排查步骤,但专利公开并不意味着相关功能已经投入使用。 按照专利描述,人工智能服务器会监测客户端设备出现的问题,并分析设备上传的数据。如果系统判断需要采取纠正措施,便可针对具体故障生成诊断方案和修复代码,再将定制固件更新自动推送至对应设备。

09/22
福克斯新闻网

人工智能恶意软件能够自我改写以逃避检测

谷歌威胁情报小组发现了一款名为 PROMPTFLUX 的实验性恶意软件,它能要求 Gemini 重写自己的代码。其中一个版本被设计为每小时执行一次此操作。恶意软件为何要不断重写自己?为了让其更难被识别。 安全软件可以通过查找恶意代码中的已知模式来进行检测。如果代码持续变化,恶意软件就会成为一个移动目标。这并不意味着它能自动逃避当前的安全工具,但会增加某些类型检测的难度。 这里有一个重要的现实核查。

09/22
华尔街见闻

RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号

AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive

09/03
TheVerge

英伟达推出免费工具,将闲置电脑连接成个人AI数据中心

英伟达正在发布其新的个人AI路由器(PAIR),这是一款免费工具,可将你的家用电脑同步起来,用于处理本地AI推理任务,支持Ollama和LM Studio等工具。 先把显而易见的事情说清楚:尽管名字可能让人误解,但PAIR并不是硬件路由器。它是英伟达开发的开源软件,能够发现网络上的兼容PC,将它们连接起来,并为处理智能体工作流中的计算任务做好准备。虽然兼容设备大多是英伟达GeForce GPU(P

09/04
凤凰网科技

仅14MB!树莓派5纯CPU也能跑AI:离线指令毫秒级响应

快科技9月23日消息,近日开发者Cactus Compute发布了一款名为Needle 2的轻量级AI模型。 该模型体积仅为14MB,专门针对树莓派5(Raspberry Pi 5)的处理器环境进行了深度优化,能够在无需AI加速扩展板的情况下,将自然语言指令实时转换为预设的函数调用。 树莓派官方博客介绍,Needle 2并非传统的通用聊天机器人,而是专注于设备端指令执行的专用模型,当用户输入点亮L

09/23
商业内幕

OpenAI想让你对着手机“脱口而出你的想法”

OpenAI正在进一步进军竞争激烈的个人智能体市场——这一次是语音领域。该公司于周三将其最先进的语音系统接入ChatGPT的网页端和移动应用。OpenAI此次发布的功能允许用户通过语音来委派需要多个步骤、浏览器以及不同应用协同完成的单次和重复性任务。该公司一直在为下周举行的OpenAI DevDay大型活动预热,接连发布新产品。OpenAI负责ChatGPT语音功能的产品主管阿蒂·埃莱蒂向Busi

09/24
cnbeta

英伟达据报重启“Rubin CPX”AI加速器项目 改用168GB HBM4内存

据供应链分析师郭明𫓹透露,英伟达此前一度搁置的“Rubin CPX”AI加速器项目如今重新启动,并对内存架构进行了重新设计。该产品原计划搭载128GB GDDR7显存,如今改为配备168GB HBM4高带宽内存。 英伟达在去年年底曾宣布,计划基于Rubin GPU家族开发一款专用加速器,主要面向大规模智能体人工智能工作负载。项目公布后曾被报道暂时搁置,但英伟达目前似乎已经完成重新规划。Rubin

09/01
cnbeta

9亿人免费用 GPT私人秘书来了

ChatGPT 有 9 亿周活用户,付费的不到 5000 万,转化率只有 5% 到 6%。8 月 26 日,OpenAI 把定时任务功能(侧栏的“已安排”)向所有免费用户开放。 这个此前只属于不到一成人的功能,一夜之间覆盖了剩余九成以上的用户。 定时任务让 ChatGPT 在后台按你设好的时间或条件自动跑一段提示词,跑完把结果推送给你。你不在线,它也照跑。 对绝大多数免费用户来说,这是第一次不用打

08/30
cnbeta

高通公布新一代Adreno GPU:矩阵核心强化AI算力、更高频率更低功耗

高通公布了下一代骁龙顶级移动平台所搭载的新一代Adreno GPU的部分技术细节。新GPU在延续三切片架构的基础上,进一步提升了运行频率,并首次引入片上高性能缓存、Matrix Cores专用AI计算单元及Adreno Neural Fusion融合架构,旨在从架构层面优化持续图形性能与功耗效率。 新一代Adreno GPU继续采用三切片架构设计,每个切片的运行频率较上一代提升250MHz,由1.

09/03
cnbeta

OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网

“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA

09/27
cnbeta

分析师解读英伟达35亿美元投资联发科:从AI芯片到系统,双方各取所需

英伟达、联发科宣布合作郭明𫓹周二在X上发文称,联发科最新公告宣布深化与英伟达的长期合作,其中反复出现的“机架级”(rack-scale),正是理解这份公告的关键,联发科内部已将AI业务的战略定位,从“IC/ASIC(集成电路和专用集成电路)设计”提升至“系统级设计”。 他指出,这份公告也进一步说明,通过与英伟达合作,把定制化芯片/XPU(各种处理器)导入英伟达已经成熟的机架级生态,让定制化芯片在完

09/01
凤凰网科技

AI行业冒出一批高薪新岗位,不用会写代码

别只盯着写代码,AI 最缺的岗位已经转移到了电力和机房。在美国弗吉尼亚州阿什伯恩,James Waddy 每天在 Digital Realty 的数据中心里走约 3 万步。他闻设备有没有烧焦的气味,摸管道检查裂缝,还要留意屋顶设备遭鸟破坏的迹象。 我们谈论 AI 与就业,常常先想到屏幕里的变化:代码自动生成,文案几秒写完。把视线移开一点,还能看到另一份工作清单。 有些人专门找模型的麻烦,有些人设计

09/26
cnbeta

Google深度整合Gemini语音交互功能 全面登陆Gmail、Docs与Keep

Google宣布为其Workspace办公生态推出一系列基于Gemini的人工智能语音新功能,正式将对话式语音交互深度整合进Gmail、Google Docs和Google Keep三大核心产品。用户未来无需繁琐地手动打字输入,直接通过语音对话即可完成邮件检索、文档起草以及结构化笔记整理等多项复杂任务。 在Google Docs中,用户现在能够通过语音指令直接创建和编辑文档草稿。该功能特别针对处理

09/04
国会山报

英伟达推出新系统为AI代理设置护栏

英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博

11小时前 全文见 美国消费者新闻与商业频道
theregister

谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密

当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制

09/09
凤凰网科技

AI写代码,人类按回车:一篇500万浏览热帖引发争论

凤凰网科技讯 9月21日,据Business Insider报道,一位软件工程师关于AI编程的帖子在社交平台X上走红,AI coding是让开发者更高效,还是把他们变成只会按按钮的人。 这位X用户名为“v0xium”,因担心遭到雇主不满而要求匿名。他说,自己在一家未披露名称的公司担任新职务,工作变得“吞噬灵魂”,因为Claude Code生成了从产品规格、测试到工单和报告的一切。 “这里没人知道任

09/22
cnbeta

Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式

Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变

09/16
cnbeta

Google公布9月Android更新:Gemini、消息应用和无障碍功能迎来多项改进

Google于9月2日宣布推出2026年9月Android更新,为Android手机带来五项新功能,涵盖Gemini深度整合、晕车缓解、无障碍体验以及Google Messages功能升级等方面。 其中一项实用改进是,用户可以让Gemini记住个人物品的放置位置。例如,用户可以告诉Gemini“我把车钥匙放在客厅的抽屉里”,还可以附加一张参考照片。相关信息随后会保存到“查找中心”(Find Hub

09/02
亚洲新闻台

OpenAI正在为AI工具构建“自动关闭”能力,致立法者的信函称

09/03
cnbeta

OpenAI最新内部数据公开 2028年实现全自动AI研究

前些天,号称实现 AGI的 GPT-6 Astra 发布后,引发了全网对于递归自我改进架构的热议。AI 已经开始参与下一代 AI 的研发。问题是,这种事情到底已经发生到什么程度了?就在刚刚,OpenAI 公开了 AI 模型在自家内部加速科研的详细数据。此外,OpenAI 正式宣布已达成自动化 AI 研究实习生的目标,并在 2028 年实现完全自动化的 AI 研究人员。 作者表示,递归式自我改进可能

09/07
cnbeta

高通详解下一代骁龙旗舰NPU升级:更强AI推理能力将降低对内存的依赖

高通近日进一步公布了骁龙8 Elite Gen 6 Pro的AI处理能力细节,其中最值得关注的是全新Hexagon NPU的升级。与过去单纯追求AI算力增长不同,高通此次更加重视AI模型运行效率、内存访问以及功耗控制,希望让下一代旗舰手机能够在本地运行规模更大的生成式AI模型和AI智能体。 高通表示,随着生成式AI逐渐成为智能手机的重要功能,AI模型本身也在不断变得更加庞大和复杂。对于移动设备而言

09/11
彭博社

Meta 宣传其最新自研人工智能芯片的成本效益

明年,新款处理器将在数据中心投入使用,另一款型号将于2027年底推出。Meta Platforms Inc. 计划在明年上半年开始在其数据中心部署自主研发的人工智能芯片,此举旨在节省运行人工智能模型时的成本和能源。 该公司于2023年首次宣布开发本土人工智能芯片的计划,目前正在测试其第三代芯片,名为MTIA 450,或称Arke。下一代芯片——代号为500,或称Astrid——将在大约一个月内完成

09/15
上一页 第 1 页 下一页
1CCF | 全球资讯
正在加载…