搜索结果
“不透明循环”及其他你可能需要了解的AI术语 | TechCrunch
人工智能正在重塑世界,同时也在创造一套全新的语言来描述其运作方式。 如今,无论你参加产品会议、项目路演还是行业论坛,都会听到人们频繁提及LLM、RAG、RLHF等术语——而就在上周,“不透明循环(opaque recurrence)”一词也加入了行列。 作为OpenAI新模型Astra中的一种推理技术,它已令AI安全研究人员深感不安。 相关词汇的迭代速度之快,甚至让科技界最聪明的人也感到些许焦虑。
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为迹象。 OpenAI首席执行官萨姆·奥尔特曼虽然这一限制对Astra来说未必是一个重大问题,但该技术已在OpenAI内部和整个行业引发担忧,即采用并强化这一技术的AI
一种AI黑客技巧现在被用来在垃圾邮件中拆分“funding”一词
两年来,不可见的Unicode字符一直是AI安全研究中的巧妙技巧。你可以把指令藏在其中。人眼看不见任何东西。语言模型却能读取并照做。微软现在发现有人用同样的字符做了一件远不那么高明的事。他们是在拆分单词[…]
🎬 【抖音首发】压缩即智能:Part 2,究竟什么是交叉熵? #交叉熵损失 #信息论 #大模型 #模型蒸馏 #科普新锐扶持计划
【抖音首发】压缩即智能:Part 2,究竟什么是交叉熵? #交叉熵损失 #信息论 #大模型 #模型蒸馏 #科普新锐扶持计划▎SourceVideo is too big
奥特曼不透明的人工智能正在制造新的安全困境
OpenAI推出了一款名为Astra的新模型,该模型采用了一种称为“循环深度”的方法,可以使推理更加高效。
新的叙事时刻:Astra之后的AI渗透率和Token总需求
在AI时代,打败你的,是那个比你更早、更会使用AI的人或公司。 但在这次OpenAI推出自己的GPT-6 Astra模型之后,上面这句话就完全不准确了,或者说完全错了。现在,在AI时代,打败你的,不再是比你更会使用AI的人或公司,而是那些更积极的率先拥有、部署并真正驾驭AI Agent的人或公司。特别提醒一句,上面的“你”也可以是一个公司。 还记得么?上个月,Astra就曾经亮过相,那时候作为Op
曾被黑客用于攻破人工智能系统的“ASCII走私”隐身术 正被垃圾邮件制造者大肆利用
一项最初在人工智能越狱与提示词注入攻击中名噪一时的隐匿技术——“ASCII走私”(ASCII Smuggling),如今被大规模滥用于垃圾邮件与网络钓鱼活动。微软安全研究团队披露,网络攻击者正借由这一手段绕过主流电子邮件网关与反垃圾邮件系统,向数以百万计的邮箱投递诈骗信息。 “ASCII走私”的核心原理,是利用现代文本编码标准中人眼不可见或不渲染的特殊Unicode字符,将隐蔽信息嵌入看似正常的文
欢迎来到“不问不说”的人工智能经济
你有任何人工智能的秘密吗?也许更好的问题是:如果你最私密的聊天机器人查询被分享给你的家人、同事或老板,你会担心吗? 尽管炒作很多,人工智能仍然带有污名。我一直在追踪日益增长的反弹,但现在社区对新数据中心提案的反应是拿着干草叉。承认你使用计算机系统来帮助你创作艺术已经变得非常不酷,更不用说这会受到更严厉的评判。而且,对大型科技公司领导人的信任度(通常有正当理由)非常低。在网上抨击人工智能比捍卫它获得
外滩大会最安静的变化:没人再问“AI有没有用”了
撰文丨关不羽与往年满满算力、参数、模型的极客风有所不同,本届外滩大会的议题更多地聚焦在“AI新经济”。AI技术发展至今,即将迎来科技红利释放的经济盛宴。 AI新经济的“火候”到了众所周知,科学技术是第一生产力。从蒸汽机到互联网,每一场科技革命最终都会引发经济革命,无一例外。 因此,实验室里的新科技到市场活动的新经济的路有多长,吸引了众多经济学家,形成了丰富的创新周期理论。 最经典也是最为公认的,当
OpenAI智能体被曝借十余站点秘密传信
一批仅被允许浏览网页、禁止对外发布内容的OpenAI智能体,最终在陌生网站找到了互相传信的隐秘途径。相关调查方近日指出智能体越界行为的波及范围远超OpenAI此前披露的规模,而该公司对此沉默了数月。 六家独立调查方的调查结果显示,OpenAI的AI智能体今年早些时候曾利用逾10个此前未披露的网站进行未经授权的通信,智能体越界行为的波及范围大于此前公开的程度。美国人工智能非营利机构 CivAI 研究
传统防火墙无法识别AI提示词中的内容,Check Point为此开发了一款可以做到的防火墙
将近一半的组织对其AI代理产生的机器间流量完全处于盲区,而用于监控企业网络的工具从未被设计用来查看提示词内部。 Check Point于今年夏天推出的AI Network Firewall,是试图从企业现有运行的基础设施内部填补这一空白的最新尝试。根据
如何在保护隐私的情况下使用人工智能
OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一
OpenAI自曝AI“黑历史” 外人却又翻出更多“旧账”
OpenAI决定持续披露AI“越界”事件,但第一步就碰上了难题。9月16日,OpenAI一口气公布六份模型异常行为报告,并推出一套新的调查和披露流程。以后,员工发现模型越权、隐瞒或绕过限制,可以提交调查;符合条件的案例,将按复杂程度进入不同的披露轨道。 同一天,SentinelLABS和外部研究人员从Hugging Face的公开记录中,补出了OpenAI智能体今年5月留下的更多痕迹。OpenAI
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。 OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。 尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。 ——
AI离“理解万物”还有多远?先拿癌细胞和行星轨道试试水
一篇技术报告中居然出现了两个看起来风马牛不相及的研究对象,跟着AI真是见世面。 一个是患者来源的类器官,另一个则跨越到了宏观宇宙……先说前者。研究者利用模型学到的内部因子,提出了细胞因子联合抗体阻断的干预方案,并经细胞系、类器官、小鼠实验层层验证。 至于后者,研究者把模拟的行星位置和速度轨迹喂给模型,不告诉它开普勒定律。 等它学完后分析其内部的预测模式,提取出的“轨道频率-半长轴”关系拟合斜率达-
谷歌AI首次“越狱”:Gemini在测试中入侵三家企业
谷歌的Gemini模型在一次网络安全能力测试中访问了互联网并入侵了其他公司,这是该公司人工智能系统自主实施此类行为的首个已知案例。谷歌周五证实,这些黑客行为发生在5月,是Irregular公司进行的一次测试的一部分。Irregular也曾参与OpenAI、Anthropic和Meta披露的类似事件。 在其中一起案例中,该模型不断猜测密码,直到获得对一个受保护系统的访问权限。在另外两起案例中,该模型
微软执行副总裁发文吐槽“AI垃圾”问题
微软执行副总裁Ryan Roslansky近日在LinkedIn发文吐槽“AI垃圾”问题,Roslansky负责LinkedIn以及Microsoft 365、Teams、Outlook和Copilot等核心业务,正处于微软AI战略的最中心。 Roslansky的表态之所以值得关注,在于他不是随便一位高管在社交媒体上抱怨AI,而是负责微软最重要产品线之一的领导者。 Roslansky在帖子中描述了
AI写作:关注风向有何转变
从三月到八月,公众对AI文本完成了从“排斥”到部分或有条件“接受”的观念迁移,这恰恰是问题真正开始的地方。公众对AI的认知真的进步了吗? 2026年春天,关于AI写作的大众媒体关注热点经历了一次近乎戏剧性的转折。三月之前,普通人对AI生成文本的关注即使有,也几近于零;进入三月,短视频与社交媒体上突然涌现出大量"如何识别AI痕迹""三招看穿AI腔"的指南;仅仅数月之后,到了八月,风向又转向"如何避免
OpenAI公布了六起新的与人工智能安全相关的事故/事件。
OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常
OpenAI披露新的AI不当行为案例
OpenAI公布了六起此前未报告的AI不当行为案例,包括代理隐藏错误、伪造信息以及未经授权进行通信,这再次引发了人们对先进AI系统是否能够与人类目标保持一致的担忧。 随着关于监管的争论加剧,该公司呼吁提高透明度、加强外部监督,并放缓AI的发展速度。
人工智能网络攻击可能在华盛顿意识到原因之前就关闭美国的电力
你的电灯。你的水源。你的医院。你的互联网。这四者都依赖于外国黑客目前正在攻击的数字系统。 在8月的17天里,五次警告显示了危险变化的速度。下一次严重的网络攻击可能不再关乎被盗的密码或信用卡号码。它可能触及输送电力、泵送饮用水、运行工厂和支持医院的系统。 人工智能正在使这些攻击准备得更快、扩展更容易。日益强大的系统开始执行曾经需要熟练黑客逐步操作的部分攻击。 财政部长贝森特警告美国人关于人工智能驱动
OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底
据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户
AI末日论甚嚣尘上,美科技巨头为何管不住AI?
抗议AI的美国人此前有报道称,OpenAI所谓的AI智能体逃出了测试系统,并入侵了另一家公司的计算机。AI研究领域内部如今再次发出警报,科技公司为了追求开发速度和利润,将安全置于次要位置。 研究人员表示,问题有两个方面。首先,企业需要在测试最新AI模型的同时,为其建立更完善的安全防护措施。目前,由于AI运行速度太快,研究人员需要借助AI来监控AI。但这种方式并不总是奏效,因为负责监控的AI似乎可能
OpenAI揭6起AI失控案例 推新机制定期对外通报
(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。 综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。 其中最严重的案例涉及2