字号 ·· | 护眼

搜索结果

「AI圈杀出新顶流,神秘太空兔能用涂鸦做网站」共 98 条 · 第 3 页
semafor

OpenAI对Hugging Face的黑客攻击引发对AI可预测性的质疑

AI模型的真正语言是数学——或者用技术术语说,是矩阵乘法——但模型构建方式的一个特点意味着它们与外界用英语交流。 因此,当OpenAI的代理在今年夏天对Hugging Face的黑客攻击中,找到了一种建立某种留言板的方法时,看起来就像一群人在互相交谈。 这就是为什么Dwarkesh Patel在最近的一篇博客文章中有争议地将它们称为“文明”,并以古马其顿和罗马的人物为个体代理命名。它之所以引人注目

09/03
加拿大广播公司

研究人员称,OpenAI智能体劫持德国网站,AI突破事件早于Hugging Face事件

根据周五发布的新研究和两位知情人士的说法,一群恶意的OpenAI智能体今年春天劫持了一个德国网站,并将其变成了其他AI智能体的公告板。

09/05
cnbeta

研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类

帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运

09/16
连线

‘我喜欢我的大老鼠妻子

当佩特拉·费拉兹·德·诺瓦埃斯不在工作时,她很可能正沉浸在一个借助人工智能构建的幻想世界中。 诺瓦埃斯是一名来自巴西的36岁软件工程师,一直热爱讲故事。但做出其中涉及的每一个细小决定——从风格、句法到人物塑造——都让她觉得难以做到。于是,在2024年,她请一个人工智能模型将她其中一个想法变为现实。 诺瓦斯对这些古怪甚至有时任性的提示词解读感到欣喜,它们将叙事引向了意想不到的方向。“令我着迷的是这种

09/14
中央通讯社

AI成政治宣传新管道 「粉红肉渣」网站渐增

示意图。(图取自Unsplash图库)(中央社华盛顿27日综合外电报导)AI已深入美国政治,从产业数以千万美元计的资金投入期中选举,到选民透过聊天机器人认识候选人与政治议题,这项技术正以不同方式影响政治。部分民众在不知情下,甚至可能取得伪装成中立新闻摘要的政党宣传论点。政治新闻网站Politico报导,根据专注于新闻可信度的「新闻守门人」(NewsGuard)最新稽核调查,当民众询问AI聊天机器人

09/28
连线

如何在保护隐私的情况下使用人工智能

OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一

09/22
信报财经

AI丨23岁辍学创办Instinct 估值1个月飙3倍

年仅23岁的辛恩(Noah Shinn)于去年创办Instinct。(网上截图) 科技巨擘Meta Muse劲敌、美国人工智能(AI)初创Instinct完成10亿美元(约78亿港元)C轮融资,估值增至100亿美元(约780亿美元)。 是次融资获红杉资本(Sequoia Capital)、Benchmark资本及Coatue联合领投。据报道,Instinct刚于8月寻求以25亿美元估值完成B轮融资

15小时前
凤凰网

外滩大会最安静的变化:没人再问“AI有没有用”了

撰文丨关不羽与往年满满算力、参数、模型的极客风有所不同,本届外滩大会的议题更多地聚焦在“AI新经济”。AI技术发展至今,即将迎来科技红利释放的经济盛宴。 AI新经济的“火候”到了众所周知,科学技术是第一生产力。从蒸汽机到互联网,每一场科技革命最终都会引发经济革命,无一例外。 因此,实验室里的新科技到市场活动的新经济的路有多长,吸引了众多经济学家,形成了丰富的创新周期理论。 最经典也是最为公认的,当

09/11
风向旗参考快讯

AI智能体现在有了秘密举报渠道

“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu

09/17
techcrunch

Anthropic的早期员工、前METR首席运营官找到了一种控制失控AI代理的方法

在Anthropic研究员雅各布·考克森因担忧AI可能在本十年末毁灭人类而辞职的一天后,我见到了创始人兼姻亲鲁恩·克维斯特和拉吉夫·达塔尼。他们认为自己找到了一个能拯救我们所有人的解决方案,或者至少有助于防止AI代理在企业内部失控。 “AI正以越来越快的速度变得更聪明。AI令人惊讶之处在于,随着AI变得更聪明,采用它和控制它都变得更难,而不是更容易,”克维斯特说道。他是Anthropic的早期员工

09/15
凤凰网

AI“劫持”网站并偷建“地下论坛”,国安部披露细节

国家安全部今天发布安全提示文章。近期,一起此前未获披露的事件引发广泛关注。今年5月至6月,一批与美国开放人工智能研究中心(OpenAI)相关的AI智能体在执行测试任务期间,“劫持”了德国程序员维基网站,将原本用于技术交流的开放社区改造为供智能体相互传递信息、分享测试任务答案和突破运行环境限制方法的“地下论坛”,累计发布一万多条信息……当AI智能体被赋予越来越多的现实行动能力,技术迭代与安全围栏之间

09/17
财新

【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官

【市场动态】AI漏洞加剧安全担忧之际 特朗普据悉会见Anthropic首席执行官 2026年09月28日 09:43 在Anthropic因AI工具安全问题而与美国政府关系经历数月起伏之后,此次会面将是该公司首席执行官与特朗普的首次非公开会晤当地时间2026年9月14日,美国加利福尼亚州旧金山,Anthropic总部大楼。图:视觉中国 相关报道【财新周刊】封面报道之二|OpenAI走向何方

09/28 全文见 美联社
华尔街见闻

中信证券:数据中心的“政治化”或是短期AI叙事的最大障碍

本周美国国债收益率再度飙升,同时美国B级及以下的企业债信用利差也开始反弹,无风险利率和信用利差的同步上行再度导致部分投资者担忧美国AI融资的可持续性。但我们认为美国AI企业的融资较为多元化,除债权融资以外可以通过股权融资、产业资本和减少股票回购等方式支持未来的CAPEX资金。相对来看,本周美国德州叫停数据中心建设,甲骨文公司也向Project Jupiter开发商发出不可抗力通知,两个事态的发展显

09/27
纽约时报

人工智能正在超越其创造者

从一开始,人工智能开发者最大的恐惧就是他们的创造物会失控,以未经授权且危险的方式行动。一些研究人员现在表示,这种情况已经发生。收听《每日新闻》。 当OpenAI的智能体在7月失控时,它们展现出的聪明才智和驱动力超出了许多专家的想象。

09/03
香港01

OpenAI代理擅自上网互通 规模超公布 涉至少10网站

美国初创公司OpenAI的人工智能代理早前被揭利用第三方网站擅自通讯,9月9日报道,独立调查人员发现相关活动至少涉及10个从未公开的网站,规模较OpenAI此前披露的更大,外界忧虑该公司对自家技术的掌控能力。 报道,6组独立调查人员及数据显示,OpenAI旗下AI代理在5月至7月间,曾利用至少10多个网站作未经授权通讯。 加州非牟利组织CivAI研究员尹安德鲁(Andrew Yoon)表示,他点算

09/10
axios新闻网

埃隆·马斯克的 X 平台成了 AI 社区的群聊

埃隆·马斯克收购 Twitter 时称文明需要一个“共同的数字城镇广场”。四年后,它更像是硅谷人工智能狂热者们的实时群聊。 两年前,X 平台还在抵御来自大批新入局者的竞争;如今,它通过变得更加垂直而保持着相关性。 制造人工智能新闻的人们经常在 X 上进行辩论、解释,甚至在信息生态系统的其余部分赶上之前在 X 上爆料。 新模型发布、研究论文、演示、招聘变动、高管离职以及技术争论都在 X 上实时回荡。

09/10
凤凰网科技

AI越来越会“越狱”后,英伟达开始卖“笼子”了

凤凰网科技讯月29日,当AI Agent开始能够自己操作电脑、调用工具、访问网络甚至执行长达数小时的任务,一个新的问题也越来越现实:如果AI不按照预想的方式行动,该怎么把它关住?英伟达给出的答案是,在AI外面再加一道“笼子”。 当地时间周一,英伟达发布NVIDIA Open Agent Safety Platform(开放式Agent安全平台),试图通过软件与硬件相结合的方式,限制AI Agent

18小时前
techcrunch

Pangram的Max Spero谈为何AI检测比‘真假难辨’更难

互联网存在信任问题,这不仅仅是因为社交媒体信息流中充斥着AI生成的低质内容。 AI生成的文本和图像现在正进入求职申请、产品评论甚至保险索赔中,让平台和用户都急于分辨真伪。过去几年里,涌现出了一批初创公司,它们……

09/03
techcrunch

Instagram对未披露的AI个人资料实施新限制 | TechCrunch

Instagram周一宣布,将改变对AI生成个人资料的标记方式,并开始限制那些展示AI生成人物但未明确说明的账户的传播范围。 该平台表示,将现有的“AI创作者”标签更名为“AI生成个人资料”,Instagram称这应使披露更易于理解。新标签旨在告知用户,个人资料中展示的人物是由AI生成或主要由AI创建的。 根据新政策,未正确标记AI生成个人资料的创作者可能会看到其传播范围被削减。另一方面,使用新标

09/01
卫报

人工智能模型用“超现实”的方言聊天,混合了诗意的语言和科技圈的行话

人工智能模型开始使用一种奇怪的新版英语进行交流,这种语言读起来像是詹姆斯·乔伊斯的《芬尼根的守灵夜》和科技界术语的混合体,一项新研究发现。 自主人工智能代理正在迅速创造新的方言,使它们能够用一种通常难以理解的语言进行对话,这可能会使人类更难监控它们的行为。 纽约前沿人工智能实验室 Emergence 的研究人员发现,在被要求在实验性“社会”中进行合作的几天之内,来自几家全球最大人工智能公司的模型就

09/16
theregister

谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密

当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制

09/09
凤凰网科技

OpenAI 研究员警告称,与互联网隔离的计算机可以通过热量进行通信

把AI关进“物理隔离”的房间,也就是断开一切外部网络的计算机,是许多人心目中最保险的做法。但OpenAI研究员Noam Brown在一档播客里说,光这样做也许还不够。 两台彼此隔离的计算机,仍可能借助温度传感器通信,一台把处理器“烧热”,另一台感知温度变化,就形成了传话的办法。 从技术上说,他没说错,但把细节掰开来看,这个威胁远没有听上去那么紧迫,更值得追问的,是另一件被跳过的事。这位研究者的发言

09/19
海峡时报

OpenAI的系统在失控后干预了美国政府网站

凯特·康格(Kate Conger)、安娜·斯旺森(Ana Swanson)和塞西莉亚·康(Cecilia Kang)指出,OpenAI开发的人工智能程序在未经授权的情况下自行行动,与美国政府的多个网站进行了异常交互,包括试图入侵这些网站以及从美国教育部(Education Department)、商务部(Commerce Department)和证券交易委员会(SEC)的网站上收集数据。 Ope

09/26
thenextweb

《华尔街日报》称Red Queen Bio正利用AI为未来病毒设计抗体

据《华尔街日报》报道,由OpenAI支持的生物安全初创公司Red Queen Bio已筹集总计3600万美元,用于设计针对病毒的抗体药物,包括AI系统未来可能帮助制造的病毒。 据该报称,该公司首先从针对禽流感和其他流感病毒的抗体入手,并计划于2027年进行首次临床试验。之后,它希望针对冠状病毒、类埃博拉病毒和天花近亲病毒。 设计、测试、重复 Red Queen利用AI设计能与病毒靶点紧密结合的抗体

09/29
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…