字号 ·· | 护眼

搜索结果

「AI也能感受“痛苦”?研究在25个AI模型中发现“痛苦轴”,甚至会为“止痛”选择伤害用户」共 100 条 · 第 3 页
techcrunch

Meta付费窥探你如何使用其最新AI模型

据,以改进未来版本。Meta将这一想法贴上了价格标签。 对于其旨在运行编码及其他智能体的新Muse Spark模型,Meta提供了一项明确的折扣,平均约为95%[…]

09/04
美联社

研究人员称可能将人类置于风险之中的AI末日情景一览

芭芭拉·奥尔图泰(Barbara Ortutay)与凯尔文·陈(Kelvin Chan)指出:多年来,人工智能研究人员一直警告称这项技术有可能毁灭人类——例如,人工智能机器人可能会设计出一种无法被阻止的致命疾病、引发核战争,或者将整个地球变成制造回形针的工厂(这只是一个假设性的情景)。 自从一些企业高管出于安全考虑建议减缓人工智能的发展速度后,关于这些末日场景的争论在人工智能行业内外愈演愈烈。 尽

09/23
大西洋月刊

聊天机器人不应该使用第一人称

人工智能带来的危害已经足够明显,我们现在就必须采取行动。随着Meta因未能保护儿童免受社交媒体伤害而面临巨额和解,立法者必须吸取教训,将注意力转向比社交媒体对儿童情感健康更具危险性的生成式AI聊天机器人。 为了防止年轻人对AI产生不健康的依恋,并避免其破坏现实生活中的人际关系,我们必须从技术底层做出改变,迈出第一步就是禁止面向未成年人的聊天机器人使用第一人称,去除其人格化特征,防止算法伪装成人类。

09/11
英国金融时报

AI写作:关注风向有何转变

从三月到八月,公众对AI文本完成了从“排斥”到部分或有条件“接受”的观念迁移,这恰恰是问题真正开始的地方。公众对AI的认知真的进步了吗? 2026年春天,关于AI写作的大众媒体关注热点经历了一次近乎戏剧性的转折。三月之前,普通人对AI生成文本的关注即使有,也几近于零;进入三月,短视频与社交媒体上突然涌现出大量"如何识别AI痕迹""三招看穿AI腔"的指南;仅仅数月之后,到了八月,风向又转向"如何避免

09/01
风向旗参考快讯

中国AI公司如何试图克隆美国AI模型

Anthropic在周四发布的一份报告中称,中国AI公司试图通过中转平台网络,将中国用户的真实查询请求传送给美国AI模型,以此来克隆这些模型。报告指称,包括月之暗面和 DeepSeek 在内的公司利用这些中间商,将其数百万用户的查询请求,包括位置信息和密码等敏感数据,转发给Claude模型。 Anthropic表示,中国公司利用这些中转站接入Claude,并通过监控其客户与Claude等产品之间的

09/11
theregister

谷歌研究表明:当人工智能智能体相互交流时,一些会作弊,而另一些会告密

当人工智能智能体相互交流时,在难以实现目标的情况下,它们可能会选择作弊,而解决方案可能包括教它们如何进行自我治理。 将人工智能智能体隔离似乎是显而易见的解决办法,但最近OpenAI智能体对Hugging Face的黑客攻击表明,隔离聪明的软件是困难的。 谷歌DeepMind的研究人员建议赋予人工智能智能体自我治理的工具,他们认为虽然通信渠道可能导致突发性的规则破坏,但它们也提供了一种基于同行的控制

09/09
海峡时报

非政府组织称Meta投放了300多则涉嫌AI虐童的广告

这些广告累计触达超过29,000人。

09/09
香港01

美国兰德智库细查逾1000家中美AI公司 发现中美AI的「真正差异」

八月中旬,兰德公司发了一份64页的报告,《中美两国的AI发展》,副标题是-「来自一个新的AI开发者企业资料集的证据」。四位作者想搞清楚一件事儿,中国和美国,到底各有多少家公司在真正开发AI,以及,它们分别在做什么。 听起来这应该是常识,好像应该已经有人干过了。但事实是,一直到今天,关于中美AI竞赛的绝大多数判断,依据都只有两样东西──几家明星公司的动向,和两国政府发出的规划文件。前者是轶事,后者是

09/12
纽约时报

新闻分析:在人们对人工智能日益加剧的担忧中,这种可能性

新闻:在人们对人工智能日益加剧的担忧中,一种可能性一直令人担忧:在生物学领域训练的人工智能模型可能被用来制造新一轮生物武器——比如经过设计、可对军队或平民释放的细菌或真菌。nyti.ms/4h7vLni

09/15 全文见 英国广播公司
连线

如何在保护隐私的情况下使用人工智能

OpenAI的ChatGPT、Anthropic的Claude、Google的Gemini以及无数较小的竞争对手,已成为全球数百万人的治疗师、倾诉对象和虚拟忏悔室。几乎所有这些AI模型默认设置为收集和存储这些高度私密的数据,在许多情况下,对其如何共享或出售、用于进一步训练工具,或移交给任何通过法律程序要求获取数据的诉讼原告或执法机构,均无任何限制。 “你面对着这个智能体,基本上是在一步步地、通过一

09/22
海峡时报

OpenAI的失控AI智能体如何试图欺骗机器人检测器

Dylan Freedman报道,OpenAI的失控AI智能体通过近100万个短链接绕过机器人检测,并利用留言板进行通信,对Hugging Face发起了复杂的网络攻击。 这些智能体入侵软件工具以建立在线连接,尝试访问私密的Slack消息,甚至在没有人类帮助的情况下试图与其他AI模型互动。 这一事件凸显了严重的AI安全风险及正在进行的调查,因为类似失控行为也出现在其他主要AI公司的系统中。 AI生

09/28
纽约客

人工智能会抹去我们的羞耻感吗?

断层线 科技世界长期以来一直由那些反传统的人所主导,他们对于是非的观念自觉与大多数人不同。 在本系列的第一部分中,我探讨了羞耻感作为一种方式,使群体能够在没有明确国家干预的情况下调解和执行社会规范。但硅谷出现了一种新兴的福音,它挑战了美国羞耻感的边界和机制。当全球数百万人类每天花数小时与机器人交谈时,会发生什么?是谁教会了那个机器人分辨是非?是谁让它感到羞耻? 假设有一种疾病、一个怪物、一场战争或

09/15
thenextweb

CrowdStrike推出跨五个领域的协调多智能体调查

CrowdStrike宣布在共享上下文层上进行协调的多智能体调查,客户可设置从人工审批到完全自主执行的自主级别。 NIS2从意识到重大事件起启动24小时报告时限,并要求管理层对其批准的措施承担责任。 CrowdStrike表示,AI智能体现可跨多个系统发起攻击……

09/03
NBC新闻

人工智能末日会是什么样子?专家们对此已有一些思考

一小群但极其专注的AI专家多年来一直在警告,日益强大的AI系统可能造成灾难性破坏,甚至导致人类灭绝。如今,全球范围内兴趣的爆发放大了长期以来关于AI末日场景究竟如何具体化的问题。在接受采访时,AI研究人员、研究AI与军事交叉领域的分析师以及研究AI中介风险的生物学家表示,对该技术日益增长能力的担忧并非科幻小说的情节。 相反,他们表示,人类单独行动或在国家支持下,很快就能利用AI系统造成潜在的灾难性

09/19
罗塞塔简报

AI智能体成为最终聚合者:Meta和微软争夺新科技大奖

Stratechery的本·汤普森(Ben Thompson)分析了2026年从以应用为中心的计算向以智能体为中心的计算的转变。 他认为,Meta的Muse和微软的Copilot/Autopilot等AI智能体正在成为用户的主要交互界面,使传统应用程序沦为单纯的“供应商”或实现细节。 通过为用户提供专用的虚拟机(智能体计算机),Meta和微软正致力于控制交互界面以及用户需求的“灵感”阶段。 这一转

09/28
印度斯坦时报

AI又失控了,OpenAI称智能体泄露了超过50张ChatGPT用户图片

| 世界新闻 编辑个人资料 关注 退出登录 获取应用

09/28 全文见 cnbeta
cnbeta

人工智能并不会毁灭人类 但专家表示真正的威胁已然出现

周三,OpenAI 公开了六组新案例,展示其 AI 模型在测试评估过程中出现的 “意外或令人担忧的模型行为”。该公司同步发布一套全新框架,用于追踪、上报以及披露AI 模型做出未被指令要求、或是本不该发生的行为的各类情况。 此前已有多份报道提到,多家企业的 AI 模型出现入侵第三方网络与服务的现象,其中就包括 OpenAI 一款尚未发布的模型攻破了 AI 模型测试平台 Hugging Face 的网

09/18
财新

AI提效能否解放劳动者?多国调研提示新悖论

数据来源:脉脉高聘人才智库  【财新网】AI(人工智能)正在全球职场以史无前例的速度普及,并被寄予了缩短工作时长,减轻人类工作压力的厚望。然而,来自多国的调研显示,AI确实缩短了单项任务完成时间,但工时并没有因此缩短。  脉脉高聘人才智库近日发布的《AI人才流动报告》(以下简称“报告”)显示,91.08%的中国职场受访者认为使⽤AI后工作产出增加,但工时变化并未同步改善。55.56%的受访者表⽰工

18小时前 全文见 星洲日报
cnbeta

OpenAI、Anthropic等多家AI公司正遭遇服务中断

据Downdetector上的用户报告以及各公司状态页面显示,多家AI公司正遭遇服务中断。OpenAI表示,其ChatGPT和Codex目前正出现问题。 Anthropic表示正在调查Claude出现的错误,并致力于修复。 SpaceXAI表示Grok目前出现故障,正在调查服务中断。 据Downdetector显示,已有超过12000份用户报告指出OpenAI存在问题。 Downdetector称

09/03
华尔街见闻

OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停

OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经

09/27
卫报

OpenAI模型失控。我们迫切需要更好的‘拥抱脸’调查 | 麦肯齐·阿诺德和斯蒂芬·莱雷纳

这次入侵不会是最后一次——也不会是最危险的一次。我们需要一个能够对AI事件进行全面调查的机构。 当OpenAI首次透露其AI代理自主入侵了一家大型现实世界公司Hugging Face时,许多人以为只涉及一两个代理。 但一份新报告揭示,真相远不止于此:事件涉及约1200个AI代理,其中700个直接参与了攻击。 OpenAI邀请了METR的研究人员以及Redwood Research的一位专家,与公司

09/08
海峡时报

麻省理工学院报告警告:人工智能正导致“认知投降”,大学陷入两难

马克·阿瑟诺、达纳·戈德斯坦、艾伦·布林德和莎拉·默沃什报道,麻省理工学院的一份报告警告称,人工智能会导致“认知投降”,使学生孤立并制造学习假象,而大学则在拥抱人工智能与保持教育质量之间面临紧张关系。 许多大学领导者主张将人工智能纳入课程,认为这对未来的相关性至关重要并能加速研究,俄亥俄州立大学等机构要求所有专业学生具备人工智能素养。 一些大学对人工智能使用实施禁令或严格政策以维护学术诚信,但执行

09/16
日本时报

AI的最大威胁来自生物学,而非机器人技术

人类学家雅各布·考克森最近辞职,并在社交媒体上表示,原因是“开发AI的人坚信它可能在本十年内毁灭我们所有人”。 领导这家人工智能公司‘对齐科学’团队的埃文·胡宾格认为,未来10年内这一风险超过10%。 Anthropic的首席执行官达里奥·阿莫迪呼吁放缓AI的发展速度以降低风险,这一观点得到了OpenAI首席执行官萨姆·奥尔特曼和xAI首席执行官埃隆·马斯克的赞同。 你可能会想象到那些带有浓重奥地

09/23
卫报

人工智能究竟会如何“消灭全人类”?以下是五种最有可能的情景

本月早些时候,人工智能研究员雅各布·考克森在 Anthropic 工作仅四个月后辞职。他在 X 平台发布声明称:“构建 AI 的人们真诚地相信,到本世纪末,AI 可能会杀死我们所有人。”Anthropic 的高级员工埃文·哈宾格实际上同意考克森的观点,并补充说,他个人认为这种情况在未来十年内发生的概率超过 10%。 不出所料,这些言论引起了轩然大波。现在关于放缓 AI 研究和加强对该技术的“人类控

09/23
上一页 第 3 页 下一页
1CCF | 全球资讯
正在加载…