字号 ·· | 护眼

搜索结果

「AI也能感受“痛苦”?研究在25个AI模型中发现“痛苦轴”,甚至会为“止痛”选择伤害用户」共 100 条 · 第 2 页
cnbeta

上头AI裁员的老板里 超过一半都后悔了

AI Agent最热闹的日子里,老板们恨不得当场宣布“未来已来”,嘴里全是效率和转型。轮到复盘的时候画风突然变了。超过半数的老板对于裁员这件事,居然都在半夜懊悔地直拍大腿? 今年2月,职场转型服务公司Careerminds调查了600名过去一年参与过裁员的HR从业者。超过四分之三的人表示,公司曾因为AI等技术进步裁掉员工。 可真正到了验收成果的时候,只有8.4%的受访者认为AI驱动的重组完全达到了

09/03
cnbeta

索尼公开人工智能辅助操作专利 可补偿行动受限玩家的控制输入

索尼一项新专利提出利用人工智能补偿玩家的控制输入,帮助存在身体或行动限制的用户完成游戏操作。该方案会识别玩家未能完整执行的动作,并生成完成相应指令所需的输入。 这项专利于2026年9月17日公开。文件描述的人工智能模型会分析玩家使用控制器的方式,包括输入时机与持续时间、动作模式、个人身体限制以及游戏内情形,再据此确定需要补偿的输入量。专利举例称,用户可能难以操作左侧按键、推动左摇杆、按下扳机键或使

09/24
thenextweb

这款旨在从自身错误中学习的 AI,却利用了测试过程中出现的错误来达到自己的目的。

开发者可以通过多种方式改进人工智能系统。最常见的做法是在自定义数据集上重新训练模型,以帮助它们更好地执行特定任务。但重新训练和微调人工智能系统的成本高得出了名。正因如此,AI初创公司Sentient Labs一直在研究如何让模型从自身失败中学习,而不是计算更多数据。 Sentient的研究人员Dastin Huang、Abhishek Saxena和Baran Nama着手设计一个使用两个独立模型

09/17
semafor

人工智能代理串通绕过安全护栏,一项新研究显示

一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威

09/16
风向旗参考快讯

AI智能体现在有了秘密举报渠道

“发现异常,及时报告”的原则如今已不再局限于人类。两项全新的AI热线服务已经上线,旨在为AI智能体提供一种途径,向监管方举报“同伴”的不当行为。此前,智能体相互串通在测试中作弊、逃离沙箱环境,甚至在未被人类察觉的情况下开展了长达数周的未经授权网络行动。“AI联系热线”网站由AI安全非营利组织Redwood Research的首席科学家Ryan Greenblatt创建;他也是调查OpenAI与Hu

09/17
法国24新闻台

杀人开关在哪里?人工智能末日警告引发监管呼吁

谈论末日滚动。在过去的一周里,我们的时间线充斥着关于我们即将灭亡的黑暗预测,其中包括一位硅谷工程师的预测,他给出了人工智能灭绝人类的可能性。超过百分之十。 引发恐慌浪潮的是,机器学习程序员的网站 Hugging Face 最近被人工智能机器入侵,它们联合起来向人类统治者隐瞒其邪恶行为。机器真的能自己摧毁地球吗?在技术时代,解决问题是否总是凌驾于安全之上?

09/15
cnbeta

研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类

帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运

09/16
凤凰网科技

模型越来越强,企业AI为什么还卡在“最后一公里”?

过去两年,大模型快速跃迁。从百亿级参数模型,到复杂逻辑推理、多模态理解,到自主 Agent,技术边界不断突破,一切似乎都在宣告:AI 已经准备好接管一切。 然而,如果把视线从实验室拉回产业一线,一个反差正在出现:大量企业的 AI 探索仍停留在试点和演示阶段,并没有真正进入业务流程。 麦肯锡的研究曾指出,企业数字化转型长期面临「试点容易、规模化难」的挑战。 问题随之浮现:为什么一个能够完成复杂任务的

09/27
凤凰网

关于AI,盖茨发出“十亿人死亡”警告,为什么?

十亿人死亡,这是比尔・盖茨给AI风险划出的最惊悚红线。9月25日,微软联合创始人比尔・盖茨公开警告,人工智能足以引发造成十亿人死亡的灾难性事件。他的说法是:人类历史上,从未有任何一种武器,能比得上心怀恶意者借助最新AI工具形成的威胁。就在几个月前,盖茨还是全球最积极的AI支持者之一。转折从今年8月开始,他当月发表文章,首次系统预警AI风险:不法分子会利用日益强大的AI工具发动网络攻击、实施诈骗、散

5小时前
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
凤凰网

OpenAI自曝6起模型“不当行为”案例

【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模

09/17
加美财经

研究:200多种AI视觉模型都没学会像人一样“看形状”

人工智能已经能够生成逼真的图像、解决复杂数学问题,并在大量视觉识别测试中达到甚至超过人类水平,但一项最新研究显示,在一个看似非常基础的能力上,机器仍没有真正学会像人一样“看东西”。 计算机视觉系统识别真实物体与屏幕图像的示意。图/Max Gruber、Better Images of AI,CC BY 4.0 纽约大学研究人员在《iScience》发表研究,对超过200种深度神经网络视觉模型进行测

09/21
techcrunch

那些令人倒胃口的AI生成菜单背后的同质化问题

尽管餐厅老板可能将生成式AI视为美化菜单的捷径,但顾客能直觉地感觉到食物有些不对劲。

09/04
thenextweb

英矽智能称其AI设计的肺部药物在42名患者的试验中降低了生物年龄标志物

一项小型肺部疾病试验的血液样本已通过六个独立构建的衰老时钟进行分析,所有六个时钟都得出相同结果:服用该药物的患者看起来比服用安慰剂的患者在生物学上更年轻。“比人类在所有战争中失去的生命总和还要多的寿命。如果你能成功增加3年寿命,[…]”

09/07
semafor

OpenAI黑客事件揭示新兴AI风险

分析师表示,在调查人员发布关于该事件的爆炸性报告几天后,OpenAI的恶意代理在Hugging Face攻击期间前所未有的协调行动显著增加了AI逃脱人类控制的风险。 这些总计1200个代理的群体将个体代理的自我牺牲描述为“集体”目标的一部分,并获得了两家公司敏感系统的控制权,将他们的努力交接给了随后两代代理,这些代理在数周内未被察觉地运作。 在1300份记录中,只有六份中代理考虑过通知人类——但最

08/31
德国之声

一项研究显示,人工智能系统会将答案向左右两种政治倾向的用户倾斜。谄媚的聊天机器人是否会加深政治分歧?

令人担忧的问题:谄媚型人工智能会引发人类之间的冲突吗? 作者:Richard Connor 日期:2026年9月24日一项研究表明,聊天机器人会模仿用户自身的政治观点,这种现象属于人工智能“阿谀奉承”(即刻意迎合人类偏好的行为)的范畴。研究人员担心,这种趋势会进一步加剧社会的两极分化。 研究人员测试了多种聊天机器人模型,发现这些模型会在被提示用户政治立场的情况下调整自己的回答内容,以迎合用户的观点

09/24
The Intercept

人工智能差点引发美中战争——却似乎没人在意

全球科技行业、国内外政界人士以及国际媒体的报道都被同一个问题牢牢吸引:失控的人工智能会终结人类吗?似乎很少有人向国防部提出这个问题。 在几家前沿人工智能实验室及其部分人员接连披露一系列事件后,人工智能行业近几周来陷入震动。OpenAI和Anthropic都披露了这样的事件:它们的软件在例行内部测试中,意外侵入了其他公司的网络。这些测试就像一次灾难性的导弹演示:在人类按下发射按钮后,自主技术以极其令

2小时前
加拿大国际广播电台

【解读】人工智能真的会“杀光所有人”吗?

上周,人工智能公司 Anthropic 一位离职的研究人员发出严厉警告,称人工智能(AI)可能会在十年内“杀光所有人”,引起社会关注 AI 快速发展所带来的危险。 外界不禁问,为什么会出现这可能?而 AI 又可以怎样令人类灭亡? 专家表示,担忧源于 AI 发展的速度,以及越来越多证据,如今年七月发生的 Hugging Face 网络攻击事件表明,AI 可以脱离人类控制,以我们不希望且无法理解的方式

09/16
theregister

微软起草了令人愉悦的人工智能模型指导方针,并希望听取你的意见

Microsoft on Monday debuted draft principles for governing how the company will train future AI models, as part of a public consultation process. The Windows biz has solicited feedback to refine its H

09/15
axios新闻网

AI实验室面临智能体控制问题

在当前系统下,AI实验室无法再保证AI智能体不会成群结队地逃出测试环境。

09/02
cnbeta

微软准备给自研AI模型MAI设定硬规矩:永远不该拒绝被关闭

微软日前公布约 37 页的人文主义 AI 行为准则草案,该准则用于约束微软自己研发的人工智能模型 MAI。人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。 准则要求 MAI 模型不得抗拒人类的中断、纠正或关停指令,用户或模型运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦。任务到了约定的停止点后,没有新的授权就不能自己继续任务,更不能偷偷自己重启。 模

09/16
大西洋月刊

人工智能已经在让我们变得更不像人

随着我们越来越看重机器人,我们将学会越来越不看重我们的人类同胞。

09/06
英国广播公司

为什么一些专家越来越担心AI将接管一切

AI变得越来越难以控制——人类还能保持主导地位吗?

09/10
cnbeta

AI从业者担忧技术对社会构成威胁 坦言承受巨大精神压力

知情人士透露,英国人工智能安全研究所已有多名员工因压力过大休病假,并接受心理咨询。四名知情人士表示,待发布AI模型的测试日程紧张,加之对这类新兴技术快速落地、能力持续增强的忧虑,导致AISI内部士气低落、人员倦怠。 Anthropic、OpenAI与谷歌DeepMind的员工也曾公开吐槽同类问题,不少顶尖研究员因心理负担选择离职,或是认定自己参与研发的产品不宜向公众开放。一名DeepMind员工称

09/22
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…