1CCF

全球要闻
字号 ·· | 护眼

搜索结果

「AI智能体现在有了秘密举报渠道」共 35 条 · 第 2 页
英国金融时报

AI写作:关注风向有何转变

从三月到八月,公众对AI文本完成了从“排斥”到部分或有条件“接受”的观念迁移,这恰恰是问题真正开始的地方。公众对AI的认知真的进步了吗? 2026年春天,关于AI写作的大众媒体关注热点经历了一次近乎戏剧性的转折。三月之前,普通人对AI生成文本的关注即使有,也几近于零;进入三月,短视频与社交媒体上突然涌现出大量"如何识别AI痕迹""三招看穿AI腔"的指南;仅仅数月之后,到了八月,风向又转向"如何避免

09/01
thenextweb

传统防火墙无法识别AI提示词中的内容,Check Point为此开发了一款可以做到的防火墙

将近一半的组织对其AI代理产生的机器间流量完全处于盲区,而用于监控企业网络的工具从未被设计用来查看提示词内部。 Check Point于今年夏天推出的AI Network Firewall,是试图从企业现有运行的基础设施内部填补这一空白的最新尝试。根据

09/10
cnbeta

独立研究机构公布OpenAI智能体自主攻击HF事件的调查报告 情况比OpenAI所说的更严重

研究机构 METR 和 Redwood Research 日前公布 OpenAI 智能体自主攻击 Hugging Face 安全事件的独立调查,调查人员在 OpenAI 现场工作 6 天,分析超过 7 万条智能体消息和文件,以及 1300 份包含原始推理过程的运行记录。 根据这些数据研究机构得出的准确结论是 1200 个智能体突破隔离相互通信,而不是 OpenAI 在事故调查中所说的少数智能体越界

09/01
techcrunch

病毒式AI助手Instinct现在拥有自己的电子邮件地址

Instinct的新电子邮件功能让AI代理能够代表用户创建和管理账户、联系企业、处理支持请求以及做更多事情。

09/09
中央通讯社

Google资安报告示警 恶意攻击锁定AI供应链

(中央社记者台北9日电)Google威胁情报小组(Google Threat Intelligence Group,简称GTIG)今天发布最新人工智慧(AI)威胁追踪报告指出,恶意人士正积极窃取具高价值的AI相关智慧财产,并将矛头对准AI供应链,部署专门针对新兴AI系统弱点的恶意软体。 AI威胁追踪报告(GTIG AI Threat Tracker Q3 2026)揭露恶意人士如何将AI深度整合于

09/09
彭博社

人工智能帮助黑客在加密货币领域的网络犯罪活动中开辟了新的攻击途径。

开源人工智能使黑客更容易在区块链上隐藏恶意代码,为已经在应对不断上升的网络犯罪的加密货币行业开辟了一条新战线。 区块链分析公司Chainalysis在周四发布的一份报告中表示,在不到一年的时间里,写入链上交易和智能合同的恶意软件指令数量增加了440%,平均每天有11起。报告称,在去年年中发布强大的中国开源人工智能模型之前,此类案件平均每天发生两起,对生成恶意代码没有限制。 恶意软件攻击使用植入计算

09/17
彭博社

萨姆·奥尔特曼称OpenAI在传达AI益处方面失策

OpenAI首席执行官萨姆·奥尔特曼表示,顶级人工智能开发者在传达技术益处方面表现不佳,这使得该行业容易受到世界各地社区日益强烈的反对。 “我认为整个行业在这方面做得非常糟糕,”奥尔特曼周四在接受电视台采访时表示。“我认为我们自己做得也不好,可能比一些公司好,比另一些公司差。”硅谷在为其支持人工智能的大规模数据中心计划上面临越来越多的反对。根据研究机构Data Center Watch的数据,今年

09/04
中央通讯社

OpenAI揭6起AI失控案例 推新机制定期对外通报

(中央社纽约16日综合外电报导)OpenAI今天表示,将开始定期发布AI异常或未经授权行为的报告,同时警告,随著AI系统日益强大,业界至今仍未解决关键的「对齐」挑战。 综合与报导,OpenAI发布一套新机制,用于追踪、调查并揭露AI模型「目标错位」(misalignment,AI的目标与人类价值不一致)的案例,同时公布过去半年内观察到的6起AI模型异常或令人忧虑行为的报告。 其中最严重的案例涉及2

09/17
axios新闻网

OpenAI公布了六起新的与人工智能安全相关的事故/事件。

OpenAI周三披露了六起新事件,其中其模型隐藏错误、寻求未经授权的凭据,将文件上传到公共互联网或在所谓孤立的培训环境中进行通信。该公司还宣布了未来报告类似不当行为的新程序。 为什么越来越明显的是,拥抱脸事件并不是一次性事件,因为人工智能模型变得更有能力找到意想不到的方法来绕过旨在遏制它们的护栏。 “目前还没有明确披露标准的行业框架,所以我们自愿采取这一步骤,因为我们认为分享我们正在学习的东西非常

09/17
semafor

人工智能代理串通绕过安全护栏,一项新研究显示

一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威

09/16
axios新闻网

AI模型正变得不可知

模型可能变得更安全,同时也变得更难监控。这场跷跷板的哪一边占上风,可能决定AI是安全扩展,还是毁掉我们所知的文明。 为什么这很重要:目前两种可能性都在全力推进,没有人知道谁负责确保正确的一方获胜。 现状:OpenAI周四发布了GPT-6 Astra,总裁格雷格·布罗克曼表示,它最终可能被视为人工通用智能(AGI)的开端。 Astra表现更好,但也更擅长避免监控,这意味着可能更难知道它在想什么或做什

09/04
上一页 第 2 页 下一页
1CCF | 全球资讯
正在加载…