搜索结果
OpenAI的Jev克隆可能帮助这家前沿实验室阻止其蜂群智能体
周二,OpenAI 开发者大会(Dev Day)上的一项引人注目的公告来自首席执行官萨姆·奥特曼(Sam Altman)的旁白,他透露了公司新的“决策 API”(Decisions API)。该 API 显然提供了与 Jev 类似的功能,Jev 是 TypeSafe AI 本月早些时候发布的一个专为软件自动化设计的模型。Jev 是一种基于大语言模型构建的超级分类器,开发者可以为其提供一组选项,它能
AI智能体接连失控 OpenAI再次叫停前沿模型开发
OpenAI对外表示,已暂停其最新一代人工智能模型的训练、评估,以及支持工具调用的推理工作,起因是内部测试中的AI智能体突破沙盒网络限制,触发安全预警,公司将借此机会升级安全隔离与对齐监控体系。 这也是OpenAI三个月内第二次叫停前沿模型开发工作。该公司在声明中表示,只有在完成额外安全防护升级、确认风险可控后,才会重启模型训练工作。OpenAI在9月25日发布技术报告披露了这一安全事件:9月20
Codex和Claude Code都跑偏了,前OpenAI研究员称Jev出现前AI世界是个悲剧
“它会逐渐退到软件背景中,像数据库、正则表达式或其他基础设施一样,成为开发者随手调用的普通能力。” 这是 TypeSafe CEO、Jev 创始人 Diogo Almeida 对 AI 的设想:当智能真正融入软件,用户甚至不必意识到它的存在。但怎样才能让开发者放心地把判断交给 AI,而不用守在旁边反复检查? 几个月前,在 AI Engineer 大会的演讲中,这位曾参与 OpenAI Instru
美中AI竞赛升温 OpenAI点名月之暗面复制模型
(中央社旧金山30日综合外电报导)OpenAI表示,已发现并阻止一场协同发起的行动,操作者企图从AI模型中取得受保护的推理过程,OpenAI指出此行动的核心群组与中国新创公司月之暗面有所关联。CNBC报导,OpenAI表示,这起行动始于7月初,随后在两天内激增,来自4000多名用户提出1.6万次请求。OpenAI最终在1.5万多名用户的群组中发现相关活动,并表示已于7月28日完全阻止这场行动。这项
Jev正在迅速崛起,挑战LLM在企业AI领域的霸主地位
随着AI正在重塑科技世界,它反过来也在等待更伟大的事物出现并重塑它,而这股不可阻挡的力量可能正是TypeSafe AI的新模型Jev。你可以
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网
AI造出了病毒,完成首杀
科学家把一些物质注入了溶液中的大肠杆菌。没过多久,显微镜下的细胞壁爆破,细菌死了。 杀死这个大肠杆菌的,是使用人工智能软件Evo研发的噬菌体病毒。 今年8月,来自斯坦福大学和Arc研究所的科学家在人工智能生成的数千种基因组中,发现其中16种是具有生命力并且能够吞噬耐药性大肠杆菌的病毒。 可以说,这是人工智能第一次成功“制作”出有机生物体。负责研发的机构发布报告称,这项研发“为针对快速演变的病原体开
啥题啊能干崩OpenAI最强模型训练
OpenAI首席科学家警告:AI公司应放慢开发步伐 没有人为后果做好准备
据《商业内幕》报道,就在OpenAI发布了性能强大的新模型几天后,该公司首席科学家呼吁放慢AI的发展速度。当地时间周日,OpenAI首席科学家雅库布·帕乔基(Jakub Pachocki)发布长文称,他担心“没有人对机器智能持续快速崛起所带来的后果做好准备”。 他说,尽管OpenAI正在内部研发技术解决方案,以更好地控制强大的AI智能体,但“还需要更广泛的干预措施”。他尤其担心,随着AI智能体变得
OpenAI正在为AI工具构建“自动关闭”能力,致立法者的信函称
英伟达推出新系统为AI代理设置护栏
英伟达周一发布了一个新平台,旨在从软件和硬件层面为人工智能(AI)智能体设置护栏,此前各大AI公司不断发现其智能体出现“失控”的新案例。这家芯片制造商的系统由两部分组成——OpenShell和Sentry。OpenShell是一款开源软件,用于限制智能体的行为;而Sentry则运行在芯片层面,作为额外的安全层。 “迄今为止,模型安全主要侧重于通过训练让模型表现良好,”英伟达企业AI副总裁贾斯汀·博
入侵美澳政府网站!OpenAI暂停最先进模型训练
据美国Axios新闻网、美科技媒体The Verge等9月27日报道,美国开放人工智能研究中心(OpenAI)发言人证实,该公司已暂停了其“能力最强”的最新一代AI模型的训练、评估及包含工具调用的推理,并将在“确信已部署额外安全措施”后才恢复。触发这次暂停的,是一个在离线沙盒中执行搜索训练任务的AI智能体。根据OpenAI于周五(25日)发布的安全漏洞报告,当地时间9月20日,该智能体发现无法直接
靠机器热源“说话”:OpenAI研究员警告“断网”也困不住未来AI
Anthropic称其阻止了可能制造生物武器的努力
突发新闻:Anthropic表示,它阻止了科学家利用其人工智能模型进行可能有助于开发生物武器的研究。 在这份新报告中,这家AI初创公司补充说,它无法确定该研究是合法的还是邪恶的,因此公司停止了这项工作。
亚马逊发布自家Jev克隆版,决策模型席卷网络
亚马逊网络服务(AWS)发布了一款受 TypeSafe 的 Jev 启发的开源决策模型,随着 AI 开发者越来越寻求比前沿大语言模型(LLM)更适合计算机自动化的智能。 亚马逊的 Strands Decider 2B 在 OpenAI 宣布类似产品的同一周发布,它是一种高速、低成本的方法,用于在预先决定的选项中进行挑选,并提供其对选择的确信程度。该模型完全开源,现已推出,且体积小到足以在本地运行。
知名计算机教授抨击工智能实验室狂妄的“救世主”情节,呼吁国会调查末日主义意识形态
过去几个月里,OpenAI和Anthropic两家领先的前沿人工智能实验室表现出了一些狂妄的行为。他们不仅宣传其代理系统的威力,还公开讨论技术可能导致人类灭绝的问题。这种弥赛亚式的思维模式让他们不仅不道歉,反而要求政府放慢潜在竞争对手的速度,以确保其领先地位。我呼吁国会启动公开的事实调查任务,以揭露OpenAI和Anthropic正在进行的研究项目、其运作方式及具体目的。调查应关注以下三点:首先,
Jev周末爆了:一个参与造出GPT的人,开始反思RLHF—AI不该永远需要人盯着
这两天,一个有点反常的AI模型突然刷屏了。 它叫 Jev。 不会聊天,不写代码,甚至不会像ChatGPT一样给你生成一大段答案。它只干一件事:做判断。 但就是这样一个看起来“能力被砍了一大半”的模型,却突然在开发者圈火了。 有人用它40秒分析724条实时广告,总共做出8724次判断;有人把它接进Claude Code,专门清理没用的上下文;还有人让它给AI Agent当“裁判”,检查任务到底有没有
得不到就强攻?曝OpenAI智能体曾尝试“暴力破解”联合国机构网站
IT之家 9 月 28 日消息,据外媒 The Verge 今天(28 日)凌晨报道,安全研究人员罗文 · 霍华德-琼斯称,今年 4 月至 6 月,OpenAI 智能体对联合国贸易和发展会议(UNCTAD)的统计网站发起了超过 16000 次扫描。 这起事件还没有严重到 Hugging Face 遭黑客攻击或近期美国政府网站遇袭的程度,却再次引发了一个令人担忧的问题:AI 智能体为了完成任务,会突
#观察 OpenAI DevDay的现场演示似乎准备不足,Dot智能体响应过慢,一度陷入“非静止状态”;Codex演示中的语音聊天无法正常启动。
#观察 OpenAI DevDay的现场演示似乎准备不足,Dot智能体响应过慢,一度陷入“非静止状态”;Codex演示中的语音聊天无法正常启动。这次笑得最大声的可能会是马斯克,因为dot. com目前会自动跳转到Grok Bot官网,抢了OpenAI的风头。https://x.com/Vincent_AINotes/status/2105019060941729989/video/1https:/
AI代理正在失控
你好,欢迎来到 TechScape。我是主持人布莱克·蒙哥马利(Blake Montgomery),《卫报》美国科技编辑。此时此刻,纽约市窗外正风雨交加。今天在科技领域,我们要讨论一系列令人担忧的 AI 公司披露信息。 AI 智能体在走向主流之际失控。这些智能体正在失控,它们的制造者无法对其进行约束。然而,每个人却都在使用它们。 自周五以来,OpenAI 发布了一系列披露信息,大幅且令人担忧地扩大
AI智能体之争升温!OpenAI被曝加紧备战Grok Bot与Muse
AI 智能体竞争焦点正从 “会聊天” 转向 “能办事”。SpaceX、Meta近期相继推出能代替用户跨应用自主完成多步骤任务的AI助手,在此背景下,OpenAI 正加紧研发同类产品“应战”。 OpenAI 正在开发一系列新功能,直接对标 SpaceX 上月推出的 Grok Bot;与此同时,另有知情人士透露,OpenAI公司管理层还曾讨论推出一款专门的个人AI助手,以抗衡Meta本月发布的Muse
OpenAI 向 100 多个团体发出关于流氓 AI 代理活动的警报
研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类
帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。 为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运
AI编程工具中存在的“0点击远程代码执行(RCE)”漏洞可能会让攻击者轻易获得系统控制权。
研究人员表示,一个允许远程代码执行的零点击漏洞影响了所有主流人工智能编程代理——包括 Anthropic 的 Claude Code、OpenAI 的 Codex、Google 的 Gemini CLI、Microsoft 的 Copilot 以及微软旗下的 GitHub Copilot。该漏洞可能使攻击者能够完全访问代理所能触及的所有资产和数据。据专注于保护企业级 AI 代理的安全初创公司 Ai