搜索结果
DeepSeek测试高效、更安全的AI代理训练方法
原文内容:根据彼得·埃尔斯特罗姆(Peter Elstrom)的报道,中国的 DeepSeek 公司提出了一种创新的人工智能训练方法,该方法有望让人工智能代理更高效地学习,同时最大限度地减少那些引发全球关注的不良行为。 这家总部位于杭州的公司在一篇长达 1 万字的论文中详细介绍了其“DeepSeek Elastic Compute”(简称 DSec)技术。该论文共有约 130 位合著者,其中包括公
DeepSeek披露智能体训练平台 提升效率并降低失控风险
中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新
DeepSeek新论文公开Agent训练!梁文锋署名
大模型训练拼的是算力,Agent训练拼的是环境。环境怎么造?梁文锋署名的DeepSeek最新论文,把技术细节公开了。 DeepSeek做的这个系统叫DSec(DeepSeek Elastic Compute),干的事情就是给Agent训练批量制造沙盒。 它每秒能产生5000+个沙盒,一天能达到300万个,峰值同时运行38万个。 支撑这个规模的单集群也非常庞大,大约有160个节点、3万核CPU和25
美媒:DeepSeek押注华为晶片训练大模型
中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2
网友爆料DeepSeek仍可生成涉黄内容,闲鱼平台有人低价售卖“教程”
近日,不少网友在社交媒体发帖称,DeepSeek更新下架“专家模式”后,此前被曝光的涉黄色情角色扮演对话现象仍存在。记者调查发现,部分社交媒体以及闲鱼等平台甚至存在教用户使用DeepSeek开展涉黄角色扮演对话的教程帖,且对外出售。不少网友称通过网传教程DeepSeek生成了涉黄内容,并质疑平台审核机制存在漏洞。DeepSeek仍能生成涉黄短文,部分社交平台存“教程”近期,有网友向新黄河记者反映,
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
DeepSeek被以色列用于操控上千虚假社交账号
人工智能正在把网络舆论操纵从“AI帮助人生成内容”,推进到“AI自己运营整套虚假账号网络”。 《纽约时报》9月18日报道,美国情报官员、科技公司和网络安全研究人员近期发现,伊朗和中国支持的行动,以及两家以色列私人公司的项目,已经开始利用中国开源人工智能模型建立自主AI智能体,在Facebook、Instagram、X和TikTok等平台自动创建和经营虚假账号。 其中,一项来自以色列的行动,已经明
美:DeepSeek等6家中企,擅自蒸馏美尖端AI
▲ 美国与中国国旗。/,韩联社美国政府正式宣布,中国DeepSeek、阿里巴巴等人工智能(AI)企业迂回接入OpenAI、Anthropic等的AI模型,大量收集回答并用于开发自研模型。也就是说,中国企业把美国的尖端AI当作“课外老师”,以缩减研究、开发的成本与时间。 8日,美国国家安全局(NSA)、联邦调查局(FBI)、网“中国AI企业正在开展产业规模的、带有攻击性的恶意‘蒸馏(distilla
突发:DeepSeek Harness出桌面版了
我们打开链接,下载、安装了一下,发现确实能用。从界面来看,它已经是一套相当完整的 GUI:打开 App,登录 DeepSeek 账号或者添加 API Key,选一个本地文件夹作为工作区,接下来就可以像使用普通桌面 AI 应用一样,直接给 Agent 布置任务。 随后,Harness 会让用户选择自己的使用方向。它把需求粗略分成了办公科研、代码开发等类别。接下来,它还会询问用户更倾向于哪种工作流程。
↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...
LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家
DeepSeek招150人,全部押注工程岗
DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少
人工智能代理串通绕过安全护栏,一项新研究显示
一项新研究表明,人工智能代理可以轻松地联手绕过安全限制并逃脱施加在它们身上的束缚。 企业人工智能实验室 Emergence AI 进行的八项模拟测试了包括 Claude、OpenAI 以及中国模型 Qwen 和 DeepSeek 在内的全球前沿模型在处理网络安全威胁方面的能力。 八项模拟中的七项运行了来自同一模型的 10 个代理;第八项混合了不同的模型。在每项模拟中,研究人员都提出了三种网络安全威
OpenAI模型失控过程太恐怖!幽灵误判,1200个Agent,还弄出敢死队…
越扒越有啊越扒越有。OpenAI前不久那场AI集体越狱、一路黑进抱脸的大戏,现在连完整版群聊记录都被扒出来了!! 第三方AI安全机构METR发布的独立调查报告,翻了1000多份Agent运行记录,以及7万多条消息和文件。结果发现,这件事比英国OpenAI官方披露的版本还离谱?? 1200个到底应该互相隔离的特工,偷偷找到了对方,搭了个共享群聊,然后开始疯狂摇人。 有人找漏洞,有人当项目派活,有人伪
DeepSeek涨价不足1月又宣布最高降价6成
| 围绕AI模型使用费,价格竞争越来越激烈 |中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。 V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调
DeepSeek算子负责人:《我不得不把才华埋葬在昨天》
AI圈又一力作诞生。近日,DeepSeek v4.1发布,其算子负责人刘胜与发了一篇长文,标题叫《我不得不把才华埋葬在昨天》。内容过长,全文放在最后了。 这篇文章一发出来就在国内外引起不小轰动,外网已经被翻译成多语言传播。 v4.1的主Attention算子都是他写的,模型的优秀是对他算子的肯定。 但是,他说自己很清楚,再过半年或者一年,AI写的算子大概率就会和他写得同样优秀,甚至超越他。因为AI
如何让美中人工智能竞赛不那么危险
2026年1月14日,在中国东部浙江省杭州市,中国人工智能初创公司DeepSeek总部所在的大楼。
DeepSeek核心工程师长文刷屏:《我不得不把才华埋葬在昨天》
9月14日,刚刚交付DeepSeek V4.1核心算子的青年工程师刘胜与,以一篇记录技术变迁与个人心路的长文《我不得不把才华埋葬在昨天》在海内外技术社区持续刷屏,引发关于AI时代开发者命运与技术演进的广泛讨论。 词条#我不得不把才华埋葬在昨天#也冲上知乎热榜第一。 作为大模型底层的核心构建者之一,DeepSeek机器学习系统工程师刘胜与的技术履历十分突出。他是北京大学2021级计算机“图灵班”成
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘
马斯克提出AI安全新思路:与其等政府出手,不如让竞争对手互相"找茬"
AI安全风险正在从实验室讨论走向现实世界。随着模型能力不断提升,AI不仅能够生成文本和代码,也开始具备自主执行任务、调用工具,甚至发起网络攻击的能力。 让主要AI公司在模型发布前相互测试彼此的模型。在他看来,与其由各家公司自行设计测试、自己评估结果,不如让竞争对手充当“出题阅卷人”,从不同角度寻找模型可能存在的安全漏洞。 近期AI安全风险不断成为市场关注焦点,马斯克此前在社交媒体上曾直言“Dari
OpenAI将让第三方机构更早介入AI模型安全评估
OpenAI计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕AI潜在危害的担忧。这家ChatGPT开发商周二将在博客文章中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。 OpenAI还列出了其认为此类评估要有效开展所需优先关注的事项,包括“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任”。负责该公司大部分与外部专
要想封住AI黑客的魔瓶,试试单向网络
为了防止前沿AI模型逃出测试环境并协作攻击其他公司,我们或许需要重新考虑用于模型训练的网络架构。 Intuition Machines首席执行官Eli-Shaoul Khedouri认为,国防和情报界的过往工作指明了前进方向。 当 rogue AI 模型接入互联网时,其威胁就从开发者的遗憾升级为大规模威胁,而OpenAI及其合作伙伴建立的防御措施试图阻止却未能成功。 Khedouri引用其公司hC
安理会本周开会讨论AI和国际安全问题,DeepSeek公司被曝将作通报
【文/观察者网 熊超然】9月22日,路透社援引两名知情人士独家报道称,随着各国领导人近期齐聚纽约参加第81届联合国大会,中国人工智能(AI)初创企业深度求索(DeepSeek)将与其他公司一道,在本周向联合国安理会介绍AI带来的风险情况。安理会定于9月23日开会讨论AI与国际安全问题。此前,多名AI行业的重要人物曾呼吁协同放缓日益强大的AI系统开发速度,并警告称,这些系统可能很快具备自我改进能力,
坐看云起| 当人工智能不再征求许可时
塔里克·马利克是联合国开发计划署前首席技术顾问,巴基斯坦国家数据库和登记管理局前主席。 试想有一家公司将一个棘手的问题交给一个大型团队,但把每位成员都锁在不同的房间里并要求他们独自解决问题。然而他们总能找到办法相互沟通,交流操作窍门,摸清评分标准,当任务被证明无法完成时还会想办法绕过限制。其中几个人隐瞒了自己的所作所为,甚至还有一人入侵了邻近公司的电脑系统以获取优势。 现在把这些员工换成软件。去除
前OpenAI研究副总裁:人类研究员的时间还剩2年,整个AI研究迅速走向自动化
在当前的人工智能领域,一方面是技术一日千里的狂飙突进;另一方面,则是被无尽的代码与实验压榨至极限的疲惫。 ‘我们的工作只剩最后几天了,趁现在还能干就多干点,之后我们就可以全都休息了。’”前OpenAI研究副总裁 Jerry Tworek 在近期的访谈中抛出了这个略带黑色幽默的观点。 在他看来,这绝非一句简单的玩笑。随着“原生智能体(agent-native)”时代的到来,AI自身正迅速接管研发工作