搜索结果
安理会本周开会讨论AI和国际安全问题,DeepSeek公司被曝将作通报
【文/观察者网 熊超然】9月22日,路透社援引两名知情人士独家报道称,随着各国领导人近期齐聚纽约参加第81届联合国大会,中国人工智能(AI)初创企业深度求索(DeepSeek)将与其他公司一道,在本周向联合国安理会介绍AI带来的风险情况。安理会定于9月23日开会讨论AI与国际安全问题。此前,多名AI行业的重要人物曾呼吁协同放缓日益强大的AI系统开发速度,并警告称,这些系统可能很快具备自我改进能力,
梁文锋用沙盒开启RSI
DeepSeek联合清华大学发表了一篇文章,署名的最后一人是梁文锋。 文章表面上是说DeepSeek训练Agent所使用的沙盒,但是论文第6节越看越不对劲。字里行间写了三个英文字母:RSI。 通过这个沙盒,Agent能创建自己需要的环境,这个环境会再次训练Agent,被训练的更强的Agent会创造更好的环境。由此形成了一个小型的RSI闭环。 也正是因此,沙盒,或许成为了开启RSI第一场战争的一把钥
美媒:DeepSeek押注华为晶片训练大模型
中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向。图为DeepSeek位于北京的办公室。(路透社档案照片) 美国媒体报道,中国人工智能(AI)企业深度求索(DeepSeek)正将使用华为等国产晶片训练大模型列为重要战略方向,以降低对英伟达的依赖,应对美国先进晶片出口管制带来的限制。路透社转引美国科技媒体The Information星期一(9月2
↩️ 据科技媒体 The Information 报道,DeepSeek 创始人梁文锋向投资者表示,采用华为芯片进行训练是 DeepSeek 最核心的战略赌注之一,预计华为最早将于 2026 ...
LoopDNS资讯播报: 中国国产AI芯片迈入大模型训练与海外输出阶段 国产AI芯片正打破“只能推理、无法训练”的认知:美团万亿参数模型“LongCat-2.0”已成功在5万颗国产芯片集群上完成预训练,表明国产硬件已具备大规模训练能力;同时,华为正向中东及中亚客户销售搭载DeepSeek-V4模型的升腾950DT系统。美国旨在限制中国AI芯片能力的出口管制,反而促使部分同样面临英伟达供应限制的国家
T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身
DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域
DeepSeek新论文公开Agent训练!梁文锋署名
大模型训练拼的是算力,Agent训练拼的是环境。环境怎么造?梁文锋署名的DeepSeek最新论文,把技术细节公开了。 DeepSeek做的这个系统叫DSec(DeepSeek Elastic Compute),干的事情就是给Agent训练批量制造沙盒。 它每秒能产生5000+个沙盒,一天能达到300万个,峰值同时运行38万个。 支撑这个规模的单集群也非常庞大,大约有160个节点、3万核CPU和25
短视频平台恶意举报 被做成明码标价的生意
短视频绘画博主“WORLD”的6月,过得很煎熬。一个近6万粉丝的账号被封禁,另一个26万粉丝账号的视频被下架。封禁和下架,都源于被同一人举报投诉。对方的来意很直接——“打钱消灾”。“WORLD”转账1000元后,对方撤销投诉,视频得以恢复。 做运动营养打假测评的博主贾博钧也有相似遭遇。8月14日上午,50分钟内,他的8条打假视频被集中投诉下架,理由均为“侵犯肖像权”——但视频里出镜的只有他本人。他
DeepSeek测试高效、更安全的AI代理训练方法
原文内容:根据彼得·埃尔斯特罗姆(Peter Elstrom)的报道,中国的 DeepSeek 公司提出了一种创新的人工智能训练方法,该方法有望让人工智能代理更高效地学习,同时最大限度地减少那些引发全球关注的不良行为。 这家总部位于杭州的公司在一篇长达 1 万字的论文中详细介绍了其“DeepSeek Elastic Compute”(简称 DSec)技术。该论文共有约 130 位合著者,其中包括公
DeepSeek招150人,全部押注工程岗
DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少
↩️ 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引...
LoopDNS资讯播报: 路透:据两位知情人士透露,中国人工智能初创公司深度求索(DeepSeek)已选定中信证券为其在上海科创板进行首次公开募股(IPO)做准备。 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引进。严文韬将带领DeepSeek冲刺首次公开募股,此前该公司已选定中信证券
OpenAI失控Agent找DeepSeek、Kimi当外援 近百万条作案短链曝光
OpenAI,又被扒了…近700个OpenAI智能体组团攻入Hugging Face,这事儿快有两个多月了吧。谁曾想,直到今天还在发酵??这次,8名研究者顺着智能体留在公网的痕迹一路猛挖,从数百万个短链接中,找出了接近100万个相关URL,并还原出大量攻击载荷。 翻Hugging Face内部Slack、扫描内网、外传数据、尝试销毁痕迹……还有的Agent把搜刮到的服务器资源和凭证,直接叫作「LO
DeepSeek V4.1 Flash内测:采用新结构 原生多模态支持
9月8日,DeepSeek今日在官方交流群内发布通知,DeepSeek V4.1 Flash的中间版本内测。据介绍,模型采用了新的模型结构,原生多模态支持、能力更强、速度更快、且成本更低。模型的base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用。当前计费与deepseek-v4-flash相同,每账号限流20并发。 据了解,DeepS
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
DeepSeek让记忆体股票投资者重新审慎
在DeepSeek最新人工智能模型引发对需求强度的疑虑后,重返韩国记忆体制造商股票的基金经理们再次受到警示。 三星电子和SK海力士股价周五均下跌超过3%,回吐了7月大幅抛售后的初步反弹。 DeepSeek表示已减少其AI模型所需的高带宽内存数量,这加剧了市场对科技股的担忧,同时市场还担心美国加息。 此前,由于大型科技公司持续支出的迹象、股价估值低廉、丰厚盈利和慷慨的股东回报,市场对这两家芯片公司的
抖音公告:下架、禁言、封禁
9月22日,抖音黑板报发布《抖音关于严厉打击各类违规导流内容的公告》。为持续营造健康清朗的网络生态,保障广大用户合法权益,抖音坚持对各类违法违规行为零容忍、严打击、重处置。随着治理的深入,平台发现部分违规用户以日常分享、展示户外探索、塑造人设等方式,隐晦宣传烟草、捕猎野生动物等内容,并借助暗语黑话、谐音变体等方式,为站外交易导流,扰乱平台秩序。对此,平台持续加强风险巡查、模型识别、人工审核和举报研