搜索结果
DeepSeek的烦恼:任务越来越多,人不够用了
以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。 崔添翼贴文截图两天后,DeepSeek又宣布下调Flash系列I价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘
DeepSeek招150人,全部押注工程岗
DeepSeek的人才扩张还在继续,但枪口已经调转方向。9月8日,DeepSeek启动新一轮招聘,计划招募约150名工程师,岗位全部集中于服务端开发工程师与Agent弹性计算研发工程师两个方向,重点面向2至10年经验的资深后端工程师,未设AI研究类岗位。 这是DeepSeek在两个多月内的第二次大规模招贤。6月25日,DeepSeek曾在官方公众号宣布“随着技术演进,正努力将所有部门的规模扩大至少
DeepSeek核心工程师长文刷屏:《我不得不把才华埋葬在昨天》
9月14日,刚刚交付DeepSeek V4.1核心算子的青年工程师刘胜与,以一篇记录技术变迁与个人心路的长文《我不得不把才华埋葬在昨天》在海内外技术社区持续刷屏,引发关于AI时代开发者命运与技术演进的广泛讨论。 词条#我不得不把才华埋葬在昨天#也冲上知乎热榜第一。 作为大模型底层的核心构建者之一,DeepSeek机器学习系统工程师刘胜与的技术履历十分突出。他是北京大学2021级计算机“图灵班”成
↩️ 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引...
LoopDNS资讯播报: 路透:据两位知情人士透露,中国人工智能初创公司深度求索(DeepSeek)已选定中信证券为其在上海科创板进行首次公开募股(IPO)做准备。 9月21日,原高瓴创投合伙人严文韬正式入职DeepSeek,至此该公司成立三年来CFO长期空缺的局面宣告结束,这也是这家AI公司迄今为止最重要的一次非技术高管引进。严文韬将带领DeepSeek冲刺首次公开募股,此前该公司已选定中信证券
据报道,DeepSeek 的年化收入运行率已达到 10 亿美元
据《The Information》报道,中国人工智能实验室 DeepSeek 目前的年化收入运行率已达到 10 亿美元,是几个月前不到 5 亿美元的两倍多。 该报告援引了两名直接知情人士的消息,DeepSeek 尚未对此置评。收入的激增归因于近期价格的上涨以及对其模型持续稳定的需求。 据《南华早报》当时报道,DeepSeek 在 8 月份曾警告开发者其 API 价格即将大幅上涨。 据《The I
DeepSeek年化营收达10亿美元,拟融资75亿美元
。DeepSeek的年化营收运行率已达到10亿美元,较几个月前的不到5亿美元翻了一番以上。这一增长归因于近期的提价及其AI模型的持续受欢迎。 据两位直接知情人士透露,这家初创公司正致力于在2026年10月底前完成约75亿美元的融资轮。
T早报|DeepSeek扩招150人;Meta发布个人AI智能体Muse;华为“韬定律”芯片麒麟9050 Pro首现身
DeepSeek扩招150人 为史上单次最大规模招聘9月8日,DeepSeek发布招聘信息,招聘人数达到150人。招聘包含两大方向,一类是服务端开发工程师,覆盖大模型研究平台、Agent框架组件、研发效率基建、DeepSeek I、线上服务、数据工程六大方向;另一类则是Agent弹性计算研发工程师,涉及平台开发和底层系统。DeepSeek Harness团队负责人崔添翼在社交平台称,这个计算机领域
DeepSeek算子负责人:《我不得不把才华埋葬在昨天》
AI圈又一力作诞生。近日,DeepSeek v4.1发布,其算子负责人刘胜与发了一篇长文,标题叫《我不得不把才华埋葬在昨天》。内容过长,全文放在最后了。 这篇文章一发出来就在国内外引起不小轰动,外网已经被翻译成多语言传播。 v4.1的主Attention算子都是他写的,模型的优秀是对他算子的肯定。 但是,他说自己很清楚,再过半年或者一年,AI写的算子大概率就会和他写得同样优秀,甚至超越他。因为AI
DeepSeek新论文公开Agent训练!梁文锋署名
大模型训练拼的是算力,Agent训练拼的是环境。环境怎么造?梁文锋署名的DeepSeek最新论文,把技术细节公开了。 DeepSeek做的这个系统叫DSec(DeepSeek Elastic Compute),干的事情就是给Agent训练批量制造沙盒。 它每秒能产生5000+个沙盒,一天能达到300万个,峰值同时运行38万个。 支撑这个规模的单集群也非常庞大,大约有160个节点、3万核CPU和25
DeepSeek年化收入据报达10亿美元 梁文锋:加价未造成客户流失
美国科技媒体《The Information》报道,DeepSeek行政总裁梁文锋在近期投资者会议上披露,公司最新的年化收入由数月前的不足5亿美元大增至10亿美元(约78亿港元),受惠于近期上调API定价,以及其大模型持续受到市场追捧。 《The Information》分析,此次营收大幅跃升,部分原因在于公司将旗下模型的定价提高了2.3至4.5倍。梁文锋在会上表示,加价并未造成客户流失,用户需求
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
DeepSeek测试高效、更安全的AI代理训练方法
原文内容:根据彼得·埃尔斯特罗姆(Peter Elstrom)的报道,中国的 DeepSeek 公司提出了一种创新的人工智能训练方法,该方法有望让人工智能代理更高效地学习,同时最大限度地减少那些引发全球关注的不良行为。 这家总部位于杭州的公司在一篇长达 1 万字的论文中详细介绍了其“DeepSeek Elastic Compute”(简称 DSec)技术。该论文共有约 130 位合著者,其中包括公
8万亿,梁文锋也开始卷“超大”
DeepSeek也加入参数大竞赛了。据The Information报道,DeepSeek目前正在训练一个约2万亿参数的新模型;梁文锋还在近期一场投资者会议上表示,公司下一步计划继续把模型推到8万亿参数。放在一年前,8万亿还是个难以想象的数字。 但现在,Kimi K3已经做到2.8万亿参数;字节正在预训练一个最高可能达到10万亿参数的新模型;阿里也公开表示,下一代模型将向5万亿到10万亿参数推进。
DeepSeek让记忆体股票投资者重新审慎
在DeepSeek最新人工智能模型引发对需求强度的疑虑后,重返韩国记忆体制造商股票的基金经理们再次受到警示。 三星电子和SK海力士股价周五均下跌超过3%,回吐了7月大幅抛售后的初步反弹。 DeepSeek表示已减少其AI模型所需的高带宽内存数量,这加剧了市场对科技股的担忧,同时市场还担心美国加息。 此前,由于大型科技公司持续支出的迹象、股价估值低廉、丰厚盈利和慷慨的股东回报,市场对这两家芯片公司的
OpenAI、Anthropic等多家AI公司正遭遇服务中断
据Downdetector上的用户报告以及各公司状态页面显示,多家AI公司正遭遇服务中断。OpenAI表示,其ChatGPT和Codex目前正出现问题。 Anthropic表示正在调查Claude出现的错误,并致力于修复。 SpaceXAI表示Grok目前出现故障,正在调查服务中断。 据Downdetector显示,已有超过12000份用户报告指出OpenAI存在问题。 Downdetector称
DeepSeek据报聘中信证券筹备科创板上市
中国人工智能(AI)初创企业深度求索(DeepSeek)据报已聘请中信证券,为在上海科创板首次公开募股(IPO)做准备。 星期三(9月9日)引述知情人士报道,这家总部位于杭州的公司计划今年启动IPO程序。拟在中国上市的企业,通常会在正式提交申请前聘请证券公司进行上市辅导。 但知情人士说,DeepSeek上市的具体时间、募资规模和目标估值目前均未确定。 在中美头部AI企业竞争日趋激烈之际,DeepS
DeepSeek被曝冲刺5000亿元估值!年化营收达67亿
智东西9月24日消息,据外媒The Information今日报道,两名直接知情人士透露,DeepSeek目前的年化营收运行率已经达到10亿美元(约合人民币67.13亿元),较几个月前不足5亿美元的水平翻了一倍以上。 这一最新数据被曝是由DeepSeek创始人兼CEO梁文锋在近期一次投资者会议上披露。近期模型涨价叠加持续增长的市场需求,共同推动了DeepSeek营收提升。 与此同时在敲定新一轮融资
DeepSeek 新模型为运行轻量化的强大大语言模型树立了模板
中国人工智能明星企业 DeepSeek 于周四推出了其成本与延迟优化型 Flash 模型的新版本 v4.1。 该版本包含的架构改进比常规点版本(point release)预期的更为显著,这些改动可能会为更大、更聪明且资源消耗更少模型的发展打开大门。 这款拥有 7630 亿参数的点版本模型体积是其所取代模型的大约 2.5 倍以上。 事实上,该模型的规模甚至超过了曾在 2025 年初让 DeepSe
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
中国DeepSeek聘请交易高手担任CFO,为可能的IPO做准备
据两位知情人士透露,DeepSeek计划聘请风险投资公司GL Ventures的合伙人闫文涛担任其首任首席财务官,这家中国AI初创公司正在为潜在的首次公开募股做准备。
突发:DeepSeek Harness出桌面版了
我们打开链接,下载、安装了一下,发现确实能用。从界面来看,它已经是一套相当完整的 GUI:打开 App,登录 DeepSeek 账号或者添加 API Key,选一个本地文件夹作为工作区,接下来就可以像使用普通桌面 AI 应用一样,直接给 Agent 布置任务。 随后,Harness 会让用户选择自己的使用方向。它把需求粗略分成了办公科研、代码开发等类别。接下来,它还会询问用户更倾向于哪种工作流程。
DeepSeek披露智能体训练平台 提升效率并降低失控风险
中国人工智能公司深度求索(DeepSeek)最近发表一篇新论文,披露了一套面向大规模人工智能(AI)智能体训练的新型基础设施。图为DeepSeek位于北京的办公室。(路透社档案照片) 中国人工智能公司深度求索(DeepSeek)披露一套面向大规模人工智能(AI)智能体训练的新型基础设施,可提高训练资源利用效率,并通过加强监测和访问控制,应对智能体“作弊”、破坏执行环境等失控行为。综合路透社和澎湃新
DeepSeek据报在内蒙古数据中心部署16万片华为晶片
美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型
DeepSeek被以色列用于操控上千虚假社交账号
人工智能正在把网络舆论操纵从“AI帮助人生成内容”,推进到“AI自己运营整套虚假账号网络”。 《纽约时报》9月18日报道,美国情报官员、科技公司和网络安全研究人员近期发现,伊朗和中国支持的行动,以及两家以色列私人公司的项目,已经开始利用中国开源人工智能模型建立自主AI智能体,在Facebook、Instagram、X和TikTok等平台自动创建和经营虚假账号。 其中,一项来自以色列的行动,已经明