搜索结果
英伟达展示DSX MaxLPS技术,AI工厂每兆瓦token吞吐量最高提升40%
IT之家 9 月 17 日消息,科技媒体 Wccftech 昨日(9 月 16 日)发布博文,报道称在 AI 基础设施峰会上,英伟达展示了面向 AI 工厂的 DSX MaxLPS 功耗调度系统,每兆瓦 token 吞吐量最高提升 40%。 每兆瓦 token 吞吐量是指数据中心每消耗 1 MW 电力时,AI 系统每秒能够生成或处理多少个 token。该指标把功耗纳入计算,因此更适合衡量 AI 数据
有望国庆发布 DeepSeek V4.1 Pro已开始测试:性能值得期待
快科技9月28日消息,9月10日发布DeepSeek V4.1 Flash之后,DeepSeek提到后续还有V4.1 Pro,但没有给出明确的日期,现在马上国庆节了,V4.1 Pro已曝出正在测试中。 从网友分析出来的结果看,V4.1 Pro目前的状态还是Early access,也就是早期接入,默认High级别推理强度。 目前是按账号灰度测试,大部分人还看不到列表,不过一旦有了权限就能一直用。
突发:DeepSeek Harness出桌面版了
我们打开链接,下载、安装了一下,发现确实能用。从界面来看,它已经是一套相当完整的 GUI:打开 App,登录 DeepSeek 账号或者添加 API Key,选一个本地文件夹作为工作区,接下来就可以像使用普通桌面 AI 应用一样,直接给 Agent 布置任务。 随后,Harness 会让用户选择自己的使用方向。它把需求粗略分成了办公科研、代码开发等类别。接下来,它还会询问用户更倾向于哪种工作流程。
DeepSeek据报在内蒙古数据中心部署16万片华为晶片
美国媒体报道,中国人工智能(AI)初创企业深度求索(DeepSeek)将在内蒙古数据中心部署至少16万片华为高端加速晶片。 彭博社星期五(9月4日)引述知情人士透露,深度求索计划使用华为新一代升腾950DT晶片操作旗下模型,但部署时间表将根据华为的产能而定。 其中一名知情者称,尽管华为升腾950DT晶片是为训练模型而研发,但深度求索目前暂未有这方面的用途。深度求索过往也用华为AI晶片训练之前的模型
深度求索推迟DS V4 Pro下线时间 但也只延迟到9月14日
昨天深度求索已经预告将在今天上线 DS V4.1 Flash 模型,深度求索经过内部和外部评测后认为 DS V4.1 Flash 能力和响应速度都远超 DS V4 Pro,所以深度求索计划在 DS V4.1 Flash 上线后,直接将现有的 DS V4 Pro 请求全部自动路由到 DS V4.1 Flash。 按照深度求索所说,新模型性能好、能力高、价格也更便宜,所以直接路由应该是好事情才对。然而
AMD发布EPYC Venice性能白皮书 宣称较英伟达Vera最高快2.24倍
AMD近日发布了一份围绕第六代EPYC 9006“Venice”服务器处理器的最新技术白皮书,重点展示了其在数据中心、云计算、高性能计算以及代理式人工智能(Agentic AI)场景下的性能表现。 白皮书中的多项测试结果直接将矛头对准英伟达最新的Vera服务器CPU平台,同时也将英特尔Xeon 6980P纳入比较对象。不过,由于所有数据均来自AMD自身或引用竞争对手公开资料,因此相关结论仍需等待第