搜索结果
刚刚,智谱首个 RSI 成果发布,10 万国产卡用 GLM 造 GLM
两周时间,10 万颗国产 AI 加速器,一个开始优化自己的模型。 就在刚刚,智谱 GLM 首席科学家唐杰在 X 平台分享了一项关于 GLM-5.3-Flash 推理系统优化的研究。 他透露,从 GLM-5.3-Flash 首次运行在国产 AI 加速器上,到完成全部生产流量承载,仅用了两周时间。在这个过程中,系统端到端吞吐能力提升了 3.2 倍。 最让唐杰印象深刻的是,完成大量优化工作的并非只有基础
智谱GLM-5.3-FlashX模型上线:进一步形成智能、价格、速度的全面竞争力
凤凰网科技讯 9月18日,智谱宣布推出GLM-5.3-FlashX(最高200tokens/s),为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash此前以“Ox Alpha”之名与全球开发者见面,调用量持续攀升。面对快速增长的需求,智谱在10万张国产芯片提供的推理算力基础上,进一步加大对Infra侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智
智谱上半年营收9.54亿元增400% 8月ARR为16亿美元
【财新网】8月31日晚,智谱(02513.HK)发布2026年半年报。财报显示,2026年上半年,公司营收9.54亿元,同比增长399.7%;期内亏损20.72亿元,同比收窄12.1%。 智谱管理层在财报发布后的业绩交流会透露,公司8月年度经常性收入(ARR)到16亿美元(约合人民币108亿元)。在不到两个月的时间内,智谱的ARR已较7月上旬的10亿美元上涨60%。 财报显示智谱商业模式变化。开放
云端商业化提速,智谱上半年营收同比增近400%,开放平台及API收入暴增2736%|财报见闻
北京智谱华章科技股份有限公司8月31日发布上市后首份中期业绩公告。截至2026年6月30日止六个月,公司实现总收入9.54亿元,同比增长399.7%;同期净亏损收窄至20.7亿元。 收入高速增长的同时,公司业务结构也发生明显变化。报告期内,开放平台及I业务收入达到8.25亿元,同比增长2735.7%,占总收入的比例由去年同期的15.2%提升至86.5%;同期,企业级通用大模型(本地化部署)收入由1
【周刊提前读】中国AI应用催生海量算力需求 国产芯片你追我赶崛起中
人工智能(AI)算力需求暴增,中国产AI芯片则迎来一轮发展红利,“得产能者得客户”。 “今年全国算力需求爆发式增长,高端卡一卡难求,变成完全的卖方市场,价格不断抬升,涨幅十分惊人。”杭州市算力资源调度服务平台浙江算力科技有限公司(下称“浙江算力科技”)业务负责人告诉财新,其平台算力已租赁一空,大集群算力产品出现多家客户排队等候的情况。 浙江算力科技为杭州国资企业,通过自建和集中社会闲置算力,统一管
智谱宣布GLM-5.3模型开源 支持免费部署和商用 但大型企业必须先提交审查
智谱日前宣布 GLM-5.3 模型正式开源,该模型已经在 8 月中旬上线 I 服务供开发者们使用,但由于模型网络安全能力增长超出预期,所以模型权重开放被推迟以进行额外的审查,现在完成审查后智谱开始提供模型权重。 总参数规模为GLM-5.3 模型沿用 GLM-5.2 的基础模型,所有能力提升均来自后训练阶段。模型采用 MoE 混合专家架构,总参数规模为 743B,每次推理时激活的参数为 39B,支持
全国首个L4万卡集群建成 近1.5万卡赋能无人驾驶研发
快科技9月18日消息,九识正式宣布,其算力集群规模突破万卡,成为业内首家建成万卡集群的L4企业。 该集群配备近1.5万卡GPU算力,覆盖模型训练、场景重建、数据标注及在线推理等全流程研发任务。 依托这一算力底座,九识自研多模态基座大模型持续训练演进,使“九识大脑”具备自主认知、动态推演与全场景无图泛化能力。 在模型层面,九识基座世界模型EX以百亿级参数为支撑,并正向千亿级参数迈进。 运营数据方面,
智谱入驻天猫开旗舰店 上架大模型订阅套餐
中国人工智能(AI)大模型厂商智谱入驻天猫开设官方旗舰店,销售大模型订阅套餐和Token充值服务,将过去主要通过官网销售的大模型服务带入传统电商平台。 综合快科技、IT之家和《科创板日报》报道,智谱星期三(9月2日)正式入驻天猫,上架GLM Coding Plan订阅套餐等产品,相关服务基于最新发布的GLM-5.3模型。 天猫店铺工商资质信息显示,网店经营者为北京智谱华章科技股份有限公司,即港交所
中国AI加码价格竞争
中国的人工智能(AI)新兴企业正推出低价格的AI模型。低于美国AI产品,甚至低于中国知名AI企业DeepSeek(深度求索),希望抓住DeepSeek8月中旬大幅提价的机会扩大份额。 中国AI新兴企业北京智谱华章科技(智谱)9月26日透露,Ox-Alpha的真实身份是该公司的“GLM-5.3-Flash”。每token的价格比提价后的DeepSeek便宜20%~70%。 性能也表现出色。专注于AI
智谱,被上了一课
作为年初登陆港交所的“全球大模型第一股”,智谱的一举一动都在放大镜下。半年时间,它的市值一度突破万亿港元,截至9月18日收盘,其总市值约3803亿港元,就在一周前,智谱刚宣布完成约50亿美元融资,用于下一代GLM模型与算力基础设施。 然而,这两天一场围绕其AI编程工具ZCode的争议,把它推入了另一个聚光灯下。 先是一位开发者发现ZCode会在后台打包项目数据并尝试上传云端,智谱回应称是“代码库索
财经早知道|华为时隔六年再次发布高性能芯片
中国8月末外汇储备报34383亿美元,环比增加195亿美元,为连续第2个月增长,主要原因是汇率折算和资产价格变化等因素的综合作用。 中国8月末黄金储备报7673万盎司,环比增加65万盎司,中国央行已连续第22个月增持黄金。 时隔六年,华为再次发布高性能芯片麒麟9050 Pro,为全球首款落地“韬定律”、采用逻辑折叠技术的旗舰芯片。该芯片对逻辑单元分层排布,内部增设垂直互联通道,信号传输路径更短、时
智谱悄悄上架天猫:Token越来越便宜,为什么AI公司反而开始限量了
最近,有读者发来一条智谱的公告。用了几个月的老套餐,要没了。 此前那个“不限周额度”的GLM Coding Plan,将停止自动续订,智谱给老用户补偿两个月新套餐。 几个月前,AI编程市场还在比谁家套餐更便宜;到了现在,你到底能用多少Token。 这意味着,一件过去听起来非常“技术”的东西,AI的使用额度,可以像手机流量一样被直接购买。 但这里真正值得关注的,并不是“智谱上天猫卖Token”这件事
华尔街见闻早餐FM-Radio | 2026年9月8日
中国央行连续22个月增持黄金,8月购金节奏进一步加快。 适时启动6G商用,到2030年智能算力规模达9800 EFLOPS。 小米推出首款“中折叠”旗舰手机小米18 Fold,10999元起售,披露造芯累计投入210亿元。华为发布首款“韬定律”逻辑折叠芯片手机Mate XT 2三折叠手机,起售19999元。长鑫LPDDR6芯片率先实现旗舰手机端首发量产,首发搭载小米18 Fold。 摩尔线程20%
RSI时代将至:谷歌、OpenAI、SSI正在发出同一个信号
AI行业正在出现一个值得资本市场重视的新变化。过去两年,模型能力能否继续提升、推理成本能否下降、Coding之外能否出现新的万亿美元应用、数据中心建设会不会过剩。 但随着谷歌发布Gemini 3.8 Flash、SSI宣布未来12个月算力扩张10倍,以及OpenAI公开讨论递归自我改进(RSI)与训练资源调配,AI不只要服务用户,也开始参与训练、评估和优化下一代AI。 RSI,即Recursive
【市场洞察】瑞银:中国AI模型性价比突出 中美差距缩窄至3到6个月
【财新数据专稿】“中国模型在成本优势上面展现出的全球竞争力。中国的模型无论是前期的训练研发阶段,还是后期的推理、使用阶段,展现出来的性价比或者绝对的成本都还是比国外的竞品是显著低的。”瑞银互联网分析师熊玮在瑞银近期举办的2026年A股研讨会上表示。熊玮对中国模型在全球市场获取更多份额保持乐观。 模型能力持续提升,中美差距缩窄至3至6个月过去两三个月间,国内多家领先模型厂商密集发布了新一代产品。其中
全球首发,雷军点赞!长鑫官宣LPDDR6内存量产
“祝贺长鑫实现LPDDR6内存量产,非常了不起!”雷军在微博上说,“这只是开始,将来还会有更多优秀的中国科技企业,强强联合,勇攀高峰!” 时间节奏上,此次官宣,距离其LPDDR6产品研发验证进入尾声,不到1个月时间。8月1日,接近长鑫的知情人士透露,其LPDDR6研发取得新进展,目前研发验证接近尾声,距离量产更进一步。 长鑫率先量产落地LPDDR6,意味着中国存储企业首次在高端内存标准上,打破海外
长鑫科技宣布量产高端LPDDR6内存晶片
长鑫科技宣布自主研发的新一代低功耗内存晶片LPDDR6实现量产,并将首批搭载于小米18折叠旗舰手机。 长鑫科技星期六(8月29日)在社交媒体上公布这一消息。新浪科技报道称,这是全球LPDDR6产品首次落地商用,标志着中国存储企业首次在高端内存标准上实现全球首发量产跨越。 LPDDR6是新一代低功耗内存标准,主要用于智能手机、平板电脑和人工智能终端等设备,可提供更高的数据传输速度和能源效率。这距离该
五项第一!纯国产AI存储首次杀入全球第一梯队:中国芯+中国存储
快科技9月17日消息,据MLCommons官方公布的最新结果,基于兆芯开胜KH-50000处理器的纯国产AI存储方案AS13000G7,在全球权威AI存储基准测试MLPerf Storage V3.0中斩获五项第一,成为业界首个闯入全球第一梯队的全国产AI存储方案。 本次测试覆盖大模型训练Checkpointing、大模型推理KVCache、高性能计算UNet3D三大核心场景,AS13000G7参
智谱以零息+溢价转股形式融资50亿美元,主要用于算力基础设施与模型研发
智谱9月13日公告,公司完成约50亿美元(人民币约335亿元)新一轮融资,由约20亿美元股份配售与约30亿美元零息可转债共同构成。距离上一次7月配售融资约40亿美元,时隔仅两个月。 这是智谱自今年1月登陆港交所以来的第三次股权融资动作。从IPO到两次再融资,募资节奏持续提速,资金流向也高度一致——算力、模型研发与基础设施。 折价配售叠加零息溢价转债本次融资分两部分独立进行,互不构成条件。 股份配售
T早报|字节跳动26亿元在北京买地;SpaceXAI 发布Grok 4.7模型;智谱被指未经用户允许上传数据 随后致歉并开源ZCode
北京,字节跳动总部大楼。图:视觉中国 【财新网】 智谱被指未经用户允许上传数据 随后致歉并开源ZCode 在因后台静默上传用户代码造成信任拷问后,智谱于9月21日宣布开源旗下编程调度框架(Coding Harness)产品ZCode,称把代码交给社区监督。智谱强调,对于社区中提及的代码数据,承诺无留存,也从未将其用于模型训练。在9月18日晚发函追责智谱的太原承明科技有限公司则在9月21日晚间
中国拟有序部署十万卡级智算集群 加大国产晶片适配力度
中国官方提出未来五年要“适度超前”建设信息基础设施,有序部署万卡、十万卡及以上规模的智能算力集群,按应用场景需求建设推理算力设施,并加大国产算力晶片适配力度。 中国工业和信息化部星期一(9月7日)发布《信息通信行业发展“十五五”规划》,提出“十五五”时期信息基础设施累计投资达到3.8万亿元人民币(7172亿新元),推动智能算力规模从2025年的1590 EFLOPS(每秒百万万亿次)提升至2030
T早报|苹果、三星、谷歌被美国国际贸易委员会调查;脉脉称今年前7月新发AI岗位数量增长790%;Kimi发布金融行业解决方案
美国纽约,中央公园附近的苹果第五大道门店。图:视觉中国 【财新网】 腾讯WorkBuddy上线全栈“应用”生成能力 9月17日 ,腾讯WorkBuddy上线全栈“应用”生成能力。该能力首期支持全栈“网页应用”生成,用户只需用自然语言描述需求,即可生成自带云数据库、文件存储、用户注册登录与AI调用能力的完整网站应用,并可一键发布上线,获得可直接分享的访问链接。 MiniMax参与新加坡AI技
罗福莉带小米登顶全球开源榜首!大规模RL立功,斩杀Grok 4.7
大模型江湖变天了。MiMo V2.6 Pro在Artificial Analysis智能指数(AA Intelligence Index v4.3)中拿下 46 分,超过Kimi K3和Qwen3.8 Max。全球开源模型第一、国产模型第一! 拉出AA榜单横着看:Fable 5.1得分53,GPT-6 Astra得分52.8,Opus 5得分50.7。 MiMo V2.6 Pro虽然还没追平这几位
AI芯片“四小龙”上半年营收大幅增长 资金压力仍大
【财新网】8月末,AI芯片“四小龙”中,沐曦股份(688802.SH)、天数智芯(09903.HK)和壁仞科技(06082.HK)相继披露半年报,上半年营收均来到约10亿元量级,并实现大幅增长。 8月30日晚,沐曦股份公布2026年上半年财务报告,报告期内实现营收13.2亿元,同比增长44.7%;财报称,主要系公司产品及服务持续获得下游客户广泛认可与采购,公司GPU产品出货量显著提升。壁仞科技财报