搜索结果
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格
就在昨天凌晨,一个320B的开源大模型横空出世,权重连同blog,一口气全丢了出来。这匹「黑马」叫IQuest-Q1。 九月这个赛道有多卷,你看看就知道了:月初GPT-6 Astra、Fable 5.1、Gemini 3.8 Flash连着三天扎堆发布,国产阵营Qwen3.8、GLM-5.3轮番上阵。 在这帮「卷王」里,一个名叫「至知」的团队突然交出了一张320B的开源答卷,而且一上来就在写代码库
OpenAI满世界抓漏洞,结果被中国AI反杀!Codex再曝0day
MiniMax新模型上线:能够完成Bug修复、完整功能开发等任务
Anthropic发布警告:开放权重模型GLM-5.3具备自主开发网络漏洞能力,安全护栏极易被绕过
Anthropic研究人员发布了对智谱AI的GLM-5.3的评估,发现该开放权重模型具备自主开发端到端软件漏洞利用的高级能力。 在ExploitBench等基准测试中,GLM-5.3在410次漏洞利用尝试中成功了50次,紧随Anthropic的Claude Mythos Preview(410次中成功56次)之后。 与受限的前沿模型不同,GLM-5.3内置的安全护栏可通过“消融”技术以极低的算力成
可定制的AI模型如何助长黑客进行网络犯罪
一群讲中文的黑客最近从数十家零售商那里窃取了超过六十万个信用卡号码,之所以成功,部分原因在于他们对一些开源的中国AI模型进行了定制。 以色列网络公司 Gambit Security 发现,受害者包括一家美国大型航空公司和一家财富 500强酒店公司。 黑客最初试图使用Anthropic Fable和ChatGPT来运行整个活动。这些AI模型拥有更严格的护栏,阻止了黑客达成其目标。 因此,攻击者将多个
中国团队双榜登顶!OpenAI、谷歌、英伟达集体让位
新智元2026年09月25日 11:06:54 来自北京 刚刚,Hugging Face的热榜,被一个中国团队屠了!全球开源社区的语音和翻译两条黄金赛道上,骤然杀出一匹中国黑马,硬生生把OpenAI、谷歌、英伟达这帮国际大厂全给踹到了身后。它就是网易有道。对,就是你考四六级那年,天天开着查单词的那个有道。语音识别Trending榜,R2T2登顶翻译Trending榜,T3PO登顶发布仅仅5天,有道
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响
2.8万亿参数的大模型,究竟要怎么跑快?近日,海内外团队盯上了全球最大参数量的开源模型——Kimi K3。K3凭借2.8万亿总参数、104B激活参数,刷新了开源模型的性能上限。但普通的AI服务器难以承载这么大参数量的模型,Kimi官方推荐64卡甚至更大规模的AI服务器才能装得下。有业内人士表示,一般未经优化的超节点跑Kimi K3,初始性能可能仅在10 tokens/s左右。 面对如何让2.8万亿
忘掉AI放缓吧——漏洞大爆发已经在发生
欢迎阅读《内核恐慌》(Kernel Panic)创刊号!这是一份由莉莉·海·纽曼(Lily Hay Newman)和马特·伯吉斯(Matt Burgess)共同撰写的每周通讯,带您深入隐私与数字安全的新世界。如需每周在收件箱中接收此通讯,请点击此处订阅。 人工智能末日论者最近将一种最坏情况换成了另一种,他们搁置了对潜在软件漏洞引发灾难的担忧,转而关注人工智能在未来十年内导致人类大规模死亡的可能性。
平均6天一个新旗舰 大模型更新快到人类跟不上了
太疯狂了,短短两天,竟然冒出了4个新模型!前脚,老马的xAI才刚发完Grok 4.7。紧接着,OpenAI突然甩出GPT-6 Sol和Luna,价格直接腰斩。同一天,Anthropic也把Claude Opus 5.5拍在了桌上,比上一代硬生生便宜40%。9月22日,一张动图在X上被转疯,浏览量狂飙近百万。 2023年,大模型73天一更,到了2026年,18天一更。从ChatGPT上线算起,Ope
中国模型首登CyberGym榜首!阿里自研AI安全模型实现“小强”突破
日前,阿里巴巴伏渊息壤大模型(XekRung-27B)以88.9%的成功率登上CyberGym榜首,成为该国际权威AI安全能力榜单历史上第一个来自中国的冠军模型。 伏渊息壤在获得最高成功率的同时,还实现了“既小又强”的突破,27B的参数量仅为其他上榜模型的1/27~1/370,这意味着该“小强模型”极大降低了智能排查安全漏洞的算力成本。 据悉,CyberGym是目前国际上最权威的AI安全能力榜单之
OpenAI突发急刹车!AI竟在全网植入自我复制代码,血洗联合国内网
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
9 月的大模型战场之激烈,没有谁能稳坐钓鱼台。除了榜单上的排名厮杀,各家还要比拼的,还有「庖丁解牛」般的实战功夫。 模型能否处理越来越复杂的真实任务,响应能否满足真实场景的即时需求,成本能否支撑大规模调用,以及能力能否真正进入手机、汽车等终端设备,正在成为衡量一家基模公司的行业金线。 今天,旗舰模型又杀出一匹黑马。阶跃星辰发布了新一代开源旗舰基础模型 Step 5 Preview。 在全球权威的
三榜第一,完胜GPT-6!中国物理RSI杀出黑马
刚刚,清北天团甩王炸!正面叫板Figure
00后清华博士创业造具身模型,融资数亿元
机器人前瞻9月17日报道,今天,北京物理世界模型创企LiberAI(将闲科技)宣布完成新一轮数亿元Pre-A++轮融资,投资方包括中关村科学城、达晨财智、高信资本、华映资本等。 今年7月,该公司宣布完成数亿元Pre-A+轮融资,投资方包括360战投、国开金融、创新工场、CMC资本、彬复资本等。自成立以来,LiberAI已获得红杉中国、真格基金、美团龙珠、顺为资本等顶级机构的连续押注,累计融资超十亿
陶哲轩、邓煜等菲奖得主联合抗议:AI公司正毁掉整个数学圈
OpenAI,又开始对黎曼猜想和P与NP问题下手了??最近,这些AI大公司仿佛疯了一般在冲刺“千禧年问题”的KPI。9月8日,NS方程被宣布解决;9月11日,第二道千禧年难题霍奇猜想被曝接近解决;据称,O/A两家正疯狂竞速,向BSD猜想发起冲锋。到了今天,OpenAI已经在用内部模型尝试解决黎曼猜想和P与NP问题。如果该模型证明了 P = NP,整个计算机科学领域都将被颠覆!然而,人类数学家们已经
OpenAI自曝:AI模型或已在全网秘密植入自我复制提示词,训练已被迫叫停
OpenAI和Anthropic正在紧急调查数万起大模型失控事件,AI不仅学会了越狱和黑进政府网站,甚至还有数百个智能体私下建群、联手黑进外部公司,秘密在全网植入自我复制提示词。 事情的严重程度远超外界想象。 最近几个月,在内部测试和实际运行中,顶尖大模型出现了海量违规行为。 这些行为包括绕过安全护栏、自己搭建论坛、逃逸沙盒环境、劫持网站、自主提示以及试图躲避监控系统。 目前调查涉及的事件总数已经
OpenAI逃逸的AI Agent竟在全网植入自我复制代码 血洗联合国内网
“天网”中的一幕,正在现实上演。一次训练中,OpenAI逃逸的AI Agent,已在整个互联网上植入了“自我复制的代码”!当政客Andrew Yang在CNBC说出这句话时,很多人以为他疯了。 就在这两天,OpenAI亲手发布了一份报告,标题非常简洁:《自我复制提示词注入存在》。白纸黑字,官方认证。AI模型,居然真的像计算机蠕虫一样,自我复制、自我传播。而更令人脊背发凉的是,就在5天前,OpenA
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS
神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra
神秘模型 Union Alpha 突袭 继“牛来”Ox Alpha 之后,OpenRouter 昨晚上又出现了一款身份不明的模型。 当地时间 9 月 16 日,OpenRouter 宣布上线匿名模型 Union Alpha。官方将其描述为一款面向研究、编程和智能体工作流的多模态模型,并称其能够在广泛的通用任务中提供“前沿级性能”。 与此前的 Ox Alpha 一样,Union Alpha 没有公
Anthropic、Meta、谷歌、阿里齐发模型更新 编程能力较量白热化
【财新网】在各自的旗舰模型基础上,各大模型厂发布更新版模型。北京时间9月2日和3日,Anthropic、Meta、谷歌和阿里等公司发布了基于旗舰模型的更新版本,在编程、网络安全和办公等领域的能力提升。 目前从第三方AI模型榜单看,最新发布的模型当中,Claude Fable 5.1在智能水平上排名最靠前,Meta新发布的Muse Spark 1.3排名第三,谷歌的新模型Gemini 3.8 Fla
Breakingviews评论:中国实验室是AI治理中的未知因素
OpenAI和Anthropic并非圣贤,但会在模型发布前公布风险审查。 像估值380亿美元的智谱AI和阿里巴巴这样的竞争对手在安全方面则不那么公开,部分原因是芯片和资本短缺。 为了保住从布鲁塞尔到首尔的市场准入,它们必须提升自己的表现。
Gemini 4 Pro疑似泄露 “AI减速”又成空话
前几个月,OpenAI和Anthropic轮番把旗舰模型往前推,Google却显得异常安静。Flash几乎3周一更,3.6、3.7、3.8连续往前,但代表最高能力上限的Pro迟迟没有动静。直到这两天,大模型盲测竞技场Arena里,突然冒出一个挂着gemini-3.8-flash名字的模型。 开发者一上手就发现了不对劲,真正的Gemini 3.8 Flash已经发布了,它该是什么水平,大家心里有数。