搜索结果
懂接触、会预判,视触世界模型来了
机器人前瞻9月20日报道,近日,Xspark AI(无界智航)联合香港科技大学(广州)、北京大学、香港大学、清华大学共同发布视触世界模型DexTouch-WM DexTouch-WM是一种以动作序列作为输入约束的视触世界模型,面向灵巧手部交互,可同步预测未来视频画面以及双手全覆盖的精细触觉信息。 此外,该模型还采集了100h的人类双手交互数据集,包含50项日常双手操作的任务。 在评测中,该团队固定
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Conn
AI将改变所有交互方式,这一次轮到了3D
硅星人下载客户端 独家抢先看2026年09月22日 15:10:18 来自北京 作者|周一笑微信|smiletalker过去一年,Agent(能自己拆解任务、调用软件的 AI 系统)开始越来越频繁地进入专业软件。写代码只是最早的一站,Blender、CAD、游戏引擎也逐渐变成大模型可以直接操作的工具。GPT-6 Astra 最近展示的 3D 能力,又把这种变化推到了台前。对 3D 生成大模型公司来
00后清华博士创业造具身模型,融资数亿元
机器人前瞻9月17日报道,今天,北京物理世界模型创企LiberAI(将闲科技)宣布完成新一轮数亿元Pre-A++轮融资,投资方包括中关村科学城、达晨财智、高信资本、华映资本等。 今年7月,该公司宣布完成数亿元Pre-A+轮融资,投资方包括360战投、国开金融、创新工场、CMC资本、彬复资本等。自成立以来,LiberAI已获得红杉中国、真格基金、美团龙珠、顺为资本等顶级机构的连续押注,累计融资超十亿
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
9 月的大模型战场之激烈,没有谁能稳坐钓鱼台。除了榜单上的排名厮杀,各家还要比拼的,还有「庖丁解牛」般的实战功夫。 模型能否处理越来越复杂的真实任务,响应能否满足真实场景的即时需求,成本能否支撑大规模调用,以及能力能否真正进入手机、汽车等终端设备,正在成为衡量一家基模公司的行业金线。 今天,旗舰模型又杀出一匹黑马。阶跃星辰发布了新一代开源旗舰基础模型 Step 5 Preview。 在全球权威的
亮源新创发布全身智能基础模型Light-O1:让机器人从人类视频中学会全身动作
凤凰网科技讯 9月21日,亮源新创今日发布全身智能基础模型Light-O1。该模型通过学习互联网视频中的人类动作,并结合语言和视觉信息,将人类动作知识迁移到机器人,以提升机器人全身协调与任务执行能力。官方称,该模用于预训练的人类动作数据越多,模型在适配不同机器人本体和视角后,动作预测越准确。 当前,机器人动作模型主要依赖遥操作、UMI等方式专门采集数据,成本高、周期长,覆盖不同任务还需定制采集流程
Pocket的AI让我的游戏创意成为现实。现在Meta掌控着结果。
近年来,AI辅助编码工具的兴起以及“氛围编码”这一概念,实际上彻底颠覆了整个软件开发工作流程。虽然这些工具已经提供给愿意花时间设置的初学者,但对于几乎没有编码经验的人来说,如今创建复杂的AI编码项目所需的命令行界面、集成开发环境和基于终端的调试操作,仍然可能让他们望而却步。 Meta最新的AI项目发布旨在让这种氛围编码变得像在社交媒体上发帖一样即时可及。Pocket——在Meta于3月收购现已停运
阶跃发布旗舰模型Step 5 Preview:跻身全球权威榜单开源前三
凤凰网科技讯 9月20日,阶跃StepFun正式发布新一代旗舰基座模型Step 5 Preview,面向真实世界Agentic任务设计。该模型采用稀疏MoE架构,总参数量600B、激活参数仅27B,支持100万Token上下文窗口,原生支持文本与视觉输入。即日起全量开放I,模型权重将于10月15日开源释放。 在全球权威的Artificial Analysis Intelligence Index中
两次瘫痪仅剩眼球能动!90后小伙用千问做了一个AI康复助手
近日在2026云栖大会现场,90后王宁向记者展示了他基于千问模型和千问办公开发的AI康复助手。 把手机支在面前,打开摄像头,跟着屏幕完成抬手、屈伸等训练动作,系统会判断动作是否标准,并给出下一步练习建议。 该APP主要面向肢体残障、脊髓损伤和脑卒中后偏瘫等需要长期运动康复的人群,而开发这款AI康复助手的想法源于王宁自己的特殊经历。 2020年王宁被确诊为脊髓肿瘤,他先后经历两次手术、两次瘫痪,最严
诺奖得主Hinton预言十年后 阿里通用医疗影像AI登Science正刊
快科技9月18日消息,据媒体报道,2016年11月,深度学习先驱、诺贝尔物理学奖得主Geoffrey Hinton有过一则过于乐观的预言。 他认为应该停止培养放射科医生,深度学习将在5年或10年内做得更好。 近10年过去,Hinton预言中的场景并没有出现,放射科医生短缺,至今仍是医疗体系面临的现实问题。 AI虽然已经能在不少影像任务中达到专家水平,却还难以像医生一样,全面检查多个器官,识别各种并
AI离“理解万物”还有多远?先拿癌细胞和行星轨道试试水
一篇技术报告中居然出现了两个看起来风马牛不相及的研究对象,跟着AI真是见世面。 一个是患者来源的类器官,另一个则跨越到了宏观宇宙……先说前者。研究者利用模型学到的内部因子,提出了细胞因子联合抗体阻断的干预方案,并经细胞系、类器官、小鼠实验层层验证。 至于后者,研究者把模拟的行星位置和速度轨迹喂给模型,不告诉它开普勒定律。 等它学完后分析其内部的预测模式,提取出的“轨道频率-半长轴”关系拟合斜率达-
GPT周报|OpenAI拓展巴西市场;MiniMax 8月ARR超8亿美元;智谱认领神秘模型“牛来”
OpenAI拓展巴西市场8月27日,OpenAI宣布正式落地巴西,启动商业化运营。以周活跃用户计算,巴西是ChatGPT全球三大市场之一,过去一年该国用户数量近乎翻倍,巴西用户每天向ChatGPT发送约2.15亿条消息。OpenAI称,巴西用户正从尝试体验AI,转向将其投入日常工作场景,巴西地区ChatGPT企业版订阅数量同比增长五倍,巴西现已跻身OpenAI商业客户规模前十市场。2026年6月,
腾讯混元发布Hy Image3.5 preview:支持文生图和图生图,多轮对话创作
凤凰网科技讯 9月22日,腾讯混元正式发布图像生成模型Hy Image3.5 preview,支持文生图、图生图及多轮对话创作。据官方介绍,该模型经腾讯内部数百名专业设计师GSB盲测,效果较Hy Image3.0提升30%,与Seedream 5.0 pro持平,略优于Nano-Banana Pro和Qwen-Image-3.0 Pro。 定价方面,腾讯云I 2K图像定价为0.15元/张(国际版0
全球的模型制作公司隐藏了许多秘密。
本周,我在 All In 大会上主持了一个关于世界模型的专题讨论(与播客无关),这让我有机会深入探讨 AI 领域中最神秘的角落之一。该领域的主要玩家是 Yann LeCun 的 AMI Labs 和 Fei‑Fei Li 的 World Labs——虽然两者都获得了大量关注和资金,但在赚钱意图的排名上却相当低。 从本质上讲,世界模型是关于自动化空间智能的,因此该领域可以向许多令人兴奋且有利可图的方
华为大模型双子星联手造物理基模,刚融资数亿元
敦鸿资产领投。智东西9月23日报道,近日,物理AI公司息壤开物(XIRRA)已在两个月内连续完成数亿元种子轮及天使轮融资,由敦鸿资产领投,华控基金、三花控股、银杏谷资本、泽然资本、本坚基金、上海天使会、标朴投资等知名机构跟投,估值达5亿美金。息壤开物由华为大模型体系的两位核心人物联手创办:创始人、CEO 李寅曾任华为云大模型 CTO,华为大模型 0 到 1 核心成员,是行业内首屈一指的大模型产业落
世界模型公司保守着许多秘密 | TechCrunch
本周,我在“All In”会议上主持了一个关于世界模型的讨论板块(与播客无关),这让我有机会深入探索人工智能领域中最神秘的角落之一。该领域的主要玩家包括 Yann LeCun 创立的 AMI 实验室和 Fei-Fei Li 创立的 World Labs——尽管这两家公司都积累了不少关注度和资金,但它们在盈利方面的优先级却相当低。 从根本上讲,世界模型旨在自动化空间智能,因此该领域可以朝着多个激动人
OpenAI推出新生图模型ChatGPT Images 2.
ChatGPT Images 2.5——更快、更清晰、更智能,并配备更好的工具,让你能创造出你所梦想的一切。
OpenAI买下iPhone人像模式幕后功臣,要给AI装上一双新眼睛
过去一周之内,连着两台新手机产品刷屏,一台是 Apple 新出的 iPhone 18,一台则是豆包手机助手消费者版发布——首款搭载机型努比亚 NaviX Ultra 在今日开售,AI 将进入手机系统,我们也做过详细测评。 AI 开始看见屏幕,也开始伸手触碰屏幕。与此同时,《华尔街日报》透露,OpenAI 已经以超过 3 亿美元收购相机技术公司 Glass Imaging。 交易尚未得到 OpenA
Meta将在眼镜上搭载自主AI“Muse”
美国Meta 9月23日发布了一款搭载AI的新型眼镜设备。 该产品将搭载可代用户完成网上购物等操作的AI智能体“Muse”。 Meta将强化眼镜的AI功能,力争在2026年销量达到约1000万副的基础上进一步增长。 Meta于23日在美国西部加利福尼亚州举行开发者大会“Meta Connect”。 Meta首席执行官(CEO)马克·扎克伯格在会上表示:“能够向Muse分享自己看到的东西和听到的内容
AI时代,不再被需要的年轻人和替他们干活的“中登”
2023年初,大模型问世,至今为止三年有余。三年多来,大模型到底会带来什么,已然有极多讨论。包括但不限于以下话题——是创造机会还是替代就业?是如虎添翼还是技能平权?利好年轻人还是利好中老登?但是,在今天,我们更需要知道,大模型实际带来了什么? 今天,使用7.4亿条截至2026年8月的招聘数据,我们发现了几个在现实世界中已经出现的重要变化。 1.能够通过使用大模型在单位时间内完成更多任务的岗位,确实
脑机接口技术获进展 瘫痪患者可通过数字虚拟形象表达语言与手势
美国加州大学旧金山分校研究团队开发出一种新型脑机接口系统,首次实现从单一脑植入设备同时解码瘫痪患者的语言及关联身体动作,并驱动数字虚拟形象进行表达。该研究成果于9月14日发表在《自然·神经科学》期刊上。 研究论文第一作者萨曼莎·布罗斯勒表示,该研究旨在推动脑机接口从一次恢复单一功能,向单一脑接口恢复多种沟通和运动方式的方向发展。她指出,手势可以增加含义、强调、情感和语境,在某些情况下可完全替代语言
新技术让PVC薄膜瞬间变成可交互控制面板
研究人员开发出一种低成本制造触摸界面的新方法,只需普通激光打印机、碳粉和PVC塑料薄膜,便能够快速制作出具备触控功能的交互界面。这项技术有望大幅降低智能设备、人机交互系统以及定制化控制面板的开发成本。 传统触摸界面通常需要专用传感器、复杂电子线路以及定制生产工艺,因此制造成本较高,也不利于快速原型开发和个性化设计。而最新研究提出了一种更加简单直接的方案,利用激光打印机中本就存在的导电特性碳粉,在柔
Meta的Muse让扎克伯格再次有机会打造真正的平台
Meta公司推出的全新个人AI助手Muse,为马克·扎克伯格提供了再次打造他多年来一直追求的那种技术平台的机会。Muse上周在应用商店中排名首位,并在周一仍保持最受欢迎免费应用的地位,超越了ChatGPT。如果足够多的人将Muse作为在线完成任务的主要工具,开发者们将会纷纷涌入这个新兴平台;企业也可能不得不与之合作。周一,Meta的股价上涨了11%,股价已接近去年夏天的历史高点。投资者似乎认为该公
实测智象视频模型:嘻哈说唱、NBA绝杀,视频生成开始理解真实世界
先理解,后生成,更懂物理规律的视频模型。近几月,AI视频生成赛道持续升温。7月31日,Seedance 2.5与MiniMax H3同日发布;8月,阿里发布Wan3.0;进入9月,智象HiDream-O1-Video-1.0(下文简称HiDream V1)发布并冲上权威榜单全球前四。 短短两个月,多家厂商接连推出新一代视频生成模型,行业竞争进一步加速。以字节Seedance、MiniMax H3、