搜索结果
懂接触、会预判,视触世界模型来了
机器人前瞻9月20日报道,近日,Xspark AI(无界智航)联合香港科技大学(广州)、北京大学、香港大学、清华大学共同发布视触世界模型DexTouch-WM DexTouch-WM是一种以动作序列作为输入约束的视触世界模型,面向灵巧手部交互,可同步预测未来视频画面以及双手全覆盖的精细触觉信息。 此外,该模型还采集了100h的人类双手交互数据集,包含50项日常双手操作的任务。 在评测中,该团队固定
腾讯宣传新AI模型,声称超越Z.AI和月之暗面
腾讯控股有限公司发布了一款基础模型,称其在内部测试中优于竞争对手Z.AI公司和月之暗面,声称在中国顶级人工智能玩家中占有一席之地。 该公司在一份声明中表示,Hy4 Preview模型运行在7700亿参数上,并具有100万token的上下文窗口,这标志着其前身在规模和数据规模上的巨大进步。上下文窗口越大,AI模型能记住的就越多,也就能更好地回应用户的查询和指令。 在腾讯自己的专家进行的盲测工程测试中
Perplexity推出混合计算功能 敏感任务拆分给本地AI处理
今年2月,Perplexity推出了Perplexity Computer。这是一套类似Claude Cowork的人工智能代理工具,能够利用网络以及用户电脑上的文件和应用,自主完成各种任务。此后,该平台逐渐发展出多个产品,包括面向Mac的Personal Computer。如今,Perplexity又宣布推出一项名为Hybrid Compute的新功能。 Hybrid Compute允许用户将一
阿里千问发布Qwen-Audio-3.1系列语音大模型,全线降价最高达95%
千问今日正式发布Qwen-Audio-3.1系列语音大模型,对语音识别、语音合成和实时语音交互三大核心模型进行全面升级同时推出全新的音频创作模型Qwen-Audio-3.1-TTS-Next和音频理解模型Qwen-Audio-3.1-ASR-Next。官方称,五款新模型形成覆盖“理解-生成-交互-创作”的完整音频能力栈。为进一步降低使用成本,Qwen-Audio全线语音模型价格均下调,其中TTS降
中国AI大模型调用量连续十九周领跑 环比增长379%
根据OpenRouter最新数据测算,上周(8月31日至9月6日)全球AI大模型总调用量为115万亿Token,环比增长1.77%。其中,上榜的AI大模型中,中国AI大模型周调用量达56.72万亿Token,环比增长2.83%;同期美国AI大模型周调用量为16.54万亿Token,环比下滑3.1%。中国大模型周调用量连续十九周超过美国,稳居全球首位。 《每日经济新闻》注意到,上周,全球调用量排名前
GPT周报|OpenAI称AI让员工“跨界干活”;智谱推出新模型GLM-5.3-FlashX;黄仁勋称2027年英伟达芯片销量有望翻倍
9月18日,智谱上线新模型GLM-5.3-FlashX。图:视觉中国 【财新网】 豆包二代AI智能体手机公开发售 9月16日,努比亚NaviX Ultra正式上市,因其搭载豆包手机助手消费者版,市场称为“豆包手机二代”。和第一代不同,此次豆包手机面向公众发售,叠加国补后售价5499元起。京东平台数据显示,当天发售5分钟内,产品被抢购一空。努比亚称,NaviX Ultra为“全球首款AI智
华为小艺Work正式上线:一句话做PPT、数据分析
该产品定位为7×24小时专属养成系助理,支持鸿蒙手机、平板和电脑,并可实现跨设备协同。 小艺Work覆盖市场调研、文档处理、PPT制作、数据分析、内容创作、代码开发等多种场景使用时,用户只需提出目标,其便可自主拆解任务、规划执行步骤,并调用合适工具推进。任务执行过程中,用户可随时查看进度,并在关键节点进行审核和确认。 执行环境方面,小艺Work同时支持云电脑和本地电脑,可根据任务所需软件、文件及工
豆包座舱助手正式发布:“豆包屏”上车,随聊天内容展现不同表情
凤凰网科技讯 9月17日,字节跳动旗下豆包与火山引擎联合打造的车载AI助手——豆包座舱助手正式发布。该助手定位为汽车统一的“大脑”,真正参与“感知-决策-执行”完整链路,可感知数百种车辆信号,联动车控、导航、辅助驾驶、娱乐等数千个整车原子能力,将复杂任务自动拆解、分步执行。 主动服务方面,豆包座舱助手支持理解复杂需求并联动全车功能。例如用户说“午睡会儿,1点叫我”,TA会按用户习惯自动调座椅高度、
苹果在这次发布会上还发布了新一代的Apple AI,计划支持英语、简体中文、繁体中文等16 种语言,但右下角小字显示首发不支持在中国大陆使用。
公众号插图、秋招物料、潮玩设计,实测商汤SenseNova U1 Pro:生图模型走向真实任务交付
时常会有人感慨,各种生图模型让人眼花缭乱,但一到真正交稿时,还是免不了反复“抽卡”。好不容易挑到一张满意的图,改个字、换个元素,又得重新开始。抽到一张好看的图,和完成一项工作,毕竟不是一回事。 在真实工作中,公众号文章需要 和多张配图,企业招聘需要海报、易拉宝、折页等一整套物料,设计过程中还可能随时需要改文字、换人物服装、调整局部元素。 这也意味着,办公场景中的生图需求,对模型提出的要求已经不只是
T早报|OpenAI、Anthropic、DeepMind合作AI安全工作;外交部回应AI风险焦虑;梁汝波称字节跳动将加大投资企业市场
阶跃发布语音大模型StepAudio 3 9月15日,阶跃星辰发布 Step Audio 3 系列模型,包括 StepAudio 3 Realtime、StepAudio 3 ASR、StepAudio 3 TTS、StepAudio 3 Gen 和 StepAudio 3 Music。该系列模型主要面向真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作等场景。 腾讯会议联
ChatGPT移动端加入语音智能代理功能
OpenAI宣布ChatGPT移动应用开始加入基于语音的智能代理功能,用户今后不只是能够通过语音与ChatGPT聊天,还可以直接用语音指挥它执行更加复杂的实际工作。例如,用户可以要求ChatGPT创建一份文档、起草电子邮件、总结Slack消息,甚至开展一系列需要多个步骤才能完成的任务。 此次更新的核心是将ChatGPT此前已经逐步加入桌面端的Agentic Work能力带到手机上。对于Plus和P
体验完 Step 5 Preview,我发现阶跃重新坐上国产大模型主桌
9 月的大模型战场之激烈,没有谁能稳坐钓鱼台。除了榜单上的排名厮杀,各家还要比拼的,还有「庖丁解牛」般的实战功夫。 模型能否处理越来越复杂的真实任务,响应能否满足真实场景的即时需求,成本能否支撑大规模调用,以及能力能否真正进入手机、汽车等终端设备,正在成为衡量一家基模公司的行业金线。 今天,旗舰模型又杀出一匹黑马。阶跃星辰发布了新一代开源旗舰基础模型 Step 5 Preview。 在全球权威的
Google推出AI图像创作工具Pics 基于Nano Banana模型打造
Google于9月1日正式推出Google Pics,这是一款集成在Google Workspace中的生成式人工智能图像创作与编辑工具,旨在与Canva、Adobe Express以及微软Designer等产品展开竞争。Google AI Pro和Ultra订阅用户,以及大多数Google Workspace企业客户,都可以免费使用该工具。 Google Pics由Gemini的“Nano Ba
苹果更新官方开发者支持文档 阐释AR参考图工作原理与优化规范
为了帮助开发者在增强现实(AR)与空间计算场景中实现更加精准的图像追踪与虚实融合效果,苹果公司近日对其官方开发者支持门户中的“参考图”技术指南进行了全面更新。 该文档系统性地拆解了ARKit及相关系统框架如何识别、锚定现实平面图像的底层逻辑,并为创意设计与工程团队提供了详尽的图像优化建议。 在苹果的AR技术体系中,参考图是指开发者预先打包进应用程序、供系统在现实物理世界中进行比对与匹配的二维图像资