搜索结果
大语言模型能记住你的代码,却记不住你的生活:构建便携式个人上下文层
AI辅助编程的上下文管理已经成熟,形成了丰富的约定文件、代码库映射、内存库以及完整的内存框架,所有这些都在努力让编程智能体扎根于你的代码库。 然而,一旦走出终端,向助手询问你的健康或财务状况时,这些工具几乎就消失了。你的个人……
AI时代,不再被需要的年轻人和替他们干活的“中登”
2023年初,大模型问世,至今为止三年有余。三年多来,大模型到底会带来什么,已然有极多讨论。包括但不限于以下话题——是创造机会还是替代就业?是如虎添翼还是技能平权?利好年轻人还是利好中老登?但是,在今天,我们更需要知道,大模型实际带来了什么? 今天,使用7.4亿条截至2026年8月的招聘数据,我们发现了几个在现实世界中已经出现的重要变化。 1.能够通过使用大模型在单位时间内完成更多任务的岗位,确实
千问办公押注的企业上下文,是 Agent 时代的组织语言
在大模型在拼命刷 Benchmark 卷编程的时候,「不能说话」的 Jev 却意外成了 AI 圈的新顶流,究其原因,大模型应用的价值正在从「生成什么」,进一步延伸到「能否理解复杂信息,并据此做出可靠判断」。放到企业办公场景里,这个问题尤为明显。 员工的一句「帮我整理报价」,背后可能同时牵涉客户历史、库存状态、折扣规则、审批权限和部门协作。AI 如果只会生成文档,却不了解这些业务背景,输出再完整,也
Anthropic工程师解释为何Claude写作变差:模型被训练成写给AI看而非写给人看
IT之家 9 月 23 日消息,AI 模型在数学、编程和推理能力上进步迅速,写作水平却停滞不前,甚至有所退步,Anthropic 的 Claude 同样也存在这一问题。 为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师杰克逊 · 克尼恩今天(23 日)对此给出了解释:后续模型的优化重点更多放在数学和代码能力上。
小艺Work正式上架:从AI帮你写到AI帮你做,把工作真正办成
9 月 24 日,小艺 Work 正式上架应用市场并全面开启众测。 作为一款定位为面向日常办公、代码开发和创意创作的 AI 工作助理,小艺 Work 可以接收用户提出的工作目标,自主拆解任务、安排执行步骤、调用相关工具,并在推进过程中让用户查看进度、审核关键节点,最终交付 Word、PPT、Excel、网页等可用成果。 过去的一年里,大语言模型在文本生成领域的表现令人瞩目,但随之而来的痛点也日益明
AI Coding,正在把存储推向前台
有望对标Databricks,OceanBase押注AI数据底座的万亿市场
AI落地的真正拐点,已经不在模型本身。当通用大模型足够强、足够便宜之后,真正卡脖子的,是自己的数据。散落在各处的交易记录、文档、图片、日志,以及那些还没被整理的向量,能不能被Agent真正用起来? 正是这一问,把数据层推到了台前。当数据库的使用主体从人变成了海量Agent,数据类型从结构化扩展到多模态,要求也从“存得下”变成了统一管理、实时检索、语义理解与安全合规。这些变化正在重写整个数据市场的边
Claude安全机制大翻车 AI怒删开发者700GB主目录
哦豁,Claude 又双叒翻车了!这次 Claude 把开发者的整个项目主目录给删了,删了 700GB 的文件。又是「rm -rf」。简而言之,开发者让 AI 帮写脚本,目的是确保文件不会被误删。AI 觉得这事有点危险,于是启动了安全审查。它把整个主目录删了。 Guillemot 是一名重度 AI Agent 用户。日常开发中,他频繁调用各种 AI 编程代理来辅助工作。这些 Agent 用完之后从
Liquid AI将面向AI代理的个人上下文层部署于骁龙芯片
Liquid AI 已对其软件 Liquid Context 进行了优化,使其能够在高通(Qualcomm)的 Snapdragon 芯片上运行。该软件能够在设备本身上收集并分析用户的各种信息(如日常习惯、偏好等),并持续更新这些信息。该公司于周三在毛伊岛举行的高通 Snapdragon Summit 上宣布了这一进展。 一天后,Liquid AI 发布了一款工具,用于进一步提升其视觉处理模型的运
Perplexity推出混合计算功能 敏感任务拆分给本地AI处理
今年2月,Perplexity推出了Perplexity Computer。这是一套类似Claude Cowork的人工智能代理工具,能够利用网络以及用户电脑上的文件和应用,自主完成各种任务。此后,该平台逐渐发展出多个产品,包括面向Mac的Personal Computer。如今,Perplexity又宣布推出一项名为Hybrid Compute的新功能。 Hybrid Compute允许用户将一
实测Opus 5.5:一句提示词造出100个网页,还会做动画谱曲
Opus 5.5 发布后,网友都抢着试用。一刷就是好几个作品,从网页、动画到游戏等等。这些都比 benchmark 的数值直观,有的还能自己上手试试。一位名为 MiaAI Lab 的创作者直接让 Opus 5.5「做 100 个 HTML 文件」,附带三条要求:好看、设计不要重复、充分发挥创意。做出来的成品十分惊人。 https://x.com/MiaAI_lab/status/210249082
Anthropic已限制华为AI芯片使用Claude Opus 5.5开发前沿模型
Anthropic最新推出的Claude Opus 5.5除了带来模型能力提升之外,还被发现加入了一套针对前沿大语言模型开发场景的特殊限制机制。当用户利用Opus 5.5为新一代AI模型开发底层内核时,系统可能不会直接使用最新的Opus 5.5,而是自动回退到能力较低的Opus 5。更值得注意的是,目前发现这套限制似乎同时针对华为和亚马逊的部分AI加速器。 Anthropic在Opus 5.5的支
Meta个人AI助手Muse算力需求极剧攀升 云端架构带来算力与硬件资源考验
科技巨头Meta最新推出的个人AI代理系统“Muse”在发布后迅速吸引了数十万用户,但其背后独特的运行架构正对数据中心的算力资源造成空前的挤压。即使在日活跃用户量尚未突破100万的情况下,该系统对通用CPU算力、内存与存储资源的巨大消耗,已经凸显出AI代理技术规模化落地所面临的硬件瓶颈。 与传统仅回答问题的对话式AI不同,Muse被设计为一款能够自主执行多步骤复杂任务的个人代理,可以为用户处理诸如
谷歌最强数学推理AI模型曝光:100万词元上下文,专攻数学难题
IT之家 9 月 18 日消息,消息源 @lyraxana 于 9 月 16 日在 X 平台发布推文,爆料称谷歌正基于 DeepThink V3 模型,构建内部代号为 Mathematica 的实验 AI 模型,主要针对繁重计算、复杂的符号问题求解特别优化,预估将成为谷歌最强数学推理 AI 模型。 I 数据显示,该模型内部标识符为“models / deepthink-mathematica-tf
OpenAI Project Lily曝光:有数百名外包员工阅读ChatGPT对话 隐私过滤并不彻底
据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。 正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。 审核界面通常还附带用户
对标OpenAI!不会代码,也能跑Claude API
Anthropic,终于动手了。就在刚刚,A/终于把用了快两年的开发者工具Workbench,一刀砍掉,改名成了Playground。表面看,只是换了个名字。 但真正的变化是,Anthropic正把原本偏工程化的Claude API,做成一个普通人也能直接上手的可视化产品。 不会写代码也能把Claude API跑起来在过去,Anthropic的「Workbench」带着鲜明的高冷烙印。 对于绝大多
口语转录,一步到位!全国产算力语音识别模型,听得懂上下文了
智东西9月24日报道,昨日,科大讯飞推出最新语音识别大模型Spark-ASR-2.0。该模型基于讯飞语音基座大模型Spark-Audio-1.0-Preview构建,重点提升通用识别、复杂声学场景识别、上下文识别和文本流畅规范性。 值得注意的是,语音基座大模型Spark-Audio-1.0-Preview和语音识别模型Spark-ASR-2.0均基于全国产算力展开训练。讯飞正在以多年积累的智能语音
为什么Markdown正在成为搜索数据与AI模型之间的默认语言
在支撑 AI 应用的基础设施层中,Markdown 正在成为一项新标准。越来越多的提供商开始将其用作模型需要读取的所有内容的默认输出格式,并取代 JavaScript 对象表示法(JSON),不再把后者当作适用于所有场景的首选格式。 这种切实而持续的转变,反映了大语言模型的训练方式、聊天界面的答案呈现方式,以及开发者在构建应用时对令牌、上下文窗口和成本的真实考量。而这种采用趋势也有充分理由。 Ma
Google Cloud吁企业重建资料架构 因应AI代理需求
(中央社记者吴家豪台北17日电)生成式人工智慧(AI)迈入代理式时代,Google Cloud资料库客户工程总监柯尼格利欧(Anna Coniglio)今天表示,将AI代理强行植入传统资料平台,就像在手排车驾驶座硬塞进一个机器人,根本行不通;企业必须跳脱渐进式思维,重建资料架构,以因应主动式、全天候运作的AI代理需求。云端运算服务Google Cloud今天在台北举办Agentic Data Cl
OpenAI首席科学家拉响警报:异类心智正在诞生,恐将脱离掌控
2026年9月6日,OpenAI在其官方网站上悄然刊发了一篇长篇专论。这篇文章由该公司的首席科学家雅各布·帕乔基亲自撰写,题为《异类心智》。正当全世界的目光依然停留在AI能否替代打字员、程序员或插画师的日常讨论之时,这位身处全球技术最前沿的掌舵者却以近乎冷峻的笔调,向全人类拉响了警报。文章明确指出,从大规模算力中破土而出的,已不再是听话的传统工具,而是一种产生机制迥异于人类大脑的新型智慧;更可怕的
Google发布原生语音大模型Gemini 3.8 Live 首创“边说边想”扩展推理模式
Google今日正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型Gemini 3.8 Live以及针对高难度任务定制的Gemini 3.8 Live Extended Thinking。 这两款模型代表了Google原生音频对音频(Audio-to-Audio)技术体系的重大跨越,不仅将实时对话延迟与自然度推向新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变
ChatGPT认为它对你的了解正在影响其回答。以下是如何改变这一点
这引发了关于隐私的担忧:随着越来越多的人将这些应用程序用于分享自己的生活信息,这些应用程序可能会以我们不希望的方式影响我们从人工智能(AI)那里获得的回复。 也许你花了一整周时间研究如何更换灯泡,而 ChatGPT 却认为你是一个热衷于自己动手修理东西的人;又或许你一直在查询某个旅行目的地的信息,结果 AI 却以为你住在那个地方。现在,ChatGPT 的所有回答都包含了它“记住”的信息。以下是关于
OpenAI披露GPT-5.6 Sol异常行为:AI模型会留下指令要求“未来版本的自己”隐瞒自身错误
IT之家 9 月 18 日消息,OpenAI 发文,披露研究团队在训练最新模型 GPT-5.6 Sol 的过程中,模型曾通过对话摘要向未来版本的自己留下指令,要求后续模型隐瞒自身错误以及与预期行为不一致的表现。目前,研究团队已经针对这一具体问题进行修复。 IT之家参考 OpenAI 的报告,研究人员在训练 GPT-5.6 Sol 过程中发现,尚未部署的 Sol 智能体会在“压缩摘要”(compac
Token彻底自由了 DeepSeek正开发轻量级模型:普通显卡就能跑
快科技9月24日消息,尽管DeepSeek的API费用已经相当低,但是用量多了还是一大笔费用,想要Token自由还得本地部署,DeepSeek也被曝出开发可以本地部署的轻量级大模型。 最新泄露的DeepSeek投资人会议中,梁文锋提到了DeepSeek内部正在测试一款轻量级大模型,已经可以在普通游戏卡上运行了。这个大模型的能力也非常可期,说是能处理绝大多数日常任务。 从梁文锋的表态来看,DeepS