网易有道LobsterAI发布公开信承诺长期投入,推出腾讯QClaw迁移助手
网易有道旗下桌面端Agent LobsterAI发布《致用户的一封信》,强调不会将用户体验作为内部赛马筹码,并推出专门迁移助手承接即将停运的腾讯QClaw用户。该产品采用MIT许可证开源及本地优先策略,2.0版本新增Sites与Teams功能支持团队协作,试图通过数据自主权建立差异化优势。
网易有道旗下桌面端Agent LobsterAI发布《致用户的一封信》,强调不会将用户体验作为内部赛马筹码,并推出专门迁移助手承接即将停运的腾讯QClaw用户。该产品采用MIT许可证开源及本地优先策略,2.0版本新增Sites与Teams功能支持团队协作,试图通过数据自主权建立差异化优势。
TypeSafe AI推出名为Jev的AI模型,专注于邮件筛选等高频小判断任务,不生成聊天回复而是直接返回选项或概率。该模型每百万输入token收费0.042美元且输出免费,上线两周后OpenAI基于GPT-6 Luna推出支持图片输入的Decisions API公开Beta版。独立研究显示Jev在37个数据集上完成超34万次请求花费不到10美元,但在二元判断阈值调整和复杂推理方面仍存在局限。
推荐理由:原文披露了Jev与OpenAI Decisions API在成本、输入模态及架构上的具体差异,为开发者评估高频判断场景的选型提供了直接对比依据。
英伟达与微软联合发布搭载RTX Spark芯片的笔记本,黄仁勋称若无Windows则无英伟达。双方推出MXC机制在操作系统底层实现Agent安全隔离,并将1 Petaflop算力封装进轻薄本以支持本地与云端协同的混合智能体验。
TypeSafe旗下非文本AI模型Jev获a16z领投的8.7亿美元融资,估值达75亿美元;同期微软发布Microsoft-Decision-1,OpenAI开放Decisions API公测,vLLM推出6款决策模型。这类模型专为Agent工作流设计,通过单次前向输出选项概率以替代高成本LLM进行路由、分类等微小判断,旨在大幅降低延迟与Token费用。
推荐理由:原文梳理了微软、OpenAI等厂商密集发布决策模型的动态,揭示了Agent工作流中低成本高频判断的技术趋势与商业逻辑。
字节拆分AI制药公司Anew Labs完成2.9亿美元融资,估值达15亿美元。阿里达摩院通用医疗影像AI模型DAMO RADAR登上《Science》,使医生阅片时间减少30.7%。腾讯云联合迈瑞医疗上线全球首个医疗技术服务大模型,关键问题回答准确率达99%,支持秒级响应。
iMLite AI(悟境)已部署至超过90万台低功耗智能硬件,服务30余家B端客户。该平台通过感知编码、环境建模与端侧Runtime SDK,在高尔夫、两轮出行等场景实现实时决策。目前采用SDK授权与设备License模式,并积累万级决策数据以优化算法闭环。
光禾万物正筹备正式上线AI改造撮合平台,已提前承接50家企业需求。平台通过“AI方案擂台”进行多团队比选,并利用“项目作战室”管理从调研到复盘的全流程,旨在解决企业选型难及交付风险问题。
GitHub开源项目REA(Reverse Engineer Anything)近期热度飙升,总星数达4.1万。该工具通过MCP协议接入Claude Code、Codex等Agent,使其能无需源码即可逆向分析手机App、网站及二进制文件,还原伪代码或模块结构。
库卡将于10月12日至16日在第26届工博会重磅发布“开天 KAI”智能平台。该平台以全量数据、数字孪生和多智能体为核心,旨在解决工业智能化升级中的数据决策割裂与柔性不足痛点。现场还将展示Visual Components CN、具身智能及KUKA LBR NEXUS协作机器人等成果,并在半导体、新能源等场景进行实景演示。
LeCun 创办的 AMI 联合多所高校推出面向视觉规划的分层世界模型 H-JEPA,通过堆叠 JEPA 实现不同时间跨度的状态预测与接力细化动作。该模型在 Visual AntMaze 仿真迷宫任务中三层架构成功率达 73%,显著高于单层模型的 18%,且以更少计算量取得更好表现。团队同步开源了代码和预训练模型权重,支持研究者直接加载复现实验。
衣流AI完成产品开发并开放真实门店测试,专为服装零售场景打造垂直AI内容营销工具。该工具通过专项模型优化,一键生成朋友圈文案、小红书图文及短视频脚本,解决中小店主缺乏专业创作能力的痛点。目前已有杭州、广州等地门店试用,反馈显示其能显著缩短内容产出时间并提升到店客流。
莱诺鸟将AI详情页、电商套图和UGC风格视频生成整合至同一平台,支持品牌团队完成从商品展示到营销传播的素材制作。据团队数据,详情页与套图生成耗时约30秒,平台品牌方用户已超3万人。依托美妆行业积累,其正结合包材设计与供应链对接,逐步向泛消费品领域拓展。
AI智慧体育系统通过智能硬件与云端平台,实时采集跳绳、短跑等国标体测及体育中考项目数据。内置算法对标《国家学生体质健康标准》评分规则,输出运动负荷与体测等级,支持老师端管理档案与家长端查看训练过程。该系统已在中山、广州等地校园及校外机构落地,实现日常训练、模拟体测与中考备考的数据闭环。
谷歌内部正在测试代号为“Carbon”的 Gemini 4 下一代模型检查点,其编程性能据称已逼近 Anthropic 的 Opus 5.5。多位员工透露,递归自我提升(RSI)技术是实现这一进展的关键,允许 AI 自主发现错误并优化逻辑。目前该模型仅接入内部编码平台 Jetski,尚未向公众开放,而前代 Argon 因安全考量仍采取分阶段发布策略。
AI原生创投情报站“问迹AI”近日正式对外开放,依托大模型与Agent Harness系统,通过多智能体协同完成检索、核实与整合,为一级市场参与者提供赛道分析、榜单及商业速览。该平台覆盖具身智能等热门方向,关键事实均标注公开来源以解决信息碎片化与溯源难题,目前融资轮次与金额暂未披露。
OpenAI宣布Codex负责人Tibo官宣dots全面登陆手机端,iOS和安卓用户可在ChatGPT App中直接创建、配置拥有云电脑和浏览器、能连接4000多个插件的24小时在线AI Agent。此次更新实现了dot与Codex的联动优化,并面向符合条件的Pro用户推出了Beta版prompt预测补全功能。
微软发布新一代快速决策AI模型 Microsoft-Decision-1,专为结构化决策任务设计,运行速度是 OpenAI GPT-6 Sol 的35倍。该模型基于 Qwen3.5-9B 构建,通过专项后训练实现从预设选项中选取最优解并赋予概率评分,适用于路由分发、内容分类及工作流控制等场景。
推荐理由:微软推出专为结构化决策设计的轻量模型,在延迟和成本上显著优于主流大语言模型,为AI代理工作流提供了更高效的底层组件。
据Business Insider报道,谷歌内部正在测试Gemini 4的新版本Carbon,员工反馈其在编程任务上的表现接近Claude Opus 5.5。除已官宣的旗舰模型Argon外,内部还出现了Barium、Carbon等研发代号,社区亦发现疑似gemini-4-flash-preview的SDK标识。
Anthropic 发布 Claude 九月更新回顾,将 Chat 与 Cowork 合并为统一的 Claude 体验,支持云端运行工作流并在合上笔记本后继续执行。同时推出 Claude 5.5 系列模型,其中 Opus 5.5 处理复杂任务,Sonnet 5.5 用于快速修改,并新增 /slides、/docs、/designs 指令以直接生成对应格式文档。
Prime Intellect 推出用 Rust 从零重写的 Prime Agent,由 2,000 多个 agent 在两周内自主完成端到端迁移。新版比 TypeScript 版本冷启动快约 14 倍,内存使用减少超过 80%,并新增 Windows 原生支持。该工具保持开源,可通过一条命令安装。
推荐理由:原文披露了多智能体自主重写代码的完整流程与性能对比数据,为评估大规模自动化迁移提供了可参考的方法论。
LangChain 发布示例项目 Restock,演示如何利用 Managed Deep Agents 和 Stripe Link 构建能在 Slack 中完成办公用品购买并安全支付的 AI 智能体。
Sierra 发布名为 Poppy 的 Personal Agent Protocol 草案,并宣布新增 OpenAI、Meta、Shopify、Walmart 等 35 家设计合作伙伴。该协议定义了发现、会话、登录、单一会话和完成任务五个构建模块,基于 OAuth、JWT、HTTPS、OpenAPI 和 MCP 等开放标准,旨在让企业识别代表客户行事的个人代理并设定交互权限。
推荐理由:原文给出了 Poppy 协议的五个构建块、底层标准和新加入的 35 家设计伙伴,读者可以据此判断它如何改变个人智能体与企业的协作方式。
Treasure AI 在 Agentic World 2026 上发布了 Digital Workers 和 Personalization Studio,前者为集成于营销工作流的自主 AI 智能体,后者支持实时网站个性化。公司还推出了基于点击计费的邮件营销定价模式及用于 AI 决策的信号功能。Digital Workers 具备“终止开关”以确保安全,旨在处理性能报告等繁琐任务而非取代人工。
OpenAI 为 ChatGPT 用户推出了虚拟试穿功能,用户在浏览服装和配饰时可点击“试穿”按钮,上传或拍摄自拍照以生成穿着效果图片。该功能已在 ChatGPT 网页版和移动端应用上线,支持将商品保存至收藏夹或在 ChatGPT Library 中建立文件夹进行整理。
Meta 在纽约广告周宣布了一系列广告更新,包括升级 AI 商业助手、扩展创意工具及推出新购物体验。其 AI 商业助手新增了上下文记忆和代理能力,可通过对话提示自动生成创意元素、调整定向并修改预算。此外,Meta 将 Ads Creative Studio 向更多广告主开放,支持从静态素材生成视频,并测试通过 Meta Ads MCP 服务器接入第三方 AI 工具以管理营销活动。
推荐理由:原文列出了Meta在广告周发布的多项AI工具更新,品牌可据此评估其智能体功能对现有广告投放流程的潜在影响。
沃尔玛在500家门店推出约1小时完成的极速路边自提服务,Walmart+会员可免费无限次使用,该服务将在未来几周扩展至全美。同时上线“Shop to Light”功能,顾客通过App搜索商品时,货架LED灯会闪烁指引位置;并在美国门店引入基于Sorenson服务的手语翻译支持。此外,“Stock the Light”功能也被用于辅助员工快速定位补货位置及处理线上订单履约。
SAP 在 SAP Connect 上宣布扩展此前发布的六款 Joule Assistants 的功能,并新增专门的 Joule Agents 以处理关键供应链任务,计划于 2026 年第四季度正式通用可用。这些更新涵盖产品设计、供应链规划、制造、物流、资产运营及商业网络协作,旨在让 AI 智能体在业务上下文中协调行动,从而提升决策速度并减少人工干预。
ts-rust(tsc-rs)是由LLM将微软TypeScript编译器、检查器和LSP从Go移植到Rust的项目,作者称全部代码由LLM编写且本人未读过代码。
OpenAI 于10月7日在 GitHub 发布 openai/math 仓库,收录其未公开内部模型产出的722份数学手稿。这些成果归为372个组,覆盖数论、代数几何、偏微分方程等方向,每个结果平均花费约3小时 ChatGPT Pro 级别思考算力。
Anthropic 发布 Claude Dashboards 和 Claude Motion 两项 beta 功能。Dashboards 可连接 BigQuery、Databricks、Snowflake 或 Salesforce 等工具,通过自然语言生成并持续更新仪表板;Motion 则通过编写代码将文本、图表转化为可编辑的动画讲解视频。
Google 发布并开源 AQuA(Ambient Quality Agent),在 Google Cloud 项目中定时从 Cloud Trace、Cloud Logging 或 BigQuery 抽取生产会话,经抽样、评审、聚类、验证、跟踪五阶段流水线诊断 Agent 失败。
推荐理由:原文给出了五阶段流水线、验证机制和实测修复数据,读者可了解生产环境智能体质量监控如何落地。
Google AI Edge团队以Apache 2.0许可开源ML Drift,作为LiteRT的核心GPU加速层,抽象OpenGL ES、OpenCL、Metal和WebGPU等硬件复杂性。
推荐理由:原文披露了跨平台GPU推理引擎的架构升级、性能数据及生产落地案例,端侧AI开发者可据此评估迁移路径。
OpenRouter 宣布 GPT-6 Luna Decisions 上线。该模型基于 OpenAI 的 Decisions API,支持发送文本、JSON 或图片并返回带概率的类型化答案,定价为输入 $0.10/M、输出免费,上下文窗口为 1M。引用 OpenAI 开发者账号称其决策速度比通过 Responses API 的 GPT-6 Luna 最快 10 倍。
LangChain 重构 Deep Agents 的技能(Skills)支持,推出工具绑定、固定技能和线程内重载三项更新以应对企业级数千个技能的场景。工具可绑定至技能并在读取时按需加载以保持上下文精简;用户可通过显式请求固定技能以在首次模型调用前预加载指令并降低延迟;长时间运行的线程可通过将 skills_metadata 设为 None 来重新扫描并获取新增或变更的技能。
NVIDIA与微软在旧金山活动上宣布共同设计软硬件以支持AI智能体在Windows PC上运行,并正式推出RTX Spark平台。
推荐理由:原文披露了RTX Spark的具体硬件规格、预购时间及MXC系统级细节,为评估本地运行AI智能体的硬件路线提供了依据。
Anthropic 发布 Claude Code v2.1.293,将 Claude Haiku 5.5 设为 API 默认模型,支持 1M 上下文,定价 $0.10/$0.50 每百万 token。
Anthropic 宣布为 Claude Max 和 Team 订阅用户新增月度 Claude Platform API 额度。Max 5x 提供 $100、Max 20x 提供 $200,Team 最高可达 $500 且支持共享。该额度适用于包括 Haiku 5.5 在内的所有模型,允许用户在自有代码或第三方 harness 中调用。
OpenAI面向每周使用ChatGPT的超过12亿人推出全新GPT-6模型及Intelligent UI功能,该功能可生成图形、按钮、表单等交互式组件以优化回答体验。GPT-6 Instant平均比GPT-5.6 Instant快44%开始作答,且能交错进行思考与回答。目前Plus、Pro、Business和Enterprise层级已逐步推出,Free和Go层级将于次日扩展覆盖。
推荐理由:官方披露了Intelligent UI的组件库与编译器机制,并给出GPT-6在响应速度与安全评估上的具体对比数据。
Perplexity 开源 pplx-embed-v2-late,包含 9B 和 0.6B 两个针对文本和图像的 late-interaction 多向量嵌入模型,二者共享同一嵌入空间。
Anthropic 推出可选加入的开源漏洞扫描服务 OSS Scanner,利用其最强模型(包括 Claude Mythos)定期免费扫描开源项目。该服务输出全模型生成、无人工复核的报告,旨在实现更快更频繁的扫描以应对快速开发的漏洞利用。