OpenAI dots登陆移动端:支持手机创建配置24小时在线AI Agent
OpenAI宣布Codex负责人Tibo官宣dots全面登陆手机端,iOS和安卓用户可在ChatGPT App中直接创建、配置拥有云电脑和浏览器、能连接4000多个插件的24小时在线AI Agent。此次更新实现了dot与Codex的联动优化,并面向符合条件的Pro用户推出了Beta版prompt预测补全功能。
OpenAI宣布Codex负责人Tibo官宣dots全面登陆手机端,iOS和安卓用户可在ChatGPT App中直接创建、配置拥有云电脑和浏览器、能连接4000多个插件的24小时在线AI Agent。此次更新实现了dot与Codex的联动优化,并面向符合条件的Pro用户推出了Beta版prompt预测补全功能。
微软发布新一代快速决策AI模型 Microsoft-Decision-1,专为结构化决策任务设计,运行速度是 OpenAI GPT-6 Sol 的35倍。该模型基于 Qwen3.5-9B 构建,通过专项后训练实现从预设选项中选取最优解并赋予概率评分,适用于路由分发、内容分类及工作流控制等场景。
推荐理由:微软推出专为结构化决策设计的轻量模型,在延迟和成本上显著优于主流大语言模型,为AI代理工作流提供了更高效的底层组件。
据Business Insider报道,谷歌内部正在测试Gemini 4的新版本Carbon,员工反馈其在编程任务上的表现接近Claude Opus 5.5。除已官宣的旗舰模型Argon外,内部还出现了Barium、Carbon等研发代号,社区亦发现疑似gemini-4-flash-preview的SDK标识。
Anthropic 发布 Claude 九月更新回顾,将 Chat 与 Cowork 合并为统一的 Claude 体验,支持云端运行工作流并在合上笔记本后继续执行。同时推出 Claude 5.5 系列模型,其中 Opus 5.5 处理复杂任务,Sonnet 5.5 用于快速修改,并新增 /slides、/docs、/designs 指令以直接生成对应格式文档。
Prime Intellect 推出用 Rust 从零重写的 Prime Agent,由 2,000 多个 agent 在两周内自主完成端到端迁移。新版比 TypeScript 版本冷启动快约 14 倍,内存使用减少超过 80%,并新增 Windows 原生支持。该工具保持开源,可通过一条命令安装。
推荐理由:原文披露了多智能体自主重写代码的完整流程与性能对比数据,为评估大规模自动化迁移提供了可参考的方法论。
LangChain 发布示例项目 Restock,演示如何利用 Managed Deep Agents 和 Stripe Link 构建能在 Slack 中完成办公用品购买并安全支付的 AI 智能体。
ts-rust(tsc-rs)是由LLM将微软TypeScript编译器、检查器和LSP从Go移植到Rust的项目,作者称全部代码由LLM编写且本人未读过代码。
OpenAI 于10月7日在 GitHub 发布 openai/math 仓库,收录其未公开内部模型产出的722份数学手稿。这些成果归为372个组,覆盖数论、代数几何、偏微分方程等方向,每个结果平均花费约3小时 ChatGPT Pro 级别思考算力。
Anthropic 发布 Claude Dashboards 和 Claude Motion 两项 beta 功能。Dashboards 可连接 BigQuery、Databricks、Snowflake 或 Salesforce 等工具,通过自然语言生成并持续更新仪表板;Motion 则通过编写代码将文本、图表转化为可编辑的动画讲解视频。
Google 发布并开源 AQuA(Ambient Quality Agent),在 Google Cloud 项目中定时从 Cloud Trace、Cloud Logging 或 BigQuery 抽取生产会话,经抽样、评审、聚类、验证、跟踪五阶段流水线诊断 Agent 失败。
推荐理由:原文给出了五阶段流水线、验证机制和实测修复数据,读者可了解生产环境智能体质量监控如何落地。
Google AI Edge团队以Apache 2.0许可开源ML Drift,作为LiteRT的核心GPU加速层,抽象OpenGL ES、OpenCL、Metal和WebGPU等硬件复杂性。
推荐理由:原文披露了跨平台GPU推理引擎的架构升级、性能数据及生产落地案例,端侧AI开发者可据此评估迁移路径。
OpenRouter 宣布 GPT-6 Luna Decisions 上线。该模型基于 OpenAI 的 Decisions API,支持发送文本、JSON 或图片并返回带概率的类型化答案,定价为输入 $0.10/M、输出免费,上下文窗口为 1M。引用 OpenAI 开发者账号称其决策速度比通过 Responses API 的 GPT-6 Luna 最快 10 倍。
LangChain 重构 Deep Agents 的技能(Skills)支持,推出工具绑定、固定技能和线程内重载三项更新以应对企业级数千个技能的场景。工具可绑定至技能并在读取时按需加载以保持上下文精简;用户可通过显式请求固定技能以在首次模型调用前预加载指令并降低延迟;长时间运行的线程可通过将 skills_metadata 设为 None 来重新扫描并获取新增或变更的技能。
NVIDIA与微软在旧金山活动上宣布共同设计软硬件以支持AI智能体在Windows PC上运行,并正式推出RTX Spark平台。
推荐理由:原文披露了RTX Spark的具体硬件规格、预购时间及MXC系统级细节,为评估本地运行AI智能体的硬件路线提供了依据。
Anthropic 发布 Claude Code v2.1.293,将 Claude Haiku 5.5 设为 API 默认模型,支持 1M 上下文,定价 $0.10/$0.50 每百万 token。
Anthropic 宣布为 Claude Max 和 Team 订阅用户新增月度 Claude Platform API 额度。Max 5x 提供 $100、Max 20x 提供 $200,Team 最高可达 $500 且支持共享。该额度适用于包括 Haiku 5.5 在内的所有模型,允许用户在自有代码或第三方 harness 中调用。
OpenAI面向每周使用ChatGPT的超过12亿人推出全新GPT-6模型及Intelligent UI功能,该功能可生成图形、按钮、表单等交互式组件以优化回答体验。GPT-6 Instant平均比GPT-5.6 Instant快44%开始作答,且能交错进行思考与回答。目前Plus、Pro、Business和Enterprise层级已逐步推出,Free和Go层级将于次日扩展覆盖。
推荐理由:官方披露了Intelligent UI的组件库与编译器机制,并给出GPT-6在响应速度与安全评估上的具体对比数据。
Perplexity 开源 pplx-embed-v2-late,包含 9B 和 0.6B 两个针对文本和图像的 late-interaction 多向量嵌入模型,二者共享同一嵌入空间。
Anthropic 推出可选加入的开源漏洞扫描服务 OSS Scanner,利用其最强模型(包括 Claude Mythos)定期免费扫描开源项目。该服务输出全模型生成、无人工复核的报告,旨在实现更快更频繁的扫描以应对快速开发的漏洞利用。
某平台发布了新的 AI 模型、工具或重大功能更新。该更新涉及面向品牌零售的新产品、平台与系统能力。