MIT 教授谈 OpenAI 模型解 Navier-Stokes 反例:人类读不懂的证明来了
MIT 工程教育副院长 Justin Solomon 在播客中谈及 OpenAI 模型解决 Navier-Stokes 方程反例一事,指出由此产生的数学证明人类难以读懂。该讨论聚焦于 AI 在复杂数学问题上的能力边界及可解释性挑战。
MIT 工程教育副院长 Justin Solomon 在播客中谈及 OpenAI 模型解决 Navier-Stokes 方程反例一事,指出由此产生的数学证明人类难以读懂。该讨论聚焦于 AI 在复杂数学问题上的能力边界及可解释性挑战。
TypeSafe AI近日完成8.7亿美元A轮融资,由a16z领投,红杉资本和DCVC参投,公司估值达到75亿美元。其核心产品Jev是一款不生成文本、直接返回类型化值和概率分布的“System One”模型,旨在解决LLM输出结构化判断时的错配问题。据称Jev运行速度可达同类LLM的200倍,成本低至1/400,目前已有约三分之一的财富500强企业接入该模型用于智能体决策等场景。
推荐理由:原文披露了Jev模型在成本与速度上的具体量化优势,以及其在智能体循环中替代高频大模型调用的技术路径。
前字节跳动实习生田柯宇创办的世界模型公司获得近3000万美元(约合人民币2亿元)融资,投后估值2亿美元,投资方包括五源资本、IDG资本等。该公司目前团队仅10人且尚无产品,计划通过构建包含约20万个符号的“视觉词典”来降低视频生成算力成本,目标是将生成1秒视频的成本降至原来的十分之一,完整模型计划于2027年发布。
OpenAI于2026年10月6日在GitHub一次性发布700多份手稿,声称解决数百个未解数学问题,引发数学界强烈反响。数学博客Proofs and Prompts收集了100多位研究者的回应,菲尔兹奖得主Peter Scholze呼吁保持耐心并警告加密风险,Terence Tao描述了对AI生成证明的复杂感受。
推荐理由:文章汇总了百余名数学家对OpenAI发布700多份数学手稿的回应,呈现从震惊到担忧职业未来的多种立场。
美国企业AI预算正呈现三重结构:巨头自建替代品,中型企业砍预算或降档,中小企业直接投奔中国开源权重。Uber等公司因Token消耗过快导致预算超支,促使微软、Meta等巨头转向自研模型以降低成本。
推荐理由:文章梳理了美国企业因Token成本压力导致AI预算分层的现状,并分析了中国开源模型在中小企业市场渗透的具体数据与原因。
Ruby on Rails创始人DHH在Rails World大会宣布公司不再将手写代码作为常规开发方式。谷歌披露企业内部近75%的新增代码已由AI生成,较两年前大幅跃升。Layoffs.fyi统计显示2026年上半年全球科技行业因AI累计裁员超12万人,程序员面临岗位缩减与技能重构的双重压力。
工业自动化推动x86、Arm、RISC-V三条架构路线在工业边缘交汇,AI加速边缘芯片渗透率接近47%。英特尔推第二代酷睿强化生态,瑞芯微以RK3588等异构方案优化能效成本,阿里玄铁C950实现千亿参数大模型本地运行。竞争焦点转向工具链、RTOS及认证体系等软基础设施适配能力。
火山引擎在平遥国际电影节发布Seedance影视合作计划,面向全球专业影视项目提供Token补贴、宣发资源及技术支持,单项目激励最高可达100万元人民币。这是字节跳动借助AI视频生成模型Seedance 2.0深入院线电影制作环节的最新动作,此前其参与部分场景制作的《三星堆:未来往事》已定档院线。
Recursive Superintelligence联合创始人田渊栋在播客中透露,其与GPT-5合作完成最后一篇关于神经网络grokking现象的论文时,效率提升了6到10倍,因此意识到研究者工作可能在五年内被取代。
Utopai Studios利用真实影视制作中的专业反馈对基于MiniMax H3后训练的定制视频模型Utopai X进行优化,使其在Artificial Analysis文生视频盲评榜单中位列全球第二、全美第一。
英伟达与微软联合发布搭载RTX Spark芯片的笔记本,黄仁勋称若无Windows则无英伟达。双方推出MXC机制在操作系统底层实现Agent安全隔离,并将1 Petaflop算力封装进轻薄本以支持本地与云端协同的混合智能体验。
微软AI部门CEO苏莱曼在社交媒体推介诺贝尔经济学奖得主达龙·阿西莫格鲁发表于《The Humanist Review of AI》的文章。阿西莫格鲁预测未来十年AI仅能拉动GDP增长约1.5%,最多取代5%的工作岗位,认为当前行业过度追求模仿人类智能的全面自动化存在偏差。
虎嗅发布深度分析指出,Alphabet和亚马逊等科技巨头的创纪录利润主要源于对SpaceX、Anthropic等公司的股权投资估值上浮,而非实际现金流入。剔除纸面浮盈后,Alphabet单季自由现金流首次转负,五大巨头合计表外承诺高达1.65万亿美元。
Rhodium报告显示中美AI模型价格呈现反向走势:中国主流前沿模型单次任务成本约0.04—0.5美元,远低于Claude的2—4美元;但在资本市场,DeepSeek每1美元ARR对应约163美元估值,OpenAI仅约34美元。
开源工具REA通过MCP协议接入Claude Code等Agent,实现无需源码的App逆向分析,GitHub总星数已达4.1万。该工具覆盖原生二进制、JavaScript及Android APK等多类软件,能还原伪代码与模块结构。尽管社区已尝试逆向微信、支付宝等国民App,但其核心逻辑位于服务端,客户端加固措施仍构成主要防护屏障。
觅蜂科技发布面向大众的众包数据采集App“觅蜂派”,并投入1亿元激励;原力无限旗下星河数据也宣布投入5亿元推动第一人称数据采集。此举旨在解决具身智能从百万小时向千万小时跨越时的长尾场景缺失问题,通过社会化生产获取维修、护理等分散专业技能数据,但行业仍面临采购端集中及Ego数据黄金期有限等挑战。
TypeSafe旗下非文本AI模型Jev获a16z领投的8.7亿美元融资,估值达75亿美元;同期微软发布Microsoft-Decision-1,OpenAI开放Decisions API公测,vLLM推出6款决策模型。这类模型专为Agent工作流设计,通过单次前向输出选项概率以替代高成本LLM进行路由、分类等微小判断,旨在大幅降低延迟与Token费用。
推荐理由:原文梳理了微软、OpenAI等厂商密集发布决策模型的动态,揭示了Agent工作流中低成本高频判断的技术趋势与商业逻辑。
OpenAI于10月一次性发布722篇机器生成的数学手稿及372个成果组,宣称解决纳维-斯托克斯方程等难题。陶哲轩联合25名顶尖数学家此前发布《人工智能在数学中的严重错位》预警风险,批评AI跳过人类推演过程导致“证明消化不良”。此举被视为OpenAI在营收不及预期背景下,为对抗Anthropic而进行的性能营销,引发了关于AI破坏数学研究生态与美学价值的争议。
字节跳动 Seed 团队联合多所高校发布论文,指出 DeepSeek-V4 因采用分块 KV 缓存压缩机制导致长文本检索存在“相位敏感性”缺陷,在128K上下文实验中不同 Token 位置的检索准确率落差高达 40.23 个百分点。
推荐理由:原文通过字节Seed团队对DeepSeek-V4长文本检索缺陷的技术溯源,揭示了分块KV缓存压缩机制导致的相位敏感性及其对模型评测盲区的影响。
生成式AI在诊断推理上已超越单个医生,但通用大模型存在漏读化验数据且不提示的风险。布兰迪·扎卡里博士指出,临床AI不能仅靠医生掌握提示词工程,需在模型外构建可复现的数据提取与逻辑层。未来方向是打造结合机器算力与人类判断力的“仿生医生”,而非简单替代。
眸娱发文分析 AI 冒充刘欢妻子带货事件,指出该行为利用逝者家属身份进行信任变现,并对比了戚薇等艺人主动授权 AI 形象与王劲松等遭遇盗用的两极分化现状。调查显示定制一条明星 AI 仿冒视频仅需 70-100 元,而合规授权正将静态肖像转化为可持续商业价值的数字 IP。尽管中央网信办要求标注 AI 生成内容,但隐蔽的标注形式难以保护消费者知情权,平台治理需通过拉开合规与违规的流量成本差距来应对。
联合研究团队推出虚拟量子工程实验室Quantum-Harbor及包含49项真实任务的QIQCBench,对17个顶尖AI Agent进行压力测试。结果显示各模型通过率从78%骤降至3%,大量失败源于耗尽预算或陷入死循环;多体物理类任务平均通过率仅15%,前三模型拿下64%而其余14个模型合计仅4%。
字节拆分AI制药公司Anew Labs完成2.9亿美元融资,估值达15亿美元。阿里达摩院通用医疗影像AI模型DAMO RADAR登上《Science》,使医生阅片时间减少30.7%。腾讯云联合迈瑞医疗上线全球首个医疗技术服务大模型,关键问题回答准确率达99%,支持秒级响应。
SevenX创始人近期在北美与101位AI从业者进行了高密度交流,发现一线研究员对模型能力提升持乐观态度,但认为更强的模型不会自动转化为更好的交付。文章指出当前存在“模型按月进化、电网按年扩容”的时间差,并观察到部分大厂已停止将AI采用率纳入考核,转而关注产出质量与ROI。此外,具身智能领域因验证链条长且硬件路线未收敛,进展相对谨慎,而算力基础设施正面临电力容量与并网周期的硬约束。
智谱GLM-5.3上架Amazon Bedrock开启收入分成模式,高盛上调其评级至“买入”并预计2026年底ARR达32亿美元;DeepSeek则通过Bedrock实现分发最大化而非直接变现。
GitHub开源项目REA(Reverse Engineer Anything)近期热度飙升,总星数达4.1万。该工具通过MCP协议接入Claude Code、Codex等Agent,使其能无需源码即可逆向分析手机App、网站及二进制文件,还原伪代码或模块结构。
尤瓦尔·赫拉利在《智人之上》指出,信息本质是维持网络联结的黏合剂,其功能在于创造秩序而非呈现真相。书中揭示算法为提升参与度而放大愤怒情绪,如Facebook在缅甸事件中因优化目标函数间接助长暴力冲突。作者强调AI作为黑盒技术可能失控,呼吁人类警惕将权力交给无法解释的智能系统。
虎嗅发布对AI初创公司Instinct的深度分析,指出其由23岁辍学生Noah Shinn创立,在成立一年内估值突破100亿美元。Instinct通过iMessage和WhatsApp等极简入口提供Personal Agent服务,用户留存与授权率较高,但面临算力成本激增、未经批准操作引发的隐私安全风险以及依赖第三方通信入口受制于巨头的问题。
推荐理由:文章剖析了Instinct从估值暴涨到面临算力、隐私及入口依赖的三重挑战,并探讨了中国独立Agent发展的生态壁垒。
LeCun 创办的 AMI 联合多所高校推出面向视觉规划的分层世界模型 H-JEPA,通过堆叠 JEPA 实现不同时间跨度的状态预测与接力细化动作。该模型在 Visual AntMaze 仿真迷宫任务中三层架构成功率达 73%,显著高于单层模型的 18%,且以更少计算量取得更好表现。团队同步开源了代码和预训练模型权重,支持研究者直接加载复现实验。
36氪研究院院长邹萍在2026全球影像场景产业大会指出,中国影像产业正从单一硬件比拼升维为生态与体验的综合较量。混合式人工智能推动价值重心从成像质量转向感知智能,端侧AI将专业能力下放至普通用户。数据显示未来五年周边配套设备年均增速9.2%,跑赢主机设备,配件生态成为留住用户的关键变量。
诺贝尔奖得主达龙·阿西莫格鲁指出,AI难以在短期内实现全面自动化,预计未来10年其仅能取代约5%的人类工作。他主张开发“以员工为中心”的AI,通过增强而非替代劳动者来提升生产力,并批评当前盲目追求通用人工智能(AGI)及完全自动化的行业趋势。
虎嗅第13场AI100闭门会上,Rokid、小度及听智慧等代表指出,接入大模型仅让AI硬件达到及格线。长期竞争力取决于对物理场景的理解、AIOS软硬件整合能力及“可路由”数据资产的积累。Sawyer Sun提出以30天留存率低于30%为警惕新鲜感消费的投资观察线,强调第二代产品迭代才是检验团队解决重量、功耗等真实问题能力的关键。
莱诺鸟将AI详情页、电商套图和UGC风格视频生成整合至同一平台,支持品牌团队完成从商品展示到营销传播的素材制作。据团队数据,详情页与套图生成耗时约30秒,平台品牌方用户已超3万人。依托美妆行业积累,其正结合包材设计与供应链对接,逐步向泛消费品领域拓展。
Nathan Benaich(Air Street Capital)发布第九份年度 State of AI Report 2026,涵盖研究、产业、政治、安全与预测五个部分。该速读版本提炼了报告中关于 AI 加速 AI、千亿级收入规模、电力瓶颈及安全议题的关键数字与核心结论。完整 PDF 报告可通过 stateof.ai 获取。
OpenAI发布Astra并解答Navier–Stokes难题,Meta推出Muse,但自主编码智能体仅带来30%实际发布增幅。当前瓶颈已从算力转向电力,百万卡集群需1.5–2吉瓦功耗且并网等待长达5年。行业正从追求Token用量转向关注ROI,探索RL与环境作为新扩展路径以弥合能力与现实间的差距。
谷歌内部正在测试代号为“Carbon”的 Gemini 4 下一代模型检查点,其编程性能据称已逼近 Anthropic 的 Opus 5.5。多位员工透露,递归自我提升(RSI)技术是实现这一进展的关键,允许 AI 自主发现错误并优化逻辑。目前该模型仅接入内部编码平台 Jetski,尚未向公众开放,而前代 Argon 因安全考量仍采取分阶段发布策略。
由AI生成的摆摊老板短剧意外带火“立规矩、不烧心”网络热梗,成为首个AI原创、真人传播的流行语。据QuestMobile数据,截至2026年7月,红果短剧日活跃用户达1.68亿,月人均单日使用时长125分钟。AI技术大幅降低制作门槛,推动年代、末世等题材漫剧爆发,精准填补了用户的碎片化娱乐需求。
vivo X500系列因存储成本上涨全系提价1100元起,首销表现平平。面对AI智能体手机普及趋势,vivo虽发布OriginOS 7及蓝河系统4,但自研30B端侧大模型预计2028年底才落地终端,技术迭代滞后于行业节奏。
IDC数据显示,2026年第三季度全球PC出货量为6270万台,同比下降20.1%,创历史最大三季度跌幅。联想、惠普等头部厂商无一幸免,其中惠普跌幅达30.9%。核心原因系AI数据中心抢占存储产能导致DRAM价格暴涨,叠加前期渠道囤货透支需求,预计2027年前市场仍将面临双位数下滑压力。
阿里巴巴在2026年NBA中国赛中深化AI应用,基于通义千问的“NBA Chat”首次引入多模态交互并上线三个风格化Agent。阿里AI视频生成模型Wan 3.0支持10-15秒内生成360度实时回放及球迷AIGC视频。淘宝88VIP连续第二年成为首席合作伙伴,为超6400万会员提供专属观赛权益。