跳到正文
10月10日周六
  1. 36氪 · 文章82

    TypeSafe AI完成8.7亿美元融资,其非文本生成模型Jev估值达75亿美元

    TypeSafe AI近日完成8.7亿美元A轮融资,由a16z领投,红杉资本和DCVC参投,公司估值达到75亿美元。其核心产品Jev是一款不生成文本、直接返回类型化值和概率分布的“System One”模型,旨在解决LLM输出结构化判断时的错配问题。据称Jev运行速度可达同类LLM的200倍,成本低至1/400,目前已有约三分之一的财富500强企业接入该模型用于智能体决策等场景。

    推荐理由:原文披露了Jev模型在成本与速度上的具体量化优势,以及其在智能体循环中替代高频大模型调用的技术路径。

  2. 36氪 · 文章68

    前字节实习生田柯宇创办世界模型公司获近3000万美元融资

    前字节跳动实习生田柯宇创办的世界模型公司获得近3000万美元(约合人民币2亿元)融资,投后估值2亿美元,投资方包括五源资本、IDG资本等。该公司目前团队仅10人且尚无产品,计划通过构建包含约20万个符号的“视觉词典”来降低视频生成算力成本,目标是将生成1秒视频的成本降至原来的十分之一,完整模型计划于2027年发布。

  3. AIHOT · AI 精选82

    OpenAI一次性发布700多份数学手稿,数学家们反应震惊与反感

    OpenAI于2026年10月6日在GitHub一次性发布700多份手稿,声称解决数百个未解数学问题,引发数学界强烈反响。数学博客Proofs and Prompts收集了100多位研究者的回应,菲尔兹奖得主Peter Scholze呼吁保持耐心并警告加密风险,Terence Tao描述了对AI生成证明的复杂感受。

    推荐理由:文章汇总了百余名数学家对OpenAI发布700多份数学手稿的回应,呈现从震惊到担忧职业未来的多种立场。

  4. 36氪 · 文章78

    美国企业AI预算因Token成本裂成三层,中国开源模型受中小企业青睐

    美国企业AI预算正呈现三重结构:巨头自建替代品,中型企业砍预算或降档,中小企业直接投奔中国开源权重。Uber等公司因Token消耗过快导致预算超支,促使微软、Meta等巨头转向自研模型以降低成本。

    推荐理由:文章梳理了美国企业因Token成本压力导致AI预算分层的现状,并分析了中国开源模型在中小企业市场渗透的具体数据与原因。

  5. 36氪 · 文章50

    x86、Arm与RISC-V在工业边缘正面相遇

    工业自动化推动x86、Arm、RISC-V三条架构路线在工业边缘交汇,AI加速边缘芯片渗透率接近47%。英特尔推第二代酷睿强化生态,瑞芯微以RK3588等异构方案优化能效成本,阿里玄铁C950实现千亿参数大模型本地运行。竞争焦点转向工具链、RTOS及认证体系等软基础设施适配能力。

  6. 36氪 · 文章58

    火山引擎发布Seedance影视合作计划,单项目激励最高百万

    火山引擎在平遥国际电影节发布Seedance影视合作计划,面向全球专业影视项目提供Token补贴、宣发资源及技术支持,单项目激励最高可达100万元人民币。这是字节跳动借助AI视频生成模型Seedance 2.0深入院线电影制作环节的最新动作,此前其参与部分场景制作的《三星堆:未来往事》已定档院线。

  7. 虎嗅42

    开源项目REA支持Agent逆向分析微信、支付宝等App,GitHub星数达4.1万

    开源工具REA通过MCP协议接入Claude Code等Agent,实现无需源码的App逆向分析,GitHub总星数已达4.1万。该工具覆盖原生二进制、JavaScript及Android APK等多类软件,能还原伪代码与模块结构。尽管社区已尝试逆向微信、支付宝等国民App,但其核心逻辑位于服务端,客户端加固措施仍构成主要防护屏障。

  8. 36氪 · 文章45

    觅蜂科技发布“觅蜂派”App,具身智能众包数据采集兴起

    觅蜂科技发布面向大众的众包数据采集App“觅蜂派”,并投入1亿元激励;原力无限旗下星河数据也宣布投入5亿元推动第一人称数据采集。此举旨在解决具身智能从百万小时向千万小时跨越时的长尾场景缺失问题,通过社会化生产获取维修、护理等分散专业技能数据,但行业仍面临采购端集中及Ego数据黄金期有限等挑战。

  9. 36氪 · 文章82

    微软、OpenAI等密集发布决策模型,Jev获8.7亿美元融资

    TypeSafe旗下非文本AI模型Jev获a16z领投的8.7亿美元融资,估值达75亿美元;同期微软发布Microsoft-Decision-1,OpenAI开放Decisions API公测,vLLM推出6款决策模型。这类模型专为Agent工作流设计,通过单次前向输出选项概率以替代高成本LLM进行路由、分类等微小判断,旨在大幅降低延迟与Token费用。

    推荐理由:原文梳理了微软、OpenAI等厂商密集发布决策模型的动态,揭示了Agent工作流中低成本高频判断的技术趋势与商业逻辑。

  10. 36氪 · 文章50

    OpenAI发布722篇机器生成数学手稿引发陶哲轩等数学家抗议

    OpenAI于10月一次性发布722篇机器生成的数学手稿及372个成果组,宣称解决纳维-斯托克斯方程等难题。陶哲轩联合25名顶尖数学家此前发布《人工智能在数学中的严重错位》预警风险,批评AI跳过人类推演过程导致“证明消化不良”。此举被视为OpenAI在营收不及预期背景下,为对抗Anthropic而进行的性能营销,引发了关于AI破坏数学研究生态与美学价值的争议。

  11. 36氪 · 文章84

    字节Seed团队论文揭示DeepSeek-V4长文本检索“周期性盲区”技术缺陷

    字节跳动 Seed 团队联合多所高校发布论文,指出 DeepSeek-V4 因采用分块 KV 缓存压缩机制导致长文本检索存在“相位敏感性”缺陷,在128K上下文实验中不同 Token 位置的检索准确率落差高达 40.23 个百分点。

    推荐理由:原文通过字节Seed团队对DeepSeek-V4长文本检索缺陷的技术溯源,揭示了分块KV缓存压缩机制导致的相位敏感性及其对模型评测盲区的影响。

  12. 36氪 · 文章47

    医疗AI现状分析:大模型漏读数据风险高,需构建“仿生医生”系统

    生成式AI在诊断推理上已超越单个医生,但通用大模型存在漏读化验数据且不提示的风险。布兰迪·扎卡里博士指出,临床AI不能仅靠医生掌握提示词工程,需在模型外构建可复现的数据提取与逻辑层。未来方向是打造结合机器算力与人类判断力的“仿生医生”,而非简单替代。

  13. 36氪 · 文章68

    眸娱分析 AI 冒充刘欢妻子带货:明星形象授权与盗用的商业博弈

    眸娱发文分析 AI 冒充刘欢妻子带货事件,指出该行为利用逝者家属身份进行信任变现,并对比了戚薇等艺人主动授权 AI 形象与王劲松等遭遇盗用的两极分化现状。调查显示定制一条明星 AI 仿冒视频仅需 70-100 元,而合规授权正将静态肖像转化为可持续商业价值的数字 IP。尽管中央网信办要求标注 AI 生成内容,但隐蔽的标注形式难以保护消费者知情权,平台治理需通过拉开合规与违规的流量成本差距来应对。

  14. 36氪 · 文章63

    17大顶级AI Agent在虚拟量子实验室评测中集体翻车,GPT-5.6与Opus表现领先

    联合研究团队推出虚拟量子工程实验室Quantum-Harbor及包含49项真实任务的QIQCBench,对17个顶尖AI Agent进行压力测试。结果显示各模型通过率从78%骤降至3%,大量失败源于耗尽预算或陷入死循环;多体物理类任务平均通过率仅15%,前三模型拿下64%而其余14个模型合计仅4%。

  15. 36氪 · 文章28

    字节、阿里、腾讯布局AI医疗:Anew Labs融资2.9亿美元,DAMO RADAR登《Science》,腾讯云上线医疗大模型

    字节拆分AI制药公司Anew Labs完成2.9亿美元融资,估值达15亿美元。阿里达摩院通用医疗影像AI模型DAMO RADAR登上《Science》,使医生阅片时间减少30.7%。腾讯云联合迈瑞医疗上线全球首个医疗技术服务大模型,关键问题回答准确率达99%,支持秒级响应。

  16. 36氪 · 文章55

    北美AI访谈手记:模型加速与现实交付的时间差

    SevenX创始人近期在北美与101位AI从业者进行了高密度交流,发现一线研究员对模型能力提升持乐观态度,但认为更强的模型不会自动转化为更好的交付。文章指出当前存在“模型按月进化、电网按年扩容”的时间差,并观察到部分大厂已停止将AI采用率纳入考核,转而关注产出质量与ROI。此外,具身智能领域因验证链条长且硬件路线未收敛,进展相对谨慎,而算力基础设施正面临电力容量与并网周期的硬约束。

  17. 36氪 · 文章42

    赫拉利《智人之上》:算法驱动愤怒源于商业模式,信息联结秩序而非真相

    尤瓦尔·赫拉利在《智人之上》指出,信息本质是维持网络联结的黏合剂,其功能在于创造秩序而非呈现真相。书中揭示算法为提升参与度而放大愤怒情绪,如Facebook在缅甸事件中因优化目标函数间接助长暴力冲突。作者强调AI作为黑盒技术可能失控,呼吁人类警惕将权力交给无法解释的智能系统。

  18. 虎嗅78

    虎嗅分析Instinct:00后创始人打造百亿美元估值AI Agent面临的挑战与中国市场启示

    虎嗅发布对AI初创公司Instinct的深度分析,指出其由23岁辍学生Noah Shinn创立,在成立一年内估值突破100亿美元。Instinct通过iMessage和WhatsApp等极简入口提供Personal Agent服务,用户留存与授权率较高,但面临算力成本激增、未经批准操作引发的隐私安全风险以及依赖第三方通信入口受制于巨头的问题。

    推荐理由:文章剖析了Instinct从估值暴涨到面临算力、隐私及入口依赖的三重挑战,并探讨了中国独立Agent发展的生态壁垒。

  19. 36氪 · 文章73

    AMI 发布 H-JEPA 分层世界模型并开源代码权重

    LeCun 创办的 AMI 联合多所高校推出面向视觉规划的分层世界模型 H-JEPA,通过堆叠 JEPA 实现不同时间跨度的状态预测与接力细化动作。该模型在 Visual AntMaze 仿真迷宫任务中三层架构成功率达 73%,显著高于单层模型的 18%,且以更少计算量取得更好表现。团队同步开源了代码和预训练模型权重,支持研究者直接加载复现实验。

  20. 36氪 · 文章28

    36氪研究院邹萍:中国影像产业从硬件比拼转向场景生态之战

    36氪研究院院长邹萍在2026全球影像场景产业大会指出,中国影像产业正从单一硬件比拼升维为生态与体验的综合较量。混合式人工智能推动价值重心从成像质量转向感知智能,端侧AI将专业能力下放至普通用户。数据显示未来五年周边配套设备年均增速9.2%,跑赢主机设备,配件生态成为留住用户的关键变量。

  21. 虎嗅40

    虎嗅AI100闭门会:Rokid等探讨AI硬件如何靠场景理解与数据资产活下去

    虎嗅第13场AI100闭门会上,Rokid、小度及听智慧等代表指出,接入大模型仅让AI硬件达到及格线。长期竞争力取决于对物理场景的理解、AIOS软硬件整合能力及“可路由”数据资产的积累。Sawyer Sun提出以30天留存率低于30%为警惕新鲜感消费的投资观察线,强调第二代产品迭代才是检验团队解决重量、功耗等真实问题能力的关键。

  22. 36氪 · 文章38

    莱诺鸟整合AI详情页、套图及UGC视频生成,实现电商素材30秒产出

    莱诺鸟将AI详情页、电商套图和UGC风格视频生成整合至同一平台,支持品牌团队完成从商品展示到营销传播的素材制作。据团队数据,详情页与套图生成耗时约30秒,平台品牌方用户已超3万人。依托美妆行业积累,其正结合包材设计与供应链对接,逐步向泛消费品领域拓展。

  23. 36氪 · 文章50

    谷歌下一代模型 Gemini 4 Carbon 曝光:内部测试性能逼近 Opus 5.5,RSI 成关键

    谷歌内部正在测试代号为“Carbon”的 Gemini 4 下一代模型检查点,其编程性能据称已逼近 Anthropic 的 Opus 5.5。多位员工透露,递归自我提升(RSI)技术是实现这一进展的关键,允许 AI 自主发现错误并优化逻辑。目前该模型仅接入内部编码平台 Jetski,尚未向公众开放,而前代 Argon 因安全考量仍采取分阶段发布策略。

  24. 虎嗅18

    AI短剧催生“不烧心”热梗,红果短剧日活达1.68亿

    由AI生成的摆摊老板短剧意外带火“立规矩、不烧心”网络热梗,成为首个AI原创、真人传播的流行语。据QuestMobile数据,截至2026年7月,红果短剧日活跃用户达1.68亿,月人均单日使用时长125分钟。AI技术大幅降低制作门槛,推动年代、末世等题材漫剧爆发,精准填补了用户的碎片化娱乐需求。

  25. 36氪 · 文章35

    IDC:2026年Q3全球PC出货量同比大跌20.1%,存储芯片短缺致行业承压

    IDC数据显示,2026年第三季度全球PC出货量为6270万台,同比下降20.1%,创历史最大三季度跌幅。联想、惠普等头部厂商无一幸免,其中惠普跌幅达30.9%。核心原因系AI数据中心抢占存储产能导致DRAM价格暴涨,叠加前期渠道囤货透支需求,预计2027年前市场仍将面临双位数下滑压力。