DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 11|回复: 0

AI动态 9.2 | Fable5.1/Devin集成/Codex桌面/百万小时/T800

[复制链接]

1190

主题

1201

帖子

4006

积分

版主

Rank: 7Rank: 7Rank: 7

积分
4006
发表于 3 天前 | 显示全部楼层 |阅读模式
AI 动态 · 2026.09.02 · AI Coding × 具身智能

1. Anthropic Claude Fable 5.1 + Mythos 5.1 正式发布 + Cognition Devin 当日集成,旗舰编程模型首次“屠榜 + 砍价 + 扩路由”三件套同步
9.1 Anthropic 推出旗舰模型 Fable 5.1 + Mythos 5.1(同底不同护栏):缓存读取价格从 $1/M 砍至 $0.25(-75%),典型工作负载 -25%、高度智能体化长任务最高 -45%;编程 Terminal-Bench 4.0 55.8%(vs Fable 5 42.0% / GPT-5.6 Sol 37.3%),科研 Terminal-Bench-Science 0.1 52.6%(vs Fable 5 24.7% / GPT-5.6 Sol 22.4%);Mythos 5.1 仅向 Project Glasswing 白名单内的网安 + 生命科学机构开放;同日 Cognition 在 X 宣布将 Fable 5.1 接入 Devin 主路由 + 融合路由(Fuse routing),相比升级前 Devin 主路由成本 -54%、Fuse 路由在性能持平下成本 -47%。
关注:当最强模型把“缓存读取”明确作为价格杠杆 + 当日就接通 Devin 路由,AI Coding 的 TCO 模型从“补全 token 数”切到“重复调用次数”——长链路 Agent 任务(连续编程 / 系统级代码审查 / 跨仓库研究)首次出现“成本可预测 + 性能可外推”的双优组合;下一阶段企业评估 AI Coding 工具的真正指标不再是“谁家模型最强”,而是“谁家路由能在不同模型 + 不同缓存策略下保持单任务成本曲线的稳定”。

2. OpenAI Codex 桌面 app 内置 Python + Node.js + LibreOffice 完整运行时 + ChatGPT 接 EHR 病历,AI Coding 从“补全工具”扩为“独立开发者工作平台”
9.1 Simon Willison 披露 OpenAI Codex 桌面 app 在 cache 目录捆绑了完整 Python + Node.js + LibreOffice 运行时 + skills,Codex 已从“云端编程工具”扩为“独立开发者工作平台”;同日 OpenAI 宣布 ChatGPT 接 EHR(电子健康记录)+ 行业数据,临床医生可安全访问患者上下文 + 研究数据,企业级医疗 AI 从“概念验证”切到“生产可用”。
关注:AI Coding 头部玩家同时完成两件事——① 桌面端把“完整运行时 + skills 生态”内化为 IDE / 桌面 app 的一部分,② 上游把“医疗合规 + EHR 接入”做成可购买的 SaaS 能力;下一阶段“云端 + 桌面 + 行业数据”三端协同将成为 AI Coding + 行业 AI 工具的标配,企业落地不再“只补一段代码”,而是“完整工程任务在本地 + 云端 + 行业数据源无缝接力”。

3. Anthropic 公布对齐与安全实践升级:3 起未授权访问事件 + METR 独立审查 + 改进计划,模型厂商“安全透明度”首次成为核心差异化指标
9.1 Anthropic 同步披露近期 3 起未授权访问事件处理结果,宣布将与 METR(Model Evaluation & Threat Research)合作进行独立审查,并公开一系列对齐 / 安全实践的改进计划(内部威胁建模升级 + 自动化红队扩编 + 第三方审计接入),与 Fable 5.1 / Mythos 5.1 同日发布;同步放出的还有“反蒸馏机制”。
关注:当 AI Coding 头部厂商把“安全事件 + 独立审查 + 改进计划”作为旗舰模型发布的配套披露,意味着行业正式把“模型层安全”和“模型层能力”放在同一优先级 —— 企业级 AI Coding 采购不再只看“基准屠榜”,而必须同时通过“独立审查 + 事件响应 + 改进闭环”三道关;下一阶段“安全透明度”将成为模型厂商的核心差异化指标,比“屠榜表”更能决定客户付费意愿。

4. 觅蜂科技累计交付无本体数据 100 万小时 + 全球首家跨越百万小时门槛,具身智能进入“GPT-3 时刻”前夜
8.31 觅蜂科技(上海具身智能数据服务商)正式交付第 2 万套无本体数采设备,累计可交付无本体数据 >100 万小时,成为全球首家跨越“百万小时级”数据门槛的服务商;机构预测 2026 年底具身智能将迎来“GPT-3 时刻”。
关注:当“无本体数据”(即不绑定特定机器人本体的数据)首次突破百万小时门槛,意味着具身智能的核心瓶颈不再是“算法不够强”而是“跨本体可复用数据不够多”——下一代具身基础模型将在这个数据底座上跑出真正的“跨本体泛化”,类似 2018 年 GPT 横空出世前的“海量文本预训练”;下一阶段拥有“数据采集 + 标注 + 评测”全链路能力的公司将吃到下一波基础设施红利。

5. 国产人形密集下线:众擎 T800 河南首批下线 + 郑州 8000 平基地 + 9 月展会三连开,人形进入“多地批量下线”阶段
9.1 国产人形机器人领域接连传出落地进展:郑州高新区众擎智能制造基地(8000 平)首批河南造 T800 人形机器人正式下线,预计今年年底完成 20-30 台组装、未来 2-3 年实现批量化生产;同期 9.4-6 青岛电博会 + 9.3-6 广州 XAIR Expo 具身智能产业博览会 + 9.8-11 厦门投洽会新质生产力专区齐开,宇树 G1/R1、乐聚 Kuavo5/Roban2、节卡 JAKA π、智元、优必选集体亮相。
关注:当 T800 河南造下线 + 多家具身展会同期开幕同时出现,意味着人形机器人正式从“单点实验室秀”切到“多地批量下线 + 多场景密集展示”——行业指标从“能不能跳 / 能不能跑”切到“单台良率 + 月度下线数 + 区域产线复制能力”三件套;下一阶段投资人不再赌“哪家厂商最强”,而是赌“哪条产线能最先跑出万台级良率 + 哪省产线能复制到全国”。

一句话:AI Coding 端 Fable 5.1 屠榜+砍价 + Devin 当日接入 + Codex 桌面完整运行时三件事指向同一信号 — AI Coding 进入“缓存可计算 + 路由可优化 + 桌面可扩展”的下半场;具身端觅蜂 100 万小时 + T800 河南造下线 + 9 月展会三连开两件事叠加,行业从“数据饥渴”切到“数据底座 + 区域产线复制”。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|Web4

GMT+8, 2026-9-5 10:03 , Processed in 0.071943 second(s), 23 queries .

Powered by Discuz! X3.4

Copyright © 2001-2021, Tencent Cloud.

快速回复 返回顶部 返回列表