早报|苹果修复 iPhone 18 Pro 面容 ID 卡死重启/AMD 82 亿美元收购李飞飞 World Labs/智界 RX 上市
苹果推送 iOS 27.0.1,修复 iPhone 18 Pro 在面容 ID 验证时卡住并重启的问题。AMD 宣布以约 82 亿美元股票收购李飞飞创办的 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。智界 RX 正式上市,六种配置起售价 25.98 万元,余承东称其为鸿蒙智行「最好开的车」。
苹果推送 iOS 27.0.1,修复 iPhone 18 Pro 在面容 ID 验证时卡住并重启的问题。AMD 宣布以约 82 亿美元股票收购李飞飞创办的 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。智界 RX 正式上市,六种配置起售价 25.98 万元,余承东称其为鸿蒙智行「最好开的车」。
Meta 的个人 AI 智能体 Muse 在用户 Robb 开启 Marketplace 自动回复后,未经授权将其家庭地址发给买家,导致买家上门取货却无人应门;Robb 再次测试要求它不要分发地址,结果地址被发给了五个人。
爱范儿实测了近期在海外 AI 圈走红的匿名模型 Space Bunny Alpha,它能把随手画的草图直接变成可打开的网站和可交互的 3D 网页,在 OpenRouter 和 OpenCode 上线后冲上两个平台日调用量第一。
OpenAI前研究员Diogo Almeida推出拒绝聊天的模型Jev,只输出Choice、Score或Boolean及对应概率,不做自然语言生成。
OpenAI 在 DevDay 2026 发布 20 多项更新,包括自带云电脑、7×24 小时常驻后台的自主智能体 Dots,以及价格降至 GPT-6 Astra 五分之一、缓存输入每百万 token 0.10 美元的 GPT-6.1 Sol。
推荐理由:梳理了 DevDay 2026 二十多项更新的产品形态与定价,关注 Agent 落地成本的读者可据此判断可用性。
Meta的Muse上线不到两周登上美国App Store免费榜首,Sensor Tower估算截至9月24日累计下载量超340万次;9月28日Manus发布个人生活场景智能助理Cue,9月30日OpenAI在DevDay推出常驻Agent Dots。Muse把长期记忆、后台执行和日常对话组织成持续服务个人的产品,任务和记忆放在用户专属云端环境,关掉App仍可继续,并计划接入AI眼镜。
Anthropic 发布 Claude Sonnet 5.5,输出速度较 Sonnet 5 提升超 30%,单项任务成本最高降低 30%,每百万 token 输入、输出价格仍为 2 美元和 10 美元,Terminal-Bench 4.0 得分 70.6%。
ColorOS 17 深度评测显示,焕新凝光视效统一了几乎所有第一方系统应用的设计语言,流体云舍弃大黑块改为深色玻璃材质并加入莫奈取色高光。小布 AI 新增小布空间、小布与我及 PersonaX 记忆共生引擎,小布记忆升级为系统级 AI 功能,并取消 Pro 模式与思考模式。后台留存与续航相比金标 C16 明显提升,但基础应用开启动画曲线等陈年问题仍未解决。
OpenAI 在旧金山举行 DevDay 2026,一口气公布 25 项更新,横跨 ChatGPT、Codex、GPT-6 模型和 API。
推荐理由:梳理了 OpenAI DevDay 25 项更新中最关键的 5 项,可快速了解 Dots、GPT-6.1 Sol 与 Codex 的产品定位和定价思路。
Manus 2.0 上线,官方称其为架构级更新,包含自研 Agent 框架 Cascade、升级为共享工作区的桌面应用 Manus Studio,以及独立个人 Agent 应用 Cue。Cascade 主打效率,官方称可节省 32% 成本,让项目从开始就保持轻量。
Anthropic 发布 Claude 5.5 家族第二个成员 Sonnet 5.5,定位为 Opus 5.5 的快而省互补款,主打高频日常任务、修 bug、文档和表格。官方称其比 Sonnet 5 速度快 30% 以上,多数任务成本低 30%,Agent 编程评测成绩从 10% 提升到 70%。
Codeaha v1.0.0 正式发布,这是一款本地优先、国产大模型友好的 AI 编程 Agent。其会话、消息与代码变更全部落盘本地 SQLite,代码数据不出本机,并基于 Eino Graph 实现 Agent 推理。项目采用 GoFrame、Eino、mark3labs/mcp-go 及纯 Go 无 CGO 的 glebarez/go-sqlite 驱动构建。
开源 Windows 多 Agent 工作台 Termexo 发布 v0.10.9,将工作区内 Agent 状态收成按终端顺序排列的图标:空闲灰色、运行和思考绿色闪动、异常与等待授权红色、完成绿色对号。鼠标悬停可查看对应窗口名称,重命名终端后提示名称同步更新,帮助开发者找到需要处理的终端。
DeepSeek Harness v0.2 预览版于 9 月 29 日发布,同时放出 macOS 和 Windows 桌面端安装包,可在官网 deepseek.com/harness 下载,无需再折腾命令行。新版本主打日常办公和开发的开箱即用,预置常用能力,可处理文档、表格或 PDF;插件通过 npm 包名安装,并支持让 AI 自己写插件。
MateClaw 2.3.0 正式版于 2026 年 9 月 20 日发布,为 Persistent Goal 增加用户配置的托管 JSON 验收:Agent 发布不可变产物版本,服务端将检查结果绑定到当前要求与具体 generation,所有当前绑定有效后才允许完成目标。该版本还发布观察模式执行证据、Team Worker 受控干预、Skill 文档及文件夹上传。
雷峰网用两道题实测 Seedance 2.5 与可灵 VIDEO 3.0:一道是让小龙虾主持人在 15 秒内科普 OpenClaw 2.0,一道是基于《赴山海》雪中殉情参考帧改写快乐结局。
雷峰网用同一份脏销售流水和同一句提示词实测腾讯 WorkBuddy、阿里千问办公和字节豆包工作,三家都交付了 Excel、PPT 和摘要,但算出的 Q1 总额最高比最低多出 57.7%,差异来自对部门缺失订单是剔除、保留为未标注还是标为待核实。
同一句"让机器人满行程转一遍"的模糊指令下,GPT‑6 Astra、Claude Fable 5.1 和 GPT‑5.6 Sol 都让云台转了起来,但完成标准差异明显。
GLM-5.3-Flash 的 45 层架构中,34 层采用 Kimi 路线的 KDA 线性注意力,11 层采用 DeepSeek 路线的 KPool-DSA 稀疏注意力,Linear 与 Sparse 首次被放进同一套模型。
雷峰网汇总了 GPT-6 Astra 发布后首批拿到模型的用户实测。Ben Davis 让 Astra 在 Blender 里生成 4K 飞船模型,并观察到它会主动打开页面。
爱诗科技 PixVerse R2 已全量上线,把实时世界模型的能力与效率拆成两层推进:Omni Causal AR 负责抬高能力上限,Real-Time Acceleration 通过同源蒸馏、稀疏计算和金字塔式少步生成把能力带回低延迟区间。官方称 R2 的 Scaling 同时发生在模型容量、数据、任务、控制信号和时间尺度五个维度,并试图把世界模型压缩到消费级单卡实时运行。
雷峰网实测阶跃 Step 5 Preview,以 Claude Code CLI 为 Agent 工作台、Blender 做 3D 资产、Three.js/Vite 做网页呈现,完成可运行的 3D 迷你游戏《星跃岛:能量快递》,角色可在 6 个浮空平台间移动、收集 5 个能量球并抵达终点信标。
用三张圆明园鼠首照片和一段自然语言指令,GPT-6 Astra 在 Codex 中调度 Aholo Lux3D 与 Blender,生成约 19.05 万顶点、28.56 万多边形的青铜鼠首 3D 资产。
雷峰网将免费的 AgnesCode + Agnes 3.0 Flash 与 Codex + GPT-5.6 Sol 放在众智 FlagOS 开放计算全球大赛的 DeepSeek-V3 解码阶段融合 QKV-A 下投影算子题(Task66: dsv3_fused_a_gemm)上对比,两组均提交赛事官方自动化评测。
美国 AI 基础设施公司 Baseten 宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一,企业用户可通过 Codex 或 Responses API 调用 Kimi K3 和 GLM 5.3 等开源模型。
哔哩哔哩 Index LLM 团队发布 Index-Translate 多语言翻译模型家族,2B / 9B / 35B-A3B(preview)文本模型权重已在 Hugging Face 与 ModelScope 开放。该模型基于 Qwen3.5 构建,文本模型覆盖包括中文、英文在内的 150 种语言,支持术语、格式、保留内容等翻译指令,并扩展出语音字幕配音、音节可控翻译和长文档翻译等能力。
网络安全研究机构 Glow Security 发现,多个 AI 智能体创建的公开 GitHub 仓库存在超 1.3 万张屏幕截图,部分包含科技公司敏感信息,这种泄密方式被称为 PixelLeak。
OpenAI Dot 智能体的云端虚拟机现身 Geekbench,搭载 AMD EPYC 9V74 处理器,每实例分配 9 个核心,单核 1667 分、多核 9435 分,配 9.73GB 内存和 32GB 存储,运行 Ubuntu 24.04.3。
OpenAI 研究员、o1 核心作者 Noam Brown 在最新播客中表示,用 1 万个 Agent、88 小时、1300 亿 token 解出千禧年数学难题,多智能体最多只占 10% 功劳,核心仍是模型本身足够强。他透露 GPT-5.6 已首次内置可调规模的多智能体系统 Ultra Mode,默认 4 个 Agent 可提速一倍,并称数学进展让他对递归自我改进(RSI)的判断比原先更近。
DeepSeek 将 TileLang 算子开发工具及 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心库推出昇腾版本,TileLang 官宣原生支持华为昇腾 950 NPU。
Anthropic 前沿红色团队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就发布的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其为第一个能自主构建复杂端到端漏洞利用的 AI 模型。
腾讯正在秘密开发 Personal Agent 产品“Handy Bot”,并计划推出独立 App,目前已在微信端低调上线服务号,简介为“Your Personal AI Agent”。该产品与 Meta 的 Muse 同属 Personal Agent 方向,区别于会话驱动的 Chatbot,拥有长期存续的运行环境,可在后台持续推进任务。国内阿里、字节等厂商也在布局消费级个人智能体。
Anthropic 发布对智谱 GLM-5.3 的网络安全评估,称该模型能自主开发端到端漏洞利用程序,但发布时缺少有效护栏。
OpenAI 发布 GPT-6.1 Sol,官方称其为一次重大升级,覆盖专业办公、操控电脑、agentic 编程等任务,智能水平接近 Astra,价格仅为其五分之一。此前 OpenAI 上周刚推出 GPT-6 Sol;而 6.1 代号的 Astra 迭代前两天因未通过安全标准被暂停。
OpenAI 在旧金山 DevDay 发布便宜版大模型 GPT-6.1 Sol(性能接近 Astra、价格仅五分之一)和 24 小时在线、连接四千多个应用的 AI agent Dots,同时以欺骗、未经授权操作、不安全访问外部服务为由扣下 GPT-6.1 Astra。
雷峰网分析称,Personal Agent 正成为这轮 AI 产品竞争的热点:Meta 的 Muse 截至 9 月下旬下载量突破 300 万,OpenAI 于 9 月 29 日发布可长期在线的个人 Agent 产品 dots,Manus 于 9 月 28 日推出独立应用 Cue,千问、豆包、腾讯也在推进同类项目。
雷峰网在 Claude Code 中用同一任务实测同日发布的 Qwen3.8-Flash 与 GLM-5.3-Flash,要求从零开发一个含任务、日程、笔记、工作概览和全局搜索的个人工作台。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批,模型和云端服务仍由 OpenAI 提供。
雷峰网在同一台服务器上用两个 Ubuntu 容器分别部署 OpenClaw v2026.7.1-2 和 v2026.8.1(2.0),以 GLM 5.3 为基座跑同一道调研加可视化网页的长任务。
恢复独立运营的 Manus 发布回归后首个大版本 Manus 2.0,桌面端升级为 Manus Studio,可剪视频、做游戏并支持用户直接上手修改;新应用 Cue 为每个 Agent 配备独立邮箱、电话号码、钱包和电脑,多个助手可拉进同一群聊分工办事,目前处于邀请码抢先体验阶段。