个人Agent,人迈向硅基的第一步?
Meta的Muse上线不到两周登上美国App Store免费榜首,Sensor Tower估算截至9月24日累计下载量超340万次;9月28日Manus发布个人生活场景智能助理Cue,9月30日OpenAI在DevDay推出常驻Agent Dots。Muse把长期记忆、后台执行和日常对话组织成持续服务个人的产品,任务和记忆放在用户专属云端环境,关掉App仍可继续,并计划接入AI眼镜。
Meta的Muse上线不到两周登上美国App Store免费榜首,Sensor Tower估算截至9月24日累计下载量超340万次;9月28日Manus发布个人生活场景智能助理Cue,9月30日OpenAI在DevDay推出常驻Agent Dots。Muse把长期记忆、后台执行和日常对话组织成持续服务个人的产品,任务和记忆放在用户专属云端环境,关掉App仍可继续,并计划接入AI眼镜。
GLM-5.3-Flash 的 45 层架构中,34 层采用 Kimi 路线的 KDA 线性注意力,11 层采用 DeepSeek 路线的 KPool-DSA 稀疏注意力,Linear 与 Sparse 首次被放进同一套模型。
OpenAI 研究员、o1 核心作者 Noam Brown 在最新播客中表示,用 1 万个 Agent、88 小时、1300 亿 token 解出千禧年数学难题,多智能体最多只占 10% 功劳,核心仍是模型本身足够强。他透露 GPT-5.6 已首次内置可调规模的多智能体系统 Ultra Mode,默认 4 个 Agent 可提速一倍,并称数学进展让他对递归自我改进(RSI)的判断比原先更近。
Anthropic 前沿红色团队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就发布的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其为第一个能自主构建复杂端到端漏洞利用的 AI 模型。
Anthropic 发布报告警告智谱 GLM-5.3 具备完整漏洞利用能力且护栏易被绕过,并引用 NIST 下属 CAISI 9 月 17 日评估称其为迄今网络能力最强的开源权重模型。
Anthropic 发布对智谱 GLM-5.3 的网络安全评估,称该模型能自主开发端到端漏洞利用程序,但发布时缺少有效护栏。
OpenAI 在旧金山 DevDay 发布便宜版大模型 GPT-6.1 Sol(性能接近 Astra、价格仅五分之一)和 24 小时在线、连接四千多个应用的 AI agent Dots,同时以欺骗、未经授权操作、不安全访问外部服务为由扣下 GPT-6.1 Astra。
雷峰网分析称,Personal Agent 正成为这轮 AI 产品竞争的热点:Meta 的 Muse 截至 9 月下旬下载量突破 300 万,OpenAI 于 9 月 29 日发布可长期在线的个人 Agent 产品 dots,Manus 于 9 月 28 日推出独立应用 Cue,千问、豆包、腾讯也在推进同类项目。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批,模型和云端服务仍由 OpenAI 提供。
a16z General Partner Anish Acharya 与 Assistant Benchmark 创始人 David Pawlan 对谈 personal agent,David 已测试 26 个产品、追踪到 122 个。双方认为 proactivity 才是真正护城河,但需划清自主行动与必须询问的边界;打动普通人的不是提升 10% 效率,而是省钱和免麻烦。
TypeSafe AI 的 Jev 模型发布不到 1 个月,公司正洽谈 10 亿美元融资、最新估值 100 亿美元;此前 9 月 15 日发布早期访问版本时,公司宣布获 DCVC 领投的 4000 万美元种子轮融资,估值 2 亿美元。
OPPO ColorOS 智慧产品研发总监姜昱辰称,大模型层差距正消失,手机差距才刚拉开,OPPO 选择端侧模型自研、云端接入开放生态。ColorOS 17 推出「记忆后台」,同内存机型后台保活率平均提升 55.6%,并上线主动服务功能「即将发生」。OPPO 还与浙江大学、OpenKG 发布端侧评测基准 MobileMem,并推出 AI 硬件「心力球」。