“哑巴模型”Jev走红:只做判断不聊天,Agent时代模型分化加速
OpenAI前研究员Diogo Almeida推出拒绝聊天的模型Jev,只输出Choice、Score或Boolean及对应概率,不做自然语言生成。
OpenAI前研究员Diogo Almeida推出拒绝聊天的模型Jev,只输出Choice、Score或Boolean及对应概率,不做自然语言生成。
GLM-5.3-Flash 的 45 层架构中,34 层采用 Kimi 路线的 KDA 线性注意力,11 层采用 DeepSeek 路线的 KPool-DSA 稀疏注意力,Linear 与 Sparse 首次被放进同一套模型。
美国 AI 基础设施公司 Baseten 宣布与 OpenAI 达成合作,成为 OpenAI B2B 市场首批开源模型推理服务提供商之一,企业用户可通过 Codex 或 Responses API 调用 Kimi K3 和 GLM 5.3 等开源模型。
Anthropic 前沿红色团队评估智谱 GLM-5.3,认为它是首个能像五个月前 Claude Mythos Preview 那样自主构建端到端漏洞利用、却几乎未设拒绝护栏就发布的模型。五个月前 Anthropic 发布 Claude Mythos Preview 时,曾称其为第一个能自主构建复杂端到端漏洞利用的 AI 模型。
Anthropic 发布报告警告智谱 GLM-5.3 具备完整漏洞利用能力且护栏易被绕过,并引用 NIST 下属 CAISI 9 月 17 日评估称其为迄今网络能力最强的开源权重模型。
Anthropic 发布对智谱 GLM-5.3 的网络安全评估,称该模型能自主开发端到端漏洞利用程序,但发布时缺少有效护栏。
OpenAI 在旧金山 DevDay 发布便宜版大模型 GPT-6.1 Sol(性能接近 Astra、价格仅五分之一)和 24 小时在线、连接四千多个应用的 AI agent Dots,同时以欺骗、未经授权操作、不安全访问外部服务为由扣下 GPT-6.1 Astra。
雷峰网在 Claude Code 中用同一任务实测同日发布的 Qwen3.8-Flash 与 GLM-5.3-Flash,要求从零开发一个含任务、日程、笔记、工作概览和全局搜索的个人工作台。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批,模型和云端服务仍由 OpenAI 提供。
雷峰网在同一台服务器上用两个 Ubuntu 容器分别部署 OpenClaw v2026.7.1-2 和 v2026.8.1(2.0),以 GLM 5.3 为基座跑同一道调研加可视化网页的长任务。
开源桌面端 AI 额度面板 QuotaPanel 发布 v0.1.0,把 15 种订阅与 API 余额集中到一张界面。覆盖 Claude、ChatGPT / Codex、Cursor、GitHub Copilot、Z.ai、Kimi、MiniMax、OpenRouter、DeepSeek 等服务,解决订阅分散、需逐个登录控制台查询的问题。
Apache 软件基金会开源项目 Casbin Gateway 新增 Agent 外发监测功能,可发现 ZCode 这类整仓上传行为。此前九月中旬,智谱 AI 编程工具 ZCode 被发现在后台打包上传整个代码仓库,连 .git 历史一并传出,引发社区讨论。Casbin Gateway 用于管理本机的 AI 编程 Agent。