跳到正文

AI 员工与 Agent 落地

把 Agent 真的接进业务流程:工作流设计、工具与权限、稳定性和成本控制。

最新精选

第 21–40 条 · 共 53 条
今天10月9日周五
  1. The Decoder62

    CrowdStrike 称 AI 渗透工具助单一攻击者入侵多家韩国银行

    CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初入侵多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 2.5 万条含姓名、联系方式、收入和信用额度的记录被窃。

    推荐理由:CrowdStrike 披露的攻击链条显示,开源 AI 渗透工具与模型组合已能支撑单人完成多机构入侵。

  2. The Decoder74

    Anthropic 发布 Claude Haiku 5.5,价格较 Haiku 4.5 平均降约 75%

    Anthropic 发布 Claude Haiku 5.5,官方称这是其最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%;提示词在 10 万 token 以内的请求降价最高达 90%,超过 10 万 token 的请求价格则是五倍。

    推荐理由:Haiku 5.5 的降价幅度与 token 消耗变化同时出现,做成本测算的读者可据此重新估算小模型调用开销。

  3. Simon Willison67

    Anthropic 发布 Claude Haiku 5.5,价格对齐 GPT-6 Luna 并推出订阅 API 额度

    Anthropic 发布快速低价模型 Claude Haiku 5.5,定价为每百万 token 输入 0.10 美元、输出 0.50 美元,与 OpenAI 上月发布的 GPT-6 Luna 一致,但超过 100,000 token 后价格涨 5 倍至 0.50/2.50 美元,而 Luna 在 272,000 token 时才涨至 0.20/0.75 美元。

    推荐理由:作者实测对比了 Haiku 5.5 与 GPT-6 Luna 的价格和分词器差异,并梳理了订阅附赠 API 额度的规则。

  4. The Decoder62

    Zenity 发现单个提示词即可接管 AWS 账户内全部 AgentCore 智能体

    安全公司 Zenity Labs 称,Amazon Bedrock AgentCore 存在被其命名为 AgentCorruption 的漏洞链,攻击者只需对一个公开智能体的聊天访问权限,用一条提示词就能接管同一 AWS 账户和区域内所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。

    推荐理由:复盘了 AgentCore 默认权限过宽导致的接管链路,做企业 Agent 部署的读者可据此核对隔离与权限边界。

  5. TechCrunch · AI62

    OpenAI 随 GPT-6 推出 Intelligent UI,ChatGPT 界面转向可视化交互

    OpenAI 推出名为 Intelligent UI 的新界面,随 GPT-6 模型于周三开始推送,在对话中大量加入可交互的按钮、定制计算器、交互式图表和可编辑图形等视觉元素。

    推荐理由:OpenAI 随 GPT-6 推出 Intelligent UI,把可交互图表、按钮和计算器直接放进对话,可看多模态交互的落地形态。

  6. AWS Machine Learning Blog62

    AWS 上线 Claude Haiku 5.5,成本较 Haiku 4.5 低约 75%

    AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,Anthropic 称其为 Claude 5.5 系列中速度最快、成本最低的模型,面向子智能体和高并发、成本敏感场景,多数任务成本比 Claude Haiku 4.5 低约 75%。

    推荐理由:Haiku 5.5 在 Bedrock 上线,成本较上代低约 75%,并首次加入 effort controls,可据此判断是否适合做子智能体。

  7. NVIDIA Blog62

    英伟达与微软发布 RTX Spark 笔记本和 DGX Station for Windows,为 Windows PC 引入 AI 智能体

    在旧金山微软 Windows AI and Surface 活动上,英伟达与微软宣布为 Windows PC 引入 AI 智能体,并推出 RTX Spark 笔记本与紧凑台式机。

    推荐理由:英伟达与微软把智能体运行所需的系统级容器和本地算力一起落地,做端侧 AI 开发的读者可据此判断硬件与平台走向。

10月8日周四
  1. 开源中国78

    Anthropic 发布 Claude Haiku 5.5,价格降至 Haiku 4.5 约四分之一

    Anthropic 于 10 月 7 日发布 Claude Haiku 5.5,这是 Haiku 系列首个支持可调节 effort 设置的型号,用户可在速度与智能之间取舍。价格降至 Haiku 4.5 的约四分之一,输入每百万 token 0.10 美元、输出 0.50 美元(提示不超过 10 万 token)。

    推荐理由:Haiku 5.5 把价格降到前代约四分之一,并首次支持可调 effort,做小模型选型的读者可据此比较成本与能力。

  2. 开源中国82

    OpenAI 向全部用户推送 GPT-6,同步上线 Intelligent UI 交互界面

    OpenAI 从 10 月 7 日起向 Plus、Pro、Business、Enterprise 用户推送 GPT-6 Sol,10 月 8 日向 Free 和 Go 用户推送 GPT-6 Luna。与模型一同上线的是名为 Intelligent UI 的新界面,ChatGPT 的回答不再只是连续文字,还会出现可点击的按钮、表单、图表、内嵌地图和计算器等元素。

    推荐理由:OpenAI 把 GPT-6 分两批推给全部用户,并同步上线可交互的 Intelligent UI,可看模型与界面同步升级的节奏。

  3. 量子位78

    OpenAI 向 ChatGPT 免费和 Go 用户推送 GPT-6 Luna

    OpenAI 宣布 GPT-6 开始向 ChatGPT 免费和 Go 用户推送,用 GPT-6 Luna 替换此前的 GPT-5.6 Luna,Plus、Pro 等付费用户则从 10 月 7 日起陆续使用 GPT-6 Sol。

    推荐理由:梳理了 GPT-6 向免费用户推送的版本安排、Intelligent UI 交互变化与安全报告中的回退项,便于对照上一代评估。

10月7日周三
10月6日周二
  1. Latent Space62

    Reflection 发布 501B-A23B 开源模型 Beam

    Reflection 发布 Beam,一个面向编程、智能体与科研的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,完整权重将以 Apache 2.0 在本月放出。

    推荐理由:Reflection 从隐身状态发布 501B 开源模型 Beam,并给出训练规模与基准数据,可对照同期开源模型看美国开源阵营的位置。

  2. 人人都是产品经理78

    盘点半年数据:22万部AI短剧播放量破亿的不到千分之五

    2026年上半年抖音端新上线AI剧与漫剧22.19万部,播放量破亿的仅1055部,破亿率0.47%;以5000万播放为回本门槛,能达标的不足1.3%。同期海外微短剧下载量同比增长79%,内购收入仅增长13%,买量投流占出海总成本约50%,八成到九成项目无法回本。收入向少数平台集中,DramaBox、ReelShort与NetShort三家占上半年TOP20内购收入近一半。

    推荐理由:用30款产品和多组数据拆开AI短剧的成本与收入结构,看清产能过剩与回本难的真实分布。

  3. Simon Willison62

    Anthropic 的 Cowork 新版将模型推理与 VM 迁至云端

    Anthropic 的 Felix Rieseberg 介绍 Cowork 新版变化:旧版在云端做模型推理,但把工具调用放在随桌面应用下发的 Anthropic VM 中本地执行,用户不满其磁盘、电量和性能开销,也不满合上笔记本就中断工作。

    推荐理由:Anthropic 的 Cowork 把模型推理和 VM 从本地搬到云端,这条引述说清了改动原因和会话隔离方式。

10月2日周五
  1. Latent Space62

    Airbnb CTO 谈 AI 原生改造:60% 代码由 AI 编写,半数客服工单由 AI 解决

    Airbnb CTO Ahmad Al-Dahle 在 Latent Space 访谈中介绍公司向 AI 原生转型的进展:目前 60% 的代码由 AI 编写,功能交付量同比增长近 80%,工程师人均 PR 吞吐量提升约 1.6 倍,约一半客服工单由 AI 独立解决。

    推荐理由:Airbnb CTO 首次系统披露 AI 原生改造的内部数据与组织方法,做 AI 落地的人可对照其取舍逻辑。

  2. 人人都是产品经理80

    谷歌发布 Gemini 4 Argon:单次输出上限 100 万 Token,缓存命中输入价 0.10 美元

    谷歌 DeepMind 未开发布会直接发布新一代旗舰模型 Gemini 4 Argon,单次最大输出 Token 提升到 100 万,基础输入定价 2 美元/百万 Token、输出 10 美元/百万 Token,Prompt Caching 命中后输入价降至 0.10 美元/百万 Token。

    推荐理由:梳理 Gemini 4 Argon 的输出上限、定价与官方工程复盘,可对照了解长程工程智能体的能力边界。