每日更新

AI 情报

不追发布会。只挑会影响你账单、上线日期和产品能不能按时交付的那几条: 调价、停用、额度变动、平台规则,以及当天就能用上的工具更新。每条都写清「你要做什么」。

2026 年 9 月 19 日

Qwen3.8-LiveTranslate:平均滞后降到 2.3 秒,实时同传开始能用了

阿里 Qwen 团队 9 月 18 日发布 Qwen3.8-LiveTranslate,把实时同传重做成「音频-文本交织」的单一流,平均滞后(LAAL)从上一代的 2.8 秒降到 2.3 秒,并加了实时说话人分离、双语同屏输出、长上下文消歧三项能力。60 种语言,70 个语向在 FLEURS 上跑分领先。

2026-09-19 语音多模态Qwen产品能力 Qwen ↗

Claude Code 2.1.269:给插件跑评分的 plugin eval 来了

Claude Code 官方 changelog 显示,9 月 11 日发布的 2.1.269 新增 claude plugin eval——对一个插件运行评测套件,输出可复现的 JSON + HTML 评分报告;同批还加了 /output-style 切换(含云端与无头会话)和 CLAUDE_CODE_WORKFLOW_MAX_CONCURRENT_AGENTS(1–256)。意义在于:你自己写的 Skill / 插件终于有办法做回归测试,而不是"感觉还行"。

2026-09-19 Claude Codeeval插件CI Claude Code Changelog ↗

DeepSeek V4.1 Flash 调价:缓存命中和没命中差 50 倍,坑在这里

DeepSeek 随 V4.1 Flash 上线同步下调价格,官方页面显示 deepseek-flash 闲时每百万 token 缓存命中输入 0.003 美元、未命中 0.15 美元,输出 0.6 美元;高峰时段翻倍。命中与未命中差 50 倍——同一份预算,prompt 前缀写得稳不稳,能差出一个数量级。另外原计划下线的 V4 Pro 宣布继续提供服务。

2026-09-19 DeepSeek定价缓存成本优化 DeepSeek API Docs · Models & Pricing ↗

未来 30 天 OpenAI 要停用一批模型:9/24、9/28、10/1、10/23 四个截止日自查

OpenAI 官方 deprecations 页面给出了接下来的四个关停日期:9/24 停 Sora 2 系列视频模型,9/28 停 gpt-3.5-turbo-instruct,10/1 停 gpt-5.4-cyber(换 gpt-5.6-cyber),10/23 一次性停掉 gpt-4o-2024-05-13、o1-2024-12-17 等一批旧快照。对一个人维护的产品来说,这类日期比模型发布会重要得多——它直接决定某天早上你的服务会不会 401。

2026-09-19 OpenAI模型下线迁移运维 OpenAI Deprecations ↗

智谱 GLM-5.3-FlashX 上线,速度 5 倍,价格 2.5 倍

智谱 9 月 18 日上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s(较 GLM-5.3-Flash 提升 5 倍),定价提到原来的 2.5 倍:输入每百万 token 从 0.8 元涨到 2 元,输出从 2.8 元涨到 7 元。这不是一次孤立的调价——同一家公司今年已经提价三次。如果你把产品建在某个"最便宜的模型"上,这条新闻值得当作一次压力测试。

2026 年 9 月 18 日
2026 年 9 月 17 日
2026 年 9 月 16 日
2026 年 9 月 15 日
2026 年 9 月 14 日
2026 年 9 月 13 日