Anthropic 于北京时间 10 月 8 日发布小模型 Claude Haiku 5.5,官方称它是其迄今最便宜、最快、能力最强的小模型,平均运行成本比 Haiku 4.5 低约 75%。它主要面向高并发、对成本敏感的任务,如摘要、上下文压缩、数据库查询和分类,也适合在编程任务中给 Opus 5.5 和 Sonnet 5.5 当子智能体,速度也足够应付实时客服和浏览器操作。Haiku 5.5 也是首个可调节思考强度(effort)的 Haiku 模型。
价格方面,提示在 10 万 Tokens 以内时,Haiku 5.5 输入 0.10 美元、输出 0.50 美元、缓存读取 0.01 美元每百万 Tokens,比 Haiku 4.5 便宜 90%;超过 10 万 Tokens 时为 0.50 / 2.50 / 0.05 美元,便宜一半。Haiku 4.5 的请求约九成在 10 万 Tokens 以内。模型已上线 Claude 各平台以及 AWS、Google Cloud 和 Microsoft Azure,模型名为 claude-haiku-5-5。
同时,Sonnet 5.5 的缓存读取价格从每百万 Tokens 0.20 美元降至 0.10 美元,官方称大多数智能体任务的成本因此降低约 20%。本周起,Max 和 Team 订阅用户还将获得每月 API 额度:Max 5x 为 100 美元,Max 20x 为 200 美元,Team 最多 500 美元,由团队成员共用。
(Anthropic)
Google 发布 Nano Banana 2.1
Google 于 10 月 6 日发布图像生成与编辑模型 Nano Banana 2.1,API 模型名为 gemini-nano-banana-2.1。它是 Nano Banana 2 的升级版,基于 Gemini 3.6 Flash,可输出 1K、2K 和 4K 图像。
官方称它能借助 Gemini 的真实世界知识生成复杂信息图和符合史实的场景,画质、多轮编辑中的角色一致性和文字渲染都有提升。
价格方面,Nano Banana 2.1 的图像输出降至每百万 Tokens 30 美元,折合 1K 图每张 0.0336 美元、2K 图 0.0504 美元、4K 图 0.113 美元,1K 和 2K 约为 Nano Banana 2 的一半。
模型已上线 Gemini 应用、Google AI Studio、Gemini API、Google 搜索 AI 模式、Google Ads、Flow 和 Stitch。
(Google)
Google 于 10 月 6 日发布图像生成与编辑模型 Nano Banana 2.1,API 模型名为 gemini-nano-banana-2.1。它是 Nano Banana 2 的升级版,基于 Gemini 3.6 Flash,可输出 1K、2K 和 4K 图像。
官方称它能借助 Gemini 的真实世界知识生成复杂信息图和符合史实的场景,画质、多轮编辑中的角色一致性和文字渲染都有提升。
价格方面,Nano Banana 2.1 的图像输出降至每百万 Tokens 30 美元,折合 1K 图每张 0.0336 美元、2K 图 0.0504 美元、4K 图 0.113 美元,1K 和 2K 约为 Nano Banana 2 的一半。
模型已上线 Gemini 应用、Google AI Studio、Gemini API、Google 搜索 AI 模式、Google Ads、Flow 和 Stitch。
(Google)
OpenAI 于北京时间 9 月 30 日凌晨在旧金山举办 DevDay 2026,一次公布 25 项更新,覆盖 ChatGPT、Codex、模型与 API。
本次重点是常驻智能体 Dots。它由 GPT-6 Astra 驱动,每个 Dot 有自己的云端电脑和浏览器。用户交给它一份长期职责后,它会持续推进,遇到重要变化或需要拍板时再主动联系用户。Dots 可以调用 ChatGPT 生态中逾 4000 款应用,在 ChatGPT、Slack 和 Microsoft Teams 中都能沟通,短信入口即将上线。
Dots 今日起向 Pro 和 Business Premium 用户推出,首个 Dot 含在套餐内。企业版岗位型 Specialist dots 同步开始预览,并将接入微软 Agent 365。与之配套的协作空间 ChatGPT Space 和新文档类型 Pages 同日上线。
模型方面,GPT-6.1 Sol 在智能体编程、电脑操作和专业工作上接近 GPT-6 Astra。它的 API 价格为输入 2 美元、缓存输入 0.10 美元、输出 10 美元每百万 Tokens,是 Astra 的五分之一。官方称它在 DeepSWE 1.1 上以约五分之一的成本追平 Astra,在 OSWorld 2.0 上与 Astra 差距在 2.1 个百分点以内。
GPT-6.1 Sol 已上线 ChatGPT 工作与 Codex,API 模型名为 gpt-6.1-sol。新速度档 Ultrafast 在 Codex 中最高约 8 倍速、每秒 300 Tokens,API 最高约 6 倍,目前先支持 Astra。OpenAI 还推出每月 500 美元的 Pro 套餐,用量约为 Plus 的 25 倍并含 Ultrafast,同时重新开放 200 美元档。
开发者侧,Codex 全面上云并支持可复用开发环境,推出 Linux 版,另有持续扫描仓库的 Codex Security Cloud。Agents API 新增电脑操作,并与 AWS 推出 Bedrock Managed Agents。分发上,「使用 ChatGPT 登录」可在首批 16 家合作方产品中直接消耗用户的 ChatGPT 套餐额度。OpenAI Marketplace 允许企业用已承诺的 OpenAI 消费额度,采购 Adobe、Figma、Salesforce 等 32 家合作伙伴的软件。
(OpenAI)
Anthropic 发布 Claude Sonnet 5.5,这是 Claude 5.5 系列继 Opus 5.5 后的第二款模型。
相比 Sonnet 5,新模型输出速度提升 30% 以上,每百万输入、输出 token 价格仍为 2 美元和 10 美元,但因完成同类任务通常消耗更少 token,官方测试中单任务成本最高降低 30%。
(Anthropic)
两款模型沿用
GPT-6 Astra 的部分训练方法,把这一代在专业工作、事实准确性、编程、计算机操作和对齐方面的进展带到更快、更便宜的档位;Astra 仍是追求最高能力时的旗舰选择,Sol 更侧重复杂工作,Luna 则面向成本和吞吐更敏感的日常任务。API 价格也较
GPT-5.6 的促销价整体降低 50%,其中 Sol 每百万输入、输出 token 分别为 2 美元 和 10 美元,Luna 为 0.10 美元 和 0.50 美元。(OpenAI)
Anthropic 于 9 月 22 日发布 Claude Opus 5.5,为 Claude 5.5 系列首款模型。官方称其多数工作表现接近 Claude Fable 5.1,相较 Opus 5 典型负载成本约低 40%,输出速度逾 30%。
Anthropic 还宣布,Claude 的 5 小时配额现已对 Pro、Max、Team 订阅用户提高。所有订阅用户也已获得一个重置额度。
Sonnet 5.5 与 Haiku 5.5 将于未来数周跟进。
(Anthropic)
2026 年 9 月 22 日 18:15(香港时间)起,香港一级运营商 HGC(AS9304)发生 BGP 路由泄漏,导致香港、新加坡、日本等地部分国际方向出现丢包、中断与访问缓慢;各地本地及直连方向基本不受影响。
对等互联(peering)学到的路由本应只在对等双方之间使用,不应再向外转发。HGC 将从对等方(如 TWGate AS9505)学到的路由错误地重新宣告给上游 FLAG/GCX(AS15412),随后扩散至 Hurricane Electric(AS6939)、Cogent(AS174)、Arelion(AS1299)等国际骨干。骨干网按惯例优先采用来自客户方向的路由,错误路径覆盖了正常优选路径,大量国际流量被牵引至 HGC—FLAG 这条不具备相应容量的链路,引发拥塞与中断。
(图:Eons)
xAI 发布 Grok 4.7,官方称其为面向编程与知识工作最强的一档,与 Grok 4.6 同价同速,并称在同类中性价比突出。
官方称 Grok 4.7 采用相对 4.6 更大的新基座,并经更长、更偏多小时任务的强化学习后训练,自检与长上下文管理更好,且原生理解 Grok Bot harness。
(Grok)
开源对象存储 RustFS 于 9 月 16 日发布 1.0 GA。官方称项目 2024 年 2 月起步,2025 年 7 月开源,历经 Beta、RC 后进入 GA;开源约 14 个月累计逾 6600 次提交、135 个版本、180 多位贡献者,GitHub 星标约 3.2 万,并称全球安装量约 270 万、Docker Hub 拉取逾 1000 万。
RustFS 由中国公司研发,以 Apache 2.0 许可证开源,官方称功能已基本追平 MinIO 开源版,且保持了与 MinIO 良好的兼容性。
(RustFS)
月之暗面宣布,K2.8 Preview 现已全量上线 Kimi Code。
K2.8 Preview 的综合性能接近 K3,思考效率更高,编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善。全部会员档位均开放最高 1M 上下文窗口。
K2.8 Preview 的综合性能接近 K3,思考效率更高,编码与智能体能力全面提升,思考(thinking)效率较 K2.7 Code 显著改善。全部会员档位均开放最高 1M 上下文窗口。
Cognition 于 9 月 10 日发布其迄今最强编码模型 SWE-2。官方称 SWE-2 在 Kimi K3(2.8T 参数)之上做后训练,首次将强化学习扩展到万亿参数量级,并称其 RL 配方在更强基座上仍能继续放大。
FrontierCode 1.1 Main 上 SWE-2 为 50.0%,官方称与 Fable 5.1 相差约 1 个百分点,成本低约 64%;相对 SWE-1.7、Grok 4.6 在分数与成本上均更好,接近 GPT-6 Astra 时成本约为其四分之一。
(Cognition)
DeepSeek 正式发布 DeepSeek V4.1 Flash。官方称其为全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解;为 552B 参数 MoE,采用 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B。官方称经更大规模强化学习后训练,基准测试超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。
新架构大幅压缩 KV Cache:相对上一代,HBM 需求降至约 1/4,SSD 需求降至约 1/8;相对初代模型,KV Cache 已缩小约 437 倍。
API 已同步上线,将模型名改为 deepseek-flash 即可调用。官方称 V4.1 Flash 已全面超越 V4 Pro,计划有序下线后者。
(DeepSeek)
Tailwind Labs 于 9 月 9 日宣布加入 Shopify。交易金额未披露。
官方称 Tailwind CSS 及其他开源项目保持不变,将继续以 MIT 许可发布,并由原团队在 Shopify 支持下主导维护。
但 Tailwind 商业侧将不再扩展围绕 Tailwind 的业务:Tailwind Plus、ui.sh 等现有客户可继续使用,但已关闭新客户注册,团队将专注于在 Shopify 上的 Tailwind CSS。
Tailwind 框架每周安装量逾 1.1 亿次,已被 ChatGPT、X、Cloudflare、Reddit、Shopify 等产品采用。
(Tailwind CSS)
DeepSeek 宣布,将于北京时间 2026 年 9 月 10 日 12:00 起调整 Flash 系列定价。空闲时段输入缓存命中价为 0.02 元 / 百万 tokens,缓存未命中价为 1 元 / 百万 tokens,输出价为 4 元 / 百万 tokens。
高峰时段价格为上述空闲时段价格的 2 倍。
OpenAI 正式发布新一代图像模型 ChatGPT Images 2.5,官方称相比 Images 2.0 生成延迟最高降低 50%,光影和纹理更自然,对参考照片中人物的还原更好。新模型支持只修改指定部分、保持其余细节不变的多轮编辑。
ChatGPT 同步上线 Sketch 草图、海报等模板和图片评论编辑功能;在对话框输入 @Sketch 即可画草图生成图像,分享图片时还可附上所用提示词。目前面向所有 ChatGPT、ChatGPT Work 和 Codex 用户开放,覆盖桌面端、移动端和网页端。
API 端推出 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunburst:前者为多数应用的默认选择,后者面向高端创意场景,精度更高但生成时间更长。Arena.ai Text-to-Image 榜上,Sunburst 与 Flare 分列第 1、第 2,Arena Score 分别为 1421 与 1399。
(OpenAI)