腾讯混元发布并开源新一代大语言模型 Hy4 preview。总参数量 770B,每 token 激活 49B 参数,上下文长度 1M。官方称其在代码、办公、科学等真实生产力任务上表现突出,进入开源模型第一梯队。
(混元)
智谱上线并开源原生多模态模型 GLM-5.3-Flash。总参数量 320B,每 token 激活 18B 参数。官方称其能力超过 GLM-5.2,在 Artificial Analysis Intelligence Index 取得 57 分,与 Claude Opus 4.8 持平;在自研 Z.ai Code Bench 中编程表现与 Opus 4.8 相当。
在正式发布前,该模型以匿名模型 Ox-Alpha(中文社区称作牛来)在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。
(智谱)
阿里通义千问于 2026 年 8 月 26 日发布多模态 MoE 模型 Qwen3.8-Flash。主模型参数量 125B,每 token 激活 6B 参数。原生支持 262,144 token 上下文,可通过 YaRN 扩展至 1M token。
Qwen3.8-Flash 即将在千问 AI 平台提供 API,输入 1 元 / 百万 Tokens,输出 3 元 / 百万 Tokens,并首发上线「千问办公」。相比 Qwen3.7-Plus,官方称其训练开销约为前者的 1/9,在编码和办公任务上能力更强。
同时,其开源权重 Qwen3.8-Flash-Next 将在 Hugging Face 与 ModelScope 发布。官方称该新架构是下一代 Qwen4 系列的雏形,供社区先行检验。
开源地址:
https://huggingface.co/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921FsyOPe&file=Qwen3.8-Flash-Next