起于小站,终于生活。
现实之外,一个普通人的思考。

博客地址:ygxz.in
讨论组:https://t.me/ygxz_group
腾讯混元发布并开源 Hy4 preview

腾讯混元发布并开源新一代大语言模型 Hy4 preview。总参数量 770B,每 token 激活 49B 参数,上下文长度 1M。官方称其在代码、办公、科学等真实生产力任务上表现突出,进入开源模型第一梯队。

混元
一个小站的自留地
OpenRouter 和 OpenCode 宣布上线匿名模型 Ox Alpha,具备 1M 上下文和多模态输入能力。 据市场消息,这是智谱即将发布的下一代轻量级 GLM 模型,对标 GPT 5.6 Terra。
智谱开源 GLM-5.3-Flash

智谱上线并开源原生多模态模型 GLM-5.3-Flash。总参数量 320B,每 token 激活 18B 参数。官方称其能力超过 GLM-5.2,在 Artificial Analysis Intelligence Index 取得 57 分,与 Claude Opus 4.8 持平;在自研 Z.ai Code Bench 中编程表现与 Opus 4.8 相当。

在正式发布前,该模型以匿名模型 Ox-Alpha(中文社区称作牛来)在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。

智谱
一个小站的自留地
阿里开源 Qwen3.8-2.4T-A95B 阿里千问开源了 Qwen3.8-2.4T-A95B,其商用版本为 Qwen3.8-Max。这是千问第一次开源该规模的旗舰级别模型。 Qwen3.8-Max 是千问最新推出的 2.4 万亿参数 MoE 旗舰,其编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。 开源地址:…
阿里发布  Qwen3.8-Flash 和 Qwen3.8-Flash-Next

阿里通义千问于 2026 年 8 月 26 日发布多模态 MoE 模型 Qwen3.8-Flash。主模型参数量 125B,每 token 激活 6B 参数。原生支持 262,144 token 上下文,可通过 YaRN 扩展至 1M token。

Qwen3.8-Flash 即将在千问 AI 平台提供 API,输入 1 元 / 百万 Tokens,输出 3 元 / 百万 Tokens,并首发上线「千问办公」。相比 Qwen3.7-Plus,官方称其训练开销约为前者的 1/9,在编码和办公任务上能力更强。


同时,其开源权重 Qwen3.8-Flash-Next 将在 Hugging Face 与 ModelScope 发布。官方称该新架构是下一代 Qwen4 系列的雏形,供社区先行检验。

开源地址:
https://huggingface.co/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921FsyOPe&file=Qwen3.8-Flash-Next
Back to Top