2026/8/28
🐧 腾讯混元发布 Hy4 preview,盲测得分略胜 GLM-5.3 与 Kimi K32026 年 8 月 28 日,腾讯发布迄今最强开源模型 Hy4 preview,总参数量 770B、活跃参数 49B、上下文窗口 1M token,主攻长周期软件工程、文档办公与科学研究,已上线腾讯云、GitHub、HuggingFace、ModelScope、AtomGit、OpenRouter 等渠道。盲评 203 个工程任务中,Hy4 preview 以 2.99 分小胜 GLM 5.3(2.92)与 Kimi K3(2.94);API 定价为每 1M tokens 输入 0.834 美元、输出 2.501 美元。腾讯混元 | Blo
2026/8/26
阿里通义发布 Qwen3.8-Flash 模型,称其性能比肩 Opus 4.6 和 V4-Flash阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。相比 Qwen3.7-Plus,训练成本仅约九分之一,编码与办公任务表现更优。每百万输入 tokens 定价 0.16 美元、输出 0.47 美元。Qwen | Qwen | Bloomberg🌸 在花频道 · 茶
2026/8/26
Z.ai 发布 GLM-5.3-Flash,18B 激活参数价格仅上代十分之一,限时价格低至每百万 Tokens 输入 0.075 美元Z.ai 发布 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash,总参数 320B、激活参数仅 18B。其在多项编程和智能体基准上超过 GLM-5.2,价格降至约十分之一,并接近 Claude Opus 4.8。限时优惠期间,API 输入价格为每百万 Tokens 0.075 美元,缓存输入为 0.015 美元,输出为 0.25 美元,缓存存储暂时免费;原价分别为 0.15 美元、 0.03 美元和 0.50 美元。该模型采用稀疏与线性注意力混合架构,匿名测试期间成为本周最受欢迎模型,
2026/8/8
当然,如果你向我赞助,我将用这笔费用来购买 coding plan ,这将会大大提升我mod的效率😋
2026/8/8
由于我的coding plan额度耗尽,mod工作不得不暂缓😢