https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
z.ai 发布 GLM-5.3-Flash,18B 激活参数价格仅上代十分之一

z.ai 发布 GLM-5 系列首个原生多模态模型 GLM-5.3-Flash,总参数 320B、激活参数仅 18B。其在多项编程和智能体基准上超过 GLM-5.2,价格降至约十分之一,并接近 Claude Opus 4.8。

该模型采用稀疏与线性注意力混合架构,匿名测试期间成为本周最受欢迎模型,且全部流量由国产 AI 芯片服务;官方称在国产芯片上端到端推理性能提升 3 倍,成本可比肩主流英伟达 GPU。

z.ai

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
↩️ 阿里通义发布 Qwen3.8-Flash 模型,称其性能比肩 Opus 4.6 和 V4-Flash


科技圈🎗在花频道📮:

Qwen 预告 3.8-Flash-Next 8 月 26 日开源,基于新一代 Qwen4 架构 Qwen 在魔搭社区上线多模态 MoE 模型 Qwen3.8-Flash-Next 的预告页,预计 2026 年 8 月 26 日 23 时(UTC+8)开放下载,将提供标准版与 FP8 两个版本。 官方称,该模型基于下一代 Qwen4 架构,提前开源这些架构进展是为社区迎接 Qwen4 系列做准备。 ModelScope2022 🌸 在花频道 · 茶馆水群 · 投稿通道

阿里通义发布 Qwen3.8-Flash 模型,称其性能比肩 Opus 4.6 和 V4-Flash

阿里通义发布多模态 MoE 模型 Qwen3.8-Flash,并开源作为 Qwen4 架构预览的 Qwen3.8-Flash-Next。模型 125B 参数、每 token 仅激活 6B,上下文原生 262K、可扩展至 1M。阿里称其性能可比肩 Anthropic Opus 4.6 和 DeepSeek V4-Flash。

相比 Qwen3.7-Plus,训练成本仅约九分之一,编码与办公任务表现更优。每百万输入 tokens 定价 0.16 美元、输出 0.47 美元。

Qwen(@Alibaba_Qwen) | Qwen | Bloomberg

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]