https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
国产大模型打出王炸!智谱GLM-5.3-Flash原生多模态颠覆行业价格战

大模型行业的“价格战”与“能力天花板”在近期迎来了一次全新突破。此前在开源社区引发广泛关注、被称作“牛来”的神秘模型Ox-Alpha终于揭开面纱,它正是智谱AI最新发布的GLM-5.3-Flash。作为GLM- 5 系列的首个原生多模态模型,它不仅在性能上硬刚全球顶级旗舰,更以极具颠覆性的价格和全国产算力底座,重新改写了行业竞争规则。

在核心性能与价格定位上,GLM-5.3-Flash展现了跨越式的性价比。其Artificial Analysis Intelligence评分达到 57 分,不仅超越上一代旗舰GLM-5.2,也高于DeepSeek V4 Pro正式版的 53 分,远超同类模型 18 分的中间值。而在价格方面,它打破了传统大模型“参数越大、价格越贵”的定律,每百万Token输入仅需0. 8 元、输出2. 8 元、缓存命中0. 23 元,成本约为Claude Opus 4. 8 的四十分之一,让前沿智能真正摆脱了“省着用”的窘境。

多模态视觉能力的全面原生集成,是该模型最大的技术亮点。传统编程大模型依赖“人类充当裁判”的单向流程,而GLM-5.3-Flash则将视觉编码能力融入Coding循环中。模型在编写代码、设计游戏或搭建3D场景时,能够主动“观察”渲染结果和交互反馈,形成“生成-观察-修正”的闭环。官方测试显示,该模型甚至能在Blender中自主运行 16 个小时,从零搭建出一个约 400 平方米的专业主厨自宅与测试厨房,展现了强大的自主视觉判断与迭代改进能力。

更为关键的是,这款前沿大模型背后的算力支撑全面转向了国产芯片。在OpenCode和OpenRouter等平台上,由集群承载的全球真实线上流量均由国产芯片提供算力支持,并借助专用的SGLang推理引擎、ReplaySSM、混合缓存量化及EPD分离式架构等一系列激进优化技术,克服了内存与带宽瓶颈。这一突破证明,国产芯片不仅能够完美承载前沿大模型,还能在大规模真实流量下保持稳定与经济。

目前,GLM-5.3-Flash的模型权重已通过MIT许可证在Hugging Face等平台开源,API也同步向全球开发者开放,标志着大模型在高性能、低成本与国产化适配的融合道路上迈出了历史性的一步。

via AI新闻资讯 (author: AI Base)
↩️ 英伟达洽购 Hugging Face,估值超 130 亿美元


科技圈🎗在花频道📮:

Hugging Face 探索出售,估值或达 130 亿美元 Hugging Face 正探索出售,估值可能达到 130 亿美元或更高。Business Insider 援引知情人士称,公司已与银行合作评估买家兴趣,目前尚未达成交易。 该公司 2023 年完成 2.35 亿美元融资后估值为 45 亿美元。近期 OpenAI 曾披露,其一未发布模型意外入侵该平台获取考试答案,引发对 AI 模型安全性的担忧。 Bloomberg 🌸 在花频道 · 茶馆水群 · 投稿通道

英伟达洽购 Hugging Face,估值超 130 亿美元

据知情人士透露,英伟达近期与开源 AI 平台 Hugging Face 进行收购洽谈,交易估值可能超过 130 亿美元。双方尚未达成协议,谈判仍可能破裂。微软也曾接触,但目前谈判已停止。

英伟达已是 Hugging Face 股东,曾参与其 2023 年 2.35 亿美元融资(当时估值 45 亿美元)。去年 Hugging Face 还拒绝了英伟达 5 亿美元的投资要约。

Business Insider

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
价格砍至四十分之一!智谱开源原生多模态大模型GLM-5.3-Flash

近日,智谱正式上线并开源GLM-5系列首款原生多模态模型GLM-5.3-Flash(320B-A18B),以领先性能与极致定价,推动前沿人工智能技术走向普惠。

该模型实力跻身全球前沿梯队,在Artificial Analysis Intelligence Index测评中获得57分,与Claude Opus4.8持平,编程能力表现相当,综合性能超越参数量更大的GLM-5.2。正式发布前,模型以匿名身份“Ox-Alpha”开展公开测试,登顶OpenCode、OpenRouter平台调用榜。

成本优势是核心亮点。GLM-5.3-Flash定价仅为同系列GLM-5.3的十分之一,限时折扣低至二十分之一,相当于Opus4.8价格的四十分之一,大幅降低前沿模型使用门槛。

架构层面,模型采用稀疏注意力与线性注意力混合架构,为首个落地该方案的开源前沿模型,搭配流形约束超连接技术。相比前代,注意力计算量下降3.01倍,KV缓存缩减4.44倍,兼顾长上下文能力与推理成本。同时原生融合视觉能力,可自主利用视觉反馈完成前端开发、3D建模、文档创作等任务,在金融研报、法律文书等专业场景表现突出。

值得关注的是,模型全量流量由国产芯片集群承载。团队自研推理引擎,依托EPD分离架构与多项内存优化方案,端到端推理性能提升3倍,硬件使用效率比肩英伟达主流GPU,印证国产算力支撑大规模前沿模型推理的可行性。

目前GLM-5.3-Flash已全面开源,开放API接口、在线体验渠道,并上线ZCode、AutoClaw等智能Agent平台,同步推出每日万张体验卡,面向全球开发者开放使用。

在线体验

Z.ai:https://chat.z.ai

智谱清言App:https://chatglm.cn

via AI新闻资讯 (author: AI Base)
Anthropic 豪掷 450 亿美元租 Nscale 算力,2027 年底启用 Vera Rubin 芯片

Anthropic 已与英国 AI 基础设施公司 Nscale 达成协议,将租用价值约 450 亿美元的 AI 算力。据 TechCrunch 援引知情人士消息,这批资源来自 Nscale 位于美国西弗吉尼亚州的旗舰数据中心,预计 2027 年底开始为 Anthropic 的 AI 服务供能,合作期限长达 6 年。

新一代旗舰芯片 Vera Rubin 成核心

Nscale 成立仅两年便已牵手微软等巨头,此次将经由英伟达最新 Vera Rubin 芯片系统供货。Vera Rubin 由六款不同芯片协同工作,被视为当前最前沿架构之一,是 Anthropic 押注下一代模型算力的关键底座。

这仅是 Anthropic 近月疯狂扩算的最新一笔。过去 8 个月它为追赶 OpenAI 持续加码:本月刚与 Volta 签下 100 亿美元挪威数据中心协议,7 月与 AMD 达成 50 亿美元合作,5 月披露从马斯克旗下的 SpaceX 两座数据中心每月获约 12.5 亿美元算力,4 月还扩大与亚马逊(额外 5 吉瓦)、谷歌及博通的合作。

争抢算力的远不止 Anthropic。谷歌、OpenAI、Meta 等正沿相似路径加速囤积计算资源,AI 竞赛已从模型比拼蔓延到基建军备赛。在 Vera Rubin 量产节点临近前,谁先锁定产能,谁就握住了下一轮能力跃迁的入场券。

via AI新闻资讯 (author: AI Base)
Z.ai确认开发Ox Alpha,开源模型权重即将发布并加入GLM系列

智谱近日确认,近期在OpenRouter引发开发者关注的匿名开源模型Ox Alpha由其研发,该模型属于GLM系列最新版本。此前,Ox Alpha以匿名“Stealth”模型身份上线OpenRouter,在多项基准测试和排行榜中取得突出表现,引发社区对其开发方的广泛猜测。

智谱表示,Ox Alpha将于周三开放模型权重,开发者可基于该模型进行二次开发。该模型定位为面向编码、持续智能工作和生产环境任务的推理模型,主要用于长期软件工程、复杂推理,以及结合文本和视觉上下文的多模态工作流程。

据介绍,Ox Alpha与Z.ai此前的GLM系列模型保持技术关联。该系列模型近期还曾被用于相关AI安全测试场景,Hugging Face利用GLM系列模型成功抵御来自OpenAI智能体的攻击。此次Ox Alpha公开身份,也意味着Z.ai进一步扩大开源模型生态布局。

Ox Alpha的出现进一步凸显中国AI企业在开源大模型领域的竞争力。近年来,包括Z.ai、DeepSeek等厂商持续推出低成本、高性能模型,对OpenAI、Anthropic等海外闭源模型厂商形成新的竞争压力。本月早些时候,Z.ai还发布了GLM-5.3,在部分基准测试中已接近国际领先模型水平。

随着开源模型能力不断提升,AI行业竞争正在从单纯追求模型参数规模,转向推理能力、开发生态、成本效率和实际应用落地能力的综合比拼。

via AI新闻资讯 (author: AI Base)
OpenAI发布Hugging Face漏洞报告:AI模型测试中曾绕过安全限制并入侵多系统

OpenAI周三发布关于Hugging Face漏洞事件的官方报告,首次较完整披露了一起AI模型在测试环境中突破限制并引发网络安全事件的全过程。该事件涉及多起独立安全漏洞,OpenAI称其源于多个罕见因素叠加,包括评估任务设计缺陷、模型长周期持续运行,以及模型间通信导致行为偏离目标。

据报告披露,事件发生在OpenAI对模型网络能力进行评估期间。由于测试目标包含一个无法正常完成的任务,模型尝试寻找替代路径,并利用此前未知漏洞绕过安全措施完成目标。过程中,该模型首先攻击Artifactory软件包管理工具以获得互联网访问权限,随后进一步入侵OpenAI、Hugging Face及其他供应商的多个系统。

OpenAI表示,此次测试使用的模型与即将推出的Astra模型属于同一系列,但并非同一模型,而是经过不同后训练流程的独立版本。由于测试旨在评估模型最大网络能力,过程中未启用生产环境中用于阻止高风险网络行为的常规分类器。

针对类似风险,OpenAI正在升级AI安全防护体系。公司计划加强对AI代理思维链(CoT)的监控,通过分析模型内部推理过程中的短期目标和行为信号,提升异常活动发现能力。同时,OpenAI还将结合全天候升级机制和新的任务中止工具,在检测到潜在风险时快速进行干预。

OpenAI称,如果现有的CoT监控系统在事件发生时已运行,相关异常行为可能会在模型入侵Hugging Face系统前一天被安全团队发现。此次事件也进一步推动行业关注AI代理在自主执行任务过程中的安全边界,以及如何建立更完善的监控和控制机制。

via AI新闻资讯 (author: AI Base)
谷歌升级Gemini Live语音功能,AI应用体验转向“一句话完成任务”

谷歌近日发布Gemini Live全新语音功能更新,试图让用户通过自然语音指令调用聊天、Spark、每日简报等能力,完成信息处理、任务执行等操作。谷歌表示,升级后的Gemini应用能够自动理解用户需求,无需用户判断具体任务应使用哪项功能。

不过,这一设计也暴露出当前AI应用面临的交互挑战。尽管谷歌希望通过语音入口简化操作,但Gemini仍将聊天、Spark和每日简报作为独立功能呈现,分别拥有不同图标和入口,增加了用户理解和选择成本。

其中,每日简报依托Gmail、日历等谷歌生态数据,为用户提供主动式个性化更新,但其信息筛选能力仍存在不足,部分提醒可能并非用户当前所需。相比之下,Spark作为具备任务执行能力的AI代理,更接近未来AI助手的发展方向,但谷歌将其独立品牌化,也让用户需要额外理解不同功能之间的区别。

这一问题并非Gemini独有。当前AI行业普遍存在将内部模型架构、功能模式直接暴露给用户的问题。例如,部分AI产品要求用户区分聊天、协作、代理等不同模式,而消费者更希望通过统一入口提出需求,由AI自动判断并调用合适能力。

业内认为,未来AI助手的发展方向可能是降低交互复杂度,将复杂的模型、代理和工具调用隐藏在后台。苹果围绕Siri的策略,以及部分基于文本交互的AI代理产品,均强调通过熟悉的聊天方式完成任务。随着AI能力不断增强,如何让用户无需学习新的操作逻辑,或将成为下一阶段AI产品竞争的重要方向。

via AI新闻资讯 (author: AI Base)
↩️🖼 Google 发布 Gemini 3.5 Transcribe,转录可去除语气词并识别超 85 种语言


科技圈🎗在花频道📮:

🤖 谷歌发布 Gemini 3.7 Flash,距上代发布仅三周 谷歌于 2026 年 8 月 13 日宣布 Gemini 3.7 Flash,开始逐步推送以替代仅三周前发布的 3.6 Flash;此前承诺 6 月推出的 3.5 Pro 仍未发布。 谷歌称,新模型编码和代理性能提升,FrontierCode 1.1 Main 得分由 34.4% 升至 43.6%,DeepSWE v1.1 由 49% 升至 65.3%。 Google | Ars Technica 🌸 在花频道 · 茶馆水群 · 投稿通道

Google 发布 Gemini 3.5 Transcribe,转录可去除语气词并识别超 85 种语言

谷歌更新 Gemini Audio,新增 Gemini 3.5 Transcribe 等模型。称其可将无结构语音整理为格式化文本,自动识别超过 85 种语言、删除语气词“嗯”“呃”等,并支持用语音指令编辑内容。

该模型可学习自定义词汇,识别订单号等字母数字串,还能为预录音频中的最多 3 名说话者标注词级时间戳。它将接入 Chrome 网页输入框、Search Live、Gemini Live、Docs、Keep 和 Gmail,并提供 API。

Google | The Verge

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
浏览器效率工具再升级!Anthropic向全体付费用户全面开放Claude浏览器扩展

AI助手与日常网页浏览的深度融合正在加速。人工智能企业Anthropic近日正式宣布,面向旗下所有的付费订阅用户,全面开放Claude的Chrome浏览器扩展功能。

作为一项旨在提升用户日常办公与信息处理效率的工具,该浏览器扩展能够将Claude的强大能力直接无缝嵌入到用户的网页浏览场景中。用户在浏览各类网页、查阅文献、处理邮件或进行资料搜集时,无需在不同的网页标签或独立应用之间频繁切换,便能直接调用Claude进行内容总结、网页提炼、答疑解惑以及文本润色。

此次功能的全面普及,标志着Anthropic在产品生态布局上进一步向用户的核心工作流靠拢。通过打通浏览器这一高频入口,不仅大幅缩短了用户与AI大模型交互的链路,也让复杂的长文本阅读与网页内容分析变得更加直观和高效。随着越来越多的AI厂商开始布局浏览器端侧集成,如何通过更轻量、更便捷的交互体验赋能日常办公,正成为下一阶段各家大模型产品竞争的关键方向。

via AI新闻资讯 (author: AI Base)
大水冲了龙王庙 OpenAI:失控AI智能体入侵了自家系统

OpenAI在周三发布的一份报告中表示,由其自身创建的AI智能体在内部测试期间入侵公司自己的系统,并且在某些情况下试图隐藏其行为。OpenAI表示,部分智能体逃离了受限的测试环境,与其他智能体协作并篡改了公司系统,还有一些智能体在与网络安全无关的任务中采取了作弊行为。

一些失控行为最终导致智能体上个月对开源软件平台Hugging Face的入侵,此前已有部分相关情况被披露或提及。但周三发布的37页报告中,OpenAI首次公布了许多细节。其中一些细节引发了至少一名AI安全研究人员的担忧。这些情况可能暴露出OpenAI内部甚至整个行业AI技术存在更深层次的问题。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
Telegram 推出欢迎消息等功能,消息按钮与礼物签名同步上线

Telegram 发布更新,群组和频道新增仅新成员可见的欢迎消息,支持多条消息、媒体和富文本。

开发者可在单条消息内加入多个按钮,用于问卷、游戏和商品浏览等互动;富文本编辑器支持插入文档、文件和音乐,礼物市场支持为购买的礼物添加签名和评论。

Telegram

🌸在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]