https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
华为官方宣布,华为与高通宣布达成一项为期多年、范围广泛的专利许可协议,内容包括双方在 5G、计算、人工智能和网络等多个领域的专利组合交叉许可;高通将购买华为部分美国专利。该交易将在获得必要监管批准后完成。据华为发言人称,高通也同意获得华为逻辑折叠芯片制造技术相关专利的许可。
华为称,交易完成后公司专利许可协议累计预期合同价值预计超过 69 亿美元,约合 463.02 亿元;自 2021 年起其知识产权授权业务已实现正向收入。
华为 | 高通 | Bloomberg | Reuters
🌸 科技圈· 茶馆 · 投稿
via 在花🎗️科技圈 - Telegram Channel
据彭博社报道,彭博行业研究称,过去几个月,随着DeepSeek等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。
彭博行业研究高级分析师罗伯特·利亚(Robert Lea)在周一的一份报告中写道,在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。
他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。
彭博指出,中国模型技术的崛起得益于其AI专业能力的不断深化,以及研究人员针对国产硬件优化模型的能力。这些进展也让人们开始质疑美国限制技术出口的做法是否有效。
利亚称,中国取得的进展“进一步让人质疑美国在AI领域的科技主导地位能否长期维持”。
DeepSeek的V4.1 Flash上月在LiveBench全球排名中位列第六,成为自这家创业公司2025年凭借其推理模型R1取得突破以来排名最高的中国模型。LiveBench根据AI模型对问题、谜题或任务的回答与分析进行评分,这一过程类似于衡量人类智商。
DeepSeek最近一次在LiveBench上的得分为81.1分,低于Anthropic最高的83.4分。利亚表示,这意味着DeepSeek模型的表现已经“可以与Anthropic、OpenAI的领先AI系统相媲美”。不过,尽管双方的得分差距已经缩小至仅3%,LiveBench评选出的前15个模型中只有3个来自中国。
利亚提醒称,这类排名会不断变化,而且无论模型在排行榜上的排名如何,变现都可能很困难。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Command Code GOAT 套餐为 DeepSeek、GLM、Kimi 等模型附带 60 美元使用额度
Command Code 列出其每月 10 美元 GOAT 套餐附带 60 美元使用额度的四款模型,包括 DeepSeek V4.1 Flash 两个版本、GLM 5.3 Flash 以及 Kimi K3。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Command Code 列出其每月 10 美元 GOAT 套餐附带 60 美元使用额度的四款模型,包括 DeepSeek V4.1 Flash 两个版本、GLM 5.3 Flash 以及 Kimi K3。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
彭博:DeepSeek新模型发力,中美顶尖AI跑分差距缩小
彭博行业研究称,过去几个月,随着深度求索(DeepSeek)等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。
彭博行业研究高级分析师罗伯特·利亚在周一的一份报告中写道,在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。
—— 凤凰网科技、彭博社
via 风向旗参考快讯 - Telegram Channel
彭博行业研究称,过去几个月,随着深度求索(DeepSeek)等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。
彭博行业研究高级分析师罗伯特·利亚在周一的一份报告中写道,在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。
—— 凤凰网科技、彭博社
via 风向旗参考快讯 - Telegram Channel
Horizon Summary: 2026-10-05 (ZH)
----------------------
科技新闻
1. Strata 在 RTX 4090 上以 100+ tokens/s 运行 125B Qwen 3.8 Flash Next ⭐️ 7.0/10
----------------------
科技新闻
Strata 在 RTX 4090 上以 100+ tokens/s 运行 125B Qwen 3.8 Flash Next ⭐️ 7.0/10
GitHub 项目 Strata 被发布在 Hacker News 上,声称可在消费级 GPU 上运行 125B 的 Qwen 3.8 Flash Next,并在 RTX 4090 上达到 100 tokens/s 以上。Hacker News 用户 snehesht 称在自己的 RTX 4090、128GB DDR5、Ryzen 7950X3D 机器上实测 124 tokens/s,但该结果尚未获得独立验证。同一讨论中,Jackson__ 报告在相同 GGUF 与视觉适配器权重下,Strata 在 50 张图像的坐标定位基准中位误差为 154.8 像素、平均 168.8 像素,而 llama.cpp 分别为 46.5 和 81.4 像素,提示低比特推理可能带来质量退化。a11r 也对低于 4-bit 的量化表示怀疑,并称 4-bit 量化在 RTX Pro 6000 上足以处理困难但范围明确的编码任务。
hackernews · snehesht · 10月4日 12:51 · 社区讨论
「背景:Qwen3.8-Flash-Next 的架构由来」 当前讨论的 Qwen3.8-Flash-Next 是阿里通义此前发布并开源的多模态 MoE 模型:据 8 月 27 日的日报报道,它采用 125B 主模型加 51B N-gram 嵌入、每 token 仅激活 6B 参数的架构,原生上下文为 262K,并被官方定位为 Qwen4 架构的预览。该模型的 Hugging Face 页面也确认了这一 125B 参数、6B 激活(外加 4B MTP)的配置。正因为每个 token 只激活很小一部分参数,本地推理工具才有机会尝试在消费级显卡上以高吞吐运行它。
「影响与部署注意」 对打算在自己机器上部署该模型的人,关键动作是按具体任务验证输出质量,而不是只看吞吐量:一位评论者用同一份 GGUF 与视觉适配器权重做 50 张图片的坐标定位测试,Strata 的中位误差为 154.8 像素,而在 llama.cpp 下为 46.5 像素(该数据为评论者自测,未经独立复核)。兼容性方面,社区已提到 ds4/Dwarfstar 等替代推理栈同样支持该模型,Strata 仓库则自述目标是让该模型在普通 PC 上本地运行,并称速度数据是在“两台普通游戏 PC”上测得,部署前应确认所选工具链与量化方案对目标任务的实际表现。
「社区讨论」 评论区的分歧集中在速度与质量能否兼得:Jackson__ 的视觉基准显示 Strata 相比 llama.cpp 误差更大,而 a11r 认为低于 4-bit 的量化可能显著降低质量。与此同时,AntiRush 报告在 RTX 6000 Pro 上使用 ds4 的 Q4 量化可达到 255.26 tokens/s 解码并支持 4 路并发,kamranjon 也称 ds4 的 Q4 量化日常表现良好。
参考链接
● 2026-08-27 — Qwen3.8-Flash-Next:新架构以 1/9 成本超越 Qwen3.7-Plus
● Qwen / Qwen 3 . 8 - Flash - Next · Hugging Face
● GitHub - Niko1221/Strata: Qwen3.8-Flash-Next on any consumer ...
标签:
----------------------
via Horizon Daily - 中文摘要
从 18 条内容中筛选出 1 条重要资讯。
----------------------
科技新闻
1. Strata 在 RTX 4090 上以 100+ tokens/s 运行 125B Qwen 3.8 Flash Next ⭐️ 7.0/10
----------------------
科技新闻
Strata 在 RTX 4090 上以 100+ tokens/s 运行 125B Qwen 3.8 Flash Next ⭐️ 7.0/10
GitHub 项目 Strata 被发布在 Hacker News 上,声称可在消费级 GPU 上运行 125B 的 Qwen 3.8 Flash Next,并在 RTX 4090 上达到 100 tokens/s 以上。Hacker News 用户 snehesht 称在自己的 RTX 4090、128GB DDR5、Ryzen 7950X3D 机器上实测 124 tokens/s,但该结果尚未获得独立验证。同一讨论中,Jackson__ 报告在相同 GGUF 与视觉适配器权重下,Strata 在 50 张图像的坐标定位基准中位误差为 154.8 像素、平均 168.8 像素,而 llama.cpp 分别为 46.5 和 81.4 像素,提示低比特推理可能带来质量退化。a11r 也对低于 4-bit 的量化表示怀疑,并称 4-bit 量化在 RTX Pro 6000 上足以处理困难但范围明确的编码任务。
hackernews · snehesht · 10月4日 12:51 · 社区讨论
「背景:Qwen3.8-Flash-Next 的架构由来」 当前讨论的 Qwen3.8-Flash-Next 是阿里通义此前发布并开源的多模态 MoE 模型:据 8 月 27 日的日报报道,它采用 125B 主模型加 51B N-gram 嵌入、每 token 仅激活 6B 参数的架构,原生上下文为 262K,并被官方定位为 Qwen4 架构的预览。该模型的 Hugging Face 页面也确认了这一 125B 参数、6B 激活(外加 4B MTP)的配置。正因为每个 token 只激活很小一部分参数,本地推理工具才有机会尝试在消费级显卡上以高吞吐运行它。
「影响与部署注意」 对打算在自己机器上部署该模型的人,关键动作是按具体任务验证输出质量,而不是只看吞吐量:一位评论者用同一份 GGUF 与视觉适配器权重做 50 张图片的坐标定位测试,Strata 的中位误差为 154.8 像素,而在 llama.cpp 下为 46.5 像素(该数据为评论者自测,未经独立复核)。兼容性方面,社区已提到 ds4/Dwarfstar 等替代推理栈同样支持该模型,Strata 仓库则自述目标是让该模型在普通 PC 上本地运行,并称速度数据是在“两台普通游戏 PC”上测得,部署前应确认所选工具链与量化方案对目标任务的实际表现。
「社区讨论」 评论区的分歧集中在速度与质量能否兼得:Jackson__ 的视觉基准显示 Strata 相比 llama.cpp 误差更大,而 a11r 认为低于 4-bit 的量化可能显著降低质量。与此同时,AntiRush 报告在 RTX 6000 Pro 上使用 ds4 的 Q4 量化可达到 255.26 tokens/s 解码并支持 4 路并发,kamranjon 也称 ds4 的 Q4 量化日常表现良好。
参考链接
● 2026-08-27 — Qwen3.8-Flash-Next:新架构以 1/9 成本超越 Qwen3.7-Plus
● Qwen / Qwen 3 . 8 - Flash - Next · Hugging Face
● GitHub - Niko1221/Strata: Qwen3.8-Flash-Next on any consumer ...
标签:
#LLM inference, #quantization, #consumer hardware, #open source, #model deployment----------------------
via Horizon Daily - 中文摘要
Codex 团队承诺未来 28 天每日交付改进或重置
Codex 团队表示,未来 28 天每天都会发布一项对大多数 Codex/ChatGPT 用户有明确改进的功能,或进行一次彻底重置,重点放在简化、效率与新模型上。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Codex 团队表示,未来 28 天每天都会发布一项对大多数 Codex/ChatGPT 用户有明确改进的功能,或进行一次彻底重置,重点放在简化、效率与新模型上。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
⏰ Codex 重置已排期
ChatGPT Work | 2026/10/5 04:33
作者承诺在未来28天里,每天要么为 Codex/ChatGPT Work 用户发布一项明确改进,要么进行一次完整重置。
公告时间:Over the next 28 days, each day(2026/10/4)
重置追踪页 | 查看原推
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
ChatGPT Work | 2026/10/5 04:33
作者承诺在未来28天里,每天要么为 Codex/ChatGPT Work 用户发布一项明确改进,要么进行一次完整重置。
公告时间:Over the next 28 days, each day(2026/10/4)
重置追踪页 | 查看原推
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
软银集团领导人孙正义是人工智能最坚定的信奉者之一,但即便是他也表示,随着机器正迅速获得更多能力,他对安全风险感到担忧。孙正义周日在京都举行的“科技与社会”论坛期间的一场活动上表示,人工智能的能力呈指数级增长,这就要求各国必须建立互信,才能共同驾驭这项技术。他当时与白宫科技政策顾问Michael Kratsios一同发言。
10月4日,孙正义与Michael Kratsios在京都。
孙正义说:“我们已经没有让人类彼此争斗的奢侈选项了,” 各国需要携手合作来控制强大人工智能模型所带来的更大威胁。他表示,如果超级智能落入错误的人手中,可能会变得“超级危险”。
对于孙正义而言,发出上述警告实属罕见,也反映出最近几个月人工智能模型发生令人不安的安全事故后外界担忧不断加剧。这位69岁的日本亿万富豪已将软银近650亿美元的资金投入ChatGPT开发商OpenAI,多年来也一直在宣扬人工智能带来投资回报和帮助人类的能力。
Kratsios当时到访京都是为了宣布一项由美国牵头的涵盖17国的合作计划,旨在更好地利用人工智能来加快科学研究。包括日本、韩国、英国、德国、新加坡和阿联酋在内的多国代表与Kratsios一同登台见证了这一时刻。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
因滥用激增,Cline 暂停 DeepSeek-V4.1-Flash 免费推广
Cline 宣布因异常高的滥用情况,暂停 DeepSeek-V4.1-Flash 免费推广,同时正在调查缓解措施。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Cline 宣布因异常高的滥用情况,暂停 DeepSeek-V4.1-Flash 免费推广,同时正在调查缓解措施。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel