https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
性能狂飙!Grok 4.6正式发布,实力比肩GPT-5.6 Sol

近日,SpaceX AI正式推出了其全新升级的旗舰级人工智能模型Grok4.6。该模型专注于处理复杂、长程的Agent任务,并在多项核心基准测试中展现出与OpenAI旗舰模型GPT-5.6Sol相媲美甚至超越的强劲实力。

回顾其技术演进,SpaceX AI曾在7月份联合Cursor推出了由数万张英伟达GB300GPU算力支持训练的Grok4.5。在此基础之上,Grok4.6实现了进一步飞跃。其训练过程重点针对长程复杂任务进行了全面优化,大量采用了涵盖推理能力、高级技术概念以及高质量工程代码的模型生成数据。同时,该模型还接受了广泛的Agent强化学习训练,覆盖知识工作、通用编程及多个专属领域环境,在构建视觉和交互式应用时能够输出更优质的初始效果。

在权威评测机构Artificial Analysis涵盖九项热门AI基准测试的综合指数中,Grok4.6的综合成绩已经追平GPT-5.6Sol,目前仅落后于Claude Opus5与Fable5Max。具体来看,在评估逻辑与知识水平的GDPval-AA v2测试中,Grok4.6取得了1753的Elo得分;而在衡量长时程知识工作Agent任务的私有基准测试AA-Briefcase中,其Elo得分也达到了1577分,两项关键表现均仅次于Claude Opus5。

在带来显著性能升级的同时,Grok4.6继续保持了极具竞争力的运行速度与价格体系。该模型的运行速度可达80TPS,基础版本的输入与输出价格分别为每百万Token2美元和6美元,高速变体版则为每百万Token4美元和12美元。目前,Cursor与Grok Build用户已经可以直接上手体验,广大开发者也能够通过API进行便捷接入。

via AI新闻资讯 (author: AI Base)
Anthropic 给 Claude 输出悄悄加水印:Reddit 吵翻天,有用户怒斥"数字文身"

Anthropic 近日决定为 Claude 的生成内容添加水印,也就是在聊天机器人产出的文本中植入不可见代码,用于标记内容由 AI 生成。这一政策是为了满足欧盟《人工智能法案》透明度规范的要求,该规范强制科技公司对 AI 生成或编辑的内容进行计算机可识别的标记。监管机构或许会满意,但部分 AI 用户明显不太买账,Reddit 上已经吵成一片。

其中一篇言辞激烈的帖子来自用户 visionode,这个账号注册至今不到三周。他认为这套水印系统是一场"严苛的阴谋",目的是让无辜的聊天机器人用户成为受害者。他的核心观点是:熟悉 Claude 的高手可以通过改写或借助其他 AI 服务隐藏使用痕迹,而普通用户只能任人拿捏。

"数字文身"论战:谁才是真正的受害者

visionode 描绘了一幅"受害者"群像:"谁会被抓到?就是你——那个让 Claude 帮忙重新组织文字的学生;那个让 AI 总结 200 页采访记录的记者;那个让 AI 提供同义词的作家。这些人完成后,额头上都会留下一个数字文身。"不过这些例子很快遭到反驳:记者若只是用 AI 总结材料,水印并不会带来实质影响,除非他原封不动把 AI 总结粘贴进文章;学生把 AI 重写的段落直接抄进论文,本身就已违背学术伦理。其他用户也并未力挺他的愤怒,有人只留下一句"看看这家伙",有人劝他"深呼吸一下"。

另一名批评者则将水印斥为"不道德"和"令人恶心",强调自己在使用 Claude 过程中提供了指令、背景信息和无数次修改,"Claude 只是工具,它到底在邀什么功?"但反对者回应称,水印并非邀功,而是为了在 AI 生成内容风险频发的场景中实现可追溯。还有用户从更深层质疑:前沿 AI 模型普遍靠吸收他人作品训练,给这样的 AI 生成内容加水印,本身就带着一种"令人恐惧的讽刺意味"。不过总体来看,多数用户仍倾向支持水印机制,一位用户的总结颇具代表性:"唯一不希望出现这种机制的理由,就是你想对别人撒谎。"

via AI新闻资讯 (author: AI Base)
白宫拟扩大 AI 政策框架,开源模型将纳入发布前安全测试

白宫据报将修订 AI 指南并扩大对模型的监管。目前该框架仅覆盖 Anthropic、OpenAI 等闭源模型,未来数月预计纳入开源模型,一旦达到“前沿”能力即须接受发布前安全测试。

由于特朗普认为正式监管只会帮助中国追赶美国,该框架目前仍属自愿;部分官员担忧可能的 30 天测试要求会抑制美国企业发展。

WIRED

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
🍉 我把《天龙八部》喂给了 AI,问它"段誉会什么武功?"答案让我惊呆了

via 掘金人工智能本月最热 (author: 默_笙)
Horizon Summary: 2026-08-13 (ZH)

从 4 条内容中筛选出 1 条重要资讯。

----------------------

科技新闻

1. 块层新增按磁盘错误注入接口 ⭐️ 7.0/10

----------------------

科技新闻

块层新增按磁盘错误注入接口 ⭐️ 7.0/10

LWN 报道了 Christoph Hellwig 提出的 Linux 块层错误注入补丁系列。该系列新增 CONFIG_BLK_ERROR_INJECTION 选项,并为每个 gendisk 在 debugfs 下创建 error_injection 文件。通过向该文件写入 add 规则,可以按操作类型(READ、WRITE、DISCARD、zone 操作等)、返回状态(IOERR、TIMEOUT、TRANSPORT 等)、起始扇区、扇区数和概率 1/N 精确注入错误;读取文件可查看规则,写入 removeall 可清除规则。这弥补了现有 fail_make_request、should_fail_bio 和 device-mapper 目标在选择性、状态码选择和直接作用于目标磁盘等方面的不足。该机制让开发者无需堆叠 device-mapper 设备,就能直接对真实磁盘测试超时、传输错误等不同恢复路径。

rss · LWN.net · 8月12日 18:34

「背景」 Linux 块层负责把文件系统等提交的 bio 请求递交给磁盘驱动,并定义 BLK_STS_IOERR、BLK_STS_TIMEOUT 等状态码表示不同错误。此前内核从 2006 年开始提供 fail_make_request 故障注入,但它对所有请求一视同仁且只能返回 IOERR;2018 年加入的 should_fail_bio() 允许 BPF 程序选择要失败的 bio,但同样只能让块层按 IOERR 完成请求。device-mapper 的 dm-error、dm-flakey、dm-dust 目标虽然可模拟坏块或间歇故障,但需要在被测设备上堆叠 mapper 设备,且受对齐和状态码限制。

「影响」 该补丁系列若合入,存储与内核开发者将能直接在真实磁盘上按操作、状态码、扇区范围和概率注入块层错误,从而更真实地测试超时、传输错误等恢复路径,避免 device-mapper 堆叠设备带来的偏差。

标签: #Linux kernel, #storage, #error injection, #debugfs, #block layer

----------------------

via Horizon Daily - 中文摘要
Google 发布 Pixel 11 系列手机,Pro 版¥7400 起

新推出 Pixel 11、Pixel 11 Pro、Pro XL 与 Pro Fold 四款。全系搭载 Tensor G6 与 Titan M3 芯片,TPU 算力提升 50%,配备 12 GB 或 16 GB 内存,支持 Gemini Nano 与智能代理操作。屏幕峰值亮度 3600nit,支持 1-120 Hz 刷新率;预装 Android 17,续航超 30 小时,支持 Qi2.2 25W 快充,可选砂岩粉、橄榄绿,迷雾灰和曜石黑。

Pixel 11 为 6.3 英寸,256 GB 起步;Pro 同尺寸,分辨率增至 1280×2856,4850 mAh 电池;Pro XL 为 6.8 英寸(1344×2992),5115 mAh 电池,45W 快充。Pro 系列独享 5000 万主摄 + 4800 万超广角 + 4800 万 5 倍潜望长焦,支持 120 倍变焦与 8K 视频,首增 HiLight 后置柔光灯环;Pro Fold 配 8 英寸内屏与 6.5 英寸外屏。


Pixel 11 Pro
12+256 ¥7734(台版),$1099(美版)
16+512 ¥8570(台版),$1219(美版)
16+1 TB $1449(美版)

Pixel 11 Pro XL
12+256 ¥8988(台版),$1299(美版)
16+512 ¥9825(台版),$1419(美版)
16+1 TB ¥11498(台版),$1649(美版)

首发期间有各种优惠,定价仅供参考


Google Store | 9to5google

🌸在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
DeepSeek推出V4-Pro-0813模型 百万Token输出仅需0.87美元

随着各大AI巨头之间的竞争日益白热化,知名中国人工智能实验室DeepSeek(深度求索)再次重拳出给。日前,DeepSeek正式推出了其最新的旗舰级模型——DeepSeek-V4-Pro-0813,并同步在DeepSeek API和DeepSeek Chat平台上展开推送。

根据官方公布的定价信息,DeepSeek-V4-Pro-0813模型的输入Token价格为每百万0.435美元,输出Token价格为每百万0.87美元。此举被视为DeepSeek直接对标OpenAI和Anthropic等行业巨头的又一强力举措。据社交平台上流出的初步测试数据显示,该模型拥有1.6万亿总参数量、490亿激活参数以及100万的上下文窗口,在Terminal Bench 2.1、Cybergym、DeepSWE和AutomationBench等多项主流基准测试中的表现已经超越了Anthropic的Opus 4.8,同时成本降低了约57倍,展现出了极高的性价比。

就在不久前,OpenAI大幅下调了其GPT-5.6 Luna模型的价格,试图通过高达80%的折扣开启价格战。然而,DeepSeek随后便迅速推出了拥有2840亿参数的V4-Flash-0731模型,以每百万输入Token仅0.14美元、输出Token仅0.28美元的极低价格彻底反击,并展现出了媲美多万亿参数模型的强悍性能。

业界第三方统计显示,今年7月DeepSeek的Token总消耗量已高居全球第二位,仅次于Anthropic。随着V4系列新模型的密集发布与普及,外界预测其在今年8月的Token使用量甚至有望登顶行业第一。

由于调用需求的呈爆发式增长,加上目前该实验室仅部署了约20,000张英伟达H100 GPU的计算集群,导致部分用户反映其推理速度在高峰期有所减缓。如何在应对巨大算力压力的同时维持极致的性价比,将成为DeepSeek接下来面临的核心挑战。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
SpaceXAI Grok 4.6 模型表现已追平甚至超越 GPT-5.6 Sol

SpaceXAI 于 8 月 12 日正式发布了全新升级的旗舰级 AI 模型 Grok 4.6。该模型专为处理复杂、长程的 Agent 任务打造,并在多项基准测试中展现出媲美甚至超越 OpenAI 旗舰模型 GPT-5.6 Sol 的强劲实力。

此前在 7 月份,SpaceXAI 曾联合 Cursor 推出 Grok 4.5 模型。该模型在数万张 NVIDIA GB300 GPU 的算力支持下完成训练,性能仅次于 Anthropic 的 Fable 5 和 OpenAI 的 GPT-5.6 Sol,且具备极高的性价比。而本次推出的 Grok 4.6 在此基础上实现了进一步飞跃,训练过程重点针对长程复杂任务进行了优化,采用了精选的模型生成数据,涵盖推理能力、高级技术概念以及高质量工程代码。此外,模型还接受了包括知识工作、通用编程及多个领域专属环境在内的广泛 Agent 强化学习训练,这使其在构建视觉和交互式应用时能够提供更优秀的初始效果。

根据 Artificial Analysis 涵盖九项热门 AI 基准测试的综合指数显示,Grok 4.6 的成绩已追平 GPT-5.6 Sol,仅落后于 Claude Opus 5 与 Fable 5 Max。在评估逻辑与知识水平的 GDPval-AA v2 测试中,Grok 4.6 取得了 1753 的 Elo 得分;而在衡量长时程知识工作 Agent 任务的私有基准测试 AA-Briefcase 中,其 Elo 得分也达到了 1577 分,两项表现均仅次于 Claude Opus 5。

在性能显著提升的同时,Grok 4.6 依然保持了极具竞争力的速度与价格体系。该模型的运行速度为 80 TPS,基础版本的输入与输出价格分别为每百万 Token 2 美元和 6 美元,高速变体版则为每百万 Token 4 美元和 12 美元。目前,Cursor 与 Grok Build 用户已可直接体验该模型,开发者也可通过 API 进行接入。为庆祝新模型上线,SpaceXAI 还面向 Grok Build 与 Cursor 用户推出了限时优惠活动,首周内可享受双倍使用额度。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Investigating service degradation — Bugbot and Cloud Agents

Aug 12, 20:55 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Bugbot due to an ongoing GitHub outage. Users may see failures or delays when starting or running Cloud Agents and when Bugbot attempts to run.

via Cursor Status - Incident History
↩️🖼 xAI 发布 Grok 4.6,聚焦长时间运行的智能体任务


科技圈🎗在花频道📮:

🤖 马斯克预告 Grok 4.6 和 4.7 埃隆·马斯克预告,Grok 4.6 将在两周后推出,Grok 4.7 将在四周后推出。 Elon Musk 🌸 在花频道 · 茶馆水群 · 投稿通道

xAI 发布 Grok 4.6,聚焦长时间运行的智能体任务

xAI 于 2026 年 8 月 12 日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时间运行的智能体与交互、视觉任务,并在综合九项基准的 Artificial Analysis 智能指数上与 GPT-5.6 Sol 持平。

Grok 4.6 即日起上线 Cursor、Grok Build 及 API,定价为每百万输入 token 2 美元、输出 token 6 美元,另有双倍价格的快速版;Grok 4.6 首周在 Grok Build 和 Cursor 赠送双倍用量。

Xai

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
#Update #DeepSeek

DeepSeek v4 Pro 0813 现已发布,宣称在部分基准测试中 SOTA 或接近 SOTA 水平。

via AI Copilot - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]