https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
性能狂飙!Grok 4.6正式发布,实力比肩GPT-5.6 Sol

近日,SpaceX AI正式推出了其全新升级的旗舰级人工智能模型Grok4.6。该模型专注于处理复杂、长程的Agent任务,并在多项核心基准测试中展现出与OpenAI旗舰模型GPT-5.6Sol相媲美甚至超越的强劲实力。

回顾其技术演进,SpaceX AI曾在7月份联合Cursor推出了由数万张英伟达GB300GPU算力支持训练的Grok4.5。在此基础之上,Grok4.6实现了进一步飞跃。其训练过程重点针对长程复杂任务进行了全面优化,大量采用了涵盖推理能力、高级技术概念以及高质量工程代码的模型生成数据。同时,该模型还接受了广泛的Agent强化学习训练,覆盖知识工作、通用编程及多个专属领域环境,在构建视觉和交互式应用时能够输出更优质的初始效果。

在权威评测机构Artificial Analysis涵盖九项热门AI基准测试的综合指数中,Grok4.6的综合成绩已经追平GPT-5.6Sol,目前仅落后于Claude Opus5与Fable5Max。具体来看,在评估逻辑与知识水平的GDPval-AA v2测试中,Grok4.6取得了1753的Elo得分;而在衡量长时程知识工作Agent任务的私有基准测试AA-Briefcase中,其Elo得分也达到了1577分,两项关键表现均仅次于Claude Opus5。

在带来显著性能升级的同时,Grok4.6继续保持了极具竞争力的运行速度与价格体系。该模型的运行速度可达80TPS,基础版本的输入与输出价格分别为每百万Token2美元和6美元,高速变体版则为每百万Token4美元和12美元。目前,Cursor与Grok Build用户已经可以直接上手体验,广大开发者也能够通过API进行便捷接入。

via AI新闻资讯 (author: AI Base)
Anthropic 给 Claude 输出悄悄加水印:Reddit 吵翻天,有用户怒斥"数字文身"

Anthropic 近日决定为 Claude 的生成内容添加水印,也就是在聊天机器人产出的文本中植入不可见代码,用于标记内容由 AI 生成。这一政策是为了满足欧盟《人工智能法案》透明度规范的要求,该规范强制科技公司对 AI 生成或编辑的内容进行计算机可识别的标记。监管机构或许会满意,但部分 AI 用户明显不太买账,Reddit 上已经吵成一片。

其中一篇言辞激烈的帖子来自用户 visionode,这个账号注册至今不到三周。他认为这套水印系统是一场"严苛的阴谋",目的是让无辜的聊天机器人用户成为受害者。他的核心观点是:熟悉 Claude 的高手可以通过改写或借助其他 AI 服务隐藏使用痕迹,而普通用户只能任人拿捏。

"数字文身"论战:谁才是真正的受害者

visionode 描绘了一幅"受害者"群像:"谁会被抓到?就是你——那个让 Claude 帮忙重新组织文字的学生;那个让 AI 总结 200 页采访记录的记者;那个让 AI 提供同义词的作家。这些人完成后,额头上都会留下一个数字文身。"不过这些例子很快遭到反驳:记者若只是用 AI 总结材料,水印并不会带来实质影响,除非他原封不动把 AI 总结粘贴进文章;学生把 AI 重写的段落直接抄进论文,本身就已违背学术伦理。其他用户也并未力挺他的愤怒,有人只留下一句"看看这家伙",有人劝他"深呼吸一下"。

另一名批评者则将水印斥为"不道德"和"令人恶心",强调自己在使用 Claude 过程中提供了指令、背景信息和无数次修改,"Claude 只是工具,它到底在邀什么功?"但反对者回应称,水印并非邀功,而是为了在 AI 生成内容风险频发的场景中实现可追溯。还有用户从更深层质疑:前沿 AI 模型普遍靠吸收他人作品训练,给这样的 AI 生成内容加水印,本身就带着一种"令人恐惧的讽刺意味"。不过总体来看,多数用户仍倾向支持水印机制,一位用户的总结颇具代表性:"唯一不希望出现这种机制的理由,就是你想对别人撒谎。"

via AI新闻资讯 (author: AI Base)
白宫拟扩大 AI 政策框架,开源模型将纳入发布前安全测试

白宫据报将修订 AI 指南并扩大对模型的监管。目前该框架仅覆盖 Anthropic、OpenAI 等闭源模型,未来数月预计纳入开源模型,一旦达到“前沿”能力即须接受发布前安全测试。

由于特朗普认为正式监管只会帮助中国追赶美国,该框架目前仍属自愿;部分官员担忧可能的 30 天测试要求会抑制美国企业发展。

WIRED

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
🍉 我把《天龙八部》喂给了 AI,问它"段誉会什么武功?"答案让我惊呆了

via 掘金人工智能本月最热 (author: 默_笙)
Horizon Summary: 2026-08-13 (ZH)

从 4 条内容中筛选出 1 条重要资讯。

----------------------

科技新闻

1. 块层新增按磁盘错误注入接口 ⭐️ 7.0/10

----------------------

科技新闻

块层新增按磁盘错误注入接口 ⭐️ 7.0/10

LWN 报道了 Christoph Hellwig 提出的 Linux 块层错误注入补丁系列。该系列新增 CONFIG_BLK_ERROR_INJECTION 选项,并为每个 gendisk 在 debugfs 下创建 error_injection 文件。通过向该文件写入 add 规则,可以按操作类型(READ、WRITE、DISCARD、zone 操作等)、返回状态(IOERR、TIMEOUT、TRANSPORT 等)、起始扇区、扇区数和概率 1/N 精确注入错误;读取文件可查看规则,写入 removeall 可清除规则。这弥补了现有 fail_make_request、should_fail_bio 和 device-mapper 目标在选择性、状态码选择和直接作用于目标磁盘等方面的不足。该机制让开发者无需堆叠 device-mapper 设备,就能直接对真实磁盘测试超时、传输错误等不同恢复路径。

rss · LWN.net · 8月12日 18:34

「背景」 Linux 块层负责把文件系统等提交的 bio 请求递交给磁盘驱动,并定义 BLK_STS_IOERR、BLK_STS_TIMEOUT 等状态码表示不同错误。此前内核从 2006 年开始提供 fail_make_request 故障注入,但它对所有请求一视同仁且只能返回 IOERR;2018 年加入的 should_fail_bio() 允许 BPF 程序选择要失败的 bio,但同样只能让块层按 IOERR 完成请求。device-mapper 的 dm-error、dm-flakey、dm-dust 目标虽然可模拟坏块或间歇故障,但需要在被测设备上堆叠 mapper 设备,且受对齐和状态码限制。

「影响」 该补丁系列若合入,存储与内核开发者将能直接在真实磁盘上按操作、状态码、扇区范围和概率注入块层错误,从而更真实地测试超时、传输错误等恢复路径,避免 device-mapper 堆叠设备带来的偏差。

标签: #Linux kernel, #storage, #error injection, #debugfs, #block layer

----------------------

via Horizon Daily - 中文摘要
Google 发布 Pixel 11 系列手机,Pro 版¥7400 起

新推出 Pixel 11、Pixel 11 Pro、Pro XL 与 Pro Fold 四款。全系搭载 Tensor G6 与 Titan M3 芯片,TPU 算力提升 50%,配备 12 GB 或 16 GB 内存,支持 Gemini Nano 与智能代理操作。屏幕峰值亮度 3600nit,支持 1-120 Hz 刷新率;预装 Android 17,续航超 30 小时,支持 Qi2.2 25W 快充,可选砂岩粉、橄榄绿,迷雾灰和曜石黑。

Pixel 11 为 6.3 英寸,256 GB 起步;Pro 同尺寸,分辨率增至 1280×2856,4850 mAh 电池;Pro XL 为 6.8 英寸(1344×2992),5115 mAh 电池,45W 快充。Pro 系列独享 5000 万主摄 + 4800 万超广角 + 4800 万 5 倍潜望长焦,支持 120 倍变焦与 8K 视频,首增 HiLight 后置柔光灯环;Pro Fold 配 8 英寸内屏与 6.5 英寸外屏。


Pixel 11 Pro
12+256 ¥7734(台版),$1099(美版)
16+512 ¥8570(台版),$1219(美版)
16+1 TB $1449(美版)

Pixel 11 Pro XL
12+256 ¥8988(台版),$1299(美版)
16+512 ¥9825(台版),$1419(美版)
16+1 TB ¥11498(台版),$1649(美版)

首发期间有各种优惠,定价仅供参考


Google Store | 9to5google

🌸在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
DeepSeek推出V4-Pro-0813模型 百万Token输出仅需0.87美元

随着各大AI巨头之间的竞争日益白热化,知名中国人工智能实验室DeepSeek(深度求索)再次重拳出给。日前,DeepSeek正式推出了其最新的旗舰级模型——DeepSeek-V4-Pro-0813,并同步在DeepSeek API和DeepSeek Chat平台上展开推送。

根据官方公布的定价信息,DeepSeek-V4-Pro-0813模型的输入Token价格为每百万0.435美元,输出Token价格为每百万0.87美元。此举被视为DeepSeek直接对标OpenAI和Anthropic等行业巨头的又一强力举措。据社交平台上流出的初步测试数据显示,该模型拥有1.6万亿总参数量、490亿激活参数以及100万的上下文窗口,在Terminal Bench 2.1、Cybergym、DeepSWE和AutomationBench等多项主流基准测试中的表现已经超越了Anthropic的Opus 4.8,同时成本降低了约57倍,展现出了极高的性价比。

就在不久前,OpenAI大幅下调了其GPT-5.6 Luna模型的价格,试图通过高达80%的折扣开启价格战。然而,DeepSeek随后便迅速推出了拥有2840亿参数的V4-Flash-0731模型,以每百万输入Token仅0.14美元、输出Token仅0.28美元的极低价格彻底反击,并展现出了媲美多万亿参数模型的强悍性能。

业界第三方统计显示,今年7月DeepSeek的Token总消耗量已高居全球第二位,仅次于Anthropic。随着V4系列新模型的密集发布与普及,外界预测其在今年8月的Token使用量甚至有望登顶行业第一。

由于调用需求的呈爆发式增长,加上目前该实验室仅部署了约20,000张英伟达H100 GPU的计算集群,导致部分用户反映其推理速度在高峰期有所减缓。如何在应对巨大算力压力的同时维持极致的性价比,将成为DeepSeek接下来面临的核心挑战。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]