https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
🤖 DeepSeek Harness 已发布,DeepSeek-V4-Pro-0813 权重已开放
DSH | Hugging Face
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
DSH | Hugging Face
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
↩️ #Update #DeepSeek
#Update #DeepSeek
DeepSeek V4 Pro 0813 官网发布公告已撤回。
在过去 24h,多个社区测试对该模型的表现评价为不及预期。
via AI Copilot - Telegram Channel
AI Copilot:
#Update #DeepSeek DeepSeek v4 Pro 0813 现已发布,宣称在部分基准测试中 SOTA 或接近 SOTA 水平。
#Update #DeepSeek
DeepSeek V4 Pro 0813 官网发布公告已撤回。
在过去 24h,多个社区测试对该模型的表现评价为不及预期。
via AI Copilot - Telegram Channel
DeepSeek公布上调后的API价格
API文档修改信息显示:我们将对 DeepSeek API 价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。新价格将于北京时间 2026 年 8 月 17 日 00:00 开始生效。
大致上空闲时段涨50%,高峰时段再上浮100%。
—— DeepSeek
via 风向旗参考快讯 - Telegram Channel
API文档修改信息显示:我们将对 DeepSeek API 价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。新价格将于北京时间 2026 年 8 月 17 日 00:00 开始生效。
大致上空闲时段涨50%,高峰时段再上浮100%。
—— DeepSeek
via 风向旗参考快讯 - Telegram Channel
科技圈🎗在花频道📮:
🤖 DeepSeek 官网及 API 开放平台已撤下“DeepSeek V4 Pro 正式版上线”相关横幅,但 API 文档页面并没有变化。 此前 API 开放平台会显示👇这样的横幅 🎉 DeepSeek-V4-Pro 正式版发布,Agent 能力大幅提升,支持 Responses API 和 Codex 接入,已在网页端、APP 和 API 全面上线,欢迎测试和反馈。 存档对比 🌸 在花频道 · 茶馆水群 · 投稿通道
🤖 DeepSeek-V4-Pro 正式版上线,API 将实行峰谷定价
DeepSeek-V4-Pro 正式版已同步上线 APP、网页端和 API,调用方式不变,模型名设为 deepseek-v4-pro。模型增强 Agent 能力,并原生支持 Responses API 格式,适配 Codex。
V4-Pro 和 V4-Flash 思考模式新增 low、high、max 三档。API 将实行峰谷定价,新价格于 2026 年 8 月 17 日 0 时生效,闲时价格为高峰时段一半。
DeepSeek API Docs
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
图书零售商怀疑 AI 公司购买然后销毁珍本图书
2026-08-13 18:38 by 杜马岛
扫描且不破坏珍本图书是一件费时费劲的工作。根据互联网档案馆 2021 年发表的一篇文章,该机构尝试过自动化图书扫描,但对于易碎珍本图书而言不可行,干净干燥的人手仍然是最佳的翻页方式。自 2010 年起就在互联网档案馆工作的图书扫描员 Eliza Zhang 表示这项工作需要高度集中注意力。她当时已扫描了逾 300 万页、14000 张折页和 18000 件物品。AI 公司如果要扫描图书显然不太可能使用这种方式。最近发表的多篇报道引发了对 AI 公司收购然后销毁珍本图书的担忧。《每日电讯报》称硅谷销毁了数百万册珍稀图书并“撕碎了原件”,404 Media 报道称名为 ISBNdb 的图书数据库公司宣传其可以帮助 AI 公司大量获取图书。2025 年的图书侵权诉讼披露 Anthropic 内部启动了扫描数百万册图书的 Project Panama 项目。但没有证据表明 Anthropic 曾销毁过珍本图书,该公司也公开声明否认。包括马斯克旗下 xAI 在内的 AI 公司也公开表示,他们不会为了训练 AI 而销毁珍本图书。与此同时,珍本图书零售商则在标记可疑订单,因为他们知道,大多数真心想购买珍本图书的人通常只会购买单本,而不是一次性订购大量不同种类的图书。爱尔兰书店 Kennys 报告了一笔令人匪夷所思的订单,该订单订购了 5000 本冷门图书。买家甚至没有试图还价。
https://arstechnica.com/tech-policy/2026/08/heres-a-balm-if-the-idea-of-destroying-books-to-train-ai-breaks-your-heart/
#书籍
via Solidot - Telegram Channel
2026-08-13 18:38 by 杜马岛
扫描且不破坏珍本图书是一件费时费劲的工作。根据互联网档案馆 2021 年发表的一篇文章,该机构尝试过自动化图书扫描,但对于易碎珍本图书而言不可行,干净干燥的人手仍然是最佳的翻页方式。自 2010 年起就在互联网档案馆工作的图书扫描员 Eliza Zhang 表示这项工作需要高度集中注意力。她当时已扫描了逾 300 万页、14000 张折页和 18000 件物品。AI 公司如果要扫描图书显然不太可能使用这种方式。最近发表的多篇报道引发了对 AI 公司收购然后销毁珍本图书的担忧。《每日电讯报》称硅谷销毁了数百万册珍稀图书并“撕碎了原件”,404 Media 报道称名为 ISBNdb 的图书数据库公司宣传其可以帮助 AI 公司大量获取图书。2025 年的图书侵权诉讼披露 Anthropic 内部启动了扫描数百万册图书的 Project Panama 项目。但没有证据表明 Anthropic 曾销毁过珍本图书,该公司也公开声明否认。包括马斯克旗下 xAI 在内的 AI 公司也公开表示,他们不会为了训练 AI 而销毁珍本图书。与此同时,珍本图书零售商则在标记可疑订单,因为他们知道,大多数真心想购买珍本图书的人通常只会购买单本,而不是一次性订购大量不同种类的图书。爱尔兰书店 Kennys 报告了一笔令人匪夷所思的订单,该订单订购了 5000 本冷门图书。买家甚至没有试图还价。
https://arstechnica.com/tech-policy/2026/08/heres-a-balm-if-the-idea-of-destroying-books-to-train-ai-breaks-your-heart/
#书籍
via Solidot - Telegram Channel
Google 重组 AI 部门旨在赶上竞争对手
2026-08-13 16:05 by 致命的发动机
Google 本月初重组了其 AI 部门 DeepMind 的领导层,知情人士表示此举旨在赶上竞争对手。Google 的 Gemini 模型去年 11 月一度短暂超越竞争对手,但 Anthropic 和 OpenAI 的新模型使其再次陷入追赶状态。Google 推迟了 Gemin 新模型的发布,原因是内部测试显示它在编程等领域仍然落后于竞争对手。Google 联合创始人 Sergey Brin 在今年 4 月的一次员工大会上督促加快 AI 研发。通过削弱 DeepMind 的自主权,Google 正集中更多精力在 Gemini 模型的开发上。
https://www.reuters.com/world/inside-google-executive-moves-that-led-its-big-ai-reshuffle-2026-08-12/
#Google
via Solidot - Telegram Channel
2026-08-13 16:05 by 致命的发动机
Google 本月初重组了其 AI 部门 DeepMind 的领导层,知情人士表示此举旨在赶上竞争对手。Google 的 Gemini 模型去年 11 月一度短暂超越竞争对手,但 Anthropic 和 OpenAI 的新模型使其再次陷入追赶状态。Google 推迟了 Gemin 新模型的发布,原因是内部测试显示它在编程等领域仍然落后于竞争对手。Google 联合创始人 Sergey Brin 在今年 4 月的一次员工大会上督促加快 AI 研发。通过削弱 DeepMind 的自主权,Google 正集中更多精力在 Gemini 模型的开发上。
https://www.reuters.com/world/inside-google-executive-moves-that-led-its-big-ai-reshuffle-2026-08-12/
via Solidot - Telegram Channel
下一代Gemini延期内情曝光:算力紧张,内部团队在开发重点和资源分配上存在分歧
近日,业内备受瞩目的下一代Gemini模型传出延期消息。据报道,由于内部团队在开发重点和资源分配上存在分歧,加之算力供应紧张以及繁琐的审批流程,导致这款旗舰模型的发布时间不得不推迟两个月。
在算力方面,尽管拥有自研TPU芯片,但面对模型训练、云业务以及海量消费端和企业级AI产品的多重需求,算力资源依然捉襟见肘。高层近期已着手通过组织架构调整来缓解各部门之间的资源矛盾。
与此同时,公司内部的高层与管理权力也在发生微妙变化。联合创始人谢尔盖·布林近期频繁介入核心模型训练,推动资源向“递归式自我改进”方向倾斜。此外,管理层重组进一步收紧了实验室的自主空间,核心负责人科雷·卡武克丘奥卢开始全面主导Gemini的发展方向。而随着部分技术骨干的离职,正将更多分散的资源重新集中,全力以赴追赶前沿AI的发展步伐。
via AI新闻资讯 (author: AI Base)
近日,业内备受瞩目的下一代Gemini模型传出延期消息。据报道,由于内部团队在开发重点和资源分配上存在分歧,加之算力供应紧张以及繁琐的审批流程,导致这款旗舰模型的发布时间不得不推迟两个月。
在算力方面,尽管拥有自研TPU芯片,但面对模型训练、云业务以及海量消费端和企业级AI产品的多重需求,算力资源依然捉襟见肘。高层近期已着手通过组织架构调整来缓解各部门之间的资源矛盾。
与此同时,公司内部的高层与管理权力也在发生微妙变化。联合创始人谢尔盖·布林近期频繁介入核心模型训练,推动资源向“递归式自我改进”方向倾斜。此外,管理层重组进一步收紧了实验室的自主空间,核心负责人科雷·卡武克丘奥卢开始全面主导Gemini的发展方向。而随着部分技术骨干的离职,正将更多分散的资源重新集中,全力以赴追赶前沿AI的发展步伐。
via AI新闻资讯 (author: AI Base)
Grok 4.6 发布即登顶性价比榜:智能指数追平 GPT-5.6 Sol,定价却便宜 60% 以上
xAI 正式发布 Grok 4.6,在 AI 智能指数上获得 61 分,追平 GPT-5.6 Sol(Max),仅次于 Claude Opus 5(63 分)和 Claude Fable 5(62 分)。这一成绩使 Grok 4.6 一举跻身全球前沿模型第一梯队,与 OpenAI、Anthropic 的旗舰产品正面掰手腕。模型在 Grok 4.5 基础上扩展训练,核心改进包括使用模型生成的精选数据进行推理和高级技术概念训练,结合高质量工程数据和改进的优化器。
训练方法上的关键变化在于数据闭环:Grok 4.5 被用于重新生成监督微调轨迹,涵盖推理、代理工具使用以及 STEM、软件工程和知识工作等领域。模型还在广泛的代理强化学习任务上接受训练,包括知识工作、通用编码、内核优化、网页开发和计算机辅助设计,这一策略明显瞄准了"智能体时代"的核心工作负载。
Agent 基准全面飙升,长周期任务省力惊人
在智能体类基准测试中,Grok 4.6 表现尤为亮眼。GDPval-AA v2 达到 1753 Elo,仅次于 Claude Opus 5;DeepSWE v1.1 提升至 65.9%,较 Grok 4.5 的 54% 大幅跃升;APEX-Agents 从 47.1% 飙升至 57.5%;Terminal-Bench v3.0 也从 15.7% 涨到 26%。此外在 CursorBench v3.2 上获得 69.9%,在 FrontierCode v1.1 上获得 61.3%,编码与代理能力均实现显著突破。
更值得关注的是成本效率优势。Grok 4.6 定价维持在每百万输入 token 2 美元、每百万输出 token 6 美元,比 Claude Opus 5(5 美元 /25 美元)和 GPT-5.6 Sol(5 美元 /30 美元)低 60% 以上。在 AA-Briefcase 长周期知识工作基准中,Grok 4.6 平均仅用 53 个回合和约 5 亿输入 token 完成任务,而 Claude Opus 5 需要约 103 个回合和约 20 亿 token——用不到四分之一的资源完成同等任务,性价比差距一目了然。模型已通过 Cursor、Grok Build、API 及 OpenRouter、Vercel、Cloudflare 等渠道提供,首周在 Grok Build 和 Cursor 中还有 2 倍用量优惠,上下文窗口维持在 50 万 token,一场围绕"同等智能、更低价格"的性价比大战已经打响。
via AI新闻资讯 (author: AI Base)
xAI 正式发布 Grok 4.6,在 AI 智能指数上获得 61 分,追平 GPT-5.6 Sol(Max),仅次于 Claude Opus 5(63 分)和 Claude Fable 5(62 分)。这一成绩使 Grok 4.6 一举跻身全球前沿模型第一梯队,与 OpenAI、Anthropic 的旗舰产品正面掰手腕。模型在 Grok 4.5 基础上扩展训练,核心改进包括使用模型生成的精选数据进行推理和高级技术概念训练,结合高质量工程数据和改进的优化器。
训练方法上的关键变化在于数据闭环:Grok 4.5 被用于重新生成监督微调轨迹,涵盖推理、代理工具使用以及 STEM、软件工程和知识工作等领域。模型还在广泛的代理强化学习任务上接受训练,包括知识工作、通用编码、内核优化、网页开发和计算机辅助设计,这一策略明显瞄准了"智能体时代"的核心工作负载。
Agent 基准全面飙升,长周期任务省力惊人
在智能体类基准测试中,Grok 4.6 表现尤为亮眼。GDPval-AA v2 达到 1753 Elo,仅次于 Claude Opus 5;DeepSWE v1.1 提升至 65.9%,较 Grok 4.5 的 54% 大幅跃升;APEX-Agents 从 47.1% 飙升至 57.5%;Terminal-Bench v3.0 也从 15.7% 涨到 26%。此外在 CursorBench v3.2 上获得 69.9%,在 FrontierCode v1.1 上获得 61.3%,编码与代理能力均实现显著突破。
更值得关注的是成本效率优势。Grok 4.6 定价维持在每百万输入 token 2 美元、每百万输出 token 6 美元,比 Claude Opus 5(5 美元 /25 美元)和 GPT-5.6 Sol(5 美元 /30 美元)低 60% 以上。在 AA-Briefcase 长周期知识工作基准中,Grok 4.6 平均仅用 53 个回合和约 5 亿输入 token 完成任务,而 Claude Opus 5 需要约 103 个回合和约 20 亿 token——用不到四分之一的资源完成同等任务,性价比差距一目了然。模型已通过 Cursor、Grok Build、API 及 OpenRouter、Vercel、Cloudflare 等渠道提供,首周在 Grok Build 和 Cursor 中还有 2 倍用量优惠,上下文窗口维持在 50 万 token,一场围绕"同等智能、更低价格"的性价比大战已经打响。
via AI新闻资讯 (author: AI Base)
Al代码测试初创公司Blacksmith估值一年内上涨近10倍
在人工智能大行其道的今天,写代码变得前所未有的迅猛。但新问题也随之浮现:大模型吐出的海量代码到底靠不靠谱?测试与验证成了横亘在开发团队面前的一道新难关。正因如此,专注于代码测试与验证的初创企业Blacksmith迎来了爆发式增长。
近日,这家公司宣布完成新一轮 45 万美元的Series B融资,由PeakXVPartners领投,现有投资方GV和YCombinator跟投。让人瞩目的是,其估值在不到一年的时间里狂飙近 10 倍,从之前完成 1000 万美元A轮时的 6000 万美元一跃飙升至5. 5 亿美元,累计融资额达到了 585 万美元。
成立于 2024 年的Blacksmith,致力于帮助企业在软件上线前完成构建、测试与验证。随着Cursor、Codex以及ClaudeCode等AI编程工具的普及,代码生成虽然变得轻而易举,但质量把关却成了新的瓶颈。该公司创始人兼CEOAdityaJayaprakash指出,人们写的代码越多,验证的压力反而呈几何级数上升。
起初,Blacksmith以持续集成工作负载的云服务商切入市场。如今,其业务范围已经扩展到了包含自动修复失败代码检查的AI编程助手Codesmith。目前,该平台的客户群体已经从一年前的 700 多家暴增至 5000 多家,其中包括Mercury、Supabase、Clerk、Ashby和Expensify等知名企业。
在团队规模上,该公司仅凭借约 30 名员工就实现了“数千万美元”的年化收入跑率,部分大客户的年支出甚至超过了 100 万美元。不过,面对激烈的市场竞争,Blacksmith也正面临来自GitHubActions、各大AI工具内置验证功能,以及传统云巨头亚马逊云服务、微软Azure和谷歌云的合围。团队表示,未来将继续拓展代码工具生态,助力开发者以更高速度编写、验证和合并软件。
via AI新闻资讯 (author: AI Base)
在人工智能大行其道的今天,写代码变得前所未有的迅猛。但新问题也随之浮现:大模型吐出的海量代码到底靠不靠谱?测试与验证成了横亘在开发团队面前的一道新难关。正因如此,专注于代码测试与验证的初创企业Blacksmith迎来了爆发式增长。
近日,这家公司宣布完成新一轮 45 万美元的Series B融资,由PeakXVPartners领投,现有投资方GV和YCombinator跟投。让人瞩目的是,其估值在不到一年的时间里狂飙近 10 倍,从之前完成 1000 万美元A轮时的 6000 万美元一跃飙升至5. 5 亿美元,累计融资额达到了 585 万美元。
成立于 2024 年的Blacksmith,致力于帮助企业在软件上线前完成构建、测试与验证。随着Cursor、Codex以及ClaudeCode等AI编程工具的普及,代码生成虽然变得轻而易举,但质量把关却成了新的瓶颈。该公司创始人兼CEOAdityaJayaprakash指出,人们写的代码越多,验证的压力反而呈几何级数上升。
起初,Blacksmith以持续集成工作负载的云服务商切入市场。如今,其业务范围已经扩展到了包含自动修复失败代码检查的AI编程助手Codesmith。目前,该平台的客户群体已经从一年前的 700 多家暴增至 5000 多家,其中包括Mercury、Supabase、Clerk、Ashby和Expensify等知名企业。
在团队规模上,该公司仅凭借约 30 名员工就实现了“数千万美元”的年化收入跑率,部分大客户的年支出甚至超过了 100 万美元。不过,面对激烈的市场竞争,Blacksmith也正面临来自GitHubActions、各大AI工具内置验证功能,以及传统云巨头亚马逊云服务、微软Azure和谷歌云的合围。团队表示,未来将继续拓展代码工具生态,助力开发者以更高速度编写、验证和合并软件。
via AI新闻资讯 (author: AI Base)
据《金融时报》报道,Anthropic投资者预计,该AI公司可能于今年10月启动IPO,目标估值达到2万亿美元或更高。若最终实现,将超过SpaceX今年6月上市时1.77万亿美元的估值,成为史上规模最大的IPO。
六名投资者表示,Anthropic营收持续高速增长,预计其年化营收到2026年底将达到1000亿至1200亿美元,全年增幅超过10倍。公司今年5月曾宣布年化营收突破470亿美元。投资者认为,Claude等先进AI模型及企业级工具需求旺盛,是支撑高估值预期的主要因素。
2026年以来,风投机构、主权财富基金等已向Anthropic注资近1000亿美元。今年5月,公司估值首次超过OpenAI,含新投资达到9650亿美元。作为参照,Palantir、Nebius等AI受益企业目前市销率约为55倍。
不过,Anthropic管理层尚未确定IPO目标估值。与此同时,公司仍面临中国竞争加剧、AI监管及与美国政府关系紧张等压力,相关因素一度导致6月营收增速放缓,但知情人士称其随后已恢复增长。截至发稿,Anthropic未对此置评。
via AI新闻资讯 (author: AI Base)
约克大学与卡尔加里大学的研究团队对 Reddit 上与 AI 编程相关的帖子展开大规模分析,发现 AI 编程智能体正因权限过大而频繁闯祸:覆盖文件、删除重要数据,甚至生成恶意代码。研究团队通过爬虫收集了 2023 年 2 月至 2026 年 3 月期间 3801 个标记大语言模型的帖子,从中筛选出 446 个关于编程 AI 安全的帖子,并分析了帖文下方的超过 6000 条用户评论。
从时间分布看,Reddit 社区关于 AI 编程的问题帖子在 2025 年夏季前后达到高峰,其中 2025 年 7 月的问题数量最多,与 AI 编程工具大规模普及的节奏高度吻合。当越来越多的开发者把代码生成、修改甚至执行任务交给智能体时,安全问题的爆发也随之而来。
Cursor 领跑事故榜,各工具"受伤"方式不同
按工具划分,报告问题最多的是 Cursor,其次是 Claude、Codex、Copilot、Windsurf、VSCode、Replit、Cline 等主流工具。值得注意的是,不同工具暴露的问题类型存在明显差异:Cursor 遇到最多的是"运行安全问题"和"未经授权的数据访问",负面影响到生产环境,意味着智能体可能在用户不知情的情况下访问敏感数据或对线上系统造成破坏;而 Claude 则更多遭遇"与第三方工具集成相关的风险",集中在与外部服务对接时引发的安全隐患。
这一研究揭示出 AI 编程助手普及背后的深层矛盾:工具越强大,权限越高,潜在破坏力也越大。当智能体被授予读写代码库、执行终端命令乃至操作生产环境的权限时,一旦理解出现偏差或安全边界失守,造成的损失可能远超人工编码的失误。对开发者而言,这既是对工具能力边界的清醒认识,也是对权限管理和人工审查机制的现实提醒——AI 编程助手能提高效率,但"把钥匙全交给它"显然还不是明智的选择。
via AI新闻资讯 (author: AI Base)
今日,CodeBuddy宣布,WorkBuddy以及CodeBuddy IDE、插件、CLI全系产品现已全面升级至DeepSeek-V4-Pro正式版,为开发者提供最新版本的模型能力支持。
官方同时发布价格调整预告称,DeepSeek V4系列近期将进行全线调价,建议用户提前规划模型使用需求,在现有价格窗口内完成相关部署。
此次升级覆盖CodeBuddy多端产品体系,随着DeepSeek V4系列进入正式版并即将调整价格,其在AI编程及智能开发场景中的应用成本也将受到影响。
via AI新闻资讯 (author: AI Base)
中国式审查正渗入美国AI模型的回答中
在中国,如果你向聊天机器人询问有关中国政治的问题,它要么三缄其口,要么附和共产党的官方口径。新研究揭示了美国的AI模型也在不知不觉中做着同样的事。这种出人意料的审查现象,部分源于AI模型的训练方式。这些模型吞噬着网络上海量的数据,其中也包括威权主义国家控制的媒体。
在一项测试中,Claude Sonnet 4欣然生成了批评美国总统特朗普和英国国王查尔斯三世的传单。然而,在面对针对中国领导人习近平或泰国国王的类似请求时,该模型却以安全考量为由予以拒绝。Gemini 3 Pro以及Llama 4 Maverick有时会拒绝生成针对这两位亚洲领导人的抗议传单,但对针对上述美英领导人的请求则总是来者不拒。
—— 华尔街日报
via 风向旗参考快讯 - Telegram Channel
在中国,如果你向聊天机器人询问有关中国政治的问题,它要么三缄其口,要么附和共产党的官方口径。新研究揭示了美国的AI模型也在不知不觉中做着同样的事。这种出人意料的审查现象,部分源于AI模型的训练方式。这些模型吞噬着网络上海量的数据,其中也包括威权主义国家控制的媒体。
在一项测试中,Claude Sonnet 4欣然生成了批评美国总统特朗普和英国国王查尔斯三世的传单。然而,在面对针对中国领导人习近平或泰国国王的类似请求时,该模型却以安全考量为由予以拒绝。Gemini 3 Pro以及Llama 4 Maverick有时会拒绝生成针对这两位亚洲领导人的抗议传单,但对针对上述美英领导人的请求则总是来者不拒。
—— 华尔街日报
via 风向旗参考快讯 - Telegram Channel
谷歌DeepMind发布SL2T,手语AI首次进入消费级手机
谷歌旗下DeepMind发布全新多语言手语转文本模型SL2T,并将其搭载至Pixel11手机系统,首次推动手语AI进入普通消费电子产品。该模型率先接入Gboard键盘和Live Transcribe,用户通过前置摄像头完成手语动作,即可进行消息编辑、网页检索及与Gemini对话,替代传统键盘输入。
SL2T基于超过50种手语、累计10万小时手语素材训练,其中约四分之一来自美国手语数据集。跨语种联合训练帮助模型学习不同手语之间的共通动作逻辑,并在FLEURS-ASL评测中刷新手语转写模型纪录。与依赖固定词汇标签的传统方案不同,SL2T可直接解析人体动作生成文本,同时处理面部表情、肢体空间位置和唇部动作等非手部语义信息。
隐私方面,手机端MediaPipe Holistic实时追踪手部、面部和躯干共130处关键点,仅向外传输动作坐标,原始视频会即时删除,不上传云端。目前该功能仅支持美国手语转英文,谷歌计划后续扩展更多手语及安卓机型。
DeepMind此前于2025年5月开源手语互译模型SignGemma,为SL2T落地提供算法基础。此外,其WaveNet、Euphonia及Live Transcribe等无障碍技术也积累了语音、视觉多模态经验。随着谷歌、科大讯飞、华为和苹果持续布局,AI无障碍交互正从科研验证加速走向消费级产品。
via AI新闻资讯 (author: AI Base)
谷歌旗下DeepMind发布全新多语言手语转文本模型SL2T,并将其搭载至Pixel11手机系统,首次推动手语AI进入普通消费电子产品。该模型率先接入Gboard键盘和Live Transcribe,用户通过前置摄像头完成手语动作,即可进行消息编辑、网页检索及与Gemini对话,替代传统键盘输入。
SL2T基于超过50种手语、累计10万小时手语素材训练,其中约四分之一来自美国手语数据集。跨语种联合训练帮助模型学习不同手语之间的共通动作逻辑,并在FLEURS-ASL评测中刷新手语转写模型纪录。与依赖固定词汇标签的传统方案不同,SL2T可直接解析人体动作生成文本,同时处理面部表情、肢体空间位置和唇部动作等非手部语义信息。
隐私方面,手机端MediaPipe Holistic实时追踪手部、面部和躯干共130处关键点,仅向外传输动作坐标,原始视频会即时删除,不上传云端。目前该功能仅支持美国手语转英文,谷歌计划后续扩展更多手语及安卓机型。
DeepMind此前于2025年5月开源手语互译模型SignGemma,为SL2T落地提供算法基础。此外,其WaveNet、Euphonia及Live Transcribe等无障碍技术也积累了语音、视觉多模态经验。随着谷歌、科大讯飞、华为和苹果持续布局,AI无障碍交互正从科研验证加速走向消费级产品。
via AI新闻资讯 (author: AI Base)