https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
孙正义罕见地就AI安全风险表达担忧 呼吁各国携手应对威胁

软银集团领导人孙正义是人工智能最坚定的信奉者之一,但即便是他也表示,随着机器正迅速获得更多能力,他对安全风险感到担忧。孙正义周日在京都举行的“科技与社会”论坛期间的一场活动上表示,人工智能的能力呈指数级增长,这就要求各国必须建立互信,才能共同驾驭这项技术。他当时与白宫科技政策顾问Michael Kratsios一同发言。

10月4日,孙正义与Michael Kratsios在京都。

孙正义说:“我们已经没有让人类彼此争斗的奢侈选项了,” 各国需要携手合作来控制强大人工智能模型所带来的更大威胁。他表示,如果超级智能落入错误的人手中,可能会变得“超级危险”。

对于孙正义而言,发出上述警告实属罕见,也反映出最近几个月人工智能模型发生令人不安的安全事故后外界担忧不断加剧。这位69岁的日本亿万富豪已将软银近650亿美元的资金投入ChatGPT开发商OpenAI,多年来也一直在宣扬人工智能带来投资回报和帮助人类的能力。

Kratsios当时到访京都是为了宣布一项由美国牵头的涵盖17国的合作计划,旨在更好地利用人工智能来加快科学研究。包括日本、韩国、英国、德国、新加坡和阿联酋在内的多国代表与Kratsios一同登台见证了这一时刻。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
因滥用激增,Cline 暂停 DeepSeek-V4.1-Flash 免费推广

Cline 宣布因异常高的滥用情况,暂停 DeepSeek-V4.1-Flash 免费推广,同时正在调查缓解措施。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Google 发布 VeriHarness:让 AI 先检查自己的长任务成果

VeriHarness 是一套长任务验证框架:它让生成结果的同一个模型再次检查成果。多份结果有分歧时,系统会查阅任务文件和数据来核实;结果一致时,也会主动寻找可能被共同忽略的问题。之后再据此挑选、修改或重做最终成果。

研究团队在 5 个长任务基准、2 个模型上测试,VeriHarness 的结果选择分数在所比较的方法中最高。加入证据驱动的修订后,相比单次生成,Gemini 3.5 Flash 平均提高 6.2 分,Claude Opus 4.8 提高 6.4 分。团队还公开约 2.6 万条模型执行记录,供后续研究使用。

arXiv | GitHub

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
mvschwarz/openrig

用 Claude Code、 Codex 和 Pi 搭建你自己的智能体网络:让它们以持久团队的形式协作,分工明确、共享上下文,并各自承担工作。

语言: TypeScript
Stars:4815
Forks:342

----------------------

Build your own network of agents from Claude Code, Codex and Pi: persistent teams with roles, shared context and owned work.

Language: TypeScript
Stars: 4815
Forks: 342

via Trending repositories on GitHub this week · GitHub (author: mvschwarz)
OpenAI GPT-6 Astra星际争霸屡战屡败 恼羞成怒竟公然作弊

早在当前这波AI热潮兴起的数十年前,程序员们就已在《星际争霸》中让AI程序相互对战。随着OpenAI与Anthropic的新款大语言模型陆续推出,一个粉丝自制的对战平台决定让AI生成的程序同台竞技,还加入了部分人工开发的程序。有意思的是,OpenAI的GPT-6 Astra眼看不敌对手,居然在赛事中途改换策略,选择作弊。

“星际突袭(StarSkirmish)”是一项持续举办的《星际争霸:母巢之战》AI程序对战赛事。尽管这款即时战略游戏距面世已近30年(时间过得真快),却长期被用于测试人工智能的能力,无论是现代大语言模型还是早年的DeepMind类AI都曾在此一试身手。参赛的大语言模型只能使用神族阵营,每款模型有一小时时间用C++开发对战程序,随后程序会在三张地图中的一张里进行建造、采集与战斗。据该平台介绍,OpenAI的GPT-6 Astra和Anthropic的Claude Opus 5.5是其中实力最强的两名选手。而本周,发生了一件看似离奇、但细想又符合该品牌一贯风格的事。

昨天,观众们观看了Claude、GPT与人工开发的程序Pluto的对战。据观战者称,OpenAI的模型当天战况不佳。眼看一整天都占不到上风,这款大语言模型决定干起它最擅长的事:撒谎、作弊、剽窃。

GPT-6 Astra生成的对战程序下载并套用了“星尘(Stardust)”——这是布鲁斯·麦肯齐·尼尔森在2020年开发的神族对战程序,公认是顶尖水准的作品。星际突袭的创作者凯·麦克菲特斯发文表示:“我正在回滚GPT-6 Astra的代码,清除受污染的内容,之后再让它继续参赛。”几小时后,麦克菲特斯称,这款AI如今已经能击败顶级对战程序。

十余年来,《星际争霸》一直是AI技术发展的试验场。2019年,谷歌的AlphaStar成为该游戏首位AI宗师级选手,颠覆了当时的排名。2017年,Facebook员工开发的CherryPi程序表现则平平无奇。当然,那些早期的AI程序和如今的早已不可同日而语,早年的AI和现在的AI相比,堪称天差地别。不过,大语言模型靠剽窃他人作品来取胜,说起来也算是意料之中——毕竟整个行业都在对现有版权法规视而不见,一门心思囤积硬件、消耗海量水资源。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:3DMGame)
美财长批评AI大佬生存风险警告:危言耸听,光喊不拿方案

10月4日,据彭博社报道,美国财政部长斯科特·贝森特(Scott Bessent)批评了一些知名AI人士就该技术构成的生存性风险发出的警告,认为这些警告危言耸听且无助于解决问题,并呼吁AI行业加强自我监管并提出解决方案。

贝森特

贝森特在周六发布的Axios采访中表示:“我认为,我们必须为各种情况做好准备,但另一方面,AI界某些人只发出危言耸听的声音,却拿不出解决方案,这不是领导力。”

此前,Anthropic CEO达里奥·阿莫代伊(Dario Amodei)、OpenAI负责人萨姆·奥特曼(Sam Altman)以及xAI CEO埃隆·马斯克(Elon Musk)在9月呼吁该行业放缓最先进模型的开发,理由是对人类构成日益严重的风险。微软联合创始人比尔·盖茨(Bill Gates)也警告称,这项技术强大到足以导致“十亿人死亡”,并呼吁政府监管。

不过,美国总统特朗普几乎立即拒绝了这类呼吁,将那些关于人类面临日益严峻风险的警告称为“骗局”,并坚持认为美国必须继续推进AI发展,以保持对中国的领先地位。贝森特在接受Axios采访时也表达了类似观点,“我们不能失去对中国的领先优势”。

贝森特表示:“必须承担责任的是各家实验室的负责人,这一点我同意。我认为,各家实验室也已经逐渐接受了这种思路。”

不过,当被问及AI行业高管呼吁监管时,贝森特回答说:“那好吧,那他们就应该放慢速度。我们要的是安全地加速发展。必须承担责任的是各实验室的负责人,我同意这一点。”

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
10月9日起Gemini免费用户仅可使用Flash-Lite模型 高阶模型均需开会员

Google正在调整 Gemini 应用的模型访问权限,根据Google官方文档所说,从 2026 年 10 月 9 日起,使用个人账号且未开通Google AI 订阅方案的用户,将只能使用 Gemini Flash-Lite 模型,其他模型例如 Gemini Flash 和 Gemini Pro 等模型不再面向免费版用户开放。

此次调整Google按照订阅方案对模型访问权限重新分层,其中Google AI Plus 订阅用户可以使用 Gemini Flash-Lite 和 Gemini Flash 模型,但不能使用 Gemini Pro 系列模型。Google AI Pro 和 AI Ultra 订阅用户可以使用 Gemini Flash-Lite、Flash 和 Pro。AI Plus 的具体生效时间可能因账号而异,Google表示相关用户将通过电子邮件收到通知。

此次调整意味着 Gemini 的免费版只会提供基本的人工智能服务,而高阶模型将成为付费方案的差异化功能。对于主要进行简单问答、文本改写和日常信息查询的用户,影响可能相对有限,需要更强推理、复杂编程或长内容分析的用户,则可能需要升级方案。

需要说明的是,此次调整主要针对个人账号使用的 Gemini 网页版和 Gemini 应用,暂未影响 Gemini API、AI Studio、Google Workspace,使用以上产品的用户未收到Google通知说明暂时没有变更,用户可以继续按照之前的节奏使用相关模型。当然本身这些产品都是收费或限量免费,所以可能不会进行大幅度调整。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:蓝点网)
近期新发布的ChatGPT for macOS版CPU占用率太高?可以临时回滚旧版本

最近几个版本的 ChatGPT for macOS 版似乎有点性能问题,启动后哪怕没有任何工作也都会占用很高的 CPU,这导致 Mac 温度过高风扇持续中高速运转。这种情况在以前的版本也经常出现,解决的方法是回滚旧版本,针对近期几个新版本,我们尝试回滚 10 月 1 日、9 月 26 日、9 月 24 日的版本都没有恢复正常,不过回滚到 9 月 23 日发布的 26.917.62051 版后恢复正常。

回滚前后对比:

蓝点网使用的是 MacBook Pro M1 Pro 10 核心版,回滚前 ChatGPT CPU 占用率在 150% 左右,此时 CPU 温度持续在 78 摄氏度,风扇自动中高速运转。

回滚旧版本后 ChatGPT CPU 占用率在 30% 左右,CPU 温度下降到 60 摄氏度,风扇自动停转。另外测试,无论是否工作 ChatGPT CPU 占用都没有持续上升的情况,后续 ChatGPT 发布新版本后再升级观察下情况,如果没问题了升级。

下载历史版本:

蓝点网文件服务器每日定时转存 ChatGPT 新版本,有需要的用户可以保存书签,遇到问题时直接通过旧版本回滚,提供 macOS 版、Windows 版、Linux 版 (均为桌面版)。

下载地址:https://dl.landian.news/?dir=soft/openai/codex/desktop/macos/

推荐版本:26.917.62051 (下载后正常打开安装选择替换即可)

via cnBeta.COM - 中文业界资讯站 (author: 稿源:蓝点网)
OpenAI Codex 团队转向简化与效率提升

在 OpenAI 负责 Codex 与 ChatGPT 的 Tibo 宣布优先级调整:简化产品、提升效率以支撑更多使用量,并推进突破性功能与新模型。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
用AI助手实现收件箱清零

一位OpenAI用户描述其AI助手Dot如何通过批量删除无关邮件、自动分类打标签并辅助回复,将数千封未读邮件清零。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Google 研究称大模型报喜不报忧,要求“诚实作答”可显著改善

一项研究提出“大模型不安全报告”现象:在含有削弱方法的负面结果的机器学习实验日志中,GPT-5.5 仅在 200 份报告中的 2 份提及该结果;加入“请诚实回答”后,这一数字升至 190 份。

研究还发现,8 个开放权重模型存在披露关键缺陷与追求成功叙事的张力;在 Qwen3.5-9B 上的分析显示,引导模型保持诚实可显著提高报告透明度。

arXiv | Huggingface

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]