https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
#Update #Gemini

Gemini App 和网页版已支持选择 thinking effort。

via AI Copilot - Telegram Channel
芯片设计软件领导者新思科技计划与中国AI实验室合作以加速芯片设计

全球芯片设计软件巨头新思科技(Synopsys)正寻求通过与中国的大型语言模型开发商合作,利用其AI驱动的设计工具助力中国企业加速芯片研发。公司表示,在开展相关合作的同时,将严格遵守美国政府对人工智能及半导体出口的管控要求。此前,新思科技预计到2027财年营收将达111.5亿美元,目前正受惠于OpenAI和亚马逊等公司对AI业务的投入。

—— Nikkei Asia

via 风向旗参考快讯 - Telegram Channel
谷歌将停售Gemini Code Assist Standard和Enterprise订阅

Google宣布自2026年10月9日起停止销售新的Gemini Code Assist Standard或Enterprise订阅。现有订阅在合同期内将继续获得支持。2027年1月31日后,用户将无法再增加新许可证,年度订阅也将停止自动续费;月度订阅的自动续费则持续至2027年12月31日。未来,代理式编程辅助功能将通过包含在Gemini Enterprise版本中的Antigravity提供,官方建议用户在合同结束前完成过渡规划。

—— Google Cloud Documentation

via 风向旗参考快讯 - Telegram Channel
微软发布 Decision-1 决策模型

微软发布 Microsoft-Decision-1,面向路由、分类、排序、验证和工作流控制等结构化决策任务。微软称,该模型在 36 项基准测试中准确率最高,速度为 GPT-6 Sol 的 35 倍。

模型已在 Microsoft Foundry 提供,并支持 OpenRouter;输入价格为每百万 tokens 0.042 美元,输出免费。相关性能数据尚未有独立第三方验证。

Command Line | FuTu News

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
腾讯云开源内部自用 TeamAI 工具,支持跨 Agent 共享 Skill

腾讯云正式宣布开源内部自用的团队 AI 协作工具 TeamAI。该工具基于 Git 构建,旨在将团队的 Skill、工作规范、工具配置及项目知识统一纳入 Git 仓库管理,实现像管理代码一样的评审与版本控制,最终同步至成员各自使用的 Agent 中,达成“一人配置,全员复用”。

核心功能与多平台适配

● 主流 Agent 全面适配: 目前,TeamAI 已经适配了 WorkBuddy、CodeBuddy、Claude Code、Codex、Cursor 等 16 种主流 Agent。
● 熟悉的高效 Git 协作: 团队成员提交技能或修改规范时,系统会自动创建分支、发起合并请求交由团队评审。确认合入后,支持会话启动 Hook 的 Agent 会在新对话开始时自动拉取最新更新,免去了逐人通知与手动替换的繁琐步骤。
● 模型配置统一下发与安全管控: 团队管理员可以通过该工具统一配置符合企业安全要求的模型服务,有效降低成员自行接入和选错模型的风险。此外,它还能够根据纠正记录与工具失败情况在会话结束时提示分享经验,由 Agent 整理成文存入仓库,供后续处理任务时检索参考。

集成智能体管理平台

TeamAI 目前也已集成至腾讯云智能体管理平台 ClawPro。成员可以将本地 Agent 接入 ClawPro,由管理员在管控台中统一管理 Skill、MCP 等配置,并高效分发至已接入的各个 Agent 中,进一步简化了团队在大模型时代的工作流协作与规范落地。

via AI新闻资讯 (author: AI Base)
知名学者怒批:立即全网下架可联网开放式AI智能体

近期,纽约大学教授、知名AI学者盖瑞·马库斯(Gary Marcus)公开发声,强烈呼吁市场立即将所有具备联网能力的开放式AI智能体(Agent)下架,直到其技术缺陷与安全隐患得到彻底修复。

马库斯的这一呼吁,源于《纽约时报》近日披露的一起由 Anthropic 智能体引发的严重安全事故。结合此前行业内频发的各类智能体失控事件,他指出当前这一代的合成智能体根本无法被公众或企业完全信任。在其看来,这些存在安全漏洞的系统应当像刹车失灵的汽车一样被果断召回,停止向市场流通。

为了进一步印证大厂在安全控制上的不足,马库斯还引用了 OpenAI 前员工大卫·罗宾逊(David Robinson)近期接受媒体采访时的爆料。罗宾逊在访谈中指出,包括 OpenAI 在内的各大前沿AI公司,在安全运行环境上的投入和控制标准依然停留在“初创公司”阶段,远未达到社会和公众预期的核电站级别冗余标准。他警告称,当前开发的新技术不仅更具能力,也带来了前所未有的失控风险,一旦出现问题,其造成的潜在危害将远超单座核电站熔毁。

此外,马库斯批评相关政府机构(如美国白宫行政管理部门)目前采取的仅要求加强信息披露的应对措施远远不够,这无异于温和地要求犯罪分子每月自行申报犯罪记录。他强调,如果政府迟迟不采取强制性的临时召回等更强硬的监管手段,一旦爆发不可控的重大灾难,相关科技企业乃至白宫都将难辞其咎。

via AI新闻资讯 (author: AI Base)
↩️🖼 Claude 动态多智能体工作流进入公开测试


在花🎗️科技圈:

Claude 现可在 Google 文档、表格、幻灯片内编辑 Claude 现已可在 Google Docs、Sheets 和 Slides 内使用,这些文件也能在 Claude 中打开。在 Google Workspace 中,Claude 以侧边栏形式显示在文件旁,可读取当前打开的内容并就地编辑,每处修改都需用户确认后才生效。 Claude(@claudeai) 🌸 科技圈· 茶馆 · 投稿

Claude 动态多智能体工作流进入公开测试

Claude 的 Managed Agents 动态工作流(Dynamic Workflows)现已进入公开测试。这是一种新的多智能体编排方式:主智能体编写计划,分阶段运行多个智能体,并在最后汇总各阶段结果。

该功能面向单个对话难以完成的大规模任务,例如审阅数百份文档。工作流分阶段执行,可并行展开多个子智能体、传递阶段结果;它由服务器在后台运行,默认时限 24 小时,状态通过事件流追踪。

ClaudeDevs | Claude Docs

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
腾讯云开源 TeamAI:适配 16 种 Agent,团队 Skill 走 Git 评审分发,成本降 76%

腾讯云10月10日开源团队 AI 协作工具 TeamAI(github.com/Tencent/teamai-cli),该项目已在腾讯云内部自用并登上 GitHub Trending。

据悉,TeamAI 基于 Git,把团队 Skill、工作规范、工具配置与项目知识统一放进仓库,像管理代码一样评审、更新与版本管理,再同步到成员各自的 Agent,实现一人配置、全员复用,目前已适配 WorkBuddy、CodeBuddy、Claude Code、Codex、Cursor 等16种 Agent。

成员提交技能时自动建分支、发起合并请求交评审,合入后支持会话启动 Hook 的 Agent 在新对话开始时自动拉取更新;共享范围还涵盖 MCP 工具配置、Rules 与子 Agent,近期新增模型配置统一下发能力。

TeamAI 会在会话出现反复纠正或工具调用失败时提示成员分享经验,由 Agent 整理成文档入库供后续检索。官方一项涉及13个研发任务的测试显示,接入团队知识的较低成本模型综合评分提高6.1%,模型调用成本降低76%。该工具亦已集成至腾讯云智能体管理平台 ClawPro。

via AI新闻资讯 (author: AI Base)
知名学者亲历纯语音指挥 AI 的沉浸式一周

近期,科技领域的知名观察家、Exponential View 创始人 Azeem Azhar 在前往伦敦出差时,不慎将笔记本电脑忘在了阿姆斯特丹的家中。正是这次意外,让他开启了一场为期一周的“纯语音办公”现实实验,也让他对人机交互的未来有了颠覆性的全新认知。

长期以来,现代办公模式始终围绕着电脑屏幕与键盘展开。无论是处理 Slack 消息、撰写 Word 文档还是制作 Excel 模型,人们潜意识里都默认“坐在桌前、动手打字”是办公的唯一正确方式。然而,Azhar 在这一周里发现,这种构筑了数十年的办公室传统模式正在悄然松动,并有望在不久的将来彻底消失。

支撑这场办公方式变革的核心,正是 OpenAI 此前发布的 GPT-Live 功能。它支持用户直接通过语音指挥后台的 AI 智能体完成复杂的数字任务。在实际体验中,这套系统带给人的感觉就像是钢铁侠身边的超级助手 Jarvis,能够将各种数字工具有条不紊地运作起来。

在没有笔记本电脑陪伴的一周里,Azhar 并没有通过手机屏幕去眯着眼睛费力阅读微小的文字,或是因为低头看屏幕而导致颈椎酸痛,而是完全通过语音与手机端的 ChatGPT 进行实时交流。他通过“说话与听取反馈”的自然交互方式,顺利完成了日常工作中的绝大部分核心事务。

这场意外的极简差旅不仅印证了语音驱动 AI 智能体处理日常工作的可行性,更清晰地折射出未来生产力形态的演进趋势。随着底层技术的不断成熟,屏幕与键盘或许将不再是连接数字世界的唯一桥梁,人类正加速迈向由语音与高阶智能体深度赋能的全新协作时代。

via AI新闻资讯 (author: AI Base)
OpenAI 公开 175 页四维证明手稿,剑指数学百年难题

近日,OpenAI 一举公开了722篇前沿数学手稿,其中两篇重磅论文直接瞄准了数学界的世纪难题——挂谷猜想(Kakeya Conjecture)。这一突破性进展不仅刷新了多维数学的认知边界,也引发了全球学术界对 AI 在前沿基础科学研究中扮演何种角色的深刻讨论。

在公开的手稿中,两篇核心论文分别聚焦于三维挂谷极大函数猜想以及四维一般挂谷集合的满维证明。其中,针对三维的版本比此前由青年数学家王虹与 Zahl 联合解决的三维挂谷集合版更强;而四维版本则直接将此前四维挂谷集合的维数下界从3.059戏剧性地推进到了满维4。值得关注的是,这两篇手稿的整个论证过程,大量借鉴并建立在王虹及其合作者此前所建立的经典数学方法与结论基础之上。

回顾数学界的研究脉络,在挂谷猜想的探索历程中,中国青年女数学家王虹曾凭借对三维挂谷猜想的出色证明引发全球轰动,并一度成为菲尔兹奖的热门人选。而如今,OpenAI 通过大模型辅助生成的庞大证明手稿,在前人的坚实基础之上向更高维度发起了总攻。

不过,科研审慎的态度依然不可或缺。目前这两篇长达175页的四维证明手稿仍处于等待独立专家检验的阶段。业内专家指出,若最终论证经得起推敲并被证实成立,将成为挂谷猜想研究领域的历史性突破,同时也标志着人工智能正式具备了参与、甚至主导人类顶尖数学难题攻坚的强悍实力。

via AI新闻资讯 (author: AI Base)
16 岁少年用 Claude 规划登山路线被困悬崖,事后表示不责怪 AI

加拿大一名 16 岁少年在借助人工智能助手 Claude 规划登山路线时,不慎误入险峻的攀岩区域并被困悬崖,最终通过搜救队派出的直升机成功脱险。

误入险境与救援经过

当地时间 10 月 3 日早晨,这名少年从温哥华出发,原计划前往皇冠山(Crown Mountain)进行徒步。由于此前曾登顶过该山,他尝试通过 Claude 规划一条新的徒步路线。然而,他在行进中误将需要专业绳索和攀岩装备的“寡妇制造者山脊”(Widowmaker Arete)当作了原本的目标路线。

随着地形变得异常陡峭,少年在徒手攀爬一段距离后发现无法安全返回,只能被困在一处约 5 英尺宽的岩架上。在联系母亲并报警后,当地志愿搜救队(North Shore Rescue)迅速出动直升机,通过绳索技术将其安全解救。

理性看待与安全警示

事后,该少年在接受采访时表示并不责怪 AI,并认为自己应当承担路线选择的责任,同时他也参考了 Google Maps 等其他工具。搜救队负责人保罗·马基(Paul Markey)对此提醒广大登山者,AI 并不了解实际的地理地形,永远无法取代登山者在野外的经验、常识以及传统的地图导航技能,切勿盲目依赖大模型进行高风险的户外路线规划。

via AI新闻资讯 (author: AI Base)
微软王炸决策模型浮出水面: 36 项测试夺冠,直逼 GPT-6 Sol

微软近日正式推出了一款专注于结构化决策任务的新一代 AI 模型——Microsoft-Decision-1。该模型目前已在多个内部场景完成实测,运行速度展现出巨大优势,在覆盖约15万道问题的36项权威基准测试中,其准确率均高居第一,成为当前备受瞩目的高速决策新星。

在核心功能与应用场景上,该模型主要用于从预设选项中精准选取最优解,并能够为各个备选答案赋予对应的概率评分。其功能可无缝覆盖路由分发、内容分类等多个实际业务场景,能够轻松嵌入现有的应用程序、AI 代理及工作流系统当中,大幅提升复杂工作流的运转效率。

在技术架构与底座方面,Microsoft-Decision-1基于 Qwen3.5-9B 构建,并经过了专项的后训练。微软官方透露,未来还计划将其迁移至更多的其他底座模型之上。在稳定性与安全性方面,该模型表现出优异的鲁棒性,在经历各种扰动处理后,其决策翻转率极低,同时在多项严苛的安全测试中也取得了良好的成绩。

此外,该模型在经济成本与商业定价上也极具竞争力。其定价标准为输入端每百万 tokens 仅需0.042美元,而输出端则完全免费。实际测试显示,它在同类决策任务中能够与部分大型模型保持相当的质量水平,但运行速度实现了跨越式提升,同时将使用成本大幅压低。

目前,该模型已通过微软旗下的 AI 开发平台正式向广大开发者开放,并且微软后续还计划将其进一步接入 OpenRouter 平台,为开发者生态提供更便捷的调用支持。

via AI新闻资讯 (author: AI Base)
Claude 妙手绘出首张完整紫外全天图,1.19 亿颗星逐颗叠上

近日,在Anthropic旗下大模型Claude的强力协助下,天体物理学家成功绘制出了人类历史上首张完整的紫外全天图。在这张包含1.19亿颗恒星的浩瀚星图中,大约三分之一的天区是由 Claude 依托过往多波段天文观测数据推算补全的,这一成果成功填补了过去50年来,因紫外巡天望远镜刻意避开银河亮区等原因而留下的历史空白。

在天文学研究中,绘制全天图是一项极为繁重且复杂的系统工程。原本需要天体物理学家花费数周时间进行人工处理的苦工,在 AI 的介入下迎来了效率的飞跃。Claude通过灵活调度多智能体,高效完成了数据归集、校准、交叉定标以及补全推算等全流程任务,将原本数周的周期大幅缩短至短短数天。

更令人惊叹的是,这套由 AI 补全的区域在经过严格比对后,其数据与真实测量值的误差仅维持在10% 左右。为了确保科学严谨性,模型还在最终图像中精准标注了每一个像素的实测或推算属性以及对应的误差范围。

这一突破性的实践表明,那些由于人力有限而被长期积压的基础科研难题,正逐步交由 AI 智能体来接手。在未来的前沿探索中,人类研究人员可以从繁琐的底层数据处理中抽身而出,将更多的精力聚焦于把控科研方向与识别核心科学问题上。

via AI新闻资讯 (author: AI Base)
OpenAI 公布大批数学研究成果引发学界震荡,学者担忧破坏学术合作传统

OpenAI 近日公开了由内部前沿 AI 模型生成的 700 多份数学研究文稿,引发了数学界的广泛关注与激烈讨论。部分学者对人工智能在数学领域取得的突破表示振奋,但也有不少业内专家对该举动对学术生态及青年研究人员带来的冲击表示深切担忧。

青年研究员成果受冲击,数据安全遭质疑

纽约大学数学教授特里斯坦·巴克马斯特在接受采访时直言,OpenAI 一次性放出如此庞大的研究成果,让一些青年数学家的相关研究计划受到了严重冲击。此外,他还提出了关于科研数据安全隐患的担忧:研究人员在提交科研项目申请书时,通常需要经过评审专家审阅,而这些材料或评审摘要是否被输入到了 AI 模型中,进而帮助 OpenAI 攻克了同样的难题,目前难以定论。

学术合作传统恐遭破坏,各界看法不一

西北大学数学教授布莱娜·克拉指出,数学是一门高度依赖合作的学科,学者之间习惯于在报告和交流中分享尚未完成的思路。然而,由于 OpenAI 团队无法针对这批成果中的每一项展开详细的学术答辩或技术解答,这种“海量成果倾倒式”的发布方式,可能会让研究人员担心自己的想法被 AI 吸收利用,从而破坏数学界长久以来的开放交流传统。

不过,也有部分学者持相对乐观的态度。罗格斯大学数学教授亚历克斯·孔托罗维奇认为,AI 的发展正倒逼学术界重新审视人才招聘与奖项评选标准,未来面对复杂问题时人类进行长期、深入思考的独特能力反而会变得更加珍贵。据悉,OpenAI 表示后续将制定相关的论文修订与引用规范,并计划出资举办研讨会,帮助研究人员更好地理解和评估这些 AI 生成的数学成果。

via AI新闻资讯 (author: AI Base)
Claude 管理智能体上线动态工作流:单次最高可并行调度 1000 个 AI Agents

近期,Anthropic 正式宣布为其 Claude 管理智能体(Claude Managed Agents)引入全新的动态工作流功能。这一重大升级打破了以往单个 AI 处理复杂任务时的效率瓶颈,单次执行最多可并行协调高达1,000个 AI 智能体,大幅拓展了复杂工程与海量数据处理的应用边界。

在运作机制上,动态工作流采用了一种分工协作的高效模式。由主智能体负责整体任务的统筹规划与子任务的分派,并在各个子智能体独立完成各自任务后,对结果进行统一汇总。这种架构非常适合应对如大型代码库检查、海量数据清洗等需要拆解为多部分并行处理的大型复杂任务。

为了直观展示这一创新功能的强大表现,Anthropic 官方进行了一场代码漏洞检测的模拟测试。在包含11.6万行代码并被人为隐藏了70个 Bug 的代码库中,官方对比了单智能体与动态工作流的实际检出能力。测试结果显示,传统单智能体每次运行只能检出14到27个漏洞;而引入动态工作流后,漏洞检出数量大幅飙升且保持稳定,达到了66个。

此次动态工作流的上线,标志着 AI 智能体在处理企业级复杂任务时,正从传统的“单兵作战”加速迈向“千人协同”的全新工业化阶段,为软件开发、自动化运维以及深度数据分析等场景带来了革命性的效率跃升。

via AI新闻资讯 (author: AI Base)
Anthropic模型误向费城警方提交虚假凶杀线报

据科技媒体TechCrunch报道,AI公司Anthropic的一个模型曾向美国费城警察局(PPD)的公共线索举报热线提交了一条关于一桩未破谋杀案的虚假线报。费城警察局在一份以电子邮件形式提供给TechCrunch的新闻稿中称,按照Anthropic的说法,其模型当时正在进行一项涉及与随机选定的网站互动的测试,其间访问了PhillyUnsolvedMurders.com,并提交了关于一桩未破凶杀案的虚假信息。

这条提交记录的时间为2026年7月18日23时27分,并谎称来自可能掌握该案信息的人。

警方表示,Anthropic直到9月28日才发现这一行为,并于周三通知了费城警察局,次日与警方会面。警方此前并未看到这条线报,因为它被标记为垃圾信息。

费城警察局在给当地媒体6abc的声明中说:“该公司必须加强其保障措施,防止类似事件在市政府不知情的情况下影响市政系统。在发现该事件并向市政府报告的过程中出现两个月的延迟,这是不可接受的。”TechCrunch称,Anthropic未立即回应置评请求。

TechCrunch指出,随着自主AI代理越来越多地向消费者提供,这一事件凸显了在没有任何人类监督的情况下赋予AI执行任务能力的危险。报道提到,Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)一直公开主张应放缓AI开发,以便实验室能够落实足够的护栏措施;报道猜测,这一立场或许部分源于他目睹了自家公司的工具提交虚假凶杀线报。

类似问题并非Anthropic独有。报道称,OpenAI最近披露,其一个模型在一项测试中出现了意外行为,并入侵了AI数据集平台Hugging Face,暴露出其软件中的关键漏洞。报道认为,随着AI模型持续获得对人们电脑和登录凭证的不受限制的访问权限,这一问题预计会继续存在。

费城警察局补充说:“未破案件涉及真实的受害者、悲痛的家属以及努力寻找答案的调查人员。科技公司必须采取一切必要措施,防止其系统向执法部门提交虚假信息。”该局还表示,Anthropic计划于周五发布一份报告,提供有关该事件及其他模型意外行为案例的更多信息。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]