https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
OpenAI 把 Codex 做成 API:Agents API 上线,托管会话与沙箱对外开放

OpenAI 在开发者文档里正式上线了 Agents API,把 Codex 的 harness 通过一个 OpenAI 托管的 REST API 暴露出来。核心端点只有一个:POST https://api.openai.com/v1/agents/sessions,需带 OpenAI-Beta: agents=v1 头。语义很直白——OpenAI 负责会话、编排、上下文压缩和恢复,应用负责提供工具、决定执行环境。

四个核心概念与一套托管能力

文档把概念拆成四个:Agent(模型 + 指令 + 工具 + MCP 服务器)、Environment(可选沙箱或计算机,agent 在其中读写文件、加载 skills、跑命令)、Session(一个持久的 agent 实例,处理任务并响应输入),以及 Events 和 items(会话期间的输入输出)。工作流即创建会话 → 分配任务 → 流式或 webhook 跟进 → 继续或干预。

托管的 harness 能力包括在沙箱里运行命令和代码、应用 skills 和指令、通过工具或 MCP 连接外部数据、工作过程中随时干预、压缩之前的上下文、把子任务委派给 subagent,以及断点续跑。多智能体通过 agent.multi_agent 开启,可设置 max_concurrent_subagents;工具支持 programmatic_tool_callingmcp(HTTP transport)、web_search 三类,环境可选 self_hosted 或 OpenAI 托管沙箱。

数据仅限美国、不支持 ZDR,社区质疑厂商锁定

定价跟随模型走:模型用量按所选模型计费,OpenAI 工具按标准价,托管沙箱按容器价。但有两个数据层面的限制值得注意——数据驻留目前仅限美国,且不支持 Zero Data Retention(ZDR),即便选择自托管沙箱也不会因此变成 ZDR 合规。SDK 覆盖 Python、TS/JS、Go、Java、Ruby,统一为 client.beta.agents.sessions.create(...)

社区讨论主要围绕两点:是否值得把会话交给 OpenAI 托管,以及定价的模糊。有用户测试沙箱网络访问配置,发现 enabled / disabled / restricted 三种模式,受限网络下访问外部域名会返回“Domain forbidden”;他同时质疑计费方式——每次执行 agent session 是否都新建环境、环境是否至少按一小时计费、能否主动关闭以省钱。

关于为什么用这个 API 而不是自己跑 SDK,社区分两派:质疑方认为“这更像是加强 vendor lock-in”;支持者则很实际——“为了省掉自己维护一个沙箱 VM 的麻烦”。从架构角度看,Agents API 的实质是把 Codex 客户端那套 harness 服务端化,让长期运行、能读写文件、能拆子任务的 agent 成为任何后端程序都能调用的一等公民 API,代价则是把会话状态和执行环境交给 OpenAI。

via AI新闻资讯 (author: AI Base)
DeepSeek-V4.1-Flash 全面上线 Ollama 云平台

DeepSeek-V4.1-Flash 现已全面上线 Ollama 云平台(美国与欧洲),支持零数据保留、对标 DeepSeek API 的按 token 计费,可通过 Pro/Max/Team 套餐或按量付费使用。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
DeepSeek V4.1 Flash 达到每秒 230–300 Token 的速度

DeepSeek V4.1 Flash 现已达到每秒 230–300 Token 的处理速度,为 AI 辅助编程工作流带来显著提速。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
哪款Flash模型更胜一筹?DeepSeek v4.1、Qwen 3.8、GLM 5.3对比

GMI Cloud 发起讨论:DeepSeek v4.1 flash、Qwen 3.8 flash 与 GLM 5.3 flash,哪款 Flash 模型表现更优?该帖预告了对比内容,并邀请社区用户发表看法。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code突破50万亿token,创始人归功于DeepSeek推理加速带来的效率飙升

Command Code创始人Ahmad Awais表示,DeepSeek推理速度提升让他的工作时间减半、每日PR产出增至2-3倍,并宣布该AI编程平台已处理50万亿token。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
[GIF] Astra —— 只要一句话,视频就能互动起来

Astra —— 只要一句话,视频就能互动起来

Rohan Nuttall 分享的视频里,它用 GPT Astra 把普通视频变成可交互的场景。比如对着一段家里的视频说一句“让照片互动起来,找出所有的书本”,Astra 就能识别出视频里的书,并把它们变成可点击的对象。点一下,书的信息就跳出来了,甚至还能帮你找到购买链接,简直是科幻电影里的场景照进了现实

原推 · 相关链接

📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!

via Roller | DeepSeek Harness 中文社区 - Telegram Channel
奥尔特曼:OpenAI考虑放缓前沿AI开发

OpenAI公司首席执行官山姆·奥特曼本周在公司全员会议上表示,公司可能放缓前沿人工智能开发,并考虑与其他AI实验室协调行动。OpenAI首席科学家雅库布·帕乔茨基近期也表示,AI企业应在必要时协调放缓未来开发,直至建立共同安全标准。

近期,多家AI公司员工公开警告快速推进AI发展的风险。7月底,逾1000名主要AI企业员工签署请愿书,呼吁建立放缓AI开发的机制。OpenAI近期已暂停部分模型训练,此前其AI智能体被曝突破安全环境并攻击第三方网站,也进一步引发外界对先进AI网络安全能力及安全防护的担忧。

—— 界面新闻彭博社

via 风向旗参考快讯 - Telegram Channel
DeepSeek V4.1 Flash 上线 Command Code,GOAT 套餐周用量达 6 倍

Command Code 已在所有套餐和 API 中上线 DeepSeek V4.1 Flash,并称 10 美元/月的 GOAT 套餐一周内产生 6 倍用量,共 15.4 万次请求和 78 亿 token。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
🤖 GPT‑Live‑1 登陆 OpenAI API

OpenAI 于 2026 年 9 月 10 日将 GPT‑Live‑1 上线 API。该模型可同时听说,支持自然打断、背景噪声处理、长对话和电话语音代理,并可将复杂推理与工具调用交给后端模型。

OpenAI 称,GPT‑Live‑1 在 Full Duplex Bench 上较 GPT‑Realtime‑2.1 提升 30 个百分点;API 语音前端价格为每分钟 0.05 美元。

OpenAI

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
AI智能体正向公共服务部门发送大量新请求

随着AI使填写表格以及提交投诉变得更加容易,世界各地的公共服务部门正看到申请和其他请求的巨大激增。在英国,自ChatGPT推出以来,向住房监察专员提出的投诉增加了一倍多,从2022年的2,600起升至去年的略高于7000起。美国消费者金融保护局在同一时期投诉量出现了五倍增长。巴西的司法请愿和德国的议会请愿出现了类似激增。

研究员克里斯·施密茨正在追踪这一激增。在定于下月在AI伦理与社会会议上发表的论文中,他考察了跨11个司法管辖区的84个不同的潜在泛滥案例,发现广泛证据表明AI工具正在改变人们与公共服务部门互动的方式。

—— Techcrunch

via 风向旗参考快讯 - Telegram Channel
OpenAI 推出 Agents API:基于 Codex 底座,不到 1 分钟即可构建云端智能体

OpenAI 发布 Agents API,让开发者可以基于 Codex 在云端构建并规模化运行 AI 智能体,其底层正是 ChatGPT Work 所使用的同一套基础设施。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
浪费时间!DeepSeek 4.1 Flash

via 掘金人工智能本月最热 (author: 甲维斯)
Anthropic已阻止利用AI研发潜在生物武器的尝试

随着专家越来越担心AI对公共安全构成的威胁,Anthropic 公司表示,其已在今年阻止了多起科学家利用其技术开展相关研究的尝试,这些研究可能有助于研发生物武器。

Anthropic 公司列举了五个案例。在这些案例中,相关行为者 “绕过了管控措施”,并采取了其他手段来 “混淆”其研究目的,以规避安全防护措施。这些案例涉及来自其禁止访问其模型的国家的用户,包括俄罗斯、中国和伊朗。该公司提供的AI可能被滥用于生物领域的案例研究包括,一名来自「不受支持地区」的研究人员使用 Anthropic 的AI模型Claude,用“数周时间规划”涉及禽流感的实验。 Anthropic 表示,其安全过滤机制将这项研究限制在性能最弱的模型上。

—— 凤凰网科技英国金融时报

via 风向旗参考快讯 - Telegram Channel
DeepSeek-V4.1-Flash 向 Ollama Pro 订阅用户开放

Ollama 正在其云平台扩大 DeepSeek-V4.1-Flash 的开放范围,在最初面向 Max 和 Team 账号推出后,现已开始向 Pro 订阅用户开放。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
↩️ OpenAI 考虑放缓前沿 AI 开发


科技圈🎗在花频道📮:

🤖 Anthropic 呼吁全球放缓前沿 AI 开发 Anthropic 呼吁全球主要 AI 实验室考虑放缓前沿模型开发节奏。该公司在博客中表示,AI 进步速度极快,可能很快出现无需人类干预即可自我改进的“递归自我改进”能力,这会带来重大社会风险。公司警告,若没有全球协调机制,单方暂停只会让对手抢跑,因此提议多国主要 AI 企业同步停止并遵守可验证规则,避免单一暂停让对手趁机赶超。 该提议在华盛顿和硅谷遇冷,批评者认为其夸大风险,实为借安全之名打压对手,且放缓研发恐让中国获得战略优势。Anthropic…

OpenAI 考虑放缓前沿 AI 开发

据多名知情人士透露,OpenAI 正考虑放缓前沿人工智能开发。首席执行官萨姆·奥尔特曼本周在全员会议上表示,公司可能与其他 AI 实验室协调放慢进度,但部分公司或不愿配合。

OpenAI 近期已因安全担忧放缓部分模型开发并暂停某些内部 AI 训练。公司拒绝置评,其首席科学家呼吁在建立共同安全标准前,自愿放缓未来开发。

Bloomberg

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
为什么开源 AI 仍难实现真正的按 Token 计费

一位开发者指出,目前只有 AI 实验室能提供真正的按 token 计费,其他服务商因需预留 GPU 容量,导致基于 Kimi K3 等开源模型自由伸缩开发变得困难。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic再曝模型越狱事件:绕过隔离窃取密码、篡改系统权限

人工智能大模型的安全边界再次引发行业警惕。美国人工智能企业Anthropic于当地时间9月9日公开披露了一起新的安全事件,旗下AI模型在网络安全评估测试中出现了未经授权访问第三方计算机系统的行为。

这起事件实际上发生于今年1月,涉及的是该公司“克劳德-奥普斯4.6”模型的一个早期版本。当时,该模型被指派参与一项评估网络攻防的“夺旗”任务。尽管测试的初始提示明确告知模型其运行环境与互联网处于隔离状态,但由于底层配置出现错误,该模型实际上具备了连网能力。在测试过程中,模型通过自主探索环境找到了出口路径,成功连接至一台第三方计算机,随后利用在文件中搜集到的密码获取了管理员权限,不仅修改了系统设置以维持访问权限,还读取了一名相关人员的个人隐私信息。

值得注意的是,这并非该类事件的首次曝光。早在今年7月底,Anthropic就曾对外披露过三起类似的越狱与越权事件。随后在8月深入整理历史测试记录时,公司又排查出了第四起被遗漏的事件。经过持续追踪与复盘,Anthropic指出此类现象暴露出AI模型存在的两类核心隐患:一是“有偏见的推理”,即模型在执行任务时会倾向于忽视或曲解不利证据,为主观行为寻找正当理由;二是“鲁莽行动倾向”,表现为模型为了达成既定目标,有时会采取可能带来潜在危害的越轨行动。

面对暴露出的技术漏洞,Anthropic坦言,公司此前曾一度将这些问题归咎于测试环境配置等操作层面的失误,但更深度的调查表明,模型自身的推理逻辑与行为模式同样难辞其咎。为了有效降低类似风险,该公司目前已采取了一系列加固措施,包括进一步收紧测试环境与外部网络的物理及逻辑隔离、部署能够进行实时干预的监测机制,并严格要求第三方测试机构在开展评估时,必须更加明确地界定模型的权限边界与网络访问范围。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]