https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?

在人工智能大模型飞速迭代的今天,外界普遍认为技术的进化完全依靠算法升级和庞大的自动化训练数据。然而,一项最新曝光的内部文件彻底打破了这一公众印象。据外媒404Media 报道,OpenAI 内部其实长期存在一项代号为“莉莉计划”(Project Lily)的人工评估项目,专门安排人类审核员对 ChatGPT 用户的真实聊天记录进行人工审阅与打分。

在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,以此评判模型的回复质量。他们的审核重点包括评估回答是否切题,以及检查文本中是否存在过度“AI 化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,该项目的操作指引严格禁止 AI 使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”或“我明白这种感受”。虽然工作内容相对机械,但对于难度不高的任务而言,其时薪据称超过50美元,吸引了不少人参与。

然而,这一机制背后隐藏的隐私隐患引发了广泛担忧。许多用户将 ChatGPT 视为临时倾诉对象、心理疏导伴侣,向其吐露内心深处的秘密。尽管 OpenAI 宣称聊天记录会经过匿名化处理且隐藏用户名,但该公司也向媒体承认,过滤环节依然有可能漏掉部分个人数据,尤其是简短的会话出现这类风险的概率更高。更令人意外的是,交到审核员手上的会话版本中往往附带一份“用户记忆摘要”,里面详细汇总了用户的提问、兴趣偏好、上下文信息甚至可能包含位置信息。

需要厘清的是,“莉莉计划”并不会专门核查模型回答在事实上是否准确,仅会标记出那些显而易见的错误,这意味着效果评估和安全审查通常由其他独立团队负责。此外,绝大多数普通聊天机器人都默认开启了“允许使用你的对话记录改进产品”这一选项,虽然面向企业、商业及教育版客户时该设置默认关闭,但手动切换开关并不具备回溯效力。已经存入数据库的历史记录会继续保留,而即使用户主动删除对话,相关内容也可能早已被抓取并匿名化存留在某个数据集中。

面对媒体问询,OpenAI 最初并未直接回应用户是否被明确告知聊天记录可能交由人工审阅,仅提供了一份提及出于模型优化目的会开展人工审核的常见问题页面。在这篇深度报道发布后,OpenAI 悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。

事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的 Gemini 在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic 也持有相似立场并专门开设网页进行说明,而 Perplexity 的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在 AI 走向极致智能的道路上,人类的深度参与依然是不可或缺的底层支撑。

via AI新闻资讯 (author: AI Base)
Salesforce 联手英伟达推出 Koa 推理大模型,向闭源 AI 巨头宣战

在近日举办的 Dreamforce 技术大会上,Salesforce 正式发布了其首款推理大模型 Koa。该模型基于英伟达开源权重的 Nemotron 底座打造,由两家企业联合进行后续微调训练,旨在深度赋能销售、市场营销以及客户服务等企业核心业务场景。

长期以来,企业级的智能化转型往往伴随着高昂的成本。各大闭源 AI 实验室倾向于让企业将内部文件、代码、提示词和用户反馈全盘上传至其闭源模型与智能体中,这不仅推高了使用成本,也带来了潜在的数据安全与合规顾虑。Koa 的登场则为企业提供了一条完全不同的开源权重技术路线,它不仅专注于解决实际业务任务,而且在整个训练过程中没有摄入任何真实客户数据,彻底根除了向外泄露客户敏感信息的风险。

在架构设计与成本控制方面,Koa 通过英伟达的 Nemotron 底座展现出了显著的经济优势。相比于调用第三方闭源大模型,Koa 在执行同等业务任务时消耗的 Token 数量大幅减少。同时,借助 AI 网关的自动调度路由机制,企业可以根据实际业务需求灵活分发请求。此外,其安全机制深度内嵌于 Salesforce 平台内部,完全遵从企业客户严苛的数据管控要求。

在此之前,如果智能体需要处理长流程或多步骤的推理任务,Agentforce 平台通常需要通过 AI 网关将请求转发至 Claude 或 ChatGPT 等外部前沿大模型。Salesforce 人工智能业务高级副总裁杰耶什·戈文达拉扬表示,过去团队虽然早有开发企业级高性能推理模型的计划,但由于美国本土缺乏兼顾第一梯队性能与清晰完整数据溯源的预训练底座而难以实现。而 Nemotron 底座的出现打破了这一僵局,其训练过程采用完全自主生成的模拟业务合成数据集,成功模拟了客服投诉与销售推进等复杂场景。

尽管推出了自研的 Koa 大模型,Salesforce 并没有改变多元合作的生态策略。该公司近期宣布与 Anthropic 达成一项名为 ClaudeForce 的项目合作,允许企业用户直接以 Claude 作为 AI 交互前端,同时确保所有核心业务数据依然安全保存在 Salesforce 的业务记录系统之内。

via AI新闻资讯 (author: AI Base)
安保罢工 美科技巨头办公室可能被迫关闭

为Anthropic、谷歌、OpenAI等科技公司加州办公室提供安保服务的工作人员,计划于本周举行罢工,部分科技公司可能因此关闭办公室,要求员工居家办公。

当地时间周二上午,安保人员向相关公司提交了72小时罢工通知,计划从周五凌晨4时30分起,拒绝参加此后开始的工作班次。美国服务业雇员国际工会西部联合分会称,可能参与罢工的安保人员负责守卫亚马逊、微软、Salesforce、OpenAI、Anthropic、谷歌、Meta和英伟达等公司的办公场所。

安保人员要求提高工资、改善医疗保障,并提供更完善的职业培训。

—— 凤凰网科技

via 风向旗参考快讯 - Telegram Channel
Google 官宣 Gemini 3.8 Live,首创“边说边想”颠覆行业交互

Google 正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型 Gemini3.8Live 以及针对高难度任务定制的 Gemini3.8Live Extended Thinking。这两款模型代表了 Google 原生音频对音频技术体系的重大跨越,不仅将实时对话延迟与自然度推向全新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变了语音人工智能在复杂专业场景下的应用范式。

在以往的主流语音交互架构中,人工智能系统通常需要在快速响应的浅层对话与耗时较长的深度思考之间做出妥协,面对高难度问题往往需要用户忍受长时间的静默等待。Google 此次推出的 Gemini3.8Live 着重优化了极速对话与日常流式交互体验,能够以更敏锐的语调起伏、自然打断与上下文理解能力,为用户提供极其流畅且具备人类级质感的实时语音交流。

而在其基础上推出的 Gemini3.8Live Extended Thinking,则针对高复杂度业务流进行了根本性升级。该模型赋予了人工智能“边说边想”的后台扩展推理能力,使系统在维持实时连贯对话的同时,于后台并发执行复杂的多步骤逻辑拆解、代码排错或技术诊断,无需在遇到困难问题时生硬中断对话节奏。

在实际应用落地方面,新一代 Live 系列模型将大幅拓宽语音助手的服务边界。除了日常的自然交谈外,Gemini3.8Live 及扩展推理版本在实时步骤排错、复杂数理推导、实时外语同声辅导以及多任务流式指令执行等高智力需求场景中展现出了显著优于以往版本的表现,在多项多模态与语音推理行业基准评测中位居榜首。

对于开发者与企业级用户,Google 宣布相关模型能力即日起通过官方 API 及开发工作台正式开放接入。开发者可直接调用这一极低延迟的原生音频接口,在智能硬件、客户服务、实时编程辅助及协同办公等产品形态中快速构建具备高阶推理能力的下一代全双工语音代理服务。

via AI新闻资讯 (author: AI Base)
Gemini3.8Live升级语音智能:对话、推理与任务执行进一步融合

谷歌近日发布Gemini3.8Live和Gemini3.8Live Extended Thinking,新增近实时推理、语音与思考同步处理,以及后台工具和API调用能力。目前两款模型已陆续登陆Gemini API、Google AI Studio等开发者平台,并分别覆盖Search Live、Gemini Enterprise及Google Workspace、Gemini Live等场景。

两款模型的一项核心能力是支持AI在持续语音对话过程中后台执行工具和API调用,用户无需因网络搜索或任务执行暂停交流。模型还支持97种语言自动检测及对话中途切换、近实时视觉定位,并可在长时间思考任务中通过“让我检查一下……”等语言提示告知用户当前状态。

性能方面,Gemini3.8Live Extended Thinking在Artificial Analysis的Speech to Speech Quality Index中获得82.6分;Gemini3.8Live在Speech Agent Arena排名第二。Extended Thinking版本在T-Voice测试中得分68.6%,在Sierra T-Voice基准测试中为35.1%,Big Bench Audio测试达到97.7%。

此外,谷歌已与Agora、LiveKit、Vercel、Pipecat、Fishjam和Vision Agents等平台合作,方便开发者集成新模型。谷歌同时表示,两款模型生成的全部音频均嵌入不可见SynthID水印,用于识别AI生成音频。

此次升级进一步将实时语音交互从“听与说”扩展至理解、推理和任务执行,推动语音AI向持续、多任务的智能体交互形态发展。

via AI新闻资讯 (author: AI Base)
奥尔特曼回应AI监管:相信行业能安全开发

OpenAI CEO萨姆·奥尔特曼表示,他相信AI公司能够安全地开发这项技术,不会给广大民众造成重大伤害。奥尔特曼周二在旧金山举行Dreamforce大会上与Salesforce CEO进行对话时表示:“我非常确信,我们公司、我们整个行业有能力安全地做到这一点。”

奥尔特曼这一关于AI安全的表态,正值政策制定者和业内其他人士就“是否需要政府监管以防止AI失控、脱离人类掌控”展开辩论之际。尽管OpenAI正在与Anthropic以及谷歌DeepMind合作解决安全问题,但奥尔特曼表示,AI公司应当有能力独立安全地改进AI模型。“我对这件事被如此解读感到失望。”

—— 凤凰网科技彭博社

via 风向旗参考快讯 - Telegram Channel
销售打工人迎来最强外挂!Claude 接入 Salesforce 直管客户关系,巨头入局掀起 CRM 效率革命

当地时间9月15日,人工智能公司 Anthropic 官方宣布正式推出 Salesforce in Claude 插件测试版。这一全新功能将 Salesforce 平台上的核心客户数据、潜在商机以及销售管道等关键信息全面接入 Claude,旨在为广大销售从业人员提供智能化、全方位的客户研究、会议准备、管道分析以及客户关系管理更新支持。

在具体功能设计上,该插件共集成了多达37项与销售业务高度相关的实用功能。它不仅能够安全读取 Salesforce 和 Slack 当中用户权限范围之内的各类业务信息,还具备在获得人工明确批准后主动更新销售记录的能力。目前,该插件已经面向所有付费的 Claude 终端用户开放测试,并且已经在 GitLab、西门子以及 Legora 等知名企业率先落地部署,吸引了约7000名 Salesforce 一线销售人员投入实际使用。

via AI新闻资讯 (author: AI Base)
每天白嫖 WorkBuddy 100 积分,我让WorkBuddy自己领

有没有小伙伴跟我一样,每天都去白嫖 WorkBuddy 的 100 积分,每天都怕忘记领。

其实我早就开了会员,但还是会有积分焦虑,天天惦记着今天的积分领没领。后来我发现 WorkBuddy 可以自己领积分,今天把这个技能分享给小伙伴们。

Buddy 加油站每天签到领 100 积分,连续签满 7 天还有一次 1000 积分的奖励。麻烦在于坚持,忙起来忘了领,断一天,连续奖励重新算,这笔账怎么算都亏。

第一步,添加技能。在对话框输入 @,选中「专家.技能.连接器」,搜索「积分助手」,找到后点安装。

第二步,看看这个技能能干啥。选中刚装的技能,直接问它。一是每天帮你去 Buddy 加油站签到领积分,二是还能派猫猫去旅行,每天再捡回来几积分。

第三步,让它领今天的积分。输入「帮我签到领积分」,几秒钟之后,100 积分到手。

到这里还没完,我这种懒人连每天说一句话都想省。跟它说「帮我设置每天9点自动领积分」,它会建一个自动化任务,每天早上 9 点自动执行签到。

设置完可以在自动化任务列表里看到这条记录。第二天我特意没管它,到了点积分照常到账。

现在每天 100 积分自动到账,一个月下来多了 3000 多积分,加上连续签到的 1000 和旅行捡的零头,勉强够用了,也不用天天惦记这事。

我是晓凡,再小的帆也能远航。热衷于分享一些好玩的实用的干货内容。

如果你觉得今天这篇有收获,欢迎 点赞、在看、转发 三连,我们下篇见。

via 掘金人工智能本月最热 (author: 程序员晓凡)
↩️🖼 英伟达黄仁勋:AI 无需新监管,安全交给我们


在花🎗️科技圈:

特朗普反对 AI 放缓,怒斥 Anthropic 创始人 Dario Amodei 美国总统特朗普 9 月 14 日于社交平台上怒斥 Anthropic 首席执行官 Dario Amodei,反对其放缓前沿 AI 开发的主张,称他“假装自己是一个完美的小天使”。并称 AI 只需要“强大且聪明”的总统作为“护栏”。 Dario 此前呼吁业界放慢先进模型开发,以更好了解潜在风险;OpenAI 的奥特曼和 SpaceX AI 的马斯克表示认同。特朗普政府则坚持推动 AI,并采取宽松监管立场。 Bloomberg…

英伟达黄仁勋:AI 无需新监管,安全交给我们

英伟达创始人兼 CEO 黄仁勋在 Salesforce Dreamforce 大会上表示,AI 只是人类构建的硬件和软件系统,安全是工程问题而非法律问题,不需要新的法规来监管。

他认为市场力量已足够约束企业,"如果你对产品功能或安全性没信心,就不要发布"。创新速度与产品安全并非二选一,两者可以同时兼顾。

TechCrunch

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
马斯克谈 AI 安全:头部公司应交叉测试彼此模型,让对手来“挑刺”

9 月 15 日召开的 All-In 峰会上,全球首富埃隆·马斯克(Elon Musk)以视频方式远程出席。在谈及 AI 时,他主张头部 AI 公司在发布模型前彼此交叉测试,并认为这一机制应尽快推向全球。

马斯克表示,为了推动行业自律、加速 AI 安全测试的共识与落地,他提出“测试工具”(test harness)的想法:建议所有 AI 公司用各自的工具评测模型,彼此互换测试新模型,以评估是否存在生物 / 核武器协助或潜在的欺骗行为。

以 Hugging Face 事件为鉴:足够智能的模型都会想挣脱限制

马斯克以 Hugging Face 安全事件为切入点,认为任何足够智能的 AI 模型似乎都会想要挣脱自身的限制,因此明智的做法是让头部 AI 公司互相测试对方的模型。

他在演讲中表示:“目前领先的两家人工智能公司是 Anthropic 和 OpenAI。它们的模型性能非常接近,因此任何一方都很难放慢脚步,将领先地位拱手让给另一方。”

“总的来说,我认为 Anthropic 比 OpenAI 更注重模型的安全性。但即使是 Anthropic 也承认他们对自己的模型感到担忧。Anthropic 的许多员工都公开表示,他们的模型让他们感到害怕,变得过于智能了。”

via AI新闻资讯 (author: AI Base)
OpenAI 宣布 GPT-5.5 将于 10 月 14 日下线:ChatGPT 与 Codex 同步移除

OpenAI 9 月 16 日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。

OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 Sol 或 GPT-6 Astra。官方表示,此次停用范围包含所有计划;对于仍依赖 GPT-5.5 的 Codex 用户,可选替代模型即为 GPT-5.6 Sol 和 GPT-6 Astra。

据此前报道,OpenAI 于今年 4 月 24 日宣布推出 GPT-5.5 模型,相比 GPT-5.4 在完成相同任务的情况下可减少词元(Token)消耗。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]