https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
近日,一段波场TRON创始人孙宇晨评价小米的视频再度被翻出,引发热议。视频中孙宇晨对小米集团及创始人雷军的战略布局发表了个人看法,核心观点是建议雷军“别卷汽车了,应该去卷机器人”。孙宇晨在视频中认为,小米进军汽车制造业有些后知后觉。他分析称雷军早期投资策略与腾讯相似,后来因为汽车估值过高而决定亲自下场造车。
对于小米汽车本身,孙宇晨承认配置不错,但认为21万元左右的定价对目标群体而言太贵了。
相比之下,孙宇晨更看好小米在机器人领域的发展潜力。他直言雷军应该把精力放在机器人赛道,认为小米的机器人加大模型组合,潜能远超其汽车业务。
他给出的理由是,小米从造车转向机器人领域不仅能“把那些初创公司卷哭了”,还可能更快迎来如ChatGPT般的“wow时刻”。
孙宇晨建议雷军应优先利用小米在生活家电领域的优势,先把炒菜机器人、生活家电全部卷完。他认为机器人也快到wow的时刻了,原来感觉不出来,但现在人工智能加上机器人太炸裂了。
值得注意的是,孙宇晨本人曾在社交媒体高调展示小米机器狗,重金押注小米生态产品。
机器人方面,小米CyberOne人形机器人持续迭代,2026年世界机器人大会上展示了新一代产品,小米在北京亦庄建设了机器人产线,推进人形机器人进工厂实训。
全球“物理AI”概念在2026年全面爆发,英伟达、特斯拉等巨头纷纷加码人形机器人赛道,马斯克多次强调特斯拉Optimus的量产计划。
有网友评价称:“虽然割韭菜也够狠,但是不得不承认是个奇才”。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:快科技)
#Tip #Codex
OpenAI 为 Codex 设计了全新的上下文管理方法,区别于先前的每触及限制就压缩一次,新方法允许模型在会话中进行检索,以减少细节丢失。
在 Codex 中启用该功能,请编辑 config.toml 文件并添加:
via AI Copilot - Telegram Channel
OpenAI 为 Codex 设计了全新的上下文管理方法,区别于先前的每触及限制就压缩一次,新方法允许模型在会话中进行检索,以减少细节丢失。
在 Codex 中启用该功能,请编辑 config.toml 文件并添加:
[features]
context_management.experimental_mode = truevia AI Copilot - Telegram Channel
又有两家新闻机构起诉 OpenAI 和微软,指控他们利用其新闻报道训练人工智能。《西雅图时报》和《新闻日报》提起诉讼,称随着人工智能的出现,新闻业可能会“彻底崩溃”。诉讼将生成式人工智能比作“一条吞噬自己尾巴的蛇”,它可能会“摧毁”那些生产其训练内容的机构。
诉讼称:“像 ChatGPT 和 CoPilot 这样的 AI 产品被吹捧为内容生产者,但实际上它们是贪婪的消费者,吞噬人类创作的内容,并将它们消费的原始内容的副本和衍生模仿品带回世界,以实现其商业目标。”
早在2023年,《纽约时报》就曾起诉OpenAI及其合作伙伴/投资方微软,指控其侵犯版权;随着案件的进展,其他媒体也纷纷效仿。《西雅图时报》的诉讼尤其引人注目,因为微软和OpenAI曾资助过该机构的一些新闻项目和奖学金。
微软发言人告诉 GeekWire,该公司对这起诉讼感到“惊讶”,但“始终乐于坐下来探讨解决此类纠纷的方案”。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:BiaNews鞭牛士)
📦 CommerceAgentBench 是让 Agent 像一个真实的电商运营助理一样,处理多达 300 封邮件的采购收件箱,识别供应商、整理报价、处理各种贸易术语,甚至还要发现潜在的欺诈行为,最后还得完成供应商选择和日历事件创建等等一系列真实工作流
📊 Accio 开源的 CommerceAgentBench,据他们说,这 107 项任务是从全球 1000 万中小企业用户的真实需求中提炼出来的。即使是当前最强的 Claude Opus 5,也只能完成 61.7% 的任务。这让我不禁思考,我们离一个能完全自主的“商业 Agent”还有多远?
🔗 这个有趣的项目已经在 GitHub 上开源了,团队也邀请大家一起贡献新的模拟环境:github.com/Accio/CommerceAgentBench · 原推
📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!
via Roller | DeepSeek Harness 中文社区 - Telegram Channel
OpenAI 发布 Astra 后多次改动评测数据,幻觉率先降后恢复
OpenAI 9 月 3 日发布 GPT-6 Astra 博客时出现罕见延迟,此后多次修改评测基准。Astra 幻觉率一度从 4.2% 降至 2%,随后又恢复 4.2%。
GPT-5.6 Sol 的 ExploitBench 得分从 5.5% 上调至 11.5%,Anthropic 的 Fable 5.1 数学分数一度被调低约 10 个百分点。OpenAI 称调整是为了让数字代表对模型性能的最佳估计。
Fortune
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
OpenAI 9 月 3 日发布 GPT-6 Astra 博客时出现罕见延迟,此后多次修改评测基准。Astra 幻觉率一度从 4.2% 降至 2%,随后又恢复 4.2%。
GPT-5.6 Sol 的 ExploitBench 得分从 5.5% 上调至 11.5%,Anthropic 的 Fable 5.1 数学分数一度被调低约 10 个百分点。OpenAI 称调整是为了让数字代表对模型性能的最佳估计。
Fortune
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel