Command Code AI登顶Composio基准测试,被誉为“GOAT”
Command Code AI在Composio知识工作基准测试中表现出色,在DeepSeek等开源模型上击败其他框架,以18/30任务完成率和最快平均用时位居前列。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code AI在Composio知识工作基准测试中表现出色,在DeepSeek等开源模型上击败其他框架,以18/30任务完成率和最快平均用时位居前列。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel