← 返回

NEWS · 快讯

标签:Claude Code

查看带有该精确标签的快讯。

订阅此筛选 RSS

共 3 条快讯 · 门户最近更新

研究称 agent 框架差异主要源于 token 消耗:精简提示词与工具最高可省 3 倍成本

作者称在 SWE-bench Verified 上用同一模型运行 Claude Code、mini-SWE-agent 和 OpenCode:Claude Code 与 mini-SWE-agent 在 447 个任务上得分相差 5 分以内,高难度 45 任务子集上各有 13% 结果翻转。成本差异来自每步重复发送的系统提示词与工具 schema,作者建议精简两者,称可在不降准确率的前提下将成本削减最高 3 倍。

dair_ai查看原文 ↗

研究:模型不变时,agent harness 可带来最高 3 倍成本差异

作者称在 SWE-bench Verified 上用同一模型运行了 Claude Code、mini-SWE-agent 和 OpenCode:前两者在 447 个任务上得分相差不超过 5 分,更换 harness 的影响约等于重跑一次(45 题困难子集上各有 13% 结果翻转)。成本差异主要来自每一步重复发送的 system prompt 和 tool schema;精简 harness 提示词和工具可在不降低准确率的情况下最多降本 3 倍。

omarsar0查看原文 ↗

作者分享个人 Agent 团队实践:自建编排器驱动约8个专职 Bot 协同工作

作者称自己低估了 Opus 5.5 等模型的智能体协调能力,并回顾了约一年内个人设置的演进:从单独 Claude Code 会话,到子代理并行工作的多智能体系统,再到两个月前搭建的类似 Grok Bot 的持久化 Agent 团队——通过自有编排器管理约8个专职 Bot(CFO、CSO、CTO、CMO、CCO、CoS 等),一个月前又开始尝试带个人 Agent 的 agent-to-agent 通信。作者表示仍需在自动化、Webhook、系统提示词和工具等方面调优,并认为 Code、Claude Desktop 等应用“远远落后”但终会赶上,建议自建编排器。以上均为作者个人陈述,未经独立核实。

omarsar0查看原文 ↗

#Claude Code · AI快讯 · Portal