← 返回快讯

快讯事件 · 1 条来源

作者分享个人 Agent 团队实践:自建编排器驱动约8个专职 Bot 协同工作

omarsar0

作者称自己低估了 Opus 5.5 等模型的智能体协调能力,并回顾了约一年内个人设置的演进:从单独 Claude Code 会话,到子代理并行工作的多智能体系统,再到两个月前搭建的类似 Grok Bot 的持久化 Agent 团队——通过自有编排器管理约8个专职 Bot(CFO、CSO、CTO、CMO、CCO、CoS 等),一个月前又开始尝试带个人 Agent 的 agent-to-agent 通信。作者表示仍需在自动化、Webhook、系统提示词和工具等方面调优,并认为 Code、Claude Desktop 等应用“远远落后”但终会赶上,建议自建编排器。以上均为作者个人陈述,未经独立核实。

全部来源

前后事件

相关事件

Tinker下调长上下文价格最高70%,GLM-5.3-Flash与DeepSeek-v4.1-Flash上线

Tinker表示已将效率提升带来的成本节约转为用户降价,长上下文RL相关价格下调最高70%,长上下文prefill与采样现价与短上下文相同;GLM-5.3-Flash和DeepSeek-v4.1-Flash也已上线,面向高性价比长上下文任务。发帖者omarsar0评论称,这将降低agentic RL中长rollout的token成本,使专门化模型更实用。

omarsar0共 1 条来源

StepFun推出Step 5 Preview,上线次日登顶OpenRouter热门榜首

Step 5 Preview发布次日登上OpenRouter Trending榜首,已接入Kilo Code、Cline、Hermes Agent和OpenCode。omarsar0实测称其能自我检查、任务完成后停止,适合长时间自主运行的工程任务;模型为600B总参数、每token激活27B的稀疏MoE,上下文窗口达1M tokens,开放权重将于10月15日放出。

omarsar0共 1 条来源

Meta超级智能实验室提出"智能体可塑性":按每美元学习收益衡量自我改进模型

Meta Superintelligence Labs的研究人员提出"agent plasticity"指标,在模型权重冻结、每次运行从全新上下文开始的条件下,衡量智能体在留出任务上每美元学习投入的得分增益。研究发现,表现最好的模型往往与学习效率最高的模型不同:在国际象棋、围棋和Hex中,Claude Fable 5取得最高最终得分,而GPT-5.6 Sol的单位美元增益最大;在NetHack中,仅Claude Opus 5.5显著提升66个归一化点,学习成本约1073美元。研究还发现,学习较慢的智能体常忽略自己已写下的产物,而学习更快的智能体会复用这些产物,但产物质量低时仍会失败。

omarsar0共 1 条来源