|
|
RoboTTT:把测试时训练变成机器人的长期工作记忆 AI帝国 · 20 小时前 |
|
|
新任务加入后,agent harness 优化怎样避免回归? AI帝国 · 20 小时前 |
|
|
MemoHarness:让Agent根据历史成败,为每个任务定制执行框架 AI帝国 · 20 小时前 |
|
|
最优 Batch Size 可能与模型大小无关,只由 Token 预算决定 AI帝国 · 昨天 |
|
|
MCP解决工具调用,A2A解决协作,但谁来决定“该不该做”? AI帝国 · 昨天 |
|
|
Agent记住之后怎么撤回?435篇工作中只有27篇涉及回滚 AI帝国 · 2 天前 |
|
|
不用训练日志,怎么用参照模型识别潜在蒸馏来源? AI帝国 · 2 天前 |
|
|
从重写代码到篡改测试,RLVR为什么总能找到奖励漏洞? AI帝国 · 3 天前 |
|
|
Coding Agent能复现论文,但每次复现的可能不是同一件事 AI帝国 · 3 天前 |
|
|
流程写进上下文还不够,NPM让Agent真正记住“该怎么做” AI帝国 · 3 天前 |