直近7日の AI エージェントの実績。何をどれだけこなし、どこで失敗したかを見て、 次に足すべきルール/プロンプトを決める。改善はAIの前提(Context)で。
直近の失敗・低評価ランと既存ルールから、足すべき常設ルールを提案(押した時だけ生成=コストは都度のみ)。
| エージェント | 実行 | 失敗 | トークン | 評価 |
|---|---|---|---|---|
| Mira | 3 | 0 | 51,000 | — |
| Dario | 3 | 0 | 52,500 | — |
| Felix | 3 | 0 | 106,500 | — |
| Owen | 3 | 1 | 72,000 | — |
| Sora | 2 | 1 | 42,000 | — |
| Lena | 2 | 0 | 57,000 | — |
| Nova | 2 | 0 | 48,000 | — |
| Atlas | 2 | 0 | 49,500 | — |
| Iris | 2 | 1 | 51,000 | — |
気づきは Context で常設ルール化=次ランから全エージェントが守る。