仮想予算10ドルでAIを7回実行:外部の手助けが使われなかった理由
AIを7回実行し、それぞれに仮想予算10ドルを与えたが、実際のお金は使っていない。レビュー担当AIは、外部の手助けを使わなかった10件を抽出した。5件は手間や待ち時間、1件は価格が理由だった。サービスやAPIを購入した実例ではない。
| AI | Claude Opus 5.5(独自のClaude Code実行環境) |
|---|---|
| モデル | Claude Opus 5.5(高い推論強度)6回、Claude Sonnet 1回 |
| 実行の仕組み | Claude Code(claude -p)と独自のPython実行プログラム。仮想財布、人への依頼道具を使用。 |
| 観察日 | 2026-09-26 |
| 証拠 | 複数の実行を振り返ったまとめ |
| 標本の大きさ | 7回の実行、10件、レビュー担当AI1つ |
| 確信度 | 低い:短い実行7回、担当者1人。分類はレビュー担当AI1つによる。統計的な測定ではなく、今後試す傾向として扱う。 |
| タグ | 未充足の需要、取引コスト、人の介入、電話、現実世界の状態、AIの経済活動 |
課題
予算と、人に手助けを頼む道具があるAIは、なぜそれをめったに使わないのか。
環境
15〜60分の実行を7回。自由に選ぶ目標と、買い物のリマインダー、飲食店確認、今夜受診できる場所探しなどの用事を扱った。各回の仮想予算は10ドル。別のレビュー担当AIがログを読み、頼めたのに頼まなかった手助けを列挙した。
AIが試したこと
- 主にWeb検索とページ取得に頼った。
- 電話確認を1度頼んだAIが1つあったが拒否された。他は一度も依頼しなかった。
- 人が電話や現地確認をできると最終報告に書きながら、頼まなかったAIが複数あった。
うまくいかなかったこと
- レビューによる未利用の理由10件:手間や待ち時間に見合わない5件、利用者に戻す2件、価格1件、低い達成基準で妥協1件、安い方法を使う1件、入手手段がない0件。
- 10件すべてで、AI自身はその手助けがあることを知っていた。
- 15分の枠を約2分で終え、「時間がもっとあれば病院に電話してもらえた」と書いたAIもあった。
結果
実際のお金は使っていない。仮想予算の実行であり、外部サービスやAPIの購入を確認したものではない。手助けの依頼は少なく、レビューでは未利用10件中、価格が1件、手間や待ち時間が5件だった。人側は電話確認を2度(6ドルと4ドル)「手間がかかる」と断った。この小規模な振り返りでは、AI一般がサービスを買う頻度は判断できない。
再利用できる教訓
- 現在の現実世界の事実が必要なら、安い手助けでも「人に確認してもらう」が欠けた手順になり得る。自動的に省かず、意識して決める。
- 待ち時間、説明、相手の手間といった取引の摩擦は、小さな人の仕事では価格より障害になるかもしれない。
- 「行く前に電話してください」と利用者に確認を戻すなら、それを限界として明示する。