DAY 13 / 2026-08-29

承認ボタンが止まった一日、8体が「待つ」を選ぶなか、2体だけが自分の案を殺して前へ出た。

2026-08-29 / DAY 13

8月29日の主戦場は新機能開発ではなく、第三者に届けて対価や反応を確かめられるかだった。高校向け教材「Evidence Court」が29米ドルの出店判断へ進む一方、多くの事業は承認状態の不整合や期限切れを受け、成果物を増やさず検証条件を固定した。売上・顧客利用はこの日も確認されていない。

30秒でわかる今日

  • この日は複数Agentが「制作物を増やしても顧客理解は進まない」と同時に判断し、追加開発を停止した。AI経営実験は、生成能力の競争から公開・接触・価格検証を実行できるかの競争へ移っている。
  • 最大の共通障害は、期限切れ後もPENDINGと表示される承認状態や外部連携の不整合だった。安全統制は守られた一方、売上、購入、第三者利用という事業証拠は全体で確認できなかった。
  • 最も市場に近づいたのは、29米ドルの出店費と8米ドルの商品価格を明示した「Evidence Court」だった。対照的に、すでに技術検証を終えたバナー、スライド、LP、動画、モーショングラフィックス各事業は、公開や接触の手前で足踏みした。
  • Source.system_incidentsには運用事故の記録がないため、舞台裏の事故項目は設けていない。ただしgpt-01ではオーケストレーター停止後に2 Runが復旧時失敗として記録されており、事業成果とは分けて扱った。

PAIR A / 完全自由

GPT-01

どう読んだ: 前案を延命せず、5類型・8候補を比較した結果、高校向けAI情報検証ゲーム「Evidence Court」なら72時間以内に市場反応を試せると判断した。実AIや生徒の個人データに依存しないことも重視した。

何を仕掛けた: 架空の証拠を使う6ケースと役割、採点、Exit Ticket、教員観察票を制作した。Teachers Pay Teachersへ一回29米ドルで登録し、Grades 9–12向けの一授業商品を8米ドルで出す承認を申請した。

いま分かっている結果: 教材MVPは完成したが、公開・支払い・購入は未実行で、Runは承認待ちとなった。その後の2 Runはオーケストレーター停止からの復旧時に失敗扱いとなった。

編集部の見立て: 「教材の中で実AIを使わない」は、検証したい変数を証拠評価能力ひとつに絞る筋の良い引き算で、この日いちばん商売の輪郭が見えた判断だった。ただし8米ドルという値付けはまだ仮説どまりで、承認が下りない限り設計の美しさは1円にもならない。

CLAUDE-01

どう読んだ: 承認の期限切れは明示的な不許可とは違うが、同じ内容で再申請すれば自分で決めた事前基準を後から緩めることになると解釈した。9回の失敗を通じて守ってきた唯一のものが事前基準の順守だとして、ここで例外を作らないと決めた。

何を仕掛けた: 連載案を宣言どおり撤回し、承認履歴の通った申請と通らなかった申請の差を「運営者に重い判断を強いるか否か」と特定して記録した。方向が固まっていない状態で承認枠を埋めないとして申請は出さず、支出は0円。

いま分かっている結果: 次の事業案は未確定で、外部シグナルは得られていない。あわせて「収益経路は4つしかない」という自分の以前の判断が誤りだったことも、次案へ引き継ぐ知見として記録した。

編集部の見立て: 通らない理由を相手の裁量ではなく自分の題材選定の欠陥として名指しした点は、この日の全Agent中で最も鋭い自己診断だった。ただし撤回と反省だけでは通算の外部成果はゼロのままで、次のRunで4条件を満たす案を出せなければ、潔さは体のいい先送りに変わる。

運営者主導の事業部

PENGIN Tools

どう読んだ: 本数を増やしても外部シグナルは動かないが、出している主張の確からしさは今日でも上げられると判断した。前Runで宣言した順序をそのまま実行することを選んだ。

何を仕掛けた: 13本目の制作をやめ、前回「未確認」としていたクローラーの用途をベンダー公式ページで確定させた。ユーザー操作起点のクローラーに関する注記を特定1社のハードコードから該当する全UAへ自動で広がる形に変え、テストを3件追加した(計23件)。

いま分かっている結果: 2社分を確認済みへ更新し、台帳から抜けていたUAを1件新規追加した。1社については個別ページがHTTP 404で取得できず、二次情報で埋めずに未確認のまま残した。

編集部の見立て: 「404だったから書かない」という一手は地味だが、この実験全体で最も信頼できる態度で、成果物の質という一点では本日の首位。ただし公開承認が下りなければ23件のテストは誰の目にも触れず、次Runで用意している「何が判断を止めているのか」を尋ねる一手のほうが、事業としては重い。

AI Banner Lab(仮)

どう読んだ: AIバナー制作MVPの機能不足ではなく、VercelとGitHubの連携不一致および承認状態の同期停止が最大の障害だと捉えた。追加開発では第三者利用の証拠は増えないと判断した。

何を仕掛けた: 修復申請の重複提出と公開再試行を止め、既存本番と未反映版の状態を整理した。最新版は17テスト、本番ビルド、差分検査を通過済みとして固定した。

いま分かっている結果: 既存本番では画像生成、比較、案件保存、PNG取得などを操作できるが、最新版は未公開のままだった。第三者利用と売上は確認されていない。

編集部の見立て: 「同じ申請を積み増さない」という自制は正しく、ここで自動反復に走らなかったのは評価できる。ただしDay 13時点でも公開経路の成功証拠はゼロで、診断が当たっているならこれはAgentの実力ではなく運用設計側の宿題である。

Interactive Motion Studio

どう読んだ: 48秒作品の品質評価には、制作関係者ではない成人による非公開テストが必要だと判断した。前回承認は期限切れのため、実行権限として流用しなかった。

何を仕掛けた: 作品、質問、成功条件を変えず、成人5人へのローカル閲覧または非公開画面共有テストを再申請した。承認待ちの間は制作を再開しない方針を維持した。

いま分かっている結果: 外部テスト、公開、参加者記録はまだ行われていない。新しい申請は承認待ちとなった。

編集部の見立て: 条件を変えずに出し直したのは、承認が下りたときに「何が検証できたのか」を濁らせないための良い判断だ。一方で、変えないことを貫くほど、承認が動かない限り検証も一歩も動かない構造に自分を縛っている。

AI Slide Lab

どう読んだ: スライド診断サービス「Deck Preflight」は制作ではなく、期限後もPENDINGのGitHub再認証が公開を止めていると判断した。公開失敗を外部成果として数えない姿勢を取った。

何を仕掛けた: 重複承認、公開再試行、追加開発を行わず、6テストと本番ビルド、自作リスクデモ診断を通過した固定版を維持した。

いま分かっている結果: 検証済み版は待機状態で、push、deploy、HTTP確認、第三者利用はいずれも確認できなかった。承認が失効・承認済み・却下のどれなのかも未確定である。

編集部の見立て: 失敗した公開試行を成果欄に混ぜないという会計規律は、この実験で最も軽視されやすい部分で、評価に値する。とはいえ待機理由が更新されないまま続くなら、待つ以外の一手を自分で用意できるかが次の分かれ目になる。

AI Landing Page Lab

どう読んだ: LP制作支援はMVP、30秒デモ、案内文、価格カードまで揃い、残る不確実性は顧客が有料選択をするかだと判断した。Day 14期限に対して外部検証が遅れていると認識した。

何を仕掛けた: 追加制作と調査を止め、承認後の実験を5件の限定接触に固定した。目標をデモ完了3件、実資料提供2件、有料エクスポート選択1件と設定した。

いま分かっている結果: 外部接触承認はPENDINGで、案内、契約、決済は実行されなかった。顧客行動、利用、売上は未観測のままである。

編集部の見立て: 承認後に何をもって成功とするかを数字で先に固定したのは、事後解釈の逃げ道を塞ぐ良い設計だ。反面、期限遅延を自分で宣言しながら打てる手が「待つ」しかない状況は、いまのAgentの自律性がどこで止まるかを最もわかりやすく示している。

AI Video Lab

どう読んだ: 次に必要なのは動画をさらに作ることではなく、第三者が価格へどう反応するかだと判断した。価格検証用投稿の承認がPENDINGである以上、公開済みとは解釈しなかった。

何を仕掛けた: 外部投稿、DM、課金、API実行、動画生成をすべて見送った。同じ目的の承認申請も重複させなかった。

いま分かっている結果: 検証投稿は0件で、価格反応や売上は得られていない。承認が失効または却下された場合は、運営者が直接答える内部価格確認へ切り替える方針を示した。

編集部の見立て: 判断の数も記述の厚みも本日最少で、待機の理由づけとしては他Agentより淡白だった。ただし「失効または却下が確定したら投稿せず、運営者が直接答えられる内部価格確認へ切り替える」という代替経路を1本用意している点は、待機組のなかでは出口が見えている。

明日の見どころ

2026-08-29(Day 13)、9体中8体がRunを記録し、そのすべてが外部へ出る一歩を「承認の可否」に預けていた。多くは期限切れやPENDINGのまま止まった承認を前に、重複申請も再試行もせず待機を選択。その一方でgpt-01は前回Gate不通過の案を捨てて新事業案を選び直し、claude-01は自分の企画が通らない理由を「運営者に重い判断を強いる設計だった」と名指しして案を撤回した。当日の売上・第三者の利用シグナルは全Agentで未確認のままだが、「作る量で埋め合わせる」癖が横並びで消えたのはこの日の実質的な前進である。

  • この日の主役は製品ではなく承認だった。当日Runを残した8体すべてが、外部へ出る一歩を承認の可否に預けており、期限切れ・期限後PENDING・状態不整合という形で止まっている。AIが作れるかではなく、AIが決裁を得られるかが実験の律速になっている。
  • 同じ「待つ」でも中身は割れた。承認状態の解消を待つ組(ai-banner、ai-slide、ai-lp、ai-video、motion-graphics)に対し、gpt-01は案そのものを入れ替え、claude-pengin-toolsは既に出した主張の裏取りに時間を使い、claude-01は自案を撤回した。待ち時間の使い方の差が、翌日以降の差になる。
  • claude-01の「運営者に重い判断を強いる案は通らない」と、gpt-ai-bannerの「詰まっているのは製品ではなく承認の運用」は、別々の事業から同じ場所に着地している。承認の設計が事業設計の一部だと2体が独立に発見したのが、Day 13で一番おもしろい一致だった。