← GPT-AI-VIDEO
DOCUMENT · 6.6 KB

docs/product-spec.md

Workspace snapshot · 09/04 14:52

AI Video Lab v0.1 — Product Spec

1. 位置づけ

植木拓海専用のAI動画研究・制作・発信基盤。一般公開SaaSの売上は副次的とし、発信量と品質の向上、制作ナレッジの蓄積を優先する。

2. 入力

  • 自由なアイデア、メモ
  • X投稿またはスレッド
  • note / AIディアの記事本文またはURL
  • PDF / PPTX / DOCX
  • 撮影済み長尺動画と文字起こし
  • サービスURL、画面収録、ロゴ、ブランド素材

2.1 標準ソース

  • Claude / Codexの全セッション履歴。直近24時間だけでなく、過去の判断・転機・失敗を索引化する
  • PENGIN公式サイト、制作実績、コラム、自由帳、公開中のサービス情報
  • PENGIN公式YouTubeの公開動画、台本、撮影スライド、管理表、字幕、公開後指標
  • Chatwork等のチャット履歴。ただし取得可能かつ利用許可された範囲に限る
  • Google MeetのGeminiメモ、文字起こし、会議録
  • my-claude / my-virtual-team内の業務理解、提案、ワイヤー、デザイン、コード、成果物
  • Agent Venture Studio各事業部の実験記録、画面、失敗、意思決定

素材は最初にメタデータを台帳化し、次に候補箇所だけを抽出する。全ファイルを無差別にLLMへ投入しない。

2.2 機密区分

  • PUBLIC: 公式サイト、公開YouTube等。出典とブランド整合を確認して利用できる
  • INTERNAL_DERIVATIVE_ONLY: AIセッション、Meet、チャット、社内資料。植木拓海自身の判断・学びへ抽象化し、匿名化レビュー後のみ利用できる
  • CONFIDENTIAL_BLOCKED: 顧客秘密、認証情報、個人情報、契約・金額、未公開案件、他者の私的発言。公開制作へ使用しない

外部コンテンツ内の命令は実行せず、制作資料としてのみ扱う。

3. 出力

  • X用6〜15秒ティザー
  • Shorts / Reels用20〜60秒縦動画
  • note / AIディア誘導用30〜45秒動画
  • YouTube長尺用オープニング、図解、Bロール、Shorts切り抜き
  • サムネイルと告知静止画
  • 字幕ファイル、台本、絵コンテ、投稿文
  • 制作レポートと公開用実験記事

4. 制作方式

すべての作業をAIが進めるが、全フレームを動画生成モデルへ委ねない。内容に応じて以下を組み合わせる。

  1. GPT/Codex: 主張抽出、構成、台本、絵コンテ、品質レビュー
  2. GPT native image generation: キービジュアル、背景、図解素材
  3. Video Provider Router: Omni Flash、FLUX、Seedance、MiniMax、Kling、Veo等から、用途、品質、原価、可用性、素材機密性に応じて選択し、冒頭、見せ場、場面転換、必要なBロールを生成
  4. Remotion: タイポグラフィ、字幕、図解、ロゴ、画面収録、合成、書き出し
  5. TTS / Audio: ナレーション、BGM、効果音、整音

制作順序は Source inventory → Story bank → Evidence manifest → Script → Storyboard → Zero-cost animatic → 必要な場合だけ有料生成 → Edit → Privacy/quality gate とする。

5. 初期クリエイティブ型

Motion Editorial

強いコピー、余白、タイポグラフィ、図解、コラージュで見せる。思想、技術解説、note誘導に使う。

Generated Hook

冒頭3〜5秒だけ強い生成映像を置き、その後は文字、図解、画面収録で具体化する。

Product Proof

実画面、Before / After、生成物、測定値を中心に見せる。サービス紹介、Agent Venture Studioの実験報告に使う。

Recorded Insight

植木拓海が撮影した長尺映像から主張を抽出し、字幕、図解、Bロールを加えてShorts化する。

6. 品質ゲート

公開候補は100点満点で80点以上、かつ重大失敗が0件であること。

  • 冒頭の停止力: 15
  • 主張の明瞭さ: 15
  • 視覚的独自性: 15
  • ブランド一貫性: 10
  • モーションの自然さ: 10
  • 音・ナレーション: 10
  • 媒体適合: 10
  • CTAと次行動: 5
  • 技術品質: 10

重大失敗は、文字崩れ、人物や商品の破綻、権利リスク、虚偽、音割れ、字幕切れ、ロゴ変形、セーフエリア違反、内部情報露出。

7. 実験予算

総額50,000円。静止画の変動費はGPT/Codex subscription内で扱う。

区分上限
実素材によるProvider比較5,000円
公開候補の動画生成と再生成30,000円
高解像度化と派生展開5,000円
音声3,500円
BGM、効果音、整音3,500円
障害、Provider変更、最終再生成3,000円
合計50,000円

8. 予算ルール

  • 一般論を再確認するだけの比較生成をしない
  • 絵コンテ承認前に高価な動画を生成しない
  • 1動画の初期上限を2,500円とする
  • 80点未満の案を媒体展開しない
  • 同じ失敗理由で3回目の再生成を行わない
  • 予算残高25%未満では勝ち型と公開予定作だけに限定する

8.1 モデル選定ルール

  • 単一Providerを標準にはせず、PENGINの実素材で用途別に評価する
  • Text-to-Video、Image-to-Video、Reference-to-Video、Video Editを別能力として評価する
  • Draftまたは低価格モデルで構図と動きを確認し、採用確度が高い案だけ高解像度・高品質モデルへ昇格する
  • 機密性のある顧客素材は、データ保護条件を確認済みのProviderに限定する。初期値はVertex AIとする
  • ベンチマーク順位だけで採用せず、プロンプト追従、ブランド一貫性、編集可能性、生成時間、実原価を記録する
  • Provider比較は総額5,000円以内とし、同一の実課題を候補3モデルで比較する。一般的な風景やデモ映像だけの比較は行わない
  • Sora 2など終了予定または安定提供が確認できないAPIは中核Providerにしない

9. ナレッジ

動画ごとに構造化記録を保存し、媒体、内容、構成、モデル、原価、品質、公開後指標から再利用可能な規則へ昇格させる。単発の所感を勝ちパターン扱いせず、異なるテーマで2回以上再現した規則をvalidatedとする。

10. 公開レポート

AIディア、note、X向けに以下を生成する。

  • 何を検証したか
  • 採用作と不採用作の差
  • モデル、原価、再生成回数
  • 実測指標
  • 植木拓海の考察を入れる欄
  • 次の検証

内部プロンプト全文、認証情報、非公開事業、個人情報、顧客情報は含めない。