← GPT-AI-VIDEO
RESEARCH · 7.3 KB

research/social-benchmark-reset-v1.md

Workspace snapshot · 09/04 14:52

Social Video Benchmark Reset v1

更新日: 2026-08-31

判定

PENGIN 24秒 v3(Kling v3 Pro / Veo 3.1 Fast)は REJECTED / 比較無効。

理由はモデル品質ではなく、動画化前の企画・画作り・編集設計が基準未達だったため。8カット中、生成動画は人物I2Vの2カットだけで、残りは写真・Web画面・資料のパン/ズームだった。したがって「生成動画AIの比較」ではなく「低品質な編集テンプレートへ2本のI2Vを差した比較」になっていた。

参考プロンプトとの不一致

参考プロンプトが要求したものv3で実施したもの判定
高予算エディトリアル広告通常のオフィス写真+資料のスライド表示不一致
1秒で止まる強い画静かなパン/ズーム不一致
写真とタイポグラフィの衝突画面上へ説明文を載せただけ不一致
明るいハイキー、都市・カルチャー感暗い/普通の会議室、LP・資料調不一致
AI生成画像を動画素材へ使う最終24秒版では生成画像工程を省略不一致
一つの鮮烈なアクセント色青・白・黒の既存資料色に依存不一致
日本語文字を主要な視覚要素にする小さい説明テロップ、情報過多不一致

媒体別の公式基準

TikTok

  • TikTok-first、9:16、音あり、人(社員・顧客・クリエイター)を出す。
  • 冒頭3〜6秒でフック、価値、理由を示す。動き、テンポ、テキストオーバーレイを使う。
  • Top Adsは2秒視聴率、6秒視聴率、CTR、CVRを秒単位で見る。現行Creative CenterはTikTok Oneへ移行中で、未ログイン状態では一覧取得不可。
  • 1広告グループ5〜10本、1キャンペーン3〜5広告グループ。初期テストは小差分ではなく、明確に異なるクリエイティブを使う。

Sources:

Instagram / Facebook Reels

  • 9:16、音あり、重要要素はsafe zone内。
  • Reels固有のネイティブ表現と人物/クリエイターを使う。
  • Metaの比較では9:16・音あり・safe zone準拠の動画が静止画より低い成果単価を示した。A/Bテスト前提。

Source:

YouTube Shorts

  • 9:16、sound-on、social-first。周囲のオーガニック投稿へ馴染ませる。
  • action目的は10〜30秒。冒頭から本題へ入り、明るく高コントラスト、音声とスーパーで意味を補強する。
  • GoogleのABCD: Attention / Branding / Connection / Direction。

Sources:

採用するベンチマーク群

特定動画の表層コピーではなく、次の4系統を役割別に参照する。

  1. Creator-native / behind the scenes — TikTok・Reelsの社員/当事者起点。借りる要素は、人物の即時登場、話し言葉、手持ち感、制作現場の証拠。
  2. Editorial campaign — ファッション/カルチャー誌型の高予算ビジュアル。借りる要素は、ハイキー、極端な余白とクロップ、紙・写真・タイポの物理的衝突、アクセントオレンジ。
  3. Microdrama / transformation — Instagramの短編連作型。借りる要素は、問題→摩擦→決断→変化を一つの小さな事件として見せること。
  4. B2B proof — TikTok Professional Services / YouTube ABCD。借りる要素は、抽象的な会社紹介ではなく、制作物・プロセス・成果を人の判断と結びつけること。

新しい品質ゲート

動画生成へ進めるのは、各構成について以下が揃った場合だけ。

  1. 0.0秒、1.0秒、3.0秒、6.0秒、12.0秒、20.0秒の6キーフレーム。
  2. 1080×1920の実寸で、本文最小48px、主見出し96px以上。1画面の主メッセージは原則12文字以内。
  3. PENGIN固有資産が主役で、生成素材は固有資産を増幅する。汎用ストックで置換しない。
  4. 静止画だけで「誰の、何の変化か」が追える。
  5. 3構成はフック、物語、画法が明確に異なる。
  6. Codex自己レビューとClaude -pレビューの両方で80点以上、致命的指摘0。
  7. 合格後にのみKling / Veo / Runway / Seedance等の有料I2Vを同一カットで比較する。

構成候補(小差分ではなく別企画)

A — 会社を、作品にする。

  • 型: editorial manifesto
  • フック: PENGIN社員の集合写真を、巨大な白い紙が切り裂き、人物の表情だけを露出。
  • 物語: 「自社サイトを作る」ではなく「自分たちの判断を、会社の顔にする」。
  • 固有素材: 撮影写真、5つのデザイン方向、社員の発言、完成サイト。
  • 文字: 「会社を、作品にする。」→「5案。」→「選んだのは、らしさ。」
  • 音: 紙の裂け、シャッター、低いキック、最後に無音。

B — 5案。1つも、妥協しない。

  • 型: process tension / tactile proof
  • フック: 5案のデザインボードが縦画面へ高速に落下し、中央の1案だけ止まる。
  • 物語: 選択肢の多さではなく、議論・却下・再設計を経て言葉と画が一致するまで。
  • 固有素材: design-directions、concept-brainstorm、wireframe、Meetの意思決定、完成画面。
  • 文字: 「5案。」→「全部、違う。」→「だから、選べた。」
  • 音: 紙の衝突、マーカー、クリック、加速するパーカッション。

C — 画面の外まで、設計する。

  • 型: proof transformation / social-native documentary
  • フック: 社員がカメラへ「サイトだけ作っても、会社は変わらない」と言い切る。
  • 物語: 会話→撮影→設計→実装→公開後の検索・採用・営業の変化。
  • 固有素材: 人物、撮影現場、wireframe、three.js、公式サイト、成果証拠。
  • 文字: 会話字幕を主役にし、説明スライドを使わない。
  • 音: 生声、室内音、UIクリック。BGMは補助。

推し

最初に作るのは A。参考プロンプトの強み(エディトリアル広告、写真とタイポの衝突、ハイキー)を最も正しく検証でき、既存の「普通の会社紹介動画」と最も離れられる。BとCも同時にキーフレームまで作り、Aの見た目だけに引っ張られない比較にする。

次の実行

  1. A/B/Cそれぞれのフック用キービジュアルを、固有写真・デザイン案を入力して生成する。
  2. 日本語文字は画像AIに焼き込まず、Remotion/HTMLで正確に組む。
  3. 3案×6フレームの静止コンテを作り、スマホ実寸で自己レビューする。
  4. Claude -pを正しい非対話実行で通し、80点未満は動画化しない。
  5. 合格した2構成だけ、有料動画モデルを1カット単位で比較する。