AIシステム2026公開中(GitHub)
AIFunRun-Video
一行の意図から、動画を最後まで自律制作するシステム。
An autonomous video production system driven by a single line of intent.
PythonBlenderFFmpegMCPDeepSeek
概要
「作りたい意図」をテキストで一行渡すと、企画・絵コンテ・3Dシーン・音声・字幕・BGM・編集・ 品質検査までを順に実行し、完成した MP4 を出力するシステムです。 生成ボタンを押すのではなく、工程そのものをパイプラインとして持つところが特徴です。
背景
動画制作は、ツールが多く、工程が長く、途中で止まりやすい。 「プロンプトだけで扱えたら、アイデアから作品までの距離が縮まるはず」と考えて作りはじめました。 また、特定の生成AIサービスに依存すると、サービスが変わったときに全部作り直しになります。 OSSの組み合わせで、環境を選ばず再現できる形にすることを設計の前提にしました。
設計
- 工場型オーケストレーション: plan → 3D資産 → Blenderシーン → レンダー → 音声 → 背景 → 編集 → BGM
- 必ず動く経路を確保: Blender や GPU が無い環境でも、ffmpeg だけで実動画を出力するフォールバックを用意
- 振り分けルーター: プロンプトの内容から、CAD(OpenSCAD / FreeCAD)/ 3D生成 / Blender の最適な手法を自動選択
- MCPサーバー: AIコーディング環境から操作できるようにし、制作の操作自体をAIに任せられる
実装のポイント
- Blender をテキストで駆動するため、シーン生成をコードとして組み立てる
creative_plan.jsonに「もっと速く」「暗く」などの追加指示を書くと、その場で再創作できる- 完成前に ffprobe で再生性・尺・解像度・音声を検査し、100点満点で品質を報告する
つまずきと解決
最初は外部ツールが無い環境でパイプラインが止まってしまいました。 そこで「無くても動く」を最優先の制約にして、各工程にフォールバックを実装。 結果として、環境を選ばず必ず何かしら出力できるシステムになりました。
学び・次にやること
生成AIに依存しない設計のほうが、長く使えて移植もしやすい。 次は音声と字幕の品質を上げ、長尺の構成管理をもっと安定させたいと考えています。