Claude Code・Codexで動画編集はどこまでできる?|72分の録画に字幕1,676本、長尺は試行中の実録
結論から言うと、AIエージェントに任せられる動画編集は、今のところ「字幕」と「モザイク」と「編集の型の抽出」までです。長尺のカットや演出は、みやっち🧑💻が2026年9月時点で試している最中で、完成したとは言えません。ただ、試して見えてきたことがひとつあります。外注先に渡してきた指示書と、Premiereのプロジェクトファイルが、そのままAIに渡す編集の型の材料になるということです。
AIエージェントによる動画編集とは Claude Code・Codexのような自分のパソコンで動くAIエージェントに、音声認識や動画処理ツールを動かさせて、字幕付け・モザイク・カットなどの編集作業を任せることです。編集ソフトの画面を人が操作する代わりに、AIが字幕ファイルや処理手順を作り、書き出しまで進めます。
YouTubeやセミナー録画を出したいのに、編集がネックで止まっている経営者・個人事業主・士業に向けて、実際にやった作業と、まだできていないことを分けて書きます。
AIの動画編集はどこまでできるか(できたこと・試行中のこと)
先に全体像です。2026年9月25日〜26日にみやっち🧑💻が手を動かした範囲を、状態ごとに分けました。
| 作業 | 使ったAI | 状態 | 中身 |
|---|---|---|---|
| 字幕の焼き込み | Codex | できた | 約72分の録画に字幕1,676本 |
| 画面のモザイク | Codex | できた(公開版では不採用) | 文字認識と目視で隠す範囲を作り、処理後に再検査 |
| 編集の型の抽出 | Claude(Opus 5.5) | 一部できた | Premiereのプロジェクトファイルからメインテロップの実際の値を抜き出せた(他の要素は確認中) |
| ショート動画 | Claude(Opus 5.5) | 1本作った | 素材を増やせば形になりそうな手応え |
| 長尺のカット・演出 | Claude(Opus 5.5) | 試行中 | 素材一式+台本+指示書だけでどこまでできるか検証中 |
「AIで動画編集は全部できる」とは言いません。機械的に正解が決まる作業(字幕・モザイク)は任せられた。センスが要る作業(カットのテンポ・演出)は、型を渡せば近づけられそう、というのが今の線引きです。
72分の録画にCodexで字幕を焼き込んだ手順
対象は、AI Crewの会員向け月次ライブのZoom録画です。2560×1440・25fps・71分49秒。みやっち🧑💻がCodexで自動テロップを付けたのは、この回が初めてでした。流れは次のとおりです。
- ローカルの音声認識で全編を字幕化する。 71分49秒ぶんの発言が字幕の下書きになります
- 製品名・用語を補正する。 主要な製品名・用語の表記を、正しい書き方に直します
- 参加者の氏名を置き換える。 字幕に出る名前は「講師」「参加者A〜H」にしました
- 字幕ファイルを2種類に分ける。 文面とタイミングを確認する
captions.srtと、焼き込み用のcaptions.ass(ヒラギノ角ゴシック・白文字+黒縁・画面下部・2行以内)です。直すときはSRT/ASSの該当区間を直して書き出し直します - FFmpegで書き出す。 音声トラックはそのままコピーし、元の動画ファイルには手を付けません
- 機械で検査する。 字幕の時間の逆転・重なりが無いこと、2行以内であることを確認し、書き出し後にハッシュ値で「元動画も音声も変わっていない」ことを確かめました
最終的に字幕は1,676本になりました。FFmpegは動画や音声を処理するツールで、公式ドキュメントによれば ass フィルタはASS形式の字幕を映像に描画する機能です。音声のコピーは、公式の説明で「デコードもエンコードもしないので非常に速く、品質も落ちない」とされる扱いです(映像は字幕を描き込むので再エンコードします)。人が編集ソフトで1本ずつテロップを打つ作業とは、発想がまったく違います。
モザイクは「隠す範囲」だけをAIに作らせた
字幕とは別の版で、モザイクも付けました。録画の画面には、参加者の情報など、外に出すべきでない文字が映り込むことがあります。
やったことは、1秒間隔の4,310枚と、画面が切り替わった直後の305枚を対象に文字認識し、目視も加えて隠す範囲を作ることです(同じ画面の小さな変化は、直前の認識結果を使い回しています)。隠す対象の文字領域20,845か所が、すべてモザイクの範囲に収まっていることを座標で確認しました。保存したのは座標と時間だけで、隠す文字そのものは残していません。処理後には43場面をもう一度文字認識して、対象の文字列が字幕以外に0件であることを確認しました。
人の目で72分を見張るのは現実的ではありません。「画面を一定間隔で機械に読ませ、隠し、処理後にもう一度読んで確かめる」という流れは、AIエージェントに任せる意味がはっきりある作業です。
字幕とモザイクで残った限界
できたことと同じくらい、限界も記録しました。
- 字幕は機械認識を補正したもので、全発言を人が一語ずつ校正したものではありません
- モザイクは、1秒未満しか映らない表示や、文字認識の失敗を完全に排除した保証はありません
最終的に、みやっち🧑💻の判断で、会員サイトには字幕だけを付けた版を載せました。モザイクは作れたけれど、今回の公開版には使わなかった。ここまで含めて「どこまでできたか」の実態です。
長尺編集を試すと、AIが時間を使ったのは「型の推測」だった
ここからは試行中の話です。背景から書きます。
YouTubeでいちばんネックになるのは編集です。制作会社に投げると、みやっち🧑💻の経験ではどうやっても完パケまで10日〜2週間かかります。普遍的な内容なら2週間後でも構いませんが、AIの話は鮮度が命です。かといって、カットもテロップも無い動画は自分でも見る気が起きません。これまでもAI編集は何度か試しましたが、「できる」と聞いて試しては期待どおりにいかない、の繰り返しで、いまいちな仕上がりで妥協してきました。
そこで、自分のパソコンのファイルを読めるAIエージェントでOpus 5.5を使い、まずショート動画を1本作りました。撮影素材をもっと撮れば、ちゃんとした動画になりそうな手応えがありました。
次に長尺です。条件は、制作会社に振るときと同じ「素材一式+台本+ちょっとした指示書」だけ。やってみると、AI自身の報告でも、いちばん時間を使ったのはお手本の完成動画から、みやっち🧑💻の編集の型を逆算して推測する部分でした。AIの見立てでは、型を最初から渡しておけば、この時間は毎回ゼロになるそうです。その後、この型を渡して1本目をv17まで直して仕上げ、2本目でも直しが続いた実録はClaude CodeのSkillsを改善するにはに書きました。
Premiereのプロジェクトファイルは編集の型の宝庫
型をどこから持ってくるか。AIの側から「指示書がなくても、過去回のPremiereのプロジェクトファイル(.prproj)から実際の値を抜き出せる」と提案がありました。答えは足元にあったわけです。
過去回のプロジェクトファイルは、中身が85MBのXMLでした。ここから、まずメインテロップの書体・サイズ・塗り・縁の色と太さを、推測ではなく実際の値として抜き出せました(Noto Sans CJK JP Black・サイズ123・塗りは白・縁は濃紺〈#193684〉の外側7px)。色替えやBGM・効果音の配置などは、続けて確認しているところです。
完成動画を見て「たぶんこの書体で、縁は太めで」と推測させるのと、プロジェクトファイルから正確な値を読ませるのとでは、再現度は後者のほうが上がるはずです(仕上がりでの比較はこれからです)。みやっち🧑💻の感想は「よく考えたら当たり前だった」。編集ソフトは、編集者の判断を全部ファイルに書き残しているわけです。
次からAIに渡す4つの材料(外注の指示書がそのまま使える)
長尺の試行のあと、AIの側から「次からこれが欲しい」と挙がったのは次の4つでした。
- 編集会社への指示書・レギュレーション: テロップの書体・色・縁・サイズ、強調の帯の使い分け、画像の位置、BGMと効果音、カットのテンポ、冒頭ダイジェストの作り方
- 台本の書き方の約束: 台本のコメントで素材を指定するルール
- 修正依頼のやり取り: 初稿で毎回どこを直させているか。「1回目がダサい」を減らすいちばんの材料です
- 撮影時の約束: 言い直しの合図、画面収録とナレーションの録り方
見てのとおり、どれも外注している人ならすでに手元にあるものです。編集者に渡してきたレギュレーションと、フィードバックのやり取りが、そのままAIにとって最高のナレッジになる、というのがみやっち🧑💻の見立てです。
言葉にしにくい「自分の好み」をAIに渡すやり方は暗黙知をAIに渡す方法に、手順(スキル)と判断基準(ナレッジ)を分けて置く考え方はAIのスキル化で成果が出ない理由に書きました。動画編集は、その考え方がいちばん素直に効く題材です。
編集待ちの2週間がどう変わるか
状態の変化で言うと、こうです。
- これまで: 撮る → 制作会社へ素材と指示書を送る → 完パケまで10日〜2週間待つ → 修正を返す
- 目指している形: 撮る → 同じ素材・台本・指示書をAIに渡す → 型どおりの初稿がすぐ出る → 自分で直して出す
2026年9月はYouTubeを動かせなかったぶん、制作会社込みのワークフローを固めずに済み、AI編集を前提にした制作の流れを最初から組み始められました。いちばん大きいのは、撮ったものをすぐに出せることです。長尺はまだ試行中なので、この「目指している形」が回りきったら、改めて結果を書きます。AIと一緒に編集した長尺の1本目は、YouTubeの動画一覧で見られます。
これが汎用の編集サービスではなく、自分のパソコンで動くAIエージェントである理由は、自分の過去のプロジェクトファイルや指示書、修正のやり取りを、そのまま読ませて型にできるからです。録画や会話そのものをAIに渡す前工程は文字起こしAIの使いどころで、Claude CodeとCodexの役割分担はClaude CodeとCodexの併用術で整理しています。なお、サムネイルは編集とは別に作っていて、その作り方はYouTubeのサムネイルをAIで作る方法に書きました。
よくある質問
Claude Code・Codexだけで動画を完成させられますか
2026年9月時点のみやっち🧑💻の検証では、字幕の焼き込みとモザイクはCodexで最後まで仕上げられました。一方、長尺動画のカットや演出は試行中で、完成までは確認できていません。ショート動画はClaude(Opus 5.5)で1本作れています。
Premiereを使っていなくてもAIに編集の型を渡せますか
渡せます。Premiereのプロジェクトファイルは型の値を正確に読み出せる材料ですが、編集会社への指示書、修正依頼のやり取り、台本の書き方の約束も、同じく型の材料になります。外注したことがあれば、手元のやり取りから始められます。
AIが付けた字幕はそのまま公開して大丈夫ですか
そのままではおすすめしません。音声認識の字幕は、製品名・用語の補正をしても、全発言を人が一語ずつ校正した状態にはなりません。音声の中の実名も字幕処理では消えないので、公開範囲に合わせて人が確認してから出します。
自分の仕事の型をAIに渡して、外注待ちの時間ごと手元に取り戻す。その最初の一歩を、講座では実際に手を動かしながら扱っています。まず無料セミナーでお会いしましょう。



