本文へ
Konte
仕組み
SH-03 · 8s loop · KONTE · ローカル GPU の MiniMax H3

HOW IT WORKSKonte の仕組み

話した言葉が、映像になるまで

会話の AI、香盤表、生成エンジン。Konte の中で起きていることを 1 枚の図に。

01—THE LOOP会話から撮影まで

話すたびに増える、作品と素材

構成表づくりも撮影も、会話の続きで。できたものはプロジェクトに残ります。

  1. 01—TALK

    話す

    作りたい動画を一文で。キャストや背景セット、写真も添えられます。

  2. 02—PLAN

    構成表ができる

    チャプターとカット割りの入った作品が 1 本。続きを話せば直ります。

  3. 03—SHOOT

    そのまま撮影

    カットの生成はそのまま始まります。直した版を撮っても、前のテイクは履歴に。

  4. 04—KEEP

    棚に残る

    作品は会話の右に、撮ったカットは成果物に。キャストと背景セットは次の作品でも使えます。

↺ 次の作品は、この棚から

Konte の画面:AI との会話。話すと構成表ができて、そのまま撮影へ。できた動画とキャストは右に溜まっていきます。
AI との会話話すと構成表ができて、そのまま撮影へ。できた動画とキャストは右に溜まっていきます。

02—THE MAP全体の図

Konte は、モデルを包む撮影所

映像を描くのはモデル。Konte はその前後の段取りと棚を受け持ちます。

YOUあなた

ブラウザで話す

  • 作りたい動画を一文で
  • 続きを話して直す
  • カットを選んで撮る

手元の Claude Code / Codex 任意

MCP でつなぐと、香盤表を読む・カットを足す・文面を直す。

KonteSTUDIO

SHOT LIST構成表(香盤表)

作品›チャプター›カット

1 カット = 1 行。映像メモ・カメラ・キャスト・尺。

AIClaude

会話からカット割り、生成直前のプロンプトの清書、キャストと背景セットの読み取り。

SHELF棚

キャスト背景セット資料成果物

撮るたびに増えて、次の作品はここから。

QUEUE生成キュー

組織の既定エンジンへ

STAGE焼く場所(組織ごとにどちらか)

ComfyUI

ローカル GPU

手元の GPU。ワークフロー(JSON)で焼く

MiniMax H3

480P で生成 → ESRGAN x2 → 1080p

Seedance 準備中

ワークフローを置くと選べる受け口

キャスト・背景セットのシート

参照画像から三面図や引き・寄りを生成

OR

fal.ai API

クラウド

GPU なし。利用料は自分の fal のキーへ

MiniMax H3

量子化なし・5〜15 秒

MiniMax Hailuo

6 / 10 秒

焼き先は組織のオーナーが「既定の生成エンジン」で 1 つ選びます。同じ作品のカットが別のエンジンで焼かれると、絵がそろわないためです。

03—ONE CUT1 カットが焼けるまで

香盤表の 1 行から、MP4 まで

カットを 1 本撮るとき、裏で順番に起きていること。

  1. 01—ROW

    香盤表の 1 行

    映像メモ、カメラ(アングル・レンズ・動き・速さ)、キャスト、尺。1 カット = 1 行です。

  2. 02—CAST

    キャストを入れる

    登録した参照画像がキーフレームとしてカットに入り、顔と衣装をそろえます。

  3. 03—PROMPT

    プロンプトの清書

    生成の直前に Claude が英語のプロンプトに書き起こします。構成とカメラ用語は Konte が決め、AI は描写だけ。ロックすれば自分の文面のまま。

  4. 04—QUEUE

    エンジンへ

    組織の既定エンジンにジョブを投げます。手元の GPU は 1 本ずつ順番に、クラウドは並行して。

  5. 05—RENDER

    焼く

    MiniMax H3 は映像と音声を一緒に生成します。手元の GPU なら 480P で焼いてから 1080p に整えます。

  6. 06—SHELF

    棚へ

    MP4 は成果物に。seed とプロンプト、カメラ設定を控えておくので、前のテイクにいつでも戻せます。

04—ENGINES生成エンジン

焼き先ごとの、生成エンジン

名前は、香盤表に表示されるものと同じです。

  • ローカル GPU の MiniMax H3

    ローカル GPU

    VIA ComfyUI既定のエンジン。12GB の VRAM に収まる int8 版を、480P で焼いてから 1080p に整えます。4 秒のカットで約 139 秒(実測)。

  • ローカル GPU の Seedance

    ローカル GPU準備中

    VIA ComfyUI受け口は用意済み。ComfyUI のワークフローを置くと選べるようになります(ワークフローは準備中)。

  • fal.ai API の MiniMax H3

    クラウド

    VIA fal.aiローカルと同じモデルを、量子化なしで。1 カット 5〜15 秒、既定は 768P。利用料は登録した fal のキーへ。

  • fal.ai API の MiniMax Hailuo

    クラウド

    VIA fal.ai1 カット 6 秒か 10 秒。GPU の順番待ちがない代わりに、利用料は登録した fal のキーへ。

05—UNDER THE HOOD中身は ComfyUI

新しいモデルも、同じ香盤表で

中身は ComfyUI。エンジンはワークフローで足していく作りです。

  • ワークフローを渡して焼く

    Konte は ComfyUI に API 形式のワークフロー(JSON)を渡して、できた映像を受け取ります。ノードは名前で指すので、ワークフローを差し替えても Konte 側はそのままです。

  • GPU は別のマシンでも

    ファイルのやり取りは HTTP だけ。Konte のサーバーと、ComfyUI を動かす GPU マシンを分けて置けます。

  • モデルが増えても、同じ香盤表

    新しい動画モデルは、ComfyUI のワークフローとして足していく作りです。Seedance もこの形で受け口を用意しています。香盤表とキャストはそのまま使えます。

GET STARTEDはじめる

あなたの撮影スタジオ、今日から

まずは出演者を 1 人つくるところから。お気軽にご相談ください。