5秒の場面を音つきで作る。Kandinsky 6.0の重みを公開
- Kandinsky Labが動画と音を共同生成するPro・Liteを公開
- 文章か参照画像を使い、音を伴う5秒の動画を生成できる
- 公開モデルの通常版・蒸留版を選び、対応環境と推奨設定を確認

AT A GLANCE
VINCIE-NExTは、静止画の編集前後を見本にして動画へ変更の意図を伝える研究。文章だけで伝えにくい直し方を示す提案で、一般向け機能は未提供です。
WHAT CHANGED
工程比較:文章だけで動画の修正を伝えると、望む色や見た目を言葉にする必要がある。
研究は静止画の編集前後を見本として渡し、変更の意図を動画へ伝える。
使う人への変化見た目の変更を例で示す編集につながる提案。動画全体での保持や性能は著者の実験範囲で確認する。
GET STARTED
一般向けの利用機能は未提供。論文 https://arxiv.org/abs/2610.12104(別タブで開く) から著者の作例・評価資料を開く。
編集前後の静止画と元動画の対応を確かめる。
先頭・中間・末尾で変更の継続と、変えていない背景や動きを見る。
実装公開が案内された場合は、環境と利用許諾を確認してから試す。
BEFORE YOU CREATE
必要な準備は環境や経験によって変わります。
研究発表。一般提供サービス、価格、実行費用は確認した要約では未確定。
料金・仕様・利用条件は変更される場合があります。利用前に公式ページで確認してください。
GO DEEPER
10月8日に投稿されたVINCIE-NExTは、静止画の編集前後を見本にして、動画へ変更の意図を伝える研究です。文章だけで「このように直して」と指示する方法に加え、画像の変化を手掛かりに使う構成を提案しています。著者は画像と動画の組み合わせを同じ学習目的で扱い、追加の推論計算を使うChain-of-Editingも説明しています。動画全体の色や対象を直したい人にとって、一枚で示した変更が時間の流れの中でも続くかという視点が注目点です。ただし研究発表であり、誰でも使えるサービスの公開とは確認していません。論文の評価は著者の実験条件に基づき、本サイトの比較結果ではありません。今は論文や著者の作例を見て、最初と最後、途中の形、変えていない背景を確認する読み方ができます。価格、PC要件、配布される重みの利用条件は、この要約だけでは確定できません。
今週投稿の、画像の編集前後を見本に使う動画編集研究。
編集前後の画像をin-contextの見本にする構成です。学習方法と評価の説明は著者の研究に限って紹介します。
指定した変更と、元の動きや背景の保持を分けて観察することを提案します。未確認のインストール手順は作っていません。
CHECK THE SOURCE
一次資料に基づく整理です。編集部による生成・性能検証は行っていません。
SNS反応は未取得です。少数の投稿を全体の評判として扱いません。