<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>AI TREND LAB</title><link>https://ai-trend-lab.pages.dev/</link><description>画像・動画生成AIの発見、理解、実践。</description><language>ja</language><item><title>8ステップで画像を生成・編集。Qwen Turboを公開</title><link>https://ai-trend-lab.pages.dev/topics/qwen-image-21-turbo-20261009/</link><guid>https://ai-trend-lab.pages.dev/topics/qwen-image-21-turbo-20261009/</guid><description>Qwenは10月9日、Qwen-Image-2.1-Turboの重みと、Pro・Turboの公式API公開を案内しました。Turboは7Bの画像モデルで、文章からの生成と画像編集を8回のノイズ除去ステップで行います。反復して構図や編集案を試す人には、少ないステップの新しい選択肢です。ただし8ステップという設定から、実際の待ち時間が必ず5分の1になるとは言えません。読み込み、画像の処理、GPU、サービスの混雑も時間に影響します。まずは短い架空の看板や自作画像の色変更を題材に、結果と設定を残すと用途を判断しやすくなります。公開重みは研究・評価の非商用利用に限定され、商用利用には別のライセンスが必要です。ローカル実行と公式API利用も分けて確認してください。本サイトでは生成速度、文字の精度、品質の同条件比較をまだ行っていません。</description><pubDate>Sun, 11 Oct 2026 13:49:51 GMT</pubDate></item><item><title>ComfyUIのノードから動画を試作。SparkDiffusionの統合が登場</title><link>https://ai-trend-lab.pages.dev/topics/sparkdiffusion-comfy-20261009/</link><guid>https://ai-trend-lab.pages.dev/topics/sparkdiffusion-comfy-20261009/</guid><description>AlibabaResearchのSparkDiffusion公式リポジトリは10月9日、ComfyUI対応のコミュニティ統合を案内しました。独立したメンテナーが公開するComfyUI-SparkDiffusionで、Wan向けの少ないステップによる動画生成をノードから呼び出す入口です。ノードと生成処理のPython環境を分ける構成で、T2V・I2Vのノードや作例ワークフローを用意しています。論文の高速化手法を、グラフの制作環境から試す選択肢が増えた更新です。ただしAlibabaResearchの公式製品ではなく、コミュニティによる独立実装です。対応表ではRTX 5090とWSL2の試験、Windowsネイティブの実験的対応などを区別しており、すべてのGPUやOSで同じように動くとはしていません。導入前に自分の環境と対応表を照合し、既存の制作環境を控えてから小さな一案を試しましょう。本サイトでは導入、速度、映像品質を再検証していません。</description><pubDate>Sun, 11 Oct 2026 13:49:51 GMT</pubDate></item><item><title>外から撮った動画を一人称へ。別の視点を作る新研究</title><link>https://ai-trend-lab.pages.dev/topics/lego-view-synthesis-20261008/</link><guid>https://ai-trend-lab.pages.dev/topics/lego-view-synthesis-20261008/</guid><description>10月8日に投稿された論文LEGOは、一つの第三者視点の映像から、一人称視点の映像を生成する研究です。撮影した位置から見える情報を使い、別の位置から見たような映像を作る「新規視点合成」を扱います。著者は学習済みの視点合成器で構造の手掛かりを渡し、確信度が低い領域をマスクして拡散モデルへ伝える方法を説明しています。外から撮った動作を、本人の目線のように見直す表現の方向として興味深い発表です。ただし見えていない部分も推定して作るため、実際にその位置で撮影した記録や現場の証拠とは扱えません。作例を見るときは、物の位置や手の形、遮られた場所がどのように作られているかに注目してみてください。LEGOはこの論文の名称で、玩具企業の製品ニュースではありません。一般サービス、価格、実装要件は確認した要約では未確定で、本サイトは動作を試していません。</description><pubDate>Sun, 11 Oct 2026 13:49:51 GMT</pubDate></item><item><title>一枚の変更を動画へ伝える。編集の見本を使う新研究</title><link>https://ai-trend-lab.pages.dev/topics/vincie-next-20261008/</link><guid>https://ai-trend-lab.pages.dev/topics/vincie-next-20261008/</guid><description>10月8日に投稿されたVINCIE-NExTは、静止画の編集前後を見本にして、動画へ変更の意図を伝える研究です。文章だけで「このように直して」と指示する方法に加え、画像の変化を手掛かりに使う構成を提案しています。著者は画像と動画の組み合わせを同じ学習目的で扱い、追加の推論計算を使うChain-of-Editingも説明しています。動画全体の色や対象を直したい人にとって、一枚で示した変更が時間の流れの中でも続くかという視点が注目点です。ただし研究発表であり、誰でも使えるサービスの公開とは確認していません。論文の評価は著者の実験条件に基づき、本サイトの比較結果ではありません。今は論文や著者の作例を見て、最初と最後、途中の形、変えていない背景を確認する読み方ができます。価格、PC要件、配布される重みの利用条件は、この要約だけでは確定できません。</description><pubDate>Sun, 11 Oct 2026 13:49:51 GMT</pubDate></item><item><title>待たずに動画を作る方向へ。1枚のGPUでライブ生成に挑む</title><link>https://ai-trend-lab.pages.dev/topics/comfystreamer-h3-20261008/</link><guid>https://ai-trend-lab.pages.dev/topics/comfystreamer-h3-20261008/</guid><description>Comfy Orgは10月8日、MiniMax H3を使った単一GPUのライブ動画生成実験を公開しました。作者が置いた条件は32GBのRTX 5090、448×256の出力で、15秒の映像を15秒以内に作ることが目標です。少ないサンプリング回数や軽いテキスト処理、量子化などを組み合わせ、ComfyStreamerH3という追加ノードを案内しています。完成映像の品質だけでなく、画面を待たずに試作を続ける方向への技術例として読むと分かりやすくなります。記事はアーティファクト、解像度、細部、一貫性の課題も認めています。目標の数字を、あらゆる題材で達成する保証や一般的なPCの処理速度に置き換えることはできません。まず公式記事と必要環境を読み、導入するなら既存の制作環境を控えたうえで小さい試作から確認しましょう。本サイトでは追加ノードの導入や速度の再測定を行っていません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>資料の図や文字を動かし、映像に仕上げる。Claude Motion連携</title><link>https://ai-trend-lab.pages.dev/topics/claude-motion-handoff-20261008/</link><guid>https://ai-trend-lab.pages.dev/topics/claude-motion-handoff-20261008/</guid><description>RunwayとLumaは10月8日、Claude Motionから制作を引き継ぐ連携を発表しました。Claude Motionは資料の文字や図、画像からコードで短い説明アニメを作る機能として紹介され、会話で調整した結果を映像制作サービスへ渡せます。Runwayはexport後に映像・音・編集を加える導線、LumaはMCP connectorを通じて作品を開き、見た目の変更や画面比率の調整へ進む導線を案内しています。説明する順番や文字の動きを先に決め、その後で映像として仕上げる使い方が考えられます。ただし発表時のClaude MotionはTeam・Enterprise向けbetaで、全利用者が同じ条件で使えるとは限りません。コードによる説明アニメと生成映像モデルの役割も分けて理解しましょう。資料や素材が連携先へ送られるため、機密性と利用権限を確認してから接続してください。本サイトではexport、連携操作、費用を試していません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>生成した画像のずれを見直して再生成。Midjourneyが試験</title><link>https://ai-trend-lab.pages.dev/topics/midjourney-thinking-20261008/</link><guid>https://ai-trend-lab.pages.dev/topics/midjourney-thinking-20261008/</guid><description>Midjourneyは10月8日、AlphaサイトでThinking Modeの試験を案内しました。8.2の通常生成と編集で、できた画像のプロンプトからのずれを見直して再生成する「Rerun (Thinking)」を追加します。公式は文字や指示への忠実さ、整合性の改善を内部試験の見解として述べています。同日に共有フォルダーの更新も発表され、CollaboratorやViewerを招待できるようになりました。自分で見るなら、同じプロンプトの画像を残し、どの失敗が直ったかを一つずつ確認すると判断しやすくなります。きれいになった部分だけでなく、文字や小物、編集外の領域も見比べましょう。共有設定は画像のstealth状態を変更せず、非stealthの画像はExploreなどへ出る可能性があります。共有先と画像の公開状態は別々に確認してください。本サイトでは利用成功、改善幅、処理時間や費用を測定していません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>画像・動画のAI透かしを調べられる。SynthIDが一般公開</title><link>https://ai-trend-lab.pages.dev/topics/synthid-detector-20261007/</link><guid>https://ai-trend-lab.pages.dev/topics/synthid-detector-20261007/</guid><description>Google DeepMindは10月7日、SynthID Detectorへのアクセスを一般向けに広げると発表しました。開始時は英語で世界向けに提供し、対応する画像・動画・音声の不可視透かしを確認する入口になります。制作物を見かけたとき、対応モデル由来の情報を調べる手段が増えた点に意味があります。ただし、あらゆる生成AI作品を見抜く判定器ではありません。仕組みは対応したモデルが付けるSynthID透かしの検出であり、見つからない結果から人間の作品だと結論づけることもできません。作品を紹介するメディアでは、検出結果だけに頼らず、作者の説明、制作記録、元の公開ページを一緒に確かめる使い方が考えられます。他人の未公開素材や機密情報は、送信条件を確認してから扱ってください。本サイトではログイン後の画面や実際の検出精度を試していません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>5秒の場面を音つきで作る。Kandinsky 6.0の重みを公開</title><link>https://ai-trend-lab.pages.dev/topics/kandinsky6-video-20261006/</link><guid>https://ai-trend-lab.pages.dev/topics/kandinsky6-video-20261006/</guid><description>Kandinsky Labは10月6日、Kandinsky 6.0 Videoのコードと重み、動画の超解像モデルを公開しました。ProとLiteの二つの規模があり、文章または参照画像から、音を伴う5秒の動画を作る構成です。映像を作ってから効果音を足す工程に加え、動きと音を一緒に考える入口が増えた点が注目です。公式はDiffusersやComfyUIなどの対応も案内しています。まず見るなら、音を聞かずに映像だけ確認し、次に音を合わせて、動きと音のタイミングがどう関係するかを観察してみてください。実行する場合は、通常版と蒸留版の設定を混ぜず、使う重みを決めることが大切です。公開資料の出力仕様や性能説明は開発元の情報で、本サイトの生成実測ではありません。短い題材で基本出力を保存し、その後で超解像の効果を見比べる進め方を提案します。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>気に入った動画から制作を再開。ComfyUIの設定を復元</title><link>https://ai-trend-lab.pages.dev/topics/freevideo-023-20261006/</link><guid>https://ai-trend-lab.pages.dev/topics/freevideo-023-20261006/</guid><description>FreeVideoの10月6日更新は、出来上がった動画から制作の続きへ戻る機能です。v0.2.3の公式リリースは、以前作った動画にも保存済みのComfyUIワークフローを付け、キャンバスへドラッグして設定を復元できるようにする仕組みを案内しています。元ファイルを保管し、保存済みの手順が完全な場合だけ書き換える条件も記載されています。10月5日には品質を4段階から選ぶ機能とApple silicon向けプレビューも案内されました。複数の案を試したあとに、気に入った動画の入力文章やシードを探し直す負担を減らせる更新です。共有する前には、動画に含まれる入力文章や設定も見直しましょう。本サイトではインストールや復元を実機で試していません。コードはApache 2.0ですが、使用するMiniMax H3の重みには別のCommunity Licenseがあるため、コードだけの条件で用途を決めないでください。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>会話で画像を直し、解像度を選ぶ。Nano Banana 2.1を一般提供</title><link>https://ai-trend-lab.pages.dev/topics/nano-banana-21-20261006/</link><guid>https://ai-trend-lab.pages.dev/topics/nano-banana-21-20261006/</guid><description>Googleは10月6日、Nano Banana 2.1の一般提供を公式APIの変更履歴で案内しました。画像生成と会話型の編集に対応し、1K・2K・4Kや縦長・横長の比率を選べます。同日にはComfyUIのPartner Node対応も発表され、いつものワークフローから利用する入口ができました。デザイン案を一度で完成させるより、元画像を残して変更を一つずつ頼む使い方が考えられます。例えば自作の商品画像で背景色だけを変え、次に配置を直す、という進め方です。ただし公式モデルカードは、小さい文字、キャラクターの一致、左右の認識などに限界が残ると説明しています。文字は一文字ずつ、編集対象の外側も同じ倍率で見比べましょう。解像度や参照画像を増やす前に料金と制限を確認してください。本サイトでは生成品質やAPIの動作を試していません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>見出しや人物の位置を箱で指定。FLUX 3 Imageの生成・編集</title><link>https://ai-trend-lab.pages.dev/topics/flux3-image-20261001/</link><guid>https://ai-trend-lab.pages.dev/topics/flux3-image-20261001/</guid><description>Black Forest Labsの10月1日付リリースノートは、FLUX 3 Imageの画像生成・編集APIを案内しています。文章の末尾に配置の箱を記述し、見出しや人物などの位置を指定する方法、最大10枚の参照画像、最大4Kの出力に対応します。生成と編集を同じ入口から行う構成です。自由な雰囲気の指定に加え、「どこに置くか」を言葉と座標で伝える選択肢が増えた点が注目されます。構図を決めた広告案や複数の枠を持つデザインでは、まず配置の意図を簡単に図にしてから試すと比較しやすくなるでしょう。これは今週の新発表ではなく、今週のComfyUI対応とつながる直近30日の補足記事です。局所編集で周辺を保持する性能説明は開発元の主張で、本サイトの実測ではありません。APIの料金は解像度で異なるため、現在の利用先で確認してください。公開重みや自分のPCでの動作を、このAPI発表だけで確定することもできません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item><item><title>作りたい絵を言葉で伝え、ノードで直す。Comfy Agentのbeta</title><link>https://ai-trend-lab.pages.dev/topics/comfy-agent-cloud-20261001/</link><guid>https://ai-trend-lab.pages.dev/topics/comfy-agent-cloud-20261001/</guid><description>Comfy Orgは10月1日、Comfy Cloudで使えるComfy Agentのbeta公開を発表しました。文章で作りたいものを伝えると、ワークフローの計画、組み立て、実行、反復を支援する入口です。画面上のノードを利用者も確認・編集しながら作業する構成で、既存ワークフローの説明や複数モデルの比較といった例を案内しています。複雑なノードの接続で止まっていた人には、完成した手順を見ながら学べる選択肢になります。ただし、すべての提案が正しい、指定した品質になるという保証ではありません。初めは小さい題材で計画を確認し、使うモデル、外部送信、生成費用を見てから実行する進め方が考えられます。これは直近30日の補足で、今週の公開ではありません。発表時はCloudが対象で、Desktopへの対応は今後の予定です。初期無料チャットの案内と生成creditsの利用条件も分けて確認してください。本サイトではワークフローの作成・実行を試していません。</description><pubDate>Sun, 11 Oct 2026 13:49:52 GMT</pubDate></item></channel></rss>