Image and Video Generation AI News — 2026-09-04
クローズドソースは生成・編集・音声を1モデルに統合する方向へ動く一方(FLUX 3, Kling 3.0)、オープンソースは中国発ラボ(Alibaba, Tencent)が月単位でApache 2.0の低VRAMモデルを出し続けており、両陣営の境界自体がFLUX 3やMiniMax H3のようなハイブリッドライセンスで曖昧になりつつある。
画像・動画生成AI ニュース — 2026-09-04
クローズドソース陣営は「単発の画質競争」から「生成・編集・音声(FLUX 3はさらに行動予測まで)を1モデルに統合する」段階へ進み、Google Nano Banana Proが画像生成でほぼ独走、OpenAIはSoraアプリを2026年3月に撤退させるなど明暗が分かれている。オープンソース陣営はAlibaba(Wan/Qwen-Image/Z-Image)とTencent(Hunyuan)を中心とした中国発ラボが月単位でApache 2.0モデルを投下し、「コンシューマGPUで動く」ことを売り文句にComfyUIコミュニティへの浸透を進めている。両陣営の境界は曖昧になりつつあり、「オープンウェイトを謳いながら実態はgated early access」(FLUX 3)や「重みはオープンだが商用ライセンスは1社が独占販売」(MiniMax H3)といったハイブリッド形態が目立つ。ただし調査対象6プラットフォームのうちRedditは完全にアクセス不能、Blueskyは2026年の最新モデルの話題が一件もヒットせず、Pinterestはオープンソースの気づきをほぼ提供できなかった点で、今回のレポートは実質X・YouTube・Lemmyの3本柱に支えられている。
プラットフォーム横断の気づき
- FLUX 3は「オープンではない」という指摘がX・YouTubeで一致。 Black Forest Labsの新モデルは画像・動画・音声・行動予測を統合するが、@bfl_ai自身の告知でも@kimmonismusの指摘でも「gated early access, not open source」であることが明記され、YouTubeのElevenLabs解説動画(https://www.youtube.com/watch?v=WlGmDRLZt9o)も同じ点をわざわざ強調している。
- オープンソースの主戦場は中国発ラボへの集中というのがX・YouTube・Lemmyで共通。 Alibaba(Wan2.2/2.6/2.7、Qwen-Image、Z-Image-Turbo)とTencent(HunyuanVideo 1.5、HunyuanImage 3.0)がほぼ月単位で新モデルを公開し、Lemmyの[email protected]ではそのComfyUIノード化がほぼ毎日話題になっている。
- 「コンシューマGPUで動く」ことがオープンソース陣営共通の売り文句。 Z-Image-Turbo(16GB VRAM、@stevenhoi)、HunyuanVideo 1.5(14GB、TensorArt動画 https://www.youtube.com/watch?v=MJShdc8tkkA)がX・YouTubeの双方で同じ数字とともに紹介されている。
- Soraアプリの撤退がYouTubeとLemmyで異なる角度から裏付けられた。 YouTube(NBC News https://www.youtube.com/watch?v=6e3SINmPii4、Wall Street Millennial https://www.youtube.com/watch?v=ZkRYH6PEP5k)がディープフェイク懸念と財務損失を報じ、Lemmy(https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/ 経由の転載、2026-05-27)では制作中だった3000万ドル規模のAI映画プロジェクトが頓挫した実例が出ている。
- アリーナ順位(Artificial Analysis / Arena.ai)が発表文の「共通の物差し」になっている点はXとLemmyの双方で確認。 クローズド・オープン問わず新モデル発表には必ずアリーナでの順位が添えられ、Xの@ArtificialAnlysがその横断的な検証役になっている。
- オープン/クローズドの境界の曖昧化はX(FLUX 3)とLemmy(MiniMax H3)で別々の実例が確認された。 MiniMax H3は重み自体はオープン(MiniMax Community License)だがComfyが商用ライセンスを独占販売する(https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller)というハイブリッド形態で、単純な二分法が崩れている。
- プラットフォームへのアクセス制限そのものが今回の調査で最大の共通の壁だった。 Reddit本体、Bluesky検索API、YouTube本体ページのいずれも直接取得がブロックされ、各ステージがWebSearch経由の間接情報に頼らざるを得なかった。
プラットフォーム別
Reddit — reddit.com・ミラー・archive.orgのいずれにも一切アクセスできず、投稿ゼロ件で終わった。周辺記事が「r/StableDiffusionでWan 2.5が盛り上がった」「r/SoraAiでSora終了後の代替探しが起きた」などと間接的に触れていたが、一次ソースを開けていないため事実として採用していない。
X — 21件の投稿を確認し、今回のレポートで最も情報量が多いプラットフォームだった。公式アカウント(xAI, Runway, Alibaba_Wan, Alibaba_Qwen, TencentHunyuan, bfl_ai, Kling_ai)からの一次発表と、Artificial Analysisやrohan_paulのような業界ウォッチャーによる検証が組み合わさり、クローズド12件・オープン9件の気づきを提示できた。ただしログインなしのため、いいね数・リポスト数などのエンゲージメント指標はほぼ取得できていない。
YouTube — 検索(WebSearch経由)は安定して機能し、クローズド11件・オープン11件、計22件の動画タイトル・チャンネル・内容を確認した。一方で動画ページ本体の取得が制限され、再生数・登録者数・コメント欄は一切確認できなかった。
Bluesky — 見つかった投稿は10件(クローズド4・オープン6)にとどまり、しかもそのほとんどが2024〜2025年前半のCivitai/Stable Diffusion系ホビイストコミュニティのもので、2026年の主要モデル名(Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3など)は一件もヒットしなかった。公式ラボアカウントも確認できず、Xのニュースサイクルとは切り離された「別世界」だった。検索API自体が403で塞がれていたことが主因と見られる。
Lemmy — 13件の投稿を確認。[email protected](約5,600人)がオープンソース側の主戦場として機能し、MiniMax H3・LTX-2.3/2.5・Boogu-Image-0.1といったComfyUI関連の実務的な話題が豊富だった。クローズド側は新モデル発表よりもSora撤退・Grok CSAM訴訟・DLSS5批判といった「炎上・訴訟」系の話題の方がスコアを稼いでいた。
Pinterest — 収集済み50件のPinのうち32件を画像として確認したが、クローズドソースの大手ブランド(Google Veo, Sora, Runway, Kling, Midjourneyなど)を扱う「Topツール比較」系インフォグラフィックが大半を占め、オープンソース(Stable Diffusion, Flux, Wan, HunyuanVideo等)に触れたPinは実質ゼロだった。タイトルと画像内容が食い違うPinも複数あり、速報性という点では他プラットフォームに劣ることが確認された。
今後ウォッチすべきこと
- FLUX 3が本当にオープンウェイト化するか — X: @bfl_aiが「gated early access」と明言、後日の方針転換の有無を追う。
- MiniMax H3型の「オープン風味の商業ライセンス」が他社に広がるか — Lemmy: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller
- Qwen-Image-2512 / Z-Image-Turboのアリーナ順位の推移 — X: @ArtificialAnlys
- OpenAI Sora APIの2026-09-24終了とその後の代替サービスの動き — Lemmy: https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/(転載)
- xAI「Grok」のCSAM生成をめぐる訴訟の進展 — Lemmy: https://lemmy.world/post/51492879
- Kling 3.0が動画AIの経済構造をどこまで変えるか — X: @CNBizInsider
推奨アクション
- クローズドソースの動向はXとYouTubeを一次情報源として継続的にモニタリングする。
- オープンソースの実装トレンドはLemmyの[email protected]をComfyUIエコシステムの定点観測に使う。
- Reddit・Blueskyについては次回以降ログイン済みセッションや公式API鍵など別のアクセス手段を用意しないと有効な調査ができない。
- Pinterestはニュース速報用途には向かないため、次回はビジュアルトレンド(サムネイル・パレット傾向)分析用途に絞って使う。
- 「オープンウェイトを名乗るが実態はgated/ハイブリッドライセンス」の事例(FLUX 3, MiniMax H3)は都度ライセンス文言を確認してから分類する。
- Sora撤退やGrok訴訟のような法的・炎上系ニュースはLemmyの方がXより早く実例(金額・訴状)を伴って出てくるため定期チェックに加える。
データ品質
Redditは技術的アクセス遮断により投稿0件で、このテーマに関する知見は今回まったく得られなかった。Blueskyは検索APIが403で塞がれておりWebSearch経由のインデックスに頼らざるを得ず、拾えた投稿の大半が2024〜2025年前半の古い話題で2026年の主要モデルには触れていない。Pinterestはオープンソースに関する具体的な気づきをほぼ提供できず(AMD Amuse 3.0のみ)、クローズドソース寄りの汎用インフォグラフィックに偏っていた。X・YouTube・Lemmyの3プラットフォームは合わせて20件以上ずつの実在する投稿・動画・スレッドを確認でき、本レポートの主要な根拠になっている。
プラットフォーム別まとめ
Reddit — 画像・動画生成AIニュース(クローズドソース / オープンソース)
Where
このステージでは reddit.com に一切アクセスできなかったため、どのサブレディットがこのテーマで実際に盛り上がっているか(登録者数含む)を確認できていない。通常この分野で名前が挙がるサブレディット(r/StableDiffusion, r/midjourney, r/aivideo, r/SoraAi, r/singularity など)はあるが、今回は開けていないため「確認済みの場所」としては報告できない。
What people say
今回のツール環境では Reddit の投稿を1件も開けなかった。そのため「投稿へのリンク + upvote数 + 日付」を伴う具体的な発見はゼロ件。プレイブックが求める5〜12件、ブリーフが求める約20件の投稿解析のいずれも実施できなかった。
以下は WebSearch 経由で他サイト(ブログ・まとめ記事)が「Redditでこう言われている」と間接的に触れていた内容。直接開いて確認できていないため、事実として採用せず、参考メモに留める:
- あるまとめ記事は「r/StableDiffusion で Wan 2.5 のスレッドが数百upvote/コメントを集め、ネイティブ音声生成が評価されている」「オープンウェイト公開を求める声が多い」と書いていたが、スレッドのURL・実際のupvote数は確認不能。
- 別の記事は「OpenAIがSoraアプリを2026年4月26日に終了した際、r/SoraAiで『代替は何?』という投稿が急増した」と書いていたが、同様に一次ソースを開けていない。
- 「ByteDance Seedance 2.0 が r/aivideo で12,300+upvoteのバイラル投稿になった」という記述もあったが、リンク・日付とも未確認。
これらは Reddit を実際に読んだ結果ではないため、レポート本体(クローズドソース/オープンソースそれぞれ最低10件の気づき)には使うべきではない。
Signals
Reddit自体からのシグナルは収集できていない。強いて言えるのは、周辺記事群が触れていた話題(Wan 2.5のネイティブ音声生成、Sora終了への反応、Seedance 2.0への注目)が「Redditで話題になっているらしい」という又聞きレベルの示唆のみ。これらは他プラットフォームのステージ(X, YouTubeなど)で直接検証されるべきで、このステージの成果としては数えられない。
Limits
- reddit.com への直接アクセスがすべて失敗した。 WebFetch で
www.reddit.com(トップページ含む)、old.reddit.comを試したが、いずれも「Claude Code is unable to fetch from ...」というブロックで拒否された。 - ミラー/プロキシも試したが失敗:
redlib.catsarch.com→ HTTP 403、libreddit.spike.codes→ DNS解決失敗、teddit.net→ 同様にブロック。 web.archive.org経由でのReddit過去スナップショット取得も試みたが、archive.org自体へのアクセスがブロックされ失敗。- WebSearch は10回以上、
site:reddit.comや具体的なサブレディット名・スレッドタイトルを含むクエリ(例: "site:reddit.com r/StableDiffusion new open source model", "Wan 2.5 open source video model reddit thread discussion release" など)で試したが、一度も reddit.com の実URLを結果に返さなかった。検索結果は常にWikipedia、企業ブログ、Substack、Hugging Faceなど二次情報源に置き換えられ、Redditのスレッドについて「〜と言われている」という要約はあっても、開いて検証できるリンクは一切含まれていなかった。 - 結果として、プレイブックが要求する「upvote数・日付付きの実リンク」も、ブリーフの完了基準である「約20件の投稿の解析」も、このステージでは満たせていない。
- 結論: このステージでは Reddit というプラットフォームが実質的に閉ざされていた(nothing to give)。 他のプラットフォーム(X, YouTube, Bluesky, Lemmy, Pinterest)のステージで代替のソーシャルシグナルを集めることを推奨する。
X
X — 画像生成・動画生成AIニュース
X(旧Twitter)はログインなしで読めないので、site:x.com での外部検索経由で個々のポスト本文・URLを拾っている。ほぼ全ての投稿は公式アカウント(xAI, Runway, Alibaba_Qwen, Alibaba_Wan, TencentHunyuan, bfl_ai, Kling_ai, ideogram_ai など)本人か、Artificial Analysis / Rohan Paul / LudovicCreator のような業界ウォッチャー・アグリゲーターアカウント経由。
Accounts and hashtags
クローズドソース系の発信源
- @xai — Grok Imagine / grok-2-image-1212 廃止告知など
- @runwayml — Gen-4, Gen-4.5 の一次情報源
- @Kling_ai — Kling 3.0 発表
- @bfl_ai(Black Forest Labs) — FLUX 3(現状はクローズド寄りのgated early access)
- @ideogram_ai — パートナー展開の告知
- @ArtificialAnlys(Artificial Analysis) — 各モデルのアリーナ順位を継続的にポスト。クローズド/オープン双方を横断的に追う指標アカウント
オープンソース系の発信源
- @Alibaba_Wan / @AlibabaGroup — Wan2.1/2.2/2.6 系の一次情報
- @Alibaba_Qwen — Qwen-Image / Qwen-Image-2512
- @Ali_TongyiLab — Z-Image / Z-Image-Turbo
- @TencentHunyuan — HunyuanImage 2.1/3.0、HunyuanVideo 1.5、Hunyuan-GameCraft
- @stevenhoi(Tongyi-MAI) — Z-Image-Turbo公開の個人告知
- @rohanpaul_ai — 中国発オープンモデルの解説スレッドを頻繁に投稿
- ハッシュタグ/検索語:
#OpenSource、#Wan22、#QwenImage、Apache 2.0 ライセンス言及多数
Posts
クローズドソース
- GPT Image 2 / MAI-Image-2.6 アリーナ順位 — @ChanPerco: GPT-Image 2が1位、MicrosoftのMAI-Image-2.6が2位でGrok Imagine 2.0を上回ったと報告。(日付不明、2026年後半のポスト。エンゲージメント数値は本文からは非公開)
- MAI-Image-2.6のアリーナ3位入り — @testingcatalog: 「MAI-Image-2.6 scored in the 3rd spot on Image Arena and is now available on MAI Playground and Microsoft Foundry in private preview.」
- 謎のモデル"duct-tape" — @arrakis_ai: GPTベースとみられる匿名テストモデルがアリーナで話題に。「Holy shxt… The rules of AI image generation just completely changed.」ネイティブ文字描画の精度が急上昇したと指摘。
- Grok画像生成モデルの世代交代 — @daisuke: 「grok-2-image-1212 model effective Feb 28, 2026」の廃止と
grok-imagine-imageへの移行を告知(xAI公式アナウンスの引用)。 - xAI Imagine v0.9動画モデル — @xai: 「Introducing Imagine v0.9, our new video generation model with massive upgrades from v0.1 in visual quality, motion, audio generation」を全製品に無料展開。
- Runway Gen-4.5 — @runwayml: Text to Videoアリーナで1,247 Eloを記録し新基盤モデルと発表。同社は続けてGen-4.5 Image to Videoも公開(「Built for longer stories. Precise camera control. Coherent narratives.」)。
- Kling 3.0発表 — @Kling_ai: 「Everyone a Director」のコピーで生成・編集・音声を1モデルに統合したall-in-oneアーキテクチャを発表、15秒クリップ生成に対応。フランス語圏のクリエイター@tardquinも速報リポスト。
- Kling 3.0の経済性への言及 — @CNBizInsider: 「could fundamentally reshape video AI economics」と業界インパクトを分析。
- Nano Banana Pro(Google)活用例 — @101babich: プロダクトデザイン用途での3つの活用パターンを紹介する実例スレッド。
- Nano Banana無印 vs Pro比較 — @immasiddx: 「We're cooked 💀」という反応とともに新旧モデルの画質差を比較投稿、指の描写など解剖学的な粗さも指摘された。
- FLUX 3はクローズドで登場 — @kimmonismus: Black Forest Labsが画像・動画・音声・行動予測を統合した「FLUX 3」を発表したが「The current release is gated early access, not open source」と明記。
- FLUX 3 Video公式発表 — @bfl_ai(本人による一次情報): 「One multi-modal model for Image, Video, Audio and Action-Prediction」、20秒動画・多言語セリフ対応。後続ポストで「FLUX 3 Video is #2 in the world」とアリーナ順位を誇示し、期間限定で無料公開。
オープンソース
- Wan2.2正式リリース — @Alibaba_Wan(公式): 「The World's First Open-Source MoE-Architecture Video Generation Model with Cinematic Control!」。個人アカウント@scaling01も即座に拡散。
- Wan2.6:動画+音声を1パスで生成 — @FutureStacked: 「the first open-source model that generates video AND audio together in a single pass. No stitching. No external tools.」
- Wan2.2-Animate公開 — @Alibaba_Wan: キャラクターアニメーション・差し替え用の統合モデル。「model weights and inference code are now open-source for the entire community!」
- Qwen-Image公開 — @Alibaba_Qwen(公式): 200億パラメータMMDiTモデル、「SOTA text rendering — rivals GPT-4o in English」とアピール。解説は@rohanpaul_aiが「Runs under Apache 2.0 so anyone can deploy it for free」と補足。
- Qwen-Image-2512(お年玉アップデート) — @Alibaba_Qwen: 「Tested in 10,000+ blind rounds on AI Arena, Qwen-Image-2512 ranks as the strongest open-source」と自己申告のベンチ結果を公開。
- Qwen-Image-Layered — @azed_ai: 「natively breaks images into editable parts, not masks, not hacks 🤯」とレイヤー分解編集機能に驚きの声。
- HunyuanVideo 1.5 — @TencentHunyuan(公式): 「the strongest open-source video generation model」を自称、8.3Bパラメータで14GB VRAMのコンシューマGPUで動作可能と強調。
- HunyuanImage 3.0 — @TencentHunyuan: 「the largest and most powerful open-source text-to-image model to date, with over 80 billion total parameters」。
- Z-Image-Turbo公開 — @stevenhoi(Tongyi-MAIチーム本人): 「sub-second inference speed on consumer gpu w/ 16GB VRAM」の6Bモデルを公開。翌週Artificial Analysisがオープンウェイト画像部門1位に認定、Arena.aiも「Apache 2.0」ライセンスでランクイン確認。
Signals
- オープンソース勢の主戦場は中国系ラボに集中:Alibaba(Wan / Qwen-Image / Z-Image)とTencent(Hunyuan)が数週間おきに新モデルを投下しており、Xでの発表→即座にArtificial Analysisやコミュニティ個人アカウントによる検証・アリーナ再ランクという「発表→独立検証」のサイクルが定着している。
- クローズド側は「単発の画質競争」から「統合・エコシステム化」へ:Kling 3.0とFLUX 3はどちらも生成・編集・音声(さらにFLUX 3は行動予測/ロボティクスまで)を1モデルに統合する方向で足並みを揃えている。検索結果でも「the AI generator era is already ending, with competitors racing to own the whole process」という指摘があった。
- オープン/クローズドの境界が曖昧化:Black Forest LabsのFLUX 3は「Open-weight」を謳いつつ実際はgated early accessで始まり、後日open weightsを予告するなど、発表文と実態にギャップがある例が目立つ。文言だけで「オープンソース」と判断せず、ライセンス表記(Apache 2.0か否か)を都度確認する必要がある。
- ベンチマーク合戦の主戦場はArtificial Analysisのアリーナ:クローズド・オープン問わず「アリーナで何位」という数字が各社の一次告知に必ず添えられており、Xユーザーの間で共通の物差しとして機能している。
- VRAM要件の低さが売り文句化:Z-Image-Turbo(16GB)、HunyuanVideo 1.5(14GB)など、オープンソース陣営は「コンシューマGPUで動く」ことを繰り返しアピールしており、ローカル実行コミュニティ(ComfyUI界隈)への訴求が明確な戦略になっている。
Limits
- X本体へのログインなしアクセスは不可のため、全ての投稿は
site:x.com経由のGoogle検索結果とその要約から拾っている。個々のポストのいいね数・リポスト数など具体的なエンゲージメント数値は検索結果のスニペットに含まれておらず、ほとんどの投稿で確認できなかった(本文中で言及がある場合のみ記載)。 - 投稿の正確な投稿日時(年月日)はステータスIDから逆算できず、多くは「2026年内」までしか特定できていない。時系列の厳密な前後関係は保証できない。
- nitterミラーやThreadreaderは今回の検索では有効なインスタンスがヒットせず、直接参照はできなかった。
- Midjourney(v7/動画機能)、Adobe Firefly、Ideogram、Runway以外の欧米クローズドソース勢(Luma、Pika、Stability AI)についてはX上の一次ポストが薄く、二次情報(ブログ記事内の言及)止まりだった。
- 完了基準にある「約20件の投稿」は本ファイルの Posts セクションで21件(クローズド12件、オープン9件)を提示し満たしている。ただし同一トピックの続報ポスト(例: bfl_aiの複数ポスト)を1件として束ねている箇所があり、単純な投稿数カウントとしては実質25件以上のポストを参照した。
YouTube
YouTube — 画像生成・動画生成AIニュース(クローズドソース / オープンソース)
YouTube公式の検索結果ページ(youtube.com/results)はJS描画が重く、WebFetchでは本文が取得できずフッターしか読めなかった。そのため site:youtube.com <キーワード> でのWeb検索(WebSearch)経由で個々の動画URLを収集し、各動画は youtube.com/oembed?url=... (YouTube公式API)でタイトル・チャンネル名を一次確認、日付・内容はWebSearchのスニペットおよび元記事で裏付けている。視聴回数と登録者数はページ取得がフッターのみに切り詰められて確認できなかった(詳細は Limits 参照)。
Channels
クローズドソース系を報じるチャンネル
- Paul J Lipsky — Kling 3.0レビュー
- Theo - t3gg(t3.gg) — Nano Banana Pro分析
- NBC News — Nano Banana Pro / Sora報道(一般メディア)
- TheAIGRID — Sora 2速報
- OpenArt — Sora 2 / Wan 2.7ハンズオン
- Wall Street Millennial — Sora撤退の財務分析
- ElevenLabs — FLUX 3解説
- ApiTechTips — Seedance 2.5紹介
- LLM Master — Grok Imagine 0.9チュートリアル
- Standarity — Seedream 5.0 Pro解説
オープンソース系を報じるチャンネル
- Codedigipt — Wan 2.6 / Z-Image Turbo
- Sebastian Kamph — Wan 2.6 R2V
- Omar Ortiz — Wan 2.7 Image Pro
- Promptus AI — Z-Image vs Flux 2
- TensorArt — HunyuanVideo 1.5
- AI Search — HunyuanVideo 1.5ランキング
- Alibaba Cloud(公式) — Qwen-Image-2.0発表
- kintu — Qwen-Image-2.0レビュー
- fal(fal Academy) — LTX-2解説
登録者数はいずれも動画ページの取得が制限されたため確認できていない(Limits参照)。
Videos
クローズドソースの動向
- Kling 3.0: The Best AI Video Generation I've Ever Seen (Truly Incredible) — Paul J Lipsky — https://www.youtube.com/watch?v=p6cV7PitAvg — Kuaishou「Kling 3.0」のマルチショット映画的生成、ネイティブ音声・リップシンク、キャラクター一貫性を「今まで見た中で最高」と評価。
- Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN — Theo - t3gg — https://www.youtube.com/watch?v=UV9GqinedQ8 — GoogleのNano Banana Pro(Gemini 3 Pro Image)が画像生成競争でほぼ独走状態にあると主張。
- Google's Nano Banana Pro is raising concerns over realistic AI image generation — NBC News — https://www.youtube.com/watch?v=RmmrVCUGYp8 — 一般ニュース局がNano Banana Proのリアルさによる悪用リスクを報道。
- OpenAI's Sora 2 Just SHOCKED The Entire Industry! (10 Things To Know About Sora 2) — TheAIGRID — https://www.youtube.com/watch?v=y4RCSU6SsA0(2025年10月1日) — Sora 2の物理演算精度(体操・三回転ジャンプ等)とSNS型アプリ展開のインパクトを解説。
- Sora 2 Just Got An Update.....And? — OpenArt — https://www.youtube.com/watch?v=WmJrfuY8BXc — Sora 2のアップデートが期待したほどの進化ではないと懐疑的に評価。
- OpenAI is shutting down its Sora video creation app — NBC News — https://www.youtube.com/watch?v=6e3SINmPii4(2026年3月25日) — Sora単体アプリの終了をディープフェイク懸念とともに報道。
- OpenAI Shuts Down Sora After Losing Billions — Wall Street Millennial — https://www.youtube.com/watch?v=ZkRYH6PEP5k — Sora撤退を巨額の損失という財務面から分析。
- FLUX 3 Is Here — Everything You NEED to Know — ElevenLabs — https://www.youtube.com/watch?v=WlGmDRLZt9o(2026年7月23日発表直後) — Black Forest LabsのFLUX 3(画像・動画・音声・行動予測を統合)は「gated early access であり現時点ではオープンソースではない」と明言。
- ByteDance Seedance 2.5: 30-Second AI Video Generation with 50 Reference Inputs — ApiTechTips — https://www.youtube.com/watch?v=O2KNqKLANtQ — 2026年6月23日のVolcano Engine FORCEで発表されたSeedance 2.5(30秒生成・4K・クローズドAPI提供)を紹介。
- GRATIS Grok Imagine 0.9. Crea videos en 20 segundos. — LLM Master — https://www.youtube.com/watch?v=ScWkfsrDAkw — xAIのGrok Imagine v0.9が音声同期動画生成を全ユーザーに無料開放したことを解説。
- ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs(2026年7月) — レイヤー単位で部分編集できる新画像モデルSeedream 5.0 Proの発表内容を読み解く。
オープンソースの動向
- Wan 2.6 Just Changed AI Video Forever 😱 — Codedigipt — https://www.youtube.com/watch?v=gYcMhT-eZ_A(2025年12月16日) — Alibaba Wan 2.6のキャラクター同一性維持と1プロンプトからのマルチアングル自動分割を紹介。
- Wan 2.6 is HERE! R2V is AWESOME! — Sebastian Kamph — https://www.youtube.com/watch?v=dGDIpQz_l-E(2025年12月21日) — Reference-to-Video(R2V)機能のデモ、Apacheライセンスのオープンウェイトである点を強調。
- Taking Wan 2.7 For A Ride! Here's What I Found Out — OpenArt — https://www.youtube.com/watch?v=RERsGjQrQ6E(2026年4月) — Wan 2.7のハンズオンレビュー。Kling 3やVeo 3.1と比較しつつ無料・無検閲な点を評価。
- Wan 2.7 Image Pro: The AI Image Model Nobody Saw Coming — Omar Ortiz — https://www.youtube.com/watch?v=GIMVt4vCv20(2026年5月) — Wanが動画だけでなく画像生成でも急速に強くなっていると指摘。
- Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Alibaba Tongyi-MAIのZ-Image-Turbo(Apache 2.0)をNano Banana Pro級と紹介。
- New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — Promptus AI — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — Z-ImageがFlux 2を上回るとするベンチマーク比較企画。
- Tencent HunyuanVideo 1.5 has been officially open-sourced! — TensorArt — https://www.youtube.com/watch?v=MJShdc8tkkA(2025年12月) — 8.3BパラメータのDiTモデルが14GB VRAMのコンシューマGPUで動作、Apache 2.0で商用利用可能と説明。
- We have a new #1 open-source AI video generator! — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — HunyuanVideo 1.5をオープンソース動画生成の新王者と位置付け。
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Alibaba Cloud(公式チャンネル) — https://www.youtube.com/watch?v=NGkwBn0ebYk(2026年2月10日) — 7Bパラメータで生成・編集を統合、ネイティブ2K解像度・タイポグラフィ強化を一次発表。
- "Qwen Image 2.0 Review: Insane Image & Text Rendering + Editing Beast!" — kintu — https://www.youtube.com/watch?v=dxLDvd1a_Sk(2026年2月16日) — 第三者視点でQwen-Image-2.0の文字描画・編集性能を検証。
- LTX-2 Is Here - Native Audio AND Open-Source! | fal Academy — fal — https://www.youtube.com/watch?v=Odkj4zllsZg — LightricksのLTX-2を「音声と映像を同一パスで同期生成する初のオープンウェイトモデル」(ネイティブ4K/50fps、学習コードごと公開)として紹介。
Signals
- オープンソース陣営は中国発(Alibaba Wan/Qwen/Tongyi-MAI、Tencent Hunyuan)+イスラエル発(Lightricks LTX-2)が主戦場。 どのチャンネルも「Apache 2.0」「無料」「無検閲(uncensored)」をキーワードにクローズドモデルとの対比で紹介しており、動画のタイトルに "DESTROYS" "Nobody Saw Coming" のような煽り文句が頻出=オープンモデルが実力で話題を奪っている構図。
2026年に入ってWan 2.6→2.7、HunyuanVideo 1.5、Z-Image(Turbo)、Qwen-Image-2.0、LTX-2と、ほぼ月単位で新オープンモデルのレビュー動画が量産されている。 - クローズドソース陣営はGoogle(Nano Banana Pro)、OpenAI(Sora 2)、Kuaishou(Kling 3.0)、ByteDance(Seedance/Seedream)、xAI(Grok Imagine)、Black Forest Labs(FLUX 3)が乱立し、各社が「アリーナ順位1位」を主張し合っている状態。 ただしOpenAIのSoraアプリは2026年3月に単体アプリとして撤退しており(NBC News, Wall Street Millennial)、クローズド側でも収益化に苦しむプレイヤーがいることが動画から読み取れる。
- FLUX 3はクローズド/オープンの境界線上の話題。 Black Forest Labsは元々オープンウェイト路線で知られていたが、FLUX 3は「gated early access」であり、ElevenLabsの解説動画もその点をわざわざ明言している=コミュニティがオープン性の後退に注目している兆候。
- レビュワー系チャンネル(Codedigipt, OpenArt, Sebastian Kamph, Promptus AI)は新モデルが出るたびにクローズド・オープン双方を同じフォーマットで比較する動画を出しており、視聴者はプラットフォームではなく「どっちが無料でどっちが高性能か」で選んでいる様子がタイトルから伺える。
Limits
- 視聴回数・登録者数を一切確認できなかった。
youtube.com/watch?v=...をWebFetchで取得すると、返ってくるMarkdownがYouTubeのフッターナビゲーション(規約・著作権リンク等)のみで「内容が長すぎるため切り詰められました」という注記が付き、肝心の再生数・投稿日・チャンネル登録者数を含む本体データに到達できなかった。プレイブックが求める「views」「subscriber counts」は今回のツール環境では取得不能。 - 代替として
youtube.com/oembed?url=...&format=json(YouTube公式API)でタイトルとチャンネル名のみ確認した。投稿日は多くの場合WebSearchのスニペット(元記事・二次情報)から推測しており、動画ページ自体で確認したものではない。日付が確認できなかった動画は本文中で日付を省略している。 - Invidious系ミラー(
yewtu.be)も試したが、Botチェック(CAPTCHA)画面が返り本文は取得できなかった。pbj=1パラメータでの内部API取得も試したが空のJSONが返るのみだった。 - コメント欄(トップコメント)は本体ページが取得できない以上、今回は一切確認できていない。
- 検索(WebSearch経由の
site:youtube.com)は毎回10件前後のリンクを安定して返しており、Redditステージのような「プラットフォームが閉ざされている」状況ではない。むしろ動画本数は非常に多く、今回の11+11件は代表例の抜粋であり、プレイブックが定める上限枠(5〜12件)に収めるため意図的に絞り込んでいる。ブリーフが求める「約20件の解析」は、クローズド11件+オープン11件の計22件のタイトル・チャンネル・内容確認をもって満たしたと判断した。
Bluesky
Bluesky — 画像生成・動画生成AIニュース
Bluesky公式の検索API(public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)は今回の環境からのアクセスをすべて403 Forbiddenで拒否し、bsky.app自体もJavaScriptで描画されるSPAのため直接開いても本文・いいね数・リポスト数が取得できなかった(詳細は## Limits)。そのためWebSearch経由でGoogleにインデックスされたbsky.appページの断片情報から実在する投稿を拾い集めている。結果として、Wan2.6・Qwen-Image-2512・Kling 3.0・FLUX 3・GPT Image 2・MAI-Image-2.6・Z-Image-Turboといった2026年後半の最新モデル名では1件もBluesky上の投稿がヒットしなかった。X(output/x.md)とは対照的に、このテーマに関するBlueskyの存在感は非常に薄い。
Accounts
- @simonwillison.net — LLM/生成AI全般を追う独立系リサーチャー。画像生成モデルにも時々言及するが専門アカウントではない。
- @todaystopainews.bsky.social — AIニュースを自動収集して投稿するボット/アグリゲーターアカウント。
- @civitai-bot.bsky.social(CivitaiCheckPoint更新BOT) — Civitai上の新規/更新チェックポイントを自動ポストするボット。オープンソース系Stable Diffusionモデルのエコシステムを追う唯一の定常アカウント。
- @doctordiffusion.bsky.social — Stable Diffusion系モデルをCivitaiで公開している個人クリエイター。
- @luok.ai — SkyReels(Skywork AI)関連のオープンソース動画モデルに言及する個人アカウント。
- @dahara1.bsky.social — 日本語で生成AIのベータテスト体験を投稿する個人アカウント。
- @valeoai.bsky.social(Valeo.ai) — 自動運転向け動画/世界モデル研究を公式にオープンソース化するアカウント。画像/動画生成そのものではなく学術系オープンソース公開が中心。
- @midjourney.bsky.social — Midjourney公式プロフィールは存在するが、今回の検索で拾える最近の投稿は見つからなかった。
- @opensource.bsky.social(Open Source Initiative) — オープンソース全般の啓発アカウント。画像/動画生成AI専用ではない。
- Alibaba(Wan/Qwen-Image)、Tencent(Hunyuan)、Kling/Kuaishou、Black Forest Labs、Runway、xAI、OpenAIなど、Xで一次情報源になっているラボの公式Blueskyアカウントは今回確認できなかった。
Posts
クローズドソース
- Nano Banana ProのSynthID検出 — @simonwillison.net: 写真をアップロードしてAI生成かどうか判定させると、Nano Banana Proが埋め込む不可視のSynthID電子透かしを検出できると言及。日付不明(2026年内と推定)。いいね/リポスト数は未取得(Limits参照)。
- APIベンダーの機能収斂とFLUX採用 — @simonwillison.net: 主要LLM APIベンダーがコード実行・Web検索・文書ライブラリ・画像生成・MCPで足並みを揃えつつあると指摘し、その中で「image generation (FLUX for Mistral)」=MistralがBlack Forest LabsのFLUXを画像生成に採用している点に触れた。日付不明。
- Kling AI 1.6を使った実制作例 — @planet-gay-comic.bsky.social(2025-02-07): 「Spring Feelings Arise」という作品でKling AI 1.6を画像→動画変換に、SD-1.5を静止画生成に、Suno AI v4を音声に使ったと明かした投稿。クローズドソース動画生成ツールが個人クリエイターの実制作フローに組み込まれている具体例。
- Grokの今後についてのコメント — @wilkos.bsky.social(2026-06-05): 「Grok will lead the way in frontier models by training off more established and capable competitors」という一般的なコメント。画像/動画生成に特化した内容ではなく、Grok系フロンティアモデルへの言及として参考程度。
オープンソース
- 「検閲なしのローカル画像生成AI」拡散 — @todaystopainews.bsky.social(2026-06-30): 「New top local AI image generator is here! Already uncensored」というAIニュース自動投稿。ローカル実行可能なオープンウェイト画像生成モデルの話題をYouTube動画からBlueskyへ転載したもの。一次情報ではなくアグリゲーターボットである点に注意。
- SkyReels V1公開 — @luok.ai(2025-02-18): 「SkyReels V1 is the first open-source human-centric video foundation model」とSkywork AIのオープンソース動画基盤モデル公開を紹介。HunyuanVideoをベースに33種の表情・400種以上の自然な動きを学習。
- HunyuanVideoベータ体験記 — @dahara1.bsky.social(2025-03-06): 「動画生成AI(HunyuanVideo)のベータテストに参加し、1枚の画像から動画を作成できるようになった(I2V)」と日本語で報告。アニメ系素材での検証に言及。
- Civitaiチェックポイント自動更新 — @civitai-bot.bsky.social(2024-05-07): 「Dream Come TrueXL v4.0」(SDXL/SD1.5系)の更新をボットが自動告知。CivitaiのオープンソースSDモデルコミュニティが今もBluesky上に自動投稿の形で存在することを示す。
- Civitaiモデル配布 — @doctordiffusion.bsky.social(2025-01-19): 自作のStable Diffusion系モデルをCivitaiのリンク付きで共有。
- 自動運転向け動画/世界モデルのオープンソース化 — @valeoai.bsky.social(2025-02-24): 「Trained on YouTube?! We used OpenDV」として、論文(arXiv:2502.15672)・プロジェクトページ・GitHubコード・学習済み重み・学習レシピ・スケーリング則までを一式オープンソース公開したと告知。画像/動画“生成”そのものではなく動画理解寄りの世界モデルだが、企業アカウントが重み込みで一式オープン化する事例として参考掲載。
Signals
- 2026年の最新モデル名では検索がまったくヒットしない:Wan2.6、Qwen-Image-2512、Kling 3.0、FLUX 3、GPT Image 2、MAI-Image-2.6、Z-Image-Turbo、HunyuanImage 3.0、Runway Gen-4.5など、Xでは活発に話題になっているモデルのいずれについても、20件以上のクエリを試したがBluesky上の投稿は1件も見つからなかった。Bluesky上のこのテーマの会話は、Xのニュースサイクルとほぼ完全に切り離されている。
- 公式ラボアカウントの不在:Alibaba(Wan/Qwen)、Tencent(Hunyuan)、Kuaishou(Kling)、Black Forest Labs、Runway、xAI、OpenAIのいずれも、Xのように一次情報を発信する公式Blueskyアカウントが確認できなかった(Midjourneyのみハンドルは存在するが活動は不明)。発表がBlueskyに流れてくる経路自体が存在しない。
- 見つかる話題は「西側・Stable Diffusion/Civitai」寄りで、しかも古い:見つかった投稿の大半は2024〜2025年前半のもので、CivitaiやStable Diffusion系のホビイストコミュニティに集中しており、2026年の中国系ラボ主導の競争(Wan/Qwen/Hunyuan/Z-Image)とは別世界の話題になっている。
- プラットフォームの文化的な逆風:BlueskyのアートフィードキュレーターbSky.artは「Trending」等のフィードに“AI除外リスト”を導入しており、Bluesky社自身も「ユーザーのコンテンツを生成AIの学習に一切使わない」と明言している。AI生成コンテンツを積極的に可視化しない文化が、この分野の会話が育たない一因と考えられる。
- 一次情報ではなくアグリゲーターボット経由:見つかった数少ない「新しいモデル」系の投稿(todaystopainews.bsky.social)もYouTube動画の転載であり、モデル開発元による一次発表ではない。
- 移住した著名AI論者の言及は散発的:X/Twitterから移った著名なAI解説者(Simon Willisonなど)も、画像/動画生成モデルを専門的に追うのではなく、LLM全般の話題の中で時々触れる程度。
Limits
- Bluesky公式の検索API
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPostsは、直接アクセス・複数のCORSプロキシ経由(allorigins.win, corsproxy.io, codetabs.com等)のいずれでも403 Forbidden(一部522)を返し、投稿本文・いいね数・リポスト数・投稿日時をAPIから直接取得することができなかった。 bsky.appの検索画面・プロフィール画面・個別投稿の permalink はいずれもJavaScriptで描画されるSPAで、取得できた本文は空のアプリシェル(「Bluesky」または「@handle on Bluesky」というタイトルのみ)だった。そのため、本レポートの投稿はすべてWebSearchがGoogle経由でインデックスしたbsky.appページのスニペットから再構成したものであり、いいね数・リポスト数は今回すべて未取得(Postsセクションで数値を示せなかった理由)。- 上記の制約により、Bluesky検索エンジンのインデックスが薄く・古いテーマについては実質的に何も出てこない。2026年の最新モデル名によるクエリはすべて空振りに終わり、代わりに2024〜2025年の投稿しか拾えなかった。これは「Blueskyにニュースがない」ことの証明ではなく、「検索インデックス経由でしか覗けない」という今回のアクセス手段の限界を反映している可能性が高い点は留意されたい。
- 完了基準にある「約20件の投稿の解析」は、実データへの直接アクセスが遮断されていたため、Bluesky単体では満たせなかった。上記10件(クローズド4件、オープン6件)が、今回の環境から実在を確認できた投稿の全てであり、これ以上ボリュームを増やすには公式アプリでのログインや別のAPIアクセス手段が必要と判断し、ここで打ち切った。
Lemmy
Lemmy — 画像・動画生成AIニュース調査
Communities
- [email protected](約5,600〜5,700人)— オープンウェイトの画像・動画生成モデルの話題全般。ComfyUIカスタムノードやHugging Faceの新モデルが毎日のように流れてくる、今回一番の当たり場所。
- [email protected](2,359人)— Stable Diffusion / オープンウェイトモデルで作った作品の投稿場。
- [email protected](1,593人)— アニメ系AIアート専用、SFW限定。
- [email protected](1,662人)— 「オープンソースのディープラーニングモデル」としてのSD談義。
- [email protected](52人)、[email protected](50人)、[email protected](102人)、[email protected](96人)— ニッチなテーマ別コミュニティ、規模は小さい。
- [email protected](222人)— lemmy.dbzer0.comコミュニティのミラー/別コミュニティ、投稿数は少なめ。
- [email protected]、[email protected]、!ai_reddit(各インスタンス)、[email protected] — クローズドソースAI(Grok、Sora、Nvidia DLSS等)のニュースや反AI感情が流れてくるのはこちら。サブスクライバー数は非公開/変動が大きく確認できず。
Posts
- OpenAIがSoraをシャットダウン、3000万ドル映画が水の泡に(!ai_reddit, 2026-05-27, スコア1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/ 。Sora 2アプリ・API終了(API終了は2026-09-24予定)の余波として、Soraで制作していたAI映画プロジェクトが頓挫したという投稿。関連: 「How OpenAI scrapping Sora points to tech problems」(!openai, 2026-04-13) https://timesofindia.indiatimes.com/technology/ 、「Why OpenAI abandoned Sora」(!kagismallweb, 2026-04-03) https://onemanandhisblog.com/2026/03/ 。
- xAI「Grok」の画像生成が実子の性的画像7000枚生成に使われたと報道、およびCSAM生成訴訟でxAIが提訴される([email protected], "Child sexual abuse survivor alleges Elon Musk's AI chatbot used photos of her to generate new illegal images", 2026年8月末頃, スコア119) — https://lemmy.world/post/51492879 。トップコメントは「億万長者が責任を取らない構造」への批判。
- 米連邦判事、AI生成の児童性的虐待表現物は憲法修正第1条で保護されると判断(!technology, 2026-08-30, スコア16) — https://reason.com/volokh/2026/08/27/ 。クローズド/オープン問わず生成AIの法的線引きに関わる大きな話題として複数インスタンスに転載([email protected]版も)。
- Nvidia DLSS 5、性能50〜60%低下と引き換えのAI画像強化フィルター([email protected], 2026-09-02〜09-03, スコア21) — https://www.pcgamer.com/hardware/graphics-cards/dlss-5-comes-with-a-massive-50-60-percent-performance-hit/ 。関連投稿「Nvidia Announces DLSS 5...An AI slop filter over your game」https://lemmy.world/post/44347792 、体験版流出を報じた「Experimental Build Of Nvidia's DLSS 5 AI Slop Filter Leaks...」https://lemmy.world/post/51240561 も同時期に話題。
- Google Nano Banana 2 Lite公開(!swisstechnews, 2026-07-02、!hackernews転載2026-06-30) — https://www.itmagazine.ch/artikel/87529/ 、https://deepmind.google.com/models/ 。Gemini 3系列の軽量版画像生成モデルとして紹介。
- Microsoft「MAI-Image-2.5」がNano Banana級に追いつく(!ai_reddit, 2026-05-28, スコア1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/ 。MicrosoftがGoogleに対抗する自社クローズド画像モデルを投入した件。
- ByteDance「Seedream 5.0 Pro」の実写比較レビュー(!ai_reddit, 2026-07-10, スコア1) — https://www.reddit.com/gallery/1usc03q 。
- Adobe Firefly、パブリックベータ公開(!swisstechnews, 2026-04-28) — https://www.itmagazine.ch/artikel/87034/ 。PhotoshopへのAIチャットボット・生成音声統合(!boycottus, 2025-10-29, スコア22 https://alternativeto.net/news/2025/10/adobe-adds-ai-chatbots-to-photoshop-premiere-ai-masking-and-generative-audio-in-firefly/ )も継続議論されている。
- 「AIディープフェイクをどれだけ恐れるべきか」議論([email protected], 2026-05-20頃, スコア21) — https://lemmy.world/post/47088326 。投稿者はディープフェイク対策でオンライン上の自分の写真を全削除。コメントでは「立場によってリスクが違う」「女性はよりリスクが高い」といった指摘。
- MiniMax H3(Hailuo 3.0)のオープンウェイト公開とComfyUIによる商用ライセンス独占販売([email protected], "ComfyUI MiniMax H3 Commercial Licensing", 2026-08-28, スコア4) — https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。重みはオープン(MiniMax Community License、年商2000万ドル未満は商用利用可)だが、商用ライセンスと導入支援はComfyが独占販売という「オープン風味の商業モデル」。テキスト・画像・動画・音声を一つのトランスフォーマーで扱い、最長15秒・2K・ネイティブステレオ音声出力。関連ツール投稿多数(MiniMax-H3-Acc-LoRAs、MotionCache-FastVAE、Director-Cut-Studio等、いずれも2026-08-28〜09-02)。
- LTX-2.3 / LTX-2.5(Lightricks製オープンウェイト動画モデル)関連ComfyUIノード続々(!stable_diffusion, 2026-08-27〜09-01) — 例: https://github.com/nazgut/ComfyUI-LTX2.3-CLSS 。LTX-2.5は22Bのオープンウェイト音声動画モデルでマルチショット生成・4K HDR出力対応、H3登場前まではオープンウェイト動画の首位だった。
- Trellis.2 と Pixal3D がComfyUIにネイティブ対応(!stable_diffusion, 2026-09-01, スコア4) — https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。画像・動画だけでなく3D生成もComfyUIエコシステムに統合。
- Boogu-Image-0.1公開(!stable_diffusion, 2026-06-17, スコア5) — https://boogu.org/ 。10BパラメータでApache-2.0ライセンス完全オープン、Qwen-Image-Benchで上位、Base/Turbo/Editの3バリアント。「小さな計算予算でもクローズドソース級の性能が出せる」ことを謳う代表例。
Signals
- クローズドソース側の空気: 話題の中心は「新モデル発表」より「炎上・訴訟・撤退」。Sora撤退、Grok CSAM訴訟、DLSS5の性能低下批判など、ネガティブなニュースの方がスコアも伸びやすい(DLSS5関連21点、Grok訴訟119点)。[email protected]系コミュニティでの反AI感情も強い。
- オープンソース側の空気: [email protected]は実質「ComfyUIエコシステムの更新ログ」と化しており、MiniMax H3・LTX-2.3/2.5・Flux・Qwen Imageまわりの新カスタムノードやLoRAがほぼ毎日投稿される。作品投稿より開発者向けツール投稿の方が多く、コミュニティは実用志向。
- オープン/クローズドの境界が曖昧化: MiniMax H3は「オープンウェイトだが商用ライセンスはComfyが独占販売」というハイブリッド形態で、単純な二分法が崩れつつある。
- Lemmy全体としてはRedditのミラーコミュニティ(!ai_reddit等)経由の転載が多く、一次情報としてのオリジナル投稿は [email protected] が最も豊富。
Limits
- LemmyはX/YouTube/Redditに比べて母数が小さく、動画生成AI単体を扱うコミュニティ(例: !video_generation のような専用コミュニティ)は見つからなかった。動画系の話題はStable Diffusionコミュニティ内のツール投稿(LTX、MiniMax H3、WanGP等)に埋もれる形でしか見られない。
- LemmyのグローバルサイトサーチAPIはキーワードによってはヒット0件(例:
video generation単体、Ideogram/Seedream/Qwen Image個別検索)で、実際に投稿がないのか検索インデックスの制約なのか区別できなかった。 - 各コミュニティの購読者数はインスタンスごとに表示が食い違う(例: [email protected]は5.05K/5.64K/5,707など出典によって差)。連合型SNSの仕様上、正確な単一の数値は取得できなかった。
lemmy.world/c/stable_diffusion_artのコミュニティページは直接フェッチ時にサーバーエラー(HTTP 500)となり、投稿一覧はAPI検索経由の情報で代替した。- 具体的な「20件の投稿」を単一プラットフォーム上で完全に精査するには至っておらず、本レポートはAPI検索・Web検索を通じて確認できた実在の投稿・リンクのみを厳選して13件収録した(架空のリンクは含めていない)。
Pinterest — 画像・動画生成AIニュース(クローズドソース / オープンソース)
収集済みの50件のPin(output/pinterest.pins.md)のうち32件を画像として開いて内容を確認した(ジャンル分けなしの単一検索結果)。
Visual themes
- YouTube発クリックベイト系サムネイルが最多勢力。 全角太字の見出し、驚き顔のクリエイター写真、ネオンブルー/パープルの光るロボット頭部が繰り返し登場する。「huge AI news」「AI NEWS」「15 Biggest AI Updates」といった動画サムネがそのままPinterestに転載されている構図 [1, 6, 8, 13, 14, 26, 47]。
- 「Top N ツール」比較インフォグラフィックが乱立し、同一テンプレートの使い回しも確認できる。 [16]と[40]はどちらも「BEST QUALITY(PAID) vs BEST FREE」の同一レイアウト(ChatGPT Plus/Gemini Advanced/Midjourney/Adobe Firefly/Recraft/Runway Gen-3/Luma/Pika Pro/Kaiber/Synthesia を左列、Ideogram/Gemini Free/SeaArt/Playground/Krea/Canva/Inkscape/CapCut/Pika Free/Runway Free を右列に配置)で、色味とアカウントの透かし(「DA」)だけが違う ― 情報ではなくテンプレートが複製・量産されている証拠。他にも [10]「Top AI Video Generators of 2025」というタイトルなのに実際の画像は映画的なムードボード風コラージュで中身が一致しない、[42]は「Video generation 📹」というだけの汎用タイトルなのに中身は Runway をハイライトした「TOP 10 IMAGE-TO-VIDEO GENERATOR TOOLS」ランキング(Kling, Google Veo, Sora, Luma, Pika, Kaiber, Synthesia, HeyGen, Adobe Firefly, InVideo)という具合に、タイトルと画像内容が食い違うPinが多い。
- ダークネイビー×ネオンブルーの「テック未来感」パレットが、具体的なニュースというより汎用のAI啓蒙グラフィックに使われている。 光る脳、サーキット模様、ロボット頭部のアイコンは、動画/画像生成に限らずAI全般の記号として流用されている [2, 12, 30, 32, 36, 49]。
- 実名プロダクトのデモ画像は少数だが具体性が高い。 Google Veo 2 の複数シーンコラージュ+「Sign up to try on VideoFX」CTA [5]、Gemini API 経由の Veo 3 image-to-video(画像入力+テキスト入力→高速生成のじょうご状グラフィック)[9]、Microsoft VASA-1(1枚の写真+音声クリップ→複数表情のトーキングヘッド生成グリッド)[18]、ShengShu Vidu S1(「リアルタイムAIインタラクションの世界最高峰モデル」を謳うアニメ調キャラクターUI)[25]、AMD Amuse 3.0(「AI generated image created on AMD Ryzen AI」とクレジットされた写実的な老漁師のポートレート、ローカル/オンデバイス生成の希少な言及)[33]、そして同一のソース動画を「木製ブロック」「折り紙アート」「カラフルなブロック玩具」「花」の4スタイルに変換し、さらに Tesla Model 3 やパンダの頭部を別の見た目に変換して見せる Luminate 風のスタイル変換デモ [3]。
- ディープフェイク不信・検知への不安を視覚化したPinが目立つ。 可愛い猫写真に捏造されたエンゲージメント数字(1.2K いいね、7.4K 再生)と赤い「FAKE」スタンプを重ねた画像 [1]、「97% likely AI generated」の音声検知UIと人間/サイボーグに分かれた目のビジュアル [12]、AI動画の「Good or Bad?」を賛否両論で並べたスコアボード(利点:時間短縮・低コスト・高品質/欠点:人間らしい創造性の欠如・感情的つながりの欠如・過度な依存)[19]。
- 市場規模・成長率を根拠なく打ち出す統計インフォグラフィック。 「AI Video Generator Market: USD 2.56B by 2032、CAGR 20%」[48]、「2026年までにオンラインコンテンツの80%が動画を含む」という予測付きの「6+ Best AI Video Generation Websites」リスト(Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI)[6]。
- 「AIニュースキャスター」「AI顔出し不要チャンネル」系のサービス広告Pin。 実際のニュースではなく、AIリップシンクでニュース番組風動画を作るサービスの宣伝サムネイル [46]。
Notable pins
- [3] ソース動画を「木製ブロック/折り紙/レゴ/花」の4スタイルに再変換し、Tesla やパンダの頭部変換も並べた比較デモ。今回開いた中で最も具体的なスタイル変換動画生成の証拠。
- [5] Google Veo 2 のローンチ画像。顕微鏡シーン、水中スイマー、アニメ調の少女、フラミンゴなど全く異なる6シーンを1枚に並べ「Sign up to try on VideoFX」を訴求。
- [9] Gemini API 経由の Veo 3 image-to-video。画像入力+テキスト入力が高速生成に収束する漏斗状グラフィックで、ネイティブ音声対応を示唆。
- [18] Microsoft VASA-1。1枚の写真+音声クリップだけで、十数種類の表情のトーキングヘッド動画を生成するグリッドを提示。
- [25] ShengShu Vidu S1。「リアルタイムAIインタラクション向け世界最高モデル」を謳うアニメ調キャラクターのプロモ画像。
- [28] 「15 Biggest AI Updates」インフォグラフィック。今回のPinの中で数少ない、具体的な画像生成系リリース名(Grok Imagine Image 2.0 の画像編集・リサイズ機能)と DeepSeek V4 Pro のAPI値下げに言及。
- [32] 「Google が1500万件のチャットを分析」統計カード。AI利用の86%が業務外という調査結果と、AIエージェントがコーディングコンテストで参加526チーム中458チームより上位に入ったという逸話を紹介。
- [1] 猫写真に「FAKE」スタンプと捏造エンゲージメント数字を重ねた画像。このPin群全体を貫くディープフェイク不信の空気を象徴。
- [33] AMD Amuse 3.0。「AMD Ryzen AI で生成」とクレジットされた写実的ポートレートで、今回唯一のローカル/オンデバイス生成への言及。
- [16]/[40] 同一の「Best Quality(有料) vs Best Free(無料)」AIツール比較チャートが、色違い・アカウント違いで2件重複投稿されている ― 情報の中身ではなくテンプレートの複製・量産を示す発見。
Signals
- クローズドソースの大手ブランド(Google Veo、OpenAI Sora、Runway、Kling、Pika、Luma、Midjourney、ChatGPT/DALL-E系、Adobe Firefly、Synthesia)が「Topツール」系Pinで繰り返し名指しされ、Pinterest上のツール比較コンテンツの主役になっている([6, 10, 16, 24, 40, 42] など)。
- オープンソースを名乗るPinはほぼ皆無。 Stable Diffusion、Flux、Wan、HunyuanVideo、ComfyUI のワークフロー画面といった、いわゆるオープンウェイトモデル関連の画像は32件中1枚も見当たらなかった。唯一「ローカル/オンデバイス」寄りと言えるのは AMD Amuse 3.0 [33] のみで、これも厳密なオープンソースというより企業製ツールのローカル実行デモ。
- Pinのタイトルと実際の画像内容が食い違うケースが多い。 「Google announces...」[3]や「Google announces video generation AI 'Veo 3'」[37、下記Limits参照]のようにビッグネームを冠したタイトルが付いていても、実際の画像には該当ブランドのロゴや証拠が見当たらないPinが複数あり、タイトルがSEO/クリックベイト目的で盛られている可能性が高い。
- 「速報」を装うPinの中身が実は汎用・使い回しテンプレートであることが多い。[30]の「Breaking News」モックアップは GPT-5、Llama 3.1、Claude 3.5 といった既に一般化した過去のモデル名を並べており、日付が更新されない常設テンプレートと見られる。
- 総じて、Pinterest上のこのテーマは「ニュースを伝える」よりも「AIツール導入・比較を売り込む」「AIへの不安を煽る」「YouTubeサムネの二次配布」という3つの目的に偏っており、ブリーフが求める最新ニュースの速報性という観点では他プラットフォーム(X, YouTubeなど)の方が一次情報に近い。
Limits
- 収集済み50件のPinのうち32件([1, 2, 3, 5, 6, 8, 9, 10, 12, 13, 14, 16, 18, 19, 20, 24, 25, 26, 28, 29, 30, 32, 33, 36, 37, 40, 41, 42, 46, 47, 48, 49])を画像として確認した。残り18件([4, 7, 11, 15, 17, 21, 22, 23, 27, 31, 34, 35, 38, 39, 43, 44, 45, 50])は未確認。
pinterest.pins.mdにはジャンル区分(## <genre>セクション)が存在せず、全50件が単一の検索結果として並んでいるため、ジャンル別の集計はできなかった。- [37]「Google announces video generation AI 'Veo 3'」というタイトルのPinを開いたところ、実際の画像は紫色のモンスターキャラクターが入力画像から3種類の異なる環境(サーバールーム、水中遺跡、キャンディの街)へ動画変換されているデモで、Googleブランドや Veo 3 のロゴは一切確認できなかった。タイトルの主張は画像だけでは裏付けられないため、事実としては採用していない。
- Pinの画像そのものを読み取っているだけで、実際のPinterestページ上の保存数・コメント・投稿日時などのエンゲージメント指標は確認できていない(
pinterest.pins.mdにもその情報は含まれていない)。 - ブリーフが求める「クローズドソース最低10件・オープンソース最低10件の気づき」のうち、オープンソースに直接該当する気づきはPinterestからはほぼ得られなかった(AMD Amuse 3.0 [33] のみ関連性あり)。オープンソースの動向はX・Reddit・Lemmyなど他プラットフォームのステージで補うことを推奨する。
推奨アクション
- クローズドソースの動向はXとYouTubeを一次情報源として継続的にモニタリングする。
- オープンソースの実装トレンドはLemmyの[email protected]をComfyUIエコシステムの定点観測に使う。
- Reddit・Blueskyは次回以降ログイン済みセッションや公式API鍵など別のアクセス手段を用意しないと有効な調査ができない。
- Pinterestはニュース速報用途には向かないため、次回はビジュアルトレンド分析用途に絞って使う。
- 「オープンウェイトを名乗るが実態はgated/ハイブリッドライセンス」の事例(FLUX 3, MiniMax H3)は都度ライセンス文言を確認してから分類する。
- Sora撤退やGrok訴訟のような法的・炎上系ニュースはLemmyの方が早く実例を伴って出てくるため定期チェックに加える。
収集画像


















































データ品質メモ
Redditはアクセス遮断で投稿0件、Blueskyは検索API遮断のため2024〜2025年の古い投稿しか拾えず2026年の主要モデルには一件も触れられなかった。Pinterestはオープンソースの気づきをほぼ提供できず、6プラットフォーム中X・YouTube・Lemmyの3つが主要な根拠となっている。



