KEN’S CAT LOG

Image and Video Generation AI News — 2026-09-09

クローズドはGoogleのNano Banana ProとOpenAIのGPT Image 2が2強、Soraは終息へ向かう一方、オープンソースはQwen-Image/FLUX/Wan/HunyuanImageがクローズド級品質に迫っている

画像・動画生成AIニュースまとめ — 2026-09-09

よっしゃ集めてきたぜ〜🔥 結論から言うと、クローズド側はGoogleのNano Banana Pro(Gemini 3 Pro Image)とOpenAIのGPT Image 2が2強で殴り合ってて、Sora単体アプリはもう終わりかけ、動画はKling・Seedance・Veoの中華+Google勢が主戦場になってる感じ😤 一方オープンソース側はQwen-Image・Z-Image・FLUX・Wan・HunyuanImageあたりが「タダでもここまでできるの!?」ってレベルまで来てて、ComfyUIとかローカル勢のコミュニティは相変わらず元気いっぱい💪 ただXだけは今回マジで空振りだったから、そこは正直に書いとくわ。

Across platforms

クローズドソースの気づき(10)🏢

  1. Nano Banana Pro(Gemini 3 Pro Image)が「画像生成でもう他モデル圧倒してる」って評判、YouTubeで話題独占 → https://www.youtube.com/watch?v=UV9GqinedQ8
  2. OpenAIのGPT Image 2登場。12言語以上でテキスト精度99%超、Thinkingモードで1発8枚生成、4K対応も進行中 → https://www.youtube.com/watch?v=blOlUnC75O4
  3. Googleは2026年8月17日にImagenを完全終了してNano Banana系に一本化。クローズド画像はGoogleに寄せる動き
  4. OpenAIはSoraアプリを4月26日で終了、Sora APIも9月24日に廃止予定。Soraブランドは事実上終わりかけ → https://lemmy.world/post/44721138
  5. Bluesky民のdahara1も「無料版Soraがクレジット切れで動かない」って報告済み → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
  6. xAIのGrok Imagine Image 2.0(8/7リリース)がArenaでGPT Image 2の僅差2位につけて三つ巴に
  7. ByteDanceのSeedance 2.5が8/7にAPI一般公開、Veo 3.1・Kling 3.0と並ぶ主力に
  8. Reddit民がSeedance 2.5とオープンのWan 3.0を同一プロンプトで比較、意見割れまくり → https://www.reddit.com/r/generativeAI/comments/1w60fip/
  9. Midjourneyが画像生成からまさかの超音波医療スキャナー事業に方向転換して炎上気味、Theranosになぞらえる皮肉も → Lemmy(theregister.com経由)
  10. ByteDanceとハリウッド(MPA)がAI著作権保護で世界的合意、著作権対応の動きも本格化 → Pinterest調べ
  11. RedditではAIで「本物の手描きタイムラプス」を偽装する技術に7,088ポイントの大炎上、AIラベリング義務化を求める声も → https://www.reddit.com/r/antiai/comments/1w81kdd/
  12. Bluesky(luok.ai)だけで2025年12月〜2026年2月にKling・Runway・PixVerse・Vidu・Seedance・Nijiと立て続けに新モデル、中華勢の勢い顕著

オープンソースの気づき(10)🛠️

  1. Qwen-Image 2512(Alibaba, Apache系)とZ-Image Turboが2大トレンド、比較動画乱立中 → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  2. Flux 2.0がQwen-Image 2512/Z-Imageに15項目ストレステストで挑まれてる → https://www.youtube.com/watch?v=54zvSiAWz2Y
  3. LightricksのLTX-2.3(220億パラメータ、音声同期・4K/50fps)がクローズド級品質と評判 → https://www.youtube.com/watch?v=qQXzlk134Sw
  4. AlibabaのWan 2.5が「クローズドのVeo 3を超えた」って主張する実践動画も → https://www.youtube.com/watch?v=yvD8TxNsR4Q
  5. 複数OSSモデル(LTX-2.3・Qwen・Flux.2 Klein・Z-Image)を束ねる無料エージェント「WanGP」登場、統合ワークフロー化が進行中 → https://www.youtube.com/watch?v=h-k6xOEITx4
  6. TencentのHunyuanImage 3.0(80B超MoE)が今も大型OSS画像モデルの参照点
  7. Black Forest LabsのFLUX 3が画像+音声付き20秒動画に対応、限定リリース → https://bfl.ai/blog/flux-3
  8. FLUX.2-klein-9b-kv-fp8の軽量版やFLUX Creator Program開始、スコセッシ監督までアドバイザー参加
  9. LemmyのStable Diffusion系コミュニティは5,000人規模でも毎日ComfyUI/SDXL/Krea2の作品投稿が続いてて実運用の厚みがすごい
  10. BlueskyのSimon Willisonが「M5 MacBookでQwen 3.7 27Bをローカル実行、17GB GGUFでベストなペリカン画像」と報告、ローカルLLM画像生成力のベンチマーク文化に → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
  11. オープン動画基盤モデルSkyReels V1(HunyuanVideoベース)や無料オールインワンOSSワークフロー「Open Creative Studio」もコツコツ更新中 → https://bsky.app/profile/perilli.com/post/3mdddenkss22v

プラットフォーム横断で刺さったポイント:クローズド対オープンの構図は「手軽だけど検閲・コスト高いクローズド」vs「自由だけど手間かかるオープン」って評価がReddit・YouTube・Lemmyで繰り返し出てくる。あと「無料・無制限」を謳うツールへの懐疑は複数コミュニティで一致🙅‍♂️。逆にPinterestだけはこの二項対立があんまり見えなくて、ツール紹介・ニュースサムネがメインだったのも面白いポイント。

Platform by platform

Reddit:12スレッド収集。反AIスレ(7,088pt)が技術トピック全部合わせたより目立つくらいバズってて、「AI悪用への反発」の方が可視化されやすいってのがリアル。r/StableDiffusionなど中核subredditは今回ノーヒットで、カバレッジに穴あり。

X:正直ここは完全にスカだった😅 ワーカーの検索語が"Harvey"や"$LAPTOP"とかテーマと無関係な語だったせいで、収集した40件のうち画像・動画生成AI関連はゼロ件。これはブリーフが挙げた6プラットフォームの中で唯一の本物のギャップ。

YouTube:レビュー・比較動画が充実。クローズドはGoogle/OpenAI/xAIの三つ巴、オープンはQwen-Image・FLUX・Wan・LTX-2.3・HunyuanImage・WanGPの統合ワークフローまで幅広くカバーできた。ただ再生数・登録者数はJS依存で取得不可、数値的な鮮度比較はできず。

Bluesky:検索API(searchPosts)が全クエリ403で使えず、アカウント経由のフィード読みに切り替えた結果、クローズド動画勢(luok.ai経由)は厚いがオープン動画の話題は薄め。SkyReels V1くらいしか見つからず。

Lemmy:Midjourneyの医療転身騒動とSora終了への皮肉が目立つクローズド系ニュース。オープンはBlack Forest Labs(FLUX系)一強で、四半期ごとに具体的な動きがコンスタントにある。

Pinterest:50ピン全部画像確認。ロボット顔+ネオンのニュースサムネ、ツールまとめインフォグラフィックが主流で、Stable Diffusion/ComfyUIみたいな「自己ホスト型オープン」文化を象徴する画像は50件中ゼロ。エンゲージメント数値も基本取得不可。

What to watch

  • OpenAIのSora API廃止(2026年9月24日予定)— Lemmy https://lemmy.world/post/44721138
  • Grok Imagine Image 2.0 vs GPT Image 2のArenaランキング推移 — YouTube(Marin Method系比較動画)
  • Qwen-Image / Z-Image / FLUXのオープンソース三つ巴、どれが標準になるか — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  • Midjourneyの超音波医療スキャナー事業が本当に成立するか — Lemmy(theregister.com経由)
  • ByteDance×ハリウッド著作権合意の具体的な運用ルール — Pinterest調べ [24]
  • WanGPみたいなOSS統合エージェントがどこまで普及するか — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4

Recommendations

  • X向けの追加収集は検索語を"Midjourney" "Stable Diffusion" "Sora" "Nano Banana" "Qwen-Image"などテーマ直結の語に差し替えて再実行すべき。
  • Reddit調査はr/StableDiffusion・r/midjourney・r/comfyuiなどコア大規模subredditを次回から必ず含めるべき。
  • Bluesky検索API(403)の代替として、今回見つけた主要アカウント(luok.ai, simonwillison.net等)をウォッチリスト化して定点観測に切り替えるべき。
  • クローズド/オープンの二項対立を可視化するには、Pinterestより意見が濃いReddit/Lemmyのコメント欄を優先材料にすべき。
  • OpenAIのSora API廃止(9/24)とMidjourneyの事業転換の続報は次回リサーチで最優先チェック項目にすべき。

Data quality

Xは検索語のミスマッチにより画像・動画生成AI関連の投稿を1件も収集できず、実質的にデータなし。Bluesky・Pinterestは検索APIやエンゲージメント数値(再生数・いいね数)を取得できず、話題の広がりを定量的に裏付けられていない。YouTubeも動画本文・再生数はJS依存で取得不可、WebSearchのスニペット頼りだった。それ以外(Reddit・Lemmy)は概ね量・質ともに十分な材料が集まった。

プラットフォーム別まとめ

Reddit

Reddit — Image and Video Generation AI News

Where

収集された12スレッドは8つのsubredditに分散している。

Subreddit メンバー数 収集スレッド数
r/generativeAI 151,605 4
r/antiai 319,039 1
r/RemoteWorkers 75,979 1
r/Seedance_AI 20,508 1
r/freetoolsAI 7,942 1
r/aivideomaking 6,614 2
r/AItips101 1,153 1
r/Unrouted_AI 517 1

生成AI全般を扱う r/generativeAI が最多で4スレッド。一方でスコア・コメント数で圧倒しているのは AI 画像生成に批判的な r/antiai の1スレッドで、他の全スレッドの合計を大きく上回るエンゲージメント(後述)。

What people say
  • 無検閲・自由度重視の統合プラットフォームが台頭:スレッド1(r/AItips101, 81 points, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/)は「WildOwl.ai」を筆頭に、Qwen Image / Flux / Seedream / Wan / Kling / Seedance / Veo / GPT Imageなど35以上のモデルにアクセスできるサブスク不要の従量課金サービスを紹介。コメントでu/reliablemicrophone84は「WildOwl really does solve that exact problem you mentioned about not having to choose between cutting-edge models and creative freedom」と評価しつつ、u/Clear-Assistance449はMage.spaceの無制限サブスクを推す対抗意見も。
  • 「無料・無制限」への強い懐疑:スレッド2(r/aivideomaking, 2 points, 22 comments, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/)とスレッド5(r/generativeAI, 1 point, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/)で共通して「本当に無料・無制限のものは存在しない」という意見が優勢。u/ai_art_is_art(スレッド5, 3 points)は「Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations.」と痛烈。
  • 45秒動画リクエストが失笑を買う:スレッド4(r/aivideomaking, 13 points, 22 comments, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/)でスマホ・iPadだけで無料の45秒AI動画を作りたいという投稿に、u/NewLifeWares(2 points)は「45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator...with a watermark」と技術的な壁を指摘。
  • AIによる「本物の手描き」偽装が大炎上:スレッド3(r/antiai, 7,088 points, 1,023 comments, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/)はGPT-6級LLMにマウス・キーボードを操作させ、ペイントソフト上で「本物のタイムラプス」を偽造できるようになったという投稿。今回収集した全スレッド中で圧倒的最高スコア。u/Nayutantantan(2,512 points)は「the trends of creating fake timelapses are getting common」と失望を表明し、u/Soggy_Supermarket100(171 points)は「EVERY SINGLE online space NEEDS AI filtering」とAIラベリングの即時義務化を要求。
  • 実写有名人のディープフェイクは「ユーザー責任」論に収斂:スレッド6(r/Seedance_AI, 0 points, 22 comments, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/)でu/Jean_velvet(7 points)は「Recent court cases put it in the responsibility of the user...It's the distribution and sharing that's the potential crime」と法的責任の所在を説明。他方でu/Alchemist42(1 point)は「They don't use Seedance」と、規制の緩い別ツール利用を示唆。
  • クローズド対オープンのモデル対決:スレッド10(r/generativeAI, 110 points, 31 comments, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/)は同一プロンプトでSeedance 2.5(クローズド、ByteDance系)とWan 3.0(オープンウェイト、Alibaba系)を比較。u/SpecialistDragonfly9(5 points)は「it looks like seedance is the by FAR superior one」と評価するが、u/Positive-Key6640(5 points)は「Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better」と比較方法論そのものに疑義。
  • OpenAIの新画像モデルが静かに話題に:スレッド7(r/Unrouted_AI, 2 points, 6 comments, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/)はOpenAI公式ブログ「introducing-chatgpt-images-2-5」へのリンク投稿。u/Ok_Homework_1859は「I'm really interested in the the Sketch feature, which lets you draw in ChatGPT to guide your image」とスケッチガイド機能に注目。
  • 著作権キャラクターの生成規制への不満:スレッド11(r/generativeAI, 2 points, 2 comments, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/)でDisneyキャラの個人利用ファンアートすら作れないGrokへの不満が投稿され、u/frightenが「PixelForge might work for you on iOS, it has no restrictions built in」と代替ツールを提案。
  • AI画像生成10年史への郷愁とツッコミ:スレッド9(r/generativeAI, 15 points, 9 comments, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/)は2016年StackGANから2026年ChatGPT生成画像までの進化まとめ投稿。u/noctallaが「Google DeepDream was an AI image generator that predated these...around 2015」と歴史的抜け漏れを指摘。
  • 画像生成の周辺で新しい"AI副業"が発生:スレッド8(r/RemoteWorkers, 169 points, 787 comments, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/)はAI生成キャプションを検証する時給$30の在宅レビュー求人。787件という高コメント数だが、収集されたトップコメントはほぼ「Images」という応募リンク要求の連投のみで、実質的な議論内容は薄い。
  • 無料生成ツールの持続可能性への疑問:スレッド12(r/freetoolsAI, 40 points, 50 comments, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)で無料・無制限・登録不要をうたうaifreeforever.comが紹介されたが、u/thecragmireは「How do you maintain this? It's got to cost you something, right?」とビジネスモデルに疑問を呈し、u/Relevant_Syllabub895はNSFW規制の厳しさに不満。
Signals
  • 急上昇: 「無検閲・複数モデル統合」型のアグリゲーター(WildOwl.ai, Venice, Mage.space, PixelForge)が個別モデル契約に代わる選択肢として複数スレッドで名指しされている。単一モデルより「モデル選び放題+緩いフィルター」を売りにするサービスが目立つ。
  • 却下されている主張: 「無料・無制限」を謳う動画/画像生成サービスは、r/aivideomaking・r/generativeAI・r/freetoolsAIの3コミュニティ横断でほぼ一致して懐疑または否定されている。ハードウェアコストか課金かのどちらかは必ず発生するというのが共通認識。
  • 意見の対立: スレッド10のSeedance対Wan比較では「どちらが優れているか」自体で意見が割れ、さらに比較手法(プロンプト一致だけでは不十分)にも異論が出た。スレッド6でも「ユーザー責任」派と「サービス側が対策すべき」派の温度差がある。
  • 驚き: 収集した12スレッド中、技術トピック(モデル比較、新ツール紹介)よりも反AIスレッド(スレッド3、7,088 points / 1,023 comments)のエンゲージメントが桁違いに大きい。これは他の全スレッドのスコア合計(約7,600点弱)にほぼ匹敵する規模で、Redditの生の反応としては「AI生成技術への熱狂」より「AI生成の悪用・欺瞞への反発」の方が可視化されやすいことを示唆する。
  • クローズド/オープンの構図: 明確な「オープンソース対クローズドソース」の対立軸として言及されたのはWan(オープンウェイト)対Seedance(クローズド)の比較(スレッド10)と、ローカル生成(ComfyUI/Civitai/Hugging Face)対クラウド課金サービスという対立(スレッド1, 2, 6)に集約された。オープンソース側は「自由だが手間がかかる」、クローズド側は「手軽だが検閲・コストが壁」という評価が繰り返されている。
Limits
  • 収集されたスレッドは12件で、brief.mdが求める「約20件」の閾値に届いていない。検索語は "Image and Video Generation AI News" の1種類のみで、クローズドソース/オープンソースをそれぞれ狙い撃ちした追加検索は行われていない。
  • r/StableDiffusion、r/midjourney、r/aivideo、r/comfyui のような、画像・動画生成AIの中核的な大規模subredditがこの収集結果には一切含まれていない。これは検索語のカバレッジの穴であり、Reddit全体の温度感を代表しているとは言い切れない。
  • スレッド8(r/RemoteWorkers)はトップコメントが実質「Images」という応募連投のみで、議論としての情報量がほぼゼロだった。
  • 本エージェントはReddit本体・検索結果ページを直接閲覧できないため(WebFetch拒否)、上記はすべてワーカーが事前収集した output/reddit.threads.md / .json の範囲内の情報であり、それ以外のスレッドやコメントの存在有無は確認できない。

X

X — Image and Video Generation AI News

前置き:収集結果がテーマと一致していない

output/x.posts.md を確認したところ、今回のステージでワーカーが実際に検索した語は
"Harvey", "#Crypto", "#sweepstakes", "#Chance", "#giveaways", "Serbia",
"$LAPTOP", "Arsenal", "Germans", "Nazis" の10件だった。これらは画像生成・動画生成AI
とは一切関係がなく、収集された40件の投稿(39アカウント)もテーマに合致するものが
ゼロだった。同様に「X's own Explore list」(サーバーの接続元=クロアチアに紐づく
トレンド、下表)にもAI関連の項目はない。

# Trend Where
1 Harvey Trending in Croatia
2 #Crypto Business & finance · Trending
3 #sweepstakes Trending in Croatia
4 #Chance Trending in Croatia
5 #giveaways Trending in Croatia
6 Serbia Politics · Trending
7 $LAPTOP Trending in Croatia
8 Arsenal Sports · Trending
9 Germans Politics · Trending
10 Nazis Politics · Trending

ルール7(ソースの捏造禁止)に従い、無関係な投稿をテーマの気づきであるかのように
書くことはしない。以下、実際に収集されたものの範囲で事実だけを記す。

Accounts

収集された39アカウントは、恋愛リアリティ番組ファン、暗号資産トレーダー、
懸賞・プレゼント企画の宣伝アカウント、バルカン半島の政治論争アカウント、
ミームコイン界隈、アーセナルサポーター、歴史修正主義/反ユダヤ主義をめぐる
論争アカウントなど、検索語ごとにバラバラなクラスタを形成している。
画像生成AI・動画生成AIを話題にしている、あるいはそれらのツールで作られたと
明記されたコンテンツを投稿しているアカウントは1つも確認できなかった
("has an image" と付記された投稿はあるが、生成AI言及や生成物である明示はない)。
最大のエンゲージメントを持つのは @saintjupitr(64,747 likes、1件のみ投稿)と
@Kwin8675309(42,021 likes、1件のみ投稿)で、いずれも単発の政治的投稿がバイラル
化したパターンであり、テーマとは無関係。

Posts

該当なし。テーマ(画像生成・動画生成AI、クローズドソース/オープンソースの動向)
に一致する投稿は40件中0件だった。個別の投稿(例: #21–24のセルビア関連政治論争、
#29–32のアーセナル関連サッカー投稿、#33–40のドイツ・ナチス関連の歴史論争)は
それぞれ大きな数字のエンゲージメントを持つが、いずれもAI画像・動画生成と無関係
なため、findingsとして計上しない。

Signals
  • 上昇/下降といったテーマに関するシグナルは検出できなかった(対象データがないため)。
  • 唯一言えるのは、このセッションのExplore結果がクロアチア・サーバーからの接続に
    ジオロケートされており、かつ検索クエリ自体がテーマと無関係な語("Harvey"や
    "$LAPTOP"等)に固定されていたという収集プロセス上の事実のみ。
Limits
  • 検索語がテーマと一致していないoutput/x.posts.md に記録された「Found by
    searching "…"」はいずれもAI画像・動画生成と無関係な語(Harvey, #Crypto,
    #sweepstakes, #Chance, #giveaways, Serbia, $LAPTOP, Arsenal, Germans, Nazis)
    であり、ワーカー側のクエリ設定の問題と考えられる。本ステージのプレイブックの
    指示(「the worker already collected the material」)に従い自分で新規検索は
    行っていないため、正しい検索語(例: "AI image generation", "Midjourney",
    "Stable Diffusion", "Sora", "Veo", "オープンソース 画像生成AI" 等)での再収集が
    改めて必要。
  • 収集された40件の投稿のうち、画像生成・動画生成AIのクローズドソース/
    オープンソース動向に関する気づきは0件。brief.mdが要求する「約20件の投稿を
    解析」はテーマに関するデータが存在しないため達成不能だった。
  • X's Explore(トレンド1–10)もクロアチアの一般トレンドのみで、AI関連トレンドは
    含まれていなかった。
  • セッション自体は有効で、投稿収集は成功していた(「session expired」等のエラー
    ではない)ため、問題は検索クエリの選定にある。

YouTube

YouTube — 画像・動画生成AI(クローズドソース/オープンソース)最新動向

チャンネル
動画
  1. 「Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN」
    チャンネル: Theo - t3.gg|投稿: 2025年11月26日ごろ|https://www.youtube.com/watch?v=UV9GqinedQ8
    → GoogleのNano Banana Pro(Gemini 3 Pro Image)が画像生成で他モデルを圧倒したと主張するブレイクダウン動画。クローズドソース最前線の象徴的な回。

  2. 「Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...」
    チャンネル: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
    → Gemini 3 Pro Imageの早期アクセスレビュー。実例多数で「衝撃的」と評価。

  3. 「GPT Image 2 Is Here — Everything You NEED to Know」
    チャンネル: ElevenLabs|投稿: 2026年4月23日|https://www.youtube.com/watch?v=blOlUnC75O4
    → OpenAIのGPT Image 2(ChatGPT Images 2.0)を解説。12言語以上で99%超のテキスト正確性、Thinkingモードで1プロンプト最大8枚生成、4K(API/β)対応など、今年最大級の画像モデルの進化と紹介。

  4. 【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
    チャンネル: AI大学【AI&ChatGPT最新情報】(日本語)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
    → GPT Image 2をNano Bananaとの比較軸で日本語解説。性能・使い方・活用事例を網羅。

  5. 「Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison」
    チャンネル: Marin Method|投稿: 2026年3月10日|https://www.youtube.com/watch?v=x5fMQvhKP60
    → クローズドソース動画生成4モデルの直接対決。Kling 3.0が総合力トップ、Grok Imagineは画像→動画で強いという評価。

  6. 「Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison」
    チャンネル: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
    → ByteDanceのSeedance 2.0が既存の主要クローズドモデルを凌駕したとする比較検証動画。

  7. 「New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)」
    チャンネル: AIOnTrend|投稿: 2026年1月上旬|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    → Alibaba製オープンソース画像モデルQwen-Image 2512と、話題のZ-Image Turboを比較。無料・Apache系ライセンスの強みを紹介。

  8. 「Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)」
    https://www.youtube.com/watch?v=54zvSiAWz2Y
    → Black Forest LabsのFlux系がQwen-Image 2512/Z-Imageに15項目のストレステストで比較され、オープンソース画像生成の勢力図が変わりつつあると分析。

  9. 「LTX-2.3 Review: The Open-Source AI Video Model Built for Creators」
    チャンネル: BMF MEDIA|投稿: 検索時点で約1か月前(2026年8月頃)|https://www.youtube.com/watch?v=qQXzlk134Sw
    → LightricksのLTX-2.3(220億パラメータ、音声同期・4K/50fps対応、オープンソース)を制作者目線でレビュー。直近60日以内の投稿で鮮度が高い。

  10. 「WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)」
    チャンネル: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
    → Alibaba TongyiのオープンソースWan 2.5が、クローズドのGoogle Veo 3を上回る出来と主張する実践ワークフロー動画。

  11. 「This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image」
    チャンネル: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
    → LTX-2.3・Qwen・Flux.2 Klein・Z-Imageなど複数のオープンソースモデルを束ねる無料エージェント「WanGP」を使った自動動画制作ワークフローを紹介。オープンソースエコシステムの統合が進んでいる証左。

  12. 「HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)」
    https://www.youtube.com/watch?v=32lhiZKhgOY
    → Tencentのオープンソース画像モデルHunyuanImage 3.0(800億パラメータ超・MoE構成、130億アクティブ)を紹介。Nano Bananaに匹敵/凌駕すると主張(初出は2025年9月だが、オープンソース大型MoE画像モデルの継続的な参照点として言及)。

シグナル

クローズドソース側の動き

  • Googleは2026年8月17日にImagenラインを完全に終了し、Nano Banana系(Gemini 3 Pro Image等)へ一本化。クローズドソース画像生成の主力がGoogleのGemini系に集約されつつある。
  • OpenAIはSoraアプリを2026年4月26日に終了、Sora API自体も2026年9月24日に終了予定(本レポート時点で目前)。動画生成単体プロダクトとしてのSoraブランドは事実上終息し、OpenAIの開発リソースはGPT Image 2やChatGPT本体への統合に向かっている。
  • OpenAIのGPT Image 2(2026年4月)はArenaのテキスト画像・編集の両部門で首位級の評価。xAIのGrok Imagine Image 2.0(2026年8月7日リリース)は僅差の2位につけ、クローズドソース画像生成はOpenAI対Google対xAIの三つ巴になっている。
  • 動画ではByteDanceのSeedance 2.5が2026年8月7日にAPIを一般公開、Google Veo 3.1・Kling 3.0と並ぶ主要選択肢として急速に台頭。
  • クローズドソース動画生成の比較動画では「Kling 3.0が総合力、Veo 3.1が映像美、Runway Gen-4.5が創作自由度」という住み分けが定着しつつある。

オープンソース側の動き

  • 画像生成はQwen-Image 2512(Alibaba, Apache系)とZ-Image Turbo(8ステップ・16GB VRAMで動作)が2大トレンド。比較動画が乱立するほど注目度が高い。
  • Black Forest LabsのFlux.2 Klein(4B、RTX3090クラスで13GB VRAM、Apache 2.0)は軽量オープンソースの選択肢として言及多数。
  • Tencent HunyuanImage 3.0(80B超・MoE)は依然としてオープンソース大型画像モデルの参照点。
  • 動画生成はAlibaba Tongyiの Wan 2.2/2.5(MoE拡散、8GBのGGUF版もあり)と、LightricksのLTX-2.3(音声同期・4K/50fps、220億パラメータ)がクローズドソース級の品質に到達したと複数チャンネルが評価。
  • ComfyUIやWanGPのような「複数のオープンソースモデルを束ねるエージェント/ワークフロー」動画が増加しており、モデル単体の比較から統合ワークフローへ関心が移っている。
  • 全体として「オープンソースとクローズドソースの品質差は縮まり、多くの制作チームがまずオープンソースを検討するようになった」という論調がレビュー動画・比較動画に共通して見られる。
Limits
  • 今回の環境ではYouTube検索結果ページ(youtube.com/results?...)や動画ページ本体はJavaScriptでレンダリングされるため、WebFetchでは実際の再生回数・投稿日・チャンネル登録者数を直接取得できなかった(フッターのナビゲーションのみが返る)。チャンネル名はYouTube oEmbed API(youtube.com/oembed?url=...&format=json)経由で取得できたが、再生回数・登録者数はこの方法でも取得不可。
  • そのためこのレポートの再生回数・登録者数は「不明」とし、代わりにWebSearchのスニペットに現れた日付・文脈情報のみを記載した。数値での鮮度比較(例:直近60日以内で何万回再生)は今回できていない。
  • 動画本編・上位コメントの内容は、YouTube側のJS依存によりページ本文を直接読めなかったため、WebSearchが返すタイトル・スニペット・関連記事の要約から間接的に把握したものであり、動画内の発言をそのまま引用したものではない。
  • HunyuanImage 3.0関連の動画は初出が2025年9月と直近60日の推奨ウィンドウ外だが、オープンソース大型画像モデルの継続的な参照点として言及に留めた。
  • 日本語チャンネルのヒットは1件(AI大学)のみで、日本語圏でのYouTube議論の厚みは英語圏に比べて確認できていない。

Bluesky

Bluesky — 画像生成AI・動画生成AIの最新動向

Accounts
  • Simon Willison @simonwillison.net — 著名なAI開発者。新モデルが出るたびに「ペリカンが自転車に乗る」ベンチマーク画像で画像生成力を比較する投稿を頻繁にしている。フォロワー多数、いいね100〜500超えの投稿多数。
  • Ethan Mollick @emollick.bsky.social — ペンシルベニア大学ウォートン校教授。GPT-6 Astra・Fable 5.1などのモデルにBlenderで3D生成させた実験を頻繁に投稿。
  • Alessandro Perilli @perilli.com — 「Open Creative Studio」(旧AP Workflow)というComfyUI向けオープンソース・オールインワン生成ワークフローの開発者。テキスト・画像・動画・音声すべて生成できるツールを継続的に告知。
  • luokai @luok.ai — クローズドソース動画生成AIのアップデートを次々に紹介するアカウント(Kling、Runway、Vidu、PixVerse、Seedance、Nijiなど)。
  • dahara1 @dahara1.bsky.social — 日本語でLLM/生成AIの使用感を投稿するエンジニア(機械翻訳ツール等を自作)。Sora終了やNano Banana比較など時事ネタを拾っている。フォロワー113人と小規模。
  • Midjourney Experience Newsletter @midjourneynews.bsky.social — Midjourney公式ではなく非公式のファン/ニュースレターアカウント。プロンプト実験と業界ニュースの断片を投稿(エンゲージメントは低い)。
  • Stable Diffusion online AI @stablediffusion.bsky.social — SD/Midjourneyの作品共有系フィード。直近の投稿は2025年1〜2月で止まっており、最新ニュースソースとしては機能していない。
  • 公式アカウント探索の結果: Black Forest Labs、Runway、Stability AI、Civitaiの公式Bluesky アカウントは確認できなかった(存在しないか、ハンドル不明)。Midjourney公式らしき midjourney.bsky.social は投稿ゼロの空アカウント。
Posts
  1. 「Sora終了」 — dahara1, 2026-04-28, いいね0/RP0
    https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
    OpenAIのSora(動画生成)サービス終了について「あまり思い入れがなかったのだろう」とコメント。WebSearchでも裏取り済み(OpenAIは2026年3月頃にSoraアプリと開発者向けAPIの提供終了を報じられている)。

  2. 無料版Soraがクレジットを使い切って生成不可に — dahara1, 2026-04-04
    https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
    「1クレジット残っているのに動画が作れない」と機能低下を報告。上記の終了報道と整合。

  3. Nano Banana(無料版)とChatGPT Images 2.0の透かし比較 — dahara1, 2026-05-04, いいね1
    https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
    「ChatGPT Images 2.0はNano Banana無料版同様、目立つ透かしが無くて使いやすい」とクローズドソース画像生成ツール同士を比較。

  4. Seedance 2が他モデルを圧倒 — luokai, 2026-02-10, いいね5
    https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
    「1日で作った」オリジナル動画を添えて、動画生成モデルSeedance 2の性能を絶賛。

  5. Niji 7 リリース — luokai, 2026-01-10, いいね3
    https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
    アニメ特化画像生成モデルNiji 7が「よりシャープな目、一貫性、プロンプト追従性の向上」を謳って登場。

  6. Runway Gen-4.5 — luokai, 2025-12-02, いいね4/RP1
    https://bsky.app/profile/luok.ai/post/3m6xsakpud226
    「モーション・忠実度・プロンプト制御」で基準を引き上げたと紹介、world-modelingを基盤とする点を強調。

  7. Kling IMAGE O1 — luokai, 2025-12-03, いいね3
    https://bsky.app/profile/luok.ai/post/3m72caiexw225
    「何でも入力・理解・生成」を掲げるKlingの画像生成フルスタック刷新。

  8. Kling VIDEO 2.6 — luokai, 2025-12-05, いいね2
    https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
    音声同期・リップシンク・シーン一貫性を備えた「ストーリーファースト」動画生成をアピール。

  9. PixVerse V5.5 — luokai, 2025-12-02, いいね4/RP2
    https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
    ワンタップでのマルチショット生成、自動SFX付与など制作の簡略化を打ち出す。

  10. Vidu AI Q2 画像モデル — luokai, 2025-12-02, いいね5/RP2
    https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
    「5秒で4K生成」、12月31日まで無制限生成キャンペーンを告知。

  11. SkyReels V1(オープンソース動画基盤モデル) — luokai, 2025-02-18, いいね3/RP1
    https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
    「初のオープンソース・人間中心動画基盤モデル」を謳い、HunyuanVideoを1,000万本超の映像でファインチューニングして33種の表情・400種以上の自然な動きを再現、と説明。日付は1年以上前だが、このアカウントで見つかった唯一の明確なオープンソース動画モデルの投稿。

  12. Open Creative Studio v13.0(ComfyUI用オープンソース統合ワークフロー) — Alessandro Perilli, 2026-01-26, いいね0
    https://bsky.app/profile/perilli.com/post/3mdddenkss22v
    テキスト・画像・動画・音声・音楽・効果音・歌詞まで生成できる「最も高機能なオールインワンComfyUIワークフロー」、無料・無制限を強調。

  13. Qwen 3.7 27B のローカル画像生成(ペリカン) — Simon Willison, 2026-08-14, いいね183/RP14
    https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
    M5 Max MacBook Pro上でLM Studio経由・17GB GGUFで動くQwen 3.7 27Bが「自分のノートPCで動くモデルの中で見た最高の自転車ペリカン」を描いたと報告。オープンウェイトモデルのローカル画像生成力を示す一例。

  14. GPT-6 Astra vs GPT-5.6系 ペリカン比較グリッド — Simon Willison, 2026-09-04, いいね202/RP9
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    GPT-6 AstraとGPT-5.6のSol/Terra/Lunaの4モデルを横並びで比較する12枚組のペリカン画像グリッドを投稿。クローズドソースモデルの画像生成力を継続的にベンチマーク。

  15. GPT-6 AstraによるBlender 3D生成(建築模型) — Ethan Mollick, 2026-09-05, いいね163/RP17
    https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
    スケッチと説明のみから18世紀の未建設建築「ブレーの記念堂」をBlenderで3Dモデル化し、ナレーション付きウォークスルーまで生成したと報告。クローズドソースLLMの画像/3D生成が「ビジュアルで存在感を出す」武器になっている、という指摘も同アカウントの別投稿(9/7)にあり。

  16. 「MidjourneyはMeta.aiの一部になった」 — Midjourney Experience Newsletter, 2026-02-03, いいね1
    https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
    ⚠️ 要注意: 非公式ファンアカウントの投稿で、事実を単純化しすぎている可能性が高い。WebSearchで裏取りしたところ、実態は2025年8月にMetaがMidjourneyの「美的技術(aesthetic tech)」をライセンス提供する提携を発表したもので、買収ではなくMidjourneyは独立を維持している(参照: TechCrunchimplicator.ai)。

Signals
  • クローズドソース動画生成は乱戦状態: 2025年12月〜2026年2月だけでもRunway Gen-4.5、Kling IMAGE O1/VIDEO 2.6/O1、PixVerse V5.5、Vidu AI Q2、Seedance 2、Niji 7と、luok.aiのフィードだけで少なくとも7つの新モデル/新バージョンが立て続けにリリースされている。中国発のモデル(Kling, Vidu, PixVerse, Seedance)の勢いが目立つ。
  • Soraは失速・終了に向かっている: dahara1の投稿から、2026年4月時点で無料版Soraの生成クレジットが機能しなくなり、同月末に「Sora終了」と明言する投稿があった。OpenAIが2026年3月頃にSoraのアプリと開発者向けAPI提供を終了したという報道と符合する。動画生成の主導権が中国勢モデル群やGoogle/OpenAIの汎用モデル内蔵機能に移っている様子がうかがえる。
  • 画像生成は「LLM本体の一機能」としてベンチマーク化: Simon WillisonやEthan Mollickの投稿は、単体の画像生成AIツールというより、GPT-6 Astra・Claude Fable 5.1・Qwen 3.7/3.8 27Bといった汎用LLMが持つ画像/3D生成力を継続的に比較するベンチマーク文化として定着している。特にGPT-6 Astraの視覚生成力(Blenderでの3D建築再現など)がSNS上での「強さ」の指標として言及されている。
  • オープンソース動画生成の話題はBlueskyでは薄い: 検索・フィード探索を通じて見つかった明確なオープンソース動画モデルの投稿は、SkyReels V1(HunyuanVideoベース)の2025年2月の投稿1件のみ。Wan2.2、Qwen-Image、Z-Imageなど2026年に話題になっているはずのオープンウェイトモデルへの言及はBluesky上で発見できなかった。ComfyUI関連はAlessandro Perilliの「Open Creative Studio」告知が定期的にあるのみで、盛り上がりというより一人のプロジェクト告知に近い。
  • Midjourney×Metaの関係は誤解されやすい: 非公式アカウントが「MidjourneyがMeta.aiの一部になった」と単純化して発信しており、実態(技術ライセンス提携、買収ではない)とズレがある点は、SNS上の情報の粒度に注意が必要という良い実例。
Limits
  • Bluesky公式の検索API (app.bsky.feed.searchPosts) は今回すべてのクエリで403 Forbiddenを返し、キーワード検索が一切できなかった(プレイブック記載の手順)。app.bsky.actor.getProfileapp.bsky.feed.getAuthorFeedapp.bsky.feed.getPostThreadなど他のpublic APIエンドポイントは正常に動作したため、search系エンドポイントのみアクセス制限されている可能性が高い。
  • https://bsky.app/search?q=... のWeb版検索ページもクライアントサイドレンダリングのため、フェッチしても投稿内容が取得できなかった。
  • 上記の制約により、キーワード検索の代わりにWeb検索経由で関連アカウントを発見し、それぞれのフィード(getAuthorFeed)を読む方式に切り替えた。これは的確なキーワード網羅ではなく、たまたま検索エンジンに引っかかったアカウントに依存するため、話題の偏り(特にオープンソース動画生成のカバレッジ不足)につながっている可能性がある。
  • Web検索でBluesky上の「Wan2.2」「Qwen-Image」「Z-Image」「HunyuanVideo」を探したが、arXiv論文や無関係なアカウントばかりがヒットし、該当する投稿は見つからなかった。
  • Black Forest Labs、Runway、Stability AI、Civitaiなど主要な画像/動画生成AI企業の公式Bluesky アカウントの所在を確認できなかった(ハンドル探索がすべて400エラーまたは該当なし)。
  • stablediffusion.bsky.socialのフィードは2025年1〜2月で止まっており、最新動向の情報源としては使えなかった。
  • 完了基準にある「各SNSで20件ほどの投稿を解析」については、上記6アカウントのフィードから合計100件以上の投稿に目を通し、その中からテーマに関連する16件を厳選して掲載した。

Lemmy

Lemmy — 画像・動画生成AI最新動向

Lemmyはインスタンスが分散しているFediverseなので、lemmy.worldのAPI検索(/api/v3/search)とlemmy.today(実体はlemmy.dbzer0.comのコミュニティをミラー)を中心に、site:lemmy.world等のWeb検索も併用して調査した。合計約25件の投稿を確認した。

Communities
  • [email protected] — 約5,050人購読。オープンソース画像生成(Stable Diffusion系)の中心コミュニティ。
  • [email protected](lemmy.today表示名 "Stable Diffusion Art") — 2,362人購読。SDXL/ComfyUI/Krea2で作った作品を毎日複数投稿、civitai.comへのリンクが多い。
  • Stable Diffusion AnimeStable Diffusion AbstractionStable Diffusion WitchesStable Diffusion FurryStable Werewolves(いずれもlemmy.dbzer0.com系のジャンル特化コミュニティ)— 購読者数は非公開だが2026年9月も連日投稿があるアクティブなコミュニティ群。
  • c/[email protected] — 一般テック系。Midjourneyの医療スキャナー騒動やSora関連ニュースなど、クローズドソース系の大手ニュースはここに集まる。
  • c/genart — 47人購読。「オープンソース・オープンライセンスの生成AIモデルを支持する」と明言する小規模コミュニティ。
  • c/[email protected] — 反AI感情を扱うコミュニティ。画像・動画生成AI専用ではないが、AIツール依存への反発を示す投稿がスコア83と大きく伸びていた。
  • c/euroai — 欧州製オープンソースAI/LLMの一覧を投稿するニッチコミュニティ。
Posts
クローズドソース寄り
  1. 「Midjourney pivots from AI image generation to body scanning medical spa」(2026-06-18, スコア58, technology) https://lemmy.world/post/... via theregister.com — Midjourneyが画像生成から離れ、医療用超音波CTスキャナー事業に参入したという話題。The Registerは「基盤技術は本物だが、提携先を公表していない」と指摘。
  2. 「Midjourney AI pivots to Theranos: Ultrasonic CT」(2026-06-19, スコア40, techtakes) pivot-to-ai.com経由 — 上記をTheranos(血液検査詐欺企業)になぞらえて皮肉る投稿。
  3. 「I was wrong about the Midjourney ultrasound scanner」(2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — 当初懐疑的だった投稿者が事実を確認し前言撤回。
  4. 「Midjourney wants Hollywood studios to reveal details of their AI usage」(2026-07-05, スコア73, technology) techcrunch.com経由 — スタジオ3社との訴訟で、MidjourneyがハリウッドのAI利用実態の開示を要求。
  5. OpenAIによるSora終了への反応投稿「OpenAI: decides to shut down their AI slop video generating model Sorahttps://lemmy.world/post/44721138 — Sora単体アプリの終了(2026年3月24日発表、4月26日停止、Sora 2 APIは2026年9月24日廃止予定)を揶揄。
  6. 「OpenAI collapses media reality with Sora AI video generator」 https://lemmy.world/post/12056737 — 匿名動画への信頼低下を懸念する記事の共有。
  7. 「OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports」 https://lemmy.world/post/36665644 — 著作権者にオプトアウトを求める方針への批判。
  8. 「Elon Musk maakt complete AI-film met zijn versie van The Odyssey」(2026-07-22, films) ad.nl経由 — MuskがGrok Imagineで長編『オデュッセイア』のAI映画制作を予告。
  9. ChatGPT収益分析の共有投稿(2026-07-15, ai_reddit) — Grok(xAI)の収益の大部分が有料NSFW画像/動画生成コンテンツによるものと分析。
  10. 「Video AI」(Adobe Firefly動画生成の無料枠についての質問投稿) — Fireflyは無料2回まで、代替としてHailuo/Kling/Runway/Pixverse/Hunyuanが比較されている。
オープンソース寄り
  1. 「Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio」(2026-07-24, スコア1, tech) https://bfl.ai/blog/flux-3 — 画像・音声付き20秒動画を生成できるマルチモーダルモデルFLUX 3の限定リリース。
  2. 「FLUX.2-klein-9b-kv-fp8 optimized variant」(2026-03-14, スコア8, stable_diffusion) huggingface.co経由 — KVキャッシュ対応の軽量FLUX.2派生モデル。
  3. 「Black Forest Labs Opening up the first FLUX Creator Program」(2026-05-06, スコア3, stable_diffusion) — クリエイター向けプログラム開始告知。
  4. 「Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf」(2026-06-03, films) nu.nl経由 — 映画監督マーティン・スコセッシがBlack Forest Labsのアドバイザーに就任。
  5. 「FLUX Chroma (The Perchance T2i model)」(約1年前, Perchanceコミュニティ) huggingface.co(lodestones/Chroma) — NAG(Normalized Attentive Guidance)を使う派生モデル、リップシンク描写の評価コメントあり。
  6. Stable Diffusion系コミュニティの日々の投稿例(2026-09-06〜09、いずれもSDXL/ComfyUI/Krea2ローカル生成): 「Erika - Mahouka Koukou No Rettousei」(スコア16)、「Colors in Quiet Water」(スコア14)、「Giant Wire Walker」(スコア11)、「Karin - Umi Monogatari」(スコア13) — いずれもcivitai.comへのリンク付き。
  7. 「Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp」 https://lemmy.world/post/3243205 — GIMP風の非破壊レイヤー編集ができるOSS UIの紹介。
  8. 「Europäische KI- & LLM-Anbieter」(2026-02-15, euroai) — 技術主権・データ保護を掲げる欧州製オープンソースAIの一覧投稿(画像生成モデルも含む)。
  9. 「Your Lemmy Crash Course to Free Open-Source AI」 https://lemmy.world/post/76020 — text-generation-webui、Automatic1111、ComfyUI+Pinokioなどローカル生成ツールをまとめた入門ガイド。
Signals
  • クローズドソース側の最大の話題は「Midjourneyの医療転身」騒動(スコア40〜73):画像生成の本業から超音波診断機器への事業転換を巡り、technology/hackernews/techtakesの3コミュニティで賛否両論。詐欺的と皮肉る反応(Theranosになぞらえ)が目立つ一方、当初批判的だった投稿者が後に訂正する動きもあり、賛否が揺れている。
  • OpenAI Soraは「AIスロップ」の代表格として繰り返し槍玉に。アプリ終了(2026年3月〜4月)後も、Sora 2 APIの2026年9月24日廃止予定など話題が続いている。
  • オープンソース側はBlack Forest Labs(FLUX系)一強。FLUX 3(画像+音声付き20秒動画)、FLUX.2-klein軽量版、Creator Program、さらにスコセッシ監督のアドバイザー就任と、四半期ごとに具体的な動きがある。
  • 日常的な創作コミュニティ(Stable Diffusion Art/Anime/Abstraction等)は購読者数こそ小さい(2,000〜5,000人規模)が、SDXL・ComfyUI・Krea2をローカルで動かす投稿が2026年9月も連日続いており、オープンソースの実運用の厚みを示している。
  • 反AI感情も無視できないシグナル:c/fuck_aiの「AI依存から抜け出したい」投稿がスコア83と、通常のAI関連投稿より大きく伸びていた。Lemmy全体でAI生成物への忌避感が一定数あることの表れ。
  • クローズド系ニュースはLemmyで新たに"発見"されたものではなく、TechCrunch/The Register/WSJなど既存メディア記事の転載・反応が中心。一次情報はLemmy外にある。
Limits
  • Lemmyはユーザー数・投稿数ともに小規模で、Reddit等に比べ画像・動画生成AI専用の議論は薄い。特に動画生成(Sora/Veo/Kling/Runway)そのものを深掘りする専用コミュニティは見つからなかった。
  • lemmy.worldのAPI全文検索は精度が低く、"AI image generation"のような一般的なクエリでは無関係な投稿(UNの世界地図、フクロウの繁殖など)が上位に混ざった。個別モデル名(Sora、Midjourney、FLUX等)で絞り込むことで関連投稿を拾えた。
  • 一部ページ(lemmy.world/post/44721138DLSS 5関連投稿 lemmy.world/post/44347792)はWebFetchでHTTP 500エラーまたは内容取得失敗となり、本文・コメント詳細は確認できなかった。タイトルとWeb検索でのスニペットのみで判断している。
  • Grok Imagine、Qwen Image、HunyuanVideo、Wan2.2、Nano Banana(Gemini)、Veoといった直近の主要モデル名でLemmy内検索したが、直接言及する投稿はほとんど見つからず(Grok Imagineは映画制作の文脈で1件のみ)。これらのモデルについてはLemmyでは話題性が乏しいと言える。
  • lemmy.ml、lemm.eeを個別に検索したが、lemmy.worldの検索結果と重複するかFediverse連合で同一投稿がミラーされているケースが多く、独自の追加情報は得られなかった。

Pinterest

Pinterest — Image and Video Generation AI News

収集された50件のピンをすべて画像を開いて確認した(ジャンル分けはされておらず、単一の検索クエリ「Image and Video Generation AI News」の結果として一括収集)。

Visual themes(visual themes)
  • 「ロボット顔+ニュース速報」テンプレの氾濫:白いヒューマノイドロボットの半顔アップに"AI NEWS"や"BREAKING NEWS"の赤・青ネオン文字を組み合わせたサムネイルが繰り返し登場する。ニュースキャスター席に座るロボット [22]、驚いた表情の男性YouTuberとロボット顔の合成 [29]、"THE FUTURE IS AI"の女性ロボット [39] など、ダークネイビー×ネオン(シアン/マゼンタ/オレンジ)の配色が支配的。
  • YouTuberのリアクション顔サムネ:驚いた/訝しげな表情の白人男性の顔写真に、OpenAI・Google・Meta・Anthropic・Grok・Notionなどのロゴを丸くネオン縁取りしたアイコンを並べる構図が複数のピンで反復 [4, 18]。YouTube動画からの転載と思われる。
  • 「◯選」まとめインフォグラフィック(listicle):紫〜黒のダークテーマに番号付きカードでツールを並べる縦長インフォグラフィックが最頻出フォーマット。Runway・Pika・Kling AI・Luma AI(Dream Machine)・Canva AI・Hailuo AIの並びがほぼ固定メンバーとして繰り返し出現 [9, 10, 27, 36, 50]。
  • Before/After・比較クイズ形式:"Which is AI?"の2枚並び山岳写真 [13] や、ソースビデオを木製ブロック/折り紙/レゴ/花で作られたキャラクターに変換するグリッド比較 [11] など、生成AIの見分けにくさ・素材変換力を訴求する構図が目立つ。
  • ロボット×人間の協働/医療シーン:白いヒューマノイドロボットが医療従事者と並んでホログラムを操作する写実的CG [3, 33] や、聴診器を着けた医師とロボットのイラスト [32] など、AIと人間の共存を描く落ち着いたトーンの絵柄も一定数ある。
  • 暗色×ネオン配色のテック感演出:藍色〜黒の背景にシアン/マゼンタ/パープルのネオン配線・光の粒子を重ねるスタイルがほぼ全体(約7割)に共通する支配色で、Pinterestの「テック系ニュース画像」の定型スタイルであることが伺える。
  • アバター・アイコンパーソナリティのAI動画生成広告:フリーランス販売(Fiverr風)の"AI video creation explainer"広告にJeff Bezosの顔を使った合成画像 [38] や、'Amuse 3.0'のAMD公式フォトリアル生成デモ(老漁師の顔)[46] など、著名人の顔や写実的ポートレートをAI生成のクオリティ訴求に使うピンが複数。
  • AI生成そのものが「バレる/バレない」を扱う画像:ロボットがスマホを見て「FAKE」スタンプと猫の写真、覆面の人物のシルエットを比較する構図 [3]、AI検出ツールの紹介 [37] など、真偽判定・偽情報への懸念を視覚化したピンが繰り返される。
Notable pins(notable pins)
  • [11] Luma AI風の素材変換デモ:同一のソース動画(人物・パンダのぬいぐるみ・車)を「木製ブロック」「折り紙」「レゴブロック」「花」に変換した5パターンをグリッド比較。動画生成AIの質感変換力を最も具体的に示すピン。
  • [24] ByteDanceとハリウッドのAI著作権合意:「ByteDance and Hollywood reach global deal on AI copyright」の見出し。ByteDanceがMotion Picture Association(MPA)とAI画像・動画生成ツールの知財保護強化で世界的合意に達したというニュース記事のスクリーンショット。クローズドソース大手の著作権対応動向を示す一次情報に近い内容。
  • [35] 2026年8月12日付のAIニュースまとめ:"Grok 4.6 drops"(自律的に数十ステップ作業し自己検証まで行う)、"Gemini hits 1 billion users"(Google史上最速でのユーザー1億人到達、3人に2人が音声入力、1日1.5億枚の画像生成)、"Honor's robot phone"(背面からチタン製アームが伸びて被写体を自動追尾するカメラ)の3本立て。日付・数値が明記された希少な一次情報系ピン。
  • [36] "Best AI Video Generators of 2026"ランキング:Google Veo 3.1・Runway Gen 4.5・Kling 3.0が王冠マーク付きの上位3社、続いてAdobe Firefly・Seedance 1.5 Pro・Pika 2.5・HeyGenの順。バージョン番号まで明記された最新モデル世代の一覧。
  • [42] Vidu S1(ShengShu Technology):"The World's Most Advanced Model for Real-Time AI Interaction"を掲げる中国発リアルタイム対話型AI動画モデルの製品ビジュアル。西側モデル一辺倒でない動向を示す数少ない中国系プレイヤーの事例。
  • [45] OpenAIの新画像生成ツール予告記事:"OpenAI's Secret Image Generation Tool to Debut Soon"の見出し付き記事画像。未発表ツールへの期待を煽る内容。
  • [25] Google I/O 2026特集まとめ:Gemini 3.5 Flash・Gemini Omni・Gemini Spark発表、AI検索への転換、Apple・Google XRスマートグラス競争など、2026年5月20日付でまとめられたAI業界全体動向。画像生成AI単体でなく周辺エコシステムの動きが分かる。
  • [9] "Just Nail It"動画生成ツール比較インフォグラフィック:Runway・Pika・Kling AI・Luma AI・Canva AI・Hailuo AIの6ツールを機能・対象ユーザー別に整理し、「2026年までにオンラインコンテンツの80%が動画を含む」という統計も併記。
  • [8] ストックフォト素材のAIコンテンツ生成アイコン集:Adobe Stock系の「Ai Content Creation Concept」ストック画像で、テキスト・画像・音楽・動画生成を表すアイコンセット。実際のニュースというより素材需要の高さを示す。
  • [43] 生成AIの歴史年表インフォグラフィック:1950年代のELIZAから2020年代のGPTまでを辿る紫系年表。現在の生成AIブームを歴史的文脈に位置付ける教育系コンテンツ。
Signals(signals)
  • オープン/クローズドの二項対立そのものは画像単体では読み取りにくい:Pinterestのピン画像は基本的に「ツール紹介」「ニュースサムネ」「ノウハウまとめ」であり、Reddit/Xで見られるような「Seedance対Wan」のような明示的なオープン対クローズド比較構図は見当たらなかった。強いて言えば[42]のVidu S1(中国・ShengShu)や[46]のAmuse 3.0(AMD関連、ローカル生成寄り)がクローズドな米系大手(Google Veo、OpenAI Sora、Runway等)以外の選択肢として目立つ程度。
  • 「まとめ・比較・ハウツー」系コンテンツが主流で、速報ニュースは少数派:50件中、日付や具体的な発表内容が明記された一次情報寄りのピンは[24][25][35][45]程度で、残りの大半は「Best AI Video Generators」「10 Smart Ways」のような evergreen listicle/アフィリエイト誘導的なピンタレスト特有の"保存されやすいコンテンツ"だった。
  • 不安・真偽判定への関心が可視化される:[3][22][37]のように「FAKE」スタンプ、ロボット記者、AI検出ツールを扱う画像が複数あり、Pinterestユーザー層にも生成AIコンテンツへの懐疑・真贋への関心が一定数存在することが伺える。
  • モデル世代の更新が速い:[36]でVeo 3.1・Runway Gen 4.5・Kling 3.0・Seedance 1.5 Proという2026年時点の最新バージョン番号が確認でき、[35]のGrok 4.6・Gemini 1B usersと合わせ、四半期単位でのバージョンアップが常態化していることが画像からも裏付けられる。
  • 不在:Stable Diffusion/ComfyUI/Hugging Faceなど、Reddit側で頻出した「ローカル・自己ホスト型オープンウェイト」文化を象徴する画像は50件中ゼロ。Pinterestの画像検索結果は商用ツール・SaaS製品の宣伝素材に大きく偏っており、真にオープンソースなコミュニティ発信の可視化はほぼ見られなかった。
Limits
  • 収集はワーカーが事前に行ったヘッドレスブラウザによるもので、本エージェント自身はPinterestを直接ブラウズしていない(プレイブック通り)。
  • ジャンル分け(## <genre> (n)セクション)は行われておらず、50件は単一クエリの検索結果として一括収集されたもの。ジャンルごとの傾向比較はできなかった。
  • タイトルが「(untitled)」のピンが5件([5, 13, 15, 20, 24]※24はタイトル空欄だが記事見出し画像から内容判別可)あり、Pinterest側でタイトルテキストが取得できていないケースがあった。
  • 各ピンのURL(pinterest.com/pin/...)は記載されているが、実際にリンク先を開いての検証は行っていない(画像とタイトルのみから判断)。投稿日時・いいね数などのエンゲージメント指標はPinterest側のデータとして収集されておらず、[25][35]のような画像内に日付が焼き込まれているもの以外は時期の特定ができない。
  • 「クローズドソース/オープンソースそれぞれ最低10件の気づき」という完了基準に対し、Pinterest単体では明確にオープンソース側に分類できる具体的な気づきが乏しい(中国系の[42]、AMD関連の[46]程度)。この不足は他プラットフォーム(Reddit等)の収集結果と合わせて補う必要がある。

推奨アクション

  • Xは検索語をテーマ直結の語(Midjourney, Stable Diffusion, Sora, Nano Banana, Qwen-Image等)に差し替えて再収集する
  • Redditはr/StableDiffusion・r/midjourney・r/comfyuiなどコア大規模subredditを次回から対象に含める
  • Bluesky検索API不通の代替として、今回発見した主要アカウントを定点観測用ウォッチリストにする
  • OpenAIのSora API廃止(2026年9月24日予定)とMidjourneyの事業転換の続報を次回最優先で追う

収集画像

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAI News: Anthropic Leak Shows Us The Future of AI...imageThe Ultimate AI Image and Video Generation Platform - The Data ScientistGoogle Unveils Veo 2: Advanced AI Video Generation...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoJust Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!Google announces ultra-high quality video...AI For Image And video GenerationimageAI Video Content Creation: High earners,...imageAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI News: OpenAI Finally Released What We Asked For️ Image to Video AI – Animate Your Photos With AIimageDiscover how Grok is revolutionizing video...‎🚨 AI is getting scary good.Top AI Video Generators of 2025imageimageMore than 20% of YouTube is now AI-generated5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreArtificial intelligence: let’s maintain our...AI Video Creation: 10 Smart Ways to Create Engaging Videos FasterWhat is Imagvio AI and how it helps creators...AI driven image and video analysisThe potential impact of artificial intelligence on...AiAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026Breaking News Latest AI Developments - Grok 4.6 Gemini 1B Honor Robot PhoneFuture of Video Creation: Best AI Video Generators of 2026🔸How To Detect AI-Generated Images Online For FreeI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingAI Video Creation: Complete Guide to Create Professional Videos Faster with AIHow AI Is Transforming Video EditingShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI Videohistory generative AIMastering Video and AI: Key Social Media Marketing Trends 2025OpenAI’s Secret Image Generation Tool to Debut Soon'Amuse 3.0', an AI art creation tool that includes...The most impressive creations from Internet users...Transform your ideas into stunning visuals! 🎥Viral Tiny People AI Effect—Learn How to Create It!12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & More

データ品質メモ

Xは検索語のミスマッチでテーマ関連投稿を1件も収集できずデータなし。Bluesky・Pinterest・YouTubeはエンゲージメント数値や検索APIが一部使えず、定量的な裏付けが弱い箇所がある。

ギャラリー