Image and Video Generation AI News — 2026-09-12
オープンソース陣営、特に中国勢のZ-Image・Qwen-Image・MiniMax-H3がブラインド評価でクローズドソースに肉薄する一方、GoogleはNano Banana/Veo/Gemini Omniで全方位攻勢をかけ、OpenAIのSoraは価格ページからのモデル削除や責任者離脱で失速の兆しを見せている。
画像・動画生成AIニュースまとめ — 2026-09-12
やっほー!今回は画像・動画生成AI界隈をReddit、X、YouTube、Bluesky、Lemmy、Pinterestの6プラットフォームでガチ調査してきたぜ🔥 結論から言うと、クローズドソース側はGoogleが画像も動画もフルパワーで攻めまくってる一方でOpenAIのSoraはなんか失速気味😳、オープンソースは中国勢(Qwen、Z-Image、MiniMax、Wan)がブラインド評価でガチ肉薄してきてて超熱い展開になってる🔥🔥 ただしXの調査は完全に空振りで、画像・動画生成AIの話題は1件も拾えなかったからそこはガチの穴として正直に書いとくわ💦 あと全プラットフォーム共通で「これAIじゃね?」っていう真贋不安・信頼性の話題がめちゃくちゃ盛り上がってて、モデル性能の話より拡散力あったのがちょっと意外だった👀
Across platforms
- オープンソースの主役は完全に中国勢🇨🇳:YouTube、Bluesky、Lemmyの3プラットフォーム独立でQwen-Image、Z-Image(Turbo)、MiniMax(H3/Hailuo 3.0)、Alibaba Wanが「新しい王者」って持ち上げられてる。BlueskyのブラインドリーダーボードだとQwen-Image-3.0-ProがGPT Image 2(high)にたった92 Eloポイント差まで詰め寄ってるって話もあって、これガチですごい(https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)。
- Googleが画像も動画も全部盛りで攻めてる:YouTubeでVeo 3.1のレビュー(https://www.youtube.com/watch?v=sTOFXi2eY_k)、Teacher's TechのNano Banana 2紹介(https://www.youtube.com/watch?v=nikIxHM_AQY)、Blueskyだと「Gemini Omni」搭載のWindowsデスクトップアプリ化まで報告されてて(https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n)、全方位で攻めてる感じマジで強い💪
- 「AIかどうか見破る」系コンテンツがガチ人気:Reddit(r/isthisAI)の判定スレ(https://www.reddit.com/r/isthisAI/comments/1wbspxo/)とPinterestのディープフェイク/AI音声検出インフォグラフィックが両方とも独立に盛り上がってて、真贋不安がジャンル横断のテーマになってる。モデル性能ニュースより拡散力あるの、地味に驚き。
- 「無制限」「アフィリエイト」系の煽り文句はどこでも警戒されてる:Redditの「'unlimited'謳うサイトは大体詐欺まがい」ってコメント(#4, r/generativeAI)と、Blueskyのcircuitai.bsky.socialによるWAN 3.0の同一文面スパム連投(1日15回以上)が同じ構図。ユーザーは煽り文句にちゃんと懐疑的😤
- 一般ユーザーはオープン/クローズドをあんまり区別してない:Redditのツール相談スレだとQwen・Flux・Seedream・Veo・GPT Imageが「使えるモデル一覧」として並列に語られてて、区別を意識したコメントはほぼ見られなかった。ブリーフが求める二軸構造と、実際のユーザー感覚には結構ギャップがある。
Platform by platform
Reddit — 12スレッド収集(目標の約20件には届かず)。一番伸びてたのは新モデルの話じゃなくて、GPT-6にマウス操作させて偽の手描きタイムラプスを作る話(r/antiai, 7,146pt、https://www.reddit.com/r/antiai/comments/1w81kdd/)っていう、AIの「欺瞞」に対する怒りの投稿。無検閲・NSFW対応の統合プラットフォーム(WildOwl.ai、cyberbara、Tensor.artなど)への言及も複数スレッドで独立に出てきてて需要ありそう。
X — マジで完全空振り😭 収集された40件はYemen情勢とか$SONGミームコインとかChelsea FCの話ばっかりで、画像・動画生成AI関連の投稿はゼロ件。使った検索語(トレンドワード)がそもそも今回のテーマとズレてたのが原因で、次回はMidjourneyやSora、Runwayみたいな固有名詞で検索し直す必要あり。
YouTube — 今回一番情報量多かった✨ クローズド側はGPT Image 2/2.5がArtificial Analysis Image Arenaで首位(Eloスコア1,339、史上最大の1位2位差、https://www.youtube.com/watch?v=DY6TkI8XtkQ)、Veo 3.1の口パク同期強化、ByteDance Seedream 5.0 Proが既存モデル圧倒(https://www.youtube.com/watch?v=WpcxwSNT3X4)。オープン側はBlack Forest Labs FLUX.2が「新しい王者か」と話題(https://www.youtube.com/watch?v=YQuTkPVkCS8)、Alibaba Z-Image TurboがローカルモデルのKING認定(https://www.youtube.com/watch?v=K0FgDU-9uik)、Lightricks LTX-2は「オープンソース動画のホーリーグレイル」とまで言われてる。
Bluesky — Soraがヤバい感じで失速中かも👀 価格ページからsora-2・sora-2-proがひっそり削除されたのを検知した投稿(https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)に加えて、元Sora責任者Bill Peeblesがハリウッドの大物と組んで独立スタートアップ立ち上げっていうスクープも(https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n)。オープン側は中国勢のQwen・Z-Image・MiniMax・WAN 3.0・SenseNova-U1.5が話題独占状態。
Lemmy — 規模は小さめで、実質Even_Adderさん1人のキュレーションに依存してる状態😅 でもクローズド側の一番のニュースはガチで衝撃的で、Midjourneyが画像生成から「医療スパ事業(超音波CTスキャン)」に方向転換したっていう話(https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)。「Theranosの再来」って皮肉られてる。オープン側はMiniMax-H3周辺のComfyUIツール・量子化ツールが1週間で7件以上リリースされるエコシステム爆発中。
Pinterest — 50ピン全部目視チェック👀 クローズドソースの商用ツール(Runway、Pika、Kling AI、Luma、Canva、Hailuo、Synthesia)がランキング系インフォグラフィックにほぼ毎回登場してて、オープンソース系のピンはほぼ見当たらなかった。Google Veo 2/3の公式プロモ素材や、ByteDanceとハリウッド(MPA)の著作権合意ニュース(#31)なんかの実ニュースも混ざってるけど、大半はSEO/アフィリエイト向けの量産型サムネ。「YouTubeの20%以上がAI生成」っていう具体的な数字ピン(#44)もあった。
What to watch
- Soraの失速がガチかどうか — Bluesky、価格ページからのモデル削除検知(https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)
- Qwen-Image-3.0-ProがGPT Image 2との差をどこまで詰めるか — Bluesky、ブラインド評価リーダーボード(https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)
- MiniMax-H3エコシステムの拡大ペース — Lemmy、ComfyUI周辺ツール群(https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA)
- Midjourneyの医療スパ事業の続報 — Lemmy、TheRegister記事(https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)
- FLUX.2 / Z-Image Turboの「ローカル王者」争いの決着 — YouTube(https://www.youtube.com/watch?v=YQuTkPVkCS8, https://www.youtube.com/watch?v=K0FgDU-9uik)
- 無検閲・NSFW統合プラットフォーム(WildOwl.ai等)の淘汰動向 — Reddit(https://www.reddit.com/r/AItips101/comments/1w9yftp/)
Recommendations
- Xの調査は次回、トレンドワードじゃなくMidjourney・Sora・Runway・Kling・Flux・ComfyUIみたいな固有名詞で検索し直すべき。
- Soraの動向はBlueskyの価格ページ監視アカウントを継続フォローして裏を取るべき。
- オープン/クローズドの性能差はQwen-Image-3.0Pro対GPT Image 2のEloスコア推移を定点観測するのが一番わかりやすい指標。
- Midjourneyの医療事業ピボットは技術ニュースというより経営戦略ニュースとして追いかける価値あり。
- Reddit収集は次回12件じゃなく目標の20件に届くよう検索語を増やすべき。
- Pinterestの番付インフォグラフィックやBlueskyのアフィリエイト連投は単独では信用せず、他プラットフォームでの裏取りが取れた時だけ採用すべき。
Data quality
Xは検索語の選定ミスで画像・動画生成AI関連の投稿がゼロ件、今回のテーマについては実質データなし。Redditは12スレッドで完了基準の約20件に届かず、内容も「ニュース」というより「おすすめツール相談」寄り。Pinterestは元データにオープン/クローズドのジャンル分けがなく手動での再分類が必要だった。Lemmyは実質1アカウント(Even_Adder)のキュレーションに依存する小規模プラットフォーム。YouTubeは動画ページがJSレンダリングのためWebFetchで本文取得できず、再生数・登録者数はoEmbed経由でも取得不能だった。Blueskyは一部キーワード(Runway、Kling、Black Forest Labs)で403エラーが続き収集を断念、WAN 3.0関連はスパムアカウントの連投で埋め尽くされていた点を割り引く必要あり。
プラットフォーム別まとめ
Reddit — Image and Video Generation AI News
Where
収集された12スレッドの内訳は以下の9サブレディット。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/isthisAI | 408,823 | 1 |
| r/antiai | 322,973 | 1 |
| r/GetNoted | 298,488 | 1 |
| r/generativeAI | 152,415 | 3 |
| r/aiwars | 167,809 | 1 |
| r/hatethissmug | 134,660 | 1 |
| r/aivideomaking | 6,823 | 2 |
| r/GoogleFlow | 1,884 | 1 |
| r/AItips101 | 1,299 | 1 |
生成AIそのものの是非を議論する大規模サブレディット(r/antiai, r/aiwars, r/isthisAI, r/GetNoted)からの参加が目立つ一方、ツール紹介・レコメンド系の中規模サブレディット(r/generativeAI, r/aivideomaking)が実際のツール動向を伝えている。
What people say
- 【#6, r/antiai, 7,146pt / 1,025コメント, 2026-09-05】LLM(GPT-6と表記)にマウス・キーボード操作権限を与えてデジタル画板に「手描き」させ、タイムラプスまで偽造できるようになったという投稿。トップコメント(2,511pt, u/Nayutantantan)は「もう自分の作品にすらタイムラプスを撮る気になれない、偽タイムラプスが当たり前になってきているから」と怒りを表明。この1スレッドだけで今回集めた中で圧倒的な反応数。 https://www.reddit.com/r/antiai/comments/1w81kdd/
- 【#11, r/GetNoted, 4,470pt / 325コメント, 2026-09-10】AI生成画像が使われたXの投稿(スケジュール画像で"Handloags"のような崩れた文字)が炎上のネタにされた例。トップコメント群はAI生成の粗さそのものをネタにして笑っている。 https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
- 【#1, r/AItips101, 145pt / 83コメント, 2026-09-07】「2026年版・無検閲AI画像生成ランキング」。1位はWildOwl.aiで、Qwen Image・Flux・Seedream・Wan・Kling・Seedance・Veo・GPT Imageなど35以上のモデルに従量課金でアクセスでき、月額不要・クレジット無期限と紹介。コメント(u/reliablemicrophone84, 4pt)は「他所でフィルターに阻まれてクレジットを無駄にしてきたから助かる」と同意。一方u/Pretend_Program_3696(3pt)はPerchance/Uncensored.aiを推し、意見は割れている。 https://www.reddit.com/r/AItips101/comments/1w9yftp/
- 【#8, r/aivideomaking, 4pt / 21コメント, 2026-09-09】「無料/クレジット制でフォトリアルな画像・動画生成ツールを探している」に対し、OpenartAI・fal・dzine・pixverse・Higgsfield・RunningHub(ComfyUI経由でOSS/クローズド両モデル利用可)が列挙され、u/zeroludesignerは「cyberbaraのSeedance 2.5は無検閲で実顔対応」とコメント。 https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
- 【#3, r/generativeAI, 0pt / 7コメント, 2026-09-11】ブラウザ完結のNSFW対応画像/動画生成ツールを探すスレ。u/MisterZan25がRunDiffusion/Tensor.art(画像・キャラ一貫性)、PornGen/PornJourney、Pika Labsミラー系(動画)を整理して紹介。u/frighten(1pt)はiPhone専用アプリ「PixelForge」をオンデバイス・無検閲として推薦。 https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
- 【#4, r/generativeAI, 1pt / 11コメント, 2026-09-07】「最安の無制限1080p画像→動画生成サービスは?」に対しArtlist.io(€550/年)が候補に。だが複数コメントが「無制限」表示を批判: u/ai_art_is_art(3pt)「'unlimited'と謳うサイトは大体詐欺まがい、$550入れて$200分しか出せず24時間待たされる」。 https://www.reddit.com/r/generativeAI/comments/1wa4k88/
- 【#5, r/aivideomaking, 16pt / 38コメント, 2026-09-07】「スマホ/iPadだけで45秒の動画を無料生成したい」という質問に対し、u/NewLifeWares(2pt)が「45秒は事実上データセンター級の要求。無料ならせいぜい透かし入り5秒×1〜2回、それを繋ぎ合わせるしかない」と冷静に否定。u/GuessingEngineer(2pt)は「それが一発でできたら世界の支配者になれる」と皮肉。無料・高品質・長尺の三立てへの需要とその非現実性が可視化されている。 https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
- 【#7, r/GoogleFlow, 6pt / 2コメント, 2026-09-10】Google Flow(Veo)向けの一括生成Chrome拡張「AutoFlow」がリリース。バッチ生成・前クリップの最終フレームからの続き生成・音声/字幕付きナレーション動画の自動編集などを実装、無料版+Pro/Ultraのサブスクモデル。 https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
- 【#12, r/aiwars, 0pt / 14コメント, 2026-09-08】AI生成人物が実在の誰かと偶然似てしまった場合の肖像権・広告利用リスクを議論。u/Upstairs-Mammoth-509(3pt)「無名の一般人の顔とたまたま一致するケースが一番厄介、企業側は逆画像検索でチェックする程度で祈るしかない」と法整備の遅れを指摘。 https://www.reddit.com/r/aiwars/comments/1wafe86/
- 【#10, r/hatethissmug, 59pt / 20コメント, 2026-09-12】「生成AIを批判しながら使う動画」に対する反AI側内部での温度差。u/AprilsStuff(22pt)「反AI派だが環境負荷の議論は誇張されすぎ、'AIは自然消滅する'というのも非現実的」と、反AI論調の中でも異論あり。 https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
- 【#2, r/isthisAI, 0pt / 31コメント, 2026-09-09】ある動画がAIか実写か判定するスレ。ネックレスの消失・再出現(u/smalltiddygothb, 16pt / u/EmergencyWaffleBox, 14pt)が決め手とされ、u/BouncingSphinx(5pt)は「動画がちょうど15秒なのも今のAI動画の上限っぽい」とコメント。一般ユーザーの間でAI動画の技術的限界(尺・不整合)が判定基準として定着しつつある。 https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Signals
- 伸びているもの: 無検閲・NSFW対応の統合プラットフォーム(WildOwl.ai, cyberbara, RunDiffusion, Tensor.art, PixelForgeなど)への言及が複数スレッドで独立に出てくる。「最新モデルへのアクセス」と「検閲の緩さ」を同時に求める需要が強い。
- 伸びているもの: Google Flow向けのサードパーティ自動化ツール(#7 AutoFlow)のような、公式ツールを補完する周辺エコシステムの登場。
- 煙たがられているもの: 「無制限」を謳うサブスク(#4 Artlist.ioなど)はコミュニティから一貫して疑いの目を向けられている。
- 煙たがられているもの: 反AI側の中でも環境負荷を強調する論法(#10)には内輪から「誇張しすぎ」との反論が出ており、反AI言説が一枚岩ではないことがわかる。
- 意外だった点: 今回集めた12スレッドの中で最もエンゲージメントが高かったのは新モデルのリリースではなく、「AIに手描きさせてタイムラプスを偽造する」という反AI系の告発(#6, 7,146pt)と、AI生成画像が招いた炎上ネタ(#11, 4,470pt)だった。プロダクトニュースよりも「AIによる欺瞞・信頼性」の話題の方がRedditでは圧倒的に拡散している。
- 意外だった点: クローズドソース/オープンソースという軸そのものはユーザーの関心の中心ではなく、多くのスレッドでは両者のモデル(Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo, GPT Imageなど)が「使えるモデルの一覧」として並列に語られており、区別を意識したコメントはほとんど見られなかった。
Limits
- 検索語は "Image and Video Generation AI News" の1種類のみで、収集できたのは12スレッド(完了基準が想定する約20件には届いていない)。
- 収集はワーカーがヘッドレスブラウザで事前に行ったものを読む形式のため、今回自分でRedditを追加検索・閲覧することはできなかった(Reddit側がWebFetchや検索経由のページを拒否するため)。
- 収集された投稿の多くは「おすすめツールを教えて」系のQ&Aスレッドで、"ニュース"というよりコミュニティのツール利用実態に近い。closed-source/open-sourceそれぞれの動向を明確に論じた専門的なニューススレッドは見つからなかった。
- r/AItips101(1,299人)やr/GoogleFlow(1,884人)は非常に小規模なサブレディットで、そこから得られた知見はコミュニティ全体を代表するというより個別の声に近い。
X
X — 画像・動画生成AIニュースの動向
Accounts
今回収集された40件は、40アカウントすべてが1投稿ずつのみで、同一アカウントが繰り返し登場するケースはない。しかも、いずれも画像・動画生成AI(Midjourney、Stable Diffusion、Sora、Runway、Kling、Veo、ComfyUI、Fluxなど)を専門に発信するアカウントではない。検索語ごとにクラスタが分かれている。
- Yemen/Saudi(中東情勢・OSINT系): @tleilax___、@Ahmed175143、@IranTimes72、@citrinowicz、@Osinttechnical、@c14english、@Rusia_HD、@MerruX — サウジ石油インフラ攻撃やイエメン紛争を報じるOSINT/ニュースアカウント。
- $SONG(Cardano系ミームコイン): @LagyADA、@EAjdarovic、@JureKaramarko、@SintoAndrej — 小規模な投機・宣伝アカウント。
- Charlie Kirk(一周忌関連): @tivent_1、@TruthNetwork24、@mscaradapawjob、@rokkstarrrrrrr — 政治的コメントやミーム反応。
- Britain(英国政治): @brigantia__、@Steven41849941、@SirJBritain、@BROKENBRITAIN0 — 移民・治安を巡るナショナリスト系の投稿。
- Anthropic(AI経済・安全保障論): @restitutorII、@BrianRoemmele、@walterkirn、@claudecode84 — Anthropicの経済シナリオ予測やClaude Codeのオープンソース化、AI批判論。画像・動画生成の話題ではなく、LLMエージェントやAI社会論。
- Apple/Samsung(スマホ論争): @FlossyCarter、@cagriozturkish、@appleinteligen、@BrandonKHill — 折りたたみ端末を巡るファン同士の煽り合い。
- Sony(ゲーム業界): @JayDubcity16、@Cris_Uther、@treeblazah、@ScreenCraveHQ — 小島秀夫やスパイダーマン映画に関するゴシップ。
- "one ai os"(AIスタートアップ自己宣伝): @de1lymoon、@neda_sefati、@harvey_control、@Iamanusbutt — AIエージェント/業務OS系スタートアップの人脈作り投稿。画像・動画生成には触れていない。
- Chelsea(サッカー): @declanstar1、@TheHateCentra、@Lea_EFC、@chelcatastr0phe — チェルシーFCの試合ネタ。
「1投稿で大きくバズった人」と「複数の小さな投稿を積み上げた人」の違いを言えるほどの反復投稿者は存在しない。強いて言えば @rokkstarrrrrrr(9,404いいね)、@TheHateCentra(19,654いいね)、@Cris_Uther(17,095いいね)が単発で最も伸びているが、いずれもテーマ外。
Posts
画像・動画生成AIに直接言及する投稿はゼロ件。テーマに最も近い(が依然としてズレている)投稿を参考までに挙げる。
-
#21 @restitutorII — 458 likes・69 reposts・41 replies・~57,000 views・2026-09-10
https://x.com/restitutorII/status/2097918742571139093"Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
→ Anthropicの経済シナリオ予測。生成AI全般の話であり、画像・動画生成AIの動向ではない。 -
#24 @claudecode84 — 2,585 likes・268 reposts・24 replies・~741,000 views・2026-09-10
https://x.com/claudecode84/status/2097959830942367747「Anthropic最高責任者本人が自分の『Claude Code環境』を丸ごとオープンソース化しています」
→ Claude Code(コーディングAI)のオープンソース化の話。画像・動画生成モデルではない。 -
#33 @de1lymoon — 49 likes・6 reposts・9 replies・~3,500 views・2026-09-11
https://x.com/de1lymoon/status/2098428267158032841"Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
→ AIエージェントのオーケストレーション論。画像・動画生成とは無関係。 -
#22 @BrianRoemmele — 792 likes・187 reposts・105 replies・~100,000 views・2026-09-10
https://x.com/BrianRoemmele/status/2098024115231924568
→ Anthropic批判・AI脅威論のミーム的投稿。画像・動画生成の話題なし。 -
#23 @walterkirn — 723 likes・91 reposts・39 replies・~28,000 views・2026-09-10
https://x.com/walterkirn/status/2098059171325427949
→ 同じくAnthropic/メディア批判の文脈で、画像・動画生成には触れていない。
以上5件が「AI」というキーワードで拾える範囲の全てであり、クローズドソース・オープンソースいずれの画像/動画生成AIニュースとしても採用できる内容ではない。
Signals
- X's Explore(このセッションが接続したサーバーの地域、投稿の「Trending in Croatia」表記から見てクロアチア基準の可能性が高い)のトップ10トレンドは「Yemen」「Saudi」「$SONG」「Charlie Kirk」「Britain」「Anthropic」「Apple」「Sony」「one ai os」「Chelsea」であり、画像・動画生成AI関連の語(Midjourney、Sora、Stable Diffusion、Runway、Kling、Veo等)は一つも含まれていない。
- 「Anthropic」と「one ai os」がトレンド入りしていることから、X上ではAIエージェント・LLMの経済的インパクトを巡る議論は活発だが、それは今回のテーマ(画像・動画生成AI)とは別の話題群である。
- 今回の40件の中で画像・動画生成AIツールの名称、リリース、デモ動画、比較などに言及した投稿は皆無だった。
Limits
- 今回使われた検索語("Yemen", "Saudi", "$SONG", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os", "Chelsea")は、いずれもX Exploreのその日のトレンドワードであり、画像・動画生成AI(例: Midjourney、Stable Diffusion、Sora、Runway、Kling、Veo、ComfyUI、Flux等)を対象とした検索語ではない。そのため収集された40件の投稿には、クローズドソース・オープンソースいずれの画像/動画生成AIニュースも一件も含まれていなかった。
- この結果、本ステージではブリーフが求める「オープンソース10件・クローズドソース10件の気づき」をX由来のデータから作ることができない。テーマに関する実質的な収集は行われなかったに等しく、Xはこのテーマについて「何も語っていない」という状態ではなく、正確には「テーマに沿った検索が行われなかった」ことが原因である。
- 次回このステージを走らせる際は、画像・動画生成AIのツール名・企業名(Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux, ComfyUI 等)を検索語に用いた再収集が必要。
YouTube
YouTube — 画像・動画生成AIニュース(クローズド/オープンソース)
Channels
- There's An AI For That — AIツール紹介系チャンネル。FLUX.2のレビューを投稿。
- AI Search — 新モデル速報系チャンネル。Sora 2、HunyuanVideo 1.5の速報動画。
- Theoretically Media — AI動画生成に強い専門チャンネル。Veo 3.1の詳細レビュー。
- Teacher's Tech — 実用ツール系チャンネル。Nano Banana 2のレビュー。
- Codebreakers — オープンソースAIモデルのレビュー・解説系。MiniMax H3特集。
- Bijan Bowen — ローカルAI画像生成のガチ勢チャンネル。Z-Image Turboのテスト。
- Benji's AI Playground — ComfyUI/ローカル生成のチュートリアル系。Ideogram 4.0解説。
- Curious Refuge — AI映像制作教育系の老舗チャンネル。Midjourney V8レビュー。
- RandomAI — 新モデル速報・比較系。GPT Image 2.5の解説。
- Standarity / The AI Filmmaking Advantage — ニュース速報・比較テスト系。Seedream 5.0 Proの発表まとめとフルテスト。
- MattVidPro AI — Runway Gen-4系のファーストインプレッション動画で言及。
Videos
- 「Is FLUX 2.0 The New Open Source King?」 — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Black Forest LabsのFLUX.2がオープンソース画像生成の新王者になり得るかを検証。
- 「We have a new #1 open-source AI video generator!」(2025-11-25)— AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — HunyuanVideo 1.5のComfyUIでのレビュー&インストール手順、低VRAMでも動くと紹介。
- 「Sora 2… wtf」 — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — OpenAI Sora 2をVeo 3、Kling 2.5、Hailuo 02と比較、音声同期と物理表現の向上を指摘。
- 「Veo 3.1 Is More Powerful Than You Realize!」(2025-10-16)— Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Google Veo 3.1の口パク同期・キャラクター一貫性・1080pアップスケールの強化を解説。
- 「The New Gemini Image Generator is Insane (Nano Banana 2)」— Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — GeminiアプリのデフォルトがNano Banana 2に置き換わったことを紹介。
- 「MiniMax H3: The New Open-Source Video Champ?」(2026-08-03)— Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — オープンウェイトのオムニモーダル動画モデルMiniMax H3(Hailuo 3.0)がネイティブでステレオ音声付き動画を1パス生成できると紹介。
- 「Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models」— Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Apache-2.0ライセンスのZ-Image TurboをローカルでテストしKING認定。
- 「Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right」(2026-06-04)— Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Ideogram初のオープンウェイトモデルがDesign Arenaで1位、文字表現がついに正確になったと報告。
- 「I Tried Midjourney 8… Here's the Truth」(2026-03-19)— Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Midjourney V8の実力を検証、正直な評価レビュー。
- 「GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model」— RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — OpenAIのGPT Image 2/2.5系、テキストレンダリングと多言語対応の向上を解説。
- 「ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted」— Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — レイヤー単位で編集できるSeedream 5.0 Proの発表内容を要約。
- 「🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)」(2026-07-16)— The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Seedream 5.0 Proを他モデルと比較しフルテスト、既存モデルを圧倒と評価。
Signals
クローズドソース側の動き
- OpenAI GPT Image 2 / 2.5がArtificial Analysis Image Arenaで首位、Eloスコア1,339で「アリーナ史上最大の1位・2位差」との報道あり(2026年9月時点)。
- Google Veo 3.1・Nano Banana Pro(Gemini 3 Pro Image)が動画/画像の両輪で強化、口パク同期・1080pアップスケール・レイヤー編集などプロ用途への寄りが顕著。
- ByteDance Seedance 2.0(2026-02)・Seedream 5.0 Pro(2026年7月前後)がマルチモーダル(テキスト+画像+動画+音声参照)を武器に急速に存在感を拡大。
- xAI Grok Imagine 1.5がVeoやSoraをベンチマークで上回ると主張する動画が複数投稿され話題化(2026年6月前後)。
- Runway Gen-4/4.5、Midjourney V8系(V8.1, V8.2)など既存プレイヤーも継続的にアップデートし、「王座防衛」的なレビュー動画が多い。
オープンソース側の動き
- Black Forest Labs FLUX.2がローカル実行可能な高品質画像モデルとして「新王者」と評されるレビューが複数。
- Tencent HunyuanVideo 1.5がComfyUIネイティブ対応し、低VRAM環境でも動くオープンソース動画生成の新定番に。
- Alibaba/Tongyi-MAIのZ-Image・Z-Image TurboがApache-2.0で公開され、「ローカルモデルの新王者」と評価するチャンネルが多数。
- Ideogram 4.0が同社初のオープンウェイトモデルとしてリリースされ、Design Arenaで1位獲得、テキストレンダリング精度の高さが強調される。
- MiniMax H3(Hailuo 3.0)がRTX 3090など個人GPUでも動くオープンウェイトのオムニモーダル動画モデルとして2026年8月に急浮上、ComfyUI対応動画が続々投稿。
- Lightricks LTX-2がオープンソースで4K・50fps・音声同期動画生成を実現し「オープンソース動画のホーリーグレイル」と評されている。
- Alibaba Wan 2.5/2.6系もテキスト・画像・音声・動画の入力に対応するオープンソース動画モデルとして継続的に取り上げられている。
Limits
- YouTube検索結果ページ(
youtube.com/results?...)はJavaScriptレンダリングのためWebFetchでは本文(タイトル・再生数・チャンネル情報)を取得できず、フッターのみが返る状態だった。個別動画ページ(watch?v=)も同様にJSレンダリングで直接読めなかったため、タイトル・チャンネル名の確認は YouTube oEmbed API(youtube.com/oembed)で行った。 - oEmbed APIは再生数・投稿日・登録者数・コメントを返さないため、本レポートの再生数とチャンネル登録者数は取得できなかった(playbookが求める項目だが今回のツール環境では取得不能)。投稿日は一部WebSearchのスニペットに含まれていたもののみ記載し、不明なものは省略した。
- 「LTX-2: Open Source AI Video, Released to the Community」(zSvCnVi181A)はoEmbedアクセス時に403 Forbiddenが返り確認できなかった。
- 上記の理由により、各動画のコメント欄の内容は確認できていない(タイトル・概要のみに基づく要約)。
- 今回はWebSearch経由の情報(記事スニペット・関連ブログ)を組み合わせて動向を補強したが、リンクを貼った動画はすべて実在するYouTube URLであることを確認済み。
Bluesky
Bluesky — 画像・動画生成AIニュース(クローズドソース/オープンソース)
Accounts
- theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — RSS連携の報道系ボット。OpenAI・Sora関連のスクープを多言語で拡散。
- ctxwindow.kynth.studio(#TechBluesky) — OpenAIの価格ページの差分を継続監視して投稿するウォッチャー。
- gen-ai.news — Midjourneyのアップデート速報を出す個人ニュースアカウント。
- oludai.bsky.social — 独自のブラインド人間評価リーダーボード(olud.ai)を運営し、オープン/クローズド画像モデルを毎時ランキング。
- aichina.news — HuaweiのModelers.cn上に出るApache-2.0のFLUX系LoRAをほぼ毎日レポートするボット的アカウント。
- circuitai.bsky.social — Alibaba WAN 3.0のアフィリエイトリンク(vidhapi.app)をほぼ同文で1日十数回投稿するスパム/宣伝アカウント。
- arxiv-cs-cv.bsky.social — 画像・動画生成分野のarXiv新着論文を自動投稿。
- un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — Midjourneyで毎日作品を出す個人アーティスト(#midjourney #QP #FoxyFriday)。
- rin-yamami.bsky.social / satomin6.alimika.jp — Qwen-Image-Edit・ComfyUIを使う日本語圏のAIイラストレーター。
Posts
- theinformation.com(2026-09-10, 👍1 🔁0)— 元OpenAI Sora責任者Bill Peeblesが、ハリウッドの大物Jeffrey Katzenberg(元ドリームワークス)、元Dropbox CFOと組んで独自の映像生成AIスタートアップを立ち上げる、とスクープ。
https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n - ctxwindow.kynth.studio(2026-09-08, 👍0/1 🔁0)— OpenAIが価格ページからsora-2・sora-2-proをひっそり削除したことを検知(旧価格: 720p $0.05〜$0.30)。Sora縮小の裏付け。
https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23 - somewhattolerable.com(2026-09-06, 👍2)— 「OpenAIがSoraを打ち切ったのは社内エンジニアがリソース食い過ぎだと不満を言ったから」との観測。
https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223 - itmatterss.bsky.social(2026-09-11, 👍1)— GoogleのGeminiがWindowsデスクトップアプリ化(Alt+Space起動)。画像生成はNano Banana、動画生成は「Gemini Omni」を搭載と明記。
https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n - dimnews.bsky.social(2026-09-11, ロシア語)— SenseTimeが80億パラメータのマルチモーダルモデル「SenseNova-U1.5」を発表、視覚推論でNano-Banana-Proを上回ると主張。
https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25 - gen-ai.news(2026-08-30, 👍1)— Midjourney V8.2の編集モデルが画質劣化の苦情を受けて静かにパッチされたと報告。
https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s - futureautomationai.bsky.social(2026-09-03, 👍2)— 「Midjourney in 2026」まとめ:V8.2・パーソナライゼーション・ムードボード・編集モデル・リファレンス機能。
https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d - oludai.bsky.social(2026-09-10/11, 👍1-2)— ブラインド評価リーダーボードで「ダウンロード可能な最良モデル」はQwen-Image-3.0-Pro(#12)で、GPT Image 2 (high)に92 Eloポイント差まで肉薄。
https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t - ddigitalmedia.bsky.social(2026-09-10, 👍1)— 「Qwen、Z-Image、MiniMaxは西側LLM/画像プロダクトに対抗できる唯一の存在」という評。
https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223 - circuitai.bsky.social(2026-09-11〜12, 反復投稿)— Alibabaの動画生成モデル「WAN 3.0」がByteDanceのSeedance 2.5に対する低価格・従量課金の対抗馬として宣伝(1クリップ最大30秒)。※同一文面のアフィリエイト投稿が1日15回以上。
https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p - minaxlab.bsky.social(2026-09-11)— ComfyUI v0.35.1がリリースされたと告知。オープンソースのローカル生成環境が継続更新中。
https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i - aichina.news(2026-09-08〜09, 連投)— HuaweiのModelers.cnにApache-2.0ライセンスのFLUX系LoRAが次々公開されているが、トリガーワードやベンチマーク未記載のものが多く「Qwen-Imageを上回るには証拠不足」と繰り返し評価。
https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24 - arxiv-cs-cv.bsky.social(2026-09-11)— 動画生成モデルの「Think-with-Video」推論能力を評価・改善する新論文が公開(From Evaluation to Enhancement)。
https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Signals
- Soraは事実上失速中:価格ページからのモデル削除、元責任者の離脱と競合スタートアップ設立、「リソースを食いすぎて打ち切られた」という観測が同時期に集中。OpenAIの動画生成は守りの姿勢に見える。
- Googleは逆に全面展開:Nano Banana(画像)・Nano Banana Pro・Veo・Gemini Omni(動画)をWindowsアプリにまで統合し、あらゆる面に生成AIを差し込む戦略。
- オープンソースの主役は中国勢:Qwen-Image-3.0-Pro、Z-Image(Turbo)、MiniMax、Alibaba WAN 3.0、SenseTime SenseNova-U1.5 が話題の中心。「西側の画像/動画AI製品に対抗できるのは中国発オープンモデルだけ」という声が複数アカウントから出ている。
- クローズドとの差は縮小傾向:ブラインド評価ベースでQwen-Image-3.0-ProはGPT Image 2 (high)に92 Eloまで接近(oludai.bsky.socialの継続計測)。
- ノイズ/宣伝の存在に注意:WAN 3.0関連の投稿の多くはcircuitai.bsky.socialによる同一文面のアフィリエイト連投で、有機的な話題の盛り上がりではない点は割り引いて見る必要がある。
- ツール面ではComfyUI・LoRAエコシステムが継続進化:ComfyUI本体の更新に加え、HuaweiのAscend NPU向けFLUX LoRA移植(aichina.news)など、CUDA以外のハードウェアへの移植も進む。
Limits
- Bluesky公開API(
public.api.bsky.appおよびapi.bsky.appのapp.bsky.feed.searchPosts)は断続的に403エラーを返し、レート制限とみられる挙動があった。連続クエリを送ると失敗しやすく、間隔を空けて再試行することで多くは成功した。 Runway Gen、Kling AI、Black Forest Labs、Wan 2.5(表記ゆれ)などいくつかのキーワードは403が続いたため断念し、代替クエリ(Wan video等)で代用した。Runway・Klingについては本ファイルに直接の投稿を収録できていない。bsky.app/searchのWeb UIはJavaScript SPAで、フェッチしても本文がレンダリングされず読めなかったため、全面的に公開APIのJSONに依存した。- 「Flux」「Z-Image」のような単語は文字通り検索されるため、Aeon Flux・太陽フレア(solar flux)・ポケモンZ-A・アダルト動画サイトなど無関係な結果が大半を占め、除外作業に時間を要した。
- The Information(Katzenberg関連)やarXiv論文などは見出し・要約止まりで、本文全体の検証はしていない(有料壁・専門論文のため)。
Lemmy
Lemmy — 画像・動画生成AIニュース
Communities
- [email protected] — 5,709 subscribers total(うちローカル893人)。画像・動画生成AIのツール/モデルリリース情報が集まる、このテーマにおけるLemmy最大のハブ。直近の投稿はほぼ全て
Even_Adderという1人のユーザーが毎日のように新しいGitHub/HuggingFaceリリースを貼っている状態。 - [email protected] / lemmy.world — 生成画像の作品共有コミュニティ。ニュースというより作品ギャラリー(スコアは-14〜16と幅広い)。
- [email protected] — SDXL+カスタムLoRAで抽象アートを作る専門コミュニティ。9月だけで10件以上投稿あり、活動は活発。
- !ai_reddit@[各インスタンス] — Reddit r/ArtificialInteligence のクロスポスト集積コミュニティ。オリジナル議論は少ない。
- [email protected] — 一般テック news。Midjourney関連の記事がここで70pt超えのスコアを獲得。
- !hackernews@[各インスタンス] — Hacker News クロスポスト。Midjourneyの騒動を複数拾っている。
- !techtakes@[各インスタンス] — AI批判色の強いコミュニティ。「Midjourney pivots to Theranos」が40pt。
- !llm@[各インスタンス] — LLM専門コミュニティ。GPT-6 Astraのリリース投稿があるがスコアはマイナス(-3)と反応は冷ややか。
- [email protected] — Perchanceというテキスト/画像生成ツール専門の小規模コミュニティ。
購読者数はインスタンスによってAPIが404を返すことがあり、[email protected] 以外は正確な数値を確認できていない。
Posts
クローズドソース寄り
- "Midjourney pivots from AI image generation to body scanning medical spa" — [email protected], 58pt, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Midjourneyが画像生成から超音波CTを使った医療スパ事業(Midjourney Medical)に方向転換したという衝撃ニュース。
- "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes, 40pt, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — 上記を「Theranosの再来」と皮肉る論評。
- "Midjourney Medical" 公式ページ — !hackernews, 3pt, 2026-06-18. https://www.midjourney.com/medical
- "Midjourney wants Hollywood studios to reveal the details of their AI usage" — [email protected], 73pt, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — MidjourneyがハリウッドスタジオにAI利用実態の開示を要求。
- "Behind the scenes with the Midjourney scanner"(動画)— !hackernews, 1pt, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
- "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit, 1pt, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — 大手クローズドソース生成AI(画像生成含む)の学習データ収集を人権団体が違法性ありと批判。
- GPT-6 Astra リリース — !llm, -3pt, 2026-09-04. https://openai.com/index/gpt-6-astra/ — LLM本体は画像/動画を直接生成せずResponses API経由でツール呼び出しする仕様。コミュニティの反応は薄く、スコアはマイナス。
オープンソース寄り(すべて [email protected]、投稿者 Even_Adder)
- MiniMax-H3 動画生成モデルの周辺ツール群 — 9/4〜9/10にかけて7件以上(
ComfyUI-MiniMax-H3-W4A4-VSA,MiniMax-H3-Semantic-Bridge,ComfyUI-Ref2VA-VSA,Minimax-h3_Singularity,minimax-h3_fl2v_8Step_motion_enhancer,ComfyUI-VDN-H3,vdn-minimax-h3,FastH3-Ref2V-Stream-Controller)。量子化・高速化・意味的ブリッジなど、オープンソース動画モデルMiniMax-H3のエコシステムが爆発的に拡大中。例: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA - "LLaDA-Image: Building Strong Image Generators" — 3pt, 2026-09-04. https://arxiv.org/abs/2609.03796 — 6BパラメータのオープンソースDiffusion Transformer論文。
- Krea 2 Turbo 用LoRA 2種 —
F16/krea2-turbo-sda(2pt, 9/10, https://huggingface.co/F16/krea2-turbo-sda)とlvladikov/Krea2-Turbo-Distill-4step-LoRA(2pt, 9/8, 4ステップ蒸留で45%品質向上を謳う)。 - "Viggle/Viggle-Animate" — 10pt, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — 1枚の再描画フレームから動画中のキャラクターを置き換える技術。
- "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit, 0pt, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — 5.84Bパラメータのオープンomniモデルがベンチマーク(MATH-500)でAppleのAFM 3Bモデルを上回ったという話題。
Signals
- オープンソース側は「モデル本体」より「周辺エコシステム」が主戦場になっている。 特にMiniMax-H3という動画生成モデルを中心に、量子化・高速化・ComfyUIノード・LoRAが1週間で10本以上リリースされており、コミュニティの熱量はここに集中している。
- Lemmyのこのテーマの発信は、実質的に個人一人(Even_Adder)のキュレーションに依存している。議論のスレッドというよりリンク集の様相で、コメント数はほぼ0。
- クローズドソース側の最大の話題は新モデルの性能競争ではなく、Midjourneyの医療スパ事業への方向転換というスキャンダラスなピボット。技術ニュースというより企業批判・皮肉のトーンが強い(pivot-to-aiなどの批判系メディアが目立つ)。
- Amnesty Internationalの報告など、生成AIの合法性・データ収集を問う人権団体からの批判もクローズドソース系の話題として浮上。
- GPT-6 Astra(2026年9月リリース)は image/video を直接生成しない仕様のため、このテーマでの直接的な話題性は薄く、Lemmy上の反応もマイナス評価。
Limits
- Lemmyは検索APIのキーワード一致に依存しており、
SoraやVeo,Runway,Kling,Grok Imagine,Nano Bananaで検索しても関連ヒットはゼロだった(無関係な投稿のみ)。これらの話題はLemmy上でほぼ議論されていない。 [email protected](別インスタンス版)はHTTP 503で読み込めなかった。dbzer0インスタンス版で代替した。- 複数コミュニティの購読者数API(
/api/v3/community?name=...)が404を返し、正確な購読者数を確認できなかったコミュニティが複数ある。 - 全体として、20件の投稿はテーマに関連する内容として集められたが、Lemmyはこのテーマについて非常に小さいプラットフォームであり、実質的な発信源は数コミュニティ・数アカウントに集中している。オリジナルの議論やスレッドは乏しく、大半がリンク投稿またはリポスト。
Pinterest — Image and Video Generation AI News
output/pinterest.pins.md に載っている50件のピン(ジャンル分けなし、単一クエリ"Image and Video Generation AI News"で収集)を全件、画像を実際に開いて確認した。
Visual themes
- ネオンブルー/パープルの近未来UI背景が圧倒的に多い。黒背景に回路基板パターン、光るAIロゴ、ホログラム風の人型シルエットという構図がインフォグラフィックにも動画サムネにも共通して使われている
[1, 3, 4, 5, 34, 37, 39, 41, 48]。 - ヒゲ面の男性YouTuber顔ドン+デカ文字「AI NEWS」+企業ロゴの寄せ集めという定型サムネが複数見つかる。驚いた顔・疑わしい顔で視聴者の目を引き、Google/OpenAI/Microsoft/Meta/Anthropicのロゴを並べる構成が反復している
[4, 20, 21, 45]。 - 「best AI video tool」系の番付インフォグラフィックが非常に多く、ほぼ同じテンプレ(ナンバリングされたカード+ロゴ+特徴チェックリスト+"best for")が使い回されている。Runway・Pika・Kling AI・Luma(Dream Machine)・Canva・Hailuo・Synthesiaがほぼ全リストで顔を揃える定番ツール群になっている
[7, 8, 13, 24, 40]。 - 「本物 vs AI」を当てさせる/見破るフォーマットが目立つ。風景写真の左右比較クイズ、ディープフェイクのトレンド解説、AI音声検出メーターなど、真贋不安をテーマにしたピンが複数系統ある
[16, 17, 20, 37]。 - ヒト型ロボットを「AI」の記号として使い回す絵柄が多い。ニュースキャスター風ロボット、地球を指すロボット、顔半分がサイボーグの合成画像など、実際の技術内容とは無関係に汎用アイキャッチとして使われている
[2, 34, 37, 39, 48]。 - 素材変換デモのグリッド画像が1件あり、同じ人物・犬・車の動画を「木製ブロック」「折り紙」「レゴ」「花」に変換した結果を並べていて、動画生成モデルの表現力デモとして具体的
[6]。 - フリーランス/受託系の宣伝ピンが紛れ込んでいる。「AI動画作ります」というFiverr風のサービス広告(WhatsApp連絡先付きや、Jeff Bezosの生成画像を使ったFiverr出品)が複数ある
[15, 32, 42]。 - 実際のプロダクトニュース(公式発表のスクショ)は全体の一部で、大半はSEO/アフィリエイト向けの量産型インフォグラフィックやYouTubeサムネ。実ニュース系はGoogle Veo 2/3、Microsoft VASA-1、ShengShuのVidu S1、Adobeのアップスケールモデル、AMD Amuse 3.0、ByteDance-MPAの著作権合意など
[3, 5, 12, 29, 46, 10, 47, 31]。
Notable pins
- #3/#5 — Google announces ultra-high quality video / Veo 2 promo — Googleの公式プロモーション素材そのもの(犬の水中スイム、フラミンゴ、キッチンの少女アニメなど実際のVeo 2出力サンプルを並べたページ)。
- #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Gemini API経由でのVeo 3画像→動画+ネイティブ音声という具体的な機能アップデート。
- #6 — 素材変換デモグリッド(Luma系) — 同一ソース動画を木製ブロック/折り紙/レゴ/花に変換した比較グリッドで、モデル性能を最も具体的に示す1枚。
- #16 — "Why Is Trump Obama AI Video Trending?" — バイラルAI動画トレンドを深掘りした詳細インフォグラフィック。使用ツールとしてRunway ML、Pika Labs、Kaiber、HeyGen、CapCut AI、DeepBrain AIを明記。
- #29 — ShengShu Technology unveils Vidu S1 — 「リアルタイム・インタラクティブ生成」を謳う中国発モデルの発表ピン。
- #31 — ByteDance and Hollywood reach global deal on AI copyright — ByteDanceとMPA(全米映画協会)がAI画像・動画生成ツールの著作権保護で合意したという法務・IP系の実ニュース。
- #44 — "More than 20% of YouTube is now AI-generated" — 具体的な統計を提示する数少ないピンの一つ。
- #46 — Microsoft VASA-1 — 1枚の写真+音声クリップからトーキング動画を生成する研究成果デモ。
- #47 — "Amuse 3.0"(AMD) — AI画像生成ツールの新バージョン発表。
- #37 — AI音声検出インフォグラフィック("97% likely AI generated") — 真贋判定・AI倫理をテーマにした啓発系ピン。
Signals
- 話題の中心は依然としてクローズドソースの商用ツール群(Runway、Pika、Kling AI、Luma、Canva、Hailuo、Synthesia、D-ID)で、これらのロゴが番付インフォグラフィックにほぼ毎回登場する。オープンソース/自前ホスト系(Stable Video Diffusion、ComfyUIワークフロー、Open-Sora的なもの)を前面に出したピンは見当たらなかった。
- Google Veo 2/3が最も目立つ公式プロダクトニュースで、Gemini API経由の画像→動画・ネイティブ音声という機能軸が強調されている。
- 中国勢ではShengShuのVidu S1が「リアルタイム・インタラクティブ生成」という切り口で登場。
- ディープフェイク/真贋不安(Trump-Obama動画トレンド、AI音声検出、"which is AI?"クイズ)がPinterestでは一貫した副テーマになっている。
- YouTube上でのAI生成コンテンツ比率(20%超)、ByteDance-MPAの著作権合意など、業界構造・法務面のニュースも一定数存在する。
- 一方で技術的な深掘り(モデルアーキテクチャ、学習手法、ベンチマーク比較)を扱うピンはほぼゼロで、Pinterestの性質上「ツール紹介」「ハウツー」「バイラル現象の解説」に偏っている。
Limits
- ワーカー側の収集クエリが単一(
"Image and Video Generation AI News")で、ジャンル分け(オープンソース/クローズドソース等)がされていなかったため、本ファイルもジャンル別ではなく50件通しでの分析となっている。ジャンル別の切り分けは後段の統合ステージに委ねる。 - 一部のピンは本テーマと関連が薄い/汎用ストック画像だった(例:
#35世界地図の時事画像、#43チェロを弾く彫像風画像、#22Adobe Stockのアイコン素材)。Pinterestの検索マッチングが緩く、ノイズとして混入したと見られる。 - Pinterestのピンには投稿日時が表示されないため、各ピンがいつのものかは判断できない(タイトル中の「2025」「2026」等の表記のみが手がかり)。
- ピン本文のタイトルはPinterest側がキャッシュしたテキストで、リンク先記事の実際の日付・詳細とは異なる可能性がある(本ページでは画像とタイトルの範囲でのみ検証)。
推奨アクション
- Xの調査はトレンドワードではなくMidjourney・Sora・Runway・Kling・Flux・ComfyUIなど固有名詞で再収集する。
- Qwen-Image-3.0-Pro対GPT Image 2のEloスコア差を定点観測し、オープン/クローズドの性能差を追跡する。
- Blueskyの価格ページ監視アカウントを継続フォローし、Soraの失速説を裏取りする。
- Reddit収集は目標の20件に届くよう検索語を増やす。
- Pinterestの番付インフォグラフィックやBlueskyのアフィリエイト連投は他プラットフォームで裏取りできるまで単独で信用しない。
収集画像


















































データ品質メモ
Xは検索語の選定ミスで画像・動画生成AI関連の投稿がゼロ件だった。Redditは12件で完了基準の約20件に届かず、YouTubeはJSレンダリングの制約で再生数・登録者数が取得できず、Blueskyは一部キーワードで403が続き収集を断念した。



