Image and Video Generation AI News — 2026-09-05
GPT-6 "Astra" dominated closed-source buzz across X and Bluesky this week, while open-source video/image models (LTX-2.5, MiniMax H3, Qwen-Image-3.0) kept pace almost entirely inside the ComfyUI ecosystem, and the biggest single story overall was Midjourney pivoting away from image generation into medical ultrasound hardware.
画像・動画生成AIニュースまとめ 〜クローズド vs オープン〜 — 2026-09-05
やっほー!今週の画像・動画生成AI界隈、まじでカオスすぎたwww🔥 クローズド側はOpenAIのGPT-6「Astra」がX(旧Twitter)で1億再生超えのバズを起こして完全に持ってった感じ😳一方でオープンソース側も負けてなくて、LTX-2.5とかMiniMax H3とかQwen-Image-3.0みたいな激強モデルが次々オープンウェイトで出てきてて、ComfyUIがガチの母艦になってる🛠️ あと地味にヤバいのが、Midjourneyが画像生成やめて医療用超音波スキャナー会社にピボットしたってニュース😱これガチで衝撃だった。技術の進化よりも「AI生成物の法的扱い」の議論の方がReddit民には刺さってた、ってのも今回の発見!
Across platforms
- GPT-6 Astra祭り:X・Bluesky(Simon Willisonのペリカン画像ベンチマーク)両方で速攻話題に。X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c 。面白いのは「画像/動画生成AI」として売り出されてないのに、みんな3DモデリングとかアニメーションでAstraをテストしてる点😂
- ComfyUIが事実上のオープンソース基地:YouTube・Lemmyの両方で、Wan・FLUX・Qwen-Image・LTX-2.5・MiniMax H3・Trellis.2まで全部ComfyUIとセットで語られてる。YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- MiniMax H3が「オープンなのに商用は課金」問題:Lemmyでも話題(RTX3060級でも動く動画モデルなのにComfy経由の有償ライセンスが必要)https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。オープン/クローズドの境界がマジで曖昧になってきてる🤔
- 技術より「炎上・転換」の方が伸びる法則:Reddit(AI生成CSAMの司法判断が800件超コメント)https://www.reddit.com/r/news/comments/1w5k6pr/ とLemmy(Midjourneyの医療機器ピボット、score58〜73)https://lemmy.zip/post/66397234 で共通して見えた現象。
Platform by platform
Reddit:r/StableDiffusionの月次まとめ(Qwen3.8、DeepSeek-V4-Pro、Ling-3.0、Gemma-4-31Bとかオープンモデルの大量リリース、コメ欄すら追いつけないペース)が神スレ https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ 。あと注目はWorld LabsのAtlas、動画/写真から3Dワールド即生成っていうロボティクス方面にも繋がる技術 https://www.reddit.com/r/accelerate/comments/1w5ye9s/ 。でも一番伸びたのは技術ニュースじゃなくて「AI生成児童ポルノは合憲」判決のスレ、法律・倫理系の方がRedditは盛り上がるっぽい。
X:検索がAstra関連の4件だけになっちゃって、GPT-6 Astraの独壇場🎤 108,000,000再生の発表ツイートに、開発者@Dimillianが「BlenderからUE5」の3Dパイプラインをデモった投稿が一番テクいhttps://x.com/Dimillian/status/2095596700815516004 。オープンソース系(Stable Diffusion, Flux, Wanとか)は今回の検索範囲では1個もヒットしなかった、これはガチの穴。
YouTube:クローズド系はNano Banana 2、Kling 3.0 vs Veo3.1 vs Sora2、Seedance2.5・Seedream5.0 Proとか比較レビューが盛りだくさん https://www.youtube.com/watch?v=AAD7wJ3DWiA 。オープン系はLTX-2.5(10秒720pを6.8秒で生成する爆速モデル)https://www.youtube.com/watch?v=RjlbDhs1MPk 、HunyuanImage3.0(80BパラメータMoE)https://www.youtube.com/watch?v=U-8RjjU7x14 など、オープンウェイトが発表直後からクローズド勢と比較される時代になってきてる。あとOpenAIがSora API終了して次期モデル「Spud」に資源集中させる話も出てた(YouTube動画自体は未確認、ニュース経由)。
Bluesky:Simon Willisonの毎回恒例「ペリカン画像ベンチマーク」がクローズド系品質チェックの定点観測所になってる https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c 。Replicate公式アカウントがKling3.0、Seedance2.0、Runway Gen-4.5、Vidu Q3みたいな動画モデルのリリース速報ハブとして機能https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c 。オープンソース系の一次発信はほぼ無くて、LoRAツール開発者のostris本人が「AI/ML界隈はほぼX(Twitter)に残ってる」って言っちゃってるレベル😅日本語勢はGIGAZINE記事のQwen-Image-3.0シェアくらい https://gigazine.net/news/20260722-qwen-image-3/ 。
Lemmy:[email protected]がオープン系の情報密度No.1。MiniMax H3関連(Comfyの商用リセラー化https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 、VRAM16GBで動くツールなど)が投稿の半分近くを占めてた。学習レシピ完全公開のLLaDA-Image https://arxiv.org/abs/2609.03796 も熱い。クローズド側は新モデルより「Midjourneyが画像生成→医療用超音波スキャナー事業へピボット」ってニュースが桁違いにスコア高くて(58〜73)、Lemmy民の一番の関心事だった。
Pinterest:ビジュアル面では圧倒的にクローズド系(Google Veo2/3、Microsoft VASA-1、Grok4.6、Gemini10億ユーザー突破)がまとめ画像のネタになってて、オープン系固有名詞はAMDのローカルツール「Amuse 3.0」くらいしか見当たらなかった。あと「顔を動かす・作る」系のユースケース(リップシンク、表情再現、ポートレート生成)がめちゃくちゃ多い、これはPinterestユーザー層(美容・SNS投稿ネタ)とAI動画の相性がいいってことっぽい。
What to watch
- GPT-6 Astraの画像/動画寄りの続報 — X, https://x.com/flowith/status/2095750768204877858(GPT-6 Astra vs GPT-5.6のアニメーション対決、近日公開予告)
- Sora API終了→次期モデル「Spud」 — YouTube調べ、2026-09-24にAPI終了予定。実際の映像・機能はまだ誰も確認できてない
- MiniMax H3の商用ライセンス化の行方 — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (オープンウェイトなのに商用は課金というハイブリッド路線が定着するか)
- Midjourneyの医療機器ピボット — Lemmy, https://lemmy.zip/post/66397234 (老舗クローズド勢がAI画像生成から本気で離脱するのか)
- LLaDA-Imageの完全オープン学習レシピ — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (Qwen-Image-Bench上位のオープンモデルが今後どこまで真似されるか)
- World LabsのAtlas — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (動画→3Dワールド生成がロボット学習データにどう転用されるか)
Recommendations
- Xの検索語をトレンド任せじゃなくて「Stable Diffusion」「ComfyUI」「Flux」「Wan」「Kling」「Sora」みたいな具体的タグに絞って再収集した方がいい。
- Blueskyの
searchPostsAPIが403で使えなかったので、次回はGoogle検索経由の既知アカウント一覧をあらかじめ増やしておくと効率いい。 - MiniMax H3みたいな「オープンウェイトだけど商用は課金」系モデルは、レポート上でも単純に「オープン」と分類せず注記した方が正確。
- Midjourneyのピボット・OpenAIのSora終了みたいな「大手の撤退・転換」ニュースは、次回以降も継続ウォッチ枠を作るべき(技術ニュースより読者の関心を引きやすいので)。
- Pinterestは一次情報が薄いので、技術トレンド把握用というより「一般消費者がどう受け取ってるか」の温度計として使うのが良さそう。
- Reddit・Lemmyで見えた「司法判断・倫理論争の方が技術ニュースよりバズる」傾向は、次回ブリーフでも別枠のシグナルとして拾う価値あり。
Data quality
- X:収集された投稿が地理的にクロアチア圏のトレンド起点だったため、GPT-6 Astra関連4件以外は無関係なノイズ(暗号通貨・イーロン界隈・スポーツなど)。オープンソース系の言及はゼロで、ブリーフが求める「20件解析」には届いていない。
- Bluesky:公式検索APIが403で使えず、既知アカウントの個別フィード確認方式に変更。テーマに直接関係する投稿は約12件どまりで、オープンソース系一次情報はほぼ拾えなかった。
- Reddit:検索語1本のみで12スレッド・9サブレディットに留まり、20件基準には未達。ただしトップコメントは各スレ最大6件まで記録。
- YouTube:検索結果・動画ページがJS描画のため再生数・登録者数・正確な投稿日を直接確認できず、日付はスニペットの相対表記から推定。
- Lemmy:連合型のため単一インスタンス検索では他インスタンスの投稿が漏れる。動画生成系クローズドサービス(Sora, Kling, Veoなど)の直接検索はほぼヒットなし。
- Pinterest:50件中24枚のみ実際に画像を開いて確認、残りはタイトルのみ。いいね数・保存数などのエンゲージメント指標は収集データに含まれていない。
プラットフォーム別まとめ
Reddit — Image and Video Generation AI News
Where
収集された12スレッドは9つのサブレディットから。検索語は「Image and Video Generation AI News」の1本のみ。
| サブレディット | 登録者数 | 収集スレッド数 |
|---|---|---|
| r/generativeAI | 150,575 | 4 |
| r/GrokAiDiscussion | 4,883 | 1 |
| r/freetoolsAI | 7,616 | 1 |
| r/StableDiffusion | 1,000,814 | 1 |
| r/accelerate | 77,800 | 1 |
| r/news | 31,531,475 | 1 |
| r/antiai | 313,317 | 1 |
| r/allthequestions | 127,064 | 1 |
| r/teenagers | 3,673,210 | 1 |
r/generativeAIが件数では最多(4件)で、ツール探し・比較系のカジュアルな投稿の中心地。それ以外は各サブから1件ずつで、r/newsやr/teenagersのような画像/動画生成専門ではないサブにもテーマが波及している点が目立つ。
What people say
- #4 r/StableDiffusion「Local AI News You Missed - August 2026」(201pt・22コメント・2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — 8月だけでQwen3.8、DeepSeek-V4-Pro-0813、Ling-3.0系列、Gemma-4-31Bなど大量のオープンソースモデルがリリースされたとする月次まとめ。コメント欄でも追加報告が相次ぎ、u/Narutobirama(20)「You probably missed Qwen3.8 Flash Next.」、u/MoJaKF(14)「Anima-3.8B its already on its 1.1 release that just released 3h ago」と、まとめ投稿自体が追いつけないほどのペースを示している。
- #5 r/accelerate「…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground」(763pt・76コメント・2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — World LabsのAtlasが動画/写真からインタラクティブな3Dワールドを生成する件。u/stainless_steelcat(48)「Matrix bullet time comes to real life...now I know it wasn't ambitious enough.」など反応は熱狂的で、動画生成技術がロボティクスの学習データ生成に橋渡しされる可能性が語られている。
- #6 r/generativeAI「Same prompt. Same 30 seconds. Two different AI video models.」(98pt・30コメント・2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — Seedance 2.5とWan 3.0を同一プロンプトで比較。u/SpecialistDragonfly9(5)は「seedance is the by FAR superior one」と評価する一方、u/Positive-Key6640(4)は「Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better」と比較手法自体に疑問を投げている。
- #2 r/GrokAiDiscussion「Have they loosened the image to video generation moderation」(14pt・28コメント・2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — Grok Imagineのモデレーション方針についてユーザーの体感が割れている。u/Miserable_Appeal515(2)「it has gotten better」に対し、u/joderrelldalejr(2)は「Hell no it gets worse and then they start to limit how many images you can even do in a week」と真逆の報告。
- #1 r/generativeAI「List of daily AI video generative websites」(38pt・27コメント・2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — 無料枠を使い倒すユーザー向けの情報交換。Kling AIは「66 free credits every 24 hours」、u/Murky-Race-3443(1)「capcut gives daily free credits btw」、u/Julia_Leeds94(1)はYalleryLabsが「$3の予算で5秒動画が720pで$0.18から」と紹介。
- #3 r/freetoolsAI「Free AI Image Generator」(31pt・31コメント・2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — 無料・登録不要をうたう画像生成サイトの宣伝投稿にコメントが集まり、u/Odd-Lingonberry1516(2)がDeepany、Aifun、Perchanceなど代替ツールを列挙。u/thecragmire(1)「How do you maintain this? It's got to cost you something, right?」と収益モデルへの疑問も出ている。
- #11 r/generativeAI「GOOD image-to-video ??」(1pt・13コメント・2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AIが「practically king of the hill for realistic human motion」、Runwayが「The gold standard for creative control」と評され、ローカル勢としてu/Ok-Addition1264(2)がComfyUI+WAN22/LTX2.3を推薦している。
- #7 r/generativeAI「Any good Ai video site ? Even if it paid ?」(0pt・15コメント・2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1)はRunwayのgen-3を「actually handles motion pretty well compared to a lot of the jank」と評価しつつ、Pikaは「fun for quick little loops...but the output gets samey after a while」と手厳しい。
- #8/#10 r/news「Federal Judge rules AI generated child sex abuse material is protected by First Amendment.」(1,379pt・545コメント・2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) と r/allthequestions「Why did a federal judge declare the creation of AI generated child porn as legal?」(31pt・277コメント・2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — AI生成物の法的位置づけを巡る議論が突出したエンゲージメントを集めている。u/Ntroepy(414)は「The headline reads like click-bait...bound by a 2002 Supreme Court ruling」と誤解を招く見出しを指摘し、r/allthequestionsのu/TheGracefulCrane(31)は「judges dont make laws and the law hasnt been updated to make it illegal ergo the ruling」と法解釈を整理している。
- #9 r/antiai「AI generated images are becoming harder to detect」(113pt・30コメント・2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — タイトルとは裏腹に、実際のコメントはu/GurInside278(31)「why are her feet her hands」など手足の破綻ネタで盛り上がっており、皮肉なギャップになっている。
- #12 r/teenagers「To all AI image/video generator users」(7pt・41コメント・2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — 「AIアートはアーティストが作業していない」という主張への反論投稿。u/LiterallyGarbage_0(5)「people who use ai to make "art" genuinely make me so upset...pick up a pencil」など、ティーン層のアンチAI感情が強く表れている。
Signals
- 上昇: オープンソースのローカルモデル(LLM/画像/動画)のリリース頻度がスレッド#4のコメント欄だけでも追いきれないほど速い。World LabsのAtlas(#5)のような「動画生成→ロボティクス学習データ」への転用も新しい盛り上がり方向。
- 意見の対立: Grok Imagineのモデレーション(#2)は「良くなった」「悪くなった」の報告が真っ二つ。Seedance vs Wan(#6)も「seedanceが圧勝」という声と「そもそも同一プロンプト比較は意味が薄い」という反論が同居している。単一の結論では語れない。
- 軽視されている/疑問視されている: 同一プロンプトでのモデル比較という定番フォーマット(#6)自体が、u/Positive-Key6640によって手法として批判されている。
- 意外だった点: 「AI画像が見分けにくくなっている」と題した#9のスレッドが、実際は手足の破綻ネタで笑いを取る内容になっており、タイトルの主張と実際の反応にギャップがある。また、プロダクトニュースよりも司法判断(#8・#10、合計800件超のコメント)の方がエンゲージメント規模で圧倒しており、Reddit上では「技術の進歩」より「AI生成物の法的・倫理的扱い」が最大の火種になっている。
Limits
- 検索語は「Image and Video Generation AI News」の1本のみで、収集できたのは12スレッド・9サブレディット。brief.mdが求める「各ネットワークで20件ほどの投稿」には届いていない。
- 本ステージはワーカーが事前収集した
output/reddit.threads.md/.threads.jsonを読むのみで、追加の検索語での再収集や個別スレッド・コメントへの直接アクセスは行っていない(プレイブックの指示通り)。収集漏れがあるとすれば、この1検索語の範囲外にある可能性が高い。 - 各スレッドのトップコメントは最大6件までしか記録されておらず、それ以下の反応や少数意見は本レポートに反映されていない。
X
X — Image and Video Generation AI News
Accounts
Of the 34 accounts in this collection, only four posted anything related to
image/video generation AI — all about the same launch, in the same 24 hours
(2026-09-03):
- @OpenAI (OpenAI) — one post, but it is the whole story: 309,095 likes,
55,587 reposts, ~108,000,000 views. The account did the minimum (one
announcement tweet with an image) and let volume do the rest. - @MatthewBerman (Matthew Berman) — AI-influencer account, one post
(4,054 likes, ~1,500,000 views) framed as a hands-on first-look thread with
"early access," positioning himself as a tester rather than the source. - @Dimillian (Thomas Ricouard) — one post (7,199 likes, ~2,300,000 views),
a developer showing a specific pipeline (Blender → Unreal Engine 5) rather
than general hype — the most concrete technical claim in the set. - @flowith (Flowith) — smallest account here (947 likes, ~115,000 views),
a product account piggybacking on the launch with a head-to-head comparison
against the previous model.
Every other account in the collection (34 total, 40 posts) — crypto/meme
accounts (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), Elon/Tesla
fan accounts (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), a cybersecurity
influencer (@corewarrior, @hackerzspace), Poland/Africa/Bosnia news-and-meme
accounts, Ariana Grande fan accounts (@vodolove posted 3 of its 4 items),
and beer-brand sweepstakes accounts (@naturallight, @ChinookCi) — has nothing
to do with image or video generation AI. They are noted here only because
they're what the collection actually returned; see Limits.
Posts
1. GPT-6 "Astra" launch — @OpenAI
- 309,095 likes · 55,587 reposts · 7,713 replies · ~108,000,000 views · 2026-09-03
- https://x.com/OpenAI/status/2095595741528125780
"This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast."
The single biggest post in the whole collected set by an order of magnitude.
Framed as a general computer-use agent, not an image/video-specific model —
but the demos that followed from other accounts (below) are all visual/3D,
suggesting Astra's showcased strengths lean toward that side.
2. Astra vs. previous model, framed around animation — @flowith
- 947 likes · 69 reposts · 19 replies · ~115,000 views · 2026-09-04
- https://x.com/flowith/status/2095750768204877858
"GPT-6 Astra VS GPT-5.6 on animation coming soon to flowith.io"
A third-party product account explicitly setting up an Astra-vs-previous-gen
animation comparison — a concrete signal that Astra is being tested/marketed
on animation-generation capability specifically, not just general computer use.
3. Early-access hands-on thread — @MatthewBerman
- 4,054 likes · 494 reposts · 210 replies · ~1,500,000 views · 2026-09-03
- https://x.com/MatthewBerman/status/2095595892464333065
"Astra (GPT-6) is here!!! I've had early access and tested it like crazy with things like games, code, writing, browser control, presentations and general knowledge work. This is the best model I've ever used. Period."
Notable for what it does not mention: no image or video generation named
explicitly in the capability list, despite the thread promising "incredible
demos below."
4. Blender-to-Unreal Engine 5 walkthrough — @Dimillian
- 7,199 likes · 1,145 reposts · 259 replies · ~2,300,000 views · 2026-09-03
- https://x.com/Dimillian/status/2095596700815516004
"Astra is very good at 3D modeling, and I can't wait for all of you to experience it, for now here is a little walkthrough on how I built the demo house for our launch blog post. From a Blender scene to a Unreal Engine 5 walkable experience."
The most concrete, tool-specific claim in the collection: Astra used inside a
real 3D content pipeline (Blender → UE5), which is closer to a video/visual
generation workflow than anything else X surfaced this run.
Signals
- Rising: GPT-6 "Astra" is the only image/video-adjacent story this
collection surfaced, and it dominates by engagement (~108M views on the
launch post alone vs. low-hundred-thousands for everything else). The
cluster of reactions (product comparison, influencer hands-on, developer
3D-pipeline demo) within 24 hours of each other reads as a coordinated
launch, not organic discovery. - Dismissed / absent: No open-source image or video generation model
(Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI, etc.) appears
anywhere in this collection. If open-source AI video/image work is
happening on X right now, this search pass did not reach it. - Surprising: how little of the "AI" launch discourse actually names
image or video generation as a feature — Matthew Berman's early-access
list omits it entirely, and Astra is marketed as a general agent
("anything you can do on a computer"). The image/video angle is inferred
from what early testers chose to demo (3D modeling, animation comparison),
not from OpenAI's own framing.
Limits
- The searches collected did not target this theme. The ten terms
actually searched — "Astra", "$SONG", "Robinhood", "Elon", "#CyberSecurity",
"Poland", "Africa", "Bosnia", "ariana", "#Sweepstakes" — are X's own
trending-topic list for this session (see the Explore table in
x.posts.md), not search terms chosen for image/video generation AI. Only
the "Astra" searches (posts #1–4) turned up anything on-theme; the other
36 posts (crypto tokens, Elon/Tesla fandom, cybersecurity influencers,
Poland/Africa/Bosnia news and memes, Ariana Grande fan accounts, beer
sweepstakes) are unrelated noise from a mismatched search list. - Completion criteria not met from this data. The brief asks for ~20
posts per platform analyzed against the theme; this collection yields only
4 usable posts, all about one closed-source launch (GPT-6 Astra), and zero
about open-source image/video generation. A pass searching terms like
"Stable Diffusion", "ComfyUI", "Flux", "Kling AI", "Runway", "Sora",
"Midjourney", "Wan 2.x", or "HunyuanVideo" would be needed to actually
cover the brief on X. - Geolocation caveat: X's Explore trending list in this session is
geolocated to Croatia (explicitly labeled "Trending in Croatia" for most
entries), which is why crypto tokens, Bosnian football, and Balkan-region
news/memes dominate the trending list this collection was seeded from —
this is one server location's trends, not a global picture. - No open-source coverage at all. Nothing in this collection touches
open-source image or video generation news, tools, or releases — that gap
is total, not partial.
YouTube
YouTube — 画像・動画生成AIニュース(クローズドソース / オープンソース)
Channels
YouTube検索結果とニュース検索経由で見つけたチャンネル。多くは動画ページ自体がJavaScript描画のため登録者数を直接確認できなかった(詳細は## Limits)。
- Theoretically Media — Wan / FLUX / Qwen-Image など毎回オープンソース生成AIをComfyUIで検証する定番チャンネル。("Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial..." https://www.youtube.com/watch?v=3BFDcO2Ysu4)
- Matt Wolfe / The Next Wave — Runway・Kling・Veo・Soraなどクローズドソース系AIツールの比較企画で有名。
- LTX-2.5・MiniMax H3・Nano Banana 2など個別モデルのレビューを出している複数の個人系AIツールチャンネル(チャンネル名は検索結果に現れず、動画タイトルのみ確認)。
Videos
クローズドソース系
- 「Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!」 — 2026-02-26頃 — https://www.youtube.com/watch?v=k0dujOUePeU — GoogleのGemini 3.1 Flash Image(通称Nano Banana 2)を実際にテストし、速度と画質のトレードオフを解消したと主張。
- 「Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To」 — 2026年2月末 — https://www.youtube.com/watch?v=B1d3SIfoQLk — 無印とProの出力を比較し、どちらを使うべきかを検証。
- 「Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2」 — 2026-02-05頃 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — KuaishouのKling 3.0をVeo 3.1・Sora 2と直接比較し、映像のリアリズムとカメラワークで健闘していると評価。
- 「Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)」 — 2026-02-04頃 — https://www.youtube.com/watch?v=Rme22R7a9O8 — 実際に課金してKling 3.0のマルチショット・4K60fps出力をテスト。
- 「Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!」 — 2026-07-15頃 — https://www.youtube.com/watch?v=pn-YwWn3kkM — ByteDanceのSeedream 5.0 Pro画像モデルと未発表のSeedance 2.5をテスト(ByteDanceはSeedance 2.1をスキップしたと言及)。
- 「Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?」 — 2026-06-23頃 — https://www.youtube.com/watch?v=8sGVhuoPOXI — Seedance 2.5が1ショットで30秒の連続映像を生成できる点を検証。
- 「MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model」 — 2026年8月上旬 — https://www.youtube.com/watch?v=67CCQBAwZiA — 2026-07-31リリースのMiniMax H3(Hailuo 3.0)をハンズオンでテスト、2K・15秒・ネイティブステレオ音声を確認。
- 「Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)」 — 2026年8月頃 — https://www.youtube.com/watch?v=la0iBk8g8_g — MiniMax H3のオムニモーダル(テキスト・画像・動画・音声を同時入力)機能をフルテスト。
- 「FLUX 3 Sneak Peek」 — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — Black Forest LabsのFLUX 3(画像・20秒動画・音声・アクションのマルチモーダル、2026-08-04にVideoがGA)の先行紹介。
- 「Gen-4.5 Updates — Research Demo Day 2025 | Runway」 — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — Runway公式チャンネルによるGen-4.5の技術アップデート解説(カメラ制御・キャラクター一貫性)。
- 「All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!」 — 直近 — https://www.youtube.com/watch?v=SnmRpf_VfgU — 複数のクローズドソースAI(Kling・Veo・Sora・Nano Banana Pro)を無料枠でまとめて使う方法を紹介する動画。
オープンソース系
- 「LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch」 — 2026年8月中旬(投稿から約3週間、2026-08-11のLTX-2.5オープンウェイト公開を受けたもの) — https://www.youtube.com/watch?v=RjlbDhs1MPk — Lightricksの22B世界モデルLTX-2.5をComfyUIにネイティブ導入し、10秒720p動画を6.8秒で生成できる速度を確認。
- 「LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows」 — 約3週間前 — https://www.youtube.com/watch?v=WpKNXZZqQEU — オープンウェイトのLTX-2.5と非公開のMiniMax H3を物理演算・マルチショットで直接対決させて比較。
- 「New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)」 — 約3週間前 — https://www.youtube.com/watch?v=pA2BQw9LY8A — ローカル実行での速度に焦点を当てたテスト。
- 「Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models」 — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Wan 2.2(MoE動画モデル)、FLUX、FLUX Krea、Qwen ImageをまとめてComfyUIで解説。Wan 2.2はSoraに迫る一貫性、FLUXはディテールで優位と評価。
- 「HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet」 — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — Tencentの80BパラメータMoE画像モデルを紹介。Seedream 4.0・Nano Banana・GPT-Imageに対して僅差で勝率があると言及。
- 「Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!」 — 2025-11-26頃 — https://www.youtube.com/watch?v=MoAwonm53hQ — Black Forest LabsのFLUX.2(オープンウェイト版含む)のComfyUIセットアップとレビュー。最大10枚の参照画像で被写体の一貫性を保てる点を紹介。
- 「FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret」 — 2025-11-26頃 — https://www.youtube.com/watch?v=nfeDS_EoblE — FLUX.2のComfyUI導入手順と新機能の解説。
- 「Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)」 — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — Alibaba Qwen-Imageのローカル実行を初検証(のちのQwen-Image-2512の前身)。
- 「Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow」 — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — Qwen Image Editの複数参照画像スタイル転送をComfyUIのGGUFワークフローで検証。
- 「MiniMax H3: The New Open-Source Video Champ?」 — 2026年8月頃 — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3はオープンウェイト公開されたオムニモーダル動画モデルとして紹介(動画編集ランキング1位という評価に言及)。
Signals
- オープンウェイトが最新鋭に急接近: LTX-2.5(2026-08-11)とMiniMax H3(2026-07-31)はどちらも直近60日以内にオープンウェイトで公開され、動画では「クローズドソースのMiniMax H3に匹敵/超える」という切り口の比較サムネイルが目立つ。オープンソース勢が「後追い」ではなく発表直後から比較対象になっている。
- ByteDanceの高速リリースサイクル: Seedream 5.0 ProとSeedance 2.5(2.1はスキップ)が数ヶ月おきに更新され、YouTuberの検証動画も「Tested」「Leaks」など速報色が強い。
- Google陣営の再編: Imagenライン全体が2026-08-17に廃止予定となり、Nano Banana(Gemini 3.x Image系)への移行が進行中。Nano Banana 2(2026-02-26)自体もすでに複数の後継比較動画(vs Pro)が出ている。
- クローズドソース大手の撤退: OpenAIはSora API を2026-09-24に終了し、次期モデル「Spud」へ計算資源を振り向ける方針(検索結果より、YouTube動画は未確認)。これはブリーフの「クローズドソースの動向」に直結する大きな転換点。
- ComfyUIが事実上のオープンソース検証基盤: Wan、FLUX、Qwen-Image、LTX-2.5など、オープンソース系のレビュー動画はほぼ全てComfyUI導入手順とセットで語られている。
Limits
- YouTubeの検索結果ページ(
youtube.com/results?...)と動画ページ(youtube.com/watch?v=...)はJavaScriptで描画されており、直接フェッチしてもフッターのナビゲーションリンクしか取得できず、再生回数・登録者数・投稿日の生データ(ytInitialData等)を直接読み取ることができなかった。そのため、日付は検索エンジンのスニペットに現れた情報(「3 weeks ago」等の相対表記や記事内の言及)から推定しており、正確な再生回数・チャンネル登録者数は確認できていない動画が大半。 - OpenAIのSora終了・後継モデル「Spud」に関する直接のYouTube動画は見つけられず、この項目はニュース記事の言及に基づく(YouTube上の反応動画は未確認)。
- Runway Gen-4.5やMidjourneyの直近アップデートに関するYouTube動画は、公式チャンネルの発表動画は見つかったが、独立系レビュアーによる直近(60日以内)の検証動画は今回の検索では見つからなかった。
- Nano Banana Pro個別のレビュー動画(タイトル「Nano Banana Pro… wtf」等)はリンクを確認できたが、チャンネル名・再生回数は取得できなかった。
Bluesky
Bluesky — 画像生成AI・動画生成AIの最新動向
Accounts
- Simon Willison @simonwillison.net — LLM/画像生成モデルの評価で有名な開発者。恒例の「ペリカン画像ベンチマーク」で新モデルが出るたびに画像を比較投稿している。フォロワーの反応も多く、クローズドソース系ニュースの一次情報源として優秀。
- fofr @fofr.ai — Replicate周辺で活動する画像生成プロンプト職人。Nano Banana Pro (Gemini 3 Pro Image) の実践的な使い方を頻繁に投稿。
- Replicate(公式) @replicate.com — AIモデルAPIホスティング企業の公式アカウント。新モデルがReplicateに載るたびに告知しており、クローズド・オープン問わず動画生成モデルのリリース速報源になっている。
- Amanda Silberling(TechCrunch記者) @amanda.omg.lol — AI画像生成の文化的側面を取材するジャーナリスト。
- AI News Updates @ai-latestnews.bsky.social — AI業界ニュースを自動投稿するbotアカウント。
- gigowat @gigowat.bsky.social — 日本のガジェット系ニュースサイトGIGAZINEの記事をBlueskyにシェアするアカウント。日本語での画像生成AIニュースの数少ない発信源。
- ostris @ostris.com — オープンソースのLoRA学習ツール「AI-Toolkit」開発者。Flex系モデルの投稿はあるが本人いわく「AI/ML界隈はほぼTwitterに残っている」とのことで、Bluesky上の更新は少ない。
Posts
-
Simon Willison — GPT-6 Astra とGPT-5.6 Sol/Terra/Lunaのペリカン画像比較グリッドを投稿(クローズドソース、OpenAI系画像モデル比較)。2026-09-04、👍91・🔁6・💬12。
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
フォローアップで生成画像のフルサイズ版も投稿(alt textもGPT-5-astra生成)。👍23。
https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c -
Simon Willison — Google Gemini 3.7 Flashで生成したペリカン画像を比較投稿。2026-09-02、👍6。
https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r -
fofr — Nano Banana Pro(Gemini 3 Pro Image)でレトロゲーム風レンダリングを再現するプロンプト詳細を共有。2026-01-19、👍31。
https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
同日、ストリートビュー風スクリーンショット生成のプロンプトも投稿。👍10。
https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m -
Replicate(公式) — OpenAIの「GPT Image 2」がReplicateで利用可能になったと告知。写実性とテキスト描画精度、UI/デザイン用途への強さを紹介(クローズドソース)。2026-04-21。
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate(公式) — ByteDanceの動画生成モデル「Seedance 2.0」が全ユーザーに開放されたと告知。テキスト・画像・動画・音声を1つのシーンに統合し、ステレオ音声も同期生成(クローズドソース)。2026-04-09。
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate(公式) — RunwayのGen-4.5がReplicateに追加。物理的なリアリズムを強調した映像生成モデル(クローズドソース)。2026-02-18。
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate(公式) — KuaishouのKling 3.0(+o3)がReplicateに追加。マルチショット4K・音声同期対応(クローズドソース)。2026-02-17。
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate(公式) — 動画生成モデル「Vidu Q3」がReplicateに追加。テキスト/画像/start-endフレームからの生成に対応、最大16秒・1080p(クローズドソース)。2026-03-11。
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Amanda Silberling(TechCrunch) — なぜAI生成の食べ物画像は独特の見た目になりがちなのか、専門家のコメントを募集する投稿。AI画像生成の美学的クセについての取材依頼。2026-08-28、👍17・🔁5・💬4。
https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x -
AI News Updates(bot) — 「Midjourney Inc.がアストロロジーアプリCo-Starを買収し、新しい画像生成アプリを立ち上げる」と報告。2026-07-25。TechCrunchやBloombergの報道(2026-07-24、買収は今春クローズと報道)と一致する内容で、裏取り可能。
https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s -
gigowat(GIGAZINE記事の日本語共有) — オープンソースの画像生成AI「Qwen-Image-3.0」が登場、イラストや日本語テキストの描画性能を検証したというGIGAZINE記事をシェア。2026-07-22。
https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
(元記事: https://gigazine.net/news/20260722-qwen-image-3/ ) -
ostris — オープンソース画像生成モデル「Flex.2-preview」(text-to-image・universal control・inpaintingを統合)のリリースを告知。やや古い投稿(2025-04-22)だが、Bluesky上でオープンソース系モデル開発者が直接発信している数少ない例。👍4。
https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a
Signals
- クローズドソース優勢:Bluesky上で実際にエンゲージメントが伴っている投稿は、GPT系・Gemini系(Nano Banana Pro)・Midjourneyなどクローズドソースの大手モデルに集中していた。特にSimon Willisonの「ペリカン画像ベンチマーク」は新モデルが出るたびに定点観測的に比較されており、事実上のクローズドソース画像モデル品質チェックの場になっている。
- Replicateアカウントが動画生成の速報ハブ:Kling 3.0、Seedance 2.0、Runway Gen-4.5、Vidu Q3など、2026年に入ってからの主要動画生成モデルのリリースが軒並みReplicate公式アカウント経由で流れてきた。いいね数自体は少ない(1〜2件)ものの、時系列でモデルの登場順を追うのに有効だった。
- オープンソース勢の発信はBluesky上では手薄:Wan 2.7(Alibaba)、HunyuanVideo 1.5(Tencent)、Chroma、LTX-2.3など2026年の主要オープンウェイトモデルについて、Bluesky上での一次言及はほとんど見つからなかった。オープンソースのLoRA学習ツール開発者ostrisも「AI/ML界隈はほぼTwitterに残っている」と自ら投稿しており、コミュニティの拠点がX(旧Twitter)側に偏っていることが伺える。
- 日本語での発信はGIGAZINE経由の共有が中心:日本語投稿はgigowatのようなニュースサイト記事の転載が中心で、独自の一次分析投稿は見つからなかった。
Limits
- Bluesky公式の投稿検索API(
app.bsky.feed.searchPosts)は本セッションのWebFetchツールからは常に403 Forbiddenが返り、キーワード検索によるいいね数・リポスト数付きの網羅的な投稿収集ができなかった(getProfile・getAuthorFeed・getPostThread・oEmbedは正常に動作した)。そのためGoogle検索で見つけた既知のアカウントをgetAuthorFeedで個別に確認する方式に切り替えて調査した。 bsky.appの検索ページ自体はJavaScriptで描画されるSPAのため、WebFetch(HTML→Markdown変換のみ)では投稿本文を取得できなかった。- 上記の制約により、「特定モデル名で検索して該当ツイートを全件確認する」という網羅的な調査はできておらず、著名アカウントの直近投稿からテーマに合致するものを抽出する形になった。結果として合計20件強の投稿・フィードを確認したが、そのうち画像・動画生成AIに直接関係する投稿として拾えたのは上記12件程度。
- オープンソース系モデル(Wan、HunyuanVideo、Chroma、Z-Image本体、LTX-2.3など)については、Bluesky上で該当アカウントを複数試したが該当する2026年の投稿を発見できなかった。huggingface.bsky.socialは投稿フィードが空、civitai-bot.bsky.socialは2024年5月で更新が止まっていた。
- 「MidjourneyがMeta.aiの一部になった」という趣旨の個人アカウント投稿(2026年2月)を発見したが、外部報道で裏取りしたところ実際は2025年8月のライセンス契約(Midjourneyは独立を維持)であり、買収ではないため、不正確な情報として本レポートには採用しなかった。
Lemmy
Lemmy — 画像・動画生成AIの最新動向(クローズド/オープンソース)
コミュニティ (Communities)
- [email protected] — 5,708人。オープンウェイトの画像・動画生成AI全般の技術ディスカッション。今回の調査で一番情報密度が高かったコミュニティ。
- [email protected] — 2,360人。Stable Diffusion系モデルで作った作品の投稿場。ニュースそのものは少ない。
- [email protected] — 1,593人。アニメ系AIアート専用。ニュース性は低い。
- [email protected] — 50人。Reddit RSSの自動転載コミュニティ(bot運用)。人間の議論ではない点に注意。
- [email protected] および [email protected] — 汎用テックニュース。画像・動画生成AI単独のヒットは少なく、AI全般の記事に埋もれている。
- 画像・動画生成AI専用の大規模コミュニティ(Reddit の r/StableDiffusion 級)はLemmy上には存在せず、話題は上記の小さめのコミュニティに分散している。
投稿 (Posts)
オープンソース系
- MiniMax H3、Comfyが商用ライセンスの公式リセラーに — [email protected]、score 4、2026-08-28。元記事: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3は2026年8月公開のオープンウェイト動画生成モデルで、RTX 3060クラスのGPUでもローカル動作し、2K・ネイティブステレオ音声付き動画を生成できる。Comfyが商用ライセンス(Professional/Enterprise)の販売代理店になり、Enterpriseでは無蒸留モデルまで使える。
- LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — [email protected]、score 2、2026-09-04。https://arxiv.org/abs/2609.03796 。学習レシピを完全公開した画像生成モデルで、Qwen-Image-Benchでトップ級のスコア、高速な蒸留ターボ版もあり。
- Trellis.2とPixal3DがComfyUIにネイティブ統合 — [email protected]、score 4、2026-09-01。https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。「最良のオープン3D生成モデルがComfyUIコアの一部になった」とアナウンス。
- ComfyUI-MiniMaxH3-CLSS — [email protected]、score 0、2026-09-01。https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。MiniMax H3向けの技術で、VRAM 16GBのコンシューマー機でも任意長の音声付き動画生成が可能になったというツール。
- Fizgig LoRA/LoKR Studio — [email protected]、score 4、2026-08-30。https://github.com/shootthesound/Fizgig 。Krea 2、MiniMax、Klein 9Bなど複数モデルファミリー向けにLoRA/LoKRを学習・抽出できるオープンツール。
- VibeVoice-ComfyUI(MicrosoftのオープンTTSをComfyUIに統合) — [email protected]、score 1、2026-08-28。https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。動画生成のワークフローに音声を組み込む動きの一例。
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — [email protected]、score 5、2026-06-17。軽量・効率重視のオープン画像生成基盤モデル。
クローズドソース系
- Midjourneyが画像生成AIから医療用超音波スキャナー事業へピボット — [email protected]、score 58、2026-06-18。https://lemmy.zip/post/66397234 。関連スレ多数(hackernewsミラーなど、score 40〜)で「Midjourney Medical」「Ultrasonic CT」として大きな議論に。老舗クローズド画像生成サービスの方向転換として最大級のニュース。
- Midjourneyがハリウッドのスタジオに対しAI利用の詳細開示を要求 — [email protected]、score 73、2026-07-05。https://lemmy.today/post/56011946
- Googleの新画像生成モデル「Nano Banana 2 Lite」がリリース — [email protected]、score 0、2026-07-02。https://lemmy.world/post/48936394(hackernewsミラー: https://lemmy.bestiver.se/post/1199483 )
- MicrosoftのMAI-Image-2.5がGoogleのNano Banana 2にベンチマークで肉薄 — [email protected]、score 1、2026-05-28。https://lemmy.durstig.online/post/35068
- Seedream 5.0 Proの実機比較レビュー — [email protected]、score 1、2026-07-10。https://lemmy.durstig.online/post/46063
- Runway、エンタープライズ事業が倍増・純収益維持率300%超と発表 — [email protected]、score 0、2026-08-30。https://lemmy.durstig.online/post/56937
- GoogleのEarth AI機能、公開翌日にNSFW生成問題で静かに撤回 — [email protected]、score 1、2026-08-07。https://lemmy.durstig.online/post/52162
シグナル (Signals)
- オープンソース側は「MiniMax H3一色」: 2026年8月末〜9月頭のstable_diffusionコミュニティの投稿の半分近くがMiniMax H3(動画生成、ローカルでRTX 3060級でも動く、音声つき)関連のComfyUI拡張・高速化ツール。オープン動画生成のデファクトになりつつある雰囲気。
- オープンとクローズドの境界が曖昧に: MiniMax H3は「オープンウェイト」だが、商用利用はComfy経由の有償ライセンス制。無料で使えるが商用は課金という、オープン/クローズドのハイブリッドモデルが主流になりつつある兆候。
- クローズド側の最大ニュースは「撤退」: 新モデル競争のニュースよりも、Midjourneyが画像生成から医療機器へピボットしたという「クローズド最大手の一角が畑違いの事業に転換」というニュースの方がスコアが圧倒的に高く(58〜73)、Lemmyユーザーの関心を集めた。
- 3D生成もComfyUIに統合が進行中: Trellis.2やPixal3DなどオープンなText/Image-to-3DモデルがComfyUIのコア機能になり、画像・動画だけでなく3Dアセット生成もローカルワークフローに取り込まれつつある。
- Lemmy全体としては画像・動画生成AI専用の大規模コミュニティが存在せず、話題は技術寄りのstable_diffusion系コミュニティ(数千人規模)と、Reddit記事を自動転載するai_redditのような小規模botコミュニティ(50人)に分散している。
制限事項 (Limits)
- Lemmyは連合型(fediverse)で検索APIが単一インスタンスの索引しかカバーしないため、
lemmy.worldのAPI検索では他インスタンス(lemmy.dbzer0.com、lemmy.todayなど)の投稿が漏れる。今回は複数インスタンスのAPI・検索を横断して補ったが、完全な網羅ではない。 lemmy.mlのlocalllamaコミュニティは直接のコミュニティ情報取得(/api/v3/community)が404で失敗し、詳細を確認できなかった。[email protected]はRedditのRSSフィードを機械的に転載するbotコミュニティで、購読者50人と人間の議論はほぼ無い。ニュースの一次情報としては使えるが「Lemmyでの議論の盛り上がり」を示す指標にはならない。- 動画生成AI専用のクローズドサービス(Sora、Kling、Runway Gen、Veoなど)について、Lemmy上での直接的な検索(
Sora、Kling AI、Veo、Runway Gen)はほぼ無関係な投稿(地名・人名・時事ニュース)しかヒットせず、具体的な議論を見つけられなかった。Runwayについては決算関連の1件のみ拾えた。 - 投稿数の規模がReddit等に比べて圧倒的に小さく(スコアも1桁〜数十が中心)、Lemmy単体では「20件を精読してトレンドを語れる」ほどの母数は無い。今回は関連しそうな検索クエリを7種類・複数インスタンスにまたがって実行し、ヒットした実在の投稿から代表例を厳選した。
Pinterest — 画像生成・動画生成AIニュース
Visual themes
- 「YouTubeサムネ/ブログのアイキャッチ」スタイルが圧倒的多数。 黒〜濃紺の背景にネオンブルー・パープル・オレンジのグラデーション、極太サンセリフの見出し(「AI NEWS」「THE FUTURE IS AI」「BREAKING NEWS」「AI IS CHANGING EVERYTHING!」など)を重ねた構成。実際の生成物そのものより「AIについて語る記事・動画」の表紙が多い [2, 7, 11, 38, 39, 42, 48]
- 人の顔・ポートレートが中心的モチーフ。 表情アニメーション、リップシンク、顔の再現(Microsoft VASA-1)、AIポートレート撮影(ChatGPT+Higgsfield)など、"顔を動かす/生成する"用途を象徴する画像が繰り返し登場する [13, 14, 18, 23, 50]
- ヒューマノイド/ロボットのビジュアルが「AI」全般の記号として多用される。 具体的なツールと無関係な、白いロボットの横顔やサイボーグ風の女性などの汎用ストック画像が多い [2, 39]
- 「Before/After」「1枚の入力画像→複数スタイル出力」のグリッド構成。 実写動画を木製・折り紙・レゴブロック・花束などに変換する比較グリッド(Luma系ツール想定)や、ぬいぐるみキャラクターを実写背景に合成する比較画像 [3, 31]
- ツール比較・ランキング形式のインフォグラフィック。 ロゴを並べたリスト形式、「Best Quality (Paid) vs Best Free」の対比表、チェックマーク付きの機能比較など、ツール選定を助ける"まとめ画像"が目立つ [7, 37]
- 実在の著名人風の顔を使ったサムネイル。 Jeff Bezos風のAI生成ポートレート、ひげ面のYouTuber然とした「AI NEWS」解説者、NVIDIAのJensen Huangの講演写真など、信頼感や話題性を狙った顔の起用が多い [11, 36, 40]
- 顔メッシュ/ワイヤーフレームのオーバーレイ演出。 表情解析や生体認証を思わせる格子線・数値ラベルを人物の顔と首に重ねたビジュアルが、広告的なピンで使われている [23, 50]
- カラーパレットの統一感。 ダーク基調+シアン/マゼンタ/イエローのネオンアクセントというトーンが、AIツール系ピンのほぼ共通したビジュアル言語になっている [2, 7, 38, 39, 42]
Notable pins
- [1] Image to Video AI: How It Works and Why It Matters — 1枚の静止画から複数フレームの"動画タイムライン"を生成する仕組みを図解した解説記事のアイキャッチ。
- [3] Google announces ultra-high quality video...(実際はLuma系の身元保持スタイル変換デモ) — ソース動画を木材・折り紙・レゴ・花などの素材に変換した3×5グリッド。同一人物・同一車の一貫性を保ったまま質感だけ変える技術デモとして分かりやすい。
- [7] 6+ Best AI Video Generation Websites — Runway・Pika・Kling AI・Luma AI(Dream Machine)・Canva AI・Hailuo AIの6ツールを機能・対象ユーザー・無料プランの有無まで並べた保存用インフォグラフィック。
- [10] Veo 2 — GoogleのVideoFX向け訴求ピン。顕微鏡を覗く実写風カット、水中スイマー、星座と踊るアニメ調の女性など、多様な映像スタイルを一枚に凝縮。
- [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Gemini APIから画像→動画生成が可能になったことを示す訴求画像で、音声ネイティブ対応を強調。
- [23] Microsoft Unveils VASA-1 — 1枚の写真+音声クリップ+任意の制御信号だけで、リアルタイムに近い表情豊かなトーキングフェイス動画を生成する技術。複数人種・複数表情のサムネイルが並ぶ。
- [27] ShengShu Technology Unveils Vidu S1 — 中国のShengShu Technologyによる「リアルタイム・インタラクティブ生成」を謳うVidu S1の発表ピン。サイバーパンク風キャラクターのビジュアル。
- [31] Google announces video generation AI 'Veo 3' — 入力画像(紫のモンスターのぬいぐるみ)を実写のサーバールームや水中遺跡、キャンディの街に合成する出力例4枚組。
- [33] 'Amuse 3.0', an AI art creation tool — AMDが提供するローカル実行型(Stable Diffusion系)の画像生成ツールの新バージョン発表。クローズドソースが大半を占める中で、ローカル/オープン寄りの数少ない具体的シグナル。
- [42] Breaking News Latest AI Developments — Grok 4.6のエージェント機能、Gemini利用者が10億人突破(1日1.5億枚の画像生成)、HonorのAIロボットフォンという3本立てのニュースまとめ(2026年8月12日付)。
Signals
- クローズドソース勢の存在感が際立つ。 Google Veo 2/Veo 3、Microsoft VASA-1、OpenAI、Grok 4.6、Gemini(10億ユーザー突破)など、大手発表がそのままピンのネタになっている一方、Stable Diffusion・ComfyUI・Flux・Wan・HunyuanVideo・LTXなど典型的なオープンソース系の固有名詞は、サンプルした画像の中では[33]のAmuse 3.0(AMD製のローカル実行ツール)以外ほぼ見当たらなかった。Pinterestは技術コミュニティよりも一般消費者・マーケター向けの"まとめ/比較"コンテンツに偏っている可能性が高い。
- 「顔」を動かす・作る用途への集中。 リップシンク、表情再現、ポートレート撮影代替、ニュースキャスター風AI動画など、顔中心のユースケースが繰り返し現れる。これはPinterestの検索需要(美容・自分磨き・SNS投稿ネタ)とAI動画マーケティングが交差している結果と考えられる。
- 一次情報より二次まとめが主流。 実際のモデル出力のスクリーンショットよりも、「解説者の顔+見出しテキスト」型のサムネイルや、ツール比較インフォグラフィックの方が多い。Pinterestは一次発表の拡散地点というより、ブログ・YouTube動画・アフィリエイト記事への"入口"として機能している。
- 不在のシグナル: 日本語圏の投稿・企業(例えば日本のAIスタートアップや国内動画生成サービス)に言及するピンはサンプル範囲内では確認できなかった。英語圏のツール・ニュースがほぼ全てを占める。
Limits
output/pinterest.pins.mdの50件中、代表性を意識して24枚の画像を実際に開いて内容を確認した(残り26件はタイトルのみで、開いた画像群と同様のビジュアルパターン——インフォグラフィック/顔ポートレート/ツール比較——に収まると推測される)。- タイトルが「(untitled)」のピンが8件あり([12, 19, 20, 30, 35, 39, 46, 50])、そのうち[39]と[50]は画像を確認したが、残りは未確認。
- このステージのワーカー収集データにジャンル分割はなく(
pinterest.pins.mdは単一のフラットな一覧)、ジャンル別の内訳は作成していない。 - Pinterest自体は今回ブラウズしておらず、プレイブックの指示通りワーカーが事前収集した画像とタイトルのみから分析した。ピン自体のいいね数・保存数・コメントなどのエンゲージメント指標は収集データに含まれておらず、参照できなかった。
推奨アクション
- Re-run X search with explicit model/tool terms (Stable Diffusion, ComfyUI, Flux, Wan, Kling, Sora) instead of relying on the trending-topic list.
- Build a standing list of known Bluesky accounts to poll via getAuthorFeed, since app.bsky.feed.searchPosts returned 403 this run.
- Flag hybrid open/commercial models like MiniMax H3 explicitly rather than filing them under a single open-source label.
- Keep a recurring watch item for major-vendor pivots or shutdowns (Midjourney's medical pivot, Sora API end-of-life) since they outdrew pure product-launch news on Reddit and Lemmy.
- Treat Pinterest as a consumer-sentiment gauge rather than a primary-source technical feed, given its near-total lack of open-source coverage.
収集画像


















































データ品質メモ
X and Bluesky fell well short of the brief's ~20-posts-per-platform bar (X surfaced only 4 on-theme posts, all closed-source; Bluesky's search API returned 403 so coverage relied on known accounts); Reddit, Lemmy, and YouTube also collected fewer items than the target, and YouTube could not confirm view/subscriber counts due to JS-rendered pages.



