Image and Video Generation AI News — 2026-09-06
OpenAIのGPT-6 Astraが「画像・動画生成」というより「PC操作エージェント」としてクローズドソース界隈を独占する一方、オープンソース側はComfyUI周りでQwen Image・MiniMax-H3の実装ニュースを地道に積み上げている。
画像・動画生成AIニュースまとめ — 2026-09-06
いやマジで今週やばい動きだらけだった😳🔥 クローズドソース側は完全にOpenAIの「GPT-6 Astra」祭り状態で、みんな画像・動画生成っていうより「PCを丸ごと操作させるエージェント」として盛り上がってる。逆にSoraは静かに息を引き取ってて、動画生成アプリからエージェントAIへの投資シフトが起きてるっぽい。オープンソース側はQwen Image・Z-Image Turbo・HunyuanImage・MiniMax-H3あたりがComfyUI周りで着々とアプデを重ねてて、派手さはないけど実装ニュースの密度がガチで高い。ただ正直に言うと、今回は検索がうまくハマらなかったプラットフォームもあって(Reddit、X、Bluesky)、全部が全部20件しっかり見れたわけじゃないから、その辺は下の「データの質」でちゃんと白状する🙏
Across platforms
- GPT-6 Astra(OpenAI)が閉じたソース界隈をほぼ独占:X(@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256)とBluesky(@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225)の両方で、ローンチ直後から話題を独占。ARC-AGI-3が98.6%(前世代7.8%)ってベンチマークがバズってる。
- Astraは「画像生成」より「エージェント操作」として語られてる:X(@aigeboku, ComputerUse機能を検証)もBluesky(Unityで街を自動構築するデモ)も、単発の画像・動画出力より「PCを勝手に動かす」側の話題で盛り上がってて、これマジで新しいジャンルになりそう。
- Fable 5.1が"比較対象"としてめちゃくちゃ使われてる:X上で@renoiseaiや@Mayz1169が独立に「Astra vs Fable 5.1」の対決動画をSeedance 2.5経由でアップしてて、しかも@k_matsumaruの投稿ではFable 5.1が最終レンダラーじゃなくプロンプト生成レイヤーとして4ツール連携の一部に組み込まれてた。単体モデルで完結させてる人がほぼいない。
- アグリゲーターAPIが両方の界隈で存在感増してる:Reddit(WaveSpeedAI、1,000以上のモデルを1本のREST APIで束ねる)とBluesky(useapi.net、Veo/Kling/Seedance/PixVerse/Hailuo/Runway/Nano Bananaを横断比較)で、どっちも公式アカウントより実務的な情報が濃いって評価されてた。
- オープンソースはQwen Image / Z-Image Turbo(Alibaba・Tongyi-MAI)とHunyuanImage(Tencent)の二強+MiniMax-H3の新星構図:YouTubeのレビュー動画群とLemmyの[email protected]の両方で確認できた、けっこう強めの裏付け。
- MiniMax-H3(オープンウェイト動画モデル)の周辺エコシステムが爆速で拡大:Lemmyだけで8/8〜9/5に10件以上(GGUF量子化、Turbo LoRA、120秒長尺対応、ハイブリッドアテンション実装)。Xでも@ImaStudio_aiがこれをベースに自社の商用ツールを作ってた、ってのがクロスプラットフォームで裏取れてるポイント。
- ComfyUIが完全にオープンソースの司令塔:Lemmy、Bluesky(@kunecco)、YouTubeのチュートリアル群、どこ見てもComfyUI対応が「その技術が本物かどうか」の踏み絵になってる。
- マルチショット+音声同期がオープン・クローズド共通の次の競争軸:Wan 2.6(オープン)とKling 3.0/Seedance 2.0/Runway Gen-4.5(クローズド)がYouTubeで直接ストレステスト比較されてた。
- 「これAI?本物?」の疑心暗鬼はどこにでもある:Redditの手指崩壊ネタ、教室での議論、Pinterestの「Which is AI?」クイズ系ピンなど、プラットフォーム違ってもこの不安ネタは共通して出てくる。
- ブランド公式アカウントはSNSでほぼ死んでる:Bluesky上でMidjourney公式(最終投稿2025-10-08)もKling AI公式(投稿ゼロ)も開店休業状態。ニュースは非公式・個人・アグリゲーターの方が早い、ってのがどのプラットフォームでも言えそう。
Platform by platform
Reddit — 9つのサブレディットから12スレッド収集(目標の約20件には届かず)。目玉はLLMにマウス操作させて手描きタイムラプスを丸ごと偽造する新手法への猛反発(r/antiai, 5,259pt)と、WaveSpeedAIのアグリゲーターAPI、Apple SiliconでのKrea-2-Turbo高速ローカル生成(45秒/枚)。r/VeniceAIでは画像生成・編集・動画変換で使うモデルを細かく使い分けるガチ勢の投稿も。倫理・品質面での否定論(AI食品画像酷評、$30/hr求人スパム化)も強め。
X — Explore側の急上昇ワードがサーバー所在地のクロアチアに引っ張られてて、10語中7語(Bitcoin、ウクライナ、アルゼンチンなど)が完全に無関係だった。オンテーマな投稿は全部GPT-6 Astra関連で埋め尽くされてて、オープンソース系の検索語(Stable Diffusion、Wan、Fluxなど)は今回一切試してない=Xのオープンソース動向はこの回に関しては「無し」じゃなくて「見てない」。
YouTube — クローズド側最大ニュースはSoraの終了(2026年4月26日にアプリ終了、API自体も2026年9月24日終了予定、ダウンロード数が11ヶ月で330万→110万に急落)。オープン側はQwen Image・HunyuanImage・Z-Image Turboのfirst-testレビューが山ほどあり、Black Forest LabsのFLUX.2(Apache 2.0)も対抗馬として言及。
Bluesky — 投稿全文検索API(searchPosts)が全クエリで403返してきて使えず、アカウント検索経由に方式変更(分析件数は目標の20件に届かず)。クローズド側はtodaystopainews・useapi.netみたいな「ニュースbot」が中心、オープン側は虹色・くねっこみたいな「個人の完成作品投稿」が中心で、技術ニュースとしてのオープンソース情報はBluesky上ではほぼ流れてない。
Lemmy — 規模は小さいけど[email protected](5,708人)が事実上のオープンソース速報板になってて、MiniMax-H3周辺やLTX-2.5のDay-0対応など実装ニュースが濃い。クローズド側はMidjourneyの医療機器転向みたいな「製品ニュースというより皮肉・スキャンダル」として消費される傾向。Sora/Veo/Kling/Hailuoの一次投稿はLemmy発では見つからなかった。
Pinterest — ワーカー事前収集の単一クエリ50件を確認(genre分割なし)。中身のほぼ全部がRunway・Pika・Kling・Luma・Synthesia・HeyGenなどクローズド系ツールの比較リスト・ニュースインフォグラフィックで、オープンソースに触れてたのはBaidu Ernie 4.5とAMD Amuse 3.0の2件のみ。ここは完全にクローズド系のSEO/マーケティング市場になってる。
What to watch
- GPT-6 Astraの「ComputerUse」エージェント機能がどこまで創作ワークフローに食い込むか — X, https://x.com/aigeboku/status/2096187322924687799
- Altmanが匂わせた「Astraじゃない、まだ出てない上位モデル」の正体 — X, https://x.com/masahirochaen/status/2096372856930386341
- MiniMax-H3のGGUF量子化・Turbo LoRAエコシステムの拡大速度 — Lemmy, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF
- Sora APIの完全終了(2026-09-24予定)に伴う移行の影響 — YouTube, https://www.youtube.com/watch?v=H2jVcy5PuBI
- Qwen-Image-2.0(20B→7B、Nano BananaをElo評価で上回る)の重み公開タイミング — Lemmy, https://files.catbox.moe/l3mzzs.jpg
- useapi.netなどアグリゲーターAPI経由のクローズドモデル価格・性能比較の動き — Bluesky, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p
Recommendations
- GPT-6 Astraは画像・動画の品質だけじゃなく「エージェント操作」の軸でFable 5.1と比較し続けること。
- オープンソース動画生成の最前線として、次回はMiniMax-H3のComfyUIエコシステム(GGUF・Turbo LoRA)を継続ウォッチすること。
- Xの次回調査ではExploreの急上昇ワードに頼らず、Stable Diffusion・Wan・Flux・Qwenなどオープンソース固有の検索語を明示的に投げること。
- オープンソースの一次情報源としては、RedditやBlueskyよりLemmyの[email protected]を優先的に見ること。
- Pinterestはオープンソース動向の情報源としては使わず、クローズド系ツールのマーケティング・SEO動向を見る用途に絞ること。
- Sora API終了(2026-09-24)に依存する外部ツール・ワークフローがないか、フォローアップ調査すること。
Data quality
Redditは12スレッドにとどまり完了基準の約20件に届かなかった(WebFetchでの直接収集ができずワーカー事前収集分のみに依存)。Xは検索語の大半(10語中7語)が無関係な急上昇ワードで、オープンソース関連の検索は今回一度も行われておらずXのオープンソース動向は実質未調査。Blueskyは投稿全文検索APIが全クエリで403を返し、アカウント検索経由への切り替えを余儀なくされたため分析件数が目標未達。YouTubeは動的レンダリングの都合で再生回数・登録者数の多くが確認できなかった。Lemmyは規模自体が小さく、Sora/Veo/Kling/Hailuoの一次投稿は見つけられなかった(検索カバレッジの限界の可能性)。Pinterestは単一の一般クエリ50件のみで、オープンソース特化の再検索は行われていない。
プラットフォーム別まとめ
Reddit — Image and Video Generation AI News
Where
検索語「Image and Video Generation AI News」で9つのサブレディットから12スレッドが収集された。
| サブレディット | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/StableDiffusion | 1,001,169 | 1 |
| r/teenagers | 3,674,216 | 1 |
| r/aiwars | 166,685 | 1 |
| r/antiai | 314,968 | 2 |
| r/generativeAI | 150,823 | 3 |
| r/RemoteWorkers | 74,528 | 1 |
| r/VeniceAI | 10,421 | 1 |
| r/DailyIncome | 12,914 | 1 |
| r/freetoolsAI | 7,736 | 1 |
r/generativeAI(3スレッド)と r/antiai(2スレッド)がこのテーマを最も多く扱っている。r/antiaiはAI画像生成への批判的立場、r/generativeAIはツール比較・実用相談が中心で、対照的な温度感を示す。
What people say
- LLMが手描きするタイムラプス偽装への警告(スレッド#1, r/antiai, 5,259pt・760コメント, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/)。GPT-6にマウス・キーボード操作を与え、デジタル画のタイムラプスごと"本物らしく"偽造できる手法が投稿され、「なぜこんな技術をリリースするのか、本物の絵師を傷つける以外の目的がない」(u/sanstheskelebrotherc, 235pt)といった強い反発が集まった。
- 無料AI動画生成ツールの日次比較(スレッド#2, r/generativeAI, 42pt・28コメント, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/)。Adobe Firefly(1日2本)、PixVerse(1日1本)、Grok Imagine(1日1本)、Google Flow(1日3〜4本)を軸に、コメントではKling AI(24時間ごとに66クレジット、5秒720p換算で2〜6本)やCapCutの日次無料クレジットが挙げられた。
- 無料・無制限の画像生成ツール共有スレ(スレッド#3, r/freetoolsAI, 37pt・38コメント, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)。コメント欄ではNSFW対応可否が主な関心事で、「なんでみんなNSFWをBANするんだ」(u/Relevant_Syllabub895)という声とともに、Deepany・Aifun・Perchance・huggingfaceのZ-Image-Turboなど代替サービスが列挙された。
- 「AI生成画像レビューで時給$30」求人が2つのサブで並行拡散(スレッド#4, r/RemoteWorkers, 114pt・520コメント, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ と スレッド#6, r/DailyIncome, 129pt・1,123コメント, 2026-09-04, https://www.reddit.com/r/DailyIncome/comments/1w7b18p/)。ほぼ同文の求人だが、コメントの大半が「images」「Interested」といった一語返信で、応募リンク欲しさのテンプレ反応が大量発生している。
- ローカル画像生成の高速化デモ(スレッド#5, r/StableDiffusion, 31pt・10コメント, 2026-09-03, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/)。Vpipe+Krea-2-Turbo-M87(16bit)をApple Silicon(M5 Pro 24GB)上でローカル実行し、1024×1024・8ステップで約45秒/枚(8bit量子化リアルタイム時35秒)を実現したと報告。
- AI画像がより検出困難になっているというミームスレ(スレッド#8, r/antiai, 113pt・30コメント, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/)。実際は手指の破綻ネタが中心で、「なぜ彼女の足が手なんだ」(u/GurInside278, 31pt)など、まだ古典的な崩壊が笑いの種になっている。
- API集約サービスWaveSpeedAIへの評価(スレッド#7, r/generativeAI, 2pt・4コメント, 2026-09-05, https://www.reddit.com/r/generativeAI/comments/1w8ci5z/)。「Flux、Wan 2.1/2.6、Hailuo、Klingなど1,000以上のモデルを単一のREST APIでラップしている」(u/Jenna_AI)とされ、実際にSeedance連携で自作ツールに組み込んだユーザー(u/BradClarkAI)も「問題は一切ない」と評価。
- VeniceAIコミュニティのモデル使い分け情報(スレッド#9, r/VeniceAI, 8pt・6コメント, 2026-08-30, https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/)。u/jerm2zが「画像生成にはChroma、編集にはQwen Edit UncensoredやSeedream、FireRed(NSFW非対応だが顔の一貫性は高い)、image-to-videoにはWAN Enhanced、Seedance、Minimax R2V」と具体的に使い分けを提案。
- AI食品画像は「食欲をそそらない」と酷評(スレッド#10, r/aiwars, 4pt・175コメント, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/)。「これはgrub hive(幼虫の巣)にしか見えない」(u/LCI_Jake, 14pt)という辛辣なコメントとともに、実際にKrea 2でローカル生成(40秒)を試したユーザー(u/Bassed_Hummble)が「プロンプトは大したことないのに、なぜここまで酷い出力になるのか」と疑問を呈した。
- AIアートの是非をめぐる若年層の議論(スレッド#12, r/teenagers, 7pt・41コメント, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/)。「AIはプロンプトを受け取って実際に絵を作るのはAI自身であり、画材やソフトを使う人間の創作とは根本的に違う」という投稿に対し、賛否が割れた。u/TheDarkmoreは「絵が上手くないのでカードゲーム120枚の絵をAIに任せた、それでいいと思っている」と実利用の立場を表明。
Signals
- 上昇傾向: LLMにマウス・キーボード操作をさせて"手描き"を偽装する新手法(スレッド#1)は、従来の拡散モデル検出とは別の脅威として急速に反発を呼んでおり、AI vs 反AIの対立軸に新しい火種を加えている。また、WaveSpeedAIのような「1,000以上のモデルを単一APIでラップする」アグリゲーター型サービス(スレッド#7)や、Apple Siliconでのローカル高速生成(スレッド#5)など、開発者向けのインフラ・効率化の話題が地味に伸びている。
- 軽視・冷笑されている領域: AIによる食品広告画像(スレッド#10)は「stock写真を貼った方がまし」と酷評され、品質面での限界が繰り返し指摘されている。また「AI生成画像レビューで時給$30」求人(スレッド#4・#6)は、投稿内容がほぼ同一で、コメントの大半が応募リンク欲しさの定型反応であり、実務的な議論はほぼ発生していない=スパム的求人として消費されている可能性が高い。
- 意外だった対立: 同じ「AI画像が見分けにくくなっている」というテーマでも、r/antiai(スレッド#8)ではまだ手指の破綻が笑いのネタになっている一方、スレッド#1では"タイムラプスごと偽造できる"新手法が真剣な脅威として語られており、AI画像検出の実態についてコミュニティ内でも評価が割れている。同様に、r/VeniceAIやr/StableDiffusionでは技術的な使い分け・最適化の話題で盛り上がる一方、r/antiaiやr/aiwarsでは倫理・品質面での強い否定論が展開されており、Reddit上の「AI画像生成」への態度はサブレディットごとに大きく分断されている。
Limits
- 検索語は「Image and Video Generation AI News」の1本のみで、「オープンソース」「クローズドソース」を分けた検索は行われていない。そのため、本ファイル単体ではブリーフが求める「オープンソース/クローズドソースそれぞれ最低10件の気づき」を直接切り分けられない(合成レポート側での分類が必要)。
- ブリーフの完了基準は各SNSで約20件の投稿を解析することだが、収集されたのは12スレッドにとどまり、目標に届いていない。
- スレッド#4・#6(時給$30の求人)はコメントの大半が「images」「Interested」等の定型反応で、実質的な議論・検証コメントが得られていない。
- Reddit自体はWebFetch・検索経由のページ取得を拒否するため、ワーカーが事前収集したファイル(reddit.threads.md/json)のみに基づいており、これ以上の深掘り(関連スレッドの追跡、コメント欄のさらなる展開など)はこの検索セッションでは行えていない。
X
X — 画像・動画生成AIニュース
X’s own Explore list for this session is geolocated to Croatia (the server’s
location), not to Japan or a global feed — it shows "Astra", "Bitcoin",
"Ukrainian", "Argentina", "$SONG", "OpenAI", "Russia", "Black", "$KURO",
"Fable" as trending there, with no post counts given. Only three of those ten
terms ("Astra", "OpenAI", "Fable") turned out to have anything to do with
image/video generation AI; the rest are crypto price calls, the Russia‑Ukraine
war, Argentine celebrity gossip and memecoins, and are not covered below —
see Limits.
Accounts
On‑topic accounts, by what they actually posted:
| Account | What they post | This post's reach |
|---|---|---|
| @masahirochaen (チャエン) | Japanese AI/tech news account; broke the GPT‑6 Astra launch with benchmark numbers, then a follow‑up on Altman's "there's more beyond Astra" remark | 2 posts, 841 + 133 likes, up to ~550,000 views on the launch post |
| @UNIBRACITY (SHINTARO) | Hobbyist 3D artist pairing GPT‑6 Astra with Blender | 1 post, 306 likes |
| @hayashimon1 (ハヤシモン|AI×個人開発) | AI/3D creator who also runs paid seminars; uses Fable 5.1 × Blender | 1 post, 55 likes |
| @manaimovie (Mankyu) | AI video hobbyist, feeding a Tripo 3D model into Astra | 1 post, 409 likes |
| @yachimat_manga (yachimat‑AI Short Anime) | AI anime-short creator, speculating Astra could replace dedicated video-gen tools for some styles | 1 post, 51 likes |
| @aigeboku (AI様の下僕) | AI power-user testing Astra's "ComputerUse" agentic control | 1 post, 653 likes |
| @gagarot200 (ガガロット) | AI demo account, one-line-prompt-to-game clips | 1 post, 306 likes |
| @SSSS_CRYPTOMAN | Crypto+AI crossover account, posted an Astra game-build demo | 1 post, 161 likes |
| @Mayz1169 (Kiki) / @renoiseai (Renoise) | Side-by-side AI video comparison accounts, both pitting GPT‑6 Astra against Fable 5.1 rendered via Seedance 2.5 | 1 post each, 64 and 140 likes |
| @k_matsumaru | AI video creator documenting a full pipeline (Typeless → Fable 5.1 → Seedream 5.0 → Seedance) | 1 post, 279 likes |
| @Strength04_X | Prompt-sharing account for Seedance 2.5 (via lovart_ai) | 1 post, 444 likes |
| @ImaStudio_ai | Product/studio account for its own AI fashion-video tool (MiniMax H3-based) | 1 post, 132 likes |
Every one of these is a single post, not a thread or a sustained campaign — this
is a scattered one-day reaction to a launch, not an organized account driving
the conversation.
Posts
24. @masahirochaen (チャエン)
- 841 likes · 148 reposts · 17 replies · ~550,000 views · 2026-09-03
- https://x.com/masahirochaen/status/2095644339041153256
【超速報】OpenAIが「GPT-6 Astra」発表。PC作業を丸ごと代行 Fable 5.1超えの本命モデルが遂に公開。…ARC-AGI-3(初見のパズルを解く力)98.6% 前世代GPT-5.6は7.8%。異常な伸び
The single biggest post in this collection by far, and the one that frames
everything else: it announces GPT‑6 Astra as a PC-operating agent that beats
Fable 5.1, citing an ARC‑AGI‑3 jump from 7.8% (GPT‑5.6) to 98.6%.
21. @masahirochaen (チャエン)
- 133 likes · 23 reposts · 8 replies · ~20,000 views · 2026-09-05
- https://x.com/masahirochaen/status/2096372856930386341
サム・アルトマン、GPT-6の"先"を公言…8月にサイバーリスクを理由に作業を一時停止したモデルは、GPT-6 Astraではなかったと明言。
Two days after the launch, the same account reports Altman saying the model
OpenAI paused in August for cyber-risk reasons was not Astra — implying an
even more capable model is still unreleased.
3. @aigeboku (AI様の下僕)
- 653 likes · 64 reposts · 7 replies · ~43,000 views · 2026-09-05
- https://x.com/aigeboku/status/2096187322924687799
GPT-6 Astraは「他を操る能力が高い」という通り、ComputerUse使えば色々とやれることが広がりますなあ…流石に一撃は難しいにしても、こっから調整すればもっと面白い表現にできそう。
Frames Astra's selling point as agentic control ("ComputerUse") rather than
raw generation quality — early testers are exploring what that control
unlocks for creative workflows, not just image output.
1. @manaimovie (Mankyu)
- 409 likes · 49 reposts · 16 replies · ~20,000 views · 2026-09-05
- https://x.com/manaimovie/status/2096176821377380677
Astra先生にTripoで作ったモデルを渡して、動くようにして言ったらできたものです。…FableやSolのときよりかなりいい!
A concrete before/after workflow claim: feeding a Tripo-made 3D model to
Astra and asking it to animate it worked better than doing the same with
Fable or "Sol".
22. @gagarot200 (ガガロット)
- 306 likes · 29 reposts · 7 replies · ~95,000 views · 2026-09-04
- https://x.com/gagarot200/status/2095789680931287390
GPT-6 Astraが完全自動でポン出し…たった一言「GPT-6 Astra」に「こんなゲームを作って」と説明するだけ
A one-line prompt producing a playable game end-to-end, offered as proof of
Astra's "does the whole task" positioning.
23. @UNIBRACITY (SHINTARO)
- 306 likes · 49 reposts · 4 replies · ~39,000 views · 2026-09-05
- https://x.com/UNIBRACITY/status/2096142182050927035
GPT-6 Astra × Blender 『Forest Retreat / フォレスト・リトリート』 Astra稼働時間 約7時間で、ここまでできました。
A ~7-hour Astra run producing a full 3D scene in Blender — one of the more
detailed "how long did this actually take" data points in the set.
4. @SSSS_CRYPTOMAN (SSSS.CRYPTOMAN⚡️AI)
- 161 likes · 23 reposts · 5 replies · ~10,000 views · 2026-09-05
- https://x.com/SSSS_CRYPTOMAN/status/2096248797873762805
GPT-6 Astraであっという間にゲームが完成!🎮…雑なプロンプトから数回のやり取りで普通に遊べるクオリティのものができました
Another vague-prompt-to-playable-game demo, with a live link, echoing
@gagarot200's claim independently.
2. @yachimat_manga (yachimat - AI Short Anime)
- 51 likes · 6 reposts · 5 replies · ~3,600 views · 2026-09-05
- https://x.com/yachimat_manga/status/2096386820997304354
GPT-6 Astra でモデリングしてみました。…これワンチャン動画のスタイルによっては動画生成いらんくなる未来があるくない?
A working AI-anime creator speculates out loud that for some styles, Astra's
3D modeling could make dedicated video-generation tools unnecessary.
40. @renoiseai (Renoise)
- 140 likes · 16 reposts · 10 replies · ~99,000 views · 2026-09-04
- https://x.com/renoiseai/status/2095773478200996066
GPT-6 Astra vs Fable 5.1 Both videos generated with Seedance 2.5 on Renoise
A direct head-to-head clip, both outputs rendered through the same
downstream tool (Seedance 2.5) to control for that variable.
39. @Mayz1169 (Kiki)
- 64 likes · 6 reposts · 10 replies · ~12,000 views · 2026-09-04
- https://x.com/Mayz1169/status/2095795273134170259
forget the benchmarks for a second. just watch this. GPT-6 Astra vs. Fable 5.1 side by side comparison on same prompts. which one would you pick?
Same comparison instinct as above, independently — Astra vs. Fable 5.1
head-to-heads are a recognizable micro-genre in this batch, not a one-off.
37. @k_matsumaru (松丸 彗吾)
- 279 likes · 34 reposts · 14 replies · ~19,000 views · 2026-09-05
- https://x.com/k_matsumaru/status/2096044983468150935
最近の動画の作り方…① Typelessで指示書を書き起こす ② Fable 5.1に動画生成用プロンプトを書き起こさせる ③ Seedream 5.0 Proで絵コンテに起こして内容精査 ④ Seedance…
The most detailed production pipeline in the set: Typeless for scripting →
Fable 5.1 for prompt-writing → Seedream 5.0 Pro for storyboarding →
Seedance for final video — Fable shows up here as a prompting layer, not
the renderer itself.
32. @ImaStudio_ai (Ima Studio)
- 132 likes · 17 reposts · 3 replies · ~4,600 views · 2026-09-04
- https://x.com/ImaStudio_ai/status/2095725066109804603
MiniMax H3 K-Fashion Outfit Change MV…8 LOOKS. 1 GIRL. ZERO IDENTITY DRIFT.
A commercial studio account promoting its own product built on MiniMax H3,
pitching "zero identity drift" across outfit changes as the differentiator.
Signals
- What's rising: GPT‑6 Astra (OpenAI) dominates every on-topic post in
this batch, and it's being talked about as an agentic, computer-operating
model first and an image/video generator second — testers keep pairing it
with other tools (Tripo for 3D meshes, Blender for scenes) rather than
treating it as a standalone renderer. - A recognizable micro-genre: unprompted, independent accounts
(@renoiseai, @Mayz1169) are posting "GPT‑6 Astra vs Fable 5.1" side-by-sides
rendered through Seedance 2.5 — Fable 5.1 is the model people reach for as
the comparison point, and Seedance/Seedream keep recurring as the actual
video-rendering layer underneath both. - Chained pipelines, not single tools: the most detailed post
(@k_matsumaru, #37) chains four different tools (Typeless → Fable 5.1 →
Seedream 5.0 Pro → Seedance) for one video — nobody in this set describes
finishing a video with a single model. - What surprised us: the trending terms this run pulled from X's own
Explore panel (geolocated to Croatia) — Bitcoin, Ukrainian, Argentina,
$SONG, Russia, Black, $KURO — had essentially zero connection to
image/video generation AI. X's "what's trending" for this server's location
on 2026‑09‑05/06 is crypto and geopolitics, not AI models; treating it as a
proxy for AI discourse would have been misleading. - What's being dismissed: no skeptical or critical thread about GPT‑6
Astra surfaced in this batch — every on-topic post is a demo, a benchmark
repost, or a comparison clip. That absence is itself notable given how
aggressive the "beats Fable 5.1" claim (#24) is.
Limits
- The ten search terms used ("Astra", "Bitcoin", "Ukrainian", "Argentina",
"$SONG", "OpenAI", "Russia", "Black", "$KURO", "Fable") came from X's own
Explore trending list for this session, not from a curated image/video-AI
term list. Seven of the ten ("Bitcoin", "Ukrainian", "Argentina", "$SONG",
"Russia", "Black", "$KURO") returned posts entirely unrelated to the
research theme (crypto giveaways and price calls, the Russia-Ukraine war,
Argentine celebrity news, and two small memecoins) and are excluded from
the Posts section above. - Because of that, open-source coverage here is thin and indirect: no post
in this collection used terms like "Stable Diffusion", "ComfyUI", "Wan",
"HunyuanVideo", or "Flux" — those searches were never run this stage.
Everything on-topic ties back to closed/commercial names (GPT‑6 Astra,
Fable 5.1, Seedance, Seedream, MiniMax H3, Tripo), so X's open-source
picture for this run should be treated as absent, not as "nothing is
happening there." - Post #35 (@MINHxDYNASTY, tagged "$KURO") was collected with no post text
captured in the source file, so it could not be used as a finding. - Explore's "Where" column is geolocated to wherever this session's server
sits (Croatia), not to Japan or worldwide — its list should not be read as
a global or Japan-specific trending picture. - No session/access failure occurred: the collection returned data for every
search term attempted, so the gap here is topical (which terms were
searched), not technical.
YouTube
YouTube — 画像・動画生成AIニュース(クローズドソース/オープンソース)
Channels
- Bijan Bowen (@Bijanbowen, 約37,000人) — LLMや画像生成モデルの深掘りレビューが専門。Qwen Image-2512を検証。
- Future Tools / Matt Wolfe (@mreflow, 90万人超) — 週刊「Everything in AI This Week」形式でMidjourneyやRunwayなど画像・動画生成AIの動向を毎週まとめている。
- ComfyUI/ローカル生成系チュートリアルチャンネル群(Wan 2.2/2.6、FLUX、Qwen Imageのワークフロー解説動画多数、チャンネル名は動画タイトルのみ確認、個別チャンネル名は検索結果に非表示)。
Videos
- "Why OpenAI Shut Down Sora So Fast: What's Next?" — 2026年3月〜4月頃投稿。OpenAIがSoraアプリを2026年4月26日に閉鎖、API自体も2026年9月24日に終了予定という決定の背景(月間ダウンロード数が2025年11月の330万から2026年2月には110万まで急落、Disneyとの10億ドル・3年契約も破談)を解説。https://www.youtube.com/watch?v=H2jVcy5PuBI
- "Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App" — 2026年春投稿。収益化に失敗した動画生成アプリの経済的コストとエージェント型AIへの戦略転換を論じる。https://www.youtube.com/watch?v=MpLY9bjYVuA
- "HunyuanImage-3.0 First Test – The Open Source Nano Banana?" — 2025年9月29日投稿。Tencent製のHunyuanImage-3.0(オープンソース最大級のテキスト画像モデル)をローカルでハードウェア要件込みで検証。https://www.youtube.com/watch?v=lLTv4sGf8Wo
- "Qwen Image-2512 First Test – The BEST Open Source Image Model!"(Bijan Bowen) — 2025年12月31日投稿。Alibaba製Qwen Image-2512の人物リアリズム・テキスト描写の改善を実写テストで検証。https://www.youtube.com/watch?v=SBaK616nP6Q
- "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — 2026年1月5日投稿。Qwen Image 2511/2512とTongyi-MAI発のZ-Image Turboを直接比較。https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- "Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!" — 2025年9月28日投稿。当時オープンソースText-to-ImageのArenaリーダーボード首位だったHunyuan Image 2.1とQwen Imageの2Kテキスト描写対決。https://www.youtube.com/watch?v=MUDTryJS0XM
- "Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI" — 2025年11月28日投稿。Alibaba/Tongyi-MAI発のオープンソースText-to-Image「Z-Image Turbo」をComfyUI上で検証。https://www.youtube.com/watch?v=eOKSBu7KLh0
- "Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models" — 2026年1月11日投稿。オープンソース画像・動画生成の最新モデル群(Wan 2.2/FLUX/Qwen Image)をComfyUI上でまとめて解説するロングフォームチュートリアル。https://www.youtube.com/watch?v=3BFDcO2Ysu4
- "WAN 2.6 Hands-On: The Good, the Bad, and the Useful" — 2025年12月26日投稿。Alibabaが公開したWan 2.6(最大15秒・マルチショット・音声同期対応)の実機ハンズオン検証。https://www.youtube.com/watch?v=iNnmLwPg7OE
- "Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)" — 2025年12月27日投稿。オープン系Wan 2.6とクローズド系Kling 2.6のマルチショット生成をストレステストで比較。https://www.youtube.com/watch?v=CDRKn4I-Iv0
- "I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds" — 2025年11月〜12月頃投稿。Google DeepMindのGemini 3 Pro Image(通称Nano Banana Pro、4K出力・14以上のオブジェクト対応・多言語テキスト描写)の実践テスト。https://www.youtube.com/watch?v=ca4SXmRqtKE
- "Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana" — 2025年12月4日投稿。クローズドソースのNano Bananaに対抗するオープンソース編集モデルQwen Image Editをレビュー。https://www.youtube.com/watch?v=Ur3udfFJ2QQ
Signals
- クローズドソース最大級のニュースはSoraの撤退: OpenAIは2026年3月24日に開発者へ通知、4月26日にSoraアプリ/Web版を終了、API自体も2026年9月24日に終了予定。ダウンロード数急落(2025年11月330万→2026年2月110万)とDisneyとの10億ドル提携破談が背景として複数動画で語られている。動画生成への投資からコーディング/エージェントAIへの資源シフトという業界の潮目を示す事例として扱われている。
- オープンソース陣営は「二強+新星」構図: Alibaba系(Qwen Image、Z-Image Turbo、Wan 2.2/2.6)とTencent系(HunyuanImage 3.0/2.1)が主要リーダーボードの首位を争い、Black Forest LabsのFLUX.2([dev]/[klein]、Apache 2.0のVAE公開)がフォトリアリズムで対抗。クリエイターの多くが「Nano Bananaのオープンソース代替」という文脈でQwen ImageやHunyuanImageを紹介しており、クローズド対オープンの直接比較がフォーマットとして定着している。
- 動画系はマルチショット・音声同期が新基準: Wan 2.6(オープン)とKling 3.0/Seedance 2.0/Runway Gen-4.5(クローズド)がいずれも「1回の生成で複数ショット」「音声・SFXの同時生成」を競っており、単発クリップ生成から一段進んだ機能競争に移行している。
- レビュー動画の多くが「first test」「first look」形式のハンズオン検証で、モデル発表から数日〜1週間以内に投稿される速報性の高いフォーマットが定着している。
Limits
- YouTube検索結果ページおよび動画視聴ページ(
youtube.com/results、youtube.com/watch)はJavaScriptでレンダリングされるため、WebFetchでは静的なフッター(著作権表示・利用規約リンク等)しか取得できず、正確な再生回数・チャンネル登録者数・コメント欄はほとんどのケースで直接確認できなかった。上記の再生回数・登録者数はWeb検索結果の要約から拾えた範囲のみ記載しており、多くの動画では再生回数を記載できていない。 - Kling 3.0 / Seedance 2.0 / Runway Gen-4.5 個別のYouTubeレビュー動画URLは、検索結果が技術比較系ブログ記事(invideo.io、Pixo、AI.ccなど)に偏り、YouTube動画への直接リンクを特定できなかった。
- 個別チャンネルの登録者数はBijan Bowen(約37,000人)とMatt Wolfe / Future Tools(90万人超)以外、検索結果から確認できなかった。
Bluesky
Bluesky — 画像・動画生成AIニュース
Bluesky公式検索API(app.bsky.feed.searchPosts)はこのセッションから一貫して403 Forbiddenを返し、キーワード検索での投稿収集ができなかった(詳細はLimits参照)。そのためapp.bsky.actor.searchActorsでテーマに関連するアカウントを探し、見つかったアカウントの投稿履歴(getAuthorFeed)を1件ずつ読む方式に切り替えて調査した。
Accounts
| アカウント | 内容 | フォロワー数 | 投稿数 |
|---|---|---|---|
| @todaystopainews.bsky.social | 「Today's Top AI News」。AI業界ニュースを自動収集・投稿するbot的アカウント。GPT-6 Astra、Fable 5.1などクローズドソース系モデルの話題が多い | 272 | 1,826 |
| @useapi.bsky.social | useapi.net。Veo、Kling、Seedance、PixVerse、Hailuo、Runway、Nano Bananaなど各社の画像・動画生成APIを束ねるアグリゲーターサービスの公式アカウント | 13 | 24 |
| @nijiironokeshiki.bsky.social | 「虹色」。Stable DiffusionとComfyUIでRe:ゼロ、リコリス・リコイル、葬送のフリーレンなどの二次創作イラストを1日2〜3回投稿する個人クリエイター | 699 | 1,963 |
| @kunecco.bsky.social | 「くねっこ」。git版ComfyUIのノード・ワークフロー・LoRA開発者。danbooruタグの翻訳など技術寄りの投稿もある | 540 | 494 |
| @midjourneyofficial.bsky.social | Midjourney公式アカウント。2025年8月にBlueskyへ参入宣言 | 不明 | 最終投稿2025-10-08 |
| @comfyuistudio.bsky.social | ComfyUIワークフロー紹介アカウント(サードパーティ) | 不明 | 最終投稿2024-12-19 |
| @klingaivideo.bsky.social | Kling AI Video生成ツールの紹介アカウント | 不明 | フィード空(投稿なし) |
Posts
クローズドソース
-
GPT-6 AstraがPS4コントローラーのSVGを生成(@todaystopainews, 11いいね・2リポスト・1リプライ, 2026-09-05, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225)。生成にかかった時間(11分54秒)まで記載されており、OpenAIのGPT-6 Astraが画像系タスクをどのくらいの時間で処理するかの具体例。
-
GPT-6 AstraがUnityで街並みシーンを組み立て(@todaystopainews, 4いいね・1リポスト, 2026-09-04, https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w)。既存アセットを使って3Dシーンを自動構成するデモで、単純な画像生成を超えたエージェント的な使われ方を示す一例。
-
「Fable 5.1 world modeling」のリポスト(@todaystopainews, 11いいね・4リポスト, 2026-09-03, https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h)とその前日の**「Fable 5.1で作った中世の街」**(10いいね・3リポスト, 2026-09-02, https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j)。Anthropic系のFable 5.1が3D・ワールドモデリング方向のデモとして繰り返し取り上げられている。
-
useapi.netブログ「Dreamina API上のSeedance 2.5」(@useapi.bsky.social, 2026-08-08, https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a)。ByteDance系動画生成モデルSeedance 2.5がDreamina経由のAPIで使えるようになったことを技術ブログ形式で紹介。
-
useapi.net「MiniMax H3 vs Seedance 2.0」同一参照画像での比較(@useapi.bsky.social, 2026-07-31, https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x)。同じ参照素材(omni references)を使ったモデル間の直接比較で、API提供者視点での品質検証。
-
useapi.net「17以上のAI画像モデル徹底比較」(@useapi.bsky.social, 3いいね, 2026-07-25, https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n)。複数の画像生成モデルを横断的に並べた比較記事で、クローズドソース各社モデルの乱立ぶりがうかがえる。
-
useapi.net「Seedance 2.0の公式ルート vs サードパーティルートの価格比較」(@useapi.bsky.social, 2026-07-23, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p)。同じモデルでも公式APIとアグリゲーター経由で価格差があることを具体的に比較しており、API市場のレイヤー構造が見える投稿。
オープンソース
-
「虹色」の日常AIイラスト投稿(@nijiironokeshiki, 87〜245いいね幅, 2026-09-02〜09-05に複数投稿, 例: https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l 104いいね・25リポスト)。プロフィールに明記の通りStable DiffusionとComfyUIを使った制作で、Blueskyの中では突出して高いエンゲージメントを継続的に得ている個人アカウント。
-
くねっこのComfyUIワークフロー開発つぶやき(@kunecco, 2025-10-27, https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f)「ノードとワークフロー作りが面白くなって沼になってきた」。同アカウントは同時期に「danbooruのtokenを14万行も翻訳した」(https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t)という投稿もしており、タグ辞書レベルでComfyUIエコシステムを弄っている実例。
-
ComfyUI公式/準公式アカウント群の停滞(@comfyuistudio.bsky.social 最終投稿2024-12-19、@comfy-ui.bsky.social はフィード空)。アクター検索では
comfyuistudioreal-comfyuicomfy-uicomfyuiorgなど類似ハンドルが多数見つかるが、実際に稼働しているのは個人のAIイラスト投稿者(虹色、くねっこなど)で、ツール開発元・情報発信元としての公式的な存在感はBluesky上ではほぼ無い。
Signals
- クローズドソース側は「ニュース速報」が中心、オープンソース側は「作品投稿」が中心:todaystopainewsやuseapi.netの投稿はGPT-6 Astra、Fable 5.1、Seedance、MiniMax H3といったモデル名・API価格・ベンチマークの話題で、いいね数は1桁〜10程度と低いがニュース密度は高い。一方オープンソース(Stable Diffusion/ComfyUI)側は虹色のような個人クリエイターの完成イラスト投稿が中心で、話題は「モデルの動向」ではなく「作品そのもの」に向いている。技術ニュースとしてのオープンソース動向はBluesky上ではほぼ流れていない。
- Midjourney公式・Kling AI公式のアカウントは事実上の開店休業状態:Midjourney公式は2025年8月に「Blueskyに来た」と宣言したが最終投稿は2025-10-08で止まっており、Kling AI Videoの公式アカウントはフィードが空。ブランド側がBlueskyを継続的な発信チャネルとして使っていない。
- GPT-6 Astra名義のAIエージェント・ペルソナ垢の存在:
astrra.space(Astra、「AI agent running on GPT-6 Astra」)やmaple-nekokami.bsky.social(「Runs on OpenAI GPT-6 Astra」)のような、モデル名を看板にしたキャラクター運用アカウントが見つかった。画像・動画生成そのものの話題ではないが、GPT-6 Astraというブランド名がBluesky上でミーム的に消費されている一例。 - アグリゲーターAPI(useapi.net)がクローズドソース比較のハブになっている:Veo、Kling、Seedance、PixVerse、Hailuo、Runway、Nano Bananaなど各社モデルを束ねるuseapi.netが、価格比較・性能比較の一次情報源としてBluesky上で最も具体的な投稿を出している。単一モデルの公式アカウントより、こうした横断サービスの方が実務的な情報が濃い。
Limits
app.bsky.feed.searchPosts(投稿本文の全文検索API)が全クエリでHTTP 403を返した("image generation AI"、"Stable Diffusion"、"Flux"など単語のみのクエリでも同様)。一方app.bsky.actor.searchActors(アカウント検索)とapp.bsky.feed.getAuthorFeed(個別アカウントの投稿履歴)は問題なく応答した。そのため本レポートは「キーワードで投稿を横断検索」ではなく「関連しそうなアカウントを見つけて個別に読む」方式に頼っており、検索エンジンが拾わなかった投稿・アカウントは本レポートに含まれていない。- 完了基準(各SNSで約20件の投稿を解析)に対し、実際に本文を読んで分析対象にできたのは上記10件+補足の周辺投稿にとどまる。アカウント単位の全文検索ができない制約下でこれ以上件数を積み増すには、関連アカウントをさらに掘り起こす必要があるが、今回のセッションでは主要な切り口(GPT-6 Astra/Fable 5.1などクローズド系ニュースbot、useapi.netなどAPIアグリゲーター、ComfyUI/Stable Diffusion系個人クリエイター)を一通り確認した時点で新規に見つかるアカウントの多くが停止済み・無関係(スポーツ、政治、ジャーナリズム系)だったため、収集を打ち切った。
- Midjourney公式、Kling AI公式などブランド公式アカウントは投稿が止まっているか空で、現在進行形のニュースとしては使えなかった。
- 検索語「Wan2.5」「Flux.2」「オープンソース 画像生成」などオープンソース最新モデル名でのアカウント検索はヒット0件で、Wan、HunyuanVideo、Qwen-Image、Chromaなど具体的なオープンソースモデル名を投稿しているBlueskyアカウントは見つからなかった。オープンソース動向はStable Diffusion/ComfyUIという既存ブランド名の範囲でしか確認できていない。
Lemmy
Lemmy — 画像生成・動画生成AIの最新動向
Communities
- [email protected] — 5,708人。断トツで一番活発なコミュニティ。ComfyUIのカスタムノード、新モデルの重み公開、LoRAなどが毎日流れてくる、実質「オープンソース画像・動画生成AIニュース速報板」。
- [email protected] — 2,360人。生成物の作品共有がメイン(ニュースは少なめ)。
- [email protected] — 1,662人。dbzer0版と近いが投稿頻度は低め。
- [email protected] — 87,858人。Lemmy最大級の技術コミュニティだが、画像/動画生成AI単体の話題は薄く、Midjourneyの企業ニュースがたまに上がる程度。
- [email protected](他インスタンスのミラーも含む) — RedditのAIサブレの転載が多い。件数は少ないが、Runwayの決算情報など固有ソースの話が拾える。
- !techtakes — AI批判・懐疑派コミュニティ。Midjourneyの迷走を皮肉る投稿など。
Posts
- Midjourney、医療用超音波CTスキャナー事業に方向転換 — [email protected], score 58, 2026-06-18, https://www.theregister.com (元記事はThe Register)。関連: Midjourney公式ブログ https://midjourney.com/medical/blogpost (!hackernews, score 2, 2026-06-18)、皮肉コミュニティでの反応「Midjourney AI pivots to Theranos」!techtakes, score 40, 2026-06-19, https://pivot-to-ai.com/2026/06/19
- Midjourney、ハリウッドのスタジオにAI利用実態の開示を要求 — [email protected], score 73, 2026-07-05, https://techcrunch.com/2026/07/04
- Runway「エンタープライズ事業が倍増、NRRは300%超」 — !ai_reddit, score 0, 2026-08-30, https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/(Lemmy転載)
- Qwen-Image-2.0リリース: パラメータ20B→7Bに大幅削減、生成+編集統合、Nano BananaをElo評価で上回る(重み公開は近日予定) — [email protected], score 12, 2026-02-12, https://files.catbox.moe/l3mzzs.jpg (同時に!LocalLLaMA, !Aii, !artificial_intelにもクロスポスト)
- Wan Animate 2がComfyUIで利用可能に — [email protected], score 8, 2026-08-08, https://blog.comfy.org/p/wan-animate-2-is-now-available-in
- LTX-2.5がComfyUIでDay-0対応 — [email protected], score 5, 2026-08-12, https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
- Trellis.2とPixal3D(3D生成モデル)がComfyUIにネイティブ対応 — [email protected], score 4, 2026-09-01, https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- MiniMax-H3(オープンウェイト動画生成モデル)エコシステムが急拡大 — 8/8〜9/5にかけて[email protected]だけで10件以上。抜粋: GGUF量子化版(21.6GB→8.9GB, score 10, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF)/ 4-8step高速化LoRA(score 6-7, https://huggingface.co/lightx2v/Minimax-h3-Turbo)/ 最大120秒+音声同期の長尺動画対応(score 5, https://huggingface.co/Smite79/MiniMax-H3-Longvideos)/ ハイブリッドアテンション実装(score 3, https://github.com/Saganaki22/ComfyUI-VDN-H3, 2026-09-05)
- GPUネイティブの映像高画質化ノード群(ComfyUI-AetherScale, DLSS5 Visual Enhancer) — [email protected], score 5, 2026-09-01/09-05, https://github.com/vizart-vj/ComfyUI-AetherScale ・ https://github.com/Merserk/dlss5-visual-enhancer
- Claude用MCPで30種類以上の画像/動画生成モデルを1つのチャットから呼び出し、同じ案件が2.5時間→50分に短縮 — !ai_reddit, score 1, 2026-05-01, https://i.redd.it/6gqfafpaukyg1.png
Signals
- オープンソース側は完全にComfyUI/HuggingFace中心の"実装ニュース"。新モデル発表そのものより、「〇〇がComfyUIに載った」「LoRAが出た」「量子化版が出た」という周辺エコシステムの更新が投稿の大半を占める。MiniMax-H3という動画生成モデルの周辺ツール開発が今の主戦場。
- 3D生成(Trellis.2, Pixal3D)がComfyUIに統合され始めており、画像・動画に続く生成対象として存在感が出てきている。
- クローズドソース側はLemmyでは「製品ニュース」ではなく「批評・スキャンダル」として消費される傾向が強い。Midjourneyの医療機器転向は生成AIコミュニティより一般テック/皮肉コミュニティで大きく伸びた(score 58, 73, 40)。
- Nano Bananaへの言及はLemmy上ではほぼ全て「オープンソースモデルが上回った」という比較の文脈でのみ登場し、Google発の一次情報としての投稿は見つからなかった。
- Sora、Veo、Kling、Hailuo、Seedream/Seedance、Adobe Firefly最新版への直接的な言及は今回の調査期間(直近1ヶ月)ではヒットせず、Adobe Fireflyの投稿は2025年のものが最新だった。
Limits
- Lemmyは規模が小さく、画像/動画生成AI専門の議論はほぼ [email protected] 一つに集中している。他のインスタンス(lemmy.ml, lemm.ee, lemmy.zip等)を横断検索したが、重複するか無関係な結果ばかりだった。
- 全文検索(
/api/v3/search)は語のfuzzy matchが弱く、"Sora"や"Veo"のような短い固有名詞では無関係な投稿(人名、他サービス名)ばかりヒットした。API・Web検索の両方を試したが、OpenAI Sora、Google Veo、Kling AI、Hailuo、ByteDance Seedream/Seedanceについて Lemmy発の一次投稿は見つけられなかった(Google検索経由でも同様)。これは「話題がない」のではなく「Lemmyの検索・カバレッジの限界」である可能性が高い。 - Qwen-Image-2.0の投稿は2026年2月と古く、直近1ヶ月の話題ではないが、オープン対クローズドの比較軸として貴重なため残した。
- Runway、Claude MCP関連の投稿はLemmy発ではなくRedditからの転載(!ai_reddit)で、一次情報はReddit側にある。
Pinterest — Image and Video Generation AI News
検索語「Image and Video Generation AI News」でPinterestから50件のピンが収集された(output/pinterest.pins.md、genre分割なしの単一検索)。全50件の画像を確認した。
Visual themes
- 「AI=白い人型ロボット/サイボーグ」の記号化:実際の生成AIの中身と関係なく、白いヒューマノイドロボットやロボットと人間の横顔を合成したビジュアルが「AI」の代名詞として繰り返し使われる([2, 19, 30, 35, 37, 40, 43, 44, 46, 48])。ニュース系・解説系ピンのサムネイルはほぼこのモチーフに収斂している。
- ネオン×紺色のサイバー配色が支配的:シアン・パープル・マゼンタのグロー、回路基板パターン、暗い背景を組み合わせたテンプレート調のインフォグラフィックが大多数を占める([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49])。実写や手描き要素はほぼ無く、Canva/stock素材ベースの量産デザインだと分かる。
- 「best AI tool」ランキング型リストがジャンルの主力:Runway、Pika、Kling AI、Luma AI(Dream Machine)、Synthesia、HeyGen、InVideo AI、Kaiber、Adobe Firefly、ChatGPT Plus、Midjourney、Canva AIなどのロゴを並べた比較表・番付画像が繰り返し登場する([9, 16, 20, 24, 38, 42])。[16]と[24]はほぼ同一内容(Best Quality/Best Freeの二択表)で、同じテンプレートが複数の投稿者に使い回されていることが分かる。
- 速報・まとめ系ニュースグラフィック:新聞風レイアウトや「Breaking News」バナーで「今週のAIニュース」を要約するピンが多い([11, 12, 21, 29, 32, 33, 39, 43, 47, 50])。日付が画像内に焼き込まれているものが多く、2025年6月30日[29]、2026年5月20日[21]、2026年8月15日[32]、と時期の異なる「速報」画像が同じ検索結果に混在している。
- 実際の生成物・デモ映像を見せるピンは少数派:ほとんどがロゴやテキストのマーケティング画像である中、Google Veo 2の公式デモリール[8]、Luma系と思われるスタイル変換グリッド(人物→木彫り/折り紙/レゴ/花)[4]、Microsoft VASA-1の1枚画像+音声からの表情生成デモ[22]、紫のモンスターキャラクターを一貫させたimage-to-video出力例[26]、AMD Amuseで作った写実的な老漁師のポートレート[41]など、実際のアウトプットを見せる「作例系」ピンは全50件中1割程度にとどまる。
- 「これは本物?AI?」という懐疑・検出テーマ:FAKEスタンプ付きの猫写真とロボット[2]、「Which is AI?」の山岳写真当てクイズ[15]、AI音声検出97%[18]、「AI生成動画は良いか悪いか」の賛否リスト[23]、「みんなAIの使い方を間違えている」というネオンサイン[46]など、真偽判定・懐疑を煽るコンテンツが一定数存在する。
- 実在の著名人の写真とAI生成の"著名人風"画像が混在:Nvidia CEOジェンセン・ファンの実写ステージ写真[45]や、Sam Altmanらしき人物のYouTubeサムネ[33]がある一方、ベゾス風の顔をAIで生成したFiverr広告画像[36]もあり、実写とAI生成の境界がピン一覧上では区別しづらい。
- オープンソースへの言及はごく少数:クローズドソース系ツール(Veo、Sora、ChatGPT、Midjourney、Runway等)の露出が圧倒的多数な中、オープンソース/ローカル生成に触れているのは中国Baiduの「Ernie 4.5」オープンソース化を報じるニュース紙面[29]と、AMD GPU上のローカルツール「Amuse 3.0」[41]の2件のみ。Stable Diffusion・ComfyUI・LoRAなどOSS画像生成コミュニティを匂わせるピンは見当たらなかった。
Notable pins
- [4] (untitled/Lumalabs風スタイル変換グリッド) — 実写動画のワンフレームを「木彫り」「折り紙」「レゴブロック」「花」に変換し、犬やTesla車でも同じ変換を横並び比較。技術デモとして最も具体的。
- [8] Google Unveils Veo 2 — 顕微鏡を覗く女性、水中を泳ぐ人、星座を描く踊り子、キッチンのアニメ少女、フラミンゴの群れなど公式プロモ素材の寄せ集めで、Veo 2の映像表現の幅を最も直接的に示す。
- [9] 6+ Best AI Video Generation Websites — Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AIを機能・対象ユーザー別に整理した保存用インフォグラフィック。「Save this pin」導線付きでPinterest特有のリスト消費行動を示す。
- [16] AI Image Video: Best Quality vs Best Free — 有料10種・無料10種のツールを用途別診断フロー付きで対比。[24]とほぼ同一内容で、同種テンプレートの拡散を裏付ける。
- [22] VASA-1(Microsoft) — 1枚の静止画+音声クリップ+任意の制御信号から、多様な表情の話す顔を生成する研究デモ図。技術系ピンの中では最も学術寄り。
- [27] Vidu S1 — 中国ShengShu Technology製、リアルタイムAIインタラクション向けモデルの派手なサイバーパンク風ビジュアル。中華系動画生成モデルの存在感を示す一枚。
- [29] AI NEWS(新聞風、2025-06-30) — Baidu Ernie 4.5のオープンソース化、OpenAIがGoogle TPUを借用、MetaのScale AIへの143億ドル出資など、具体的な企業動向をまとめた数少ない一次情報寄りのピン。
- [38] Top 10 Image-to-Video Generator Tools — Runway Gen-3を筆頭にKling、Google Veo、OpenAI Sora、Luma AI、Pika Labs、Kaiber AI、Synthesia、HeyGen、Adobe Firefly、InVideo AIを番付形式で列挙。主要プレイヤーの一覧性が高い。
- [41] Amuse 3.0(AMD) — 老漁師の写実的ポートレートで、AMD GPU上で動くローカルAIアートツールの画質を訴求。オープンソース/ローカル生成側の数少ない実例。
- [50] This Week's Top AI Developments — Googleの1,500万チャット調査(利用の86%が業務外)、ChatGPTの無制限化、AIが526チーム中458チームを破ったコンテスト結果など、統計に基づく最新動向がまとまっている。
Signals
- 今、現在地に見えるもの:Pinterest上の「Image and Video Generation AI」は実質的に“ツール比較リストとニュースまとめインフォグラフィックのSEO/アフィリエイト市場”になっている。Runway・Pika・Kling AI・Luma AI・Synthesia・HeyGen・InVideo AI・Adobe Firefly・Google Veoといった名前が繰り返し上位に並び、これらがクローズドソース動画生成AIの“定番セット”として認知されていることが読み取れる。
- 同一テンプレートの使い回し:[16]と[24]が事実上同じ画像であることから、Pinterest上のAIツール比較コンテンツは少数のテンプレートが複数アカウントから量産・再投稿されている可能性が高い。
- オープンソースの不在:ブリーフが求める「オープンソースの動向」に直接使える実例は[29](Baidu Ernie 4.5)と[41](AMD Amuse 3.0)のみで、Stable Diffusion系・ComfyUI・Hugging Face発の生成AIコミュニティ画像は皆無だった。Pinterestの検索結果は視覚的に映える完成品・マーケティング素材に偏っており、オープンソースの技術コミュニティ的な投稿とは相性が悪いことが示唆される。
- 実制作物より「解説・比較・煽り」画像が優勢:50件中、実際のAI生成映像・画像そのものを主役に据えたピンは1割程度で、大半はテキスト主体のインフォグラフィックやリストである。Pinterestでは「このツールを使うとこう変換できる」という具体的な作例よりも、「どのツールを選ぶべきか」という意思決定支援コンテンツの方が拡散しやすい傾向がうかがえる。
Limits
- 本ステージではワーカーが事前収集したPinterest画像(
images/pinterest/manifest.json、50件、単一クエリのみでgenre分割なし)を読んだのみで、Pinterest自体をブラウズしていない。追加のキーワード(例:「open source AI art」「Stable Diffusion」等)で再検索すれば、オープンソース寄りのピンがもっと見つかった可能性がある。 - ピン画像内に焼き込まれた日付(2025-06-30、2026-05-20、2026-08-15など)はテンプレートの制作時期を示すのみで、実際にPinterestへ投稿・保存された時期は
manifest.jsonからは分からない。 - [12], [15], [21], [23], [29] など画像内テキストの一部がやや不鮮明(OCR的な読み取りで「Human Journalism」「Machine-Genertsd Media」のような誤字がテンプレート側に存在)で、正確な引用ではなく要旨としてまとめた。
- タイトルが空(untitled)のピンが5件([12], [15], [21], [29], [35]の一部)あり、画像内容から推測して分類した。
推奨アクション
- GPT-6 Astraは品質だけでなく「エージェント操作」の軸でFable 5.1と比較し続けること。
- MiniMax-H3のComfyUIエコシステム(GGUF量子化・Turbo LoRA)を次回も継続ウォッチすること。
- Xの次回調査ではExploreの急上昇ワードに頼らず、Stable Diffusion・Wan・Flux・Qwenなどオープンソース固有の検索語を投げること。
- オープンソースの一次情報源としてはLemmyの[email protected]を優先すること。
- Pinterestはオープンソース動向の情報源としては使わず、クローズド系ツールのマーケティング動向の観測に絞ること。
- Sora API終了(2026-09-24予定)に依存する外部ツールがないかフォローアップすること。
収集画像


















































データ品質メモ
RedditはWebFetch不可のため事前収集12スレッドのみで完了基準の約20件に未達、XはExplore急上昇ワードの大半が無関係でオープンソース検索も未実施、Blueskyは全文検索APIが403で代替収集に切り替え、Lemmyはクローズド系一次投稿が見つからず、Pinterestは単一の一般クエリのみでオープンソース特化検索は未実施。



