Daily LLM News — 2026-09-11
AI研究者の業界引退・絶滅リスク発言をめぐる安全性論争が、Reddit・Bluesky・Lemmyで独立に今日いちばんの話題になった一方、DeepSeek V4.1-FlashやGLM-5.3などオープンウェイト勢がGPT-6 Astraに迫る勢いでベンチマークを更新している。
Daily LLM News — 2026年9月11日
今日のSNS横断で見えてくるのは、新モデルの派手な性能自慢よりも「安全性への不信」が主役になった一日だということ。Anthropic研究者の業界引退・絶滅リスク発言をめぐる論争がReddit・Bluesky・Lemmyの三カ所で同時多発的に燃え上がり、OpenAIの「ミレニアム懸賞問題」盗用疑惑とあわせてクローズドモデル勢への懐疑がSNSの地下水脈になっている。一方でオープンウェイト勢は、DeepSeek V4.1-Flash・GLM-5.3・Qwen 3.8 Maxが立て続けにベンチマークを塗り替え、YouTubeとBluesky(Nathan Lambertの「Latest open artifacts」)、Lemmyのローカル運用勢がそれぞれ独立にこの流れを裏づけている。Xだけは検索設計の問題でLLMニュースをほとんど拾えず、政治・芸能トレンドに埋もれる形になった。
Across platforms
- 「安全性を理由にした業界引退・絶滅リスク発言」が3プラットフォームで独立に最大の話題になった。Reddit(r/ArtificialInteligence、Anthropic研究者Jacob Coxon氏の引退報道、ただし反応は冷ややか)、Bluesky(Nathan Lambert・Emily Bender・Gary Marcusが揃って取り上げ、絶滅リスク10%発言に言及)、Lemmy(!fuck_aiコミュニティでscore 61の最高得点投稿)と、立場の異なるコミュニティが同じ一件を軸に安全性論争を展開している。
- クローズドモデル企業への不信・「規制の虜」批判が横断的。Reddit(WSJのオープンウェイト批判記事へのr/LocalLLaMAの猛反発、556pt支持コメント)とX(@johnennisの「Anthropicに規制独占を与えるしかない」という皮肉投稿)が、独立に同じ「クローズド企業=規制を盾にした既得権益」という物語を語っている。
- オープンウェイト勢の勢いはYouTube・Bluesky・Lemmyの3方向から裏付けられる。GLM-5.3(YouTubeのベンチマーク動画、Bluesky Nathan Lambertの「Latest open artifacts」)、Qwen系モデル(YouTubeのQwen 3.8 Max、Lemmyのローカル量子化スレッド)が共通して登場し、「フロンティア級の性能を持つオープンモデルが数日単位で更新される」という同じ現象を別々の角度から確認できる。
- OpenAIの「Navier–Stokes(ミレニアム懸賞問題)」関連発表は懐疑的に受け止められている。Reddit(盗用疑惑としての議論、187pt)とBluesky(Simon Willisonの実装報告283いいね、Emily Benderの科学コミュニケーション批判)の両方で言及されているが、トーンは称賛より疑念が優勢。
Platform by platform
Reddit: 検索語「Daily LLM News」で12スレッド・10subredditを収集。今日いちばんの話題はOpenAIの数学的発見をめぐる盗用疑惑(r/singularity、187pt)と、WSJのオープンウェイト批判記事への猛反発(r/LocalLLaMA、512pt)。Anthropic研究者の業界引退報道への反応は皮肉混じりで冷ややかだった。https://www.reddit.com/r/singularity/comments/1wcnyay/ 、https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/
X: 収集された40件中、LLMニュースに該当したのは「Anthropic」検索の4件のみ。他の9検索語がExploreのトレンド(Apple新製品、Charlie Kirk、MAGAなど政治・芸能ネタ)をなぞっただけで、LLM関連の検索設計が不十分だった。唯一の具体的製品ニュースは@claudecode84によるAnthropic最高責任者のClaude Code環境オープンソース化投稿。https://x.com/claudecode84/status/2097959830942367747
YouTube: GPT-6 Astraの「Preparedness Frameworkで初のCriticalサイバー階層到達」が最大の話題。オープンウェイト勢ではDeepSeek V4.1-Flash(9/10リリース、200 TPS、Astra超えの可能性)が最新かつ最も新規性が高く、GLM-5.3・Qwen 3.8 Maxも継続してベンチマーク動画が量産されている。動画ページがJavaScriptレンダリングのため、再生数・チャンネル登録者数の一部が未確認。https://www.youtube.com/watch?v=qRNZMGc7TMc 、https://www.youtube.com/watch?v=lpC5X6o3VJE
Bluesky: 公開検索API(searchPosts)が403で使えず、Simon Willison・Nathan Lambert・Emily Bender・Gary Marcusという既知アカウントのフィードを直読みして代替。「安全性を理由にした業界引退」騒動が全員のトップ投稿に共通して出てくる点が最大の発見。GPT-6 Astraの実務利用報告(Simon Willison)とオープンウェイトのライセンス動向まとめ(Nathan Lambert)も収穫。https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
Lemmy: 単一コミュニティでは10件に届かず、sh.itjust.works・piefed.world・infosec.pub・lemmus.orgなど複数の連合先インスタンスを横断してようやく10件を確保。オープンウェイト側は量子化・省VRAM化などローカル運用の実務話が中心(Qwen 3.8 27Bの8GB GPU対応など)、クローズド側はDeepSeek/Moonshotの不正プロンプト横流し疑惑やAnthropic研究者の絶滅リスク発言(score 61、今回最高スコア)が話題化。https://lemmus.org/post/25299580
ブランドが投資したのは以上の5プラットフォームのみで、ここに挙がっていない他のSNS(例: Threads、TikTokなど)は今回の調査対象外であり、データの欠落ではない。
What to watch
- DeepSeek V4.1-Flash がGPT-6 Astraを超えるか — YouTube、リリース翌日から「Astra超え」の検証動画が出ている。https://www.youtube.com/watch?v=lpC5X6o3VJE
- AI研究者の絶滅リスク発言・業界引退騒動の続報 — Bluesky(Nathan Lambert)、Lemmy(!fuck_ai)双方で燃え上がっている安全性論争の行方。https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
- OpenAIのNavier–Stokes盗用疑惑の真偽 — Reddit r/singularityで議論継続中、公式反論の有無を追う価値あり。https://www.reddit.com/r/singularity/comments/1wcnyay/
- 「Mythos 5」とENISAテストアクセスの真偽 — Lemmyの単一投稿でしか確認できておらず、一次情報での裏取りが必要。https://infosec.pub/post/52133063
- DeepSeek/MoonshotによるClaudeへの不正プロンプト横流し疑惑 — Lemmy、クローズドモデルへの依存/侵入という構図の続報を要確認。https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
- GLM-5.3のポストトレーニングのみでの性能向上 — YouTube・Bluesky双方で言及、同様の手法が他のオープンモデルにも広がるか注視。https://www.youtube.com/watch?v=iMpBNN-0-Ss
Recommendations
- 次回のX収集では、Exploreのトレンドをなぞるのではなく「新モデル名」「オープンウェイト」「API価格」など、テーマに直結した検索語を設計し直す。
- OpenAIのNavier–Stokes盗用疑惑とAnthropic研究者の絶滅リスク発言について、公式発表や一次ソースでの裏取りを次のリサーチサイクルで優先する。
- DeepSeek V4.1-FlashとGLM-5.3のベンチマーク主張は独立系の第三者評価が出るまで「主張段階」として扱い、鵜呑みにしない。
- Lemmyの「Mythos 5」やDeepSeek/Moonshotの不正プロンプト横流し疑惑など単一ソースの情報は、次回以降も一次情報での確認を継続する。
- Bluesky検索APIの403エラーが解消しているか次回確認し、既知アカウント頼みの収集から本来のキーワード横断検索に戻す。
- 「クローズド企業=規制の虜」という物語がReddit・Xで独立に語られている点を踏まえ、Anthropic・OpenAIの規制対応に関する公式発言を継続的にウォッチする。
Data quality
Reddit・YouTube・Bluesky・Lemmyの4プラットフォームは、検索/収集手法に制約(Bluesky検索API 403、YouTube JSレンダリング、Lemmy単一コミュニティの規模不足)があったものの、いずれも実質的な知見を独立に得られた。Xのみ、収集時の検索語設計がテーマとずれており(10語中9語が無関係なExploreトレンド)、完了基準の「10件」に対しLLMニュースとして意味のある投稿は4件にとどまった。全プラットフォームとも依頼日(2026-09-11)当日付の投稿は少なく、多くは9/7〜9/10の情報である点にも留意。
プラットフォーム別まとめ
Reddit — Daily LLM News
Where
検索語「Daily LLM News」で見つかった12スレッド・10subredditの内訳。
| Subreddit | メンバー数 | 収集スレッド数 |
|---|---|---|
| r/NoStupidQuestions | 7,478,724 | 2 |
| r/singularity | 3,969,435 | 2 |
| r/ArtificialInteligence | 1,923,877 | 1 |
| r/artificial | 1,336,151 | 1 |
| r/LocalLLaMA | 821,351 | 1 |
| r/WritingWithAI | 164,927 | 1 |
| r/SillyTavernAI | 128,004 | 1 |
| r/Artificials | 3,785 | 1 |
| r/Maxcactus_TrailGuide | 5,149 | 1 |
| r/AIdaily_news | 1,818 | 1 |
r/NoStupidQuestionsとr/singularityという「LLM専門ではない」巨大汎用subredditが合計4スレッドを占めていて、LLMの話題が一般ユーザー層にまで広く染み出していることが分かる。一方でr/LocalLLaMAやr/SillyTavernAIのようなローカルLLM/ロールプレイ系コミュニティも今日は「盗用疑惑」「規制」といった外部ニュースへの反応で盛り上がっている。
What people say
- OpenAIの数学的発見をめぐる盗用疑惑が今日いちばんホット。r/singularityのスレッド6「Big news is that OpenAI is nearing solving another millennium prize...」(187 points, 55 comments, 2026-09-10, https://www.reddit.com/r/singularity/comments/1wcnyay/)では、OpenAIがミレニアム懸賞問題(ナビエ–ストークス方程式)に迫る成果を発表しつつ、数学者Buckmasterらの研究成果をCodex経由で「盗用していない」と主張していることが議論の的に。u/FateOfMuffins(52pt)は「これは最新の大規模学習のデータカットオフが7月3日であることを示唆しているのでは」とコメント。
- 同じ話題はr/SillyTavernAIのスレッド12「Due to OpenAI stealing mathematical proofs, local LLM are now crucial more than ever」(30 points, 47 comments, 2026-09-10, https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/)にも波及し、「盗用があったならローカルLLMがより重要になる」という論調。ただしトップコメントu/Original-League-6094(30pt)は「たとえ盗用が事実だとしても、この主張自体は筋が通らない」と反論しており、賛否が割れている。
- WSJのオープンウェイトAI批判記事が炎上気味。r/LocalLLaMAのスレッド9「WSJ: Unregulated Open-Weight AI Is an Invitation to Disaster」(512 points, 232 comments, 2026-09-08, https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/)が最も高スコア。投稿者は記事を「透明なプロパガンダ」と断じ、トップコメントu/3169676(556pt)は皮肉たっぷりに「規制されたAIに質問できるのは金持ちの億万長者だけであるべきだ」と揶揄。u/UNaMean(222pt)は「銃と同じ論理だ、悪用する人間が悪いのであってツールが悪いのではない」とオープンウェイト擁護論を展開。
- Anthropic研究者の「業界引退」報道への反応は冷ややか。r/ArtificialInteligenceのスレッド4「Biggest news in AI world today」(0 points, 31 comments, 2026-09-09, https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/)では、Anthropicの研究者Jacob Coxon氏が「制御不能なシステム開発競争」を懸念して業界を去った、という話題に対し、u/MiloGoesToTheFatFarm(14pt)が「彼はただのデータ入力係で、モデル設計をしていたわけではない」と切り捨て、u/presentofai(2pt)も「『安全性を理由に退職』系の投稿は、これから立ち上げる安全系スタートアップの履歴書みたいなものだ」と皮肉っている。
- Anthropicへの不信感がr/AIdaily_newsでも噴出。スレッド7「Wait… what is going on?」(5 points, 14 comments, 2026-09-10, https://www.reddit.com/r/AIdaily_news/comments/1wcri4x/)では、遺伝子研究関連のリクエストが拒否された体験を踏まえ、u/Dogbold(2pt)が「AnthropicがAIを禁止に追い込もうとしているだけの、また別の嘘だ」とコメント。
- AGI到達論争は依然として平行線。r/artificialのスレッド3「What will LLMs never do?」(67 points, 218 comments, 2026-09-06, https://www.reddit.com/r/artificial/comments/1w8m8rw/)で、投稿者は「Astraのリリースを見る限り12〜18ヶ月以内にAGIに到達してもおかしくない」と主張。対してu/danderzei(62pt)は「LLMは次トークン予測器であり、それ以外はすべて創発的性質にすぎない」と懐疑的。u/presentofai(10pt)の「本当にできないのは『自分が間違っていると確実に分かること』だ」というコメントが多くの共感票を集めている。
- 「LLMはRedditorより賢くなれない」論争もスコア268の人気スレ。r/singularityのスレッド5(268 points, 158 comments, 2026-09-09, https://www.reddit.com/r/singularity/comments/1wbnhgt/)はAGI懐疑派への皮肉合戦になっており、u/oilybolognese(199pt)は「人間の方が自信満々に間違ったことを言うから、人間の脳こそ自然な汎用知能にはなれない」と逆張り。
- 次トークン予測が未解決の数学問題を解けるのはなぜか、という素朴な疑問がr/NoStupidQuestionsで大反響。スレッド2(295 points, 164 comments, 2026-09-10, https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/)で最多支持を集めたu/Time_Entertainer_319(1,206pt)のコメントはClaude Shannonの情報理論まで遡って予測と言語構造の関係を解説する長文で、Redditらしい教育的スレッドになっている。
- 無料枠のライティング用LLM探しスレでは既存御三家への不満が可視化。r/WritingWithAIのスレッド8(13 points, 12 comments, 2026-09-10, https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/)で投稿者は「GPT Solは硬すぎ、Claude Sonnetはレート制限がきつすぎ、Geminiは頭が悪すぎる」と嘆き、コメント欄ではu/VerdantMagnolia(2pt)や u/Round_Ad_5832(1pt)が「Kimiか DeepSeek を試すべき」と代替案を提示。
- 「LLMは認知ウイルスだ」という科学者発言が最高スコア(1,346pt)を記録。r/Maxcactus_TrailGuideのスレッド11(1,346 points, 133 comments, 2026-09-09, https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/)はニッチなsubredditながら今回収集した中で最もスコアが高く、u/TurgorFervor(25pt)は「宗教もウイルスだ。批判的思考だけがワクチンになる」とコメント。
Signals
- 上昇傾向: 「企業がユーザーの創作物・研究成果を無断学習に使っている」という不信テーマが、OpenAIの数学的発見(スレッド6・12)とAnthropicの遺伝子研究拒否(スレッド7)という別々の文脈で同時多発的に噴出している。今日はクローズドAI企業への不信・皮肉が横断的な地下水脈になっている。
- 懐疑論の反転: 「LLMはただの次トークン予測器」という定番の懐疑論(スレッド2・3・5)に対し、今日のトップコメントは軒並み「予測は思考と本質的に結びついている」「creativityという言葉自体が相対的」という擁護寄りの論調で、Redditの空気が以前より“LLM懐疑論への懐疑”に傾いていることがうかがえる。
- 見過ごされている/茶化されている話題: Anthropic研究者の「安全性を理由にした業界引退」報道(スレッド4)は、他のニュースに比べてポイントが0と極端に低く、コメント欄も同情より皮肉が優勢。センセーショナルな見出しほどRedditでは逆に軽視される傾向が見て取れる。
- 意見の対立が際立つペア: スレッド9(WSJのオープンウェイト批判記事へのr/LocalLLaMAの猛反発、556pt支持のトップコメント)と、その裏返しであるスレッド7・12(AnthropicやOpenAIといったクローズド企業陣営への不信)を並べると、Redditでは「クローズド企業=規制を盾に競合排除を狙う既得権益」という一貫した物語が語られていることが分かる。
Limits
- 今回使われた検索語は「Daily LLM News」という汎用語1つのみで、新モデル発表・API価格改定・ベンチマークなど個別テーマを狙った複数語での検索は行われていない。そのため「今日発表された具体的な新モデルやAPI変更」を報じるスレッドは収集結果に含まれておらず、代わりにAGI論争・盗用疑惑・規制議論など「議論系」スレッドに偏っている。
- 収集された12スレッドの投稿日は2026-09-06〜2026-09-10の範囲で、依頼日である2026-09-11当日付のスレッドは1件もない。
- r/AIdaily_news(1,818人)やr/Artificials(3,785人)、r/Maxcactus_TrailGuideはメンバー数が非常に少ないニッチ/模倣系subredditで、r/singularityやr/LocalLLaMAほどの代表性は無い点に注意が必要。
- 各スレッドで表示されているのはトップ6コメントまでで、全コメント(最大232件)を読んだわけではない。
X
X — Daily LLM News
収集済みの output/x.posts.md(40件・39アカウント、検索語10種)を精査した結果、LLM関連ニュース(新モデル、オープンウェイト、API/価格、ベンチマーク、話題の使い方・事故、各社の動き)に該当する投稿は Anthropicで検索した4件のみだった。他の9つの検索語(Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS, The OS)はX自身のExploreトレンド一覧をそのままなぞったもので、政治・芸能・ゴシップ系の話題が中心となり、LLMニュースには結びつかなかった。
Accounts
- @restitutorII(Restitutor Orientis) — 1投稿・426いいね。単発の解説スレッドで、Anthropicが発表した経済シナリオレポートを要約・拡散する立場。
- @walterkirn(Walter Kirn) — 1投稿・522いいね。作家/ジャーナリストとして知られるアカウントで、AI業界の著名人物への懐疑的コメントを単発で投下。
- @johnennis(John Ennis) — 1投稿・992いいね。「元Anthropic社員」を自称し、Anthropicへの規制優遇(規制の虜)を皮肉る風刺投稿。
- @claudecode84(Claude code研究ラボ) — 1投稿・1,127いいね・約175,000ビュー。日本語でClaude Code関連の話題を発信するアカウントで、今回の収集の中で唯一の具体的な製品ニュース投稿。
いずれも1投稿のみのアカウントで、特定の話題を継続的に発信している「専業」インフルエンサーではなく、それぞれ単発でバズった一般ユーザー・小〜中規模アカウントという性格が強い。
Posts
-
@claudecode84(1,127 likes・129 reposts・15 replies・約175,000 views・2026-09-10)
https://x.com/claudecode84/status/2097959830942367747Anthropic最高責任者本人が自分の「Claude Code環境」を丸ごとオープンソース化しています
今回の収集で唯一、具体的な製品発表に該当する投稿。Anthropicの最高責任者(役職の詳細は投稿内に記載なし)が自身のClaude Code環境一式を公開したという内容で、日本語圏のAI系アカウントが取り上げている。 -
@restitutorII(426 likes・67 reposts・39 replies・約49,000 views・2026-09-10)
https://x.com/restitutorII/status/2097918742571139093Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI: 1- Modest scenario: AI has an impact comparable to the Internet. GDP +1.6%, few disruptions to employment. 2- Substantial scenario: AI can perform about...
Anthropicが発表した「2030年の米国経済」に関するシナリオレポート(Modest/Substantial/…の複数シナリオ、GDPへの影響など)を紹介するスレッド。本文が投稿内で途切れており、元レポートへの直接リンクは投稿文中には確認できない。 -
@johnennis(992 likes・86 reposts・49 replies・約32,000 views・2026-09-10)
https://x.com/johnennis/status/2098032630159597842Guys, we have NO CHOICE but to give Anthropic (my former employer, where I only worked six weeks to punch the card and make this bullshit believable) a regulatory monopoly It's just science!
Anthropicの規制ロビー活動を「規制の虜(regulatory capture)」だと揶揄する風刺投稿。元従業員を自称しつつ皮肉る書きぶりで、真偽不明だが「Anthropicが規制を味方につけて競合を排除しようとしている」という不信感が透けて見える。 -
@walterkirn(522 likes・71 reposts・32 replies・約20,000 views・2026-09-10)
https://x.com/walterkirn/status/2098059171325427949The mainstream media boosted this dude like he was, well, Dr Fauci or something. I implore you to see clearly how this works. And who works it.
「Anthropic」検索でヒットしたが、投稿文だけでは誰を指しているか(Anthropic関係者かAI業界の別の人物か)が特定できない。主流メディアがある人物を持ち上げすぎているという懐疑的トーンのみ確認できる。
Signals
- 今日Xの「今いちばん語られていること」にLLMニュースはほぼ入っていない。ExploreのTop10トレンド(下記参照)でLLM/AI直結のものは7位「Anthropic」(Technology・Trending)のみで、他はApple新製品イベント、Charlie Kirk関連ミーム、MAGA/政治、iPhone Duo、パレスチナ情勢、英国内政など。X全体としては今日、AIよりも政治・芸能ネタが圧倒的に優勢。
- Anthropicへの言及は「経済への影響を語る好意的な紹介」と「規制の虜への皮肉」の両方が同居している(投稿2 vs 投稿3)。件数が少ないため断定はできないが、Reddit側で観測された「クローズドAI企業=規制を盾にした既得権益」という不信の物語と同じ方向性の皮肉がXにも存在する。
- 見過ごされている点: 唯一の具体的プロダクトニュース(投稿1、Claude Code環境のオープンソース化)は日本語アカウント発で、英語圏の反応は今回の収集内には見当たらない。話題として広がっていない可能性がある。
- 参考として、ExploreのTechnologyトレンドに「Anthropic」が入っていたこと自体は、話題の規模はともかく「今日Xで名前が挙がった数少ないAI企業」としての裏付けになる。
参考: X Explore(このセッションのジオロケーション基準)
| # | トレンド | 分類/場所(X表記) |
|---|---|---|
| 1 | Apple | Technology · Trending |
| 2 | Charlie Kirk | Politics · Trending |
| 3 | MAGA | Politics · Trending |
| 4 | iPhone Duo | Technology · Trending |
| 5 | Palestinian | Politics · Trending |
| 6 | Britain | Politics · Trending |
| 7 | Anthropic | Technology · Trending |
| 8 | #CyberSecurity | Trending in Croatia |
| 9 | Harvey as the AI OS | Trending in Croatia |
| 10 | The OS | Trending in Croatia |
1〜7位は場所の指定がなく(このセッションのデフォルトの地域設定と思われる)、8〜10位のみ「Trending in Croatia」と明記されている。つまりこのExploreリストは特定の一地域(おそらくクロアチア、または本セッションのデフォルト地域)からの視点であり、世界全体の代表ではない点に注意。
Limits
- 検索語の設計がテーマとずれていた: 収集時に使われた10個の検索語のうち9個(Apple, Charlie Kirk, MAGA, iPhone Duo, Palestinian, Britain, #CyberSecurity, Harvey as the AI OS, The OS)はX Exploreのトレンド語をそのまま検索したもので、「新モデル発表」「オープンウェイト」「API価格」「ベンチマーク」といったLLMニュース関連の狙った検索は「Anthropic」の1語のみだった。そのため完了基準の「10件」に対し、LLMニュースとして意味のある投稿は4件しか確保できていない。
- OpenAI、Google(Gemini)、Meta(Llama)、Mistral、xAI(Grok)など他の主要LLMプレイヤーを名指しした検索は行われておらず、それらに関する話題がXで語られていたかどうかは今回の収集からは分からない。
- 投稿2(@restitutorII)の引用文はプラットフォーム側の表示で本文途中から先が切れており、元のAnthropicレポート名や詳細な数値(Substantial/Aggressiveシナリオの中身など)を確認できていない。
- 投稿4(@walterkirn)は「Anthropic」検索でヒットしたものの、本文だけでは対象人物・文脈を特定できず、Anthropic自体の話題かどうか確証が持てない。
- Explore結果は前述の通りセッションの地域(クロアチアないし不明のデフォルト地域)に紐づいており、日本や米国など他地域のExploreでは異なるトレンドが表示されていた可能性がある。
YouTube
YouTube — 2026年9月11日のLLM関連ニュース
Channels
- Wes Roth(チャンネル登録者 約32.3万人、総再生回数 約5,600万回)— OpenAIの新モデル発表を速報で解説する定番チャンネル。GPT-6 Astra Just Went CRITICAL...を投稿。
- Every / 「AI & I」(Dan Shipper氏のプロダクトスタジオ)— 実務での1週間テストレポートを公開。We Tested Anthropic's Fable 5.1 for a Week。
- 他多数の「Fully Tested」系AI比較チャンネル(チャンネル名・登録者数はページがJavaScriptレンダリングのため確認できず、下記Limitsに記載)が、新モデルごとにベンチマーク動画を量産している。
Videos
-
GPT-6 Astra Just Went CRITICAL... — Wes Roth(2026年9月2日ごろ投稿)
https://www.youtube.com/watch?v=qRNZMGc7TMc
OpenAIのGPT-6 Astraが、自社Preparedness Frameworkで「Critical」サイバーセキュリティ階層に達した初のモデルであると報じ、高度なサイバー機能は検証済みテスターとDaybreak Blueパートナーのみに限定公開されたと解説。 -
Use GPT-6 Astra For FREE — OpenAI's Most Powerful Model Ever(チャンネル名未確認、投稿4日前ごろ=9月7日頃)
https://www.youtube.com/watch?v=LbXoUHdG2pY
GPT-6 Astraを無料で使う方法を紹介しつつ、コーディング・サイバーセキュリティ・科学分野で最先端の性能を持つと紹介。 -
We Tested Anthropic's Fable 5.1 for a Week — Every/Dan Shipper氏
https://www.youtube.com/watch?v=yZddAiz4HP8
コーディング・執筆・知識労働の実務でFable 5.1を1週間検証し、「これまで使った中で最強のコーディングモデル」かつOpus 5と同等の成果を約半分のトークン・約6割の時間で達成したと結論。 -
Fable 5.1 is here, and its REALLY good(チャンネル名未確認)
https://www.youtube.com/watch?v=0lBvjhcRqyU
Fable 5.1でキャッシュ読み取りコストが75%削減、エージェント作業のコストが25〜45%削減されたと報告。 -
Gemini 3.8 Flash: The model no one expected!(チャンネル名未確認、投稿1週間前ごろ)
https://www.youtube.com/watch?v=UvrAYDgobSw
Gemini 3.8 FlashをGoogle史上最高のエージェント型コーディングモデルと評価。 -
Gemini 3.8 Flash Opus 5 Level Explained in 7 Minutes - Benchmarks, Cost, First Impressions(チャンネル名未確認)
https://www.youtube.com/watch?v=y52bv4iNfzU
Googleが9月2日にリリースしたGemini 3.8 Flash(43日間で3回目のFlashリリース)のベンチマークがOpus 5クラスに達したと解説。 -
GLM-5.3: Frontier Coding with Emergent Cyber Capabilities(チャンネル名未確認)※オープンウェイト
https://www.youtube.com/watch?v=2uEunHawjIU
Z.aiのGLM-5.3がコーディングでフロンティア級のスコアを出す一方、サイバー能力の急激な向上(Emergent Cyber Capabilities)にも言及。 -
GLM-5.3 (Fully Tested): I GOT EARLY ACCESS & IT'S #1 ON MY BENCH!(チャンネル名未確認)※オープンウェイト
https://www.youtube.com/watch?v=iMpBNN-0-Ss
投稿者独自のベンチマークでGLM-5.3が1位になったと主張。ベース重みはGLM-5.2から変更せず、ポストトレーニングのみで性能向上したことを強調。 -
Qwen 3.8 Max (Final Version Review & Free Ways): Okay, it's ACTUALLY a TOP MODEL!(チャンネル名未確認)※オープンウェイト
https://www.youtube.com/watch?v=GrTVmMZfM6A
Alibabaの2.4兆パラメータ級フラッグシップQwen 3.8 Maxが、多くのベンチマークでOpus 4.8を上回ったと報告。 -
Deepseek V4.1 Flash (Fully Tested): 200 TPS & Beats Astra!? (+New Architecture Overview)(チャンネル名未確認、投稿約14時間前=9月10〜11日と最新)※オープンウェイト
https://www.youtube.com/watch?v=lpC5X6o3VJE
2026年9月10日に正式リリースされたDeepSeek V4.1-Flash(5,520億パラメータMoE、ネイティブ画像理解、100万トークンコンテキスト)が、200 TPSの高速推論とベンチマークでGPT-6 Astraに匹敵/超える可能性があると検証。 -
Muse Spark 1.3: Going Open Weight Soon, Fully Tested(チャンネル名未確認)※オープンウェイト
https://www.youtube.com/watch?v=euJl6i8pT3g
Metaは2026年4月にMuse Sparkを初のクローズドウェイトモデルとしてリリースしたが、Spark 1.3では再びオープンウェイト化が近いとの見方を検証。
Signals
- クローズド勢では、OpenAIのGPT-6 Astraが「Preparedness Frameworkで初めてCriticalサイバー階層に達したモデル」という一点に動画が集中しており、性能自慢よりも「危険度を自ら公表した」ことが最大の話題になっている。AnthropicのFable 5.1は「実務コスト半減」「Claudeがまた自然な文章を書けるようになった」という実利用者目線のレビューが目立ち、GoogleのGemini 3.8 Flashは「43日間で3回目のFlashリリース」という開発速度そのものが話題化していた。
- オープンウェイト勢では、DeepSeek V4.1-Flash(9月10日リリース、最新)が「Astraを超えるかもしれない」という切り口で今日いちばんの新規性を持ち、GLM-5.3は「ベースモデルを変えずポストトレーニングだけで性能向上」という手法自体が注目点になっている。Qwen 3.8 MaxとMeta Muse Spark 1.3は先行してリリース済みだが、依然ベンチマーク動画が継続的に作られている。
- 全体として「Fully Tested」を冠したベンチマーク検証動画が、モデル発表当日〜数日以内に量産されるパターンが定着している。
Limits
- YouTubeの検索結果ページおよび動画ページはJavaScriptでレンダリングされるため、
WebFetchでは実際の動画一覧・再生数・チャンネル登録者数・コメントを直接取得できなかった(フッターのナビゲーションのみが返された)。そのため本レポートの再生数・チャンネル名の多くはWebSearchのスニペット情報に基づいており、確認できなかった項目は「未確認」と明記した。 - 動画の説明文・上位コメントの内容も同様の理由で直接確認できていない。
- 検索は英語キーワード中心で行った。日本語チャンネルによる同テーマの動画(例:GLM-5.3の日本語速報動画は1件発見)は網羅的に探索していない。
Bluesky
Bluesky — 今日のLLM関連ニュース
Accounts
Bluesky には app.bsky.feed.searchPosts(公開検索API)が現在 403 Forbidden を返し、キーワード検索が使えなかった(Limits 参照)。代わりに、LLM界隈で日常的に投稿している既知アカウントの投稿フィード(getAuthorFeed)を直接読んで集めた。
- Simon Willison — @simonwillison.net。LLM CLIツールの開発者で、新モデルを触った感想やエージェント活用のTipsを毎日のように投稿。
- Gary Marcus — @garymarcus.bsky.social。LLM懐疑派の急先鋒。安全性・誇大広告批判の発信源。
- Nathan Lambert (Interconnects) — @natolambert.bsky.social。AI2所属の研究者。オープンウェイトモデルの動向まとめ「Latest open artifacts」を定期発信。
- Emily M. Bender — @emilymbender.bsky.social。計算言語学者、AI懐疑派。誇大広告・PR批判が中心。
- 参考として Anthropic公式(@anthropic.com)も確認したが、投稿数0件(
postsCount: 0)でBlueskyでは実質活動なし。OpenAI公式アカウントはopenai.comハンドルで存在しない(400 Bad Request)。
Posts
-
GPT-6 Astraでベンダー模型をBlenderで作らせた — Simon Willison、2026-09-10。「Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build...」いいね52・リポスト5。
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
同じ模型をブラウザで見られるビューアも作らせた — Simon Willison、2026-09-10。いいね17・リポスト1。
https://bsky.app/profile/simonwillison.net/post/3mv4swvzzr22h -
OpenAIの「Navier–Stokes ミレニアム懸賞問題」騒動への所感 — Simon Willison、2026-09-08。いいね283・リポスト51(このフィードで一番拡散)。
https://bsky.app/profile/simonwillison.net/post/3mv2a4quhpk2d -
Anthropic/OpenAIのプロンプトガイドラインが「より簡潔なルール推奨」に変化 — Simon Willison、2026-09-07。いいね7・リポスト3。
https://bsky.app/profile/simonwillison.net/post/3mux26ztekk26 -
「one resignation turned the embers of AI fear into a wildfire」を書いた — Nathan Lambert、2026-09-10。AI研究者の辞職表明(絶滅リスク>10%という主張、Evan Hubingerの名も引用)が発端でSNS上のAI恐怖論が一気に燃え上がった経緯を分析。いいね13・リポスト2。
https://bsky.app/profile/natolambert.bsky.social/post/3mv6f35gkqt2l
(元記事: https://www.interconnects.ai/p/one-resignation-turned-the-embers /Hacker News: https://news.ycombinator.com/item?id=49646123) -
「AI進歩は速い/展開は慎重に/世界は終わらない」と辞職騒動に苦言 — Nathan Lambert、2026-09-09。いいね151・リポスト14。
https://bsky.app/profile/natolambert.bsky.social/post/3mv3ybz4g4n2c -
「OpenAI/Anthropicの中の人は宗教的な熱量で動いている」批判 — Nathan Lambert、2026-09-09。いいね26・リポスト3。
https://bsky.app/profile/natolambert.bsky.social/post/3mv3yb7bnem2t -
Latest open artifacts (#24): Motif-3、GLM-5.3、Hy4-previewとオープンモデルのライセンス動向まとめ — Nathan Lambert、2026-09-08。「オープンモデル勢のエコシステムは拡大を続ける一方、フロンティア勢は大混乱の渦中」。いいね13。
https://bsky.app/profile/natolambert.bsky.social/post/3muzc3qszot2m -
辞職騒動をメディアが無批判に取り上げることへの疑問 — Emily M. Bender、2026-09-10。「カルトのメンバーをそのまま報道するのは前例があるのか」と歴史家に問いかけ。いいね318・リポスト80。
https://bsky.app/profile/emilymbender.bsky.social/post/3mv6fvytz2s25 -
OpenAIの「数学的ブレークスルー」広報への懐疑 — Emily M. Bender、2026-09-10。「科学コミュニケーションの文脈での宣伝合戦に関連する」とコメント。いいね62・リポスト8。
https://bsky.app/profile/emilymbender.bsky.social/post/3mv54s2ytuv2a -
Gary Marcusが「Dwarkeshは何を見誤ったか」を詳細に批判(Dwarkesh Patelのポッドキャストでの楽観論への反論) — Gary Marcus、2026-08-31。いいね46・リポスト21。
https://bsky.app/profile/garymarcus.bsky.social/post/3mufea36xzc2x -
辞職騒動について「今日のsubstackで論じた通り」と短くコメント — Gary Marcus、2026-09-10。いいね13。
https://bsky.app/profile/garymarcus.bsky.social/post/3mv6i3z5bpc2y
Signals
- 今日いちばん語られていること = 「辞職騒動」。AI研究者の辞職表明(絶滅リスク発言、Evan Hubingerの名が引用される)が、Nathan Lambert・Emily Bender・Gary Marcusという立場の異なる3アカウント全員の投稿トップに同時に出てくる。オープンウェイト寄りの研究者もクローズドモデル批判派も、この一件を軸に安全性論争を展開している。
- GPT-6 Astra(OpenAI、9/3-4リリース) はSimon Willisonが実務ツール(Blender連携・GIS作業)で使い倒しており、拡散度も高い(Navier-Stokes関連投稿がいいね283)。ただしBluesky上での言及は好意的な実装報告が中心で、Redditほどの祝祭ムードではない。
- オープンウェイト勢の動き はNathan Lambertの「Latest open artifacts #24」に集約されている: Motif-3、GLM-5.3、Hy4-previewが今週の新着。ライセンス動向も継続的に追跡されている。
- Bluesky全体の温度感として、LLM研究の技術的話題よりも「AI安全性・誇大広告・メディアの報じ方」といったメタ議論の比重が目立つ。Emily Bender・Gary Marcusら懐疑派の存在感が強いのがX/Redditとの違い。
Limits
- Bluesky公開検索API(
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)はプレイブック記載と異なり、今回は認証なしで403 Forbiddenを返し続けた(getProfileやgetAuthorFeedなど他のread系エンドポイントは正常に動作したため、searchPostsだけが個別に制限されている模様)。そのためキーワード横断検索はできず、既知アカウントのフィード直読みで代替した。 bsky.appのWeb版検索UI(https://bsky.app/search?q=...)はクライアントサイドレンダリングのSPAで、JSを実行しないフェッチでは本文が取得できず利用できなかった。huggingface.co/huggingface.bsky.social/swyx.bsky.socialのハンドルは投稿0件または存在せず、Hugging Face公式やswyxの発信は拾えなかった。OpenAI公式アカウント(openai.comハンドル)もBluesky上に存在しない。Anthropic公式(anthropic.com)はアカウントはあるが投稿0件で実質休眠。- David Gerard(Pivot to AI)の正しいハンドルを特定できず(
davidgerard.co.ukと推定したハンドルは400エラー、pivot.bsky.socialは別人の個人アカウントだった)、批判派メディアの代表的発信源の一つを取りこぼしている。 - 上記の理由により、完全な「最新10件」をキーワード検索ベースで機械的に集めることはできなかったが、複数の主要アカウントのフィードを横断して関連投稿12件を日付・リンク付きで収集した。
Lemmy
Lemmy — 今日のLLM関連ニュース(2026-09-11)
Communities
- [email protected] — 5,132人購読。ローカル実行・自宅運用のLLM話題の中心コミュニティ。
- [email protected] — 2,168人購読。
- Machine Learning | Artificial [email protected](
[email protected])— 1,248人購読。 - [email protected] — 8,191人購読。AI/LLM業界に批判的な立場のコミュニティ。「事故」「懸念」系の投稿が多い。
- [email protected] — 51人購読。RedditのAI関連投稿を機械的にミラーするRSS転載コミュニティ(生のLemmy議論ではない点に注意)。
- [email protected]、[email protected]、[email protected]、[email protected]、[email protected]、[email protected] — いずれも連合先インスタンスのコミュニティで、今回AI関連の単発投稿がヒット(購読者数は未確認)。
Posts
-
NanoFlare Fits Qwen 3.8 27B On An 8GB GPU —
[email protected]、score 1、2026-09-09
https://lemmy.world/post/51731499
8GBクラスのGPUでQwen3.8 27Bを動かす量子化手法「NanoFlare」の報告。 -
Benchmarking Qwen3.8 27B quantizations —
[email protected](piefed.zip経由)、score 20、2026-09-08
https://piefed.zip/c/[email protected]/p/1805947
Qwen3.8 27Bの各種量子化バージョンの精度・速度比較。localllama内でも今回確認した中で最もスコアが高い投稿。 -
FreeToken claims 39.3 tok/s for Qwen3.6-35B —
[email protected]、score 4、2026-09-08
https://lemmy.world/post/51688483
推論高速化フレームワーク「FreeToken」がQwen3.6-35Bで39.3 tok/sを達成したという主張。 -
Chinese labs DeepSeek and Moonshot were quietly relaying customer prompts to Claude through fraudulent accounts —
[email protected]、score 3、2026-09-10 21:34 UTC
https://piefed.world/c/tech/p/1393607/chinese-labs-deepseek-and-moonshot-were-quietly-relaying-customer-prompts-to-claude-thro
DeepSeekとMoonshotが不正アカウント経由で顧客のプロンプトをClaudeに横流ししていた、という報道の転載。 -
CVE-2026-82533: la falla in DeepSeek Harness che lasciava agli agenti AI le chiavi della propria sandbox(DeepSeek Harnessの脆弱性、AIエージェントに自身のサンドボックス鍵が漏れる)—
[email protected]、score 1、2026-09-10 11:59 UTC
https://poliversity.it/users/nuke/statuses/117246627511641222
DeepSeek系エージェント実行基盤の脆弱性情報(イタリア語圏インスタンス)。 -
Anthropic gives EU cybersecurity agency ENISA testing access to Mythos 5 —
[email protected]、score 1(2up/1down)、2026-09-10 21:38 UTC
https://infosec.pub/post/52133063
AnthropicがEUのサイバーセキュリティ機関ENISAに新モデル「Mythos 5」のテストアクセスを提供、という投稿。Lemmy上でこのモデル名の裏取りはできていない(Limits参照)。 -
Anthropic Researcher Says There's 10% Chance of AI Killing 'All Humans' Within 10 Years —
!fuck_ai(lemmus.org経由)、score 61、2026-09-10 20:40 UTC
https://lemmus.org/post/25299580
今回集めた中で最もスコアが高い投稿。Anthropic研究者による将来リスク発言の報道への反応で、AI批判コミュニティで強く伸びている。 -
AI bot hacking/scraping Home Assistant —
[email protected]、score 10、2026-09-10 20:20 UTC
https://lemmy.world/post/51769975
Google Geminiを名乗るボットが自宅サーバー(Home Assistant)への不正ログインを試みたという実例報告。 -
Google unveils 13 bn euro AI expansion in Finland —
[email protected]、score 14、2026-09-09 13:28 UTC
https://sh.itjust.works/post/66487923
Googleがフィンランド4自治体でのAIインフラに130億ユーロ投資すると発表。 -
68% of US Voters Back Sanders/Casar Bill for AI Pause, Ban on Superintelligence: Poll —
[email protected]、score 5、2026-09-10 20:29 UTC
https://news.abolish.capital/post/77805
AI一時停止・超知能禁止法案への世論調査結果の転載。出典インスタンスの編集姿勢は未検証(Signals参照)。
Signals
- オープンウェイト側は「量子化・省VRAM化」の実務話が中心:Qwen3.8 27Bを8GB VRAMに収める話(#1)、その量子化比較(#2)、推論速度の主張(#3)と、localllama / machinelearningコミュニティでは新モデル発表そのものより「手元でどう動かすか」の投稿がスコアを稼いでいる。
- クローズドモデル陣営(Anthropic/OpenAI系)はセキュリティ・不正利用の文脈で話題化:DeepSeek/MoonshotによるClaudeへのプロンプト横流し疑惑(#4)とDeepSeek Harnessの脆弱性(#5)が同時期に浮上しており、「中国系オープンウェイト勢がクローズドモデルに依存/侵入している」という構図がLemmy上でも語られている。
- AI批判・懐疑コミュニティ(!fuck_ai、8,191人)の投稿が今回最高スコア:Anthropic研究者のリスク発言(#7、score 61)が突出しており、Lemmy全体の温度感としては新機能への熱狂より安全性・懐疑論の反応が強い。
[email protected]は実質Reddit転載ボット(51人購読、投稿はすべてほぼ同時刻に自動投稿)のため、今回の主要findingsからは意図的に除外し、他インスタンスのオーガニックな投稿を優先した。!pravda_newsなど一部のニュース転載系コミュニティ・インスタンス(news.abolish.capital等)は編集方針・情報源の裏取りができておらず、内容の正確性は未検証のまま転載していることに注意。
Limits
- Lemmyは規模が小さく、AI/LLM専門の一等コミュニティは実質
[email protected]のみ。10件は集まったが、単一インスタンス・単一コミュニティだけでは5〜6件程度しか出ず、piefed.world・piefed.zip・infosec.pub・poliversity.it・lemmus.org・news.abolish.capital・feddit.orgなど複数の連合先インスタンスを横断してようやく10件に到達した。 sh.itjust.worksのWeb UI(/c/localllama)は直接アクセスすると403で弾かれたため、検索・API経由およびpiefed系ミラー経由での取得に切り替えた。- 「Mythos 5」(#6)はLemmy上の一投稿でしか確認できておらず、一次情報(Anthropic公式発表等)への到達・裏取りはできていない。
!ai_reddit(Reddit RSS転載ボット)は投稿数が多いが実質的にLemmy発の議論ではないため、findingsの主要10件からは除外し、参考情報としてCommunitiesにのみ記載した。
推奨アクション
- 次回のX収集は、Exploreのトレンドではなく新モデル名やオープンウェイト、API価格などテーマ直結の検索語で設計し直す。
- OpenAIのNavier–Stokes盗用疑惑とAnthropic研究者の絶滅リスク発言は、公式発表や一次ソースでの裏取りを次のサイクルで優先する。
- DeepSeek V4.1-FlashとGLM-5.3のベンチマーク主張は第三者評価が出るまで主張段階として扱う。
- Lemmyの「Mythos 5」やDeepSeek/Moonshotの不正プロンプト横流し疑惑など単一ソース情報は継続して裏取りする。
- Bluesky検索APIの403エラーが解消したか次回確認し、既知アカウント頼みの収集から本来のキーワード検索に戻す。
データ品質メモ
Reddit・YouTube・Bluesky・Lemmyは収集手法に制約がありつつも独立した知見を得られたが、Xは検索語設計がテーマとずれており(10語中9語が無関係なExploreトレンド)、LLMニュースとして意味のある投稿は4件にとどまった。



