Redditが23%急落、AIがユーザー成長を喰う構図
Redditの株価が1日で23%下落する急落を見せました。報道では、AIによる検索や要約がユーザーの伸びを圧迫しているとの見方が背景にあると指摘されています。
プラットフォームにとって、ユーザーが直接アプリを開くのではなくAIの回答で事足りるようになることは、長期的な成長の足かせになり得ます。今回の下落がどこまでAI起因かは断定できませんが、AIがトラフィックの構造そのものを変えつつあることを示す一つの材料と言えそうです。
WSJが振り返る「OpenAIが失ったAIの覇権」
ウォール・ストリート・ジャーナル(WSJ)が、OpenAIがかつて握っていた優位性が揺らぎ、再び覇権を奪還しようとする過程を長編でまとめました。
リリース戦略、競合の台頭、人材と資金の動向などがテーマとみられますが、記事本文は有料設定で、今回の収集データだけでは詳細が確認できていません。業界の主導権争いが流動化しているという大局観を伝える記事として、位置づけは留保しておきます。
ローカルLLM最前線:Qwen 3.6 27B をRTX 2080 Ti×3で55 tps
RedditのLocalLLaMAコミュニティで、Qwen3.6-27B(Q5_K_S量子化)を3枚のRTX 2080 Tiで1秒あたり55トークン(55 tps)で動かした実例が共有されました。構成はThreadripper 3970X、メモリ128GB、GPUは2080 Ti 11GB×3枚。
投稿者は、テンソル分割(tensor split)とフラッシュアテンションの有効化、KVキャッシュのq8量子化、推測デコード(draft-MTP)などを組み合わせて速度を引き出しています。「これ以上絞れるか」という相談を兼ねた知見の共有で、中古の2080 Tiでもミドルクラスのモデルを高速に回せる実践例として参考になります。
1BクラスのLLMは2026年に消えるのか
同じくLocalLLaMAで「1BクラスのLLMは2026年に消えていくのか」という議論が立ち上がりました。
投稿者は、Gemma 4では1Bモデルが用意されず、Llamaも1Bの更新がなく、Qwenも最近のリリースでは1B帯を狙っていない点を指摘。現状ではGemma 3 1Bが実用的なベストの1つと評価する一方、Bonsaiの三値(ternary)LLMはハルシネーションが多く信頼性に欠けるという実感も示されています。
小型・端末向けモデルの方向性が、単なるパラメータ削減から別の設計へ移り変わっている可能性を示唆する、興味深い観点です。