inclusionAI、エージェント特化モデル「Ling-2.6-flash」をオープンソース公開
inclusionAIは5月3日、エージェント用途に最適化したインストラクトモデル「Ling-2.6-flash」のオープンソース版をHugging Faceで公開した。総パラメータ104Bのうちアクティブパラメータは7.4BというMoEアーキテクチャを採用しており、エージェントワークフローで問題となる大量のトークン消費を抑える設計となっている。
「long-reasoning」で性能上限を押し上げる流れが業界の主流になる中、Ling-2.6-flashはあえて推論効率・トークン効率・エージェント性能の3点に絞った最適化を追求する。高頻度で日常的に使われるエージェントユースケースでは、過剰な推論トークンが本当に必要なのかという問いに対する答えを示すモデルと言える。
エージェントの実運用でコストが最大の障壁になりつつある中、トークン効率に真正面から向き合ったこのアプローチは実用上の価値が高い。ベンチマークの詳細は今後の検証を待ちたい。
中国の裁判所、「労働者をAIで代替することはできない」と判断
中国の裁判所が、労働者をAIで代替することはできないとの判断を下したとFuturismが報じた。具体的には、企業が従業員を解雇してAIに置き換えることは法的に認められないという判決が出た。
AI導入が進む中、雇用との兼ね合いは各国で議論が続いている。中国はAI技術の積極的な活用を推進する一方で、今回の判決は労働者保護の観点から重要な先例となる可能性がある。「技術革新」と「労働者の権利」の境界線をどこに引くかは、日本を含む多くの国にとって共通の課題だ。
現時点では個別事案の判断とみられるが、今後同様の判断が蓄積されれば、AI導進国における法的枠組みのモデルケースになるかもしれない。
Hummingbird+:低コストFPGAでLLM推論、量産$150を実現へ
LocalLLaMAコミュニティで話題になっているのが、Hummingbird+と呼ぶFPGAベースのLLM推論アプローチだ。Qwen3-30B-A3BのQ4量子化モデルを18 tok/sで動作させ、24GBメモリを使用し、量産時のコストは$150と試算されている。
NVIDIA GPUに依存しない推論手段として、AMDやIntelのアクセラレータに続く「第3の道」としてFPGAが注目されている。特にエッジデバイスやオンプレミスでの小規模運用では、GPUの調達コストや消費電力が壁になるケースが多く、FPGAは有力な選択肢になり得る。
まだ学術論文の段階であり、実際の製品化には時間がかかる見込みだが、LLM推論のハードウェア多様化は歓迎すべき方向性と言える。
Lilly × Profluent:AI創薬で22.5億ドルの大型提携
Eli LillyとAIバイオテック企業Profluentは、遺伝子治療の「聖杯」と呼ばれる領域において22.5億ドルの提携を結んだとBioSpaceが報じた。
AI創薬はここ数年で急速に投資が拡大しており、特にタンパク質設計や遺伝子治療分野ではAIの寄与が大きいとされる。ProfluentはAIを使ってタンパク質を設計する技術を持っており、今回の大型提携は同分野の商業的成熟度を示唆している。
日本でもAI創薬スタートアップが増加しており、グローバルな動向として注目しておきたい。
最近のフィッシング攻撃の大部分がAIを活用——The Register調査
The Registerの報道によると、現代のフィッシングキャンペーンの大部分がAIを活用しているという。生成AIの普及により、自然言語での説得力の高いフィッシングメールを大量生成することが容易になり、従来のスパムフィルタをすり抜けるケースが増加している。
セキュリティ対策は「技術的な防御」だけでなく、AIが生成した文面を見分けるリテラシーも求められる時代に入った。企業のセキュリティ教育にも新たな対応が求められている。
LLM-jp-4 32B Thinkingの量子化GGUF版が公開
LLM-jpプロジェクトの「llm-jp-4-32b-a3b-thinking」(総32B / アクティブ3BのMoE、思考連鎖出力対応)を、本家の事前学習コーパスllm-jp-corpus-v4でimatrixキャリブレーションし量子化したGGUF版がHugging Faceで公開された。
一般的な汎用コーパスではなく、モデルと同じ学習コーパスを使うことで量子化精度の劣化を最小限に抑えるのが特徴。ローカルでの日本語LLM推論を試したいユーザーにとっては実用的な選択肢が増えたと言える。
参照
- Ling-2.6-flash – Hugging Face
- Chinese Court Rules That a Worker Cannot Be Replaced by AI – Futurism
- Hummingbird+: low-cost FPGAs for LLM inference – Reddit/LocalLLaMA
- Lilly, AI biotech Profluent ink $2.25B pact – BioSpace
- Bot her emails: most modern phishing campaigns are AI-enabled – The Register
- LLM-jp-4 32B Thinking GGUF – Zenn