Mistral AIが新モデルMistral Large 4の技術ドキュメントを公開し、Hacker News上で939ポイントと630件のコメントを獲得した
Mistral Large 4は、オープンウェイトのマルチモーダルモデルで、MoEアーキテクチャを採用し、総パラメータ数は1.05Tに達する
- •49Bのアクティブパラメータと1.05Tの総パラメータを持つMoEアーキテクチャを採用している
- •ビジョンエンコーダーは1.6Bパラメータで構成されている
- •オープンウェイトの汎用マルチモーダルモデルとして位置づけられている
Mistral Large 4は1兆パラメータのネイティブマルチモーダルモデルで、490億パラメータがアクティブであり、米国・欧州のオープンウェイトモデルとして最高性能を誇る
- •モデルは1Tパラメータを持ち、49Bがアクティブパラメータとして動作するネイティブマルチモーダル構成を採用している。
- •サイバーディフェンス、製造業、金融といった重要な業務向けに最先端の性能を発揮し、クローズドなフロンティアモデルを上回るとされている。
- •米国または欧州のオープンウェイトモデルとして、統合ベンチマークにおいて最良の結果を記録している。
毎月フロンティアAIの新モデルが登場する背景にある「再帰的自己改善」技術と、AIによるAI開発の現状をELYZAのCEOが解説する
- •新モデルの頻繁な登場の裏側には「再帰的自己改善」(RSI)という技術がある
- •「AIによるAI開発」が現実のものとなっている現状について言及されている
- •KDDI傘下のELYZAの曽根岡CEOが、この技術の現在地について語っている
ローカルLLM実行環境の定番ツールllama.cppがv0.6.0として公開され、新モデルGLM-5.3-Flashへの対応とMetalによる高速化が実現された
- •ggml-orgが10月5日に新モデル「GLM-5.3-Flash」をサポートしたllama.cpp v0.6.0を公開した
- •同ソフトはGitHubから無料でダウンロード可能で、ライセンスはMITが採用されている
- •Metalによる高速化機能も追加され、ローカルでのLLM実行環境がさらに進化している
OpenAIがGPT-6 AstraとGPT-6.1 Solを約50%高速化し、Codex利用者の待ち時間短縮を実現した
- •ChatGPTのサブスクリプションでCodexを使う開発者は、設定変更なしで応答までの待ち時間短縮を実感できる
- •OpenAIは10月5日に、今後28日間にわたり毎日ChatGPTおよびCodexの改善や利用枠リセットを実施すると発表していた
- •今回の高速化は、その28日間の改善計画における1日目の取り組みとして行われた
Dust: Pretraining Transformers Without Backpropagation
バックプロパゲーションを必要としない新しいTransformer事前学習手法「Dust」に関する技術的な研究や提案
VRAM 12GBのビデオカードで総パラメータ125Bの「Qwen3.8-Flash-Next」を動作させるツール「Strata」の試行結果を報告
- •総パラメータ125B、アクティブパラメータ6Bの「Qwen3.8-Flash-Next」がVRAM 12GBで動作するとの情報が広まった
- •10月に入ってAI関連の話題が賑わいをみせている
- •やや古いゲーミングPC環境で「Strata」を用いてモデルを実際に動作させた
Opus 5.5 agents discover 2 room-temperature magnetic semiconductor candidates
Claude Opus 5.5エージェントチームが次世代メモリ向けの室温磁性半導体候補2種を発見し、計算過程やコードを公開した
- •Claude Opus 5.5エージェントチームが次世代コンピュータメモリ向けの磁性体候補を2つ特定した
- •候補は1つが新設計化合物、もう1つが1999年に初めて作られた既存材料である
- •両材料とも正味磁化がゼロでありながら電子のスピンを分類できると予測されている
AIのトークン単価が低下傾向にあるにもかかわらず、企業における請求額が増加している背景にある「見えないAI浪費」の構造を分析する
- •AIのトークン単価は下がり続けてきたが、企業が支払う総請求額は増加している
- •利用者が気付かないうちに膨らむ「トークン浪費」が発生するメカニズムに焦点を当てる
- •単価低下と支出増という矛盾した現象の正体を探る