DevPick

Hacker NewsHN投稿者: malshe
登録で表示

Open-sourcing AstaBrief, the fast report-generation model in Asta

Astaの高速モードで利用可能な、引用付き科学レポートを生成する8Bパラメータのオープンウェイトモデル「AstaBrief」が公開された

  • •AstaBriefは8Bパラメータのオープンウェイトモデルとしてリリースされた
  • •このモデルは引用付きの科学レポート生成に特化している
  • •AstaのFastモードで利用可能であるほか、自前のインフラストラクチャでダウンロードして実行することも可能
#LLM/モデル動向#主要プレイヤー動向
2026/10/3
Hacker NewsHN投稿者: fibo
登録で表示

From the creator of Redis; run LLM locally with ds4

Redisの創始者antirezが開発したC言語製推論エンジンds4について、DeepSeek V4などのモデルをローカルで実行するドキュメントやベンチマークを解説した

  • •ds4はDeepSeek V4/V4.1、Qwen3.8 Flash Next、GLM 5.xに対応したC言語製の推論エンジンである
  • •Metal、CUDA、ROCmといった異なるハードウェア環境での動作をサポートしている
  • •ds4に関するドキュメント、ベンチマーク結果、セットアップ手順が公開されている
#生成AI活用・ツール#LLM/モデル動向
2026/10/3
Hacker NewsHN投稿者: ThibWeb
登録で表示

One month coding with GLM 5.3 Flash

GLM 5.3 Flashを1ヶ月間コーディングに使用した報告で、20億トークンの利用実績とモデル選定やコストに影響する要因を解説した

  • •1ヶ月間のコーディングで合計20億トークンのAI利用があった
  • •モデルの選定基準やコスト構造に影響を与える要素について分析した
#生成AI活用・ツール#LLM/モデル動向
2026/10/3
Hacker NewsHN投稿者: dblack12705
登録で表示

How accurately calibrated is Jev?

物理的に現実的な確率分布を生成させることで、AIモデルJevの確率予測の正確性(キャリブレーション)を検証した

  • •物理的に現実的な確率分布の生成を要求することでJevの性能をテストした
  • •モデルの確率出力が実際の物理現象とどれだけ整合しているかを評価した
#研究・論文#LLM/モデル動向
2026/10/3

OpenAIのChatGPTがGPT-6.1 Solの動作遅延を理由に、日本時間10月4日午前2時にリセットされる予定であることが発表された

  • •OpenAIのThibault Sottiaux氏が10月2日、X上でリセットの予告を行った
  • •リセットの理由はGPT-6.1 Solにおける動作遅延への対応とされている
  • •実施予定時刻は日本時間10月4日午前2時(米国時間10月3日)に設定されている
#主要プレイヤー動向#LLM/モデル動向
2026/10/2

KDDI傘下のELYZAが、オープンモデル「LLM-jp-4」をベースに性能を強化した完全国産AIモデルを無料公開した

  • •KDDIグループのAI開発企業ELYZAが、AIモデル「ELYZA-Thinking-1.0-llm-jp-4-33b」および「ELYZA-Thinking-1.0-llm-jp-4-32b-a3b」を発表した
  • •国立情報学研究所が開発したオープンなAIモデル「LLM-jp-4」シリーズをベースにしている
  • •ベースモデルに対して事後学習を実施し、性能を強化した
#LLM/モデル動向#AI企業・資金調達
2026/10/2

テキスト生成をせず分類やルーティングの判断のみを高速に返す「意思決定モデル」が注目され、Typesafe AIの「Jev」をきっかけに互換モデルや対応実装が相次いで登場している

  • •テキストを1トークンも生成せず、分類やルーティングといった判断だけを高速に返す「意思決定モデル」が盛り上がりを見せている
  • •Typesafe AIの「Jev」がこのジャンルの火付け役となった
  • •「Jev」に続く形で、互換モデルや対応実装が相次いで登場している
#LLM/モデル動向#主要プレイヤー動向
2026/10/2

AlibabaのQwen3.8-Flash-NextをゲーミングPCで高速実行する推論エンジン「Strata」が公開され、秒間60~95トークンで動作

  • •総パラメータ125B、アクティブパラメータ6BのQwen3.8-Flash-Nextが、ビデオカード1枚のゲーミングPCで動作する
  • •推論エンジン「Strata」により、秒間60~95トークンの速度で高速に実行できる
  • •開発者のNiko1221氏がGitHubで公開し、ライセンスはMITとなっている
#LLM/モデル動向#半導体・インフラ
2026/10/2

Googleが新AIモデル「Gemini 4 Argon」を発表し、自社評価では競合モデルを多くの項目で上回るとしている

  • •Googleが新AIモデル「Gemini 4 Argon」を発表した
  • •自社評価ではAstraやFable 5.1、Opus 5.5を多くの項目で上回る性能を有すると主張している
  • •当面はサイバー防御組織などに限定提供し、一般提供は「できるだけ早く」としている
#LLM/モデル動向#主要プレイヤー動向
2026/10/2
Hacker NewsHN投稿者: usernomdeguerre
登録で表示

Greg Kroah-Hartman – Security in the LLM Age [video]

Greg Kroah-Hartmanによる、大規模言語モデル(LLM)の普及に伴うセキュリティ課題や影響について考察する動画コンテンツ

#セキュリティ・悪用#LLM/モデル動向
2026/10/2