DevPick

毎月フロンティアAIの新モデルが登場する背景にある「再帰的自己改善」技術と、AIによるAI開発の現状をELYZAのCEOが解説する

  • •新モデルの頻繁な登場の裏側には「再帰的自己改善」(RSI)という技術がある
  • •「AIによるAI開発」が現実のものとなっている現状について言及されている
  • •KDDI傘下のELYZAの曽根岡CEOが、この技術の現在地について語っている
#LLM/モデル動向#研究・論文#主要プレイヤー動向
2026/10/6
Hacker NewsHN投稿者: bryan0
登録で表示

AI Tutoring with Khanmigo in a Two-Year School Experiment

テネシー州の18校で実施された2年間の無作為化試験により、AIチューターKhanmigoを活用した教育への影響に関する大規模な実験証拠が示された

  • •テネシー州の18の中学校で、2年間にわたるクラスター無作為化試験が実施された
  • •生徒は既存の日常補習数学セッションにおいて、答えを教えるのではなくコーチングするよう設定されたKhanmigoを使用した
  • •生成AIが教育を変革する技術として期待される中、大規模な実験証拠の一部が提供された
#研究・論文#規制・倫理・社会影響
2026/10/6
Hacker NewsHN投稿者: ibobev
登録で表示

Ephemeral Testing

AIエージェントがコードを書き、ソフトウェアコンポーネントを構築する前提で、一時的なテスト手法であるエフェメラルテストを提案する記事

  • •ユニットテストやファジテスト、統合テストなど既存の品質保証手法を前提にしている
  • •AIエージェントがコードを書き、コンポーネントを構築する状況を想定している
  • •「捨てられる」または「一時的な」という意味のエフェメラルテストという手法を提案している
#研究・論文#AIエージェント
2026/10/6

産総研がCEATEC 2026に「人口減少・高齢化社会を再設計するテクノロジー」をテーマに出展し、モアレ画像によるたわみ測定や転倒リスク判定などの研究成果を体験できる展示を行う

  • •10月13日~16日に幕張メッセで開催されるCEATEC 2026に、産総研がホール4のブース4H621に出展する
  • •昨年の量子・AI技術に絞った展示から一変し、今年は「人口減少・高齢化社会を再設計するテクノロジー」をテーマとする
  • •モアレ画像でのたわみ測定や座った状態での転倒リスク判定など、研究成果を来場者が体験できる展示やデモが用意される
#研究・論文#主要プレイヤー動向
2026/10/6
Hacker NewsHN投稿者: ishan0102
登録で表示

Learning Jazz Pianist Style with Cross-Attention Conditioning

12人のジャズピアニストのスタイルで演奏を継続する音楽モデルと、スタイルが最も認識しやすい瞬間についての研究が発表された

  • •12人のジャズピアニストのスタイルで演奏を継続する音楽モデルが開発・検証された
  • •モデルの性能評価としてブラインドテストが実施されたとされている
  • •各ピアニストのスタイルが最も認識しやすい瞬間について分析が行われた
#研究・論文#画像/動画/音声生成
2026/10/6
Hacker NewsHN投稿者: E-Reverance
登録で表示

Dust: Pretraining Transformers Without Backpropagation

バックプロパゲーションを必要としない新しいTransformer事前学習手法「Dust」に関する技術的な研究や提案

#研究・論文#LLM/モデル動向
2026/10/6
Hacker NewsHN投稿者: outlier99
登録で表示

Opus 5.5 agents discover 2 room-temperature magnetic semiconductor candidates

Claude Opus 5.5エージェントチームが次世代メモリ向けの室温磁性半導体候補2種を発見し、計算過程やコードを公開した

  • •Claude Opus 5.5エージェントチームが次世代コンピュータメモリ向けの磁性体候補を2つ特定した
  • •候補は1つが新設計化合物、もう1つが1999年に初めて作られた既存材料である
  • •両材料とも正味磁化がゼロでありながら電子のスピンを分類できると予測されている
#研究・論文#LLM/モデル動向
2026/10/6
The Vergeby Robert Hart
登録で表示

All the drama around AI’s takeover of mathematics

OpenAIやAnthropicなどのAIラボが長年の数学的問題の解決を発表し、研究者の期待を超えた成果を出したが、その急激な進歩に伴う課題や議論が起きている

  • •OpenAI、Anthropicなどのラボが長年の数学的問題に対する突破を発表した
  • •一部の成果は現在のシステムが持つとされていた能力を大きく超えており、ミレニアム懸賞問題の一つを解決した
  • •AIラボは急速に動き、問題を壊しながら進んでいる(moving fast and breaking things)様相を呈している
#研究・論文#主要プレイヤー動向
2026/10/6
GitHub Blogby Michelle Zhou
登録で表示

ReviewBench: An open benchmark for AI code review

GitHubが、代表的なプルリクエストと多様な正解データに基づいたAIコードレビューエージェントの性能評価ベンチマーク「ReviewBench」を公開した

  • •代表的なGitHubのプルリクエストを基に構築されたベンチマークである
  • •多様なソースからの正解データを用いた評価体系を採用している
  • •生産環境に即した指標を用いた較正された評価が特徴である
#研究・論文#AIエージェント#主要プレイヤー動向
2026/10/6
Hacker NewsHN投稿者: signa11
登録で表示

Homa: The End of TCP for AI Clusters [video]

AIクラスター向けにTCPの代替となる新しいネットワークプロトコルHomaに関する動画

  • •AIクラスター向けにTCPに代わる新しいネットワークプロトコルとしてHomaが紹介されている
  • •関連記事としてThe RegisterによるStanford大学関連の報道が参照されている
  • •Hacker News上で10ポイントと1つのコメントを獲得している
#半導体・インフラ#研究・論文
2026/10/5