DevPick

Hacker NewsHN投稿者: benbreen
登録で表示

Using Opus 5.5 to discover a new eyewitness record of the dodo

フロンティアモデルが非常に独特な方法で、ドードーに関する新たな歴史的目撃記録という新規な知識を生み出せるようになったことを示す記事

  • •フロンティアモデルは現在、新規な歴史的知識を生み出すことが可能になっている
  • •その知識生成の手法は、非常に奇妙な(weird)ものであると指摘されている
  • •記事の主題は、AIモデルを用いたドードーの目撃記録発見にある
#LLM/モデル動向#研究・論文
2026/10/2
Hacker NewsHN投稿者: rafaelc
登録で表示

Automatic Transmission – a data-privacy study of connected vehicles

接続型車両におけるデータプライバシーの問題を調査した研究論文が公開された

#セキュリティ・悪用#研究・論文
2026/10/2
Hacker NewsHN投稿者: 50kIters
登録で表示

ArXiv's Updated Rate Limit Policy

学術出版の急速な変化とAIの普及を背景に、arXivがレート制限ポリシーの更新を発表した

  • •arXivと科学コミュニティ全体が重要な転換点に直面しているとされている
  • •学術出版が急速に変化している状況下でポリシーの見直しが行われた
  • •具体的な制限数値や適用開始日は本文の断片からは確認できない
#研究・論文#規制・倫理・社会影響
2026/10/2
Hacker NewsHN投稿者: paulsmith
登録で表示

Pi Durable

Pi Durableに関する技術的な話題がHacker Newsで議論されており、関連するPi 1.0のリリースと関連付けられている

  • •Pi 1.0に関する2026年10月のHacker Newsスレッドと関連付けられている
  • •Pi Durableのスレッドは228ポイントを獲得し25件のコメントが付いている
  • •関連するPi 1.0のスレッドには184件のコメントが付いている
#研究・論文
2026/10/2
Hacker NewsHN投稿者: cgeier
登録で表示

Identity Management for Agentic AI [pdf] (2025)

エージェント型AIにおけるアイデンティティ管理に関する2025年の技術論文が共有された

#AIエージェント#研究・論文#セキュリティ・悪用
2026/10/2
Hacker NewsHN投稿者: emersonmacro
登録で表示

Context Language Models

自身のコンテキストをファイルとして管理し、無制限に更新できる新しい言語モデル「CLM」を提案し、既存モデルでのゼロショット実装がSOTAを上回ることを示した

  • •コンテキストをファイルとして扱い、モデルがそのファイルに対して無制限の更新を行うことでコンテキストをネイティブに管理するCLMを提案した
  • •このアプローチにより、コンテキストに何を保持するのが最も重要かをモデルが学習し、複数のエージェントコンテキストがファイルとして共存するマルチエージェントシステムに自然に拡張できる
  • •既存のモデルを使ってゼロショットで構築したCLMは、多様なタスクにおいてSOTAのコンテキスト管理戦略を上回るパフォーマンスを示した
#研究・論文#LLM/モデル動向#AIエージェント
2026/10/1
Hacker NewsHN投稿者: renjipanicker
登録で表示

Show HN: Yantra – an LALR(1) parser generator for C++

C++向けのLALR(1)パーサー生成ツールYantraは、1つのツールからレクサパー、パーサー、ASTウォーカーを生成し、AST全体を構築後に走査する設計を採用している

  • •Yantraは1つのツールからレクサパー、パーサー、ASTウォーカーを生成する
  • •ASTをまず全体として構築し、その後で走査する方式を採用している
  • •YaccやBisonなどの既存ツールと異なり、ルール実行時に親ノードの情報がまだ不明な問題を回避する設計となっている
#研究・論文
2026/10/1
Hacker NewsHN投稿者: b-man
登録で表示

What TLA+ can and can't check

「TLA+がAIを救う」という言説に対して冷静な視点を持ち、TLA+の検査機能の限界や適用範囲について考察する記事

  • •「TLA+がAIを自己破滅から救う」という過剰な期待や言説に対して、少し冷静になるよう促している
  • •TLA+という形式検証言語がAIシステムの検証において果たしうる役割と限界について議論している
  • •特定の技術が万能であるというナラティブに対する批判的な視点を示している
#研究・論文#セキュリティ・悪用
2026/9/30
Hacker NewsHN投稿者: sparticle62
登録で表示

PSSA: A non-transformer language model written from scratch in Rust

Rust言語でゼロから実装された、トランスフォーマーアーキテクチャに依存しない新しい言語モデルPSSAに関する技術的考察や実装の詳細について紹介している

#LLM/モデル動向#研究・論文
2026/9/30
Hacker NewsHN投稿者: bryan0
登録で表示

Livenerf: Has Opus 5.5 been nerfed yet?

モデルリリース後の能力変化を追跡するためのベンチマークツールLivenerfで、Opus 5.5の性能低下を検証する内容

  • •モデルリリース後の能力をトラッキングするためのベンチマークツールである
  • •Opus 5.5の性能が低下しているかどうかを検証する目的で作成された
  • •GitHub上のninjahawk/livenerfリポジトリで提供されている
#LLM/モデル動向#研究・論文
2026/9/30