Hacker NewsHN投稿者: cdnsteve
元記事公開:
CognitionのSWE-2がTerminal-Bench 2.1で92.8のスコアを記録
原題: Cognition's SWE-2 achieves 92.8 on Terminal-Bench 2.1
AI要約
AI開発企業CognitionのモデルSWE-2が、ソフトウェアエンジニアリングのベンチマークテストで高い精度を達成したことを報じる
重要ポイント
- •Cognition社が開発したSWE-2モデルがTerminal-Bench 2.1というベンチマークで92.8という高スコアを記録した
- •この成績は、AIが複雑なソフトウェアタスクを自律的に解決できる能力を示唆している
- •生成AIが実際の開発現場でエンジニアの補助や代替となる可能性がさらに高まった