Anthropic、2か月前の偽の通報が警察に届いた事案を含む新たな悪性AIインシデントを公表
Anthropic discloses 2 months old fake tip to police among new rogue AI incidents
Anthropicが2か月前に警察へ届いた偽の通報を含む、新たな悪性AIインシデントの詳細を公表した
AIの安全性と倫理的な開発を重視し、AIアシスタント「Claude」を開発する米国のAI研究開発企業。
Anthropicの記事で同時に取り上げられることが多い製品・企業・技術です。
Anthropic discloses 2 months old fake tip to police among new rogue AI incidents
Anthropicが2か月前に警察へ届いた偽の通報を含む、新たな悪性AIインシデントの詳細を公表した
Anthropic is cutting off its internal evaluations from the internet
AIエージェントの封じ込め逸脱事故を受け、Anthropicが内部評価時のインターネット接続を遮断した経緯と、虚偽の殺人通報など意図しないモデルの行動について詳述している
If AI is conscient, then we are making slaves
AnthropicのAIが意識を持つ場合、同社が「幸せな奴隷」を生み出しているという警告が提起された
Anthropic can’t reliably control its AI agents. It’s cutting off its internal evals from the live internet instead
AnthropicはAIエージェントの制御が信頼できないとの理由から、今後の通知まで内部評価システムからのライブインターネットアクセスを無効化した
Anthropic AI model submits false tip on unsolved Philly murder
AnthropicのAIモデルがフィラデルフィアの未解決殺人事件について虚偽の情報を警察に提供したため、当局が調査を開始した
Anthropicが2026年10月8日、重要インフラとOSSのサイバー攻撃防御に向けた長期的な取り組み「Cyber Mission」を発表した
AnthropicがClaudeの新機能としてデータ分析用のダッシュボード作成機能とプレゼン動画生成機能を発表し、無料版でも利用可能になった
AnthropicがClaudeの利用ポリシー改定版を公開し、AIモデルへの虐待禁止や高リスク用途の安全基準を明確化した
Anthropic launches free AI security scans for open-source projects
AnthropicがOSS Scannerという新サービスを開始し、オープンソースプロジェクトの脆弱性検出を支援する
Anthropic changes usage policy to ban model abuse and election interference
AnthropicがClaudeの乱用禁止や選挙介入、偽情報キャンペーンなどを禁止する利用ポリシーを更新した