Hacker NewsHN投稿者: ishan01022026/10/6
Learning Jazz Pianist Style with Cross-Attention Conditioning
12人のジャズピアニストのスタイルで演奏を継続する音楽モデルと、スタイルが最も認識しやすい瞬間についての研究が発表された
- •12人のジャズピアニストのスタイルで演奏を継続する音楽モデルが開発・検証された
- •モデルの性能評価としてブラインドテストが実施されたとされている
- •各ピアニストのスタイルが最も認識しやすい瞬間について分析が行われた
TechCrunchby Sarah Perez2026/10/6
OpenAI launches visual ads that appear alongside image generation results
OpenAIは、画像生成の結果が表示された後にビジュアル広告を表示する新機能を米国限定で開始した
- •画像生成の結果が表示された後に広告が表示される仕組みである
- •現在この機能は米国でのみ提供されている
- •OpenAIが新しい収益化手段としてビジュアル広告を導入した
#画像/動画/音声生成#主要プレイヤー動向#ビジネス活用事例 Hacker NewsHN投稿者: allenleee2026/10/4
Show HN: AI search for every photo and every frame of video on macOS
macOS上で任意のフォルダ内のすべての写真や動画のフレームを、ディープAI検索で深掘りできるツールが共有された
- •macOS環境下で動作するAI検索ツールとして提供されている
- •対象は任意のフォルダ内に保存されているすべての写真である
- •動画については1フレーム単位での深層検索に対応している
Hacker NewsHN投稿者: porridgeraisin2026/10/3
US killer's sentence quashed because of AI video of victim shown in court
故人の被害者からAI生成のメッセージ動画が法廷で再生されたことを理由に、アリゾナ州控訴裁判所が判決を無効とした
- •故人の被害者からのAI生成メッセージが法廷で再生された
- •アリゾナ州控訴裁判所がその使用は「線を越えた」と判断した
- •このAI動画の提示を理由に殺人犯の判決が取り消された
TechCrunchby Connie Loizos2026/10/3
Sean Parker is rebuilding Stability AI around music
Sean Parkerがレコードレーベルの祝福と資金を得て、Stability AIを音楽分野を中心に再構築する取り組みを進めている
- •Sean Parkerはかつて音楽業界に「後から許しを乞う」ことを教えてきた人物である
- •現在、彼はレコードレーベルの祝福と資金を得て、Stability AIを音楽を中心に再構築している
#AI企業・資金調達#画像/動画/音声生成#主要プレイヤー動向 Hacker NewsHN投稿者: antelocnova2026/10/3
Show HN: Made an open-source Lego AI generator
ChatGPTやClaudeを用いてLDraw言語でレゴモデルのソースコードを生成し、CADモデルに変換するオープンソースツール
- •ChatGPTやClaudeがLDraw言語でレゴの組立手順を記述したソースコードを生成する
- •LDrawはレゴパーツの配置を低レベルで記述する言語であり、LDViewやLeoCADなどで実行可能
- •生成されたコードはインタラクティブに操作・修正できるレゴCADモデルとして変換される
TechCrunchby Russell Brandom2026/10/3
Pope Leo XIV is not a fan of AI-generated art
レオ14世教皇が、他人の画像データに基づく統計計算で生成されるAI作品と人間の芸術には本質的な違いがあると述べ、アルゴリズムには人間性が欠如していると批判した
- •教皇は、他人が作成した数百万枚の画像に基づく統計計算で機械が生成するものとの間には、審美的な違いの前に存在論的な違いがあると記述した
- •アルゴリズムには人間性の火花が欠如していると指摘している
- •AI生成アートに対する教皇の否定的な立場を表明した
The Vergeby Jess Weatherbed2026/10/2
AI music maker Suno now generates spoken words
AI音楽生成サービスSunoが、スクリプトやプロンプトから話し言葉を生成する新機能を公開ベータとして提供開始した
- •SunoのWeb版およびモバイル版で、スクリプトやプロンプト記述に基づいた音声生成機能が利用可能になった
- •生成されたナレーション音声と背景音楽を同時に生成できる機能が含まれている
- •同社は音楽生成が引き続きサービスの中心であることを強調している
CodeZine2026/10/2
Google Vidsにおいて、字幕のフォントや表示位置、アニメーションをカスタマイズできる機能が追加された
ITmedia AI+2026/10/2
Microsoft AIが低遅延な逐次認識に対応するストリーミング文字起こしモデルと、声のトーンを保った多言語音声合成モデル群を公開し、音声エージェント構築を想定した技術としてMicrosoft Foundryでのプレビュー提供を開始した。
- •低遅延な逐次認識に対応したストリーミング文字起こしモデル「MAI-Transcribe-2-Streaming」が発表された
- •声のトーンを保った多言語合成に対応する音声合成モデル群が同時に公開された
- •Microsoft Foundryでのプレビュー提供が始まり、音声エージェント構築を想定した複合デモも公開された
#画像/動画/音声生成#主要プレイヤー動向#AIエージェント