画像/動画/音声生成

画像生成・動画生成・音声合成・音楽生成AIの最新情報とツール動向をAIが要約してお届けします。

カテゴリ一覧

画像/動画/音声生成の主なトピック

このカテゴリの記事で多く取り上げられている製品・企業・技術です。

新着記事・要約(225件)

3 / 23 ページ
トップで開く
Hacker NewsHN投稿者: ishan01022026/10/6
AI要約

12人のジャズピアニストのスタイルで演奏を継続する音楽モデルと、スタイルが最も認識しやすい瞬間についての研究が発表された

  • •12人のジャズピアニストのスタイルで演奏を継続する音楽モデルが開発・検証された
  • •モデルの性能評価としてブラインドテストが実施されたとされている
  • •各ピアニストのスタイルが最も認識しやすい瞬間について分析が行われた
TechCrunchby Sarah Perez2026/10/6

OpenAI、画像生成結果と併せて表示されるビジュアル広告を開始

OpenAI launches visual ads that appear alongside image generation results

AI要約

OpenAIは、画像生成の結果が表示された後にビジュアル広告を表示する新機能を米国限定で開始した

  • •画像生成の結果が表示された後に広告が表示される仕組みである
  • •現在この機能は米国でのみ提供されている
  • •OpenAIが新しい収益化手段としてビジュアル広告を導入した
#画像/動画/音声生成#主要プレイヤー動向#ビジネス活用事例
Hacker NewsHN投稿者: allenleee2026/10/4

Show HN: macOSでの全写真と動画の全フレームを対象としたAI検索

Show HN: AI search for every photo and every frame of video on macOS

AI要約

macOS上で任意のフォルダ内のすべての写真や動画のフレームを、ディープAI検索で深掘りできるツールが共有された

  • •macOS環境下で動作するAI検索ツールとして提供されている
  • •対象は任意のフォルダ内に保存されているすべての写真である
  • •動画については1フレーム単位での深層検索に対応している
#生成AI活用・ツール#画像/動画/音声生成
Hacker NewsHN投稿者: porridgeraisin2026/10/3

AI動画が法廷で示されたため、米国の殺人犯の判決が取り消された

US killer's sentence quashed because of AI video of victim shown in court

AI要約

故人の被害者からAI生成のメッセージ動画が法廷で再生されたことを理由に、アリゾナ州控訴裁判所が判決を無効とした

  • •故人の被害者からのAI生成メッセージが法廷で再生された
  • •アリゾナ州控訴裁判所がその使用は「線を越えた」と判断した
  • •このAI動画の提示を理由に殺人犯の判決が取り消された
#規制・倫理・社会影響#画像/動画/音声生成
TechCrunchby Connie Loizos2026/10/3

Sean Parker、Stability AIを音楽を中心に再構築

Sean Parker is rebuilding Stability AI around music

AI要約

Sean Parkerがレコードレーベルの祝福と資金を得て、Stability AIを音楽分野を中心に再構築する取り組みを進めている

  • •Sean Parkerはかつて音楽業界に「後から許しを乞う」ことを教えてきた人物である
  • •現在、彼はレコードレーベルの祝福と資金を得て、Stability AIを音楽を中心に再構築している
#AI企業・資金調達#画像/動画/音声生成#主要プレイヤー動向
Hacker NewsHN投稿者: antelocnova2026/10/3

Show HN: オープンソースのレゴAIジェネレーター

Show HN: Made an open-source Lego AI generator

AI要約

ChatGPTやClaudeを用いてLDraw言語でレゴモデルのソースコードを生成し、CADモデルに変換するオープンソースツール

  • •ChatGPTやClaudeがLDraw言語でレゴの組立手順を記述したソースコードを生成する
  • •LDrawはレゴパーツの配置を低レベルで記述する言語であり、LDViewやLeoCADなどで実行可能
  • •生成されたコードはインタラクティブに操作・修正できるレゴCADモデルとして変換される
#生成AI活用・ツール#画像/動画/音声生成
TechCrunchby Russell Brandom2026/10/3

レオ14世教皇はAI生成アートに否定的

Pope Leo XIV is not a fan of AI-generated art

AI要約

レオ14世教皇が、他人の画像データに基づく統計計算で生成されるAI作品と人間の芸術には本質的な違いがあると述べ、アルゴリズムには人間性が欠如していると批判した

  • •教皇は、他人が作成した数百万枚の画像に基づく統計計算で機械が生成するものとの間には、審美的な違いの前に存在論的な違いがあると記述した
  • •アルゴリズムには人間性の火花が欠如していると指摘している
  • •AI生成アートに対する教皇の否定的な立場を表明した
#規制・倫理・社会影響#画像/動画/音声生成
The Vergeby Jess Weatherbed2026/10/2
AI要約

AI音楽生成サービスSunoが、スクリプトやプロンプトから話し言葉を生成する新機能を公開ベータとして提供開始した

  • •SunoのWeb版およびモバイル版で、スクリプトやプロンプト記述に基づいた音声生成機能が利用可能になった
  • •生成されたナレーション音声と背景音楽を同時に生成できる機能が含まれている
  • •同社は音楽生成が引き続きサービスの中心であることを強調している
#画像/動画/音声生成#主要プレイヤー動向
ITmedia AI+2026/10/2
AI要約

Microsoft AIが低遅延な逐次認識に対応するストリーミング文字起こしモデルと、声のトーンを保った多言語音声合成モデル群を公開し、音声エージェント構築を想定した技術としてMicrosoft Foundryでのプレビュー提供を開始した。

  • •低遅延な逐次認識に対応したストリーミング文字起こしモデル「MAI-Transcribe-2-Streaming」が発表された
  • •声のトーンを保った多言語合成に対応する音声合成モデル群が同時に公開された
  • •Microsoft Foundryでのプレビュー提供が始まり、音声エージェント構築を想定した複合デモも公開された
#画像/動画/音声生成#主要プレイヤー動向#AIエージェント