画像/動画/音声生成

画像生成・動画生成・音声合成・音楽生成AIの最新情報とツール動向をAIが要約してお届けします。

カテゴリ一覧

画像/動画/音声生成の主なトピック

このカテゴリの記事で多く取り上げられている製品・企業・技術です。

新着記事・要約(225件)

6 / 23 ページ
トップで開く
The Vergeby Terrence O’Brien2026/9/28

EngramはAIのハルシネーションを音楽に変えるサンプラー

Engram is a sampler that turns broken AI hallucinations into music

AI要約

音楽スタートアップのThoughtful Thingsが、AIを用いて入力音声を加工し新しい音を生み出すサンプラー兼グルーブボックス「Engram」のKickstarterキャンペーンを開始した

  • •Thoughtful Thingsは、AIを活用して既存の音声を歪ませたり、完全に新しい音声をハルシネーションで生成したりするデバイス「Engram」を発表した
  • •この製品はボタンを押すだけで完成曲を作るSunoのようなデバイスではなく、音作りを重視したサンプラーおよびグルーブボックスとして位置づけられている
  • •トップ40チャートに載るような完成品を作ることを目的とせず、クリエイティブな音源生成に焦点を当てた設計となっている
#画像/動画/音声生成#生成AI活用・ツール
TechCrunchby Dominic-Madori Davis2026/9/26

自分のインタラクティブなデジタルアバターを作成し、会話可能にした

I created an interactive digital avatar of myself — and you can talk to it

AI要約

ベンチャー詐欺に関する会話を可能にトレーニングしたインタラクティブなデジタルアバターを作成し、AIによる自己クローン化について複雑な感情を抱いた体験談。

  • •ベンチャー詐欺について議論できるような形でインタラクティブなアバターを取得し、トレーニングを行った
  • •AIによる自分自身のクローン(デジタルアバター)を作成することに対して、複雑な感情を抱いている
  • •作成したアバターと対話できるインタラクティブな機能を実装している
#生成AI活用・ツール#画像/動画/音声生成
ITmedia2026/9/26
AI要約

日本のアニメ制作に携わる外国人スタッフの現状を取材し、永住許可手数料の大幅引き上げやAI技術の普及がもたらす不安について考察している

  • •10月より永住許可の手数料が20倍に引き上げられる制度変更が、在日外国人スタッフに不安を与えている
  • •来日20年近いロシア出身のベテラン声優と、来日7カ月のフランス出身新人アニメーターの2名に話を聞いている
  • •AI技術への向き合い方と日本の制度に対する思いが、それぞれの立場から異なる形で浮かび上がっている
#規制・倫理・社会影響#画像/動画/音声生成
The Vergeby Terrence O’Brien2026/9/26

ソニーとUMG、Sunoを再び提訴

Sony and UMG are suing Suno again

AI要約

ソニーとユニバーサルミュージックグループが、新モデルv6が著作権を侵害していると主張し、Sunoに対して再び訴訟を提起した

  • •Sunoの新モデルv6が、以前のモデルからのユーザー出力を学習素材として使用しているため、依然として著作権を侵害しているとレーベル側は主張している
  • •以前のモデルは、YouTubeなどのソースから無断で取得された音楽で学習されていた
  • •ソニーとUMGは、Sunoとライセンス契約を結ばなかった notable な保留派(holdouts)である
#規制・倫理・社会影響#画像/動画/音声生成#AI企業・資金調達
クラウド Watchby 石井 一志2026/9/25
AI要約

NECネッツエスアイが、AI技術を活用して等身大に近い3D映像を実現するビデオコミュニケーションツール「HP Dimension with Google Beam」の国内提供を10月から開始すると発表。

  • •NECネッツエスアイは、3D映像によるビデオコミュニケーションソリューション「HP Dimension with Google Beam」の取り扱いを開始する。
  • •このソリューションは、AIを活用することでユーザーに近い等身大の3D映像を生成し、臨場感のあるコミュニケーションを実現する。
  • •日本国内での正式な提供開始は10月以降を予定しており、法人向けの新しい通信手段として展開される。
#画像/動画/音声生成#主要プレイヤー動向
PC Watchby 竹元 かつみ2026/9/25
AI要約

NVIDIAが会議録音での話者分離に特化した小型AIモデル「Nemotron 3 Diarization」を無償公開し、最大8人の話者追跡と商用利用を可能にした。

  • •パラメータ数が0.1B(1億)の小型モデルであり、9月24日に無償公開された
  • •声が重なっている場面でも最大8人の話者を追跡・識別できる機能を持つ
  • •モデルの重みはHugging Faceからダウンロード可能で、商用利用も認められている
#LLM/モデル動向#画像/動画/音声生成
ITmedia AI+2026/9/25
AI要約

GoogleがGemini Enterprise経由で、リアルタイム音声対話と動画生成アバターを統合した新機能を展開した内容です。

  • •写真1枚から自然に応答する独自のアバターを生成できる機能を備えている。
  • •多言語対応や非同期ツール実行が可能で、柔軟な運用を実現する。
  • •顧客対応や店頭端末といった商用シーンでの活用を想定している。
#画像/動画/音声生成#主要プレイヤー動向#ビジネス活用事例
INTERNET Watchby 渡邊 悠太2026/9/25
AI要約

メガネトップがAI機能搭載のカメラ付きARグラス「Linse Display」を発表し、10月にクラウドファンディングで先行予約を開始する

  • •株式会社メガネトップは9月24日、スマートグラス「Linse」の後継機であるARグラス「Linse Display」を発表した
  • •製品の価格は11万9000円と設定されており、AI機能が搭載されている
  • •10月23日よりクラウドファンディングサイト「GREEN FUNDING」で先行予約を開始し、その後全国店舗で販売予定
#ビジネス活用事例#画像/動画/音声生成
PC Watchby トライゼット西川 善司2026/9/25
AI要約

NVIDIAがDLSS 5の技術詳細を開示し、ゲーム画像の陰影が1回の推論で描き起こされる画像生成AIであることが判明した

  • •DLSS 5では、肌や髪の陰影が描画結果の復元ではなく、実写写真から学習したAIが1回の推論で生成する
  • •NVIDIAは2026年3月に存在を明らかにしたDLSS 5について、2026年9月3日に技術的詳細を多く開示した
  • •この技術は3D誘導型の仕組みを持ち、従来のDLSSとは異なるアプローチを採用している
#画像/動画/音声生成#半導体・インフラ#主要プレイヤー動向
Hacker NewsHN投稿者: iacguy2026/9/25

Opus 5.5は解説動画の作成に優れている

Opus 5.5 is good at explainer videos

AI要約

URLやプロンプトを入力するだけで、OpenComputerのサーバーレスエージェント上でOpus 5.5が解説動画を執筆・レンダリングする手法が紹介されている。

  • •URLまたはプロンプトを入力するだけで、Opus 5.5が動画の構成とレンダリングを行う
  • •処理はOpenComputerのサーバーレスエージェント上で行われ、専用の動画生成モデルは使用されていない
  • •この手法により、テキストベースのAIモデルだけで発足動画などのコンテンツ生成が可能になる
#画像/動画/音声生成#AIエージェント