画像/動画/音声生成

画像生成・動画生成・音声合成・音楽生成AIの最新情報とツール動向をAIが要約してお届けします。

カテゴリ一覧

画像/動画/音声生成の主なトピック

このカテゴリの記事で多く取り上げられている製品・企業・技術です。

新着記事・要約(225件)

17 / 23 ページ
トップで開く
ITmedia AI+2026/9/2
AI要約

Googleが画像生成・編集ツール「Google Pics」を提供開始。基盤モデル「Nano Banana」を使用し、特定領域の編集や文字翻訳が可能でWorkspaceにも統合される。

  • •画像モデル「Nano Banana」を基盤とし、ポスター制作やSNS用画像の生成・編集を支援するツールとして提供
  • •画像内の特定オブジェクトを編集したり、写真内の文字を翻訳・修正したりする高度な機能を実装している
  • •Web版に加えGoogle Workspaceアプリにも統合され、対象となる有料プラン利用者へ順次展開される予定
#画像/動画/音声生成#生成AI活用・ツール#主要プレイヤー動向
PC Watchby 竹元 かつみ2026/9/2
AI要約

DeepSeekが画像入力に対応したV4ファミリー初のモデル「DeepSeek-V4-Flash-Vision-Exp」の実験版を公開。MITライセンスで商用利用を含む無償提供を行い、既存モデルを上回る性能を誇る。

  • •DeepSeek-V4-Flash-Vision-Expは画像入力に対応した初のV4ファミリモデルである
  • •モデルの重みはMITライセンスで公開され、商用利用を含め無償で使用可能
  • •性能は先行する「DeepSeek-V4-Flash-0731」を上回るレベルにある
#LLM/モデル動向#画像/動画/音声生成
Hacker NewsHN投稿者: johnsutor2026/9/2

Atlas: 空間知能のための世界モデル

Atlas: A World Model for Spatial Intelligence

AI要約

World Labsが空間知能を実現するための世界モデル「Atlas」を発表し、3D環境の理解と生成を可能にする技術を公開した。

  • •空間知能を実現する世界モデルAtlasが発表された
  • •3D環境の理解と生成を目的としたAI技術
  • •World Labsによる新しいアプローチの公開
#研究・論文#LLM/モデル動向#画像/動画/音声生成
TechCrunchby Sarah Perez2026/9/2

GoogleがCanvaに対抗するAIファーストのクリエイティブツール「Google Pics」を発表

Google’s answer to Canva is an AI tool where you prompt instead of design

AI要約

GoogleはCanvaやAdobeが主導するクリエイティブソフトウェア市場に参入するため、プロンプト入力だけでデザインを作成できるAIファーストのツール「Google Pics」を提供する。

  • •Googleは既存のデザインツール市場にAI優先のアプローチで新規参入を図っている
  • •ユーザーは複雑なデザイン操作ではなく、テキストプロンプトを入力するだけでデザインを作成できる
  • •CanvaやAdobeのような従来のクリエイティブツール市場で、AI生成技術による差別化を図っている
#生成AI活用・ツール#画像/動画/音声生成
The Vergeby Jess Weatherbed2026/9/2
AI要約

GoogleがWorkspace向けに「Google Pics」を提供開始。GeminiとNano Bananaモデルを活用し、プロフェッショナルなAI画像生成と編集をビジネスユーザー向けに簡素化。

  • •Canvaのようなデザインツールだが、より高度なAI機能とプロンプト制御を提供する
  • •Geminiと独自モデル「Nano Banana」を組み合わせ、画像生成の精度と制御性を向上させた
  • •ビジネスユーザーが専門知識なしで高品質な画像を編集・生成できることを目的としている
#生成AI活用・ツール#画像/動画/音声生成#主要プレイヤー動向
ITmedia2026/9/1
AI要約

fal.aiが動画生成AI「MiniMax H3 Max」を公開し、テキストや画像から音声付きの480p動画を約3秒という実時間以下で生成できる高速処理を実現した

  • •生成AI開発基盤のfal.aiが、MiniMax社の動画生成モデル「H3 Max」を無料体験ページで提供を開始した
  • •入力されたテキストや画像から、音声を含む480p解像度の5秒動画を実時間以下の約3秒で生成可能
  • •アカウント登録なしでも利用でき、登録すれば1日最大5本まで無料で生成できるため、視聴者参加型コンテンツなどの即時フィードバック用途に適している
#画像/動画/音声生成#生成AI活用・ツール
ITmedia AI+2026/9/1
AI要約

生成AI画像が消費者に「キショい」という違和感や炎上を招く背景について、危機管理広報のプロである長沼史宏氏がその本質を解説する。

  • •生成AIで作成された画像をめぐる炎上や消費者の違和感が社会問題化している
  • •製造メーカーやIT企業の危機管理広報に携わる長沼史宏氏が分析を行う
  • •AI画像特有の違和感が生まれる心理的・技術的な背景が解説される
#画像/動画/音声生成#規制・倫理・社会影響
Hacker NewsHN投稿者: keithcarolus2026/9/1
AI要約

単一のHTMLファイルで動作するASCIIアートによるサイバーパンク都市の3D表現が公開され、ブラウザ上でインタラクティブに探索できる

  • •テキスト文字のみで構成された3D都市空間を、軽量なHTMLとJavaScriptで実装したプロジェクトが紹介されている
  • •ユーザーはブラウザ上でキャラクターを操作し、建物の内部や高層ビルなどを探索できるインタラクティブ性を備える
  • •最新のアップデートでは交通システムや詳細な装飾が追加され、レトロな美学と現代のWeb技術の融合を示している
#画像/動画/音声生成#生成AI活用・ツール
Hacker NewsHN投稿者: metrofun2026/8/31
AI要約

オープンソース動画編集ソフトOpenShotのメジャーアップデート版4.0がリリースされ、録画機能の強化や新しいカラーグレーディングツールが追加された

  • •新しい録画機能により、スクリーンキャプチャやカメラ入力からの直接録画が容易になった
  • •カラーグレーディング機能が刷新され、より直感的かつ高度な色調整が可能となった
  • •ユーザーインターフェースの改善により、初心者から上級者まで快適に動画編集を行える環境が整えられた
#画像/動画/音声生成#生成AI活用・ツール
PC Watchby 劉 尭2026/8/31
AI要約

Googleが動画生成AI「Gemini Omni 1.1 Flash」を発表。キャラクターの整合性を維持しながら高品質な動画を作成可能とし、クリエイター向け機能を強化した。

  • •生成された動画内でキャラクターの外見や特性がブレるという課題に対し、整合性を維持する技術を搭載した
  • •クリエイターおよび開発者向けに、動画生成だけでなく編集機能も強化されたモデルとして公開された
  • •米国時間8月27日に発表され、既存の動画生成AIの弱点である一貫性の欠如を改善する狙いがある
#画像/動画/音声生成#LLM/モデル動向#主要プレイヤー動向