3DモデリングソフトBlenderのスカルプトモードの基本的な機能と操作方法をイラストを用いて解説し、デジタル彫刻の基礎知識を習得するための入門ガイドを提供
- •Blenderのスカルプトモードにおける主要なツールやブラシの種類とその役割を視覚的に説明している
- •初心者向けに3Dモデルを粘土のように変形させるデジタル彫刻のワークフローを段階的に紹介
- •複雑な形状を直感的に作成するための具体的な設定方法や操作テクニックが記載されている
成人向けECサイト「FANZA」で生成AIを活用した漫画制作・公開サービス「FANZAスタジオ」の先行体験が開始された。漫画家からは技術への懸念と期待が交錯している。
- •「FANZAスタジオ」は生成AIを用いて成人向け漫画を作成し、プラットフォーム上で公開できるサービスである
- •業界関係者からはAI生成コンテンツの質や倫理面への懸念の声が上がっている
- •一方で、創作のハードル低下や新しい表現の可能性への期待感も同時に示されている
テンセントがマルチモーダルAIモデル「Hy4」のプレビュー版を公開し、オープンソース化を発表。動画生成や高度な視覚認識能力を備え、コミュニティでの検証と改良を促す取り組みである
- •テンセントが開発した次世代マルチモーダルモデルHy4がプレビュー版として公開された
- •モデルはオープンソースとして提供され、研究者や開発者によるアクセスが容易になっている
- •動画生成および複雑な視覚タスクにおける性能向上が主な特徴として挙げられている
Hollywood celebs are getting into microdrama apps
複数のハリウッド著名人が、高額な映画出演料ではなく、短編動画中心のマイクロドラマアプリへの出演を選択。新しいメディアフォーマットにおける収益機会と視聴者との距離の近さを重視している。
- •伝統的な映画製作よりも制作コストが低く、回転が早いマイクロドラマ市場がセレブリティの関心を引いている
- •アプリ内での直接的なファンエンゲージメントや、新しい収益モデルの可能性が参画理由となっている
- •エンタメ業界の潮流が、長尺コンテンツから短尺・高頻度配信のデジタルネイティブな形式へシフトしつつある
人間の知覚における色の特性を数学的・科学的に定量化する方法や、色彩空間における色の距離や類似性を数値で表現する理論的背景について解説している
- •色の主観的な知覚を客観的な数値データとして扱うための色彩科学の基礎的な概念が紹介されている
- •異なる色間の差異を計算するアルゴリズムや、色彩管理システムでの応用例について言及されている
- •デジタル画像処理やデザインツールにおいて、色の精度を高めるための技術的アプローチが含まれている
Musicians-turned-detectives are hunting for AI grifters
AI生成音楽の増加に伴い、音楽家が著作権侵害やAI使用の隠蔽を疑うコンテンツを特定し、製作者を特定する活動を活発化させている
- •音声生成AIの進化により、人間アーティストの作品を模したAI生成音楽がインターネット上で溢れている
- •AI使用を認めるケースと、隠蔽して利益を得ようとするケースが存在し、後者が問題視されている
- •音楽家自身が「探偵」役となり、アルゴリズム由来のメロディやボーカルを特定して製作者を追求している
Googleが「Gemini 3.5 Transcribe」をリリースし、言いよどみ除去や背景雑音補正により高音質な文字起こしを実現
- •「えーと」などの言いよどみを自動的に除去する機能を実装している
- •背景雑音や専門用語、言い直しに対する補正能力を備えている
- •生の音声をフォーマット済みテキストへ直接変換する処理を行う
映像監督が明治のCM制作で生成AIを活用。CG予算の制約や法規制を克服し、SF的な映像を生成AIで作成しつつ、倫理的・法的配慮から人の手による修正箇所を明確に区別した制作プロセスを解説する。
- •CG制作の予算不足を補うため、巨大なUFOやSF的な背景映像の生成に生成AIを活用した
- •景品表示法や薬機法などの法規制を遵守するため、AI生成部分と人的修正部分の境界を明確にした
- •「AI動画は好きになれない」という監督の本音と、実務でAIをどう使いこなすかという現場のジレンマが語られている
Googleが動画生成AI「Gemini Omni 1.1 Flash」を発表。直前10秒の文脈を参照して最長40秒までシーンを延長可能で、360pから4Kへのアップスケールも対応した。
- •直前10秒の映像文脈を学習し、最大40秒までのシーンをシームレスに延長生成できる機能が搭載された
- •開始フレームと終了フレームを指定して中間を生成する機能や、360pの高速プレビューから4Kへのアップスケールに対応
- •開発者向けにAPIやツール経由で提供され、動画の生成だけでなく編集作業もサポートするマルチモーダルAIとして位置づけられている
Googleが音声認識特化のモデル「Gemini 3.5 Transcribe」を公開し、高精度な音声テキスト変換を提供する
- •Googleが音声認識に特化した新しいモデル「Gemini 3.5 Transcribe」を公開した
- •既存のマルチモーダルモデルとは異なり、音声データのテキスト変換性能に焦点を当てている
- •開発者はこのモデルを活用して、より高精度な音声処理アプリケーションの構築が可能となる