ラペットテクノロジーズは3D VTuber向けトラッキングソフト「LuppetX」のオフライン版を無料開放し、商用利用も無制限で可能になった
- •サポート終了に伴い、LuppetXのオフライン版Ver.1.1.0が個人・法人問わず無料で提供されるようになった
- •商用利用における制限が撤廃され、VTuber活動やコンテンツ制作での活用が容易になった
- •リアルタイムの3Dモーションキャプチャ機能が無料で利用できるため、低コストでのVTuber運用が可能となる
ChatGPTに統合されたAdobeプラグインの検証結果として、静止画編集は直感的で快適だったが、動画編集ではまだ限界があることが分かった
- •「@adobe」コマンドでPhotoshopやPremiere ProをChatGPTから直接呼び出し、自然言語で指示する操作が可能となった
- •静止画の編集タスクではアプリの複雑な操作を介さず快適に作業でき、クリエイティブのハードル低下に寄与する
- •動画編集においては処理の複雑さや精度の面で課題が残っており、現時点では完全な代替とは言い難い結果となった
ボカコレで3DS生成MVを使用した場合のランキング除外基準が曖昧だったとしてクリエイターから反発があり、AI生成コンテンツの規制基準をめぐる議論が沸騰している。
- •ボカコレにおいて、3DSなどのAI生成ツールを用いたMVが『規約違反』としてランキングから除外された
- •除外基準の不透明さをめぐり、『曖昧だ』や『過剰規制だ』といったクリエイターからの批判が相次いでいる
- •AI生成コンテンツの扱いやコンテストの公正性に関する議論がSNS上で炎上状態となっている
サンフランシスコ全市を検索エンジンでゲームのように探索できるデモが公開され、AIによる3D空間のリアルタイムレンダリング技術の進歩が示された
- •検索クエリに基づいてサンフランシスコの街並みを3Dゲームのようにナビゲートできるプロトタイプが公開された
- •この技術はAIを用いた大規模な地理空間データの処理と、リアルタイムでの視覚的生成を組み合わせている
- •従来のマップ検索を超え、没入感のある都市探索体験を提供する次世代のインターフェースの可能性を示している
生成AIが不自然な料理画像を出力する理由を探り、プロンプトの質やモデルの学習データ偏りが原因である可能性を考察
- •高画質な画像生成が可能になったAIでも、料理の質感や形状を誤って描写するケースがある
- •「岩のような唐揚げ」などの不自然な出力は、プロンプトの指示不足や学習データの偏りに起因する
- •AIの出力結果を改善するには、詳細な指示や画像参照の活用など、適切なプロンプトエンジニアリングが重要
Show HN: Make your logo extra bright on HDR screens
Claude Codeを活用して開発されたブラウザベースのユーティリティを紹介し、JPEGにゲインマップを追加することでHDR対応デバイスでロゴをより明るく表示する技術を解説する
- •既存のJPEG画像にゲインマップを追加することで、HDR対応のMacBook Proなどでロゴが周囲より明るく表示される
- •LinkedInはゲインマップをストリップしない唯一のソーシャルネットワークであり、独自サイトでの活用が推奨される
- •開発者はClaude Codeを使用して登録不要のブラウザベースツールを作成し、公開している
Doodle generative compositions in your browser with Musical Spirograph
ブラウザ上で動作するMusical Spirographは、幾何学的なパターンを生成しながら同時に音楽を作成するツールであり、視覚と聴覚の連動を楽しめる。
- •Musical Spirographはブラウザ上で動作する生成アートツールである。
- •画面を動く点の軌跡に応じて幾何学模様と音楽が同時に生成される。
- •子供の頃に人気だったスパイログラフの概念をデジタルかつ音楽的に再解釈している。
ElevenLabs, TwelveLabs, ThirteenLabs
音声生成で知られるElevenLabsと、動画検索AIのTwelveLabs、ThirteenLabsという名前を持つAIスタートアップ群の概要や関連性を整理した記事
- •ElevenLabsがテキスト読み上げや音声クローニングで業界をリードしている現状を説明している
- •TwelveLabsが動画内のセマンティック検索を可能にする技術を提供している点を紹介している
- •ThirteenLabsの具体的なサービス内容や、他の2社との技術的な違いについて言及している
DeepSeekが画像認識機能を備えたマルチモーダルモデル「V4-Flash-Vision-Exp」をAPI公開し、既存モデルと同価格で提供開始した。
- •DeepSeekは画像を読み解ける実験的なマルチモーダルモデルをAPIプラットフォームで公開した
- •料金は既存のDeepSeek V4 Flashと同額で、画像1枚あたりの課金上限は384トークンと設定されている
- •現時点ではモデルの重み(パラメータ)を無償公開する予定かどうかは明言されていない
Pixel 11 gets in on the digicam trend
Google Pixel 11がスマートフォン写真の画質を向上させ、2014年のスマホ写真と比較しても詳細な描写とシャドウ処理でデジタルカメラライクな質感を再現している
- •2014年のスマホ写真は詳細が柔らかくシャドウが暗かったが、Pixel 11はそれを改善した
- •Pixel 11は近年見られなかったレベルの写真クオリティを実現している
- •スマートフォンカメラがデジタルカメラのトレンドに再び近づいている兆候が見られる