DevPick

Hacker NewsHN投稿者: primitivesuave
登録で表示

Show HN: A working 3D model of an Enigma machine

Veritasiumの動画やアニメーションを参考にし、Astraと詳細なプロンプトを用いて歴史的に正確なエニグマ機の内部機構を3Dモデリングした

  • •Veritasiumのエニグマ機解説動画やJared Owenのアニメーションを視聴した後に制作を開始した
  • •Astraツールと数百もの詳細なプロンプト、独自の検査ツールを組み合わせて内部部品を構築した
  • •すべての部品が歴史的に正確なサイズと位置にあることを確認するためにツールを使用した
#画像/動画/音声生成#AIエージェント
2026/9/30

開発元が不明な高性能AIモデル「Space Bunny」がオープンソースAIコーディングエージェント「OpenCode」によって1週間限定で無料で提供され、Webブラウザ上のアニメーション作成能力で話題になっている

  • •オープンソースのAIコーディングエージェント「OpenCode」が9月23日にステルスモデル「Space Bunny」を1週間限定で無料提供している
  • •Space BunnyはWebブラウザ上で美しいアニメーションを描く能力があると評価されている
  • •開発元が不明な“謎の高性能AIモデル”であり、無料で使える点が話題を集めている
#LLM/モデル動向#生成AI活用・ツール#画像/動画/音声生成
2026/9/29

リコーが不動産事業者向けサービス「RICOH360 ビジネスパッケージ 集客AI」の機能を強化し、360度画像から集客用写真を自動生成する新機能を10月中旬から提供する

  • •株式会社リコーが不動産事業者向けサービス「RICOH360 ビジネスパッケージ 集客AI」の機能を強化した
  • •撮影した360度画像から物件の集客用写真を自動生成する「THETA内画像切り出し機能」が新機能である
  • •同機能は10月中旬より提供開始される
#画像/動画/音声生成#ビジネス活用事例
2026/9/29

Googleがライブアバター機能付きの「Gemini 3.8 Live」の一般提供を開始した

#主要プレイヤー動向#画像/動画/音声生成
2026/9/29

Googleが100言語に対応した音声AIモデル「Gemini 3.8 Flash TTS」シリーズを発表し、AI StudioとAPIで提供を開始した

  • •Googleは9月23日にGemini AudioファミリーのTTSモデル「Gemini 3.8 Flash TTS」と「Gemini 3.8 Flash-Lite TTS」を発表した
  • •新モデルはGoogle AI StudioとGemini APIで順次提供が開始された
  • •価格は明らかにされていない
#画像/動画/音声生成#主要プレイヤー動向
2026/9/29
Hacker NewsHN投稿者: mrborgen
登録で表示

Show HN: HN.watch – Videos of all Hacker News posts

ScrimbaがLLMを活用し、Hacker Newsの投稿を即座に解説動画に変換するHN.watchを公開した

  • •Scrimbaの創設者Per氏が、LLMを組み込んだ解説動画生成ツール「Scrimba Explain」を公開した
  • •Hacker Newsの投稿リンクをクリックした際に、その場で解説動画を生成するHN.watchをデモとして構築した
  • •HTMLベースの動画形式を用いたため、視覚的な制約があるものの、誰でも任意のトピックについて解説動画を作成できる
#画像/動画/音声生成#生成AI活用・ツール
2026/9/29
Hacker NewsHN投稿者: bovermyer
登録で表示

What Heraldry and Mon Can Teach Us About Building Visual-Identity Generators

紋章(Heraldry)とMon(家紋)の歴史や構造的特徴を分析し、視覚アイデンティティを生成するAIシステムやツールを構築する際の設計思想にどう応用できるかを考察する

#画像/動画/音声生成
2026/9/28
TechCrunchby Ivan Mehta
登録で表示

ElevenLabs’ new v4 speech model supports more expression control and 90 languages

ElevenLabsが新しいv4音声モデルを発表し、より多くの表現制御と90言語の対応、そして10秒のクリップでの声のクローニングを可能にした

  • •ElevenLabs v4はより多くの表現制御をサポートしている
  • •同モデルは90言語に対応している
  • •10秒のクリップだけで声のクローニングが可能である
#画像/動画/音声生成#LLM/モデル動向
2026/9/28
Hacker NewsHN投稿者: cocoflunchy
登録で表示

Made by Mechanical Means

2026年秋のClaude活用事例として、BlenderやCGI、音楽制作をコード実行なしで実現する方法を紹介している

  • •Blender、CGI、音楽制作の3分野でClaudeを利用している
  • •自身のコンピュータ上でコードを実行せずに作業を行っている
  • •Claude Codeのスレッドを直接開くことなく処理を完結させている
#AIエージェント#生成AI活用・ツール#画像/動画/音声生成
2026/9/28

AdobeはGeminiやClaudeとの連携を強化し、AIチャットから自社の制作ツールを利用できるようにすることで、画像の調整やPDF編集などの生成後の作業を効率化する仕組みを提供している。

  • •AdobeはGeminiやClaudeとの連携を強化し、制作ツールへのアクセスを容易にした
  • •AIチャットから直接Adobeのツールを利用できることで、生成後の編集作業が効率化される
  • •画像の調整やPDFの編集など、生成AIだけで完結しない後工程の課題を解決する
#生成AI活用・ツール#画像/動画/音声生成#主要プレイヤー動向
2026/9/28