DevPick

Hacker NewsHN投稿者: arnemunthekaas
登録で表示

Show HN: An e-ink frame that hears birds and draws them as 1800s illustrations

e-inkディスプレイを備えたフレームが周囲の鳥の声を識別し、19世紀の博物画スタイルでイラストを描画するオープンソースプロジェクトが公開された

  • •デバイスが環境音から鳥の種類を特定し、リアルタイムで視覚的なアートに変換する
  • •描画スタイルは19世紀の古典的な鳥類イラストレーションを模したデザインを採用している
  • •Hacker News上で52ポイントを記録し、AIとアート、ハードウェアを組み合わせたユニークな実装として注目を集めた
#画像/動画/音声生成
2026/9/15

放送・映像業界のIT活用に関する悩みや導入事例を共有する無料交流会が10月6日に開催される

  • •映像・動画・配信に関わる実務者が集まり、現場の課題や導入事例を語り合うオフラインイベントである
  • •参加費は無料であり、トークセッションや交流企画、豪華グルメの提供が予定されている
  • •ASCII主催の「TECH.ASCII ゆるっとナイト vol.8」として開催される
#ビジネス活用事例#画像/動画/音声生成
2026/9/15

Photoshopの画像生成機能において、マークアップ機能を活用して意図した通りの編集指示をAIに伝える具体的な手順を解説する

  • •画像生成AIに対してテキストプロンプトだけでなく、視覚的なマークアップで指示を出す方法を学ぶ
  • •複雑な編集意図をAIが正確に理解しやすくするため、ブラシや選択範囲などのツールを組み合わせる
  • •短時間で効率的なワークフローを構築し、生成AIの精度と使い勝手を高めるテクニックを紹介する
#生成AI活用・ツール#画像/動画/音声生成
2026/9/15
Hacker NewsHN投稿者: toebee
登録で表示

Show HN: Nari Qwen3-TTS and Qwen3-ASR – High accuracy, low latency and cost

オープンソースの音声モデルQwen3-TTS/ASRを高速推論するための専用エンジンNariを開発し、既存フレームワークの限界を克服した

  • •vLLMやSGLangがマルチモーダル推論に不向きな点に着目し、音声特化の推論エンジンを構築した
  • •低レイテンシと低コストを実現することで、クローズドソースモデルに依存しない音声処理の選択肢を提供する
  • •自然な対話生成が可能だったDiaモデルのノウハウを活かし、OSS音声モデルのエコシステム強化を目指している
#画像/動画/音声生成#半導体・インフラ#AI企業・資金調達
2026/9/15
Hacker NewsHN投稿者: ibobev
登録で表示

Graphic Rants: Nanite Tessellation

ゲームエンジンにおけるナニテ技術のテッセレーション処理について、技術的な詳細と視覚的な効果に関する考察をまとめた専門的なブログ記事である

  • •ナニテ技術におけるテッセレーションの仕組みを解説している
  • •リアルタイムレンダリングにおける幾何学処理の最適化について言及している
  • •グラフィックス技術の専門的な視点からの分析を提供している
#研究・論文#画像/動画/音声生成
2026/9/14
TechCrunchby Ivan Mehta
登録で表示

A Vinyl Bar in Shibuya is a startup from a former Spotify leader for making music apps

元Spotify幹部が創業したスタートアップが、ユーザー参加型の音楽制作を可能にする実験的なプラットフォームをリリースした

  • •渋谷のレコードバー形式の店舗を拠点に、音楽アプリ開発を行うスタートアップとして活動している
  • •ユーザーが音楽制作プロセスに参加できる実験的な「シングルス」機能を提供している
  • •元Spotifyの経営陣が関与し、音楽配信や制作における新しいユーザー体験を追求している
#AI企業・資金調達#画像/動画/音声生成
2026/9/14
TechCrunchby Ivan Mehta
登録で表示

A Vinyl Bar in Shibuya is a startup offering fun music apps without any AI prompting

元Spotifyの幹部が設立したスタートアップは、渋谷で「レコードバー」と呼ばれる実験的な音楽アプリを提供している。AIの指示を待つことなく、ユーザーが直接音楽制作に関与する体験を提供し、従来のAI音楽生成とは異なるアプローチを採っている。

  • •元Spotifyの執行役員が設立したスタートアップが、AIプロンプトに依存しない新しい音楽体験を提供している
  • •渋谷を拠点に「レコードバー」という名前のアプリを通じて、ユーザーが音楽制作プロセスに直接参加する仕組みを実験している
  • •AIによる自動生成ではなく、人間の創造性と参加性を重視した、対照的な音楽テックのアプローチを試みている
#AI企業・資金調達#画像/動画/音声生成
2026/9/14
Hacker NewsHN投稿者: tkgally
登録で表示

Show HN: Pelican-bicycle alternatives (updated for 2026)

LLMによるSVG画像生成能力の進化を追跡する実験で、2025年末から2026年初頭にかけて複数の最新モデルを比較し、生成精度の向上を実証した

  • •「タコがパイプオルガンを演奏している」など複雑なプロンプトに対するSVG生成能力を、6つのモデルで比較評価した
  • •約9ヶ月間でLLMの視覚的表現力が大幅に向上し、細部まで正確なベクター画像が生成可能になっている
  • •OpenRouter経由での推論コストは約20ドルで済んだことから、高品質な画像生成の経済性も改善されている
#画像/動画/音声生成#LLM/モデル動向#研究・論文
2026/9/14

古坂大魔王が娘の絵をAIアニメ化し投稿。親孝行と称賛される一方、学習データの権利問題や創造性への影響を危惧する声も上がり、AI活用における倫理的議論が浮上した。

  • •タレントが生成AIツールを用いて子供の手描きイラストを動画化する試みが行われた
  • •親子の創作活動として肯定的な反応が多い一方で、著作権や学習データへの懸念も表明されている
  • •一般ユーザーによるAI活用が、技術の利便性と倫理的課題の両面を社会に問いかけている
#規制・倫理・社会影響#画像/動画/音声生成
2026/9/14

レベルファイブが発表会でAI生成映像を多用し不自然さを指摘された。社長は謝罪し、派手さを出したいとの狙いで実験的処理を行ったと説明した。

  • •レベルファイブのオンライン発表会でAI生成映像の使用がSNS上で批判を呼んだ
  • •日野晃博社長は視聴者への不快感に対して謝罪し、説明責任を果たした
  • •AI活用は派手な演出を狙った実験的な取り組みであったと明言している
#画像/動画/音声生成#規制・倫理・社会影響
2026/9/14