画像とビジョン
画像のアップロード、視覚分析、プライバシーの境界、画像生成の基礎。
9件のコンテンツ (記事6件 · 動画3件)
ここから開始
一覧を見る前に、まずおすすめのコンテンツをいくつかご覧ください。
このトピックの他の記事
6 分の読書作風を盗用しないビジュアル参照
参照画像やアーティストの作品は、作り手が学ぶ手段である一方、生成ツールが誤用される経路にもなります。存命アーティストの作風の模倣を拒みつつ、技法を学べる、同意に配慮した公正な参照方法を紹介します。
初心者
6 分の読書AI画像ツールの弱点と、検出器だけでは判定できない理由
AIで生成または編集した画像には、参考になる視覚的な手がかりがあります。ただし、手がかりは変化し、検出結果もモデル、編集方法、テストデータによって異なります。スコアを証明書のように扱わず、情報源と来歴を確認してください。
初心者
7 分の読書誰かの写真をAI編集・共有する前に同意を取る
友人の写真をAIツールにアップロードして背景を消したり、笑顔を差し替えたり、イラストに変えたりするのは、小さく個人的な編集に感じられます。写真の中の人にとっては、決める機会がなかった、はるかに大きな決定になりえます。
初心者
7 分の読書音声クローニングからポッドキャスト、翻訳まで:AIの音声とオーディオ
音声クローニング、ナレーション、文字起こし、翻訳の全体像と、同意、開示、プライバシー、検証の境界を解説します。
初心者
48 分2024年版Midjourney初心者完全ガイド
Future Tech Pilot. Midjourneyを試す価値があると判断したら、プロンプトの構成、stylize/chaos/weirdパラメーター、画像プロンプト、ブレンド、ズームとパン、スタイル調整までを網羅する詳細な解説として、この動画が役立ちます。インターフェースは進化し続けていますが、ここで扱う内容はすべて今でも通用し、プロンプトに関する直感はv7にもそのまま応用できます。
初心者
48 分どのAI画像生成ツールを選ぶべきか?
Matt Wolfe. MattはMidjourney、DALL·E、Adobe Firefly、Stable Diffusion、Leonardoなどに同じ一連のプロンプトを入力し、記事が重視する評価軸、すなわち正確さ、写実性、イラスト、ロゴ、テキスト、価格で採点しています。モデルの顔ぶれはその後変わりましたが(現在はFluxも選択肢に入っています)、その方法論こそが、この分野を把握するための最良の動画であり続けている理由です。
初心者
4 分GPT-4oの視覚機能ライブデモ
OpenAI. 手書きの一次方程式をカメラに映すと、ChatGPTが答えを直接教えずに、解き方を指導する様子を4分間で紹介します。「モデルは見せたものを実際に認識できる」ことを示す、最も明快で短いデモです。手書きのメモ、簡単な計算問題、撮影した文書など、記事で推奨している用途も、私たちが見つけたどの解説動画より的確に提示しています。
AI初心者
