Emne

Images & Vision

Image uploads, visual analysis, privacy boundaries, and image generation basics.

9 historier (6 artikler · 3 videoer)

Start her

Et par gode steder at begynde, før du går på opdagelse i hele oversigten.

Flere i dette emne

6 min læsning
Artikel

Visuelle referencer uden stiltyveri

Referencebilleder og kunstnere er en del af, hvordan skabere lærer, men også af, hvordan generative værktøjer bliver misbrugt. Her er en samtykkebevidst og fair referencepraksis til AI-billeder, som afviser kopiering af nulevende kunstneres stil uden at afskære studiet af håndværket.

Begynder
6 min læsning
Artikel

Hvad AI-billedværktøjer gør forkert — og hvorfor detektorer ikke løser problemet

AI-genererede og AI-redigerede billeder kan indeholde nyttige visuelle spor, men sporene ændrer sig, og detektorernes resultater afhænger af modellerne, redigeringerne og testdataene. Kontrollér kilde og proveniens i stedet for at behandle en score som et certifikat.

Begynder
7 min læsning
Artikel

Få samtykke, før du AI-redigerer eller deler nogens foto

At uploade en vens foto til et AI-værktøj for at fjerne en baggrund, bytte et smil eller omdanne det til en illustration føles som en lille, personlig redigering. For personen på fotoet kan det være en langt større beslutning, de aldrig fik lov at træffe.

Begynder
7 min læsning
Artikel

AI-stemme og lyd: fra kloning og podcasts til oversættelse

En oversigt over stemmekloning, indtaling, transskription og oversættelse med klare grænser for samtykke, oplysning, databeskyttelse og kontrol.

Begynder
48 minutter
Video

Den ultimative begynderguide til Midjourney i 2024

Future Tech Pilot. Når du har besluttet, at Midjourney er værd at prøve, er dette gennemgangen fra start til slut — promptstruktur, parametrene stylize / chaos / weird, image prompting, blending, zoom og pan, style tuning. Grænsefladen er fortsat med at udvikle sig, men alt her gælder stadig, og prompting-intuitionen overføres rent til v7.

Begynder
48 minutter
Video

Hvilken AI-billedgenerator bør DU bruge??

Matt Wolfe. Matt kører det samme prompt-sæt gennem Midjourney, DALL·E, Adobe Firefly, Stable Diffusion, Leonardo og andre og vurderer dem på de dimensioner, artiklen bryder sig om — nøjagtighed, realisme, illustration, logoer, tekst, pris. Modellelisten har skiftet siden (Flux er nu med), men metoden er det, der stadig gør denne til den bedste orienteringsvideo for området.

Begynder
4 minutter
Video

Livedemo af GPT-4o-visionsevner

OpenAI. Fire minutter, hvor nogen holder en håndskrevet lineær ligning op foran kameraet, og ChatGPT vejleder dem igennem den uden at give svaret. Det er den klareste, korteste demo af "modellen kan faktisk se, hvad jeg viser den", og den rammer de anvendelser, artiklen anbefaler — håndskrevne noter, simpel matematik, fotograferede dokumenter — bedre end nogen gennemgang, vi fandt.

Ny inden for AI