En otrolig vecka för att skapa bilder till vår verksamhet med generativ AI.
Förra veckan förklarade jag hur den nya Gemini-modellen kunde ta bort vattenstämplar från bilder med AI Studio. Den här veckan har jag ännu en överraskning.
Och en mycket, mycket efterlängtad sådan:
Att kunna skapa realistiska lifestyle-produktbilder.
Du vet, sådana där människor syns använda och njuta av produkten.
Hittills har det här varit varumärkets eller leverantörens ansvar. Det var svårt att hitta en ecommercebutik som skapade den här typen av exklusivt innehåll för varumärken den sålde men inte ägde.
Även stora projekt nöjde sig med produktfoton mot vit bakgrund eller med modell, när det gällde mode.
Och det var allt.
Nu kan vi göra det själva. Och dessutom enkelt, snabbt och gratis, tack vare AI och framför allt ChatGPT.
Här visar jag hur i video:
Nedan får du processen förklarad i text med skärmbilder. Och den är mycket enkel, som du snart kommer att se.
Índice de Contenidos del Artículo
#1. Hämta produktbilden
Det första steget är att få tag på produktbilden.
Med produktbild menar jag den vanliga bilden mot vit eller grå bakgrund som ligger högst upp på produktsidan:

För att få tag på den har du flera alternativ:
- Du har den redan sparad på din dator.
- Du går till produktsidan i ecommercebutiken, högerklickar och väljer ”Spara som”.
- Du tar en skärmbild på produktsidan.
- Eller så använder du alternativet jag valde i videon, när bilden ligger som bakgrund i ett HTML-DIV-element: högerklicka, välj ”Inspektera”, öppna den i en ny flik och spara som vanligt.
Oavsett metod kommer du att få en bild som den här:

Senare ser du att jag valde den här produkten eftersom beskrivningen inte innehåller någon bild alls.
#2. Ladda upp den till ChatGPT och välj prompt
Det här är inte särskilt komplicerat:
- Öppna ChatGPT, tills vidare med ett betalkonto, även om Sam Altman har sagt att planen är att göra funktionen tillgänglig för alla.
- Ladda upp bilden via ikonen.
- Kontrollera att modellen 4o är vald.
- Skriv en prompt som beskriver slutbilden du vill ha och hur produktbilden ska användas.

Som exempel använde jag den här prompten:
Jag vill att du använder bilden av whiskyflaskan som jag skickade och skapar en realistisk bild av några vänner vid ett träbord i en naturlig miljö vid solnedgången, där en av dem häller upp flera whiskyshots.
Det kan hända att du gillar ChatGPTs första resultat direkt. Då behöver du bara spara bilden och ladda upp den på ecommerce-produktens sida:

#3. Be om ändringar i bilden
Om du vill ha ändringar behöver du bara be verktyget om dem. I det här exemplet ber jag om två saker:
- Visa endast flaskan som killen håller i, inte den som står på bordet.
- Ge mig bilden i liggande format.
Resultat:

Du kan även göra mer detaljerade justeringar.
Det syns knappt på bilden, men ChatGPT har bytt ut de två ”i” i namnet på produktetiketten mot två ”y”. Därför ber jag verktyget rätta dem.
Det här är resultatet:

Som du ser är det inte alls dåligt.
Och jag tycker att steget från den här ecommerce-produktsidan:

Till den här:

är en tydlig förbättring när det gäller att fånga användarens uppmärksamhet.
Och det tar mindre än 5 minuter att genomföra. Då räknar jag med att du ägnar största delen av tiden åt att vänta på att ChatGPT ska skapa bilden.
Ett annat exempel
Här kommer ett exempel till.
I det här fallet skapades den första bilden i stående format och med två flaskor:

Än en gång ber jag om liggande format och bara en flaska. Och förstås att personen ska vara med vänner, för att dricka ensam är väldigt sorgligt:

Inte dåligt det heller, även om verktyget går lite för långt och inte riktigt får glaset rätt XD.
Slutsats
Just nu är funktionen ganska överraskande, ärligt talat.
Den placerar produkten mycket bra i fotot. Och den ändrar reflexer och glans och anpassar dem realistiskt, vilket är avgörande för den fotorealism vi vill uppnå. I Photoshop skulle det här ta ganska lång tid.
En annan snygg detalj är korken: den togs bort från den öppna flaskan utan att vi bad om det, åtminstone i vissa bilder, men inte alla.
Jag har även testat med flera bilder av olika produkter, och verktyget integrerar dem alla lika bra som en enda. Ett stort steg framåt för mer komplexa kompositioner.
Men när man går lite djupare och testar verktyget i svårare situationer märker man att det fortfarande är något begränsat.
Just nu är det bra på att infoga produktbilder som liknar den du laddar upp, vilket oftast är en frontbild av produkten.
Det du får tillbaka är därför en infogning av samma produktbild i ett frontperspektiv, utan att helt ”förstå” en möjlig rotation eller ett annat perspektiv på produkten. Som du ser på whiskybilden försöker det, men skarvarna syns fortfarande och resultatet är inte redo för exempelvis en realistisk reklamaffisch vid en busshållplats.
För tillfället.
När du ber om en attraktiv bild måste du alltså ha den här begränsningen i åtanke och hålla dig till perspektiv som liknar originalbilden, med bara små variationer.
Just nu kan du inte skapa allt du kan föreställa dig. Men min första tanke var: vad händer om några månader eller veckor när det här har utvecklats? Eller när vi kan ladda upp en 3D-modell av produkten och iterera därifrån…
Jag tror att produktfotografer och designers av 3D-renderingar har anledning att vara oroliga.
För även om stora varumärken kommer att fortsätta anlita dem — eller det hoppas jag, eftersom min kusin lever på det — kommer en AI-skapad bild mycket ofta att räcka för små och medelstora företag.
För att skapa realistiska lifestylebilder som dessa var ett verkligt problem för små och medelstora ecommerceföretag.
Fram till nu.
Så snabbt det går.
Det positiva är att om du prenumererar på mitt nyhetsbrev eller på YouTube-kanalen håller jag dig uppdaterad så att du inte blir tagen på sängen.
Kom igen, dags att förbättra produktsidorna i din ecommerce.

Lämna ett svar