Ga naar hoofdinhoud
Terug naar blog
aiautomatiseringmkbmarketingbeeldgeneratie

Je kunt nu afbeeldingen laten maken met leesbare tekst erin

Google's nieuwe beeldmodel rendert tekst in de afbeelding en houdt je product hetzelfde over meerdere bewerkingen. Wat dat verandert voor je banners, productfoto's en social posts, en welke datum je in de agenda moet zetten.

7 oktober 20265 min leestijd

Waarom AI-afbeeldingen zelden door de eindcontrole kwamen

Je hebt het vast een keer geprobeerd. Je vraagt een AI om een afbeelding voor een actie, je krijgt iets dat op het eerste gezicht prima is, en dan kijk je naar de tekst in het beeld. Daar staat "AANBIEDNG" of een woord dat op geen enkele taal lijkt. Of je laat vijf productfoto's maken in verschillende settings en op elke foto is je product net een beetje anders: andere kleur dop, ander logo, ander aantal knoppen.

Dat waren niet twee kleine schoonheidsfoutjes. Het waren precies de twee dingen waardoor beeldgeneratie bij echt klantwerk afviel. Een banner zonder leesbare tekst kun je niet plaatsen, en een productreeks waarin je product steeds verandert kun je niet in een webshop zetten. Het gevolg was dat AI-beeld bleef hangen in het hoekje van sfeerplaatjes, en dat al het werk waar het eigenlijk om ging met de hand gebeurde.

Wat er deze week is veranderd

Google bracht op 6 oktober een nieuwe versie van zijn beeldmodel uit, Nano Banana 2.1, en zette die direct algemeen beschikbaar. Het blijft een snel en goedkoop model, dus het is niet zo dat je nu voor topprijzen gaat werken. Wat eraan vooruit is gegaan, zijn vier punten die je merkt zodra je het gebruikt: de beeldkwaliteit, hoe nauwkeurig het je opdracht volgt, het vasthouden van hetzelfde personage of product over meerdere bewerkingsrondes, en het weergeven van leesbare tekst in de afbeelding zelf.

Die laatste twee zijn de interessante. Tekst in beeld betekent dat een opdracht als "maak een banner van 1200 bij 628 met de tekst 'Gratis bezorging in heel Noord-Brabant' linksonder" iets kan opleveren dat je daadwerkelijk plaatst. En consistentie over bewerkingsrondes betekent dat je een foto van jouw product kunt aanleveren en hem daarna in tien omgevingen kunt zetten zonder dat het product onderweg verandert.

Daarbij kreeg het model ook brede en hoge beeldverhoudingen erbij (1:4, 4:1, 1:8 en 8:1), tot 4K. Dat klinkt als een detail, maar het is het verschil tussen wel of niet kunnen leveren voor een webshop-banner, een verticale verhaal-post of een smalle header.

Waar je dit maandag voor inzet

Drie dingen die hiermee van handwerk naar opdracht verschuiven:

  • Actiebanners in je eigen taal. Dezelfde actie in vijf formaten en drie teksten, in plaats van één formaat waar je de rest zelf uit snijdt.
  • Een productfoto in meerdere settings. Eén goede foto als basis, daarna dezelfde fles, doos of machine op een werkbank, in een keuken, buiten op een bouwplaats.
  • Social posts die niet alle drie hetzelfde zijn. Je hebt geen twintig losse ideeën nodig, je hebt één idee nodig dat twintig keer net anders mag.

Waar het niet voor is: alles wat jouw bedrijf echt moet laten zien. Je team, je werkplaats, je geleverde project. Daar is een fotograaf voor, en dat blijft zo. Het punt is niet dat je nu geen foto's meer laat maken, het punt is dat de stapel beeld die je per campagne nodig hebt niet langer uit diezelfde fotoshoot hoeft te komen.

Je moet nog steeds zelf kijken

Een model dat "leesbare tekst" kan maken, maakt niet altijd leesbare tekst. En zeker in het Nederlands blijft het opletten: een model dat vooral op Engels is getraind zet er graag een Engelse tussenruimte of een ontbrekend trema in. Dus de regel die we bij elke automatisering aanhouden geldt hier dubbel: het eerste resultaat is een voorstel, geen oplevering.

Praktisch betekent dat twee controles voordat iets live gaat. Lees de tekst in het beeld letter voor letter, en leg een nieuwe productafbeelding naast de originele foto om te kijken of het nog hetzelfde product is. Dat kost je tien seconden per afbeelding en het voorkomt het soort fout dat een klant wel ziet.

Eén afbeelding per keer is het punt niet

Zolang je per stuk in een chatvenster werkt, blijft dit een handige truc. Het wordt pas iets anders als het een stap in een proces is: een nieuw product in je systeem, en de bijbehorende set beelden rolt eruit, inclusief de formaten die je nodig hebt.

Dat is precies het werk waar automatiseringsplatforms voor zijn. Als je nog niet weet hoe zo'n proces eruitziet, is onze uitleg over n8n een goed beginpunt: daarin staat hoe je stappen aan elkaar knoopt zonder dat je zelf gaat programmeren. En voor wie dit specifiek voor een webshop wil inzetten, sluit het aan op wat we eerder schreven over content maken voor je webshop met AI.

De eerlijke waarschuwing daarbij: begin niet met de hele keten. Begin met één formaat en één product, kijk of de uitkomst door je eigen controle komt, en bouw het pas daarna uit. We zien bij dit soort trajecten vaker iets stuklopen op te veel tegelijk dan op de techniek zelf.

Zet 29 oktober in je agenda

Er zit een harde kant aan dit nieuws. Met de nieuwe versie heeft Google de voorganger afgekondigd: het oude beeldmodel gaat op 29 oktober uit. Werkt er iets in jouw bedrijf met beeldgeneratie van Google, dan is dat geen datum om te onthouden maar om te controleren.

De vraag die je moet kunnen beantwoorden is: staat ergens vastgelegd welk model onze automatisering gebruikt, en op één plek of overal los? Staat het op één plek, dan is zo'n overstap vijf minuten werk. Staat het verspreid over tien scenario's, dan ben je een middag kwijt en kom je er waarschijnlijk pas achter als er iets niet meer werkt.

Dat is trouwens de bredere les van deze week, los van beeld. Modellen worden vervangen en oude versies gaan uit, en dat gaat in dit tempo gewoon door. Een automatisering die bedoeld is om jaren mee te gaan, legt vast welk model hij gebruikt op een plek waar je het in één keer kunt wijzigen.

Benieuwd wat dit voor jouw bedrijf betekent? We kijken het graag samen met je door.

KC

Kyan Cordes

Oprichter NOVAITEC