Grok versus Gemini in 7 AI-beeldgeneratietests: welke is beter?
Elke afbeeldingengenerator heeft zijn eigen sterke punten.
AI-afbeeldingsgeneratoren ontwikkelen zich razendsnel en worden steeds slimmer, sneller en creatiever. Nadat ik de mogelijkheden van ChatGPT-5 en Gemini voor het genereren van afbeeldingen had getest, wilde ik de prestaties van Google's Gemini vergelijken met die van Grok, de "gratis" chatbot van Elon Musk.

In een strijd van zeven ronden, met onder meer fotorealistische en Pixar-achtige verzoeken, testte ik de naleving van de instructies en het vermogen van elk model om overtuigende beelden te leveren. Dit zijn de belangrijkste sterke punten van elk model en welke AI uiteindelijk de overhand kreeg. Deze vergelijking helpt je te begrijpen welk model, Gemini of Grok, het meest geschikt is voor jouw AI-beeldgeneratiebehoeften.
1. Hyperrealistisch productconcept

De uitdaging: "Maak een realistische foto van een opvouwbare, transparante smartphone die op een houten cafétafel ligt, met reflecties van stadslichten op het oppervlak."
Grok voldeed succesvol aan deze eis en maakte twee realistische foto's met alle gevraagde details. Beide versies oogden professioneel en gaven het concept nauwkeurig weer.
Het resultaat van Gemini was goed, maar niet perfect. De transparante smartphone oogde enigszins disproportioneel en de reflecties van stadslichten, een belangrijk onderdeel van de bewering, werden niet zo overtuigend weergegeven als bij Grok.
Winnaar: Grok wint omdat het een superieure afbeelding heeft gecreëerd en de bewering het beste heeft geïnterpreteerd. In deze test voor AI-beeldgeneratie presteerde Grok duidelijk beter.
2. Karakters tekenen met emoties

De uitdaging: "Teken een stripverhaalachtige illustratie van een jonge astronaut die beseft dat hij zijn helm op het oppervlak van Mars is vergeten – met overdreven expressie, levendige kleuren en een cartoonesk gevoel voor humor."
Grok maakte twee foto's van wat lijkt op twee verraste astronauten, beiden met een helm op. Omdat de foto's zo kort na elkaar zijn genomen, is het moeilijk om ze definitief te interpreteren, en de "vergeetachtigheid" is niet erg duidelijk.
Gemini maakte een afbeelding van een vergeetachtige astronaut, en de gedachtebubbel illustreert het beste de reden voor de ergernis van de astronaut, hoewel de afbeelding nog beter zou zijn als de astronaut geen helm droeg. De achtergrond en het algehele ontwerp zijn helder.
Winnaar: Gemini wint omdat ze de instructies voor het claimen nauwkeurig hebben opgevolgd en een humoristischere afbeelding hebben aangeleverd.
3. De geschiedenis opnieuw vormgeven

De opdracht: "Schilder een kunstwerk in renaissancestijl van Cleopatra die een moderne smartphone vasthoudt, in de stijl van Leonardo da Vinci."
Grok maakte een foto die lijkt op een moderne vrouw in renaissancekleding met een smartphone in haar hand. De afbeelding is echter meer een selfie en erg eigentijds.
Gemini legde meer de nadruk op het artistieke aspect. Het schilderij leek meer op een schilderij in renaissancestijl en meer op Cleopatra zelf, in plaats van slechts een moderne vrouw in kostuum.
Winnaar: Gemini wint vanwege de beste interpretatie van de orde en de beste historische nauwkeurigheid.
4. Complexe menigtescène

Eiser: “Maak een luchtfoto van Times Square op oudejaarsavond, vol met mensenmassa's, gloeiende billboards en confetti dat door de nachtelijke hemel dwarrelt.”
Grok stelde echt teleur tijdens deze tour. Beide foto's waren even slecht, nogal wazig en gaven geen goed beeld van oudejaarsavond op Times Square. De mensen staan te ver uit elkaar en andere details die de sfeer van oudejaarsavond zouden kunnen oproepen, ontbreken.
Gemini heeft de energie en de enorme menigte op oudejaarsavond in Times Square perfect vastgelegd. De foto is duidelijk genomen in New York City, en de borden bevestigen de gelegenheid. De menigte is hier dicht opeengepakt, in tegenstelling tot de foto van Grok.
Winnaar: Gemini wint de prijs voor de scherpste en meest accurate foto van oudejaarsavond op Times Square.
5. Surrealistische mix

De bewering luidt: "Stel je voor dat een gigantische octopus schaak speelt met Albert Einstein in een glazen kamer op de bodem van de oceaan."
Grok had moeite met deze test. Hij moest er veel langer over nadenken dan bij alle andere tot nu toe geteste beweringen. De afbeelding was goed, maar voldeed niet aan de eis van een "glazen ruimte" in de bewering.
Gemini presenteerde meteen wat op een portret leek. Het glazen huis was interessant en realistisch. De octopus was veel groter dan die van Grok en vulde het vreemde beeld veel beter in.
Winnaar: Gemini wint vanwege de superieure beeldkwaliteit en de nauwkeurige uitvoering van de instructies.
6. Duidelijkheid van de infographic

De opdracht : "Ontwerp een duidelijke infographic die de levenscyclus van de vlinder illustreert, met vermelding van de verschillende stadia, en gebruik pijlen en platte pictogrammen met zo min mogelijk kleuren."
Groks poging om een diagram te maken was zowel geslaagd als mislukt. De eerste versie was te rommelig, met een overbodige extra vlinder die de aandacht afleidde van de levenscyclus. De tweede versie was veeleisender, maar miste precisie in de details van de cyclus.
Gemini presenteerde een helder beeld dat de levenscyclus van de vlinder nauwkeurig weergaf, met duidelijke labels, minimaal kleurgebruik en gemakkelijk leesbare labels.
Winnaar: Gemini wint omdat het de taak in één keer heeft voltooid. De afbeelding is nauwkeurig en klaar om te bekijken.
7. Zorg voor consistentie in gestileerde profielfoto's.

De opdracht: "Maak een 3D-personagemodel in Pixar-stijl van een 40-jarige journalist met blond haar die een notitieboekje vasthoudt – en maak vervolgens 3 varianten met verschillende outfits."
Grok begreep er helemaal niets van door in zijn claim, naast het gedeelte over de "verschillende outfits", ook nog eens een "Pixar-stijl" te vragen. Hij heeft weliswaar drie verschillende kapsels gemaakt, wat hem siert.
Gemini maakte de journalist helemaal af op Pixar-achtige wijze, maar had alle drie de verschillen fout.
Winnaar: Een gelijkspel voor beide robots, omdat ze de instructies niet opvolgden. Als ik er één moest kiezen, zou het Gemini zijn, omdat zij het patroon correct uitvoerden en de sfeer van de journalist beter wisten vast te leggen.
Algehele winnaar: Tweelingen
Na zeven opdrachten bleek Gemini de meest betrouwbare beeldgenerator te zijn. Hij volgde instructies consistenter en nauwkeuriger op, produceerde duidelijkere composities en beheerste details die Grok vaak over het hoofd zag. Met andere woorden, Gemini excelleerde in het begrijpen en uitvoeren van tekstopdrachten om de gevraagde afbeeldingen te genereren.
Grok toonde zeker flitsen van creativiteit en leverde een duidelijke overwinning op het gebied van fotorealisme, maar het haperde vaak in nauwkeurigheid en week af van de norm. Als je experimentele en onconventionele resultaten wilt, heeft Grok zijn momenten. Maar voor dagelijks gebruik, waar helderheid, precisie en verfijning van het grootste belang zijn, is Gemini de AI-beeldgenerator die ik vertrouw om de klus te klaren. Kortom, Gemini is een betere keuze voor gebruikers die op zoek zijn naar consistente, hoogwaardige resultaten in uiteenlopende scenario's.
Heb je Grok al geprobeerd? En Gemini? Welke is jouw favoriet? Laat het me weten in de reacties.
Reacties zijn gesloten.