Manus AI is niet de volgende Chinese DeepSeek: een diepere blik achter de hype

In slechts één week tijd schreven meer dan 2 miljoen gebruikers zich in voor de wachtlijst voor toegang tot Manus General AI, een Chinese agent. Manus AI wordt aangeprezen als het volgende "DeepSeek-moment" uit China. Dit terwijl de agent zich nog in een gesloten bètafase bevindt en alleen toegankelijk is op uitnodiging.

De regio is in rep en roer, waarbij Manus AI door velen wordt geprezen als een "doorbraak" en een passend antwoord op OpenAI's Deep Research-agent, vooral omdat China AI-innovaties blijft leveren tegen lagere kosten . De hype rond Manus is echter overdreven, deels door de grote beweringen die AI-influencers op sociale media doen. Hieronder leg ik uit waarom ik denk dat Manus AI een veelbelovend begin is, maar geen doorbraak.

Waarom is Manus AI geen doorbraak?

De doorbraak van DeepSeek komt voort uit het succes in het nabootsen van de reinforcement learning (RL)-methodologie van OpenAI, waarmee prestaties werden behaald die vergelijkbaar zijn met O-serie denkmodellen. Bovendien bereikte het DeepSeek-team dit met een aanzienlijk lager budget dan de trainingskosten van OpenAI. DeepSeek bracht later zijn GRPO-trainingsmethodologie als open source uit , waardoor andere laboratoria geavanceerde denkmodellen konden trainen.

Dit waren allemaal nieuwe innovaties en het Chinese DeepSeek-team slaagde erin deze te realiseren ondanks de Amerikaanse beperkingen op GPU's. Het algemene AI-programma van Manus omvat daarentegen het Claude 3.5 Sonnet-model van Anthropic, diverse verbeterde Qwen-modellen en is gebaseerd op het open source Browser Use-project.

manus ai agent homepage

Integratie en verbeterde tools zijn weliswaar voordelen, maar de echte doorbraak ligt in het pionieren van geavanceerde modellen die zijn geoptimaliseerd voor de taken van agenten. Claude 3.5 Sonnet van Anthropic is een van de beste AI-modellen voor agentische taken en programmering. Het team achter Manus test het nieuwe, uniforme model, de Claude 3.7 Sonnet, momenteel intern en vindt het “veelbelovend”.

Het bouwen van capabele AI-modellen blijft de grootste uitdaging en dat zal ook in de nabije toekomst zo blijven. Het Manus AI-team verdient echter een compliment voor het feit dat zij meerdere tools en omgevingen met elkaar hebben verbonden om taken uit te voeren. Zoals eerder gezegd is dit een veelbelovende start voor een toekomst waarin agenten centraal staan.

Manus AI struikelt

Wij hebben geen toegang tot Manus AI, maar sommige X-gebruikers hebben er al eerder toegang toe gehad en hun ervaringen gedeeld. Biomedisch wetenschapper Derya Onmutmaz deelde de resultaten op X nadat hij Manus en OpenAI's Deep Research-agent naast elkaar had gedraaid.

Deep Research bleek de taak in 15 minuten te kunnen voltooien, maar Manus had er 50 minuten over gedaan en slaagde er niet in de taak te voltooien. Hij merkte ook op dat Manus geen bronnen zoals Deep Research citeert.

X-gebruiker teortaxesTex probeerde op vergelijkbare wijze de Manus-agent uit en gaf aan dat deze beter was in het reproduceren van informatie als grote taalmodellen (LLM's) dan in het uitvoeren van proxytaken. Een andere X-gebruiker, TheXeophon, deelde ook zijn bevindingen na het gebruiken van de Manus-agent, die bij een zoektocht op de markt voor videogameconsoles compleet verzuimde de Nintendo Switch te noemen.

De virale video waarin een Manus AI-client automatisch 50 taken uitvoert, bleek nep te zijn. Yichao "Peak" Ji, hoofdwetenschapper van Manus, verklaarde: "Deze video is absoluut niet van Manus", en voegde er een lachende emoji aan toe. De video leidde tot een breed debat over de mogelijkheden en toepassingen van kunstmatige intelligentie, waardoor experts het belang benadrukten van het controleren van informatie die online circuleert.

Ondanks de aanvankelijke misstappen moeten we niet vergeten dat Manus zich nog in een gesloten bètafase bevindt en dat het voorbarig is om het programma te verlaten. Toch is het net zo belangrijk om voorzichtig en weloverwogen te werk te gaan bij het experimenteren met nieuwe AI-producten. Manus is misschien geen doorbraak, maar het is wel een ambitieuze start in de goede richting.

Naarmate AI-modellen steeds beter worden in agentische taken, zullen nieuwe producten die op basis van AI-modellen worden gebouwd, ook verbeteringen ondergaan. Het Manus AI-team heeft al aangegeven dat de agent aanzienlijk zal worden verbeterd voordat deze op grote schaal wordt uitgebracht. Het is nog maar de vraag of het aan de verwachtingen zal voldoen, maar het is zeker een opvallende ontwikkeling die het volgen waard is.

Reacties zijn gesloten.