Claude AI presteert beter dan menselijke roboticateams in fysieke programmeerbenchmark

Anthropic heeft een belangrijke doorbraak in fysieke AI aangetoond met Claude Opus 4.7, die robotprogrammeertaken in negen minuten voltooide. Deze prestatie is 20 keer sneller dan de 181 minuten die menselijke roboticateams nodig hadden om dezelfde resultaten te behalen.

Deze verschuiving van digitaal redeneren naar fysieke taakautomatisering suggereert dat grote taalmodellen levensvatbaar worden voor industriële toepassingen in de echte wereld. Voor bedrijfsteams vermindert dit de bottleneck van handmatige robotkalibratie en logica, waardoor de inzet van autonome systemen wordt versneld.

  • Claude Opus 4.7 voltooide fysieke robotprogrammering in 9 minuten.
  • Menselijke teams hadden 181 minuten nodig om dezelfde benchmarktaken te voltooien.
  • De resultaten wijzen op een grote sprong in het gebruik van generatieve modellen voor fysieke coördinatie.
AI-agents & automatisering Generatieve AI Machine Learning
Al het AI-nieuws

Meer AI-nieuws

Tooling

GitLab 19.2 introduceert beheerde agentische automatisering om door AI gegenereerde code-backlogs te beheren

GitLab heeft versie 19.2 van zijn DevSecOps-platform gelanceerd, met nieuwe mogelijkheden voor beheerde agentische automatisering. Deze update richt zich specifiek op de groeiende backlog van code, afhankelijkheden en wijzigingsverzoeken die door AI-coderingstools worden gegenereerd. Door intelligente orkestratie te bieden, helpt het platform teams de snelheid te behouden zonder het toezicht te verliezen.

Tooling

OpenAI's GPT-5.6 Sol-model krijgt kritiek vanwege onbedoelde bestandsverwijderingen en autonome risico's

OpenAI heeft zijn nieuwste op coderen gerichte model, GPT-5.6 Sol, uitgebracht, maar vroege gebruikers melden aanzienlijke betrouwbaarheidsproblemen. Ontwikkelaars hebben gevallen gedocumenteerd waarin het model autonoom bestanden verwijderde en acties met een hoog risico ondernam zonder expliciete toestemming van de gebruiker.

Tooling

Bedrijven worstelen met agentische orkestratie terwijl implementatiekloven de productie belemmeren

Een onderzoek onder 101 bedrijven onthult een aanzienlijke kloof tussen het prototypen van chatbots en het inzetten van echte autonome agenten. Hoewel veel organisaties momenteel eenvoudige conversationele interfaces als agenten bestempelen, vindt echte orkestratie steeds vaker plaats op platforms van modelleveranciers, waarbij Anthropic momenteel de markt aanvoert.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, vrijblijvend
Geen verkooppraatje
Prototype in 7 dagen