Open source tool omzeilt het nieuwe watermerksysteem van Claude van Anthropic

Een ontwikkelaar heeft een open source tool uitgebracht die de onzichtbare watermerken verwijdert die Anthropic onlangs aan zijn AI-outputs heeft toegevoegd. Deze watermerken waren bedoeld om het bedrijf te helpen voldoen aan de komende transparantie-eisen van de EU AI Act. De omzeiling laat zien hoe snel door de gemeenschap gedreven tools de veiligheidsfuncties van providers kunnen neutraliseren.

Voor bedrijfsteams onderstreept dit de kwetsbaarheid van de huidige AI-veiligheids- en nalevingsmechanismen. Alleen vertrouwen op watermerken van de provider voor herkomst of naleving van regelgeving kan onvoldoende blijken naarmate vijandige tools zich verder ontwikkelen.

  • Anthropic introduceerde watermerken om te voldoen aan de transparantiestandaarden van de EU AI Act
  • Een populair GitHub-project laat zien hoe gemakkelijk deze markeringen uit gegenereerde tekst kunnen worden verwijderd
  • Het incident roept vragen op over de levensvatbaarheid op lange termijn van op metadata gebaseerde AI-identificatie
Generatieve AI Sovereign AI
Al het AI-nieuws

Meer AI-nieuws

Modellen

Anthropic beperkt toegang tot Claude vanwege risico's op biologische wapens en surveillance

Anthropic heeft naar verluidt de toegang tot zijn Claude-assistent beëindigd voor specifieke gebruikers die zijn geïdentificeerd als uitvoerders van gevoelig onderzoek. Het in de VS gevestigde bedrijf signaleerde activiteiten die mogelijk zouden kunnen bijdragen aan de ontwikkeling van biologische wapens of ongeoorloofde surveillanceprogramma's, waarmee het zijn toewijding aan veiligheidsprotocollen versterkt.

Modellen

Shanghai AI Lab brengt ArchPreview model uit dat gebruikmaakt van next concept prediction

Shanghai AI Lab heeft ArchPreview geïntroduceerd, een open model met 8,9 miljard parameters dat gebruikmaakt van een nieuwe trainingsmethode genaamd Next Concept Prediction. Deze aanpak stelt het model in staat om abstracte concepten te leren in plaats van zich uitsluitend te richten op individuele woorden. ArchPreview behaalt vergelijkbare prestaties als het OLMo-3-7B model terwijl het slechts de helft van de trainingstokens nodig heeft.

Modellen

World Labs lanceert Atlas om AI te verplaatsen van taal naar ruimtelijke wereldmodellen

World Labs heeft Atlas geïntroduceerd, een ruimtelijk intelligentiemodel dat is ontworpen om verder te gaan dan tekstgebaseerde verwerking. In tegenstelling tot traditionele grote taalmodellen richt dit systeem zich op het creëren van wereldmodellen die 3D fysieke ruimtes begrijpen en ermee interageren. De technologie biedt AI een fundamenteel begrip van diepte, natuurkunde en ruimtelijke relaties.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, vrijblijvend
Geen verkooppraatje
Prototype in 7 dagen