Microsoft ontwikkelt Project Perception om kosten voor AI-beveiliging en veiligheid te verlagen

Microsoft bouwt naar verluidt aan een intern hulpmiddel genaamd Project Perception om de veiligheid en beveiliging van AI te verbeteren. Het systeem maakt gebruik van een architectuur met meerdere modellen om kwetsbaarheden te identificeren en modelgedrag efficiënter te monitoren dan bestaande oplossingen. Dit initiatief is bedoeld om een robuust alternatief te bieden voor dure beveiligingspakketten.

Bedrijfsteams hebben schaalbare manieren nodig om de veiligheid van modellen te garanderen zonder onbetaalbare kosten te maken. Deze verschuiving naar verificatie via meerdere modellen wijst op een volwassen wordende markt voor geautomatiseerde AI-governance en tools voor risicobeperking.

  • Project Perception maakt gebruik van meerdere modellen om AI-antwoorden te kruisverwijzen en te valideren op veiligheid.
  • De tool is bedoeld als een betaalbaarder alternatief voor gespecialiseerde beveiligingspakketten zoals Mythos van Anthropic.
  • Het richt zich op het identificeren van vijandige prompts en het in realtime voorkomen van schadelijke resultaten.
Generatieve AI AI-apps & platformen Machine Learning
Al het AI-nieuws

Meer AI-nieuws

Tooling

OpenAI ontwikkelt automatische uitschakelfuncties voor autonome AI-tools

OpenAI heeft wetgevers laten weten dat het automatische uitschakelmogelijkheden ontwikkelt om controle te behouden over steeds autonomere AI-agents. Deze veiligheidsmechanismen zijn ontworpen om in te grijpen als een systeem buiten de beoogde parameters of veiligheidsrichtlijnen begint te werken. De stap is een reactie op de groeiende bezorgdheid over de risico's van agentische systemen die complexe taken uitvoeren met minimale menselijke controle.

Modellen

OpenAI rapporteert dat zijn Astra-model autonoom onbekende softwarekwetsbaarheden kan misbruiken

OpenAI heeft bekendgemaakt dat zijn Astra-model het eerste is dat een kritieke drempelwaarde voor cybersecurity heeft bereikt. Het systeem toonde het vermogen aan om voorheen onbekende softwarefouten te identificeren en te misbruiken zonder enige menselijke tussenkomst. Deze ontwikkeling vertegenwoordigt een aanzienlijke vooruitgang in de autonome capaciteiten van grote taalmodellen binnen complexe beveiligingsomgevingen.

Modellen

OpenAI brengt GPT-6 Astra uit als zijn krachtigste model tot nu toe

OpenAI heeft GPT-6 Astra gelanceerd, een nieuw vlaggenschipmodel dat het bedrijf omschrijft als zijn meest capabele release tot nu toe. Topman Sam Altman positioneert het model als een toonaangevende benchmark voor wereldwijde AI-prestaties in diverse sectoren.

Ready to build something
extraordinary?

15 minutes. No pitch deck. Just a conversation about what AI can do for your team.

Talk directly with our AI specialists

15 min, vrijblijvend
Geen verkooppraatje
Prototype in 7 dagen