65 datatypen.
11 categorieën.
Één engine.
Bombus 2.1 is de detectie-engine achter BeeSensible. Een combinatie van snelle AI-technieken en harde regels. Hij herkent persoonsgegevens, financiële data, medische informatie en technische gegevens: in het Engels en Nederlands, en haalt op onze interne testset een F1-score van ~96%.
11 categorieën, 65 gegevenstypen.
Elk gegevenstype hoort bij een categorie. Admins zetten via detectieprofielen zelf het ernstsniveau en of een categorie actief is, per app.
Identifiers
15 types
- · BSN
- · IBAN
- · Paspoortnummer
- · Rijbewijsnummer
- · Zaaknummer
Medisch
12 types
- · Medische code
- · Diagnose
- · Medicijn en dosering
- · Verzekeringsnummer
Locatie en adres
8 types
- · Straatnaam
- · Postcode
- · Stad / Regio
- · GPS-coördinaten
Technisch
8 types
- · API-sleutel
- · IP-adres
- · Apparaat-ID
- · Gebruikersnaam
Financieel
7 types
- · Creditcardnummer
- · CVV en vervaldatum
- · Cryptowallet
- · Bedragen
Demografisch
5 types
- · Geslacht
- · Taal
- · Burgerlijke staat
- · Nationaliteit
Contact
3 types
- · E-mailadres
- · Telefoonnummer
- · Webadres (URL)
Reizen
2 types
- · Vluchtnummer
- · Ticketnummer
Temporeel
2 types
- · Geboortedatum
- · Gebeurtenisdatum
Persoon
2 types
- · Voornaam
- · Achternaam
Organisatie
1 types
- · Bedrijfsnaam
Zelf bepalen wat er als gevoelig telt
Van de 65 gegevenstypen zet je per profiel aan wat je wilt herkennen, en je geeft elk type een niveau: standaard of kritiek. Een BSN weegt bij de meeste organisaties zwaarder dan een straatnaam, en een geboortedatum is in het ene team een datum en in het andere een patiëntgegeven.
- · Zet een enkel gegevenstype aan of uit zonder het profiel opnieuw op te bouwen.
- · Bij elk type staat een voorbeeldwaarde, zodat je ziet waar het over gaat.
Live terwijl je typt. Hetzelfde bij hele documenten.
Bombus detecteert terwijl je schrijft, en scant ook documenten voordat je ze deelt. Dat gebeurt op de eigen servers van BeeSensible binnen de EU, waar de tekst in werkgeheugen wordt verwerkt en meteen daarna verwijderd. Geen contentlog, geen klembordtoegang.
Europese infrastructuur
Tekst wordt gecontroleerd terwijl je typt, nooit verzameld voor later.
Detectie draait op de eigen servers van BeeSensible bij Europese aanbieders: Scaleway in Amsterdam, de modellen bij Hetzner in Duitsland. Europese bedrijven zonder Amerikaans moederbedrijf, allebei ISO 27001-gecertificeerd. De tekst wordt in werkgeheugen verwerkt en meteen daarna verwijderd. Niets wordt opgeslagen of gelogd; alleen aantallen bereiken het dashboard.
Profielgebonden
Actieve gegevenstypen volgen het detectieprofiel.
Admins configureren welke types actief zijn per app. Een streng profiel op ChatGPT hoeft niet voor Slack te gelden; elke app volgt het profiel dat je eraan koppelt, en het standaardprofiel dekt de rest.
Twee niveaus
Standaard en kritiek krijgen elk hun eigen markering.
Kritieke types (BSN, IBAN's, creditcards) krijgen een rode, goed zichtbare markering. Standaardtypes (namen, e-mailadressen) een gele. Het niveau stel je per gegevenstype in het profiel in.
Nauwkeurig genoeg om te vertrouwen. Stil genoeg voor dagelijks gebruik.
Nauwkeurigheid
Gemeten per soort data, niet als één gemiddelde.
Detectie wordt geëvalueerd over elke categorie en elk ernstsniveau. Een sterk overall resultaat kan een zwakke klasse niet verbergen, omdat elk gegevenstype apart wordt gecontroleerd.
Weinig ruis
Gebouwd om mensen niet onnodig te onderbreken.
Precisie is afgestemd per gegevenstype. Veelgebruikte woorden of generieke nummers geven geen waarschuwing. Patronen moeten overeenkomen met structuur en context.
Engels en Nederlands
Beide talen, op dezelfde standaard.
Nederlandse types zoals BSN, Nederlandse IBAN's en KvK-nummers zijn gevalideerd op Nederlandstalige voorbeelden. Engelse types op Engelstalige voorbeelden. Allebei op hetzelfde niveau.
Doorlopend verbeterd
Bijgewerkt door BeeSensible, nooit getraind op jouw tekst.
De detectie-engine wordt gebouwd en verfijnd door het BeeSensible-team. Tekst die gebruikers typen, wordt in het geheugen verwerkt en verwijderd. Het bereikt nooit een trainingsdataset.
Rol detectie per app uit.
Kies de AI-tools en e-mailapps die jouw team het meest gebruikt, koppel daar een profiel aan en voeg de rest toe wanneer je er klaar voor bent.