La Meva Salut diu adeu a la contrasenya i es passa a l’idCAT Mòbil
Accedir a La Meva Salut serà cada vegada més fàcil i segur. Durant aquest any, l’idCAT Mòbil es convertirà progressivament en el sistema principal d’identificació per...
Publicar una acta de ple al portal de transparència pot semblar un procés senzill. Però abans de fer-la pública, cal revisar-la i anonimitzar les dades personals que no han de ser objecte de publicació. Això obliga a decidir, cas per cas, quina informació es pot mantenir visible i quina cal protegir. I aquesta decisió no sempre depèn del tipus de dada, sinó del context en què apareix.
Aquesta tasca pot comportar una càrrega important de revisió manual i, alhora, un risc d’error que pot acabar amb la publicació accidental de dades personals. Per això, a l’AOC hem explorat com la intel·ligència artificial generativa pot ajudar a anonimitzar de manera àgil i fiable, interpretant el contingut dels documents i proposant automàticament quina informació cal anonimitzar, sempre amb la supervisió final d’una persona.
El principal valor diferencial de la solució desenvolupada és la seva capacitat per interpretar el context del document, més enllà de detectar dades a partir de patrons predefinits o sistemes de reconeixement d’entitats.
Això permet, per exemple, distingir entre el nom d’un càrrec electe, que s’ha de mantenir públic en una acta de ple, i el d’una persona física que apareix en un altre context i que pot requerir anonimització. De la mateixa manera, una data pot formar part de la informació institucional que cal publicar o ser una dada personal que s’ha de protegir.
Les solucions basades en patrons o en reconeixement d’entitats continuen sent útils per identificar determinats tipus de dades. Tanmateix, no sempre poden determinar si una dada concreta s’ha d’anonimitzar perquè aquesta decisió pot dependre de la funció que té dins del document. La proposta de l’AOC busca reduir aquesta intervenció combinant qualitat en la detecció, intel·ligència contextual i automatització, sense perdre el control humà sobre la decisió final.
El procés és senzill: l’usuari carrega l’acta, selecciona els criteris d’anonimització i inicia l’anàlisi. El sistema interpreta el document i genera una proposta anonimitzada. A continuació, l’usuari revisa les màscares, les modifica o n’afegeix de noves si ho considera necessari i descarrega el document preparat per publicar.
Aquest model de supervisió humana permet aprofitar la capacitat d’automatització de la IA sense substituir el criteri jurídic de les administracions. La plataforma incorpora també llistes blanques per evitar la sobreanonimització i mecanismes de traçabilitat i explicabilitat que permeten revisar els criteris aplicats.
La prova de concepte s’ha validat amb 52 documents aportats per 9 ajuntaments, a més de diverses proves internes de l’AOC. Els resultats mostren una precisió global del 96%, és a dir, que la gran majoria de les dades que el sistema proposa anonimitzar estan correctament identificades. L’indicador F1, que combina la precisió i la cobertura (la capacitat de detectar totes les dades que cal anonimitzar), supera el 90%.
Aquests resultats confirmen la viabilitat tècnica i funcional de la proposta i el potencial de combinar la IA generativa i la supervisió humana per reduir la càrrega de treball i el risc de divulgació accidental de dades personals.
La prova també ha permès identificar àmbits de millora, especialment pel que fa a la cobertura de detecció en documents complexos i a l’escalabilitat de la solució.
La PoC ja ha finalitzat i ha validat el potencial de l’enfocament. Actualment està en procés de contractació la continuïtat de la iniciativa, mitjançant un pilot amb un abast més ampli que permetrà continuar millorant la solució i avançar cap a un possible servei compartit per a les administracions locals.