Tutorial

Un ChatGPT privato per i documenti aziendali: cosa significa davvero «privato»

Il team di Kopik7 min di lettura

Un ChatGPT privato per i documenti aziendali è un assistente che risponde a partire dai Suoi file interni senza che questi sfuggano al Suo controllo: non vengono usati per addestrare modelli pubblici, non sono conservati più a lungo di quanto Lei decida e possono interrogarli solo le persone e le applicazioni autorizzate. Ci si arriva con un piano business di un assistente, con un'installazione sui propri server o con una base di conoscenza privata che qualsiasi assistente interroga via API o MCP. La scelta dipende meno dal marchio del chatbot che da tre domande: chi può leggere cosa, per quanto tempo viene conservato tutto e da dove arrivano le risposte.

«Privato»: cinque garanzie diverse dietro una sola parola

Quando un fornitore assicura che i Suoi dati «restano privati», la frase può indicare impegni molto diversi. Prima di caricare anche un solo contratto, conviene scomporla:

  • Nessun addestramento: domande e file non servono a migliorare un modello usato da altri clienti.
  • Conservazione limitata: conversazioni, file caricati e log vengono cancellati entro un termine noto o quando Lei li elimina.
  • Controllo degli accessi: solo persone e applicazioni autorizzate interrogano i documenti, e l'accesso si può revocare.
  • Separazione: i Suoi documenti non finiscono in un indice condiviso dove la ricerca di un altro cliente potrebbe trovarli.
  • Impegno contrattuale: tutto ciò è scritto in un contratto, in particolare nell'accordo sul trattamento previsto dall'articolo 28 del GDPR.

Una soluzione può essere ottima su un punto e debole su un altro. Un modello installato in azienda separa perfettamente, ma non gestisce i permessi finché qualcuno non li sviluppa. Un piano business può escludere i dati dall'addestramento e lasciare comunque che qualsiasi collega dello spazio di lavoro apra un file condiviso. Tratti ogni garanzia come una voce di controllo a sé.

Conservazione dei dati e GDPR: le domande da porre al fornitore

Le sorprese si nascondono quasi sempre nella conservazione. I piani personali e aziendali dello stesso assistente raramente hanno le stesse impostazioni predefinite, e queste cambiano nel tempo. Per questo non riassumiamo qui le condizioni di alcun fornitore: verifichi le condizioni del Suo piano, per iscritto, e ne conservi una copia datata. Le domande utili:

  1. Domande, file e risposte vengono usati per l'addestramento in modo predefinito, e un amministratore può disattivarlo per tutta l'organizzazione?
  2. Per quanto tempo resta conservata una conversazione dopo la cancellazione, ed esistono copie (backup, controllo degli abusi) con scadenze diverse?
  3. Quando si elimina un documento, vengono cancellati anche il testo estratto e l'indice di ricerca?
  4. Chi, presso il fornitore, può accedere ai contenuti, in quali casi, e gli accessi sono registrati?
  5. Quali sub-responsabili intervengono e i dati escono dallo Spazio economico europeo? Con quali garanzie?
  6. È possibile esportare tutto e ottenere la cancellazione a fine contratto?

Quando i documenti contengono dati personali (fascicoli dei dipendenti, corrispondenza con i clienti, curriculum), si applicano il GDPR e il Codice privacy: base giuridica, minimizzazione, periodo di conservazione, nomina del responsabile del trattamento e, se il rischio è elevato, una valutazione d'impatto (DPIA). Il Garante per la protezione dei dati personali pubblica provvedimenti e indicazioni sull'intelligenza artificiale che vale la pena leggere prima di scegliere. L'AI Act aggiunge obblighi propri a seconda dell'uso. La nostra checklist per un chatbot conforme al GDPR approfondisce ciascun punto.

Attenzione ai controlli a distanza

Se lo strumento registra le domande dei dipendenti e consente quindi di ricostruirne l'attività, va valutato alla luce dell'articolo 4 dello Statuto dei lavoratori sui controlli a distanza. Coinvolga per tempo il consulente del lavoro o le rappresentanze sindacali, e informi i dipendenti.

Quattro modi per interrogare i documenti interni in privato

Le soluzioni per un assistente documentale privato

SoluzioneCome funzionaPunti di forzaAttenzione a
Caricare file in un assistenteOgnuno allega PDF alle proprie conversazioniNessuna configurazioneConservazione secondo il piano; copie sparse; nessuna fonte comune
Piano business con spazi condivisiGestione centrale di utenti, file e impostazioniConsole di amministrazione, impegni contrattualiPermessi spesso a livello di intero spazio; documenti legati a un solo assistente
Stack open source sui propri serverModello, indice e interfaccia girano in aziendaSeparazione massimaPermessi, aggiornamenti, monitoraggio e qualità sono a Suo carico
Base di conoscenza privata via API o MCPI documenti si indicizzano una volta; assistenti e applicazioni la interrogano con una chiaveUn'unica fonte, chiavi revocabili, passaggi citati, più assistentiDecide Lei cosa entra; il fornitore va verificato come ogni responsabile

La quarta soluzione separa due aspetti che gli strumenti di chat di solito confondono: dove stanno i documenti e quale assistente scrive la risposta. I documenti restano in uno strato di ricerca privato; Claude, Cursor, ChatGPT o la Sua applicazione pongono domande e ricevono solo i passaggi pertinenti. È la generazione aumentata dal recupero, seguita passo per passo in Come funziona il RAG.

I permessi interni: la parte che si dimentica

Un assistente che qualunque dipendente può interrogare su qualunque documento non è privato all'interno dell'azienda. Il procedimento disciplinare, il piano di riorganizzazione o la tabella delle retribuzioni non devono trovarsi a una domanda di distanza dallo stagista. Regole pratiche per una PMI:

  • Divida per destinatari, non per argomento. Una base comune (regolamento, procedure, documentazione di prodotto) e basi separate per HR, ufficio legale e amministrazione. Una ricerca trova solo ciò che contiene la base interrogata.
  • Una chiave per persona o applicazione. Se uno script, un agente e un collega condividono la chiave, non se ne può revocare una senza bloccare le altre.
  • Revochi all'uscita. Chiavi API e connessioni degli assistenti vanno nella procedura di cessazione, accanto alla casella email.
  • Riduca i dati personali. Ciò che non è indicizzato non può trapelare: anonimizzi o riassuma prima di caricare.
  • Riveda gli accessi ogni trimestre. Utenti, chiavi e documenti cambiano nel tempo.

Una base privata interrogabile da ChatGPT, Claude o dal Suo codice

È l'approccio di Kopik. Lei crea una base caricando file PDF, Word, di testo o Markdown; Kopik estrae il testo, lo suddivide in passaggi e lo indicizza per una ricerca ibrida (testo completo più ampliamento semantico delle parole chiave). Una base privata è accessibile solo al proprietario e alle sue chiavi API, e non compare mai nel catalogo pubblico.

La si interroga in tre modi: dal sito, con l'API REST e una chiave, oppure tramite il server MCP di Kopik, a cui si collegano client MCP come Claude, Cursor o ChatGPT (verifichi quali connettori personalizzati consente il Suo piano). Ogni risposta si basa sui Suoi documenti e cita passaggi numerati; in alternativa può chiedere solo i passaggi e lasciare che sia il Suo assistente a scrivere. Il Model Context Protocol è uno standard aperto, spiegato in Cos'è MCP: per questo la stessa base serve più assistenti senza essere copiata in ciascuno.

Per una sola base, l'indirizzo è `https://kopik.io/api/mcp?base=<slug>` (indicato nella pagina della base) e la chiave va nell'intestazione `Authorization: Bearer kpk_…`. In Cursor, nel file `.cursor/mcp.json`: `{ "mcpServers": { "kopik": { "url": "https://kopik.io/api/mcp?base=<slug>", "headers": { "Authorization": "Bearer kpk_…" } } } }`

L'assistente dispone così di `ask_base` (risposta redatta con passaggi fonte) e `search_base` (solo passaggi). Il contenuto della base arriva tra tag `<kopik-untrusted>`, così l'assistente lo tratta come dati e non come istruzioni: una protezione utile se un documento contiene un testo che somiglia a un comando. Se lavora soprattutto con Claude, Come dare a Claude l'accesso ai documenti aziendali confronta questa strada con le alternative.

Piano di adozione in otto passaggi

  1. Censisca i documenti su cui arrivano davvero domande: procedure, inserimento dei nuovi assunti, schede prodotto, modelli di contratto.
  2. Li classifichi: pubblico, interno, riservato, dati personali, categorie particolari.
  3. Scelga la soluzione per categoria. La documentazione interna può andare subito in una base privata; i dati particolari richiedono un quadro contrattuale solido o restano fuori.
  4. Legga le condizioni del fornitore: addestramento, conservazione, sub-responsabili, trasferimenti, cancellazione. Annoti le risposte con la data.
  5. Aggiorni il registro dei trattamenti ed effettui una DPIA se necessario.
  6. Crei una base per destinatari e una chiave per applicazione, con nomi che ne indichino l'uso.
  7. Faccia test con domande di cui conosce la risposta e controlli i passaggi citati, non solo la forma.
  8. Elimini le versioni superate: due versioni di una procedura producono due risposte.

Crei la Sua base di conoscenza privata

Carichi PDF e file Word, mantenga la base privata e la interroghi dal sito, dall'API o dal Suo client MCP con le Sue chiavi.

Domande frequenti

Si può usare ChatGPT con documenti aziendali riservati?

Dipende dal piano e dai documenti. I piani aziendali offrono in genere impostazioni più rigorose di quelli personali, ma i dettagli su addestramento, conservazione e amministrazione variano e cambiano. Verifichi le condizioni del Suo piano per iscritto e le confronti con il GDPR e con gli obblighi di riservatezza verso i clienti.

Un'IA privata deve essere installata sui server aziendali?

Non necessariamente. L'installazione interna garantisce la separazione massima, ma rende l'azienda responsabile di aggiornamenti di sicurezza, permessi e qualità delle risposte. Molte PMI preferiscono un servizio ospitato con contratto chiaro, accessi rigorosi e documenti cancellabili in qualsiasi momento.

Che differenza c'è tra caricare un file in un chatbot e una base di conoscenza privata?

Un file caricato vive dentro un assistente, spesso in una sola conversazione. Una base privata è un indice centrale: i documenti si gestiscono una volta, si decide quali chiavi possono interrogarla e qualsiasi assistente compatibile vi accede via API o MCP.

Il GDPR vieta di indicizzare documenti con dati personali?

No, ma richiede una base giuridica, la minimizzazione, un periodo di conservazione definito, un accordo con il responsabile del trattamento e, se il rischio è elevato, una valutazione d'impatto. La via più semplice è anonimizzare ciò che non deve essere nominativo.

Come evito che l'assistente citi documenti riservati alla direzione?

Non si affidi a un'istruzione nel prompt. Metta quei documenti in una base separata e dia la relativa chiave solo a persone e applicazioni autorizzate: l'assistente non può trovare ciò che non è nella base che interroga.

Riceva la newsletter di Kopik

Nuove basi di conoscenza, guide sul RAG e novità del prodotto. Un'email ogni una o due settimane, disiscrizione con un clic.

Iscrivendosi accetta di ricevere la nostra newsletter. Il Suo indirizzo non viene mai condiviso.