Prerequisiti (prima del giorno 1)
- Host Windows 10/11 per TuaGate® (server o workstation dedicata).
- 1–3 PC client Windows per TuaGPT®.
- Motore LLM locale (Ollama o LM Studio) già installabile in LAN.
- Cartella pilota di 20–100 PDF non classificatissimi (procedure, manuali, contratti di esempio).
- Referente IT + 2 utenti chiave disponibili 30–60 min/giorno.
Hardware di riferimento (indicativo): 32 GB RAM sul gateway, GPU opzionale ma consigliata per modelli medi; rete LAN stabile. Checklist sicurezza: RFP AI.
Installazione gateway e modello
- Installare TuaGate®, abilitare HTTPS se previsto, creare utenti/token di test.
- Collegare backend Ollama/LM Studio; verificare
/v1/modelse una chat di smoke test. - Documentare IP, porte e account di servizio.
Done when: una richiesta chat dal client di test riceve risposta via gateway.
TuaGPT® sulle workstation
- Installare TuaGPT® Client; puntare all’URL del gateway con token.
- Definire policy: nessun endpoint cloud nel pilota; solo modelli approvati.
- Verificare log delle richieste su TuaGate®.
Done when: 2 utenti autentici completano 5 prompt tipici del proprio lavoro.
Indicizzazione documenti
- Caricare/indicizzare la cartella PDF pilota (chunking, embeddings locali).
- Eseguire 10 domande “grounded” (risposte che citano il documento).
- Annotare fallimenti (OCR, scansioni, tabelle).
Done when: ≥70% delle domande pilota hanno risposta utile e revisionabile da un umano.
Controlli e stress soft
- Verificare TLS, scadenza token, (se Enterprise) whitelist IP e rate limit.
- Simulare 3–5 sessioni concorrenti; annotare latenza percepita.
- Allineare IT su backup del DB locale e retention log.
Done when: nessun dato del corpus pilota è uscito dalla LAN; checklist RFP sezioni 1–4 compilata.
Demo interna e go/no-go
- Demo di 30 minuti a stakeholder (IT + business).
- Compilare il template case study interno (contesto → metriche).
- Decidere: estendere corpus, ampliare utenti, o fermarsi e rivedere modello/hardware.
Criteri go / no-go (esempio)
| Criterio | Go | No-go / ripianificare |
|---|---|---|
| Residenza dati | Prompt e documenti solo in LAN | Dipendenza non governata da API esterne |
| Utilità RAG | ≥70% domande pilota utili | <50% o OCR insufficiente sul corpus reale |
| Operatività | IT sa riavviare servizio e ruotare token | Nessun owner operativo |
| TCO 12 mesi | Licenza + hardware compatibili col budget | Serve GPU/cloud non previsti senza piano |
Volete eseguire il PoC con supporto DEV74? Scrivete a [email protected] o prenotate una demo. Materiali correlati: case study, licenze, Trust Center.