Gli assistenti di codice sono evoluti dall'autocompletamento verso agenti capaci di esplorare un repository, modificare più file, eseguire comandi, lanciare i test e preparare una pull request. Nel 2026, strumenti come Codex e Claude Code illustrano questa transizione verso compiti più lunghi e più autonomi.
Questa capacità può accelerare la manutenzione, i test, le migrazioni e la documentazione. Può anche produrre più codice incoerente, ripetere un errore su larga scala o esporre segreti. La produttività dipende meno dal modello da solo che dalla qualità del deposito e della catena di controllo.
Le funzionalità e i modelli evolvono rapidamente; le capacità citate devono essere confermate nella documentazione ufficiale al momento del dispiegamento.
Ciò che cambia l’agente
Un agente può:
- leggere l’albero delle directory;
- ricercare degli usi;
- proporre un piano;
- modificare più componenti;
- lanciare dei test;
- analizzare un errore;
- iterare;
- produrre una diff e un resoconto.
Lavora alla velocità del calcolo, ma non possiede automaticamente la comprensione della storia, dei compromessi e delle restrizioni implicite. Il deposito deve rendere queste restrizioni eseguibili o leggibili.
Il deposito deve diventare leggibile e verificabile
Le condizioni favorevoli sono:
- comando unico per avviare;
- ambienti riproducibili;
- dipendenze bloccate;
- test rapidi e mirati;
- analisi statica ;
- convenzioni ;
- architettura documentata ;
- esempi;
- dati di test ;
- CI vicino al locale.
Un essere umano può compensare una documentazione scarsa con la memoria del team. Un agente amplifica le ambiguità.
Ciclo di consegna di un agente di codice dal ticket limitato alla revisione, alla CI e al ritorno in produzione.
Fornire istruzioni gerarchiche
Un file di istruzioni nella radice descrive:
- architettura ;
- ordini ;
- stile ;
- test ;
- zone vietate;
- sicurezza;
- definizione di terminato;
- formato del verbale.
Le istruzioni locali completano per modulo. Devono rimanere brevi, versionate e verificabili. Una direttiva « rispettare l’architettura » senza descrizione o test è poco utile.
Le decisioni strutturanti possono essere documentate in ADR. L'agente le consulta prima di proporre una trasformazione.
Trasformare una richiesta in un ticket delimitato
Un buon compito indica:
- obiettivo;
- contesto ;
- perimetro ;
- file o domini interessati;
- comportamento atteso;
- vincoli;
- test ;
- criteri di accettazione;
- elementi fuori perimetro.
I compiti lunghi sono suddivisi in fasi con risultati concreti. Una richiesta vaga come «modernizzare il progetto» porta a cambiamenti massicci difficili da rivedere.
Isolare l'esecuzione
L’agente lavora in un ramo, un worktree, un contenitore o una sandbox. I segreti di produzione sono assenti. La rete, i comandi e le risorse sono limitati in base al compito.
Gli accessi in scrittura ai sistemi esterni sono vietati per default. Le migrazioni distruttive, i deployment e le azioni cloud richiedono una convalida indipendente.
Le dipendenze scaricate passano attraverso i meccanismi di sicurezza abituali.
Iniziare con compiti a basso rischio
I primi usi possono essere:
- documentazione ;
- aggiunta di test di caratterizzazione;
- correzione localizzata;
- aggiornamento ripetitivo;
- analisi di un incidente;
- generazione di un rapporto;
- migrazione meccanica verificabile.
Una volta che la catena è sotto controllo, possono essere delegate funzionalità più ampie. I cambiamenti di architettura e di sicurezza rimangono ampiamente rivisti.
L’agente deve dimostrare il suo lavoro
Il rapporto finale contiene:
- piano realizzato;
- file modificati ;
- decisioni;
- ordini eseguiti ;
- test e risultati;
- limiti ;
- rischi;
- punti da verificare.
Il diff resta la fonte. Il testo dell’agente non sostituisce la revisione.
Test e vincoli come imbracatura
I test automatici forniscono un feedback immediato. I linters, i tipi, l'analisi statica, i contratti API e i budget di prestazioni limitano le derive.
I test devono coprire il comportamento, non solo l’implementazione generata. Un agente può scrivere un test che conferma il proprio bug. I casi di accettazione provengono dal ticket o da una fonte indipendente.
I progetti legacy beneficiano di test di caratterizzazione prima della rifattorizzazione.
Rivista umana adattata
La rivista si concentra su:
- comportamento ;
- sicurezza;
- dati ;
- architettura ;
- complessità;
- dipendenze;
- test ;
- leggibilità ;
- compatibilità.
Un grande diff generato rapidamente è difficile da verificare. Limitare la dimensione e richiedere commit logici protegge la qualità. Le modifiche sensibili possono richiedere due revisori.
Rischio di debito e di omogeneità ingannevole
L’agente può produrre codice pulito localmente ma duplicare astrazioni, aggirare un servizio o introdurre una nuova libreria inutile. Le regole di dipendenza e l’architettura devono essere testate.
Un aumento del volume di codice non è un aumento di valore. Misurare la rimozione, il riutilizzo e il costo di manutenzione.
Sicurezza del codice e dell'agente
Il deposito può contenere istruzioni dannose in un file o in un problema. I contenuti non sono affidabili e non possono ampliare le autorizzazioni.
I controlli includono:
- segreti nascosti;
- scanner delle dipendenze;
- SAST ;
- divieto di comandi pericolosi;
- rete limitata;
- firma degli artefatti;
- provenienza ;
- audit delle azioni.
I risultati dei test scaricati o le pagine web non sono istruzioni di politica.
Agenti e catena di approvvigionamento
Un agente può aggiungere una dipendenza o modificare la pipeline. Qualsiasi nuova libreria deve essere giustificata, verificata e bloccata. I file di CI, Docker, Terraform e le autorizzazioni sono trattati come sensibili.
Gli artefatti conservano la provenienza del commit, della CI e delle dipendenze. L’agente non utilizza binari sconosciuti per risparmiare tempo.
Metriche di produttività
Le righe di codice e i ticket chiusi sono ingannevoli. Seguire:
- tempo di consegna
- tempo di revisione;
- tasso di accettazione;
- riaperture ;
- difetti;
- incidenti ;
- copertura dei casi critici;
- frequenza di consegna;
- soddisfazione dello sviluppatore;
- tempo netto risparmiato.
Un agente può ridurre il tempo di sviluppo e aumentare la revisione. La metrica deve coprire l'intero ciclo.
Valutare gli agenti
Costruire un gioco di compiti interni anonimizzati: bug, test, refactoring, migrazione, documentazione. Misurare il successo funzionale, la qualità del diff, i test, la durata, il costo e l'intervento umano.
Le valutazioni vengono ripetute dopo il cambiamento di modello o di strumento. Un postmortem pubblico di un fornitore ricorda che un'esperienza agentica può peggiorare anche se l'API del modello non è cambiata; la sorveglianza deve riguardare il prodotto completo.
Organizzazione del lavoro
Gli sviluppatori diventano sempre più responsabili del quadro, dell'architettura, della revisione e dell'utilizzo. I ticket precisi e gli ambienti automatici prendono valore.
I junior possono imparare più velocemente con delle spiegazioni, ma rischiano anche di accettare del codice che non comprendono. La regola rimane: nessuna modifica critica senza un proprietario capace di spiegarla.
Politica aziendale
La politica precisa :
- strumenti approvati;
- tipi di depositi;
- dati autorizzati;
- modalità di esecuzione;
- segreti ;
- compiti vietati;
- rivista ;
- registrazione;
- proprietà intellettuale ;
- procedura di incidente.
Essa permette l'uso invece di spingerlo nell'ombra.
Un'adozione progressiva
Selezionare un deposito, strumentare le metriche, preparare le istruzioni e iniziare con alcuni compiti. I feedback migliorano il telaio. La portata aumenta quando qualità e sicurezza sono dimostrate.
Partitech utilizza flussi di lavoro strutturati di ticket, test e revisioni per delegare compiti agli agenti di codice. Possiamo auditare un deposito, preparare il suo ambiente e integrare gli agenti in una catena di consegna governata. L'obiettivo è accelerare il lavoro utile senza moltiplicare il debito e gli incidenti.
Parliamo del tuo progetto
Mettere in piedi una catena di sviluppo assistita e governata con Partitech. Contatta Partitech.