Sentinel è live da oggi
Da oggi, Montana Labs lancia Sentinel: il nostro gate d'azione indipendente per gli agenti IA. Sentinel è pensato per il momento in cui un agente non si limita più a proporre o suggerire, ma sta per fare qualcosa che conta davvero in produzione. Spostare denaro. Aggiornare un record. Inviare un messaggio. Attivare un workflow. Chiamare un sistema esterno. In quel punto di confine, i team hanno bisogno di più della semplice fiducia nel modello. Hanno bisogno di un punto di controllo indipendente di cui hanno la piena proprietà.
È esattamente questo che offre Sentinel. Il prodotto inserisce un sidecar self-hosted tra la decisione di un agente e l'azione stessa, valuta l'azione proposta rispetto a policy e sistemi di record, e restituisce uno di tre esiti: ALLOW, BLOCK o ESCALATE. Ogni decisione genera un record di provenance firmato. L'identità di firma risiede nel gate, non nell'agente. E se il gate non è raggiungibile, l'SDK per impostazione predefinita blocca l'azione (fail-closed). Il risultato è un prodotto che i team possono davvero usare per rallentare il rischio senza bloccare l'automazione.
Sentinel è il livello di fiducia tra i tuoi agenti IA e le azioni che contano davvero. Montana Labs
Cosa include il prodotto
Sentinel arriva live con gli elementi fondamentali di cui i team platform hanno bisogno per integrarlo in uno stack reale. La documentazione pubblica e il repository descrivono un sidecar self-hosted, una API HTTP leggera, SDK TypeScript e Python, una CLI per lo scaffolding e la verifica, provenance firmata e una modalità di packaging distribuibile sia come binari standalone che via Docker. È pensato per essere inserito al confine dell'azione, non per sostituire il framework di agenti che un team già utilizza.
Anche il modello di verifica è pensato per l'uso pratico. Sentinel combina controlli sincroni rapidi come la validazione dello schema, le regole di policy e i controlli sui confini dei dati, con controlli più lenti come la riconciliazione rispetto ai sistemi di record, la logica sulle sanzioni, i controlli predicativi e, opzionalmente, una revisione con un secondo modello. Gli esiti vengono aggregati seguendo una precedenza rigorosa: BLOCK su ESCALATE su ALLOW. Questo significa che i team possono bloccare precocemente le azioni chiaramente non sicure e dedicare tempo extra solo dove la decisione richiede davvero una verifica più approfondita.
| Capacità | Cosa fa | Perché è importante |
|---|---|---|
| Gate sidecar indipendente | Separa l'approvazione dell'azione dall'agente stesso | Crea un confine di fiducia di proprietà del cliente |
| SDK fail-closed | Blocca quando il gate non è disponibile o restituisce dati malformati | Evita che un fallimento passi inosservato |
| Provenance firmata | Registra ogni decisione in una catena a prova di manomissione | Migliora l'auditabilità e la revisione post-incidente |
| Ricevute di autorizzazione opzionali | Lega l'esecuzione a un'approvazione firmata a uso singolo | Riduce il rischio di replay e sostituzione dell'azione |
- Sidecar self-hosted con un'identità di firma separata da quella dell'agente.
- SDK leggeri per TypeScript e Python, così i team possono controllare le azioni senza dover riprogettare tutto.
- CLI e percorsi di deployment pensati per ambienti reali, non solo per demo.
- Hook per policy e connettori, così il gate può riconciliare le azioni con la verità di business, non solo con il testo del prompt.
Dove si inserisce Sentinel in uno stack di produzione
Sentinel non vuole essere un altro framework per agenti, un wrapper per chat o un livello di sola osservabilità. Il suo scopo è occupare quello spazio più ristretto ma cruciale tra la proposta e l'esecuzione. Questo lo rende particolarmente rilevante per i team che costruiscono agenti che toccano pagamenti, operazioni clienti, workflow sanitari, azioni di supporto, comunicazioni in uscita, modifiche infrastrutturali o tooling interno che può causare danni reali se un'azione sbagliata passa senza controllo.
Per questi team, la logica del prodotto è semplice: mantenere l'agente flessibile, mantenere il percorso di esecuzione governato e mantenere le prove durature nel tempo. Il protocollo di adjudication opzionale va oltre, trasformando un ALLOW in una ricevuta di autorizzazione firmata, a uso singolo e con scadenza, legata esattamente all'azione e al contesto specifici. È una funzionalità potente per i team che hanno bisogno di più dei semplici controlli di policy e vogliono un legame più stretto tra ciò che è stato approvato e ciò che è stato effettivamente eseguito.
- 1 Un agente propone un'azione con conseguenze rilevanti.
- 2 Sentinel la valuta rispetto a policy, connettori e, se previsto, logica di revisione aggiuntiva.
- 3 Il gate restituisce ALLOW, BLOCK o ESCALATE e firma il risultato.
- 4 Se necessario, l'esecuzione può essere legata a una ricevuta di autorizzazione a uso singolo.
- 5 I team operations e audit possono verificare in un secondo momento cosa è stato deciso e perché.
Perché l'abbiamo costruito così
Abbiamo costruito Sentinel in questo modo perché troppi stack di agenti chiedono ancora ai clienti di fidarsi dello stesso sistema che prende la decisione anche per certificarla. Non è una posizione comoda per i team platform, e non è una risposta seria per workflow ad alto rischio. Sentinel offre ai team uno spazio separato per gestire policy, verifica e auditabilità, senza rinunciare ai vantaggi degli agenti. È pensato per aiutare le aziende ad andare più veloci con l'automazione, mantenendo però una linea chiara su cosa è permesso, cosa richiede revisione e cosa non dovrebbe mai procedere.
Questo lancio dice anche qualcosa sul modo in cui Montana Labs pensa all'applied AI engineering. Non crediamo che la fiducia in produzione nasca da demo più belle o da un linguaggio più rassicurante sui guardrail. Crediamo che nasca dall'architettura. Confini di fiducia separati. Valutazione reale delle policy. Riconciliazione rispetto ai sistemi di record. Prove firmate. Impostazioni predefinite fail-safe. Sentinel è l'espressione concreta di questa convinzione, e da oggi è live per i team che vogliono un modo più credibile di governare le azioni degli agenti.
Se hai già agenti in test o in produzione, il miglior caso d'uso iniziale è il workflow che oggi sembra un passo troppo rischioso da automatizzare end-to-end. È esattamente lì che Sentinel trova il suo posto. È live da oggi, ed è pensato per i team che vogliono che gli agenti facciano più che assistere, mantenendo comunque il pieno controllo sul confine dell'azione.
Find this story relevant to you?
Contact us to find a unique solution