OpenAI Presence: agenti AI aziendali, ingegneri inclusi

 | Intelligenza-Artificiale

Il modo più recente per acquistare agenti AI aziendali da OpenAI non prevede l’acquisto di nulla online. Presenza OpenAI, annunciato il 22 luglio, è un prodotto gestito fornito tramite un programma di disponibilità generale limitato e la società afferma chiaramente che non è ancora disponibile come prodotto self-service. Le implementazioni sono guidate dai Forward Deployed Engineers di OpenAI e da una serie di integratori di sistemi globali selezionati.

Si tratta di una svolta per un’azienda che si è basata in gran parte su chiavi API e licenze per postazioni. La presenza viene venduta come progetto piuttosto che come prodotto. Ogni impegno inizia con un singolo lavoro, come la risoluzione di una controversia sulla fatturazione, la gestione di un sinistro assicurativo o l’approvazione di una richiesta di servizio IT da parte di un dipendente.

All’agente vengono fornite solo le conoscenze e l’accesso al sistema richiesti dal lavoro, mentre il cliente scrive le regole che governano cosa può fare, quando necessita di approvazione e quando una persona subentra. Dopo il lancio, Codex legge le sessioni di produzione e le escalation, quindi propone le modifiche che il team del cliente testa e approva prima dell’implementazione.

La documentazione di OpenAI è insolitamente sincera riguardo alla manodopera coinvolta. Il suo centro assistenza si avvia un processo in sei fasi che va dalla valutazione dei risultati aziendali, alla sicurezza, alla privacy e alla revisione legale, alla simulazione e ai test di accettazione, all’implementazione graduale e all’iterazione post-lancio. Un agente di presenza, si dice, non diventa pronto per la produzione semplicemente inserendo i documenti.

Il problema per cui questo è stato creato è reale

Il modello gestito è facile da leggere in modo cinico e più difficile da respingere sulla base delle prove. Gartner sì avvertito che oltre il 40% dei progetti di intelligenza artificiale saranno cancellati entro la fine del 2027, attribuendo i fallimenti alla governance, al valore aziendale indefinito e alla debole disciplina operativa piuttosto che alla capacità del modello.

Quasi tutti i pacchetti Presence sono mirati esattamente a quella diagnosi. Simulazioni e valutatori verificano se un agente ha raggiunto il risultato giusto, ha seguito la politica, ha utilizzato correttamente i suoi strumenti ed è intervenuto quando dovrebbe, prima che qualcuno esterno all’azienda gli parli. I guardrail intervengono quando un’interazione supera i confini definiti. I record delle sessioni e la cronologia delle azioni offrono ai revisori qualcosa da controllare. I percorsi di escalation forniscono a una persona un contesto strutturato anziché una trascrizione a freddo e le nuove versioni escono attraverso un’implementazione controllata con rollback.

Le aziende hanno trascorso due anni scoprendo che la parte difficile di un agente di produzione risiede nell’integrazione, nelle autorizzazioni e nella gestione delle modifiche. Un fornitore che invia ingegneri a svolgere quel lavoro sta rispondendo a ciò in cui gli acquirenti hanno effettivamente fallito, piuttosto che spedire un altro dashboard e definire il divario un problema del cliente.

Dove si trova il vincolo

Il compromesso si manifesta nei criteri di ammissibilità. L’accesso, afferma OpenAI, dipende dall’idoneità del flusso di lavoro, dalla disponibilità dell’implementazione e dalla capacità di consegna disponibile.

La capacità di consegna è un vincolo per la consulenza. Bilance software; gli ingegneri abilitati ai sistemi principali di una banca non lo fanno. Forward Deployed Engineer è un titolo preso in prestito da Palantir, in cui descrive il personale coinvolto nelle operazioni dei clienti per mesi alla volta, e gli aspetti economici ad esso collegati non assomigliano per niente all’economia dell’inferenza misurata. Mettendo i propri FDE e i propri partner nominati in primo piano in ogni implementazione, OpenAI è entrata nello strato di mercato occupato dagli integratori su cui farà affidamento anche per crescere, il che è un accordo realizzabile mentre i volumi sono piccoli e più complicato in seguito.

Inoltre pone una domanda sul tavolo per chiunque stia valutando un contratto. Quando il fornitore del modello è anche il partner di implementazione, le linee di responsabilità per una politica applicata in modo errato nella produzione devono essere scritte piuttosto che assunte.

Gli agenti AI aziendali in mostra sono ancora in anticipo

OpenAI descrive Presence come testato sul campo, e il motivo di questo linguaggio è che il prodotto è stato assemblato dopo anni di distribuzione di agenti con clienti aziendali prima di essere confezionato e nominato. L’affermazione riguarda la pratica accumulata piuttosto che il tempo trascorso dal prodotto sul mercato, ed è ragionevole da fare.

Il punto di prova più forte è la linea di supporto telefonico in lingua inglese di OpenAI, 1-888-GPT-0090. L’azienda afferma che l’agente ha raggiunto o superato i suoi parametri interni per il supporto umano in prima linea in poche settimane, ora risolve il 75% dei problemi in entrata senza assistenza umana e ha ridotto i trasferimenti umani di 15 punti percentuali in dieci giorni attraverso il ciclo di miglioramento del Codex. Queste sono le cifre di OpenAI, misurate rispetto ai criteri di valutazione di OpenAI, sul canale di OpenAI. La trasparenza è benvenuta, ma i numeri non sono verificati in modo indipendente.

I tre clienti nominati si collocano prima nel ciclo rispetto a quanto implica l’inquadramento del lancio. BBVA sta esplorando il supporto vocale per le operazioni bancarie quotidiane in Messico. SoftBank sta testando le conversazioni in lingua giapponese. IAG sta esplorando il supporto durante eventi ad alta richiesta come condizioni meteorologiche avverse. Daniel Ordaz, responsabile della trasformazione dell’intelligenza artificiale presso BBVA Mexico, descrive la banca come un partner di progettazione che aiuta a modellare e perfezionare le esperienze vocali per il servizio clienti finanziario. I partner di progettazione sono normali e utili con GA limitata. Nessuno dei tre, però, si presenta come una Presenza funzionante su larga scala, il che vale la pena affiancare alla parola provata.

Cosa non è stato reso noto

Il prezzo non è pubblicato. L’ambito e i costi di implementazione sono stabiliti per cliente e per implementazione, il che è normale per i servizi aziendali e lascia ancora gli acquirenti senza un punto di riferimento pubblico per il costo per contatto risolto rispetto a un fornitore di contact center storico.

Il modello non è nominato. Presence utilizza modelli OpenAI, afferma la documentazione, con la configurazione selezionata per il flusso di lavoro e soggetta a modifiche man mano che il flusso di lavoro si evolve. Questa flessibilità è un’ingegneria difendibile, perché vincolare un agente di produzione a una versione del modello congelato invecchia gravemente. I team che hanno trascorso l’ultimo anno a costruire suite di valutazione rispetto a versioni specifiche vorranno comunque che il contratto indichi a cosa saranno tenuti quando la configurazione verrà spostata.

Il supporto del canale durante GA limitato copre voce o chat, con l’integrazione del contact center, l’instradamento, l’autenticazione e la progettazione del trasferimento confermata implementazione dopo implementazione. La gestione dei dati segue lo stesso schema, con l’architettura e il contratto firmati trattati come un documento regolamentare piuttosto che come una politica pubblicata.

La presenza si distingue dagli agenti ChatGPT Workspace, che rimangono il percorso self-service per i team che creano all’interno di ChatGPT e Slack, mentre i clienti vocali mantengono l’accesso API ai modelli di frontiera di OpenAI. L’azienda ora offre sostanzialmente le stesse capacità in tre modi, separati non tanto da ciò che la tecnologia può fare quanto da chi svolge il lavoro.

Ciò lascia agli acquirenti la scelta della capacità di consegna tanto quanto della capacità del modello e, per conto di OpenAI, la capacità di consegna è la parte che viene razionata.

Vedi anche: HP accelera i flussi di lavoro aziendali con OpenAI Frontier

Banner per la serie di eventi AI & Big Data Expo.

Vuoi saperne di più sull’intelligenza artificiale e sui big data dai leader del settore? Guardare Fiera dell’intelligenza artificiale e dei big data che si svolge ad Amsterdam, in California, e a Londra. L’evento completo è parte di TechEx ed è situato in concomitanza con altri importanti eventi tecnologici tra cui Fiera sulla sicurezza informatica e sul cloud. Clic Qui per ulteriori informazioni

AI News è alimentato da Media TechForge. Esplora altri prossimi eventi e webinar sulla tecnologia aziendale Qui.

Fonte: www.artificialintelligence-news.com

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *