Lansarea OpenAI Presence din 22 iulie face vizibilă o schimbare importantă: punerea unui agent în producție devine o problemă de operare continuă.
Presence reunește politici, proceduri standard, guardrail-uri, acțiuni aprobate, simulări, evaluări, reguli de escaladare, conexiuni cu sistemele companiei și un proces de îmbunătățire după lansare. Aceasta este descrierea propriului produs făcută de OpenAI, nu o dovadă independentă a rezultatelor. Arhitectura rămâne relevantă pentru că arată unde se mută povara operațională.
Producția începe acolo unde se termină demo-ul
Un demo arată că agentul poate termina o sarcină în condiții selectate. Producția trebuie să răspundă la întrebări mai grele.
Ce informații poate folosi? La ce sisteme are acces? Ce acțiuni poate executa fără aprobare? Când trebuie să se oprească? Cine preia escaladarea? Ce se întâmplă când se schimbă politica, produsul, comportamentul clienților sau un sistem conectat?
OpenAI spune că fiecare implementare Presence pornește de la un singur job și oferă agentului doar informațiile și accesul necesare. Compania stabilește politicile, punctele de aprobare și regulile de handoff către oameni. Înainte de lansare, simulările și evaluările verifică rezultatul, respectarea politicii, folosirea tool-urilor și comportamentul la escaladare.
OpenAI raportează și că Presence rezolvă 75% dintre solicitările primite prin canalul propriu de suport telefonic în limba engleză, iar procesul de îmbunătățire a redus handoff-urile către oameni cu 15 puncte procentuale în zece zile. Sunt rezultate raportate de vendor din propriul mediu. Anunțul nu publică suficientă metodologie pentru a le trata ca prognoză pentru altă companie.
Procesul de îmbunătățire are nevoie de un owner
Cea mai importantă parte a anunțului apare după lansare.
OpenAI spune că sesiunile din producție, escaladările și semnalele de calitate scot la suprafață golurile. Codex poate investiga aceste semnale și poate propune schimbări. Echipa testează fiecare propunere față de versiunea din producție și aprobă un rollout controlat.
Procesul nu elimină responsabilitatea umană. O face mai precisă. Cineva trebuie să decidă ce semnale contează, ce evaluare definește performanța acceptabilă, ce schimbare este sigură și când agentul trebuie limitat, oprit sau readus la versiunea anterioară.
Fără acest ritm de operare, agentul poate rămâne online din punct de vedere tehnic și totuși să se îndepărteze de munca pentru care a fost construit.
Definește modelul de operare înainte să alegi produsul
OpenAI Presence este disponibil printr-un program limitat de general availability pentru clienți enterprise eligibili. Implementările sunt conduse de Forward Deployed Engineers OpenAI și de integratori selectați; produsul nu este self-service.
Multe companii vor evalua și alte produse. Întrebările de operare rămân aceleași, indiferent de vendor:
- Definește un singur job, inputurile, acțiunile permise și limitele.
- Numește ownerul pentru calitate, politici, acces și escaladări.
- Stabilește evaluări pentru munca obișnuită, edge case-uri și situații cu risc mai mare.
- Fă handoff-ul către oameni vizibil și testează dacă transmite suficient context.
- Revizuiește semnalele din producție după un ritm stabil, nu doar când apar reclamații.
- Păstrează un traseu controlat pentru testare, aprobare, rollout și rollback.
Lansarea este un singur eveniment. Operarea agentului este sistemul care menține munca fiabilă după ce realitatea se schimbă.
Servicii relevante: Implementare, Optimizare, Support
