OpenAI a publicat noi detalii despre GPT-6 Astra, modelul său orientat către muncă profesională complexă, disponibil în ChatGPT Work, Codex și API. Compania îl poziționează ca un pas important pentru utilizarea agenților AI în fluxuri de lucru reale, inclusiv acolo unde aplicațiile nu oferă API-uri dedicate.
Unul dintre punctele centrale este capacitatea de computer use. OpenAI spune că Astra poate lucra direct cu aplicații folosite zilnic de companii, ceea ce reduce nevoia de integrări personalizate înainte ca un flux să poată fi automatizat. Pentru organizații, diferența este importantă: un agent poate combina navigarea, analiza documentelor, operarea aplicațiilor și scrierea de cod într-o singură sarcină.
În evaluările publicate de companie, GPT-6 Astra ajunge la 57,9% pe Terminal-Bench 4.0, față de 37,3% pentru GPT-5.6 Sol și 55,8% pentru Claude Fable 5.1. OpenAI afirmă și că modelul a produs rezultate neintenționate cu 89% mai rar decât GPT-5.6 Sol într-un benchmark intern pentru siguranța computer use.
OpenAI citează utilizări în optimizarea GPU-urilor, verificarea situațiilor financiare și generarea de prezentări. Databricks, Box și Hebbia sunt printre companiile care au furnizat evaluări despre performanța Astra în sarcini enterprise.
De ce contează: dacă modelele pot opera aplicații existente cu suficientă fiabilitate, automatizarea enterprise se mută de la integrări punctuale către agenți capabili să folosească software-ul aproape ca un operator uman. Asta poate reduce timpul de implementare, dar crește importanța controalelor de acces, auditului și confirmărilor înaintea operațiunilor sensibile.
Surse
OpenAI — GPT-6 Astra
Imagine reutilizabilă legal din Media Library NetNews.