Conform Mediafax: OpenAI lansează o nouă tehnologie pentru modelele sale AI, promițând o procesare de până la 14 ori mai rapidă în anumite scenarii, comparativ cu modurile standard. Noul mod, denumit „Ultrafast”, este conceput pentru situațiile în care viteza de răspuns este critică, fără a compromite performanța modelelor de vârf. Compania afirmă că această inovație permite utilizatorilor să obțină „mai multă muncă utilă pe secundă”, conform informațiilor publicate de TechCrunch.
GPT-5.6 Sol, considerat modelul emblematic al noii familii GPT-5.6, alături de versiunile Terra și Luna, este prezentat ca fiind cel mai capabil instrument al OpenAI pentru sarcini complexe. Acestea includ programarea, analizele profesionale, cercetarea științifică și securitatea cibernetică. Viteza de procesare, care poate ajunge până la 750 de tokenuri pe secundă, este realizată prin intermediul infrastructurii dezvoltate în colaborare cu producătorul de cipuri Cerebras. Inițial, accesul la această tehnologie va fi oferit selectiv, pe măsură ce compania își extinde capacitatea disponibilă.
Optimizare pentru companii și fluxuri de lucru în timp real
Procesarea accelerată oferită de noua tehnologie se dovedește deosebit de utilă în domenii precum răspunsul la incidente de securitate, serviciile de asistență pentru clienți, analiza piețelor financiare și comerțul electronic. În aceste sectoare, timpul de reacție influențează direct eficiența operațională. OpenAI a dezvoltat, de asemenea, funcția „ultra”, care utilizează mai mulți agenți software ce lucrează în paralel. Scopul acestei funcții este accelerarea sarcinilor complexe prin executarea simultană a mai multor fluxuri de lucru, o abordare diferită de simpla accelerare a generării de text.
Competiția pe piața AI și noile viteze de procesare
Această nouă strategie se înscrie în contextul unei concurențe intense între furnizorii de modele AI, care vizează reducerea timpului de latență. OpenAI oferă deja pentru GPT-5.6 Sol un „Fast mode”, capabil să atingă viteze de până la 2,5 ori mai mari decât procesarea standard în API, la un cost dublu. Cu noua infrastructură bazată pe Cerebras, însă, compania raportează viteze de până la 750 de tokenuri pe secundă, o creștere semnificativă față de procesarea standard.
Sursa: Mediafax
