Tagad varat apmācīt ChatGPT, izmantojot savus dokumentus, izmantojot API
Otrdien OpenAI paziņoja par GPT-3.5 Turbo — AI modeļa, kas nodrošina ChatGPT bezmaksas versiju — precizēšanu , izmantojot tā API. Tas ļauj apmācīt modeli ar pielāgotiem datiem, piemēram, uzņēmuma dokumentiem vai projekta dokumentāciju. OpenAI apgalvo, ka noteiktos scenārijos precīzi pielāgots modelis var darboties tikpat labi kā GPT-4 ar zemākām izmaksām.
Tātad būtībā precizēšana māca GPT-3.5 Turbo par pielāgotu saturu, piemēram, projekta dokumentāciju vai jebkuru citu rakstisku atsauci. Tas var noderēt, ja vēlaties izveidot mākslīgā intelekta palīgu, kura pamatā ir GPT-3.5, kas labi pārzina jūsu produktu vai pakalpojumu, bet kuram trūkst zināšanu par to apmācības datos (atgādinājumam, tie tika izņemti no tīmekļa pirms 2021. gada septembris).
“Kopš GPT-3.5 Turbo izlaišanas izstrādātāji un uzņēmumi ir lūguši iespēju pielāgot modeli, lai radītu unikālu un atšķirīgu pieredzi saviem lietotājiem,” savā reklāmas emuārā raksta OpenAI . “Ar šo palaišanu izstrādātāji tagad var veikt uzraudzītu precizēšanu, lai šis modelis labāk darbotos viņu lietošanas gadījumos.”
Lai gan GPT-4 , jaudīgākais GPT-3.5 brālēns, ir labi pazīstams kā vispārējs, kas ir pielāgojams daudziem priekšmetiem, tas ir lēnāks un dārgāks. OpenAI piedāvā 3.5 precizēšanu, lai iegūtu GPT-4 līdzīgu veiktspēju noteiktā zināšanu jomā ar zemākām izmaksām un ātrāku izpildes laiku. “Sākotnējie testi ir parādījuši, ka GPT-3.5 Turbo precīzi noregulēta versija var saskaņot vai pat pārspēt pamata GPT-4 līmeņa iespējas noteiktos šauros uzdevumos,” viņi raksta.

Turklāt OpenAI saka, ka precīzi noregulētie modeļi nodrošina “uzlabotu vadāmību”, kas nozīmē labāku norādījumu izpildi; “uzticams izvades formatējums”, kas uzlabo modeļa spēju konsekventi izvadīt tekstu tādā formātā kā API izsaukumi vai JSON; un “pielāgots tonis”, kas var radīt pielāgotu garšu vai personību tērzēšanas robotam.
OpenAI saka, ka precizēšana ļauj lietotājiem saīsināt uzvednes un ietaupīt naudu OpenAI API zvanos, kas tiek iekasēti par katru marķieri. “Agrīnie testētāji ir samazinājuši uzvednes lielumu līdz pat 90%, precizējot instrukcijas pašā modelī,” saka OpenAI. Pašlaik precīzās regulēšanas konteksta garums ir iestatīts uz 4K marķieriem, taču OpenAI saka, ka precizēšana tiks attiecināta uz 16k marķieru modeli “vēlāk šoruden”.
Par savu datu izmantošanu ir jāmaksā
Šobrīd jūs varētu domāt, kā darbojas savu datu izmantošana GPT-3.5 apmācīšanai — un cik tas maksā. OpenAI savā emuārā izklāsta vienkāršotu procesu, kurā parādīta sistēmas uzvednes iestatīšana ar API, failu augšupielāde OpenAI apmācībai un precizēšanas darba izveide, izmantojot komandrindas rīka loku, lai vaicātu API tīmekļa adresi . Kad precizēšanas process ir pabeigts, OpenAI saka, ka pielāgotais modelis ir pieejams lietošanai nekavējoties ar tādiem pašiem ātruma ierobežojumiem kā bāzes modelis. Sīkāku informāciju var atrast OpenAI oficiālajā dokumentācijā .
Tam visam, protams, ir cena, un tā ir sadalīta apmācības izmaksās un lietošanas izmaksās. GPT-3.5 apmācība maksā 0,008 USD par 1000 žetoniem. Lietošanas fāzē API piekļuve maksā 0,012 USD par 1000 marķieriem teksta ievadei un 0,016 USD par 1000 marķieriem teksta izvadei.
Salīdzinājumam, bāzes 4K GPT-3.5 Turbo modelis maksā 0,0015 USD par 1000 marķieru ievadi un 0,002 USD par 1000 žetonu izvadi, tāpēc precīzi noregulētais modelis ir aptuveni astoņas reizes dārgāks. Un, lai gan GPT-4 8K konteksta modelis ir arī lētāks — USD 0,03 par 1 000 marķieru ievadi un USD 0,06 par 1 000 marķieru izvadi, OpenAI joprojām apgalvo, ka naudu var ietaupīt, jo precizētajā modelī ir samazināta nepieciešamība pēc uzvednes. Tas ir izstiepts, bet šauros gadījumos tas var attiekties.
GPT-3.5 mācīšana par pielāgotiem dokumentiem dažiem cilvēkiem var būt šīs cenas vērta pat par augstāku cenu, ja varat neļaut modelim kaut ko izdomāt. Pielāgošana ir viena lieta, bet uzticēšanās GPT-3.5 Turbo izvadu precizitātei un uzticamībai ražošanas vidē ir pavisam cita lieta. GPT-3.5 ir labi pazīstams ar savu tendenci sajaukt informāciju.
Attiecībā uz datu konfidencialitāti OpenAI atzīmē, ka, tāpat kā ar visām tā API, OpenAI (vai kāds cits) neizmanto datus, kas tiek nosūtīti no precizējošās API, lai apmācītu AI modeļus. Interesanti, ka OpenAI moderēšanas nolūkos nosūtīs visus klientu precizējošos apmācības datus, izmantojot GPT-4, izmantojot savu nesen paziņoto moderēšanas API. Tas var segt daļu no precizēšanas pakalpojuma izmantošanas izmaksām.
Un, ja 3.5 jums nav pietiekami labs, OpenAI saka, ka GPT-4 precizēšana tiks veikta šoruden. No mūsu pieredzes izriet, ka GPT-4 neko daudz neizveido, taču šī modeļa precizēšana (vai baumotie 8 modeļi , kas darbojas kopā zem pārsega), visticamāk, būs daudz dārgāka. Mums būs jāredz, kad pienāks laiks.
Atbildēt