Ce include numărul de tokenuri
Alege exact codificarea cerută de aplicația ta. Tokenizatorul împarte textul în secvențe de octeți UTF-8 și le combină folosind vocabularul selectat. Spațiile albe, majusculele și punctuația pot schimba tokenurile chiar și atunci când cuvintele arată asemănător.
Numărul include doar textul lipit. Nu include rolurile din conversație, structurile de sistem care încadrează mesajele, instrumentele, imaginile, sunetul sau alte elemente suplimentare ale cererii. Numele codificărilor sunt afișate direct, astfel încât schimbarea numelui unui model să nu ducă pe neobservate la alegerea vocabularului greșit.
Deschide detaliile tokenurilor pentru a vedea delimitările și ID-urile. ID-urile exportate permit reconstruirea octeților UTF-8 ai textului; instrumentul verifică această corespondență înainte de a activa exportul. Șirurile care seamănă cu tokenuri speciale sunt numărate ca text obișnuit.
Exemplu
„hello world” are 2 tokenuri în ambele codificări, dar ID-urile diferă: cl100k_base produce [15339, 1917], iar o200k_base produce [24912, 2375].
Înainte de a folosi rezultatul
Acest număr nu reprezintă utilizarea facturată a API-ului și nu garantează încadrarea în fereastra de context. Sunt acceptate doar cele două codificări de bază menționate. Tokenurile pot împărți un caracter Unicode; previzualizarea unui token poate afișa un simbol de înlocuire chiar dacă octeții combinați sunt exacți. Unitățile surogat UTF-16 izolate și nevalide sunt normalizate la caracterul de înlocuire.
Citează această pagină
ToolOctopus. “Numărător de tokenuri.” Actualizat 7 octombrie 2026. https://tooloctopus.com/ro/numărător-de-tokenuri.
Adaugă data accesării dacă instrucțiunile tale de citare o cer.
Citările sunt formatate cu citeproc-js, creat de Frank Bennett, și cu stiluri Citation Style Language. Licență și cod sursă.