What is ChatGPT Token Counter?
▾
Ο μετρητής διακριτικών ChatGPT υπολογίζει τον αριθμό των διακριτικών σε ένα δεδομένο κείμενο και υπολογίζει το σχετικό κόστος API για μοντέλα OpenAI, συμπεριλαμβανομένων των GPT-4o, GPT-4 Turbo, GPT-3.5 Turbo και άλλων LLM. Τα διακριτικά είναι η θεμελιώδης μονάδα επεξεργασίας κειμένου σε μεγάλα γλωσσικά μοντέλα — δεν είναι χαρακτήρες ή λέξεις, αλλά μονάδες υπολέξεων που συνήθως έχουν κατά μέσο όρο περίπου 4 χαρακτήρες ή 0,75 λέξεις ανά διακριτικό στα Αγγλικά. Η κατανόηση του αριθμού των διακριτικών είναι απαραίτητη για τη διαχείριση του κόστους API, την άμεση μηχανική και την παραμονή εντός των ορίων του παραθύρου περιβάλλοντος του μοντέλου. Το GPT-4o υποστηρίζει ένα παράθυρο περιβάλλοντος 128K διακριτικών, που σημαίνει ότι μια συνομιλία μπορεί να περιλαμβάνει περίπου 96.000 λέξεις συνδυασμένης εισόδου και εξόδου. Δεδομένου ότι η χρέωση API βασίζεται στον αριθμό των διακριτικών με ξεχωριστές τιμές για τα διακριτικά εισόδου και εξόδου, η ακριβής εκτίμηση των διακριτικών επηρεάζει άμεσα τους προϋπολογισμούς ανάπτυξης και το κόστος εφαρμογής.
DigiCalcs delivers precision-engineered tools for engineers and STEM professionals.
Τύπος
▾
Αριθμός διακριτικών (κατά προσέγγιση) = Πλήθος χαρακτήρων / 4 ή Πλήθος λέξεων / 0,75. Κόστος API = (Διακριτικά εισόδου / 1.000.000) x Τιμή εισόδου ανά εκατομμύριο + (Διακριτικά εξόδου / 1.000.000) x Τιμή εξόδου ανά εκατομμύριο.Variable Legend
▾
| Σύμβολο | Όνομα | Μονάδα | Περιγραφή |
|---|---|---|---|
| T | Token Count | tokens | Αριθμός διακριτικών στο κείμενο εισόδου ή εξόδου, όπως καθορίζεται από τον προγραμματιστή διακριτικών του μοντέλου (π.χ. cl100k_base για GPT-4) |
| C | Αριθμός χαρακτήρων | characters | Συνολικός αριθμός χαρακτήρων στο κείμενο — περίπου 4 χαρακτήρες ανά διακριτικό στα Αγγλικά |
| Pi | Τιμή εισόδου | USD per 1M tokens | Κόστος ανά εκατομμύριο διακριτικά εισόδου (προτροπής) για το επιλεγμένο μοντέλο |
| Po | Τιμή εξόδου | USD per 1M tokens | Κόστος ανά εκατομμύριο κουπόνια παραγωγής (ολοκλήρωσης) για το επιλεγμένο μοντέλο — συνήθως 2-4 φορές υψηλότερο από την τιμή εισόδου |
| W | Παράθυρο περιβάλλοντος | tokens | Μέγιστα συνδυασμένα διακριτικά εισόδου + εξόδου που υποστηρίζει το μοντέλο σε ένα μόνο αίτημα |
How to ChatGPT Token Counter
▾
- 1Επικολλήστε ή πληκτρολογήστε το κείμενό σας στο πεδίο εισαγωγής μετρητή διακριτικών — το εργαλείο το επεξεργάζεται σε πραγματικό χρόνο.
- 2Ο μετρητής υπολογίζει τον αριθμό των διακριτικών χρησιμοποιώντας την προσέγγιση ~4 χαρακτήρων ανά διακριτικό (ή χρησιμοποιεί το πραγματικό cl100k_base tokenizer για ακριβείς μετρήσεις).
- 3Επιλέξτε το μοντέλο AI που σκοπεύετε να χρησιμοποιήσετε — GPT-4o, GPT-4 Turbo, GPT-3.5 Turbo, Claude 3, κ.λπ. — καθώς οι τιμές διαφέρουν σημαντικά.
- 4Η αριθμομηχανή εφαρμόζει την τιμολόγηση ανά εκατομμύριο διακριτικών του μοντέλου στον αριθμό των διακριτικών εισόδου και στον εκτιμώμενο αριθμό διακριτικών εξόδου.
- 5Το συνολικό κόστος του API υπολογίζεται: (Κωδικά εισόδου x Ρυθμός εισόδου) + (Κερίδια εξόδου x ρυθμός εξόδου).
- 6Το εργαλείο δείχνει επίσης πόσο από το παράθυρο περιβάλλοντος του μοντέλου καταναλώνει η προτροπή σας, βοηθώντας σας να παραμένετε εντός ορίων.
- 7Για ομαδικές λειτουργίες, πολλαπλασιάστε το κόστος ανά αίτημα με τον αριθμό των κλήσεων API για να υπολογίσετε το συνολικό κόστος του έργου.
Worked Examples
▾
200 λέξεις / 0,75 = ~267 μάρκες εισαγωγής. Σε τιμές GPT-4o (2,50 $/1 εκατ. είσοδος, 10,00 $/1 εκατ. έξοδος): κόστος εισόδου = 267/1 εκατ. x 2,50 $ = 0,00067 $, κόστος εξόδου = 267/1 εκατ. x 10,00 $ = 0,00267 $. Σύνολο ανά αίτημα = 0,00334 $. Σε 10.000 αλληλεπιδράσεις πελατών/μήνα, το συνολικό κόστος είναι περίπου 33,40 $.
10.000 λέξεις / 0,75 = ~13.333 κουπόνια εισαγωγής. 500 λέξεις / 0,75 = ~ 667 μάρκες εξόδου. Κόστος εισόδου: 13.333/1 εκατ. x 2,50 $ = 0,0333 $. Κόστος εξόδου: 667/1 εκατ. x 10,00 $ = 0,00667 $. Σύνολο = ~0,04$ ανά έγγραφο. Η σύνοψη 1.000 εγγράφων θα κόστιζε περίπου 40 $.
GPT-3.5 Turbo: (1.000/1 εκατ. x 0,50 $) + (500/1 εκατ. x 1,50 $) = 0,0005 $ + 0,00075 $ = 0,00125 $. GPT-4o: (1.000/1 εκατ. x 2,50 $) + (500/1 εκατ. x 10,00 $) = 0,0025 $ + 0,005 $ = 0,0075 $. Το GPT-4o είναι 6 φορές πιο ακριβό ανά αίτημα, αλλά παρέχει σημαντικά καλύτερη ποιότητα συλλογιστικής και παρακολούθησης οδηγιών.
Διακριτικά ημερήσιας εισαγωγής: 500 x 100.000 = 50 εκατ. Διακριτικά ημερήσιας εξόδου: 300 x 100.000 = 30 εκατ. Κόστος εισόδου: 50 εκατ./1 εκατ. x 0,15 $ = 7,50 $. Κόστος παραγωγής: 30 εκατ./1 εκατ. x 0,60 $ = 18,00 $. Ημερήσιο σύνολο = 25,50 $, μηνιαία = ~ 765 $. Το GPT-4o mini έχει σχεδιαστεί για εφαρμογές μεγάλου όγκου όπου η αποδοτικότητα κόστους έχει μεγαλύτερη σημασία από τη μέγιστη ικανότητα συλλογιστικής.
Real-World Applications
▾
Πρόβλεψη προϋπολογισμού API: Οι προγραμματιστές υπολογίζουν το μηνιαίο κόστος του OpenAI API με βάση τους αναμενόμενους όγκους αιτημάτων, τα μέσα μήκη προτροπών και την επιλογή μοντέλου για τον καθορισμό προϋπολογισμών μηχανικής.
Άμεση βελτιστοποίηση: Οι μηχανικοί μετρούν τον αριθμό των διακριτικών διαφορετικών σχεδίων προτροπής για να βρουν τις πιο οικονομικές συνθέσεις που διατηρούν την ποιότητα παραγωγής.
Μοντελοποίηση κόστους Chatbot: Οι ομάδες προϊόντων υπολογίζουν το κόστος ανά συνομιλία για τα chatbot AI για να καθορίσουν την τιμολόγηση, τα περιθώρια και εάν θα χρησιμοποιηθούν φθηνότερα μοντέλα για απλούστερα ερωτήματα.
Σωληνώσεις επεξεργασίας εγγράφων: Οι εταιρείες εκτιμούν το κόστος επεξεργασίας μεγάλων σωμάτων εγγράφων (συμβάσεις, ιατρικά αρχεία, νομικές αρχειοθετήσεις) μέσω του GPT-4 για σύνοψη, εξαγωγή ή ανάλυση.
Επιλογή μοντέλου: Οι τεχνικοί υποψήφιοι συγκρίνουν το κόστος ανά εργασία σε διαφορετικά μοντέλα (GPT-4o έναντι Claude εναντίον Gemini) για να επιλέξουν το βέλτιστο μοντέλο για κάθε περίπτωση χρήσης στην εφαρμογή τους.
Special Cases
▾
Μη Αγγλικό Κείμενο και Πολυγλωσσική Tokenization
Τα μη λατινικά σενάρια (Κινέζικα, Ιαπωνικά, Κορεάτικα, Αραβικά, Χίντι) συνήθως καταναλώνουν 2-3 φορές περισσότερα διακριτικά ανά λέξη από τα αγγλικά, επειδή το tokenizer ήταν κυρίως εκπαιδευμένο σε αγγλικό κείμενο. Ένα κινεζικό κείμενο 1.000 χαρακτήρων μπορεί να χρησιμοποιεί 700-1.000 μάρκες, ενώ το ίδιο μήκος στα αγγλικά θα χρησιμοποιεί μόνο 250 μάρκες. Αυτό επηρεάζει σημαντικά το κόστος για πολύγλωσσες εφαρμογές.
Κωδικός Tokenization
Ο πηγαίος κώδικας συχνά χαρακτηρίζεται διαφορετικά από την πεζογραφία. Οι κοινές λέξεις-κλειδιά προγραμματισμού και η σύνταξη είναι συνήθως μεμονωμένα διακριτικά, αλλά τα ονόματα μεταβλητών, οι συμβολοσειρές και τα σχόλια διαφέρουν πολύ. Η εσοχή και το κενό διάστημα καταναλώνουν διακριτικά. Ο ελαχιστοποιημένος κώδικας χρησιμοποιεί λιγότερα διακριτικά από τον μορφοποιημένο κώδικα. Η Python τυπικά κάνει πιο αποτελεσματικά διακριτικά από ό,τι περίπλοκες γλώσσες όπως η Java.
Προσωρινά αποθηκευμένα διακριτικά εισόδου (Προτροπή προσωρινής αποθήκευσης)
Το OpenAI προσφέρει έκπτωση 50% στα αποθηκευμένα διακριτικά εισόδου για GPT-4o και GPT-4o mini, όταν το ίδιο πρόθεμα προτροπής χρησιμοποιείται ξανά σε κλήσεις API. Εάν η προτροπή του συστήματός σας (ας πούμε, 2.000 διακριτικά) είναι πανομοιότυπη μεταξύ των αιτημάτων, πληρώνετε την πλήρη τιμή στην πρώτη κλήση και τη μισή τιμή για τις επόμενες κλήσεις για αυτά τα αποθηκευμένα διακριτικά. Αυτό μπορεί να μειώσει το κόστος κατά 20-40% για εφαρμογές με μεγάλες προτροπές συστήματος.
Τιμολόγηση μοντέλου OpenAI (2025)
▾
| Μοντέλο | Είσοδος (ανά 1 εκατομμύριο διακριτικά) | Έξοδος (ανά 1 εκατομμύριο διακριτικά) | Παράθυρο περιβάλλοντος |
|---|---|---|---|
| GPT-4o | $2,50 | 10,00 $ | 128 χιλιάδες μάρκες |
| GPT-4o μίνι | 0,15 $ | 0,60 $ | 128 χιλιάδες μάρκες |
| GPT-4 Turbo | 10,00 $ | 30,00 $ | 128 χιλιάδες μάρκες |
| GPT-3.5 Turbo | $0,50 | $1,50 | 16 χιλιάδες μάρκες |
| o1 (συλλογισμός) | 15,00 $ | 60,00 $ | 200 χιλιάδες μάρκες |
| o1-mini | 3,00 $ | 12,00 $ | 128 χιλιάδες μάρκες |
| Σονέτο Claude 3.5 (Anthropic) | 3,00 $ | 15,00 $ | 200 χιλιάδες μάρκες |
| Gemini 1.5 Pro (Google) | 1,25 $ | $5,00 | 1 εκατομμύριο μάρκες |
Frequently Asked Questions
▾
Τι ακριβώς είναι ένα διακριτικό;
Ένα διακριτικό είναι μια μονάδα υπολέξεων που χρησιμοποιείται από LLM για την επεξεργασία κειμένου. Οι συνηθισμένες λέξεις όπως «το» ή «και» είναι μεμονωμένα κουπόνια, ενώ μεγαλύτερες ή ασυνήθιστες λέξεις μπορεί να χωριστούν σε πολλά διακριτικά (π.χ. «κρυπτονομίσματα» μπορεί να είναι «κρυπτό» + «νόμισμα» = 2 μάρκες). Στα αγγλικά, 1 διακριτικό έχει κατά μέσο όρο ~4 χαρακτήρες ή ~0,75 λέξεις. Οι μη αγγλικές γλώσσες και ο κώδικας έχουν συνήθως διαφορετικές αναλογίες διακριτικού ανά λέξη.
Γιατί τα διακριτικά εξόδου είναι πιο ακριβά από τα διακριτικά εισόδου;
Τα διακριτικά εξόδου (ολοκλήρωσης) απαιτούν περισσότερους υπολογισμούς από τα διακριτικά εισόδου (προτροπή), επειδή το μοντέλο πρέπει να δημιουργήσει κάθε διακριτικό εξόδου διαδοχικά, εκτελώντας ένα πλήρες πέρασμα προς τα εμπρός μέσω του νευρωνικού δικτύου για κάθε ένα. Τα διακριτικά εισόδου μπορούν να υποβληθούν σε επεξεργασία παράλληλα. Αυτή η ασυμμετρία στο υπολογιστικό κόστος αντανακλάται στο 2-4x premium τιμής για μάρκες παραγωγής.
Πόσο ακριβής είναι η εκτίμηση των ~4 χαρακτήρων ανά διακριτικό;
Η προσέγγιση των 4 χαρακτήρων είναι αρκετά ακριβής για την τυπική αγγλική πεζογραφία (εντός 10-15%). Ωστόσο, γίνεται λιγότερο ακριβής για τον κώδικα (ο οποίος μπορεί να χρησιμοποιεί 2-3 χαρακτήρες ανά διακριτικό λόγω συντακτικών συμβόλων), τα μη λατινικά σενάρια (τα Κινεζικά/Ιαπωνικά μπορεί να χρησιμοποιούν 1-2 χαρακτήρες ανά διακριτικό) και την εξειδικευμένη ορολογία. Για ακριβείς μετρήσεις, χρησιμοποιήστε τη βιβλιοθήκη tiktoken του OpenAI ή το πραγματικό tokenizer.
Τι είναι το παράθυρο περιβάλλοντος και γιατί έχει σημασία;
Το παράθυρο περιβάλλοντος είναι ο μέγιστος αριθμός διακριτικών (συνδυασμός εισόδου + εξόδου) που μπορεί να επεξεργαστεί ένα μοντέλο σε ένα μόνο αίτημα. Το GPT-4o έχει ένα παράθυρο διακριτικών 128K (~96.000 λέξεις). Εάν η καταχώρισή σας υπερβαίνει το παράθυρο περιβάλλοντος, πρέπει να περικόψετε, να συνοψίσετε ή να χρησιμοποιήσετε την επαυξημένη παραγωγή ανάκτησης (RAG). Η υπέρβαση του ορίου επιστρέφει ένα σφάλμα API.
Οι προτροπές συστήματος και το ιστορικό συνομιλιών υπολογίζονται στη χρήση διακριτικών;
Ναί. Κάθε κλήση API περιλαμβάνει το πλήρες μήνυμα του συστήματος, όλο το ιστορικό συνομιλιών και το νέο μήνυμα χρήστη ως διακριτικά εισόδου. Σε ένα chatbot, το ιστορικό συνομιλιών μεγαλώνει με κάθε στροφή, επομένως το κόστος αυξάνεται όσο μεγαλώνουν οι συνομιλίες. Εφαρμόστε στρατηγικές περικοπής συνομιλιών ή σύνοψης για τον έλεγχο του κόστους σε εφαρμογές πολλαπλών στροφών.
Πώς συγκρίνεται η τιμολόγηση του GPT-4o με τον Claude και άλλα μοντέλα;
Από το 2025: Το GPT-4o είναι 2,50 $/10,00 $ ανά 1 εκατομμύριο διακριτικά (είσοδος/έξοδος). Το Anthropic Claude 3.5 Sonnet είναι 3,00 $/15,00 $ ανά 1 εκατομμύριο. Το Google Gemini 1.5 Pro είναι 1,25 $/5,00 $ ανά 1 εκατομμύριο. Το GPT-4o mini στα 0,15 $/0,60 $ είναι η φθηνότερη επιλογή μοντέλου συνόρων. Οι τιμές αλλάζουν συχνά καθώς οι πάροχοι ανταγωνίζονται ως προς το κόστος-απόδοση.
Common Mistakes to Avoid
▾
- !Υποθέτοντας 1 διακριτικό = 1 λέξη — στα Αγγλικά, 1 διακριτικό είναι περίπου 0,75 λέξεις (ή 1 λέξη = ~1,33 μάρκες) και αυτή η αναλογία ποικίλλει σημαντικά για άλλες γλώσσες.
- !Ξεχνώντας ότι το ιστορικό συνομιλιών συγκεντρώνει διακριτικά σε κάθε στροφή — μια συνομιλία chatbot 20 στροφών μπορεί να στείλει 10.000+ διακριτικά εισόδου ανά αίτημα, ακόμη και αν κάθε μεμονωμένο μήνυμα είναι σύντομο.
- !Δεν λαμβάνεται υπόψη το κόστος διακριτικού προτροπής συστήματος, το οποίο περιλαμβάνεται σε κάθε κλήση API και μπορεί να είναι 500-2.000 μάρκες για λεπτομερείς οδηγίες.
- !Σύγκριση τιμών μοντέλων χωρίς να ληφθούν υπόψη οι διαφορές ποιότητας εξόδου — Το GPT-4o mini είναι 17 φορές φθηνότερο από το GPT-4o, αλλά ενδέχεται να απαιτούνται περισσότερα διακριτικά για να επιτευχθεί το ίδιο αποτέλεσμα λόγω χαμηλότερης ικανότητας συλλογισμού.
- !Αγνοώντας τη χωριστή τιμολόγηση για τα διακριτικά εισόδου έναντι εξόδου — τα διακριτικά εξόδου είναι 2-4 φορές πιο ακριβά, επομένως οι εφαρμογές που δημιουργούν μεγάλες αποκρίσεις κοστίζουν δυσανάλογα περισσότερο.
Pro Tip
Για να μειώσετε το κόστος του API χωρίς να θυσιάσετε την ποιότητα: (1) Χρησιμοποιήστε το GPT-4o mini για απλές εργασίες όπως η ταξινόμηση και η εξαγωγή, δεσμεύοντας το GPT-4o για πολύπλοκη συλλογιστική. (2) Εφαρμόστε προσωρινή αποθήκευση εντολών για να λάβετε έκπτωση 50% σε επαναλαμβανόμενες προτροπές συστήματος. (3) Ορίστε max_tokens για να αποτρέψετε τις απροσδόκητες μεγάλες εξόδους. (4) Συνοψίστε το ιστορικό συνομιλιών αντί να στείλετε την πλήρη μεταγραφή. Μια καλά βελτιστοποιημένη εφαρμογή μπορεί να μειώσει το κόστος κατά 60-80% σε σύγκριση με την απλή χρήση API.
Did you know?
Η λέξη «tokenization» στην τεχνητή νοημοσύνη έχει μια περίεργη διπλή ζωή — στην επεξεργασία φυσικής γλώσσας σημαίνει διαχωρισμό κειμένου σε μονάδες υπολέξεων, ενώ στην ασφάλεια στον κυβερνοχώρο σημαίνει αντικατάσταση ευαίσθητων δεδομένων με μη ευαίσθητα σύμβολα κράτησης θέσης. Και οι δύο έννοιες περιλαμβάνουν τη μετατροπή πληροφοριών σε μικρότερες μονάδες, αλλά για εντελώς διαφορετικούς σκοπούς. Το cl100k_base tokenizer του OpenAI έχει λεξιλόγιο με ακριβώς 100.256 μοναδικά διακριτικά.
Regional Guides
▾
United States▾
European Union▾
Asia-Pacific▾
References
Λάβετε εβδομαδιαίες συμβουλές για τα μαθηματικά
Εγγραφείτε σε 12.000+ συνδρομητές που λαμβάνουν συμβουλές για την αριθμομηχανή κάθε εβδομάδα.