KI-Prompt-Token-Zähler & Kostenschätzer — Echtzeit-BPE-Tokenizer
Berechnen Sie genaue Token und Live-API-Kosten für GPT-4o, o1, Claude 3.5 Sonnet und Gemini 1.5. 100% clientseitig im Browser ohne Server-Logs.
Flagship multimodal model with o200k_base tokenization
API-Kostenschätzer
$2.50 / $10.00 per 1MModellübergreifende Kostenvergleichs-Matrix
Live Estimates (USD)| Model | Provider | Context | Input / 1M | Output / 1M | Total Est. Cost |
|---|---|---|---|---|---|
| GPT-4o (Omni) | OpenAI | 128k | $2.50 | $10.00 | $0.0000 |
| GPT-4o-mini | OpenAI | 128k | $0.15 | $0.60 | $0.0000 |
| OpenAI o1 | OpenAI | 200k | $15.00 | $60.00 | $0.0000 |
| Claude 3.5 Sonnet | Anthropic | 200k | $3.00 | $15.00 | $0.0000 |
| Claude 3.5 Haiku | Anthropic | 200k | $0.80 | $4.00 | $0.0000 |
| Gemini 1.5 Pro | 2000k | $1.25 | $5.00 | $0.0000 | |
| Gemini 1.5 Flash | 1000k | $0.07 | $0.30 | $0.0000 | |
| DeepSeek-V3 | DeepSeek | 64k | $0.14 | $0.28 | $0.0000 |
| Llama 3.3 (70B) | Meta | 128k | $0.20 | $0.60 | $0.0000 |
Reserved high-performance space. Zero Cumulative Layout Shift (CLS) guaranteed.
BPE-Tokenisierung, Kontextgrenzen und LLM-Preise verstehen
Große Sprachmodelle (LLMs) wie GPT-4o, Claude 3.5 und Gemini verarbeiten Text nicht direkt als Wörter, sondern wandeln ihn mittels Byte-Pair Encoding (BPE) in diskrete Zahleneinheiten (Token) um.
Im Englischen entspricht 1 Token etwa 4 Zeichen oder 0,75 Wörtern. Bei Quellcode und internationalen Schriften wie Arabisch komprimieren moderne Tokenizer wie o200k_base deutlich effizienter.
Die API-Abrechnung erfolgt pro 1 Million Token. Ausgabetoken sind typischerweise 3- bis 4-mal teurer als Eingabetoken, da sie sequentiell berechnet werden müssen.
OmniTools berechnet alle Werte zu 100% lokal im Browser-Speicher – absolut vertraulich und sicher.
Häufig gestellte Fragen (FAQ)
Unser Algorithmus ist auf cl100k- und o200k-Vokabulare kalibriert und erreicht eine Genauigkeit von ca. 1-3% gegenüber offiziellen Binärdateien.
Eingaben können hochgradig parallel auf GPUs verarbeitet werden, während Ausgaben autoregressiv Token für Token generiert werden müssen.
Nein, keinesfalls. Die gesamte Analyse läuft vollständig isoliert in Ihrem Browser ab.