{"id":29192,"date":"2026-09-20T15:48:11","date_gmt":"2026-09-20T13:48:11","guid":{"rendered":"https:\/\/www.caseking.de\/blog\/?p=29192"},"modified":"2026-09-20T15:48:12","modified_gmt":"2026-09-20T13:48:12","slug":"was-sind-ai-tokens","status":"publish","type":"post","link":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens","title":{"rendered":"Was sind AI Tokens? Einfach erkl\u00e4rt"},"content":{"rendered":"<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_88 counter-hierarchy ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">Inhaltsverzeichnis<\/p>\n<span class=\"ez-toc-title-toggle\"><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Was_sind_AI_Tokens\" >Was sind AI Tokens?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Welche_Arten_von_AI_Tokens_gibt_es\" >Welche Arten von AI Tokens gibt es?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Wie_funktionieren_Tokens_bei_einem_AI-Modell\" >Wie funktionieren Tokens bei einem AI-Modell?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Wie_viele_Woerter_sind_1000_Tokens\" >Wie viele W\u00f6rter sind 1.000 Tokens?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-5\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Was_haben_Tokens_mit_dem_Kontextfenster_zu_tun\" >Was haben Tokens mit dem Kontextfenster zu tun?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-6\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Was_kosten_KI%E2%80%91Tokens\" >Was kosten KI\u2011Tokens?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-7\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Lokale_kuenstliche_Intelligenz_Keine_Rechnung_fuer_jede_Anfrage\" >Lokale k\u00fcnstliche Intelligenz: Keine Rechnung f\u00fcr jede Anfrage<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-8\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Tokens_pro_Sekunde_Die_FPS_der_lokalen_AI\" >Tokens pro Sekunde: Die FPS der lokalen AI?<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-9\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#FAQ_Haeufige_Fragen_zu_AI_Tokens\" >FAQ: H\u00e4ufige Fragen zu AI Tokens<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-10\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\/#Tokens_sind_klein_%E2%80%93_fuer_lokale_AI_aber_entscheidend\" >Tokens sind klein &#8211; f\u00fcr lokale AI aber entscheidend<\/a><\/li><\/ul><\/nav><\/div>\n\n<p class=\"wp-block-paragraph\"><strong>Was sind AI Tokens<\/strong> und warum taucht dieser Begriff \u00fcberall auf, sobald es um Chatbots, LLMs oder lokale AI geht?&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Vereinfacht gesagt sind Tokens die kleinen Bausteine, in die ein AI-Modell deine Eingaben zerlegt und aus denen es anschlie\u00dfend seine Antwort zusammensetzt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Tokens entscheiden dabei nicht nur dar\u00fcber, wie ein Sprachmodell Texte verarbeitet. Sie beeinflussen auch die maximale L\u00e4nge eines Chats, die Geschwindigkeit der Ausgabe und bei vielen Cloud-Diensten sogar die Kosten.&nbsp;<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Wer AI dagegen lokal auf dem eigenen PC betreibt, muss zwar weiterhin mit Tokens rechnen &#8211; bezahlt aber nicht jeden einzelnen davon an einen Anbieter.<\/p>\n\n\n\n<figure class=\"wp-block-image size-full\"><img loading=\"lazy\" decoding=\"async\" width=\"1024\" height=\"576\" src=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg.webp\" alt=\"\" class=\"wp-image-23034\"\/ loading=\"lazy\" srcset=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg.webp 1024w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg-300x169.webp 300w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg-768x432.webp 768w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg-850x478.webp 850w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2025\/07\/Undervolt-GPU-Blank-Overclockers-UK-Blog-Feature-Image-Bottom-Text-Blog-1600x900Light-TextTwitter-1024x576.jpg-400x225.webp 400w\" sizes=\"auto, (max-width: 1024px) 100vw, 1024px\" \/><\/figure>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Was_sind_AI_Tokens\"><\/span><strong>Was sind AI Tokens?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Ein Sprachmodell verarbeitet einen Satz nicht einfach Wort f\u00fcr Wort so, wie wir ihn lesen. Stattdessen zerlegt ein sogenannter <strong>Tokenizer<\/strong> den Text in kleinere Einheiten: die Tokens.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ein Token kann ein vollst\u00e4ndiges Wort sein, aber genauso nur ein Teil davon, ein einzelnes Zeichen oder ein Satzzeichen. Selbst Schreibweise, Leerzeichen und verwendete Sprache k\u00f6nnen beeinflussen, wie ein Text zerlegt wird. Deshalb gilt: <strong>Ein Token ist nicht automatisch ein Wort.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Nehmen wir beispielsweise das Wort:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Grafikkarte<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr dich ist das ein einziges Wort. Ein Tokenizer k\u00f6nnte daraus jedoch mehrere Bestandteile machen. Wie genau diese Aufteilung aussieht, h\u00e4ngt vom jeweiligen Modell und dessen Tokenizer ab.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Kurze und h\u00e4ufig vorkommende W\u00f6rter passen dagegen h\u00e4ufig in ein einzelnes Token.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das ist einer der Gr\u00fcnde, warum zwei AI-Modelle f\u00fcr exakt denselben Text unterschiedlich viele Tokens ben\u00f6tigen k\u00f6nnen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Welche_Arten_von_AI_Tokens_gibt_es\"><\/span><strong>Welche Arten von AI Tokens gibt es?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Nicht alle Tokens erf\u00fcllen denselben Zweck. Gerade bei AI-APIs und Reasoning-Modellen begegnen dir unterschiedliche Bezeichnungen. F\u00fcr den Einstieg reichen diese vier Kategorien:<\/p>\n\n\n\n<figure class=\"wp-block-table is-style-stripes\"><table class=\"has-fixed-layout\"><tbody><tr><td><strong>Token-Art<\/strong><\/td><td><strong>Was bedeutet das?<\/strong><\/td><\/tr><tr><td><strong>Input Tokens<\/strong><\/td><td>Tokens, die du dem Modell als Eingabe \u00fcbergibst. Dazu geh\u00f6ren dein Prompt, vorherige Nachrichten und zus\u00e4tzlicher Kontext. Sie werden auch als Prompt Tokens bezeichnet.<\/td><\/tr><tr><td><strong>Output Tokens<\/strong><\/td><td>Tokens, die das AI-Modell f\u00fcr seine Antwort erzeugt. Bei manchen APIs werden sie auch Completion Tokens genannt.<\/td><\/tr><tr><td><strong>Cached Input Tokens<\/strong><\/td><td>Bereits verarbeitete Eingaben, die \u00fcber Prompt Caching erneut genutzt werden k\u00f6nnen. Je nach Anbieter k\u00f6nnen daf\u00fcr andere Preise gelten als f\u00fcr normale Input Tokens.<\/td><\/tr><tr><td><strong>Reasoning Tokens<\/strong><\/td><td>Tokens, die bestimmte Reasoning-Modelle intern f\u00fcr ihre Verarbeitung nutzen, bevor sie die sichtbare Antwort erzeugen.<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr die meisten Nutzer sind vor allem <strong>Input und Output Tokens<\/strong> wichtig. Sie bestimmen, wie viel Text ein Modell verarbeitet und erzeugt \u2013 und bei vielen Cloud-Diensten letztlich auch, wie hoch die Kosten ausfallen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Wie_funktionieren_Tokens_bei_einem_AI-Modell\"><\/span><strong>Wie funktionieren Tokens bei einem AI-Modell?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Schreibst du einer AI beispielsweise:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>\u201eWelche Grafikkarte brauche ich f\u00fcr ein lokales LLM?\u201c<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Landet dieser Satz nicht direkt im Sprachmodell. Zuerst zerlegt der Tokenizer deine Eingabe in Tokens und ordnet diesen intern Zahlenwerte zu.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das Modell verarbeitet anschlie\u00dfend diese numerische Darstellung und berechnet, welches Token mit hoher Wahrscheinlichkeit als N\u00e4chstes folgen sollte. Danach wiederholt sich der Vorgang.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Token f\u00fcr Token entsteht daraus schlie\u00dflich die Antwort.<\/p>\n\n\n\n<figure class=\"wp-block-image size-full\"><img loading=\"lazy\" decoding=\"async\" width=\"726\" height=\"285\" src=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-39.png\" alt=\"\" class=\"wp-image-29195\"\/ loading=\"lazy\" srcset=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-39.png 726w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-39-300x118.png 300w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-39-499x196.png 499w\" sizes=\"auto, (max-width: 726px) 100vw, 726px\" \/><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Genau deshalb erscheint die Antwort vieler Sprachmodelle nach und nach auf dem Bildschirm. Das Modell generiert sie w\u00e4hrend der Inferenz St\u00fcck f\u00fcr St\u00fcck.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Wie_viele_Woerter_sind_1000_Tokens\"><\/span><strong>Wie viele W\u00f6rter sind 1.000 Tokens?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Eine feste Umrechnung gibt es nicht. Wie viele Tokens ein Text ben\u00f6tigt, h\u00e4ngt unter anderem von Sprache, Modell, Tokenizer und Inhalt ab.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr englischen Text gilt als grobe Faustregel:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>1.000 Tokens entsprechen ungef\u00e4hr 750 W\u00f6rtern.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Oder anders gerechnet: Ein Token entspricht im Englischen durchschnittlich etwa vier Zeichen beziehungsweise ungef\u00e4hr drei Vierteln eines Wortes. Diese Werte sind allerdings lediglich N\u00e4herungen. Bei deutschen Texten k\u00f6nnen die Ergebnisse aufgrund l\u00e4ngerer W\u00f6rter und anderer Wortstrukturen deutlich anders aussehen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Was_haben_Tokens_mit_dem_Kontextfenster_zu_tun\"><\/span><strong>Was haben Tokens mit dem Kontextfenster zu tun?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Tokens bestimmen auch, wie viele Informationen ein Sprachmodell gleichzeitig ber\u00fccksichtigen kann. Hier kommt das sogenannte <strong>Kontextfenster<\/strong> oder \u201eContext Window\u201c ins Spiel.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Hat ein Modell beispielsweise ein Kontextfenster von 32.000 Tokens, k\u00f6nnen innerhalb dieses Limits unter anderem deine Eingabe, Teile des bisherigen Gespr\u00e4chs, zus\u00e4tzliche Dokumente und die generierte Antwort verarbeitet werden.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Wird das Limit erreicht, m\u00fcssen \u00e4ltere oder weniger relevante Informationen entfernt, zusammengefasst oder anderweitig gek\u00fcrzt werden. Die genaue Vorgehensweise h\u00e4ngt von der jeweiligen Anwendung ab.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ein gr\u00f6\u00dferes Kontextfenster erm\u00f6glicht entsprechend l\u00e4ngere Gespr\u00e4che oder umfangreichere Dokumente. Gleichzeitig steigt jedoch der Rechen- und Speicheraufwand.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das wird auch beim Thema <strong>lokale KI<\/strong> wichtig: Sehr gro\u00dfe Modelle und lange Kontexte stellen h\u00f6here Anforderungen an deine Hardware.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Was_kosten_KI%E2%80%91Tokens\"><\/span><strong>Was kosten KI\u2011Tokens?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Bei vielen kommerziellen KI-APIs sind Tokens gleichzeitig die Abrechnungseinheit. Dabei wird meist zwischen zwei wichtigen Arten unterschieden:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Input Tokens<\/strong> sind alles, was das Modell als Eingabe verarbeiten muss. Dazu geh\u00f6ren beispielsweise dein Prompt, vorherige Nachrichten oder zus\u00e4tzliche Kontextinformationen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Output Tokens<\/strong> sind die Tokens, die das Modell anschlie\u00dfend f\u00fcr seine Antwort erzeugt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Je nach Dienst k\u00f6nnen daf\u00fcr unterschiedliche Preise gelten. H\u00e4ufig wird der Preis pro einer Million Tokens angegeben. Welche Kosten tats\u00e4chlich entstehen, h\u00e4ngt stark vom verwendeten Modell und Anbieter ab.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Bei den meisten KI-Abonnements bekommst du davon nicht unbedingt unmittelbar etwas mit. Wer Modelle \u00fcber eine API in eigene Programme, KI-Agenten oder andere Anwendungen integriert, muss den Token-Verbrauch dagegen h\u00e4ufig direkt ber\u00fccksichtigen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Ein langer Prompt plus eine lange Antwort kann entsprechend mehr kosten als eine kurze Anfrage.<\/p>\n\n\n\n<figure class=\"wp-block-image size-full\"><img loading=\"lazy\" decoding=\"async\" width=\"832\" height=\"468\" src=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40.png\" alt=\"\" class=\"wp-image-29198\"\/ loading=\"lazy\" srcset=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40.png 832w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-300x169.png 300w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-500x281.png 500w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-291x164.png 291w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-631x355.png 631w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-768x432.png 768w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-400x225.png 400w, https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/image-40-501x282.png 501w\" sizes=\"auto, (max-width: 832px) 100vw, 832px\" \/><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Und genau an dieser Stelle wird lokale AI interessant.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Lokale_kuenstliche_Intelligenz_Keine_Rechnung_fuer_jede_Anfrage\"><\/span><strong>Lokale k\u00fcnstliche Intelligenz: Keine Rechnung f\u00fcr jede Anfrage<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">L\u00e4uft ein Sprachmodell direkt auf deinem eigenen Gaming-PC oder einer KI-Workstation, funktioniert das Modell grunds\u00e4tzlich weiterhin mit Tokens.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Der entscheidende Unterschied: <strong>Du zahlst keinem externen Anbieter einen festen Betrag pro verarbeitetem oder generiertem Token.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Stattdessen verschieben sich die Kosten auf deine eigene Hardware. Dazu geh\u00f6ren insbesondere Grafikkarte, Arbeitsspeicher, Stromverbrauch und gegebenenfalls weitere Komponenten.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Tokens sind lokal also nicht kostenlos im Sinne von \u201esie ben\u00f6tigen keine Ressourcen\u201c. Deine GPU muss jeden Token weiterhin berechnen. Es gibt lediglich keinen Anbieter, der dir anschlie\u00dfend beispielsweise eine Million generierte Tokens in Rechnung stellt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Bei selbst betriebenen Sprachmodellen l\u00e4sst sich deshalb theoretisch ebenfalls ein effektiver Preis pro Token berechnen. Dieser ergibt sich dann jedoch aus Hardwarekosten, Stromverbrauch und Auslastung statt aus einer festen API-Preisliste.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Gerade wenn du deine Hardware ohnehin besitzt, entsteht dadurch ein v\u00f6llig anderes Nutzungsmodell: Du kannst dein lokales KI-Modell immer wieder verwenden, ohne bei jedem langen Chat auf einen wachsenden Token-Z\u00e4hler beim AI-Anbieter schauen zu m\u00fcssen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Tokens_pro_Sekunde_Die_FPS_der_lokalen_AI\"><\/span><strong>Tokens pro Sekunde: Die FPS der lokalen AI?<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Wenn du dich mit lokalen Sprachmodellen besch\u00e4ftigst, wirst du noch eine weitere Angabe h\u00e4ufig sehen:<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><strong>Tokens pro Sekunde &#8211; kurz tok\/s.<\/strong><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Damit wird beschrieben, wie schnell ein Modell Tokens erzeugt. Je h\u00f6her der Wert, desto schneller erscheint die generierte Antwort.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">F\u00fcr Gaming-Enthusiasten l\u00e4sst sich das grob mit FPS beim Gaming vergleichen. Die Werte beschreiben zwar v\u00f6llig unterschiedliche Dinge, erf\u00fcllen aber einen \u00e4hnlichen Zweck: Sie machen Performance vergleichbar.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Wie viele Tokens pro Sekunde dein System erreicht, h\u00e4ngt unter anderem vom AI-Modell, dessen Gr\u00f6\u00dfe und Einstellungen sowie deiner CPU, GPU und Speicherbest\u00fcckung ab.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Vor allem der verf\u00fcgbare <strong>VRAM deiner Grafikkarte<\/strong> wird beim Betrieb lokaler KI-Modelle schnell zu einem wichtigen Faktor.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"FAQ_Haeufige_Fragen_zu_AI_Tokens\"><\/span><strong>FAQ: H\u00e4ufige Fragen zu AI Tokens<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<div class=\"wp-block-getwid-accordion has-icon-left\" data-active-element=\"none\">\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Was ist ein AI Token?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">Ein AI Token ist eine kleine Verarbeitungseinheit, in die ein AI-Modell Texte zerlegt. Ein Token kann beispielsweise ein Wort, ein Wortteil, ein Zeichen oder ein Satzzeichen darstellen.<\/p>\n<\/div><\/div>\n\n\n\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Ist ein Token dasselbe wie ein Wort?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">Nein. Ein Wort kann aus einem Token, aber auch aus mehreren Tokens bestehen. Wie der Text aufgeteilt wird, h\u00e4ngt vom jeweiligen Modell und dessen Tokenizer ab.<\/p>\n<\/div><\/div>\n\n\n\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Wie viele W\u00f6rter sind 1.000 Tokens?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">F\u00fcr englische Texte entsprechen 1.000 Tokens grob etwa 750 W\u00f6rtern. Das ist allerdings nur eine Faustregel. Sprache, Inhalt und Tokenizer beeinflussen die tats\u00e4chliche Anzahl.<\/p>\n<\/div><\/div>\n\n\n\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Warum kosten Tokens Geld?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">Viele Cloud-Anbieter berechnen die Nutzung ihrer AI-Modelle anhand der verarbeiteten Input- und generierten Output-Tokens. Mehr Tokens bedeuten dadurch h\u00e4ufig h\u00f6here API-Kosten.<\/p>\n<\/div><\/div>\n\n\n\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Kostet lokale AI ebenfalls pro Token?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">Nein, wenn das Modell vollst\u00e4ndig auf deinem eigenen Rechner l\u00e4uft, stellt dir kein externer AI-Anbieter eine Rechnung pro Token. Kosten entstehen trotzdem durch Hardware und Stromverbrauch.<\/p>\n<\/div><\/div>\n\n\n\n<div class=\"wp-block-getwid-accordion__header-wrapper\"><span class=\"wp-block-getwid-accordion__header\"><a href=\"#\"><span class=\"wp-block-getwid-accordion__header-title\"><strong>Was bedeutet Tokens pro Sekunde?<\/strong><\/span><span class=\"wp-block-getwid-accordion__icon is-active\"><i class=\"fas fa-angle-right\"><\/i><\/span><span class=\"wp-block-getwid-accordion__icon is-passive\"><i class=\"fas fa-angle-down\"><\/i><\/span><\/a><\/span><\/div><div class=\"wp-block-getwid-accordion__content-wrapper\"><div class=\"wp-block-getwid-accordion__content\">\n<p class=\"wp-block-paragraph\">Tokens pro Sekunde beziehungsweise tok\/s beschreiben, wie viele Tokens ein AI-Modell innerhalb einer Sekunde erzeugen kann. Der Wert wird h\u00e4ufig verwendet, um die Geschwindigkeit lokaler Sprachmodelle zu vergleichen.<\/p>\n<\/div><\/div>\n<\/div>\n\n\n\n<p class=\"wp-block-paragraph\"><\/p>\n\n\n\n<h2 class=\"wp-block-heading\"><span class=\"ez-toc-section\" id=\"Tokens_sind_klein_%E2%80%93_fuer_lokale_AI_aber_entscheidend\"><\/span><strong>Tokens sind klein &#8211; f\u00fcr lokale AI aber entscheidend<\/strong><span class=\"ez-toc-section-end\"><\/span><\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Tokens wirken zun\u00e4chst wie ein unscheinbares technisches Detail. Tats\u00e4chlich begegnen sie dir aber an fast jeder Stelle, wenn du tiefer in lokale KI einsteigst.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Das Gute daran: Du musst sie weder z\u00e4hlen noch jedes Detail der Tokenisierung kennen, um AI auf deinem eigenen Rechner zu nutzen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Nutzt du bereits lokale AI auf deinem PC oder bist du gerade erst dabei, dich mit dem Thema zu besch\u00e4ftigen? Schreib es uns gerne in die Kommentare!<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Was sind AI Tokens und warum taucht dieser Begriff &uuml;berall auf, sobald es um Chatbots, LLMs oder lokale AI geht?&nbsp; Vereinfacht gesagt sind Tokens die kleinen Bausteine, in die ein AI-Modell deine Eingaben zerlegt und aus denen es anschlie&szlig;end seine Antwort zusammensetzt. Tokens entscheiden dabei nicht nur dar&uuml;ber, wie ein Sprachmodell Texte verarbeitet. Sie beeinflussen [&hellip;]<\/p>\n","protected":false},"author":34,"featured_media":29193,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[2227,2243],"tags":[3347,270,135,3344],"class_list":["post-29192","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tech-hardware","category-wissen","tag-ai","tag-caseking","tag-grafikkarte","tag-ki"],"yoast_head":"<!-- This site is optimized with the Yoast SEO plugin v28.5 - https:\/\/yoast.com\/product\/yoast-seo-wordpress\/ -->\n<title>Was sind AI Tokens? Einfach erkl\u00e4rt \u2013 und was kosten sie?<\/title>\n<meta name=\"description\" content=\"Was sind AI Tokens? Wir erkl\u00e4ren einfach, wie Tokens funktionieren, warum sie Geld kosten und was sich bei lokaler AI ver\u00e4ndert.\" \/>\n<meta name=\"robots\" content=\"index, follow, max-snippet:-1, max-image-preview:large, max-video-preview:-1\" \/>\n<link rel=\"canonical\" href=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\" \/>\n<meta property=\"og:locale\" content=\"de_DE\" \/>\n<meta property=\"og:type\" content=\"article\" \/>\n<meta property=\"og:title\" content=\"Was sind AI Tokens? Einfach erkl\u00e4rt \u2013 und was kosten sie?\" \/>\n<meta property=\"og:description\" content=\"Was sind AI Tokens? Wir erkl\u00e4ren einfach, wie Tokens funktionieren, warum sie Geld kosten und was sich bei lokaler AI ver\u00e4ndert.\" \/>\n<meta property=\"og:url\" content=\"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens\" \/>\n<meta property=\"og:site_name\" content=\"Caseking Blog | Gaming-PCs, Hardware-News &amp; Modding-Guides\" \/>\n<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/caseking\/\" \/>\n<meta property=\"article:published_time\" content=\"2026-09-20T13:48:11+00:00\" \/>\n<meta property=\"article:modified_time\" content=\"2026-09-20T13:48:12+00:00\" \/>\n<meta property=\"og:image\" content=\"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png\" \/>\n\t<meta property=\"og:image:width\" content=\"1600\" \/>\n\t<meta property=\"og:image:height\" content=\"900\" \/>\n\t<meta property=\"og:image:type\" content=\"image\/png\" \/>\n<meta name=\"author\" content=\"Marcel Bruns\" \/>\n<meta name=\"twitter:label1\" content=\"Verfasst von\" \/>\n\t<meta name=\"twitter:data1\" content=\"Marcel Bruns\" \/>\n\t<meta name=\"twitter:label2\" content=\"Gesch\u00e4tzte Lesezeit\" \/>\n\t<meta name=\"twitter:data2\" content=\"7\u00a0Minuten\" \/>\n<!-- \/ Yoast SEO plugin. -->","yoast_head_json":{"title":"Was sind AI Tokens? Einfach erkl\u00e4rt \u2013 und was kosten sie?","description":"Was sind AI Tokens? Wir erkl\u00e4ren einfach, wie Tokens funktionieren, warum sie Geld kosten und was sich bei lokaler AI ver\u00e4ndert.","robots":{"index":"index","follow":"follow","max-snippet":"max-snippet:-1","max-image-preview":"max-image-preview:large","max-video-preview":"max-video-preview:-1"},"canonical":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens","og_locale":"de_DE","og_type":"article","og_title":"Was sind AI Tokens? Einfach erkl\u00e4rt \u2013 und was kosten sie?","og_description":"Was sind AI Tokens? Wir erkl\u00e4ren einfach, wie Tokens funktionieren, warum sie Geld kosten und was sich bei lokaler AI ver\u00e4ndert.","og_url":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens","og_site_name":"Caseking Blog | Gaming-PCs, Hardware-News &amp; Modding-Guides","article_publisher":"https:\/\/www.facebook.com\/caseking\/","article_published_time":"2026-09-20T13:48:11+00:00","article_modified_time":"2026-09-20T13:48:12+00:00","og_image":[{"width":1600,"height":900,"url":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png","type":"image\/png"}],"author":"Marcel Bruns","twitter_misc":{"Verfasst von":"Marcel Bruns","Gesch\u00e4tzte Lesezeit":"7\u00a0Minuten"},"schema":{"@context":"https:\/\/schema.org","@graph":[{"@type":"Article","@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#article","isPartOf":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens"},"author":{"name":"Marcel Bruns","@id":"https:\/\/www.caseking.de\/blog\/#\/schema\/person\/499fc9c20cfe8b1a1edb06fa9b7b9c3b"},"headline":"Was sind AI Tokens? Einfach erkl\u00e4rt","datePublished":"2026-09-20T13:48:11+00:00","dateModified":"2026-09-20T13:48:12+00:00","mainEntityOfPage":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens"},"wordCount":1485,"commentCount":0,"publisher":{"@id":"https:\/\/www.caseking.de\/blog\/#organization"},"image":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#primaryimage"},"thumbnailUrl":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png","keywords":["AI","Caseking","Grafikkarte","KI"],"articleSection":["Tech + Hardware","Wissen"],"inLanguage":"de","potentialAction":[{"@type":"CommentAction","name":"Comment","target":["https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#respond"]}]},{"@type":"WebPage","@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens","url":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens","name":"Was sind AI Tokens? Einfach erkl\u00e4rt \u2013 und was kosten sie?","isPartOf":{"@id":"https:\/\/www.caseking.de\/blog\/#website"},"primaryImageOfPage":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#primaryimage"},"image":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#primaryimage"},"thumbnailUrl":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png","datePublished":"2026-09-20T13:48:11+00:00","dateModified":"2026-09-20T13:48:12+00:00","description":"Was sind AI Tokens? Wir erkl\u00e4ren einfach, wie Tokens funktionieren, warum sie Geld kosten und was sich bei lokaler AI ver\u00e4ndert.","breadcrumb":{"@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#breadcrumb"},"inLanguage":"de","potentialAction":[{"@type":"ReadAction","target":["https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens"]}]},{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#primaryimage","url":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png","contentUrl":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2026\/09\/Blog-Was-sind-KI-Tokens-Beitragsbild.png","width":1600,"height":900,"caption":"Blog Beitragsbild - KI Tokens Erkl\u00e4rt"},{"@type":"BreadcrumbList","@id":"https:\/\/www.caseking.de\/blog\/was-sind-ai-tokens#breadcrumb","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https:\/\/www.caseking.de\/blog"},{"@type":"ListItem","position":2,"name":"News","item":"https:\/\/www.caseking.de\/blog\/category\/news"},{"@type":"ListItem","position":3,"name":"Tech + Hardware","item":"https:\/\/www.caseking.de\/blog\/category\/news\/tech-hardware"},{"@type":"ListItem","position":4,"name":"Was sind AI Tokens? Einfach erkl\u00e4rt"}]},{"@type":"WebSite","@id":"https:\/\/www.caseking.de\/blog\/#website","url":"https:\/\/www.caseking.de\/blog\/","name":"Caseking Blog | Gaming-PCs, Hardware-News &amp; Modding-Guides","description":"Die neuesten Hardware und Games News, Ger\u00fcchte, Trends und vieles mehr","publisher":{"@id":"https:\/\/www.caseking.de\/blog\/#organization"},"potentialAction":[{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https:\/\/www.caseking.de\/blog\/?s={search_term_string}"},"query-input":{"@type":"PropertyValueSpecification","valueRequired":true,"valueName":"search_term_string"}}],"inLanguage":"de"},{"@type":"Organization","@id":"https:\/\/www.caseking.de\/blog\/#organization","name":"Caseking GmbH","url":"https:\/\/www.caseking.de\/blog\/","logo":{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/www.caseking.de\/blog\/#\/schema\/logo\/image\/","url":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2021\/09\/logo.png","contentUrl":"https:\/\/www.caseking.de\/blog\/wp-content\/uploads\/2021\/09\/logo.png","width":367,"height":200,"caption":"Caseking GmbH"},"image":{"@id":"https:\/\/www.caseking.de\/blog\/#\/schema\/logo\/image\/"},"sameAs":["https:\/\/www.facebook.com\/caseking\/","https:\/\/x.com\/caseking","https:\/\/www.instagram.com\/caseking.de","https:\/\/www.linkedin.com\/company\/caseking-gmbh\/","https:\/\/www.youtube.com\/channel\/UC8qA3SSeY04t_lWumt_SgEg"]},{"@type":"Person","@id":"https:\/\/www.caseking.de\/blog\/#\/schema\/person\/499fc9c20cfe8b1a1edb06fa9b7b9c3b","name":"Marcel Bruns","image":{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/secure.gravatar.com\/avatar\/97f54f496f36a2d7f73c2e95b889c7aaf3aa20866625c2f7d7b9852fa0e6573c?s=96&d=mm&r=g","url":"https:\/\/secure.gravatar.com\/avatar\/97f54f496f36a2d7f73c2e95b889c7aaf3aa20866625c2f7d7b9852fa0e6573c?s=96&d=mm&r=g","contentUrl":"https:\/\/secure.gravatar.com\/avatar\/97f54f496f36a2d7f73c2e95b889c7aaf3aa20866625c2f7d7b9852fa0e6573c?s=96&d=mm&r=g","caption":"Marcel Bruns"},"description":"Marcel stammt aus Bonn und ist im Berliner Umland aufgewachsen. Schon in der Schulzeit entwickelte er eine Leidenschaft f\u00fcr Technik und Gaming \u2013 seinen ersten PC zerlegte er direkt nach dem Auspacken, einfach um zu verstehen, wie er funktioniert. Bis heute baut er regelm\u00e4\u00dfig Gaming-PCs f\u00fcr sich und Freunde zusammen. Wenn er gerade nicht an seinem PC herumschraubt, taucht er gerne in die Welt der Anime ein und tr\u00e4umt davon, einmal Japan zu bereisen. In seiner Freizeit trifft man ihn entweder beim Zocken des neuesten AAA-Titels oder dabei, seine Teammates in League of Legends (mehr oder weniger absichtlich) zu inten.","url":"https:\/\/www.caseking.de\/blog\/author\/marcel-bruns"}]}},"_links":{"self":[{"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/posts\/29192","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/users\/34"}],"replies":[{"embeddable":true,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/comments?post=29192"}],"version-history":[{"count":4,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/posts\/29192\/revisions"}],"predecessor-version":[{"id":29199,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/posts\/29192\/revisions\/29199"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/media\/29193"}],"wp:attachment":[{"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/media?parent=29192"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/categories?post=29192"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.caseking.de\/blog\/wp-json\/wp\/v2\/tags?post=29192"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}