Een miljoen tokens zijn minder woorden dan u denkt: wij hebben het gemeten

Het bezwaar komt steevast naar voren zodra iemand het over een ‘tweede brein’ heeft. Huidige taalmodellen kunnen een miljoen tokens verwerken, sommige zelfs nog meer. Waarom zou u dan überhaupt notities sorteren, labelen en koppelen als u de hele stapel gewoon aan de AI kunt overdragen?
Het antwoord komt neer op een getal dat bijna niemand controleert. Tokens zijn de stukjes waaruit een model tekst opsplitst, en de eenheid waarmee het wordt gefactureerd. Hoeveel tekst een miljoen tokens omvat, hangt af van de taal en van de methode waarmee de opsplitsing plaatsvindt, de tokenizer. Daarom hebben we het gemeten in plaats van te gissen.
Hoe we hebben geteld
We zijn uitgegaan van twee teksten met identieke inhoud: de Duitse en Engelse versie van een van onze eigen tijdschriftartikelen. De Duitse versie telde 1.134 woorden en de Engelse versie 1.276 woorden. Beide tellingen hebben uitsluitend betrekking op de hoofdtekst en tussenkopjes, zonder bijschriften of een bronnenlijst. Alles tussen twee spaties telt als een woord. Beide versies werden verwerkt met behulp van de js-tiktoken-bibliotheek, versie 1.0.20: één keer met de o200k_base-codering die OpenAI gebruikt voor zijn huidige modellen, en één keer met cl100k_base, de oudere codering die door GPT-4 en GPT-3.5 wordt gebruikt.
Top 10 Testrapporten
» Top 10 Multimedia Notebooks
» Top 10 Gaming-Notebooks
» Top 10 Budget Gaming Laptops
» Top 10 Lichtgewicht Gaming-Notebooks
» Top 10 Premium Office/Business-Notebooks
» Top 10 Budget Office/Business-Notebooks
» Top 10 Workstation-Laptops
» Top 10 Subnotebooks
» Top 10 Ultrabooks
» Top 10 Notebooks tot €300
» Top 10 Notebooks tot €500
» Top 10 Notebooks tot € 1.000
» De beste notebookbeeldschermen
» Top Windows Alternatieven voor de MacBook Pro 13
» Top Windows Alternatieven voor de MacBook Pro 15
» Top Windows alternatieven voor de MacBook 12 en Air
» Top 10 best verkopende notebooks op Amazon
» Top 10 Convertible Notebooks
» Top 10 Tablets
» Top 10 Tablets tot € 250
» Top 10 Smartphones
» Top 10 Phablets (>90cm²)
» Top 10 Camera Smartphones
» Top 10 Smartphones tot €500
» Top 10 best verkopende smartphones op Amazon
De veel geciteerde vuistregel luidt dat één miljoen tokens overeenkomt met 750.000 woorden. Voor het Engels is deze schatting te conservatief; voor het Duits is deze aanzienlijk te ruim. De vergelijking tussen de twee coderingen zegt meer. Dezelfde Duitse tekst komt bij de ene codering uit op 1.747 tokens en bij de andere op 2.088. Een verschil van twintig procent, louter omdat de splitsing op basis van een andere methode plaatsvindt. De Engelse tekst bleef vrijwel ongewijzigd, met 1.200 tegenover 1.202 tokens per woord. De vooruitgang op het gebied van tokenizers kwam vrijwel volledig ten goede aan andere talen dan het Engels.
Voor Claude en Gemini is dezelfde test niet mogelijk, omdat Anthropic en Google hun tokenizers niet openbaar maken. Anthropic vermeldt in zijn prijsdocumentatie echter wel dat Claude 4.7 en nieuwere modellen een andere methode gebruiken die voor dezelfde tekst ongeveer 30 procent meer tokens genereert dan hun voorgangers. De onderstaande cijfers zijn daarom een orde van grootte, geen exacte waarde.
Wat dit betekent voor een verzameling uit de praktijk
Wij hebben een verzameling gemeten die in de loop der jaren is gegroeid: ongeveer 470 notities, geëxtrapoleerd naar 350.000 tot 400.000 woorden. Dat past net in een contextvenster, en de verzameling blijft groeien.
Maar een contextvenster wordt bij elke afzonderlijke vraag opnieuw gevuld en er wordt telkens opnieuw voor betaald. Het model onthoudt niets. Het leest elke keer opnieuw vanaf het begin. Bij GPT-5.6 Sol kosten één miljoen invoertokens vijf Amerikaanse dollar, en vanaf 272.000 tokens in één verzoek is dat tien dollar. 400.000 Duitse woorden komen neer op ongeveer 616.000 tokens, waardoor ze in de duurste tariefklasse vallen, dus 6,16 dollar. Per vraag. Tien vragen op één middag komen neer op ongeveer 60 dollar. Notion Business, het duurste abonnement in onze systeemvergelijking, kost 19,50 euro per gebruiker per maand.
Er zijn twee kanttekeningen. Deze berekening heeft betrekking op de API, de interface die ontwikkelaars gebruiken om een model rechtstreeks aan te spreken, en niet op de consumentenabonnementen. Gebruikers van ChatGPT Plus of Claude Pro betalen niet per token, maar bereiken uiteindelijk wel gebruikslimieten. En dan is er nog de caching. Bij een cache-hit brengen OpenAI en Anthropic slechts een tiende van de invoerprijs in rekening, waardoor $ 6,16 wordt omgezet in 62 cent. Afhankelijk van de instelling blijft de cache echter slechts vijf minuten tot een uur actief.
Waarom sorteren nog steeds de moeite waard is
Het gaat er niet om dat een notitiesysteem goedkoper zou zijn dan de AI. Het zorgt ervoor dat de stapel die überhaupt in de context moet worden opgenomen, kleiner wordt. Een degelijke full-textzoekfunctie, of een semantische index die op betekenis in plaats van op trefwoord zoekt, levert het model tien relevante notities op in plaats van vierhonderd.
Dat reduceert 616.000 tokens tot ongeveer 9.000 en $6,16 tot vijf cent. Voor de tokens is dat een verhouding van 67 op 1, voor de prijs 123 op 1, omdat de kleine aanvraag onder de dure drempel van 272.000 tokens blijft. Daarbovenop komt nog een effect dat in geen enkele prijstabel wordt weergegeven. Een model dat tien relevante notities leest, geeft nauwkeurigere antwoorden dan een model dat zich door vierhonderd notities heen werkt.
De werkelijke beperking ligt zelden in het contextvenster
Als u niet via de API werkt, stuit u sowieso veel eerder op een andere beperking. Bij ChatGPT hangt het aantal bestanden per project af van het abonnement: vijf bij het gratis abonnement, 25 bij Go en Plus, en 40 bij Pro, Business en de onderwijsabonnementen. Gemini Notebook staat 50 bronnen per notitieboek toe bij het gratis Standard-abonnement, 100 bij het Plus-abonnement en 300 bij het Pro-abonnement. Eén enkele bron mag maximaal 500.000 woorden bevatten.
Wat opvalt, is hoe inconsistent deze cijfers zijn. OpenAI vermeldt 25 bestanden voor het Plus-abonnement op de helppagina over projecten, maar 20 in de helpsectie over het uploaden van bestanden, terwijl beide pagina’s in dezelfde week voor het laatst zijn bijgewerkt. Als u hierop wilt vertrouwen, controleer dan het aantal in uw eigen account in plaats van af te gaan op de documentatie.
Dat verschuift de vraag. Wat bepaalt of een verzameling kan worden doorzocht, is niet het aantal van een miljoen tokens, maar of de tool deze überhaupt accepteert. En dat is precies waar uw eigen notitiesysteem zijn nut bewijst, omdat het niet selecteert wat erin gaat, maar alleen wat eruit komt.
Wat tegen het hele idee pleit
Een ‘tweede brein’ kost nog steeds moeite, en de programma’s hebben eigenaardigheden die u beter kunt kennen voordat u begint. Obsidian en Joplin draaien ook op telefoons, maar ze synchroniseren niet op de achtergrond. Obsidian beantwoordt die vraag in zijn eigen FAQ over synchronisatie met een duidelijk ‘nee’. Bestanden worden alleen gesynchroniseerd terwijl het programma actief is. Op een computer merkt u daar nauwelijks iets van, omdat de app meestal openstaat. Maar als u onderweg een notitie typt en de app wegveegt, komt deze pas op uw computer terecht wanneer u de app op uw telefoon weer opent. Dit geldt ook voor Obsidian Sync, de betaalde eigen synchronisatiedienst. Als u de map in iCloud bewaart of deze in plaats daarvan met Syncthing synchroniseert, doet die dienst het werk voor u. Notion beperkt afzonderlijke bestanden tot 5 MB in het gratis abonnement. En bij Gemini Notebook biedt Google geen mogelijkheid om terug te gaan. Verwijder een notitieboek en de bronnen verdwijnen mee. Alleen de Gemini-gesprekken verschijnen weer in de chatlijst.
Het beste advies is dus om twee weken lang notities te verzamelen en daarna een beslissing te nemen. Als u uiteindelijk dertig notities hebt, hebt u geen systeem nodig, maar een map. Als u er driehonderd hebt, zult u zelf merken wat er ontbreekt wanneer u iets zoekt.
Bron(nen)
OpenAI: API-tarieven, Anthropic: Tarieven voor modellen en functies, js-tiktoken 1.0.20, Notion: Abonnementsplannen, Notion: Afbeeldingen, bestanden en media, Obsidian: Veelgestelde vragen over synchronisatie, Joplin: Synchronisatie, Google: Gemini-notitieboeklimieten, Google: Notitieboeken verwijderen, OpenAI: Projecten in ChatGPT, OpenAI: Veelgestelde vragen over het uploaden van bestanden



