Mit gecachtem tiktoken 0.12.0 sinken die großen Banking- und HTTP-Graphen von 37,846 auf 32,486 beziehungsweise von 161,861 auf 134,165 cl100k_base-Tokens. Die HTTP-Aufgabenansicht sinkt von 5,602 auf 5,010. Der vollständige model-text-Umschlag wird mitgezählt und gegen dieselbe JSON-Auswahl erneut geprüft.
Kontext ist messbar. Kostenvorteile sind noch nicht belegt.
Das Gegenbeispiel vor der Behauptung veröffentlichen.
Semaprax veröffentlicht jetzt gemessene Tokens kompakter Projektionen, Anbieterbelege pro Aufgabe, einen kostenpflichtigen Qualifikationstest der Entwicklungswerkzeuge sowie Messungen echter Rust-Anwendungen und Hot Reloads. Manche Ansichten schrumpfen, kleine Ansichten wachsen. Die dokumentierte Kostenkampagne qualifizierte keine neue Standardeinstellung; die kleine Hot-Reload-Testanwendung war langsamer als ein Neustart.
entity Semaprax
status beta
snapshot 615e501
authority github.com/wavect/semapraxRepository-Status zum geprüften Snapshot
| Repository-Snapshot | 615e501 · 2026-10-06. Das Tag v0.8.0 verweist auf den festgehaltenen Quellcommit. Die exakte Tag-CI war erfolgreich. Daraus folgt keine allgemeine Produktions- oder Sicherheitsgarantie. |
|---|---|
| Status des Gesamtprodukts | 55 Teilweise · 0 Implementiert · 0 Fehlend |
| Graph- und Projektvertrag | Kanonischer Quellcode, stabile IDs und geprüfte Compiler-Repräsentationen verbinden Regeln, semantische Abfragen, Änderungen und Ausführung. Die je nach Feature gewählten Graph- und Project-Schemas behalten ihre eigenen Vorgaben für Zulassung, Kompatibilität und Host-Berechtigungen. |
| Veröffentlichte Betaversion | v0.8.0 · Veröffentlicht am 6. Oktober 2026 um 07:37 UTC. Alle 82 Jobs für den exakten Release-Tag waren erfolgreich. Veröffentlicht wurden drei Toolchain-Archive, SHA256SUMS, Attestierungen für jedes Archiv und eine signierte gemeinsame Herkunftsdokumentation. Der Release-Job prüfte den signierten Satz vor der Veröffentlichung unabhängig. Die Archive sind nicht notarisiert; reproduzierbare Builds werden nicht zugesichert. Eine Offline-Prüfung bestätigt keinen aktuellen Widerrufsstatus. Exakte Tag-CI. |
| Paket- und API-Vorschau | Die Veröffentlichung enthält nutzbare Profile für die Sprache, Quellcode-Regeln, Entwicklungswerkzeuge und Host-Integrationen. Für generierte Rust/npm-Pakete, öffentliche generische ABIs und weitere Plattformen gelten weiterhin eigene Entscheidungen über Veröffentlichung und Unterstützung. |
Ist Semaprax für Coding-Agenten günstiger?
Ein allgemeiner Kostenvorteil ist nicht belegt. Exakte lokale cl100k_base-Messungen zeigen kleinere model-text-Inhalte für zwei große Graphen und einen HTTP-Aufgabenkontext, während kleine Kontexte wachsen. Eine separate kostenpflichtige Kampagne der Entwicklungswerkzeuge maß die Kosten pro akzeptierter Aufgabe. Die beste Einsparung lag bei etwa 1% und damit unter der vorab festgelegten Schwelle von 10%. Anbieternutzung, lokale Tokenzahlen, Ausführungsgeschwindigkeit und Aufgabenkorrektheit bleiben getrennte Messgrößen.
Dieselben ausgewählten Fakten, auf zwei Arten gezählt
Fünf Zeilen aus dem eingecheckten lokalen Bericht zu model-text v2. Die Werte nutzen cl100k_base für den gesamten Inhalt einschließlich Metadaten. Es sind lokale Tokenizer-Zählungen, keine Anbieterrechnungen. Ein höherer model-text-Wert ist eine Verschlechterung.
| Ausgewählte Ansicht | JSON-Tokens | Model-text-Tokens |
|---|---|---|
| Banking-Ledger: vollständiger Graph | 37846 | 32486 |
| ledger.apply: Aufgabenkontext | 1679 | 1802 |
| HTTP-Anwendung: vollständiger Graph | 161861 | 134165 |
| HTTP app.main: Aufgabenkontext | 5602 | 5010 |
| Calculator-Project: Graph | 2500 | 2615 |
Sechs Messreihen oder erneut geprüfte Nachweispfade
Der Ledger-Aufgabenkontext wächst von 1,679 auf 1,802 Tokens; der Graph des Calculator-Projects wächst von 2,500 auf 2,615. Feste Metadaten können den Kompressionsvorteil überwiegen. Ein Vergleich von Quellcode und Kontext beantwortet eine andere Frage als die Kodierung derselben ausgewählten Fakten.
Tokenberichte gruppieren kompatible Tokenizer-Fingerprints, Methoden und Messgrenzen. Belege der Entwicklungswerkzeuge erhalten die tatsächliche Anbieternutzung, fehlgeschlagene oder abgeschnittene Versuche und geschätzte im Vergleich zu gemeldeten Kosten. Fehlende Werte bleiben nicht verfügbar. Belege allein sind noch kein Vergleichsergebnis.
Die Kampagne vom 5. Oktober nutzte Claude Haiku 4.5 über einen Messadapter: 711 Aufrufe und USD 3.10 erfasste Ausgaben. Jeder Versuchsarm akzeptierte 109 von 120 Aufgaben. Die beste Einsparung bei den Kosten pro akzeptierter Aufgabe lag bei etwa 1% und damit unter den geforderten 10%. Kein Arm qualifizierte sich; die Standardeinstellungen blieben unverändert. Der Anwendungspfad durchläuft nicht den vollständigen Semaprax-Quellcode-Workflow.
Für gespeicherte Regex/Url-, Serde/Iterator- und reqwest/Tokio-Anwendungen liegen Belege aus sauberen Offline-Läufen mit fixierten Abhängigkeiten für macOS arm64 und einen Linux-x86-64-Gast vor, jeweils mit 22 bestandenen Stufen oder Messungen. Übersichten zu Kopien und Allokationen ergänzen die Ergebnisse. Schlechterer M1/M3-Durchsatz wird weiter untersucht und ist kein Beleg für nahezu overheadfreie Ausführung.
Bei der dokumentierten macOS-arm64-Testanwendung lag der Median eines kalten Reloads von A nach B bei 545.694 ms, gegenüber 37.904 ms für einen vollständigen Neustart. Elf Messungen und getrennte Werte für Zulassung, Vorbereitung, Warten und Aktivierung erhalten diesen Gegenbefund. Das zeigt geprüfte Kontinuität, keine Beschleunigung und kein Ergebnis für andere Betriebssysteme.
Was diese Ergebnisse nicht belegen
- Einen allgemeinen Vorteil bei vom Anbieter abgerechneten Tokens oder Kosten pro akzeptierter Aufgabe über Projekte und Modelle hinweg.
- Bessere Korrektheit, Latenz oder Wartungsproduktivität als Rust, TypeScript oder eine andere Sprache.
- Universelle Rust-Interoperabilität ohne Mehraufwand oder die Leistung eines physischen Linux-x86-64-Hosts auf Basis eines emulierten Gasts.
- Einen Geschwindigkeitsvorteil durch Hot Reload, den Austausch nativer/Wasm-Prozesse oder breite Plattformleistung.
- Die Leistung der aktuellen Veröffentlichung aus historischen Debug-Build-Zeiten oder Korrektheit aus einem Kontextkompressionsverhältnis.
Nötige Evidenz vor einer Kostenaussage
- Gleichwertige Aufgaben, Quellcode-Revisionen, Adapter und die Abnahmebewertung vor dem Experiment festlegen.
- Modellidentität, Berechtigungen, Token- und Geldgrenzen, Wiederholungen und Abbruchregeln vergleichbar halten.
- Vollständige Anbieterbelege, Laufzeit, Quote akzeptierter Aufgaben und fehlgeschlagene Regressionstests erfassen, einschließlich erfolgloser Versuche.
- Rohmessungen, fehlende Nachweise, Ausschlüsse und Unsicherheit veröffentlichen. Lokale Tokenizer getrennt von abgerechneter Nutzung halten.
- Vor einer Änderung der Standardeinstellungen die festgelegten Qualitäts- und Kostenschwellen verlangen; mit weiteren Projekten, Modellen und Hosts wiederholen.
Geprüft anhand des Tags v0.8.0 und seines festgehaltenen Quellcommits. Versionierte Spezifikationen definieren Zulassung und Befugnisse; ältere Release-Überschriften in Matrix und Roadmap sind historisch. GitHub-Repository.
Das Semaprax-Handbuch öffnen
Das Online-Handbuch ist die englische Anleitung aus main und kann Änderungen nach 0.8.0 behandeln. Nutze den fixierten Snapshot, um diese Veröffentlichung nachzuvollziehen.
Aktuelles Handbuch
Der aktuelle englische Lernpfad, veröffentlicht aus main.
Handbuch-Snapshot von 0.8.0
Die Handbuchdateien am exakt geprüften Release-Commit.
Dein erstes Projekt erstellen
Aktuelle englische Anleitung zu Rechner-Manifest, Prüfungen, Tests und Builds.
Die Grundlagen der Sprache lernen
Aktuelle englische Einführung in Werte, Funktionen und Quellcodestruktur.
Mit einem Coding-Agenten arbeiten
Aktuelle englische Anleitung zu semantischem Kontext und sicheren Änderungsabläufen.
CLI-Referenz für 0.8.0
Fixierte Befehlsformen und die Abgrenzung zwischen eigenständiger CLI und vollständiger Toolchain.
VS-Code-Erweiterung
Fixierte Einrichtung, semantische Navigation, Review und Entwicklungssteuerung.
Ausführbare Beispiele
Fixierte Beispiele für Sprache, Projekte, Regeln, Agents und Host-Integrationen.
Primärquellen für diese Seite
Geprüft anhand des Tags v0.8.0 und seines festgehaltenen Quellcommits. Versionierte Spezifikationen definieren Zulassung und Befugnisse; ältere Release-Überschriften in Matrix und Roadmap sind historisch.
- Vertrag für kompaktes model-text und exakte Tokentabelle
- Lokaler Tokenmessbericht mit Rohdaten
- Tokenberichte für einzelne Eingaben und Sitzungen
- Semantik von Anbieterbelegen, Kosten und Ausgabegrenzen
- Kostenpflichtige Werkzeugqualifikation und unveränderte Standards
- Belege und Mehraufwand echter Rust-Anwendungen
- Hot-Reload-Zeiten und Vergleich mit Neustarts
- Ursprüngliche Messgrenze des Kontexts
Fragen und praktische Antworten
Braucht Semaprax weniger Tokens als Rust oder C?
Ein allgemeiner Sprachvergleich ist nicht belegt. Die Tabelle für kompakte Kontexte vergleicht zwei Kodierungen derselben ausgewählten Semaprax-Fakten und enthält Einsparungen wie Verschlechterungen. Eine separate kostenpflichtige Kampagne der Entwicklungswerkzeuge maß Kosten pro akzeptierter Aufgabe. Ihre beste Einsparung von ungefähr 1% erreichte die Qualifikationsschwelle von 10% nicht.
Warum einen Benchmark ohne Einsparung veröffentlichen?
So sehen Nutzer, wann eine Optimierung hilft und wann nicht. Kleine kompakte Ansichten können wachsen, die dokumentierte Hot-Reload-Testanwendung ist langsamer als ein Neustart und manche Rust-Anwendungspfade haben schlechteren Durchsatz. Zusammen mit den positiven Nachweisen machen diese Ergebnisse Entscheidungen über Standards und Unterstützung prüfbar.