Token Efficient Data Format for LLMs | Dweve HEDL

HEDL names a table columns once and writes each record behind a pipe, so a table sent to a language model carries under half the bytes it does as JSON.

Orchestrazione multi-agente con HEDL in tutto il processo.

Recupero sub-millisecondo per prompt più ricchi.

Pipeline di parsing con indirizzamento per contenuto.

Installa HEDL, esegui il server MCP davanti ai tuoi strumenti e guarda il consumo di token diminuire. Il corpus di benchmark è nel repository.

PARSING CON INDIRIZZAMENTO PER CONTENUTO

Stessa semantica, codifica più densa, ripristino esatto.

Core Rust con zero dipendenze e nessun codice non sicuro.

Nessun fornitore nel percorso. La conversione avviene localmente.

HEDL è distribuito come libreria Rust, server MCP e componente WASM. Il parser core ha zero dipendenze e nessun codice non sicuro; la conversione è locale, bidirezionale e senza perdita tra i formati supportati.

Libreria, server MCP e WASM espongono lo stesso percorso di conversione senza perdita.

Statistiche del progetto a colpo d'occhio

Pipeline di agenti, recupero, estrazione batch, ovunque i token LLM siano fatturati a volume. I risparmi si accumulano man mano che le catene di chiamate agli strumenti si allungano. Stessi dati in ingresso, stesse risposte in uscita, l'unica cosa che cambia è il numero sulla fattura.

Round-trip senza perdita in entrambe le direzioni

Parser di schema, encoder posizionale, adattatore MCP

Davanti a qualsiasi strumento, zero modifiche all'app

Inserisci il server MCP e il tuo stack di agenti parla HEDL a monte e JSON a valle senza modifiche al codice dell'applicazione. Il proxy registra il conteggio dei token prima e dopo ogni richiesta. Una crate Rust, una CLI e una build WASM coprono l'uso embedded e nel browser.

Misurato su 571 attività di estrazione su 7 dataset, eseguito su Mistral Large, DeepSeek Chat e NVIDIA GLM-4.7.

I valori che intendevi inviare. In HEDL, quasi tutto ciò che rimane.

Una coppia di virgolette attorno a ogni stringa, anche a quelle non ambigue.

Parentesi graffe e quadre che marcano una struttura che lo schema già conosce.

Gli stessi nomi di campo, pagati di nuovo su ogni record.

JSON è il formato di scambio universale, ma come input per LLM è dispendioso. Nomi di campo ripetuti, parentesi strutturali e virgolette attorno a ogni stringa sono byte che paghi senza significato. Isola ogni parte qui sotto per vedere esattamente cosa compra il tuo budget di token.

Non abbiamo dato per scontato che gli LLM comprendessero un formato più denso. Lo abbiamo testato. In una singola esecuzione misurata su 571 domande di estrazione strutturata su 7 dataset reali, HEDL ha usato il 56 percento in meno di token rispetto a JSON e ha registrato la massima accuratezza tra i formati in quella esecuzione. Il risultato appartiene a quel modello, corpus e setup di test.

Da JSON a HEDL e viceversa, byte per byte.

Stessi record, schema dichiarato una volta.

HEDL dichiara uno schema una volta sola, poi codifica i record in modo posizionale. Nessun nome di campo ripetuto. Nessuna parentesi per la nidificazione. Stringhe non quotate per impostazione predefinita. Scegli un dataset e guarda il conteggio dei token scendere mentre i dati restano identici. Il round-trip è senza perdite.

Progettato e mantenuto in Europa, con conversione eseguita ovunque lo distribuisca.

Il core Rust ha zero dipendenze e nessun codice non sicuro.

Non telefona a casa. Nulla attraversa un confine che non hai approvato.

Nessun fornitore nel percorso. La conversione gira localmente sulle tue macchine.

La conversione gira sulle tue macchine, in una regione UE, o completamente offline. HEDL non telefona a casa e non richiede servizi esterni, quindi i record strutturati restano dentro il confine che già gestisci.

Rimuovi il proxy e ogni sistema a valle continua con JSON semplice.

Conteggi token reali, registrati per richiesta.

Un flusso di lavoro AI, nient'altro toccato.

Non c'è una migrazione big-bang da pianificare. Metti il convertitore davanti a un flusso di lavoro AI, confronta i conteggi token registrati, poi espandi solo dove il risparmio regge. Il percorso è reversibile: rimuovi il proxy e ogni sistema a valle continua con JSON semplice.

Rimuovi il convertitore; database e report continuano a ricevere JSON ordinario.

Converte al confine, quindi i tuoi database e report non cambiano mai.

Parquet per data lake e Neo4j Cypher per database a grafo, in entrambe le direzioni.

JSON, YAML, XML e CSV, le forme che la maggior parte dei team già scambia ogni giorno.

In entrambe le direzioni, dentro e fuori HEDL

Nessuno deve strappare via nulla. HEDL converte da e verso i formati che i tuoi sistemi già usano, in entrambe le direzioni, e si mette davanti ai tuoi strumenti AI come un singolo drop-in. La versione densa esiste solo nel viaggio verso il modello. Tutto a valle vede le forme che ha sempre visto.

Il contatore scala allo stesso ritmo in salita e in discesa, così puoi leggere un valore vicino al tuo consumo reale.

Il risparmio è semplicemente i token che HEDL elimina. Meno da inviare significa meno da pagare, a parità di dati.

Il riferimento pubblicato: un servizio con un miliardo di token al mese risparmia 1.680 dollari al mese passando da JSON.

I token vengono fatturati in base al volume e HEDL ne invia il 56 percento in meno per gli stessi dati. Scegli la dimensione che assomiglia al tuo utilizzo e osserva le cifre mensili e annuali cambiare. Il punto di riferimento pubblicato è un servizio con un miliardo di token al mese, che risparmia 1.680 dollari al mese.

Ogni chiamata AI è prezzata in base al token e gran parte di quel budget è sintassi piuttosto che dati. HEDL ha inviato la stessa richiesta con il 56 percento in meno di token nell'esecuzione misurata e ha mostrato una differenza di precisione di +10,3 pp rispetto a JSON in quel contesto. Questa è la prova di questa configurazione, insieme a una bolletta più bassa, senza modificare i sistemi a valle.

Il corpus di benchmark e i controlli di andata e ritorno rendono visibile l'effetto prima della produzione.

Parla JSON semplice al resto del tuo stack. Rimuovilo e torni a JSON, byte per byte.

Un livello compatto si trova davanti al modello; il resto dei tuoi sistemi continua a parlare JSON.

HEDL aggiunge un livello di scambio compatto davanti al modello mentre ogni database, report e applicazione continua a parlare JSON. Esegui la conversione localmente, misurala su un flusso di lavoro e rimuovila senza migrazione dei dati se i numeri non reggono.

Meno parole da pagare, con la stessa risposta alla fine.

Ogni messaggio compatto viene ripristinato e controllato prima che la risposta arrivi a te.

Cambia solo il modo in cui il messaggio viene piegato per l'invio.

Non vedi mai HEDL né lo tocchi. Sta dietro all'assistente.

HEDL è un piccolo componente che rende gli assistenti AI più economici da eseguire, senza cambiare ciò che ti rispondono. Non lo installi, non lo configuri e non devi capirlo. Ecco l'intera promessa, in quattro brevi righe.

No. Il messaggio completo viene ripristinato prima di essere utilizzato.

La versione completa torna parola per parola.

Il significato rimane esattamente lo stesso.

È normale avere domande, e non esistono domande stupide. Ecco le cinque che le persone fanno più spesso, ciascuna con una risposta chiara e niente di nascosto. Tocca una domanda per leggere la risposta.

Le etichette sono scritte una volta, non su ogni riga.

L'assistente legge meno per risponderti.

Non avvierai mai HEDL né lo vedrai. Ma ogni volta che uno di quegli assistenti AI sta facendo un lavoro per te, è lì in silenzio, rendendo l'assistente più economico da eseguire. Scegli un momento e guarda cosa fa dietro le quinte.

Il messaggio compatto viene riconvertito nella versione completa e controllato prima di essere utilizzato.

Sì. Il modo breve si ripiega nel modo lungo, parola per parola.

No. Il significato rimane esattamente lo stesso, ogni volta.

No. Non lo vedi mai né lo configuri. Fa il suo lavoro da solo.

Pensa di scrivere lo stesso indirizzo su cento buste. Potresti scriverlo per intero ogni volta, o scriverlo una volta e tenerlo breve sulle altre. Le lettere arrivano comunque. HEDL fa il modo breve per te, ed ecco cosa significa per il tuo lato.

Lo stesso messaggio, detto con meno parole.

Niente parole tecniche, niente grafici. Solo l'idea, come la spiegheresti a un amico. HEDL è un modo più breve per i computer di dire la stessa cosa a un assistente AI, così la stessa risposta costa meno da ottenere.

+10,3 punti percentuali rispetto alla media JSON

HEDL si pone davanti ai tuoi strumenti AI e invia le stesse richieste con il 56 percento in meno di token, parlando JSON semplice al resto del tuo stack. Niente cambia a valle: il risultato è una bolletta di token più bassa, una differenza di precisione misurata in una singola esecuzione di benchmark e una conversione che può girare sulle tue macchine senza spostare dati su un altro servizio.

No, il viaggio di andata e ritorno è verificato

Meno parole significa una bolletta più bassa

Un modo più breve per dire la stessa cosa

Non devi conoscere nessuna delle parole tecniche per seguire questo. Quando un computer parla con uno di quegli assistenti AI, invia molte parole, e ogni parola viene pagata, un po' come una bolletta telefonica contata a parole. HEDL è un modo per dire esattamente la stessa cosa con molte meno parole. Niente viene omesso, il significato rimane lo stesso e la risposta che ricevi non cambia. Costa solo meno, e non devi mai toccarlo.