Context Compression for LLMs in Rust | Signum
Signum is a Rust library and CLI for deterministic context compression before an LLM call. Publishing in the third release round.
Più breve per regola. Pronto da ispezionare.
Quando il repository viene pubblicato, leggi le note di implementazione, esegui tu stesso il binario locale e metti il risultato accanto al passaggio che lo ha prodotto. Signum arriva nel terzo round del programma di rilascio della fondazione, con la sua documentazione disponibile lo stesso giorno.
Un formato dati denso con round trip pubblicati.
Un percorso delimitato da una domanda a prove con fonti.
Un modello intrecciato che lascia una traccia accanto alla risposta.
lavoro di migrazione non finito connessione replica caduta 30 secondi.
migrazione connessione replica caduta 30
Il livello sposta un taglio numerico attraverso una classifica di parole fissa. Aumenta anche la penalità sulle parole di collegamento man mano che l'impostazione sale all'interno del passaggio.
Le posizioni fissate superano il budget qualunque sia il loro rango. Le protezioni successive spiegano dove risiede la correttezza, piuttosto che la preferenza.
Otto tipi di span diventano segnaposto numerati prima del primo punteggio. Intestazioni, citazioni, tabelle e righe delimitate sono tenute fuori come righe intere.
Dopo la compressione, i segnaposto vengono ripristinati sia che siano scritti normalmente sia in minuscolo. Il risultato rimane byte-identico dove una persona o una macchina deve potervi fare affidamento.
Il tetto viene concesso prima che i bonus ordinari possano essere conteggiati. Nessuna combinazione di lunghezza, maiuscole o rarità lo raggiunge.
Questo rende una negazione una garanzia piuttosto che un probabile sopravvissuto. È importante ovunque un'affermazione opposta dall'aspetto pulito creerebbe un errore silenzioso.
La scansione all'indietro scavalca le parole brevi tra una particella e il suo verbo. Quando trova un'azione, entrambe le posizioni ricevono peso forzato.
Una particella isolata non guadagna nulla e può cadere con il riempitivo. Questa distinzione mantiene "set up" mentre lascia passare una preposizione ordinaria.
Quarantanove riduzioni scattano senza contesto prima che inizi la classifica. Altre sedici aspettano la parola successiva prima di agire.
Una maiuscola, una cifra, un carattere di percorso o un termine dichiarato apre il cancello. Un sostantivo ordinario lascia la frase intatta perché l'affermazione cambierebbe.
Prosa e codice usano tutte e cinque le posizioni, mentre l'output degli strumenti ne ha tre. Cinque classi a forma di macchina finiscono in una posizione senza leggere il quadrante.
Un log, un diff o un insieme di record produce quindi lo stesso risultato a ogni impostazione del chiamante. La classificazione stabilisce il trattamento prima che inizi la compressione.
Una passata strutturale tratta ogni riga in base al suo compito. Tabelle e regole passano, mentre paragrafi e cortesie possono accorciarsi.
Un turno di conversazione contenente prove rimane intero. Ogni sostituzione viene mantenuta solo se è più piccola dell'originale.
La passata di sezione ammette una sezione oltre il tetto mentre è sotto il pavimento. Impedisce che un documento diventi troppo esile per rispondere.
La passata di frase obbedisce solo al tetto e può tagliare all'interno di una sezione. Il dispatcher prova prima la via a due limiti.
Le parole marcatore vengono contate su trentacinque codici, con marcatori unici che valgono tre volte quelli condivisi. Una lingua deve superare una soglia prima che le sue regole si applichino.
Ungherese, finlandese ed estone vengono ridotti alla radice prima della ricerca dove necessario. Un risultato incerto ricade su regole generali e rimuove meno.
Ogni fase mantiene un risultato solo se usa meno token del suo input. Un passaggio breve ritorna esattamente come è arrivato, invariato.
Compressori separati restituiscono lo stesso output perché nulla campiona. I test verificano sia il limite di dimensione sia la ripetibilità.
Rimozione, similarità e leggibilità appartengono alla stessa esecuzione misurata. La leggibilità verifica che un risparmio più forte non abbia alterato la prosa.
Il corpus era di 5.520 frasi da cinquanta documenti tecnici con ricerca abilitata. Un corpus diverso richiede una propria misurazione piuttosto che una promessa presa in prestito.
Ogni frase viene confrontata con la query usando tre codifiche di grammi. La sovrapposizione di parole chiave determina il resto.
Metà sopravvive, con un minimo di tre, poi torna nell'ordine originale. Un passaggio sotto le quattro frasi torna come scritto.
La metà in uscita di un modello di fattura è la metà che il tuo team può modificare. È contesto assemblato, spesso inviato invariato più di una volta.
Una regola locale rimuove quell'impalcatura prima della chiamata a pagamento. Non crea una seconda fattura né altera la risposta che deve comunque essere generata.
Un revisore può nominare ogni parola rimossa dalla regola che l'ha rimossa. La copia marcata offre loro qualcosa di concreto da ispezionare e firmare.
Un riepilogo lascia solo un giudizio da fidarsi contro la memoria. La frase di cui qualcuno chiede più tardi è proprio quella che potrebbe essere scomparsa.
L'accorciamento avviene nel processo che già detiene il documento. Nessun endpoint, coda di fornitori o processore aggiuntivo riceve una copia.
Il passaggio basato su regole resta con il codice che gestisce il documento.
Risultati stabili rendono i documenti ripetuti utili voci di cache. I test affermano un output esatto piuttosto che qualcosa di semplicemente plausibile.
Una differenza tra due esecuzioni è quindi un risultato, non rumore. Questo dà a una successiva revisione di incidente una parte fissa e ispezionabile del suo registro.
Comandi, riferimenti e testo di errore citato restano completamente fuori dall'accorciamento. Anche nove parole inglesi che invertono un'affermazione sono protette.
Un comando copiato funziona ancora e un errore citato può ancora essere cercato. Una frase non può cambiare silenziosamente nel suo opposto a un'impostazione alta.
Un componente copre lettere clienti accurate e log macchina bruschi. La classificazione decide se un'impostazione del chiamante è anche rilevante.
Log, diff e record possono essere corretti o seguire un percorso denso separato. Questo mantiene l'approvvigionamento a un componente invece di diversi strumenti.
Il passaggio del documento rispetta sia un tetto che un minimo. Il suo pavimento mantiene un passaggio più corto abbastanza sostanzioso da rispondere alla domanda.
Il passaggio della frase rispetta solo il tetto quando la finestra è tutto ciò che conta. La scelta appartiene alla revisione del codice, non a una decisione manuale affrettata.
Il componente decide la lingua dal testo, non dalla configurazione del tenant. Una soglia impedisce a una lettura incerta di applicare le regole sbagliate.
Ogni codice riconosciuto porta le proprie parole funzione e sostituzioni. Le lingue con desinenze pesanti sono ridotte alla radice prima che inizi la ricerca.
Ogni risposta dello strumento riporta byte in ingresso, byte in uscita e il risparmio risultante. Il tuo stesso traffico fornisce quindi le prove dalla prima chiamata.
Una settimana di prompt reali trasforma il caso in una somma piuttosto che in una stima. Nessun sistema di monitoraggio separato deve misurare di nuovo lo stesso lavoro.
Il software rimuove il riempitivo prima che un'IA legga un rapporto lungo. Più di ciò che hai incollato può entrare nella stessa richiesta.
Funziona all'interno dello strumento che già gestisce il rapporto. Niente di extra viene inviato altrove semplicemente per rendere il testo più corto.
Un riepilogo chiede a qualcosa di decidere cosa conta nel tuo documento. Le regole fisse rimuovono solo i tipi di parole scritti nella loro lista.
Puoi mettere insieme le due copie e vedere ogni parola che è andata. Questo è più sicuro che fidarsi della memoria quando una frase mancante conta.
Alcune parole lunghe vengono scambiate con una parola più corta da una tabella fissa. La stessa parola riceve lo stesso scambio su ogni documento.
Il risultato può sembrare secco piuttosto che rifinito. Il suo senso rimane presente e il prossimo lettore ha bisogno di quel senso, non della formulazione formale.
Codici, link e testo di avviso esatto vengono sollevati prima che inizi qualsiasi accorciamento. Intestazioni e righe di tabella restano al loro posto per lo stesso motivo.
Un carattere sbagliato può impedire il funzionamento di una ricerca, un modulo o un comando. Quei riferimenti tornano esattamente come sono stati scritti.
L'accorciamento avviene sulla macchina che ha già il testo. Nessuna nuova azienda riceve un documento per renderlo più piccolo.
Lo stesso paragrafo restituisce anche lo stesso paragrafo più corto domani. Se cambia, qualcosa è cambiato nell'input o nelle regole, non un'opinione.
Signum capisce la lingua dalle parole e dalle lettere nel messaggio. Non devi etichettare un documento o configurarlo prima di inviarlo.
Se non è sicuro, usa regole generali e rimuove meno. Le desinenze vengono via prima nelle lingue in cui nascondono la parola sottostante.
veicolo sostitutivo · eccesso · copertura