Context Compression for LLMs in Rust | Signum

Signum is a Rust library and CLI for deterministic context compression before an LLM call. Publishing in the third release round.

Groupes d'algorithmes par type de données

Une fois le dépôt publié, lisez les notes d'implémentation, exécutez vous-même le binaire local et placez le résultat à côté du passage qui l'a produit. Signum arrive dans la troisième vague du programme de publication de la fondation, avec sa documentation disponible le même jour.

Un format de données dense avec des allers-retours publiés.

Un parcours borné d'une question à des preuves sourcées.

Un modèle tissé qui laisse une trace à côté de la réponse.

tâche de migration non terminée connexion réplique interrompue 30 secondes.

Le niveau déplace une coupure numérique dans un classement de mots fixe. Il approfondit aussi la pénalité sur les mots de liaison à mesure que le réglage augmente dans le passage.

Les positions épinglées passent avant le budget, quel que soit leur rang. Les protections suivantes expliquent où la correction, plutôt que la préférence, réside.

Huit types de segments deviennent des substituts numérotés avant le premier score. Les titres, citations, tableaux et lignes délimitées sont conservés comme des lignes entières.

Après compression, les espaces réservés sont restaurés, qu'ils soient écrits normalement ou en minuscules. Le résultat reste identique octet par octet là où une personne ou une machine doit pouvoir s'y fier.

Le plafond est accordé avant que les bonus ordinaires puissent être comptés. Aucune combinaison de longueur, de majuscules ou de rareté ne l'atteint.

Cela fait d'une négation une garantie plutôt qu'un survivant probable. Cela importe partout où une déclaration opposée d'apparence propre créerait une erreur silencieuse.

Le balayage en arrière enjambe les petits mots entre une particule et son verbe. Quand il trouve une action, les deux positions gagnent un poids forcé.

Une particule isolée ne gagne rien et peut tomber avec le remplissage. Cette distinction maintient set up tout en laissant une préposition ordinaire passer.

Quarante-neuf réductions se déclenchent sans contexte avant le début du classement. Seize autres attendent le mot qui suit avant d'agir.

Une majuscule, un chiffre, un caractère de chemin ou un terme déclaré ouvre la porte. Un nom ordinaire laisse l'expression intacte parce que la revendication changerait.

La prose et le code utilisent les cinq positions, tandis que la sortie d'outil en a trois. Cinq classes façonnées par machine atterrissent à une position sans lire le cadran.

Un journal, une diff ou un ensemble d'enregistrements produit donc le même résultat à chaque réglage d'appelant. La classification règle le traitement avant le début de la compression.

Un passage structurel traite chaque ligne selon son rôle. Les tableaux et les règles passent, tandis que les paragraphes et la courtoisie peuvent être raccourcis.

Un tour de conversation contenant des preuves reste entier. Chaque remplacement n'est conservé que s'il est plus petit que l'original.

Le passage de section admet une section au-dessus du plafond tout en dessous du plancher. Il empêche un document de devenir trop léger pour répondre.

Le passage de phrase obéit au seul plafond et peut couper dans une section. Le répartiteur essaie d'abord la voie à deux limites.

Les mots marqueurs sont comptés sur trente-cinq codes, les marqueurs uniques valant trois fois les partagés. Une langue doit franchir un seuil avant que ses règles s'appliquent.

Le hongrois, le finnois et l'estonien sont racinisés avant la recherche lorsque nécessaire. Un résultat incertain retombe sur les règles générales et supprime moins.

Chaque étape ne conserve un résultat que s'il utilise moins de jetons que son entrée. Un passage court revient exactement comme il est arrivé, inchangé.

Des compresseurs séparés renvoient la même sortie parce que rien n'échantillonne. Les tests affirment à la fois la limite de taille et la répétabilité.

La suppression, la similarité et la lisibilité appartiennent à la même exécution mesurée. La lisibilité vérifie qu'une économie plus forte n'a pas brouillé la prose.

Le corpus était de 5 520 phrases provenant de cinquante documents techniques avec la recherche activée. Un corpus différent nécessite sa propre mesure plutôt qu'une promesse empruntée.

Chaque phrase est comparée à la requête en utilisant trois encodages de grammes. Le chevauchement de mots-clés score le reste.

La moitié survit, avec un minimum de trois, puis revient dans l'ordre d'origine. Un passage de moins de quatre phrases revient tel quel.

La moitié sortante d'une facture modèle est la moitié que votre équipe peut modifier. C'est un contexte assemblé, souvent envoyé inchangé plus d'une fois.

Une règle locale supprime cet échafaudage avant l'appel payant. Elle ne crée pas de seconde facture ni ne modifie la réponse qui doit encore être générée.

Un relecteur peut nommer chaque mot supprimé par la règle qui l'a supprimé. La copie marquée leur donne quelque chose de concret à inspecter et à approuver.

Un résumé ne laisse qu'un jugement à croire de mémoire. La phrase dont on demandera plus tard est précisément celle qui a pu disparaître.

Le raccourcissement s'exécute dans le processus qui détient déjà le document. Aucun point de terminaison, file d'attente fournisseur ou processeur supplémentaire n'en reçoit de copie.

L'étape basée sur des règles reste avec le code qui traite le document.

Des résultats stables font des documents répétés des entrées de cache utiles. Les tests affirment une sortie exacte plutôt que quelque chose de simplement plausible.

Une différence entre deux exécutions est alors un constat, pas du bruit. Cela donne à un examen d'incident ultérieur une partie fixe et inspectable de son dossier.

Les commandes, les références et le texte d'erreur cité restent entièrement hors du raccourcissement. Neuf mots anglais qui inversent une affirmation sont également protégés.

Une commande copiée s'exécute toujours et une erreur citée peut toujours être recherchée. Une phrase ne peut pas changer silencieusement en son contraire à un réglage élevé.

Un composant couvre les lettres client soignées et les journaux machine directs. La classification décide si un paramètre d'appelant est même pertinent.

Les journaux, les diffs et les enregistrements peuvent être corrigés ou suivre une voie dense séparée. Cela maintient l'approvisionnement à un composant au lieu de plusieurs outils.

Le passage de document respecte à la fois un plafond et un minimum. Son plancher maintient un passage plus court suffisamment substantiel pour répondre à la question.

Le passage de phrase respecte le plafond seul lorsque la fenêtre est tout ce qui compte. Le choix appartient à la revue de code, pas à une décision manuelle précipitée.

Le composant détermine la langue à partir du texte, pas de la configuration du locataire. Un seuil empêche une lecture incertaine d'appliquer les mauvaises règles.

Chaque code reconnu apporte ses propres mots de fonction et substitutions. Les langues à terminaisons lourdes sont racinisées avant le début de la recherche.

Chaque réponse d'outil porte les octets entrants, les octets sortants et l'économie résultante. Votre propre trafic fournit donc la preuve dès le premier appel.

Une semaine de vraies invites transforme le cas en une somme plutôt qu'en une estimation. Aucun système de surveillance séparé n'a à mesurer le même travail à nouveau.

Le logiciel supprime le remplissage avant qu'une IA ne lise un long rapport. Plus de ce que vous avez collé peut tenir dans la même requête.

Cela fonctionne dans l'outil qui gère déjà le rapport. Rien d'extra n'est envoyé simplement pour rendre le texte plus court.

Un résumé demande à quelque chose de décider ce qui compte dans votre document. Des règles fixes ne suppriment que les types de mots écrits sur leur liste.

Vous pouvez mettre les deux copies ensemble et voir chaque mot qui est parti. C'est plus sûr que de se fier à la mémoire quand une phrase manquante compte.

Certains mots longs sont échangés contre un mot plus court d'une table fixe. Le même mot reçoit le même échange sur chaque document.

Le résultat peut sembler sec plutôt que poli. Son sens reste présent et le prochain lecteur a besoin de ce sens, pas de la formulation formelle.

Les codes, les liens et le texte d'erreur exact sont retirés avant que tout raccourcissement ne commence. Les titres et les lignes de tableau restent en place pour la même raison.

Un mauvais caractère peut empêcher une recherche, un formulaire ou une commande de fonctionner. Ces références reviennent exactement comme elles ont été écrites.

Le raccourcissement se produit sur la machine qui a déjà le texte. Aucune nouvelle entreprise ne reçoit un document pour le rendre plus petit.

Le même paragraphe renvoie également le même paragraphe plus court demain. S'il change, quelque chose a changé dans l'entrée ou les règles, pas une opinion.

Signum détermine la langue à partir des mots et des lettres du message. Vous ne marquez pas un document ni ne le configurez avant de l'envoyer.

S'il n'est pas sûr, il utilise des règles générales et supprime moins. Les terminaisons sont retirées en premier dans les langues où elles cachent le mot en dessous.