Context Compression for LLMs in Rust | Signum

Signum is a Rust library and CLI for deterministic context compression before an LLM call. Publishing in the third release round.

Sobald das Repository veröffentlicht ist, lies die Implementierungshinweise, führe die lokale Binärdatei selbst aus und lege das Ergebnis neben die Passage, die es erzeugt hat. Signum erscheint in der dritten Runde des Foundation-Release-Programms, mit der Dokumentation am selben Tag.

Ein dichtes Datenformat mit veröffentlichten Roundtrips.

Ein begrenzter Weg von einer Frage zu belegten Beweisen.

Ein gewebtes Modell, das neben der Antwort eine Spur hinterlässt.

Migrationsaufgabe nicht abgeschlossen Verbindung Replikat abgebrochen 30 Sekunden.

Migration Verbindung Replikat abgebrochen 30

Die Stufe verschiebt einen numerischen Schnitt durch eine feste Wortrangfolge. Sie vertieft auch die Strafe für Füllwörter, wenn die Einstellung innerhalb des Textes steigt.

Angeheftete Positionen gehen unabhängig von ihrem Rang vor dem Budget durch. Die nächsten Schutzregeln erklären, wo Korrektheit und nicht Präferenz entscheidet.

Acht Span-Arten werden vor der ersten Bewertung zu nummerierten Platzhaltern. Überschriften, Zitate, Tabellen und eingerückte Zeilen werden als ganze Zeilen ausgeklammert.

Nach der Komprimierung werden Platzhalter wiederhergestellt, egal ob sie normal oder in Kleinbuchstaben geschrieben wurden. Das Ergebnis bleibt byte-identisch, wo eine Person oder Maschine sich darauf verlassen muss.

Die Obergrenze wird gewährt, bevor normale Boni gezählt werden können. Keine Kombination aus Länge, Großschreibung oder Seltenheit erreicht sie.

Das macht eine Verneinung zu einer Garantie statt zu einem wahrscheinlichen Überlebenden. Es ist überall dort wichtig, wo eine sauber aussehende gegenteilige Aussage einen stillen Fehler erzeugen würde.

Der Rückwärtsscan überspringt kleine Wörter zwischen einer Partikel und ihrem Verb. Wenn er eine Handlung findet, erhalten beide Positionen erzwungenes Gewicht.

Eine einzelne Partikel gewinnt nichts und kann mit dem Füllmaterial fallen. Diese Unterscheidung hält "set up" am Leben, während eine gewöhnliche Präposition gehen darf.

Neunundvierzig Reduktionen greifen ohne Kontext, bevor die Rangfolge beginnt. Sechzehn andere warten auf das folgende Wort, bevor sie aktiv werden.

Ein Großbuchstabe, eine Ziffer, ein Pfadzeichen oder ein deklarierter Begriff öffnet das Tor. Ein gewöhnliches Substantiv lässt die Phrase unberührt, weil sich die Aussage ändern würde.

Prosa und Code nutzen alle fünf Positionen, während Tool-Ausgabe drei hat. Fünf maschinenförmige Klassen landen auf einer Position, ohne das Zifferblatt zu lesen.

Ein Log, Diff oder Datensatz erzeugt daher bei jeder Aufrufereinstellung dasselbe Ergebnis. Die Klassifizierung legt die Behandlung fest, bevor die Komprimierung beginnt.

Ein struktureller Durchgang behandelt jede Zeile nach ihrer Funktion. Tabellen und Regeln passieren, während Absätze und Höflichkeiten gekürzt werden können.

Eine Gesprächsrunde mit Belegen bleibt vollständig. Jeder Ersatz wird nur behalten, wenn er kleiner als das Original ist.

Der Abschnittsdurchgang lässt einen Abschnitt über der Obergrenze, aber unter der Untergrenze zu. Er verhindert, dass ein Dokument zu dürftig wird, um zu antworten.

Der Satzdurchgang gehorcht nur der Obergrenze und kann innerhalb eines Abschnitts kürzen. Der Dispatcher versucht zuerst den Weg mit zwei Grenzen.

Markerwörter werden über fünfunddreißig Codes gezählt, wobei eindeutige Marker dreimal so viel wert sind wie geteilte. Eine Sprache muss einen Schwellenwert überschreiten, bevor ihre Regeln gelten.

Ungarisch, Finnisch und Estnisch werden bei Bedarf vor dem Nachschlagen gestemmt. Ein unsicheres Ergebnis fällt auf allgemeine Regeln zurück und entfernt weniger.

Jede Stufe behält ein Ergebnis nur, wenn es weniger Token als seine Eingabe verwendet. Ein kurzer Text kehrt genau so zurück, wie er angekommen ist, unverändert.

Getrennte Kompressoren geben dieselbe Ausgabe zurück, weil nichts stichprobenartig ist. Tests prüfen sowohl die Größenbegrenzung als auch die Wiederholbarkeit.

Entfernung, Ähnlichkeit und Lesbarkeit gehören zu demselben gemessenen Lauf. Die Lesbarkeit prüft, dass eine stärkere Einsparung die Prosa nicht verstümmelt hat.

Das Korpus bestand aus 5.520 Sätzen aus fünfzig technischen Dokumenten mit aktiviertem Nachschlagen. Ein anderes Korpus braucht seine eigene Messung statt eines geliehenen Versprechens.

Jeder Satz wird mit der Abfrage unter Verwendung von drei Gram-Codierungen verglichen. Die Stichwortüberschneidung bewertet den Rest.

Die Hälfte überlebt, mit einem Minimum von drei, und kehrt dann in der ursprünglichen Reihenfolge zurück. Ein Absatz mit weniger als vier Sätzen wird unverändert zurückgegeben.

Die ausgehende Hälfte einer Modellrechnung ist die Hälfte, die Ihr Team ändern kann. Sie besteht aus zusammengestelltem Kontext und wird oft mehr als einmal unverändert gesendet.

Eine lokale Regel entfernt dieses Gerüst vor dem kostenpflichtigen Aufruf. Sie erstellt keine zweite Rechnung und ändert nicht die Antwort, die dennoch generiert werden muss.

Ein Prüfer kann jedes entfernte Wort der Regel zuordnen, die es entfernt hat. Die markierte Kopie gibt ihnen etwas Konkretes zum Prüfen und Freigeben.

Eine Zusammenfassung hinterlässt nur ein Urteil, dem man gegen die Erinnerung vertrauen muss. Der Satz, nach dem später jemand fragt, ist genau der, der möglicherweise verschwunden ist.

Die Kürzung läuft in dem Prozess, der das Dokument bereits enthält. Kein Endpunkt, keine Anbieterwarteschlange und kein zusätzlicher Prozessor erhält eine Kopie.

Der regelbasierte Schritt bleibt beim Code, der das Dokument verarbeitet.

Stabile Ergebnisse machen wiederholte Dokumente zu nützlichen Cache-Einträgen. Tests bestätigen exakte Ausgaben und nicht nur etwas, das plausibel erscheint.

Ein Unterschied zwischen zwei Läufen ist dann ein Befund, kein Rauschen. Das gibt einer späteren Vorfallprüfung einen festen, prüfbaren Teil ihres Protokolls.

Befehle, Verweise und zitierter Fehlertext bleiben vollständig außerhalb der Kürzung. Auch neun englische Wörter, die eine Aussage umkehren, sind geschützt.

Ein kopierter Befehl funktioniert weiterhin, und ein zitierter Fehler kann weiterhin gesucht werden. Ein Satz kann sich bei hoher Einstellung nicht leise in sein Gegenteil verkehren.

Eine Komponente deckt sorgfältige Kundenbriefe und unverblümte Maschinenprotokolle ab. Die Klassifizierung entscheidet, ob eine Anrufereinstellung überhaupt relevant ist.

Protokolle, Diffs und Aufzeichnungen können korrigiert oder einen separaten dichten Weg nehmen. Das hält die Beschaffung bei einer Komponente statt bei mehreren Werkzeugen.

Der Dokumentdurchlauf respektiert sowohl eine Obergrenze als auch ein Minimum. Sein Minimum hält einen kürzeren Abschnitt substanziell genug, um die Frage zu beantworten.

Der Satzdurchlauf respektiert allein die Obergrenze, wenn nur das Fenster zählt. Die Wahl gehört in die Code-Review, nicht in eine überstürzte manuelle Entscheidung.

Die Komponente bestimmt die Sprache aus dem Text, nicht aus der Mandanteneinrichtung. Ein Schwellenwert verhindert, dass eine unsichere Lesart die falschen Regeln anwendet.

Jeder erkannte Code bringt seine eigenen Funktionswörter und Ersetzungen mit. Sprachen mit starken Endungen werden vor Beginn der Suche gestemmt.

Jede Werkzeugantwort enthält Bytes rein, Bytes raus und die resultierende Ersparnis. Ihr eigener Datenverkehr liefert also bereits ab dem ersten Aufruf die Belege.

Eine Woche echter Eingabeaufforderungen verwandelt den Fall in eine Summe statt in eine Schätzung. Kein separates Überwachungssystem muss dieselbe Arbeit erneut messen.

Software entfernt Füllmaterial, bevor eine KI einen langen Bericht liest. Mehr von dem, was Sie eingefügt haben, passt in dieselbe Anfrage.

Es funktioniert innerhalb des Werkzeugs, das den Bericht bereits verarbeitet. Es wird nichts zusätzlich weggeschickt, nur um den Text zu kürzen.

Eine Zusammenfassung bittet etwas, zu entscheiden, was in Ihrem Dokument wichtig ist. Feste Regeln entfernen nur die Arten von Wörtern, die auf ihrer Liste stehen.

Sie können die beiden Kopien nebeneinanderlegen und jedes Wort sehen, das verschwunden ist. Das ist sicherer, als der Erinnerung zu vertrauen, wenn ein fehlender Satz wichtig ist.

Einige lange Wörter werden gegen ein kürzeres Wort aus einer festen Tabelle getauscht. Dasselbe Wort erhält bei jedem Dokument denselben Tausch.

Das Ergebnis mag abgehackt statt poliert klingen. Sein Sinn bleibt erhalten, und der nächste Leser braucht diesen Sinn, nicht die formelle Formulierung.

Codes, Links und exakter Warntext werden herausgehoben, bevor eine Kürzung beginnt. Überschriften und Tabellenzeilen bleiben aus demselben Grund an Ort und Stelle.

Ein falsches Zeichen kann eine Suche, ein Formular oder einen Befehl stoppen. Diese Verweise kehren genau so zurück, wie sie geschrieben wurden.

Die Kürzung geschieht auf der Maschine, die den Text bereits hat. Kein neues Unternehmen erhält ein Dokument, um es zu verkleinern.

Derselbe Absatz liefert morgen auch denselben kürzeren Absatz. Wenn er sich ändert, hat sich etwas an der Eingabe oder den Regeln geändert, nicht an einer Meinung.

Signum ermittelt die Sprache aus den Wörtern und Buchstaben in der Nachricht. Sie müssen ein Dokument nicht taggen oder vor dem Senden konfigurieren.