Context Compression for LLMs in Rust | Signum

Signum is a Rust library and CLI for deterministic context compression before an LLM call. Publishing in the third release round.

Rövidebb szabály szerint. Készen áll az ellenőrzésre.

Amint a tároló megjelenik, olvassa el a megvalósítási jegyzeteket, futtassa le a helyi binárist, és tegye az eredményt az azt előállító szakasz mellé. A Signum az alapítványi kiadási program harmadik körében érkezik, dokumentációja még aznap elérhető.

Sűrű adatformátum közzétett oda-vissza átjárásokkal.

Korlátozott út a kérdéstől a forrásokkal alátámasztott bizonyítékig.

Szövött modell, amely nyomot hagy a válasz mellett.

migrációs feladat nem befejeződött kapcsolat replika megszakadt 30 másodperc.

migráció kapcsolat replika megszakadt 30

bizonytalanság esetén kevesebbet távolíts el

A szint egy numerikus vágást mozgat egy rögzített szó rangsoron. Emellett mélyíti a kötőszavakra vonatkozó büntetést, ahogy a beállítás emelkedik a szövegrészen belül.

A rögzített pozíciók a költségvetés előtt haladnak át, függetlenül a rangsoruktól. A következő védelmek elmagyarázzák, hol él a helyesség, nem pedig a preferencia.

Nyolc fesztávtípus számozott helyettesítővé válik az első pontszám előtt. A fejlécek, idézetek, táblázatok és keretezett sorok egész sorokként vannak kivonva.

A tömörítés után a helyőrzők visszaállnak, akár normál, akár kisbetűs írásmóddal szerepelnek. Az eredmény bájt-azonos marad ott, ahol egy személynek vagy gépnek támaszkodnia kell rá.

A plafon megadása a szokásos bónuszok számolása előtt történik. A hosszúság, nagybetűk vagy ritkaság kombinációja sem éri el.

Ez a tagadást garanciává teszi, nem pedig valószínű túlélővé. Ott számít, ahol egy tisztának tűnő ellentétes állítás csendes hibát okozna.

A visszafelé irányuló vizsgálat átlép a kis szavakon egy partikula és igéje között. Amikor cselekvést talál, mindkét pozíció kényszerített súlyt kap.

Egy magányos partikula nem nyer semmit, és a töltelékkel együtt eshet. Ez a megkülönböztetés megtartja a 'set up'-ot, miközben egy közönséges elöljárószót elenged.

Negyvenkilenc redukció tüzel kontextus nélkül, mielőtt a rangsorolás elkezdődik. Tizenhat másik megvárja a következő szót, mielőtt cselekszik.

Egy nagybetű, számjegy, elérési út karakter vagy deklarált kifejezés megnyitja a kaput. Egy közönséges főnév érintetlenül hagyja a kifejezést, mert az állítás megváltozna.

A próza és a kód mind az öt pozíciót használja, míg a szerszám kimenet hármat. Öt gépi alakú osztály egy pozícióba kerül a tárcsa olvasása nélkül.

Egy napló, diff vagy rekordkészlet ezért ugyanazt az eredményt adja minden hívó beállításnál. A besorolás a kezelést a tömörítés megkezdése előtt rendezi.

Egy strukturális menet minden sort a feladata szerint kezel. A táblázatok és szabályok átmennek, míg a bekezdések és udvariasság rövidülhetnek.

Egy bizonyítékot tartalmazó beszélgetési fordulat egészben marad. Minden csere csak akkor marad meg, ha kisebb az eredetinél.

A szakasz menet egy szakaszt a plafon fölé enged be, miközben a padló alatt van. Megakadályozza, hogy egy dokumentum túl csekély legyen a válaszhoz.

A mondat menet egyedül a plafonnak engedelmeskedik, és egy szakaszon belül vághat. A diszpécser először a két korlátos utat próbálja.

A jelölő szavakat harmincöt kód között számolják, az egyedi jelölők háromszor annyit érnek, mint a megosztottak. Egy nyelvnek küszöböt kell átlépnie, mielőtt a szabályai érvényesülnek.

A magyar, finn és észt szótövezés történik a keresés előtt, ahol szükséges. Egy bizonytalan eredmény az általános szabályokhoz esik vissza, és kevesebbet távolít el.

Minden szakasz csak akkor tart meg egy eredményt, ha kevesebb tokent használ, mint a bemenete. Egy rövid szövegrész pontosan úgy tér vissza, ahogy érkezett, változatlanul.

A különálló tömörítők ugyanazt a kimenetet adják, mert semmi nem mintavételez. A tesztek mind a méretkorlátot, mind az ismételhetőséget ellenőrzik.

Az eltávolítás, hasonlóság és olvashatóság ugyanahhoz a mért futáshoz tartozik. Az olvashatóság ellenőrzi, hogy egy erősebb megtakarítás nem rontotta-e el a prózát.

A korpusz 5 520 mondat volt ötven technikai dokumentumból, engedélyezett kereséssel. Egy másik korpusz saját mérést igényel, nem pedig kölcsönzött ígéretet.

Minden mondatot három gram kódolással hasonlítanak össze a lekérdezéssel. A kulcsszó-átfedés pontozza a többit.

A fele megmarad, legalább három, majd az eredeti sorrendben tér vissza. A négynél rövidebb bekezdés változatlanul marad.

A modellszámla kimenő fele az a fele, amelyet a csapat módosíthat. Ez összeállított kontextus, amelyet gyakran változatlanul küldenek el többször is.

Egy helyi szabály eltávolítja ezt a keretet a fizetett hívás előtt. Nem hoz létre második számlát, és nem változtatja meg a választ, amelyet továbbra is generálni kell.

A lektor minden eltávolított szót meg tud nevezni az eltávolító szabály alapján. A megjelölt példány konkrét anyagot ad a vizsgálathoz és az aláíráshoz.

Az összefoglaló csak egy ítéletet hagy, amelyet az emlékezettel szemben kell megbízni. A mondat, amelyről később kérdeznek, pontosan az, amelyik eltűnhetett.

A rövidítés abban a folyamatban fut, amely már tartalmazza a dokumentumot. Semmilyen végpont, szolgáltatói sor vagy extra processzor nem kap másolatot.

A szabályalapú lépés a dokumentumot kezelő kóddal marad.

A stabil eredmények hasznos gyorsítótár-bejegyzésekké teszik az ismétlődő dokumentumokat. A tesztek pontos kimenetet állítanak, nem csak valószínűt.

A két futtatás közötti különbség így megállapítás, nem zaj. Ez későbbi incidensvizsgálat számára egy rögzített, ellenőrizhető részt ad a rekordhoz.

A parancsok, hivatkozások és idézett hibaüzenetek teljesen kívül maradnak a rövidítésen. Kilenc angol szó, amely megfordít egy állítást, szintén védett.

A másolt parancs továbbra is fut, a idézett hiba pedig kereshető marad. Egy mondat nem változhat észrevétlenül az ellenkezőjére magas beállításnál.

Egy komponens lefedi a gondos ügyfélleveleket és a nyers gépi naplókat. Az osztályozás dönti el, hogy a hívó beállítása egyáltalán releváns-e.

A naplók, diffek és rekordok javíthatók, vagy külön sűrű útvonalat kaphatnak. Ez egy komponensre korlátozza a beszerzést, nem több eszközre.

A dokumentum-menet tiszteletben tartja a felső és alsó korlátot is. Az alsó korlát biztosítja, hogy a rövidebb szakasz elég tartalmas maradjon a kérdés megválaszolásához.

A mondat-menet csak a felső korlátot tartja be, ha csak az ablak számít. A választás a kódellenőrzésre tartozik, nem kapkodó kézi döntésre.

A komponens a szövegből határozza meg a nyelvet, nem a bérlő beállításaiból. Egy küszöb megakadályozza, hogy bizonytalan olvasat rossz szabályokat alkalmazzon.

Minden felismert kódhoz saját funkciószavak és helyettesítések tartoznak. A ragozott nyelveknél a keresés előtt tőre vágják a szavakat.

Minden eszközválasz tartalmazza a bemeneti bájtokat, a kimeneti bájtokat és az így elért megtakarítást. Így a saját forgalma szolgáltatja a bizonyítékot az első hívástól.

Egy hét valós prompt az esetet összeggé változtatja, nem becsléssé. Nem kell külön felügyeleti rendszernek újra mérnie ugyanazt a munkát.

A szoftver eltávolítja a tölteléket, mielőtt egy AI elolvasna egy hosszú jelentést. Így több beillesztett tartalom fér el ugyanabban a kérésben.

A már a jelentést kezelő eszközön belül működik. Semmit nem küldenek el külön csak azért, hogy a szöveg rövidebb legyen.

Az összefoglaló valamit arra kér, hogy döntse el, mi a fontos a dokumentumban. A rögzített szabályok csak azokat a szótípusokat távolítják el, amelyek a listájukon szerepelnek.

A két példányt egymás mellé teheti, és láthatja minden szót, ami kikerült. Ez biztonságosabb, mint az emlékezetre hagyatkozni, ha egy hiányzó mondat számít.

Néhány hosszú szót egy rövidebb szóra cserélnek egy rögzített táblából. Ugyanaz a szó minden dokumentumban ugyanazt a cserét kapja.

Az eredmény tömörnek tűnhet, nem csiszoltnak. Az értelme megmarad, és a következő olvasónak erre az értelemre van szüksége, nem a formális megfogalmazásra.

A kódok, linkek és pontos hibaüzenetek kiemelésre kerülnek, mielőtt bármilyen rövidítés elkezdődne. A fejlécek és táblázatsorok ugyanezen okból a helyükön maradnak.

Egyetlen rossz karakter megakadályozhatja a keresés, űrlap vagy parancs működését. Ezek a hivatkozások pontosan úgy térnek vissza, ahogy írták őket.

A rövidítés azon a gépen történik, amelyen a szöveg már rajta van. Nem kap új cég dokumentumot azért, hogy kisebb legyen.

Ugyanaz a bekezdés holnap is ugyanazt a rövidebb bekezdést adja. Ha változik, akkor a bemenetben vagy a szabályokban történt változás, nem vélemény.

A Signum a szavakból és betűkből határozza meg a nyelvet az üzenetben. Nem kell címkéznie a dokumentumot, vagy konfigurálnia küldés előtt.

Ha nem biztos, általános szabályokat használ, és kevesebbet távolít el. A végződések először azokban a nyelvekben kerülnek le, ahol elrejtik az alatta lévő szót.

annak a ténynek köszönhetően, hogy → semmi

A Signum egy Rust könyvtár determinisztikus prompt-tömörítéshez LLM-hívás előtt. Pontozza és rövidíti a kontextust abban a folyamatban, amely már tartalmazza, ugyanazt az eredményt adja ugyanarra a bemenetre, és nem végez modellhívást vagy hálózati kérést. A szabályok, amelyek eldöntik, mi kerül kivágásra, érdemes elolvasni: a Signum az alapítói kiadási program harmadik körében jelenik meg.