Context Compression for LLMs in Rust | Signum
Signum is a Rust library and CLI for deterministic context compression before an LLM call. Publishing in the third release round.
Más corto por regla. Listo para inspeccionar.
Cuando el repositorio se publique, lee las notas de implementación, ejecuta el binario local tú mismo y coloca el resultado junto al pasaje que lo produjo. Signum llega en la tercera ronda del programa de lanzamiento de la fundación, con su documentación disponible el mismo día.
Un formato de datos denso con idas y vueltas publicadas.
Una ruta acotada desde una pregunta hasta evidencia con fuente.
Un modelo tejido que deja un rastro junto a la respuesta.
trabajo de migración no terminar conexión réplica se cayó 30 segundos.
una diferencia se convierte en un hallazgo
El nivel mueve un corte numérico a través de una clasificación de palabras fija. También profundiza la penalización en palabras de unión a medida que el ajuste aumenta dentro del pasaje.
Las posiciones fijadas pasan por delante del presupuesto sin importar su rango. Las siguientes protecciones explican dónde reside la corrección, más que la preferencia.
Ocho tipos de tramos se convierten en sustitutos numerados antes de la primera puntuación. Los encabezados, las citas, las tablas y las líneas delimitadas se mantienen como líneas completas.
Después de la compresión, los marcadores de posición se restauran, ya sea escritos normalmente o en minúsculas. El resultado permanece byte-idéntico donde una persona o máquina necesita confiar en él.
El techo se concede antes de que se puedan contar las bonificaciones ordinarias. Ninguna combinación de longitud, mayúsculas o rareza lo alcanza.
Eso convierte una negación en una garantía más que en un probable superviviente. Importa siempre que una afirmación opuesta de apariencia limpia crearía un error silencioso.
El escaneo hacia atrás pasa por encima de las palabras pequeñas entre una partícula y su verbo. Cuando encuentra una acción, ambas posiciones ganan peso forzado.
Una partícula solitaria no gana nada y puede caer con el relleno. Esa distinción mantiene "set up" mientras deja pasar una preposición ordinaria.
Cuarenta y nueve reducciones se activan sin contexto antes de que comience la clasificación. Otras dieciséis esperan a la palabra que sigue antes de actuar.
Una mayúscula, un dígito, un carácter de ruta o un término declarado abre la puerta. Un sustantivo ordinario deja la frase intacta porque la afirmación cambiaría.
La prosa y el código usan las cinco posiciones, mientras que la salida de herramientas tiene tres. Cinco clases con forma de máquina aterrizan en una posición sin leer el dial.
Un registro, un diff o un conjunto de registros produce por tanto el mismo resultado en cada ajuste de llamada. La clasificación decide el tratamiento antes de que comience la compresión.
Una pasada estructural trata cada línea según su función. Las tablas y las reglas pasan, mientras que los párrafos y la cortesía pueden acortarse.
Un turno de conversación que contiene evidencia permanece completo. Cada reemplazo se conserva solo cuando es más pequeño que el original.
La pasada de sección admite una sección por encima del techo mientras está por debajo del suelo. Evita que un documento se vuelva demasiado escaso para responder.
La pasada de oración obedece solo al techo y puede recortar dentro de una sección. El despachador prueba primero la ruta de dos límites.
Las palabras marcadoras se cuentan en treinta y cinco códigos, y las marcadoras únicas valen tres veces más que las compartidas. Un idioma necesita superar un umbral antes de que se apliquen sus reglas.
El húngaro, el finlandés y el estonio se reducen a su raíz antes de la búsqueda cuando es necesario. Un resultado incierto recurre a reglas generales y elimina menos.
Cada etapa conserva un resultado solo cuando usa menos tokens que su entrada. Un pasaje corto regresa exactamente como llegó, sin cambios.
Compresores separados devuelven la misma salida porque nada muestrea. Las pruebas verifican tanto el límite de tamaño como la repetibilidad.
La eliminación, la similitud y la legibilidad pertenecen a la misma ejecución medida. La legibilidad comprueba que un ahorro más fuerte no haya distorsionado la prosa.
El corpus fue de 5.520 oraciones de cincuenta documentos técnicos con la búsqueda habilitada. Un corpus diferente necesita su propia medición en lugar de una promesa prestada.
Cada oración se compara con la consulta usando tres codificaciones de gram. La superposición de palabras clave puntúa el resto.
La mitad sobrevive, con un mínimo de tres, y luego vuelve en el orden original. Un pasaje de menos de cuatro frases se devuelve tal cual.
La mitad saliente de una factura modelo es la mitad que tu equipo puede cambiar. Es contexto ensamblado, a menudo enviado sin cambios más de una vez.
Una regla local elimina ese andamiaje antes de la llamada de pago. No crea una segunda factura ni altera la respuesta que aún debe generarse.
Un revisor puede nombrar cada palabra eliminada por la regla que la eliminó. La copia marcada les da algo concreto que inspeccionar y firmar.
Un resumen deja solo un juicio que confiar contra la memoria. La frase sobre la que alguien pregunta más tarde es precisamente la que puede haber desaparecido.
El acortamiento se ejecuta en el proceso que ya contiene el documento. Ningún endpoint, cola de proveedor o procesador adicional recibe una copia.
El paso basado en reglas permanece con el código que maneja el documento.
Los resultados estables hacen que los documentos repetidos sean entradas de caché útiles. Las pruebas verifican la salida exacta en lugar de algo meramente plausible.
Una diferencia entre dos ejecuciones es entonces un hallazgo, no ruido. Eso le da a una revisión de incidentes posterior una parte fija e inspeccionable de su registro.
Los comandos, las referencias y el texto de error citado quedan completamente fuera del acortamiento. Nueve palabras en inglés que invierten una afirmación también están protegidas.
Un comando copiado aún se ejecuta y un error citado aún se puede buscar. Una frase no puede cambiar silenciosamente a su opuesto en un ajuste alto.
Un componente cubre cartas cuidadosas a clientes y registros de máquina contundentes. La clasificación decide si un ajuste de llamada es siquiera relevante.
Los registros, las diferencias y los registros se pueden corregir o tomar una ruta densa separada. Eso mantiene la adquisición en un solo componente en lugar de varias herramientas.
El paso de documento respeta tanto un máximo como un mínimo. Su mínimo mantiene un pasaje más corto lo suficientemente sustancial para responder la pregunta.
El paso de frase respeta solo el máximo cuando la ventana es lo único que importa. La elección pertenece a la revisión de código, no a una decisión manual apresurada.
El componente decide el idioma a partir del texto, no de la configuración del inquilino. Un umbral evita que una lectura incierta aplique las reglas equivocadas.
Cada código reconocido trae sus propias palabras funcionales y sustituciones. Los idiomas con terminaciones pesadas se reducen a la raíz antes de que comience la búsqueda.
Cada respuesta de herramienta lleva bytes de entrada, bytes de salida y el ahorro resultante. Tu propio tráfico proporciona la evidencia desde la primera llamada.
Una semana de indicaciones reales convierte el caso en una suma en lugar de una estimación. Ningún sistema de monitoreo separado tiene que medir el mismo trabajo de nuevo.
El software elimina el relleno antes de que una IA lea un informe largo. Más de lo que pegaste puede caber en la misma solicitud.
Funciona dentro de la herramienta que ya maneja el informe. No se envía nada adicional solo para hacer el texto más corto.
Un resumen pide que algo decida qué importa en tu documento. Las reglas fijas solo eliminan los tipos de palabras escritas en su lista.
Puedes juntar las dos copias y ver cada palabra que se fue. Eso es más seguro que confiar en la memoria cuando una frase que falta importa.
Algunas palabras largas se cambian por una palabra más corta de una tabla fija. La misma palabra recibe el mismo cambio en cada documento.
El resultado puede sonar seco en lugar de pulido. Su sentido sigue presente y el próximo lector necesita ese sentido, no la redacción formal.
Los códigos, los enlaces y el texto de advertencia exacto se extraen antes de que comience cualquier acortamiento. Los encabezados y las filas de tabla permanecen en su lugar por la misma razón.
Un carácter incorrecto puede impedir que una búsqueda, un formulario o un comando funcionen. Esas referencias vuelven exactamente como fueron escritas.
El acortamiento ocurre en la máquina que ya tiene el texto. Ninguna empresa nueva recibe un documento para hacerlo más pequeño.
El mismo párrafo también devuelve el mismo párrafo más corto mañana. Si cambia, algo cambió en la entrada o en las reglas, no una opinión.
Signum deduce el idioma de las palabras y letras del mensaje. No etiquetas un documento ni lo configuras antes de enviarlo.
Si no está seguro, usa reglas generales y elimina menos. Las terminaciones se quitan primero en idiomas donde ocultan la palabra debajo.
vehículo de sustitución · exceso · cobertura