Por qué el Orden de inserción no es una clasificación de prioridad
Aquí está la definición, textualmente:
"Numeric value. Defines a priority of the entry if multiple were activated at once. Entries with larger order numbers will be inserted closer to the end of the context as they will have more impact on the output. For example, an entry with Order number 100 will appear in the context before an entry with Order number 250."
Número más grande, posición más tardía, más impacto. Una entrada en 250 se coloca después de una en 100, y queda más cerca de donde el modelo está a punto de escribir. Si numeraste la regla principal de tu mundo como 1 y una taberna irrelevante como 400, la taberna es lo que estará justo al lado de la atención del modelo.
Esa es la primera tarea. La segunda tarea está en una sección completamente diferente de la documentación, bajo Configuración de activación (Activation Settings), y es la que causa problemas en sesiones largas:
"If the budget is exhausted, then no more entries are activated even if the keys are present in the prompt."
"Constant entries will be inserted first. Then entries with larger order numbers."
Así que el mismo número también decide quién sobrevive. Una vez que se agota el presupuesto de World Info, la activación se detiene: la palabra clave coincidió, la entrada era elegible y no se insertó nada. Lo que entró primero fueron las entradas constantes, luego todo lo demás desde el extremo superior del rango numérico hacia abajo. Tu entrada en 1 es la última de la fila para obtener espacio y la última de la fila para recibir atención.
Una línea más de la misma sección cambia la forma en que deberías pensar sobre el lore recursivo: "Las entradas insertadas al mencionar directamente sus claves tienen mayor prioridad que aquellas que se mencionaron en el contenido de otras entradas". Las entradas atraídas por recursión hacen cola detrás de las entradas activadas por la conversación real.
Y un detalle que explica gran parte de los fallos silenciosos. El Título de la entrada (Entry Title) está documentado como "un campo de texto para tu comodidad para etiquetar tus entradas, que no es utilizado por la IA ni por ninguna de las lógicas de activación". Los consejos profesionales lo dicen de manera más amplia: "las palabras clave de activación, los títulos y otra información que no esté en el campo de Contenido (Content) no se insertan en el contexto, por lo que cada entrada de World Info debe tener una descripción completa e independiente". Si tus títulos transmiten significado, nadie los ha leído jamás.
Este es el aspecto general del problema descrito en por qué los agentes ignoran tus archivos de instrucciones: el archivo está presente, el archivo es correcto y el archivo no está llegando al modelo.
Qué intenta la gente en su lugar
Renumerar todo a 1. Si todo es de máxima importancia, el desempate se vuelve arbitrario y el presupuesto seguirá recortando la lista en algún punto. No has priorizado; has eliminado tu capacidad de hacerlo.
Hacer que cada entrada clave sea constante. La estrategia del círculo azul significa que una entrada "no necesita ninguna palabra clave y se activará independientemente del contenido". Funciona, y consume todo tu presupuesto antes de que se considere cualquier entrada condicional (las entradas constantes están documentadas para insertarse primero). Tres o cuatro es un plan. Veinte es un presupuesto sin espacio disponible.
Escribir entradas más cortas y detenerse ahí. Es útil, pero aborda la variable equivocada. La longitud afecta a cuántas entradas caben; el orden afecta a cuáles obtienen el espacio y dónde se colocan. Los límites del enfoque de acortar todo son los mismos que se tratan en cuánta memoria deberías darle a un agente de IA.
Aumentar el presupuesto hasta que deje de doler. Esto convierte un problema de lore en un problema de contexto. Un límite de World Info más grande significa menos espacio para el historial de chat, que es el intercambio descrito en por qué el contexto largo no es memoria: más espacio en el prompt no es más memoria, sino simplemente una asignación diferente del mismo estante.
Cambiar las entradas a coincidencia de vectores para evitar toda la cuestión. SillyTavern es sincero sobre lo que eso cuesta: "Dado que la calidad de la recuperación depende completamente de los resultados del modelo de incrustación (embedding), es imposible predecir exactamente qué entradas se insertarán. Si deseas resultados deterministas y predecibles, limítate a la coincidencia de palabras clave". La coincidencia de vectores también solo reemplaza la verificación de palabras clave: el presupuesto, la probabilidad, los filtros y los grupos de inclusión siguen aplicándose. La versión más amplia de ese intercambio, donde la búsqueda por similitud reemplaza a una decisión que podrías haber dejado por escrito, se cubre en por qué RAG no es memoria.
La solución: Numerar según qué tan tarde quieres que se lea, luego verificar a qué llega realmente el presupuesto
Paso 1: Renumerar por proximidad, en bandas
Deja de pensar en "rango" y empieza a pensar en "qué tan cerca de la siguiente frase del modelo debe colocarse esto".
Date tres o cuatro bandas con amplios intervalos, para que puedas insertar elementos más tarde sin tener que renumerar. Números bajos para el trasfondo que debe establecerse temprano: la física del mundo, la época, el entorno general. Números medios para hechos permanentes sobre lugares y facciones. Números altos para las cosas que deberían ser lo último que se lea antes de que el modelo escriba: restricciones activas de la trama, reglas estrictas sobre lo que un personaje nunca hará, lo que está en juego en la escena actual.
Los intervalos amplios importan más que los valores exactos. Las bandas de 100 dejan espacio para que una nueva entrada se coloque entre dos existentes sin necesidad de una renumeración global.
Luego verifica tu Estrategia de inserción de lore (Lore Insertion Strategy), porque cambia contra qué se comparan los números. El valor predeterminado es Ordenado uniformemente (Sorted Evenly), que SillyTavern describe como ordenar "todas las entradas de acuerdo con su Orden de inserción como si fueran parte de un solo archivo grande, ignorando el origen". Las alternativas, Lore del personaje primero (Character Lore First) y Lore global primero (Global Lore First), agrupan por origen antes de aplicar el orden dentro de cada grupo. Si tu lorebook de personaje y tu lorebook global usan diferentes convenciones de numeración, Sorted Evenly los entrelazará de formas que ninguno de los autores pretendía.
Ten en cuenta también que el lore vinculado al chat y el vinculado a la persona se insertan completamente antes de esa comparación, en el orden documentado: lore del chat, luego lore de la persona, y luego lore del personaje o global según la estrategia elegida.
Paso 2: Separar la posición del orden, porque son controles diferentes
El Orden de inserción (Insertion Order) decide la secuencia entre las entradas activadas. La Posición de inserción (Insertion Position) decide en qué región del prompt aterriza una entrada, y SillyTavern anota el impacto de cada una.
Antes de las definiciones de personaje (Before Char Defs) está documentado que tiene "un impacto moderado en la conversación". Después de las definiciones de personaje (After Char Defs) tiene "un impacto mayor". Las posiciones de mensajes de ejemplo se analizan como bloques de diálogo de ejemplo y siguen las reglas de los mensajes de ejemplo, lo que significa que pueden ser desplazadas a medida que se llena el contexto. Las posiciones de la Nota del autor (Author's Note) conllevan una trampa que la documentación señala con un signo de exclamación: "¡Si tu Nota del autor está desactivada (Frecuencia de inserción = 0), las entradas de World Info en las posiciones de A/N serán ignoradas!". Una entrada puede estar perfectamente escrita, tener las claves correctas, estar alta en el orden y ser descartada silenciosamente porque una función completamente diferente está desactivada.
La posición de profundidad (depth) es la herramienta más precisa aquí: una entrada insertada a una profundidad específica en el chat, donde la profundidad cero es la parte inferior del prompt, y con la opción de rol de sistema, usuario o asistente. Así es como se coloca una restricción estricta inmediatamente antes de la generación sin hacerla constante.
Si deseas un control total, la posición Outlet elimina por completo la inyección automática y almacena el contenido bajo un token con nombre que tú mismo colocas. La documentación enumera advertencias reales: los nombres de los outlets distinguen entre mayúsculas y minúsculas, los espacios iniciales o finales en un nombre se ignoran al llamar a la macro (por lo que los nombres con espacios de relleno no coincidirán), no se admite el anidamiento y los campos de la tarjeta de personaje no pueden expandir los outlets porque se analizan de forma temprana.
Paso 3: Verificar observando qué se descarta, no leyendo el panel
Una entrada correcta y una entrada insertada son cosas diferentes, y el panel solo te muestra la primera.
Ejecuta una escena que debería activar varias entradas a la vez y observa qué llegó realmente. Si aparece una entrada de orden alto y una de orden bajo no, has encontrado tu límite de presupuesto y ahora sabes que el ordenamiento está haciendo su trabajo. Si no llega nada condicional en absoluto, cuenta primero tus entradas constantes.
Prueba los grupos de inclusión deliberadamente, porque su comportamiento sorprende a la gente: "Si se activaron varias entradas que tienen la misma etiqueta de grupo, solo una se insertará en el prompt", seleccionada por Peso del grupo (Group Weight) a menos que habilites Priorizar inclusión (Prioritize Inclusion), en cuyo caso "se seleccionará la que tenga el valor de 'Orden' más alto". Esa es la tercera tarea que se le puede asignar a tu número de orden, y es opcional.
También verifica cualquier cosa con un efecto de tiempo antes de culpar al orden. Sticky mantiene una entrada activa durante un número determinado de mensajes e ignora las comprobaciones de probabilidad mientras dura; cooldown bloquea la reactivación durante un número determinado de mensajes; delay impide la activación hasta que el chat sea lo suficientemente largo. And check Profundidad de escaneo (Scan Depth), ya que en cero "solo se evalúan las entradas recursivas y la Nota del autor"; ninguna cantidad de numeración correcta ayudará a una entrada cuya palabra clave nunca se escanea.
Esta es la misma disciplina que la descrita en auditar lo que recuerda tu IA: verificar observando el resultado, no leyendo la configuración.
Configuración de esto en MemoryLake
De este ejercicio surgen dos cosas, y solo una de ellas pertenece a un lorebook. Las entradas en sí son trabajo de SillyTavern y lo hace bien. El razonamiento (por qué esta regla supera a aquella, qué restricción nunca debe descartarse, qué aprendiste cuando una entrada dejó de activarse silenciosamente) no tiene dónde vivir dentro de un campo numérico.
MemoryLake contiene esa segunda capa, fuera de cualquier interfaz. Lo escribes tú mismo, con tus propias palabras, y sigue siendo legible cuando cambias de herramienta, reconstruyes un lorebook o le entregas un mundo a otra persona.
Paso 1: Crear una clave API
Inicia sesión, abre la configuración de tu espacio de trabajo y genera una clave API. Esta es la credencial que usan tus asistentes para leer la misma capa, así que créala una vez y mantenla accesible desde cada máquina en la que escribas.

Paso 2: Subir tus primeros recuerdos
Saca el razonamiento de los cuerpos y títulos de tus entradas: por qué existe cada banda, qué entradas son fundamentales, cuáles degradaste y por qué, qué condiciones descubriste de la manera difícil. El lorebook conserva el lore; esta capa conserva las decisiones al respecto.

Paso 3: Conectar tu IA y agentes
Conéctalo con lo que sea que uses para escribir. Las mismas decisiones llegan a cada uno, lo cual es importante porque un lorebook no viaja a la siguiente herramienta y el pensamiento detrás de él debería hacerlo.

Qué cambia esto en la práctica
La primera diferencia aparece en las escenas largas. Una vez que las entradas de alto valor tienen los números altos, el agotamiento del presupuesto comienza a recortar desde el extremo menos importante en lugar de hacerlo al azar, y las entradas que sí llegan aterrizan donde tienen la mayor influencia.
La segunda es que el fallo silencioso se vuelve diagnosticable. Hay al menos cuatro razones documentadas por las que una entrada puede ser correcta y estar ausente: presupuesto agotado, Nota del autor desactivada, grupo de inclusión que perdió el sorteo, profundidad de escaneo demasiado superficial; y conocer la lista convierte un misterio en una lista de verificación.
La tercera es que tus títulos dejan de mentirte. Una vez que aceptas que el título es solo para ti, cada entrada obtiene un cuerpo autónomo, que es lo que la documentación pide de todos modos cuando dice que cada entrada debe tener una descripción completa e independiente.
La cuarta es la portabilidad. Un mundo expresado como condiciones en palabras sobrevive al cambio de plataformas; un mundo expresado como números de inserción, no. Esa es la brecha que hace que las migraciones sean dolorosas, como en migrar lorebooks de Character AI a ChatGPT, donde las superficies de personalización documentadas de OpenAI no describen un control de ordenamiento para recibirlos.
Buenas prácticas para el ordenamiento de World Info
Numerar por posición, no por rango. Más alto significa más tarde, y más tarde significa más influencia. Escribe eso en una nota adhesiva si es necesario.
Dejar intervalos. Las bandas de 100 te permiten insertar sin tener que renumerar el mundo.
Presupuestar las entradas constantes deliberadamente. Se insertan primero y consumen primero. Mantén la lista del círculo azul lo suficientemente corta como para recordarla de memoria.
Colocar restricciones estrictas en profundidad, no en la parte superior. La posición de profundidad coloca el contenido cerca de la generación sin hacerlo permanente.
Verificar la Nota del autor antes de usar sus posiciones. Las entradas asignadas a las posiciones de la Nota del autor se ignoran cuando la Nota del autor está desactivada.
Give every entry a standalone body. Los títulos y las palabras clave no se insertan en el contexto, por lo que una entrada que solo tiene sentido con su título es una entrada que no tiene sentido.
Volver a probar después de cualquier cambio de presupuesto o estrategia. Cambiar la Estrategia de inserción de lore cambia contra qué se comparan tus números, y cambiar el presupuesto cambia dónde se realiza el corte. Ambos son silenciosos.
Conclusión
SillyTavern te dio un sistema de gestión de prompts genuinamente potente y lo documentó correctamente, incluidas las partes que son contraintuitivas. El Orden de inserción no es una clasificación; es una posición, y los números más altos se colocan más tarde y tienen más peso. El mismo número decide quién sobrevive cuando se agota el presupuesto, y también se puede hacer que decida los ganadores de los grupos de inclusión.
Renumera por proximidad en bandas amplias, usa la posición y la profundidad para las cosas que deben colocarse tarde, y verifica observando qué llega en lugar de leyendo el panel. Luego, saca el razonamiento de los cuerpos de las entradas, porque un campo numérico es un mal lugar para registrar por qué tu mundo funciona de la manera en que lo hace, y porque la próxima herramienta que uses tendrá sus propios controles, su propio presupuesto y ninguna forma de leer este lorebook en absoluto.