El Asistente IA de Legio puede buscar un contacto, abrir un expediente, chequear si salió algo nuevo en el Boletín Oficial, o crear un caso — todo desde el chat, en lenguaje natural. Pero es un recurso que se paga por uso: cada plan trae una cuota mensual de tokens, y no todos los mensajes cuestan lo mismo. Esta guía explica, en criollo, cómo funciona por dentro y — lo más importante — cómo usarlo para que rinda todo el mes sin quedarte sin saldo a mitad de camino.

Qué es el Asistente y qué NO es
Es fácil pensar en el Asistente como "un chat de IA con onda ChatGPT adentro de Legio". Pero hace algo más: puede actuar sobre tu base de datos. Cuando le pedís "creá un expediente laboral para Juan Pérez", no te está devolviendo un texto sugerido para que vos lo copies a mano en otro lado — realmente crea el expediente. Eso es posible porque el modelo de lenguaje (Gemini) tiene acceso a un conjunto de herramientas (los técnicos las llaman tools), cada una con un trabajo puntual:
- Buscar, crear o actualizar contactos y expedientes.
- Leer un PDF o una página web que le pases (
read_url). - Buscar novedades normativas recientes (Boletín Oficial, BCRA) o hacer una pregunta sobre qué salió publicado sobre un tema (Radar Legal).
- Buscar jurisprudencia real (fallos de tribunales argentinos) para citar en un escrito.
- Auditar cláusulas riesgosas de un contrato, o calcular plazos procesales.
- Si conectaste Google Drive, buscar y leer archivos ahí.
El modelo no ejecuta nada por sí solo ni "sabe" derecho de memoria de forma confiable: decide qué herramienta conviene usar según lo que le pediste, el backend la ejecuta de verdad contra la base de datos real de tu estudio, y el modelo recién ahí redacta una respuesta con el resultado.

El listado completo de herramientas (para entender el alcance real)
Más arriba dimos una idea general. Acá está el detalle completo, porque conocer cada herramienta disponible te da algo más importante que la lista en sí: te permite deducir combinaciones que el asistente puede resolver aunque no exista una herramienta "hecha a medida" para ese pedido puntual. Por ejemplo: no existe un botón "duplicar expediente", pero si el asistente puede leer el detalle completo de un expediente y también puede crear uno nuevo con datos específicos, entonces puede encadenar ambas cosas solo y lograr el mismo resultado — sin que nadie haya programado "duplicar" como función explícita. Esa es la lógica para leer esta lista: no pienses "qué botón apreta", pensá "qué puede leer y qué puede escribir", y el resto son combinaciones.
Gestión del CRM
manage_contacts— gestor universal de contactos: listar, buscar, crear o actualizar clientes.manage_cases— gestor de expedientes legales: listar, buscar, crear o actualizar casos, con todos los campos específicos por fuero (Laboral, Civil, Familia, Penal, Comercial, Administrativo).manage_documents— gestor de documentos y archivos: listar los archivos de un expediente, hacer OCR, subir archivos, y abrir el Redactor IA con el contexto del expediente ya cargado para generar un escrito.
Lectura web y documentos externos
read_url— lee el contenido completo de una página web o un PDF a partir de una URL (por ejemplo, para leer un fallo publicado online).research_legal— busca información legal, leyes, decretos o jurisprudencia en la web para fundamentar un escrito o responder una duda.search_web— búsqueda general en internet para datos actualizados.check_sisfe_expediente— consulta el estado y los movimientos de un expediente directamente en el SISFE (sistema de la Justicia de Santa Fe).
Derecho argentino
audit_contract— audita un contrato buscando cláusulas riesgosas ("banderas rojas") según el CCCN, la LCT y la Ley de Defensa del Consumidor.search_argentine_law— busca leyes argentinas específicas o artículos puntuales.search_jurisprudence— busca jurisprudencia y sentencias judiciales reales en portales como la SCBA, la CSJN o Infojus (esta es la fuente que el Redactor IA usa para citar fallos reales, nunca inventados).analyze_legal_deadlines— calcula plazos procesales según la jurisdicción (Santa Fe, CABA, PBA, Federal).
Radar Legal
buscar_normativa_vigia— busca regulaciones, resoluciones y normativa publicada recientemente (Boletín Oficial, BCRA, InfoLEG) en tiempo real.buscar_normativa_radar— búsqueda semántica sobre todo lo que el Radar Legal ya escaneó e indexó (boletines nacionales, de Santa Fe, CABA, y jurisprudencia). Esta es la que hay que usar para preguntas del tipo "¿salió algo sobre tarifas de gas esta semana?" — encuentra resultados por significado, no por coincidencia exacta de palabras.
Google Drive (solo si el estudio lo conectó)
manage_drive— buscar, listar y leer archivos del Drive del estudio.

Con esta lista a la vista, pensalo en combinaciones: leer un expediente + crear uno nuevo = duplicarlo. Buscar jurisprudencia + generar documento = una demanda fundada con fallos reales citados. Leer una URL + auditar contrato = revisar un contrato que te mandaron por mail sin descargarlo. El asistente no tiene un botón para cada combinación posible — tiene un conjunto de piezas, y las encadena solo según lo que le pidas.
Cómo "piensa": el loop de pasos
Un pedido como "buscá a María López y fijate si tiene expedientes abiertos" no se resuelve en una sola llamada. El asistente trabaja en pasos encadenados:
- Decide: "primero busco el contacto" → ejecuta la búsqueda.
- Con el resultado en mano, decide: "ahora reviso sus expedientes" → ejecuta esa consulta.
- Con todo lo que reunió, recién ahí redacta la respuesta final en lenguaje natural.
Esto pasa todo en una sola interacción tuya — vos escribís una vez y el asistente hace varios pasos internos antes de contestarte. Hay un tope de seguridad (12 pasos por turno) para que nunca quede dando vueltas indefinidamente; si con eso no alcanzó, corta y responde con lo que consiguió hasta ahí.
El "prompt" no es siempre el mismo
Cada vez que le escribís, el asistente arma internamente un bloque de instrucciones (el prompt) que cambia según el contexto:
- Siempre incluye la fecha actual, para que no se confunda calculando plazos.
- Si tenés abierto un contacto o un expediente en pantalla cuando le escribís, se lo informa automáticamente — por eso podés decir "actualizále el teléfono" sin repetir el nombre: el asistente ya sabe a quién te referís. Esto es gratis en términos de esfuerzo tuyo, y además más barato en tokens que escribir un mensaje largo repitiendo datos que ya están a la vista.
- Se le agrega un perfil según la materia del caso (Laboral, Civil, Penal, Familia...), con las particularidades de esa rama.
- Se le informa si tenés Google Drive conectado, para habilitar o no esas herramientas.
Dos abogados distintos, mirando pantallas distintas, le están hablando al "mismo" asistente pero con contextos completamente diferentes armados en el momento.
Ahora sí: qué es un token y por qué importa
Un token es, aproximadamente, un pedazo de palabra (en español, una palabra común suele ser 1 o 2 tokens). El modelo no lee ni escribe letras: lee y escribe tokens, y tanto lo que vos mandás como lo que él te responde se cobra en tokens, de tu cuota mensual del plan.
Lo que mucha gente no espera es que el costo de un mensaje no es solo el texto que escribiste. Cada vez que el asistente responde, se le manda:
- Las instrucciones base del sistema (fijas, siempre las mismas).
- La lista completa de herramientas disponibles y sus parámetros (para que el modelo sepa qué puede hacer).
- El contexto de lo que tenés en pantalla, si corresponde.
- Todo el historial de la conversación hasta ese punto — no solo tu último mensaje.
- Tu mensaje nuevo (texto, audio, imagen o documento adjunto).
- La respuesta que el modelo genera.
El punto 4 es el que más sorprende: en un chat, cada mensaje nuevo reenvía toda la charla anterior, porque el modelo no tiene memoria propia entre mensajes — la única forma de que "recuerde" lo que dijiste antes es mandarle de nuevo toda la conversación. Por eso una conversación larga se va poniendo progresivamente más cara: el mensaje 20 de un chat carga con el peso de los 19 anteriores, aunque tu pregunta sea cortita.

Por qué un audio de 30 minutos o un PDF de 300 páginas no conviene
Acá está el punto que más impacta en el saldo del mes:
- Audio e imágenes se convierten en muchísimos tokens, no en las pocas palabras que "deberían costar". El modelo tiene que procesar la señal completa de audio o la imagen entera, y eso se traduce en una cantidad de tokens proporcional a la duración del audio o al tamaño/resolución de la imagen — no a cuánto "dijiste" en esos minutos. Un audio de 30 minutos contándole el caso completo puede consumir, solo en procesar el audio, el equivalente a varios miles de palabras de texto — muchísimo más que escribir un resumen de 5 líneas con los datos clave.
- Un PDF largo se convierte en texto completo, página por página, antes de llegar al modelo. Un documento de 300 páginas equivale a una cantidad enorme de tokens, aunque lo que realmente te interese sean 2 párrafos de la página 47.
- Y por el punto anterior (el historial que se arrastra): si adjuntás ese PDF de 300 páginas al principio de una conversación larga, no lo pagás una sola vez — se reenvía en cada mensaje posterior de esa misma charla, mientras el chat siga abierto.

Buenas prácticas para rendir el plan todo el mes
Preferí texto corto y específico por sobre audio largo. Un mensaje de texto con los datos concretos ("Juan Pérez, DNI 30111222, despido sin causa el 15/03, sueldo $800.000") cuesta una fracción de lo que cuesta un audio de varios minutos contando la misma información con vueltas y repeticiones. Si preferís hablar, grabá notas cortas y al grano en vez de audios largos "pensando en voz alta".
No adjuntes documentos enteros cuando solo necesitás una parte. Si tenés un PDF de 300 páginas y lo que importa es un anexo de 3 páginas, extraé o copiá esa parte en vez de mandar el archivo completo.
Abrí el contacto o expediente relevante antes de preguntar por él. El contexto de pantalla es gratis y evita que tengas que escribir un mensaje largo re-explicando de quién se trata.
Arrancá una conversación nueva para un tema nuevo. No sigas agregando preguntas sobre casos distintos en el mismo chat larguísimo — cada mensaje nuevo en esa charla paga el peso de todo lo anterior. Un chat nuevo por tema/consulta mantiene el historial liviano.
Dejá que el asistente busque en vez de pegarle todo el expediente. Si necesitás que mire un caso, pedile que lo busque ("buscá el expediente de María López") en vez de copiar y pegar todos los datos del expediente en el mensaje — el asistente ya tiene herramientas para traer esa información directo de la base, más barato que reescribirla.
Usá el asistente para lo que es fuerte: buscar, crear, actualizar, resumir. Para redactar escritos judiciales completos existe el Redactor IA, una herramienta aparte optimizada específicamente para eso (con su propio artículo en este blog).
En resumen
El Asistente IA es potente porque puede actuar de verdad sobre tus datos, no solo charlar. Pero cada palabra, cada segundo de audio, cada página de un PDF y cada mensaje anterior de la conversación suman al mismo pozo de tokens del mes. La regla de oro es simple: sé específico, sé breve, y arrancá charlas nuevas para temas nuevos. Con esos tres hábitos, la cuota mensual rinde mucho más de lo que parece.
