Ir al contenido

IA gestionada

Inteligencia que puedes medir.

Chat, embeddings, recuperación de conocimiento, OCR, transcripción y generación de imágenes — seis servicios sobre un solo crédito prepagado. Sin API key que conseguir, sin GPU que alquilar, sin base vectorial que operar.

Tus primeros $5 son gratis y no piden tarjeta. Ya te esperan en el Asistente de tu escritorio.

Un solo crédito

Seis servicios, un solo monedero.

Todos los servicios beben del mismo crédito prepagado. Nada se factura aparte, y nada se renueva sin saldo que lo cubra.

Chat

El Asistente, y cualquier vApp que llame a la IA. Se cobra por token, de entrada y de salida, a la tarifa del modelo que elegiste.

Embeddings

Convierte tus documentos en algo que se puede buscar por significado. Se cobra por millón de tokens indexados.

Recuperación de conocimiento

El sistema RAG de aquí abajo: búsqueda, reordenamiento y citas sobre tu propio corpus.

OCR

Escaneos y PDFs de imagen a texto. Se cobra por página — o córrelo gratis en el navegador.

Transcripción

Audio y video a texto. Se cobra por minuto — o córrelo gratis en el navegador.

Generación de imágenes

Imágenes a partir de un prompt, en línea en el Asistente y disponibles para las vApps. Se cobra por imagen.

La aritmética

¿Qué compra realmente el crédito?

Tarifas reales del libro de precios vivo. Elige un crédito.

Elige un crédito para convertir
42 turnos de chat con Sonnet 4.6
250 turnos de chat con Haiku 4.5
100 páginas leídas por OCR
83 minutos transcritos
1,900 páginas añadidas a tu base de conocimiento
16 imágenes generadas
833 turnos de chat con Sonnet 4.6
5,000 turnos de chat con Haiku 4.5
2,000 páginas leídas por OCR
28 horas transcritas
38,000 páginas añadidas a tu base de conocimiento
333 imágenes generadas
5,000 turnos de chat con Sonnet 4.6
30,000 turnos de chat con Haiku 4.5
12,000 páginas leídas por OCR
167 horas transcritas
230,000 páginas añadidas a tu base de conocimiento
2,000 imágenes generadas
27,000 turnos de chat con Sonnet 4.6
162,000 turnos de chat con Haiku 4.5
65,000 páginas leídas por OCR
900 horas transcritas
1,250,000 páginas añadidas a tu base de conocimiento
10,800 imágenes generadas

Un turno de chat se cuenta como 2.000 tokens de entrada y 400 de salida. Cada otra cifra es la tarifa publicada por página, por minuto, por imagen o por millón de tokens dividida en el crédito. Gasta el crédito en cualquier mezcla de los seis — es un solo monedero.

Los modelos

Tú eliges el modelo. Nosotros publicamos la tarifa.

Cinco proveedores detrás de un solo endpoint — Anthropic, OpenAI, Google Gemini, xAI Grok y Ollama Cloud. Cambiar de proveedor es un ajuste, no una migración.

Con precio antes de ejecutarse

Cada modelo lleva una tarifa publicada. Un modelo sin tarifa activa no se puede servir — el proxy falla cerrado antes que acumular un coste que nadie cotizó.

Se cotiza, luego se mide

La tarifa se congela antes de la llamada y se mide contra ella después. Editar el libro de precios a mitad de una conversación no cambia lo que se te cobra por una llamada que ya iba en vuelo.

Barato y premium, uno al lado del otro

Haiku 4.5 para volumen, Sonnet 4.6 para el día a día, Opus 4.8 cuando el razonamiento tiene que salir bien. Una vApp puede pedir uno por nombre o quedarse con el de por defecto.

O trae tu propia clave

Gestionado es un modo, no un candado. Apunta la misma pasarela a tu propia cuenta de proveedor y la plataforma sigue funcionando — sólo que le pagas a tu proveedor en vez de a nosotros.

La consola de IA gestionada listando los modelos disponibles por proveedor, cada uno con un interruptor, y un selector de modelo por defecto.
Elige qué modelos puede usar tu organización. El ajuste aplica a todas las llamadas gestionadas, desde todas las apps.

El límite

Cada servicio gestionado tiene uno local y gratuito.

Gestionado es una decisión que tomas por servicio, y que puedes deshacer. Aquí nada es una puerta de un solo sentido.

Corre en tu máquina · gratis

  • OCR — Tesseract, en el navegador. El archivo nunca sale del dispositivo.
  • Transcripción — Whisper, en el navegador.
  • Vectores — guardados en tu propia base Odoo. Es lo de por defecto.
  • Tus propias API keys — la pasarela llama directo a tu cuenta de proveedor.

Corre en la nuestra · medido

  • OCR — visión en la nube, para los escaneos que Tesseract no puede leer.
  • Transcripción — archivos más largos, más rápido, sin dejar una pestaña abierta.
  • Vectores — pgvector alojado, cuando el corpus le queda grande a la base.
  • Chat y embeddings — nuestras cuentas de proveedor, nuestras tarifas, tu crédito.

Lo que no se mueve en ningún caso: tus registros. El proxy lleva el texto de la petición y devuelve la respuesta. Tu base Odoo no se replica a nosotros, y los datos de negocio que lee una vApp siguen bajo los mismos permisos de siempre.

Conocimiento

Respuestas salidas de tus propios documentos.

Apúntalo a tus manuales, contratos, catálogos y carpetas del drive. Los indexa, los busca de verdad, y te muestra de dónde salió cada respuesta.

Dos búsquedas, fusionadas

Significado y palabras a la vez: una búsqueda vectorial para lo que quisiste decir, y la búsqueda de texto completo de Postgres para el número de parte que escribiste. Los dos rankings se fusionan por reciprocal rank fusion, así que una cadena exacta no se pierde ante un casi-sinónimo.

Primero reescribe la pregunta

Una repregunta como «¿y la anterior?» se reescribe en una búsqueda que se sostiene sola. Pide más recall y correrá varias reformulaciones a la vez, o buscará con una respuesta hipotética en lugar de la pregunta.

Un lector que reordena

La recuperación es rápida y aproximada. Después, una pasada de reordenamiento lee la lista corta contra tu pregunta y la reordena, para que lo de arriba sea deliberado y no sólo parecido.

Tablas e imágenes, no sólo texto

Los PDFs se abren página por página — texto, tablas como tablas e imágenes incrustadas. Una página escaneada se renderiza y se lee por OCR. Word, PowerPoint, Excel, CSV y Markdown se parsean de forma nativa; el audio y el video se transcriben primero.

Un grafo sobre el corpus

Las entidades y sus relaciones se extraen una vez por documento y se puntúan por centralidad, lo que desempata a favor de aquello que tu corpus trata como importante — y agrupa todo el corpus en temas. Activado por defecto; apágalo para ahorrar crédito.

Permisos por documento

Cada documento indexado se comparte a propósito — todo el personal interno, personas concretas o grupos concretos. Una búsqueda sólo devuelve lo que quien pregunta tiene permiso de leer.

Citas que vuelven a la fuente

Las respuestas llevan sus fuentes, y una fuente enlaza al documento original — no a una paráfrasis. Cuando la respuesta importa, puedes ir y comprobarla.

Cada perilla es tuya

Cuántos fragmentos llegan al modelo, cuántos candidatos se recuperan antes de reordenar, el tamaño de fragmento y el solapamiento, la temperatura — todo eso son ajustes, no un ticket de soporte.

El panel de ajustes de Knowledge: modo de búsqueda en híbrido, reescritura de la consulta, multi-consulta y HyDE, reordenamiento con IA, small-to-big y los controles de fragmentación.
El motor de recuperación es configuración, no una caja negra.
El panel de ingesta de Knowledge, con los formatos aceptados y las opciones de guardar el archivo original y construir el grafo de conocimiento.
Suelta documentos, pega texto o indexa registros de Odoo directamente — tus propios permisos deciden qué registros puedes indexar.

Agent Center

Agentes que hacen el trabajo, con la autonomía que tú fijas.

Un asistente responde. Un agente termina el trabajo — lee los registros, decide y escribe de vuelta. La diferencia que importa es cuánto puede hacer sin preguntar, y eso es una perilla que tú controlas.

  1. 0

    Observa

    Lee y reporta. No toca nada. Aquí vive un agente auditor, y aquí debería empezar todo agente nuevo.

  2. 1

    Propone

    Redacta el cambio y te lo entrega. Nada llega a un registro hasta que una persona lo dice.

  3. 2

    Actúa con aprobación

    Encola acciones reales para revisión. Apruebas una y la plataforma la corre como la persona que la aprobó — bajo sus permisos, a su nombre, en la pista de auditoría.

  4. 3

    Autonomía limitada

    Actúa dentro de las herramientas y los campos que le diste, y no más allá. El techo es la definición del propio agente, no su criterio.

El plantel de Agent Center: cuatro agentes — Auditor, Cobros, Conocimiento y Pipeline — cada uno mostrando su nivel de autonomía y cuántas herramientas puede usar.
Cada agente lleva en la cara su nivel de autonomía y cuántas herramientas puede usar.

Corre sobre tus datos, con tus permisos

Un agente lee por el mismo ORM que usan todas las apps, así que nunca puede ver un registro que su usuario no pudiera. No hay una copia aparte de tu base para que el agente lea.

Una cola de aprobación, no un registro de sorpresas

Todo lo que supere su nivel espera a una persona. Ves qué quiere hacer y sobre qué registro antes de que pase — no después, en un informe de auditoría.

Trabaja con horario

Los agentes corren solos desde un cron, no sólo cuando alguien abre una ventana. La pasada de facturas vencidas ocurre el lunes se haya acordado alguien o no.

Recuerda

Los hallazgos y las decisiones persisten entre ejecuciones, así que un agente que marcó algo la semana pasada no lo vuelve a levantar como si fuera nuevo.

Residencia

Tú eliges dónde viven los vectores.

Es una decisión de cumplimiento, así que es un ajuste y no un ticket de soporte — y las contrapartidas están escritas.

Por defecto

En tu base de datos

Los vectores son filas de tu propia base Odoo. Nada que aprovisionar, nada que medir, y se van cuando se va tu respaldo.

Búsqueda
Significado y palabras clave, fusionados
Escala
Cómodo hasta un corpus mediano
Coste de almacenamiento
None

Gran escala, y siguen siendo tuyos

pgvector, en tu Postgres

La misma base, con la extensión pgvector haciendo la búsqueda. Para corpus lo bastante grandes como para que el camino simple se note. Una app guía te lleva por la instalación.

Búsqueda
Significado y palabras clave, fusionados
Escala
Grande — la búsqueda corre en Postgres
Coste de almacenamiento
None

Cero operación

Alojados por nosotros

Los vectores viven en nuestro clúster pgvector. Nada que instalar, nada que afinar — y la misma búsqueda que obtienes en cualquier otro modo: significado y palabras clave, fusionados por el mismo ranking que usan los modos locales. Aquí la residencia es una decisión de cumplimiento, no de calidad de recuperación.

Búsqueda
Significado y palabras clave, fusionados
Escala
Grande — la operamos nosotros
Coste de almacenamiento
$0.15 / 1,000 vectors / month

El grafo de conocimiento funciona en todos los modos — se construye desde tus documentos y se queda en tu base aunque los vectores no.

La vista de índice de Knowledge: número de vectores y documentos, dimensiones del embedding, almacenamiento en disco, capacidad del índice usada y la lista de bases de conocimiento.
Respondas como respondas a la pregunta de residencia, el índice te dice qué estás guardando y cuánto cuesta.

Precios

Prepagado, y visible en pantalla.

Un plan mensual concede crédito; el crédito paga lo que usas. También puedes saltarte el plan y simplemente recargar. Lo que no puedes es gastar dinero que no has puesto.

Prueba gratis

Pruébalo

5 de crédito, una vez

Sin tarjeta. Ya está en la instancia — abre el Asistente y empieza a gastarlo.

Consigue primero el escritorio

Plan

Starter

20 al mes

$20 de crédito de IA cada mes.

Empezar

Plan

Business

499 al mes

$650 de crédito de IA cada mes. Eso es 30% más crédito que el precio.

Empezar

El almacenamiento de vectores alojado se factura aparte a $0.15 por mil vectores al mes, y sólo si eliges residencia alojada. El crédito sin usar no se convierte en devolución.

La vista de consumo de la IA gestionada: gasto y número de llamadas en treinta días, desglosado por chat, embeddings, reordenamiento, almacenamiento e indexación.
Ésta es la promesa en lugar de «ilimitado»: puedes ver a dónde se fue el dinero, por servicio, por usuario y por app — y exportarlo.

Ya está en tu escritorio.

La IA gestionada no es algo que se instale. Abre el Asistente en un escritorio Vizum y los primeros $5 ya están ahí — decide lo del plan cuando te los hayas gastado.