Volver al blog
Guía·25 de mayo de 2026·7 min de lectura

RAG en italiano para pymes — construir un asistente con Claude en 4 semanas

Guía práctica para startups y pymes italianas: stack RAG completo en italiano con Claude Sonnet 4.6, ~€0.006 por consulta, consideraciones sobre los tokens italianos (1.3-1.5x más que el inglés), prevención de alucinaciones, costos mensuales reales de 100 a 10.000 consultas al día, RGPD y nota sobre la facturación electrónica al SDI.

Cómo construir un asistente RAG en italiano para tu PYME: guía práctica para startups y empresas italianas que quieren poner Claude en producción sobre una base de conocimiento en italiano. Código funcional, costes mensuales realistas, consideraciones sobre el RGPD y facturación electrónica.

La pila básica

  1. Generación de embeddings de los documentos con text-embedding-3-large, llamado directamente en OpenAI —— Kunavo no sirve los embeddings, solo el paso de generación
  2. Búsqueda vectorial (pgvector / Pinecone / Qdrant)
  3. Generación de respuestas con Claude Sonnet 4.6 + almacenamiento en caché de prompts
  4. Fallback a Gemini 2.5 Flash para una alta concurrencia / costes mínimos

Código esencial

rispondere.py
from openai import OpenAI

client = OpenAI(
    api_key="sk-kn-...",
    base_url="https://api.kunavo.com/v1",
)

def rispondere(domanda: str, contesto: list[str]) -> str:
    """Risponde in italiano basandosi solo sul contesto recuperato dalla KB."""
    resp = client.chat.completions.create(
        model="claude-sonnet-4-6",
        messages=[
            {
                "role": "system",
                "content": [
                    {
                        "type": "text",
                        "text": (
                            "Sei un assistente che risponde in italiano formale "
                            "ma cordiale, basandoti esclusivamente sul contesto "
                            "fornito. Se la risposta non si trova nel contesto, "
                            "rispondi 'Non ho questa informazione' invece di "
                            "inventare. Cita sempre il documento di origine "
                            "quando possibile."
                        ),
                        "cache_control": {"type": "ephemeral"},
                    },
                ],
            },
            {
                "role": "user",
                "content": (
                    f"## Contesto\n{chr(10).join(contesto)}\n\n"
                    f"## Domanda\n{domanda}"
                ),
            },
        ],
        max_tokens=600,
    )
    return resp.choices[0].message.content

Coste por consulta con el almacenamiento en caché activo: ~$0.004 (aproximadamente €0.004). Sin almacenamiento en caché: ~$0.01. La diferencia justifica configurar correctamente cache_control en el system prompt estable.

Tokens en italiano

El italiano consume aproximadamente 1.3-1.5x más tokens que el inglés para el mismo contenido (artículos y terminaciones largas). Tenlo en cuenta en los presupuestos: un contexto de 5K tokens en inglés se convierte en ~6.5K en italiano. Limita el contexto a 4K para mantener los costes bajo control sin perder calidad.

Antialucinación: qué funciona realmente

  • System prompt explícito: "si la respuesta no está en el contexto, di 'No tengo esta información'". Claude respeta esta instrucción en italiano de forma fiable
  • Citar la fuente: pide al modelo que devuelva el id del documento del que ha extraído cada afirmación. Si el id es inventado, has detectado una alucinación
  • Limitar la salida: max_tokens=400 reduce la tentación de añadir contenido inventado como relleno
  • Pruebas adversariales: prepara 50 preguntas de tu conjunto de datos marcadas como "no respondibles con el contexto actual". El asistente debe rechazar todas

Coste mensual estimado

  • 100 consultas/día: ~$11/mes (~€10) con almacenamiento en caché
  • 1.000 consultas/día: ~$110/mes (~€100)
  • 10.000 consultas/día: ~$1.100/mes (~€1.000)

Comparación: un empleado italiano de atención al cliente cuesta ~€2.500/mes para cubrir ~100 tickets/día. Incluso con solo 1.000 consultas/día, el asistente de IA hace el trabajo de 10 personas por aproximadamente el 4% del coste de un solo empleado.

Pago y facturación

  • Tarjetas: Visa, Mastercard, American Express, PostePay (a través de Visa)
  • Apple Pay / Google Pay / Link
  • Satispay, cuando el checkout está en euros

Todos los precios están en USD; Stripe puede convertir el importe a EUR durante el checkout, con un tipo de cambio que incluye una comisión de conversión del 2–4 % a cargo del pagador (no se aplica al pagar en USD; documentación de Adaptive Pricing de Stripe, consultada el 2026-10-03). PayPal y SEPA Direct Debit no están disponibles. El checkout no muestra el IVA ni solicita el número de IVA. Facturación electrónica al SDI: actualmente no emitimos facturas electrónicas al SDI italiano. Para necesidades de facturación, contacta con sales@kunavo.com.

RGPD: puntos críticos para las PYMES italianas

  • Seudonimización de PII: elimina nombres propios, códigos fiscales, IBAN, correos electrónicos y direcciones del prompt antes de enviarlo al modelo
  • DPA / artículo 28 del RGPD: Kunavo no ofrece un DPA ni cláusulas contractuales tipo (CCT); las solicitudes se procesan en Estados Unidos y se reenvían a los proveedores ascendentes. Si necesitas un DPA con CCT para transferir datos a Estados Unidos, formalízalo directamente con el proveedor del modelo (condiciones empresariales de Anthropic, OpenAI o Google).
  • Política de privacidad actualizada: menciona explícitamente el uso de IA de terceros a través de Kunavo
  • Derecho al olvido (Art. 17): asegúrate de que tus registros de aplicación puedan eliminarse. No guardes prompts en archivos inmutables como una cadena de bloques

Hoja de ruta práctica

  • Semana 1: prototipo con 100 documentos y 10 consultas de prueba
  • Semana 2: integración con la base de conocimiento completa y pruebas con usuarios internos
  • Semana 3: ajuste del system prompt con casos reales y evaluación de la calidad
  • Semana 4: despliegue gradual y monitorización de costes en /app/usage

¿Listo para empezar? Regístrate gratis, recarga $10 y paga solo por lo que uses (suficiente para ~1.100 consultas de prueba). Documentación completa: /docs/quickstart. Para preguntas en italiano, escribe directamente a contact@kunavo.com.