Cómo construir un asistente RAG en italiano para tu PYME: guía práctica para startups y empresas italianas que quieren poner Claude en producción sobre una base de conocimiento en italiano. Código funcional, costes mensuales realistas, consideraciones sobre el RGPD y facturación electrónica.
La pila básica
- Generación de embeddings de los documentos con text-embedding-3-large, llamado directamente en OpenAI —— Kunavo no sirve los embeddings, solo el paso de generación
- Búsqueda vectorial (pgvector / Pinecone / Qdrant)
- Generación de respuestas con Claude Sonnet 4.6 + almacenamiento en caché de prompts
- Fallback a Gemini 2.5 Flash para una alta concurrencia / costes mínimos
Código esencial
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1",
)
def rispondere(domanda: str, contesto: list[str]) -> str:
"""Risponde in italiano basandosi solo sul contesto recuperato dalla KB."""
resp = client.chat.completions.create(
model="claude-sonnet-4-6",
messages=[
{
"role": "system",
"content": [
{
"type": "text",
"text": (
"Sei un assistente che risponde in italiano formale "
"ma cordiale, basandoti esclusivamente sul contesto "
"fornito. Se la risposta non si trova nel contesto, "
"rispondi 'Non ho questa informazione' invece di "
"inventare. Cita sempre il documento di origine "
"quando possibile."
),
"cache_control": {"type": "ephemeral"},
},
],
},
{
"role": "user",
"content": (
f"## Contesto\n{chr(10).join(contesto)}\n\n"
f"## Domanda\n{domanda}"
),
},
],
max_tokens=600,
)
return resp.choices[0].message.contentCoste por consulta con el almacenamiento en caché activo: ~$0.004 (aproximadamente €0.004). Sin almacenamiento en caché: ~$0.01. La diferencia justifica configurar correctamente cache_control en el system prompt estable.
Tokens en italiano
El italiano consume aproximadamente 1.3-1.5x más tokens que el inglés para el mismo contenido (artículos y terminaciones largas). Tenlo en cuenta en los presupuestos: un contexto de 5K tokens en inglés se convierte en ~6.5K en italiano. Limita el contexto a 4K para mantener los costes bajo control sin perder calidad.
Antialucinación: qué funciona realmente
- System prompt explícito: "si la respuesta no está en el contexto, di 'No tengo esta información'". Claude respeta esta instrucción en italiano de forma fiable
- Citar la fuente: pide al modelo que devuelva el id del documento del que ha extraído cada afirmación. Si el id es inventado, has detectado una alucinación
- Limitar la salida: max_tokens=400 reduce la tentación de añadir contenido inventado como relleno
- Pruebas adversariales: prepara 50 preguntas de tu conjunto de datos marcadas como "no respondibles con el contexto actual". El asistente debe rechazar todas
Coste mensual estimado
- 100 consultas/día: ~$11/mes (~€10) con almacenamiento en caché
- 1.000 consultas/día: ~$110/mes (~€100)
- 10.000 consultas/día: ~$1.100/mes (~€1.000)
Comparación: un empleado italiano de atención al cliente cuesta ~€2.500/mes para cubrir ~100 tickets/día. Incluso con solo 1.000 consultas/día, el asistente de IA hace el trabajo de 10 personas por aproximadamente el 4% del coste de un solo empleado.
Pago y facturación
- Tarjetas: Visa, Mastercard, American Express, PostePay (a través de Visa)
- Apple Pay / Google Pay / Link
- Satispay, cuando el checkout está en euros
Todos los precios están en USD; Stripe puede convertir el importe a EUR durante el checkout, con un tipo de cambio que incluye una comisión de conversión del 2–4 % a cargo del pagador (no se aplica al pagar en USD; documentación de Adaptive Pricing de Stripe, consultada el 2026-10-03). PayPal y SEPA Direct Debit no están disponibles. El checkout no muestra el IVA ni solicita el número de IVA. Facturación electrónica al SDI: actualmente no emitimos facturas electrónicas al SDI italiano. Para necesidades de facturación, contacta con sales@kunavo.com.
RGPD: puntos críticos para las PYMES italianas
- Seudonimización de PII: elimina nombres propios, códigos fiscales, IBAN, correos electrónicos y direcciones del prompt antes de enviarlo al modelo
- DPA / artículo 28 del RGPD: Kunavo no ofrece un DPA ni cláusulas contractuales tipo (CCT); las solicitudes se procesan en Estados Unidos y se reenvían a los proveedores ascendentes. Si necesitas un DPA con CCT para transferir datos a Estados Unidos, formalízalo directamente con el proveedor del modelo (condiciones empresariales de Anthropic, OpenAI o Google).
- Política de privacidad actualizada: menciona explícitamente el uso de IA de terceros a través de Kunavo
- Derecho al olvido (Art. 17): asegúrate de que tus registros de aplicación puedan eliminarse. No guardes prompts en archivos inmutables como una cadena de bloques
Hoja de ruta práctica
- Semana 1: prototipo con 100 documentos y 10 consultas de prueba
- Semana 2: integración con la base de conocimiento completa y pruebas con usuarios internos
- Semana 3: ajuste del system prompt con casos reales y evaluación de la calidad
- Semana 4: despliegue gradual y monitorización de costes en /app/usage
¿Listo para empezar? Regístrate gratis, recarga $10 y paga solo por lo que uses (suficiente para ~1.100 consultas de prueba). Documentación completa: /docs/quickstart. Para preguntas en italiano, escribe directamente a contact@kunavo.com.