Einen RAG-Assistenten auf Italienisch für dein KMU entwickeln – praxisorientierter Leitfaden für italienische Start-ups und Unternehmen, die Claude auf einer italienischsprachigen Wissensbasis produktiv einsetzen möchten. Funktionierender Code, realistische monatliche Kosten, Überlegungen zu DSGVO und elektronischer Rechnungsstellung.
Der Basis-Stack
- Dokumente mit text-embedding-3-large direkt über OpenAI einbetten – Kunavo stellt keine Embeddings bereit, sondern nur den Generierungsschritt
- Vektorsuche (pgvector / Pinecone / Qdrant)
- Antwortgenerierung mit Claude Sonnet 4.6 + Prompt-Caching
- Fallback auf Gemini 2.5 Flash für hohe Parallelität / minimale Kosten
Wesentlicher Code
from openai import OpenAI
client = OpenAI(
api_key="sk-kn-...",
base_url="https://api.kunavo.com/v1",
)
def rispondere(domanda: str, contesto: list[str]) -> str:
"""Risponde in italiano basandosi solo sul contesto recuperato dalla KB."""
resp = client.chat.completions.create(
model="claude-sonnet-4-6",
messages=[
{
"role": "system",
"content": [
{
"type": "text",
"text": (
"Sei un assistente che risponde in italiano formale "
"ma cordiale, basandoti esclusivamente sul contesto "
"fornito. Se la risposta non si trova nel contesto, "
"rispondi 'Non ho questa informazione' invece di "
"inventare. Cita sempre il documento di origine "
"quando possibile."
),
"cache_control": {"type": "ephemeral"},
},
],
},
{
"role": "user",
"content": (
f"## Contesto\n{chr(10).join(contesto)}\n\n"
f"## Domanda\n{domanda}"
),
},
],
max_tokens=600,
)
return resp.choices[0].message.contentKosten pro Anfrage bei aktiviertem Caching: ~$0.004 (ca. €0.004). Ohne Caching: ~$0.01. Der Unterschied rechtfertigt die korrekte Konfiguration von cache_control im stabilen System-Prompt.
Tokens im Italienischen
Italienisch verbraucht für denselben Inhalt etwa 1.3–1.5x mehr Tokens als Englisch (Artikel, längere Endungen). Berücksichtige dies bei der Budgetplanung: Ein Kontext von 5K Tokens auf Englisch wird auf Italienisch zu etwa 6.5K. Begrenze den Kontext auf 4K, um die Kosten unter Kontrolle zu halten, ohne Qualität einzubüßen.
Schutz vor Halluzinationen – was wirklich funktioniert
- Expliziter System-Prompt: „Wenn die Antwort nicht im Kontext enthalten ist, sage ‚Ich habe diese Information nicht‘.“ Claude befolgt diese Anweisung auf Italienisch zuverlässig
- Quelle zitieren: Bitte das Modell, die Dokument-ID zurückzugeben, aus der es jede Aussage entnommen hat. Wenn die ID erfunden ist, hast du eine Halluzination gefunden
- Ausgabe begrenzen: max_tokens=400 verringert die Versuchung, erfundene Inhalte als Füllmaterial hinzuzufügen
- Gegnerische Tests: Erstelle 50 Fragen aus deinem Datensatz, die als „mit dem aktuellen Kontext nicht beantwortbar“ markiert sind. Der Assistent muss alle ablehnen
Geschätzte monatliche Kosten
- 100 Anfragen/Tag: ~$11/Monat (~€10) mit Caching
- 1.000 Anfragen/Tag: ~$110/Monat (~€100)
- 10.000 Anfragen/Tag: ~$1.100/Monat (~€1.000)
Vergleich: Ein italienischer Kundensupport-Mitarbeiter kostet etwa €2.500/Monat, um etwa 100 Tickets/Tag abzudecken. Bereits bei 1.000 Anfragen/Tag erledigt der KI-Assistent die Arbeit von 10 Personen für etwa 4 % der Kosten eines einzigen Mitarbeiters.
Zahlung und Rechnungsstellung
- Karten: Visa, Mastercard, American Express, PostePay (über Visa)
- Apple Pay / Google Pay / Link
- Satispay, wenn der Checkout in Euro erfolgt
Alle Preise sind in USD angegeben; Stripe kann den Betrag beim Checkout in EUR umrechnen. Der Wechselkurs enthält eine Umrechnungsgebühr von 2–4 %, die von der zahlenden Person getragen wird (bei Zahlung in USD fällt sie nicht an; Dokumentation zu Stripe Adaptive Pricing, gelesen am 2026-10-03). PayPal und SEPA-Lastschrift sind nicht verfügbar. Der Checkout zeigt keine Mehrwertsteuer an und fragt nicht nach der Umsatzsteuer-Identifikationsnummer. Elektronische Rechnungsstellung an SDI: Derzeit stellen wir keine elektronischen Rechnungen an das italienische SDI aus. Bei Fragen zur Rechnungsstellung wenden Sie sich an sales@kunavo.com.
DSGVO – kritische Punkte für italienische KMU
- Pseudonymisierung personenbezogener Daten: Entferne Eigennamen, Steuernummern, IBANs, E-Mail-Adressen und Anschriften aus dem Prompt, bevor du ihn an das Modell sendest
- DPA / Art. 28 DSGVO: Kunavo bietet weder einen DPA noch Standardvertragsklauseln (SCC) an; Anfragen werden in den Vereinigten Staaten verarbeitet und an vorgelagerte Anbieter weitergeleitet. Wenn Sie einen DPA mit SCC für die Datenübermittlung in die USA benötigen, schließen Sie ihn direkt mit dem Modellanbieter (den Enterprise-Bedingungen von Anthropic, OpenAI oder Google).
- Aktualisierte Datenschutzerklärung: Erwähne ausdrücklich die Nutzung von KI Dritter über Kunavo
- Recht auf Vergessenwerden (Art. 17): Stelle sicher, dass deine Anwendungsprotokolle gelöscht werden können. Speichere Prompts nicht in unveränderlichen Archiven wie einer Blockchain
Praktischer Fahrplan
- Woche 1: Prototyp mit 100 Dokumenten, 10 Testanfragen
- Woche 2: Integration mit der vollständigen Wissensbasis, Tests mit internen Nutzern
- Woche 3: Feinabstimmung des System-Prompts mit realen Fällen, Qualitätsbewertung
- Woche 4: Schrittweise Bereitstellung, Kostenüberwachung unter /app/usage
Bereit für den Start? Kostenlose Registrierung, ab $10 aufladen und nur für die tatsächliche Nutzung zahlen (ausreichend für etwa 1.100 Testanfragen). Vollständige Dokumentation: /docs/quickstart. Bei Fragen auf Italienisch schreibe direkt an contact@kunavo.com.