Prompt-Engineering für Ollama
Was dieser Artikel über Prompt-Engineering behandelt
- Was Prompt-Engineering ist und warum es wichtig ist.
- Grundtechniken wie Rollen, Kontext und Beispiele.
- Wie man komplexe Aufgaben strukturiert.
- Methoden wie Chain-of-Thought und Few-Shot.
- Häufige Fehler und wie man sie vermeidet.
Einleitung: Prompt-Engineering für Ollama
Prompt-Engineering ist die Kunst, Modelle durch die richtige Formulierung von Aufgaben zu besseren Antworten zu führen. Anders als bei geringeren Modellen können kleine Sprachmodelle auf lokaler Hardware besonders von klaren, präzisen Prompts profitieren. Wer gute Prompts schreibt, holt aus einem 7B-Modell oft mehr heraus als andere aus einem 13B-Modell, ohne bessere Hardware zu brauchen.
Dieser Artikel zeigt die wichtigsten Techniken und Muster, um Ollama-Modelle effektiv anzusprechen.
Wichtige Begriffe
- Prompt: Eingabe, die an ein Sprachmodell gesendet wird.
- System-Prompt: Hintergrundanweisung, die das Verhalten steuert.
- User-Prompt: Eigentliche Frage oder Aufgabe.
- Context: Zusätzliche Informationen im Prompt.
- Few-Shot: Beispiele für gewünschte Ein- und Ausgaben.
- Zero-Shot: Keine Beispiele, nur Aufgabe.
- Chain-of-Thought: Modell soll Schritt für Schritt denken.
- Output-Format: Gewünschte Struktur der Antwort.
Grundregeln
- Prompts sollen klar und präzise sein.
- Die Rolle des Modells beschreiben.
- Den gewünschten Ton und Stil nennen.
- Konkrete Ausgabevorgaben machen.
- Bei komplexen Aufgaben in kleine Schritte unterteilen.
- Beispiele geben, wenn das Format wichtig ist.
- Nicht zu viele unterschiedliche Anweisungen mischen.
Rolle vergeben
Eine klar definierte Rolle verbessert die Antwortqualität.
Du bist ein erfahrener Python-Entwickler. Erkläre Konzepte kurz und mit praktischen Beispielen.
Weitere Beispiele:
- Fachkundiger KI-Berater.
- Kreative Texterin.
- Übersetzer für Fachtexte.
- Sicherheitsanalyst.
- Lehrer für Anfänger.
Kontext mitgeben
Je mehr relevante Informationen im Kontext stehen, desto präziser kann das Modell antworten.
Kontext: Ich betreibe Ollama auf einem Ryzen 9 mit RTX 4070 Ti und 64 GB RAM.
Frage: Welche 13B-Modelle laufen flüssig auf dieser Hardware?
Ausgabeformat festlegen
Gib die Antwort in drei Stichpunkten und am Ende eine Zusammenfassung in einem Satz.
Beispiele geben
Few-Shot
Schreibe kurze Produktbeschreibungen.
Beispiel 1:
Produkt: Mechanische Tastatur
Beschreibung: Robuste mechanische Tastatur mit präzisen Switches und langlebiger Bauweise.
Beispiel 2:
Produkt: 4K-Monitor
Beschreibung: Grosser 4K-Monitor mit scharfem Bild und hoher Farbtreue für produktives Arbeiten.
Produkt: Lokale KI-Workstation
Beschreibung:
Das Modell erkennt das Muster und setzt es fort.
Chain-of-Thought
Bei komplexen Aufgaben:
Löse die Aufgabe Schritt für Schritt und erkläre jeden Zwischenschritt kurz.
Dadurch wird das Modell gezwungen, Zwischenschritte zu nennen, anstatt sofort ein Endergebnis zu liefern. Das reduziert Fehler.
Negative Beispiele
Wenn das Modell etwas nicht tun soll, explizit ausschliessen:
Erkläre Quantisierung ohne Fachjargon. Vermeide mathematische Formeln.
Iterieren und testen
Ein guter Prompt entsteht durch Ausprobieren:
- Erste Version schreiben.
- Antwort prüfen.
- Anweisungen präzisieren.
- Beispiele hinzufügen oder entfernen.
- Temperatur anpassen.
- System-Prompt anpassen.
Spezielle Techniken
Self-Consistency
Eine Frage mehrmals stellen und häufigste Antwort auswählen. Erhöht Zuverlässigkeit.
ReAct
Wechselseitiges Denken und Handeln: Modell denkt, handelt, beobachtet und schliesst daraus. Gut für Agenten und Tool-Nutzung.
Tree-of-Thoughts
Mehrere Lösungswege entwickeln und bewerten, anstatt einen einzigen Pfad zu verfolgen.
Persona-Wechsel
Für kreative oder kontroverse Themen kann man das Modell bitten, verschiedene Perspektiven einzunehmen.
Prompt für RAG
Beantworte die Frage ausschliesslich anhand des folgenden Kontexts. Wenn die Antwort nicht im Kontext enthalten ist, gib an, dass keine passende Information vorliegt.
Kontext: {context}
Frage: {question}
Prompt für Coding
Du bist ein erfahrener Softwareentwickler. Schreibe sauberen, kommentierten Python-Code für die folgende Funktion. Erkläre kurz, was der Code tut.
Aufgabe: Eine Funktion, die eine Liste von Zahlen sortiert und die grössten n Werte zurückgibt.
Prompt für Zusammenfassungen
Fasse den folgenden Text in drei bis fünf Stichpunkten zusammen. Behalte die wichtigsten Fakten bei.
Text: {text}
Typische Fehler
- Zu vage: Das Modell hat Interpretationsspielraum.
- Zu lange Einführung: Wichtige Informationen gehen im Kontext verloren.
- Widersprüchliche Anweisungen: Modell kann nicht beides gleichzeitig tun.
- Fehlende Beispiele: Modell liefert falsches Format.
- Zu hohe Temperatur: Kreative Aufgaben werden unkontrollierbar.
- Kontext überladen: Nicht alle Informationen sind relevant.
- Keine Iteration: Prompt wird nie verbessert.
Tipps für lokale Modelle
- Lokale Modelle sind oft kleiner, daher besonders präzise arbeiten.
- System-Prompts haben grossen Einfluss auf die Ausgabe.
- Temperatur niedrig halten, wenn Konsistenz wichtig ist.
- Formatierungsvorgaben sehr explizit machen.
- Komplexe Aufgaben in mehrere Prompts aufteilen.
Weiterführende Links und Infos
- BotServ.de Ollama für Coding
- BotServ.de Ollama Modelfiles
- BotServ.de RAG mit Ollama
- BotServ.de Ollama Evaluation
FAQ: Prompt-Engineering
Brauche ich lange Prompts? Nicht unbedingt. Klar und präzise ist besser als lang.
Was ist besser: System- oder User-Prompt? Beide haben unterschiedliche Rollen. System-Prompts steuern Verhalten, User-Prompts geben die Aufgabe.
Wie finde ich gute Prompts? Testen, iterieren und Beispiele sammeln.
Welche Temperatur ist gut? 0.1 bis 0.3 für präzise Aufgaben, 0.7 bis 0.9 für kreative.
Helfen Beispiele wirklich? Ja, besonders bei spezifischen Ausgabeformaten.
Quellen und weiterführende Literatur
- Prompt Engineering Guide: https://www.promptingguide.ai/
- Learn Prompting: https://learnprompting.org/
- OpenAI Best Practices: https://platform.openai.com/docs/guides/prompt-engineering
Zusammenfassung: Prompt-Engineering für Ollama
Prompt-Engineering ist der schnellste Weg, um bessere Ergebnisse aus Ollama-Modellen herauszuholen. Klare Rollen, präzise Kontextangaben, Ausgabevorgaben und Beispiele führen zu deutlich besseren Antworten. Techniken wie Chain-of-Thought, Few-Shot und negative Beispiele helfen bei komplexen Aufgaben. Wer Prompts iterativ testet und anpasst, findet schnell ein Muster, das auch mit kleineren lokalen Modellen überzeugt.


