Skip to content

Commit 2b63110

Browse files
abossardCopilot
andcommitted
Rename 'Workshop' to 'Kann ich mit dem Prompt die Genauigkeit verbessern?'
Clearer framing: not a DSPy workshop, but the natural question after seeing failures + metrics. Bridges to automatic optimization. Co-authored-by: Copilot <223556219+Copilot@users.noreply.github.com>
1 parent 7c9afb5 commit 2b63110

1 file changed

Lines changed: 11 additions & 10 deletions

File tree

notebooks/01_evaluation_and_tuning.ipynb

Lines changed: 11 additions & 10 deletions
Original file line numberDiff line numberDiff line change
@@ -662,7 +662,11 @@
662662
"cell_type": "markdown",
663663
"metadata": {},
664664
"source": [
665-
"## 4. Dein Prompt-Tuning Workshop\n\nJetzt bist **du** dran! Editiere den Prompt und sieh, wie sich dein Score verändert. Jeder Versuch wird aufgezeichnet.\n"
665+
"## 4. Kann ich mit dem Prompt die Genauigkeit verbessern?\n",
666+
"\n",
667+
"Du hast gesehen, dass das Modell Fehler macht. Und du weisst jetzt, wie man Genauigkeit misst. Die naheliegende Frage: **hilft eine bessere Formulierung?**\n",
668+
"\n",
669+
"Probier's aus! Editiere den Prompt unten und klick \"Auswerten\". Jeder Versuch wird aufgezeichnet — so siehst du, ob deine Änderungen wirklich etwas bringen.\n"
666670
]
667671
},
668672
{
@@ -703,18 +707,15 @@
703707
"id": "d7840a56",
704708
"metadata": {},
705709
"source": [
706-
"### 💡 Was hast du beobachtet?\n",
710+
"### 💡 Und — hat es geholfen?\n",
707711
"\n",
708-
"- Hat sich dein Score verbessert?\n",
709-
"- Welche Formulierungen haben geholfen?\n",
710-
"- Wie lange hast du dafür gebraucht?\n",
712+
"- Wurde dein Score besser?\n",
713+
"- Wie viele Versuche hast du gebraucht?\n",
714+
"- Hättest du das für 20 verschiedene Aufgaben machen wollen?\n",
711715
"\n",
712-
"Das ist **Prompt Engineering** — manuelles Ausprobieren von Formulierungen. Es funktioniert, aber:\n",
713-
"- Es ist **zeitaufwändig** (jeder Versuch dauert Sekunden bis Minuten)\n",
714-
"- Es ist **fragil** (was bei einem Modell klappt, versagt bei einem anderen)\n",
715-
"- Es ist **nicht reproduzierbar** (wie weisst du, dass Version 47 besser war als Version 23?)\n",
716+
"Genau das ist das Problem mit manuellem Prompt-Tuning: es **funktioniert** — aber es ist **langsam, mühsam und fragil**. Was bei einer Aufgabe hilft, verschlechtert vielleicht eine andere.\n",
716717
"\n",
717-
"> 🤔 **Was wäre, wenn ein Computer das automatisch machen könnte?** Tausende Varianten ausprobieren, jede bewerten, die beste behalten? Das ist Notebook 04!"
718+
"> Im nächsten Notebook sehen wir, wie man das **automatisiert**.\n"
718719
]
719720
},
720721
{

0 commit comments

Comments
 (0)