You signed in with another tab or window. Reload to refresh your session.You signed out in another tab or window. Reload to refresh your session.You switched accounts on another tab or window. Reload to refresh your session.Dismiss alert
"Eine **Signature** beschreibt was reingeht und was rauskommen soll — wie ein Funktionstyp. Kein Prompt nötig! Der passende Prompt wird automatisch generiert."
172
+
"Lass uns das Modell auf **Fragen mit bekannter Antwort** testen — und schauen wo es richtig liegt und wo es **daneben haut**.\n"
" result = classifier(review=review_input.value)\n",
264
-
" display_score(\"Prediction\", 1.0 if result.sentiment else 0.0)\n",
265
-
" print(f\"→ {result.sentiment}\")\n",
266
-
"\n",
267
-
"run_btn.on_click(on_click)\n",
268
-
"display(review_input, run_btn, output)"
269
-
]
270
-
},
271
-
{
272
-
"cell_type": "markdown",
273
-
"id": "2cc4afb0",
274
-
"metadata": {},
275
-
"source": [
276
-
"## 🗺️ Was dich erwartet\n",
277
-
"\n",
278
-
"Du wirst durch 8 Notebooks geführt — von den Grundlagen bis zur automatischen Optimierung. Jedes Notebook baut auf dem vorherigen auf und hat interaktive Aufgaben.\n",
279
-
"\n",
280
-
"Los geht's!"
281
-
]
282
-
},
283
-
{
284
-
"cell_type": "code",
285
-
"execution_count": 7,
286
-
"id": "a0eedf86",
287
-
"metadata": {},
288
226
"outputs": [],
289
-
"source": [
290
-
"# Die Aufgaben entdeckst du Schritt für Schritt in den folgenden Notebooks."
291
-
]
227
+
"execution_count": null
292
228
},
293
229
{
294
230
"cell_type": "markdown",
295
-
"id": "d2b9afcc",
296
231
"metadata": {},
297
232
"source": [
298
-
"## ⏭️ Weiter geht's!\n",
299
-
"\n",
300
-
"Du kannst ein Modell aufrufen und bekommst ein Ergebnis. **Aber woher weisst du, ob es GUT ist?**\n",
233
+
"## 💡 Das Problem\n",
301
234
"\n",
302
-
"Das klären wir im nächsten Notebook: Wie man **Accuracy misst**, wo LLMs versagen, und wie du **selbst versuchst den Prompt zu verbessern**.\n",
235
+
"LLMs klingen immer selbstsicher — auch wenn sie **falsch liegen**. Ohne systematische Messung weisst du nicht:\n",
236
+
"- Wie oft liegt das Modell richtig?\n",
237
+
"- Wird es bei bestimmten Fragen schlechter?\n",
238
+
"- Hilft eine andere Formulierung?\n",
303
239
"\n",
304
-
"👉 **[Weiter zu Notebook: Evaluation →](01_evaluation_and_tuning.ipynb)**\n"
240
+
"Genau dafür brauchst du **Evaluation** — und die kommt jetzt.\n"
0 commit comments