Zum Inhalt springen
Kontakt

Technik verstehen.
Ideen weiterdenken.

Beginne mit einer Frage. Hinter den Abkürzungen stecken Bausteine, die du in ganz unterschiedlichen Projekten verwenden kannst.

Vom Bild zum eigenen Modell.

Ein Lernweg in drei Teilen: Verfolge ein Foto durch ein VLM, berechne echte Lernschritte und bereite ein Training mit eigenen Bildern vor.

Sehen & Bilder

  • VLM

    Bilder verstehen

    Was passiert zwischen Foto und Antwort? Verfolge Pixel, Bildmerkmale und Sprache durch ein VLM – und finde heraus, was es dabei wirklich lernt.

    Bild + Frage → Textantwort
    15 Min. Einstieg
  • Training

    So lernt ein Modell

    Verändere echte Gewichte im Browser. Verfolge Vorhersage, Loss und Gradienten – und teste, ob das Gelernte auch bei neuen Bildern funktioniert.

    Beispiele + Zielantworten → Angepasste Gewichte
    20 Min. Einstieg
  • OCR

    Text aus Bildern lesen

    Ein Foto wird zu Text, den du kopieren, durchsuchen oder vorlesen lassen kannst.

    Bild mit Schrift → Bearbeitbarer Text
    4 Min. Einstieg
  • Fine-Tuning

    Ein VLM mit eigenen Bildern anpassen

    Eine konkrete Aufgabe, saubere Bilddaten und ein messbarer Vergleich: Bereite deinen ersten LoRA-Versuch vor – mit einem herunterladbaren Python-Lernpaket.

    Vortrainiertes VLM + eigene Beispiele → Adapter + Vergleich auf neuen Bildern
    25 Min. Einstieg

Sprache & Audio

  • TTS

    Text vorlesen lassen

    Aus geschriebenen Wörtern wird hörbare Sprache. Probiere aus, wie Tempo und Satzzeichen das Zuhören verändern.

    Geschriebener Text → Gesprochene Sprache
    4 Min. Einstieg
  • STT

    Gesprochenes aufschreiben

    Aus einer Sprachaufnahme wird ein Transkript. Verstehe den Unterschied zwischen Gesagtem, erkanntem Text und einer ausgeführten Aufgabe.

    Gesprochene Sprache → Transkript
    4 Min. Einstieg

Du suchst etwas Bestimmtes?

Die gemeinsame Suche findet Erklärungen, Projekte, Beiträge und Kurse – auch über Begriffe wie „Sprachausgabe“ oder „Raspberry Pi“.