• v0.3.2 8eb13a4e15

    SHUFTN 0.3.2 Stable

    Timba released this 2026-09-05 07:29:10 +00:00 | 28 commits to main since this release

    Das Diktat bekommt ein deutsches Modell — und der Umweg über einen Endpunkt fällt weg.

    Das Diktat hört auf ein deutsches Modell. Bisher lag whisper-base bei — klein und schnell, aber an Namen und Zahlen scheiterte es. An einem gesprochenen Satz gemessen:

    base: „Herr Nepomok geil von der Spinglereiwebe … Kalenderwoche 7 und 30" turbo-de: „Herr Nepomuk-Geil von der Spenglerei Weber … Kalenderwoche 37"

    Das neue Paket trägt whisper-large-v3-turbo in der deutschen Fassung von primeline (Apache-2.0). Es kostet: 1,2 GB statt 158 MB, und für zwölf Sekunden Sprache rechnet es zwölf Sekunden statt drei. Dafür steht in der Mail, was gesagt wurde — und nicht etwas, das man erst wieder ausbessert. Das kleine Modell bleibt daneben liegen, für schwache Rechner.

    Ein Fehler, der dabei auffiel: Whisper hörte nicht auf. Bei einer Aufnahme von fünf Sekunden kam derselbe Satz achtmal zurück. Der Grund war das Fenster: Whisper ist auf dreissig Sekunden trainiert, und wer ihm weniger gibt, bekommt kein Schlusszeichen. Jetzt wird jedes Fenster mit Stille aufgefüllt — so, wie es die Vorlage von OpenAI tut.

    Der Weg über einen Endpunkt ist heraus. Mit ihm das Feld „Diktat-Modell" unter Einstellungen → Assistent. Es zeigte auf einen Dienst, den nicht jeder hat — am eigenen Endpunkt antwortete POST /audio/transcriptions mit 404, während das Textmodell danebenlief. Ein Feld, das auf einen Weg zeigt, den es nicht mehr gibt, ist schlimmer als keines. Diktiert wird jetzt ausschliesslich hier, mit dem Modell aus dem Plugin. Der abgelegte Modellname bleibt in der Datenbank stehen; er wird nur nicht mehr gelesen.

    Und die Grenzen für Pakete sind gewachsen — von 700 MB auf 2,5 GB beim Herunterladen und von 1,5 GB auf 4 GB beim Entpacken. Die alten Zahlen waren für einen Editor gedacht; an ihnen wäre das Modellpaket gescheitert, bevor jemand etwas gemerkt hätte.

    Downloads