diff --git a/latest.json b/latest.json index ef1cd8a..0feb22d 100644 --- a/latest.json +++ b/latest.json @@ -1,11 +1,11 @@ { - "version": "0.3.1", - "notes": "Diktieren braucht keinen Endpunkt mehr — Whisper rechnet auf diesem Rechner. Das Modell dazu kommt als eigenes Paket, das man einspielt oder eben nicht.\n\nDiktieren geht jetzt ohne Endpunkt — auf diesem Rechner. Bisher brauchte das Diktat einen Dienst, der `POST /audio/transcriptions` annimmt. Am eigenen Endpunkt gemessen: `GET /v1/ki/models` antwortete 401 (die Route gibt es), `/audio/transcriptions` antwortete 404. Dort lief das Textmodell, aber keine Spracherkennung — und damit ging Diktieren gar nicht, ohne dass jemand am Server etwas nachrüstet.\n\nJetzt rechnet Whisper hier: Die Aufnahme verlässt den Rechner nicht, nicht einmal ins eigene Rechenzentrum. Wer ein Modell eingespielt hat, bekommt diesen Weg; wer keines hat, weiter den Endpunkt. Der Mikrofonknopf sagt im Zeigerfähnchen, welcher gerade gilt.\n\nAn einer gesprochenen Probe nachgemessen (die Sprachausgabe von Windows las einen Satz vor, 4,9 Sekunden):\n\ngeladen in 232 ms erkannt in 453 ms „Bitte senden Sie mir das Angebot für die Halle süd bis Freitag.\"\n\nGesprochen war „… Halle Süd …\" — bis auf die Grosschreibung Wort für Wort.\n\nDas Modell kommt als Plugin. `whisper-base` wiegt 277 MB, der Installer von SHUFTN 272 MB; beides zusammen hiesse ein halbes Gigabyte für jeden, auch für den, der nie diktiert. Es wird deshalb eingespielt wie der Editor — unter *Einstellungen → Erweiterungen*, mit Prüfsummen und der Möglichkeit, es wieder loszuwerden. Ohne Neustart: Ein Modell meldet kein Schema an, der Kern liest seine Dateien beim nächsten Diktat.\n\nDamit gibt es zwei Arten Plugin. Ein Modell nennt weder `schema` noch `einstieg`, und beides wird abgewiesen: Stünde dort ein Schema, lieferte SHUFTN die 277 MB Gewichte als Webseite aus. Was für Paketbauer gilt, steht in `PLUGINS.md` unter „Modelle\".\n\nGerechnet wird in reinem Rust. `whisper.cpp` wäre der verbreitetere Weg und hätte eine C++-Werkzeugkette in den Bau von SHUFTN gebracht — cmake, ein Compiler, plattformabhängige Schalter. Dann liesse sich SHUFTN nicht mehr mit `cargo build` allein übersetzen. Der Preis steht offen: auf der CPU langsamer als handoptimiertes C. Bei einem Diktat von zwanzig Sekunden ist das eine Frage von Sekunden.\n\nDas Umrechnen der Aufnahme (Opus → 16 kHz Mono) macht die Webansicht, nicht der Kern: Sie hat den Dekodierer eingebaut, und ihn in Rust nachzubauen hiesse wieder eine C-Bibliothek. Was der Kern bekommt, ist ein WAV — und was nicht 16 kHz Mono ist, weist er ab, statt es falsch zu deuten. Eine falsch gedeutete Abtastrate klingt für Whisper wie jemand, der zu schnell spricht, und liefert Text, den niemand als falsch erkennt.", - "pub_date": "2026-09-04T15:12:36Z", + "version": "0.3.2", + "notes": "Das Diktat bekommt ein deutsches Modell — und der Umweg über einen Endpunkt fällt weg.\n\nDas Diktat hört auf ein deutsches Modell. Bisher lag `whisper-base` bei — klein und schnell, aber an Namen und Zahlen scheiterte es. An einem gesprochenen Satz gemessen:\n\nbase: „Herr Nepomok geil von der Spinglereiwebe … Kalenderwoche 7 und 30\" turbo-de: „Herr Nepomuk-Geil von der Spenglerei Weber … Kalenderwoche 37\"\n\nDas neue Paket trägt `whisper-large-v3-turbo` in der deutschen Fassung von primeline (Apache-2.0). Es kostet: 1,2 GB statt 158 MB, und für zwölf Sekunden Sprache rechnet es zwölf Sekunden statt drei. Dafür steht in der Mail, was gesagt wurde — und nicht etwas, das man erst wieder ausbessert. Das kleine Modell bleibt daneben liegen, für schwache Rechner.\n\nEin Fehler, der dabei auffiel: Whisper hörte nicht auf. Bei einer Aufnahme von fünf Sekunden kam derselbe Satz achtmal zurück. Der Grund war das Fenster: Whisper ist auf dreissig Sekunden trainiert, und wer ihm weniger gibt, bekommt kein Schlusszeichen. Jetzt wird jedes Fenster mit Stille aufgefüllt — so, wie es die Vorlage von OpenAI tut.\n\nDer Weg über einen Endpunkt ist heraus. Mit ihm das Feld „Diktat-Modell\" unter Einstellungen → Assistent. Es zeigte auf einen Dienst, den nicht jeder hat — am eigenen Endpunkt antwortete `POST /audio/transcriptions` mit 404, während das Textmodell danebenlief. Ein Feld, das auf einen Weg zeigt, den es nicht mehr gibt, ist schlimmer als keines. Diktiert wird jetzt ausschliesslich hier, mit dem Modell aus dem Plugin. Der abgelegte Modellname bleibt in der Datenbank stehen; er wird nur nicht mehr gelesen.\n\nUnd die Grenzen für Pakete sind gewachsen — von 700 MB auf 2,5 GB beim Herunterladen und von 1,5 GB auf 4 GB beim Entpacken. Die alten Zahlen waren für einen Editor gedacht; an ihnen wäre das Modellpaket gescheitert, bevor jemand etwas gemerkt hätte.", + "pub_date": "2026-09-05T07:29:09Z", "platforms": { "windows-x86_64": { - "signature": "dW50cnVzdGVkIGNvbW1lbnQ6IHNpZ25hdHVyZSBmcm9tIHRhdXJpIHNlY3JldCBrZXkKUlVRbENEalUzQ3RFRHhzUjE0VEd6WDJDK3FCazRieExqMzdQWmQ4T1B3SzNzZERDUUlkTGViNGxET1JlYmxVT0s2V3htNW1BYmxrMjZURkhIbVc4a0phNkdFOVEveHI5T0FNPQp0cnVzdGVkIGNvbW1lbnQ6IHRpbWVzdGFtcDoxNzg4NTM0NzU1CWZpbGU6U0hVRlROXzAuMy4xX3g2NC1zZXR1cC5leGUKaVVaTjRTSGxwc3pyNGRSODdMWWc4bVgxaFRhMWVhVE5CcWRja0hhaGpla0NIRGEwb0Q1aExJUmxkelZZaUQ4RngwK0FVTXJtWDZ6TDBxNDZORDJnQnc9PQo=", - "url": "https://gitea.itm-technologies.de/ITM-GmbH/shuftn-releases/releases/download/v0.3.1/SHUFTN_0.3.1_x64-setup.exe" + "signature": "dW50cnVzdGVkIGNvbW1lbnQ6IHNpZ25hdHVyZSBmcm9tIHRhdXJpIHNlY3JldCBrZXkKUlVRbENEalUzQ3RFRHp5STRtb2JCQ0VENW1ZTkw2ZW5VN0ZpTlRCa3RxWTZtRjNMTnhOb09BOVIrT21RbGlZYVo1K1ZFdGtVQmg1UlFMdXRJOWxPZCtRU3ZzRnFTem5MZ1FnPQp0cnVzdGVkIGNvbW1lbnQ6IHRpbWVzdGFtcDoxNzg4NTkzMzQ5CWZpbGU6U0hVRlROXzAuMy4yX3g2NC1zZXR1cC5leGUKcktvQ1p5UUZBcWgyVC96bEFCSmJxRDNyQU0wWUFkdHZzN21Cc3BYbmM0T3ZQdGJpU3hrZDJrREZRc1N2ZjZkZjVsSnBoOXZaMSt3NHFXTzBsWmFEQXc9PQo=", + "url": "https://gitea.itm-technologies.de/ITM-GmbH/shuftn-releases/releases/download/v0.3.2/SHUFTN_0.3.2_x64-setup.exe" } } } \ No newline at end of file