ChatNicer Download

Besser formulieren, ohne das Fenster zu wechseln.

ChatNicer ersetzt markierten Text per Hotkey durch eine bessere Fassung – gerechnet von einem lokalen Ollama-Modell, überall in Windows.

  • 111 KB EXE
  • ~1 Sekunde pro Anfrage
  • 100 % lokal

Windows 10/11 · x64 · benötigt ein laufendes Ollama

So funktioniert’s

Kein Chatfenster, keine Zwischenstation: Die Markierung selbst wird ersetzt – im Outlook-Entwurf, im Teams-Eingabefeld, im Editor.

Text markieren STRG+SHIFT+LEERTASTE localhost:11434 Markierung ersetzt in jedem Programm frei konfigurierbar Ollama, lokal Original bleibt Auswahl
markiertdas ist ein test mit fehlan
eingefügtDas ist ein Test mit Fehlern.
markiertmach mir ne liste mit 5 gemüsesorten
eingefügtMach mir bitte eine Liste mit fünf Gemüsesorten.
markiertey das geht so nicht du hast das verkackt
eingefügtSo funktioniert das leider nicht, hier ist etwas schiefgelaufen.

Beim zweiten Beispiel ist der Punkt: Die Bitte wird umformuliert, nicht beantwortet. Genau daran scheitern kleine Modelle sonst – wie das verhindert wird, steht in Abschnitt 7.

Was es kann

  • blau: bereit
  • orange: Modell arbeitet
  • rot: Fehler, mit Klartext-Hinweis
  • Zwei ModiEinfügen (Antwort kommt fertig über die Zwischenablage) oder Live tippen (Streaming, ~1,3 s für 271 Zeichen).
  • Warmup beim StartLädt das Modell mit einer leeren Anfrage in Ollamas Speicher – spart der ersten echten Anfrage rund 4 Sekunden.
  • Freier HotkeyVoreingestellt STRG + SHIFT + Leertaste, im Dialog änderbar.
  • ModellauswahlAuswahlliste aus den Modellen, die auf dem Rechner tatsächlich installiert sind.
  • Eigener System-PromptEbenso Temperature und Timeout – gespeichert in einer config.ini neben der EXE.
  • Zwischenablage bleibt heilDer vorherige Inhalt wird nach dem Einfügen wiederhergestellt, auch auf jedem Fehlerpfad.
  • VerbindungstestEin Klick im Einstellungsdialog prüft, ob Ollama erreichbar ist und das Modell antwortet.
  • Statusanzeige im TrayDas Icon zeigt jederzeit, woran das Programm gerade ist (siehe oben).

Installation

  1. Ollama installieren und das Modell holen

    Von ollama.com, danach in der Eingabeaufforderung:

    ollama pull qwen3:4b-instruct
  2. ChatNicer.exe herunterladen und irgendwohin legen

    Eine Datei, kein Installer, keine Registry-Einträge. Ein Ordner im Benutzerverzeichnis genügt; daneben legt das Programm später seine config.ini ab.

  3. Starten

    Beim ersten Start öffnet sich der Einstellungsdialog. Modell wählen, Verbindung testen, fertig – danach lebt ChatNicer im Tray.

Autostart erledigt die Einstellung „Mit Windows automatisch starten" (seit v1.2). Von Hand geht es weiterhin über Win + R, shell:startup und eine Verknüpfung zur EXE.

shell:startup

Lokal und privat

Jede Anfrage geht an http://localhost:11434 – also an das Ollama auf demselben Rechner. Der markierte Text verlässt die Maschine nicht.

Kein Konto, kein API-Schlüssel, keine Telemetrie, kein Auto-Update. ChatNicer öffnet keine Netzverbindung außer der zu Ollama; ist eine entfernte Ollama-Instanz eingetragen, geht sie genau dorthin und sonst nirgends.

Download

ChatNicer.exe · 111 KB
Version 1.6113.664 BytesWindows 10/11, x64
SHA-256
589F01979757E8FDB3620BE481CD7C31E7D426E4071488545B2797BB7DF94D03

Die EXE ist nicht signiert, deshalb warnt Windows SmartScreen beim ersten Start. Über Weitere InformationenTrotzdem ausführen geht es weiter. Wer das nicht mag: build.bat im Repository baut die EXE in unter einer Minute selbst – Visual Studio 2022 muss nicht installiert sein, das Skript findet die Buildtools.

Versionen

  • v1.6

    • Update CNAME
  • v1.5

    • Ohne Changelog-Eintrag veroeffentlicht
  • v1.4

    • Delete CNAME
    • Create CNAME
    • Update CNAME
Ältere Versionen
  • v1.3

    • Jeder Push auf main veröffentlicht jetzt ein durchnummeriertes Release v1.x
    • Changelog und Landingpage werden dabei automatisch nachgezogen
  • v1.2

    • Start-Warmup lädt das Modell schon beim Programmstart
    • Autostart-Schalter in den Einstellungen
    • Smileys werden nicht mehr in Worte übersetzt
    • Verschriebene Antwort-Tags werden toleriert
  • v1.1

    • Tippmodus: Die Antwort wird live getippt, während das Modell streamt
    • Vier neue Regeln im System-Prompt gegen holprige Sätze
  • v1.0

    • Standardmodell ist qwen3:4b-instruct: 1–4 s statt 14–27 s
    • Die Token-Grenzen richten sich nach der Textlänge
    • Ein Zweitversuch rettet leere Antworten denkender Modelle
  • v0.9

    • Erste Fassung: Tray-Icon, globaler Hotkey, WinHTTP-Anbindung an die Ollama-API
    • Einstellungsdialog mit Verbindungstest und Modell-Liste
    • Handgeschriebener JSON-Umgang statt Bibliothek

Details für Interessierte

Welches Modell soll ich nehmen?

Die Endung entscheidet, nicht die Größe. qwen3:4b und qwen3:4b-instruct sind gleich groß – die Instruct-Variante hat die Denkphase gar nicht erst.

ModellDauer pro AnfrageBewertung
qwen3:4b-instruct~0,3 sStandard: hält sich am zuverlässigsten an die Tag-Regel, bestes Deutsch
llama3.2:3b~0,3–1 sähnlich schnell, verhaspelt sich aber häufiger beim Tag
qwen3:4b14–27 sdieselbe Größe, denkt aber sichtbar mit – fürs Inline-Einfügen zu langsam
qwen3.5:4b~16 sdenkt noch ausdauernder
Warum ist die EXE nur 111 KB groß?

Reines Win32 plus WinHTTP, keine einzige externe Bibliothek: kein .NET, kein Electron, kein curl, keine JSON-Bibliothek. Die vcruntime wird statisch gebunden, die Universal CRT dynamisch – ucrtbase.dll gehört seit Windows 10 zum System, deshalb braucht es kein Redistributable. Dazu /O1 /Os, /GL mit /LTCG, /GR-, /GS-, /OPT:REF /OPT:ICF und abgeschaltete Exceptions. Die Icons zeichnet das Programm zur Laufzeit, es gibt keine Ressourcendatei.

VarianteGrößeLaufzeitabhängigkeit
Standard-Release113.664 Bnur ucrtbase.dll (Windows-Systemdatei)
statische CRT + Exceptions (build.bat compat)212.992 Bkeine
dynamische CRT (/MD)106.496 BVC++-Redistributable erforderlich
Wie bringt man ein 4B-Modell dazu, den Text nicht zu beantworten?

Der markierte Text wird nie roh in den Prompt geschrieben, sondern in <text_to_process> verpackt. Ohne diese Klammer hält ein kleines Modell „was ist die hauptstadt von frankreich?“ für eine Frage an sich selbst und antwortet „Paris“, statt den Satz zu glätten.

Die Antwort muss ihrerseits in <rewritten_text> stehen und wird genau daraus herausgeschnitten – Vorreden wie „Hier ist mein Versuch:“ landen also nie im Dokument. Das Herausschneiden ist bewusst fehlertolerant: verschriebene, halb geschlossene oder mit Leerzeichen verunstaltete Tags werden trotzdem erkannt, weil kleine Modelle sich genau dort verhaspeln.

Was kann es nicht?
  • Ein kleines Modell bleibt ein kleines Modell: Bei Texten, die stark nach einer Anweisung an eine KI klingen, kann es ausbrechen.
  • Nur Text: Gesichert und wiederhergestellt wird ausschließlich Unicode-Text. Ein Bild in der Zwischenablage ist danach weg.
  • Im Tippmodus werden Zeilenumbrüche als ENTER getippt – in Chat-Eingabefeldern (Teams, Slack, WhatsApp Web) schickt das die Nachricht ab. Für mehrzeilige Texte ist dort der Einfügemodus die sichere Wahl.
  • Im Tippmodus gibt es ab dem ersten Zeichen kein Zurück: Bricht die Verbindung ab, bleibt der halbe Text stehen.
  • Fenster mit Administratorrechten nehmen keine simulierten Tastendrücke an (UIPI). Abhilfe: ChatNicer ebenfalls als Administrator starten.
  • Nur x64.
Kurze Fragen
Braucht das Internet?
Nein, nur ein laufendes Ollama.
Kostet es etwas?
Nein, Open Source.
Kann ich den Prompt ändern, z. B. zum Übersetzen?
Ja – die <rewritten_text>-Regel muss aber stehen bleiben.
Warum warnt Windows beim Start?
Die EXE ist nicht signiert.
Ollama auf einem anderen Rechner?
Ja, URL und optionaler API-Key sind konfigurierbar.
macOS oder Linux?
Nein, reines Win32.