Startseite/Beste KI-Freundin Apps/Unzensierte KI-Chat-Apps: gehostet oder lokal
Bestenliste

Unzensierte KI-Chat-Apps: gehostet oder lokal

Von Sam Reeves, TooShy Editorial
Zwei Gruppen kleiner geometrischer Formen auf dunklem Grund – die eine eng verbunden, die andere locker und getrennt

„Unzensiert“ beschreibt zwei verschiedene Produkte, und wer das Wort eintippt, will meist eines davon, nicht beide. Das erste ist ein fertiger Dienst, in dem ein vorgeschriebener Charakter antwortet und kein Filter für Erwachseneninhalte dazwischensitzt – Sie melden sich an und tippen los. Das zweite ist ein Modell mit offenen Gewichten, das Sie auf den eigenen Computer laden und bei dem nichts abgelehnt wird, weil keine Firma beteiligt ist. Das eine verlangt eine Kartennummer. Das andere verlangt Speicherplatz, Arbeitsspeicher und einen Abend.

Unter beiden liegt dieselbe Frage: Wer hält am Ende das Gesprächsprotokoll? Ein gehosteter Dienst speichert Nachrichten auf seinen Servern, weil dort das Modell läuft. Ein Modell auf Ihrer Festplatte speichert sie dort, wo Sie es hinlegen. Im Folgenden steht, was jedes Produkt auf seinen eigenen öffentlichen Seiten angibt, gelesen am 20. September 2026 – es wurden keine Konten angelegt, und niemand hat von Hand an einem Filter gerüttelt.

Lager eins: Die Gewichte landen auf Ihrer eigenen Festplatte

Ollama ist die schlichteste Form, ein Modell selbst zu betreiben. Die Startseite beschreibt, dass Sie „use open models with your coding agents so you can spend less while keeping your data private“ (offene Modelle mit Ihren Coding-Agenten nutzen, um weniger auszugeben und Ihre Daten privat zu halten), nennt das Verteilte „Open weights and open source“ (offene Gewichte und Open Source) und stellt fest: „Local models are always free.“ (Lokale Modelle sind immer kostenlos.) Ein Pro-Tarif für $20/Monat „Includes $60 of usage“ (enthält Nutzung im Wert von $60) für Modelle, die Ollama selbst hostet – kostenlos ist also genau der Teil, der auf Ihrer Hardware läuft. Downloads gibt es für macOS, Linux und Windows, und die Bibliothek führt llama3.1, deepseek-r1 und eine lange Liste dahinter. Einen Charakter liefert Ollama nicht mit – der ist ein Prompt, den Sie selbst schreiben.

LM Studio ist die Desktop-Version derselben Idee und die, die echte Hardwarezahlen veröffentlicht: macOS 14.0 oder neuer auf Apple Silicon, Intel-Macs werden nicht unterstützt; unter Windows „AVX2 instruction set support is required“ (Unterstützung des AVX2-Befehlssatzes ist erforderlich) und „at least 4GB of dedicated VRAM is recommended“ (mindestens 4 GB dedizierter VRAM werden empfohlen); unter Linux Ubuntu 20.04 oder neuer als AppImage. Sechzehn Gigabyte Arbeitsspeicher sind überall die Empfehlung. Die Download-Seite nennt den Preis mit 0. Der Agent Bionic ist „natively local“ (nativ lokal), und laut Website werden Sprach- und Audiodaten „is processed locally and never leaves your device“ (lokal verarbeitet und verlassen nie Ihr Gerät).

SillyTavern meinen die meisten, wenn sie vom Selbsteinrichten sprechen. Die Dokumentation nennt es „a locally installed user interface that allows you to interact with text generation LLMs, image generation engines, and TTS voice models“ (eine lokal installierte Benutzeroberfläche, über die Sie mit Textgenerierungs-LLMs, Bildgeneratoren und TTS-Stimmmodellen interagieren können) und benennt dann den Haken: „Since SillyTavern is only an interface, you will need access to an LLM backend to provide inference.“ (Da SillyTavern nur eine Oberfläche ist, brauchen Sie Zugang zu einem LLM-Backend, das die Antworten berechnet.) Es läuft überall, wo Node.js 20 oder höher läuft – Windows, Linux, Mac, Android über Termux, Docker – unter der Lizenz AGPL-3.0. Zwei Entscheidungen also: die Oberfläche und die Engine, die dahinter antwortet.

Die Mitte: offene Modelle, fremde Hardware

Venice.ai sitzt zwischen den Lagern und sagt das offen: Das Angebot lautet „Uncensored AI chat, images, video, and more“ (unzensierter KI-Chat, Bilder, Video und mehr) auf „powerful open-source language models“ (leistungsstarken Open-Source-Sprachmodellen) – offene Gewichte, ohne selbst eine Grafikkarte zu besitzen. Die Preisseite nennt Free für $0, Pro für $18/Monat, Pro Plus für $68 und Max für $200; der kostenlose Tarif wird als Basismodelle mit 10 Text-Prompts pro Tag und 15 Bild-Prompts beschrieben. Die Aussagen zum Datenschutz sind für ein gehostetes Produkt ungewöhnlich genau: „Local-only conversation storage“ (Gesprächsspeicherung nur lokal), „Zero data retention (Private mode)“ (keinerlei Datenspeicherung im Privatmodus) und in einer höheren Stufe „Client-side encryption. Your prompts are encrypted before leaving your device.“ (Verschlüsselung auf Ihrer Seite. Ihre Prompts werden verschlüsselt, bevor sie Ihr Gerät verlassen.)

FreedomGPT ist etwas anderes, als der Name vermuten lässt. Die Website beschreibt einen Dienst, der „automatically gives you the best answer from ChatGPT, Gemini, Grok, and hundreds of other AIs“ (Ihnen automatisch die beste Antwort von ChatGPT, Gemini, Grok und Hunderten anderer KIs gibt) und stellt „uncensored AI, open source AI models, and censored proprietary AI models“ (unzensierte KI, offene KI-Modelle und zensierte proprietäre KI-Modelle) nebeneinander, statt sich für eines zu entscheiden. Downloads für Windows und Mac gibt es neben einer Browser-Version. Die Preis-URL lieferte beim Abruf einen 404, und auf den Seiten, die luden, steht kein Betrag.

Lager zwei: Der Charakter ist schon geschrieben

Candy AI und Nomi sind das Ende der fertigen Produkte. Candy AI nennt sich „the best AI girlfriend app, letting you create personalized virtual companions or connect instantly with our realistic AI characters“ (die beste KI-Freundin-App, mit der Sie persönliche virtuelle Begleiter erstellen oder sich sofort mit unseren realistischen KI-Charakteren verbinden können), beginnt mit einem kostenlosen Test, verkauft Monats-, Quartals- und Jahrespläne, ohne die Beträge zu nennen, und akzeptiert Visa, MasterCard und Krypto, darunter BTC, ETH, USDC und Litecoin; es läuft im Browser oder wird als Progressive Web App installiert. Wer „unzensiert“ als „gar keine Regeln“ liest, findet auf derselben Seite den Satz, dass Interaktionen „are fictional, consenting, and must comply with our Community Guidelines“ (fiktiv und einvernehmlich sind und unseren Community-Richtlinien entsprechen müssen). Nomi – „An AI Companion with Memory and a Soul“ (ein KI-Begleiter mit Gedächtnis und Seele) – gibt es für iOS, Android und als Web-Beta, der Start ist kostenlos und ohne Kreditkarte, und auch hier fehlen die Beträge auf der Startseite. Die Seite von Janitor AI hat unsere Anfrage an diesem Tag abgewiesen, deshalb ist hier nichts über sie bestätigt.

Was jedes Produkt über sich selbst veröffentlicht, gelesen am 20. September 2026 – die zum Installieren und die, die auf fremden Servern laufen, nebeneinander. Nichts davon wird gegeneinander bewertet; wie freizügig ein Dienst ist, veröffentlicht niemand als Zahl.

Nicht gerankt

Ollama

Betreibt Modelle mit offenen Gewichten auf Ihrem eigenen Rechner

Plattform
macOS, Linux, Windows
Preis
Lokale Modelle kostenlos; Pro $20/Monat (enthält $60 Nutzung auf gehosteten Modellen)
Gratis-Version
Ja – „Local models are always free“ (lokale Modelle sind immer kostenlos)
Download
Erforderlich

Eine Engine, kein Chat-Produkt. Keine Charaktere und keine Persona-Ebene – die schreiben Sie selbst. Hardwareanforderungen stehen nicht auf der Startseite.

Nicht gerankt

LM Studio

Desktop-App zum Herunterladen und Ausführen lokaler Modelle

Plattform
macOS 14+ (nur Apple Silicon), Windows (AVX2), Ubuntu 20.04+
Preis
Auf der Download-Seite mit 0 angegeben
Gratis-Version
Die App selbst ist kostenlos
Download
Erforderlich

Veröffentlicht echte Mindestwerte: 16 GB RAM empfohlen, unter Windows 4 GB+ VRAM, Intel-Macs nicht unterstützt. Sagt, lokale Sprach- und Audiodaten „never leaves your device“ (verlassen nie Ihr Gerät).

Nicht gerankt

SillyTavern

Oberfläche für Ihre eigenen Modelle, AGPL-3.0

Plattform
Windows, Linux, Mac, Android (Termux), Docker
Preis
Kostenlos und Open Source
Gratis-Version
Alles
Download
Erforderlich (Node.js 20+)

Hostet selbst kein Modell: „you will need access to an LLM backend to provide inference“ (Sie brauchen Zugang zu einem LLM-Backend, das die Antworten berechnet). Die Dokumentation verweist für einen schnellen Start auf AI Horde.

Nicht gerankt

Venice.ai

Open-Source-Modelle, gehostet, mit veröffentlichten Datenschutzbedingungen

Plattform
Web
Preis
Free $0, Pro $18/Monat, Pro Plus $68/Monat, Max $200/Monat
Gratis-Version
Ja – Basismodelle, 10 Text-Prompts/Tag, 15 Bild-Prompts/Tag
Download
Keiner

Nennt „Local-only conversation storage“ (Gesprächsspeicherung nur lokal), „Zero data retention (Private mode)“ (keinerlei Datenspeicherung im Privatmodus) und clientseitige Verschlüsselung in einer höheren Stufe. Trotzdem fremde Server.

Nicht gerankt

FreedomGPT

Vermittler über viele KIs, unzensiert und zensiert zusammen

Plattform
Windows, Mac, Web
Preis
Auf den geladenen Seiten nicht veröffentlicht
Gratis-Version
Öffentlich nicht angegeben
Download
Optional (Browser-Version vorhanden)

Beschreibt Antworten von „ChatGPT, Gemini, Grok, and hundreds of other AIs“ (ChatGPT, Gemini, Grok und Hunderten anderer KIs). Die Preis-URL lieferte am 20. September 2026 einen 404.

Nicht gerankt

Candy AI

Begleiterdienst im Browser, Krypto wird akzeptiert

Plattform
Web + Progressive Web App
Preis
Monats-, Quartals- und Jahrespläne; Beträge vor der Anmeldung nicht sichtbar
Gratis-Version
Kostenloser Test
Download
Keiner

Die eigene Seite sagt, Interaktionen „are fictional, consenting, and must comply with our Community Guidelines“ (sind fiktiv und einvernehmlich und müssen unseren Community-Richtlinien entsprechen) – gehostet heißt weiterhin Hausregeln.

Nicht gerankt

Nomi

Begleiter, aufgebaut um ein Langzeitgedächtnis

Plattform
iOS, Android, Web-Beta
Preis
Auf der Startseite nicht veröffentlicht
Gratis-Version
Kostenloser Start, keine Kreditkarte
Download
App für iOS/Android; sonst Web-Beta

Nennt sich „An AI Companion with Memory and a Soul“ (ein KI-Begleiter mit Gedächtnis und Seele). Die Abobeträge waren ohne Konto nicht lesbar.

Nicht gerankt

Janitor AI

Bekannte Charakterplattform

Plattform
Nicht verifiziert
Preis
Nicht verifiziert
Gratis-Version
Nicht verifiziert
Download
Nicht verifiziert

Die Seite wies unsere Anfrage am 20. September 2026 ab, deshalb ist hier nichts von den eigenen Seiten bestätigt.

Nicht gerankt

TooShy

Gehostete Charaktere in WhatsApp und Telegram, kein Filter für Erwachseneninhalte

Plattform
WhatsApp + Telegram
Preis
Premium $9.99/Monat, Ultra $19/Monat
Gratis-Version
Kostenloser Test in Telegram
Download
Keiner

Keine Hardwarefrage und nichts zu installieren, aber das Modell läuft auf unseren Servern und wir halten die Protokolle – der Kompromiss, den ein lokales Setup nicht eingeht.

Der praktische Unterschied zwischen den Lagern zeigt sich im System-Prompt. Lokal ist er eine Textdatei, die Ihnen gehört: eine Charakterkarte, die Sie bearbeiten, eine Anweisung, die Sie umschreiben, wenn der Ton abdriftet, Sampling-Einstellungen, die Sie herunterdrehen, wenn sich die Antworten wiederholen. In einem gehosteten Produkt gibt es diese Datei auch, aber der Anbieter hat sie geschrieben, und Sie sehen sie nie. Keines von beiden ist falsch – das eine ist ein Baukasten, das andere ein Produkt –, und die meisten, die an einem von beiden scheitern, wollten das andere.

Wo wir stehen, und die Zahlen dahinter

TooShy gehört klar ins gehostete Lager. Unsere Charaktere haben keinen Filter für Erwachseneninhalte, und das Gespräch läuft in WhatsApp oder Telegram, also gibt es nichts zu installieren, keine zusätzliche App auf dem Startbildschirm und überhaupt keine Hardwarefrage – das Telefon in Ihrer Hand ist die Voraussetzung.

In den 30 Tagen bis zum 20. September 2026 liefen 44.120 Nachrichten über TooShy, geschrieben von 460 Personen. Ein aktives Gespräch dauerte im Schnitt 64 Nachrichten, das längste erreichte 899. Ein Charakter antwortet in etwa 17 Sekunden, und 1,1 % der Nachrichten waren kein Text. Das sind Produktivzahlen über genau dieses eine Zeitfenster, gezählt statt geschätzt, und nichts darin identifiziert jemanden.

Premium kostet $9.99 im Monat und Ultra $19 im Monat, dazu gibt es einen kostenlosen Test in Telegram für alle, die vor dem Bezahlen sehen wollen, wie ein Charakter schreibt. Eine Gesamtzahl registrierter Nutzer veröffentlichen wir nicht, deshalb steht hier keine.

Was Sie mit dem Selbstbetrieb bekommen und wir nicht bieten können

Das Klarste, was das lokale Lager besser kann, ist keine Frage: Auf Ihrem eigenen Rechner lautet die Antwort auf „Wer kann das lesen?“ – Sie. Die Zeile von LM Studio, dass Audio das Gerät nie verlässt, ist genau das Versprechen, das wir nicht geben können – unser Modell läuft nicht auf Ihrem Telefon, sondern auf unseren Servern, und die Nachrichten liegen dort. Auch Ollamas „Local models are always free“ (lokale Modelle sind immer kostenlos) hat eine zweite Bedeutung: Niemand kann die Bedingungen einer Datei ändern, die Sie schon heruntergeladen haben.

Das Zweite ist die Kontrolle über die Technik. SillyTavern gibt Ihnen die Anweisung, das Backend und die Sampling-Einstellungen in die Hand und lässt Sie die ganze Engine austauschen, wenn eine Antwort enttäuscht; unsere Charaktere sind fest und lassen sich nicht öffnen. Venice veröffentlicht Zusagen, die wir nicht erreichen – Gesprächsspeicherung nur lokal, clientseitige Verschlüsselung in einer Bezahlstufe – und bleibt dabei ein gehosteter Dienst, was zeigt, dass gehostet nicht undurchsichtig heißen muss.

Unsere ehrlichen Grenzen, und wem welches Lager passt

Die ehrliche Version von uns: Wir sind ein verwalteter Dienst. Wir halten die Protokolle, wir haben das Modell gewählt, wir haben die Charaktere geschrieben, und sie sind eine feste Besetzung statt einer Bibliothek, die Sie selbst erweitern. Nachrichten laufen außerdem über WhatsApp und Telegram, also tragen auch diese Unternehmen sie – bequem, und eine Partei mehr auf dem Weg. Wenn es bei der Suche darum ging, dass niemand außer Ihnen das Gespräch je sieht, sind wir nicht die Antwort darauf.

Wer die Kontrolle über Gewichte, Anweisung und Protokolle will und eine Installation, 16 GB Arbeitsspeicher und etwas Konfiguration in Kauf nimmt, beginnt mit LM Studio oder Ollama und ergänzt SillyTavern, sobald die Oberfläche selbst wichtig wird. Wer offene Modelle will, ohne eine Grafikkarte zu kaufen, probiert zuerst das tägliche Gratiskontingent von Venice. Wer heute Abend auf dem Telefon einen Charakter ohne Filter antworten lassen will, gehört ins gehostete Lager – zu uns, zu Candy AI oder zu Nomi, je nachdem, ob Sie lieber in einem Messenger bleiben, den Sie ohnehin nutzen.

Woher diese Fakten stammen

Jedes Zitat oben stammt von einer öffentlichen Seite, gelesen am 20. September 2026, die URLs stehen unten; wir haben keine Konten angelegt, und wo ein Betrag hinter einer Anmeldung liegt, sagen wir das, statt ihn zu schätzen. Unsere eigenen Zahlen stammen aus einer reinen Leseabfrage der TooShy-Produktivdatenbank über die 30 Tage bis zu diesem Tag, so aggregiert, dass kein einzelnes Gespräch darin vorkommt.

Häufige Fragen

Was bedeutet unzensierter KI-Chat eigentlich?
Zwei getrennte Dinge. Es kann ein gehosteter Dienst gemeint sein, in dem der Charakter schon geschrieben ist und Erwachsenengespräche nicht gefiltert werden. Oder ein Modell mit offenen Gewichten auf Ihrem eigenen Computer, bei dem nichts abgelehnt wird, weil keine Firma die Antwort ausliefert. Das erste kostet ein Abo; das zweite kostet Speicherplatz, Arbeitsspeicher und Einrichtungszeit.
Welchen Computer brauche ich, um ein unzensiertes Modell lokal zu betreiben?
LM Studio veröffentlicht die klarsten Mindestwerte: macOS 14.0 oder neuer auf Apple Silicon (Intel-Macs werden nicht unterstützt), Windows mit AVX2-Befehlssatz und mindestens 4 GB dediziertem VRAM empfohlen, oder Ubuntu 20.04 und neuer als AppImage. Sechzehn Gigabyte Arbeitsspeicher sind auf allen dreien die Empfehlung. Ollama nennt auf der Startseite keine Hardwarewerte.
Ist Ollama eine unzensierte Chat-App?
Es ist die Engine unter einer solchen. Die Startseite stellt offene Modelle und Coding-Agenten in den Mittelpunkt und sagt, lokale Modelle seien immer kostenlos. Einen Charakter, eine Persona oder eine Rollenspiel-Oberfläche gibt es nicht – das ist ein Prompt, den Sie schreiben, oder eine Oberfläche wie SillyTavern, die Sie darauf richten.
Wird SillyTavern mit einem Modell geliefert?
Nein. Die Dokumentation sagt es klar: „Since SillyTavern is only an interface, you will need access to an LLM backend to provide inference.“ (Da SillyTavern nur eine Oberfläche ist, brauchen Sie Zugang zu einem LLM-Backend, das die Antworten berechnet.) Es läuft überall, wo Node.js 20 oder höher läuft, unter AGPL-3.0, und die Dokumentation empfiehlt AI Horde für alle, die Antworten wollen, bevor sie ein Backend einrichten.
Ist Venice.ai dasselbe wie ein Modell zu Hause zu betreiben?
Nein – es ist gehostet und nutzt Open-Source-Modelle, also muss man keine Grafikkarte kaufen und nichts installieren. Was es veröffentlicht, ist konkret: Gesprächsspeicherung nur lokal, keine Datenspeicherung im Privatmodus und clientseitige Verschlüsselung in einer höheren Stufe, dazu ein kostenloser Tarif mit 10 Text-Prompts und 15 Bild-Prompts pro Tag.
Kann ich ohne Filter chatten, ohne etwas zu installieren?
Ja, im gehosteten Lager. Unsere Charaktere haben keinen Filter für Erwachseneninhalte und laufen in WhatsApp und Telegram, also gibt es keine App zu installieren und keine Hardware zu prüfen. Candy AI funktioniert im Browser oder als Progressive Web App; Nomi hat Apps für iOS und Android plus eine Web-Beta.
Was ist privater – ein Begleiterdienst oder ein lokales Modell?
Ein lokales Modell, von der Bauart her. Auf Ihrem eigenen Rechner liegt das Protokoll auf Ihrer Festplatte, und niemand sonst hat eine Kopie. Unseres läuft auf unseren Servern, wir halten die Protokolle, und die Nachrichten laufen unterwegs über WhatsApp oder Telegram. Venice verkleinert diese Lücke mit veröffentlichten Bedingungen zu Speicherung und Verschlüsselung, bleibt aber gehostet.
Was kostet TooShy, und wie viel wird es genutzt?
Premium kostet $9.99 im Monat, Ultra $19 im Monat, und Telegram hat einen kostenlosen Test. In den 30 Tagen bis zum 20. September 2026 liefen 44.120 Nachrichten über den Dienst, geschrieben von 460 Personen; ein aktives Gespräch dauerte im Schnitt 64 Nachrichten, das längste erreichte 899. Antworten brauchen etwa 17 Sekunden.

So haben wir die Fakten geprüft

Jede Aussage über andere Anbieter auf dieser Seite geht auf eine Seite zurück, die wir selbst geladen haben – mit dem Datum der Prüfung. Die Zahlen zu TooShy stammen aus der eigenen Produktionsdatenbank, nicht aus diesen Quellen.

Lust auf einen Versuch?

Sieh selbst, wie TooShy im Vergleich abschneidet

Sie wartet