Dolphin Mistral 24B Venice Edition: Spezifikationen, Story und wo man es jetzt verwenden kann

Wenn Sie dolphin-mistral-24b-venice-edition auf Hugging Face oder Reddit gesehen haben und tatsächlich mit ihm sprechen möchten, haben Sie im Jahr 2026 zwei Arbeitsmöglichkeiten: Führen Sie eine quantisierte Kopie auf Ihrer eigenen Hardware aus oder nutzen Sie den gehosteten Nachfolger online. Hier ist das Modell, seine Geschichte und beide Wege.

Dolphin Mistral 24B Venice Edition ist eine unzensierte Feinabstimmung des 24B-Modells von Mistral, erstellt vom Dolphin-Team (Cognitive Computations) für Venice AI. Der ursprüngliche Slug API wurde eingestellt; Sein direkter Nachfolger, Venice Uncensored 1.2, wird heute von Venice bedient – ​​und Sie können mit ihm unter Pinkerton AI chatten, ohne ein Konto zu erstellen. Für die lokale Verwendung bleiben GGUF Quantisierungen des Originals auf Hugging Face verfügbar und laufen unter Ollama.

Last updated

Was ist Dolphin Mistral 24B Venice Edition?

Eine Zusammenarbeit zwischen Cognitive Computations – dem Team hinter der Dolphin-Serie unzensierter Feinabstimmungen – und Venice AI, angewendet auf die 24B-Basis von Mistral. Dolphin-Modelle sind darauf trainiert, den Systemaufforderungen strikt zu folgen und ohne Ablehnung zu antworten, was die Venice Edition zu einem der am häufigsten verwendeten unzensierten Modelle ihrer Generation gemacht hat: stark im kreativen Schreiben, Rollenspiel und unverblümten technischen Antworten, klein genug, um sich selbst zu hosten, freizügig lizenziert.

Warum können Sie es nicht mehr auf Venice API finden?

Venice stellt Modell-Slugs ein, wenn neuere Versionen ausgeliefert werden, und der dolphin-mistral-24b-venice-edition-Slug wurde aus der Modellliste von api.venice.ai entfernt. Seine Abstammung wird als Venice Uncensored fortgesetzt – derzeit Version 1.2 – die die gleiche Rolle wie die unzensierte Flaggschiff-Feinabstimmung der Plattform bei fp16 mit einem 128K-Kontextfenster erfüllt. Wenn ein Tutorial oder ein Reddit-Thread Sie auf den alten Fehler hinweist, ist Venice Uncensored 1.2 das, worauf es in der Praxis hinausläuft.

So nutzen Sie es online ohne Konto

Pinkerton AI hostet Venice Uncensored 1.2 in seiner Modellauswahl – öffnen Sie den Chat, wählen Sie ihn aus und sprechen Sie. Keine E-Mail, keine Anmeldung und keine serverseitigen Konversationsprotokolle; Eine kostenlose Sitzung beinhaltet genügend Credits, um sie ordnungsgemäß bewerten zu können. Dies ist der schnellste Weg vom „Ansehen des Modells auf Hugging Face“ bis zur tatsächlichen Nutzung, und die Datenschutzlage – anonyme Sitzungen, Krypto-Zahlung bei Upgrade – entspricht dem, was Menschen überhaupt zu Dolphin-Modellen hinzieht.

So führen Sie das Original lokal aus

GGUF Quantisierungen von dolphin-mistral-24b-venice-edition werden auf Hugging Face veröffentlicht und in Ollama, LM Studio oder llama.cpp geladen. Budgetieren Sie etwa 14 GB für eine Q4-Quantisierung und deutlich mehr für Q8; Eine 24-GB-GPU sorgt für eine angenehme Geschwindigkeit und die reine CPU-Inferenz funktioniert, ist aber langsam. Lokal gewinnt durch absolute Privatsphäre – die Eingabeaufforderung verlässt nie Ihren Computer – auf Kosten von Quantisierungsqualitätsverlusten und Hardware. Es ist der richtige Anruf, wenn Ihr Bedrohungsmodell es erfordert.

Ist es tatsächlich unzensiert?

Ja, im spezifischen Dolphin-Sinn: Die Feinabstimmung entfernt Ablehnungsverhalten und verschiebt sich auf die Eingabeaufforderung Ihres Systems, sodass legale, aber sensible Anfragen – düstere Fiktion, explizite Rollenspiele zwischen Erwachsenen, offene Sicherheitsdetails, ungesicherte Meinungen – direkte Antworten erhalten. Es stellt keine illegalen Inhalte zur Verfügung und der gehostete Zugriff auf Pinkerton AI setzt unabhängig vom Modell dieselben rechtlichen Grundsätze durch.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
ModellversionVenice Uncensored 1.2 (Nachfolger)Original 24B GGUF von Hugging Face
AufstellenKeine – wählen Sie es aus und chatten SieOllama / llama.cpp + ~14-50 GB Download
Präzisionfp16, 128K KontextQuantisiert (Q4-Q8), kürzerer praktischer Kontext
Hardware erforderlichKeiner24 GB+ VRAM für komfortable Geschwindigkeit
KontoKeine – anonyme SitzungKeiner
PrivatsphäreKeine serverseitigen ProtokolleVollständig lokal – so stark wie möglich

Was hat Dolphin Mistral 24B Venice Edition ersetzt?

Venice Uncensored 1.2 – die Fortsetzung derselben unzensierten Flaggschifflinie auf der Infrastruktur von Venice. Es kann bei Pinkerton AI ohne Konto ausgewählt werden.

Kann ich Dolphin Mistral 24B Venice Edition trotzdem herunterladen?

Ja – GGUF-Quantisierungen bleiben auf Hugging Face (dphn/dolphin-mistral-24b-venice-edition und Community-GGUF-Repos) und werden unter Ollama, LM Studio oder llama.cpp ausgeführt.

Welche Hardware benötigt Dolphin Mistral 24B lokal?

Etwa 14 GB Speicher für einen Q4 GGUF, mehr für höhere Quantisierungen; Eine 24-GB-VRAM-GPU sorgt für den komfortablen Betrieb. Für den gehosteten Zugriff ist nichts erforderlich.

Ist Dolphin Mistral gut für Rollenspiele?

Es ist eines der Referenzmodelle dafür – das Dolphin-Training sorgt dafür, dass es Persona- und Szenarioanweisungen aus der Systemaufforderung folgt, ohne den Charakter zu brechen und abzulehnen.

Kann ich die Linie Dolphin/Venice kostenlos online testen?

Ja – das kostenlose Kontingent von Pinkerton AI beinhaltet Credits und erfordert kein Konto; Venice Uncensored 1.2 kostet 3 Credits pro Nachricht.

Related answers

Pinkerton AI · Blog