Dolphin Mistral 24B Venice Edition : spécifications, histoire et où l'utiliser maintenant

Si vous avez vu dolphin-mistral-24b-venice-edition sur Hugging Face ou Reddit et que vous souhaitez réellement lui parler, vous avez deux options de travail en 2026 : exécuter une copie quantifiée sur votre propre matériel ou utiliser son successeur hébergé en ligne. Voici le modèle, son histoire et les deux chemins.

Dolphin Mistral 24B Venice Edition est une mise au point non censurée du modèle 24B de Mistral, construit par l'équipe Dolphin (Cognitive Computations) pour Venice AI. Le slug API d'origine a été retiré ; son successeur direct, Venice Uncensored 1.2, est ce que Venice sert aujourd'hui – et vous pouvez discuter avec lui à Pinkerton AI sans créer de compte. Pour une utilisation locale, les quantifications GGUF de l'original restent disponibles sur Hugging Face et s'exécutent sous Ollama.

Last updated

Qu'est-ce que Dolphin Mistral 24B Venice Edition ?

Une collaboration entre Cognitive Computations — l'équipe derrière la série Dolphin de réglages fins non censurés — et Venice AI, appliquée à la base 24B de Mistral. Les modèles Dolphin sont formés pour suivre absolument l'invite du système et pour répondre sans refus, ce qui a fait de l'édition Venice l'un des modèles non censurés les plus utilisés de sa génération : fort en écriture créative, en jeu de rôle et en réponses techniques brutales, suffisamment petit pour s'auto-héberger, avec une licence permissive.

Pourquoi ne le trouvez-vous plus sur le Venice API ?

Venice retire les slugs de modèle à mesure que les versions plus récentes sont livrées, et le slug dolphin-mistral-24b-venice-edition a été supprimé de la liste des modèles d'api.venice.ai. Sa lignée se poursuit sous le nom de Venice Uncensored – actuellement version 1.2 – qui joue le même rôle que le réglage fin non censuré phare de la plate-forme, à fp16 avec une fenêtre contextuelle de 128 Ko. Si un didacticiel ou un fil de discussion Reddit vous pointe vers l'ancien slug, Venice Uncensored 1.2 est ce à quoi il résout dans la pratique.

Comment l'utiliser en ligne sans compte

Pinkerton AI héberge Venice Uncensored 1.2 dans son sélecteur de modèle : ouvrez le chat, sélectionnez-le et parlez. Pas d'e-mail, pas d'inscription et pas de journaux de conversations côté serveur ; une session gratuite comprend suffisamment de crédits pour l'évaluer correctement. Il s'agit du chemin le plus rapide entre « avoir vu le modèle sur Hugging Face » et son utilisation réelle, et la politique de confidentialité (sessions anonymes, paiement crypté si vous effectuez une mise à niveau) correspond à ce qui attire les gens vers les modèles Dolphin en premier lieu.

Comment exécuter l'original localement

GGUF quantifications de dolphin-mistral-24b-venice-edition sont publiées sur Hugging Face et chargées en Ollama, LM Studio ou llama.cpp. Prévoyez environ 14 Go pour une quantification au quatrième trimestre et sensiblement plus pour le huitième ; un GPU de 24 Go offre une vitesse confortable et l'inférence uniquement sur le processeur fonctionne mais est lente. Le local gagne en confidentialité absolue - l'invite ne quitte jamais votre machine - au prix d'une perte de qualité de quantification et de matériel. C'est la bonne décision lorsque votre modèle de menace l'exige.

Est-ce vraiment non censuré ?

Oui, dans le sens spécifique Dolphin : le réglage fin supprime les comportements de refus et s'en remet à l'invite de votre système, de sorte que les demandes légales mais sensibles (fiction sombre, jeu de rôle explicite entre adultes, détails de sécurité francs, opinions non couvertes) obtiennent des réponses directes. Il ne rend pas disponible le contenu illégal et l'accès hébergé sur Pinkerton AI applique la même ligne juridique quel que soit le modèle.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Version du modèleVenice Uncensored 1.2 (successeur)Original 24B GGUF de Hugging Face
InstallationAucun – sélectionnez-le et discutezOllama / llama.cpp + ~14-50 Go de téléchargement
Précisionfp16, contexte 128KQuantisé (Q4-Q8), contexte pratique plus court
Matériel nécessaireAucun24 Go+ VRAM pour une vitesse confortable
CompteAucun — session anonymeAucun
ConfidentialitéZéro journal côté serveurEntièrement local – le plus fort possible

Qu'est-ce qui a remplacé Dolphin Mistral 24B Venice Edition ?

Venice Uncensored 1.2 — la continuation de la même ligne phare non censurée sur l'infrastructure de Venice. Il est sélectionnable à Pinkerton AI sans compte.

Puis-je quand même télécharger Dolphin Mistral 24B Venice Edition ?

Oui — GGUF les quantifications restent sur Hugging Face (dphn/dolphin-mistral-24b-venice-edition et communauté GGUF repos) et s'exécutent sous Ollama, LM Studio ou llama.cpp.

De quel matériel Dolphin Mistral 24B a-t-il besoin localement ?

Environ 14 Go de mémoire pour un Q4 GGUF, plus pour des quantifications plus élevées ; un GPU VRAM de 24 Go l’exécute confortablement. L'accès hébergé n'a besoin de rien.

Est-ce que Dolphin Mistral est bon pour le jeu de rôle ?

C'est l'un des modèles de référence pour cela - la formation Dolphin lui fait suivre les instructions du personnage et du scénario à partir de l'invite du système sans interrompre le caractère pour refuser.

Puis-je essayer la lignée Dolphin/Venice gratuitement en ligne ?

Oui : l'offre gratuite de Pinkerton AI inclut des crédits et ne nécessite aucun compte ; Venice Uncensored 1.2 coûte 3 crédits par message.

Related answers

Pinkerton AI · Blog