Dolphin Mistral 24B Venice Edition: 仕様、ストーリー、今すぐ使用できる場所

Hugging Face または Reddit で dolphin-mistral-24b-venice-edition を見たことがあり、実際に話してみたい場合は、2026 年には 2 つの選択肢があります。量子化されたコピーを自分のハードウェアで実行するか、ホストされている後継のオンラインを使用するかです。ここでは、モデル、そのストーリー、および両方のパスを示します。

Dolphin Mistral 24B Venice Edition は、Venice AI の Dolphin チーム (認知計算) によって構築された、Mistral の 24B モデルの無修正の微調整です。元の API スラッグは廃止されました。その直接の後継である Venice Uncensored 1.2 は、Venice が現在提供しているものであり、アカウントを作成せずに Pinkerton AI でチャットできます。ローカルで使用する場合、オリジナルの GGUF 量子化は Hugging Face で利用可能であり、Ollama で実行されます。

Last updated

Dolphin Mistral 24B Venice Editionとは何ですか?

Cognitive Computations (無修正微調整シリーズ Dolphin の背後にあるチーム) と Venice AI とのコラボレーション。Mistral の 24B ベースに適用されます。 Dolphin モデルは、システム プロンプトに絶対に従い、定型文を拒否せずに答えるようにトレーニングされています。そのため、Venice エディションは、同世代で最も使用されている無修正モデルの 1 つになりました。クリエイティブなライティング、ロールプレイ、率直な技術的回答に強く、自己ホストできるほど小規模で、寛容にライセンスされています。

Venice API でもう見つからないのはなぜですか?

Venice は、新しいバージョンの出荷に伴いモデル スラグを廃止し、dolphin-mistral-24b-venice-edition スラグは api.venice.ai のモデル リストから削除されました。その系譜は Venice Uncensored (現在バージョン 1.2) として引き継がれており、プラットフォームの主力の無修正微調整と同じ役割を果たします (fp16、128K コンテキスト ウィンドウ)。チュートリアルや Reddit のスレッドで古いスラッグが示されている場合、実際には Venice Uncensored 1.2 が解決されます。

アカウントなしでオンラインで使用する方法

Pinkerton AI はモデル ピッカーで Venice Uncensored 1.2 をホストします。チャットを開いて選択し、会話します。電子メール、サインアップ、サーバー側の会話ログは必要ありません。無料セッションには、適切に評価するのに十分なクレジットが含まれています。これは、「Hugging Face でモデルを見た」から実際に使用するまでの最速のパスであり、プライバシーに関する姿勢 (匿名セッション、アップグレードした場合の暗号通貨支払い) は、そもそも人々を Dolphin モデルに引き寄せるものと一致します。

オリジナルをローカルで実行する方法

dolphin-mistral-24b-venice-edition の GGUF 量子化は Hugging Face で公開され、Ollama、LM Studio、または llama.cpp にロードされます。第 4 四半期の量子化には約 14 GB の予算を立て、第 8 四半期にはそれ以上の予算を立てます。 24 GB GPU は快適な速度を提供し、CPU のみの推論は機能しますが、速度が遅くなります。ローカルは、量子化品質の損失とハードウェアを犠牲にして、絶対的なプライバシーを勝ち取ります。つまり、プロンプトがマシンから離れることはありません。脅威モデルが要求する場合、これは正しい判断です。

本当に無修正なのでしょうか?

はい、Dolphin という特定の意味で: 微調整により拒否動作が削除され、システムのプロンプトに従うため、ダークフィクション、大人同士の露骨なロールプレイ、率直なセキュリティの詳細、ヘッジされていない意見など、合法ではあるが機密性の高いリクエストに対して直接回答が得られます。違法なコンテンツを利用可能にすることはなく、Pinkerton AI でのホスト型アクセスには、モデルに関係なく同じ法的境界線が適用されます。

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
モデルバージョンVenice Uncensored 1.2 (後継)元の 24B GGUF (Hugging Face から)
設定なし — 選択してチャットしますOllama / llama.cpp + ~14 ~ 50 GB のダウンロード
精度fp16、128K コンテキスト量子化された (Q4 ~ Q8)、より短い実践的なコンテキスト
必要なハードウェアなし24 GB+ VRAM による快適な速度
アカウントなし - 匿名セッションなし
プライバシーサーバー側のログはゼロ完全にローカル — 可能な限り最強

Dolphin Mistral 24B Venice Edition を置き換えるものは何ですか?

Venice Uncensored 1.2 — Venice のインフラストラクチャ上の同じ無修正主力ラインの継続。 Pinkerton AI ではアカウントなしで選択できます。

まだ Dolphin Mistral 24B Venice Edition をダウンロードできますか?

はい — GGUF 量子化は Hugging Face (dphn/dolphin-mistral-24b-venice-edition およびコミュニティ GGUF リポジトリ) に残り、Ollama、LM Studio、または llama.cpp で実行されます。

Dolphin Mistral 24B がローカルで必要とするハードウェアは何ですか?

第 4 四半期 GGUF のメモリは約 14 GB、より高い量子化の場合はさらに多くなります。 24 GB VRAM GPU により快適に動作します。ホスト型アクセスには何も必要ありません。

Dolphin Mistral はロールプレイに適していますか?

これはその参照モデルの 1 つです。Dolphin トレーニングにより、拒否する性格を損なうことなく、システム プロンプトからのペルソナとシナリオの指示に従うことができます。

Dolphin/Venice リネージュをオンラインで無料で試すことはできますか?

はい — Pinkerton AI の無料利用枠にはクレジットが含まれており、アカウントは必要ありません。 Venice Uncensored 1.2 では、メッセージごとに 3 クレジットがかかります。

Related answers

Pinkerton AI · Blog