Dolphin Mistral 24B Venice Edition: Thông số kỹ thuật, câu chuyện và nơi sử dụng nó ngay bây giờ

Nếu bạn đã xem dolphin-mistral-24b-venice-edition trên Hugging Face hoặc Reddit và thực sự muốn nói chuyện với nó, thì bạn có hai tùy chọn làm việc vào năm 2026: chạy bản sao lượng tử hóa trên phần cứng của riêng bạn hoặc sử dụng phiên bản kế nhiệm được lưu trữ trực tuyến. Đây là mô hình, câu chuyện của nó và cả hai con đường.

Dolphin Mistral 24B Venice Edition là bản tinh chỉnh không bị kiểm duyệt của mô hình 24B của Mistral, được xây dựng bởi nhóm Dolphin (Tính toán nhận thức) cho Venice AI. Sên API ban đầu đã bị loại bỏ; người kế nhiệm trực tiếp của nó, Venice Uncensored 1.2, là những gì Venice phục vụ ngày hôm nay — và bạn có thể trò chuyện với nó tại Pinkerton AI mà không cần tạo tài khoản. Để sử dụng cục bộ, số lượng hóa GGUF của bản gốc vẫn có sẵn trên Hugging Face và chạy dưới Ollama.

Last updated

Dolphin Mistral 24B Venice Edition là gì?

Sự hợp tác giữa Tính toán nhận thức — nhóm đằng sau loạt tinh chỉnh không bị kiểm duyệt Dolphin — và Venice AI, áp dụng cho cơ sở 24B của Mistral. Các mô hình Dolphin được đào tạo để tuân theo lời nhắc của hệ thống một cách tuyệt đối và trả lời mà không từ chối bản mẫu soạn sẵn, điều này khiến Phiên bản Venice trở thành một trong những mô hình không bị kiểm duyệt được sử dụng nhiều nhất trong thế hệ của nó: mạnh về khả năng viết sáng tạo, nhập vai và trả lời kỹ thuật thẳng thừng, đủ nhỏ để tự lưu trữ, được cấp phép cho phép.

Tại sao bạn không thể tìm thấy nó trên Venice API nữa?

Venice ngừng sử dụng sên mô hình khi có phiên bản mới hơn và sên dolphin-mistral-24b-venice-edition đã bị xóa khỏi danh sách mô hình của api.venice.ai. Dòng dõi của nó tiếp tục là Venice Uncensored — phiên bản hiện tại là 1.2 — đóng vai trò tương tự như tính năng tinh chỉnh không kiểm duyệt hàng đầu của nền tảng, ở fp16 với cửa sổ ngữ cảnh 128K. Nếu một hướng dẫn hoặc chủ đề Reddit chỉ cho bạn về lỗi cũ, thì Venice Uncensored 1.2 là những gì nó giải quyết trong thực tế.

Cách sử dụng trực tuyến mà không cần tài khoản

Pinkerton AI lưu trữ Venice Uncensored 1.2 trong bộ chọn mô hình của nó — mở cuộc trò chuyện, chọn cuộc trò chuyện và nói chuyện. Không có email, không đăng ký và không có nhật ký hội thoại phía máy chủ; một phiên miễn phí bao gồm đủ tín chỉ để đánh giá nó một cách chính xác. Đây là con đường nhanh nhất từ ​​'thấy mô hình trên Hugging Face' đến thực sự sử dụng nó và tư thế bảo mật — phiên ẩn danh, thanh toán bằng tiền điện tử nếu bạn nâng cấp — phù hợp với những gì thu hút mọi người đến với mô hình Dolphin ngay từ đầu.

Cách chạy bản gốc cục bộ

Định lượng GGUF của dolphin-mistral-24b-venice-edition được xuất bản trên Hugging Face và tải trong Ollama, LM Studio hoặc llama.cpp. Ngân sách khoảng 14 GB cho lượng tử hóa Q4 và nhiều hơn về mặt vật chất cho Q8; GPU 24 GB cho tốc độ thoải mái và khả năng suy luận chỉ của CPU hoạt động nhưng chậm. Lợi ích cục bộ về quyền riêng tư tuyệt đối — lời nhắc không bao giờ rời khỏi máy của bạn — phải trả giá bằng việc giảm chất lượng lượng tử hóa và phần cứng. Đó là quyết định đúng đắn khi mô hình mối đe dọa của bạn yêu cầu điều đó.

Nó thực sự không được kiểm duyệt?

Có, theo nghĩa Dolphin cụ thể: tính năng tinh chỉnh sẽ loại bỏ hành vi từ chối và tuân theo lời nhắc hệ thống của bạn, do đó, các yêu cầu hợp pháp nhưng nhạy cảm — hư cấu đen tối, nhập vai rõ ràng giữa những người lớn, chi tiết bảo mật thẳng thắn, ý kiến ​​không được bảo vệ — sẽ nhận được câu trả lời trực tiếp. Nó không cung cấp nội dung bất hợp pháp và quyền truy cập được lưu trữ trên Pinkerton AI thực thi cùng một dòng pháp lý bất kể mô hình.

Pinkerton AI vs Running it locally: how do they compare?

FeaturePinkerton AIRunning it locally
Phiên bản mẫuVenice Uncensored 1.2 (người kế nhiệm)24B gốc GGUF từ Hugging Face
Cài đặtKhông có - chọn nó và trò chuyệnOllama / llama.cpp + ~14-50 GB tải xuống
Độ chính xácbối cảnh fp16, 128KLượng tử hóa (Q4-Q8), bối cảnh thực tế ngắn hơn
Phần cứng cần thiếtKhông có24 GB+ VRAM cho tốc độ thoải mái
Tài khoảnKhông có - phiên ẩn danhKhông có
Sự riêng tưKhông có nhật ký phía máy chủHoàn toàn cục bộ - mạnh nhất có thể

Điều gì đã thay thế Dolphin Mistral 24B Venice Edition?

Venice Uncensored 1.2 — sự tiếp nối của dòng hàng đầu không bị kiểm duyệt tương tự trên cơ sở hạ tầng của Venice. Có thể chọn ở mức Pinkerton AI mà không cần tài khoản.

Tôi vẫn có thể tải xuống Dolphin Mistral 24B Venice Edition chứ?

Có — Số lượng hóa GGUF vẫn còn trên Hugging Face (dphn/dolphin-mistral-24b-venice-edition và kho lưu trữ GGUF cộng đồng) và chạy trong Ollama, LM Studio hoặc llama.cpp.

Dolphin Mistral 24B cần phần cứng nào cục bộ?

Khoảng 14 GB bộ nhớ cho Q4 GGUF, nhiều hơn cho lượng tử hóa cao hơn; GPU VRAM 24 GB chạy thoải mái. Truy cập được lưu trữ không cần gì cả.

Dolphin Mistral có phù hợp để nhập vai không?

Đây là một trong những mô hình tham khảo cho nó — quá trình đào tạo Dolphin làm cho nó tuân theo các hướng dẫn về tính cách và kịch bản từ lời nhắc của hệ thống mà không phá vỡ ký tự để từ chối.

Tôi có thể dùng thử dòng Dolphin/Venice trực tuyến miễn phí không?

Có - Cấp miễn phí của Pinkerton AI bao gồm các khoản tín dụng và không yêu cầu tài khoản; Venice Uncensored 1,2 tốn 3 tín dụng cho mỗi tin nhắn.

Related answers

Pinkerton AI · Blog