Gemma 无审查版 — Google 的 Gemma 4,不再拒绝回答

Gemma 是 Google 的开放权重家族——能力强、效率高,并且以高度一致而闻名:股票指令模型拒绝广泛的法律提示。未经审查的社区构建解决了这个问题。本页介绍了您现在可以使用的托管 Gemma 4 未经审查的版本,以及它与库存模型的比较。

您可以在 Pinkerton AI 在线与 Google Gemma 4 的未经审查版本聊天:一个 26B 专家混合模型(总共 25.2B,3.8B 活动参数),删除了拒绝行为,通过硬件证明在可信执行环境中进行端到端加密。无需帐户,不保留服务器端日志,每条消息需要 3 个积分,免费套餐。

Last updated

什么是 Gemma 未经审查?

Google Gemma 4 的社区修改版本,其中训练有素的拒绝行为已被删除,而模型的知识和写作质量保持不变。 Stock Gemma 是最保守的开放模式之一——它拒绝或说教黑暗小说、直率的观点、安全细节和最成熟的主题。未经审查的构建在法律范围内直接回答这些问题。这里托管的变体是 26B 专家混合 Gemma 4:25.2B 总参数,每个代币 3.8B 活跃,因此它的质量等级运行速度很快。

是什么让这个托管不寻常:E2EE 变成了 TEE

Gemma 未经审查的端点在可信执行环境内运行 - 一个加密的硬件飞地,其完整性可以通过证明进行验证。您的消息在飞地中被端到端加密,这意味着即使服务器操作员也无法读取传输中或内存中的交换。结合 Pinkerton AI 的无帐户、无日志设计,这与托管推理一样私密:服务器端没有任何可读内容,没有存储任何内容,没有人可以将其附加到。

与库存 Gemma 4 相比如何?

相同的基础能力——相同的架构、相同的知识。区别在于行为:stock Gemma 插入拒绝、安全免责声明和法律提示音调监管,而未经审查的版本只是简单地回答。如果您在本地使用过 Gemma 并且喜欢它的速度和书写,但遇到了拒绝墙,那么这与移除墙的模型相同。非法内容仍被拒绝;未经审查消除的是编辑判断,而不是法律。

Gemma 未经审查的在线 vs 自己运行

未经审查的 Gemma 构建在 Hugging Face 上循环并在本地运行良好 — MoE 设计对于第四季度的中档 GPU 来说足够高效。本地赢得绝对隐私;托管在设置(无)、速度(数据中心硬件)方面获胜,这里特别是在 E2EE/TEE 保证上,大多数自托管设置不会复制远程访问。如果您只想在接下来的三十秒内与 Gemma 交谈而不拒绝,那么托管是实用的答案。

入门

打开聊天,从模型选择器中选择“Gemma 4 26B A4B Uncensored”,然后开始 - 没有帐户,没有电子邮件。每条消息花费 3 个积分;免费会话包括根据默认GLM Heretic 和Venice Uncensored 1.2 进行测试的积分。如果 64K E2EE 上下文限制了您的使用案例,则此处的其他未经审查的模型在没有 enclave 的情况下提供高达 200K 的分辨率。

Pinkerton AI vs Stock Gemma 4: how do they compare?

FeaturePinkerton AIStock Gemma 4
拒绝行为已删除 — 直接回答法律提示频繁拒绝和对冲
建筑学Gemma 4 MoE,总计 25.2B / 3.8B 活跃相同的基础架构
托管E2EE 变为 TEE,硬件认证无论您将其部署在何处
设置无 — 选择并聊天,无需帐户自托管或云部署
上下文窗口E2EE 端点上的 64K高达 256K 自托管
成本3 个积分/消息,免费套餐自由重量 + 你的硬件

Google Gemma 有未经审查的版本吗?

是的 — Gemma 4 的社区构建已删除拒绝行为。 Pinkerton AI 托管 26B MoE 未经审查的版本,无需帐户即可在线聊天。

Gemma未经审查可以免费使用吗?

有积分且无需注册的免费会话可让您进行测试;此后每条消息需要 3 个积分,计划价格为每月 17.99 欧元。

E2EE/TEE 托管实际上能保证什么?

消息被端到端加密到具有硬件证明的可信执行环境中——交换在服务器端是不可读的,即使是操作员也是如此,并且不保留任何对话日志。

未经审查的 Gemma 和股票 Gemma 一样聪明吗?

是的——修改消除了拒绝行为,而不是能力。知识和写作质量是Gemma 4 26B MoE 的。

我可以在本地运行未经审查的 Gemma 吗?

是的 - 未经审查的 Gemma 构建位于 Hugging Face 上,并在中档 GPU 上运行于 Ollama 或 llama.cpp 下。此处的托管访问适用于您立即需要的情况,速度为 E2EE,并且以全服务速度进行。

Related answers

Pinkerton AI · Blog