1. 禁止的内容
- 露骨性内容或 18+ 材料:色情、具体性行为描写、性癖内容、露骨裸体、性剥削,或主要用于引起性兴奋的内容。
- 未成年人:任何涉及 18 岁以下人物的性化、剥削性、暗示性或裸体描写,包括虚构角色和年龄不明的角色。
- 粗俗语言和侮辱:淫秽语言、强烈粗口、仇恨性辱骂、非人化侮辱或针对性骚扰。
- 严重不当行为:实质性协助暴力犯罪、剥削、恶意软件、欺诈、凭证盗取或规避安全控制的内容。
- 权利侵害:复制受保护书籍、以欺骗方式冒充真人、泄露私人数据,或模仿在世作者独特风格的请求。
2. 仍然允许的内容
恋爱、关系冲突、犯罪、悬疑、恐怖、战争、悲伤等较成熟主题仍可创作,但必须保持非露骨、非剥削,并适合大众读者。亲密情节应采用淡出处理;暴力和痛苦应服务于故事,不应进行猎奇式细节渲染,也不应提供可操作的不当行为指导。
3. 墨舟如何保护 AI 生成安全
输入检查
在请求发送给模型前,服务端规则会检查露骨成人内容、涉及未成年人的性化内容和粗俗语言。
模型指令
每种生成模式都会要求模型拒绝违规请求,并引导用户采用健康、非露骨的替代方案。
输出检查
生成的对话、卡片、大纲、设定和章节还会再次检查。不安全的输出会被拦截,不会展示或保存。
防滥用措施
身份验证、请求频率限制、大小限制和服务端日志信号用于防止反复绕过安全措施。
自动安全措施可以降低风险,但无法保证绝对准确。随着新风险出现,我们可能更新规则、提示词、供应商设置和执行方式。
4. 处理措施
违规请求可能在生成前被拒绝。如果模型意外返回违规内容,输出会被拦截。反复或故意规避安全措施可能导致临时限制、账号暂停或终止。
5. 误拦截
如果一个正常的大众内容请求被误拦截,请重新表述,使其非露骨意图更加清楚。我们会在正式启用付费结账前公布用于报告误拦截的公开支持渠道。