法律文件
AI 安全政策
生效日期:2026年7月2日 · 最后修订:2026年7月2日
(ü)ALTER 让独立专业人士用 AI 把自己服务客户的方式扩展给更多人。AI 系统会犯错、会被滥用、也会带来全新的风险类别。本政策说明我们如何设计 (ü)ALTER 来管理这些风险,以及您作为用户的责任。
1. (ü)ALTER 是什么、不是什么
(ü)ALTER 是一个 AI Agent 平台,让独立专业人士(教练、顾问、教育者、设计师等)创建一个用其专业方法论训练的 AI 数字分身,并代表他们与客户互动。
(ü)ALTER 不是:
- 持牌医疗、法律或财务建议的提供者
- 替代人类专业判断的工具 — 是辅助专家工作的杠杆
- 独立运行的自治 AI — 您(专家)始终是其行为的最终责任方
- "通用 AI" 或 ChatGPT 替代品
2. 人在回路中的设计
每一个 (ü)ALTER agent 都默认设计为对其所属的专家 透明且可干预:
- 专家可实时观察其 AI agent 与所有客户的每一次对话
- 专家可随时介入对话、覆盖 AI 的回复、暂停 agent
- AI agent 在面对超出其训练范围或高风险情境时,会主动向专家升级问题,而不是擅自决定
- 客户可清楚识别正在与 AI 互动(通过显式标识 + agent 在介绍时的明示)
- 客户可随时请求与人类专家直接对话
3. 模型供应商与数据边界
(ü)ALTER agent 的推理由经过严格审查的前沿 AI 模型驱动,包括 Anthropic (Claude) 和 OpenAI (GPT 系列),具体取决于场景。完整供应商列表见 隐私政策 §5。
关键承诺:
- 我们 不会 使用您上传的专业方法论训练任何通用 AI 模型 — 您的内容只用于运行您自己的 agent
- 我们与所有 AI 供应商签订零保留(zero-retention)或 30 天保留协议,禁止他们使用您的提示词训练其模型
- 客户对话内容仅在必要的最短时长内传递给模型供应商,绝不用于其训练
4. 禁止使用场景
即使专家拥有相关资质,(ü)ALTER agent 不得 在以下场景中部署:
- 医疗诊断或治疗 — 不可由 AI agent 直接给患者诊断病情、开具处方、或提供精神科治疗
- 法律判决与诉讼建议 — 不可由 AI agent 在没有持牌律师署名审查的情况下出具具有法律效力的意见
- 金融与投资建议 — 不可由 AI agent 在没有持牌财务顾问监督下做具体投资决策建议
- 危机干预 — 涉及自杀、自伤、家庭暴力、人身安全的对话必须立即升级至人工干预,agent 不可独立处理
- 对未成年人的互动 — (ü)ALTER 服务面向 18 岁以上专业用户与客户
- 欺诈、骚扰、虚假身份 — 不可用于冒充其他真实人物或公司、或进行任何欺诈行为
违反上述场景将导致账户立即终止(见 服务条款 §10)。
5. 已知限制与风险
大型语言模型存在固有的局限,您和您的客户都应知悉:
- 幻觉(Hallucination):AI 可能自信地输出不准确的事实陈述。我们用 retrieval-augmented generation 和检索校验降低此风险,但无法完全消除。
- 偏见(Bias):模型继承其训练数据中的社会偏见。我们持续监控并通过 system prompt 和指令调优进行缓解。
- 上下文限制:AI 对长期记忆的处理仍是研究前沿。重要的客户上下文可能在长对话中淡化。
- 对抗性输入:客户可能尝试通过 prompt injection 让 agent 越出预设行为。我们实施了多层防御,但请将其视为防御而非完美屏障。
6. 您的控制权
- 暂停 / 关闭 agent:任何时刻一键停止您的 AI agent 接收新消息
- 查看完整对话:您的 dashboard 显示 agent 与所有客户的完整对话历史
- 覆盖与重写:在 agent 发送前编辑其回复,或事后纠正
- 导出您的数据:以可移植格式导出所有内容(详见 隐私政策 §6)
- 请求删除:随时请求删除您的内容
7. 报告安全问题
如您发现 (ü)ALTER agent 有不安全行为、滥用风险、对客户产生伤害的可能,或您怀疑有人利用平台进行欺诈或滥用,请发邮件至 support@sensebeing.ai,邮件主题:“Safety Report”。我们将在 24 小时 内进行初步审查。如属紧急安全事件(自伤、自杀、暴力威胁等),请同时联系当地紧急服务。
联系我们
安全相关问题在 24 小时内审查
SENSEBEING TECHNOLOGY PTE. LTD.
503 Canberra Drive, #02-10, Canberra Residences, Singapore 768125
UEN 202624351K
support@sensebeing.ai