数字分身
数字分身
数字分身是用个人文本、行为记录、价值判断、表达习惯和社交策略训练或配置出的 AI 身份实例。它不只是“记住用户偏好”,而是试图让系统在语气、判断和社会互动中持续扮演某个具体的人。
观察
- 肖仰华 的公开自述把数字分身压缩成少量结构化文本文件,包含说话方式、价值观、思考模式、社交风格和自我校正规则。这说明人格复刻正在从大规模模型训练转向“个人状态文件 + 通用模型”的轻量路径。
- 数字分身把 AI 记忆系统 的问题从检索扩展为身份外化:需要管理的不只是事实记忆,还包括人格边界、风格指纹、关系策略、沉默规则和错误校准。
- 一旦分身能在本人不在线时互动,AI Agent 安全 的边界就会从工具权限扩展到身份权限:谁能调用这个分身、能不能代表本人承诺、如何标注代理身份、如何撤销或冻结。
- 数字分身的难点不只是像不像本人。更关键的是责任和人格连续性:分身的输出算谁的判断,过期人格是否仍可代表本人,亲友或学生能否区分本体和实例。
- Pika AI Selves 把数字分身推到多模态产品层:外貌、声音、视频表达、个性、持续记忆和跨平台互动被组织成一个可“养育”的身份代理。
- 社交代理 把数字分身从身份呈现推进到低层社交行动代理:分身不只要像本人,还要决定何时替本人点赞、评论、破冰、筛选关系,以及何时交还给人类。
- 在中国现行规范下,数字分身不是只有“像不像”的产品问题。《民法典》禁止利用信息技术伪造等方式侵害肖像权,并让自然人声音参照肖像权保护;《个人信息保护法》把生物识别列为敏感个人信息,要求特定目的、充分必要、严格保护和单独同意。
- 网络服务中的人脸、人声编辑还受深度合成规则约束:应提示使用者告知被编辑者并取得单独同意,对可能造成混淆的文本、语音、人物图像/视频和拟真场景显著标识,并保存必要日志。2025 年生效的标识办法进一步要求下载、复制和导出的生成合成内容保留规定标识。
截至 2026-08-10 的答案与最低上线门槛
- 可行性答案:“熟悉的人分辨不出真假”目前只是作者自述,不能推广为数字分身的通用可行性。最低评测应做盲测并报告误认率、跨场景稳定性、过期人格、错误承诺、越权发言和撤销后的残留行为,而不是只展示相似度样例。
- 数据授权:训练或配置前逐类列出聊天记录、公开文章、采访、语音、图像和关系数据的来源、用途、保存期限与接收方;公开可见不等于可以无限制塑造身份代理。涉及生物识别时取得单独同意,处理目的、方式或数据种类改变时重新同意。
- 撤回与删除:提供随时冻结、撤回同意和删除入口;删除应覆盖在线画像、检索索引、派生 embedding/adapter、缓存与可控备份。若依法或技术上暂不能删除,至少停止除存储和必要保护之外的处理,并记录到期清除责任。
- 身份与内容标识:每次对外互动都显示这是 AI 代理;文本、音频、图片、视频和虚拟场景按适用规则保留显式/隐式标识,下载和跨平台导出不能自动去标。第三方若无法看到代理标识,就不应默认开启主动互动。
- 权限上限:默认禁止代表本人承诺、签约、支付、披露敏感信息、建立亲密关系或处理高风险冲突。允许的渠道、受众、动作和有效期采用白名单;草稿可自动生成,对外发布和权限提升必须由本人逐次确认。
- 人格版本:保存人格版本、生成来源、授权依据、调用者、时间、目标平台和人类确认记录;新版本不能静默覆盖旧授权,离线或死后运行也不能从历史同意自动推出。
- 适用边界:上述是中国网络服务、人格权和个人信息处理的公开基线,不替代具体产品、平台条款和司法辖区下的法律审查。
相关页面
- AI 记忆系统
- AI Agent 安全
- 自进化智能体
- 肖仰华
- Pika AI Selves
- 社交代理
- 原始资料快照(本地归档)
- 中华人民共和国民法典
- 中华人民共和国个人信息保护法
- 互联网信息服务深度合成管理规定
- 人工智能生成合成内容标识办法
证据
- 原始资料快照(本地归档)
- Pika AI Selves
- 原始资料快照(本地归档)
- 社交代理