共计 1099 个字符,预计需要花费 3 分钟才能阅读完成。
最近, 一个名为“同事.Skill”的 GitHub 项目突然火出圈,随之衍生出“老板.Skill”“前任.Skill”等版本。社交媒体上充斥着“数字永生”“完美复刻同事”等夸张描述, 仿佛 AI 已经能轻易将一个人“炼化”成随时陪伴的数字分身。但真相究竟如何? 这背后又隐藏着哪些被忽略的风险?
📌 一、技术本质: 爬虫 + 提示词, 远非“赛博永生”
“同事.Skill”项目的核心其实非常简单。它并非通过训练 AI 模型来复制一个人的思维 , 而是利用爬虫脚本(如抓取飞书、钉钉、微信聊天记录的工具) 收集文本数据, 然后整理成几个静态的 Markdown 文件, 再交给 Claude 等大语言模型读取并扮演相应角色。
具体来说, 每个“数字同事”目录下通常包含:
- Skill.md: 主入口文件
- work.md: 描述工作内容
- persona.md: 描述性格特征, 采用“五层人格结构”组织
- meta.json: 存放元数据
这本质上是一个遵循 AgentSkills 标准的提示词工程,更像给 AI 演员写一份详细的“角色剧本”。运行过程中,AI 会根据预设的文本模仿语气、习惯, 但存在明显局限:
- 没有持久记忆: 每次对话都是重新读取文件, 不会学习更新。
- 依赖数据质量: 如果原始聊天记录多是“收到”“好的”等简单回复, 生成的 Skill 就近乎复读机。
- 容易出现人格漂移: 随着对话轮次增加,AI 可能逐渐偏离预设人格。
- 无法提取深层能力: 如复杂决策、创新解决、经验直觉等。
“原材料质量决定 Skill 质量”——项目 README 中的这句话, 恰好点出了其局限性: 垃圾进, 垃圾出。
因此, 它最多算一个带人设的聊天机器人或智能化工作日志,作为知识传承的辅助工具或许可行, 但若以为能替代真人, 就过于天真了。
🔍 二、法律风险: 数据使用可能已踩红线
尽管项目以“玩梗”形式出现,但其要求用户爬取同事的飞书、钉钉、邮件等数据的行为, 潜藏着不小的法律风险。
根据《个人信息保护法》,处理个人信息需满足特定条件, 如取得个人同意、为履行合同所必需等。然而:
- 离职后数据使用缺乏依据: 员工离职后, 劳动合同解除, 继续使用其工作数据“炼化”数字人格, 既未取得新授权, 也不属于“履行合同所必需”。
- 敏感信息处理违规: 聊天记录中可能包含健康状况、家庭情况、财务信息等敏感个人信息, 依法需取得“单独同意”, 但项目流程中完全缺失这一环节。
- 平台协议违规: 例如, 爬取微信聊天记录可能违反《腾讯微信软件许可及服务协议》。
一旦有公司当真尝试用这种方式“留住”离职员工,可能面临责令改正、高额罚款, 甚至刑事责任(如数据泄露构成犯罪)。离职员工也可投诉要求删除数据并索赔, 企业还可能引发集体诉讼。