)
AI还原度高的关键在这里自己.skill的5类数据源完整清单微信/QQ/日记/照片【免费下载链接】yourself-skill与其蒸馏别人不如蒸馏自己。欢迎加入数字永生Inspired by colleague-skill同事skill。项目地址: https://gitcode.com/gh_mirrors/yo/yourself-skill想让 AI 说出你的语气而不是AI 味关键就在喂给它的原材料。开源项目自己.skill的理念是与其蒸馏别人不如蒸馏自己——你把聊天记录、日记、照片交出去它就蒸馏出一个能像你一样思考和回复的 AI 数字分身。本文带你完整过一遍它的5 类数据源并给出新手最实用的选择清单。先搞懂为什么数据源决定还原度自己.skill 把你拆成两个可运行的模块模块内容通俗理解Part A — Self Memory自我记忆经历、价值观、习惯、重要记忆你的人生硬盘Part B — Persona人格模型说话风格、情感模式、人际行为你的说话方式运行逻辑是收到消息 → Persona 判断你会怎么回应 → Self Memory 补充背景 → 用你的方式输出。也就是说原材料质量直接决定还原度。官方原话是聊天记录 日记/笔记 仅口述。下面按优先级从高到低讲 5 类数据源。5 类数据源总览完整清单一次看全#数据源支持格式主要提取内容优先级1微信聊天记录WeChatMsg / 留痕 / PyWxDump 导出你的原话、口头禅、决策模式⭐⭐⭐2QQ 聊天记录txt / mht 导出年轻时的表达方式⭐⭐⭐3社交媒体 / 日记 / 笔记截图 / Markdown / TXT价值观、深度思考、公开人设⭐⭐⭐4照片JPEG / PNG含 EXIF时间线、常去地点、生活轨迹⭐⭐5口述 / 粘贴纯文本你对自己的主观认知⭐这 5 类全部可跳过——纯口述也能生成只是还原度上限会低不少。数据源一微信聊天记录还原度第一功臣聊天记录是最高优先级的数据源因为它记录的是你不加修饰的原话。自己.skill 适配了主流导出工具的格式WeChatMsg导出 txt / html / csv留痕macOS导出 jsonPyWxDump解密导出数据库解析由 tools/wechat_parser.py 完成它会重点分析我说的话提取这些人格指纹 高频语气词哈、嗯、噢、嘛…… 高频 Emoji 及使用习惯 标点偏好句号多还是感叹号多爱用波浪号吗 消息风格短句连发型还是长段落型新手建议优先喂这几类对话——深夜对话/独白最能暴露真实性格、情绪波动时的表达、做重要决定时的聊天记录、日常闲扯提炼口头禅。数据源二QQ 聊天记录学生党专属福利很多大厂的你其实都留在 QQ 里。QQ 消息管理器可以导出txt或mht格式的聊天记录tools/qq_parser.py 两种都支持。它和微信解析的定位略有不同QQ 记录更多承载的是你学生时代、更松弛的表达方式——那些哈哈哈哈6nb的浓度往往比工作微信高得多对刻画真实语气非常有用。数据源三社交媒体与日记价值观主战场日记和笔记是提取价值观与深度思考的最佳来源比聊天记录更能反映你内心真实的优先级排序。形式处理方式日记 / 笔记md / txt直接作为文本分析朋友圈、微博、小红书截图图片交给 AI 的读图能力逐张查看文本导出由 tools/social_parser.py 扫描目录、自动分类图片与文本文件截图类则由 AI 直接读取识别。prompts/self_analyzer.md 定义了从日记中提取的维度核心价值观、生活习惯、重要记忆、人际关系图谱、成长轨迹。小提醒日记不必整理流水账和情绪化片段反而更有价值。数据源四照片用 EXIF 还原生活轨迹照片本身是图片但自己.skill 读的不是画面而是元信息。tools/photo_analyzer.py 会批量提取每张 JPEG/PNG 的 EXIF 数据 拍摄时间 → 排出你的个人时间线 GPS 坐标 → 还原你常去的地点和生活轨迹比如2022 年秋天你在莫干山住了一周这种回忆就靠照片时间线支撑。该工具依赖 Pillowpip install -r requirements.txt即可装上。⚠️ 注意手机相册转发、微信压缩过的照片通常丢失 EXIF建议用原图目录。数据源五口述/粘贴最低优先级但保底必备没有任何原始文件也没关系。录入流程 prompts/intake.md 只问 3 个问题全部可跳过仅代号必填代号/昵称——比如小北20岁的我基本信息——年龄、职业、城市自我画像——MBTI、星座、性格标签、你对自己的主观评价这套信息会写入 selves/example_me/meta.json 这样的元数据文件中作为 Persona 的硬覆盖层直接生效。数据源组合推荐不同情况的选法你的情况推荐组合时间充裕追求极致还原微信 QQ 日记 照片全套上只有手机随时可用微信/QQ 记录 一段自我口述社恐不想暴露聊天记录日记/笔记 照片 口述想先试试水仅口述跑通流程后再追加而且它支持追加进化以后找到更多聊天记录、日记、照片可以增量 merge 进已有 Skill不覆盖已有结论增量逻辑见 prompts/merger.md。说我不会这样说还能即时纠正每次更新自动存档、支持回滚。快速上手从 0 到数字永生三步第 1 步安装到 Claude Codegit clone https://gitcode.com/gh_mirrors/yo/yourself-skill ~/.claude/skills/create-yourself pip install -r requirements.txt # 可选解析工具依赖第 2 步创建你的分身在 Claude Code 中输入/create-yourself按提示回答 3 个问题然后选择提供哪些数据源。第 3 步调用与管理命令说明/{slug}调用完整分身像你一样思考和说话/{slug}-self自我档案模式帮你回忆和分析自己/{slug}-persona仅人格模式性格 表达风格/yourself-rollback {slug} {version}回滚到历史版本常见问题Q聊天记录太多要全给吗不需要。优先给情绪浓度高、决策场景多、深夜时段的对话几十到几百条高质量对话优于上万条群聊水贴。Q隐私安全吗所有数据都在本地解析和存储生成的 Skill 文件就在你自己的项目目录里SKILL.md 是入口不上传任何第三方服务。Q只有口头描述也能用吗可以所有字段均可跳过。但如前所述口述还原的是你以为的自己聊天记录还原的是真实行为的自己两者差距往往很大。总结选对 5 类数据源AI 还原度直接拉开差距微信聊天记录原话级语气素材优先级最高QQ 记录 / 日记年轻时的真实表达 价值观照片 EXIF时间线和地点让记忆有据可查口述保底方案随时可补一句话聊天记录塑造语气日记塑造三观照片锚定时间线口述兜底。材料越真实蒸馏出的数字分身越像你。与其蒸馏别人不如蒸馏自己。欢迎加入数字永生【免费下载链接】yourself-skill与其蒸馏别人不如蒸馏自己。欢迎加入数字永生Inspired by colleague-skill同事skill。项目地址: https://gitcode.com/gh_mirrors/yo/yourself-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考