Claude 对话记录 / 项目审查与 GitHub 上传完整记录

项目审查与 GitHub 上传完整记录

来源:Obsidian 笔记「Claude对话记录」· 静态快照,文字已脱敏

2026-08-24 项目审查与 GitHub 上传完整记录

标签:#项目 #GitHub #安全审查 #数据脱敏 日期:2026-08-24


一、会话背景与环境

1.1 运行环境确认

关键认识:工具外壳是 Claude Code,但"大脑"是 DeepSeek。这带来一个实际限制——当前模型不支持图片识别(详见第八节)。

1.2 API Key 安全改造

发现 ~/.claude/settings.json 里明文存着 DeepSeek API token,做了以下改造:


二、项目审查(原始项目 G:\data_test

2.1 项目概况

2.2 发现的高危问题 🔴

问题 位置 说明
2 个 DeepSeek API Key ai.env.idea/workspace.xml 上传即泄露,可被盗刷
2143 个真实手机号 db.sql0126.sql20260301.sql mobile 字段,严重隐私泄露
招聘者真实姓名(本记录已脱敏) 6 个 CSV(5.7 万行) 如"<已脱敏姓名>""<已脱敏姓氏>先生"
Django SECRET_KEY settings.py:25 硬编码
数据库密码 <数据库账号>/<明文密码> Scala×4、settings.py、word_cloud_picture.py 明文
内网 IP <已脱敏> 遍布源码 HDFS/MySQL 地址
管理员弱口令 settings.py:138 <管理员账号>/<弱口令>
用户密码明文存储 views.py 违背安全实践

2.3 未发现的问题 ✅

2.4 侵权结论


三、清理与脱敏(副本 G:\data_test_github

原则:全部操作在副本上进行,原始 data_test 保持不动。

3.1 复制

robocopy 复制 data_testdata_test_github(559 文件、384.66 MB,零失败)。

3.2 A 组:删除敏感文件

删除:ai.env、2 个 .idea/、3 个 SQL、6 个 CSV、zhangsan_resume.txtchromedriver.exesalary_predict_model.pkltarget/spark-warehouse/、全部 .pyc/.jar

结果:559 → 464 文件。

3.3 B 组:脱敏配置文件

3.4 C 组:.gitignore

根目录新建,排除:.env.idea/*.pyc*.sql*.csv、编译产物、二进制等。

3.5 D 组:署名

用户选择保留原名"基于Spark的IT岗位薪资分析预测系统",未改动。

3.6 额外删除

新建 DOCX 文档.docx项目图集/(用户确认后删除)。

最终副本:456 文件、293 MB,核心敏感信息全部清零。


四、上传 GitHub

4.1 关键决策

4.2 SSH 配置

4.3 推送


五、README 编写

从论文 F:\Obsidian\data\dify企业问答知识库项目\data_test_github.md 精炼成 GitHub README,包含:


六、截图与改名

6.1 截图

14 张截图复制到 screenshots/ 并重命名(home、login、profile、6 个可视化模块、salary-prediction、ai-job-match、3 个后台管理)。

6.2 仓库改名


七、环境变量清单(运行项目需要)

DJANGO_SECRET_KEY   # Django 密钥
DJANGO_DEBUG        # "True"/"False"
DB_HOST             # 数据库地址
DB_PASSWORD         # 数据库密码
DEEPSEEK_API_KEY    # AI 岗位匹配模块需要

八、遗留注意事项 / 待办 ⚠️

8.1 截图敏感信息未检查(最重要)

8.2 其他已处理项

8.3 可选后续


九、最终仓库信息