如何让Codex识别D盘中的大文件和重复文件?

2026-08-18 06:15 来源:阡陌浮生记

  想用 Codex 调用豆包清理 C 盘,需要先在 Codex 环境中配置豆包的 API 密钥,再让豆包通过 Python 脚本扫描 D 盘目录,利用文件大小排序和哈希比对找出大文件与重复文件。

  一、环境准备与调用配置

  安装依赖:在 Codex 的 Python 环境中安装

  requests

  

  openai

  库,用于调用豆包 API

  配置密钥:将豆包的 API Key 和模型名称(如

  doubao-pro-32k

  )写入环境变量,避免硬编码泄露

  验证连通:先发送一条简单测试消息(如"你好"),确认 Codex 能顺利调用豆包接口

  二、识别 D 盘大文件

  遍历目录:让豆包生成 Python 脚本,用

  os.walk

  递归遍历 D 盘所有文件夹

  筛选阈值:设定大小阈值(如 500MB),仅保留超过该体积的文件并记录路径与大小

  排序输出:按文件大小降序排列,输出前十名大文件路径,便于后续清理判断

  三、查找 D 盘重复文件

  计算哈希:同脚本内用

  hashlib.md5

  

  sha1

  计算每个文件的内容指纹

  分组比对:将相同哈希值的文件归为一组,保留路径、大小与修改时间

  汇总结果:输出重复文件分组列表,并预估可释放的磁盘空间总量

  四、结合豆包分析与清理

  智能判断:把扫描结果交给豆包,由它分析哪些重复文件可安全删除(如临时文件、缓存)

  生成建议:让豆包输出清理建议清单,并生成相应的删除或移动命令供用户确认后执行