一套「Agent skill + 纯标准库 Python 服务」,用于剥离文本与文件中的多厂商 AI 溯源标记——包括 Claude、Gemini/SynthID-Text、OpenAI 溯源面、开源统计水印以及 C2PA/EXIF/XMP 元数据;README 明确限定用于自己拥有或已授权的内容,不用于欺诈或虚假署名。

| 项目 | 内容 |
|---|---|
| 仓库 | guillaumemeyer/watermarks-remover |
| 语言 / 许可证 | Python / MIT |
| 总星标 | ⭐ 18457(截至 2026-08-26) |
| 创建时间 | 2026-08-11 |
| 榜单 | 近30天新星榜 第1名 |
一套「Agent skill + 纯标准库 Python 服务」,用于剥离文本与文件中的多厂商 AI 溯源标记——包括 Claude、Gemini/SynthID-Text、OpenAI 溯源面、开源统计水印以及 C2PA/EXIF/XMP 元数据;README 明确限定用于自己拥有或已授权的内容,不用于欺诈或虚假署名。
一是 AI 内容水印(SynthID-Text、C2PA 凭证)全面铺开,用户对自有内容的隐私与元数据卫生需求陡增,而专门工具几乎空白;二是项目踩在敏感但强需求的合规边界上,话题性极强;三是工程质量扎实(核心零依赖、安全审计友好、CI 带 CodeQL/pip-audit),曾用名 remove-claude-marks 积累了首批关注;四是对 Claude Code 插件市场与 PostToolUse hook 的一键接入大幅降低门槛。
三层结构:skill 层仅是 markdown 指令;服务层为 stdlib 实现的 HTTP 服务器(按扩展名 + magic bytes 双重路由);外部重型 harness 固定 commit 克隆到独立 venv,永不捆绑。核心要求 Python 3.10+,零第三方依赖;真正的 PDF 元数据剥离需 qpdf/exiftool(exiftool 单独写增量段不算真删除),Ghostscript 负责 PDF 内深层图像。
python3 install_skill.py --skill remove-ai-marks --target claude-code
target 支持 claude-code / claude-project / cowork / cursor。服务端 `make serve`(默认 127.0.0.1:8765);Docker 只读容器 `-p 127.0.0.1:8765:8765 --read-only --tmpfs /tmp`。
SCRIPTS=service/scripts
python3 "$SCRIPTS/clean_file.py" draft.md -o draft.cleaned.md
python3 "$SCRIPTS/clean_file.py" photo.png -o photo.cleaned.png
python3 "$SCRIPTS/rewrite_text.py" draft.md --backend print-prompt --strength paraphrase
也可 `curl -X POST $WM/clean` 传 base64 文件。
对比通用 EXIF 清理工具:额外覆盖 AI 统计水印与 C2PA,且以 Agent skill 形态分发;对比 MarkLLM 等学术框架:面向生产管道而非验证研究;同领域几乎无开源竞品,属先发占位。
仓库 README(三层架构说明)、service/scripts 脚本目录、docker compose 的 core/harness/heavy 三组 profile、pytest 测试套件。