首页00月度趋势榜01新星榜02增速榜03HF热榜04总表05搜索06

guillaumemeyer/watermarks-remover

一套「Agent skill + 纯标准库 Python 服务」,用于剥离文本与文件中的多厂商 AI 溯源标记——包括 Claude、Gemini/SynthID-Text、OpenAI 溯源面、开源统计水印以及 C2PA/EXIF/XMP 元数据;README 明确限定用于自己拥有或已授权的内容,不用于欺诈或虚假署名。

语言
Python
⭐ 总星标
18,457
📅 创建
2026-08-11
🍴 Forks
2,136
许可证
MIT
在 GitHub 打开 回到总表

配图

信息卡

项目内容
仓库guillaumemeyer/watermarks-remover
语言 / 许可证Python / MIT
总星标⭐ 18457(截至 2026-08-26)
创建时间2026-08-11
榜单近30天新星榜 第1名

一句话定位

一套「Agent skill + 纯标准库 Python 服务」,用于剥离文本与文件中的多厂商 AI 溯源标记——包括 Claude、Gemini/SynthID-Text、OpenAI 溯源面、开源统计水印以及 C2PA/EXIF/XMP 元数据;README 明确限定用于自己拥有或已授权的内容,不用于欺诈或虚假署名。

走红原因分析

一是 AI 内容水印(SynthID-Text、C2PA 凭证)全面铺开,用户对自有内容的隐私与元数据卫生需求陡增,而专门工具几乎空白;二是项目踩在敏感但强需求的合规边界上,话题性极强;三是工程质量扎实(核心零依赖、安全审计友好、CI 带 CodeQL/pip-audit),曾用名 remove-claude-marks 积累了首批关注;四是对 Claude Code 插件市场与 PostToolUse hook 的一键接入大幅降低门槛。

核心功能拆解

架构与技术栈浅析

三层结构:skill 层仅是 markdown 指令;服务层为 stdlib 实现的 HTTP 服务器(按扩展名 + magic bytes 双重路由);外部重型 harness 固定 commit 克隆到独立 venv,永不捆绑。核心要求 Python 3.10+,零第三方依赖;真正的 PDF 元数据剥离需 qpdf/exiftool(exiftool 单独写增量段不算真删除),Ghostscript 负责 PDF 内深层图像。

安装与环境要求

python3 install_skill.py --skill remove-ai-marks --target claude-code

target 支持 claude-code / claude-project / cowork / cursor。服务端 `make serve`(默认 127.0.0.1:8765);Docker 只读容器 `-p 127.0.0.1:8765:8765 --read-only --tmpfs /tmp`。

快速上手示例

SCRIPTS=service/scripts
python3 "$SCRIPTS/clean_file.py" draft.md -o draft.cleaned.md
python3 "$SCRIPTS/clean_file.py" photo.png -o photo.cleaned.png
python3 "$SCRIPTS/rewrite_text.py" draft.md --backend print-prompt --strength paraphrase

也可 `curl -X POST $WM/clean` 传 base64 文件。

进阶使用要点

典型应用场景

同类生态位对比

对比通用 EXIF 清理工具:额外覆盖 AI 统计水印与 C2PA,且以 Agent skill 形态分发;对比 MarkLLM 等学术框架:面向生产管道而非验证研究;同领域几乎无开源竞品,属先发占位。

资源导航

仓库 README(三层架构说明)、service/scripts 脚本目录、docker compose 的 core/harness/heavy 三组 profile、pytest 测试套件。

← 上一篇kunchenguid/firstmate下一篇 →yc-software/qm