项目定位
面向 coding-agent 的多档位读图与 OCR Skill,包含候选故障转移、本地 VLM 和安全配置边界。
核心能力
这个项目强调把一个明确问题落成可运行的工作流,并将输入、处理、输出和验证边界写进公开文档。
验证证据
- Bilingual README
- Skill manifest and scripts
- Local tests and dry-run path
当前限制
远程视觉服务是否可用取决于外部 Provider;静态检查与 dry-run 不等于线上调用成功。
- 状态
- 可安装 Skill
- 技术栈
- Python · OCR · Agent Skill · OpenAI-compatible API
- 源码
- github.com/Dithob/Youcansee