• 集成文本区域检测、OCR、去字修复与 LLM 翻译,覆盖漫画翻译的完整处理链路
• 支持本地与远程模型后端,兼容 llama.cpp、OpenAI 兼容接口,以及 OpenAI、Gemini、Claude、DeepSeek 等服务
• 提供竖排 CJK、RTL 文本渲染、可编辑 PSD 导出、Local HTTP API 与 MCP Server,方便接入自动化工作流
https://github.com/mayocream/koharu
~/.openclaw/workspace/AGENTS.md 里更好 因为 TOOLS.md 已经是怎么用 tools 了 可以强化一下...- 我新加的 skills 在 /root/.agents/skills 里, 总是使用里面最新的名字
- 生成图片使用 pollinations-image-gen, model 默认使用 zimage, 除非用户指定其他 model
- 当我让你截图或直接发送图片时, 需要使用 Message send media 发送图片到当前对话, 回复用户的消息
🖥 原生 macOS 应用程序,使用 SwiftUI 界面
🎨 使用 AI 模型进行高质量图像放大
🚀 GPU 加速,处理速度快
🖼 支持多种图像格式
💻 现代化直观的用户界面
max_tokens,gpt _set_max_tokens -1
-1 表示不限制. 默认为 888,gpt _set_key sk-xxx 设置 key, 默认为空,gpt _set_api https://api.openai.com 设置 api, 默认为官方,gpt _set_model gpt-3.5-turbo 设置 模型, 默认为 gpt-4o-mini,gpt _set_vision_model gpt-4o 设置 模型, 默认为 gpt-4o-mini,gpt _set_image_upload True 开启图像上传(部分第三方接口需要图片链接而不是 base64, 人形源码同款图床 fars.ee),gpt _set_auto_remove True 设置自动删除空提问,gpt _set_auto_remove False 关闭自动删除空提问,gpt _set_max_tokens -1 设置 max_tokens. -1 表示不限制. 默认为 888,gpt 直接提问 或 回复一条带文字的消息,gpt_reply 回复一条带文字的消息,gpt_vision 回复一条带图的消息,gpt_vision_reply 回复一条带图的消息,gpt4, ,gpt4_reply, ,gpt4_vision , ,gpt4_vision_reply 直接调用 gpt-4o,gpt3 直接调用 gpt-3.5-turbo
,claude 直接调用 claude-3-haikugpt-4o-mini 和 claude-3-haiku 的接口