vision-toolkit
Provides multimodal vision MCP tools for image analysis, OCR, object detection, text-to-image generation, and image similarity, integrating OpenAI, Qwen, and Gemini.
- Score
- 22.5571 signal
- Evidence
- 1 star
- Last commit
- as last read from GitHub; most reads are from 2 Sep 2026 or later
- Listed
Install
No one-command install. Set it up from its source.
Alternatives · MCPs
- jau123-meigen-ai-design1,735 stars · 224 forks98.312
- gemini-skill830 stars · 119 forks97.532
- arcadeai-blueprint731 stars · 68 forks97.084
What it is
Provides multimodal vision MCP tools for image analysis, OCR, object detection, text-to-image generation, and image similarity, integrating OpenAI, Qwen, and Gemini.
When to use it
Provides multimodal vision MCP tools for image analysis, OCR, object detection, text-to-image generation, and image similarity, integrating OpenAI, Qwen, and Gemini.
How to install / invoke
See Glama for the install config.
Notes
Listed from the Glama MCP registry.