CATEGORY
该分类下经过 manifest 校验、精确版本的插件。
xby-speech-synthesis
一个集成了Microsoft Edge高质量语音合成能力的MCP服务器,支持多语言语音生成、音频合并和云端存储。
xby-wikimedia-search-images
该MCP服务器使AI助手能够在Wikimedia Commons上搜索图片,提供详细的元数据和可选的缩略图组合,帮助AI模型进行视觉比较。
xby-wild-animal-detection
输入一张图像,输出图像中所有识别到的野生动物的检测框、置信度及标签。
dsh-drop-preview
DSH WebUI 拖放文件预览:可在任意位置拖放文件,全页面预览图像和渲染后的 Markdown(从拖放的文件中解析内联图像,或在会话工作区中自动搜索),点击图像进行缩放/旋转,持久化的编辑器文件框,智能桌面截图(全屏/自由区域选择/窗口选择,带实时缩略图,自动保存到文件框),支持预览和外部视觉模型识别,并将可读文本插入编辑器,适用于 DeepSeek 等纯文本模型
xby-animal-recognition
对含有动物的图像进行标签识别,无需任何额外输入,输出动物的类别标签。
xby-asr-1
通用语音识别,支持多国语言及小语种。
xby-asr-5
常用的五种语音识别,中文普通话、英语、日语、韩语、粤语,自动识别语种。
xby-asr-f
支持普通话,20多种方言和口音的语音识别。
xby-asr-zh
中文语音识别
xby-bird
检测并识别图片中的鸟类。
xby-captcha
验证码识别工具集,支持文本、滑块、旋转、选择等验证方式的识别。注意:一定要遵守目标网站或系统的使用条款和法律法规,在允许的条件下使用。
xby-cellphone-detection
输入一张图像,对其中的手机进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-classify
对图像进行ImageNet 1000类分类,返回Top-5类别和置信度。
xby-daily-object-detection
输入一张图像,对其中的人/宠物/车/火焰/纸箱进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-detect-vehicle
输入一张图像,检测图像中的车辆类型(car/truck/bus/motorbike/tricycle/carplate),输出所有目标的检测框、置信度和标签。
xby-detect
包括日常物体检测、昆虫识别、植物识别、动物识别、电动自行车检测、手机检测、手势检测、火焰检测、香烟检测、人头人体检测、野生动物检测、鸟类识别、宠物情绪识别、菜品识别、安全帽人体检测、行人检测、反光衣检测、车辆检测、图像分类、目标检测、旋转目标检测、人体姿态估计和万物识别。
xby-dish
菜品识别,输出可能的菜品名称及概率。
xby-ebike-detection
输入一张图像,对其中的电动自行车进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-extract-image
MCP服务器提供从本地文件、URL提取图像并转换为base64格式的功能,适用于LLM分析。
xby-fire-detection
检测各类通用场景中出现的火焰,最佳使用场景:安防摄像头、交通摄像头视角。
xby-general-recognition
对包含主体物体的图像进行标签识别,输出主体物体的类别标签,目前已经覆盖了5万多类的物体类别。
xby-gesture-detection
输入一张图像,对其中的手势进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-head-person-detection
输入一张图像,对其中的人头人体进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-helmet-head
输入一张图像,对其中的人体、头部和安全帽进行检测,输出图片中所有目标的检测框、置信度和标签。
xby-image-detect
检测图像中的80类COCO目标(人、车、动物、日常物品等),输出边界框、置信度和类别标签。
xby-insect-recognition
识别昆虫或其他节肢动物名称(或所属目, 科, 属, 种)。
xby-logo-analyze
一个智能Logo提取和处理的MCP服务器,支持从网站URL自动识别并提取Logo图标,并提供图像处理和矢量转换功能。
dsh-omi-voice
DeepSeek Harness 对话内朗读:豆包音质 · 点读/暂停/继续 · 豆包 Key 只留在 Omi 引擎(BYOK)
@dopilot/dsh-plugin-image-gen
适用于 DeepSeek Harness 的 OpenAI 兼容图像生成工具
dsh-pro-vision-std
dsh-std Community v0.15 模型提供商:DeepSeek-V4-Pro,图像由 V4-Flash-Vision-Exp 生成描述。需要在 DeepSeek Harness 上使用 @dsh-std/adapter-dsh。