SEMANTIC DIRECTORY · plugin-directory-semantic-v3-18

Media & Multimodal

媒体与多模态领域Plugin

Use keyword search
Source catalog discovery.composite.2026-09-06.v1-0-5.b92b985e31dfCanonical structure · 823 nodes · 14829 plugins
Leaf categoryAspect-ratio Calculation

根据宽高参数计算或换算画幅比例;不处理图像像素内容。

1 plugins
Leaf categoryAudio & Video File Processing & Subtitles

对已有音视频文件执行技术处理:剪辑拼接、转码、压缩、抽帧、元数据探测、渲染、字幕解析翻译、时间轴校验、双语合并与字幕烧录。不负责内容语义分析、媒体播放或生成式创作。

11 plugins
Leaf categoryCross-Media Generation & Workflows

编排同时涉及多种媒体类型的生成式流程,例如图片、音乐、音效、配音和视频流水线,多模态能力路由及综合媒体 API 套件。不包含单一媒体类型的独立生成工具。

48 plugins
Leaf categoryImage Generation & Editing

根据文本提示词或参考图生成新图像,或对图像进行局部重绘、合成、风格化、放大和设计工作流处理,包含多模型接入、提示词模板与 ComfyUI 等生成式流程。不含确定性像素处理和图像理解。

50 plugins
Leaf categoryImage Processing & Optimization

对已有图像执行确定性变换和优化:裁剪、缩放、压缩、格式转换、水印、去背景、像素比较、切块、TIFF 解码与尺寸读取等。不进行模型语义推理,也不生成新的图像内容。

46 plugins
Leaf categoryImage Understanding & Analysis

让模型理解已有图片内容并输出语义结果:图像描述、视觉问答、截图或界面分析、物体与场景识别、图像比较及视觉模型桥接。不含以文字提取为核心的 OCR、确定性图像处理、屏幕采集与图像生成。

51 plugins
Leaf categoryIn-Chat Media Display & Input

在对话界面中展示或注入媒体:图片、画廊、音视频预览、内联 HTML/SVG/CSV 卡片、表情包、图片上传和图床外链等。不负责理解、生成或管理完整媒体素材库。

50 plugins
Leaf categoryMedia Fetching & Content Extraction

从 URL、网站或在线平台获取媒体或其附属内容,并提取音视频、字幕、文稿、评论、弹幕、关键帧及链接正文供模型阅读或分析。不负责本地媒体库管理和界面播放。

31 plugins
Leaf categoryMedia Library Management

组织和管理已有的本地或工作区媒体素材,包括图片、视频和音频的导入、打标、索引、去重、语义检索、Category与资产关联。不负责在线抓取、媒体生成或会话内展示。

24 plugins
Leaf categoryMedia Playback & Reading

面向用户消费已有内容:音乐、播客、有声书、在线视频、短视频、电台、漫画和小说等的搜索、订阅、播放控制与阅读。不包含下载处理、内容分析、录制或语音合成。

50 plugins
Leaf categoryMultimodal Input/output Bridging

在文本、图像、音频或其他模态输入输出之间提供统一桥接和工作台能力。

1 plugins
Leaf categoryOCR & Document Recognition

从图片、截图、扫描件、PDF 或文档中提取文字、公式和结构化字段,包含手写、证件、票据、表格、二维码与条码识别,输出文本、Markdown、坐标或文档结构。不含开放式视觉问答。

52 plugins
Leaf categoryScreen Capture & Visual Input

采集屏幕区域、窗口、终端或移动设备画面并输出图片,可包含框选、标注、全局热键和将采集结果注入会话。不负责分析图片内容或在会话中展示普通媒体。

45 plugins
Leaf categorySpeech-to-Text & Transcription

将麦克风语音或已有音频、视频中的语音识别为文字,用于听写、输入、转录或生成时间轴文本,支持实时、离线、多语种和方言识别。不包含语音合成和双向语音对话。

50 plugins
Leaf categoryText-to-Speech & Read-Aloud

将文本、助手回复或会话事件合成为语音并朗读、播报或发送语音消息,包含音色选择、声音克隆和语音通知。不负责语音识别输入或持续双向对话。

28 plugins
Leaf categoryVideo Parameter Calculation

根据用户输入的编码参数离线精确计算视频/音频技术参数(码率、帧率、文件大小)并返回详细结果,不处理任何媒体文件。

3 plugins
Leaf categoryVideo Generation & Production

生成或制作可交付的视频内容,包括文生视频、口播与对口型、短视频创作、剪辑编排、动画渲染、配音、转场、竖屏成片和直播推流。不含仅对已有视频进行技术转换或内容分析。

44 plugins
Leaf categoryVideo Understanding & Analysis

分析已有视频的语义内容和时间线:场景感知、抽帧、关键帧索引、视频问答、转录摘要、分镜与剧本拆解、证据审查和内容检索。不包含视频剪辑、转码或生成。

32 plugins
Leaf categoryCharts & Specialized Visualization

将数据、代码或结构化描述渲染为图表和可视化对象,包括 Mermaid、D2、PlantUML、SVG、函数图像、信息图、地图、分子结构、CAD 或其他专业三维查看器。不负责媒体播放或图像生成。

49 plugins
Leaf categoryReal-Time Voice Conversation

提供持续、流式或全双工的语音对话:语音输入、语音回复、唤醒词、打断、实时 turn-taking 和 agent 通话模式等输入输出闭环能力。单纯听写或朗读Plugin不属于此类。

31 plugins

Categories are public semantic index facts, not a final recommendation. Compatibility, permissions, and source evidence remain separate.