← ClaudeAtlas

visionenginelisted

VisionEngine(视擎科技)媒体 AI 能力命令行:覆盖图片生成/编辑/识别/提示词反推、语音合成与音色克隆、字幕生成与打轴、图生视频/文生视频/视频风格重绘/视频理解、数字人对口型、Remotion 工作区文件管理与远端渲染、LLM 文案生成。当用户要求生成图片或视频、给视频配音、克隆音色、做数字人、生成字幕或转写、做视频风格迁移、把素材上传到 Remotion 工作区、渲染 Remotion 成片、反推图片提示词,或提到 VisionEngine / 视擎 / ve 的媒体任务时使用本技能——即使用户没有点名 VisionEngine,只要任务落在上述媒体 AI 能力范围内也应使用。不适用于纯本地 ffmpeg 处理或与 VisionEngine 平台无关的通用编码任务。
vecai-dev/skills · ★ 0 · AI & Automation · score 78
Install: claude install-skill vecai-dev/skills
# VisionEngine CLI 一个零依赖的 Python 脚本,覆盖 VisionEngine 平台的全部媒体 AI 能力。 ## 何时用 / 何时不用 **用**:图片生成与编辑、图片识别与提示词反推、TTS 配音与音色克隆、字幕生成/打轴、图生视频/文生视频/风格重绘、视频理解、数字人对口型、Remotion 工作区文件读写与远端渲染、用 LLM 生成文案。 **不用**:与 VisionEngine 平台无关的本地视频处理(直接用 ffmpeg)、纯前端代码任务、需要更高权限的管理端点(API Key 无权访问,会 401)。 ## 60 秒上手 ```bash python <skill>/scripts/ve.py env # 自检:确认凭据可用 python <skill>/scripts/ve.py image generate --prompt "一只橘猫在窗台晒太阳" --aspect-ratio 9:16 python <skill>/scripts/ve.py audio voices --gender female python <skill>/scripts/ve.py audio tts --text "你好,欢迎使用视擎" --speaker zh_female_vv_uranus_bigtts python <skill>/scripts/ve.py files list --path . --max-depth 1 ``` 所有命令输出统一 JSON(UTF-8、缩进 2);失败时向 stderr 输出 `{"success": false, "error": ..., "http_status": ...}` 并返回退出码 1。 ## 命令地图 | 组 | 命令 | 说明 | 参考 | |---|---|---|---| | `env` | `env` | 诊断端点/密钥/鉴权 | [troubleshooting](references/troubleshooting.md) | | `api` | `api <METHOD> <PATH> [--data\|--data-file] [--query K=V]` | 任意已开放接口透传 | troubleshooting | | `image` | `generate` `edit` `edit-advanced` `generate-from-images` `recognize` `prompt-reverse` | 图片生成/编辑/识别/反推 | [image](references/image.md) | | `audio` | `tts` `voices` | 语音合成 / 音色目录(本地) | [audio-subtitle](references/audio-subtitle.md) | | `subtitle` | `generate` `align` | 字幕生成 / 强制对齐(自动落 .srt) | audio-subtitle | | `video` | `img2video\|text2video\|style-transfer\|recognize` × `submit\|query`(recognize 另有 `result` `cancel`) | 视频生成与理解 | [video](references/video.md) | | `dh` | `clone