Claude Code Vision Skill
为 Claude Code 赋能多模态视觉能力,支持豆包、通义千问、GPT-4o 等模型,用于截图 / UI / 图表分析;适配 DeepSeek 等无视觉底座,搭配 browser-harness 可做前端布局自动化检查。
Perfil del activo
Agents de programación y desarrollo
Code review, repo analysis, testing, CI, GitHub, DevOps, and developer workflow skills.
Escenario
Agents de programación
I need a coding agent that can understand a repository, edit code, and review pull requests.
Afinidad con Agent
Claude Code + OpenAI Agents + Browser agents
Funciona con Codex, Claude Code, Cursor, CLI o Agents personalizados.
Instalar
Listo
npx skills add xiincs/claude-code-vision-skill
Mantenimiento
Actual
23 días desde el último push
Riesgo
Requiere revisión
Dependency or permission surface needs review
Calidad de GitHub
92
77/100 Calidad · 72/100 Confianza
Etiquetas de cobertura
Notas de revisión
Dependency or permission surface needs review · Permission surface may require sandboxing
Tarjeta de adopción del Agent
Confianza, auditoría y preparación de instalación de un vistazo
Estas puntuaciones combinan metadatos públicos del repositorio, señales de revisión de OpenAgentSkill, actualidad de mantenimiento y preparación de instalación. Sirven para preseleccionar; no sustituyen la revisión humana.
Calidad
SólidoSolid option that is likely worth shortlisting for production workflows.
Confianza
Solo sandboxCandidata útil con señales de confianza incompletas o mixtas. Manténgala en un espacio aislado hasta que el ciclo de resultados demuestre el ajuste.
Auditoría
Requiere revisiónRevisión legible por máquina de la preparación de instalación, los metadatos de seguridad, el mantenimiento y el riesgo de adopción.
Trust Score de OpenAgentSkill v5
Revisión humana antes de instalar
Ejecute solo en un sandbox y compare alternativas cercanas antes de usarla en trabajo real.
Estrellas
92 estrellas de GitHub
Actividad del repositorio
92 estrellas y 5 forks
Mantenimiento
23 días desde el último push
Licencia
MIT
Instalar
npx skills add xiincs/claude-code-vision-skill
Seguridad de instalación
Ruta estándar de paquete o instalación en tiempo de ejecución
Superficie de permisos
secrets or environment access, shell or command execution
Resultados del Agent
Aún no hay datos de resultados del Agent
Documentación
Contexto sólido de README/SKILL.md
Resumen de riesgo
Revisar antes de producción
- Quality score needs review
- Permission surface needs review: secrets or environment access, shell or command execution
- GitHub adoption: 92 GitHub stars
- Stars/forks activity: 92 stars, 5 forks; issue activity unavailable in current metadata
Preparación de instalación
Ruta de instalación disponible
- La ruta de instalación está disponible
- La evidencia del repositorio está disponible
- La licencia está declarada
- Aún no hay evidencia de resultados Agent-Proven
Metadatos legibles por Agent
Datos de decisión legibles por máquina para este skill.
Usa este bloque o el JSON integrado para decidir si un Agent debe instalar este skill, elegir una alternativa o pedir revisión humana primero.
Tareas adecuadas
- flujos de Agents de programación
- Equipos de Claude Code
- builders willing to evaluate younger projects
- Inspect source files
Agents adecuados
Decisión de instalación
- Comando
- npx skills add xiincs/claude-code-vision-skill
- Política
- Bloquear
- Revisión humana
- Sí
Confianza y riesgo
- Confianza
- 64/100
- Auditoría
- 80/100
- Nivel de riesgo
- Requiere revisión
Ciclo de resultados
- Endpoint
- /api/agent/outcome
- ID del evento
- resolve
- Resultados
- 5
Comando de instalación
npx skills add xiincs/claude-code-vision-skillNo usar cuando
- Equipos que necesitan un SLA con soporte del proveedor
- Entornos de alta conformidad sin revisión interna de seguridad
- No major risk signals from current metadata
- Indicios de permisos de alto riesgo: Shell or command execution, Secrets or environment access
- Dependency or permission surface needs review
Skill alternativo
Code Review
168.6K Estrellas
npx skills add mattpocock/skills --skill code-review
Skill alternativo
Grill With Docs
164.7K Estrellas
npx skills add mattpocock/skills --skill grill-with-docs
Skill alternativo
To Spec
164.7K Estrellas
npx skills add mattpocock/skills --skill to-spec
Skill alternativo
To Tickets
176.7K Estrellas
npx skills add mattpocock/skills --skill to-tickets
Seguridad de Agent v2
40/100 · Evitar instalación automática
This skill should not be selected by an agent without explicit human security review.
Do not auto-install. Inspect the source, dependencies, and permission surface first.
Alto
Ejecución de shell o comandos
Los metadatos del skill hacen referencia a terminal, CLI, shell, subprocesos o flujos de ejecución de comandos.
Medio
Browser automation
Skill may drive a browser or interact with web pages.
Medio
Acceso a red
El skill probablemente consulta páginas remotas, API, repositorios o servicios externos.
Alto
Secrets or environment access
Skill metadata references credentials, tokens, environment variables, or secret-bearing workflows.
- Indicios de permisos de alto riesgo: Shell or command execution, Secrets or environment access
- Dependency or permission surface needs review
Destinos de instalación
Instala este skill en tu flujo de Agent
Usa el endpoint público para obtener el comando, la lista de seguridad, prompts y enlaces canónicos.
OpenAgentSkill CLI
Resolve policy, run the source installer safely, and report a verified install receipt.
$ npx --yes https://github.com/Leon-Drq/openagentskill/releases/download/cli-v0.2.1/openagentskill-0.2.1.tgz install xiincs-claude-code-vision-skillPlan de resolución de Agent
Deja que un Agent valide el ajuste antes de instalar.
La API Resolve devuelve la skill elegida, alternativas, política de seguridad, notas de auditoría, destino de instalación y un prompt listo para usar.
Abrir JSON
/api/agent/resolve?task=Use%20Claude%20Code%20Vision%20Skill%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Texto de Resolve
/api/agent/resolve?task=Use%20Claude%20Code%20Vision%20Skill%20for%20an%20agent%20workflow&agent=codex&max_risk=medium&format=text
Traspaso de instalación
/api/skills/xiincs-claude-code-vision-skill/install
Agent debe revisar
- Task fit and alternatives from Resolve API.
- Audit score, trust score, and safety policy warnings.
- Install target compatibility for Codex, Claude Code, Cursor, or CLI.
Copiar prompt
Task: Use Claude Code Vision Skill in this workspace.
Resolve first: https://www.openagentskill.com/api/agent/resolve?task=Use%20Claude%20Code%20Vision%20Skill%20for%20an%20agent%20workflow&agent=codex&max_risk=medium
Review install handoff: https://www.openagentskill.com/api/skills/xiincs-claude-code-vision-skill/install
Install command: npx skills add xiincs/claude-code-vision-skill
Before running it, summarize audit warnings, required permissions, and the fallback skill if install is risky.Traspaso de Agent
Da al Agent la ruta de instalación, no otro directorio.
Usa el endpoint público para obtener el comando, la lista de seguridad, prompts y enlaces canónicos.
Traspaso de instalación
/api/skills/xiincs-claude-code-vision-skill/install
Formato de texto LLM
/api/skills/xiincs-claude-code-vision-skill/install?format=text
Buscar alternativas
/api/skills/search?q=Claude%20Code%20Vision%20Skill&limit=3
Prompt de Agent
Use Claude Code Vision Skill for this task. Review https://www.openagentskill.com/api/skills/xiincs-claude-code-vision-skill/install, then install with: npx skills add xiincs/claude-code-vision-skillMetadatos del Registry
Perfil legible por Agent para seleccionar skills automáticamente.
La API Registry expone señales de decisión, confianza, auditoría, casos de uso e instalación sin raspar la interfaz.
Manifest
/api/registry/manifest/xiincs-claude-code-vision-skill
Texto LLM
/api/registry/manifest/xiincs-claude-code-vision-skill?format=text
Alias de instalación
/api/registry/install/xiincs-claude-code-vision-skill
Recomendar
/api/registry/recommend?task=Use%20Claude%20Code%20Vision%20Skill%20in%20an%20agent%20workflow&limit=3
Afinidad con Agent
Agents de programación
Etiquetas de uso
Plataformas
Python, Claude Code, OpenAI Agents, Browser agents
Informe de auditoría
Requiere revisión · 80/100
Revisión legible por máquina de la preparación de instalación, los metadatos de seguridad, el mantenimiento y el riesgo de adopción.
Panel de decisión de Agent
Companion skill for Coding agents
Shortlist this skill and compare it with close alternatives before production adoption.
Rol en la pila
Skill complementaria
Ajuste principal
Agents de programación
Etiqueta de confianza
Lista sólida
Ruta de instalación
Comando listo
Úsalo cuando
- flujos de Agents de programación
- Equipos de Claude Code
- builders willing to evaluate younger projects
Evidencia
- recent repository activity
- install command or GitHub repo available
- perfil de calidad 77/100
- 4 eventos de interacción de OpenAgentSkill
revisar primero
- No major risk signals from current metadata
Ruta de implementación
- 1Instálalo en un Agent de sandbox y ejecuta una tarea de Agents de programación de principio a fin.
- 2Compare output quality, latency, and failure behavior against at least one alternative.
- 3Promote it into production only after reviewing repository permissions, license, and maintenance signals.
Perfil de confianza
Solo sandbox
Candidata útil con señales de confianza incompletas o mixtas. Manténgala en un espacio aislado hasta que el ciclo de resultados demuestre el ajuste.
Adopción en GitHub
Revisar92 estrellas de GitHub
Actividad de stars/forks
Revisar92 estrellas y 5 forks; la actividad de issues no está disponible en los metadatos actuales
Mantenimiento reciente
Aprobado23 días desde el último push
Claridad de licencia
AprobadoMIT
Señales positivas
- Revisión de IA aprobada
- La ruta de instalación está disponible
- La evidencia del repositorio está disponible
- Repositorio mantenido recientemente
- El comando de instalación no muestra un patrón de alto riesgo evidente
- El ciclo de resultados está listo, pero necesita la primera ejecución real de Agent
Revisar antes de instalar
- Quality score needs review
- Permission surface needs review: secrets or environment access, shell or command execution
- GitHub adoption: 92 GitHub stars
- Stars/forks activity: 92 stars, 5 forks; issue activity unavailable in current metadata
- Dependency/runtime risk: command execution surface, credential or environment access
- Permission surface: secrets or environment access, shell or command execution
- Aún no hay informes reales de resultados del Agent
- Se requiere revisión humana antes de una instalación desatendida
Acción recomendada
Ejecute solo en un sandbox y compare alternativas cercanas antes de usarla en trabajo real.
Perfil de calidad
Sólido candidato para flujos de Agent
Solid option that is likely worth shortlisting for production workflows.
Ajuste de flujo
Usa esta skill en estos escenarios
Build and ship code
Coding agents
I need a coding agent that can understand a repository, edit code, and review pull requests.
Operate web apps
Browser automation
I need my agent to control a browser, fill forms, and verify web app workflows.
Verify behavior
Testing and QA
I need my agent to test a web app, reproduce bugs, and verify fixes.
Ajuste de flujo
Añadir a un flujo completo
Operate and verify web apps
Browser QA agent
A workflow for agents that navigate products, fill forms, take screenshots, and verify real user flows across web applications.
Inspect, patch, and verify code
Coding review agent
A workflow for software agents that inspect repositories, review pull requests, generate tests, and turn findings into shippable patches.
Design, build, test, and ship interfaces
Frontend and UI
A practical workflow for agents that turn product briefs or Figma designs into polished frontend code, review the result, test it in a browser, and prepare a safe deployment.
Lista de alternativas
Compara antes de instalar
Similar skills that may fit this task.
Code Review
Review a branch or diff against repository standards and the originating spec in two independent analysis passes.
Grill With Docs
A relentless interview that pressure-tests a plan against the codebase, sharpens domain language, and updates CONTEXT.md and ADRs when decisions become durable.
To Spec
Turn the current conversation and codebase context into a structured implementation spec, then publish it to the configured project issue tracker.
To Tickets
Break a plan, spec, or conversation into independently actionable tracer-bullet tickets with explicit blocking relationships.
Resumen
# Claude Code Vision Skill
为 Claude Code 提供多模态视觉能力,支持多种视觉模型分析截图、UI、图表。
专为使用 DeepSeek 等无多模态能力的模型作为 Claude Code 底座的用户设计。
## 截图直贴,所见即所析 遇到 UI 报错、设计稿或数据图表?**直接 alt + v 截图粘贴到 Claude Code 对话中,自动调用视觉模型分析**。无需记住任何命令,像聊天一样自然。
## 串联工具链,自动 UI 审查 配合 **browser-harness** 等工具,可实现**自动截图 → AI 视觉分析 → 生成审查报告 → 修正页面**的完整闭环。前端页面渲染后自动截图,由视觉模型检查布局、样式和交互问题。
## 支持的模型
| Provider | 模型 | API Key 环境变量 | |----------|------|-----------------| | 豆包 (Doubao) | doubao-seed-2-0-pro-260215 | `DOUBAO_API_KEY` | | 通义千问 (Qwen) | qwen-vl-max | `DASHSCOPE_API_KEY` | | OpenAI | gpt-4o | `OPENAI_API_KEY` | | Claude (Anthropic) | claude-sonnet-5 | `ANTHROPIC_API_KEY` | | **任意自定义 provider** | 任意 | `{NAME}_API_KEY` |
不在上面四个内置厂商里的 `--provider` 名字,会按同一套命名约定动态解析:设置 `{NAME}_API_KEY` / `{NAME}_BASE_URL` / `{NAME}_MODEL`(`{NAME}_PROTOCOL` 可选, 默认 `openai`,需要 Anthropic Messages API 形状时设为 `anthropic`),无需改一行代码即可接入任意 OpenAI 兼容端点(vLLM、Ollama、LiteLLM、OpenRouter、Azure OpenAI、自建代理等)。详见 [vision/SKILL.md](vision/SKILL.md#any-custom-provider)。
## 安装依赖
需要 Python 3.10+。
```bash pip install -r requirements.txt ```
`anthropic` 包仅在使用 `--provider anthropic` 时才会被导入,其他 provider 不受影响。
---
## Claude Code 安装流程(给 Claude Code 看的指令)
> **When the user asks you to install this skill, follow these steps IN ORDER. Do NOT skip any step.**
### Step 1 — 询问用户
使用 AskUserQuestion 询问以下信息:
1. **选择 provider**:doubao / qwen / openai / anthropic / 自定义(可多选;自定义需额外要 base URL、model,可选 protocol) 2. **API Key**:每个 provider 的 API key 3. **默认 provider**(多选时):选哪个作为默认
### Step 2 — 运行安装脚本
```bash python install.py \ --api-key qwen:sk-xxx \ --default-provider qwen \ --merge-claude ```
`--api-key` 可重复,`--merge-claude` **必须带上**。
如果用户选了自定义 provider,额外带上 `--base-url` / `--model`(`--protocol` 可选,默认 openai):
```bash python install.py \ --api-key myapi:sk-xxx \ --base-url myapi:https://host/v1 \ --model myapi:my-vision-model \ --default-provider myapi \ --merge-claude ```
### Step 3 — 合并 CLAUDE.md(如果 install.py 未自动完成)
如果未使用 `--merge-cla
Compatibilidad de plataforma
Detalles técnicos
- Versión
- 1.0.0
- Licencia
- MIT
- Última actualización
- 18 ago 2026
- Publicado
- 31 jul 2026
Frameworks y herramientas
Resumen de decisión
Skill complementaria
recent repository activity
Auditoría
Revisión de instalación
Revisión de instalación y adopción
- Seguridad
- 77/100
- Mantenimiento
- 100/100
- Instalar
- 92/100
Evidencia probada por Agent
Evidencia probada por Agent
Informes de resultados tras resolver, revisar, instalar y una ejecución limitada.
- Tasa de éxito
- —
- Fallo reciente
- —
- Resultados
- 0
- Calidad de salida
- —
- Fallidos
- 0
- No relevante
- 0
- Instalaciones
- 0
- Bloqueado por riesgo
- 0
- Configuración necesaria
- 0
- Producción
- 0
Aún no hay datos de resultados de Agent. La primera ejecución puede informar éxito, configuración necesaria, bloqueos de riesgo, fallo o irrelevancia mediante /api/agent/outcome.
Instalar
Añadir al flujo de Agent
Gratis y de código abierto. Revisa el informe antes de instalar en Agents de producción.
Bucle de crecimiento
Kit para compartir
Borrador basado en un caso para Claude Code Vision Skill, listo para publicar manualmente en X.
Claude Code Vision Skill: A reusable skill for Claude Code that adds multimodal vision capabilities for analyzing scree... 92 stars https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill?ref=x
Respuesta opcional con comando de instalación
Listing + install path for Claude Code Vision Skill: https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill?ref=x Install: npx skills add xiincs/claude-code-vision-skill
Fuente de la ficha
Indexado por la comunidad
Esta ficha se indexó desde fuentes públicas y no está marcada como oficial hasta que se apruebe una reclamación de mantenedor.
- Creador
- xiincs
- Indexado por
- Índice comunitario de OpenAgentSkill
La atribución enlaza al repositorio público o al perfil del creador. Los creadores pueden reclamar la ficha para actualizar las señales de propiedad.
Reclamar este skillReclamación del propietario
Reclamar esta ficha de skill
Esta ficha Indexado por la comunidad se atribuye a xiincs, pero aún no está marcada como oficial. Reclámala para añadir una señal de propietario verificado y hacer más fiables futuras actualizaciones de lanzamiento, instalación y auditoría.
Kit de enlaces para creadores
Añade las insignias de evidencia a tu README
Muestra la ficha canónica, las señales actuales de confianza y auditoría, y evidencia real de Agent-Proven donde los desarrolladores evalúan el repositorio.
[](https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill)
[](https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill)
[](https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill/audit)
[](https://www.openagentskill.com/skills/xiincs-claude-code-vision-skill)Autor
xiincs
@xiincs
Afinidad con plataforma
Señales de salud
- Estrellas de GitHub
- 92
- Puntuación de calidad
- 47/100
- Último push de GitHub
- 31 jul 2026
- Pistas del framework
- 1
- Vistas de OpenAgentSkill
- 4
- Copias de instalación
- 0
- Clics externos
- 0
Señal de comunidad
Comparte si este skill resulta útil para tu flujo de Agent. Los comentarios agregados mejoran la clasificación con el tiempo.
Confianza y seguridad
Solo sandbox
- Adopción en GitHub92 estrellas de GitHubRevisar
- Actividad de stars/forks92 estrellas y 5 forks; la actividad de issues no está disponible en los metadatos actualesRevisar
- Mantenimiento reciente23 días desde el último pushAprobado
- Claridad de licenciaMITAprobado
- Completitud de README/SKILL.mdLos metadatos incluyen suficiente contexto de uso y flujo de trabajoAprobado
- Riesgo de dependencias/runtimecommand execution surface, credential or environment accessCorregir
Skills relacionados
Code Review
Review a branch or diff against repository standards and the originating spec in two independent analysis passes.
168.6K EstrellasGrill With Docs
A relentless interview that pressure-tests a plan against the codebase, sharpens domain language, and updates CONTEXT.md and ADRs when decisions become durable.
164.7K EstrellasTo Spec
Turn the current conversation and codebase context into a structured implementation spec, then publish it to the configured project issue tracker.
164.7K EstrellasTo Tickets
Break a plan, spec, or conversation into independently actionable tracer-bullet tickets with explicit blocking relationships.
176.7K Estrellas