Agent Skill隐私敏感 设计与创意

格罗克想象视频

xAI格罗克想象API集成,支持通过自然语言进行图像生成、文本转视频、图像转视频及编辑功能。适用于根据文本提示生成图像/视频、编辑现有图像、将静态图像动画化为视频,或通过自然语言指令编辑现有视频。支持跨消息平台的对话式生成,具有异步轮询、进度更新和自动交付功能。

查看 GitHub 仓库 ↗ ⭐ 13 Stars

📌 Skill基础信息

Skill名称:Grok Imagine Video

简称:grok-imagine-video

来源:社区第三方(DevvGwardo)

运行宿主:OpenClaw Agent

核心定位:通过xAI Grok Imagine API实现多模态内容生成与编辑,支持从文本生成图像/视频、图像动画化、视频编辑等自然语言驱动的内容创作场景。

🧩 内部核心组成

核心能力模块

  • GrokImagineVideoClient:核心API客户端,封装所有xAI接口调用
  • 异步任务处理系统:支持视频生成的轮询机制和进度更新
  • 自动交付系统:生成完成后自动下载并通过聊天界面交付

功能命令表格

功能类型实现方式主要用途
文生图generate_image()根据文本描述生成静态图像(1-10个变体)
图像编辑edit_image()基于自然语言指令修改现有图像
文生视频text_to_video()从文本描述生成动态视频(1-15秒)
图生视频image_to_video()将静态图像动画化为视频
视频编辑edit_video()使用自然语言指令编辑现有视频

目录结构

scripts/grok_video_api.py   # 核心API客户端
references/api_reference.md # 完整API文档

🛠 安装与启用方式

前置依赖

  • Python 3.x
  • OpenClaw Agent环境

关键步骤

  1. 获取xAI API密钥:访问 https://console.x.ai/
  2. 设置环境变量:
export XAI_API_KEY="your-api-key-here"
  1. 安装Skill:
skills install --user DevvGwardo/grok-imagine-video

API要求:必须配置有效的xAI API密钥,不支持预配置密钥

📋 标准工作流

  1. 用户输入:通过自然语言描述需求(如"生成海洋日落的视频")
  2. 请求发起:Skill解析指令并调用对应API方法
  3. 处理阶段

- 图像类任务:即时生成,无需等待

- 视频类任务:启动异步任务,返回job_id

  1. 进度监控:视频生成期间进行轮询(1-3分钟),提供进度更新
  2. 结果交付

- 自动下载生成内容到工作区

- 通过聊天界面交付最终成果

  1. 错误处理:遇到限制或错误时提供友好提示

⚠️ 关键限制、缺陷、注意事项

技术限制

  • 视频时长:严格限制1-15秒
  • 分辨率选项:仅支持480p(默认)和720p
  • 速率限制:60请求/分钟
  • 并发限制:最大15个并发任务

使用成本

  • API调用消耗xAI额度,需自行监控使用量
  • 视频生成耗时较长,不适合实时应用

平台兼容性

  • 仅支持OpenClaw Agent环境
  • 需要稳定的网络连接访问xAI API

生产环境适用性

  • 适合原型开发和内容创作场景
  • 不适合高并发生产环境(受API限制约束)
  • 生成内容可能存在内容政策限制

✅ 适用场景 & ❌ 不适合场景

适合场景

  • 内容创作者快速生成视觉素材
  • 产品原型设计中的视觉概念验证
  • 社交媒体内容制作
  • 教育和演示材料生成
  • 个人娱乐和创意探索

不适合场景

  • 实时视频生成需求(延迟较高)
  • 长视频内容制作(超过15秒)
  • 高分辨率专业制作(最高仅720p)
  • 大批量自动化内容生产(受API限制)
  • 对生成内容有严格版权要求的商业项目

如何安装

skills install --user DevvGwardo/grok-imagine-video

通用安装教程:在哪里输入上面的命令

上面的命令本质是在「终端 / 命令行」中调用技能管理器,把该 Skill 下载并注册到你的 AI 工具。各主流工具打开终端的位置不同,按下面操作即可:

  1. 打开工具自带的终端面板,或系统终端(macOS「终端」、Windows「PowerShell」、Linux「Terminal」)。
  2. 把上面的安装命令复制进去,回车运行,等待下载与注册完成。
  3. 重启或重新加载 AI 工具,让新安装的 Skill 被识别。
  4. 新建对话并触发:直接描述用途,或通过该工具的技能 / 斜杠菜单选中此 Skill。
Claude 桌面版(macOS / Windows)

桌面版没有内置命令行,Skill 需通过 Claude Code CLI 安装。打开系统终端,先执行 npm install -g @anthropic-ai/claude-code,再运行上面的安装命令;完成后完全退出并重新打开 Claude。

Claude Code(终端 CLI)

直接在项目目录的终端里运行上面的命令即可。也可先输入 claude 启动交互界面,再在对话中引用该 Skill(/ 斜杠菜单或直接描述用途)。

VS Code(含 GitHub Copilot)

打开终端面板:菜单「终端 → 新建终端」,或快捷键 Ctrl+`(macOS 为 ⌃+`)。在终端里运行上面的命令;装完后执行「重新加载窗口」(Ctrl+Shift+P → Reload Window),让 Copilot 等扩展识别新技能。

Cursor

底部「终端」面板(Ctrl+`)即是内置终端。粘贴运行上面的命令,完成后在命令面板执行「Reload Window」刷新,再开始对话。

Windsurf

底部「终端」面板运行命令;也可直接使用其内置 Agent 终端,在对话侧执行安装。

其他工具(ChatGPT、本地脚本等)

不支持本地终端的产品,可先在本机终端完成安装,再在对话中描述该 Skill 的能力让其调用;不同工具的命令格式请以其官方文档为准。

风险提示

⚠️ 中风险:需留意隐私

本 Skill 涉及读取隐私 / 敏感信息(如密钥、环境变量、凭据)。安装前请确认其用途是否必要。

检测到隐私/敏感信息读取(预设模式 #3)
检测到隐私/敏感信息读取(预设模式 #6)

命中检测项

  • privacy_collect

相似 Skill 推荐

A/B测试
sickn33/agentic-awesome-skills
低风险

当用户需要规划、设计或实施A/B测试/实验,或构建增长实验项目时使用。适用于用户提及“A/B测试”、“拆分测试”、“实验”、“测试此变更”、“变体文案”、“多变量测试”、“假设”、“是否应测试此内容”等场景。

花叔设计
alchaincyf/huashu-design
中风险

花叔Design——用HTML做高保真原型、幻灯片、动画、可视化与专家评审。任何新设计100%先出三个方向初稿给用户选(指定风格/品牌也不豁免),选定后才执行。触发词:做原型、PPT、幻灯片、动画、设计风格、评审、做个H

cdxgen
cdxgen/cdxgen
中风险

从源代码和容器镜像为您的项目创建CycloneDX物料清单(BOM)。支持多种语言和包管理器。可集成到CI/CD流程中,自动提交至Dependency Track服务器。

FSE实验设计
brycewang-stanford/Awesome-Journal-Skills
低风险

用于设计或评审ESEC/FSE实证评估,涵盖真实主体系统、公平基准、SE标准统计与效应量、定性与混合方法严谨性、污染感知的LLM消融实验、挖掘研究的可追溯性,以及证据与软件工程主张形态的匹配。