作成者 affaan-m
videodb は、ローカルファイル、URL、RTSP/RTMP のライブ配信、またはデスクトップキャプチャから動画と音声を取り込み、タイムスタンプ付きの検索で該当シーンを見つけ、再生可能な証拠として確認し、クリップ、オーバーレイ、文字起こし、アラート、タイムライン編集で実際に操作するのに役立ちます。VideoDB for Video Editing とライブ配信分析に向けた、実用的な videodb ガイドです。
Audio タグ付きの Agent Skill を閲覧し、関連ワークフローを比較できます。
作成者 affaan-m
videodb は、ローカルファイル、URL、RTSP/RTMP のライブ配信、またはデスクトップキャプチャから動画と音声を取り込み、タイムスタンプ付きの検索で該当シーンを見つけ、再生可能な証拠として確認し、クリップ、オーバーレイ、文字起こし、アラート、タイムライン編集で実際に操作するのに役立ちます。VideoDB for Video Editing とライブ配信分析に向けた、実用的な videodb ガイドです。
作成者 affaan-m
video-editingスキルは、既存の映像素材をより洗練された、各プラットフォーム向けの動画へ素早く仕上げるためのものです。Vlog、チュートリアル、デモ、短尺クリップ、インタビュー編集を対象に、カット、構成、字幕付け、リフレーミング、軽い補強を中心に扱います。すでにラフ素材があり、実用的なvideo-editingガイドが必要なときに最適です。
作成者 affaan-m
fal-ai-media は、fal.ai MCP を使ってメディア生成を一元化する GitHub スキルです。画像生成、画像編集、動画、音声、オーディオの各ワークフローで、モデル検索、コスト確認、ガイド付きプロンプトを使いながら fal-ai-media スキルをインストールして活用できます。
作成者 ComposioHQ
youtube-downloader は、Python の yt-dlp ラッパーで YouTube の単一動画を保存したり、MP3 音声を抽出したりできる File Automation スキルです。画質の選択、mp4/webm/mkv 形式、音声のみモード、カスタム出力フォルダに対応しています。
作成者 ComposioHQ
meeting-insights-analyzer は、会議の議事録をもとに、コミュニケーションの傾向、フィラー語、断定を避ける表現、対立回避、発話バランスを分析し、議事録に裏付けられた Workplace Communication 向けのコーチングフィードバックを支援します。
作成者 ComposioHQ
Spotify Automation は、認証済みの SPOTIFY_* ツールを通じて、Spotify の検索、プレイリスト、再生操作、アルバム、トラック、ユーザープロフィールへのアクセスを扱う Composio MCP スキルです。
作成者 ComposioHQ
rev-ai-automation は、Composio Rube MCP を通じて Rev AI ワークフローを自動化するための Claude skill です。Rube への接続、rev_ai connection の確認、最新のツールスキーマの事前検索、文字起こしや関連する Rev AI タスクの実行をガイドし、推測に頼る作業を減らします。
作成者 ComposioHQ
lmnt-automation は、Composio の Rube MCP を通じて Claude が LMNT ワークフローを自動化できるようにする skill です。実行前に利用可能な最新ツールを検出し、LMNT 接続を確認し、ライブスキーマを参照して進めます。
作成者 ComposioHQ
happy-scribe-automation は、Claude が Composio Rube MCP 経由で Happy Scribe のワークフローを実行できるようにするスキルです。文字起こし、字幕、エクスポート、プロジェクト自動化に向けて、セットアップ要件、接続確認、ツール検出、安全な使い方の基本を確認できます。
作成者 ComposioHQ
GroqCloud Automation は、GroqCloud のモデル検出、チャット補完、音声翻訳、TTS 音声選択を `GROQCLOUD_*` ツール経由で扱うための Composio MCP スキルです。
作成者 ComposioHQ
deepgram-automation は、Composio Rube MCP 経由で Deepgram タスクを自動化するための Claude スキルです。現在のツールスキーマの確認、有効な Deepgram 接続の検証、スキーマ優先のワークフロー実行に利用できます。
作成者 openai
transcribe は、音声や動画をテキスト化するスキルで、話者分離の指定や既知話者のヒントも使えます。技術文書作成、会議メモ、インタビュー、講義、コンテンツ運用など、出力形式を安定させたい場面に向いています。汎用プロンプトよりも手順が明確で、再現性のある音声文字起こしスキルを求めるときに適しています。
作成者 JimLiu
baoyu-youtube-transcriptは、YouTubeのURLまたは動画IDから文字起こし、字幕、カバー画像を抽出できるスキルです。言語指定、翻訳、Markdown / SRT出力、キャッシュを使った再整形に対応し、より確実に文字起こしを取得するためにInnerTube APIからyt-dlpへのフォールバックも備えています。
作成者 heygen-com
hyperframes は、HyperFrames で HTML ベースの動画コンポジションを構築するためのワークフロースキルです。タイトルカード、オーバーレイ、字幕、ナレーション、音に反応するモーション、シーン遷移など、Video Editing 向けに構造化されたコードファーストの hyperframes が必要なときに使えます。汎用的なプロンプトだけの動画依頼よりも、レイアウト、タイミング、アニメーションの設計を重視します。
作成者 microsoft
azure-ai-voicelive-ts は、Azure AI Voice Live TypeScript SDK を使ってリアルタイム音声 AI アプリを構築するのに役立ちます。双方向音声、ストリーミング応答、セッション設定、関数呼び出しが必要な Node.js やブラウザ向けプロジェクトに最適です。この azure-ai-voicelive-ts ガイドは、実践的な導入、使い方、コード生成のヒントを探しているときに役立ちます。
作成者 microsoft
azure-ai-contentunderstanding-py は、Azure AI Content Understanding 向けの Python スキルです。ドキュメント、画像、音声、動画から構造化コンテンツを抽出し、RAG ワークフローや自動化に活用できます。信頼性の高いマルチモーダル抽出、Azure 認証、再現性のあるパイプライン向け出力が必要な場合に適しています。
作成者 microsoft
azure-ai-voicelive-java は、Java のバックエンド開発向けの Azure AI VoiceLive SDK スキルです。インストール、認証、WebSocket による音声ストリーミング、イベント処理、リアルタイムのアシスタント構築に役立つ実例ベースの使い方をカバーします。
作成者 microsoft
azure-ai-voicelive-dotnet は、Azure AI Voice Live を使ってリアルタイム音声AIアプリを構築するための .NET 向けスキルです。インストール、セットアップ、認証、利用方法をカバーしており、双方向音声、低遅延セッション、音声対話から音声対話へのワークフローなど、バックエンド開発に必要なガイダンスを提供します。
作成者 microsoft
podcast-generation は、Azure OpenAI GPT Realtime Mini を WebSocket で使い、テキストから AI 生成のポッドキャスト風音声を作るためのスキルです。React、Python FastAPI、PCM ストリーミング、文字起こしの取得、WAV 変換まで含めた、Full-Stack Development 向けの podcast-generation に適しています。汎用的なプロンプトではなく、実際のアプリ統合に使える実践的な podcast-generation ガイドが必要なときに向いています。
作成者 microsoft
github-issue-creator は、メモ、エラーログ、音声入力、スクリーンショットを、GitHub らしい簡潔な issue 下書きに整えます。Issue Tracking 用のこの github-issue-creator skill は、要約、環境、再現手順、期待される挙動と実際の挙動、影響範囲、証拠を整理し、レビューしやすい markdown issue にまとめるのに役立ちます。
作成者 NoizAI
speech-to-text スキルは、対応音声ファイルをプレーンテキストに文字起こしします。タイムスタンプ、話者ラベル、JSON 出力にも対応しており、実務的な音声文字起こしに向けて設計されています。インタビュー、会議、ポッドキャスト、講義、そして一貫した文字起こしが重要な自動化タスクなど、繰り返し使うワークフローでの利用に適しています。
作成者 NoizAI
ttsスキルは、テキストを音声に変換し、ナレーション、吹き替え、ボイスオーバー、タイムライン同期再生に使える音声を生成します。プレーンテキストから音声ファイルを作成したり、記事やテキストファイルを音声化したり、SRTベースの音声をタイミング制御付きで出力したりできます。シンプルモードとタイムラインモードに対応し、バックエンドを意識した再現性のあるtts運用にも向いています。
作成者 NoizAI
sound-fx スキルを使って、テキストプロンプトから効果音、フォーリー、アンビエント音、クリーチャー音、UI ノイズを生成できます。Audio Editing 向けの sound-fx として、素早い試作やダウンロード可能な音声アセット作成に適しています。NoizAI/skills にインストールし、有効な Noiz API key を使ってスクリプトベースのワークフローを実行します。音声、歌詞、メロディ、ボイスクローンには向きません。
作成者 NoizAI
characteristic-voice は、温かく、寄り添うようで、感情のこもった話し方を生成する音声生成 skill です。慰める返答、朝や夜のメッセージ、気軽な雑談、間や笑い、やわらかさのあるキャラクター調の受け答えに向いています。プリセット駆動のワークフローと、実用的な characteristic-voice 運用を支えるバックエンド対応を備えています。