Audio

Audio 태그가 붙은 Agent Skill을 찾아보고 관련 워크플로를 비교하세요.

33 개 스킬
A
videodb

작성자 affaan-m

videodb는 로컬 파일, URL, RTSP/RTMP 라이브 피드, 데스크톱 캡처에서 비디오와 오디오를 수집하고, 타임스탬프가 있는 순간을 검색해 재생 가능한 증거로 확인하며, 클립, 오버레이, 전사, 알림, 타임라인 편집으로 바로 활용할 수 있도록 돕습니다. VideoDB for Video Editing과 라이브 스트림 분석을 위한 실용적인 videodb 가이드입니다.

Video Editing
즐겨찾기 0GitHub 156.3k
A
video-editing

작성자 affaan-m

video-editing 스킬은 기존 영상을 더 빠르게 세련되고 플랫폼 배포에 바로 쓸 수 있는 영상으로 다듬는 데 도움을 줍니다. 브이로그, 튜토리얼, 데모, 숏폼 클립, 인터뷰 편집을 위해 컷 편집, 구조화, 자막, 화면 재구성, 가벼운 보강 작업에 초점을 맞춥니다. 이미 원본 영상이 있고 실용적인 video-editing 가이드가 필요할 때 가장 잘 맞습니다.

Video Editing
즐겨찾기 0GitHub 156.3k
A
fal-ai-media

작성자 affaan-m

fal-ai-media는 fal.ai MCP를 통해 이미지, 비디오, 음성, 오디오를 한 번에 다루는 미디어 생성용 GitHub 스킬입니다. 이미지 생성, 이미지 편집, 비디오, 음성, 오디오 워크플로에 맞춰 fal-ai-media 스킬을 설치하고 활용하는 데 도움이 되며, 모델 검색, 비용 확인, 안내 프롬프트까지 함께 제공합니다.

Image Generation
즐겨찾기 0GitHub 156.1k
C
youtube-downloader

작성자 ComposioHQ

youtube-downloader는 단일 YouTube 동영상을 저장하거나 Python yt-dlp 래퍼로 MP3 오디오를 추출하는 File Automation skill입니다. 품질 선택, mp4/webm/mkv 형식, 오디오 전용 모드, 사용자 지정 출력 폴더를 지원합니다.

File Automation
즐겨찾기 0GitHub 67.5k
C
meeting-insights-analyzer

작성자 ComposioHQ

meeting-insights-analyzer는 Workplace Communication을 위해 회의 transcript를 분석해 커뮤니케이션 패턴, filler words, hedging, conflict avoidance, 발언 균형, transcript 기반 코칭 피드백을 도출하도록 돕습니다.

Workplace Communication
즐겨찾기 0GitHub 67.5k
C
Spotify Automation

작성자 ComposioHQ

Spotify Automation은 인증된 SPOTIFY_* 도구를 통해 Spotify 검색, 플레이리스트, 재생 제어, 앨범, 트랙, 사용자 프로필 접근을 지원하는 Composio MCP용 Spotify Automation 스킬입니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
C
rev-ai-automation

작성자 ComposioHQ

rev-ai-automation은 Composio Rube MCP를 통해 Rev AI 워크플로를 자동화하는 Claude 스킬입니다. 에이전트가 Rube를 연결하고, rev_ai connection을 확인하며, 먼저 최신 tool schema를 검색한 뒤 전사나 관련 Rev AI 작업을 더 적은 추측으로 실행하도록 안내합니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
C
lmnt-automation

작성자 ComposioHQ

lmnt-automation은 Claude가 Composio의 Rube MCP를 통해 LMNT 워크플로를 자동화하도록 돕습니다. 실행 전에 현재 사용 가능한 도구를 찾고, LMNT 연결 상태를 확인하며, 실제 스키마를 활용합니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
C
happy-scribe-automation

작성자 ComposioHQ

happy-scribe-automation은 Claude가 Composio Rube MCP를 통해 Happy Scribe 워크플로를 실행하도록 돕습니다. 전사, 자막, 내보내기, 프로젝트 자동화에 필요한 설정 조건, 연결 확인, 도구 검색, 안전한 사용 패턴을 파악할 수 있습니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
C
GroqCloud Automation

작성자 ComposioHQ

GroqCloud Automation은 GroqCloud 모델 탐색, 채팅 완성, 오디오 번역, TTS 음성 선택을 GROQCLOUD_* 도구로 처리하는 Composio MCP 스킬입니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
C
deepgram-automation

작성자 ComposioHQ

deepgram-automation은 Composio Rube MCP를 통해 Deepgram 작업을 자동화하는 Claude 스킬입니다. 최신 도구 스키마를 확인하고, 활성 Deepgram 연결을 검증하며, 스키마 우선 워크플로를 실행하는 데 사용할 수 있습니다.

Workflow Automation
즐겨찾기 0GitHub 67.5k
O
transcribe

작성자 openai

transcribe는 오디오나 비디오를 텍스트로 바꾸며, 선택적으로 화자 분리와 알려진 화자 힌트도 지원합니다. Technical Writing, 회의록, 인터뷰, 강의, 콘텐츠 운영처럼 재현 가능한 transcribe 스킬과 명확한 출력 형식이 필요할 때 잘 맞으며, 범용 프롬프트보다 덜 추측에 의존하게 해줍니다.

Technical Writing
즐겨찾기 0GitHub 18.8k
J
baoyu-youtube-transcript

작성자 JimLiu

baoyu-youtube-transcript는 URL 또는 비디오 ID에서 YouTube 자막, 스크립트, 커버 이미지를 추출할 수 있게 도와주는 스킬입니다. 언어 선택과 번역을 지원하며, markdown 또는 SRT 출력, 캐시 기반 재포맷, 그리고 더 안정적인 스크립트 수집을 위해 InnerTube API에서 yt-dlp로 폴백하는 방식까지 제공합니다.

Format Conversion
즐겨찾기 0GitHub 13.2k
H
hyperframes

작성자 heygen-com

hyperframes는 HyperFrames에서 HTML 기반 비디오 컴포지션을 만드는 워크플로 스킬입니다. 제목 카드, 오버레이, 자막, 보이스오버, 오디오 반응형 모션, 장면 전환처럼 구조화된 코드 우선 hyperframes가 필요할 때 사용하세요. 일반적인 프롬프트만으로 만드는 비디오 요청보다 레이아웃, 타이밍, 애니메이션 결정을 더 중시합니다.

Video Editing
즐겨찾기 0GitHub 2.7k
M
azure-ai-voicelive-ts

작성자 microsoft

azure-ai-voicelive-ts는 Azure AI Voice Live TypeScript SDK로 실시간 음성 AI 앱을 만드는 데 도움이 됩니다. 양방향 오디오, 스트리밍 응답, 세션 설정, 함수 호출이 필요한 Node.js 또는 브라우저 프로젝트에 적합합니다. 이 azure-ai-voicelive-ts 가이드는 실용적인 설치, 사용법, 코드 생성 도움을 원할 때 유용합니다.

Code Generation
즐겨찾기 0GitHub 2.3k
M
azure-ai-contentunderstanding-py

작성자 microsoft

azure-ai-contentunderstanding-py는 Azure AI Content Understanding용 Python 스킬입니다. 문서, 이미지, 오디오, 비디오에서 구조화된 콘텐츠를 추출해 RAG 워크플로와 자동화에 활용할 수 있습니다. 신뢰할 수 있는 멀티모달 추출, Azure 인증, 그리고 반복 가능한 파이프라인용 출력을 필요로 할 때 적합합니다.

RAG Workflows
즐겨찾기 0GitHub 2.2k
M
azure-ai-voicelive-java

작성자 microsoft

azure-ai-voicelive-java는 Java 백엔드 개발용 Azure AI VoiceLive SDK 스킬입니다. 설치, 인증, WebSocket 음성 스트리밍, 이벤트 처리, 예제 기반 사용법을 다루며, 실시간 어시스턴트 구축에 필요한 핵심 흐름을 제공합니다.

Backend Development
즐겨찾기 0GitHub 2.2k
M
azure-ai-voicelive-dotnet

작성자 microsoft

azure-ai-voicelive-dotnet은 Azure AI Voice Live로 실시간 음성 AI 앱을 만드는 .NET 스킬입니다. 설치, 설정, 인증, 사용 방법을 다루며, 양방향 오디오, 저지연 세션, 음성-음성 워크플로 같은 백엔드 개발 가이드를 제공합니다.

Backend Development
즐겨찾기 0GitHub 2.2k
M
podcast-generation

작성자 microsoft

podcast-generation은 Azure OpenAI GPT Realtime Mini를 WebSocket으로 연결해 텍스트에서 AI 생성 팟캐스트 스타일 오디오를 만드는 데 도움이 됩니다. React, Python FastAPI, PCM 스트리밍, 전사 캡처, WAV 변환까지 안내해 Full-Stack Development용 podcast-generation에 적합합니다. 일반적인 프롬프트가 아니라, 실제 앱 통합에 바로 쓰는 실용적인 podcast-generation 가이드가 필요할 때 사용하세요.

Full-Stack Development
즐겨찾기 0GitHub 2.2k
M
github-issue-creator

작성자 microsoft

github-issue-creator는 원본 메모, 오류 로그, 음성 받아쓰기, 스크린샷을 GitHub 스타일의 깔끔한 이슈 초안으로 바꿉니다. 이 github-issue-creator 스킬은 요약, 환경, 재현 단계, 예상 결과와 실제 결과, 영향도, 증거를 보기 좋은 markdown 이슈로 정리해 이슈 추적을 돕습니다.

Issue Tracking
즐겨찾기 0GitHub 2.2k
N
speech-to-text

작성자 NoizAI

speech-to-text 스킬은 지원되는 오디오 파일을 일반 텍스트로 전사하며, 타임스탬프, 화자 레이블, JSON 출력 옵션을 제공합니다. 반복 가능한 워크플로에서 실용적으로 음성을 텍스트로 옮기는 용도에 맞게 설계되었으며, 인터뷰, 회의, 팟캐스트, 강의, 그리고 일관된 전사가 중요한 자동화 작업에 적합합니다.

Workflow Automation
즐겨찾기 0GitHub 498
N
tts

작성자 NoizAI

tts 스킬은 텍스트를 음성 오디오로 바꿔 내레이션, 더빙, 보이스오버, 타임라인 맞춤 재생에 활용할 수 있습니다. 일반 텍스트로 음성 파일을 만들고, 기사나 텍스트 파일을 음성으로 변환하고, 시간 제어가 필요한 SRT 기반 오디오를 렌더링하는 데 유용합니다. 단순 모드와 타임라인 모드를 모두 지원하며, 반복 가능한 tts 사용을 위한 백엔드 인식 워크플로도 제공합니다.

Voice Generation
즐겨찾기 0GitHub 498
N
sound-fx

작성자 NoizAI

sound-fx 스킬로 텍스트 프롬프트를 효과음, 폴리, 앰비언트 베드, 크리처 사운드, UI 노이즈로 바꿔보세요. 오디오 편집, 빠른 프로토타이핑, 다운로드 가능한 오디오 자산 제작에 잘 맞습니다. NoizAI/skills로 설치한 뒤, 유효한 Noiz API 키를 사용해 스크립트 기반 워크플로로 실행합니다. 음성, 가사, 멜로디, 보이스 클로닝 용도에는 적합하지 않습니다.

Audio Editing
즐겨찾기 0GitHub 498
N
characteristic-voice

작성자 NoizAI

characteristic-voice는 따뜻하고, 동행하는 느낌이 나며, 감정이 살아 있는 음성을 생성하는 스킬입니다. 위로하는 답변, 아침·밤 인사, 가벼운 농담, 멈춤·웃음·다정함이 들어간 캐릭터풍 전달에 적합합니다. 프리셋 기반 워크플로와 실사용을 위한 백엔드 지원도 포함합니다.

Voice Generation
즐겨찾기 0GitHub 498