Speech To Text

Speech To Text skills and workflows surfaced by the site skill importer.

9 skills
C
rev-ai-automation

bởi ComposioHQ

rev-ai-automation là một Claude skill dùng để tự động hóa quy trình Rev AI thông qua Composio Rube MCP. Skill hướng dẫn agent kết nối Rube, xác minh kết nối rev_ai, tìm schema công cụ hiện tại trước, rồi chạy tác vụ phiên âm hoặc các tác vụ Rev AI liên quan với ít phải phỏng đoán hơn.

Workflow Automation
Yêu thích 0GitHub 67.5k
C
happy-scribe-automation

bởi ComposioHQ

happy-scribe-automation giúp Claude chạy các quy trình Happy Scribe thông qua Composio Rube MCP. Nội dung hướng dẫn các yêu cầu thiết lập, kiểm tra kết nối, khám phá công cụ và cách dùng an toàn cho phiên âm, phụ đề, xuất tệp và tự động hóa dự án.

Workflow Automation
Yêu thích 0GitHub 67.5k
C
gladia-automation

bởi ComposioHQ

gladia-automation là một Claude skill dùng để tự động hóa tác vụ Gladia thông qua Composio Rube MCP, với khả năng khám phá công cụ trực tiếp, kiểm tra kết nối và thực thi theo schema trước khi chạy phiên âm hoặc các workflow khác.

Workflow Automation
Yêu thích 0GitHub 67.5k
C
deepgram-automation

bởi ComposioHQ

deepgram-automation là một skill Claude dùng để tự động hóa các tác vụ Deepgram thông qua Composio Rube MCP. Bạn có thể dùng skill này để khám phá schema công cụ hiện tại, xác minh kết nối Deepgram đang hoạt động và chạy các workflow theo hướng schema-first.

Workflow Automation
Yêu thích 0GitHub 67.5k
O
transcribe

bởi openai

transcribe biến âm thanh hoặc video thành văn bản, có thể kèm phân tách người nói và gợi ý người nói đã biết. Phù hợp cho viết kỹ thuật, ghi chú cuộc họp, phỏng vấn, bài giảng và vận hành nội dung khi bạn cần một kỹ năng transcribe lặp lại được với định dạng đầu ra rõ ràng và ít phải đoán hơn so với một prompt chung chung.

Technical Writing
Yêu thích 0GitHub 18.8k
M
azure-speech-to-text-rest-py

bởi microsoft

azure-speech-to-text-rest-py là skill Python Azure Speech REST để chuyển giọng nói thành văn bản từ audio ngắn mà không cần Speech SDK. Hãy dùng khi phát triển backend và bạn cần kiểm soát HTTP trực tiếp, thiết lập nhanh, cùng hỗ trợ tệp âm thanh dài tối đa 60 giây. Hướng dẫn này bao gồm cài đặt, xác thực, định dạng audio và thời điểm nên tránh dùng cho audio dài, streaming hoặc batch transcription.

Backend Development
Yêu thích 0GitHub 2.3k
N
speech-to-text

bởi NoizAI

Kỹ năng speech-to-text chuyển các tệp âm thanh được hỗ trợ thành văn bản thuần, với tùy chọn thêm dấu thời gian, nhãn người nói và đầu ra JSON. Kỹ năng này được thiết kế cho nhu cầu speech-to-text thực tế trong các quy trình lặp lại, bao gồm phỏng vấn, họp, podcast, bài giảng và các tác vụ tự động hóa nơi độ nhất quán của bản chép là quan trọng.

Workflow Automation
Yêu thích 0GitHub 498
N
tts

bởi NoizAI

Kỹ năng tts biến văn bản thành âm thanh giọng nói cho thuyết minh, lồng tiếng, voiceover và phát theo mốc thời gian. Bạn có thể dùng nó để tạo file giọng nói từ văn bản thuần, chuyển bài viết hoặc file text thành speech, hoặc render âm thanh từ SRT với khả năng kiểm soát timing. Kỹ năng hỗ trợ chế độ đơn giản và chế độ theo timeline, cùng các quy trình làm việc nhận biết backend để dùng tts lặp lại một cách ổn định.

Voice Generation
Yêu thích 0GitHub 498
M
detecting-deepfake-audio-in-vishing-attacks

bởi mukul975

detecting-deepfake-audio-in-vishing-attacks giúp các đội an ninh phân tích âm thanh để phát hiện giọng nói do AI tạo ra trong các vụ vishing, gian lận và mạo danh. Skill này trích xuất các đặc trưng dựa trên phổ và MFCC, chấm điểm các mẫu đáng ngờ, và tạo báo cáo theo phong cách điều tra số để xem xét. Phù hợp nhất cho quy trình Security Audit và ứng phó sự cố.

Security Audit
Yêu thích 0GitHub 0