bởi ComposioHQ
google-cloud-vision-automation giúp agent chạy các quy trình Google Cloud Vision qua Composio Rube MCP bằng cách tìm kiếm các công cụ hiện có, xác minh kết nối google_cloud_vision và thực thi các schema đã được kiểm tra.
bởi ComposioHQ
google-cloud-vision-automation giúp agent chạy các quy trình Google Cloud Vision qua Composio Rube MCP bằng cách tìm kiếm các công cụ hiện có, xác minh kết nối google_cloud_vision và thực thi các schema đã được kiểm tra.
bởi K-Dense-AI
histolab là một skill Python cho tiền xử lý ảnh whole-slide image (WSI) trong giải phẫu bệnh số. Skill này hỗ trợ phát hiện mô, trích xuất tile và chuẩn hóa nhuộm cho các slide H&E, rất hữu ích cho chuẩn bị bộ dữ liệu, phân tích nhanh theo tile và các quy trình phân tích dữ liệu nhẹ. Hãy cài đặt và dùng histolab với hướng dẫn thực tế về mask, tiler và quản lý slide.
bởi huggingface
huggingface-vision-trainer giúp bạn cài đặt và sử dụng một skill Hugging Face cho các tác vụ huấn luyện thị giác máy tính: phát hiện đối tượng, phân loại ảnh và phân đoạn SAM/SAM2. Nội dung bao gồm chuẩn bị dữ liệu, thiết lập GPU trên cloud, đánh giá mô hình, ghi log bằng Trackio và đẩy kết quả lên Hub. Phù hợp cho tự động hóa backend và các quy trình huấn luyện có thể lặp lại.
bởi microsoft
Skill azure-ai-vision-imageanalysis-py giúp bạn cài đặt và sử dụng Azure AI Vision Image Analysis SDK cho Python. Nội dung bao gồm chú thích ảnh, thẻ, đối tượng, OCR, phát hiện người và cắt ảnh thông minh, kèm hướng dẫn thiết lập backend, xác thực và môi trường cho các quy trình hiểu ảnh dựa trên Azure.
bởi microsoft
azure-ai-vision-imageanalysis-java giúp bạn xây dựng ứng dụng phân tích ảnh bằng Java với Azure AI Vision. Phù hợp cho captioning, OCR, phát hiện đối tượng, gắn thẻ, phát hiện người, cắt ảnh thông minh và phát triển API, với thiết lập SDK, xác thực và ví dụ minh họa.
bởi K-Dense-AI
Skill transformers giúp bạn dùng Hugging Face Transformers để tải mô hình, suy luận, tokenization và fine-tuning. Đây là hướng dẫn transformers thực tế cho các tác vụ Machine Learning trên text, vision, audio và quy trình đa phương thức, với lộ trình rõ ràng cho baseline nhanh cũng như huấn luyện tùy chỉnh.