Fish Audio là nền tảng giọng nói AI giúp chuyển văn bản thành lời nói tự nhiên và tái sử dụng một giọng nói trong nhiều sản phẩm. Quy trình chính rất đơn giản: tạo âm thanh bằng S2.1 Pro, tạo hoặc chọn giọng nói rồi gửi Voice ID trong các yêu cầu tiếp theo.
Vì sao nên thử Fish Audio?
- Một mô hình cho 83 ngôn ngữ: S2.1 Pro tự động nhận diện ngôn ngữ, phù hợp với sản phẩm bản địa hóa và nội dung đa ngôn ngữ.
- Mô tả cách diễn đạt ngay trong văn bản: các chỉ dẫn như
[whispers sweetly],[laugh]hoặc[excited]điều khiển cảm xúc mà không cần danh sách cố định. - Tái sử dụng giọng nói: nhân bản một lần, nhận Voice ID rồi dùng làm
reference_idcho các yêu cầu TTS sau. - Nhanh chóng từ văn bản đến MP3: Playground của Free AI API hỗ trợ giọng mặc định hoặc Voice ID tùy chọn, đồng thời cho phép nghe và tải kết quả.
Có thể xây dựng gì?
- Lời thuyết minh đa ngôn ngữ cho video, podcast, khóa học và bản demo.
- Giọng nói cho nhân vật game, bạn đồng hành AI và conversational agent.
- Đọc hỗ trợ tiếp cận, thông báo và nguyên mẫu giao diện giọng nói.
- Giọng thương hiệu nhất quán khi bạn sở hữu hoặc đã được cấp quyền sử dụng giọng đó.
“Miễn phí” có hai nghĩa khác nhau
Fish Audio hiện có hai lựa chọn miễn phí không nên nhầm lẫn với nhau:
- Mô hình API dành cho phát triển:
s2.1-pro-freecó giá $0 cho mỗi triệu UTF-8 bytes, cùng chất lượng và độ phủ ngôn ngữ vớis2.1-pro. Mô hình chịu giới hạn fair use và không có bảo đảm TTFA hoặc DPA. - Free Tier trên website: trang gói hiện liệt kê 8.000 credits mỗi tháng, khoảng 7 phút tạo âm thanh, 500 ký tự mỗi lần và 3 ô giọng nói công khai, không cần thẻ tín dụng.
Mô hình API miễn phí không cam kết năng lực production không giới hạn. Hãy đo latency thực tế và chuyển sang mô hình production khi cần bảo đảm dịch vụ.
Bắt đầu trong bốn bước
- Tạo tài khoản Fish Audio.
- Làm theo hướng dẫn API Key có hình và lưu Key an toàn.
- Mở S2.1 Pro TTS Playground, dán Key và tạo MP3 từ tối đa 500 ký tự.
- Nếu cần giọng tùy chỉnh, dùng endpoint nhân bản giọng nói rồi dán Voice ID vào Playground.
Chỉ nhân bản giọng của bạn hoặc giọng đã được cho phép rõ ràng. Fish Audio khuyến nghị ít nhất 10 giây âm thanh sạch được thu ở nơi yên tĩnh.
Khám phá thêm trên Free AI API
Xem trang nhà cung cấp Fish Audio, mô hình S2.1 Pro và tài liệu chính thức về mô hình và giá. Sau đó, tạo tài khoản và dùng thử.

Phản hồi từ cộng đồng
Bình luận được liên kết với tài khoản GitHub của bạn — đăng nhập để tham gia thảo luận.