Free Mimo TTS 2.5 (Voice Design) on Xiaomi

เข้าถึง Mimo TTS 2.5 (Voice Design) ได้ฟรีผ่าน Xiaomi

อัปเดตเมื่อ 11/5/2569ตัวอย่างโค้ด 1 รายการ
加载评分…

เกี่ยวกับโมเดล

ทำไมต้องเลือก MIMO Voice Design 2.5?

นี่เป็นวิธีการล้มล้างการสังเคราะห์คำพูดแบบดั้งเดิม มันละทิ้ง "เสียงที่เลือก" แบบดั้งเดิมและ "ให้โคลนเสียง" แบบดั้งเดิมอย่างสมบูรณ์ และสามารถสร้างบางสิ่งบางอย่างจากความว่างเปล่าได้

จุดแข็งและคุณลักษณะหลัก

  • เสียงการนวดภาษาธรรมชาติ: คุณเพียงแค่ป้อนคำอธิบายข้อความที่คล้ายกับ "หยาบ ลุงวัยกลางคนตัวเล็ก ๆ ที่มีสำเนียงเล็กน้อย" และโมเดลใหญ่สามารถสร้างเสียงที่ไม่เหมือนใครในโลกได้โดยตรงตามความเข้าใจเชิงความหมาย
  • การควบคุมโหมดผู้กำกับ: รองรับการควบคุมพื้นหลังของตัวละคร ฉากปัจจุบัน และแม้แต่รูปแบบการตีความเฉพาะผ่านคำพรอมต์ ซึ่งให้พื้นที่จินตนาการที่ไม่มีที่สิ้นสุดสำหรับการสร้างเนื้อหา
  • ความต้องการตัวอย่างเป็นศูนย์: คุณไม่จำเป็นต้องเตรียมเสียงที่สะอาดเป็นเวลาหลายสิบวินาทีด้วยซ้ำ ทำลายขีดจำกัดของวัสดุโดยสิ้นเชิง

วิธีเข้าถึงฟรี (ผ่าน Xiaomi)

พื้นฐานฟรี (ทำไมมันฟรี?)

ฟังก์ชันที่เป็นนวัตกรรมใหม่นี้เป็นผลิตภัณฑ์ทางเข้าที่ดึงดูดผู้สร้างให้สัมผัสกับแพลตฟอร์ม MIMO และขณะนี้เปิดให้บริการในเวลาจำกัดและฟรี เนื่องจากต้นทุนพลังงานในการคำนวณสูงในการสร้างเสียงคุณภาพสูงเฉพาะ ขอแนะนำให้ใช้ช่วงโบนัสฟรีนี้เพื่อผลิตเนื้อหาโดยเร็วที่สุด

[สิทธิประโยชน์เพิ่มเติม] แม้ว่าโมเดลนี้จะฟรี แต่หากคุณต้องการสัมผัสกับ Xiaomi รุ่นท็อปที่จ่ายเงินอื่น ๆ (เช่น MIMO v2.5 Dialogue Model) ฉันกำลังใช้แพลตฟอร์ม MIMO Open ลงทะเบียนเป็นผู้ใช้ใหม่ผ่านรหัสเชิญของฉัน คุณจะได้รับประสบการณ์ API มูลค่า $2 ทอง • รหัสเชิญ: TUE76X • ลิงค์การลงทะเบียน: https://platform.xiaomimimo.com?ref=tue76x • วิธีการแลกเปลี่ยน: คลิกทางเข้าที่ด้านล่างซ้ายของคอนโซลเพื่อกรอกหลังจากลงทะเบียน และโบนัสประสบการณ์มีอายุ 40 วัน

ทดลองใช้ในเบราว์เซอร์

เลือกโมเดล วางคีย์ฟรีของคุณเอง แล้วรันได้เลย คีย์ของคุณถูกส่งเพียงครั้งเดียวเพื่อเรียกผู้ให้บริการ และจะไม่ถูกเก็บไว้บนเซิร์ฟเวอร์ของเรา

เลือกโมเดล วางคีย์ฟรีของคุณเอง แล้วรันได้เลย คีย์ของคุณถูกส่งเพียงครั้งเดียวเพื่อเรียกผู้ให้บริการ และจะไม่ถูกเก็บไว้บนเซิร์ฟเวอร์ของเรา

ตัวอย่างโค้ด

python
import os
from openai import OpenAI
import base64

client = OpenAI(
    api_key=os.environ.get("MIMO_API_KEY"),
    base_url="https://api.xiaomimimo.com/v1"
)

completion = client.chat.completions.create(
    model="mimo-v2.5-tts-voicedesign",
    messages=[
        {
            "role": "user", 
            "content": "A deep, gravelly middle-aged male voice with a heavy accent, sounding blunt and matter-of-fact."
        },
        {
            "role": "assistant", 
            "content": "I don't have time for games. Tell me what you know, or leave."
        }
    ],
    audio={ "format": "wav" }
)

audio_bytes = base64.b64decode(completion.choices[0].message.audio.data)
with open("designed_output.wav", "wb") as f:
    f.write(audio_bytes)

ความคิดเห็นจากชุมชน

ความคิดเห็นผูกกับบัญชี GitHub ของคุณ — เข้าสู่ระบบเพื่อร่วมพูดคุย