ข้ามไปยังเนื้อหาหลัก
เกี่ยวกับเรา

เกี่ยวกับ StemSplit

ทำให้การแยกเสียงระดับมืออาชีพเข้าถึงได้สำหรับทุกคน

ภารกิจของเรา

เราเชื่อว่าทุกคนควรมีสิทธิ์เข้าถึงเครื่องมือเสียงระดับมืออาชีพ ไม่ว่าคุณจะเป็นโปรดิวเซอร์มือใหม่ คนรักคาราโอเกะ หรือครีเอเตอร์ StemSplit ให้ผลลัพธ์คุณภาพสตูดิโอโดยไม่ต้องมีงบประมาณสตูดิโอ เรากำลังพัฒนาอย่างเปิดเผย และคำแนะนำของคุณกำหนดแผนงานของเราโดยตรง

เราให้บริการใคร

  • โปรดิวเซอร์เพลงและ DJ
  • คนรักคาราโอเกะ
  • ครีเอเตอร์และ YouTuber
  • พอดแคสเตอร์และนักตัดต่อเสียง
  • ครูสอนดนตรีและนักเรียน
  • นักพัฒนาที่สร้างแอปเสียง
เบื้องหลังระบบ

สร้างบนเทคโนโลยีจริงจัง

StemSplit ใช้ HTDemucs — โมเดลไฮบริดทรานส์ฟอร์เมอร์ล่าสุดที่ Meta Research พัฒนาและเผยแพร่ที่ NeurIPS 2022 เป็นโมเดลเดียวกับที่นักวิจัยใช้ เปิดให้เข้าถึงผ่านอินเทอร์เฟซเว็บที่สะอาด

โมเดล HTDemucs

HTDemucs เป็นโมเดลไฮบริดทรานส์ฟอร์เมอร์/คอนโวลูชันที่ทำงานทั้งในโดเมนเวฟฟอร์มและสเปกโตรแกรมพร้อมกัน แนวทางสองโดเมนนี้ทำให้แม่นยำกว่าโมเดล CNN อย่างเดียวรุ่นเก่าอย่าง Demucs v3 หรือ Spleeter

ส่งออก ONNX

เราส่งออกโมเดลเป็นรูปแบบ ONNX — มาตรฐานเปิดสำหรับทำงานร่วมกันของแมชชีนเลิร์นนิง ทำให้โมเดลรันได้โดยไม่ต้องมี PyTorch เบากว่า เร็วกว่า และพกพาง่าย เราเผยแพร่ค่าน้ำหนัก ONNX บน HuggingFace ให้ใครก็ใช้ได้

สูงสุด 6 stem

โหมดมาตรฐานแยกเสียงเป็นเสียงร้อง กลอง เบส และอื่นๆ โมเดล 6 stem แยกกีตาร์และเปียโนเพิ่มด้วย รุ่นปรับละเอียด (htdemucs_ft) มีให้สำหรับดึง stem เดียวให้แม่นยำขึ้น

ไม่ต้องมี GPU

การประมวลผลทั้งหมดอยู่ในคลาวด์ อัปโหลดไฟล์ เรารันอินเฟอเรนซ์ฝั่งเซิร์ฟเวอร์ แล้วดาวน์โหลด stem ที่แยกแล้ว ไม่ต้องติดตั้งซอฟต์แวร์ ไม่ต้องมี GPU ฝั่งคุณ

เรื่องราว

ใครสร้างสิ่งนี้

StemSplit สร้างโดยนักพัฒนาคนเดียวที่เจอความหงุดหงิดเดิมซ้ำๆ เครื่องมือลบเสียงร้องที่มีอยู่ถูกซ่อนหลังสมาชิกรายเดือนที่ลืมยกเลิก หรือใช้เครดิตที่หมดอายุก่อนจะได้ใช้ใหม่

เป้าหมายเรียบง่าย — สร้างเครื่องมือที่ควรมีอยู่แล้ว จ่ายราคาที่เป็นธรรมตามที่ใช้จริง ยอดคงเหลือไม่มีวันหมดอายุ และคุณภาพดีพอจนไม่ต้องลองสามบริการ

เป็นผลิตภัณฑ์อินดี้ ไม่มีเงิน VC ไม่มีทีมโกรท ไม่มีสายขาย มีแค่เครื่องมือที่ใช้ได้ ราคาตรงไปตรงมา ดูแลโดยคนเดียวที่ก็ใช้เอง แผนงานขับเคลื่อนโดยผู้ใช้ — ถ้ามีข้อเสนอ จะได้อ่านจริง

พัฒนาแบบเปิดเผย

การพัฒนาเกิดขึ้นอย่างเปิดเผย แพ็กเกจเผยแพร่บน GitHub, PyPI, npm และ HuggingFace วิธีทำเบนช์มาร์กเป็นสาธารณะ พังเมื่อไหร่ก็แก้ และเห็นการแก้ได้

ระบบนิเวศ

มากกว่าเว็บไซต์

StemSplit เป็นแพลตฟอร์มสำหรับนักพัฒนาด้วย เอนจินแยกเสียงชุดเดียวกับที่ขับเว็บแอป มีให้ผ่านหลายช่องทางแจกจ่าย

REST API

เข้าถึงการแยก stem แบบโปรแกรมได้เต็มที่ ส่งงาน เช็กสถานะ ดาวน์โหลดผลลัพธ์ นักพัฒนาที่สร้างเครื่องมือของตัวเองบน StemSplit ใช้ช่องทางนี้

แพ็กเกจ Python

stemsplit-python บน PyPI แยกเสียงในเครื่องหรือเรียก API จากสคริปต์ Python และไพพ์ไลน์ข้อมูล

เครื่องมือ CLI

stemsplit ผ่าน Homebrew แยกไฟล์เสียงจากเทอร์มินัลด้วยคำสั่งเดียว เหมาะกับงานชุดและสคริปต์เชลล์

โหนด n8n

n8n-nodes-stemsplit บน npm ลากวางการแยก stem ในเวิร์กโฟลว์อัตโนมัติของ n8n — ไม่ต้องเขียนโค้ด

เซิร์ฟเวอร์ MCP

stemsplit-mcp บน npm เปิดการแยก stem เป็นเครื่องมือที่เอเจนต์ AI (Claude, GPT ฯลฯ) เรียกตรงผ่าน Model Context Protocol

การเชื่อมต่อ Zapier

เชื่อม StemSplit กับแอปนับพันผ่าน Zapier สั่งแยกเสียงจากการอัปโหลด Google Drive อีเมลใหม่ การส่งฟอร์ม และอื่นๆ

งานวิจัยและเบนช์มาร์ก

วิธีประเมินแบบเปิด

เราสร้างและเผยแพร่ชุดข้อมูลเบนช์มาร์กบน HuggingFace ที่ประเมินหลายรุ่นของ HTDemucs กับแทร็กเพลงจริง การประเมินใช้ Signal-to-Distortion Ratio (SDR) — ตัวชี้วัดวิชาการมาตรฐานของคุณภาพการแยกแหล่งเสียง — พร้อมการฟังทดสอบข้ามแนวเพลงและประเภท stem

ดูชุดข้อมูลเบนช์มาร์กบน HuggingFace

Evaluation metric

SDR คืออะไร?

SDR (Signal-to-Distortion Ratio) วัดว่าโมเดลแยกแหล่งเป้าหมายออกจากมิกซ์ได้สะอาดแค่ไหน เป็นเดซิเบล ยิ่งสูงยิ่งดี เป็นตัวชี้วัดเดียวกับเบนช์มาร์ก SiSEC Music Separation ซึ่งเป็นการประเมินวิชาการมาตรฐานของปัญหานี้

Typical SDR scores (HTDemucs)

Vocals~9 dB
Drums~8.5 dB
Bass~8 dB
Other~6 dB

Source: StemSplit benchmark dataset on HuggingFace. Higher SDR = cleaner separation.

ปรัชญาการคิดราคา

ทำไมคิดเงินแบบนี้

เครื่องมือเสียงส่วนใหญ่ใช้สมาชิกเพราะดีต่อธุรกิจ — ได้รายได้คาดการณ์ได้แม้จากคนที่แทบไม่เข้าใช้งาน เราไม่อยากทำงานแบบนั้น

StemSplit ใช้เครดิตจ่ายตามใช้ ซื้อนาทีประมวลผลแล้วไม่มีวันหมดอายุ แยกเพลงเดือนละหนึ่งเพลงก็จ่ายหนึ่งเพลง ประมวลผลทั้งอัลบั้มก็จ่ายเท่านั้น ไม่มีแพ็กเกจที่ต้องอัปเกรด ไม่มีฟีเจอร์ที่ล็อกไว้หลังระดับแพงกว่า

ระดับฟรีให้ผู้ใช้ใหม่ทุกคน 5 นาทีเพื่อลองสินค้าจริง — ไม่ใช่พรีวิวติดลายน้ำหรือคลิป 30 วินาที ห้านาทีเต็มของผลลัพธ์จริง

How it works

  • เครดิตไม่มีวันหมดอายุ — จริงๆ
  • ไม่ต้องสมัครสมาชิก
  • 5 นาทีฟรีเมื่อสมัคร ไม่ต้องใช้บัตร
  • คุณภาพเดียวกันทุกช่วงราคา
  • เข้าถึง API เต็มรูปแบบรวมอยู่แล้ว

สิ่งที่เราเชื่อ

ความเรียบง่ายมาก่อน

เทคโนโลยีซับซ้อนควรใช้งานง่าย อัปโหลด ประมวลผล ดาวน์โหลด — แค่นั้น

ราคาโปร่งใส

ไม่ต้องสมัครสมาชิก เครดิตไม่หมดอายุ จ่ายเฉพาะที่คุณใช้ เมื่อคุณใช้

พัฒนาอย่างเปิดเผย

เรากำลังพัฒนาอย่างเปิดเผยร่วมกับชุมชนของเรา คำแนะนำและความคิดเห็นของคุณไม่เพียงถูกรับฟัง — มันคือแผนงานของเรา

คำถามที่พบบ่อย

พร้อมลองแล้วหรือยัง?

ดูว่าทำไมผู้ใช้หลายพันคนเลือก StemSplit