پرش به محتوا

ساخت موسیقی

ساخت قطعهٔ موسیقی با Lyria از روی توصیف: کلیپ کوتاه یا آهنگ کامل، قطعهٔ بی‌کلام یا با کلام، ذخیرهٔ فایل MP3 و قیمت هر قطعه.

بازبینی: ۸ مهر ۱۴۰۵ ۴ دقیقه مطالعه

با POST /audio/music از روی یک توصیف متنی قطعهٔ موسیقی می‌سازید: موسیقی پس‌زمینهٔ ویدیو، جینگل تبلیغ، قطعهٔ بی‌کلام برای پادکست یا آهنگ با کلام. پاسخ یک فایل کامل MP3 است که یک‌جا می‌رسد؛ نیمهٔ یک آهنگ به کاری نمی‌آید، پس این endpoint جریانی نیست.

POSThttps://gisoo.pro/api/v1/audio/music

نمونه#

curl https://gisoo.pro/api/v1/audio/music \
  -H "Authorization: Bearer $GISOO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openrouter/google/lyria-3-clip-preview",
    "prompt": "Calm lo-fi piano with soft rain in the background, slow tempo, no vocals"
  }' | jq -r '.data[0].b64_json' | base64 --decode > calm.mp3
JSON پاسخ
{
  "id": "req_2f8a91c4b7e0d3a6c5f1e2b9",
  "object": "music.generation",
  "created": 1790000000,
  "model": "openrouter/google/lyria-3-clip-preview",
  "text": "<instrumental>",
  "data": [
    { "b64_json": "SUQzBAAAAAAA…", "format": "mp3", "bytes": 744608 }
  ]
}
  • data[0].b64_json خود فایل است؛ decode و ذخیره کنید. format قالب فایل و bytes حجم آن است.
  • text برچسبی مثل <instrumental> برای قطعهٔ بی‌کلام، یا متنی که مدل خوانده است.
  • SDK رسمی OpenAI متدی برای این endpoint ندارد؛ با یک درخواست HTTP معمولی (مثل نمونه‌ها) صدایش بزنید.

دو مدل: کلیپ و آهنگ کامل#

modelخروجیقیمت هر قطعه (دلار)
openrouter/google/lyria-3-clip-preview کلیپ کوتاه، تا حدود ۳۰ ثانیه $0.056
openrouter/google/lyria-3-pro-preview آهنگ کامل $0.112
lyria-3.5 آهنگ کامل $0.112
lyria-3-clip-preview کلیپ کوتاه، تا حدود ۳۰ ثانیه $0.056
lyria-3-pro-preview آهنگ کامل $0.112

قیمت به‌ازای هر قطعه است، نه توکن؛ طول توصیف روی آن اثری ندارد. برای آزمودن ایده‌ها از openrouter/google/lyria-3-clip-preview شروع کنید.

پارامترها#

model string الزامی
مدل موسیقی؛ از GET /models?type=music.
prompt string الزامی
توصیف قطعه، حداکثر ۴٬۰۰۰ نویسه. برای آهنگ با کلام، متن شعر را هم بنویسید.
temperature، top_p، seed number
تنوع خروجی؛ با seed ثابت، نتیجه‌ها به هم نزدیک‌ترند.

آهنگ با کلام#

سبک، ساز، سرعت (bpm) و نوع صدا را بنویسید و بعد متن شعر را با برچسب بخش‌ها ([Verse]، [Chorus]) بیاورید:

Python متن آهنگ در prompt
track = requests.post(
    "https://gisoo.pro/api/v1/audio/music",
    headers={"Authorization": f"Bearer {os.environ['GISOO_API_KEY']}"},
    timeout=120,
    json={
        "model": "openrouter/google/lyria-3-pro-preview",
        "prompt": (
            "Warm Persian pop ballad, female vocal, acoustic guitar and soft strings, 90 bpm.\n"
            "Lyrics:\n"
            "[Verse] The city sleeps, the tea is warm...\n"
            "[Chorus] Stay a little longer..."
        ),
    },
).json()
کلام فارسی

مدل متن فارسی را می‌پذیرد، ولی تلفظ و وزن آواز فارسی هنوز به خوبی انگلیسی نیست. پیش از استفادهٔ جدی، چند نسخه بسازید و آن را که بیشتر می‌پسندید نگه دارید.

نکته‌ها#

  • کلیپ کوتاه معمولاً در چند ثانیه آماده می‌شود، ولی آهنگ کامل ممکن است تا حدود یک دقیقه و نیم طول بکشد؛ زمان انتظار کلاینت HTTP را دست‌کم ۱۲۰ ثانیه بگذارید.
  • اگر ساخت قطعه ناموفق باشد یا فایلی برنگردد، هزینه‌ای کم نمی‌شود.
  • مدل‌های موسیقی را به /chat/completions نفرستید؛ خطای model_endpoint_mismatch می‌گیرید.
  • حق استفاده از خروجی تابع شرایط سازندهٔ مدل است؛ برای استفادهٔ تجاری، شرایط همان سازنده را بخوانید.

پاسخ پرسشتان را پیدا نکردید؟

شناسهٔ درخواست (هدر X-Request-Id) را با پرسشتان در تیکت بفرستید تا دقیق بررسی کنیم.

تیکت پشتیبانی