PATIPHAN DEV
หน้าแรกบริการคอร์สเรียนผลงานสินค้าบทความเกี่ยวกับผมติดต่อ
เข้าสู่ระบบ
← กลับไปหน้าบทความ
0 เข้าชม

Fish Audio เปิดโมเดลเสียงบน Vercel AI Gateway ฟรี!

โมเดลเสียงจาก Fish Audio เปิดให้ใช้งานฟรีบน AI Gateway ของ Vercel ในช่วงเปิดตัวนี้ เหมาะสำหรับนักพัฒนาที่ต้องการทดลองสร้างสรรค์ผลงานด้วยเสียง

โอกาสสำรวจเทคโนโลยีเสียงใหม่

ปัจจุบันเทคโนโลยีการแปลงข้อความเป็นเสียง (Text-to-Speech) และแปลงเสียงเป็นข้อความ (Speech-to-Text) กำลังเข้ามามีบทบาทมากขึ้นในหลายด้าน และตอนนี้ Fish Audio ก็ได้เปิดโอกาสให้ทดลองใช้งานโมเดลเสียงของพวกเขาบน Vercel AI Gateway ได้ฟรี! ช่วงเวลาในการทดลองนี้มีไปจนถึงวันที่ 18 กันยายน 2023 ซึ่งเป็นโอกาสที่นักพัฒนาไทยไม่ควรพลาด

รายละเอียดของการเปิดให้ใช้งานฟรี

Fish Audio ได้ปล่อยโมเดลเสียงสี่โมเดลให้ใช้งานบน AI Gateway ของ Vercel โดยไม่มีค่าบริการในช่วงเวลานี้ ซึ่งรวมถึงโมเดลล่าสุดของพวกเขา ได้แก่:

  • fish-audio/s2.1-pro: โมเดล Text-to-Speech สำหรับการสตรีมที่มีความหน่วงต่ำ สามารถทำการจำลองเสียงจากการอัดเสียงต้นแบบ
  • fish-audio/transcribe-1: โมเดลสำหรับ Transcription ที่สามารถแปลงเสียงเป็นข้อความ พร้อมแสดงเวลาเริ่มต้นและสิ้นสุดของแต่ละคำ
  • fish-audio/s2-pro: รองรับภาษาประมาณ 80 ภาษา และสามารถนำแท็กไปใช้ในเนื้อหาการแปลงเสียงได้ด้วยคำอธิบายที่เข้าใจง่าย
  • fish-audio/s1: โมเดลอ่านข้อความที่สามารถสื่อสารด้วยอารมณ์ โทนเสียง และเอฟเฟกต์เสียง

ความสำคัญสำหรับนักพัฒนาไทย

สำหรับนักพัฒนาที่มุ่งเน้นการสร้างแอปพลิเคชันหรือเนื้อหาที่ใช้งานเสียง การใช้โมเดลเสียงจาก Fish Audio จะเปิดโอกาสให้ได้รับรู้ศักยภาพของ AI ในการสร้างเสียงที่สมจริงและมีอารมณ์ ซึ่งอาจช่วยในการเพิ่มขีดความสามารถในโปรเจ็กต์ของคุณ และเป็นการเตรียมความพร้อมในยุคที่เสียงมีความสำคัญมากขึ้น

วิธีทดลองใช้โมเดลเสียง

นักพัฒนาที่พร้อมจะเริ่มต้นสามารถใช้โมเดลได้โดยการติดตั้ง AI SDK:

npm install ai@latest @ai-sdk/gateway@latest

โมเดล Text-to-Speech สามารถเริ่มสร้างเสียงได้ด้วยโค้ดอย่างง่าย:

import { experimental_generateSpeech as generateSpeech } from 'ai' ;
import { writeFile } from 'node:fs/promises' ;

const result = await generateSpeech ({
 model : 'fish-audio/s2.1-pro' ,
 text : 'How are you doing today?' ,
}) ;
await writeFile ('speech.mp3' , result . audio . uint8Array) ;

ส่วนโมเดล Speech-to-Text สามารถแปลงเสียงที่มีเป็นข้อความได้เช่นกัน:

import { experimental_transcribe as transcribe } from 'ai' ;
import { readFile } from 'node:fs/promises' ;

const result = await transcribe ({
 model : 'fish-audio/transcribe-1' ,
 audio : await readFile ('audio.mp3') ,
}) ;
console . log (result . text) ;
console . log (result . segments) ;

หากต้องการลองใช้โมเดลเสียงโดยไม่ต้องเขียนโค้ด คุณสามารถเปิดหน้าเว็บที่ป้อนข้อมูลทดสอบแล้วดูผลลัพธ์ได้ทันทีจากเบราว์เซอร์

สรุป

โอกาสนี้เป็นทางเลือกที่ยอดเยี่ยมในการสำรวจศักยภาพของเทคโนโลยีเสียงจาก Fish Audio อย่าลืมปรับชื่อโมเดลเป็นรูปแบบ -free หากไม่อยากให้มีการคิดค่าใช้จ่ายหลังหมดช่วงฟรี

ที่มา: Vercel

บทความที่น่าสนใจ

3 เข้าชม

Qwen 3.8 Max พร้อมใช้งานบน Vercel AI Gateway แล้ว

Qwen 3.8 Max นำความสามารถด้าน text-only และ vision-language มาบูรณาการในโมเดลเดียว เปิดใช้งานสำหรับนักพัฒนาแล้วบน Vercel AI Gateway

อ่านต่อ →
2 เข้าชม

Exa web search ใช้งานฟรีบน AI Gateway และ eve จนถึงสิ้นเดือนสิงหาคม

Exa web search เปิดให้ใช้งานฟรีบน AI Gateway จนถึงวันที่ 31 สิงหาคมนี้ พร้อมรองรับการค้นหาสำหรับ eve agents เป็นค่าเริ่มต้น

อ่านต่อ →
0 เข้าชม

ไมโครซอฟท์รวม Copilot และ Microsoft 365 Copilot เป็นแอพเดียว

ไมโครซอฟท์ตัดสินใจรวมแอพ Copilot ทั้งสองเป็นแอพเดียว เพื่อสร้างความสะดวกให้กับผู้ใช้ทุกกลุ่ม ตั้งแต่พนักงานองค์กรไปจนถึงผู้ใช้ทั่วไป

อ่านต่อ →