TH ▾

Uncensored Gemma: คู่มือการผสานรวมสำหรับนักพัฒนา

อัปเดต

Uncensored Gemma หมายถึงโมเดลภาษาขนาดใหญ่แบบ open-weight ที่ปรับให้เหมาะสมสำหรับการสร้างข้อความที่มีความละเอียดสูงและมีการปฏิเสธต่ำ เข้าถึงผ่านอินเทอร์เฟซ chat-completions มาตรฐาน คู่มือนี้อธิบายวิธีการผสานรวม API ที่รองรับเฉพาะข้อความนี้ลงในเวิร์กโฟลว์ของคุณ โดยถือเป็นตัวเลือกแทนที่แบบ drop-in สำหรับไคลเอนต์ที่เข้ากันได้กับ OpenAI ขณะเดียวกันก็เข้าใจข้อจำกัดของโทเคนและโครงสร้างราคาที่เกี่ยวข้อง

ทำไมต้องเลือก Uncensored Gemma?

เมื่อนักพัฒนาแสวงหาประสบการณ์แบบ uncensored gemma พวกเขามักมองหาโมเดลที่หลีกเลี่ยงตัวกรองความปลอดภัยที่พบในการนำเสนอเชิงพาณิชย์ API นี้ให้โมเดลความจุสูงตัวเดียวที่ปรับให้ตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย การวิจัยความปลอดภัย หรือหัวข้อที่ถกเถียงกัน ต่างจากแพลตฟอร์มที่รวมผู้ขายหลายราย บริการนี้มุ่งเน้นไปที่โมเดล open-weight เฉพาะตัวหนึ่งเพื่อรับประกันพฤติกรรมที่สอดคล้องกันและเวลาแฝงที่คาดการณ์ได้

โมเดลไม่ปฏิเสธพรอมต์เชิงสร้างสรรค์หรือเชิงวิเคราะห์มาตรฐาน ทำให้เหมาะสำหรับการสร้างสไตล์เนื้อหาที่หลากหลาย อย่างไรก็ตาม ควรสังเกตว่าเป็นโมเดล open-weight ที่เป็นอิสระ ไม่ใช่ Google's Gemma และไม่เกี่ยวข้องกับ Grok ของ xAI มันทำงานบนเซิร์ฟเวอร์เฉพาะและให้บริการข้อความเข้าและข้อความออก ให้สภาพแวดล้อมที่สะอาดและคาดการณ์ได้สำหรับนักพัฒนาที่ต้องการผลลัพธ์โมเดลดิบโดยไม่ต้องมีโอเวอร์เฮดของการกำหนดเส้นทางหลายโมเดล

ภาพรวมความเข้ากันได้ของ API

API เข้ากันได้กับ OpenAI อย่างสมบูรณ์ หมายความว่าคุณสามารถใช้ SDK ทางการของ OpenAI หรือไคลเอนต์อื่นๆ ที่รองรับโปรโตคอล OpenAI ได้ คุณเพียงแค่ต้องอัปเดต base_url และระบุคีย์ API ของคุณ โครงสร้างเอนด์พอยต์สะท้อนอินเทอร์เฟซการสร้างข้อความแชทมาตรฐาน ทำให้การย้ายจากผู้ให้บริการรายอื่นเป็นเรื่องง่าย

  • เอนด์พอยต์: มีเพียง POST /v1/chat/completions และ GET /v1/models เท่านั้นที่มีให้บริการ
  • ไม่มีฟีเจอร์เพิ่มเติม: ไม่มีเอนด์พอยต์ embeddings การสร้างภาพ การประมวลผลเสียง หรือ fine-tuning
  • Base URL: https://api.grokuncensored.cc/v1
  • Model ID: ใช้ uncensored เป็นตัวระบุโมเดล

ความเรียบง่ายนี้ลดความซับซ้อนของการผสานรวม คุณไม่จำเป็นต้องจัดการสคีมาการตอบกลับที่แตกต่างกันสำหรับฟีเจอร์ต่างๆ รูปแบบการตอบกลับจะสม่ำเสมอ โดยส่งคืนเนื้อหาข้อความและสถิติการใช้งานโทเคน

การตั้งค่าสภาพแวดล้อม

การผสานรวมเริ่มต้นด้วยการรับคีย์ API สมัครสมาชิกผ่านหน้า รับคีย์ API โดยใช้การตรวจสอบสิทธิ์ของ Google หรืออีเมลและรหัสผ่าน คีย์จะแสดงทันทีและไม่จำเป็นต้องใช้หมายเลขโทรศัพท์ กระบวนการนี้ได้รับการออกแบบมาเพื่อความเร็ว ทำให้คุณสามารถเริ่มทดสอบได้ภายในไม่กี่นาที

เมื่อคุณมีคีย์แล้ว ให้กำหนดตัวแปรสภาพแวดล้อมของคุณ ตัวอย่างเช่น ใน Python:

ตรวจสอบให้แน่ใจว่า base URL ของคุณชี้ไปที่ https://api.grokuncensored.cc/v1 คุณยังสามารถใช้ประโยชน์จากเครดิตทดลองใช้ ซึ่งให้ $0.50 ที่มีอายุ 7 วัน โดยไม่ต้องใช้บัตรเครดิต สิ่งนี้ช่วยให้คุณตรวจสอบการเชื่อมต่อและคุณภาพการตอบกลับก่อนตัดสินใจเติมเงินด้วยคริปโต

การทำคำขอครั้งแรก

เมื่อตั้งค่าสภาพแวดล้อมของคุณแล้ว คุณสามารถส่งคำขอได้ API รับอาร์เรย์ข้อความมาตรฐาน นี่คือตัวอย่างพื้นฐานโดยใช้ cURL:

curl https://api.grokuncensored.cc/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

การตอบกลับจะประกอบด้วยข้อความที่สร้างและการใช้งานโทเคน หากคุณตั้งค่า max_tokens เป็นค่า API จะเคารพขีดจำกัดนั้น หากคุณไม่ได้ตั้งค่า max_tokens ค่าสูงสุดเริ่มต้นสำหรับการสร้างข้อความคือ 2,048 โทเคน สำหรับการสร้างข้อความที่ยาวขึ้น คุณสามารถเพิ่มค่านี้ได้สูงสุด 32,000 โทเคน โดยที่บริบททั้งหมด (พรอมต์ + การสร้างข้อความ) ยังคงอยู่ในหน้าต่าง 100,000 โทเคน

การจัดการการตอบกลับและโทเคน

การตอบกลับจะถูกส่งกลับในรูปแบบ JSON มาตรฐาน การใช้งานโทเคนจะถูกรวมอยู่ในชิ้นสุดท้ายของการตอบกลับแบบสตรีมมิง ทำให้คุณสามารถติดตามต้นทุนแบบเรียลไทม์ได้ ราคาโปร่งใส: $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต ข้อผิดพลาดและการปฏิเสธเป็นฟรี ดังนั้นคุณสามารถทดลองได้โดยไม่ต้องกังวลเกี่ยวกับการสูญเสียเครดิต

เมื่อใช้สตรีมมิง ให้แน่ใจว่าไคลเอนต์ของคุณจัดการ Server-Sent Events (SSE) ได้ถูกต้อง API ส่งคืนชิ้นข้อความ และชิ้นสุดท้ายมีฟิลด์ usage ซึ่งทำให้สามารถตรวจสอบการเรียกเก็บเงินได้อย่างแม่นยำ โปรดทราบว่าเครดิตเป็นแบบเติมเงินล่วงหน้า และข้อผิดพลาดจะไม่หักจากยอดคงเหลือ โมเดลนี้ไม่ใช่บริการ embeddings ดังนั้นคุณไม่สามารถใช้สำหรับการค้นหาเวกเตอร์โดยตรงได้ คุณต้องจัดการการสร้าง embeddings แยกหากจำเป็น

พารามิเตอร์ขั้นสูง

API รองรับพารามิเตอร์หลายตัวเพื่อควบคุมคุณภาพการสร้าง คุณสามารถปรับ temperature เพื่อความคิดสร้างสรรค์ top_p เพื่อการสุ่มตัวอย่างนิวเคลียส และ seed เพื่อความสามารถในการทำซ้ำ พารามิเตอร์อื่นๆ ที่รองรับรวมถึง stop presence_penalty และ frequency_penalty

รองรับการเรียกใช้ฟังก์ชันผ่านฟิลด์ tools และ tool_choice ซึ่งช่วยให้โมเดลสร้างผลลัพธ์ที่มีโครงสร้างซึ่งแอปพลิเคชันของคุณสามารถนำไปประมวลผลต่อได้ นอกจากนี้ยังมีโหมด JSON ผ่าน response_format: {"type": "json_object"} เพื่อให้ผลลัพธ์เป็น JSON ที่ถูกต้อง มีประโยชน์สำหรับการสร้างเอเจนต์หรือสายงานข้อมูลที่มีโครงสร้าง โมเดลเป็นโมเดลแบบเปิดน้ำหนัก ที่ปรับแต่งมาสำหรับการสร้างข้อความคุณภาพสูง ทำให้เหมาะสำหรับการปฏิบัติตามคำสั่งที่ซับซ้อน

การจัดการข้อผิดพลาด

ข้อผิดพลาดจะถูกส่งกลับในรหัสสถานะ HTTP มาตรฐาน ข้อผิดพลาดทั่วไปรวมถึงขีดจำกัดอัตรา (429) หรือคีย์ API ไม่ถูกต้อง (401) ขีดจำกัดอัตราถูกตั้งค่าไว้ที่ 300 คำขอต่อนาทีและ 8 คำขอพร้อมกันต่อคีย์ หากคุณถึงขีดจำกัดเหล่านี้ ให้ใช้การหน่วงเวลาแบบเอกซ์โพเนนเชียลในไคลเอนต์ของคุณ

body ของคำขอมีขนาดจำกัดที่ 8 MB หากเกินกว่านี้ คำขอจะถูกปฏิเสธ ตรวจสอบให้แน่ใจว่าพรอมต์ของคุณอยู่ในขอบเขตนี้ เนื่องจาก API ใช้เฉพาะข้อความ ข้อผิดพลาดที่เกี่ยวข้องกับการประมวลผลสื่อจะไม่เกิดขึ้น สำหรับข้อผิดพลาดด้านการเรียกเก็บเงิน เช่น เครดิตไม่เพียงพอ API จะส่งสถานะ 402 กลับมา เครดิตไม่หมดอายุ ดังนั้นคุณสามารถเติมเงินได้ตามความสะดวก ข้อผิดพลาดเช่นการเรียกเก็บเงินซ้ำสามารถแก้ไขได้ผ่านหน้า Support เนื่องจากเครดิตไม่คืนเงินอัตโนมัติ

การเปรียบเทียบกับ Grok Uncensored

แม้ว่าจะมักถูกกล่าวถึงร่วมกับโมเดลไม่เซ็นเซอร์อื่นๆ เช่น grok uncensored แต่ API นี้เป็นบริการที่เป็นอิสระ ไม่ให้บริการ Google's Gemma และไม่ใช่ API ของ Grok อย่างเป็นทางการจาก xAI คำว่า uncensored gemma ในผลการค้นหา มักหมายถึงพฤติกรรมของโมเดลแบบเปิดน้ำหนัก ซึ่ง API นี้เลียนแบบได้อย่างใกล้ชิด อย่างไรก็ตาม รหัสโมเดลคือ uncensored และไม่ได้ผูกติดกับสถาปัตยกรรมของ Google

ต่างจาก API ของ Grok ทางการซึ่งอาจมีราคาและขีดจำกัดที่แตกต่างกัน API นี้มีอัตราราคาคงที่ที่ $0.25/$1.00 ต่อหนึ่งล้านโทเคน นอกจากนี้ยังรองรับการชำระเงินด้วยคริปโตเท่านั้น โดยไม่ต้องใช้บัตรเครดิตสำหรับการทดลองใช้ ทำให้เป็นทางเลือกที่ยืดหยุ่นสำหรับนักพัฒนาที่ชื่นชอบคริปโตหรือต้องการหลีกเลี่ยงการผูกมัดแบบสมาชิก โมเดลนี้ไม่ใช่ผู้ขายต่อของ Grok แต่เป็นโมเดลแบบเปิดน้ำหนักที่เป็นเอกลักษณ์

สรุป

API นี้ให้ส่วนติดต่อที่แข็งแกร่งและเน้นนักพัฒนาสำหรับโมเดลแบบเปิดน้ำหนักที่ไม่เซ็นเซอร์ โดยยึดตามโปรโตคอลที่เข้ากันได้กับ OpenAI ทำให้สามารถผสานรวมเข้ากับเวิร์กโฟลว์ที่มีอยู่ได้อย่างราบรื่น ราคาโปร่งใส และขีดจำกัดเอื้อต่อการใช้งานส่วนใหญ่ ไม่ว่าคุณกำลังสร้างแชทบอท เอเจนต์ หรือเครื่องมือสร้างเนื้อหา API นี้เป็นทางเลือกที่ไม่เซ็นเซอร์ที่เชื่อถือได้ โปรดจำไว้ว่าเป็น API แบบข้อความล้วน ดังนั้นควรออกแบบสถาปัตยกรรมของคุณให้สอดคล้องกัน สำหรับรายละเอียดเพิ่มเติมเกี่ยวกับราคาและคีย์ โปรดเยี่ยมชมหน้าที่เกี่ยวข้องในเว็บไซต์

ถาม-ตอบ

API นี้เหมือนกับ Google's Gemma หรือไม่

ไม่ API นี้ให้บริการโมเดลแบบเปิดน้ำหนักที่เป็นอิสระ ไม่ใช่ Google's Gemma และไม่ได้ผูกติดกับสถาปัตยกรรมของ Google คำว่า 'uncensored gemma' มักหมายถึงพฤติกรรมของโมเดล แต่รหัสโมเดลคือ 'uncensored' อย่างเดียว

ฉันจะชำระเงินสำหรับ API ได้อย่างไร

รับชำระเงินผ่านคริปโตเท่านั้น โดยเฉพาะ USDT (TRC20) หรือ USDC (Base) คุณสามารถเติมเงินด้วยจำนวนเต็มใดๆ ระหว่าง $10 ถึง $500 ไม่มีตัวเลือกบัตรเครดิตหรือ PayPal มีเครดิตทดลองใช้ $0.50 โดยไม่ต้องใช้บัตร

ขีดจำกัดของหน้าต่างบริบทคือเท่าใด?

หน้าต่างบริบทรองรับ 100,000 โทเคน ซึ่งรวมถึงทั้งพรอมต์และการสร้างผลลัพธ์ ขีดจำกัดสูงสุดต่อคำขอคือ 32,000 โทเคน หรือ 2,048 โทเคนหากไม่ได้ระบุค่า max_tokens

API รองรับ function calling หรือไม่?

ใช่ API รองรับ function calling ผ่านพารามิเตอร์ 'tools' และ 'tool_choice' นอกจากนี้ยังรองรับโหมด JSON สำหรับผลลัพธ์ที่มีโครงสร้าง การสตรีมมิงรองรับผ่าน SSE โดยจะรายงานการใช้งานโทเคนในชิ้นข้อมูลสุดท้าย

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ และเปลี่ยน base URL เพียงเท่านี้ก็พร้อมใช้งาน

รับคีย์ API