คำถามที่พบบ่อย

คำถามที่ลูกค้าถามเราจริง

รวมถึงคำถามที่คำตอบไม่ได้สวยอย่างที่เราอยากให้เป็น อะไรที่ยังไม่ได้ทำ เราเขียนว่ายังไม่ได้ทำ ไม่ได้เขียนว่ากำลังจะมา

ภาษีและการชำระเงิน

ใช้ LLM API แล้วขอใบกำกับภาษีไทยได้ไหม

ได้ ทุกครั้งที่เติมเงินจะได้ใบกำกับภาษีเต็มรูปแบบเป็นเงินบาท ออกโดย I C Develop Co., Ltd. ซึ่งเป็นบริษัทจดทะเบียนในประเทศไทย นี่คือเหตุผลที่เกตเวย์นี้มีอยู่ เพราะการจ่ายเงินให้ OpenAI, Anthropic หรือ Google โดยตรง คุณจะได้ใบเสร็จจากต่างประเทศที่ฝ่ายบัญชีเอาไปลงบัญชีแบบเดียวกันไม่ได้

ยังต้องยื่น ภ.พ.36 หรือ ภ.ง.ด.54 อยู่ไหม

ไม่ต้อง สำหรับยอดที่ใช้จ่ายกับเรา การซื้อจาก IC Lueur Ai เป็นการซื้อในประเทศจากบริษัทไทย จึงลงเป็นค่าใช้จ่ายได้เต็ม 100% โดยไม่ต้องนำส่ง VAT แทนผู้ประกอบการต่างประเทศ (ภ.พ.36) และไม่ต้องหักนำส่งภาษีให้ผู้รับเงินต่างประเทศ (ภ.ง.ด.54) การจ่ายตรงให้ผู้ให้บริการ AI ต่างประเทศต่างหากที่ทำให้เกิดแบบยื่นเหล่านั้น ข้อความนี้อธิบายโครงสร้างของการซื้อขาย ไม่ใช่คำแนะนำทางภาษี — คนที่เซ็นแบบยื่นคือผู้สอบบัญชีของคุณ ไม่ใช่เรา

จ่ายเงินอย่างไร และมีขั้นต่ำไหม

จ่ายผ่าน PromptPay จากบัญชีธนาคารไทย ขั้นต่ำ ฿300 ต่อการเติมหนึ่งครั้ง ไม่ต้องใช้บัตรเครดิตต่างประเทศ และไม่มีส่วนต่างอัตราแลกเปลี่ยนตอนเติม เครดิตเป็นแบบเติมล่วงหน้าและไม่หมดอายุตามเวลา

มีค่าบริการรายเดือนหรือค่าสมาชิกไหม

ไม่มี มียอดเครดิตเดียวและคิดเงินตามการใช้งานที่วัดได้จริง โดย input, output และ cached token คิดราคาแยกกัน เพราะผู้ให้บริการต้นทางก็คิดแยกกันแบบนั้น ไม่มีแพ็กเกจเป็นชั้น ๆ และไม่คิดตามจำนวนผู้ใช้

ถ้าราคาเปลี่ยน ค่าใช้จ่ายเดิมของเราจะเปลี่ยนไหม

ไม่เปลี่ยน อัตราที่ใช้ ณ ตอนที่คำขอเกิดขึ้นถูกบันทึกไว้กับคำขอนั้น การเปลี่ยนราคาภายหลังจึงไม่คิดราคาใหม่ย้อนหลัง บัญชีแยกประเภทของเราเป็นแบบเพิ่มอย่างเดียว การแก้ไขทำโดยลงรายการกลับรายการใหม่ ไม่ใช่การแก้ประวัติเดิม

ข้อมูล ความเป็นส่วนตัว และที่ตั้งของระบบ

ข้อมูลของเราเก็บอยู่ที่ไหน

อยู่ในประเทศไทย บัญชีผู้ใช้ ยอดเครดิต บัญชีแยกประเภทแบบเพิ่มอย่างเดียว บันทึกการใช้งาน และใบกำกับภาษีของคุณ เก็บอยู่ในภูมิภาค AWS Asia Pacific (Thailand) หรือ ap-southeast-7 ทั้งหมด พร้อมกับตัวเกตเวย์และ control plane เอง

ตัวโมเดล AI ประมวลผลในประเทศไทยหรือเปล่า

ไม่ และตอนนี้ยังไม่มีเจ้าไหนทำได้เช่นกัน ยังไม่มีผู้ให้บริการรายใด — ไม่ว่าจะเป็น AWS Bedrock, Google Vertex AI, Azure AI Foundry หรือรายอื่นในแคตตาล็อกของเรา — ที่เปิดให้บริการโมเดลเหล่านี้จากในประเทศไทย คำขอถูกให้บริการจากภูมิภาคเอเชียของผู้ให้บริการ ส่วนใหญ่คือสิงคโปร์ (ap-southeast-1) และโตเกียว (ap-northeast-1) และบางโมเดลมีให้บริการเฉพาะบนโครงข่ายระดับ global ที่ผู้ให้บริการบริหารเอง รายการของแต่ละโมเดลในแคตตาล็อกระบุภูมิภาคที่ให้บริการไว้ คุณจึงตรวจดูเองได้เป็นรายโมเดล ไม่ต้องเชื่อคำพูดของเรา

เราควบคุมได้ไหมว่าคำขอจะวิ่งไปไกลแค่ไหน

ได้ แต่ละ API key มี routing policy กำกับและถูกบังคับใช้กับทุกคำขอ ไม่ใช่แค่ความต้องการที่ตั้งไว้เฉย ๆ โดย strict จะไม่ออกนอกภูมิภาคที่ใกล้ที่สุดและตอบ 429 พร้อม Retry-After แทนที่จะส่งไปไกลกว่านั้น, regional ซึ่งเป็นค่าเริ่มต้น ยอมให้ overflow ภายในขอบเขตสิงคโปร์–โตเกียว, ส่วน available ต้องเปิดใช้เองและอนุญาตทุกที่ที่มีโมเดลให้บริการ รายละเอียดดูได้ในหน้าเอกสาร

เก็บ prompt ของเราไหม แล้วเอาไปเทรนโมเดลหรือเปล่า

ไม่ เกตเวย์บันทึกเฉพาะจำนวนโทเคน ค่าใช้จ่าย ชื่อโมเดล ผู้ให้บริการ ภูมิภาค และเวลา ซึ่งเป็นข้อมูลที่จำเป็นต่อการคิดเงินเท่านั้น เนื้อหาของ prompt และคำตอบไม่เคยถูกเขียนลงที่เก็บใด ๆ และไม่เคยอยู่ใน payload ที่ออกนอกโปรเซส และเราไม่ได้นำทราฟฟิกของคุณไปเทรนอะไรทั้งสิ้น ทั้งนี้ผู้ให้บริการต้นทางที่คุณส่งคำขอไปมีเงื่อนไขของเขาเอง ซึ่งเราไม่ได้ไปแทนที่

ทำ API key หาย ขอกู้คืนได้ไหม

ไม่ได้ และเป็นเช่นนั้นโดยตั้งใจ คีย์จะแสดงให้เห็นครั้งเดียวตอนสร้าง และเราเก็บไว้แค่ค่า hash เท่านั้น เราจึงแสดงซ้ำให้ไม่ได้จริง ๆ วิธีแก้คือสร้างคีย์ใหม่แล้วเพิกถอนคีย์เดิม นอกจากนี้พอร์ทัลสมาชิกยังมีการยืนยันตัวตนสองชั้นพร้อมรหัสกู้คืนด้วย

การใช้งาน API

ต้องแก้โค้ดเดิมมากแค่ไหน

แค่ base URL กับ API key เกตเวย์รองรับ OpenAI Chat Completions API ดังนั้น client เดิมที่ใช้อยู่ ไม่ว่าจะเป็น openai-python, openai-node หรือ LangChain — อะไรก็ตามที่ตั้ง base URL ได้ — ใช้งานต่อได้เลย จุดเดียวที่ควรรู้คือรูปแบบ error ของเราตอบกลับเป็น {"detail": "..."} ซึ่งแบนกว่า object error แบบซ้อนของ OpenAI

รองรับ streaming ไหม

รองรับ ใส่ stream: true แล้วอ่าน response เป็น server-sent events รูปแบบเดียวกับที่ OpenAI ใช้ ข้อควรรู้คือโทเคนที่ถูกสร้างไปแล้วก่อนคุณตัดการเชื่อมต่อ ยังถูกคิดเงินตามปกติ คำขอที่ถูกตัดกลางคันจะวัดการใช้งานเหมือนคำขอที่เสร็จสมบูรณ์

เรียกโมเดลอะไรได้บ้าง

ดูได้จากแคตตาล็อกสดในหน้าราคา และเรียก GET /api/models เพื่อรับข้อมูลชุดเดียวกันเป็น JSON ได้โดยไม่ต้องยืนยันตัวตน ครอบคลุมทั้ง Anthropic Claude, OpenAI GPT, Google Gemini, Meta Llama, Mistral, DeepSeek และอื่น ๆ ผ่าน AWS Bedrock, Google Vertex AI, Azure AI Foundry และ Fireworks เราไม่ระบุจำนวนโมเดลตายตัวไว้ตรงนี้ เพราะแคตตาล็อกมีการเปลี่ยนแปลง

ทีมใช้บัญชีเดียวกันได้ไหม

ได้ หนึ่งองค์กรมีสมาชิกได้หลายคน และกำหนดบทบาทให้แต่ละคนได้ — เจ้าของ ผู้ดูแลระบบ หรือสมาชิก — ทุกคนจึงดูยอดเงินและจัดการคีย์ได้โดยไม่ต้องแชร์รหัสผ่านกัน

ข้อจำกัดที่เราพูดตรง ๆ

ถูกกว่าการไปใช้ผู้ให้บริการโดยตรงไหม

ไม่ถูกกว่า เราคิดราคาเท่าต้นทุนผู้ให้บริการบวก margin คงที่ ดังนั้นต่อโทเคนเราแพงกว่าการทำสัญญาตรง ถ้าคุณทำสัญญากับ AWS, Google หรือ Microsoft เองได้ และจัดการเอกสารภาษีบริการต่างประเทศเองได้ ทางนั้นถูกกว่าเสมอ สิ่งที่ส่วนต่างนี้แลกมาคือใบกำกับภาษีไทย การชำระผ่าน PromptPay การควบคุมเส้นทางของคำขอ และซัพพอร์ตในโซนเวลาเดียวกับคุณ ถ้าสิ่งเดียวที่คุณสนใจคือราคาต่อโทเคน เราไม่ใช่เกตเวย์ที่ใช่สำหรับคุณ

มีการจำกัดอัตราคำขอ API ไหม

ยังไม่มีในตอนนี้ การจำกัดจำนวนคำขอต่อคีย์มีแผนจะทำในเฟสถัดไป และยังไม่ได้บังคับใช้ การจำกัดอัตราเดียวที่มีอยู่ในระบบตอนนี้ใช้ปกป้องหน้าล็อกอินของพอร์ทัลสมาชิกจากการเดารหัสซ้ำ ๆ เท่านั้น ไม่เกี่ยวกับการเรียก /v1/chat/completions

ตัวเลข latency กับ uptime อยู่ที่ไหน

เรายังไม่เผยแพร่ตัวเลขใด ๆ เพราะเรายังไม่ได้วัด หน้าสถานะจะแสดง time-to-first-token และ tokens-per-second ต่อโมเดล วัดต่อเนื่องจากกรุงเทพฯ ด้วย benchmark ชุดเดียวกับที่ใช้กำหนดค่า routing เริ่มต้น การเผยแพร่ตัวเลขที่เราไม่ได้วัดจริงจะแย่กว่าการไม่เผยแพร่อะไรเลย หน้านั้นจึงว่างไว้จนกว่าการวัดผลจะเป็นของจริง

ยังมีคำถามอยู่ใช่ไหม

หน้าเอกสารลงรายละเอียดฝั่งเทคนิคมากกว่านี้ ส่วนหน้าราคาแสดงอัตราต่อโมเดลแบบสด