
ที่มาภาพ: VentureBeat
Palmyra X6 ลดค่าใช้จ่ายโทเค็นของ AI‑agent ลง 52% พร้อมความเร็วเพิ่ม 48%
⚡ สรุป 30 วิ
Writer เปิดตัว Palmyra X6 รุ่นใหม่ที่ช่วยลดต้นทุนโทเค็นสำหรับ AI‑agent ถึง 52% และเพิ่มความเร็วการตอบสนอง 48%…
Writer เปิดตัว Palmyra X6 รุ่นใหม่ของแพลตฟอร์ม AI‑agent ระดับองค์กร พร้อมระบบ orchestration “harness” ที่ถูกออกแบบใหม่และเครื่องมือการกำกับดูแลเพื่อควบคุมค่าใช้จ่ายโทเค็นที่เพิ่มขึ้นอย่างรวดเร็ว รายงานว่าโมเดลใหม่นี้ทำให้ต้นทุนลดลง 52 % และความเร็วในการตอบเพิ่มขึ้น 48 % ซึ่งอาจเปลี่ยนแนวทางการลงทุน AI ของบริษัทขนาดใหญ่หลายพันล้านดอลลาร์ได้
Overview
Palmyra X6 ถูกปล่อยพร้อมกับฟีเจอร์การจัดการโทเค็นและ UI ควบคุมที่ช่วยให้ทีม IT สามารถตั้งขอบเขตการใช้ทรัพยากรของ AI‑agent ได้อย่างชัดเจนตามนโยบายองค์กร บริษัท Writer ระบุว่าโมเดลนี้ทำงานบน โครงสร้างพื้นฐานสหรัฐอเมริกา ทั้งหมด แม้ว่าจะใช้ฐานโมเดลเปิดจากประเทศจีนเป็นจุดเริ่มต้น
การประกาศมาพร้อมกับข้อมูลที่บ่งชี้ว่าการใช้งาน AI‑agent ในระดับองค์กรกำลังเข้าสู่ช่วงที่ค่าใช้จ่ายกลายเป็นข้อจำกัดหลัก แทนที่จะเป็นความสามารถของโมเดลเอง ทั้งนี้ Writer เชื่อว่า การลดค่าใช้จ่ายต่อโทเค็นจะขยายตลาด (TAM) ของการใช้งานอัตโนมัติในองค์กรได้อย่างมีนัยสำคัญ
Key Improvements
Writer ให้ตัวเลขเปรียบเทียบโดยระบุว่าการผสาน Palmyra X6 เข้ากับระบบเดิมทำให้ค่าใช้จ่ายเฉลี่ยต่อภารกิจลดลง 52 % ความเร็วในการประมวลผลเพิ่มขึ้น 48 % และคุณภาพของผลลัพธ์ดีขึ้นประมาณ **10 % ตามการทดสอบภายในที่ครอบคลุมเก้าความสามารถ เช่น การสืบค้นข้อมูล การใช้เครื่องมือเสริมและการถ่ายทอดเสียงแบรนด์
ผู้บริหารระดับสูงของ Writer เน้นว่า “อุปสรรคใหญ่ที่สุดต่อการขยายตัวของ AI ในองค์กรวันนี้คือค่าใช้จ่าย ไม่ใช่ความสามารถของโมเดล” ซึ่งสอดคล้องกับมุมมองของหลายบริษัท Fortune 500 ที่กำลังพิจารณาเปลี่ยนจากแรงงานมนุษย์เป็นระบบอัตโนมัติที่คุ้มค่ามากขึ้น
Technical Foundations
Palmyra X6 เป็น โมเดล mixture‑of‑experts ขนาด 744 พันล้านพารามิเตอร์ โดยมีประมาณ 40 พันล้านพารามิเตอร์ที่ทำงานต่อโทเค็น โมเดลนี้เป็นเวอร์ชันหลังการฝึก (post‑trained) ของ GLM‑5.2 ซึ่งพัฒนาโดย Z.ai (เดิมชื่อ Zhipu AI)
- ใช้กระบวนการ **anchored supervised fine‑tuning (ASFT) บนชุดข้อมูลสังเคราะห์ 626 ตัวอย่างเท่านั้น
- ปรับอัตราการเรียนรู้ต่ำและฝึกเพียงหนึ่ง epoch เพื่อรักษาความเสถียรของโมเดลพื้นฐาน
- แทนที่ optimizer แบบ Adam ด้วย Muon ซึ่งมองเมตริกซ์น้ำหนักเป็นวัตถุทางเรขาคณิต
ข้อมูลการฝึกทั้งหมดเป็นสังเคราะห์โดย “teacher models” ผ่านขั้นตอนกรองคุณภาพหลายชั้น รวมถึง verifier โมเดลและคณะกรรมการ LLM สองโมเดล ก่อนนำเข้าสู่กระบวนการ ASFT ความพยายามนี้สะท้อนแนวคิด “less is more” ที่ว่าชุดข้อมูลขนาดเล็กแต่มีคุณภาพสูงสามารถให้ผลลัพธ์ที่ดีเทียบกับชุดข้อมูลใหญ่แต่ผิวเผิน
Economic Context
ตามการคาดการณ์ของ Goldman Sachs ปริมาณโทเค็นจะเพิ่มขึ้น 24 เท่าระหว่างปี 2026‑2030 ไปถึง 120 quadrillion โทเค็นต่อเดือน แม้ราคาต่อโทเค็นจะลดลง แต่หากการใช้งานของ AI‑agent เพิ่มขึ้น 20 เท่าโดยที่ราคาแค่ลด 75 % ค่าใช้จ่ายรวมก็ยังอาจเพิ่มเป็น 5 เท่า
Writer CTO Waseem AlShikh ชี้ว่า “องค์กรต้องการให้โทเค็นระเบิดเพื่อพิสูจน์การยอมรับ แต่ต้องการให้ค่าใช้จ่ายคงที่” การลดต้นทุนต่อโทเค็นของ Palmyra X6 จึงเป็นการตอบสนองตรงต่อแนวโน้มนี้และช่วยให้ลูกค้าสามารถขยายกรณีใช้งานได้โดยไม่ต้องกังวลเรื่องบิลค่าใช้จ่ายที่พุ่งสูง
Market Impact
ด้วยการอ้างว่า “ลดต้นทุนไม่ได้ทำร้ายกำไรของเรา แต่กลับเพิ่ม TAM ของโอกาสภายในองค์กร” Writer กำลังสอดคล้องกับรูปแบบตลาดคลาวด์ในช่วงทศวรรษที่ผ่านมา ซึ่งราคาต่อหน่วยต่ำลงแต่ยอดใช้บริการรวมสูงขึ้นอย่างต่อเนื่อง
การเปิดตัว Palmyra X6 จึงอาจเป็นจุดเปลี่ยนที่ทำให้หลายองค์กรเริ่มนำ AI‑agent ไปใช้ในกระบวนการธุรกิจแบบต่อเนื่อง เช่น การจัดซื้อจัดจ้างอัตโนมัติหรือการวิเคราะห์ข้อมูลเชิงลึก ที่ก่อนหน้านี้ยังคงพึ่งพากำลังคน เนื่องจากต้นทุนที่สูงกว่าการทำงานของมนุษย์
Governance Tools
ส่วนสำคัญอีกประการหนึ่งของการเปิดตัวคือชุดเครื่องมือ governance ใหม่ ซึ่งให้ผู้ดูแลระบบตั้งขีดจำกัดการใช้โทเค็นต่อภารกิจหรือระยะเวลาที่กำหนดได้อย่างแม่นยำ นอกจากนี้ยังมีแดชบอร์ดแสดงภาพรวมการใช้ทรัพยากรแบบเรียลไทม์ ทำให้องค์กรสามารถตรวจสอบและปรับนโยบายเพื่อป้องกันค่าใช้จ่ายที่ไม่คาดคิด
เครื่องมือเหล่านี้ได้รับการออกแบบให้สอดคล้องกับมาตรฐานความปลอดภัยข้อมูลของสหรัฐอเมริกา (FedRAMP) และสหภาพยุโรป (GDPR) เพื่อรองรับลูกค้าขนาดใหญ่ที่ต้องรักษาความเป็นส่วนตัวและข้อบังคับตามกฎหมาย
Summary
Writer เปิดตัว Palmyra X6 พร้อมการลดค่าใช้จ่ายต่อโทเค็นถึง 52 % และฟีเจอร์การกำกับดูแลใหม่ ซึ่งตอบโจทย์ความต้องการขององค์กรที่เผชิญกับการเพิ่มขึ้นอย่างรวดเร็วของค่าใช้จ่าย AI‑agent. โมเดลนี้นำเสนอแนวทางการพัฒนา “ข้อมูลคุณภาพสูงแต่ขนาดเล็ก” ที่อาจเป็นแบบอย่างสำหรับตลาด AI ระดับองค์กรในอนาคต.
แชร์บทความนี้:
ชอบบทความแบบนี้?
สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม
แหล่งข่าวต้นฉบับ
- ชื่อต้นฉบับ
- Writer says its new Palmyra X6 model cuts AI agent costs by 52% as token spending surges
- ผู้เขียน
- [email protected] (Michael Nuñez)
- แหล่ง
- VentureBeat
- วันที่เผยแพร่
- 13 สิงหาคม 2569 เวลา 20:00



