Palmyra X6 ลดค่าใช้จ่ายโทเค็นของ AI‑agent ลง 52% พร้อมความเร็วเพิ่ม 48%

ที่มาภาพ: VentureBeat

AI-อ่าน 6 นาทีVentureBeat

Palmyra X6 ลดค่าใช้จ่ายโทเค็นของ AI‑agent ลง 52% พร้อมความเร็วเพิ่ม 48%

⚡ สรุป 30 วิ

Writer เปิดตัว Palmyra X6 รุ่นใหม่ที่ช่วยลดต้นทุนโทเค็นสำหรับ AI‑agent ถึง 52% และเพิ่มความเร็วการตอบสนอง 48%…

Writer เปิดตัว Palmyra X6 รุ่นใหม่ของแพลตฟอร์ม AI‑agent ระดับองค์กร พร้อมระบบ orchestration “harness” ที่ถูกออกแบบใหม่และเครื่องมือการกำกับดูแลเพื่อควบคุมค่าใช้จ่ายโทเค็นที่เพิ่มขึ้นอย่างรวดเร็ว รายงานว่าโมเดลใหม่นี้ทำให้ต้นทุนลดลง 52 % และความเร็วในการตอบเพิ่มขึ้น 48 % ซึ่งอาจเปลี่ยนแนวทางการลงทุน AI ของบริษัทขนาดใหญ่หลายพันล้านดอลลาร์ได้

Overview

Palmyra X6 ถูกปล่อยพร้อมกับฟีเจอร์การจัดการโทเค็นและ UI ควบคุมที่ช่วยให้ทีม IT สามารถตั้งขอบเขตการใช้ทรัพยากรของ AI‑agent ได้อย่างชัดเจนตามนโยบายองค์กร บริษัท Writer ระบุว่าโมเดลนี้ทำงานบน โครงสร้างพื้นฐานสหรัฐอเมริกา ทั้งหมด แม้ว่าจะใช้ฐานโมเดลเปิดจากประเทศจีนเป็นจุดเริ่มต้น

การประกาศมาพร้อมกับข้อมูลที่บ่งชี้ว่าการใช้งาน AI‑agent ในระดับองค์กรกำลังเข้าสู่ช่วงที่ค่าใช้จ่ายกลายเป็นข้อจำกัดหลัก แทนที่จะเป็นความสามารถของโมเดลเอง ทั้งนี้ Writer เชื่อว่า การลดค่าใช้จ่ายต่อโทเค็นจะขยายตลาด (TAM) ของการใช้งานอัตโนมัติในองค์กรได้อย่างมีนัยสำคัญ

Key Improvements

Writer ให้ตัวเลขเปรียบเทียบโดยระบุว่าการผสาน Palmyra X6 เข้ากับระบบเดิมทำให้ค่าใช้จ่ายเฉลี่ยต่อภารกิจลดลง 52 % ความเร็วในการประมวลผลเพิ่มขึ้น 48 % และคุณภาพของผลลัพธ์ดีขึ้นประมาณ **10 % ตามการทดสอบภายในที่ครอบคลุมเก้าความสามารถ เช่น การสืบค้นข้อมูล การใช้เครื่องมือเสริมและการถ่ายทอดเสียงแบรนด์

ผู้บริหารระดับสูงของ Writer เน้นว่า “อุปสรรคใหญ่ที่สุดต่อการขยายตัวของ AI ในองค์กรวันนี้คือค่าใช้จ่าย ไม่ใช่ความสามารถของโมเดล” ซึ่งสอดคล้องกับมุมมองของหลายบริษัท Fortune 500 ที่กำลังพิจารณาเปลี่ยนจากแรงงานมนุษย์เป็นระบบอัตโนมัติที่คุ้มค่ามากขึ้น

Technical Foundations

Palmyra X6 เป็น โมเดล mixture‑of‑experts ขนาด 744 พันล้านพารามิเตอร์ โดยมีประมาณ 40 พันล้านพารามิเตอร์ที่ทำงานต่อโทเค็น โมเดลนี้เป็นเวอร์ชันหลังการฝึก (post‑trained) ของ GLM‑5.2 ซึ่งพัฒนาโดย Z.ai (เดิมชื่อ Zhipu AI)

  • ใช้กระบวนการ **anchored supervised fine‑tuning (ASFT) บนชุดข้อมูลสังเคราะห์ 626 ตัวอย่างเท่านั้น
  • ปรับอัตราการเรียนรู้ต่ำและฝึกเพียงหนึ่ง epoch เพื่อรักษาความเสถียรของโมเดลพื้นฐาน
  • แทนที่ optimizer แบบ Adam ด้วย Muon ซึ่งมองเมตริกซ์น้ำหนักเป็นวัตถุทางเรขาคณิต

ข้อมูลการฝึกทั้งหมดเป็นสังเคราะห์โดย “teacher models” ผ่านขั้นตอนกรองคุณภาพหลายชั้น รวมถึง verifier โมเดลและคณะกรรมการ LLM สองโมเดล ก่อนนำเข้าสู่กระบวนการ ASFT ความพยายามนี้สะท้อนแนวคิด “less is more” ที่ว่าชุดข้อมูลขนาดเล็กแต่มีคุณภาพสูงสามารถให้ผลลัพธ์ที่ดีเทียบกับชุดข้อมูลใหญ่แต่ผิวเผิน

Economic Context

ตามการคาดการณ์ของ Goldman Sachs ปริมาณโทเค็นจะเพิ่มขึ้น 24 เท่าระหว่างปี 2026‑2030 ไปถึง 120 quadrillion โทเค็นต่อเดือน แม้ราคาต่อโทเค็นจะลดลง แต่หากการใช้งานของ AI‑agent เพิ่มขึ้น 20 เท่าโดยที่ราคาแค่ลด 75 % ค่าใช้จ่ายรวมก็ยังอาจเพิ่มเป็น 5 เท่า

Writer CTO Waseem AlShikh ชี้ว่า “องค์กรต้องการให้โทเค็นระเบิดเพื่อพิสูจน์การยอมรับ แต่ต้องการให้ค่าใช้จ่ายคงที่” การลดต้นทุนต่อโทเค็นของ Palmyra X6 จึงเป็นการตอบสนองตรงต่อแนวโน้มนี้และช่วยให้ลูกค้าสามารถขยายกรณีใช้งานได้โดยไม่ต้องกังวลเรื่องบิลค่าใช้จ่ายที่พุ่งสูง

Market Impact

ด้วยการอ้างว่า “ลดต้นทุนไม่ได้ทำร้ายกำไรของเรา แต่กลับเพิ่ม TAM ของโอกาสภายในองค์กร” Writer กำลังสอดคล้องกับรูปแบบตลาดคลาวด์ในช่วงทศวรรษที่ผ่านมา ซึ่งราคาต่อหน่วยต่ำลงแต่ยอดใช้บริการรวมสูงขึ้นอย่างต่อเนื่อง

การเปิดตัว Palmyra X6 จึงอาจเป็นจุดเปลี่ยนที่ทำให้หลายองค์กรเริ่มนำ AI‑agent ไปใช้ในกระบวนการธุรกิจแบบต่อเนื่อง เช่น การจัดซื้อจัดจ้างอัตโนมัติหรือการวิเคราะห์ข้อมูลเชิงลึก ที่ก่อนหน้านี้ยังคงพึ่งพากำลังคน เนื่องจากต้นทุนที่สูงกว่าการทำงานของมนุษย์

Governance Tools

ส่วนสำคัญอีกประการหนึ่งของการเปิดตัวคือชุดเครื่องมือ governance ใหม่ ซึ่งให้ผู้ดูแลระบบตั้งขีดจำกัดการใช้โทเค็นต่อภารกิจหรือระยะเวลาที่กำหนดได้อย่างแม่นยำ นอกจากนี้ยังมีแดชบอร์ดแสดงภาพรวมการใช้ทรัพยากรแบบเรียลไทม์ ทำให้องค์กรสามารถตรวจสอบและปรับนโยบายเพื่อป้องกันค่าใช้จ่ายที่ไม่คาดคิด

เครื่องมือเหล่านี้ได้รับการออกแบบให้สอดคล้องกับมาตรฐานความปลอดภัยข้อมูลของสหรัฐอเมริกา (FedRAMP) และสหภาพยุโรป (GDPR) เพื่อรองรับลูกค้าขนาดใหญ่ที่ต้องรักษาความเป็นส่วนตัวและข้อบังคับตามกฎหมาย

Summary

Writer เปิดตัว Palmyra X6 พร้อมการลดค่าใช้จ่ายต่อโทเค็นถึง 52 % และฟีเจอร์การกำกับดูแลใหม่ ซึ่งตอบโจทย์ความต้องการขององค์กรที่เผชิญกับการเพิ่มขึ้นอย่างรวดเร็วของค่าใช้จ่าย AI‑agent. โมเดลนี้นำเสนอแนวทางการพัฒนา “ข้อมูลคุณภาพสูงแต่ขนาดเล็ก” ที่อาจเป็นแบบอย่างสำหรับตลาด AI ระดับองค์กรในอนาคต.

แชร์บทความนี้:

ชอบบทความแบบนี้?

สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม

แหล่งข่าวต้นฉบับ

ชื่อต้นฉบับ
Writer says its new Palmyra X6 model cuts AI agent costs by 52% as token spending surges
ผู้เขียน
[email protected] (Michael Nuñez)
แหล่ง
VentureBeat
วันที่เผยแพร่
13 สิงหาคม 2569 เวลา 20:00

Related

บทความที่เกี่ยวข้อง

NEC ทดสอบระบบจอดอัจฉริยะที่คิดค่าบริการเมื่อลูกค้าออกจากรถAI
12 สิงหาคม 2569 เวลา 08:30

NEC ทดสอบระบบจอดอัจฉริยะที่คิดค่าบริการเมื่อลูกค้าออกจากรถ

NEC ร่วมกับ UrbanChain ทดลองระบบจอดรถอัจฉริยะที่คำนวณค่าบริการเมื่อผู้ขับออกจากรถโดยใช้ AI วิเคราะห์ภาพจากกล้อง…

The Register6 นาที
แก้ปัญหา Local LLM วนซ้ำด้วยการปรับ Temperature และ Repeat Penalty เพียงสองค่าAI
12 สิงหาคม 2569 เวลา 01:00

แก้ปัญหา Local LLM วนซ้ำด้วยการปรับ Temperature และ Repeat Penalty เพียงสองค่า

ผู้เขียนพบว่า Local LLM บางรุ่นตอบข้อความวนซ้ำเนื่องจากค่าการกำหนด token ไม่เหมาะ สมรรถภาพจึงลดลง การปรับค่า temperature สูงขึ้นและตั้ง repeat penalty…

XDA Developers6 นาที
ความคาดหวังการตอบเร็วกลายเป็นเกณฑ์ใหม่ในประเมินผลทำงานAI
10 สิงหาคม 2569 เวลา 14:30

ความคาดหวังการตอบเร็วกลายเป็นเกณฑ์ใหม่ในประเมินผลทำงาน

สำรวจของ Use.AI พบว่า 52% พนักงานส่งอีเมลหรือข้อความที่ไม่นำไปใช้จริงเพียงเพื่อแสดงว่ากำลังทำงาน การคาดหวังความเร็วในการตอบกลับกลายเป็นเกณฑ์ใหม่ในประเมินผล…

TechRadar5 นาที
SoloMD เปิดแอปจดบันทึกโอเพ่นซอร์สแทน Obsidian พร้อม AI panel ในตัวAI
10 สิงหาคม 2569 เวลา 05:30

SoloMD เปิดแอปจดบันทึกโอเพ่นซอร์สแทน Obsidian พร้อม AI panel ในตัว

SoloMD เป็นแอปจดบันทึกโอเพ่นซอร์สที่รองรับ Markdown โดยตรงและมี AI panel ช่วยสร้างเนื้อหาอัตโนมัติ การเปิด vault ของ Obsidian ใน SoloMD ทำได้ราบรื่น…

XDA Developers7 นาที
คัดลอกลิงก์แล้ว!