Google Gemini เปิด 5 ฟีเจอร์ที่ ChatGPT ยังทำไม่ได้

ที่มาภาพ: Tom's Guide

AI-อ่าน 7 นาทีTom's Guide

Google Gemini เปิด 5 ฟีเจอร์ที่ ChatGPT ยังทำไม่ได้

⚡ สรุป 30 วิ

Google Gemini เพิ่งเปิดเผยฟีเจอร์ห้าประการ ได้แก่ การสร้างเพลงอัตโนมัติ การค้นหารูปใน Google Photos การแปลงเอกสารเป็นเสียง การสร้างอวาตาร์ดิจิทัลส่วนตัว…

Gemini ของ Google เพิ่งเปิดเผยฟีเจอร์ห้าประการที่ยังไม่สามารถทำได้โดยตรงใน ChatGPT ทำให้ผู้ใช้ AI ผู้ช่วยทั้งสองต้องเลือกระหว่างความคล่องตัวของ ChatGPT กับความลึกซึ้งของ Gemini ซึ่งอาจส่งผลต่อวิธีการสร้างสรรค์และจัดการข้อมูลส่วนบุคคลของผู้บริโภคในหลายด้าน

Overview

ในช่วงไม่กี่ปีที่ผ่านมา ChatGPT และ Gemini พัฒนาความสามารถที่ช่วยให้ทำงานหลากหลายได้เหมือนกัน ทั้งตอบคำถาม แปลภาษา หรือสรุปข้อความ อย่างไรก็ตาม ความแตกต่างระหว่างสองระบบชัดเจนขึ้นเมื่อมองไปไกลกว่าโหมด “ถาม‑ตอบ” ธรรมดา Google ได้เชื่อมต่อ Gemini เข้ากับบริการและอุปกรณ์ที่บริษัทควบคุมอยู่แล้ว เช่น ระบบปฏิบัติการ Android และ Google Photos ทำให้ผู้ใช้สามารถเรียกใช้งานฟังก์ชันสร้างสรรค์โดยตรงจากแอปพลิเคชันได้ การเปิดตัวคุณสมบัติเหล่านี้ยังคงขึ้นกับประเภทของอุปกรณ์ บัญชีผู้ใช้ ระดับการสมัครสมาชิก และภูมิภาคที่ให้บริการ

Feature 1 – Original Song Generation

Gemini นำเสนอ Lyria 3 ตัวสร้างดนตรีที่สามารถรับคำสั่งแบบข้อความหรือภาพแล้วผลิตเพลงเต็มรูปแบบพร้อมเนื้อร้องและทำนอง ผู้ใช้เพียงระบุธีม เช่น “เพลงป็อปสดใสเกี่ยวกับการเป็นพ่อแม่ในสัปดาห์แรกของโรงเรียน” ระบบจะสร้างไฟล์ MP3 หรือ MP4 พร้อมภาพหน้าปกให้ดาวน์โหลดได้ตามต้องการ การสร้างเพลงแบบนี้ต้องเปลี่ยนโหมด Gemini ไปใช้รุ่น Pro model ตามคำแนะนำของ Google ซึ่งเป็นจุดแตกต่างที่ชัดเจนจาก ChatGPT ที่แม้จะช่วยเขียนเนื้อหาและคอร์ดได้แต่ไม่สามารถผลิตไฟล์เสียงสำเร็จรูปให้ผู้ใช้งานโดยตรง

Gemini สามารถค้นหารูปภาพในบัญชี Google Photos ของผู้ใช้โดยอิงจากคน สถานที่ หรือวัตถุที่ปรากฏในรูปได้โดยไม่ต้องอัปโหลดไฟล์ใหม่ ตัวอย่างเช่น ผู้ใช้สามารถขอให้ Gemini แสดงรูปจากวันเกิดปีที่ผ่านมา หรือค้นหาภาพของบุคคลเฉพาะเจาะจงได้ทันที การทำงานนี้ช่วยลดเวลาในการสกรอลภาพจำนวนหลายพันรูปที่มักเป็นปัญหาในชีวิตประจำวัน อย่างไรก็ตามมีข้อจำกัดบางประการที่ผู้ใช้ควรรับทราบ

  • ต้องเชื่อมต่อกับบัญชี Google ส่วนบุคคลและเปิดใช้งาน Keep Activity
  • ไม่สามารถใช้ได้สำหรับผู้ใช้ที่อายุต่ำกว่า 18 ปี และต้องอยู่ในภูมิภาคที่รองรับฟีเจอร์นี้
  • จำเป็นต้องเปิดการทำงานของ Face Groups ใน Google Photos

การปกป้องข้อมูลส่วนบุคคลจึงยังคงเป็นประเด็นสำคัญ ผู้ใช้ควรระมัดระวังเมื่อขอให้ AI ดึงเอกสารสำคัญเช่น ใบขับขี่หรือผลตรวจสุขภาพจากรูปถ่าย

Feature 3 – Audio Overview of Documents

ด้วย Audio Overview Gemini สามารถแปลงเอกสาร รายงานการวิจัย หรือสไลด์พรีเซนเทชั่นให้กลายเป็นบทสนทนาแบบพอดคาสต์สองโฮสต์ ผู้ใช้ไม่จำเป็นต้องอ่านเนื้อหาเต็ม แต่สามารถฟังสรุปสำคัญในระยะเวลาหลายนาทีได้ การสร้างเสียงพูดนี้ใช้เวลาเพียงไม่กี่นาทีแล้วผู้ใช้สามารถฟังภายในแอป ดาวน์โหลดไฟล์หรือแชร์ลิงก์ให้ผู้อื่นตามต้องการ ความสามารถนี้แตกต่างจาก ChatGPT Voice ที่แม้จะอ่านข้อความออกมาเป็นเสียงได้แต่ยังไม่มีฟีเจอร์ที่จัดทำบทสนทนาแบบพอดคาสต์และบันทึกผลลัพธ์เพื่อแบ่งปันต่อไป

Feature 4 – Personal Gemini Avatar (AI Digital Twin)

สำหรับสมาชิกที่สมัครใช้บริการระดับพรีเมียม Google เปิดให้สร้าง Personal Avatar ซึ่งเป็นดิจิทัลคลอนของผู้ใช้เองโดยอาศัยเทคโนโลยี Gemini Omni และ Google Veo กระบวนการทำงานเริ่มจากเปิดหน้าตั้งค่าในแอป Gemini แล้วเลือก “Personal Avatar” ผู้ใช้ต้องบันทึกวิดีโอสั้น ๆ เพื่อให้ระบบจับโครงหน้าและเสียง จากนั้นสามารถเรียกใช้งานตัวตนดิจิทัลนี้ในการสนทนาโดยพิมพ์ @me** หรือ @[username] ได้ทันที การสร้างอวาตาร์ยังเปิดโอกาสให้ผู้ใช้กำหนดลักษณะภาพ 3 มิติ เช่น “นักพัฒนาเพศชายผมสั้น สวมฮูดสีฟ้า มีแสงนีออนพื้นหลัง” ซึ่งช่วยเสริมประสบการณ์ส่วนบุคคลในงานสร้างเนื้อหาและการโต้ตอบกับ AI

Feature 5 – YouTube Video Analysis

Gemini รองรับการวิเคราะห์ลิงก์ YouTube โดยตรง ผู้ใช้สามารถวาง URL ของวิดีโอลงในช่องแชทแล้วขอให้ระบบสรุปใจความสำคัญ คำตอบคำถาม หรือดึงข้อมูลที่ต้องการโดยละเว้นส่วนโฆษณาและบทนำ ตัวอย่างเช่น การขอสรุป “ขั้นตอนการตั้งค่าการบันทึกหน้าจอ” จากวิดีโอ 30 นาที Gemini จะให้รายการขั้นตอนโดยตรงและสามารถแยกประเด็นสำคัญออกมาได้อย่างรวดเร็ว ความสามารถนี้ยังช่วยผู้ใช้ที่ต้องการข้อมูลเชิงลึกจากสื่อวีดีโอดิจิทัลโดยไม่ต้องดูทั้งหมด ซึ่ง ChatGPT ปัจจุบันไม่มีฟีเจอร์อัตโนมัติแบบนี้

Summary

Gemini ของ Google เพิ่มคุณสมบัติหลายอย่างตั้งแต่สร้างเพลง ดาวน์โหลดไฟล์เสียง การค้นหารูปใน Google Photos ไปจนถึงการทำ Audio Overview, Personal Avatar, และการวิเคราะห์ YouTube โดยตรง ซึ่งยังไม่มีให้บริการโดยพื้นฐานใน ChatGPT อย่างไรก็ตาม ความพร้อมใช้งานของฟีเจอร์เหล่านี้ขึ้นกับอุปกรณ์ บัญชีผู้ใช้ ระดับสมาชิกและตำแหน่งทางภูมิศาสตร์ของผู้บริโภค.

แชร์บทความนี้:

ชอบบทความแบบนี้?

สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม

แหล่งข่าวต้นฉบับ

ชื่อต้นฉบับ
5 Gemini features ChatGPT still can’t match
ผู้เขียน
Amanda Caswell
แหล่ง
Tom's Guide
วันที่เผยแพร่
18 สิงหาคม 2569 เวลา 12:30

Related

บทความที่เกี่ยวข้อง

เกม Rideshare Stimulator เปิดเผยการใช้ AI หลังข้อหาจากอดีตหัวหน้าผู้เขียนAI
17 สิงหาคม 2569 เวลา 02:30

เกม Rideshare Stimulator เปิดเผยการใช้ AI หลังข้อหาจากอดีตหัวหน้าผู้เขียน

Saber Interactive เปิดเผยว่ามีการใช้ AI เช่น ChatGPT ในส่วนของเสียง การแปลและภารกิจบางอย่างของเกม Rideshare Stimulator หลังที่ Stella Sacco…

GameSpot7 นาที
OpenAI ทดลองระบบ ‘pay‑to‑reset’ ค่าบริการ $8 เพื่อรีเซ็ตโควต้าการใช้งาน ChatGPT รายสัปดาห์AI
14 สิงหาคม 2569 เวลา 22:00

OpenAI ทดลองระบบ ‘pay‑to‑reset’ ค่าบริการ $8 เพื่อรีเซ็ตโควต้าการใช้งาน ChatGPT รายสัปดาห์

OpenAI กำลังทดสอบฟีเจอร์ ‘pay‑to‑reset’ ให้ผู้ใช้จ่าย $8 เพื่อรีเซ็ตโควต้ารายสัปดาห์…

Tom's Guide6 นาที
สร้างเว็บไซต์โดยไม่ออกจาก ChatGPT เพียงหนึ่งคำสั่งAI
7 สิงหาคม 2569 เวลา 10:00

สร้างเว็บไซต์โดยไม่ออกจาก ChatGPT เพียงหนึ่งคำสั่ง

OpenAI เปิดฟีเจอร์ ChatGPT Sites ที่ทำให้สร้างเว็บไซต์หรือแอปขนาดเล็กได้ด้วยคำสั่งเดียว. ผู้รีวิวอัปโหลดไฟล์หนังสือสี่ฉบับและได้รับผลลัพธ์ภายในไม่กี่นาที

Tom's Guide8 นาที
ซาม อัลท์แมน ชักชวนพ่อแม่ใช้ ChatGPT สร้างพ็อดคาสต์ AI สำหรับลูกAI
3 สิงหาคม 2569 เวลา 23:30

ซาม อัลท์แมน ชักชวนพ่อแม่ใช้ ChatGPT สร้างพ็อดคาสต์ AI สำหรับลูก

ซาม อัลทร์แมน ผู้ก่อตั้ง OpenAI แนะนำให้พ่อแม่ใช้ ChatGPT สร้างพ็อดคาสท์ AI บรรยายกิจกรรมของลูกทุกเช้า การตอบรับบน X ได้รับไลค์กว่า 9,500 ครั้ง…

Mashable Tech6 นาที
คัดลอกลิงก์แล้ว!