เลือก Gemma 4 สำหรับการติดตั้งในระบบท้องถิ่น แบบออฟไลน์ หรือตามความต้องการเฉพาะ เลือก Gemini สำหรับการวิจัยแบบมีผู้ดูแล การวิเคราะห์เอกสารยาว และการเข้าถึงเครื่องมือรูปภาพและวิดีโอของ Google. ความแตกต่างที่ใหญ่ที่สุดคือว่าคุณต้องการจัดการระบบด้วยตัวเองมากแค่ไหน.
- Gemma 4: น้ำหนักที่ดาวน์โหลดได้; 5 ขนาด; บริบท 128K–256K; ผลลัพธ์เป็นข้อความ.
- ราศีเมถุน: โมเดลที่โฮสต์; โมเดลที่เปรียบเทียบกันในที่นี้มีจำนวนโทเคนอินพุตสูงสุด 1 ล้าน; เครื่องมือที่ได้รับการจัดการ และโมเดลสื่อที่แยกต่างหาก.
- ใช้ทั้งสองอย่าง: เก็บข้อมูลที่ละเอียดอ่อนไว้ในระบบท้องถิ่น แล้วส่งข้อมูลที่ได้รับการอนุมัติไปยังระบบคลาวด์ เพื่อใช้ในวัตถุประสงค์การวิจัยหรือการผลิต.
The บัตรแบบ Gemma 4 กำหนดกลุ่มโมเดลท้องถิ่น สำหรับจุดเริ่มต้นที่ได้รับการจัดการ ให้ลอง Gemini 3.1 Pro บน GlobalGPT.
- เลือกตามกระบวนการทำงาน
- Gemma 4 vs Gemini: สรุปข้อมูลสำคัญ
- Gemma 4: โมเดลและความจำ
- รุ่น Gemini ใดที่เหมาะกับความต้องการ?
- การควบคุม vs ความสะดวกสบาย
- บริบทและการสนับสนุนสื่อ
- ความเป็นส่วนตัว: เปรียบเทียบระดับบริการ
- ค่าใช้จ่าย: อุปกรณ์ท้องถิ่น vs API
- วิธีอ่านผลการทดสอบประสิทธิภาพ
- เอกสาร การเขียนโค้ด และสื่อ
- สิบตัวอย่างการใช้งานจริง
- สองคำสั่งให้ลอง
- เมื่อใดควรใช้ทั้งสองอย่าง
- 5 ข้อผิดพลาดที่ควรหลีกเลี่ยง
- คุณควรเลือกอันไหนดี?
- ก่อนที่คุณจะตัดสินใจ
- คำถามที่พบบ่อย
เลือกตามกระบวนการทำงาน
เริ่มจากข้อกำหนดที่ไม่สามารถเจรจาได้ก่อน โมเดลมาตรฐานไม่สามารถกำหนดได้ว่าไฟล์ของคุณจะถูกจัดเก็บไว้ที่ใด หรือใครจะเป็นผู้ดูแลระบบ.
- ต้องทำงานแบบออฟไลน์ได้หรือไม่? Gemma 4 สามารถทำงานได้หลังจากติดตั้งน้ำหนักและเวลาการทำงานแล้ว.
- ต้องการควบคุมน้ำหนัก อุปกรณ์ และการปรับแต่งหรือไม่? Gemma 4 ให้คุณควบคุมได้ทั้งหมด — รวมถึงงานปฏิบัติการด้วย.
- ต้องการผลลัพธ์ภายในสัปดาห์นี้โดยไม่ต้องเตรียมการมาก? Gemini ช่วยลดภาระงานด้านการให้บริการและการปรับขนาดลงอย่างมาก.
- ต้องการภาพหรือวิดีโอที่เสร็จเรียบร้อยแล้วหรือไม่? ใช้โมเดลภาพเฉพาะหรือ Veo ในระบบที่ Google จัดการ โมเดลข้อความเพียงอย่างเดียวไม่สามารถสร้างทรัพยากรเหล่านั้นได้.
หากต้องการเลือกแบบต่าง ๆ ได้มากขึ้นในที่เดียว, โกลบอลจีพีที ให้บริการการเข้าถึง 100 โมเดลปัญญาประดิษฐ์, โดยแพ็กเกจเริ่มต้นที่ ต่ำกว่า 1,000,000 บาทต่อเดือน.

Gemma 4 vs Gemini: สรุปข้อมูลสำคัญ
| หมวดหมู่ | เจมม่า 4 | ราศีเมถุน |
|---|---|---|
| มันคืออะไร | ครอบครัวโมเดลน้ำหนักเปิดจาก Google | โมเดลคลาวด์แบบจัดการและระบบนิเวศบริการจาก Google |
| วิธีที่คุณเข้าถึงมัน | ดาวน์โหลดน้ำหนักและรันผ่านรันไทม์ที่รองรับหรือแพลตฟอร์มพันธมิตร | Gemini API, Google AI Studio, แผน Google AI, Vertex AI, แอป Gemini |
| รูปแบบการปรับใช้ | โฮสต์เอง, ขอบ, ท้องถิ่นก่อน, โฮสต์โดยพันธมิตร | จัดโดย Google |
| การใช้งานแบบออฟไลน์ | ใช่ ขึ้นอยู่กับการตั้งค่าของคุณเอง | ไม่, ไม่ใช่ในความหมายเดียวกัน |
| หน้าต่างบริบท | 128K บน E2B/E4B; 256K บน 12B Unified, 31B และ 26B A4B | โทเค็นสูงสุด 1 ล้านเหรียญบนโมเดลนักพัฒนา Gemini 3 ปัจจุบัน |
| ประเภทของข้อมูลนำเข้า | ข้อความและภาพปรากฏในทุกรุ่น; เสียงต้นฉบับในรุ่น E2B, E4B และ 12B Unified | ข้อความ, รูปภาพ, วิดีโอ, เสียง, เอกสาร, และกระบวนการทำงานที่ใช้เครื่องมือเป็นตัวกลาง ขึ้นอยู่กับแบบจำลอง |
| ประเภทของผลลัพธ์ | ข้อความ | ข้อความทั่วไป พร้อมการสร้างภาพและวิดีโอผ่านชุดโมเดลที่โฮสต์โดย Google |
| เครื่องมือ | การเรียกใช้ฟังก์ชันและการสนับสนุนการเขียนโค้ดในระดับโมเดล แต่การจัดระเบียบเป็นหน้าที่ของคุณ | การค้นหา, บริบท URL, การดำเนินการโค้ด, การเรียกใช้ฟังก์ชัน, ผลลัพธ์ที่มีโครงสร้าง, API สื่อ |
| ขอบเขตความเป็นส่วนตัว | กำหนดโดยโครงสร้างพื้นฐานและตัวเลือกการปรับใช้ของคุณ | กำหนดโดยระดับบริการและข้อกำหนดของ Google |
| แบบจำลองต้นทุน | ดาวน์โหลดโมเดลพร้อมฮาร์ดแวร์, ที่เก็บข้อมูล, การปรับแต่ง, และค่าใช้จ่ายในการดำเนินงาน | การกำหนดราคาคลาวด์แบบใช้โทเค็นหรือสื่อ, พร้อมระดับฟรีและแบบเสียค่าใช้จ่าย |
| เหมาะสมที่สุด | ระบบ AI ภายในองค์กร, การติดตั้งใช้งานส่วนตัว, กระบวนการทำงานที่ปรับแต่งเอง, การใช้งานที่ขอบเครือข่าย | การวิจัยที่มีการจัดการ การวิเคราะห์บริบทระยะยาว การทำงานบนคลาวด์แบบหลายรูปแบบ การทำงานกับภาพและวิดีโอ |
| ไม่เหมาะสม | การผลิตสื่อแบบครบวงจรหรือความสะดวกสบายบนคลาวด์แบบไม่ต้องดูแล | ควบคุมแบบออฟไลน์ก่อนหรือควบคุมด้วยตนเองอย่างเต็มรูปแบบ |
การเปรียบเทียบมีดังต่อไปนี้ เอกสารการติดตั้ง Gemma ของ Google และข้อมูลจำเพาะของรุ่นนักพัฒนา Gemini; การสมัครสมาชิกแอปและการเข้าถึง API เป็นผลิตภัณฑ์ที่แยกกัน.

Gemma 4: โมเดลและความจำ
Gemma 4 เปิดตัวเมื่อวันที่ 31 มีนาคม 2026. The บัตรรุ่นปัจจุบัน ระบุ E2B, E4B, 12B Unified, 26B A4B และ 31B ภายใต้ใบอนุญาต Apache 2.0 ทุกโปรแกรมรับข้อมูลแบบข้อความและภาพ และส่งคืนผลลัพธ์เป็นข้อความ.
| ตัวแปร | บริบท | ช่องรับเสียง | บทบาททั่วไป |
|---|---|---|---|
| อี2บี | 128 กิโลไบต์ | ใช่ | จุดเข้าสำหรับอุปกรณ์ที่มีข้อจำกัด |
| E4B | 128 กิโลไบต์ | ใช่ | ตัวเลือกท้องถิ่นที่กว้างขึ้นสำหรับสภาพแวดล้อมที่มีข้อจำกัด |
| 12B Unified | 256 กิโลไบต์ | ใช่ | ตัวเลือกกลางที่มีระบบรับข้อมูลแบบหลายรูปแบบที่รวมเป็นหนึ่ง |
| 26B A4B | 256 กิโลไบต์ | ไม่ | กลุ่มผู้เชี่ยวชาญ; มีพารามิเตอร์ที่ใช้งานอยู่ประมาณ 4 พันล้านตัว |
| 31B | 256 กิโลไบต์ | ไม่ | แบบจำลองที่มีความหนาแน่นสูงที่สุดในกลุ่มนี้ |
- การเข้าใจ: การวิเคราะห์เอกสาร, OCR, ตัวอักษรเขียนมือ, แผนภูมิ, ส่วนติดต่อผู้ใช้, การเขียนโค้ด และการเรียกฟังก์ชัน.
- ขอบเขตของเสียงและวิดีโอ: บัตรข้อมูลแบบจำลองบันทึกเสียงได้สูงสุด 30 วินาที และวิดีโอได้สูงสุด 60 วินาที ด้วยอัตรา 1 เฟรมต่อวินาที วันที่ตัดข้อมูลฝึกอบรม: มกราคม 2025.
- 12B Unified: ส่งภาพแพตช์และรูปคลื่นเสียงเข้าสู่โมเดลภาษา โดยไม่ต้องใช้ตัวเข้ารหัสแยกต่างหาก.
- การติดตั้ง: ระบบรันไทม์ที่มีอยู่ ได้แก่ Hugging Face, Ollama, vLLM, llama.cpp, MLX และ LM Studio โปรดเลือกระบบรันไทม์ที่รองรับโมเดลและฮาร์ดแวร์ที่คุณเลือก.
| ตัวแปร | หน่วยความจำ BF16 | หน่วยความจำ SFP8 | หน่วยความจำ Q4_0 |
|---|---|---|---|
| อี2บี | 11.4 GB | 5.7 GB | 2.9 GB |
| E4B | 17.9 GB | 8.9 GB | 4.5 GB |
| 12B Unified | 26.7 GB | 13.4 GB | 6.7 GB |
| 26B A4B | 57.7 GB | 28.8 GB | 14.4 GB |
| 31B | 69.9 GB | 34.9 GB | 17.5 GB |
Gemma 4: ความจำที่จำเป็นสำหรับการโหลดโมเดล
Q4_0 (4-bit) การประมาณค่า แถบที่เล็กกว่าแสดงถึงพื้นที่การโหลดของโมเดลที่น้อยลง.
อี2บี · 2.9 GB
E4B · 4.5 GB
12B Unified · 6.7 GB
26B A4B · 14.4 GB
31B · 17.5 GB
ช่วง: 0–20 GB. ที่มา: ตารางหน่วยความจำ Gemma ของ Google. นี่เป็นค่าประมาณการโหลด ไม่ใช่ความต้องการหน่วยความจำของแอปพลิเคชันทั้งหมด.
ตารางของ Google ระบุว่ามีค่าใช้จ่ายในการโหลด 20% ให้เหลือพื้นที่เพิ่มเติมสำหรับแคชบริบท (context cache), การทำงานในเวลาจริง (runtime) และการทำงานพร้อมกัน (concurrency); การปรับแต่งให้ละเอียดยิ่งขึ้นต้องการหน่วยความจำเพิ่มเติม โมเดล A4B ขนาด 26B ยังคงโหลดน้ำหนักของเอ็กซ์เพิร์ตทั้งหมด แม้จะมีเพียงส่วนย่อยเท่านั้นที่ทำงานอยู่ต่อโทเคน.
Gemma 4 พัฒนาต่อจากงานวิจัย Gemini 3 โดยมีเส้นทางการนำไปใช้ทั้งใน GPU สำหรับผู้บริโภค เซิร์ฟเวอร์ท้องถิ่น และอุปกรณ์มือถือ แผนการเปิดตัว Android AICore เวอร์ชันทดลองสำหรับนักพัฒนาของ Google และแผนการพัฒนา Gemini Nano รุ่นต่อไป ได้อธิบายไว้ใน ภาพรวมของ Gemma 4.
สำหรับกลุ่มน้ำหนักเปิดอีกกลุ่มหนึ่ง ให้เปรียบเทียบความคาดหวังในการปรับใช้กับของเรา รีวิว Kimi K3.
รุ่น Gemini ใดที่เหมาะกับความต้องการ?
เลือกรุ่นที่เหมาะสมกับงานนั้น หมายเลขเวอร์ชัน Flash ที่สูงขึ้นไม่ได้แทนที่ตระกูล Pro ได้ ไดเรกทอรีรุ่น Gemini แยกโมเดลการให้เหตุผล โมเดลภาพ และโมเดลวิดีโอ.
| แบบหรือผลิตภัณฑ์ | ใช้สำหรับ | ขอบเขตการเข้าถึง |
|---|---|---|
| Gemini 3.1 Pro พรีวิว | การวิเคราะห์เชิงเหตุผลที่ซับซ้อน การเขียนโค้ด และการวิเคราะห์แบบหลายรูปแบบ | ข้อความที่แสดงบนโฮสต์ |
| Gemini 3.8 Flash | กระบวนการทำงานแบบเอเจนต์และงานผลิตทั่วไป | ข้อความที่แสดงบนโฮสต์ |
| Gemini 3.5 Flash-Lite | การแปลในปริมาณมากและการประมวลผลที่เรียบง่าย | ข้อความที่แสดงบนโฮสต์ |
| Nano Banana Pro / Nano Banana 2 | การสร้างและแก้ไขภาพ | โมเดลภาพเฉพาะทาง |
| Veo 3.1 | การสร้างวิดีโอ | แยกโมเดลวิดีโอและระบบการเรียกเก็บเงิน |
- แอป Gemini + แผน Google AI: การเข้าถึงของผู้ใช้และสิทธิ์การใช้งานแอป.
- Google AI Studio: การสร้างต้นแบบสำหรับนักพัฒนา.
- API Gemini: การบูรณาการระบบกับระบบการคิดค่าบริการสำหรับนักพัฒนา.
- Vertex AI: การติดตั้ง Google Cloud และระบบควบคุมระดับองค์กร; ตรวจสอบความพร้อมใช้งานและเงื่อนไขของบริการเอง.
เพื่อเข้าถึงแอป โปรดดู คู่มือใช้งานฟรี Gemini Pro.
การควบคุม vs ความสะดวกสบาย

| คุณมีหน้าที่รับผิดชอบ... | Gemma 4 ที่ติดตั้งบนเซิร์ฟเวอร์ของตัวเอง | Gemini API |
|---|---|---|
| การให้บริการและการขยายระบบ | ฮาร์ดแวร์, ระบบปฏิบัติการ, ความจุ และการอัปเดต | Google ดำเนินการให้บริการโมเดล |
| เครื่องมือและการค้นหา | สร้างและรักษาความสัมพันธ์ | เครื่องมือที่ติดตั้งมาพร้อมระบบ (หากมี); ปรับแต่งกระบวนการทำงานของคุณ |
| ความน่าเชื่อถือ | การติดตามผล, แผนสำรอง, ความเร็วการประมวลผล และการแปลงค่า | จัดการข้อผิดพลาดของ API, ขีดจำกัด, การลองใหม่ และงบประมาณ |
| ข้อมูลและความปลอดภัย | การควบคุมการเข้าถึง, บันทึกกิจกรรม และพฤติกรรมของเครื่องมือในระบบ | เลือกระดับบริการและกำหนดการจัดการข้อมูลอย่างปลอดภัย |
Gemma ให้คุณควบคุมได้มากขึ้น ส่วน Gemini ช่วยประหยัดเวลาในการตั้งค่า แต่ทั้งสองระบบยังคงต้องการผู้รับผิดชอบด้านความน่าเชื่อถือและคุณภาพผลลัพธ์ของแอปพลิเคชัน.
บริบทและการสนับสนุนสื่อ
| ความสามารถ | เจมม่า 4 | ชุดเครื่องมือพัฒนา Gemini |
|---|---|---|
| บริบทของข้อมูลที่ป้อนเข้า | 128K: E2B/E4B; 256K: 12B/26B/31B | 1,048,576 โทเคนข้อมูลเข้าในเวอร์ชัน 3.1 Pro, 3.8 Flash และ 3.5 Flash-Lite |
| ข้อความที่แสดง | ใช่; ข้อมูลที่สกัดมา, บทสรุป, รหัส และข้อมูลที่มีโครงสร้าง | ใช่; สามารถสร้างโทเคนผลลัพธ์ได้สูงสุด 65,536 โทเคนในทั้งสามโมเดลนั้น |
| การเข้าใจทางภาพ | รูปภาพ เอกสาร แผนภูมิ ภาพหน้าจอ และคลิปวิดีโอตัวอย่าง | รูปภาพ วิดีโอ และไฟล์ PDF; เครื่องมือเฉพาะรุ่น |
| การเข้าใจเสียง | E2B, E4B และ 12B รวมเป็นหนึ่ง | ได้รับการสนับสนุนจากสามแบบจำลองข้างต้น |
| การสร้างภาพ/วิดีโอ | ไม่ใช่ผลลัพธ์แบบดั้งเดิม | แบบจำลองภาพเฉพาะและ Veo; ไม่ใช่ผลลัพธ์จากแบบจำลองข้อความ Pro/Flash |
ข้อจำกัดเกิดจาก บัตรข้อมูลแบบ Gemma และข้อมูลจำเพาะของรุ่นแต่ละรุ่นของ Gemini การใช้หน้าต่างบริบทที่ใหญ่ขึ้นไม่ได้รับประกันว่าคำตอบจะแม่นยำขึ้น.
- ผลงานที่ Gemma ต้องส่งมอบ: ไฟล์ JSON ของใบแจ้งหนี้, สรุปเนื้อหาสไลด์, ข้อความคำพูดที่แปลแล้ว, รายการงานจากภาพหน้าจอ และโครงร่างการวิจัย.
- การจัดการเอกสาร Gemini: ความสามารถในการเข้าใจไฟล์ PDF แบบดั้งเดิม รวมถึงแผนภูมิและตาราง; ขนาดสูงสุด 50 MB หรือ 1,000 หน้า โดยข้อมูลที่ป้อนเข้าทั้งหมดยังคงถูกจำกัดโดยบริบทของโมเดล.
- การผลิตสื่อ: ใช้แบบจำลองภาพหรือวิดีโอที่แยกต่างหากหลังจากเตรียมบทสรุปแล้ว.
ข้อจำกัดเกี่ยวกับไฟล์และหน้าได้อธิบายไว้ใน เอกสาร PDF ของ Google.
ความเป็นส่วนตัว: เปรียบเทียบระดับบริการ
| การตั้งค่า | ข้อมูลจะถูกนำไปใช้อย่างไร? | สิ่งที่ควรตรวจสอบ |
|---|---|---|
| Gemma 4 ที่ติดตั้งบนเซิร์ฟเวอร์ของตัวเอง | การอนุมานสามารถยังคงอยู่บนอุปกรณ์ฮาร์ดแวร์ที่คุณควบคุมได้ | เครื่องมือระยะไกล, การวัดระยะไกล, บันทึก, สิทธิ์การเข้าถึง และการสำรองข้อมูล |
| บริการ API Gemini ที่ยังไม่ได้ชำระ | ข้อมูลที่ป้อนเข้าและข้อมูลที่ส่งออกอาจช่วยปรับปรุงผลิตภัณฑ์ของ Google; อาจมีการตรวจสอบโดยมนุษย์ | อย่าส่งข้อมูลที่ละเอียดอ่อนตามเงื่อนไขเหล่านี้; มีข้อยกเว้นตามภูมิภาค |
| บริการแบบชำระเงินของ API Gemini | คำสั่งและคำตอบไม่ถูกใช้เพื่อปรับปรุงผลิตภัณฑ์ของ Google | การบันทึกข้อมูลด้านความปลอดภัย/การรักษาความปลอดภัยที่จำกัดและการเปิดเผยข้อมูลตามกฎหมายยังคงมีผลบังคับใช้ |
| พื้นที่เศรษฐกิจยุโรป (EEA), สวิตเซอร์แลนด์ และสหราชอาณาจักร | เงื่อนไขการใช้ข้อมูลสำหรับบริการแบบเสียค่าบริการยังใช้บังคับกับบริการแบบไม่เสียค่าบริการในภูมิภาคเหล่านี้ด้วย | ลูกค้า API ที่เสนอให้ผู้ใช้ที่นี่ต้องใช้บริการแบบเสียค่าใช้จ่าย |
ความแตกต่างนี้เกิดจาก เงื่อนไข API ของ Gemini. AI Studio สามารถถือเป็นบริการแบบเสียค่าใช้จ่ายได้ผ่านโครงการ Cloud ที่เชื่อมโยงกับระบบการเรียกเก็บเงินที่ยังใช้งานอยู่ หรือบัญชี Workspace สำหรับองค์กร แม้ว่าการเข้าถึง Studio เองจะเป็นบริการฟรีก็ตาม.
- “ท้องถิ่น” ไม่หมายความว่า “สอดคล้องกับข้อกำหนด” โดยอัตโนมัติ: การปรับใช้ระบบและมาตรการควบคุมการเข้าถึงของคุณคือสิ่งที่กำหนดขอบเขตความเป็นส่วนตัว.
- การจ่ายเงินไม่หมายความว่าอัตราการรักษาลูกค้าเป็นศูนย์: ตรวจสอบการบันทึกข้อมูล สถานที่ประมวลผล และข้อกำหนดขององค์กรของคุณ.
- การสนับสนุนตามภูมิภาคเป็นระบบที่แยกต่างหาก: ตรวจสอบ พื้นที่ที่รองรับ API Gemini และเส้นทาง Vertex AI ที่เกี่ยวข้องเมื่อจำเป็น.
สิทธิในการเผยแพร่เป็นประเด็นที่แยกต่างหาก; ดู คู่มือการใช้ภาพ Gemini สำหรับวัตถุประสงค์เชิงพาณิชย์.
ค่าใช้จ่าย: อุปกรณ์ท้องถิ่น vs API
| รายการค่าใช้จ่าย | Gemma 4 สำหรับการติดตั้งเอง | Gemini API |
|---|---|---|
| การใช้แบบจำลอง | น้ำหนักที่สามารถดาวน์โหลดได้; ไม่มีการเรียกเก็บค่าโทเค็น Google สำหรับการอนุมานในท้องถิ่น | การใช้งานจะถูกคิดค่าบริการตามอัตราของแพ็กเกจที่เลือก |
| โครงสร้างพื้นฐาน | ฮาร์ดแวร์, หน่วยความจำ, พื้นที่จัดเก็บข้อมูล, แหล่งจ่ายไฟ และการให้บริการ | Google บริหารจัดการการส่งเนื้อหา |
| การดำเนินงาน | การติดตั้ง การปรับแต่ง การตรวจสอบ และการบำรุงรักษา | การบูรณาการ การลองใหม่ การควบคุมงบประมาณ และการตรวจสอบผลลัพธ์ |
| คุณสมบัติเพิ่มเติม | สร้างหรือเชื่อมต่อบริการของคุณเอง | ค่าใช้จ่ายสำหรับเครื่องมือ การเก็บข้อมูลชั่วคราว/พื้นที่จัดเก็บ และภาพและวิดีโออาจถูกคิดแยกกัน |
สำหรับปริมาณงานที่น้อยหรือเป็นครั้งคราว การใช้ API อาจมีค่าใช้จ่ายต่ำกว่าเวลาที่ใช้ในการสร้างระบบท้องถิ่น ส่วนปริมาณงานที่คงที่อาจเหมาะกับการโฮสต์เอง แต่สิ่งนี้ขึ้นอยู่กับระดับการใช้งานและค่าใช้จ่ายในการดำเนินงาน.
| แบบจำลอง API มาตรฐาน | ข้อมูลเข้า / 1 ล้านโทเคน | ผลผลิต / 1 ล้านโทเคน |
|---|---|---|
| Gemini 3.1 Pro พรีวิว | ≤200K: $2; >200K: $4 | ≤200K: $12; >200K: $18 |
| Gemini 3.8 Flash | จนถึงวันที่ 31 ธันวาคม 2026: $0.75; หลังจากนั้น $1.50 | จนถึงวันที่ 31 ธันวาคม 2026: $3.75; หลังจากนั้น $7.50 |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 |
ค่าใช้จ่ายสำหรับงานข้อความ 100 ชิ้นจะเป็นเท่าใด?
แต่ละครั้ง: 10,000 โทเคนข้อมูลเข้า + 1,000 โทเคนข้อมูลออกที่คิดค่าบริการ รวม: 1 ล้าน โทเคนข้อมูลเข้า + 100,000 โทเคนข้อมูลออก.
Gemini 3.1 Pro พรีวิว · $3.20
Gemini 3.8 Flash · $1.125 (ประมาณ $1.13)
Gemini 3.5 Flash-Lite · $0.55
ระดับ: 0–4 USD. คำนวณจาก อัตราค่าบริการ API มาตรฐานของ Google; นี่เป็นตัวอย่างค่าใช้จ่าย ไม่ใช่ผลการทดสอบ.
- การคำนวณ: อัตราการรับข้อมูล × 1 + อัตราการส่งข้อมูล × 0.1. ทุกคำขอจะอยู่ต่ำกว่าขีดจำกัด 200K ของ Pro.
- ผลลัพธ์รวมถึงโทเคนการคิด. จำนวน 1,000 โทเคน คือผลผลิตทั้งหมดที่สามารถเรียกเก็บเงินได้ ไม่ใช่เพียงคำตอบที่แสดงให้เห็นเท่านั้น.
- ไม่รวม: เครื่องมือ, การเก็บไว้ในแคช/การเก็บข้อมูล, การลองใหม่, ภาษี และการสร้างภาพ/วิดีโอ ไม่มีการให้ส่วนลดแบบกลุ่ม.
- โปรโมชั่นพิเศษ: $1.125 มีผลบังคับใช้จนถึงวันที่ 31 ธันวาคม 2026 ตามอัตราค่าบริการเมื่อวันที่ 1 มกราคม 2027 ปริมาณงานเดียวกันจะมีค่าเป็น $2.25.
- การซื้อแยกกัน: แผนบริการแอป Google AI, การใช้งาน API Gemini และการสมัครสมาชิก GlobalGPT มีระบบการเรียกเก็บเงินและสิทธิประโยชน์ที่แตกต่างกัน.
Veo คำนวณค่าบริการตามระยะเวลาของวิดีโอที่สร้างขึ้นและระดับ/ความละเอียดที่เลือกไว้ การสร้างภาพก็ใช้อัตราค่าบริการที่แตกต่างกัน; เปรียบเทียบ Nano Banana 2 โควตาและค่าใช้จ่าย API.
วิธีอ่านผลการทดสอบประสิทธิภาพ
ใช้เกณฑ์มาตรฐานเพื่อคัดเลือกรุ่นที่เหมาะที่สุดก่อน แล้วจึงทดสอบกับงานที่คุณต้องการจริงๆ ระบบที่โฮสต์และใช้เครื่องมือช่วย กับรุ่นที่ควอนไทซ์ในเครื่องท้องถิ่น เป็นวิธีการประเมินที่แตกต่างกัน.
- Gemma 4: การ บัตรข้อมูลตัวละครอย่างเป็นทางการ รายงานเกี่ยวกับกระบวนการคิด การเขียนโค้ด และผลลัพธ์จากหลายรูปแบบ รวมถึง MMLU-Pro, AIME 2026, LiveCodeBench, GPQA Diamond, MMMU-Pro และ MATH-Vision.
- Gemini 3.1 Pro: ของกูเกิล หน้าเปรียบเทียบประสิทธิภาพระดับมืออาชีพ ครอบคลุมหัวข้อทางวิทยาศาสตร์ที่ซับซ้อน การเขียนโค้ด และงานที่เกี่ยวข้องกับเอเจนต์ ผลลัพธ์จากการใช้เครื่องมือค้นหาหรือเครื่องมือเขียนโค้ดยังช่วยวัดประสิทธิภาพของระบบที่ได้รับการสนับสนุนจากเครื่องมือด้วย.
- เปรียบเทียบอย่างยุติธรรม: ควรปรับให้ตรงกับเวอร์ชันของโมเดล ข้อความคำสั่ง เครื่องมือ งบประมาณการคิด และการตั้งค่าการอนุมาน ก่อนที่จะเรียกใช้โมเดลหนึ่งตัวให้เหมาะสมยิ่งขึ้น.
| ตารางเกณฑ์มาตรฐานสามารถบอกอะไรคุณได้บ้าง | สิ่งที่พวกเขาไม่สามารถบอกคุณได้ |
|---|---|
| ไม่ว่าครอบครัวของโมเดลน้ำหนักเปิดจะกำลังลดช่องว่างในการให้เหตุผลที่ซับซ้อนและงานหลายรูปแบบหรือไม่ | ไม่ว่าจะถูกกว่าหรือง่ายกว่าสำหรับทีมของคุณในการนำไปใช้ |
| ไม่ว่าโมเดลแนวหน้าที่มีการโฮสต์จะมีประสิทธิภาพที่แข็งแกร่งกว่าในงานการเขียนโค้ดที่ยาก งานวิทยาศาสตร์ หรือภารกิจของตัวแทน | ไม่ว่าข้อได้เปรียบนั้นจะยังคงอยู่ภายใต้ข้อจำกัดด้านความหน่วง ความเป็นส่วนตัว หรืองบประมาณเฉพาะของคุณหรือไม่ |
| ไม่ว่าครอบครัวตัวอย่างจะมีความเข้มแข็งเพียงพอที่จะพิจารณาใช้เป็นแบบอย่างในระดับท้องถิ่นหรือไม่ | ไม่ว่ามันจะทำงานได้ดีกว่ารุ่นอื่นในคำสั่งและกระบวนการทำงานของคุณหรือไม่ |
| ไม่ว่ารูปแบบบริบทยาวและการสนับสนุนหลายรูปแบบจะเป็นมากกว่าคำโฆษณาทางการตลาดหรือไม่ | คุณภาพของผลลัพธ์เหมาะสมกับมาตรฐานในห้องเรียน งานวิจัย หรือความคิดสร้างสรรค์ของคุณหรือไม่ |
เพื่อทดลองด้วยตัวเอง โปรดบันทึกคุณภาพคำตอบ เวลาตอบสนอง และค่าใช้จ่ายการดำเนินงานรวม คะแนนที่เปิดเผยต่อสาธารณะไม่สามารถชี้ชัดได้ว่าการปรับใช้แบบใดมีค่าใช้จ่ายต่ำกว่าหรือมีความน่าเชื่อถือมากกว่าสำหรับทีมของคุณ.
เอกสาร การเขียนโค้ด และสื่อ

| งาน | วิธีการ Gemma 4 | วิธีการ Gemini |
|---|---|---|
| เอกสาร | แสดงหน้าเว็บหรือภาพจากฟีด; สร้างระบบการสกัดข้อมูล/OCR แบบท้องถิ่น และผลลัพธ์ที่มีโครงสร้าง | ใช้ความสามารถในการวิเคราะห์ PDF แบบดั้งเดิมสำหรับรูปแบบการจัดวางที่หลากหลาย รวมถึงแผนภูมิและตาราง |
| การวิจัย | เชื่อมต่อเครื่องมือค้นหา ค้นดู และตรวจสอบของคุณเอง | ใช้คุณสมบัติ Search grounding, URL Context และการดำเนินการโค้ดที่ได้รับการสนับสนุน |
| การเขียนโค้ด | ผสานรวมโมเดลเข้ากับเครื่องมือภายในและสภาพแวดล้อมทดสอบที่ได้รับการควบคุม | ใช้ระบบการให้เหตุผลแบบโฮสต์และเครื่องมือที่ได้รับการสนับสนุนสำหรับการเขียนโค้ดหลายขั้นตอน |
| รูปภาพ | กำหนดความต้องการ, จัดประเภทสินทรัพย์ และเขียนเอกสารสรุป | สร้างหรือแก้ไขด้วยโมเดลภาพ Nano Banana |
| วิดีโอ | วิเคราะห์เฟรมที่เลือกมา; จัดทำสตอรีบอร์ดและรายชื่อช็อต | สร้างวิดีโอจริงด้วย Veo |
หากต้องการกระบวนการจัดการเอกสารแบบอื่น โปรดเปรียบเทียบกับ กระบวนการทำงานของไฟล์ PDF ChatGPT.
สิบตัวอย่างการใช้งานจริง
| กระบวนการทำงานจริง | พอดีมากขึ้น | ทำไม |
|---|---|---|
| ผู้ช่วยสอนในห้องเรียนแบบออฟไลน์บนแล็ปท็อปของโรงเรียน | เจมม่า 4 | การติดตั้งใช้งานในท้องถิ่นและการทำงานแบบออฟไลน์มีความสำคัญมากกว่าเครื่องมือสื่อที่โฮสต์ |
| การสกัดสัญญาส่วนตัวภายในสภาพแวดล้อมที่ควบคุม | เจมม่า 4 | ขอบเขตข้อมูลสามารถอยู่ภายในโครงสร้างพื้นฐานของคุณได้ |
| การวิเคราะห์ชุดข้อมูลวิจัยจำนวน 500 หน้า | ราศีเมถุน | การเข้าใจบริบท 1 ล้านและไฟล์ PDF ต้นฉบับช่วยลดความขัดแย้งในกระบวนการ |
| การวิจัยเชิงแข่งขันที่อิงจากการค้นหา | ราศีเมถุน | การค้นหา, บริบทของ URL, และการใช้เครื่องมือถูกสร้างขึ้นในตัวในสแต็กที่โฮสต์ |
| การทำความเข้าใจภาพหน้าจอในท้องถิ่นและการคัดแยก UI | เจมม่า 4 | การมองเห็นพร้อมข้อความแสดงผลเพียงพอแล้ว และการใช้งานในท้องถิ่นสามารถทำให้ง่ายขึ้นได้ |
| การสร้างและแก้ไขภาพลักษณ์ทางการตลาด | แบบจำลองภาพ Gemini | การโฮสต์การสร้างและแก้ไขภาพได้รับการสนับสนุนอย่างเป็นทางการ |
| ขั้นตอนการทำงานจากสคริปต์ถึงวิดีโอสำเร็จรูป | ราศีเมถุน | Veo ในชุด API ของ Gemini รองรับการส่งออกวิดีโอโดยตรง |
| ผู้ช่วยเขียนโค้ดภายในที่กำหนดเองภายในสภาพแวดล้อมของคุณเอง | เจมม่า 4 | เหมาะสมยิ่งขึ้นเมื่อการควบคุมโมเดลและการโฮสต์ด้วยตนเองมีความสำคัญ |
| การสรุปข้อมูลปริมาณมากด้วยต้นทุนต่ำในระดับขนาดใหญ่ | Gemini Flash หรือ Flash-Lite หรือ Gemma 4 ขึ้นอยู่กับความพร้อมของระบบปฏิบัติการ | ราคาแบบโฮสต์อาจมีราคาถูกกว่าสำหรับทีมขนาดเล็ก แต่การโฮสต์เองอาจคุ้มค่ากว่าเมื่อใช้งานในระดับใหญ่ |
| การทดลองการอนุมานบนอุปกรณ์เคลื่อนที่และเอดจ์ | เจมม่า 4 | Google กำลังวางตำแหน่ง Gemma 4 อย่างชัดเจนสำหรับ GPU สำหรับผู้บริโภค, เซิร์ฟเวอร์ที่เน้นการใช้งานในท้องถิ่น และเส้นทางสำหรับ Android |
- นักเรียนและครู: คู่มือการเรียนแบบท้องถิ่น, สรุปสไลด์การบรรยาย และผู้ช่วยในห้องเรียนแบบออฟไลน์ เหมาะกับ Gemma; ส่วนเอกสารยาวและทรัพยากรสำหรับการนำเสนอ เหมาะกับเครื่องมือที่ Gemini ให้บริการ.
- นักวิจัย: เก็บชุดข้อมูลส่วนตัวไว้ในระบบท้องถิ่นเมื่อจำเป็น; ใช้ Gemini สำหรับการสังเคราะห์เอกสารขนาดใหญ่และงานที่อิงจากเว็บ เมื่อนโยบายข้อมูลอนุญาต.
- นักการตลาดและผู้สร้างเนื้อหา: Gemma สามารถจัดเรียงบทสรุปและวัสดุอ้างอิงได้ ส่วนทีมงานผู้เชี่ยวชาญด้านสื่อที่ได้รับการจัดเตรียมไว้จะดำเนินการจนได้ภาพหรือวิดีโอที่เสร็จสมบูรณ์.
สำหรับส่วนวิดีโอ ให้ใช้ คู่มือการใช้งาน Veo 3.1.
สองคำสั่งให้ลอง
Gemma 4: การดึงข้อมูลใบแจ้งหนี้ส่วนตัว. กระบวนการทำงานนี้เก็บไฟล์ต้นฉบับไว้ในเครื่องท้องถิ่นและสร้างข้อความที่มีโครงสร้าง.
คุณกำลังอ่านหน้าใบแจ้งหนี้และภาพหน้าจอจากโฟลเดอร์ของผู้ขายรายเดียวกัน สำหรับแต่ละหน้า: 1. สกัดหมายเลขใบแจ้งหนี้, วันที่ออก, วันที่ครบกำหนด, รายการบรรทัด, ยอดรวมย่อย, ภาษี, และยอดรวม 2. ทำเครื่องหมายช่องที่มีความมั่นใจต่ำ 3. หากค่าใดปรากฏเฉพาะในบริเวณภาพ ให้ระบุ 4. ส่งคืนเฉพาะ JSON ที่ถูกต้องเท่านั้น.
- อินพุต: หน้าใบแจ้งหนี้และภาพหน้าจอ.
- ผลลัพธ์: JSON รวมถึงตัวบ่งชี้ความมั่นใจต่ำ.
- หน้าที่ของคุณ: ตรวจสอบความถูกต้องของข้อมูลในช่องต่าง ๆ และยอดรวมก่อนส่งไปยังระบบอื่น.
Gemini: กระบวนการทำงานจากรายงานสู่แคมเปญ. ใช้เครื่องมือวิเคราะห์เอกสารและ URL แล้วส่งบทสรุปที่ได้ไปยังโมเดลสื่อที่เหมาะสม.
อ่านรายงานตลาด 300 หน้าและหน้าบริษัทที่เชื่อมโยง สรุปการเปลี่ยนแปลงที่สำคัญที่สุดห้าประการสำหรับทีม SaaS ในสหรัฐอเมริกา สำหรับแต่ละการเปลี่ยนแปลง ให้: - คำอธิบายที่เข้าใจง่าย - หนึ่งคำพูดหรือข้อมูลที่มีหลักฐานสนับสนุน - หนึ่งผลกระทบต่อผลิตภัณฑ์ - หนึ่งผลกระทบต่อการตลาด จากนั้นเปลี่ยนสรุปให้เป็น: - โครงร่างการนำเสนอหกสไลด์ - บทสรุปกราฟิกสำหรับโซเชียล - บทสคริปต์วิดีโอ 45 วินาที
- อินพุต: รายงาน 300 หน้า และหน้าข้อมูลบริษัท.
- ผลลัพธ์: การวิเคราะห์ที่อิงจากหลักฐาน, โครงร่างสไลด์, คำอธิบายภาพ และบทพูดในวิดีโอ.
- ขั้นตอนต่อไป: การสร้างภาพหรือวิดีโอต้องเรียกใช้โมเดลแยกต่างหาก; คำสั่งนี้จะสร้างแผนงาน.
สำหรับขั้นตอนการปรับภาพ ให้ดำเนินการต่อด้วย คู่มือการใช้งาน Nano Banana Pro.
เมื่อใดควรใช้ทั้งสองอย่าง

- สนับสนุนธุรกิจท้องถิ่น: การสกัดข้อมูลที่ละเอียดอ่อน การคัดกรองภาพหน้าจอ การจัดประเภทเอกสารส่วนตัว และการอนุมานแบบ edge.
- ตรวจสอบขั้นตอนการส่งต่อ: อนุมัติหรือแก้ไขเนื้อหาก่อนที่จะส่งออกจากระบบภายในองค์กร.
- ส่งไปยังคลาวด์: การสังเคราะห์เอกสารยาว การวิจัยบนเว็บในปัจจุบัน และการผลิตสื่อ.
- เลือกตามผลลัพธ์ที่คาดหวัง: ผู้ก่อตั้งอาจใช้ Gemma เวอร์ชันท้องถิ่นสำหรับการวิเคราะห์แบบส่วนตัว, Gemini สำหรับการสังเคราะห์ และโมเดลอื่นสำหรับการปรับแต่งเสียงของแบรนด์.
รายชื่อผลิตภัณฑ์ของ GlobalGPT รวมถึง Gemini 3.1 Pro, Gemini 3.8 Flash, Nano Banana Pro, Nano Banana 2 และ Veo 3.1 พร้อมกับรุ่นที่ไม่ใช่ของ Google พื้นที่ทำงานแบบรวมสามารถช่วยลดการสลับแท็บระหว่างการวิจัย การเขียน การจัดการภาพ และวิดีโอ.
5 ข้อผิดพลาดที่ควรหลีกเลี่ยง
- “น้ำหนักที่ดาวน์โหลดมา หมายถึงการผลิตแบบฟรี” พิจารณาด้านฮาร์ดแวร์ หน่วยความจำ พลังงาน วิศวกรรม และการบำรุงรักษา.
- “ทุกระดับของ Gemini ล้วนจัดการข้อมูลด้วยวิธีเดียวกัน” เปรียบเทียบเงื่อนไขการให้บริการจริงและเงื่อนไขตามภูมิภาค.
- “Multimodal หมายถึงการสร้างภาพและวิดีโอ” Gemma สามารถเข้าใจข้อมูลภาพได้ แต่ให้ผลลัพธ์เป็นข้อความ.
- “ระบบคลาวด์มาแทนที่ทุกกรณีการใช้งานแบบท้องถิ่น” การดำเนินการแบบออฟไลน์และการโฮสต์ด้วยตนเองยังคงต้องการเส้นทางติดตั้งในเครื่องท้องถิ่น.
- “มาตรฐานสูงสุดคือผู้ชนะ” คำสั่ง เครื่องมือ ค่าเป้าหมายความล่าช้า และขอบเขตข้อมูลของคุณอาจส่งผลต่อผลลัพธ์ที่เกิดขึ้นจริง.
คุณควรเลือกอันไหนดี?

| เลือก… | เมื่อสิ่งเหล่านี้เป็นสิ่งที่คุณให้ความสำคัญเป็นอันดับแรก |
|---|---|
| เจมม่า 4 | การเข้าถึงแบบออฟไลน์; การควบคุมน้ำหนักและเวลาการทำงาน; การสกัดข้อมูลท้องถิ่นที่ละเอียดอ่อน; การปรับใช้บนอุปกรณ์ปลายทาง |
| ราศีเมถุน | งานบริการน้อยลง; เอกสารยาว; เครื่องมือที่ได้รับการจัดการ; สามารถเข้าถึงโมเดลภาพและวิดีโอที่แยกกัน |
| ทั้งสอง | ดำเนินการเตรียมข้อมูลแบบส่วนตัวในระบบท้องถิ่นก่อน แล้วจึงดำเนินการวิจัยหรือผลิตในระบบคลาวด์ที่ได้รับการอนุมัติ |
Gemma 4 ให้คุณควบคุมได้เต็มที่ ส่วน Gemini ให้คุณใช้แพลตฟอร์มที่ได้รับการจัดการ. เลือกแพ็กเกจที่เหมาะสมกับปริมาณงานของคุณ และระดับความพยายามในการดำเนินงานที่ทีมของคุณสามารถรับมือได้.
ก่อนที่คุณจะตัดสินใจ
- กำหนดผลลัพธ์: text/JSON, ภาพ, วิดีโอ หรือการดำเนินการในเครื่องมืออื่น.
- กำหนดขอบเขตข้อมูล: ข้อมูลใดอาจถูกส่งออกจากระบบของคุณ?
- ประมาณการปริมาณงาน: คำขอ, โทเค็น, การทำงานพร้อมกัน และเวลาทำงานที่จำเป็น.
- ระบุชื่อตัวดำเนินการ: ใครเป็นฝ่ายรับผิดชอบงบประมาณและปัญหาการให้บริการในระบบท้องถิ่นหรือระบบคลาวด์?
- ลองทำงานตัวอย่างหนึ่ง: ตรวจสอบคุณภาพ ความล่าช้า และค่าใช้จ่ายรวม ก่อนที่จะขยายระบบ.
คำถามที่พบบ่อย
Gemma 4 สามารถทำงานแบบออฟไลน์ได้หรือไม่?
ใช่ครับ โดยใช้ค่าน้ำหนักที่ดาวน์โหลดมาและสภาพแวดล้อมการทำงานในเครื่องที่เหมาะสม อย่างไรก็ตาม การค้นหาจากภายนอก เครื่องมือระยะไกล และการดาวน์โหลดโมเดล ยังคงต้องมีการเชื่อมต่ออินเทอร์เน็ตเป็นของตัวเอง.
รุ่น Gemma 4 ใดที่รองรับเสียง?
E2B, E4B และ 12B Unified รองรับข้อมูลเสียง ทั้งห้าขนาดนี้รองรับข้อความและภาพ และสามารถสร้างข้อความได้ แต่ไม่ใช่เครื่องมือสร้างภาพหรือวิดีโอแบบดั้งเดิม.
Gemma 4 ราคาถูกกว่า Gemini หรือไม่?
ขึ้นอยู่กับวิธีการใช้งานและโครงสร้างพื้นฐาน การใช้แบบโลคัลจะโอนค่าใช้จ่ายไปยังฮาร์ดแวร์และค่าใช้จ่ายในการดำเนินงาน ส่วน Gemini จะคิดค่าบริการตามการใช้งาน API และเครื่องมือเพิ่มเติมใดๆ.
แพ็กเกจ Gemini มีเครดิต API รวมอยู่ด้วยหรือไม่?
แผน Google AI สำหรับผู้บริโภคและระบบการคิดค่าบริการ API Gemini เป็นการซื้อที่แยกกัน โปรดเปรียบเทียบสิทธิ์การใช้งานของแอปเฉพาะหรือตารางราคาสำหรับนักพัฒนาที่สอดคล้องกับกระบวนการทำงานของคุณ.
สามารถใช้ Gemini ไปจนถึง GlobalGPT ได้หรือไม่?
GlobalGPT ให้บริการเส้นทางแบบจำลอง Gemini พร้อมกับกลุ่มแบบจำลองอื่น ๆ และเครื่องมือสื่อต่าง ๆ ระบบการเรียกเก็บเงินและระบบควบคุมของ GlobalGPT แยกต่างหากจากแอป Google ดั้งเดิมและบัญชี API.



