เจมม่า 4 กับ เจมินี, ชุดเครื่องมือปัญญาประดิษฐ์ของกูเกิลใดที่เหมาะกับกระบวนการทำงานของคุณ

เจมม่า 4 กับ เจมินี, ชุดเครื่องมือปัญญาประดิษฐ์ของกูเกิลใดที่เหมาะกับกระบวนการทำงานของคุณ

เลือก Gemma 4 สำหรับการติดตั้งในระบบท้องถิ่น แบบออฟไลน์ หรือตามความต้องการเฉพาะ เลือก Gemini สำหรับการวิจัยแบบมีผู้ดูแล การวิเคราะห์เอกสารยาว และการเข้าถึงเครื่องมือรูปภาพและวิดีโอของ Google. ความแตกต่างที่ใหญ่ที่สุดคือว่าคุณต้องการจัดการระบบด้วยตัวเองมากแค่ไหน.

  • Gemma 4: น้ำหนักที่ดาวน์โหลดได้; 5 ขนาด; บริบท 128K–256K; ผลลัพธ์เป็นข้อความ.
  • ราศีเมถุน: โมเดลที่โฮสต์; โมเดลที่เปรียบเทียบกันในที่นี้มีจำนวนโทเคนอินพุตสูงสุด 1 ล้าน; เครื่องมือที่ได้รับการจัดการ และโมเดลสื่อที่แยกต่างหาก.
  • ใช้ทั้งสองอย่าง: เก็บข้อมูลที่ละเอียดอ่อนไว้ในระบบท้องถิ่น แล้วส่งข้อมูลที่ได้รับการอนุมัติไปยังระบบคลาวด์ เพื่อใช้ในวัตถุประสงค์การวิจัยหรือการผลิต.

The บัตรแบบ Gemma 4 กำหนดกลุ่มโมเดลท้องถิ่น สำหรับจุดเริ่มต้นที่ได้รับการจัดการ ให้ลอง Gemini 3.1 Pro บน GlobalGPT.

เลือกตามกระบวนการทำงาน

เริ่มจากข้อกำหนดที่ไม่สามารถเจรจาได้ก่อน โมเดลมาตรฐานไม่สามารถกำหนดได้ว่าไฟล์ของคุณจะถูกจัดเก็บไว้ที่ใด หรือใครจะเป็นผู้ดูแลระบบ.

  • ต้องทำงานแบบออฟไลน์ได้หรือไม่? Gemma 4 สามารถทำงานได้หลังจากติดตั้งน้ำหนักและเวลาการทำงานแล้ว.
  • ต้องการควบคุมน้ำหนัก อุปกรณ์ และการปรับแต่งหรือไม่? Gemma 4 ให้คุณควบคุมได้ทั้งหมด — รวมถึงงานปฏิบัติการด้วย.
  • ต้องการผลลัพธ์ภายในสัปดาห์นี้โดยไม่ต้องเตรียมการมาก? Gemini ช่วยลดภาระงานด้านการให้บริการและการปรับขนาดลงอย่างมาก.
  • ต้องการภาพหรือวิดีโอที่เสร็จเรียบร้อยแล้วหรือไม่? ใช้โมเดลภาพเฉพาะหรือ Veo ในระบบที่ Google จัดการ โมเดลข้อความเพียงอย่างเดียวไม่สามารถสร้างทรัพยากรเหล่านั้นได้.

หากต้องการเลือกแบบต่าง ๆ ได้มากขึ้นในที่เดียว, โกลบอลจีพีที ให้บริการการเข้าถึง 100 โมเดลปัญญาประดิษฐ์, โดยแพ็กเกจเริ่มต้นที่ ต่ำกว่า 1,000,000 บาทต่อเดือน.

gemini 3 pro บน globalgpt

Gemma 4 vs Gemini: สรุปข้อมูลสำคัญ

หมวดหมู่เจมม่า 4ราศีเมถุน
มันคืออะไรครอบครัวโมเดลน้ำหนักเปิดจาก Googleโมเดลคลาวด์แบบจัดการและระบบนิเวศบริการจาก Google
วิธีที่คุณเข้าถึงมันดาวน์โหลดน้ำหนักและรันผ่านรันไทม์ที่รองรับหรือแพลตฟอร์มพันธมิตรGemini API, Google AI Studio, แผน Google AI, Vertex AI, แอป Gemini
รูปแบบการปรับใช้โฮสต์เอง, ขอบ, ท้องถิ่นก่อน, โฮสต์โดยพันธมิตรจัดโดย Google
การใช้งานแบบออฟไลน์ใช่ ขึ้นอยู่กับการตั้งค่าของคุณเองไม่, ไม่ใช่ในความหมายเดียวกัน
หน้าต่างบริบท128K บน E2B/E4B; 256K บน 12B Unified, 31B และ 26B A4Bโทเค็นสูงสุด 1 ล้านเหรียญบนโมเดลนักพัฒนา Gemini 3 ปัจจุบัน
ประเภทของข้อมูลนำเข้าข้อความและภาพปรากฏในทุกรุ่น; เสียงต้นฉบับในรุ่น E2B, E4B และ 12B Unifiedข้อความ, รูปภาพ, วิดีโอ, เสียง, เอกสาร, และกระบวนการทำงานที่ใช้เครื่องมือเป็นตัวกลาง ขึ้นอยู่กับแบบจำลอง
ประเภทของผลลัพธ์ข้อความข้อความทั่วไป พร้อมการสร้างภาพและวิดีโอผ่านชุดโมเดลที่โฮสต์โดย Google
เครื่องมือการเรียกใช้ฟังก์ชันและการสนับสนุนการเขียนโค้ดในระดับโมเดล แต่การจัดระเบียบเป็นหน้าที่ของคุณการค้นหา, บริบท URL, การดำเนินการโค้ด, การเรียกใช้ฟังก์ชัน, ผลลัพธ์ที่มีโครงสร้าง, API สื่อ
ขอบเขตความเป็นส่วนตัวกำหนดโดยโครงสร้างพื้นฐานและตัวเลือกการปรับใช้ของคุณกำหนดโดยระดับบริการและข้อกำหนดของ Google
แบบจำลองต้นทุนดาวน์โหลดโมเดลพร้อมฮาร์ดแวร์, ที่เก็บข้อมูล, การปรับแต่ง, และค่าใช้จ่ายในการดำเนินงานการกำหนดราคาคลาวด์แบบใช้โทเค็นหรือสื่อ, พร้อมระดับฟรีและแบบเสียค่าใช้จ่าย
เหมาะสมที่สุดระบบ AI ภายในองค์กร, การติดตั้งใช้งานส่วนตัว, กระบวนการทำงานที่ปรับแต่งเอง, การใช้งานที่ขอบเครือข่ายการวิจัยที่มีการจัดการ การวิเคราะห์บริบทระยะยาว การทำงานบนคลาวด์แบบหลายรูปแบบ การทำงานกับภาพและวิดีโอ
ไม่เหมาะสมการผลิตสื่อแบบครบวงจรหรือความสะดวกสบายบนคลาวด์แบบไม่ต้องดูแลควบคุมแบบออฟไลน์ก่อนหรือควบคุมด้วยตนเองอย่างเต็มรูปแบบ

การเปรียบเทียบมีดังต่อไปนี้ เอกสารการติดตั้ง Gemma ของ Google และข้อมูลจำเพาะของรุ่นนักพัฒนา Gemini; การสมัครสมาชิกแอปและการเข้าถึง API เป็นผลิตภัณฑ์ที่แยกกัน.

การตัดสินใจที่ชาญฉลาดเริ่มต้นจากการเหมาะสมกับการดำเนินงาน ไม่ใช่การสร้างแบรนด์แบบโมเดล

Gemma 4: โมเดลและความจำ

Gemma 4 เปิดตัวเมื่อวันที่ 31 มีนาคม 2026. The บัตรรุ่นปัจจุบัน ระบุ E2B, E4B, 12B Unified, 26B A4B และ 31B ภายใต้ใบอนุญาต Apache 2.0 ทุกโปรแกรมรับข้อมูลแบบข้อความและภาพ และส่งคืนผลลัพธ์เป็นข้อความ.

ตัวแปรบริบทช่องรับเสียงบทบาททั่วไป
อี2บี128 กิโลไบต์ใช่จุดเข้าสำหรับอุปกรณ์ที่มีข้อจำกัด
E4B128 กิโลไบต์ใช่ตัวเลือกท้องถิ่นที่กว้างขึ้นสำหรับสภาพแวดล้อมที่มีข้อจำกัด
12B Unified256 กิโลไบต์ใช่ตัวเลือกกลางที่มีระบบรับข้อมูลแบบหลายรูปแบบที่รวมเป็นหนึ่ง
26B A4B256 กิโลไบต์ไม่กลุ่มผู้เชี่ยวชาญ; มีพารามิเตอร์ที่ใช้งานอยู่ประมาณ 4 พันล้านตัว
31B256 กิโลไบต์ไม่แบบจำลองที่มีความหนาแน่นสูงที่สุดในกลุ่มนี้
  • การเข้าใจ: การวิเคราะห์เอกสาร, OCR, ตัวอักษรเขียนมือ, แผนภูมิ, ส่วนติดต่อผู้ใช้, การเขียนโค้ด และการเรียกฟังก์ชัน.
  • ขอบเขตของเสียงและวิดีโอ: บัตรข้อมูลแบบจำลองบันทึกเสียงได้สูงสุด 30 วินาที และวิดีโอได้สูงสุด 60 วินาที ด้วยอัตรา 1 เฟรมต่อวินาที วันที่ตัดข้อมูลฝึกอบรม: มกราคม 2025.
  • 12B Unified: ส่งภาพแพตช์และรูปคลื่นเสียงเข้าสู่โมเดลภาษา โดยไม่ต้องใช้ตัวเข้ารหัสแยกต่างหาก.
  • การติดตั้ง: ระบบรันไทม์ที่มีอยู่ ได้แก่ Hugging Face, Ollama, vLLM, llama.cpp, MLX และ LM Studio โปรดเลือกระบบรันไทม์ที่รองรับโมเดลและฮาร์ดแวร์ที่คุณเลือก.
ตัวแปรหน่วยความจำ BF16หน่วยความจำ SFP8หน่วยความจำ Q4_0
อี2บี11.4 GB5.7 GB2.9 GB
E4B17.9 GB8.9 GB4.5 GB
12B Unified26.7 GB13.4 GB6.7 GB
26B A4B57.7 GB28.8 GB14.4 GB
31B69.9 GB34.9 GB17.5 GB

Gemma 4: ความจำที่จำเป็นสำหรับการโหลดโมเดล

Q4_0 (4-bit) การประมาณค่า แถบที่เล็กกว่าแสดงถึงพื้นที่การโหลดของโมเดลที่น้อยลง.

อี2บี · 2.9 GB

E4B · 4.5 GB

12B Unified · 6.7 GB

26B A4B · 14.4 GB

31B · 17.5 GB

ช่วง: 0–20 GB. ที่มา: ตารางหน่วยความจำ Gemma ของ Google. นี่เป็นค่าประมาณการโหลด ไม่ใช่ความต้องการหน่วยความจำของแอปพลิเคชันทั้งหมด.

ตารางของ Google ระบุว่ามีค่าใช้จ่ายในการโหลด 20% ให้เหลือพื้นที่เพิ่มเติมสำหรับแคชบริบท (context cache), การทำงานในเวลาจริง (runtime) และการทำงานพร้อมกัน (concurrency); การปรับแต่งให้ละเอียดยิ่งขึ้นต้องการหน่วยความจำเพิ่มเติม โมเดล A4B ขนาด 26B ยังคงโหลดน้ำหนักของเอ็กซ์เพิร์ตทั้งหมด แม้จะมีเพียงส่วนย่อยเท่านั้นที่ทำงานอยู่ต่อโทเคน.

Gemma 4 พัฒนาต่อจากงานวิจัย Gemini 3 โดยมีเส้นทางการนำไปใช้ทั้งใน GPU สำหรับผู้บริโภค เซิร์ฟเวอร์ท้องถิ่น และอุปกรณ์มือถือ แผนการเปิดตัว Android AICore เวอร์ชันทดลองสำหรับนักพัฒนาของ Google และแผนการพัฒนา Gemini Nano รุ่นต่อไป ได้อธิบายไว้ใน ภาพรวมของ Gemma 4.

สำหรับกลุ่มน้ำหนักเปิดอีกกลุ่มหนึ่ง ให้เปรียบเทียบความคาดหวังในการปรับใช้กับของเรา รีวิว Kimi K3.

รุ่น Gemini ใดที่เหมาะกับความต้องการ?

เลือกรุ่นที่เหมาะสมกับงานนั้น หมายเลขเวอร์ชัน Flash ที่สูงขึ้นไม่ได้แทนที่ตระกูล Pro ได้ ไดเรกทอรีรุ่น Gemini แยกโมเดลการให้เหตุผล โมเดลภาพ และโมเดลวิดีโอ.

แบบหรือผลิตภัณฑ์ใช้สำหรับขอบเขตการเข้าถึง
Gemini 3.1 Pro พรีวิวการวิเคราะห์เชิงเหตุผลที่ซับซ้อน การเขียนโค้ด และการวิเคราะห์แบบหลายรูปแบบข้อความที่แสดงบนโฮสต์
Gemini 3.8 Flashกระบวนการทำงานแบบเอเจนต์และงานผลิตทั่วไปข้อความที่แสดงบนโฮสต์
Gemini 3.5 Flash-Liteการแปลในปริมาณมากและการประมวลผลที่เรียบง่ายข้อความที่แสดงบนโฮสต์
Nano Banana Pro / Nano Banana 2การสร้างและแก้ไขภาพโมเดลภาพเฉพาะทาง
Veo 3.1การสร้างวิดีโอแยกโมเดลวิดีโอและระบบการเรียกเก็บเงิน
  • แอป Gemini + แผน Google AI: การเข้าถึงของผู้ใช้และสิทธิ์การใช้งานแอป.
  • Google AI Studio: การสร้างต้นแบบสำหรับนักพัฒนา.
  • API Gemini: การบูรณาการระบบกับระบบการคิดค่าบริการสำหรับนักพัฒนา.
  • Vertex AI: การติดตั้ง Google Cloud และระบบควบคุมระดับองค์กร; ตรวจสอบความพร้อมใช้งานและเงื่อนไขของบริการเอง.

เพื่อเข้าถึงแอป โปรดดู คู่มือใช้งานฟรี Gemini Pro.

การควบคุม vs ความสะดวกสบาย

หากคุณให้ความสำคัญกับการควบคุมโมเดล Gemma 4 คือตัวเลือกที่ซื่อตรงกว่า.
คุณมีหน้าที่รับผิดชอบ...Gemma 4 ที่ติดตั้งบนเซิร์ฟเวอร์ของตัวเองGemini API
การให้บริการและการขยายระบบฮาร์ดแวร์, ระบบปฏิบัติการ, ความจุ และการอัปเดตGoogle ดำเนินการให้บริการโมเดล
เครื่องมือและการค้นหาสร้างและรักษาความสัมพันธ์เครื่องมือที่ติดตั้งมาพร้อมระบบ (หากมี); ปรับแต่งกระบวนการทำงานของคุณ
ความน่าเชื่อถือการติดตามผล, แผนสำรอง, ความเร็วการประมวลผล และการแปลงค่าจัดการข้อผิดพลาดของ API, ขีดจำกัด, การลองใหม่ และงบประมาณ
ข้อมูลและความปลอดภัยการควบคุมการเข้าถึง, บันทึกกิจกรรม และพฤติกรรมของเครื่องมือในระบบเลือกระดับบริการและกำหนดการจัดการข้อมูลอย่างปลอดภัย

Gemma ให้คุณควบคุมได้มากขึ้น ส่วน Gemini ช่วยประหยัดเวลาในการตั้งค่า แต่ทั้งสองระบบยังคงต้องการผู้รับผิดชอบด้านความน่าเชื่อถือและคุณภาพผลลัพธ์ของแอปพลิเคชัน.

บริบทและการสนับสนุนสื่อ

ความสามารถเจมม่า 4ชุดเครื่องมือพัฒนา Gemini
บริบทของข้อมูลที่ป้อนเข้า128K: E2B/E4B; 256K: 12B/26B/31B1,048,576 โทเคนข้อมูลเข้าในเวอร์ชัน 3.1 Pro, 3.8 Flash และ 3.5 Flash-Lite
ข้อความที่แสดงใช่; ข้อมูลที่สกัดมา, บทสรุป, รหัส และข้อมูลที่มีโครงสร้างใช่; สามารถสร้างโทเคนผลลัพธ์ได้สูงสุด 65,536 โทเคนในทั้งสามโมเดลนั้น
การเข้าใจทางภาพรูปภาพ เอกสาร แผนภูมิ ภาพหน้าจอ และคลิปวิดีโอตัวอย่างรูปภาพ วิดีโอ และไฟล์ PDF; เครื่องมือเฉพาะรุ่น
การเข้าใจเสียงE2B, E4B และ 12B รวมเป็นหนึ่งได้รับการสนับสนุนจากสามแบบจำลองข้างต้น
การสร้างภาพ/วิดีโอไม่ใช่ผลลัพธ์แบบดั้งเดิมแบบจำลองภาพเฉพาะและ Veo; ไม่ใช่ผลลัพธ์จากแบบจำลองข้อความ Pro/Flash

ข้อจำกัดเกิดจาก บัตรข้อมูลแบบ Gemma และข้อมูลจำเพาะของรุ่นแต่ละรุ่นของ Gemini การใช้หน้าต่างบริบทที่ใหญ่ขึ้นไม่ได้รับประกันว่าคำตอบจะแม่นยำขึ้น.

  • ผลงานที่ Gemma ต้องส่งมอบ: ไฟล์ JSON ของใบแจ้งหนี้, สรุปเนื้อหาสไลด์, ข้อความคำพูดที่แปลแล้ว, รายการงานจากภาพหน้าจอ และโครงร่างการวิจัย.
  • การจัดการเอกสาร Gemini: ความสามารถในการเข้าใจไฟล์ PDF แบบดั้งเดิม รวมถึงแผนภูมิและตาราง; ขนาดสูงสุด 50 MB หรือ 1,000 หน้า โดยข้อมูลที่ป้อนเข้าทั้งหมดยังคงถูกจำกัดโดยบริบทของโมเดล.
  • การผลิตสื่อ: ใช้แบบจำลองภาพหรือวิดีโอที่แยกต่างหากหลังจากเตรียมบทสรุปแล้ว.

ข้อจำกัดเกี่ยวกับไฟล์และหน้าได้อธิบายไว้ใน เอกสาร PDF ของ Google.

ความเป็นส่วนตัว: เปรียบเทียบระดับบริการ

การตั้งค่าข้อมูลจะถูกนำไปใช้อย่างไร?สิ่งที่ควรตรวจสอบ
Gemma 4 ที่ติดตั้งบนเซิร์ฟเวอร์ของตัวเองการอนุมานสามารถยังคงอยู่บนอุปกรณ์ฮาร์ดแวร์ที่คุณควบคุมได้เครื่องมือระยะไกล, การวัดระยะไกล, บันทึก, สิทธิ์การเข้าถึง และการสำรองข้อมูล
บริการ API Gemini ที่ยังไม่ได้ชำระข้อมูลที่ป้อนเข้าและข้อมูลที่ส่งออกอาจช่วยปรับปรุงผลิตภัณฑ์ของ Google; อาจมีการตรวจสอบโดยมนุษย์อย่าส่งข้อมูลที่ละเอียดอ่อนตามเงื่อนไขเหล่านี้; มีข้อยกเว้นตามภูมิภาค
บริการแบบชำระเงินของ API Geminiคำสั่งและคำตอบไม่ถูกใช้เพื่อปรับปรุงผลิตภัณฑ์ของ Googleการบันทึกข้อมูลด้านความปลอดภัย/การรักษาความปลอดภัยที่จำกัดและการเปิดเผยข้อมูลตามกฎหมายยังคงมีผลบังคับใช้
พื้นที่เศรษฐกิจยุโรป (EEA), สวิตเซอร์แลนด์ และสหราชอาณาจักรเงื่อนไขการใช้ข้อมูลสำหรับบริการแบบเสียค่าบริการยังใช้บังคับกับบริการแบบไม่เสียค่าบริการในภูมิภาคเหล่านี้ด้วยลูกค้า API ที่เสนอให้ผู้ใช้ที่นี่ต้องใช้บริการแบบเสียค่าใช้จ่าย

ความแตกต่างนี้เกิดจาก เงื่อนไข API ของ Gemini. AI Studio สามารถถือเป็นบริการแบบเสียค่าใช้จ่ายได้ผ่านโครงการ Cloud ที่เชื่อมโยงกับระบบการเรียกเก็บเงินที่ยังใช้งานอยู่ หรือบัญชี Workspace สำหรับองค์กร แม้ว่าการเข้าถึง Studio เองจะเป็นบริการฟรีก็ตาม.

  • “ท้องถิ่น” ไม่หมายความว่า “สอดคล้องกับข้อกำหนด” โดยอัตโนมัติ: การปรับใช้ระบบและมาตรการควบคุมการเข้าถึงของคุณคือสิ่งที่กำหนดขอบเขตความเป็นส่วนตัว.
  • การจ่ายเงินไม่หมายความว่าอัตราการรักษาลูกค้าเป็นศูนย์: ตรวจสอบการบันทึกข้อมูล สถานที่ประมวลผล และข้อกำหนดขององค์กรของคุณ.
  • การสนับสนุนตามภูมิภาคเป็นระบบที่แยกต่างหาก: ตรวจสอบ พื้นที่ที่รองรับ API Gemini และเส้นทาง Vertex AI ที่เกี่ยวข้องเมื่อจำเป็น.

สิทธิในการเผยแพร่เป็นประเด็นที่แยกต่างหาก; ดู คู่มือการใช้ภาพ Gemini สำหรับวัตถุประสงค์เชิงพาณิชย์.

ค่าใช้จ่าย: อุปกรณ์ท้องถิ่น vs API

รายการค่าใช้จ่ายGemma 4 สำหรับการติดตั้งเองGemini API
การใช้แบบจำลองน้ำหนักที่สามารถดาวน์โหลดได้; ไม่มีการเรียกเก็บค่าโทเค็น Google สำหรับการอนุมานในท้องถิ่นการใช้งานจะถูกคิดค่าบริการตามอัตราของแพ็กเกจที่เลือก
โครงสร้างพื้นฐานฮาร์ดแวร์, หน่วยความจำ, พื้นที่จัดเก็บข้อมูล, แหล่งจ่ายไฟ และการให้บริการGoogle บริหารจัดการการส่งเนื้อหา
การดำเนินงานการติดตั้ง การปรับแต่ง การตรวจสอบ และการบำรุงรักษาการบูรณาการ การลองใหม่ การควบคุมงบประมาณ และการตรวจสอบผลลัพธ์
คุณสมบัติเพิ่มเติมสร้างหรือเชื่อมต่อบริการของคุณเองค่าใช้จ่ายสำหรับเครื่องมือ การเก็บข้อมูลชั่วคราว/พื้นที่จัดเก็บ และภาพและวิดีโออาจถูกคิดแยกกัน

สำหรับปริมาณงานที่น้อยหรือเป็นครั้งคราว การใช้ API อาจมีค่าใช้จ่ายต่ำกว่าเวลาที่ใช้ในการสร้างระบบท้องถิ่น ส่วนปริมาณงานที่คงที่อาจเหมาะกับการโฮสต์เอง แต่สิ่งนี้ขึ้นอยู่กับระดับการใช้งานและค่าใช้จ่ายในการดำเนินงาน.

แบบจำลอง API มาตรฐานข้อมูลเข้า / 1 ล้านโทเคนผลผลิต / 1 ล้านโทเคน
Gemini 3.1 Pro พรีวิว≤200K: $2; >200K: $4≤200K: $12; >200K: $18
Gemini 3.8 Flashจนถึงวันที่ 31 ธันวาคม 2026: $0.75; หลังจากนั้น $1.50จนถึงวันที่ 31 ธันวาคม 2026: $3.75; หลังจากนั้น $7.50
Gemini 3.5 Flash-Lite$0.30$2.50

ค่าใช้จ่ายสำหรับงานข้อความ 100 ชิ้นจะเป็นเท่าใด?

แต่ละครั้ง: 10,000 โทเคนข้อมูลเข้า + 1,000 โทเคนข้อมูลออกที่คิดค่าบริการ รวม: 1 ล้าน โทเคนข้อมูลเข้า + 100,000 โทเคนข้อมูลออก.

Gemini 3.1 Pro พรีวิว · $3.20

Gemini 3.8 Flash · $1.125 (ประมาณ $1.13)

Gemini 3.5 Flash-Lite · $0.55

ระดับ: 0–4 USD. คำนวณจาก อัตราค่าบริการ API มาตรฐานของ Google; นี่เป็นตัวอย่างค่าใช้จ่าย ไม่ใช่ผลการทดสอบ.

  • การคำนวณ: อัตราการรับข้อมูล × 1 + อัตราการส่งข้อมูล × 0.1. ทุกคำขอจะอยู่ต่ำกว่าขีดจำกัด 200K ของ Pro.
  • ผลลัพธ์รวมถึงโทเคนการคิด. จำนวน 1,000 โทเคน คือผลผลิตทั้งหมดที่สามารถเรียกเก็บเงินได้ ไม่ใช่เพียงคำตอบที่แสดงให้เห็นเท่านั้น.
  • ไม่รวม: เครื่องมือ, การเก็บไว้ในแคช/การเก็บข้อมูล, การลองใหม่, ภาษี และการสร้างภาพ/วิดีโอ ไม่มีการให้ส่วนลดแบบกลุ่ม.
  • โปรโมชั่นพิเศษ: $1.125 มีผลบังคับใช้จนถึงวันที่ 31 ธันวาคม 2026 ตามอัตราค่าบริการเมื่อวันที่ 1 มกราคม 2027 ปริมาณงานเดียวกันจะมีค่าเป็น $2.25.
  • การซื้อแยกกัน: แผนบริการแอป Google AI, การใช้งาน API Gemini และการสมัครสมาชิก GlobalGPT มีระบบการเรียกเก็บเงินและสิทธิประโยชน์ที่แตกต่างกัน.

Veo คำนวณค่าบริการตามระยะเวลาของวิดีโอที่สร้างขึ้นและระดับ/ความละเอียดที่เลือกไว้ การสร้างภาพก็ใช้อัตราค่าบริการที่แตกต่างกัน; เปรียบเทียบ Nano Banana 2 โควตาและค่าใช้จ่าย API.

วิธีอ่านผลการทดสอบประสิทธิภาพ

ใช้เกณฑ์มาตรฐานเพื่อคัดเลือกรุ่นที่เหมาะที่สุดก่อน แล้วจึงทดสอบกับงานที่คุณต้องการจริงๆ ระบบที่โฮสต์และใช้เครื่องมือช่วย กับรุ่นที่ควอนไทซ์ในเครื่องท้องถิ่น เป็นวิธีการประเมินที่แตกต่างกัน.

  • Gemma 4: การ บัตรข้อมูลตัวละครอย่างเป็นทางการ รายงานเกี่ยวกับกระบวนการคิด การเขียนโค้ด และผลลัพธ์จากหลายรูปแบบ รวมถึง MMLU-Pro, AIME 2026, LiveCodeBench, GPQA Diamond, MMMU-Pro และ MATH-Vision.
  • Gemini 3.1 Pro: ของกูเกิล หน้าเปรียบเทียบประสิทธิภาพระดับมืออาชีพ ครอบคลุมหัวข้อทางวิทยาศาสตร์ที่ซับซ้อน การเขียนโค้ด และงานที่เกี่ยวข้องกับเอเจนต์ ผลลัพธ์จากการใช้เครื่องมือค้นหาหรือเครื่องมือเขียนโค้ดยังช่วยวัดประสิทธิภาพของระบบที่ได้รับการสนับสนุนจากเครื่องมือด้วย.
  • เปรียบเทียบอย่างยุติธรรม: ควรปรับให้ตรงกับเวอร์ชันของโมเดล ข้อความคำสั่ง เครื่องมือ งบประมาณการคิด และการตั้งค่าการอนุมาน ก่อนที่จะเรียกใช้โมเดลหนึ่งตัวให้เหมาะสมยิ่งขึ้น.
ตารางเกณฑ์มาตรฐานสามารถบอกอะไรคุณได้บ้างสิ่งที่พวกเขาไม่สามารถบอกคุณได้
ไม่ว่าครอบครัวของโมเดลน้ำหนักเปิดจะกำลังลดช่องว่างในการให้เหตุผลที่ซับซ้อนและงานหลายรูปแบบหรือไม่ไม่ว่าจะถูกกว่าหรือง่ายกว่าสำหรับทีมของคุณในการนำไปใช้
ไม่ว่าโมเดลแนวหน้าที่มีการโฮสต์จะมีประสิทธิภาพที่แข็งแกร่งกว่าในงานการเขียนโค้ดที่ยาก งานวิทยาศาสตร์ หรือภารกิจของตัวแทนไม่ว่าข้อได้เปรียบนั้นจะยังคงอยู่ภายใต้ข้อจำกัดด้านความหน่วง ความเป็นส่วนตัว หรืองบประมาณเฉพาะของคุณหรือไม่
ไม่ว่าครอบครัวตัวอย่างจะมีความเข้มแข็งเพียงพอที่จะพิจารณาใช้เป็นแบบอย่างในระดับท้องถิ่นหรือไม่ไม่ว่ามันจะทำงานได้ดีกว่ารุ่นอื่นในคำสั่งและกระบวนการทำงานของคุณหรือไม่
ไม่ว่ารูปแบบบริบทยาวและการสนับสนุนหลายรูปแบบจะเป็นมากกว่าคำโฆษณาทางการตลาดหรือไม่คุณภาพของผลลัพธ์เหมาะสมกับมาตรฐานในห้องเรียน งานวิจัย หรือความคิดสร้างสรรค์ของคุณหรือไม่

เพื่อทดลองด้วยตัวเอง โปรดบันทึกคุณภาพคำตอบ เวลาตอบสนอง และค่าใช้จ่ายการดำเนินงานรวม คะแนนที่เปิดเผยต่อสาธารณะไม่สามารถชี้ชัดได้ว่าการปรับใช้แบบใดมีค่าใช้จ่ายต่ำกว่าหรือมีความน่าเชื่อถือมากกว่าสำหรับทีมของคุณ.

เอกสาร การเขียนโค้ด และสื่อ

หากงานประจำวันของคุณเกี่ยวข้องกับเอกสารเป็นส่วนใหญ่ ระบบจัดการเอกสารของ Gemini มีข้อได้เปรียบอย่างมาก.
งานวิธีการ Gemma 4วิธีการ Gemini
เอกสารแสดงหน้าเว็บหรือภาพจากฟีด; สร้างระบบการสกัดข้อมูล/OCR แบบท้องถิ่น และผลลัพธ์ที่มีโครงสร้างใช้ความสามารถในการวิเคราะห์ PDF แบบดั้งเดิมสำหรับรูปแบบการจัดวางที่หลากหลาย รวมถึงแผนภูมิและตาราง
การวิจัยเชื่อมต่อเครื่องมือค้นหา ค้นดู และตรวจสอบของคุณเองใช้คุณสมบัติ Search grounding, URL Context และการดำเนินการโค้ดที่ได้รับการสนับสนุน
การเขียนโค้ดผสานรวมโมเดลเข้ากับเครื่องมือภายในและสภาพแวดล้อมทดสอบที่ได้รับการควบคุมใช้ระบบการให้เหตุผลแบบโฮสต์และเครื่องมือที่ได้รับการสนับสนุนสำหรับการเขียนโค้ดหลายขั้นตอน
รูปภาพกำหนดความต้องการ, จัดประเภทสินทรัพย์ และเขียนเอกสารสรุปสร้างหรือแก้ไขด้วยโมเดลภาพ Nano Banana
วิดีโอวิเคราะห์เฟรมที่เลือกมา; จัดทำสตอรีบอร์ดและรายชื่อช็อตสร้างวิดีโอจริงด้วย Veo

หากต้องการกระบวนการจัดการเอกสารแบบอื่น โปรดเปรียบเทียบกับ กระบวนการทำงานของไฟล์ PDF ChatGPT.

สิบตัวอย่างการใช้งานจริง

กระบวนการทำงานจริงพอดีมากขึ้นทำไม
ผู้ช่วยสอนในห้องเรียนแบบออฟไลน์บนแล็ปท็อปของโรงเรียนเจมม่า 4การติดตั้งใช้งานในท้องถิ่นและการทำงานแบบออฟไลน์มีความสำคัญมากกว่าเครื่องมือสื่อที่โฮสต์
การสกัดสัญญาส่วนตัวภายในสภาพแวดล้อมที่ควบคุมเจมม่า 4ขอบเขตข้อมูลสามารถอยู่ภายในโครงสร้างพื้นฐานของคุณได้
การวิเคราะห์ชุดข้อมูลวิจัยจำนวน 500 หน้าราศีเมถุนการเข้าใจบริบท 1 ล้านและไฟล์ PDF ต้นฉบับช่วยลดความขัดแย้งในกระบวนการ
การวิจัยเชิงแข่งขันที่อิงจากการค้นหาราศีเมถุนการค้นหา, บริบทของ URL, และการใช้เครื่องมือถูกสร้างขึ้นในตัวในสแต็กที่โฮสต์
การทำความเข้าใจภาพหน้าจอในท้องถิ่นและการคัดแยก UIเจมม่า 4การมองเห็นพร้อมข้อความแสดงผลเพียงพอแล้ว และการใช้งานในท้องถิ่นสามารถทำให้ง่ายขึ้นได้
การสร้างและแก้ไขภาพลักษณ์ทางการตลาดแบบจำลองภาพ Geminiการโฮสต์การสร้างและแก้ไขภาพได้รับการสนับสนุนอย่างเป็นทางการ
ขั้นตอนการทำงานจากสคริปต์ถึงวิดีโอสำเร็จรูปราศีเมถุนVeo ในชุด API ของ Gemini รองรับการส่งออกวิดีโอโดยตรง
ผู้ช่วยเขียนโค้ดภายในที่กำหนดเองภายในสภาพแวดล้อมของคุณเองเจมม่า 4เหมาะสมยิ่งขึ้นเมื่อการควบคุมโมเดลและการโฮสต์ด้วยตนเองมีความสำคัญ
การสรุปข้อมูลปริมาณมากด้วยต้นทุนต่ำในระดับขนาดใหญ่Gemini Flash หรือ Flash-Lite หรือ Gemma 4 ขึ้นอยู่กับความพร้อมของระบบปฏิบัติการราคาแบบโฮสต์อาจมีราคาถูกกว่าสำหรับทีมขนาดเล็ก แต่การโฮสต์เองอาจคุ้มค่ากว่าเมื่อใช้งานในระดับใหญ่
การทดลองการอนุมานบนอุปกรณ์เคลื่อนที่และเอดจ์เจมม่า 4Google กำลังวางตำแหน่ง Gemma 4 อย่างชัดเจนสำหรับ GPU สำหรับผู้บริโภค, เซิร์ฟเวอร์ที่เน้นการใช้งานในท้องถิ่น และเส้นทางสำหรับ Android
  • นักเรียนและครู: คู่มือการเรียนแบบท้องถิ่น, สรุปสไลด์การบรรยาย และผู้ช่วยในห้องเรียนแบบออฟไลน์ เหมาะกับ Gemma; ส่วนเอกสารยาวและทรัพยากรสำหรับการนำเสนอ เหมาะกับเครื่องมือที่ Gemini ให้บริการ.
  • นักวิจัย: เก็บชุดข้อมูลส่วนตัวไว้ในระบบท้องถิ่นเมื่อจำเป็น; ใช้ Gemini สำหรับการสังเคราะห์เอกสารขนาดใหญ่และงานที่อิงจากเว็บ เมื่อนโยบายข้อมูลอนุญาต.
  • นักการตลาดและผู้สร้างเนื้อหา: Gemma สามารถจัดเรียงบทสรุปและวัสดุอ้างอิงได้ ส่วนทีมงานผู้เชี่ยวชาญด้านสื่อที่ได้รับการจัดเตรียมไว้จะดำเนินการจนได้ภาพหรือวิดีโอที่เสร็จสมบูรณ์.

สำหรับส่วนวิดีโอ ให้ใช้ คู่มือการใช้งาน Veo 3.1.

สองคำสั่งให้ลอง

Gemma 4: การดึงข้อมูลใบแจ้งหนี้ส่วนตัว. กระบวนการทำงานนี้เก็บไฟล์ต้นฉบับไว้ในเครื่องท้องถิ่นและสร้างข้อความที่มีโครงสร้าง.

คุณกำลังอ่านหน้าใบแจ้งหนี้และภาพหน้าจอจากโฟลเดอร์ของผู้ขายรายเดียวกัน สำหรับแต่ละหน้า: 1. สกัดหมายเลขใบแจ้งหนี้, วันที่ออก, วันที่ครบกำหนด, รายการบรรทัด, ยอดรวมย่อย, ภาษี, และยอดรวม 2. ทำเครื่องหมายช่องที่มีความมั่นใจต่ำ 3. หากค่าใดปรากฏเฉพาะในบริเวณภาพ ให้ระบุ 4. ส่งคืนเฉพาะ JSON ที่ถูกต้องเท่านั้น.
  • อินพุต: หน้าใบแจ้งหนี้และภาพหน้าจอ.
  • ผลลัพธ์: JSON รวมถึงตัวบ่งชี้ความมั่นใจต่ำ.
  • หน้าที่ของคุณ: ตรวจสอบความถูกต้องของข้อมูลในช่องต่าง ๆ และยอดรวมก่อนส่งไปยังระบบอื่น.

Gemini: กระบวนการทำงานจากรายงานสู่แคมเปญ. ใช้เครื่องมือวิเคราะห์เอกสารและ URL แล้วส่งบทสรุปที่ได้ไปยังโมเดลสื่อที่เหมาะสม.

อ่านรายงานตลาด 300 หน้าและหน้าบริษัทที่เชื่อมโยง สรุปการเปลี่ยนแปลงที่สำคัญที่สุดห้าประการสำหรับทีม SaaS ในสหรัฐอเมริกา สำหรับแต่ละการเปลี่ยนแปลง ให้: - คำอธิบายที่เข้าใจง่าย - หนึ่งคำพูดหรือข้อมูลที่มีหลักฐานสนับสนุน - หนึ่งผลกระทบต่อผลิตภัณฑ์ - หนึ่งผลกระทบต่อการตลาด จากนั้นเปลี่ยนสรุปให้เป็น: - โครงร่างการนำเสนอหกสไลด์ - บทสรุปกราฟิกสำหรับโซเชียล - บทสคริปต์วิดีโอ 45 วินาที
  • อินพุต: รายงาน 300 หน้า และหน้าข้อมูลบริษัท.
  • ผลลัพธ์: การวิเคราะห์ที่อิงจากหลักฐาน, โครงร่างสไลด์, คำอธิบายภาพ และบทพูดในวิดีโอ.
  • ขั้นตอนต่อไป: การสร้างภาพหรือวิดีโอต้องเรียกใช้โมเดลแยกต่างหาก; คำสั่งนี้จะสร้างแผนงาน.

สำหรับขั้นตอนการปรับภาพ ให้ดำเนินการต่อด้วย คู่มือการใช้งาน Nano Banana Pro.

เมื่อใดควรใช้ทั้งสองอย่าง

แล้วคุณควรเลือกอันไหน
  • สนับสนุนธุรกิจท้องถิ่น: การสกัดข้อมูลที่ละเอียดอ่อน การคัดกรองภาพหน้าจอ การจัดประเภทเอกสารส่วนตัว และการอนุมานแบบ edge.
  • ตรวจสอบขั้นตอนการส่งต่อ: อนุมัติหรือแก้ไขเนื้อหาก่อนที่จะส่งออกจากระบบภายในองค์กร.
  • ส่งไปยังคลาวด์: การสังเคราะห์เอกสารยาว การวิจัยบนเว็บในปัจจุบัน และการผลิตสื่อ.
  • เลือกตามผลลัพธ์ที่คาดหวัง: ผู้ก่อตั้งอาจใช้ Gemma เวอร์ชันท้องถิ่นสำหรับการวิเคราะห์แบบส่วนตัว, Gemini สำหรับการสังเคราะห์ และโมเดลอื่นสำหรับการปรับแต่งเสียงของแบรนด์.

รายชื่อผลิตภัณฑ์ของ GlobalGPT รวมถึง Gemini 3.1 Pro, Gemini 3.8 Flash, Nano Banana Pro, Nano Banana 2 และ Veo 3.1 พร้อมกับรุ่นที่ไม่ใช่ของ Google พื้นที่ทำงานแบบรวมสามารถช่วยลดการสลับแท็บระหว่างการวิจัย การเขียน การจัดการภาพ และวิดีโอ.

5 ข้อผิดพลาดที่ควรหลีกเลี่ยง

  • “น้ำหนักที่ดาวน์โหลดมา หมายถึงการผลิตแบบฟรี” พิจารณาด้านฮาร์ดแวร์ หน่วยความจำ พลังงาน วิศวกรรม และการบำรุงรักษา.
  • “ทุกระดับของ Gemini ล้วนจัดการข้อมูลด้วยวิธีเดียวกัน” เปรียบเทียบเงื่อนไขการให้บริการจริงและเงื่อนไขตามภูมิภาค.
  • “Multimodal หมายถึงการสร้างภาพและวิดีโอ” Gemma สามารถเข้าใจข้อมูลภาพได้ แต่ให้ผลลัพธ์เป็นข้อความ.
  • “ระบบคลาวด์มาแทนที่ทุกกรณีการใช้งานแบบท้องถิ่น” การดำเนินการแบบออฟไลน์และการโฮสต์ด้วยตนเองยังคงต้องการเส้นทางติดตั้งในเครื่องท้องถิ่น.
  • “มาตรฐานสูงสุดคือผู้ชนะ” คำสั่ง เครื่องมือ ค่าเป้าหมายความล่าช้า และขอบเขตข้อมูลของคุณอาจส่งผลต่อผลลัพธ์ที่เกิดขึ้นจริง.

คุณควรเลือกอันไหนดี?

GlbGPT 200 โมเดล AI รวมทุกอย่างในหนึ่งเดียว
เลือก…เมื่อสิ่งเหล่านี้เป็นสิ่งที่คุณให้ความสำคัญเป็นอันดับแรก
เจมม่า 4การเข้าถึงแบบออฟไลน์; การควบคุมน้ำหนักและเวลาการทำงาน; การสกัดข้อมูลท้องถิ่นที่ละเอียดอ่อน; การปรับใช้บนอุปกรณ์ปลายทาง
ราศีเมถุนงานบริการน้อยลง; เอกสารยาว; เครื่องมือที่ได้รับการจัดการ; สามารถเข้าถึงโมเดลภาพและวิดีโอที่แยกกัน
ทั้งสองดำเนินการเตรียมข้อมูลแบบส่วนตัวในระบบท้องถิ่นก่อน แล้วจึงดำเนินการวิจัยหรือผลิตในระบบคลาวด์ที่ได้รับการอนุมัติ

Gemma 4 ให้คุณควบคุมได้เต็มที่ ส่วน Gemini ให้คุณใช้แพลตฟอร์มที่ได้รับการจัดการ. เลือกแพ็กเกจที่เหมาะสมกับปริมาณงานของคุณ และระดับความพยายามในการดำเนินงานที่ทีมของคุณสามารถรับมือได้.

ก่อนที่คุณจะตัดสินใจ

  • กำหนดผลลัพธ์: text/JSON, ภาพ, วิดีโอ หรือการดำเนินการในเครื่องมืออื่น.
  • กำหนดขอบเขตข้อมูล: ข้อมูลใดอาจถูกส่งออกจากระบบของคุณ?
  • ประมาณการปริมาณงาน: คำขอ, โทเค็น, การทำงานพร้อมกัน และเวลาทำงานที่จำเป็น.
  • ระบุชื่อตัวดำเนินการ: ใครเป็นฝ่ายรับผิดชอบงบประมาณและปัญหาการให้บริการในระบบท้องถิ่นหรือระบบคลาวด์?
  • ลองทำงานตัวอย่างหนึ่ง: ตรวจสอบคุณภาพ ความล่าช้า และค่าใช้จ่ายรวม ก่อนที่จะขยายระบบ.

คำถามที่พบบ่อย

Gemma 4 สามารถทำงานแบบออฟไลน์ได้หรือไม่?

ใช่ครับ โดยใช้ค่าน้ำหนักที่ดาวน์โหลดมาและสภาพแวดล้อมการทำงานในเครื่องที่เหมาะสม อย่างไรก็ตาม การค้นหาจากภายนอก เครื่องมือระยะไกล และการดาวน์โหลดโมเดล ยังคงต้องมีการเชื่อมต่ออินเทอร์เน็ตเป็นของตัวเอง.

รุ่น Gemma 4 ใดที่รองรับเสียง?

E2B, E4B และ 12B Unified รองรับข้อมูลเสียง ทั้งห้าขนาดนี้รองรับข้อความและภาพ และสามารถสร้างข้อความได้ แต่ไม่ใช่เครื่องมือสร้างภาพหรือวิดีโอแบบดั้งเดิม.

Gemma 4 ราคาถูกกว่า Gemini หรือไม่?

ขึ้นอยู่กับวิธีการใช้งานและโครงสร้างพื้นฐาน การใช้แบบโลคัลจะโอนค่าใช้จ่ายไปยังฮาร์ดแวร์และค่าใช้จ่ายในการดำเนินงาน ส่วน Gemini จะคิดค่าบริการตามการใช้งาน API และเครื่องมือเพิ่มเติมใดๆ.

แพ็กเกจ Gemini มีเครดิต API รวมอยู่ด้วยหรือไม่?

แผน Google AI สำหรับผู้บริโภคและระบบการคิดค่าบริการ API Gemini เป็นการซื้อที่แยกกัน โปรดเปรียบเทียบสิทธิ์การใช้งานของแอปเฉพาะหรือตารางราคาสำหรับนักพัฒนาที่สอดคล้องกับกระบวนการทำงานของคุณ.

สามารถใช้ Gemini ไปจนถึง GlobalGPT ได้หรือไม่?

GlobalGPT ให้บริการเส้นทางแบบจำลอง Gemini พร้อมกับกลุ่มแบบจำลองอื่น ๆ และเครื่องมือสื่อต่าง ๆ ระบบการเรียกเก็บเงินและระบบควบคุมของ GlobalGPT แยกต่างหากจากแอป Google ดั้งเดิมและบัญชี API.

แชร์โพสต์:

โพสต์ที่เกี่ยวข้อง

ตัวอย่างการทดสอบแบบโปสเตอร์และอินโฟกราฟิกเปรียบเทียบระหว่าง Nano Banana 2.1 กับ Nano Banana Pro.

Nano Banana 2.1 vs Nano Banana Pro: การทดสอบด้วยคำสั่งเดียวกัน

Nano Banana 2.1 vs Pro: เปรียบเทียบผลลัพธ์จากคำสั่งเดียวกัน เช่น โปสเตอร์ แผนภูมิ ภาพผลิตภัณฑ์ และการแก้ไข โดยใช้ราคา API อย่างเป็นทางการ ดูผลลัพธ์ก่อนเลือกโมเดล.

อ่านเพิ่มเติม

วิธีสร้างภาพสำหรับบล็อกด้วย AI ที่ช่วยเพิ่มประสิทธิภาพการค้นหาและดึงดูดผู้อ่าน

เรียนรู้วิธีสร้างภาพสำหรับบล็อกด้วย AI โดยใช้แหล่งข้อมูลล่าสุด การทดสอบในทางปฏิบัติ ข้อจำกัดที่ชัดเจน และขั้นตอนที่ปลอดภัยยิ่งขึ้น ตั้งแต่การทดลองครั้งแรกจนถึงขั้นตอนการผลิต.

อ่านเพิ่มเติม