Your privacy choices

Allow optional cookies for referral attribution, visit analytics, and Google Ads purchase measurement.

กลับไปที่บล็อก

Xiaomi MiMo-V2.6 Pro / Flash: ราคา API และ CodeMidas

MiMo-V2.6Xiaomi AICodeMidasReinforcement LearningModel selection

Pro และ Flash เป็นโมเดลมัลติโหมดหลัง RL ขนาดใหญ่: context 1M, output สูงสุด 128K, รับข้อความ/ภาพ/เสียง/วิดีโอ และส่งออกข้อความเท่านั้น Pro, Flash

ในวันเปิดตัว Xiaomi รายงานว่า MiMo-V2.6-Pro ได้ 46 ใน Artificial Analysis (AA) และเป็นอันดับหนึ่งของ open-weight (ตรวจ 2026-09-22) แต่ไม่ใช่หลักฐานว่าชนะทุกงานจริง AA, ประกาศ

เลือก Pro หรือ Flash

รายการ Pro Flash
API ID mimo-v2.6-pro mimo-v2.6-flash
เหมาะกับ workflow ยาว เหตุผลซับซ้อน งานเฉพาะทาง เรียกบ่อย งานจำนวนมาก คุมต้นทุน
ควรประเมิน แก้หลายไฟล์ วิจัย วางแผน ดึงข้อมูล สรุป ช่วยเขียนโค้ดทั่วไป

ให้สร้าง baseline คุณภาพ/ต้นทุนด้วย Flash แล้วเทียบ Pro ในงานที่ Flash ทำได้ไม่ดี ชื่อ Flash ไม่รับประกันว่าเร็วกว่าในทุกเครือข่าย client หรือความยาว output เว็บไซต์นี้มีเฉพาะ Pro และ Flash; ไม่มี route UltraSpeed.

ขอบเขต AA และ benchmark

AA ใช้คัดเลือกผู้สมัคร ไม่แทนการตรวจ repo, tool, retry และงานส่งมอบ อันดับแบ่งตามกลุ่มชนิดโมเดลและขนาดพารามิเตอร์ จึงสรุปไม่ได้ว่าอันดับหนึ่งกลุ่มดีกว่าโมเดลปิดทั้งหมด

MiMo-V2.6 release benchmarks

ตารางเปิดตัว Pro Flash
DeepSWE v1.1 71.9 67.9
ProgramBench 26.5 26.0
Terminal Bench 2.1 89.9 87.6
MiMo Visual Coding 72.3 71.5

นี่คือเอกสารผู้เผยแพร่ ไม่ใช่การทดสอบอิสระ DeepSWE v1.1 ระหว่าง Live RL คือ Pro 58.4 → 72.6, Flash 48.8 → 65.7 ซึ่งต่าง checkpoint/การตั้งค่าจากตาราง จึงห้ามรวมเป็นอันดับเดียว

Live RL 3.47 ล้านดอลลาร์ และ CodeMidas

RL ที่เปิดเผยใช้เวลาน้อยกว่าหกวัน: Pro ราว $2.62M, Flash ราว $0.85M, รวม $3.47M, อย่างละ 30 step นี่คือต้นทุนรอบ RL เท่านั้น ไม่ใช่ R&D, pretraining, data หรือ infrastructure ทั้งหมด คำอธิบาย

CodeMidas สร้างงาน coding RL ที่ตรวจได้จากโค้ดที่ทำงานอยู่: เก็บ spec/interface/project ไว้ ลบแกนที่จะให้สร้างใหม่ ใช้ reference implementation สร้างผลที่คาดหวัง และตรวจ environment, การรั่วคำตอบจาก cache/build และ validator ที่ผิดพลาด

CodeMidas RL pipeline

บทความรายงาน 5,545 tasks จาก 3,185 repositories ครอบคลุม 23 ภาษา; การทดลองหลักใช้ MiMo-V2.5 จึงไม่ใช่ผลฝึกเต็มรอบ V2.6 และห้ามบวกกับจำนวน RL environment ในข่าวเปิดตัว

ราคา API

ราคา real-time ทางการเป็นหยวน / ล้าน Tokens Pro, Flash

API ทางการ input cache hit input miss output
Pro ¥0.025 ¥3 ¥6
Flash ¥0.02 ¥1 ¥2

snapshot เว็บ ณ 2026-09-22: mimo-v2.6-pro 4× / ¥1.6, mimo-v2.6-flash 2× / ¥0.8 ต่อหนึ่งล้าน Tokens เอกสารราคา อย่าผสมกับราคาทางการสามคอลัมน์; ตรวจ ราคาปัจจุบัน และบิล Batch API คือ offline batch inference ไม่ใช่ request ปกติพร้อมกันหรือสัญญาว่าเว็บมี API เดียวกัน

ค่าใช้จ่าย = cache-hit input × ราคา cache + miss input × ราคา input + output × ราคา output ตัวอย่าง Pro: input 1M, hit 90%, output 0.1M = 0.9 × 0.025 + 0.1 × 3 + 0.1 × 6 = ¥0.9225; ไม่มี hit = 1 × 3 + 0.1 × 6 = ¥3.6 เป็นเพียงตัวอย่าง ไม่ใช่บิลจริงหรือราคา multiplier

ทดสอบและเชื่อม API

ใช้ input, สิทธิ์ tool และเกณฑ์รับงานเดียวกันกับ 3D (ขนาด/asset), frontend (รันได้/responsive), repo fix (regression), ข้อมูลสำนักงาน (ตามรอยแต่ละแถว), research (citation เปิดได้ แยก fact/inference) บันทึก first-pass, เวลา, การแก้คน และ ค่าเรียกรวม ÷ งานผ่าน ความสำเร็จใน MiMo Desktop ไม่เท่ากับทุก API Agent

curl "https://api.llm-token.cn/v1/chat/completions" -H "Authorization: Bearer $API_KEY" -H "Content-Type: application/json" -d '{"model":"mimo-v2.6-flash","messages":[{"role":"user","content":"ระบุเกณฑ์รับงานที่ทำได้จริงสามข้อสำหรับการนำเข้า CSV"}],"stream":false}'

เปรียบเทียบ Pro โดยเปลี่ยนเฉพาะ model เป็น mimo-v2.6-pro และบันทึก model, usage, bill Pro, Flash, ซื้อ, เติมเงิน

FAQ

เป็น open model ที่เก่งที่สุดไหม?

เฉพาะ AA 46 และขอบเขตตารางตอนเปิดตัว ไม่ใช่ทุก repo ภาษา หรือ client

Flash แทน Pro ได้ไหม?

เริ่มจาก summary/extraction/coding ทั่วไป; งานหลายขั้น เหตุผลซับซ้อน หรือแก้ซ้ำแพง ให้เทียบผลสุดท้ายของ Pro

Multimodal ออกภาพ เสียง วิดีโอได้ไหม?

ไม่ได้ output ทางการคือข้อความ; งานเว็บ 3D วิดีโอมักใช้ code และ tool ภายนอก

CodeMidas เกี่ยวข้องอย่างไร?

เป็นงานวิจัยที่เกี่ยวข้องเรื่องงาน coding RL ที่รันและให้คะแนนได้; ต้องอ้างผล V2.5 แยกจากคะแนนเปิดตัว V2.6

อ่านราคาอย่างไร?

ทางการคิด cache input/input ปกติ/output แยกกัน ส่วนเว็บใช้ multiplier อ้างอิง ตรวจ Base URL, Key, provider และอย่าผสมข้ามแพลตฟอร์ม

แหล่งข้อมูลและขอบเขต

ตรวจ 2026-09-22; เป็นการวิเคราะห์เอกสารเปิดตัวและคู่มือเชื่อมต่อ ไม่ใช่การเปรียบเทียบอิสระ MiMo-V2.6 open collection มี weights, technical report และทรัพยากร RL; ตรวจ license, dependency และ compute ของแต่ละ repo

อ่านต่อ: คู่มือ Agent multimodal Qwen3.8-Omni-Flash