DeepSeek V4 Flash untuk Codex: Panduan Persediaan Responses API
DeepSeek melancarkan beta awam API rasmi DeepSeek-V4-Flash pada 31 Julai 2026. Model ini mengekalkan seni bina dan saiz V4-Flash Preview tetapi menerima post-training baharu yang menumpukan pelaksanaan Agent, coding dan penggunaan alat.
Perubahan utama untuk pembangun ialah sokongan asli bagi OpenAI Responses API dan integrasi khusus untuk Codex. Dokumentasi semasa DeepSeek menyatakan bahawa deepseek-v4-flash ialah satu-satunya model DeepSeek yang boleh disambungkan terus ke Codex. Sokongan V4 Pro dijangka dalam kemas kini kemudian.
Gerbang ini menyediakan deepseek-v4-flash melalui /v1/responses untuk Codex dan klien Agent lain yang dibina berasaskan protokol Responses.
Perkara yang berubah dalam DeepSeek-V4-Flash-0731
DeepSeek menyatakan bahawa DeepSeek-V4-Flash-0731 menggunakan seni bina dan saiz model yang sama dengan V4-Flash Preview. Keluaran 31 Julai mengubah post-training dan bukannya struktur asas. API V4 Pro serta model dalam aplikasi dan web DeepSeek tidak dinaik taraf dalam keluaran ini.
| Perkara | Maklumat semasa |
|---|---|
| ID model gerbang | deepseek-v4-flash |
| Tarikh keluaran | 31 Julai 2026 |
| Status keluaran | Beta awam API rasmi |
| Naik taraf utama | Pelaksanaan Agent, coding dan penggunaan alat |
| Responses API | Disokong secara asli |
| Codex | Diadaptasi secara rasmi |
| Context | 1M dalam katalog gerbang |
| Pengganda gerbang | 2.5x |
| Kadar rujukan gerbang | Kira-kira CNY 1 bagi setiap 1M token |
| Input imej | Kini ditandai sebagai tidak disokong dalam katalog gerbang |
Ketersediaan model dan kadar boleh berubah. Semak semula halaman harga model dan panduan model secara langsung sebelum digunakan dalam produksi.
Keputusan benchmark Agent rasmi
DeepSeek menerbitkan keputusan berikut untuk keluaran rasmi V4 Flash:
| Benchmark | Keputusan rasmi |
|---|---|
| Terminal Bench 2.1 | 82.7 |
| NL2Repo | 54.2 |
| Cybergym | 76.7 |
| DeepSWE | 54.4 |
| Toolathlon verified | 70.3 |
| Agent Last Exam | 25.2 |
| Automation Bench (Public) | 25.1 |
| DSBench-FullStack | 68.7 |
| DSBench-Hard | 59.6 |
Keputusan ini menerangkan arah keupayaan, bukan jaminan kadar kejayaan untuk repository anda. DeepSeek menyatakan bahawa penilaian Code Agent awamnya menggunakan DeepSeek Harness mod minimum yang belum diterbitkan, effort tahap max, top_p=0.95 dan temperature=1.0. DSBench-FullStack dan DSBench-Hard ialah set ujian dalaman.
Untuk perolehan, nilai model pada repository, alat, kebenaran dan acceptance test yang dipinkan. Ukur kejayaan percubaan pertama, kegagalan alat, masa berlalu, penggunaan token dan kerja semula jurutera.
Responses API berbanding Chat Completions
Chat Completions sesuai untuk perbualan, penulisan, terjemahan, ringkasan dan soalan coding ringkas. Aliran asasnya ialah senarai mesej diikuti teks yang dijana.
Responses API direka untuk Agent dan pelaksanaan alat yang berterusan. Sesuatu tugas boleh mengandungi output model, function call, tindakan terminal, hasil alat dan penaakulan seterusnya. Codex menggunakan protokol yang lebih kaya ini untuk memeriksa kod, menyunting fail, menjalankan ujian dan meneruskan kerja selepas setiap hasil.
| Keupayaan | Chat Completions | Responses API |
|---|---|---|
| Chat dan penjanaan teks | Sesuai | Disokong |
| Structured tool calls | Tersedia | Workflow asli |
| Pelaksanaan berterusan dengan pelbagai alat | Diurus klien | Lebih sesuai |
| Integrasi Codex | Bukan protokol wayar Codex | Diperlukan |
| Struktur event Agent | Lebih ringkas | Lebih kaya |
| Workflow kejuruteraan panjang | Memerlukan orchestration tambahan | Kes penggunaan utama |
Gunakan Chat Completions untuk penjanaan ringkas dengan volum tinggi. Gunakan /v1/responses apabila beban kerja memerlukan Codex, MCP, alat terminal atau pelaksanaan kejuruteraan berbilang langkah.
Panggil DeepSeek V4 Flash melalui Responses API
Mulakan dengan permintaan kecil:
curl https://api.llm-token.cn/v1/responses \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"input": "Inspect this repository and propose the smallest fix for the failing tests."
}'
Sahkan Base URL, API key, ID model, status HTTP dan struktur response event sebelum menguji streaming, function calls, MCP, long context atau tugas yang banyak menggunakan terminal.
Jangan gantikan dengan model DeepSeek lain dalam Codex. DeepSeek kini hanya mendokumenkan deepseek-v4-flash sebagai serasi dengan Codex. ID model lain mungkin mengembalikan ralat protokol, menggagalkan tool call, menghentikan tugas atau menghasilkan bentuk event yang tidak serasi.
Sempadan antara Direct API dan klien Codex
Responses API langsung DeepSeek kini bersifat stateless. Dokumentasinya menyatakan bahawa previous_response_id, conversations, storage dan background mode tidak disokong. Pelayan menyokong function tools, web search dan alat tersuai apply_patch yang digunakan oleh Codex, tetapi mengabaikan alat asli mcp, file_search, code_interpreter dan computer_use. Input imej dan fail juga tidak disokong.
Codex masih boleh membaca fail dan menjalankan arahan Shell kerana klien mengatur alat tersebut secara setempat lalu menghantar hasilnya kembali kepada model. Uji keupayaan API model dan keupayaan alat pada sisi klien secara berasingan, bukannya menganggap kedua-duanya sebagai lapisan yang sama.
Konfigurasi deepseek-v4-flash dalam Codex
Pasang atau kemas kini Codex CLI:
npm install -g @openai/codex@latest
codex --version
Tambah penyedia Responses dalam ~/.codex/config.toml:
model_provider = "llm-token"
model = "deepseek-v4-flash"
model_reasoning_effort = "high"
[model_providers.llm-token]
name = "LLM Token"
base_url = "https://api.llm-token.cn/v1"
wire_api = "responses"
requires_openai_auth = true
Berikan API key gerbang melalui kaedah pengesahan selamat yang disokong oleh versi Codex anda. Jangan sekali-kali commit key sebenar ke Git, menampalnya dalam kod contoh atau mendedahkannya dalam log.
Mulakan dengan tugas baca sahaja:
Read the repository structure and list its build command, test command, and three main modules. Do not modify files.
Berikan kebenaran menulis fail dan Shell hanya selepas model, tool calls dan pengendalian context berfungsi dengan betul. Lihat panduan persediaan Codex untuk butiran pemasangan penuh.
Beban kerja yang disyorkan
- Analisis pada tahap repository, diagnosis pepijat dan pembaikan berskop
- Mengulang kod selepas kegagalan ujian
- Arahan terminal, carian kod dan tugas kejuruteraan berbilang langkah
- MCP servers, function calls dan orchestration alat luaran
- Ujian automatik, code review dan perancangan migration
- Beban kerja pembangunan sensitif kos yang masih memerlukan tingkah laku Agent
DeepSeek V4 Flash bukan sekadar laluan chat kos rendah. Nilai utamanya ialah membawa pengganda gerbang yang lebih rendah ke dalam workflow Codex dan Agent. Agent produksi masih memerlukan sempadan kebenaran, timeout, had percubaan semula, belanjawan token dan syarat pengambilalihan manusia.
Senarai semak pengesahan produksi
- Salin ID model tepat
deepseek-v4-flashdaripada panduan model. - Gunakan
https://api.llm-token.cn/v1sebagai Base URL dan tetapkan protokol wayar Codex kepadaresponses. - Sahkan status, struktur event, model yang dipilih dan bil dengan permintaan ringkas.
- Gunakan tugas repository baca sahaja untuk menguji akses fail, carian dan pengekalan context.
- Uji Shell, patch, function calls, MCP dan pelaksanaan alat berbilang pusingan secara berasingan.
- Tetapkan sempadan jelas bagi fail, pangkalan data, pembayaran, deployment dan pelayan.
- Pin repository, commit permulaan, dependencies dan arahan acceptance untuk perbandingan model.
- Catat completion rate, tempoh P50/P95, campuran kegagalan dan kos bagi setiap tugas yang diterima.
Soalan lazim
Adakah DeepSeek V4 Flash menyokong Codex?
Ya. DeepSeek mengesahkan bahawa keluaran rasmi V4 Flash menyokong Responses API secara asli dan diadaptasi untuk Codex. Ia kini mendokumenkan deepseek-v4-flash sebagai satu-satunya model DeepSeek yang disokong dalam Codex.
Endpoint manakah yang patut digunakan oleh Codex?
Gunakan /v1/responses, bukan /v1/chat/completions. Pada gerbang ini, tetapkan Base URL kepada https://api.llm-token.cn/v1 dan konfigurasikan wire_api = "responses".
Bolehkah DeepSeek V4 Pro dijalankan dalam Codex?
Dokumentasi DeepSeek menyatakan bahawa V4 Pro dijangka menyokong Codex pada awal Ogos 2026. Jangan anggap ia serasi sehingga API rasmi dan laluan gerbang mengesahkan sokongan.
Berapakah kos DeepSeek V4 Flash?
Katalog gerbang semasa menyenaraikan pengganda 2.5x, atau kira-kira CNY 1 bagi setiap 1M token. Halaman harga secara langsung dan lejar akaun ialah rujukan muktamad.
Adakah Responses API sentiasa lebih baik daripada Chat Completions?
Tidak. Chat Completions lebih ringkas untuk perbualan dan penjanaan sekali jalan. Responses paling berguna untuk Codex, MCP, alat dan workflow kejuruteraan yang berterusan.
Di manakah saya boleh membeli atau menambah nilai akses API?
Pelanggan baharu boleh bermula di halaman pembelian. Pemegang API key sedia ada boleh menggunakan top-up. Mulakan dengan ujian kecil, baca sahaja dan boleh diterbalikkan.
Sumber utama
- Log perubahan DeepSeek 31 Julai 2026: status keluaran, benchmark Agent, syarat penilaian, Responses API dan sokongan Codex
- Panduan integrasi Codex DeepSeek: model yang disokong dan sempadan integrasi Codex
- Panduan Responses API DeepSeek: protokol dan panduan permintaan
- Panduan model gerbang: route ID, pengganda, context dan label keupayaan semasa