DeepSeek V4 Pro scumpește tarifele API de patru ori: ce se schimbă din 16 august

Andrei Negrescu Andrei Negrescu
5 min citire
Sigla DeepSeek, compania chineză care își scumpește de patru ori tarifele API pentru modelele V4
Publicitate

DeepSeek V4 Pro marchează sfârșitul perioadei în care compania chineză oferea inteligență artificială la tarife imposibil de egalat. Odată cu lansarea oficială a familiei V4, prețurile API cresc de peste patru ori, iar facturarea devine diferențiată în funcție de ora la care rulezi cererile.

Publicitate

Noile tarife intră în vigoare la ora 16:00 UTC, pe 16 august 2026, potrivit jurnalului de modificări publicat de DeepSeek în documentația pentru dezvoltatori. Explicația oficială este dorința de a aloca resursele „mai rațional”, iar mecanismul ales seamănă mai mult cu facturarea energiei electrice decât cu software-ul: un tarif pentru orele aglomerate și un tarif redus pentru restul zilei.

Cât costă DeepSeek V4 Pro și V4 Flash după scumpire

Pentru DeepSeek V4 Pro, un milion de tokeni de ieșire va costa 3,96 dolari în intervalele de vârf, față de 0,87 dolari în prezent. În afara vârfului prețul se înjumătățește, la 1,98 dolari. Varianta mai rapidă și mai ieftină, V4 Flash, urcă de la 0,28 la 1,32 dolari pe milion de tokeni de ieșire la orele aglomerate și la 0,66 dolari în restul timpului.

Scumpirea nu se limitează la ieșiri. La intrare, V4 Pro trece de la 0,435 la 1,32 dolari pe milion de tokeni atunci când textul nu se află în cache, respectiv 0,66 dolari în afara vârfului, iar tokenii serviți din cache sar de la 0,003625 la 0,044 dolari, respectiv 0,022 dolari. La V4 Flash, intrarea necachetată crește de la 0,14 la 0,44 dolari, iar cea din cache de la 0,0028 la 0,014 dolari.

Aceeași pagină oficială de tarife definește și ferestrele orare: se consideră vârf intervalele 01:00–04:00 și 06:00–10:00 UTC, iar tot restul zilei intră la tarif redus. Pentru o echipă din România asta înseamnă că orele scumpe sunt 04:00–07:00 și 09:00–13:00 în ora locală de vară, adică exact mijlocul dimineții de lucru. Sarcinile care pot fi programate — reindexări, generare de conținut în lot, evaluări automate — devin de două ori mai ieftine dacă sunt mutate după-amiaza sau noaptea.

Rack-uri de servere într-un centru de date, infrastructura pe care rulează modelul DeepSeek V4 Pro
Costul unui apel API depinde direct de capacitatea de calcul disponibilă în centrele de date. Foto: BalticServers.com, Wikimedia Commons, CC BY-SA 3.0

Reducerea „permanentă” a rezistat mai puțin de trei luni

Ironia situației este că tarifele care se scumpesc acum fuseseră anunțate inițial drept promoție cu termen limită, valabilă până la 31 mai. În aceeași lună DeepSeek a comunicat că le transformă în prețuri permanente, dar a mers în cele din urmă înainte cu majorarea. Engadget notează secvența completă, iar informația despre creșterea de patru ori a fost raportată prima dată de Bloomberg, pe 13 august.

Contextul explică decizia mai bine decât comunicatul. DeepSeek a devenit un nume global în ianuarie 2025, când modelul R1 a demonstrat că performanțe apropiate de ale liderilor americani pot fi obținute cu un buget de antrenare mult mai mic, iar șocul s-a văzut imediat în evaluările producătorilor de cipuri. Problema este că inferența, adică rularea efectivă a modelului pentru utilizatori, nu s-a ieftinit în același ritm. Criza globală a memoriei și cererea uriașă de acceleratoare au împins costurile de operare în sus pentru toată industria.

Publicitate

Chiar și scump, DeepSeek rămâne printre cele mai ieftine opțiuni

Comparația cu concurența arată de ce compania își permite mutarea. Kimi K3, modelul companiei chineze Moonshot, cere 15 dolari pe milion de tokeni de ieșire, iar cel mai capabil model al OpenAI, GPT-5.6 Sol, ajunge la 30 de dolari. Singura excepție notabilă este GPT-5.6 Luna, varianta ieftină a OpenAI, cu 1,20 dolari pe milion de tokeni de ieșire, deci sub V4 Flash la ore de vârf, dar peste el în afara vârfului.

Pe hârtie, V4 Pro rămâne de aproximativ opt ori mai ieftin decât GPT-5.6 Sol chiar și la tarif maxim. Diferența este că marja de siguranță a echipelor care și-au construit produsul pe API-ul DeepSeek s-a subțiat brusc, iar bugetele calculate în primăvară nu mai sunt valabile. Tendința generală merge în direcția opusă în segmentul de consum, unde abonamentele devin mai accesibile, dar accesul programatic la modelele de top se scumpește.

Ce mai aduce V4 Pro pe lângă factura mai mare

Majorarea vine la pachet cu versiunea generală a V4 Pro, pe care DeepSeek o prezintă ca un salt pe partea de agenți software. Documentația listează 87,9 puncte pe Terminal Bench 2.1, 61,5 pe NL2Repo, 83,3 pe Cybergym și 42,7 pe HLE fără unelte, respectiv 60,0 cu unelte. Modelul acceptă acum nativ formatul Responses API al OpenAI, este adaptat pentru Codex și permite trei niveluri de efort de gândire: low, high și max. Fereastra de context rămâne de un milion de tokeni, cu maximum 384.000 de tokeni la ieșire, iar limita de concurență este de 500 de cereri simultane pentru Pro și 2.500 pentru Flash.

Pentru cine construiește agenți autonomi, ecuația se schimbă a doua oară: un model care parcurge mai mulți pași și apelează mai multe unelte consumă mai mulți tokeni, deci scumpirea se resimte multiplicat. Aceeași logică se vede și la rivali, unde modelele specializate pe sarcini complexe sunt tarifate separat de cele generaliste.

Publicitate

Ce poți face concret dacă folosești DeepSeek în producție

Prima măsură este banală, dar eficientă: verifică ce parte din trafic tolerează întârziere și mută-o în afara ferestrelor de vârf, unde tariful este jumătate. A doua este optimizarea cache-ului de prompturi, pentru că diferența dintre un token servit din cache și unul recalculat rămâne de aproximativ 30 de ori, chiar și după scumpire. A treia este segmentarea modelelor: multe sarcini de clasificare, extragere sau rescriere nu au nevoie de V4 Pro și pot rula pe V4 Flash la o fracțiune din cost.

Sursele acestui articol sunt jurnalul oficial de modificări și pagina de tarife DeepSeek și informația inițială publicată de Bloomberg.

Publicitate

Ultimele Știri

Descoperă mai multe

Articole selectate pentru tine

Se încarcă...