O čemu je dubok o čemu svi govore?

Feb 21, 2025 Ostavite poruku

Deepseek, čije je puno ime "Hangzhou Deepseek Umjetna inteligencija Basic Technology Research Co., Ltd." (u daljnjem tekstu China Deepseek) osnovao je u srpnju 2023. godine kvantitativni div za upravljanje imovinom Huanfang Kvantitativno. Njegov osnivač Liang Wenfeng ima duboku pozadinu i bogato iskustvo u kvantitativnom ulaganju i računalstvu visokih performansi.

 

U prosincu 2024. DeepSeek-V3 je pokrenuo ogroman val u globalnom AI polju. Postigla je performanse usporedive s vrhunskim modelima kao što su GPT-4O uz izuzetno niske troškove treninga, šokirajući industriju.


Pokretanjem novog Deepseekovog novog modela Deepseek-R1, 27. siječnja, aplikacija DeepSeek na vrhu je besplatnih aplikacija za preuzimanje Apple's App's App Store u Kini i Sjedinjenim Državama, nadmašivši chatgpt u američkoj ljestvici za preuzimanje.

 

DeepSeek je veliki jezični model. Ima snažne mogućnosti obrade prirodnog jezika, baš kao i pametni i razumijevanje pomoćnika koji može razumjeti i odgovarati na pitanja poput prijatelja. Na temelju algoritama i podrške podataka koji stoje iza njega, to vam može pomoći i da napišete kôd, organizirate podatke, pa čak i riješite neke složene matematičke probleme.


Kada je riječ o sličnim velikim modelima, svačiji prvi dojam je chatgpt koji je razvio OpenAi. Od objavljivanja O1-PREVIES-a OpenAi-a u rujnu 2024. do sada, prošlo je manje od četiri mjeseca, a modeli zaključaka koji su usporedivi ili čak premašuju njegove performanse procvjetali su na tržištu.


Razlog zašto se DeepSeek može istaknuti iz mnogih modela je taj što nije samo preuzeo vodeću ulogu u postizanju rezultata usporedivih s modelom Openai-O1, već je i komprimirao troškove modela zaključivanja na izuzetno nisku razinu.

 

Na dan otvaranja Svjetskog ekonomskog foruma 2025. Godišnji sastanak ovog mjeseca, kineski Deepseek objavio je svoj najnoviji model otvorenog koda R1, koji je još jednom privukao globalnu pažnju u području umjetne inteligencije.


DeepSeek -R1 postigao je važan proboj u tehnologiji - koristeći čiste metode dubokog učenja kako bi AI omogućio spontano izlazak s mogućnostima rasuđivanja. U zadacima kao što su matematika, kôd i rasuđivanje prirodnog jezika, njegova je performansa usporediva sa službenom verzijom modela Openai-O1. Model također nastavlja visoku ekonomičnost tvrtke.


Podrazumijeva se da su troškovi treninga modela DeepSeek-R1 samo 5,6 milijuna američkih dolara, daleko niži od stotina milijuna ili čak milijardi dolara uloženih u tehnologiju umjetne inteligencije od strane američkih tehnoloških divova, kao što su američki istraživački centar za umjetnu inteligenciju, Google i "Meta" kompanija.


Što se tiče cijene, osnivač Liang Wenfeng jednom je rekao u intervjuu s medijima da i API i AI trebaju biti univerzalni i pristupačni za sve.

 

Pored toga, vrijedno je napomenuti da DeepSeek prihvaća potpuno otvoreni izvorni strategija.


Izvorna namjera OpenAi bila je "unaprijediti digitalnu inteligenciju na način koji će najvjerojatnije imati koristi cijelom čovječanstvu, a da pritom ne bude ograničen potrebom za ostvarivanjem financijskih prinosa". Međutim, nakon objavljivanja GPT-3, OpenAi je ograničio pristup modelu, a nakon objavljivanja GPT-4, čak je sakrio svoje podatke o treningu i utege modela, potpuno krećući se prema "zatvorenom izvoru".

 

Deepseekova strategija potpuno otvorenog koda ne samo da smanjuje prag za korisnike, već i promovira suradničku ekologiju zajednice AI programera. Kroz otvoreni izvor, DeepSeek je privukao pažnju velikog broja programera i istraživača, koji na platformi mogu slobodno dobiti i izmijeniti kodove modela kako bi zajednički promovirali razvoj AI tehnologije.


Nvidia stariji znanstvenik Jimfan rekao je na svojoj osobnoj društvenoj platformi: "Mi smo u takvom povijesnom trenutku: tvrtka koja nije američka tvrtka nastavlja OpenAi-jevu originalnu misiju-osnažujući cijelo čovječanstvo kroz istinski otvorena vrhunska istraživanja."