Am beth mae'r Deepseek y mae pawb yn siarad amdano?

Feb 21, 2025 Gadewch neges

Deepseek, a'i enw llawn yw "Hangzhou Deepseek Intificial Intelligence Basic Technology Research Co., Ltd." (y cyfeirir ato o hyn ymlaen fel China Deepseek), ei sefydlu ym mis Gorffennaf 2023 gan y cawr rheoli asedau meintiol Huanfang Meintiol. Mae gan ei sylfaenydd Liang Wenfeng gefndir dwfn a phrofiad cyfoethog mewn buddsoddiad meintiol a chyfrifiadura perfformiad uchel.

 

Ym mis Rhagfyr 2024, cychwynnodd Deepseek-V3 don enfawr yn y maes AI byd-eang. Cyflawnodd berfformiad sy'n debyg i fodelau gorau fel GPT-4O ar gostau hyfforddi isel iawn, gan syfrdanu'r diwydiant.


Gyda lansiad model newydd Deepseek Deepseek-R1, ar Ionawr 27, roedd yr app Deepseek ar frig y safleoedd lawrlwytho ap rhad ac am ddim o siop app Apple yn Tsieina a'r Unol Daleithiau, gan ragori ar Chatgpt yn safleoedd lawrlwytho'r UD.

 

Mae Deepseek yn fodel iaith fawr. Mae ganddo alluoedd prosesu iaith naturiol pwerus, yn union fel cynorthwyydd craff a deallus sy'n gallu deall ac ateb cwestiynau fel ffrind. Yn seiliedig ar yr algorithmau a'r gefnogaeth ddata y tu ôl iddo, gall hefyd eich helpu i ysgrifennu cod, trefnu data, a hyd yn oed ddatrys rhai problemau mathemategol cymhleth.


O ran modelau mawr tebyg, argraff gyntaf pawb yw Chatgpt a ddatblygwyd gan Openai. O ryddhau O1-Preview gan Openai ym mis Medi 2024 hyd yn hyn, mae llai na phedwar mis wedi mynd heibio, ac mae modelau casglu sy'n debyg i neu hyd yn oed yn fwy na'i berfformiad wedi blodeuo yn y farchnad.


Y rheswm pam y gall Deepseek sefyll allan o lawer o fodelau yw ei fod nid yn unig wedi cymryd yr awenau wrth gyflawni canlyniadau sy'n debyg i'r model Openai-O1, ond hefyd wedi cywasgu cost y model casglu i lefel isel iawn.

 

Ar ddiwrnod agoriadol Fforwm Economaidd y Byd 2025 Cyfarfod Blynyddol y mis hwn, rhyddhaodd Deepseek Tsieina ei Model Ffynhonnell Agored diweddaraf R1, a ddenodd sylw byd -eang unwaith eto ym maes deallusrwydd artiffisial.


Mae DeepSeek -R1 wedi cyflawni datblygiad pwysig mewn technoleg - gan ddefnyddio dulliau dysgu dwfn pur i ganiatáu i AI ddod i'r amlwg yn ddigymell gyda galluoedd rhesymu. Mewn tasgau fel mathemateg, cod, a rhesymu iaith naturiol, mae ei berfformiad yn debyg i fersiwn swyddogol y model Openai-O1. Mae'r model hefyd yn parhau â chost-effeithiolrwydd uchel y cwmni.


Deallir mai dim ond US $ 5.6 miliwn yw cost hyfforddi model Deepseek-R1, yn llawer is na'r cannoedd o filiynau neu hyd yn oed biliynau o ddoleri a fuddsoddwyd mewn technoleg deallusrwydd artiffisial gan gewri technoleg America fel Canolfan Ymchwil Cudd-wybodaeth Artiffisial Agored yr Unol Daleithiau, Google, a chwmni "Meta".


O ran y pris, dywedodd y sylfaenydd Liang Wenfeng unwaith mewn cyfweliad â'r cyfryngau y dylai APIs ac AI fod yn gyffredinol ac yn fforddiadwy i bawb.

 

Yn ogystal, mae'n werth nodi bod Deepseek yn mabwysiadu strategaeth ffynhonnell hollol agored.


Bwriad gwreiddiol Openai oedd "hyrwyddo deallusrwydd digidol mewn ffordd sydd fwyaf tebygol o fod o fudd i ddynoliaeth i gyd, heb gael ei chyfyngu gan yr angen i gynhyrchu enillion ariannol." Fodd bynnag, ar ôl rhyddhau GPT-3, roedd Openai yn cyfyngu mynediad i'r model, ac ar ôl rhyddhau GPT-4, fe guddiodd hyd yn oed ei ddata hyfforddi a'i bwysau model, gan symud yn llwyr tuag at "ffynhonnell gaeedig."

 

Mae strategaeth ffynhonnell gwbl agored DeepSeek nid yn unig yn gostwng y trothwy i ddefnyddwyr, ond hefyd yn hyrwyddo ecoleg gydweithredol y gymuned ddatblygwyr AI. Trwy ffynhonnell agored, mae Deepseek wedi denu sylw nifer fawr o ddatblygwyr ac ymchwilwyr, a all gael ac addasu codau enghreifftiol ar y platfform yn rhydd i hyrwyddo datblygiad technoleg AI ar y cyd.


Dywedodd uwch wyddonydd ymchwil Nvidia, Jimfan, ar ei blatfform cymdeithasol personol, "Rydyn ni ar foment mor hanesyddol: mae cwmni nad yw'n UD yn parhau â chenhadaeth wreiddiol Openai-gan rymuso pob dynolryw trwy ymchwil arloesol wirioneddol agored."