A kínai DeepSeek megtalálja a módját, hogy segítsen az AI-nak a kérdések megválaszolásában. Íme, hogyan működik 😊
China’s DeepSeek finds a way to help AI get better at answering questions. Here’s how it works 😊
Cikk tartalma röviden
A DeepSeek, a kínai mesterséges intelligencia induló cége új módszert fejlesztett ki a nagy nyelvi modellek (LLM) érvelési képességének javítására az önelvű kritikai hangolás (SPCT) segítségével, amely jobb és gyorsabb válaszadást tesz lehetővé, mint a versenytársak. AI-modelljük, az R1 azt állítja, hogy a ChatGPT-hez hasonlítható teljesítményt nyújt, miközben költséghatékonyabb. A Tsinghua Egyetemmel együttműködve a DeepSeek megközelítése egy valós idejű bírálati rendszert foglal magában, amely értékeli a mesterséges intelligencia válaszait, ami önfejlesztéshez vezet. A cég azt tervezi, hogy ezeket a modelleket nyílt forráskódú szoftverként adják ki, egy új R2 chatbottal kapcsolatban.
Chinese AI start-up DeepSeek has developed a new method to enhance the reasoning abilities of large language models (LLMs) through self-principled critique tuning (SPCT), enabling better and faster responses than competitors. Their AI model, R1, claims to perform comparably to ChatGPT while being more cost-effective. Collaborating with Tsinghua University, DeepSeek's approach involves a real-time judging system that evaluates AI responses, leading to self-improvement. The company plans to release these models as open-source software, with speculation about a new R2 chatbot.