NV Премиум

DeepSeek: все, что нужно знать о китайском ИИ, который обрушил акции Nvidia и угрожает лидерству ChatGPT

Инновации

27 января 2025, 17:42

Понедельник, 27 января, стал воистину «черным» для признанных лидеров технологической индустрии. Публикация данных о работе китайского сервиса DeepSeek привела к падению акций Nvidia и обрушению стоимости ИИ-токенов на крипторынке. Что происходит?

DeepSeek заставляет экспертов говорить о себе уже несколько недель. Китайская большая языковая модель создана вроде бы по образу и подобию ChatGPT от OpenAI, она работает быстрее и ее приложение совершенно бесплатно. Неудивительно, что приложение DeepSeek начало опережать ChatGPT по количеству скачиваний в Apple App Store.

Но самое поразительное случилось, когда данные о работе китайского стартапа появились в открытом доступе всего через несколько дней после того, как Дональд Трамп триумфально объявил о плане обеспечить лидерство США в области ИИ за четыре года и $500 млрд.

Тут-то и выяснилось, что китайский стартап DeepSeek, насчитывающий около 200 сотрудников, всего за $10 млн создал мощную ИИ-модель, во многом превосходящую ChatGPT.

Подпишитесь на NV Премиум и читайте без ограничений

Нам необходима ваша поддержка, чтобы заниматься качественной журналистикой

Первый месяц 1 ₴. Отписаться можно в любой момент

Оказалось, что DeepSeek тратит $2,19 за 1 млн токенов (единиц текста, которые ИИ обрабатывает, чтобы понимать пользователя и отвечать ему), а OpenAI — $60 за 1 млн токенов.

Вдобавок, DeepSeek разработала ИИ, который работает автономно на смартфонах без участия серверов компании. И здесь кроется еще одна огромная опасность для американской hi-tech индустрии. Ведь пример DeepSeek показывает, что ИИ может развиваться без дорогих видеокарт. Моментальное падение стоимости акций Nvidia стало вполне прогнозируемой реакцией.

Итак, DeepSeek предлагает удивительный продукт (вдобавок, еще и с открытым исходным кодом), который представляет угрозу для индустрии высоких технологий США.

Генеральный директор компании Curai Нил Хосла даже считает, что угроза возникла не сама по себе, а является психологической операцией Китая. Хосла предполагает, что DeepSeek «симулирует низкую стоимость, чтобы оправдать установление низкой цены и надеется, что все перейдут на нее чтобы нанести ущерб конкурентоспособности ИИ в США».

Насколько серьезна эту угроза и есть ли у DeepSeek какие-то подводные камни, которые могут помешать китайскому триумфу в области ИИ?

Давайте разбираться.

Что такое DeepSeek?

DeepSeek: как работает китайский ИИ и в чем он лучше, чем ChatGPT / Фото: NV via Midjourney

Основанная в мае 2023 года Лян Вэньфэном, известным деятелем китайской индустрии ИИ, компания DeepSeek финансируется исключительно за счет хедж-фонда, также основанного Вэньфэном.

Благодаря этому DeepSeek не имеет прямых внешних инвесторов, которые навязывали бы проекту волю.

Команда DeepSeek состоит в основном из молодых, талантливых выпускников ведущих китайских университетов, что способствует развитию культуры инноваций и глубокому пониманию китайского языка и культуры.

Обозреватель Forbes Джанакирам Мсв отмечает, что отличительной чертой DeepSeek стало то, что при приеме на работу компания отдает предпочтение техническим способностям, а не традиционному опыту работы, в результате чего в команде работают высококвалифицированные специалисты со свежим взглядом на развитие ИИ.

Первый проект был реализован в ноябре 2023 года. Это была модель DeepSeek Coder с открытым исходным кодом, предназначенная для решения задач программирования.

Потом была представлена DeepSeek LLM, модель с 67 параметрами, нацеленная на конкуренцию с другими крупными языковыми моделями, такими как ChatGPT.

Модель DeepSeek-V2, выпущенная в мае 2024 года, привлекла большое внимание благодаря своей высокой производительности и низкой стоимости, вызвав ценовую войну на китайском рынке моделей ИИ.

Эта разрушительная ценовая стратегия заставила других крупных китайских технологических гигантов, таких как ByteDance, Tencent, Baidu и Alibaba, снизить цены на свои модели ИИ, чтобы сохранить конкурентоспособность.

Все это прошло фактически вне поля зрения западных пользователей и инвесторов. Все-таки китайский рынок довольно плотно закрыт от посторонних глаз. Кроме того, по мнению некоторых экспертов, западные разработчики долгое время высокомерно считали, что их отрыв от Китая настолько велик, что им ничего не угрожает.

Ну а затем последовали новые разработки китайского стартапа.

Такие как DeepSeek-Coder-V2, более продвинутая модель с 236 миллиардами параметров. Она предназначена для решения сложных задач кодирования и отличается высокой длиной контекста — до 128 тысяч токенов. Цены на API-доступ к этой модели чрезвычайно низкие — $0,14 за миллион входных токенов и $0,28 за миллион выходных токенов.

Две последние модели компании и вовсе «рвут» шаблоны.

DeepSeek-V3 может похвастаться впечатляющей производительностью в различных бенчмарках, требуя при этом значительно меньше ресурсов, чем аналоги.

А DeepSeek-R1, выпущенная в январе 2025 года, ориентирована на задачи рассуждения и своими расширенными возможностями бросает вызов модели o1 от OpenAI. Именно ее успех и привел к тотальной истерии вокруг DeepSeek после того, как компания выложила в App Store бесплатное приложение, дающее доступ к модели.

Крупный венчурный инвестор Марк Андреессен назвал DeepSeek «одним из самых потрясающих технологических прорывов, которые он когда-либо видел».

«Идея недорогой китайской версии не всегда была на первом плане, поэтому она застала рынок врасплох», — говорит Фиона Цинкотта, старший аналитик рынка City Index.

При этом важно отметить, что у китайского стартапа пока нет четкой коммерческой идеологии. DeepSeek в короткие сроки добилась впечатляющих успехов, но акцент у компании по-прежнему на исследованиях. Пока не ясна, как китайцы намерены монетизировать свой триумф.

В чем революционность технологий DeepSeek?

Давайте посмотрим, что такого уникального создал китайский стартап, чтобы навести столько шороху в индустрии ИИ.

Начать можно с того, что в отличие от традиционных методов, которые в значительной степени полагаются на контролируемую тонкую настройку, DeepSeek использует чистое обучение с подкреплением. Это — довольно сложная система, которая дает языковым моделям учиться методом проб и ошибок. А самосовершенствование достигается за счет алгоритмического вознаграждения.

По сути, модели DeepSeek учатся, взаимодействуя с окружающей средой и получая обратную связь о своих действиях, подобно тому, как человек учится через опыт.

За счет этого модели получают новые способности к рассуждению и эффективно адаптируются к новым ситуациям.

Именно таким образом натренировала модель DeepSeek-R1, широчайшие возможности которой привели к взрывному успеху китайского стартапа.

Но залогом невероятной ресурсной эффективности DeepSeek является архитектура MoE, которая умеет задействовать лишь минимально необходимую часть своих параметров для решения любой задачи.

Проще говоря, китайский ИИ не «стреляет из пушки по воробьям».

Избирательная активация мощностей значительно снижает вычислительные затраты и повышает эффективность.

А еще в DeepSeek используются методы дистилляции для переноса знаний и возможностей больших моделей в меньшие, более эффективные. Меньшие модели наследуют передовые возможности рассуждений от старших моделей, и вся система работает более эффективно. Учитывая, что здесь активно используется открытый исходный код, проект в целом можно назвать наиболее передовым в сфере создания больших языковых моделей.

В принципе, приведенные выше технологии уже сами по себе являются ответом на вопрос, почему доступ к DeepSeek по API стоит в 20−30 раз дешевле, чем ChatGPT.

Но это еще не все.

Использование программных решений с открытым исходным кодом позволяет отказаться от лицензионных платежей. Кроме того, разработчики могут с легкостью модифицировать модели DeepSeek под себя.

Почему DeepSeek представляет серьезную угрозу для конкурентов?

То, что случилось на китайском рынке ИИ в прошлом году — маленькая репетиция того, что может случиться на мировом рынке.

Появление DeepSeek с его высокой производительностью и эффективностью и низкими ценами может спровоцировать настоящую ценовую войну. И привести к снижению цен на доступ к большим языковым моделям.

У OpenAI, Google, xAI и Meta затраты на обучение моделей несоизмеримо выше. И в силу того, что они пока не обладают такими технологиями, и в силу того, что это огромные компании с большими штатами и раздутыми бюджетами.

Но что случится, если люди начнут массово отказываться от 20-долларовой подписки на ChatGPT, раз DeepSeek предлагает то же бесплатно?

Или бизнесы начнут переключаться на API китайской компании, чтобы платить $2−3 за 1 млн токенов вместо $60 у того же ChatGPT?

Масштабные планы гигантов Кремниевой долины по развитию, в которые закладывались миллиардные обороты, будут под угрозой.

А есть ведь еще и индустрия «железа».

Огромные требования больших языковых моделей к производительности привели к повышенному спросу на видеокарты, что позволило Nvidia стать самой дорогой компанией мира, опережая Apple и Microsoft.

Однако, DeepSeek показывает, что вычислительные ресурсы — далеко не главное. И существуют технологии, которые позволяют обойти это ограничение.

Как только такие технологии станут массовыми, спрос на топовые решения Nvidia спадет.

А еще есть вопрос открытого исходного кода. Свободный доступ к технологиям DeepSeek позволяет небольшим компаниям и стартапам работать с самыми передовыми ИИ-решениями.

Нельзя обойти стороной и положительное влияние таких технологий на экологию. При меньшей аппаратной нагрузке DeepSeek производит меньший углеродный след, выполняя те же самые задачи.

Что может помешать китайцам на пути к триумфу?

Впрочем, хоронить американские компании пока рано. У них есть парочка козырей в рукаве.

Например, те же вычислительные мощности. Несмотря на более высокую эффективность, DeepSeek все же нуждается в современных технологиях и больших мощностях.

Но это — китайская компания. Из-за американских экспортных ограничений, у DeepSeek нет доступа к топовому «железу», которое безусловно потребуется для развития моделей следующего поколения.

Да, эффективность DeepSeek сейчас крайне высока, но не исключено, что в какой-то момент разработка, нуждающаяся в масштабировании все же упрется в нехватку производственных мощностей.

Учитывая высочайшую конкуренцию на рынке ИИ-решений, DeepSeek необходимо будет постоянно быть на «переднем крае» разработки и быть на шаг впереди конкурентов.

Другим вызовом на пути к общемировой популярности может стать репутация «китайской компании». Во многих западных странах это — не лучший способ завоевать доверие.

Особенно, с учетом типичных для китайских IT-продуктов моментов, связанных с цензурой. В сети уже активно обсуждают скриншоты чатов с DeepSeek, в которых ИИ напрямую отрицает разные общепринятые деяния коммунистических властей Китая. Проще говоря, DeepSeek создавался с учетом доминирующей в Китае коммунистической идеологии.

Вряд ли этот момент может сыграть совсем уж критическую роль, особенно для программистов, которые используют DeepSeek в качестве ассистента в работе с кодом. Но для многих людей с «гуманитарными» запросами, DeepSeek будет попросту неприемлем.

Смогут ли разработчики DeepSeek как-то обойти эти ограничения при развитии своих моделей, пока неизвестно.

«Время покажет, реальна ли угроза DeepSeek, — сейчас идет гонка за тем, какие технологии сработают и как отреагируют и эволюционируют крупные западные игроки, — убежден Майкл Блок, рыночный стратег Third Seven Capital. — Финансовые рынки слишком успокоились в начале эры Трампа 2.0 и, возможно, искали повод для отступления — и они получили отличный повод».

Другие новости

Все новости