Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → deepseek
Быстрый переход

Nvidia усиливает поддержку китайских открытых моделей ИИ, невзирая на возможные репрессии со стороны Белого дома

Nvidia заявила, что оптимизирует своё оборудование для китайских открытых моделей ИИ. Компания стремится опередить других производителей чипов в поддержке оборудования для этих платформ. Американские законодатели серьёзно обеспокоены растущей популярностью китайских моделей, поэтому Nvidia предупредила о рисках для бизнеса, связанных с потенциальными ограничениями администрации США в отношении ИИ, разработанного в Китае.

 Источник изображений: unsplash.com

Источник изображений: unsplash.com

Вчера Nvidia объявила о «локальной инициативе в области ИИ с оптимизацией для ведущих открытых моделей», включая модели от DeepSeek и Alibaba, наряду с системами, разработанными Google и самой Nvidia. В документе, поданном в Комиссию по ценным бумагам и биржам (SEC) и связанном с результатами компании за второй квартал, также содержалось особое предупреждение о рисках для бизнеса, связанных с потенциальными ограничениями Белого дома в отношении ИИ, разработанного в Китае.

Китайские модели ИИ совершили прорыв в своих возможностях к 2026 году, и их растущее внедрение разработчиками по всему миру, включая США, усилило волну беспокойства среди законодателей в Вашингтоне. Доступ к продвинутым китайским открытым моделям ИИ стал ключевым моментом в обостряющейся гонке за технологическое превосходство между США и Китаем. Открытые модели ИИ могут быть модифицированы и размещены самостоятельно, в отличие от ведущих закрытых систем, разработанных OpenAI и Anthropic.

И Пекин, и Вашингтон стремятся использовать политическое влияние для получения преимущества. В настоящее время администрация США рассматривает возможность введения новых пошлин на американские полупроводники, хотя представитель Белого дома заявил, что «пока администрация официально не объявит об этом, любые сообщения о пошлинах следует рассматривать как необоснованные спекуляции». В США также рассматривают возможность введения ограничений для Nvidia по поддержке, по словам компании, «сторонних приложений и моделей, построенных на основе открытых базовых моделей, разработанных в Китае».

Nvidia предупредила, что любой «регуляторный контроль или другие ограничения, которые ограничивают нашу способность предоставлять продукты и услуги», поддерживающие приложения, построенные на моделях, «таких как DeepSeek, Qwen или Kimi», могут оказать существенное негативное влияние на бизнес американских компаний.

«Поддержка моделей по всему миру позволяет разработчикам создавать приложения на основе американского технологического стека, — заявил представитель Nvidia. —Разработчики, использующие популярные американские и китайские модели, будут выбирать стек, для которого оптимизирована модель, что делает необходимость оптимизации для американского стека критически важной» .

Nvidia не одинока в своей кампании против вмешательства правительства США в открытые модели, которые могут быть загружены, модифицированы и размещены компаниями самостоятельно. Microsoft, Meta✴, Palantir и более 20 других компаний присоединились к ней, выступив с заявлением, призывающим политиков избегать «преждевременных ограничений» на модели с открытым исходным кодом.

В свою очередь, китайские производители чипов, включая Huawei, выпускающую процессоры серии Ascend, и Alibaba, в последние месяцы объявили о собственных оптимизациях для моделей с открытым исходным кодом, включая серии DeepSeek и Qwen.

Существуют опасения, что быстро развивающиеся китайские модели ИИ, которые, как правило, дешевле американских аналогов, могут стать стандартом для развивающихся стран. «Если китайские технологии ИИ станут стандартом для развивающихся стран, эти страны, вероятно, будут склонны к политической поддержке Пекина, а китайские компании, занимающиеся ИИ, получат плацдарм на их рынках», — уверен представитель аналитического «Центра новой американской безопасности» (CNAS).

В августе Nvidia объявила об оптимизации своего аппаратного стека, включая «поддержку с первого дня» для модели Qwen3.8-27B. Компания также сообщила, что обновления ПО позволили «легко объединять несколько систем DGX Spark в кластер», что важно для работы с такими китайскими моделями, как Z.ai GLM 5.2 и DeepSeek V4 Flash.

Сегодня биржевая стоимость Nvidia заметно возросла после опубликования результатов второго квартала, превзошедших ожидания инвесторов, и оптимистичного прогноза будущей выручки. С начала 2026 года акции технологического гиганта, обладающего почти монополией на самые передовые чипы для ИИ, выросли более чем на 10 %.

Благодаря использованию ИИ китайские хакеры удвоили число атак

Китайские хакеры увеличили число атак благодаря использованию открытых ИИ-моделей, включая DeepSeek, сообщил Bloomberg. По данным тайваньской исследовательской компании Team T5, количество атак, совершённых связанными с Пекином кибергруппировками, выросло более чем вдвое с тех пор, как они начали использовать ИИ для разработки сложного вредоносного ПО.

 Источник изображения: Sasun Bughdaryan/unsplash.com

Источник изображения: Sasun Bughdaryan/unsplash.com

Исследователи отметили, что идентифицировать используемые хакерами ИИ-модели пока не удаётся, хотя, по их сведениям, разработки DeepSeek пользуются популярностью в киберпреступной среде благодаря своей высокой производительности и возможности индивидуальной настройки, а также низким требованиям к безопасности.

В то время как в США нарастает беспокойство по поводу автономных возможностей передовых моделей от Anthropic и OpenAI после серии произведённых ими взломов в тестовой среде, китайские хакеры используют гораздо менее совершенный ИИ для масштабирования своей деятельности и осуществления атак, несмотря на наличие в стране более мощных ИИ-моделей, включая Kimi K3 от Moonshot.

«DeepSeek — это предпочтительная ИИ-модель для китайских хакеров, поскольку она относительно мощная и имеет очень низкие киберограничения, — отметил Чарльз Ли (Charles Li), главный аналитик Team T5. — Западные модели пользуются большим спросом, но их ограничения гораздо более строгие и требуют больше усилий для обхода».

По данным Team T5, группировка Grimfengxi использовала DeepSeek для создания эксплойт-кодов. Другая группа хакеров Huapi применяла китайскую ИИ-модель, как правило, DeepSeek, для атаки на почтовую систему тайской компании. Третья группа хакеров, известная как Teleboyi, использовала эту платформу для сбора 1 тыс. IP-адресов из интернета и составления карты доменов компании.

В некоторых случаях китайские хакеры применяли для атак американские ИИ-модели. Компания по кибербезопасности CyCraft сообщила, что ChatGPT использовался во время атаки на западный аналитический центр. Получив копию локальной базы данных Signal сотрудника с взломанного компьютера, хакеры обратились к чат-боту за помощью в создании программного модуля, предназначенного для ее расшифровки.

DeepSeek представила экспериментальную мультимодальную ИИ-модель — она не уступает Claude Opus 4.8

Китайский разработчик систем искусственного интеллекта DeepSeek представил экспериментальную мультимодальную версию своей модели V4-Flash. От базового варианта она отличается способностью обрабатывать в качестве запросов не только текст, но и изображения.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Экспериментальная модель DeepSeek V4-Flash-Vision-Exp умеет анализировать изображения, скриншоты и прочие визуальные запросы наряду с текстовыми, сохраняя при этом существующие возможности, в том числе функции работы с текстом, навыки логических рассуждений, применение знаний об окружающем мире и управление автономными ИИ-агентами.

 Источник изображения: x.com/deepseek_ai

Источник изображения: x.com/deepseek_ai

«В тестах для мультимодальных агентов V4-Flash-Vision-Exp демонстрирует значительный прогресс по сравнению с [базовой] V4-Flash, поднимая производительность мультимодальных агентов на уровень, близкий к Opus-4.8», — заявили в компании. Дополнительно вышел инструмент DeepSeek Harness 0.1.1, который поддерживает новую модель «из коробки».

Обновлённая модель уже доступна через API DeepSeek. При тарификации изображения преобразуются в токены (до 384 токенов на каждое) и идут по расценкам базовой модели DeepSeek V4-Flash.

ИИ-модель DeepSeek V4 Pro выпущена официально

Специализирующийся на технологиях искусственного интеллекта китайский стартап DeepSeek объявил об официальном выпуске обновлённой модели V4 Pro, призванной помочь ему отыграть позиции у местных конкурентов, которые развиваются очень быстро. Сейчас компания расширяет штат сотрудников, наращивает вычислительные мощности и привлекает инвестиции.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Модель DeepSeek V4-Pro-0813 значительно расширила возможности управления ИИ-агентами, отметил разработчик, — доступ к ней открыт через API, мобильное приложение и веб-интерфейс. Ранее компания также сообщила о повышении цен на доступ по API к V4 Pro и V4 Flash: тарификация теперь зависит от нагрузки в пиковые часы. Сообщество будет внимательно следить за свежим выпуском, потому что недорогая V4 Flash в независимых тестах внезапно показала лучшие результаты, чем выпущенный в апреле предварительный вариант V4 Pro. Это необычно, ведь Pro разрабатывалась как более функциональный продукт, но свидетельствует, что DeepSeek быстро улучшает технические решения в период между предварительным запуском и официальным релизом.

В начале 2025 года DeepSeek привлекла внимание общественности, выпустив рассуждающую R1 — она получила широкое распространение и вызвала вопросы о возможности создания мощных систем ИИ значительно дешевле, чем у американских конкурентов. С тех пор её лидерство в Китае оспорило множество конкурентов, в том числе Moonshot AI, Zhipu AI, MiniMax, Alibaba и ByteDance.

Ещё более сложной задачей для DeepSeek стало превращение своего лидерства в устойчивый бизнес. В июне компания привлекла инвестиций на $7,4 млрд; а в июле стало известно, что она готовится провести новый раунд финансирования при оценке около $71 млрд. Это знаменательная перемена для компании, которая долгое время избегала внешнего капитала. Конкуренция в области ИИ неуклонно дорожает: требуются инвестиции в ИИ-ускорители, центры обработки данных и кадровый ресурс. DeepSeek намерена удвоить штат сотрудников во всех подразделениях, включая ЦОД и отделы ИИ-агентов. Ранее также стало известно, что компания увеличила набор разработчиков микросхем — она хочет создать собственный ускоритель для запуска моделей, чтобы снизить свою зависимость от Nvidia и Huawei.

DeepSeek больше не хочет быть дешёвой — тарифы на флагманские ИИ-модели взлетят до 4,5 раза

Китайская компания DeepSeek резко повысит стоимость использования флагманских моделей V4, отказавшись от прежних сверхнизких тарифов. Новые цены начнут действовать с 16 августа и будут зависеть от загрузки вычислительных ресурсов.

 Источник изображения: John Cameron/Unsplash

Источник изображения: John Cameron/Unsplash

По информации Bloomberg, стоимость 1 млн выходных токенов DeepSeek-V4-Flash в часы пик составит $1,32 против прежних $0,28. В остальное время тариф будет вдвое дешевле. Более продвинутая модель DeepSeek-V4-Pro также подорожает: цена вырастет с $0,87 до $3,96 за 1 млн токенов в часы максимальной нагрузки, а вне этого периода будет вдвое ниже.

В компании объяснили изменение тарифов необходимостью более рационально распределять вычислительные ресурсы, а динамическая модель ценообразования должна побудить разработчиков переносить ресурсоёмкие задачи на менее загруженные периоды. При этом даже после повышения цен тарифы DeepSeek останутся ниже тарифов некоторых крупных конкурентов. Например, стоимость аналогичного объёма токенов у Anthropic для Claude 3.5 Sonnet составляет $50.

Bloomberg отмечает, что резкое изменение тарифов произошло на фоне растущего внимания к ценам высокопроизводительных ИИ-моделей. Ранее необычно низкая стоимость сервисов DeepSeek породила дискуссии о так называемой «зоне смерти DeepSeek», в которой более дорогие или менее производительные модели могут потерять конкурентоспособность.

Одновременно DeepSeek, как ранее сообщал 3DNews, готовится к масштабному привлечению финансирования и рассматривает возможность проведения IPO уже в этом году, из-за чего её основателю Лян Вэньфэну (Liang Wenfeng) приходится учитывать не только темпы расширения бизнеса, но и растущие расходы на вычислительную инфраструктуру.

Unitree подготовилась к выходу на биржу — DeepSeek закупит акций на $20,8 млн

Китайский производитель роботов Unitree завершил приготовления к выходу на Шанхайскую биржу. Цена размещения акций (IPO) установлена на уровне 150,8 юаня ($22,34) при оценке компании в 61 млрд юаней ($9,04 млрд). Это будет первый в стране производитель роботов, акции которого будут размещены в материковом Китае. Компания намеревается привлечь 6,1 млрд юаней ($904 млн); в рамках IPO заключено партнёрское соглашение с разработчиком систем искусственного интеллекта DeepSeek.

 Источник изображения: unitree.com

Источник изображения: unitree.com

DeepSeek инвестирует в Unitree 140,8 млн юаней ($20,8 млн) и получит 933 399 акций производителя роботов, или 2,31 % от общего объёма размещаемых ценных бумаг. В рамках партнёрского соглашения Unitree будет отдавать предпочтение DeepSeek при закупке услуг по обучению моделей и технических решений; DeepSeek, в свою очередь, будет отдавать предпочтение Unitree при закупке роботов и проведении исследований в области «воплощённого ИИ».

Партнёрский проект направлен на решение ключевой проблемы разработчиков человекоподобных роботов — создания «мозга» для машин, способного ориентироваться в незнакомой обстановке и надёжно преобразовывать команды человека в реальные действия. В Китае создано множество относительно недорогих роботов, которые умеют ходить, бегать и танцевать, но для эффективной работы в автономном режиме необходимы модели, обученные на данных о физическом мире: роботы должны уметь манипулировать объектами и реагировать на изменения в окружающей среде. Китайские производители роботов проводят обучение в центрах сбора данных, где люди многократно направляют человекоподобные машины при выполнении таких задач, как складывание одежды и открывание дверей.

ИИ-модели DeepSeek демонстрируют высокие результаты в тестах на программирование, математику и логическое мышление и работают с минимальными затратами. При этом сильной стороной компании являются языковые, а не мультимодальные модели, способные обрабатывать не только текст, но и изображения. В качестве исследовательского проекта у DeepSeek есть система VL2, способная обрабатывать как визуальную, так и языковую информацию, однако во флагманскую коммерческую модель она не интегрирована. В апреле один из исследователей DeepSeek опубликовал материалы проекта по улучшению визуального мышления ИИ, но впоследствии статья и связанные с ней материалы на GitHub были отозваны без объяснения причин. Партнёрство с Unitree поможет DeepSeek ускорить работу в этом направлении.

DeepSeek планирует существенно поднять цены на свои услуги в сфере ИИ

Принято считать, что китайские разработчики ИИ-моделей осуществляют свою экспансию на мировом рынке во многом благодаря низким ценам на свои услуги, но предполагаемые шаги компании DeepSeek в этой сфере разрушают данный стереотип. Стартап уведомил клиентов, что собирается существенно поднять расценки на свои услуги.

 Источник изображения: Unsplash, John Cameron

Источник изображения: Unsplash, John Cameron

Точная величина изменений не была указана, но текущие цены позволяют говорить о существенной разнице в меньшую сторону по сравнению с конкурентами. DeepSeek взимает с клиентов $0,14 за миллион входящих токенов и $0,28 за миллион исходящих. Для сравнения, Moonshot AI берёт по $3 за миллион входящих токенов и по $5 за миллион исходящих. В случае с американской Anthropic расценки ещё выше: $10 и $50 соответственно.

До сих пор считалось, что действующая ценовая политика DeepSeek надёжно защищает компанию от конкурентов, поскольку те не могут предложить доступ к сопоставимым по производительности ИИ-моделям по столь же низким ценам. Впрочем, для всей мировой отрасли ИИ сейчас характерна ориентация на окупаемость, поскольку многомиллиардные инвестиции надо отбивать, а предлагая доступ к ИИ-моделям за бесценок, этого сделать в разумные сроки нельзя. DeepSeek намеревается выйти на биржу в этом году, а потому инвесторам нужно продемонстрировать способность компании зарабатывать деньги.

DeepSeek намерена получить в своё распоряжение минимум 1 ГВт вычислительных мощностей, как благодаря строительству крупного ЦОД в районе Внутренней Монголии, так и через аренду у других компаний. В США для строительства ЦОД мощностью 1 ГВт могут требоваться затраты в размере около $50 млрд, но в Китае они традиционно ниже. В любом случае, DeepSeek нуждается в дополнительных капиталовложениях для достижения стоящих перед компанией целей.

Пользователи модели V4-Flash могут получать к ней доступ не только напрямую от DeepSeek, но и через партнёров компании, которые разместили её на своих вычислительных мощностях. Теоретически, именно сторонние провайдеры могут сохранить более привлекательные цены на доступ к V4-Flash, если DeepSeek слишком сильно задерёт тарифы.

Alibaba представила свою самую мощную ИИ-модель, а DeepSeek V4-Flash оказалась самой доступной

В понедельник китайская компания Alibaba представила свою крупнейшую и наиболее мощную на сегодняшний день модель искусственного интеллекта, что привело к резкому росту её акций, пишет Reuters. В то же время сообщается, что новейшая ИИ-модель от компании DeepSeek предлагается более чем в 100 раз дешевле, чем Claude Fable 5 от Anthropic.

 Источник изображения: Unsplash / Markus Winkler

Источник изображения: Unsplash / Markus Winkler

Издание сообщает, что указанные два события подчеркивают стремительные темпы развития искусственного интеллекта китайскими технологическими компаниями, которые ведут ожесточённую борьбу за создание более мощных систем, не делая их при этом непомерно дорогими в эксплуатации.

Обе модели — Qwen3.8-Max от Alibaba и V4-Flash от DeepSeek — демонстрируют приверженность Китая открытым моделям, поскольку компании стремятся завоевать популярность среди разработчиков по всему миру. «Китайские компании, занимающиеся ИИ, нашли важный рынок. Для многих бизнес-процессов не требуется самая лучшая в отрасли модель. Им нужны модели, которые достаточно хороши, доступны по цене, прозрачны и удобны в использовании, и модели с открытым исходным кодом помогают удовлетворить этот спрос», — отметил в разговоре с Reuters главный аналитик исследовательской фирмы Omdia Лянь Цзе Су (Lian Jye Su).

В случае с моделью с открытым исходным кодом, базовые параметры обучения, позволяющие разработчикам запускать или адаптировать систему, доступны для загрузки. В отличие от них, OpenAI, Anthropic и Google используют модели с закрытым исходным кодом.

ИИ-модель Alibaba Qwen3.8-Max сразу же взлетела в рейтингах, оценивающих возможности моделей ИИ, после своего дебюта в понедельник. На фоне этого цена акций компании подскочила на 7 % на торгах в Гонконге. Новая модель поддерживает 2,4 триллиона параметров — числовых настроек, которые модель изучает на основе данных и использует для распознавания закономерностей, генерации ответов и выполнения задач. Она несильно отстаёт от своего отечественного конкурента, модели Kimi K3 от Moonshot AI, которая была запущена в прошлом месяце и поддерживает 2,8 триллиона параметров. Более высокое значение параметра не делает модель автоматически лучше, но оно стало важным показателем масштаба вычислительных ресурсов и данных, лежащих в основе передовых систем искусственного интеллекта.

Qwen3.8-Max была представлена на краудсорсинговой платформе сравнения моделей Arena.AI. Вскоре она оказалась одной из самых высокорейтинговых китайских моделей в категории текстовых моделей ИИ, хотя всё ещё отстаёт от Claude Fable 5 и трёх вариантов моделей Opus, все из которых разработаны Anthropic. В таблице лидеров Arena.AI для моделей ИИ, анализирующих изображения и другие визуальные материалы, Qwen3.8-Max заняла второе место в мире, уступив только модели Claude Fable 5.

Как Qwen3.8-Max, так и Kimi K3 могут работать с текстом, изображениями и видео, обрабатывая до 1 млн токенов за раз. Токены — это фрагменты данных, часто части слов или короткие слова. Чем больше это значение, тем больше материала модель может обрабатывать за один раз, например, длинные юридические документы, обширную базу программного кода или сотни страниц документов.

Компания Alibaba заявила, что Qwen3.8-Max, выпуск которой запланирован на следующую неделю, завершила проект по разработке программного обеспечения за 16 дней. Она использует архитектуру «смешанных экспертов», которая распределяет работу между специализированными частями системы, вместо того чтобы включать всю мощность ИИ для каждого запроса. Одновременно используется 95 млрд параметров, что снижает затраты и задержки ответа.

По данным исследовательской компании Artificial Analysis, модель DeepSeek V4-Flash, выпущенная в пятницу, является самой недорогой среди известных моделей в мире согласно тестам. Использование V4-Flash стоит $0,14 за миллион входных токенов и $0,28 за миллион выходных токенов. Artificial Analysis оценила среднюю стоимость теста V4-Flash в $0,03, по сравнению с $0,86 для Kimi K3, $1,86 для GPT-5.6 Sol от OpenAI и $3,15 для Claude Fable 5.

Переписки пользователей с DeepSeek оказалась общедоступны в поиске Google

Сеансы переписки пользователей с китайским чат-ботом с искусственным интеллектом DeepSeek проиндексировал поисковый сервис Google, обнаружили «Коммерсантъ» и РБК. В общем доступе оказались чаты, для которых создавались публичные ссылки.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Поиск Google добавил в выдачу переписку пользователей с DeepSeek — в неё вошли личные сообщения чат-боту и загруженные на платформу рабочие документы. Поисковик проиндексировал только те сеансы, которыми пользователи решили поделиться с другими: сервис предлагает возможность создавать публичные ссылки чатов. При этом DeepSeek предупреждает, что содержимое сможет прочитать любой человек, у которого окажется доступ к этой ссылке, а также рекомендует проверять наличие конфиденциальной информации.

Закрытой информации в открытых переписках пользователей с DeepSeek обнаружить пока не удалось, нет возможности и скачивать приложенные документы. Но сервис предлагает сформировать новый запрос к ИИ и продолжить диалог. Доступ к чужим учётным записям и возможность читать закрытую историю запросов в DeepSeek отсутствует. Это не первый инцидент подобного рода: в 2023 году поиск Google проиндексировал аналогичные публичные ссылки на переписку пользователей с ChatGPT — тогда проблема оказалась связана с ошибкой в библиотеке с открытым исходным кодом.

DeepSeek готовится привлечь новые миллиарды — оценка стартапа вырастет до $71 млрд

В конце мая китайская компания DeepSeek провела первый в своей истории раунд привлечения внешнего финансирования, который позволил собрать $7,4 млрд и оценить капитализацию разработчика в $52 млрд. Теперь появилась информация, что стартап уже готовит второй раунд финансирования, который поднимет планку капитализации до $71 млрд.

 Источник изображения: Unsplash, Solen Feyissa

Источник изображения: Unsplash, Solen Feyissa

Об этом накануне сообщило издание Financial Times, напомнив, что с момента предыдущего привлечения капитала DeepSeek прошло чуть более месяца. Капитализация стартапа при этом должна вырасти на 37 %, исходя из приводимых оценок. Средства требуются компании на строительство центров обработки данных и покупку ускорителей вычислений для инфраструктуры искусственного интеллекта. В рамках предыдущего раунда основатель компании Лян Вэньфэн (Liang Wenfeng) вложил в капитал DeepSeek около $3 млрд собственных средств, а ещё акционерами стартапа стали CATL, Tencent, JD.com и NetEase. Небольшой пакет акций DeepSeek также достался одному из государственных инвестиционных фондов КНР.

Помимо строительства ЦОД, выручка от первого раунда финансирования будет направлена DeepSeek на привлечение дополнительных кадровых ресурсов. На ключевых направлениях численность команд специалистов будет удвоена, как сообщает Financial Times. Конкуренция в сегменте ИИ растёт не только среди китайских разработчиков, но и на мировом рынке, поэтому его участникам требуется всё больше финансовых ресурсов. DeepSeek уже считается самым дорогим стартапом в Китае, а её основатель является самым богатым разработчиком ИИ-моделей благодаря высокой концентрации капитала в его руках.

Попутно Bloomberg и The Wall Street Journal сообщили, что DeepSeek начала подготовку к проведению IPO в Шанхае, заявка на которое может быть подана до конца текущего года, а само размещение произойдёт уже в 2027 году. Переговоры с финансовыми консультантами на эту тему руководство стартапа уже проводит.

Основатель DeepSeek стал богатейшим разработчиком ИИ-моделей в истории

Состояние основателя китайской компании DeepSeek Ляна Вэньфэна (Liang Wenfeng) после последнего инвестиционного раунда выросло более чем вдвое — примерно с $16,7 млрд до $36 млрд. По оценке Bloomberg Billionaires Index, это сделало его самым богатым предпринимателем среди основателей компаний, специализирующихся непосредственно на создании больших моделей искусственного интеллекта.

 Источник изображения: VCG

Источник изображения: VCG

Китайский предприниматель с существенным отрывом опередил сооснователя Anthropic Дарио Амодеи (Dario Amodei) и сооснователя OpenAI Грега Брокмана (Greg Brockman). Резкий рост состояния связан с июньским раундом финансирования DeepSeek, достигшим объёма более $7,4 млрд. Инвесторы оценили китайский стартап приблизительно в $50 млрд, тогда как ещё в апреле его ориентировочная стоимость составляла около $10 млрд. Сам Лян вложил в раунд примерно $3 млрд и после размещения, по расчётам Bloomberg, сохранил около 78 % компании.

Таким образом, состояние предпринимателя остаётся преимущественно «бумажным»: оно определяется расчётной стоимостью его доли в непубличной части DeepSeek, акции которой не торгуются на бирже. При следующем раунде финансирования или изменении оценки компании размер состояния Ляна может существенно измениться. Его высокая позиция в рейтинге богачей объясняется не только ростом DeepSeek, но и тем, что он сохранил гораздо большую долю бизнеса, чем многие американские основатели, привлекавшие капитал в течение нескольких раундов.

В общем рейтинге миллиардеров Лян Вэньфэн занимается 63-ю строчку. В Китае по этому параметру он примерно на восьмом месте. Следует учесть, что Bloomberg составил рейтинг с высоким положением основателя DeepSeek без учёта всего спектра бизнеса в ИИ (от разработки чипов до дата-центров). В ином случае на первое место претендовал бы Илон Маск с его триллионами, в том числе, за ИИ-модели. Несмотря на отчасти «бумажную» основу успеха основателя DeepSeek, у компании ещё есть резерв для роста, который опирается на самое настоящее «железо» — по слухам, компания разрабатывает свой чип для ИИ-инференса и намерена соскочить с оборудования Nvidia и Huawei.

Что касается лидеров компаний Anthropic и OpenAI, пусть почаще изымают свои передовые ИИ-модели из общего пользования — это «верный» путь к успеху.

Китайская DeepSeek тайно разрабатывает собственный чип для инференса ИИ

Китайский стартап DeepSeek, по информации источников Reuters, уже около года интересуется возможностью разработки собственного ИИ-чипа для ускорения работы с инференсом, а потому проводит консультации с возможными партнёрами и привлекает профильных специалистов без лишней огласки.

 Источник изображения: Unsplash

Источник изображения: Unsplash

По замыслу DeepSeek, собственный чип поможет компании снизить зависимость от компонентов Nvidia и Huawei. Если первые до некоторых пор поставлялись в Китай в ограниченном ассортименте из-за экспортных ограничений США, то в последнее время их сложно импортировать уже из-за позиции китайских властей, которые настаивают на импортозамещении. Продукция Huawei хоть и пользуется растущей популярностью у китайских разработчиков, доступна в ограниченных количествах из-за тех же санкций США, которые не позволяют подрядчикам компании выпускать необходимые чипы в достаточных количествах и закупать за границей скоростную память типа HBM. В любом случае, доля Huawei на китайском рынке ИИ-ускорителей сейчас приближается к 50 %, тогда как Nvidia практически утратила своё присутствие на первичном рынке КНР.

Пока сложно судить, кому именно DeepSeek поручит выпуск своего ускорителя для инференса, и какая память ему потребуется, но компании наверняка предстоит найти и партнёра по разработке. По информации Reuters, стартап привлекает специалистов по разработке чипов, но старается не афишировать подобную деятельность, а потому соответствующие объявления о вакансиях не публикуются в открытом виде. Если первые ИИ-модели DeepSeek были обучены на ускорителях Nvidia H800, которые с определённых пор не поставляются в Китай из-за санкций, то весной этого года стартап адаптировал свои новейшие модели под чипы Huawei Ascend. Если ускорители собственной разработки DeepSeek сможет поставить на конвейер и не попасть под санкции США, это позволит стартапу получить определённое преимущество по сравнению с прочими китайскими разработчиками.

Многие компании ИИ-сектора стремятся разрабатывать собственные ускорители вычислений. Помимо американских OpenAI и Anthropic, в подобную активность вовлечены китайские Alibaba и Baidu. По всей видимости, DeepSeek предпочитает двигаться по такой же траектории.

Tencent начала тестировать ИИ-агента на базе DeepSeek в корпоративной версии WeChat

Tencent начала подготовку к запуску агента искусственного интеллекта в корпоративном мессенджере. Китайские технологические гиганты усилили ожесточённую борьбу за привязку пользователей к своим экосистемам, передаёт Bloomberg.

 Источник изображения: tencent.com

Источник изображения: tencent.com

ИИ-агент уже начал развёртываться для некоторых пользователей мессенджера WeCom — корпоративной версии популярного в Китае суперприложения WeChat, рассказал глава отдела по связям с общественностью Tencent Чжан Цзюнь (Zhang Jun). Помощник, получивший название Dayuan, работает на базе модели DeepSeek V4 и поддерживает запросы на естественном языке.

Dayuan обещает стать серьёзным рабочим инструментом, способным использовать огромные массивы данных, присутствующие в WeCom. ИИ-агент анализирует групповые чаты, переписку по электронной почте и записи в корпоративном календаре — он помогает эффективнее оценивать отзывы клиентов и оптимизирует взаимодействие с ними. Приложение умеет автоматизировать повторяющиеся задачи, составляя ежедневные отраслевые обзоры и готовя еженедельные отчёты.

Tencent сейчас выступает в качестве догоняющей сегменте ИИ, уступая таким игрокам как Alibaba и ByteDance. Корпоративный мессенджер WeCom является прямым конкурентом Alibaba DingTalk и ByteDance Lark на китайском рынке рабочих приложений. Эти приложения служат интерфейсом для облачных подразделений китайских техногигантов — их клиенты сейчас наращивают потребление токенов. Преимущество WeCom состоит в интеграции с популярной в стране потребительской экосистемой WeChat — обладая им, Tencent стремится укрепить свои позиции.

CATL и Tencent стали инвесторами DeepSeek, но больше всех вложился основатель стартапа

Не только западные стартапы привлекают крупные суммы на развитие инфраструктуры искусственного интеллекта. Как сообщает The Information, первая попытка китайской DeepSeek обратиться за финансированием к внешним источникам позволила этой компании привлечь $7,4 млрд и оценить свою капитализацию более чем в $50 млрд. Среди инвесторов оказались компании Tencent и CATL.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Структура сделки, как сообщает источник, была направлена на сохранение основателем и генеральным директором DeepSeek Ляном Вэньфэном (Liang Wenfeng) абсолютного контроля над своим детищем. По этой причине инвесторы формально вкладывались в капитал не самой DeepSeek, а контролируемой им партнёрской организации. Кроме того, продать свои доли в капитале этой структуры инвесторы не смогут на протяжении ближайших пяти лет. Исключением стал Национальный фонд инвестиций в ИИ-отрасль КНР, которому было позволено вложить $148 млн напрямую в капитал DeepSeek, а также в дальнейшем продать свою долю в любое время без ограничений. Кроме того, эта структура ещё и сохранила право голоса в управлении DeepSeek, в отличие от прочих внешних инвесторов.

Впрочем, в качестве привилегий для последних можно рассматривать сохранение доступа к подробной финансовой отчётности DeepSeek, а также право первоочередного участия в новых раундах финансирования. Непосредственно основатель компании внёс в её капитал дополнительные $3 млрд, что сделало его основным участником раунда. Tencent внесла $1,5 млрд, производитель тяговых батарей CATL внёс вдвое меньше, а ряд прочих инвесторов ограничились суммами по $444 млн. Сбор средств вёлся с апреля этого года. Основанная в 2023 году DeepSeek до этого не привлекала внешний капитал. Успех ИИ-модели R1 в начале 2025 года вызвал необходимость в более активном финансировании компании, поэтому ей пришлось обратиться к внешним инвесторам. Новые средства будут направлены не только на обучение ИИ-моделей и развитие вычислительной инфраструктуры, но и увеличение штата профильных специалистов.

Китайские DeepSeek и CXMT увернулись от попадания в чёрный список Минторга США

Ограничения на взаимодействие с теми или иными иностранными компаниями в США диктуются разными ведомствами, но Министерство торговли воздержалось, вопреки опасениям, от включения в свой «чёрный список» китайских DeepSeek, CXMT и в общей сложности более чем 100 других компаний из КНР.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Об этом сообщило накануне агентство Reuters, которое объяснило подобную осторожность нежеланием властей США обострять взаимоотношения с Китаем. Кандидаты из числа китайских компаний на включение в новую редакцию перечня были отобраны межведомственной комиссией ещё в прошлом году, но последнее слово оставалось именно за внешнеторговым ведомством США.

К китайской DeepSeek у властей США накопилось немало претензий. Её подозревают не только в нелегальном получении доступа к американским ускорителям вычислений, но и в использовании разработок Anthropic и OpenAI для создания схожих ИИ-моделей. Кроме того, в эту копилку добавился и традиционный фактор подозрений в содействии DeepSeek китайским военным и спецслужбам.

Китайский производитель памяти CXMT был уличён в содействии китайским военным ещё при президенте Байдене, а действующая администрация США рассматривала возможность введения санкций против этой компании на протяжении более чем полутора лет. Если бы экспортные ограничения по линии Министерства торговли США в отношении указанных китайских компаний вступили в силу, то любое сотрудничество с ними со стороны американских юридических лиц потребовало бы получения специальной лицензии, которую на практике было бы практически нереально оформить. «Чёрный список» в последний раз обновлялся Министерством торговли США в октябре прошлого года, пауза стала самой продолжительной за последние десять с лишним лет.

Предполагалось, что этот список может пополниться теми китайскими компаниями, которые снабжают своей продукцией вооружённые силы КНР и могут поставлять соответствующее оборудование в Россию, а также снабжать китайские университеты санкционными ускорителями вычислений Nvidia. С конца прошлого года руководство американского министерства предпочло не обострять напряжённость во взаимоотношениях с Китаем. Считается, что это даже немного упростило китайским компаниям процесс закупки американских ускорителей вычислений. Не менее 75 китайских компаний и организаций были предварительно отобраны для включения в новую редакцию списка, но она так и не была опубликована с осени прошлого года.


window-new
Soft
Hard
Тренды 🔥
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 8 мин.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 2 ч.
В российской серверной ОС SelectOS прописалася ИИ-агент Aish 2 ч.
«Нам нужно адаптироваться»: оригинальная The Long Dark получит новые DLC, а Blackfrost: The Long Dark 2 скоро выйдет из тени 4 ч.
Новая Fable не станет игрой на сотни часов, и фанаты даже рады 5 ч.
ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию 24 ч.
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрд 30-08 15:22
Valve случайно «слила» 12 Тбайт данных по играм Steam с 2003 по 2013 год, включая ранние сборки Portal 2, Left 4 Dead, CS:GO и не только 30-08 15:18
Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений 30-08 11:59
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 30-08 00:08
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 32 мин.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 44 мин.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 3 ч.
Очередная доставка астронавтов и космонавта на МКС задержится из-за технических проблем у корабля SpaceX Dragon 3 ч.
Поставщики облачных услуг в Бразилии возьмут на вооружение оптические диски Folio Photonics 4 ч.
Гибрид Xiaomi Skynomad N90 Max проехал в реальных условиях 1230 км без подзарядки и дозаправки 5 ч.
FPGA AMD Versal RF получат поддержку UCIe 1.1 5 ч.
Российские цены на оперативную память и SSD для серверов выросли вдвое — снижения цен пока не предвидится 5 ч.
Лиха беда начало: Longsys станет третьим китайским чипмейкером, который выйдет на биржу в этом году 8 ч.
Intel может приобщиться к выпуску памяти HBM4E — она будет делать базовые кристаллы для SK hynix 8 ч.