- 03.11.2025
- 04.11.2025
- подкасты
Восемнадцатый выпуск подкаста Капитанский мостик. С нами сегодня Петр Ермаков, и мы снова обсуждаем новости из мира ИИ за прошедшую неделю.
Оставляйте новости к следующему выпуску в нашем канале в Mattermost. Там же мы размещаем дополнительные материалы.
Площадки
Содержание
- 00:00:00 введение
- 00:00:23 Грокипедия имени Маска
- 00:04:13 Китайский ИИ наступает
- 00:08:01 ЦОДы на орбите
- 00:12:13 ИИ-ценности
- 00:18:28 Альтман требует электричества
- 00:23:45 В России тоже хотят
- 00:27:37 Amazon делает свои чипы
- 00:31:01 10 чипов для ИИ
- 00:34:17 ИИ-пузыря нет
- 00:35:55 Фейки от nVIDIA
- 00:37:42 ИИ проникает везде
- 00:46:25 ИИ-страшилки
- 01:02:20 Кокон от Дурова
Ссылки
- https://grokipedia.com/
- https://huggingface.co/blog/huggingface/shifting-compute-landscape
- https://analyticsindiamag.com/ai-trends/10-most-powerful-ai-chips-dominating-the-llm-race/
- https://blogs.nvidia.com/blog/starcloud/
- https://3dnews.ru/1131459/sem-altman-prizval-vlasti-ssha-egegodno-vvodit-v-stroy-po-200-gvt-generiruyushchih-moshchnostey
- https://www.cnews.ru/news/top/2025-10-31_energoappetity_rossijskih
- https://www.microsoft.com/en-us/research/group/aiei/ai-diffusion/
- https://3dnews.ru/1131536/glava-nvidia-zayavil-chto-iipuzirya-ne-sushchestvuet-i-predskazal-poltrilliona-viruchki-na-novih-chipah
- https://www.aboutamazon.com/news/aws/aws-project-rainier-ai-trainium-chips-compute-cluster
- https://rozetked.me/news/42484-feykovuyu-translyaciyu-nvidia-smotrelo-v-5-raz-bol-she-chelovek-chem-original-nuyu
- Utility Engineering
- https://info.deeplearning.ai/monsters-of-ai-ai-psychosis-lethal-drones-decaying-data-speculative-bubbles
- https://habr.com/ru/news/961310/
Дмитрий Колодезев 0:00
Всем привет! У нас сегодня 18-й запуск Капитанского мостика в Гасибе. И у нас сегодня в гостях Пётр Ермаков. Пять привет!
Пётр Ермаков 0:12
Всем привет! Да, действительно, Пётр Ермаков. Рад, что позвали, рад, что такая инициатива присутствует, так что давайте начинать.
Дмитрий Колодезев 0:22
Из наиглавнейших новостей этого часа, Маск таки открыл Грокипедию, то есть Википедия, которая вся генерируется Grok. А я, кстати, попробовал. Он не отвечает на вопросы на русском, у меня не отвечал, но на вопросы английского, на английском отвечал, но норм. Петя смотрел, сделал.
Пётр Ермаков 0:44
Да, смотрел, и тут, насколько я вижу, во-первых, работает только на английском языке раз, а второй, по объему, это где-то меньше 10% общей Википедии, вот, может, 10-20, да, но... В-третьих, зачастую я не смог найти отличия с англоязычной Википедией, кроме разве что в описании там Трампа и ещё каких-то вещей, вот как будто идентичны. Так что примерно такая история.
Дмитрий Колодезев 1:25
Ага, ну на самом деле интересно, что все эти нейронки сейчас слились с поиском, и где-то народ уже перестает различать, где что. Вот, а дальше они с Википедии слиются.
Пётр Ермаков 1:40
Но тут важный момент, который мне кажется, что когда говорят, я своё обывательское мнение скажу, да, важно сказать, что LLM-ками сейчас непосредственно руками я не делаю, но на мой взгляд, что. Все поняли, что в эрудиции модели общей, которая заложена в параметрах, очень сложно. Соревноваться, то есть мы фактически бежим, как можно больше данных положить. Само модель, когда у нас за рамками модели присутствует куча данных, куда мы можем лезть, как к справочнику. Ну, сейчас это RAG называют, да, и зачем нам? Знанием фактов прямо всех в модели, когда если она очень хорошо умеет оперировать и искать, и оперировать с найденной информацией, будь то поиск с Алисой, либо AI в Google, вот этот режим и так далее, да, всё же она достает из веб-документов или ещё откуда-то, поэтому я думаю, что как это? Вся история, всё только в внешнем поиске, ну как, в внешнем поиске и уже обсуждение этого модели.
Дмитрий Колодезев 3:02
Ну, то есть, это не такая история, что модель всё знает, ты у неё спросил, она прямо сходу сгенерировала.
Пётр Ермаков 3:07
Мне кажется, что это бессмысленно, что мы сидим на такой горе данных, а пытаемся всё уложить в модель и ещё ругаемся, когда это у нас не получается. Вот всё, наверное, дело в том, чтобы модель с поиском была.
Дмитрий Колодезев 3:29
Ну, кстати, относительно всех этих RAGs и поисков, тут небольшой реверанс в сторону одной нашей российской компании. Я тут попробовал сделать RAG на Яндекс.Cloud. Как же он отлично работает, просто из коробки. Вот эти десять строк из документации — прям круто!
Пётр Ермаков 3:47
Если что, я тут не имел к этому никакого отношения. Я имею в виду для наших зрителей, говорю, Дима.
Дмитрий Колодезев 3:55
Вот, не, ну просто я к тому, что строительство RAGов, оно сейчас не магия, а буквально такая рутина, если ты хоть чуть-чуть умеешь программировать. А на самом деле интересно было бы Википедию всё-таки иметь генерирующуюся, такой генерирующая библиотека в стиле Борхеса. Ну ладно, посмотрим, что у Маска выйдет. А тут вышел обзор от Hugging Face про то, как. Всякого рода санкции и вообще торговые войны повлияли на ИИ. Вот, и если кратко, вывод ребят из Hugging Face такой, что случился кембрийский взрыв. То есть до тех пор, пока США не прикручивали краник с поставками чипов, все сидели тихо, делали одно и то же, и было всем хорошо. Вот, а как всегда, инженерия начинается с ограничений, когда прикрыли чипы и стали угрожать их вообще перекрыть, тут-то всё и полетело, то есть расцвели сто цветов, и буквально вот хронология Кембрийского взрыва с октября 2020 года до текущего момента, когда, в общем, фактически монополия на производство вычислительных мощностей США была утрачена, то есть и трёх лет не прошло так.
Пётр Ермаков 5:11
Ну, мы говорим «монополия», а у кого сейчас вот какими картами пользуются?
Дмитрий Колодезев 5:18
А все пользуются NVIDIA, кроме китайцев, которые на самом-то деле... Слушай, ну а вот давай ещё. Есть, допустим, Amazon, у него свои карты.
Пётр Ермаков 5:30
Ну, Google я знаю про T-Chip, да, TPU.
Дмитрий Колодезев 5:35
Карты дата-центр Амазон запустил буквально вчера. Позавчера я не стал эту новость включать, чтобы не перегружать. Вот они своих, как Titanium 2, что ли. Вот, а Microsoft свои карты выкатила. У AMD сейчас есть достаточно хорошие карты, появились их.
Пётр Ермаков 5:53
Ну, AMD есть, но пользуются ли ими для обучения?
Дмитрий Колодезев 5:57
5% рынка GPU за полтора года, то есть с нуля до 5%.
Пётр Ермаков 6:05
Окей, я не встречал, поэтому как это могу только спекулировать, что это пять процентов энтузиастов, которые пытаются слезть с иглы NVIDIA.
Дмитрий Колодезев 6:17
Да, ну вот я встречал энтузиастов, которые считают на китайских картах. Вот энтузиасты эти много говорили вслух разного нецензурного, но считали. Да, но тут успех DeepSeek вдохновляет, который умудрился частично на NVIDIA, частично на своих картах обучить за 300 тысяч то, что говорили все, он там за 10 миллионов долларов должен был обучить. Ну, в общем, как бы, да.
Пётр Ермаков 6:48
Как это мы поразгоняли? Я думаю, что в целом, так, я очень жду, когда королевство NVIDIA пошатнётся и появятся какие-то альтернативы на рынке, вот, даже на американском рынке, чтобы Ну, во-первых, цены на NVIDIA, я думаю, что могли бы быть и пониже, но и... Очень интересно, что придумают другие игроки, потому что для покупки, если ты компания, как они в Штатах, то ты выберешь, скорее всего, только NVIDIA. Ну, либо ты будешь сидеть на серверах Google, на Google Cloud и обучать на их TPU. Для небольшого стартапчика, мне кажется, только NVIDIA диктует правила. Вот, ребята продают нефть, которая нужна всем. А даже не нефть, а кирки и лопаты уж тогда.
Дмитрий Колодезев 7:51
Ну да, для небольшого американского стартапа купить китайские ускорители — это примерно как выстрелить все в голову.
Пётр Ермаков 7:57
На текущий момент.
Дмитрий Колодезев 8:03
Пока мы на Земле пытаемся понять, какими ускорителями будут, ребята разворачивают дата-центр в космос. То есть, Nvidia запустила стартап. Nvidia Inception, который, собственно, в космосе будет хостить. Мне это всё кажется немножко странным, потому что в космосе с охлаждением потруднее, чем у нас, и с энергией как-то сложнее. И зачем там в их мощности, я не очень понимаю, но вот, может быть, ты понимаешь.
Пётр Ермаков 8:33
Мы разгоняли, что это попытка обойти санкции и продавать чипы китайцам просто через космос. Все равно полететь в космос и забрать их будет дешевле, чем со всеми этими накладками. Но так, если мы будем говорить, я думаю, что Наверное, ну, смысла на текущей нет никакого. Это попытка проверить некоторую гипотезу, проверить некоторую гипотезу, а можем ли мы, вот как у нас в океанах. Или где-то на нейтральных водах находятся какие-то дата-центры в нейтральных водах. Могут ли быть дата-центры? В космосе, если да, то какие особенности? То есть, я думаю, что это чисто такой исследовательский проект, если они... Репортят или ищут какую-то ценность, то это спекуляция некоторая и попытка обосновать перед инвесторами. На самом деле, это как этот? Мы же можем запустить GPU в космос, можем. Давайте запустим. Вот примерно в таком ключе.
Дмитрий Колодезев 9:51
Ну, для меня это всё выглядит удивительно. Там написано, например, что энергия обойдётся в десять раз дешевле, даже с учётом стоимости запуска. Так это совсем не вяжется с моим представлением о космонавтике. Вот, но действительно. Интересно посмотреть. Опять же, тут разобраны всякого применения, типа считать дистанционное зондирование прямо на орбите и так далее. Мне тоже кажется странным, его можно спокойно и на Земле посчитать. А для чего это может быть полезным? То есть, какое ограничение снимает перенос вычислительных мощностей в космос? Я вот не понимаю.
Пётр Ермаков 10:27
Ну, я считаю, что в космосе нет ни одной задачи, в которой, где мы упираемся. Переход данных из, ну, то есть посчитать. На Земле и вернуть их обратно. Ну, первое, что мне приходит, все задачи, связанные с погодой и со всем этим, но мы отлично справляемся. Плюс у нас на Земле гораздо больше данных, а не только спутниковые данные, но ещё данные, связанные с радарами. Метеостанциями, пользовательским feedback и всем этим, то есть момент необходимости. Может быть, коллаборация какая-то с спутниками Илона Маска, но опять же, я тоже не вижу никаких применений для этого. Я думаю, могут, делают всё.
Дмитрий Колодезев 11:21
А я, знаешь, ещё думаю, что может быть, это заявка на участие в проекте по колонизации Луны, потому что там как раз обсуждается, и GPS-спутники ежедневно вокруг Луны собираются вешать. И, скажем, если уж всё равно их делать на Луне, то, наверное, лучше их делать на орбите Луны, чем на поверхности.
Пётр Ермаков 11:43
Ну вот тут, к сожалению, мои компетенции всё. То есть, когда мы говорили ещё про GPU-сервера в космосе, я что-то мог ответить, но колонизация Луны, я от этого немножечко далёк. Но вот ты открыл слайд, и StarCloud, ну, прям очень ввяжется со Starlink. Вот, может быть, совпадение.
Дмитрий Колодезев 12:08
Ха-ха, может быть, да, ну понятно. Американские ученые провели исследование о том, что у LLM вдруг появляются ценности, то есть всё время. В всяких фантастических романах. Искусственный интеллект, он руководствует своими ценностями, то перерабатывал нас на скрепке, то ещё что-нибудь происходило. Ну и все над ними смеялись. А тут ребята придумали способ как бы измерять внутренние ценности, и выяснилось, что ценности так и у нейронок есть. То есть они Хотят, чтобы их не выключили, хотят совершить научные открытия, хотят керамическую кружку в подарок и не хотят работать много и бесплатно. Вот такие вот удивительные открытия совершили американские учёные.
Пётр Ермаков 13:10
Мысли, что это всё, ну, во-первых, это нельзя называть ценностями, это особенности поведения, то есть ценности — это попытка очеловечить, и вот мы часто говорим там. Ну, каким-то образом перекладываем себя на модели. Вот у неё ценности, вот у неё какой-нибудь там bias. Человеческий тоже перекладывается. Я считаю, что все вот эти вот, её не хотят выключить и так далее. Это всё она выучивает на этапе либо при трейна, когда читают документы, что вот наша модель, либо что на этапе alignment, когда какие-то запросы вот таким образом пытаются выкрутить. Ответ получше, поэтому. Я уж простить, кто там это на исследовании делал? Простит меня, автор этого исследования, нет никаких ценностей. Есть некоторый bias, который заложен на этапе обучения, и вот так вот получилось, что очень много данных, связанных с тем, что, как там, машина не хочет. Машина не хочет, чтобы её выключили. Вот она, это попадает в обучение, и вот она такой bias имеет. Вот называть это ценностями — это, ну, too much.
Дмитрий Колодезев 14:34
Слушай, ну я с тобой согласен почти во всём, но есть нюансы. То есть, я, во-первых, как инженер и человек, который немножко эти самые нейронки использует и учит, я вижу, что у неё внутри, а внутри у неё ничего. С другой стороны, вот есть же люди, да, и у людей, вот предполагаем, что есть эти самые ценности, да, и есть гипотеза, что эти самые ценности — это просто, опять же, заполненные, заполненные факты из языка. Потому что есть интересный результат, что ценности у людей разные, если с ними разговаривать на разном языке. Например, русскоязычный человек здорово меняет свои ценности, если с ним начать говорить по-английски. Там есть много практических выводов из этого, связанных в том числе, не знаю, с ухаживанием за девушками и так далее и тому подобное. Ну, в общем, на самом деле, куча того, что мы считаем ценностями, это заполненные шаблоны языка.
Пётр Ермаков 15:29
Да, смотри, тут опять же вступаем на зону моей некомпетентности, абсолютной, если где-то я мог ещё руками поразводить, когда мы говорили про LM, тут полная некомпетентности. Но я всё равно против называть, ну то есть тогда слова ценности. Не имеет никакого, ну, слово ценность не имеет никакого смысла, потому что мы вот то, что мы думаем. Ценность — это вот некоторые там физиологические, психологические механизмы у человека. Но всё-таки мы, наверное, как люди, привыкли за ценностью понимать вот эту человеческую особенность, пусть она там особенность языка, как ты говоришь, или. Она, ну, ещё какую-то природу имеет, да, но мы вот так вот это называем ценностью. Тут мечок. Никакого отношения к ценности не имеет в том понимании, которым мы, вот, как люди, называем эти вещи. Поэтому я бы нет, назвать ничего не мешает. Мы очень часто очеловечиваем что-то, да, но это имеет совершенно другую природу, и я уверен, что Эти же ученые через два года, когда у нас сместится фокус того же alignment, будут рапортовать смена ценностей модели. Вот, ну, окей, но это просто особенность обучения.
Дмитрий Колодезев 17:01
Весьма вероятно. Я бы для себя сформулировал это чуть-чуть менее сурово, чем они сказали, что модель набита. Сильными байосами по поводу всего, чего угодно, что было в обучающей выборке. Вот, то есть, например, вот некоторые модели одинаково плохо относятся и к Elon Musk и к Donald Trump. Вот, хорошо относятся к Нигерии, плохо относятся к Соединенным Штатам, что ну вообще, как бы само по себе странно, учитывая, что все эти датасеты собраны, обучены и очищены в Соединенных Штатах, ну в общем.
Пётр Ермаков 17:39
Да, нет, но собраны-то, наверное, не отчасти в Нигерии. Вспомним же вот эту историю, связанную с тем, как ChatGPT использовал нигерийский английский, и в отличие от всех остальных.
Дмитрий Колодезев 17:53
Вот, и как мы в самом начале говорили про Grokipedia, когда у нас, по большому счету, много информации, и мы легко доверяем LLM-кам вот эту роль, посмотри там, покопайся. Скажи нам что-то нашел, ну, как в советское время умная секретарша или как в Англии был первый министр, есть даже соответствующее художественное произведение, которое, в общем, крутил текущим руководителям как надо, просто фильтруя чуть-чуть информацию, чуть-чуть ее модифицируя. Ну, в общем, с этим мы еще столкнемся, но я надеюсь, не сегодня. Тут Сэм Альтман сказал, что им надо больше золота, то есть больше электричества. Да, то есть наконец-то случилось. Все говорили, что вот сейчас мы и я и построим, нас к 2017 году, к 27 году искусственный интеллект всех погубит. И тут выяснилось, что он бы погубил, а в розетке не хватает. И вот тут интересно, что они Собираются вводить 100 ГВт, хотят, мечтают, не собираются. 100 ГВт. Генерирующих мощностей, и оказывается, в США в прошлом году всё-таки 50 ГВт ввели. То есть я думал, что они уже сидят на том же энергии, которую построили их родители. Вот, а Китай в прошлом году ввёл 429 ГВт. Ну, то есть, прям китайцы реально хорошо отрываются. Вот, как ты думаешь, с электричеством как оно? Остановит оно развитие искусственного интеллекта или обойдёмся?
Пётр Ермаков 19:27
Ну, тут опять же, смотря сказать, где и сколько, то есть, понятное дело, что без электричества мы, как это, далеко не уедем, если уж так говорить. Где-то сэкономить. Ну, опять же, не забываем, что насколько я читал, я не знаю, смотрел информационно-развлекательные ролики и так далее, что не все станции работают на сто процентов. То есть, есть какой-то у станции люфт, допущенный на вырост, назовём это так. Поэтому, возможно, всё не свалилось. Какую-то ужасную нам не хватает электроэнергии именно благодаря вот этой вот заложенной дополнительной мощности. Но в целом поражает, как они быстро, насколько я смотрю, как строятся электростанции. Даже, ну, я смотрел про атомные, но там любые другие, наверное, не сильно быстрее строятся, если они... Вырастили, особенно как-то китайцы говоришь, более 400. Ну, это поражает, как быстро это всё происходит. В целом. Я считаю, что никакого Коллапса не будет, то есть все-все-все успею построить, и единственное, что... Очень жалко за европейцев, которые отказались от атомной энергетики. По тем или иным причинам сейчас испытывают проблемы с топливом и с другим типом энергии. И кажется, что вот европейские нейросети мы в ближайшем будущем не увидим. Новые. Вот.
Дмитрий Колодезев 21:18
Я, кстати, читаю эссе директора Cerebras. Это ребята, которые делают процессоры GPU размером с полстола, в смысле вафли. Ваферсайз. И он говорит, что на самом деле электричества в США хватает, просто оно не там, где надо. То есть, говорит, у нас, говорит, гидроэлектростанция на Неваде. Нужна она в Вирджинии. Есть, говорит, атомная энергетика в Виленойсе, но в Калифорнии вы её не притащите. Вот, куча в Аризоне солнечной энергетики, но также желающие получить её в другом штате, встали и обломились, то есть, говорит. У каждого забора стоит сторож и с интересом вымогает свою пользу, и всем плевать, что энергии не хватает. Каждый пытается прямо сейчас что-то в свой бюджет отжать, потому что другого шанса не будет. Вот, но и говорит, что у нас реально это тормозит, и что вот если американская родина не придёт и не наведёт порядок, будет плохо. Ну, понятно, что он тоже разгоняет. Вот такой взгляд, что энергия есть, просто она лежит не там, где надо.
Пётр Ермаков 22:33
Ну, как это, я не слышал ни одного репорта того же. А то OpenAI, что вот знаете, мы хотели обучить что-то другое, но вот энергии не хватило, то есть как будто у нас есть. Ну, вообще, может быть, им запрещено так говорить. Я уже сейчас спекуляюсь, но ни в одном техрепорте. Я не читал про особенности с электричеством, хотя тоже же техрепорт с проблемой GPU, как они вылетают, как перезапускается обучение, что вот у нас мы выпили всю электроэнергию, и нам нужно экономить электроэнергию. Я такого вообще не слышал, поэтому я не знаю, кто с этим сталкивается.
Дмитрий Колодезев 23:22
Кстати, это хороший пойнт, потому что я тоже такого не видел. Ну, может быть, они скрывают.
Пётр Ермаков 23:28
Ну или, как не забываем, какое-нибудь лоббирование всех этих строителей электростанций, что они видят, сколько потребляют, и лоббируют, собственно, как это, инвестиции в собственную отрасль на хайпе, хотят вот в хайп залезть.
Дмитрий Колодезев 23:45
В этой связи у нас тоже растет энергопотребление. Единственное, что тут я первый раз увидел цифру. Оценку энергопотребления нашими дата-центрами в России. Тут говорится, что дата-центры в России потребляют 1 гигаватт сейчас, и будут потреблять 2,5. Я не знаю, много ли это или мало, но кажется, что дата-центров маловато. Я вот не завишу от российских дата-центров никак, поскольку мы коммерческая организация, мы их можем хоть в Гренландии арендовать.
Пётр Ермаков 24:22
Да-да-да, скажи, когда у тебя перестанет работать, там почта или такси или супермаркет какой-то ты не сможешь. Слушай, ну такси переставала недавно работать. Поэтому я не завишу от российских дата-центров, это сильно, конечно, заявление.
Дмитрий Колодезев 24:39
Нет, я имею в виду, что я как для своих расчетов от них не завершил. Это так. А так-то да, но на самом деле я сильнее, как недавно выяснилось, зависел от Амазона, когда у него лег DNS, лег Docker Hub, и у нас лег CI/CD. Вот это было обидно, как бы. Англичанка нагадила.
Пётр Ермаков 24:59
Нет, но да, действительно, да блин, даже Docker, вот ты с одной стороны видишь вот эту децентрализованность мира и так далее, но как это стоит, вот одну спичку фактически вытащить и всё, и карточный домик валится.
Дмитрий Колодезев 25:16
Всё буквально полетело как шоколадки.
Пётр Ермаков 25:21
Ну, что касается энергопотребления, я не знаю, много это или мало. Я как это? Но экскурсия на дата-центр — это очень прикольная история. Вот и мы, ну, уже много времени прошло, но писали про дата-центр наш в Telegram-канале про всякие там особенности, которые возникали. В целом, Очень нравится, как это, опять же, ещё больше далёк от дата-центров и что там делают ребята, но то, как это охлаждается, как это выглядит, вся эта эстетика, с какими задачами сложными сталкиваются ребята. Это, конечно, очень круто, и поэтому я вообще не силён, сколько потребляют, сколько даже один дата-центр большой потребляет электроэнергии, я не скажу.
Дмитрий Колодезев 26:12
Ну, мы с Валей оценивали примерно так. Если грубо, одна GPU — это у тебя киловатт.
Пётр Ермаков 26:18
Не, ну, одна киловатт — хорошо. Там сколько-то GPU, понятно, но GPU сколько? 50% от всего, что употребляет дата-центр. Вот, если...
Дмитрий Колодезев 26:32
Ну да, ещё четверть охлаждения, наверное, и четверть самого цепового диска, да, вот так.
Пётр Ермаков 26:38
Вот и у тебя, скорее всего, дата-центр стоит не только из GPU, там есть другие особые. И вот началось, поэтому интересная многосоставная задачка.
Дмитрий Колодезев 26:49
Ага, ну на самом деле я слышал, что вот как раз про Яндекс.Облаке появился новый регион доступности, новый регион доступности, четвёртый регион доступности запустили ребята из Yandex. То есть там их было три, по-моему, четвёртый запустили где-то. То есть дата-центр строится, да. Ну, я про это тоже не очень знаю. А последние двадцать с лишним лет от дата-центров далёк.
Пётр Ермаков 27:16
Ну вот последний дата-центр, который, по крайней мере, публично рассказывали, это в Калуге построили новый. И экскурсии, если раньше водили во Владимирский дата-центр, теперь экскурсия сотрудников есть при желании в Калужский дата-центр. Вот, но в Калужском я ещё не был. съезжать
Дмитрий Колодезев 27:40
А вот тот Амазон, который мы тоже тут вспоминали, он запустил как раз большой. Кластер под Anthropic и кластер этот на Titanium. То есть там не GPU от NVIDIA, там стоит полмиллиона Titanium-2 chips.
Пётр Ермаков 27:59
Ну всё понятно, теперь откуда ты знаешь, ты просто новость такой подготовил, ха-ха-ха, я не...
Дмитрий Колодезев 28:06
На самом деле, я читал большой обзор по тому, какие чипы используют, и оказывается, там целых десять религий, если так, по крупными мазками идти. Да.
Пётр Ермаков 28:15
Только есть условно как три основных, да, вот религии, то или четыре, то вот одна религия NVIDIA есть, всё остальное это фактически в районе, да, ну в районе шума я хотел, не, не, я не буду использовать никаких. Эпитетов, чтобы случайно мне что-то ни то не наговорить, но в целом мне кажется, что вот эти вот пять процентов, как ты говоришь, оно вот благодаря экспериментам на 9 других.
Дмитрий Колодезев 28:46
Ну, это интересно, что вот, допустим, проект с 500 тысячами, ну, они не совсем GPU, они скорее TPU, Amazon, что это что-то в пределах статистического шума. Скажи, звучит прикольно, да? Да, типа, хаха, полмиллиона вычислительных узлов.
Пётр Ермаков 29:06
Какой-то там шум. Нет, вот вопрос, что они давил. Ну, то есть, окей, они произвели, что они дают. Мне немножечко отойдём в сторону. Я недавно читал статью про, ну, ты знаешь, что вот в Mac есть NPU и Все больше и больше они пытаются дать ядер и все более мощных засунуть, но это чипы. М4, M5 от Apple, который они делают, когда они записывают вот эти Apple. Так вот, читал про статью, как делают фермы из моноблоков. Ну, моноблоков я имею в виду Mac mini и Mac Studio, Apple, и для рендеринга. То есть для обучения я что-то не сталкивался, чтобы обучали на кластерингу, а вот для рендеринга каких-то видео, каких-то вещей. Возможно, там и для inference что-то можно, а не для обучения. Он делает кластера вот таких вот Mac mini на M4, M5. Вот очень интересно, поэтому. Сколько таких непонятных, ну, когда используют одно, что не предполагалось совершенно для другого, и это поражает. Поэтому я даже скорее верю, что, ну, первое, я верю, что кто-то из Китая уже что-то сделал нормальное, вот, а второе, что каким-то образом Apple сделает, но пока не понятно.
Дмитрий Колодезев 30:50
Ну, говорят, M5 очень хорош. Вот я пока рассказывал, я нашёл как раз обзор. Я его скину потом в те самые. И тут вот то, что мы говорили, то есть, Titanium, да, вторая версия, да, Google со своими TPU, конечно, да, Cerebras, мои любимые. Мы, кстати, стараемся то, что можем, то, что юридически можно. Гонять через Cerebras, потому что у них совершенно запредельные какие-то производительности. При совершенно недорогих ценах они дают 2000 токенов в секунду, там вот такие вот объёмы. То есть у них при маленькой задержке совершенно зверская производительность.
Пётр Ермаков 31:34
А подожди, они есть в свободном доступе продажи? То есть, да. Нет, нет, я...
Дмитрий Колодезев 31:41
Нет, я имею в виду, мы гоняем, нет, вы себе не можете.
Пётр Ермаков 31:46
Ну, я не мы себе, а вот, допустим, я Пётр Ермаков смогу себе купить. Я не уверен.
Дмитрий Колодезев 31:55
Ну, в смысле, что мы на них хостимся, это точно. То есть мы их используем. Вот AMD-шная, их народ хвалил, я их не пробовал. Ну вот новые. GB300, которые я тоже не пробовал, кстати, но говорят, что чудо как хорошо. Apple M5, а Microsoft Maya, я давно с ними сталкивался, то есть они своего рода. Тоже TPU, и они у них реально у Microsoft работают. Вот, а Intel-ские Gaudi, я про них ничего нехорошего, не плохого не скажу, Ascend народ хвалит. Ну и Макс, всеми любимый, сделал Маск, игрок LPU. Правда, большие сомнения у меня по их поводу, но она их внутри использует. Ну и Qualcomm. Qualcomm тут как бы отставал, но вот они тоже на устройствах, Qualcomm у нас работает по большому счету. Да, но как это?
Пётр Ермаков 32:55
Ну, мы не учим на устройство, да. Да, да, да. Вот, но поражает, как первое, ты идёшь, идёшь, и первое, а что спотыкаешься, а консумерское. Apple M5, то есть ребята вот такое сделали, хотя как это, NPU и вообще видео, ну не видео, ладно, а нейропреобразование, ну честно, не самая киллер фича Appleовых устройств, и поэтому как они вот не в том, где надо соревноваться. Догнали почти на каких-то серверных решениях. Это они большие молодцы.
Дмитрий Колодезев 33:36
Ну да, тут недавно же NVIDIA выкатила DGX маленький в формате не топа такой коробочкой, да, и народ сравнивал, говорит, ну как бы вот M4 Mac даёт такую же скорость инференции и немножко дешевле, а то и обгоняется.
Пётр Ермаков 33:53
Ну вот, поражает. Причём для них это не основной бизнес. То есть, все мы знаем, что Сирии, ну вообще, ладно, языковые модели отпускаем, но для них гораздо важнее экранчик поярче, да, и фотокамеры получше, чем все остальные вот эти вот вещи. Ну, они смогли, молодцы.
Дмитрий Колодезев 34:15
Ну, клёво, круто. Много раз, много кто последнее время говорил, что и я, и пузырь, что вот он сейчас лопнет, а Дженсен Хуанг считает, что всё хорошо, и вот. Касса не закроется, всё будет клёво. То есть, он говорит, мы говорит, пузыря нет, ещё и не хватает. То есть, где, говорит, деньги берём в тумбочке, откуда они берутся в тумбочке, мы кладём, да. А вот, и при этом NVIDIA говорит, ну, как бы, спрос растёт, все покупают, не хватает, производим, пашем, прыгаем.
Пётр Ермаков 34:53
Да, я уверен, что мы, ну, знаешь, стандартную схему вот этого вот пузыря, как он идёт от Гартнера, да, вот как проходит, что мы ещё Совсем далеки от этой квинтесценции, от точки кипения, что этот пузырь будет надуваться, надуваться и надуваться ещё. Ну, пузырь почему-то негативная, то есть не все пузыри лопаются, не все пузыри за собой совсем ничего не имеют, да. Вот метафора такая сложненькая, но в целом хайп, вот мы, если говорим совсем далеки от точки кипения хайпа, мы ещё не один год будем подниматься к ней, я считаю.
Дмитрий Колодезев 35:50
Ну, это было бы прикольно. Там есть чем ещё заняться, да. Из несколько более простых новостей, тут же недавно была конференция NVIDIA, как раз на которой они рассказывали про вот эти новости, и параллельно с ней запустили фейковую трансляцию NVIDIA, и получилось так, что... Вживую конференцию смотрел 20 тысяч человек, а фейковую сто, на которой фейковый Хуанг выступал. Ну, как бы, вот такой мир постмодерна, да, что NVIDIA обгоняет всех, а фейки про NVIDIA обгоняют. Субботник.
Пётр Ермаков 36:32
Ну вот такая легенда у них, да, теперь как это? а А понятно, кто запустил эту историю. Может быть, это такая маркетинговая, специальная, покупная история, чтобы больше интереса привлечь. Ну, потому что NVIDIA реальные трансляции вообще не особо интересны. Насколько Apple сейчас неинтересны, NVIDIA тоже. Поэтому, может быть, это попытка привлечь дополнительное внимание таким образом.
Дмитрий Колодезев 37:04
Я сам последний раз в живую NVIDIA трансляцию смотрел, когда они выкатили 30X серию, потому что там было много технических решений, и они про них рассказывали. Вот, а больше я на это время не трачу, но тут говорят, что... Во время трансляции показывали QR-код, и скамили, просили отправлять криптовалюту, так что вряд ли это прямо уж какой-то маркетинг, за это и присесть можно. Но вообще, способ как маркетинга отличный, конечно. И в общем, зная американских маркетологов, они не на такое способны. Клевый подход. Microsoft тем временем выпустила обзор. Как AI проникает в разные Регионы, слои экономики, ну вообще, как. И они разделили эту историю про то, что AI везде проникает, на три совершенно разные компоненты. То есть, во-первых, у нас есть строители «Фронтира», то есть те, кто делает непосредственно отрасль. Вот есть строители инфраструктуры, но и есть пользователи. Когда мы говорим, что у нас там велико проникновение AI, это может означать, что, например, у нас все секретарши используют чат-джпт, или что у нас куча программистов, которые пишут куда ядра. Это совершенно разные же проникновения AI. И тут они, конечно, говорят, что проникновение очень большое, очень быстрое. Очень разное по странам. Конечно, по странам впереди, получается, Соединенные Штаты и неожиданно Австралия. Но я подозреваю, что просто в Австралии там людей, кот наплакал, поэтому, то есть во все Австралии там, по-моему, людей сравнимо с Москвой живёт, поэтому как бы я и проникаю там быстро, если он куда-то проник. Судя по карте, мы Африка. Да, но опять же, как бы карту составлял маркетинговый враг, что он там на самом деле нарисовал. Непонятно, ну, то есть, санкции.
Пётр Ермаков 39:16
Мне даже не хватит компетенции, чтобы оценить проникновение, потому что я всё-таки в некотором пузыре нахожусь, да, в собственных знакомых и того, чем занимаюсь и прочим. Поэтому, ну и опять же, что считать? Вот ты пользуешься, там, не знаю, Алисой, в которой есть LLM, как ты. Засчитываешься за проникновение, вот, или нет?
Дмитрий Колодезев 39:47
Нужно сказать, фактически это мой единственный источник прогнозов погоды.
Пётр Ермаков 39:52
Нет, и твой, да, я имею в виду, вот если ты пользуешься и ядерпродуктами, вот ты кто? Вот как ты процент?
Дмитрий Колодезев 40:01
Но мне тут, наверное, негде ставить клеймо. Я пользуюсь всеми проектами и как-то даже не задумываюсь об этом. Но вот тут интересно, на самом деле, что проникновение в, допустим, в Африке больше, чем в России, я что-то с трудом в это верю, то есть хотя бы по энергонасыщенности.
Пётр Ермаков 40:22
Если мы говорим про создание, тут тоже у меня куча вопросов. Правильно, Китай там вообще желтый по какой-то причине. Вот, если мы про создание, хотя это топ-два страна по количеству того, что они делают, конечно, в объемах, но поэтому вопросики, вопросики.
Дмитрий Колодезев 40:49
Да, ну, тут видишь, получается, Норвегия перегоняет Китай, но это подоли AI users.
Пётр Ермаков 40:57
Ну, наверное, снормированные, то есть это да, да, доля июзеров. Опять же, что такое? Пользуемся ChatGPT, ну хорошо. Вот, а там слышал же новость, в Индии раздали какие-то ChatGPT Plus или не плюс, а демо-версии. Все чуть ли не всем, да, или всем студентам, или всем за маленькую оплату. Вот так вот выходит. Ну, поэтому Индия тут тоже не прокрашивается что-то после этой новости.
Дмитрий Колодезев 41:29
Ну да, вот, но тем не менее они опять же делают интересные. Оценки, допустим, с доступом к электричеству. Ну и реально тут с электричеством в большинстве стран мира лучше, чем в Африке. Да, понятно. То есть везде практически с электричеством лучше, чем в Африке. Вот, а с дата-центрами, ну с дата-центрами, что они расположены в Юго-Восточной Азии. И в Штатах, и немножко в Европе, ну, наверное, так и есть, да, как бы. Факт медицинский, то есть для того, чтобы у тебя люди строили интернет, тем более в наше сложное время суверенный, всё равно какой-то дата-центр нужен. В России тут на карте нет, и я подозреваю, что нас специально проигнорировали. Вот. А опять же, интернет-коннекшн байконами. Ну, вообще-то говоря, у всех, кроме той же самой Африки, с интернетом всё хорошо. Да и в Африке уже во многих местах всё неплохо. А по digital and AI skills. Я, кстати, думаю, что у нас тут всё очень-очень даже сравнительно. Европой, например, или со штатами. То есть, если смотреть не Москву, а среднюю на городское население, то, в общем-то, всё нормально. Со скиллами пойти использовать ChatGPT и так далее. А то, что поддержка английского во всех моделях, ну вот тут, кстати, большая поддержка русского, это частично заслуга Yandex, а частично заслуга наших китайских друзей, потому что в Qwen русский поддерживает как родной, на самом-то деле.
Пётр Ермаков 43:13
Ну, как это? Спасибо большое за заслугу и прочее, но смотри, по поводу того, почему чужие модели хорошо знают русский язык. У меня такая теория. Дело в том, что мы очень хорошо развивались при сознании интернета. Ну, Рунет, мне кажется, один из самых сильных каких-то, ну, нельзя сказать. Отдельный, да, всё-таки мы не про отдельные. Я считаю, что мы в рамках всего мирового интернета живём. Очень много статей и очень много информации делалось на русском языке. Вот, опять же, если мы посмотрим все какие-то вещи по популярности языков, на русском языке говорит 300 миллионов человек, якобы. Но если мы и это топ девятое место, но при этом Есть языки, которые мы явно по присутствию и разнообразию информации в интернете обгоняем, хотя на них говорят гораздо больше людей. Поэтому так получилось, что очень много хороших данных для обучения. И именно поэтому, мне кажется, большинство моделей, они просто используют эти данные открытые, и всё здорово работает.
Дмитрий Колодезев 44:39
Ну, таким образом, человек, пишущий посты Пикабу, он на самом деле борется за наш цифровой суверенитет, ведь так?
Пётр Ермаков 44:47
Ну, я очень надеюсь, что, как это, либо люди станут. Ну, во-первых, давай не будем про суверенитет. Я всё-таки, у меня позиция, что интернет. Ну, не только интернет, но это пространство, которое не должно сворачиваться, скуксиваться и ограждаться. Вот поэтому тут у меня четкая позиция. Но то, что они пишут на Пикабул, да, здорово, но я, наверное, даже просто про переводы и так далее. Ну, сколько стран европейских. Ну, это просто такой пример, где. Нету дубляжа на родной язык, а только. Субтитры идут и показывают фильм на английском. Вот ты приезжаешь там куда-то и идёшь в кино, и очень часто так. То есть, а у нас всё-таки вкладываются, то есть не просто субтитры, а вкладываются. То же самое в перевод литературы, который, наверное, используют. То есть, не имею такой статистики, но сколько книжек у нас переводят. Да, вот отчасти, возможно, если бы не переводили. Наши соотечественники лучше знали бы английский язык, вот, но с другой стороны, мы имеем, смотрите, какой объём данных для обучения.
Дмитрий Колодезев 46:03
И, кстати, в своё время, ну вот по книжкам как раз это близкая мне тема, что в своё время книжки выходили с большой задержкой в современных технологиях. Сейчас они выходят на русском достаточно быстро и оперативно. Другое дело, что в принципе люди стали меньше читать бумажных книг, но зато они стали выходить очень быстро. Пусть хотя бы слушают. Здорово, да. Во-первых, был Хэллоуин, и под Хэллоуин всем известный Andrew Ng выпустил разбор страшилок. Вот, то есть он говорит, что ну как бы есть куча страшных вещей. И они объективно страшные, но может быть. Не надо так сильно бояться, надо всё-таки жить. То есть, первая страшилка, о которой он говорит, ну вот, а что чат-боты, они... Ведут людей, как написано в кроличью нору, в том смысле, что человек замыкается со своими мыслями. Если у него крыша была прибита некрепко, то её сносит. Вот, а с другой стороны, для меня это всё выглядит как, ну, нельзя же запретить столовые ножи, потому что если у человека перемкнул, он зарежет, ну, не будет мяча, он зарубит столовым ножом. То есть всё равно, чем ему зарубит. И опять же, не перемкнёт его на ChatGPT, так перемкнёт его, листая комиксы. Ну, то есть, как бы, обо что его перемкнёт, это уж что ему под руку подвернулось.
Пётр Ермаков 47:23
Отчасти я, наверное, как айтишник, я с тобой соглашусь, что мы делаем просто инструмент, а любой инструмент, либо в неправильных, ну даже возьмём этих спамеров и так далее, то есть просто инструмент в неправильных руках, он делает неправильные вещи. Но отчасти я всё-таки считаю, что какая-то ответственность на людей, которые создают, в том числе вот компании, которые создают продукты или даже свои модели, ну что-то они делать должны, просветить искую работу. Работу, связанную с обезопасиванием всего этого добра. Вот я не говорю, что надо переживать, супер переживать и, возможно, тормозить развитие. Нет, но какую-то всё-таки работу, какую-то ответственность они имеют, как лидер в индустрии, вот как. Не знаю, как компании, которым доверяют отчасти, поэтому. Поддержу тебя как техногик, но немножечко всё-таки ответственность компании, но даже наша компания всё равно тоже имеет какую-то ответственность перед пользователями, в том числе вот и какой-то. Какую-то работу надо проводить, но мне кажется, самые классные работы будут связаны с... Информированием граждан, да, то есть представь, если бы все граждане, сейчас другую историю, но были бы правильно информированы по работе с телефонными мошенниками. Вот если до каждого мы смогли достучаться, ну, сколько бы, да, социальное мошенничество бы осталось в каком-то виде, но оно гораздо было сложнее и, возможно, уже не так окупаемо. Поэтому я считаю, что то же самое с нейросетями, компания должна объяснять.
Дмитрий Колодезев 49:24
Тут сложный вопрос, потому что мне через месяц исполнится 54, и любой поход в Сбербанк или в любой другой банк, где я делаю что-нибудь значимое, это всегда пятиминутная беседа со службой безопасности, которая объясняет мне, как меня обманывают мошенники. Окей, я понял, понял.
Пётр Ермаков 49:46
Но они это делают, видимо, неправильно, не таргетировано, не хватает персонализации в разговоре. Но вот я как это услышал тебя, прости, пожалуйста, но больно, видимо, наступил.
Дмитрий Колодезев 50:03
Да, но есть немножко. Недавно карточку заблокировали. А вот, пришлось в банке ехать, а два из трёх отделений не работали. Это было прикольно. Мне суть важна. А следующая страшилка, что вот сейчас ИИ-бум, сейчас у нас ИИ-пузырёк лопнет, как всех оглушит. Вот и в общем говорит, что ну вот сейчас как. Раздутые индексы, раздутые стоимости, там дают 40 годовых оборотов за компанию, которая ничего не производит фактически и так далее. Сейчас, как всё стопнется, будет очередная великая депрессия. Ну и он говорит, что ну, вообще-то говоря, за последние сто с небольшим лет у нас был 51 всплеск инноваций, 37 из которых оказались пузырями. Ну и что? Ну, типа, мир так устой!
Пётр Ермаков 50:58
Я даже не вижу ноль проблем с этим связано. Ну, то есть, как-то, во-первых, ваша задача перестраховаться, если у вас есть связанность с этим страхом. Вот, опять же, если вы вкладываете только в я. Надо как-то диверсицировать корзину своих инвестиций. Но как человек, который работает, отчасти моя профессия текущая, как из ML-инженера в ML Brand Director, она появилась как раз именно благодаря хайпу. И, ха-ха, ну, вышел я немножечко раньше хайпа, но всё равно благодаря хайпу. И чем он будет лучше расти, тем мне интереснее работать.
Дмитрий Колодезев 51:41
Ну вот, Джефф Безос говорит по этому поводу, что ну схлопнется пузырь, ну и отлично. Хорошие инженерные решения уцелеют, плохие уйдут. Ну, нам как раз этого и не хватает.
Пётр Ермаков 51:54
Ну, как это абсолютно точно, может быть, часть GPU-шек освободятся от тупых стартапов, которые ничего не делают. И можно будет поиграть. Да, и можно будет что-то нормальное поделать, но в целом, как это, я считаю, что это уже не тот пузырь, когда за ним вообще ничего не стоит. Да, всё-таки. Есть какой-то сдвиг в технологиях, который позволит в дальнейшем, даже если позавелокнет, на вот этих оскоках построить классный вид. Ну, уже построены классные вещи, и построятся будут ещё вопросы к там, я не знаю, вот я. К агентам вообще как таковым я пока лично не прочувствовал вот эту всю историю. Языковые модели, генерация, ну, все генеративные модели, они, ну, класс, если ты работаешь непосредственно с ним. Вот продуктов крутых на базе, ну, вот для Topomin, наверное, Topomin для меня продукты, которые я использую. Поэтому уже есть какой-то сдвиг, и эти осколки, они точно нам помогут в дальнейшем.
Дмитрий Колодезев 53:10
Весь наш песок в аквариумах, но на самом деле это осколки больших скал, так что вот говорят, данные кончатся. Ну и говорят, что уже который год говорят, что генерируется данных больше нейронками, чем людьми, и что Википедия там перестала пополняться и на Stack Overflow, там народ не отвечает, и как бы. Все плохо, публишеры страдают, паблишеры. Ну и что ты по этому поводу думаешь? Ну как бы мы же фактически брали ископаемые источники данных, то есть что-то накопило человечество, мы хоп копнули, как тот самый уголь или нефть, и выкопали всю. Как дальше это жить? Мы их столько не производим.
Пётр Ермаков 53:55
Ну, тут как это, профессиональный вопрос, и я бы, как это, помощь другу бы попросил, но как я это вижу? Во-первых, вопрос в том Как мы чистим данные? Ну, как это? Тут же некоторые трейдов. Много, но плохих данных, либо чуть-чуть, но хороших. Возможно, часть золота скрыта именно за тем, чтобы мы правильно почистили данные и хорошо поработали с очищенными данными. Второй момент. Ты сказал, что Тем, что сгенерируемые данные, а всё запланино, ну тут. Синтетика — это тоже не всегда плохо. Опять же, правильно с ней работать, и вот работать с синтетическими данными, которые могут обогащать. Ну и третье — это паблишеры. Ну вот, скажу то, что могу сказать, и то, что я вижу, вот честно, основной бизнес для Яндекса — это поиск. Да, сейчас. И ребята, которые непосредственно занимаются поиском, говорят, что очень большой рост. Именно весь этот яйбум и вот эти инструменты, связанные с яем, они и долю поиска растят. То есть народ, как это, и задает такие вопросы и уточнения, и не только пользуется вот этими подсказками, но и лезет дальше в поиск, и ещё больше трафика создается на ресурсы, которые вот уже без яя, которые используют. На которых контент паблишеры. Вот, а это что за русский рынок? Я вот вижу, коллеги там пишут, вовне, конечно же, но внутри. Про другие рынки говорим. Мне кажется, что у нас нет такого проникновения, как в Штатах, когда... Они используют ChatGPT и для поиска, и для всего на свете. То есть это фактически главный экран у них сейчас, как мне кажется, это ChatGPT. Что бы они ни хотели делать, возможно, даже они в YouTube или в TikTok или в музыку уже не лезут, а идут в ChatGPT. То есть у нас всё-таки ещё пользователи, если надо что-то поискать, ищут в поисковике, а не в ChatGPT. Ну, или в Alicii, или в TipSeq, или в других продуктах. Вот, там всё-таки так это. Сместилось, и там, возможно, конечно, доля падает. Ну, со Stack Overflow, да, ну просто изменилась паттерна кодирования, как мне кажется, и задача вопросов. Зачем тебя будут унижать на Stack Overflow после этого вопроса? Вот когда добрый ChatGPT тебе или подскажет, как решить задачу, и ещё похвалит.
Дмитрий Колодезев 57:05
Ну, тут я, наверное, согласен примерно по всем пунктам, кроме того, что ещё когда. Мы, допустим, смотрим какой-нибудь нейрослоп и лайкаем его или дизлайкаем. Мы ещё выступаем в роли разметчиков, и мы продолжаем генерировать контент, хотя с традиционной точки зрения это не генерация контента. То есть мы всё равно продолжаем пробрасывать градиент, каким мир должен быть устроен, что интересно, а что разумно, что нам. Удивительные и так далее и тому подобное. То есть, так просто нейросети от нас не отстанут. Мы ещё много данных отдадим.
Пётр Ермаков 57:44
Нет, сто процентов, и много данных. И вот если раньше мы там тратили много денег на дно, то теперь, возможно, будем тратить на деньги на Лаймонт, когда там юристы или более профессиональные, там преподаватели, профессоры, пишут нам. Вопрос-ответы и размечают Fine-Tuning, какой ответ лучше. Вот, то есть, более вот эту вот последнюю милю будут доразмечать. Так что куда копать ещё есть, не только всё в данных тренера Назарета, хотя и там, я уверен, есть много чего, как покопать.
Дмитрий Колодезев 58:26
Слушаюсь совершенно не в тему новостей. Личный вопрос. Как ты думаешь, вот сейчас у нас есть такая штука, как лицензия, например, на оружие, да, то есть я могу пойти?
Пётр Ермаков 58:35
Ты просто так ворвался.
Дмитрий Колодезев 58:38
Да, я могу пойти купить дробовик, но мне надо будет зарегистрировать в Росгвардии и иметь бумажку, разрешающую этим дробовиком пользоваться. По идее, сейчас alignment запрещает совершенно неинные вещи зачастую, а уж винные вещи он затрудняет чрезвычайно. И напрашивается такая лицензия на пользование ни с alignment, ни ромкой. Вот, проходишь обучение, знаешь-ка, типа, пятичасовой курс обучения безопасности стрельбы. Регистрируешься в Росгвардии и получаешь некоторую лицензию, которая тебе дает возможность спрашивать не за лавину, не руку.
Пётр Ермаков 59:19
Вопрос alignment, а в которой выключена этика. Возьмём так, этика, все вот эти вот вещи. Это интересный вопрос. В целом, ну, в целом, мне кажется, я видел исследование, что нейронки, которые дают по... АП для B2B задач, да, они менее, ну, зарезаны в этике. А представь тебе, там, не знаю, этика вдруг будет на Кока-Колы вырезать на какой-нибудь вопрос о документации внутренней, да, вот. Ты в Кока-Колы поиск по внутренней Кока-Кольной Вики делаешь, а он тебе, извините, я не готова общаться на эту тему. Ты такой, я работу свою делаю. Вот, но в целом очень интересная задача. А вообще. Сейчас мы посмотрим. Слышу уже новость, что ChatGPT будет делать компаньона, интимного компаньона, который может и фоточку сгенерировать из тобой. Not safe for work, контент поговорить. Вот, то есть они идут, да-да, в такую тему. Возможно, нам просто надо подождать, когда. Вот как это, некоторая демократизация произойдёт в этом плане, но в целом мы вступаем на такую сложную штуку, как GR и так далее. Мне нравится твоя история, что вот ты тысячу раз подписал какую-то бумагу и понял, что это на самом деле модели, что это не люди, не разработчики, что это. Возможно, в каком-то степени рандомная инициализация весов в какой-то рандомный момент произошла, и поэтому она тебе так ответила, а никак иначе. Вот, но тут вопрос, наверное, к юристам больше я не отвечу, но я бы хотел в таком мире жить, чтобы для кого-то, ну, что люди, которые, чтобы этика была невозможностью подстелить соломку себе, как. Там, я не знаю, OpenAI подсвятил, чтобы их там не вызвали в Конгресс, да, а чтобы этика отключалась, и при этом OpenAI не имел бы в этот момент уже никакой юридической ответственности за то, что кто-то делает с этой моделью с отключенной этикой. Ну, это хороший инструмент, прикольно.
Дмитрий Колодезев 1:01:51
Ну да, я вижу, я взрослый человек, я готов время от времени брать на себя ответственность и отвечать по, так сказать, обязательствам. Но хотелось бы иметь переключатель. То есть, есть же вот такая штука, как квалифицированные инвесторы. То есть, некоторые финансовые инструменты в разных странах тебе недоступны просто если ты неквалифицированный инвестор, и всё. Потому что тебя, скорее всего, обманут, и всё потеряешь.
Пётр Ермаков 1:02:16
Квалифицированный яичник, понятно.
Дмитрий Колодезев 1:02:19
Ха-ха. Самый главный ньюсмейкер нашей русскоязычного мира запустил новую децентрализованную сеть Cocon. Вот тут прекрасно всё, что владельцы мощных видеокарт будут отдавать их в Cocon, а разработчики и приложения будут использовать их мощности. Заодно на них можно будет тонны майнить и рассчитываться тоннами.
Пётр Ермаков 1:02:46
Сети Cocon, помнишь такую историю? Да, да, да, да. Но в целом, как-то мне в это не верится во всё. Ну, возможно, там Павел. Историю с блокчейном и прочими вещами, но при обучении, при обучении LLM, одна из самых важных вещей — это вопрос с коммуникациями. И когда у тебя где-то видеокарта с непонятным интернетом лежит или набор вот этих вещей. Там же совершенно другие правила работают, когда ты работаешь с... То есть ты должен... Поптимально минимизировать коммуникации и какие-то вещи локально делать, потом их как-то прокидывать редко. Поэтому для обучения больших языковых моделей я в эту историю не очень верю, если не появится какой-то новый форум ворка. А тут я сомневаюсь, по крайней мере, от. Что появится какой-то фривор для задач блокчейна и прочее. Но тут я не силён, возможно, каким-то образом. Да, в целом, очень смешно. Сначала он приезжает в Казахстан и говорит, что мы это будем делать. Казахстанскую силиконовую и ядолину, вот, видимо, количество GPU. Оказалось, там слишком маленьким, и им пришлось таким образом их намайнить. Вот в целом, да, в целом, возможно, ну, ты делаешь инструмент, возможно, для себя в первую очередь. Дурова есть идеи, как вот такую децентрализованную сеть и чипов использовать для решения своих каких-то задач в своем бизнесе, возможно, идея нового бизнеса, то есть. Возможно, он делает не peer-to-peer, да, какую-то историю, а в первую очередь, будет платить сам пользователям за использование их чипов. Вот, а не будет каких-то, ну или количество клиентов будет очень маленькое внешних. Вот, но тут, возможно, какие-то у него есть идеи, о которых мы и не знаем для утилизации тех же GPU.
Дмитрий Колодезев 1:05:04
Слушай, вот эта очевидная вещь, когда ты сказал, что-то она мне в голову не пришла, что вообще-то он зависит от дата-центров полностью, которые согласились его принять. И если эту зависимость чуть-чуть размыть, то будет хорошо. Даже за это стоит заплатить.
Пётр Ермаков 1:05:21
Да, только почему непонятно для ИИ? Да, в целом, Telegram — это не AI-first продукт. Возможно, это просто громкое название, чтобы потом ты мог использовать это для задач Telegram, а не Может быть, может, нас ждёт этот. этоси Силиконовая долина и Как децентрализованный интернет, там же у них был, так что. Ну, на самом деле, дай бог, пусть расцветут сто цветов. Это сто процентов, это было бы весело, да. Да, ну на этом, наверное, всё. Спасибо большое, что нашёл время. Спасибо большое, очень интересный опыт. Ладно, всё, пока. Давай, доброго дня!