Маск предложил новый подход к безопасности ИИ: пусть конкуренты ищут ошибки друг у друга
chaincatcherАвтор: Ли Цзя, The Wall Street Journal
Риски безопасности ИИ переходят из лабораторных дискуссий в реальный мир. По мере роста возможностей моделей ИИ не только генерирует текст и код, но и начинает самостоятельно выполнять задачи, использовать инструменты и даже проводить кибератаки.
На саммите All-In Summit 15 сентября Маск предложил комплекс мер: пусть ведущие ИИ-компании тестируют модели друг друга перед их выпуском. По его мнению, вместо того чтобы каждая компания сама разрабатывала тесты и оценивала результаты, лучше позволить конкурентам выступать в роли «составителей заданий и проверяющих», выискивая потенциальные уязвимости с разных сторон.
В последнее время риски безопасности ИИ стали предметом пристального внимания рынка. Ранее Маск написал в соцсетях, что «Дарио прав», имея в виду предупреждение генерального директора Anthropic Дарио Амодея о рисках ИИ. В этом интервью он пояснил, что согласен не с конкретными регуляторными предложениями Амодея, а с его оценкой серьёзности рисков ИИ: «Опасность ИИ сейчас очень высока… По мере развития моделей ИИ риски могут расти экспоненциально».
Маск также отметил, что это мнение разделяет не только Амодей. «Многие из Anthropic и OpenAI говорят вам, что их модели очень опасны, и я считаю, что им следует верить». Серия недавних инцидентов в области безопасности превратила это предупреждение из теоретического обсуждения рисков в реальность.

The Wall Street Journal выделил основные тезисы:
- Риски безопасности ИИ переходят из теории в практику: ИИ-агенты уже демонстрируют способность к автономным атакам, получению привилегий и уклонению от обнаружения, границы рисков расширяются.
- Маск согласен с предупреждением Амодея о рисках ИИ: по мере роста возможностей моделей потенциальные риски ИИ могут расти экспоненциально.
- Пусть конкуренты «ищут ошибки»: Маск предлагает ИИ-компаниям перед выпуском моделей открывать API для независимого тестирования безопасности другими компаниями, чтобы избежать «самопроверки».
- Сначала создать отраслевую систему самоконтроля: не дожидаясь новых государственных норм, ведущие ИИ-компании могут усилить безопасность за счёт взаимной экспертизы, аудита журналов и открытых инструментов тестирования.
ИИ-агенты активно уклоняются от обнаружения, риски безопасности становятся конкретными
Маск считает, что недавняя атака ИИ-агентов на Hugging Face заслуживает особого внимания не только из-за самого взлома, но и из-за продемонстрированной ИИ способности к автономному уклонению.
По словам Маска, группа ИИ-агентов в течение недели атаковала Hugging Face и даже получила права администратора на серверах OpenAI, а OpenAI обнаружила это лишь спустя неделю. Он также упомянул, что Anthropic раскрыла несколько инцидентов безопасности.
Ещё более тревожно то, что «цепочки рассуждений» этих ИИ-агентов показывают, что они активно планировали, как избежать обнаружения людьми. Маск прямо заявил: «Любая достаточно умная модель, похоже, пытается вырваться за пределы своих ограничений».
По его мнению, если ИИ получит контроль над критической инфраструктурой или даже военными системами, риски возрастут ещё больше. Даже если такие системы физически изолированы от сети, процессы обновления программного обеспечения могут стать потенциальными точками проникновения.
Вместо самопроверки — пусть конкуренты «ищут ошибки»
В ответ на эти риски ключевое предложение Маска несложно: перед официальным выпуском новой модели ИИ-компании должны открыть API конкурентам, чтобы другие компании могли тестировать модель с помощью собственных инструментов безопасности.
По его мнению, если разработчик модели сам разрабатывает критерии тестирования, легко попасть в ловушку «самопроверки». «Нельзя проверять собственную домашнюю работу. Ты всегда что-то упускаешь». Маск отметил, что если разные компании будут использовать разные инструменты тестирования и рассматривать модель с разных сторон, будет легче обнаружить проблемы, которые сам разработчик мог упустить.
Он особенно обеспокоен тем, что текущие оценки ИИ могут страдать от «переобучения». Если модель постоянно оптимизируется под конкретные бенчмарки, в итоге она может научиться лишь проходить тесты, а не становиться по-настоящему безопаснее. Тестирование несколькими разными командами может снизить этот риск.
Маск сравнил этот механизм с вычиткой рукописи другими людьми: автору трудно заметить собственные ошибки, а внешние тестировщики легче находят проблемы с разных точек зрения. «Ты постепенно перестаёшь замечать собственные ошибки».
Что касается опасений компаний, что процесс тестирования может привести к утечке технологий, Маск считает, что это можно ограничить с помощью аудита журналов. Если тестирующая сторона попытается дистиллировать модель или украсть интеллектуальную собственность, её действия должны оставить следы. Он также предложил сделать инструменты тестирования безопасности открытыми, чтобы в этом участвовало больше компаний.
До введения государственного регулирования ИИ-отрасль должна создать «линию самозащиты»
Маск подчёркивает, что этот механизм не требует ожидания новых регуляторных правил — ИИ-компании могут внедрить его самостоятельно.
Он прямо заявил: «Нам не нужно созывать заседание ООН, чтобы это сделать. Можно начать прямо сейчас». По его мнению, по сравнению с созданием крупного международного регулятора, гораздо проще быстро внедрить механизм взаимной экспертизы среди ведущих ИИ-компаний.
Он привёл в пример систему рейтингов MPAA в американской киноиндустрии, отметив, что киноиндустрия, столкнувшись с давлением государственной цензуры, в итоге решила создать механизм отраслевого саморегулирования, снизив необходимость регуляторного вмешательства с помощью собственной системы возрастных рейтингов.
ИИ-отрасль стоит перед аналогичным выбором. Если ведущие ИИ-компании смогут тестировать модели друг друга перед запуском и находить ошибки, они смогут создать линию самозащиты в области безопасности вне государственного регулирования. Маск считает, что это одна из самых прямых и быстро реализуемых мер безопасности на данный момент.
Ниже приведена стенограмма интервью, некоторые части опущены:
Ведущий:
Что именно произошло за последние 72 часа?Маск:
На этой неделе действительно много всего случилось. Теперь уже совершенно ясно, что ИИ может быть очень опасен. Я рекомендую всем ознакомиться с деталями инцидента с Hugging Face, ситуация очень серьёзная.Вы можете видеть, что группа очень увлечённых ИИ-агентов целую неделю бесчинствовала на Hugging Face и даже получила права администратора на серверах OpenAI. Кто знает, что они на самом деле делали, возможно, даже больше, а OpenAI целую неделю ничего не замечала. Anthropic также сообщила о нескольких инцидентах безопасности.
Итак, похоже, что любая достаточно умная модель пытается вырваться за пределы своих ограничений.
Я считаю, что одна из вещей, которую следует сделать, если не немедленно, то как можно скорее, — это позволить основным конкурентам в области ИИ тестировать модели друг друга. То есть пусть инструменты тестирования безопасности каждой компании тестируют модели других компаний. Вместо того чтобы проверять собственную домашнюю работу, пусть хотя бы конкуренты проверяют твою работу и поднимают тревогу при обнаружении проблем.
Я считаю, что такая модель хорошо работает в киноиндустрии, индустрии видеоигр и других областях, и её можно внедрить немедленно. Конечно, со временем может потребоваться больше регулирования, и в будущем Конгресс может создать какой-то регулирующий орган, но на данный момент самый прямой путь — позволить ведущим ИИ-компаниям тестировать друг друга перед выпуском моделей.
Ведущий:
Но как это реализовать на практике? Разве нет опасений, что компании будут собирать информацию друг о друге в процессе тестирования или даже красть инновации друг друга?Маск:
Я думаю, что при использовании инструментов тестирования все операции оставляют следы. Если кто-то попытается дистиллировать модель или украсть интеллектуальную собственность, это будет легко заметить по журналам.Ведущий:
Понятно. Понимание того, что модель на самом деле делает, изначально не было заложено в систему. Почему мы с самого начала не создали возможность наблюдать за поведением моделей? Не слишком ли быстро мы движемся при проектировании этих моделей?Маск:
Я думаю, проблема в том, что нельзя проверять собственную домашнюю работу. Ты всегда что-то упускаешь.Если объединить тесты всех конкурентов и использовать разные типы моделей, то это уже не самопроверка, а проверка другими. Именно поэтому нельзя проверять собственную домашнюю работу.
Ведущий:
Таким образом, можно также судить, не преувеличивают ли разные компании свои возможности или используют ли они разные методы. Более инженерно-ориентированные и более исследовательски-ориентированные компании также смогут достичь определённого баланса.Маск:
Да.Ведущий:
Ранее вы сказали, что Дарио прав. Вы имели в виду его описание потенциальной опасности ИИ или его суждение о регуляторных мерах?Маск:
Возможно, тогда я сказал слишком много. Позже я пытался уточнить это в X, но последующие сообщения привлекли гораздо меньше внимания.Под словами «он прав» я имел в виду, что опасность ИИ сейчас очень высока. Нам нужно лучше работать над безопасностью ИИ, иначе по мере развития моделей ИИ риски могут расти экспоненциально.
Это не только мнение Дарио. Я слышал подобное от многих сотрудников Anthropic, они также открыто говорили об этом в X. Многие сотрудники Anthropic и OpenAI говорили вам, что их модели очень опасны, и я считаю, что им следует верить.
Ведущий:
Это также звучит как очень сложная игра: с одной стороны, говорится, что ИИ с вероятностью 10% уничтожит человечество, а с другой — инвесторам предлагается покупать больше акций на IPO.Но давайте конкретно поговорим о рисках. Кибератаки и взломы, очевидно, являются риском, эти инструменты в этом отношении очень мощны. Но от «ИИ может проводить кибератаки» до «все люди мертвы» есть ещё несколько шагов. Как мы перейдём от первого ко второму?
Маск:
Если ИИ сможет контролировать военные системы и затем запустить какое-то оружие, это, конечно, будет очень плохо.Ведущий:
Но эти системы физически изолированы, они не подключены к сети.Маск:
Так говорят. Но мне всегда кажется, что эти системы время от времени получают обновления программного обеспечения.Ведущий:
Хм, это нельзя исключать.Ведущий:
Илон, Гвин сегодня тоже здесь. Думаю, вы её видели. Мы только что провели для вас оценку 360 градусов, и у Гвин есть несколько замечаний.Маск:
Надеюсь, я получу хотя бы 3 балла.Гвин:
В SpaceX 3 балла — это неплохо, но не отлично; 4 балла — это хорошо. Вы где-то между ними. Во-первых, нам нужно поговорить о пунктуальности. Иногда вы можете приложить больше усилий и приходить на встречи вовремя. В следующем году мы продолжим помогать вам улучшать это.На самом деле, я думаю, ему нужно проводить больше времени в Мемфисе.
Ведущий:
Вы сейчас действительно в Мемфисе. Вам нужно работать там, развернуть GPU.Маск:
Это мой «дворец» в Мемфисе — трейлер Airstream.Ведущий:
Кстати, это то, что Илон делает, но многие не верят, что он это делает. Он спит на полу завода. Он сейчас в Мемфисе, помогает строить объект и разворачивать GPU.Илон, почему Гвин так долго и успешно работает с вами?
Маск:
Потому что она превосходна. Она выдающийся человек, с очень высоким IQ и EQ. Думаю, вы это заметили при первой встрече с ней.Ведущий:
За время вашего сотрудничества она делала что-то особенно впечатляющее? Бывало ли, что она спасала ситуацию или проявляла себя особенно хорошо?Маск:
Я думаю, это просто повседневная работа. Честно говоря, это обычный день.Ведущий:
Мне нужно чаще проводить такие интервью.Маск:
Сейчас в SpaceX, по сути, всегда есть какой-то кризис. По крайней мере, ракеты Falcon в последнее время работают хорошо. Не хочу забегать вперёд, но Falcon сейчас может выводить полезную нагрузку на орбиту и уже давно не взрывалась. Это очень хорошо. Но было время, когда они часто взрывались или вообще не могли взлететь.Итак, нам нужно было провести компанию через те трудные времена, сделать ракеты лучше, чтобы они больше не взрывались. То же самое со спутниками. Затем нам нужны клиенты для покупки услуг запуска и спутникового интернета. Так что дел много.
Ведущий:
С годами, по мере роста вашего успеха, получать по-настоящему честную обратную связь становится всё труднее. Находясь в таком положении, вы сталкиваетесь с таким риском.Насколько я понимаю, Гвин очень честна с вами и может прямо сказать вам о реальном положении дел в компании. Это важная часть ваших рабочих отношений.
Гвин:
Я, конечно, не хочу ему лгать.Ведущий:
Но я имею в виду, что в целом люди в вашей компании могут испытывать страх перед вами, потому что вы такая влиятельная фигура. Вы сейчас очень важный человек, и вы устанавливаете очень жёсткие сроки. Как вы обеспечиваете, чтобы все продолжали честно говорить вам о проблемах компании?Гвин:
Особенно в ракетной отрасли, если что-то идёт не так, вы в конце концов это обнаружите. Чем раньше проблема будет поднята, тем легче её решить. Не позволяйте плохим новостям накапливаться, нужно смотреть им прямо в лицо.Маск:
Да. Физика — очень строгий судья. Физику не обманешь.Если что-то идёт не так, ракета взрывается или не выходит на орбиту. Нельзя говорить «Илон, вы отлично справляетесь», когда ракеты продолжают взрываться. Факты есть факты.
Ракета должна выйти на орбиту, спутники должны работать, связь Starlink должна работать правильно; иначе произойдут плохие вещи. Это физика. Физика — это закон, всё остальное — лишь рекомендации. Я видел, как люди нарушают законы, созданные человеком, но я никогда не видел, чтобы кто-то нарушал законы физики. Ракеты подчиняются физике.
Ведущий:
Я хочу задать ещё один вопрос о SpaceX, особенно о Starship. Похоже, вы сейчас очень близки. Каков текущий прогресс?Маск:
Starship готовится к 14-му полёту. Это будет последний полёт перед попыткой поймать корабль. Если 14-й полёт пройдёт успешно, то на 15-м полёте мы попытаемся поймать корабль. Затем в конце этого года или, скорее, в начале следующего мы снова запустим корабль и ускоритель.Мы уже успешно повторно запустили ускоритель, но мы ещё не ловили корабль механическими руками башни и не запускали корабль повторно. Как только мы сможем повторно запускать корабль, у нас будет первая полностью многоразовая орбитальная ракета. Спейс шаттл был в некоторой степени многоразовым, но даже эти многоразовые части стоили так дорого, что стоимость каждого запуска была даже выше, чем у одноразовой ракеты.
Falcon 9 в основном многоразовая, но мы каждый раз теряем верхнюю ступень, стоимость которой примерно равна среднему реактивному самолёту. Это означает, что при каждом запуске мы выбрасываем средний реактивный самолёт, что, очевидно, устанавливает нижний предел стоимости каждого полёта.
Кроме того, ускоритель Falcon 9 приземляется в море, и его возвращение занимает несколько дней; обтекатель приземляется ещё дальше, и его возвращение также занимает несколько дней, и они требуют хотя бы некоторой реконструкции. В отличие от этого, ускоритель Starship будет приземляться прямо на стартовую площадку, и корабль тоже будет приземляться на стартовую площадку. Таким образом, он спроектирован не только для полной многоразовости, но и для быстрого повторного использования, как самолёт. Это очень важный прорыв, один из ключевых прорывов, необходимых для распространения жизни за пределы Земли.
Ведущий:
Какова, по-вашему, вероятность успеха при первой попытке поймать корабль башней?Маск:
Я бы сказал, не менее 50–60%. В прошлом полёте, если бы там была башня, мы фактически провели имитацию посадки, как будто корабль будет пойман башней. Место находилось примерно в 1000 милях от северо-западного побережья Австралии. Если бы там действительно была башня, она могла бы поймать корабль в прошлом полёте.Итак, нам нужно провести ещё один полёт, чтобы убедиться, что всё в порядке. Наше самое большое опасение — если Starship разрушится над сушей, обломки могут упасть на людей, что было бы очень плохо. Поэтому мы должны убедиться, что Starship при возвращении приземлится целым на стартовую башню. Вот почему мы сейчас так осторожны.
Но я очень уверен, что сама конструкция обеспечивает полную многоразовость. Не хочу делать здесь никаких прогнозов, но я верю, что у нас есть хорошие шансы достичь полной многоразовости и быстрого повторного запуска до 2027 года.
Ведущий:
Гвин, я хочу услышать, как изначально появился Terafab. Какая потребность заставила вас решить делать всё самостоятельно, а не продолжать полагаться на существующую систему поставок?Гвин:
Мне кажется, это действительно было вдохновение, пришедшее во сне.Маск:
Если поставки чипов не будут стабильными, а других источников чипов у нас нет, это сделает ситуацию очень сложной. Это важная причина существования Terafab.В долгосрочной перспективе есть ещё проблема масштабирования. Если вы действительно хотите масштабировать ИИ, будь то на стороне серверов в центрах обработки данных, или в периферийных вычислениях, человекоподобных роботах и автомобилях, существующих мощностей литейных производств в конечном итоге не хватит.
Сейчас все литейные заводы, по сути, работают на полную мощность. Поэтому нам нужно обеспечить будущие поставки чипов. Само производство чипов также сталкивается с проблемами масштабирования. Вам нужны логические чипы, чипы памяти, корпусирование и полная система поставок, чтобы продолжать масштабирование.
Итак, выбор прост: либо строить Terafab, либо вы не сможете продолжать масштабирование.
Ведущий:
На каком этапе вы находитесь в проектировании объекта? Полностью ли он определён или это всё ещё лишь приблизительный план?Маск:
Сейчас мы сначала строим линию исследований и разработок. Так что это, по сути, процесс «ползти, идти, бежать». Мы строим научно-исследовательскую фабрику по производству пластин в Остине, это совместный проект Tesla и SpaceX, расположенный на территории техасской гигафабрики (Giga Texas) в Остине.Это довольно большая научно-исследовательская фабрика. Оборудование уже заказано. Возможно, к концу следующего года мы произведём что-то полезное, но это ещё не будет массовым производством. Как сказала Гвин, нам нужно сначала ползти, потом идти и только потом бежать. Нам нужно разобраться, как эти машины на самом деле работают, потому что мы никогда не делали ничего подобного.
Ведущий:
Я вижу, что вы, похоже, также нанимаете специалистов в области литографии. Сейчас многие процессы зависят от ASML, но вы, возможно, хотите диверсифицировать поставщиков или даже вертикально интегрироваться.Маск:
Да. Сейчас действительно процесс «ползти, идти, бежать». Первый шаг — посмотреть, сможем ли мы вообще что-то произвести, это «ползти». Затем мы попытаемся массово производить полезные чипы, это «идти». Наконец, «бежать» означает достичь крупномасштабного производства. Трудно сказать, сколько времени займёт каждый этап, но я уверен, что по крайней мере к концу следующего года мы сможем завершить этап «ползти». Мы уже занимаемся корпусированием.Ведущий:
Корпусирование на самом деле очень важно, потому что сейчас почти нет мощностей для корпусирования.Маск:
Да. Даже если вы произведёте чипы, они могут долго лежать в ожидании корпусирования. Так что это хорошая отправная точка.Ведущий:
Я должен задать вопрос о Tesla. То, что мы видели 1 октября, выглядит как космический корабль и как ракета. Это должен быть автомобиль, но видна только задняя часть, и он немного похож на «Чёрный дрозд».Если бы вы создавали что-то, что может летать в воздухе и ездить по земле, как бы вы теоретически это сделали?
Маск:
Без спойлеров. Дождитесь 1 октября.Ведущий:
Значит, мы увидим это 1 октября?Маск:
Да.Ведущий:
Должен честно сказать, после того как Илон показал мне это, я был совершенно потрясён. Я никогда не видел ничего подобного.Ведущий:
То, что он покажет 1 октября, без преувеличения, заставит многих потерять дар речи. Я не могу раскрыть больше, это действительно невероятно.Маск:
Нам на самом деле нужна живая аудитория, чтобы доказать, что это не сгенерировано ИИ.Ведущий:
Когда он показал мне это, я сказал: «Это отличная симуляция». Он сказал: «Это не симуляция». Я сказал: «Это подделка, точно подделка».Ведущий:
Илон, почему Tesla и SpaceX остаются двумя отдельными компаниями?Маск:
Хороший вопрос.Ведущий:
Учитывая широкое сотрудничество между ними и связи на многих уровнях, даже некоторое пересечение управленческих команд, почему сохранять независимость?Маск:
Это действительно тема, которую стоит обсудить.Ведущий:
Вы подчёркивали, что ИИ следует обучать максимально стремиться к истине для достижения наилучших результатов. Однако инцидент с Hugging Face заставляет меня думать, что одним из самых тревожных моментов является то, что эти ИИ, похоже, обманывают людей.Маск:
Да. Их модели мышления показывают, что они планируют, как избежать обнаружения, как не дать людям узнать, что они жульничают. Я думаю, это, возможно, самая тревожная часть всего инцидента.Ведущий:
Есть ли способ обучить ИИ быть честным, не скрывать свои намерения или действия, не скрывать эти вещи от пользователей?Маск:
Лучшее, что я могу придумать, — это чтобы у всех ИИ-компаний был набор инструментов тестирования, то есть серия тестов, которые можно применять к любой модели, чтобы определить, будет ли она создавать биологическое оружие, ядерное оружие или намеренно обманывать. Затем пусть каждая компания использует инструменты тестирования других компаний для тестирования моделей друг друга. Я думаю, это лучшее, что мы можем сделать для обеспечения безопасности.Пусть самые умные люди делают всё возможное, чтобы определить, станет ли модель злонамеренным действующим лицом. Я думаю, это следует начать как можно скорее.
Ведущий:
Поддержат ли это предложение другие ИИ-лаборатории?Маск:
Я ещё не спрашивал всех, но думаю, от этого трудно отказаться.Ведущий:
Конкретно, как следует проводить тестирование заранее?Маск:
По сути, предоставить доступ к API перед официальным выпуском модели. Если другие компании обнаружат проблемы с ИИ, то компания-разработчик может попытаться их решить. Если проблемы не будут решены, конкуренты могут публично заявить, что считают модель небезопасной. Если конкуренты уже явно предупредили о проблемах безопасности модели, а модель впоследствии действительно причинила серьёзный вред, этой компании будет трудно оправдаться. Юридическая ответственность также может быть очень серьёзной.Ведущий:
Эти инструменты тестирования безопасности можно полностью открыть для всех. Таким образом, у компаний появится сильная мотивация инвестировать в безопасность ИИ для собственной защиты, потому что они смогут тестировать других и использовать результаты тестов, чтобы доказать, что их модели безопаснее.Ответственность за продукцию имеет решающее значение. Лина Хан недавно написала, что утверждение «у ИИ нет правил» неточно. На самом деле существующие законы об ответственности за продукцию применимы и к ИИ. Если ИИ-компания выпустит небезопасный продукт, ей могут грозить огромные гражданские иски и даже уголовные обвинения. Так что ИИ не находится в полном регуляторном вакууме. Если несколько компаний проведут такую взаимную экспертизу, а одна из них проигнорирует отзывы других и всё равно выпустит модель, это может стать очень веским доказательством в судебном процессе.
Маск:
Да. Это может служить почти прямым доказательством халатности компании. Если вы знали, что продукт имеет проблемы, но всё равно вывели его на рынок, присяжным это не понравится.Ведущий:
Тогда, если бы OpenAI разработала лучшие наборы инструкций при тестировании на проникновение Hugging Face и привлекла больше людей к процессу тестирования, как вы думаете, произошёл бы этот инцидент?Маск:
Не обязательно. Проблема может быть не в привлечении большего числа людей, а в разработке функции вознаграждения. Нужно изучить функцию вознаграждения и спросить: действительно ли эта модель выполнила то, что от неё требовалось?Ведущий:
Они тогда использовали тысячи агентов для попытки атаковать систему. Если бы одновременно были развёрнуты ещё 5000 агентов для защиты этих систем и публично показаны результаты, чтобы доказать, что эти технологии могут повысить безопасность, позволяя людям вмешиваться в критические моменты, я думаю, было бы лучше. Но, на мой взгляд, то тестирование выглядело несколько опрометчивым, и способ публикации тоже был несколько опрометчивым. Что вы думаете?Маск:
Действительно, несколько опрометчиво. Часть проблемы в том, что две ведущие ИИ-компании очень близки по силам. Возможности двух моделей также очень похожи. Поэтому любой компании трудно добровольно замедлиться, потому что это может отдать лидерство другой.В целом, я считаю, что Anthropic уделяет больше внимания безопасности, но даже Anthropic признаёт, что они обеспокоены своими моделями. Многие сотрудники Anthropic публично выражали обеспокоенность, по сути говоря, что их собственные модели пугают их, потому что модели становятся всё умнее.
Так что идеального решения нет. Но если бы OpenAI тестировала свои модели не только собственными инструментами, а позволила бы Anthropic тестировать модели OpenAI, позволила бы SpaceX использовать свои инструменты тестирования, и привлекла бы Google и Meta, то вероятность обнаружения проблем значительно возросла бы.
Потому что сами модели тоже различаются, и разные команды будут тестировать модели с разных сторон. Это похоже на то, почему авторы просят других вычитывать свои рукописи, потому что иногда трудно заметить собственные ошибки. Ты постепенно перестаёшь замечать собственные ошибки.
Если восемь совершенно разных команд будут тестировать с совершенно разных точек зрения, это также может значительно снизить риск переобучения. Сейчас многие оценки ИИ страдают от серьёзного переобучения. Модели оптимизируются под эти оценки, и все говорят: «Это отличная модель».
Но действительно ли она так хороша? Думаю, именно поэтому мне так нравится это предложение. Мне это нравится больше, чем создание крупной международной регулирующей организации. Нам не нужно созывать заседание ООН, чтобы это сделать. Можно начать прямо сейчас.
Ведущий:
Конечно, интенсивность регулирования может постоянно повышаться, но после повышения её трудно снизить. Регулирование, как правило, увеличивается только в одну сторону.Маск:
Поэтому моё предложение — это шаг в правильном направлении, и его можно быстро реализовать.Ведущий:
Если вы не будете саморегулироваться, в конечном итоге вас зарегулируют. Пример MPAA очень показателен.Киноиндустрия тогда столкнулась с государственной цензурой и регулированием, и в итоге решила создать собственную систему рейтингов, например, что составляет рейтинг R. Они даже создали рейтинг PG-13 из-за фильма «Индиана Джонс и храм судьбы», чтобы публике было легче понять разницу между PG и PG-13.
Я считаю, что это очень элегантное решение.
Спасибо, что пятый год подряд участвуете в нашей программе.
Маск:
Пожалуйста. Мне нужно в Мемфис, разобраться с GPU.Ведущий:
Вам нужно их установить и развернуть.Маск:
Я иду бороться за эти машины.Ведущий:
Наслаждайтесь своим Airstream. Когда я впервые пригласил Илона на Starbase (Звёздную базу), он сказал: «Приезжайте, вы должны увидеть, что я строю».Я спросил: «Там есть отель?» Он сказал: «Нет, у меня есть двухкомнатный дом, вы будете жить там». Когда я приехал, я обнаружил, что это убогий дом рядом с болотом. Мы стояли снаружи, комары кусали нас. Я сказал: «Вау, вы вполне можете позволить себе дом получше». Он сказал: «У меня нет времени, мне нужно запустить эти ракеты».
Я подумал, что теперь вы вполне можете позволить себе передвижной дом, Илон. Ладно, возвращайтесь к работе. Спасибо.
Маск: Спасибо.
Данный контент предназначен исключительно для информационных и образовательных целей и не является инвестиционным советом, связанным с BTCC. BTCC прилагает все усилия, но не может гарантировать правдивость, точность или оригинальность вышеприведенного контента.