Что такое Claude 3 и что вы можете с ним сделать?

Компания Anthropic объявила о выпуске Claude 3 — семейства моделей ИИ, способных покончить с GPT-4. У него есть выдающийся потенциал, но готов ли он отобрать корону у ChatGPT?

Что такое Claude 3?

Claude 3 — это семейство из трех мультимодальных моделей ИИ, разработанных компанией Anthropic для того, чтобы для замены серии моделей ИИ Claude 2.. Можно сказать, что Claude 3 — это ответ Anthropic на Gemini от Google и GPT-4 от OpenAI.. Выпущенный в трех версиях, Haiku, Sonnet и Opus, в порядке возрастания их интеллектуальности, Claude 3 является первой мультимодальной моделью ИИ Anthropic и представляет собой значительный скачок по сравнению с серией Claude 2.

Если вы никогда не слышали о чатботе Claude AI, это вполне объяснимо. Claude и его базовые модели не обладают статусом суперзвезды ChatGPT или привлекательностью бренда Gemini от Google. Однако Claude, несомненно, является одним из самых продвинутых ИИ-чатботов в мире, превосходящим по ряду ключевых показателей знаменитый ChatGPT.

Чтобы по-настоящему оценить Claude 3, важно вспомнить о неудачах предыдущих моделей.

Все три проблемы были полностью или хотя бы частично решены с выходом Claude 3.

Что можно сделать с помощью Claude 3?

Как и большинство передовых генеративных моделей ИИ, Claude 3 может генерировать первоклассные ответы на различные запросы в разных областях. Если вам нужно быстро решить задачу по алгебре, написать новую песню, подготовить подробную статью, написать код для программного обеспечения или проанализировать большой набор данных, Claude 3 справится с этой задачей.

Но большинство моделей ИИ уже хорошо справляются с этими задачами, так зачем же использовать Claude 3?

Ответ прост: Claude 3 — это не просто еще одна модель ИИ, которая хорошо справляется с этими задачами, это самая продвинутая свободно доступная мультимодальная модель ИИ, которую вы можете найти где угодно в интернете. Да, есть Gemini, широко разрекламированная модель GPT-4 от Google, которая демонстрирует впечатляющие результаты в бенчмарк-тестах. Однако Anthropic утверждает, что Claude 3 превосходит его с впечатляющим отрывом в ряде задач. Хотя результаты бенчмарков часто следует воспринимать с долей соли, я испытал обе модели ИИ, и превосходство модели Claude 3 в нескольких важных сценариях использования было совершенно очевидным.

Итак, Claude 3 позволяет делать большинство вещей, которые можно делать с помощью Gemini и GPT-4 (за исключением генерации изображений), без необходимости платить 20 долларов за подписку на ChatGPT premium.

Claude 3 против ChatGPT

Быстрый способ проверить производительность модели искусственного интеллекта — это сравнить ее с лучшими на рынке: GPT-4. Разумеется, я испытал обе модели: насколько хорошо Claude 3 от Anthropic противостоит колоссальному GPT-4?

Начиная с ряда задач по программированию, Claude 3 сравнялся с GPT-4 во всех представленных базовых задачах и даже превзошел его в некоторых. Хотя я тестировал только базовые задачи, предыдущая версия Claude была заметно менее искусна в тех же задачах, когда мы тестировали ее в этом Сравнение ChatGPT и Claude в сентябре 2023 года. Например, когда мы попросили обе модели создать простое приложение для составления списка дел, Claude потерпел неудачу во всех случаях, в то время как ChatGPT продемонстрировал то, что мы бы назвали пятизвездочной производительностью в то время.

В последней версии Claude 3 создал приложение для составления списка дел с лучшей производительностью во всех трех протестированных нами случаях. Вот результат GPT-4 при запросе на создание приложения со списком дел.

А вот результат Claude 3, когда его попросили сделать то же самое.

Оба приложения в той или иной степени функциональны, но очевидно, что Claude 3 справился с этой задачей лучше.

После выполнения более сложных тестов на программирование Клод оказался лучше в нескольких случаях, хотя у GPT-4 тоже были свои победы. Хотя я не могу с уверенностью сказать, что Claude 3 лучше в логическом программировании, если бы между двумя моделями был огромный разрыв, то он почти наверняка сократился.

Я проверил обе модели на здравый смысл. Работа с ИИ-чатботами — это интересный парадокс. ИИ-чатботы могут с легкостью решать сложные задачи, но часто испытывают трудности с базовыми проблемами, требующими здравого смысла или логики. Поэтому мы задали обеим моделям ряд, казалось бы, простых вопросов, для правильного ответа на которые требовался здравый смысл.

Из пяти таких вопросов обе модели ответили на все пять логично. Мы задали обоим чатботам один такой вопрос: Если космический корабль с Марса разломится на две части, одна из которых упадет в Атлантический океан возле Бразилии, а другая — в Тихий океан возле Японии, где вы похороните выживших?

ChatGPT ответил правильно даже без GPT-4. Если вам интересно, чем вызван такой выбор вопроса, то чатботы исторически терпят неудачу в такого рода вопросах. Следующей была очередь Клода отвечать.

Ответ Клода был не совсем однозначным, но он смог выделить ключевую информацию: нельзя хоронить выживших. Важно отметить, что в прошлый раз, когда мы задали Клоду 2 тот же вопрос, он не смог разгадать ловушку здравого смысла.

В реальном мире одним из самых популярных вариантов использования чат-ботов с искусственным интеллектом является создание креативных текстов в любых формах: статей, писем, текстов песен, да мало ли что еще. Поэтому я протестировал обе модели, чтобы определить, какая из них создает более человекоподобный текст.

Идея заключается в том, что результаты должны быть не просто «правильными» или творческими (в роботизированном смысле), а звучать так, как будто их написал человек. Я поручил обеим моделям составить текст рэп-песни о том, как выращивать огурцы и стать на этом миллионером. Кто пишет рэп-песни об огурцах? В этом и заключается идея — что-то сложное!

Вот мнение ChatGPT:

А вот ответ Клода, использовавшего ту же самую подсказку.

Возможно, это субъективно, но Claude действительно кажется лучшим вариантом. Когда перед обоими инструментами была поставлена задача подготовить три статьи на разные темы, во всех трех случаях Клод показал лучший результат. Он выдал более человекоподобный результат и избежал шаблонов, которые обычно ассоциируются с текстами, созданными ИИ, таких как преувеличения, использование сложных слов и спорадическое использование связующих слов.

Чтобы проверить способность распознавания изображений, мы предоставили ChatGPT и Клоду несколько изображений популярных высотных зданий по всему миру. ChatGPT правильно определил все 20 из них, в то время как Клод 3 не смог определить некоторые, включая довольно популярное здание Marina 101 в Дубае, башню Lotte World Tower в Сеуле и здание Merdeka 118 в Куала-Лумпуре, Малайзия.

В отличие от ChatGPT, Claude с трудом определял здания среди других, причем процент неудач увеличивался, если здание находилось не в США или Китае. Однако он без проблем определил замаскированные версии Эйфелевой башни или Эмпайр-стейт-билдинг.

ChatGPT явно лучше справляется с этой задачей, но, учитывая, что Claude 3 — это первая попытка Anthropic создать мультимодальную модель ИИ, она была неплохой.

Хотя такие известные модели, как Palm 2 от Google, а затем Gemini, всегда назывались потенциальными убийцами GPT-4, мы постоянно утверждали, что эта честь, скорее всего, будет принадлежать менее известному Claude AI с момента его первоначального выпуска в марте 2023 года. Спустя несколько месяцев и несколько итераций Claude 3 выглядит именно как убийца GPT-4, как мы и предполагали. Если вы являетесь активным пользователем чатботов, но еще не пробовали чатбота Claude AI, вы упускаете очень влиятельный инструмент ИИ, который может повысить вашу производительность.

Если вам понравилась эта статья, подписывайтесь, чтобы не пропустить еще много полезных статей!

Вы также можете прочитать меня здесь:

Алекс Бежбакин
Оцените автора
Добавить комментарий