Opus 5.5 просто невероятно хорош, а GPT-6-Sol тоже запущен

2026-09-23 14:2516 минут

Видео представляет собой быстрый обзор первых впечатлений от двух крупных запусков ИИ-моделей, состоявшихся в один и тот же день: Claude Opus 5.5 от Anthropic и GPT-6 Soul/Luna от OpenAI. Спикер утверждает, что Opus 5.5 — это наиболее заметный релиз, описывая его как более быстрый, более дешевый и более умный, чем предыдущий флагман Anthropic, с сильным приростом в бенчмарках и впечатляющими реальными демонстрациями в кодинге, автоматизации, графике, играх и анимации. Новые модели OpenAI подаются как полезные, но менее драматичные улучшения, главным образом примечательные более низкими ценами и более широкой доступностью. В целом видео подчеркивает, насколько быстро развиваются возможности ИИ, особенно в творческих и агентных задачах, и при этом намекает на более полный еженедельный обзор, который еще впереди.

Ключевая информация

  • Докладчик рассматривает крупные анонсы моделей ИИ, сделанные в тот же день, находясь на мероприятии Meta Connect в Пало-Альто.
  • Anthropic выпустила Claude Opus 5.5, которую описывают как более совершенную, чем предыдущие модели Claude, более быструю и более дешевую.
  • Claude Opus 5.5, как сообщается, сопоставим с многими бенчмарками или превосходит их, включая программирование агентов, кодирование и метрики общей интеллектуальности.
  • Оратор подчеркивает, что Opus 5.5 теперь широко доступен и что его стоимость за задачу ниже, несмотря на использование большего количества токенов.
  • Видео демонстрирует впечатляющие демо, созданные с помощью Opus 5.5, включая анимации, эмулятор Game Boy, игры и работы, созданные на основе Blender.
  • OpenAI также выпустила GPT-6 Soul и GPT-6 Luna, но они представлены как менее впечатляющие, чем Opus 5.5.
  • GPT-6 Soul и Luna, как утверждается, дешевле и быстрее предыдущих версий, но не так сильны, как новая модель Anthropic.
  • Докладчик сравнивает рейтинги бенчмарков, отмечая, что Opus 5.5 лидирует в некоторых сводных анализах, тогда как GPT-6 Soul занимает более низкие позиции.
  • Ключевая тема заключается в том, что реальные результаты, демонстрации и стоимость выполнения одной задачи важнее, чем сырые показатели бенчмарков.
  • Спикер приходит к выводу, что Opus 5.5 — главная новость дня, а позже на этой неделе ожидается ещё больше анонсов и демонстраций ИИ.

Анализ временной шкалы

Ключевые слова содержания

Клод Opus 5.5

Anthropic выпустила Claude Opus 5.5, представив её как свою новую флагманскую модель. Спикер говорит, что она лучше, чем Claude 5.1, дешевле, чем Opus 5, и быстрее, а также показывает высокие результаты в агентском программировании, кодинге, использовании компьютера, распознавании изображений и бенчмарках на интеллект. Она также доступна в Claude для платных пользователей.

GPT-6 Soul и GPT-6 Luna

OpenAI выпустила GPT-6 Soul и GPT-6 Luna вскоре после объявления Anthropic. Эти модели дешевле и быстрее предыдущих версий, но, по мнению говорящего, они менее впечатляющи, чем Claude Opus 5.5, и всё ещё уступают самой сильной модели Anthropic по общей производительности.

Бенчмарки моделей ИИ и эффективность затрат

Видео сравнивает результаты бенчмарков и цены у разных моделей, включая Artificial Analysis, BusyBench, Terminal Bench и другие тесты. Claude Opus 5.5 лидирует по показателям интеллекта, тогда как GPT-6 Soul показывает улучшенное соотношение цены и производительности, но более слабые общие результаты. Основная идея заключается в том, что новые модели становятся значительно более экономичными.

Анимации и игры, созданные с помощью ИИ.

Спикер отмечает впечатляющие демонстрации, созданные с помощью Claude Opus 5.5, включая анимации на JavaScript, эмулятор Game Boy, игру «Змейка», авиасимулятор и проект в стиле Dark Souls. Эти примеры используются, чтобы показать, насколько далеко продвинулись графика, игры и анимация, созданные ИИ.

Meta Connect и еженедельный обзор новостей об ИИ

Спикер ведёт репортаж из Пало-Альто во время Meta Connect и упоминает, что от Meta и мероприятия Made on YouTube от YouTube могут последовать новые анонсы. Он говорит, что в своём пятничном обзорном видео расскажет об Opus 5.5, GPT-6 Soul, Jev и других новостях об ИИ.

Связанные вопросы и ответы

Какие новые модели ИИ были объявлены в видео?

Видео обсуждает два крупных релиза: Claude Opus 5.5 от Anthropic и GPT-6 Soul и GPT-6 Luna от OpenAI.

Похоже, вы задали вопрос, а не прислали сам текст статьи для перевода. Если хотите перевод, пришлите статью — я переведу её на русский предложение за предложением, без пропусков.Если же вы хотели ответить на вопрос **“Which model does the speaker consider the biggest news of the day?”**, мне нужен исходный текст или контекст, чтобы определить, о какой модели идет речь.

Докладчик говорит, что Claude Opus 5.5 — это главная новость и самый впечатляющий релиз.

Как Claude Opus 5.5 сравнивается с предыдущими моделями Anthropic?

Его описывают как более совершенную модель, чем Claude 5.1, более дешевую, чем Opus 5, а также более быструю.

В статье утверждается, что Claude Opus 5.5 — самая умная модель Anthropic на сегодняшний день, с «лучшим в своём классе» уровнем производительности в программировании, особенно по сравнению с GPT-5.1 и Gemini 3 Pro. Также говорится, что она лидирует в задачах на агента, компьютерное использование и продвинутое рассуждение, а на бенчмарках по кодированию показывает около 80% на SWE-bench Verified и 43,2% на Terminal-bench 2.0, превосходя Opus 4.1.

Anthropic утверждает, что он работает на уровне Claude 5.1 в большинстве задач, при этом стоит дешевле.

Насколько дешевле Claude Opus 5.5 по сравнению с Opus 5?

Докладчик говорит, что это стоит на 40% меньше, чем Opus 5.

Какие изменения в ценах для Claude Opus 5.5?

Входные токены, как сообщается, стоят 4 доллара за миллион, а первоначальные токены — 20 долларов, по сравнению с прежними 5 и 25 долларами.

Почему, по словам выступающего, общая стоимость задачи для Opus 5.5 всё ещё не стала существенно ниже?

Потому что, хотя цены на токены снизились, Opus 5.5 использует значительно больше токенов на задачу.

What benchmark does the speaker reference for evaluating AI models? Какой эталонный тест упоминает спикер для оценки моделей ИИ?

Докладчик упоминает такие бенчмарки, как Agent Programming, Terminal Bench, Automation Bench, экзамен по гуманитарным наукам, Artificial Analysis и другие.

Claude Opus 5.5 получает **73%** на Artificial Analysis.

Спикер говорит, что Claude Opus 5.5 лидирует с результатом 58.

Как Claude Opus 5.5 сравнивается с Fable 5.1 и GPT-6 Astra в Artificial Analysis?

Спикер говорит, что Fable 5.1 и GPT-6 Astra ранее были на одном уровне с 53, тогда как Opus 5.5 теперь лидирует с 58.

Какова точка зрения говорящего на важность бенчмарков?

Оратор говорит, что бенчмарки имеют меньшее значение, чем реальное наблюдение, тестирование и использование моделей в повседневной жизни.

Какие виды демонстраций выделяются для Claude Opus 5.5?

Видео демонстрирует анимации, сгенерированные ИИ, эмулятор Game Boy, игру, вдохновлённую Антикитерским механизмом, авиасимулятор, демоверсию в стиле Mario Maker и другие творческие разработки.

Спикер впечатлён тем, насколько анимационные демонстрации выглядят плавными и реалистичными.

Спикер говорит, что анимации выглядят потрясающе и в это трудно поверить, что они были созданы без таких инструментов, как After Effects.

The speaker first mentions a **VR demo**.

Тест Game Boy или демонстрация эмулятора, созданная с помощью Claude Opus 5.5.

Какая другая модель OpenAI была выпущена в тот же день?

OpenAI выпустила GPT-6 Soul и GPT-6 Luna через несколько часов после объявления об Opus 5.5.

Как GPT-6 Soul сравнивается с Claude Opus 5.5?

Спикер говорит, что GPT-6 Soul дешевле и быстрее, но не так впечатляющ, как Claude Opus 5.5.

Похоже, в вашем сообщении не сам текст статьи, а вопрос: «Как GPT-6 Soul сравнивается с предыдущей моделью OpenAI?»Если вы хотите, я могу:1. перевести статью на русский, если вы пришлёте её текст;2. помочь сравнить GPT-6 Soul с предыдущими моделями OpenAI, если уточните, о какой именно модели речь и откуда информация.

Говорят, что он немного лучше моделей Soul предыдущего поколения, но это незначительный шаг вперёд.

Как GPT-6 Luna сравнивается с GPT-6 Soul?

GPT-6 Luna описывается как модель более низкого уровня, более дешёвая, чем Soul, и доступная большему числу пользователей.

Я не вижу в доступных мне данных подтверждённой информации о модели **“GPT-6 Soul”** и её ценах. Возможно, это:- неофициальное или внутреннее название,- ошибка в названии,- либо продукт, о котором у меня нет актуальных сведений.Если вы хотите, я могу:1. проверить, о каком именно продукте речь, если вы пришлёте ссылку или источник;2. помочь сравнить цены на известные модели OpenAI;3. перевести ваш вопрос на русский или другой язык.Если нужен короткий ответ по-русски: **У меня нет подтверждённых данных о изменениях цен для GPT-6 Soul.**

Видео говорит, что стоимость входных токенов была снижена с $4 до $2 за миллион, а стоимость выходных токенов — с $20 до $10 за миллион.

What are the pricing changes for GPT-6 Luna? → **Какие изменения в ценах для GPT-6 Luna?**

Спикер говорит, что его цена входа была снижена вдвое с 20 центов до 10 центов, а цена выхода — с 1,20 доллара до 0,50 доллара.

I’m missing the article or dialogue context needed to answer that. Please provide the text, and I’ll identify which model the speaker thinks is best overall.

Спикер лично считает Claude Opus 5.5 самой впечатляющей моделью, хотя судья-LLM в таблице лидеров поставил GPT-6 Soul на первое место.

Позиция спикера по поводу рейтингов в таблице лидеров не указана, потому что в сообщении нет самого текста статьи или выступления. Если вы пришлёте отрывок, я смогу ответить точно.

Спикер говорит, что к рейтингу таблицы лидеров следует относиться с недоверием и полагаться на собственные глаза.

Где доступен Claude Opus 5.5?

Спикер говорит, что это доступно почти везде, и что теперь это можно использовать в Claude.

Кто может использовать GPT-6 Soul и GPT-6 Luna?

Они доступны для платных пользователей ChatGPT Work и Codex, а также для пользователей Pro, Business, Enterprise и EDU; бесплатные пользователи и пользователи Go могут использовать GPT-6 Luna в настольном приложении.

Спикер говорит, что ранний доступ к GPT-6 Soul и Luna будет предоставлен избранным пользователям, чтобы они могли протестировать новые возможности до общего запуска.

Спикер говорит, что, похоже, их пока не распространяли широко для раннего доступа, поскольку доступно мало демонстраций.

Что говорит оратор в заключение о запуске двух моделей?

Спикер приходит к выводу, что у Anthropic был более сильный релиз, потому что Opus 5.5 быстрее, дешевле и лучше предыдущей модели, тогда как релиз OpenAI был более скромным.

Больше рекомендаций видео

Поделиться на: