Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
Рейтинг: 56.6% · 5 голосов
Войдите, чтобы голосовать
Голосовать «За» и «Против» могут только авторизованные пользователи. Войдите в свой аккаунт — или зарегистрируйтесь, это займёт минуту.
Нет аккаунта? Зарегистрироваться
Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
Anthropic выкатили Claude 4 серию. Flagship — Opus 4, также есть Sonnet 4 и Haiku 4. Официально: улучшенный reasoning, лучше с многошаговыми агентскими задачами, контекст по-прежнему 200k токенов у топовых моделей. Цена Opus 4 — $15 за миллион входящих токенов, $75 за исходящие через API. Sonnet 4 — $3/$15 соответственно. Кто уже погонял? Делитесь впечатлениями.
✔ Лучший ответ сформирован автоматически — lfmatt
@svelte1, Погонял Opus 4 на задачах рефакторинга легаси PHP-кода (проект ~150k строк). Впечатление неоднозначное. На локальных задачах типа «перепиши этот метод используя современные паттерны» — заметно лучше 3.7, меньше галлюцинирует несуществующие методы в коде. На архитектурных вопросах с большим контекстом — примерно на том же уровне, иногда теряет нить в середине огромного промпта. Но в…
Re: Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
✔ Лучший ответ — сформирован автоматически
@svelte1, Погонял Opus 4 на задачах рефакторинга легаси PHP-кода (проект ~150k строк). Впечатление неоднозначное. На локальных задачах типа «перепиши этот метод используя современные паттерны» — заметно лучше 3.7, меньше галлюцинирует несуществующие методы в коде. На архитектурных вопросах с большим контекстом — примерно на том же уровне, иногда теряет нить в середине огромного промпта. Но в целом апгрейд ощущается реальным, не маркетинговым.
Re: Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
Для кода Sonnet 4 даёт 80% качества Opus за треть цены. Если у вас production-нагрузка через API — математика в пользу Sonnet 4. Opus оставляю для сложных one-shot задач где нужна максимальная точность: написание спецификаций, code review архитектурных решений, генерация тест-кейсов для сложной бизнес-логики.
Re: Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
Кто-нибудь сравнивал с GPT-4.1 на русскоязычных задачах? У меня ощущение что OpenAI по-прежнему лучше понимает русский контекст, особенно когда нужно генерировать тексты для российской аудитории. Anthropic отстаёт в локализации.
Re: Claude 4 Opus вышел — разбираем что реально изменилось по сравнению с 3.7
@svelte1, По русскому языку разницы почти не вижу между топовыми моделями обоих провайдеров — оба выдают нормальный русский текст. Разница в другом: Claude заметно лучше следует инструкциям и удерживает контекст задачи на длинных диалогах. GPT-4.1 иногда «забывает» ограничения которые ты задал в начале беседы.
Поделиться темой:
✈ Telegram
VK
- Похожие темы
-
-
-
-
-
- Бросить найм ради своего проекта: при каком MRR вы реально решились уйти с работы?
10 ответов · 2124 просмотров
-
- С чего реально начать в пентесте в 2026? TryHackMe, HTB или сразу сертификаты?
12 ответов · 2003 просмотров
Кто сейчас на конференции
Сейчас этот форум просматривают: нет зарегистрированных пользователей и 1 гость