CGD - Crypto Government Department logo CGD - Crypto Government Department logo
Forklog 2026-07-25 07:25:50

Anthropic выпустила Claude Opus 5

Anthropic представила Claude Opus 5, возможности которой «приближаются к интеллекту» флагманской Fable 5. Компания сразу открыла доступ к модели на всех платформах.  https://twitter.com/claudeai/status/2080699495453528290 Она стала моделью по умолчанию в подписке Max, а цены остались на уровне Opus 4.8 — $5 за млн входных токенов и $25 за млн выходных. Anthropic утверждает, что Opus 5 приблизилась к уровню Claude Fable 5 при вдвое меньших затратах на токены. В компании также заявили, что модель «стала новым эталоном» в тестах на оценку навыков программирования и интеллектуального труда, таких как Frontier-Bench и GDPval-AA, хотя в задачах кибербезопасности она по-прежнему уступает Mythos 5. Источник: Anthropic. По данным Anthropic, в бенчмарке Frontier-Bench v0.1 Opus 5 более чем вдвое превзошла Opus 4.8 при меньшей стоимости на задачу. В CursorBench 3.2 отставание от пикового результата Fable 5 составило менее 0,5% при вдвое более низкой стоимости. В тесте ARC-AGI 3 Opus 5 показала результат в три раза выше ближайшего конкурента. На платформе Zapier AutomationBench, оценивающей решение бизнес-задач, показатель успешного исполнения оказался примерно в полтора раза выше при равных финансовых затратах. В тесте OSWorld 2.0 (оценка производительности компьютера) модель превзошла лучший результат Fable 5. В Anthropic отдельно отметили прогресс в научных задачах. По данным компании, Opus 5 обошла Opus 4.8 во всех оценках по наукам о жизни. На внутреннем бенчмарке по органической химии результат вырос на 10,2 п.п., а в задачах, связанных с белками, — на 7,7 п.п. По словам Anthropic, Opus 5 стала самой согласованной с правилами компании моделью. В автоматизированном поведенческом аудите показатель общего несогласованного поведения составил 2,3 — это лучший результат среди последних моделей Anthropic. Источник: Anthropic. Для киберзадач Anthropic ослабила ограничения по сравнению с Fable 5. Компания оценила, что вмешательства классификаторов будут срабатывать примерно на 85% реже. При этом запросы, которые системы безопасности пометят в Claude.ai, Claude Code и Claude Cowork, по умолчанию будут перенаправляться на Opus 4.8. Аналогичное переключение можно включить и в API. Отдельно Anthropic указала, что биологические запросы, которые блокируются на Fable 5, теперь будут направляться на Opus 5, а не на Opus 4.8. Вместе с моделью Anthropic запустила в бета-режиме два обновления: возможность менять доступные инструменты по ходу диалога без сброса кеша промпта и автоматические переключения на резервные модели в API. Напомним, Opus 4.8 компания представила в мае, одновременно добавив в Claude Code функцию динамических рабочих процессов.

Διαβάστε την Αποποίηση Ευθυνών : Όλο το περιεχόμενο που παρέχεται εδώ στον ιστότοπό μας, τους υπερσυνδεδεμένους ιστότοπους, τις σχετικές εφαρμογές, τα φόρουμ, τα ιστολόγια, τους λογαριασμούς κοινωνικών μέσων και άλλες πλατφόρμες (“Site”) προορίζεται μόνο για τις γενικές πληροφορίες σας, που προέρχονται από τρίτες πηγές. Δεν κάνουμε καμία εγγύηση οποιουδήποτε είδους σε σχέση με το περιεχόμενό μας, συμπεριλαμβανομένης ενδεικτικά της ακρίβειας και της ενημέρωσης. Κανένα μέρος του περιεχομένου που παρέχουμε δεν αποτελεί οικονομική συμβουλή, νομική συμβουλή ή οποιαδήποτε άλλη μορφή συμβουλών που προορίζεται για τη συγκεκριμένη εμπιστοσύνη σας για οποιονδήποτε σκοπό. Οποιαδήποτε χρήση ή εξάρτηση από το περιεχόμενό μας είναι αποκλειστικά με δική σας ευθύνη και διακριτική ευχέρεια. Πρέπει να πραγματοποιήσετε τη δική σας έρευνα, να ελέγξετε, να αναλύσετε και να επαληθεύσετε το περιεχόμενό μας προτού βασιστείτε σε αυτά. Η διαπραγμάτευση είναι μια εξαιρετικά επικίνδυνη δραστηριότητα που μπορεί να οδηγήσει σε μεγάλες απώλειες, επομένως συμβουλευτείτε τον οικονομικό σας σύμβουλο πριν λάβετε οποιαδήποτε απόφαση. Κανένα περιεχόμενο στον ιστότοπό μας δεν προορίζεται να είναι παράκληση ή προσφορά