Новости ИИ, 8 октября: Anthropic выпустила Claude Haiku 5.5 для быстрых задач

В выпуске: Anthropic выпустила Claude Haiku 5.5 для быстрых задач; Mistral выпустила открытую модель Large 4 для разработчиков; Hugging Face выпустила мультимодальные модели решений для edge.

Anthropic выпустила Claude Haiku 5.5 для быстрых задач

Anthropic представила Claude Haiku 5.5 — модель для частых и чувствительных к стоимости запросов: суммаризации, классификации, работы с базами данных и обработки контекста. Компания сообщает, что в среднем запуск обходится примерно на 75% дешевле, чем у Haiku 4.5; цена зависит от объёма запроса. Модель доступна на Claude Platform и облачных платформах Amazon Web Services, Google Cloud и Microsoft Azure. Впервые в линейке Haiku добавлена настройка уровня усилий, позволяющая выбирать баланс между стоимостью и интеллектуальными возможностями.

Anthropic также снизила цену чтения кэша Claude Sonnet 5.5 вдвое — до $0.10 за миллион токенов, что, по оценке компании, уменьшает стоимость большинства агентных задач примерно на 20%. Подписчики Claude Max и Team получат ежемесячные API-кредиты для работы с моделями на Claude Platform. В SDK Claude для Python и TypeScript добавят бета-поддержку управления компьютером и браузером.

Что это значит для разработчиков. Haiku 5.5 подходит для узких и повторяющихся задач, а настройка усилий позволяет разработчикам выбирать между стоимостью и качеством. Для сложной агентной разработки Anthropic рекомендует рассматривать Sonnet 5.5 и Opus 5.5.

Источник: Anthropic News · Попробовать в GateLLM: Claude Sonnet 5.5, Claude Haiku 5.5

Mistral выпустила открытую модель Large 4 для разработчиков

Французская компания Mistral представила Mistral Large 4 — модель с 1 трлн параметров, получившую прозвище Le Chonk. По заявлению компании, она способна конкурировать с ведущими моделями из США и Китая. Модель доступна бесплатно, её можно использовать и настраивать под свои задачи. Сейчас Large 4 находится в предварительной версии, окончательный релиз ожидается позднее.

Модель рассчитана на широкий круг задач, но отдельно оптимизирована для программирования и киберзащиты. Среди других целевых областей Mistral называет производство, финансы и электротехнику, а также другие специализированные направления. Сооснователь и главный научный сотрудник компании Гийом Лампль объяснил такой подход возможностью улучшать модели для отдельных предметных областей.

Что это значит для разработчиков. Разработчики могут бесплатно получить доступ к модели и адаптировать её; среди заявленных направлений — программирование, киберзащита и ряд отраслевых задач.

Источник: Ars Technica · Попробовать в GateLLM: Mistral Large 4

Hugging Face выпустила мультимодальные модели решений для edge

Hugging Face представила открытые модели решений d1-3B и d1-omni-600M, созданные на базе Liquid Foundation Models. В отличие от генеративных моделей, они не создают последовательность токенов, а выдают ответ за один проход. d1-3B принимает текст и изображения и набрала 48,57 балла в Decision Index 0.2.1 — выше всех моделей на 4B и 9B, а также Decider 35B-A3B с результатом 47,11. На семи открытых наборах данных средний результат d1-3B составил 82,9, а d1-omni-600M — 78,4; последняя модель принимает текст и изображения либо текст и аудио.

Вместе с NVIDIA разработчики проверили d1-3B на видеокартах и устройствах Jetson. На Jetson AGX Thor модель отвечает за 16 мс, на Jetson AGX Orin — за 26 мс, на Jetson Orin Nano — за 50 мс; на GPU ответ занимает менее 10 мс. d1-omni-600M пока находится на раннем этапе исследований, поэтому показатели скорости для неё не приводятся.

Что это значит для разработчиков. Модели можно рассматривать для приложений, которым нужны быстрые структурированные ответы по тексту и изображениям на edge-устройствах. Для сценариев с аудио подходит d1-omni-600M, но её скорость пока не оценена.

Источник: Hugging Face

Новое в каталоге GateLLM