📊 Arena довольно корректно Pareto-диаграммой показывает факт, что сформировались фактически 2 лиги по цене/качеству. Первая около 1680 баллов Эло — это фронтиры или «модели-думатели». Из них самый дешёвый Qwen 3.8 Max. Конечно, зависит от области применения, но если брать научные исследования, то эта модель уехала в какой-то космос от остальных.
Второй эшелон — это worker-модели или «модели-делатели» с рейтингом около 1590 баллов Эло. Несмотря на повышение цен, DeepSeek V4 Flash тут господствует дешевизной, при этом выдерживает планку качества для своей ниши.
💬 Обсудить в Telegram: https://t.me/turboproject/5025
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Alibaba представила свою самую мощную ИИ-модель Qwen3.8-Max | 0 | 29.91 | 04-08-2026 |
| 2 | Alibaba Cloud анонсировала ИИ-модель Qwen3-Max с 1 трлн параметров | 0 | 0 | 24-09-2025 |
| 3 | Сравниваем LLM, 12 тестов для среднего класса: три Sonnet против GigaChat 2 MAX и YandexGPT Pro 5.1 | 0 | 8 | 15-07-2026 |
| 4 | AI‑тренер по CS2 на DeepSeek: где LLM выдумывает и почему семь недель стоили $1,45 | 1 | 10.84 | 24-07-2026 |
| 5 | Новая китайская ИИ-модель GLM-5.2 набирает популярность, догоняя Claude и ChatGPT | 0 | 7 | 03-07-2026 |
| 6 | Простой запрос — и готова газетная полоса, медицинская схема или целый комикс. Alibaba представляет модель Qwen-Image-3.0 | 0 | 13.06 | 24-07-2026 |
| 7 | Сколько на самом деле стоит решённая задача: считаем экономику self-hosted моделей vs API токены | 0 | 12.75 | 29-07-2026 |
| 8 | Как заставить LLM сортировать данные: от наивного подхода до TrueSkill | 0 | 9.74 | 23-01-2026 |
| 9 | Новый ИИ Qwen от Alibaba заявляет о сопоставимых с Claude автономных навыках работы | 0 | 7.09 | 03-08-2026 |