#оптимизация ИИ

11 статей

Все новости
Система серверных стоек Weka с технологией кэширования для оптимизации GPU в ИИ-задачах.
NEWS
22 июл. 2026

Weka: экономия GPU для ИИ-моделей до 100% кэшированием

Компания Weka представила инновационную платформу для ИИ, снижающую нагрузку на GPU. Она кэширует все предварительно рассчитанные токены, экономя ресурсы.

Логотип стартапа ZML на фоне микросхем, символизирующий ускорение ИИ на чипах.
NEWS
8 июл. 2026

ZML: Новое ПО ускоряет ИИ и снижает затраты

Французский стартап ZML представил бесплатное ПО ZML/LLMD. Оно ускоряет работу ИИ на множестве чипов, делая его дешевле.

Схематическое изображение работы нового ИИ-фреймворка Alibaba, оптимизирующего расход токенов
NEWS
3 июл. 2026

Alibaba AI сокращает потребление токенов на 99% новым фреймворком

Alibaba представила инновационный ИИ-фреймворк, который позволяет агентам пропускать загрузку ненужных инструментов, снижая расход токенов на 99%.

Логотип DeepSeek и визуализация ускорения больших языковых моделей с помощью DSpark
NEWS
29 июн. 2026

DeepSeek представила DSpark: ускорение LLM до 85%

Китайская компания DeepSeek открыла исходный код DSpark — нового фреймворка, способного ускорить инференс больших языковых моделей (LLM) до 85%.

Схематичное изображение ИИ-фреймворка, демонстрирующее оптимизацию и превосходство над Claude Code и Codex
NEWS
18 июн. 2026

Новый ИИ-фреймворк опережает Claude Code в 2.5 раза

Разработан новый фреймворк для оптимизации ИИ, который показал эффективность в 2.5 раза выше, чем Claude Code и Codex при том же бюджете.

Логотип Microsoft SkillOpt, иллюстрация с ИИ-агентом и схемами оптимизации
NEWS
11 июн. 2026

SkillOpt от Microsoft улучшает ИИ-агентов без переобучения

Microsoft представила SkillOpt, инструмент с открытым исходным кодом. Он автоматически улучшает навыки ИИ-агентов, не меняя веса моделей.

Логотип Pinterest и символы искусственного интеллекта, показывающие снижение затрат
NEWS
29 мая 2026

Pinterest сократил затраты на ИИ на 90% благодаря оптимизации

Pinterest добился 90%-го снижения затрат на ИИ, переработав архитектуру модели Qwen3-VL. Это значительно повысило эффективность.

Визуализация о�птимизации работы LLM-моделей и сокращения расхода токенов на 69,5%.
NEWS
29 мая 2026

LLM-модели: автоматизация снизила потребление токенов на 69,5%

Исследователи автоматизировали разработку стратегий для больших языковых моделей. Это привело к значительному сокращению использования токенов почти на 70%.

Схема работы RecursiveMAS, иллюстрирующая ускорение и экономию токенов в мультиагентных ИИ.
NEWS
16 мая 2026

RecursiveMAS ускоряет мультиагентный ИИ в 2.4 раза и экономит токены

Новая система RecursiveMAS значительно улучшает работу мультиагентных ИИ. Она ускоряет их в 2.4 раза и сокращает расход токенов на 75%.

Искусственный интеллект и нейронные сети: ИИ-агенты и оптимизация вычислительных ресурсов
NEWS
29 апр. 2026

ИИ: Как создать кастомных агентов с меньшими затратами ресурсов

Новый метод позволяет обучать ИИ-агентов для рассуждений, значительно сокращая вычислительные затраты. Исследование упрощает разработку ИИ.

График оптимизации ИИ-бюджета, процессы Train и Test, вычисления LLM
NEWS
17 апр. 2026

Оптимизация ИИ-бюджета: масштабирование Train-to-Test

Как оптимизировать затраты на вычисления для ИИ? Стандартные подходы игнорируют расходы на инференс, что создает проблемы для реальных LLM-приложений.