#оптимизация ИИ
11 статей

Weka: экономия GPU для ИИ-моделей до 100% кэшированием
Компания Weka представила инновационную платформу для ИИ, снижающую нагрузку на GPU. Она кэширует все предварительно рассчитанные токены, экономя ресурсы.

ZML: Новое ПО ускоряет ИИ и снижает затраты
Французский стартап ZML представил бесплатное ПО ZML/LLMD. Оно ускоряет работу ИИ на множестве чипов, делая его дешевле.

Alibaba AI сокращает потребление токенов на 99% новым фреймворком
Alibaba представила инновационный ИИ-фреймворк, который позволяет агентам пропускать загрузку ненужных инструментов, снижая расход токенов на 99%.

DeepSeek представила DSpark: ускорение LLM до 85%
Китайская компания DeepSeek открыла исходный код DSpark — нового фреймворка, способного ускорить инференс больших языковых моделей (LLM) до 85%.

Новый ИИ-фреймворк опережает Claude Code в 2.5 раза
Разработан новый фреймворк для оптимизации ИИ, который показал эффективность в 2.5 раза выше, чем Claude Code и Codex при том же бюджете.

SkillOpt от Microsoft улучшает ИИ-агентов без переобучения
Microsoft представила SkillOpt, инструмент с открытым исходным кодом. Он автоматически улучшает навыки ИИ-агентов, не меняя веса моделей.

Pinterest сократил затраты на ИИ на 90% благодаря оптимизации
Pinterest добился 90%-го снижения затрат на ИИ, переработав архитектуру модели Qwen3-VL. Это значительно повысило эффективность.

