AI Server 1.26.8.2
Новый функционал
- Добавлен флаг «Включать рассуждение в ответ» (
IncludeReasoning) в NLP-запросах API. Позволяет скрыть рассуждения thinking-модели из ответа, не отключая сам режим рассуждений.
Улучшения
- Ускорено обновление виджета использования ресурсов агентов (CPU/GPU/RAM/VRAM/диск): период обновления сокращён с 10 до 1 секунды.
Исправления
- Исправлена ошибка, из-за которой NLP-запросы к внешнему LLM-движку (LiteLLM) обрабатывались некорректно: возникали лишние ошибки, а рассуждения thinking-моделей не отключались при выключенном флаге.
- Устранена регрессия производительности Ollama на vision-моделях: обработка мелких изображений могла замедляться до 18 раз.
Инструкция по обновлению AI Server
Обновление 1.26.8.1 → 1.26.8.2 — ограничивается вариантом установки через Docker.
Last updated on