Skip to Content

AI Server 1.26.8.2

Новый функционал

  • Добавлен флаг «Включать рассуждение в ответ» (IncludeReasoning) в NLP-запросах API. Позволяет скрыть рассуждения thinking-модели из ответа, не отключая сам режим рассуждений.

Улучшения

  • Ускорено обновление виджета использования ресурсов агентов (CPU/GPU/RAM/VRAM/диск): период обновления сокращён с 10 до 1 секунды.

Исправления

  • Исправлена ошибка, из-за которой NLP-запросы к внешнему LLM-движку (LiteLLM) обрабатывались некорректно: возникали лишние ошибки, а рассуждения thinking-моделей не отключались при выключенном флаге.
  • Устранена регрессия производительности Ollama на vision-моделях: обработка мелких изображений могла замедляться до 18 раз.

Инструкция по обновлению AI Server

Обновление 1.26.8.1 → 1.26.8.2 — ограничивается вариантом установки через Docker.

Last updated on