GLM 5.2 и Kimi K2.6 — развернули на своих GPU и ждём ваши API-вызовы
Привет, Хабр! Мы обновили каталог MWS GPT Model Hub. Добавили новые LLM, реранкеры, а также модели распознавания и генерации речи.
Все модели хостим в MWS Cloud, инференс делаем на собственных GPU.Что у нас нового:GLM 5.2Kimi K2.6Qwen 3.6 35B A3BGemma 4 31B ITGPT OSS 120BНовые модели расширяют выбор для генерации и анализа текста, работы с кодом, документами, ИИ-ассистентами и многошаговыми запросами.bge-reranker-v2-gemmabge-reranker-v2-m3Реранкеры используются после первичного поиска: они повторно оценивают найденные фрагменты и помогают передать LLM наиболее релевантный контекст.Теперь RAG-пайплайн можно построить с использованием разных типов моделей из одного интерфейса MWS GPT Model Hub.Это позволяет повышать точность поиска и качество ответов в системах, которые работают с внутренними базами знаний, документацией или другими наборами данных.Для распознавания речи добавили:whisper-large-v3qwen3-asr-1.7bgigaam-v3 (хороша для русского языка)Их можно использовать для расшифровки встреч и звонков, обработки голосовых обращений, подготовки субтитров и последующего анализа аудио с помощью LLM.Для генерации речи появилась модель:qwen3-tts-12hz-1.7b-custom-voiceОна позволяет тестировать голосовых ассистентов, озвучивание ответов и другие сценарии преобразования текста в речь.Все модели доступны через OpenAI-совместимый API.
habr.com