Сальваторе Санфилиппо, известный как antirez, опубликовал на GitHub свой новый проект под названием voxtral.c. Это реализация модели Voxtral Realtime 4B от компании Mistral, выполненная на языке C. Модель, обладая 4 миллиардами параметров, преобразует речь в текст и может работать как с микрофоном, так и с аудиофайлами. Для сборки необходимо всего лишь выполнить одну команду make, без внешних зависимостей, таких как Python или PyTorch. Voxtral Realtime 4B является потоковой моделью, умеющей обрабатывать аудио длительностью до 30 минут с контекстным окном в 32 000 токенов. Веса модели занимают примерно 8,9 ГБ и доступны под лицензией Apache 2.0. Хотя Mistral рекомендует использовать vLLM для запуска модели, реализация antirez позволяет обойтись без этой зависимости. Это уже третий проект antirez в его серии “ИИ на чистом C”, предшествующие работы − flux2.c и gte-pure-C. Все проекты используют Claude Code и созданы в духе минималистичных решений, демонстрирующих, что запуск нейросетей возможен без громоздкого ML-стека.