Андрей Карпатый, бывший инженер OpenAI и популяризатор машинного обучения, представил проект, который может кардинально изменить доступность технологий искусственного интеллекта. Его новая инициатива, названная nanochat, демонстрирует, что разработать собственную языковую модель теперь можно всего за сотню долларов, используя базовые инструменты. Этот проект интегрирован в открытый курс LLM101n от Eureka Labs, где Карпатый пошагово объясняет, как собрать и обучить языковую модель с нуля. Все процессы максимально упрощены: токенизатор написан на Rust, данные загружаются через систему FineWeb-EDU, а готовые скрипты управляют обучением и сбором метрик. Доступ к недорогим облачным мощностям позволяет завершить обучение всего за сто долларов. Основная цель nanochat — продемонстрировать, что создание больших языковых моделей больше не привилегия крупных компаний. В репозитории есть не только код, но и учебные материалы для самостоятельного изучения. Встроенный веб-интерфейс облегчает работу с моделью, позволяя пользователям тестировать результаты обучения и сравнивать их с существующими решениями. Карпатый создал доступный инструмент для тех, кто хочет глубже понять работу ИИ. В эпоху миллиардных инвестиций в обучение моделей, nanochat подчеркивает, что инновации начинаются с любопытства и открытых ресурсов.