В мире сейчас десятки компаний пытаются повторить успех языковой модели ChatGPT. Однако разработчики из Университета Стэнфорда смогли это сделать по-своему. Там создали Alpaca 7B, которая работает подобно ChatGPT, но построена на языковой модели с открытым кодом. А на обучение ушло всего лишь 600 долларов, тогда как обучение ChatGPT оценивается в миллионы долларов.
В основе лежит модель Meta LLaMA 7B, которую обучили определённым образом. Важно отметить, что это самая маленькая модель серии LLaMA. В базовом варианте она отставала от ChatGPT в большинстве задач, однако после необходимого обучения даже превзошла.
Тесты в задачах, связанных с электронной почтой, социальных сетях и инструментах производительности, Alpaca победила в 90 из этих тестов, а GPT – в 89.
«Мы были удивлены результатом, учитывая небольшой размер модели и скромный объем данных для выполнения инструкций. Кроме использования этого набора статических оценок, мы также тестировали Alpaca в интерактивном режиме и обнаружили, что она часто ведет себя подобно GPT-3.5 на различных входных данных. Мы признаем, что наша оценка может быть ограничена в масштабе и разнообразии», – сообщили разработчики.
При этом отметим, что такие нейросети можно запускать на обычных ПК или даже на одноплатных системах, подобных Raspberry Pi.

Huawei Pura 80 Ultra обошел iPhone 18 Pro в DxOMark, лишив Apple титула создателя лучшего камерофона
iPhone 18 Pro раскупили в первые сутки: новый флагман Apple исчез с прилавков
Clicks Communicator улучшили перед выходом: больше памяти, мощнее батарея, Android, 12 ГБ ОЗУ и реальная клавиатура
В Панаме заработал спутниковый интернет Starlink Mobile с прямой связью со смартфонами и минимальной задержкой
Бюджетный мини-ПК Peladn WO5 на Core i5-13500H получил три слота для накопителей
Samsung меняет правила игры: галерея теперь синхронизируется с Google Фото
Porsche создала аккумулятор из 100% переработанных материалов со старых батарей
Утечка данных во Флориде: хакеры слили в сеть информацию о тысячах водителей