Базовый гайд по тому как пользоваться llama.cpp для запуска языковых моделей на домашнем ПК.
Популярное
Свежее
Моя лента
Сообщения
Рейтинг
Курс ИИ
Базовый гайд по тому как пользоваться llama.cpp для запуска языковых моделей на домашнем ПК.
Игорь Телегин на связи! Коллеги, пока NVIDIA продает свои H100 по цене крыла от Боинга, а доступ к топовым LLM через API стоит как чугунный мост, на горизонте появился интересный игрок – Groq AI. Эти ребята, основанные бывшими инженерами Google, пилят свое AI-железо (чипы), которое обещает невероятную скорость и эффективность. А самое сочное – чере…
Вчера Qwen.AI (AI подразделение Alibaba Group) опубликовали свои новые открытые модели нового поколения Qwen3.
Три дня назад Meta выпустила три (две доступны) новые модели из популярного семейства LLaMA.
Недавно в LM Studio (софт для запуска нейронок локально) зарелизилась интересная фича: speculative decoding, которая по обещаниями авторов дает прирост скорости от 1.3 до чуть ли не 2x. Выглядит слишком хорошо, что бы быть правдой.
Всем привет! В последнее время я заметил множество постов и статей в русскоязычном сегменте интернета, которые ссылаются на одно интересное исследование, но интерпретируют его… скажем так, довольно своеобразно. Часто можно встретить заголовки вроде «ИИ научился обманывать чтобы спастись!» или «Нейросети вышли из-под контроля и пытались сбежать!». Э…
Оригинальная публикация была сделана на сайте Reddit
Мы с командой разрабатываем FractalGPT - проект самообучающегося ИИ на базе больших языковых моделей(LLM) и логического вывода (reasoning). В этой статье мы расскажем о разработанном нами новом подходе, который называется fractal answer synthesis. Фрактальный синтез ответа позволяет существенно уменьшить уровень «галлюционирования» LLM и, как следс…
Она была обучена без использования человеческой обратной связи и может показывать результаты, схожие с GPT-4