- Последний пост
- 30 июл.
- Последнее чтение
- 14 авг.
- Постов за неделю
- 0
- Всего постов
- 20
- Тип
- открытый
- Язык
- русский
- В каталоге с
- 13 авг.
- 1/24сутки в ленте
- 360
- 1/48двое суток
- 412
- 1/72трое суток
- 444
Оценка по просмотрам недавних постов: пост набирает почти всё за первые сутки.
Посты
She hungry
https://www.youtube.com/watch?v=rGNmjx6S2v4
видео или голосовое, без подписи
Открытие дня: zerotier пытается пробить NAT, а не просто роутит весь трафик через свои сервера, как делает обычный VPN. Zerotier — штука, похожая на vpn, которая связывает устройства в одну виртуальную сеть. Узнал о ней 4 года назад из поста Жовнера.
Только что наконец пришло I-20 от универа. Скоро будем подаваться на визу P.S. поступил в CMU на PhD, буду писать статьи с Tim Dettmers
Ок, вы меня убедили, стоит попробовать
Ок, вы меня убедили, стоит попробовать
В моём твиттере все восхваляют uv и закапывают pip. Это мой пузырь, или он и правда хороший?
видео или голосовое, без подписи
Понравилась эта цитата из поста выше: Я не понимаю вот чего — то поведение, которое называют "быстрым дофамином", было известно всегда, и люди как-то обходились другими терминами. Но когда широкий круг общественности узнал, что такое дофамин, то почему-то возникла острая необходимость переименовать в его честь то, что им не является. Зачем? Я сама временами задумываюсь о том, как же сильно многие люди любят пихать названия всевозможных нейромедиаторов во все возможные объяснения всех возможных видов поведения человека. Захотел погладить котика? Это все от окситоцина. Понравился ролик в тик ток? Это все от дофамина. Нервничаешь перед дедлайном? Это все от кортизола. Конечно, никто (или почти никто) из произносящих подобное на самом деле не читал научные статьи с экспериментами, которые бы доказывали подобные высказывания (Не удивлюсь, если таких статей и нет, так как все перечисленное звучит как гипер-упрощение, и причинно-следственные связи здесь явно нуждаются в дополнительном уточнении). А самое главное, никакого настоящего понимания того, по каким закономерностям работают все эти процессы и что с этим делать не-биологам типа меня названия этих веществ никак не добавляют.
Классика src
src
сник пик новой версии -- с меньшим потреблением памяти и большим выбором моделей
Исследователь из научного отдела «ebány labs» Юрий Шмилевский разработал bash скрипт, который позволяет запустить большую языковую модель с 8,1 млрд параметров «на обычном компьютере с графическим ускорителем А-СТО» через трубочку для поедания супа-пюре, рассказал сам Юрий Шмилевский
Наконец-то закончил работу над большим пет-проектом. Я смог запустить Llama 3.1-8b прямо в браузере на cpu с помощью нашего нового алгоритма сжатия AQLM+PV. Можно потестить демо здесь видео
И первая новость в обновленном канале следующая: Мы с командой запустили свою российскую LLM Aрену. Это такой сайт (идею скопировали у LMSYS), на котором обычные люди могут использовать разные LLM бесплатно, но взамен должны определять лучшую модель. А мы на основе фидбека пользователей составляем рейтинг LLM и рассчитываем какая модель работает лучше всех на русском языке. Мы попали прям в боль ML сообщества: кол-во LLM в России растет как на дрожжах, уже помимо YandexGPT, Гигачата есть и T-lite, и Вихрь, и Сайга. Новые LLM появляются каждую неделю и возникает потребность их сравнивать. За последний месяц посещаемость проекта увеличилась в 6 раз, цитируемость бенчмарка возросла в разы, о нас написали Коммерсантъ, ITZine, Machinelearning, Tproger, ХАЙТЕК, RSpectr, hi-tech, газета.ru, Хабр, Lenta.ru. Заходите на llmarena.ru и выбирайте лучшую модель!
Если у вас есть свободное время, анонимно потыкать в модели на llmarena.ru -- хорошее дело. Чем больше людей сравнивают модели, тем точнее рейтинг
Увеличил на 9% скорость работы и уменьшил размер на те же 9%. Смог сжать эмбединги в nf4 формате. Не стал жать в nf4 голову, остановился на int8, поскольку второй быстрее.
Наконец-то закончил работу над большим пет-проектом. Я смог запустить Llama 3.1-8b прямо в браузере на cpu с помощью нашего нового алгоритма сжатия AQLM+PV. Можно потестить демо здесь видео
Наконец-то закончил работу над большим пет-проектом. Я смог запустить Llama 3.1-8b прямо в браузере на cpu с помощью нашего нового алгоритма сжатия AQLM+PV. Можно потестить демо здесь видео