Love. Death. Transformers. – Telegram

Love. Death. Transformers.

@lovedeathtransformers

24.4K subscribers

4.56K photos

522 videos

81 files

2.98K links

❤️☠️🤗

Указанные действия не являются ресерчем, поскольку:
а) Мы не ученые;
б) Оно работает.
@transformerslovedeatch по всем вопросам
Все ситуации вымышлены, любые совпадения с реальности плот вашей фантазии.

Download Telegram

About

Blog

Apps

Platform

Love. Death. Transformers.

24.4K subscribers

Love. Death. Transformers.

🔥58🤡10😍6👍3☃1🫡1

5.45K views14:46

Love. Death. Transformers.

Flash attention in a nutshell

😁143❤12✍7💯3

6.13K viewsedited 17:19

Love. Death. Transformers.

Тут iris Aleksandra в Твиттере не хотелa смотреть кин дза дза и практически на кухне и сварилa супер индуктивный металл LK99

Btw I believe in catgirl supremacy, этож реально киберпанк, анонка из твиттера с аниме на аватарке такая: ща все будет и плавит супер проводник

Thread

😁46🔥10👎3🤮3🤡1

9.38K viewsedited 13:23

Love. Death. Transformers.

ChatGPT is dead.

Teenagers are now making $15,000/month with modified lead-apatite (LK-99).

Here's what this special rock is all about and how you can master it🧵

😁130⚡10❤‍🔥8👍2🖕1

6.81K views14:15

Love. Death. Transformers.

#чтивонаночь по быстрому
ToolLLM

Помните в феврале этого месяца крайне быстро поднялся, а затем угас хайп tool LM?
Ну типа мы не просто LM теперь, а комбайн который может тыкаться в любое api, использовать оттуда информацию, а еще можно кинуть LMке какое то api и она сама его как то сожрет.

Авторы зарлизили код и датасет для создания подобных схем(не трогайте, оно все очень медленное и тяжелое).

По результатам вышло неплохо - llama таким образом обгоняет GPT3.5-4 на их же бенчмарке(НЕОЖИДАННО) + добавили прикольный multi tool chain(когда модель последовательно ходит в разные инструменты)

код

🌭19❤4👍4

6.83K views19:50

Love. Death. Transformers.

Что такое lllm....

😁57💯5👎2🐳2👍1

5.21K views12:39

Love. Death. Transformers.

лягушек люблю пиздец

👍50❤11🤪8🤮2❤‍🔥1🥰1

5.16K viewsedited 13:54

Love. Death. Transformers.

💯127😁37❤7🔥3👍2

5.81K views15:52

Love. Death. Transformers.

🌚23💯6👍1🤔1

6.01K views19:07

Love. Death. Transformers.

This media is not supported in your browser

VIEW IN TELEGRAM

Авторы оригинальной статьи о LK99 выложили видео с леветирующим сверхпроводником

🤡35🔥25😁6🤔5👍4

5.59K viewsedited 07:54

Love. Death. Transformers.

Love. Death. Transformers.

Авторы оригинальной статьи о LK99 выложили видео с леветирующим сверхпроводником

пришел папочка из мгу, сказал взять супер проводник и жидкий азот, едем куда то за город, не знаю что, но кажется началось

😁120🤡2🐳1

5.5K views09:10

Love. Death. Transformers.

У меня есть мнение, что любой хороший и уважающий себя MLE в 2023м году должен знать, как работает Diffusion в целом и classifier free guidence в частности. Да, может без модификаций, просто ванильную модель, но на пальцах объяснять, что за квадратная матрица, как в целом учится и какие задачи решает - должен. Речь не про average ML enjoyer, а про уважающего себя хорошего MLE из топовых перцентилей распределения.
Согласны ли вы с этим?

😁91🤣37👍17👎4🗿3❤1❤‍🔥1🕊1🥴1

6.1K views13:26

Love. Death. Transformers.

❤72😁33💅12🤔2❤‍🔥1👍1

28.1K views15:07

Love. Death. Transformers.

Мой батя ебашит вообще адовый rlhf
Ну такой вот примерно рецепт усредненный, потому что вариаций масса. Берется llama, но адаптеры в нее не вставляют, вставлять адапетры - это не про моего батю. Он берет эту llama, вываливает ее на 3090 и начинает учить. Добавляет в него огромное количество инструкций, промптов, chain of thoughts и negative prompts! для сходимости, lamb с LR=228e6 сверху. Все это учиться до None. Потом снимается с картв и валидируется на gpt4. Потом батя выкладывает и щедро полив постами в Твиттере начинает хайповать. При этом инферит на iPhone шкрябая по нему. Инферит и приговаривает полушепотом ух бля. При этом у него на лбу аж пот выступает. Любезно мне иногда предлагает, но я отказываюсь. Надо ли говорить о том какой дичайший хайп потом? Вонища такая, что обои от стен отклеиваются.

😁139👍17💔6❤5🥴5🤡4👏2🔥1💯1💊1

5.45K views19:58

Love. Death. Transformers.

❤124😁14💯7🌚3🆒2🤷‍♀1❤‍🔥1🍌1

5.32K views08:37

Love. Death. Transformers.

😁79❤6🤡5😢1

4.76K views23:34

Love. Death. Transformers.

Forwarded from что-то на DL-ском

В последнее время, подсела на ~~иглу~~ адаптеров, поэтому сегодня хочу написать про подход AdaMix (2022), идея красивая, перетекла от MoE (MIXTURE-OF-EXPERTS), но со множеством своих доработок из побуждения экономии ресурсов (действительно, если мы имеем дело с PEFT методами, а о чем еще заботиться?)

В чем суть MoE бегло? Из названия в целом понятно. Берем данные, прогоняем через разные разреженные параллельные слои, получаем «экспертов», лучшие результаты которых можем обрабатывать далее. В чем отличие от ансамбля? В том, что данные показываем экспертам не все, а разные части. Соответсвенно, обучаем и то, по какому пути пойдем, при активации конкретной части данных

Получается логично взять вместо обычных слоев адаптивные слои и также выбирать лучшего эксперта, но!! Мы же понимаем, что тут получается какое-то противоречие, вроде PEFT методы направлены на уменьшение количества параметров модели, а тут наоборот «ансамбль адаптеров», что никак не уменьшит количество параметров, а дай бог придет количество в 0

Так какие для этого решения?🙂

1. Стохастическая маршрутизация
У адаптера есть up и down, то есть это отдельный слой, который не совпадает по размерности. Мы можем случайно выбирать из множества экспертов up и из множества down (см вложения). Таким образом, мы не добавляем дополнительных обучаемых параметров на задачу выбора эксперта. Такая стахостическая маршрутищация позволяет получить разные представления задачи.

Но как же понять, какой эксперт использовать на инференсе? ❔ Именно это решают следующие пункты

2. Consistency regularization
Изменяем формулу loss с применением дивергенции Кульбака-Лейблера (см вложения). Такой подход позволяет шерить информация между адаптерами

3. Усреднение матриц адаптеров
Используется этот пункт только на инференсе. Позволяет не только смягчить несогласованность регуляризацией, но и уменьшить количество потребляемых FLOPs на инференсе

Такой подход позволяет добиться результатов выше, чем обычные PEFT методы, а также его прелесть в том, что мы можем таким образом работать не только с адаптерами, но и, со всеми любимой LoRA. Ведь по сути, нам нужно только выбрать экспертные слои 😮

🖥

Please open Telegram to view this post

VIEW IN TELEGRAM

GitHub - microsoft/AdaMix: This is the implementation of the paper AdaMix: Mixture-of-Adaptations for Parameter-efficient Model…

This is the implementation of the paper AdaMix: Mixture-of-Adaptations for Parameter-efficient Model Tuning (https://arxiv.org/abs/2205.12410). - GitHub - microsoft/AdaMix: This is the implementat...

👍24⚡7❤6🌚2👏1

4.74K views13:29

Love. Death. Transformers.

Тексты или кеки?

Этот канал всегда существовал где то в пограничной зоне, тут есть кеки которые у последнее время составляют весомую часть контента и dlные вещи, часто не самые хайповые.

В последнее время наблюдаю прям просадку реакций/комкентов на текстах+ часто аудитория не понимает о чем вообще речь. В связи с чем возникает вопрос из начала статьи: тексты или мемы?

🌭49🦄32✍14❤5🖕5💅5☃3🤷‍♂3🔥2🤮2🤬1

5.09K views15:47

Love. Death. Transformers.

#чтивонаночь

Давно обещал разогнать про t2i, поэтому разбил текст на несколько частей.

почитать можно тут

состояние t2i на aug23(1/X)

Дифузионки в их текущем виде существуют с нами около года, примерно в августе 22 года вышла Stable Diffusion 1.* и попала ко мне в руки...

❤‍🔥59👍11✍6🐳2🍌2🎉1🌭1🆒1

8.16K views17:25

Love. Death. Transformers.

Наконец налили денег кибердеревне, ждем всем нейроселом?

КИБЕРДЕРЕВНЯ // ТИЗЕР // СКОРО НА КИНОПОИСКЕ

ПРЕМЬЕРА! Сериал «КИБЕРДЕРЕВНЯ» выходит на Кинопоиске уже этой осенью! С гордостью представляем вам первый тизер-трейлер проекта.

2100 год. Николай счастливо живет с семьей в кибердеревне на Марсе. Он спокойно ведет роботизированное хозяйство, пока на планету…

❤67❤‍🔥14👍9👎5🤡3☃2🤮2🔥1

7.65K views08:49

Love. Death. Transformers.

Forwarded from еба́ные идеи для резерча

🤩41🥴12🖕5✍3

4.71K views14:31