NEW BOT Телеграм, страница

Forwarded from ду́но

Мы ищем стажеров!

👩‍🌾 shorties — это персональная программа, в которой мы выращиваем таланты до полноценных Research Engineer’ов или Research Scientist’ов в зависимости от ваших интересов.

🔭 Intern Research Scientist

Вы будете заниматься написанием статей на top-tier ИИ конференции (NeurIPS, ICLR, ICML) и участием в научном дискурсе: проведение экспериментов, проверка и генерация исследовательских идей, которые направлены на развитие научного знания.

🧪 Intern Research Engineer

Вы будете заниматься созданием новых frontier-технологий и применением Reinforcement Learning в реальных задачах.

Тестовые задания и подробные описания позиций можно найти по ссылкам выше, дедлайн подачи заявки — 15 августа.

- - —
@dunnolab

🔥10👏7👍5🥰1

4.41K views09:31

causality links

😘 Первая публикация дорогого брата Ильи Зисмана (@suessmann) на ICML'e первым автором, проделал кучу работы и прошел через несколько кругов ада с Watermaze'ом.

Клевая и простая идея, с которой дальше будет гораздо легче скейлить in-context rl.

https://news.1rj.ru/str/dunnolab/20

Please open Telegram to view this post

VIEW IN TELEGRAM

ду́но

Рассказываем о нашей работе принятой на ICML 2024. В деталях.

🌻Контекст🌻

In-Context RL позволяет обучать агентов способных на адаптацию к новым задачам прямо во время инференеса, то есть zero-shot. При этом не происходит обновлений весов модели или обучения…

🔥17👍6💯6❤2🥰1

7.56K viewsedited 12:45

causality links

> два года назад: ура, нашу статью приняли на нипс

> сегодня: депрессия, потому что приняли только 1 статью на нипс

🫠

Please open Telegram to view this post

VIEW IN TELEGRAM

🤯22😁9😢6🍌3🙏2🥰1

7.64K views13:01

causality links

github anon strikes again

https://github.com/NVIDIA/ngpt/issues/1

GitHub

GPT baseline block computation error · Issue #1 · NVIDIA/ngpt

Hello, thank you very much for open sourcing nGPT. I have found an error in the block computation of the GPT (use_nGPT=0) baseline. The computation being done is : x = norm(x) + attn(norm(x)) x = n...

❤8🥰1

7.39K views17:09

causality links

ахахахаххаха

❤9🔥1🥰1😁1🌭1

7.24K views10:56

causality links

Forwarded from Does RL work yet? (Александр Никулин)

Прошла тут статейка на ICLR 2025, настрадались с ней ужас 🫠

❤10🔥10🏆4👏3🥰1

5.37K views07:49

causality links

no rest for the wicked

думали взять небольшую передышку после сабмитов на ICML, но произошел нюанс

2 / 3 сабмитов на ICML с concurrent work, которые судя по абстракту делают примерно тоже самое

let the twitter war begin 🔫

🔫

https://news.1rj.ru/str/rllinks/67

Please open Telegram to view this post

VIEW IN TELEGRAM

Does RL work yet?

> ICML
> вызываешься ревьювером
> открываешь предварительный список статей, чтобы заматчится на ревью
> видишь статью подозрительно похожую на твою
> абстракт почти один в один как в твоей
> результаты тоже

лицо представили? а мне и представлять не надо.

🔥8🤯4👍2🥰1

6.59K viewsedited 20:10

causality links

https://news.1rj.ru/str/airi_research_institute/755

если вы поддерживаете благотворительные организации или хотите начать, мы сейчас в институте участвуем в MeetForCharity — благотворительном аукционе встреч с успешными успехами из разных сфер, от бизнеса и технологий до театра и кино

тоже участвую в этом году и выбрал «Дом с маяком» — хоспис, который поддерживает около 800 детей

мне кажется история очень здравая, там много интересных людей, которых просто так не вытащишь, а это отличная возможность и познакомиться и людям помочь 🙂

Институт AIRI

AIRI х Meet For Charity

В рамках недели коллабораций ко Дню науки пять учёных AIRI примут участие в Meet For Charity — крупнейшем в России благотворительным аукционе. Слоты на аукционе — это возможность встретиться с исследователем и лично обсудить интересующие…

❤11🔥4🥰1

7.95K viewsedited 18:17

causality links

Forwarded from Does RL work yet?

Самое время подвести итоги сабмитов на ICLR 2025. Не все успели довести до фулл статей, но и воркшопы тоже хорошо!

Что-то уже есть на архиве (и еще будет обновлятся с новыми результатами), так что делюсь:
1. XLand-100B: A Large-Scale Multi-Task Dataset for In-Context Reinforcement Learning (Main, Poster), by @howuhh and @suessmann and @zzmtsvv
2. Latent Action Learning Requires Supervision in the Presence of Distractors (Workshop, World Models), by @howuhh
3. Object-Centric Latent Action Learning (Workshop, World Models), by @cinemere
4. N-Gram Induction Heads for In-Context RL: Improving Stability and Reducing Data Needs (Workshop, SCOPE), by @suessmann
5. Yes, Q-learning Helps Offline In-Context RL (Workshop, SSI-FM), by @adagrad

🔥10

5.67K views15:06

causality links

💥 Запустили именную стипендию для студентов Университета Иннополис! В августе вместе с @lua_b после очередных посиделок в District'e задались вопросом -- а почему нет стипендии для студентов УИ от выпускников? Решили, что нужно взять в свои руки и организовали…

совсем забыл рассказать, в этом году успешно продолжили поддерживать студентов УИ через стипендию 1519

в этот раз получилось раздать 30 стипендий (в прошлом году было 17!)

маленькая победа, ура 🙂

1519.innopolis.university

1519 Scholarship

Scholarship by Innopolis University Alumni

❤12⚡3🥰3

6.26K views00:24

causality links

в этом году буду курировать направления по Reinforcement Learning и World Models, залетайте, контент будет хороший 🙂

https://news.1rj.ru/str/airi_research_institute/825

Институт AIRI

⚡️Открываем прием заявок на Лето с AIRI 2025!

В этом году мы запускаем Школу совместно с ТГУ. Программа пройдет в Томске с 30 июня по 10 июля. Это отличная возможность поработать с экспертами в области ИИ, прокачать навыки и погрузиться в исследовательскую…

❤16🥰2

8.68K views18:27

causality links

чуть подробнее написали, что ожидается от рисерч пропозала

примером делился до этого в комментариях, но вдруг кто не видел, то вот

https://news.1rj.ru/str/airi_research_institute/870

Институт AIRI

Для тех, кто впервые готовит Research Proposal: рассказываем, с чего начать, зачем он нужен и как его подготовить ⤵️

Research Proposal — это способ обосновать и спланировать будущую работу: показать, что вы понимаете контекст, видите важную задачу, умеете…

❤6🥰3❤‍🔥2

4.86K views17:31

causality links

Forwarded from Институт AIRI

Новый шаг в управлении роботами и оптимизации индустриальных процессов 🤖

Исследователи AIRI разработали Vintix — SOTA action-модель для роботов и индустриальных процессов, умеющую имитировать ход обучения с подкреплением. Благодаря этому Vintix самостоятельно корректирует и улучшает свои действия, получая минимальную обратную связь от пользователя.

Техническая реализация Vintix опирается на расширенный контекст трансформера. Благодаря сжатию данных — состояние-действие-награда в один токен — модель анализирует в 3 раза больше информации по сравнению с аналогами: JAT от HugginFace и GATO от Google DeepMind. При этом архитектура устойчива к шуму и частичной наблюдаемости среды — Vintix успешно справляется с задержками и неполными данными, что критически важно для промышленного применения.

Vintix может быть полезной в разных областях. Например, применяться для автоматизации задач на производственных линиях и оптимизации маршрутов складских роботов, а в сфере энергетики подобные системы способны управлять распределением нагрузки для более эффективного использования ресурсов. Научная статья будет представлена на конференции ICML в июле 2025 года.

Подробнее про исследование — в материале Forbes.

Научная статья | GitHub

🔥8❤4👏3🥴2🥰1😁1😱1

3.22K views09:58

causality links

lol

😁7👍2🔥2⚡1🥰1💔1

3.46K views22:37

causality links

https://news.1rj.ru/str/complete_ai/684

хорошая коллаба получилась, затащили рль для реверс инжиниринга деталей, топ работа как обычно от @adagrad @suessmann и @Howuhh

Complete AI

⚡️⚡️⚡️На прошлой неделе мы в AIRI зарелизили очень крутую работу в рамках трека «Генеративное проектирование» — cadrille: Multi-modal CAD Reconstruction with Online Reinforcement Learning

Архитектура представляет собой мультимодальную LLM, которая на вход…

🔥8❤2🥰2

5K views11:10

causality links

продуктивный год получился 🤩

https://news.1rj.ru/str/dunnolab/35

Please open Telegram to view this post

VIEW IN TELEGRAM

ду́но

📘 Годовой отчет за период июнь 2024–июнь 2025

-> Девиз года: «Сохраняя исследовательские традиции»

В соответствии с научными традициями и вызовами времени, наша команда в 2024 году продолжила уверенное движение по вектору фундаментальных и прикладных исследований…

🔥10🥰5❤1

5.47K views19:32

causality links

Forwarded from ду́но

0:43

This media is not supported in your browser

VIEW IN TELEGRAM

Сейчас суперактивно развивается сегмент бюджетной домашней робототехники на коленке — LeRobot от HuggingFace.

Можно на 3д принтере распечатать детали, за дешево купить приводы и дома на коленке собрать мини-робота.

Например, собрать SO-100 в домашних условиях стоит около 20k рублей, крутяк?

На прошлых выходных @suessmann поучаствовал в хакатоне от HuggingFace: нужно было сделать демо по использованию таких роботов. Илья в домашних условиях собрал робота и заимплементил крутейшее демо для телеоператоров с помощью телефона!

Результат на видосе, если хотите что-то такое же дома провернуть, то вот код: https://github.com/suessmann/daxie

Если вам интересно поработать с нами в направлении RL/VLA и около — скоро откроем набор тут.
А если уже горит и есть оформленные рисерч пропозалы, не ждите — пишите сразу @howuhh.

- - —
@dunnolab

❤24🥰4👍3

6K views11:00

causality links

Forwarded from ду́но

Открыли набор на практику по направлениям RL / VLA / IL.

У нашей группы большой опыт в области RL: имеем публикации на самых топовых конференциях [см. Наши статьи]. Если вы хотите писать научные статьи, сдвигать соты, и развиваться как исследователь в области Reinforcement Learning (RL) и вокруг — то вам к нам!

Resident Research Scientist — RL / VLA / IL

Вы будете заниматься написанием статей на top-tier конференции (NeurIPS, ICLR, ICML), проводить эксперименты и предлагать новые исследовательские идеи.

Требования:
- Наличие исследовательских идей.
- Начитанность, знание и умение рассказать о последних заинтересовавших статьях с A* конференций.
- Cамостоятельный опыт с чем-то из RL, Imitation Learning, Vision-Language-Action models и всем вокруг.

Подробное описание позиции и тестовое задание можно найти по ссылке выше, дедлайн подачи заявки — 10-го ноября.

- - —
@dunnolab

dunnolab on Notion

Resident Research Scientist — RL / VLA / IL | Notion

Про практику

❤9

2.31K views09:30

causality links

Forwarded from Неискусственный интеллект (Илья Склюев)

0:34

This media is not supported in your browser

VIEW IN TELEGRAM

🤖

В России появилась своя "арена" для оценки моделей управления роботами

Её разработали в Институте AIRI. VLA Arena позволяет запускать роботов в виртуальной среде, а также подключать реальные устройства: сейчас поддерживаются компактные манипуляторы LeRobot SO-100 и SO-101 от Hugging Face.

Если у пользователя нет робота, он может сравнивать модели в виртуальной среде, а если робот есть — подключить его и проверить, как различные модели управляют его действиями.

Так можно легко оценить, какие VLA-сборки лучше всего подходят к конкретному "железу".

Аналоги, вроде RoboArena от учёных из Беркли и Стэнфорда, оперируют роботами, стоимость которых исчисляется десятками тысяч долларов. Воспользоваться ими можно только в исследовательских лабораториях. VLA Arena же адаптирована специально для демократичных LeRobot стоимостью до 30 тысяч рублей.

Сейчас для тестов доступны открытые VLA-модели (Vision-Language-Action):
▪️ π0.5 от Physical Intelligence
▪️ SmolVLA от Hugging Face
▪️ Flower от Intuitive Robots Lab и Microsoft Research
▪️ "Русифицированная" π0.5, адаптированная в AIRI

Они обладают способностью понимать и выполнять инструкции на естественном языке. Такие модели могут работать в различных сценариях, включая сложные задачи, требующие обобщения и анализа контекста.

Пользователи могут оценивать производительность моделей в различных сценариях, в том числе на русском языке. Итоговые оценки в рейтинге будут основаны на рандомизированных тестах.

Платформа также содержит чистые датасеты для LeRobot из открытых источников, размеченные и переведённые на русский язык для помощи разработчикам в обучении собственных моделей для LeRobot.

Первый запуск платформы рассчитан на срок до 3 месяцев, разработчики будут собирать обратную связь. Тестовый доступ открыли буквально только что: попробовать VLA Arena можно уже сейчас.

@anti_agi

Please open Telegram to view this post

VIEW IN TELEGRAM

❤15🔥5❤‍🔥3

1.63K views11:16

About

Blog

Apps

Platform