Разбираемся, зачем ML‑специалистам писать рантайм, как сделать интерактивного ассистента с помощью KV‑кеш‑мани…
📕
Разбираемся, зачем ML‑специалистам писать рантайм, как сделать интерактивного ассистента с помощью KV‑кеш‑манипуляций и как аналитика меняется в эпоху агентов. Об этом и не только — в новом дайджесте Yandex for Developers
🚕
Куда сходить
🔴
3 октября —
«Я про бэкенд»
в Москве и онлайн.
На конференции обсудим архитектуру AI-систем в продакшене: инференс генеративных моделей, потоковую обработку данных, высокие нагрузки и отказоустойчивость
🔴
6 октября —
Architecture Club Яндекс 360
.
Это открытое сообщество для архитекторов и инженеров. На встрече мы разберём, как устроен AI-агент, который работает с корпоративными данными и остаётся управляемым
🔴
28 октября —
Data Dojo
в Москве.
Поговорим про тренды и актуальные технологии, разберём реальные задачи из соревнований и поделимся прикладными кейсами в кругу ML-специалистов
🌎
Что случилось
🔴
Запустили
Intern Week Offer
.
Зовите друзей и знакомых, которые хотят попасть на стажировку в Яндекс: здесь они смогут решить контест, пройти собес в течение недели и стать стажёрами уже этой осенью. Доступны три направления: ML, Frontend, Backend
🔴
Выкатываем
AliceAI-Foundation-80B-A3B-Base
в опенсорс.
Публикуем веса нашей новой модели и большой технический отчёт: от пайплайнов подготовки данных и методов оценки до стабилизации обучения и scaling laws
🔴
Yandex B2B Tech
научила AI-агентов работать в мессенджерах
.
Теперь на платформе Yandex AI Studio можно создавать AI-ассистентов для Telegram или Яндекс Мессенджера и подключать их как чат-ботов
🔴
Андроиду исполнилось 18 лет
.
В честь этого решили вспомнить, какие странности самой первой версии платформы всё ещё с нами: от Activity и поворота экрана до TextView.setText(18)
📖
Что почитать
🔴
Почему LLM
перестаёт слушать, когда думает
.
Разобрали, как сделать интерактивного агента с помощью KV‑кеш‑манипуляций и как от параллельных ответов прийти к совместному вычислению
🔴
RuntimeNodes:
зачем ML‑специалистам писать рантайм
.
Рассказали на примере LLM‑ответов в поисковой выдаче Яндекса, как мы научились работать с бизнес‑логикой как с ML‑артефактом и зачем нам для этого понадобились ещё один DSL и представление вычислений в виде графа
📺
Что посмотреть
🔴
Как ускорить работу LLM.
В подкасте «От инженера слышу» обсудили, что происходит между отправкой запроса и появлением ответа, как устроен инференс больших языковых моделей и что помогает сделать его быстрее и дешевле. Смотрите на
ютубе
и в
VK Видео
🔴
Новый сезон
«Историй Яндекса»
на Кинопоиске.
История компании, переданная людьми, которые её создавали и создают. В каждой серии новый герой со своим рассказом: от поиска инопланетной жизни и самоуправляющегося хаоса до истоков Алисы и краш-тестов самокатов
🔴
Записи докладов с deep tech night.
Здесь эксперты разобрали AI-продуктивность разработки, Physical AI и другие технологические вызовы в эпоху нейросетей. Смотрите на
лендинге
и на ютубе в двух треках:
Hard
и
Experiment
🔴
Аналитика в эпоху агентов.
В новом выпуске «Доверительного интервала» разбираемся, как нейросети меняют процессы, мышление и ценность работы аналитика. Смотрите на
ютубе
и в
VK Видео
, слушайте на
Яндекс Музыке
Подписывайтесь:
💬
@Yandex4Developers
Откликнуться в Telegram →
⚠️ Никогда не платите «за оформление» или «гарантию трудоустройства» — это признак мошенников. Работа ТРУ не несёт ответственности за содержание вакансии.