<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
    <channel>
        <title>A-vision мультимодальная модель Авито – Константин Веснин.</title>
        <link>https://peertube.lightnode.ru/videos/watch/7f11596b-50d2-4792-9039-f1ab9b71e2a8</link>
        <description>Константин Веснин рассказывает о разработке A-vision — мультимодальной модели Авито, которая объединяет изображения и текст для автоматической генерации описаний. Он делится деталями архитектуры, сбора данных, адаптации токенизатора, результатами обучения и планами по интеграции модели в продукты. 📎 Больше контента от АвитоТех по ссылке https://clc.to/WEquqg 📎 Конференция от Авито – для тех кто управляет продуктами, процессами и людьми - регистрация https://clc.to/kKFMSA Таймкоды: 00:00:04 Введение 00:00:26 Цели презентации 00:00:57 Что такое Vision Language Model 00:02:13 Проблемы генерации описаний 00:03:53 Сбор данных 00:06:13 Сбор собственного датасета 00:07:08 Архитектура VLM 00:09:02 Эксперименты и результаты 00:09:56 Адаптация токенизатора 00:11:45 Результаты адаптации 00:12:44 Обучение модели 00:13:27 Перевод метрик 00:13:57 Результаты обучения 00:14:50 Планы по интеграции 00:15:36 Пример работы модели 00:16:32 Вопросы и ответы 00:20:42 Переобучение модели 00:22:54 Динамическое разрешение 00:24:43 Разделение роутов 00:25:57 Обсуждение модели от Google 00:25:57 Завершение выступления AvitoTech — это команда инженеров Авито. Подпишитесь на наш канал, соцсети и блоги, чтобы узнавать больше о технологиях Авито 👇🏻 ВК: https://vk.com/avitotech Телеграм: https://clc.to/-YHGlg Хабр: https://habr.com/ru/company/avito Гитхаб: https://github.com/avito-tech RuTube: https://rutube.ru/channel/30462632/ Дзен: https://dzen.ru/avitotech Сайт: https://clc.to/l5ZqRA</description>
        <lastBuildDate>Mon, 27 Jul 2026 13:42:39 GMT</lastBuildDate>
        <docs>https://validator.w3.org/feed/docs/rss2.html</docs>
        <generator>PeerTube - https://peertube.lightnode.ru</generator>
        <image>
            <title>A-vision мультимодальная модель Авито – Константин Веснин.</title>
            <url>https://peertube.lightnode.ru/client/assets/images/icons/icon-96x96.png</url>
            <link>https://peertube.lightnode.ru/videos/watch/7f11596b-50d2-4792-9039-f1ab9b71e2a8</link>
        </image>
        <copyright>All rights reserved, unless otherwise specified in the terms specified at https://peertube.lightnode.ru/about and potential licenses granted by each content's rightholder.</copyright>
        <atom:link href="https://peertube.lightnode.ru/feeds/video-comments.xml?videoId=7f11596b-50d2-4792-9039-f1ab9b71e2a8" rel="self" type="application/rss+xml"/>
    </channel>
</rss>