ym104432846
Вставьте ссылку на видео из Youtube, Rutube, VK видео
Задайте вопрос по видео
Что вас интересует?
00:10:59
Презентация национальной библиотеки Саха-Якутия:
  • 1. Национальная библиотека Республики Саха (Якутия) разработала технологии интеграции искусственного интеллекта своими силами, с участием специалистов, знающих внутренние процессы учреждения
  • 2. В рамках мероприятия запланировано демонстрационное представление технологий искусственного интеллекта с возможностью последующего обсуждения и вопросов участников
  • 3. Презентация включает показ работы технологий искусственным интеллектом через нажатие кнопок ассистентами библиотеки
00:12:00
Продукт «Эксперт Якутии»:
  • Разработан сервис под названием «Эксперт Якутии», ранее известный как «Краевед»
  • В основе сервиса лежит языковая модель GigaChat 2.0 версии
  • Система работает в формате вопрос-ответ, предоставляя точные сведения из научных статей и базы данных «Наука»
00:12:46
Технология GigaChat и борьба с галлюцинациями:
  • 1. Обсуждается проблема появления галлюцинаций у нейронных сетей и подходы к её решению
  • 2. Предложено считать появление галлюцинаций особенностью работы нейронок, а не ошибкой (багом)
  • 3. Упоминается термин «рак-технология», связанный с решением проблемы предсказаний нейронных сетей
00:13:17
Автоматизация процессов с применением искусственного интеллекта:
  • 1. Разработан метод подготовки контента для автоматизации внутренних процессов GigaChat
  • 2. Контент ориентирован на работу с новыми сотрудниками и ответы чат-бота на конкретные вопросы внутри одного учреждения или бизнеса
  • 3. Расширение охвата до предоставления ответов по всей Якутии
00:13:47
Сервис «Энциклопедия Якутия»:
  • 1. Разработан веб-виджет портала «Энциклопедия Якутии», интегрированный с мобильными приложениями Telegram и ботами
  • 2. Пользовательский интерфейс сервиса предусматривает различные варианты решений, однако текущее исполнение выполнено указанным способом
  • 3. Объем обрабатываемых данных значительный и ежедневно увеличивается
00:14:18
Пользовательский интерфейс и интеграция искусственного интеллекта:
  • Разработана универсальная информационная система на основе больших языковых моделей (GigaChat), способная обрабатывать естественный язык и создавать контент по различным тематикам
  • Система обеспечивает доступ к верифицированным источникам информации, включая электронные библиотеки и энциклопедии, создавая органичные тексты ответов
  • Проведены наблюдения и глубинные интервью среди пользователей научной библиотеки, подтвердившие использование ими ноутбуков, планшетов и подключение к Wi-Fi для поиска дополнительной информации
00:17:11
Работа с читателями и конспектирование:
  • 1. Разработана единая электронная библиотека с удобным интерфейсом, объединяющая различные приложения в одном окне
  • 2. Реализована функция быстрого поиска терминов и сложных оборотов непосредственно внутри документа без обращения к сторонним сервисам
  • 3. Добавлена возможность автоматической генерации вопросов для самопроверки после изучения материала
00:18:36
Генерация вопросов и объяснение сложных терминов:
  • Разработан сервис с использованием искусственного интеллекта (GigaChat), предназначенный для помощи студентам и учёным в обработке текстов, создании конспектов и понимании сложных статей
  • Сервис поддерживает работу с несколькими источниками информации, сохраняет конспекты в личном кабинете и позволяет скачивать материалы и литературу
  • Планируется интеграция национального языка Республики Саха (Якутского) в языковую модель GigaChat, что позволит пользователям общаться и получать информацию на родном языке
00:25:21
Перевод речи в текст и обратно:
  • 1. Искусственный интеллект успешно переводит речь участников на Якутский язык и обратно, включая распознавание речи и пунктуации
  • 2. Разработан Telegram-бот, позволяющий пользователям отправлять аудиофайлы длительностью до одного часа и получать переведенный текст
  • 3. Представители СМИ активно используют сервис для расшифровки записей разговоров и интервью в текстовый формат
00:27:24
Сбор и использование датасетов:
  • 1. Необходимо собрать аннотированные аудиозаписи для обучения искусственного интеллекта Якутского языка
  • 2. Текущие данные (тексты) недостаточно подходят для разработки требуемой системы
  • 3. Требуется значительный объем данных (датасетов) для качественного обучения ИИ
00:27:55
Проект Voice.ru и сбор аудиоданных:
  • Разработан портал voice.ru для сбора датасета Якутского языка совместной разработкой Арктического института культуры и Национальной библиотеки Республики Саха (Якутия)
  • Пользователи будут вносить отрывки текста, которые другие пользователи будут читать и отправлять на сервер проекта
  • Система оценивания записей позволит включать в датасет наиболее популярные материалы для обучения систем распознавания Якутского языка
00:30:36
Ассистент библиотеки и чат-боты:
  • 1. Разработан цифровой библиотекарь, отвечающий на фактографические вопросы пользователей и предоставляющий доступ ко всему электронному контенту библиотеки
  • 2. Система оснащена рекомендательной моделью искусственного интеллекта, предлагающей материалы исходя из предпочтений пользователя
  • 3. Доступ ко всей информации осуществляется через телеграм-бота, интегрированного в мини-приложение, работающее непосредственно в мессенджере
00:37:57
Вебархивирование и автоматизация каталогизации:
  • 1. Разработана технология автоматической обработки электронных документов с помощью искусственного интеллекта, позволяющая ускорить создание библиографических записей
  • 2. Внедрена практика дистанционного каталогации национальных библиотек во время пандемии COVID-19
  • 3. Используемый формат описания библиографических записей соответствует стандарту «русмарк коммуникативный»
00:42:06
Государственные библиографические указатели:
  • 1. Принято решение опубликовать созданный библиографический указатель в составе электронной библиотеки либо напечатать его
  • 2. Обеспечена автоматическая отправка готового государственного библиографического указателя органам исполнительной власти согласно классификационным индексам УДК
  • 3. Созданный указатель включает в себя основную версию, а также дополнительные вспомогательные указатели (именной, географический, предметный)
00:46:37
Искусственный интеллект в создании библиографических указателей:
  • 1. Разработан универсальный библиографический модуль, позволяющий создавать указатели на любые темы
  • 2. Созданный указатель демонстрируется на электронном каталоге, где автоматически формируются библиографические источники и хронологические рамки
  • 3. Система самостоятельно генерирует структуру указателя, однако специалисты сохраняют контроль над процессом и вправе вносить изменения
00:52:29
Платформа для обмена библиотечными датасетами:
  • Разработана собственная платформа для хранения и наполнения датасетов искусственным интеллектом, содержащая верифицированные и точные данные из фондов Национальной библиотеки Республики Саха (Якутия)
  • Платформа предназначена для обмена данными между разработчиками искусственного интеллекта и библиотекой, обеспечивая доступ зарубежных разработчиков к качественным данным
  • Презентация библиотеки превзошла ожидания участников, продемонстрировав инновационный подход и значимость проекта для развития технологий искусственного интеллекта в России и Якутии
0: Дорогие гости, уважаемые участники конгресса, всем доброе утро. Всех приветствуем на презентации национальной библиотеки республики саха якутия, которая посвящена технологиям искусственного интеллекта и каким образом мы их
1: Интегрируем в нашу деятельность очень коротко перед тем, как начнём все эти решения, которые мы сегодня вам покажем, про которых мы вам расскажем. Они появились не просто так, они разработаны внутри национальной библиотеки библиотекарями, то есть теми,
2: Людьми, специалистами, которые знают внутреннюю кухню, какие операции, какие процессы и каким образом туда лучше всего включить искусственный интеллект. У нас сегодня есть ассистенты. Собственно, я буду вам рассказывать, показывать наши
3: Девушки будут нажимать на кнопки и, собственно, мы будем видеть, как все это работает. Быстро проводим презентацию, это все посмотрим. И у нас будет время, когда мы будем отвечать на ваши вопросы всей командой национальной библиотеки. Давайте
4: Девушки, приступим, начнём мы, собственно, с сервиса, с решения, с продукта, который на данный момент называется эксперт якутии. Он был эксперт, краевед. Ну, в общем, как, как он только не назывался, главная идея у нас такая.
5: Да, под капотом у нас большая языковая модель GigaChat 2 0 версии, Макс и очень много контента, который соответствующим образом подготовлен. Задача. Какая это вопросно ответная система? Мы
6: Задаём вопрос о якутии, и искусственный интеллект отвечает на наши вопросы, используя достоверные данные, научные статьи из энциклопедии справочников, а также база данных, которая называется наука, которые
7: Ведёт национальная библиотека. Это попытка победить, если можно так сказать, такое явление, как галлюцинация нейронной сети, да. Ну это, скорее всего, не баг, а фича, просто природа нейронок, она такая.
8: Она работает с предсказаниями и возможность галлюцинаций, там она всегда есть. И таким образом мы решаем, ну или пытаемся решить эту проблему с появлением галлюцинаций. Такой подход технология сама называется рак. То есть в данном случае мы
9: GigaChat новым данным мы просто готовим соответствующим образом контент, на который он будет опираться, когда будет генерировать свои ответы в различных учреждениях. Такой подход используется для автоматизации внутренней работы, скажем так.
10: Там есть, когда приходят новые сотрудники, допустим, или когда чат бот отвечает на какие-то определённые вопросы, но это дело в рамках 1 учреждения 1 бизнеса. В данном случае мы говорим, что мы предоставляем ответы по всей якутии, то есть
11: Данных, с которыми мы работаем, он очень, очень большой. Более того, он каждый день пополняется. Так, давайте перейдём сам сам сервис, вот портал энциклопедия якутия и здесь у нас есть веб виджет, то есть
12: Мы, он интегрирован на сам портал, и тут же мы можем с ним говорить мобильное приложение telegram, боты. В общем, в качестве интерфейса для пользователя может быть абсолютно любое решение, но на данный момент оно реализовано вот таким вот.
13: Образом, так как у нас GigaChat, у нас здесь предусмотрено нлпи, то есть об обработке естественного языка, мы особо не задумываемся над формулировками там, да, как, скажем, в классических информационных системах и
14: И работают здесь и вектора, и эмбендинги, и у нас есть момент небольшой задержкой, да, он здесь присутствует, потому что мы ещё не переехали на архитектуру ии, агентов, вот которая
15: Появилась большой языковой модели GigaChat, но мы это сделаем. Ещё 1 момент, который здесь надо сказать, что вот что хочу до вас донести, до уважаемые слушатели, это инструмент универсальный, то есть не надо зации.
16: Не рекомендую вам зацикливаться и думать только, что мы работаем только с краеведческой информацией. Любой контент, который у вас есть, да, про ваши регионы или там ещё по какой-то определённой теме. Все это можно таким образом подготовить. Искусственный интеллект будет таким же образо.
17: Работать.
18: Что мы здесь дальше видим, так как у нас источники достоверные, мы библиотекари с вами, поэтому мы всегда делаем ссылки, да, на документы, с которых был, с помощью которых был сгенерирован данный ответ. Собственно, у нас там есть источники.
19: Которые ведут в статью энциклопедии якутия, откуда, собственно, был сгенерирован ответ. Он генерируется не из 1 источника. Это могут быть несколько статей, это могут быть контент из нашей электронной библиотеки. В общем, он собирает эту информацию.
20: Из верифицированных источников и делает такой органичный, хороший текст ответа. Вот энциклопедия якутия, и, собственно, мы можем пойти дальше и попасть в электронную библиотеку национальной библиотеки и поработать уже
21: С первичными текстами глубоко. Это точка входа во все наши, ну, определённое количество наших цифровых ресурсов. Ну, там у нас ещё есть пометки, да, Зелёная книжка, красная книжка, Зелёная книжка, это не защищено авторским
22: Правом, с краткой, с красной отметкой, к сожалению, вне стен библиотеки открываться не будет. В соответствии с гражданским кодексом, частью 4. Вот так выглядит наша электронная библиотека. Спасибо. Спасибо, Елена.
23: Так, следующее наше решение, оно касается наших читателей, вот как ведут себя читатели библиотеки, какие задачи они решают, какие операции они производят. Мы провели ряд так называемых Глубоких интервью, провели наблюдение за нашими Чита.
24: Подтвердили наши гипотезы и поняли, что наши читатели, мы, научная библиотека, приходят всегда с ноутбуками, с планшетами, конспектируем все пишем, ходим в google, подключаемся к вай фаю, ищем дополнительную информацию, когда мы
25: Разговаривали с нашими читателями. Оказалось, что очень важно быть в состоянии потока, да, чтобы не переключаться между различными приложениями, чтоб все у нас было в 1 окне, и все это у нас реализовано в рамках нашей читалки. Ну вот нам
26: Она показывает тот инструмент, который, ну, лично мне больше всего нравится. Мы можем прямо разговаривать с документом, посмотрим, как это все работает. Давайте она перейдём в электронную библиотеку. Вот так вот выглядит наша электронная библиотека.
27: Различный функционал тут у нас, но у нас есть возможность, допустим,
28: Какой-то термин там сложный или там какой-то не очень понятный оборот, мы тут же, не обращаясь к google или к другим поисковым системам, прямо тут же на экране, на странице с документом можем попросить и нам помочь, да.
29: Давайте дальше. Сейчас, значит, Анна нам показывает, что можем извлечь ключевые моменты, то есть сделать суммаризации то, что лмки делают очень хорошо. Все это может работать в масштабах документа, а также может работать в рамка.
30: Выделенного текста. Дальше. Значит, у нас, мы генерируем вопросы для самопроверки. Как мы усвоили материал студентам, аспирантам, преподавателям все это дело очень помогает. Понятно, что сгенерированные вопросы, они больше повторяться не будут. Да, есть такая
31: История, допустим, маленькая, мини контрольная школьных школах. И получается, что 1 класс мы опросили, a2 класс уже ответы знает, тут это так не сработает. Да, и также мы можем попросить искусственный интеллект объяснить нам текст.
32: Ну там, другими словами, простыми словами, как тьютер, мы работаем, то есть более такими словами пытаемся донести содержание документа. Так она дальше. У нас есть конспекты, тут же, значит, текстовый редактор ими
33: Можем делать конспекты, то есть копировать фрагменты текста, писать самим. Мы тут работаем с текстом, можем использовать несколько источников для того, чтобы создать наш конспект, и этот конспект у нас сохраняется в личном кабинет.
34: И всегда с нами путешествует, какие бы мы книги не открывали. Вот эта штука всегда будет с нами в режиме конспектирования. У нас тоже наш искусственный интеллект нас не покидает. Тут же мы можем работать с текстом конспекта.
35: Который, допустим, собран из различных источников или там ещё наш собственный авторский текст, мы это все тоже очень хорошо обрабатываем.
36: Да, генерируем вопросы, но тот же функционал, который относится и к полному тексту документов, он и реализован в рамках режима конспектирования. Можем сохранить, можем скачать и, соответственно, можем генерируем список использованной литературы. Вот все те,
37: Документы, с которых мы копировали сюда данные, те, собственно, источники тут и будут. И, соответственно, библиографическое описание полностью соответствует всем требованиям, которые предъявляются к такой работе. Да, вот она сейчас скачает, мы можем открыть в другом текстовом редактор.
38: Унести домой флешка, почта и дальше там продолжать работать.
39: Так, давайте к чату перейдём, Анна.
40: Какой движок, о чем движок?
41: Там внутри модель, которая, да, в общем, умная часть этой системы, это GigaChat гига, чат 2 0. Самая последняя модель. Тут мы, кстати говоря, спасибо за вопрос, Вадим, вот я же забыл упомянуть Сбер, вот Сберу, мы говорим огромное спасибо, все эти разра,
42: От у нас начались в 22 году, мы все это протестировали, попробовали, решили, что нам нужна отечественная большая языковая модель на рынке всего 2. Да, это яндекс и Сбер. Так случилось, что мы обратились к Сберу, сказали, вот, помогите, поддержите, они сказали, вот, вот вам
43: Доступ к гига чату. Ребята, покажите, на что способны. Вот вам токены не хватит. Типа вам ещё дадим за это им большое спасибо. Вот чат с документом, вот наша статья. И тут же мы уточняемся у нашего искусственного интеллекта. О чем, собственно,
44: Статья какие-то моменты бывают очень сложные статьи, технически, с большим количеством формул, да и прочее. Мы просто тут у него спрашиваем, и GigaChat нам, не уставая все это объясняет, объясняет пока мы это все не поймём, как это работает, значит, мы прово,
45: Небольшой, небольшую демонстрацию. И нам попался автор статьи, которая вот здесь была представлена, и он начал пользоваться этой системой, и в итоге сказал, что это очень перспективное дело. Ему позиционировали это как для студентов, аспирантов. Он говорит, нет.
46: Дователи смежных отраслей, другие учёные. Все это нам очень полезно будет. Поэтому мы считаем, что этот сервис обладает огромным потенциалом и принесёт большую пользу для развития науки, техники, да, образования. Вот таким вот образом это работает. Спасибо.
47: Anna национальная библиотека уделяет большое внимание сохранению и развитию Языков.
48: В нашей республике 2 государственных языка русский, якутский и 5 официальных Языков, значит, мы государственное учреждение и вносим свою лепту в развитие, сохранение этих Языков. Значит, есть проект, который у нас называ.
49: Мы можем это перевести, как слушайте, да, или слушай, на русский язык. В рамках электронной библиотеки у нас есть плеер и есть искусственный интеллект, который обучен на большом объёме датасета на Якутском языке и может генерировать
50: Аудио давайте, Анна, покажем модель обучена на мужском и женском голосах про dataset мы ещё поговорим вот читалки тоже да, в электронной библиотеке все у нас встроено, в электронную библиотеку наш читатель никуда не ходит, не переходит там на
51: Какие-то другие ссылки, вот у него текст, вот у него инструменты с поддержкой технологии искусственного интеллекта и все это проходит, скажем так, в 1 кухне как бы сразу
52: Да ну, здесь должен быть звук, но у Павла звука нет.
53: В общем, там есть звук, речь якутская.
54: Да, но можно прямо в читалку зайти, можно, можно джамботрона, наверное, перейти сразу. А вот здесь можно перейти, то есть аудиокниги без участия человека, допустим, для обучения язык.
55: Тоже, да, и мы знаем, что на данный момент GigaChat, ну, у них стоит такая задача, чтобы включить в эту языковую модель национальные языки субъектов Российской Федерации. То есть в скором времени GigaChat начнёт говорить на Якутском языке, в том числ,
56: И вот эти вот наши языковые сервисы, то, ну, то, что называется ттс, да, text to speech или стт, speech to text. Все это будет работать там.
57: Нет, тут, тут Сбера нет язык, они вам мощности нет такого бартера нет такого бартера нет, это государственная, ну, насколько я понимаю, это государственная задача. Да, я точно не знаю, включение национальных Языков. Нам просто сказали, что вот
58: К концу года мы планируем, если все пойдёт нормально, у вас будет якутский язык гига чате, у нас же естественный интерфейс вот взаимодействия между нами, да, между людьми, это же, ну, по большей части, наверное, вербальное общение, язык. А вот все эти клавиатуры
59: Мышки неудобные, искусственные инструменты ввода, видимо, в скором времени их не будет, раз мы устроены таким образом. И вот эти вот технологии, когда искусственный интеллект говорит или искусственный интеллект конспектирует то, что мы говорим. Вот так вот все это взаимо
60: Действие будет идти у нас звуком накладка. Да, у нас ноутбука звук не передаётся.
61: Все работает. Можете зайти из телефона, пройти по ссылке, послушать якутскую речь. Да, давайте на следующий наш инструмент тоже он касается Языков, он работает в обратную сторону. Если здесь искусственный интеллект читает вслух то, что написано, то вам
62: В рамках данного проекта искусственный интеллект переводит в текст нашу речь, да, опять-таки на Якутском языке точность распознавания достаточно хорошая, и чем-то, что тем, что мы особенно гордимся, это пунктуа.
63: Вот это вот сложный технический момент, когда мы говорим, искусственный интеллект должен предсказывать, здесь запятая будет, здесь будет вот такая вот такой знак будет стоять. Это тоже нашими разработчиками как бы реализовано и то, что хорошо работает, это не наше
64: Да, это мнение других разработчиков. А также оказалось, что представители средств массовой информации очень хорошо этим пользуются. Они постоянно ходят с диктофонами, оказывается, а потом вечером идут на работу и все это расшифровывают в текст, чтобы пошло, грубо говоря.
65: В данном случае все это делает искусственный интеллект. Давайте, Анна, посмотрим.
66: Угу. Ну, в данном в данном случае это telegram бот.
67: Мы в него говорим и получаем текст или можем даже не говорить. Допустим, если бы мы сейчас ввели запись нашей, нашего мероприятия, я говорил бы по-якутски, и мой доклад перевести в текстовый формат, мне бы
68: Никаких проблем, у нас накладка звуком, дорогие друзья, ссылка на telegram бот тоже имеется, если можно проверить носители якутского языка, можете там попробовать наговорить и получить результат.
69: Да, мы обрабатываем достаточно продолжительное аудио, то есть до часа включительно. Мы туда отправляем нашему искусственному интеллекту, и все это переводит в текст.
70: Так, она. Ага, спасибо. И давайте перейдём к
71: Главной главному моменту, без которого все это не будет работать ни в коем случае. Да, нам нужен большой объём данных. Нам нужны датасеты, чтобы мы могли обучить искусственный интеллект. Якутскому языку встаёт вопрос, а каким же образом эта? Да.
72: Собрать библиотеке, да, у нас много данных, но они текстовые, да, для подобных систем нам нужны аннотированные аудиозаписи, то есть кусочек текста и аудиофайл, который озвучивает этот текст, значит,
73: Для того чтобы собрать все эти, весь этот огромный датасет, разработан портал, который называется voice, точка с точка ру, совместная разработка арктического института культуры и национальной библиотеки республики саха якутия.
74: Идея очень простая. Ну, практически все якуты, да, саха, они говорят на Якутском языке такое есть. Значит, вот наши носители ходят, каким образом мы их вовлечём в дело сбора этого датасета. А давайте мы им
75: Оставим инструмент, в котором мы будем, библиотека будет заносить отрывки текста, а дело пользователей будет это дело зачитывать.
76: И таким образом мы соберём этот аннотированный датасет аннотированный аудиозапись, где у нас будет текст и где у нас будет озвучка этого текста. Принять участие в данном проекте может кто угодно, мы всем рады, никаких персональных.
77: Данных и прочих там не фигурирует искусственный интеллект, не будет говорить их голосами. Да, нам нужны паттерны, нам нужно просто вот понять скрытые взаимосвязи, которые существуют в нашем языке.
78: Ну, давайте вместо буду я комментировать, да, вот отрывок текста. Сейчас пользователь читает, потом он нажимает на кнопку остановить, ещё раз читает. Мы каждому пользователю предлагаем по 3 отрывка различной сложности. Вот он.
79: На это он нажимает, читает и отправляет на наш сервер. У нас все это сохраняется, но вы скажете, ну как же так, Борисов, ну там же, если кто угодно может этим пользоваться, то они же могут там наговорить всякого, да, и тогда получится, что и наш искусственный интеллект может говорить всякое там.
80: Текст будет не соответствовать аудио или аудио, не будет соответствовать тексту, какие-то шутки могут быть, чтобы решить эту проблему. У нас есть система вот оценки, да, то есть пользователи не только записывают свой текст, но они дают оценку аудио, кото
81: Которая была записана другими пользователями. Соответственно, потом разработчики в состав датасета включают данные, которые получили, ну, скажем так, больше всего лайков, да, мы их берём и обучаем наши системы якутскому языку.
82: Так, она, давайте дальше.
83: Это.
84: Наш гид, наш ассистент, который называется Максим. Да, ну, в скором времени, наверное, он превратится в maxima, это чат бот, опять-таки, который присутствует в мессенджерах. Мы хотели сделать так, чтобы любой пользователь
85: Мог общаться с библиотекой, как будто бы с живым человеком. Вот когда появились эти технологии. 1, о чем мы задумались, было вот такое вот решение, оно реализовано в рамках нашего цифрового библиотекаря. Он отвечает на вопросы фактографические касательно библиотек.
86: И предоставляет весь контент, который есть в нашей электронной библиотеке. Понятно, что здесь ещё встроена рекомендательная система. Это отдельные модели искусственного интеллекта. Если мы авторизировались, то система нам будет предлагать, да, какие
87: Исходя из того, что мы прочитали то, что мы откладывали на свою книжную полку, там много параметров, и с помощью них мы предсказываем достаточно точно. Давайте посмотрим, как работает. Тут звука нет, но звук здесь может быть, потому что с помощью
88: Ещё этого ассистента пользователь получает доступ к книгам, журналам, статьям 3 д объектам, оцифрованным аудио, видео в общем, все, что у нас есть.
89: Везде у нас есть вектора и эмбендинги, то есть искусственный интеллект понимает, о чем идёт речь. Он понимает смысл вопроса, который мы хотим ему задать. Где наш telegram? Telegram у нас? Да.
90: В общем, это может быть мессенджер Макс. Это может vk messenger, это может быть любое абсолютно цифровое решение, куда мы включаем нашего ассистента, можем с ним общаться как живым человеком, можем даже уточниться, где у нас
91: Буфет да, бывают такие вопросы база знаний, по которым отвечает наша система, она постоянно пополняется. У нас есть колл центр, у нас есть библиографы, которые обслуживают, и мы постоянно собираем наиболее часто задаваемые вопросы и eto используем для работы нашей системы.
92: Так, ну вот мы можем посмотреть новости самые актуальные оттуда же. В общем, история. Видимо, я, может быть, не прав, да, но, скорее всего, история с сайтами может уйти в прошлое, да, если такие интеллектуальные системы не появятс,
93: То вот таким вот образом, ну, тематические коллекции.
94: Весь контент, все, что есть в цифровых ресурсах национальной библиотеки, мы к нему получаем доступ с использованием естественного языка. То есть идея такая, что мы должны общаться как с человеком. Мы стремимся к этому.
95: И а, да, ещё тут должен упомянуть момент. Реализовано все это у нас в рамках telegram, мини апп, то есть мини приложений, да, то есть наш пользователь, когда он нажимает на ссылки, он не переходит на сайт национальной библиотеки. Все.
96: Это работает внутри мессенджера. Вот почему такой размер экрана, потому что адаптировано под телефоны, мы думали, ну и знаем, что это
97: Да, даже читалка, которую мы с вами смотрели, открывается также в рамках telegram мини апп, и все взаимодействие происходит здесь вот это вот есть настоящая точка входа. Читатель начинает отсюда общается с естественным языком на
98: Языке. Дальше уже попадает в читалку, дальше попадает в конспекты, дальше уже попадает во все наши ресурсы, как будто бы живой библиограф, да, который, ну, он, конечно, не сравнится с живым библиографом, но в какой-то мере такой маленький маленький библиограф, который, да, достаточно
99: Хорошо эту задачу.
100: Ну да, технически, значит, когда мы говорим про какие-то паттерны, смыслы, мы всегда говорим про бендинге, тут они везде, тут они везде вокруг пользователь нам что-то пишет, да, наша задача
101: Перевести это векторное представление и получить числа, которые соответствуют смыслу. Да, и каждую библиографическую запись мы можем таким же образом с помощью вот этого подхода перевести в определённую систему координат. Находим кластеры.
102: Вот, допустим, библиографические записи, которые объединены по какому-то внутренним связям, это 1 кластер пользователя мы также перевели в эту плоскость. Видим, что он рядом находится с какими-то точками, грубо говоря, да, их вместе собираем, обрабатываем. И таким образом здесь у нас
103: Получается, ну то, что касается ip Аппак глобал, да, то эти запросы он тоже может, ну то есть, говоря к каталогу он обращается через апишку, Аппак, да, ну иначе то никак, да, если я не ошибся, да, разработ.
104: Присутствует. Так, значит, экранизированные книги. Вот когда мы думаем, мы вот таким вот образом даём понять нашему пользователю. Сейчас читалка должна открыться, откроется потом просмотрщик 3 д объектов, если он уже не открылся, в общем, очень
105: Удобный такой сервис, очень хороший. И почему telegram бот? Потому что, ну, для разработки проще, да, во первых, мы, фронтенд, практически не разрабатываем. Во вторых, пользователям не надо скачивать. Особенно вот в текущих ситуациях, да, какие-то приложения, допустим, с каких-то
106: Все у нас вот таким вот образом работает, насколько я знаю, и читаю, и знаю, из сми, то Макс стремится тоже к такой же инфраструктуре, да, чтобы стать всеобъемлющим, чтобы там были хорошие боты, можно было разрабатывать на
107: Основе этого мессенджера, и все это легко и просто переедет туда.
108: Ну, это на самом деле быстро работает, да, у нас вот, кстати, вчера была авария, когда части вас не было, да, мы же далеко от материка, у нас магистральных линий то не так много. И вчера у нас случилась авария, и, собственно, весь Якутск остался с очень медленным интернетом. Такое не часто.
109: Но бывает, да, вроде как сегодня утром вроде было нормально, но, видимо, опять, ну вот, как бы так у нас работает. Так хорошо. Спасибо, Лена.
110: Она написана, ну, я не знаю, какие именно фреймворки там точно использованы. Да, это, в общем, история будет такая в 2016 году, когда вот сарглана Васильевна стала директором национальной библиотек.
111: Было принято решение пересмотреть цифровизацию во многих библиотеках же it отдел такой отдел, который системный администратор, да, поддержка мероприятий там и прочее. В 16 году it направление национальной библиотеки разделилось на 2 части. Вот 1 остались системные администраторы, а
112: Стали это разработчики, которые люди, которые с утра с 9 до 6 сидят и пишут код, да, даже больше, чем от 9 до 6. Да, бывает, что мы очень, очень много и часто кодим. У нас есть бэкенд, направление, серверная часть, фронтент, отдельно, у на
113: Есть у нас есть ui ux, у нас есть ml. То есть это такая маленькая айти компания библиотечная, внутри библиотеки, которая очень хорошо знает библиотеку и может это очень хорошо оцифровать. И Анна Григорьевна, сколько у нас человек, Анна Григорьевна?
114: 6, говорят, именно разработка. А само, да. А само направление айти лаборатория, человек 15. Ну, в общем, где-то так. 30, наверное, на всю электронную библиотеку, да, и ту.
115: Ещё сложилась такая история, что национальная ипотека стала кадром для it компаний. У нас здесь, ну, были, да, есть большие айти компании, и многие наши парни работают там, так, и каталогизация.
116: Значит, значит, искусственный интеллект формирует машиночитаемую библиографическую запись. У нас мы работаем на основе 2 источников. 1 мы называем веб архивирование об этом подробнее рассказано после этого мероприятия сразу, когда
117: Робот ищет в интернете статьи, которые подлежат веб архивированию, да, и предлагает уже это дело обработать. Сейчас мы с вами посмотрим, как мы работаем с традиционными документами. У нас времени уже не так много остаётся.
118: Электронный образ документа расшифровывается эоот это подход, который был внедрён национальной библиотекой во время коронавирусной инфекции когда каталогизаторы сидели дома, работали дистанционно, смысл такой мы оцифровываем не весь документ, а оцифровываем его фрагмент.
119: Которые нужны каталогизаторам, девизу, чтобы они могли создать каталожную запись, да, библиографическую запись, скажем так. Так, значит, мы сейчас в уде найдём документ, который
120: Мы каталогизируем, то есть создадим библиографическую запись.
121: Опа глобал формат русмарк коммуникативный.
122: Да, у нас как-то
123: У нас технические накладки, я вам клянусь да, вчера с медленным интернетом мы все это проверяли не раз. Сегодня утром мы это как бы проверяли ну цифровизация да. Da, вперёд.
124: Да, знакомая ситуация. Айтишникам привет. А у нас сервера, они распределённые. Вот наши партнёры, адики там стоят, у нас вычислительные сервера. Часть у нас стоит здесь, да, вот как бы.
125: Pdf давайте посмотрим образ документа, который мы сейчас будем обрабатывать, только быстро посмотрим да, у нас времени совсем мало сколько у нас здесь страниц 33 страницы, электронный образ документа, все, что нужно каталогизатору, чтобы сделать библиографическую запис.
126: Так, Ольга, ага, давайте вот у нас кнопка.
127: Мы её нажимаем.
128: И будет сгенерирована библиографическая запись это обычно на этом моменте я делаю так. 1, 2, 3 e. Запись уже готова, да, но.
129: Нет, нет, нет, все нормально по плану это так и должно быть. Я говорю, 1, 2, 3, когда мы говорим про web архивирование, то есть документы, которые изначально электронные, цифровые, да, то есть из сайтов, они берутся, и с ними искусственный интеллект работает быстро, но если мы говорим
130: Что он должен распознать вот этот pdf, определить, какие там моменты будут использованы в библиографической записи 33 страницы, все это занимает определённое время, но все равно они это делают быстрее, чем живой.
131: Человек, да.
132: Да, в общем, вот, да, по моему, да, запись, она готова.
133: Ну, тут, конечно, это да. Период может скакать туда сюда, но это очень быстро, гораздо в разы быстрее, чем делает живой человек. А дальше наш ценный специалист, эксперт уже от человека. Здесь нужна только экспертиза. Да, нужны его таланты, нужны его знания.
134: Нужен. Его, creative, техническую часть делает. И дальше мы проверяем, сверяем, если что надо, редактируем и пускаем в электронный каталог. Таким образом мы это можем пополнять очень быстро. Наш любимый аппа глобал и модуль.
135: Каталогизация, да, записали, все готово, все для читателей. Наша библиографическая запись уже доступна для других наших моделей искусственного интеллекта. Эта запись уже доступна. Таким образом, мы вот работаем именно про этот модуль, рассказывал Тимур.
136: В среду да, совместный проект с арктическим институтом, государственные библиографические указатели, статьи из газеты у нас есть такая штука.
137: Давайте сразу перейдём к демонстрации. Да, у нас почти нет времени.
138: Да, вот у нас там кнопка это параметры нашего указателя, который мы задаём. Какой год. Собственно, мы хотим за какой год мы делаем наш указатель, номер, период выборки статей, там дата каталогизации у нас будет
139: Нумерация статей на сквозная, поэтому мы тут можем указать, с какого номера мы
140: Гбу выходит 2 раза в месяц.
141: Угу. Ну понятно, что все эти параметры тоже нам можно автоматически все направлять в нашу систему, но вот для данной демонстрации у нас это работает. Так, выбираем ответ.
142: Но за выпуск составитель редактора. И сейчас машина, собственно, будет, пойдёт в наш Аппак глобал, в наши электронные каталоги будет искать соответствующие библиографические записи. Здесь мы
143: Можем ещё подредактировать, да? Ну давайте сразу попробуем импортировать.
144: Можем заморозить, чтобы никто там изменения не вводил.
145: Вот наш запрос, и он пошёл, ну вот, вот этот интерфейс, наверное, он выглядит не очень красиво на это внимание обращать не надо. Это административная панель национальной библиотеки с помощью
146: Этого интерфейса. Наши специалисты управляют всей деятельностью библиотеки. Обычно мы говорим, да, что мы управляем сайтами, там добавляем новости вроде этого. Но здесь управление осуществляется не только цифровым направлением библиотеки, а вообще в целом все наши и
147: Статистика и различные ограничения по фондам, генерация изображений для виртуальных выставок, подборок в электронной библиотеке. Да, все готово. У нас есть сколько записей мы нашли 201, по моему, запись. Дальше что мы
148: Делаем дальше. Мы проверяем эти записи, можем отправить каталогизатором на доработку, можем принять. Давайте сделаем вид, что мы все приняли, да, вот здесь вот, вот этими кнопками мы управляем. Все, давайте сверстаем.
149: Поработали мы, посмотрели, сказали, все нас устраивает. И хотим мы сегодня же, ну, через минуту, чтобы этот указатель появился в составе электронной библиотеки нашей, например, или хотим распечатать её.
150: Дать её отправить органам исполнительной власти, да, для кого мы делаем государственные библиографические указатели? Система наша сейчас подумает она автоматически у нас все распределит по, в соответствии с классификационными индексами удк и
151: По плану, как запланировано, ну, как обычно это у нас происходит, мы получаем готовый государственный библиографический указатель с дизайном, с вёрсткой и библиографическими записями, которые будут там, внутри.
152: Да, ну это у нас опять, а там у вас ещё была команда проиллюстрировать. Это чем вы иллюстрируете.
153: А иллюстрировать, а где была команда иллюстрировать?
154: Исключить, наверное, была команда. Нет, нет, ещё было. Ну, насколько увидели. Ладно, ага. Ну, мы у нас, я не уверен, что у нас, да, ну, давайте откроем. А вот у нас интернет очень медленный, видите, он скачивает этот world 1000 лет. Вот.
155: Да, именно самый важный момент такой вот у нас происходит вот наш указатель, собственно, вёрстка.
156: Да, и тут надо отметить, что мы также генерируем и вспомогательные указатели, да, давайте вниз девочек быстро мокнем. Да, вот именной географический, предметный. Да, все мы готовы, мы публи.
157: Наш указатель. Могли бы мы сейчас сказать, если б мы это делали, да? Так, следующий модуль.
158: Это были государственные библиографические указатели, а это вот универсальный модуль. То есть мы практически можем создавать любой указатель на любую тему, да, то, что есть.
159: У нас в электронном каталоге мы можем это вытащить в виде указателя. Давайте, Анна, быстренько попробуем продемонстрировать коллегам. Опять-таки наша административная панель, там очень много кнопок в начале там было всего 3 кнопки, потом больше стало, мы задаём
160: Как бы параметры, да, то, что мы хотим, какой указатель мы хотим
161: Понятно, что это можно было бы реализовать в виде кнопок, выпадающих меню, как мы это все раньше делали, но у нас здесь больше свободы, потому что у нас опять-таки искусственный интеллект и мы с ним можем вот таким вот образом разговаривать.
162: Ну, по поводу этого интернета, да, вот, вот мы у него спросили, вот он нам что-то предлагает, мы можем там уточнить, попросить.
163: Да, ну, про аюнского мы, да, про платона Алексеевича аюнского делаем указатель.
164: Ну, тут мы можем его поправлять, он нас будет вводить, указываем все параметры, которые нам нужны. Какие виды документов, хронологические рамки. Ну, в общем, все по нашей методике, традиционной библиографировании.
165: Все указали языки. Ну все, мы знаем эту методику универсальную. Опять же, это зависит научно вспомогательный, библиографический, рекомендательный. То есть от этого тоже все зависит. В общем, все указали. Ну вот примерно
166: Для демонстрации все создать указатель.
167: В принципе, можно.
168: Можно и структуру заранее указать, но в данном случае сейчас он сам будет структурировать, группировку, сам предложит.
169: Ну, это излишне, я думаю, все-таки группировку, структуру будем сами делать. Ну, если это большой крупный указатель, в принципе, заранее можно загрузить. Так вернее будет работать.
170: Так, ну вот уже на данном этапе, ну вот на таких поверхностных промта все уже биография, ранние годы, видите, структура уже готова. Давай самому.
171: Указателю?
172: Угу. Да, конечно. Угу.
173: Ольга Филь, Железногорск, илимский, иркутская область. Вы работаете в апаке, когда вы разрабатывали вот это все? Возникли ли у вас какие-то мысли? Ну, какие-то
174: Рекомендации для тех, кто работает в ирбисе.
175: Ну да, ну там, там, там без разницы, да, там разницы нет, да. Ну то есть наши ребята могут вам написать, и вы какие-то рекомендации им дадите, да?
176: Да, да, все, спасибо. Ну, можем, можем, конечно, тут ещё, ну, тут ещё такая фишка сейчас для демонстрации мы работаем только.
177: На электронном каталоге сейчас вот для демонстрации, а на самом деле перечень источников может быть разный, и то, что мы сами предложим, и то, что он сам найдёт как робот. И, в общем, все.
178: То, как мы хотим, опять же от вида библиографического указателя мы можем сами формировать тот перечень библиографических источников для выявления документов, и хронологические рамки, и все, и в общем,
179: Логически все проструктурировать.
180: Конечно, это, ещё раз говорю, демонстрация, а так настоящая работа, аналитическая и так далее. Естественно, это тоже будет занимать энное время, но рутинная вот наша работа, которая связана с переписыванием.
181: Новым библиограф. А, все, давай.
182: Ну, в общем, система нам вытащила те записи, которые она считает релевантными. Там внутри много проверок туда, сюда, да, и вот, но все равно конечное слово остаётся за человеком для специалиста. Вот, как уже
183: Сказала, мы здесь структуру можем поменять или можем попробовать его попросить его ещё раз сгенерировать. И, собственно, по этой структуре у нас будут раскиданы библиографические записи, которые мы нашли.
184: Запись успешно распределены по разделам, говорит нам система.
185: Угу.
186: Да, ну так как это не, не унифицированный указатель, да, не государственный библиографический указатель, поэтому здесь вёрстка может быть разная, поэтому мы её не предусмотрели. В принципе, там сгенерировать эту вёрстку тоже дело техники демонстрации сейча.
187: Угу. На маленьком объёме поработали из за того, что интернет слабый. Так, да, у нас сейчас, да, вот это вот последний продукт, который мы хотели вам сегодня показать. То есть пользовательские решения, решения, которые касаются Языков и решения, которые автомати,
188: Деятельность библиотеки, да, то есть внедрение искусственного интеллекта в библиотеке. Я забыл про датасет. Да, есть у нас такая платформа, мы её разработали и сейчас наполняем датасетами. Идея такая, что у библиотек огромное количество этих датасетов. Я уверен, что к вам разработчики приходят очень част
189: Да, я в этом полностью уверен. Они к нам приходят каждую неделю, им нужны датасеты, нужны наши данные, чтобы искусственный интеллект мог с этим вместе, ну, работать с нашими данными, обучаться. На них есть такая платформа зарубежная, очень хорошая. Называется Хагин фейс, куда разработчики складывают.
190: Модели и свои датасеты. У нас есть своя платформа, именно библиотечная, здесь будут верифицированные точные достоверные датасеты, которые собираются из фондов, из контента национальной библиотеки республики саха якутия 3.
191: Отражение, видео, тексты. Все это будет здесь. Таким образом мы надеемся, что внесём большой вклад в развитие технологий ии в Российской Федерации, республики саха якутия. Точно
192: Ага, вот как бы платформа, которой мы завершаем нашу презентацию.
193: Если есть вопросы.
194: У нас времени очень мало осталось, но если есть вопросы, мы можем на них, или мы уже на них ответили в ходе обсуждения, пока интернет тормозил.
195: Впервые за 43 года моей библиотечной деятельности карьеры я присутствую на презентации библиотеки, которая превосходит презентацию коммерческой компании.
196: Когда со мной стал координатор общаться по приезду, я подумал, что это, ну, какое-то, это коммерческая компания, какой-то аутсорс какой-то. Теперь я понял, что здесь это стандарт, это огромное спасибо вам. Вы первые сейчас в России.
197: Точно, спасибо.
198: Ага, коллеги тогда.
199: Так у нас ещё измени.
200: Ой, конечно, скажу.
201: Потрясение полное и счастье абсолютное, да, мы прорываемся на другой уровень, и мы сейчас уже видим, что нам нужно срочно пересматривать. Ой, нет, не все головы библиографические остались, и все это очень чётко
202: Ложиться в вечную совершенно библиографию, да, все смыслы наши те же. А вот руки, вот эти инструменты мы тоже уже начинаем, я уже у меня в голове крутится, все мы понимаем. Вот сейчас уже понятно, что нам менять
203: Только нужно сейчас это привести в систему вот эту новую логику Находки. Вот уже просто вот варится в котелочке, да, вот все это, мне кажется, мы быстро это сделаем, потому что это то, о чем мы по
204: Дельности мечтали и думали. И вот эта простота этих решений, логическая простота, да, точная вписанность в классическую библиографию. Вот это залог того, что это точно получится, это не
205: Переворачивает, не отменяет библиографию, а делает то, что библиография всегда умела в новой среде. То, что она умела, это такое огро, такое счастье. Коллеги, мы просто вот мы поняли, сейчас мы говорим понемножку, что библиография это жи,
206: Библиографы вымирают недооценённые, непонятые, загруженные чем угодно, кроме библиографии сейчас понятно, что мы прорвались вот просто за всех библиографов, а краеведов, библиографов, которые самые большие работяги на этом свете.
207: Да, те, кому больше всех нужно вечно, да. А вот нас всех поздравляю. Просто слушай, страна, что происходит? Да, все. Ура. Спасибо огромное. Якутским коллегам вы лучшие, вы просто лучшие.
208: Спасибо. Спасибо большое. Уважаемые гости, перед тем, как мы закончим отрывок, да, все-таки коллеги настаивают, что мы должны, ну, не доказать, а как показать, что дело было в интернете? Давайте быстро запустим.
209: Ага, якутская речь искусственный интеллект, говорит.
210: Якутские в рамках цифровых проектов национальной библиотеки. Всем большое спасибо, дорогие друзья.
211: На этом мы завершаем нашу презентацию.
212: Coffee break сколько? Ой, 11 уже. А сейчас сколько хорошо? В 11? Да, в 11 часов у нас начинается мастер класс по веб архивированию. Не
213: Забывайте, участники.