Skip to content

Latest commit

 

History

299 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Neuromedia-VidBee

Рабочее пространство локальной медиа-библиотеки

Neuromedia-VidBee — русскоязычная продуктовая дистрибуция VidBee: открытого приложения для создания управляемой медиа-библиотеки из разрешённых видео-, аудиоматериалов и локальных файлов. Решение помогает скачать или импортировать материалы, получить локальную расшифровку, найти нужный фрагмент по словам или спикеру и подготовить конспект, перевод, FAQ либо другие результаты через выбранного AI-провайдера.

Проект основан на VidBee, распространяемом по лицензии MIT. Это не новый продукт «с нуля» и не официальный релиз upstream. Сведения об исходнике, ревизии и характере изменений — в ATTRIBUTION.md; исходный технический README сохранён в UPSTREAM_README.md.

Для каких задач подходит

Когда у команды много интервью, лекций, подкастов, демонстраций продукта, записей встреч или обучающих роликов, основной расход времени часто связан не с просмотром, а с поиском одного ответа, цитаты или решения. Neuromedia-VidBee собирает разрешённые материалы в контролируемую библиотеку и делает их содержимое доступным для поиска и последующей обработки.

Практические сценарии:

  • расшифровка интервью и быстрый переход к реплике по тайм-коду;
  • подготовка структуры лекции, заметок, FAQ и черновика публикации из собственной записи;
  • поиск решений, требований или упоминаний в архиве внутренних обучающих материалов;
  • импорт локальных видео и аудио для анализа без обязательной загрузки файла в облачный сервис распознавания;
  • ведение очереди разрешённых загрузок и RSS-подписок на собственные либо лицензированные источники;
  • перевод и сжатое резюме транскрипта через провайдера, которого организация выбирает сама.

Приложение не предназначено для обхода ограничений доступа, CAPTCHA, платных стен, аутентификации, антибот-защит или правил источников. Скачивайте и обрабатывайте только материалы, на которые у вас есть права, согласие либо явное разрешение.

Возможности

Локальная транскрибация и поиск

После импорта или завершения разрешённой загрузки можно запустить распознавание речи на своём компьютере. Upstream поддерживает семейства Whisper, SenseVoice, Parakeet и Qwen3-ASR; доступность конкретной модели зависит от сборки, аппаратных ресурсов и конфигурации. Расшифровка содержит временные метки, а при поддерживаемой конфигурации — метки спикеров. Поиск по словам и именам спикеров помогает открыть нужный участок записи без повторного просмотра всего файла. Транскрипт можно скопировать или экспортировать как обычный текст и Markdown.

AI-обработка под вашим контролем

Для конспекта, перевода, FAQ, исправления формулировок, извлечения статистики или собственных промптов подключается выбранный AI-провайдер. Проект поддерживает облачные и локальные варианты, включая OpenAI-совместимые точки доступа, Ollama и LM Studio. Важно понимать границу данных: локальная транскрибация остаётся на устройстве, но текст, отправленный в AI-запрос, получает именно выбранный провайдер. Перед корпоративным внедрением определите допустимые категории данных, правила хранения ключей и требования к персональным данным.

Очередь, RSS и организация библиотеки

Можно работать с отдельными материалами, очередями, плейлистами и RSS-подписками для разрешённых каналов. Настраиваются формат, имя файла, папка назначения, метаданные, субтитры и правила обработки новых элементов. Для команды полезно заранее определить владельца источника, лимит хранения, схему тегов и порядок ручной проверки автоматически добавленных материалов. Это снижает риск накопления нерелевантных файлов и облегчает аудит происхождения контента.

Web/API и self-hosted развёртывание

В upstream-monorepo присутствуют desktop-компоненты, web-клиент и API. Для серверного сценария используются контейнеры Docker Compose, выделенные persistent volumes для базы и медиаданных, а также ограничение доступа к интерфейсу на уровне сети или reverse proxy. Веб-интерфейс работает с файловой системой сервера, а не с браузером пользователя: продумайте права доступа, резервное копирование, шифрование хранилища и политику удаления материалов до запуска в организации.

Быстрый старт

Для разработки или оценки используйте требования и команды исходного проекта. В корне репозитория применяется pnpm:

git clone https://github.com/GeniusBotsLab/Neuromedia-VidBee.git
cd Neuromedia-VidBee
pnpm install
pnpm run start:web

Для контейнерного сценария upstream предоставляет базовую команду:

docker compose up -d --build

Перед первым запуском изучите UPSTREAM_README.md, структуру apps/ и актуальную документацию исходного проекта. Не публикуйте порты web/API напрямую в интернет без аутентификации, сетевых ограничений и контроля доступа. Переменные среды, cookie-файлы, ключи API, медиафайлы, расшифровки и SQLite-базы являются локальными операционными данными: храните их вне Git и не отправляйте в issue-трекер.

Рекомендованный процесс внедрения

  1. Определите законные источники. Зафиксируйте владельца контента, разрешённые URL/каналы, основания для скачивания и срок хранения.
  2. Выберите контур. Для одиночной работы подойдёт desktop-режим; для команды требуется изолированный сервер, роли доступа, резервное копирование и мониторинг объёма диска.
  3. Настройте обработку. Выберите локальную ASR-модель с учётом языка, точности и доступного CPU/GPU. Для AI-обработки выберите провайдера, совместимого с политикой данных.
  4. Проверьте пилот. Загрузите несколько собственных записей, оцените точность, разделение спикеров, поиск, экспорт и фактические затраты ресурсов.
  5. Включайте автоматизацию постепенно. RSS и правила очереди должны иметь лимиты, понятные фильтры и ручную проверку. Ошибка правила не должна бесконтрольно заполнять хранилище.

Интеграции и адаптация

Проект может быть основой для аккуратного медиапроцесса: интеграции с внутренними хранилищами, системой заявок, базой знаний, CRM или корпоративным AI-контуром. Любая интеграция должна проектироваться с минимальными правами доступа, аудитом, ограничением типов данных и понятным механизмом удаления. Не передавайте внешним сервисам транскрипты, содержащие персональные, коммерческие или иные чувствительные данные, пока это не разрешено вашей политикой и договорными условиями.

Лицензия, происхождение и безопасность

Исходный проект лицензирован по MIT; текст лицензии сохранён в LICENSE. Авторские уведомления и происхождение не удаляются. Эта дистрибуция не означает поддержку или одобрение со стороны авторов VidBee. Политика безопасного применения и канал для уязвимостей — в SECURITY.md. Подробности происхождения — в ATTRIBUTION.md.

Контакты TheBotsLab

Нужна автоматизация медиапроцесса, оценка внедрения, адаптация под работу команды или интеграция с существующими сервисами? TheBotsLab готов помочь разобраться с задачей, спроектировать безопасный контур, подключить нужные компоненты и сопровождать решение.

Контакты относятся к услугам TheBotsLab и не заменяют официальные каналы поддержки исходного проекта VidBee.

About

Русскоязычная продуктовая дистрибуция VidBee: локальная медиа-библиотека, транскрибация и AI-анализ с сохранением происхождения MIT.

Topics

Resources

Contributing

Security policy

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages