Помощь
Работа с платформой, права ролей и методика анализа русского и башкирского текста.
Войдите в систему
Гостям доступны словарь, статистика, команда и публикации. Для работы с документами используйте выданный логин и временный пароль.
Загрузите материал
Выберите тип текста, язык или автоматическое определение и загрузите TXT, PDF, DOCX либо RTF.
Получите результат
После анализа откройте показатели, частоты и графики, затем выгрузите научный отчёт.
Как материалы попадают в корпус
Новые материалы обычных пользователей и авторов получают статус ожидания и не влияют на публичную статистику до проверки. После подтверждения надёжность становится равной 1, а данные включаются в частотный словарь и накопительные показатели.
Удаление документа из рабочей области сохраняет оригинал в архиве для будущих исследований. Физическое удаление архивных файлов доступно только административным ролям.
Работа автора
- Откройте «Настройки → Авторы» и заполните только собственный профессиональный профиль.
- Загрузите фотографию, укажите организацию, должность, ORCID и контакты.
- В «Публикациях» добавляйте работы только от своего профиля и редактируйте связанные с вами записи.
- В «Письмах» обрабатывайте обращения, направленные именно вам.
- В «Новых документах» просматривайте только материалы своей учётной записи и их статус модерации.
Работа пользователя
- Загрузите документ в разделе «Документы».
- Проверьте выбранный тип текста и режим определения языка.
- Для сканированного PDF запустите OCR и дождитесь завершения.
- Запустите анализ, изучите показатели и скачайте результат.
- Удаляйте только собственные документы; оригинал сохранится в архиве.
Слова, слоги и структурные единицы
Слова выделяются с сохранением внутренних дефисов и апострофов; однобуквенные токены исключаются. Число слогов определяется по количеству гласных. Для обычных текстов учитываются предложения, для стихов — непустые строки, а для типа «Словарь» — словарные статьи и только слова, полностью состоящие из заглавных букв.
а ә б в г ғ д ҙ е ё ж з и й к ҡ л м н ң о ө п р с ҫ т у ү ф х һ ц ч ш щ ъ ы ь э ю я
Русский, башкирский и смешанный текст
Документ делится на смысловые блоки. Для каждого блока сопоставляются специфические башкирские буквы, частотные служебные слова, словарные источники и символьные n-граммы. Соседние блоки сглаживают одиночные неуверенные решения. Если оба языка занимают существенную часть уверенно распознанных блоков, документ помечается как смешанный.
В словаре язык и вероятность сохраняются для каждой словоформы. Для OCR вероятность следует оценивать осторожно: русская модель может заменять специфические башкирские буквы.