Публічний реєстр
Звіт про здоров'я програмного забезпеченнясхема 0.31.0 · метрики 2.10.0 · 2026-08-12 22:47 UTC

MaartenGr / BERTopic

Leveraging BERT and c-TF-IDF to create easily interpretable topics.

PythonMIT★ 7 782 зірки⑂ 917 форківз вер. 2020 р.Переглянути на GitHub ↗
ТипБібліотекаяк це визначено

MaartenGr/BERTopic має індекс здоров’я 87 зі 100, що відповідає смузі «Відмінний». Найвищий показник — Engineering Quality (94/100), найнижчий — AI Readiness (49/100). Останнє оновлення було 10 днів тому. Більшість нещодавньої роботи виконують 6 учасників.

87
загалом / 100
Відмінний

Індекс здоров'я програмного забезпечення

Метрики згруповано у зважені категорії на шкалі 1–100. Загальна оцінка починається як їхнє зважене середнє, відкаліброване за розподілом публічного реєстру, тож діапазони мають перцентильний зміст; коли публічні дані активують Політику юрисдикцій високого ризику, рейтинг коригується й отримує верхню межу 34 («У зоні ризику»).

87
Винятковий93-100Верхній щабель реєстру (≈ топ-5%); відповідає практично всім перевіреним критеріям
Відмінний80-92Сильний за всіма напрямами; незначні прогалини
Добрий65-79Здоровий; прогалини обмежені та керовані
Помірний50-64Прийнятний, але з помітними прогалинами; рекомендовано перевірку
Слабкий35-49Суттєві недоліки в кількох сферах
У зоні ризику20-34Суттєві слабкі місця; впровадження потребує обережності
Критичний1-19Серйозні проблеми (покинутий, єдиний мейнтейнер, без базової гігієни)
ЖиттєздатністьСпільнота тавпровадженняСталість таврядуванняІнженернаякістьБезпекаГотовність доШІ

Профіль оцінок

Кожна вісь — окрема категорія. Форма важить більше, ніж середнє: здоровий об'єкт заповнює всю фігуру, тоді як профіль із піками та провалами означає, що сила в одному вимірі маскує ризик в іншому.

Зважений загальний бал 73 калібровано до 87 за шкалою опублікованого індексу (калібрування реєстру 2026-08-02).

Власність

Maarten GrootendorstОсобистий обліковий запис
2 946 підписників33 публічні репозиторіїз лют. 2017 р.@google-deepmind

Цей репозиторій належить особистому обліковому запису. Проєкт з єдиним власником несе більший ризик безперервності, ніж підтримуваний організацією.

Пакетні екосистеми

РеєстрПакетВерсіяЗавантажень / місВерсіїОстання публікаціяТеги
PyPIbertopic0.17.4-43252 дні томуnlpberttopicmodelingembeddings

Метрики за категоріями

Життєздатність

Чи живий проєкт — чи пишеться код і чи виходять релізи?

56Помірний · 21% загального індексу
Як обчислюється оцінка
28.8/36Свіжість pushостанній push 10 дн. тому
5.5/36Ритм комітів8/52 тижнів із комітами
11.5/18Обсяг комітів18 комітів за останній рік
0/10OpenSSF Scorecard: Maintained0 commit(s) and 0 issue activity found in the last 90 days -- score normalized to 0
Використані вхідні дані
commits_last_year18
human_commit_share1
days_since_last_push10
active_weeks_last_year8
Як обчислюється оцінка
27/27Випускає релізиопубліковано 37 релізів
16.2/36Свіжість релізівостанній реліз 252 дн. тому
19.8/27Ритм релізівреліз кожні ~102 дн.
0/10OpenSSF Scorecard: Signed-Releasesнемає даних
Використані вхідні дані
releases_count37
latest_release_tagv0.17.4
releases_from_tagsні
days_since_latest_release252
mean_days_between_releases102
Виключено з оцінювання (немає даних або не застосовно): OpenSSF Scorecard: Signed-Releases. Залишкові ваги перенормовано.

Спільнота та впровадження

Чи має проєкт користувачів, завантаження, увагу та влаштовані умови для контриб’юторів?

86Відмінний · 17% загального індексу
Як обчислюється оцінка
60/60Зірки7 782 зірок
24.7/25Форки917 форків
9.6/15Спостерігачі55 спостерігачів
Використані вхідні дані
forks917
stars7 782
watchers55
growth_stateunverified
growth_factor_pct100
growth_unverified_reasonno_history
Як обчислюється оцінка
22.5/22.5README
22.5/22.5Ліцензіявизнана ліцензія (MIT)
18/18Настанови CONTRIBUTING
0/13.5Кодекс поведінки
0/7.2Шаблон issue
6.3/6.3Шаблон PR
Використані вхідні дані
has_readmeтак
has_licenseтак
readme_badges7
has_contributingтак
has_issue_templateні
has_code_of_conductні
readme_badge_servicesshields.io
has_pull_request_templateтак

Сталість та врядування

Чи переживе проєкт своїх людей — бас-фактор, реактивність, хто за ним стоїть і як супроводжуються пакети?

78Добрий · 23% загального індексу
Як обчислюється оцінка
48.6/54Бас-факторна 6 контриб’ютор(ів) припадає половина всіх комітів
14.9/22.5Розподіл комітівголовний контриб’ютор — автор 34% комітів
13.5/13.5Широта контриб’юторів91 контриб’юторів
10/10OpenSSF Scorecard: Contributorsproject has 3 contributing companies or organizations -- score normalized to 10
Використані вхідні дані
bus_factor6
contributors_sampled91
top_contributor_share0,337
Як обчислюється оцінка
31.9/42Вирішення issueзакрито 76% issue
22.1/30Прийняття PRзлито 194/263 вирішених PR
0/13Newcomer PR acceptanceзлито 0/12 PR від новачків за 30 дн.
9/15OpenSSF Scorecard: Code-ReviewFound 20/30 approved changesets -- score normalized to 6
Використані вхідні дані
merged_prs194
open_issues437
closed_issues1 384
prs_merged_7d0
prs_decided_7d0
prs_merged_30d0
prs_decided_30d12
issue_closed_ratio0,76
closed_unmerged_prs69
first_time_authors_30d1
first_time_prs_merged_30d0
first_time_prs_decided_30d12
Як обчислюється оцінка
10/30Підтримка власникаособистий (користувацький) обліковий запис
0/20Верифікований доменне застосовно до користувацьких облікових записів
24.9/25Охоплення власника2 946 підписників у MaartenGr
23.2/25Послужний список33 публічних репозиторіїв, вік облікового запису ~9 р.
Використані вхідні дані
followers2 946
owner_typeUser
is_verified
owner_loginMaartenGr
public_repos33
account_age_days3 467
Виключено з оцінювання (немає даних або не застосовно): Верифікований домен. Залишкові ваги перенормовано.
Як обчислюється оцінка
25/25Опубліковано й доступно1 пакет(ів) у pypi
26/35Свіжість публікаційостання публікація 252 дн. тому
20/20Історія версій43 опублікованих версій
20/20Не застарілийактивний, не deprecated і не yanked
Використані вхідні дані
packagesbertopic
ecosystemspypi
any_deprecatedні
min_days_since_publish252

Інженерна якість

Чи наявні базові інженерні практики та документація?

94Винятковий · 19% загального індексу
Як обчислюється оцінка
24/24Процеси CI1 процес(ів) CI
24/24Наявні тести
16/16Конфігурація лінтера
9.6/9.6Pre-commit-хуки
0/6.4.editorconfig
16/20OpenSSF Scorecard: CI-Tests22 out of 25 merged PRs checked by a CI test -- score normalized to 8
Використані вхідні дані
has_ciтак
has_testsтак
has_editorconfigні
has_linter_configтак
has_precommit_configтак

Документація

100Винятковий
Як обчислюється оцінка
30/30README
25/25Каталог документації
15/15Сайт документації / домашня сторінкаhttps://maartengr.github.io/BERTopic/
10/10Опис репозиторію
10/10Теми10 тем
10/10Wiki
Використані вхідні дані
topicsbert, transformers, topic-modeling, sentence-embeddings, nlp, machine-learning, topic, ldavis, topic-modelling, topic-models
has_wikiтак
homepagehttps://maartengr.github.io/BERTopic/
docs_sitehttps://maartengr.github.io/BERTopic/
has_readmeтак
has_docs_dirтак
has_descriptionтак

Безпека

Чи міцні видимі практики безпеки й ланцюга постачання, без непослабленої пов’язаності з юрисдикціями високого ризику?

53Помірний · 16% загального індексу

Стан безпеки

41Слабкий
Як обчислюється оцінка
7.5/7.5Binary-Artifactsno binaries found in the repo
0/7.5Branch-Protectionbranch protection not enabled on development/release branches
2/2.5CI-Tests22 out of 25 merged PRs checked by a CI test -- score normalized to 8
0/2.5CII-Best-Practicesno effort to earn an OpenSSF best practices badge detected
4.5/7.5Code-ReviewFound 20/30 approved changesets -- score normalized to 6
2.5/2.5Contributorsproject has 3 contributing companies or organizations -- score normalized to 10
10/10Dangerous-Workflowno dangerous workflow patterns detected
0/7.5Dependency-Update-Toolno update tool detected
0/5Fuzzingproject is not fuzzed
2.5/2.5Ліцензіяlicense file detected
0/7.5Maintained0 commit(s) and 0 issue activity found in the last 90 days -- score normalized to 0
0/5Packagingнемає даних
1.5/5Pinned-Dependenciesdependency not pinned by hash detected -- score normalized to 3
0/5SASTSAST tool is not run on all commits -- score normalized to 0
0/5Security-Policysecurity policy file not detected
0/7.5Signed-Releasesнемає даних
0/7.5Token-Permissionsdetected GitHub workflow tokens with excessive permissions
7.5/7.5Vulnerabilities0 existing vulnerabilities detected
Використані вхідні дані
sourceopenssf_scorecard
checks_evaluated16
scorecard_versionv5.5.0
checks_inconclusive2
scorecard_aggregate4,1
Виключено з оцінювання (немає даних або не застосовно): Packaging, Signed-Releases. Залишкові ваги перенормовано.
Як обчислюється оцінка
35/35Прямі залежності без відомих сповіщеньжодна пряма залежність не має відомих сповіщень
25/25Непрямі залежності без відомих сповіщеньжодна непряма залежність не має відомих сповіщень
0/40Немає задавнених сповіщеньжодне сповіщення не має дати публікації
Використані вхідні дані
sourceosv
advisories0
affected_packages0
assessed_packages43
unassessed_packages0
affected_by_severitynone
direct_affected_packages0
Виключено з оцінювання (немає даних або не застосовно): Немає задавнених сповіщень. Залишкові ваги перенормовано. Звірено з runtime-замиканням залежностей pypi:bertopic@0.17.4 — тим, що тягне за собою встановлення опублікованого пакета, — 43 пакетів. Досяжність не аналізується.

Готовність до ШІ

Наскільки репозиторій оснащений для розробки та супроводу за участі ШІ-агентів? Має свідомо малу вагу (4%): агентний інструментарій — реальний сигнал супроводу, але репозиторій без нього все одно може отримати 100/100.

49Слабкий · 4% загального індексу
Як обчислюється оцінка
0/45Інструкції для агентівнемає CLAUDE.md / AGENTS.md / правил редактора
0/15Машиночитана документація (llms.txt)
40/40Читабельна історія комітівнамір зазначено у 87 з 100 людських комітів (структурований заголовок або пояснювальний текст)
Використані вхідні дані
has_llms_txtні
llms_txt_url
legible_history_share0,87
agent_instruction_files
agent_instruction_max_bytes
Як обчислюється оцінка
18/18Розгортання однією командоюMakefile
22/22Автоматизовані тести
11/11Конфігурація лінтера / форматера
0/11Статична перевірка типів
0/10Відтворюване середовище
0/10Підтверджена практика роботи з агентамисеред останніх 100 комітів немає створених агентом
0/8Автоматизоване супроводженняавтоматичних оновлень залежностей не виявлено
3/10OpenSSF Scorecard: Pinned-Dependenciesdependency not pinned by hash detected -- score normalized to 3
Використані вхідні дані
has_nixні
has_testsтак
lockfiles
has_dockerfileні
typed_languageні
bootstrap_filesMakefile
has_devcontainerні
has_linter_configтак
typecheck_configs
agent_commit_share0
toolchain_manifests
dependency_bot_commit_share0
Як обчислюється оцінка
0/45Типізований кодPython без конфігурації перевірки типів
54.4/55Керовані розміри файлів1/87 файлів вихідного коду понад 60 КБ
Використані вхідні дані
primary_languagePython
largest_source_bytes226 981
source_files_sampled87
oversized_source_files1

Ключові факти

7 782зірок GitHub
91контриб'юторів
18комітів за останні 12 місяців
10днів від останнього пушу
37релізів
6бас-фактор
437відкритих issue
PyPIпакетних екосистем

Попередження щодо збору даних

  • Star history unavailable: GitHub GraphQL error: Resource not accessible by personal access token
  • GitHub dependency-graph SBOM unavailable (404); the dependency graph may be disabled for this repository

Докладніше

Історія зірок і форків 0 ★ / 917 ⇿
0Зірки
917Форки
34Релізи

Коли додано кожну зірку й форк — зібрано з GitHub і згруповано за днями. Кумулятивне зростання розміщено просто над денними додаваннями, з яких воно складається, тож їх видно одне проти одного: рівномірне органічне накопичення виглядає зовсім інакше, ніж різкий короткочасний сплеск. Там, де цю різницю можна виміряти, її подано як автентичність росту.

02004006008001 000911182020-102023-092026-08
Мажорні 0Мінорні 15Патчі 19

Кожна точка охоплює 6 днів.

OpenSSF Scorecard 4.1 / 10
4.1сукупно

Незалежна, не прив'язана до інструментів оцінка безпеки від відкритого проєкту OpenSSF Scorecard. Кожна перевірка винагороджує практику безпеки, а не інструмент конкретного постачальника. Перевірки, які Scorecard не зміг визначити, позначено н/д і виключено з оцінки безпеки (вони ніколи не зараховуються як нуль).Scorecard v5.5.0 · 2026-08-12 22:47 UTC

10Binary-Artifactsno binaries found in the repo
0Branch-Protectionbranch protection not enabled on development/release branches
8CI-Tests22 out of 25 merged PRs checked by a CI test -- score normalized to 8
0CII-Best-Practicesno effort to earn an OpenSSF best practices badge detected
6Code-ReviewFound 20/30 approved changesets -- score normalized to 6
10Contributorsproject has 3 contributing companies or organizations -- score normalized to 10
10Dangerous-Workflowno dangerous workflow patterns detected
0Dependency-Update-Toolno update tool detected
0Fuzzingproject is not fuzzed
10Licenselicense file detected
0Maintained0 commit(s) and 0 issue activity found in the last 90 days -- score normalized to 0
н/дPackagingpackaging workflow not detected
3Pinned-Dependenciesdependency not pinned by hash detected -- score normalized to 3
0SASTSAST tool is not run on all commits -- score normalized to 0
0Security-Policysecurity policy file not detected
н/дSigned-Releasesno releases found
0Token-Permissionsdetected GitHub workflow tokens with excessive permissions
10Vulnerabilities0 existing vulnerabilities detected
Прямі залежності 9
РеєстрПакетОбмеження версіїМаніфест
PyPIhdbscan>=0.8.29pyproject.toml
PyPIumap-learn>=0.5.0pyproject.toml
PyPInumpy>=1.20.0pyproject.toml
PyPIpandas>=1.1.5pyproject.toml
PyPIplotly>=4.7.0pyproject.toml
PyPIscikit-learn>=1.0pyproject.toml
PyPIsentence-transformers>=0.4.1pyproject.toml
PyPItqdm>=4.41.1pyproject.toml
PyPIllvmlite>0.36.0pyproject.toml
Усі залежності не зібрано

Не вдалося зібрати розв'язаний набір залежностей для цього звіту: GitHub dependency-graph SBOM unavailable (404); the dependency graph may be disabled for this repository

Сповіщення про залежності 0

Встановлення pypi:bertopic@0.17.4 тягне 43 пакетів, прямих і транзитивних: 0 мають відомі сповіщення, з них 0 — прямі залежності.

Жодне відоме сповіщення не стосується оцінених залежностей.

Сповіщення означає, що версія, записана в графі залежностей, потрапляє в уражений діапазон. Досяжність не аналізується, а граф містить піниї розробки й тестування — знахідка може стосуватися інструментів, а не поставленого коду.

Звіт у форматі JSON машиночитний

Зворотний зв’язок

Помітили щось хибне у цьому звіті або маєте чим поділитися? Неправильні вимірювання, непомічені інструменти, ідеї, запитання — усе доречно. Кожне повідомлення читається й отримує відповідь.

Повідомлення збережеться під час входу.

Оцінки — це сигнали, а не гарантії. Вони відображають публічно видимі практики на GitHub — це не аудит коду й не гарантія безпеки.

Відсутні дані виключаються, а ваги перенормовуються — нуль за відсутність ніколи не ставиться. Методологія версіонована й відкрита: метрики v2.10.0, схема v0.31.0 — повна методологія · вікі метрик.

Як окремий результат виглядає на тлі всього реєстру: сукупна статистикаPyPI.