Проект: Всесоюзный научно-исследовательский институт слова  Публичный пост
17 августа 2026  14
Всесоюзный научно-исследовательский институт слова
https://vniislov.xyz/

Добро пожаловать во Всесоюзный научно-исследовательский институт слова! Мы ведём полную опись слов русского языка. Работа общественная, участвовать может каждый.

О себе

Всем привет! Меня зовут Нуриль, я фронтенд-разработчик (а может и фуллстак уже), работаю в мексиканском финтехе, люблю создавать небольшие проектики и не рассказывать о них. Обычно это что-то специфичное и нужное только мне, но я пытаюсь их выкладывать в общее пользование. Так вот, например, я сделал себе и друзьям конвертер валют, где можно смотреть сразу на четыре валюты на одном экране или Raycast-расширение для управления TorBox, а в Клубе я рассказал всего только про один проект и давненько, телеграм-бот популярный у жителей Индии.

О том, как появилась идея

Но вообще я давно хотел делать что-то не только полезное, но околополезное-весёлое, в хорошем смысле глупое. Меня всегда впечатлял Neal Fun, с его бесконечными идеями, eieio с его игровыми сайтами и списком всех возможных UUID v4,
и много других: индекс сложности икеи, рулетка районов Нью-Йорка, BlueSky-словарь.

Одним из последних проектов, который дотолкнул меня сделать что-то подобное был Word Research Inc. Я не придумал оригинальную идею и решил локализовать этот проект, но со своми нюансами. Так появился Всесоюзный научно-исследовательский институт слова (ВНИИСЛОВ), неофициальный филиал всемирной организации исследования слов Word Research Inc.

Об институте

В институте мы пытаемся обнаружить все слова русского языка. Конечно же, в шутку, потом что эти слова уже лежат в базе данных. Задача волонтёров записать как раз в картотеку все эти слова.

При вводе слова проверяется, искалось ли оно до этого, и если нет то, засчитываяется как новое открытие, а если да, то засчитываем повтор. Чтобы мотивировать волонтёров, каждые пять слов показываем приободряющее сообщение о серии новых слов подряд, или неодобряющее о серии уже обнаруженных.

За более значительный вклад в науку, институт выдаёт грамоту, подписанную рукой самого директора института, и присваивает звание. До пятидесяти открытых слов — внештатный сотрудник, больше — практикант, младший сотрудник и так далее, не буду раскрывать всю градацию.

Чтобы следить за прогрессом в институте есть раздел со сводкой, где можно посмотреть не только количество открытых слов, но и самые часто запрашиваемые слова, ваш вклад как волонтёра и скачать свою грамоту.

Шутники-волонтёры
Шутники-волонтёры

О времени и технологиях

Я использовал Claude Code, Opus 5, а на написанный им код я не слишком сильно обращал внимание. Зато обращал его дотошно на всё остальное.

Весь код писал Клод, я только задал технологические рамки: Astro 7 в режиме standalone и static output, страницы пререндерятся при сборке, и живут только две апи-ручки, а сам фронтенд написан на ванильном TypeScript без фреймворков. Для хранения словаря и находок используется SQlite через better-sqlite3, а волонтёрская личная статистика хранится в браузере. Шеринг-картинки и грамота рендерятся через canvas в браузере. Деплой через Github Actions на собственный VPS.

От перебора слов защищаемся, требуя proof of work. Перед отправкой браузер должен решить задачу: взять строку слово|время|номер, посчитать SHA-256, проверить начинается ли результат с четырёх нулей, если нет, то прибавить к номеру единицу и посчитать заново. Плюсом дополнительные защиты на сервере: свежесть отправленного PoW, защита от повтора, лимит на запросы.

Источниками для слов помог выбрать тоже Клод. Изначально это были словари OpenCorpora и hunspell, которые используются для проверки правописания в разных приложениях типа LibreOffice. Но волонтёры быстро упёрлись в то, что не могут внести в картотеку некоторые слова, например, страпонтен. Поэтому я намекнул Клоду, что пора выкачивать Викисловарь.

Сложность с русскими словами в том, что у них есть разные формы, и если с этим ничего не делать, то волонтёрам придётся искать около десяти миллионов слов. Поэтому мы решили всё же ограничиться леммами, что сократило словарь до двухсот пятидесяти тысяч слов. При этом для самого поиска этих лемм надо было оставить все формы, чтобы волонтёры могли вписывать любую форму слова, а мы засчитывали только начальную.

На Клоде была техническая часть с моим напуствием, а на мне были тексты, дизайн и любые идеи того, что должно быть. Я вайбкодил, но хотел, чтобы этого не ощущалось при использовании сайта. Для дизайна вдохновлялся чертежами, шрифт тоже взял чертёжный по ГОСТ 2.304-81.

Первую версию мы с Клодом сделали за один вечер, а в следующий вечер добивали идеями, чтобы отойти от оригинала.

О первых волонтёрах

Первые волонтёры были моя жена и близкие друзья, я скинул им ссылку, как только задеплоил проект. Потом я написал шуточный пост-анонс в свой маленький телеграм-канал, и запостил ссылку в свой крохотный твиттер. За несколько дней волонтёры обнаружили чуть больше тысячи слов и несколько скромных багов.

А сейчас вот рассказываю вам, возможно, кто-то из вас станет уважаемым сотрудником института и внесёт непомерный вклад в опись русского языка, а институт выдаст вам официальную грамоту!

О тратах и будущем

О будущем проекта я не думал, он в целом законченное произведение. Потратил я ровно два доллара, на покупку домена у PorkBun. Увидим через год, захочу ли я его продлевать.

А пока слежу за волонтёрской работой в переделанной читалке под автообновляемую сводку.

Связанные посты
Откомментируйте первым 👇

😎

Автор поста открыл его для большого интернета, но комментирование и движухи доступны только участникам Клуба

Что вообще здесь происходит?


Войти  или  Вступить в Клуб