Editly

Лічильник слів і аналізатор тексту

Вставте текст — і цифри почнуть рухатися просто під час набору: слова, символи, речення, час читання, читабельність. Усе працює всередині цієї вкладки, тож написане залишається на вашому комп'ютері. Без реєстрації, без завантаження на сервер, без обмежень на обсяг.

0
Кількість слів
0
Кількість речень
0
З пробілами
0
Без пробілів
0
Кількість абзаців
0
Унікальні слова
0%

Text Analysis

Час читання
< 1 хв читання
Час мовлення
< 1 хв
Сер. довжина слова
0
Читабельність
Н/Д
Легкість читання
Н/Д
Функції:

Трекер цілей

Ліміти соцмереж
Власна ціль
Довжина фрази

Навіщо вам цей лічильник слів і символів?

Більшість лічильників видають число — і на цьому все. Цей пояснює, що воно означає: скільки текст звучатиме вголос, які слова ви повторюєте частіше, ніж вам здається, і чи не розрослися ваші речення до непристойної довжини.

Рахує під час набору Кнопки «Порахувати» немає, бо надсилати нема чого. Кожен показник перераховується з кожним натисканням клавіші й не відстає навіть на рукописі в 100 000 слів.

Не лише англійська Межі слів визначає вбудований у браузер Intl.Segmenter, тому українська, арабська, японська та китайська розбираються коректно, а не ріжуться по пробілах.

Текст не залишає вкладку Жодного завантаження на сервер і жодного запиту до API. Якщо волієте перевірити, а не вірити на слово, — відкрийте DevTools, увімкніть вкладку Network і вставте текст.

Як користуватися цим лічильником слів

1

Вставте або наберіть текст у полі вгорі сторінки. Кнопки «Порахувати» немає, як немає й перезавантаження сторінки, бо нікуди нічого не відправляється для обчислення. Рядок статистики над полем оживає з першого ж натискання клавіші й далі встигає за вами — що на короткому дописі, що на дисертації.

2

Панель інструментів над полем допоможе причесати текст перед підрахунком. Вона прибирає пробіли на початку й у кінці, стискає повтори пробілів, прибирає зайві переноси рядків, копіює все до буфера обміну й запускає «Пошук і заміну» будь-якою абеткою. Нічого з цього не є незворотним: скасування та повтор тримають 50 останніх станів, а Ctrl+Z чи Cmd+Z поводяться саме так, як ви очікуєте.

3

Верхній рядок показує основне — слова, речення, символи з пробілами й без них, абзаци, унікальні слова. Під полем з'являються час читання, час мовлення, середня довжина слова, рівень складності за Флешем-Кінкейдом і бал легкості читання Флеша. Усе це перераховується з того тексту, який зараз у полі, тож жодне число не встигає застаріти, поки ви редагуєте.

4

Чипи під рядком аналізу вмикають і вимикають додаткові панелі. «Трекер цілей» звіряє довжину з лімітами платформ — від допису на 280 символів до мета-опису на 160. «Аналіз речень» показує найкоротше, найдовше й середнє речення. «Якість тексту» ловить здвоєні слова й перелічує найдовшу лексику. «Щільність ключових слів» ранжує ваші терміни. «Порівняння текстів» зіставляє дві чернетки слово за словом. Увімкнене запам'ятається до наступного візиту, а дві кнопки експорту збережуть поточну статистику у файл .txt або .csv.

Часті запитання

Як працює наш алгоритм

Кожне число на цій сторінці обчислюється у вашому браузері, з тексту в полі, після кожного натискання клавіші. Нижче — що саме робить кожне з них, разом із задіяними API та шаблонами, щоб ви могли оцінити, чи означає число те, що вам потрібно, перш ніж на нього покладатися.

1

Визначення слів

Слова дає Intl.Segmenter, створений із гранулярністю 'word', з якого лишаються тільки ті сегменти, що API позначив як словоподібні. Це браузерна реалізація алгоритму сегментації тексту Unicode — саме тому "don't" лишається одним словом, а китайський чи японський текст ділиться на справжні слова, а не на низку ієрогліфів. Звідси ж випливає, що дефіс розриває слово, тому "state-of-the-art" — це чотири, і що емодзі пропускаються взагалі, бо Unicode не вважає їх словоподібними. Там, де Intl.Segmenter недоступний — скажімо, на старішому Node або на сервері зі скороченим ICU, — код відкочується до /\p+/gu, це Unicode-обізнаний збіг із послідовностями літер, якого вистачає для абеткових систем письма, але замало для сегментації китайської та японської.

2

Визначення речень

Речення знаходяться поділом за /[.!?]+(\s

3

Бали читабельності

Два бали за Флешем, обидва спираються на одну й ту саму оцінку складів. Рівень складності відповідає рокам навчання в американській школі. Легкість читання йде від 0 до 100, де більше означає простіше, і затискається в цей діапазон, перш ніж отримати словесну позначку. Лічильник складів обходиться без словника: переводить слово в нижній регістр, прибирає не-літери, повертає 1 для всього завдовжки до трьох літер, знімає німе "ed" чи кінцеве німе "e", ігнорує "y" на початку, а тоді рахує групи голосних по одній–три літери й ніколи не повертає менше за 1. Надійно на звичайній англійській прозі, ненадійно на іменах і запозиченнях.

Рівень = 0,39 × (слова ÷ речення) + 11,8 × (склади ÷ слова) − 15,59
4

Час читання та мовлення

Час читання — це кількість слів, поділена на 200 і округлена вгору; час мовлення ділить на 130. Обидві цифри навмисно округлі. 200 слів за хвилину — обережна оцінка швидкості читання про себе, а опубліковані метааналізи ставлять англійську нехудожню прозу дещо вище, тож сприймайте оцінку читання радше як комфортну верхню межу, ніж як секундомір. 130 — це темп виступу, помітно повільніший за 150 із гаком, які більшість видає в розмові, бо читати на залу означає робити паузи, наголошувати й час від часу губити рядок. Якщо ваш власний темп інший, інструмент «Слова у хвилини» приймає власне значення.

часЧитання = ⌈ слова ÷ 200 ⌉ хв
5

Щільність ключових слів

Панель на цій сторінці переводить кожне слово в нижній регістр, зрізає все, що не літера, відкидає вбудований список англійських стоп-слів разом із усім коротшим за три символи, рахує решту в Map, сортує за частотою й показує десятку найчастіших разом із часткою кожного терміна від загалу. Один прохід текстом, тому на довгих документах це лишається дешевим. Окремий інструмент «Щільність ключів» іде далі: дво- і трислівні фрази, вимикач стоп-слів під вашим контролем і до 2000 рядків — усе це рахується у Web Worker, тож інтерфейс ніде не застрягає.

6

Унікальні слова та багатство лексики

Кожен словоподібний сегмент переводиться в нижній регістр і проштовхується через Set; розмір цього Set і є кількістю унікальних слів, а ділення його на загал дає багатство лексики. Дві речі варто знати, перш ніж вичитувати з цього числа забагато. Показник падає з довжиною тексту, бо службові слова повторюються незалежно від того, наскільки різноманітно ви пишете, тож порівнювати анотацію на 300 слів із розділом на 5000 майже безглуздо. І словоформи рахуються окремо: «біг», «біжить» і «бігти» — це тут три різні слова.

Ключові терміни

Стоп-слова
Сполучна тканина речення: і, на, що, в, до. Це найчастотніші слова майже в будь-якому тексті, а тому цілком непридатні, щоб зрозуміти, про що той текст, — саме тому підрахунок ключів відкидає їх ще до ранжування.
Склад
Один такт вимови. В "algorithm" їх чотири: al-go-rith-m. Обидва бали Флеша тримаються на цьому підрахунку — тому інструмент без словника вимови може їх лише наближено оцінити.
Легкість читання за Флешем
Бал від 0 до 100, де більше означає простіше. 60–70 — звичайна зрозуміла мова, 90 і вище — дитяча книжка, менше за 30 — договір або наукова стаття.
Багатство лексики
Унікальні слова, поділені на загальну кількість, у відсотках. 70% означає, що сім слів із кожних десяти різні. Показник неухильно падає з довжиною тексту, тож має сенс лише тоді, коли ви порівнюєте тексти схожого обсягу.

Розуміння статистики тексту

Кожна метрика пояснена — щоб ви точно знали, що вимірюєте і навіщо це потрібно.

Кількість слів

Підраховує словоподібні сегменти через вбудований у браузер Intl.Segmenter, який виконує правила сегментації Unicode, а не просто ріже текст по пробілах. Скорочення лишаються цілими, китайська та японська отримують справжні межі слів, а слова з дефісом розпадаються — тому "state-of-the-art" рахується як чотири. Microsoft Word рахує його як одне, і це варто знати, якщо ліміт перевіряють саме там.

Кількість речень

Ділить текст на крапках, знаках оклику та питання, після яких є пробіл або кінець тексту. Допомагає перевірити, чи складається ваш текст із достатньої кількості завершених думок, і використовується для розрахунку показників читабельності.

Символи з пробілами

«Сира» довжина тексту з усіма пробілами й переносами рядків. Рахує так, як рахує JavaScript — у кодових одиницях UTF-16, тому одне емодзі додає 2, а сімейне — аж 8. Соцмережі накладають поверх цього власні ваги, тож сприймайте число як близький орієнтир, а не точний збіг з їхнім лічильником.

Символи без пробілів

Кількість символів після видалення всіх пробілів. Корисно при порівнянні фактичного обсягу двох текстів або коли видавець стягує плату за символ набраного тексту.

Кількість абзаців

Підраховує непорожні блоки, розділені переносами рядків, тож один Enter уже починає новий абзац, а кілька порожніх рядків поспіль не роздувають лічильник. Зручно стежити за структурою: у статті для вебу абзаци зазвичай тримають по 3–5 речень.

Унікальні слова та словниковий запас

Підраховує окремі слова у нижньому регістрі після видалення пунктуації. Відсоток (словниковий запас) — це унікальні слова ÷ загальна кількість слів × 100. Вищий відсоток означає різноманітніший словниковий запас. Академічні тексти зазвичай мають 60–80%; повторювані маркетингові матеріали часто нижче 40%.

Час читання

Розраховується зі швидкістю 200 слів на хвилину — середня швидкість тихого читання дорослої людини. Корисно для блогів, де читачі за секунди вирішують, читати далі чи ні. Для вебконтенту рекомендується не більше 7 хвилин.

Час мовлення

Розраховується зі швидкістю 130 слів на хвилину — середній комфортний темп мовлення для презентацій і подкастів. П'ятихвилинна промова — приблизно 650 слів. Використовуйте це для планування виступів, відео або озвучення.

Середня довжина слова

Загальна кількість символів у всіх словах, поділена на кількість слів. В англійській мові середнє значення — 4,5–5 символів. Показник вище 6 свідчить про активне використання технічної або академічної лексики; нижче 4 — про дуже простий або розмовний текст.

Оцінка читабельності (рівень за Flesch-Kincaid)

Формула: 0,39 × (слова ÷ речення) + 11,8 × (склади ÷ слова) − 15,59. Результат відповідає класу американської школи. 6–8 клас — ідеально для вебконтенту та email. 12+ клас — підходить для академічних статей. Примітка: найкраще працює для англійської мови; для інших мов результати є приблизними.

Легкість читання (Flesch Reading Ease)

Формула: 206,835 − 1,015 × (слова ÷ речення) − 84,6 × (склади ÷ слова). Оцінка від 0 до 100 — вище означає легше. 60–70 — стандарт (проста мова), 90+ — дуже легко (дитячі книги), 0–30 — дуже складно (юридичний/науковий текст). Доповнює оцінку класу зрозумілою текстовою міткою.

Хто користується цим лічильником слів?

Три задачі, де число на екрані має наслідки.

SEO-копірайтери

Більшість контент-завдань крутиться навколо двох чисел: наскільки довгий матеріал і як часто в ньому трапляється цільова фраза. Обидва тут, на сторінці, живими, поки ви пишете. «Щільність ключових слів» видає десятку найчастіших термінів із їхньою часткою від загалу й уже прибраними стоп-словами — зазвичай цього досить, щоб помітити фразу, на яку ви налягли разів на три більше, ніж варто. Пораду про 1–3% для головного терміна варто тримати за перевірку на здоровий глузд, а не за мету: метрика існує, щоб виявляти перенасичення, і писати під неї — значить знищити її сенс. По-справжньому панель відпрацьовує себе тим, що показує терміни, за якими ви й не планували ранжуватися, а вийшло.

Студенти та науковці

Системи подання робіт, анотації до статей і грантові форми — усі мають жорсткі ліміти, і чимало з них рахують символи без пробілів, а не слова, тому цей показник і стоїть у верхньому рядку. Дві речі підставлять вас найшвидше. Лічильник читає все, що лежить у полі, разом зі списком літератури, тож перед фінальною перевіркою його треба прибрати або відділити основний текст через «Пошук і заміну». Важливіше інше: слова з дефісом тут рахуються окремо, а в Microsoft Word — як одне, тому насичена методологією стаття може виглядати тут на кілька десятків слів довшою, ніж у копії вашого наукового керівника. Якщо ліміт перевіряють у Word, робіть фінальну звірку у Word, а цю сторінку лишіть для всього, що відбувається до неї.

Розробники й технічні писарі

Причина відкрити лічильник посеред роботи зазвичай геть не романтична: чи влізе цей підпис у кнопку, якої довжини цей рядок у колонці, приблизно скільки токенів у цьому промпті. «Символи без пробілів» — найближче тут до довжини рядка для простого ASCII-тексту. Розходитися вони починають тієї ж миті, коли з'являються емодзі або нелатинські символи, бо JavaScript рахує кодові одиниці UTF-16, а одне емодзі — це дві з них; про це варто пам'ятати, перш ніж задавати розмір колонки в базі за кількістю символів. Інструменти роботи з пробілами на панелі — найшвидший спосіб причесати фрагмент, скопійований із редактора, перед тим як його міряти.

Чому це працює у вашому браузері

Звичний спосіб зробити текстовий інструмент — відправити текст на сервер і повернути результат. Це працює, це легко написати, і це тихенько створює копію вашого документа там, куди ви не бачите. Не тому, що хтось збирався її берегти. Запит дорогою всередину проходить через балансувальник, вебсервер, код застосунку й зазвичай ще й журнал доступу, і будь-що з цього здатне потримати тіло запиту довше, ніж живе сам запит. Політика, у якій написано «ми не зберігаємо ваші дані», — це твердження про наміри. Вона не покриває ні налагоджувальний лог, забутий увімкненим після інциденту, ні збирач помилок, який послужливо чіпляє тіло запиту, ні кеш на краю мережі, якою ніхто з команди не адмініструє.

Тому цей інструмент не відправляє нічого. JavaScript приїжджає один раз, коли завантажується сторінка, і від тієї миті кожен підрахунок, кожен бал і кожна цифра щільності обчислюються над рядком у полі введення, на вашому процесорі. Це не налаштування, яке хтось потім перемкне. Браузер не може нікуди надіслати дані, поки код його про це не попросить, а в коді підрахунку такого запиту немає: ні fetch, ні XMLHttpRequest, ні beacon. Це менша обіцянка, ніж дає більшість сторінок про приватність, і значно витриваліша. Копію вашого тексту неможливо злити, бо її ніколи не існувало.

Переконатися в цьому швидше, ніж прочитати політику. Натисніть F12 або Cmd+Option+I на Mac і відкрийте вкладку Network. Вставте найчутливіше, що у вас є. Подивіться, чим наповнюється список. Ви побачите власні ресурси сторінки, аналітичний пінг про те, що хтось її відвідав, і ту рекламу, яка цього місяця крутиться, — і жодного запиту, що ніс би ваші слова. Саме цю частину ми воліли б, щоб ви перевірили, а не просто повірили.

Матеріали до теми