મફત વર્ડ ફ્રીક્વન્સી કાઉન્ટર

તમારા ટેક્સ્ટમાં દરેક શબ્દ કેટલી વાર આવે છે તે ગણો. ટોપ શબ્દો વિઝ્યુલાઇઝ કરો, CSV માં એક્સપોર્ટ કરો અને સ્ટોપ વર્ડ્સ ફિલ્ટર કરો.

એક વાર લોડ થયા પછી ઑફલાઇન કામ કરે છે

.txt, .md, .csv, .docx અથવા .pdf લોડ કરો. ફાઇલો તમારા ઉપકરણ પર વંચાય છે.

ન્યૂનતમ લંબાઈ:
ન્યૂનતમ ગણતરી:
ટોચના બતાવો:
ગોઠવો:

આ કેવી રીતે કાર્ય કરે છે

Word frequency analysis હાથે લખેલા tokenizer અને JavaScript Map વાપરીને સંપૂર્ણપણે તમારા બ્રાઉઝરમાં ચાલે છે — કોઈ લાઇબ્રેરી નહીં, કોઈ સર્વર નહીં. તમે ટાઈપ કરો કે પેસ્ટ કરો એ જ ક્ષણે text સ્થાનિક રીતે parse, count, અને rank થાય છે.

  1. 1
    યુનિકોડ-જાગૃત ટોકનાઇઝેશન
    ટૂલ તમારો text lowercase કરે છે, પછી Unicode property regex \p{L}\p{M} વડે tokens કાઢે છે — જે accented letters અને non-Latin scripts ને યોગ્ય રીતે હેન્ડલ કરે છે. CJK text (Chinese, Japanese, Korean) માટે, તે characters વચ્ચે spaces ન હોય તેમને split કરવા granularity: 'word' સાથે બ્રાઉઝરના બિલ્ટ-ઇન Intl.Segmenter API પર switch કરે છે.
  2. 2
    Stop-word અને length filtering
    ઓપ્શનલ filtering તમારા site locale સાથે mેચ કરેલા hardcoded Set વાપરીને સામાન્ય function words (the, a, is, અને Spanish, French, German, Italian, Portuguese માં સમકક્ષ) strip કરે છે. Minimum-length slider ગણતરી શરૂ થાય તે પહેલા તમારા પસંદ કરેલા threshold કરતાં ટૂંકા tokens દૂર કરે છે.
  3. 3
    Map-આધારિત frequency counting અને n-gram mode
    Tokens JavaScript Map માં tally થાય છે — ખાસ પસંદ કરેલો કારણ કે 'constructor' જેવા reserved property names ગણેલા words સાથે collide ન થાય. Bigram કે trigram મોડમાં, tokenizer raw token stream પર window slide કરે છે અને ગણતરી પહેલા અડોઅડ words ને phrases માં જોડે છે.
  4. 4
    Ranked પરિણામો અને CSV export
    પરિણામો count descending પ્રમાણે sort થાય છે અને ranked bar chart તરીકે બતાવવામાં આવે છે. Export બ્રાઉઝરના Blob API વાપરીને મેમરીમાં plain-text CSV blob બનાવે છે અને download ટ્રિગર કરે છે — કોઈપણ સમયે કંઈ પણ સર્વર પર મોકલાતું નથી.

સંબંધિત સાધનો

વારંવાર પૂછાતા પ્રશ્નો