/usr/lib/python3/dist-packages/chardet/__pycache__
NameSizeModeActions
big5freq.cpython-310.pyc271300644editdlrm
big5prober.cpython-310.pyc10810644editdlrm
chardistribution.cpython-310.pyc56910644editdlrm
charsetgroupprober.cpython-310.pyc21800644editdlrm
charsetprober.cpython-310.pyc34340644editdlrm
codingstatemachine.cpython-310.pyc28530644editdlrm
compat.cpython-310.pyc3520644editdlrm
cp949prober.cpython-310.pyc10880644editdlrm
enums.cpython-310.pyc25350644editdlrm
escprober.cpython-310.pyc25820644editdlrm
escsm.cpython-310.pyc83290644editdlrm
eucjpprober.cpython-310.pyc23840644editdlrm
euckrfreq.cpython-310.pyc120140644editdlrm
euckrprober.cpython-310.pyc10890644editdlrm
euctwfreq.cpython-310.pyc271340644editdlrm
euctwprober.cpython-310.pyc10890644editdlrm
gb2312freq.cpython-310.pyc190580644editdlrm
gb2312prober.cpython-310.pyc10970644editdlrm
hebrewprober.cpython-310.pyc29700644editdlrm
jisfreq.cpython-310.pyc220860644editdlrm
jpcntx.cpython-310.pyc375930644editdlrm
langbulgarianmodel.cpython-310.pyc478620644editdlrm
langgreekmodel.cpython-310.pyc460520644editdlrm
langhebrewmodel.cpython-310.pyc445010644editdlrm
langhungarianmodel.cpython-310.pyc478220644editdlrm
langrussianmodel.cpython-310.pyc609550644editdlrm
langthaimodel.cpython-310.pyc446770644editdlrm
langturkishmodel.cpython-310.pyc445180644editdlrm
latin1prober.cpython-310.pyc43800644editdlrm
mbcharsetprober.cpython-310.pyc21990644editdlrm
mbcsgroupprober.cpython-310.pyc10840644editdlrm
mbcssm.cpython-310.pyc187110644editdlrm
sbcharsetprober.cpython-310.pyc30300644editdlrm
sbcsgroupprober.cpython-310.pyc16530644editdlrm
sjisprober.cpython-310.pyc24220644editdlrm
universaldetector.cpython-310.pyc57760644editdlrm
utf8prober.cpython-310.pyc19330644editdlrm
version.cpython-310.pyc3900644editdlrm
__init__.cpython-310.pyc18510644editdlrm
Edit: /usr/lib/python3/dist-packages/chardet/__pycache__/charsetprober.cpython-310.pyc (3434B)
o -åÏ_öã@s0ddlZddlZddlmZGdd„deƒZdS)éNé)Ú ProbingStatec@sneZdZdZddd„Zdd„Zedd„ƒZd d „Zed d „ƒZ d d„Z e dd„ƒZ e dd„ƒZ e dd„ƒZdS)Ú CharSetProbergffffffî?NcCsd|_||_t t¡|_dS©N)Ú_stateÚ lang_filterÚloggingÚ getLoggerÚ__name__Úlogger)Úselfr©r ú7/usr/lib/python3/dist-packages/chardet/charsetprober.pyÚ__init__'szCharSetProber.__init__cCs tj|_dSr)rÚ DETECTINGr©r r r rÚreset,s zCharSetProber.resetcCódSrr rr r rÚ charset_name/szCharSetProber.charset_namecCrrr )r Úbufr r rÚfeed3ózCharSetProber.feedcCs|jSr)rrr r rÚstate6szCharSetProber.statecCsdS)Ngr rr r rÚget_confidence:rzCharSetProber.get_confidencecCst dd|¡}|S)Ns([-])+ó )ÚreÚsub)rr r rÚfilter_high_byte_only=sz#CharSetProber.filter_high_byte_onlycCs\tƒ}t d|¡}|D] }| |dd…¡|dd…}| ¡s&|dkr&d}| |¡q |S)u9 We define three types of bytes: alphabet: english alphabets [a-zA-Z] international: international characters [€-ÿ] marker: everything else [^a-zA-Z€-ÿ] The input buffer can be thought to contain a series of words delimited by markers. This function works to filter all words that contain at least one international character. All contiguous sequences of markers are replaced by a single space ascii character. This filter applies to all scripts which do not use English characters. s%[a-zA-Z]*[€-ÿ]+[a-zA-Z]*[^a-zA-Z€-ÿ]?Néÿÿÿÿó€r)Ú bytearrayrÚfindallÚextendÚisalpha)rÚfilteredÚwordsÚwordÚ last_charr r rÚfilter_international_wordsBsÿ  z(CharSetProber.filter_international_wordscCs¤tƒ}d}d}tt|ƒƒD]7}|||d…}|dkrd}n|dkr$d}|dkrD| ¡sD||kr@|s@| |||…¡| d¡|d}q |sP| ||d …¡|S) aÈ Returns a copy of ``buf`` that retains only the sequences of English alphabet and high byte characters that are not between <> characters. Also retains English alphabet and high byte characters immediately before occurrences of >. This filter can be applied to all scripts which contain both English characters and extended ASCII characters, but is currently only used by ``Latin1Prober``. Frró>ós