o
    Û­jH½  ã                   @  sj  d dl mZ d dlmZmZ d dlmZmZmZm	Z	 d dl
Z
d dlmZ d dlZd dlmZmZmZmZmZ d dlZd dlZd dlmZ d dlmZmZmZ d d	lmZ d d
lm Z  d dl!m"Z"m#Z#m$Z$ d dl%m&Z& d dl'm(Z(m)Z) d dl*m+Z+m,Z, erŽd dl-m.Z.m/Z/m0Z0 d dl1m2Z2m3Z3 dZ4G dd„ de+ƒZ5G dd„ dejƒZ6G dd„ de5ƒZ7ddd„Z8d dd„Z9dS )!é    )Úannotations)ÚabcÚdefaultdict)ÚHashableÚIteratorÚMappingÚSequenceN)ÚStringIO)ÚIOÚTYPE_CHECKINGÚDefaultDictÚLiteralÚcast)Úlib)ÚEmptyDataErrorÚParserErrorÚParserWarning)Úcache_readonly)Úfind_stack_level)Úis_bool_dtypeÚ
is_integerÚis_numeric_dtype)Úis_dict_like)Údedup_namesÚis_potential_multi_index)Ú
ParserBaseÚparser_defaults)Ú	ArrayLikeÚReadCsvBufferÚScalar)ÚIndexÚ
MultiIndexu   ï»¿c                      sJ  e Zd ZU ded< db‡ fdd„Zedcd
d„ƒZdddd„Z	dedfdd„Zdgdd„Z		dedhdd„Z
did d!„Zedjd#d$„ƒZdkd&d'„Zed(d)„ ƒZdld0d1„Zdmd3d4„Zdnd6d7„Zdod9d:„Zdmd;d<„Zdpd@dA„ZdqdCdD„ZdrdGdH„ZdrdIdJ„ZdrdKdL„ZdsdOdP„ZdrdQdR„ZdtdSdT„ZdudVdW„ZdvdYdZ„Zdedwd[d\„Zdxd^d_„Zdyd`da„Z ‡  Z!S )zÚPythonParserúset[int]Ú_no_thousands_columnsÚfúReadCsvBuffer[str] | listÚreturnÚNonec                   sú  t ƒ  |¡ dˆ _g ˆ _dˆ _dˆ _|d ˆ _tˆ jƒr!ˆ jˆ _n‡ fdd„ˆ _t	|d ƒˆ _
|d ˆ _|d ˆ _tˆ jtƒrEtˆ jƒˆ _|d	 ˆ _|d
 ˆ _|d ˆ _|d ˆ _|d ˆ _|d ˆ _dˆ _d|v ro|d ˆ _|d ˆ _|d ˆ _|d ˆ _|d ˆ _t|tƒr‘ttt |ƒˆ _nt|dƒs˜J ‚ˆ  |¡ˆ _dˆ _ˆ   ¡ \}ˆ _!ˆ _"ˆ  #|ˆ j$¡\ˆ _%ˆ _$ˆ _&}tˆ j%ƒˆ _'ˆ j(sÕˆ  )¡ \}ˆ _'ˆ _%dˆ _*ˆ j$du rÕ|ˆ _$ˆ jdu rätt+t,ˆ j%ƒƒƒˆ _ˆ  -ˆ j%¡ˆ _.ˆ  /¡ ˆ _0t,ˆ jƒdkrût1dƒ‚dS )zN
        Workhorse function for processing nested list into DataFrame
        Nr   Úskiprowsc                   s
   | ˆ j v S ©N)r)   )Úx©Úself© ú\/var/www/html/CropPilot/venv/lib/python3.10/site-packages/pandas/io/parsers/python_parser.pyÚ<lambda>Z   s   
 z'PythonParser.__init__.<locals>.<lambda>Ú
skipfooterÚ	delimiterÚ	quotecharÚ
escapecharÚdoublequoteÚskipinitialspaceÚlineterminatorÚquotingÚskip_blank_linesFÚhas_index_namesÚverboseÚ	thousandsÚdecimalÚcommentÚreadlineTé   z'Only length-1 decimal markers supported)2ÚsuperÚ__init__ÚdataÚbufÚposÚline_posr)   ÚcallableÚskipfuncÚ_validate_skipfooter_argr1   r2   r3   Ú
isinstanceÚstrr4   r5   r6   r7   r8   r9   r:   r;   r<   r=   r>   Úlistr   r   ÚhasattrÚ_make_readerÚ_col_indicesÚ_infer_columnsÚnum_original_columnsÚunnamed_colsÚ_extract_multi_indexer_columnsÚindex_namesÚcolumnsÚ	col_namesÚ
orig_namesÚ_has_complex_date_colÚ_get_index_nameÚ_name_processedÚrangeÚlenÚ_validate_parse_dates_presenceÚ_parse_date_colsÚ_set_no_thousand_columnsr$   Ú
ValueError)r-   r%   ÚkwdsrU   Ú_rT   ©Ú	__class__r,   r/   rB   J   sv   
















üþû


ÿzPythonParser.__init__ú
re.Patternc                 C  sL   t  | j¡}| jd u rd|› d�}nt  | j¡}d|› d|› d�}t  |¡S )Nz^[\-\+]?[0-9]*(z [0-9]*)?([0-9]?(E|e)\-?[0-9]+)?$z^[\-\+]?([0-9]+z	|[0-9])*()ÚreÚescaper=   r<   Úcompile)r-   r=   Úregexr<   r.   r.   r/   Únum©   s   
ÿ
zPythonParser.numúIO[str] | ReadCsvBuffer[str]c                   sJ  ˆj ‰ˆd u stˆƒdkr™ˆjrtdƒ‚G ‡fdd„dtjƒ}|}ˆd ur)ˆ|_ nfˆ  ¡ }ˆ |gg¡d }ˆ ˆj	¡s>|sZˆ j	d7  _	ˆ  ¡ }ˆ |gg¡d }ˆ ˆj	¡s>|r>t
tt |ƒ}|d }ˆ j	d7  _	ˆ jd7  _t ¡  |¡}|j |_ tjt|ƒ|d�}ˆj t|ƒ¡ tjˆ |dd�}	|	S ‡ ‡fd	d
„}
|
ƒ }	|	S )Nr@   z<Custom line terminators not supported in python parser (yet)c                      s4   e Zd Z” jZ” jZ” jZ” jZ” jZ” jZdZ	dS )z,PythonParser._make_reader.<locals>.MyDialectÚ
N)
Ú__name__Ú
__module__Ú__qualname__r2   r3   r4   r5   r6   r8   r7   r.   r,   r.   r/   Ú	MyDialect¿   s    rp   r   )ÚdialectT)rq   Ústrictc                  3  sB   � ˆ   ¡ } t ˆ¡}| |  ¡ ¡V  ˆ D ]
} | |  ¡ ¡V  qd S r*   )r?   rf   rh   ÚsplitÚstrip)ÚlineÚpat)r%   Úsepr.   r/   Ú_readé   s   €
ÿz(PythonParser._make_reader.<locals>._read)r2   r\   r7   r`   ÚcsvÚDialectr?   Ú_check_commentsrH   rE   r   rL   rK   rF   ÚSnifferÚsniffÚreaderr	   rD   Úextend)r-   r%   rp   Údiaru   ÚlinesÚ	lines_strÚsniffedÚline_rdrr~   rx   r.   )r%   r-   rw   r/   rN   ¶   s<   ÿ	ýõ	zPythonParser._make_readerNÚrowsú
int | NoneúRtuple[Index | None, Sequence[Hashable] | MultiIndex, Mapping[Hashable, ArrayLike]]c                 C  s  z|   |¡}W n ty   | jrg }n|  ¡  ‚ Y nw d| _t| jƒ}t|ƒsIt| jt| j| j	ƒƒ}|  
|| j¡\}}}|  || j¡}|||fS t|d ƒ}d }	| jrd|t|ƒkrd|d }	|dd … }|  |¡}
|  |
¡\}}|  |¡}|  ||¡\}}|  ||
||	¡\}}|||fS )NFr   r@   )Ú
_get_linesÚStopIterationÚ_first_chunkÚcloserL   rW   r\   r   r   Ú	index_colÚ_get_empty_metaÚdtypeÚ_maybe_make_multi_index_columnsrV   Úcount_empty_valsr:   Ú_rows_to_colsÚ_exclude_implicit_indexÚ_convert_dataÚ_do_date_conversionsÚ_make_index)r-   r…   ÚcontentrU   ÚnamesÚindexÚcol_dictÚconv_columnsÚcount_empty_content_valsÚindexnamerowÚalldatarC   Ú	conv_dataÚresult_columnsr.   r.   r/   Úreadö   sL   ýþ
þþ
þ


ÿ
zPythonParser.readr�   úlist[np.ndarray]ú8tuple[Mapping[Hashable, np.ndarray], Sequence[Hashable]]c                   s\   t | jt| j| jƒƒ}d‰| jrt| jƒ‰tˆ ƒ‰|  |ˆ ¡ ‡ ‡‡fdd„t|ƒD ƒ|fS )Nr   c                   s&   i | ]\}}|ˆk r|ˆ |ˆ  “qS r.   r.   )Ú.0ÚiÚname©r�   Úlen_alldataÚoffsetr.   r/   Ú
<dictcomp>A  s     z8PythonParser._exclude_implicit_index.<locals>.<dictcomp>)r   rW   r   rŒ   Ú_implicit_indexr\   Ú_check_data_lengthÚ	enumerate)r-   r�   r—   r.   r¦   r/   r’   ,  s"   þþ
ÿþz$PythonParser._exclude_implicit_indexÚsizec                 C  s   |d u r| j }| j|d�S )N)r…   )Ú	chunksizer    )r-   r­   r.   r.   r/   Ú	get_chunkF  s   zPythonParser.get_chunkrC   úMapping[Hashable, np.ndarray]úMapping[Hashable, ArrayLike]c           	      C  sž   |   | j¡}|   | j¡}i }i }t| jtƒr>| jD ]#}| j| }| j| }t|tƒr4|| jvr4| j| }|||< |||< qn| j}| j}|  	|||| j
||¡S r*   )Ú_clean_mappingÚ
convertersrŽ   rJ   Ú	na_valuesÚdictÚ
na_fvaluesÚintrW   Ú_convert_to_ndarraysr;   )	r-   rC   Ú
clean_convÚclean_dtypesÚclean_na_valuesÚclean_na_fvaluesÚcolÚna_valueÚ	na_fvaluer.   r.   r/   r“   P  s.   




ø
úzPythonParser._convert_dataÚboolc                 C  s6   | j d u rdS | j }t|tttjfƒrt|ƒdkS dS )NFr@   )ÚheaderrJ   rL   ÚtupleÚnpÚndarrayr\   )r-   rÁ   r.   r.   r/   Ú_have_mi_columnss  s   
zPythonParser._have_mi_columnsú9tuple[list[list[Scalar | None]], int, set[Scalar | None]]c                   s–  | j ‰ d}d}tƒ }| jd u�rq| j}| j}t|tttjfƒr-|r,t|ƒ|d d g }n|g}g }t	|ƒD �]°\}}z|  
¡ }	| j|krN|  ¡ }	| j|ksEW n… tyÔ }
 zyd| j  k rb|kr–n n2|rl||d kr–ttt|rw|d d… n|ƒƒ}dd |¡› dt|ƒ› d�}td	|› d
| j› d�ƒ|
‚|r»|dkr»|r¢|  ¡  | d gt|d ƒ ¡ |||fW  Y d }
~
  S | j sÃtdƒ|
‚| j d d … }	W Y d }
~
nd }
~
ww g ‰g ‰t	|	ƒD ])\}}|dk�r|rñd|› d|› �}nd|› �}ˆ |¡ ˆ |¡ qÝˆ |¡ qÝ|�sŒttƒ}‡fdd„ttˆƒƒD ƒˆ }|D ]k}ˆ| }|}|| }|dk�r|dk�rU|d ||< |› d|› �}|ˆv �rL|d7 }n|| }|dk�s5| jd u�rt| jƒ�r| j |¡d u�r| j |¡d u �r| j || j |¡i¡ |ˆ|< |d ||< �qn?|�rË||d k�rËtˆƒ}| j}|d u�r¦t|ƒnd}tˆƒ}||k�r¸|| |k�s½|dk�rËd}d g| ‰| jd g| _| ˆ¡ | ‡fdd„ˆD ƒ¡ t|ƒdk�rçtˆƒ}q6|�rï|  ¡  ˆ d u�rgz|  ¡ }W n t�y   d }Y nw |d u �rdnt|ƒ}tˆ ƒt|d ƒk�r(tˆ ƒ|k�r(tdƒ‚t|ƒdk�r3tdƒ‚| j d u�rA|  !|ˆ |¡ ntˆ ƒ}| j"d u�rctˆ ƒt| j"ƒk�rc‡ fdd„t#| j"ƒD ƒg}ncˆ g}n_|  !||d |¡}nUt| j$ƒ}|}ˆ �sŒtt|ƒƒg}|  !||d |¡}n:| j d u �s™tˆ ƒ|k�r¦|  !ˆ gˆ |¡}tˆ ƒ}n t%| j ƒ�sºtˆ ƒt| j ƒk�rºtdƒ‚ˆ g}|  !||d |¡ |||fS )Nr   Téÿÿÿÿr@   ú[ú,z
], len of z, zPassed header=z	but only z lines in fileúNo columns to parse from fileÚ z	Unnamed: Ú_level_c                   s   g | ]}|ˆ vr|‘qS r.   r.   ©r£   r¤   )Úthis_unnamed_colsr.   r/   Ú
<listcomp>Ç  s
    þz/PythonParser._infer_columns.<locals>.<listcomp>Ú.Fc                   s   h | ]}ˆ | ’qS r.   r.   rÍ   )Úthis_columnsr.   r/   Ú	<setcomp>÷  ó    z.PythonParser._infer_columns.<locals>.<setcomp>zHNumber of passed names did not match number of header fields in the filez*Cannot pass names with multi-index columnsc                   s   g | ]}ˆ | ‘qS r.   r.   rÍ   )r—   r.   r/   rÏ     rÓ   )&r—   ÚsetrÁ   rÅ   rJ   rL   rÂ   rÃ   rÄ   r¬   Ú_buffered_linerF   Ú
_next_liner‰   ÚmaprK   Újoinr\   r`   Ú_clear_bufferÚappendr   r   r·   r[   rŽ   r   ÚgetÚupdaterŒ   rD   Ú	TypeErrorÚusecolsÚ_handle_usecolsrO   ÚsortedÚ_header_linerG   )r-   rQ   Úclear_bufferrR   rÁ   Úhave_mi_columnsrU   ÚlevelÚhrru   ÚerrÚjoiÚmsgr¤   ÚcÚcol_nameÚcountsÚcol_loop_orderr½   Úold_colÚ	cur_countÚlcÚsicÚicÚunnamed_countÚ
first_lineÚlen_first_data_rowÚncolsr.   )r—   rÑ   rÎ   r/   rP   ~  s  €

ÿ€ÿÿÿý
€ç




þü




ú	ÿê"

€
ÿ$ÿÿ
ÿ

 ÿ
zPythonParser._infer_columnsc              
   C  sb   | j d urd S z|  ¡ }W |S  ty0 } z| jstdƒ|‚| jd d … }W Y d }~|S d }~ww )NrÊ   )rÁ   rÕ   r‰   r—   r   )r-   ru   ræ   r.   r.   r/   rá   7  s   

û
€ûzPythonParser._header_linerU   úlist[list[Scalar | None]]Úusecols_keyúlist[Scalar | None]rQ   r·   c              	     sö   | j duryt| j ƒr|  | j |¡‰ nYtdd„ | j D ƒƒrTt|ƒdkr&tdƒ‚g ‰ | j D ]'}t|tƒrMz
ˆ  | 	|¡¡ W q+ tyL   |  
| j |¡ Y q+w ˆ  |¡ q+n‡fdd„| j D ƒ}|rhtd|› d	�ƒ‚| j ‰ ‡ fd
d„|D ƒ}tˆ ƒ| _|S )zb
        Sets self._col_indices

        usecols_key is used if there are string usecols.
        Nc                 s  s   � | ]}t |tƒV  qd S r*   )rJ   rK   )r£   Úur.   r.   r/   Ú	<genexpr>U  s   € z/PythonParser._handle_usecols.<locals>.<genexpr>r@   z4If using multiple headers, usecols must be integers.c                   s   g | ]}|ˆ kr|‘qS r.   r.   )r£   r½   )rQ   r.   r/   rÏ   e  s    z0PythonParser._handle_usecols.<locals>.<listcomp>z<Defining usecols with out-of-bounds indices is not allowed. z are out-of-bounds.c                   s"   g | ]}‡ fd d„t |ƒD ƒ‘qS )c                   ó   g | ]
\}}|ˆ v r|‘qS r.   r.   )r£   r¤   Ún©Úcol_indicesr.   r/   rÏ   p  ó    z;PythonParser._handle_usecols.<locals>.<listcomp>.<listcomp>)r¬   )r£   Úcolumnrý   r.   r/   rÏ   o  s    ÿÿ)rÞ   rG   Ú_evaluate_usecolsÚanyr\   r`   rJ   rK   rÚ   r˜   Ú_validate_usecols_namesr   rà   rO   )r-   rU   r÷   rQ   r½   Úmissing_usecolsr.   )rþ   rQ   r/   rß   F  sB   

ÿ

ÿù
	ÿÿÿ
þ
zPythonParser._handle_usecolsúlist[Scalar]c                 C  s    t | jƒdkr| jd S |  ¡ S )zH
        Return a line from buffer, filling buffer if required.
        r   )r\   rD   rÖ   r,   r.   r.   r/   rÕ   v  s   
zPythonParser._buffered_lineÚ	first_rowc           	      C  sÖ   |s|S t |d tƒs|S |d s|S |d d }|tkr|S |d }t|ƒdkrZ|d | jkrZd}|d }|dd…  |¡d }|||… }t|ƒ|d krY|||d d… 7 }n|dd… }|g}||dd…  S )a-  
        Checks whether the file begins with the BOM character.
        If it does, remove it. In addition, if there is quoting
        in the field subsequent to the BOM, remove it as well
        because it technically takes place at the beginning of
        the name, not the middle of it.
        r   r@   é   N)rJ   rK   Ú_BOMr\   r3   r˜   )	r-   r  Ú	first_eltÚfirst_row_bomÚstartÚquoteÚendÚnew_rowÚnew_row_listr.   r.   r/   Ú_check_for_bom  s*   
€zPythonParser._check_for_bomru   c                 C  s   | pt dd„ |D ƒƒS )zô
        Check if a line is empty or not.

        Parameters
        ----------
        line : str, array-like
            The line of data to check.

        Returns
        -------
        boolean : Whether or not the line is empty.
        c                 s  s   � | ]}| V  qd S r*   r.   ©r£   r+   r.   r.   r/   rú   Á  s   € z.PythonParser._is_line_empty.<locals>.<genexpr>)Úall)r-   ru   r.   r.   r/   Ú_is_line_empty´  s   zPythonParser._is_line_emptyc                 C  s¬  t | jtƒrg|  | j¡r"| jt| jƒkrn|  jd7  _|  | j¡s	 z8|  | j| j g¡d }|  jd7  _| jsI|  | j| jd  ¡sG|rIW n| jrZ|  	|g¡}|rZ|d }W nW n	 t
yd   t‚w q#nV|  | j¡r†|  jd7  _| jd us{J ‚t| jƒ |  | j¡sm	 | j| jd d�}|  jd7  _|d ur¼|  |g¡d }| jr´|  	|g¡}|r³|d }n
n|  |¡s»|r¼nq‡| jdkrÇ|  |¡}|  jd7  _| j |¡ |S )Nr@   Tr   ©Úrow_num)rJ   rC   rL   rH   rE   r\   r{   r9   r  Ú_remove_empty_linesÚ
IndexErrorr‰   ÚnextÚ_next_iter_liner  rF   rD   rÚ   )r-   ru   ÚretÚ	orig_liner.   r.   r/   rÖ   Ã  sf   ýÿÿ€ÿò€
üþò

zPythonParser._next_linerè   rK   r  c                 C  sL   | j | jjkrt|ƒ‚| j | jjkr$tjd|› d|› d�ttƒ d� dS dS )a   
        Alert a user about a malformed row, depending on value of
        `self.on_bad_lines` enum.

        If `self.on_bad_lines` is ERROR, the alert will be `ParserError`.
        If `self.on_bad_lines` is WARN, the alert will be printed out.

        Parameters
        ----------
        msg: str
            The error message to display.
        row_num: int
            The row number where the parsing error occurred.
            Because this row number is displayed, we 1-index,
            even though we 0-index internally.
        zSkipping line z: rl   )Ú
stacklevelN)	Úon_bad_linesÚBadLineHandleMethodÚERRORr   ÚWARNÚwarningsÚwarnr   r   )r-   rè   r  r.   r.   r/   Ú_alert_malformedû  s   
ýÿzPythonParser._alert_malformedúlist[Scalar] | Nonec              
   C  s®   z| j dusJ ‚t| j ƒ}t|tƒsJ ‚|W S  tjyV } z3| j| jj| jj	fv rKt
|ƒ}d|v s6d|v r8d}| jdkrEd}|d| 7 }|  ||¡ W Y d}~dS d}~ww )a[  
        Wrapper around iterating through `self.data` (CSV source).

        When a CSV error is raised, we check for specific
        error messages that allow us to customize the
        error message displayed to the user.

        Parameters
        ----------
        row_num: int
            The row number of the line being parsed.
        Nz	NULL bytezline contains NULz„NULL byte detected. This byte cannot be processed in Python's native csv library at the moment, so please pass in engine='c' insteadr   z¡Error could possibly be due to parsing errors in the skipped footer rows (the skipfooter keyword is only applied after Python's csv library has parsed all rows).ú. )rC   r  rJ   rL   ry   ÚErrorr  r  r  r   rK   r1   r#  )r-   r  ru   Úerè   Úreasonr.   r.   r/   r    s,   
þÿ
ÿ€æzPythonParser._next_iter_liner�   úlist[list[Scalar]]c                 C  sŒ   | j d u r|S g }|D ]8}g }|D ],}t|tƒr"| j |vs"|| jv r(| |¡ q|d | | j ¡… }t|ƒdkr=| |¡  | |¡ q|S )Nr   )r>   rJ   rK   r´   rÚ   Úfindr\   )r-   r�   r  ru   Úrlr+   r.   r.   r/   r{   E  s"   
ÿ


zPythonParser._check_commentsc                 C  s   dd„ |D ƒ}|S )a—  
        Iterate through the lines and remove any that are
        either empty or contain only one whitespace value

        Parameters
        ----------
        lines : list of list of Scalars
            The array of lines that we are to filter.

        Returns
        -------
        filtered_lines : list of list of Scalars
            The same array of lines with the "empty" ones removed.
        c                 S  sB   g | ]}t |ƒd kst |ƒd krt|d tƒr|d  ¡ r|‘qS )r@   r   )r\   rJ   rK   rt   ©r£   ru   r.   r.   r/   rÏ   j  s    ÿ
ÿüz4PythonParser._remove_empty_lines.<locals>.<listcomp>r.   )r-   r�   r  r.   r.   r/   r  Z  s   þ	z PythonParser._remove_empty_linesc                 C  s    | j d u r|S | j|| j dd�S )NrË   ©r�   ÚsearchÚreplace)r<   Ú_search_replace_num_columns©r-   r�   r.   r.   r/   Ú_check_thousandsu  s
   
ÿzPythonParser._check_thousandsr.  r/  c           	      C  s|   g }|D ]7}g }t |ƒD ])\}}t|tƒr&||vs&|| jv s&| j | ¡ ¡s,| |¡ q| | ||¡¡ q| |¡ q|S r*   )	r¬   rJ   rK   r$   rj   r.  rt   rÚ   r/  )	r-   r�   r.  r/  r  ru   r+  r¤   r+   r.   r.   r/   r0  }  s   ÿ
ÿz(PythonParser._search_replace_num_columnsc                 C  s$   | j td kr	|S | j|| j dd�S )Nr=   rÐ   r-  )r=   r   r0  r1  r.   r.   r/   Ú_check_decimal�  s
   ÿzPythonParser._check_decimalc                 C  s
   g | _ d S r*   )rD   r,   r.   r.   r/   rÙ   ˜  s   
zPythonParser._clear_bufferú@tuple[Sequence[Hashable] | None, list[Hashable], list[Hashable]]c           
      C  sl  | j }t|ƒ}t|ƒ}| jdur| j}nz|  ¡ }W n ty%   d}Y nw z|  ¡ }W n ty7   d}Y nw d}|dur�| j}|durLt|ƒ| j }|dur�| jdur�|dur�t|ƒt|ƒ| j kr�tt	t|ƒƒƒ| _| j
dd… | _
t|ƒD ]}| d|¡ qyt|ƒ}t|ƒ| _|||fS |dkr¦d| _| jdu r£tt	|ƒƒ| _d}n|  || j¡\}}	| _|||fS )aÐ  
        Try several cases to get lines:

        0) There are headers on row 0 and row 1 and their
        total summed lengths equals the length of the next line.
        Treat row 0 as columns and row 1 as indices
        1) Look for implicit index: there are more columns
        on row 1 than row 0. If this is true, assume that row
        1 lists index columns and row 0 lists normal columns.
        2) Get index from the columns if it was listed.
        Nr   Fr@   T)rW   rL   rá   rÖ   r‰   rŒ   r\   rQ   rÁ   r[   rD   ÚreversedÚinsertrª   Ú_clean_index_names)
r-   rU   rW   ru   Ú	next_lineÚimplicit_first_colsrŒ   ré   Ú
index_namerb   r.   r.   r/   rY   ›  sP   
ÿÿ



ÿ
zPythonParser._get_index_namer–   c                   sÜ  ˆj }ˆjr|tˆjƒ7 }tdd„ |D ƒƒ}||kr¹ˆjdur¹ˆjd u r¹ˆjr*ˆjnd}g }t|ƒ}t|ƒ}g }|D ]J\}}	t|	ƒ}
|
|krtˆj	ƒrZˆ 	|	¡}|d urY| 
|¡ q:ˆj	ˆjjˆjjfv r~ˆj|| |  }| 
||
f¡ ˆj	ˆjjkr~ nq:| 
|	¡ q:|D ]1\}}
d|› d|d › d|
› �}ˆjr°tˆjƒdkr°ˆjtjkr°d	}|d
| 7 }ˆ ||d ¡ q‡ttj||d�jƒ}ˆjrìˆjd usÍJ ‚ˆj‰ ˆjrá‡ ‡fdd„t|ƒD ƒ}|S ‡ fdd„t|ƒD ƒ}|S )Nc                 s  s   � | ]}t |ƒV  qd S r*   )r\   ©r£   Úrowr.   r.   r/   rú   ï  s   € z-PythonParser._rows_to_cols.<locals>.<genexpr>Fr   z	Expected z fields in line r@   z, saw zXError could possibly be due to quotes being ignored when a multi-char delimiter is used.r%  )Ú	min_widthc                   s4   g | ]\}}|t ˆjƒk s|t ˆjƒ ˆ v r|‘qS r.   )r\   rŒ   ©r£   r¤   Úa©rþ   r-   r.   r/   rÏ   1  s    üz.PythonParser._rows_to_cols.<locals>.<listcomp>c                   rû   r.   r.   r>  rý   r.   r/   rÏ   :  s    )rQ   rª   r\   rŒ   ÚmaxrÞ   r1   r¬   rG   r  rÚ   r  r  r   rE   r2   r8   ry   Ú
QUOTE_NONEr#  rL   r   Úto_object_arrayÚTrO   )r-   r–   Úcol_lenÚmax_lenÚfootersÚ	bad_linesÚiter_contentÚcontent_lenr¤   Ú_contentÚ
actual_lenÚnew_lr  rè   r(  Úzipped_contentr.   r@  r/   r‘   é  sp   




€þ€ÿÿÿÿþ
ýÿzPythonParser._rows_to_colsc                 C  sJ  | j }d }|d ur(t| j ƒ|kr!| j d |… | j |d … }| _ n|t| j ƒ8 }|d u rÿt| jtƒrl| jt| jƒkr<t‚|d u rN| j| jd … }t| jƒ}n| j| j| j| … }| j| }|  |¡}| |¡ || _n�g }zg|d ur¸d}d}| jd ur| jnd}||k r©| jd usŒJ ‚t	| jƒ}|  
|| ¡sœ|d7 }|d7 }| |¡ ||k s…t|ƒ}	|  |¡}| |¡ nd}	 | j| j| d d�}
|d7 }|
d urÓ| |
¡ q»W n tyó   t|ƒ}	|  |¡}| |¡ t|ƒdkrñ‚ Y nw |  j|	7  _g | _ n|}| j�r|d | j … }|  |¡}| j�r|  |¡}|  |¡}|  |¡S )Nr   r@   Tr  )rD   r\   rJ   rC   rL   rE   r‰   Ú_remove_skipped_rowsr   r  rH   rÚ   r  r1   r{   r9   r  r2  r3  )r-   r…   r�   Únew_rowsÚnew_posÚ	row_indexÚrow_ctr¨   r  Úlen_new_rowsÚnext_rowr.   r.   r/   rˆ   ?  sz   "




ø


ûü

ÿü



zPythonParser._get_linesrP  c                   s    ˆ j r‡ fdd„t|ƒD ƒS |S )Nc                   s$   g | ]\}}ˆ   |ˆ j ¡s|‘qS r.   )rH   rE   )r£   r¤   r<  r,   r.   r/   rÏ   ’  s
    ÿÿz5PythonParser._remove_skipped_rows.<locals>.<listcomp>)r)   r¬   )r-   rP  r.   r,   r/   rO  �  s
   
ÿz!PythonParser._remove_skipped_rowsc                 C  sÂ   t ƒ }| jr| jr| jd usJ ‚|  | j| j¡}| jr_| jr_| jd us%J ‚t| j| jƒD ]2\}}t| jtƒs@t	| jƒs@| 
|¡ t| jtƒr^|| jv r^t	| j| ƒrYt| j| ƒr^| 
|¡ q,|S r*   )rÔ   rU   Úparse_datesrO   Ú_set_noconvert_dtype_columnsrŽ   ÚziprJ   rµ   r   Úaddr   )r-   Úno_thousands_columnsr¤   r½   r.   r.   r/   r_   —  s.   ÿÿ

ÿ
þý
€z%PythonParser._set_no_thousand_columns)r%   r&   r'   r(   )r'   re   )r%   rk   r*   )r…   r†   r'   r‡   )r�   r¡   r'   r¢   )r­   r†   r'   r‡   )rC   r°   r'   r±   )r'   rÀ   )r'   rÆ   )rU   rö   r÷   rø   rQ   r·   r'   rö   )r'   r  )r  r  r'   r  )ru   r  r'   rÀ   )rè   rK   r  r·   r'   r(   )r  r·   r'   r$  ©r�   r)  r'   r)  )r�   r)  r.  rK   r/  rK   r'   r)  )r'   r(   )r'   r4  )r–   r)  r'   r¡   )r…   r†   r'   r)  )rP  r)  r'   r)  )r'   r#   )"rm   rn   ro   Ú__annotations__rB   r   rj   rN   r    r’   r¯   r“   rÅ   rP   rá   rß   rÕ   r  r  rÖ   r#  r  r{   r  r2  r0  r3  rÙ   rY   r‘   rˆ   rO  r_   Ú__classcell__r.   r.   rc   r/   r"   G   sH   
 _
Aÿ
6ÿ

#

 :


0
	
5

8

0






NV
Qr"   c                   @  sD   e Zd ZdZ		dddd„Zdddd„Z	dd dd„Zd!dd„ZdS )"ÚFixedWidthReaderz(
    A reader of fixed-width lines.
    Néd   r%   rk   Úcolspecsú(list[tuple[int, int]] | Literal['infer']r2   ú
str | Noner>   r)   úset[int] | NoneÚinfer_nrowsr·   r'   r(   c                 C  sÎ   || _ d | _|rd| nd| _|| _|dkr| j||d�| _n|| _t| jttfƒs4t	dt
|ƒj› �ƒ‚| jD ]-}t|ttfƒr`t|ƒdkr`t|d ttjt
d ƒfƒr`t|d ttjt
d ƒfƒsdt	d	ƒ‚q7d S )
Nz
z
	 Úinfer)rd  r)   z;column specifications must be a list or tuple, input was a r  r   r@   zEEach column specification must be 2 element tuple or list of integers)r%   Úbufferr2   r>   Údetect_colspecsr`  rJ   rÂ   rL   rÝ   Útyperm   r\   r·   rÃ   Úinteger)r-   r%   r`  r2   r>   r)   rd  Úcolspecr.   r.   r/   rB   ¶  s8   	
ÿÿÿ
ÿÿþÿüýzFixedWidthReader.__init__ú	list[str]c                 C  sd   |du rt ƒ }g }g }t| jƒD ]\}}||vr| |¡ | |¡ t|ƒ|kr* nqt|ƒ| _|S )aÉ  
        Read rows from self.f, skipping as specified.

        We distinguish buffer_rows (the first <= infer_nrows
        lines) from the rows returned to detect_colspecs
        because it's simpler to leave the other locations
        with skiprows logic alone than to modify them to
        deal with the fact we skipped some rows here as
        well.

        Parameters
        ----------
        infer_nrows : int
            Number of rows to read from self.f, not counting
            rows that are skipped.
        skiprows: set, optional
            Indices of rows to skip.

        Returns
        -------
        detect_rows : list of str
            A list containing the rows to read.

        N)rÔ   r¬   r%   rÚ   r\   Úiterrf  )r-   rd  r)   Úbuffer_rowsÚdetect_rowsr¤   r<  r.   r.   r/   Úget_rowsÜ  s   

ÿ
zFixedWidthReader.get_rowsúlist[tuple[int, int]]c                   sú   d  dd„ ˆ jD ƒ¡}t d|› d�¡}ˆ  ||¡}|s tdƒ‚ttt|ƒƒ}t	j
|d td�}ˆ jd ur>‡ fd	d„|D ƒ}|D ]}| |¡D ]}	d||	 ¡ |	 ¡ …< qGq@t	 |d¡}
d
|
d
< t	 ||
A dk¡d
 }tt|d d d… |dd d… ƒƒ}|S )NrË   c                 S  s   g | ]}d |› �‘qS )ú\r.   r  r.   r.   r/   rÏ     s    z4FixedWidthReader.detect_colspecs.<locals>.<listcomp>z([^z]+)z(No rows from which to infer column widthr@   )rŽ   c                   s   g | ]
}|  ˆ j¡d  ‘qS )r   )Ú	partitionr>   r;  r,   r.   r/   rÏ     rÿ   r   r  )rØ   r2   rf   rh   ro  r   rA  r×   r\   rÃ   Úzerosr·   r>   Úfinditerr  r  ÚrollÚwhererL   rX  )r-   rd  r)   Ú
delimitersÚpatternr…   rF  Úmaskr<  ÚmÚshiftedÚedgesÚ
edge_pairsr.   r,   r/   rg    s$   
ÿ"z FixedWidthReader.detect_colspecsc                   s\   ˆj d urztˆj ƒ‰ W n ty   d ˆ_ tˆjƒ‰ Y nw tˆjƒ‰ ‡ ‡fdd„ˆjD ƒS )Nc                   s$   g | ]\}}ˆ ||…   ˆj¡‘qS r.   )rt   r2   )r£   Úfrom_Úto©ru   r-   r.   r/   rÏ   $  s   $ z-FixedWidthReader.__next__.<locals>.<listcomp>)rf  r  r‰   r%   r`  r,   r.   r€  r/   Ú__next__  s   
þ
zFixedWidthReader.__next__)Nr_  )r%   rk   r`  ra  r2   rb  r>   rb  r)   rc  rd  r·   r'   r(   r*   )rd  r·   r)   rc  r'   rk  )r_  N)rd  r·   r)   rc  r'   rp  )r'   rk  )rm   rn   ro   Ú__doc__rB   ro  rg  r�  r.   r.   r.   r/   r^  ±  s    
ù&'ÿr^  c                   @  s.   e Zd ZdZddd„Zdd
d„Zddd„ZdS )ÚFixedWidthFieldParserzl
    Specialization that Converts fixed-width fields into DataFrames.
    See PythonParser for details.
    r%   úReadCsvBuffer[str]r'   r(   c                 K  s0   |  d¡| _|  d¡| _tj| |fi |¤Ž d S )Nr`  rd  )Úpopr`  rd  r"   rB   )r-   r%   ra   r.   r.   r/   rB   -  s   zFixedWidthFieldParser.__init__rk   r^  c                 C  s   t || j| j| j| j| jƒS r*   )r^  r`  r2   r>   r)   rd  )r-   r%   r.   r.   r/   rN   3  s   úz"FixedWidthFieldParser._make_readerr�   r)  c                 C  s   dd„ |D ƒS )z¿
        Returns the list of lines without the empty ones. With fixed-width
        fields, empty lines become arrays of empty strings.

        See PythonParser._remove_empty_lines.
        c                 S  s"   g | ]}t d d„ |D ƒƒr|‘qS )c                 s  s$   � | ]}t |tƒ p| ¡ V  qd S r*   )rJ   rK   rt   )r£   r'  r.   r.   r/   rú   G  ó   €" zGFixedWidthFieldParser._remove_empty_lines.<locals>.<listcomp>.<genexpr>)r  r,  r.   r.   r/   rÏ   D  s    ýÿz=FixedWidthFieldParser._remove_empty_lines.<locals>.<listcomp>r.   r1  r.   r.   r/   r  =  s   þz)FixedWidthFieldParser._remove_empty_linesN)r%   r„  r'   r(   )r%   rk   r'   r^  r[  )rm   rn   ro   r‚  rB   rN   r  r.   r.   r.   r/   rƒ  '  s
    


rƒ  r'   r·   c                 C  s   t dd„ | D ƒƒS )Nc                 s  s$   � | ]}|d ks|du rdV  qdS )rË   Nr@   r.   )r£   Úvr.   r.   r/   rú   L  r†  z#count_empty_vals.<locals>.<genexpr>)Úsum)Úvalsr.   r.   r/   r�   K  s   r�   r1   c                 C  s$   t | ƒstdƒ‚| dk rtdƒ‚| S )að  
    Validate the 'skipfooter' parameter.

    Checks whether 'skipfooter' is a non-negative integer.
    Raises a ValueError if that is not the case.

    Parameters
    ----------
    skipfooter : non-negative integer
        The number of rows to skip at the end of the file.

    Returns
    -------
    validated_skipfooter : non-negative integer
        The original input if the validation succeeds.

    Raises
    ------
    ValueError : 'skipfooter' was not a non-negative integer.
    zskipfooter must be an integerr   zskipfooter cannot be negative)r   r`   )r1   r.   r.   r/   rI   O  s
   rI   )r'   r·   )r1   r·   r'   r·   ):Ú
__future__r   Úcollectionsr   r   Úcollections.abcr   r   r   r   ry   Úior	   rf   Útypingr
   r   r   r   r   r!  ÚnumpyrÃ   Úpandas._libsr   Úpandas.errorsr   r   r   Úpandas.util._decoratorsr   Úpandas.util._exceptionsr   Úpandas.core.dtypes.commonr   r   r   Úpandas.core.dtypes.inferencer   Úpandas.io.commonr   r   Úpandas.io.parsers.base_parserr   r   Úpandas._typingr   r   r   Úpandasr    r!   r  r"   r^  rƒ  r�   rI   r.   r.   r.   r/   Ú<module>   sD    	        rv
$