§
    ‚ŠtjZâ  ã                   ó.  — d Z ddlZddlZddlZddlmZ ddlZddlm	Z	m
Z
mZmZmZ ddlmZ ddlmZ ddlmZ d	d
lmZmZ  ej        e¦  «        ZdddddœZi dd“dd“dd“dd“dd“dd“dd“dd“d d!“d"d#“d$d%“d&d'“d(d)“d*d+“d,d-“d.d/“d0d1“i d2d3“d4d5“d6d7“d8d9“d:d;“d<d=“d>d?“d@dA“dBdC“dDdE“dFdG“dHdI“dJdK“dLdM“dNdO“dPdQ“dRdS“¥i dTdU“dVdW“dXdY“dZd[“d\d]“d^d_“d`da“dbdc“ddde“dfdg“dhdi“djdk“dldm“dndo“dpdq“drds“dtdu“¥i dvdw“dxdy“dzd{“d|d}“d~d“d€d�“d‚dƒ“d„d…“d†d‡“dˆd‰“dŠd‹“dŒd�“dŽd�“d�d‘“d’d““d”d•“d–d—“¥i d˜d™“dšd›“dœd�“dždŸ“d d¡“d¢d£“d¤d¥“d¦d§“d¨d©“dªd«“d¬d­“d®d¯“d°d±“d²d³“d´dµ“d¶d·“d¸d¹“¥dºd»d¼d½d¾d¿dÀdÁdÂdÃdÄdÅdÆdÇdÈdÉœ¥Zi dÊ„ e                     ¦   «         D ¦   «         ¥dËd&d(d°dÌd²dŒdBdBdŽdddÍœ¥ZdÎdÏgZ G dÐ„ dÑe¦  «        Z	 	 	 dãdÔe e!         dÕe"dz  dÖe"d×e"fdØ„Z#dädÙ„Z$dÚdÛœdÜ„Z%dädÝ„Z$dÞ„ Z&	 	 	 dãdÔe e!         dÕe"dz  dÖe"d×e"fdß„Z#dÔe e!         fdà„Z'dÔe e!         fdá„Z(dâ„ Z)dÑgZ*dS )åz!Tokenization classes for Whisper.é    N)Ú	lru_cache)Ú
AddedTokenÚ	TokenizerÚdecodersÚpre_tokenizersÚ
processors)ÚBPEé   )ÚTokenizersBackend)Úloggingé   )ÚBasicTextNormalizerÚEnglishTextNormalizerz
vocab.jsonztokenizer.jsonz
merges.txtznormalizer.json)Ú
vocab_fileÚtokenizer_fileÚmerges_fileÚnormalizer_fileÚenÚenglishÚzhÚchineseÚdeÚgermanÚesÚspanishÚruÚrussianÚkoÚkoreanÚfrÚfrenchÚjaÚjapaneseÚptÚ
portugueseÚtrÚturkishÚplÚpolishÚcaÚcatalanÚnlÚdutchÚarÚarabicÚsvÚswedishÚitÚitalianÚidÚ
indonesianÚhiÚhindiÚfiÚfinnishÚviÚ
vietnameseÚheÚhebrewÚukÚ	ukrainianÚelÚgreekÚmsÚmalayÚcsÚczechÚroÚromanianÚdaÚdanishÚhuÚ	hungarianÚtaÚtamilÚnoÚ	norwegianÚthÚthaiÚurÚurduÚhrÚcroatianÚbgÚ	bulgarianÚltÚ
lithuanianÚlaÚlatinÚmiÚmaoriÚmlÚ	malayalamÚcyÚwelshÚskÚslovakÚteÚteluguÚfaÚpersianÚlvÚlatvianÚbnÚbengaliÚsrÚserbianÚazÚazerbaijaniÚslÚ	slovenianÚknÚkannadaÚetÚestonianÚmkÚ
macedonianÚbrÚbretonÚeuÚbasqueÚisÚ	icelandicÚhyÚarmenianÚneÚnepaliÚmnÚ	mongolianÚbsÚbosnianÚkkÚkazakhÚsqÚalbanianÚswÚswahiliÚglÚgalicianÚmrÚmarathiÚpaÚpunjabiÚsiÚsinhalaÚkmÚkhmerÚsnÚshonaÚyoÚyorubaÚsoÚsomaliÚafÚ	afrikaansÚocÚoccitanÚkaÚgeorgianÚbeÚ
belarusianÚtgÚtajikÚsdÚsindhiÚguÚgujaratiÚamÚamharicÚyiÚyiddishÚloÚlaoÚuzÚuzbekÚfoÚfaroeseÚhtzhaitian creoleÚpsÚpashtoÚtkÚturkmenÚnnÚnynorskÚmtÚmalteseÚsanskritÚluxembourgishÚmyanmarÚtibetanÚtagalogÚmalagasyÚassameseÚtatarÚhawaiianÚlingalaÚhausaÚbashkirÚjavaneseÚ	sundaneseÚ	cantonese)ÚsaÚlbÚmyÚboÚtlÚmgÚasÚttÚhawÚlnÚhaÚbaÚjwÚsuÚyuec                 ó   — i | ]\  }}||“Œ	S © rÜ   )Ú.0ÚcodeÚlanguages      ún/var/www/html/CA-Chatbot/venv/lib/python3.11/site-packages/transformers/models/whisper/tokenization_whisper.pyú
<dictcomp>rá   ‘   s   € Ð>Ð>Ð>™.˜$ €x�Ð>Ð>Ð>ó    rÎ   rÍ   )ÚburmeseÚ	valencianÚflemishÚhaitianÚletzeburgeschÚpushtoÚpanjabiÚ	moldavianÚmoldovanÚ	sinhaleseÚ	castilianÚmandarinÚ	translateÚ
transcribec                   ón  ‡ — e Zd ZdZeZddgZeZ	 	 	 	 	 	 	 	 	 	 d6de	e
e	ef         z  dz  fˆ fd„Z	 d7de	fˆ fd„Zd8d„Zed9d„¦   «         Zd:defd„Zd„ Z	 	 	 	 	 	 	 	 d;dededz  dedededededede	fˆ fd„Zddddœdededede	fˆ fd„Zd„ Zed:d„¦   «         Zd<de	de	dz  dee	         fd „Z	 d=d!e	dz  d"e	dz  d#edz  fd$„Zedee         fd%„¦   «         Zd<dee         fd&„Z 	 d>d'ee         d(ee         dz  d)edee         fˆ fd*„Z!d?d,„Z"d-„ Z#d@d/e	fd0„Z$d1ee         d2ed3efd4„Z%ed5„ ¦   «         Z&ˆ xZ'S )AÚWhisperTokenizerag	  
    Construct a "fast" Whisper tokenizer (backed by HuggingFace's *tokenizers* library).

    This tokenizer inherits from [`PreTrainedTokenizerFast`] which contains most of the main methods. Users should
    refer to this superclass for more information regarding those methods.

    Args:
        vocab_file (`str`, *optional*):
            Path to the vocabulary file.
        merges_file (`str`, *optional*):
            Path to the merges file.
        normalizer_file (`str`, *optional*):
            Path to the normalizer_file file.
        tokenizer_file (`str`, *optional*):
            Path to [tokenizers](https://github.com/huggingface/tokenizers) file (generally has a .json extension) that
            contains everything needed to load the tokenizer.
        unk_token (`str`, *optional*, defaults to `"<|endoftext|>"`):
            The unknown token. A token that is not in the vocabulary cannot be converted to an ID and is set to be this
            token instead.
        bos_token (`str`, *optional*, defaults to `"<|endoftext|>"`):
            The beginning of sequence token. The `decoder_start_token_id` is used to set the first token as
            `"<|startoftranscript|>"` when generating.
        eos_token (`str`, *optional*, defaults to `"<|endoftext|>"`):
            The end of sequence token.
        add_prefix_space (`bool`, *optional*, defaults to `False`):
            Whether or not to add an initial space to the input. This allows to treat the leading word just as any
            other word. (Whisper tokenizer detect beginning of words by the preceding space).
        language (`str`, *optional*):
            The language of the transcription text. The corresponding language id token is appended to the start of the
            sequence for multilingual speech recognition and speech translation tasks, e.g. for Spanish the token
            `"<|es|>"` is appended to the start of sequence. This should be used for multilingual fine-tuning only.
        task (`str`, *optional*):
            Task identifier to append at the start of sequence (if any). This should be used for mulitlingual
            fine-tuning, with `"transcribe"` for speech recognition and `"translate"` for speech translation.
        predict_timestamps (`bool`, *optional*, defaults to `False`):
            Whether to omit the `<|notimestamps|>` token at the start of the sequence.
    Ú	input_idsÚattention_maskNú<|endoftext|>FÚvocabc                 óp  •— t          |t          ¦  «        rt          |dddd¬¦  «        n|}t          |t          ¦  «        rt          |dddd¬¦  «        n|}t          |t          ¦  «        rt          |dddd¬¦  «        n|}|�|ni | _        |�|ng | _        t          t          | j        | j        d ddd¬¦  «        ¦  «        | _        t          j	        |¬¦  «        | j        _
        t          j	        ¦   «         | j        _         t          ¦   «         j        d|||||||	|
dœ|¤Ž |�Ct          |d¬	¦  «        5 }t!          j        |¦  «        | _        d d d ¦  «         n# 1 swxY w Y   nd | _        t'          j        d
¦  «        | _        || _        |	| _        |
| _        |                      ¦   «          d S )NFT)ÚlstripÚrstripÚ
normalizedÚspecialÚ )rö   ÚmergesÚdropoutÚcontinuing_subword_prefixÚend_of_word_suffixÚfuse_unk)Úadd_prefix_space)Ú	unk_tokenÚ	bos_tokenÚ	eos_tokenr  r   rß   ÚtaskÚpredict_timestampsúutf-8©Úencodingz<\|(\d+\.\d+)\|>rÜ   )Ú
isinstanceÚstrr   Ú_vocabÚ_mergesr   r	   Ú
_tokenizerr   Ú	ByteLevelÚpre_tokenizerr   ÚdecoderÚsuperÚ__init__ÚopenÚjsonÚloadÚenglish_spelling_normalizerÚreÚcompileÚtimestamp_patrß   r  r  Úset_prefix_tokens)Úselfrö   rý   r   r  r  r  r  rß   r  r  ÚkwargsÚvocab_handleÚ	__class__s                €rà   r  zWhisperTokenizer.__init__Î   sM  ø€ õ  ˜)¥SÑ)Ô)ð�J�y¨°uÈÐX\Ð]Ñ]Ô]Ð]àð 	õ ˜)¥SÑ)Ô)ð�J�y¨°uÈÐX\Ð]Ñ]Ô]Ð]àð 	õ ˜)¥SÑ)Ô)ð�J�y¨°uÈÐX\Ð]Ñ]Ô]Ð]àð 	ð  %Ð0�e�e°bˆŒØ!'Ð!3�v�v¸ˆŒå#ÝØ”kØ”|ØØ*,Ø#%Øðñ ô ñ	
ô 	
ˆŒõ )7Ô(@ÐRbÐ(cÑ(cÔ(cˆŒÔ%Ý"*Ô"4Ñ"6Ô"6ˆŒÔà�‰ŒÔð 
	
ØØØØ-Ø+ØØØ1ð
	
ð 
	
ð ð
	
ð 
	
ð 
	
ð Ð&Ý�o°Ð8Ñ8Ô8ð K¸LÝ37´9¸\Ñ3JÔ3J�Ô0ðKð Kð Kñ Kô Kð Kð Kð Kð Kð Kð Køøøð Kð Kð Kð Køð 04ˆDÔ,åœZÐ(;Ñ<Ô<ˆÔà ˆŒØˆŒ	Ø"4ˆÔØ×ÒÑ Ô Ð Ð Ð s   Ä;E!Å!E%Å(E%ç{®Gáz”?éÜ  Úreturnc                 óò  •— | j         d         dz   }g g}d}d}d}	t          |¦  «        D ]¹\  }
}||k    r“t          ||z
  |z  ¦  «        }||k     rA|
dk    o||
dz
           |k    o||
dz
           |k     }|r	|||z  z  }n|	}||	z  }|dd…         }|}	|}|                     d||z   d›d	�¦  «         |                     g ¦  «         Œž|d                              |¦  «         Œºg }|D ]{}t	          |t
          ¦  «        r|                     |¦  «         Œ-|r7|                     t          ¦   «                              ||¬
¦  «        ¦  «         Œf|                     d¦  «         Œ|d                     |¦  «        S )zÄ
        Timestamp tokens are above the special tokens' id range and are ignored by `decode()`. This method decodes
        given tokens with timestamps tokens annotated, e.g. "<|1.08|>".
        éÿÿÿÿr   ç        é   Néþÿÿÿz<|z.2fz|>©Úskip_special_tokensrü   )	Úall_special_idsÚ	enumerateÚfloatÚappendr  r  r  ÚdecodeÚjoin)r  Ú	token_idsr*  Útime_precisionÚsegment_sizeÚtimestamp_beginÚoutputsÚcur_max_timestampÚprev_segments_lenÚpenultimate_timestampÚiÚtokenÚ	timestampÚlast_was_single_endingÚdecoded_outputsÚsr   s                   €rà   Ú_decode_with_timestampsz(WhisperTokenizer._decode_with_timestamps  së  ø€ ð Ô.¨rÔ2°QÑ6ˆØ�$ˆàÐØÐØ #Ðå! )Ñ,Ô,ð 	*ð 	*‰HˆAˆuØ˜Ò'Ð'Ý! 5¨?Ñ#:¸nÑ"LÑMÔM�	àÐ0Ò0Ð0à-.°!ªVð .Ø! ! a¡%Ô(¨OÒ;ÐcÀ	È!ÈaÉ%Ô@PÐTcÒ@cð9Ð*ð .ð /Ø)¨^¸lÑ-JÑJÐ)Ð)à,AÐ)Ø)Ð-BÑBÐ)Ø")¨#¨2¨#¤,˜à(9Ð%Ø$-Ð!à—’ÐK YÐ1BÑ%BÐKÐKÐKÐKÑLÔLÐLØ—’˜rÑ"Ô"Ð"Ð"à˜”×"Ò" 5Ñ)Ô)Ð)Ð)àˆØð 	+ð 	+ˆAÝ˜!�SÑ!Ô!ð +Ø×&Ò& qÑ)Ô)Ð)Ð)Øð +Ø×&Ò&¥u¡w¤w§~¢~°aÐM` ~Ñ'aÔ'aÑbÔbÐbÐbà×&Ò& rÑ*Ô*Ð*Ð*Ø�wŠw�Ñ'Ô'Ð'râ   c                 ó8  — g }dt          t          |¦  «        ¦  «        v r8t          |d¦  «        r(t          |j        ¦  «        r|                     ¦   «         }t          j        |¦  «        }|j        d         dk    r't          |j        ¦  «        dk    rt          d¦  «        ‚| j
        d         dz   }||k    }t          j        |dd…         |dd…         z  ¦  «        d         dz   }|j        d         dk    r|                     ¦   «         dk    rg S t          j        |¦  «        d         d         dz   |vr6t          j        |t          j        |¦  «        d         d         dz   ¦  «        }t          j        |¦  «        d         d         }d}	d}
|D �]}|||…         }t          |¦  «        dk    rß|d                              ¦   «         |z
  }|d                              ¦   «         |z
  }||	k     r2|dk    o||dz
           |k    o||dz
           |k     }|r|
|z  }
n|
|	z  }
|}	|                      |¦  «        }|                      |¦  «        }|                      |¦  «        }|                     |||z  |
|z  z   ||z  |
|z  z   fd	œ¦  «         |}�Œ|S )
aø  
        Compute offsets for a given tokenized input

        Args:
            token_ids (`Union[int, list[int], np.ndarray, torch.Tensor]`):
                List of tokenized input ids. Can be obtained using the `__call__` method.
            time_precision (`float`, *optional*, defaults to 0.02):
                The time ratio to convert from token to time.
            segment_size (`int`, *optional*, defaults to 1500):
                The number of features in the input mel spectrogram.
        ÚtorchÚcpur   r   z)Can only process a single input at a timer%  Nr'  ©Útextr;  )r  ÚtypeÚhasattrÚcallablerB  ÚnpÚarrayÚshapeÚlenÚ
ValueErrorr+  ÚwhereÚsumr.  ÚitemÚ_preprocess_token_idsÚ_decodeÚ_filter_timestamp_ids)r  r1  r2  r3  Úoffsetsr4  Útimestamp_tokensÚconsecutiveÚ
last_slicer6  r7  Úcurrent_sliceÚsliced_tokensÚstart_timestamp_positionÚend_timestamp_positionÚis_single_endingrD  s                    rà   Ú_compute_offsetsz!WhisperTokenizer._compute_offsetsH  sû  € ð ˆà•c�$˜y™/œ/Ñ*Ô*Ð*Ð*µ¸	À5Ñ0IÔ0IÐ*ÍhÐW`ÔWdÑNeÔNeÐ*Ø!Ÿš™œˆIÝ”H˜YÑ'Ô'ˆ	ØŒ?˜1Ô Ò!Ð!¥c¨)¬/Ñ&:Ô&:¸QÒ&>Ð&>ÝÐHÑIÔIÐIØÔ.¨rÔ2°QÑ6ˆØ$¨Ò7Ðå”hÐ/°°°Ô4Ð7GÈÈÈÔ7KÑKÑLÔLÈQÔOÐRSÑSˆØÔ˜QÔ 1Ò$Ð$Ð)9×)=Ò)=Ñ)?Ô)?À1Ò)DÐ)DàˆIÝŒXÐ&Ñ'Ô'¨Ô*¨2Ô.°Ñ2¸+ÐEÐEåœ) Kµ´Ð:JÑ1KÔ1KÈAÔ1NÈrÔ1RÐUVÑ1VÑWÔWˆKå”XÐ.Ñ/Ô/°Ô2°1Ô5ˆ
ØÐØÐØ(ð 	'ñ 	'ˆMØ% j°Ð&>Ô?ˆMÝ�=Ñ!Ô! AÒ%Ð%Ø+8¸Ô+;×+@Ò+@Ñ+BÔ+BÀ_Ñ+TÐ(Ø)6°rÔ):×)?Ò)?Ñ)AÔ)AÀOÑ)SÐ&à+Ð.?Ò?Ð?à'1°Q¢ð (Ø! *¨q¡.Ô1°_ÒDÐuÈÐS]Ð`aÑSaÔIbÐfuÒIuð<Ð$ð (ð ?Ø)¨\Ñ9Ð)Ð)à)Ð->Ñ>Ð)à$:Ð!ð !%× :Ò :¸=Ñ IÔ I�Ø—|’| MÑ2Ô2�Ø×1Ò1°$Ñ7Ô7�Ø—’à $à4°~ÑEÐHYÐ\jÑHjÑjØ2°^ÑCÐFWÐZhÑFhÑhð&ðð ñô ð ð 'ˆJ‰Jàˆrâ   c                 ó`   ‡— |                       ˆfd„t          d¦  «        D ¦   «         ¦  «        S )a  
        Compute the timestamp token ids for a given precision and save to least-recently used (LRU) cache.

        Args:
            time_precision (`float`, *optional*, defaults to 0.02):
                The time ratio to convert from token to time.
        c                 ó    •— g | ]
}d |‰z  z  ‘ŒS )z<|%.2f|>rÜ   )rÝ   r9  r2  s     €rà   ú
<listcomp>z2WhisperTokenizer.timestamp_ids.<locals>.<listcomp>–  s$   ø€ Ð*hÐ*hÐ*hÐST¨J¸!¸nÑ:LÑ,MÐ*hÐ*hÐ*hrâ   iÝ  )Úconvert_tokens_to_idsÚrange)r  r2  s    `rà   Útimestamp_idszWhisperTokenizer.timestamp_idsŒ  s8   ø€ ð ×)Ò)Ð*hÐ*hÐ*hÐ*hÕX]Ð^fÑXgÔXgÐ*hÑ*hÔ*hÑiÔiÐirâ   r*  c                 óŒ   — |rA|                       d¦  «        }|                       d¦  «        }|                      |||¦  «        }|S )a  
        Pre-process the token ids for decoding by removing the prompt tokens ids and timestamp token ids.

        Args:
            token_ids (`Union[int, list[int], np.ndarray, torch.Tensor]`):
                List of tokenized input ids. Typically, obtained using the `__call__` method of the tokenizer.
            skip_special_tokens (`bool`, *optional*, defaults to `False`):
                Whether or not to remove special tokens from the token ids. If `True`, the prompt token ids will be
                removed.
        ú<|startofprev|>ú<|startoftranscript|>)r`  Ú_strip_prompt)r  r1  r*  Úprompt_token_idÚdecoder_start_token_ids        rà   rP  z&WhisperTokenizer._preprocess_token_ids™  sT   € ð ð 	_Ø"×8Ò8Ð9JÑKÔKˆOØ%)×%?Ò%?Ð@WÑ%XÔ%XÐ"Ø×*Ò*¨9°oÐG]Ñ^Ô^ˆIàÐrâ   c                 ó8   — t          j        | j        d|¦  «        S )Nrü   )r  Úsubr  )r  rD  s     rà   rR  z&WhisperTokenizer._filter_timestamp_ids¬  s   € ÝŒv�dÔ(¨"¨dÑ3Ô3Ð3râ   Úclean_up_tokenization_spacesÚoutput_offsetsr2  Údecode_with_timestampsÚ	normalizeÚbasic_normalizeÚremove_diacriticsc
           	      ó\  •‡ — ‰                       ||¬¦  «        } t          ¦   «         j        |f|||||	dœ|
¤Ž}|r‰                      |||¬¦  «        }n9t	          |t
          ¦  «        rˆ fd„|D ¦   «         }n‰                      |¦  «        }|r‰                      ||¬¦  «        }||dœS |S )aò	  
        Converts a sequence of ids in a string, using the tokenizer and vocabulary with options to remove special
        tokens and clean up tokenization spaces.

        Similar to doing `self.convert_tokens_to_string(self.convert_ids_to_tokens(token_ids))`.

        Args:
            token_ids (`Union[int, list[int], np.ndarray, torch.Tensor]`):
                List of tokenized input ids. Can be obtained using the `__call__` method.
            skip_special_tokens (`bool`, *optional*, defaults to `False`):
                Whether or not to remove special tokens in the decoding. Will remove the previous tokens (pre-prompt)
                if present.
            clean_up_tokenization_spaces (`bool`, *optional*):
                Whether or not to clean up the tokenization spaces. If `None`, will default to
                `self.clean_up_tokenization_spaces` (available in the `tokenizer_config`).
            output_offsets (`bool`, *optional*, defaults to `False`):
                Whether or not to output the offsets of the tokens. This should only be set if the model predicted
                timestamps. If there are previous tokens (pre-prompt) to decode, they will only appear in the decoded
                text if they contain timestamp tokens.
            time_precision (`float`, *optional*, defaults to 0.02):
                The time ratio to convert from token to time.
            decode_with_timestamps (`bool`, *optional*, defaults to `False`):
                Whether or not to decode with timestamps included in the raw text.
            normalize (`bool`, *optional*, defaults to `False`):
                Whether or not to apply the English text normalizer to the decoded text. Only applicable when the
                target text is in English. Otherwise, the basic text normalizer should be applied.
            basic_normalize (`bool`, *optional*, defaults to `False`):
                Whether or not to apply the Basic text normalizer to the decoded text. Applicable to multilingual
                target text.
            remove_diacritics (`bool`, *optional*, defaults to `False`):
                Whether or not to remove diacritics when applying the Basic text normalizer. Removing diacritics may
                destroy information in the decoded text, hence it should be used with caution.
            kwargs (additional keyword arguments, *optional*):
                Will be passed to the underlying model specific decode method.
        Returns:
            `str`: The decoded sentence.
        r)  )r*  rk  rn  ro  rp  )r2  r*  c                 ó:   •— g | ]}‰                      |¦  «        ‘ŒS rÜ   )rR  )rÝ   Útr  s     €rà   r_  z+WhisperTokenizer.decode.<locals>.<listcomp>ø  s'   ø€ ÐDÐDÐD¸!˜×2Ò2°1Ñ5Ô5ÐDÐDÐDrâ   )r2  )rD  rS  )rP  r  r/  r?  r  ÚlistrR  r\  )r  r1  r*  rk  rl  r2  rm  rn  ro  rp  r  Úfiltered_idsrD  rS  r   s   `             €rà   r/  zWhisperTokenizer.decode°  s  øø€ ðd ×1Ò1ØØ 3ð 2ñ 
ô 
ˆð
 �u‰wŒwŒ~Øð
à 3Ø)EØØ+Ø/ð
ð 
ð ð
ð 
ˆð "ð 
	8à×/Ò/Ø¨^ÐQdð 0ñ ô ˆDˆDõ
 ˜$¥Ñ%Ô%ð 8ØDÐDÐDÐD¸tÐDÑDÔD��à×1Ò1°$Ñ7Ô7�ð ð 	6Ø×+Ò+¨IÀnÐ+ÑUÔUˆGØ ¨WÐ5Ð5Ð5Øˆrâ   )rn  ro  rp  c                ó¢   •—  t          ¦   «         j        |i |¤Ž}|r|                      |¦  «        }|S |r|                      ||¬¦  «        }|S |S )N©rp  )r  rQ  rn  ro  )	r  rn  ro  rp  Úargsr  rD  Ú
clean_textr   s	           €rà   rQ  zWhisperTokenizer._decode  sj   ø€ ð �u‰wŒwŒ Ð/¨Ð/Ð/ˆàð 	ØŸš¨Ñ-Ô-ˆJØÐØð 	Ø×-Ò-¨dÐFWÐ-ÑXÔXˆJØÐàˆKrâ   c                 ó@   — t          | j        ¦  «        } ||¦  «        S )z’
        Normalize a given string using the `EnglishTextNormalizer` class, which performs commons transformation on
        english text.
        )r   r  )r  rD  Ú
normalizers      rà   rn  zWhisperTokenizer.normalize  s$   € õ
 +¨4Ô+KÑLÔLˆ
Øˆz˜$ÑÔÐrâ   c                 ó8   — t          |¬¦  «        } || ¦  «        S )z•
        Normalize a given string using the `BasicTextNormalizer` class, which performs commons transformation on
        multilingual text.
        rw  )r   )rD  rp  r{  s      rà   ro  z WhisperTokenizer.basic_normalize  s%   € õ )Ð;LÐMÑMÔMˆ
Øˆz˜$ÑÔÐrâ   Úsave_directoryÚfilename_prefixc           	      ó  — t           j                             |¦  «        s t                               d|› d�¦  «         d S t           j                             ||r|dz   ndt          d         z   ¦  «        }t           j                             ||r|dz   ndt          d         z   ¦  «        }t           j                             ||r|dz   ndt          d         z   ¦  «        }t          |dd	¬
¦  «        5 }|                     t          j
        | j        ddd¬¦  «        dz   ¦  «         d d d ¦  «         n# 1 swxY w Y   t          |dd	¬
¦  «        5 }|                     d¦  «         |                     d„ | j        D ¦   «         ¦  «         d d d ¦  «         n# 1 swxY w Y   | j        �]t          |dd	¬
¦  «        5 }|                     t          j
        | j        ddd¬¦  «        dz   ¦  «         d d d ¦  «         n# 1 swxY w Y   |||fS )NzVocabulary path (z) should be a directoryú-rü   r   r   r   Úwr  r	  r'  TF)ÚindentÚ	sort_keysÚensure_asciiú
z#version: 0.2
c              3   óF   K  — | ]}d                       |¦  «        dz   V — ŒdS )ú r…  N)r0  )rÝ   Ú
merge_pairs     rà   ú	<genexpr>z3WhisperTokenizer.save_vocabulary.<locals>.<genexpr>5  s3   è è € ÐYÐY¸j˜cŸhšh zÑ2Ô2°TÑ9ÐYÐYÐYÐYÐYÐYrâ   )ÚosÚpathÚisdirÚloggerÚerrorr0  ÚVOCAB_FILES_NAMESr  Úwriter  Údumpsr  Ú
writelinesr  r  )r  r}  r~  r   Ú
merge_filer   ÚfÚwriters           rà   Úsave_vocabularyz WhisperTokenizer.save_vocabulary!  sî  € ÝŒw�}Š}˜^Ñ,Ô,ð 	Ý�LŠLÐT¨^ÐTÐTÐTÑUÔUÐUØˆFå”W—\’\Ø°oÐM˜_¨sÑ2Ð2È2ÕQbÐcoÔQpÑpñ
ô 
ˆ
õ ”W—\’\Ø°oÐM˜_¨sÑ2Ð2È2ÕQbÐcpÔQqÑqñ
ô 
ˆ
õ œ'Ÿ,š,Ø°oÐM˜_¨sÑ2Ð2È2ÕQbÐctÔQuÑuñ
ô 
ˆõ �*˜c¨GÐ4Ñ4Ô4ð 	b¸Ø�GŠG•D”J˜tœ{°1ÀÐSXÐYÑYÔYÐ\`Ñ`ÑaÔaÐað	bð 	bð 	bñ 	bô 	bð 	bð 	bð 	bð 	bð 	bð 	bøøøð 	bð 	bð 	bð 	bõ �*˜c¨GÐ4Ñ4Ô4ð 	Z¸Ø�LŠLÐ*Ñ+Ô+Ð+Ø×ÒÐYÐYÈDÌLÐYÑYÔYÑYÔYÐYð	Zð 	Zð 	Zñ 	Zô 	Zð 	Zð 	Zð 	Zð 	Zð 	Zð 	Zøøøð 	Zð 	Zð 	Zð 	Zð Ô+Ð7Ý�o s°WÐ=Ñ=Ô=ð ÀØ—’Ý”J˜tÔ?ÈÐUYÐhmÐnÑnÔnÐquÑuñô ð ðð ð ñ ô ð ð ð ð ð ð øøøð ð ð ð ð
 ˜J¨Ð8Ð8s6   Ã14D1Ä1D5Ä8D5Å:FÆFÆFÆ84G8Ç8G<Ç?G<rß   r  r  c           	      óx  — |�|n| j         | _         |�|n| j        | _        |�|n| j        | _        | j        }|                      |¦  «        }| j        }| j        }d                     d„ |D ¦   «         ¦  «        }t          j	        |› d|› d�|› d|› d�||fgt          ||¦  «        ¢¬¦  «        | j        _        dS )	aÆ  
        Override the prefix tokens appended to the start of the label sequence. This method can be used standalone to
        update the prefix tokens as required when fine-tuning. Example:

        ```python
        >>> # instantiate the tokenizer and set the prefix token to Spanish
        >>> tokenizer = WhisperTokenizerFast.from_pretrained("openai/whisper-tiny", language="spanish")
        >>> # now switch the prefix token from Spanish to French
        >>> tokenizer.set_prefix_tokens(language="french")
        ```

        Args:
            language (`str`, *optional*, defaults to `None`):
                The language of the transcription text.
            task (`str`, *optional*, defaults to `None`):
                Task identifier to append at the start of sequence (if any).
            predict_timestamps (`bool`, *optional*, defaults to `None`):
                Whether to omit the `<|notimestamps|>` token at the start of the sequence.
        Nr‡  c                 ó   — g | ]}|› d �‘ŒS )ú:0rÜ   ©rÝ   r:  s     rà   r_  z6WhisperTokenizer.set_prefix_tokens.<locals>.<listcomp>]  s   € Ð#GÐ#GÐ#G°U u L L LÐ#GÐ#GÐ#Grâ   z $A:0 r™  z $A:0 $B:1 z:1)ÚsingleÚpairÚspecial_tokens)rß   r  r  Úprefix_tokensÚconvert_ids_to_tokensr  Úeos_token_idr0  r   ÚTemplateProcessingÚzipÚbackend_tokenizerÚpost_processor)	r  rß   r  r  Úprefix_token_idsÚprefixesÚeosr   Úprefix_templates	            rà   r  z"WhisperTokenizer.set_prefix_tokens?  sö   € ð, %-Ð$8˜˜¸d¼mˆŒØ Ð,�D�D°$´)ˆŒ	Ø8JÐ8VÐ"4Ð"4Ð\`Ô\sˆÔàÔ-ÐØ×-Ò-Ð.>Ñ?Ô?ˆØŒnˆØÔ(ˆØŸ(š(Ð#GÐ#G¸hÐ#GÑ#GÔ#GÑHÔHˆÝ0:Ô0MØ%Ð4Ð4¨SÐ4Ð4Ð4Ø#Ð7Ð7°Ð7Ð7Ð7à�lÐ#ðå�XÐ/Ñ0Ô0ðð1
ñ 1
ô 1
ˆÔÔ-Ð-Ð-râ   c           	      ó6  — |                       d¦  «        }|                       d¦  «        }|                       d¦  «        }|                       d¦  «        }t          t                               ¦   «         ¦  «        }| j        �æ| j                             ¦   «         | _        | j        t          v rt          | j                 }n§| j        t                               ¦   «         v r| j        }nt          | j        ¦  «        dk    }t          d| j        › d|r&t          t                               ¦   «         ¦  «        n%t          t                               ¦   «         ¦  «        › d�¦  «        ‚| j        �-| j        t          vrt          d	| j        › d
t          › �¦  «        ‚|g}| j        �.|                     |dz   |                     |¦  «        z   ¦  «         | j        �"|                     | j        dk    r|n|¦  «         | j        s|                     |¦  «         |S )Nre  z<|translate|>z<|transcribe|>ú<|notimestamps|>r'  zUnsupported language: z. Language should be one of: ú.zUnsupported task: z. Task should be in: r   rð   )r`  ÚtupleÚ	LANGUAGESÚkeysrß   ÚlowerÚTO_LANGUAGE_CODEÚvaluesrK  rL  rt  r  ÚTASK_IDSr.  Úindexr  )	r  Úbos_token_idÚtranslate_token_idÚtranscribe_token_idÚnotimestamps_token_idÚlangsÚlanguage_idÚis_language_codeÚbos_sequences	            rà   rž  zWhisperTokenizer.prefix_tokensg  s  € ð ×1Ò1Ð2IÑJÔJˆØ!×7Ò7¸ÑHÔHÐØ"×8Ò8Ð9IÑJÔJÐØ $× :Ò :Ð;MÑ NÔ NÐÝ•i—n’nÑ&Ô&Ñ'Ô'ˆàŒ=Ð$Ø œM×/Ò/Ñ1Ô1ˆDŒMØŒ}Õ 0Ð0Ð0Ý.¨t¬}Ô=��Ø”Õ"2×"9Ò"9Ñ";Ô";Ð;Ð;Ø"œm��å#& t¤}Ñ#5Ô#5¸Ò#:Ð Ý ðr¨T¬]ð rð rØ;KÐn�Õ-×4Ò4Ñ6Ô6Ñ7Ô7Ð7ÕQUÕVf×VkÒVkÑVmÔVmÑQnÔQnðrð rð rñô ð ð
 Œ9Ð ØŒy¥Ð(Ð(Ý Ð!`°d´iÐ!`Ð!`ÕV^Ð!`Ð!`ÑaÔaÐaà$�~ˆØŒ=Ð$Ø×Ò ¨qÑ 0°5·;²;¸{Ñ3KÔ3KÑ KÑLÔLÐLØŒ9Ð Ø×Ò°t´yÀLÒ7PÐ7PÐ 3Ð 3ÐVhÑiÔiÐiØÔ&ð 	7Ø×ÒÐ 5Ñ6Ô6Ð6ØÐrâ   c                 óX   — |€| j         |z   | j        gz   S | j         |z   |z   | j        gz   S )z=Build model inputs from a sequence by appending eos_token_id.)rž  r   )r  Útoken_ids_0Útoken_ids_1s      rà   Ú build_inputs_with_special_tokensz1WhisperTokenizer.build_inputs_with_special_tokens‹  s?   € àÐØÔ%¨Ñ3°tÔ7HÐ6IÑIÐIàÔ! KÑ/°+Ñ=ÀÔARÐ@SÑSÐSrâ   r½  r¾  Úalready_has_special_tokensc                 ó  •— |r$t          ¦   «                              ||d¬¦  «        S dgt          | j        ¦  «        z  }dg}|€|dgt          |¦  «        z  z   |z   S |dgt          |¦  «        z  z   dgt          |¦  «        z  z   |z   S )aÄ  
        Retrieve sequence ids from a token list that has no special tokens added. This method is called when adding
        special tokens using the tokenizer `prepare_for_model` method.

        Args:
            token_ids_0 (`list[int]`):
                List of IDs.
            token_ids_1 (`list[int]`, *optional*):
                Optional second list of IDs for sequence pairs.
            already_has_special_tokens (`bool`, *optional*, defaults to `False`):
                Whether or not the token list is already formatted with special tokens for the model.

        Returns:
            `list[int]`: A list of integers in the range [0, 1]: 1 for a special token, 0 for a sequence token.
        T)r½  r¾  rÀ  r   Nr   )r  Úget_special_tokens_maskrK  rž  )r  r½  r¾  rÀ  Úprefix_onesÚsuffix_onesr   s         €rà   rÂ  z(WhisperTokenizer.get_special_tokens_mask“  s¯   ø€ ð& &ð 	Ý‘7”7×2Ò2Ø'°[Ð]að 3ñ ô ð ð �c�C Ô 2Ñ3Ô3Ñ3ˆØ�cˆØÐØ 1 #­¨KÑ(8Ô(8Ñ"8Ñ9¸KÑGÐGØ˜q˜c¥C¨Ñ$4Ô$4Ñ4Ñ5¸!¸½sÀ;Ñ?OÔ?OÑ9OÑPÐS^Ñ^Ð^râ   Tc                 óˆ   — |                       ||| ¬¦  «         | j        dd …         }d„ t          |¦  «        D ¦   «         }|S )N)r  rß   r  r   c                 ó"   — g | ]\  }}|d z   |f‘ŒS )r   rÜ   )rÝ   Úrankr:  s      rà   r_  z;WhisperTokenizer.get_decoder_prompt_ids.<locals>.<listcomp>¹  s%   € Ð\Ð\Ð\±K°D¸%˜t a™x¨Ð/Ð\Ð\Ð\râ   )r  rž  r,  )r  r  rß   Úno_timestampsÚforced_tokensÚforced_decoder_idss         rà   Úget_decoder_prompt_idsz'WhisperTokenizer.get_decoder_prompt_ids²  sV   € Ø×Ò D°8ÐTaÐPaÐÑbÔbÐbð
 Ô*¨1¨2¨2Ô.ˆØ\Ð\Å9È]ÑC[ÔC[Ð\Ñ\Ô\ÐØ!Ð!râ   c                ó*   — t          | ||||¬¦  «        S )N)Úreturn_timestampsÚreturn_languager2  )Ú_decode_asr)r  Úmodel_outputsrÍ  rÎ  r2  s        rà   rÏ  zWhisperTokenizer._decode_asr¼  s(   € ÝØØØ/Ø+Ø)ð
ñ 
ô 
ð 	
râ   rH  rD  c                 ó2  ‡ —  ‰ dd|                      ¦   «         z   d¬¦  «        }|d         dd…         }t          ˆ fd„|D ¦   «         d¦  «        }|�(‰                      |¦  «        }t          d	|› d
�¦  «        ‚|                     |¬¦  «         |d         S )z`Converts prompt text to IDs that can be passed to [`~WhisperForConditionalGeneration.generate`].rd  r‡  F)Úadd_special_tokensró   r   Nc              3   ó>   •K  — | ]}|‰j         d          k    ¯|V — ŒdS )r   N)r+  )rÝ   Úxr  s     €rà   r‰  z2WhisperTokenizer.get_prompt_ids.<locals>.<genexpr>Ì  s6   øè è € Ð \Ð \ q¸qÀDÔDXÐYZÔD[Ò?[Ð?[ Ð?[Ð?[Ð?[Ð?[Ð \Ð \râ   zJEncountered text in the prompt corresponding to disallowed special token: r«  )Útensor_type)ÚstripÚnextrŸ  rL  Úconvert_to_tensors)r  rD  Úreturn_tensorsÚbatch_encodingÚprompt_text_idsÚspecial_token_idr:  s   `      rà   Úget_prompt_idszWhisperTokenizer.get_prompt_idsÆ  sº   ø€ à˜Ð/°°t·z²z±|´|Ñ1CÐX]Ð^Ñ^Ô^ˆð )¨Ô5°a°b°bÔ9ˆÝÐ \Ð \Ð \Ð \¨OÐ \Ñ \Ô \Ð^bÑcÔcÐØÐ'Ø×.Ò.Ð/?Ñ@Ô@ˆEÝÐrÐjoÐrÐrÐrÑsÔsÐsà×)Ò)°nÐ)ÑEÔEÐEØ˜kÔ*Ð*râ   r1  rg  rh  c                 óÄ   — t          |t          ¦  «        s|                      |¦  «        }|s|S |d         |k    }|r#||v r||                     |¦  «        d …         S g S |S )Nr   )r  rt  Ú_convert_to_listr³  )r  r1  rg  rh  Ú
has_prompts        rà   rf  zWhisperTokenizer._strip_promptÕ  s�   € Ý˜)¥TÑ*Ô*ð 	9Ø×-Ò-¨iÑ8Ô8ˆIð ð 	ØÐà˜q”\ _Ò4ˆ
Øð 	Ø%¨Ð2Ð2Ø  §¢Ð1GÑ!HÔ!HÐ!JÐ!JÔKÐKà�	àÐrâ   c                 óÎ   — t          | d¦  «        r&|                      ¦   «                              ¦   «         } t          | t          j        ¦  «        r|                      ¦   «         } | S )NÚnumpy)rF  rB  râ  r  rH  ÚndarrayÚtolist)r1  s    rà   rß  z!WhisperTokenizer._convert_to_listç  sZ   € õ �9˜gÑ&Ô&ð 	0Ø!Ÿš™œ×-Ò-Ñ/Ô/ˆIå�i¥¤Ñ,Ô,ð 	+Ø!×(Ò(Ñ*Ô*ˆIØÐrâ   )
NNNrõ   rõ   rõ   FNNF)Fr!  r"  )r!  r"  )r!  )F)FNFr!  FFFF©N)NNN)NF)NNT)rH  )(Ú__name__Ú
__module__Ú__qualname__Ú__doc__r�  Úvocab_files_namesÚmodel_input_namesr	   Úmodelr  ÚdictÚintr  r?  r\  r   rb  ÚboolrP  rR  r-  r/  rQ  rn  Ústaticmethodro  r¬  r–  r  Úpropertyrt  rž  r¿  rÂ  rË  rÏ  rÝ  rf  rß  Ú__classcell__)r   s   @rà   rò   rò   £   s@  ø€ € € € € ð$ð $ðL *ÐØ$Ð&6Ð7ÐØ€Eð .2ØØØ!Ø!Ø!ØØØØ ðF!ð F!à�T˜#˜s˜(”^Ñ# dÑ*ðF!ð F!ð F!ð F!ð F!ð F!ðT W[ð.(ð .(à	ð.(ð .(ð .(ð .(ð .(ð .(ðbBð Bð Bð BðH ðjð jð jñ „Yðjðð ÀDð ð ð ð ð&4ð 4ð 4ð %*Ø48Ø$Ø $Ø',ØØ %Ø"'ðPð Pð "ðPð '+¨T¡kð	Pð
 ðPð ðPð !%ðPð ðPð ðPð  ðPð 
ðPð Pð Pð Pð Pð Pðf (-ÀeÐglðð ð Ø $ðØ?CðØ`dðà	ðð ð ð ð ð ð ð  ð  ð ð ð  ð  ñ „\ð ð9ð 9¨cð 9ÀCÈ$ÁJð 9ÐZ_Ð`cÔZdð 9ð 9ð 9ð 9ð> gkð&
ð &
Ø˜d™
ð&
Ø14°t±ð&
ØX\Ð_cÑXcð&
ð &
ð &
ð &
ðP ð˜t Cœyð ð ð ñ „XððDTð TÐQUÐVYÔQZð Tð Tð Tð Tð puð_ð _Ø œ9ð_Ø37¸´9¸tÑ3Cð_Øhlð_à	ˆcŒð_ð _ð _ð _ð _ð _ð>"ð "ð "ð "ð
ð 
ð 
ð+ð + 3ð +ð +ð +ð +ð t¨C¤yð À3ð Ð`cð ð ð ð ð$ ðð ñ „\ðð ð ð ð râ   rò   õ   "'â€œÂ¡Â¿([{-õ   "'.ã€‚,ï¼Œ!ï¼�?ï¼Ÿ:ï¼šâ€�)]}ã€�Útokensrß   Úprepend_punctuationsÚappend_punctuationsc                 ó¦   — |€| j         }|€d}|dv rt          | |¦  «        \  }}}nt          | |¦  «        \  }}}t          |||||¦  «         |||fS ©z©
    Groups tokens by word. Returns a tuple containing a list of strings with the words, and a list of `token_id`
    sequences with the tokens making up each word.
    Nr   >   r¯   rQ   r   r¿   r#   rË   ©rß   Ú_split_tokens_on_unicodeÚ_split_tokens_on_spacesÚ_merge_punctuations©Ú	tokenizerrõ  rß   rö  r÷  ÚwordsÚword_tokensÚtoken_indicess           rà   Ú_combine_tokens_into_wordsr  ó  ó}   € ð ÐØÔ%ˆØÐØˆàÐQÐQÐQå,DÀYÐPVÑ,WÔ,WÑ)ˆˆ{˜M˜Må,CÀIÈvÑ,VÔ,VÑ)ˆˆ{˜Må˜˜{¨MÐ;OÐQdÑeÔeÐeØ�+˜}Ð,Ð,râ   c           
      ó¼  ‡‡‡‡‡‡— | d         }t          |¦  «        }g }‰r
‰d         Šg }t          | dd …         ¦  «        D �]Ð\  Š}d}||ddf}t          |¦  «        }	t          d||	z   ¦  «        D �]}
|
dz  }t          d||
z
  ¦  «        Št	          |||	z   |
z
  ¦  «        }t          j        |‰|…         ¦  «        }t          d|
|z
  ¦  «        Št	          |	|
¦  «        }t          j        |‰|…         ¦  «        Št          |¦  «        t          ‰¦  «        k    rt          d¦  «        ‚‰r.t          ˆˆˆˆˆˆfd„t          |¦  «        D ¦   «         ¦  «        }nt          j        |‰k    ¦  «        }||
z  |z   }|dk    r||k    r|}‰|‰|f}�Œ!|\  Š}Š}|‰z   dz  }|‰z   dz  }| 	                    |d |…         ¦  «         ||d …         }t          |¦  «        }‰r0| 	                    ‰d |…         ¦  «         ‰‰dz            |d …         Š�ŒÒ| 	                    |¦  «         ‰€|S t          ‰¦  «        dk    r| 	                    ‰¦  «         ||fS |g fS )Nr   r   r&  ç     ˆÃ@úiThere is a bug within whisper `decode_asr` function, please report it. Dropping to prevent bad inference.c              3   ó|   •K  — | ]6\  }}|‰|         k    r%‰‰|z            ‰‰d z            ‰|z            k    ¯2d V — Œ7dS ©r   NrÜ   ©	rÝ   ÚidxÚelemÚ
left_startÚleft_token_timestamp_sequenceÚrightÚright_startÚseq_idxÚtoken_timestamp_sequencess	      €€€€€€rà   r‰  z0_find_longest_common_sequence.<locals>.<genexpr>V  ó~   øè è € ð ð á!˜˜Tà  c¤
Ò*Ð*Ø9¸*ÀsÑ:JÔKØ4°W¸q±[ÔAÀ+ÐPSÑBSÔTòUð Uð	 ðUð Uð Uð Uðð râ   r'  ©
rK  r,  ra  ÚmaxÚminrH  rI  ÚRuntimeErrorrN  Úextend©Ú	sequencesr  Úleft_sequenceÚleft_lengthÚtotal_sequenceÚtotal_token_timestamp_sequenceÚright_sequenceÚmax_Úmax_indicesÚright_lengthr9  ÚepsÚ	left_stopÚleftÚ
right_stopÚmatchesÚmatchingÚleft_midÚ	right_midr  r  r  r  r  s    `                 @@@@@rà   Ú_find_longest_common_sequencer+    ó  øøøøøø€ ð ˜a”L€MÝ�mÑ$Ô$€KØ€Nà ð ,Ø(AÀ!Ô(DÐ%Ø)+Ð&å#,¨Y°q°r°r¬]Ñ#;Ô#;ð [_ñ [_Ñˆ�àˆØ" K°°AÐ6ˆõ< ˜>Ñ*Ô*ˆÝ�q˜+¨Ñ4Ñ5Ô5ð (	Oñ (	OˆAà�g‘+ˆCõ
 ˜Q ¨a¡Ñ0Ô0ˆJÝ˜K¨°|Ñ)CÀaÑ)GÑHÔHˆIÝ”8˜M¨*°YÐ*>Ô?Ñ@Ô@ˆDå˜a  [¡Ñ1Ô1ˆKÝ˜\¨1Ñ-Ô-ˆJÝ”H˜^¨K¸
Ð,BÔCÑDÔDˆEõ �4‰yŒy�C ™JœJÒ&Ð&Ý"Øñô ð ð )ð 0õ ð ð ð ð ð ð ð ð ð å%.¨t¡_¤_ðñ ô ñ ô ��õ œ& ¨¢Ñ/Ô/�à ‘{ SÑ(ˆHØ˜Š{ˆ{˜x¨$š˜Ø�Ø)¨9°kÀ:ÐN�ùà;FÑ8ˆ�Y ¨Zð  
Ñ*¨qÑ0ˆØ +Ñ-°!Ñ3ˆ	Ø×Ò˜m¨I¨X¨IÔ6Ñ7Ô7Ð7Ø& y z zÔ2ˆÝ˜-Ñ(Ô(ˆà$ð 	_Ø*×1Ò1Ð2OÐPYÐQYÐPYÔ2ZÑ[Ô[Ð[Ø,EÀgÐPQÁkÔ,RÐS\ÐS]ÐS]Ô,^Ð)ùà×Ò˜-Ñ(Ô(Ð(à Ð(ØÐå
Ð$Ñ%Ô%¨Ò)Ð)Ø&×-Ò-Ð.KÑLÔLÐLØÐ=Ð=Ð=à˜rÐ!Ð!râ   r"  )r3  c          	      ó$  ‡/— dŠ/ˆ/fd„}g } |¦   «         }d}	|                       d¦  «        dz   }
g }g }d}d}t          | j        ¦  «        }|                       d¦  «        }|                       d¦  «        }t          |¦  «        D �]é\  }}|d	         d
                              ¦   «         }|                      |||¦  «        }|dk    r |d         d
                              ¦   «         }d}|
}d}d}d}d|v rL|d         \  }}}|	|z  }	||z
  }|r||z  |
z   }|r*t          |¦  «        D ]}||
k    r|�||
z
  |z  |k     r n|}Œg }g } t          |¦  «        D �]¬\  }!}||v r°|                      |g¦  «        }"|"dd…         }"t           	                    |"¦  «        }#|#�s‰/ri|#‰/k    rc|sa| 
                    |¦  «         t          |¦  «        }$|                      |$¦  «        }%|%|d<   | 
                    |¦  «         g }g } |¦   «         }|#|d<   |#Š/Œ¹Œº||
k    �rjt          ||
z
  |z  ¦  «        }&|&|k     r7|!dk    o||!dz
           |
k    o||!dz
           |
k     }'|'r	|||z  z  }n|}||z  }|}|&}||
z
  |z  |	z   |z   }(t          |(d¦  «        }(|r
||k    rd}�ŒA|s|r
||k     rd}�ŒO|d         d
         €|(|d         d
<   �Œj|(|d         d
         k    r�Œ~|(|d         d<   | 
                    |¦  «         |dk    r| 
                    | ¦  «         t          ||¦  «        \  }$})|                      |$¦  «        }%|%|d<   |dk    rt          | |$|)‰/|¦  «        |d<   | 
                    |¦  «         g }g }g }g }  |¦   «         }�Œ+| 
                    |¦  «         |dk    rf|!d
k    rt          d|	z   d¦  «        }*nt          ||!dz
           |	z   d¦  «        }*t          ||!         |	z   d¦  «        }+|  
                    |*|+f¦  «         �Œ®d|v r|	||z
  z  }	|r2| 
                    |¦  «         |dk    r| 
                    | ¦  «         �Œ¾t          d„ |D ¦   «         ¦  «        s |¦   «         }g }g }g }g } �Œë|rz|rt                                d¦  «         t          ||¦  «        \  }$})|                      |$¦  «        }%|%|d<   |dk    rt          | |$|)‰/|¦  «        |d<   | 
                    |¦  «         d                     d„ |D ¦   «         ¦  «        },|s|r~|D ]I}|s|                     d¦  «         nt)          |d         ¦  «        |d<   |s|                     d¦  «         ŒJ|dk    r'g }-|D ]}|-                     |d         ¦  «         Œd|-i}.nd|i}.ni }.|,|.fS )z¸
    Internal method meant to only be used by asr pipeline. Handles all the little quirks specific to whisper to handle
    the various options not allowed in other seq2seq models
    Nc                  ó   •— ‰ d d gddœS )Nrü   )rß   r;  rD  rÜ   )Úlast_languages   €rà   Ú	new_chunkz_decode_asr.<locals>.new_chunk™  s   ø€ Ø)¸¸t¸ÈbÐQÐQÐQrâ   r&  rª  r   Frd  re  rõ  r   ÚwordÚtoken_timestampsÚstrider'  r(  rD  rß   Tr;  r   c              3   ó   K  — | ]}|V — Œd S rå  rÜ   )rÝ   Úps     rà   r‰  z_decode_asr.<locals>.<genexpr>Q  s"   è è € Ð1Ð1˜A�aÐ1Ð1Ð1Ð1Ð1Ð1râ   zµWhisper did not predict an ending timestamp, which can happen if audio is cut off in the middle of a word. Also make sure WhisperTimeStampLogitsProcessor was used during generation.rü   c              3   ó&   K  — | ]}|d          V — ŒdS )rD  NrÜ   )rÝ   Úchunks     rà   r‰  z_decode_asr.<locals>.<genexpr>k  s&   è è € Ð:Ð:¨%˜˜fœÐ:Ð:Ð:Ð:Ð:Ð:râ   Úchunks)r`  Úsetr+  r,  rä  rf  Úreversedr/  r­  Úgetr.  r+  r-  ÚroundÚ_collate_word_timestampsÚanyr�  Úwarningr0  Úpopr¬  r  )0rÿ  rÐ  rÍ  rÎ  r2  r3  r0  r8  r7  Útime_offsetr4  Úprevious_tokensÚprevious_token_timestampsÚskipÚright_stride_startr+  rg  rh  Úchunk_idÚoutputr1  r2  Úlast_timestampÚfirst_timestampr6  r7  r8  Ú	chunk_lenÚstride_leftÚstride_rightr:  Úcurrent_tokensÚcurrent_token_timestampsr9  rD  rß   Úresolved_tokensÚresolved_textr;  r<  ÚtimeÚresolved_token_timestampsÚ
start_timeÚend_timeÚ	full_textÚ
new_chunksÚoptionalr/  s0                                                  @rà   rÏ  rÏ  …  sÕ  ø€ ð$ €MðRð Rð Rð Rð Rð €FØˆI‰KŒK€EØ€KØ×5Ò5Ð6HÑIÔIÈAÑM€OØ€OØ "ÐØ€DØÐå˜)Ô3Ñ4Ô4€OØ×5Ò5Ð6GÑHÔH€OØ&×<Ò<Ð=TÑUÔUÐå% mÑ4Ô4ð l*ñ l*Ñˆ�&ð ˜8Ô$ QÔ'×.Ò.Ñ0Ô0ˆ	à×+Ò+¨I°ÐH^Ñ_Ô_ˆ	Ø Ò&Ð&Ø%Ð&8Ô9¸!Ô<×CÒCÑEÔEÐð
 ˆØ)ˆð  ÐØÐØ #Ðà�vÐÐØ39¸(Ô3CÑ0ˆI�{ Là˜;Ñ&ˆKØ!*¨\Ñ!9Ðð ð QØ"-°Ñ">ÀÑ"P�Øð 
/Ý% iÑ0Ô0ð 	/ð 	/�EØ Ò/Ð/ð +Ð6Ø!&¨Ñ!8¸NÑ JÐM_Ò _Ð _à!˜EØ).˜øàˆØ#%Ð õ " )Ñ,Ô,ð l	Lñ l	L‰HˆAˆuð ˜Ð'Ð'à ×'Ò'¨¨Ñ0Ô0�à˜A˜b˜D”z�Ý$Ÿ=š=¨Ñ.Ô.�ØÐ'ð %ð 
,¨°]Ò)BÐ)BÐK\Ð)BØ'×.Ò.¨~Ñ>Ô>Ð>Ý*GÈÑ*XÔ*X˜Ø(1×(8Ò(8¸Ñ(IÔ(I˜Ø(5˜˜f™ØŸš eÑ,Ô,Ð,ð +-˜Ø)+˜Ø ) 	¡¤˜Ø(0�E˜*Ñ%Ø$,�M�Mð Ø˜/Ò)Ñ)õ " 5¨?Ñ#:¸nÑ"LÑMÔM�	ØÐ0Ò0Ð0à-.°!ªVð .Ø! ! a¡%Ô(¨OÒ;ÐcÀ	È!ÈaÉ%Ô@PÐTcÒ@cð9Ð*ð .ð CØ)¨^¸lÑ-JÑJÐ)Ð)à,AÐ)Ø)Ð-BÑBÐ)à(9Ð%Ø$-Ð!à Ñ/°>ÑAÀKÑOÐRcÑc�å˜T 1‘~”~�Ø!ð +, e¨~Ò&=Ð&=ð  �D‘DØð $,˜oð $,°%¸/Ò2IÐ2IØ �D‘DØ˜;Ô'¨Ô*Ð2Ø,0�E˜+Ô& qÑ)Ñ)ð ˜u [Ô1°!Ô4Ò4Ð4ñ à04˜˜kÔ*¨1Ñ-à'×.Ò.¨~Ñ>Ô>Ð>Ø,°Ò6Ð6Ø5×<Ò<Ð=UÑVÔVÐVÝEbØ+Ð-FñFô FÑB˜Ð)Bð )2×(8Ò(8¸Ñ(IÔ(I˜Ø(5˜˜f™Ø,°Ò6Ð6Ý-EØ )¨?Ð<UÐWdÐfuñ.ô .˜E '™Nð Ÿš eÑ,Ô,Ð,ð +-˜Ø)+˜Ø46Ð1Ø35Ð0Ø ) 	¡¤˜™ð
 ×%Ò% eÑ,Ô,Ð,Ø$¨Ò.Ð.Ø˜A’v�vÝ%*¨3°Ñ+<¸aÑ%@Ô%@˜
˜
å%*Ð+;¸AÀ¹EÔ+BÀ[Ñ+PÐRSÑ%TÔ%T˜
Ý$Ð%5°aÔ%8¸;Ñ%FÈÑJÔJ�HØ,×3Ò3°ZÀÐ4JÑKÔKÐKùà�vÐÐØ˜9 |Ñ3Ñ3ˆKð ð 		*Ø×"Ò" >Ñ2Ô2Ð2Ø  FÒ*Ð*Ø)×0Ò0Ð1IÑJÔJÐJùÝÐ1Ð1 Ð1Ñ1Ô1Ñ1Ô1ð 	*Ø�I‘K”KˆEØ ˆOØˆNØ(*Ð%Ø')Ð$ùàð Øð 	Ý�NŠNð]ñô ð õ
 6SØÐ6ñ6
ô 6
Ñ2ˆÐ2ð "×(Ò(¨Ñ9Ô9ˆØ%ˆˆf‰Ø Ò&Ð&Ý5Ø˜?Ð,EÀ}ÐVeñô ˆE�'‰Nð 	�Š�eÑÔÐð —’Ð:Ð:°6Ð:Ñ:Ô:Ñ:Ô:€IØð ˜Oð Øð 	&ð 	&ˆEØ$ð ?Ø—	’	˜+Ñ&Ô&Ð&Ð&å%*¨5°Ô+=Ñ%>Ô%>��kÑ"Ø"ð &Ø—	’	˜*Ñ%Ô%Ð%øà Ò&Ð&ØˆJØð 2ð 2�Ø×!Ò! %¨¤.Ñ1Ô1Ð1Ð1Ø  *Ð-ˆHˆHà  &Ð)ˆHˆHàˆØ�hÐÐrâ   c           
      ó¼  ‡‡‡‡‡‡— | d         }t          |¦  «        }g }‰r
‰d         Šg }t          | dd …         ¦  «        D �]Ð\  Š}d}||ddf}t          |¦  «        }	t          d||	z   ¦  «        D �]}
|
dz  }t          d||
z
  ¦  «        Št	          |||	z   |
z
  ¦  «        }t          j        |‰|…         ¦  «        }t          d|
|z
  ¦  «        Št	          |	|
¦  «        }t          j        |‰|…         ¦  «        Št          |¦  «        t          ‰¦  «        k    rt          d¦  «        ‚‰r.t          ˆˆˆˆˆˆfd„t          |¦  «        D ¦   «         ¦  «        }nt          j        |‰k    ¦  «        }||
z  |z   }|dk    r||k    r|}‰|‰|f}�Œ!|\  Š}Š}|‰z   dz  }|‰z   dz  }| 	                    |d |…         ¦  «         ||d …         }t          |¦  «        }‰r0| 	                    ‰d |…         ¦  «         ‰‰dz            |d …         Š�ŒÒ| 	                    |¦  «         ‰€|S t          ‰¦  «        dk    r| 	                    ‰¦  «         ||fS |g fS )Nr   r   r&  r  r  c              3   ó|   •K  — | ]6\  }}|‰|         k    r%‰‰|z            ‰‰d z            ‰|z            k    ¯2d V — Œ7dS r	  rÜ   r
  s	      €€€€€€rà   r‰  z0_find_longest_common_sequence.<locals>.<genexpr>Ê  r  râ   r'  r  r  s    `                 @@@@@rà   r+  r+  �  r,  râ   c                 ó~   ‡‡	— t          | ||¦  «        \  }}}|rd|ini Š	ˆ	ˆfd„t          ||¦  «        D ¦   «         }|S )Nrß   c                 óp   •— g | ]2\  }}|‰|d                   d          ‰|d                  d         fdœ‰¥‘Œ3S )r   r%  r   rC  rÜ   )rÝ   r1  ÚindicesÚoptional_language_fieldr2  s      €€rà   r_  z,_collate_word_timestamps.<locals>.<listcomp>þ  sj   ø€ ð ð ð ñ ˆD�'ð	 Ø*¨7°1¬:Ô6°qÔ9Ð;KÈGÐTVÌKÔ;XÐYZÔ;[Ð\ð	
ð 	
ð &ð	
ðð ð râ   )r  r¢  )
rÿ  rõ  r2  rß   rÎ  r   Ú_r  Útimingsr]  s
     `      @rà   r=  r=  ù  sq   øø€ Ý8¸ÀFÈHÑUÔUÑ€Eˆ1ˆmà8GÐO˜z¨8Ð4Ð4ÈRÐðð ð ð ð õ ! ¨Ñ6Ô6ðñ ô €Gð €Nrâ   c                 ó¦   — |€| j         }|€d}|dv rt          | |¦  «        \  }}}nt          | |¦  «        \  }}}t          |||||¦  «         |||fS rù  rú  rþ  s           rà   r  r  	  r  râ   c                 óJ  — |                       |d¬¦  «        }d}g }g }g }g }g }d}	t          |¦  «        D ]ê\  }
}|                     |¦  «         |                     |
¦  «         |                       |d¬¦  «        }||vsK|	|                     |¦  «        z   t	          |¦  «        k    s"||	|                     |¦  «        z            |k    rU|                     |¦  «         |                     |¦  «         |                     |¦  «         g }g }|	t	          |¦  «        z  }	Œë|||fS )zlCombine tokens into words by splitting at any position where the tokens are decoded as valid unicode points.T)rm  u   ï¿½r   )r/  r,  r.  r³  rK  )rÿ  rõ  Údecoded_fullÚreplacement_charr   r  r  rM  Úcurrent_indicesÚunicode_offsetÚ	token_idxr:  Údecodeds                rà   rû  rû  #  sQ  € à×#Ò# FÀ4Ð#ÑHÔH€LØÐà€EØ€KØ€MØ€NØ€OØ€Nå% fÑ-Ô-ð +ð +Ñˆ	�5Ø×Ò˜eÑ$Ô$Ð$Ø×Ò˜yÑ)Ô)Ð)Ø×"Ò" >È$Ð"ÑOÔOˆð  GÐ+Ð+Ø §¢Ð.>Ñ ?Ô ?Ñ?Å3À|ÑCTÔCTÒTÐTØ˜N¨W¯]ª]Ð;KÑ-LÔ-LÑLÔMÐQaÒaÐaà�LŠL˜Ñ!Ô!Ð!Ø×Ò˜~Ñ.Ô.Ð.Ø× Ò  Ñ1Ô1Ð1ØˆNØ ˆOØ�c '™lœlÑ*ˆNøà�+˜}Ð,Ð,râ   c                 ó"  — t          | |¦  «        \  }}}g }g }g }t          |||¦  «        D ]ß\  }}	}
|	d         | j        k    }|                     d¦  «        }|                     ¦   «         dv }|s|s|st          |¦  «        dk    r@|                     |¦  «         |                     |	¦  «         |                     |
¦  «         Œ›|d         |z   |d<   |d                              |	¦  «         |d                              |
¦  «         Œà|||fS )zLCombine tokens into words by splitting at whitespace and punctuation tokens.r   r‡  z !"#$%&'()*+,-./:;<=>?@[\]^_`{|}~r%  )rû  r¢  r   Ú
startswithrÖ  rK  r.  r  )rÿ  rõ  ÚsubwordsÚsubword_tokens_listÚsubword_indices_listr   r  r  ÚsubwordÚsubword_tokensÚsubword_indicesrû   Ú
with_spaceÚpunctuations                 rà   rü  rü  C  s;  € å:RÐS\Ð^dÑ:eÔ:eÑ7€HÐ!Ð#7Ø€EØ€KØ€Må47¸ÐBUÐWkÑ4lÔ4lð 6ð 6Ñ0ˆ� Ø  Ô# yÔ'=Ò=ˆØ×'Ò'¨Ñ,Ô,ˆ
Ø—m’m‘o”oÐ)MÐMˆàð 	6�jð 	6 Kð 	6µ3°u±:´:À²?°?Ø�LŠL˜Ñ!Ô!Ð!Ø×Ò˜~Ñ.Ô.Ð.Ø× Ò  Ñ1Ô1Ð1Ð1à˜bœ	 GÑ+ˆE�"‰IØ˜ŒO×"Ò" >Ñ2Ô2Ð2Ø˜"Ô×$Ò$ _Ñ5Ô5Ð5Ð5à�+˜}Ð,Ð,râ   c                 ó0  — t          | ¦  «        dz
  }t          | ¦  «        dz
  }|dk    r�| |                              d¦  «        rh| |                              ¦   «         |v rL| |         | |         z   | |<   ||         ||         z   ||<   ||         ||         z   ||<   d| |<   g ||<   g ||<   n|}|dz  }|dk    °�d}d}|t          | ¦  «        k     r‘| |                              d¦  «        s\| |         |v rR| |xx         | |         z  cc<   ||xx         ||         z  cc<   ||xx         ||         z  cc<   d| |<   g ||<   g ||<   n|}|dz  }|t          | ¦  «        k     °‘d„ | D ¦   «         | dd…<   d„ |D ¦   «         |dd…<   d	„ |D ¦   «         |dd…<   dS )
z1Merges punctuation tokens with neighboring words.r'  r   r   r‡  rü   c                 ó   — g | ]}|¯|‘ŒS rÜ   rÜ   )rÝ   r1  s     rà   r_  z'_merge_punctuations.<locals>.<listcomp>|  s   € Ð/Ð/Ð/˜¨$Ð/�Ð/Ð/Ð/râ   Nc                 ó   — g | ]}|¯|‘ŒS rÜ   rÜ   rš  s     rà   r_  z'_merge_punctuations.<locals>.<listcomp>}  s   € Ð4Ð4Ð4˜5¨eÐ4�Ð4Ð4Ð4râ   c                 ó   — g | ]}|¯|‘ŒS rÜ   rÜ   )rÝ   r  s     rà   r_  z'_merge_punctuations.<locals>.<listcomp>~  s   € Ð0Ð0Ð0˜#¨CÐ0�#Ð0Ð0Ð0râ   )rK  ri  rÖ  Úendswith)r   rõ  r\  Ú	prependedÚappendedr9  Újs          rà   rý  rý  [  sù  € õ 	ˆE‰
Œ
�Q‰€AÝˆE‰
Œ
�Q‰€AØ
ˆqŠ&ˆ&Ø�Œ8×Ò˜sÑ#Ô#ð 	¨¨a¬¯ªÑ(8Ô(8¸IÐ(EÐ(EØ˜Q”x %¨¤(Ñ*ˆE�!‰HØ˜qœ	 F¨1¤IÑ-ˆF�1‰IØ  œ g¨a¤jÑ0ˆG�A‰JØˆE�!‰HØˆF�1‰IØˆG�A‰JˆJàˆAØ	ˆQ‰ˆð ˆqŠ&ˆ&ð 	
€AØ	€AØ
�c�%‰jŒjŠ.ˆ.Ø�QŒx× Ò  Ñ%Ô%ð 	¨%°¬(°hÐ*>Ð*>Ø�!ˆHˆHŒH˜˜aœÑ ˆHˆH‰HØ�1ˆIˆIŒI˜ œÑ"ˆIˆI‰IØ�AˆJˆJŒJ˜' !œ*Ñ$ˆJˆJ‰JØˆE�!‰HØˆF�1‰IØˆG�A‰JˆJàˆAØ	ˆQ‰ˆð �c�%‰jŒjŠ.ˆ.ð 0Ð/ Ð/Ñ/Ô/€Eˆ!ˆ!ˆ!�HØ4Ð4 FÐ4Ñ4Ô4€Fˆ1ˆ1ˆ1�IØ0Ð0 Ð0Ñ0Ô0€GˆAˆAˆA�J€J€Jrâ   )Nró  rô  rå  )+ré  r  rŠ  r  Ú	functoolsr   râ  rH  Ú
tokenizersr   r   r   r   r   Útokenizers.modelsr	   Útokenization_utils_tokenizersr   Úutilsr   Úenglish_normalizerr   r   Ú
get_loggerræ  r�  r�  r­  Úitemsr°  r²  rò   rt  rî  r  r  r+  rÏ  r=  rû  rü  rý  Ú__all__rÜ   râ   rà   ú<module>rƒ     s&  ðð (Ð 'à €€€Ø 	€	€	€	Ø 	€	€	€	Ø Ð Ð Ð Ð Ð à Ð Ð Ð Ø RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RÐ RØ !Ð !Ð !Ð !Ð !Ð !à >Ð >Ð >Ð >Ð >Ð >Ø Ð Ð Ð Ð Ð Ø JÐ JÐ JÐ JÐ JÐ JÐ JÐ Jð 
ˆÔ	˜HÑ	%Ô	%€ð Ø&ØØ(ð	ð Ð ðeØˆ)ðeàˆ)ðeð 	ˆ(ðeð 	ˆ)ð	eð
 	ˆ)ðeð 	ˆ(ðeð 	ˆ(ðeð 	ˆ*ðeð 	ˆ,ðeð 	ˆ)ðeð 	ˆ(ðeð 	ˆ)ðeð 	ˆ'ðeð 	ˆ(ðeð 	ˆ)ðeð  	ˆ)ð!eð" 	ˆ,ð#eð eð$ 	ˆ'ð%eð& 	ˆ)ð'eð( 	ˆ,ð)eð* 	ˆ(ð+eð, 	ˆ+ð-eð. 	ˆ'ð/eð0 	ˆ'ð1eð2 	ˆ'ð3eð4 	ˆ*ð5eð6 	ˆ(ð7eð8 	ˆ+ð9eð: 	ˆ'ð;eð< 	ˆ+ð=eð> 	ˆ&ð?eð@ 	ˆ&ðAeðB 	ˆ*ðCeðD 	ˆ+ðEeð eð eðF 	ˆ,ðGeðH 	ˆ'ðIeðJ 	ˆ'ðKeðL 	ˆ+ðMeðN 	ˆ'ðOeðP 	ˆ(ðQeðR 	ˆ(ðSeðT 	ˆ)ðUeðV 	ˆ)ðWeðX 	ˆ)ðYeðZ 	ˆ)ð[eð\ 	ˆ-ð]eð^ 	ˆ+ð_eð` 	ˆ)ðaeðb 	ˆ*ðceðd 	ˆ,ðeeðf 	ˆ(ðgeð eð eðh 	ˆ(ðieðj 	ˆ+ðkeðl 	ˆ*ðmeðn 	ˆ(ðoeðp 	ˆ+ðqeðr 	ˆ)ðseðt 	ˆ(ðueðv 	ˆ*ðweðx 	ˆ)ðyeðz 	ˆ*ð{eð| 	ˆ)ð}eð~ 	ˆ)ðeð@ 	ˆ)ðAeðB 	ˆ'ðCeðD 	ˆ'ðEeðF 	ˆ(ðGeðH 	ˆ(ðIeð eð eðJ 	ˆ+ðKeðL 	ˆ)ðMeðN 	ˆ*ðOeðP 	ˆ,ðQeðR 	ˆ'ðSeðT 	ˆ(ðUeðV 	ˆ*ðWeðX 	ˆ)ðYeðZ 	ˆ)ð[eð\ 	ˆ%ð]eð^ 	ˆ'ð_eð` 	ˆ)ðaeðb 	Ð
ðceðd 	ˆ(ðeeðf 	ˆ)ðgeðh 	ˆ)ðieðj 	ˆ)ðkeð eðl Ø
Ø
Ø
Ø
Ø
Ø
Ø
ØØ
Ø
Ø
Ø
Ø
ØðIeð eð e€	ðPØ>Ð>¨I¯OªOÑ,=Ô,=Ð>Ñ>Ô>ðàØØØØØØØØØØØðð ð Ð ð  ˜Ð&€ðM	ð M	ð M	ð M	ð M	Ð(ñ M	ô M	ð M	ðf  Ø 0ØAð-ð -à�ŒIð-ð �D‰jð-ð ð	-ð
 ð-ð -ð -ð -ð4u"ð u"ð u"ð u"ðp osð yð yð yð yð yðxu"ð u"ð u"ð u"ðpð ð ð&  Ø 0ØAð-ð -à�ŒIð-ð �D‰jð-ð ð	-ð
 ð-ð -ð -ð -ð4-°°S´	ð -ð -ð -ð -ð@-¨t°C¬yð -ð -ð -ð -ð0#1ð #1ð #1ðL Ð
€€€râ   