§
    ‚Štje  ã                   ó„   — d Z ddlmZ ddlmZ ddlmZ  ed¬¦  «        e G d„ d	e¦  «        ¦   «         ¦   «         Zd	gZd
S )zOpenAI GPT configurationé    )Ústricté   )ÚPreTrainedConfig)Úauto_docstringzopenai-community/openai-gpt)Ú
checkpointc                   ó€  — e Zd ZU dZdZdddddœZdZeed	<   d
Z	eed<   dZ
eed<   dZeed<   dZeed<   dZeed<   dZeez  ed<   dZeez  ed<   dZeez  ed<   dZeed<   dZeed<   dZeed<   dZeed<   dZedz  ed<   dZeed<   dZeez  ed<   dZedz  ed<   dZedz  ed <   dZeee         z  dz  ed!<   dZeed"<   dS )#ÚOpenAIGPTConfigaþ	  
    afn (`str` or `Callable`, *optional*, defaults to `"gelu"`):
        The non-linear activation function (function or string) in the encoder and pooler. If string, `"gelu"`,
        `"relu"`, `"silu"` and `"gelu_new"` are supported.
    layer_norm_epsilon (`float`, *optional*, defaults to 1e-05):
        The epsilon to use in the layer normalization layers
    summary_type (`str`, *optional*, defaults to `"cls_index"`):
        Argument used when doing sequence summary, used in the models [`OpenAIGPTDoubleHeadsModel`] and
        [`OpenAIGPTDoubleHeadsModel`].
        Has to be one of the following options:
            - `"last"`: Take the last token hidden state (like XLNet).
            - `"first"`: Take the first token hidden state (like BERT).
            - `"mean"`: Take the mean of all tokens hidden states.
            - `"cls_index"`: Supply a Tensor of classification token position (like GPT/GPT-2).
            - `"attn"`: Not implemented now, use multi-head attention.
    summary_use_proj (`bool`, *optional*, defaults to `True`):
        Argument used when doing sequence summary, used in the models [`OpenAIGPTDoubleHeadsModel`] and
        [`OpenAIGPTDoubleHeadsModel`].
        Whether or not to add a projection after the vector extraction.
    summary_activation (`str`, *optional*):
        Argument used when doing sequence summary, used in the models [`OpenAIGPTDoubleHeadsModel`] and
        [`OpenAIGPTDoubleHeadsModel`].
        Pass `"tanh"` for a tanh activation to the output, any other value will result in no activation.
    summary_proj_to_labels (`bool`, *optional*, defaults to `True`):
        Argument used when doing sequence summary, used in the models [`OpenAIGPTDoubleHeadsModel`] and
        [`OpenAIGPTDoubleHeadsModel`].
        Whether the projection outputs should have `config.num_labels` or `config.hidden_size` classes.
    summary_first_dropout (`float`, *optional*, defaults to 0.1):
        Argument used when doing sequence summary, used in the models [`OpenAIGPTDoubleHeadsModel`] and
        [`OpenAIGPTDoubleHeadsModel`].
        The dropout ratio to be used after the projection and activation.

    Examples:

    ```python
    >>> from transformers import OpenAIGPTConfig, OpenAIGPTModel

    >>> # Initializing a GPT configuration
    >>> configuration = OpenAIGPTConfig()

    >>> # Initializing a model (with random weights) from the configuration
    >>> model = OpenAIGPTModel(configuration)

    >>> # Accessing the model configuration
    >>> configuration = model.config
    ```z
openai-gptÚn_positionsÚn_embdÚn_headÚn_layer)Úmax_position_embeddingsÚhidden_sizeÚnum_attention_headsÚnum_hidden_layersiž  Ú
vocab_sizei   i   é   ÚgeluÚafngš™™™™™¹?Úresid_pdropÚ
embd_pdropÚ
attn_pdropgñhãˆµøä>Úlayer_norm_epsilong{®Gáz”?Úinitializer_rangeÚ	cls_indexÚsummary_typeTÚsummary_use_projNÚsummary_activationÚsummary_proj_to_labelsÚsummary_first_dropoutÚpad_token_idÚbos_token_idÚeos_token_idÚtie_word_embeddings) Ú__name__Ú
__module__Ú__qualname__Ú__doc__Ú
model_typeÚattribute_mapr   ÚintÚ__annotations__r
   r   r   r   r   Ústrr   Úfloatr   r   r   r   r   r   Úboolr   r   r    r!   r"   r#   Úlistr$   © ó    úm/var/www/html/CA-Chatbot/venv/lib/python3.11/site-packages/transformers/models/openai/configuration_openai.pyr	   r	      s®  € € € € € € ð-ð -ð^ €Jà#0ØØ'Ø&ð	ð €Mð €J�ÐÐÑØ€K�ÐÐÑØ€FˆCÐÐÑØ€GˆSÐÐÑØ€FˆCÐÐÑØ€CˆÐÐÑØ"€K�˜‘Ð"Ð"Ñ"Ø!€J�˜‘Ð!Ð!Ñ!Ø!€J�˜‘Ð!Ð!Ñ!Ø $Ð˜Ð$Ð$Ñ$Ø#Ð�uÐ#Ð#Ñ#Ø#€L�#Ð#Ð#Ñ#Ø!Ð�dÐ!Ð!Ñ!Ø%)Ð˜˜d™
Ð)Ð)Ñ)Ø#'Ð˜DÐ'Ð'Ñ'Ø),Ð˜5 3™;Ð,Ð,Ñ,Ø#€L�#˜‘*Ð#Ð#Ñ#Ø#€L�#˜‘*Ð#Ð#Ñ#Ø+/€L�#˜˜Sœ	‘/ DÑ(Ð/Ð/Ñ/Ø $Ð˜Ð$Ð$Ñ$Ð$Ð$r2   r	   N)	r(   Úhuggingface_hub.dataclassesr   Úconfiguration_utilsr   Úutilsr   r	   Ú__all__r1   r2   r3   ú<module>r8      sª   ðð Ð à .Ð .Ð .Ð .Ð .Ð .à 3Ð 3Ð 3Ð 3Ð 3Ð 3Ø #Ð #Ð #Ð #Ð #Ð #ð €Ð8Ð9Ñ9Ô9ØðK%ð K%ð K%ð K%ð K%Ð&ñ K%ô K%ñ „ñ :Ô9ðK%ð\ Ð
€€€r2   