AI models ले तपाईंलाई कसरी बुझ्छन्: tokens, context र hallucinations
प्राविधिक तह सरल भाषामा — tokens, context window, temperature र hallucination — ताकि तपाईं AI बारे सटीक कुरा गर्न सक्नुहोस्।
स्पष्ट prompt लेख्न जानेपछि, अर्को तह model भित्र के हुन्छ भन्ने बुझ्नु हो: गणित होइन, अवधारणा र तिनको वर्णन गर्ने English। यी ती terms हुन् जो AI को जुनसुकै गम्भीर कुराकानीमा सामुन्ने आउँछन्, र तिनको सटीक प्रयोगले शीर्षक मात्र पढ्ने र औजारबारे सोच्नेलाई छुट्याउँछ।
Tokens
Model ले शब्द पढ्दैन। उसले tokens पढ्छ — text का टुक्रा, लगभग एउटा शब्द वा शब्दको अंश। unhappy एउटा token हुन सक्छ; unbelievable दुई।
- The model splits the text into tokens.
- This model has a large token limit.
एउटा उपयोगी परिणाम token limit हो, model ले एकपटकमा लिन वा दिन सक्ने अधिकतम। prompt «धेरै लामो» हुँदा, सकिएका tokens नै हुन्छन्।
Context window
Context window भनेको model ले एकैसाथ कति ध्यानमा राख्न सक्छ भन्ने हो, उसको अल्पकालीन स्मरण, tokens मा नापिएको। भित्र तपाईंको पूरा कुराकानी र prompt हुन्छ।
- The whole document fits inside the context window.
- Once the conversation exceeds the context window, the model forgets the beginning.
त्यसैले chatbot सँगको लामो कुराकानीले कहिलेकाहीँ धागो गुमाउँछ: सुरुवात window बाहिर खस्यो। सटीक English मा भनिन्छ कि model runs out of context, उसले बिर्स्यो भनेर होइन — «बिर्स्यो» ले स्मरणको संकेत दिन्छ, जुन model सँग sessions बीच हुँदै हुँदैन।
Temperature
Temperature ले जवाफको पूर्वानुमेयतालाई नियन्त्रण गर्छ। यो विचार physics बाट लिइएको हो — temperature जति उच्च, गति उति बढी।
कम temperature — पूर्वानुमेय, सुरक्षित, शाब्दिक। facts र code का लागि राम्रो।
उच्च temperature — विविध, अप्रत्याशित, रचनात्मक। विचार र drafts का लागि राम्रो।
Set the temperature low for a technical answer.
The model's temperature was high, so it gave three very different drafts.
यो शब्द अब यति मानक छ कि मानिसले the response felt high-temperature — अर्थात् अप्रत्याशित — व्याख्याबिना भन्छन्।
Hallucination
Hallucination आत्मविश्वासपूर्ण जवाफ हो जुन केवल झुटो हुन्छ। Model ले कुनै तथ्य, नाम, स्रोत बनायो र त्यसलाई निर्विवाद भनी प्रस्तुत गर्यो।
- The model hallucinated a citation.
- That reference is a hallucination — it doesn't exist.
यो त्यो term हो जुन हरेक सावधान AI प्रयोगकर्तालाई चाहिन्छ, किनकि यसले औजारको मुख्य खराबीलाई नाम दिन्छ। Verb सही छ: hallucinate, hallucinated, has hallucinated। र noun गन्न सकिने छ: a hallucination, two hallucinations।
Hallucination झुटो बोल्नु होइन। झुटका लागि सत्य जान्नु र त्यसको विरुद्ध जानु जरुरी छ। Model ले सत्य के हो जान्दैन; उसले अर्को कुन text आउँछ भनी अड्कल गर्छ। झुटो नतिजालाई hallucination भन्नु lie र mistake नभएजत्तिकै सटीक छ — model ले कहिल्यै वास्तविकतासँग मिलान गरेकै छैन।
बाँकी समूह
यीले मूललाई पूरा गर्छन्, र तपाईं यिनलाई सटीक प्राविधिक शब्दावली नजिक देख्नुहुन्छ:
| Term | अर्थ |
|---|---|
| training data | model ले जसबाट सिक्यो ती text |
| parameters | model ले सिकेका सङ्ख्या; प्राविधिक भाषामा «size» |
| inference | model ले जवाफ दिने क्षण |
| prompt injection | prompt भित्र लुकेको आक्रमण, जसले model लाई निर्देशन बेवास्ता गर्न बाध्य पार्छ |
| fine-tuning | model लाई कुनै विशेष कामका लागि मिलाउनु |
यसबारे सटीक कुरा गर्ने
ढाँचामा ध्यान दिनुहोस्: हरेक term को आफ्नै verb हुन्छ, र जोडा उत्तिकै तय छ जति collocations सधैँ तय हुन्छन्।
- The model splits text into tokens.
- The answer exceeded the context window.
- I lowered the temperature.
- The model hallucinated a source.
सही verb ले तपाईंले केवल शब्द होइन, संयन्त्र बुझ्नुभएको देखाउँछ।
आफैँ परीक्षा गर्नुहोस्
तलको क्विजले terms र तिनीहरूसँग चल्ने verbs परीक्षण गर्छ।