Të dhëna & IA

Si mësojnë kompjuterët nga të dhënat, dhe çfarë janë vërtet mjetet IA që përdor çdo ditë. · 29 terma

AI agent

Agjent IA

Agjenti IA është një program me LLM që jo vetëm përgjigjet, por edhe vepron vetë, hap pas hapi, për të kryer një detyrë — kërkon në internet, shkruan dhe ekzekuton kod, përdor mjete — dhe e kontrollon rezultatin.

AI coding assistant

Asistent IA për kod

Asistenti IA për kod është një mjet në IDE ose në terminal që të ndihmon të shkruash kod: sugjeron rreshtat e radhës, shpjegon gabimet dhe mund të bëjë ndryshime vetë. Është ndihmë e madhe, por kodin duhet ta kuptosh dhe ta kontrollosh vetë.

Artificial intelligence (AI)

Inteligjencë artificiale (IA)

Inteligjenca artificiale janë programe që mësojnë nga shumë shembuj, në vend që t'u shkruhet çdo rregull një nga një. Kështu njohin foto, përkthejnë tekste ose u përgjigjen pyetjeve — por mund të gabojnë, ndaj kontrolloji gjithmonë.

Bias (AI)

Paragjykim (IA)

Bias-i ndodh kur një model IA jep rezultate të padrejta ose të njëanshme, sepse të dhënat me të cilat u trajnua nuk ishin të balancuara. P.sh. një model i trajnuar kryesisht me tekste në anglisht mund ta kuptojë më keq shqipen.

Chatbot

Chatbot-i është një program me të cilin bisedon me shkrim (ose me zë), si me një person. Chatbot-et e sotme si ChatGPT ose Claude përdorin LLM, ndërsa ato më të thjeshtat në faqet e dyqaneve ndjekin vetëm disa rregulla të gatshme.

Classification

Klasifikim

Klasifikimi është një detyrë e IA-së ku modeli vendos në cilën kategori bën pjesë diçka — p.sh. nëse një email është spam, nëse në foto ka mace apo qen, ose nëse një koment është pozitiv apo negativ.

Computer vision

Shikim kompjuterik

Shikimi kompjuterik është fusha e IA-së që i mëson kompjuterët të „shohin“: të njohin objekte, fytyra, tekst ose targa makinash në foto dhe video.

Context window

Dritarja e kontekstit

Dritarja e kontekstit është sa tekst mund të „mbajë mend“ një LLM njëherësh — bisedën, dokumentet dhe përgjigjen e vet, të matura në token-a. Kur biseda bëhet shumë e gjatë, pjesët e vjetra mund të harrohen.

Dataset

Grup të dhënash

Dataset-i është një koleksion i organizuar të dhënash për një temë — p.sh. një tabelë me notat e mijëra nxënësve ose me çmimet e banesave. Përdoret për analiza dhe për të trajnuar modele të inteligjencës artificiale.

Deep learning

Mësim i thellë

Deep learning është machine learning me rrjete nervore me shumë shtresa („të thella“). Kjo i lejon të mësojnë gjëra shumë të ndërlikuara — të njohin fytyra, të kuptojnë zërin ose të shkruajnë tekst.

Embedding

Embedding-u e kthen një tekst (ose foto) në një listë numrash, ku kuptimet e ngjashme marrin numra të afërt. Kështu kompjuteri e kupton që „makinë“ dhe „veturë“ janë pothuajse e njëjta gjë.

Fine-tuning

Përshtatje e imët

Fine-tuning do të thotë ta marrësh një model të trajnuar tashmë dhe ta trajnosh edhe pak me të dhënat e tua, që të bëhet i mirë në një punë të caktuar — p.sh. t'u përgjigjet pyetjeve për produktet e një kompanie.

Generative AI

IA gjeneruese

IA gjeneruese është inteligjenca artificiale që krijon diçka të re — tekst, foto, muzikë, video ose kod — në vend që vetëm të klasifikojë ose të parashikojë. ChatGPT-ja, Claude-i dhe gjeneratorët e fotove janë shembuj.

Hallucination (AI)

Halucinacion

Halucinacioni ndodh kur një model IA jep një përgjigje që tingëllon e sigurt dhe e saktë, por është e shpikur — një fakt i rremë, një burim që s'ekziston ose kod që s'punon. Prandaj përgjigjet e IA-së duhen kontrolluar.

Inference

Inferencë

Inferenca është momenti kur një model i trajnuar vihet në punë: i jep diçka të re dhe ai jep përgjigjen. Sa herë që i shkruan një chatbot-i, po bëhet inferencë.

LLM (Large Language Model)

Model i madh gjuhësor

LLM-ja është një model IA i trajnuar me sasi të mëdha teksti, që mëson të parashikojë fjalën e radhës. Kështu mund të shkruajë, të përkthejë, të shpjegojë kod dhe t'u përgjigjet pyetjeve — por mund edhe të shpikë gjëra që s'janë të vërteta.

Machine learning

Mësim automatik

Machine learning është mënyra si kompjuteri mëson nga shembujt: në vend që t'i shkruash rregullat, i jep shumë të dhëna me përgjigjet e sakta, dhe ai e gjen vetë modelin. Është pjesa kryesore e inteligjencës artificiale sot.

Model (AI)

Model

Modeli është ajo që del pasi një program machine learning „mëson“ nga të dhënat — një lloj formule e madhe që, kur i jep diçka të re, parashikon përgjigjen. Asistentët si ChatGPT ose Claude punojnë me modele shumë të mëdha.

Multimodal AI

IA multimodale

IA multimodale është një model që punon me disa lloje të dhënash njëherësh — tekst, foto, zë, video. P.sh. mund t'i dërgosh foton e një detyre matematike dhe ta pyesësh me zë si zgjidhet.

Neural network

Rrjet nervor

Rrjeti nervor është një model i frymëzuar nga truri: shumë „neurone“ të vogla, të lidhura në shtresa, që i kalojnë numra njëri-tjetrit. Gjatë trajnimit, lidhjet forcohen ose dobësohen derisa rrjeti të japë përgjigje të sakta.

NLP (Natural Language Processing)

Përpunim i gjuhës natyrore

NLP-ja është fusha e IA-së që merret me gjuhën e njerëzve: përkthim, kuptim i tekstit, përmbledhje, njohje e zërit. LLM-të janë hapi më i madh i NLP-së deri tani.

Overfitting

Mbipërshtatje

Overfitting ndodh kur një model i mëson përmendësh shembujt e trajnimit, në vend që ta kuptojë rregullin. Te të dhënat që i ka parë del i përsosur, por me të dhëna të reja gabon shumë.

Prompt

Prompt-i është teksti ose pyetja që i shkruan një modeli të inteligjencës artificiale. Sa më i qartë dhe më i detajuar të jetë prompt-i, aq më e mirë del përgjigjja.

RAG (Retrieval-Augmented Generation)

RAG është një teknikë ku, para se LLM-ja të përgjigjet, programi gjen dokumentet më të përshtatshme (p.sh. me embedding-e) dhe ia jep modelit bashkë me pyetjen. Kështu përgjigjja bazohet në informacion të vërtetë dhe të freskët, jo vetëm në kujtesën e modelit.

Supervised learning

Mësim i mbikëqyrur

Në mësimin e mbikëqyrur, modeli trajnohet me shembuj që e kanë përgjigjen e saktë të shënuar — p.sh. mijëra email-e të etiketuar „spam“ ose „jo spam“. Pastaj mëson t'i etiketojë vetë email-et e rinj.

Temperature (AI)

Temperatura (IA)

Temperatura është një rregullim i LLM-së që vendos sa „i guximshëm“ është modeli kur zgjedh fjalët. Me temperaturë të ulët përgjigjet janë më të sigurta dhe të përsëritshme; me të lartë, më kreative por edhe më të paparashikueshme.

Token (AI)

Token (IA)

Për një LLM, teksti ndahet në copa të vogla që quhen token-a — zakonisht një fjalë ose pjesë fjale. Modeli lexon dhe shkruan token pas token-i, dhe shërbimet IA shpesh e matin përdorimin dhe çmimin me token-a.

Training (AI)

Trajnim

Trajnimi është procesi kur një model IA shikon shumë shembuj dhe i rregullon vetë numrat e tij të brendshëm, derisa të gabojë sa më pak. Për modelet e mëdha, trajnimi zgjat javë dhe kërkon mijëra GPU.

Unsupervised learning

Mësim i pambikëqyrur

Në mësimin e pambikëqyrur, modeli merr të dhëna pa përgjigje dhe gjen vetë grupe ose modele të fshehura — p.sh. i ndan klientët e një dyqani në grupe sipas asaj që blejnë.