Lewati ke konten utama
menjadi.dev
AI

LLM (Large Language Model)

Model AI yang dilatih pada data teks besar untuk memahami dan menghasilkan bahasa manusia.

LLM (Large Language Model) adalah model deep learning yang dilatih pada corpus teks yang sangat besar (triliunan kata dari internet, buku, kode) untuk memahami dan menghasilkan teks seperti manusia. LLM bekerja dengan memprediksi token berikutnya dalam sequence — namun dengan training data yang masif, mereka mengembangkan kemampuan emergent: reasoning, code generation, translation, summarization, dan creative writing. LLM populer: GPT-4/4o (OpenAI), Claude (Anthropic), Gemini (Google), Llama (Meta — open weight), dan DeepSeek (open weight). Parameter model: GPT-4 diperkirakan > 1 triliun parameter, Llama 3.1 405B punya 405 miliar parameter. Konteks window: jumlah token yang bisa diproses sekaligus — Claude 3.5 Sonnet bisa 200K token (~500 halaman).

Istilah Terkait