LLM (Large Language Model)

/ɛl ɛl ɛm/

Una rete neurale con miliardi di parametri addestrata su enormi dataset testuali per comprendere e generare linguaggio umano.

In English: LLM (Large Language Model)

Gli LLM come GPT-4, Claude e LLaMA sono addestrati su testi diversificati da internet. Dimostrano abilità emergenti come ragionamento, few-shot learning e generalizzazione dei task. La scala è fondamentale - modelli più grandi mostrano performance migliori.

Esempi

  • GPT-4 con 1.76 trilioni di parametri
  • LLaMA 2 per applicazioni open-source
  • Claude per comprensione long-context