Replying to
@jesuislibre@infosec.exchange mais en gros c'est un model qui comprend le natural language mais ne le parle pas.
Comme la phase la plus gourmande c'est aligner les tokens pour parler de manière compréhensible. Tu passes sous les 100 ms pour répondre.
Contrepartie, tu dois faire des questions fermées.
Avantage tu peux parralleliser tes questions.