Post #2747940
2026-04-15 06:42 UTC
@diegologs@mastodon.social es todo un mundo :) el system prompt de opencode son 80k, el de qwencli 20k, yo tengo uno a mano de 4k. Logicamente no es tan generalista y con depende de que modelo no te irá bien, pero hay mucho que jugar. Al final es cambiar el baseurl del provider y mirar varios modelos. Con los glm es importante tunear el reasoning level q va igual que con openai ahora, lo han cambiado 20 veces, pq sino una query de 2s puede tardar 1 minuto
Replies (1)
-
@diegologs@mastodon.social 2026-04-15 06:47
@pancake@mastodont.cat Es que es un mundo esto. Yo tengo OpenCode con GTP 5.4 xhigh sin nada configurado y va bien, no se me gastan los tokens. Para los tokens lo que uso mucho es lo de indicar los ficheros que tiene que tocar con el @, supongo que eso ahorrará tokens también. Probaré lo que dices sin tocar mucho y luego ajustaré sobre la marcha a ver qué tal.