diff --git a/c/coli b/c/coli
index 4ce4c24..849e09c 100755
--- a/c/coli
+++ b/c/coli
@@ -482,8 +482,11 @@ def cmd_run(a):
need_model(a.model)
prompt=" ".join(a.prompt) if a.prompt else sys.exit('usage: coli run "your prompt"')
banner("run")
- # template ufficiale GLM-5.2: niente \n dopo i ruoli; = risposta diretta (nothink)
- e=env_for(a); e["PROMPT"]=f"[gMASK]<|user|>{prompt}<|assistant|>"
+ # template ufficiale GLM-5.2: niente \n dopo i ruoli; = risposta diretta (nothink).
+ # THINK=1 lascia aperto, stessa convenzione del serve mode (glm.c). EN: THINK=1 leaves
+ # open so the engine emits its reasoning block; the default stays nothink.
+ tk="" if os.environ.get("THINK","0")=="1" else ""
+ e=env_for(a); e["PROMPT"]=f"[gMASK]<|user|>{prompt}<|assistant|>{tk}"
sys.exit(subprocess.call([GLM, str(a.cap)], env=e))
def server_probe(base, api_key=None, timeout=1.5):