@@ -20,6 +20,7 @@ if args.help then
2020 print (" --tokenizer: Path of tokenizer model file. (default: tokenizer.spm)" )
2121 print (" --weights: Path of model weights file. (default: 4b-it-sfp.sbs)" )
2222 print (" --map: Enable memory-mapping? -1 = auto, 0 = no, 1 = yes. (default: -1)" )
23+ print (" --seq_len: Sequence length, capped by max context window of model. (default: 4096)" )
2324 print (" --max_generated_tokens: Maximum number of tokens to generate. (default: 2048)" )
2425 print (" --prefill_tbatch: Maximum batch size during prefill phase (default: 256)" )
2526 print (" --temperature: Temperature for top-K. (default: 1.0)" )
4344
4445-- Config global scheduler
4546local ok , err = require (" cgemma" ).scheduler .config ({
46- num_threads = args .num_threads ,
47- pin = args .pin ,
48- skip_packages = args .skip_packages ,
49- max_packages = args .max_packages ,
50- skip_clusters = args .skip_clusters ,
51- max_clusters = args .max_clusters ,
52- skip_lps = args .skip_lps ,
53- max_lps = args .max_lps
47+ num_threads = tonumber ( args .num_threads ) ,
48+ pin = tonumber ( args .pin ) ,
49+ skip_packages = tonumber ( args .skip_packages ) ,
50+ max_packages = tonumber ( args .max_packages ) ,
51+ skip_clusters = tonumber ( args .skip_clusters ) ,
52+ max_clusters = tonumber ( args .max_clusters ) ,
53+ skip_lps = tonumber ( args .skip_lps ) ,
54+ max_lps = tonumber ( args .max_lps )
5455})
5556if not ok then
5657 error (" Opoos! " .. err )
7879
7980-- Create a session
8081local session , err = gemma :session ({
81- max_generated_tokens = args .max_generated_tokens ,
82- prefill_tbatch = args .prefill_tbatch ,
83- temperature = args .temperature ,
84- top_k = args .top_k ,
82+ seq_len = tonumber (args .seq_len ) or 4096 ,
83+ max_generated_tokens = tonumber (args .max_generated_tokens ),
84+ prefill_tbatch = tonumber (args .prefill_tbatch ),
85+ temperature = tonumber (args .temperature ),
86+ top_k = tonumber (args .top_k ),
8587 no_wrapping = true
8688})
8789if not session then
0 commit comments