AI Chat
llm-api
π Clear
π
MiniCPM5-1B Thinking
Fast reasoning model running locally via llama.cpp.
Markdown & code supported Β· context window 8K Β· 1B params (Q8_0)
Stream
Temp
Top-P
Max tokens
System
β Stop
Send