AI Chat

llm-api

MiniCPM5-1B Thinking

Fast reasoning model running locally via llama.cpp.
Markdown & code supported Β· context window 8K Β· 1B params (Q8_0)