Model Index

Seventeen models across two families, all Apache 2.0, all hosted on Hugging Face. Base models continue text and do not follow instructions. Instruct models are finetuned for conversation. GGUF builds are quantized for llama.cpp.

Boris 1.3 — current

ModelTypeParamsReleased
Boris-1.3-125MBase125M2026.07.31
Boris-1.3-125M-InstructInstruct125M2026.08.01
Boris-1.3-125M-Instruct-GGUFGGUF125M2026.08.01
Boris-1.3-75MBase77.4M2026.07.26
Boris-1.3-75M-InstructInstruct77.4M2026.07.26
Boris-1.3-75M-Instruct-GGUFGGUF77.4M2026.07.26

Boris 1.0 — original release

ModelTypeParamsReleased
Boris-250MBase250M2026.07.23
Boris-250M-InstructInstruct250M2026.07.23
Boris-250M-Instruct-GGUFGGUF250M2026.07.23
Boris-125MBase125M2026.07.15
Boris-125M-InstructInstruct125M2026.07.15
Boris-125M-Instruct-GGUFGGUF125M2026.07.23
Boris-75MBase77.4M2026.07.18
Boris-75M-InstructInstruct77.4M2026.07.18
Boris-75M-Instruct-GGUFGGUF77.4M2026.07.23

littlerock

ModelTypeParamsReleased
littlerock-1MBase1,002,7202026.08.07
littlerock-1M-arithmaxResearch artifact1,002,7202026.08.07

Which one should you use? For conversation at the best quality we currently offer, take Boris-1.3-125M-Instruct. For text continuation or as a finetuning base, take Boris-1.3-125M. For CPU-only or embedded use, take a GGUF build. For scaling research at the smallest end, take littlerock-1M.