tinker-nomics

Models

Model specifications for all Tinker-supported models.

ModelOrgArchTotalActiveLayersd_modelAttentionExperts
Qwen3.5-397B-A17Bqwenmoe397B17BGQA
Qwen3.5-35B-A3Bqwenmoe35B3BGQA
Qwen3.5-27Bqwendense27B27BGQA
Qwen3.5-4Bqwendense4B4BGQA
Qwen3-VL-235B-A22B-Instructqwenmoe235B22B944096GQA128/8
Qwen3-VL-30B-A3B-Instructqwenmoe30.5B3.3B482048GQA128/8
Qwen3-235B-A22B-Instruct-2507qwenmoe235B22B944096GQA128/8
Qwen3-30B-A3B-Instruct-2507qwenmoe30.5B3.3B482048GQA128/8
Qwen3-30B-A3Bqwenmoe30.5B3.3B482048GQA128/8
Qwen3-30B-A3B-Baseqwenmoe30.5B3.3B482048GQA128/8
Qwen3-32Bqwendense32B32B645120GQA
Qwen3-8Bqwendense8B8B364096GQA
Qwen3-8B-Baseqwendense8B8B364096GQA
Qwen3-4B-Instruct-2507qwendense4B4B362560GQA
GPT-OSS-120Bopenaimoe117B5.1BGQA
GPT-OSS-20Bopenaimoe21B3.6BGQA
DeepSeek-V3.1deepseekmoe671B37B617168MLA256/8
DeepSeek-V3.1-Basedeepseekmoe671B37B617168MLA256/8
Llama-3.1-70Bmetadense70B70B808192GQA
Llama-3.3-70B-Instructmetadense70B70B808192GQA
Llama-3.1-8Bmetadense8B8B324096GQA
Llama-3.1-8B-Instructmetadense8B8B324096GQA
Llama-3.2-3Bmetadense3B3B283072GQA
Llama-3.2-1Bmetadense1B1B162048GQA
Kimi-K2-Thinkingmoonshotmoe1000B32BMLA
Kimi-K2.5moonshotmoe1000B32BMLA