tinker-nomics

Models

Model specifications for all Tinker-supported models.

ModelOrgArchTotalActiveLayersd_modelAttentionExperts
Qwen3.5-397B-A17Bqwenmoe397B17B——GQA—
Qwen3.5-35B-A3Bqwenmoe35B3B——GQA—
Qwen3.5-27Bqwendense27B27B——GQA—
Qwen3.5-4Bqwendense4B4B——GQA—
Qwen3-VL-235B-A22B-Instructqwenmoe235B22B944096GQA128/8
Qwen3-VL-30B-A3B-Instructqwenmoe30.5B3.3B482048GQA128/8
Qwen3-235B-A22B-Instruct-2507qwenmoe235B22B944096GQA128/8
Qwen3-30B-A3B-Instruct-2507qwenmoe30.5B3.3B482048GQA128/8
Qwen3-30B-A3Bqwenmoe30.5B3.3B482048GQA128/8
Qwen3-30B-A3B-Baseqwenmoe30.5B3.3B482048GQA128/8
Qwen3-32Bqwendense32B32B645120GQA—
Qwen3-8Bqwendense8B8B364096GQA—
Qwen3-8B-Baseqwendense8B8B364096GQA—
Qwen3-4B-Instruct-2507qwendense4B4B362560GQA—
GPT-OSS-120Bopenaimoe117B5.1B——GQA—
GPT-OSS-20Bopenaimoe21B3.6B——GQA—
DeepSeek-V3.1deepseekmoe671B37B617168MLA256/8
DeepSeek-V3.1-Basedeepseekmoe671B37B617168MLA256/8
Llama-3.1-70Bmetadense70B70B808192GQA—
Llama-3.3-70B-Instructmetadense70B70B808192GQA—
Llama-3.1-8Bmetadense8B8B324096GQA—
Llama-3.1-8B-Instructmetadense8B8B324096GQA—
Llama-3.2-3Bmetadense3B3B283072GQA—
Llama-3.2-1Bmetadense1B1B162048GQA—
Kimi-K2-Thinkingmoonshotmoe1000B32B——MLA—
Kimi-K2.5moonshotmoe1000B32B——MLA—