PyYAML<7,>=6.0
numpy<3,>=1.26
einops<1,>=0.8
torch<3,>=2.8
transformers<6,>=5.0
huggingface-hub<2,>=0.34
accelerate<2,>=1.0
safetensors<1,>=0.4

[:python_version < "3.11"]
tomli>=2.0

[capture]

[capture:sys_platform == "linux" and python_version >= "3.11" and python_version < "3.14"]
specforge==0.2.0
flash-attn-4==4.0.0b15

[data]
datasets==4.8.5

[deepspeed]
deepspeed>=0.19.2

[dev]
build==1.5.0
pytest>=8
omegaconf>=2.3
wandb>=0.19
matplotlib>=3.8
ruff>=0.12

[gpu]
torch==2.10.0
transformers==5.13.0
accelerate==1.14.0
deepspeed==0.19.2
transformer-engine[core_cu12,pytorch]==2.13.0
cuda-bindings==12.9.4
cuda-python==12.9.4
apache-tvm-ffi==0.1.12
nvidia-cutlass-dsl==4.5.2
nvidia-cutlass-dsl-libs-base==4.5.2
torch-c-dlpack-ext==0.1.5
quack-kernels==0.5.0

[kernel-build]
build==1.5.0
ninja==1.13.0
setuptools-scm==9.2.2
nvidia-cutlass-dsl==4.5.2
nvidia-cutlass-dsl-libs-base==4.5.2
torch-c-dlpack-ext==0.1.5
quack-kernels==0.5.0

[logging]
wandb>=0.19

[plots]
wandb>=0.19
matplotlib>=3.8

[qwen3_8]
transformers==5.13.0
transformer-engine[core_cu12,pytorch]==2.13.0
flash-linear-attention[conv1d,cuda,tilelang]==0.5.2
tilelang==0.1.13

[sglang]

[sglang:sys_platform == "linux" and python_version < "3.14"]
sglang==0.5.20
cuda-tile==1.6.0rc5
flash-attn-4==4.0.0b19

[test]
pytest>=8
omegaconf>=2.3

[vllm]

[vllm:sys_platform == "linux" and python_version < "3.14"]
vllm==0.29.0
