numpy

[all-backends]
transformers>=4.36
accelerate
torch>=2.0
llama-cpp-python>=0.2.0
requests>=2.28

[dev]
pytest>=7.0
pytest-timeout
numpy
torch>=2.0
transformers>=4.36
accelerate
llama-cpp-python>=0.2.0
requests
huggingface-hub

[llama]
llama-cpp-python>=0.2.0

[mlx]
mlx>=0.12
mlx-lm

[ollama]
requests>=2.28

[torch]
torch>=2.0

[transformers]
transformers>=4.36
accelerate
torch>=2.0

[vllm]
vllm>=0.4
