© 2025-2026 PySpect
| Dependency | Optional | Group |
|---|---|---|
| filelock | false | |
| modelscope-hub | false | |
| packaging | false | |
| requests | false |
| setuptools | false |
| tqdm | false |
| urllib3 | false |
| accelerate | true | cv |
| addict | true | datasets |
| albumentations | true | cv |
| attrs | true | datasets |
| av | true | cv |
| biopython | true | science |
| bitstring | true | audio-tts |
| bmt-clipit | true | cv |
| boto3 | true | nlp |
| chumpy | true | cv |
| clip | true | cv |
| cloudpickle | true | multi-modal |
| control-ldm | true | cv |
| datasets | true | datasets |
| ddpm-guided-diffusion | true | cv |
| decord | true | multi-modal |
| diffusers | true | cv |
| docutils | true | docs |
| easydict | true | cv |
| edit-distance | true | cv |
| einops | true | datasets |
| embeddings | true | nlp |
| expecttest | true | tests |
| face-alignment | true | cv |
| fairscale | true | cv |
| fairseq-fixed | true | multi-modal |
| fastai | true | cv |
| fastapi | true | server |
| ffmpeg | true | cv |
| ffmpeg-python | true | cv |
| flake8 | true | tests |
| ftfy | true | cv |
| funasr | true | audio-asr |
| fvcore | true | cv |
| greenlet | true | audio-tts |
| hdbscan | true | audio-signal |
| hyperpyyaml | true | audio-signal |
| imageio | true | cv |
| imageio-ffmpeg | true | cv |
| imgaug | true | cv |
| inflect | true | audio-tts |
| iopath | true | science |
| ipdb | true | science |
| isort | true | tests |
| jedi | true | audio-tts |
| jieba | true | nlp |
| kaldiio | true | audio-kws |
| kantts | true | audio-tts |
| kornia | true | cv |
| librosa | true | multi-modal |
| lmdb | true | cv |
| lpips | true | cv |
| lxml | true | audio-tts |
| matplotlib | true | cv |
| megatron-util | true | nlp |
| mindaec | true | audio-signal |
| mir-eval | true | audio-signal |
| ml-collections | true | cv |
| mmcls | true | cv |
| mmdet | true | cv |
| mmdet3d | true | cv |
| mmsegmentation | true | cv |
| moviepy | true | cv |
| ms-funcodec | true | audio-codec |
| msgpack | true | audio-tts |
| myst-parser | true | docs |
| nerfacc | true | cv |
| networkx | true | cv |
| nltk | true | nlp |
| numba | true | cv |
| omegaconf | true | cv |
| onnx | true | cv |
| onnxruntime | true | cv |
| onnxsim | true | cv |
| open-clip-torch | true | cv |
| opencv-python | true | cv |
| oss2 | true | datasets |
| paint-ldm | true | cv |
| pandas | true | cv |
| panopticapi | true | cv |
| parso | true | audio-tts |
| pexpect | true | audio-tts |
| pickleshare | true | audio-tts |
| pillow | true | datasets |
| plyfile | true | cv |
| pre-commit | true | tests |
| prompt-toolkit | true | audio-tts |
| protobuf | true | nlp |
| psutil | true | cv |
| ptflops | true | audio-tts |
| ptyprocess | true | audio-tts |
| py-sound-connect | true | audio-kws |
| pyclipper | true | cv |
| pycocoevalcap | true | multi-modal |
| pycocotools | true | multi-modal |
| pydot | true | multi-modal |
| pygments | true | audio-tts |
| pymcubes | true | cv |
| pythainlp | true | nlp |
| python-dateutil | true | datasets |
| pytorch-lightning | true | multi-modal |
| pytorch-wavelets | true | audio-tts |
| pyvi | true | nlp |
| pywavelets | true | audio-tts |
| pyyaml | true | framework |
| rapidfuzz | true | multi-modal |
| recommonmark | true | docs |
| regex | true | cv |
| rotary-embedding-torch | true | audio-signal |
| rouge | true | nlp |
| rouge-score | true | multi-modal |
| sacrebleu | true | multi-modal |
| sacremoses | true | nlp |
| safetensors | true | multi-modal |
| scikit-image | true | cv |
| scikit-learn | true | nlp |
| scipy | true | datasets |
| sentencepiece | true | nlp |
| seqeval | true | nlp |
| shapely | true | cv |
| shotdetect-scenedetect-lgss | true | cv |
| simplejson | true | datasets |
| smplx | true | cv |
| sortedcontainers | true | datasets |
| soundfile | true | multi-modal |
| sox | true | audio-tts |
| spacy | true | nlp |
| speechbrain | true | audio-signal |
| sphinx | true | docs |
| sphinx-book-theme | true | docs |
| sphinx-copybutton | true | docs |
| sphinx-markdown-tables | true | docs |
| sse-starlette | true | server |
| stanza | true | nlp |
| subword-nmt | true | nlp |
| taming-transformers-rom1504 | true | multi-modal |
| tensorboardx | true | audio-tts |
| tensorflow-estimator | true | cv |
| termcolor | true | nlp |
| tf-slim | true | cv |
| thop | true | cv |
| timm | true | cv |
| tokenizers | true | nlp |
| torch-scatter | true | cv |
| torchaudio | true | audio-signal |
| torchmetrics | true | cv |
| torchsummary | true | cv |
| torchvision | true | cv |
| traitlets | true | audio-tts |
| transformers | true | framework |
| trimesh | true | cv |
| ujson | true | cv |
| umap-learn | true | audio-signal |
| unicodedata2 | true | multi-modal |
| unidecode | true | audio-tts |
| utils | true | cv |
| uvicorn | true | server |
| videofeatures-clipit | true | cv |
| wcwidth | true | audio-tts |
| yacs | true | cv |
| yapf | true | tests |
| zhconv | true | nlp |