Transformers
Safetensors
qwen2_audio
text2text-generation
audio
speech-to-speech
multimodal
qwen2-audio
Instructions to use tranquangchung/qwen2-audio-dialogue with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use tranquangchung/qwen2-audio-dialogue with Transformers:
# Load model directly from transformers import AutoProcessor, AutoModelForMultimodalLM processor = AutoProcessor.from_pretrained("tranquangchung/qwen2-audio-dialogue") model = AutoModelForMultimodalLM.from_pretrained("tranquangchung/qwen2-audio-dialogue", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Dialogue
This repository contains a fine-tuned version of Qwen2-Audio optimized for speech-to-speech dialogue interactions.
Model Description
- Architecture: Qwen2-Audio (0.5B Backbone)
Usage
Since this model uses a custom implementation, ensure the models directory is present in your working directory.
from models.modeling_qwen2_audio import Qwen2AudioForConditionalGeneration
from models.processing_qwen2_audio import Qwen2AudioProcessor
# Load model and processor
model = Qwen2AudioForConditionalGeneration.from_pretrained("tranquangchung/qwen2-audio-dialogue")
processor = Qwen2AudioProcessor.from_pretrained("tranquangchung/qwen2-audio-dialogue")
- Downloads last month
- 12
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support