Qwen3-ASR-1.7B GGUF

้˜ฟ้‡Œ้€šไน‰ๅƒ้—ฎๅ›ข้˜ŸๆŽจๅ‡บ็š„ๅคš่ฏญ่จ€่‡ชๅŠจ่ฏญ้Ÿณ่ฏ†ๅˆซ(ASR)ๆจกๅž‹๏ผŒๆ”ฏๆŒ30็ง่ฏญ่จ€ใ€‚

ๆจกๅž‹็ฎ€ไป‹

Qwen3-ASR-1.7B ๆ˜ฏ้˜ฟ้‡Œๅทดๅทด้€šไน‰ๅƒ้—ฎๅ›ข้˜Ÿ็š„่ฏญ้Ÿณ่ฏ†ๅˆซๆจกๅž‹๏ผŒๅ…ทๆœ‰ไปฅไธ‹็‰น็‚น๏ผš

  • ๅ‚ๆ•ฐ้‡๏ผš1.7B
  • ่ฏญ่จ€ๆ”ฏๆŒ๏ผš30็ง่ฏญ่จ€๏ผˆไธญ่‹ฑๆ—ฅ้Ÿฉๆณ•ๅพท่ฅฟ่‘กไฟ„้˜ฟๆ‹‰ไผฏ่ฏญ็ญ‰๏ผ‰
  • ้‡ๅŒ–ๆ ผๅผ๏ผšGGUF (llama.cpp ๅ…ผๅฎน)
  • ้€‚็”จๅœบๆ™ฏ๏ผš่ฏญ้Ÿณ่ฝฌๆ–‡ๅญ—ใ€ๅญ—ๅน•็”Ÿๆˆใ€ไผš่ฎฎ่ฎฐๅฝ•่ฝฌๅ†™ใ€ๅคš่ฏญ่จ€่ฝฌๅฝ•

ๆ”ฏๆŒ่ฏญ่จ€ (30็ง)

่ฏญ่จ€ ไปฃ็  ่ฏญ่จ€ ไปฃ็  ่ฏญ่จ€ ไปฃ็ 
ไธญๆ–‡ zh ่‹ฑ่ฏญ en ็ฒค่ฏญ yue
ๆ—ฅ่ฏญ ja ้Ÿฉ่ฏญ ko ้˜ฟๆ‹‰ไผฏ่ฏญ ar
ๅพท่ฏญ de ๆณ•่ฏญ fr ่ฅฟ็ญ็‰™่ฏญ es
่‘ก่„็‰™่ฏญ pt ๆ„ๅคงๅˆฉ่ฏญ it ไฟ„่ฏญ ru
ๆณฐ่ฏญ th ่ถŠๅ—่ฏญ vi ๅฐๅœฐ่ฏญ hi
ๅœŸ่€ณๅ…ถ่ฏญ tr ๅฐๅฐผ่ฏญ id ้ฉฌๆฅ่ฏญ ms
่ทๅ…ฐ่ฏญ nl ็‘žๅ…ธ่ฏญ sv ไธน้บฆ่ฏญ da
่Šฌๅ…ฐ่ฏญ fi ๆณขๅ…ฐ่ฏญ pl ๆทๅ…‹่ฏญ cs
่ฒๅพ‹ๅฎพ่ฏญ fil ๆณขๆ–ฏ่ฏญ fa ๅธŒ่…Š่ฏญ el
็ฝ—้ฉฌๅฐผไบš่ฏญ ro ๅŒˆ็‰™ๅˆฉ่ฏญ hu ้ฉฌๅ…ถ้กฟ่ฏญ mk

ๅฏ็”จ้‡ๅŒ–็‰ˆๆœฌ

ๆ–‡ไปถๅ ้‡ๅŒ–็ฑปๅž‹ ๆ–‡ไปถๅคงๅฐ ่ฏดๆ˜Ž
Qwen3-ASR-1.7B-Q4_K_M.gguf Q4_K_M ~1.1 GB ๆŽจ่ๅนณ่กก็ฒพๅบฆไธŽ้€Ÿๅบฆ
Qwen3-ASR-1.7B-Q5_K_M.gguf Q5_K_M ~1.3 GB ๆ›ด้ซ˜็ฒพๅบฆ
Qwen3-ASR-1.7B-Q6_K.gguf Q6_K ~1.5 GB ้ซ˜็ฒพๅบฆ
Qwen3-ASR-1.7B-Q8_0.gguf Q8_0 ~1.8 GB ๆœ€้ซ˜้‡ๅŒ–็ฒพๅบฆ

ไฝฟ็”จๆ–นๆณ•

llama.cpp ๅ‘ฝไปค่กŒ

./main -m Qwen3-ASR-1.7B-Q4_K_M.gguf -f audio.wav --output-txt

Python (llama-cpp-python)

from llama_cpp import Llama

# ๅŠ ่ฝฝๆจกๅž‹
llm = Llama(
    model_path="Qwen3-ASR-1.7B-Q4_K_M.gguf",
    n_gpu_layers=-1,  # ไฝฟ็”จGPUๅŠ ้€Ÿ
)

# ่ฟ›่กŒ่ฏญ้Ÿณ่ฏ†ๅˆซ
result = llm.transcribe("audio.wav")
print(result["text"])

whisper.cpp ้ฃŽๆ ผ่ฐƒ็”จ

whisper_context * ctx = whisper_init_from_file("Qwen3-ASR-1.7B-Q4_K_M.gguf");
whisper_full(ctx, wparams, samples, n_samples, nullptr, 0);

ๆ€ง่ƒฝ็‰น็‚น

  • ๅคš่ฏญ่จ€่ฏ†ๅˆซๅ‡†็กฎ็އ้ซ˜๏ผŒๆ”ฏๆŒ30็ง่ฏญ่จ€
  • ไธญๆ–‡่ฏ†ๅˆซๅฐคๅ…ถไผ˜็ง€๏ผŒๆ”ฏๆŒๆ™ฎ้€š่ฏๅ’Œ็ฒค่ฏญ
  • ๅฏนๅ™ช้Ÿณๆœ‰ไธ€ๅฎšๆŠ—ๅนฒๆ‰ฐ่ƒฝๅŠ›
  • ๆ”ฏๆŒๅฎžๆ—ถๆตๅผ่ฝฌๅ†™

ๆŠ€ๆœฏ่ง„ๆ ผ

  • ๆžถๆž„: ๅŸบไบŽ Transformer ็š„็ผ–็ ๅ™จ-่งฃ็ ๅ™จ็ป“ๆž„
  • ้‡‡ๆ ท็އ: 16kHz
  • ่พ“ๅ…ฅๆ ผๅผ: WAV/PCM ้Ÿณ้ข‘
  • ่พ“ๅ‡บๆ ผๅผ: ๆ–‡ๆœฌ

่ฎธๅฏ่ฏ

Apache 2.0 License

่‡ด่ฐข

  • ๅŽŸๅง‹ๆจกๅž‹๏ผšQwen/Qwen3-ASR-1.7B
  • GGUF่ฝฌๆข๏ผš็”ฑ voconly ๅ›ข้˜ŸๅฎŒๆˆ
Downloads last month
137
GGUF
Model size
2B params
Architecture
qwen3_asr
Hardware compatibility
Log In to add your hardware

4-bit

5-bit

6-bit

8-bit

16-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. ๐Ÿ™‹ Ask for provider support

Model tree for voconly-org/Qwen3-ASR-1.7B-gguf

Quantized
(54)
this model