Kaiju Hub AI

အသံဖြင့် စာရိုက်ခြင်း။

Kaiju Hub ဆက်တင်များတွင် အသံဖြင့် စာရိုက်ခြင်း ဝန်ဆောင်မှု ရွေးချယ်ခြင်း။

ခြုံငုံသုံးသပ်ချက်

ဒေသတွင်း စာသားမှတ်တမ်း အင်ဂျင် သို့မဟုတ် သင့်လည်ပတ်မှုစနစ်၏ တပ်ဆင်ထားသော သတ်ပုံဖြတ်ခြင်းဝန်ဆောင်မှုကို ရွေးချယ်ပါ။ ရရှိနိုင်မှုသည် သင့်ပလပ်ဖောင်းပေါ်တွင် မူတည်ပြီး မည်သည့်ရွေးချယ်နိုင်သောအင်ဂျင်များ တပ်ဆင်မည်နည်း။

ဘာစကားပြောမှ စာသားလုပ်သလဲ။

Kaiju Hub AI သည် မိုက်ခရိုဖုန်းလုပ်ဆောင်ချက်ကို ပံ့ပိုးပေးသည့် နေရာတိုင်းတွင် သင်ပြောသောအရာကို စာသားအဖြစ် ပြောင်းလဲနိုင်သော စာသားအဖြစ် ပြောင်းလဲပေးပါသည်။ အေးဂျင့်သတိပေးချက်များကို ညွှန်ကြားရန်၊ Kaiju Voice စကားဝိုင်းကို ဆက်လုပ်ရန်နှင့် စာရိုက်စရာမလိုဘဲ ပိုရှည်သော ညွှန်ကြားချက်များကို ထည့်သွင်းပါ။ Whisper နှင့် Parakeet ကဲ့သို့သော ပြည်တွင်းအင်ဂျင်များသည် သင့်စက်ပေါ်တွင် စာသားမှတ်တမ်းကို သိမ်းဆည်းထားမည်ဖြစ်သည်။ ပလက်ဖောင်း သတ်ပုံသတ်ပုံသည် Windows သို့မဟုတ် macOS မှ ပံ့ပိုးပေးသော စကားပြောဝန်ဆောင်မှုကို အသုံးပြုသည်။

ရရှိနိုင်သောဝန်ဆောင်မှုများ

တိတ်တိတ်လေး

ရွေးချယ်နိုင်သော မော်ဒယ်အရွယ်အစားနှင့် ဟာ့ဒ်ဝဲအရှိန်မြှင့်မှုနှင့်အတူ Local OpenAI တိတ်တိတ်လေး စာသားမှတ်တမ်း။

NVIDIA Parakeet

ရွေးချယ်နိုင်သော Parakeet အင်ဂျင်ကို အသုံးပြု၍ လျင်မြန်သော ဒေသန္တရစကားပြောမှတ်မိခြင်း။

မယုံနိုင်လောက်အောင် မြန်မြန် တိတ်တိတ်လေး

ပံ့ပိုးထားသော GPU ဖွဲ့စည်းမှုများအတွက် အကောင်းဆုံးပြင်ဆင်ထားသော Whisper လမ်းကြောင်း။

Windows အသံဖြင့် စာရိုက်ခြင်း

Windows သတ်ပုံသတ်ပုံနှင့် ပြင်ဆင်ထားသော စနစ်ဟော့ကီးကို အသုံးပြုသည်။

Apple အသံဖြင့် စာရေးခြင်း

built-in macOS သတ်ပုံဝန်ဆောင်မှုကို အသုံးပြုသည်။

တိတ်တိတ်လေး

တိတ်တိတ်လေး — စာသားမှ အင်ဂျင်ရွေးချယ်မှုနှင့် တပ်ဆင်မှုအခြေအနေပါရှိသော ဒေသန္တရ စကားမှ စာသား

ပံ့ပိုးပေးသော အကြောင်းအရာ အမျိုးအစားများ

AI ပါဝင်သော Block ဖန်တီးခြင်း

အုပ်စုများကို ဖန်တီးခြင်း

အငယ်ဆုံး

React, Solid.js, Vue, Svelte, Angular, HTML, CSS, GLSL shaders, Markdown, ရိုးရှင်းသောစာသား, ပုံရိပ်များနှင့် ဗီဒီယိုများ။

အခြေခံ

"အသစ် Block တစ်ခုကို ဖန်တီးပါ" ကို နှိပ်ပြီး Block ဖန်တီးသည့်မြင်ကွင်းကို ဖွင့်ပါ။ ၎င်းတွင် အကြောင်းအရာကို ထည့်သွင်းနိုင်သည့် သုံးသွယ်သောနည်းလမ်းရှိသည်-

အငယ်

အသစ်အုပ်စုတစ်ခုကို ဖန်တီးပါ

အလယ်

အုပ်စုများသို့ အကြောင်းအရာကို ထည့်သွင်းပါ

အကြီး

လက်動 ထည့်သွင်းခြင်း

အရှိန်မြန်

အကြောင်းအရာကို ကူးပြီးထည့်ပါ

ဘယ် Whisper မော်ဒယ်ကို ရွေးရမလဲ။

လက်တွေ့အမြန်နှုန်း၊ မှတ်ဉာဏ်အသုံးပြုမှုနှင့် စာသားမှတ်တမ်းအရည်အသွေးတို့အတွက် Small ဖြင့် စတင်ပါ။ ဟာ့ဒ်ဝဲကို ကန့်သတ်ထားသည့်အခါ အောက်သို့ရွှေ့ပါ သို့မဟုတ် တိကျမှုနှင့် GPU စွမ်းဆောင်ရည် ပိုအရေးကြီးသည့်အခါ Medium၊ Large သို့မဟုတ် Turbo ကို ရွေးပါ။

အငယ်ဆုံး

Wake-word detection၊ အမြန် commands နှင့် lowest-memory systems တွင် စမ်းသပ်ခြင်း။

အခြေခံ

ပျော့ပျောင်းသောဟာ့ဒ်ဝဲအတွက် တိုတောင်းသော မှတ်စုများ၊ အချက်ပြမှုများနှင့် ယေဘုယျ သတ်ပုံ။

အငယ်

အေးဂျင့်သတိပေးချက်များနှင့် ပိုရှည်သော သတ်ပုံများအတွက် မျှတသောနေ့စဉ်ရွေးချယ်မှု။

အလယ်

အပိုလုပ်ဆောင်ချိန်နှင့် မှတ်ဉာဏ်ကို လဲလှယ်နိုင်သည့်အခါ တိကျမှုကို အဓိကထား ကူးယူဖော်ပြပါသည်။

အကြီး

ရရှိနိုင်သော VRAM အနည်းဆုံး 10 GB ရှိသော စနစ်များအတွက် တိကျမှုအမြင့်ဆုံး ဒေသရွေးချယ်မှု။

အရှိန်မြန်

ရနိုင်သော VRAM အနည်းဆုံး 6 GB ပါရှိသည့် ပံ့ပိုးထားသော GPU တွင် မြန်ဆန်ပြီး အရည်အသွေးမြင့် စာသားမှတ်တမ်း။

Block များကို ဖန်တီးခြင်း

Block များကို အသုံးပြုခြင်း

တိတ်တိတ်လေး
FFmpeg
CUDA
UV (Python env)

Parakeet နှင့် မယုံနိုင်လောက်အောင် မြန်ဆန်သော တိတ်တိတ်လေး

ရွေးချယ်နိုင်သော အမြန်အင်ဂျင်များ

ဤအင်ဂျင်များသည် သီးခြားဒေါင်းလုဒ်များဖြစ်သောကြောင့် မူရင်းတပ်ဆင်မှု သေးငယ်နေပါသည်။ ဆက်တင်စခရင်သည် အင်ဂျင်တစ်ခုစီအတွက် တပ်ဆင်မှုနှင့် ဟာ့ဒ်ဝဲအခြေအနေတို့ကို ပြသသည်။

တိုက်ရိုက် စက်တွင်း စာသားပြောင်းလဲမှုဖြင့် သင်ပြောနေစဉ် စကားလုံးများ ပေါ်လာသည်ကို ကြည့်ပါ။ Insanely Fast Whisper ကို ခေတ်မီ NVIDIA GPU များအတွက် အကောင်းဆုံးဖြစ်အောင် ပြုလုပ်ထားပြီး Whisper၊ Parakeet၊ cloud နှင့် platform speech ရွေးချယ်စရာများလည်း ရရှိနိုင်သည်။

NVIDIA Parakeet

မြန်နှုန်းမြင့် စက်တွင်းစကားမှ စာသားအင်ဂျင်။ ၎င်းကိုမရွေးချယ်မီ Voice Typing ဆက်တင်များမှ ၎င်း၏ရွေးချယ်နိုင်သော runtime ကို ထည့်သွင်းပါ။

မယုံနိုင်လောက်အောင် မြန်မြန် တိတ်တိတ်လေး

တွဲဖက်အသုံးပြုနိုင်သော GPU စနစ်များအတွက် ရည်ရွယ်သည့် အရှိန်မြှင့် Whisper အကောင်အထည်ဖော်မှု။ အသုံးမပြုမီ ရွေးချယ်နိုင်သော အင်ဂျင်ကို ထည့်သွင်းပါ။

Kaiju Voice မှတစ်ဆင့် တစ်ခုရွေးချယ်ခြင်းသည် ကြီးမားသောဒေါင်းလုဒ်ကို တိတ်တဆိတ် စတင်မည်မဟုတ်ပါ။ ၎င်းကို ဆက်တင်များတွင် ဦးစွာ ထည့်သွင်းပါ။ ထို့နောက် လက်ထောက်သည် ရရှိနိုင်မှုကို အတည်ပြုနိုင်ပြီး ဝန်ဆောင်မှုများကို ပြောင်းနိုင်သည်။

ပလက်ဖောင်းအသံ

Windows Voice Typing — keyboard shortcut configuration and system setup

Wireframe မှ ကုဒ်

AI ဖန်တီးခြင်း

တိုက်ရိုက် AI ဖြင့် ပြင်ဆင်ပါ

လက်ရှိ Block အစိတ်အပိုင်းများကို တိုက်ရိုက် AI ကို အသုံးပြု၍ ပြင်ဆင်ပါ။ ညွှန်ကြားချက်များကို ပေးပြီး AI သည် အကြောင်းအရာကို နေရာတွင် ပြင်ဆင်လိမ့်မည်။

မူကွဲများကို ဖန်တီးပါ

အချက်အလက်တစ်ခုကို ရိုက်ပြီး သင်လိုချင်သော မူကွဲအရေအတွက်ကို သတ်မှတ်ပါ။ AI သည် သင်၏အချက်အလက်ပေါ်မူတည်ပြီး Block အကြောင်းအရာ၏ အခြားမူကွဲအများအပြားကို ထုတ်လုပ်လိမ့်မည်။

အကြောင်းအရာကို သိမ်းဆည်းပါ

API အချက်အလက်၊ ကုဒ်အပိုင်းများ၊ ဒီဇိုင်းအချက်အလက်များနှင့် အခြားအကြောင်းအရာ Block များကို သိမ်းဆည်းပြီး စီမံကိန်းများတွင် အသုံးပြုပါ။

ဘာလဲအသစ်လဲ

AI ကို အသုံးပြု၍ Block အကြောင်းအရာကို ထုတ်လုပ်ပါ။ React, GLSL shaders, Svelte, HTML, Vue, Angular, Solid.js, နှင့် CSS တို့ကို ပံ့ပိုးပေးသည်။

တိုက်ရိုက် AI ဖြင့် ပြင်ဆင်ပါ

မီဒီယာကို ဖန်တီးပါ

မူကွဲများကို ဖန်တီးပါ

ပုံရိပ်များ၊ ဗီဒီယိုများနှင့် အခြားမီဒီယာပစ္စည်းများကို ဖန်တီးပြီး Block Library တွင် သိမ်းဆည်းပါ။

အကြောင်းအရာကို သိမ်းဆည်းပါ

AI သို့ ပంపပါ

မိန့်ခွန်းနှင့် AI Voices သို့ စာတိုပို့ပါ။

ဒေသတွင်း အသံမော်ဒယ်များ

AI Brain သည် ရွေးချယ်ထားသော ထည့်သွင်းထားသော ပုံစံဖြင့် စကားပြောသည်။ မော်ဒယ်များကို ပြောင်းလဲခြင်းသည် အသစ်ကို မဖွင့်မီ ယခင်မော်ဒယ်ကို ဖြုတ်ပြီး အသံစာရင်းကို ထိုမော်ဒယ်နှင့် လိုက်ဖက်သော အသံများအဖြစ် စစ်ထုတ်ပါသည်။

Kokoro 82M

ကျယ်ပြန့်သော built-in အသံရွေးချယ်မှုနှင့်အတူ ပေါ့ပါးမြန်ဆန်သော ဒေသန္တရစကား။

Chatterbox Turbo

latency နည်းသော ထုတ်ဖော်ပြောဆိုမှု နှင့် အသံပုံတူပွားခြင်းကို ပံ့ပိုးထားသည်။

Chatterbox

ဖော်ပြနိုင်စွမ်းရှိသော ဒေသန္တရပေါင်းစပ်ခြင်းနှင့် ပုံတူပွားခြင်းအတွက် Chatterbox မော်ဒယ်အပြည့်အစုံ။

OmniVoice 0.6B

ဘာသာစကားမျိုးစုံသော ဒေသန္တရ စာသားမှ စကားပြောသံကို ကျစ်ကျစ်လစ်လစ်။

OuteTTS 1.0 1B

၎င်း၏ကိုယ်ပိုင် လိုက်ဖက်ညီသော အသံအစုံဖြင့် ဒေသတွင်း စကားပြောမျိုးဆက်။

Qwen3-TTS 1.7B

ဘာသာစကားမျိုးစုံနှင့် ဖော်ပြနိုင်သော ဒေသဆိုင်ရာပေါင်းစပ်မှု ပိုကြီးသည်။

Fish Speech S2 Pro

ပံ့ပိုးထားသော အကိုးအကား-အသံ အလုပ်အသွားအလာများနှင့်အတူ အရည်အသွေးမြင့် ဒေသတွင်း စကားပြော။

စကားပြောအမြန်နှုန်း 0.5× မှ 2× အထိ သတ်မှတ်နိုင်သည်။ အသံပုံတူပွားခြင်းကို ပံ့ပိုးပေးသည့် မော်ဒယ်များအတွက်သာ ပေါ်လာသည်။ သင်ပိုင်ဆိုင်သောအသံကိုအသုံးပြုပါ သို့မဟုတ် အသုံးပြုရန်ခွင့်ပြုချက်ရှိသည်။

Cloud ပံ့ပိုးပေးသူ ကက်တလောက်

ဆက်တင်ကတ်တလောက်တွင် OpenAI၊ ElevenLabs၊ Cartesia၊ အသေးငယ်ဆုံး AI၊ Fish Audio၊ Speechmatics၊ Amazon Polly၊ Google Cloud Text-to-Speech နှင့် Microsoft Azure အတွက် ဖွဲ့စည်းမှုလည်း ပါဝင်သည်။ ရရှိနိုင်မှုသည် သင်ပံ့ပိုးပေးသည့် ပံ့ပိုးသူဖွဲ့စည်းပုံနှင့် အထောက်အထားများပေါ်တွင် မူတည်ပါသည်။

API အထောက်အထားများသည် ဆက်တင်များထဲတွင် ကျန်ရှိနေပြီး Kaiju Voice ၏ ပြောဆိုမှု သို့မဟုတ် ဖွဲ့စည်းတည်ဆောက်ထားသော ဆက်တင်အကျဉ်းချုပ်များမှ ဖယ်ထုတ်ထားသည်။

Kaiju Hub AI တွင် ပြသထားသော တတိယပါတီ လိုဂိုများ၊ အမှတ်တံဆိပ်များနှင့် ကုန်အမှတ်တံဆိပ်အမည်များအားလုံးသည် ၎င်းတို့၏ ပိုင်ရှင်များ၏ ပိုင်ဆိုင်မှုဖြစ်ပါသည်။ ခွဲခြားသိရှိရေးအတွက်သာ အသုံးပြုပြီး ထောက်ခံခြင်း၊ ပံ့ပိုးခြင်း သို့မဟုတ် ဆက်စပ်ခြင်းကို ဆိုလိုခြင်း မဟုတ်ပါ။