📰 Hikayesi ve Doğuşu
Bağımsız geliştirici Peiiii, yapay zekâ ile sesli iletişim kurarken yaşanan "bas-konuş" zorluğunu ve hantal arayüzleri ortadan kaldırmak amacıyla Xiaoban'ı tasarladı. Günlük akışta tıpkı bir arkadaşla telefonda konuşur gibi, araya girilebilen ve akıcı akan bir sesli deneyim hedeflendi.
⚡ Nasıl Çalışıyor & Mimari Detaylar
Proje, arka planda Alibaba'nın Qwen 3.8 Omni Flash Realtime modelini kullanarak WebSocket protokolü üzerinden akışlı ses işleme gerçekleştirir. Node.js tabanlı sunucu mimarisi; akıcı öncelikli oynatma, ses algılama, anlık kesme ve metin/ses modları arasında geçiş yapabilme yetenekleriyle donatılmıştır.
💡 Neden Radarımıza Girdi?
Xiaoban; tarayıcı tabanlı pratik yapısı, yerel gizlilik odaklı mimarisi ve kendi API anahtarınızla tamamen ücretsiz çalışabilme esnekliğiyle öne çıkıyor. Hem masaüstü hem mobil uyumlu tasarımı, açık kaynak dünyasına sesli yapay zekâ entegrasyonu açısından harika bir ilham kaynağı sunuyor.
🚀 Nasıl Denenir & Kaynaklar
Projeyi kendi bilgisayarınızda çalıştırmak için Node.js 22+ gereklidir. Depoyu klonladıktan sonra .env dosyasına DashScope API anahtarınızı ekleyip npm start komutuyla yerelde ayağa kaldırabilirsiniz. Canlı demo için geliştiricinin sunduğu web sürümünü inceleyebilir, kaynak kodlar için GitHub deposunu ziyaret edebilirsiniz.
💬 Yorumlar ve Değerlendirmeler 0
Deneyimlerinizi veya sorularınızı toplulukla paylaşın.
Yeni Yorum ve Puan Bırakın