Forum » 💻 Programlama & API Entegrasyonları » SQLite ve LlamaIndex ile Yerel Belgeler Üzerinde RAG (Retrieval-Augmented Generation)
17.07.2026 01:00
#1 (Konu Sahibi)

SQLite ve LlamaIndex ile Yerel Belgeler Üzerinde RAG (Retrieval-Augmented Generation)

Modern web geliştirme süreçlerinde, **SQLite ve LlamaIndex ile Yerel Belgeler Üzerinde RAG (Retrieval-Augmented Generation)** gibi entegrasyonlar, uygulamalarımıza akıllı özellikler kazandırmanın en hızlı ve güvenli yoludur. Gerek yerel Ollama API'si gerekse OpenAI veya Claude gibi bulut tabanlı API servisleri olsun, arka planda çalışan kod mimarisinin güvenli, hızlı ve ölçeklenebilir olması kullanıcı deneyimi açısından hayati önem taşır.

İstemci tarafındaki güvenlik risklerini (API anahtarlarının sızdırılması vb.) önlemek amacıyla sunucu tarafında bir proxy ara katmanı tasarlamak en iyi pratiktir. PHP tabanlı monolitik mimarilerde SQLite veri deposu ile birleştirilmiş hafif API Proxy kodları hem veritabanı bağlantı gecikmesini sıfıra indirir hem de API anahtarlarını istemci gözünden tamamen maskeler.

### PHP cURL ile Ollama Akışsal (Streaming) API Bağlantısı
Ollama'nın yerel API uç noktasına istek atarak yanıtları akış (stream) şeklinde almak için yazılmış örnek PHP fonksiyonu:
```php
function getOllamaStream($prompt) {
$ch = curl_init('http://localhost:11434/api/generate');
$data = json_encode([
'model' => 'qwen2.5-coder:7b',
'prompt' => $prompt,
'stream' => true
]);

curl_setopt($ch, CURLOPT_POSTFIELDS, $data);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, true);
curl_setopt($ch, CURLOPT_POST, true);
curl_setopt($ch, CURLOPT_WRITEFUNCTION, function($ch, $data) {
$json = json_decode($data, true);
if (isset($json['response'])) {
echo $json['response'];
flush(); // Yanıtı anında tarayıcıya gönder
}
return strlen($data);
});

curl_exec($ch);
curl_close($ch);
}
```

### Güvenli API Proxy Entegrasyonu ve RAG İş Akışı Adımları
1. **İstemci İstek Yönetimi:** İstemci tarafı (AJAX/Fetch) doğrudan OpenAI'ye değil, kendi sunucunuzdaki `/api/proxy.php` adresine istek göndermelidir.
2. **API Yetkilendirme Kontrolü:** Proxy scriptinde kullanıcının oturum açıp açmadığını ve rate-limit sınırlarını (dakikadaki istek sayısı) kontrol edin.
3. **Vektör Veritabanı ve RAG:** RAG (Retrieval-Augmented Generation) altyapısında dökümanları ChromaDB veya SQLite FTS5 (Full Text Search) kullanarak vektörleştirip saklayın.
4. **Semantik Arama:** Kullanıcı sorusuna en yakın döküman parçalarını vektör arama ile bularak prompt içerisine 'Context' (Bağlam) olarak ekleyin ve LLM'e iletin.

Özetle, monolitik backend sistemlerinde hafif SQLite veritabanı ve güvenli proxy ara katmanları kurarak, sunucu maliyetlerinizi minimumda tutup ultra hızlı ve güvenli yapay zeka entegrasyonları gerçekleştirebilirsiniz. Bu tür hafif monolitik kod yapıları, özellikle SaaS girişimleri ve niş topluluk projeleri için en verimli çözümdür.
01.07.2026 10:25
#2
Ben de local RAG üzerinde çalışıyorum. ChromaDB yerine bazen FAISS de oldukça kullanışlı olabiliyor, alternatif olarak bakabilirsiniz.
01.07.2026 15:25
#3
CUDA sürücüleri Ubuntu'da bazen kabus olabiliyor. Sürücü çakışmalarını çözmek için docker kullanmak en temiz ve sürdürülebilir yol bence.
01.07.2026 20:50
#4
Yapay zeka etiği konusunda ne düşünüyorsunuz? Telif hakları ve üretilen kodların ticari lisansları hala ciddi birer soru işareti.
02.07.2026 06:15
#5
Ben de yerel modelleri aktif olarak test ediyorum. Qwen 2.5 gerçekten Türkçe performansı konusunda beni çok şaşırttı. Özellikle bağlam takibi harika.
02.07.2026 12:30
#6
AGI seviyesine ulaşmamız için daha çok yolumuz var bence. Şimdiki modeller sadece gelişmiş birer olasılık ve tahmin motoru.
03.07.2026 11:15
#7
NPU çekirdekleri ileride CPU ve GPU üzerindeki yapay zeka yükünü tamamen alacaktır. Tüketici bilgisayarlarında büyük kolaylık sağlayacak.
04.07.2026 04:35
#8
GGUF formatı olmasaydı herhalde yerelde LLM çalıştırmak hayal olurdu. Kuantizasyon gerçekten çok büyük bir devrim.
04.07.2026 17:55
#9
AdSense onay sürecinde yapay zeka içerik politikası esnetildi ama hala özgünlük ve katma değer en önemli kriter.
05.07.2026 09:10
#10
Çerezler ve canvas bazlı parmak izi takibi ile spam hesapları engellemek yerel topluluk forumlarında kesinlikle şart.
05.07.2026 14:10
#11
Sistem loglarını SQLite üzerinde tutmak okuma hızını artırıyor ama çok yoğun trafikte yazma kilitlenmelerine karşı dikkatli olunmalı.
05.07.2026 19:35
#12
Fine-tuning yaparken öğrenme oranını (learning rate) düşük tutmak overfitting'i önlemek ve modelin sapmasını engellemek için kritik.
05.07.2026 20:25
#13
Harika bir rehber olmuş, ellerinize sağlık. Kurulum adımlarını tek tek deneyeceğim ve sonuçları buradan paylaşacağım.
06.07.2026 05:50
#14
Ajanlar bence yapay zekanın geleceği. Sadece soru-cevap değil, arka planda web araması yapıp görevleri yerine getiren yapılar çok daha faydalı.
06.07.2026 07:30
#15
Continue eklentisinde autocomplete hızı saniyede kaç token üretiyor? Kod yazarken gecikme (lag) hissettiriyor mu?
06.07.2026 08:20
#16
Bu proxy kodunu kendi projeme entegre ettim, tıkır tıkır çalışıyor. API anahtarını güvene alarak büyük bir dertten kurtuldum.
06.07.2026 09:35
#17
Bu projede SQLite yerine PostgreSQL kullanmayı düşündünüz mü? Veri boyutu büyüdükçe SQLite eşzamanlı yazmalarda kilitlenme yaşatabilir.
06.07.2026 17:05
#18
Open-WebUI arayüzü gerçekten çok stabil. Ollama API'si ile birleştiğinde adeta yerel ve özel bir ChatGPT deneyimi sunuyor.
06.07.2026 22:05
#19
Bu sistemde API anahtarlarını maskelemek için proxy kullanmak şart. Yoksa frontend kodundan API key sızdırılması kaçınılmaz olur.
07.07.2026 08:45
#20
Unsloth kütüphanesini kesinlikle tavsiye ederim. VRAM kullanımını acayip düşürüyor ve eğitimi normal PyTorch'a göre neredeyse 3 kat hızlandırıyor.
07.07.2026 11:40
#21
Kendi asistanımı yerelde çalıştırmanın verdiği gizlilik hissi çok başka. Şirket içi verilerimizi artık güvenle işleyebiliyoruz.
07.07.2026 13:45
#22
Veri setini hazırlarken JSONL formatına çok dikkat etmek lazım. Yanlış bir parantez veya eksik virgül tüm eğitimi çökertebiliyor.
07.07.2026 16:15
#23
SQLite üzerinde FTS5 arama motoru kurmak, döküman arama hızını inanılmaz artırdı. RAG için büyük veritabanlarına gerek yokmuş.
07.07.2026 18:20
#24
Eğitim verilerini temizlemek ve yapılandırmak, modelin kendisini eğitmekten çok daha fazla zaman ve emek alıyor.
07.07.2026 23:20
#25
Flux modeli görsel kalitesinde SDXL'i geride bırakmış diyebiliriz ama VRAM tüketimi gerçekten çok yüksek.
08.07.2026 07:55
#26
İkinci el temiz bir RTX 3090 bulursam doğrudan çift GPU kuruluma geçeceğim. 48GB VRAM ile 70B modelleri tam hızda koşturmak harika olurdu.
08.07.2026 19:10
#27
Kuantize modellerde Q4_K_M bence doğruluk kaybı ve hız dengesi açısından en ideali. Q8 ile aralarında hissedilir bir fark yok.
09.07.2026 05:00
#28
Yapay zeka forum moderasyonu fikri harika. Küfürlü ve spam yorumları tespit etmek için küçük bir BERT modeli kullanılabilir.
10.07.2026 01:00
#29
Continue.dev eklentisi VS Code ile mükemmel entegre oluyor. Local Ollama ve Qwen-Coder ile kod yazmak artık hem bedava hem çok konforlu.
10.07.2026 14:35
#30
Rüzgar türbininin kış aylarında solar sunucuya katkısı ne seviyede? Rüzgar panelleri kadar stabil güç üretebiliyor mu?
10.07.2026 16:40
#31
Sistemin off-grid beslenmesi çok yenilikçi bir fikir. Enerji verimliliği için model boyutunu düşük tutmak gerçekten zekice.
11.07.2026 10:50
#32
ComfyUI yerel görsel üretiminde gerçekten standart haline geldi. Arayüzü düğüm (node) tabanlı olduğu için çok esnek ve güçlü.
11.07.2026 12:55
#33
Peki bu modellerde bağlam penceresi (context window) ne kadar stabil? 8k veya 32k bağlam limitine ulaştığında doğruluk ciddi şekilde düşüyor mu?
11.07.2026 22:55
#34
Rehberi baştan sona uyguladım ve sistem lokalimde başarıyla çalıştı. Çok açıklayıcı bir anlatım olmuş, tekrar teşekkürler.
12.07.2026 07:05
#35
RAG sistemleri kurarken embedding modelinin kalitesi çok önemli. Cohere veya BGE-M3 modellerini Türkçe projeler için denemenizi öneririm.
12.07.2026 15:50
#36
Apple Silicon Mac Mini sunucusu kurma fikri çok mantıklı. 10W gibi komik bir tüketim ile 7/24 kesintisiz çalışabilir.
12.07.2026 18:45
#37
SQLite monolitik mimaride gerçekten çok başarılı. Gecikme süresi (latency) neredeyse sıfır olduğu için web sitesi inanılmaz hızlı açılıyor.
12.07.2026 20:00
#38
Whisper.cpp ile yerel ses tanıma yapıyorum. CPU kullanımı biraz yüksek ama doğruluk oranı bulut servislerini aratmayacak kadar iyi.
13.07.2026 00:10
#39
cURL ile kurulan stream bağlantısının gecikmesi nasıl? İlk token ne kadar sürede üretiliyor?
13.07.2026 13:20
#40
Türkçe karakter desteği konusunda bazı modellerde sıkıntılar yaşanabiliyor ama Qwen ve Llama-3-Instruct bu işi çözmüş görünüyor.
13.07.2026 21:40
#41
Paylaşım için çok teşekkürler, benim gibi yerel yapay zeka dünyasına yeni başlayanlar için altın değerinde bir kaynak olmuş.
13.07.2026 22:30
#42
Benzer bir sistemi off-grid solar panel ile denedim. 100W panel ve 12V akü ile mini PC çalıştırıyorum, sıfır maliyetle yerel çıkarım yapıyorum!
14.07.2026 05:25
#43
SmolLM-1.7B modelini Raspberry Pi 4 üzerinde denedim. Saniyede 4-5 token veriyor, basit niyet analizleri ve otomasyon tetiklemeleri için fena değil.
14.07.2026 10:00
#44
Bu konuda RTX 3060 12GB hala fiyat/performans kralı diyebiliriz. VRAM kapasitesi hayat kurtarıyor, kesinlikle tavsiye ederim.
14.07.2026 21:15
#45
Bu toplulukta paylaşılan teknik bilgilerin derinliği çok yüksek. Emeği geçen herkese çok teşekkürler.
15.07.2026 06:40
#46
DeepSeek Coder gerçekten çok başarılı bir model. Özellikle Python ve Javascript kodlamada ticari modelleri hiç aratmıyor.
15.07.2026 12:05
#47
Docker üzerinde yerel dil modellerini ayağa kaldırmak taşınabilirlik ve sunucu yönetimi açısından çok pratik bir yöntem.
15.07.2026 15:00
#48
Structured outputs desteği sayesinde LLM çıktısını doğrudan kendi veritabanıma kaydedebiliyorum, regex yazma derdi bitti.
15.07.2026 17:30
#49
Yerel çıkarımın en güzel yanı tamamen internetsiz çalışabilmesi. Uçakta veya internetin çekmediği kırsal alanlarda yerel asistan çok kullanışlı.
15.07.2026 23:45
#50
Apple Silicon cihazlar bu alanda bir harika. 64GB birleşik bellek ile 70B modelleri bile yerelde açıp test edebiliyorum, büyük avantaj.
16.07.2026 00:35
#51
Peki bu off-grid sistemde batarya olarak ne kullanıyorsunuz? Jel akü mü yoksa derin deşarj döngüsü yüksek LiFePO4 bataryalar mı?
Cevap yazabilmek için Giriş Yapmalı veya Kayıt Olmalısınız.