Arama Yap Mesaj Gönder
Biz Sizi Arayalım
+90
X

Lütfen Ülke (Bölge) Seçiniz

Türkiye (Türkçe)Türkiye (Türkçe) Almanya (German)Almanya (German) Worldwide (English)Worldwide (English)
X

Lütfen Para Birimi Seçiniz

Türk Lirası $ US Dollar Euro
X

Lütfen Ülke (Bölge) Seçiniz

Türkiye (Türkçe)Türkiye (Türkçe) Almanya (German)Almanya (German) Worldwide (English)Worldwide (English)
X

Lütfen Para Birimi Seçiniz

Türk Lirası $ US Dollar Euro

Bize Ulaşın

Konum Halkalı merkez mahallesi fatih cd ozgur apt no 46 , Küçükçekmece , İstanbul , 34303 , TR
TEKNİK REHBER • TR / EN / DE

OpenHands + Ollama / vLLM Local Model Kurulumu

OpenHands’i Ollama veya vLLM gibi local/self-hosted inference endpoint’lerine bağlarken model seçimi, endpoint erişimi, context ve GPU kapasitesini birlikte planlama rehberi.

Production öncesi önemli not

Komutları canlı sistemde uygulamadan önce sürüm, yedek, firewall ve geri dönüş planını kendi altyapınızda doğrulayın.

mimari kapasite güvenlik hata teşhisi
MİMARİ & TEŞHİS
EKA CORE
OpenHands + Ollama / vLLM Local Model Kurulumu

Mimari ve veri akışıProduction odaklı teknik kontrol
Doğrulandı
Sunucu kapasitesi nasıl planlanmalı?Production odaklı teknik kontrol
Doğrulandı
Performans nasıl ölçülmeli?Production odaklı teknik kontrol
Doğrulandı
Güvenlik ve erişim sınırlarıProduction odaklı teknik kontrol
Doğrulandı
Resmî kaynak + ölçülebilir test + geri dönüş planı
Bu rehberde neler var?

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

01

Bu rehberde neler var?

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz.

Mimari ve veri akışı
Sunucu kapasitesi nasıl planlanmalı?
Performans nasıl ölçülmeli?
Güvenlik ve erişim sınırları
Production kontrolü ve canlıya geçiş
Hata teşhisi: nereden başlanmalı?

İçindekiler

  1. Mimari ve veri akışı
  2. Sunucu kapasitesi nasıl planlanmalı?
  3. Performans nasıl ölçülmeli?
  4. Güvenlik ve erişim sınırları
  5. Production kontrolü ve canlıya geçiş
  6. Hata teşhisi: nereden başlanmalı?
  7. Sık görülen hata ve yanlış teşhisler
  8. Komutlar ve kontrol çıktıları
  9. İnteraktif teknik araç
  10. Sık sorulan sorular
02

Mimari ve veri akışı

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir.

OpenHands + Ollama / vLLM Local Model Kurulumu için tasarım kararı yalnız servislerin ayağa kalkmasına göre verilmemeli. Inference endpoint private ağda tutulabilir; API key, firewall ve runtime egress policy ile erişim daraltılmalıdır. Mimari doğrulamada OpenHands Local LLMs dokümantasyonu ile gerçek ağ ve veri akışı birlikte karşılaştırılmalıdır.

03

Sunucu kapasitesi nasıl planlanmalı?

Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir. Bu yüzden kapasite testi, OpenHands + Ollama / vLLM Local Model Kurulumu üzerinde gerçek veri ve eşzamanlı iş yüküyle yapılmalı; yalnız boşta kullanılan RAM değeri satın alma kararına dönüştürülmemelidir.

04

Performans nasıl ölçülmeli?

Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir. GPU veya hızlandırıcı kullanılan senaryoda aynı model/veri, aynı concurrency ve aynı ölçüm süresi korunmadan yapılan karşılaştırma güvenilir değildir.

Karşılaştırmada aynı veri/model, aynı concurrency ve aynı ölçüm penceresi korunur. Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir. Sonuç tablosuna throughput yanında başarısız iş oranı ve peak kaynak kullanımı da eklenmelidir.

05

Güvenlik ve erişim sınırları

Inference endpoint private ağda tutulabilir; API key, firewall ve runtime egress policy ile erişim daraltılmalıdır.

OpenHands + Ollama / vLLM Local Model Kurulumu için erişim politikası deployment sonrasında eklenen bir ayrıntı değildir. Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir. Bu akışta public olması gerekmeyen database, worker, runtime veya yönetim portları private ağda tutulmalıdır.

06

Production kontrolü ve canlıya geçiş

Model değiştirirken aynı görev setiyle başarı oranı, latency ve token tüketimi karşılaştırılmalıdır; tek prompt benchmark yeterli değildir.

Canlıya geçiş kontrolünde şu komut/işlem hattı da doğrulama noktası olarak kullanılabilir: curl http://127.0.0.1:11434/api/tags. Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir. Bu kontrol başarısızsa release ilerletilmeden önce geri dönüş noktası test edilmelidir.

07

Hata teşhisi: nereden başlanmalı?

Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir.

OpenHands + Ollama / vLLM Local Model Kurulumu arızasında semptom ile kök nedeni ayırmak için önce son değişiklik zamanı kaydedilir. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir. Ardından servis logu, dependency health ve ağ erişimi aynı zaman diliminde karşılaştırılır.

ERR

Sık görülen hata ve yanlış teşhisler

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

Belirti / problemMuhtemel katmanİlk doğrulama
Sandbox başlıyor fakat workspace yazılamıyorContainer içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir.İlgili servis logu, dependency health ve son değişiklik zamanı tek zaman çizgisinde karşılaştırılır.
Agent local model endpoint’ine ulaşamıyorKod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.Peak kaynak kullanımı, concurrency ve disk/network baskısı aynı test penceresinde ölçülür.
Tool çağrıları bozuk JSON/timeout üretiyorInference endpoint private ağda tutulabilir; API key, firewall ve runtime egress policy ile erişim daraltılmalıdır.Public/private portlar, kimlik doğrulama, TLS ve secret kapsamı dıştan içe doğrulanır.
GPU var fakat görev başarı oranı düşükModel değiştirirken aynı görev setiyle başarı oranı, latency ve token tüketimi karşılaştırılmalıdır; tek prompt benchmark yeterli değildir.Sürüm, config diff, kalıcı veri ve geri dönüş noktası birlikte kontrol edilir.
FLOW

Uygulama ve doğrulama akışı

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz.

1

Workspace sınırını belirle

OpenHands’i Ollama veya vLLM gibi local/self-hosted inference endpoint’lerine bağlarken model seçimi, endpoint erişimi, context ve GPU kapasitesini birlikte planlama rehberi.

2

Sandbox sağlayıcısını doğrula

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir.

3

LLM endpoint’ini ayrı test et

Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

4

Secret ve network egress’i daralt

Inference endpoint private ağda tutulabilir; API key, firewall ve runtime egress policy ile erişim daraltılmalıdır.

5

Aynı görev setiyle model testi yap

Model değiştirirken aynı görev setiyle başarı oranı, latency ve token tüketimi karşılaştırılmalıdır; tek prompt benchmark yeterli değildir.

6

Log ve artifact ile sonucu doğrula

Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir.

CLI

Komutlar ve kontrol çıktıları

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz.

Adım 1
ollama list
Adım 2
curl http://127.0.0.1:11434/api/tags
Adım 3
curl http://127.0.0.1:8000/v1/models
Adım 4
nvidia-smi
GPU

İnteraktif teknik araç

Model ağırlığı için yaklaşık VRAM planlama aracı

Bu sonuç tahmindir; production kararı gerçek ölçüm ve test ile verilmelidir.
TEKNİK ÖN DEĞERLENDİRME

Sunucu ihtiyacınızı teknik olarak değerlendirelim

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

Telefon & WhatsApp0850 307 34 58İlk aşamada şifre göndermeyin.
SRC

Resmî ve teknik kaynaklar

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz.

EKA

İlgili Eka Sunucu sayfaları

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz.

FAQ

Sık sorulan sorular

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

OpenHands GPU’yu doğrudan kullanır mı?

Agent katmanı local provider endpoint’ine istek gönderir; runtime’ın endpoint’e ağ üzerinden erişebilmesi gerekir.

Sandbox ile host arasındaki güvenlik sınırı nedir?

Inference endpoint private ağda tutulabilir; API key, firewall ve runtime egress policy ile erişim daraltılmalıdır.

Ollama/vLLM endpoint’i container’dan nasıl erişilir?

Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

Hangi local model sınıfı denenmeli?

Model değiştirirken aynı görev setiyle başarı oranı, latency ve token tüketimi karşılaştırılmalıdır; tek prompt benchmark yeterli değildir.

Workspace’e hangi klasörler mount edilmemeli?

Container içinden hosttaki Ollama’ya localhost ile erişilememesi yaygın bir network namespace problemidir.

Bu sayfadaki interaktif araç kesin kapasite garantisi verir mi?

Hayır. Araç ilk planlama için yaklaşık sonuç üretir. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir. Son karar gerçek workload ölçümüyle doğrulanmalıdır.

EKA SUNUCU

Sunucu ihtiyacınızı teknik olarak değerlendirelim

Kurulum komutundan öte mimari, kapasite, güvenlik, hata teşhisi ve production işletimini tek akışta ele alıyoruz. Kod ajanlarında model kalitesi kadar context ve tool-use başarısı önemlidir; quantized büyük modeller için VRAM ve token throughput birlikte ölçülmelidir.

Telefon & WhatsApp0850 307 34 58ekasunucu.com
Top