Tencent’in Hunyuan laboratuvarı, iki ay içinde iki büyük açık ağırlık modeli yayınladı: Hy3 temmuzun başında ve Hy4 önizlemesi 28 Ağustos 2026’te. Her iki model de Mixture-of-Experts (MoE) mimarisi kullanır, her ikisi de Apache 2.0 lisansı taşır ve her ikisi de ajent kodlama ve uzun bağlam üretkenlik işleri hedefler. Bu yayınlar önemlidir, çünkü kurumlara ABD-kontrollü API’lara karşı izin veren bir lisanslı alternatif sunarlar, tahmin maliyeti sadece bir fraksiyonu kadar — donanım gerçeklerini yönetebiliyorsanız.
İki modelin aslında neler olduğu
Hy3, 295B parametreli bir MoE modelidir, her token için 21B aktif parametre, 256K-token bağlam penceresi ve speküatif kodlama için 3.8B çoklu-token tahmini (MTP) katmanına sahiptir. Hy4 önizlemesi, toplam 770B parametreye ulaşır, 49B aktif parametreye sahiptir ve bağlamı 1 milyon tokenın ötesine çıkarır. Tencent, Hy3’i “trilyon ölçekli amirallerle rakip” olarak konumlandırır; çünkü sparse aktivasyon, ~300B modelinin ajent benchmark’lerde çok daha yoğun bir yığın gibi davranmasını sağlar, her ağırlığı aktif etmeden [2].
Her iki model de Hugging Face ve ModelScope üzerinden gün birinden itibaren mevcuttur. Hy3’in OpenRouter üzerindeki ücretsiz API penceresi (tencent/hy3:free) lansman sırasında iki hafta sürdü; Hy4 önizlemesi de WorkBuddy, CodeBuddy ve OpenRouter üzerinden aynı iki hafta ücretsiz katmanı alır [3]. AtlasCloud, Hy3’i tam 256K bağlam ile milyon giriş token başına 0,20 dolar ve milyon çıkış token başına 0,80 dolar olarak listeler — bu da onu en maliyet-etkin barındırılan seçeneklerden biri hâline getirir [4].
GLM, DeepSeek ve kapalı API’larla nasıl karşılaştırıldıkları
Tencent’in iç kör değerlendirmesinde, 163 uzman Hy4 önizlemesini 203 mühendislik görevi üzerinde 4,00 üzerinden 2,99 puanla değerlendirdi; bu skor GLM-5.3’ün (2,92) ve Kimi K3’ün (2,94) puanlarını geçti [3]. Hy3, SWE-bench Verified’de %78 ve GPQA Diamond’de %90,4 başarı gösterdi [2]. Hy3 önizleme taban modeli, sadece 21B parametre aktif ederek Kimi-K2 Base (1,043B), DeepSeek-V3 Base (671B) ve GLM-4.5 Base (355B) modellerinin 32B–37B aktif parametre karşısında rekabet etti [4].
Pratik fark: bu ölçekte Apache 2.0 lisansı, ihraç kontrolü altında olan ABD API’larına erişemeyen kurumlara, düzenlenmemiş kod ajentleri için izin veren bir lisanslı alternatif sağlar [2]. Nous Research, bunu “maliyet-etkin ajent kullanımına odaklanmış ve özellikle kodlama, araç çağrısı güvenilirliği, reasoning ve 256K uzun bağlam görevlerinde güçlü” olarak tanımlamıştır [2].
Kendi çalıştırmanız: API, kendi barındırma ve kuantizasyon
Hy3’i tam fideliteyle kendi barındırmak istiyorsanız, Tencent H20-3e veya H200 sınıfı GPU’lar kullanarak 8× GPU tensor paralelini belirtir [2]. Bu bir küme olup bir iş istasyonu değildir. Ancak, 14 Temmuz’da llama.cpp için MTP desteği olan 1-bit ve 4-bit GGUF kuantizasyonları yayınlandı; bu sayede 128 GB tek-GPU riginde çıkarım yapılabiliyor — 8× H20 kümesine ihtiyaç yok [2]. vLLM ve SGLang için resmi sunum tarifeleri mevcuttur [2].
Hy4 önizlemesinin 49B aktif parametresi ve 1M+ bağlamı çubuğu daha da yükselecek; Tencent henüz onun için minimum kendi barındırma spesifikasyonlarını yayınlamadı. Şimdilik, ücretsiz API pencereleri ve üçüncü parti barındırıcıları (OpenRouter, Tencent Cloud TokenHub, AtlasCloud) en düşük sürtünmeli giriş noktalarıdır [3][4].
Gerçek iş akışlarında nerede göründükleri
Hy3, Tencent’in WorkBuddy/CodeBuddy kodlama asistanlarını, Yuanbao tüketici asistanını (doğal dilden PowerPoint, Word, Excel, PDF ve HTML üreten ücretsiz Agent işlevi kazandı), OS-level Marvis asistanını, bilgi aracı ima’yı, Weixin/WeChat Resmi Hesaplar AI müşteri hizmetlerini ve WeGame üzerindeki Path of Exile: Advent asistanını güçlendirir [4]. WorkBuddy kullanıcıları Hy3’i aktif olarak seçme oranı önizleme tarihinden bu yana altı kat artmıştır [4].
Hy4 önizlemesi bu yetenekleri genişletir: uzun bağlamlı geliştirme için daha iyi anlama, planlama, hata ayıklama ve doğrulama; finansal analiz ve belge間 işbirliği üzerindeki iyileşme; tek doğal dil isteğinden oynanabilir oyun prototipleri üretimi; ve AI Araştırma ve Geliştirde, moleküler dinamik, yoğunlaştırılmış madde fizigi ve temel matematikte belirgin kazanımlar [3]. Ayrıca kendi geliştirme sürecine de katıldı — eğitim optimizasyonları önerdi, deneyler yaptı ve sonuçlara göre yineleme yaparak erken özyinelemeli kendini iyileştirme döngüsü oluşturdu [3]. Özerk operatör birleştirmesi ve iletişim optimizasyonu sayesinde çıkarım verimi %31,8 artırıldı [3].
Geçiş önünde değerlendirmeniz gerekenler
Apache 2.0 lisansı ticari olarak uygun [5]. Benchmark sayıları rekabetçi. Ancak iki pratik sınırlama hâlâ mevcut: tam ağırlıkla kendi barındırma sérieux GPU sermayesi talep eder ve modeller hafta-ay yaşındadır — uzun vadeli kararlılık, topluluk araçları ve güvenlik denetimi izleri hâlâ oluşum aşamasındadır. İş yükünüz ücretsiz API katmanına veya barındırılan fiyatlandırmaya uyuyorsa maliyet argümanı güçlüdür. Tam fideliteyle hava geçirimi olmayan dağıtım ihtiyacınız varsa, 8× H200 sınıfı küme için bütçe ayırmanız gerekir. Hy3 için 128 GB tek-GPU kuantizasyonlu yol mevcuttur; Hy4’ün eşdeğeri henüz belgelenmemiştir.
OpenRouter veya WorkBuddy/CodeBuddy üzerinden ücretsiz API ile başlayın. Altyapı taahhüt etmeden önce gerçek ajent iş akışlarınızı stres test edin — araç çağrısı güvenilirliği, uzun bağlam alma ve çıktı formatı uyumu.
Kaynaklar
- Tencent Hy3: 295B Açık MoE Ajent Kodlama İçin | explainx.ai Blogu
- Tencent Yayınlar ve Açık Kaynak Hale Getirir Tencent Hy4 önizlemesi
- Tencent Hy3’i yayınlar: açık kaynak 295B MoE modeli - datanorth.ai
- Tencent Hunyuan Resmi Olarak Hy3’i Yayınlar, Ajent Yeteneklerini Geliştirir …
- Çin’in Tencent’i kodlama ve araştırma için yeni açık kaynaklı AI modeli yayınlar …