1 yorum

 
GN⁺ 3 시간 전
Hacker News yorumları
  • Mevcut başlık olan “DeepSeek pause fundraise after comments on compute gap to US leaked (transcript) [pdf]”, DeepSeek’in ABD ile arasındaki hesaplama kaynağı farkını fark edip fon toplamayı durdurduğuna dair bir sızıntı varmış gibi okunuyor
    Ancak çoğu kişi bunu, hesaplama kaynağı farkına ilişkin açıklamalar sızdığı için fon toplamayı durdurduğu şeklinde anlayacaktır; bu yorum ise doğru değil

    • “Leaked DeepSeek transcripts reveal plan to pause fundraising due to compute gap” gibi bir başlık daha iyi olabilir
      Yine de burada hesaplama kaynağı farkının tam olarak ne olduğu ve bunun fon toplamayı durdurmanın nedeni olup olmadığı da belirsiz; başlık sanki farklı şeyleri bir araya getiriyor
    • Belgeye göz atınca aslında ikinci yorumun, yani sızıntıya tepki olarak yatırım almayı durdurduğu yönündeki okumanın daha doğru olduğu görülüyor
      Belgede şirketin gizli bilgileri ve ABD laboratuvarlarına karşı gelecekte izleyeceği strateji epey ayrıntılı biçimde yer alıyor; bu yüzden sızıntıya büyük öfke duymuş olmaları ve cezalandırıcı bir önlem olarak yatırımı askıya almaları muhtemel. Rakiplerinden daha az kaynağa sahip olduklarını düşündülerse fon toplamayı durdurmaları için bir neden yok; bu açıdan ilk yorum mantıksız
    • Çince haberlerin hepsi ikinci yoruma işaret ediyor. Asıl mesele, Liang Wenfeng’in yatırımcılarla yaptığı özel konuşmanın internete sızması ve onun buna çok öfkelenmesi
      Örnek: https://x.com/_FORAB/status/2081034500101017616?s=20
    • Başlıktaki ifadeyi açıklayan haberi paylaşmayı düşündüm ama kayıt dökümünün daha ilginç olduğuna karar verdim. Yardımcı bağlantı olarak eklenebilse iyi olurdu
      https://www.bloomberg.com/news/articles/2026-07-25/deepseek-...
      Ücret duvarı daha hafif olan, fiilen aynı kopya ise https://fortune.com/2026/07/25/deepseek-liang-wenfeng-backer... ve https://archive.ph/zpIrG adreslerinde görülebilir
  • Biraz daha bağlam sağlayan haber şu: https://www.cyberkendra.com/2026/07/deepseek-pauses-fundrais...
    Bloomberg’e göre, Liang Wenfeng’in ABD-Çin yapay zeka rekabetine ilişkin açıklamalarının internette yayılmasından birkaç gün sonra DeepSeek, ikinci yatırım turunun potansiyel yatırımcılarına sürecin durdurulduğunu bildirdi. Tencent’e bağlı bir teknoloji medyasının yayımladığı 118 maddede AGI stratejisi, çip tedariki, fiyatlandırma ve yetenek tutma gibi konular yer alıyordu; Liang ise Çin’in zayıflığını yetenek değil, kaynaklara dair aritmetik bir sorun olarak tanımlıyordu
    Özellikle en ileri model eğitimleri için 200 bin Huawei 950 çipine ihtiyaç duyduklarını, ancak yalnızca 16 bin tane alabildiklerini ve Huawei’nin üretim kapasitesi eksikliğinin en az 3 yıl süreceğinin öngörüldüğünü söylüyordu. Ayrıca ABD laboratuvarlarından çok daha az hesaplama kaynağıyla farkı 3-6 aya kadar indirme yolları da öneriyordu

    • Çin’in daha az gelişmiş mantık yarı iletkeni fabrikalarını büyük ölçekli biçimde genişletme stratejisinin de mümkün olup olmadığını merak ediyorum. GPGPU ve yapay zeka, grafikten çok daha fazla bellek bant genişliğine bağımlı ve hesaplama yoğunluğu daha düşük görünüyor
      GPU ömrünü uzatmak için amortismanı düşürmenin bir “mali hile” olduğu sıkça söyleniyor, ama yeni GPU’larda bant genişliği artışı çok büyük olmadığı için gerçek ömür gerçekten daha uzun olabilir. Bellek şirketlerinin hisseleri fırlamışken NVIDIA’nın yatay seyretmesi de bunu yansıtıyor olabilir. Çin’in en ileri bellek üretiminde ABD ile arasındaki fark daha küçük olduğundan, dezavantajı abartılıyor olabilir
    • Bu, küçük modellerin iyileştirilmesi ve açık kaynak haline getirilmesinin süreceği ihtimalini artırıyor
      ABD’li yapay zeka şirketlerinin yaklaşımının en iyisi olduğu gibi bir yanılgı var, ama en öndeki modeller aşırı büyük ve yüzlerce olası hız iyileştirmesi olabilir. Açık ağırlıkları zorlamak bu verimsizlikleri azaltmayı sürdürmeye yardımcı olabilir
  • Çin'in açık ağırlıklı modelleri ABD'yi yakalıyorsa ve maliyetin yalnızca bir kısmıyla en ileri seviye performans üretebiliyorsa, sonunda yapay zeka modelleri emtiaya dönüşür ve ABD laboratuvarlarının milyarlarca, trilyonlarca dolarlık yatırımları sadece azalan getiri mi üretir, üstünlükleri de yalnızca geçici midir diye sorgulanıyor
    Öyleyse DeepSeek'in neden aynı yolu seçtiği, performans farkı geçiciyken ve maliyet bu kadar yüksekken mutlak anlamda en ön safta olmanın gerçekten neden önemli olduğu da belirsiz

    • ABD'li politika yapıcılar, fark yalnızca 6 ay ila 1 yıl olsa bile AGI'ye önce ulaşan tarafın düşmanlarını fiilen etkisiz bırakacak kadar büyük bir üstünlük elde edebileceğine inanıyor. Siber savaş ve kitle imha silahlarından söz etmelerinden bunun anlamı çıkarılabiliyor. Buna karşılık Jensen Huang, yapay zekayı bir maraton olarak görüyor
    • DeepSeek, hedge fon High-Flyer tarafından finanse ediliyor ve token fiyatlarını da sunucu maliyetlerini karşılayacak düzeyle kasıtlı olarak sınırlıyor
      Kayıtta bu durum ahlaki bir sorumluluk olarak ifade ediliyor; görüntü/video üretimi ya da world model çılgınlığıyla ilgilenmediklerini, yalnızca muhakeme, düşünme süreci ve sürekli öğrenmeye odaklandıklarını söylüyorlar
    • Makale bu kısmı açık sözlülükle ele alıyor ve DeepSeek'in en üst düzey şirketlerden biri olmasının beklendiğini ya da hedeflendiğini söylemiyor
      Amaç dünya hakimiyeti değil, büyük dil modellerinin gelişimine kendi paylarını eklemeyi sürdürmek; ticari hale gelme ise uzak bir hedef yalnızca. Zaten hizmet sundukları düşünülürse burada ticarileşme muhtemelen ciddi kâr üretimi anlamına geliyor. Bu tavırla bakınca sızıntıya yanıt olarak fon toplamayı iptal etmeleri de anlaşılır
    • Yatırımcı toplantısındaki sözlere bakılırsa Liang, AGI'den emin görünüyor ve her şeyini buna yatırıyor. AGI'ye ulaşılırsa düzenin tamamen tersine döneceğini düşünüyor, ancak emek ve tüketim piyasaları üzerindeki etkisi çok büyük olacağından gerçek ekonomik etkiyi öngörmek zor
      Daha gidilecek çok yol olduğunu ve bu arada maliyetlerin de geri kazanılması gerektiğini kabul ediyor; ancak kısa vadeli gelire odaklanmanın AGI başarısı olasılığını düşürdüğünü ve AGI'nin getireceği değerin yanında bunun önemsiz kaldığını düşünüyor. Ölçülülüğü kurum kültürü olarak vurguluyor ve yalnızca basit performans artışlarına değil, atılımlara inandığı için yapay zeka yatırımını sürdürüyor
    • Çin'de devlet destekli şirketlerin propagandası çok olduğundan, maliyetin yalnızca bir kısmıyla geliştirildiği iddiası tartışmalı. Singapore gibi üçüncü ülkeler üzerinden büyük çaplı GPU kaçakçılığına dair işaretler var, ancak Çin bunu açıkça kabul edemez
      Eğer distillation ise, bu sıfırdan eğitimden çok daha ucuz olacaktır ve Çin'deki iş gücü maliyeti de ABD'den düşüktür. Anthropic, Alibaba'nın 2026 Nisan-Haziran döneminde yaklaşık 25 bin sahte hesapla Claude'la 28,8 milyon etkileşim kurduğunu iddia etti, ancak bunun bir kısmının ya da tamamının ajanlar tarafından otomatikleştirilmiş olması da mümkün
  • Depoya force push yapıldığı için eski bağlantılar kırılmış, ancak dosya hâlâ https://github.com/demo-zexuan/liang-wenfeng-investor-meetin... adresinde görülebiliyor

    • Bu belgeler, özellikle DeepSeek'in iç düşünce yapısını anlamak açısından çok değerli. Muhakeme fiyatını 10 ay içinde sermaye harcamasını geri kazanacak bir düzeyde belirleyip bunun üstünde ücret almayacaklarını söylemeleri ilginç
      Liang Wenfeng'in motivasyonu, Batı'da alışık olunan girişimcilerden belirgin biçimde farklı
  • Bu kayıt, Anthropic ya da OpenAI'yi yöneten megaloman yöneticilerin açıklamalarından çok farklı okunuyor

    • Anthropic ve OpenAI yatırımcı toplantısı kayıtlarını da okuyup okumadığını merak ediyorum. Şirketlerin resmî belgelerinin nasıl yazıldığını görmek için IPO başvuru belgeleri okunmalı; elinizin altında böyle bir belge yoksa SpaceX belgelerindeki “CAUTIONARY STATEMENT REGARDING FORWARD-LOOKING STATEMENTS” bölümüne bakabilirsiniz
      https://www.sec.gov/Archives/edgar/data/1181412/000162828026...
    • OpenAI ile Anthropic'i neden sürekli aynı kategoriye koyduklarını anlamıyorum. OpenAI de kötü görülebilir ama Anthropic çok daha vahim ve kıyas kabul etmez
      Açık ağırlıklar/açık kaynak mektubunu OpenAI dahil büyük teknoloji şirketleri imzaladı ama Anthropic imzalamadı; çalışanları da https://x.com/Mononofu/status/2080937562739531837 gibi açıklamalar nedeniyle X'te sert biçimde eleştiriliyor. Kendileri dışındaki herkesin aptal olduğunu, kışkırtmaya kolayca kapıldığını ve yapay zekanın onlara emanet edilemeyeceğini, kontrolün yalnızca kendilerinde olması gerektiğini düşünüyor gibiler. Güç ve zenginlik peşindeki yöneticileri çalışanların ideolojik olarak desteklediği, tarikatı andıran bir kültür oluşmuş; açıklanmış siyasi harcamaları bile 20 milyon dolardan 40 milyon dolara çıkmış
  • Temel hedef AGI, bunun önkoşulu ise sürekli öğrenme. Herkes bunu nasıl gerçekleştireceğini arıyor ve şu an için ajan çalıştırma temelli yaklaşım en güçlü aday gibi görünüyor
    Ben de https://github.com/rush86999/atom içinde aynı sorunu çözüyorum

  • Belge yeniden silinmiş gibi görünüyor, ancak Liang'ın sözleri başka yerlerde de görülebiliyor
    [1] https://aiproem.substack.com/p/must-read-deepseek-liang-wenf...

  • Açıklamanın özü, görünüşe göre fiilen NVIDIA H200 satın almak için gereken kaynakların yetersizliği. Liang, bu yıl 2 milyar dolar harcayabilirse tedarik departmanının olağanüstü iş çıkarmış olacağını, ABD ile aradaki temel farkın insan gücü değil kaynaklar olduğunu ve şu anda en büyük modelin eğitim maliyetini karşılayamayacaklarını söylüyor
    Trump, ilk döneminde Çin yarı iletken sektörünün gelişimini engellemeye odaklanan bir ticaret savaşı başlattı; Çin de buna karşılık elektrikli araçlar, LiDAR ve güneş enerjisi gibi ileri sektörlerde hızla büyüdü. İkinci dönemde NVIDIA'nın Çin'e çip satışını engelledi, ancak Çin yarı iletken sektörünün şaşırtıcı ilerleme kaydetmesi üzerine geri adım attı; bunun ardından Çin ise kendi sektörünü desteklemek için yerli şirketlerin NVIDIA satın almasını tersine kendisi yasakladı. EUV'ye daha yıllar var, ancak şu anda 14nm üzeri süreçteki çiplerin çoğunu kendi üretiyor ve hızla büyüyor

    • Çin'in artık yabancı çipleri engelliyor olması ilginç. Belirleyici bir gösterge olmasa da, rakibin ABD kaynaklarını kullanmasının ABD'ye yardım etmek anlamına geldiğine karar verecek kadar ileri gitmişse bu, ABD'nin hakimiyeti açısından iyiye işaret değil
  • Huawei'nin üretim kapasitesini sınırlayan temel etkenin ne olduğu merak ediliyor. Çin, gerektiğinde ölçeği büyütme yeteneğini gösterdiği için, mesele zaten bilinen bir teknolojiyle yalnızca daha fazla tesis kurmak olsaydı muhtemelen çoktan genişlemiş olurdu

    • Eğitimde kullanılabilecek yüksek performanslı çiplerin verimi çok düşük ve bu düşük verimi göze alarak üretimi artırmak için gereken eski ASML ekipmanını da ek olarak temin edemiyorlar
      Yüksek performanslı çipleri ekonomik biçimde kendi başına üretebilecek teknolojik temeli kurmanın daha yıllar, hatta 10 yıl alması mümkün
    • Huawei çiplerinin rekabetçi kalabilmesi için ileri 3D paketleme gerekiyor, ancak süreç aşırı karmaşık olduğu için verim hâlâ düşük. Yalnızca DeepSeek değil, birçok yerden talep yüksek ve Huawei'nin kendisi de başlıca tüketicilerden biri