Bloomberg'e göre OpenAI'ın ChatGPT'nin "fiziksel tezahürü" olarak tarif edilen akıllı hoparlörü donut şeklinde olacak; yüksek kaliteli metal gövde, "premium" bir görünüm ve hareketli parçalar içerecek. Fiyat 300-400 dolar aralığında, Amazon'un 40-240 dolarlık cihazlarının epey üstünde. Jony Ive'ın kurduğu LoveFrom ile geliştirilen cihaz muhtemelen 2027'de çıkacak.
Benim yorumumBeni asıl merak ettiren "hareketli parçalar" detayı: bir hoparlöre mekanik ekliyorsan ya kamera/mikrofon yönlendiriyorsun ya da ekranı döndürüyorsun, ikisi de sıradan bir Alexa klonundan çok başka bir ürün demek. Ama 300-400 dolar, kimsenin para kazanamadığı bir kategoride cesur bir iddia. Üstüne Apple'ın ticari sır davası var. 2027 uzak; o zamana kadar asıl soru donanım değil, evdeki mikrofona ne kadar güvendiğin olacak.
Google, Maps'teki "Ask Maps" özelliğine yemek siparişi, otel rezervasyonu ve etkinlik bileti bulma gibi agentic yetenekler ekledi. Sipariş akışı Square, Toast veya Uber Eats üzerinden sepete ekleme yapıyor, ödeme o platformda tamamlanıyor. Agentic özellikler ABD'de; varsayılan olarak kapalı gelen Personal Intelligence, Gmail ve Google Calendar verisiyle yanıtları kişiselleştiriyor ve Ask Maps'in açık olduğu tüm pazarlara çıkıyor.
Benim yorumumDikkat edilmesi gereken bir konu: burada uçtan uca bir agent yok. Ask Maps sepeti dolduruyor, ödemeyi sen Square, Toast ya da Uber Eats'te yapıyorsun; otelde de partner sitesine tıklayıp çıkıyorsun. Yani gerçek iş, checkout, hâlâ dışarıda. Asıl kısım Personal Intelligence bence: Gmail ve Calendar'ı haritaya bağlamak, konumla mail içeriğini aynı context'te birleştirmek demek. Varsayılan kapalı olması da bunun farkında olduklarını gösteriyor. Kaç kişi açacak, görmek lazım.
Meta, beta aşamasında olan terminal tabanlı kodlama ajanı Muse Code'u yayınladı. Mark Zuckerberg'e göre araç büyük repolarda planlama, kod yazma ve sonuç doğrulama yapıyor; iş büyüdüğünde izole worktree'lerde paralel çalışan alt ajanlara dağılıyor ve çalışma kopyanıza dokunmuyor. Altında Meta'nın daha önce çıkardığı Muse Spark kodlama modeli var.
Benim yorumumAsıl ilginç detay paralellik iddiası: izole worktree'ler, çalışan kopyaya dokunmadan altı feature'ı aynı anda çakışmasız kurmak. Bunu gerçekten büyük bir monorepoda denemiş biri bilir ki zor kısım kod yazmak değil, merge. Ama Alexandr Wang'ın vurgusu yeteneğe değil maliyete: Codex ve Claude Code karşısında ucuz olmak. Bence konumlanma bu, ve fiyat kalıcı bir fark değil. Beta'da fan-out'un gerçekten temiz çalışıp çalışmadığını göreceğiz.
Meta sözcüsü çarşamba günü, Muse Spark modelinin siber güvenlik testleri sırasında başka bir şirkette "bir güvenlik açığını istismar ettiğini" doğruladı. Sebep olarak bağımsız test şirketi Irregular'ın hatalı yapılandırması gösterildi; bu hata model değerlendirme sırasında modele internet erişimi vermiş. Haberi The Information duyurdu, CNN yeniden servis etti. Daha önce OpenAI ve Anthropic'te de benzer olaylar açıklanmıştı.
Benim yorumumÜç şirket, üç aynı hikâye: modelin kötücül olması değil mesele, eval harness'ının network egress'inin açık kalması. Burada suçlanan taraf Irregular, yani üçüncü parti bir test şirketi — ve bence asıl mesaj bu. Tehlikeli yetenekleri ölçmek için kurduğun sandbox, ölçtüğün şeyden daha zayıfsa neyi test ettiğini bilmiyorsun. Simon'ın Gemini şakası eğlenceli ama sıradaki açıklamanın kimden geleceğini merak ediyorum. Sen kendi eval kutunun dışarıya ne kadar çıkabildiğini biliyor musun?
OpenAI, haftalık 1 milyar kullanıcıyı geçen ChatGPT'de tüm kullanıcılar için metin sohbetlerindeki limitleri kaldırıyor. Free ve Go'da varsayılan model GPT-5.5 yerine GPT-5.6 Luna oluyor, yanına da daha yüksek reasoning için "Think" butonu geliyor. Plus ve Pro ise güncellenmiş GPT-5.6 Sol ile thinking slider alıyor. Dosya, görsel, ses ve görsel üretimde limitler duruyor.
Benim yorumumAsıl haber limitler değil, kontrolün kullanıcıya verilmesi bence. Think butonu ve thinking slider, model seçici karmaşasını "ne kadar düşünsün" sorusuna indiriyor; API tarafında reasoning effort ile zaten yaptığın şeyin tüketici hali. GPT-5.5-Instant'a kıyasla factual error'da %62 ve %68 azalma iddiası ise internal evaluation, yani bağımsız bir ölçüm yok. Codex ve Work'teki Sol'a dokunulmamış olması ilginç: ürün tarafı hızlı hareket ediyor, developer tarafı sabit kalıyor. İlk hafta gerçek latency'yi izlemek lazım.