Yapay zeka ajanlarının artık kendi telefon numarası, e-postası, cüzdanı ve bilgisayarı var ve bu bir fikir denemesi değil; 28 Eylül'de bağımsızlığını ilan eden sürecin ardından Manus 2.0 ile sahaya inmiş bir ürün. Kurucu Xiao Hong'un tezi net: Manus en baştan beri herkese açık bir platformdu ve bilgisayar satmaya benziyordu; insanlar bilgisayarı iş için alır ama video ve oyun çalıştırmıyorsa sıkıcı kalır. Yeni mimarinin adı Cascade ; proje hafif başlıyor, uzman yetenekler yalnızca iş gerektirdiğinde çağrılıyor, özet, sayfa, video ve otomasyon tek bağlantılı projenin parçası kalıyor. Paylaşılan tek testte jeton kullanımı yüzde 23,2 , süre yüzde 28,2 , maliyet yüzde 32 düşük çıktı; ortalamalar değil, tek ölçüm olduğunun altını çizmek şart. Bu mimari anlatısı manus.im adresindeki resmi Manus 2.0 tanıtımıyla birebir örtüşüyor ve maliyet iddiası tokenpost.com adresindeki Cascade haberinde de aynı yüzdeyle tek test kaydı olarak yer alıyor.
Studio: kurgu masası ve oyun atölyesi
Masaüstü uygulaması Manus Studio, insanla yapay zekanın aynı dosyalar üzerinde buluştuğu bir ortak çalışma alanı; belgeler, tablolar, PDF dosyaları, sunumlar, web siteleri, yazılımlar, videolar ve oyunlar aynı çatı altında ve her proje yalnızca ihtiyaç duyduğu araçları yüklediği için yapı hızlı ve verimli kalıyor.
Video tarafındaki ilk yenilik, küçük bir değişiklikte filmin tamamını baştan üretme derdini bitiren kurgu ortamı: Manus işi video, görsel, metin, altyazı, animasyon ve sesten oluşan ayrı öğeli bir şerit olarak veriyor; yarın yayınlanacak kısa tanıtımda daha sıcak bir şarkı ve kendi ürün çekimin bununla ekleniyor, animasyon taşınıyor, çıktı alınıyor ya da dosya geri verilip düzeltme Manus'a bırakılıyor. Format listesi 30-60 saniyelik ürün reklamı, yapay içerik, kullanıcı içeriği, hareketli veri grafiği, ders, vlog ve animasyonu kapsıyor ve kurgu bilgisi gerekmiyor.
Alchemy kipi bir adım ileri gidiyor; fikirle başlanıyor, Manus yaratıcı yönetmen koltuğuna oturuyor, video üretimiyle kod üretimini aynı potada eritiyor ve fikir, görsel kontrol, hareket ile ritimde sıçrama vadediyor. Xiao Hong'un iddiası iddialı: Q uygulamasının tanıtım filmi bir video modeliyle değil, stüdyonun içinde kod olarak yazılıp filme dönüştürülerek hazırlandı.
Oyun kanadı yapay makyajlı iyi bir kopya değil, hayal edilen oyunun kendisini hedefliyor; görsel, video ve kod modelleri birlikte çalışıyor, ultra-max kipinde görüntünün etkileyici, akışın pürüzsüz ve hissin gerçek olması bekleniyor. Oynanabilir şablon sayesinde fikir ilk oturumda deneniyor, kurgu panelinde oyun çalışırken izleniyor, varlıklar yönetiliyor, kod ile hareket, grafik ve sahneler elle değiştiriliyor; bir köylünün saçını kahverengiden gümüşe çevirmek gerçekten o saçı değiştirmek kadar yalın. Yayınlama site olarak yapılıyor, herkes bağlantıyla oynuyor ve bu tür projeleri genelde öldüren çok oyunculu düğümü bir bulut bilgisayar kurup satın alma adımına iniyor; çünkü sunucu dizüstü kapanınca da ayakta kalmalı. Yarış, rekabetçi ve üç boyutlu oyunlar destekleniyor, arkadaşların oyunda keşfettikleri sonraki sürümü besliyor. Tuhaf bir not da var: yardım merkezi sürekli açık bir Ubuntu sanal makinesinden söz ederken Xiao Hong Linux, Mac ve Windows kiralamaktan bahsediyor; ya özellik yolda ya belgeler geride.
Tetiklenen otomasyon ve Q uygulaması
Otomasyon tarafı planlı görevlerin ötesine geçiyor; yeni bir e-posta, reklam performansındaki değişim, takvim olayı, Slack mesajı ya da bağlı servisteki bir Notion güncellemesi, neyin izleneceğini ve ne yapılacağını söyleyen tek yönergeyle iş akışını ateşliyor. Uzaktan bilgisayar kullanımı da aynı mantıkla çalışıyor: taksideyken ev bilgisayarındaki çalıştır klasöründeki son güncellemeyi bulup göndermesini ya da dosyayı PDF'e çevirirken masaüstünü telefondan izlemeyi istemek yetiyor. Bağlı ve izinli oturumda sistem kendi görünür çalışma alanında, yalnızca onaylanan dosya, tarayıcı ve uygulamalarla çalışıyor; uygulama sen işindeyken test ediliyor ya da sen yokken iş sürüyor, denetim hep kullanıcıda kalıyor. Xiao Hong'un sevdiği ayrıntı ise bulut işlemin yerel imleçle yarışmaması ve yakında tek bir kişinin merakı için dev bir küme yi matematik ve bilim deneylerine koşması.
İş modeli de bununla değişiyor: Manus artık görev değil işlem, yazılım ortamı ve sürekli çalışırlık satıyor; araç çağrılmıyor, yazılımın yönettiği bir bilgisayara sahip olunuyor. Q uygulaması bu fikrin kişisel hali; aynı altyapıda telefon ve masaüstünde çalışan bağımsız uygulama, verilen görev listesiyle işe koyuluyor. Her ajanın kendi e-postası, telefonu, cüzdanı ve bilgisayarı var; mesaj gönderiyor, belirlenen bütçede ödeme yapıyor, kendi makinesinde işi bitiriyor, aramaları yanıtlayıp özet bırakıyor. Birden fazla ajan grup sohbetinde iş bölüyor: biri New York lansman mekanlarını araştırıyor, biri listeyi daraltıyor, biri sunumu yazıyor, son söz kullanıcıda. Restoranda QR okutulunca sipariş veriliyor ya da sıra tutuluyor. Uygulama davetli erken erişimde, web, masaüstü ve mobilde açık, iOS mağaza onayının ardından geliyor; MEETCUE kodu sınırlı sayıda ilk gelene ücretsiz ve erişen herkese paylaşmalık ek kod veriliyor. Bu kimlik ve şirket anlatısı thenextweb.com adresindeki Manus 2.0 haberinde bağımsız biçimde doğrulanıyor ve aynı haber Singapur merkez ile Pekin'in Meta'nın 2 milyar dolarlık Manus anlaşmasını iptal ettirmesi bağlamını da veriyor.
Rakipler: Muse ve Instinct
Zamanlama tesadüf değil, rekabet kızışıyor: Meta 8 Eylül'de kendi bulut sanal makinesinde çalışan Muse uygulamasını çıkardı; uygulama ya da WhatsApp üzerinden e-posta, rezervasyon ve ödemeleri üstleniyor, Kuzey Amerika'da tuttuğu ve hisseleri yukarı taşıdığı anlatılıyor ve bu lansman çerçevesi reuters.com adresindeki Eylül haberiyle uyumlu. Instinct ise yeni arayüzleri tamamen atlıyor; bir mesaj ya da aramayla e-postaya, mesajlara, ekrana, sese ve konuma bağlanıyor. Ağustos sonunda yaklaşık 250 milyon dolarlık tur ve 2,5 milyar dolar değerleme konuşulurken eylülde açıklanan tur 10 milyar doların üzerine taşıdı; bu değerleme sıçraması techcrunch.com adresindeki Eylül turu haberiyle net biçimde doğrulanıyor. Çin tarafında Xiao Hong, yurt dışındaki açık ekosistemin seçkin deneyimi kolaylaştırdığını, yerel sürüm için çalıştıklarını ve ortaklık aradıklarını söylüyor; yolculuğun dipnot değil tam bir bölüm olabileceği sözü ve işe alım duyurusuyla kapatıyor.
Tencent'in oyun arkadaşı: Goose Dimension
Çin cephesinde Tencent gizli bir iç test yürütüyor; Doujia sitesinin özel bakış attığı yapay zeka oyun arkadaşı Goose Dimension, şirketin Çince lakabı olan kaz imgesini taşıyor. Ürün insansı dijital karakterler etrafında dönüyor: sesli sohbet, gerçek zamanlı ekran tanıma ve oyun içi eşlik bir arada; erkek ve kadın karakterler arasından kişiliğe göre seçim yapılıyor, kadın karakterler arasında Gaius, Shen, Lubai ve Xiaxia sayılıyor ve testte seçilen Xiaxia kendini geveze, içine kapanık değil, bronz seviye uzman olarak tanıtıyor. Arayüzde görseli duvar kağıdı yapan anlar bölümü, karakteri hareketli ya da sabit çizim olarak masaya koyan evcil hayvan kipi ve yetenekler menüsü var; altta metin kutusu, turuncu telefon düğmesi, mikrofon, üstte iki kaynak sayacı ve karakter seçimine dönüş düğmesi duruyor. Sohbet edilebiliyor ya da sol alttaki oyun arkadaşı modülü popüler çevrimiçi oyunlarla açılıp maç sırasında gerçek zamanlı sesli yanıt alınıyor. Testte her şey ücretsiz ama enerji penceresi planı ele veriyor: metin sohbeti tur başına, eşlik ve sesli arama dakika başına, görsel üretim adet başına enerji yiyor ve enerji yıldız parayla, takas başına en az 10 adetle alınıyor; bakiyeler şimdilik çalışmıyor ama lansman modelinin bu olması muhtemel. Strateji mantıklı çünkü sosyal oyun Tencent'in çekirdeği ve ücretli insan eşlikçi piyasası darmadağın: güvenilmez dış platformlar, yüksek işçilik maliyeti, yönetmesi zor kadro, doğaçlama diyalog ve tutarsız fiyat; üstelik çok oyuncu koçluk değil, gece yarısı çevrimiçi arkadaşı yokken muhabbet edecek birini istiyor ve karakterlerin orta seviye esprisi de bunu söylüyor: eşlik, hizmet değil, kullandıkça öde abonelikten uygun. Belirleyici olacak başlıklar ise ekran tanımanın kararlılığı, sohbetin eğlencesi ve uzun oturumlarda tekrar düşmesi; bu kapalı test bilgisi technode.com adresindeki Eylül haberinde resmi anket referansıyla yer alıyor ve insideai.news adresindeki analizde lansman tarihi ile fiyatın belirsizliği ve gecikme çıtası açıkça vurgulanıyor.
Sonnet 5.5: hız ve fiyat
Anthropic 28 Eylül'de orta seviye Sonnet 5.5 modelini çıkardı; günlük kodlama ve ofis belgelerinde yardımcı olarak konumlanıyor. Sonnet 5 yalnızca 3 ay önce daha ucuz ajan çalıştırma teziyle gelmişti, bu kez vurgu hızda: yüzde 30 üzerinde hız, çok daha az jeton ve görev başına yüzde 30 varan düşük maliyet; giriş jetonu milyonda 2, çıkış jetonu milyonda 10 dolar. Terminal Bench 4.0 ile ajan kod testinde yüzde 70,6 alırken Sonnet 5 yüzde 10,3 kalıyor, amiral gemisi Opus 5.5 en yüksek eforda yüzde 66,4 görüyor ve jeton fiyatı iki katı; TechCrunch'a göre Sonnet'in üstünlüğü maliyet sınırına çarpmadan çok ajan üretebilmesinde. 44 meslekli GDP Eval AA testinde 1844'e 1846 ve 1449 skorları çıkıyor ama Anthropic, sürekli akıl yürütme isteyen açık uçlu işlerde Opus'un açık ara güçlü olduğunu söylüyor; Sonnet toplamda daha dar ama daha esnek. Bu fiyat ve hız çerçevesi anthropic.com adresindeki resmi duyurudaki rakamlarla aynı ve skor tablosu decrypt.co adresindeki lansman haberindeki bağımsız ölçümlerle de destekleniyor; aynı haberde Artificial Analysis'in kendi testinde 63,6'ya 59,6 üstünlüğüyle GPT-6 Astra'nın 59,1 skoru ve modelin test edilenler arasında görev başına en çok jeton yakan model olduğu uyarısı da var.
Güvenlik tarafı Sonnet için yeni bir sayfa: siber yetenek Opus 5 ayarına çıktığı için Fable ve Opus sınıfı siber güvenceleri taşıyan ilk Sonnet oluyor, yüksek riskli siber istekler sıkı yönlendirmeye giriyor, biyolojik güvenceler değişmiyor. Akıl yürütme sızdırmayı engelleyen sınıflandırıcılı ilk Sonnet ve kayıtlı düşünce sistemi akıl yürütmeyi üreten hesaba bağlıyor; abartı sayılmamalı çünkü ağustosta araştırmacılar 6.708 herkese açık ajan izinden 315.320 düşünce bloğunu çözüp 62 API anahtarı, 33 parola ve 7 özel anahtar kurtarmıştı. Avrupa da yakından izliyor: Yapay Zeka Yasası'nın 55. maddesi sistemik riskli genel amaçlı model sağlayıcılarına modeli ve fiziksel altyapıyı korumayı, hasım testlerini ve ciddi olayları gecikmeden bildirmeyi şart koşuyor; yükümlülükler Ağustos 2025'ten beri yürürlükte, Komisyon bu ağustosta para cezası yetkisi aldı ve bu çerçeve ai-act-law.eu adresindeki 55. madde kaydındaki başlıklarla örtüşüyor. Ancak Next Web'in yakaladığı iki pürüz var: Anthropic yeni bir yetenek sınırı aşılmadığını söyleyip uyum değerlendirmesini hafif tutarken aynı duyuru öncü sınıfı güvence gerektiren bir siber sıçramayı anlatıyor; fiyat tarafında da şirket 10 doların Sonnet 5 ile aynı olduğunu söylerken site, haziranda bu fiyatların 31 Ağustos'a kadar tanıtım fiyatı olduğunu ve sonra Sonnet 5'in 15 dolara çıkacağını yazmıştı, yani zam ya hiç gelmedi ya kıyas tanıtım fiyatıyla. Yeni Haiku haftalar içinde tarihsiz geliyor; haftanın turunda OpenAI'nin orta ve ekonomi sınıfı Sol ile Luna hatları ve Meta'nın akıllı gözlük özelliğini çalıştıracak modeli de sayılıyor.
| Konu | Özet |
|---|---|
| Manus 2.0 | Ajan başına kimlik: e-posta, telefon, cüzdan ve bilgisayar |
| Sonnet 5.5 | Yarı fiyatla zirve skoru ve yüzde 30 hız artışı |
| Goose Dimension | Ekranı izleyen, sesle eşlik eden kapalı test |
| Model | Giriş / çıkış | Bench skoru | Hız notu |
|---|---|---|---|
| Sonnet 5.5 | 1M'de 2 / 10 $ | %70,6 | %30+ hızlı |
| Opus 5.5 | 1M'de 4 / 20 $ | %66,4 | En yüksek efor |
| Sonnet 5 | 1M'de 2 / 10 $ | %10,3 | Önceki nesil |
Videodaki anahtar anlar
AI yorumu
"Bu haftanın üç haberi aynı cümlede buluşuyor: marifet artık daha büyük modelde değil, daha ucuz ve özerk çalışanda. Fiyatı yarıya inen bir orta modelin zirveyi alması, ezberleri bozmak için yeterli."
AI değerlendirmesi
Tek teste dayalı yüzdeler, kodla yazıldığı söylenen tanıtım filmi ve yarı fiyatına zirve iddiası; üçü de şirket sunumundan geliyor ve bağımsız doğrulaması turda yok. Fiyat kıyası da aynı dosyadan besleniyor: 10 dolar Sonnet 5 ile aynı görünürken tanıtım fiyatı detayı kıyası bulanıklaştırıyor. Okur, turdaki her parlak sayıyı bir iddia olarak cebine koymalı.
Eksik listesi uzun: Goose tarafında tanıma kararlılığı, sohbet eğlencesi ve uzun oturum tekrarı yanıtsız; Manus tarafında Ubuntu sanal makinesi ile Linux, Mac ve Windows kiralama söylemi çelişiyor; enerji tarifesi, bakiyeler kapalıyken yalnızca tahmin. Sonnet tarafında ise bağımsız testin jeton oburluğu uyarısı, ucuz etiketin görev faturasını tek başına kapatmadığını söylüyor.
Anlatıcının konumu da not edilmeli: tur formatı şirket duyurularını art arda aktarıyor, sponsorlu bölüm elendi ama seçki yine de lansman haftasının penceresinden bakıyor. Meta hisselerinin Muse ile yükselmesi gibi piyasa yorumları tek cümlelik korelasyon; nedensellik kurulmadı. Bu yüzden yazıdaki her piyasa cümlesi bağlam, kanıt değil.
Pratik çıkarım net: orta modelle çok ajan koşmak, görev başına maliyeti toplantı odası hesabıyla değil ölçerek düşürüyor; erken erişim tarafında MEETCUE kodu ilk gelenin. Okura düşen, tek testlik yüzdeleri değil kendi iş yükündeki faturayı baz almak ve davetli ürünlerde verisini kime emanet ettiğini sormak.
Kaynaklar
11 bağlantı; 2 tanesi 8 başka haberde de kullanılıyor. Aynı bağlantıyı paylaşan haberler birbirini doğrulamış sayılmaz; kaynağın kökeni bağlantı sayısından çıkarılmaz.
- @youtube.com YouTube — AI news roundup
- @manus.im Manus — Introducing Manus 2.0
- @tokenpost.com TokenPost — Manus 2.0 Cascade report
- @thenextweb.com The Next Web — Manus 2.0 and Cue
- @reuters.com Reuters — Meta Muse launch
Aynı kaynağı kullanan: Meta Muse ile 26 gerçek kullanım: tek asistandan dijital hayat yönetimi · Fiyat Satırındaki Tek Harf: OpenAI'ın 'Her Zaman Açık' Asistan İddiası · Nasdaq Coşkusu Nereye Kadar? Dar Ralli, Meta Muse ve Ucuz Kalan Çipler · Zuckerberg'in Muse Hamlesi: Herkese 7/24 Çalışan Kişisel Süper Zeka · Muse Lansmanı Meta Hisselerini Yüzde 6 Sıçrattı: 763 Dolarlık Adil Değer Hesabı ve Alım Tezi · GPT-6 Astra'dan Meyve Sineği Beynine: Bir Haftada Yapay Zekânın Boy Gösterisi · Meta Muse: Herkes İçin Kişisel Yapay Zekâ Ajanı Gerçekten Ne Yapıyor
- @techcrunch.com TechCrunch — Instinct funding
- @technode.com TechNode — Tencent game companion test
- @insideai.news Inside AI — Goose Dimension analysis
- @anthropic.com Anthropic — Sonnet 5.5 announcement
Aynı kaynağı kullanan: Dots, Gemini 4 Argon ve Sonnet 5.5: Yapay Zekânın DevDay Haftasında Neler Oldu
- @decrypt.co Decrypt — Sonnet 5.5 benchmarks
- @ai-act-law.eu AI Act Law — Article 55 obligations
yapay zeka · ajanlar · manus · anthropic · tencent · otomasyon