MiniMax H3 ile ComfyUI: Ücretsiz sürümde Kling AI, Seedance ve diğer video oluşturuculardan daha mı iyi?

AI video oluşturucuları, ChatGPT gibi tipik LLM'lere kıyasla ücretsiz olarak kullanmak çok daha zordur; çoğu sağlayıcı ücretsiz krediler konusunda cimri davranır. Onlardan tam olarak istediğiniz şeyi yaratmalarını sağlamak — aynı zamanda iyi ve tutarlı bir görünümü korumak — daha da zordur. Bu yüzden alternatifi denemeye karar verdim: MiniMax H3 gibi yerel bir modeli barındırmak.
Oğlum, yapay zekayı kullanarak ışın kılıçlarıyla ilgili kendi “tuğla yapımı” videosunu oluşturmak istiyor. Şu anda bu konuya hayran. Ancak deneyleri için pahalı bir video yapay zeka hizmeti aboneliğine hemen çok para harcamak istemediğimden, başlangıçta Kling AI ve benzeri hizmetleri ücretsiz olarak denedi.
Çoğu yapay zeka video oluşturucu, hesap açmanızı sağlamak için başlangıçta ücretsiz bir kotayla sizi cezbeder. Ancak işin püf noktası kısa sürede ortaya çıkar: Günde bir veya iki adet üç saniyelik videodan fazlasını sürekli olarak oluşturmak istiyorsanız, hızla pahalı bir aboneliğe yönlendirilirsiniz.
Ancak görsel açıdan bile, o ana kadar oluşturulan videolar pek tatmin edici değildi. Ortamları, nesneleri ve karakterleri tutarlı tutmak da genellikle zordur. Hayal kırıklığına uğrayan çocuk, beni yerel bir çözümü denemeye itti.
Yerel modeller ve çözümler doğal olarak güçlü donanım gerektirir. Testi, RTX 5090 ve 24 GB VRAM’e sahip bir Razer Blade 16 (2025) üzerinde gerçekleştiriyoruz. Genel olarak, video oluşturma ancak 8 GB VRAM’e sahip olduğunuzda makul ölçüde ilgi çekici hale gelir ve bu durumda daha fazlası gerçekten de daha fazlası anlamına gelir.
Model için birçok arayüz mevcuttur — biz MiniMax H3'ü tercih ettik. Bu model, örneğin Ollama'nın yanı sıra Pinokio veya Stability Matrix'te de çalıştırılabilir. Stability Matrix, video üretimi ile sınırlı olmayan, AI iş akışları için bir grafik arayüz olan ComfyUI'yi de içerir. Ancak bu kombinasyonda sorunlar yaşadığım için, Windows ve diğer platformlar için uygulama olarak indirilebilen bağımsız bir ComfyUI (ComfyUI.org) sürümünü tercih ettim.

ComfyUI, yeni başlayanlar için alışmak biraz zaman alabilir, ancak video oluşturma konusunda çok geniş bir yelpazede olanaklar sunar. İş akışlarını tek tek düğümlerden oluşturursunuz; bu, temelde birden fazla araç/düğümden oluşan modüler bir araç setidir. Her düğümün bir girişi ve bir çıkışı vardır ve diğer düğümlere bağlanabilir.

Top 10
» Top 10 Multimedia Notebook listesi
» Top 10 oyun notebooku
» Top 10 bütçeye uygun Ofis/İş Notebook Listesi
» Top 10 Premium Ofis/İş notebookları
» Top 10 Çalışma istasyonu laptopları
» Top 10 Subnotebook listesi
» Top 10 Ultrabooklar
» En iyi 10 dönüştürülebilir modeli
» Seçimi en iyi 10 tablet
» Notebookcheck Top 10 Windows Tabletleri
» Top 10 Subnotebook listesi
» NotebookCheck tarafından incelenen en iyi Notebook ekranları
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» NotebookCheck tarafından seçilen 300 Euro altındaki en iyi 10 Notebook
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» Notebookcheck'in Top 10 akıllı telefon listesi
» Notebookcheck'in Top 10 hafif oyun notebookları
Tüm araçlar ayrı düğümlere ayrılmıştır. Örneğin, metin komutu için bir düğüm, video oluşturma öncesinde referans veya ara adım olarak kullanılabilecek birden fazla görüntü düğümü ve diğer araçlar bulunmaktadır. Teorik olarak, her düğüme ayrı bir AI modeli yükleyebilirsiniz — metin komutu için bir LLM, resim düğümleri için bir resim oluşturma modeli vb. AI modelleri doğal olarak çok fazla depolama alanı kaplar. Sonunda, tüm düğümler çıktıyı üreten video oluşturma düğümüne beslenir.
İlk başta metinden videoya ön ayarlarla denemeler yaptık, ancak kısa sürede referanstan videoya yöntemine yöneldik.

Bunu özellikle kullanışlı kılan şey, tutarlı ortamlar, nesneler ve karakterler oluşturmaya da olanak sağlamasıdır. Örneğin ilk videomuzda, kare içinde uçan tuğladan yapılmış bir savaş gemisi yarattık. 480p çözünürlükte oluşturulması yaklaşık 5,5 dakika sürdü; ancak uygun donanımla daha yüksek çözünürlükler de mümkündür. Bununla birlikte, gelecek sahnelerden birinde, tam olarak aynı savaş gemisini tekrar kullanmak istedik. Bu nedenle uzay gemisinin ön ve arka görünümlerinin ekran görüntülerini aldık, görüntüleri içe aktardık, bunları Ship_front ve Ship_rear adlı referanslar olarak ana düğüme bağladık ve yapay zekaya başka bir sahnede tam olarak bu gemiyi kullanması talimatını verdik. Aksi takdirde, yapay zeka yeni bir görünüm oluşturacaktı.
Sisteme biraz alıştıktan ve Profesör YouTube'dan biraz yardım aldıktan sonra, video sahnelerimiz için ilk iş akışımızı hızla oluşturduk ve ikimizin de çok memnun kaldığı videolar ürettik. Bir LLM — bu durumda ChatGPT — metin komutlarını MiniMax H3'e özel olarak uyarlamamıza yardımcı oldu ve bunları kesin ve ayrıntılı hale getirdi.
İş akışım: ChatGPT’de aklımdaki görünümü tarif ettim, görünümün belirli marka isimlerinden ilham alabilmesine rağmen bu isimlerin görünmemesi gerektiğini belirttim, sinematik bir havası olması gerektiğini açıkladım ve hangi referansların (örneğin Ship_front) dahil edilmesi gerektiğini belirttim. Ancak bundan sonra sahneyi tarif ettim. ChatGPT tarafından uyarlanan komut dizisini ComfyUI’deki metin düğümüne yapıştırdım, gerekirse referans görseller ekledim ve işim bitti.

Ayrıca ChatGPT'den, istediğiniz görünüme ve diğer parametrelere dayalı olarak evrensel bir komut oluşturmasını isteyebilirsiniz; bunu daha sonra kullanmak üzere kaydedebilirsiniz. Bu komutu bir LLM'ye tekrar girdiğinizde, gerekli tüm bilgilere sahip olur ve bir sonraki sahneyi hemen tanımlayabilirsiniz.
Her halükarda, oğlum ve ben sonuçlardan Kling AI, Seedance ve benzeri hizmetlerin ücretsiz sürümlerinden çok daha memnun kaldık. Mevcut birçok seçenek deneme yapmaya da teşvik ediyor ve nihayet can sıkıcı kredi sınırlamalarından, abonelik uyarılarından, reklamlardan ve veri güvenliği endişelerinden kurtulmuş oluyorsunuz. Ancak çözünürlük hâlâ bir sorun teşkil ediyor. Full HD veya daha yüksek çözünürlük bir seçenek olarak bile mevcut değil; muhtemelen donanım gereksinimleri çok yüksek olacağı için. Gelecekteki modeller bu açıdan muhtemelen daha verimli hale gelecektir. Şimdilik, iş akışınızı yükselticilerle de genişletebilirsiniz.
Gerekli donanıma sahip ve film üretimine ilgi duyan herkes, ComfyUI'ye ve iyi bir yerel AI modeline bir göz atmalıdır. Özellikle ComfyUI, gerçekten ihtiyacınız varsa, inanılmaz derecede karmaşık ve katmanlı iş akışlarına olanak tanır. Ancak başlangıç için gerekli temel unsurlar zaten mevcut ve hızlı bir şekilde öğrenilebilir.









