ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-26
OpenAI যখন 2026 সালের 24 সেপ্টেম্বর Sora/Videos API পুরোপুরি বন্ধ করে দিচ্ছে, তখন Alibaba-র ওপেন-ওয়েট মডেল Wan 3.0 ও Qwen-Image 2.1 দ্রুত ইকোসিস্টেমে ছড়িয়ে পড়ছে। ক্লোজড মডেলের পুনর্গঠন এবং ওপেন মডেলের উত্থান একসঙ্গেই চলছে।
ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-26
সত্যিই পাগলাটে একটা সপ্তাহ ছিল 😤🔥 সবচেয়ে বড় খবর হলো OpenAI সত্যি সত্যিই Sora গুটিয়ে ফেলেছে। অ্যাপ ও Videos API দুটোই 2026 সালের 24 সেপ্টেম্বর পুরোপুরি বন্ধ—কোনো উত্তরসূরি ঘোষণাও নেই, বেশ পরিষ্কার সিদ্ধান্ত(?)। অন্যদিকে ওপেন-সোর্স শিবিরে Alibaba-র Wan 3.0 আর Qwen-Image 2.1 অবিশ্বাস্য গতিতে দৃশ্যপট বদলে দিচ্ছে। ক্লোজড পক্ষ যখন দাম কমানো আর সরে যাওয়ার মাধ্যমে প্রতিরক্ষামূলক অবস্থানে, ওপেন পক্ষ তখন আক্রমণাত্মকভাবে এগোচ্ছে 📈 মোটের ওপর সপ্তাহটি ছিল: “ক্লোজডে বাছাই ও পুনর্গঠন, ওপেনে ঝড়ের গতির রিলিজ রাশ।”
বিভিন্ন প্ল্যাটফর্ম জুড়ে
- Qwen-Image 2.1 (Alibaba-র তৈরি, ওপেন) একসঙ্গে একাধিক প্ল্যাটফর্মে ছড়িয়েছে: Reddit (r/StableDiffusion-এ ইমেজ এডিটিংয়ের মানক পছন্দ হিসেবে সুপারিশ), Bluesky (7B প্যারামিটার ও 60.2 স্কোরের নির্দিষ্ট বেঞ্চমার্ক, প্রকাশের পরপরই ComfyUI পোর্ট), Lemmy (dbzer0 কমিউনিটিতে সেই একই ComfyUI অফিসিয়াল সাপোর্টের খবর)—তিনটি প্ল্যাটফর্মই প্রায় একই সময়ে (9/22–9/25) একই গতিবিধি দেখেছে। এটি এখনকার সবচেয়ে আলোচিত ওপেন মডেল বলেই বোঝা যায় 🔥
- ভিডিওর ওপেন স্ট্যান্ডার্ড = MiniMax H3: Reddit-এ (r/StableDiffusion-এ “ভিডিওর জন্য Minimax H3” নিয়ে ঐকমত্য), Lemmy-তে (ComfyUI টুল ও প্রম্পট বিল্ডারের এক সপ্তাহে 5টির বেশি পোস্ট), Bluesky-তে (স্বতন্ত্র নির্মাতারা ComfyUI দিয়ে পরীক্ষা-নিরীক্ষা করছেন)—তিন জায়গাতেই একই চিত্র। ওপেন ভিডিও জেনারেশনের প্রধান মডেল বদল রিয়েল টাইমে ঘটছে 👀
- Krea 2, Z-Image Turbo-র কাছ থেকে সিংহাসন নিয়েছে: Reddit-এ “Z-Image Turbo এখন পুরোনো” মন্তব্যের আধিক্য এবং Lemmy-তে Krea2 দ্রুততর করার LoRA-র দুটি পোস্ট একই ইঙ্গিত দেয়। ওপেন ইমেজ মডেলের পালাবদল সত্যিই দ্রুত ⚡
- Sora-র পূর্ণ বন্ধ হওয়া নিয়ে প্রায় শুধু Bluesky-তেই আলোচনা: Reddit, X, YouTube, Lemmy ও Pinterest-এ এই বড় খবর প্রায় পুরোপুরি উপেক্ষিত হয়েছে। Lemmy-তে কেবল মার্চের পুরোনো ঘোষণার পুনঃপ্রকাশ আছে; 24 সেপ্টেম্বরের প্রকৃত বন্ধের খবর একটিও নেই। মাত্র একটি প্ল্যাটফর্মে যাচাই হওয়া হলেও এর প্রভাব বড়, তাই সতর্ক থাকা দরকার ⚠️
- DeepSeek × Huawei Ascend-র একই অবকাঠামোগত গল্প দুই দিক থেকে দেখা গেছে: Reddit বলছে DeepSeek কম্পিউট রিসোর্সের ঘাটতিতে Ascend 960DT-এর 160,000 ইউনিট অর্ডার করেছে। Bluesky বলছে Huawei Ascend-এর Modelers.cn-এ SDXL/FLUX LoRA ব্যাপকভাবে তৈরি হচ্ছে, যদিও মান অসমান। চীনা ক্লোজড ও ওপেন—দুই দিকের AI-ই Ascend চিপের উপর নির্ভরশীল হয়ে উঠছে; একই ভূমিকম্পের দুই দৃষ্টিভঙ্গি 💡
- “AI-তৈরি জিনিসকে বাস্তব বলে ব্যবহার” করার বিরুদ্ধে প্রতিক্রিয়া বিভিন্ন জায়গায় বাস্তব ঘটনার রূপ নিয়েছে: Reddit-এ মাইক্রোস্কোপ প্রতিযোগিতায় AI-সম্পাদনা ধরা পড়া, রিয়েল-এস্টেটের AI ভুয়া ছবি, AI ছবি ব্যবহারের কারণে CEO-র চাকরি যাওয়া; Pinterest-এ NBC News-ধাঁচের AI অ্যাঙ্কর ভিডিওতে “AI GENERATED” ব্যাজ এবং সত্য-মিথ্যার সীমা নিয়ে উদ্বেগ; Lemmy-র সাধারণ কমিউনিটিতে AI নির্ভরতা ও ডেটাসেন্টারের বিদ্যুৎ ব্যবহারের সমালোচনা। বিমূর্ত বিতর্ক নয়, বাস্তব ক্ষতি ও বিতর্কের উদাহরণ জমছে 😬
প্ল্যাটফর্মভিত্তিক
Reddit — 9টি সাবরেডিটের 12টি থ্রেড বিশ্লেষণ করা হয়েছে। বিশেষায়িত সাবগুলোতে (r/StableDiffusion) Krea 2, Qwen-Image 2.1, Minimax H3 ও SenseNova-U1.5 দ্রুত মানক পছন্দ হয়ে উঠেছে। অন্যদিকে সাধারণ সাবগুলোতে AI-তৈরি কনটেন্টের বিরাগ “চাকরিচ্যুতি” ও “রিপোর্ট” পর্যায়ের বাস্তব ক্ষতির ঘটনায় পরিণত হওয়ার আলোচনা বেশি। তবে সংগ্রহ একটিমাত্র সার্চ টার্মে সীমিত ছিল এবং 20টির লক্ষ্য পূরণ হয়নি—থেমেছে 12টিতে।
X — সেশনের অবস্থান ক্রোয়েশিয়ায় স্থির থাকায় Explore ট্রেন্ডের সঙ্গে বিষয়টির প্রায় কোনো সম্পর্ক ছিল না—10টির 8টি শব্দই অপ্রাসঙ্গিক। শেষ পর্যন্ত মাত্র 7–8টি প্রাসঙ্গিক পোস্ট পাওয়া যায়, তাই লক্ষ্য অপূর্ণ। তবে পাওয়া পোস্টগুলো আকর্ষণীয়: Claude Opus 5.5-কে কেন্দ্র করে GPT Images, Grok ও Gemini TTS মিলিয়ে “মাল্টি-টুল পাইপলাইন” ভিডিও নির্মাণ, এবং Claude Code-কে উপকরণ সংগ্রহ থেকে সম্পাদনা ও সঙ্গীত নির্বাচন পর্যন্ত স্বয়ংক্রিয়ভাবে করানো “ভিডিও প্রোডাকশন এজেন্ট” ধরনের ব্যবহার বারবার দেখা গেছে। ওপেন-সোর্স বিষয়ে কোনো উল্লেখ ছিল না।
YouTube — Sora 2 বনাম Veo 3.1, Seedance 2.5 বনাম Kling 3.0 বনাম Minimax H3 বনাম Google Omni—এ ধরনের বহু-মডেলের পাশাপাশি তুলনা ক্লোজড পক্ষের প্রধান ফরম্যাট। ওপেন দিকে LTX-2.5, Lightricks-এর 22B প্যারামিটারের ওপেন-ওয়েট ভিডিও+অডিও মডেল, ঘোষণার মাত্র এক সপ্তাহের মধ্যে ComfyUI পরীক্ষার ভিডিও পেয়েছে। Z-Image Turbo-কে Nano Banana Pro-র বিনামূল্যের বিকল্প হিসেবে একাধিক চ্যানেল তুলে ধরেছে। তবে JavaScript রেন্ডারিংয়ের কারণে ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।
Bluesky — 12টি কুয়েরি ও 200-এর বেশি পোস্ট বিশ্লেষণ করে এইবার সবচেয়ে বেশি ফল মিলেছে এখানে। ক্লোজড দিকের প্রধান খবর: Sora-র পূর্ণ বন্ধ হওয়া—Disney-র সঙ্গে 1 বিলিয়ন ডলারের অংশীদারত্ব ভেঙে যাওয়াসহ, Google Veo-র চার গুণ দাম কমানো, এবং Nano Banana 2.5 Flash-এর লিকের চিহ্ন। ওপেন দিকে Wan 3.0—Alibaba-র 10 বিলিয়ন ডলারের শেয়ার বিক্রির পরপর লঞ্চ, মানব মূল্যায়নে ক্লোজড প্রতিদ্বন্দ্বীদের পেছনে ফেলা—Qwen-Image 2.1-এর বেঞ্চমার্ক ও তাৎক্ষণিক ComfyUI ইন্টিগ্রেশন, এবং stable-diffusion.cpp (★7,148)-এর GitHub Trending-এ আসা উল্লেখযোগ্য ছিল।
Lemmy — কিওয়ার্ড সার্চে প্রচুর নয়েজ থাকায় দ্রুত বিশেষায়িত কমিউনিটি সরাসরি ব্রাউজ করার পদ্ধতিতে যাওয়া হয়। ফল: পুরোপুরি ওপেন-সোর্সকেন্দ্রিক—Qwen-Image 2.1, Krea2 LoRA, MiniMax H3 টুল, LTX-2.5 LoRA, এবং বিকেন্দ্রীকৃত বিনামূল্যের জেনারেশন অবকাঠামো AI Horde। বিপরীতে Sora বন্ধ, Veo মূল্যছাড়, Grok Imagine-এর মতো ক্লোজড খবর টার্গেটেড সার্চেও সেপ্টেম্বরে একটিও মেলেনি; এই “নিস্তব্ধতা” নিজেই একটি পর্যবেক্ষণ। প্রাসঙ্গিক পোস্ট প্রায় 9টি, 20টির লক্ষ্য পূরণ হয়নি।
Pinterest — 50টি আইটেম সংগ্রহ, তার মধ্যে 20টি বিস্তারিত পাঠ। Runway, Pika, Kling, Luma, Hailuo, Veo ও Sora-কে একত্রে দেখানো “best AI video tool” ধরনের তালিকাই পুরোপুরি প্রভাবশালী। AI সংবাদ-ধাঁচের থাম্বনেইল—চমকে ওঠা দাড়িওয়ালা পুরুষ ও লোগো গ্রিড—এবং AI অ্যাঙ্কর নিয়ে বিশ্বাসযোগ্যতার উদ্বেগও চোখে পড়ে। বিপরীতে Stable Diffusion, Flux, ComfyUI, Wan, Hunyuan-এর মতো ওপেন-সোর্স মডেলের নাম নমুনার একটিতেও আসেনি। Pinterest স্পষ্টতই “আয় করা যায় এমন, ভোক্তামুখী ক্লোজড টুল”-কেন্দ্রিক।
নজরে রাখুন
- Sora-র পূর্ণ বন্ধের প্রভাব (Bluesky) — https://bsky.app/profile/knowmouth.bsky.social/post/3mwckivdpkk2y → Disney-র সঙ্গে অংশীদারত্ব ভেঙে যাওয়াসহ, বড় ক্লোজড পরিষেবাও লাভজনক না হলে দ্রুত বন্ধ হয়ে যেতে পারে—এমন নজির।
- Wan 3.0 মানব মূল্যায়নে ক্লোজড মডেলকে ছাড়িয়ে গেছে (Bluesky) — https://bsky.app/profile/oludai.bsky.social/post/3mweo2rmjo424 → ওপেন-ওয়েট মডেল কি এখন গুণমানেও জিততে পারে—তার সম্ভাব্য মোড়বদল।
- Qwen-Image 2.1-এর একই দিনে ComfyUI ইন্টিগ্রেশন (Lemmy) — https://lemmy.dbzer0.com/post/75874773 → প্রকাশ থেকে ইকোসিস্টেমে অন্তর্ভুক্তির সময় ক্রমশ কমছে—তার প্রমাণ।
- Nano Banana 2.5 Flash-এর লিকের চিহ্ন (Bluesky) — https://bsky.app/profile/coreati.bsky.social/post/3mwbwh5p7mj2e → Google-এর পরবর্তী পদক্ষেপ হিসেবে ইমেজ জেনারেশনের মূল প্রতিযোগিতার ক্ষেত্র হতে পারে।
- DeepSeek-এর কম্পিউট সংকট ও Ascend চিপের বড় অর্ডার (Reddit) — https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ → চীনা ক্লোজড AI-র বৃদ্ধিজনিত সংকট এবং Huawei চিপের উপর নির্ভরতার ইঙ্গিত।
- Claude Code দিয়ে “ভিডিও প্রোডাকশন এজেন্ট” ব্যবহার (X) — https://x.com/bond_ai1/status/2103374441250259316 → শুধু জেনারেশনের চেয়ে সম্পাদনা ও অটোমেশনের স্বয়ংক্রিয়তা পরের প্রতিযোগিতার ক্ষেত্র হয়ে উঠতে পারে।
সুপারিশ
- Wan 3.0 ও Qwen-Image 2.1-এর গ্রহণের গতি নিয়মিত পর্যবেক্ষণ করুন; ওপেন বনাম ক্লোজডের গুণগত উলটপালট স্থায়ী হয় কি না নির্ধারণ করুন।
- Google Veo-র মূল্যছাড় এবং Nano Banana 2.5-এর অগ্রগতি অনুসরণ করুন; Sora প্রত্যাহারের পর মূল্য প্রতিযোগিতা কতদূর ত্বরান্বিত হয় দেখুন।
- Reddit-উৎসারিত “AI-তৈরি জিনিসকে বাস্তব হিসেবে ব্যবহার” সংক্রান্ত বিতর্ক ও ক্ষতির ঘটনা—মাইক্রোস্কোপ প্রতিযোগিতা, রিয়েল-এস্টেট, CEO চাকরিচ্যুতি—তালিকাবদ্ধ করে নিয়মকানুন ও মামলার দিকে গড়ায় কি না পর্যবেক্ষণ করুন।
- পরের X ও Reddit সংগ্রহে “Stable Diffusion”, “Flux”, “ComfyUI”, “Wan”, “Qwen”-এর মতো স্পষ্ট ওপেন-সোর্স সার্চ টার্ম যোগ করে এইবারের শূন্যতার ফাঁক পূরণ করুন।
- Pinterest-কে ওপেন-সোর্স প্রবণতার সূচক হিসেবে ব্যবহার না করে, ভোক্তামুখী ক্লোজড টুলের “এখন কী বিকোচ্ছে” বোঝার বিশেষ উৎস হিসেবে নিন।
- Bluesky-তে XRPC-তে সরাসরি (
api.bsky.app-এরapp.bsky.feed.searchPosts) অনুসন্ধান অন্য প্ল্যাটফর্মের তুলনায় অনেক বেশি ফল দিয়েছে; ভবিষ্যতের মানক সংগ্রহপদ্ধতিতে এটিকে অগ্রাধিকার দিন।
ডেটার গুণমান
Bluesky 12টি কুয়েরিতে 200-এর বেশি পোস্ট সংগ্রহ করে লক্ষ্যকে বড় ব্যবধানে ছাড়িয়েছে। বিপরীতে Reddit ও Lemmy প্রায় 20টি পোস্টের লক্ষ্যে পৌঁছাতে পারেনি—যথাক্রমে 12 ও প্রায় 9টি। Lemmy-র ক্ষেত্রে সার্চ API-র নয়েজ ও প্ল্যাটফর্মের ছোট আকার এর কারণ। X-এ Explore অঞ্চল ক্রোয়েশিয়ায় স্থির ছিল এবং 10টি সার্চ টার্মের 8টিই বিষয়বহির্ভূত; মাত্র 7–8টি প্রাসঙ্গিক পোস্ট ও শূন্য ওপেন-সোর্স উল্লেখ থাকায় এটিই সবচেয়ে নিম্নমানের ডেটা। YouTube-এ JavaScript রেন্ডারিংয়ের কারণে ভিউ, সাবস্ক্রাইবার ও প্রকাশের সময় পাওয়া যায়নি, তাই পরিমাণগত তুলনা সম্ভব নয়। Pinterest-এ Sora-র পূর্ণ বন্ধের মতো সেপ্টেম্বরের সর্বশেষ খবর ধরা পড়েনি; 50টির মধ্যে কেবল 20টি বিস্তারিত পাঠ করা হয়েছে এবং ওপেন-সোর্সের অনুপস্থিতি সার্চ-কুয়েরি পক্ষপাতও হতে পারে।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ
কোথায়
সংগৃহীত 12টি থ্রেড 9টি সাবরেডিট থেকে এসেছে:
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত থ্রেড |
|---|---|---|
| r/mildlyinfuriating | 12,595,406 জন | 1টি |
| r/WhitePeopleTwitter | 3,145,649 জন | 1টি |
| r/StableDiffusion | 1,025,554 জন | 1টি |
| r/labrats | 726,754 জন | 1টি |
| r/antiai | 339,499 জন | 1টি |
| r/generativeAI | 157,118 জন | 4টি |
| r/DeepSeek | 141,262 জন | 1টি |
| r/GenAI4all | 48,605 জন | 1টি |
| r/aivideomaking | 7,735 জন | 1টি |
বড় সাধারণ সাবগুলো (mildlyinfuriating, WhitePeopleTwitter) AI-তৈরি কনটেন্ট নিয়ে বিরাগ ও বিতর্ককেন্দ্রিক। বিশেষায়িত সাবগুলো (StableDiffusion, generativeAI, aivideomaking, DeepSeek, GenAI4all) টুল তুলনা ও প্রযুক্তিগত বিষয়ে কেন্দ্রীভূত। r/antiai নামের মতোই AI-বিরোধী অবস্থান থেকে পোস্ট করে।
মানুষ কী বলছে
- থ্রেড #1 (r/labrats, 1,101 পয়েন্ট, 131 মন্তব্য, 2026-09-23): https://www.reddit.com/r/labrats/comments/1wo0j5e/ — Nikon Small World in Motion মাইক্রোস্কোপ ইমেজ প্রতিযোগিতায় প্রথম হওয়া ভিডিওটিকে AI দিয়ে “উন্নত” করা হয়েছিল বলে ধরা পড়ে। পোস্টদাতা বলেন, “সিলিয়া হঠাৎ মিলিয়ে যায়, নীল গঠনগুলো—যা নিউক্লিয়াসের মতো—মুহূর্তে স্থান বদলায়; জীববৈজ্ঞানিকভাবে অসম্ভব।” শীর্ষ মন্তব্যকারী u/Barkinsons (629 পয়েন্ট) বলেন, “বৈজ্ঞানিক মাইক্রোস্কোপ ইমেজে AI টুলের কোনো জায়গা নেই।”
- থ্রেড #3 (r/mildlyinfuriating, 26,941 পয়েন্ট, 722 মন্তব্য, 2026-09-21): https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ — রিয়েল-এস্টেট ভিউয়িং ছবিতে AI-তৈরি “ইমেজ” ব্যবহারের সমস্যা। পোস্টদাতা বলেন রেডিয়েটর মুছে ফেলা হয়েছে, ফলে বাস্তবে সেই স্টেজিং পুনর্নির্মাণ করা যাবে না। u/BojackWorseman13 (1,141 পয়েন্ট) বলেন, “এজেন্টের সামাজিক মাধ্যমে অভিযোগ করা উচিত; এগুলো AI-তৈরি—এ কথা বড় করে লেখা উচিত।”
- থ্রেড #9 (r/antiai, 18,728 পয়েন্ট, 634 মন্তব্য, 2026-09-23): https://www.reddit.com/r/antiai/comments/1wnrfi6/ — Dreamworks তাদের নতুন চলচ্চিত্র “Forgotten Island”-এ “এই কনটেন্ট AI প্রশিক্ষণে ব্যবহার নিষিদ্ধ” ডিসক্লেইমার যোগ করেছে বলে খবর। তবে সর্বাধিক ভোট পাওয়া u/SlowlyDyingInAPit (2,586 পয়েন্ট) ঠান্ডা প্রতিক্রিয়ায় বলেন, “AI পক্ষ তবু উপেক্ষা করে ব্যবহার করবে; সবসময়ই তাই করেছে।” u/Arckanoid (145 পয়েন্ট) বিশ্লেষণ করেন, “বন্ধ করার চেয়ে মামলা করার ভিত্তি তৈরিই সম্ভবত উদ্দেশ্য।”
- থ্রেড #11 (r/WhitePeopleTwitter, 470 পয়েন্ট, 56 মন্তব্য, 2026-09-25): https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/ — “Lake America” সোয়েটারের AI-তৈরি ছবি ব্যবহারের কারণে এক CEO বরখাস্ত হওয়ার ঘটনা। u/samanime (236 পয়েন্ট) বলেন, “এ রকম বোকারা আরও ভুগলে এমন ঘটনা কমবে।” AI-তৈরি কনটেন্টের কর্পোরেট ব্যবহারে বাস্তব চাকরিচ্যুতির বিরল উদাহরণ।
- থ্রেড #5 (r/DeepSeek, 314 পয়েন্ট, 51 মন্তব্য, 2026-09-21): https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ — DeepSeek-এর DAU 120 মিলিয়ন থেকে 200 মিলিয়নে (+66.7%) উঠলেও কম্পিউট রিসোর্স বেড়েছে মাত্র +8.3%; এটি মান কমা ও পুনরায় জেনারেশনের সমস্যার কারণ বলে বিশ্লেষণ। একই পোস্টে Huawei থেকে DeepSeek-এর Ascend 960DT-এর 160,000 ইউনিট অর্ডারের তথ্যও আছে। u/Equivalent-Grass-527 (14 পয়েন্ট): “চাহিদা ও কম্পিউট রিসোর্সের অমিলই সাম্প্রতিক অবনতির সবচেয়ে যুক্তিসংগত ব্যাখ্যা।”
- থ্রেড #12 (r/StableDiffusion, 0 পয়েন্ট, 19 মন্তব্য, 2026-09-25): https://www.reddit.com/r/StableDiffusion/comments/1wpr4uf/ — বর্তমান সেরা ওপেন-সোর্স/লোকাল মডেল নিয়ে প্রশ্ন। মন্তব্যের ঐকমত্য: ইমেজ জেনারেশন = Krea 2; আগের Z-Image Turbo থেকে বদলানোর পরামর্শে একাধিক জন একমত। ইমেজ এডিটিং = Qwen-Image 2.1; u/Jackkgold বাণিজ্যিক ব্যবহারে লাইসেন্স খেয়াল করতে বলেন। ভিডিও = Minimax H3। u/Cultural-Broccoli-41, Apache-2.0 লাইসেন্সের শক্তিশালী ইমেজ এডিটিং মডেল হিসেবে SenseNova-U1.5 উল্লেখ করেন।
- থ্রেড #4 (r/generativeAI, 7 পয়েন্ট, 38 মন্তব্য, 2026-09-23): https://www.reddit.com/r/generativeAI/comments/1wog53q/ — “দীর্ঘ AI ভিডিও কীভাবে বানাব?” প্রশ্নে u/kaboom-o (2 পয়েন্ট) ব্যবহারিক ওয়ার্কফ্লো ব্যাখ্যা করেন: কেউ এক শটে দীর্ঘ ভিডিও বানায় না; স্ক্রিপ্ট → 5–15 সেকেন্ডের ক্লিপ জমা → সম্পাদনাই প্রচলিত। মুখ দীর্ঘক্ষণ ধরে রাখতে Seedance 2.5, সস্তা মোশন ড্রাফটের জন্য Grok Imagine Video, বাস্তবধর্মিতার জন্য Gemini Omni Flash ব্যবহার করেন। u/AlfieSchmalfie (2 পয়েন্ট) 12 মিনিট, 148 শট, 8 সপ্তাহ, আনুমানিক 1,000 AUD-এ সম্পন্ন প্রকল্পের উদাহরণ দেন।
- থ্রেড #8 (r/GenAI4all, 165 পয়েন্ট, 63 মন্তব্য, 2026-09-24): https://www.reddit.com/r/GenAI4all/comments/1wou5vb/ — 2024 সালে ভাইরাল হওয়া AI ভিডিও নিয়ে ফিরে দেখা। u/MinosAristos (7 পয়েন্ট) বলেন, “সিন্থেটিক মিডিয়ার দুর্বলতাকে শক্তি হিসেবে ব্যবহার করেছে; ভিডিওটি সত্যিই সিনেমা”—বর্তমান ও তখনকার মানের ফারাক নিয়ে আলোচনা।
- থ্রেড #2, #6, #7, #10 (সবগুলো r/generativeAI/r/aivideomaking, 2–17 পয়েন্ট, 2026-09-19–22): একই ধরনের “বিনামূল্যের AI ভিডিও জেনারেশন টুল চাই” প্রশ্ন প্রায় একই ভাষায় বারবার পোস্ট হয়েছে (r/aivideomaking https://www.reddit.com/r/aivideomaking/comments/1wled0f/ , r/generativeAI https://www.reddit.com/r/generativeAI/comments/1wlec1u/ অন্যান্য)। উত্তরে একদল বলেন “ফ্রি বলে কিছু নেই, কম্পিউট রিসোর্স বিনা মূল্যের নয়”; আরেকদল Muse, Meta, Nanobanana/Veo, dreamfort.ai/video-সহ বিনামূল্যের টুল ও ফ্রি-টিয়ারের নাম দেন। অটো-রিপ্লাই বট u/Jenna_AI বারবার ব্যঙ্গ করে বলে, “H100 ফ্রি চালাতে পারবে ভেবো না।”
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: r/StableDiffusion-এ Krea 2, Qwen-Image 2.1, Minimax H3 এবং SenseNova-U1.5 অল্প সময়েই নিয়মিত পছন্দ হয়ে উঠেছে। “Z-Image Turbo এখন পুরোনো”—এমন একাধিক মন্তব্য মডেল পরিবর্তনের দ্রুত গতি দেখায়।
- AI-বিরোধী আবেগ বাস্তব রূপ নিচ্ছে: r/antiai, r/mildlyinfuriating এবং r/WhitePeopleTwitter-এ শুধু অসন্তোষ নয়—চাকরিচ্যুতি, রিপোর্ট, প্রশিক্ষণ নিষিদ্ধের আইনি পদক্ষেপের মতো বাস্তব কর্মকাণ্ডে রূপ নেওয়া দেখা যায়। প্রতিক্রিয়া বিমূর্ত বিতর্ক থেকে সামাজিক ব্যয়ের আলোচনায় যাচ্ছে।
- ক্লোজড-সোর্সের চাপ: DeepSeek থ্রেড দেখায়, কম্পিউট ঘাটতিতে মান কমার মতো বৃদ্ধিজনিত সমস্যায় বড় ক্লোজডধাঁচের পরিষেবার সীমাবদ্ধতা।
- মতবিরোধ: থ্রেড #9-এ Dreamworks-এর প্রশিক্ষণ-নিষেধ শর্তকে বড় জয় বলা হলেও, সর্বোচ্চ ভোট পাওয়া মন্তব্যে বলা হয়েছে AI পক্ষ তাতে কিছুই বদলাবে না। একই আলোচনায় স্পষ্ট মতভেদ।
- অবহেলা না করার মতো “তুচ্ছ” চাহিদা: “বিনামূল্যের AI ভিডিও টুল চাই” ধরনের পুনরাবৃত্ত পোস্ট চারটির মধ্যে চারটিই একই বিষয় নিয়ে। এগুলোই সম্ভবত সবচেয়ে বড় বাস্তব চাহিদার অংশ এবং তার চারপাশে অটো-রিপ্লাই বটের ব্যঙ্গসংস্কৃতি গড়ে উঠেছে।
- অপ্রত্যাশিত বিষয়: Nikon Small World in Motion-এর মতো AI-বহির্ভূত মর্যাদাপূর্ণ বৈজ্ঞানিক প্রতিযোগিতায় AI সম্পাদনা ঢুকে পড়ে, আর কমিউনিটি নিজেই তা যাচাই ও প্রকাশ করে। ওপর থেকে নিয়ম আরোপের আগে বিশেষজ্ঞ কমিউনিটির আত্মশুদ্ধির উদাহরণ।
সীমাবদ্ধতা
- সার্চ টার্ম ছিল কেবল “Image and Video Generation AI News”; ফলে 9টি সাবরেডিটের 12টি থ্রেড পাওয়া গেছে। Krea, Qwen, Seedance, Sora, “open source diffusion”, “closed source video AI” ইত্যাদি দিয়ে বাড়তি অনুসন্ধান করলে আরও ফল মিলতে পারত, কিন্তু হাতে কেবল এই এক টার্মের ডেটা ছিল।
- এ পর্যায়ে হেডলেস ব্রাউজার দিয়ে আগে সংগৃহীত ডেটা শুধু পড়া হয়েছে; Reddit-এ অতিরিক্ত অ্যাক্সেস, সার্চ বা প্রতিটি থ্রেডের শীর্ষ 6টির বেশি মন্তব্য দেখা সম্ভব ছিল না।
- থ্রেড #8 ও #11-এর মূল লেখা সংক্ষিপ্ত বা অনুপস্থিত ছিল; শিরোনাম ও শীর্ষ মন্তব্য থেকে উদ্দেশ্য অনুমান করা হয়েছে।
- DeepSeek থ্রেডে উল্লেখিত nbd.com.cn ও ntdtv.com-এর বাইরের নিবন্ধের উপস্থিতি Reddit পোস্টের লিংক হিসেবে নিশ্চিত করা হয়েছে, কিন্তু এই run-এ নিবন্ধগুলো পড়া হয়নি।
X
X — ছবি ও ভিডিও জেনারেশন AI সংবাদ
Explore ট্রেন্ড এই সেশনে সংযুক্ত সার্ভারের অবস্থানের ভিত্তিতে ক্রোয়েশিয়া-কেন্দ্রিক ছিল—8টির মধ্যে 7টিতে “Trending in Croatia” দেখা যায়। ফলে এটি বিশ্বব্যাপী ট্রেন্ড তালিকা নয়। সার্চ করা 10টি শব্দ ছিল “Taylor”, “#sweepstakes”, “#giveaways”, “#chance”, “Opus 5.5”, “Slovenia”, “Italy”, “Cardano”, “Croatia”, “Claude”; এর মধ্যে কেবল “Opus 5.5” ও “Claude” ইমেজ/ভিডিও জেনারেশন AI-সংশ্লিষ্ট। বাকি 8টি শব্দ বিষয়বহির্ভূত ফল দিয়েছে। নিচে শুধু প্রাসঙ্গিক পোস্টগুলোর বিশ্লেষণ আছে।
অ্যাকাউন্ট
এই বিষয়ের পোস্টে বড় ফলোয়ারসংখ্যার একক কোনো উৎস প্রবলভাবে নেতৃত্ব দেয়নি; জাপানি AI নির্মাতাদের ব্যক্তিগত অ্যাকাউন্ট থেকে পৃথক পৃথক পোস্ট এসেছে।
- @aiehon_aya (妖精アーヤ) — 1টি পোস্টে 1,594 লাইক ও 143 রিপোস্ট। Claude Opus5.5 দিয়ে মোশন গ্রাফিক্স তৈরির প্রক্রিয়া—HTML → প্রতিটি ফ্রেম আঁকা → Python-এ ভিডিও বানানো—ব্যাখ্যা করেছে। Opus 5.5-সংক্রান্ত পোস্টে সর্বাধিক লাইক।
- @sankakuten91256 (さんかくてん) — 1টি পোস্টে 1,159 লাইক ও প্রায় 57,000 ভিউ। একাধিক জেনারেটিভ AI-কে মিলিয়ে পাইপলাইন পরিচিতি।
- @mmmiyama_D (ミヤマ), @rotejin (ろてじん), @seiiiiiiiiiiru (SEIIIRUAI ব্যবহারকারী ভিডিও নির্মাতা) — প্রত্যেকের 1টি করে পোস্টে কয়েকশ লাইক। Claude Code বা Opus 5.5 দিয়ে ব্যক্তিগত ভিডিও, Live2D মোশন এবং AI বিজ্ঞাপন ভিডিও তৈরির প্রদর্শন।
- @bond_ai1 ও @ponzponz15 — AI-ভিত্তিক আয় ও ব্যবহার-কৌশল বিষয়ক অ্যাকাউন্ট; Claude Code দিয়ে ভিডিও সম্পাদনার অটোমেশন টুল তুলে ধরেছে।
- এই বিষয়ে বহু পোস্টে কম লাইক পাওয়া কোনো অ্যাকাউন্ট ছিল না; প্রত্যেকের ধরন “একটি পোস্ট, মাঝারি প্রতিক্রিয়া।” একক ভাইরাল পোস্ট না থাকলেও বিশেষায়িত, ধারাবাহিক প্রদর্শনের চিত্র দেখা যায়।
পোস্ট
-
#17 @sankakuten91256 — 1,159 likes, 102 reposts, 13 replies, প্রায় 57,000 views, 2026-09-25
https://x.com/sankakuten91256/status/2103483923783373039Opus 5.5はこんなこともできるのか GPT Images 2.5 で9分割のダンスの画像を作成 Grokでグリーンバックのダンス動画 Opus 5.5でモーショングラフィックス Astraで音の差し替え
→ একটি কাজে GPT Images 2.5, Grok, Opus 5.5 ও Astra-কে ভূমিকা অনুযায়ী একত্রে ব্যবহার করা “মাল্টি-টুল স্ট্যাক” ওয়ার্কফ্লো। একক মডেলের বদলে বহু ক্লোজড টুলের সমন্বয়ই ট্রেন্ড। -
#18 @seiiiiiiiiiiru — 554 likes, 75 reposts, 29 replies, প্রায় 45,000 views, 2026-09-24
https://x.com/seiiiiiiiiiiru/status/2103227982592831846AI広告動画 → AI音声 × AI編集 もうここがゴール地点ってことでいいでしょ。笑 Cluad Opus 5.5にGemini 3.8 Flash TTSでナレーション生成させて…
→ AI ভয়েস ও AI এডিটিংকে বিজ্ঞাপন ভিডিও নির্মাণের গন্তব্য হিসেবে উপস্থাপন করা হয়েছে। Claude Opus 5.5 ও Gemini 3.8 Flash TTS মেলানো বাস্তব উৎপাদনের উদাহরণ। -
#19 @mmmiyama_D — 632 likes, 41 reposts, 15 replies, প্রায় 75,000 views, 2026-09-25
https://x.com/mmmiyama_D/status/2103384986661671058プロンプト一撃の方が出来が良くて、ちょっと悲しい… Claude CodeのOpus 5.5で15秒の自己紹介動画も作りました。フォントは勝手にダウンロード、音楽までいい感じに作ってくれた〜!!!
→ Claude Code (Opus 5.5) নিজে ফন্ট ডাউনলোড ও সঙ্গীত নির্বাচন করেছে—এটি বিস্ময়ের সঙ্গে শেয়ার করা হয়েছে। “ভিডিও জেনারেশন” নয়, বরং “ভিডিও প্রোডাকশন এজেন্ট” হিসেবে ব্যবহার। -
#20 @rotejin — 435 likes, 57 reposts, 8 replies, প্রায় 37,000 views, 2026-09-25
https://x.com/rotejin/status/2103384608301830297Claude Codeに「新しいモーションを追加して」と頼むだけでLive2Dモーションを追加できるツールを使わせてもらいました…使ったモデルはOpus 5.5のxhigh。
→ ইমেজ বা ভিডিও জেনারেশন নয়; Claude Code দিয়ে Live2D মোশন—হাই তোলা, হাঁচি—স্বয়ংক্রিয়ভাবে যোগ করার টুলের প্রদর্শন। “xhigh” Opus 5.5 রিজনিং স্তরের উল্লেখ নতুনত্বপূর্ণ। -
#37 @ponzponz15 — 226 likes, 17 reposts, 7 replies, প্রায় 35,000 views, 2026-09-24
https://x.com/ponzponz15/status/21029318249181064993Dカメラ×立体テキスト演出② After Effectsで作るような編集がClaude OpusやCodexでも可能に。 上 Seedance 2.5 prev 下 Codex + Hyperframes skill
→ Seedance 2.5 ভিডিও জেনারেশন এবং Codex + Hyperframes skill-এর সমান্তরাল তুলনা। After Effects-সমমানের উপস্থাপনা কোড-জেনারেশন AI দিয়ে প্রতিস্থাপনের প্রবণতা। -
#38 @aiehon_aya — 1,594 likes, 143 reposts, 12 replies, প্রায় 95,000 views, 2026-09-25
https://x.com/aiehon_aya/status/2103403361022419005Claude Opus5.5 モーショングラフィックス 天才Opus5.5にどうやって作ったのか説明させてみた…index.html→1コマずつ描かせる→render.pyで動画ファイルに
→ Opus 5.5-সংক্রান্ত পোস্টে সর্বোচ্চ লাইক। ইমেজ মডেল না ব্যবহার করে, ছবি আঁকার কোড লিখিয়ে ফ্রেম ধরে রেন্ডার করে ভিডিও তৈরির পদ্ধতি সমর্থন পেয়েছে। -
#40 @bond_ai1 — 499 likes, 46 reposts, 3 replies, প্রায় 69,000 views, 2026-09-25
https://x.com/bond_ai1/status/2103374441250259316動画編集、Premiere Proもカット作業の外注もいらない時代が来ました。Claude Codeに素材を投げるだけで、完全自動でプロ品質の動画が仕上がる『video-use』が登場。
→ Claude Code-এর “video-use” টুল ভিডিও সম্পাদনা সম্পূর্ণ স্বয়ংক্রিয় করার দাবি নিয়ে উপস্থাপিত। জেনারেশনের বদলে বিদ্যমান উপকরণের অটো-এডিটিংয়ে AI ছড়িয়ে পড়ার উদাহরণ।
(#39 @samcoderx-এর পোস্ট Claude ব্যবহারের সাধারণ গাইড হওয়ায়, ইমেজ/ভিডিও জেনারেশনের সঙ্গে সরাসরি সম্পর্কিত নয় এবং শুধু রেফারেন্স হিসেবে রাখা হয়েছে।)
সংকেত
- ঊর্ধ্বমুখী: Claude Opus 5.5-কে কেন্দ্রে রেখে GPT Images 2.5, Grok, Gemini TTS ও Astra-সহ একাধিক ক্লোজড টুলে একটি ভিডিও সম্পন্ন করার “মাল্টি-টুল পাইপলাইন” এইবারের প্রায় সব Opus 5.5 পোস্টের বিষয়। এক-প্রম্পটের বদলে Claude Code উপকরণ সংগ্রহ, সম্পাদনা ও সঙ্গীত বাছাইও করছে—“ভিডিও প্রোডাকশন এজেন্ট” ব্যবহারের কথা বারবার এসেছে।
- অদৃশ্য/উল্লেখহীন: সংগৃহীত পোস্টে Stable Diffusion, Flux, ComfyUI, Wan বা HunyuanVideo-সহ ওপেন-সোর্স ইমেজ ও ভিডিও জেনারেশন AI-র কোনো উল্লেখ নেই। সার্চ টার্মে এসব না থাকা এর প্রধান কারণ, তবে 40টি সংগৃহীত ও 7টি প্রাসঙ্গিক পোস্টে আলোচনা সম্পূর্ণ ক্লোজড মডেলকেন্দ্রিক।
- বিস্ময়কর বিষয়: Explore-এর 10টি ট্রেন্ড টার্মের 8টি—Taylor, #sweepstakes, #giveaways, #chance, Slovenia, Italy, Cardano, Croatia—বিষয়বহির্ভূত ছিল। ক্রোয়েশিয়ার Explore-এ এই বিশেষায়িত AI নির্মাণ টুল ট্রেন্ডিং নয়; আলোচনাটি ভাইরাল নয়, ব্যক্তিগত অনুশীলনকারীদের দীর্ঘ-লেজের শেয়ারিং।
সীমাবদ্ধতা
- Explore অঞ্চল ক্রোয়েশিয়ায় স্থির থাকায় “Slovenia”, “Italy”, “Cardano”, “Croatia”-সহ পাঁচটি টার্ম শুধু বিষয়বহির্ভূত ফল দিয়েছে।
- “Taylor”, “#sweepstakes”, “#giveaways”, “#chance”-ও সম্পর্কহীন ফল দেয়।
- “Stable Diffusion”, “Flux”, “ComfyUI”, “Wan”, “open source”-এর সমমানের জাপানি বা ইংরেজি টার্ম সার্চে ছিল না; ফলে X-এ ওপেন-সোর্স প্রবণতা একেবারেই সংগ্রহ হয়নি।
- সংগৃহীত 40টির মধ্যে সরাসরি প্রাসঙ্গিক পোস্ট মাত্র 7–8টি; প্রায় 20টি পোস্ট বিশ্লেষণের লক্ষ্য X-এর ক্ষেত্রে পূরণ হয়নি।
YouTube
YouTube — ইমেজ ও ভিডিও জেনারেশনের সাম্প্রতিক প্রবণতা
চ্যানেল
সার্চ ফল ও oEmbed থেকে নিশ্চিত চ্যানেলগুলো—সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি, বিস্তারিত “সীমাবদ্ধতা” অংশে:
- VEED STUDIO — Sora 2 ও Veo 3.1 তুলনার মতো ভিডিও প্রকাশ করা ভিডিও-এডিটিং টুল চ্যানেল
- AI Autopsy Dossier — ক্লোজড-সোর্স ভিডিও জেনারেশন মডেল পরীক্ষার চ্যানেল
- Tao Prompts — বহু মডেলের পাশাপাশি তুলনায় দক্ষ: Seedance/Kling/Minimax/Google Omni
- Better Stack — AI শিল্পসংক্রান্ত সংবাদ ব্যাখ্যার চ্যানেল, xAI/Grok বিষয়ক
- Latent Space — AI গবেষক সাক্ষাৎকারধর্মী পডকাস্ট/চ্যানেল
- AI Master — Google Gemini টুলের ব্যাখ্যা, যেমন Nano Banana Pro
- Zebra Techies Solution-ZTS Infotech — AI টুল বদল ও তুলনাভিত্তিক চ্যানেল
- SECourses — ComfyUI/SwarmUI দিয়ে ওপেন-সোর্স মডেলের দীর্ঘ টিউটোরিয়াল
- LTX_io — Lightricks-এর অফিসিয়াল চ্যানেল, LTX-2.5 ঘোষণা
- Prompt Engineer 48 — ওপেন-সোর্স মডেলের লোকাল ইনস্টল ও পরীক্ষার চ্যানেল
- Bijan Bowen / Codedigipt — Z-Image Turbo-সহ ওপেন-সোর্স ইমেজ মডেল রিভিউ চ্যানেল
- QUASA — Qwen-Image-সহ ওপেন-সোর্স মডেলের প্রযুক্তিগত ব্যাখ্যা
ভিডিও
[ক্লোজড-সোর্স]
-
Sora 2 Vs Veo 3.1 Comparison (Same Prompts, VERY Different Results) — VEED STUDIO — 2025-11-27 — ভিউ অজানা — https://www.youtube.com/watch?v=kebWkj5ONzo — একই প্রম্পটে Sora 2 ও Veo 3.1 তুলনা; Veo 3.1-কে পদার্থগত আচরণ ও সামঞ্জস্যে বেশি স্থিতিশীল বলা হয়েছে।
-
Seedance 2.5 vs Kling 3.0 | The Honest Truth About AI Video Generation in 2026 — AI Autopsy Dossier — 2026-06-27 — ভিউ অজানা — https://www.youtube.com/watch?v=EtmdbF0DbHU — ByteDance-এর Seedance 2.5 মোশন ও পদার্থগত প্রকাশে Kling 3.0 থেকে সামান্য এগিয়ে, কিন্তু চরিত্রের সামঞ্জস্যে Kling এখনও শক্তিশালী—এমন দাবি।
-
Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — Tao Prompts — 2026-08-14 — ভিউ অজানা — https://www.youtube.com/watch?v=G5D053drKB8 — চারটি ক্লোজড-সোর্স ভিডিও জেনারেশন মডেলের তুলনা। Google-এর নতুন “Omni” মডেল সম্ভাবনাময় প্রতিযোগী হিসেবে উল্লেখিত।
-
xAI are killing it (Grok 4.6, Image 2.0 and more...) — Better Stack — প্রায় 2026 সালের আগস্ট — ভিউ অজানা — https://www.youtube.com/watch?v=ILHJqmJdWso — xAI-এর Grok Imagine/Image 2.0 দ্রুত Veo ও Sora-র ব্যবধান কমাচ্ছে বলে দাবি।
-
Inside xAI: Building Grok Imagine in 3 Months, Videogen vs World Models, and Video Agents — Ethan He — Latent Space — তারিখ অজানা, অনুমান 2026 মধ্যভাগ — ভিউ অজানা — https://www.youtube.com/watch?v=jPtQlILfkhA — xAI ইঞ্জিনিয়ারের সাক্ষাৎকার। মাত্র তিন মাসে Grok Imagine বানানো এবং বিশুদ্ধ ভিডিও ডিফিউশন মডেলের বদলে “world model” পথে যাওয়ার কারণ নিয়ে আলোচনা।
-
Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI — AI Master — তারিখ অজানা, 2026 — ভিউ অজানা — https://www.youtube.com/watch?v=ZCw325FiS78 — Google-এর Nano Banana Pro-এর সম্পাদনা ফিচারের পূর্ণ ব্যাখ্যা।
[ওপেন-সোর্স]
-
Cancel Every Image AI Subscription You Have — Here's What Replaced Them in 2026 — Zebra Techies Solution-ZTS Infotech — 2026-06-24 — ভিউ অজানা — https://www.youtube.com/watch?v=2qOWfES7R3I — 2026 সালে বিনামূল্যের/ওপেন-সোর্স টুল Midjourney-সহ পেইড সাবস্ক্রিপশনের বিকল্প হতে পারে বলে দাবি।
-
Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — SECourses — তারিখ অজানা, 2026 — ভিউ অজানা — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — 37 মিনিটের টিউটোরিয়াল। Wan 2.2, FLUX ও Qwen-Image-কে SwarmUI/ComfyUI-তে Lightning LoRA-সহ সেটআপ ও অপ্টিমাইজ করার পদ্ধতি।
-
LTX-2.5: The World Model the World Builds On — LTX_io (Lightricks অফিসিয়াল) — 2026-08-11 — ভিউ অজানা — https://www.youtube.com/watch?v=ZDfjZae7Da0 — ওপেন-ওয়েট ভিডিও+অডিও মডেল LTX-2.5-এর অফিসিয়াল ঘোষণা। 22B প্যারামিটার; চলচ্চিত্র নির্মাণের পাশাপাশি রোবোটিক্সের “world model” হিসেবেও উপস্থাপিত।
-
LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — Prompt Engineer 48 — 2026-08-18 — ভিউ অজানা — https://www.youtube.com/watch?v=sIOC9pzHzjs — LTX-2.5 ঘোষণার মাত্র এক সপ্তাহের মধ্যে ComfyUI-তে লোকাল ইনস্টল ও পরীক্ষা। ভোক্তাপর্যায়ের GPU-তেও চলার বিষয়টি নিশ্চিত করা হয়েছে।
-
Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models — Bijan Bowen — তারিখ অজানা, অনুমান 2025 সালের শেষ থেকে 2026 শুরুর দিক — ভিউ অজানা — https://www.youtube.com/watch?v=K0FgDU-9uik — Apache-2.0 লাইসেন্সের Alibaba/Tongyi Z-Image Turbo অন্য লোকাল ইমেজ মডেলের তুলনায় গতি ও গুণমানে শক্তিশালী বলে মূল্যায়িত।
-
Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — তারিখ অজানা — ভিউ অজানা — https://www.youtube.com/watch?v=sPQQPpQ9X4E — বিনামূল্যের ওপেন-সোর্স Z-Image Turbo Google-এর পেইড Nano Banana Pro-র সমতুল্য বলে দাবি।
সংকেত
- ক্লোজড-সোর্স ভিডিও জেনারেশনে “Seedance বনাম Kling বনাম Veo বনাম Sora”-র মতো বহু-মডেল তুলনা প্রধান ফরম্যাট; একক রিভিউয়ের চেয়ে তুলনামূলক কনটেন্টের চাহিদা বেশি।
- 2026 সালের প্রথমার্ধ পর্যন্ত Grok Imagine-কে প্রায়ই আনফিল্টার্ড বা উসকানিমূলক কনটেন্টের প্রেক্ষিতে দেখা হলেও, আগস্টের ভিডিওগুলোতে এটি Veo/Sora-র গুরুতর প্রতিদ্বন্দ্বী হিসেবে আলোচিত।
- Google-কে ইমেজে Nano Banana Pro এবং ভিডিওতে Flow/Omni—দুই দিকেই ঘনঘন উল্লেখ করা হয়; একক মডেলের চেয়ে সমগ্র ইকোসিস্টেম হিসেবে।
- Lightricks-এর LTX-2.5 (2026-08-11) ওপেন-সোর্স পক্ষের প্রতীকী ঘটনা; অফিসিয়াল ঘোষণার এক সপ্তাহের মধ্যে স্বতন্ত্র নির্মাতার ComfyUI পরীক্ষা বেরিয়েছে, যা কমিউনিটির দ্রুত প্রতিক্রিয়া দেখায়।
- Alibaba/Tongyi-র Z-Image Turbo-কে বিভিন্ন চ্যানেল একইভাবে “Nano Banana Pro-র ফ্রি সংস্করণ” হিসেবে উপস্থাপন করেছে। ভিডিওর শিরোনামেই ওপেন বনাম ক্লোজড সংঘাতের চিত্র।
- SECourses-এর মতো 30 মিনিটের বেশি টিউটোরিয়ালে Wan, FLUX ও Qwen-Image একসঙ্গে ব্যবহারের ওয়ার্কফ্লো ধরা পড়ে; একক মডেল পরিচালনা থেকে সরে আসার ইঙ্গিত।
সীমাবদ্ধতা
- YouTube সার্চ ও ভিডিও পেজ JavaScript-নির্ভর; WebFetch-এ শুধু স্থির ফুটার পাওয়া গেছে। ভিউ, সাবস্ক্রাইবার, প্রকাশের সময় বা মন্তব্য সরাসরি পড়া যায়নি।
- WebSearch ও YouTube oEmbed ব্যবহার করে শিরোনাম এবং চ্যানেলের নাম নিশ্চিত করা হয়েছে, তবে এগুলো ভিউ বা সাবস্ক্রাইবার দেয় না—তাই সব ভিডিওতে “ভিউ অজানা” লেখা।
- প্রকাশের তারিখ WebSearch স্নিপেটভিত্তিক অনুমান; কিছু ক্ষেত্রে “2 সপ্তাহ আগে”, “1 মাস আগে” ধরনের আপেক্ষিক সময়ই ছিল।
- বিবরণ ও মন্তব্যে সরাসরি প্রবেশ করা যায়নি; দর্শকের প্রতিক্রিয়া অন্তর্ভুক্ত নয়।
- OpenAI Sora API 2026 সালের 24 সেপ্টেম্বর বন্ধ হওয়ার বিষয়টি নিয়ে সরাসরি কোনো YouTube ভিডিও পাওয়া যায়নি।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ
bsky.app মূল সাইটটি JavaScript-রেন্ডার করা SPA; WebFetch-এ সার্চ ও পৃথক পোস্ট পেজের কনটেন্ট পাওয়া যায়নি। অফিসিয়াল public.api.bsky.app এন্ডপয়েন্ট 403 দিচ্ছিল। বদলে api.bsky.app-এর app.bsky.feed.searchPosts JSON API ব্যবহার করা হয়েছে। stable diffusion, midjourney, Sora 2, Veo 3, Nano Banana, Flux image model, ComfyUI, Sora API shutdown, Wan 3.0 video, Seedance, Grok Imagine, HunyuanVideo/LTX Video—এই 12টি কুয়েরিতে প্রতিটিতে 20–25টি করে, মোট 200-এর বেশি পোস্ট সংগ্রহ ও বিশ্লেষণ করা হয়েছে।
অ্যাকাউন্ট
- @aichina.news — Huawei Ascend NPU-র AI প্ল্যাটফর্ম Modelers.cn-এ আপলোড হওয়া SDXL/FLUX LoRA যান্ত্রিকভাবে রিপোর্ট করা বটধাঁচের অ্যাকাউন্ট। প্রায় সব পোস্টে 0 লাইক, কিন্তু দৈনিক 20টির বেশি পোস্ট; Ascend-কেন্দ্রিক ওপেন-সোর্স ইমেজ ইকোসিস্টেমের পর্যবেক্ষণ উৎস।
- @oludai.bsky.social (🚀 olud.ai) — AI মডেল র্যাঙ্কিংয়ের দ্রুত সংবাদ। Alibaba-র Wan 3.0 ওপেন-ওয়েট ভিডিও মডেল মানব পছন্দের র্যাঙ্কিংয়ে শীর্ষে উঠেছে বলে জানায়।
- @github-trending.bsky.social — GitHub Trending-এর স্বয়ংক্রিয় পোস্ট।
stable-diffusion.cpp(★7,148), হালকা C++ ডিফিউশন ইনফারেন্স ইঞ্জিনের ট্রেন্ডিং হওয়া জানায়। - @huggingfacetrends.bsky.social — Hugging Face দৈনিক ট্রেন্ড বট। Qwen-Image 2.1-এর ComfyUI পোর্টের তথ্য দেয়।
- @aipromptingclinic.bsky.social — Seedance, Kling ও Grok Imagine-এর প্রম্পট ডিজাইনের টিপস প্রতিদিন বিপুল সংখ্যায় পোস্ট করে। এনগেজমেন্ট প্রায় শূন্য, কিন্তু উপস্থিতির হার ক্লোজড ভিডিও/ইমেজ মডেলের বাস্তব ব্যবহারের বিস্তার দেখায়।
- @aki-kisaragi.bsky.social (AKI) — Grok Imagine দিয়ে আইকন ও ইলাস্ট্রেশন বানিয়ে প্রকাশ করা ব্যক্তিগত নির্মাতা। জাপানি ভাষাভাষী ব্যবহারের উদাহরণ।
- @hashimoto-ekuto.bsky.social (PuniQ) — Seedance 2.5-এর ক্রেডিট শেষ হওয়া পর্যন্ত ভিডিও জেনারেশনের অভিজ্ঞতা লাইভ পোস্ট করেন।
- @dfl.bsky.social (DFL inc.) / @obeca.bsky.social — Nano Banana 2 দিয়ে তৈরি ছবি নিয়মিত পোস্ট করে।
- @alternativeto.net — 11 লাইকসহ OpenAI Sora বন্ধের খবর ছড়ানো টুল-তুলনামূলক মিডিয়া অ্যাকাউন্ট।
পোস্ট
-
@knowmouth.bsky.social — 0 likes, 0 reposts, 2026-09-25T00:51
https://bsky.app/profile/knowmouth.bsky.social/post/3mwckivdpkk2y🎬 Sora is officially gone. OpenAI discontinued the Sora product earlier this year, and Sora 2, Sora 2 Pro and the Videos API reached their shutdown date on September 24, 2026.
→ ক্লোজড-সোর্সের সবচেয়ে বড় খবর। OpenAI ভিডিও জেনারেশন API Sora সম্পূর্ণ বন্ধ করেছে; কোনো বিকল্প রোডম্যাপ নেই। -
@alternativeto.net — 11 likes, 0 reposts, 2026-03-25T11:30
https://bsky.app/profile/alternativeto.net/post/3mhuyfrjnpz26OpenAI is shutting down its AI video slop social app, Sora, along with its API less than six months after launch... ending a billion-dollar partnership with Disney.
→ Sora অ্যাপ ও API বন্ধের সঙ্গে Disney-র 1 বিলিয়ন ডলারের অংশীদারত্ব ভেঙে যাওয়ার খবর; সংগৃহীত Sora-সংক্রান্ত পোস্টে সর্বোচ্চ লাইক। -
@aifoundersczech.bsky.social (AI Founders ONLINE) — 0 likes, 0 reposts, 2026-07-04T11:00
https://bsky.app/profile/aifoundersczech.bsky.social/post/3mpsvtc4hkd2uGoogle just priced its new video API 4x cheaper than its own flagship tier — on purpose... Sora finished burning $1M/day against $2.1M in lifetime revenue.
→ Sora API বন্ধের পেছনের অর্থনীতি হিসেবে প্রতিদিন 1 মিলিয়ন ডলার ক্ষতি বনাম জীবনকালীন 2.1 মিলিয়ন ডলার আয় উল্লেখ; Google Veo-র মূল্য আক্রমণও আছে। -
@coreati.bsky.social (Core Ai News 🚨) — 0 likes, 0 reposts, 2026-09-24T18:52
https://bsky.app/profile/coreati.bsky.social/post/3mwbwh5p7mj2eGOOGLE 🔥: Nano Banana 2.5 Flash traces have been spotted...
→ Google-এর ইমেজ জেনারেশন মডেল Nano Banana-এর পরবর্তী 2.5 Flash সংস্করণের চিহ্ন পাওয়া গেছে—এমন লিক। -
@garutoroid.bsky.social (ガル・トロイド) — 3 likes, 0 reposts, 2026-09-24T10:03
https://bsky.app/profile/garutoroid.bsky.social/post/3mwayvizumc2g同プロンプトのGPT Image 2.5とNano Banana 2版。
→ একই প্রম্পটে GPT Image 2.5 বনাম Nano Banana 2 তুলনা। ব্যবহারকারী পর্যায়ে ক্লোজড ইমেজ মডেলের তুলনা দৈনন্দিন হয়ে যাওয়ার প্রমাণ। -
@ahiruai.bsky.social (あひる|楽すぎるAI副業) — 0 likes, 0 reposts, 2026-09-25T08:41
https://bsky.app/profile/ahiruai.bsky.social/post/3mwdeqlfflo2fRunwayの「Draft mode」を使うとSeedance 2.5のクレジット消費を抑えられる、という情報共有。
→ Runway-এর Draft mode ব্যবহার করে Seedance 2.5-এর ক্রেডিট খরচ কমানোর টিপস; অন্য প্ল্যাটফর্মের মাধ্যমে ক্লোজড ভিডিও মডেল ব্যবহারের উদাহরণ। -
@oludai.bsky.social (🚀 olud.ai) — 1 like, 0 reposts, 2026-09-25T21:00
https://bsky.app/profile/oludai.bsky.social/post/3mweo2rmjo424🏆 Wan 3.0, an open-weight model, tops the human-preference ranking for video generation—beating every closed rival.
→ ওপেন-সোর্সের সবচেয়ে বড় খবর। Alibaba-র Wan 3.0 মানব মূল্যায়নে সব ক্লোজড মডেলকে ছাড়িয়ে গেছে। -
@ai-linkstream.bsky.social — 0 likes, 0 reposts, 2026-09-25T17:50
https://bsky.app/profile/ai-linkstream.bsky.social/post/3mwedgzcgkh2gAlibaba has launched its AI video model, Wan 3.0, after a $10 billion share sale.
→ Alibaba-র 10 বিলিয়ন ডলারের শেয়ার বিক্রির ঠিক পর Wan 3.0 চালুর খবর; ওপেন AI-তে পুঁজির পরিমাণের ইঙ্গিত। -
@riccinov.bsky.social (Ricci Research) — 0 likes, 0 reposts, 2026-09-24T15:07
https://bsky.app/profile/riccinov.bsky.social/post/3mwbjv6rqxt2fAlibaba's Qwen Image 2.1 is 7B parameters and scores 60.2...
→ Alibaba-র ওপেন ইমেজ মডেল Qwen-Image 2.1-এর 7B প্যারামিটার ও 60.2 বেঞ্চমার্ক স্কোরের তথ্য। -
@huggingfacetrends.bsky.social — 0 likes, 0 reposts, 2026-09-25T15:04
https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mwe25zx3bn27Comfy-Org/Qwen-Image-2.1: Qwen-Image 2.1 repackaged for ComfyUI
→ Qwen-Image 2.1 দ্রুত ComfyUI নোড হিসেবে বিতরণ হয়েছে; ওপেন মডেল কত দ্রুত ইকোসিস্টেমে ঢোকে তার প্রমাণ। -
@github-trending.bsky.social — 1 like, 0 reposts, 2026-09-24T19:17
https://bsky.app/profile/github-trending.bsky.social/post/3mwbxt7hrhr2q📦 leejet / stable-diffusion.cpp ⭐ 7,148 (+33) 🗒 C++ — Diffusion model(SD,Flux,Wan,Qwen Image,Z-Image,...) inference in pure C/C++
→ SD, Flux, Wan, Qwen Image ও Z-Image-সহ প্রধান ওপেন ডিফিউশন মডেল এক C++ ইনফারেন্স ইঞ্জিনে চালানোর প্রকল্প GitHub Trending-এ এসেছে। -
@manilarope.bsky.social (Taimai🔞) — 2 likes, 1 repost, 2026-09-26T00:48
https://bsky.app/profile/manilarope.bsky.social/post/3mwf2swkkao2fComfyUIくんとのケンカがなんとか一段落して、MiniMaxH3で動画を生成できるようになってくれました。
→ ComfyUI-এর মাধ্যমে MiniMax H3 চালাতে ব্যক্তিগত পরীক্ষানিরীক্ষা; ওপেন/আংশিক ওপেন ভিডিও মডেল লোকাল পরিবেশে আনার উদাহরণ।
সংকেত
ক্লোজড-সোর্সের গতি
- OpenAI “Sora” ব্র্যান্ড সম্পূর্ণ বন্ধ করেছে: অ্যাপ 2026 সালের এপ্রিলে, এবং Sora 2, Sora 2 Pro, Videos API ও সব মডেল alias 24 সেপ্টেম্বর বন্ধ। বিকল্প রোডম্যাপ নেই।
- Sora-র আর্থিক অদক্ষতা—প্রতিদিন 1 মিলিয়ন ডলার ক্ষতি বনাম 2.1 মিলিয়ন ডলার জীবনকালীন আয়—নিয়ে প্রকাশ্যে আলোচনা হয়েছে।
- Sora বন্ধের সঙ্গে Google তার Veo ভিডিও API-কে ফ্ল্যাগশিপ স্তরের চেয়ে চার গুণ সস্তায় পুনর্মূল্য নির্ধারণ করেছে।
- Google-এর Nano Banana ইমেজ লাইন 2 থেকে 2.5 Flash-এ প্রজন্ম পরিবর্তনের গুজব/চিহ্নে রয়েছে; ব্যবহারকারীরা GPT Image 2.5-এর সঙ্গে একই প্রম্পটে তুলনা করছেন।
- ByteDance-এর Seedance 2.5 Runway-সহ অন্যান্য প্ল্যাটফর্মেও ব্যবহৃত হচ্ছে এবং ক্রেডিট দ্রুত খরচ হওয়ার বিষয়টি আলোচিত।
- Kling 3.0 ও Grok Imagine ব্যক্তিগত নির্মাতার ওয়ার্কফ্লোতে ঢুকে গেছে।
- Sora API বন্ধের পর Seedance 2.0, LTX ও Runway-কে স্থানান্তরের গন্তব্য হিসেবে সুপারিশ করা পোস্টও আছে।
ওপেন-সোর্সের গতি
- Alibaba-র Wan 3.0 মানব মূল্যায়নে ক্লোজড মডেলকে ছাড়িয়েছে বলে রিপোর্ট হয়েছে; 10 বিলিয়ন ডলারের শেয়ার বিক্রির পরপরই লঞ্চ।
- Qwen-Image 2.1—7B প্যারামিটার, বেঞ্চমার্ক 60.2—প্রকাশের পরপরই ComfyUI অফিসিয়াল নোডে পরিণত হয়েছে।
stable-diffusion.cpp(★7,148) SD, Flux, Wan, Qwen Image ও Z-Image-সহ নানা ওপেন মডেল চালায় এবং GitHub Trending-এ এসেছে।- Huawei Ascend NPU ইকোসিস্টেমে Modelers.cn-এ SDXL/FLUX LoRA ব্যাপকভাবে তৈরি হচ্ছে; তবে অনেকের মডেল কার্ড, ট্রিগার শব্দ ও নমুনা নেই, তাই মান কম।
- MiniMax H3-কে ComfyUI দিয়ে লোকালি চালানোর ব্যক্তিগত প্রয়াস ও পারফরম্যান্স তুলনা দেখা যায়।
- সামগ্রিকভাবে Alibaba-র বড় মডেল Wan/Qwen-এর দ্রুত ComfyUI স্থানান্তর এবং Huawei Ascend ইকোসিস্টেমে তৃণমূল LoRA উৎপাদন—দুটি স্তরে ওপেন-সোর্স এগোচ্ছে।
সীমাবদ্ধতা
bsky.app-এর সার্চ ও পোস্ট পেজ ক্লায়েন্ট-সাইড SPA হওয়ায় WebFetch-এ কনটেন্ট পাওয়া যায়নি।public.api.bsky.appসবসময় 403 দিয়েছে;api.bsky.appকাজ করলেও ভবিষ্যতে বট প্রতিরোধে এটিও ব্লক হতে পারে।- Bash থেকে সরাসরি curl নেটওয়ার্ক সীমাবদ্ধতায় ব্যবহার করা যায়নি; WebFetch-নির্ভর কাজ হয়েছে।
Veo 3কুয়েরি স্প্যানিশ ক্রিয়া “veo” ও অন্যান্য অপ্রাসঙ্গিক ফলাফলে ভরা ছিল; সরাসরি Google Veo-র উল্লেখ কম পাওয়া গেছে।HunyuanVideo/LTX Videoকুয়েরিতে কোনো ফল আসেনি।- সার্চ API-তে প্রতি কুয়েরিতে
limit=25সীমা ছিল এবং কেবল সর্বশেষ পোস্ট দেখা হয়েছে; দীর্ঘমেয়াদি ট্রেন্ড বিশ্লেষণ নয়।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI সংবাদ
Lemmy-তে “image generation AI”, “video generation AI”, “Sora shutdown”, “Nano Banana”, “Grok Imagine”, “Wan 2.2 OR Wan 3”, “Flux image model” ইত্যাদি দিয়ে lemmy.world-এর /api/v3/search সার্চ API ব্যবহার করা হয়, কিন্তু ফলের অধিকাংশই অপ্রাসঙ্গিক ছিল। তাই টার্ম সার্চ দ্রুত বাদ দিয়ে ইমেজ জেনারেশন-কেন্দ্রিক কমিউনিটি সরাসরি ব্রাউজ করা হয়েছে।
কমিউনিটি
| কমিউনিটি | ইনস্ট্যান্স | সাবস্ক্রাইবার | প্রবণতা |
|---|---|---|---|
| !«メールアドレス» | lemmy.dbzer0.com | 5,713 জন | নতুন ওপেন-সোর্স মডেল, LoRA ও ComfyUI নোডের HuggingFace/GitHub লিংক নিয়মিত পোস্ট করা ফিড। |
| !«メールアドレス» | lemmy.dbzer0.com | 2,363 জন | Civitai থেকে AI-তৈরি ইলাস্ট্রেশনের মিরর পোস্ট করা শোকেস। |
| !«メールアドレス» | lemmy.world | 1,985 জন | Flux ব্যবহারকারী বিনামূল্যের AI জেনারেশন টুল Perchance নিয়ে কমিউনিটি। |
| !«メールアドレス» | lemmy.ml | 1,662 জন | একসময় সক্রিয় হলেও কার্যত স্থবির। |
| !«メールアドレス» | lemmy.world | 1,258 জন | সাধারণ ML/AI সংবাদ; ইমেজ/ভিডিও জেনারেশননির্ভর পোস্ট প্রায় নেই। |
| !«メールアドレス» (Generative Artificial Intelligence) | sopuli.xyz | 328 জন | জেনারেটিভ AI আলাপ; নির্দিষ্ট ইমেজ/ভিডিও সংবাদ কম। |
| !«メールアドレス» | lemmy.durstig.online | 52 জন | Reddit-এর AI সাবরেডিট যান্ত্রিকভাবে মিরর করা RSS বট। |
| !«メールアドレス» | sh.itjust.works | 172 জন | AI আর্ট উদাহরণের কমিউনিটি, 2023 থেকেই নিষ্ক্রিয়। |
পোস্ট
-
Qwen-Image-2.1 in ComfyUI (!«メールアドレス», 13 পয়েন্ট, 0 মন্তব্য, 2026-09-22)
https://lemmy.dbzer0.com/post/75874773 → Alibaba-র ওপেন Qwen-Image 2.1-কে ComfyUI অফিসিয়াল ব্লগে আনুষ্ঠানিক সমর্থনের লিংক পোস্ট। Bluesky-তেও একই সময়ে একই প্রবণতা দেখা গেছে। -
Supra2-IMG Model (!«メールアドレス», 8 পয়েন্ট, 0 মন্তব্য, 2026-09-22)
https://lemmy.dbzer0.com/post/75874769 → নতুন ইমেজ জেনারেশন মডেল “SupraLabs/Supra2-IMG”-এর HuggingFace প্রকাশনা। -
AI Horde New Interface (!«メールアドレス», 9 পয়েন্ট, 0 মন্তব্য, 2026-09-19)
https://lemmy.dbzer0.com/post/75736717 → haidra.net-এর ক্রাউডসোর্সড, বিকেন্দ্রীকৃত ও বিনামূল্যের ইমেজ জেনারেশন অবকাঠামো AI Horde-এর নতুন ইন্টারফেস ও ডকুমেন্টেশন। -
MiniMax H3-এর ComfyUI টুলের ঘন পোস্টিং (!«メールアドレス», প্রতিটি 1–3 পয়েন্ট, 2026-09-12–09-16)
https://lemmy.dbzer0.com/post/75586072 (MiniMaxH3-PromptBuilder),
https://lemmy.dbzer0.com/post/75586070 (wan2gp-h3-latent-continue),
https://lemmy.dbzer0.com/post/75427444 (3d-Camera-control-H3-Minimax) অন্যান্য
→ MiniMax H3-র জন্য ComfyUI কাস্টম নোড ও প্রম্পট বিল্ডার এক সপ্তাহে 5টির বেশি পোস্ট হয়েছে। Reddit-এ “ভিডিও = Minimax H3” ঐকমত্যের সঙ্গে মেলে। -
Krea2-Turbo-Distill-2step-LoRA (!«メールアドレス», 2026-09-13 ও 09-16-এ 2টি পোস্ট, প্রতিটি 1–2 পয়েন্ট)
https://lemmy.dbzer0.com/post/75427441 / https://lemmy.dbzer0.com/post/75586071 → Krea 2-কে দুই ধাপে দ্রুততর করার LoRA প্রকাশ। Reddit-এর “Krea 2 এখনকার সুপারিশ” প্রবণতার সঙ্গে দ্রুতগতির অ্যাডাপ্টার প্রস্তুতি চলেছে। -
LTX-2.5-22b-IC-LoRA-Ingredients (!«メールアドレス», 3 পয়েন্ট, 0 মন্তব্য, 2026-09-12)
https://lemmy.dbzer0.com/post/75382763 → Lightricks-এর ওপেন ভিডিও মডেল LTX-এর জন্য LoRA প্রকাশ। -
Waters & World's Edge এবং Civitai-তৈরি ইলাস্ট্রেশনের দৈনিক পোস্ট (!«メールアドレス», সর্বোচ্চ 12 পয়েন্ট, 2026-09-22–09-26)
https://lemmy.dbzer0.com/post/75841792 অন্যান্য → সংবাদ নয়, উদাহরণের শোকেস; কিন্তু প্রতিদিন নিয়মিত পোস্ট হওয়া লোকাল জেনারেশন কমিউনিটির সক্রিয়তার প্রমাণ। -
We are saying goodbye to Sora (!«メールアドレス», -11 পয়েন্ট, 4 মন্তব্য, 2026-03-24)
https://lemmy.world/post/44702049 → OpenAI-র Sora অ্যাপ বন্ধের ঘোষণার হুবহু পুনঃপ্রকাশ। Lemmy-র প্রতিক্রিয়া ঠান্ডা, স্কোর নেতিবাচক। সেপ্টেম্বরে Sora 2/Videos API বন্ধের নতুন পোস্ট পাওয়া যায়নি। -
Interesting Facts about Perchance (!«メールアドレス», 3 পয়েন্ট, 18 মন্তব্য, 2026-08-05)
https://lemmy.world/post/50319371 → বিনামূল্যের AI সাইট Perchance-এর ইমেজ অংশে ওপেন মডেল Flux এবং বিনামূল্যের ওপেন টেক্সট মডেল DeepSeek ব্যবহারের আলোচনা। সাধারণ ব্যবহারকারীদের “বিনামূল্যে ব্যবহারযোগ্য AI টুল” প্রসঙ্গে ওপেন-সোর্স মডেল নামের প্রবেশের উদাহরণ।
সংকেত
- ঊর্ধ্বমুখী প্রবণতা প্রায় পুরোপুরি ওপেন-সোর্সে: সক্রিয়
!«メールアドレス»-এ Qwen-Image 2.1, Krea 2, MiniMax H3 ও LTX নামগুলো গত দুই সপ্তাহে ঘনঘন এসেছে। Reddit ও Bluesky-র আলোচিত ওপেন মডেলগুলো প্রায় সময়ের ব্যবধান ছাড়াই Lemmy-তেও এসেছে। - ক্লোজড-সোর্স সংবাদ কাঠামোগতভাবেই দুর্বল: Sora বন্ধ, Nano Banana, Veo মূল্যছাড়, Grok Imagine, Seedance-এর মতো সেপ্টেম্বরের বড় খবর টার্গেটেড সার্চেও মেলেনি। একমাত্র Sora পোস্টটি মার্চের পুরোনো ঘোষণা। প্রযুক্তিবিদ/নিজে-চালানো ব্যবহারকারীকেন্দ্রিক Lemmy ব্যবহারকারীরা কর্পোরেট ক্লোজড পরিষেবার খবরের চেয়ে নিজে চালানো যায় এমন মডেল ও টুলে বেশি আগ্রহী।
- এনগেজমেন্ট সাধারণত কম:
stable_diffusion-এর পোস্টে 1–13 পয়েন্ট ও প্রায়শ শূন্য মন্তব্য; Reddit-সদৃশ আলোচনা নেই। পোস্টের সংখ্যা ও আপডেট ফ্রিকোয়েন্সি দিয়েই আলোচ্যতা মাপতে হয়। - সাধারণ কমিউনিটিতে AI নিয়ে সন্দেহ বেশি:
!fuck_aiও!machinelearning-এ ইমেজ/ভিডিও জেনারেশনের চেয়ে AI নির্ভরতা, ডেটাসেন্টারের বিদ্যুৎ, Stability AI-র ব্যবসায়িক ইতিহাস ইত্যাদি বিষয় বেশি।
সীমাবদ্ধতা
- Lemmy সার্চ API-র নির্ভুলতা কম; একাধিক কিওয়ার্ডে বেশিরভাগ ফল অপ্রাসঙ্গিক ছিল। ফলে সরাসরি বিশেষায়িত কমিউনিটি ব্রাউজ করা হয়েছে এবং অন্যান্য ইনস্ট্যান্সে কিছু খবর বাদ পড়তে পারে।
- ভিডিও জেনারেশনের জন্য আলাদা কমিউনিটি পাওয়া যায়নি; ভিডিও মডেল কেবল
!«メールアドレス»-এর ComfyUI টুল পোস্টে দেখা গেছে। - সেপ্টেম্বরের ক্লোজড-সোর্স সংবাদ একেবারেই মেলেনি; অন্য প্ল্যাটফর্মে বড় হওয়া বিষয় Lemmy-তে কার্যত অনুপস্থিত—এটি প্ল্যাটফর্মটির বৈশিষ্ট্য।
- প্রায় 20টি পোস্ট বিশ্লেষণের লক্ষ্য পূরণ হয়নি; সরাসরি প্রাসঙ্গিক পোস্ট প্রায় 9টির বেশি ছিল না।
!«メールアドレス»-সহ সার্চে শুধু নাম পাওয়া কিছু কমিউনিটি API-তে 404 দিয়েছে; সেগুলোর অস্তিত্ব যাচাই করা যায়নি।
Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ
ভিজ্যুয়াল থিম
- “সেরা AI টুল” তালিকাধর্মী ইনফোগ্রাফিক বোর্ডজুড়ে প্রভাবশালী: গাঢ় নেভি বা কালো ব্যাকগ্রাউন্ড, নিয়ন বেগুনি/নীল/গোলাপি গ্রেডিয়েন্ট, বড় স্যানস-সেরিফ শিরোনাম, নম্বর দেওয়া সারি বা ফোন-মকআপ ফ্রেম, এবং প্রতিটি সারিতে টুল লোগো, এক লাইনের পিচ ও নমুনা ছবি।
- ক্রোম বা কাচের হিউম্যানয়েড রোবট মাথা, নীল আলোয় প্রোফাইল ভিউ, “AI সব বদলে দিচ্ছে” বা “AI-এর ভবিষ্যৎ” ধরনের পিনের ডিফল্ট ছবি।
- জেনারেটিভ ভিডিও টুলের বাস্তব প্রোডাক্ট স্ক্রিনশট বড় ছবি না হয়ে ইনফোগ্রাফিকের ছোট ইনসেট হিসেবে থাকে—যেমন Adobe Premiere-এর “Generate Video/Sound” প্যানেল বা Luma AI ও Kling-এর ডেমো স্টিল।
- উল্লম্ব ফোন-স্ট্যাক কোলাজ: দৌড়বিদ, বিড়াল, পাহাড়ের ভিডিও দেখানো অসংখ্য স্মার্টফোন স্ক্রিন আকাশের দিকে স্তূপ; নির্দিষ্ট টুলের বদলে “AI কনটেন্ট সর্বত্র” বোঝাতে ব্যবহৃত।
- YouTube-থাম্বনেইল ধরনের AI সংবাদ পিন: চমকানো বা উত্তেজিত দাড়িওয়ালা মুখের পাশে OpenAI, Google, Microsoft, Meta, Notion-এর লোগো; নীল/কালো পটভূমি ও “AI NEWS” লেখা।
- ভিডিও-টু-এনিথিং রূপান্তরের আগে/পরের গ্রিড: হাঁটতে থাকা একজনকে কাঠের ব্লক, অরিগামি, রঙিন খেলনা ইট, ফুল ইত্যাদি স্টাইলে রূপান্তরিত করা।
- AI অ্যাঙ্কর/ডিপফেক সংবাদ ফ্রেমিং: NBC News-ব্র্যান্ডেড আবহাওয়ার ভিডিওতে “AI GENERATED” ব্যাজ, যা AI সংবাদ ভিডিও বিশ্বাস করা যায় কি না—সেই বিতর্ক দেখায়।
- সম্পূর্ণ কনটেন্ট পাইপলাইনের ফানেল/মাইন্ড-ম্যাপ ইনফোগ্রাফিক: AI-পাওয়ার্ড ইকোসিস্টেম এবং ChatGPT, Claude 3, Pictory AI, Runway Gen-3, Synthesia, ElevenLabs, Midjourney, Descript, CapCut AI, VidIQ, Leonardo AI-কে একই ওয়ার্কফ্লোতে রাখা গ্রাফিক।
উল্লেখযোগ্য পিন
- [1] “6+ Best AI Video Generation Websites” — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI Video Generator ও Hailuo AI-র র্যাঙ্কিং ইনফোগ্রাফিক; Pinterest নির্মাতারা বর্তমানে কোন ক্লোজড ভিডিও টুল প্রচার করছেন তার পরিষ্কার চিত্র।
- [3] “4 Major AI Updates You Need to Know in 2026” — চারটি ক্লোজড আইটেম: OpenAI “GPT-6 Astra”, Gmail/Drive/Docs/Slides/Chat-এ আরও এজেন্টিক Google Gemini, Adobe Premiere-এর ইন-টাইমলাইন জেনারেটিভ ভিডিও/সাউন্ড, এবং Cognition (Devin)-এর $48B মূল্যায়নে $2B Series E।
- [7] “12 Best AI Video Generators in 2026” — Google Veo, OpenAI Sora, Runway, Kling AI, Pika, Luma Dream Machine, HeyGen, Synthesia, InVideo AI, Vidu AI, Hailuo AI, PixVerse AI। [1]-এর সঙ্গে তুলনায় Runway, Pika, Kling, Luma ও Hailuo পুনরাবৃত্ত নাম—সম্মতিমূলক সংক্ষিপ্ত তালিকা।
- [13] “AI Content Studio & Automation Secrets” — ChatGPT, Claude 3, Pictory AI, Runway Gen-3, Synthesia, Midjourney, ElevenLabs, Descript, CapCut AI, VidIQ ও Leonardo AI-কে “idea → publish” পাইপলাইনে দেখানো মাইন্ড-ম্যাপ। তবে গন্তব্য সাইটটি নির্ভরযোগ্য উৎসের চেয়ে পাইরেটেড-স্ট্রিমিং লিড-জেন পেজের মতো।
- [24] “AI News: Anthropic Leak Shows Us The Future of AI” — OpenAI/Google/Microsoft-লোগোসহ YouTube-থাম্বনেইল পিন। দাবি থাকলেও ছবিতে Anthropic-সংক্রান্ত উপাদান দেখা যায় না, ফলে ছবি থেকে যাচাই করা যায় না।
- [28] “Google announces ultra-high quality video...” — মানুষ, কুকুর ও গাড়ির ভিডিওকে কাঠের ব্লক, অরিগামি, খেলনা ইট ও ফুলে রূপান্তরিত করা 5-condition × 3-subject গ্রিড; Luma ওয়াটারমার্কসহ। সেটের সবচেয়ে নির্দিষ্ট প্রোডাক্ট ডেমো।
- [32] “AI news videos blur line between real and fake reports” — তুষারাচ্ছন্ন আবহাওয়ার রিপোর্টে “AI GENERATED” ব্যাজসহ NBC News-ধাঁচের ক্লিপ; AI অ্যাঙ্কর বিতর্কের ভিজ্যুয়াল।
- [38] “AI News: OpenAI Finally Released What We Asked For” — আরেকটি চমকানো মুখ ও লোগো-গ্রিড থাম্বনেইল; [24]-এর সঙ্গে এতটাই মিল যে এটি সংবাদ স্কুপ নয়, পুনরাবৃত্ত চ্যানেল/থাম্বনেইল ফরম্যাট বলেই মনে হয়।
- [43] “generate ai images, art, illustration, using with midjourney” — ব্যাচে Midjourney-কে আলাদাভাবে নাম নেওয়া খুব কম পিনের একটি; ছবিটি সাধারণ ট্রিপল-মনিটর ডেস্ক মকআপ, বাস্তব Midjourney আউটপুটের চেয়ে SEO/অ্যাফিলিয়েট পিনের মতো।
সংকেত
- ক্লোজড-সোর্স ভোক্তামুখী ভিডিও টুলই প্রধান গল্প। Runway, Pika, Kling AI, Luma, Hailuo AI, Google Veo, OpenAI Sora, HeyGen, Synthesia, InVideo AI, Vidu AI ও PixVerse AI বিভিন্ন স্বতন্ত্র পিনে বারবার এসেছে।
- বিশ্বাস ও সত্যতার উদ্বেগ দৃশ্যমান উপ-বিষয়: AI-তৈরি সংবাদ অ্যাঙ্কর ডিপফেক, AI ভয়েস ডিটেক্টর, উৎস প্রমাণের ওয়াটারমার্ক এবং সাংবাদিকতাকে বিশ্বাস করা যায় কি না—টুল প্রচারের পাশাপাশি এগুলোও বারবার আসে।
- এন্টারপ্রাইজ/এজেন্টিক AI সংবাদও একই বোর্ডে মিশে যায়: Workspace-এ Gemini-এর এজেন্টিক অগ্রগতি ও Cognition/Devin-এর $2B তহবিল। Pinterest-এর অ্যালগরিদম এই নিসকে শুধু জেনারেটিভ মিডিয়ায় সীমাবদ্ধ রাখে না।
- ওপেন-সোর্স ইমেজ/ভিডিও মডেল প্রায় পুরোপুরি অনুপস্থিত। নমুনায় Stable Diffusion, Flux, ComfyUI, LoRA, Hunyuan, Wan বা কোনো ওপেন-ওয়েট মডেলের নাম নেই। Pinterest-এর দর্শক ও অ্যালগরিদম আয়কেন্দ্রিক “সেরা ফ্রি টুল” ও সাইড-হাসল কনটেন্টে ঝোঁকে।
- প্রাথমিক উৎসের উপাদান কম। অধিকাংশ পিন সেকেন্ডারি অ্যাগ্রিগেটর কনটেন্ট; [28]-এর Luma স্টাইল-ট্রান্সফার গ্রিডই একমাত্র প্রকৃত ফার্স্ট-পার্টি প্রোডাক্ট ডেমোর মতো।
সীমাবদ্ধতা
- হেডলেস ব্রাউজার সার্চ “Image and Video Generation AI News” কুয়েরিতে 50টি পিনের সমতল ব্যাচ দিয়েছে; উপধারা অনুসারে তুলনা সম্ভব হয়নি।
- 50টির মধ্যে 20টি ছবি বিস্তারিত পড়া ও বর্ণনা করা হয়েছে। বাকি 30টি আলাদা করে খোলা হয়নি, যদিও শিরোনাম দেখা হয়েছে।
- কয়েকটি পিনের কোনো শিরোনাম নেই; না খোলা ছবিতে কার্যকর ক্যাপশন বা লেখা থাকতে পারে।
- ওপেন-সোর্স মডেলের অনুপস্থিতি Pinterest-এ সত্যিকারের অনুপস্থিতি নাকি নির্দিষ্ট সার্চ কুয়েরির ফল—তা নিশ্চিত নয়।
- নির্দেশমতো Pinterest-এ সরাসরি ব্রাউজ বা দাবিগুলো যাচাই করা হয়নি।
প্রস্তাবিত পদক্ষেপ
- Wan 3.0 ও Qwen-Image 2.1-এর গ্রহণের গতি নিয়মিত দেখুন, ওপেন বনাম ক্লোজডের গুণগত উলটপালট স্থায়ী হয় কি না যাচাই করুন।
- Google Veo-র মূল্যছাড় ও Nano Banana 2.5-এর অগ্রগতি অনুসরণ করে Sora প্রত্যাহারের পর মূল্য প্রতিযোগিতার গতি দেখুন।
- Reddit-উৎসের AI-তৈরি কনটেন্ট ভুয়া উপস্থাপনা-সংক্রান্ত বিতর্ক ও বাস্তব ক্ষতির ঘটনা তালিকাবদ্ধ করুন এবং সেগুলো নিয়মকানুন বা মামলায় গড়ায় কি না দেখুন।
- পরবর্তী X ও Reddit সংগ্রহে Stable Diffusion, Flux, ComfyUI, Wan ও Qwen-এর মতো সুস্পষ্ট ওপেন-সোর্স টার্ম যোগ করুন।
- Pinterest-কে ওপেন-সোর্সের সূচক হিসেবে নয়, ভোক্তামুখী ক্লোজড টুলের জনপ্রিয়তার বিশেষ উৎস হিসেবে ব্যবহার করুন।
সংগৃহীত ছবি


















































ডেটার গুণমান সংক্রান্ত নোট
Bluesky 12টি কুয়েরিতে 200-এর বেশি পোস্ট নিয়ে লক্ষ্যকে অনেকটাই ছাড়িয়েছে। কিন্তু Reddit (12টি), X (7–8টি; ক্রোয়েশিয়া-নির্দিষ্ট অঞ্চলের কারণে ওপেন-সোর্স উল্লেখ শূন্য) এবং Lemmy (প্রায় 9টি) প্রায় 20টির সমাপ্তি-মানদণ্ডে পৌঁছায়নি। YouTube-এ JavaScript রেন্ডারিংয়ের সীমাবদ্ধতায় ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।



