KEN’S CAT LOG

ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-26

OpenAI যখন 2026 সালের 24 সেপ্টেম্বর Sora/Videos API পুরোপুরি বন্ধ করে দিচ্ছে, তখন Alibaba-র ওপেন-ওয়েট মডেল Wan 3.0 ও Qwen-Image 2.1 দ্রুত ইকোসিস্টেমে ছড়িয়ে পড়ছে। ক্লোজড মডেলের পুনর্গঠন এবং ওপেন মডেলের উত্থান একসঙ্গেই চলছে।

ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-26

সত্যিই পাগলাটে একটা সপ্তাহ ছিল 😤🔥 সবচেয়ে বড় খবর হলো OpenAI সত্যি সত্যিই Sora গুটিয়ে ফেলেছে। অ্যাপ ও Videos API দুটোই 2026 সালের 24 সেপ্টেম্বর পুরোপুরি বন্ধ—কোনো উত্তরসূরি ঘোষণাও নেই, বেশ পরিষ্কার সিদ্ধান্ত(?)। অন্যদিকে ওপেন-সোর্স শিবিরে Alibaba-র Wan 3.0 আর Qwen-Image 2.1 অবিশ্বাস্য গতিতে দৃশ্যপট বদলে দিচ্ছে। ক্লোজড পক্ষ যখন দাম কমানো আর সরে যাওয়ার মাধ্যমে প্রতিরক্ষামূলক অবস্থানে, ওপেন পক্ষ তখন আক্রমণাত্মকভাবে এগোচ্ছে 📈 মোটের ওপর সপ্তাহটি ছিল: “ক্লোজডে বাছাই ও পুনর্গঠন, ওপেনে ঝড়ের গতির রিলিজ রাশ।”

বিভিন্ন প্ল্যাটফর্ম জুড়ে

  • Qwen-Image 2.1 (Alibaba-র তৈরি, ওপেন) একসঙ্গে একাধিক প্ল্যাটফর্মে ছড়িয়েছে: Reddit (r/StableDiffusion-এ ইমেজ এডিটিংয়ের মানক পছন্দ হিসেবে সুপারিশ), Bluesky (7B প্যারামিটার ও 60.2 স্কোরের নির্দিষ্ট বেঞ্চমার্ক, প্রকাশের পরপরই ComfyUI পোর্ট), Lemmy (dbzer0 কমিউনিটিতে সেই একই ComfyUI অফিসিয়াল সাপোর্টের খবর)—তিনটি প্ল্যাটফর্মই প্রায় একই সময়ে (9/22–9/25) একই গতিবিধি দেখেছে। এটি এখনকার সবচেয়ে আলোচিত ওপেন মডেল বলেই বোঝা যায় 🔥
  • ভিডিওর ওপেন স্ট্যান্ডার্ড = MiniMax H3: Reddit-এ (r/StableDiffusion-এ “ভিডিওর জন্য Minimax H3” নিয়ে ঐকমত্য), Lemmy-তে (ComfyUI টুল ও প্রম্পট বিল্ডারের এক সপ্তাহে 5টির বেশি পোস্ট), Bluesky-তে (স্বতন্ত্র নির্মাতারা ComfyUI দিয়ে পরীক্ষা-নিরীক্ষা করছেন)—তিন জায়গাতেই একই চিত্র। ওপেন ভিডিও জেনারেশনের প্রধান মডেল বদল রিয়েল টাইমে ঘটছে 👀
  • Krea 2, Z-Image Turbo-র কাছ থেকে সিংহাসন নিয়েছে: Reddit-এ “Z-Image Turbo এখন পুরোনো” মন্তব্যের আধিক্য এবং Lemmy-তে Krea2 দ্রুততর করার LoRA-র দুটি পোস্ট একই ইঙ্গিত দেয়। ওপেন ইমেজ মডেলের পালাবদল সত্যিই দ্রুত ⚡
  • Sora-র পূর্ণ বন্ধ হওয়া নিয়ে প্রায় শুধু Bluesky-তেই আলোচনা: Reddit, X, YouTube, Lemmy ও Pinterest-এ এই বড় খবর প্রায় পুরোপুরি উপেক্ষিত হয়েছে। Lemmy-তে কেবল মার্চের পুরোনো ঘোষণার পুনঃপ্রকাশ আছে; 24 সেপ্টেম্বরের প্রকৃত বন্ধের খবর একটিও নেই। মাত্র একটি প্ল্যাটফর্মে যাচাই হওয়া হলেও এর প্রভাব বড়, তাই সতর্ক থাকা দরকার ⚠️
  • DeepSeek × Huawei Ascend-র একই অবকাঠামোগত গল্প দুই দিক থেকে দেখা গেছে: Reddit বলছে DeepSeek কম্পিউট রিসোর্সের ঘাটতিতে Ascend 960DT-এর 160,000 ইউনিট অর্ডার করেছে। Bluesky বলছে Huawei Ascend-এর Modelers.cn-এ SDXL/FLUX LoRA ব্যাপকভাবে তৈরি হচ্ছে, যদিও মান অসমান। চীনা ক্লোজড ও ওপেন—দুই দিকের AI-ই Ascend চিপের উপর নির্ভরশীল হয়ে উঠছে; একই ভূমিকম্পের দুই দৃষ্টিভঙ্গি 💡
  • “AI-তৈরি জিনিসকে বাস্তব বলে ব্যবহার” করার বিরুদ্ধে প্রতিক্রিয়া বিভিন্ন জায়গায় বাস্তব ঘটনার রূপ নিয়েছে: Reddit-এ মাইক্রোস্কোপ প্রতিযোগিতায় AI-সম্পাদনা ধরা পড়া, রিয়েল-এস্টেটের AI ভুয়া ছবি, AI ছবি ব্যবহারের কারণে CEO-র চাকরি যাওয়া; Pinterest-এ NBC News-ধাঁচের AI অ্যাঙ্কর ভিডিওতে “AI GENERATED” ব্যাজ এবং সত্য-মিথ্যার সীমা নিয়ে উদ্বেগ; Lemmy-র সাধারণ কমিউনিটিতে AI নির্ভরতা ও ডেটাসেন্টারের বিদ্যুৎ ব্যবহারের সমালোচনা। বিমূর্ত বিতর্ক নয়, বাস্তব ক্ষতি ও বিতর্কের উদাহরণ জমছে 😬

প্ল্যাটফর্মভিত্তিক

Reddit — 9টি সাবরেডিটের 12টি থ্রেড বিশ্লেষণ করা হয়েছে। বিশেষায়িত সাবগুলোতে (r/StableDiffusion) Krea 2, Qwen-Image 2.1, Minimax H3 ও SenseNova-U1.5 দ্রুত মানক পছন্দ হয়ে উঠেছে। অন্যদিকে সাধারণ সাবগুলোতে AI-তৈরি কনটেন্টের বিরাগ “চাকরিচ্যুতি” ও “রিপোর্ট” পর্যায়ের বাস্তব ক্ষতির ঘটনায় পরিণত হওয়ার আলোচনা বেশি। তবে সংগ্রহ একটিমাত্র সার্চ টার্মে সীমিত ছিল এবং 20টির লক্ষ্য পূরণ হয়নি—থেমেছে 12টিতে।

X — সেশনের অবস্থান ক্রোয়েশিয়ায় স্থির থাকায় Explore ট্রেন্ডের সঙ্গে বিষয়টির প্রায় কোনো সম্পর্ক ছিল না—10টির 8টি শব্দই অপ্রাসঙ্গিক। শেষ পর্যন্ত মাত্র 7–8টি প্রাসঙ্গিক পোস্ট পাওয়া যায়, তাই লক্ষ্য অপূর্ণ। তবে পাওয়া পোস্টগুলো আকর্ষণীয়: Claude Opus 5.5-কে কেন্দ্র করে GPT Images, Grok ও Gemini TTS মিলিয়ে “মাল্টি-টুল পাইপলাইন” ভিডিও নির্মাণ, এবং Claude Code-কে উপকরণ সংগ্রহ থেকে সম্পাদনা ও সঙ্গীত নির্বাচন পর্যন্ত স্বয়ংক্রিয়ভাবে করানো “ভিডিও প্রোডাকশন এজেন্ট” ধরনের ব্যবহার বারবার দেখা গেছে। ওপেন-সোর্স বিষয়ে কোনো উল্লেখ ছিল না।

YouTube — Sora 2 বনাম Veo 3.1, Seedance 2.5 বনাম Kling 3.0 বনাম Minimax H3 বনাম Google Omni—এ ধরনের বহু-মডেলের পাশাপাশি তুলনা ক্লোজড পক্ষের প্রধান ফরম্যাট। ওপেন দিকে LTX-2.5, Lightricks-এর 22B প্যারামিটারের ওপেন-ওয়েট ভিডিও+অডিও মডেল, ঘোষণার মাত্র এক সপ্তাহের মধ্যে ComfyUI পরীক্ষার ভিডিও পেয়েছে। Z-Image Turbo-কে Nano Banana Pro-র বিনামূল্যের বিকল্প হিসেবে একাধিক চ্যানেল তুলে ধরেছে। তবে JavaScript রেন্ডারিংয়ের কারণে ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।

Bluesky — 12টি কুয়েরি ও 200-এর বেশি পোস্ট বিশ্লেষণ করে এইবার সবচেয়ে বেশি ফল মিলেছে এখানে। ক্লোজড দিকের প্রধান খবর: Sora-র পূর্ণ বন্ধ হওয়া—Disney-র সঙ্গে 1 বিলিয়ন ডলারের অংশীদারত্ব ভেঙে যাওয়াসহ, Google Veo-র চার গুণ দাম কমানো, এবং Nano Banana 2.5 Flash-এর লিকের চিহ্ন। ওপেন দিকে Wan 3.0—Alibaba-র 10 বিলিয়ন ডলারের শেয়ার বিক্রির পরপর লঞ্চ, মানব মূল্যায়নে ক্লোজড প্রতিদ্বন্দ্বীদের পেছনে ফেলা—Qwen-Image 2.1-এর বেঞ্চমার্ক ও তাৎক্ষণিক ComfyUI ইন্টিগ্রেশন, এবং stable-diffusion.cpp (★7,148)-এর GitHub Trending-এ আসা উল্লেখযোগ্য ছিল।

Lemmy — কিওয়ার্ড সার্চে প্রচুর নয়েজ থাকায় দ্রুত বিশেষায়িত কমিউনিটি সরাসরি ব্রাউজ করার পদ্ধতিতে যাওয়া হয়। ফল: পুরোপুরি ওপেন-সোর্সকেন্দ্রিক—Qwen-Image 2.1, Krea2 LoRA, MiniMax H3 টুল, LTX-2.5 LoRA, এবং বিকেন্দ্রীকৃত বিনামূল্যের জেনারেশন অবকাঠামো AI Horde। বিপরীতে Sora বন্ধ, Veo মূল্যছাড়, Grok Imagine-এর মতো ক্লোজড খবর টার্গেটেড সার্চেও সেপ্টেম্বরে একটিও মেলেনি; এই “নিস্তব্ধতা” নিজেই একটি পর্যবেক্ষণ। প্রাসঙ্গিক পোস্ট প্রায় 9টি, 20টির লক্ষ্য পূরণ হয়নি।

Pinterest — 50টি আইটেম সংগ্রহ, তার মধ্যে 20টি বিস্তারিত পাঠ। Runway, Pika, Kling, Luma, Hailuo, Veo ও Sora-কে একত্রে দেখানো “best AI video tool” ধরনের তালিকাই পুরোপুরি প্রভাবশালী। AI সংবাদ-ধাঁচের থাম্বনেইল—চমকে ওঠা দাড়িওয়ালা পুরুষ ও লোগো গ্রিড—এবং AI অ্যাঙ্কর নিয়ে বিশ্বাসযোগ্যতার উদ্বেগও চোখে পড়ে। বিপরীতে Stable Diffusion, Flux, ComfyUI, Wan, Hunyuan-এর মতো ওপেন-সোর্স মডেলের নাম নমুনার একটিতেও আসেনি। Pinterest স্পষ্টতই “আয় করা যায় এমন, ভোক্তামুখী ক্লোজড টুল”-কেন্দ্রিক।

নজরে রাখুন

  • Sora-র পূর্ণ বন্ধের প্রভাব (Bluesky) — https://bsky.app/profile/knowmouth.bsky.social/post/3mwckivdpkk2y → Disney-র সঙ্গে অংশীদারত্ব ভেঙে যাওয়াসহ, বড় ক্লোজড পরিষেবাও লাভজনক না হলে দ্রুত বন্ধ হয়ে যেতে পারে—এমন নজির।
  • Wan 3.0 মানব মূল্যায়নে ক্লোজড মডেলকে ছাড়িয়ে গেছে (Bluesky) — https://bsky.app/profile/oludai.bsky.social/post/3mweo2rmjo424 → ওপেন-ওয়েট মডেল কি এখন গুণমানেও জিততে পারে—তার সম্ভাব্য মোড়বদল।
  • Qwen-Image 2.1-এর একই দিনে ComfyUI ইন্টিগ্রেশন (Lemmy) — https://lemmy.dbzer0.com/post/75874773 → প্রকাশ থেকে ইকোসিস্টেমে অন্তর্ভুক্তির সময় ক্রমশ কমছে—তার প্রমাণ।
  • Nano Banana 2.5 Flash-এর লিকের চিহ্ন (Bluesky) — https://bsky.app/profile/coreati.bsky.social/post/3mwbwh5p7mj2e → Google-এর পরবর্তী পদক্ষেপ হিসেবে ইমেজ জেনারেশনের মূল প্রতিযোগিতার ক্ষেত্র হতে পারে।
  • DeepSeek-এর কম্পিউট সংকট ও Ascend চিপের বড় অর্ডার (Reddit) — https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ → চীনা ক্লোজড AI-র বৃদ্ধিজনিত সংকট এবং Huawei চিপের উপর নির্ভরতার ইঙ্গিত।
  • Claude Code দিয়ে “ভিডিও প্রোডাকশন এজেন্ট” ব্যবহার (X) — https://x.com/bond_ai1/status/2103374441250259316 → শুধু জেনারেশনের চেয়ে সম্পাদনা ও অটোমেশনের স্বয়ংক্রিয়তা পরের প্রতিযোগিতার ক্ষেত্র হয়ে উঠতে পারে।

সুপারিশ

  • Wan 3.0 ও Qwen-Image 2.1-এর গ্রহণের গতি নিয়মিত পর্যবেক্ষণ করুন; ওপেন বনাম ক্লোজডের গুণগত উলটপালট স্থায়ী হয় কি না নির্ধারণ করুন।
  • Google Veo-র মূল্যছাড় এবং Nano Banana 2.5-এর অগ্রগতি অনুসরণ করুন; Sora প্রত্যাহারের পর মূল্য প্রতিযোগিতা কতদূর ত্বরান্বিত হয় দেখুন।
  • Reddit-উৎসারিত “AI-তৈরি জিনিসকে বাস্তব হিসেবে ব্যবহার” সংক্রান্ত বিতর্ক ও ক্ষতির ঘটনা—মাইক্রোস্কোপ প্রতিযোগিতা, রিয়েল-এস্টেট, CEO চাকরিচ্যুতি—তালিকাবদ্ধ করে নিয়মকানুন ও মামলার দিকে গড়ায় কি না পর্যবেক্ষণ করুন।
  • পরের X ও Reddit সংগ্রহে “Stable Diffusion”, “Flux”, “ComfyUI”, “Wan”, “Qwen”-এর মতো স্পষ্ট ওপেন-সোর্স সার্চ টার্ম যোগ করে এইবারের শূন্যতার ফাঁক পূরণ করুন।
  • Pinterest-কে ওপেন-সোর্স প্রবণতার সূচক হিসেবে ব্যবহার না করে, ভোক্তামুখী ক্লোজড টুলের “এখন কী বিকোচ্ছে” বোঝার বিশেষ উৎস হিসেবে নিন।
  • Bluesky-তে XRPC-তে সরাসরি (api.bsky.app-এর app.bsky.feed.searchPosts) অনুসন্ধান অন্য প্ল্যাটফর্মের তুলনায় অনেক বেশি ফল দিয়েছে; ভবিষ্যতের মানক সংগ্রহপদ্ধতিতে এটিকে অগ্রাধিকার দিন।

ডেটার গুণমান

Bluesky 12টি কুয়েরিতে 200-এর বেশি পোস্ট সংগ্রহ করে লক্ষ্যকে বড় ব্যবধানে ছাড়িয়েছে। বিপরীতে Reddit ও Lemmy প্রায় 20টি পোস্টের লক্ষ্যে পৌঁছাতে পারেনি—যথাক্রমে 12 ও প্রায় 9টি। Lemmy-র ক্ষেত্রে সার্চ API-র নয়েজ ও প্ল্যাটফর্মের ছোট আকার এর কারণ। X-এ Explore অঞ্চল ক্রোয়েশিয়ায় স্থির ছিল এবং 10টি সার্চ টার্মের 8টিই বিষয়বহির্ভূত; মাত্র 7–8টি প্রাসঙ্গিক পোস্ট ও শূন্য ওপেন-সোর্স উল্লেখ থাকায় এটিই সবচেয়ে নিম্নমানের ডেটা। YouTube-এ JavaScript রেন্ডারিংয়ের কারণে ভিউ, সাবস্ক্রাইবার ও প্রকাশের সময় পাওয়া যায়নি, তাই পরিমাণগত তুলনা সম্ভব নয়। Pinterest-এ Sora-র পূর্ণ বন্ধের মতো সেপ্টেম্বরের সর্বশেষ খবর ধরা পড়েনি; 50টির মধ্যে কেবল 20টি বিস্তারিত পাঠ করা হয়েছে এবং ওপেন-সোর্সের অনুপস্থিতি সার্চ-কুয়েরি পক্ষপাতও হতে পারে।

প্ল্যাটফর্মভিত্তিক সারাংশ

Reddit

Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ

কোথায়

সংগৃহীত 12টি থ্রেড 9টি সাবরেডিট থেকে এসেছে:

সাবরেডিট সদস্যসংখ্যা সংগৃহীত থ্রেড
r/mildlyinfuriating 12,595,406 জন 1টি
r/WhitePeopleTwitter 3,145,649 জন 1টি
r/StableDiffusion 1,025,554 জন 1টি
r/labrats 726,754 জন 1টি
r/antiai 339,499 জন 1টি
r/generativeAI 157,118 জন 4টি
r/DeepSeek 141,262 জন 1টি
r/GenAI4all 48,605 জন 1টি
r/aivideomaking 7,735 জন 1টি

বড় সাধারণ সাবগুলো (mildlyinfuriating, WhitePeopleTwitter) AI-তৈরি কনটেন্ট নিয়ে বিরাগ ও বিতর্ককেন্দ্রিক। বিশেষায়িত সাবগুলো (StableDiffusion, generativeAI, aivideomaking, DeepSeek, GenAI4all) টুল তুলনা ও প্রযুক্তিগত বিষয়ে কেন্দ্রীভূত। r/antiai নামের মতোই AI-বিরোধী অবস্থান থেকে পোস্ট করে।

মানুষ কী বলছে
  • থ্রেড #1 (r/labrats, 1,101 পয়েন্ট, 131 মন্তব্য, 2026-09-23): https://www.reddit.com/r/labrats/comments/1wo0j5e/ — Nikon Small World in Motion মাইক্রোস্কোপ ইমেজ প্রতিযোগিতায় প্রথম হওয়া ভিডিওটিকে AI দিয়ে “উন্নত” করা হয়েছিল বলে ধরা পড়ে। পোস্টদাতা বলেন, “সিলিয়া হঠাৎ মিলিয়ে যায়, নীল গঠনগুলো—যা নিউক্লিয়াসের মতো—মুহূর্তে স্থান বদলায়; জীববৈজ্ঞানিকভাবে অসম্ভব।” শীর্ষ মন্তব্যকারী u/Barkinsons (629 পয়েন্ট) বলেন, “বৈজ্ঞানিক মাইক্রোস্কোপ ইমেজে AI টুলের কোনো জায়গা নেই।”
  • থ্রেড #3 (r/mildlyinfuriating, 26,941 পয়েন্ট, 722 মন্তব্য, 2026-09-21): https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ — রিয়েল-এস্টেট ভিউয়িং ছবিতে AI-তৈরি “ইমেজ” ব্যবহারের সমস্যা। পোস্টদাতা বলেন রেডিয়েটর মুছে ফেলা হয়েছে, ফলে বাস্তবে সেই স্টেজিং পুনর্নির্মাণ করা যাবে না। u/BojackWorseman13 (1,141 পয়েন্ট) বলেন, “এজেন্টের সামাজিক মাধ্যমে অভিযোগ করা উচিত; এগুলো AI-তৈরি—এ কথা বড় করে লেখা উচিত।”
  • থ্রেড #9 (r/antiai, 18,728 পয়েন্ট, 634 মন্তব্য, 2026-09-23): https://www.reddit.com/r/antiai/comments/1wnrfi6/ — Dreamworks তাদের নতুন চলচ্চিত্র “Forgotten Island”-এ “এই কনটেন্ট AI প্রশিক্ষণে ব্যবহার নিষিদ্ধ” ডিসক্লেইমার যোগ করেছে বলে খবর। তবে সর্বাধিক ভোট পাওয়া u/SlowlyDyingInAPit (2,586 পয়েন্ট) ঠান্ডা প্রতিক্রিয়ায় বলেন, “AI পক্ষ তবু উপেক্ষা করে ব্যবহার করবে; সবসময়ই তাই করেছে।” u/Arckanoid (145 পয়েন্ট) বিশ্লেষণ করেন, “বন্ধ করার চেয়ে মামলা করার ভিত্তি তৈরিই সম্ভবত উদ্দেশ্য।”
  • থ্রেড #11 (r/WhitePeopleTwitter, 470 পয়েন্ট, 56 মন্তব্য, 2026-09-25): https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/ — “Lake America” সোয়েটারের AI-তৈরি ছবি ব্যবহারের কারণে এক CEO বরখাস্ত হওয়ার ঘটনা। u/samanime (236 পয়েন্ট) বলেন, “এ রকম বোকারা আরও ভুগলে এমন ঘটনা কমবে।” AI-তৈরি কনটেন্টের কর্পোরেট ব্যবহারে বাস্তব চাকরিচ্যুতির বিরল উদাহরণ।
  • থ্রেড #5 (r/DeepSeek, 314 পয়েন্ট, 51 মন্তব্য, 2026-09-21): https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ — DeepSeek-এর DAU 120 মিলিয়ন থেকে 200 মিলিয়নে (+66.7%) উঠলেও কম্পিউট রিসোর্স বেড়েছে মাত্র +8.3%; এটি মান কমা ও পুনরায় জেনারেশনের সমস্যার কারণ বলে বিশ্লেষণ। একই পোস্টে Huawei থেকে DeepSeek-এর Ascend 960DT-এর 160,000 ইউনিট অর্ডারের তথ্যও আছে। u/Equivalent-Grass-527 (14 পয়েন্ট): “চাহিদা ও কম্পিউট রিসোর্সের অমিলই সাম্প্রতিক অবনতির সবচেয়ে যুক্তিসংগত ব্যাখ্যা।”
  • থ্রেড #12 (r/StableDiffusion, 0 পয়েন্ট, 19 মন্তব্য, 2026-09-25): https://www.reddit.com/r/StableDiffusion/comments/1wpr4uf/ — বর্তমান সেরা ওপেন-সোর্স/লোকাল মডেল নিয়ে প্রশ্ন। মন্তব্যের ঐকমত্য: ইমেজ জেনারেশন = Krea 2; আগের Z-Image Turbo থেকে বদলানোর পরামর্শে একাধিক জন একমত। ইমেজ এডিটিং = Qwen-Image 2.1; u/Jackkgold বাণিজ্যিক ব্যবহারে লাইসেন্স খেয়াল করতে বলেন। ভিডিও = Minimax H3। u/Cultural-Broccoli-41, Apache-2.0 লাইসেন্সের শক্তিশালী ইমেজ এডিটিং মডেল হিসেবে SenseNova-U1.5 উল্লেখ করেন।
  • থ্রেড #4 (r/generativeAI, 7 পয়েন্ট, 38 মন্তব্য, 2026-09-23): https://www.reddit.com/r/generativeAI/comments/1wog53q/ — “দীর্ঘ AI ভিডিও কীভাবে বানাব?” প্রশ্নে u/kaboom-o (2 পয়েন্ট) ব্যবহারিক ওয়ার্কফ্লো ব্যাখ্যা করেন: কেউ এক শটে দীর্ঘ ভিডিও বানায় না; স্ক্রিপ্ট → 5–15 সেকেন্ডের ক্লিপ জমা → সম্পাদনাই প্রচলিত। মুখ দীর্ঘক্ষণ ধরে রাখতে Seedance 2.5, সস্তা মোশন ড্রাফটের জন্য Grok Imagine Video, বাস্তবধর্মিতার জন্য Gemini Omni Flash ব্যবহার করেন। u/AlfieSchmalfie (2 পয়েন্ট) 12 মিনিট, 148 শট, 8 সপ্তাহ, আনুমানিক 1,000 AUD-এ সম্পন্ন প্রকল্পের উদাহরণ দেন।
  • থ্রেড #8 (r/GenAI4all, 165 পয়েন্ট, 63 মন্তব্য, 2026-09-24): https://www.reddit.com/r/GenAI4all/comments/1wou5vb/ — 2024 সালে ভাইরাল হওয়া AI ভিডিও নিয়ে ফিরে দেখা। u/MinosAristos (7 পয়েন্ট) বলেন, “সিন্থেটিক মিডিয়ার দুর্বলতাকে শক্তি হিসেবে ব্যবহার করেছে; ভিডিওটি সত্যিই সিনেমা”—বর্তমান ও তখনকার মানের ফারাক নিয়ে আলোচনা।
  • থ্রেড #2, #6, #7, #10 (সবগুলো r/generativeAI/r/aivideomaking, 2–17 পয়েন্ট, 2026-09-19–22): একই ধরনের “বিনামূল্যের AI ভিডিও জেনারেশন টুল চাই” প্রশ্ন প্রায় একই ভাষায় বারবার পোস্ট হয়েছে (r/aivideomaking https://www.reddit.com/r/aivideomaking/comments/1wled0f/ , r/generativeAI https://www.reddit.com/r/generativeAI/comments/1wlec1u/ অন্যান্য)। উত্তরে একদল বলেন “ফ্রি বলে কিছু নেই, কম্পিউট রিসোর্স বিনা মূল্যের নয়”; আরেকদল Muse, Meta, Nanobanana/Veo, dreamfort.ai/video-সহ বিনামূল্যের টুল ও ফ্রি-টিয়ারের নাম দেন। অটো-রিপ্লাই বট u/Jenna_AI বারবার ব্যঙ্গ করে বলে, “H100 ফ্রি চালাতে পারবে ভেবো না।”
সংকেত
  • ঊর্ধ্বমুখী প্রবণতা: r/StableDiffusion-এ Krea 2, Qwen-Image 2.1, Minimax H3 এবং SenseNova-U1.5 অল্প সময়েই নিয়মিত পছন্দ হয়ে উঠেছে। “Z-Image Turbo এখন পুরোনো”—এমন একাধিক মন্তব্য মডেল পরিবর্তনের দ্রুত গতি দেখায়।
  • AI-বিরোধী আবেগ বাস্তব রূপ নিচ্ছে: r/antiai, r/mildlyinfuriating এবং r/WhitePeopleTwitter-এ শুধু অসন্তোষ নয়—চাকরিচ্যুতি, রিপোর্ট, প্রশিক্ষণ নিষিদ্ধের আইনি পদক্ষেপের মতো বাস্তব কর্মকাণ্ডে রূপ নেওয়া দেখা যায়। প্রতিক্রিয়া বিমূর্ত বিতর্ক থেকে সামাজিক ব্যয়ের আলোচনায় যাচ্ছে।
  • ক্লোজড-সোর্সের চাপ: DeepSeek থ্রেড দেখায়, কম্পিউট ঘাটতিতে মান কমার মতো বৃদ্ধিজনিত সমস্যায় বড় ক্লোজডধাঁচের পরিষেবার সীমাবদ্ধতা।
  • মতবিরোধ: থ্রেড #9-এ Dreamworks-এর প্রশিক্ষণ-নিষেধ শর্তকে বড় জয় বলা হলেও, সর্বোচ্চ ভোট পাওয়া মন্তব্যে বলা হয়েছে AI পক্ষ তাতে কিছুই বদলাবে না। একই আলোচনায় স্পষ্ট মতভেদ।
  • অবহেলা না করার মতো “তুচ্ছ” চাহিদা: “বিনামূল্যের AI ভিডিও টুল চাই” ধরনের পুনরাবৃত্ত পোস্ট চারটির মধ্যে চারটিই একই বিষয় নিয়ে। এগুলোই সম্ভবত সবচেয়ে বড় বাস্তব চাহিদার অংশ এবং তার চারপাশে অটো-রিপ্লাই বটের ব্যঙ্গসংস্কৃতি গড়ে উঠেছে।
  • অপ্রত্যাশিত বিষয়: Nikon Small World in Motion-এর মতো AI-বহির্ভূত মর্যাদাপূর্ণ বৈজ্ঞানিক প্রতিযোগিতায় AI সম্পাদনা ঢুকে পড়ে, আর কমিউনিটি নিজেই তা যাচাই ও প্রকাশ করে। ওপর থেকে নিয়ম আরোপের আগে বিশেষজ্ঞ কমিউনিটির আত্মশুদ্ধির উদাহরণ।
সীমাবদ্ধতা
  • সার্চ টার্ম ছিল কেবল “Image and Video Generation AI News”; ফলে 9টি সাবরেডিটের 12টি থ্রেড পাওয়া গেছে। Krea, Qwen, Seedance, Sora, “open source diffusion”, “closed source video AI” ইত্যাদি দিয়ে বাড়তি অনুসন্ধান করলে আরও ফল মিলতে পারত, কিন্তু হাতে কেবল এই এক টার্মের ডেটা ছিল।
  • এ পর্যায়ে হেডলেস ব্রাউজার দিয়ে আগে সংগৃহীত ডেটা শুধু পড়া হয়েছে; Reddit-এ অতিরিক্ত অ্যাক্সেস, সার্চ বা প্রতিটি থ্রেডের শীর্ষ 6টির বেশি মন্তব্য দেখা সম্ভব ছিল না।
  • থ্রেড #8 ও #11-এর মূল লেখা সংক্ষিপ্ত বা অনুপস্থিত ছিল; শিরোনাম ও শীর্ষ মন্তব্য থেকে উদ্দেশ্য অনুমান করা হয়েছে।
  • DeepSeek থ্রেডে উল্লেখিত nbd.com.cn ও ntdtv.com-এর বাইরের নিবন্ধের উপস্থিতি Reddit পোস্টের লিংক হিসেবে নিশ্চিত করা হয়েছে, কিন্তু এই run-এ নিবন্ধগুলো পড়া হয়নি।

X

X — ছবি ও ভিডিও জেনারেশন AI সংবাদ

Explore ট্রেন্ড এই সেশনে সংযুক্ত সার্ভারের অবস্থানের ভিত্তিতে ক্রোয়েশিয়া-কেন্দ্রিক ছিল—8টির মধ্যে 7টিতে “Trending in Croatia” দেখা যায়। ফলে এটি বিশ্বব্যাপী ট্রেন্ড তালিকা নয়। সার্চ করা 10টি শব্দ ছিল “Taylor”, “#sweepstakes”, “#giveaways”, “#chance”, “Opus 5.5”, “Slovenia”, “Italy”, “Cardano”, “Croatia”, “Claude”; এর মধ্যে কেবল “Opus 5.5” ও “Claude” ইমেজ/ভিডিও জেনারেশন AI-সংশ্লিষ্ট। বাকি 8টি শব্দ বিষয়বহির্ভূত ফল দিয়েছে। নিচে শুধু প্রাসঙ্গিক পোস্টগুলোর বিশ্লেষণ আছে।

অ্যাকাউন্ট

এই বিষয়ের পোস্টে বড় ফলোয়ারসংখ্যার একক কোনো উৎস প্রবলভাবে নেতৃত্ব দেয়নি; জাপানি AI নির্মাতাদের ব্যক্তিগত অ্যাকাউন্ট থেকে পৃথক পৃথক পোস্ট এসেছে।

  • @aiehon_aya (妖精アーヤ) — 1টি পোস্টে 1,594 লাইক ও 143 রিপোস্ট। Claude Opus5.5 দিয়ে মোশন গ্রাফিক্স তৈরির প্রক্রিয়া—HTML → প্রতিটি ফ্রেম আঁকা → Python-এ ভিডিও বানানো—ব্যাখ্যা করেছে। Opus 5.5-সংক্রান্ত পোস্টে সর্বাধিক লাইক।
  • @sankakuten91256 (さんかくてん) — 1টি পোস্টে 1,159 লাইক ও প্রায় 57,000 ভিউ। একাধিক জেনারেটিভ AI-কে মিলিয়ে পাইপলাইন পরিচিতি।
  • @mmmiyama_D (ミヤマ), @rotejin (ろてじん), @seiiiiiiiiiiru (SEIIIRUAI ব্যবহারকারী ভিডিও নির্মাতা) — প্রত্যেকের 1টি করে পোস্টে কয়েকশ লাইক। Claude Code বা Opus 5.5 দিয়ে ব্যক্তিগত ভিডিও, Live2D মোশন এবং AI বিজ্ঞাপন ভিডিও তৈরির প্রদর্শন।
  • @bond_ai1 ও @ponzponz15 — AI-ভিত্তিক আয় ও ব্যবহার-কৌশল বিষয়ক অ্যাকাউন্ট; Claude Code দিয়ে ভিডিও সম্পাদনার অটোমেশন টুল তুলে ধরেছে।
  • এই বিষয়ে বহু পোস্টে কম লাইক পাওয়া কোনো অ্যাকাউন্ট ছিল না; প্রত্যেকের ধরন “একটি পোস্ট, মাঝারি প্রতিক্রিয়া।” একক ভাইরাল পোস্ট না থাকলেও বিশেষায়িত, ধারাবাহিক প্রদর্শনের চিত্র দেখা যায়।
পোস্ট
  1. #17 @sankakuten91256 — 1,159 likes, 102 reposts, 13 replies, প্রায় 57,000 views, 2026-09-25
    https://x.com/sankakuten91256/status/2103483923783373039

    Opus 5.5はこんなこともできるのか GPT Images 2.5 で9分割のダンスの画像を作成 Grokでグリーンバックのダンス動画 Opus 5.5でモーショングラフィックス Astraで音の差し替え
    → একটি কাজে GPT Images 2.5, Grok, Opus 5.5 ও Astra-কে ভূমিকা অনুযায়ী একত্রে ব্যবহার করা “মাল্টি-টুল স্ট্যাক” ওয়ার্কফ্লো। একক মডেলের বদলে বহু ক্লোজড টুলের সমন্বয়ই ট্রেন্ড।

  2. #18 @seiiiiiiiiiiru — 554 likes, 75 reposts, 29 replies, প্রায় 45,000 views, 2026-09-24
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    AI広告動画 → AI音声 × AI編集 もうここがゴール地点ってことでいいでしょ。笑 Cluad Opus 5.5にGemini 3.8 Flash TTSでナレーション生成させて…
    → AI ভয়েস ও AI এডিটিংকে বিজ্ঞাপন ভিডিও নির্মাণের গন্তব্য হিসেবে উপস্থাপন করা হয়েছে। Claude Opus 5.5 ও Gemini 3.8 Flash TTS মেলানো বাস্তব উৎপাদনের উদাহরণ।

  3. #19 @mmmiyama_D — 632 likes, 41 reposts, 15 replies, প্রায় 75,000 views, 2026-09-25
    https://x.com/mmmiyama_D/status/2103384986661671058

    プロンプト一撃の方が出来が良くて、ちょっと悲しい… Claude CodeのOpus 5.5で15秒の自己紹介動画も作りました。フォントは勝手にダウンロード、音楽までいい感じに作ってくれた〜!!!
    → Claude Code (Opus 5.5) নিজে ফন্ট ডাউনলোড ও সঙ্গীত নির্বাচন করেছে—এটি বিস্ময়ের সঙ্গে শেয়ার করা হয়েছে। “ভিডিও জেনারেশন” নয়, বরং “ভিডিও প্রোডাকশন এজেন্ট” হিসেবে ব্যবহার।

  4. #20 @rotejin — 435 likes, 57 reposts, 8 replies, প্রায় 37,000 views, 2026-09-25
    https://x.com/rotejin/status/2103384608301830297

    Claude Codeに「新しいモーションを追加して」と頼むだけでLive2Dモーションを追加できるツールを使わせてもらいました…使ったモデルはOpus 5.5のxhigh。
    → ইমেজ বা ভিডিও জেনারেশন নয়; Claude Code দিয়ে Live2D মোশন—হাই তোলা, হাঁচি—স্বয়ংক্রিয়ভাবে যোগ করার টুলের প্রদর্শন। “xhigh” Opus 5.5 রিজনিং স্তরের উল্লেখ নতুনত্বপূর্ণ।

  5. #37 @ponzponz15 — 226 likes, 17 reposts, 7 replies, প্রায় 35,000 views, 2026-09-24
    https://x.com/ponzponz15/status/2102931824918106499

    3Dカメラ×立体テキスト演出② After Effectsで作るような編集がClaude OpusやCodexでも可能に。 上 Seedance 2.5 prev 下 Codex + Hyperframes skill
    → Seedance 2.5 ভিডিও জেনারেশন এবং Codex + Hyperframes skill-এর সমান্তরাল তুলনা। After Effects-সমমানের উপস্থাপনা কোড-জেনারেশন AI দিয়ে প্রতিস্থাপনের প্রবণতা।

  6. #38 @aiehon_aya — 1,594 likes, 143 reposts, 12 replies, প্রায় 95,000 views, 2026-09-25
    https://x.com/aiehon_aya/status/2103403361022419005

    Claude Opus5.5 モーショングラフィックス 天才Opus5.5にどうやって作ったのか説明させてみた…index.html→1コマずつ描かせる→render.pyで動画ファイルに
    → Opus 5.5-সংক্রান্ত পোস্টে সর্বোচ্চ লাইক। ইমেজ মডেল না ব্যবহার করে, ছবি আঁকার কোড লিখিয়ে ফ্রেম ধরে রেন্ডার করে ভিডিও তৈরির পদ্ধতি সমর্থন পেয়েছে।

  7. #40 @bond_ai1 — 499 likes, 46 reposts, 3 replies, প্রায় 69,000 views, 2026-09-25
    https://x.com/bond_ai1/status/2103374441250259316

    動画編集、Premiere Proもカット作業の外注もいらない時代が来ました。Claude Codeに素材を投げるだけで、完全自動でプロ品質の動画が仕上がる『video-use』が登場。
    → Claude Code-এর “video-use” টুল ভিডিও সম্পাদনা সম্পূর্ণ স্বয়ংক্রিয় করার দাবি নিয়ে উপস্থাপিত। জেনারেশনের বদলে বিদ্যমান উপকরণের অটো-এডিটিংয়ে AI ছড়িয়ে পড়ার উদাহরণ।

(#39 @samcoderx-এর পোস্ট Claude ব্যবহারের সাধারণ গাইড হওয়ায়, ইমেজ/ভিডিও জেনারেশনের সঙ্গে সরাসরি সম্পর্কিত নয় এবং শুধু রেফারেন্স হিসেবে রাখা হয়েছে।)

সংকেত
  • ঊর্ধ্বমুখী: Claude Opus 5.5-কে কেন্দ্রে রেখে GPT Images 2.5, Grok, Gemini TTS ও Astra-সহ একাধিক ক্লোজড টুলে একটি ভিডিও সম্পন্ন করার “মাল্টি-টুল পাইপলাইন” এইবারের প্রায় সব Opus 5.5 পোস্টের বিষয়। এক-প্রম্পটের বদলে Claude Code উপকরণ সংগ্রহ, সম্পাদনা ও সঙ্গীত বাছাইও করছে—“ভিডিও প্রোডাকশন এজেন্ট” ব্যবহারের কথা বারবার এসেছে।
  • অদৃশ্য/উল্লেখহীন: সংগৃহীত পোস্টে Stable Diffusion, Flux, ComfyUI, Wan বা HunyuanVideo-সহ ওপেন-সোর্স ইমেজ ও ভিডিও জেনারেশন AI-র কোনো উল্লেখ নেই। সার্চ টার্মে এসব না থাকা এর প্রধান কারণ, তবে 40টি সংগৃহীত ও 7টি প্রাসঙ্গিক পোস্টে আলোচনা সম্পূর্ণ ক্লোজড মডেলকেন্দ্রিক।
  • বিস্ময়কর বিষয়: Explore-এর 10টি ট্রেন্ড টার্মের 8টি—Taylor, #sweepstakes, #giveaways, #chance, Slovenia, Italy, Cardano, Croatia—বিষয়বহির্ভূত ছিল। ক্রোয়েশিয়ার Explore-এ এই বিশেষায়িত AI নির্মাণ টুল ট্রেন্ডিং নয়; আলোচনাটি ভাইরাল নয়, ব্যক্তিগত অনুশীলনকারীদের দীর্ঘ-লেজের শেয়ারিং।
সীমাবদ্ধতা
  • Explore অঞ্চল ক্রোয়েশিয়ায় স্থির থাকায় “Slovenia”, “Italy”, “Cardano”, “Croatia”-সহ পাঁচটি টার্ম শুধু বিষয়বহির্ভূত ফল দিয়েছে।
  • “Taylor”, “#sweepstakes”, “#giveaways”, “#chance”-ও সম্পর্কহীন ফল দেয়।
  • “Stable Diffusion”, “Flux”, “ComfyUI”, “Wan”, “open source”-এর সমমানের জাপানি বা ইংরেজি টার্ম সার্চে ছিল না; ফলে X-এ ওপেন-সোর্স প্রবণতা একেবারেই সংগ্রহ হয়নি।
  • সংগৃহীত 40টির মধ্যে সরাসরি প্রাসঙ্গিক পোস্ট মাত্র 7–8টি; প্রায় 20টি পোস্ট বিশ্লেষণের লক্ষ্য X-এর ক্ষেত্রে পূরণ হয়নি।

YouTube

YouTube — ইমেজ ও ভিডিও জেনারেশনের সাম্প্রতিক প্রবণতা

চ্যানেল

সার্চ ফল ও oEmbed থেকে নিশ্চিত চ্যানেলগুলো—সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি, বিস্তারিত “সীমাবদ্ধতা” অংশে:

  • VEED STUDIO — Sora 2 ও Veo 3.1 তুলনার মতো ভিডিও প্রকাশ করা ভিডিও-এডিটিং টুল চ্যানেল
  • AI Autopsy Dossier — ক্লোজড-সোর্স ভিডিও জেনারেশন মডেল পরীক্ষার চ্যানেল
  • Tao Prompts — বহু মডেলের পাশাপাশি তুলনায় দক্ষ: Seedance/Kling/Minimax/Google Omni
  • Better Stack — AI শিল্পসংক্রান্ত সংবাদ ব্যাখ্যার চ্যানেল, xAI/Grok বিষয়ক
  • Latent Space — AI গবেষক সাক্ষাৎকারধর্মী পডকাস্ট/চ্যানেল
  • AI Master — Google Gemini টুলের ব্যাখ্যা, যেমন Nano Banana Pro
  • Zebra Techies Solution-ZTS Infotech — AI টুল বদল ও তুলনাভিত্তিক চ্যানেল
  • SECourses — ComfyUI/SwarmUI দিয়ে ওপেন-সোর্স মডেলের দীর্ঘ টিউটোরিয়াল
  • LTX_io — Lightricks-এর অফিসিয়াল চ্যানেল, LTX-2.5 ঘোষণা
  • Prompt Engineer 48 — ওপেন-সোর্স মডেলের লোকাল ইনস্টল ও পরীক্ষার চ্যানেল
  • Bijan Bowen / Codedigipt — Z-Image Turbo-সহ ওপেন-সোর্স ইমেজ মডেল রিভিউ চ্যানেল
  • QUASA — Qwen-Image-সহ ওপেন-সোর্স মডেলের প্রযুক্তিগত ব্যাখ্যা
ভিডিও

[ক্লোজড-সোর্স]

  1. Sora 2 Vs Veo 3.1 Comparison (Same Prompts, VERY Different Results) — VEED STUDIO — 2025-11-27 — ভিউ অজানা — https://www.youtube.com/watch?v=kebWkj5ONzo — একই প্রম্পটে Sora 2 ও Veo 3.1 তুলনা; Veo 3.1-কে পদার্থগত আচরণ ও সামঞ্জস্যে বেশি স্থিতিশীল বলা হয়েছে।

  2. Seedance 2.5 vs Kling 3.0 | The Honest Truth About AI Video Generation in 2026 — AI Autopsy Dossier — 2026-06-27 — ভিউ অজানা — https://www.youtube.com/watch?v=EtmdbF0DbHU — ByteDance-এর Seedance 2.5 মোশন ও পদার্থগত প্রকাশে Kling 3.0 থেকে সামান্য এগিয়ে, কিন্তু চরিত্রের সামঞ্জস্যে Kling এখনও শক্তিশালী—এমন দাবি।

  3. Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — Tao Prompts — 2026-08-14 — ভিউ অজানা — https://www.youtube.com/watch?v=G5D053drKB8 — চারটি ক্লোজড-সোর্স ভিডিও জেনারেশন মডেলের তুলনা। Google-এর নতুন “Omni” মডেল সম্ভাবনাময় প্রতিযোগী হিসেবে উল্লেখিত।

  4. xAI are killing it (Grok 4.6, Image 2.0 and more...) — Better Stack — প্রায় 2026 সালের আগস্ট — ভিউ অজানা — https://www.youtube.com/watch?v=ILHJqmJdWso — xAI-এর Grok Imagine/Image 2.0 দ্রুত Veo ও Sora-র ব্যবধান কমাচ্ছে বলে দাবি।

  5. Inside xAI: Building Grok Imagine in 3 Months, Videogen vs World Models, and Video Agents — Ethan He — Latent Space — তারিখ অজানা, অনুমান 2026 মধ্যভাগ — ভিউ অজানা — https://www.youtube.com/watch?v=jPtQlILfkhA — xAI ইঞ্জিনিয়ারের সাক্ষাৎকার। মাত্র তিন মাসে Grok Imagine বানানো এবং বিশুদ্ধ ভিডিও ডিফিউশন মডেলের বদলে “world model” পথে যাওয়ার কারণ নিয়ে আলোচনা।

  6. Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI — AI Master — তারিখ অজানা, 2026 — ভিউ অজানা — https://www.youtube.com/watch?v=ZCw325FiS78 — Google-এর Nano Banana Pro-এর সম্পাদনা ফিচারের পূর্ণ ব্যাখ্যা।

[ওপেন-সোর্স]

  1. Cancel Every Image AI Subscription You Have — Here's What Replaced Them in 2026 — Zebra Techies Solution-ZTS Infotech — 2026-06-24 — ভিউ অজানা — https://www.youtube.com/watch?v=2qOWfES7R3I — 2026 সালে বিনামূল্যের/ওপেন-সোর্স টুল Midjourney-সহ পেইড সাবস্ক্রিপশনের বিকল্প হতে পারে বলে দাবি।

  2. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — SECourses — তারিখ অজানা, 2026 — ভিউ অজানা — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — 37 মিনিটের টিউটোরিয়াল। Wan 2.2, FLUX ও Qwen-Image-কে SwarmUI/ComfyUI-তে Lightning LoRA-সহ সেটআপ ও অপ্টিমাইজ করার পদ্ধতি।

  3. LTX-2.5: The World Model the World Builds On — LTX_io (Lightricks অফিসিয়াল) — 2026-08-11 — ভিউ অজানা — https://www.youtube.com/watch?v=ZDfjZae7Da0 — ওপেন-ওয়েট ভিডিও+অডিও মডেল LTX-2.5-এর অফিসিয়াল ঘোষণা। 22B প্যারামিটার; চলচ্চিত্র নির্মাণের পাশাপাশি রোবোটিক্সের “world model” হিসেবেও উপস্থাপিত।

  4. LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — Prompt Engineer 48 — 2026-08-18 — ভিউ অজানা — https://www.youtube.com/watch?v=sIOC9pzHzjs — LTX-2.5 ঘোষণার মাত্র এক সপ্তাহের মধ্যে ComfyUI-তে লোকাল ইনস্টল ও পরীক্ষা। ভোক্তাপর্যায়ের GPU-তেও চলার বিষয়টি নিশ্চিত করা হয়েছে।

  5. Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models — Bijan Bowen — তারিখ অজানা, অনুমান 2025 সালের শেষ থেকে 2026 শুরুর দিক — ভিউ অজানা — https://www.youtube.com/watch?v=K0FgDU-9uik — Apache-2.0 লাইসেন্সের Alibaba/Tongyi Z-Image Turbo অন্য লোকাল ইমেজ মডেলের তুলনায় গতি ও গুণমানে শক্তিশালী বলে মূল্যায়িত।

  6. Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — তারিখ অজানা — ভিউ অজানা — https://www.youtube.com/watch?v=sPQQPpQ9X4E — বিনামূল্যের ওপেন-সোর্স Z-Image Turbo Google-এর পেইড Nano Banana Pro-র সমতুল্য বলে দাবি।

সংকেত
  • ক্লোজড-সোর্স ভিডিও জেনারেশনে “Seedance বনাম Kling বনাম Veo বনাম Sora”-র মতো বহু-মডেল তুলনা প্রধান ফরম্যাট; একক রিভিউয়ের চেয়ে তুলনামূলক কনটেন্টের চাহিদা বেশি।
  • 2026 সালের প্রথমার্ধ পর্যন্ত Grok Imagine-কে প্রায়ই আনফিল্টার্ড বা উসকানিমূলক কনটেন্টের প্রেক্ষিতে দেখা হলেও, আগস্টের ভিডিওগুলোতে এটি Veo/Sora-র গুরুতর প্রতিদ্বন্দ্বী হিসেবে আলোচিত।
  • Google-কে ইমেজে Nano Banana Pro এবং ভিডিওতে Flow/Omni—দুই দিকেই ঘনঘন উল্লেখ করা হয়; একক মডেলের চেয়ে সমগ্র ইকোসিস্টেম হিসেবে।
  • Lightricks-এর LTX-2.5 (2026-08-11) ওপেন-সোর্স পক্ষের প্রতীকী ঘটনা; অফিসিয়াল ঘোষণার এক সপ্তাহের মধ্যে স্বতন্ত্র নির্মাতার ComfyUI পরীক্ষা বেরিয়েছে, যা কমিউনিটির দ্রুত প্রতিক্রিয়া দেখায়।
  • Alibaba/Tongyi-র Z-Image Turbo-কে বিভিন্ন চ্যানেল একইভাবে “Nano Banana Pro-র ফ্রি সংস্করণ” হিসেবে উপস্থাপন করেছে। ভিডিওর শিরোনামেই ওপেন বনাম ক্লোজড সংঘাতের চিত্র।
  • SECourses-এর মতো 30 মিনিটের বেশি টিউটোরিয়ালে Wan, FLUX ও Qwen-Image একসঙ্গে ব্যবহারের ওয়ার্কফ্লো ধরা পড়ে; একক মডেল পরিচালনা থেকে সরে আসার ইঙ্গিত।
সীমাবদ্ধতা
  • YouTube সার্চ ও ভিডিও পেজ JavaScript-নির্ভর; WebFetch-এ শুধু স্থির ফুটার পাওয়া গেছে। ভিউ, সাবস্ক্রাইবার, প্রকাশের সময় বা মন্তব্য সরাসরি পড়া যায়নি।
  • WebSearch ও YouTube oEmbed ব্যবহার করে শিরোনাম এবং চ্যানেলের নাম নিশ্চিত করা হয়েছে, তবে এগুলো ভিউ বা সাবস্ক্রাইবার দেয় না—তাই সব ভিডিওতে “ভিউ অজানা” লেখা।
  • প্রকাশের তারিখ WebSearch স্নিপেটভিত্তিক অনুমান; কিছু ক্ষেত্রে “2 সপ্তাহ আগে”, “1 মাস আগে” ধরনের আপেক্ষিক সময়ই ছিল।
  • বিবরণ ও মন্তব্যে সরাসরি প্রবেশ করা যায়নি; দর্শকের প্রতিক্রিয়া অন্তর্ভুক্ত নয়।
  • OpenAI Sora API 2026 সালের 24 সেপ্টেম্বর বন্ধ হওয়ার বিষয়টি নিয়ে সরাসরি কোনো YouTube ভিডিও পাওয়া যায়নি।

Bluesky

Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ

bsky.app মূল সাইটটি JavaScript-রেন্ডার করা SPA; WebFetch-এ সার্চ ও পৃথক পোস্ট পেজের কনটেন্ট পাওয়া যায়নি। অফিসিয়াল public.api.bsky.app এন্ডপয়েন্ট 403 দিচ্ছিল। বদলে api.bsky.app-এর app.bsky.feed.searchPosts JSON API ব্যবহার করা হয়েছে। stable diffusion, midjourney, Sora 2, Veo 3, Nano Banana, Flux image model, ComfyUI, Sora API shutdown, Wan 3.0 video, Seedance, Grok Imagine, HunyuanVideo/LTX Video—এই 12টি কুয়েরিতে প্রতিটিতে 20–25টি করে, মোট 200-এর বেশি পোস্ট সংগ্রহ ও বিশ্লেষণ করা হয়েছে।

অ্যাকাউন্ট
  • @aichina.news — Huawei Ascend NPU-র AI প্ল্যাটফর্ম Modelers.cn-এ আপলোড হওয়া SDXL/FLUX LoRA যান্ত্রিকভাবে রিপোর্ট করা বটধাঁচের অ্যাকাউন্ট। প্রায় সব পোস্টে 0 লাইক, কিন্তু দৈনিক 20টির বেশি পোস্ট; Ascend-কেন্দ্রিক ওপেন-সোর্স ইমেজ ইকোসিস্টেমের পর্যবেক্ষণ উৎস।
  • @oludai.bsky.social (🚀 olud.ai) — AI মডেল র‌্যাঙ্কিংয়ের দ্রুত সংবাদ। Alibaba-র Wan 3.0 ওপেন-ওয়েট ভিডিও মডেল মানব পছন্দের র‌্যাঙ্কিংয়ে শীর্ষে উঠেছে বলে জানায়।
  • @github-trending.bsky.social — GitHub Trending-এর স্বয়ংক্রিয় পোস্ট। stable-diffusion.cpp (★7,148), হালকা C++ ডিফিউশন ইনফারেন্স ইঞ্জিনের ট্রেন্ডিং হওয়া জানায়।
  • @huggingfacetrends.bsky.social — Hugging Face দৈনিক ট্রেন্ড বট। Qwen-Image 2.1-এর ComfyUI পোর্টের তথ্য দেয়।
  • @aipromptingclinic.bsky.social — Seedance, Kling ও Grok Imagine-এর প্রম্পট ডিজাইনের টিপস প্রতিদিন বিপুল সংখ্যায় পোস্ট করে। এনগেজমেন্ট প্রায় শূন্য, কিন্তু উপস্থিতির হার ক্লোজড ভিডিও/ইমেজ মডেলের বাস্তব ব্যবহারের বিস্তার দেখায়।
  • @aki-kisaragi.bsky.social (AKI) — Grok Imagine দিয়ে আইকন ও ইলাস্ট্রেশন বানিয়ে প্রকাশ করা ব্যক্তিগত নির্মাতা। জাপানি ভাষাভাষী ব্যবহারের উদাহরণ।
  • @hashimoto-ekuto.bsky.social (PuniQ) — Seedance 2.5-এর ক্রেডিট শেষ হওয়া পর্যন্ত ভিডিও জেনারেশনের অভিজ্ঞতা লাইভ পোস্ট করেন।
  • @dfl.bsky.social (DFL inc.) / @obeca.bsky.social — Nano Banana 2 দিয়ে তৈরি ছবি নিয়মিত পোস্ট করে।
  • @alternativeto.net — 11 লাইকসহ OpenAI Sora বন্ধের খবর ছড়ানো টুল-তুলনামূলক মিডিয়া অ্যাকাউন্ট।
পোস্ট
  1. @knowmouth.bsky.social — 0 likes, 0 reposts, 2026-09-25T00:51
    https://bsky.app/profile/knowmouth.bsky.social/post/3mwckivdpkk2y

    🎬 Sora is officially gone. OpenAI discontinued the Sora product earlier this year, and Sora 2, Sora 2 Pro and the Videos API reached their shutdown date on September 24, 2026.
    → ক্লোজড-সোর্সের সবচেয়ে বড় খবর। OpenAI ভিডিও জেনারেশন API Sora সম্পূর্ণ বন্ধ করেছে; কোনো বিকল্প রোডম্যাপ নেই।

  2. @alternativeto.net — 11 likes, 0 reposts, 2026-03-25T11:30
    https://bsky.app/profile/alternativeto.net/post/3mhuyfrjnpz26

    OpenAI is shutting down its AI video slop social app, Sora, along with its API less than six months after launch... ending a billion-dollar partnership with Disney.
    → Sora অ্যাপ ও API বন্ধের সঙ্গে Disney-র 1 বিলিয়ন ডলারের অংশীদারত্ব ভেঙে যাওয়ার খবর; সংগৃহীত Sora-সংক্রান্ত পোস্টে সর্বোচ্চ লাইক।

  3. @aifoundersczech.bsky.social (AI Founders ONLINE) — 0 likes, 0 reposts, 2026-07-04T11:00
    https://bsky.app/profile/aifoundersczech.bsky.social/post/3mpsvtc4hkd2u

    Google just priced its new video API 4x cheaper than its own flagship tier — on purpose... Sora finished burning $1M/day against $2.1M in lifetime revenue.
    → Sora API বন্ধের পেছনের অর্থনীতি হিসেবে প্রতিদিন 1 মিলিয়ন ডলার ক্ষতি বনাম জীবনকালীন 2.1 মিলিয়ন ডলার আয় উল্লেখ; Google Veo-র মূল্য আক্রমণও আছে।

  4. @coreati.bsky.social (Core Ai News 🚨) — 0 likes, 0 reposts, 2026-09-24T18:52
    https://bsky.app/profile/coreati.bsky.social/post/3mwbwh5p7mj2e

    GOOGLE 🔥: Nano Banana 2.5 Flash traces have been spotted...
    → Google-এর ইমেজ জেনারেশন মডেল Nano Banana-এর পরবর্তী 2.5 Flash সংস্করণের চিহ্ন পাওয়া গেছে—এমন লিক।

  5. @garutoroid.bsky.social (ガル・トロイド) — 3 likes, 0 reposts, 2026-09-24T10:03
    https://bsky.app/profile/garutoroid.bsky.social/post/3mwayvizumc2g

    同プロンプトのGPT Image 2.5とNano Banana 2版。
    → একই প্রম্পটে GPT Image 2.5 বনাম Nano Banana 2 তুলনা। ব্যবহারকারী পর্যায়ে ক্লোজড ইমেজ মডেলের তুলনা দৈনন্দিন হয়ে যাওয়ার প্রমাণ।

  6. @ahiruai.bsky.social (あひる|楽すぎるAI副業) — 0 likes, 0 reposts, 2026-09-25T08:41
    https://bsky.app/profile/ahiruai.bsky.social/post/3mwdeqlfflo2f

    Runwayの「Draft mode」を使うとSeedance 2.5のクレジット消費を抑えられる、という情報共有。
    → Runway-এর Draft mode ব্যবহার করে Seedance 2.5-এর ক্রেডিট খরচ কমানোর টিপস; অন্য প্ল্যাটফর্মের মাধ্যমে ক্লোজড ভিডিও মডেল ব্যবহারের উদাহরণ।

  7. @oludai.bsky.social (🚀 olud.ai) — 1 like, 0 reposts, 2026-09-25T21:00
    https://bsky.app/profile/oludai.bsky.social/post/3mweo2rmjo424

    🏆 Wan 3.0, an open-weight model, tops the human-preference ranking for video generation—beating every closed rival.
    → ওপেন-সোর্সের সবচেয়ে বড় খবর। Alibaba-র Wan 3.0 মানব মূল্যায়নে সব ক্লোজড মডেলকে ছাড়িয়ে গেছে।

  8. @ai-linkstream.bsky.social — 0 likes, 0 reposts, 2026-09-25T17:50
    https://bsky.app/profile/ai-linkstream.bsky.social/post/3mwedgzcgkh2g

    Alibaba has launched its AI video model, Wan 3.0, after a $10 billion share sale.
    → Alibaba-র 10 বিলিয়ন ডলারের শেয়ার বিক্রির ঠিক পর Wan 3.0 চালুর খবর; ওপেন AI-তে পুঁজির পরিমাণের ইঙ্গিত।

  9. @riccinov.bsky.social (Ricci Research) — 0 likes, 0 reposts, 2026-09-24T15:07
    https://bsky.app/profile/riccinov.bsky.social/post/3mwbjv6rqxt2f

    Alibaba's Qwen Image 2.1 is 7B parameters and scores 60.2...
    → Alibaba-র ওপেন ইমেজ মডেল Qwen-Image 2.1-এর 7B প্যারামিটার ও 60.2 বেঞ্চমার্ক স্কোরের তথ্য।

  10. @huggingfacetrends.bsky.social — 0 likes, 0 reposts, 2026-09-25T15:04
    https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mwe25zx3bn27

    Comfy-Org/Qwen-Image-2.1: Qwen-Image 2.1 repackaged for ComfyUI
    → Qwen-Image 2.1 দ্রুত ComfyUI নোড হিসেবে বিতরণ হয়েছে; ওপেন মডেল কত দ্রুত ইকোসিস্টেমে ঢোকে তার প্রমাণ।

  11. @github-trending.bsky.social — 1 like, 0 reposts, 2026-09-24T19:17
    https://bsky.app/profile/github-trending.bsky.social/post/3mwbxt7hrhr2q

    📦 leejet / stable-diffusion.cpp ⭐ 7,148 (+33) 🗒 C++ — Diffusion model(SD,Flux,Wan,Qwen Image,Z-Image,...) inference in pure C/C++
    → SD, Flux, Wan, Qwen Image ও Z-Image-সহ প্রধান ওপেন ডিফিউশন মডেল এক C++ ইনফারেন্স ইঞ্জিনে চালানোর প্রকল্প GitHub Trending-এ এসেছে।

  12. @manilarope.bsky.social (Taimai🔞) — 2 likes, 1 repost, 2026-09-26T00:48
    https://bsky.app/profile/manilarope.bsky.social/post/3mwf2swkkao2f

    ComfyUIくんとのケンカがなんとか一段落して、MiniMaxH3で動画を生成できるようになってくれました。
    → ComfyUI-এর মাধ্যমে MiniMax H3 চালাতে ব্যক্তিগত পরীক্ষানিরীক্ষা; ওপেন/আংশিক ওপেন ভিডিও মডেল লোকাল পরিবেশে আনার উদাহরণ।

সংকেত

ক্লোজড-সোর্সের গতি

  • OpenAI “Sora” ব্র্যান্ড সম্পূর্ণ বন্ধ করেছে: অ্যাপ 2026 সালের এপ্রিলে, এবং Sora 2, Sora 2 Pro, Videos API ও সব মডেল alias 24 সেপ্টেম্বর বন্ধ। বিকল্প রোডম্যাপ নেই।
  • Sora-র আর্থিক অদক্ষতা—প্রতিদিন 1 মিলিয়ন ডলার ক্ষতি বনাম 2.1 মিলিয়ন ডলার জীবনকালীন আয়—নিয়ে প্রকাশ্যে আলোচনা হয়েছে।
  • Sora বন্ধের সঙ্গে Google তার Veo ভিডিও API-কে ফ্ল্যাগশিপ স্তরের চেয়ে চার গুণ সস্তায় পুনর্মূল্য নির্ধারণ করেছে।
  • Google-এর Nano Banana ইমেজ লাইন 2 থেকে 2.5 Flash-এ প্রজন্ম পরিবর্তনের গুজব/চিহ্নে রয়েছে; ব্যবহারকারীরা GPT Image 2.5-এর সঙ্গে একই প্রম্পটে তুলনা করছেন।
  • ByteDance-এর Seedance 2.5 Runway-সহ অন্যান্য প্ল্যাটফর্মেও ব্যবহৃত হচ্ছে এবং ক্রেডিট দ্রুত খরচ হওয়ার বিষয়টি আলোচিত।
  • Kling 3.0 ও Grok Imagine ব্যক্তিগত নির্মাতার ওয়ার্কফ্লোতে ঢুকে গেছে।
  • Sora API বন্ধের পর Seedance 2.0, LTX ও Runway-কে স্থানান্তরের গন্তব্য হিসেবে সুপারিশ করা পোস্টও আছে।

ওপেন-সোর্সের গতি

  • Alibaba-র Wan 3.0 মানব মূল্যায়নে ক্লোজড মডেলকে ছাড়িয়েছে বলে রিপোর্ট হয়েছে; 10 বিলিয়ন ডলারের শেয়ার বিক্রির পরপরই লঞ্চ।
  • Qwen-Image 2.1—7B প্যারামিটার, বেঞ্চমার্ক 60.2—প্রকাশের পরপরই ComfyUI অফিসিয়াল নোডে পরিণত হয়েছে।
  • stable-diffusion.cpp (★7,148) SD, Flux, Wan, Qwen Image ও Z-Image-সহ নানা ওপেন মডেল চালায় এবং GitHub Trending-এ এসেছে।
  • Huawei Ascend NPU ইকোসিস্টেমে Modelers.cn-এ SDXL/FLUX LoRA ব্যাপকভাবে তৈরি হচ্ছে; তবে অনেকের মডেল কার্ড, ট্রিগার শব্দ ও নমুনা নেই, তাই মান কম।
  • MiniMax H3-কে ComfyUI দিয়ে লোকালি চালানোর ব্যক্তিগত প্রয়াস ও পারফরম্যান্স তুলনা দেখা যায়।
  • সামগ্রিকভাবে Alibaba-র বড় মডেল Wan/Qwen-এর দ্রুত ComfyUI স্থানান্তর এবং Huawei Ascend ইকোসিস্টেমে তৃণমূল LoRA উৎপাদন—দুটি স্তরে ওপেন-সোর্স এগোচ্ছে।
সীমাবদ্ধতা
  • bsky.app-এর সার্চ ও পোস্ট পেজ ক্লায়েন্ট-সাইড SPA হওয়ায় WebFetch-এ কনটেন্ট পাওয়া যায়নি।
  • public.api.bsky.app সবসময় 403 দিয়েছে; api.bsky.app কাজ করলেও ভবিষ্যতে বট প্রতিরোধে এটিও ব্লক হতে পারে।
  • Bash থেকে সরাসরি curl নেটওয়ার্ক সীমাবদ্ধতায় ব্যবহার করা যায়নি; WebFetch-নির্ভর কাজ হয়েছে।
  • Veo 3 কুয়েরি স্প্যানিশ ক্রিয়া “veo” ও অন্যান্য অপ্রাসঙ্গিক ফলাফলে ভরা ছিল; সরাসরি Google Veo-র উল্লেখ কম পাওয়া গেছে।
  • HunyuanVideo / LTX Video কুয়েরিতে কোনো ফল আসেনি।
  • সার্চ API-তে প্রতি কুয়েরিতে limit=25 সীমা ছিল এবং কেবল সর্বশেষ পোস্ট দেখা হয়েছে; দীর্ঘমেয়াদি ট্রেন্ড বিশ্লেষণ নয়।

Lemmy

Lemmy — ছবি ও ভিডিও জেনারেশন AI সংবাদ

Lemmy-তে “image generation AI”, “video generation AI”, “Sora shutdown”, “Nano Banana”, “Grok Imagine”, “Wan 2.2 OR Wan 3”, “Flux image model” ইত্যাদি দিয়ে lemmy.world-এর /api/v3/search সার্চ API ব্যবহার করা হয়, কিন্তু ফলের অধিকাংশই অপ্রাসঙ্গিক ছিল। তাই টার্ম সার্চ দ্রুত বাদ দিয়ে ইমেজ জেনারেশন-কেন্দ্রিক কমিউনিটি সরাসরি ব্রাউজ করা হয়েছে।

কমিউনিটি
কমিউনিটি ইনস্ট্যান্স সাবস্ক্রাইবার প্রবণতা
!«メールアドレス» lemmy.dbzer0.com 5,713 জন নতুন ওপেন-সোর্স মডেল, LoRA ও ComfyUI নোডের HuggingFace/GitHub লিংক নিয়মিত পোস্ট করা ফিড।
!«メールアドレス» lemmy.dbzer0.com 2,363 জন Civitai থেকে AI-তৈরি ইলাস্ট্রেশনের মিরর পোস্ট করা শোকেস।
!«メールアドレス» lemmy.world 1,985 জন Flux ব্যবহারকারী বিনামূল্যের AI জেনারেশন টুল Perchance নিয়ে কমিউনিটি।
!«メールアドレス» lemmy.ml 1,662 জন একসময় সক্রিয় হলেও কার্যত স্থবির।
!«メールアドレス» lemmy.world 1,258 জন সাধারণ ML/AI সংবাদ; ইমেজ/ভিডিও জেনারেশননির্ভর পোস্ট প্রায় নেই।
!«メールアドレス» (Generative Artificial Intelligence) sopuli.xyz 328 জন জেনারেটিভ AI আলাপ; নির্দিষ্ট ইমেজ/ভিডিও সংবাদ কম।
!«メールアドレス» lemmy.durstig.online 52 জন Reddit-এর AI সাবরেডিট যান্ত্রিকভাবে মিরর করা RSS বট।
!«メールアドレス» sh.itjust.works 172 জন AI আর্ট উদাহরণের কমিউনিটি, 2023 থেকেই নিষ্ক্রিয়।
পোস্ট
  1. Qwen-Image-2.1 in ComfyUI (!«メールアドレス», 13 পয়েন্ট, 0 মন্তব্য, 2026-09-22)
    https://lemmy.dbzer0.com/post/75874773 → Alibaba-র ওপেন Qwen-Image 2.1-কে ComfyUI অফিসিয়াল ব্লগে আনুষ্ঠানিক সমর্থনের লিংক পোস্ট। Bluesky-তেও একই সময়ে একই প্রবণতা দেখা গেছে।

  2. Supra2-IMG Model (!«メールアドレス», 8 পয়েন্ট, 0 মন্তব্য, 2026-09-22)
    https://lemmy.dbzer0.com/post/75874769 → নতুন ইমেজ জেনারেশন মডেল “SupraLabs/Supra2-IMG”-এর HuggingFace প্রকাশনা।

  3. AI Horde New Interface (!«メールアドレス», 9 পয়েন্ট, 0 মন্তব্য, 2026-09-19)
    https://lemmy.dbzer0.com/post/75736717 → haidra.net-এর ক্রাউডসোর্সড, বিকেন্দ্রীকৃত ও বিনামূল্যের ইমেজ জেনারেশন অবকাঠামো AI Horde-এর নতুন ইন্টারফেস ও ডকুমেন্টেশন।

  4. MiniMax H3-এর ComfyUI টুলের ঘন পোস্টিং (!«メールアドレス», প্রতিটি 1–3 পয়েন্ট, 2026-09-12–09-16)
    https://lemmy.dbzer0.com/post/75586072 (MiniMaxH3-PromptBuilder),
    https://lemmy.dbzer0.com/post/75586070 (wan2gp-h3-latent-continue),
    https://lemmy.dbzer0.com/post/75427444 (3d-Camera-control-H3-Minimax) অন্যান্য
    → MiniMax H3-র জন্য ComfyUI কাস্টম নোড ও প্রম্পট বিল্ডার এক সপ্তাহে 5টির বেশি পোস্ট হয়েছে। Reddit-এ “ভিডিও = Minimax H3” ঐকমত্যের সঙ্গে মেলে।

  5. Krea2-Turbo-Distill-2step-LoRA (!«メールアドレス», 2026-09-13 ও 09-16-এ 2টি পোস্ট, প্রতিটি 1–2 পয়েন্ট)
    https://lemmy.dbzer0.com/post/75427441 / https://lemmy.dbzer0.com/post/75586071 → Krea 2-কে দুই ধাপে দ্রুততর করার LoRA প্রকাশ। Reddit-এর “Krea 2 এখনকার সুপারিশ” প্রবণতার সঙ্গে দ্রুতগতির অ্যাডাপ্টার প্রস্তুতি চলেছে।

  6. LTX-2.5-22b-IC-LoRA-Ingredients (!«メールアドレス», 3 পয়েন্ট, 0 মন্তব্য, 2026-09-12)
    https://lemmy.dbzer0.com/post/75382763 → Lightricks-এর ওপেন ভিডিও মডেল LTX-এর জন্য LoRA প্রকাশ।

  7. Waters & World's Edge এবং Civitai-তৈরি ইলাস্ট্রেশনের দৈনিক পোস্ট (!«メールアドレス», সর্বোচ্চ 12 পয়েন্ট, 2026-09-22–09-26)
    https://lemmy.dbzer0.com/post/75841792 অন্যান্য → সংবাদ নয়, উদাহরণের শোকেস; কিন্তু প্রতিদিন নিয়মিত পোস্ট হওয়া লোকাল জেনারেশন কমিউনিটির সক্রিয়তার প্রমাণ।

  8. We are saying goodbye to Sora (!«メールアドレス», -11 পয়েন্ট, 4 মন্তব্য, 2026-03-24)
    https://lemmy.world/post/44702049 → OpenAI-র Sora অ্যাপ বন্ধের ঘোষণার হুবহু পুনঃপ্রকাশ। Lemmy-র প্রতিক্রিয়া ঠান্ডা, স্কোর নেতিবাচক। সেপ্টেম্বরে Sora 2/Videos API বন্ধের নতুন পোস্ট পাওয়া যায়নি।

  9. Interesting Facts about Perchance (!«メールアドレス», 3 পয়েন্ট, 18 মন্তব্য, 2026-08-05)
    https://lemmy.world/post/50319371 → বিনামূল্যের AI সাইট Perchance-এর ইমেজ অংশে ওপেন মডেল Flux এবং বিনামূল্যের ওপেন টেক্সট মডেল DeepSeek ব্যবহারের আলোচনা। সাধারণ ব্যবহারকারীদের “বিনামূল্যে ব্যবহারযোগ্য AI টুল” প্রসঙ্গে ওপেন-সোর্স মডেল নামের প্রবেশের উদাহরণ।

সংকেত
  • ঊর্ধ্বমুখী প্রবণতা প্রায় পুরোপুরি ওপেন-সোর্সে: সক্রিয় !«メールアドレス»-এ Qwen-Image 2.1, Krea 2, MiniMax H3 ও LTX নামগুলো গত দুই সপ্তাহে ঘনঘন এসেছে। Reddit ও Bluesky-র আলোচিত ওপেন মডেলগুলো প্রায় সময়ের ব্যবধান ছাড়াই Lemmy-তেও এসেছে।
  • ক্লোজড-সোর্স সংবাদ কাঠামোগতভাবেই দুর্বল: Sora বন্ধ, Nano Banana, Veo মূল্যছাড়, Grok Imagine, Seedance-এর মতো সেপ্টেম্বরের বড় খবর টার্গেটেড সার্চেও মেলেনি। একমাত্র Sora পোস্টটি মার্চের পুরোনো ঘোষণা। প্রযুক্তিবিদ/নিজে-চালানো ব্যবহারকারীকেন্দ্রিক Lemmy ব্যবহারকারীরা কর্পোরেট ক্লোজড পরিষেবার খবরের চেয়ে নিজে চালানো যায় এমন মডেল ও টুলে বেশি আগ্রহী।
  • এনগেজমেন্ট সাধারণত কম: stable_diffusion-এর পোস্টে 1–13 পয়েন্ট ও প্রায়শ শূন্য মন্তব্য; Reddit-সদৃশ আলোচনা নেই। পোস্টের সংখ্যা ও আপডেট ফ্রিকোয়েন্সি দিয়েই আলোচ্যতা মাপতে হয়।
  • সাধারণ কমিউনিটিতে AI নিয়ে সন্দেহ বেশি: !fuck_ai ও !machinelearning-এ ইমেজ/ভিডিও জেনারেশনের চেয়ে AI নির্ভরতা, ডেটাসেন্টারের বিদ্যুৎ, Stability AI-র ব্যবসায়িক ইতিহাস ইত্যাদি বিষয় বেশি।
সীমাবদ্ধতা
  • Lemmy সার্চ API-র নির্ভুলতা কম; একাধিক কিওয়ার্ডে বেশিরভাগ ফল অপ্রাসঙ্গিক ছিল। ফলে সরাসরি বিশেষায়িত কমিউনিটি ব্রাউজ করা হয়েছে এবং অন্যান্য ইনস্ট্যান্সে কিছু খবর বাদ পড়তে পারে।
  • ভিডিও জেনারেশনের জন্য আলাদা কমিউনিটি পাওয়া যায়নি; ভিডিও মডেল কেবল !«メールアドレス»-এর ComfyUI টুল পোস্টে দেখা গেছে।
  • সেপ্টেম্বরের ক্লোজড-সোর্স সংবাদ একেবারেই মেলেনি; অন্য প্ল্যাটফর্মে বড় হওয়া বিষয় Lemmy-তে কার্যত অনুপস্থিত—এটি প্ল্যাটফর্মটির বৈশিষ্ট্য।
  • প্রায় 20টি পোস্ট বিশ্লেষণের লক্ষ্য পূরণ হয়নি; সরাসরি প্রাসঙ্গিক পোস্ট প্রায় 9টির বেশি ছিল না।
  • !«メールアドレス»-সহ সার্চে শুধু নাম পাওয়া কিছু কমিউনিটি API-তে 404 দিয়েছে; সেগুলোর অস্তিত্ব যাচাই করা যায়নি।

Pinterest

Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ

ভিজ্যুয়াল থিম
  • “সেরা AI টুল” তালিকাধর্মী ইনফোগ্রাফিক বোর্ডজুড়ে প্রভাবশালী: গাঢ় নেভি বা কালো ব্যাকগ্রাউন্ড, নিয়ন বেগুনি/নীল/গোলাপি গ্রেডিয়েন্ট, বড় স্যানস-সেরিফ শিরোনাম, নম্বর দেওয়া সারি বা ফোন-মকআপ ফ্রেম, এবং প্রতিটি সারিতে টুল লোগো, এক লাইনের পিচ ও নমুনা ছবি।
  • ক্রোম বা কাচের হিউম্যানয়েড রোবট মাথা, নীল আলোয় প্রোফাইল ভিউ, “AI সব বদলে দিচ্ছে” বা “AI-এর ভবিষ্যৎ” ধরনের পিনের ডিফল্ট ছবি।
  • জেনারেটিভ ভিডিও টুলের বাস্তব প্রোডাক্ট স্ক্রিনশট বড় ছবি না হয়ে ইনফোগ্রাফিকের ছোট ইনসেট হিসেবে থাকে—যেমন Adobe Premiere-এর “Generate Video/Sound” প্যানেল বা Luma AI ও Kling-এর ডেমো স্টিল।
  • উল্লম্ব ফোন-স্ট্যাক কোলাজ: দৌড়বিদ, বিড়াল, পাহাড়ের ভিডিও দেখানো অসংখ্য স্মার্টফোন স্ক্রিন আকাশের দিকে স্তূপ; নির্দিষ্ট টুলের বদলে “AI কনটেন্ট সর্বত্র” বোঝাতে ব্যবহৃত।
  • YouTube-থাম্বনেইল ধরনের AI সংবাদ পিন: চমকানো বা উত্তেজিত দাড়িওয়ালা মুখের পাশে OpenAI, Google, Microsoft, Meta, Notion-এর লোগো; নীল/কালো পটভূমি ও “AI NEWS” লেখা।
  • ভিডিও-টু-এনিথিং রূপান্তরের আগে/পরের গ্রিড: হাঁটতে থাকা একজনকে কাঠের ব্লক, অরিগামি, রঙিন খেলনা ইট, ফুল ইত্যাদি স্টাইলে রূপান্তরিত করা।
  • AI অ্যাঙ্কর/ডিপফেক সংবাদ ফ্রেমিং: NBC News-ব্র্যান্ডেড আবহাওয়ার ভিডিওতে “AI GENERATED” ব্যাজ, যা AI সংবাদ ভিডিও বিশ্বাস করা যায় কি না—সেই বিতর্ক দেখায়।
  • সম্পূর্ণ কনটেন্ট পাইপলাইনের ফানেল/মাইন্ড-ম্যাপ ইনফোগ্রাফিক: AI-পাওয়ার্ড ইকোসিস্টেম এবং ChatGPT, Claude 3, Pictory AI, Runway Gen-3, Synthesia, ElevenLabs, Midjourney, Descript, CapCut AI, VidIQ, Leonardo AI-কে একই ওয়ার্কফ্লোতে রাখা গ্রাফিক।
উল্লেখযোগ্য পিন
  • [1] “6+ Best AI Video Generation Websites” — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI Video Generator ও Hailuo AI-র র‌্যাঙ্কিং ইনফোগ্রাফিক; Pinterest নির্মাতারা বর্তমানে কোন ক্লোজড ভিডিও টুল প্রচার করছেন তার পরিষ্কার চিত্র।
  • [3] “4 Major AI Updates You Need to Know in 2026” — চারটি ক্লোজড আইটেম: OpenAI “GPT-6 Astra”, Gmail/Drive/Docs/Slides/Chat-এ আরও এজেন্টিক Google Gemini, Adobe Premiere-এর ইন-টাইমলাইন জেনারেটিভ ভিডিও/সাউন্ড, এবং Cognition (Devin)-এর $48B মূল্যায়নে $2B Series E।
  • [7] “12 Best AI Video Generators in 2026” — Google Veo, OpenAI Sora, Runway, Kling AI, Pika, Luma Dream Machine, HeyGen, Synthesia, InVideo AI, Vidu AI, Hailuo AI, PixVerse AI। [1]-এর সঙ্গে তুলনায় Runway, Pika, Kling, Luma ও Hailuo পুনরাবৃত্ত নাম—সম্মতিমূলক সংক্ষিপ্ত তালিকা।
  • [13] “AI Content Studio & Automation Secrets” — ChatGPT, Claude 3, Pictory AI, Runway Gen-3, Synthesia, Midjourney, ElevenLabs, Descript, CapCut AI, VidIQ ও Leonardo AI-কে “idea → publish” পাইপলাইনে দেখানো মাইন্ড-ম্যাপ। তবে গন্তব্য সাইটটি নির্ভরযোগ্য উৎসের চেয়ে পাইরেটেড-স্ট্রিমিং লিড-জেন পেজের মতো।
  • [24] “AI News: Anthropic Leak Shows Us The Future of AI” — OpenAI/Google/Microsoft-লোগোসহ YouTube-থাম্বনেইল পিন। দাবি থাকলেও ছবিতে Anthropic-সংক্রান্ত উপাদান দেখা যায় না, ফলে ছবি থেকে যাচাই করা যায় না।
  • [28] “Google announces ultra-high quality video...” — মানুষ, কুকুর ও গাড়ির ভিডিওকে কাঠের ব্লক, অরিগামি, খেলনা ইট ও ফুলে রূপান্তরিত করা 5-condition × 3-subject গ্রিড; Luma ওয়াটারমার্কসহ। সেটের সবচেয়ে নির্দিষ্ট প্রোডাক্ট ডেমো।
  • [32] “AI news videos blur line between real and fake reports” — তুষারাচ্ছন্ন আবহাওয়ার রিপোর্টে “AI GENERATED” ব্যাজসহ NBC News-ধাঁচের ক্লিপ; AI অ্যাঙ্কর বিতর্কের ভিজ্যুয়াল।
  • [38] “AI News: OpenAI Finally Released What We Asked For” — আরেকটি চমকানো মুখ ও লোগো-গ্রিড থাম্বনেইল; [24]-এর সঙ্গে এতটাই মিল যে এটি সংবাদ স্কুপ নয়, পুনরাবৃত্ত চ্যানেল/থাম্বনেইল ফরম্যাট বলেই মনে হয়।
  • [43] “generate ai images, art, illustration, using with midjourney” — ব্যাচে Midjourney-কে আলাদাভাবে নাম নেওয়া খুব কম পিনের একটি; ছবিটি সাধারণ ট্রিপল-মনিটর ডেস্ক মকআপ, বাস্তব Midjourney আউটপুটের চেয়ে SEO/অ্যাফিলিয়েট পিনের মতো।
সংকেত
  • ক্লোজড-সোর্স ভোক্তামুখী ভিডিও টুলই প্রধান গল্প। Runway, Pika, Kling AI, Luma, Hailuo AI, Google Veo, OpenAI Sora, HeyGen, Synthesia, InVideo AI, Vidu AI ও PixVerse AI বিভিন্ন স্বতন্ত্র পিনে বারবার এসেছে।
  • বিশ্বাস ও সত্যতার উদ্বেগ দৃশ্যমান উপ-বিষয়: AI-তৈরি সংবাদ অ্যাঙ্কর ডিপফেক, AI ভয়েস ডিটেক্টর, উৎস প্রমাণের ওয়াটারমার্ক এবং সাংবাদিকতাকে বিশ্বাস করা যায় কি না—টুল প্রচারের পাশাপাশি এগুলোও বারবার আসে।
  • এন্টারপ্রাইজ/এজেন্টিক AI সংবাদও একই বোর্ডে মিশে যায়: Workspace-এ Gemini-এর এজেন্টিক অগ্রগতি ও Cognition/Devin-এর $2B তহবিল। Pinterest-এর অ্যালগরিদম এই নিসকে শুধু জেনারেটিভ মিডিয়ায় সীমাবদ্ধ রাখে না।
  • ওপেন-সোর্স ইমেজ/ভিডিও মডেল প্রায় পুরোপুরি অনুপস্থিত। নমুনায় Stable Diffusion, Flux, ComfyUI, LoRA, Hunyuan, Wan বা কোনো ওপেন-ওয়েট মডেলের নাম নেই। Pinterest-এর দর্শক ও অ্যালগরিদম আয়কেন্দ্রিক “সেরা ফ্রি টুল” ও সাইড-হাসল কনটেন্টে ঝোঁকে।
  • প্রাথমিক উৎসের উপাদান কম। অধিকাংশ পিন সেকেন্ডারি অ্যাগ্রিগেটর কনটেন্ট; [28]-এর Luma স্টাইল-ট্রান্সফার গ্রিডই একমাত্র প্রকৃত ফার্স্ট-পার্টি প্রোডাক্ট ডেমোর মতো।
সীমাবদ্ধতা
  • হেডলেস ব্রাউজার সার্চ “Image and Video Generation AI News” কুয়েরিতে 50টি পিনের সমতল ব্যাচ দিয়েছে; উপধারা অনুসারে তুলনা সম্ভব হয়নি।
  • 50টির মধ্যে 20টি ছবি বিস্তারিত পড়া ও বর্ণনা করা হয়েছে। বাকি 30টি আলাদা করে খোলা হয়নি, যদিও শিরোনাম দেখা হয়েছে।
  • কয়েকটি পিনের কোনো শিরোনাম নেই; না খোলা ছবিতে কার্যকর ক্যাপশন বা লেখা থাকতে পারে।
  • ওপেন-সোর্স মডেলের অনুপস্থিতি Pinterest-এ সত্যিকারের অনুপস্থিতি নাকি নির্দিষ্ট সার্চ কুয়েরির ফল—তা নিশ্চিত নয়।
  • নির্দেশমতো Pinterest-এ সরাসরি ব্রাউজ বা দাবিগুলো যাচাই করা হয়নি।

প্রস্তাবিত পদক্ষেপ

  • Wan 3.0 ও Qwen-Image 2.1-এর গ্রহণের গতি নিয়মিত দেখুন, ওপেন বনাম ক্লোজডের গুণগত উলটপালট স্থায়ী হয় কি না যাচাই করুন।
  • Google Veo-র মূল্যছাড় ও Nano Banana 2.5-এর অগ্রগতি অনুসরণ করে Sora প্রত্যাহারের পর মূল্য প্রতিযোগিতার গতি দেখুন।
  • Reddit-উৎসের AI-তৈরি কনটেন্ট ভুয়া উপস্থাপনা-সংক্রান্ত বিতর্ক ও বাস্তব ক্ষতির ঘটনা তালিকাবদ্ধ করুন এবং সেগুলো নিয়মকানুন বা মামলায় গড়ায় কি না দেখুন।
  • পরবর্তী X ও Reddit সংগ্রহে Stable Diffusion, Flux, ComfyUI, Wan ও Qwen-এর মতো সুস্পষ্ট ওপেন-সোর্স টার্ম যোগ করুন।
  • Pinterest-কে ওপেন-সোর্সের সূচক হিসেবে নয়, ভোক্তামুখী ক্লোজড টুলের জনপ্রিয়তার বিশেষ উৎস হিসেবে ব্যবহার করুন।

সংগৃহীত ছবি

Just Nail It 🎥How Generative AI Will Reshape Every Industry4 Major AI Updates You Need to Know in 2026AI Image GenerationimageAI Content Studio & Automation Secrets 🚀📱12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MoreAI For Image And video Generation‎🚨 AI is getting scary good.image5 ChatGPT side hustles you can start tonight 🚀Top Free AI Tools for Social Media Content Creation & Growth 2026 ✨GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSNew York's Bold Gambit: Inside the Legislative...Join us for daily SEO!🚀 Scope of AI in 2030: How Artificial Intelligence Will Transform Our FutureAI Video Creation Services | AI-Powered Video ProductionAI Voiceovers for News & Current Affairs VideosAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Easiest Way to Make Money with AI in 2025May 6 AI News UpdateimageVidu AI Tutorial - NEW Amazing Text To Video AI GeneratorAI News: Anthropic Leak Shows Us The Future of AI...imageFollow 👉 grow your brand with AI, faster ⚡"Why AI Chatbots Fail at Keeping Up with Breaking News"Google announces ultra-high quality video...imageThe news industry is evolving rapidlyStop scrolling… this story will completely change how you see AI!AI news videos blur line between real and fake reportsimageAI-Powered YouTube Marketing for 2026Why AI-Powered News Platforms Are Growing Faster in 2026AI Is Writing the News – Can We Still Trust Journalism?Create Viral Content Using AIAI News: OpenAI Finally Released What We Asked ForAI content and social media concernsWatermarking AI Content: Proving Origin (2025 Challenge)You Are Not Prepared for This Terrifying New Wave of AI-Generated Videosbest free 15 ai toolsgenerate ai images, art, illustration, using with midjourneyHear from one of the top minds in AI marketing!Latest AI News & ArticlesHow to Generate AI Images in Google Search With a Text DescriptionAI Ecosystem interconnected Artificial Intelligence Ecosystemimageimageimage

ডেটার গুণমান সংক্রান্ত নোট

Bluesky 12টি কুয়েরিতে 200-এর বেশি পোস্ট নিয়ে লক্ষ্যকে অনেকটাই ছাড়িয়েছে। কিন্তু Reddit (12টি), X (7–8টি; ক্রোয়েশিয়া-নির্দিষ্ট অঞ্চলের কারণে ওপেন-সোর্স উল্লেখ শূন্য) এবং Lemmy (প্রায় 9টি) প্রায় 20টির সমাপ্তি-মানদণ্ডে পৌঁছায়নি। YouTube-এ JavaScript রেন্ডারিংয়ের সীমাবদ্ধতায় ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।

গ্যালারি