ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-22
2026-09-24-এ Sora-এর API বন্ধ হয়ে যাওয়াই এই মুহূর্তের ক্লোজড-সোর্স জগতের সবচেয়ে গুরুত্বপূর্ণ গল্প। অন্যদিকে MiniMax H3 এবং চীনা ওপেন-ওয়েট ল্যাবগুলো (Alibaba/Qwen, ByteDance, Baidu, Tencent) ComfyUI-কেন্দ্রিক দ্রুততম-বর্ধনশীল ওপেন-সোর্স ইকোসিস্টেমকে এগিয়ে নিচ্ছে।
ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-22
ক্লোজড-সোর্স দুনিয়ার সবচেয়ে বড় খবর হলো OpenAI-এর Sora ভিডিও জেনারেশন API 2026-09-24-এ (এই প্রতিবেদনের দুই দিন পর) পুরোপুরি বন্ধ হচ্ছে — অ্যাপটি এপ্রিলেই বন্ধ হয়েছে; দিনে প্রায় ১০ লাখ ডলার পরিচালন ব্যয়ের বিপরীতে মোট আয় ছিল প্রায় ২১ লাখ ডলার, ফলে ব্যবসায়িক হিসাব খারাপ হওয়াই এর পটভূমি। এদিকে GPT Image 2.5 এবং Google DeepMind-এর Nano Banana Pro/2 গতি ও ফটোরিয়ালিজমে প্রতিদ্বন্দ্বিতা করছে, আর ক্লোজড শিবিরের উন্নয়ন-লড়াই কয়েক সপ্তাহ পরপর আপডেটে তীব্র হচ্ছে। ওপেন-সোর্স দিকটিতে MiniMax H3-কে কেন্দ্র করে ComfyUI ইকোসিস্টেম ধারাবাহিকভাবে বাড়ছে; Alibaba (Qwen), ByteDance, Baidu ও Tencent-সহ চীনা ল্যাবগুলোর নতুন মডেল প্রকাশ বিশেষভাবে চোখে পড়ছে। একাধিক প্ল্যাটফর্মে এমন কথাও উঠছে যে ক্লোজড ও ওপেন মডেলের ব্যবহারিক মানের ব্যবধান কমে এসেছে।
সব প্ল্যাটফর্মজুড়ে
- Sora API বন্ধ হওয়া (2026-09-24) ক্লোজড-সোর্সের সবচেয়ে আলোচিত যৌথ বিষয়। Bluesky-তে Ed Zitron-এর পোস্টটি (3,572 লাইক, এই সংগ্রহের সর্বোচ্চ এনগেজমেন্ট) প্রথম খবরটি দেয়; YouTube-এর State of AI Video সারাংশ এবং Lemmy-র !ai_reddit পোস্টেও একই বিষয় উঠে আসে। তিনটি প্ল্যাটফর্মই স্বাধীনভাবে ঘটনাটিকে সবচেয়ে গুরুত্বপূর্ণ হিসেবে দেখেছে, যেখানে আয় ও ব্যয়ের খারাপ সমীকরণকে “ক্লোজড-সোর্সে বিজয়ী সবকিছু নিয়ে যায় না”-এর উদাহরণ হিসেবে বলা হয়েছে।
- MiniMax H3 ওপেন-সোর্স ভিডিও জেনারেশনের সাধারণ কীওয়ার্ড। Reddit-এ Wan ও MiniMax H3 বিনা খরচে চালানোর উপায় নিয়ে নির্দিষ্ট আলোচনা হয়েছে; Bluesky-তে Adina Yakup MiniMax H3-এর ৮-স্টেপ দ্রুত ডিস্টিলড সংস্করণ “HyperFlow” পরিচয় করিয়েছেন; Lemmy-তে ComfyUI-র জন্য MiniMax H3-সংক্রান্ত পাঁচটির বেশি নোড আগস্ট থেকে সেপ্টেম্বর পর্যন্ত পোস্ট হয়েছে। তিন প্ল্যাটফর্মেই স্বাধীনভাবে একই মডেলের নাম উঠে এসেছে, ফলে একে সবচেয়ে গতিশীল ওপেন-ওয়েট ভিডিও মডেল বলা যায়।
- GPT Image 2.5 ক্লোজড ইমেজ জেনারেশনের প্রতিনিধিত্বশীল মডেল হিসেবে তিন প্ল্যাটফর্মেই উল্লেখিত। Reddit-এর r/ImagineAiArt-এ (92 পয়েন্টের থ্রেড) প্রশংসার পাশাপাশি “KREA2-এর সঙ্গে ব্যবহারিক পার্থক্য নেই” কথাও এসেছে; YouTube-এ ৫০% কম জেনারেশন লেটেন্সি ও Sketch ফিচার ব্যাখ্যা করা হয়েছে; Bluesky-র Simon Willison-ও মডেলটি দিয়ে ধারণাচিত্র তৈরি করেছেন।
- চীনা ল্যাবগুলোর উপস্থিতি ওপেন-সোর্স অংশে বিশেষভাবে স্পষ্ট। Bluesky-র Adina Yakup, YouTube ও Lemmy—তিন জায়গাতেই Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) এবং Tencent (HunyuanVideo 1.5)-এর মতো চীনা প্রতিষ্ঠানের Apache-2.0-ধরনের ওপেন-ওয়েট মডেল বারবার আলোচিত হয়েছে। একাধিক প্ল্যাটফর্মের তথ্যই দেখায় যে ওপেন-সোর্স প্রবণতার মূল চালিকাশক্তি প্রায় সম্পূর্ণভাবে চীনা প্রতিষ্ঠানগুলো।
- ComfyUI কার্যত অভিন্ন ভিত্তি হয়ে উঠেছে। YouTube-এর প্রায় সব রিভিউ এবং Lemmy-র !«メールアドレス»-এর অধিকাংশ পোস্ট ComfyUI-তে ইমপ্লিমেন্টেশন বা ওয়ার্কফ্লোর কথা বলে। ওপেন-সোর্স টুলের বাস্তব ব্যবহার ক্রমে ComfyUI-তে কেন্দ্রীভূত হচ্ছে।
- ক্লোজড ও ওপেনের ব্যবহারিক মানের ব্যবধান কমছে—এমন মত আছে। Reddit-এ মন্তব্য এসেছে, “GPT Image 2.5 ও KREA2—দুটির ফল একই রকম দেখায়।” বিপরীতে Pinterest-এ ক্লোজড-সোর্সের বিপণন অনেক বেশি দৃশ্যমান, আর ওপেন-সোর্সের উল্লেখ প্রায় শূন্য — এর অর্থ সম্ভবত “ওপেন-সোর্স দুর্বল” নয়, বরং “সাধারণ ভোক্তার কাছে কম দৃশ্যমান।”
প্ল্যাটফর্মভিত্তিক
Reddit: ৭টি সাবরেডিট থেকে ১২টি থ্রেড সংগ্রহ করা হয়েছে। বিনা খরচে AI ভিডিও বানানোর চাহিদা এবং তার বিপরীতে “এটা আর সম্ভব নয়, মেনে নাও”—এই নিরুৎসাহিত মনোভাব প্রধান দ্বন্দ্ব। Wan ও MiniMax H3-এর মতো ওপেন-ওয়েট মডেলের পরামর্শ স্বতঃস্ফূর্তভাবে অনেক এসেছে। DeepSeek-এর ব্যবহারকারী দ্রুত বেড়ে যাওয়া (+66.7%) এবং কম্পিউটিং ক্ষমতার ঘাটতিও স্পষ্ট সংকেত। একই রেফারেল কোডের প্রচারমূলক মন্তব্য একাধিক থ্রেডে দেখা গেছে, তাই স্বাভাবিক আলোচনায় বিজ্ঞাপন মেশার বিষয়ে সতর্ক থাকা দরকার।
X: সংগৃহীত ৩২টি পোস্ট ও ৩১টি অ্যাকাউন্টের একটিতেও ছবি বা ভিডিও জেনারেশন AI-এর উল্লেখ ছিল না। ব্যবহৃত অনুসন্ধান শব্দগুলো (Bitcoin, Zelensky, Zagreb ইত্যাদি) ছিল X-এর সাধারণ Explore ট্রেন্ড—সম্ভবত ক্রোয়েশিয়া অঞ্চলের স্থানীয় ট্রেন্ড—এবং থিমের সঙ্গে সম্পর্কহীন। তাই X থেকে এ বিষয়ের কোনো বাস্তব অন্তর্দৃষ্টি পাওয়া যায়নি।
YouTube: WebSearch-এর মাধ্যমে ৩০টির বেশি শিরোনাম পাওয়া যায় এবং ১৩টি প্রতিনিধিত্বশীল ভিডিও নেওয়া হয়। ক্লোজড দিকটিতে GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 এবং Kling 3.0-এর বহুমুখী তুলনা নিয়মিত ফরম্যাট। ওপেন দিকটিতে Z-Image Turbo, Qwen-Image-2.1, LTX-2 ও HunyuanVideo 1.5-এর মতো “মান না কমিয়ে হালকা করা” প্রবণতা চলমান। পেজগুলো JavaScript-এ রেন্ডার হয় বলে ভিউ সংখ্যা ও নির্ভুল তারিখ পাওয়া যায়নি; এগুলো আনুমানিক হিসেবে ধরা হয়েছে।
Bluesky: অনুসন্ধান API (searchPosts) সবসময় 403 দেওয়ায় ব্যবহার করা যায়নি, তাই সম্পর্কিত অ্যাকাউন্টের ফিড সরাসরি পড়ে বিকল্প নমুনা নেওয়া হয়েছে। Ed Zitron-এর Sora-বন্ধের পোস্ট সর্বোচ্চ এনগেজমেন্ট পেয়েছে। ওপেন-সোর্স সংবাদ প্রায় একাই Hugging Face-এর Adina Yakup-এর ওপর নির্ভরশীল; Civitai, ComfyUI এবং Stability AI-এর অফিসিয়াল অ্যাকাউন্টগুলো নীরব বা নিষ্ক্রিয় ছিল।
Lemmy: ৮টি কমিউনিটি ও ১৬টি পোস্ট বিশ্লেষণ করা হয়েছে। ক্লোজড-সোর্স সংবাদ প্রায় সবই Reddit মিরর (!ai_reddit) বা Hacker News মিরর (!hackernews)-এর মাধ্যমে পরোক্ষভাবে এসেছে এবং স্কোরও কম। একমাত্র ভাইরাল খবর ছিল Midjourney-এর “ইমেজ জেনারেশন → চিকিৎসা-ব্যবহারের আল্ট্রাসাউন্ড CT স্ক্যানার” ব্যবসায় মোড় নেওয়ার খবর (score 40)। ওপেন-সোর্স অংশে আগস্ট থেকে সেপ্টেম্বর পর্যন্ত MiniMax H3-এর ComfyUI নোডের পোস্ট অব্যাহত ছিল।
Pinterest: ৫০টি পিন বিশ্লেষণ করা হয়েছে। “Best AI Video Generator”-ধরনের তালিকামূলক ছবি এবং সাধারণ AI রোবট ভিজ্যুয়ালই অধিকাংশ; Kling AI ও Hailuo AI যে Runway, Pika ও Luma-র সঙ্গে শীর্ষ স্তরে ঢুকেছে তা বোঝা যায়। ৫০টির মধ্যে ওপেন-সোর্সের বাস্তব উল্লেখ প্রায় শূন্য; কেবল “Open Models. Open weights.” শিরোনাম একবার এসেছে — এটিই গুরুত্বপূর্ণ অনুসন্ধান যে ভোক্তা-কেন্দ্রিক প্ল্যাটফর্মে ওপেন-সোর্স প্রায় অদৃশ্য।
ব্রিফে নির্ধারিত ৬টি প্ল্যাটফর্মের মধ্যে X (ভুল অনুসন্ধান শব্দের কারণে কার্যত ০টি) এবং Reddit (লক্ষ্য ২০টির বদলে ১২টি থ্রেড) “প্রায় ২০টি পোস্ট বিশ্লেষণ”-এর সমাপ্তির মানদণ্ড পূরণ করেনি। এগুলোকে সীমাবদ্ধতা হিসেবে স্পষ্ট করা হলো; ব্রিফে উল্লেখ না থাকা অন্য প্ল্যাটফর্মের অনুপস্থিতি এর আওতার বাইরে।
যা নজরে রাখবেন
- Sora API বন্ধের (2026-09-24) পর ব্যবহারকারীরা কোথায় যাবে — Bluesky, Ed Zitron পোস্ট: https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
- Qwen-Image-2.1-এর “অ-বাণিজ্যিক গবেষণা লাইসেন্স” প্রশ্ন — একে ওপেন-সোর্স বলা যায় কি না, সেই বিতর্ক। YouTube: https://www.youtube.com/watch?v=tP_gGGJzEqg
- MiniMax H3 × ComfyUI ইকোসিস্টেমের সম্প্রসারণের গতি — Lemmy: https://lemmy.dbzer0.com/post/74279236
- LTX-2 কি ওপেন-সোর্স ভিডিওর নতুন বেঞ্চমার্ক হবে? — YouTube: https://www.youtube.com/watch?v=27UAb_Tlv4E
- DeepSeek-এর দ্রুত চাহিদা বৃদ্ধি (+66.7%) ও কম্পিউটিং ঘাটতির পরিণতি — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Midjourney-এর চিকিৎসা-যন্ত্র ব্যবসায় মোড় নেওয়ার পরবর্তী খবর — Lemmy: https://awful.systems/post/8731127
সুপারিশ
- Sora API বন্ধ হওয়ার পরের মাইগ্রেশন ট্রাফিক Seedance 2.5, MiniMax H3 ও Kling v3-এর মধ্যে কোনটিতে যায়, পরবর্তী গবেষণায় তা অনুসরণ করুন।
- Qwen-Image-2.1-এর লাইসেন্স নীতি বদলায় কি না, Hugging Face ও Alibaba-র অফিসিয়াল ঘোষণাগুলো নিয়মিত পর্যবেক্ষণ করুন।
- MiniMax H3-সম্পর্কিত ComfyUI নোড পোস্টের ঘনত্বকে ওপেন-সোর্স ভিডিও জেনারেশনের গতি মাপার অগ্রবর্তী সূচক হিসেবে ট্র্যাক করুন।
- পরবর্তী X সংগ্রহে আঞ্চলিক ট্রেন্ডের বদলে "AI image generation" "Sora" "Midjourney"-এর মতো বিষয়ভিত্তিক অনুসন্ধান শব্দ ব্যবহার করুন।
- Reddit সংগ্রহও একক অনুসন্ধান শব্দের বদলে পৃথক মডেলের নাম দিয়ে একাধিক অনুসন্ধানে বদলান, যাতে সমাপ্তির মানদণ্ড (২০টি) পূরণ করা যায়।
- Midjourney-এর চিকিৎসা-ব্যবহারের আল্ট্রাসাউন্ড CT-তে মোড় নেওয়ার খবর প্রাথমিক উৎস (midjourney.com/medical) দিয়ে যাচাই করুন এবং ভাইরাল হওয়া দ্বিতীয়-হাত তথ্য থেকে আলাদা রাখুন।
ডেটার মান
X-এ ভুল অনুসন্ধান শব্দের কারণে ৩২টি পোস্টের মধ্যে থিম-সম্পর্কিত পোস্ট ছিল ০টি; ফলে বিষয়টি নিয়ে কার্যকর অন্তর্দৃষ্টি দেওয়া যায়নি। Reddit-এ কেবল একটি অনুসন্ধান শব্দ থেকে ১২টি থ্রেড পাওয়া গেছে, লক্ষ্য প্রায় ২০টিতে পৌঁছানো যায়নি। Bluesky-র অফিসিয়াল সার্চ API সবসময় 403 দেওয়ায় অ্যাকাউন্টের ফিড সরাসরি পড়ে নমুনা নেওয়া হয়েছে; এটি পূর্ণাঙ্গ কীওয়ার্ড অনুসন্ধান নয়। YouTube-এর পেজ JavaScript-এ রেন্ডার হওয়ায় ভিউ সংখ্যা ও সঠিক প্রকাশ-তারিখ পাওয়া যায়নি; তারিখগুলো আনুমানিক। Lemmy একটি বিকেন্দ্রীভূত ইনস্ট্যান্সভিত্তিক ব্যবস্থা হওয়ায় আন্তঃইনস্ট্যান্স অনুসন্ধান সম্ভব হয়নি; যাচাই প্রধান ৬টি ইনস্ট্যান্সে সীমিত। Pinterest-এ ৫০টি পিন বিশ্লেষণ করা গেলেও ওপেন-সোর্সের উল্লেখ প্রায় ছিল না, তাই ডেটা এক দৃষ্টিভঙ্গি—ক্লোজড-সোর্স—কেন্দ্রিক।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ
কোথায়
সংগৃহীত ১২টি থ্রেড ৭টি সাবরেডিট থেকে এসেছে।
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত থ্রেডসংখ্যা |
|---|---|---|
| r/generativeAI | 155,851 | 5 |
| r/ImagineAiArt | 19,415 | 1 |
| r/aivideomaking | 7,414 | 2 |
| r/DeepSeek | 140,403 | 1 |
| r/Purdue | 100,714 | 1 |
| r/aivideos | 123,539 | 1 |
| r/Instagramreality | 1,155,229 | 1 |
r/generativeAI-তে সবচেয়ে বেশি থ্রেড, আর আলোচনার কেন্দ্র “বিনা খরচে AI ভিডিও বানাতে চাই”—এই চাহিদা। বিশেষজ্ঞধর্মী r/aivideomaking, r/aivideos ও r/ImagineAiArt-এ নির্দিষ্ট টুল ও প্রযুক্তি নিয়ে আলোচনা; r/DeepSeek-এ একক মডেলের সংবাদ; আর r/Purdue ও ১১.৫ লাখের বেশি সদস্যের r/Instagramreality-তে বাস্তব জগতে AI-তৈরি কনটেন্ট ঢুকে বিতর্ক সৃষ্টি করার ঘটনা।
মানুষ কী বলছে
- বিনা খরচে AI ভিডিও জেনারেশনের চাহিদা এখনও শক্তিশালী, কিন্তু কমিউনিটির মনোভাব “এটা আর সম্ভব নয়, মেনে নাও”-এর দিকে ঝুঁকছে। থ্রেড #2 “Why do so many people expect to find a free AI video generator?” (39 পয়েন্ট, 79 মন্তব্য, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/)—এ পোস্টদাতা নিজেই বলেছেন, “Sora 2 বিনা খরচে প্রকাশিত হয়ে প্রচুর ব্যবহারকারী পেয়েছিল, কিন্তু শেষ পর্যন্ত OpenAI এটি বন্ধ করেছে”; তাঁর উপসংহার ছিল, “AI ভিডিও জেনারেশন ব্যয়বহুল, আর বিনা খরচের মডেল টেকসই নয়।”
- একই থ্রেডের u/buttchuckjones (4 পয়েন্ট) বলেন, তিনি “10GB VRAM থেকে এখন 5080 (16GB)-এ লোকাল জেনারেশন করছেন,” এবং চান যে সাবরেডিটের মানুষ লোকাল জেনারেশনের দিকে আরও আগ্রহী হোক—যা লোকাল/ওপেন-সোর্স পদ্ধতিকে উৎসাহিত করে।
- থ্রেড #1 “Which AI video generator can still be used for free?” (20 পয়েন্ট, 68 মন্তব্য, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/)-এ u/RioMetal (4 পয়েন্ট) “Wan বা Minimax-এর মতো লোকাল বিকল্প অনেক আছে” বলে ওপেন-ওয়েট মডেল সুপারিশ করেন। u/tuckken2 (3 পয়েন্ট) নির্দিষ্টভাবে বলেন, “Wan 2.2 ও Minimax H3 cnaps studio-তে ফ্রি; প্রতি ৫ ঘণ্টায় ক্রেডিট রিসেট হয়।”
- ক্লোজড-সোর্স দিকটিতে GPT Image 2.5 Flare আলোচনার কেন্দ্রে। থ্রেড #3 “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (92 পয়েন্ট, 62 মন্তব্য, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/)-এ u/oldboi777 (4 পয়েন্ট) একে “অসাধারণ উন্নতি” বলে প্রশংসা করেন। বিপরীতে u/Dependent_Quit_3730 (3 পয়েন্ট) বলেন, “এটি নিখুঁত মডেল… কিন্তু আমি এখনও KREA 2-ই ব্যবহার করি”; u/SeaworthinessFresh16 (2 পয়েন্ট) বলেন, “ComfyUI-তে Krea2-এর ফল একই রকম দেখায়”—অর্থাৎ ওপেন টুলের সঙ্গে বাস্তব পার্থক্য তাঁর চোখে নেই।
- DeepSeek (ওপেন-ওয়েট) দ্রুত বৃদ্ধি ও সরবরাহ-সংকট—দুটিই একসঙ্গে দেখাচ্ছে। থ্রেড #6 “some deepseek news, if you care” (206 পয়েন্ট, 36 মন্তব্য, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)-এ জানানো হয়েছে, দৈনিক সক্রিয় ব্যবহারকারী ১.২ কোটি থেকে ২ কোটি (+66.7%) হয়েছে, কিন্তু কম্পিউট ক্ষমতা মাত্র +8.3% বেড়েছে; এতে মান কমা ও পুনরায় জেনারেশনের সমস্যা হচ্ছে। সমাধান হিসেবে Huawei থেকে ১.৬ লাখ Ascend 960DT অর্ডারের কথা বলা হয়। u/Equivalent-Grass-527 (6 পয়েন্ট) মন্তব্য করেন, “চাহিদা ও কম্পিউটের এই অসামঞ্জস্যই সম্ভবত সবচেয়ে গুরুত্বপূর্ণ বিষয়।”
- “AI-সুলভ ভাব” দূর করার কারিগরি দক্ষতার মূল্যায়ন বিভক্ত। থ্রেড #8 “I stopped prompting for clean shots and my AI video finally stopped looking like AI” (63 পয়েন্ট, 56 মন্তব্য, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/、Seedance 2.5 ব্যবহার)-এ বিস্তারিত প্রম্পট কৌশল ভাগ করা হলেও মন্তব্যগুলো সন্দেহপ্রবণ। u/TCristatus (9 পয়েন্ট) বলেন, “অনেক ফাঁকা কথা, ভিডিওটি এখনও স্পষ্টতই AI”; u/Biscuits4u2 (6 পয়েন্ট) বলেন, “বাস্তবসম্মত দেখাতে মানুষকে ৫ শতাংশ কম সুন্দর হতে হবে। মুখগুলো অতিরিক্ত নিখুঁত।”
- AI-তৈরি ছবি বাস্তব পরিবেশে ঢুকে পড়ার ঘটনা বিতর্ক তৈরি করছে। থ্রেড #7 “AI generated image on MSEE wall” (61 পয়েন্ট, 13 মন্তব্য, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/)-এ ক্যাম্পাসে টাঙানো AI-তৈরি ছবির সার্কিট বোর্ড লেআউটের অর্থহীনতা সমালোচিত হয়। u/j909m (11 পয়েন্ট) বলেন, “ওই IC-এর PCBA লেআউট যিনি করেছেন, তাঁর F পাওয়া উচিত।”
- ১১.৫ লাখের বেশি সদস্যের বৃহৎ সাবরেডিটেও AI-তৈরি ছবি ধরার প্রতিযোগিতা তীব্র। থ্রেড #12 “AI generated images on Reddit with thousands of upvotes and comments” (2,109 পয়েন্ট, 341 মন্তব্য, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/) ছিল সংগৃহীতগুলোর মধ্যে সবচেয়ে বেশি এনগেজমেন্ট পাওয়া পোস্ট। u/Smart-Membership-117 (405 পয়েন্ট) ছবির সূক্ষ্ম অসামঞ্জস্য—হাঁটুর কাছে বেসবোর্ডের ট্রিম এবং জানালার বাইরে গাছপালার বদলে যাওয়া—চিহ্নিত করেন। u/Negative-Raise-8286 (275 পয়েন্ট) অভিযোগ করেন যে মূল থ্রেডে তিনি বিষয়টি পোস্ট করতে পারেননি।
- “ফ্রি ক্রেডিট বেশ উদার”—এমন কথাও একাধিকবার এসেছে; তাই চিত্রটি শুধু হতাশার নয়। থ্রেড #9 (r/aivideomaking, 3 পয়েন্ট, 26 মন্তব্য, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/)-এ u/Chance-Business (2 পয়েন্ট) বলেন, “Google Flow-এ প্রতিদিন ৫০টি ফ্রি ক্রেডিট পাওয়া যায়, প্রতিটি ভিডিওতে ৬–১২ ক্রেডিট লাগে; বেশিরভাগ দিনই ৫০ ছুঁই না।” থ্রেড #4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/)-এ u/MrBoondoggles (1 পয়েন্ট) একইভাবে বলেন, “Google Flow-এ Nanobanana ও Veo ব্যবহার করা যায়; তাদের দৈনিক ফ্রি ক্রেডিট যথেষ্ট উদার।”
- একই রেফারেল কোডের প্রচার একাধিক থ্রেডে দেখা গেছে। u/MeatStickMcFapperton থ্রেড #2 (4 পয়েন্ট) এবং #5 (1 পয়েন্ট)—দুটিতেই Meta “Muse”-এর রেফারেল কোড “42JB8K” দিয়ে “১ বিলিয়ন টোকেন ফ্রি” প্রচার করে প্রায় একই ভাষার মন্তব্য পোস্ট করেছেন।
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: লোকাল/ওপেন-ওয়েট ভিডিও জেনারেশন (Wan, MiniMax H3, FramePack, ComfyUI)-এর উল্লেখ “ফ্রি চাই” ধরনের অধিকাংশ থ্রেডে স্বাভাবিকভাবেই আসে। DeepSeek-এর ব্যবহারকারী +66.7% বেড়ে যাওয়াও স্পষ্ট ঊর্ধ্বমুখী সংকেত।
- সন্দেহ ও নিরুৎসাহ: “ফ্রি AI ভিডিও চাই”—এই দাবির বিরুদ্ধেই প্রবল প্রতিক্রিয়া। থ্রেড #4-এ u/activematrix99 (2 পয়েন্ট) তীব্রভাবে বলেন, “কল্পনা করুন রেস্তোরাঁয় গিয়ে বিনা খরচে খেতে দাবি করছেন… কী এমন বিশেষত্ব আপনার যে তারা বিনা খরচে দেবে?” ফ্রি ভিডিও জেনারেশনের প্রত্যাশা নিয়ে এমন উপদেশধর্মী মন্তব্য একাধিক থ্রেডে উচ্চ ভোট পেয়েছে—কমিউনিটির মানসিকতার পরিবর্তনের ইঙ্গিত।
- অপ্রত্যাশিত বিষয়: একই রেফারেল কোড (“42JB8K”) ও প্রায় অভিন্ন বিক্রয়ভাষা বিভিন্ন থ্রেডে বারবার দেখা গেছে, যা স্বাভাবিক আলোচনার মধ্যে প্রচার বা কৃত্রিম মন্তব্য ঢুকে থাকার সম্ভাবনা বাড়ায়। সংখ্যাগুলো গ্রহণে সতর্কতা দরকার।
- বিরোধ: “ফ্রি ভিডিও জেনারেশন এখন কল্পনা” পক্ষ (থ্রেড #2, #9, #10-এ একাধিক উচ্চ ভোটপ্রাপ্ত মন্তব্য) এবং “Google Flow/Veo/Muse/Nanobanana-এর ফ্রি স্তর যথেষ্ট উদার” পক্ষ (থ্রেড #4, #5, #9) একই সাবরেডিটগুলোতেই সরাসরি বিরোধে আছে। উভয় পক্ষই অভিজ্ঞতাভিত্তিক দাবি করছে; সহজে একপক্ষকে সঠিক বলা যায় না।
- ক্লোজড বনাম ওপেনের ব্যবহারিক ব্যবধান সামান্য—এমন মতও আছে: থ্রেড #3-এ ক্লোজড GPT Image 2.5 Flare এবং ওপেন টুল ব্যবহারকারী KREA 2-কে “ফল একই দেখায়” বলা হয়েছে, যা ইমেজ জেনারেশনে দুই শিবিরের ব্যবহারকারীর চোখে মানের ব্যবধান প্রায় মিলিয়ে যাওয়ার ইঙ্গিত।
সীমাবদ্ধতা
- সংগ্রহ টুল কেবল “Image and Video Generation AI News” অনুসন্ধান শব্দটি ব্যবহার করেছে। ব্রিফের লক্ষ্য ছিল প্রতিটি সোশ্যাল নেটওয়ার্কে প্রায় ২০টি পোস্ট বিশ্লেষণ; বাস্তবে ৭টি সাবরেডিট থেকে মাত্র ১২টি থ্রেড পাওয়া গেছে। “Sora”, “Veo”, “Kling”, “Stable Diffusion”, “Flux”, “open source” / “closed source”-এর মতো পৃথক শব্দে বাড়তি অনুসন্ধান করলে আরও বেশি ও লক্ষ্যভিত্তিক থ্রেড পাওয়ার সম্ভাবনা ছিল।
- থ্রেড #9-এর মূল পোস্টের লেখা সংগ্রহের ডেটায় ছিল না; কেবল মন্তব্য দেখে এর বিষয়বস্তু বিচার করা হয়েছে।
- এই ধাপের প্লেবুকের নির্দেশনা অনুযায়ী Reddit-এ আলাদাভাবে ব্রাউজ বা সার্চ করা হয়নি; কেবল ইতিমধ্যে সংগৃহীত
output/reddit.threads.md/.jsonথেকে যাচাই করা হয়েছে। এখানে নেই এমন আলোচনা—যেমন নির্দিষ্ট ইমেজ/ভিডিও মডেলের বিশেষ থ্রেড—এই প্রতিবেদনের আওতার বাইরে।
X
X — ছবি ও ভিডিও জেনারেশন AI সংবাদ
অ্যাকাউন্টসমূহ
output/x.posts.md-এ সংগৃহীত ৩২টি পোস্ট ও ৩১টি অ্যাকাউন্ট পরীক্ষা করে দেখা গেছে, ছবি/ভিডিও জেনারেশন AI নিয়ে কাজ করে এমন একটি অ্যাকাউন্টও নেই। বিভাজন নিচে দেওয়া হলো; সবই বিষয়বহির্ভূত ক্ষেত্রে কেন্দ্রীভূত।
| ধরন | সংশ্লিষ্ট অ্যাকাউন্ট |
|---|---|
| ক্রিপ্টো/শেয়ার ($SDOG, $AMD, Bitcoin) | @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows |
| ইউক্রেন-রাশিয়া পরিস্থিতি | @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite |
| বিনোদন/রাজনৈতিক গসিপ (Lauren-সম্পর্কিত) | @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui |
| খেলাধুলা/লড়াই (Muhammad-সম্পর্কিত) | @CylinderAnalyst, @bullyb170 (2 পোস্ট) |
| ধর্ম | @TaymiFawaid |
| Zagreb-ট্রেন্ড সম্পর্কিত ব্যক্তিগত অ্যাকাউন্ট | @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy |
একটি বড় পোস্টে এনগেজমেন্ট পাওয়া অ্যাকাউন্ট (যেমন @AlaskanTzar-এর এক পোস্টে 34,704 লাইক) এবং অনেক ছোট পোস্ট করা অ্যাকাউন্ট—দুই ধরনেরই উপস্থিতি ছিল; কিন্তু কোনো অ্যাকাউন্টই ছবি/ভিডিও জেনারেশন AI সংবাদ বা টুল নিয়ে পোস্ট করেনি।
পোস্টসমূহ
সংগ্রহের ডেটায় থিমের সঙ্গে মেলে এমন পোস্ট না থাকায় ছবি ও ভিডিও জেনারেশন AI নিয়ে স্বাভাবিক “৫–১২টি অন্তর্দৃষ্টি” দেওয়া সম্ভব নয়। নমুনা হিসেবে সংগৃহীত কনটেন্টের কয়েকটি উদাহরণ:
- #8 @TedPillows (2,829 লাইক, 293 রিপোস্ট, প্রায় 486,000 প্রদর্শন, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562)— “Bitcoin $83,000 ভেঙে উঠলে সাইকেলের তল নিশ্চিত হবে...” — এটি Bitcoin বাজার বিশ্লেষণ, AI-এর সঙ্গে সম্পর্কহীন।
- #30 @AlaskanTzar (34,704 লাইক, 1,083 রিপোস্ট, প্রায় 1,500,000 প্রদর্শন, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636)— “2017 সালে রাশিয়া ও ইউক্রেন Twitter-এ একে অন্যকে ratio করছিল” — এই সংগ্রহের সর্বোচ্চ এনগেজমেন্ট, কিন্তু ইউক্রেন-রাশিয়া বিষয়ক মিম।
- #22 @Katauroraaa (2,840 লাইক, প্রায় 309,000 প্রদর্শন, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180)— রাশিয়া/বাল্টিক অঞ্চল নিয়ে ব্যঙ্গাত্মক পোস্ট।
কোনোটিতেই ইমেজ জেনারেশন বা ভিডিও জেনারেশন AI—ক্লোজড কিংবা ওপেন—নিয়ে কোনো উল্লেখ নেই।
সংকেত
- সংগ্রহের ডেটা থেকে একমাত্র সংকেত হলো, এই ধাপের অনুসন্ধান শব্দগুলো থিমের সঙ্গে সম্পর্কহীন ছিল। X-এর Explore ট্রেন্ড (নিচের Limits দেখুন) সরাসরি ব্যবহার করায় আলোচনা ক্রিপ্টো, ভূরাজনীতি, বিনোদন গসিপ ও খেলাধুলাতেই সীমাবদ্ধ ছিল।
- ছবি ও ভিডিও জেনারেশন AI সম্পর্কে “উর্ধ্বমুখী” বা “সন্দেহপ্রবণ” ধরনের কোনো বাস্তব আলোচনা এই ডেটায় একটিও দেখা যায়নি।
সীমাবদ্ধতা
-
অনুসন্ধান শব্দ থিমবহির্ভূত ছিল:
output/x.posts.md-এর শুরুতে দেখা যায়, ব্যবহৃত শব্দগুলো ছিল"$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR"। এগুলো “X's own Explore list” থেকে সরাসরি নেওয়া; “ইমেজ জেনারেশন AI”, “ভিডিও জেনারেশন AI”, “Sora”, “Midjourney”, “Stable Diffusion”—এ ধরনের থিমভিত্তিক কোনো শব্দ ব্যবহৃত হয়নি।# ট্রেন্ড স্থান (X-এর প্রদর্শন) 1 $SDOG Trending in Croatia 2 Bitcoin Business & finance · Trending 3 Zelensky Politics · Trending 4 Lauren Trending in Croatia 5 Muhammad Politics · Trending 6 Russians Politics · Trending 7 Zagreb Trending in Croatia 8 Ukraine Politics · Trending 9 Weeknd Trending in Croatia 10 USSR Politics · Trending এই Explore তালিকাটি সেশনের সার্ভার অবস্থানের সঙ্গে ভৌগোলিকভাবে যুক্ত—সম্ভবত ক্রোয়েশিয়া অঞ্চল—এবং বিশ্বব্যাপী ট্রেন্ড নয়।
-
সমাপ্তির মানদণ্ড পূরণ হয়নি:
brief.mdঅনুযায়ী প্রত্যেক SNS-এ প্রায় ২০টি পোস্ট বিশ্লেষণ করার কথা ছিল, কিন্তু ৩২টি সংগৃহীত পোস্টের মধ্যে ছবি/ভিডিও জেনারেশন AI-সম্পর্কিত পোস্ট ছিল ০টি। তাই এই প্রতিবেদনে X থেকে বিষয়টি নিয়ে কার্যকর কোনো অন্তর্দৃষ্টি দেওয়া যায়নি। -
সেশনটি কার্যকর ছিল—লগইন করা অবস্থায় সংগ্রহ হয়েছে এবং “no posts were collected”-জাতীয় ঘাটতি বার্তা ছিল না—তাই X-এর অনুসন্ধান বা ব্রাউজিং ব্যবস্থায় সমস্যা ছিল না। সমস্যা সংগ্রহ পর্যায়ে অনুসন্ধান শব্দের নির্বাচনে।
-
পরেরবার এই ধাপ চালানোর সময় “AI image generation”, “AI video generation”, “Sora 2”, “Midjourney”, “Stable Diffusion”, “Nano Banana”, “Veo”-এর মতো থিমভিত্তিক শব্দে পুনরায় সংগ্রহ দরকার।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড-সোর্স/ওপেন-সোর্স)
চ্যানেলসমূহ
- Matt Wolfe (@mreflow) — 925,000-এর বেশি সাবস্ক্রাইবারের AI সংবাদ চ্যানেল। Nano Banana Pro / Nano Banana 2-এর মতো ক্লোজড-সোর্স মডেলের দ্রুত রিভিউ নিয়মিত প্রকাশ করে। (https://www.youtube.com/@mreflow)
- Theoretically Media — LTX-2 / LTX-2.3 ও HunyuanVideo-ধারার ওপেন-সোর্স AI ভিডিও টুলের রিভিউ ও বাস্তব পরীক্ষা নিয়ে বিশেষায়িত চ্যানেল। (https://theoreticallymedia.com/videos/)
- Aitrepreneur — ComfyUI ওয়ার্কফ্লো ব্যাখ্যায় শক্তিশালী; LTX-2.3-এর মতো নতুন ওপেন-সোর্স ভিডিও মডেল লোকালে চালানো নিয়ে কনটেন্ট করে। (Patreon সংযোগ: https://www.patreon.com/aitrepreneur)
- অন্যান্য একাধিক মাঝারি মাপের AI টুল রিভিউ চ্যানেল Z-Image Turbo / Flux.2 / HunyuanVideo 1.5 নিয়ে কাজ করে (চ্যানেলের নাম শুধু ভিডিও শিরোনাম থেকে নিশ্চিত করা গেছে; সাবস্ক্রাইবার সংখ্যা অজানা — Limits দেখুন)।
ভিডিওসমূহ
-
Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN
date: 2025-11-26 | views: অজানা | https://www.youtube.com/watch?v=UV9GqinedQ8
Google DeepMind-এর Nano Banana Pro (Gemini 3 Pro Image) বিদ্যমান ইমেজ জেনারেশন AI-কে “প্রতিযোগিতার বাইরে” পর্যায়ে ছাড়িয়ে গেছে—এমন দাবি করে; টেক্সট রেন্ডারিংয়ের নির্ভুলতা ও ফটোরিয়ালিজমকে গুরুত্ব দেওয়া ক্লোজড-সোর্স রিভিউ। -
Google's Nano Banana Pro is raising concerns over realistic AI image generation
date: 2025 সালের নভেম্বরের শেষভাগ | views: অজানা | https://www.youtube.com/watch?v=RmmrVCUGYp8
বাস্তবতা এতটাই বেড়ে যাওয়ায় ডিপফেক ও ভুয়া তথ্যের ঝুঁকি নিয়ে উদ্বেগভিত্তিক সংবাদ ভিডিও। -
GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model
date: 2026-09-08-এর কাছাকাছি (২ সপ্তাহ আগে প্রকাশিত) | views: অজানা | https://www.youtube.com/watch?v=DY6TkI8XtkQ
OpenAI-এর GPT Image 2.5-এর পূর্ণাঙ্গ ব্যাখ্যা—জেনারেশন লেটেন্সি ৫০% কম এবং Sketch ফিচারে হাতে আঁকা ছবি AI ইমেজে রূপান্তর করা যায়। ক্লোজড-সোর্স শিবিরের সর্বশেষ আপডেট। -
Sketch with ChatGPT Images 2.5
date: 2026 সালের সেপ্টেম্বরের প্রথম ভাগ | views: অজানা | https://www.youtube.com/watch?v=imPtIEAEHSU
ChatGPT-তে “@Sketch” লিখে হাতে আঁকা ছবি সরাসরি AI ইমেজে বদলানোর নতুন ফিচারের ডেমো। -
State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows
date: 2026-03-20 | views: অজানা | https://www.youtube.com/watch?v=vtJzDgmWVWc
Sora 2, Veo 3.1 ও Kling 3.0—ক্লোজড-সোর্স ভিডিও জেনারেশনের তিন প্রধান প্রতিদ্বন্দ্বী—তুলনা করে, সঙ্গে সিনেম্যাটিক প্রম্পট কৌশলের সারাংশ। -
Seedance 2.5 REVIEW: ByteDance's New AI Video Model Explained
date: 2026-08-01 | views: অজানা | https://www.youtube.com/watch?v=LTAOvsH6cjM
ByteDance-এর Seedance 2.5 ৩০ সেকেন্ডের একটানা শট এবং সর্বোচ্চ ৫০টি রেফারেন্স ছবি ইনপুট সমর্থন করে; Sora 2 ও Veo 3.1-এর চেয়ে দীর্ঘ দৃশ্য ধরে রাখার ক্ষমতার কারণে আলোচিত। ক্লোজড-সোর্স। -
Kling 2.6 Pro DESTROYS Competition - Veo 3.1 & Sora 2 Pro
date: 2025-12-19 | views: অজানা | https://www.youtube.com/watch?v=-vRsjX9seUU
Kling 3.0 আসার আগে Kling 2.6 Pro-ই Veo 3.1 ও Sora 2 Pro-কে ছাড়িয়েছে—এমন বেঞ্চমার্ক ভিডিও। পরে Kling 3.0 (2026-02-05-এ মুক্তি, ELO স্কোর 1,243-এ শীর্ষে) পর্যন্ত সেই গতি বজায় থাকে। -
Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro)
date: 2025-11-27 | views: অজানা | https://www.youtube.com/watch?v=sPQQPpQ9X4E
Alibaba-এর Tongyi-MAI টিমের 6B প্যারামিটারের Apache-2.0 লাইসেন্স মডেল। 16GB ভোক্তা GPU-তে ৮-স্টেপ দ্রুত ইনফারেন্স সম্ভব করে; “Nano Banana Pro-এর সমতুল্য” বলে আলোচিত ওপেন-সোর্স মডেল। -
New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial
date: 2025-12-11 | views: অজানা | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Z-Image Flux.2-কে ছাড়িয়ে গেছে—এমন তুলনামূলক যাচাই ও টিউটোরিয়াল। -
FLUX.2 EL MEJOR MODELO OPEN SOURCE, EN LOCAL Y GGUF
date: 2025 সালের নভেম্বর-ডিসেম্বরের কাছাকাছি | views: অজানা | https://www.youtube.com/watch?v=t4eVxZPP0b0
Black Forest Labs-এর FLUX.2 সিরিজ (Pro/Flex/Dev এবং Apache-2.0-এর Klein-সহ) ComfyUI-তে লোকালে চালানোর গাইড। সর্বোচ্চ 4MP আউটপুট এবং ১০টি পর্যন্ত মাল্টি-রেফারেন্স সঙ্গতি এর শক্তি। -
The "Holy Grail" of Open Source AI Video is Here (LTX-2)
date: 2026 সালের জানুয়ারির প্রথম ভাগ | views: অজানা | https://www.youtube.com/watch?v=27UAb_Tlv4E
Lightricks-এর 2026-01-06-এ প্রকাশিত LTX-2 নেটিভ 4K, অডিও সিঙ্ক, সম্পূর্ণ ওপেন ওয়েট ও ট্রেনিং কোড প্রকাশ—এই সমন্বয় নিয়ে প্রথম “প্রোডাকশন-মানের” ওপেন-সোর্স ভিডিও মডেল হিসেবে প্রশংসিত। -
Tencent HunyuanVideo 1.5 has been officially open-sourced!
date: 2026 সালের প্রথমার্ধ | views: অজানা | https://www.youtube.com/watch?v=MJShdc8tkkA
Tencent 13B থেকে 8.3B প্যারামিটারে নামিয়েও কর্মক্ষমতা ধরে রেখে HunyuanVideo 1.5 প্রকাশ করেছে। ভোক্তা GPU-তে চলতে পারার বিষয়টি প্রশংসিত। -
Qwen-Image 2.1 | Early Access Showcase
date: 2026-09-20-এর কাছাকাছি (২ দিন আগে প্রকাশিত) | views: অজানা | https://www.youtube.com/watch?v=tP_gGGJzEqg
Alibaba Qwen-এর 2026-09-20-এ প্রকাশিত Qwen-Image-2.1-এর আগাম-প্রবেশ ডেমো: 7B-তে সংকুচিত ভিজ্যুয়াল জেনারেটর, জেনারেশন ও এডিটিং একীভূত, স্বচ্ছ RGBA আউটপুট সমর্থিত। তবে লাইসেন্সটি অ-বাণিজ্যিক, কেবল গবেষণার জন্য।
সংকেত
- ক্লোজড-সোর্সে “গতি ও ফটোরিয়ালিজম”-এর প্রতিযোগিতা তীব্র: GPT Image 2.5 (2026-09-08, ৫০% কম লেটেন্সি), Nano Banana Pro → Nano Banana 2 (2026, দ্বিগুণ গতি)—OpenAI ও Google কয়েক সপ্তাহ পরপর আপডেট নিয়ে প্রতিদ্বন্দ্বিতা করছে। ভিডিওতে Sora 2, Veo 3.1 ও Kling 3.0-এর ত্রিমুখী তুলনা নিয়মিত ফরম্যাট।
- Sora API-সহ বন্ধ হচ্ছে: Sora Web/অ্যাপ 2026-04-26-এ বন্ধ হয়েছে; API-ও 2026-09-24-এ—এই প্রতিবেদন লেখার দুই দিন পর—পুরোপুরি বন্ধ হওয়ার কথা। দিনে প্রায় ১০ লাখ ডলার পরিচালন ব্যয় এবং মোট প্রায় ২১ লাখ ডলার আয়ের খারাপ হিসাবকে কারণ বলা হয়েছে, যা ক্লোজড-সোর্স ভিডিও জেনারেশনে “বিজয়ী সবকিছু পায়”-এর সীমাবদ্ধতার উদাহরণ।
- ওপেন-সোর্স শিবির হালকা ও দ্রুত মডেলের দিকে যাচ্ছে: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (7B ভিজ্যুয়াল জেনারেটরে সংকুচিত), HunyuanVideo 1.5 (13B → 8.3B)—সব ক্ষেত্রেই মান কমানো ছাড়া প্যারামিটার কমিয়ে ভোক্তা GPU-তে চালানোর প্রকাশনা দেখা যাচ্ছে।
- ওপেন ওয়েট ও বাণিজ্যিক লাইসেন্সের সীমারেখা বিতর্কের বিষয়: Flux.2-এর একটি অংশ (Klein) Apache 2.0-এ সম্পূর্ণ উন্মুক্ত; অন্যদিকে Qwen-Image-2.1 ওয়েট প্রকাশ করলেও “অ-বাণিজ্যিক গবেষণা-শুধু লাইসেন্স” স্পষ্ট করেছে। মন্তব্য ও রিভিউ উভয় জায়গায় এটি সত্যিই ওপেন-সোর্স কি না, আলোচনা চলছে।
- LTX-2 ওপেন-সোর্স ভিডিওর বেঞ্চমার্ক হয়ে উঠছে: “নেটিভ 4K + অডিও সিঙ্ক + ট্রেনিং কোড পর্যন্ত প্রকাশ”—এই প্রথম সমন্বয়ের কারণে Wan 2.2 / HunyuanVideo 1.5-এর সঙ্গে লোকাল ভিডিও জেনারেশনের শীর্ষ তিন মডেল তুলনা একাধিক চ্যানেলে হয়েছে।
- ComfyUI কার্যত অভিন্ন ভিত্তি: Flux.2, Z-Image, LTX-2, Wan ও HunyuanVideo—সবগুলোরই Day-0 ComfyUI সাপোর্ট ও ওয়ার্কফ্লো ভিডিও ব্যাপক; ওপেন-সোর্স রিভিউয়ের প্রায় সবকটিই ComfyUI-তে বাস্তব পরীক্ষা করে।
সীমাবদ্ধতা
- YouTube অনুসন্ধান ফলাফল (
/results?search_query=...) ও ভিডিও পেজ (/watch?v=...) JavaScript-এ রেন্ডার হয়; WebFetch-এ শুধু ফুটারের নেভিগেশন লিংক পাওয়া গেছে। ফলে সঠিক ভিউ সংখ্যা, চ্যানেলের নাম, প্রকাশের সময় ও সাবটাইটেল/মন্তব্য সরাসরি পাওয়া যায়নি। তাই তারিখগুলো অনুসন্ধান স্নিপেট ও সম্পর্কিত লেখা থেকে অনুমিত, আর সব ভিউ “অজানা” হিসেবে রাখা হয়েছে। - এ সীমাবদ্ধতায় প্রায় ২০টি পোস্ট আলাদাভাবে খুলে বিশ্লেষণের আদর্শ পদ্ধতি অনুসরণ করা যায়নি। পরিবর্তে WebSearch-এর মাধ্যমে শিরোনাম, চ্যানেল-সংক্রান্ত ইঙ্গিত ও প্রকাশকাল সংগ্রহ করা হয়েছে। বিভিন্ন অনুসন্ধানে ৩০টির বেশি ভিডিও শিরোনাম পাওয়া যায়, যার মধ্যে ওপরের ১৩টি প্রতিনিধিত্বশীল নমুনা।
- Qwen-Image-2.1-সংক্রান্ত ভিডিও প্রকাশের মাত্র দুই দিন পরের; আগামী কয়েক সপ্তাহে রিভিউয়ের সংখ্যা বাড়ার সম্ভাবনা বেশি।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ
অ্যাকাউন্টসমূহ
- Ed Zitron (
edzitron.com) — প্রযুক্তি/AI শিল্প সমালোচক (Where's Your Ed At); Bluesky-তে বড় এনগেজমেন্টের সঙ্গে Sora বন্ধের খবরটি জানান। - Simon Willison (
simonwillison.net) — স্বাধীন AI গবেষক; তাঁর “pelican” পরীক্ষাসহ নতুন মডেল, ইমেজ জেনারেটর নিয়মিত বেঞ্চমার্ক করেন এবং তৈরি ধারণাচিত্র পোস্ট করেন। - Adina Yakup (
adinayakup.bsky.social) — Hugging Face-এর ওপেন-সোর্স ML সমর্থক; Bluesky-তে নতুন ওপেন-ওয়েট ছবি/ভিডিও মডেল প্রকাশের সবচেয়ে সক্রিয় ধারাভাষ্যকার, প্রায় প্রতি সপ্তাহেই পোস্ট করেন। - useapi.net (
useapi.bsky.social) — Veo, Kling, Seedance, Runway, MiniMax ইত্যাদি AI ভিডিও/ছবি/সঙ্গীত জেনারেশনের REST-API রিসেলার; নিয়মিত মডেল-তুলনা পোস্ট করে। - GPT Image Prompt (
gptimageprompt.bsky.social) — OpenAI-এর ChatGPT/GPT Image টুলকেন্দ্রিক প্রম্পট ভাগাভাগির অ্যাকাউন্ট। - Stable Diffusion online AI (
stablediffusion.bsky.social) — Stable Diffusion প্রম্পট ও AI আর্ট চ্যালেঞ্জের দীর্ঘদিনের কমিউনিটি অ্যাকাউন্ট। - Stability AI (অফিসিয়াল) — 2025 সালের নভেম্বরের কাছাকাছি থেকে ছবি/ভিডিও নিয়ে নীরব; সাম্প্রতিক পোস্ট প্রায় সবই Stable Audio ও সঙ্গীত লেবেলের অংশীদারিত্ব (Warner, Universal) নিয়ে, Stable Diffusion ইমেজ মডেল নয়।
পোস্টসমূহ
-
Ed Zitron — OpenAI Sora বন্ধ করছে (2026-03-24, 👍 3,572 · 🔁 984)
“Wall Street Journal এবং The Information—দুটিই নিশ্চিত করছে যে OpenAI Sora বন্ধ করছে; অ্যাপ এবং ডেভেলপারদের ভিডিও-জেনারেশন মডেল ব্যবহারের সুযোগ—দুটিই। এটি বিশাল পদক্ষেপ, যা পরিস্থিতি কিছুটা মরিয়া হতে পারে বলে ইঙ্গিত দেয়।”
https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
(এটি সেই প্রতিবেদনের সঙ্গে সামঞ্জস্যপূর্ণ যে Sora অ্যাপ 2026-04-26-এ বন্ধ হয়েছে এবং API 2026-09-24-এ বন্ধ হওয়ার কথা—এই গবেষণা চালানোর দুই দিন পর।) -
Simon Willison — ChatGPT Images 2.5 দিয়ে তৈরি (2026-09-10, 👍 56 · 🔁 5)
“GPT-6 Astra দিয়ে বানানো Pluribus-থিমের Fabergé ডিমের একটি Blender মডেল এখানে আছে—ধারণাচিত্রটি আমি ChatGPT Images 2.5 দিয়ে তৈরি করেছি।”
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Adina Yakup — HyperFlow (ওপেন ভিডিও ডিস্টিলেশন) (2026-09-19, 👍 6 · 🔁 1)
“HyperFlow⚡ Video Rebirth-এর নতুন MiniMax-H3 ভ্যারিয়েন্ট — ওপেন-ওয়েট 8-step LoRA — ডেটা-ফ্রি সেলফ-ডিস্টিলেশনে 3× দ্রুত; ভিডিও ও স্টেরিও অডিও অক্ষুণ্ণ।”
https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b -
Adina Yakup — ByteDance-এর Lance (2026-05-19, 👍 48 · 🔁 5)
“ByteDance Lance প্রকাশ করেছে👀 — এই 3B মডেল ছবি তৈরি, ছবি সম্পাদনা, ভিডিও তৈরি, ভিডিও সম্পাদনা করতে পারে এবং ছবি/ভিডিও দুটিই বুঝতে পারে।”
https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b -
Adina Yakup — Baidu-এর ERNIE-Image (2026-04-14, 👍 1)
“Baidu Hugging Face-এ ERNIE-Image প্রকাশ করেছে🔥 — 8B DiT - Image/Image Turbo — Apache 2.0।”
https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i -
Adina Yakup — Skywork-এর Matrix-Game 3.0 (2026-03-27, 👍 13 · 🔁 2)
“Matrix-Game 3.0🔥 Skywork-এর রিয়েল-টাইম ইন্টারঅ্যাকটিভ ওয়ার্ল্ড মডেল — ✨ 5B মডেলে 720p @ 40FPS।”
https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x -
Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
“LongCat-Video-Avatar 1.5🐱 অডিও-চালিত অবতার ভিডিও জেনারেশন [মডেল]।”
https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i -
Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
“HiDream-O1-Image ব্যাপক মনোযোগ পাচ্ছে🔥”
https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26 -
useapi.net — Sora 2 API বিকল্প (2026-09-21, 👍 0)
“কোডসহ Sora 2 API বিকল্পের তুলনা: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo”
https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27 -
useapi.net — MiniMax H3 বনাম Seedance 2.0 (2026-07-31, 👍 0)
“একই omni রেফারেন্সে MiniMax H3 ও Seedance 2.0 মুখোমুখি তুলনা #minimax #seedance #ai #api”
https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x -
GPT Image Prompt — মিম প্রম্পট শেয়ার (2026-05-07, 👍 0)
“থিম: Text to Meme — প্রম্পট মন্তব্যে — আমাদের ওয়েবসাইটে স্বাগতম: gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts”
https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226
সংকেত
- Bluesky-তে ক্লোজড-সোর্সের যে গল্পটি সত্যিই আলোচিত, সেটি Sora বন্ধ হওয়া। Ed Zitron-এর পোস্টটি পুরো অনুসন্ধানে সর্বোচ্চ এনগেজমেন্ট পাওয়া আইটেম (3.5k লাইক); নতুন মডেল প্রকাশের যে কোনো পোস্টের তুলনায় অনেক বেশি। এখানে AI শ্রোতারা ল্যাবের বিপণনের চেয়ে শিল্প-নাটক ও সমালোচনার দিকে বেশি ঝুঁকে।
- Bluesky-তে ওপেন-সোর্স সংবাদ মূলত একজনের বিট। পাওয়া প্রায় সব নির্দিষ্ট ওপেন-ওয়েট প্রকাশ (Baidu ERNIE-Image, ByteDance Lance, Skywork Matrix-Game 3.0, LongCat-Video-Avatar, HyperFlow, HiDream-O1-Image) এসেছে Hugging Face-এর Adina Yakup-এর একক অ্যাকাউন্ট থেকে। ধরণটি প্রবলভাবে চীনা ল্যাব-চালিত—Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork, Tencent—যারা Apache-2.0-ধরনের লাইসেন্সে মডেল প্রকাশ করছে।
- বড় ক্লোজড-সোর্স ল্যাবগুলোর ছবি/ভিডিও লঞ্চের সক্রিয় Bluesky উপস্থিতি নেই। OpenAI, Google DeepMind, Adobe বা Midjourney-এর কোনো অফিসিয়াল অ্যাকাউন্ট পাওয়া যায়নি। ক্লোজড-সোর্সের কভারেজ আসে স্বাধীন পরীক্ষক (Simon Willison) বা তৃতীয়-পক্ষ API রিসেলার (useapi.net)-এর তুলনামূলক পোস্টের মাধ্যমে।
- টুল-নির্দিষ্ট প্রযুক্তিগত পোস্ট প্রায় কোনো এনগেজমেন্ট পায় না (useapi.net-এর তুলনা এবং Adina Yakup-এর অধিকাংশ রিলিজে 0–13 লাইক), কোম্পানির ভবিষ্যৎ নিয়ে বৃহৎ বয়ানভিত্তিক পোস্টের তুলনায় (Sora গল্পে হাজার হাজার লাইক)। এ প্ল্যাটফর্মে এনগেজমেন্ট প্রযুক্তিগত নতুনত্বের চেয়ে শিল্প-বয়ানের সঙ্গে বেশি সম্পর্কিত।
- কয়েকটি সুস্পষ্ট AI-আর্ট কেন্দ্র Bluesky-তে মৃত বা নিষ্ক্রিয়: Civitai-এর অফিসিয়াল ও বট অ্যাকাউন্ট, ComfyUI অ্যাকাউন্ট এবং Stability AI-এর নিজস্ব অ্যাকাউন্ট—যেটি Stable Audio/সঙ্গীত লেবেল কনটেন্টে মোড় নিয়েছে এবং 2025 সালের মাঝামাঝির পর Stable Diffusion ইমেজ মডেল নিয়ে পোস্ট করেনি।
সীমাবদ্ধতা
- পাবলিক কীওয়ার্ড-সার্চ API ব্লক ছিল।
app.bsky.feed.searchPostsWebFetch দিয়ে প্রতিটি প্রয়াসেHTTP 403 Forbiddenদিয়েছে—বহুশব্দের অনুসন্ধান, একক শব্দ এবং ভিন্ন ভাষা, সব ক্ষেত্রেই।bsky.app/searchওয়েব UI-ও সম্পূর্ণ client-rendered JavaScript হওয়ায় পোস্ট কনটেন্ট দেয়নি। ফলে বাস্তব সময়ের পূর্ণাঙ্গ অনুসন্ধান সম্ভব হয়নি; পরিবর্তে (ক)site:bsky.appওয়েব সার্চে সম্পর্কিত হ্যান্ডেল খোঁজা, তারপর (খ) পাবলিক AT Protocol API দিয়ে তাদেরgetAuthorFeedইতিহাস সরাসরি পড়ার পদ্ধতি নেওয়া হয়েছে। - কয়েকটি সম্ভাবনাময় অ্যাকাউন্ট সরাসরি দেখে খালি বা নিষ্ক্রিয় পাওয়া গেছে:
civitai.bsky.social(খালি ফিড),civitai-bot.bsky.social(শেষ পোস্ট মে 2024),real-comfyui.bsky.social(খালি ফিড),runwayml.bsky.social(সম্পর্কহীন ব্যক্তিগত অ্যাকাউন্ট, 2024-এর একটি পোস্ট),midjourney-api.bsky.social(অননুমোদিত রিসেলার, নভেম্বর 2024-এর একটি পোস্ট),qwen1.bsky.social(ফ্যান অ্যাকাউন্ট, ফেব্রুয়ারি 2025-এর একটি পোস্ট)। - Alibaba-এর Qwen-Image-2.1—একটি 7B ওপেন-ওয়েট, একীভূত ছবি তৈরি/সম্পাদনা মডেল, বাইরের সূত্র অনুযায়ী 2026-09-20-এ প্রকাশিত—এই অনুসন্ধানে পাওয়া কোনো Bluesky পোস্টে ওঠেনি। সম্ভবত অনুসরণ করা অ্যাকাউন্টগুলো এখনও এটি উল্লেখ করেনি, অথবা ব্লক করা সার্চ API থাকলে যা পাওয়া যেত তার বাইরে রয়েছে।
- Ethan Mollick (
emollick.bsky.social) ও Tanishq Abraham (iscienceluvr.bsky.social) সম্ভাব্য উৎস মনে হলেও পরীক্ষা করে দেখা যায় তাঁরা যথাক্রমে সাধারণ/টেক্সট LLM সংবাদ ও পুরোনো একাডেমিক পেপারে বেশি মনোযোগী; বর্তমান ইমেজ/ভিডিও জেনারেশন সংবাদে নয়। - সার্চ ব্লকের কারণে প্রায় ২০ পোস্টের নমুনা লক্ষ্যটি একক র্যাঙ্কড সার্চ দিয়ে নয়, সম্পূর্ণ লেখক-ফিড ইতিহাস পড়ে পূরণ হয়েছে—Adina Yakup-এর প্রায় ৩০টি, useapi.net-এর প্রায় ১৫টি, Stable Diffusion-এর প্রায় ২০টি পোস্ট এবং Simon Willison ও Ed Zitron-এর সাম্প্রতিক ফিড। এটি লক্ষ্যভিত্তিক অ্যাকাউন্ট-নমুনা, পূর্ণাঙ্গ কীওয়ার্ড অনুসন্ধান নয়।
Lemmy
Lemmy — ইমেজ ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা
কমিউনিটিসমূহ
- !«メールアドレス» (5,713 জন) — ওপেন-সোর্স AI ইমেজ ও ভিডিও জেনারেশন প্রযুক্তির প্রধান আলোচনাকেন্দ্র। GitHub/HuggingFace টুলের নতুন সংযোজন প্রায় প্রতিদিন আসে।
- !«メールアドレス» (2,361 জন) — Stable Diffusion ও অন্যান্য ওপেন-ওয়েট মডেলে তৈরি কাজ পোস্টের জায়গা।
- !«メールアドレス» (1,599 জন) — অ্যানিমে-কেন্দ্রিক AI আর্ট, শুধু SFW।
- !«メールアドレス» (52 জন, মাসিক সক্রিয় 157 জন) — Reddit-এর AI-সম্পর্কিত থ্রেড হুবহু মিরর করে। Sora ও Midjourney-সহ ক্লোজড-সোর্সের খবর প্রায়ই এ পথেই আসে।
- !«メールアドレス» (204 জন, lemmy.bestiver.se ইনস্ট্যান্সের পোস্টও মিশে আছে) — Hacker News মিরর। Qwen-Image, Nano Banana ইত্যাদির রিলিজ সংবাদ এখানে আসে।
- !«メールアドレス» — AI শিল্প নিয়ে ব্যঙ্গাত্মক কমিউনিটি। Midjourney-এর বিভ্রান্তিকর খবরটির উৎস এখানে।
- !«メールアドレス» (8,265 জন) — জেনারেটিভ AI-বিরোধী বড় কমিউনিটি। সংবাদকেন্দ্রিক না হলেও Lemmy-র সামগ্রিক মানসিকতা বোঝার রেফারেন্স।
- !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — নির্দিষ্ট ঘরানাকেন্দ্রিক SD আর্ট কমিউনিটি। পোস্ট আছে, তবে স্কোর বেশিরভাগই এক অঙ্ক বা ঋণাত্মক।
পোস্টসমূহ
ক্লোজড-সোর্স সম্পর্কিত
- OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !«メールアドレス», 2026-09-20, score 1। Sora API বন্ধ এবং চীনা প্রতিদ্বন্দ্বীর বিপুল তহবিল সংগ্রহের তুলনামূলক পোস্ট।
- Midjourney AI pivots to Theranos: Ultrasonic CT — !«メールアドレス», 2026-06-19, score 40। Midjourney AI ইমেজ জেনারেশন থেকে আল্ট্রাসাউন্ড CT চিকিৎসা-যন্ত্র ব্যবসায় আকস্মিক মোড় নিয়েছে—এমন আলোচনা; Lemmy-তে Midjourney-সম্পর্কিত সবচেয়ে জনপ্রিয় পোস্ট।
- Midjourney Ultrasonic CT Scanner — !hackernews, 2026-06-18, score 2। ওপরের প্রাথমিক উৎস (midjourney.com/medical)-এর HN মিরর।
- Midjourney wants Hollywood studios to reveal AI usage details সূত্রে পোস্ট — !«メールアドレス», 2026-07-05, score 73। TechCrunch নিবন্ধের পরিচিতি; প্রযুক্তি কমিউনিটিতে তুলনামূলকভাবে ভালো স্কোর।
- Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — !ai_reddit, 2026-08-07, score 1।
- Seedream 5.0 Pro is here: an honest comparison and technical breakdown — !ai_reddit, 2026-07-10, score 1। ByteDance-এর ক্লোজড ইমেজ মডেলের পরীক্ষা।
- Nano Banana 2 Lite — !hackernews, 2026-06-30, score 1। Google DeepMind-এর হালকা ইমেজ জেনারেশন মডেল ঘোষণা।
- Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, 2026-05-28, score 1।
ওপেন-সোর্স সম্পর্কিত
- Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, 2026-09-20, score 1। Alibaba Qwen-এর সর্বশেষ ওপেন-ওয়েট ইমেজ জেনারেশন মডেল।
- supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, score 1। MiniMax H3-এ দীর্ঘ ভিডিও জেনারেশন ও মেমরি সীমা অতিক্রমের নোড।
- Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — একই কমিউনিটি, 2026-09-16, score 3। MiniMax H3 প্রম্পট বিল্ডার।
- nazgut/ComfyUI-MiniMaxH3-CLSS — একই কমিউনিটি, 2026-09-01, score 0। 16GB VRAM-এ যে কোনো দৈর্ঘ্যের অডিও-সহ ভিডিও জেনারেশন।
- filliptm/ComfyUI-FL-MiniMaxH3 — একই কমিউনিটি, 2026-08-30, score 5।
- Luisacaotica/ComfyUI-MiniMaxH3Mod — একই কমিউনিটি, 2026-08-20, score 7। ট্রেনিংবিহীন রেফারেন্স ইমেজ/ভিডিও কম্প্রেশন অ্যাডাপ্টার।
- I've been testing Wan for AI video generation — !«メールアドレス», 2026-09-10, score -9 (অজনপ্রিয়/বিতর্কিত)। ওপেন-ওয়েট Wan মডেলে ভিডিও জেনারেশন রিভিউ।
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», 2026-06-17, score 5। নতুন ওপেন ইমেজ ফাউন্ডেশন মডেল।
সংকেত
- MiniMax H3-কেন্দ্রিক ComfyUI ইকোসিস্টেম আগস্ট থেকে সেপ্টেম্বর পর্যন্ত ধারাবাহিকভাবে বাড়ছে। 2026-08-07 থেকে 09-16 পর্যন্ত !«メールアドレス»-এ কমপক্ষে পাঁচটি সংশ্লিষ্ট নোড/টুল পোস্ট হয়েছে; প্রবাহ থামেনি। এই কমিউনিটিতে ওপেন-সোর্স ভিডিও জেনারেশনের সবচেয়ে বড় কীওয়ার্ড ছিল “MiniMax H3।”
- ক্লোজড-সোর্স সংবাদ Lemmy-তে নিজস্ব আলোচনায় দুর্বল; প্রায় সবই Reddit মিরর (!ai_reddit) অথবা Hacker News মিরর (!hackernews)-এর পরোক্ষ তথ্য, স্কোরও সাধারণত ১–৩। Lemmy-উৎসের প্রাথমিক আলোচনা প্রায় নেই।
- বড় সাড়া পাওয়া একমাত্র ক্লোজড-সোর্স বিষয় ছিল Midjourney-এর “ইমেজ জেনারেশন → চিকিৎসা-ব্যবহারের আল্ট্রাসাউন্ড CT স্ক্যানার” ব্যবসায় মোড় নেওয়া (!techtakes, score 40), যা ব্যঙ্গ ও বিদ্রূপপ্রবণ কমিউনিটিতে ভাইরাল হয়।
- কাজ-ভাগাভাগির কমিউনিটি (stable_diffusion_art, share_anime_art ইত্যাদি)-তে পোস্টের ঘনত্ব বেশি—প্রায় প্রতিদিন একাধিক—কিন্তু স্কোর সাধারণত এক অঙ্ক থেকে কয়েক দশক; সেখানে সংবাদ নয়, তৈরি কাজই কেন্দ্র।
- !«メールアドレス» (8,265 জন)-এর মতো AI-বিরোধী কমিউনিটি, ইতিবাচক জেনারেটিভ AI কমিউনিটি stable_diffusion (5,713 জন)-এর চেয়ে বড়। এটি দেখায় Lemmy-র সামগ্রিক কমিউনিটি কাঠামোতে জেনারেটিভ AI-এর বিরুদ্ধে প্রবল মনোভাব রয়েছে।
সীমাবদ্ধতা
- Lemmy সার্চ API কেবল কীওয়ার্ড-ভিত্তিক পূর্ণপাঠ অনুসন্ধান করে; প্রাসঙ্গিকতার র্যাঙ্কিং দুর্বল। “Sora” বা “Veo”-র মতো সাধারণ শব্দে অসংখ্য অপ্রাসঙ্গিক রাজনৈতিক খবর (latam, pravda_news ইত্যাদি) আসে। ফিল্টার করতে প্রতি কীওয়ার্ডে ১৫–২০টি, মোট ১০০টির বেশি ফল দেখা হলেও থিমমাফিক পোস্ট শেষে মাত্র ডজনখানেক পাওয়া গেছে।
- Lemmy ইনস্ট্যান্স-বিকেন্দ্রীভূত; সব ইনস্ট্যান্সে একযোগে অনুসন্ধান সম্ভব নয়। lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se ও lemmy.today-এ মূলত অনুসন্ধান করা হয়েছে; Mastodon-এর মতো বিচ্ছিন্ন ছোট ইনস্ট্যান্সের আলোচনা বাদ পড়তে পারে।
- Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2, HunyuanImage-সহ অন্য প্ল্যাটফর্মে আলোচিত অনেক বড় মডেলের নামে Lemmy-তে উল্লেখযোগ্য পোস্ট পাওয়া যায়নি—শূন্য ফল, অথবা সম্পূর্ণ অপ্রাসঙ্গিক ফল।
- সামগ্রিকভাবে Lemmy ইমেজ/ভিডিও জেনারেশন AI-এর দ্রুত সংবাদকেন্দ্র হিসেবে ছোট; দ্রুততার জন্য Reddit/Hacker News মিররের ওপর নির্ভরশীল, আর নিজস্ব কনটেন্ট মূলত “ওপেন-ওয়েট মডেল ComfyUI-তে চালাতে প্রয়োজনীয় ইমপ্লিমেন্টেশন টুল ভাগাভাগি”-তে সীমিত।
Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ
ভিজ্যুয়াল থিম
- নিয়ন-আভাযুক্ত “AI” ওয়ার্ডমার্ক / সার্কিট-বোর্ড রোবট ভিজ্যুয়াল Pinterest-এ “AI”-এর প্রচলিত শর্টহ্যান্ড—জ্বলজ্বলে চিপ, হলোগ্রাফিক রোবট-মাথা ও হাত, কণার সার্কিট; নির্দিষ্ট টুল বা সংবাদ বোঝাতে নয়, সাধারণ কভার আর্ট হিসেবে ব্যবহৃত
[1, 2, 8, 22, 25, 28, 29, 31, 39, 49]। - সংখ্যাযুক্ত “Best AI Video/Image Generator” তালিকাধর্মী থাম্বনেইল—বড় শিরোনাম ও অ্যাপ লোগোর গ্রিড (Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo, Adobe Firefly)—পুরো সেটে সবচেয়ে সাধারণ পিন ফরম্যাট
[7, 13, 20, 30, 32, 33, 41, 43]। - মুখবিহীন YouTuber রিঅ্যাকশন-ফেস থাম্বনেইল—আশ্চর্য/বিস্মিত দাড়িওয়ালা ব্যক্তি, হেডফোন, ঝাপসা বিস্ফোরণের পটভূমি—বড় প্রযুক্তি প্রতিষ্ঠানের লোগোর সঙ্গে “AI NEWS” সারাংশ ভিডিও বিক্রি করতে ব্যবহৃত
[6, 19, 40]। - তারিখযুক্ত “আজকের/এই সপ্তাহের AI সংবাদ” ডাইজেস্ট কার্ড, ছোট প্রথম পাতার বা Instagram carousel-এর মতো নকশা, প্রতি কার্ডে একাধিক বাস্তব শিরোনামের সারাংশ
[17, 35, 44, 47]। - “AI শনাক্ত করুন” / বাস্তবতা প্রদর্শনী—“This is AI” লেখা ফটোরিয়াল টেনিস খেলোয়াড়, “FAKE” ছাপ দেওয়া বিড়ালের ছবি—নির্দিষ্ট পণ্যের বদলে জেনারেট করা মিডিয়ার বাস্তবতা বিক্রি করে
[5, 23]। - একই চরিত্রের স্টাইল-ট্রান্সফার ডেমো—একটি Lumalabs পিনে একই সোর্স ভিডিও চার স্টাইলে: কাঠের ব্লক, অরিগামি কাগজ, খেলনা ইট, ফুল। এই চক্রের অন্যান্য জায়গায় দেখা ভাইরাল “এটিকে X উপাদানে বদলে দিন” ফরম্যাট
[10]। - ফ্রিল্যান্স/সাইড-হাসল সার্ভিস বিজ্ঞাপন, “আপনার ব্র্যান্ডের জন্য AI ভিডিও” অফার, আর WhatsApp নম্বর ও Gmail ঠিকানা সরাসরি গ্রাফিকে বসানো
[24]। - শুরুর স্তরের ব্যাখ্যামূলক ইনফোগ্রাফিক, প্রম্পট → latent space → denoising → ফ্রেম → আউটপুট ধাপগুলো দেখিয়ে; জেনারেশন কীভাবে কাজ করে জানেন না এমন মানুষের জন্য
[3, 36]।
উল্লেখযোগ্য পিন
- #9 — Veo 2-এর অফিসিয়াল পণ্য পেজ (“আমাদের সর্বাধুনিক ভিডিও জেনারেশন মডেল,” VideoFX-এ সাইন-আপ CTA)। তালিকামূলক পোস্ট নয়, প্রকৃত ক্লোজড-সোর্স পণ্য বিপণন। https://www.pinterest.com/pin/716705728243313502/
- #10 — Lumalabs “কাঠের ব্লক / অরিগামি ভাঁজ কাগজের শিল্প / রঙিন খেলনা ইট / ফুল দিয়ে তৈরি”: একটি সোর্স ভিডিও চারটি সঙ্গতিপূর্ণ স্টাইলে পুনরায় রেন্ডার। https://www.pinterest.com/pin/308144799526598925/
- #17 — “4 Major AI Updates: Real News. Real Impact.”-এ OpenAI-এর GPT-6 Astra, Gmail/Drive/Docs/Slides/Chat জুড়ে Gemini-এর বেশি এজেন্টিক হওয়া, Adobe Premiere-র টাইমলাইনের মধ্যে জেনারেটিভ ভিডিও/সাউন্ড এবং Cognition-এর $48B মূল্যায়নে $2B Series E একসঙ্গে আছে। https://www.pinterest.com/pin/982558843745608433/
- #20 — “AI Image Video: Best Quality vs Best Free” সিদ্ধান্ত-চার্ট; বর্তমান পেইড টুল (ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia) ও ফ্রি টুল (Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free)-এর সবচেয়ে পরিষ্কার এক-ছবির মানচিত্র। https://www.pinterest.com/pin/37295503160959330/
- #26 — সংবাদ কার্ড: “ByteDance ও Hollywood AI কপিরাইট নিয়ে বৈশ্বিক চুক্তিতে”—ByteDance ও Motion Picture Association, ByteDance-এর ইমেজ/ভিডিও-জেনারেশন টুলে IP সুরক্ষা শক্তিশালী করতে সম্মত। https://www.pinterest.com/pin/1074530792376376121/
- #27 — AI নৈতিকতা/কণ্ঠ শনাক্তকরণ ইনফোগ্রাফিক: “97% সম্ভাবনায় AI-তৈরি” ভয়েস বিশ্লেষণের ফল, পাশে “AI video generators” ও “AI ethics & prompt engineering” প্যানেল—জেনারেটেড মিডিয়ায় আস্থা নিয়ে মূলধারার উদ্বেগ। https://www.pinterest.com/pin/951104015101996491/
- #32 — “22 Best & Free AI Video Generators,” সেটের সবচেয়ে বড় টুল রাউন্ডআপ; “Top 5 Picks”-এ বাস্তবতার বিচারে Kling AI ও Hailuo AI-কে Runway ও Pika-এর ওপরে রেখেছে। https://www.pinterest.com/pin/128493395623874987/
- #35 — “আজকের AI সংবাদ, 20 মে 2026”: Google I/O 2026 সারাংশ—Gemini 3.5 Flash, Gemini Omni, Gemini Spark এজেন্ট এবং Android XR স্মার্ট গ্লাস। https://www.pinterest.com/pin/652670171044638578/
- #44 — “This Week in AI News” মক সংবাদপত্র (15 আগস্ট, 2026), যেখানে “Open Models / Open weights,” “Sovereign AI,” এবং “Agent Harness” নিয়ে শিরোনাম আছে—পুরো সেটে ওপেন-ওয়েট মডেলের নামমাত্র উল্লেখ করা একমাত্র পিন, তাও ডেমো নয়, শিরোনামের টিজার হিসেবে। https://www.pinterest.com/pin/644577765463965693/
- #48 — “Amuse 3.0,” AMD-সমর্থিত লোকাল AI আর্ট-সৃজন টুলের লঞ্চ—সাধারণ তালিকা বা নিউজ-লোগো কার্ডের বদলে নির্দিষ্ট নতুন পণ্যের উল্লেখ থাকা অল্প কয়েকটি পিনের একটি। https://www.pinterest.com/pin/4601060441986715264/
সংকেত
- Kling AI ও Hailuo AI শীর্ষ স্তরে ঢুকেছে, প্রায় সব সংগৃহীত তালিকায় Runway, Pika ও Luma-র পাশে
[7, 13, 30, 32, 41, 43]—এক বছর আগের Runway/Pika-নির্ভর জুটির চেয়ে বিস্তৃত “শীর্ষ পছন্দ” তালিকা। - Google-এর Veo/Gemini অগ্রযাত্রাই এ প্ল্যাটফর্মে সবচেয়ে দৃশ্যমান ক্লোজড-সোর্স গল্প, একটি ভাইরাল পোস্টের বদলে স্বাধীন “AI সংবাদ” পিনে বারবার এসেছে—Veo 2 লঞ্চ, Gemini 3.5/Omni/Spark, এবং I/O 2026-এ Android XR গ্লাস।
- OpenAI মূলত লোগোর ভিড়ে দেখা যায়; Sora-2-এর একমাত্র নির্দিষ্ট উল্লেখ #4-এ, তৃতীয়-পক্ষ টুল “zeely.ai”-এর “sora-2-video-ad” মোডের ঝাপসা স্ক্রিন রেকর্ডিং। অন্য প্ল্যাটফর্মের তুলনায় উপস্থিতি ক্ষীণ।
- ডিপফেক/প্রামাণিকতা-সংক্রান্ত উদ্বেগ একটি পুনরাবৃত্ত সুর, এককালীন নয়: “FAKE” ছাপ দেওয়া কনটেন্ট, 97%-AI ভয়েস ডিটেক্টর রিডিং এবং “Human Journalism vs. Machine-Generated Media” গ্রাফিক আলাদাভাবে দেখা গেছে
[5, 16, 27]। - আয়/সাইড-হাসল ফ্রেমিং স্পষ্ট—যোগাযোগ তথ্যসহ ফ্রিল্যান্স AI ভিডিও বিজ্ঞাপন (#24), “faceless channel” ও “content marketing” প্রচার (#23, #25)। Pinterest-এর AI ভিডিও দর্শক গবেষকের চেয়ে কনটেন্ট বিক্রি বা বড় করতে চাওয়া নির্মাতাদের দিকে বেশি ঝুঁকে।
- ওপেন-সোর্স কার্যত অনুপস্থিত। ৫০টি পিনের কোথাও Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi বা কোনো GitHub/HuggingFace লিংক নেই। একমাত্র ইঙ্গিত “Open Models. Open weights.”—একটি নকল AI সংবাদপত্রের #44 শিরোনামের অংশ, আলাদা পিন, টুল লোগো বা ডেমো নয়। এ বিষয়ে Pinterest-এর কনটেন্ট প্রায় পুরোপুরি ক্লোজড-সোর্স SaaS বিপণন ও SEO-ভিত্তিক “সেরা টুল” তালিকা; কেউ শুধু এই প্ল্যাটফর্মের ওপর নির্ভর করলে ওপেন-সোর্স ইমেজ/ভিডিও জেনারেশনের কোনো দৃশ্য আছে বলেই জানতে পারবে না।
সীমাবদ্ধতা
- কর্মীর
pinterest.pins.mdটেবিলে ঘরানা-ভিত্তিক বিভাগ ছিল না—একটি অন্তর্নিহিত ঘরানার অধীনে ৫০টি পিনের সমতল তালিকা ছিল—তাই প্লেবুকে বর্ণিত বহু-ঘরানা বিশ্লেষণের বদলে সব পিন একসঙ্গে বিশ্লেষণ করা হয়েছে। - কিছু পিনের শিরোনাম ছবিতে দৃশ্যমান বিষয়বস্তুর সঙ্গে মেলেনি; প্লেবুক অনুসারে এই ধাপে Pinterest সরাসরি ব্রাউজ করে যাচাই করা হয়নি, তাই এগুলোকে ফলাফল নয়, অযাচাইকৃত হিসেবে চিহ্নিত করা হলো: #42 (“Nvidia #NEW AI Tools”) ছবিতে শুধু Jensen Huang-এর সাধারণ ছবি, কোনো টুলের দৃশ্যমান লেখা নেই; #45 (“Grok 5: Elon Musk's AI Revolution”) এবং #50 (“Discover how Grok is revolutionizing video”) উভয়টিতে Grok-নির্দিষ্ট কিছু ছাড়াই সাধারণ স্টক/AI নিউজ-অ্যাঙ্কর ছবি; #40 (“GPT 5.2, realtime video editor...”) কেবল সাধারণ “huge AI news” রিঅ্যাকশন থাম্বনেইল।
- অনেক পিন কাছাকাছি একই ধরনের সাধারণ স্টক গ্রাফিক, আলাদা কোনো তথ্যগত বিষয়বস্তু নেই (
[2, 8, 22, 29, 39, 45, 49])—৫০টির হিসেবে থাকলেও এগুলোকে আলাদা সংকেত ধরা হয়নি। - এ থিমে Pinterest-এ কোনো ওপেন-সোর্স ইমেজ/ভিডিও জেনারেশন কনটেন্ট পাওয়া যায়নি। এই অনুপস্থিতিই প্ল্যাটফর্মটির প্রধান অনুসন্ধান, গবেষণার ঘাটতি নয়—উপরের Signals দেখুন।
প্রস্তাবিত পদক্ষেপ
- 2026-09-24-এর পর Sora API ট্রাফিক Seedance 2.5, MiniMax H3 নাকি Kling v3-এ যায়, ট্র্যাক করুন।
- “এটি কি ওপেন-সোর্স?” বিতর্ক চলতে থাকায় Qwen-Image-2.1-এর অ-বাণিজ্যিক গবেষণা লাইসেন্সে পরিবর্তন নজরে রাখুন।
- ওপেন-ওয়েট ভিডিও গ্রহণের অগ্রবর্তী সূচক হিসেবে Lemmy-তে MiniMax H3 ComfyUI নোড পোস্টের ঘনত্ব ব্যবহার করুন।
- আঞ্চলিক ট্রেন্ডের বদলে থিমভিত্তিক অনুসন্ধান শব্দ ব্যবহার করে X সংগ্রহধাপ পুনরায় চালান।
- প্রতি-মডেল অনুসন্ধান শব্দ ব্যবহার করে Reddit সংগ্রহধাপ পুনরায় চালান, যাতে প্রায় ২০ পোস্টের লক্ষ্য পূরণ হয়।
- নিশ্চিত তথ্য হিসেবে নেওয়ার আগে Midjourney-এর চিকিৎসা-ব্যবহারের আল্ট্রাসাউন্ড CT-তে মোড় নেওয়ার খবর প্রাথমিক উৎসে যাচাই করুন।
সংগৃহীত ছবি


















































ডেটার মান-সংক্রান্ত নোট
অনুসন্ধান শব্দের অমিলের কারণে X-এ ৩২টির মধ্যে থিম-সম্পর্কিত পোস্ট ছিল শূন্য, আর Reddit একক অনুসন্ধান শব্দে লক্ষ্যমাত্রার প্রায় ২০টির বদলে মাত্র ১২টি থ্রেড সংগ্রহ করেছে; Bluesky-এর সার্চ API ব্লক ছিল (403), তাই অ্যাকাউন্ট ফিড থেকে নমুনা নিতে হয়েছে; YouTube-এর ভিউ সংখ্যা ও সঠিক তারিখ JavaScript-রেন্ডার করা পেজের কারণে নিশ্চিত করা যায়নি।



