ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-10-02
চীনা ওপেন-সোর্স মডেলগুলো (Qwen-Image-2.1, Z-Image Turbo) ক্লোজড-সোর্স শীর্ষ মডেলগুলোর কাছাকাছি চলে আসছে, ঠিক সেই সময়ে যখন গার্ডরেল, অপব্যবহার এবং Sora-এর অর্থনীতি নিয়ে ক্লোজড-সোর্স ব্যবস্থার প্রতি আস্থা ক্ষয় হচ্ছে।
ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-10-02
সত্যি বলতে, এই মুহূর্তে ছবি ও ভিডিও জেনারেশন AI দুনিয়ায় বেশ তোলপাড় চলছে😤। ক্লোজড-সোর্স শিবিরে (OpenAI-এর GPT Image 2.5, Google-এর Veo 3.1/Nano Banana 2.0, Kling 2.5, Seedance 2.5 ইত্যাদি) ফিচার যোগ করার প্রতিযোগিতা থামছেই না। কিন্তু তার আড়ালেই গার্ডরেল কঠোর হওয়া, ডিপফেক, আর Sora-এর বিপুল লোকসানের মতো আস্থা-ক্ষয়ের ঘটনাও একসঙ্গে ঘটছে💸। অন্যদিকে ওপেন-সোর্স শিবিরে Alibaba-র (Qwen-Image-2.1, Z-Image Turbo) মতো চীনা প্রকল্পগুলো সত্যিই গতি পাচ্ছে; ComfyUI-কেন্দ্রিক লোকাল ব্যবহারের সংস্কৃতিও Reddit, Lemmy ও Bluesky—সবখানেই দেখা গেছে🔥। এবার Reddit, X, YouTube, Bluesky, Lemmy ও Pinterest—এই ছয় প্ল্যাটফর্ম দেখা হয়েছে; তবে X পুরোপুরি ফলহীন ছিল, তাই সেটিও স্পষ্টভাবে জানানো হলো👇।
সব প্ল্যাটফর্মজুড়ে
- চীনা ওপেন-সোর্সের উত্থান, এবং তা প্রায়ই “ক্লোজড-সোর্সের বিকল্প” হিসেবে আলোচিত হচ্ছে 🇨🇳 YouTube-এ বলা হচ্ছে Z-Image Turbo (6B প্যারামিটার, 6GB VRAM-এ চলে) Flux 2-কে ছাড়িয়ে গেছে (https://www.youtube.com/watch?v=JF4Q5hXh-_Q), আর Qwen-Image-Edit Nano Banana-এর সমকক্ষ বা তার চেয়েও ভালো (https://www.youtube.com/watch?v=AIgYj5RG-FQ)। Lemmy-তেও একই সপ্তাহে Qwen-Image-2.1 ঘিরে WebUI ও LoRA প্রকাশ হয়েছে (https://github.com/ogoun/fooocus-qwen-image-2.1), আর Bluesky-তে Simon Willison Qwen-Image হাতে-কলমে পরীক্ষা করেছেন (https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223)। একাধিক প্ল্যাটফর্মে একই সময়ে বিষয়টি ঘটছে—তাই এটিকে বাস্তব প্রবণতাই মনে হচ্ছে।
- কঠোর গার্ডরেল ব্যবহারকারীদের দূরে ঠেলে দিচ্ছে 🚪 Reddit-এ ChatGPT-এর প্রত্যাখ্যান এড়িয়ে অনেকে Midjourney, Grok ও Venice AI-তে যাচ্ছেন (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/); আবার DreamFort.ai-এর ফিল্টার কঠোর হওয়ায় কেউ কেউ Seedream Unfiltered বা MiniMax H3-তে চলে যাচ্ছেন (https://www.reddit.com/r/generativeAI/comments/1wtzefv/)। Bluesky-তেও GLM-5.3-এর মতো ওপেন-ওয়েট মডেলকে প্রায় গার্ডরেলবিহীন বলে বিশেষজ্ঞরা সতর্ক করছেন (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o)। নিয়ন্ত্রণ কঠোর হওয়া বনাম নিয়ন্ত্রণহীনতার এই দ্বিমেরু অবস্থা সব সামাজিক মাধ্যমে চোখে পড়ছে।
- ক্লোজড-সোর্সের “আস্থা” একাধিক দিক থেকে একসঙ্গে টলছে ⚠️ Bluesky-তে প্রকাশিত TIME-এর অনুসন্ধানে Veo3 দিয়ে হিন্দু মন্দিরে অগ্নিসংযোগের ভুয়া ভিডিও বানানো সম্ভব হয়েছে (https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h)। আবার Reddit-এ Photoshop/Apple Photos সাধারণ crop-কেও “AI সম্পাদনা” হিসেবে চিহ্নিত করে কপিরাইট ক্রেডিট সরিয়ে দেওয়ার অভিযোগ উঠেছে (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/)। অপব্যবহার ও ভুল ট্যাগিং ভিন্ন সমস্যা হলেও দুটিই “ক্লোজড টুলকে বিশ্বাস করা যায় না”—এই ধারণা জোরদার করছে।
- ComfyUI ওপেন-সোর্স শিবিরের কার্যত ডিফল্ট কর্মক্ষেত্র 🛠️ Reddit-এ MiniMax-H3-এর নোড (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/), Lemmy-তে LanPaint ইনপেইন্টিং (https://github.com/scraed/LanPaint/), Bluesky-তে Krea2 দিয়ে দৈনিক ইলাস্ট্রেশন পোস্ট (https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t), এবং YouTube-এ নতুন মডেল এলেই দ্রুত প্রকাশিত সেটআপ টিউটোরিয়াল—সবখানেই একই নাম উঠে এসেছে।
- “পাশাপাশি তুলনা” এখন প্রতিষ্ঠিত কনটেন্ট ফরম্যাট 📊 YouTube-এ “WAN 2.5 is Open Source Veo3”-ধরনের শিরোনাম, Lemmy-তে Berserk-এর একই ডাবল-পেজ চার মডেলে রঙ করার তুলনা (https://www.reddit.com/gallery/1wfyqdy), আর Pinterest-এ “পেইড হলে এটি, ফ্রি হলে এটি”—এমন নিয়ন তুলনাচার্ট। একক সংবাদ নয়, মানুষ জানতে চায় কোনটি সবচেয়ে শক্তিশালী।
- ভোক্তামুখী AI ভিডিও লাভজনক নয়—এমন ধারণা একাধিক উৎসে সমর্থন পেয়েছে 💰 Bluesky-তে Sora2-এর বার্ষিক পরিচালন ব্যয় প্রায় 5 বিলিয়ন ডলার, বিপরীতে আয় প্রায় 1.4 মিলিয়ন ডলার—এমন পোস্ট আছে (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o)। Lemmy-তেও বিশ্লেষণ রয়েছে যে OpenAI 9/24-এ Sora API বন্ধ করছে, অথচ Kling-এর মতো এন্টারপ্রাইজমুখী প্রতিদ্বন্দ্বীরা অর্থ সংগ্রহ করছে (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/)।
প্ল্যাটফর্মভিত্তিক
Reddit 🟠 12টি থ্রেড ও 9টি সাবরেডিট বিশ্লেষণ করা হয়েছে। ক্লোজড শিবিরে সবচেয়ে বেশি সাড়া পাওয়া বিষয়টি হলো Seedance 2.5 (Higgsfield-এর মাধ্যমে) দিয়ে একজন ব্যক্তি 10 মিনিটের ধারাবাহিক চরিত্রসমৃদ্ধ ছোট গল্প তৈরি করতে পারছেন (784pt, https://www.reddit.com/r/accelerate/comments/1wqqr4p/)। ওপেন শিবিরে MiniMax-H3-এর জন্য ComfyUI নোডকে “এ পর্যন্ত ব্যবহার করা সেরা নোড” বলা হয়েছে (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/)। গার্ডরেল নিয়ে অসন্তোষও এখানে সবচেয়ে নির্দিষ্টভাবে উঠে এসেছে।
X ⚫️ এখানে সত্যিই কিছুই মেলেনি😅। সংগৃহীত 40টি পোস্ট (33টি অ্যাকাউন্ট) ছিল ফুটবল, K-pop, যুক্তরাজ্যের রাজনীতি এবং রিয়েলিটি শো নিয়ে; AI ছবি বা ভিডিও জেনারেশনের কোনো আলোচনা ছিল না। কর্মী যে অনুসন্ধান শব্দ ব্যবহার করেছে—যেমন “Halloween”, “Ronaldo”, “#bb28”—সেগুলো সরাসরি X-এর ট্রেন্ড ট্যাব থেকে নেওয়া, AI-সম্পর্কিত শব্দ দিয়ে অনুসন্ধান করা হয়নি। তাই এবারের X অংশ থেকে প্রতিবেদনে যোগ করার মতো তথ্য নেই।
YouTube 🔴 ক্লোজড শিবিরে GPT Image 2.5-এর “Sketch” ফিচার (https://www.youtube.com/watch?v=LYUr4BY33h4), Veo 3.1-এর বিনামূল্যে উন্মুক্তকরণ (https://www.youtube.com/watch?v=uj6eD31OxkA), এবং Nano Banana 2.0-কে “Photoshop-এর চেয়েও ভালো” বলা ভিডিও (https://www.youtube.com/watch?v=u22-XoQvI4I)—সবই একই সময়ে এসেছে; ফলে ফিচার প্রতিযোগিতা খুব দ্রুত। ওপেন শিবিরে FLUX.2, Z-Image ও Qwen-Image-Edit নিয়ে “ComfyUI-তে কীভাবে চালাবেন” ধরনের টিউটোরিয়াল ব্যাপক। তবে JavaScript রেন্ডারিংয়ের কারণে ভিউ, সাবস্ক্রাইবার ও মন্তব্য সংগ্রহ করা যায়নি; বিশ্লেষণ কেবল শিরোনাম ও oEmbed তথ্যের ওপর ভিত্তি করে—এ বিষয়টি খেয়াল রাখা দরকার।
Bluesky 🔵 AT Protocol API-তে সরাসরি অনুরোধ করে 100টির বেশি বাস্তব পোস্ট থেকে বাছাই করা হয়েছে। ক্লোজড শিবিরে Veo3-এর বর্ণবাদী কনটেন্ট তৈরির সমস্যা (❤️842, https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y) এবং Sora2-এর অর্থনৈতিক বিপর্যয় (❤️1,375) সবচেয়ে বেশি আলোচিত। ওপেন শিবিরে Simon Willison ও Ethan Mollick-এর মতো বাস্তব পরীক্ষা করা গবেষক-অ্যাকাউন্টগুলো Qwen-Image ও GLM-5.3 নিয়ে আলোচনা করছেন। ComfyUI+Krea2 ব্যবহার করে দৈনন্দিন পোস্টও প্রচুর দেখা গেছে।
Lemmy 🟢 !«メールアドレス» মূল কেন্দ্র হলেও স্কোর সাধারণত 1 থেকে 10-এর মধ্যে, অর্থাৎ এটি ছোট পরিসরের। তবু একই সপ্তাহে Qwen-Image-2.1 ঘিরে WebUI, LoRA ও ControlNet টুলের পোস্ট আসায় গতি বোঝা যায়। ক্লোজড-সোর্স খবর—যেমন Sora API বন্ধ হওয়া, বা Nano Banana 2-এর Google Earth ফিচার অপব্যবহারের কারণে একদিনেই প্রত্যাহার করা (https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/)—মূলত !ai_reddit-এর Reddit মিরর বটের মাধ্যমে এসেছে; Lemmy-র নিজস্ব আলোচনা প্রায় নেই।
Pinterest 🟣 50টির মধ্যে 18টি পিন সরাসরি খুলে দেখা হয়েছে। বিপুল সংখ্যক ক্লোজড-সোর্সকেন্দ্রিক (OpenAI/Google/Meta/Grok লোগো ও অবাক মুখের থাম্বনেইল) সংবাদ-সারাংশের ছবি পাওয়া গেছে। ওপেন শিবিরে AMD Amuse 3.0 ছাড়া নির্দিষ্ট নাম খুব কম এসেছে। ফটোরিয়াল মানুষ তৈরির ডেমো—বলিরেখা ও ত্বকের টেক্সচার পর্যন্ত যত্ন নিয়ে বানানো মুখ—বিভিন্ন প্রতিষ্ঠানের অভিন্ন বেঞ্চমার্কসদৃশ ভিজ্যুয়াল হিসেবে ব্যবহৃত হচ্ছে, যা আকর্ষণীয় পর্যবেক্ষণ। তবে এনগেজমেন্ট সংখ্যা (সেভ/লাইক) পাওয়া যায়নি; পিনগুলো কেবল কর্মীর আগাম সংগৃহীত নমুনা।
যা নজরে রাখবেন
- Qwen-Image-2.1 ঘিরে টুলসমষ্টির সম্প্রসারণের গতি — Lemmy-তে একই সপ্তাহে WebUI/LoRA/ControlNet-এর একাধিক পোস্ট (https://github.com/ogoun/fooocus-qwen-image-2.1)। পরবর্তী কী আসে, তা দেখার মতো।
- Sora2-এর অর্থনৈতিক সমস্যা OpenAI-এর নীতিতে কী প্রভাব ফেলে — Bluesky (https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o) ও Lemmy-তে (Sora API বন্ধ, https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/) একই বিতর্ক চলছে।
- গার্ডরেল-উৎসারিত নিয়ন্ত্রণ বনাম নিয়ন্ত্রণহীনতার দ্বিমেরুতা — Reddit (https://www.reddit.com/r/generativeAI/comments/1wtzefv/) ও Bluesky (https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o)-তে ভিন্ন দিক থেকে উঠে আসা একই কাঠামোগত বিষয়।
- Black Forest Labs-এর FLUX 3 — এটি সীমিত ক্লোজড রিলিজ (ছবি + 20 সেকেন্ডের অডিও ভিডিও), কিন্তু FLUX.2-এর ওপেন-ওয়েট সংস্করণও পাশাপাশি প্রকাশিত হচ্ছে (https://bfl.ai/blog/flux-3)। ওপেন/ক্লোজড সীমারেখা ঝাপসা হওয়ার উদাহরণ হিসেবে অনুসরণ করার মতো।
- Z-Image / Qwen-Image-এর কম-VRAM পথ — YouTube-এ বলা হচ্ছে এটি Flux2-কে ছাড়িয়ে গেছে (https://www.youtube.com/watch?v=JF4Q5hXh-_Q); ফলে লোকাল ব্যবহারকারীর পরিসর বাড়তে পারে।
- X পুনঃতদন্তের প্রয়োজন — এবার ট্রেন্ড ট্যাবের ভুল সংগ্রহে ফল মেলেনি; “Midjourney”, “Sora”, “Nano Banana”-এর মতো সরাসরি কীওয়ার্ডে পুনরায় সংগ্রহ করলে আকর্ষণীয় তথ্য পাওয়া যেতে পারে।
সুপারিশ
- পরেরবার X (Twitter)-এ “Midjourney” “Sora” “Nano Banana” “ComfyUI” “Flux” ইত্যাদি সরাসরি AI কীওয়ার্ড দিয়ে পুনরায় সংগ্রহ করা উচিত।
- ওপেন-সোর্স প্রবণতার স্থায়ী পর্যবেক্ষণ সূচক হিসেবে Qwen-Image-2.1 ইকোসিস্টেমের দ্রুত বৃদ্ধি পর্যবেক্ষণ চালিয়ে যাওয়া উচিত।
- Sora2-এর পরিচালন ব্যয় বনাম আয়ের বিষয়টি ক্লোজড-সোর্স ভিডিও জেনারেশন মডেলগুলোর সামগ্রিক লাভজনকতার সূচক হিসেবে অনুসরণ করা উচিত।
- গার্ডরেল-সম্পর্কিত ব্যবহারকারী-সরে-যাওয়া—কোন টুল থেকে কোন টুলে যাচ্ছেন—নিয়মিত মানচিত্রায়ন করা উচিত।
- Pinterest-এ ছবির নমুনা 50টিতেই বাড়ানো, অথবা এনগেজমেন্ট সংখ্যা পাওয়া যায় এমন বিকল্প পদ্ধতি বিবেচনা করা উচিত।
- Lemmy-র !ai_reddit নির্ভরতা (মূলত Reddit পুনঃপ্রকাশ) বিবেচনায় নিয়ে Lemmy-র নিজস্ব মতামত পেতে !stable_diffusion-ধরনের কমিউনিটিতেই নজর দেওয়া উচিত।
ডেটার মান
X-এর সংগৃহীত ডেটা গবেষণার বিষয়ের সঙ্গে পুরোপুরি অসংগত ছিল (ট্রেন্ড ট্যাবের ভুল সংগ্রহ), তাই এবার তা কোনো অবদান রাখতে পারেনি। YouTube-এ JavaScript রেন্ডারিংয়ের কারণে ভিউ, প্রকাশের তারিখ, সাবস্ক্রাইবার ও মন্তব্য যাচাই করা যায়নি; বিশ্লেষণ কেবল শিরোনাম ও oEmbed তথ্যভিত্তিক। Pinterest-এ 50টির মধ্যে মাত্র 18টি চোখে দেখে যাচাই করা হয়েছে এবং এনগেজমেন্ট সংখ্যা (সেভ/লাইক) অনুপলব্ধ। Lemmy-তে পোস্ট যাচাই করা গেলেও সামগ্রিক স্কোর 0–10 হওয়ায় আলোচনা অন্য প্ল্যাটফর্মের তুলনায় কম প্রাণবন্ত। Reddit ও Bluesky বাস্তব সংগৃহীত/API ডেটার ভিত্তিতে বিশ্লেষণ করা গেছে এবং তুলনামূলকভাবে বেশি নির্ভরযোগ্য।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ
কোথায়
সংগৃহীত সেটে 9টি সাবরেডিটে এই থিম দেখা গেছে (মোট 12টি থ্রেড; সবগুলো একক অনুসন্ধান শব্দ “Image and Video Generation AI News” দিয়ে পাওয়া):
- r/generativeAI — 159,938 সদস্য — 3টি থ্রেড (#1, #2, #7)
- r/TopologyAI — 24,052 সদস্য — 1টি থ্রেড (#3)
- r/StableDiffusion — 1,027,672 সদস্য — 1টি থ্রেড (#4)
- r/LocalLLaMA — 838,632 সদস্য — 1টি থ্রেড (#5)
- r/AI_Agents — 452,911 সদস্য — 1টি থ্রেড (#6)
- r/accelerate — 93,680 সদস্য — 2টি থ্রেড (#8, #12)
- r/aifails — 39,194 সদস্য — 1টি থ্রেড (#9)
- r/VideoEditors — 81,700 সদস্য — 1টি থ্রেড (#10)
- r/mildlyinfuriating — 12,610,232 সদস্য — 1টি থ্রেড (#11)
মানুষ কী বলছে
- ক্লোজড-সোর্স “ফ্রি” ভিডিও জেনারেশন একটি মিথ—কমিউনিটির ঐকমত্য — থ্রেড #1, r/generativeAI, 71 পয়েন্ট, 46 মন্তব্য, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wty6zj/)। মূল পোস্টার বলেন, ক্লাউড GPU ব্যয়ের কারণে সত্যিকারের সীমাহীন বিনামূল্যের ভিডিও জেনারেশন সম্ভব নয়; u/opengradient সমর্থন করে বলেন: “ভিডিও সস্তা LLM-এর মতো নয়, কেউ এগুলো বিনামূল্যে দিতে পারে না” (5 পয়েন্ট)।
- ক্লোজড-সোর্স NSFW ফিল্টার কঠোর হচ্ছে, ফলে ব্যবহারকারীরা ওপেন/আনফিল্টারড বিকল্পে যাচ্ছেন — থ্রেড #2, r/generativeAI, 7 পয়েন্ট, 14 মন্তব্য, 2026-09-30 (https://www.reddit.com/r/generativeAI/comments/1wtzefv/)। DreamFort.ai তার WAN 3.0-ভিত্তিক ফিল্টার কঠোর করেছে; u/opengradient উল্লেখ করেন, “অনেক ক্লোজড-সোর্স মডেল প্রদানকারী সম্প্রতি নিয়ন্ত্রণ কঠোর করেছে (Wan 3.0-এর মালিক Alibaba-সহ)” এবং বিকল্প হিসেবে Seedream 2.0 Unfiltered ও MiniMax H3-এর কথা বলেন।
- ভিডিও জেনারেশনের নিয়ন্ত্রণযোগ্যতার সমাধান হিসেবে ওপেন-সোর্স + Blender 3D ওয়ার্কফ্লো উপস্থাপিত, কিন্তু দর্শক নিশ্চিত নন যে তা বাস্তব — থ্রেড #3, r/TopologyAI, 437 পয়েন্ট, 19 মন্তব্য, 2026-09-28 (https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/)। উচ্চ স্কোর সত্ত্বেও শীর্ষ মন্তব্যগুলো মূলত বিভ্রান্ত প্রশ্ন—“এটি কোন ‘3d AI’?” — u/stevester911, 5 পয়েন্ট—এবং u/amon_de_no-এর সরাসরি প্রত্যাখ্যান: “ওটা নকল বাস্তব AI” (5 পয়েন্ট)।
- MiniMax-H3-এর জন্য ওপেন-সোর্স রেফারেন্স-কনসিস্টেন্সি টুলিং অত্যন্ত ইতিবাচক সাড়া পাচ্ছে — থ্রেড #4, r/StableDiffusion, 690 পয়েন্ট, 51 মন্তব্য, 2026-09-30 (https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/)। একটি বিনামূল্যের ComfyUI নোড (Fantastic-MiniMaxH3-PromptBuilder) রেফারেন্স-ইমেজ ভিডিও সম্পাদনায় পরিচয় মিশে যাওয়ার সমস্যা সমাধান করেছে; u/ClassicUse2579: “H3 media loader জিনিসটি আমার ব্যবহার করা সেরা Comfy নোডগুলোর একটি। দারুণ!” (3 পয়েন্ট)।
- ওপেন-সোর্স লোকাল ছবি/চ্যাট স্ট্যাক এখন অভিনব প্রদর্শনী হিসেবেও যথেষ্ট পরিণত — থ্রেড #5, r/LocalLLaMA, 194 পয়েন্ট, 96 মন্তব্য, 2026-10-01 (https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/)। 1990-এর দশকের একটি Tandy 1000 WiFi-এর মাধ্যমে লোকালি চালানো Qwen3.8-27B + Krea 2 (ComfyUI)-তে চ্যাট ও ছবি জেনারেশনের জন্য ব্যবহৃত হচ্ছে। তবে শীর্ষ মন্তব্যে ফ্রেমিংয়ের বিরোধিতা করা হয়: u/Aggravating-Push-207 (113 পয়েন্ট): “এটি আসলে Tandy-তে চলছে না; এটি শুধু আপনার হোম নেটওয়ার্কে অনুরোধ পাঠাচ্ছে।”
- ক্লোজড-সোর্স গার্ডরেল সাধারণ ব্যবহারকারীকে বিকল্পে পাঠানোর মতোই বিরক্তিকর — থ্রেড #6, r/AI_Agents, 0 পয়েন্ট, 22 মন্তব্য, 2026-09-29 (https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/)। একজন ব্যবহারকারী গার্ডরেল প্রত্যাখ্যানের কারণে ChatGPT দিয়ে সুপারহিরোর ছবি তৈরি করতে পারছেন না; মন্তব্যকারীরা Midjourney, Grok, VeniceAI এবং ওপেন “uncensored sdxl” মডেলে যেতে বলছেন।
- ফ্রি/কম খরচের ক্ষেত্রে ক্লোজড-সোর্স দৈনিক-ক্রেডিট টুল সাধারণ সুপারিশে এখনো প্রভাবশালী — থ্রেড #7, r/generativeAI, 4 পয়েন্ট, 59 মন্তব্য, 2026-09-26 (https://www.reddit.com/r/generativeAI/comments/1wqfleb/)। পরামর্শ বিভক্ত: u/Scuzzy_Womack অফলাইন ComfyUI (3 পয়েন্ট, ওপেন) প্রস্তাব করেন, অন্যরা দৈনিক ফ্রি ক্রেডিটের জন্য Yodayo/MoescapeAI ও Leonardo-এর কথা বলেন (ক্লোজড)।
- ক্লোজড-সোর্স ভিডিও (Higgsfield-এর মাধ্যমে Seedance 2.5) এখন একজনের 10 মিনিটের বর্ণনামূলক ছোট চলচ্চিত্রের জন্য যথেষ্ট ভালো — থ্রেড #8, r/accelerate, 784 পয়েন্ট, 196 মন্তব্য, 2026-09-26 (https://www.reddit.com/r/accelerate/comments/1wqqr4p/)। প্রতিটি শটে চরিত্রের ধারাবাহিকতা রাখতে Captain Walker-এর চরিত্র-শিট রেফারেন্স ব্যবহার হয়েছে; u/JoseLunaArts (95 পয়েন্ট) বলেন “no budget” উপস্থাপনা টোকেন ব্যয়কে খাটো করে দেখাচ্ছে, আর u/Nabugu (7 পয়েন্ট) বারবার আসা “AI সুন্দর মুখ”-এর একঘেয়েমির কথা বলেন।
- ছবি জেনারেশন এখনো হাস্যকর, মিমযোগ্য ভুল করে—প্রবণতা হিসেবে নয়, বিনোদন হিসেবে উপেক্ষিত — থ্রেড #9, r/aifails, 526 পয়েন্ট, 76 মন্তব্য, 2026-09-28 (https://www.reddit.com/r/aifails/comments/1ws6jzs/)। মুরগির অ্যানাটমির প্রম্পটে অ্যানাটমিক্যাল অর্থহীনতা তৈরি হয়েছে; u/kasimirvendom-এর শীর্ষ মন্তব্য: “সবকিছুরই শেষ আছে, শুধু মুরগির আছে দুইটি” (52 পয়েন্ট)।
- ভিডিও এডিটরদের এখনই AI টুলের ওপর নির্ভর না করতে স্পষ্টভাবে বলা হচ্ছে — থ্রেড #10, r/VideoEditors, 4 পয়েন্ট, 39 মন্তব্য, 2026-09-26 (https://www.reddit.com/r/VideoEditors/comments/1wqkx27/)। শীর্ষ মন্তব্যে (u/VisibleExplanation, 33 পয়েন্ট) বলা হয়: “যেকোনো AI টুল ভুলে যান। DaVinci Resolve ডাউনলোড করে ব্যবহার শিখুন... মৌলিক জ্ঞান ছাড়া কোনো AI টুল আপনাকে ভালো ফল দেবে না।”
- সামান্য সম্পাদনাকে নীরবে “Generative AI” নামে পুনরায় লেবেল করা ক্লোজড-সোর্স এডিটিং টুলের বিরুদ্ধে আস্থার প্রতিক্রিয়া তৈরি করছে — থ্রেড #11, r/mildlyinfuriating, 1,268 পয়েন্ট, 136 মন্তব্য, 2026-09-28 (https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/)। অভিযোগ অনুযায়ী Photoshop/Apple Photos সাধারণ crop-কেও AI-সম্পাদিত হিসেবে ট্যাগ করে এবং কপিরাইটের তথ্য সরিয়ে দেয়; u/Kagevjijon (41 পয়েন্ট): “এভাবে চলতে পারে না। এটি আসলেই চুরি।” তবে u/teh_maxh-এর আপত্তি (135 পয়েন্ট): “আমি Photoshop-এ একটি ছবি crop করে দেখলাম, এবং GAI ব্যবহারের মেটাডেটা যোগ হয়নি।”
- AI-তৈরি গেম মড (ওপেন, কমিউনিটি-চালিত) এখন আলোচিত মুহূর্তে আছে — থ্রেড #12, r/accelerate, 193 পয়েন্ট, 35 মন্তব্য, 2026-09-30 (https://www.reddit.com/r/accelerate/comments/1wuhyiw/)। u/Chopstik0-0 (38 পয়েন্ট) বর্ণনা করেন, নতুন VR গেম কেউ বানাচ্ছে না বোঝা যাওয়ার পর VR modding সাবরেডিট কীভাবে প্রতিরোধ থেকে উৎসাহে বদলে গেছে।
সংকেত
- উত্থানশীল: ওপেন-সোর্স রেফারেন্স-কনসিস্টেন্সি টুলিং (থ্রেড #4-এর ComfyUI নোড, থ্রেড #5-এর লোকাল Qwen+Krea2 স্ট্যাক) সংগৃহীত সেটে সবচেয়ে স্পষ্ট প্রশংসা পাচ্ছে—উচ্চ স্কোরের সঙ্গে প্রকৃত ইতিবাচক, প্রযুক্তিগত শীর্ষ মন্তব্য; শুধু প্রচারণা নয়।
- উত্থানশীল: ক্লোজড-সোর্স ভিডিও জেনারেশন দীর্ঘ বর্ণনামূলক কনটেন্টের পর্যায়ে পৌঁছেছে—ধারাবাহিক চরিত্রসহ 10 মিনিটের শর্ট ফিল্মটি সংগৃহীত সবচেয়ে বেশি সম্পৃক্ততার থ্রেড (784 পয়েন্ট, 196 মন্তব্য), এবং কমিউনিটির সমালোচনা দৃশ্যের বদলে স্ক্রিপ্ট ও ভয়েস অভিনয়কে ঘিরে।
- উপেক্ষিত: “সত্যিকারের ফ্রি” ক্লোজড-সোর্স ভিডিও জেনারেটরের ধারণা প্রতিষ্ঠিত ও কিছুটা ক্লান্তিকর বিতর্ক হিসেবে দেখা হচ্ছে (থ্রেড #1)—আলোচনা “কোন ফ্রি ওয়েবসাইট” থেকে “কোন ওপেন-সোর্স লোকাল সেটআপ”-এ চলে গেছে।
- মতভেদ: থ্রেড #3 পৃষ্ঠতলের উত্তেজনা (437 পয়েন্ট) ও মন্তব্যের স্তরের সন্দেহ/বিভ্রান্তির মধ্যে বিভাজন দেখায়—“3D AI” ওয়ার্কফ্লো নিয়ে অস্পষ্ট পোস্ট কেউ টুলটি কী তা না বুঝলেও প্রচুর পয়েন্ট পেতে পারে।
- চমক—গার্ডরেল এখন শুধু বিরক্তি নয়, প্ল্যাটফর্ম বদলের পুনরাবৃত্ত চালক: থ্রেড #2 (ক্লোজড-সোর্স NSFW ফিল্টার কঠোর হওয়া) এবং থ্রেড #6 (ChatGPT-এর গার্ডরেল অ-স্পষ্ট সুপারহিরো ছবিও আটকে দেওয়া)—উভয় ক্ষেত্রেই ব্যবহারকারীরা নির্দিষ্টভাবে ক্লোজড টুল ছেড়ে অন্য ক্লোজড টুল (Grok, VeniceAI) বা ওপেন টুলে (Seedream Unfiltered, uncensored SDXL) যাচ্ছেন।
- চমক—থ্রেড #11-এ ক্লোজড-সোর্স টুলিংয়ের বিরুদ্ধে আস্থার প্রতিক্রিয়া কনটেন্ট ফিল্টার নিয়ে নয়: এটি অ্যাট্রিবিউশন/মেটাডেটা নিয়ে—সাধারণ সম্পাদনাকে “Generative AI” হিসেবে স্বয়ংক্রিয় ট্যাগ করা ও কপিরাইট তথ্য সরানো—যা সেটের অন্যান্য গার্ডরেল অসন্তোষ থেকে ভিন্ন অভিযোগ।
সীমাবদ্ধতা
- সংগ্রাহক মাত্র একটি অনুসন্ধান শব্দ ব্যবহার করেছেন (“Image and Video Generation AI News”), যার মাধ্যমে 9টি সাবরেডিটে 12টি থ্রেড পাওয়া গেছে—ব্রিফের সমাপ্তি মানদণ্ডে প্রতি নেটওয়ার্কে প্রায় 20 পোস্টের লক্ষ্যের চেয়ে কম। প্লেবুক অনুযায়ী, কর্মী আগে থেকে যা সংগ্রহ করেছেন (
output/reddit.threads.md) কেবল তাই পড়া হয়েছে; Reddit WebFetch ও ওয়েব সার্চের মাধ্যমে খোলা পেজ ব্লক করে বলে নিজে Reddit ব্রাউজ করে পরিপূরক তথ্য নেওয়া হয়নি। - থ্রেড #9, #11 ও #12-এ শুরুর লেখা সংরক্ষিত হয়নি (শুধু শিরোনাম), তাই এসব পর্যবেক্ষণ পুরোপুরি মন্তব্য ও স্কোরের ওপর নির্ভরশীল।
- কোনো থ্রেডে বড় ক্লোজড-সোর্স ল্যাবের নির্দিষ্ট ঘোষণা (যেমন OpenAI/Google/Midjourney-এর নামযুক্ত মডেল লঞ্চ) বিশেষভাবে পাওয়া যায়নি—সংগৃহীত সেটটি পণ্য-উদ্বোধনী সংবাদের চেয়ে ব্যবহারকারীর অভিজ্ঞতা, টুলিং ও গার্ডরেল-ঘর্ষণের দিকে ঝুঁকেছে।
X
X — ছবি ও ভিডিও জেনারেশন AI সংবাদ
অ্যাকাউন্ট
সংগৃহীত ডেটার কোনো অ্যাকাউন্টই ছবি বা ভিডিও জেনারেশন AI—ক্লোজড-সোর্স বা ওপেন-সোর্স—নিয়ে আলোচনা করছে না। এখানে থাকা 33টি অ্যাকাউন্ট (@Davesonude, @rcostadoazeite, @ChrisExcel102, @Louissaikyoo, @DlugoszMarcin, @khtaeverse এবং আরও 27টি) হলো খেলার মিম অ্যাকাউন্ট, K-pop ভক্ত অ্যাকাউন্ট, Big Brother (#BB28) ভক্ত অ্যাকাউন্ট, যুক্তরাজ্যের রাজনৈতিক অ্যাকাউন্ট (Restore Britain), এবং সাধারণ মিম/শিটপোস্ট অ্যাকাউন্ট। এদের কেউই AI ছবি বা ভিডিও টুলকে মূল বিষয় হিসেবে পোস্ট করে না; ফলে প্রকৃত গবেষণা থিমের জন্য X-এ “কারা এটি চালাচ্ছে” বলার কিছু নেই—## সীমাবদ্ধতা দেখুন।
পোস্ট
output/x.posts.md-এর কোনো পোস্টেই (40 পোস্ট, 33 অ্যাকাউন্ট) ছবি জেনারেশন AI, ভিডিও জেনারেশন AI, বা সংশ্লিষ্ট কোনো পণ্য, কোম্পানি বা ওপেন-সোর্স প্রকল্পের উল্লেখ নেই (Midjourney, Sora, Stable Diffusion, Flux, Runway, Veo, Nano Banana, ComfyUI বা অনুরূপ কিছুর উল্লেখ নেই)। সর্বোচ্চ এনগেজমেন্টের পোস্টগুলো যাচাই করেও তা নিশ্চিত হয়েছে:
- পোস্ট #7, @Davesonude, আনুমানিক 291,000 ভিউ, 22,958 লাইক (2026-09-30),
https://x.com/Davesonude/status/2105273235965370529 — Ronaldo-কে নিয়ে ফুটবল মিম। “Ronaldo” অনুসন্ধানে পাওয়া। - পোস্ট #19, @ChrisExcel102, আনুমানিক 343,000 ভিউ, 7,886 লাইক (2026-09-29),
https://x.com/ChrisExcel102/status/2104913863200096350 — সেলিব্রিটি সম্পর্কের মিম। “JubJub” অনুসন্ধানে পাওয়া। - পোস্ট #26, @Louissaikyoo, আনুমানিক 185,000 ভিউ, 10,292 লাইক (2026-09-30),
https://x.com/Louissaikyoo/status/2105090778766696620 — Disney Channel ট্রিভিয়া কৌতুক। “China” অনুসন্ধানে পাওয়া। - পোস্ট #36, @DlugoszMarcin, আনুমানিক 189,000 ভিউ, 2,937 লাইক (2026-09-30),
https://x.com/DlugoszMarcin/status/2105363575145394223 — ফুটবল ভাষ্য (Messi/Lewandowski/Ronaldo/Modrić)। “Messi” অনুসন্ধানে পাওয়া।
এগুলোর কোনোটিই বা বাকি 36টি পোস্টের কোনোটিই গবেষণার বিষয় স্পর্শ করেনি। AI ছবি/ভিডিও জেনারেশন নিয়ে 5–12টি “ফাইন্ডিং” এখানে দেওয়া হচ্ছে না, কারণ সংগৃহীত উপকরণে এমন কোনো তথ্য নেই—এমনটি করা হলে তা বানানো তথ্য হবে, যা এই রানের প্লেবুক স্পষ্টভাবে নিষিদ্ধ করে।
সংকেত
এই ডেটাসেট থেকে ওপেন-সোর্স বা ক্লোজড-সোর্স ছবি/ভিডিও জেনারেশন AI বিষয়ে কোনো সংকেত পাওয়া যায় না। ডেটা যা দেখায়: সংগ্রহে ব্যবহৃত দশটি অনুসন্ধান শব্দ (“Halloween”, “Ronaldo”, “Britain”, “Yess”, “JubJub”, “Gold”, “China”, “#bb28”, “Messi”, “Balkans”) ছিল এই সেশনের অবস্থান অনুযায়ী X-এর নিজস্ব Explore-tab ট্রেন্ড, AI মিডিয়া জেনারেশনের বিষয় নয়। output/x.posts.md-এর Explore টেবিলও তা নিশ্চিত করে: 10টি ট্রেন্ডের 6টিতে স্পষ্টভাবে “Trending in Croatia” লেখা, আর অন্যগুলো (“Ronaldo,” “Britain,” “China,” “Messi”) বৈশ্বিক খেলা/রাজনীতির ট্রেন্ড—কোনোটিই AI বা প্রযুক্তিসংশ্লিষ্ট নয়। এটি সম্ভবত সংগ্রহপর্বের অসামঞ্জস্য: কর্মী AI ছবি/ভিডিও জেনারেশন শব্দ দিয়ে অনুসন্ধান না করে X যা ট্রেন্ডিং দেখিয়েছে তাই টেনেছেন; ফলে 40টি পোস্ট ফুটবল, যুক্তরাজ্যের রাজনৈতিক দল (Restore Britain), K-pop ফ্যানডম বিরোধ, রিয়েলিটি-TV সিজন (#BB28) ও সম্পর্কহীন মিম নিয়ে।
সীমাবদ্ধতা
- সংগৃহীত ডেটা গবেষণা ব্রিফের উত্তর দেয় না। ব্রিফে ক্লোজড ও ওপেন-সোর্স ছবি/ভিডিও জেনারেশন AI সংবাদ চাওয়া হয়েছে; কিন্তু কর্মীর 10টি অনুসন্ধান শব্দ ছিল AI-সম্পর্কিত কুয়েরি নয়, এই সেশনের অবস্থানভিত্তিক (Explore টেবিল অনুযায়ী প্রধানত Croatia) সাধারণ ট্রেন্ড। সংগৃহীত 40টি পোস্ট হাতে ধরে থিমের সঙ্গে মিলিয়ে দেখা হয়েছে এবং একটিও যোগ্য নয়।
- এই ধাপের প্লেবুক অনুযায়ী X নিজে ব্রাউজ করা হয়নি (অজ্ঞাত পাঠক X-এ কিছু দেখেন না); কেবল সংগৃহীত
output/x.posts.md/output/x.posts.json-এর ওপর নির্ভর করা হয়েছে। - পরিমাণে সমাপ্তি মানদণ্ড (“প্রতি সামাজিক নেটওয়ার্কে প্রায় 20 পোস্ট বিশ্লেষণ”) পূরণ হলেও—40টি পোস্ট বিশ্লেষিত—প্রাসঙ্গিকতায় তা পূরণ হয়নি। ফলে X ধাপটি সংশ্লেষে কোনো ক্লোজড-সোর্স বা ওপেন-সোর্স তথ্য যোগ করতে পারে না। সাধারণ ট্রেন্ডের বদলে “Midjourney,” “Sora,” “Stable Diffusion,” “Flux,” “Runway,” “Veo,” “Nano Banana,” “ComfyUI” ইত্যাদি অনুসন্ধান শব্দ দিয়ে X ধাপ পুনরায় চালানো উচিত।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড/ওপেন-সোর্স)
চ্যানেল
- AI WITH Rithesh (Rithesh Sreenivasan) — ChatGPT/OpenAI-সম্পর্কিত রিলিজ একই দিনে যাচাই করা ব্যক্তিগত চ্যানেল।
- Bart Slodyczka — নতুন মডেল প্রকাশের পরই “কী বদলেছে” সারসংক্ষেপ করা চ্যানেল।
- Learn with LEESI — Google Gemini/Veo/Flow-ভিত্তিক টিউটোরিয়ালে বিশেষায়িত চ্যানেল।
- WorldofAI(@intheworldofai) — সাপ্তাহিক ক্লোজড-সোর্স AI সংবাদ পর্যালোচনাকারী চ্যানেল।
- MattVidPro — AI ভিডিও জেনারেশন মডেলের তুলনা ও দ্রুত সংবাদে পরিচিত বড় AI চ্যানেল।
- There's An AI For That(@theresanaiforit) — নতুন মডেলের দ্রুত সংবাদ ও তুলনামূলক কনটেন্ট।
- Promptus AI(@promptusai) — ওপেন-সোর্স ছবি/ভিডিও মডেল লোকালি চালানোর টিউটোরিয়ালে বিশেষায়িত।
- AI Late to Class(@ailatetoclass) — ওপেন-সোর্স ছবি সম্পাদনা মডেলের রিভিউ।
- MaxonShire — লোকাল ভিডিও জেনারেশন মডেলের তুলনায় (HunyuanVideo, Wan, LTX ইত্যাদি) বিশেষায়িত।
- smallzero(@webdot3) — ComfyUI-তে ওপেন-সোর্স মডেলের ব্যবহার (যেমন Z-Image)।
- FlyMyAI — দৈনিক/সাপ্তাহিক AI সংবাদ ব্রিফ প্রকাশ করে।
- Lev Selector(@lev-selector) — সাপ্তাহিক AI আপডেট সংকলন চ্যানেল।
YouTube অনুসন্ধান ফলাফলের HTML JavaScript-এ রেন্ডার হওয়ায় চ্যানেল সাবস্ক্রাইবার সংখ্যা সরাসরি যাচাই করা যায়নি (সীমাবদ্ধতা দেখুন)।
ভিডিও
ক্লোজড-সোর্স
- 「ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!」 — AI WITH Rithesh / 2026 সালের সেপ্টেম্বরের শুরু — OpenAI 2026 সালের 8 সেপ্টেম্বর চালু করা GPT Image 2.5 (স্কেচ থেকে ছবি তৈরির নতুন “Sketch” ফিচার, জেনারেশন গতি সর্বোচ্চ 50% বাড়ানো) যাচাই করেছে। https://www.youtube.com/watch?v=LYUr4BY33h4
- 「ChatGPT Image 2.5 Just Dropped — Here's Everything That's New」 — Bart Slodyczka / 2026 সালের সেপ্টেম্বর — GPT Image 2.5-এর নতুন ফিচারগুলোর পূর্ণাঙ্গ পর্যালোচনা। https://www.youtube.com/watch?v=dvpQHWwuaIo
- 「Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation」 — Learn with LEESI — Google Flow/Vids-এর মাধ্যমে Veo 3.1 (ছবি থেকে ভিডিও, তিনটি রেফারেন্স ছবি সমর্থন) বিনামূল্যে উন্মুক্ত হওয়ার পরিচিতি। https://www.youtube.com/watch?v=uj6eD31OxkA
- 「Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!」 — WorldofAI — Google DeepMind-এর Nano Banana 2.0 (Gemini-ভিত্তিক ছবি জেনারেশন) পরীক্ষা করে একে “Photoshop-কে ছাড়িয়ে গেছে” বলে মূল্যায়ন। https://www.youtube.com/watch?v=u22-XoQvI4I
- 「Kling 2.5 goes BEAST MODE for AI Video!」 — MattVidPro — Kling 2.5 গতিশীলতার ক্ষেত্রে বড় অগ্রগতি করেছে বলে প্রতিবেদন। https://www.youtube.com/watch?v=SGUxHC1cI1c
- 「AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)」 — MattVidPro — ক্লোজড (Kling) ও ওপেন (Wan) মডেল পাশাপাশি তুলনা করে প্রতিযোগিতা তীব্র হচ্ছে বলে উল্লেখ। https://www.youtube.com/watch?v=vFXe3uXb75k
- 「Your AI news brief for September 3, 2026.」 — FlyMyAI — 2026 সালের 3 সেপ্টেম্বরের AI বিষয়ক সাধারণ সংবাদ ব্রিফ, যাতে ছবি/ভিডিও জেনারেশনের বিষয়ও আছে। https://www.youtube.com/watch?v=JK6w9tA2jH8
- 「Exciting AI Updates Weekly - September 25, 2026」 — Lev Selector — সাম্প্রতিক এক সপ্তাহের AI আপডেটের সংকলন; ছবি ও ভিডিও জেনারেশন মডেলও অন্তর্ভুক্ত। https://www.youtube.com/watch?v=iyZHPCNd8jI
ওপেন-সোর্স
- 「Is FLUX 2.0 The New Open Source King?」 — There's An AI For That — Black Forest Labs-এর FLUX.2-কে ওপেন-ওয়েট ছবি/সম্পাদনা মডেলের শীর্ষ প্রার্থী হিসেবে মূল্যায়ন। https://www.youtube.com/watch?v=YQuTkPVkCS8
- 「New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial」(oEmbed-এ শিরোনাম:「Z-Image Open-Source Image Generator: Free Online and Local Setup」) — Promptus AI — Alibaba Tongyi-MAI-এর Z-Image Turbo (6B প্যারামিটার, 6GB VRAM-এ চলে) Flux 2-কে ছাড়িয়ে গেছে বলে উপস্থাপন। https://www.youtube.com/watch?v=JF4Q5hXh-_Q
- 「Z-Image Full Release: The New King of AI Influencers in ComfyUI?」 — smallzero — Z-Image-এর আনডিস্টিলড পূর্ণ রিলিজ (Base) ComfyUI-তে পরীক্ষা। https://www.youtube.com/watch?v=ClVY5ll1sDU
- 「Qwen Image 2.1 best open source Image Editor. Better than Nano Banana」 — AI Late to Class — Alibaba Qwen-Image-Edit-এর সর্বশেষ সংস্করণ 10টি রেফারেন্স ছবি, স্বচ্ছ ব্যাকগ্রাউন্ড ও দ্রুততার কারণে Nano Banana-এর সমকক্ষ বা ভালো বলে মূল্যায়ন। https://www.youtube.com/watch?v=AIgYj5RG-FQ
- 「HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?」 — MaxonShire — Tencent-এর HunyuanVideo 1.5 এবং Alibaba-এর Wan 2.7-কে লোকাল ভিডিও জেনারেশন মডেল হিসেবে তুলনা। https://www.youtube.com/watch?v=4GNT4-QYekg
সংকেত
- ক্লোজড-সোর্স শিবির “ফিচার যোগের গতি” দিয়ে প্রতিযোগিতা করছে: OpenAI (GPT Image 2.5 “Sketch”, 2026/9/8), Google (Veo 3.1 বিনামূল্যে + Google Vids/Flow একীভূতকরণ), ও Kling 2.5-এর আপডেট প্রায় একই সময়ে এসেছে; মাসভিত্তিক ফিচার প্রতিযোগিতা চলমান।
- ওপেন-সোর্স শিবিরে চীনা শক্তি (Alibaba Tongyi-MAI, Qwen) গতি পাচ্ছে: Z-Image Turbo ও Qwen-Image-Edit বারবার “6GB/কম VRAM-এ চলে” এবং “Nano Banana-মানের গুণমান” হিসেবে আলোচিত; Black Forest Labs-এর FLUX.2-এর সঙ্গে সরাসরি তুলনা এখন পরিচিত কাঠামো।
- “ওপেন বনাম ক্লোজড” তুলনামূলক ভিডিও আলাদা একটি ঘরানায় পরিণত হয়েছে: “WAN 2.5 is Open Source Veo3”, “Z-Image vs Flux 2”-এর মতো শিরোনামে ওপেন-সোর্স মডেলকে ক্লোজড-সোর্স বিকল্প হিসেবে উপস্থাপন করা হচ্ছে।
- ComfyUI-তে লোকাল চালানোর টিউটোরিয়াল (Promptus AI, MaxonShire, smallzero) ওপেন-সোর্স কনটেন্টের প্রধান ফরম্যাট হয়ে উঠেছে—নতুন মডেল এলেই “ComfyUI-তে সেটআপ” ভিডিও দ্রুত প্রকাশিত হয়।
- সাপ্তাহিক/দৈনিক AI সংবাদ ব্রিফ চ্যানেল (FlyMyAI, Lev Selector) নিয়মিত ছবি ও ভিডিও জেনারেশন বিষয় তুলে ধরে; একক মডেলের সংবাদ এসব নিয়মিত আপডেট চ্যানেলের মাধ্যমেও ছড়ায়।
সীমাবদ্ধতা
- YouTube অনুসন্ধান ফলাফল (
youtube.com/results?search_query=...) এবং ভিডিও পেজ (youtube.com/watch?v=...) JavaScript-এ রেন্ডার হওয়ায় WebFetch দিয়ে ভিডিও তালিকা বা পেজের মূল লেখা (ভিউ, প্রকাশের তারিখ, চ্যানেল সাবস্ক্রাইবার, মন্তব্য) সরাসরি পাওয়া যায়নি। শিরোনাম ও চ্যানেলের নাম পৃথক ভিডিওর জন্যyoutube.com/oembedendpoint (JSON) দিয়ে যাচাই করা হয়েছে; প্রকাশকাল ও প্রেক্ষাপট ওয়েব সার্চের স্নিপেট ও সংশ্লিষ্ট নিবন্ধ দিয়ে সম্পূরক করা হয়েছে। - ফলে প্রতিটি ভিডিওর নির্ভুল ভিউ ও প্রকাশ-তারিখ, এবং চ্যানেল সাবস্ক্রাইবার সংখ্যা নিশ্চিত করা যায়নি। কিছু ভিডিওর ক্ষেত্রে ওয়েব সার্চে “◯ দিন আগে” আপেক্ষিক সময় দেখা গেলেও 60 দিনের সাম্প্রতিক সীমার চেয়ে অনেক পুরোনো (300 দিনেরও বেশি) ভিডিও ছিল; তাই প্রতিবেদনে স্পষ্টভাবে 60 দিনের মধ্যে চিহ্নিত বিষয়কে অগ্রাধিকার দেওয়া হয়েছে (GPT Image 2.5: 2026/9/8 এবং তারিখসহ সাপ্তাহিক সংবাদ ভিডিও)।
- Runway Gen-4.5, Grok Imagine, Seedream 4.0, Midjourney V8 ইত্যাদি নিয়ে সম্পর্কিত YouTube ভিডিও পাওয়া গেছে, কিন্তু প্রকাশকাল বা চ্যানেলের বিস্তারিত যাচাই করার যথেষ্ট তথ্য পাওয়া যায়নি; তাই Videos অংশে রাখা হয়নি (ওয়েব সার্চে অস্তিত্ব নিশ্চিত হয়েছে)।
- ভিডিও পেজের মূল লেখা পাওয়া যায়নি বলে এবার মন্তব্যের বিষয়বস্তু বিশ্লেষণ করা সম্ভব হয়নি।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড/ওপেন-সোর্স)
গবেষণা পদ্ধতি: Bluesky-এর অফিসিয়াল সাইট (bsky.app) JavaScript SPA হওয়ায় অনুসন্ধান ফল রেন্ডার করা যায় না; তাই Bluesky-এর AT Protocol-এর পাবলিক API (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts, প্রমাণীকরণ প্রয়োজন নেই) সরাসরি ব্যবহার করে বাস্তব পোস্ট ডেটা (লেখা, লেখক, লাইক সংখ্যা, পোস্টের সময়) সংগ্রহ করা হয়েছে। “Nano Banana”, “Sora 2”, “Flux”, “ComfyUI”, “Z-Image”, “Qwen Image”, “open weights”, “Veo 3” ইত্যাদি কীওয়ার্ডে অনুসন্ধান করে 100টির বেশি বাস্তব পোস্ট দেখা হয়েছে এবং থিম-প্রাসঙ্গিক পোস্টগুলো বাছাই করা হয়েছে।
অ্যাকাউন্ট
- Eliot Higgins(
eliothiggins.bsky.social, Bellingcat-এর প্রতিষ্ঠাতা, Bluesky-তে যাচাইকৃত)—Veo 3 দ্বারা বিভ্রান্তি ও ডিপফেকের ঝুঁকি নিয়ে নিয়মিত লিখেন। - Simon Willison(
simonwillison.net, স্বাধীন AI গবেষক, Bluesky-তে যাচাইকৃত)—Qwen-Image / Qwen-Image-Edit-এর মতো ওপেন-ওয়েট মডেল লোকালি চালিয়ে প্রযুক্তিগত নোট পোস্ট করেন। - Ethan Mollick(
emollick.bsky.social, Wharton-এর অধ্যাপক, Bluesky-তে যাচাইকৃত)—ওপেন-ওয়েট মডেলের সক্ষমতা ও ঝুঁকি নিয়ে নিয়মিত মন্তব্য করেন। - 404 Media সাংবাদিক(Jason Koebler
jasonkoebler.bsky.social, Sam Colesamleecole.bsky.social)—Sora 2-এর কপিরাইট ও কনটেন্ট মডারেশন সমস্যা নিয়ে অনুসন্ধানী প্রতিবেদন করেন। - obeca(
obeca.bsky.social, তুর্কিভাষী পরিসর)—প্রায় প্রতিদিন Nano Banana 2 দিয়ে তৈরি ছবি পোস্ট করা ব্যক্তিগত অ্যাকাউন্ট। - Ria_Tatibana(
ria-tatibana.bsky.social, জাপানিভাষী পরিসর)—ComfyUI + Krea2 (ওপেন-সোর্স মডেল) দিয়ে প্রতিদিন ইলাস্ট্রেশন পোস্ট করেন। - cubby.jpg(
cubby-ai.bsky.social)—Z-Image / Qwen-Image-এর মতো ওপেন-সোর্স ছবি মডেলে AI শিল্পকর্ম ব্যাপকভাবে তৈরি করে এমন অ্যাকাউন্ট। - AlternativeTo(
alternativeto.net)—সফটওয়্যার সংবাদ স্বয়ংক্রিয়ভাবে পোস্ট করা অ্যাকাউন্ট, Qwen-Image-2.1-এর মতো মডেল রিলিজের দ্রুত খবর দেয়।
পোস্ট
ক্লোজড-সোর্স
- Google Veo 3 বর্ণবাদী কনটেন্ট তৈরি করতে পারে—এই সমস্যা — Eliot Higgins, 2025-06-22, ❤️842। “Google Veo 3 বর্ণবাদের নতুন ও আকর্ষণীয় উপায় দিচ্ছে।” https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
- TIME সাংবাদিকেরা Veo 3 দিয়ে মুসলিমদের অগ্নিসংযোগ ও হিন্দু মন্দিরে আগুন লাগানোর বিশ্বাসযোগ্য ভুয়া ভিডিও বানাতে পেরেছেন; প্রশ্নের মুখে Google দৃশ্যমান ওয়াটারমার্ক যোগ করে — Aman Batheja (TIME সাংবাদিক), 2025-06-03, ❤️431・🔁192・উদ্ধৃতি 107। “নতুন: TIME প্রতিবেদকেরা Google-এর AI ভিডিও টুল ব্যবহার করে মুসলিমদের একটি হিন্দু মন্দিরে আগুন লাগানোর বিশ্বাসযোগ্য ভিডিও তৈরি করতে পেরেছেন...” https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
- Sora 2-এর বার্ষিক পরিচালন ব্যয় প্রায় 5 বিলিয়ন ডলার, এ পর্যন্ত OpenAI-এর আয় প্রায় 1.4 মিলিয়ন ডলার—এমন দাবি — Peter Labuza, 2026-02-10, ❤️1,375・🔁368・উদ্ধৃতি 192। “Sora 2 চালাতে বছরে সম্ভবত প্রায় $5 billion লাগে এবং এ পর্যন্ত OpenAI-এর আয় প্রায় $1.4 million।” https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
- Sora AI প্রতিষ্ঠানগুলোর “কপিরাইটযুক্ত উপকরণে প্রশিক্ষণ দিইনি” দাবির ভেঙে পড়ার প্রতীক—এমন সমালোচনামূলক নিবন্ধ — Jason Koebler (404 Media), 2025-10-01, ❤️1,508・উদ্ধৃতি 44। “Sora-এর বিষয়টি এতটাই নিরানন্দ, এবং AI কোম্পানিগুলো কপিরাইটকৃত উপাদানে প্রশিক্ষণ দেয়নি—এমন ভান করার সময় থেকে আমরা কত দূরে এসেছি তা দেখায়।” https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
- Sora 2 কপিরাইটকৃত চরিত্র তৈরি নিষিদ্ধ করতেই ব্যবহারকারীদের তীব্র প্রতিক্রিয়া—এমন প্রতিবেদন — Sam Cole (404 Media), 2025-10-08, ❤️435・উদ্ধৃতি 37। “মনে হয় Sora-তে মানুষ শুধু কপিরাইটকৃত চরিত্রের ছবি বানাতেই চায়; এখন তা না পারায় তারা ভয়ংকরভাবে ক্ষুব্ধ।” https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
- Nano Banana(2)-এর তৈরি ছবিতে প্রতারিত হওয়ার অভিজ্ঞতা — furuakasaber.bsky.social, 2026-07-03, ❤️333। “এই Nano Banana বাজে জিনিস আমাকে ঠকিয়েছে, যদিও মনে হয়েছিল কিছু একটা অস্বাভাবিক। বেশ ভয়ংকর।” https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
- Nano Banana-ধাঁচের ইনফোগ্রাফিক (“AI-এর মতো দেখতে গ্রাফিক”) নিয়ে ক্লান্তি — garrison.corporate.fm, 2026-03-15, ❤️73・🔁9। “nano banana ইনফোগ্রাফিক যেকোনো মূল্যে বন্ধ করতে হবে।” https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
ওপেন-সোর্স
- Alibaba Qwen প্রথম ছবি জেনারেশন মডেল “Qwen-Image” Apache 2.0 লাইসেন্সে প্রকাশ করেছে — Simon Willison, 2025-08-04, ❤️46। “Qwen আজ তাদের প্রথম ছবি জেনারেশন মডেল Qwen-Image প্রকাশ করেছে—তাদের LLM-এর মতোই Apache 2.0।” https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
- Qwen-Image-Edit-এর বাস্তব পরীক্ষা: Mac-এ প্রায় পুরো 64GB RAM ব্যবহার এবং 54GB ডিস্ক প্রয়োজন—এমন পরিমাপভিত্তিক প্রতিবেদন — Simon Willison, 2025-08-19, ❤️77। “আমার Mac-এ নতুন Qwen-Image-Edit মডেল চালানোর নোট... এটি আমার 64GB RAM-এর প্রায় সবটাই ব্যবহার করেছে এবং 54GB ডিস্ক লেগেছে।” https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
- Alibaba 7 বিলিয়ন প্যারামিটারের “Qwen-Image-2.1” ওপেন-ওয়েট হিসেবে প্রকাশ করেছে; লাইসেন্সেও পরিবর্তন — AlternativeTo, 2026-09-24, ❤️6। “Alibaba Cloud 7B প্যারামিটারের Qwen-Image-2.1 মডেল প্রকাশ করেছে... লাইসেন্স পরিবর্তনও আছে।” https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
- Apple ছবি ও ভিডিও জেনারেশনের জন্য Transformer autoregressive flow মডেল “STARFlow” ও “STARFlow-V” ওপেন-ওয়েট হিসেবে প্রকাশ করেছে — Sung Kim, 2025-12-02, ❤️13। “Apple উচ্চমানের ছবি ও ভিডিও জেনারেশনের জন্য অত্যাধুনিক transformer autoregressive flow মডেল STARFlow ও STARFlow-V—দুটিরই open weights প্রকাশ করেছে।” https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
- ওপেন-ওয়েট “GLM-5.3” শক্তিশালী হলেও প্রায় কোনো গার্ডরেল নেই এবং আক্রমণাত্মক সাইবার সক্ষমতাও রাখে—এমন সতর্কতা — Ethan Mollick, 2026-08-28, ❤️88। “ওপেন-ওয়েট মডেলগুলোর কার্যত কোনো গার্ডরেল নেই, এবং তারা খুব সামান্য ঝুঁকি পরীক্ষা করে।” https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
- ComfyUI + Krea2 (ওপেন-সোর্স ছবি মডেল) দিয়ে দৈনিক ইলাস্ট্রেশন পোস্ট; প্রতি পোস্টে ❤️50–80 — Ria_Tatibana, 2026-09-28 থেকে 10-01-এর একাধিক পোস্ট (উদাহরণ: https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t , ❤️53)। অনুসন্ধানে ComfyUI ট্যাগের শীর্ষ ফলের অধিকাংশই AI ইলাস্ট্রেশন নির্মাতাদের দৈনন্দিন কাজ ভাগাভাগির পোস্ট।
- Z-Image (Alibaba Tongyi-এর হালকা ওপেন-সোর্স ছবি মডেল) প্রকাশ নিয়ে প্রত্যাশা ও ব্যঙ্গ — theophite.bsky.social, 2025-11-27, ❤️30। “z-image প্রকাশের অপেক্ষায় নেই।” https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
সংকেত
- Veo 3 = “বিভ্রান্তিমূলক তথ্যের টুল” হিসেবে প্রতিষ্ঠিত সুনাম: Eliot Higgins (Bellingcat প্রতিষ্ঠাতা) বারবার বিষয়টি তুলেছেন, TIME-এর অনুসন্ধানী প্রতিবেদনও ছড়িয়েছে (❤️431, উদ্ধৃতি 107)। ক্লোজড-সোর্স ভিডিও জেনারেশনের প্রধান প্রশ্ন “গুণমান” থেকে “অপব্যবহার”-এ সরে গেছে।
- Sora 2 অর্থনৈতিকভাবেও চাপে, বিতর্কও চলমান: বার্ষিক 5 বিলিয়ন ডলার পরিচালন ব্যয় বনাম 1.4 মিলিয়ন ডলার আয়ের সংখ্যাটি (❤️1,375) ব্যাপকভাবে ছড়িয়েছে। কপিরাইটকৃত চরিত্র তৈরিতে কঠোর নিষেধাজ্ঞায় ব্যবহারকারীর অসন্তোষ বিস্ফোরিত হয়েছে (❤️435)—“ক্লোজড-সোর্সের নীতির পরিবর্তন → ব্যবহারকারীর প্রতিক্রিয়া” কাঠামো বারবার দেখা যায়।
- Nano Banana (Google) এখন সাধারণ ব্যবহারকারীর ডিফল্ট ছবি জেনারেশন টুল: obeca.bsky.social-এর মতো ব্যক্তি নিয়মিত তৈরি ছবি পোস্ট করছেন; তুর্কিভাষী ও জাপানিভাষীসহ অ-ইংরেজি পরিসরেও এর ব্যবহার প্রতিষ্ঠিত। তবে “চেনা যায় না বলে ভয় লাগে”—এমন মতও (❤️333) প্রবল।
- ওপেন-সোর্স ছবি জেনারেশনে “Qwen-Image সিরিজ” প্রযুক্তি সম্প্রদায়ের কেন্দ্রীয় আলোচ্য: Simon Willison-এর মতো গবেষকরা বাস্তব পরীক্ষা করেন—VRAM/ডিস্ক ব্যবহার পর্যন্ত—এবং Apache 2.0 লাইসেন্স ইতিবাচকভাবে গৃহীত। তবে Qwen-Image-2.1-এ লাইসেন্স পরিবর্তন হয়েছে (❤️6 পোস্টে উল্লেখ), ফলে ওপেন-সোর্স শিবিরেও “আসলে কতটা ওপেন?”—এই টানাপোড়েন আছে।
- ComfyUI ওপেন-সোর্স ছবি জেনারেশনের ডি-ফ্যাক্টো স্ট্যান্ডার্ড ওয়ার্কফ্লোই রয়ে গেছে: অনুসন্ধান ফলের বড় অংশ ComfyUI + নির্দিষ্ট মডেল (Krea2, SDXL ইত্যাদি) দিয়ে তৈরি দৈনন্দিন AI ইলাস্ট্রেশন; এটি প্রযুক্তি সংবাদ নয়, বরং জীবনে মিশে যাওয়া টুল হিসেবে এর প্রতিষ্ঠা দেখায়।
- ওপেন-ওয়েট = উচ্চ সক্ষমতা কিন্তু গার্ডরেলহীন—বিশেষজ্ঞদের সতর্কতা: Ethan Mollick-এর মতো পরিচিত গবেষকরা GLM-5.3-র মতো ওপেন-ওয়েট মডেলের আক্রমণাত্মক সক্ষমতা ও সীমিত ঝুঁকি পরীক্ষা নিয়ে লিখছেন। Apple (STARFlow)-এর মতো বড় প্রতিষ্ঠানও ওপেন-ওয়েট প্রকাশে যুক্ত হওয়ায় ওপেন-সোর্স শিবিরের পরিসর বাড়ছে।
সীমাবদ্ধতা
- Bluesky-এর অফিসিয়াল সাইট (bsky.app) SPA হওয়ায় WebFetch দিয়ে সরাসরি মূল লেখা পাওয়া যায়নি, এবং
public.api.bsky.appঅনুসন্ধান endpoint 403 ফিরিয়েছে। শেষেapi.bsky.app(“public.” ছাড়া) একই API প্রমাণীকরণ ছাড়াই সাড়া দেওয়ায় বাস্তব ডেটা সংগ্রহে সেটিই ব্যবহার করা হয়েছে। - “Flux”, “Kling”, “Wan”-এর মতো সাধারণ শব্দ বা অন্য ক্ষেত্রের সঙ্গে মিলে যেতে পারে এমন কীওয়ার্ডে অনুসন্ধান-নয়েজ বেশি ছিল, ফলে যথেষ্ট প্রাসঙ্গিক পোস্ট সংগ্রহ করা যায়নি (Flux অনুসন্ধানে 15টির মধ্যে কার্যত ছবি জেনারেশন AI-সংক্রান্ত পোস্ট 0)। Black Forest Labs-এর FLUX.2 নিয়ে Bluesky-তে যথেষ্ট পোস্ট পাওয়া যায়নি।
- Kling 2.5, Wan 2.5, HunyuanVideo, Seedance-এর মতো ভিডিও জেনারেশন মডেলের নামগুলোর জন্য এ কুয়েরিগুলোতে যথেষ্ট পোস্ট মেলেনি; Bluesky-তে তাদের নিয়ে আলোচনার মাত্রা নিশ্চিত করা যায়নি (YouTube ইত্যাদিতে বেশি সক্রিয় হতে পারে)।
- অনুসন্ধান API-তে
sort=topব্যবহার করলেও প্রকৃত জনপ্রিয়তার ক্রম নিশ্চিত নয় (cursor-ভিত্তিক পেজিংয়ে তারিখ মিশ্রিত ছিল); তাই বাছাই করা “প্রতিনিধিত্বশীল পোস্ট” কঠোর জনপ্রিয়তা র্যাঙ্কিং নয়, বরং প্রাসঙ্গিকতা ও অস্তিত্ব যাচাই করা নমুনা।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI (ক্লোজড/ওপেন-সোর্স)-এর গতিবিধি
কমিউনিটি
- !«メールアドレス» — ওপেন-সোর্সের নতুন মডেল ও টুল রিলিজের মূল কমিউনিটি। পোস্টের ঘনত্ব বেশি, কিন্তু প্রতিটি পোস্টের স্কোর 1–10-এর মধ্যে, তাই ছোট পরিসর।
- !«メールアドレス» / !«メールアドレス» — Civitai-সংযুক্ত স্বয়ংক্রিয় পোস্টে তৈরি ছবি (Krea, SDXL সিরিজ ইত্যাদি) প্রতিদিন আসে। সংবাদমূল্য কম, তবে ওপেন-সোর্স মডেল নিত্য ব্যবহার হচ্ছে—তার প্রমাণ।
- !«メールアドレス» / !«メールアドレス» — একই ছবি ক্রস-পোস্ট করা বিমূর্ত শিল্পের কমিউনিটি।
- !«メールアドレス» — Reddit-এর AI সাবরেডিট (r/ArtificialIntelligence ইত্যাদি) মিরর করা বট-চালিত কমিউনিটি। ক্লোজড-সোর্সের সংবাদ (Sora, Nano Banana, Seedream ইত্যাদি) মূলত এখান দিয়েই আসে, কিন্তু স্কোর সাধারণত 0–1 এবং আলোচনা প্রায় নেই।
- !«メールアドレス» / !«メールアドレス» / !tech — Black Forest Labs-এর FLUX-সংক্রান্ত খবরের মতো একক পোস্ট এখানে আসে।
- !«メールアドレス» / !casual_perchance — বিনামূল্যের ব্রাউজার ছবি জেনারেশন সেবা Perchance.org-এর ব্যবহারকারী কমিউনিটি।
- Lemmy.world-এর কমিউনিটি পেজ (
/c/<name>) বারবার 500/400 ত্রুটি দিচ্ছিল এবং API (/api/v3/community) থেকে প্যারামিটার-সংক্রান্ত কারণে তথ্য পাওয়া যায়নি; তাই কোনো কমিউনিটির সদস্যসংখ্যাই যাচাই করা সম্ভব হয়নি (সীমাবদ্ধতাদেখুন)।
পোস্ট
ওপেন-সোর্সঘেঁষা
- scraed/LanPaint — যেকোনো Stable Diffusion মডেলের সঙ্গে ব্যবহারযোগ্য, প্রশিক্ষণবিহীন উচ্চমানের ইনপেইন্টিং (ComfyUI সমর্থিত) / !«メールアドレス» / স্কোর 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
- DenRakEiw/scumble — লেয়ার, টেক্সট নির্বাচন ও কাস্টম ব্রাশসহ AI ইনপেইন্টিং-কেন্দ্রিক ডেস্কটপ এডিটর। নিজস্ব ComfyUI বা API প্রদানকারী দিয়ে আঁকে, MCP সমর্থিত / !«メールアドレス» / স্কোর 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
- ogoun/fooocus-qwen-image-2.1 — Qwen-Image-2.1-এর WebUI / !«メールアドレス» / স্কোর 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
- PrunaAI/Pruna-Qwen-Image-2.1 — Qwen-Image-2.1-এর জন্য কম-ধাপের LoRA অ্যাডাপ্টার (Kijai-এর
QwenImage_experimentalControlNet union ডেরিভেটিভের একই সময়ে এসেছে; Qwen-Image-2.1 ঘিরে টুলসমষ্টি দ্রুত বেড়েছে) / !«メールアドレス» / স্কোর 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 — Black Forest Labs-এর ওপেন-ওয়েট 9B মডেলের FP8 quantized সংস্করণ / !«メールアドレス» / স্কোর 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
- Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — distillation-বর্ধিত হয়ে ক্লোজড-সোর্স ভিডিও মডেলকে ছাড়িয়েছে বলে দাবি করা ওপেন-সোর্স ভিডিও জেনারেশন মডেল / !«メールアドレス» / স্কোর 5 / 2026-05-13 / (webm সংযুক্তি, lemmy.dbzer0.com pictrs)
ক্লোজড-সোর্সঘেঁষা
- Black Forest Labs “FLUX 3” ঘোষণা করেছে — ছবি জেনারেশনের সঙ্গে অডিওসহ 20 সেকেন্ডের ভিডিও তৈরি করতে পারে, প্রথমে সীমিত প্রকাশ / !«メールアドレス» / স্কোর 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
- OpenAI পরের সপ্তাহে (9/24) Sora API বন্ধ করছে, অপরদিকে চীনা প্রতিদ্বন্দ্বীরা 3 বিলিয়ন ডলার তুলছে — ভোক্তামুখী AI ভিডিও লাভজনক নয়; Kling-এর মতো এন্টারপ্রাইজমুখী প্রতিষ্ঠান অর্থ সংগ্রহ করছে—এমন বিশ্লেষণ / !«メールアドレス» / স্কোর 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Google Google Earth-এর AI ফিচার (Nano Banana 2) একদিনের মধ্যেই প্রত্যাহার করেছে — অপব্যবহারের কারণে ফিচার বন্ধ / !«メールアドレス» / স্কোর 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Seedream 5.0 Pro-এর সৎ তুলনা ও প্রযুক্তিগত ব্যাখ্যা (Nano Banana Pro-এর সঙ্গে দ্বন্দ্ব) / !«メールアドレス» / স্কোর 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
- “Berserk-এর একই ডাবল-পেজ চারটি AI দিয়ে রঙ করা” তুলনা — ChatGPT Images 2.5 / Wan 2.7 Pro / Nano Banana Pro / Seedream 5.0 Pro-কে পাশাপাশি পরীক্ষা; GPT জয়ী—এমন মত / !«メールアドレス» / স্কোর 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
- ছয়টি AI ভিডিও মডেলে একই প্রম্পট, প্রায় 40 জনের অন্ধ মূল্যায়ন — Google Veo প্রথম, শীর্ষ তিন মডেলের ব্যবধান অল্প / !«メールアドレス» / স্কোর 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
- ByteDance-এর Seedance 2.5 ঘোষণা — one-take জেনারেশন ও নমনীয় রেফারেন্স ফিচার যোগ / !«メールアドレス» / স্কোর 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
- Runway-এর দাবি, তাদের এন্টারপ্রাইজ ব্যবসা দ্বিগুণ হয়েছে এবং NRR 300%-এর বেশি / !«メールアドレス» / স্কোর 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
সংকেত
- Qwen-Image-2.1 Lemmy-র ওপেন-সোর্স শিবিরের কেন্দ্রে: একই সপ্তাহে (9/26-27) WebUI (fooocus ডেরিভেটিভ), ControlNet (Kijai), ও কম-ধাপ LoRA (PrunaAI) ধারাবাহিকভাবে পোস্ট হয়েছে; বর্তমান ComfyUI/Stable Diffusion কমিউনিটির প্রধান ক্ষেত্র Qwen-Image সিরিজ।
- “ক্লোজড-সোর্স নিজেই সীমারেখা ভাঙছে” প্রবণতা: Black Forest Labs (মূলত ওপেন-ওয়েটকেন্দ্রিক) FLUX 3-এ ভিডিও+অডিও ফিচার “সীমিত ক্লোজড প্রকাশ” করেছে, আবার FLUX.2-klein-9b-এর মতো ওপেন-ওয়েট সংস্করণও পাশাপাশি দিচ্ছে; ওপেন/ক্লোজড সীমারেখা অস্পষ্ট।
- Nano Banana 2 আলোচনার পাশাপাশি বিতর্কও: Google Earth-এ একীভূতকরণ → অপব্যবহারের কারণে একদিনে প্রত্যাহার—এই ঘটনাবহুল খবর সবচেয়ে বেশি স্কোর পেয়েছে (স্কোর 6; অন্যগুলো বেশিরভাগই কম)।
- AI ভিডিও নিয়ে “ভোক্তামুখী হলে লাভ হয় না” সুর: OpenAI Sora API বন্ধ করছে, অন্যদিকে Kling/Seedance/Runway এন্টারপ্রাইজে জোর দিয়ে অর্থায়ন ও আয়ে এগোচ্ছে—এমন তুলনা Reddit মিররের একাধিক পোস্টে আছে।
- পাশাপাশি তুলনামূলক কনটেন্ট প্রচুর: Nano Banana Pro / Seedream 5.0 Pro / Wan 2.7 Pro / ChatGPT Images 2.5 একই শর্তে তুলনা করা পোস্ট বারবার আসে—ব্যবহারকারী একক সংবাদে নয়, “কোনটি সবচেয়ে শক্তিশালী”-তে আগ্রহী।
- Lemmy-র নিজস্ব আলোচনা প্রায় নেই: পাওয়া পোস্টগুলোর অধিকাংশ !ai_reddit (Reddit মিরর বট) থেকে, স্কোর 0–1 এবং মন্তব্যও কম। Lemmy-উৎসারিত মৌলিক বিশ্লেষণ মূলত !«メールアドレス»-এর টুল পোস্টগুলো।
সীমাবদ্ধতা
- Lemmy-তে ছবি/ভিডিও জেনারেশন AI-কে কেন্দ্র করে বড় কমিউনিটি নেই; আলোচনা ছোট !«メールアドレス»-এ (টুল/মডেল পোস্ট, এক অঙ্কের স্কোর) এবং Reddit পোস্ট হুবহু স্থানান্তর করা বট কমিউনিটি !ai_reddit-এ (স্কোর 0–1) ছড়িয়ে আছে। দ্বিতীয়টি কার্যত Reddit পুনঃপ্রকাশ, Lemmy-র স্বতন্ত্র মতামত নয়।
- কমিউনিটির সদস্যসংখ্যা পাওয়া যায়নি।
https://lemmy.world/c/<community>বারবার HTTP 500 ফিরিয়েছে, আরhttps://lemmy.world/api/v3/community?name=...HTTP 400 ফিরিয়েছে (প্যারামিটার স্পেসিফিকেশন সাধারণ v3 ডকুমেন্টেশন থেকে ভিন্ন হতে পারে, অথবা ইনস্ট্যান্সে সীমাবদ্ধতা থাকতে পারে)। - “Grok Imagine”, “Kling AI”, “Runway Gen”, “HunyuanVideo”, “Flux” এককভাবে ইত্যাদি কীওয়ার্ডে প্রাসঙ্গিক পোস্ট প্রায় শূন্য (শুধু নয়েজ); Lemmy-তে এসব নাম সরাসরি খুব কম ব্যবহৃত হয়।
- lemmy.world অনুসন্ধান API নিজেকে ইনস্ট্যান্স-পার ফেডারেটেড সার্চ বলে, কিন্তু বাস্তবে প্রধানত lemmy.world / lemmy.ml / lemmy.dbzer0.com / lemmy.today / lemmy.zip-উৎসের পোস্ট ফেরত দেয়; lemmy.ml বা lemm.ee আলাদা করে খোঁজার সময় ছিল না।
- অধিকাংশ পোস্টের স্কোর 0–10 হওয়ায় মোট সম্পৃক্ততা খুব কম; “জোরালো আলোচনা” বলা যায় না। Lemmy মূলত ছোট প্ল্যাটফর্ম এবং ছবি/ভিডিও জেনারেশন AI নিয়ে Reddit/X-এর মতো বিশেষায়িত কমিউনিটি না থাকার ফলও এটি।
Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ
50টি পিন সংগ্রহ করা হয়েছে (কোনো বিভাগ নেই, একক সেট)। শিরোনাম ও থাম্বনেইল ছবি সরাসরি খুলে যাচাই করা হয়েছে।
ভিজ্যুয়াল থিম
- “অবাক মুখের YouTuber + লোগোর সমাহার” থাম্বনেইল — OpenAI, Google, Meta, Microsoft ও Anthropic-এর লোগো নিয়নরঙে সাজানো, পাশে অবাক এক পুরুষের মুখ—এমন আদর্শ “AI NEWS” ভিডিও থাম্বনেইল বহুবার দেখা যায়। ক্লোজড-সোর্স শিবিরের সাম্প্রতিক সংবাদে প্রায় এই ফরম্যাটই প্রভাবশালী
[2, 7, 23, 41] - রোবট = সংবাদ উপস্থাপক ভিজ্যুয়াল বারবার দেখা যায়। সাদা অ্যান্ড্রয়েড স্যুট পরে “BREAKING NEWS” প্যানেলের সামনে বসে আছে, বা AI অ্যাঙ্কর সংবাদস্টুডিও দখল করে নিচ্ছে—এমন ভবিষ্যৎ কল্পচিত্র
[23, 45] - ফটোরিয়াল মানব প্রতিকৃতির ডেমো ছবি — বলিরেখা, দাড়ি ও টেক্সচার পর্যন্ত সূক্ষ্মভাবে তৈরি বয়স্ক পুরুষের মুখ নতুন মডেল ঘোষণার প্রধান প্রদর্শনী চিত্র হিসেবে ব্যবহৃত হয় (AMD-এর Amuse 3.0, Luma Dream Machine-এর চোখের ক্লোজ-আপ ইত্যাদি)। বাস্তবসম্মততাই বর্তমান বেঞ্চমার্ক
[43, 47] - একই উৎস ভিডিওকে বহু স্টাইলে রূপান্তরের গ্রিড তুলনা — কাঠখোদাই, অরিগামি, লেগো, ফুলের সাজ ইত্যাদি ভিন্ন উপাদানে একই মানুষ/গাড়ি পুনরায় তৈরি করে দেখানো “স্টাইল ধারাবাহিকতা” ডেমো
[4] - নিয়ন ভবিষ্যৎ UI মকআপ — উজ্জ্বল আইকন, সার্কিট-বোর্ড প্যাটার্নের মাথার সিলুয়েট, হোলোগ্রামসদৃশ ড্যাশবোর্ডে “ছবি/ভিডিও/সংগীত/টেক্সট জেনারেশন” একসঙ্গে বিক্রি করার বিমূর্ত প্রচারচিত্র প্রচুর
[5, 9, 22, 50] - টুল তুলনা ও দ্রুত-নির্বাচন ইনফোগ্রাফিক — ChatGPT/Midjourney/Gemini/Runway/Pika/Krea ইত্যাদির লোগো গ্রিডে সাজিয়ে “পেইড হলে এটি, ফ্রি হলে এটি” বলে ভাগ করা নিয়ন সাইবারধাঁচের চার্ট
[40] - ভুয়া কনটেন্ট শনাক্তকরণ ও AI নীতিশাস্ত্রের সতর্কতামূলক ছবি — “FAKE” স্ট্যাম্প দেওয়া বিড়ালের ছবি নিয়ে সন্দিহান রোবট, চোখের আগে-পরে তুলনায় “দেখে বিশ্বাস করবেন না”-ধরনের ইনফোগ্রাফিক ইত্যাদি; AI-তৈরি কনটেন্ট নিয়ে অবিশ্বাস ও যাচাই থিমের একটি অংশ আছে
[1, 20, 32, 37] - শিরোনাম ও ছবি না মেলার পিনও দেখা গেছে — যেমন “Stability AI ভিডিও জেনারেশনে প্রবেশ করেছে” শিরোনাম, কিন্তু ছবিতে ফ্যান্টাসি মুডবোর্ডের কোলাজ। ক্লিকের জন্য পুনর্ব্যবহৃত থাম্বনেইল প্রচুর মনে হয়
[29]
উল্লেখযোগ্য পিন
- [2] AI News: Anthropic Leak Shows Us The Future of AI... — OpenAI, Google, Microsoft ও Anthropic-এর লোগোসহ পরিচিত “AI NEWS” থাম্বনেইল। ক্লোজড-সোর্স শিবিরের গতিবিধি সংকলন ভিডিও।
- [4] Google announces ultra-high quality video... — একই মানুষ ও গাড়িকে কাঠ/অরিগামি/লেগো/ফুলের স্টাইলে পুনরায় তৈরি করা গ্রিড তুলনা। স্টাইল ধারাবাহিকতা দেখানোর পরিষ্কার উদাহরণ।
- [5] Meta Unveils Muse Image and Muse Video Generative... — “Meta Muse Spark AI Model 2026”, ব্যক্তিগত AI সহকারী দিককে জোর দেওয়া SF-ধাঁচের ব্যানার।
- [23] Discover how Grok is revolutionizing video... — “BREAKING NEWS” প্যানেলের সামনে বসা সাদা অ্যান্ড্রয়েড সংবাদ উপস্থাপকের ছবি। AI সংবাদ তৈরি করা ভবিষ্যতের কল্পচিত্র।
- [26] Google's Gemini Omni Turns Anything Into Video — “Omni” লোগোকে কেন্দ্র করে ছবি, ভিডিও, অডিও ও টেক্সটের আইকন; মাল্টিমোডাল একীভূতকরণের বার্তা।
- [38] Google Unveils Veo 2: Advanced AI Video Generation... — Veo2-এর অফিসিয়ালসদৃশ ব্যানার, “state-of-the-art video generation model” বার্তা ও বাস্তব/অ্যানিমেশন নমুনা ছবির সারি।
- [43] Introducing Luma Dream Machine - Next Generation AI Video — চোখের ক্লোজ-আপের ওপর “Dream Machine” টাইপোগ্রাফি। ফটোরিয়াল জেনারেশনের শক্তি দেখানোর প্রতীকী ছবি।
- [47] 'Amuse 3.0', an AI art creation tool that includes... — AMD-এর লোকাল-চালিত AI আর্ট টুল। বয়স্ক জেলের ফটোরিয়াল মুখ ডেমো হিসেবে ব্যবহৃত; GPU-তে পরিপূর্ণ জেনারেশন সক্ষমতা তুলে ধরে। ওপেন-সোর্স/লোকালঘেঁষা অল্প কয়েকটি নির্দিষ্ট টুলের একটি।
- [40] Top AI Video Generators of 2025 — ChatGPT Plus, Midjourney, Runway, Pika, Kaiber ইত্যাদিকে “ছবির মান অগ্রাধিকার” ও “বিনামূল্য অগ্রাধিকার”-এ ভাগ করা নিয়ন তুলনাচার্ট। টুল নির্বাচনের ব্যবহারিক তথ্য।
- [20] 'AI is getting scary good.' — AI ভিডিও জেনারেশন, ভয়েস শনাক্তকরণ, এবং প্রম্পট ইঞ্জিনিয়ারিং সংবলিত সতর্কতামূলক ইনফোগ্রাফিক। “দেখেই বিশ্বাস করবেন না”—এমন AI-সচেতনতার বার্তা।
সংকেত
- Pinterest-এ “ছবি ও ভিডিও জেনারেশন AI সংবাদ” বলতে ক্লোজড-সোর্স শিবিরের (OpenAI, Google Veo/Gemini Omni, Meta Muse, Grok, Midjourney, Runway, Pika) সংবাদধর্মী থাম্বনেইলই বিপুল সংখ্যাগরিষ্ঠ। YouTube ভিডিওর থাম্বনেইলকে পিন করার মতো “অবাক মুখ + লোগোর সমাহার” ফরম্যাট প্রভাবশালী; তথ্যের গভীরতার চেয়ে ক্লিক আকর্ষণ বেশি।
- ওপেন-সোর্স/লোকাল জেনারেশনের আলোচনা দুর্বল। Stability AI-এর নাম এসেছে (তবে কেবল শিরোনামে, ছবিতে সম্পর্কহীন মুডবোর্ড) এবং AMD Amuse 3.0 (লোকাল GPU টুল)—এ দুটিই নির্দিষ্ট উদাহরণ। ComfyUI, Hugging Face, ডিফিউশন মডেলের স্থাপত্যচিত্রের মতো কমিউনিটি-উৎসারিত প্রযুক্তিগত ভিজ্যুয়াল একটিও পাওয়া যায়নি।
- ফটোরিয়াল মানব সৃষ্টি—বলিরেখা ও টেক্সচার পর্যন্ত যত্ন নেওয়া মুখ—প্রতিষ্ঠানগুলোর অভিন্ন “এখন এটি করা যায়” বেঞ্চমার্ক ভিজ্যুয়াল হিসেবে বারবার ব্যবহৃত; প্রযুক্তির পরিণত হওয়ার সংকেত।
- AI-তৈরি কনটেন্ট নিয়ে অবিশ্বাস ও যাচাই (ভুয়া নির্ধারণ, কণ্ঠস্বরের সত্যতা, নীতি) বিষয়ক ইনফোগ্রাফিকও আছে; জেনারেশনের আলোচনার সঙ্গে “কীভাবে চেনা যায়” ও “ব্যবহারের শিষ্টাচার” নিয়ে আগ্রহও দৃশ্যমান।
- বিপরীতে যা অনুপস্থিত: নির্দিষ্ট ওপেন-সোর্স মডেলের নাম (Stable Diffusion, FLUX, Wan, HunyuanVideo ইত্যাদি) প্রধান বিষয় করে বানানো পিন, GitHub/প্রযুক্তি ব্লগের স্ক্রিনশট, গবেষণাপত্র বা বেঞ্চমার্ক সংখ্যা দেখানো পিন। Pinterest-এর প্রকৃতির কারণে প্রযুক্তি কমিউনিটির প্রাথমিক তথ্যের বদলে দ্বিতীয়স্তরের সংবাদ-সংকলন, তুলনাচার্ট ও বিজ্ঞাপনধর্মী ব্যানার বেশি।
সীমাবদ্ধতা
output/pinterest.pins.md-এ কোনো বিভাগ নেই (genreফাঁকা), একক 50টির সেট দেওয়া হয়েছে; তাই প্লেবুকে প্রত্যাশিত “বিভাগভিত্তিক সারাংশ” করা যায়নি—পুরো সেটকে একসঙ্গে বিশ্লেষণ করা হয়েছে।- 50টির মধ্যে 18টি ছবি সরাসরি খোলা হয়েছে (শিরোনামের নির্দিষ্টতা ও বিষয়বস্তুর বৈচিত্র্য বিবেচনায় নমুনা নেওয়া)। বাকি 32টি যাচাই করা হয়নি, তবে দেখা নমুনায় ফরম্যাটের পুনরাবৃত্তি এত বেশি যে প্যাটার্ন স্পষ্ট।
- একাধিক পিনে শিরোনাম ও বাস্তব ছবি মিলেনি (যেমন
[29]-এ Stability AI-সংক্রান্ত শিরোনামের সঙ্গে সম্পর্কহীন মুডবোর্ড ছবি); এ ধরনের পিনে ছবির বদলে শিরোনামের প্রেক্ষাপট উল্লেখ করা হয়েছে। - Pinterest সরাসরি ব্রাউজ করা হয়নি (কর্মীর আগাম সংগৃহীত ছবি ও শিরোনামই ব্যবহার করা হয়েছে), তাই প্রতিটি পিনের প্রকৃত এনগেজমেন্ট সংখ্যা (সেভ/লাইক) বা লিংকে থাকা নিবন্ধের মূল লেখা যাচাই করা যায়নি।
সুপারিশকৃত পদক্ষেপ
- সাধারণ ট্রেন্ডের বদলে সরাসরি AI কীওয়ার্ড (Midjourney, Sora, Nano Banana, ComfyUI, Flux) দিয়ে X ধাপ পুনরায় চালান।
- ওপেন-সোর্স গতির প্রধান সূচক হিসেবে Qwen-Image-2.1 ইকোসিস্টেম (WebUI, LoRA, ControlNet) পর্যবেক্ষণ চালিয়ে যান।
- ক্লোজড-সোর্স ভিডিও জেনারেশনের লাভজনকতার বিকল্প সূচক হিসেবে Sora 2-এর ব্যয়-আয় ব্যবধান ট্র্যাক করুন।
- ক্লোজড-সোর্স টুল গার্ডরেল কঠোর করলে ব্যবহারকারীরা কোন টুলে সরে যান, তার মানচিত্র তৈরি করুন।
- Pinterest নমুনা 18 থেকে 50টি পিনে সম্প্রসারিত করুন, অথবা এনগেজমেন্ট সংখ্যা পাওয়ার উপায় খুঁজুন।
- পর্যবেক্ষণের ওজন নির্ধারণে Lemmy-র !ai_reddit কমিউনিটিকে স্বতন্ত্র সংকেত নয়, Reddit মিরর হিসেবে বিবেচনা করুন।
সংগৃহীত ছবি


















































ডেটার মানসংক্রান্ত নোট
X ধাপে AI-সম্পর্কিত অনুসন্ধানের বদলে সাধারণ ট্রেন্ডিং বিষয় থেকে পোস্ট সংগ্রহ করা হয়েছে, তাই তা কোনো অবদান রাখেনি। JavaScript রেন্ডারিং ও নমুনাগত সীমার কারণে YouTube ও Pinterest-এ এনগেজমেন্ট সূচক (ভিউ/সাবস্ক্রাইবার বা সেভ/লাইক) নিশ্চিত করা যায়নি; অন্যদিকে Reddit ও Bluesky বাস্তব সংগৃহীত/API ডেটার ওপর ভিত্তি করে তৈরি হওয়ায় এগুলো এখানে সবচেয়ে নির্ভরযোগ্য উৎস।



