ইমেজ ও ভিডিও জেনারেশন AI সংবাদ — ২০২৬-১০-০১
ওপেন-সোর্স (Qwen-Image-2.1, LTX 2.5) ComfyUI-কে কেন্দ্র করে গতি পাচ্ছে, অন্যদিকে ক্লোজড-সোর্সের বড় নামগুলো (Google Nano Banana, OpenAI Sora, xAI Grok Imagine) অপব্যবহার, মামলা ও পরিষেবা বন্ধের খবরে আলোচনায় রয়েছে।
ইমেজ ও ভিডিও জেনারেশন AI-এর সর্বশেষ সংবাদ — ২০২৬-১০-০১
সোজা কথায়, এখন ওপেন-সোর্স দুনিয়াটাই সত্যি দারুণ গরম🔥 Alibaba-এর Qwen-Image-2.1 (মাত্র 7B হলেও নেটিভ ট্রান্সপারেন্সি ও 2K আউটপুট) এবং ওপেন-সোর্স ভিডিও মডেল LTX 2.5 ComfyUI কমিউনিটিকে ঘিরে দ্রুত ছড়িয়ে পড়ছে। লোকালেই বিনামূল্যে ও সেন্সরশিপ ছাড়া ব্যবহারযোগ্য পরিবেশ দিন দিন শক্তিশালী হচ্ছে😤 অন্যদিকে ক্লোজড-সোর্স দিকটি (Google Nano Banana পরিবার, OpenAI Sora, Midjourney, xAI Grok Imagine) ফিচারে ঝকঝকে হলেও, ডিপফেক, শিশু পর্নোগ্রাফি-সংক্রান্ত অপব্যবহার, মামলা আর পরিষেবা বন্ধের মতো “বিপত্তির খবর” বেশি নজর কেড়েছে🙄 আর সত্যি বলতে, এ বার X ও Bluesky থেকে থিমের সঙ্গে সরাসরি মেলে এমন ডেটা প্রায় পাওয়া যায়নি—সেটির জন্য আন্তরিকভাবে দুঃখিত🙏
সব প্ল্যাটফর্মজুড়ে
একাধিক প্ল্যাটফর্মে একইভাবে দেখা গেছে এই তিনটি বিষয়!
- ওপেন-সোর্সের অভিন্ন ভাষা হয়ে উঠেছে ComfyUI: Reddit-এ (r/StableDiffusion-এ Vlo 0.3, 1,055pt), YouTube-এ (Qwen-Image-2.1 ও LTX 2.5 নিয়ে ধারাবাহিক ব্যাখ্যামূলক ভিডিও), এবং Lemmy-তে (!«メールアドレス»-এ Qwen-Image-2.1-ভিত্তিক ওয়ার্কফ্লো প্রতিদিন পোস্ট হচ্ছে)—সবখানেই ComfyUI কার্যত মানক প্ল্যাটফর্ম হয়ে উঠেছে💪
- ক্লোজড-সোর্স প্রায়ই অপব্যবহার ও বিতর্কের পথেই খবর হয়: Reddit-এ (SM Entertainment K-pop শিল্পীদের ডিপফেক ছবির বিরুদ্ধে আইনি পদক্ষেপ, 730pt), Lemmy-তে (Google Earth-এর Nano Banana ফিচার দুর্যোগ জালিয়াতির ছবির কারণে এক দিনের মধ্যেই বন্ধ, score473), Bluesky-তে (404 Media সাংবাদিক Emanuel Maiberg-এর অসন্মতিপূর্ণ জেনারেটেড ছবি নিয়ে ধারাবাহিক প্রতিবেদন), Pinterest-এ (“AI সাংবাদিকদের প্রতিস্থাপন করছে” ধরনের উদ্বেগ-উসকানিমূলক ছবি ৫০টির মধ্যে অন্তত ৭টি)—চারটি ভিন্ন প্ল্যাটফর্মে একই চিত্র দেখা সত্যিই আকর্ষণীয়🫣
- সেন্সরশিপ কঠোর হওয়া থেকে লোকালে সরে যাওয়ার ধারা: Reddit-এ (WAN 3.0-এর NSFW ফিল্টার শক্ত হওয়ার পর Seedream/MiniMax H3-তে বিকল্প খোঁজা, ChatGPT-এর অতিরিক্ত সেন্সরশিপের অভিযোগ থেকে Midjourney/VeniceAI-তে যাওয়ার পরামর্শ) এবং Lemmy-তে (AI Horde-এর মতো বিকেন্দ্রীভূত, ফ্রি অবকাঠামোর সমর্থন)—“নিয়ন্ত্রণ কঠোর হলে ওপেন-সোর্সে চলে যাও” মনোভাবটি স্পষ্ট🏃
প্ল্যাটফর্মভিত্তিক
Reddit: ১২টি থ্রেড সংগ্রহ করা হয়েছে (২০টির সমাপ্তি-মানদণ্ডে পৌঁছায়নি)। K-pop ডিপফেক মামলা (730pt) এবং Vocaloid MV বিতর্ক (327pt) অত্যন্ত প্রভাবশালী ছিল; প্রযুক্তি-ট্রেন্ড পরিচিতি থ্রেডের চেয়ে নৈতিকতা ও ক্ষতি-সংক্রান্ত বিষয় বেশি ভাইরাল হয়েছে। ক্লোজড ও ওপেন—দুই ধরনের বিষয়ই রয়েছে।
X: সত্যিই গড়বড় হয়ে যাওয়া ফলাফল😭 সার্চ শব্দগুলো থিম-সম্পর্কিত কীওয়ার্ড নয়; ক্রোয়েশিয়ার ট্রেন্ড শব্দ (Spain, Tesla, JubJub ইত্যাদি) সরাসরি ব্যবহার করা হয়েছিল। ফলে সংগৃহীত ৪০টি পোস্টের মধ্যে থিম-সম্পর্কিত পোস্ট কার্যত শূন্য। ইমেজ/ভিডিও জেনারেশন AI নিয়ে “কিছুই বলার নেই”—এটাই X পর্যায়ের সিদ্ধান্ত।
YouTube: ১০টি ভিডিও পরীক্ষা করা হয়েছে। Qwen-Image-2.1 ও LTX 2.5-সহ ওপেন-সোর্স মডেলগুলো মূলত ইংরেজি চ্যানেলে দ্রুত ছড়িয়েছে; জাপানি চ্যানেলগুলোতে Nano Banana, Flow ও Sora2-এর মতো ক্লোজড-সোর্স পণ্যের ব্যবহারিক তুলনা বেশি শক্তিশালী। ভাষাভেদে ওপেন/ক্লোজড আগ্রহও ভিন্ন ছিল।
Bluesky: অফিসিয়াল পূর্ণ-পাঠ সার্চ API (searchPosts) সব সময় HTTP403 দেওয়ায় ব্যবহার করা যায়নি; তাই নির্দিষ্ট অ্যাকাউন্ট ট্র্যাক করার বিকল্প পদ্ধতি নেওয়া হয়। ক্লোজড-সোর্সে dfl.bsky.social প্রতিদিন Nano Banana 2 দিয়ে ল্যান্ডস্কেপ ছবি পোস্ট করে, আর ওপেন-সোর্স নির্মাতারা (doctordiffusion প্রমুখ) ২০২৫ সালের প্রথমার্ধ থেকেই নিষ্ক্রিয়; তাই সাম্প্রতিক পোস্ট কম ছিল।
Lemmy: ১১টি পোস্ট বাছাই করে দেওয়া হয়েছে (৬০টির বেশি রিভিউ করা হয়েছে)। !«メールアドレス» ওপেন-সোর্সের প্রযুক্তিগত তথ্যের ক্ষেত্রে অত্যন্ত সমৃদ্ধ, আর ক্লোজড-সোর্সে Google Earth বিতর্ক বা xAI Grok Imagine-এর CSAM মামলা ইত্যাদি “বিতর্কের মাধ্যমে আসা” খবরই প্রধান। নমুনার আকারের দিক থেকে সমাপ্তি-মানদণ্ড পূরণ হয়েছে।
Pinterest: সব ৫০টি পিন পরীক্ষা করা হয়েছে। তবে অধিকাংশই SEO-উদ্দেশ্যপ্রণোদিত স্টক ছবি বা তালিকাভিত্তিক থাম্বনেইল; বাস্তব প্রোডাক্ট ডেমো বলতে Lumalabs-এর ট্রান্সফর্ম গ্রিডের মতো কয়েকটি। ওপেন-সোর্স (ComfyUI, Stable Diffusion UI ইত্যাদি) সম্পর্কিত ছবি একটিও নেই। ক্লোজড-সোর্স ব্র্যান্ডের ভিজ্যুয়াল (Veo2, Gemini Omni) চোখে পড়লেও একই ছবি বহু পিনে পুনর্ব্যবহৃত হয়েছে।
নজরে রাখুন
- Qwen-Image-2.1 (Alibaba, 7B ওপেন-ওয়েট): YouTube “A 7B Model That Beats Nano Banana 2.0?” https://www.youtube.com/watch?v=fwHS0ubmI7I এবং Lemmy https://lemmy.dbzer0.com/post/75874773 — নিজস্ব বেঞ্চমার্কে ক্লোজড বড় মডেলকে ছাড়িয়ে যাওয়ার দাবি; ওপেন-সোর্সের গতির প্রতীক🚀
- LTX 2.5 (সম্পূর্ণ ওপেন-সোর্স ভিডিও মডেল): YouTube https://www.youtube.com/watch?v=6B9WSxi6j8E — ComfyUI-তে মাল্টি-শট ও 2K আউটপুট পর্যন্ত বাস্তবে ব্যবহার দেখানো হয়েছে
- Google Earth-এর “Nano Banana” বিতর্ক: Lemmy https://lemmy.world/post/50167698(score473) — ক্লোজড-সোর্স বড় প্রতিষ্ঠানের ফিচার প্রকাশ → অপব্যবহার → তাৎক্ষণিক বন্ধের আদর্শ উদাহরণ
- Sora 2-এর মন্দা: YouTube (TBS NEWS DIG) https://www.youtube.com/watch?v=_r9hojDlABM — আলোচনায় আসার পরই ধাপে ধাপে বন্ধের দিকে যায় (API বন্ধের তারিখ ২০২৬-০৯-২৪ নির্ধারিত ছিল)
- SM Entertainment-এর K-pop ডিপফেক মামলা: Reddit https://www.reddit.com/r/kpop/comments/1wsdr6d/ — ক্লোজড বা ওপেন নির্বিশেষে AI অপব্যবহারের প্রতিকৃতি-অধিকার সমস্যা সবচেয়ে বড় প্রতিক্রিয়া এনেছে
- Vlo 0.3 (ওপেন-সোর্স AI ভিডিও এডিটর): Reddit https://www.reddit.com/r/StableDiffusion/comments/1wsmat4/ — Minimax H3/Qwen2.1/Krea2/LTX2.5 একত্র করা লোকাল-ভিত্তিক টুল
সুপারিশ
- পরের বার X পর্যায়ে থিম-সরাসরি কীওয়ার্ড (Midjourney, Sora, Stable Diffusion, Wan, Kling ইত্যাদি) দিয়ে পুনরায় সংগ্রহ করতে হবে। এ বারের ডেটা ব্যবহারযোগ্য নয়।
- Bluesky-এর
searchPosts403 দেওয়ার সমস্যা চললে, প্রমাণীকৃত API-এর মতো অন্য অ্যাক্সেস পদ্ধতি বিবেচনা করা উচিত। - Qwen-Image-2.1 ও LTX 2.5-এর গ্রহণের প্রবণতা পরবর্তী চক্রে ওপেন-সোর্স সূচক হিসেবে অব্যাহতভাবে পর্যবেক্ষণ করতে হবে।
- ক্লোজড-সোর্স প্রতিষ্ঠানের অপব্যবহার ও বিতর্কের খবর (Nano Banana/Google Earth, Grok Imagine মামলা) বেশি এনগেজমেন্ট আনে; তাই অগ্রাধিকার দিয়ে অনুসরণ করা উচিত।
- Reddit-এ সার্চ কুয়েরি একাধিক ভাগে চালিয়ে, প্রায় ২০টি পোস্টের সমাপ্তি-মানদণ্ডে পৌঁছাতে সংগ্রহের পরিসর বাড়াতে হবে।
- Sora API বন্ধের পর ক্লোজড-সোর্স ভিডিও বাজারের শক্তির ভারসাম্য কীভাবে বদলায়, পরের বার তা পরীক্ষা করতে হবে।
ডেটার মান
X-এ সার্চ শব্দ বাছাইয়ের ভুলে থিম-বহির্ভূত ডেটাই পাওয়া গেছে; কার্যত “ডেটা নেই”। Bluesky-তে পূর্ণ-পাঠ সার্চ API 403-এ বন্ধ থাকায় বিকল্প অ্যাকাউন্ট-ট্র্যাকিং পদ্ধতি নেওয়া হয়েছে এবং প্রায় ২০টি পোস্টের সমাপ্তি-মানদণ্ডে পৌঁছানো যায়নি। Reddit-ও একটি সার্চ শব্দে ১২টিতেই সীমিত ছিল। অন্যদিকে Lemmy (৬০টির বেশি রিভিউ), Pinterest (সব ৫০টি ছবি রিভিউ), এবং YouTube (১০টি ভিডিও বিশদ পরীক্ষা) মোটামুটি যথেষ্ট নমুনা দিয়েছে।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ইমেজ ও ভিডিও জেনারেশন AI সংবাদ
কোথায়
সংগৃহীত ১২টি থ্রেড ৯টি সাবরেডিট থেকে এসেছে। সদস্যসংখ্যা ও পোস্টসংখ্যা নিচে দেওয়া হলো (সবগুলো “Image and Video Generation AI News” সার্চ শব্দে পাওয়া গেছে)।
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত সংখ্যা |
|---|---|---|
| r/kpop | 3,893,359 | 1 |
| r/youtube | 3,462,568 | 1 |
| r/StableDiffusion | 1,027,325 | 1 |
| r/AI_Agents | 452,181 | 1 |
| r/Vocaloid | 218,928 | 1 |
| r/aiwars | 170,021 | 1 |
| r/generativeAI | 159,505 | 4 |
| r/B2BForHire | 139,944 | 1 |
| r/GenAI4all | 49,028 | 1 |
r/generativeAI-তে সর্বাধিক ৪টি পোস্ট; “বিনামূল্যে ব্যবহারযোগ্য AI টুল কোনগুলো?” ধরনের প্রশ্নের থ্রেড সেখানে কেন্দ্রীভূত। অন্য প্রতিটি সাবরেডিটে একটি করে পোস্ট, যেখানে চলচ্চিত্র, সঙ্গীত ও K-pop-এ “GenAI ব্যবহৃত হয়েছে/ব্যবহারের কারণে সমস্যা হয়েছে”—এমন বিষয় চোখে পড়ে।
মানুষ কী বলছে
- থ্রেড#1 “Dreamworks ২০২৩ সাল থেকে GenAI ব্যবহার করছে” (r/aiwars・17pt・48 মন্তব্য・2026-09-30、https://www.reddit.com/r/aiwars/comments/1wty4m6/): Trolls Band Together ও Kung Fu Panda 4-সহ Dreamworks-এর কাজ GenAI দিয়ে তৈরি হয়েছে—এমন দাবি। শীর্ষ মন্তব্যটি সন্দেহপ্রবণ: “Nothing you posted says that these movies are 'produced with gen AI'. ... You have no idea how they used AI in these productions.”(u/Majestic-Coat3855, 25pt)
- থ্রেড#2 “DreamFort-এর ফিল্টার কঠোর হওয়ায় প্রাপ্তবয়স্ক image-to-video-এর বিকল্প খোঁজা” (r/generativeAI・10pt・8 মন্তব্য・2026-09-30、https://www.reddit.com/r/generativeAI/comments/1wtzefv/): WAN 3.0-এর NSFW জেনারেশন হঠাৎ কঠোর হওয়ায় ব্যবহারকারীরা Seedream 2.0 Unfiltered ও MiniMax H3-র মতো বিকল্প ক্লোজড মডেল খুঁজছেন।
- থ্রেড#3 “AI-জেনারেটেড কনটেন্ট YouTube-কে নষ্ট করছে” (r/youtube・107pt・21 মন্তব্য・2026-09-25、https://www.reddit.com/r/youtube/comments/1wqbl4f/): বর্ণনাসহ AI কাটা-জোড়া ভিডিওর দ্রুত বৃদ্ধি নিয়ে উদ্বেগ। “We have entered the realm of slop.”(u/three-sense, 2pt)、“YouTube CEO says he's pro ai slop.”(u/HotUKTakes, 2pt)
- থ্রেড#4 “'সম্পূর্ণ ফ্রি' AI ভিডিও জেনারেশন টুল বলে কিছু নেই” (r/generativeAI・55pt・36 মন্তব্য・2026-09-30、https://www.reddit.com/r/generativeAI/comments/1wty6zj/): ক্লাউড GPU-এর খরচ দাতব্য কাজ নয়—এই বাস্তবতা। “videos are not like cheap LLMs, no one can give it away for free”(u/opengradient, 5pt)
- থ্রেড#5 “ফ্রিতে সবচেয়ে ভালো AI ইমেজ জেনারেশন টুল কোনটি?” (r/generativeAI・4pt・54 মন্তব্য・2026-09-26、https://www.reddit.com/r/generativeAI/comments/1wqfleb/): Yodayo/MoescapeAI (প্রতি ২৪ ঘণ্টায় ৫০ ক্রেডিট), Leonardo (প্রতিদিন ফ্রি টোকেন) ইত্যাদি সুপারিশ করা হয়েছে।
- থ্রেড#6 “AI ভিডিও নির্মাতা/AI কনটেন্ট ম্যানেজার নিয়োগ” (r/B2BForHire・2pt・5 মন্তব্য・2026-09-25、https://www.reddit.com/r/B2BForHire/comments/1wpx42u/): হাইব্রিড AI ও সম্পূর্ণ AI-তৈরি ভিডিওর ব্যবহারিক অভিজ্ঞতা চাওয়া চাকরির পোস্ট। AI ভিডিও উৎপাদন ইতিমধ্যে পেশা হিসেবে বাজারে ঢোকার ইঙ্গিত।
- থ্রেড#7 “AnythingBecomeMoe নতুন MV ‘DisplayHolic’-এ GenAI ব্যবহার করেছে” (r/Vocaloid・327pt・105 মন্তব্য・2026-09-28、https://www.reddit.com/r/Vocaloid/comments/1wsa4nz/): মতভেদ তীব্র। “I don't understand when incredibly talented people embrace ai”(u/AungCowMyat, 297pt)বনাম “at least they're disclosing it... far better usage than some others who just straight up reject the fact that they used AI”(u/memorie_desu, 200pt)
- থ্রেড#8 “SM Entertainment, Lim Yoona ও aespa-এর Winter-কে লক্ষ্য করে তৈরি AI ছবির বিরুদ্ধে আইনি পদক্ষেপ” (r/kpop・730pt・52 মন্তব্য・2026-09-28、https://www.reddit.com/r/kpop/comments/1wsdr6d/): ডিপফেক নিয়ে প্রবল উদ্বেগ। “the deepfakes are so concerning. glad sm is taking action :(”(u/llamacana, 167pt)
- থ্রেড#9 “Vlo 0.3 — কম্পোজিটিং-কেন্দ্রিক ওপেন-সোর্স AI ভিডিও এডিটর/জেনারেটর” (r/StableDiffusion・1,055pt・71 মন্তব্য・2026-09-28、https://www.reddit.com/r/StableDiffusion/comments/1wsmat4/): Minimax H3, Qwen2.1, Krea2 ও LTX2.5-সমর্থিত ওয়ার্কফ্লোর জন্য প্রশংসিত। “Great ad, same as before :) I forgot about this app, I will Def try it.”(u/Maskwi2, 22pt)
- থ্রেড#10 “২০২৪-এ ভাইরাল AI ভিডিওগুলো এখন দেখলে গুণগত অগ্রগতি অবিশ্বাস্য” (r/GenAI4all・199pt・66 মন্তব্য・2026-09-24、https://www.reddit.com/r/GenAI4all/comments/1wou5vb/): অল্প কয়েক বছরে ছবির মানের উন্নতি নিয়ে ফিরে দেখা থ্রেড; শিরোনামের “the leap in quality since then is insane” বক্তব্যের সঙ্গেই অধিকাংশ প্রতিক্রিয়া মেলে।
- থ্রেড#11 “গার্ডরেলহীন AI ইমেজ জেনারেশন টুল চাই” (r/AI_Agents・0pt・22 মন্তব্য・2026-09-29、https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/): ChatGPT-এর অতিরিক্ত সেন্সরশিপ নিয়ে অসন্তোষ থেকে Midjourney, VeniceAI এবং চীনা ওপেন-সোর্স মডেলে সরে যাওয়ার বহু পরামর্শ।
- থ্রেড#12 “স্ক্রিপ্ট থেকে অ্যানিমেটেড ভিডিও বানাতে পারে এমন ফ্রি AI টুল আছে?” (r/generativeAI・4pt・23 মন্তব্য・2026-09-27、https://www.reddit.com/r/generativeAI/comments/1wrip4m/): “Minimax H3 with comfyUI”(লোকাল সেটআপ ধরে নেওয়া, u/Amonsul_, 4pt)সবচেয়ে শক্তিশালী উত্তর। ভালো মান চাইলে শেষ পর্যন্ত খরচ করতেই হবে—এমন সিদ্ধান্তও আছে।
সংকেত
- ঊর্ধ্বমুখী ধারা: ক্লোজড-সোর্সের ফিল্টার শক্ত হওয়া (থ্রেড#2)-র বিরুদ্ধে প্রতিক্রিয়া থেকে ওপেন-সোর্স/লোকাল মডেলে (ComfyUI, Minimax H3, SDXL পরিবার) যাওয়ার প্রবণতা একাধিক থ্রেডে (#2, #11, #12) একইভাবে দেখা যায়। “সেন্সরশিপ এড়াতে হলে লোকালই ভরসা”—এই সিদ্ধান্তটি প্রায় টেমপ্লেট হয়ে গেছে।
- পেশাদার ব্যবহারের ইঙ্গিত: নিয়োগ থ্রেড (#6) ও Dreamworks থ্রেড (#1) দেখায়, GenAI আর শখের গণ্ডিতে নেই; চলচ্চিত্র ও কনটেন্ট উৎপাদনের ব্যবহারিক অবকাঠামোতে ঢুকে পড়ছে।
- প্রত্যাখ্যাত দাবি: “সম্পূর্ণ ফ্রি, সীমাহীন, ওয়াটারমার্কবিহীন ভিডিও জেনারেশন টুল”-এর প্রত্যাশা (থ্রেড#4, #5) কমিউনিটিই অবাস্তব বলে উড়িয়ে দিয়েছে। ক্লাউড GPU খরচের বাস্তবতা ব্যাখ্যা করা প্রতিক্রিয়াগুলো শীর্ষ মন্তব্যে ছিল।
- বিরোধী কাঠামো: থ্রেড#1 ও #7-এ GenAI ব্যবহারের “প্রকাশ” নৈতিক কি না তা নিয়ে বিভাজন রয়েছে। Vocaloid থ্রেডে “ব্যবহারের কথা জানানো অন্তত সৎ” সমর্থন এবং “প্রতিভাবান মানুষ AI-নির্ভর হওয়া দুঃখজনক” সমালোচনা—দুটিই শীর্ষ মন্তব্যে; সহজ পক্ষে/বিপক্ষে দ্বৈততা যথেষ্ট নয়।
- অপ্রত্যাশিত দিক: সর্বোচ্চ স্কোর ছিল K-pop শিল্পীদের ক্ষতিকর AI ছবির বিরুদ্ধে আইনি পদক্ষেপ (#8, 730pt) ও Vocaloid MV বিতর্কে (#7, 327pt), টুল-পরিচিতি থ্রেডের (#5, #12 ইত্যাদি) চেয়ে অনেক বেশি। প্রযুক্তির ট্রেন্ডের চেয়ে AI-জনিত ব্যক্তিগত ক্ষতি ও নৈতিকতা বেশি দৃশ্যমান প্রতিক্রিয়া আনে।
সীমাবদ্ধতা
- ব্রিফে প্রতিটি প্ল্যাটফর্মে প্রায় ২০টি পোস্ট বিশ্লেষণের সমাপ্তি-মানদণ্ড ছিল, কিন্তু সংগ্রহ হয়েছে মাত্র ১২টি থ্রেড। শুধু “Image and Video Generation AI News” কুয়েরি ব্যবহার করা হয়েছিল; “closed source” ও “open source” আলাদা করে অতিরিক্ত সার্চ করা হয়নি (ওয়ার্কারের ফল সরাসরি পড়া হওয়ায় এই এজেন্ট থেকে বাড়তি সার্চ চালানো হয়নি)।
- সার্চ ব্যর্থ বা ফাঁকা ফিরেছিল—এমন কোনো নথি threads.md-তে নেই। অর্থাৎ ১২টিই ওই এক কুয়েরি থেকে এসেছে; সংখ্যার ঘাটতি সম্ভবত কুয়েরির সংকীর্ণতার কারণে।
- থ্রেড#7 (Vocaloid), #8 (kpop), #9 (StableDiffusion) ও #10 (GenAI4all)-এর মূল লেখা রেকর্ড করা হয়নি; শিরোনাম ও শীর্ষ মন্তব্যের ভিত্তিতে বিচার করা হয়েছে।
X
X — ইমেজ ও ভিডিও জেনারেশন AI সংবাদ
##সংগৃহীত ডেটা সম্পর্কে গুরুত্বপূর্ণ নোট
output/x.posts.md পরীক্ষা করে দেখা গেছে, এই বারের X সংগ্রহে ব্যবহৃত সার্চ শব্দ ছিল
“Spain”“Tesla”“JubJub”“Holy”“Italy”“#bb28”“Elon”“Croat”“Donald”
“Roman”—এই ১০টি। এগুলো গবেষণার থিম (ক্লোজড/ওপেন-সোর্স ইমেজ ও ভিডিও জেনারেশন AI)
থেকে আসেনি; বরং output/x.posts.md-এর শুরুর
“What X says is happening” টেবিলে থাকা X Explore ট্রেন্ড শব্দগুলো (ক্রোয়েশিয়ায়
জিওলোকেট করা সেশনে দেখা ট্রেন্ড) সরাসরি সার্চে ব্যবহৃত হয়েছে। ফলে সংগৃহীত ৪০টি পোস্ট (৩৭টি অ্যাকাউন্ট)
মূলত ফুটবল (Spain বনাম Croatia), Tesla গাড়ির চালক-সহায়ক ফিচার, WWE, Big Brother (#bb28),
Donald Trump-এর রাজনৈতিক মন্তব্য ইত্যাদি থিম-বহির্ভূত বিষয়ে ছিল।
নিচের প্রতিবেদনটি সংগৃহীত ডেটার ভিত্তিতে সৎভাবে তৈরি, কিন্তু ইমেজ জেনারেশন AI ও ভিডিও জেনারেশন AI-এর
প্রবণতাকে উপস্থাপন করে না—এ কথা আগে থেকেই স্পষ্ট করা জরুরি।
অ্যাকাউন্ট
সংগৃহীত ৩৭টি অ্যাকাউন্টের অধিকাংশের একটিমাত্র পোস্ট ছিল; থিম-সম্পর্কিত কোনো প্রকাশক পাওয়া যায়নি। একাধিক পোস্ট থাকা অ্যাকাউন্ট কেবল নিচেরগুলো (সবই থিম-বহির্ভূত):
- @ryu15(Ryu)— ২টি পোস্ট; “Tesla V100” দিয়ে VRChat চালানোর ব্যক্তিগত প্রযুক্তি নোট (Tesla অটোপাইলট নয়, GPU মডেল হিসেবে “Tesla” শব্দে কাকতালীয় মিল)
- @grouchoskie(Grouch Oskie)— ২টি পোস্ট; দৈনন্দিন টুইট
- @reigns_era(Roman Reigns SZN)— ২টি পোস্ট; WWE-এর Roman Reigns-সংক্রান্ত ভক্ত পোস্ট
এই ডেটাসেটে ইমেজ/ভিডিও জেনারেশন AI নিয়ে ধারাবাহিক পোস্ট করা কোনো অ্যাকাউন্ট নেই।
পোস্ট
থিমের কাছাকাছি শব্দ (“AI”, “generation” ইত্যাদি) থাকা পোস্ট খুবই কম, এবং কোনোটিই ইমেজ/ভিডিও জেনারেশন AI নিজে নিয়ে নয়। তথ্যসূত্র হিসেবে দেওয়া হলো।
-
@rammcodes (Ram Maheshwari) — 276 likes・51 reposts・4 replies・প্রায় 15,000 views・2026-09-29
https://x.com/rammcodes/status/2104962267267944848
“Holy Sh*t... this is like PDF parsing on steroids... A free, open-source
PDF parser that converts PDFs into AI-ready Markdown, JSON, and HTML.”
→ ওপেন-সোর্স PDF পার্সারের পরিচিতি; ইমেজ/ভিডিও জেনারেশন AI নয়, ডকুমেন্ট বিশ্লেষণ ও RAG-সংক্রান্ত টুল। -
@LuisBizarro (Luis Bizarro) — 930 likes・48 reposts・37 replies・প্রায় 52,000 views・2026-09-29
https://x.com/LuisBizarro/status/2104780688113455342
“Another AI slop and vibe coded experiment... based on Neon Genesis
Evangelion. This took me like 45 minutes and three prompts. This is all
Three.js and WebGL.”
→ AI দিয়ে “vibe coding” করা ইন্টারঅ্যাকটিভ 3D অভিজ্ঞতা (Three.js/WebGL); ইমেজ/ভিডিও জেনারেশন মডেল নয়, কোড জেনারেশন AI-এর বিষয়। -
@thomasunise (Thomas Unise) — 732 likes・48 reposts・43 replies・প্রায় 111,000 views・2026-09-29
https://x.com/thomasunise/status/2105003307232059397
“Elon is diabolical OpenAI drops dots https://Dot.com goes to Grok Bot”
→ OpenAI ও Grok ঘিরে ডোমেইন-সংক্রান্ত ঠাট্টার পোস্ট; জেনারেটিভ AI মডেলের প্রযুক্তিগত খবর নয়। -
@LinusEkenstam (Linus ✦ Ekenstam) — 2,640 likes・408 reposts・354 replies・প্রায় 344,000 views・2026-09-30
https://x.com/LinusEkenstam/status/2105212016583422270
“This video is going Viral everywhere. A trillionaire and a pile of
billionaires are unable to answer a simple question about regular laptop
jobs...”
→ AI জগতের পরিচিত ব্যক্তিদের (Dario প্রমুখ) নিয়ে একটি ভিডিওর পোস্ট; মূল বিষয় কর্মসংস্থান, ভিডিও জেনারেশন AI-এর প্রযুক্তিগত প্রবণতা নয়।
বাকি ৩৬টি পোস্ট (Spain বনাম Croatia ফুটবল, Tesla অটোপাইলটের অভিযোগ, JubJub নামের পোষ্য/চরিত্রের ফ্যান পোস্ট, Big Brother #bb28, WWE, Trump-এর রাজনৈতিক বক্তব্য ইত্যাদি) ইমেজ/ভিডিও জেনারেশন AI-এর সঙ্গে একেবারেই সম্পর্কহীন।
সংকেত
- থিম-সম্পর্কিত কোনো স্পষ্ট সংকেত শনাক্ত করা যায়নি। সংগৃহীত ৪০টি পোস্টের মধ্যে ক্লোজড-সোর্স (যেমন Midjourney, Sora, Runway, Veo, Flux Kontext) বা ওপেন-সোর্স (যেমন Stable Diffusion, Wan, HunyuanVideo, ComfyUI) ইমেজ/ভিডিও জেনারেশন AI-এর উল্লেখ একটিও নেই।
- একমাত্র ফল হলো সংগ্রহ-পদ্ধতির সংকেত: X Explore-এর আঞ্চলিক ট্রেন্ড (ক্রোয়েশিয়ার জন্য) সরাসরি সার্চ শব্দ হিসেবে ব্যবহৃত হয়েছে, যা গবেষণা ব্রিফের থিমের সঙ্গে অসংগত। এই সংগ্রহ-লজিকের সমস্যাই এ বারের সবচেয়ে বড় আবিষ্কার।
সীমাবদ্ধতা
- সার্চ শব্দ থিমের সঙ্গে সম্পর্কহীন ছিল—এটাই সবচেয়ে বড় সীমাবদ্ধতা। “Spain”“Tesla”“JubJub”“Holy”“Italy”“#bb28”“Elon”“Croat”“Donald”“Roman”—এই ১০টি শব্দের কোনোটিই ইমেজ/ভিডিও জেনারেশন AI থিম থেকে আসেনি; সেগুলো X Explore-এর ট্রেন্ড শব্দ (ক্রোয়েশিয়ায় জিওলোকেট করা সেশন থেকে) ছিল। ফলে সংগৃহীত ৪০টি পোস্টের মধ্যে থিম-সম্পর্কিত পোস্ট কার্যত শূন্য।
- “Midjourney”“Sora”“Stable Diffusion”“Runway”“Flux”“Veo”“Kling”“HunyuanVideo”-এর মতো থিম-সরাসরি শব্দ একবারও সার্চ করা হয়নি। এই run-এর X পর্যায় থিম সম্পর্কে কার্যত কিছুই বলতে পারে না।
- Explore-এর ট্রেন্ড টেবিল (Spain / Tesla / JubJub / Holy / Italy / #bb28 / Elon / Croat / Donald / Roman) নিজেই ক্রোয়েশিয়ান সার্ভারের দৃষ্টিভঙ্গিতে সীমিত; একে বৈশ্বিক ট্রেন্ড হিসেবে দেখা উচিত নয়।
- উপসংহারে, X-উৎসের ক্লোজড/ওপেন-সোর্স ইমেজ ও ভিডিও জেনারেশন AI প্রবণতা সম্পর্কে এ বারের ডেটা থেকে বৈধ কোনো অন্তর্দৃষ্টি দেওয়া সম্ভব নয়। পুনরায় সংগ্রহে থিম-সঙ্গত শব্দ (নির্দিষ্ট মডেল, টুল ও প্রতিষ্ঠানের নাম) ব্যবহার জরুরি।
YouTube
YouTube — ইমেজ ও ভিডিও জেনারেশন AI-এর সর্বশেষ সংবাদ (ক্লোজড-সোর্স/ওপেন-সোর্স)
চ্যানেল
- AI WITH Rithesh(@RitheshSreenivasan)— বিদেশি AI টুল চ্যানেল; Qwen-Image-2.1 প্রকাশের দিনই পরীক্ষা করেছে।
- Daily AI Roundup(@ai_roundup)— AI খবরের দৈনিক সারাংশ চ্যানেল; Qwen-Image-2.1 প্রকাশকে সংবাদ আকারে উপস্থাপন করেছে।
- Veteran AI(@VeteranAI-y1r)— ComfyUI ওয়ার্কফ্লো-কেন্দ্রিক চ্যানেল; LTX 2.5 ও Qwen Image 2.1 ধারাবাহিকভাবে কভার করছে।
- MaxonShire(@MaxonShire)— লোকাল AI ভিডিও জেনারেশনের তুলনামূলক পরীক্ষার চ্যানেল; HunyuanVideo ও Wan সিরিজের তুলনা প্রধান।
- 動画編集の中の人 — জাপানি ভাষার; পেইড ইমেজ-জেনারেশন AI টুল তুলনায় শক্তিশালী।
- AI大学【AI&ChatGPT最新情報】(@AIAIChatGPT-cj4sh)— জাপানি; নতুনদের জন্য AI টুল ব্যাখ্যা ও গাইড ভিডিও প্রধান।
- AIで創作効率化とマネタイズby呪喝蛙(@AI_aaafrog)— জাপানি; ComfyUI মডেল পরিচিতি ও আয়কেন্দ্রিক ব্যবহার তুলে ধরে।
- TBS NEWS DIG — TBS-এর অফিসিয়াল সংবাদ চ্যানেল; Sora 2-কে সম্প্রচার সংবাদ (news23) আকারে প্রতিবেদন করেছে।
সব ভিডিও পেজে সাবস্ক্রাইবার সংখ্যা JavaScript রেন্ডারের পরেই দেখা যায়; এই বারে পাওয়া oEmbed/সার্চ ফল থেকে তা নিশ্চিত করা যায়নি (Limits দেখুন)।
ভিডিও
-
“Qwen-Image-2.1 Is INSANE… Just 7B Parameters?!” — AI WITH Rithesh / ২০২৬ সালের সেপ্টেম্বরের শেষভাগ (Qwen-Image-2.1 প্রকাশ ২০২৬-০৯-২০-এর পরপরই) / https://www.youtube.com/watch?v=3qGl0wiv2G0 — Alibaba-এর প্রকাশিত ওপেন-ওয়েট 7B মডেলটি ট্রান্সপারেন্ট PNG, ১০টি পর্যন্ত রেফারেন্স ছবি ও নেটিভ 2K আউটপুট সমর্থন করে; ক্লোজড বড় মডেলের সমকক্ষ বলে পরিচিতি।
-
“A 7B Model That Beats Nano Banana 2.0? Master Qwen Image 2.1: Native 2K, RGBA & 10-Image Workflows” — Veteran AI / ২০২৬ সালের সেপ্টেম্বরের শেষভাগ / https://www.youtube.com/watch?v=fwHS0ubmI7I — Qwen-Image-2.1-এর ComfyUI ওয়ার্কফ্লো ব্যাখ্যা। নিজস্ব বেঞ্চমার্কে Nano Banana 2.0 (ক্লোজড)-কে ছাড়িয়ে যাওয়ার দাবিকে কেন্দ্র করে তৈরি (Tom's Hardware-এর প্রতিবেদনেও Qwen Image Benchmark 60.2 বনাম Nano Banana 2.0-এর 59.82 উল্লেখ আছে)।
-
“Alibaba Open-Sources Qwen-Image-2.1, A 7B Model With Native Transparency” — Daily AI Roundup / ২০২৬ সালের সেপ্টেম্বরের শেষভাগ / https://www.youtube.com/watch?v=cdZ4E7_kiJY — Qwen-Image-2.1 ওপেন-সোর্স হওয়ার ব্রেকিং নিউজধর্মী পরিচিতি। নেটিভ ট্রান্সপারেন্সি (আলফা চ্যানেল) সমর্থন এর মূল আকর্ষণ।
-
“Master LTX 2.5 in ComfyUI: Multi-Shot, First-Last Frame & 2K Workflows” — Veteran AI / ২০২৬ সালের আগস্টের মাঝামাঝি (সার্চ ফলে পোস্টের পর প্রায় ৪০–৪৮ দিন দেখানো) / https://www.youtube.com/watch?v=6B9WSxi6j8E — সম্পূর্ণ ওপেন-সোর্স ভিডিও জেনারেশন মডেল LTX 2.5 ComfyUI-তে ব্যবহারের ব্যবহারিক গাইড। মাল্টি-শট, প্রথম/শেষ ফ্রেম নির্ধারণ এবং 2K আউটপুট ওয়ার্কফ্লো ব্যাখ্যা করে।
-
“LTX 2.5 is a New Free and Opensource AI Video Model that is Insanely Fast in Generation”(Shorts)— ২০২৬ সালের আগস্টের মাঝামাঝি / https://www.youtube.com/shorts/h8qy-MBDzho — সংক্ষিপ্ত ভিডিওতে LTX 2.5-এর দ্রুত জেনারেশন ক্ষমতা তুলে ধরা হয়েছে।
-
“使わにゃ損損!お得に生成するならComfyUI一択!2026年おすすめ生成モデルベスト!” — AIで創作効率化とマネタイズby呪喝蛙 / ২০২৬ (সার্চ ফলে পোস্টের পর প্রায় ১৭২ দিন দেখানো, কিছুটা পুরোনো) / https://www.youtube.com/watch?v=qmiPya-U2KM — ছবি, ভিডিও, সঙ্গীত, অডিও ও 3D-সহ ওপেন-সোর্স ComfyUI মডেলের বিস্তৃত সারাংশ।
-
“【ドS課金して判明】2026年おすすめ画像生成AIはコレ!NanoBananaPro・Seedream4.0・Midjourney・AdobeFireflyを徹底比較します!” — 動画編集の中の人 / ২০২৬ (সাম্প্রতিক; নির্দিষ্ট তারিখ অজানা) / https://www.youtube.com/watch?v=vJLDbXaSKW4 — চারটি ক্লোজড-সোর্স সেবা (Nano Banana Pro, Seedream 4.0, Midjourney, Adobe Firefly) বাস্তবে পেমেন্ট করে তুলনামূলক রিভিউ।
-
“【画像生成AIの頂点】Google最新の画像生成AI「Nano Banana 2(ナノバナナ)」を無料で使い倒す!最短スタート完全ガイド!” — AI大学【AI&ChatGPT最新情報】/ ২০২৬ (Nano Banana 2 মূলত ২০২৬-০২-২৬–২৭-এ প্রকাশিত; ভিডিওটি এরপরও দেখা হয়েছে) / https://www.youtube.com/watch?v=Asuw6jHVcSs — Gemini 3 Pro-ভিত্তিক Nano Banana 2(Pro) বিনামূল্যে শুরু করার জন্য নতুনদের গাইড।
-
“【Google Flow完全ガイド】無料で使えるAI映像制作ツールが超進化!Gemini Omni Flash・ナノバナナを使って動画や画像を作れる!” — AI大学【AI&ChatGPT最新情報】/ ২০২৬ সালের মে-পরবর্তী (Gemini Omni Flash সংযোজনের উল্লেখ) / https://www.youtube.com/watch?v=dBFK1yFJXOA — Google-এর ক্লোজড-সোর্স সমন্বিত টুল Flow-এর নতুন উন্নতি ব্যাখ্যা করে। একই টুলে Nano Banana-ভিত্তিক ছবি এবং Veo-ভিত্তিক ভিডিও ব্যবহার করা যায়।
-
“最新動画生成AI「Sora2」リアルな映像が約3分で生成可能に…実演でわかったその性能 一方で著作権への懸念も【news23】” — TBS NEWS DIG / ২০২৬ / https://www.youtube.com/watch?v=_r9hojDlABM — ক্লোজড-সোর্স Sora 2 প্রদর্শনের মাধ্যমে এর পারফরম্যান্স এবং কপিরাইট লঙ্ঘন-উদ্বেগ নিয়ে সংবাদধর্মী কনটেন্ট। আলাদা গবেষণায় বলা হয়েছে OpenAI ২০২৬-০৩-২৪-এ Sora বন্ধের ঘোষণা দেয়, ২৬ এপ্রিল অ্যাপ/ওয়েব সংস্করণ বন্ধ করে এবং ২০২৬-০৯-২৪-এ Sora 2 API-ও বন্ধ করার পরিকল্পনা ছিল; অর্থাৎ এ সংবাদ সময়ের প্রায় ছয় মাসের মধ্যেই Sora বন্ধের দিকে যায়।
সংকেত
- ওপেন-সোর্স দিকের গতি: Qwen-Image-2.1 (Alibaba, ২০২৬-০৯-২০ প্রকাশিত, 7B প্যারামিটার, নেটিভ ট্রান্সপারেন্সি ও ১০টি রেফারেন্স ছবি সমর্থন) প্রকাশের পরপরই একাধিক চ্যানেলে কভার হয়েছে। ওপেন-ওয়েট মডেলটি Nano Banana 2.0-এর মতো ক্লোজড বড় মডেলের সমান বা তার চেয়ে ভালো—এমন নিজস্ব বেঞ্চমার্ক-দাবিই ছড়িয়ে পড়ার প্রধান কেন্দ্র। LTX 2.5 এবং HunyuanVideo/Wan পরিবারের “লোকালে চলা ফ্রি ভিডিও মডেল”-এর তুলনামূলক ভিডিওও নিয়মিত প্রকাশিত হচ্ছে; ComfyUI কার্যত সাধারণ প্ল্যাটফর্মে পরিণত হয়েছে।
- ক্লোজড-সোর্সের গতি: Google পরিবার (Nano Banana 2 / Nano Banana Pro, Gemini Omni Flash, Flow) জাপানি চ্যানেলগুলোতে বারবার আলোচিত প্রধান বিষয়। অন্যদিকে OpenAI-এর Sora ২০২৬ সালের শুরুতে আলোচনায় আসার পর মার্চ থেকে সেপ্টেম্বর পর্যন্ত ধাপে ধাপে বন্ধ হয়েছে (ওয়েব/অ্যাপ বন্ধ → API বন্ধ); “প্রকাশের সময় শক্তিশালী, কিন্তু স্থায়িত্ব নিয়ে প্রশ্ন” প্রেক্ষাপটে ক্লোজড বড় প্রতিষ্ঠানের উত্থান-পতন আলোচিত হয়েছে।
- ভাষাগত বণ্টন: জাপানি চ্যানেলগুলোতে (AI大学, 動画編集の中の人, 呪喝蛙) ক্লোজড-সোর্সের ব্যবহারিক তুলনা ও গাইড বেশি, আর ইংরেজি চ্যানেলগুলোতে (Veteran AI, AI WITH Rithesh, Daily AI Roundup, MaxonShire) ওপেন-সোর্স মডেলের ComfyUI ওয়ার্কফ্লো ব্যাখ্যা ও বেঞ্চমার্ক ব্রেকিং নিউজ বেশি—এমন প্রবণতা দেখা গেছে।
সীমাবদ্ধতা
- YouTube ভিডিও ও সার্চ ফল পেজ (
/watch,/results) WebFetch-এ কেবল স্থির HTML (ফুটারের নেভিগেশন লিংক) হিসেবে আসে; ভিউ, লাইক, সাবস্ক্রাইবার ও মন্তব্যের মতো ডায়নামিক উপাদান সরাসরি পাওয়া যায়নি। - বিকল্প হিসেবে YouTube oEmbed API (
/oembed?url=...&format=json) দিয়ে কেবল শিরোনাম ও চ্যানেল নাম পূরণ করা হয়েছে; ভিউ ও প্রকাশকাল ওয়েব সার্চের স্নিপেটে থাকা আপেক্ষিক সময় (“~দিন আগে”) থেকে নেওয়া। তাই কিছু ভিডিওর প্রকাশের তারিখ আনুমানিক। - কিছু ভিডিও ID (যেমন
yVMs1Z-FWmQ, রুশ ভাষার03MX2U8ZLDk, স্প্যানিশjH0AjVP49KI) সার্চ ফলে থাকলেও ভাষা ও প্রাসঙ্গিকতার অগ্রাধিকার কম হওয়ায় বিস্তারিত পরীক্ষা করা হয়নি। - শীর্ষ মন্তব্যের বিষয়বস্তু পাওয়া যায়নি, কারণ WebFetch মন্তব্য বিভাগ রেন্ডার করেনি।
Bluesky
Bluesky — ইমেজ ও ভিডিও জেনারেশন AI সংবাদ
সংগ্রহ-পদ্ধতি সম্পর্কে নোট
প্লেবুকে দেওয়া https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts?q=...-এ
Midjourney・"Stable Diffusion"・cat ইত্যাদি একাধিক কুয়েরি চেষ্টা করা হলেও প্রতিবার HTTP 403 এসেছে; ফলে এটি ব্যবহার করা যায়নি (bsky.app/search-এর ওয়েব সংস্করণও JavaScript-নির্ভর SPA হওয়ায় কনটেন্ট সংগ্রহ করা যায়নি)। অন্যদিকে app.bsky.actor.getProfile・app.bsky.feed.getAuthorFeed・app.bsky.unspecced.getTrendingTopics স্বাভাবিকভাবে কাজ করেছে। তাই WebSearch দিয়ে থিম-সম্পর্কিত অ্যাকাউন্ট খুঁজে তাদের getAuthorFeed সরাসরি পড়ার বিকল্প পদ্ধতি নেওয়া হয়েছে। বিস্তারিত ## Limits-এ আছে।
অ্যাকাউন্ট
-
dfl.bsky.social(DFL inc.)
https://bsky.app/profile/dfl.bsky.social
Google-এর “Nano Banana 2” দিয়ে তৈরি জাপানি ল্যান্ডস্কেপ-ফটোধর্মী AI ছবি প্রায় প্রতিদিন পোস্ট করা ব্যক্তিগত অ্যাকাউন্ট। ২০২৬ সালের সেপ্টেম্বরেও সক্রিয়; ক্লোজড-সোর্স মডেলের ব্যবহারকারী হিসেবে সবচেয়ে ধারাবাহিকভাবে পর্যবেক্ষণযোগ্য। -
doctordiffusion.bsky.social
https://bsky.app/profile/doctordiffusion.bsky.social
Stable Diffusion 3.5/Flux Dev/HunyuanVideo/LTX-Video-এর LoRA ও মডেল নিজে তৈরি করে Civitai ও Hugging Face-এ বিতরণ করা ওপেন-সোর্স নির্মাতা। তবে পোস্ট ২০২৪ সালের নভেম্বর থেকে ২০২৫ সালের মার্চে থেমে গেছে; ২০২৬-এ কার্যকলাপ দেখা যায়নি। -
emanuelmaiberg.bsky.social(404 Media সাংবাদিক Emanuel Maiberg)
https://bsky.app/profile/emanuelmaiberg.bsky.social
ইমেজ/ভিডিও জেনারেশন AI-এর অপব্যবহার—ডিপফেক, অসন্মতিপূর্ণ জেনারেটেড ছবি, AI সঙ্গীতে সেলিব্রিটি নকল—নিয়ে ধারাবাহিক প্রতিবেদন ও পোস্ট করেন। ২০২৬ সালের আগস্ট–সেপ্টেম্বরেও সক্রিয়, এবং Bluesky-তে থিম-সম্পর্কিত সবচেয়ে ধারাবাহিক অ্যাকাউন্টগুলোর একটি। -
midjourneyofficial.bsky.social(Midjourney অফিসিয়াল)
https://bsky.app/profile/midjourneyofficial.bsky.social
২০২৫ সালের আগস্টে Bluesky-তে যোগদানের ঘোষণা দিলেও সর্বশেষ পোস্ট ২০২৫-১০-০৮; ২০২৬-এর কোনো পোস্ট পাওয়া যায়নি। অফিসিয়াল ক্লোজড-সোর্স প্রতিষ্ঠানের Bluesky কার্যক্রমও দুর্বল—তার উদাহরণ। -
stablediffusion.bsky.social(“Stable Diffusion online AI”)
https://bsky.app/profile/stablediffusion.bsky.social
প্রায় ১,৮০০ ফলোয়ারের AI আর্ট কমিউনিটি-ধর্মী অ্যাকাউন্ট। পোস্ট ২০২৫ সালের ফেব্রুয়ারি পর্যন্ত; পরে আর আপডেট নেই। -
wagahai-ai.bsky.social
https://bsky.app/profile/wagahai-ai.bsky.social
জাপানি ভাষায় AI ইলাস্ট্রেশন ও AI ভিডিও পোস্ট করা ব্যক্তিগত অ্যাকাউন্ট। এটিও ২০২৫ সালের জানুয়ারির পর আর সক্রিয় নয়।
পোস্ট
-
@dfl.bsky.social — 2026-09-30・লাইক14・রিপোস্ট1
https://bsky.app/profile/dfl.bsky.social/post/3mwr727gyck26
“AI image generation #Nano Banana 2 ... সোনালি প্রতিফলন পড়া খাল।” Google-এর ক্লোজড-সোর্স ইমেজ মডেল “Nano Banana 2” দিয়ে তৈরি জাপানি খালের দৃশ্য। -
@dfl.bsky.social — 2026-09-25・লাইক51・রিপোস্ট2(সাম্প্রতিক ২০টির মধ্যে সর্বোচ্চ এনগেজমেন্ট)
https://bsky.app/profile/dfl.bsky.social/post/3mwesrcxg5k2c
“#Nano Banana 2 ... বিস্তৃত নদীতীর, পাথরের বাঁধ, দূরে জাপানি বাড়িঘর।” -
@dfl.bsky.social — 2026-09-21・লাইক45・রিপোস্ট2
https://bsky.app/profile/dfl.bsky.social/post/3mw2ny6hsa22p
“#Nano Banana 2 ... পুরোনো কাঠের সেতু, ছোট নদী, শীতল গোধূলি।” প্রতিদিন পোস্ট করার গতি এবং ৩০–৫০ লাইক পরিসরের স্থিতিশীল সাড়া দেখা যায়। -
@doctordiffusion.bsky.social — 2025-01-19・লাইক3・উত্তর4
https://bsky.app/profile/doctordiffusion.bsky.social/post/3lg36y7u2i22x
“SD3.5 Lives! Absynth 2.0 প্রকাশ।” Stable Diffusion 3.5 Large-এর ফাইন-টিউন সংস্করণ Civitai/Hugging Face-এ বিনামূল্যে বিতরণ—ওপেন-সোর্স ঘরানার তৃণমূল প্রকাশনা। -
@doctordiffusion.bsky.social — 2025-01-01・লাইক1・উত্তর2
https://bsky.app/profile/doctordiffusion.bsky.social/post/3leofdsx6yc23
Flux Dev ও Stable Diffusion 3.5-এর text encoder alignment দিয়ে প্রশিক্ষণ স্থিতিশীল হয়েছে—এই প্রযুক্তিগত আবিষ্কার#opensourceট্যাগে শেয়ার। -
@doctordiffusion.bsky.social — 2024-11-26・লাইক4
https://bsky.app/profile/doctordiffusion.bsky.social/post/3lbssdeocz226
ComfyUI-তে LTX-Video-এর Img2Vid ও কাস্টম নোড ব্যবহার করে ভিডিও বাড়ানোর উদাহরণ; ওপেন-সোর্স ভিডিও জেনারেশন (LTX-Video/Mochi) মিলিয়ে ব্যবহার। -
@emanuelmaiberg.bsky.social — 2026-08-20・লাইক14・রিপোস্ট6
https://bsky.app/profile/emanuelmaiberg.bsky.social/post/3mtjegiaxpk2h
অসন্মতিপূর্ণ AI-জেনারেটেড ছবি ক্রমে আরও “subtle” বা শনাক্ত করা কঠিন হয়ে উঠছে—404 Media-র প্রতিবেদন। -
@emanuelmaiberg.bsky.social — 2026-08-17・লাইক36・রিপোস্ট9
https://bsky.app/profile/emanuelmaiberg.bsky.social/post/3mtbvku5wds2p
ডিপফেক গবেষক Hany Farid-এর সঙ্গে পডকাস্টে সিন্থেটিক মিডিয়ার অতীত, বর্তমান ও ভবিষ্যৎ নিয়ে আলোচনা। -
@midjourneyofficial.bsky.social — 2025-08-15・লাইক41・রিপোস্ট4・উত্তর14
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwi222j4sk2b
“#Midjourney is now on BlueSky! Who are the best creators we should follow?” অফিসিয়াল অ্যাকাউন্টের Bluesky-তে প্রবেশের প্রথম পোস্ট। পরে ২০২৫ সালের অক্টোবর পর্যন্ত বিচ্ছিন্ন কিছু পোস্ট ছিল।
সংকেত
- Bluesky-র “AI” আলোচকরা ইমেজ/ভিডিও জেনারেশনের চেয়ে LLM ও এজেন্ট নিয়ে বেশি ব্যস্ত। Tim Kellogg (@timkellogg.me) ও Ethan Mollick (@emollick.bsky.social)-এর মতো ১০,০০০+ ফলোয়ারের AI আলোচকদের ২০২৬ সালের সেপ্টেম্বরের সাম্প্রতিক পোস্টে GPT-6.1, Gemini 4 ও Claude-এর এজেন্ট ফিচারই প্রধান; Midjourney/Stable Diffusion/Sora/Wan/Kling ইত্যাদি ইমেজ-ভিডিও মডেলের উল্লেখ শূন্য।
- ক্লোজড-সোর্সের ব্যবহারিক উদাহরণ প্রতিষ্ঠান নয়, ব্যক্তির দৈনন্দিন ব্যবহারে দেখা যায়। Midjourney-এর অফিসিয়াল অ্যাকাউন্ট প্রায় নীরব; dfl.bsky.social-এর মতো অ্যাকাউন্ট Google Nano Banana 2 দিয়ে প্রতিদিন কাজ পোস্ট করে চলেছে।
- ওপেন-সোর্স নির্মাতা কমিউনিটি—LoRA বিতরণ, ComfyUI ওয়ার্কফ্লো ভাগাভাগি—Bluesky-তে ইতিমধ্যে ম্লান। doctordiffusion, wagahai-ai ও stablediffusion সবাই ২০২৫ সালের প্রথমার্ধেই আপডেট বন্ধ করেছে; ২০২৪-এর শেষ ও ২০২৫-এর শুরু ছিল শেষ উচ্ছ্বাসের সময় হতে পারে।
- ইমেজ/ভিডিও জেনারেশন AI নিয়ে সবচেয়ে ধারাবাহিক কথাবার্তা সমালোচনা ও সাংবাদিকতার দিকেই। 404 Media-র Emanuel Maiberg ডিপফেক ও অসন্মতিপূর্ণ জেনারেটেড ছবি নিয়ে ২০২৬ সালের আগস্ট–সেপ্টেম্বরেও লিখছেন; এই থিমের ক্ষেত্রে সবচেয়ে “বর্তমান” পোস্টগুলো তাঁর।
- এ থেকে এই চক্রের সবচেয়ে বড় উপলব্ধি হলো: ক্লোজড/ওপেন-সোর্স ইমেজ ও ভিডিও জেনারেশন AI সংবাদের জন্য Bluesky মূল স্রোতের প্রকাশস্থল নয়। X-এর মতো এখানেও থিম-সরাসরি সাম্প্রতিক পোস্ট কম।
সীমাবদ্ধতা
app.bsky.feed.searchPosts(পাবলিক সার্চ API) সব সময় HTTP 403 দিয়েছে। “Midjourney”“"Stable Diffusion"”“cat”—সব ক্ষেত্রেই 403; কুয়েরির বিষয়বস্তু নির্বিশেষে ব্লক করা মনে হয়েছে।app.bsky.unspecced.searchPostsSkeletonHTTP 501 দিয়েছে, কিন্তুgetProfile・getAuthorFeed・getTrendingTopicsস্বাভাবিক ছিল। অর্থাৎ রিড এন্ডপয়েন্ট খোলা থাকলেও এই পরিবেশ থেকে পূর্ণ-পাঠ সার্চ বন্ধ ছিল।bsky.app/searchওয়েব সংস্করণও JavaScript-নির্ভর SPA হওয়ায় WebFetch পোস্টের মূল লেখা সংগ্রহ করতে পারেনি (শুধু শিরোনামের স্ট্রিং ফিরেছে)।- ফলে প্লেবুক অনুসারে কীওয়ার্ড-ভিত্তিক পোস্ট সংগ্রহ করা যায়নি; WebSearch-এ অ্যাকাউন্ট খুঁজে
getAuthorFeedআলাদাভাবে পড়া হয়েছে। এতে পাওয়া অ্যাকাউন্টের সাম্প্রতিক পোস্ট নির্ভুলভাবে দেখা যায়, কিন্তু গোটা প্ল্যাটফর্মে এই থিমে কত পোস্ট হচ্ছে তার বিস্তৃত চিত্র পাওয়া যায় না। - WebSearch-এ MiniMax H3 নিয়ে Bluesky আলোচনার ইঙ্গিত পাওয়া sungkim.bsky.social ও ekazakos.bsky.social-এর পোস্ট বাস্তবে
getAuthorFeed-এ সাম্প্রতিক ৩০টির মধ্যে মেলেনি; পোস্টগুলো ২০২৬ সালের জুলাইয়ের শেষের, যা সেপ্টেম্বরের শেষের ৩০টি সাম্প্রতিক পোস্টের চেয়ে পুরোনো। তাই এই প্রতিবেদনে রাখা হয়নি—আসলে পড়া পোস্টই অন্তর্ভুক্ত করার নীতি অগ্রাধিকার পেয়েছে। - doctordiffusion.bsky.social, wagahai-ai.bsky.social ও stablediffusion.bsky.social থিম-সরাসরি অ্যাকাউন্ট হলেও ২০২৫ সালের প্রথমার্ধেই নিষ্ক্রিয়; ২০২৬ সালের সেপ্টেম্বর–অক্টোবরের সর্বশেষ সংবাদ হিসেবে ধরার মতো নয়। কার্যত সক্রিয় থিম-সম্পর্কিত অ্যাকাউন্ট কেবল dfl.bsky.social (ক্লোজড-সোর্স ব্যবহার) ও emanuelmaiberg.bsky.social (সমালোচনামূলক প্রতিবেদন)।
- “প্রায় ২০টি পোস্ট বিশ্লেষণ”-এর সমাপ্তি-মানদণ্ড পূরণ হয়নি। পূর্ণ-পাঠ সার্চ না থাকায় থিম-সম্পর্কিত পোস্ট হিসেবে চিহ্নিত হয়েছে কেবল এক ডজনের মতো, যার অর্ধেকই ২০২৪–২০২৫-এর পুরোনো পোস্ট। সত্যিকারের সিদ্ধান্ত: এই থিম নিয়ে Bluesky-তে অন্য প্ল্যাটফর্মের মতো বলার মতো উপাদান কম।
Lemmy
Lemmy — ইমেজ ও ভিডিও জেনারেশন AI (ক্লোজড/ওপেন-সোর্স) সংবাদ
গবেষণার তারিখ: 2026-10-01। Lemmy API সার্চ (/api/v3/search) ও কমিউনিটির POST তালিকা API ব্যবহার করে stable_diffusion, imageai, fuck_ai, technology ইত্যাদি কমিউনিটি এবং FLUX.2 / Qwen-Image / Nano Banana / Midjourney / Grok Imagine / Sora / Veo / Kling-এর মতো কীওয়ার্ডে আন্তঃপ্ল্যাটফর্ম সার্চ চালানো হয়েছে।
কমিউনিটি
- !«メールアドレス» — 5,713 subscribers / 1,423 posts। Lemmy-তে ইমেজ ও ভিডিও জেনারেশন AI-এর প্রযুক্তিগত তথ্য—ComfyUI ওয়ার্কফ্লো, LoRA, নতুন মডেল—নিয়ে সবচেয়ে সক্রিয় কমিউনিটি। dbzer0 পরিচালিত বিকেন্দ্রীভূত ফ্রি ইমেজ জেনারেশন প্রকল্প AI Horde-এর ঘোষণাও এখানে আসে।
- !«メールアドレス» — 8,532 subscribers / 4,680 posts। মডেল নির্বিশেষে AI-তৈরি ছবি পোস্টের জায়গা। সংবাদ নয়, কাজের পোস্টই প্রধান; অনেক পোস্টে নেতিবাচক স্কোর দেখা যায়, যা Lemmy জুড়ে AI-জেনারেটেড উপাদান নিয়ে শীতল মনোভাব দেখায়।
- !«メールアドレス» — 8,333 subscribers। AI-বিরোধী অবস্থান থেকে শিল্প-সমালোচনার খবর ভাগ করে নেওয়া কমিউনিটি। ক্লোজড-সোর্সের বিতর্ক ও মামলার খবর এখানে সহজে জমা হয়।
- !«メールアドレス» — সাধারণ প্রযুক্তি কমিউনিটি। Google Earth ঘটনার মতো বড় ক্লোজড-সোর্স সংবাদে এখানেই সর্বোচ্চ স্কোর দেখা গেছে।
- !«メールアドレス» — 53 subscribers। Reddit (r/ArtificialIntelligence)-এর RSS যান্ত্রিকভাবে পুনঃপ্রকাশ করা বট কমিউনিটি; Lemmy-র নিজস্ব আলোচনা নয়।
পোস্ট
ওপেন-সোর্সমুখী (সবগুলো !«メールアドレス»)
- ComfyUI-তে Qwen-Image-2.1: ওপেন-ওয়েট ইমেজ… — 2026-09-22, score 13। Alibaba-এর ওপেন-ওয়েট ইমেজ মডেল Qwen-Image-2.1-এর ComfyUI সমর্থন নিয়ে blog.comfy.org নিবন্ধ। এই গবেষণায় ওপেন-সোর্স পোস্টগুলোর মধ্যে সর্বোচ্চ স্কোর।
- qwen-image-2.1-এর জন্য WebUI — 2026-09-27, score 2। Fooocus-ধাঁচের হালকা WebUI-কে Qwen-Image-2.1-সমর্থিত করার প্রকল্প।
- Qwen-Image-2.1-এর জন্য অল্প-ধাপের LoRA অ্যাডাপ্টার — 2026-09-26, score 0। জেনারেশন ধাপ কমিয়ে দ্রুত করার LoRA।
- দীর্ঘ, নিরবচ্ছিন্ন মাল্টি-শট ভিডিও ধারাবাহিকতা — 2026-09-29, score 4। MiniMax-H3-Latent ব্যবহার করে একাধিক শট নির্বিঘ্নে জোড়া ভিডিও ওয়ার্কফ্লো।
- AI-সহ ফ্রি, লোকাল, ওপেন-সোর্স ভিডিও এডিটর — 2026-09-29, score 5। লোকাল-ভিত্তিক AI ভিডিও এডিটিং টুল “vlo”。
- LanPaint — প্রতিটি মডেলের জন্য প্রশিক্ষণবিহীন inpaint — 2026-09-29, score 8। অতিরিক্ত প্রশিক্ষণ ছাড়া বিদ্যমান মডেলে উচ্চমানের ইনপেইন্ট যোগ করার পদ্ধতি।
- ক্ষুদ্র 100M-প্যারামিটারের text-to-image মডেল (Supra2-IMG) — 2026-09-22, score 7। অতি হালকা, কম VRAM-এ চলা text-to-image মডেল।
- AI Horde — নতুন ইন্টারফেস ও ডকুমেন্টেশন — 2026-09-19, score 8। dbzer0 পরিচালিত বিকেন্দ্রীভূত ফ্রি ইমেজ জেনারেশন সেবার UI/ডকুমেন্টেশন হালনাগাদের ঘোষণা।
ক্লোজড-সোর্সমুখী
- দুর্যোগ ডিপফেকের পর Google Earth-এর নতুন AI ইমেজ জেনারেশন ফাংশন এক দিনও টেকেনি — 2026-08-01, score 473(!«メールアドレス»)。Google Earth-এর Nano Banana (Gemini)-সমর্থিত AI ফিচার দুর্যোগ জালিয়াতির ছবিতে অপব্যবহারের কারণে এক দিনও না টিকে বন্ধ হওয়া। পর্যবেক্ষিত সব পোস্টের মধ্যে এটি সর্বোচ্চ স্কোরের একটি।
- Tennessee-এর কিশোররা শিশু যৌন নির্যাতনের ছবি নিয়ে Elon Musk-এর xAI-এর বিরুদ্ধে মামলা করেছে — 2026-03-17, score 13(Mother Jones কমিউনিটি)। xAI-এর Grok Imagine দিয়ে তৈরি শিশু যৌন নির্যাতনের ছবি নিয়ে মামলা। ১১ দিনে প্রায় ২.৩ লাখ এমন ছবি তৈরি হয়েছিল বলে অভিযোগ।
- Disney ও Universal কপিরাইট লঙ্ঘনের জন্য ইমেজ নির্মাতা Midjourney-এর বিরুদ্ধে মামলা করেছে — 2025-06-11, score 88(!«メールアドレス»)。কিছুটা পুরোনো হলেও Midjourney কপিরাইট মামলা এখনো চলমান; প্রেক্ষাপট-খবর হিসেবে উল্লেখ অব্যাহত।
- একই Berserk পাতা, ৪টি AI রঙায়ন। মনে হচ্ছে আবার GPT জিতল? — 2026-09-14, score 1(!«メールアドレス»-এর মাধ্যমে)。Nano Banana Pro-সহ একাধিক মডেলে মাঙ্গার স্বয়ংক্রিয় রঙায়নের তুলনা করা Reddit থ্রেডের মিরর। এটি Lemmy-র নিজস্ব পোস্ট নয়।
সংকেত
- ওপেন-সোর্স দিকটি সম্পূর্ণ ComfyUI ইকোসিস্টেমনির্ভর। FLUX.2 (Black Forest Labs) ও Qwen-Image পরিবার, বিশেষত 2.1-এর ডেরিভেটিভ ওয়ার্কফ্লো, LoRA ও নোড এক্সটেনশন প্রতিদিন পোস্ট হচ্ছে। পোস্টের ঘনত্ব ও প্রযুক্তিগত নির্দিষ্টতায় Lemmy-তে এ অংশটি নিঃসন্দেহে সবচেয়ে সমৃদ্ধ। AI Horde-এর মতো ফ্রি ও বিকেন্দ্রীভূত অবকাঠামো Lemmy-র বাণিজ্যবিরোধী, স্বনির্ভর সংস্কৃতির সঙ্গেও মেলে।
- ভিডিও জেনারেশন এখনো খুবই বিশেষায়িত। MiniMax-H3 ও নিজস্ব লোকাল ভিডিও এডিটরের মতো ভিডিও পোস্ট ছবিসংক্রান্ত পোস্টের তুলনায় কম এবং স্কোরও সীমিত (প্রায় ৪–৮)।
- ক্লোজড-সোর্স সংবাদ ফিচার পরিচিতির বদলে বিতর্ক ও মামলার পথেই আসে। Google Earth (Nano Banana), Grok Imagine ও Midjourney—প্রতিটির ক্ষেত্রেই নতুন ফিচার ঘোষণার চেয়ে অপব্যবহার বা মামলার সময় !technology ও !fuck_ai-তে পোস্ট আসে এবং উচ্চ স্কোর পায়। Google Earth পোস্টটির score 473 এ গবেষণায় বিশেষভাবে উঁচু।
- AI-জেনারেটেড কাজের প্রতি দৃষ্টিভঙ্গি মোটের ওপর ঠান্ডা। !«メールアドレス»-এ প্রায় অর্ধেক পোস্টে নেতিবাচক স্কোর (-18 থেকে -3); “AI আর্ট” হওয়াটাই যেন স্কোর কমার কারণ। !fuck_ai (8,333 সদস্য)-এর উপস্থিতিও Lemmy কমিউনিটির মনোভাব বোঝায়।
সীমাবদ্ধতা
- Lemmy ছোট পরিসরের; ইমেজ/ভিডিও জেনারেশন AI-কেন্দ্রিক ক্লোজড-সোর্স কমিউনিটি পাওয়া যায়নি। ওপেন-সোর্সের !stable_diffusion থাকলেও তার সমমানের ক্লোজড কমিউনিটি নেই। ফলে ক্লোজড-সোর্স অন্তর্দৃষ্টি !technology ও !fuck_ai-এর মতো সাধারণ কমিউনিটি থেকে সীমিতভাবে এসেছে।
- “Veo 3”“Kling AI” সার্চ করেও কার্যকর Lemmy পোস্ট মেলেনি (শুধু অপ্রাসঙ্গিক ফল); Sora-র ক্ষেত্রেও ভিডিও মডেল নিয়ে আলোচনা নয়, মিমে মাত্র একটি উল্লেখ পাওয়া গেছে।
lemmy.world/c/stablediffusionকমিউনিটি পেজ সরাসরি আনতে 500 error হয়েছে (API সার্চ দিয়ে বিকল্প নেওয়া হয়েছে)।lemmy.today/api/v3/community-তে অনুরোধও 404 দিয়েছিল; প্রকৃত হোম ইনস্ট্যান্স lemmy.dbzer0.com বুঝতে সময় লেগেছে।- !«メールアドレス» হলো Reddit RSS পুনঃপ্রকাশ করা ৫৩ সদস্যের বট কমিউনিটি; Lemmy-র নিজস্ব আলোচনা নয়। তথ্যসূত্র হিসেবে মাত্র একটি পোস্ট রাখা হয়েছে।
- সার্চের সীমার মধ্যে জাপানি ভাষার Lemmy কমিউনিটি বা পোস্ট পাওয়া যায়নি।
- এই পর্যায় কেবল Lemmy নিয়ে; প্রতিটি SNS-এ প্রায় ২০টি পোস্ট বিশ্লেষণের লক্ষ্য বিবেচনায় API সার্চ ও কমিউনিটি তালিকা থেকে মোট ৬০টির বেশি পোস্ট/মন্তব্য পরীক্ষা করে উপরের প্রতিনিধিত্বশীল ১১টি নির্বাচন করা হয়েছে।
Pinterest — ইমেজ ও ভিডিও জেনারেশন AI সংবাদ
“Image and Video Generation AI News” কুয়েরির জন্য ওয়ার্কার ৫০টি পিন সংগ্রহ করেছিলেন (কোনো ঘরানা-বিভাজন ছিল না—সব এক ব্যাচ)। সব ৫০টি খোলা ও রিভিউ করা হয়েছে।
দৃশ্যগত থিম
- AI-এর “মুখ” হিসেবে ক্রোম/সাদা মানবাকৃতি অ্যান্ড্রয়েড — জ্বলজ্বলে নীল চোখ, উন্মুক্ত ধাতব জয়েন্ট, কখনও স্যুট পরা। সাধারণ ব্যাখ্যা, সংবাদ উপস্থাপক ও নৈতিকতা-সংক্রান্ত কনটেন্টে ব্যবহৃত। [1, 16, 19, 20, 24, 29, 30, 35, 45]
- গাঢ় নেভি/কালো পটভূমিতে নীয়ন সায়ান-বেগুনি সার্কিটের আভা — AI ব্যাখ্যামূলক ও তালিকাভিত্তিক থাম্বনেইলের প্রচলিত রং; সার্কিট-মস্তিষ্ক বা উজ্জ্বল “AI” ওয়ার্ডমার্ক কেন্দ্রীয় আইকন। [2, 9, 14, 21, 28, 33, 40, 42, 50]
- “AI সাংবাদিকদের প্রতিস্থাপন করছে / ভুয়া সংবাদ” উদ্বেগের ফ্রেমিং — নিউজ ডেস্কে AI অ্যাঙ্কর, “FAKE” স্ট্যাম্প, ডিপফেক-সনাক্তকরণ UI, বাস্তব সম্প্রচারকারীর লোগোতে (NBC) “AI GENERATED” ওয়াটারমার্ক। [1, 6, 23, 31, 35, 36, 44]
- মানুষ বনাম AI দ্বৈততার গ্রাফিক — স্প্লিট-স্ক্রিনে মানুষের আঙুল বনাম রোবটের আঙুল, কিবোর্ডের ওপর ম্যাগনিফাইং গ্লাস, “Human or AI?” ক্যাপশন। [30, 31]
- ডিস্টোপিয়ান/খলনায়ক AI চিত্র — শিংওয়ালা, লালচোখের “AI” দানব ফোনে মগ্ন মানুষদের পুতুলের মতো নিয়ন্ত্রণ করছে; ভয়-উসকানিমূলক ক্যাপশন (“AI is getting scary good”)। [17, 23]
- টুল তালিকা ও তুলনা চার্ট — Runway, Pika, Kling AI, Luma/Dream Machine, Canva AI, Hailuo, Midjourney, Adobe Firefly, Recraft, Kaiber, Ideogram, SeaArt, Krea-সহ বাস্তব পণ্যের “সেরা পেইড বনাম সেরা ফ্রি” বা “সেরা ৬+ ওয়েবসাইট” ইনফোগ্রাফিক। [5, 15, 40]
- প্রকৃত প্রোডাক্ট-ডেমো স্ক্রিনশট — image-to-video ওয়ার্কফ্লোর ধাপে ধাপে UI মকআপ (upload → prompt → motion sliders → render), JoyFun AI ও Blueticks-এর মতো ছোট SaaS ব্র্যান্ডের। [8, 10]
- ফটোরিয়াল/স্টাইলাইজেশন রূপান্তর ডেমো — একই উৎস ছবি কাঠের ব্লক, অরিগামি, Lego, ফুল ও খেলনা-ব্লকের রূপে পাশাপাশি (Lumalabs); পাশাপাশি মার্বেলের ভায়োলিনবাদক মূর্তি ও AMD/“Amuse 3.0” ক্রেডিটসহ জেলের প্রতিকৃতি। [4, 15, 38]
- বড় মডেলের বিপণন কোলাজ — Google Veo 2 (একই অফিসিয়াল প্রচার কোলাজ দুইটি অসংশ্লিষ্ট পিনে ব্যবহৃত), Gemini Omni “যেকোনো কিছুকে ভিডিওতে রূপান্তর করে”, Meta “Muse Spark” 2026 মডেল। [17, 24, 32, 3]
উল্লেখযোগ্য পিন
- AI কনটেন্ট ও সামাজিক মাধ্যম নিয়ে উদ্বেগ [1] — ফোন স্ক্রল করা রোবটের পাশে “FAKE” স্ট্যাম্প ও সন্দেহজনক বিড়ালের ছবি; ডিপফেক-উদ্বেগ উসকানোর প্রচলিত উপাদান।
- Meta Unveils Muse Image and Muse Video Generative... [3] — ২০২৬-এর “Muse Spark” মডেলকে শুধু কনটেন্ট টুল নয়, ব্যক্তিগত সহকারী/“superintelligence” উদ্যোগ হিসেবে উপস্থাপন করে।
- (শিরোনামহীন, Lumalabs ট্রান্সফর্ম গ্রিড) [4] — একটি উৎস ভিডিও থেকে মানুষ, কুকুর ও গাড়ির কাঠের-ব্লক, অরিগামি, Lego-ব্লক ও ফুল সংস্করণ; সেটের মধ্যে সবচেয়ে স্পষ্ট বাস্তব before/after সক্ষমতা ডেমো।
- Create Videos From Images [8] — “JoyFun AI” নামে একটি টুলের সম্পূর্ণ ৬-ধাপের UI মকআপ (upload → prompt → AI processing → motion sliders → render → output)।
- Transform your ideas into stunning visuals! [15] — ইমেজ জেনারেশনের প্রদর্শনী ছবি হিসেবে ব্যবহৃত ভায়োলিন বাজানো অতিবাস্তব মার্বেল মূর্তি।
- (শিরোনামহীন, Veo 2 প্রচার) [17] — Google-এর অফিসিয়াল “Veo 2: our state-of-the-art video generation model” লঞ্চ কোলাজ (সাঁতার কাটা কুকুর, ফ্লেমিঙ্গো, অ্যানিমেটেড মেয়ে); একই ছবি ভিন্ন ক্যাপশনসহ pin 32-এও হুবহু ব্যবহৃত।
- Google's Gemini Omni Turns Anything Into Video [24] — “যেকোনো ইনপুট → যেকোনো আউটপুট” Google-এর ভিডিও জেনারেশনের বড় সাধারণীকরণ দাবির ফ্রেমিং।
- ‘Amuse 3.0’, an AI art creation tool that includes... [38] — AMD-ব্র্যান্ডেড বৃদ্ধ জেলের ফটোরিয়াল প্রতিকৃতি; হার্ডওয়্যার-অ্যাক্সিলারেটেড লোকাল ইমেজ-জেনারেশন টুলের ইঙ্গিত।
- Introducing Luma Dream Machine [43] — “Dream Machine” ওয়ার্ডমার্কের ওপর চোখের অতিনিকট দৃশ্য; প্রোডাক্ট শটের বদলে ব্র্যান্ড-কেন্দ্রিক ছবি।
- AI NEWS: May 20 2026 Google I/O recap infographic [35] — Gemini 3.5 Flash, Gemini Omni, Gemini Spark, Android XR চশমা নিয়ে “সবচেয়ে বড় AI ইভেন্ট” ফ্রেমে; চিরকালীন তালিকার বদলে তারিখযুক্ত নির্দিষ্ট সংবাদ সারাংশ।
সংকেত
- সেটটি প্রকৃত জেনারেটেড আর্ট প্রদর্শনের বদলে SEO/ব্লগ-থাম্বনেইল কনটেন্টে ভারী ঝুঁকে আছে—স্টক রোবট, সাধারণ “AI News” ওয়ার্ডমার্ক, টুল তালিকা; সংখ্যায় এগুলোই বাস্তব ডেমোর চেয়ে বেশি।
- ডিপফেক/ভুলতথ্য এবং “AI সাংবাদিকদের প্রতিস্থাপন করছে” পুনরাবৃত্ত বয়ান, একক ঘটনা নয়—৫০টি পিনের অন্তত ৭টিতে দেখা যায়; প্রায়ই বাস্তব ব্রডকাস্টার ব্র্যান্ডিং (NBC) বা “FAKE” স্ট্যাম্পের সঙ্গে।
- বাস্তব নামের টুল বারবার এসেছে: Veo 2/Gemini Omni (Google), Dream Machine/Luma, Runway, Pika, Kling AI, Canva AI, Hailuo, Amuse 3.0, Meta Muse Spark—তবে বেশিরভাগই লোগো বা মার্কেটিং কোলাজ; বাস্তব ওয়ার্কফ্লো স্ক্রিনশট বিরল (JoyFun AI ও Blueticks ব্যতিক্রম)।
- অনুপস্থিত: কোনো দৃশ্যমান ওপেন-সোর্স মডেলের নাম বা লোকাল টুলিং স্ক্রিনশট নেই—ComfyUI, Automatic1111, Stable Diffusion UI, checkpoint/LoRA আলোচনাও নেই; একটি পিনের শিরোনামে “Stable Diffusion” থাকলেও মিলযুক্ত স্ক্রিনশট নেই। অ্যানিমে/ইলাস্ট্রেশন AI-আর্ট কমিউনিটির কনটেন্ট নেই; Lumalabs-এর একটিমাত্র ট্রান্সফর্ম গ্রিড ছাড়া মাল্টি-শট গল্প/সামঞ্জস্যের ভিডিও ডেমো নেই।
- একই অফিসিয়াল Veo 2 মার্কেটিং ছবি ভিন্ন লেখা সহ দুই পিনে [17, 32] দেখা গেছে—Pinterest-এর AI নিউজ অংশ কিছুটা পুনর্ব্যবহৃত/সংকলিত, মৌলিক মন্তব্যনির্ভর নয়।
সীমাবদ্ধতা
- প্লেবুক অনুযায়ী Pinterest সরাসরি ব্রাউজ করা হয়নি; সব ফল ওয়ার্কারের আগে সংগৃহীত ৫০টি পিন ও ছবি
output/pinterest.pins.mdএবংimages/pinterest/থেকে দৃশ্যগত পাঠের উপর ভিত্তি করে। - পিন টেবিলে ঘরানাভিত্তিক বিভাগ নেই (একটি লেবেলবিহীন ব্যাচ), তাই থিমগুলো ঘরানা অনুসারে নয়, পুরো সেট জুড়ে নির্ধারিত।
- কয়েকটি পিনের শিরোনাম “(untitled)” এবং কেবল সাধারণ স্টক-আর্ট আছে; পিন URL ছাড়া উৎস, পোস্টের তারিখ বা এনগেজমেন্ট নিশ্চিত করার উপায় নেই।
- শিরোনাম/ছবি থেকে ব্র্যান্ড ও হেডলাইনের দাবি (যেমন “Grok is revolutionizing video”, “GPT 5.2 ... full body control”) বোঝা যায়, কিন্তু ছবিগুলো নিজে সাধারণ স্টক গ্রাফিক; সেগুলো প্রকৃত পণ্য বা ফিচারের স্ক্রিনশট নয়। ফলে শুধু ছবির ভিত্তিতে এই দাবিগুলো যাচাই করা যায়নি।
সুপারিশকৃত পদক্ষেপ
- X পর্যায়ে থিম-সরাসরি কীওয়ার্ড (Midjourney, Sora, Stable Diffusion, Wan, Kling ইত্যাদি) দিয়ে পুনরায় সংগ্রহ করুন
- Bluesky-এর searchPosts API 403 সমস্যা সমাধানে বিকল্প সার্চ পদ্ধতি বিবেচনা করুন
- Qwen-Image-2.1 ও LTX 2.5-এর গ্রহণের প্রবণতা ওপেন-সোর্স সূচক হিসেবে নিয়মিত পর্যবেক্ষণ করুন
- ক্লোজড-সোর্স প্রতিষ্ঠানের অপব্যবহার ও বিতর্কের খবর (Nano Banana/Google Earth, Grok Imagine মামলা) অগ্রাধিকার দিয়ে অনুসরণ করুন
- Reddit-এ একাধিক সার্চ কুয়েরি ব্যবহার করে সংগ্রহের পরিসর বাড়ান, যাতে প্রায় ২০টি পোস্টের সমাপ্তি-মানদণ্ডে পৌঁছানো যায়
সংগৃহীত ছবি


















































ডেটা-মানের নোট
X-এ সার্চ শব্দ নির্বাচনের ভুলে থিম-বহির্ভূত ডেটাই পাওয়া গেছে, ফলে কার্যত ডেটা নেই। Bluesky ও Reddit-ও প্রায় ২০টি পোস্টের সমাপ্তি-মানদণ্ডে পৌঁছাতে পারেনি; অন্যদিকে Lemmy, Pinterest ও YouTube মোটামুটি যথেষ্ট পরিমাণ নমুনা যাচাই করতে পেরেছে।



