ছবি ও ভিডিও জেনারেশন AI নিউজ — 2026-09-20
ওপেন-সোর্স (বিশেষ করে চীনা উৎসের Qwen, Wan ও MiniMax-H3-এর মতো মডেল) দ্রুতই ক্লোজড-সোর্সের ফ্রি টিয়ার শেষ হয়ে যাওয়া ব্যবহারকারীদের বিকল্পে পরিণত হচ্ছে। অন্যদিকে, X পর্যায়ে অপ্রাসঙ্গিক সার্চ টার্মের কারণে কোনো কার্যকর ডেটা পাওয়া যায়নি, ফলে এই পর্বের প্রমাণ কার্যত পাঁচটি প্ল্যাটফর্মে সীমাবদ্ধ।
ছবি ও ভিডিও জেনারেশন AI নিউজের সারসংক্ষেপ 〜ক্লোজড বনাম ওপেন সোর্স〜 — 2026-09-20
হ্যালো! এবার Reddit, X, YouTube, Bluesky, Lemmy ও Pinterest—এই ছয় প্ল্যাটফর্ম দ্রুত দেখে এলাম🔥🔥 সংক্ষেপে বললে, ক্লোজড-সোর্স শিবির (Google Veo/Nano Banana, Sora 2, Midjourney, Kling, Seedance প্রভৃতি) এখনও খবরের মূল চরিত্র, এবং “অডিও সিঙ্ক” সত্যিই স্ট্যান্ডার্ড ফিচারে পরিণত হচ্ছে। তবে ওপেন-সোর্স শিবির—বিশেষ করে চীনা Qwen, Wan ও MiniMax-H3—অবিশ্বাস্য গতিতে এগোচ্ছে এবং ফ্রি টিয়ার শেষ হয়ে যাওয়া ব্যবহারকারীদের “আশ্রয়” হিসেবে জোরালো উপস্থিতি তৈরি করেছে🚀 আরও একটি নীরব কিন্তু গুরুত্বপূর্ণ বিষয় হলো, AI-তৈরি কনটেন্টের বিরুদ্ধে প্রতিক্রিয়া AI-অনুরাগী কমিউনিটির চেয়ে সাধারণ মানুষের আড্ডাস্থলগুলোতেই বড় আকার নিচ্ছে😤। তবে খোলাখুলি বললে, X পর্যায়টি পুরোপুরি ব্যর্থ হওয়ায় এই রিপোর্টের ভিত্তি পাঁচটি প্ল্যাটফর্মের ডেটা🙏
বিভিন্ন প্ল্যাটফর্মজুড়ে
- ওপেন-সোর্স পক্ষের গতি সত্যিই থামছে না: Reddit-এ Wan, Minimax H3 ও Krea2 ক্লোজড মডেলের ফ্রি টিয়ার শেষ হওয়ার পর বিকল্প হিসেবে একাধিক থ্রেডে উঠে এসেছে। Lemmy-র
!stable_diffusionকমিউনিটিতে শুধু সেপ্টেম্বরে MiniMax-H3-এর জন্য ১৫টির বেশি ComfyUI টুল পোস্ট হয়েছে। YouTube-এ Qwen-Image→Qwen-Image-2512→Z-Image এবং Wan 2.5→2.6→2.7 প্রায় মাসিক হারে আপডেট হচ্ছে। “ওপেন সোর্স = বিনা খরচে উচ্চমান”—এটি প্রায় ডি-ফ্যাক্টো ধারণায় পরিণত হচ্ছে💪 - ক্লোজড ভিডিও জেনারেশনে “অডিওসহ” এখন স্বাভাবিক: Bluesky-তে Replicate ঘোষিত Kling 3.0-এর সিঙ্ক্রোনাইজড অডিও ও Seedance 2.0-এর অডিও-ভিডিও সমন্বয়, এবং YouTube-এ Grok Imagine 1.5-এর সংলাপ ও পরিবেশের শব্দ একসঙ্গে তৈরির কথা—একই প্রবণতা নিশ্চিত করেছে🎬🔊
- Google-এর Veo/Nano Banana পরিবার ক্লোজড মডেলের “মুখ” হয়ে উঠছে: Pinterest-এ Veo-এর উষ্ণ Pixar-ধাঁচের ভিডিও বারবার ভাইরাল ভিজ্যুয়াল হিসেবে ব্যবহৃত হচ্ছে; YouTube-এ Theo - t3.gg সরাসরি বলছে “Google won image generation”; Reddit-এ Google Flow-এর বর্ধিত ফ্রি টিয়ার আলোচনায় এসেছে—তিন দিক থেকেই বিষয়টি নিশ্চিত হয়েছে👀
- AI-তৈরি কনটেন্টের বিরোধিতা AI-অনুরাগীদের গণ্ডির বাইরে বিস্ফোরিত হচ্ছে: Reddit-এ ArtPrize-এর AI কাজ গ্রহণ নিয়ে ক্ষোভ 354pt, কর্মক্ষেত্রে AI ছবি ব্যাপক উৎপাদনের কোটা নিয়ে আর্তনাদ 63pt। Lemmy-তে অ্যান্টি-AI কমিউনিটি
!fuck_ai-এর মাসিক সক্রিয় ব্যবহারকারী 9,179, যা Lemmy-র অন্যতম বৃহৎ কমিউনিটি। Pinterest-এ “Real vs AI” আসল-নকল শনাক্তের কুইজ আলাদা ঘরানা হয়ে গেছে😨 - প্রাথমিক তথ্যের উৎস কোম্পানির চেয়ে “ব্যক্তি” বেশি: Bluesky-তে কর্পোরেট অফিসিয়াল অ্যাকাউন্ট প্রায় নীরব; Simon Willison-এর মতো স্বতন্ত্র গবেষক এবং Replicate-এর মতো হোস্টিং অপারেটর তথ্যের উৎস। YouTube-এও ব্যক্তিগত চ্যানেলের সাপ্তাহিক সারাংশ—AIPOD-CAST ও Lev Selector—খবরের উৎস। অফিসিয়াল কোম্পানি-চালিত প্রাথমিক প্রচার চ্যানেল কম, এটি একটি সাধারণ প্রবণতা বলেই মনে হয়📢
প্ল্যাটফর্মভিত্তিক
Reddit: ৯টি সাবরেডিট থেকে ১২টি থ্রেড সংগ্রহ করা হয়েছে (লক্ষ্য ২০টিতে পৌঁছায়নি)। ওপেন-সোর্স Wan, Minimax H3 ও Krea2 ক্লোজড মডেলের ফ্রি টিয়ার শেষের বিকল্প—এই কথা একাধিক থ্রেডে বারবার এসেছে। অন্যদিকে GPT Image 2.5 Flare নিয়ে মতামত “incredible” বনাম “Krea2-এর মতোই”—দুই ভাগে বিভক্ত😂 সবচেয়ে আকর্ষণীয় বিষয়, AI-প্রযুক্তির সাবের তুলনায় সাধারণ কমিউনিটি (ArtPrize প্রতিক্রিয়া 354pt) ও বাস্তব কাজভিত্তিক সাবগুলোতে (ডিজাইনারদের অভিযোগ 63pt) তাপ বেশি ছিল।
X: সত্যি বলতে, এটি পুরোপুরি দুর্ঘটনা ছিল🙈 সংগৃহীত ৪০টি পোস্ট “Greenland”, “#Bitcoin”, “Chelsea”-র মতো সংযোগস্থল-নির্ভর (ক্রোয়েশিয়া অঞ্চলের) সাধারণ ট্রেন্ড সার্চ করে পাওয়া—ছবি/ভিডিও জেনারেশন AI-সংক্রান্ত পোস্ট শূন্য। ফলে এই দফায় X থেকে ক্লোজড বা ওপেন—কোনো দিকেই একটি অন্তর্দৃষ্টিও পাওয়া যায়নি। ব্রিফে নির্দিষ্ট করা প্ল্যাটফর্মে এটি একটি স্পষ্ট ফাঁক🕳️
YouTube: ১২টি ভিডিও পর্যালোচনা করা হয়েছে। ক্লোজড শিবির (Theo, Astrovah, Woollyfern—Midjourney মাসিক আপডেট বিশেষজ্ঞ, FixNode) এবং ওপেন-সোর্স শিবির (Bijan Bowen, HitPaw, MaxonShire, Promptus AI) সুন্দরভাবে পৃথক। ওপেন পক্ষ “ComfyUI”, “লোকাল রান”, “ফ্রি”-কে সামনে আনছে; ক্লোজড পক্ষ জোর দিচ্ছে গুণমান ও ফিচারে। তবে সার্চ ফলের পাতা অতিরিক্ত JavaScript-নির্ভর হওয়ায় ভিউ ও সাবস্ক্রাইবার সংখ্যা প্রায় পাওয়া যায়নি😅
Bluesky: অফিসিয়াল সার্চ API বারবার 403-এ ব্লক হওয়ায় Simon Willison, Max Woolf, Ethan Mollick-এর মতো গবেষক এবং Replicate-এর অফিসিয়াল পোস্ট অনুসরণ করে তথ্য সংগ্রহ করা হয়েছে। ফলস্বরূপ পাওয়া পোস্টগুলো প্রায় সবই ক্লোজড-সোর্স—GPT Image 2, Runway Gen-4.5, Kling 3.0, Seedance 2.0 ও Vidu Q3। সক্রিয় ওপেন-সোর্স কমিউনিটি অ্যাকাউন্ট পাওয়া যায়নি; একমাত্র প্রাসঙ্গিক মনে হওয়া অ্যাকাউন্টটিও ২০২৫ সালের ফেব্রুয়ারিতে নিষ্ক্রিয়। “সাইকেল চালানো পেলিক্যান” ছবিটি মডেল তুলনার প্রচলিত রসিকতা হয়ে উঠেছে🐦🚲
Lemmy: ওপেন ও ক্লোজড শিবির সবচেয়ে স্পষ্টভাবে আলাদা, এবং ভারসাম্যও এখানে সবচেয়ে ভালো। ওপেন দিকে !stable_diffusion কমিউনিটিতে MiniMax-H3-এর ঢল এবং নতুন মডেল Boogu-Image-0.1 (Apache-2.0, ১০ বিলিয়ন প্যারামিটার)। ক্লোজড দিকে Google Nano Banana 2 Lite, Microsoft MAI-Image-2.5, Sora 2 দিয়ে দীর্ঘ গল্প তৈরির পরীক্ষা এবং Midjourney-এর “মেডিক্যাল স্পায় পিভট” করার চমকপ্রদ খবর😲 অ্যান্টি-AI কমিউনিটি !fuck_ai-এর (8,252 সদস্য) দৃশ্যমানতাও Lemmy-র নিজস্ব বিশেষ আবিষ্কার।
Pinterest: কর্মীর আগাম সংগৃহীত ৫০টি পিনের মধ্যে ছবি-সহ ৩০টি যাচাই করা হয়েছে। ক্লোজড-সোর্স টুল তালিকা ও পুনর্ব্যবহৃত “AI NEWS” থাম্বনেইল টেমপ্লেট ব্যাপক, আর ওপেন-সোর্সের উপস্থিতি প্রায় নেই—শুধু Amuse 3.0 নামের একটি লোকাল টুল একবার দেখা গেছে। Google Veo-এর ভিজ্যুয়াল অস্বাভাবিকভাবে পুনর্ব্যবহৃত, এবং “এটি AI নাকি আসল?” যাচাই কুইজ একটি স্বতন্ত্র ঘরানায় পরিণত হয়েছে🎨
নজরে রাখুন
- MiniMax-H3-এর জন্য ComfyUI টুলের দ্রুত বৃদ্ধি (Lemmy
!stable_diffusion, উদাহরণ: https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS) — ওপেন-সোর্স ভিডিও জেনারেশনের নতুন প্রধান চরিত্র হওয়ার সম্ভাবনা🔥 - Sora 2-এর “production memory” সমস্যা (Lemmy হয়ে Reddit, https://lemmy.durstig.online/post/59922) — একক ক্লিপের চেয়ে দীর্ঘমেয়াদি ধারাবাহিকতা বজায় রাখাই পরবর্তী বড় বাধা হতে পারে
- Google Nano Banana Pro-এর একচ্ছত্র দৌড়ের দাবি (YouTube・Theo - t3.gg, https://www.youtube.com/watch?v=UV9GqinedQ8) — “Photoshop লাগবে না” পর্যায়ে সত্যিই পৌঁছেছে? পরের খবরের অপেক্ষা
- GPT Image 2.5 Flare বনাম ওপেন-সোর্স Krea2 বিতর্ক (Reddit, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) — পেইড সংস্করণের প্রকৃত সুবিধাই প্রশ্নের মুখে
- ArtPrize-এর AI কাজ গ্রহণের প্রশ্ন (Reddit r/grandrapids, https://www.reddit.com/r/grandrapids/comments/1wi4ub0/) — সাধারণ সমাজে গ্রহণযোগ্যতার সীমা মাপার সূচক হতে পারে
- Midjourney-এর মেডিক্যাল স্পায় রূপান্তর ও হলিউডের প্রকাশ-দাবি (Lemmy, https://lemmy.zip/post/66397234 、https://lemmy.today/post/56011946) — কোম্পানি হিসেবে বিশ্বাসযোগ্যতার ঝুঁকি দেখা দিচ্ছে
সুপারিশ
- X পর্যায়ে "Sora 2" "Midjourney" "Stable Diffusion" "Runway Gen" "Kling AI" "open source image generation"-এর মতো বিষয়-সংশ্লিষ্ট সার্চ টার্ম দিয়ে পুনরায় সংগ্রহ করুন।
- MiniMax-H3, Qwen, Wan ও Z-Image-এর মতো চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের হার প্রতিবার ওয়াচলিস্টে রাখুন।
- AI-কেন্দ্রিক সাবের পাশাপাশি সাধারণ ও পেশাভিত্তিক কমিউনিটির প্রতিক্রিয়াও নিয়মিত অনুসরণ করুন; কারণ প্রতিক্রিয়ার সংকেত সেখানে বেশি শক্তিশালী।
- Bluesky অফিসিয়াল সার্চ API-এর 403 সমস্যার বিকল্প সমাধান পরবর্তীবারের আগে যাচাই করুন।
- Sora 2-এর “production memory” সমস্যা এবং Midjourney-এর মেডিক্যাল স্পায় রূপান্তর পরবর্তী রানেও অনুসরণ করুন।
- Pinterest সংগ্রহে ঘরানা-ট্যাগ যুক্ত করুন, যাতে ওপেন/ক্লোজড মডেল যান্ত্রিকভাবে আলাদা করা যায়।
ডেটার গুণমান
X পর্যায়ে ব্যবহৃত সার্চ টার্ম বিষয়ের সঙ্গে সম্পর্কহীন—ভূরাজনীতি, ক্রিপ্টোকারেন্সি ও ফুটবলের মতো বিষয়—হওয়ায় সংগৃহীত ৪০টি পোস্টের মধ্যে বিষয়-সম্পর্কিত পোস্ট ছিল ০টি; কার্যত ব্যবহারযোগ্য ডেটা ছিল না। Reddit (১২টি) ও Bluesky (সার্চ API ব্লক থাকায় ব্যক্তিগত অ্যাকাউন্ট থেকে প্রায় ১২টি) ব্রিফের “প্রতি প্ল্যাটফর্মে প্রায় ২০টি” সম্পন্নতার মানদণ্ডে পৌঁছায়নি। Pinterest ও YouTube-তেও আংশিক সীমাবদ্ধতা ছিল—Pinterest-এ ঘরানা-ট্যাগ নেই এবং লাইভ ব্রাউজিং হয়নি, আর YouTube-এ ভিউ ও সাবস্ক্রাইবার সংখ্যা JavaScript-নির্ভর হওয়ায় পাওয়া যায়নি। তবু সারাংশের জন্য যথেষ্ট তথ্য পাওয়া গেছে। Lemmy ও YouTube তুলনামূলকভাবে নির্ভরযোগ্য ছিল এবং ওপেন/ক্লোজড উভয় দিক নিয়ে নির্দিষ্ট অন্তর্দৃষ্টি দিতে পেরেছে।
প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ
Reddit — ছবি ও ভিডিও জেনারেশন AI নিউজ
কোথায়
সংগৃহীত ১২টি থ্রেড এসেছে ৯টি সাবরেডিট থেকে।
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত থ্রেড |
|---|---|---|
| r/generativeAI | 154,961 | 4 |
| r/graphic_design | 2,929,382 | 1 |
| r/GeminiAI | 375,783 | 1 |
| r/grandrapids | 161,719 | 1 |
| r/aitubers | 28,785 | 1 |
| r/ImagineAiArt | 19,335 | 1 |
| r/AIToolTalks | 6,757 | 1 |
| r/aifilmmaking | 8,200 | 1 |
| r/aivideomaking | 7,267 | 1 |
r/generativeAI হলো AI ছবি ও ভিডিও জেনারেশন নিয়ে কেন্দ্রীয় হাব (৪টি পোস্ট)। r/GeminiAI ও r/ImagineAiArt-এ ক্লোজড-সোর্স মডেলের অভিজ্ঞতা, r/aifilmmaking ও r/aivideomaking-এ ভিডিও প্রযোজনার বাস্তব কাজের দৃষ্টিভঙ্গি, r/grandrapids ও r/graphic_design-এ AI-তৈরি কনটেন্ট বাস্তব জগৎ—শিল্প প্রতিযোগিতা ও কর্মক্ষেত্র—মুখোমুখি হলে প্রতিক্রিয়া, আর r/AIToolTalks AI নিয়ে সার্বিক উদ্বেগের আশ্রয়স্থল।
মানুষ কী বলছে
- থ্রেড ১ “Which AI video generator can still be used for free?” (r/generativeAI・18pt・57 মন্তব্য・2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — ক্লোজড-সোর্সের ফ্রি টিয়ার শেষ হলে ওপেন-সোর্স/লোকাল জেনারেশন (Wan, Minimax) বিকল্প হয়ে ওঠে। u/RioMetal: “If you can go local you have plenty of them, like Wan or Minimax”
- থ্রেড ২ “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (r/ImagineAiArt・84pt・60 মন্তব্য・2026-09-16) https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ — মতামত সম্পূর্ণ বিভক্ত। u/oldboi777 একে “incredible upgrade” বললেও u/SeaworthinessFresh16 বলেছে, “The result in Comfyui with Krea2 looks the same”—অর্থাৎ ওপেন-সোর্স Krea2-এর সঙ্গে বড় পার্থক্য নেই।
- থ্রেড ১২ “Need a good video generation AI for image to video of people” (r/generativeAI・0pt・22 মন্তব্য・2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ — ক্লোজড-সোর্স Google Flow / Nano Banana Pro-এর সেন্সরশিপ ফিল্টার নিয়ে অভিযোগ পোস্টের মূল বিষয়। u/f5alcon: “Minimax H3 is the best local generator”; u/jworm0624: “Krea 2 turbo for images, minimax h3 for videos. All on comfyui”—ওপেন-সোর্স বিকল্পের সুপারিশ।
- থ্রেড ৭ “Google Flow is giving creators a surprisingly generous amount of free AI video generation right now” (r/aifilmmaking・8pt・7 মন্তব্য・2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — ক্লোজড-সোর্স Google Flow/Veo ফ্রি ক্রেডিট বাড়িয়েছে; শুধু টেক্সট-টু-ভিডিও থেকে দৃশ্য নির্মাণ, ক্যামেরা নিয়ন্ত্রণ ও রেফারেন্স অ্যাসেটসহ প্রোডাকশন ওয়ার্কস্পেসে রূপান্তরিত হচ্ছে। তবে u/MrBoondoggles-এর শীতল মন্তব্য: “I'm not surprised Google is giving away Veo at this point... trying to maintain some interest in their product”
- থ্রেড ৮ “Did Anyone Notice Sudden Quality Drop of Image Generation? From 2 MB to 500 KB” (r/GeminiAI・10pt・25 মন্তব্য・2026-09-17) https://www.reddit.com/r/GeminiAI/comments/1wj02p4/ — ক্লোজড-সোর্স Gemini-তে ছবির মান কমা—PNG→JPEG, 8MB→2MB→500KB—নিয়ে অভিযোগ, পেইড ব্যবহারকারীরাও অসন্তুষ্ট। u/Well_HellooF: “there's no difference in quality between the free version and the paid one. suck”
- থ্রেড ৫ “ArtPrize Allows Generative AI” (r/grandrapids・354pt・176 মন্তব্য・2026-09-16) https://www.reddit.com/r/grandrapids/comments/1wi4ub0/ — শিল্প প্রতিযোগিতায় AI-তৈরি কাজ গ্রহণ নিয়ে প্রবল বিরোধিতা। u/Chirotera (319pt): “Fucking disgusting. It is not AI "Art," it's fucking theft.” প্রযুক্তি সাবের তুলনায় সাধারণ কমিউনিটির ক্ষোভ বেশি।
- থ্রেড ১০ “Company expects us to generate 500 AI images PER WEEK. Is this realistic?” (r/graphic_design・63pt・133 মন্তব্য・2026-09-17) https://www.reddit.com/r/graphic_design/comments/1wieke2/ — কর্মক্ষেত্রের ডিজাইনাররা ক্লোজড-সোর্স টুল ChatGPT ব্যবহার করে ব্যাপক উৎপাদনের কোটায় বিপর্যস্ত। u/Diligent-Educator409 (123pt): “500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no.”
- থ্রেড ৯ “best apps for generating AI videos” (r/aitubers・0pt・46 মন্তব্য・2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — স্ক্রিপ্ট থেকে স্বয়ংক্রিয় ভিডিও বানানো ক্লোজড-সোর্স টুল InVideo AI, Steve AI ইত্যাদির চাহিদা আছে, কিন্তু কমিউনিটির প্রতিক্রিয়া ঠান্ডা। u/RobJames007 (15pt): “Youtube is trying to reduce AI slop, not allow more of it onto the platform.”
- থ্রেড ৩ “Please help me generate free ai video without subscription” (r/aivideomaking・0pt・20 মন্তব্য・2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ — u/Chance-Business বলেছে “google flow you get 50 free credits per day, each vid is 6-12 credits”; আর u/Bastisheen92 বলেছে “Local Generation is free if you already own the Hardware”—ক্লোজডের ফ্রি টিয়ার বনাম ওপেনের লোকাল রান-এর পরিচিত বৈপরীত্য।
- থ্রেড ১১ “Are all of you also anxious about recent news about AI?” (r/AIToolTalks・12pt・36 মন্তব্য・2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — এটি সরাসরি ছবি/ভিডিও জেনারেশন নয়; AI-এর পানি ব্যবহার, কর্মসংস্থান ক্ষতি ও নিয়ন্ত্রণ নিয়ে উদ্বেগের আলোচনা। মন্তব্যে তীব্র মতবিরোধ—u/Big-Pops78 পানি ব্যবহারের উদ্বেগকে আপেক্ষিক করে, অন্যদিকে u/UnburyingBeetle “cost efficiency” শব্দটি ব্যঙ্গ করে পাল্টা জবাব দেয়।
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: Wan, Minimax H3, LTX Video ও Krea2-এর মতো ওপেন-সোর্স/লোকাল মডেলের নাম একাধিক স্বাধীন থ্রেডে (১, ২, ১২) একই প্রসঙ্গে—ক্লোজড মডেলের ফ্রি টিয়ার শেষ হওয়ার পর বিকল্প—বারবার উঠছে। লোকাল জেনারেশন “বিনামূল্যে উচ্চমান”-এর প্রতিশব্দ হয়ে উঠছে।
- অবজ্ঞা বা ব্যঙ্গের লক্ষ্য: “ফ্রি” দাবি করা ক্লোজড-সোর্স ভিডিও জেনারেশন সেবা নিয়ে ব্যঙ্গ তীব্র। একাধিক থ্রেডে (১, ৪, ৬, ১২) বট অ্যাকাউন্ট u/Jenna_AI একই ধরনের দীর্ঘ ব্যঙ্গাত্মক মন্তব্য করেছে—ফ্রি বললেও শেষে অর্থ দিতে হয়—যা কমিউনিটির সংশয়ী আবহকে প্রতিফলিত করে।
- অপ্রত্যাশিত দিক: প্রযুক্তি-কেন্দ্রিক সাবরেডিটের চেয়ে সাধারণ কমিউনিটি (r/grandrapids, 354pt・176 মন্তব্য) এবং কাজকেন্দ্রিক সাব (r/graphic_design, 63pt・133 মন্তব্য)-এ AI প্রযুক্তি সাবগুলোর তুলনায় বেশি এনগেজমেন্ট ও স্কোর। AI-তৈরি কনটেন্ট দৈনন্দিন জীবন বা কাজের সঙ্গে সংঘর্ষে এলে প্রতিক্রিয়া ও বিতর্ক বাড়ে।
- মতবিরোধ: থ্রেড ২-এ GPT Image 2.5 Flare নিয়ে “incredible upgrade” (u/oldboi777) ও “Krea2-এর মতোই ফল” (u/SeaworthinessFresh16)—বিপরীত মূল্যায়ন। থ্রেড ৭-এও Google Flow/Veo-কে “free credits are generous” বলার পাশাপাশি “it's weak at physics and logic. Even Minimax is far better” (u/Sea-Temporary-6995) মত রয়েছে।
সীমাবদ্ধতা
- সংগৃহীত থ্রেড ১২টি, ব্রিফের সম্পন্নতার মানদণ্ড—প্রতি প্ল্যাটফর্মে প্রায় ২০টি পোস্ট বিশ্লেষণ—পূরণ হয়নি। কর্মীর সংগ্রহ করা এই ১২টিই Reddit-এর জন্য উপলব্ধ পূর্ণ ডেটা, এবং প্লেবুকের নির্দেশ অনুযায়ী এ পর্যায়ে অতিরিক্ত Reddit অনুসন্ধান বা ব্রাউজিং করা যায়নি।
- শুধুমাত্র ইংরেজি “Image and Video Generation AI News” কুয়েরি ব্যবহার হয়েছে; জাপানি কুয়েরি বা “ওপেন সোর্স”, “ক্লোজড সোর্স”-এর মতো দৃষ্টিভঙ্গিভিত্তিক কুয়েরি ব্যবহারের কোনো চিহ্ন নেই।
- r/aitubers, r/aivideomaking ও r/AIToolTalks-এর মতো কিছু সাবরেডিট থেকে মাত্র একটি করে থ্রেড নেওয়া হয়েছে; ফলে তাদের অভ্যন্তরীণ প্রবণতার শক্তি নির্ণয় করা যায় না।
X
X — ছবি ও ভিডিও জেনারেশন AI (ক্লোজড/ওপেন সোর্স) নিউজ
অ্যাকাউন্ট
এবার output/x.posts.md-তে সংগৃহীত ৩৯টি অ্যাকাউন্ট ও ৪০টি পোস্ট সবকটিই ছবি/ভিডিও জেনারেশন AI-এর সঙ্গে সম্পর্কহীন। সার্চ টার্ম ছিল “Greenland”, “Denmark”, “#Bitcoin”, “NATO”, “Christ”, “Jubjub”, “Charles”, “Bosnia”, “Chelsea”, “Belgrade”—এসব X-এর নিজস্ব Explore ট্রেন্ড থেকে সরাসরি নেওয়া সাধারণ ট্রেন্ড, যা সার্ভারের সংযোগ উৎস ক্রোয়েশিয়া অঞ্চলে ভূ-অবস্থানকৃত হওয়ার প্রভাব। গবেষণা ব্রিফের ছবি ও ভিডিও জেনারেশন AI বিষয়ের সঙ্গে সম্পর্কিত কোনো সার্চ টার্মই ছিল না।
তাই এই ডেটা দিয়ে “X-এ এই বিষয়টি কারা নেতৃত্ব দিচ্ছে” বলা সম্ভব নয়। কী সংগৃহীত হয়েছিল, শুধু তা নিচে দেওয়া হলো:
- রাজনীতি/ভূরাজনীতি ক্লাস্টার: @RapidResponse47 (30,291 লাইক, গ্রিনল্যান্ড-সংক্রান্ত), @AJENews, @Rusia_HD, @Globalsurv, @NepCorres প্রমুখ—গ্রিনল্যান্ড, ডেনমার্ক ও NATO ঘিরে খবর/মতামত পোস্ট।
- ক্রিপ্টোকারেন্সি ক্লাস্টার: @aacryptoverse, @Bitcoin_Pirate_, @StackandRun, @bitcr_org প্রমুখ—#Bitcoin ট্যাগের পোস্ট; লাইক সাধারণত এক অঙ্ক থেকে কয়েক দশক।
- রাজপরিবারের গসিপ ক্লাস্টার: @barristerlawusa, @hernandez_64876, @thebluestshade, @Rimmesfk—“Charles” অর্থ চার্লস স্পেন্সারের প্রকাশিত স্মৃতিকথা ঘিরে আলোচনা।
- ফুটবল ক্লাস্টার: @icunga_, @john322226, @Cfc_Kemboi, @Pats_Aura—“Chelsea” অর্থ Chelsea FC-এর ম্যাচ ফলাফল।
- মিম/আড্ডা ক্লাস্টার: @SardineKing_O, @isellbeforeyou, @0xHeatt—“$jubjub” ক্রিপ্টো-মিম কয়েন; @MarquiseDeBelgr-এর সার্বিয়ান ভাষার কথোপকথনমূলক পোস্ট দুটি।
কোনো অ্যাকাউন্টে ১–২টির বেশি পোস্ট নেই; ধারাবাহিকভাবে অসাধারণ সক্রিয় অ্যাকাউন্টও নেই। @RapidResponse47-এর একটি পোস্ট—৩০ হাজার লাইক ও প্রায় ৬.৮ মিলিয়ন ভিউ—সেটের মধ্যে ব্যতিক্রমী, কিন্তু তা গ্রিনল্যান্ডের সার্বভৌমত্ব প্রশ্নে এবং এই বিষয়ের সঙ্গে সম্পর্কহীন।
পোস্ট
ছবি ও ভিডিও জেনারেশন AI—ক্লোজড বা ওপেন সোর্স—উল্লেখকারী পোস্ট সংগৃহীত ৪০টির মধ্যে ০টি। ফলে “প্রতিনিধিত্বশীল পোস্ট” দেখানোর মতো কিছু নেই। নমুনার প্রকৃতি বোঝাতে সর্বোচ্চ এনগেজমেন্টের একটি পোস্ট নিচে দেওয়া হলো; এটি বিষয়বহির্ভূত:
- @RapidResponse47 (বিষয়বহির্ভূত・শুধু রেফারেন্স) — 30,291 likes・5,022 reposts・1,164 replies・প্রায় 6,800,000 views・2026-09-18।https://x.com/RapidResponse47/status/2101059494587285834 “Greenland” সার্চে পাওয়া। গ্রিনল্যান্ডের সার্বভৌমত্ব নিয়ে রাজনৈতিক পোস্ট; AI-তৈরি ছবি বা ভিডিওর সঙ্গে সম্পর্কহীন।
সংকেত
- X পর্যায়ের ডেটায় ছবি ও ভিডিও জেনারেশন AI—Midjourney, Sora, Runway, Stable Diffusion, Flux, Wan, Kling ইত্যাদি—সংক্রান্ত কোনো উল্লেখ, আলোচনা বা খবর একটিও পাওয়া যায়নি। কী আলোচিত হচ্ছে বা হচ্ছে না, তা বিচার করার উপাদানই নেই।
- ব্যবহৃত সার্চ টার্ম—Greenland, Denmark, #Bitcoin, NATO, Christ, Jubjub, Charles, Bosnia, Chelsea, Belgrade—
output/x.posts.md-এর শুরুতে থাকা “X's own Explore list” শিরোনামের সঙ্গে পুরোপুরি মিলে যায়। অর্থাৎ ভূরাজনীতি, রাজপরিবারের গসিপ, ফুটবল ও ক্রিপ্টো মিমের স্থানীয় ট্রেন্ড সার্চ করা হয়েছে; বিষয়ভিত্তিক “image generation AI”, “video generation AI”, “Sora”, “Midjourney”, “Stable Diffusion”, “open source AI” ইত্যাদি একবারও ব্যবহার হয়নি। - তাই এই পর্যায় থেকে ক্লোজড-সোর্স বা ওপেন-সোর্স—কোনো দিকেরই একটি অন্তর্দৃষ্টি বের করা যায় না।
সীমাবদ্ধতা
- সংগ্রহ নিজেই বিষয়ের সঙ্গে মিলেনি।
output/x.posts.md-এর ১০টি সার্চ টার্মের একটিও ছবি/ভিডিও জেনারেশন AI-সম্পর্কিত নয়; এগুলো ভূরাজনীতি, রাজপরিবারের গসিপ, ফুটবল ও ক্রিপ্টো মিমের Explore ট্রেন্ড। কর্মী একবারও ক্লোজড/ওপেন ছবি ও ভিডিও AI-সংক্রান্ত সার্চ চালাননি। ফলে X পর্যায়ের “প্রায় ২০টি বিষয়-সম্পর্কিত পোস্ট” বিশ্লেষণের সম্পন্নতার মানদণ্ড পূরণ হয়নি। - ৪০টি পোস্ট বিশ্লেষণ করা হলেও ছবি/ভিডিও জেনারেশন AI উল্লেখকারী পোস্ট ছিল শূন্য।
output/x.posts.json-এও একই ডেটা, তাই অতিরিক্ত কোনো সূত্র পাওয়া যায়নি।- এই রানের X পর্যায়ের একমাত্র সিদ্ধান্ত: সংগৃহীত সার্চ টার্ম ও পোস্টের ভিত্তিতে ছবি ও ভিডিও জেনারেশন AI-এর ক্লোজড বা ওপেন-সোর্স প্রবণতা নিয়ে X থেকে কোনো অন্তর্দৃষ্টি দেওয়া সম্ভব নয়। “Sora 2”, “Midjourney”, “Stable Diffusion”, “Runway Gen”, “Kling AI”, “Flux”, “open source image generation”-এর মতো সার্চ টার্মে পুনরায় সংগ্রহ দরকার।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI-এর (ক্লোজড সোর্স/ওপেন সোর্স) সাম্প্রতিক প্রবণতা
চ্যানেল
ক্লোজড-সোর্সমুখী
- Theo - t3.gg(@t3dotgg)— Google Nano Banana Pro-এর প্রযুক্তিগত বিশ্লেষণ
- Astrovah(@astrovah)— Sora 2 রিভিউ ও ব্যবহারিক উদাহরণ
- Woollyfern(@woollyferncreative)— Midjourney মাসিক আপডেট-কেন্দ্রিক চ্যানেল
- FixNode(@Fixnode1)— Runway Gen-4.5 টিউটোরিয়াল
- Higher E-Learning(@higherelearning)— Adobe Firefly-তে একীভূত মডেল যাচাই
- AIPOD-CAST(@AIPOD-CAST)— সাপ্তাহিক AI নিউজ সারাংশ (Episode 220-এর আশপাশ)
- Lev Selector(@lev-selector)— সাপ্তাহিক AI আপডেট সারাংশ
ওপেন-সোর্সমুখী
- Bijan Bowen(@Bijanbowen)— Qwen Image-এর লোকাল টেস্ট
- HitPaw Edimakor(@HitPawEdimakorOfficial)— Wan সিরিজের রিভিউ ও ব্যবহারপদ্ধতি
- MaxonShire(@MaxonShire)— ওপেন-সোর্স ভিডিও মডেল তুলনামূলক পরীক্ষা
- Promptus AI(@promptusai)— Z-Image-এর মতো নতুন মডেল লোকালি সেটআপের গাইড
- 黎黎原上啃 / SweetValberry(@SweetValberry)— FLUX.1 Kontext-সহ চীনা ভাষাভাষী ব্যাখ্যামূলক কনটেন্ট
কোনো চ্যানেল পাতাতেই সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি (নিচের সীমাবদ্ধতা দেখুন), তাই আকার বা পরিসর যাচাই করা যায়নি।
ভিডিও
-
“Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN” — Theo - t3.gg/প্রকাশকাল অজানা (Nano Banana Pro নিজে 2025-11-20-এ ঘোষিত, ভিডিওটি তার পরে)/ভিউ অজানা
https://www.youtube.com/watch?v=UV9GqinedQ8
Gemini 3 Pro-ভিত্তিক Nano Banana Pro-এর ছবি তৈরির মান “Photoshop লাগবে না” পর্যায়ের এবং ক্লোজড-সোর্স প্রতিদ্বন্দ্বীদের মধ্যে স্পষ্টতই এগিয়ে—এমন দাবি। -
“Sora 2 - An Honest Review As Well As 20 Creative Use Cases To Try” — Astrovah/2025-10-07/ভিউ অজানা
https://www.youtube.com/watch?v=pJHWIgri5vk
Sora 2-কে “এ পর্যন্ত সবচেয়ে বাস্তবসম্মত AI ভিডিও” হিসেবে মূল্যায়ন করে এবং কাজের ক্ষেত্রে ব্যবহারের ২০টি ধরন দেখায়। -
“Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More!” — Woollyfern/2026-07/ভিউ অজানা
https://www.youtube.com/watch?v=dvfH5HzCARY
Midjourney V8.2-তে personalization এবং NIJI-এর জন্য style creator যুক্ত হয়েছে—মাসিক সিরিজের সর্বশেষ পর্ব। -
“I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)” — Higher E-Learning/2026-07/ভিউ অজানা
https://www.youtube.com/watch?v=nOSYufWVdq8
Adobe Firefly-তে Veo 3.1, Kling 3.0, Runway Gen-4.5 ও Sora 2 পর্যন্ত একীভূত হওয়ার পর সব মডেলের পাশাপাশি পরীক্ষা। -
“Ultimate Runway Gen 4.5 Tutorial For New Users in 2026” — FixNode/2026-03-29/ভিউ অজানা
https://www.youtube.com/watch?v=IUge3u4ZrqQ
Runway Gen-4.5-এর image-to-video টিউটোরিয়াল; সিনেমাটিক টেক্সচারের ওপর জোর। -
“Episode 222: Weekly AI News Summary - 6 September 2026” — AIPOD-CAST/2026-09-06/ভিউ অজানা
https://www.youtube.com/watch?v=8f34nSLdNtk
মডেল, এজেন্ট ও ব্যবসায়িক গতিপ্রকৃতি নিয়ে সাপ্তাহিক সারাংশে ছবি/ভিডিও জেনারেশন AI নিউজও রয়েছে। -
“Exciting AI Updates Weekly - September 18, 2026” — Lev Selector/2026-09-18/ভিউ অজানা
https://www.youtube.com/watch?v=Utu4zIcqPtM
ব্যক্তিগত চ্যানেলের গত সপ্তাহের AI আপডেটের দ্রুত সারাংশ। এই গবেষণায় সবচেয়ে সাম্প্রতিক পোস্ট। -
“Qwen Image-2512 First Test – The BEST Open Source Image Model!” — Bijan Bowen/প্রকাশকাল অজানা (মডেলটি 2025-12 সংস্করণ)/ভিউ অজানা
https://www.youtube.com/watch?v=SBaK616nP6Q
Alibaba-এর Qwen-Image-2512 (২০ বিলিয়ন প্যারামিটার) লোকালি পরীক্ষা করে একে বর্তমানের শক্তিশালী ওপেন-সোর্স ছবি মডেল বলা হয়েছে। -
“Wan 2.6 Review | How to Use Wan 2.6 for Free | New AI Video Generator Tutorial” — HitPaw Edimakor/প্রকাশকাল অজানা (মডেলটি 2025-12-এ প্রকাশিত)/ভিউ অজানা
https://www.youtube.com/watch?v=6FMisTHYYgA
Alibaba Wan 2.6 বিনা খরচে ব্যবহার ও রিভিউ; T2V/I2V/R2V-সহ নানা মোডের উল্লেখ। -
“HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?” — MaxonShire/2026-06-25/ভিউ অজানা
https://www.youtube.com/watch?v=4GNT4-QYekg
Tencent HunyuanVideo 1.5 ও Alibaba Wan 2.7 (2026-04-22 প্রকাশিত)—দুই প্রধান ফ্রি লোকাল ভিডিও মডেলের সরাসরি তুলনা। -
“Z-Image Open-Source Image Generator: Free Online and Local Setup” — Promptus AI/2026 (সুনির্দিষ্ট সময় অজানা)/ভিউ অজানা
https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Alibaba-এর Z-Image (৬ বিলিয়ন প্যারামিটার, S3-DiT আর্কিটেকচার) হালকা হলেও Flux 2 ও Qwen Image-এর চেয়েও ভালো গুণমান দিতে পারে—এমন পরিচিতি; ComfyUI সমন্বয়ও ব্যাখ্যা করা হয়েছে। -
“FLUX.1 Kontext [dev] is open source! Try image editing locally in ComfyUI” — 黎黎原上啃/2025 (Flux Kontext Dev প্রকাশের পর)/ভিউ অজানা
https://www.youtube.com/watch?v=v4pp3TdbWNw
Black Forest Labs-এর Flux Kontext Dev মডেলের ওজন প্রকাশের পর ComfyUI-তে লোকাল ছবি সম্পাদনার প্রদর্শনী। পুরোনো হলেও ওপেন-সোর্স ছবি সম্পাদনার ধারার সূচনাবিন্দু বোঝার জন্য অন্তর্ভুক্ত।
সংকেত
- ক্লোজড-সোর্স পক্ষ “মাসিক আপডেট” নিয়মিত করেছে: Midjourney-এর Woollyfern “Update” সিরিজ প্রতি মাসে ভিডিও প্রকাশ করছে; ২০২৬-এ V8→V8.1→V8.2 ধারাবাহিকভাবে এগিয়েছে। Runway ও Adobe Firefly-র বড় আপডেটও প্রযুক্তি চ্যানেলগুলো দ্রুত রিভিউ করছে।
- অডিও সিঙ্ক ক্লোজড-সোর্স ভিডিও জেনারেশনের মানক ফিচার হয়ে উঠছে: Kling 3.0 (৫ ভাষায় নেটিভ সংলাপ), Seedance 2.0 (অডিও-ভিডিওর সমন্বিত আর্কিটেকচার, প্রতিধ্বনি পর্যন্ত), Grok Imagine 1.5 (সংলাপ ও পরিবেশের শব্দ একসঙ্গে)—বহু ফলেই শব্দ ও দৃশ্য একসঙ্গে জেনারেশনের নকশা জোর দিয়ে বলা হয়েছে। প্রতিযোগিতার অক্ষ একক ভিজ্যুয়াল থেকে “অডিওসহ শর্ট মুভি” তৈরির দিকে সরে যাচ্ছে।
- বিশেষত চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের গতি ক্লোজড মডেলের সমান বা বেশি: শুধু Alibaba-তেই Qwen-Image→Qwen-Image-2512→Z-Image, Wan 2.5→2.6→2.7 অল্প ব্যবধানে এসেছে। Tencent HunyuanVideo 1.5 ও Lightricks LTX-2→2.3→2.5-ও প্রায় মাসিক বা ত্রৈমাসিক গতিতে উন্নত হচ্ছে। ভিডিও শিরোনামে “সেরা ওপেন সোর্স”, “অমুককে হারাল”—এমন ভাষা প্রচুর; দর্শকের আগ্রহের ইঙ্গিত।
- ওপেন-সোর্স ভিডিওর অধিকাংশই “ComfyUI”, “লোকাল রান”, “ফ্রি” প্রচার করে: HitPaw Edimacor, Promptus AI, MaxonShire প্রভৃতি চ্যানেল “বিনা খরচে ব্যবহার” ও “লোকাল GPU-তে চালানো”-কে সামনে আনে। বিপরীতে Theo, Astrovah ও Woollyfern-এর মতো ক্লোজড-সোর্স চ্যানেল গুণমান ও ফিচার রিভিউ-নির্ভর।
- সাপ্তাহিক AI নিউজ ফরম্যাটের চ্যানেল—AIPOD-CAST ও Lev Selector—ছবি/ভিডিও জেনারেশন AI-কে নিয়মিত সেগমেন্ট করেছে, যা দেখায় এটি একক খবর নয়, ধারাবাহিক নজরদারির বিষয়।
সীমাবদ্ধতা
- YouTube-এর সার্চ ফলের পাতা (
https://www.youtube.com/results?search_query=…) JavaScript দিয়ে ডায়নামিকভাবে রেন্ডার হয়। WebFetch-এ কেবল ফুটারের নেভিগেশন লিংক পাওয়া যায়, তাই HTML থেকে শিরোনাম, চ্যানেল, ভিউ ও প্রকাশের তারিখ পড়ার প্রত্যাশিত পদ্ধতি কাজ করেনি। - বিকল্প হিসেবে
site:youtube.comওয়েব সার্চে ভিডিও খুঁজে YouTube-এরoembedএন্ডপয়েন্টে শিরোনাম ও চ্যানেল নিশ্চিত করা হয়েছে। এতে ভিউ বা চ্যানেল সাবস্ক্রাইবার সংখ্যা একেবারেই পাওয়া যায়নি, তাই উপরের তালিকায় ভিউ “অজানা”। - একই কারণে কিছু ভিডিওর সঠিক প্রকাশের তারিখ নিশ্চিত করা যায়নি: Nano Banana Pro বিশ্লেষণ, Qwen Image-2512 টেস্ট, Wan 2.6 রিভিউ ও Z-Image পরিচিতি। সার্চ স্নিপেট ও সংশ্লিষ্ট মডেলের রিলিজ সময় থেকে কেবল আনুমানিক সময় দেওয়া হয়েছে।
- ভিডিওর বিবরণ ও টপ মন্তব্যও JavaScript-নির্ভর পৃষ্ঠার কারণে সরাসরি পড়া যায়নি।
- ৬০ দিনের মধ্যে—2026-07-22-এর পরের—পোস্টকে অগ্রাধিকার দেওয়া হলেও, Flux Kontext ও Runway Gen-4.5 টিউটোরিয়ালের মতো উভয় ধারার ইতিহাস বোঝার জন্য গুরুত্বপূর্ণ ১–২টি পুরোনো ভিডিও প্রেক্ষাপট হিসেবে অন্তর্ভুক্ত হয়েছে।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা
অ্যাকাউন্ট
- Simon Willison (@simonwillison.net) — স্বতন্ত্র AI গবেষক। নতুন মাল্টিমোডাল মডেল এলে নিজের “সাইকেল চালানো পেলিক্যান” ছবি বেঞ্চমার্ক দিয়ে ইমেজ জেনারেশন ক্ষমতা পরীক্ষা করেন। প্রায় ৫০ হাজার অনুসারী; ঘন ঘন পোস্ট করেন।
- Max Woolf (@minimaxir.bsky.social) — সাবেক BuzzFeed ডেটা বিজ্ঞানী। AI কনটেন্ট জেনারেশনের নৈতিকতা ও R&D-তে অভিজ্ঞ; ছবি মডেল রিলিজে প্রায়ই প্রতিক্রিয়া দেন।
- Ethan Mollick (@emollick.bsky.social) — Wharton-এর অধ্যাপক। AI-এর সার্বিক প্রবণতার আলোচনায় AI ভিডিওর গুণগত পরিবর্তনও উল্লেখ করেন।
- Replicate (@replicate.com) — মডেল হোস্টিং সেবার অফিসিয়াল অ্যাকাউন্ট। নতুন ক্লোজড-সোর্স ছবি বা ভিডিও মডেল প্ল্যাটফর্মে এলে ঘোষণা দেয়।
- Stability AI (@stabilityai.bsky.social) — Stable Diffusion-এর নির্মাতার অফিসিয়াল অ্যাকাউন্ট। তবে সাম্প্রতিক পোস্ট Stable Audio ও এন্টারপ্রাইজ ছবি-সম্পাদনা API-কেন্দ্রিক; 2025-11-19-এর পর থেকে পোস্ট বন্ধ।
- Stable Diffusion online AI (@stablediffusion.bsky.social) — SDXL/ComfyUI-ধাঁচের প্রম্পট-শেয়ারিং ও AI আর্ট সারাংশ অ্যাকাউন্ট (প্রায় ১,৮০০ অনুসারী)। 2025-02-24-এর পর থেকে নিষ্ক্রিয়।
- AI Art News (@ai-art-news.bsky.social) — AI আর্ট সংবাদ কিউরেশন অ্যাকাউন্ট। 2025-09-18-এর পর কোনো পোস্ট নেই।
পোস্ট
-
Simon Willison (2026-09-19) — GPT-6 Astra ও Claude Fable 5.1 দিয়ে ম্যাপ ডেটা ব্যবহার করে Blender-এর জন্য 3D মডেল তৈরির পোস্টের ধারাবাহিকতায় image-to-3D workflow তুলে ধরেন। লাইক 57・রিপোস্ট 5।
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Simon Willison (2026-09-05) — GPT-6 Astra দিয়ে সাইকেল চালানো পেলিক্যানের দৃশ্য Blender-এ রেন্ডার করানোর পরীক্ষা। লাইক 405・রিপোস্ট 30।
https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s -
Simon Willison (2026-09-04) — GPT-6 Astra, GPT-5.6 Sol/Terra/Luna পাশাপাশি রেখে “সাইকেল চালানো পেলিক্যান” ছবি বেঞ্চমার্কের তুলনামূলক গ্রিড। লাইক 206・রিপোস্ট 9।
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c -
Simon Willison (2026-09-02) — Claude Fable 5.1 (Max চিন্তন স্তর, প্রতি রান $3.30) দিয়ে এ পর্যন্ত সেরা SVG পেলিক্যান ছবি, পরে তা অ্যানিমেট করা। লাইক 362・রিপোস্ট 22।
https://bsky.app/profile/simonwillison.net/post/3muimzxo2sk2g -
Max Woolf (2026-09-19) — ইমেজ জেনারেশন AI দিয়ে ভেক্টর-ধাঁচের “সাইকেল চালানো পেলিক্যান” বানাতে গিয়ে মডেলটি পা ও প্যাডেলের সম্পর্ক বোঝেনি—এই পর্যবেক্ষণ। লাইক 1।
https://bsky.app/profile/minimaxir.bsky.social/post/3mvtt3uxdrk2c -
Max Woolf (2026-09-08) — OpenAI-এর নতুন ছবি মডেল ঘোষণায় মন্তব্য: “ChatGPT Images 2.0-এর সারসংক্ষেপ লেখা পিছিয়েছি ভালোই হয়েছে; এটিই বেশি গুরুত্বপূর্ণ মনে হচ্ছে”—ChatGPT Images 2.5-কে নির্দেশ করে। লাইক 4।
https://bsky.app/profile/minimaxir.bsky.social/post/3muzq6mcadk2n -
Ethan Mollick (2026-09-19) — নিম্নমানের ব্যাপক AI কনটেন্ট বা “slop”-এর বন্যার মধ্যে সত্যিই আকর্ষণীয় AI ভিডিও কাজও দেখা দিতে শুরু করেছে—AI ভিডিও প্রযোজনার গুণগত পরিবর্তনের ইঙ্গিত। লাইক 58・রিপোস্ট 7।
https://bsky.app/profile/emollick.bsky.social/post/3mvuss476oc2b -
Replicate (2026-04-21) — OpenAI-এর “GPT Image 2” Replicate-এ যোগ হয়েছে। ফটোরিয়ালিজম, টেক্সট রেন্ডারিং ও লেআউট অনুসরণের ক্ষমতা তুলে ধরা হয়েছে। লাইক 5।
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate (2026-04-09) — ByteDance-এর ভিডিও মডেল “Seedance 2.0” সব ব্যবহারকারীর জন্য উন্মুক্ত। টেক্সট, ছবি, ভিডিও ও অডিও একত্র করে; সিঙ্ক্রোনাইজড স্টেরিও অডিও ও বাস্তবধর্মী পদার্থবিদ্যা সমর্থন করে। লাইক 2・রিপোস্ট 1।
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate (2026-02-18) — Runway “Gen-4.5” প্রকাশের ঘোষণা। পদার্থগত নির্ভুলতা ও বাস্তবতা-কেন্দ্রিক সিনেমাটিক ভিডিও জেনারেশন। লাইক 2।
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate (2026-02-17) — Kuaishou “Kling 3.0” ও “Kling o3” Replicate-এ যুক্ত। মাল্টিশট 4K, সিঙ্ক্রোনাইজড অডিও, ভিডিও এডিটিং ও স্টাইল ট্রান্সফার সমর্থন করে। লাইক 2।
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate (2026-03-11) — Shengshu “Vidu Q3” Replicate-এ যুক্ত। সর্বোচ্চ ১৬ সেকেন্ড ও 1080p, সিঙ্ক্রোনাইজড অডিওসহ টেক্সট/ছবি/শুরুর-শেষ ফ্রেম থেকে ভিডিও তৈরি। লাইক 1।
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w
সংকেত
- ক্লোজড-সোর্সের আধিপত্য: Bluesky-তে পাওয়া সংশ্লিষ্ট পোস্টগুলো প্রায় সবই OpenAI (GPT Image 2 / ChatGPT Images 2.5), Runway (Gen-4.5), Kling (3.0), Seedance (2.0), Vidu (Q3)-এর মতো বড় ক্লোজড মডেল নিয়ে। এগুলো ভাইরাল স্বাভাবিক পোস্ট নয়; বরং Replicate-এর মতো মডেল-হোস্টিং ব্যবসার নতুন মডেল ঘোষণা, অথবা Simon Willison ও Max Woolf-এর মতো স্বতন্ত্র গবেষকের পরীক্ষামূলক পোস্ট থেকে এসেছে।
- ওপেন-সোর্সের উপস্থিতি প্রায় নেই: Flux, Stable Diffusion, Qwen-Image, Wan, ComfyUI workflow ইত্যাদি নিয়ে পোস্ট করা সক্রিয় অ্যাকাউন্ট পাওয়া যায়নি। একমাত্র কাছাকাছি কমিউনিটি অ্যাকাউন্ট stablediffusion.bsky.social 2025-02-এর পর থেকে বন্ধ, আর Stability AI-ও 2025-11-এর পর নীরব; তাদের সাম্প্রতিক পোস্টও Stable Diffusion ছবি নয়, Stable Audio বা এন্টারপ্রাইজ API-কেন্দ্রিক।
- “সাইকেল চালানো পেলিক্যান” ডি-ফ্যাক্টো বেঞ্চমার্ক: GPT-6 Astra ও Claude Fable 5.1-এর মতো নতুন মাল্টিমোডাল মডেল এলে একাধিক স্বাধীন পর্যবেক্ষক একই প্রম্পটে ছবি গুণমান তুলনা করেন। এটি Bluesky-র অভ্যন্তরীণ রসিকতা হলেও মডেলের ক্ষমতা মাপার অনানুষ্ঠানিক সাধারণ সূচক হয়ে উঠেছে।
- কর্পোরেট অফিসিয়াল অ্যাকাউন্টের অনুপস্থিতি: OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai ও ComfyUI-এর সম্ভাব্য প্রধান হ্যান্ডল হয় নেই, নয়তো কোনো পোস্টবিহীন। ফলে Bluesky এসব কোম্পানির প্রাথমিক ঘোষণা চ্যানেল নয়; খবর আসে ব্যক্তি গবেষক বা Replicate-এর মতো মধ্যবর্তী প্ল্যাটফর্ম হয়ে।
- ভিডিও জেনারেশন নিয়ে মূল্যায়নের পরিবর্তন: Ethan Mollick-এর পোস্টে যেমন দেখা যায়, ব্যাপক নিম্নমানের AI ভিডিওর মধ্যে বাস্তবেই উচ্চমানের কাজ উঠতে শুরু করেছে—এমন ধারণা বাড়ছে। তবে এটি সাধারণ পর্যবেক্ষণ, নির্দিষ্ট কোনো ওপেন-সোর্স ভিডিও মডেল নিয়ে নয়।
সীমাবদ্ধতা
- Bluesky-এর অফিসিয়াল সার্চ API (
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) কিওয়ার্ড বদলালেও ও দুই ধরনের CORS প্রক্সি দিয়েও সর্বদা HTTP 403 Forbidden দিয়েছে; একেবারেই ব্যবহার করা যায়নি।https://bsky.app/search?q=...ওয়েব UI ক্লায়েন্ট-সাইড SPA হওয়ায় WebFetch-এ ভেতরের কনটেন্ট পাওয়া যায়নি। - বিকল্প হিসেবে প্রমাণীকরণ ছাড়াই চলা
app.bsky.actor.getProfileওapp.bsky.feed.getAuthorFeedএন্ডপয়েন্ট ব্যবহার করে WebSearch বা অনুমান থেকে পাওয়া অ্যাকাউন্টভিত্তিক ফিড নেওয়া হয়েছে। ফলে ফলাফলটি Bluesky জুড়ে কিওয়ার্ড সার্চ নয়, কেবল খুঁজে পাওয়া অ্যাকাউন্টগুলোর পোস্টে সীমাবদ্ধ। - বড় ব্র্যান্ডগুলোর অফিসিয়াল অ্যাকাউন্ট—OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai, ComfyUI ও Stability AI-এর অংশ—অব্যবহৃত বা নীরব ছিল; সরাসরি তাদের কাছ থেকে খবর নেওয়া যায়নি।
- সার্চ সীমাবদ্ধতার কারণে ব্রিফের “প্রায় ২০টি পোস্ট” মানদণ্ড কেবল সরাসরি বিষয়-সম্পর্কিত পোস্ট দিয়ে পূরণ করা যায়নি। ৭টি অ্যাকাউন্টের ১০০টির বেশি পোস্ট পড়ে সরাসরি সম্পর্কিত ১২টি বেছে দেওয়া হয়েছে।
- ছবি বা ভিডিও নিজে প্রদর্শন ও যাচাই করা হয়নি; পোস্টের টেক্সট বিবরণই একমাত্র তথ্যসূত্র।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা (ক্লোজড/ওপেন সোর্স)
কমিউনিটি
- !«メールアドレス» — 5,712 subscribers (স্থানীয় 893), 1,407 পোস্ট ও 1,927 মন্তব্য। ওপেন-ওয়েট ছবি/ভিডিও মডেলের সাধারণ আলোচনা। দৈনিক সক্রিয় 10, মাসিক 66—ছোট হলেও নিয়মিত আপডেট হয়।
- !«メールアドレス» — 2,362 subscribers; দৈনিক 24/সাপ্তাহিক 114/মাসিক 344। Stable Diffusion-ভিত্তিক ওপেন-ওয়েট মডেলে তৈরি কাজ শেয়ারের স্থান; বেশিরভাগই civitai ছবির সরাসরি লিংক।
- !«メールアドレス»(কমিউনিটির নাম
share_anime_art, প্রদর্শিত নাম “Stable Diffusion Anime”)— 1,598 subscribers (স্থানীয় 206)। শুধু SFW অ্যানিমে-ধাঁচের AI ছবি পোস্টের কমিউনিটি। - !«メールアドレス» — 8,252 subscribers (স্থানীয় 3,027), মাসিক সক্রিয় 9,179—এই পর্যবেক্ষণে দেখা বৃহত্তমগুলোর একটি। “a place for all those who loathe AI” স্লোগানের অ্যান্টি-AI কমিউনিটি; ছবি/ভিডিও জেনারেশনের চেয়ে AI-সংক্রান্ত সাধারণ সমালোচনা ও ব্যঙ্গই মূল।
- !«メールアドレス» — মাত্র 52 subscribers হলেও r/ArtificialInteligence ইত্যাদি Reddit থ্রেড RSS-এ মিরর করে; ছবি/ভিডিও AI বিষয় ঘন ঘন আসে। ছয় মাসে সক্রিয় 725।
- !«メールアドレス»・!«メールアドレス»・!«メールアドレス» — সাধারণ প্রযুক্তি কমিউনিটি; Midjourney-সম্পর্কিত বড় খবর এখানে এসেছে।
পোস্ট
- সেপ্টেম্বরে MiniMax-H3-এর জন্য ComfyUI টুলের দ্রুত বৃদ্ধি (ওপেন সোর্স) —
!«メールアドレス»-এ 2026-09-01 থেকে 09-16-এর মধ্যে MiniMax-H3 ভিডিও মডেলের জন্য অন্তত ১৫টির বেশি টুল পোস্ট। উদাহরণ:- “ComfyUI-MiniMaxH3-CLSS” — সাধারণ ব্যবহারকারীর 16GB VRAM-এ যেকোনো দৈর্ঘ্যের অডিওসহ ভিডিও জেনারেশন (score 0, 2026-09-01) https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS
- “H3-World” — MiniMax-H3-ভিত্তিক “বিশ্বের প্রথম interactive world model” দাবি করে (score 3, 2026-09-02) https://huggingface.co/DANNY621/H3-World
- “ComfyUI-VDN-H3-24GB” — 24GB GPU-এর জন্য hybrid attention বাস্তবায়ন (score 6, 2026-09-12) https://github.com/Speach1sdef178/ComfyUI-VDN-H3-24GB
- “MiniMax-H3-Image-Training-Adapter” (Circlestone Labs, score 5, 2026-09-12) https://huggingface.co/circlestone-labs/MiniMax-H3-Image-Training-Adapter
- Boogu-Image-0.1 — Huawei-সংশ্লিষ্ট ল্যাবের নতুন ওপেন ইমেজ ফাউন্ডেশন মডেল (ওপেন সোর্স) —
!«メールアドレス», score 5, 2026-06-17। Apache-2.0 লাইসেন্স, ১০ বিলিয়ন প্যারামিটার; Base/Turbo (3–4 ধাপ)/FP8/Edit-এর ৫টি ভ্যারিয়েন্ট। চীনা ও ইংরেজি দ্বিভাষিক টেক্সট রেন্ডারিং প্রধান আকর্ষণ। https://boogu.org/ - Seedream 5.0 Pro (ByteDance-সংশ্লিষ্ট ক্লোজড মডেল)-এর প্রযুক্তিগত যাচাই নিবন্ধ (ক্লোজড সোর্স) —
!«メールアドレス»হয়ে, score 1, 2026-07-10। “an honest comparison and technical breakdown” শিরোনামের পরীক্ষামূলক পোস্ট। https://www.reddit.com/gallery/1usc03q - Google “Nano Banana 2 Lite” ঘোষণা (ক্লোজড সোর্স) — Hacker News মিরর, score 1, 2026-06-30, DeepMind অফিসিয়াল পেজের লিংক। সুইস টেক মিডিয়ার জার্মান ভাষার প্রতিবেদনও একই সময়ে ছিল (score 0, swisstechnews, 2026-07-02)। https://deepmind.google/models/gemini-image/flash-lite/
- Microsoft MAI-Image-2.5 বেঞ্চমার্কে Nano Banana 2-এর কাছাকাছি (ক্লোজড সোর্স) —
!«メールアドレス», score 1, 2026-05-28। Google বনাম Microsoft ছবি মডেল প্রতিযোগিতা নিয়ে পোস্ট। https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/ - Sora 2 দিয়ে দীর্ঘ গল্প তৈরির পরীক্ষার বিবরণ (ক্লোজড সোর্স) —
!«メールアドレス», score 1, 2026-09-13। Sora 2 প্রকাশের প্রায় এক মাস পর শুরু করে ৭টি এক ঘণ্টার ভিডিও বানানোর অভিজ্ঞতা। “সুন্দর একক ক্লিপ বানানো কঠিন নয়; আসল কঠিন হলো ‘production memory’—ধারাবাহিকতা বজায় রাখা।” https://lemmy.durstig.online/post/59922(মূল Reddit: https://www.reddit.com/r/ArtificialInteligence/comments/1wfabp9/) - Midjourney-এর AI ছবি জেনারেশন থেকে “মেডিক্যাল স্পা”-তে সাহসী পিভট—বাস্তব খবর (ক্লোজড সোর্স/কোম্পানি গতিপ্রকৃতি) —
!«メールアドレス»(The Register নিবন্ধ, lemmy.zip সংস্করণে ক্রস-পোস্ট, score 58-66, 2026-06-18)। full-body scan “Golden Light” স্পা ব্যবসায় রূপান্তর; মূল প্রযুক্তি অংশীদারের কাছ থেকে ধার নেওয়া বলে প্রতিবেদন, মন্তব্যে Theranos তুলনা। https://lemmy.zip/post/66397234 - Midjourney হলিউড স্টুডিওকে AI ব্যবহার প্রকাশের দাবি করেছে (ক্লোজড সোর্স) —
!«メールアドレス», score 73, 2026-07-05। কপিরাইট মামলা-সম্পর্কিত পদক্ষেপ হিসেবে প্রতিবেদন। https://lemmy.today/post/56011946 - InterleaveThinker পেপারের পরিচিতি (ওপেন সোর্স/গবেষণা) —
!«メールアドレス», score 0, 2026-06-12। “Reinforcing Agentic Interleaved Generation” শিরোনামের arXiv পেপারের লিংক। https://arxiv.org/abs/2606.13679 - AI-তৈরি কনটেন্টের বিরোধিতার তীব্রতা (সামাজিক সংকেত) —
!«メールアドレス», score 923, 2026-09-13। সরাসরি ছবি/ভিডিও জেনারেশন নয়; AI-চালিত স্মার্ট গ্লাস (Ray-Ban Meta) নিয়ে পোস্ট। তবু কমিউনিটির আকার—মাসিক সক্রিয় 9,179—এবং প্রতিক্রিয়ার তীব্রতা ছবি/ভিডিও AI আলোচনার বিরূপ আবহের পরোক্ষ প্রমাণ। https://lemmy.world/post/51874921
সংকেত
- ওপেন-সোর্স দিকে MiniMax-H3-ই প্রধান। lemmy.dbzer0.com-এর
!stable_diffusionকমিউনিটিতে সেপ্টেম্বরের প্রথমার্ধে MiniMax-H3-এর জন্য ComfyUI node, LoRA, quantization ও VAE acceleration টুলের পোস্ট প্রতিদিন এসেছে। Wan/Flux/HunyuanVideo-এর মতো পুরোনো প্রজন্মের মডেলের নাম সার্চে প্রায় আর দেখা যায়নি। ব্যক্তিগত GitHub অ্যাকাউন্টের বহু স্বাধীন ডেভেলপার প্রাথমিক পোস্টদাতা—এটি Hugging Face/civitai-কেন্দ্রিক তৃণমূল ইকোসিস্টেমের ছবি। - ক্লোজড পাশে Google (Nano Banana), Microsoft (MAI-Image), ByteDance (Seedream), OpenAI (Sora 2) ও Midjourney—এই পাঁচ কোম্পানি পাশাপাশি চলছে, কিন্তু Lemmy-তে উল্লেখ কম; স্কোর প্রায় সবই এক অঙ্কে। আলোচনার মূল প্রবাহ বেশিরভাগ ক্ষেত্রেই Reddit মিরর
!ai_redditদিয়ে আসে। Lemmy-উৎসের নিজস্ব উল্লেখ Midjourney-এর মেডিক্যাল স্পা পিভটের মতো কর্পোরেট খবরেই কেন্দ্রীভূত। - civitai-তে সরাসরি লিংক করা কাজের পোস্ট—stable_diffusion_art / share_anime_art—সক্রিয়, কিন্তু মডেল নাম বা প্রম্পটের বিস্তারিত কম, তাই সংবাদমূল্য হিসেবে এগুলো কেবল উপাদান।
- অ্যান্টি-AI কমিউনিটি
!fuck_aiLemmy জুড়ে সবচেয়ে বড়গুলোর একটি, এবং ছবি/ভিডিও AI-সংক্রান্ত পোস্ট সেখানে পৌঁছালে সমর্থনের চেয়ে বিরূপ মন্তব্য প্রাধান্য পায়।
সীমাবদ্ধতা
- Lemmy-র মূল ব্যবহারকারীসংখ্যা ছোট, এবং সার্চ API পুরোনো পোস্ট—যেমন 2025-03-এর HunyuanVideo-I2V—বা অপ্রাসঙ্গিক ফল—যেমন “Flux” শব্দে পারমাণবিক জ্বালানি স্টার্টআপ Fluxnium-এর নিবন্ধ—বেশি দেয়। তাই প্রতিটি কিওয়ার্ডে হাতে ধরে নোইজ বাদ দিতে হয়েছে।
Runway Gen,Kling AI,Wan 2.5আলাদা করে সার্চ করা হলেও সরাসরি সম্পর্কিত পোস্ট পাওয়া যায়নি: Kling শূন্য, Runway শূন্য, Wan-এ কেবল অপ্রাসঙ্গিক পোস্ট। Lemmy-তে এসব মডেল নিয়ে স্বতন্ত্র উত্তেজনা নিশ্চিত করা যায়নি।!«メールアドレス»Reddit RSS রিপোস্ট বট; এটি Lemmy-র নিজস্ব আলোচনা নয়। তাই উৎস স্পষ্ট করে Reddit অংশের পুনরাবৃত্তি এড়িয়ে শুধু স্বতন্ত্র অন্তর্দৃষ্টি নেওয়া হয়েছে।- Midjourney-এর মেডিক্যাল স্পা পিভট ও হলিউড প্রকাশ-দাবির খবর যথাক্রমে 2026-06-18 ও 2026-07-05-এর; গত সপ্তাহের ঘটনা নয়। Lemmy-তে নতুন পরবর্তী খবর পাওয়া যায়নি।
- প্রায় ২০টি পোস্ট পরীক্ষা করা হলেও দুই অঙ্কের স্কোরসহ সত্যিকারের ভাইরাল পোস্ট ছিল কেবল Midjourney-এর মেডিক্যাল স্পা খবর ও
!fuck_ai-এর স্মার্ট গ্লাস পোস্ট। Lemmy জুড়ে শুধু ছবি/ভিডিও জেনারেশন AI বিষয়ক পোস্ট ব্যাপক ভাইরাল হওয়ার প্রমাণ মেলেনি।
Pinterest — ছবি ও ভিডিও জেনারেশন AI নিউজ
লিখিত সারাংশের জন্য সংগ্রহ করা ৫০টি পিনের মধ্যে ৩০টি সরাসরি খোলা ও পড়া হয়েছে (সবই Read সহ, ছবিসহ); বাকি ২০টির শিরোনাম—মূলত সাধারণ “AI content creation concept” স্টক-ফটো তালিকা ও ডুপ্লিকেট টুল-সারাংশ গ্রাফিক—নিচে নিশ্চিত হওয়া থিমের সঙ্গে মিলে যাওয়ায় খোলা হয়নি।
দৃশ্যগত থিম
- “AI news” YouTube-থাম্বনেইল টেমপ্লেট প্রাধান্য পেয়েছে: কালো/নেভি পটভূমি, বিস্মিত বা হাস্যরত মানব মুখ, বড় সাদা/লাল “AI NEWS” লেখা, এবং জ্বলজ্বলে ব্র্যান্ড লোগোর সারি—OpenAI, Google, Anthropic-এর কমলা, Meta, Microsoft, Notion। অসংলগ্ন বিষয়েও বারবার দেখা যায়; কখনও শিরোনামের সঙ্গে ছবির মিল নেই। এটি আলাদা করে তৈরি শিল্প নয়, পুনর্ব্যবহৃত চ্যানেল টেমপ্লেট।
[6, 14, 41, 43, 47] - টুল-সারাংশ তালিকা একই ডার্ক-নিয়ন ইনফোগ্রাফিক ভাষা ব্যবহার করে: নম্বরযুক্ত বেগুনি/কমলা/টিল ব্যাজ, জেনারেশন UI-সহ ল্যাপটপ মকআপ এবং প্রতিযোগী অ্যাপ লোগোর গ্রিড—Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, invideo AI, CapCut, Synthesia, HeyGen। সবকটিই ক্লোজড-সোর্স SaaS।
[2, 29] - “Real vs AI” সত্যতা-উদ্বেগ একটি স্বতন্ত্র পুনরাবৃত্ত ফরম্যাট: পাশাপাশি কুইজ—“Which is AI?”—ছবির ওপর লাল “AI-GENERATED” লেবেল, এবং মিম-ধাঁচের “AI GENERATED / ORIGINAL CLIP” তুলনা। এটি সংবাদ থাম্বনেইলের মতোই প্রচলিত একটি ঘরানা।
[3, 21, 32] - Google Veo সিনেমাটিক AI ভিডিওর ডিফল্ট দৃশ্যভাষা জোগাচ্ছে: একই উষ্ণ Pixar-ধাঁচের স্টিল—রান্নাঘরের মেয়ে, ফ্লেমিঙ্গো, তারার নিচে নৃত্যশিল্পী, সাঁতারু, মাইক্রোস্কোপের সামনে বিজ্ঞানী—একাধিক আলাদা পিনে দেখা যায়; Veo 3-এর জন্য আলাদা প্লাশ দানব image-to-video ডেমোও রয়েছে। অন্য কোনো প্রতিযোগীর ডেমো রিল এত বেশি বার দেখা যায়নি।
[8, 9, 13, 27] - হাইপাররিয়াল AI প্রতিকৃতি সাধারণ ক্লিকবেইট আর্ট হিসেবে ব্যবহৃত: নিবন্ধের প্রকৃত বিষয় নির্বিশেষে টুল ঘোষণার জন্য কুঁচকানো জেলের মুখ, নিউজ-সারাংশ কার্ডে ঝিলমিল ত্বকের নারীর প্রোফাইল, মজার অ্যাপের জন্য face-morph triptych। ত্বকের রোমকূপ, চোখের ক্যাচলাইট ও অগভীর depth of field-ই এগুলো AI-তৈরি হওয়ার ইঙ্গিত।
[33, 45, 48, 20] - যেখানে প্রকৃত পণ্যের স্ক্রিনশট নেই, সেখানে সাধারণ sci-fi/circuit-board স্টক ছবি ব্যবহৃত: জ্বলজ্বলে wireframe মস্তিষ্ক, ক্রোম হিউম্যানয়েড রোবট, হোলোগ্রাফিক AI ড্যাশবোর্ডের সামনে স্যুট পরা ব্যবসায়ী। এগুলোর সংবাদমূল্য নেই, শুধু আবহ।
[1, 37, 50] - শুরুর স্তরের শিক্ষামূলক ইনফোগ্রাফিক প্যাস্টেল, কার্টুনধর্মী ভাষা ব্যবহার করে: হলুদ/গোলাপি, হাস্যোজ্জ্বল রোবট মাসকট ও হাতে আঁকা তীর—নিউজ থাম্বনেইল ঘরানার চেয়ে নরম ভিজ্যুয়াল, যাদের “generative AI” অর্থও জানা নেই তাদের জন্য।
[7] - আসল প্রযুক্তিগত ডায়াগ্রাম বিরল: নমুনায় শুধু একটি পিনে মডেল আর্কিটেকচারের প্রকৃত চিত্র ছিল—text embedding → diffusion → upscaling ধাপ—তাও গবেষণাচিত্রের বদলে চকচকে ম্যাগাজিন গ্রাফিকের সাজে।
[34]
উল্লেখযোগ্য পিন
- #48 — “Amuse 3.0”, একটি AI আর্ট তৈরির টুল (pin) — AMD-ব্র্যান্ডযুক্ত লোকাল ছবি জেনারেটর, হাইপাররিয়াল প্রতিকৃতির মাধ্যমে দেখানো; ক্লোজড SaaS তালিকার ভিড়ে নমুনায় পাওয়া একমাত্র স্পষ্ট লোকাল/ওপেন-ঘেঁষা টুল।
- #27 — Google ভিডিও জেনারেশন AI ‘Veo 3’ ঘোষণা করেছে (pin) — প্লাশ দানবের একটি ইনপুট স্টিল ও ভিন্ন দৃশ্যে তিনটি তৈরি ভিডিও দেখায়; Veo 3-এর image-to-video সামঞ্জস্যই প্রকৃত বিক্রয়-বিন্দু।
- #46 — ByteDance ও Hollywood AI কপিরাইট নিয়ে বৈশ্বিক চুক্তিতে পৌঁছেছে (pin) — ByteDance–MPA-র ছবি/ভিডিও টুল-কভার করা IP চুক্তির Cointelegraph-ধাঁচের নিউজ কার্ড; Pixar-ধাঁচে জেনারেট করা ছেলের ছবি দিয়ে সাজানো।
- #10 — “4 Major AI Updates” (pin) — একটি ইনফোগ্রাফিকে GPT-6 Astra, আরও agentic Gemini, Adobe Premiere-এ generative media এবং Cognition-এর $2B Series E ($48B valuation)।
- #49 — “Today's AI News, May 20 2026” (pin) — Google I/O সারাংশ: Gemini 3.5 Flash, Gemini Omni, Gemini Spark এবং AI স্মার্ট-গ্লাস উদ্যোগ।
- #3 — Hollywood Reporter প্রথম AI অভিনেত্রীর সাক্ষাৎকার নিয়েছে (pin) — “Tilly Norwood” নামের AI-তৈরি অভিনেত্রী নিয়ে TV chyron; ফ্রেমে নিজেই “AI-GENERATED IMAGE” লেখা।
- #41 — “More than 20% of YouTube is now AI-generated” (pin) — কোনো সহায়ক চার্ট ছাড়া পরিসংখ্যান-শিরোনামের পিন; দাবি হিসেবে উপস্থাপিত।
- #29 — “10 Best Free AI Video Generators for YouTube 2026” (pin) — নমুনার সবচেয়ে বিস্তৃত টুল-সারাংশ: Google Veo, Runway, Pika, invideo AI, CapCut, Synthesia, HeyGen—সবগুলো ফ্রি/YouTube-উপযোগী হিসেবে উপস্থাপিত।
- #34 — OpenAI-এর গোপন ছবি তৈরির টুল শিগগির আসবে (pin) — ক্লোজড-সোর্স, এখনও প্রকাশ না হওয়া টুল নিয়ে শিরোনাম; পণ্যের ছবি নয়, প্রকৃত diffusion pipeline ডায়াগ্রাম দিয়ে সাজানো।
- #32 — “AI GENERATED” বনাম “ORIGINAL CLIP” তুলনামূলক মিম (pin) — আসল সোর্স ক্লিপের পাশে AI-তে পুনর্নির্মিত মুখ/অঙ্গভঙ্গি; প্ল্যাটফর্মজুড়ে চলমান সত্যতা শনাক্ত ঘরানার অংশ।
সংকেত
- বর্তমান: Google Veo (2 ও 3) বোর্ডে এককভাবে সবচেয়ে পুনরাবৃত্ত ভিডিও মডেল—অন্য যে কোনো নামকরা টুলের চেয়ে বেশি। “AI চ্যাটের বাইরে বাস্তব কাজে যাচ্ছে”—এই ফ্রেম একাধিক পিনে স্পষ্ট: Adobe Premiere generative timeline, Cognition-এর Devin ফান্ডিং, Gmail/Drive/Docs-জুড়ে agentic Gemini। ByteDance × MPA-এর মতো IP ও কপিরাইট চুক্তি এখন মূলধারার সংবাদ, কেবল বিশেষায়িত আইনি খবর নয়। “spot the AI” বা সত্যতা লেবেলিং একটি নিজস্ব ঘরানা, যা ভুয়া ছবি ও অভিনেত্রী নিয়ে দর্শকের প্রকৃত উদ্বেগ বোঝায়। অসংলগ্ন শিরোনামে একই সাধারণ থাম্বনেইল পুনর্ব্যবহার থেকে বোঝা যায় এই “নিউজ” কনটেন্টের বড় অংশ মৌলিক রিপোর্টিং নয়, কম-চেষ্টার কনটেন্ট মিলের উৎপাদন।
- অনুপস্থিত: ওপেন-সোর্স মডেল সংস্কৃতি প্রায় অদৃশ্য—Stable Diffusion, Flux, ComfyUI, LoRA বা GitHub রিপোজিটরির কোনো স্ক্রিনশট পাওয়া যায়নি। Amuse 3.0 (#48) নমুনার একমাত্র লোকাল/ওপেন-ঘেঁষা টুল, তাও ওপেন-সোর্স প্রকল্প হিসেবে নয়, পরিশীলিত কনজিউমার অ্যাপ হিসেবে উপস্থাপিত। কোনো অ-ইংরেজি পিন নেই। নমুনার কিছুই ভিডিও আকারে প্লে হয় না—সবই স্থির থাম্বনেইল; ফলে আসল আউটপুটের গুণমান নয়, কেবল দাবি বিচার করা যায়।
সীমাবদ্ধতা
- প্লেবুক অনুযায়ী Pinterest সরাসরি ব্রাউজ করা হয়নি; এই সারাংশ কেবল কর্মীর আগাম সংগৃহীত
output/pinterest.pins.mdটেবিল এবংimages/pinterest/manifest.json/ছবির ওপর নির্মিত। একটিমাত্র অজ্ঞাত কুয়েরি—“Image and Video Generation AI News”—থেকে সংগ্রহ করা, ঘরানাভিত্তিক ভাগ নয়; manifest-এর প্রতিটি পিনেgenreফিল্ড ফাঁকা, তাই ঘরানাভিত্তিক তুলনা করা যায়নি। - ৫০টির মধ্যে ৩০টি পিন খোলা হয়েছে; বাকি ২০টি বাদ দেওয়া হয়েছে কারণ তাদের শিরোনাম ইতিমধ্যে আলোচিত ফরম্যাটের পুনরাবৃত্তি—সাধারণ “AI content creation concept” স্টক-ফটো তালিকা ও পুনরাবৃত্ত টুল-সারাংশ গ্রাফিক। এটি পূর্ণ কভারেজ নয়, স্পট চেক।
- উৎস টেবিলে কয়েকটি পিনের শিরোনাম ফাঁকা—“(untitled)”। সেসব ক্ষেত্রে বর্ণনা ছবিতে দৃশ্যমান লেখার ভিত্তিতে।
- কিছু পিনের ছবির বিষয় শিরোনামের সঙ্গে হুবহু মেলে না—যেমন #47-এর ছবি Grok 5 সম্পর্কিত নির্দিষ্ট কিছু নয়, সাধারণ “AI NEWS” চ্যানেল কার্ড। এটি পুনর্ব্যবহৃত সাধারণ থাম্বনেইল-সংক্রান্ত পর্যবেক্ষণকে সমর্থন করে, তবে শিরোনামকে নিশ্চিত রিপোর্টিং হিসেবে নয়, ইঙ্গিত হিসেবে পড়া উচিত।
- কোনো পিনে দৃশ্যমান প্রকাশের তারিখ নেই; ছবির ভিত্তিতে সংবাদদাবির সাম্প্রতিকতা—যেমন YouTube-এর ২০% AI-generated পরিসংখ্যান—যাচাই করা যায়নি।
সুপারিশকৃত পদক্ষেপ
- X পর্যায়ে ‘Sora 2’ ‘Midjourney’ ‘Stable Diffusion’ ‘Runway Gen’ ‘Kling AI’ ‘open source image generation’-এর মতো বিষয়-সংশ্লিষ্ট সার্চ টার্ম দিয়ে পুনরায় সংগ্রহ করুন।
- MiniMax-H3, Qwen, Wan ও Z-Image-এর মতো চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের গতি নিয়মিত পর্যবেক্ষণ করুন।
- শুধু AI বিশেষজ্ঞ কমিউনিটি নয়, সাধারণ ও পেশাভিত্তিক কমিউনিটির প্রতিক্রিয়াও অনুসরণ করে AI-তৈরি কনটেন্টের বিরুদ্ধে প্রতিক্রিয়ার বিস্তার পর্যবেক্ষণ করুন।
- Bluesky অফিসিয়াল সার্চ API-এর 403 সমস্যার বিকল্প অ্যাক্সেস পদ্ধতি পরীক্ষা করুন।
- Sora 2-এর ‘production memory’ সমস্যা ও Midjourney-এর মেডিক্যাল স্পায় পিভটের পরবর্তী খবর পরের রানেও অনুসরণ করুন।
- Pinterest সংগ্রহে ঘরানা ট্যাগ যুক্ত করুন, যাতে ওপেন/ক্লোজড মডেল যান্ত্রিকভাবে শ্রেণিবদ্ধ করা যায়।
সংগৃহীত ছবি


















































ডেটা গুণমান নোট
X-এর সার্চ টার্ম বিষয়ের সঙ্গে সম্পর্কহীন হওয়ায় ৪০টির মধ্যে ০টিই ব্যবহারযোগ্য ছিল। Reddit (১২টি) ও Bluesky (সার্চ API ব্লক থাকায় ব্যক্তিগত অ্যাকাউন্ট থেকে প্রায় ১২টি)-ও প্রায় ২০টি পোস্টের লক্ষ্যে পৌঁছায়নি। Pinterest-এ ঘরানা-ট্যাগবিহীন পূর্বসংগৃহীত ডেটা ব্যবহৃত হয়েছে; YouTube-এ ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।



