KEN’S CAT LOG

ছবি ও ভিডিও জেনারেশন AI নিউজ — 2026-09-20

ওপেন-সোর্স (বিশেষ করে চীনা উৎসের Qwen, Wan ও MiniMax-H3-এর মতো মডেল) দ্রুতই ক্লোজড-সোর্সের ফ্রি টিয়ার শেষ হয়ে যাওয়া ব্যবহারকারীদের বিকল্পে পরিণত হচ্ছে। অন্যদিকে, X পর্যায়ে অপ্রাসঙ্গিক সার্চ টার্মের কারণে কোনো কার্যকর ডেটা পাওয়া যায়নি, ফলে এই পর্বের প্রমাণ কার্যত পাঁচটি প্ল্যাটফর্মে সীমাবদ্ধ।

ছবি ও ভিডিও জেনারেশন AI নিউজের সারসংক্ষেপ 〜ক্লোজড বনাম ওপেন সোর্স〜 — 2026-09-20

হ্যালো! এবার Reddit, X, YouTube, Bluesky, Lemmy ও Pinterest—এই ছয় প্ল্যাটফর্ম দ্রুত দেখে এলাম🔥🔥 সংক্ষেপে বললে, ক্লোজড-সোর্স শিবির (Google Veo/Nano Banana, Sora 2, Midjourney, Kling, Seedance প্রভৃতি) এখনও খবরের মূল চরিত্র, এবং “অডিও সিঙ্ক” সত্যিই স্ট্যান্ডার্ড ফিচারে পরিণত হচ্ছে। তবে ওপেন-সোর্স শিবির—বিশেষ করে চীনা Qwen, Wan ও MiniMax-H3—অবিশ্বাস্য গতিতে এগোচ্ছে এবং ফ্রি টিয়ার শেষ হয়ে যাওয়া ব্যবহারকারীদের “আশ্রয়” হিসেবে জোরালো উপস্থিতি তৈরি করেছে🚀 আরও একটি নীরব কিন্তু গুরুত্বপূর্ণ বিষয় হলো, AI-তৈরি কনটেন্টের বিরুদ্ধে প্রতিক্রিয়া AI-অনুরাগী কমিউনিটির চেয়ে সাধারণ মানুষের আড্ডাস্থলগুলোতেই বড় আকার নিচ্ছে😤। তবে খোলাখুলি বললে, X পর্যায়টি পুরোপুরি ব্যর্থ হওয়ায় এই রিপোর্টের ভিত্তি পাঁচটি প্ল্যাটফর্মের ডেটা🙏

বিভিন্ন প্ল্যাটফর্মজুড়ে

  • ওপেন-সোর্স পক্ষের গতি সত্যিই থামছে না: Reddit-এ Wan, Minimax H3 ও Krea2 ক্লোজড মডেলের ফ্রি টিয়ার শেষ হওয়ার পর বিকল্প হিসেবে একাধিক থ্রেডে উঠে এসেছে। Lemmy-র !stable_diffusion কমিউনিটিতে শুধু সেপ্টেম্বরে MiniMax-H3-এর জন্য ১৫টির বেশি ComfyUI টুল পোস্ট হয়েছে। YouTube-এ Qwen-Image→Qwen-Image-2512→Z-Image এবং Wan 2.5→2.6→2.7 প্রায় মাসিক হারে আপডেট হচ্ছে। “ওপেন সোর্স = বিনা খরচে উচ্চমান”—এটি প্রায় ডি-ফ্যাক্টো ধারণায় পরিণত হচ্ছে💪
  • ক্লোজড ভিডিও জেনারেশনে “অডিওসহ” এখন স্বাভাবিক: Bluesky-তে Replicate ঘোষিত Kling 3.0-এর সিঙ্ক্রোনাইজড অডিও ও Seedance 2.0-এর অডিও-ভিডিও সমন্বয়, এবং YouTube-এ Grok Imagine 1.5-এর সংলাপ ও পরিবেশের শব্দ একসঙ্গে তৈরির কথা—একই প্রবণতা নিশ্চিত করেছে🎬🔊
  • Google-এর Veo/Nano Banana পরিবার ক্লোজড মডেলের “মুখ” হয়ে উঠছে: Pinterest-এ Veo-এর উষ্ণ Pixar-ধাঁচের ভিডিও বারবার ভাইরাল ভিজ্যুয়াল হিসেবে ব্যবহৃত হচ্ছে; YouTube-এ Theo - t3.gg সরাসরি বলছে “Google won image generation”; Reddit-এ Google Flow-এর বর্ধিত ফ্রি টিয়ার আলোচনায় এসেছে—তিন দিক থেকেই বিষয়টি নিশ্চিত হয়েছে👀
  • AI-তৈরি কনটেন্টের বিরোধিতা AI-অনুরাগীদের গণ্ডির বাইরে বিস্ফোরিত হচ্ছে: Reddit-এ ArtPrize-এর AI কাজ গ্রহণ নিয়ে ক্ষোভ 354pt, কর্মক্ষেত্রে AI ছবি ব্যাপক উৎপাদনের কোটা নিয়ে আর্তনাদ 63pt। Lemmy-তে অ্যান্টি-AI কমিউনিটি !fuck_ai-এর মাসিক সক্রিয় ব্যবহারকারী 9,179, যা Lemmy-র অন্যতম বৃহৎ কমিউনিটি। Pinterest-এ “Real vs AI” আসল-নকল শনাক্তের কুইজ আলাদা ঘরানা হয়ে গেছে😨
  • প্রাথমিক তথ্যের উৎস কোম্পানির চেয়ে “ব্যক্তি” বেশি: Bluesky-তে কর্পোরেট অফিসিয়াল অ্যাকাউন্ট প্রায় নীরব; Simon Willison-এর মতো স্বতন্ত্র গবেষক এবং Replicate-এর মতো হোস্টিং অপারেটর তথ্যের উৎস। YouTube-এও ব্যক্তিগত চ্যানেলের সাপ্তাহিক সারাংশ—AIPOD-CAST ও Lev Selector—খবরের উৎস। অফিসিয়াল কোম্পানি-চালিত প্রাথমিক প্রচার চ্যানেল কম, এটি একটি সাধারণ প্রবণতা বলেই মনে হয়📢

প্ল্যাটফর্মভিত্তিক

Reddit: ৯টি সাবরেডিট থেকে ১২টি থ্রেড সংগ্রহ করা হয়েছে (লক্ষ্য ২০টিতে পৌঁছায়নি)। ওপেন-সোর্স Wan, Minimax H3 ও Krea2 ক্লোজড মডেলের ফ্রি টিয়ার শেষের বিকল্প—এই কথা একাধিক থ্রেডে বারবার এসেছে। অন্যদিকে GPT Image 2.5 Flare নিয়ে মতামত “incredible” বনাম “Krea2-এর মতোই”—দুই ভাগে বিভক্ত😂 সবচেয়ে আকর্ষণীয় বিষয়, AI-প্রযুক্তির সাবের তুলনায় সাধারণ কমিউনিটি (ArtPrize প্রতিক্রিয়া 354pt) ও বাস্তব কাজভিত্তিক সাবগুলোতে (ডিজাইনারদের অভিযোগ 63pt) তাপ বেশি ছিল।

X: সত্যি বলতে, এটি পুরোপুরি দুর্ঘটনা ছিল🙈 সংগৃহীত ৪০টি পোস্ট “Greenland”, “#Bitcoin”, “Chelsea”-র মতো সংযোগস্থল-নির্ভর (ক্রোয়েশিয়া অঞ্চলের) সাধারণ ট্রেন্ড সার্চ করে পাওয়া—ছবি/ভিডিও জেনারেশন AI-সংক্রান্ত পোস্ট শূন্য। ফলে এই দফায় X থেকে ক্লোজড বা ওপেন—কোনো দিকেই একটি অন্তর্দৃষ্টিও পাওয়া যায়নি। ব্রিফে নির্দিষ্ট করা প্ল্যাটফর্মে এটি একটি স্পষ্ট ফাঁক🕳️

YouTube: ১২টি ভিডিও পর্যালোচনা করা হয়েছে। ক্লোজড শিবির (Theo, Astrovah, Woollyfern—Midjourney মাসিক আপডেট বিশেষজ্ঞ, FixNode) এবং ওপেন-সোর্স শিবির (Bijan Bowen, HitPaw, MaxonShire, Promptus AI) সুন্দরভাবে পৃথক। ওপেন পক্ষ “ComfyUI”, “লোকাল রান”, “ফ্রি”-কে সামনে আনছে; ক্লোজড পক্ষ জোর দিচ্ছে গুণমান ও ফিচারে। তবে সার্চ ফলের পাতা অতিরিক্ত JavaScript-নির্ভর হওয়ায় ভিউ ও সাবস্ক্রাইবার সংখ্যা প্রায় পাওয়া যায়নি😅

Bluesky: অফিসিয়াল সার্চ API বারবার 403-এ ব্লক হওয়ায় Simon Willison, Max Woolf, Ethan Mollick-এর মতো গবেষক এবং Replicate-এর অফিসিয়াল পোস্ট অনুসরণ করে তথ্য সংগ্রহ করা হয়েছে। ফলস্বরূপ পাওয়া পোস্টগুলো প্রায় সবই ক্লোজড-সোর্স—GPT Image 2, Runway Gen-4.5, Kling 3.0, Seedance 2.0 ও Vidu Q3। সক্রিয় ওপেন-সোর্স কমিউনিটি অ্যাকাউন্ট পাওয়া যায়নি; একমাত্র প্রাসঙ্গিক মনে হওয়া অ্যাকাউন্টটিও ২০২৫ সালের ফেব্রুয়ারিতে নিষ্ক্রিয়। “সাইকেল চালানো পেলিক্যান” ছবিটি মডেল তুলনার প্রচলিত রসিকতা হয়ে উঠেছে🐦🚲

Lemmy: ওপেন ও ক্লোজড শিবির সবচেয়ে স্পষ্টভাবে আলাদা, এবং ভারসাম্যও এখানে সবচেয়ে ভালো। ওপেন দিকে !stable_diffusion কমিউনিটিতে MiniMax-H3-এর ঢল এবং নতুন মডেল Boogu-Image-0.1 (Apache-2.0, ১০ বিলিয়ন প্যারামিটার)। ক্লোজড দিকে Google Nano Banana 2 Lite, Microsoft MAI-Image-2.5, Sora 2 দিয়ে দীর্ঘ গল্প তৈরির পরীক্ষা এবং Midjourney-এর “মেডিক্যাল স্পায় পিভট” করার চমকপ্রদ খবর😲 অ্যান্টি-AI কমিউনিটি !fuck_ai-এর (8,252 সদস্য) দৃশ্যমানতাও Lemmy-র নিজস্ব বিশেষ আবিষ্কার।

Pinterest: কর্মীর আগাম সংগৃহীত ৫০টি পিনের মধ্যে ছবি-সহ ৩০টি যাচাই করা হয়েছে। ক্লোজড-সোর্স টুল তালিকা ও পুনর্ব্যবহৃত “AI NEWS” থাম্বনেইল টেমপ্লেট ব্যাপক, আর ওপেন-সোর্সের উপস্থিতি প্রায় নেই—শুধু Amuse 3.0 নামের একটি লোকাল টুল একবার দেখা গেছে। Google Veo-এর ভিজ্যুয়াল অস্বাভাবিকভাবে পুনর্ব্যবহৃত, এবং “এটি AI নাকি আসল?” যাচাই কুইজ একটি স্বতন্ত্র ঘরানায় পরিণত হয়েছে🎨

নজরে রাখুন

  • MiniMax-H3-এর জন্য ComfyUI টুলের দ্রুত বৃদ্ধি (Lemmy !stable_diffusion, উদাহরণ: https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS) — ওপেন-সোর্স ভিডিও জেনারেশনের নতুন প্রধান চরিত্র হওয়ার সম্ভাবনা🔥
  • Sora 2-এর “production memory” সমস্যা (Lemmy হয়ে Reddit, https://lemmy.durstig.online/post/59922) — একক ক্লিপের চেয়ে দীর্ঘমেয়াদি ধারাবাহিকতা বজায় রাখাই পরবর্তী বড় বাধা হতে পারে
  • Google Nano Banana Pro-এর একচ্ছত্র দৌড়ের দাবি (YouTube・Theo - t3.gg, https://www.youtube.com/watch?v=UV9GqinedQ8) — “Photoshop লাগবে না” পর্যায়ে সত্যিই পৌঁছেছে? পরের খবরের অপেক্ষা
  • GPT Image 2.5 Flare বনাম ওপেন-সোর্স Krea2 বিতর্ক (Reddit, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/) — পেইড সংস্করণের প্রকৃত সুবিধাই প্রশ্নের মুখে
  • ArtPrize-এর AI কাজ গ্রহণের প্রশ্ন (Reddit r/grandrapids, https://www.reddit.com/r/grandrapids/comments/1wi4ub0/) — সাধারণ সমাজে গ্রহণযোগ্যতার সীমা মাপার সূচক হতে পারে
  • Midjourney-এর মেডিক্যাল স্পায় রূপান্তর ও হলিউডের প্রকাশ-দাবি (Lemmy, https://lemmy.zip/post/66397234 、https://lemmy.today/post/56011946) — কোম্পানি হিসেবে বিশ্বাসযোগ্যতার ঝুঁকি দেখা দিচ্ছে

সুপারিশ

  • X পর্যায়ে "Sora 2" "Midjourney" "Stable Diffusion" "Runway Gen" "Kling AI" "open source image generation"-এর মতো বিষয়-সংশ্লিষ্ট সার্চ টার্ম দিয়ে পুনরায় সংগ্রহ করুন।
  • MiniMax-H3, Qwen, Wan ও Z-Image-এর মতো চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের হার প্রতিবার ওয়াচলিস্টে রাখুন।
  • AI-কেন্দ্রিক সাবের পাশাপাশি সাধারণ ও পেশাভিত্তিক কমিউনিটির প্রতিক্রিয়াও নিয়মিত অনুসরণ করুন; কারণ প্রতিক্রিয়ার সংকেত সেখানে বেশি শক্তিশালী।
  • Bluesky অফিসিয়াল সার্চ API-এর 403 সমস্যার বিকল্প সমাধান পরবর্তীবারের আগে যাচাই করুন।
  • Sora 2-এর “production memory” সমস্যা এবং Midjourney-এর মেডিক্যাল স্পায় রূপান্তর পরবর্তী রানেও অনুসরণ করুন।
  • Pinterest সংগ্রহে ঘরানা-ট্যাগ যুক্ত করুন, যাতে ওপেন/ক্লোজড মডেল যান্ত্রিকভাবে আলাদা করা যায়।

ডেটার গুণমান

X পর্যায়ে ব্যবহৃত সার্চ টার্ম বিষয়ের সঙ্গে সম্পর্কহীন—ভূরাজনীতি, ক্রিপ্টোকারেন্সি ও ফুটবলের মতো বিষয়—হওয়ায় সংগৃহীত ৪০টি পোস্টের মধ্যে বিষয়-সম্পর্কিত পোস্ট ছিল ০টি; কার্যত ব্যবহারযোগ্য ডেটা ছিল না। Reddit (১২টি) ও Bluesky (সার্চ API ব্লক থাকায় ব্যক্তিগত অ্যাকাউন্ট থেকে প্রায় ১২টি) ব্রিফের “প্রতি প্ল্যাটফর্মে প্রায় ২০টি” সম্পন্নতার মানদণ্ডে পৌঁছায়নি। Pinterest ও YouTube-তেও আংশিক সীমাবদ্ধতা ছিল—Pinterest-এ ঘরানা-ট্যাগ নেই এবং লাইভ ব্রাউজিং হয়নি, আর YouTube-এ ভিউ ও সাবস্ক্রাইবার সংখ্যা JavaScript-নির্ভর হওয়ায় পাওয়া যায়নি। তবু সারাংশের জন্য যথেষ্ট তথ্য পাওয়া গেছে। Lemmy ও YouTube তুলনামূলকভাবে নির্ভরযোগ্য ছিল এবং ওপেন/ক্লোজড উভয় দিক নিয়ে নির্দিষ্ট অন্তর্দৃষ্টি দিতে পেরেছে।

প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ

Reddit

Reddit — ছবি ও ভিডিও জেনারেশন AI নিউজ

কোথায়

সংগৃহীত ১২টি থ্রেড এসেছে ৯টি সাবরেডিট থেকে।

সাবরেডিট সদস্যসংখ্যা সংগৃহীত থ্রেড
r/generativeAI 154,961 4
r/graphic_design 2,929,382 1
r/GeminiAI 375,783 1
r/grandrapids 161,719 1
r/aitubers 28,785 1
r/ImagineAiArt 19,335 1
r/AIToolTalks 6,757 1
r/aifilmmaking 8,200 1
r/aivideomaking 7,267 1

r/generativeAI হলো AI ছবি ও ভিডিও জেনারেশন নিয়ে কেন্দ্রীয় হাব (৪টি পোস্ট)। r/GeminiAI ও r/ImagineAiArt-এ ক্লোজড-সোর্স মডেলের অভিজ্ঞতা, r/aifilmmaking ও r/aivideomaking-এ ভিডিও প্রযোজনার বাস্তব কাজের দৃষ্টিভঙ্গি, r/grandrapids ও r/graphic_design-এ AI-তৈরি কনটেন্ট বাস্তব জগৎ—শিল্প প্রতিযোগিতা ও কর্মক্ষেত্র—মুখোমুখি হলে প্রতিক্রিয়া, আর r/AIToolTalks AI নিয়ে সার্বিক উদ্বেগের আশ্রয়স্থল।

মানুষ কী বলছে
  • থ্রেড ১ “Which AI video generator can still be used for free?” (r/generativeAI・18pt・57 মন্তব্য・2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — ক্লোজড-সোর্সের ফ্রি টিয়ার শেষ হলে ওপেন-সোর্স/লোকাল জেনারেশন (Wan, Minimax) বিকল্প হয়ে ওঠে। u/RioMetal: “If you can go local you have plenty of them, like Wan or Minimax”
  • থ্রেড ২ “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?” (r/ImagineAiArt・84pt・60 মন্তব্য・2026-09-16) https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ — মতামত সম্পূর্ণ বিভক্ত। u/oldboi777 একে “incredible upgrade” বললেও u/SeaworthinessFresh16 বলেছে, “The result in Comfyui with Krea2 looks the same”—অর্থাৎ ওপেন-সোর্স Krea2-এর সঙ্গে বড় পার্থক্য নেই।
  • থ্রেড ১২ “Need a good video generation AI for image to video of people” (r/generativeAI・0pt・22 মন্তব্য・2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ — ক্লোজড-সোর্স Google Flow / Nano Banana Pro-এর সেন্সরশিপ ফিল্টার নিয়ে অভিযোগ পোস্টের মূল বিষয়। u/f5alcon: “Minimax H3 is the best local generator”; u/jworm0624: “Krea 2 turbo for images, minimax h3 for videos. All on comfyui”—ওপেন-সোর্স বিকল্পের সুপারিশ।
  • থ্রেড ৭ “Google Flow is giving creators a surprisingly generous amount of free AI video generation right now” (r/aifilmmaking・8pt・7 মন্তব্য・2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — ক্লোজড-সোর্স Google Flow/Veo ফ্রি ক্রেডিট বাড়িয়েছে; শুধু টেক্সট-টু-ভিডিও থেকে দৃশ্য নির্মাণ, ক্যামেরা নিয়ন্ত্রণ ও রেফারেন্স অ্যাসেটসহ প্রোডাকশন ওয়ার্কস্পেসে রূপান্তরিত হচ্ছে। তবে u/MrBoondoggles-এর শীতল মন্তব্য: “I'm not surprised Google is giving away Veo at this point... trying to maintain some interest in their product”
  • থ্রেড ৮ “Did Anyone Notice Sudden Quality Drop of Image Generation? From 2 MB to 500 KB” (r/GeminiAI・10pt・25 মন্তব্য・2026-09-17) https://www.reddit.com/r/GeminiAI/comments/1wj02p4/ — ক্লোজড-সোর্স Gemini-তে ছবির মান কমা—PNG→JPEG, 8MB→2MB→500KB—নিয়ে অভিযোগ, পেইড ব্যবহারকারীরাও অসন্তুষ্ট। u/Well_HellooF: “there's no difference in quality between the free version and the paid one. suck”
  • থ্রেড ৫ “ArtPrize Allows Generative AI” (r/grandrapids・354pt・176 মন্তব্য・2026-09-16) https://www.reddit.com/r/grandrapids/comments/1wi4ub0/ — শিল্প প্রতিযোগিতায় AI-তৈরি কাজ গ্রহণ নিয়ে প্রবল বিরোধিতা। u/Chirotera (319pt): “Fucking disgusting. It is not AI "Art," it's fucking theft.” প্রযুক্তি সাবের তুলনায় সাধারণ কমিউনিটির ক্ষোভ বেশি।
  • থ্রেড ১০ “Company expects us to generate 500 AI images PER WEEK. Is this realistic?” (r/graphic_design・63pt・133 মন্তব্য・2026-09-17) https://www.reddit.com/r/graphic_design/comments/1wieke2/ — কর্মক্ষেত্রের ডিজাইনাররা ক্লোজড-সোর্স টুল ChatGPT ব্যবহার করে ব্যাপক উৎপাদনের কোটায় বিপর্যস্ত। u/Diligent-Educator409 (123pt): “500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no.”
  • থ্রেড ৯ “best apps for generating AI videos” (r/aitubers・0pt・46 মন্তব্য・2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — স্ক্রিপ্ট থেকে স্বয়ংক্রিয় ভিডিও বানানো ক্লোজড-সোর্স টুল InVideo AI, Steve AI ইত্যাদির চাহিদা আছে, কিন্তু কমিউনিটির প্রতিক্রিয়া ঠান্ডা। u/RobJames007 (15pt): “Youtube is trying to reduce AI slop, not allow more of it onto the platform.”
  • থ্রেড ৩ “Please help me generate free ai video without subscription” (r/aivideomaking・0pt・20 মন্তব্য・2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ — u/Chance-Business বলেছে “google flow you get 50 free credits per day, each vid is 6-12 credits”; আর u/Bastisheen92 বলেছে “Local Generation is free if you already own the Hardware”—ক্লোজডের ফ্রি টিয়ার বনাম ওপেনের লোকাল রান-এর পরিচিত বৈপরীত্য।
  • থ্রেড ১১ “Are all of you also anxious about recent news about AI?” (r/AIToolTalks・12pt・36 মন্তব্য・2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — এটি সরাসরি ছবি/ভিডিও জেনারেশন নয়; AI-এর পানি ব্যবহার, কর্মসংস্থান ক্ষতি ও নিয়ন্ত্রণ নিয়ে উদ্বেগের আলোচনা। মন্তব্যে তীব্র মতবিরোধ—u/Big-Pops78 পানি ব্যবহারের উদ্বেগকে আপেক্ষিক করে, অন্যদিকে u/UnburyingBeetle “cost efficiency” শব্দটি ব্যঙ্গ করে পাল্টা জবাব দেয়।
সংকেত
  • ঊর্ধ্বমুখী প্রবণতা: Wan, Minimax H3, LTX Video ও Krea2-এর মতো ওপেন-সোর্স/লোকাল মডেলের নাম একাধিক স্বাধীন থ্রেডে (১, ২, ১২) একই প্রসঙ্গে—ক্লোজড মডেলের ফ্রি টিয়ার শেষ হওয়ার পর বিকল্প—বারবার উঠছে। লোকাল জেনারেশন “বিনামূল্যে উচ্চমান”-এর প্রতিশব্দ হয়ে উঠছে।
  • অবজ্ঞা বা ব্যঙ্গের লক্ষ্য: “ফ্রি” দাবি করা ক্লোজড-সোর্স ভিডিও জেনারেশন সেবা নিয়ে ব্যঙ্গ তীব্র। একাধিক থ্রেডে (১, ৪, ৬, ১২) বট অ্যাকাউন্ট u/Jenna_AI একই ধরনের দীর্ঘ ব্যঙ্গাত্মক মন্তব্য করেছে—ফ্রি বললেও শেষে অর্থ দিতে হয়—যা কমিউনিটির সংশয়ী আবহকে প্রতিফলিত করে।
  • অপ্রত্যাশিত দিক: প্রযুক্তি-কেন্দ্রিক সাবরেডিটের চেয়ে সাধারণ কমিউনিটি (r/grandrapids, 354pt・176 মন্তব্য) এবং কাজকেন্দ্রিক সাব (r/graphic_design, 63pt・133 মন্তব্য)-এ AI প্রযুক্তি সাবগুলোর তুলনায় বেশি এনগেজমেন্ট ও স্কোর। AI-তৈরি কনটেন্ট দৈনন্দিন জীবন বা কাজের সঙ্গে সংঘর্ষে এলে প্রতিক্রিয়া ও বিতর্ক বাড়ে।
  • মতবিরোধ: থ্রেড ২-এ GPT Image 2.5 Flare নিয়ে “incredible upgrade” (u/oldboi777) ও “Krea2-এর মতোই ফল” (u/SeaworthinessFresh16)—বিপরীত মূল্যায়ন। থ্রেড ৭-এও Google Flow/Veo-কে “free credits are generous” বলার পাশাপাশি “it's weak at physics and logic. Even Minimax is far better” (u/Sea-Temporary-6995) মত রয়েছে।
সীমাবদ্ধতা
  • সংগৃহীত থ্রেড ১২টি, ব্রিফের সম্পন্নতার মানদণ্ড—প্রতি প্ল্যাটফর্মে প্রায় ২০টি পোস্ট বিশ্লেষণ—পূরণ হয়নি। কর্মীর সংগ্রহ করা এই ১২টিই Reddit-এর জন্য উপলব্ধ পূর্ণ ডেটা, এবং প্লেবুকের নির্দেশ অনুযায়ী এ পর্যায়ে অতিরিক্ত Reddit অনুসন্ধান বা ব্রাউজিং করা যায়নি।
  • শুধুমাত্র ইংরেজি “Image and Video Generation AI News” কুয়েরি ব্যবহার হয়েছে; জাপানি কুয়েরি বা “ওপেন সোর্স”, “ক্লোজড সোর্স”-এর মতো দৃষ্টিভঙ্গিভিত্তিক কুয়েরি ব্যবহারের কোনো চিহ্ন নেই।
  • r/aitubers, r/aivideomaking ও r/AIToolTalks-এর মতো কিছু সাবরেডিট থেকে মাত্র একটি করে থ্রেড নেওয়া হয়েছে; ফলে তাদের অভ্যন্তরীণ প্রবণতার শক্তি নির্ণয় করা যায় না।

X

X — ছবি ও ভিডিও জেনারেশন AI (ক্লোজড/ওপেন সোর্স) নিউজ

অ্যাকাউন্ট

এবার output/x.posts.md-তে সংগৃহীত ৩৯টি অ্যাকাউন্ট ও ৪০টি পোস্ট সবকটিই ছবি/ভিডিও জেনারেশন AI-এর সঙ্গে সম্পর্কহীন। সার্চ টার্ম ছিল “Greenland”, “Denmark”, “#Bitcoin”, “NATO”, “Christ”, “Jubjub”, “Charles”, “Bosnia”, “Chelsea”, “Belgrade”—এসব X-এর নিজস্ব Explore ট্রেন্ড থেকে সরাসরি নেওয়া সাধারণ ট্রেন্ড, যা সার্ভারের সংযোগ উৎস ক্রোয়েশিয়া অঞ্চলে ভূ-অবস্থানকৃত হওয়ার প্রভাব। গবেষণা ব্রিফের ছবি ও ভিডিও জেনারেশন AI বিষয়ের সঙ্গে সম্পর্কিত কোনো সার্চ টার্মই ছিল না।

তাই এই ডেটা দিয়ে “X-এ এই বিষয়টি কারা নেতৃত্ব দিচ্ছে” বলা সম্ভব নয়। কী সংগৃহীত হয়েছিল, শুধু তা নিচে দেওয়া হলো:

  • রাজনীতি/ভূরাজনীতি ক্লাস্টার: @RapidResponse47 (30,291 লাইক, গ্রিনল্যান্ড-সংক্রান্ত), @AJENews, @Rusia_HD, @Globalsurv, @NepCorres প্রমুখ—গ্রিনল্যান্ড, ডেনমার্ক ও NATO ঘিরে খবর/মতামত পোস্ট।
  • ক্রিপ্টোকারেন্সি ক্লাস্টার: @aacryptoverse, @Bitcoin_Pirate_, @StackandRun, @bitcr_org প্রমুখ—#Bitcoin ট্যাগের পোস্ট; লাইক সাধারণত এক অঙ্ক থেকে কয়েক দশক।
  • রাজপরিবারের গসিপ ক্লাস্টার: @barristerlawusa, @hernandez_64876, @thebluestshade, @Rimmesfk—“Charles” অর্থ চার্লস স্পেন্সারের প্রকাশিত স্মৃতিকথা ঘিরে আলোচনা।
  • ফুটবল ক্লাস্টার: @icunga_, @john322226, @Cfc_Kemboi, @Pats_Aura—“Chelsea” অর্থ Chelsea FC-এর ম্যাচ ফলাফল।
  • মিম/আড্ডা ক্লাস্টার: @SardineKing_O, @isellbeforeyou, @0xHeatt—“$jubjub” ক্রিপ্টো-মিম কয়েন; @MarquiseDeBelgr-এর সার্বিয়ান ভাষার কথোপকথনমূলক পোস্ট দুটি।

কোনো অ্যাকাউন্টে ১–২টির বেশি পোস্ট নেই; ধারাবাহিকভাবে অসাধারণ সক্রিয় অ্যাকাউন্টও নেই। @RapidResponse47-এর একটি পোস্ট—৩০ হাজার লাইক ও প্রায় ৬.৮ মিলিয়ন ভিউ—সেটের মধ্যে ব্যতিক্রমী, কিন্তু তা গ্রিনল্যান্ডের সার্বভৌমত্ব প্রশ্নে এবং এই বিষয়ের সঙ্গে সম্পর্কহীন।

পোস্ট

ছবি ও ভিডিও জেনারেশন AI—ক্লোজড বা ওপেন সোর্স—উল্লেখকারী পোস্ট সংগৃহীত ৪০টির মধ্যে ০টি। ফলে “প্রতিনিধিত্বশীল পোস্ট” দেখানোর মতো কিছু নেই। নমুনার প্রকৃতি বোঝাতে সর্বোচ্চ এনগেজমেন্টের একটি পোস্ট নিচে দেওয়া হলো; এটি বিষয়বহির্ভূত:

  1. @RapidResponse47 (বিষয়বহির্ভূত・শুধু রেফারেন্স) — 30,291 likes・5,022 reposts・1,164 replies・প্রায় 6,800,000 views・2026-09-18।https://x.com/RapidResponse47/status/2101059494587285834 “Greenland” সার্চে পাওয়া। গ্রিনল্যান্ডের সার্বভৌমত্ব নিয়ে রাজনৈতিক পোস্ট; AI-তৈরি ছবি বা ভিডিওর সঙ্গে সম্পর্কহীন।
সংকেত
  • X পর্যায়ের ডেটায় ছবি ও ভিডিও জেনারেশন AI—Midjourney, Sora, Runway, Stable Diffusion, Flux, Wan, Kling ইত্যাদি—সংক্রান্ত কোনো উল্লেখ, আলোচনা বা খবর একটিও পাওয়া যায়নি। কী আলোচিত হচ্ছে বা হচ্ছে না, তা বিচার করার উপাদানই নেই।
  • ব্যবহৃত সার্চ টার্ম—Greenland, Denmark, #Bitcoin, NATO, Christ, Jubjub, Charles, Bosnia, Chelsea, Belgrade—output/x.posts.md-এর শুরুতে থাকা “X's own Explore list” শিরোনামের সঙ্গে পুরোপুরি মিলে যায়। অর্থাৎ ভূরাজনীতি, রাজপরিবারের গসিপ, ফুটবল ও ক্রিপ্টো মিমের স্থানীয় ট্রেন্ড সার্চ করা হয়েছে; বিষয়ভিত্তিক “image generation AI”, “video generation AI”, “Sora”, “Midjourney”, “Stable Diffusion”, “open source AI” ইত্যাদি একবারও ব্যবহার হয়নি।
  • তাই এই পর্যায় থেকে ক্লোজড-সোর্স বা ওপেন-সোর্স—কোনো দিকেরই একটি অন্তর্দৃষ্টি বের করা যায় না।
সীমাবদ্ধতা
  • সংগ্রহ নিজেই বিষয়ের সঙ্গে মিলেনি। output/x.posts.md-এর ১০টি সার্চ টার্মের একটিও ছবি/ভিডিও জেনারেশন AI-সম্পর্কিত নয়; এগুলো ভূরাজনীতি, রাজপরিবারের গসিপ, ফুটবল ও ক্রিপ্টো মিমের Explore ট্রেন্ড। কর্মী একবারও ক্লোজড/ওপেন ছবি ও ভিডিও AI-সংক্রান্ত সার্চ চালাননি। ফলে X পর্যায়ের “প্রায় ২০টি বিষয়-সম্পর্কিত পোস্ট” বিশ্লেষণের সম্পন্নতার মানদণ্ড পূরণ হয়নি।
  • ৪০টি পোস্ট বিশ্লেষণ করা হলেও ছবি/ভিডিও জেনারেশন AI উল্লেখকারী পোস্ট ছিল শূন্য।
  • output/x.posts.json-এও একই ডেটা, তাই অতিরিক্ত কোনো সূত্র পাওয়া যায়নি।
  • এই রানের X পর্যায়ের একমাত্র সিদ্ধান্ত: সংগৃহীত সার্চ টার্ম ও পোস্টের ভিত্তিতে ছবি ও ভিডিও জেনারেশন AI-এর ক্লোজড বা ওপেন-সোর্স প্রবণতা নিয়ে X থেকে কোনো অন্তর্দৃষ্টি দেওয়া সম্ভব নয়। “Sora 2”, “Midjourney”, “Stable Diffusion”, “Runway Gen”, “Kling AI”, “Flux”, “open source image generation”-এর মতো সার্চ টার্মে পুনরায় সংগ্রহ দরকার।

YouTube

YouTube — ছবি ও ভিডিও জেনারেশন AI-এর (ক্লোজড সোর্স/ওপেন সোর্স) সাম্প্রতিক প্রবণতা

চ্যানেল

ক্লোজড-সোর্সমুখী

  • Theo - t3.gg(@t3dotgg)— Google Nano Banana Pro-এর প্রযুক্তিগত বিশ্লেষণ
  • Astrovah(@astrovah)— Sora 2 রিভিউ ও ব্যবহারিক উদাহরণ
  • Woollyfern(@woollyferncreative)— Midjourney মাসিক আপডেট-কেন্দ্রিক চ্যানেল
  • FixNode(@Fixnode1)— Runway Gen-4.5 টিউটোরিয়াল
  • Higher E-Learning(@higherelearning)— Adobe Firefly-তে একীভূত মডেল যাচাই
  • AIPOD-CAST(@AIPOD-CAST)— সাপ্তাহিক AI নিউজ সারাংশ (Episode 220-এর আশপাশ)
  • Lev Selector(@lev-selector)— সাপ্তাহিক AI আপডেট সারাংশ

ওপেন-সোর্সমুখী

  • Bijan Bowen(@Bijanbowen)— Qwen Image-এর লোকাল টেস্ট
  • HitPaw Edimakor(@HitPawEdimakorOfficial)— Wan সিরিজের রিভিউ ও ব্যবহারপদ্ধতি
  • MaxonShire(@MaxonShire)— ওপেন-সোর্স ভিডিও মডেল তুলনামূলক পরীক্ষা
  • Promptus AI(@promptusai)— Z-Image-এর মতো নতুন মডেল লোকালি সেটআপের গাইড
  • 黎黎原上啃 / SweetValberry(@SweetValberry)— FLUX.1 Kontext-সহ চীনা ভাষাভাষী ব্যাখ্যামূলক কনটেন্ট

কোনো চ্যানেল পাতাতেই সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি (নিচের সীমাবদ্ধতা দেখুন), তাই আকার বা পরিসর যাচাই করা যায়নি।

ভিডিও
  1. “Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN” — Theo - t3.gg/প্রকাশকাল অজানা (Nano Banana Pro নিজে 2025-11-20-এ ঘোষিত, ভিডিওটি তার পরে)/ভিউ অজানা
    https://www.youtube.com/watch?v=UV9GqinedQ8
    Gemini 3 Pro-ভিত্তিক Nano Banana Pro-এর ছবি তৈরির মান “Photoshop লাগবে না” পর্যায়ের এবং ক্লোজড-সোর্স প্রতিদ্বন্দ্বীদের মধ্যে স্পষ্টতই এগিয়ে—এমন দাবি।

  2. “Sora 2 - An Honest Review As Well As 20 Creative Use Cases To Try” — Astrovah/2025-10-07/ভিউ অজানা
    https://www.youtube.com/watch?v=pJHWIgri5vk
    Sora 2-কে “এ পর্যন্ত সবচেয়ে বাস্তবসম্মত AI ভিডিও” হিসেবে মূল্যায়ন করে এবং কাজের ক্ষেত্রে ব্যবহারের ২০টি ধরন দেখায়।

  3. “Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More!” — Woollyfern/2026-07/ভিউ অজানা
    https://www.youtube.com/watch?v=dvfH5HzCARY
    Midjourney V8.2-তে personalization এবং NIJI-এর জন্য style creator যুক্ত হয়েছে—মাসিক সিরিজের সর্বশেষ পর্ব।

  4. “I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)” — Higher E-Learning/2026-07/ভিউ অজানা
    https://www.youtube.com/watch?v=nOSYufWVdq8
    Adobe Firefly-তে Veo 3.1, Kling 3.0, Runway Gen-4.5 ও Sora 2 পর্যন্ত একীভূত হওয়ার পর সব মডেলের পাশাপাশি পরীক্ষা।

  5. “Ultimate Runway Gen 4.5 Tutorial For New Users in 2026” — FixNode/2026-03-29/ভিউ অজানা
    https://www.youtube.com/watch?v=IUge3u4ZrqQ
    Runway Gen-4.5-এর image-to-video টিউটোরিয়াল; সিনেমাটিক টেক্সচারের ওপর জোর।

  6. “Episode 222: Weekly AI News Summary - 6 September 2026” — AIPOD-CAST/2026-09-06/ভিউ অজানা
    https://www.youtube.com/watch?v=8f34nSLdNtk
    মডেল, এজেন্ট ও ব্যবসায়িক গতিপ্রকৃতি নিয়ে সাপ্তাহিক সারাংশে ছবি/ভিডিও জেনারেশন AI নিউজও রয়েছে।

  7. “Exciting AI Updates Weekly - September 18, 2026” — Lev Selector/2026-09-18/ভিউ অজানা
    https://www.youtube.com/watch?v=Utu4zIcqPtM
    ব্যক্তিগত চ্যানেলের গত সপ্তাহের AI আপডেটের দ্রুত সারাংশ। এই গবেষণায় সবচেয়ে সাম্প্রতিক পোস্ট।

  8. “Qwen Image-2512 First Test – The BEST Open Source Image Model!” — Bijan Bowen/প্রকাশকাল অজানা (মডেলটি 2025-12 সংস্করণ)/ভিউ অজানা
    https://www.youtube.com/watch?v=SBaK616nP6Q
    Alibaba-এর Qwen-Image-2512 (২০ বিলিয়ন প্যারামিটার) লোকালি পরীক্ষা করে একে বর্তমানের শক্তিশালী ওপেন-সোর্স ছবি মডেল বলা হয়েছে।

  9. “Wan 2.6 Review | How to Use Wan 2.6 for Free | New AI Video Generator Tutorial” — HitPaw Edimakor/প্রকাশকাল অজানা (মডেলটি 2025-12-এ প্রকাশিত)/ভিউ অজানা
    https://www.youtube.com/watch?v=6FMisTHYYgA
    Alibaba Wan 2.6 বিনা খরচে ব্যবহার ও রিভিউ; T2V/I2V/R2V-সহ নানা মোডের উল্লেখ।

  10. “HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?” — MaxonShire/2026-06-25/ভিউ অজানা
    https://www.youtube.com/watch?v=4GNT4-QYekg
    Tencent HunyuanVideo 1.5 ও Alibaba Wan 2.7 (2026-04-22 প্রকাশিত)—দুই প্রধান ফ্রি লোকাল ভিডিও মডেলের সরাসরি তুলনা।

  11. “Z-Image Open-Source Image Generator: Free Online and Local Setup” — Promptus AI/2026 (সুনির্দিষ্ট সময় অজানা)/ভিউ অজানা
    https://www.youtube.com/watch?v=JF4Q5hXh-_Q
    Alibaba-এর Z-Image (৬ বিলিয়ন প্যারামিটার, S3-DiT আর্কিটেকচার) হালকা হলেও Flux 2 ও Qwen Image-এর চেয়েও ভালো গুণমান দিতে পারে—এমন পরিচিতি; ComfyUI সমন্বয়ও ব্যাখ্যা করা হয়েছে।

  12. “FLUX.1 Kontext [dev] is open source! Try image editing locally in ComfyUI” — 黎黎原上啃/2025 (Flux Kontext Dev প্রকাশের পর)/ভিউ অজানা
    https://www.youtube.com/watch?v=v4pp3TdbWNw
    Black Forest Labs-এর Flux Kontext Dev মডেলের ওজন প্রকাশের পর ComfyUI-তে লোকাল ছবি সম্পাদনার প্রদর্শনী। পুরোনো হলেও ওপেন-সোর্স ছবি সম্পাদনার ধারার সূচনাবিন্দু বোঝার জন্য অন্তর্ভুক্ত।

সংকেত
  • ক্লোজড-সোর্স পক্ষ “মাসিক আপডেট” নিয়মিত করেছে: Midjourney-এর Woollyfern “Update” সিরিজ প্রতি মাসে ভিডিও প্রকাশ করছে; ২০২৬-এ V8→V8.1→V8.2 ধারাবাহিকভাবে এগিয়েছে। Runway ও Adobe Firefly-র বড় আপডেটও প্রযুক্তি চ্যানেলগুলো দ্রুত রিভিউ করছে।
  • অডিও সিঙ্ক ক্লোজড-সোর্স ভিডিও জেনারেশনের মানক ফিচার হয়ে উঠছে: Kling 3.0 (৫ ভাষায় নেটিভ সংলাপ), Seedance 2.0 (অডিও-ভিডিওর সমন্বিত আর্কিটেকচার, প্রতিধ্বনি পর্যন্ত), Grok Imagine 1.5 (সংলাপ ও পরিবেশের শব্দ একসঙ্গে)—বহু ফলেই শব্দ ও দৃশ্য একসঙ্গে জেনারেশনের নকশা জোর দিয়ে বলা হয়েছে। প্রতিযোগিতার অক্ষ একক ভিজ্যুয়াল থেকে “অডিওসহ শর্ট মুভি” তৈরির দিকে সরে যাচ্ছে।
  • বিশেষত চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের গতি ক্লোজড মডেলের সমান বা বেশি: শুধু Alibaba-তেই Qwen-Image→Qwen-Image-2512→Z-Image, Wan 2.5→2.6→2.7 অল্প ব্যবধানে এসেছে। Tencent HunyuanVideo 1.5 ও Lightricks LTX-2→2.3→2.5-ও প্রায় মাসিক বা ত্রৈমাসিক গতিতে উন্নত হচ্ছে। ভিডিও শিরোনামে “সেরা ওপেন সোর্স”, “অমুককে হারাল”—এমন ভাষা প্রচুর; দর্শকের আগ্রহের ইঙ্গিত।
  • ওপেন-সোর্স ভিডিওর অধিকাংশই “ComfyUI”, “লোকাল রান”, “ফ্রি” প্রচার করে: HitPaw Edimacor, Promptus AI, MaxonShire প্রভৃতি চ্যানেল “বিনা খরচে ব্যবহার” ও “লোকাল GPU-তে চালানো”-কে সামনে আনে। বিপরীতে Theo, Astrovah ও Woollyfern-এর মতো ক্লোজড-সোর্স চ্যানেল গুণমান ও ফিচার রিভিউ-নির্ভর।
  • সাপ্তাহিক AI নিউজ ফরম্যাটের চ্যানেল—AIPOD-CAST ও Lev Selector—ছবি/ভিডিও জেনারেশন AI-কে নিয়মিত সেগমেন্ট করেছে, যা দেখায় এটি একক খবর নয়, ধারাবাহিক নজরদারির বিষয়।
সীমাবদ্ধতা
  • YouTube-এর সার্চ ফলের পাতা (https://www.youtube.com/results?search_query=…) JavaScript দিয়ে ডায়নামিকভাবে রেন্ডার হয়। WebFetch-এ কেবল ফুটারের নেভিগেশন লিংক পাওয়া যায়, তাই HTML থেকে শিরোনাম, চ্যানেল, ভিউ ও প্রকাশের তারিখ পড়ার প্রত্যাশিত পদ্ধতি কাজ করেনি।
  • বিকল্প হিসেবে site:youtube.com ওয়েব সার্চে ভিডিও খুঁজে YouTube-এর oembed এন্ডপয়েন্টে শিরোনাম ও চ্যানেল নিশ্চিত করা হয়েছে। এতে ভিউ বা চ্যানেল সাবস্ক্রাইবার সংখ্যা একেবারেই পাওয়া যায়নি, তাই উপরের তালিকায় ভিউ “অজানা”।
  • একই কারণে কিছু ভিডিওর সঠিক প্রকাশের তারিখ নিশ্চিত করা যায়নি: Nano Banana Pro বিশ্লেষণ, Qwen Image-2512 টেস্ট, Wan 2.6 রিভিউ ও Z-Image পরিচিতি। সার্চ স্নিপেট ও সংশ্লিষ্ট মডেলের রিলিজ সময় থেকে কেবল আনুমানিক সময় দেওয়া হয়েছে।
  • ভিডিওর বিবরণ ও টপ মন্তব্যও JavaScript-নির্ভর পৃষ্ঠার কারণে সরাসরি পড়া যায়নি।
  • ৬০ দিনের মধ্যে—2026-07-22-এর পরের—পোস্টকে অগ্রাধিকার দেওয়া হলেও, Flux Kontext ও Runway Gen-4.5 টিউটোরিয়ালের মতো উভয় ধারার ইতিহাস বোঝার জন্য গুরুত্বপূর্ণ ১–২টি পুরোনো ভিডিও প্রেক্ষাপট হিসেবে অন্তর্ভুক্ত হয়েছে।

Bluesky

Bluesky — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা

অ্যাকাউন্ট
  • Simon Willison (@simonwillison.net) — স্বতন্ত্র AI গবেষক। নতুন মাল্টিমোডাল মডেল এলে নিজের “সাইকেল চালানো পেলিক্যান” ছবি বেঞ্চমার্ক দিয়ে ইমেজ জেনারেশন ক্ষমতা পরীক্ষা করেন। প্রায় ৫০ হাজার অনুসারী; ঘন ঘন পোস্ট করেন।
  • Max Woolf (@minimaxir.bsky.social) — সাবেক BuzzFeed ডেটা বিজ্ঞানী। AI কনটেন্ট জেনারেশনের নৈতিকতা ও R&D-তে অভিজ্ঞ; ছবি মডেল রিলিজে প্রায়ই প্রতিক্রিয়া দেন।
  • Ethan Mollick (@emollick.bsky.social) — Wharton-এর অধ্যাপক। AI-এর সার্বিক প্রবণতার আলোচনায় AI ভিডিওর গুণগত পরিবর্তনও উল্লেখ করেন।
  • Replicate (@replicate.com) — মডেল হোস্টিং সেবার অফিসিয়াল অ্যাকাউন্ট। নতুন ক্লোজড-সোর্স ছবি বা ভিডিও মডেল প্ল্যাটফর্মে এলে ঘোষণা দেয়।
  • Stability AI (@stabilityai.bsky.social) — Stable Diffusion-এর নির্মাতার অফিসিয়াল অ্যাকাউন্ট। তবে সাম্প্রতিক পোস্ট Stable Audio ও এন্টারপ্রাইজ ছবি-সম্পাদনা API-কেন্দ্রিক; 2025-11-19-এর পর থেকে পোস্ট বন্ধ।
  • Stable Diffusion online AI (@stablediffusion.bsky.social) — SDXL/ComfyUI-ধাঁচের প্রম্পট-শেয়ারিং ও AI আর্ট সারাংশ অ্যাকাউন্ট (প্রায় ১,৮০০ অনুসারী)। 2025-02-24-এর পর থেকে নিষ্ক্রিয়।
  • AI Art News (@ai-art-news.bsky.social) — AI আর্ট সংবাদ কিউরেশন অ্যাকাউন্ট। 2025-09-18-এর পর কোনো পোস্ট নেই।
পোস্ট
  1. Simon Willison (2026-09-19) — GPT-6 Astra ও Claude Fable 5.1 দিয়ে ম্যাপ ডেটা ব্যবহার করে Blender-এর জন্য 3D মডেল তৈরির পোস্টের ধারাবাহিকতায় image-to-3D workflow তুলে ধরেন। লাইক 57・রিপোস্ট 5।
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  2. Simon Willison (2026-09-05) — GPT-6 Astra দিয়ে সাইকেল চালানো পেলিক্যানের দৃশ্য Blender-এ রেন্ডার করানোর পরীক্ষা। লাইক 405・রিপোস্ট 30।
    https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s

  3. Simon Willison (2026-09-04) — GPT-6 Astra, GPT-5.6 Sol/Terra/Luna পাশাপাশি রেখে “সাইকেল চালানো পেলিক্যান” ছবি বেঞ্চমার্কের তুলনামূলক গ্রিড। লাইক 206・রিপোস্ট 9।
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c

  4. Simon Willison (2026-09-02) — Claude Fable 5.1 (Max চিন্তন স্তর, প্রতি রান $3.30) দিয়ে এ পর্যন্ত সেরা SVG পেলিক্যান ছবি, পরে তা অ্যানিমেট করা। লাইক 362・রিপোস্ট 22।
    https://bsky.app/profile/simonwillison.net/post/3muimzxo2sk2g

  5. Max Woolf (2026-09-19) — ইমেজ জেনারেশন AI দিয়ে ভেক্টর-ধাঁচের “সাইকেল চালানো পেলিক্যান” বানাতে গিয়ে মডেলটি পা ও প্যাডেলের সম্পর্ক বোঝেনি—এই পর্যবেক্ষণ। লাইক 1।
    https://bsky.app/profile/minimaxir.bsky.social/post/3mvtt3uxdrk2c

  6. Max Woolf (2026-09-08) — OpenAI-এর নতুন ছবি মডেল ঘোষণায় মন্তব্য: “ChatGPT Images 2.0-এর সারসংক্ষেপ লেখা পিছিয়েছি ভালোই হয়েছে; এটিই বেশি গুরুত্বপূর্ণ মনে হচ্ছে”—ChatGPT Images 2.5-কে নির্দেশ করে। লাইক 4।
    https://bsky.app/profile/minimaxir.bsky.social/post/3muzq6mcadk2n

  7. Ethan Mollick (2026-09-19) — নিম্নমানের ব্যাপক AI কনটেন্ট বা “slop”-এর বন্যার মধ্যে সত্যিই আকর্ষণীয় AI ভিডিও কাজও দেখা দিতে শুরু করেছে—AI ভিডিও প্রযোজনার গুণগত পরিবর্তনের ইঙ্গিত। লাইক 58・রিপোস্ট 7।
    https://bsky.app/profile/emollick.bsky.social/post/3mvuss476oc2b

  8. Replicate (2026-04-21) — OpenAI-এর “GPT Image 2” Replicate-এ যোগ হয়েছে। ফটোরিয়ালিজম, টেক্সট রেন্ডারিং ও লেআউট অনুসরণের ক্ষমতা তুলে ধরা হয়েছে। লাইক 5।
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  9. Replicate (2026-04-09) — ByteDance-এর ভিডিও মডেল “Seedance 2.0” সব ব্যবহারকারীর জন্য উন্মুক্ত। টেক্সট, ছবি, ভিডিও ও অডিও একত্র করে; সিঙ্ক্রোনাইজড স্টেরিও অডিও ও বাস্তবধর্মী পদার্থবিদ্যা সমর্থন করে। লাইক 2・রিপোস্ট 1।
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  10. Replicate (2026-02-18) — Runway “Gen-4.5” প্রকাশের ঘোষণা। পদার্থগত নির্ভুলতা ও বাস্তবতা-কেন্দ্রিক সিনেমাটিক ভিডিও জেনারেশন। লাইক 2।
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  11. Replicate (2026-02-17) — Kuaishou “Kling 3.0” ও “Kling o3” Replicate-এ যুক্ত। মাল্টিশট 4K, সিঙ্ক্রোনাইজড অডিও, ভিডিও এডিটিং ও স্টাইল ট্রান্সফার সমর্থন করে। লাইক 2।
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  12. Replicate (2026-03-11) — Shengshu “Vidu Q3” Replicate-এ যুক্ত। সর্বোচ্চ ১৬ সেকেন্ড ও 1080p, সিঙ্ক্রোনাইজড অডিওসহ টেক্সট/ছবি/শুরুর-শেষ ফ্রেম থেকে ভিডিও তৈরি। লাইক 1।
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

সংকেত
  • ক্লোজড-সোর্সের আধিপত্য: Bluesky-তে পাওয়া সংশ্লিষ্ট পোস্টগুলো প্রায় সবই OpenAI (GPT Image 2 / ChatGPT Images 2.5), Runway (Gen-4.5), Kling (3.0), Seedance (2.0), Vidu (Q3)-এর মতো বড় ক্লোজড মডেল নিয়ে। এগুলো ভাইরাল স্বাভাবিক পোস্ট নয়; বরং Replicate-এর মতো মডেল-হোস্টিং ব্যবসার নতুন মডেল ঘোষণা, অথবা Simon Willison ও Max Woolf-এর মতো স্বতন্ত্র গবেষকের পরীক্ষামূলক পোস্ট থেকে এসেছে।
  • ওপেন-সোর্সের উপস্থিতি প্রায় নেই: Flux, Stable Diffusion, Qwen-Image, Wan, ComfyUI workflow ইত্যাদি নিয়ে পোস্ট করা সক্রিয় অ্যাকাউন্ট পাওয়া যায়নি। একমাত্র কাছাকাছি কমিউনিটি অ্যাকাউন্ট stablediffusion.bsky.social 2025-02-এর পর থেকে বন্ধ, আর Stability AI-ও 2025-11-এর পর নীরব; তাদের সাম্প্রতিক পোস্টও Stable Diffusion ছবি নয়, Stable Audio বা এন্টারপ্রাইজ API-কেন্দ্রিক।
  • “সাইকেল চালানো পেলিক্যান” ডি-ফ্যাক্টো বেঞ্চমার্ক: GPT-6 Astra ও Claude Fable 5.1-এর মতো নতুন মাল্টিমোডাল মডেল এলে একাধিক স্বাধীন পর্যবেক্ষক একই প্রম্পটে ছবি গুণমান তুলনা করেন। এটি Bluesky-র অভ্যন্তরীণ রসিকতা হলেও মডেলের ক্ষমতা মাপার অনানুষ্ঠানিক সাধারণ সূচক হয়ে উঠেছে।
  • কর্পোরেট অফিসিয়াল অ্যাকাউন্টের অনুপস্থিতি: OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai ও ComfyUI-এর সম্ভাব্য প্রধান হ্যান্ডল হয় নেই, নয়তো কোনো পোস্টবিহীন। ফলে Bluesky এসব কোম্পানির প্রাথমিক ঘোষণা চ্যানেল নয়; খবর আসে ব্যক্তি গবেষক বা Replicate-এর মতো মধ্যবর্তী প্ল্যাটফর্ম হয়ে।
  • ভিডিও জেনারেশন নিয়ে মূল্যায়নের পরিবর্তন: Ethan Mollick-এর পোস্টে যেমন দেখা যায়, ব্যাপক নিম্নমানের AI ভিডিওর মধ্যে বাস্তবেই উচ্চমানের কাজ উঠতে শুরু করেছে—এমন ধারণা বাড়ছে। তবে এটি সাধারণ পর্যবেক্ষণ, নির্দিষ্ট কোনো ওপেন-সোর্স ভিডিও মডেল নিয়ে নয়।
সীমাবদ্ধতা
  • Bluesky-এর অফিসিয়াল সার্চ API (https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) কিওয়ার্ড বদলালেও ও দুই ধরনের CORS প্রক্সি দিয়েও সর্বদা HTTP 403 Forbidden দিয়েছে; একেবারেই ব্যবহার করা যায়নি। https://bsky.app/search?q=... ওয়েব UI ক্লায়েন্ট-সাইড SPA হওয়ায় WebFetch-এ ভেতরের কনটেন্ট পাওয়া যায়নি।
  • বিকল্প হিসেবে প্রমাণীকরণ ছাড়াই চলা app.bsky.actor.getProfile ও app.bsky.feed.getAuthorFeed এন্ডপয়েন্ট ব্যবহার করে WebSearch বা অনুমান থেকে পাওয়া অ্যাকাউন্টভিত্তিক ফিড নেওয়া হয়েছে। ফলে ফলাফলটি Bluesky জুড়ে কিওয়ার্ড সার্চ নয়, কেবল খুঁজে পাওয়া অ্যাকাউন্টগুলোর পোস্টে সীমাবদ্ধ।
  • বড় ব্র্যান্ডগুলোর অফিসিয়াল অ্যাকাউন্ট—OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai, ComfyUI ও Stability AI-এর অংশ—অব্যবহৃত বা নীরব ছিল; সরাসরি তাদের কাছ থেকে খবর নেওয়া যায়নি।
  • সার্চ সীমাবদ্ধতার কারণে ব্রিফের “প্রায় ২০টি পোস্ট” মানদণ্ড কেবল সরাসরি বিষয়-সম্পর্কিত পোস্ট দিয়ে পূরণ করা যায়নি। ৭টি অ্যাকাউন্টের ১০০টির বেশি পোস্ট পড়ে সরাসরি সম্পর্কিত ১২টি বেছে দেওয়া হয়েছে।
  • ছবি বা ভিডিও নিজে প্রদর্শন ও যাচাই করা হয়নি; পোস্টের টেক্সট বিবরণই একমাত্র তথ্যসূত্র।

Lemmy

Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা (ক্লোজড/ওপেন সোর্স)

কমিউনিটি
  • !«メールアドレス» — 5,712 subscribers (স্থানীয় 893), 1,407 পোস্ট ও 1,927 মন্তব্য। ওপেন-ওয়েট ছবি/ভিডিও মডেলের সাধারণ আলোচনা। দৈনিক সক্রিয় 10, মাসিক 66—ছোট হলেও নিয়মিত আপডেট হয়।
  • !«メールアドレス» — 2,362 subscribers; দৈনিক 24/সাপ্তাহিক 114/মাসিক 344। Stable Diffusion-ভিত্তিক ওপেন-ওয়েট মডেলে তৈরি কাজ শেয়ারের স্থান; বেশিরভাগই civitai ছবির সরাসরি লিংক।
  • !«メールアドレス»(কমিউনিটির নাম share_anime_art, প্রদর্শিত নাম “Stable Diffusion Anime”)— 1,598 subscribers (স্থানীয় 206)। শুধু SFW অ্যানিমে-ধাঁচের AI ছবি পোস্টের কমিউনিটি।
  • !«メールアドレス» — 8,252 subscribers (স্থানীয় 3,027), মাসিক সক্রিয় 9,179—এই পর্যবেক্ষণে দেখা বৃহত্তমগুলোর একটি। “a place for all those who loathe AI” স্লোগানের অ্যান্টি-AI কমিউনিটি; ছবি/ভিডিও জেনারেশনের চেয়ে AI-সংক্রান্ত সাধারণ সমালোচনা ও ব্যঙ্গই মূল।
  • !«メールアドレス» — মাত্র 52 subscribers হলেও r/ArtificialInteligence ইত্যাদি Reddit থ্রেড RSS-এ মিরর করে; ছবি/ভিডিও AI বিষয় ঘন ঘন আসে। ছয় মাসে সক্রিয় 725।
  • !«メールアドレス»・!«メールアドレス»・!«メールアドレス» — সাধারণ প্রযুক্তি কমিউনিটি; Midjourney-সম্পর্কিত বড় খবর এখানে এসেছে।
পোস্ট
  1. সেপ্টেম্বরে MiniMax-H3-এর জন্য ComfyUI টুলের দ্রুত বৃদ্ধি (ওপেন সোর্স) — !«メールアドレス»-এ 2026-09-01 থেকে 09-16-এর মধ্যে MiniMax-H3 ভিডিও মডেলের জন্য অন্তত ১৫টির বেশি টুল পোস্ট। উদাহরণ:
  2. Boogu-Image-0.1 — Huawei-সংশ্লিষ্ট ল্যাবের নতুন ওপেন ইমেজ ফাউন্ডেশন মডেল (ওপেন সোর্স) — !«メールアドレス», score 5, 2026-06-17। Apache-2.0 লাইসেন্স, ১০ বিলিয়ন প্যারামিটার; Base/Turbo (3–4 ধাপ)/FP8/Edit-এর ৫টি ভ্যারিয়েন্ট। চীনা ও ইংরেজি দ্বিভাষিক টেক্সট রেন্ডারিং প্রধান আকর্ষণ। https://boogu.org/
  3. Seedream 5.0 Pro (ByteDance-সংশ্লিষ্ট ক্লোজড মডেল)-এর প্রযুক্তিগত যাচাই নিবন্ধ (ক্লোজড সোর্স) — !«メールアドレス» হয়ে, score 1, 2026-07-10। “an honest comparison and technical breakdown” শিরোনামের পরীক্ষামূলক পোস্ট। https://www.reddit.com/gallery/1usc03q
  4. Google “Nano Banana 2 Lite” ঘোষণা (ক্লোজড সোর্স) — Hacker News মিরর, score 1, 2026-06-30, DeepMind অফিসিয়াল পেজের লিংক। সুইস টেক মিডিয়ার জার্মান ভাষার প্রতিবেদনও একই সময়ে ছিল (score 0, swisstechnews, 2026-07-02)। https://deepmind.google/models/gemini-image/flash-lite/
  5. Microsoft MAI-Image-2.5 বেঞ্চমার্কে Nano Banana 2-এর কাছাকাছি (ক্লোজড সোর্স) — !«メールアドレス», score 1, 2026-05-28। Google বনাম Microsoft ছবি মডেল প্রতিযোগিতা নিয়ে পোস্ট। https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/
  6. Sora 2 দিয়ে দীর্ঘ গল্প তৈরির পরীক্ষার বিবরণ (ক্লোজড সোর্স) — !«メールアドレス», score 1, 2026-09-13। Sora 2 প্রকাশের প্রায় এক মাস পর শুরু করে ৭টি এক ঘণ্টার ভিডিও বানানোর অভিজ্ঞতা। “সুন্দর একক ক্লিপ বানানো কঠিন নয়; আসল কঠিন হলো ‘production memory’—ধারাবাহিকতা বজায় রাখা।” https://lemmy.durstig.online/post/59922(মূল Reddit: https://www.reddit.com/r/ArtificialInteligence/comments/1wfabp9/)
  7. Midjourney-এর AI ছবি জেনারেশন থেকে “মেডিক্যাল স্পা”-তে সাহসী পিভট—বাস্তব খবর (ক্লোজড সোর্স/কোম্পানি গতিপ্রকৃতি) — !«メールアドレス» (The Register নিবন্ধ, lemmy.zip সংস্করণে ক্রস-পোস্ট, score 58-66, 2026-06-18)। full-body scan “Golden Light” স্পা ব্যবসায় রূপান্তর; মূল প্রযুক্তি অংশীদারের কাছ থেকে ধার নেওয়া বলে প্রতিবেদন, মন্তব্যে Theranos তুলনা। https://lemmy.zip/post/66397234
  8. Midjourney হলিউড স্টুডিওকে AI ব্যবহার প্রকাশের দাবি করেছে (ক্লোজড সোর্স) — !«メールアドレス», score 73, 2026-07-05। কপিরাইট মামলা-সম্পর্কিত পদক্ষেপ হিসেবে প্রতিবেদন। https://lemmy.today/post/56011946
  9. InterleaveThinker পেপারের পরিচিতি (ওপেন সোর্স/গবেষণা) — !«メールアドレス», score 0, 2026-06-12। “Reinforcing Agentic Interleaved Generation” শিরোনামের arXiv পেপারের লিংক। https://arxiv.org/abs/2606.13679
  10. AI-তৈরি কনটেন্টের বিরোধিতার তীব্রতা (সামাজিক সংকেত) — !«メールアドレス», score 923, 2026-09-13। সরাসরি ছবি/ভিডিও জেনারেশন নয়; AI-চালিত স্মার্ট গ্লাস (Ray-Ban Meta) নিয়ে পোস্ট। তবু কমিউনিটির আকার—মাসিক সক্রিয় 9,179—এবং প্রতিক্রিয়ার তীব্রতা ছবি/ভিডিও AI আলোচনার বিরূপ আবহের পরোক্ষ প্রমাণ। https://lemmy.world/post/51874921
সংকেত
  • ওপেন-সোর্স দিকে MiniMax-H3-ই প্রধান। lemmy.dbzer0.com-এর !stable_diffusion কমিউনিটিতে সেপ্টেম্বরের প্রথমার্ধে MiniMax-H3-এর জন্য ComfyUI node, LoRA, quantization ও VAE acceleration টুলের পোস্ট প্রতিদিন এসেছে। Wan/Flux/HunyuanVideo-এর মতো পুরোনো প্রজন্মের মডেলের নাম সার্চে প্রায় আর দেখা যায়নি। ব্যক্তিগত GitHub অ্যাকাউন্টের বহু স্বাধীন ডেভেলপার প্রাথমিক পোস্টদাতা—এটি Hugging Face/civitai-কেন্দ্রিক তৃণমূল ইকোসিস্টেমের ছবি।
  • ক্লোজড পাশে Google (Nano Banana), Microsoft (MAI-Image), ByteDance (Seedream), OpenAI (Sora 2) ও Midjourney—এই পাঁচ কোম্পানি পাশাপাশি চলছে, কিন্তু Lemmy-তে উল্লেখ কম; স্কোর প্রায় সবই এক অঙ্কে। আলোচনার মূল প্রবাহ বেশিরভাগ ক্ষেত্রেই Reddit মিরর !ai_reddit দিয়ে আসে। Lemmy-উৎসের নিজস্ব উল্লেখ Midjourney-এর মেডিক্যাল স্পা পিভটের মতো কর্পোরেট খবরেই কেন্দ্রীভূত।
  • civitai-তে সরাসরি লিংক করা কাজের পোস্ট—stable_diffusion_art / share_anime_art—সক্রিয়, কিন্তু মডেল নাম বা প্রম্পটের বিস্তারিত কম, তাই সংবাদমূল্য হিসেবে এগুলো কেবল উপাদান।
  • অ্যান্টি-AI কমিউনিটি !fuck_ai Lemmy জুড়ে সবচেয়ে বড়গুলোর একটি, এবং ছবি/ভিডিও AI-সংক্রান্ত পোস্ট সেখানে পৌঁছালে সমর্থনের চেয়ে বিরূপ মন্তব্য প্রাধান্য পায়।
সীমাবদ্ধতা
  • Lemmy-র মূল ব্যবহারকারীসংখ্যা ছোট, এবং সার্চ API পুরোনো পোস্ট—যেমন 2025-03-এর HunyuanVideo-I2V—বা অপ্রাসঙ্গিক ফল—যেমন “Flux” শব্দে পারমাণবিক জ্বালানি স্টার্টআপ Fluxnium-এর নিবন্ধ—বেশি দেয়। তাই প্রতিটি কিওয়ার্ডে হাতে ধরে নোইজ বাদ দিতে হয়েছে।
  • Runway Gen, Kling AI, Wan 2.5 আলাদা করে সার্চ করা হলেও সরাসরি সম্পর্কিত পোস্ট পাওয়া যায়নি: Kling শূন্য, Runway শূন্য, Wan-এ কেবল অপ্রাসঙ্গিক পোস্ট। Lemmy-তে এসব মডেল নিয়ে স্বতন্ত্র উত্তেজনা নিশ্চিত করা যায়নি।
  • !«メールアドレス» Reddit RSS রিপোস্ট বট; এটি Lemmy-র নিজস্ব আলোচনা নয়। তাই উৎস স্পষ্ট করে Reddit অংশের পুনরাবৃত্তি এড়িয়ে শুধু স্বতন্ত্র অন্তর্দৃষ্টি নেওয়া হয়েছে।
  • Midjourney-এর মেডিক্যাল স্পা পিভট ও হলিউড প্রকাশ-দাবির খবর যথাক্রমে 2026-06-18 ও 2026-07-05-এর; গত সপ্তাহের ঘটনা নয়। Lemmy-তে নতুন পরবর্তী খবর পাওয়া যায়নি।
  • প্রায় ২০টি পোস্ট পরীক্ষা করা হলেও দুই অঙ্কের স্কোরসহ সত্যিকারের ভাইরাল পোস্ট ছিল কেবল Midjourney-এর মেডিক্যাল স্পা খবর ও !fuck_ai-এর স্মার্ট গ্লাস পোস্ট। Lemmy জুড়ে শুধু ছবি/ভিডিও জেনারেশন AI বিষয়ক পোস্ট ব্যাপক ভাইরাল হওয়ার প্রমাণ মেলেনি।

Pinterest

Pinterest — ছবি ও ভিডিও জেনারেশন AI নিউজ

লিখিত সারাংশের জন্য সংগ্রহ করা ৫০টি পিনের মধ্যে ৩০টি সরাসরি খোলা ও পড়া হয়েছে (সবই Read সহ, ছবিসহ); বাকি ২০টির শিরোনাম—মূলত সাধারণ “AI content creation concept” স্টক-ফটো তালিকা ও ডুপ্লিকেট টুল-সারাংশ গ্রাফিক—নিচে নিশ্চিত হওয়া থিমের সঙ্গে মিলে যাওয়ায় খোলা হয়নি।

দৃশ্যগত থিম
  • “AI news” YouTube-থাম্বনেইল টেমপ্লেট প্রাধান্য পেয়েছে: কালো/নেভি পটভূমি, বিস্মিত বা হাস্যরত মানব মুখ, বড় সাদা/লাল “AI NEWS” লেখা, এবং জ্বলজ্বলে ব্র্যান্ড লোগোর সারি—OpenAI, Google, Anthropic-এর কমলা, Meta, Microsoft, Notion। অসংলগ্ন বিষয়েও বারবার দেখা যায়; কখনও শিরোনামের সঙ্গে ছবির মিল নেই। এটি আলাদা করে তৈরি শিল্প নয়, পুনর্ব্যবহৃত চ্যানেল টেমপ্লেট। [6, 14, 41, 43, 47]
  • টুল-সারাংশ তালিকা একই ডার্ক-নিয়ন ইনফোগ্রাফিক ভাষা ব্যবহার করে: নম্বরযুক্ত বেগুনি/কমলা/টিল ব্যাজ, জেনারেশন UI-সহ ল্যাপটপ মকআপ এবং প্রতিযোগী অ্যাপ লোগোর গ্রিড—Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, invideo AI, CapCut, Synthesia, HeyGen। সবকটিই ক্লোজড-সোর্স SaaS। [2, 29]
  • “Real vs AI” সত্যতা-উদ্বেগ একটি স্বতন্ত্র পুনরাবৃত্ত ফরম্যাট: পাশাপাশি কুইজ—“Which is AI?”—ছবির ওপর লাল “AI-GENERATED” লেবেল, এবং মিম-ধাঁচের “AI GENERATED / ORIGINAL CLIP” তুলনা। এটি সংবাদ থাম্বনেইলের মতোই প্রচলিত একটি ঘরানা। [3, 21, 32]
  • Google Veo সিনেমাটিক AI ভিডিওর ডিফল্ট দৃশ্যভাষা জোগাচ্ছে: একই উষ্ণ Pixar-ধাঁচের স্টিল—রান্নাঘরের মেয়ে, ফ্লেমিঙ্গো, তারার নিচে নৃত্যশিল্পী, সাঁতারু, মাইক্রোস্কোপের সামনে বিজ্ঞানী—একাধিক আলাদা পিনে দেখা যায়; Veo 3-এর জন্য আলাদা প্লাশ দানব image-to-video ডেমোও রয়েছে। অন্য কোনো প্রতিযোগীর ডেমো রিল এত বেশি বার দেখা যায়নি। [8, 9, 13, 27]
  • হাইপাররিয়াল AI প্রতিকৃতি সাধারণ ক্লিকবেইট আর্ট হিসেবে ব্যবহৃত: নিবন্ধের প্রকৃত বিষয় নির্বিশেষে টুল ঘোষণার জন্য কুঁচকানো জেলের মুখ, নিউজ-সারাংশ কার্ডে ঝিলমিল ত্বকের নারীর প্রোফাইল, মজার অ্যাপের জন্য face-morph triptych। ত্বকের রোমকূপ, চোখের ক্যাচলাইট ও অগভীর depth of field-ই এগুলো AI-তৈরি হওয়ার ইঙ্গিত। [33, 45, 48, 20]
  • যেখানে প্রকৃত পণ্যের স্ক্রিনশট নেই, সেখানে সাধারণ sci-fi/circuit-board স্টক ছবি ব্যবহৃত: জ্বলজ্বলে wireframe মস্তিষ্ক, ক্রোম হিউম্যানয়েড রোবট, হোলোগ্রাফিক AI ড্যাশবোর্ডের সামনে স্যুট পরা ব্যবসায়ী। এগুলোর সংবাদমূল্য নেই, শুধু আবহ। [1, 37, 50]
  • শুরুর স্তরের শিক্ষামূলক ইনফোগ্রাফিক প্যাস্টেল, কার্টুনধর্মী ভাষা ব্যবহার করে: হলুদ/গোলাপি, হাস্যোজ্জ্বল রোবট মাসকট ও হাতে আঁকা তীর—নিউজ থাম্বনেইল ঘরানার চেয়ে নরম ভিজ্যুয়াল, যাদের “generative AI” অর্থও জানা নেই তাদের জন্য। [7]
  • আসল প্রযুক্তিগত ডায়াগ্রাম বিরল: নমুনায় শুধু একটি পিনে মডেল আর্কিটেকচারের প্রকৃত চিত্র ছিল—text embedding → diffusion → upscaling ধাপ—তাও গবেষণাচিত্রের বদলে চকচকে ম্যাগাজিন গ্রাফিকের সাজে। [34]
উল্লেখযোগ্য পিন
  1. #48 — “Amuse 3.0”, একটি AI আর্ট তৈরির টুল (pin) — AMD-ব্র্যান্ডযুক্ত লোকাল ছবি জেনারেটর, হাইপাররিয়াল প্রতিকৃতির মাধ্যমে দেখানো; ক্লোজড SaaS তালিকার ভিড়ে নমুনায় পাওয়া একমাত্র স্পষ্ট লোকাল/ওপেন-ঘেঁষা টুল।
  2. #27 — Google ভিডিও জেনারেশন AI ‘Veo 3’ ঘোষণা করেছে (pin) — প্লাশ দানবের একটি ইনপুট স্টিল ও ভিন্ন দৃশ্যে তিনটি তৈরি ভিডিও দেখায়; Veo 3-এর image-to-video সামঞ্জস্যই প্রকৃত বিক্রয়-বিন্দু।
  3. #46 — ByteDance ও Hollywood AI কপিরাইট নিয়ে বৈশ্বিক চুক্তিতে পৌঁছেছে (pin) — ByteDance–MPA-র ছবি/ভিডিও টুল-কভার করা IP চুক্তির Cointelegraph-ধাঁচের নিউজ কার্ড; Pixar-ধাঁচে জেনারেট করা ছেলের ছবি দিয়ে সাজানো।
  4. #10 — “4 Major AI Updates” (pin) — একটি ইনফোগ্রাফিকে GPT-6 Astra, আরও agentic Gemini, Adobe Premiere-এ generative media এবং Cognition-এর $2B Series E ($48B valuation)।
  5. #49 — “Today's AI News, May 20 2026” (pin) — Google I/O সারাংশ: Gemini 3.5 Flash, Gemini Omni, Gemini Spark এবং AI স্মার্ট-গ্লাস উদ্যোগ।
  6. #3 — Hollywood Reporter প্রথম AI অভিনেত্রীর সাক্ষাৎকার নিয়েছে (pin) — “Tilly Norwood” নামের AI-তৈরি অভিনেত্রী নিয়ে TV chyron; ফ্রেমে নিজেই “AI-GENERATED IMAGE” লেখা।
  7. #41 — “More than 20% of YouTube is now AI-generated” (pin) — কোনো সহায়ক চার্ট ছাড়া পরিসংখ্যান-শিরোনামের পিন; দাবি হিসেবে উপস্থাপিত।
  8. #29 — “10 Best Free AI Video Generators for YouTube 2026” (pin) — নমুনার সবচেয়ে বিস্তৃত টুল-সারাংশ: Google Veo, Runway, Pika, invideo AI, CapCut, Synthesia, HeyGen—সবগুলো ফ্রি/YouTube-উপযোগী হিসেবে উপস্থাপিত।
  9. #34 — OpenAI-এর গোপন ছবি তৈরির টুল শিগগির আসবে (pin) — ক্লোজড-সোর্স, এখনও প্রকাশ না হওয়া টুল নিয়ে শিরোনাম; পণ্যের ছবি নয়, প্রকৃত diffusion pipeline ডায়াগ্রাম দিয়ে সাজানো।
  10. #32 — “AI GENERATED” বনাম “ORIGINAL CLIP” তুলনামূলক মিম (pin) — আসল সোর্স ক্লিপের পাশে AI-তে পুনর্নির্মিত মুখ/অঙ্গভঙ্গি; প্ল্যাটফর্মজুড়ে চলমান সত্যতা শনাক্ত ঘরানার অংশ।
সংকেত
  • বর্তমান: Google Veo (2 ও 3) বোর্ডে এককভাবে সবচেয়ে পুনরাবৃত্ত ভিডিও মডেল—অন্য যে কোনো নামকরা টুলের চেয়ে বেশি। “AI চ্যাটের বাইরে বাস্তব কাজে যাচ্ছে”—এই ফ্রেম একাধিক পিনে স্পষ্ট: Adobe Premiere generative timeline, Cognition-এর Devin ফান্ডিং, Gmail/Drive/Docs-জুড়ে agentic Gemini। ByteDance × MPA-এর মতো IP ও কপিরাইট চুক্তি এখন মূলধারার সংবাদ, কেবল বিশেষায়িত আইনি খবর নয়। “spot the AI” বা সত্যতা লেবেলিং একটি নিজস্ব ঘরানা, যা ভুয়া ছবি ও অভিনেত্রী নিয়ে দর্শকের প্রকৃত উদ্বেগ বোঝায়। অসংলগ্ন শিরোনামে একই সাধারণ থাম্বনেইল পুনর্ব্যবহার থেকে বোঝা যায় এই “নিউজ” কনটেন্টের বড় অংশ মৌলিক রিপোর্টিং নয়, কম-চেষ্টার কনটেন্ট মিলের উৎপাদন।
  • অনুপস্থিত: ওপেন-সোর্স মডেল সংস্কৃতি প্রায় অদৃশ্য—Stable Diffusion, Flux, ComfyUI, LoRA বা GitHub রিপোজিটরির কোনো স্ক্রিনশট পাওয়া যায়নি। Amuse 3.0 (#48) নমুনার একমাত্র লোকাল/ওপেন-ঘেঁষা টুল, তাও ওপেন-সোর্স প্রকল্প হিসেবে নয়, পরিশীলিত কনজিউমার অ্যাপ হিসেবে উপস্থাপিত। কোনো অ-ইংরেজি পিন নেই। নমুনার কিছুই ভিডিও আকারে প্লে হয় না—সবই স্থির থাম্বনেইল; ফলে আসল আউটপুটের গুণমান নয়, কেবল দাবি বিচার করা যায়।
সীমাবদ্ধতা
  • প্লেবুক অনুযায়ী Pinterest সরাসরি ব্রাউজ করা হয়নি; এই সারাংশ কেবল কর্মীর আগাম সংগৃহীত output/pinterest.pins.md টেবিল এবং images/pinterest/manifest.json/ছবির ওপর নির্মিত। একটিমাত্র অজ্ঞাত কুয়েরি—“Image and Video Generation AI News”—থেকে সংগ্রহ করা, ঘরানাভিত্তিক ভাগ নয়; manifest-এর প্রতিটি পিনে genre ফিল্ড ফাঁকা, তাই ঘরানাভিত্তিক তুলনা করা যায়নি।
  • ৫০টির মধ্যে ৩০টি পিন খোলা হয়েছে; বাকি ২০টি বাদ দেওয়া হয়েছে কারণ তাদের শিরোনাম ইতিমধ্যে আলোচিত ফরম্যাটের পুনরাবৃত্তি—সাধারণ “AI content creation concept” স্টক-ফটো তালিকা ও পুনরাবৃত্ত টুল-সারাংশ গ্রাফিক। এটি পূর্ণ কভারেজ নয়, স্পট চেক।
  • উৎস টেবিলে কয়েকটি পিনের শিরোনাম ফাঁকা—“(untitled)”। সেসব ক্ষেত্রে বর্ণনা ছবিতে দৃশ্যমান লেখার ভিত্তিতে।
  • কিছু পিনের ছবির বিষয় শিরোনামের সঙ্গে হুবহু মেলে না—যেমন #47-এর ছবি Grok 5 সম্পর্কিত নির্দিষ্ট কিছু নয়, সাধারণ “AI NEWS” চ্যানেল কার্ড। এটি পুনর্ব্যবহৃত সাধারণ থাম্বনেইল-সংক্রান্ত পর্যবেক্ষণকে সমর্থন করে, তবে শিরোনামকে নিশ্চিত রিপোর্টিং হিসেবে নয়, ইঙ্গিত হিসেবে পড়া উচিত।
  • কোনো পিনে দৃশ্যমান প্রকাশের তারিখ নেই; ছবির ভিত্তিতে সংবাদদাবির সাম্প্রতিকতা—যেমন YouTube-এর ২০% AI-generated পরিসংখ্যান—যাচাই করা যায়নি।

সুপারিশকৃত পদক্ষেপ

  • X পর্যায়ে ‘Sora 2’ ‘Midjourney’ ‘Stable Diffusion’ ‘Runway Gen’ ‘Kling AI’ ‘open source image generation’-এর মতো বিষয়-সংশ্লিষ্ট সার্চ টার্ম দিয়ে পুনরায় সংগ্রহ করুন।
  • MiniMax-H3, Qwen, Wan ও Z-Image-এর মতো চীনা উৎসের ওপেন-সোর্স মডেলের রিলিজের গতি নিয়মিত পর্যবেক্ষণ করুন।
  • শুধু AI বিশেষজ্ঞ কমিউনিটি নয়, সাধারণ ও পেশাভিত্তিক কমিউনিটির প্রতিক্রিয়াও অনুসরণ করে AI-তৈরি কনটেন্টের বিরুদ্ধে প্রতিক্রিয়ার বিস্তার পর্যবেক্ষণ করুন।
  • Bluesky অফিসিয়াল সার্চ API-এর 403 সমস্যার বিকল্প অ্যাক্সেস পদ্ধতি পরীক্ষা করুন।
  • Sora 2-এর ‘production memory’ সমস্যা ও Midjourney-এর মেডিক্যাল স্পায় পিভটের পরবর্তী খবর পরের রানেও অনুসরণ করুন।
  • Pinterest সংগ্রহে ঘরানা ট্যাগ যুক্ত করুন, যাতে ওপেন/ক্লোজড মডেল যান্ত্রিকভাবে শ্রেণিবদ্ধ করা যায়।

সংগৃহীত ছবি

🎨 AI Image and Video CreationJust Nail It 🎥Hollywood Reporter প্রথম AI অভিনেত্রীর সাক্ষাৎকার নিয়েছে...টেক্সট, ছবি, সঙ্গীত ও ভিডিও জেনারেশনের আইকনসহ AI কনটেন্ট তৈরির ধারণা, কৃত্রিম বুদ্ধিমত্তার ছবি – 66 Stock Photos, Vectors, and Video দেখুনAI কনটেন্ট ও সামাজিক যোগাযোগমাধ্যম নিয়ে উদ্বেগAI News: Anthropic ফাঁস আমাদের AI-এর ভবিষ্যৎ দেখায়...🤯 জেনারেটিভ AI ব্যাখ্যা করা হলো! 🤖✨ AI কীভাবে টেক্সট, ছবি, ভিডিও ও আরও অনেক কিছু তৈরি করে!ছবিGoogle উন্নত বাস্তবতা ও সিনেমাটিক ফিচারসহ উন্নত AI ভিডিও জেনারেশন টুল Veo 2 উন্মোচন করেছে2026-এ জানার মতো 4টি বড় AI আপডেটGoogle অতি-উচ্চমানের ভিডিও ঘোষণা করেছে...কনটেন্ট মার্কেটিংয়ের জন্য AI-তৈরি ভিডিওVeo 3 Image-to-Video: Gemini API দিয়ে দ্রুত জেনারেশন ও নেটিভ অডিওAI News: OpenAI অবশেষে আমাদের চাওয়া জিনিসটি প্রকাশ করেছেছবি ও ভিডিও জেনারেশনের জন্য AIটেক্সট, ছবি, সঙ্গীত ও ভিডিও জেনারেশনের আইকনসহ AI কনটেন্ট তৈরির ধারণা, কৃত্রিম বুদ্ধিমত্তার ছবি – 57 Stock Photos, Vectors, and Video দেখুনImagvio AI কী এবং এটি নির্মাতাদের কীভাবে সাহায্য করে...ছবিছবি7টি সেরা AI Baby Generator: আপনার সন্তানের মুখ অনুমান করুন (2026)ছবিAI ভিডিও তৈরির সফটওয়্যারChatGPT + Higgsfield দিয়ে নিজের ফটোরিয়ালিস্টিক AI ফটোশুট তৈরি করুন 📸🤖AI-তৈরি ভিডিও: ভালো না খারাপ? সত্যটি এখানে! 🤖🎥কনটেন্ট নির্মাতাদের গোপন অস্ত্র: AI-চালিত ভিডিও জেনারেশন2025-এর শীর্ষ AI ভিডিও জেনারেটরGoogle ভিডিও জেনারেশন AI ‘Veo 3’ ঘোষণা করেছে,...ভিডিও এডিটিংয়ের AI টুল — 2026-এ নির্মাতারা কনটেন্ট তৈরিতে আসলে যা ব্যবহার করেনছবিআপনার ভাবনাকে চমৎকার ভিজ্যুয়ালে রূপ দিন! 🎥নকলটি শনাক্ত করতে পারেন? AI ভিডিও বনাম বাস্তব জীবন চ্যালেঞ্জ!ছবিছবিOpenAI-এর গোপন ছবি জেনারেশন টুল শিগগির আসছেপেশাদার AI ভিডিও তৈরি | সিনেমাটিক AI ভিডিও | কাস্টম ভিডিও সম্পাদনাAI-চালিত ছবি ও ভিডিও বিশ্লেষণ‎🚨 AI ভয়ংকর ভালো হয়ে উঠছে।AI ছবি জেনারেশনAI-তৈরি বাস্তবসম্মত প্রতিকৃতি ভিডিও | আরামদায়ক ঘরোয়া পরিবেশ, ক্যামেরা নেই"ব্যক্তিগতকৃত AI-চালিত 4K ভিডিও দিয়ে আপনার দৃষ্টিভঙ্গি বদলে দিন 🎥✨"YouTube-এর 20%-এর বেশি এখন AI-তৈরিএই সপ্তাহের AI নিউজ - Aug 15 2026GPT 5.2, রিয়েলটাইম ভিডিও এডিটর, AI স্টেরিও ভিডিও, মোবাইল AI এজেন্ট, পূর্ণ শরীর নিয়ন্ত্রণ: AI NEWSযখন AI মানুষকে তাদের নিজের স্মৃতিতে ফিরে যেতে দিলভাইরাল Tiny People AI Effect—এটি তৈরি করতে শিখুন!ছবিGrok 5: Elon Musk-এর AI বিপ্লব: এক বিস্ময়কর...‘Amuse 3.0’, একটি AI আর্ট তৈরির টুল যাতে রয়েছে...ছবিAI

ডেটা গুণমান নোট

X-এর সার্চ টার্ম বিষয়ের সঙ্গে সম্পর্কহীন হওয়ায় ৪০টির মধ্যে ০টিই ব্যবহারযোগ্য ছিল। Reddit (১২টি) ও Bluesky (সার্চ API ব্লক থাকায় ব্যক্তিগত অ্যাকাউন্ট থেকে প্রায় ১২টি)-ও প্রায় ২০টি পোস্টের লক্ষ্যে পৌঁছায়নি। Pinterest-এ ঘরানা-ট্যাগবিহীন পূর্বসংগৃহীত ডেটা ব্যবহৃত হয়েছে; YouTube-এ ভিউ ও সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি।

গ্যালারি