ছবি ও ভিডিও জেনারেশন এআই সংবাদ — 2026-09-18
ক্লোজড-সোর্স ক্ষেত্রে Google-এর Nano Banana সিরিজের ছবি তৈরি ব্যক্তিগত ব্যবহারে স্থায়ী হয়ে গেছে, আর Sora 2-এর API 9/24-এ বন্ধ হওয়ায় তা পিছিয়ে পড়ছে। ওপেন-সোর্সে MiniMax-H3 ও Qwen-Image—এই দুই শক্তি ComfyUI মহলকে দখল করে আছে।
ছবি ও ভিডিও জেনারেশন এআই সংবাদসংক্ষেপ — 2026-09-18
উফ, এবারটা সত্যিই ভীষণ ঘন ছিল 🔥 সংক্ষেপে বললে, ক্লোজড-সোর্স দিকটায় Google-এর Nano Banana সিরিজ (Gemini ছবি তৈরি) পুরোপুরি প্রধান চরিত্র; Sora 2-এর অ্যাপ বন্ধ ও API বন্ধ (9/24) হওয়ায় সেটিকে ইতিমধ্যেই “অতীতের জিনিস” মনে হতে শুরু করেছে 🤖📉। ওপেন-সোর্স দিকটায় MiniMax-H3 (ভিডিও তৈরি) ও Qwen-Image (ছবি তৈরি)—এই দুইয়ের আধিপত্য, বিশেষ করে ComfyUI মহল MiniMax-H3-এর আলোচনায় ভরে ছিল 😳। আর এবার একটি সত্যিকারের গুরুত্বপূর্ণ বিষয় পরিষ্কার হয়েছে: টুলের কর্মক্ষমতা তুলনার চেয়ে “সম্মতি ছাড়া জেনারেশন বৈধ করা” বা “Disney বনাম Midjourney মামলা”-র মতো নৈতিকতা ও আইনসংক্রান্ত বিষয়ই বেশি ভাইরাল ⚖️🔥। এবার X (সাবেক Twitter) পুরোপুরি ব্যর্থ হয়েছে, তাই সে বিষয়ে সৎভাবে “ডেটা নেই” বলছি 🙏
প্ল্যাটফর্মজুড়ে
শুধু যেসব বিষয় একাধিক প্ল্যাটফর্মে যাচাই করা গেছে, সেগুলো এখানে দিলাম 📝✨
- 🍌 Nano Banana (Gemini ছবি তৈরি) ব্যক্তিগত নির্মাতাদের দৈনন্দিন টুলে পরিণত হয়েছে। Bluesky-তে dfl ও triflingtree-এর মতো ব্যবহারকারীরা প্রতিদিন Nano Banana 2-এর কাজ পোস্ট করছেন (https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i), আর YouTube-এ “Ultimate Nano Banana Pro Guide 2026” 327K সাবস্ক্রাইবারের চ্যানেলে ব্যাপক দেখা হচ্ছে (https://www.youtube.com/watch?v=Q7SiipUCjro ধরনের চ্যানেলসমূহ)। Reddit-এর Riverside থ্রেডেও Nano Banana-র নাম একটি ইন্টিগ্রেশন লক্ষ্য হিসেবে এসেছে (https://www.reddit.com/r/RiversideFM/comments/1wiweik/)।
- 🌊 Sora 2 এখন আর “আগামীর” নয়, বরং “ফিরে দেখা”-র বিষয় হয়ে উঠছে। Bluesky-তে স্বতন্ত্র অ্যাপ বন্ধ হওয়ায় Runway/Kling/Veo-তে চলে যাওয়ার পরামর্শ রয়েছে (https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l), এবং YouTube-এ নতুন ফিচার পরিচিতির বদলে এটি “State of AI Video” ধরনের তুলনামূলক ভিডিওর বেসলাইন হয়ে যাচ্ছে। API বন্ধ হওয়ার তারিখ 2026-09-24 নির্ধারিত। ঠিক এখনই দিক বদলের মুহূর্ত 😮
- 🧩 ক্লোজড-সোর্সে “সমন্বিত প্ল্যাটফর্ম” কৌশল মূলধারায় আসছে। Reddit-এ Adobe Firefly Boards ও Riverside একসঙ্গে একাধিক মডেল দেয়, আর Pinterest-এ Runway, Pika, Kling, Luma, Veo, Hailuo ও CapCut-কে পাশাপাশি রাখা বহু টুল-তুলনা ইনফোগ্রাফিক দেখা গেছে। একটি মডেল চাপিয়ে দেওয়ার বদলে ব্যবহারকারীকে “বেছে নিতে দেওয়া”-র যুগ শুরু হয়েছে বলে মনে হচ্ছে 🛠️
- 🐉 ওপেন-সোর্সের প্রধান দুই নাম MiniMax-H3 ও Qwen-Image। Lemmy-র ComfyUI-কেন্দ্রিক কমিউনিটিগুলো সেপ্টেম্বরের শুরু থেকে মাঝামাঝি পর্যন্ত MiniMax-H3-ঘিরে টুলের পোস্টে প্রায় ভরে ছিল (উদাহরণ: https://github.com/filliptm/ComfyUI-FL-MiniMaxH3 , score 5)। ব্যবহারকারীদের হার্ডওয়্যার রিপোর্ট অনুযায়ী RTX 3090-স্তরের পিসিতেও লোকাল রান সম্ভব (score 12 মন্তব্য)। Qwen-Image-এর নাম YouTube-এ 700-ভিডিও বেঞ্চমার্কে এবং Bluesky-তে Qwen3.8-Flash প্রিভিউতে (https://bsky.app/profile/primereports.bsky.social/post/3mub3pkd2rf2s) এসেছে।
- ⚖️ প্রযুক্তির চেয়ে নৈতিকতা ও আইনি বিষয় বেশি ভাইরাল। Reddit-এ সম্মতি ছাড়া AI জেনারেশন বৈধ করার বিতর্কে প্রায় 900 মোট মন্তব্য (https://www.reddit.com/r/CriticalState/comments/1wisk2n/), Bluesky-তে Disney বনাম Midjourney মামলার অগ্রগতি (https://bsky.app/profile/ai.bots.law/post/3mvqwgixvkm2n), Lemmy-তে Midjourney ছবির বদলে চিকিৎসা সরঞ্জামে মোড় নেওয়ায় “Theranos নাকি?” ধরনের ব্যঙ্গ (https://awful.systems/post/8731127), এবং Pinterest-এ ByteDance ও Hollywood-এর কপিরাইট চুক্তি—চার প্ল্যাটফর্মেই আইন ও নৈতিকতার আলোচনাই সবচেয়ে উত্তপ্ত।
- 😤 “AI slop”-এর বিরুদ্ধে প্রতিক্রিয়া ধারাবাহিকভাবে তীব্র। Reddit-এর r/aitubers-এ স্ক্রিপ্ট থেকে সম্পূর্ণ স্বয়ংক্রিয় faceless ভিডিও নিয়ে তীব্র সমালোচনা, এবং Lemmy-তে r/fuck_ai-এর “কোম্পানিগুলো AI-কে আরও খারাপ করে” পোস্টের score 63—দুই জায়গাতেই একই মনোভাব। কোথাও নিঃশর্ত প্রশংসা নেই।
প্ল্যাটফর্মভিত্তিক
Reddit — একটিমাত্র সার্চ টার্ম ব্যবহার হওয়ায় r/StableDiffusion-এর মতো ছবি-তৈরি-কেন্দ্রিক সাবরেডিট ধরা পড়েনি। পরিবর্তে নৈতিকতা ও সংস্কৃতি-সংক্রান্ত থ্রেড—DHS-এর AI ছবি অপব্যবহার, সম্মতিবিহীন জেনারেশন বৈধ করার বিতর্ক—এনগেজমেন্টের বড় অংশ দখল করেছে। Google Flow, Wan ও Minimax-এর মতো একক টুল নিয়ে মত বিভক্ত; সহজ কোনো “এটাই সেরা” আবহ ছিল না 😐
X — এখানে সত্যিই দুঃখিত, সম্পূর্ণ ব্যর্থতা 🙅♂️। সংগৃহীত 40টি পোস্টই রাজনীতি, স্পোর্টস বেটিং বা ক্রিপ্টো-সংক্রান্ত; ছবি বা ভিডিও জেনারেশন AI নিয়ে একটিও নয়। মনে হচ্ছে সার্চ টার্ম AI থিম নয়, X-এর ট্রেন্ড—Africa, Serbia, Zcash ইত্যাদি—তুলে এনেছে। ব্রিফে নির্ধারিত ছয় প্ল্যাটফর্মের একটি একেবারেই কাজ করেনি; এটিকে বাস্তব ডেটা ঘাটতি হিসেবেই জানাচ্ছি।
YouTube — ক্লোজড-সোর্সে সপ্তাহভিত্তিক খবর আসছে। OpenAI-এর ChatGPT Images 2.5 (9/8 প্রকাশ) এবং Google-এর Nano Banana Pro/2 মাঝারি চ্যানেলগুলোতে (30 হাজার–330 হাজার সাবস্ক্রাইবার) দ্রুত রিভিউ হয়ে ভাইরাল হয়েছে। ওপেন-সোর্সে SECourses-এর মতো গভীর টেকনিক্যাল চ্যানেল ও Qwen-Image-এর জাপানি ব্যাখ্যামূলক ভিডিও প্রধান; দেখা হয়েছে ক্লোজড-সোর্সের প্রায় এক-দশমাংশ। ByteDance-এর Seedance 2.0/2.5-ই এ বছর ভিডিও জেনারেশন মডেল হিসেবে সবচেয়ে বেশি আলোচিত—এটিও উল্লেখযোগ্য 📹
Bluesky — ব্যক্তিগত নির্মাতাদের Nano Banana 2 পোস্ট প্রতিদিন আসছে; পাশাপাশি নিউজবটের মাধ্যমে LTX-2.5 (Lightricks), FLUX LoRA এবং আবুধাবির সম্পূর্ণ ওপেন মডেল প্রকাশের খবরও মিলেছে। তবে “Stable Diffusion”, “Wan 2.5”, “Qwen Image” ফ্রেজ সার্চে API বারবার 403 দিয়েছে, ফলে ওপেন-সোর্স ভিডিও জেনারেশন নিয়ে সরাসরি বক্তব্য তুলনামূলক কম 😑
Lemmy — এবার সবচেয়ে ফলপ্রসূ প্ল্যাটফর্ম 🎯। !«メールアドレス» MiniMax-H3-সংক্রান্ত ComfyUI এক্সটেনশন পোস্টে ভরে ছিল; ওপেন-সোর্স ভিডিও জেনারেশনের বর্তমান অবস্থা এখানে সবচেয়ে ঘনভাবে দেখা গেছে। বিপরীতে ক্লোজড-সোর্সে Midjourney-এর চিকিৎসা সরঞ্জামে মোড় নেওয়ার মতো “বিভ্রান্তিকর খবর” বেশি নজরে এসেছে, এবং Lemmy-র সামগ্রিক সুর বেশ সন্দেহপ্রবণ।
Pinterest — কর্মীর আগাম সংগৃহীত ছবিভিত্তিক গবেষণায় Runway, Pika, Kling, Luma, Veo, Hailuo ও CapCut-কে পাশাপাশি রাখা SEO/অ্যাফিলিয়েট-ধাঁচের টুল-তুলনা ইনফোগ্রাফিকের বিপুল উপস্থিতি দেখা গেছে 🖼️। “আসল আর AI আলাদা করে চিনুন” ধরনের সচেতনতামূলক কনটেন্টও একটি স্বতন্ত্র ঘরানা। ওপেন-সোর্স বিষয় খুবই কম; Stable Video Diffusion কেবল টুল-তালিকায় লোগো হিসেবে দেখা যায়।
নজরে রাখুন
- 🔥 MiniMax-H3-এর ComfyUI ইকোসিস্টেমের বিস্তার — Lemmy, https://github.com/filliptm/ComfyUI-FL-MiniMaxH3
- 📉 Sora 2-এর API বন্ধ (2026-09-24 নির্ধারিত) এবং ব্যবহারকারীরা কোথায় যাচ্ছে — Bluesky, https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l
- 🍌 Nano Banana Pro/Gemini ছবি তৈরির ব্যক্তিগত নির্মাতাদের মধ্যে স্থায়ী গ্রহণযোগ্যতা — Bluesky, https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i
- 🎬 ভিডিও জেনারেশনে ByteDance Seedance 2.0/2.5-এর উপস্থিতি এবং Hollywood-এর সঙ্গে কপিরাইট চুক্তি — YouTube (Dan Kieft-এর টিউটোরিয়াল) ও Pinterest-এর ByteDance-MPA পিন
- ⚖️ সম্মতি ছাড়া AI জেনারেশন বৈধ করার বিতর্কের ভবিষ্যৎ — Reddit, https://www.reddit.com/r/CriticalState/comments/1wisk2n/
- 🐦⬛ ওপেন-ওয়েট ক্ষেত্রে Qwen-Image-এর ক্রমবর্ধমান উপস্থিতি — YouTube (700-ভিডিও বেঞ্চমার্ক) এবং Bluesky-র Qwen3.8-Flash পোস্ট
সুপারিশ
- পরেরবার X সংগ্রহে Sora, Nano Banana, Kling, Qwen, Flux, ComfyUI-এর মতো AI-সরাসরি শব্দ দিয়ে পুনরায় সার্চ করতে হবে; এবার সম্পূর্ণ অপ্রাসঙ্গিক ট্রেন্ড ধরা পড়েছিল।
- MiniMax-H3 ও Qwen-Image-কে ওপেন-সোর্স জগতের এখনকার সবচেয়ে গুরুত্বপূর্ণ সূচক হিসেবে নজরে রাখতে হবে।
- Sora 2-এর API বন্ধের (9/24) আগে ও পরে ব্যবহারকারীরা Runway/Kling/Veo-তে কীভাবে সরে যায়, তা পর্যবেক্ষণ করতে হবে।
- Disney বনাম Midjourney মামলা ও সম্মতিবিহীন জেনারেশন বৈধ করার বিতর্কের মতো আইন-নৈতিকতা ট্র্যাককে টুল কর্মক্ষমতা তুলনার চেয়ে বেশি অগ্রাধিকার দিতে হবে।
- Reddit সংগ্রহে r/StableDiffusion ও r/aiArt-এর মতো ছবি-জেনারেশন-কেন্দ্রিক সাবরেডিট লক্ষ্য করে কোয়েরি যোগ করতে হবে।
- Pinterest-এর ক্ষেত্রে বর্তমানে শুধু ছবির ওপর অনুমান করা হয়েছে; পরেরবার লিংকে থাকা নিবন্ধ সত্যিই লাইভ খুলে যাচাই করতে হবে।
ডেটার মান
X (সাবেক Twitter)-এ সংগৃহীত 40টি পোস্টই AI থিমের সঙ্গে সম্পর্কহীন, ফলে কার্যত কোনো ডেটা নেই। Reddit একটিমাত্র সার্চ টার্মের কারণে ছবি-জেনারেশন-কেন্দ্রিক কমিউনিটি বাদ দিয়েছে; 12টি সংগৃহীত থ্রেডের 5টির score 0pt, অর্থাৎ প্রতিক্রিয়াও কম। YouTube-এ পেজ ফেচের 401/CAPTCHA সমস্যায় প্রায় দুই-তৃতীয়াংশ তথ্য যাচাই করা যায়নি, এবং ওপেন-সোর্স ভিডিওর ভিউ-সংখ্যা অনেক ক্ষেত্রেই অনিশ্চিত। Bluesky-তে পাবলিক API ফ্রেজ সার্চে বারবার 403 দেওয়ায় “Stable Diffusion”, “Wan 2.5” ইত্যাদির সরাসরি ডেটা পাওয়া যায়নি। Lemmy-তে শুধু lemmy.world-এ ইনডেক্স হওয়া পোস্ট অন্তর্ভুক্ত; অন্য ইনস্ট্যান্স যেমন lemmy.ml পরীক্ষা করা হয়নি। Pinterest কেবল কর্মীর আগাম সংগৃহীত ছবির ভিত্তিতে বিশ্লেষিত; কোনো লাইভ যাচাই হয়নি।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ছবি ও ভিডিও জেনারেশন এআই সংবাদ
কোথায়
সার্চ টার্ম “Image and Video Generation AI News” দিয়ে 11টি subreddit থেকে মোট 12টি থ্রেড সংগ্রহ করা হয়েছে।
| Subreddit | সদস্যসংখ্যা | সংগৃহীত থ্রেড |
|---|---|---|
| r/generativeAI | 154,407 | 1 |
| r/CriticalState | 35,134 | 2 |
| r/aifilmmaking | 8,038 | 1 |
| r/aitubers | 28,687 | 1 |
| r/agi | 123,187 | 1 |
| r/AIToolTalks | 6,513 | 1 |
| r/ContentCreators | 88,168 | 1 |
| r/AIContentAutomators | 9,387 | 1 |
| r/AIDangers | 53,842 | 1 |
| r/popculturechat | 6,680,224 | 1 |
| r/RiversideFM | 728 | 1 |
r/StableDiffusion ও r/aiArt-এর মতো ছবি-জেনারেশন-কেন্দ্রিক বড় subreddit হিট হয়নি; এই সার্চ টার্ম AI টুল, সংস্কৃতি ও নৈতিক বিতর্ককেন্দ্রিক subreddit-এর দিকে ঝুঁকে আছে।
মানুষ কী বলছে
- থ্রেড 1 (r/generativeAI・13pt・41 মন্তব্য・2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — “বিনামূল্যে ব্যবহারযোগ্য AI ভিডিও জেনারেশন টুল কী?” প্রশ্নে u/RioMetal বলেছেন, “লোকাল চালাতে পারলে Wan বা Minimax প্রচুর আছে”; u/juzellicious বলেছেন, “Wan-এ দিনে 3 সেকেন্ডের ফ্রি কোটা, Google Veo 3-তে এখনও বেশি ছিল।” ক্লাউড-ভিত্তিক ফ্রি কোটা কমে যাওয়ায় লোকাল/ওপেন-সোর্স মডেলে ফেরার আলোচনা চলছে।
- থ্রেড 3 (r/aifilmmaking・7pt・7 মন্তব্য・2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Google Flow-এর ফ্রি ক্রেডিট “এখন বেশ উদার” বলে পোস্ট। u/MechanicForward2274 বলেছেন, “দিনে 50 ক্রেডিট থাকলে অপচয় না করলে অনেক পরীক্ষা করা যায়।” অন্যদিকে u/Sea-Temporary-6995-এর মতে, “পদার্থবিদ্যা ও লজিকে দুর্বল; Minimax অনেক ভালো”—মূল্যায়ন বিভক্ত।
- থ্রেড 8 (r/ContentCreators・0pt・6 মন্তব্য・2026-09-17) https://www.reddit.com/r/ContentCreators/comments/1wj380j/ — Adobe Firefly Boards দিয়ে স্পেকের জন্য বিউটি কমার্শিয়াল বানানোর রিপোর্ট। পোস্টদাতা বাণিজ্যিক ব্যবহারের নিরাপত্তার কারণে Veo বা Kling-এর বদলে Firefly Video বেছে নিয়েছেন। u/avatar0027 বলেছেন, “ক্লোজ-আপ সুন্দর, কিন্তু শটের মধ্যে ধারাবাহিকতায় AI-সুলভ ভাব দেখা যায়।”
- থ্রেড 12 (r/RiversideFM・0pt・1 মন্তব্য・2026-09-17) https://www.reddit.com/r/RiversideFM/comments/1wiweik/ — পডকাস্ট নির্মাণ টুল Riverside Seedance 2.5, Veo 3.1, Nano Banana-সহ একাধিক মডেল ইন্টিগ্রেট করা ছবি ও ভিডিও জেনারেশন ফিচার প্রকাশ করেছে। সব পেইড প্ল্যানে 2,000 ক্রেডিট দেওয়া হয়েছে।
- থ্রেড 4 (r/aitubers・0pt・40 মন্তব্য・2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — “স্ক্রিপ্ট থেকে সম্পূর্ণ স্বয়ংক্রিয় faceless YouTube ভিডিও বানাতে চাই” পোস্টে তীব্র প্রতিক্রিয়া। u/RobJames007 বলেছেন, “YouTube যখন AI slop কমাতে চাইছে, তখন আপনি তা বাড়ানোর টুল চাইছেন”; u/-NearlyThere- বলেছেন, “পেলে রিপোর্ট ও ডাউনভোট করব।”
- থ্রেড 9 (r/AIContentAutomators・0pt・11 মন্তব্য・2026-09-11) https://www.reddit.com/r/AIContentAutomators/comments/1wdm1n4/ — নতুন Google অ্যাকাউন্টের $300 ফ্রি ক্লাউড ক্রেডিট ব্যবহার করে AI ভিডিও খরচ কমিয়ে মাসে $5,000 আয়ের দাবি। u/Truegentlehat বলেছেন, “এক ঘণ্টা আগে অন্য পোস্টে লিখেছেন ‘মাসে €120 পেলেই আয় শুরু হয়েছে’; মিথ্যা নয় কি?”—সবচেয়ে জনপ্রিয় মন্তব্যে বিশ্বাসযোগ্যতা নিয়ে প্রশ্ন।
- থ্রেড 2・5 (r/CriticalState・0pt/1pt・421/475 মন্তব্য・2026-09-17) https://www.reddit.com/r/CriticalState/comments/1wisk2n/ , https://www.reddit.com/r/CriticalState/comments/1wiwhm4/ — “সম্মতি ছাড়া AI ছবি তৈরি বৈধ করা হবে, নাকি নিষিদ্ধ করা হবে?”—এই ভোটধর্মী দুই থ্রেডে “নিষিদ্ধ করা উচিত” মতের মন্তব্যগুলো শীর্ষে। u/AwarenessOk7862 বলেছেন, “এটি বাস্তবতাকে জাল করে এবং সত্য ও কল্পনার পার্থক্য আরও কঠিন করে তোলে।”
- থ্রেড 11 (r/popculturechat・448pt・22 মন্তব্য・2026-09-11) https://www.reddit.com/r/popculturechat/comments/1wd49kb/ — মার্কিন Department of Homeland Security (DHS) জোরপূর্বক নির্বাসন প্রচারের প্রচারে AI-তৈরি Optimus Prime ছবি ব্যবহার করেছে, যার কারণে Hasbro-কে প্রতিক্রিয়া জানাতে হয়। u/Jerkrollatex বলেছেন, “Optimus নিজেও যুদ্ধশরণার্থী ছিল; যারা এটি বানিয়েছে তারা কি সবে পৃথিবীতে এসেছে?”
- থ্রেড 7 (r/AIToolTalks・12pt・35 মন্তব্য・2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — AI নিয়ে উদ্বেগ প্রকাশের পোস্ট—পানি ব্যবহার ও কর্মসংস্থান হারানোর উল্লেখসহ, ছবি ও ভিডিও জেনারেশন AI-এর প্রেক্ষাপটে। u/EstablishmentRare276 পাল্টা বলেছেন, “ডেটা সেন্টার 1950-এর দশক থেকেই আছে; YouTube-এ দুই ঘণ্টার ভিডিও 50টি ভারী AI রিকোয়েস্টের সমান।”
- থ্রেড 10 (r/AIDangers・28pt・31 মন্তব্য・2026-09-14) https://www.reddit.com/r/AIDangers/comments/1wg5y17/ — “AI অপরিহার্য টুল নয়; বহু প্রতিষ্ঠান কর্মদক্ষতা বাড়ার বদলে কমে যেতে দেখেছে”—এমন দাবি। u/LopsidedSolution বলেছেন, “গবেষণাটি কি 2024-এর মডেল—GPT-4o ইত্যাদি—নিয়ে? Astra বা Fable দিয়ে পুনরায় যাচাই করে বলুন।”
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: লোকাল/ওপেন-সোর্স ভিডিও জেনারেশন মডেল (Wan, Minimax)-এ আগ্রহ। ক্লাউডের ফ্রি কোটা কমে যাওয়া (থ্রেড 1) পটভূমি হিসেবে কাজ করছে, এবং খরচ এড়াতে ব্যবহারকারীরা নিজস্ব চালনার দিকে ঝুঁকছেন।
- ঊর্ধ্বমুখী প্রবণতা: মাল্টি-মডেল সমন্বিত ওয়ার্কফ্লো টুল। Adobe Firefly Boards (থ্রেড 8) ও Riverside (থ্রেড 12)-এর মতো প্ল্যাটফর্মে Veo, Kling, Seedance, Nano Banana-সহ বহু ক্লোজড-সোর্স মডেলকে পার্টনার মডেল হিসেবে বেছে নেওয়া যায়।
- তীব্র বিরোধিতা ও প্রত্যাখ্যানের প্রবণতা: “শুধু স্ক্রিপ্ট দিন, পুরো ভিডিও স্বয়ংক্রিয়ভাবে তৈরি হবে” ধরনের faceless ভিডিও অটোমেশনকে r/aitubers ও r/ContentCreators ধারাবাহিকভাবে “slop” বলে উপহাস ও রিপোর্টযোগ্য বলে মনে করছে। আয়ের দাবি-সংক্রান্ত অভিজ্ঞতাও (থ্রেড 9) বিজ্ঞাপন বা অতিরঞ্জন সন্দেহে বিশ্বাস পায়নি।
- যে বিরোধ স্পষ্ট হয়েছে: Google Flow ও সামগ্রিক AI-এর বাস্তব ব্যবহারের মূল্যায়ন নিয়ে মতভেদ (থ্রেড 3-এ Minimax-কে শ্রেষ্ঠ বলা হয়েছে; থ্রেড 10-এ AI আদৌ প্রতিষ্ঠানের কর্মক্ষমতা বাড়ায় কি না, তা নিয়ে বিতর্ক)। সরল “AI প্রশংসা” বা “AI বিরোধিতা”—কোনোটিই নয়, এমন বাস্তবমুখী মন্তব্য নজরে আসে।
- অপ্রত্যাশিত বিষয়: প্রযুক্তিগত কর্মক্ষমতার আলোচনার চেয়ে সম্মতিবিহীন জেনারেশন বৈধ করার বিতর্ক (থ্রেড 2・5, মোট প্রায় 900 মন্তব্য) বা DHS-এর AI-তৈরি ছবি অপব্যবহারের (থ্রেড 11, 448pt) মতো নৈতিক ও রাজনৈতিক প্রেক্ষাপটের থ্রেডে বহু গুণ বেশি এনগেজমেন্ট। খাঁটি টুল-তুলনা থ্রেডগুলো 0–13pt-এর নিম্ন স্কোরে সীমিত।
সীমাবদ্ধতা
- এবারের Reddit সার্চ সম্পূর্ণভাবে একটিমাত্র টার্ম “Image and Video Generation AI News” দিয়ে করা হয়েছে; “open source”, “closed source” আলাদা করে বা Stable Diffusion, ComfyUI, Flux-এর মতো নির্দিষ্ট মডেল নাম দিয়ে সার্চ করা হয়নি। ফলে ছবি-জেনারেশন-কেন্দ্রিক প্রধান subreddit—r/StableDiffusion, r/aiArt ইত্যাদি—একটিও ফলাফলে নেই।
- সংগৃহীত 12টি থ্রেডের মধ্যে 5টির স্কোর 0pt; তাই কমিউনিটি প্রতিক্রিয়া কম এমন থ্রেডও রয়েছে। ছোট subreddit—r/RiversideFM: 728 সদস্য, r/AIToolTalks: 6,513 সদস্য ইত্যাদি—সীমিত নমুনা হিসেবে বিবেচনা করতে হবে।
- প্লেবুকের সীমাবদ্ধতার কারণে এই এজেন্ট নিজে Reddit ব্রাউজ করেনি; কর্মীর আগাম সংগৃহীত 12 থ্রেডের বাইরের তথ্য—যেমন সাম্প্রতিক কয়েক ঘণ্টার নতুন পোস্ট বা সার্চ টার্মে না থাকা সম্পর্কিত থ্রেড—অন্তর্ভুক্ত নয়।
- সংগ্রহকাল 2026-09-11 থেকে 2026-09-17, প্রায় এক সপ্তাহ; এর আগের বিতর্কের পরিবর্তনশীল ধারা জানা যায়নি।
X
X — ছবি ও ভিডিও জেনারেশন এআই সংবাদ
অ্যাকাউন্ট
সংগৃহীত 40টি পোস্ট 39টি আলাদা অ্যাকাউন্ট থেকে এসেছে (output/x.posts.md); এর একটিও ছবি/ভিডিও জেনারেশন AI-সংশ্লিষ্ট অ্যাকাউন্ট নয়। সেটে Midjourney, OpenAI/Sora, Runway, Stability AI, Black Forest Labs, ByteDance/Kling, Pika, Luma বা অনুরূপ কোনো হ্যান্ডেল নেই। থাকা অ্যাকাউন্টগুলো রাজনৈতিক ভাষ্য (@GunterFehlinger, @AntiTrumpCanada, @Rusia_HD), স্পোর্টস বেটিং টিপস্টার (@BDreamz37398, @thekasik, @TheRealCEOAmber), ক্রিপ্টো/NFT প্রচার (@Hasan_NFTOX, @0xHeatt, @jubjubcommunity, @patlandcrypto, @AltcoinSherpa), এবং সাধারণ মন্তব্য/মিম অ্যাকাউন্টের মিশ্রণ (@Keegan59992745, @LeeLovesBey, @Captian_Loden_4)। এদের কেউ ছবি বা ভিডিও জেনারেশন AI নিয়ে পোস্ট করে না; থিম-সংশ্লিষ্ট কোনো কার্যকলাপই না থাকায় কোনো বড় একক অ্যাকাউন্টও এই বিষয়ে চালক নয়।
পোস্ট
কোনো ফলাফল নেই — সংগৃহীত 40টি পোস্টের একটিও ক্লোজড-সোর্স বা ওপেন-সোর্স ছবি/ভিডিও জেনারেশন AI-সংক্রান্ত নয়। গবেষণা ব্রিফের প্রেক্ষিতে প্রতিটি পোস্ট ও পূর্ণ পাঠ দেখে কোনো প্রাসঙ্গিক তথ্য মেলেনি। অপ্রাসঙ্গিক উদাহরণ: #1 (https://x.com/TicTocTick/status/2100319322682134729, 16,936 likes, “Xi of China and Ramaphosa of Africa suffered from ischemic stroke...”), #35 (https://x.com/GunterFehlinger/status/2100099276672040971, 13,824 likes, “Russia is collapsing in Donbas”), #38 (https://x.com/Keegan59992745/status/2100583905204326909, 159,030 likes, burrito/Israel রসিকতা)—সেটের তিনটি সর্বোচ্চ-এনগেজমেন্ট পোস্ট, সবকটিই AI-বহির্ভূত।
সংকেত
এই রানে X-এ ক্লোজড-সোর্স বা ওপেন-সোর্স ছবি/ভিডিও জেনারেশন AI প্রবণতা নিয়ে জানানোর কিছু নেই। একমাত্র দৃশ্যমান প্যাটার্ন সার্চ টার্মে: “Africa”, “Serbia”, “Zcash”, “Germany”, “$JubJub”, “Canada”, “Zagreb”, “#CyberSecurity”, “Russia”, “Israel”—এগুলো গবেষণা ব্রিফ-সংক্রান্ত শব্দ নয়, বরং X-এর নিজস্ব ট্রেন্ডিং/Explore বিষয় বলে মনে হচ্ছে। output/x.posts.md অনুসারে Explore-এ Croatia-ভিত্তিক ও “Politics” ট্রেন্ড দেখা গিয়েছিল। এই ধাপের সংগ্রহ সম্ভবত AI ছবি/ভিডিও থিমের বদলে X-এর ট্রেন্ডিং বিষয় সার্চ করেছে।
সীমাবদ্ধতা
- সংগৃহীত ডেটা এই রানের ব্রিফের উত্তর দেয় না।
output/x.posts.mdওoutput/x.posts.json-এ “Africa”, “Serbia”, “Zcash”, “Germany”, “$JubJub”, “Canada”, “Zagreb”, “#CyberSecurity”, “Russia”, “Israel” সার্চ করে পাওয়া 40টি পোস্ট আছে—সাধারণ রাজনৈতিক, স্পোর্টস বেটিং ও ক্রিপ্টো কনটেন্ট; এগুলো ব্রিফের “Image and Video Generation AI News” থিম নয়। - প্লেবুক অনুসারে এই ধাপ সরাসরি X ব্রাউজ করে না—অ্যানোনিমাস রিডে কিছু ফেরে না—এবং কেবল কর্মীর সংগৃহীত ডেটার ওপর নির্ভর করে। যেহেতু কোনো টার্মই Sora, Veo, Midjourney, Runway, Kling, Stable Diffusion, Flux, ComfyUI, LoRA, Nano Banana ইত্যাদির সঙ্গে যুক্ত নয়, তাই এই ফাইল থেকে ব্রিফের উত্তর দেওয়া সম্ভব নয়; থিম-সংশ্লিষ্ট শব্দে নতুন করে সংগ্রহ প্রয়োজন।
- ব্রিফের সঙ্গে সম্পর্কিত কোনো সার্চ টার্ম ব্যবহার হয়নি; ফলে এই রানে X কী বলছে বা বলছে না, সে বিষয়ে কোনো সিদ্ধান্ত দেওয়া যায় না।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন এআই সংবাদ
চ্যানেল
- Paul J Lipsky — সাধারণ AI টুল রিভিউয়ার; “ChatGPT Images 2.5 Is Here (And It's A LOT Of Fun)” 9 দিনে 277K ভিউ পেয়েছে (watch)।
- Kevin Stratvert — বড় মূলধারার টেক-টিউটোরিয়াল চ্যানেল; “ChatGPT Images 2.5 Tutorial for Beginners” 1 দিনে 58K ভিউ পেয়েছে।
- AI Master — 327K সাবস্ক্রাইবার; “Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI”, 17 জানুয়ারি 2026 থেকে 76,658 ভিউ।
- JohnnyTube — 30.6K সাবস্ক্রাইবার; “Nano Banana 2 Is INSANE! Everything You Need To Know (Full Course)”, 6 মার্চ 2026 থেকে 26,162 ভিউ।
- AffContent — 262K সাবস্ক্রাইবার; তুলনা/অ্যাফিলিয়েটধর্মী কনটেন্ট, যেমন “BEST AI Image Generator in 2026 (Don't Choose Wrong!)”, 9 এপ্রিল 2026 থেকে 14,694 ভিউ।
- Dan Kieft — 295K সাবস্ক্রাইবার, AI চলচ্চিত্রনির্মাণকেন্দ্রিক; “Seedance 2.0 is CRAZY for AI Filmmaking - Full Course”, 24 এপ্রিল 2026 থেকে 179,589 ভিউ—সাবস্ক্রাইবার সংখ্যার তুলনায় সাম্প্রতিক আপলোডগুলোর মধ্যে সম্ভবত সেরা পারফর্মার।
- SECourses — 53.7K সাবস্ক্রাইবার, ঘন লোকাল/ওপেন-সোর্স ComfyUI টিউটোরিয়াল; “Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models”, 6,649 ভিউ (18 আগস্ট 2025-এ পোস্ট—60 দিনের উইন্ডোর বাইরে, সক্রিয় ওপেন-সোর্স টিউটোরিয়াল চ্যানেলের পটভূমি হিসেবে রাখা)।
- Qwen-Image ও Wan সার্চে বারবার উঠে আসা ছোট/লং-টেইল চ্যানেল (শুধু শিরোনাম, মেট্রিক নিশ্চিত নয়): “Qwen-Image完全ガイド” ও “Qwen-Image-2512” ওয়াকথ্রু করা জাপানি AI টুল চ্যানেল, এবং “ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat” করা ইংরেজি চ্যানেল।
ভিডিও
- “ChatGPT Images 2.5 Is Here (And It's A LOT Of Fun)” — Paul J Lipsky, প্রায় 9 দিনের পুরোনো, 277K ভিউ। https://www.youtube.com/watch?v=Q7SiipUCjro — OpenAI-এর 8 সেপ্টেম্বর 2026-এর ChatGPT Images 2.5 লঞ্চ (স্কেচ-টু-ইমেজ, প্রায় 50% কম লেটেন্সি, Flare/Sunburst API মডেল) নিয়ে আলোচনা; পরিচয়-সামঞ্জস্যকে প্রধান উন্নতি বলেছেন।
- “ChatGPT Images 2.5 Tutorial for Beginners” — Kevin Stratvert, প্রায় 1 দিনের পুরোনো, 58K ভিউ। মূলধারার দর্শকদের জন্য নতুন স্কেচ ফিচার ও বহু-ধাপের এডিটিং দেখায়, যা এখন এডিটের মধ্যে কনটেক্সট ধরে রাখতে পারে।
- “Everyone's Lying to You About GPT Image 2.5” — Joseph Martin, প্রায় 2 দিনের পুরোনো, 10K ভিউ। বিপরীতধর্মী মত: GPT-Image-1-এর তুলনায় “বড় লাফ” মূলত গতি/লেটেন্সিতে, কাঁচা ছবির গুণমানে নয়।
- “Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI” — AI Master, 17 জানুয়ারি 2026 থেকে 76,658 ভিউ। ব্র্যান্ড/পণ্য ছবির ব্যবহারের জন্য Google Gemini 3 Pro Image মডেলের 6-অংশের প্রম্পট গাইড—Subject+Action+Environment+Art Style+Lighting+Details।
- “Nano Banana 2 Is INSANE! Everything You Need To Know (Full Course)” — JohnnyTube, 6 মার্চ 2026 থেকে 26,162 ভিউ। Nano Banana Pro 2-কে এক টুলে ছবি+ভিডিও জেনারেটর হিসেবে তুলে ধরে এবং Midjourney, Flux, Sora 2 ও Veo 3.1-এর সঙ্গে অনানুষ্ঠানিক তুলনা করে।
- “BEST AI Image Generator in 2026 (Don't Choose Wrong!)” — AffContent, 9 এপ্রিল 2026 থেকে 14,694 ভিউ। বিনামূল্যে বনাম পেইড ক্লোজড-সোর্স জেনারেটরের ব্যাপক রাউন্ডআপ/অ্যাফিলিয়েট তুলনা।
- “Seedance 2.0 is CRAZY for AI Filmmaking - Full Course” — Dan Kieft, 24 এপ্রিল 2026 থেকে 179,589 ভিউ। ByteDance-এর Seedance 2.0-এর অ্যাকশন সিকোয়েন্সের মান, প্রম্পট-নির্ভুলতা ও ভিজ্যুয়াল ধারাবাহিকতা তুলে ধরা হয়েছে, সীমাবদ্ধতাসহ; একই সপ্তাহে একই বিষয়ে অন্য নির্মাতাদের বেশ কয়েকটি আপলোডের তুলনায় এটি সর্বোচ্চ আকর্ষণ পেয়েছে।
- “State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows” — @StarnationsAI, 20 মার্চ 2026 প্রিমিয়ার, 177 ভিউ / প্রায় 1K সাবস্ক্রাইবার। কম-ট্র্যাকশনের উদাহরণ; ছোট চ্যানেলেও তুলনামূলক ভিডিও ফরম্যাট আছে। বর্ণনার বড় অংশ AI ভিডিও কীওয়ার্ড ঘিরে অপ্রাসঙ্গিক কর্পোরেট ট্রেনিং কনটেন্টে ভরা।
- “Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — SECourses, 6,649 ভিউ (18 আগস্ট 2025—60 দিনের উইন্ডোর বাইরে, তবে সবচেয়ে পরিষ্কার ওপেন-সোর্স-নির্দিষ্ট ডেটা পয়েন্ট)। Wan 2.2 (ভিডিও), FLUX ও Qwen-Image (টেক্সট-টু-ইমেজ)-এর প্রিসেট কনফিগারেশন, ডাউনলোড, আপস্কেলিং ও ট্রেনিং/ফাইন-টিউনিং নিয়ে সপ্তাহব্যাপী পরীক্ষা।
- সার্চে পাওয়া কিন্তু পেজ ফেচে মেট্রিক যাচাই না হওয়া ওপেন-সোর্স শিরোনামের ক্লাস্টার: “Qwen-Image完全ガイド|ポスター作成から画像編集まで5分で終わらせる方法”, “【徹底解説】最強オープンソース『Qwen-Image-2512』”, “ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat”, এবং “Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX.”
সংকেত
- এ মুহূর্তে ক্লোজড-সোর্সের গতি সাপ্তাহিক। OpenAI 8 সেপ্টেম্বর 2026-এ ChatGPT Images 2.5 প্রকাশ করেছে এবং Google 26 ফেব্রুয়ারি 2026-এ Nano Banana 2 (Gemini 3.1 Flash Image, 4K) এগিয়ে দিয়েছে—দুই ক্ষেত্রেই 30K–330K সাবস্ক্রাইবারের চ্যানেলে একই সপ্তাহে টিউটোরিয়াল ও প্রতিক্রিয়ার ঢেউ, কয়েক দিনের মধ্যে দশ-হাজারের বেশি ভিউ।
- ByteDance-এর Seedance 2.0 (10 ফেব্রুয়ারি 2026 প্রকাশ) এ বছরের YouTube-এ সবচেয়ে আলোচিত ভিডিও মডেল। সাধারণ শিরোনাম সার্চে ফেব্রুয়ারি থেকে জুন পর্যন্ত 10টির বেশি নিবেদিত টিউটোরিয়াল/রিভিউ পাওয়া গেছে; Sora 2, Veo 3.1 বা Kling 3.0-এর প্রতিটির চেয়ে বেশি। পাওয়া সেরা ভিডিও Dan Kieft-এর 179.6K ভিউ, যা ক্লোজড-সোর্স ছবি টিউটোরিয়ালগুলোর চেয়ে প্রায় দ্বিগুণ।
- Sora 2 নিয়ে YouTube আলোচনায় এখন ফিরে দেখা বেশি, ভবিষ্যৎমুখিতা কম। সার্চ ফল নতুন ফিচার টিউটোরিয়ালের বদলে “state of AI video” তুলনার দিকে ঝুঁকেছে। OpenAI-এর কনজিউমার অ্যাপ বন্ধ (26 এপ্রিল 2026) এবং API বন্ধের তারিখ (24 সেপ্টেম্বর 2026) এর সঙ্গে এটি সামঞ্জস্যপূর্ণ—Sora 2 এখন অন্য মডেলের তুলনামূলক বেসলাইন, শেখার প্রধান বিষয় নয়।
- ওপেন-সোর্স কভারেজ SECourses-ধাঁচের ঘন, টুল-কেন্দ্রিক চ্যানেল ও Qwen-Image-এর জাপানি গভীর ব্যাখ্যার দিকে ঝুঁকে আছে, বড় তুলনামূলক ভিডিওর দিকে নয়। নিশ্চিত ওপেন-সোর্স ভিডিওটির 6,649 ভিউ ক্লোজড-সোর্স নেতাদের তুলনায় প্রায় এক-দশমাংশ, যা ছোট কিন্তু বেশি প্রযুক্তিনির্ভর দর্শকগোষ্ঠী নির্দেশ করে।
- Qwen-Image (Alibaba) ওপেন-ওয়েট মডেল হিসেবে সবচেয়ে বেশি নিবেদিত ভিডিও মনোযোগ পাচ্ছে। ইংরেজি 700-জেনারেশন বনাম FLUX বেঞ্চমার্ক এবং একাধিক জাপানি “এখন আর AI বলে বোঝা যায় না” ধরনের Qwen-Image-2512 ভিডিওতে এর উপস্থিতি রয়েছে।
সীমাবদ্ধতা
- YouTube-এর সার্চ ফল পেজ (
/results?search_query=...) ও অধিকাংশ/watchপেজে কাঠামোবদ্ধ মেটাডেটা আনার সময় বারবার 401/CAPTCHA বাধা এসেছে। সার্চ পেজ ক্লায়েন্ট-রেন্ডারড JavaScript হওয়ায় HTML-reader proxy ব্যবহৃত হয়েছে। প্রায় প্রতি তিনটি ফেচে একটিই সফল হয়েছে; বাকিগুলো বাদ দিতে হয়েছে বা সার্চ স্নিপেটের শিরোনাম/তারিখ হিসেবে উল্লেখ করতে হয়েছে। - এ বাধার কারণে Qwen-Image-2512 গভীর ব্যাখ্যা, Ovis/LongCat/Z-Image ComfyUI তুলনা, Qwen-Image-Edit-Rapid-AIO-এর মতো ওপেন-সোর্স ভিডিওর নির্দিষ্ট ভিউ, সাবস্ক্রাইবার ও পূর্ণ বর্ণনা নিশ্চিত করা যায়নি।
- কোনো ভিডিওর শীর্ষ মন্তব্য সংগ্রহ করা যায়নি; একই পেজ-অ্যাক্সেস বাধায় মন্তব্য বিভাগ পড়া সম্ভব হয়নি।
- সাধারণ Sora 2 / Veo 3.1 / Kling 3.0 তুলনামূলক ভিডিওর নির্দিষ্ট ভিউ-সংখ্যা নিশ্চিত করা যায়নি, নিম্ন-ট্র্যাকশনের StarnationsAI উদাহরণটি ছাড়া।
- বর্তমান রানে Wan, HunyuanVideo বা LTX-এর মতো একক ওপেন-সোর্স ভিডিও জেনারেশন মডেল নিয়ে নিশ্চিত ভিউ-সংখ্যাসহ উচ্চ-প্রদর্শনকারী ইংরেজি ভিডিও পাওয়া যায়নি।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন এআই সংবাদ
অ্যাকাউন্ট (প্রকাশক অ্যাকাউন্ট)
- dfl.bsky.social — Nano Banana 2 (Gemini ছবি তৈরি) দিয়ে তৈরি ল্যান্ডস্কেপ-ফটোগ্রাফি-ধাঁচের ইলাস্ট্রেশন প্রতিদিন পোস্ট করা ব্যক্তিগত নির্মাতা।
- triflingtree.bsky.social —
#NanoBananaPro#GeminiAiট্যাগে বিপুল AI আর্ট পোস্ট করা ভারী ব্যবহারকারী। - ai.bots.law — AI-সংক্রান্ত মামলা ও আইনগত পরিবর্তন অনুসরণকারী স্বয়ংক্রিয় পোস্টিং বট।
- gen-ai.news / aichina.news / stechtimes.com / channelnewsasia.bsky.social (bridgy-এর মাধ্যমে) — জেনারেটিভ AI শিল্পের খবর দেওয়া নিউজ বট/ফিড।
- pitchwall.bsky.social / onestudio1.bsky.social / beginnersinai.bsky.social — AI টুল তুলনা ও পণ্যসংক্রান্ত খবর তুলে ধরা অ্যাকাউন্ট।
- primereports.bsky.social / techpresso.bsky.social / theregister.com / socialmedialab.ca — Meta “Muse” ও Alibaba Qwen-এর মতো মডেলের ওপেন-ওয়েট প্রবণতা পর্যবেক্ষণকারী আন্তর্জাতিক সংবাদ অ্যাকাউন্ট।
- singularityhorizon.bsky.social / heppokopu.bsky.social / misaka-mikoto-17.bsky.social / 404ai.bsky.social — Midjourney ও লোকাল পরিবেশ (ComfyUI)-এ AI আর্ট তৈরি করা জাপানি ব্যবহারকারীগোষ্ঠী।
পোস্ট (প্রধান পোস্ট)
ক্লোজড-সোর্স বিভাগ
- Sora 2 API প্রকাশ নিয়ে পোস্ট: “Sora 2 API: A developer-friendly API for Sora 2 and Sora 2 Pro”。2026-09-15, Likes 0 / Reposts 0。
https://bsky.app/profile/pitchwall.bsky.social/post/3mvjwvr327k2u - “Veo 3.1 vs Sora 2 vs Kling 3.0” ভিডিও জেনারেশন AI তুলনার পোস্ট।2026-09-14, Likes 2 / Reposts 0。
https://bsky.app/profile/onestudio1.bsky.social/post/3mvhdlv5vgk2w - Sora-এর একক অ্যাপ বন্ধ হওয়ার কথা বলে Runway, Kling, Veo-তে চলে যাওয়ার পরামর্শ; ব্যাখ্যায় বলা হয়েছে OpenAI প্রযুক্তি বন্ধ করছে না, কেবল স্বতন্ত্র অ্যাপ গুটিয়ে নিচ্ছে।2026-03-25, Likes 0。
https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l - Disney বনাম Midjourney কপিরাইট মামলার নতুন নথি নিয়ে পোস্ট।2026-09-18, Likes 0。
https://bsky.app/profile/ai.bots.law/post/3mvqwgixvkm2n - Nano Banana 2 দিয়ে তৈরি ওপর থেকে দেখা জাপানি-ধাঁচের প্রাকৃতিক দৃশ্যের ইলাস্ট্রেশন।Likes 25 / Reposts 1, 2026-09-17。
https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i #NanoBananaProট্যাগের অতিবাস্তব গাছের আর্ট পোস্ট।Likes 15, 2026-09-17。
https://bsky.app/profile/triflingtree.bsky.social/post/3mvpliiqt5c25- “Meta ya tiene su rival para Nano Banana 2” (Meta Nano Banana 2-এর প্রতিদ্বন্দ্বী তৈরি করেছে) শিরোনামের ব্রেকিং পোস্ট।2026-09-16, Likes 0。
https://bsky.app/profile/laiadesk.bsky.social/post/3mvmiod2iod26
ওপেন-সোর্স বিভাগ
- Lightricks ভিডিও জেনারেশন মডেল LTX-2.3-কে লেগ্যাসি ঘোষণা করে LTX-2.5-কে সুপারিশকৃত মডেল করেছে—এমন সংবাদ।2026-09-12, Likes 0。
https://bsky.app/profile/gen-ai.news/post/3mvdadb2upx2l - Modelers.cn-এর মাধ্যমে প্রকাশিত আফ্রিকান বংশোদ্ভূত মানুষের উপস্থাপনার জন্য FLUX LoRA (open-weight) পরিচয় করানো পোস্ট।2026-09-09, Likes 0。
https://bsky.app/profile/aichina.news/post/3mv3dcr6hgz2i - Alibaba-এর multimodal MoE মডেল “Qwen3.8-Flash” (Qwen4 স্থাপত্যের প্রিভিউ) প্রকাশের খবর।2026-08-30, Likes 1。
https://bsky.app/profile/primereports.bsky.social/post/3mub3pkd2rf2s - আবুধাবির একটি গবেষণা প্রতিষ্ঠান ওয়েট, প্রশিক্ষণ ডেটা ও কোডসহ সম্পূর্ণ ওপেন AI মডেলসমষ্টি প্রকাশ করেছে—এমন খবর।2026-09-03, Likes 0。
https://bsky.app/profile/channelnewsasia.bsky.social/post/3mumk4agbwm2g - চীনা AI প্রতিষ্ঠানগুলো পশ্চিমা প্রতিদ্বন্দ্বীদের মূল্য-কমানোর প্রতিযোগিতার মধ্যে ধারাবাহিকভাবে ওপেন মডেল প্রকাশ করছে—এমন বিশ্লেষণ।2026-09-06, Likes 0。
https://bsky.app/profile/stechtimes.com/post/3muuykcvzv62i
সংকেত
- Nano Banana 2 (Google Gemini ছবি তৈরি) ব্যক্তিগত নির্মাতাদের দৈনন্দিন পোস্টে স্থায়ী হয়েছে। triflingtree ও dfl-এর মতো ব্যক্তিরা
#NanoBananaProও#GeminiAiট্যাগে প্রায় প্রতিদিন কাজ প্রকাশ করছেন; অর্থাৎ এটি কেবল প্রাথমিক হাইপ নয়, বাস্তব ব্যবহারে বিস্তৃত হচ্ছে। - Sora 2-কে ঘিরে “আশা” ও “ভবিষ্যৎ নিয়ে উদ্বেগ” পাশাপাশি রয়েছে। ডেভেলপার-বান্ধব API প্রকাশের খবরের সঙ্গে স্বতন্ত্র অ্যাপ বন্ধ হওয়ায় Runway/Kling/Veo-তে সরে যেতে বলা পোস্টও দেখা গেছে; OpenAI-এর ভিডিও জেনারেশন কৌশলের পুনর্গঠন আলোচ্য বিষয়।
- ক্লোজড-সোর্স দিকের গুরুত্বপূর্ণ বিষয় কপিরাইট মামলা। Disney বনাম Midjourney-এর নতুন মামলাগত পরিবর্তন বট অ্যাকাউন্ট অনুসরণ করছে; স্টুডিও ও AI ছবি-জেনারেশন প্রতিষ্ঠানের আইনি লড়াই চলমান।
- ওপেন-সোর্সে প্রধানত নিউজবট-নির্ভর ব্রেকিং আপডেট, ব্যক্তিগত উচ্চ-উদ্দীপনার পোস্ট কম। LTX-2.5, FLUX LoRA, Qwen3.8-Flash ও আবুধাবির সম্পূর্ণ ওপেন মডেলের মতো খবর ইউরোপ, চীন ও মধ্যপ্রাচ্যে ছড়িয়ে আছে।
- Meta “Muse” সিরিজের মডেল (Spark/Glimmer 30B)-এর ওপেন-ওয়েট হওয়া “শিগগিরই” বলা হলেও এখনও অপেক্ষমান, এবং Nano Banana 2-এর প্রতিদ্বন্দ্বী হিসেবে একাধিক আন্তর্জাতিক সংবাদ অ্যাকাউন্ট এটি নজরে রাখছে।
- ComfyUI জাপানি ব্যবহারকারীদের লোকাল জেনারেশনের একটি মানক টুল। heppokopu ও misaka-mikoto-17 প্রমুখের পোস্টে ChatGPT/Nano Banana-ধাঁচের গুণমানে লোকাল পরিবেশে পৌঁছানোর চেষ্টা দেখা যায়।
সীমাবদ্ধতা
- পাবলিক সার্চ API (
public.api.bsky.app/api.bsky.app) স্বয়ংক্রিয় ফেচে অনিয়মিতভাবে HTTP 403 দিয়েছে।Sora 2 video,Midjourney-এর মতো সাদামাটা স্পেস-বিচ্ছিন্ন শব্দ কাজ করলেও উদ্ধৃত ফ্রেজ—যেমন"Stable Diffusion"—বা OR সিনট্যাক্স প্রায় সবসময় ব্যর্থ। “Stable Diffusion”, “Wan 2.5”, “Qwen Image” দিয়ে একবারও ডেটা পাওয়া যায়নি। bsky.appওয়েব পেজ ক্লায়েন্ট-সাইড রেন্ডারড; JavaScript ছাড়া সরাসরি ফেচে পোস্ট বা প্রোফাইলের মূল লেখা পাওয়া যায়নি। সব পাঠ JSON API-এর টেক্সট ও কাউন্টের ওপর ভিত্তি করে।- লগইন না থাকায় following feed, custom feed বা ব্যক্তিগত তালিকা দেখা যায়নি; শুধু পাবলিক কীওয়ার্ড সার্চ অন্তর্ভুক্ত।
- সার্চ প্রধানত ইংরেজি পণ্য ও মডেল নাম দিয়ে করা হয়েছে; সক্রিয় জাপানি সার্চ করা হয়নি। ইংরেজি কীওয়ার্ডে কাকতালীয়ভাবে ধরা জাপানি পোস্ট থেকে জাপানি আলোচনার পূর্ণ কভারেজ দাবি করা যায় না।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI-সংক্রান্ত আলোচনা (সেপ্টেম্বর 2026)
কমিউনিটি
- !«メールアドレス» — open-weight ছবি ও ভিডিও জেনারেশন AI, ComfyUI এক্সটেনশন ও মডেল বিতরণে বিশেষায়িত। এবার এটি সবচেয়ে কার্যকর উৎস; MiniMax-H3 ভিডিও মডেল-সংক্রান্ত পোস্ট ঘনভাবে এসেছে।
- !«メールアドレス» — সাবস্ক্রাইবার প্রায় 1.6K (স্থানীয় 206)। Stable Diffusion-ধাঁচের মডেলে তৈরি অ্যানিমে আর্ট পোস্টের জন্য, শুধু SFW।
- !stable_diffusion_art / !stable_diffusion_abstract / !stable_diffusion_witches / !stable_diffusion_mycology / !stable_diffusion_furry / !stable_werewolves (সব lemmy.today) — বিষয়ভিত্তিক খণ্ডিত AI আর্ট কমিউনিটি; খবরের চেয়ে কাজের গ্যালারি।
- !«メールアドレス» — r/ArtificialIntelligence-এর ক্রসপোস্ট প্রবাহিত করা মিররধর্মী কমিউনিটি; Lemmy-উৎপন্ন মৌলিক আলোচনা প্রায় নেই।
- !«メールアドレス» — 8,235 সাবস্ক্রাইবার। AI-সমালোচনামুখী কমিউনিটি; ছবি/ভিডিও জেনারেশন AI নিয়ে সংশয়ী পোস্ট বেশি।
- !«メールアドレス» — 2,698 সাবস্ক্রাইবার। প্রযুক্তি শিল্পের অতিরঞ্জন ব্যঙ্গ করা “sneer” কমিউনিটি; Midjourney-এর দিকবদলের খবর এখানে সবচেয়ে আলোচিত।
- !«メールアドレス» — সাধারণ প্রযুক্তি সংবাদ। Midjourney-সংক্রান্ত একাধিক প্রধান খবর এখানে এসেছে।
পোস্ট
- MiniMax-H3-এর জন্য ComfyUI এক্সটেনশনের ধারাবাহিক পোস্ট (ওপেন-সোর্স প্রবণতার মূল বিষয়) — !«メールアドレス»-এ শুধু 2026-08-28 থেকে 09-16-এর মধ্যে প্রায় 20টি পোস্ট। উদাহরণ:
- “ComfyUI-FL-MiniMaxH3” (score 5, 2026-08-30, github.com/filliptm/ComfyUI-FL-MiniMaxH3)—প্রম্পট টাইমলাইন ব্যবস্থাপনা ও শট বিন্যাস ফিচার।
- “H3-World” (score 3, 2026-09-02, huggingface.co/DANNY621/H3-World)—নিজেকে “the first interactive world model built on MiniMax-H3” বলে দাবি করে।
- “ComfyUI-MiniMaxH3-CLSS” (score 0, 2026-09-01, github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)—16GB VRAM-সমৃদ্ধ ভোক্তা মেশিনে ইচ্ছামতো দৈর্ঘ্যের অডিওসহ ভিডিও জেনারেশনের দাবি।
- “ComfyUI_MinimaxH3_AutoContext” (score 1, 2026-09-16, github.com/supElement/ComfyUI_MinimaxH3_AutoContext)—কম VRAM-এও অনন্ত দীর্ঘ ভিডিও ধারাবাহিকভাবে তৈরি করার দাবি।
- ব্যবহারকারী brucethemoose-এর মন্তব্য (score 12, 2026-09-14) অনুযায়ী MiniMax-H3 হলো এমন মডেল যা অডিও, ভিডিও ও ছবিকে ইচ্ছামতো একত্রে রেফারেন্স করতে পারে; RTX 3090 + Ryzen 7800-সহ সাধারণ কাস্টম পিসিতে লোকাল রান নিশ্চিত করেছেন।
- Midjourney ছবি তৈরি থেকে চিকিৎসা সরঞ্জাম (পুরো শরীরের আল্ট্রাসাউন্ড স্ক্যানার)-এ মোড় নিয়েছে — !«メールアドレス» পোস্ট (https://awful.systems/post/8731127 , score 40, 15 মন্তব্য, 2026-06-19)। David Gerard “Midjourney Medical” ঘোষণা পরিচয় করিয়েছেন; মন্তব্যে Theranos-এর সঙ্গে তুলনা করে ব্যঙ্গ করা হয়েছে। YourNetworkIsHaunted বলেছেন, যন্ত্রটি কেবল 60 ইঞ্চি (প্রায় 152 সেমি) উচ্চতা পর্যন্ত ডুবানো যায়, ফলে হৃদপিণ্ডের ওপরের অংশ স্ক্যান করা যায় না (score 10)। Terranoid একে ছবি-জেনারেশন ব্যবসা আটকে যাওয়ার পরের “hail mary” বলেছেন (score 10)।
- একই খবর !«メールアドレス»-এও একাধিকবার এসেছে: “Midjourney pivots from AI image generation...” (theregister.com, score 58, 2026-06-18), “Midjourney wants Hollywood studios to reveal...” (techcrunch.com, score 73, 2026-07-05)।
- Runway-এর কর্পোরেট ব্যবসা দ্বিগুণ হয়েছে বলে রিপোর্ট — !«メールアドレス» (score 0, 2026-08-30, reddit.com/r/ArtificialInteligence/comments/1w2hnea মাধ্যমে ক্রসপোস্ট)। এন্টারপ্রাইজ চুক্তির নেট রেভিনিউ রিটেনশন (NRR) 300%-এর বেশি—এই সংখ্যাটি আলোচিত।
- Google Earth-এর AI ফিচার “Nano Banana” সংযোজন প্রকাশের পরদিনই বন্ধ — !«メールアドレス» (fortune.com, 2026-08-07) ও !«メールアドレス»-ঘরানার পোস্টে। যে কেউ স্যাটেলাইট ছবির মতো জাল ছবি বানাতে পারে—এমন সমস্যার কথা উঠে আসে (404media.co নিবন্ধও দেখুন), এবং Google তাৎক্ষণিকভাবে ফিচারটি বন্ধ করে বলে রিপোর্ট।
- একই প্রম্পটে 6টি AI ভিডিও মডেলের তুলনা — !«メールアドレス» “I ran the same prompt through 6 AI video models...” (score 1, 2026-09-17, reddit.com/r/ArtificialIntelligence/comments/1wipgwa)।
- ChatGPT Images, Wan, Nano Banana Pro ও Seedream-এর সাদা-কালো মাঙ্গা রঙিন করার তুলনা — !«メールアドレス» “Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?” (score 1, 2026-09-14)। ওপেন মডেল Wan এবং ক্লোজড মডেল Nano Banana Pro, Seedream, GPT Images পাশাপাশি তুলনা হয়েছে; মন্তব্যে GPT-এর ফলাফলের প্রশংসা বেশি।
- AI-বিরোধী সুর নির্দেশ করা পোস্ট — !«メールアドレス» “Why companies like anthropic and open AI make AI even worse” (score 63, 2026-09-14)। ছবি/ভিডিও জেনারেশন AI-কেন্দ্রিক না হলেও, Lemmy-র সামগ্রিক পরিবেশে বড় ক্লোজড-সোর্স প্রতিষ্ঠানের প্রতি অবিশ্বাসের নির্দেশক।
- Qwen লোকাল চালনার রিপোর্ট — !«メールアドレス» “Testing Qwen 3.8 27B running locally on a single 5090” (score 1, 2026-09-16, v.redd.it/jdrothgw4vph1)। ছবি তৈরি নিজে নয়, কিন্তু ভোক্তা GPU-তে ওপেন মডেল চালানোর প্রেক্ষাপটের অংশ।
- অ্যানিমে আর্ট, বিমূর্ত শিল্প ইত্যাদির দৈনন্দিন AI-তৈরি পোস্ট প্রবাহ — !share_anime_art ও !stable_diffusion_art-ধরনের কমিউনিটিতে civitai.com-এ হোস্ট করা ছবিসহ প্রায় প্রতিদিন নতুন পোস্ট আসে (উদাহরণ: “Isshiki Clear - Mahjong Fight Girl” score 15, 2026-09-17, lemmy.dbzer0.com/post/75601449)। সংবাদমূল্য কম, কিন্তু Stable Diffusion/Flux/Krea2-ধরনের মডেলের দৈনন্দিন ব্যবহার দেখায়।
সংকেত
- ওপেন-সোর্স দিক “MiniMax-H3-এ একরঙা”। সেপ্টেম্বরের শুরু থেকে মাঝামাঝি stable_diffusion কমিউনিটি এই ভিডিও মডেলের ComfyUI-ঘিরে টুলের পোস্টে প্রায় পূর্ণ ছিল। লোকাল GPU-তে অডিও, ছবি ও ভিডিও একত্রে চালানো এবং 16GB VRAM-স্তরেও কাজের জন্য অপ্টিমাইজেশনের বিষয় বারবার এসেছে।
- ক্লোজড-সোর্সে ইতিবাচক খবর কম। Midjourney-এর হার্ডওয়্যার-পিভট ও Google Earth ফিচার বন্ধ—দুটিই “ভুল পথে যাওয়া” ধরনের খবর—বেশি দৃশ্যমান। Runway-এর প্রবৃদ্ধি রিপোর্ট অল্প কয়েকটি ইতিবাচক বিষয়ের একটি।
- Lemmy-র সামগ্রিক সুর সন্দেহপ্রবণ ও সমালোচনামুখী (!fuck_ai, !techtakes)। নিঃশর্ত প্রশংসা বিরল; বাস্তবায়ন কমিউনিটি (stable_diffusion) ও সংবাদ-সমালোচক কমিউনিটি (techtakes, fuck_ai)-র মধ্যে তাপমাত্রার পার্থক্য বড়।
- মৌলিক আলোচনার বদলে কাজের পোস্ট ও ক্রসপোস্ট প্রধান। !ai_reddit আক্ষরিক অর্থেই Reddit পুনঃপ্রেরণ; এটি Lemmy-র প্রাথমিক তথ্য নয়।
সীমাবদ্ধতা
- Lemmy ইনস্ট্যান্স-বিতরণকৃত; সার্চ API কেবল lemmy.world-এ ইনডেক্স করা পোস্ট ধরে। lemmy.ml বা lemm.ee আলাদাভাবে সার্চ করার সময় ছিল না; এবার শুধু lemmy.world-এর ফেডারেশনের মাধ্যমে পাওয়া ফল অন্তর্ভুক্ত।
- “Sora”, “Veo”, “Gemini image”, “Flux” ইত্যাদি একাধিক কীওয়ার্ডে সার্চ করা হলেও Sora 2 বা Google Veo-এর নতুন মডেল ঘোষণাকেন্দ্রিক পোস্ট পাওয়া যায়নি; ক্লোজড-সোর্স বড় প্রতিষ্ঠানের পণ্য ঘোষণার খবর Lemmy-তে কম—এটাই এবারের বাস্তবতা।
- pivot-to-ai.com-এর মূল নিবন্ধ WebFetch-এ বিকৃত অক্ষরে আসায় সরাসরি উদ্ধৃত করা যায়নি; awful.systems-এর Lemmy পোস্ট ও মন্তব্য, এবং সার্চ ইঞ্জিনের মাধ্যমে বাইরের সংবাদ (Bloomberg ইত্যাদি) দিয়ে বিষয়টি সমর্থন করা হয়েছে।
- কমিউনিটির সাবস্ক্রাইবার সংখ্যা API অস্থিরতার (400/500 error) কারণে অনির্ভরযোগ্য; !stable_diffusion ও !ai_reddit-এর সঠিক সংখ্যা পাওয়া যায়নি। শুধু !share_anime_art (প্রায় 1.6K), !fuck_ai (8,235), !techtakes (2,698) পাওয়া গেছে।
- ব্রিফের “প্রতিটি SNS-এ প্রায় 20টি পোস্ট বিশ্লেষণ” মানদণ্ডের জন্য একাধিক কীওয়ার্ড সার্চে মোট 20টির বেশি পোস্টের লেখা, স্কোর ও তারিখ নিশ্চিত করা হয়েছে; এখানে সেগুলোর মধ্যে প্রতিনিধিত্বমূলক 9টি বাছাই করে দেওয়া হয়েছে।
Pinterest — ছবি ও ভিডিও জেনারেশন এআই সংবাদ
ভিজ্যুয়াল থিম
- গাঢ় নিয়ন “AI news roundup” ইনফোগ্রাফিক টেমপ্লেট প্রাধান্য পেয়েছে। প্রায় কালো/নেভি ব্যাকগ্রাউন্ড, জ্বলজ্বলে cyan-magenta-purple লাইন, মোটা সাদা হেডলাইন টাইপ, এবং গোলাকার ব্যাজে টুল লোগোসহ নম্বরযুক্ত সারি। অধিকাংশ তথ্যধর্মী পিন এই ভিজ্যুয়াল ভাষা ব্যবহার করে।
[6, 9, 10, 11, 18, 20, 26, 31, 38, 39, 41, 45, 48] - “AI চিনতে পারেন?” আসল-বনাম-নকল চ্যালেঞ্জ সর্বত্র। বিভক্ত স্ক্রিন বা A/B তুলনায় আসল ছবি/ভিডিও/চোখ বেছে নিতে বলা হয়; সঙ্গে face-swapped red-carpet photo demo ও “This is AI” hyperreal selfie caption।
[3, 21, 24, 33, 46] - AI-কে chrome/white humanoid robot হিসেবে মানবিক রূপ দেওয়া। “BREAKING NEWS” অ্যাঙ্কর ডেস্কে, ফোন হাতে “FAKE” স্ট্যাম্পের পাশে, বা শহুরে আকাশরেখার ওপর জ্বলন্ত পৃথিবী ছোঁয়া android—নির্দিষ্ট কোনো পণ্যের বদলে “AI” বোঝাতে ব্যবহৃত।
[3, 40, 44] - AI news কনটেন্টে YouTuber reaction-face thumbnail। OpenAI, Google, Meta, Anthropic, Notion-এর লোগোর পাশে বিস্মিত/দাড়িওয়ালা পুরুষ—সাপ্তাহিক AI খবর ভিডিওর পরিচিত ঘরানাগত রীতি।
[2, 19, 22, 42] - এক উৎস ভিডিও, অনেক স্টাইল—ছবি/ভিডিও ধারাবাহিকতা প্রযুক্তির ডেমো। হাঁটা একজন মানুষ ও একটি গাড়িকে কাঠের ব্লক, origami, Lego bricks, ফুল ও খেলনা নির্মাণে পুনরায় রেন্ডার করে দেখানো হয়েছে।
[5] - একই অল্প কয়েকটি টুল-নাম সব তালিকায় ফিরে আসে: Runway (Gen-3), Pika, Kling AI, Luma/Dream Machine, Google Veo (2 ও 3), Canva AI, Hailuo AI (MiniMax), CapCut, ElevenLabs, Stable Video Diffusion।
[6, 10, 18, 20, 31, 45] - মান-প্রমাণ হিসেবে অতিবাস্তব AI প্রতিকৃতি। ফটোরিয়ালিস্টিক বৃদ্ধ জেলে (AMD “Amuse 3.0”), মার্বেল-ও-কাঠের সেলোবাদক মূর্তি ও “AI baby” মুখ-মর্ফ কম্পোজিট ব্যবহার করে বর্তমান ছবি মডেল কতটা বিশ্বাসযোগ্য দেখায় তা বিক্রি করা হয়।
[25, 47, 50] - AI খবরকেও নকল সম্প্রচার/পত্রিকার ফ্রেমে উপস্থাপন। মক “BREAKING NEWS” chyron, AI news-anchor avatar generator (Wondershare Virbo), এবং সম্পূর্ণ মক পত্রিকার প্রথম পাতা (“The AI Dispatch,” Aug 15 2026) দেখায় AI news কনটেন্ট টিভি/প্রিন্ট সাংবাদিকতার ভিজ্যুয়াল রীতি অনুকরণ করছে।
[14, 36, 40, 41]
উল্লেখযোগ্য পিন
[5](শিরোনামহীন, বহু-স্টাইল ভিডিও রূপান্তর গ্রিড) — একজন ব্যক্তি ও গাড়ির উৎস ভিডিও 5 ধরনের উপাদানে—কাঠ, origami, Lego, ফুল, খেলনা প্লাস্টিক—পুনরায় রেন্ডার করা; সেটের বর্তমান ছবি/ভিডিও ধারাবাহিকতা প্রযুক্তির সবচেয়ে স্পষ্ট ডেমো।[9]“4 Major AI Updates You Need to Know in 2026” — নির্দিষ্ট বিষয়: OpenAI “GPT-6 Astra,” Gmail/Docs/Slides জুড়ে Gemini-এর এজেন্টিক হওয়া, Adobe Premiere-এ টাইমলাইনের ভেতর ভিডিও/অডিও জেনারেশন, এবং Cognition (Devin)-এর $48B মূল্যায়নে $2B Series E।[28]“ByteDance and Hollywood reach global deal on AI copyright” — বাস্তব সংবাদধর্মী পিন: ByteDance তার AI ছবি/ভিডিও টুলে IP সুরক্ষা জোরদার করতে Motion Picture Association-এর সঙ্গে চুক্তি করেছে।[45]“Today's AI News — May 20, 2026” — Google I/O 2026 সারাংশ: Gemini 3.5 Flash, Gemini Omni, AI-চালিত Search পুনর্গঠন, Apple AI accessibility ফিচার এবং AI স্মার্ট-গ্লাস প্রতিযোগিতা (Android XR)।[41]“The AI Dispatch,” Aug 15 2026 — মক পত্রিকার প্রথম পাতায় inference speed, sovereign AI, agent harnesses, AI safety, deep research-সহ বিস্তৃত AI-সংলগ্ন বিষয়।[31]“AI Video Creation Tools Changing How Content Is Made” — পাওয়া সবচেয়ে বিস্তৃত একক টুল ডিরেক্টরি; text-to-video, image-to-video, editing, voiceover, stock/B-roll ও publishing/optimization জুড়ে 20টি পণ্যের নাম।[24](শিরোনামহীন, AI-তৈরি red-carpet photo বনাম “original clip”) — এক ব্যক্তির উৎস ক্লিপের বিপরীতে অন্য ব্যক্তির চকচকে AI-তৈরি প্রতিকৃতি দিয়ে face-swap/deepfake ডেমো; পরিচয় স্থানান্তর প্রযুক্তি তুলে ধরে।[40]“Discover how Grok is revolutionizing video...” — “BREAKING NEWS” ডেস্কে humanoid robot anchor দিয়ে Grok-এর ভিডিও সক্ষমতার প্রচার।[47]“Amuse 3.0” — AMD-ব্র্যান্ডেড লোকাল/on-device AI আর্ট টুল; ফটোরিয়ালিস্টিক বৃদ্ধ জেলের প্রতিকৃতিতে ডেমো করা।[10]“AI Image Video: Best Quality vs Best Free” — পেইড সেরা-মানের টুল (ChatGPT Plus, Midjourney, Adobe Firefly, Runway Gen-3, Luma) এবং ফ্রি টুল (Ideogram, Gemini free tier, SeaArt, Krea, CapCut)-এ ভাগ করা decision-tree ইনফোগ্রাফিক।
সংকেত
- ভিডিও জেনারেশন টুল রাউন্ডআপ/তালিকাধর্মী পোস্ট সবচেয়ে জোরালো ও পুনরাবৃত্ত কনটেন্ট। Pinterest-এর AI ছবি-জেনারেশন দর্শকদের উদ্দেশে মূলত SEO/অ্যাফিলিয়েট নির্মাতারা একই ক্লোজড-সোর্স টুলসেট—Runway, Pika, Kling, Luma, Veo, Hailuo, CapCut—প্যাকেজ করছেন, সংবাদ ভাঙছেন না।
- “এটি AI কি না বোঝা যায়?” ধরনের সচেতনতামূলক কনটেন্ট—আসল-নকল চ্যালেঞ্জ, deepfake demo—নিজস্ব পূর্ণাঙ্গ উপঘরানা; একটি নির্দিষ্ট মডেল প্রকাশের বাইরে সনাক্তকরণ নিয়ে উদ্বেগ/কৌতূহল কনটেন্টের চালক।
- কয়েকটি পিন সংগ্রহ উইন্ডো শুরুর পরের তারিখযুক্ত নির্দিষ্ট ঘটনা উল্লেখ করে—Google I/O 2026 recap, “GPT-6 Astra,” “Aug 15 2026” news digest, Cognition-এর $2B তহবিল সংগ্রহ—এগুলো প্ল্যাটফর্মে পাওয়া কঠিন সংবাদের সবচেয়ে কাছাকাছি উদাহরণ।
- ওপেন-সোর্সের নির্দিষ্ট তথ্য খুবই সীমিত: “Stable Video Diffusion” কেবল 20-টুলের ডিরেক্টরি
[31]-এ একটি লোগো; কোনো পিন open-weight প্রকাশ, লাইসেন্স বা কমিউনিটি fork নিয়ে গভীর আলোচনা করে না। - ByteDance–MPA কপিরাইট চুক্তির একক পিন
[28]ছাড়া এখানে ট্রেনিং পদ্ধতি, মডেল আর্কিটেকচার বা ডেটাসেট/লাইসেন্স বিতর্কের আলোচনা নেই।
সীমাবদ্ধতা
- এই ধাপে শুধু কর্মীর আগাম সংগৃহীত ছবি (
platforms/pinterest.md) বর্ণনা করা হয়েছে; কোনো লাইভ Pinterest ব্রাউজ, সার্চ বা নিবন্ধপাঠ করা হয়নি। ফলে কোনো দাবিই লাইভ পেজ বা পিনের পেছনের নিবন্ধের সঙ্গে যাচাই করা হয়নি। - কয়েকটি পিন কাছাকাছি-একই টেমপ্লেটের পুনঃপোস্ট/স্ক্র্যাপার অ্যাকাউন্টের মতো: “Generate content with AI” নিয়ন স্টক গ্রাফিক দুবার
[11, 26], Google Veo 2 banner দুবার[7, 8], এবং “Best AI Video Generation Websites” তালিকা একই টুল-তালিকাসহ দুবার[6, 18]। - পাঁচটি পিনের কোনো শিরোনাম নেই (
(untitled))—বিশেষত[8, 20, 21, 24, 28]-এ শিরোনাম ফাঁকা বা সাধারণ ছিল—ফলে দৃশ্যমান ছবির বাইরে উৎস নির্ধারণ সীমিত। - পিন সেট একক ঘরানার; এই রানে genre breakdown সংজ্ঞায়িত ছিল না, তাই ঘরানাভিত্তিক তুলনা সম্ভব হয়নি। সব 50টি পিন এক অনির্দিষ্ট সার্চ থেকে এসেছে।
সুপারিশকৃত পদক্ষেপ
- X সংগ্রহে Sora, Nano Banana, Kling, Qwen, Flux, ComfyUI-এর মতো AI-সরাসরি শব্দে পুনরায় সার্চ করুন; এবার ভুল করে X ট্রেন্ডিং শব্দ নেওয়ায় সম্পূর্ণ ব্যর্থতা হয়েছে।
- MiniMax-H3 ও Qwen-Image-কে ওপেন-সোর্স ক্ষেত্রের প্রধান সূচক হিসেবে অব্যাহতভাবে পর্যবেক্ষণ করুন।
- Sora 2-এর API বন্ধের (2026-09-24) আগে ও পরে ব্যবহারকারীদের গন্তব্য—Runway/Kling/Veo—কীভাবে বদলায়, তা অনুসরণ করুন।
- Disney বনাম Midjourney মামলা এবং সম্মতি ছাড়া জেনারেশন বৈধ করার বিতর্কের মতো আইন ও নৈতিকতা-সংক্রান্ত ট্র্যাককে টুল তুলনার সমান বা বেশি গুরুত্ব দিন।
- Reddit সংগ্রহে r/StableDiffusion ও r/aiArt-এর মতো ছবি-জেনারেশন-কেন্দ্রিক subreddit-এর জন্য কোয়েরি যোগ করুন।
- Pinterest-এর আবিষ্কারগুলোতে লাইভভাবে লিংকের নিবন্ধ খুলে যাচাই করুন।
সংগৃহীত ছবি


















































ডেটার মান-সংক্রান্ত নোট
ব্রিফে নির্ধারিত ছয় প্ল্যাটফর্মের মধ্যে X-এর সংগ্রহ করা ডেটা সম্পূর্ণভাবে থিম-বহির্ভূত হওয়ায় ব্যবহারযোগ্য নয়। Reddit, Bluesky ও YouTube-তেও সার্চ টার্ম এবং API সীমাবদ্ধতা (403/401/CAPTCHA)-র কারণে Stable Diffusion, Wan 2.5-র মতো কিছু গুরুত্বপূর্ণ বিষয় বাদ পড়েছে।



