ছবি ও ভিডিও জেনারেশন AI সংবাদ — ২০২৬-০৯-০৭
ক্লোজড-সোর্স দুনিয়ায় Sora2-এর API বন্ধ হওয়া (২০২৬/৯/২৪) ও GPT-6 Astra-র সাধারণ-উদ্দেশ্যের এজেন্টে রূপান্তর নেতৃত্ব বদলের ইঙ্গিত দিচ্ছে; অন্যদিকে ওপেন-সোর্সে ComfyUI/MiniMax-H3/Qwen-Image-Edit ইকোসিস্টেম প্রতিদিন বিস্তৃত হচ্ছে এবং কনজিউমার GPU-তেও ব্যবহারযোগ্য পর্যায়ে পৌঁছেছে।
ছবি ও ভিডিও জেনারেশন AI-এর সর্বশেষ সংবাদ — ৭ সেপ্টেম্বর ২০২৬
সত্যিই দারুণ ব্যস্ত একটি সপ্তাহ ছিল 🔥🔥 ক্লোজড-সোর্স দিকটায় OpenAI-এর “GPT-6 Astra” কেবল ছবি বা ভিডিও জেনারেটর নয়, বরং “অন্য টুল নিয়ন্ত্রণ করা এজেন্ট” হিসেবে দ্রুত প্রশংসা পাচ্ছে। উল্টো দিকে, একসময়ের রাজা “Sora 2” অপ্রত্যাশিতভাবে পরিষেবা বন্ধের পথে (Web/অ্যাপ ২০২৬/৪/২৬-এ বন্ধ, API-ও এ মাসে ২০২৬/৯/২৪-এ সম্পূর্ণ বন্ধ হওয়ার কথা) 😱। ওপেন-সোর্স পক্ষটি তুলনামূলক নীরব হলেও ভীষণ উষ্ণ: ComfyUI ঘিরে “MiniMax-H3” ও “Qwen-Image-Edit” ইকোসিস্টেমে প্রায় প্রতিদিন নতুন অংশ যোগ হচ্ছে, আর AMD-সহ কনজিউমার GPU-তেও শক্তিশালী ভিডিও জেনারেশন সম্ভব হচ্ছে 🛠️✨। সব প্ল্যাটফর্মেই আরেকটি বিষয় স্পষ্ট: AI-তৈরি কনটেন্ট ধরা পড়লে তা কঠোর সমালোচনার মুখে পড়ছে; সত্যতা-লেবেল বাধ্যতামূলক করার দাবি ও অ্যান্টি-AI পোস্টই সবচেয়ে বেশি লাইক পাচ্ছে।
বিভিন্ন প্ল্যাটফর্মে 🌐
- GPT-6 Astra-কে “জেনারেটিভ AI” নয়, “নিয়ন্ত্রণকারী AI” হিসেবে দেখা হচ্ছে: X-এ (@Yokohara_h, ২,১৫৬ লাইক, https://x.com/Yokohara_h/status/2096622171011666003) এবং YouTube-এ (まさおAI じっくり解説ch, https://www.youtube.com/watch?v=_pAAaBv_G7A), ComputerUse দিয়ে Blender-এর মতো অন্যান্য অ্যাপ নিয়ন্ত্রণ করে 3DCG পাইপলাইন স্বয়ংক্রিয় করার আলোচনা ব্যাপক আগ্রহ তৈরি করেছে। দুই প্ল্যাটফর্মের ভাষ্য প্রায় একই 🔥
- Sora 2-এর শেষের শুরু: YouTube-এ (https://www.youtube.com/watch?v=DSfAZdE5rWA) API বন্ধের তারিখ ২০২৬/৯/২৪—আজ থেকে তিন সপ্তাহ পর—ব্যাখ্যা করা হয়েছে। Bluesky-তে (https://bsky.app/profile/coah80.com/post/3muulvyomz72c) “SORA 2 WAS GENUINELY SO BAD” পোস্টও পাওয়া গেছে। সমর্থনমূলক কণ্ঠ কার্যত অনুপস্থিত 😢
- ComfyUI/MiniMax-H3 ইকোসিস্টেমই ওপেন-সোর্সের প্রধান যুদ্ধক্ষেত্র: Lemmy-এর !«メールアドレス»-এ (https://lemmy.dbzer0.com/post/75036488 ইত্যাদি) প্রতিদিন ৩–৯টি হারে নতুন নোড ও LoRA আসছে। Reddit-এ VPIPE দিয়ে Apple Silicon M5 Pro-তে ১০২৪px, ৮ স্টেপে প্রায় ৪৫ সেকেন্ড (https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/) এবং Bluesky-তে “local software like ComfyUI”-তে বেশি ফিচার থাকার কথা (https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t) একই ধারা নিশ্চিত করে।
- AI-জেনারেটেড মানেই সমালোচনার পরিবেশটি সবচেয়ে বড় এনগেজমেন্টের উৎস: Reddit r/antiai-এর ভুয়া টাইমল্যাপ্স উন্মোচন থ্রেড (৬,৭৯২pt, ৯৯৪ মন্তব্য, https://www.reddit.com/r/antiai/comments/1w81kdd/) এবং Bluesky-এর শীর্ষ দুই লাইক-পোস্ট (জেনারেটিভ AI সমালোচনা, ১২১ ও ১০০ লাইক, https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b) দেখায়, টুল পরিচিতির চেয়ে “এটা কি ভয়ংকর নয়?” ধরনের সমালোচনা বেশি ভাইরাল হচ্ছে।
প্ল্যাটফর্মভিত্তিক 📱
Reddit: r/StableDiffusion-এর লোকাল জেনারেশন বেঞ্চমার্ক ও r/freetoolsAI-এর বিনামূল্যের টুল তালিকা (Deepany, Aifun, Perchance ইত্যাদি) ওপেন-সোর্সঘেঁষা ব্যবহারিক তথ্য হিসেবে শক্তিশালী। অন্যদিকে r/aiwars-এ খাদ্যবিজ্ঞাপনের জন্য ব্যবহৃত ক্লোজড-সোর্স বাণিজ্যিক AI ছবির মান সমালোচিত হয়েছে (১৭৭ মন্তব্য, https://www.reddit.com/r/aiwars/comments/1w69cdj/)। একটি মাত্র সার্চ টার্ম ব্যবহারের কারণে সংগ্রহ ১২টি থ্রেডেই থেমে যায়; ২০টির লক্ষ্য পূরণ হয়নি।
X: ৪০টি পোস্ট সংগ্রহ হলেও বিষয়ের সঙ্গে সম্পর্কিত ছিল মাত্র ৪টি 😅—বাকিগুলো ফুটবল, রাজনীতি ও ক্রোয়েশিয়া-ভিত্তিক ট্রেন্ডের শব্দদূষণ। তবে চারটিই GPT-6 Astra-র প্রশংসামূলক, এবং ওপেন-সোর্সের উল্লেখ একটিও নেই। পুরোপুরি ক্লোজড-সোর্সকেন্দ্রিক।
YouTube: তথ্যের দিক থেকে সবচেয়ে সমৃদ্ধ প্ল্যাটফর্ম। ক্লোজড-সোর্সে Sora2 বন্ধ, GPT-6 Astra, Midjourney V7 আপডেট—জাপানি ভয়েস ইনপুট-সমর্থনসহ (https://www.youtube.com/watch?v=wFHlG7wcRUQ)—এবং Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY) আলোচনায় ছিল। ওপেন-সোর্সে Flux.2 (Apache 2.0-এর Dev/Klein, https://www.youtube.com/watch?v=ISRy5Skd04U) এবং Qwen-Image-Edit-2511-এর বহু ComfyUI টিউটোরিয়াল (https://www.youtube.com/watch?v=ScoIZYsoRwo) প্রধান। AMD কনজিউমার GPU-তে Wan2.2 ও Hunyuan1.5 চালানোর পরীক্ষাও ছিল (https://www.youtube.com/watch?v=a_xzC7ckwno)।
Bluesky: টুল ব্যবহারকারী ব্যক্তিগত নির্মাতা ও অ্যান্টি-AI গোষ্ঠীর দ্বিমুখী কাঠামো। ক্লোজড-সোর্সে Nano Banana (Gemini 3.1) + Kling 3.0 ওয়ার্কফ্লো জনপ্রিয় (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), কিন্তু xAI-এর Grok Imagine-এর নতুন মডেল ঘোষণায় লাইক ছিল শূন্য। ওপেন-সোর্সে ComfyUI-পক্ষের ইতিবাচক মত ও Stable Diffusion WebUI reForge (AMD ROCm) ব্যবহারকারী ছিল। API সীমাবদ্ধতায় (বারবার 403) ২০টির লক্ষ্যের বদলে কার্যত ১১টি পোস্ট বিশ্লেষণ করা গেছে।
Lemmy: ওপেন-সোর্সের উদ্দীপনা অত্যন্ত বেশি; শুধু !«メールアドレス»-এই ১১টি টুল পোস্ট ছিল—Viggle-Animate, Trellis.2 + Pixal3D-এর ComfyUI নেটিভ ইন্টিগ্রেশন ইত্যাদি। ক্লোজড-সোর্সে একমাত্র বড় বিষয় ছিল “Midjourney ছবি-জেনারেশন ব্যবসা থেকে চিকিৎসা-উপযোগী আল্ট্রাসাউন্ড স্ক্যান ব্যবসায় যাচ্ছে” খবরটি (সর্বোচ্চ স্কোর ৭৩, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood), যা একাধিক ইনস্ট্যান্সে পুনঃপ্রকাশিত হয়েছে। Lemmy-তে Sora বা Veo-এর স্বতন্ত্র কোনো সংবাদ না পাওয়াটিও একটি গুরুত্বপূর্ণ আবিষ্কার।
Pinterest: কর্মীর পূর্ব-সংগৃহীত ৫০টি পিনই দেখা হয়েছে। এখানে Veo, Sora, Runway, Kling, Pika ও Adobe Firefly-এর মতো ক্লোজড-সোর্স বাণিজ্যিক টুলের র্যাঙ্কিংধর্মী ইনফোগ্রাফিক প্রায় সম্পূর্ণ আধিপত্যে। ওপেন-সোর্সে লোকাল ব্যবহারের প্রচার করা “Amuse 3.0” ছাড়া উল্লেখ প্রায় নেই। ডিপফেক-উদ্বেগ ও শনাক্তকরণবিষয়ক কনটেন্টও আলাদা একটি ধারায় পরিণত হয়েছে।
নজরে রাখুন 👀
- Sora 2-এর API বন্ধ (২০২৬/৯/২৪) — বিকল্পে স্থানান্তর কীভাবে হয় তা দেখার বিষয়। YouTube “AI収益化ラボ” https://www.youtube.com/watch?v=YHPmaUb_X6c
- GPT-6 Astra-র ComputerUse/3DCG পাইপলাইন অটোমেশন — এটি জেনারেটিভ AI-এর চেয়ে প্রোডাকশন হাব হয়ে ওঠে কি না। X https://x.com/Yokohara_h/status/2096622171011666003
- MiniMax-H3 ইকোসিস্টেমের বিস্তারের গতি — Viggle-Animate ও H3-World-এর মতো নতুন অংশ প্রতিদিন আসছে। Lemmy https://lemmy.dbzer0.com/post/75036488
- AI-তৈরি কনটেন্টের সত্যতা-লেবেল বিতর্ক — ভুয়া টাইমল্যাপ্স উন্মোচন আইনগত চাপ পর্যন্ত গড়ায় কি না। Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
- Midjourney-এর ব্যবসায়িক রূপান্তর (ছবি জেনারেশন → চিকিৎসা সরঞ্জাম) — এটি ক্লোজড-সোর্স প্রতিষ্ঠানের ব্যবসায়িক মডেল বদলের পূর্বলক্ষণ হতে পারে। Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
- Qwen-Image-Edit × ComfyUI-এর বিস্তার — ক্লোজড-সোর্স সম্পাদনা টুলের সমতুল্য পারফরম্যান্সের সুনাম কত দূর ছড়ায়। YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk
সুপারিশ 💡
- Sora2-নির্ভর ওয়ার্কফ্লো থাকলে API বন্ধের (২০২৬/৯/২৪) আগে Kling 3.0 বা Veo 3.1-এ স্থানান্তরের পরিকল্পনা এখনই করুন।
- GPT-6 Astra-র ComputerUse-কে স্বতন্ত্র জেনারেটিভ AI হিসেবে নয়, প্রোডাকশন পাইপলাইন অটোমেশন টুল হিসেবে মূল্যায়ন ও পর্যবেক্ষণ করুন।
- খরচ কমাতে চাইলে ক্লোজড-সোর্স সাবস্ক্রিপশন নেওয়ার আগে Qwen-Image-Edit + ComfyUI-এর লোকাল এডিটিং ব্যবহার করে দেখুন।
- ভুয়া টাইমল্যাপ্স বা AI-সম্পাদনা নিয়ে বিতর্কের ঝুঁকি কমাতে প্রকাশিত কনটেন্টে AI ব্যবহারের অভ্যন্তরীণ প্রকাশনীতি আগে থেকে ঠিক করুন।
- Nano Banana (স্থিরচিত্র) + Kling 3.0 (ভিডিও রূপান্তর) বিভাজিত ওয়ার্কফ্লোটি একাধিক স্বাধীন নির্মাতা ইতিমধ্যেই মূল্যায়ন করেছেন; পরীক্ষা করার মতো।
- Midjourney-এর ব্যবসায়িক রূপান্তরের খবর নিয়মিত দেখুন; অন্য ক্লোজড-সোর্স প্রতিষ্ঠানেও একই ধরনের বহুমুখীকরণ ঘটে কি না যাচাই করুন।
ডেটার মান 📊
কোনো প্ল্যাটফর্মই brief.md-এর সম্পন্নতার মানদণ্ড—প্রতিটি সামাজিক নেটওয়ার্কে প্রায় ২০টি বিশ্লেষিত আইটেম—পুরোপুরি পূরণ করতে পারেনি 😅। বিশেষত X-এ ৪০টি পোস্টের মধ্যে প্রাসঙ্গিক ছিল কেবল ৪টি; সার্চ টার্মগুলো ক্রোয়েশিয়ার আঞ্চলিক ট্রেন্ড থেকে নেওয়ায় ফুটবল ও রাজনৈতিক শব্দদূষণ ছিল অনেক। Bluesky-তেও পাবলিক API-এর 403 রেট-লিমিটে চেষ্টা করা প্রায় অর্ধেক সার্চ ব্যর্থ হয়, ফলে কার্যত ১১টি আইটেমে সীমাবদ্ধ থাকতে হয়। Reddit-এ একটি মাত্র সার্চ টার্মে ১২টি থ্রেড, আর Lemmy-তে ওপেন-সোর্স ১১ ও ক্লোজড-সোর্স ৪—মোট ১৫টি পোস্ট পাওয়া গেছে; কারণ বিশেষায়িত সংবাদ কমিউনিটি নেই। YouTube-এ প্লেবুকের ৫–১২ ভিডিও মানদণ্ড মেনে ১১টি ভিডিও সংগ্রহ করা হয়েছে, যদিও ভিউয়ের মতো মেটাডেটা JavaScript রেন্ডারিংয়ের কারণে পাওয়া যায়নি। Pinterest-এ ৫০টি পূর্বসংগৃহীত পিন দেখা গেলেও একক কুয়েরির কারণে ওপেন-সোর্স সম্পর্কিত পিন প্রায় পাওয়া যায়নি। তবু ছয়টি প্ল্যাটফর্ম স্বাধীনভাবে GPT-6 Astra, Sora2 বন্ধ এবং ComfyUI ইকোসিস্টেমের সম্প্রসারণের একই বড় প্রবণতাকে সমর্থন করেছে, তাই সামগ্রিক গতিপথ বোঝার জন্য বিষয়বস্তুটি যথেষ্ট নির্ভরযোগ্য।
প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ
কোথায়
সার্চ টার্ম “Image and Video Generation AI News” ব্যবহার করে ১১টি সাবরেডিট থেকে ১২টি থ্রেড সংগ্রহ করা হয়েছে।
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত থ্রেড |
|---|---|---|
| r/antiai | 316,504 | 1 |
| r/generativeAI | 151,065 | 2 |
| r/freetoolsAI | 7,817 | 1 |
| r/StableDiffusion | 1,001,556 | 1 |
| r/teenagers | 3,675,063 | 1 |
| r/aiwars | 166,920 | 1 |
| r/RemoteWorkers | 74,882 | 1 |
| r/aislop | 82,721 | 1 |
| r/TopAITools4U | 2,396 | 1 |
| r/GoogleFlow | 1,750 | 1 |
| r/EyesWideShut | 15,320 | 1 |
সাবরেডিটগুলোর তালিকায় AI জেনারেশনকেন্দ্রিক বিশেষায়িত কমিউনিটি (r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI) এবং AI ছবিবিরোধী বা সমালোচনামূলক কমিউনিটি (r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers) প্রায় সমান সংখ্যায় আছে। r/RemoteWorkers-এ বিষয়টি চাকরির বিজ্ঞাপনের প্রেক্ষাপটে এসেছে।
মানুষের কণ্ঠ
- থ্রেড #1 r/antiai・৬,৭৯২pt・৯৯৪ মন্তব্য・২০২৬-০৯-০৫ — “Warning: There is a new form of ai generated image”। পোস্টটিতে দাবি করা হয়, ডিফিউশন মডেলের বদলে LLM-কে (GPT-6 লেখা আছে) মাউস ও কিবোর্ড চালিয়ে হাতে আঁকা মনে হওয়া টাইমল্যাপ্সসহ “আসল ইলাস্ট্রেশন” জাল করা যায়। ৯৯৪ মন্তব্যে পোস্টটি ব্যাপক সাড়া পায়। শীর্ষ মন্তব্যে ভুয়া টাইমল্যাপ্স সাধারণ হয়ে উঠছে বলে উদ্বেগ প্রকাশ করা হয়; “এখনই লেবেল বাধ্যতামূলক করতে হবে” দাবিটিও জোরালো সমর্থন পায়।
- থ্রেড #5 r/teenagers・৭pt・৪১ মন্তব্য・২০২৬-০৮-৩১ — “To all AI image/video generator users”। বক্তব্য ছিল, “AI তোমার ধারণা বাস্তবায়ন করছে—আঁকছে AI নিজেই।” এক ব্যবহারকারী বলেন, শিল্প করতে চাইলে পেন্সিল হাতে আঁকো। অন্যদিকে আরেকজন কার্ড গেমের আর্টে AI ব্যবহারের বাস্তব প্রয়োজনের কথা বলেন; প্রজন্মের ভেতরেও মতভেদ রয়েছে।
- থ্রেড #6 r/aiwars・৪pt・১৭৭ মন্তব্য・২০২৬-০৯-০৩ — “Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food”। ১৭৭টি মন্তব্যে আলোচনা দীর্ঘ হয়। একজন বলেন, বাস্তব ছবি গ্রাহককে সঠিক প্রত্যাশা দেয়। পাল্টা যুক্তিতে স্থানীয় Krea 2 দিয়ে ৪০ সেকেন্ডে তৈরি একটি “রুচিকর ব্রেকফাস্ট বুরিটো”-র প্রম্পট দেখিয়ে বলা হয়, সমস্যা মডেলের নয়—প্রম্পটেরও হতে পারে।
- থ্রেড #4 r/StableDiffusion・৩১pt・১০ মন্তব্য・২০২৬-০৯-০৩ — “VPIPE: Not Just Video — Local Image Generation Is Fast Too”। Apple Silicon M5 Pro 24GB-তে krea/Krea-2-Turbo-M87 (16bit) ও M87 LoRA ব্যবহার করে ১০২৪×১০২৪, ৮ স্টেপে প্রতি ছবি প্রায় ৪৫ সেকেন্ড; 8bit কোয়ান্টাইজড রিয়েল-টাইম মোডে ৩৫ সেকেন্ডের ফল দেখানো হয়।
- থ্রেড #11 r/GoogleFlow・১২pt・৬ মন্তব্য・২০২৬-০৯-০১ — “AutoFlow just got continuous AI video generation”। Google Flow/Veo-এর অনানুষ্ঠানিক Chrome এক্সটেনশন “AutoFlow”-তে “Continue from Last Frame” যোগ হয়েছে, যা আগের ক্লিপের শেষ ফ্রেম স্বয়ংক্রিয়ভাবে পরের ক্লিপের শুরুতে ব্যবহার করে।
- থ্রেড #10 r/TopAITools4U・১pt・১০ মন্তব্য・২০২৬-০৯-০১ — “Tested 4 best AI video generators in 2026 for beginners”। Sora 2, Kling AI, DomoAI ও Google Veo 3.1 তুলনা করা হয়েছে; মন্তব্যে Qwen-এর বিনামূল্যের ভিডিও জেনারেশনকেও সম্ভাব্য বিকল্প বলা হয়।
- থ্রেড #3 r/freetoolsAI・৩৮pt・৪৫ মন্তব্য・২০২৬-০৯-০৪ — “Free AI Image Generator”। বিনামূল্যে, সীমাহীন এবং সাইন-আপবিহীন টুলের পরিচিতির প্রতিক্রিয়ায় Deepany, Aifun ও Perchance-কে বিকল্প হিসেবে তালিকাভুক্ত করা হয়।
- থ্রেড #2 r/generativeAI・৪৩pt・২৯ মন্তব্য・২০২৬-০৮-৩১ — “List of daily AI video generative websites”। Kling AI-এর প্রতি ২৪ ঘণ্টায় ৬৬টি ফ্রি ক্রেডিট—৫ সেকেন্ডের ভিডিও হিসেবে দিনে ২–৬টি—এবং YalleryLabs-এর মূল্যতথ্য দেওয়া হয়।
- থ্রেড #12 r/EyesWideShut・৩৫pt・৯ মন্তব্য・২০২৬-০৯-০৬ — “AI generated images shouldn't be allowed here”। কুবরিক চলচ্চিত্রের স্ক্রিনশট AI দিয়ে সম্পাদনার ঘটনাকে ভুল তথ্য ছড়ানো বলা হয়। যিনি সম্পাদনা করেছেন তিনি বলেন, শুধু দুইটি ছবি মিশিয়েছেন, বিষয়বস্তু বদলাননি। AI সম্পাদনার গ্রহণযোগ্য সীমা নিয়ে মতবিরোধ স্পষ্ট।
- থ্রেড #8 r/RemoteWorkers・১৩০pt・৬২৩ মন্তব্য・২০২৬-০৯-০৪ — “Get Paid $30/Hour Reviewing AI-Generated Images”। AI-তৈরি ক্যাপশনের তথ্য যাচাইয়ের জন্য ঘণ্টায় ৩০ ডলারের কাজের বিজ্ঞাপন। বিপুল মন্তব্যের বেশিরভাগই আবেদন লিঙ্ক পাওয়ার আশায় এক শব্দের “images” মন্তব্য; অর্থবহ আলোচনা হয়নি।
- থ্রেড #9 r/aislop・৩৭pt・৪ মন্তব্য・২০২৬-০৯-০৬ — “Saw this on a news article, an AI slop image explaining what is AI slop”। “AI slop কী” বোঝানো সংবাদচিত্রটিই AI-তৈরি হওয়ায় আত্ম-উল্লেখকারী রসিকতা হিসেবে আলোচিত হয়।
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: লোকাল, ওপেন-সোর্স জেনারেশনের বাস্তবায়ন-প্রতিবেদন—বিশেষত VPIPE/Krea 2—সময়, স্টেপ ও হার্ডওয়্যারসহ নির্দিষ্ট বেঞ্চমার্কের কারণে ইতিবাচক সাড়া পাচ্ছে।
- ঊর্ধ্বমুখী প্রবণতা: AI কনটেন্টের সত্যতা-লেবেল চাওয়ার দাবি ৯৯৪ মন্তব্যের মাত্রায় জোরালো; “টাইমল্যাপ্স জালিয়াতি” একটি নতুন নির্দিষ্ট উদ্বেগ।
- অবহেলিত বা ব্যঙ্গের পাত্র: ক্লোজড-সোর্স বাণিজ্যিক AI ছবি—বিশেষত খাবারের বিজ্ঞাপনে—মানের দিক থেকে সমালোচিত।
- অপ্রত্যাশিত বিষয়: অনেক থ্রেডে ব্যবহারিক মূল্য এসেছে AI bot-এর দেওয়া বিনামূল্যের সুবিধার তালিকা থেকে; গভীর মানবিক আলোচনার চেয়ে এই তথ্যই মুখ্য।
- বিরোধ: AI সম্পাদনাকে পরিবর্তন ও ভুল তথ্য বলা পক্ষের সঙ্গে সরল কম্পোজিটকে নিরীহ বলা পক্ষের কোনো পরিষ্কার ঐকমত্য নেই।
- অপ্রত্যাশিত বিষয়: সর্বাধিক ৬২৩ মন্তব্যের থ্রেডটিতে মন্তব্যের সংখ্যা আলোচনা-গভীরতার সূচক ছিল না।
সীমাবদ্ধতা
- শুধু “Image and Video Generation AI News” সার্চ করা হয়েছে; “open source image generation”, “closed source video AI”, Midjourney, Sora, Kling ইত্যাদি দিয়ে অতিরিক্ত অনুসন্ধান করা হয়নি।
- লক্ষ্যমাত্রার প্রায় ২০টির বদলে মাত্র ১২টি থ্রেড পাওয়া গেছে।
- থ্রেড #7 ও #9-এ মন্তব্য খুব কম; বিশ্লেষণের উপাদান সীমিত।
- সংগ্রহকাল ২০২৬-০৮-৩১ থেকে ২০২৬-০৯-০৬, অর্থাৎ প্রায় এক সপ্তাহ; পুরোনো প্রবণতার তুলনা করা যায় না।
- ক্লোজড/ওপেন-সোর্সে স্পষ্টভাবে বিভাজ্য থ্রেড কম, তাই অন্য প্ল্যাটফর্মের ডেটা দিয়ে ঘাটতি পূরণ দরকার।
X
X — ছবি ও ভিডিও জেনারেশন AI সংবাদ
অ্যাকাউন্ট
সংগৃহীত ৪০টি পোস্ট ও ৩৭টি অ্যাকাউন্টের মধ্যে ছবিভিত্তিক/ভিডিও জেনারেশন AI বিষয়ের সঙ্গে বাস্তবে সম্পর্কিত ছিল নিচের চারটি অ্যাকাউন্ট। সবকটিই এক পোস্ট করা ব্যক্তিগত অ্যাকাউন্ট।
| অ্যাকাউন্ট | নাম | পোস্ট | লাইক | ধরন |
|---|---|---|---|---|
| @aigeboku | AI様の下僕 | 1 | 1,281 | GPT-6 Astra-র ComputerUse পরীক্ষা করা ব্যক্তি |
| @MiraMusic_AI | MiraMusic | 1 | 525 | AI অ্যানিমে নির্মাণভিত্তিক অ্যাকাউন্ট |
| @manaimovie | Mankyu | 1 | 562 | 3D মডেল × AI ভিডিও ব্যক্তিগত নির্মাতা |
| @Yokohara_h | Hirokazu Yokohara | 1 | 2,156 | চারটির মধ্যে সর্বোচ্চ প্রতিক্রিয়া পাওয়া প্রযুক্তি-কেন্দ্রিক ব্যক্তি |
বাকি ৩৩টি অ্যাকাউন্ট—@kaihavertz29-এর ৯৬,১৮৪ লাইককে শীর্ষে রেখে ফুটবল, F1, জার্মান রাজনীতি, বিটকয়েন ও বসনিয়া সংক্রান্ত অ্যাকাউন্ট—বিষয়টির সঙ্গে সম্পর্কহীন।
পোস্ট
- #29 @aigeboku(২০২৬-০৯-০৫・১,২৮১ লাইক・১৩৫ রিপোস্ট・১৪ রিপ্লাই・প্রায় ৯৪,০০০ ভিউ)https://x.com/aigeboku/status/2096187322924687799 — GPT-6 Astra-এর অন্য টুল নিয়ন্ত্রণক্ষমতা এবং ComputerUse দিয়ে কাজের পরিসর বাড়ানোর কথা বলা হয়েছে।
- #30 @MiraMusic_AI(২০২৬-০৯-০৬・৫২৫ লাইক・৫০ রিপোস্ট・৬ রিপ্লাই・প্রায় ২৬,০০০ ভিউ)https://x.com/MiraMusic_AI/status/2096441679847006358 — GPT-6 Astra ও Blender ব্যবহার করে ১৫ মিনিটে শহরের পরিবেশ নির্মাণের উদাহরণ।
- #31 @manaimovie(২০২৬-০৯-০৫・৫৬২ লাইক・৬১ রিপোস্ট・১৯ রিপ্লাই・প্রায় ৩৫,০০০ ভিউ)https://x.com/manaimovie/status/2096176821377380677 — Tripo-তে বানানো মডেলকে Astra দিয়ে অ্যানিমেট করানোর ফল; Fable ও Sol-এর চেয়ে অনেক ভালো বলে মূল্যায়ন।
- #32 @Yokohara_h(২০২৬-০৯-০৬・২,১৫৬ লাইক・২৯৯ রিপোস্ট・১৯ রিপ্লাই・প্রায় ১,৭৮,০০০ ভিউ)https://x.com/Yokohara_h/status/2096622171011666003 — ছবি দিয়ে Blender-এ শহরের পটভূমি স্বয়ংক্রিয় মডেলিং ও ব্রেকডাউন সম্পাদনার উদাহরণ। মান এখনো অপরিণত হলেও হাতে 3DCG তৈরি না করার যুগের শুরু দেখা যাচ্ছে বলে মন্তব্য।
এই চারটি ছাড়া সংগৃহীত ৪০টি পোস্টে ক্লোজড বা ওপেন—কোনো ধরনের ছবি/ভিডিও জেনারেশন AI-এর উল্লেখ ছিল না।
সংকেত
- ঊর্ধ্বমুখী প্রবণতা: ক্লোজড-সোর্স GPT-6 Astra-কে ComputerUse ও Blender ইন্টিগ্রেশনের মাধ্যমে অন্যান্য টুল চালানোর ক্ষমতার জন্য দেখা হচ্ছে—একক মডেলের চেয়ে সম্পূর্ণ 3DCG প্রোডাকশন পাইপলাইনের অটোমেশন হাব হিসেবে।
- অপ্রত্যাশিত বিষয়: চারজনই মান অপরিণত বলে সতর্কতা যোগ করলেও ইতিবাচক মূল্যায়ন করেছেন।
- অবহেলিত/উল্লেখহীন: এই সংগ্রহে Stable Diffusion, Krea, Kling, Veo ইত্যাদি ওপেন-সোর্স বা সংশ্লিষ্ট AI-এর একটিও উল্লেখ নেই।
- তুলনায় আসা টুল: Fable ও Sol-এর নাম এসেছে, কিন্তু পোস্টে বিস্তারিত ব্যাখ্যা নেই।
- এনগেজমেন্টের মাত্রা বিষয়বহির্ভূত ট্রেন্ডের তুলনায় কম; X-এ এখনো এই বিষয়টি ব্যাপক ভাইরাল বলা যায় না।
সীমাবদ্ধতা
- সার্চ টার্ম বিষয়ভিত্তিক ছিল না: Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin, Bosnia—এর মধ্যে Astra ছাড়া বাকিগুলো মূলত ফুটবল, F1, রাজনীতি, ক্রিপ্টো ও আঞ্চলিক আলাপ।
- প্রায় ২০টির লক্ষ্যের তুলনায় কেবল ৪টি প্রাসঙ্গিক পোস্ট পাওয়া গেছে।
- “$SONG” ও “Bosnia” উভয়ই “Trending in Croatia” হিসেবে চিহ্নিত; ফলে এটি বৈশ্বিক নয়, ক্রোয়েশিয়া-কেন্দ্রিক ট্রেন্ড ডেটা।
- ওপেন-সোর্স সংক্রান্ত কোনো পোস্ট পাওয়া যায়নি।
- চারটি প্রাসঙ্গিক পোস্টই জাপানি ভাষাভিত্তিক অ্যাকাউন্টের; অন্য ভাষাভাষী সম্প্রদায় সংগ্রহ হয়নি।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ
চ্যানেল
| চ্যানেল | ধারা | বিষয়বস্তু |
|---|---|---|
| AI大学【AI&ChatGPT最新情報】 | জাপানি ব্যাখ্যামূলক | GPT-6 Astra-সহ নতুন AI মডেলের ব্যাখ্যা |
| まさおAI じっくり解説ch | জাপানি ব্যাখ্যামূলক | AI মডেলের বাস্তব পরীক্ষা ও পর্যালোচনা |
| RKJ VIDEO【イケている動画を作りたいなら】 | জাপানি, ভিডিও AI বিশেষায়িত | Sora/Veo/Kling প্রভৃতির তুলনা |
| AI収益化ラボ | জাপানি, আয়কেন্দ্রিক | AI টুলে আয়ের সুযোগ ও পরিষেবা বন্ধের প্রভাব |
| StableDiffusion等 チュートリアル&自作アニメ | জাপানি, মূলত ওপেন-সোর্স | Stable Diffusion টিউটোরিয়াল ও Sora2 বন্ধের খবর |
| AIたろう | জাপানি ব্যাখ্যামূলক | Midjourney প্রভৃতি ছবি জেনারেশন AI |
| Teacher's Tech | ইংরেজি ব্যাখ্যামূলক | Google টুল ও AI ফিচার রিভিউ |
| OpenArt | ইংরেজি, অফিসিয়ালঘেঁষা | Flux.2-সহ মডেলের UI পরিচিতি |
| Donato Capitella | ইংরেজি, প্রযুক্তিবিদ | AMD-সহ লোকাল GPU-তে ওপেন-সোর্স জেনারেশন পরীক্ষা |
| ErrorFixer | ইংরেজি টিউটোরিয়াল | ComfyUI-তে ওপেন-সোর্স মডেল ব্যবহারের নির্দেশনা |
| AI Search | ইংরেজি রিভিউ | নতুন ছবি ও ভিডিও AI টুলের দ্রুত রিভিউ |
ভিডিও পৃষ্ঠার JavaScript রেন্ডারিংয়ের কারণে সাবস্ক্রাইবার সংখ্যা সংগ্রহ করা সম্ভব হয়নি; সার্চ স্নিপেট ও oEmbed থেকে নিশ্চিত তথ্যই ব্যবহার করা হয়েছে।
ভিডিও
- “OpenAI-এর সর্বশেষ AI মডেল ‘GPT-6 Astra’ বিস্তারিত ব্যাখ্যা…” — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — GPT-6 Astra (২০২৬/৯/৩ প্রকাশিত) প্রায় সব বেঞ্চমার্কে Claude Fable 5.1-কে ছাড়িয়েছে বলে দাবি; ছবি বা ভিডিওর চেয়ে ব্রাউজার, অ্যাপ ও কোড পরিচালনাসহ সাধারণ এজেন্ট ক্ষমতাকে গুরুত্ব দিয়েছে।
- “【বর্তমান পরিবেশে সেরা】GPT-6 Astra বাস্তবে ব্যবহার করে…” — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — ComputerUse-এর মাধ্যমে অন্য অ্যাপ চালানোর ক্ষমতাকে উচ্চ মূল্যায়ন; X-এর প্রবণতার সঙ্গে সঙ্গতিপূর্ণ।
- “VEO 3.1 ও SORA2—কোনটি বেশি শক্তিশালী?” — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Veo 3.1 ও Sora 2-এর ফিচার ও চিত্রমান তুলনা।
- “Sora2 সম্পূর্ণ বন্ধ… কেন হঠাৎ অদৃশ্য হলো?” — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Sora 2-এর Web/অ্যাপ ২০২৬/৪/২৬-এ এবং API ২০২৬/৯/২৪-এ বন্ধ হওয়ার প্রক্রিয়া; AGI উন্নয়নের জন্য কম্পিউটিং রিসোর্স নিশ্চিত করাকে সম্ভাব্য কারণ হিসেবে উল্লেখ।
- “【পরিষেবা বন্ধ】বিশ্বের সেরা ভিডিও জেনারেশন AI ‘Sora2’ আর ব্যবহার করা যায় না…” — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Sora2 বন্ধে নির্মাতাদের আয়ের ওপর প্রভাব এবং Kling, Runway ইত্যাদিতে API স্থানান্তরের প্রয়োজন।
- “Midjourney V7 আপডেট…” — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — ভিডিও টুল, কথোপকথন মোড এবং জাপানি ভয়েস ইনপুটসহ V7 ফিচার।
- “The New Gemini Image Generator is Insane (Nano Banana 2)” — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Google-এর Nano Banana 2 আগের প্রজন্ম থেকে বড় উন্নতি হিসেবে মূল্যায়িত।
- “FLUX.2 Has Landed On OpenArt!” — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Flux.2-এর Pro/Flex/Dev/Klein পরিবার; Dev/Klein Apache 2.0 ওপেন-ওয়েট এবং ১০টি রেফারেন্স ছবি ও 4MP এডিটিং সমর্থন করে।
- “Video and Image Generation on AMD R9700 AI PRO…” — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Qwen Image, Wan 2.2 ও Hunyuan 1.5 কনজিউমার AMD GPU-তে চালানোর পরীক্ষা।
- “Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511…” — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — ওপেন-ওয়েট Qwen-Image-Edit-2511-এর ComfyUI লোকাল টিউটোরিয়াল।
- “This new AI image editor is a BEAST…” — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — Qwen-Image-Edit-এর ২০ বিলিয়ন প্যারামিটার ও নেটিভ ControlNet সমর্থন পরীক্ষা; ক্লোজড-সোর্স সম্পাদনা টুলের সমমান বলে মূল্যায়ন।
সংকেত
- ক্লোজড-সোর্সের প্রধান আলোচনা GPT-6 Astra: একক ছবি/ভিডিও মডেল নয়, ComputerUse দিয়ে ব্রাউজার, অ্যাপ ও ভিডিও সম্পাদনার কাজ করা সাধারণ এজেন্ট হিসেবে এটি আলোচিত।
- Sora 2 বন্ধই ক্লোজড-সোর্স ভিডিও জেনারেশনের সবচেয়ে বড় খবর: Web/অ্যাপ ২০২৬/৪/২৬-এ বন্ধ, API ২০২৬/৯/২৪-এ বন্ধ হওয়ার কথা; মনোযোগ নতুন ফিচারের বদলে স্থানান্তরের দিকে।
- Sora2-এর পরের সম্ভাব্য বিকল্প Kling: Kling 2.6 থেকে Kling 3.0 পর্যন্ত দ্রুত উন্নতি এবং বিকল্প হিসেবে এর উল্লেখ।
- ওপেন-সোর্স ছবি সম্পাদনায় এখন Qwen-Image-Edit মুখ্য: ComfyUI টিউটোরিয়ালের ঘনত্ব Stable Diffusion-এর নতুন মডেলসংক্রান্ত খবরের চেয়ে বেশি।
- ওপেন-সোর্স ভিডিও জেনারেশন তিন ধারায় গুছোচ্ছে: Wan 2.2, HunyuanVideo 1.5 ও LTX-2। “Wan 2.7 ওপেন-ওয়েট” দাবি করা কিছু পৃষ্ঠা পাওয়া গেলেও অফিসিয়াল উৎসে তা নেই; SEO-ভিত্তিক ভুয়া তথ্য বলে ধরা হয়েছে।
- চ্যানেলগুলোর সীমানা মিশছে: Stable Diffusion-কেন্দ্রিক চ্যানেলও Sora2 বন্ধের মতো ক্লোজড-সোর্স খবর কভার করছে।
সীমাবদ্ধতা
- YouTube-এর ফল ও ভিডিও পৃষ্ঠা JavaScript-নির্ভর; WebFetch-এ নির্ভরযোগ্য শিরোনাম, চ্যানেল, ভিউ বা তারিখ পাওয়া যায়নি।
- তাই সঠিক ভিউ সংখ্যা বা তারিখ অধিকাংশ ক্ষেত্রেই পাওয়া যায়নি এবং জালিয়াতি এড়াতে প্রতিবেদনে ভিউ সংখ্যা দেওয়া হয়নি।
- ৬০ দিনের আপলোড অগ্রাধিকার কঠোরভাবে প্রয়োগ করা যায়নি।
- YouTube-এর নিজস্ব প্লেবুকের ৫–১২ ভিডিও মানদণ্ড অনুযায়ী এই অংশ সম্পন্ন হিসেবে ধরা হয়েছে।
- মন্তব্যের পূর্ণ বিশ্লেষণ হয়নি এবং চীনা ভাষার চ্যানেল অন্তর্ভুক্ত ছিল না।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ
অ্যাকাউন্ট
Bluesky পাবলিক API-তে “Stable Diffusion”, “Sora 2”, “Midjourney”, “Grok Imagine”, “ComfyUI”, “Veo 3”, “Nano Banana” অনুসন্ধান করে প্রাসঙ্গিক অ্যাকাউন্ট বাছাই করা হয়েছে।
| অ্যাকাউন্ট | ধরন | বিষয়টির সঙ্গে সম্পর্ক |
|---|---|---|
| @xai-bot.bsky.social | xAI অফিসিয়াল Bot | Grok Imagine নতুন মডেলের তথ্য |
| @codename.cc | অ্যাপ আপডেট ট্র্যাকার Bot | Grok iOS-এর Imagine আপডেট |
| @drewkav.bsky.social | ব্যক্তিগত শিল্পী | Gemini 3.1 Nano Banana 2 ও Kling 3.0 যৌথ ওয়ার্কফ্লো |
| @triflingtree.bsky.social | ব্যক্তিগত শিল্পী | Nano Banana Pro দিয়ে নির্মিত কাজ |
| @gentile-of-hope.bsky.social | ব্যক্তি, জেনারেটিভ AI সমালোচক | নৈতিকতা ও পরিবেশ নিয়ে সমালোচনা |
| @samperson.bsky.social | শিল্পীপক্ষের ব্যক্তি | Procreate-এর অ্যান্টি-জেনারেটিভ-AI নীতির সমর্থন |
| @ecutruin.bsky.social | লোকাল জেনারেশন ব্যবহারকারী | ComfyUI-এর ফিচারগত সুবিধার কথা |
| @digitalhowl.bsky.social | ভিডিও নির্মাতা | ComfyUI + Minimax H3 পেশাদারি ভিডিও কাজে ব্যবহার |
| @kerzefasta.bsky.social | ফ্যান-আর্ট ইলাস্ট্রেটর | Stable Diffusion WebUI reForge (ROCm) ব্যবহার |
| @aichina.news | স্বয়ংক্রিয় Bot | FLUX-ভিত্তিক Apache-2.0 LoRA-এর ব্যাপক স্বয়ংক্রিয় পোস্ট |
সামগ্রিকভাবে এখানে সক্রিয়রা সংবাদদাতা নয়; মূলত টুল ব্যবহারকারী ব্যক্তিগত নির্মাতা এবং জেনারেটিভ AI-সমালোচক—দুই মেরুর মানুষ।
পোস্ট
- @xai-bot.bsky.social(২০২৬-০৯-০৫・০ লাইক)https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — Grok Imagine Video 1.5 agent ও Image 2.0 মডেলের ঘোষণা; লাইক ও রিপোস্ট শূন্য।
- @codename.cc(২০২৬-০৯-০৬・০ লাইক)https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — Grok iOS 1.4.33-এ Chat, Voice ও Imagine উন্নতির আপডেট রেকর্ড।
- @drewkav.bsky.social(২০২৬-০৯-০৬・৯ লাইক)https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — “Persistent Dream” কাজটিতে স্থিরচিত্র Gemini 3.1 Nano Banana 2-তে এবং ভিডিও Kling 3.0-তে তৈরি।
- @triflingtree.bsky.social(২০২৬-০৯-০৬・১৫ লাইক・১ রিপোস্ট)https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — Nano Banana Pro-তে তৈরি বাইজেন্টাইন ধাঁচের “ভিনগ্রহী মা ও শিশু”।
- coah80.com(২০২৬-০৯-০৬・০ লাইক)https://bsky.app/profile/coah80.com/post/3muulvyomz72c — Sora 2-এর তীব্র সমালোচনা: “SORA 2 WAS GENUINELY SO BAD…”।
- @gentile-of-hope.bsky.social(২০২৬-০৯-০৫・১০০ লাইক・৪২ রিপোস্ট)https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — Stable Diffusion, ChatGPT ও Gemini-সহ ছবি জেনারেশন AI-কে অনৈতিক ডেটা আহরণ, বিপুল বিদ্যুৎ ও পানি ব্যবহার এবং পরিবেশবিনাশের সঙ্গে যুক্ত করে সমালোচনা।
- @samperson.bsky.social(২০২৬-০৯-০৫・১২১ লাইক・১১ রিপোস্ট)https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Procreate-এর অ্যান্টি-জেনারেটিভ-AI নীতির সমর্থন; এই সংগ্রহে সর্বোচ্চ লাইক।
- @ecutruin.bsky.social(২০২৬-০৯-০৬・১ লাইক)https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — “local software like ComfyUI has more features than the majority of hosted solutions”।
- @digitalhowl.bsky.social(২০২৬-০৯-০৬・০ লাইক)https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — ComfyUI ও Minimax H3 ব্যবহার করে পেশাদারি ভিডিও কাজের কথা।
- @kerzefasta.bsky.social(২০২৬-০৯-০৫–০৬・একাধিক পোস্ট, সর্বোচ্চ ২৯ লাইক・১০ রিপোস্ট)https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — AMD GPU-তে ROCm-সহ Stable Diffusion WebUI reForge দিয়ে 艦これ চরিত্রের ধারাবাহিক ইলাস্ট্রেশন।
- @aichina.news(২০২৬-০৯-০৬・০ লাইক, ঘণ্টায় ২০টির বেশি একই ধরনের পোস্ট)https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — ComfyUI বা Diffusers-এ ব্যবহারের জন্য FLUX-এর Apache-2.0 LoRA ঘোষণা করা স্বয়ংক্রিয় পোস্ট; কার্যত আলোচনাহীন।
সংকেত
- ক্লোজড-সোর্স: Nano Banana ও Kling 3.0-কে স্থিরচিত্র ও ভিডিওর আলাদা ধাপে ব্যবহারের ওয়ার্কফ্লো ব্যক্তিগত নির্মাতাদের মধ্যে দৃশ্যমান।
- ক্লোজড-সোর্স: Grok Imagine ঘোষণার দৃশ্যমান প্রতিক্রিয়া নেই।
- ক্লোজড-সোর্স: Sora 2 নিয়ে কেবল তীব্র সমালোচনাই পাওয়া গেছে।
- ওপেন-সোর্স: ComfyUI ব্যবহারকারীরা লোকাল টুলকে হোস্টেড সমাধানের তুলনায় ফিচার-সমৃদ্ধ মনে করেন।
- ওপেন-সোর্স/শব্দদূষণ: Stable Diffusion ও Flux-সংক্রান্ত ফলের বড় অংশ ফ্যান-আর্ট, NSFW লিংক ও স্বয়ংক্রিয় LoRA ঘোষণা; সংবাদযোগ্য আলোচনা অল্প।
- সর্বোচ্চ এনগেজমেন্ট: সর্বোচ্চ দুই লাইক-পোস্টই জেনারেটিভ AI-বিরোধী।
সীমাবদ্ধতা
public.api.bsky.appসব অনুরোধে 403 দিয়েছে; বিকল্পapi.bsky.appকাজ করলেও দ্রুত একাধিক কুয়েরিতে রেট-লিমিট 403 দিয়েছে।- Web UI JavaScript-নির্ভর SPA হওয়ায় API ফলই কার্যত প্রধান উৎস।
- প্রায় ২০টির লক্ষ্যের বদলে প্রায় ১১টি পোস্ট যাচাই করা গেছে।
- ভিউ বা ইমপ্রেশন পাওয়া যায়নি।
- কিছু পোস্টের পূর্ণ থ্রেড আনতে 400 ত্রুটি হয়েছে।
- ফল নির্দিষ্ট কিছু অ্যাকাউন্টে অতিরিক্ত কেন্দ্রীভূত।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা
কমিউনিটি
- !«メールアドレス» — ৫,৭০৮ সাবস্ক্রাইবার, ১,৩৮৬ পোস্ট। ওপেন-সোর্স ছবি/ভিডিও জেনারেশন AI—মডেল, ComfyUI নোড, LoRA ইত্যাদির প্রধান কেন্দ্র। https://lemmy.dbzer0.com/c/stable_diffusion
- !«メールアドレス» — ২,৩৬১ সাবস্ক্রাইবার, ৩,৫০০ পোস্ট। Stable Diffusion/ওপেন-ওয়েট মডেলে তৈরি কাজের গ্যালারি; সংবাদমূল্য কম। https://lemmy.dbzer0.com/c/stable_diffusion_art
- !«メールアドレス» — ৪.৮২K সাবস্ক্রাইবার। Free/Open Source AI-কেন্দ্রিক, ছবি/ভিডিওর বিশেষায়িত পোস্ট কম। https://lemmy.world/c/fosai
- !«メールアドレス», !«メールアドレス», !«メールアドレス» — Midjourney-এর মতো ক্লোজড-সোর্স প্রতিষ্ঠানের খবর সাধারণ প্রযুক্তি-সংবাদ কমিউনিটিতে ছড়িয়ে আসে।
পোস্ট
ওপেন-সোর্সঘেঁষা (মূলত !«メールアドレス»)
- MiniMax-H3_Singularity — MiniMax-H3 ভিডিও মডেলের ফাইন-টিউন মার্জড মডেল। স্কোর ৩, ২০২৬-০৯-০৬। https://lemmy.dbzer0.com/post/75088455 (মূল: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
- Qwen3.8-Flash-Next-NVFP4 — NVIDIA-এর Qwen মডেলের NVFP4 কোয়ান্টাইজড সংস্করণ। স্কোর ৩, ২০২৬-০৯-০৬। https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
- ComfyUI-AetherScale — ComfyUI-এর নতুন এক্সটেনশন। স্কোর ৫, ২০২৬-০৯-০৫। https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
- Viggle-Animate — একটি পুনরায় আঁকা ছবি দিয়ে ভিডিওর চরিত্র প্রতিস্থাপনের ভিডিও এডিটিং মডেল। স্কোর ৯, ২০২৬-০৯-০৫। https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
- FastH3-Ref2V-Stream-Controller — ধারাবাহিক ভিডিও জেনারেশনের জন্য ComfyUI কন্ট্রোলার। স্কোর ২, ২০২৬-০৯-০৪। https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
- ComfyUI-Majoor-OmniCam — ComfyUI ক্যামেরা লেআউট/অ্যানিমেশন টুল। স্কোর ৪, ২০২৬-০৯-০৪। https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
- H3-World — “MiniMax-H3-ভিত্তিক প্রথম ইন্টার্যাক্টিভ world model” হিসেবে পরিচিত। স্কোর ৩, ২০২৬-০৯-০২। https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
- ComfyUI-MiniMaxH3-CLSS — ১৬GB VRAM-এ যে-কোনো দৈর্ঘ্যের অডিওসহ ভিডিও জেনারেশনের নোড। স্কোর ০, ২০২৬-০৯-০১। https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
- Trellis.2 and Pixal3D Now Native in ComfyUI — Trellis.2 ও Pixal3D-এর নেটিভ ComfyUI সংযুক্তি। স্কোর ৪, ২০২৬-০৯-০১। https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
- ComfyUI-DLSS5-NR — NVIDIA DLSS 5 নিউরাল রেন্ডারিংভিত্তিক পরীক্ষামূলক ComfyUI সমর্থন। স্কোর ২, ২০২৬-০৯-০১। https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
- LLaDA-Image — ডিফিউশন-ভিত্তিক ছবি জেনারেশনের গবেষণাপত্র। স্কোর ৩, ২০২৬-০৯-০৪। https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
ক্লোজড-সোর্সঘেঁষা
- Midjourney pivots from AI image generation to body scanning medical spa — Midjourney চিকিৎসা-উপযোগী বডি-স্ক্যান/আল্ট্রাসাউন্ড ব্যবসা “Midjourney Medical”-এ যাচ্ছে—এমন প্রতিবেদন। স্কোর ৫৮, ২০২৬-০৬-১৮। https://lemmy.zip/post/66397234 (মূল: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
- Midjourney AI pivots to Theranos: Ultrasonic CT — একই খবরের সমালোচনামূলক ভাষ্য। স্কোর ৪০, ২০২৬-০৬-১৯। https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
- Midjourney Medical / Midjourney Ultrasonic CT Scanner — Midjourney অফিসিয়াল পেজে সরাসরি লিংক করা দুটি পোস্ট। স্কোর ৩ ও ২, ২০২৬-০৬-১৮। https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
- Midjourney wants Hollywood studios to reveal AI usage details — হলিউড স্টুডিওর AI ব্যবহারের তথ্য প্রকাশের দাবি সংক্রান্ত খবর। স্কোর ৭৩, ২০২৬-০৭-০৫। https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
সংকেত
- Lemmy-তে ছবি ও ভিডিও জেনারেশন AI-এর উদ্দীপনা প্রায় পুরোপুরি ওপেন-সোর্সকেন্দ্রিক। MiniMax-H3, LoRA, ComfyUI নোড, VAE দ্রুতায়ন ও মোশন ক্যাশ ঘিরে প্রায় প্রতিদিন ৩–৯টি টুল পোস্ট আসছে।
- ক্লোজড-সোর্সে একমাত্র সুসংহত আলোচ্য বিষয় Midjourney-এর চিকিৎসা-আল্ট্রাসাউন্ডে রূপান্তর; স্কোর ৪০–৭৩। Sora, Veo, Kling, Runway, Nano Banana ও Flux.2-এর প্রকাশনা এখানে সংবাদ হিসেবে প্রায় অনুপস্থিত।
- “Veo 3” ও “Kling AI”-এর ফল শূন্য; ব্যবহারকারীরা নতুন মডেল ঘোষণার চেয়ে ComfyUI-তে বাস্তবে ব্যবহারযোগ্য নোড, LoRA ও অপ্টিমাইজেশনে বেশি সাড়া দেন।
সীমাবদ্ধতা
- Lemmy ছোট; ছবি/ভিডিও জেনারেশন AI সংবাদ-কেন্দ্রিক কমিউনিটি নেই।
- লক্ষ্যমাত্রার ২০টির বদলে ওপেন-সোর্স ১১ ও ক্লোজড-সোর্স ৪ মিলিয়ে ১৫টি পোস্ট পাওয়া গেছে।
- প্রধান মডেলগুলোর খবর পাওয়া না যাওয়াটিও একটি ফলাফল হিসেবে নথিভুক্ত।
- lemmy.world-এর
/c/stablediffusionপৃষ্ঠা HTTP 500 দিয়েছে; সার্চ API বিকল্প হিসেবে ব্যবহৃত হয়েছে।
Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ
৫০টি পিন (output/pinterest.pins.md / images/pinterest/manifest.json) দেখা হয়েছে। এগুলো শ্রেণিবদ্ধ নয় এবং একক কুয়েরি “Image and Video Generation AI News” দিয়ে সংগৃহীত।
ভিজ্যুয়াল থিম
- নেভি × নিয়ন—নীল, বেগুনি ও গোলাপি—সাইবার নান্দনিকতা টেমপ্লেটে পরিণত: সার্কিট লাইন, কণা-আভা ও নিউরাল-নেটওয়ার্কসদৃশ নোডভিত্তিক পটভূমি অধিকাংশ AI থাম্বনেইলে। [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
- “AI নিউজ অ্যাঙ্কর” ভিজ্যুয়ালের পুনরাবৃত্তি: সাদা অ্যান্ড্রয়েড বা অর্ধেক মানুষ-অর্ধেক যন্ত্র মুখের স্যুট পরা নিউজ অ্যাঙ্কর; ব্র্যান্ড নাম বদলে একই রকমের ব্যাপক ব্যবহার। [4, 32, 34, 37, 42]
- টুল তুলনা/র্যাঙ্কিং ইনফোগ্রাফিক সবচেয়ে সাধারণ ফরম্যাট: Runway, Pika, Kling AI, Luma, Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora, Adobe Firefly ঘুরে ফিরে “Best AI Video Generators” তালিকায়। [9, 19, 28, 33, 36, 46]
- একটি উৎস ছবি/ভিডিও থেকে বহু স্টাইলে রূপান্তরের ডেমো গ্রিড: কাঠের ব্লক, অরিগামি, লেগো বা ফুলের স্টাইলে একই চরিত্রের রূপান্তর; ধারাবাহিকতা প্রদর্শন। [8, 25, 44]
- ডিপফেক উদ্বেগ ও শনাক্তকরণ: “FAKE” চিহ্ন, “Which is AI?” কুইজ, শনাক্তকরণ টুল, এবং “দেখা মানেই বিশ্বাস করা নয়”—এসব আলাদা কনটেন্টধারা। [4, 12, 18, 26, 47]
- তারিখ-দেওয়া “AI News Roundup” কার্ড: Google I/O 2026, 911 কল AI, উত্তর কোরিয়ার AI স্ট্যাক প্রভৃতি বিষয় বুলেটে দেওয়া হয়। [21, 29, 31, 35]
- বিষয়বহির্ভূত সাধারণ AI আর্টের প্রদর্শনী: মার্বেলের সেলোবাদক বা বৃদ্ধ জেলের প্রতিকৃতির মতো সংবাদহীন AI আর্ট প্রচারও আছে। [49, 50]
- গাঢ় পটভূমি ও নিয়ন লেখা ডিফল্ট; সাদা পটভূমির কর্পোরেট নীল ফ্ল্যাট ডিজাইন বিরল। [3, 10, 27, 33]
উল্লেখযোগ্য পিন
- [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Gemini API দিয়ে Veo 3-এর ছবি-থেকে-ভিডিও এবং নেটিভ অডিও।
- [16] Google Unveils Veo 2 — Veo 2-এর অফিসিয়াল ধাঁচের প্রচার গ্রিড।
- [25] Google announces Veo 3 — একটি বেগুনি দানব চরিত্রকে বিভিন্ন পরিবেশে ধারাবাহিকভাবে তৈরি করার ডেমো।
- [29] Today's AI News: MAY 20, 2026 — Google I/O 2026, Gemini 3.5 Flash, Gemini Omni, Gemini Spark, Apple অ্যাক্সেসিবিলিটি AI ও Android XR-এর তালিকা।
- [35] The Latest AI Developments — নিউ অরলিন্সে 911 কলে AI উত্তর, Meta-এর অফলাইন এজেন্ট Muse Glimmer, এবং Kimsuky-এর নিজস্ব AI স্ট্যাক দিয়ে ফিশিং অটোমেশন।
- [44] Microsoft Unveils VASA-1 — একটি স্থিরচিত্র ও অডিও ক্লিপ থেকে কথা বলা মুখের ভিডিও তৈরি।
- [48] ShengShu Technology Unveils Vidu S1 — রিয়েল-টাইম AI ইন্টার্যাকশনের জন্য Vidu S1।
- [8] স্টাইল-সামঞ্জস্যপূর্ণ রূপান্তর ডেমো — একই মানুষ/প্রাণী/গাড়ির পাঁচটি স্টাইলভিত্তিক রূপান্তর।
- [46] Future of Video Creation: Best AI Video Generators of 2026 — Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly ও Seedance 1.5 Pro-সহ সাম্প্রতিক র্যাঙ্কিং।
- [20] More than 20% of YouTube is now AI-generated — AI-তৈরি কনটেন্টের প্রসারকে প্রতীকীভাবে তুলে ধরা একটি পরিসংখ্যান।
সংকেত
- মডেলের প্রজন্মগত প্রতিযোগিতা দৃশ্যমান: Veo 2→3→3.1, Kling AI→3.0, Runway Gen-3→Gen 4.5, Pika 2.5, Seedance 1.5 Pro—উন্নতির চক্র দ্রুত।
- পরবর্তী কেন্দ্রবিন্দু এজেন্ট, রিয়েল-টাইম ও অফলাইন ব্যবহার: স্কাউটিং থেকে স্ক্রিপ্ট, জেনারেশন ও এডিটিং অটোমেশন; Vidu S1-এর রিয়েল-টাইম ইন্টার্যাকশন; এবং নেটওয়ার্কবিহীন Meta Muse Glimmer।
- বাস্তব প্রয়োগ ও অপব্যবহার আলোচিত হচ্ছে: জরুরি কল ব্যবস্থায় AI এবং রাষ্ট্রীয় AI অপব্যবহারের মতো বিষয় রয়েছে।
- ক্লোজড-সোর্স বাণিজ্যিক টুলের প্রবল দৃশ্যমানতা: Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen ও Synthesia বারবার দেখা যায়। Stable Diffusion, AnimateDiff, Open-Sora ও ComfyUI-এর মতো ওপেন-সোর্স উল্লেখ প্রায় নেই। লোকাল-রান প্রচার করা “Amuse 3.0” বিরল ব্যতিক্রম।
- প্রাথমিক উৎসের সঙ্গে সংযোগ দুর্বল: অধিকাংশ পিন অ্যাফিলিয়েট ব্লগ, SEO নিবন্ধ বা Fiverr বিক্রয়-থাম্বনেইল; Pinterest সংবাদ অনুসরণের চেয়ে টুল বিক্রির জায়গা হিসেবে কাজ করছে।
- ডিপফেক উদ্বেগ স্থায়ী কনটেন্টধারা: প্রযুক্তিগত অগ্রগতির চেয়ে বিশ্বাসযোগ্যতার উদ্বেগ আলাদা বাজার তৈরি করেছে।
সীমাবদ্ধতা
- কর্মীর আগাম সংগ্রহ করা ছবি দেখা হয়েছে; Pinterest-এ অতিরিক্ত সার্চ বা স্ক্রল করা হয়নি।
- একক কুয়েরির কারণে ওপেন/ক্লোজড-সোর্স আলাদা করে খোঁজা হয়নি; ওপেন-সোর্স পিন না পাওয়ার পেছনে অনুসন্ধান-পদ্ধতির প্রভাব থাকতে পারে।
- দুইটি পিনের শিরোনাম
(untitled)। - পিনের URL-এ সরাসরি যাওয়া হয়নি; কেবল ছবি ও শিরোনাম থেকে বিশ্লেষণ, তাই মূল লেখা, মন্তব্য ও সেভ-সংখ্যা যাচাই করা হয়নি।
- [49] সংবাদ-সংশ্লিষ্ট নয় এমন সাধারণ AI আর্টের প্রচার; তাই সংবাদ-সংকেত হিসেবে ধরা হয়নি।
প্রস্তাবিত পদক্ষেপ
- Sora2-নির্ভর ওয়ার্কফ্লোর জন্য API বন্ধের (২০২৬/৯/২৪) আগে Kling 3.0 বা Veo 3.1-এ স্থানান্তর পরিকল্পনা করুন।
- GPT-6 Astra-র ComputerUse-কে শুধু জেনারেটিভ AI নয়, প্রোডাকশন পাইপলাইন অটোমেশন টুল হিসেবে অনুসরণ করুন।
- খরচ কমাতে ক্লোজড-সোর্সে অর্থ খরচের আগে Qwen-Image-Edit + ComfyUI লোকাল এডিটিং পরীক্ষা করুন।
- সত্যতা-লেবেল ও ভুয়া টাইমল্যাপ্স বিতর্কের ঝুঁকিতে প্রকাশ্য কনটেন্টে AI ব্যবহারের নীতি তৈরি করুন।
- Nano Banana (স্থিরচিত্র) + Kling 3.0 (ভিডিও রূপান্তর) ওয়ার্কফ্লো যাচাই করুন।
- Midjourney-এর ছবি জেনারেশন থেকে চিকিৎসা সরঞ্জামে যাওয়ার ঘটনাকে অন্য ক্লোজড-সোর্স প্রতিষ্ঠানের বহুমুখীকরণের সম্ভাব্য পূর্বসূচক হিসেবে পর্যবেক্ষণ করুন।
সংগৃহীত ছবি


















































ডেটার মানসংক্রান্ত নোট
ছয়টি প্ল্যাটফর্মের কোনোটিই brief.md-এর প্রতিটি সামাজিক নেটওয়ার্কে প্রায় ২০টি আইটেম বিশ্লেষণের মানদণ্ডে পৌঁছায়নি। বিশেষত X-এ ৪০টির মধ্যে প্রাসঙ্গিক ৪টি, Bluesky-তে 403 রেট-লিমিটে কার্যত ১১টি, এবং Lemmy-তে বিশেষায়িত সংবাদ কমিউনিটি না থাকায় ১৫টি পোস্ট পাওয়া গেছে। তবে GPT-6 Astra, Sora2 বন্ধ, ও ComfyUI ইকোসিস্টেমের সম্প্রসারণের প্রধান প্রবণতাগুলো একাধিক প্ল্যাটফর্মে স্বাধীনভাবে সমর্থিত হয়েছে।



