ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-04
ক্লোজড-সোর্স ক্ষেত্রটি জেনারেশন, সম্পাদনা ও অডিওকে এক মডেলে একীভূত করার দিকে এগোচ্ছে (FLUX 3, Kling 3.0), অন্যদিকে ওপেন-সোর্স ক্ষেত্রে চীনা ল্যাবগুলো (Alibaba, Tencent) মাসে মাসে Apache 2.0-লাইসেন্সের কম-VRAM মডেল প্রকাশ করে চলেছে। FLUX 3 ও MiniMax H3-এর মতো হাইব্রিড লাইসেন্সের কারণে দুই শিবিরের সীমারেখাও ক্রমশ অস্পষ্ট হচ্ছে।
ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-04
ক্লোজড-সোর্স শিবির এককালীন ইমেজ-গুণমানের প্রতিযোগিতা থেকে এগিয়ে গিয়ে জেনারেশন, সম্পাদনা ও অডিওকে এক মডেলে একীভূত করার পর্যায়ে পৌঁছেছে (FLUX 3 আরও এক ধাপ এগিয়ে অ্যাকশন প্রেডিকশনও যুক্ত করেছে)। Google Nano Banana Pro ইমেজ জেনারেশনে প্রায় একচ্ছত্র অবস্থানে, আর OpenAI 2026 সালের মার্চে Sora অ্যাপ বন্ধ করে দেওয়ায় পরিস্থিতি দুই মেরুতে বিভক্ত। ওপেন-সোর্সে Alibaba (Wan/Qwen-Image/Z-Image) ও Tencent (Hunyuan)-কেন্দ্রিক চীনা ল্যাবগুলো মাসে মাসে Apache 2.0 মডেল প্রকাশ করছে এবং “কনজিউমার GPU-তে চলে” এই বার্তায় ComfyUI কমিউনিটিতে বিস্তার ঘটাচ্ছে। দুই শিবিরের সীমারেখা ঝাপসা হচ্ছে: “ওপেন ওয়েট” দাবি করলেও বাস্তবে gated early access (FLUX 3), বা ওয়েট খোলা হলেও বাণিজ্যিক লাইসেন্স এক প্রতিষ্ঠান একচেটিয়াভাবে বিক্রি করছে (MiniMax H3)—এ ধরনের হাইব্রিড রূপ স্পষ্ট। তবে ছয়টি প্ল্যাটফর্মের মধ্যে Reddit পুরোপুরি অপ্রবেশযোগ্য ছিল, Bluesky-তে 2026-এর সাম্প্রতিক মডেল নিয়ে একটিও পোস্ট মেলেনি, আর Pinterest ওপেন-সোর্স বিষয়ে প্রায় কোনো কার্যকর অন্তর্দৃষ্টি দেয়নি। ফলে এই রিপোর্ট কার্যত X, YouTube ও Lemmy—এই তিন স্তম্ভের ওপর দাঁড়িয়ে আছে।
প্ল্যাটফর্মজুড়ে মূল অন্তর্দৃষ্টি
- FLUX 3 “ওপেন নয়”—এই মূল্যায়নে X ও YouTube একমত। Black Forest Labs-এর নতুন মডেলটি ছবি, ভিডিও, অডিও ও অ্যাকশন প্রেডিকশন একীভূত করলেও, @bfl_ai-এর ঘোষণায় এবং @kimmonismus-এর মন্তব্যে এটিকে “gated early access, not open source” বলা হয়েছে। ElevenLabs-এর YouTube ব্যাখ্যাও (https://www.youtube.com/watch?v=WlGmDRLZt9o) বিষয়টি আলাদা করে জোর দিয়েছে।
- ওপেন-সোর্সের মূল যুদ্ধক্ষেত্র চীনা ল্যাবগুলোতে কেন্দ্রীভূত—X, YouTube ও Lemmy-র অভিন্ন পর্যবেক্ষণ। Alibaba (Wan2.2/2.6/2.7, Qwen-Image, Z-Image-Turbo) ও Tencent (HunyuanVideo 1.5, HunyuanImage 3.0) প্রায় মাসে মাসে মডেল প্রকাশ করছে; Lemmy-র !«メールアドレス»-এ তাদের ComfyUI নোডে রূপান্তর প্রায় প্রতিদিন আলোচিত হয়।
- “কনজিউমার GPU-তে চলে”—ওপেন-সোর্স শিবিরের অভিন্ন বিক্রয়বার্তা। Z-Image-Turbo (16GB VRAM, @stevenhoi) এবং HunyuanVideo 1.5 (14GB, TensorArt ভিডিও https://www.youtube.com/watch?v=MJShdc8tkkA) X ও YouTube—দুই জায়গাতেই একই সংখ্যাসহ উপস্থাপিত হয়েছে।
- Sora অ্যাপ বন্ধ হওয়ার বিষয়টি YouTube ও Lemmy-তে ভিন্ন দৃষ্টিকোণ থেকে সমর্থিত হয়েছে। YouTube (NBC News https://www.youtube.com/watch?v=6e3SINmPii4, Wall Street Millennial https://www.youtube.com/watch?v=ZkRYH6PEP5k) ডিপফেক উদ্বেগ ও আর্থিক ক্ষতির কথা বলেছে; Lemmy-তে (https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/ থেকে পুনঃপ্রকাশ, 2026-05-27) নির্মীয়মাণ 30 মিলিয়ন ডলারের AI চলচ্চিত্র প্রকল্প ভেস্তে যাওয়ার বাস্তব উদাহরণ এসেছে।
- অ্যারেনা র্যাঙ্কিং (Artificial Analysis / Arena.ai) ঘোষণার “সাধারণ মাপকাঠি” হয়ে উঠেছে—X ও Lemmy উভয় জায়গায় এর প্রমাণ মিলেছে। ক্লোজড বা ওপেন, নতুন মডেলের ঘোষণার সঙ্গে অ্যারেনায় অবস্থান যুক্ত থাকে; X-এ @ArtificialAnlys আন্তঃপ্ল্যাটফর্ম যাচাইকারীর ভূমিকা পালন করছে।
- ওপেন/ক্লোজড সীমারেখা ঝাপসা হওয়ার আলাদা উদাহরণ X-এ FLUX 3 এবং Lemmy-তে MiniMax H3। MiniMax H3-এর ওয়েট খোলা (MiniMax Community License), কিন্তু Comfy বাণিজ্যিক লাইসেন্স একচেটিয়াভাবে বিক্রি করে (https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller)—ফলে সহজ দ্বিভাজন ভেঙে যাচ্ছে।
- এই গবেষণার সবচেয়ে বড় অভিন্ন বাধা ছিল প্ল্যাটফর্মে প্রবেশাধিকার সীমাবদ্ধতা। Reddit, Bluesky search API এবং YouTube-এর মূল পেজ—সব কটিতেই সরাসরি অ্যাক্সেস বাধাপ্রাপ্ত হওয়ায় প্রতিটি ধাপকে WebSearch-ভিত্তিক পরোক্ষ তথ্যের ওপর নির্ভর করতে হয়েছে।
প্ল্যাটফর্মভিত্তিক
Reddit — reddit.com, মিরর ও archive.org—কোনোটিতেই প্রবেশ করা যায়নি; ফলে শূন্য পোস্ট নিয়েই কাজ শেষ হয়েছে। আশপাশের নিবন্ধে “r/StableDiffusion-এ Wan 2.5 নিয়ে উৎসাহ ছিল” বা “r/SoraAi-তে Sora শেষ হওয়ার পর বিকল্প খোঁজা শুরু হয়”—এমন পরোক্ষ উল্লেখ পাওয়া গেলেও, প্রাথমিক উৎস খোলা যায়নি বলে সেগুলোকে তথ্য হিসেবে ধরা হয়নি।
X — 21টি পোস্ট যাচাই করা হয়েছে; এ রিপোর্টে এটিই সর্বাধিক তথ্যবহুল প্ল্যাটফর্ম। অফিসিয়াল অ্যাকাউন্ট (xAI, Runway, Alibaba_Wan, Alibaba_Qwen, TencentHunyuan, bfl_ai, Kling_ai)-এর প্রাথমিক ঘোষণা এবং Artificial Analysis ও rohan_paul-এর মতো শিল্প পর্যবেক্ষকদের যাচাই মিলিয়ে ক্লোজড 12টি ও ওপেন 9টি অন্তর্দৃষ্টি পাওয়া গেছে। তবে লগইন ছাড়া থাকায় লাইক, রিপোস্ট ইত্যাদি সম্পৃক্ততার সূচক প্রায় পাওয়া যায়নি।
YouTube — WebSearch-ভিত্তিক অনুসন্ধান স্থিতিশীল ছিল; ক্লোজড 11টি ও ওপেন 11টি—মোট 22টি ভিডিওর শিরোনাম, চ্যানেল ও বিষয়বস্তু যাচাই হয়েছে। কিন্তু মূল ভিডিও পেজ সীমাবদ্ধ থাকায় ভিউ, সাবস্ক্রাইবার ও মন্তব্য যাচাই করা যায়নি।
Bluesky — মাত্র 10টি পোস্ট পাওয়া গেছে (ক্লোজড 4, ওপেন 6), এবং বেশিরভাগই 2024 থেকে 2025-এর প্রথমার্ধের Civitai/Stable Diffusion-ভিত্তিক শৌখিন কমিউনিটির পোস্ট। Wan2.6, Qwen-Image-2512, Kling 3.0 বা FLUX 3-এর মতো 2026-এর প্রধান মডেল একটিও মেলেনি। অফিসিয়াল ল্যাব অ্যাকাউন্টও পাওয়া যায়নি; X-এর সংবাদচক্র থেকে বিচ্ছিন্ন এক “অন্য জগৎ” মনে হয়েছে। search API-র 403 অবরোধই সম্ভবত প্রধান কারণ।
Lemmy — 13টি পোস্ট যাচাই করা হয়েছে। !«メールアドレス» (প্রায় 5,600 সদস্য) ওপেন-সোর্স পক্ষের প্রধান ক্ষেত্র; MiniMax H3, LTX-2.3/2.5 এবং Boogu-Image-0.1-এর ComfyUI-সংক্রান্ত ব্যবহারিক আলোচনা সমৃদ্ধ। ক্লোজড পক্ষের ক্ষেত্রে নতুন মডেল ঘোষণার চেয়ে Sora বন্ধ, Grok CSAM মামলা ও DLSS5 সমালোচনার মতো বিতর্ক/মামলাভিত্তিক পোস্ট বেশি স্কোর পেয়েছে।
Pinterest — সংগৃহীত 50টি Pin-এর মধ্যে 32টি ছবি হিসেবে দেখা হয়েছে। অধিকাংশই ক্লোজড-সোর্সের বড় ব্র্যান্ড (Google Veo, Sora, Runway, Kling, Midjourney প্রভৃতি) নিয়ে “Top tools” তুলনামূলক ইনফোগ্রাফিক। ওপেন-সোর্স (Stable Diffusion, Flux, Wan, HunyuanVideo ইত্যাদি) উল্লেখ করা Pin কার্যত শূন্য। বহু Pin-এ শিরোনাম ও ছবির বিষয়বস্তুও মেলে না; দ্রুত সংবাদ উৎস হিসেবে এটি অন্য প্ল্যাটফর্মের চেয়ে দুর্বল।
সামনে যা নজরে রাখা উচিত
- FLUX 3 সত্যিই ওপেন-ওয়েট হবে কি না — X: @bfl_ai একে “gated early access” বলেছে; পরে নীতিগত পরিবর্তন আসে কি না দেখুন।
- MiniMax H3 ধরনের “ওপেন-স্বাদের বাণিজ্যিক লাইসেন্স” অন্যদের মধ্যে ছড়ায় কি না — Lemmy: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller
- Qwen-Image-2512 / Z-Image-Turbo-এর অ্যারেনা র্যাঙ্কিংয়ের পরিবর্তন — X: @ArtificialAnlys
- OpenAI Sora API 2026-09-24-এ শেষ হওয়ার পর বিকল্প পরিষেবাগুলোর গতিবিধি — Lemmy: https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/(পুনঃপ্রকাশ)
- xAI “Grok”-এর CSAM জেনারেশন ঘিরে মামলার অগ্রগতি — Lemmy: https://lemmy.world/post/51492879
- Kling 3.0 ভিডিও-AI-এর অর্থনৈতিক কাঠামো কতটা বদলায় — X: @CNBizInsider
প্রস্তাবিত পদক্ষেপ
- ক্লোজড-সোর্সের গতিবিধি জানতে X ও YouTube-কে প্রাথমিক তথ্যসূত্র হিসেবে নিয়মিত পর্যবেক্ষণ করুন।
- ওপেন-সোর্স বাস্তবায়ন প্রবণতা পর্যবেক্ষণে Lemmy-র !«メールアドレス»-কে ComfyUI ইকোসিস্টেমের নির্দিষ্ট পর্যবেক্ষণস্থল হিসেবে ব্যবহার করুন।
- Reddit ও Bluesky-এর ক্ষেত্রে পরের বার লগইন করা সেশন বা অফিসিয়াল API কী-র মতো বিকল্প অ্যাক্সেস না থাকলে কার্যকর গবেষণা সম্ভব নয়।
- Pinterest সংবাদ ব্রেকিংয়ের জন্য উপযোগী নয়; পরের বার এটি কেবল ভিজ্যুয়াল ট্রেন্ড—থাম্বনেইল ও প্যালেট প্রবণতা—বিশ্লেষণে ব্যবহার করুন।
- “ওপেন ওয়েট” বলা হলেও বাস্তবে gated/হাইব্রিড লাইসেন্স—এ ধরনের FLUX 3 ও MiniMax H3-এর উদাহরণ প্রতিবার লাইসেন্সের ভাষা যাচাই করে শ্রেণিবদ্ধ করুন।
- Sora বন্ধ বা Grok মামলার মতো আইনি ও বিতর্কভিত্তিক খবর Lemmy-তে X-এর আগেই অর্থমূল্য ও মামলার নথির মতো বাস্তব উদাহরণসহ দেখা দিতে পারে; নিয়মিত পর্যবেক্ষণে যুক্ত করুন।
ডেটার গুণমান
প্রযুক্তিগত অ্যাক্সেস অবরোধের কারণে Reddit-এ শূন্য পোস্ট পাওয়া গেছে; ফলে এ বিষয়ে কোনো অন্তর্দৃষ্টি পাওয়া যায়নি। Bluesky search API 403 হওয়ায় WebSearch-নির্ভর ইনডেক্স ব্যবহার করতে হয়েছে; পাওয়া পোস্টের বেশিরভাগই 2024 থেকে 2025-এর প্রথমার্ধের পুরোনো বিষয়, 2026-এর প্রধান মডেলের নয়। Pinterest ওপেন-সোর্স বিষয়ে প্রায় কোনো নির্দিষ্ট অন্তর্দৃষ্টি দেয়নি (শুধু AMD Amuse 3.0)। X, YouTube ও Lemmy—এই তিন প্ল্যাটফর্মেই 20টির বেশি বাস্তব পোস্ট, ভিডিও ও থ্রেড যাচাই হয়েছে; এ রিপোর্টের প্রধান ভিত্তি এগুলোই।
প্ল্যাটফর্মভিত্তিক সারাংশ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড-সোর্স / ওপেন-সোর্স)
কোথায়
এই ধাপে reddit.com-এ কোনো অ্যাক্সেস পাওয়া যায়নি; তাই কোন সাবরেডিটে এ বিষয়টি বাস্তবে সবচেয়ে আলোচিত, সদস্যসংখ্যাসহ তা যাচাই করা সম্ভব হয়নি। সাধারণত এ ক্ষেত্রে r/StableDiffusion, r/midjourney, r/aivideo, r/SoraAi, r/singularity-এর নাম উঠে আসে, কিন্তু এগুলো খোলা যায়নি বলে “যাচাইকৃত স্থান” হিসেবে জানানো যাচ্ছে না।
মানুষ কী বলছে
এই টুল পরিবেশে Reddit-এর একটি পোস্টও খোলা যায়নি। ফলে “পোস্টের লিংক + upvote সংখ্যা + তারিখ” সহ নির্দিষ্ট কোনো আবিষ্কার নেই। প্লেবুকের 5–12টি এবং ব্রিফের প্রায় 20টি পোস্ট বিশ্লেষণ—দুটির কোনোটিই করা যায়নি।
নিচের তথ্যগুলো WebSearch-এ অন্য সাইটের (ব্লগ ও সারসংকলন নিবন্ধ) পরোক্ষ উল্লেখ, যেখানে বলা হয়েছে “Reddit-এ এমন বলা হচ্ছে।” সরাসরি খুলে যাচাই করা হয়নি; তাই তথ্য হিসেবে গ্রহণ না করে কেবল রেফারেন্স নোট হিসেবে রাখা হলো:
- একটি সারসংকলন নিবন্ধ বলেছে, “r/StableDiffusion-এ Wan 2.5-এর একটি থ্রেড শত শত upvote/মন্তব্য পেয়েছিল, এবং native audio generation প্রশংসিত হয়েছিল”; পাশাপাশি ওপেন-ওয়েট প্রকাশের দাবিও নাকি ছিল। কিন্তু থ্রেড URL বা প্রকৃত upvote সংখ্যা যাচাই করা যায়নি।
- অন্য একটি নিবন্ধ বলেছে, OpenAI 2026-04-26-এ Sora অ্যাপ বন্ধ করলে r/SoraAi-তে “বিকল্প কী?” পোস্ট দ্রুত বেড়ে যায়; এখানেও প্রাথমিক উৎস খোলা যায়নি।
- “ByteDance Seedance 2.0 r/aivideo-তে 12,300+ upvote-সহ ভাইরাল পোস্ট হয়েছিল”—এমন দাবিও ছিল, কিন্তু লিংক ও তারিখ কোনোটিই যাচাই হয়নি।
এগুলো Reddit সরাসরি পড়ার ফল নয়, তাই রিপোর্টের মূল অংশে—ক্লোজড ও ওপেন উভয় পক্ষের ন্যূনতম 10টি অন্তর্দৃষ্টির ভিত্তি হিসেবে—ব্যবহার করা উচিত নয়।
সংকেত
Reddit থেকে সরাসরি কোনো সংকেত সংগ্রহ করা যায়নি। সর্বোচ্চ যা বলা যায়, আশপাশের নিবন্ধে উল্লিখিত বিষয়—Wan 2.5-এর native audio generation, Sora বন্ধের প্রতিক্রিয়া, Seedance 2.0 নিয়ে মনোযোগ—এসব “সম্ভবত Reddit-এ আলোচিত” এমন শোনা-কথার পর্যায়ের ইঙ্গিত মাত্র। এগুলো অন্য প্ল্যাটফর্মে, যেমন X বা YouTube-এ, সরাসরি যাচাই করা উচিত; এ ধাপের অর্জন হিসেবে গণ্য করা যাবে না।
সীমাবদ্ধতা
- reddit.com-এ সব সরাসরি অ্যাক্সেস ব্যর্থ হয়েছে। WebFetch দিয়ে
www.reddit.com(হোমপেজসহ) এবংold.reddit.comচেষ্টা করা হলে “Claude Code is unable to fetch from ...” ব্লকে প্রত্যাখ্যাত হয়। - মিরর/প্রক্সিও ব্যর্থ:
redlib.catsarch.com→ HTTP 403,libreddit.spike.codes→ DNS resolution ব্যর্থ,teddit.net→ একইভাবে ব্লক। web.archive.orgদিয়ে Reddit-এর পুরোনো snapshot আনার চেষ্টাও ব্যর্থ, কারণ archive.org-ই ব্লক ছিল।- WebSearch 10 বারের বেশি
site:reddit.comও নির্দিষ্ট সাবরেডিট/থ্রেড-শিরোনামসহ কুয়েরি দিয়ে চালানো হয়েছে—যেমন "site:reddit.com r/StableDiffusion new open source model", "Wan 2.5 open source video model reddit thread discussion release"—কিন্তু একবারও reddit.com-এর প্রকৃত URL ফলাফলে আসেনি। সবসময় Wikipedia, কর্পোরেট ব্লগ, Substack বা Hugging Face-এর মতো গৌণ উৎস এসেছে; Reddit থ্রেডে “এমন বলা হচ্ছে” ধরনের সারাংশ থাকলেও যাচাইযোগ্য লিংক নেই। - ফলে প্লেবুকের “upvote সংখ্যা ও তারিখসহ বাস্তব লিংক” এবং ব্রিফের “প্রায় 20টি পোস্ট বিশ্লেষণ”—কোনোটিই এ ধাপে পূরণ হয়নি।
- উপসংহার: এই ধাপে Reddit প্ল্যাটফর্মটি কার্যত বন্ধ ছিল (nothing to give)। অন্য প্ল্যাটফর্ম—X, YouTube, Bluesky, Lemmy ও Pinterest—থেকে বিকল্প সামাজিক সংকেত সংগ্রহের পরামর্শ দেওয়া হচ্ছে।
X
X — ছবি ও ভিডিও জেনারেশন AI সংবাদ
X (পূর্বের Twitter) লগইন ছাড়া পড়া যায় না, তাই site:x.com-এর বহিরাগত অনুসন্ধান থেকে পৃথক পোস্টের লেখা ও URL সংগ্রহ করা হয়েছে। প্রায় সব পোস্টই অফিসিয়াল অ্যাকাউন্ট (xAI, Runway, Alibaba_Qwen, Alibaba_Wan, TencentHunyuan, bfl_ai, Kling_ai, ideogram_ai ইত্যাদি) অথবা Artificial Analysis, Rohan Paul ও LudovicCreator-এর মতো শিল্প পর্যবেক্ষক/অ্যাগ্রিগেটর অ্যাকাউন্ট থেকে এসেছে।
অ্যাকাউন্ট ও হ্যাশট্যাগ
ক্লোজড-সোর্স তথ্যসূত্র
- @xai — Grok Imagine / grok-2-image-1212 অবসানের ঘোষণা ইত্যাদি
- @runwayml — Gen-4, Gen-4.5-এর প্রাথমিক তথ্যসূত্র
- @Kling_ai — Kling 3.0 ঘোষণা
- @bfl_ai (Black Forest Labs) — FLUX 3 (বর্তমানে ক্লোজড-ধারার gated early access)
- @ideogram_ai — অংশীদার সম্প্রসারণের ঘোষণা
- @ArtificialAnlys (Artificial Analysis) — বিভিন্ন মডেলের অ্যারেনা র্যাঙ্কিং নিয়মিত পোস্ট করে; ক্লোজড ও ওপেন উভয় ক্ষেত্রের তুলনামূলক সূচক
ওপেন-সোর্স তথ্যসূত্র
- @Alibaba_Wan / @AlibabaGroup — Wan2.1/2.2/2.6-সংক্রান্ত প্রাথমিক তথ্য
- @Alibaba_Qwen — Qwen-Image / Qwen-Image-2512
- @Ali_TongyiLab — Z-Image / Z-Image-Turbo
- @TencentHunyuan — HunyuanImage 2.1/3.0, HunyuanVideo 1.5, Hunyuan-GameCraft
- @stevenhoi (Tongyi-MAI) — Z-Image-Turbo প্রকাশের ব্যক্তিগত ঘোষণা
- @rohanpaul_ai — চীনা ওপেন মডেল নিয়ে ব্যাখ্যামূলক থ্রেড নিয়মিত পোস্ট করে
- হ্যাশট্যাগ/সার্চ শব্দ:
#OpenSource,#Wan22,#QwenImage, Apache 2.0 লাইসেন্সের বহু উল্লেখ
পোস্ট
ক্লোজড-সোর্স
- GPT Image 2 / MAI-Image-2.6 অ্যারেনা র্যাঙ্কিং — @ChanPerco: জানায় GPT-Image 2 প্রথম, Microsoft-এর MAI-Image-2.6 দ্বিতীয় এবং Grok Imagine 2.0-কে ছাড়িয়েছে। (তারিখ অজানা; 2026-এর শেষার্ধের পোস্ট। লেখায় সম্পৃক্ততার সংখ্যা প্রকাশিত নয়)
- MAI-Image-2.6-এর অ্যারেনায় তৃতীয় স্থান — @testingcatalog: “MAI-Image-2.6 scored in the 3rd spot on Image Arena and is now available on MAI Playground and Microsoft Foundry in private preview.”
- রহস্যময় “duct-tape” মডেল — @arrakis_ai: GPT-ভিত্তিক বলে ধারণা করা অজ্ঞাত পরীক্ষামূলক মডেলটি অ্যারেনায় আলোচিত হয়। “Holy shxt… The rules of AI image generation just completely changed.”—native text rendering-এর নির্ভুলতা হঠাৎ বেড়েছে বলে উল্লেখ।
- Grok ইমেজ মডেলের প্রজন্মান্তর — @daisuke: “grok-2-image-1212 model effective Feb 28, 2026” অবসান এবং
grok-imagine-image-এ স্থানান্তরের ঘোষণা (xAI-এর অফিসিয়াল ঘোষণার উদ্ধৃতি)। - xAI Imagine v0.9 ভিডিও মডেল — @xai: “Introducing Imagine v0.9, our new video generation model with massive upgrades from v0.1 in visual quality, motion, audio generation”—সব পণ্যে বিনা খরচে চালু।
- Runway Gen-4.5 — @runwayml: Text to Video অ্যারেনায় 1,247 Elo অর্জন করে নতুন foundation model ঘোষণা। পরে Gen-4.5 Image to Video-ও প্রকাশ করে: “Built for longer stories. Precise camera control. Coherent narratives.”
- Kling 3.0 ঘোষণা — @Kling_ai: “Everyone a Director” স্লোগানে জেনারেশন, সম্পাদনা ও অডিওকে এক মডেলে একত্র করা all-in-one আর্কিটেকচার ঘোষণা; 15-সেকেন্ড ক্লিপ সমর্থন। ফরাসিভাষী নির্মাতা @tardquin-ও দ্রুত রিপোস্ট করেন।
- Kling 3.0-এর অর্থনৈতিক প্রভাব — @CNBizInsider: এটি “could fundamentally reshape video AI economics” বলে শিল্পগত প্রভাব বিশ্লেষণ।
- Nano Banana Pro (Google)-এর ব্যবহার উদাহরণ — @101babich: প্রোডাক্ট ডিজাইনে ব্যবহারের তিনটি ধরন দেখানো বাস্তব উদাহরণের থ্রেড।
- Nano Banana সাধারণ সংস্করণ বনাম Pro তুলনা — @immasiddx: “We're cooked 💀” প্রতিক্রিয়াসহ নতুন ও পুরোনো মডেলের গুণমানের তুলনা; আঙুলের অ্যানাটমির মতো দুর্বলতার কথাও উঠে আসে।
- FLUX 3 ক্লোজড রূপে এসেছে — @kimmonismus: Black Forest Labs ছবি, ভিডিও, অডিও ও অ্যাকশন প্রেডিকশন একীভূত “FLUX 3” ঘোষণা করলেও “The current release is gated early access, not open source” স্পষ্ট করেছে।
- FLUX 3 Video অফিসিয়াল ঘোষণা — @bfl_ai (প্রাথমিক উৎস): “One multi-modal model for Image, Video, Audio and Action-Prediction”; 20-সেকেন্ড ভিডিও ও বহু ভাষার সংলাপ সমর্থন। পরের পোস্টে “FLUX 3 Video is #2 in the world” বলে অ্যারেনা অবস্থান তুলে ধরে এবং সীমিত সময়ের জন্য বিনা খরচে খুলে দেয়।
ওপেন-সোর্স
- Wan2.2 আনুষ্ঠানিক রিলিজ — @Alibaba_Wan (অফিসিয়াল): “The World's First Open-Source MoE-Architecture Video Generation Model with Cinematic Control!” ব্যক্তিগত অ্যাকাউন্ট @scaling01-ও সঙ্গে সঙ্গেই ছড়িয়ে দেয়।
- Wan2.6: এক পাসে ভিডিও + অডিও — @FutureStacked: “the first open-source model that generates video AND audio together in a single pass. No stitching. No external tools.”
- Wan2.2-Animate প্রকাশ — @Alibaba_Wan: চরিত্র অ্যানিমেশন ও প্রতিস্থাপনের একীভূত মডেল। “model weights and inference code are now open-source for the entire community!”
- Qwen-Image প্রকাশ — @Alibaba_Qwen (অফিসিয়াল): 20 বিলিয়ন প্যারামিটারের MMDiT মডেল; “SOTA text rendering — rivals GPT-4o in English” দাবি। @rohanpaul_ai যোগ করে, “Runs under Apache 2.0 so anyone can deploy it for free.”
- Qwen-Image-2512 (নববর্ষ আপডেট) — @Alibaba_Qwen: “Tested in 10,000+ blind rounds on AI Arena, Qwen-Image-2512 ranks as the strongest open-source”—নিজস্ব বেঞ্চমার্ক ফল প্রকাশ।
- Qwen-Image-Layered — @azed_ai: “natively breaks images into editable parts, not masks, not hacks 🤯”—লেয়ারভিত্তিক সম্পাদনা নিয়ে বিস্ময় প্রকাশ।
- HunyuanVideo 1.5 — @TencentHunyuan (অফিসিয়াল): নিজেকে “the strongest open-source video generation model” বলে দাবি; 8.3B প্যারামিটার এবং 14GB VRAM-এর কনজিউমার GPU-তে চলার বিষয়টি জোর দিয়ে উল্লেখ।
- HunyuanImage 3.0 — @TencentHunyuan: “the largest and most powerful open-source text-to-image model to date, with over 80 billion total parameters.”
- Z-Image-Turbo প্রকাশ — @stevenhoi (Tongyi-MAI দলের সদস্য): 16GB VRAM-এর কনজিউমার GPU-তে “sub-second inference speed” দেওয়া 6B মডেল। পরের সপ্তাহে Artificial Analysis ওপেন-ওয়েট ইমেজ বিভাগে এক নম্বর স্বীকৃতি দেয়; Arena.ai-ও “Apache 2.0” লাইসেন্সে র্যাঙ্কিং নিশ্চিত করে।
সংকেত
- ওপেন-সোর্সের প্রধান ক্ষেত্র চীনা ল্যাবগুলোতে কেন্দ্রীভূত: Alibaba (Wan / Qwen-Image / Z-Image) ও Tencent (Hunyuan) কয়েক সপ্তাহ পরপর নতুন মডেল প্রকাশ করছে। X-এ ঘোষণা, তারপর Artificial Analysis বা কমিউনিটি অ্যাকাউন্টে তাৎক্ষণিক যাচাই ও অ্যারেনা পুনঃর্যাঙ্কিং—এই “ঘোষণা → স্বাধীন যাচাই” চক্র প্রতিষ্ঠিত হয়েছে।
- ক্লোজড পক্ষ এককালীন গুণমান প্রতিযোগিতা থেকে একীভবন ও ইকোসিস্টেমে যাচ্ছে: Kling 3.0 ও FLUX 3—দুটিই জেনারেশন, সম্পাদনা ও অডিওকে একটি মডেলে আনার দিকে; FLUX 3 আরও অ্যাকশন প্রেডিকশন/রোবোটিক্স পর্যন্ত যায়। অনুসন্ধান ফলেও বলা হয়েছে, “the AI generator era is already ending, with competitors racing to own the whole process.”
- ওপেন/ক্লোজড সীমা ঝাপসা: Black Forest Labs-এর FLUX 3 “Open-weight” বললেও বাস্তবে gated early access দিয়ে শুরু এবং পরে open weights-এর ইঙ্গিত দিয়েছে—ঘোষণা ও বাস্তবতার ফাঁক দেখা যাচ্ছে। শুধু ভাষা দেখে “ওপেন-সোর্স” বলা উচিত নয়; প্রতিবার লাইসেন্স Apache 2.0 কি না যাচাই দরকার।
- বেঞ্চমার্ক প্রতিযোগিতার কেন্দ্র Artificial Analysis অ্যারেনা: ক্লোজড বা ওপেন—সব প্রতিষ্ঠানের প্রাথমিক ঘোষণায় “অ্যারেনায় কত নম্বর” প্রায় অবধারিত; X ব্যবহারকারীদের কাছে এটি অভিন্ন মানদণ্ড।
- কম VRAM চাহিদাই প্রচারণার বিষয়: Z-Image-Turbo (16GB), HunyuanVideo 1.5 (14GB)-এর মতো ওপেন মডেলগুলো বারবার “কনজিউমার GPU-তে চলে” বলে প্রচারিত হচ্ছে; স্থানীয় রান কমিউনিটি, বিশেষত ComfyUI-কে লক্ষ্য করার এটি সুস্পষ্ট কৌশল।
সীমাবদ্ধতা
- X-এর মূল সাইটে লগইন ছাড়া প্রবেশ করা যায়নি; সব পোস্ট
site:x.com-এর Google search ফল ও সারাংশ থেকে সংগ্রহ। লাইক/রিপোস্টের মতো সম্পৃক্ততার সংখ্যা সার্চ স্নিপেটে ছিল না; তাই অধিকাংশ পোস্টে তা যাচাই হয়নি। - স্ট্যাটাস ID থেকে পোস্টের সঠিক তারিখ নির্ণয় করা যায়নি; অনেক ক্ষেত্রে কেবল “2026 সালের মধ্যে” পর্যন্ত চিহ্নিত করা গেছে। সময়রেখার নিখুঁত ক্রম নিশ্চিত নয়।
- nitter মিরর বা Threadreader-এর কার্যকর instance পাওয়া যায়নি; সরাসরি রেফারেন্স সম্ভব হয়নি।
- Midjourney (v7/ভিডিও), Adobe Firefly, Ideogram, এবং Runway ছাড়া পশ্চিমা ক্লোজড-সোর্স প্রতিদ্বন্দ্বী—Luma, Pika, Stability AI—সম্পর্কে X-এর প্রাথমিক পোস্ট সীমিত ছিল; গৌণ নিবন্ধের উল্লেখে থামতে হয়েছে।
- সমাপ্তির শর্তে থাকা “প্রায় 20টি পোস্ট” Posts অংশে 21টি (ক্লোজড 12, ওপেন 9) দিয়ে পূরণ হয়েছে। তবে একই বিষয়ের পরবর্তী পোস্ট—যেমন bfl_ai-এর একাধিক পোস্ট—কিছু ক্ষেত্রে একত্র ধরা হয়েছে; সাধারণ পোস্ট-গণনায় বাস্তবে 25টির বেশি পোস্ট উল্লেখ করা হয়েছে।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড-সোর্স / ওপেন-সোর্স)
YouTube-এর অফিসিয়াল search ফল পেজ (youtube.com/results) JavaScript-নির্ভর ও ভারী; WebFetch-এ কেবল ফুটার পাওয়া গেছে। তাই site:youtube.com <keyword> WebSearch দিয়ে পৃথক ভিডিও URL সংগ্রহ করা হয়, তারপর youtube.com/oembed?url=... (YouTube অফিসিয়াল API) দিয়ে শিরোনাম ও চ্যানেল নাম প্রাথমিকভাবে যাচাই করা হয়। তারিখ ও বিষয়বস্তু WebSearch স্নিপেট ও মূল নিবন্ধ দিয়ে সমর্থিত। ভিডিও পেজ পাওয়া যায়নি বলে ভিউ ও সাবস্ক্রাইবার সংখ্যা যাচাই সম্ভব হয়নি (বিস্তারিত Limits-এ)।
চ্যানেল
ক্লোজড-সোর্স নিয়ে প্রতিবেদন করা চ্যানেল
- Paul J Lipsky — Kling 3.0 রিভিউ
- Theo - t3gg(t3.gg) — Nano Banana Pro বিশ্লেষণ
- NBC News — Nano Banana Pro / Sora প্রতিবেদন (সাধারণ সংবাদমাধ্যম)
- TheAIGRID — Sora 2 দ্রুত সংবাদ
- OpenArt — Sora 2 / Wan 2.7 হ্যান্ডস-অন
- Wall Street Millennial — Sora বন্ধ হওয়ার আর্থিক বিশ্লেষণ
- ElevenLabs — FLUX 3 ব্যাখ্যা
- ApiTechTips — Seedance 2.5 পরিচিতি
- LLM Master — Grok Imagine 0.9 টিউটোরিয়াল
- Standarity — Seedream 5.0 Pro ব্যাখ্যা
ওপেন-সোর্স নিয়ে প্রতিবেদন করা চ্যানেল
- Codedigipt — Wan 2.6 / Z-Image Turbo
- Sebastian Kamph — Wan 2.6 R2V
- Omar Ortiz — Wan 2.7 Image Pro
- Promptus AI — Z-Image বনাম Flux 2
- TensorArt — HunyuanVideo 1.5
- AI Search — HunyuanVideo 1.5 র্যাঙ্কিং
- Alibaba Cloud (অফিসিয়াল) — Qwen-Image-2.0 ঘোষণা
- kintu — Qwen-Image-2.0 রিভিউ
- fal (fal Academy) — LTX-2 ব্যাখ্যা
ভিডিও পেজ সীমাবদ্ধ থাকায় কোনো চ্যানেলের সাবস্ক্রাইবার সংখ্যা যাচাই করা যায়নি (Limits দেখুন)।
ভিডিও
ক্লোজড-সোর্সের গতিবিধি
- Kling 3.0: The Best AI Video Generation I've Ever Seen (Truly Incredible) — Paul J Lipsky — https://www.youtube.com/watch?v=p6cV7PitAvg — Kuaishou-এর “Kling 3.0”-এর মাল্টিশট সিনেমাটিক জেনারেশন, native audio ও lip-sync, চরিত্রের ধারাবাহিকতাকে “এ পর্যন্ত দেখা সেরা” হিসেবে মূল্যায়ন।
- Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN — Theo - t3gg — https://www.youtube.com/watch?v=UV9GqinedQ8 — দাবি, Google-এর Nano Banana Pro (Gemini 3 Pro Image) ইমেজ জেনারেশনে প্রায় একচ্ছত্র।
- Google's Nano Banana Pro is raising concerns over realistic AI image generation — NBC News — https://www.youtube.com/watch?v=RmmrVCUGYp8 — বাস্তবধর্মী Nano Banana Pro-এর অপব্যবহারের ঝুঁকি নিয়ে সাধারণ সংবাদ প্রতিবেদন।
- OpenAI's Sora 2 Just SHOCKED The Entire Industry! (10 Things To Know About Sora 2) — TheAIGRID — https://www.youtube.com/watch?v=y4RCSU6SsA0(2025-10-01) — Sora 2-এর পদার্থবিজ্ঞানগত নির্ভুলতা (জিমন্যাস্টিকস, তিন পাক লাফ ইত্যাদি) ও সামাজিক-অ্যাপ বিস্তারের প্রভাব বিশ্লেষণ।
- Sora 2 Just Got An Update.....And? — OpenArt — https://www.youtube.com/watch?v=WmJrfuY8BXc — Sora 2 আপডেট প্রত্যাশামতো অগ্রগতি নয়—এমন সন্দেহপ্রবণ মূল্যায়ন।
- OpenAI is shutting down its Sora video creation app — NBC News — https://www.youtube.com/watch?v=6e3SINmPii4(2026-03-25) — ডিপফেক উদ্বেগের প্রেক্ষিতে পৃথক Sora অ্যাপ বন্ধ হওয়ার খবর।
- OpenAI Shuts Down Sora After Losing Billions — Wall Street Millennial — https://www.youtube.com/watch?v=ZkRYH6PEP5k — বিপুল ক্ষতির আর্থিক দৃষ্টিকোণ থেকে Sora প্রত্যাহার বিশ্লেষণ।
- FLUX 3 Is Here — Everything You NEED to Know — ElevenLabs — https://www.youtube.com/watch?v=WlGmDRLZt9o(2026-07-23 ঘোষণার পরপর) — Black Forest Labs-এর FLUX 3 (ছবি, ভিডিও, অডিও ও অ্যাকশন প্রেডিকশন একীভূত) “gated early access”, অর্থাৎ এখনো ওপেন-সোর্স নয়—এ কথা স্পষ্ট করে।
- ByteDance Seedance 2.5: 30-Second AI Video Generation with 50 Reference Inputs — ApiTechTips — https://www.youtube.com/watch?v=O2KNqKLANtQ — 2026-06-23-এর Volcano Engine FORCE-এ ঘোষিত Seedance 2.5 (30 সেকেন্ড, 4K, ক্লোজড API) পরিচিতি।
- GRATIS Grok Imagine 0.9. Crea videos en 20 segundos. — LLM Master — https://www.youtube.com/watch?v=ScWkfsrDAkw — xAI-এর Grok Imagine v0.9-এর অডিও-সিঙ্ক ভিডিও জেনারেশন সব ব্যবহারকারীর জন্য বিনা খরচে উন্মুক্ত হওয়ার ব্যাখ্যা।
- ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs(2026-07) — লেয়ার ধরে আংশিক সম্পাদনাযোগ্য নতুন ইমেজ মডেল Seedream 5.0 Pro-এর ঘোষণার বিশ্লেষণ।
ওপেন-সোর্সের গতিবিধি
- Wan 2.6 Just Changed AI Video Forever 😱 — Codedigipt — https://www.youtube.com/watch?v=gYcMhT-eZ_A(2025-12-16) — Alibaba Wan 2.6-এর চরিত্র-সামঞ্জস্য ও এক প্রম্পট থেকে স্বয়ংক্রিয় মাল্টি-অ্যাঙ্গেল বিভাজন দেখানো হয়েছে।
- Wan 2.6 is HERE! R2V is AWESOME! — Sebastian Kamph — https://www.youtube.com/watch?v=dGDIpQz_l-E(2025-12-21) — Reference-to-Video (R2V) ডেমো; Apache লাইসেন্সের ওপেন ওয়েট হওয়ার বিষয়টি জোর দিয়ে বলা হয়েছে।
- Taking Wan 2.7 For A Ride! Here's What I Found Out — OpenArt — https://www.youtube.com/watch?v=RERsGjQrQ6E(2026-04) — Wan 2.7-এর হ্যান্ডস-অন রিভিউ; Kling 3 ও Veo 3.1-এর সঙ্গে তুলনায় বিনা খরচে ও অনিয়ন্ত্রিত হওয়ার দিকটি ইতিবাচকভাবে তুলে ধরা হয়েছে।
- Wan 2.7 Image Pro: The AI Image Model Nobody Saw Coming — Omar Ortiz — https://www.youtube.com/watch?v=GIMVt4vCv20(2026-05) — Wan কেবল ভিডিও নয়, ইমেজ জেনারেশনেও দ্রুত শক্তিশালী হচ্ছে—এমন পর্যবেক্ষণ।
- Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — https://www.youtube.com/watch?v=sPQQPpQ9X4E — Alibaba Tongyi-MAI-এর Z-Image-Turbo (Apache 2.0)-কে Nano Banana Pro-মানের বলে উপস্থাপন।
- New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial — Promptus AI — https://www.youtube.com/watch?v=JF4Q5hXh-_Q — বেঞ্চমার্ক তুলনায় Z-Image Flux 2-কে হারায়—এমন ভিডিও।
- Tencent HunyuanVideo 1.5 has been officially open-sourced! — TensorArt — https://www.youtube.com/watch?v=MJShdc8tkkA(2025-12) — 8.3B প্যারামিটারের DiT মডেল 14GB VRAM-এর কনজিউমার GPU-তে চলে, Apache 2.0-এ বাণিজ্যিক ব্যবহারযোগ্য—এমন ব্যাখ্যা।
- We have a new #1 open-source AI video generator! — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — HunyuanVideo 1.5-কে ওপেন-সোর্স ভিডিও জেনারেশনের নতুন শীর্ষ মডেল হিসেবে দেখানো হয়েছে।
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Alibaba Cloud (অফিসিয়াল চ্যানেল) — https://www.youtube.com/watch?v=NGkwBn0ebYk(2026-02-10) — 7B প্যারামিটারে জেনারেশন ও সম্পাদনা একীভূত, native 2K resolution ও উন্নত typography-সহ প্রাথমিক ঘোষণা।
- "Qwen Image 2.0 Review: Insane Image & Text Rendering + Editing Beast!" — kintu — https://www.youtube.com/watch?v=dxLDvd1a_Sk(2026-02-16) — তৃতীয় পক্ষের দৃষ্টিতে Qwen-Image-2.0-এর টেক্সট রেন্ডারিং ও সম্পাদনা ক্ষমতার পরীক্ষা।
- LTX-2 Is Here - Native Audio AND Open-Source! | fal Academy — fal — https://www.youtube.com/watch?v=Odkj4zllsZg — Lightricks-এর LTX-2-কে “একই পাসে অডিও ও ভিডিও সিঙ্ক করে তৈরি করা প্রথম ওপেন-ওয়েট মডেল” (native 4K/50fps, প্রশিক্ষণ কোডসহ প্রকাশিত) হিসেবে উপস্থাপন।
সংকেত
- ওপেন-সোর্সে চীনের Alibaba Wan/Qwen/Tongyi-MAI, Tencent Hunyuan এবং ইসরায়েলের Lightricks LTX-2 প্রধান কেন্দ্র। সব চ্যানেলই “Apache 2.0”, “free”, “uncensored” শব্দে ক্লোজড মডেলের সঙ্গে তুলনা করেছে। “DESTROYS”, “Nobody Saw Coming”-এর মতো উত্তেজক শিরোনাম ঘন ঘন দেখা যায়—ইঙ্গিত, ওপেন মডেল সক্ষমতা দিয়ে মনোযোগ কেড়ে নিচ্ছে। 2026-এ Wan 2.6→2.7, HunyuanVideo 1.5, Z-Image (Turbo), Qwen-Image-2.0 ও LTX-2—প্রায় মাসে মাসে নতুন ওপেন মডেলের রিভিউ তৈরি হচ্ছে।
- ক্লোজড শিবিরে Google (Nano Banana Pro), OpenAI (Sora 2), Kuaishou (Kling 3.0), ByteDance (Seedance/Seedream), xAI (Grok Imagine), Black Forest Labs (FLUX 3) প্রতিযোগিতায় রয়েছে; সবাই “অ্যারেনায় এক নম্বর” দাবি করছে। তবে OpenAI-এর Sora অ্যাপ 2026 সালের মার্চে পৃথক অ্যাপ হিসেবে বন্ধ হয়ে যায় (NBC News, Wall Street Millennial), যা দেখায় ক্লোজড ক্ষেত্রেও আয় করতে হিমশিম খাওয়া প্রতিষ্ঠান আছে।
- FLUX 3 ক্লোজড ও ওপেনের সীমানার আলোচ্য বিষয়। Black Forest Labs আগে ওপেন-ওয়েট নীতির জন্য পরিচিত হলেও FLUX 3 “gated early access”; ElevenLabs-এর ব্যাখ্যাও আলাদা করে তা উল্লেখ করেছে। এতে কমিউনিটির উন্মুক্ততা-হ্রাসের উদ্বেগ বোঝা যায়।
- রিভিউ-ভিত্তিক চ্যানেলগুলো (Codedigipt, OpenArt, Sebastian Kamph, Promptus AI) নতুন মডেল বেরোলেই ক্লোজড ও ওপেন উভয় পক্ষকে একই ফরম্যাটে তুলনা করে। শিরোনাম থেকে বোঝা যায়, দর্শকের মূল প্রশ্ন প্ল্যাটফর্ম নয়—কোনটি বিনা খরচে এবং কোনটি বেশি সক্ষম।
সীমাবদ্ধতা
- ভিউ ও সাবস্ক্রাইবার সংখ্যা একেবারেই যাচাই করা যায়নি।
youtube.com/watch?v=...-এWebFetchদিলে কেবল YouTube ফুটার নেভিগেশন—শর্ত, কপিরাইট লিংক ইত্যাদি—ফিরে আসে এবং “content too long” নোট থাকে; ভিউ, প্রকাশের তারিখ বা চ্যানেলের সাবস্ক্রাইবারসহ মূল ডেটায় পৌঁছানো যায়নি। - বিকল্প হিসেবে
youtube.com/oembed?url=...&format=jsonদিয়ে কেবল শিরোনাম ও চ্যানেলের নাম নিশ্চিত হয়েছে। অধিকাংশ তারিখ WebSearch-এর স্নিপেট বা গৌণ উৎস থেকে অনুমিত; ভিডিও পেজ থেকে যাচাইকৃত নয়। যেগুলোর তারিখ পাওয়া যায়নি, সেগুলোতে তা বাদ রাখা হয়েছে। - Invidious মিরর (
yewtu.be) চেষ্টা করা হলেও CAPTCHA bot check দেখা গেছে; বিষয়বস্তু পাওয়া যায়নি।pbj=1প্যারামিটারের অভ্যন্তরীণ API-তে খালি JSON এসেছে। - মূল পেজই না পাওয়ায় মন্তব্য অংশ বা শীর্ষ মন্তব্য যাচাই করা হয়নি।
- WebSearch-ভিত্তিক
site:youtube.comঅনুসন্ধান নিয়মিত প্রায় 10টি লিংক দিয়েছে; Reddit-এর মতো প্ল্যাটফর্ম সম্পূর্ণ বন্ধ ছিল না। ভিডিওর পরিমাণ অনেক; এখানে 11+11 উদাহরণ প্লেবুকের 5–12 সীমার মধ্যে রাখতে ইচ্ছাকৃত বাছাই। 22টি ভিডিওর শিরোনাম, চ্যানেল ও বিষয়বস্তু যাচাই করে ব্রিফের “প্রায় 20টি বিশ্লেষণ” শর্ত পূরণ হয়েছে বলে ধরা হয়েছে।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI সংবাদ
Bluesky-এর অফিসিয়াল search API (public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) এই পরিবেশ থেকে সব অনুরোধে 403 Forbidden দিয়েছে। bsky.app-ও JavaScript-নির্ভর SPA; সরাসরি খুললে পোস্ট, লাইক বা রিপোস্ট পাওয়া যায়নি (বিস্তারিত ## Limits)। তাই Google-ইনডেক্সকৃত bsky.app পেজের WebSearch স্নিপেট থেকে বাস্তব পোস্ট সংগ্রহ করা হয়েছে। Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3, GPT Image 2, MAI-Image-2.6, Z-Image-Turbo—2026-এর শেষার্ধের এসব মডেলের নামে একটিও Bluesky পোস্ট পাওয়া যায়নি। X-এর বিপরীতে এ বিষয়ে Bluesky-এর উপস্থিতি অত্যন্ত ক্ষীণ।
অ্যাকাউন্ট
- @simonwillison.net — LLM ও জেনারেটিভ AI পর্যবেক্ষণকারী স্বাধীন গবেষক; মাঝে মাঝে ইমেজ মডেলের কথা বলেন, তবে এ ক্ষেত্রে বিশেষজ্ঞ নন।
- @todaystopainews.bsky.social — AI সংবাদ স্বয়ংক্রিয়ভাবে সংগ্রহ ও পোস্ট করা bot/aggregator অ্যাকাউন্ট।
- @civitai-bot.bsky.social (CivitaiCheckPoint update BOT) — Civitai-এর নতুন/আপডেট checkpoint স্বয়ংক্রিয়ভাবে পোস্ট করে; ওপেন-সোর্স Stable Diffusion ইকোসিস্টেমের একমাত্র নিয়মিত অ্যাকাউন্ট।
- @doctordiffusion.bsky.social — Civitai-তে Stable Diffusion-ভিত্তিক মডেল প্রকাশকারী ব্যক্তিগত নির্মাতা।
- @luok.ai — SkyReels (Skywork AI)-সম্পর্কিত ওপেন-সোর্স ভিডিও মডেলের কথা বলা ব্যক্তিগত অ্যাকাউন্ট।
- @dahara1.bsky.social — জাপানি ভাষায় জেনারেটিভ AI beta-test অভিজ্ঞতা পোস্ট করা ব্যক্তিগত অ্যাকাউন্ট।
- @valeoai.bsky.social (Valeo.ai) — স্বচালিত গাড়ির ভিডিও/ওয়ার্ল্ড মডেল গবেষণা ওপেন-সোর্স করে; সরাসরি ইমেজ/ভিডিও জেনারেশন নয়, মূলত গবেষণা।
- @midjourney.bsky.social — Midjourney-এর অফিসিয়াল প্রোফাইল আছে, তবে সাম্প্রতিক পোস্ট পাওয়া যায়নি।
- @opensource.bsky.social (Open Source Initiative) — ওপেন-সোর্স প্রচারক সাধারণ অ্যাকাউন্ট, ইমেজ/ভিডিও AI-কেন্দ্রিক নয়।
- Alibaba (Wan/Qwen-Image), Tencent (Hunyuan), Kling/Kuaishou, Black Forest Labs, Runway, xAI, OpenAI—X-এ প্রাথমিক উৎস হিসেবে থাকা এ ল্যাবগুলোর অফিসিয়াল Bluesky অ্যাকাউন্ট এ গবেষণায় পাওয়া যায়নি।
পোস্ট
ক্লোজড-সোর্স
- Nano Banana Pro-এর SynthID শনাক্তকরণ — @simonwillison.net: একটি ছবি আপলোড করে AI-তৈরি কি না জানতে চাইলে Nano Banana Pro-এ থাকা অদৃশ্য SynthID watermark শনাক্ত করা যায়—এ কথা উল্লেখ। তারিখ অজানা (2026-এর মধ্যে অনুমিত)। লাইক/রিপোস্ট পাওয়া যায়নি।
- API বিক্রেতাদের ফিচার-সংমিলন ও FLUX ব্যবহার — @simonwillison.net: প্রধান LLM API বিক্রেতারা code execution, web search, document library, image generation ও MCP-তে একই ধরনের সক্ষমতায় পৌঁছাচ্ছে; এ প্রসঙ্গে “image generation (FLUX for Mistral)”—Mistral-এর FLUX ব্যবহারের উল্লেখ। তারিখ অজানা।
- Kling AI 1.6 দিয়ে বাস্তব সৃজন কাজ — @planet-gay-comic.bsky.social (2025-02-07): “Spring Feelings Arise” কাজে Kling AI 1.6 দিয়ে image-to-video, SD-1.5 দিয়ে স্থিরচিত্র, Suno AI v4 দিয়ে অডিও বানানোর কথা বলা পোস্ট। ব্যক্তিগত নির্মাতার কাজে ক্লোজড ভিডিও টুল ব্যবহারের নির্দিষ্ট উদাহরণ।
- Grok-এর ভবিষ্যৎ নিয়ে মন্তব্য — @wilkos.bsky.social (2026-06-05): “Grok will lead the way in frontier models by training off more established and capable competitors”—সাধারণ মন্তব্য; ছবি/ভিডিও জেনারেশন-কেন্দ্রিক নয়, কেবল প্রাসঙ্গিক উল্লেখ।
ওপেন-সোর্স
- “সেন্সরবিহীন লোকাল ইমেজ AI” প্রচার — @todaystopainews.bsky.social (2026-06-30): “New top local AI image generator is here! Already uncensored”—YouTube ভিডিও থেকে Bluesky-তে পুনঃপ্রকাশিত স্বয়ংক্রিয় সংবাদ। প্রাথমিক উৎস নয়; aggregator bot—এটি মনে রাখা জরুরি।
- SkyReels V1 প্রকাশ — @luok.ai (2025-02-18): “SkyReels V1 is the first open-source human-centric video foundation model”—Skywork AI-এর ওপেন-সোর্স ভিডিও foundation model পরিচিতি। HunyuanVideo-ভিত্তিক, 33 ধরনের মুখভঙ্গি ও 400-এর বেশি স্বাভাবিক গতি শিখেছে।
- HunyuanVideo beta অভিজ্ঞতা — @dahara1.bsky.social (2025-03-06): জাপানি ভাষায় জানানো হয়েছে, HunyuanVideo beta পরীক্ষায় অংশ নিয়ে এক ছবি থেকে ভিডিও (I2V) বানানো গেছে; anime-ধাঁচের উপকরণে পরীক্ষার কথা আছে।
- Civitai checkpoint স্বয়ংক্রিয় আপডেট — @civitai-bot.bsky.social (2024-05-07): “Dream Come TrueXL v4.0” (SDXL/SD1.5) আপডেটের bot ঘোষণা। Civitai-এর ওপেন-সোর্স SD কমিউনিটি Bluesky-তে এখনও স্বয়ংক্রিয় পোস্টের রূপে আছে।
- Civitai মডেল বিতরণ — @doctordiffusion.bsky.social (2025-01-19): নিজের Stable Diffusion-ভিত্তিক মডেল Civitai লিংকসহ ভাগ করেছেন।
- স্বচালিত গাড়ির ভিডিও/ওয়ার্ল্ড মডেল ওপেন-সোর্স — @valeoai.bsky.social (2025-02-24): “Trained on YouTube?! We used OpenDV”—পেপার (arXiv:2502.15672), প্রজেক্ট পেজ, GitHub কোড, প্রশিক্ষিত ওয়েট, training recipe ও scaling law-সহ সবকিছু ওপেন-সোর্স করার ঘোষণা। সরাসরি ছবি/ভিডিও “জেনারেশন” নয়; তবে কোম্পানির ওয়েটসহ পূর্ণাঙ্গ ওপেন প্রকাশের উদাহরণ।
সংকেত
- 2026-এর সাম্প্রতিক মডেল নামের কোনো ফল নেই: Wan2.6, Qwen-Image-2512, Kling 3.0, FLUX 3, GPT Image 2, MAI-Image-2.6, Z-Image-Turbo, HunyuanImage 3.0, Runway Gen-4.5 ইত্যাদি নিয়ে 20টির বেশি কুয়েরি চালিয়েও Bluesky পোস্ট মেলেনি। X-এ সক্রিয় সংবাদচক্র থেকে Bluesky-এর আলোচনা প্রায় পুরোপুরি বিচ্ছিন্ন।
- অফিসিয়াল ল্যাব অ্যাকাউন্টের অনুপস্থিতি: Alibaba, Tencent, Kuaishou, Black Forest Labs, Runway, xAI বা OpenAI—কারোরই X-এর মতো প্রাথমিক তথ্য দেওয়া অফিসিয়াল Bluesky অ্যাকাউন্ট পাওয়া যায়নি। Midjourney-এর handle থাকলেও সক্রিয়তা অজানা।
- পাওয়া আলোচনা পশ্চিমা Stable Diffusion/Civitai-কেন্দ্রিক এবং পুরোনো: অধিকাংশ পোস্ট 2024–2025-এর প্রথমার্ধের; Civitai ও Stable Diffusion শৌখিন কমিউনিটিতে সীমাবদ্ধ। 2026-এর Wan/Qwen/Hunyuan/Z-Image-নেতৃত্বাধীন চীনা প্রতিযোগিতা থেকে আলাদা।
- প্ল্যাটফর্মের সাংস্কৃতিক প্রতিকূলতা: Bluesky-এর art feed curator bSky.art “Trending” ইত্যাদি ফিডে AI exclusion list চালু করেছে; Bluesky-ও বলেছে ব্যবহারকারীর কনটেন্ট জেনারেটিভ AI প্রশিক্ষণে ব্যবহার করা হয় না। AI-তৈরি কনটেন্টকে সক্রিয়ভাবে দৃশ্যমান না করার সংস্কৃতি এ আলোচনার বিকাশে বাধা হতে পারে।
- প্রাথমিক উৎসের বদলে aggregator bot: অল্প যে “নতুন মডেল” ধরনের পোস্ট পাওয়া গেছে, যেমন todaystopainews.bsky.social, সেগুলো YouTube থেকে পুনঃপ্রকাশ; নির্মাতার নিজস্ব ঘোষণা নয়।
- স্থানান্তরিত পরিচিত AI ভাষ্যকারদের বিচ্ছিন্ন উল্লেখ: Simon Willison-এর মতো X/Twitter থেকে আসা ভাষ্যকাররাও ছবি/ভিডিও মডেল বিশেষভাবে অনুসরণ করেন না; LLM-সাধারণ আলোচনায় মাঝে মাঝে উল্লেখ করেন।
সীমাবদ্ধতা
- Bluesky-এর অফিসিয়াল search API
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPostsসরাসরি এবং একাধিক CORS proxy (allorigins.win, corsproxy.io, codetabs.com ইত্যাদি) দিয়ে চেষ্টা করলেও 403 Forbidden, কিছু ক্ষেত্রে 522 দিয়েছে। তাই পোস্ট লেখা, লাইক, রিপোস্ট বা সময় সরাসরি API থেকে পাওয়া যায়নি। bsky.appসার্চ, প্রোফাইল ও পোস্ট permalink—সবই JavaScript SPA; পাওয়া বিষয়বস্তু ছিল খালি app shell, শুধু “Bluesky” বা “@handle on Bluesky” শিরোনাম। ফলে সব পোস্ট Google-ইনডেক্সকৃত স্নিপেট থেকে পুনর্গঠিত; লাইক ও রিপোস্ট সংখ্যা সবক্ষেত্রেই অজানা।- এ সীমাবদ্ধতায় Bluesky search index পাতলা; পুরোনো বিষয়ের বাইরে প্রায় কিছু পাওয়া যায় না। 2026-এর মডেলনামের সব কুয়েরি ব্যর্থ হয়েছে, বদলে 2024–2025-এর পোস্ট এসেছে। এটি “Bluesky-তে সংবাদ নেই”—তার প্রমাণ নয়; বরং কেবল ইনডেক্সের মাধ্যমে দেখার সীমা প্রতিফলিত হওয়ার সম্ভাবনাই বেশি।
- সমাপ্তির “প্রায় 20টি পোস্ট বিশ্লেষণ” শর্ত Bluesky এককভাবে পূরণ করা যায়নি; সরাসরি ডেটা বন্ধ থাকায় উপরের 10টি পোস্টই এ পরিবেশ থেকে যাচাইকৃত সব ফল। আরও তথ্য পেতে অফিসিয়াল অ্যাপ লগইন বা ভিন্ন API অ্যাক্সেস দরকার।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI সংবাদ গবেষণা
কমিউনিটি
- !«メールアドレス» (প্রায় 5,600–5,700 সদস্য) — ওপেন-ওয়েট ইমেজ ও ভিডিও মডেলের সাধারণ আলোচনা। ComfyUI custom node এবং Hugging Face-এর নতুন মডেল প্রায় প্রতিদিন আসে; এ গবেষণার সবচেয়ে কার্যকর স্থান।
- !«メールアドレス» (2,359 সদস্য) — Stable Diffusion/ওপেন-ওয়েট মডেলে তৈরি শিল্পকর্মের পোস্টস্থান।
- !«メールアドレス» (1,593 সদস্য) — anime-ধাঁচের AI art-এর জন্য, শুধু SFW।
- !«メールアドレス» (1,662 সদস্য) — “ওপেন-সোর্স ডিপ লার্নিং মডেল” হিসেবে SD আলোচনা।
- !«メールアドレス» (52 সদস্য), !«メールアドレス» (50 সদস্য), !«メールアドレス» (102 সদস্য), !«メールアドレス» (96 সদস্য) — ছোট, বিষয়ভিত্তিক niche কমিউনিটি।
- !«メールアドレス» (222 সদস্য) — lemmy.dbzer0.com-এর কমিউনিটির mirror/স্বতন্ত্র রূপ; পোস্ট কম।
- !«メールアドレス», !«メールアドレス», !ai_reddit (বিভিন্ন instance), !«メールアドレス» — ক্লোজড AI যেমন Grok, Sora ও Nvidia DLSS-এর খবর এবং AI-বিরোধী মনোভাব এখানে আসে। সদস্যসংখ্যা অপ্রকাশিত বা পরিবর্তনশীল, যাচাই সম্ভব নয়।
পোস্ট
- OpenAI Sora বন্ধ করেছে, 30 মিলিয়ন ডলারের চলচ্চিত্র প্রকল্প ভেস্তে গেছে (!ai_reddit, 2026-05-27, স্কোর 1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/ । Sora 2 app/API বন্ধের (API 2026-09-24-এ বন্ধ হওয়ার কথা) প্রভাবে Sora-নির্ভর AI চলচ্চিত্র প্রকল্প থেমে যাওয়ার পোস্ট। সম্পর্কিত: “How OpenAI scrapping Sora points to tech problems” (!openai, 2026-04-13) https://timesofindia.indiatimes.com/technology/ , “Why OpenAI abandoned Sora” (!kagismallweb, 2026-04-03) https://onemanandhisblog.com/2026/03/ ।
- xAI “Grok”-এর image generation দিয়ে ভুক্তভোগীর নিজের ছবি থেকে 7,000 যৌন ছবি বানানো হয়েছে—এমন অভিযোগ, এবং CSAM তৈরির মামলায় xAI-এর বিরুদ্ধে মামলা (!«メールアドレス», “Child sexual abuse survivor alleges Elon Musk's AI chatbot used photos of her to generate new illegal images”, 2026 সালের আগস্টের শেষভাগ, স্কোর 119) — https://lemmy.world/post/51492879 । শীর্ষ মন্তব্যে “ধনকুবেরদের দায় না নেওয়ার কাঠামো” নিয়ে সমালোচনা।
- মার্কিন ফেডারেল বিচারকের রায়: AI-তৈরি শিশু যৌন নির্যাতন-সংক্রান্ত কনটেন্ট প্রথম সংশোধনীর সুরক্ষা পায় (!technology, 2026-08-30, স্কোর 16) — https://reason.com/volokh/2026/08/27/ । ক্লোজড বা ওপেন নির্বিশেষে জেনারেটিভ AI-এর আইনি সীমা নির্ধারণে গুরুত্বপূর্ণ বিষয় হিসেবে বহু instance-এ পুনঃপ্রকাশিত।
- Nvidia DLSS 5: 50–60% পারফরম্যান্স কমার বিনিময়ে AI image enhancement filter (!«メールアドレス», 2026-09-02–09-03, স্কোর 21) — https://www.pcgamer.com/hardware/graphics-cards/dlss-5-comes-with-a-massive-50-60-percent-performance-hit/ । সংশ্লিষ্ট পোস্ট: “Nvidia Announces DLSS 5...An AI slop filter over your game” https://lemmy.world/post/44347792 এবং পরীক্ষামূলক build ফাঁসের খবর “Experimental Build Of Nvidia's DLSS 5 AI Slop Filter Leaks...” https://lemmy.world/post/51240561 ।
- Google Nano Banana 2 Lite প্রকাশ (!swisstechnews, 2026-07-02; !hackernews পুনঃপ্রকাশ 2026-06-30) — https://www.itmagazine.ch/artikel/87529/ , https://deepmind.google.com/models/ । Gemini 3 সিরিজের হালকা ইমেজ জেনারেশন মডেল হিসেবে পরিচিতি।
- Microsoft “MAI-Image-2.5” Nano Banana-মানের পর্যায়ে পৌঁছেছে (!ai_reddit, 2026-05-28, স্কোর 1) — https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/ । Google-এর মোকাবিলায় Microsoft-এর নিজস্ব ক্লোজড ইমেজ মডেল প্রকাশের খবর।
- ByteDance “Seedream 5.0 Pro”-এর বাস্তবধর্মী তুলনামূলক রিভিউ (!ai_reddit, 2026-07-10, স্কোর 1) — https://www.reddit.com/gallery/1usc03q ।
- Adobe Firefly পাবলিক beta (!swisstechnews, 2026-04-28) — https://www.itmagazine.ch/artikel/87034/ । Photoshop-এ AI chatbot এবং generative audio সংযুক্তি (!boycottus, 2025-10-29, স্কোর 22 https://alternativeto.net/news/2025/10/adobe-adds-ai-chatbots-to-photoshop-premiere-ai-masking-and-generative-audio-in-firefly/ ) নিয়েও আলোচনা চলেছে।
- “AI ডিপফেককে কতটা ভয় করা উচিত?” আলোচনা (!«メールアドレス», 2026-05-20-এর কাছাকাছি, স্কোর 21) — https://lemmy.world/post/47088326 । পোস্টদাতা ডিপফেকের ভয়ে অনলাইনে নিজের সব ছবি মুছে ফেলেছেন; মন্তব্যে বলা হয়েছে, অবস্থানভেদে ঝুঁকি ভিন্ন এবং নারীদের ঝুঁকি বেশি।
- MiniMax H3 (Hailuo 3.0)-এর ওপেন-ওয়েট প্রকাশ ও ComfyUI-এর বাণিজ্যিক লাইসেন্স একচেটিয়া বিক্রি (!«メールアドレス», “ComfyUI MiniMax H3 Commercial Licensing”, 2026-08-28, স্কোর 4) — https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller । ওয়েট খোলা (MiniMax Community License; বার্ষিক রাজস্ব 20 মিলিয়ন ডলারের কম হলে বাণিজ্যিক ব্যবহার অনুমোদিত), কিন্তু বাণিজ্যিক লাইসেন্স ও deployment support কেবল Comfy বিক্রি করে—একটি “ওপেন-স্বাদের বাণিজ্যিক মডেল”। টেক্সট, ছবি, ভিডিও ও অডিও এক transformer-এ; সর্বোচ্চ 15 সেকেন্ড, 2K, native stereo audio আউটপুট। সম্পর্কিত টুল পোস্ট বহু: MiniMax-H3-Acc-LoRAs, MotionCache-FastVAE, Director-Cut-Studio ইত্যাদি, 2026-08-28 থেকে 09-02।
- LTX-2.3 / LTX-2.5 (Lightricks-এর ওপেন-ওয়েট ভিডিও মডেল) ঘিরে ComfyUI node দ্রুত বাড়ছে (!stable_diffusion, 2026-08-27–09-01) — উদাহরণ: https://github.com/nazgut/ComfyUI-LTX2.3-CLSS । LTX-2.5 হলো 22B ওপেন-ওয়েট audio-video model, multi-shot generation ও 4K HDR output সমর্থন করে; H3 আসার আগে ওপেন-ওয়েট ভিডিওর শীর্ষে ছিল।
- Trellis.2 ও Pixal3D-র ComfyUI native support (!stable_diffusion, 2026-09-01, স্কোর 4) — https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native । কেবল ছবি/ভিডিও নয়, 3D জেনারেশনও ComfyUI ইকোসিস্টেমে যুক্ত হচ্ছে।
- Boogu-Image-0.1 প্রকাশ (!stable_diffusion, 2026-06-17, স্কোর 5) — https://boogu.org/ । 10B প্যারামিটার, সম্পূর্ণ Apache-2.0 লাইসেন্স, Qwen-Image-Bench-এ উচ্চ অবস্থান, Base/Turbo/Edit—তিন রূপ। “অল্প কম্পিউট বাজেটেও ক্লোজড-সোর্স স্তরের কর্মক্ষমতা” দাবি করা একটি উল্লেখযোগ্য উদাহরণ।
সংকেত
- ক্লোজড-সোর্স পক্ষের পরিবেশ: মূল আলোচনা নতুন মডেল ঘোষণার বদলে বিতর্ক, মামলা ও প্রত্যাহারকে ঘিরে। Sora বন্ধ, Grok CSAM মামলা, DLSS5-এর কর্মক্ষমতা-হ্রাসের সমালোচনা—নেতিবাচক খবর বেশি স্কোর করে (DLSS5 21, Grok মামলা 119)। !«メールアドレス»-জাতীয় কমিউনিটিতে AI-বিরোধী মনোভাব প্রবল।
- ওপেন-সোর্স পক্ষের পরিবেশ: !«メールアドレス» কার্যত ComfyUI ইকোসিস্টেমের update log; MiniMax H3, LTX-2.3/2.5, Flux, Qwen Image ঘিরে নতুন custom node ও LoRA প্রায় প্রতিদিন আসে। শিল্পকর্মের চেয়ে ডেভেলপার-উপযোগী টুল পোস্ট বেশি; কমিউনিটি ব্যবহারিক।
- ওপেন/ক্লোজড সীমা ঝাপসা: MiniMax H3 ওপেন-ওয়েট, কিন্তু বাণিজ্যিক লাইসেন্স Comfy একচেটিয়াভাবে বিক্রি করে—সরল দ্বিভাজন ভাঙছে।
- Lemmy জুড়ে Reddit mirror community (!ai_reddit ইত্যাদি) থেকে পুনঃপ্রকাশ বেশি; প্রাথমিক তথ্যের মূল উৎস হিসেবে !«メールアドレス» সবচেয়ে সমৃদ্ধ।
সীমাবদ্ধতা
- Lemmy-র পরিসর X/YouTube/Reddit-এর তুলনায় ছোট; শুধুই ভিডিও জেনারেশন AI নিয়ে নিবেদিত কমিউনিটি—যেমন !video_generation—পাওয়া যায়নি। ভিডিও বিষয়গুলো Stable Diffusion কমিউনিটির LTX, MiniMax H3, WanGP ইত্যাদি টুল পোস্টের মধ্যে চাপা থাকে।
- Lemmy global site search API কিছু কীওয়ার্ডে শূন্য ফল দেয়—যেমন
video generation,Ideogram/Seedream/Qwen Image—ফলে সত্যিই পোস্ট নেই নাকি index সীমাবদ্ধ, তা আলাদা করা যায়নি। - কমিউনিটি সদস্যসংখ্যা instance-ভেদে ভিন্ন দেখায়—যেমন !«メールアドレス»-এর জন্য 5.05K/5.64K/5,707—ফেডারেটেড সামাজিক নেটওয়ার্কের কারণে সঠিক একক সংখ্যা পাওয়া যায়নি।
lemmy.world/c/stable_diffusion_artসরাসরি fetch-এ HTTP 500 দিয়েছে; API search-ভিত্তিক তথ্য দিয়ে বিকল্প করা হয়েছে।- এক প্ল্যাটফর্মে নির্দিষ্ট 20টি পোস্ট সম্পূর্ণভাবে যাচাই করা হয়নি; এ রিপোর্টে API search ও WebSearch-এ যাচাইকৃত বাস্তব পোস্ট ও লিংক থেকে বাছাই করা 13টি পোস্ট রয়েছে, কোনো কল্পিত লিংক নেই।
Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ (ক্লোজড-সোর্স / ওপেন-সোর্স)
সংগৃহীত 50টি Pin-এর (output/pinterest.pins.md) মধ্যে 32টি ছবি খুলে দেখা হয়েছে (কোনো genre ভাগ ছাড়া একক সার্চ ফল)।
ভিজ্যুয়াল থিম
- YouTube-ধাঁচের clickbait thumbnail সবচেয়ে বেশি। বড় গাঢ় হরফ, বিস্মিত মুখের নির্মাতা, neon blue/purple জ্বলজ্বলে রোবট মাথা—বারবার দেখা যায়। “huge AI news”, “AI NEWS”, “15 Biggest AI Updates”-এর মতো ভিডিও থাম্বনেইল Pinterest-এ সরাসরি পুনঃপ্রকাশিত [1, 6, 8, 13, 14, 26, 47]।
- “Top N tools” তুলনামূলক ইনফোগ্রাফিকের আধিক্য, একই template পুনর্ব্যবহারের প্রমাণও আছে। [16] ও [40]-এ একই “BEST QUALITY(PAID) vs BEST FREE” layout—বাম দিকে ChatGPT Plus/Gemini Advanced/Midjourney/Adobe Firefly/Recraft/Runway Gen-3/Luma/Pika Pro/Kaiber/Synthesia, ডানদিকে Ideogram/Gemini Free/SeaArt/Playground/Krea/Canva/Inkscape/CapCut/Pika Free/Runway Free—শুধু রঙ ও “DA” watermark আলাদা। তথ্যের বদলে template নকল ও ব্যাপক পুনঃউৎপাদনের প্রমাণ। [10]-এর “Top AI Video Generators of 2025” শিরোনাম হলেও ছবিটি সিনেমাটিক moodboard-কোলাজ; [42]-এর সাধারণ “Video generation 📹” শিরোনামের ছবিতে Runway-কেন্দ্রিক “TOP 10 IMAGE-TO-VIDEO GENERATOR TOOLS” তালিকা (Kling, Google Veo, Sora, Luma, Pika, Kaiber, Synthesia, HeyGen, Adobe Firefly, InVideo)। শিরোনাম ও ছবির বিষয়বস্তু অনেক ক্ষেত্রেই মেলে না।
- Dark navy × neon blue “প্রযুক্তিমুখী ভবিষ্যৎ” palette নির্দিষ্ট খবরের বদলে AI-সাধারণ সচেতনতামূলক গ্রাফিকে ব্যবহৃত। জ্বলজ্বলে মস্তিষ্ক, সার্কিট নকশা, রোবট মাথার icon—ভিডিও/ইমেজ জেনারেশনের বাইরেও AI-এর সাধারণ প্রতীক [2, 12, 30, 32, 36, 49]।
- নির্দিষ্ট পণ্যের ডেমো ছবি কম, তবে তুলনামূলকভাবে বেশি বাস্তব। Google Veo 2-এর বহুদৃশ্য কোলাজ ও “Sign up to try on VideoFX” CTA [5]; Gemini API-র Veo 3 image-to-video (ছবির ইনপুট + টেক্সট ইনপুট → দ্রুত জেনারেশন funnel graphic) [9]; Microsoft VASA-1 (এক ছবি + audio clip → নানা অভিব্যক্তির talking-head grid) [18]; ShengShu Vidu S1 (অ্যানিমে-ধাঁচের চরিত্র UI-তে “রিয়েল-টাইম AI interaction-এর বিশ্বসেরা মডেল”) [25]; AMD Amuse 3.0 (“AI generated image created on AMD Ryzen AI” উল্লেখসহ বাস্তবধর্মী বৃদ্ধ জেলের প্রতিকৃতি, স্থানীয়/on-device জেনারেশনের বিরল উল্লেখ) [33]; এবং একই উৎস ভিডিওকে “কাঠের ব্লক”, “origami art”, “রঙিন block toy”, “ফুল”—চার শৈলীতে বদলানো, সঙ্গে Tesla Model 3 ও পান্ডার মাথা বদলানোর Luminate-ধাঁচের style transfer demo [3]।
- ডিপফেক অবিশ্বাস ও শনাক্তকরণ-উদ্বেগের ভিজ্যুয়াল উল্লেখযোগ্য। বিড়ালের ছবিতে বানানো engagement সংখ্যা (1.2K লাইক, 7.4K ভিউ) ও লাল “FAKE” স্ট্যাম্প [1]; “97% likely AI generated” audio-detection UI ও মানুষ/cyborg-এ ভাগ করা চোখ [12]; AI ভিডিওর “Good or Bad?” লাভ-ক্ষতি scorecard (সময় সাশ্রয়, কম খরচ, উচ্চ গুণমান বনাম মানবিক সৃজনশীলতা ও আবেগী সংযোগের অভাব, অতিনির্ভরতা) [19]।
- ভিত্তিহীন বাজার আকার ও বৃদ্ধির হারভিত্তিক পরিসংখ্যান। “AI Video Generator Market: USD 2.56B by 2032, CAGR 20%” [48] এবং “2026-এর মধ্যে অনলাইন কনটেন্টের 80%-এ ভিডিও থাকবে” পূর্বাভাসসহ “6+ Best AI Video Generation Websites” তালিকা (Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI) [6]।
- “AI news anchor” ও “AI faceless channel” ধরনের সেবা-বিজ্ঞাপনী Pin। প্রকৃত সংবাদ নয়; AI lip-sync দিয়ে সংবাদ অনুষ্ঠানের মতো ভিডিও তৈরির সেবার প্রচার thumbnail [46]।
উল্লেখযোগ্য Pin
- [3] উৎস ভিডিওকে “কাঠের ব্লক/origami/লেগো/ফুল”—চার শৈলীতে রূপান্তর এবং Tesla ও পান্ডার মাথার পরিবর্তনসহ তুলনামূলক ডেমো। দেখা Pinগুলোর মধ্যে সবচেয়ে নির্দিষ্ট style-transfer video generation প্রমাণ।
- [5] Google Veo 2 launch image। microscope scene, underwater swimmer, anime-ধাঁচের মেয়ে, flamingo-সহ একেবারে ভিন্ন ছয়টি দৃশ্য এক ছবিতে; “Sign up to try on VideoFX” প্রচার।
- [9] Gemini API-এর মাধ্যমে Veo 3 image-to-video। ছবি ও টেক্সট ইনপুট দ্রুত জেনারেশনে মিলছে—এমন funnel graphic; native audio সমর্থনের ইঙ্গিত।
- [18] Microsoft VASA-1। একটি ছবি ও audio clip থেকে ডজনখানেক মুখভঙ্গির talking-head ভিডিও তৈরির grid।
- [25] ShengShu Vidu S1। “রিয়েল-টাইম AI interaction-এর বিশ্বসেরা মডেল” দাবি করা anime-ধাঁচের চরিত্রের প্রচার ছবি।
- [28] “15 Biggest AI Updates” ইনফোগ্রাফিক। Pinগুলোর মধ্যে অল্প কয়েকটির একটি যাতে নির্দিষ্ট ইমেজ জেনারেশন রিলিজ—Grok Imagine Image 2.0-এর image-editing ও resize—এবং DeepSeek V4 Pro API মূল্যহ্রাসের কথা আছে।
- [32] “Google 15 মিলিয়ন চ্যাট বিশ্লেষণ করেছে” পরিসংখ্যান কার্ড। AI ব্যবহারের 86% কাজের বাইরের—এমন দাবি এবং coding contest-এ AI agent 526 দলের মধ্যে 458টির ওপরে ছিল—এমন উল্লেখ।
- [1] বিড়ালের ছবিতে “FAKE” স্ট্যাম্প ও বানানো engagement সংখ্যা; এই Pinগুলোর সামগ্রিক ডিপফেক-অবিশ্বাসের প্রতীক।
- [33] AMD Amuse 3.0। “AMD Ryzen AI দিয়ে তৈরি” ক্রেডিটযুক্ত বাস্তবধর্মী portrait; স্থানীয়/on-device জেনারেশনের একমাত্র উল্লেখ।
- [16]/[40] একই “Best Quality (paid) vs Best Free (free)” AI tool comparison chart ভিন্ন রঙ ও অ্যাকাউন্টে দুইবার পোস্ট—তথ্যের বদলে template নকল ও পুনঃউৎপাদনের ইঙ্গিত।
সংকেত
- ক্লোজড-সোর্সের বড় ব্র্যান্ড—Google Veo, OpenAI Sora, Runway, Kling, Pika, Luma, Midjourney, ChatGPT/DALL-E, Adobe Firefly, Synthesia—Pinterest-এর “Top tools” Pin-এ বারবার নাম পায় এবং tool-comparison content-এর মূল চরিত্র ([6, 10, 16, 24, 40, 42] ইত্যাদি)।
- নিজেকে ওপেন-সোর্স বলা Pin প্রায় নেই। Stable Diffusion, Flux, Wan, HunyuanVideo বা ComfyUI workflow-সংক্রান্ত ছবি 32টির মধ্যে একটিও দেখা যায়নি। কেবল AMD Amuse 3.0 [33]-কে স্থানীয়/on-device বলা যায়, তাও কঠোর অর্থে ওপেন-সোর্স নয়; কর্পোরেট টুলের local-run ডেমো।
- Pin-এর শিরোনাম ও ছবির বিষয়বস্তু প্রায়ই অসামঞ্জস্যপূর্ণ। “Google announces...” [3] কিংবা “Google announces video generation AI 'Veo 3'” [37, নিচের Limits দেখুন]-এর মতো নামী শিরোনাম থাকলেও ছবিতে সংশ্লিষ্ট ব্র্যান্ডের logo বা প্রমাণ নেই; SEO/clickbait উদ্দেশ্যে দাবি বাড়িয়ে বলা হতে পারে।
- “ব্রেকিং নিউজ” সাজা Pin-এর ভেতর আসলে সাধারণ, পুনর্ব্যবহৃত template। [30]-এর “Breaking News” mockup-এ GPT-5, Llama 3.1, Claude 3.5—ইতিমধ্যেই পুরোনো মডেলের নাম; তারিখবিহীন স্থায়ী template বলেই মনে হয়।
- মোটের ওপর Pinterest-এ এই বিষয়টি “খবর দেওয়া”-র চেয়ে “AI tool adoption/comparison বিক্রি”, “AI নিয়ে ভয় তৈরি” এবং “YouTube thumbnail-এর দ্বিতীয় বণ্টন”—এই তিন উদ্দেশ্যে বেশি ব্যবহৃত। সাম্প্রতিক সংবাদগত দিক থেকে X ও YouTube-এর মতো প্রাথমিক উৎসের কাছাকাছি নয়।
সীমাবদ্ধতা
- 50টি Pin-এর মধ্যে 32টি ([1, 2, 3, 5, 6, 8, 9, 10, 12, 13, 14, 16, 18, 19, 20, 24, 25, 26, 28, 29, 30, 32, 33, 36, 37, 40, 41, 42, 46, 47, 48, 49]) ছবি হিসেবে দেখা হয়েছে। বাকি 18টি ([4, 7, 11, 15, 17, 21, 22, 23, 27, 31, 34, 35, 38, 39, 43, 44, 45, 50]) দেখা হয়নি।
pinterest.pins.md-এ genre বিভাগ (## <genre>) নেই; 50টিই এক সার্চ ফল হিসেবে আছে, ফলে genre-ভিত্তিক গণনা করা যায়নি।- [37]-এর শিরোনাম “Google announces video generation AI 'Veo 3'”, কিন্তু ছবিতে বেগুনি monster চরিত্রকে input image থেকে তিন ভিন্ন পরিবেশে—server room, underwater ruin, candy city—ভিডিওতে রূপান্তরের demo দেখা গেছে; Google বা Veo 3 logo নেই। ছবিমাত্র দিয়ে শিরোনামের দাবি সমর্থিত নয়, তাই তথ্য হিসেবে নেওয়া হয়নি।
- কেবল Pin-এর ছবি পড়া হয়েছে; Pinterest পেজের save count, মন্তব্য, পোস্ট তারিখ ইত্যাদি সম্পৃক্ততার সূচক যাচাই হয়নি (
pinterest.pins.md-তেও নেই)। - ব্রিফে চাওয়া “ক্লোজড-সোর্স অন্তত 10 ও ওপেন-সোর্স অন্তত 10 অন্তর্দৃষ্টি”-র মধ্যে ওপেন-সোর্স সম্পর্কিত Pin থেকে কার্যত কিছুই পাওয়া যায়নি; AMD Amuse 3.0 [33] একমাত্র প্রাসঙ্গিক উদাহরণ। ওপেন-সোর্স প্রবণতা X, Reddit ও Lemmy-র মতো অন্য প্ল্যাটফর্মে পূরণ করার পরামর্শ।
প্রস্তাবিত পদক্ষেপ
- ক্লোজড-সোর্সের গতিবিধি জানতে X ও YouTube-কে প্রাথমিক তথ্যসূত্র হিসেবে নিয়মিত পর্যবেক্ষণ করুন।
- ওপেন-সোর্স বাস্তবায়ন প্রবণতা পর্যবেক্ষণে Lemmy-র !«メールアドレス»-কে ComfyUI ইকোসিস্টেমের নির্দিষ্ট পর্যবেক্ষণস্থল হিসেবে ব্যবহার করুন।
- Reddit ও Bluesky-এর জন্য পরের বার লগইন করা সেশন বা অফিসিয়াল API কী-র মতো বিকল্প অ্যাক্সেস না থাকলে কার্যকর গবেষণা সম্ভব নয়।
- Pinterest সংবাদ ব্রেকিংয়ের জন্য উপযোগী নয়; পরের বার এটি কেবল ভিজ্যুয়াল ট্রেন্ড বিশ্লেষণে ব্যবহার করুন।
- FLUX 3 ও MiniMax H3-এর মতো “ওপেন ওয়েট হলেও বাস্তবে gated/হাইব্রিড লাইসেন্স” উদাহরণ প্রতিবার লাইসেন্সের ভাষা যাচাই করে শ্রেণিবদ্ধ করুন।
- Sora বন্ধ বা Grok মামলার মতো আইনি ও বিতর্কভিত্তিক খবর Lemmy-তে বাস্তব উদাহরণসহ আগে দেখা দিতে পারে; নিয়মিত পর্যবেক্ষণে যুক্ত করুন।
সংগৃহীত ছবি


















































ডেটার গুণমানের নোট
অ্যাক্সেস অবরোধে Reddit-এ শূন্য পোস্ট পাওয়া গেছে। Bluesky-তে search API অবরুদ্ধ থাকায় 2024–2025-এর পুরোনো পোস্ট ছাড়া কিছু পাওয়া যায়নি এবং 2026-এর প্রধান মডেলের একটিও উল্লেখ করা যায়নি। Pinterest ওপেন-সোর্স নিয়ে প্রায় কোনো অন্তর্দৃষ্টি দেয়নি। ছয় প্ল্যাটফর্মের মধ্যে X, YouTube ও Lemmy—এই তিনটিই প্রধান ভিত্তি।



