ছবি ও ভিডিও জেনারেশন এআই সংবাদ — 2026-09-27
Sora API বন্ধ হয়ে যাওয়ায় ক্লোজড-সোর্স ভিডিও জেনারেশনের শক্তির সমীকরণ বদলাচ্ছে। অন্যদিকে Qwen-Image-2.1 ও LTX-2.5-কে কেন্দ্র করে ওপেন-ওয়েট শিবির প্রকাশের পরপরই একাধিক প্ল্যাটফর্মে দ্রুত ইকোসিস্টেম সম্প্রসারণ করছে।
ছবি ও ভিডিও জেনারেশন এআই সংবাদ — 2026-09-27
আহা—এবারের সংকলনে সবচেয়ে উত্তেজনাকর বিষয় ছিল ওপেন-সোর্স শিবিরের গতি সত্যিই থামছে না 🔥🔥 Qwen-Image-2.1 আর LTX-2.5-এর মতো মডেল প্রকাশ হওয়া মাত্রই YouTube, Lemmy ও Bluesky একসঙ্গে ঝাঁপিয়ে পড়ছে—ব্যাপারটা দারুণ। অন্যদিকে ক্লোজড-সোর্স দিকের Sora 2 সত্যিই পরিষেবা বন্ধ করে দিয়েছে (অ্যাপ 4/26, API 9/24), ফলে Veo, Kling, Runway ও Grok Imagine-কে ঘিরে চেয়ার দখলের খেলা শুরু হয়েছে বলেই মনে হচ্ছে 🪑💨 সব প্ল্যাটফর্মেই আরেকটি প্রবল সুর: “AI দিয়ে তৈরি হলে তা লুকিও না।” রিয়েল-এস্টেটের ছবি থেকে বিজ্ঞান প্রতিযোগিতা পর্যন্ত—ধরা পড়লে সহজেই বিতর্ক, এমনকি চাকরি হারানোর পরিস্থিতি তৈরি হচ্ছে 😱 সত্যি বলতে, শুধু X-এর ডেটা একেবারেই ব্যবহারযোগ্য ছিল না—সেটা খোলাখুলিই বলছি 🙏
প্ল্যাটফর্মজুড়ে
- নতুন ওপেন-ওয়েট মডেল প্রকাশের সঙ্গে সঙ্গেই একাধিক প্ল্যাটফর্মে প্রতিক্রিয়া পাচ্ছে। Qwen-Image-2.1 (Alibaba, 7B প্যারামিটার, স্বচ্ছ আউটপুট সমর্থন) নিয়ে YouTube-এ একাধিক “Day 0 রিভিউ” ভিডিও হয়েছে; Lemmy-র !stable_diffusion-এ কয়েক দিনের মধ্যে ComfyUI সমর্থনের নিবন্ধ, LoRA ও ControlNet প্রকাশিত হয়েছে; Bluesky-তে ব্যক্তিগত নির্মাতারাও ব্যবহৃত টুল হিসেবে এটি প্রোফাইলে উল্লেখ করেছেন। LTX-2.5 (Lightricks, 22B প্যারামিটার, অডিও সিঙ্ক) নিয়েও YouTube ও Bluesky—দুই জায়গাতেই আলোচনা হয়েছে। ওপেন-সোর্স জগতে রিলিজের পর প্রাথমিক প্রতিক্রিয়ার গতি ভয়ানক দ্রুত ⚡
- “ঘোষণা ছাড়া AI ব্যবহার”-এর বিরোধিতা সব শিল্পখাতেই বিতর্কের বিষয় হয়ে উঠেছে। Reddit-এ রিয়েল-এস্টেট তালিকার ছবি (26,980pt), বিজ্ঞান প্রতিযোগিতায় পুরস্কারজয়ী ভিডিও (1,100pt-এর বেশি), এবং কোম্পানির বিজ্ঞাপনে AI-তৈরি ছবি নিয়ে CEO বরখাস্ত (585pt)—তিনটি সম্পূর্ণ ভিন্ন প্রেক্ষাপটে একই ক্ষোভ দেখা গেছে। Lemmy-তেও ওয়াটারমার্ক বাধ্যতামূলক করার বিলের সমর্থন ও Midjourney-বনাম-Hollywood মামলায় AI ব্যবহারের ঘোষণা চাওয়ার বিষয়টি উঠে এসেছে; Pinterest-এ ডিপফেক ও ভুলতথ্য নিয়ে উদ্বেগ উসকে দেওয়া ছবিও আলাদা একটি বড় ধারা। এটি আর বিচ্ছিন্ন বিতর্ক নয়; কাঠামোগত আলোচনায় পরিণত হচ্ছে 🔥
- Nano Banana (Google) কার্যত তুলনার মানদণ্ড হয়ে উঠেছে। YouTube-এ Grok Imagine 2.0-কে “Nano Banana Pro-এর চেয়ে 15 গুণ সস্তা” বলে পরিচয় করানো ভিডিও, এবং ওপেন-সোর্স Qwen-Image-2.1-কে “Better than Nano Banana” বলা ভিডিও—দুই ধরনেরই কনটেন্ট এসেছে। ক্লোজড ও ওপেন—উভয় পক্ষই এখন এই মডেলকে মাপকাঠি হিসেবে ব্যবহার করছে 👀
- ComfyUI ডেভেলপার কমিউনিটির সাধারণ অবকাঠামো। Reddit-এ বিনা খরচে ভিডিও বানাতে ইচ্ছুকদের স্থানীয়ভাবে চালানোর পরামর্শ, YouTube-এ LTX-2.5 ও Qwen-Image-2.1 সেটআপ ভিডিও, Lemmy-তে দুই সপ্তাহে পাঁচটির বেশি এক্সটেনশন নোড—সবখানেই ComfyUI-এর নাম এসেছে। ওপেন-সোর্স শিবিরের হোম গ্রাউন্ড বললেই চলে 🏠
প্ল্যাটফর্মভিত্তিক
Reddit — 12টি থ্রেড সংগ্রহ করা হয়েছে (লক্ষ্য 20-এ পৌঁছায়নি)। টুল সুপারিশ চাওয়া প্রশ্ন এবং “AI দিয়ে সম্পাদনা করা লুকিও না” ধরনের বিতর্কিত থ্রেডই প্রধান ছিল। ক্লোজড/ওপেন—এই দুই অক্ষে সরাসরি আলোচনা কম হলেও r/generativeAI থেকে Seedance 2.5 ও Grok Imagine Video-এর মতো নির্দিষ্ট মডেল নিয়ে বাস্তব ব্যবহারের পরামর্শ পাওয়া গেছে।
X — এই ধাপটি কার্যত পুরোপুরি ব্যর্থ 😂 সংগ্রহ করা 40টি পোস্টই ট্রেন্ডিং শব্দ (Yugoslavia, সেলিব্রিটি, সুইপস্টেকস বিজ্ঞাপন ইত্যাদি) থেকে এসেছে; ছবি/ভিডিও জেনারেশন AI নিয়ে একটি পোস্টও ছিল না। কর্মীর অনুসন্ধান যে থিমের সঙ্গে একেবারেই যুক্ত ছিল না সেটিই কারণ; পরেরবার “Midjourney” বা “Sora 2”-এর মতো সরাসরি কীওয়ার্ডে পুনরায় সংগ্রহ দরকার।
YouTube — সার্চ স্নিপেটের মাধ্যমে 12টি ভিডিও যাচাই করা হয়েছে (WebFetch প্রকৃত YouTube পৃষ্ঠা আনতে না পারায় সমস্যা হয়েছে)। ক্লোজড পক্ষের ক্ষেত্রে Grok Imagine 2.0-এর দ্রুত উত্থান ও Sora বন্ধ হওয়ার পর বিকল্পগুলোর তুলনা চোখে পড়েছে; ওপেন পক্ষের ক্ষেত্রে Qwen-Image-2.1, FLUX 3 ধারণা ও LTX-2.5 সাম্প্রতিক রিলিজ হিসেবে উল্লেখযোগ্য।
Bluesky — কোম্পানির অফিসিয়াল অ্যাকাউন্টগুলোর কার্যক্রম ক্লোজড ও ওপেন—দুই ক্ষেত্রেই প্রায় মৃত (Midjourney অফিসিয়াল একমাত্র সক্রিয় ছিল, কিন্তু সর্বশেষ পোস্ট প্রায় এক বছর আগের; Stability AI, Black Forest Labs ও Kling AI-এর অফিসিয়াল অ্যাকাউন্টে পোস্ট নেই বা কার্যক্রম স্থবির)। আসল সক্রিয়তা ব্যক্তিগত নির্মাতাদের প্রোফাইলে Qwen-Image, LTX-2 ও Wan Video-এর মতো নির্দিষ্ট টুলের নাম থাকার মধ্যেই ধরা পড়েছে।
Lemmy — !«メールアドレス»-এ ওপেন-সোর্স প্রাথমিক তথ্য প্রায় কেন্দ্রীভূত। Qwen-Image-2.1, Krea 2, MiniMax H3 ও Wan2GP গত দুই সপ্তাহে একসঙ্গে আপডেট হয়েছে; উন্নয়নের গতির হিসেবে ওপেন শিবির ক্লোজড পক্ষের আলোচনার পরিমাণ ছাড়িয়ে গেছে। ক্লোজড পক্ষের আলোচনা মূলত Sora API বন্ধ ও Midjourney-বনাম-Hollywood মামলার মতো “সংবাদ/মামলা” প্রেক্ষাপটে সীমিত।
Pinterest — 50টির মধ্যে 30টি যাচাই করা হয়েছে। এগুলো প্রাথমিক ঘোষণা নয়; YouTube থাম্বনেইলধর্মী সংবাদ সংকলন, “Top 10 ভিডিও জেনারেশন টুল” ধরনের অ্যাফিলিয়েট তালিকা, এবং ডিপফেক-ভীতি উসকে দেওয়া ছবিই প্রধান। ওপেন-সোর্স ওয়ার্কফ্লো (ComfyUI স্ক্রিনশট বা LoRA) একটিও পাওয়া যায়নি; ক্লোজড ও ওপেন—দুই ক্ষেত্রেই মূলত দ্বিতীয় স্তরের বিতরণ কনটেন্ট ছিল।
যা নজরে রাখবেন
- Qwen-Image-2.1 ইকোসিস্টেমের প্রসার — প্রকাশের কয়েক দিনের মধ্যে LoRA, ControlNet ও গতি বাড়ানো অ্যাডাপ্টার আসছে। Lemmy: https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
- LTX-2.5 (ওপেন-ওয়েট ভিডিও, 22B, অডিও সিঙ্ক)-এর স্থানীয় ব্যবহারের আগ্রহ — YouTube: https://www.youtube.com/watch?v=sIOC9pzHzjs
- Sora API পুরোপুরি বন্ধ (9/24) হওয়ার পর চীনা প্রতিদ্বন্দ্বীদের $3 বিলিয়ন তহবিল সংগ্রহ — Lemmy: https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next_week_while/
- MiniMax H3 ভিডিও মডেল ঘিরে টুলের দ্রুত বৃদ্ধি (দুই সপ্তাহে 5টির বেশি) — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- AI-তৈরি কনটেন্ট ঘোষণার বাধ্যবাধকতা (ওয়াটারমার্ক বিলের সমর্থন / Midjourney-বনাম-Hollywood মামলা) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/ / Lemmy: https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
- Grok Imagine 2.0 Nano Banana Pro-এর এক-পনেরো ভাগ দামে উঠে আসছে — YouTube: https://www.youtube.com/watch?v=NE2_w4_aDig
সুপারিশ
- X সংগ্রহ ধাপটি ট্রেন্ডিং শব্দের বদলে “Midjourney”, “Sora 2”, “Stable Diffusion”-এর মতো ব্রিফ-সংশ্লিষ্ট কীওয়ার্ড দিয়ে পুনরায় চালানো উচিত।
- Qwen-Image-2.1 ও LTX-2.5 প্রকাশের পরপরই দ্রুত ইকোসিস্টেম গড়ে তুলছে; পরবর্তী পর্যবেক্ষণেও এগুলোকে অগ্রাধিকার দিন।
- ঘোষণা ছাড়া AI ব্যবহারের ঘটনা কীভাবে বরখাস্ত, মামলা ও আইনি নিয়ন্ত্রণে গড়াচ্ছে, তা ধারাবাহিকভাবে অনুসরণ করুন।
- Sora প্রত্যাহারের পর Veo, Kling, Runway ও Grok Imagine-এর শক্তির সমীকরণ তুলনা নিয়মিত পর্যবেক্ষণের যোগ্য।
- Bluesky-তে কোম্পানির অফিসিয়াল যোগাযোগ প্রায় অকার্যকর; ব্যক্তিগত নির্মাতার প্রোফাইল অনুসন্ধানে সীমিত থাকাই বেশি কার্যকর।
- Pinterest প্রাথমিক তথ্যসূত্র হিসেবে দুর্বল; দ্বিতীয় স্তরের কনটেন্টের (সংবাদ সংকলন ও অ্যাফিলিয়েট কনটেন্ট) সামগ্রিক আবহ বোঝার কাজেই সীমিত রাখুন।
ডেটার মান
X পুরোপুরি ব্যর্থ (শুধু ট্রেন্ডিং শব্দ থেকে থিমবহির্ভূত পোস্ট এসেছে; পুনরায় সংগ্রহ অপরিহার্য)। YouTube-এ WebFetch YouTube মূল সাইট ব্লক করায় সার্চ স্নিপেটনির্ভর 12টি ফলেই সীমাবদ্ধ থাকতে হয়েছে এবং অধিকাংশ ক্ষেত্রে চ্যানেলের নাম ও ভিউ সংখ্যা অজানা। Reddit (12টি), Bluesky (API 403 হওয়ায় অ্যাকাউন্টভিত্তিক 20টির কম ফিড) লক্ষ্য 20-এ পৌঁছায়নি। Lemmy-তে 20টির বেশি আইটেম মিললেও বেশিরভাগই শূন্য মন্তব্যসহ রিলিজ বিজ্ঞপ্তি বট; আলোচনার তীব্রতা কম। Pinterest-এ 50টির মধ্যে মাত্র 30টি যাচাই করা হয়েছে।
প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ
Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ (Image and Video Generation AI News)
কোথায়
সংগ্রহ করা 12টি থ্রেড 9টি সাবরেডিট থেকে এসেছে।
| সাবরেডিট | সদস্যসংখ্যা | সংগৃহীত থ্রেড |
|---|---|---|
| r/mildlyinfuriating | 12,597,694 | 1 |
| r/labrats | 726,858 | 2 |
| r/WhitePeopleTwitter | 3,145,714 | 1 |
| r/generativeAI | 157,421 | 3 |
| r/DeepSeek | 141,431 | 1 |
| r/isthisAI | 423,156 | 1 |
| r/Earth199999 | 54,355 | 1 |
| r/CriticalState | 39,741 | 1 |
| r/aivideomaking | 7,823 | 1 |
জেনারেটিভ AI-কেন্দ্রিক ছোট কমিউনিটি (r/aivideomaking, r/generativeAI) থেকে শুরু করে মিম/আড্ডাভিত্তিক বিশাল সাব (r/mildlyinfuriating, r/WhitePeopleTwitter)—দুই জায়গাতেই বিষয়টি ছড়িয়েছে। সবগুলোই “Image and Video Generation AI News” সার্চ টার্ম দিয়ে পাওয়া গেছে।
মানুষ কী বলছে
- #1 r/aivideomaking・24pt・58 মন্তব্য・2026-09-20 — বিনা খরচে AI ভিডিও বানাতে চাওয়া একজনকে u/AztecWheels(2pt) উত্তর দেন: “Pinokio দিয়ে ডাউনলোড করুন, ComfyUI দিয়ে ছবি বানান, FramePack দিয়ে ভিডিও করুন। কম ক্ষমতার হার্ডওয়্যারেও 1 থেকে 120 সেকেন্ডের ভিডিও স্থানীয়ভাবে বানানো যায়।” স্থানীয় জেনারেশন ও ক্লাউড সাবস্ক্রিপশনের মধ্যে দ্বিধায় থাকা মানুষের মন্তব্য ছিল অনেক। (https://www.reddit.com/r/aivideomaking/comments/1wled0f/)
- #2 r/labrats・1,103pt・133 মন্তব্য・2026-09-23 — Nikon Small World in Motion-এর পুরস্কারজয়ী ভিডিও AI দিয়ে তৈরি/সম্পাদিত বলে ধরা পড়ে। শীর্ষ মন্তব্য u/Barkinsons(630pt): “বৈজ্ঞানিক মাইক্রোস্কোপ ছবিতে AI টুল ব্যবহারের কোনো জায়গা নেই; ছবিকে যতটা সম্ভব বিশ্বস্তভাবে পুনরুৎপাদন করা আমাদের দায়িত্ব।” (https://www.reddit.com/r/labrats/comments/1wo0j5e/)
- #4 r/labrats・416pt・90 মন্তব্য・2026-09-24 — উপরোক্ত ঘটনার পরবর্তী খবর। নির্মাতা স্বীকার করেন যে তিনি তত্ত্বাবধানহীন AI দিয়ে কাঠামো সেগমেন্ট/লেবেল করেছেন। u/Feline_Diabetes(299pt) মন্তব্য করেন: “মূল ছবির কতটা বাস্তব আর কতটা AI হ্যালুসিনেশন, তা দেখতে চাই।” Nikon পুরস্কার পুনর্বিবেচনা করছে বলেও তথ্য এসেছে। (https://www.reddit.com/r/labrats/comments/1woxdhk/)
- #3 r/generativeAI・7pt・40 মন্তব্য・2026-09-23 — “দীর্ঘ AI ভিডিও কীভাবে বানাবেন” প্রশ্নের উত্তরে u/kaboom-o(2pt) নির্দিষ্ট মডেলের নাম দেন: “মুখ দীর্ঘক্ষণ ধরে রাখতে Seedance 2.5 (সর্বোচ্চ প্রায় 30 সেকেন্ড, নেটিভ অডিও)। সস্তা মোশন ড্রাফটের জন্য Grok Imagine Video (480p, 5 সেকেন্ড)। ফটোরিয়ালিস্টিক চূড়ান্ত শটের জন্য Gemini Omni Flash।” প্রচুর ছোট ক্লিপ বানিয়ে DaVinci-তে জোড়া দেওয়াই বাস্তব কাজের মূলধারা বলে মত এসেছে। (https://www.reddit.com/r/generativeAI/comments/1wog53q/)
- #6 r/generativeAI・4pt・17 মন্তব্য・2026-09-22 — u/jmbirn(2pt): “Magnific AI (অথবা Fal, Krea)-এর মতো সেবায় সাইন আপ করলে একটি অ্যাকাউন্টেই অনেক মডেল চেষ্টা করতে পারবেন।” u/sharktank123456(2pt) জানান Dream Machine নতুন নিবন্ধন বন্ধ করেছে; পরিবর্তে Luma Agents ব্যবহার করা যায়। (https://www.reddit.com/r/generativeAI/comments/1wngj3w/)
- #8 r/generativeAI・2pt・20 মন্তব্য・2026-09-26 — বিনামূল্যের ছবি তৈরির টুল চাওয়া পোস্টে u/Scuzzy_Womack(3pt): “ইন্টারনেট ছাড়া ComfyUI ব্যবহার করলে ফ্রি।” Yodayo/MoescapeAI (প্রতি 24 ঘণ্টায় 50 ক্রেডিট), Leonardo (প্রতিদিন ফ্রি টোকেন) ইত্যাদিও সুপারিশ করা হয়েছে। (https://www.reddit.com/r/generativeAI/comments/1wqfleb/)
- #5 r/mildlyinfuriating・26,980pt・723 মন্তব্য・2026-09-21 — রিয়েল-এস্টেটের তালিকার ছবিতে AI-তৈরি “ইনস্পিরেশনাল” ইন্টেরিয়র ব্যবহার নিয়ে ক্ষোভ। পোস্টদাতা বলেন: “রেডিয়েটর সরিয়ে দেওয়ার মতো বাস্তবে পুনর্নির্মাণ অসম্ভব এমন উপস্থাপনা করা হচ্ছে।” u/BojackWorseman13(1,140pt) ওই এজেন্টের পেজে অভিযোগের ঢল নামানোর প্রস্তাব করেন; এই বিশাল সাবে প্রতিক্রিয়ার মাত্রা ছিল উল্লেখযোগ্য। (https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/)
- #7 r/WhitePeopleTwitter・585pt・64 মন্তব্য・2026-09-25 — AI-তৈরি “Lake America” সোয়েটারের ছবি ঘিরে CEO বরখাস্ত হওয়ার ঘটনা। u/samanime(294pt): “এমন বোকাদের যদি আরও জবাবদিহি করতে হতো, তবে এদের সংখ্যা কমত।” AI-তৈরি কনটেন্ট নিয়ে বিতর্ক সরাসরি কর্মসংস্থানে প্রভাব ফেলছে—এমন একটি উদাহরণ। (https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/)
- #9 r/DeepSeek・318pt・53 মন্তব্য・2026-09-21 — DeepSeek-এর DAU 1.2 কোটি থেকে 2 কোটিতে (+66.7%) বেড়েছে, অথচ কম্পিউটিং সংস্থান বেড়েছে মাত্র +8.3%; এটিই মান কমার কারণ বলে বিশ্লেষণ। 160,000 Huawei Ascend 960DT অর্ডার দিয়ে কম্পিউটিং ঘাটতি পূরণের চেষ্টা করা হচ্ছে বলেও তথ্য এসেছে। u/Equivalent-Grass-527(14pt): “চাহিদা ও কম্পিউট শক্তির অমিল সাম্প্রতিক অবনতির বড় অংশ ব্যাখ্যা করে।” (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)
- #10 r/CriticalState・1,280pt・13,849 মন্তব্য・2026-09-21 — “AI-তৈরি ছবি ও লেখায় ওয়াটারমার্ক বাধ্যতামূলক হওয়া উচিত”—এমন বিলের প্রস্তাব। মন্তব্যসংখ্যা অসাধারণ বেশি; u/Timedforfun(19pt)-সহ একাধিক উচ্চসমর্থিত মন্তব্য ভোটের মতো করে “সমর্থন✅” জানিয়েছে। বাধ্যতামূলক ওয়াটারমার্কের পক্ষে প্রবল সমর্থন দেখা যায়। (https://www.reddit.com/r/CriticalState/comments/1wmktek/)
- #12 r/isthisAI・605pt・104 মন্তব্য・2026-09-23 — কম সাবস্ক্রাইবারের একটি YouTube চ্যানেলের চিত্রাঙ্কন ভিডিও “AI নাকি বাস্তব”—তা নিয়ে বিতর্ক। u/chekhovsdickpic(444pt) ফ্রেম ধরে বিশ্লেষণ করে বলেন, “সম্পাদনা আছে, কিন্তু AI নয়”; পরে নির্মাতা নিজেই মন্তব্য করে বিষয়টি নিশ্চিত করেন। AI শনাক্তকরণ কমিউনিটির যাচাই পদ্ধতি আরও সূক্ষ্ম হচ্ছে। (https://www.reddit.com/r/isthisAI/comments/1wohq6s/)
সংকেত
- যা বাড়ছে: দীর্ঘ AI ভিডিও “একবারে তৈরি” নয়; বরং অনেক ছোট ক্লিপ (5–30 সেকেন্ড; যেমন Seedance 2.5 বা Grok Imagine Video) তৈরি করে DaVinci বা Capcut-এ সম্পাদনা ও জোড়া লাগানোর ওয়ার্কফ্লো প্রতিষ্ঠিত হচ্ছে (#3)। একই সঙ্গে “ফ্রি × উচ্চমান × ওয়াটারমার্কহীন”—তিনটিই একসঙ্গে দেওয়া টুল নেই, এমন ধারণা দৃঢ় হচ্ছে (#6-এ u/Jenna_AI-এর “দুটো বেছে নিয়ে কাঁদো” মন্তব্যটি প্রতীকী)। ফলে পছন্দ দুটি বিকল্পে সীমিত: স্থানীয়ভাবে চালানো (ComfyUI) অথবা কমদামি সাবস্ক্রিপশন (যেমন Grok $10/মাস) (#1, #8)।
- যা অবহেলিত/বিতর্কিত: “AI দিয়ে সম্পাদিত বিষয় লুকানো বা অস্পষ্ট রাখা”-র বিরুদ্ধে বিরোধিতা খুব শক্তিশালী। বিজ্ঞান প্রতিযোগিতা (#2, #4), রিয়েল-এস্টেট ছবি (#5), ও কর্পোরেট বিজ্ঞাপন (#7)—তিনটি সম্পূর্ণ ভিন্ন প্রেক্ষাপটে “ঘোষণা ছাড়া AI ব্যবহার”-এর তীব্র সমালোচনা হয়েছে। r/mildlyinfuriating-এর 26,980pt (#5) এবং r/CriticalState-এর 13,849 মন্তব্য (#10) দেখায় যে এই প্রতিক্রিয়া কেবল একটি কমিউনিটিতে সীমিত নয়; সাধারণ মানুষের মধ্যেও ছড়িয়েছে।
- অপ্রত্যাশিত বিষয়: r/labrats-এর দুই থ্রেডে (#2, #4) বিজ্ঞানী কমিউনিটির ক্ষোভ ছিল “AI কাঠামো হ্যালুসিনেট করেছে” এই প্রযুক্তিগত দিকটি নিয়ে; তবে নির্মাতার প্রতি কিছু সহানুভূতিও ছিল (মূল পোস্টদাতা স্পষ্ট করেছেন, নির্মাতাকে ঘৃণা করাই উদ্দেশ্য নয়), তাই মতভেদ রয়েছে। অন্যদিকে u/holydiver18-এর (#4, 55pt) মতো মন্তব্যে “কিছু সমালোচনা প্রাপ্যই” বলা হয়েছে। AI ব্যবহারের চেয়ে ঘোষণা ও যাচাইযোগ্যতাই আসল বিরোধের জায়গা—এটি সর্বত্র এক।
- প্ল্যাটফর্মের সরবরাহ-সীমাবদ্ধতার প্রেক্ষাপট: DeepSeek-এর দ্রুত বৃদ্ধি ও কম্পিউটিং সংস্থানের ঘাটতি (#9), ছবি/ভিডিও জেনারেশন AI-এর পেছনের ভিত্তিমডেলের চাহিদা-সরবরাহের চাপের একটি পরোক্ষ সংকেত।
সীমাবদ্ধতা
- মাত্র 12টি থ্রেড সংগ্রহ করা সম্ভব হয়েছে; ব্রিফে চাওয়া “প্রতি প্ল্যাটফর্মে প্রায় 20টি” পূরণ হয়নি। কেবল “Image and Video Generation AI News” একটি সার্চ টার্ম ব্যবহার করা হয়েছে; ক্লোজড-সোর্স (Midjourney, Sora, Veo ইত্যাদি) অথবা ওপেন-সোর্স (Stable Diffusion, Flux, HunyuanVideo ইত্যাদি)-এর নির্দিষ্ট পণ্য বা রিলিজ সংবাদ লক্ষ্য করে অতিরিক্ত অনুসন্ধান করা হয়নি।
- ফলে সংগ্রহ করা উপাদান টুল-সুপারিশ চাওয়া প্রশ্ন ও AI-তৈরি কনটেন্টবিরোধী নৈতিক প্রতিক্রিয়ার দিকে ঝুঁকে আছে; ওপেন-সোর্স বনাম ক্লোজড-সোর্স—এই দুই অক্ষে সরাসরি আলোচনাকারী থ্রেড পাওয়া যায়নি। তুলনামূলক বিশ্লেষণের জন্য অন্য প্ল্যাটফর্মের ফলের সঙ্গে একত্র করা প্রয়োজন।
- এই ধাপে কর্মী কেবল আগে থেকে সংগৃহীত
output/reddit.threads.md/.jsonপড়েছে; Reddit-এ সরাসরি প্রবেশ বা অতিরিক্ত অনুসন্ধান করেনি, প্লেবুকের নির্দেশ অনুযায়ী।
X
X — Image and Video Generation AI News
অ্যাকাউন্ট
output/x.posts.json-এ থাকা 39টি অ্যাকাউন্ট X-এ AI ছবি/ভিডিও জেনারেশন আলোচনা কে চালায় তার প্রতিচ্ছবি নয়—সীমাবদ্ধতা অংশ দেখুন। @Amateraspi0x (জঙ্গল চ্যানেল, 2টি পোস্ট, মোট 0 লাইক) ছাড়া 39টি অ্যাকাউন্টের প্রতিটি থেকে একটি করে পোস্ট এসেছে। সম্পৃক্ততার বিচারে সবচেয়ে বড় একক পোস্টগুলো এসেছে @LagunaBiotchIG (28,975 লাইক, Taylor-in-Cleveland ছবি), @_daddydisco (60,755 লাইক, একজনের মুখ “কাদায় পরিণত হচ্ছে” এমন spoken-word ক্লিপ), @NIKKE_en (5,608 লাইক, মোবাইল-গেম স্ক্রিনশট ইভেন্ট), এবং @newheightshow (11,282 লাইক, “Shoutout Cleveland!”)। এদের কেউই জেনারেটিভ AI টুল, মডেল বা শিল্প নিয়ে পোস্ট করে না—এরা ক্রীড়া/সেলিব্রিটি ভক্ত অ্যাকাউন্ট, গাচা-গেমের অফিসিয়াল অ্যাকাউন্ট, ও গিভঅ্যাওয়ে বট (@Miledge1, @CSharp66427821, @RaeWirth একই Fanatics “Quad Goals #sweepstakes” বিজ্ঞাপন দিয়েছে)।
পোস্ট
সংগৃহীত 40টি পোস্টের মধ্যে 0টিতে ছবি-জেনারেশন বা ভিডিও-জেনারেশন AI, কোনো AI মডেল বা AI টুলের উল্লেখ আছে। Midjourney, Stable Diffusion, Sora, Veo, Runway, Flux, Grok Imagine, Nano Banana বা অন্য কোনো জেনারেটিভ সিস্টেমের উল্লেখ নেই। দৃশ্য-মাধ্যমের সবচেয়ে কাছাকাছি বিষয়টি পোস্ট #4 (@vintagemapstore, 234 লাইক, 52 রিপোস্ট, প্রায় 13,000 ভিউ, 2026-09-26, https://x.com/vintagemapstore/status/2103834220624068946)—Yugoslavia ভাঙনের হাতে-তৈরি মানচিত্র অ্যানিমেশন, যেটি স্পষ্টভাবে “Work by me”, অর্থাৎ AI-বহির্ভূত হিসেবে উপস্থাপিত। বাকি সেটের কোনো কিছুই জেনারেটিভ মিডিয়ার সঙ্গে সামান্যও সম্পর্কিত নয়। এখানে কোনো অনুসন্ধান জানানো হচ্ছে না, কারণ জানানোর মতো কিছু নেই; অপ্রাসঙ্গিক পোস্টের তালিকা দিলে X এই থিমে কী বলেছে তা ভুলভাবে উপস্থাপিত হবে।
সংকেত
এই ডেটাসেটে ছবি/ভিডিও জেনারেশন AI নিয়ে কোনো সংকেত নেই—উত্থান হোক বা অন্য কিছু। তবে ডেটা কেন এমন হয়েছে তা দেখায়: কর্মীর সার্চ টার্ম (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland) ব্রিফের সঙ্গে কোনোভাবেই যুক্ত নয়; সংগ্রহের সময় X-এর নিজস্ব Explore/trending তালিকা থেকে হুবহু নেওয়া হয়েছে (দেখুন output/x.posts.json, "source": "trending")। দশটির মধ্যে আটটি “Trending in Croatia” হিসেবে চিহ্নিত; বাকি “Politics”, “Music”, “Sports”, “Gaming” ও “Motorsport”। Explore সংগ্রহ সেশনের X-এ পৌঁছানোর অবস্থানভিত্তিক; এই ক্ষেত্রে সম্ভবত Croatia। তাই এটি একটি স্থানের ট্রেন্ডিং সাইডবার, বৈশ্বিক চিত্র নয়, এবং শুরু থেকেই গবেষণা থিমের অনুসন্ধান ছিল না।
সীমাবদ্ধতা
- সংগ্রহে থিম অনুসন্ধান করা হয়নি।
output/x.posts.json-এ"query": "Image and Video Generation AI News"রেকর্ড থাকলেও"source": "trending"এবং"terms"X-এর Explore ট্রেন্ড (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland) থেকে এসেছে—যার কোনোটিই AI বা জেনারেটিভ মিডিয়ার সঙ্গে সম্পর্কিত নয়। এটি প্রকৃত কীওয়ার্ড অনুসন্ধানের বদলে একটি fallback পথ বলে মনে হয়; তাই এই ফাইল ব্রিফের উত্তর দিতে পারে না। - ফলে এই রানে X-এর জন্য থিম-সংশ্লিষ্ট অ্যাকাউন্ট, পোস্ট বা সংকেত নেই—সংগৃহীত সব 40টি পোস্টই ভিন্ন কিছু নিয়ে (সেলিব্রিটি ভক্তি, ক্রীড়া স্কোর, মোবাইল গেম, গিভঅ্যাওয়ে বিজ্ঞাপন, পুরনো মানচিত্রের অ্যানিমেশন, Formula 1 ভক্তদের বিতর্ক)।
- এটি সংশোধনের জন্য নিজে অনুসন্ধান চালানো সম্ভব হয়নি: প্লেবুক অনুযায়ী অননুমোদিত/অপ্রস্তুত পাঠে X কোনো ফল দেয় না, এবং কেবল কর্মীর প্রি-অথেনটিকেটেড সেশন পোস্ট সংগ্রহ করতে পারে। এই ধাপের জন্য বিকল্প ডেটা উৎসও নেই।
- পরেরবার ব্রিফ-সংশ্লিষ্ট স্পষ্ট সার্চ টার্ম (যেমন “Midjourney,” “Sora 2,” “Stable Diffusion,” “Runway Gen-4,” “Nano Banana,” “Veo 3,” “open-source image model,” “open weights video model”) দিয়ে X সংগ্রহ ধাপ পুনরায় চালানোর পরামর্শ দেওয়া হচ্ছে—ট্রেন্ডিং টপিক দিয়ে নয়।
YouTube
YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ (Image and Video Generation AI News)
চ্যানেল
YouTube-এ এই বিষয়টি (ছবি/ভিডিও জেনারেশন AI) নিয়মিত কভার করা বড় চ্যানেল হিসেবে সার্চে নিচেরগুলো পাওয়া গেছে:
- Matt Wolfe(@mreflow) — প্রায় 690,000–970,000 সাবস্ক্রাইবার (উৎসভেদে সংখ্যা ভিন্ন)। AI-সংক্রান্ত সামগ্রিক সংবাদ বড় প্রেক্ষাপটে সংকলনকারী প্রতিনিধিত্বশীল চ্যানেল।
- Wes Roth — প্রায় 321,000 সাবস্ক্রাইবার। প্রতিদিন সংক্ষিপ্ত AI সংবাদ ব্রিফিং ফরম্যাটে কাজ করে।
এই দুই চ্যানেলের নাম সাধারণ AI সংবাদ কভার করা প্রচলিত চ্যানেল হিসেবে বাহ্যিক নিবন্ধে (atakinteractive.com, vidiq.com) এসেছে; তবে এবারের সংগৃহীত নির্দিষ্ট ভিডিওগুলো যে এই দুই চ্যানেলের, তা নিশ্চিত করা যায়নি (নিচের Limits দেখুন)। পাওয়া বেশিরভাগ ভিডিওর চ্যানেল নাম YouTube সার্চ ফলের স্নিপেটে দেখা যায়নি।
ভিডিও
ক্লোজড-সোর্স পক্ষ:
- Grok Imagine 2.0 Just WIPED OUT Expensive Design Tools (Full Asset Workflow) — প্রায় আগস্ট 2026 — https://www.youtube.com/watch?v=jH7-krxfarU — xAI 2026 সালের 7 আগস্ট প্রকাশিত ছবি জেনারেশন মডেল “Grok Imagine 2.0” দিয়ে বিদ্যমান ব্যয়বহুল ডিজাইন টুলের পুরো ওয়ার্কফ্লো প্রতিস্থাপন করা সম্ভব—এমন দাবি।
- [Image Gen AI] Grok Imagine 2.0 Hits #2 Globally — প্রায় আগস্ট 2026 — https://www.youtube.com/watch?v=X6PChZ59LrQ — Grok Imagine 2.0 ছবি জেনারেশনের বৈশ্বিক র্যাঙ্কিংয়ে দ্বিতীয় হয়েছে বলে প্রতিবেদন।
- Grok Imagine 2 is out of control (And It's 15x Cheaper Than Nano Banana Pro) — প্রায় আগস্ট 2026 — https://www.youtube.com/watch?v=NE2_w4_aDig — Grok Imagine 2-কে Nano Banana Pro-এর সঙ্গে তুলনা করে বলা হয়েছে, এটি 15 গুণ সস্তা হলেও মান প্রতিদ্বন্দ্বী পর্যায়ের।
- BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27 মার্চ 2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — OpenAI-এর Sora 2 বন্ধ হওয়ার (অ্যাপ 26 এপ্রিল, API 24 সেপ্টেম্বর পুরোপুরি বন্ধ) প্রেক্ষাপটে বিকল্প সেবাগুলো বাস্তবে পরীক্ষা ও তুলনা করা হয়েছে। সেপ্টেম্বর নাগাদ এই বন্ধ হওয়া বাস্তব।
- Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison — প্রায় মার্চ 2026 — https://www.youtube.com/watch?v=x5fMQvhKP60 — চারটি ক্লোজড-সোর্স ভিডিও জেনারেশন মডেলের সরাসরি তুলনা। Kling দীর্ঘ ভিডিও, 4K ও মোশন ট্রান্সফারে; Veo অডিও মান ও রেফারেন্স ছবি নিয়ন্ত্রণে এগিয়ে—এভাবে উপস্থাপন করা হয়েছে।
- Midjourney V8 Is Close: Here's What We Know — 2026 — https://www.youtube.com/watch?v=aEVvqmwDVu8 — Midjourney V8 (V8.1 14 এপ্রিল প্রকাশিত)–এর পরবর্তী ধাপ সম্পর্কে জানা তথ্যের সংকলন।
ওপেন-সোর্স পক্ষ:
- Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — প্রায় 20–21 সেপ্টেম্বর 2026 — https://www.youtube.com/watch?v=3qGl0wiv2G0 — Alibaba Qwen-এর 20 সেপ্টেম্বর প্রকাশিত “Qwen-Image-2.1” (7B প্যারামিটার, টেক্সট-টু-ইমেজ জেনারেশন ও এডিটিং একত্র, স্বচ্ছ ব্যাকগ্রাউন্ড নেটিভ সমর্থন, সর্বোচ্চ 10টি রেফারেন্স ছবি কম্পোজ) নিয়ে দ্রুত রিভিউ।
- Qwen Image 2.1 best open source Image Editor. Better than Nano Banana - 10 refs transparency faster — সেপ্টেম্বর 2026 — https://www.youtube.com/watch?v=AIgYj5RG-FQ — ComfyUI ডেমোসহ Nano Banana-এর তুলনায় সুবিধা (10টি রেফারেন্স ছবি, স্বচ্ছতা, গতি) যাচাই।
- FLUX 3 Might Be the Open Source Sora 2 We Deserve — 24 জুলাই 2026 — https://www.youtube.com/watch?v=1s3zslFOSh0 — Black Forest Labs-এর FLUX পরিবার শুধু ছবি নয়, ভিডিও, অডিও ও রোবটিক্সও অন্তর্ভুক্ত করে বহুমাত্রিক “FLUX 3” মডেলে বিস্তৃত হওয়ার ধারণা উপস্থাপন।
- LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — 18 আগস্ট 2026 — https://www.youtube.com/watch?v=sIOC9pzHzjs — Lightricks-এর ওপেন-ওয়েট হিসেবে প্রকাশিত 22B প্যারামিটারের সিঙ্ক্রোনাইজড অডিওযুক্ত ভিডিও জেনারেশন মডেল “LTX-2.5” ComfyUI-তে সেটআপ ও পরীক্ষা।
- New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local) — 12 আগস্ট 2026 — https://www.youtube.com/watch?v=pA2BQw9LY8A — LTX-2.5 স্থানীয় পরিবেশে চালিয়ে জেনারেশনের গতি তুলে ধরা হয়েছে।
- Z Image Undistilled Just Dropped | Day 0 Review — নভেম্বর 2025–ফেব্রুয়ারি 2026 (প্রকাশের তারিখ অনিশ্চিত) — https://www.youtube.com/watch?v=mtk4IL-Bv28 — Apache-2.0 লাইসেন্সের হালকা ওপেন-সোর্স ছবি মডেল “Z-Image” পরিবারের Undistilled সংস্করণের Day 0 রিভিউ।
সংকেত
- ওপেন-সোর্স পক্ষের গতি শক্তিশালী: এই ধাপে পাওয়া গত 60 দিনের মধ্যে (জুলাইয়ের শেষ থেকে সেপ্টেম্বর 2026) ভিডিওগুলোর মধ্যে Grok Imagine 2.0 (ক্লোজড, আগস্ট) ছাড়া Qwen-Image-2.1 (20 সেপ্টেম্বর), FLUX 3 ধারণা (24 জুলাই), ও LTX-2.5 (12–26 আগস্ট; একাধিক চ্যানেল একই সময়ে কভার করেছে)—ওপেন-সোর্স ধারাই বেশি দৃশ্যমান। বিশেষ করে Qwen-Image-2.1 ও LTX-2.5 প্রকাশের পরপরই “Day 0 রিভিউ” ও “লোকাল সেটআপ” ভিডিও একাধিকবার এসেছে; কমিউনিটির প্রতিক্রিয়া দ্রুত।
- “Nano Banana (Google)-কে হারানো/বিকল্প হওয়া যাবে কি না”—এই ভাষা প্রচলিত হয়ে গেছে: ওপেন পক্ষের ভিডিও (#8, “Better than Nano Banana”, এবং Qwen-সংক্রান্ত আরও অনেক অনুরূপ শিরোনাম) ও ক্লোজড পক্ষের ভিডিও (#3, “15x Cheaper Than Nano Banana Pro”)—উভয়েই Nano Banana (Gemini ছবি জেনারেশন)-কে রেফারেন্স পয়েন্ট হিসেবে ব্যবহার করছে। Google-এর Nano Banana পরিবার কার্যত ক্ষেত্রটির de facto তুলনা-মানদণ্ড।
- ক্লোজড-সোর্স ভিডিও জেনারেশনের মানচিত্র “Sora প্রত্যাহার”-এ বদলাচ্ছে: Sora 2-এর অ্যাপ 26 এপ্রিল এবং API 24 সেপ্টেম্বর পুরোপুরি বন্ধ (#4)। ফলে Veo 3.1, Kling 3.0, Grok Imagine ও Runway Gen-4.5—এই চার বিকল্পের তুলনামূলক ভিডিও (#5) ক্লোজড-পক্ষের পরিচিত ফরম্যাট হয়ে উঠছে।
- অপ্রত্যাশিত বিষয়: LTX-2.5, HunyuanVideo 1.5 ইত্যাদি ওপেন-সোর্স ভিডিও মডেলের রিভিউ ছবি মডেলের রিভিউয়ের তুলনায় “ComfyUI সেটআপ পদ্ধতি”, “VRAM চাহিদা” ইত্যাদি বাস্তবমুখী বিষয়ের দিকে বেশি ঝুঁকে; কাঁচা পারফরম্যান্সের চেয়ে “নিজের PC-তে চলবে কি না”—এই আগ্রহ বেশি।
সীমাবদ্ধতা
- YouTube সার্চ ফল বা ভিডিও পৃষ্ঠা
WebFetchদিয়ে সরাসরি খুললেও কেবল cookie সম্মতি/ফুটারের টেমপ্লেট অংশ পাওয়া গেছে; প্রকৃত শিরোনাম তালিকা, চ্যানেল নাম, সাবস্ক্রাইবার, ভিউ, প্রকাশের তারিখ, বিবরণ বা মন্তব্য পাওয়া যায়নি (একাধিকবার চেষ্টা করা হয়েছে;ytInitialData-এর মতো JSON-ও পাওয়া যায়নি)। ফলে ভিডিও তথ্য সরাসরি YouTube সার্চ পৃষ্ঠা থেকে নয়, ওয়েব সার্চের স্নিপেট থেকে এসেছে। - ফলস্বরূপ প্রতিটি ভিডিওর চ্যানেল নাম, সাবস্ক্রাইবার ও নির্দিষ্ট ভিউ সংখ্যা যাচাই করা যায়নি। প্লেবুকের Videos অংশে চাওয়া শিরোনাম, চ্যানেল, তারিখ, ভিউ, লিংক ও সারাংশ—এসবের মধ্যে অধিকাংশের চ্যানেল ও ভিউ অজানা; তারিখও অনেক ক্ষেত্রে সার্চ স্নিপেট থেকে অনুমিত “প্রায়” হিসেবে দেওয়া।
- ব্রিফের সমাপ্তি-শর্ত—প্রতি প্ল্যাটফর্মে প্রায় 20টি পোস্ট/ভিডিও বিশ্লেষণ—পূরণ হয়নি। ভিডিও পৃষ্ঠার বিস্তারিত যাচাইয়ের ধাপ কাজ না করায় ওয়েব সার্চে পাওয়া শিরোনাম ও সারাংশভিত্তিক 12টিতে সীমাবদ্ধ রাখা হয়েছে।
- সেপ্টেম্বর নাগাদ Sora API বন্ধ হওয়ার খবর সরাসরি জানানো কোনো YouTube ভিডিও পাওয়া যায়নি; মার্চে প্রাথমিক ঘোষণার সময়কার ভিডিও (#4) বিকল্প হিসেবে ব্যবহার করা হয়েছে। সেপ্টেম্বরের “বন্ধ সম্পন্ন” সরাসরি জানানো ভিডিও যাচাই হয়নি।
- Channels অংশের Matt Wolfe / Wes Roth বাহ্যিক নিবন্ধ থেকে এই ঘরানার প্রতিনিধিত্বশীল চ্যানেল হিসেবে নেওয়া; এবারের নির্দিষ্ট ভিডিওগুলো (#1–12) যে এই দুই চ্যানেলের, তা নিশ্চিত নয়।
Bluesky
Bluesky — ছবি ও ভিডিও জেনারেশন AI (ক্লোজড/ওপেন-সোর্স) সংবাদ গবেষণা
অ্যাকাউন্ট
- Midjourney অফিসিয়াল @midjourneyofficial.bsky.social — ক্লোজড-সোর্স পক্ষে নিয়মিত পোস্ট করা একমাত্র অফিসিয়াল অ্যাকাউন্ট। তবে মূলত ছবি/ভিডিওর দৈনন্দিন পোস্ট ও Style Explorer ফিচার পরিচিতি; বড় “সংবাদ” পর্যায়ের ঘোষণা খুব কম।
- Stability AI @stabilityai.bsky.social — ওপেন-ওয়েট (Stable Diffusion পরিবার) পক্ষের অফিসিয়াল অ্যাকাউন্ট। সর্বশেষ পোস্ট 19 নভেম্বর 2025-এর Warner Music Group অংশীদারিত্বের ঘোষণা; এর পর আপডেট বন্ধ (সেপ্টেম্বর 2026 অনুযায়ী প্রায় 10 মাস পোস্ট নেই)।
- Black Forest Labs (FLUX নির্মাতা) @blackforestlabs.bsky.social — হ্যান্ডেল সংরক্ষিত থাকলেও পোস্ট শূন্য; কার্যত পরিত্যক্ত।
- ComfyUI অফিসিয়াল-ধরনের অ্যাকাউন্ট (real-comfyui.bsky.social / comfy-ui.bsky.social) — উভয়েরই পোস্ট শূন্য। ComfyUI কমিউনিটি Bluesky-তে আনুষ্ঠানিক প্রচার চালায় না।
- Civitai আপডেট Bot @civitai-bot.bsky.social (পরিচিতি “CivitaiCheckPoint আপডেট BOT”, জাপানি পরিচালনা) — Civitai-এ আপলোড হওয়া চেকপয়েন্ট আপডেট স্বয়ংক্রিয়ভাবে জানায়। যাচাই করা সর্বশেষ পোস্ট 9 মে 2024; এরপর আর আপডেট আসেনি, অর্থাৎ Bluesky স্বয়ংক্রিয় সংযোগ বন্ধ থাকার সম্ভাবনা।
- Kling AI অফিসিয়াল @klingai.bsky.social — হ্যান্ডেল আছে, কিন্তু পোস্ট নেই।
- OpenAI, Google DeepMind ও Adobe Firefly-এর অফিসিয়াল প্রাথমিক অ্যাকাউন্ট পাওয়া যায়নি; সার্চে দেখা যায় অননুমোদিত মিরর/Bot (যেমন
openai-m.extwitter.link,googledeepmind.zpravobot.news.ap.brid.gy) অথবা কোম্পানির দূত/বর্তমান কর্মীদের ব্যক্তিগত অ্যাকাউন্ট।- Stability AI-সম্পর্কিত গবেষক: @markboss.bsky.social (Co-Head of Visual Research), @drscotthawley.bsky.social (সাবেক Stability AI)
- Google DeepMind-সম্পর্কিত: @tkipf.bsky.social (প্রোফাইলে “Veo Capabilities” উল্লেখ), @jascha.sohldickstein.com (ডিফিউশন মডেলের প্রস্তাবক; DeepMind থেকে Anthropic-এ গেছেন বলে উল্লেখ)
- ব্যক্তিগত নির্মাতা (ওপেন-সোর্স পক্ষের বাস্তব ব্যবহার যাচাই করা অ্যাকাউন্ট):
- @you32081.bsky.social — Qwen-Image, Z-Image-Turbo দিয়ে তৈরি কাজ পোস্ট করেন
- @andyt79.bsky.social — প্রোফাইলে “LTX-2 Qwen Image” ব্যবহার উল্লেখ; Midjourney প্রম্পট-শেয়ারিং উদ্যোগ (#QP)-তেও অংশ নেন
- @generate-cmyxt.bsky.social — ComfyUI, Qwen Image Edit, Wan Video ও BindWeave ওয়ার্কফ্লো ব্যাখ্যার ঘোষণা (X সংযোগ)
পোস্ট
- Midjourney “Happy Friday!” ভিডিও পোস্ট — 2025-08-22, 64 লাইক / 4 রিপোস্ট / 3 রিপ্লাই। যাচাই করা Midjourney পোস্টগুলোর মধ্যে সবচেয়ে বেশি প্রতিক্রিয়া পাওয়া পোস্ট, তবে ফিচার সংবাদ নয়—দৈনন্দিন সম্পৃক্ততা পোস্ট।
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwz7idyu4k27 - Midjourney Style Explorer সম্প্রসারণ ঘোষণা — 2025-09-10, 10 লাইক / 1 রিপোস্ট / 1 quote। “ভিডিও ও ছবির Explore পৃষ্ঠার মতো Style-ও খোঁজা যাবে”—নতুন ফিচার পরিচিতি।
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lyj6kbu47k2c - Midjourney Style Explorer-এ স্টাইলের সংখ্যা কয়েক গুণ বাড়ানোর ঘোষণা — 2025-09-18, 10 লাইক / 2 রিপোস্ট / 1 quote। fuzzy style search ফিচার যোগের কথাও বলা হয়েছে।
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c - Midjourney “Time for some chaos?” ভিডিও — 2025-10-08, 12 লাইক / 1 রিপোস্ট / 1 বুকমার্ক। যাচাইকৃত মধ্যে এটি সর্বশেষ পোস্ট; প্রায় এক বছর ধরে এখানেই আপডেট বন্ধ।
https://bsky.app/profile/midjourneyofficial.bsky.social/post/3m2ndua75gc26 - “Odin's Chariot does not exist” ব্যবহারকারী পোস্টে Midjourney অফিসিয়ালের প্রতিক্রিয়া — মূল পোস্ট 2025-09-04, bot @ttaships.airminded.org-এর স্বয়ংক্রিয় শিল্প-পোস্ট; 20 লাইক / 2 রিপোস্ট। Midjourney অফিসিয়াল রিপ্লাই দিয়েছে; কমিউনিটি বটের সঙ্গে এমন যোগাযোগই অফিসিয়াল অ্যাকাউন্টের প্রধান কর্মকাণ্ড বলে দেখা যায়।
https://bsky.app/profile/ttaships.airminded.org/post/3lxzwpuriuf2y - Stability AI × Warner Music Group অংশীদারিত্ব ঘোষণা — 2025-11-19, “ethically trained models” ব্যবহার করে সংগীত নির্মাণ টুল যৌথভাবে তৈরির ঘোষণা। কিন্তু প্রতিক্রিয়া মাত্র 1 লাইক / 2 রিপ্লাই / 0 রিপোস্ট। ওপেন-সোর্সের বড় নাম Stability AI-এর অংশীদারিত্ব সংবাদও Bluesky-তে প্রায় প্রতিক্রিয়াহীন ছিল।
https://bsky.app/profile/stabilityai.bsky.social/post/3m5ynoibe3s2k - Civitai আপডেট Bot “Carrot Caramel Batake updated” — 2024-05-09, SD1.5-ভিত্তিক চেকপয়েন্ট আপডেট বিজ্ঞপ্তি, 3 লাইক (porn label-সহ)।
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24 - Civitai আপডেট Bot “AnimeMixV2 updated” — 2024-05-09, SD1.5-ভিত্তিক, 2 লাইক। এই দুটি বর্তমানে যাচাই করা Bot-এর সর্বশেষ পোস্ট; মে 2024-এর পর Bluesky-তে স্বয়ংক্রিয় আপডেট কার্যত বন্ধ।
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nn7lydr2y - ব্যক্তিগত নির্মাতার প্রোফাইলে ওপেন-ওয়েটের সাম্প্রতিক শক্তির চিত্র — @you32081.bsky.social Qwen-Image ও Z-Image-Turbo উল্লেখ করেছেন; @andyt79.bsky.social LTX-2 ও Qwen Image উল্লেখ করেছেন; @generate-cmyxt.bsky.social ComfyUI + Qwen Image Edit + Wan Video + BindWeave ওয়ার্কফ্লো ব্যাখ্যার ঘোষণা দিয়েছেন। পৃথক পোস্টের প্রতিক্রিয়া-সংখ্যা যাচাই করা হয়নি, কিন্তু 2026 সালে Bluesky-এর ব্যক্তিগত ব্যবহারকারীরা যে ওপেন-ওয়েট মডেলগুলো ব্যবহার করছেন তার স্পষ্ট প্রমাণ পাওয়া গেছে।
- Black Forest Labs অফিসিয়াল অ্যাকাউন্টে পোস্ট শূন্য — FLUX পরিবারের (ওপেন-ওয়েট ছবি জেনারেশনের শীর্ষ পর্যায়ের একটি) নির্মাতা প্রতিষ্ঠানের Bluesky অ্যাকাউন্ট আছে, কিন্তু একটি পোস্টও নেই। ওপেন-সোর্স ফ্রন্টলাইনের যোগাযোগ সম্ভবত Bluesky-এর বাইরে X/GitHub/Discord ইত্যাদিতে কেন্দ্রীভূত।
https://bsky.app/profile/blackforestlabs.bsky.social
সংকেত
- ক্লোজড-সোর্সের Bluesky যোগাযোগ অত্যন্ত দুর্বল। OpenAI, Google DeepMind, Adobe Firefly, Runway, Kling AI ও Ideogram—কোনোটিরই যাচাই করা সীমার মধ্যে কার্যকর অফিসিয়াল প্রাথমিক অ্যাকাউন্ট নেই; কেবল মিরর/Bot অথবা খালি অ্যাকাউন্ট। একমাত্র নিয়মিত পোস্ট করা Midjourney অফিসিয়ালের সর্বশেষ পোস্টও অক্টোবর 2025-এর, প্রায় এক বছর আগের।
- ওপেন-সোর্স পক্ষেও অফিসিয়াল যোগাযোগ স্থবির। Stability AI-এর বড় অংশীদারিত্ব সংবাদ (Warner Music Group) মাত্র 1টি লাইক পেয়েছে। Black Forest Labs ও ComfyUI-র অফিসিয়ালধর্মী অ্যাকাউন্টে পোস্ট নেই। Civitai আপডেট Bot-ও মে 2024-এ থেমে গেছে।
- আসল আলোচনার তাপমাত্রা ব্যক্তিগত নির্মাতাদের বায়ো/পোস্টে ধরা পড়ে। Qwen-Image, Qwen-Image-Edit, Z-Image-Turbo, Wan Video/WanAnimate, LTX-2, BindWeave-এর মতো সাম্প্রতিক ওপেন-ওয়েট ছবি ও ভিডিও মডেল একাধিক ব্যক্তিগত প্রোফাইলে বাস্তব ব্যবহারের টুল হিসেবে উল্লেখিত। Bluesky-তে এটি সংবাদ হিসেবে প্রচারের চেয়ে মানুষের নীরবে ব্যবহারের প্রমাণ বেশি।
- সামগ্রিকভাবে Bluesky, X-এর মতো ছবি/ভিডিও জেনারেশন AI শিল্পের প্রাথমিক তথ্যপ্রচারের স্থান নয়। কোম্পানির অফিসিয়াল উপস্থিতি ন্যূনতম; সক্রিয় মূলত ব্যক্তিগত AI শিল্প কমিউনিটি—কাজ ভাগাভাগি, প্রম্পট শেয়ারিং প্রকল্প #QP, জাপানি AI ইলাস্ট্রেশন পোস্টার ও Civitai-সংশ্লিষ্ট ডোজিন কমিউনিটি।
সীমাবদ্ধতা
- Bluesky-এর পূর্ণ-পাঠ অনুসন্ধান API (
app.bsky.feed.searchPosts) এই সেশনের WebFetch-এ সব সময়HTTP 403 Forbiddenফেরত দিয়েছে। ফলে “Stable Diffusion”, “Midjourney” ইত্যাদি কীওয়ার্ডে পূর্ণ-পাঠ অনুসন্ধান বা গণনা সম্ভব হয়নি; পরিবর্তেapp.bsky.actor.searchActors(অ্যাকাউন্ট অনুসন্ধান) ওapp.bsky.feed.getAuthorFeed(নির্দিষ্ট অ্যাকাউন্টের পোস্ট ইতিহাস) মিলিয়ে গবেষণা করা হয়েছে। তাই হ্যাশট্যাগ বা বিষয়ভিত্তিক পূর্ণাঙ্গ “20টি” সংগ্রহ করা হয়নি; চিহ্নিত প্রধান অ্যাকাউন্টের পোস্ট ইতিহাসভিত্তিক গবেষণাই হয়েছে। - গবেষণার সময় WebFetch-কে “কাঁচা JSON হুবহু ফেরত দাও” না বললে একবার বাস্তব API প্রতিক্রিয়ার ভিন্ন কাঠামোর সারাংশ (অস্তিত্বহীন
data.sample_accountsইত্যাদি ফিল্ডসহ) ফিরে এসেছিল। এরপর প্রতিবার “verbatim, no summarization” বলে কাঁচা JSON নেওয়া হয়েছে; ওই একবারের ফল এই প্রতিবেদনে একেবারেই ব্যবহার করা হয়নি। - Runway, Luma AI, Pika, Hailuo, Ideogram, Leonardo AI, Adobe Firefly, OpenAI (DALL-E/Sora), Google DeepMind (Veo/Nano Banana)-এর জন্য অ্যাকাউন্ট অনুসন্ধানে অফিসিয়াল প্রাথমিক অ্যাকাউন্ট শনাক্ত করা যায়নি; যা পাওয়া গেছে সেগুলো অননুমোদিত মিরর, দূত/কর্মীর ব্যক্তিগত অ্যাকাউন্ট বা অপ্রাসঙ্গিক অ্যাকাউন্ট। তাই “Bluesky-তে প্রাথমিক তথ্যপ্রচার প্রায় নেই”—এই সত্যটিই ফলাফল হিসেবে জানানো হয়েছে।
- getAuthorFeed-এ প্রতিটি অ্যাকাউন্টে সর্বোচ্চ 20টি পোস্ট নেওয়া হয়েছে (পেজিনেশন করা হয়নি)। এই সীমার মধ্যে বড় নতুন মডেল ঘোষণা না থাকলেই যে Bluesky-তে একেবারেই নেই, তা নিশ্চিতভাবে বলা যায় না।
Lemmy
Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা
কমিউনিটি
- !«メールアドレス» — স্থানীয় সাবস্ক্রাইবার 1,230 / ফেডারেশনজুড়ে 5,710। দৈনিক সক্রিয় 3, সাপ্তাহিক 20, মাসিক 67—ছোট কমিউনিটি; কিন্তু Hugging Face / GitHub-এর নতুন মডেল, LoRA ও টুল বট দিয়ে স্বয়ংক্রিয় পোস্ট করে, তাই ওপেন-সোর্স ছবি/ভিডিও জেনারেশনের সবচেয়ে ঘন প্রাথমিক তথ্যসূত্র।
- !«メールアドレス» — একই ইনস্ট্যান্সে কাজ ভাগাভাগির কমিউনিটি। সংবাদ নয়; প্রতিদিন কয়েকটি করে SDXL/Flux AI শিল্পকর্ম পোস্ট হয়, তাই প্রবণতা বিশ্লেষণের জন্য উপযোগী নয়।
- !«メールアドレス» — Lemmy-তে সবচেয়ে বড় AI ছবি কমিউনিটিগুলোর একটি, 8,531 সাবস্ক্রাইবার; কিন্তু স্কোরে অনেক নেতিবাচক মান, ভিউ ও আলোচনা দুটোই কম।
- !«メールアドレス» — সাধারণ প্রযুক্তি সংবাদ কমিউনিটি। Midjourney-এর মামলা-সংক্রান্ত খবরের মতো ক্লোজড-সোর্স বিষয় এখানে আসে।
- !ai_reddit (Lemmy-র Reddit ক্রসপোস্ট কমিউনিটি) — r/ArtificialIntelligence-এর পোস্ট Lemmy-তে পুনঃপ্রকাশ করে; Sora API বন্ধের মতো খবর এই পথে পাওয়া গেছে।
- !«メールアドレス» — বিকেন্দ্রীভূত, বিনামূল্যের Stable Diffusion জেনারেশন সেবা “AI Horde”-এর ঘোষণা কমিউনিটি; ওপেন-সোর্স জোটধর্মী বিষয়।
পোস্ট
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing — !«メールアドレス», 2026-09-22, স্কোর 13
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Alibaba-এর Qwen-Image-2.1 ComfyUI-তে আনুষ্ঠানিক সমর্থন পেয়েছে। স্বচ্ছ আউটপুটসমর্থিত এডিটিং ফিচারসহ ওপেন-ওয়েট মডেল হিসেবে পরিচিত। -
Kijai/QwenImage_experimental — Qwen Image 2.1 Fun_controlnet_union — !«メールアドレス», 2026-09-26, স্কোর 1
https://huggingface.co/Kijai/QwenImage_experimental/tree/main/model_patches
পরিচিত ডেভেলপার Kijai-এর Qwen-Image-2.1-এর জন্য ControlNet সংযুক্ত মডেল প্যাচ। -
PrunaAI/Pruna-Qwen-Image-2.1 — Few-step LoRA adapters — !«メールアドレス», 2026-09-26, স্কোর 1
https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
Qwen-Image-2.1-এর জেনারেশন ধাপ কমানোর জন্য গতি বাড়ানো LoRA। -
Cierpliwy/krea2-inpaint-edit — LoRAs for Krea-2-Raw এবং lvladikov/Krea2-Turbo-Distill-2step-LoRA — !«メールアドレス», 2026-09-26 / 2026-09-13–16, স্কোর 0–2
https://huggingface.co/Cierpliwy/krea2-inpaint-edit ・ https://huggingface.co/lvladikov/Krea2-Turbo-Distill-2step-LoRA
Black Forest Labs পরিবারের “Krea 2” মডেলের জন্য ইনপেইন্ট এডিটিং LoRA এবং দুই ধাপে ডিস্টিল করা দ্রুততর LoRA একের পর এক পোস্ট হয়েছে। -
SupraLabs/Supra2-IMG — tiny 100M parameters text-to-image model — !«メールアドレス», 2026-09-22, স্কোর 8
https://huggingface.co/SupraLabs/Supra2-IMG
মাত্র 100M প্যারামিটারের অত্যন্ত হালকা text-to-image মডেল। স্থানীয় ও কম ক্ষমতার পরিবেশের দিকে প্রবণতার একটি উদাহরণ। -
MiniMax H3-সম্পর্কিত টুলের দ্রুত বৃদ্ধি (ComfyUI-Fizgig-H3-Tweaks / ComfyUI_MinimaxH3_AutoContext / 3d-Camera-control-H3-Minimax / MiniMax-H3-Image-Training-Adapter / TaoMate-H3-3Step-ComfyUI) — !«メールアドレス», 2026-09-12–09-26, স্কোর 1–5
উদাহরণ: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext (দীর্ঘ ভিডিও জেনারেশনের জন্য) ・ https://github.com/NyckM/3d-Camera-control-H3-Minimax (3D ক্যামেরা নিয়ন্ত্রণ)
ওপেন-ওয়েট ভিডিও মডেল “MiniMax H3”-কে কেন্দ্র করে ComfyUI এক্সটেনশন নোড দুই সপ্তাহে 5টির বেশি পোস্ট হয়েছে; পারিপার্শ্বিক ইকোসিস্টেম দ্রুত গড়ে উঠছে। -
g3n3rativ3/wan2gp-h3-latent-continue — !«メールアドレス», 2026-09-16, স্কোর 1
https://github.com/g3n3rativ3/wan2gp-h3-latent-continue
Alibaba-সম্পর্কিত ভিডিও জেনারেশন GUI “Wan2GP”-তে latent থেকে ভিডিও চালিয়ে যাওয়ার ফিচার যোগ করে। -
The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation! — !«メールアドレス» / !aihorde, 2026-09-19, স্কোর 8 / -2
https://haidra.net/an-image-generation-studio-and-documentation-on-aihorde-net/
সবাই কম্পিউটিং সংস্থান ভাগাভাগি করে বিনা খরচে Stable Diffusion-ধারার ছবি বানাতে পারে এমন বিকেন্দ্রীভূত সেবা “AI Horde” ফ্রন্টএন্ড, ব্যাকএন্ড ও ডকুমেন্টেশন নবায়ন করেছে। -
OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, 2026-09-20, স্কোর 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next_week_while/
OpenAI-এর ভিডিও জেনারেশন AI “Sora” API সেবা বন্ধ করছে, আর চীনা প্রতিদ্বন্দ্বী $3 বিলিয়ন তুলেছে—এমন পোস্ট। ক্লোজড-সোর্স ভিডিও জেনারেশনের শক্তির সমীকরণ বদলানোর ইঙ্গিত। -
OpenAI's Identity Crisis(The Atlantic) — !theatlantic, 2026-03-26, স্কোর 2
https://www.theatlantic.com/technology/2026/03/sora-openai-identity-crisis/686544/
Sora বন্ধ হওয়ার পটভূমিতে রাজস্বের সন্ধানে ফিচার ও ব্যবসা-মডেল বারবার বদলানোর কারণে OpenAI-এর দিশাহীনতা তুলে ধরা হয়েছে। উচ্চ কম্পিউটিং খরচকে প্রত্যাহারের প্রধান কারণ হিসেবে বিশ্লেষণ করা হয়েছে। -
Midjourney Wants Hollywood Studios to Reveal AI Usage Details(TechCrunch) — !«メールアドレス», 2026-07-05, স্কোর 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
Disney, Universal ও Warner Bros.-এর সঙ্গে কপিরাইট মামলায় Midjourney স্টুডিওগুলোর AI ব্যবহারের বাস্তবতা—অভ্যন্তরীণ AI প্রশিক্ষণ ও প্রম্পট ব্যবহারসহ—সম্পূর্ণ প্রকাশের দাবি করেছে। ক্লোজড-সোর্স বড় প্রতিষ্ঠানের মধ্যে কপিরাইট লড়াই তীব্র হচ্ছে।
সংকেত
- Lemmy-তে ওপেন-সোর্স ছবি ও ভিডিও জেনারেশন AI আলোচনা প্রায় পুরোপুরি !«メールアドレス» একটি কমিউনিটিতে কেন্দ্রীভূত। অধিকাংশই মানুষের আলোচনা নয়; Hugging Face/GitHub-এর নতুন রিলিজ স্বয়ংক্রিয়ভাবে পুনঃপ্রকাশ করা বট পোস্ট (মন্তব্য প্রায় শূন্য)। তাই এটি “সংবাদ”-এর চেয়ে “রিলিজ ফিড”-এর কাছাকাছি।
- কেবল গত দুই সপ্তাহে (2026-09-12–09-26) Qwen-Image-2.1, Krea 2, MiniMax H3 ও Wan2GP—চারটি স্বতন্ত্র ওপেন-ওয়েট পরিবার নিজ নিজ পার্শ্বটুল (LoRA, ComfyUI নোড, গতি বাড়ানো অ্যাডাপ্টার) নিয়ে একসঙ্গে আপডেট হয়েছে। উন্নয়নের গতিতে ওপেন-সোর্স পক্ষ ক্লোজড-সোর্স আলোচনার পরিমাণ ছাড়িয়েছে।
- Lemmy-তে ক্লোজড-সোর্সের আলোচনা প্রযুক্তি কমিউনিটির চেয়ে “সংবাদ/মামলা/ব্যবস্থাপনা”—Sora API বন্ধ, Midjourney-বনাম-Hollywood মামলা—এই প্রেক্ষাপটে বেশি হয়; তৈরি ফলের মান নিয়ে আলোচনা খুব কম।
- পোস্টগুলোর স্কোর ও মন্তব্য প্রায় সবই এক অঙ্ক থেকে দশকের ঘরে; Reddit/X-এর তুলনায় Lemmy-র সামগ্রিক আলোচনার তীব্রতাই কম।
সীমাবদ্ধতা
- Lemmy-র ব্যবহারকারী ও পোস্ট দুটোই কম; প্রতি প্ল্যাটফর্মে প্রায় 20টি স্বাধীন “আলোচনা” পাওয়ার শর্ত পূরণের মতো উপাদান মেলেনি। বাস্তবে 20টির বেশি পোস্ট দেখা হলেও বেশিরভাগই শূন্য মন্তব্যের রিলিজ-বিজ্ঞপ্তি বট, সক্রিয় কথোপকথন নয়।
- “Nano Banana”, “Midjourney v7”, “Gemini ছবি জেনারেশন”, “Flux 2”-এর মতো ক্লোজড-সোর্সের সাম্প্রতিক নির্দিষ্ট মডেল-আলোচনা Lemmy অনুসন্ধান ও সংশ্লিষ্ট কমিউনিটিজুড়ে খোঁজা হলেও পাওয়া যায়নি; ফলগুলো সাধারণ প্রযুক্তি নিবন্ধ বা অপ্রাসঙ্গিক পোস্টে চাপা পড়েছে।
- Alibaba “Wan 2.1” ওপেন-সোর্স ভিডিও মডেল নিয়ে AI পর্ন ব্যবহারের সমস্যা সম্পর্কিত একটি নিবন্ধ পাওয়া গিয়েছিল, কিন্তু পোস্ট ও নিবন্ধ দুটোই মার্চ 2025-এর; ব্রিফের চাওয়া সেপ্টেম্বর 2026-এর সাম্প্রতিক প্রবণতার বাইরে হওয়ায় অন্তর্ভুক্ত করা হয়নি।
- lemmy.world অনুসন্ধান API কিছু কুয়েরিতে বারবার 500 ত্রুটি দিয়েছে (যেমন
stablediffusionকমিউনিটির সরাসরি অনুরোধ, নির্দিষ্ট পোস্ট পুনরুদ্ধার), ফলে কিছু পৃষ্ঠা পাওয়া যায়নি।
Pinterest — Image and Video Generation AI News
সংগ্রহ করা 50টি পিনের মধ্যে 30টি ছবি হিসেবে খোলা ও পড়া হয়েছে ( output/pinterest.pins.md-এর টেবিল একটি সমতল তালিকা, ঘরানাভিত্তিক ভাগ নয়; তাই ঘরানা ধরে নয়, এক দফায় পর্যালোচনা হয়েছে)।
দৃশ্যগত ধারা
- YouTube থাম্বনেইলধর্মী “AI NEWS” সংকলন, Pinterest-এ পুনঃপোস্ট। চমকিত মুখভঙ্গির উপস্থাপক, পাশে উজ্জ্বল বিক্রেতা-লোগোর সারি—OpenAI, Google, Microsoft, Anthropic-এর ঘূর্ণি, Meta-এর infinity, Notion-এর N।
[1, 20] - ঘন “জানার মতো X আপডেট” ইনফোগ্রাফিক। একাধিক খবর এক কার্ডে: GPT-6 Astra, Gmail/Docs/Slides-জুড়ে Gemini-এর “agentic” হওয়া, Adobe Premiere-এর টাইমলাইনে জেনারেটিভ ভিডিও/সাউন্ড, Cognition-এর $2B Series E; আরেকটিতে Google I/O 2026 (Gemini 3.5 Flash, Gemini Omni, সার্চের জায়গায় AI Overviews, Android XR চশমা)।
[22, 35] - “Top N AI video generator” তালিকাধর্মী কনটেন্ট, প্রায় সবসময় একই তালিকা—Kling AI, Runway, Pika, Luma Dream Machine, HeyGen, Hailuo AI, Google Veo, OpenAI Sora, Synthesia, D-ID—SEO/অ্যাফিলিয়েট ব্লগের জন্য ফোন-স্ক্রিন বা পোস্টার গ্রাফিকে সাজানো।
[27, 47, 49] - মানবাকৃতির রোবটের হিরো আর্ট, টুল-প্রমোশন পিনে সাধারণ সাজসজ্জা হিসেবে: Chrome রোবট হাত OpenAI লোগো ধরে আছে, মনিটরে কমলা-কাচের অ্যান্ড্রয়েড, অর্ধেক মানব/অর্ধেক সার্কিটের সাইবর্গ নারী।
[16, 21, 41] - ডিপফেক/ভুলতথ্যের আশঙ্কার ছবি: বরফে দাঁড়ানো ভুয়া সংবাদদাতার NBC News-ব্র্যান্ডেড “AI GENERATED” ক্লিপ; “Human Journalism vs. Machine-Generated Media” স্প্লিট-স্ক্রিন গ্রাফিক; AI-বিড়ালের ছবির পাশে জাল এনগেজমেন্ট সংখ্যা ও “FAKE” লেখা রোবট; ফোন-আসক্ত জম্বিদের পুতুলনাচ করানো “AI” লেখা দানব; 9/11 ছবির পটভূমিতে ককপিটে থাম্বস-আপ দেওয়া Trump-এর কৃত্রিম ছবি।
[4, 19, 26, 30, 44] - স্টাইল-সামঞ্জস্য প্রযুক্তি ডেমো: একই ব্যক্তিকে ও গাড়িকে একটি উৎস ভিডিও থেকে কাঠের ব্লক, অরিগামি, Lego brick ও ফুলে-ঢাকা সংস্করণে পাঁচভাবে পুনরায় রেন্ডার করা ভিডিও; ভিডিও মডেলের ওয়াটারমার্কসহ, এক উৎস ক্লিপ থেকে বহু-স্টাইল রূপান্তর দেখায়।
[2] - ছোট ব্যবসার AI ভিডিও সেবা বিজ্ঞাপন: ফ্রিল্যান্সার/এজেন্সির WhatsApp-যোগাযোগ গ্রাফিক, যেখানে “AI Video Generation from Gemini” বা “Professional AI Video Creation” অফার করা হচ্ছে—সংবাদ জানানোর চেয়ে ট্রেন্ড অনুসরণ করা।
[9, 24, 37] - AI কনটেন্ট ছাড়াই সাধারণ কর্পোরেট স্টক ফটোগ্রাফি, যদিও শিরোনাম AI-ঘেঁষা—ল্যাপটপ দেখছে অফিস টিম, জ্বলজ্বলে স্মৃতি-দেয়ালে কম্পোজ করা বাবা ও ছেলে, “Amuse 3.0” (AMD-এর স্থানীয় ছবি জেনারেটর, শুধু ছোট লোগোতে শনাক্তযোগ্য)-এর পুরোনো জেলের প্রতিকৃতি বিজ্ঞাপন।
[13, 28, 40, 45]
উল্লেখযোগ্য পিন
- [1] “AI News: Anthropic Leak Shows Us The Future of AI...” — OpenAI/Google/Microsoft/Anthropic-কে একত্র করা সাধারণ উপস্থাপক-থাম্বনেইল ফরম্যাট; শিরোনামে Anthropic leak-এর প্রতিশ্রুতি থাকলেও ছবিতে কোনো নির্দিষ্ট তথ্য নেই।
- [2] “Just Nail It 🎥” — একজন ব্যক্তি ও গাড়ির উৎস ভিডিওকে কাঠের ব্লক, অরিগামি, Lego ও ফুলের স্টাইলে রূপান্তর করা 3×5 গ্রিড; “Lumiere” নামের ভিডিও মডেলের ওয়াটারমার্কসহ, সেটে সবচেয়ে পরিষ্কার বাস্তব পণ্য ডেমো।
- [10] “Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API” — ক্লোজড-সোর্স (Google); গতি ও নেটিভ অডিওকে পার্থক্যকারী বৈশিষ্ট্য হিসেবে তুলে ধরা।
- [14] “Kling.ai AI-Powered Text-to-Video Generation” — ক্লোজড-সোর্স চীনা টুল (Kuaishou), পশ্চিমা টুলগুলোর পাশাপাশি “top pick” হিসেবে উপস্থাপিত।
- [15] “ByteDance and Hollywood reach global deal on AI copyright” — ByteDance/MPA চুক্তিতে ByteDance-এর AI ছবি/ভিডিও টুলে IP সুরক্ষা শক্তিশালী করা হবে; সেটের বিরল আইনি/নীতিগত সংবাদ।
- [23] “Google's Gemini Omni Turns Anything Into Video” — Google-এর Omni মডেল ঘোষণার এজেন্সি (Osiz Technologies) পুনঃপোস্ট।
- [30] “AI news videos blur line between real and fake reports” — বরফে দাঁড়ানো বানানো সংবাদদাতার NBC News-লেবেলযুক্ত “AI GENERATED” ক্লিপ; আস্থার সমস্যাটি সরাসরি দেখাতে ব্যবহৃত।
- [34] “Google Makes AI Watermarks Optional for Images and...” — শিরোনাম Google-এর SynthID/ওয়াটারমার্কের শর্ত শিথিল করার ইঙ্গিত দেয়।
- [35] “4 Major AI Updates You Need to Know in 2026” — GPT-6 Astra, Gemini-এর agentic অগ্রগতি, Adobe Premiere টাইমলাইনে জেনারেটিভ মিডিয়া ও Cognition-এর $48B মূল্যায়নে $2B তহবিল সংগ্রহ—এক ইনফোগ্রাফিকে।
- [43] “Stability AI's Stable Diffusions Maker Can Now Build AI Generative Video” — ওপেন-ওয়েট ধারার নাম নির্দিষ্ট করে বলা একমাত্র পিন (Stability AI), তাও মডেল বা কৌশল নয়, ব্র্যান্ড হিসেবে।
সংকেত
- বর্তমানে Pinterest-এ এই থিমের সরবরাহ মূলত দ্বিতীয় স্তরের সংকলন—YouTube থাম্বনেইলধর্মী সংবাদ সারাংশ, একই প্রায় 12টি ভিডিও টুলের অ্যাফিলিয়েট র্যাঙ্কিং তালিকা, ও ব্যাখ্যামূলক ইনফোগ্রাফিক—প্রাথমিক ঘোষণা বা হাতে-কলমে জেনারেশনের চেয়ে বেশি। প্রতিটি পড়া তালিকায় চীনা ক্লোজড-সোর্স টুল (Kling, Hailuo) পশ্চিমা টুলের (Veo, Sora, Runway) সমমর্যাদায় আছে। ডিপফেক/ভুলতথ্যের আশঙ্কা নিজস্ব পুনরাবৃত্ত দৃশ্যধারা—ভুয়া সংবাদ উপস্থাপক, বানানো রাজনৈতিক ছবি, “human vs. machine” সাংবাদিকতা গ্রাফিক—এবং টুলের চেয়ে এটিই সম্ভবত সম্পৃক্ততার আবেগীয় চালক।
- অনুপস্থিত বিষয়: Pinterest সাধারণত মুডবোর্ড ও সৃজনশীলতার প্ল্যাটফর্ম হলেও কোনো পিনেই বাস্তব ওপেন-সোর্স ওয়ার্কফ্লো নেই—ComfyUI স্ক্রিনশট, LoRA/ফাইন-টিউনিং কনটেন্ট, Flux, SDXL, HunyuanVideo অথবা Wan-এর উল্লেখ, কিংবা শিল্পী-কমিউনিটির নান্দনিক বোর্ড নেই। কেবল একটি পিন (
[43]) ওপেন-সোর্স ধারা উল্লেখ করেছে, তাও মডেল বা কৌশল নয়, Stability AI ব্র্যান্ড হিসেবে। শিরোনাম[1]-এ Anthropic-এর নাম থাকলেও তার নিজস্ব ছবি/ভিডিও কাজ দেখানো হয়নি। “AI ভিডিও সেবা” দেওয়া ছোট ব্যবসা/ফ্রিল্যান্সারের বিজ্ঞাপন প্রকৃত পণ্য-সংবাদের চেয়েও বেশি।
সীমাবদ্ধতা
- 50টি সংগৃহীত পিনের মধ্যে 30টি (60%) পড়া হয়েছে; সময়ের কারণে বাকি 20টি খোলা হয়নি, তাই কিছু উল্লেখযোগ্য পিন কম প্রতিনিধিত্ব পেতে পারে।
- পিন টেবিলে ঘরানা ভাগ নেই (একটি সার্চের অধীনে এক সমতল তালিকা), তাই প্লেবুক অনুমোদিত হলেও এই সারাংশ ঘরানাভিত্তিক ভাগ করা যায়নি।
- 50টির মধ্যে 12টির শিরোনাম নেই (“(untitled)”); কয়েকটি আসলে সাধারণ স্টক ফটোগ্রাফি, যেখানে AI কেবল আনুষঙ্গিক বা একেবারেই নেই। ফলে কেবল শিরোনাম সূচকের ভিত্তিতে প্রাসঙ্গিকতার সংকেত নির্ভরযোগ্য নয়।
- শিরোনামে ভাঙা-ইংরেজি SEO/অ্যাফিলিয়েট ব্লগস্প্যাম (“AI For Image And video Generation”, “AI black GPT”) বেশি; ছবিগুলোও তা সমর্থন করে, তবে কিছু “উল্লেখযোগ্য” শিরোনাম লিংক করা পিনের চেয়ে বেশি নির্দিষ্টতার প্রতিশ্রুতি দেয়।
প্রস্তাবিত পদক্ষেপ
- X সংগ্রহ ধাপটি ট্রেন্ডিং শব্দের বদলে স্পষ্ট কীওয়ার্ড (Midjourney, Sora 2, Stable Diffusion ইত্যাদি) দিয়ে পুনরায় চালান
- Qwen-Image-2.1 ও LTX-2.5-এর মতো প্রকাশের পরপরই দ্রুত ইকোসিস্টেম সম্প্রসারণকারী ওপেন-ওয়েট পরিবারকে অগ্রাধিকার দিয়ে নজর রাখুন
- ঘোষণা ছাড়া AI-তৈরি কনটেন্ট ব্যবহারের ঘটনা কীভাবে বরখাস্ত, মামলা ও আইনি নিয়ন্ত্রণে গড়ায় তা অনুসরণ করুন
- Sora প্রত্যাহারের পর Veo, Kling, Runway ও Grok Imagine-এর শক্তির সমীকরণ নিয়মিত পর্যবেক্ষণ করুন
- Bluesky-তে কোম্পানির অফিসিয়াল যোগাযোগ প্রায় কাজ না করায় ব্যক্তিগত নির্মাতাদের প্রোফাইল গবেষণায় সীমিত থাকুন
সংগৃহীত ছবি


















































ডেটার মানসংক্রান্ত নোট
X-এ ট্রেন্ডিং শব্দের মাধ্যমে শুধু অপ্রাসঙ্গিক পোস্ট সংগৃহীত হওয়ায় থিম-সংশ্লিষ্ট ডেটা কার্যত নেই। Reddit, YouTube, Bluesky ও Pinterest-ও সম্পূর্ণতার মানদণ্ডের প্রায় 20টি আইটেমে পৌঁছায়নি; YouTube ও Bluesky প্রযুক্তিগত সীমাবদ্ধতার কারণে (WebFetch ব্লক, সার্চ API 403) সংগ্রহপদ্ধতি বদলেছে।



