KEN’S CAT LOG

ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-09

ক্লোজড মডেলে Google-এর Nano Banana Pro এবং OpenAI-এর GPT Image 2 শীর্ষ দুই প্রতিদ্বন্দ্বী; Sora অবসানের দিকে, আর ওপেন সোর্সে Qwen-Image/FLUX/Wan/HunyuanImage ক্লোজড-মানের গুণগত মানের কাছাকাছি পৌঁছে গেছে

ছবি ও ভিডিও জেনারেশন AI সংবাদ সংকলন — 2026-09-09

সবকিছু জড়ো করে আনলাম~🔥 সংক্ষেপে বললে, ক্লোজড দিকটায় Google-এর Nano Banana Pro (Gemini 3 Pro Image) এবং OpenAI-এর GPT Image 2 শীর্ষ দুই প্রতিদ্বন্দ্বী হিসেবে লড়ছে; একক Sora অ্যাপ প্রায় শেষের পথে, আর ভিডিওতে Kling, Seedance ও Veo-র চীনা ও Google-ভিত্তিক মডেলগুলোই প্রধান যুদ্ধক্ষেত্র😤 অন্যদিকে ওপেন সোর্সে Qwen-Image, Z-Image, FLUX, Wan ও HunyuanImage এমন পর্যায়ে পৌঁছেছে যে মনে হয়, “বিনামূল্যেও এত কিছু করা যায়!?” ComfyUI ও লোকাল-কেন্দ্রিক কমিউনিটিগুলোও যথারীতি বেশ প্রাণবন্ত💪 তবে এবার শুধু X-এ পুরোপুরি ব্যর্থতা এসেছে, তাই সেটিও সৎভাবেই উল্লেখ করছি।

সব প্ল্যাটফর্মজুড়ে

ক্লোজড-সোর্স পর্যবেক্ষণ (10) 🏢

  1. Nano Banana Pro (Gemini 3 Pro Image)-কে ছবি তৈরিতে “অন্যান্য মডেলকে পুরোপুরি ছাড়িয়ে গেছে” বলা হচ্ছে; YouTube-এ আলোচনার কেন্দ্রবিন্দু → https://www.youtube.com/watch?v=UV9GqinedQ8
  2. OpenAI-এর GPT Image 2 এসেছে। 12টির বেশি ভাষায় টেক্সট নির্ভুলতা 99%+; Thinking মোডে একবারে 8টি ছবি তৈরি, 4K সমর্থনও এগোচ্ছে → https://www.youtube.com/watch?v=blOlUnC75O4
  3. Google 2026 সালের 17 আগস্ট Imagen সম্পূর্ণ বন্ধ করে Nano Banana সিরিজে একীভূত হয়েছে। ক্লোজড ছবি তৈরির প্রবণতা Google-কেন্দ্রিক হচ্ছে।
  4. OpenAI 26 এপ্রিল Sora অ্যাপ বন্ধ করেছে এবং 24 সেপ্টেম্বর Sora API-ও বন্ধ হওয়ার কথা। কার্যত Sora ব্র্যান্ডের সমাপ্তি ঘনিয়ে এসেছে → https://lemmy.world/post/44721138
  5. Bluesky ব্যবহারকারী dahara1-ও জানিয়েছে যে ফ্রি Sora-তে ক্রেডিট শেষ হওয়ায় এটি আর কাজ করছে না → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
  6. xAI-এর Grok Imagine Image 2.0 (8/7 প্রকাশিত) Arena-তে GPT Image 2-এর অল্প ব্যবধানে দ্বিতীয়, ফলে তিনমুখী প্রতিযোগিতা।
  7. ByteDance-এর Seedance 2.5 8/7 তারিখে API-র সাধারণ প্রাপ্যতা পেয়েছে; Veo 3.1 ও Kling 3.0-এর পাশাপাশি প্রধান পছন্দে পরিণত হয়েছে।
  8. Reddit ব্যবহারকারীরা Seedance 2.5 এবং ওপেন Wan 3.0-কে একই প্রম্পটে তুলনা করেছেন; মতামত ব্যাপকভাবে বিভক্ত → https://www.reddit.com/r/generativeAI/comments/1w60fip/
  9. Midjourney ছবি জেনারেশন থেকে অপ্রত্যাশিতভাবে আল্ট্রাসাউন্ড মেডিক্যাল স্ক্যানার ব্যবসায় মোড় নেওয়ায় বিতর্ক চলছে; Theranos-সদৃশ কটাক্ষও দেখা গেছে → Lemmy(theregister.com-এর মাধ্যমে)
  10. ByteDance এবং Hollywood (MPA) AI কপিরাইট সুরক্ষায় বৈশ্বিক সমঝোতায় পৌঁছেছে; কপিরাইট-সম্মত ব্যবস্থার পদক্ষেপও জোরদার হচ্ছে → Pinterest-এর অনুসন্ধান
  11. Reddit-এ AI দিয়ে “আসল হাতে আঁকা টাইমল্যাপস” জাল করার প্রযুক্তি 7,088 পয়েন্টে তীব্র বিতর্ক সৃষ্টি করেছে; AI লেবেল বাধ্যতামূলক করার দাবিও উঠেছে → https://www.reddit.com/r/antiai/comments/1w81kdd/
  12. শুধু Bluesky-র luok.ai ফিডেই 2025 সালের ডিসেম্বর থেকে 2026 সালের ফেব্রুয়ারির মধ্যে Kling, Runway, PixVerse, Vidu, Seedance ও Niji-র নতুন মডেল একের পর এক এসেছে; চীনা মডেলগুলোর গতি স্পষ্ট।

ওপেন-সোর্স পর্যবেক্ষণ (10) 🛠️

  1. Qwen-Image 2512 (Alibaba, Apache-ধাঁচের) ও Z-Image Turbo দুটি বড় ট্রেন্ড; তুলনামূলক ভিডিওর বন্যা চলছে → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  2. Flux 2.0-কে Qwen-Image 2512/Z-Image-এর বিপরীতে 15-দফা স্ট্রেস টেস্টে নামানো হচ্ছে → https://www.youtube.com/watch?v=54zvSiAWz2Y
  3. Lightricks-এর LTX-2.3 (22 বিলিয়ন প্যারামিটার, অডিও সিঙ্ক, 4K/50fps) ক্লোজড-মানের গুণমানের জন্য প্রশংসিত → https://www.youtube.com/watch?v=qQXzlk134Sw
  4. Alibaba-এর Wan 2.5 “ক্লোজড Veo 3-কে ছাড়িয়ে গেছে” দাবি করা ব্যবহারিক ভিডিওও রয়েছে → https://www.youtube.com/watch?v=yvD8TxNsR4Q
  5. LTX-2.3, Qwen, Flux.2 Klein ও Z-Image-সহ একাধিক OSS মডেল একত্র করা বিনামূল্যের এজেন্ট “WanGP” এসেছে; সমন্বিত ওয়ার্কফ্লোর দিকে অগ্রগতি → https://www.youtube.com/watch?v=h-k6xOEITx4
  6. Tencent-এর HunyuanImage 3.0 (80B+-এর MoE) এখনও বৃহৎ OSS ছবি মডেলের একটি মানদণ্ড।
  7. Black Forest Labs-এর FLUX 3 ছবি ও অডিওসহ 20-সেকেন্ডের ভিডিও সমর্থন করে; সীমিত প্রকাশ → https://bfl.ai/blog/flux-3
  8. FLUX.2-klein-9b-kv-fp8-এর হালকা সংস্করণ এবং FLUX Creator Program শুরু হয়েছে; পরিচালক Martin Scorsese-ও উপদেষ্টা হিসেবে যোগ দিয়েছেন।
  9. Lemmy-র Stable Diffusion-ভিত্তিক কমিউনিটিগুলো প্রায় 5,000 সদস্যের হলেও প্রতিদিন ComfyUI/SDXL/Krea2-র কাজ পোস্ট হচ্ছে—বাস্তব ব্যবহারের গভীরতা অসাধারণ।
  10. Bluesky-তে Simon Willison জানিয়েছেন, M5 MacBook-এ Qwen 3.7 27B লোকালি চালিয়ে 17GB GGUF-এ তাঁর দেখা সেরা পেলিকান ছবি পাওয়া গেছে; লোকাল LLM ছবি তৈরির সক্ষমতার বেঞ্চমার্ক সংস্কৃতিতে পরিণত হচ্ছে → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
  11. ওপেন ভিডিও ফাউন্ডেশন মডেল SkyReels V1 (HunyuanVideo-ভিত্তিক) এবং বিনামূল্যের অল-ইন-ওয়ান OSS ওয়ার্কফ্লো “Open Creative Studio”-ও ধীরে ধীরে আপডেট হচ্ছে → https://bsky.app/profile/perilli.com/post/3mdddenkss22v

প্ল্যাটফর্মজুড়ে যে বিষয়টি সবচেয়ে চোখে পড়েছে: ক্লোজড বনাম ওপেনের কাঠামোটি Reddit, YouTube ও Lemmy-তে বারবার এসেছে—“সহজ, কিন্তু সেন্সরশিপ ও খরচ বেশি—এমন ক্লোজড” বনাম “স্বাধীন, কিন্তু ঝামেলাপূর্ণ—এমন ওপেন”। “ফ্রি ও সীমাহীন” দাবি করা টুল নিয়ে সন্দেহও একাধিক কমিউনিটিতে অভিন্ন🙅‍♂️। উল্টোভাবে Pinterest-এ এই দ্বৈততা তেমন দেখা যায়নি; সেখানে টুল পরিচিতি ও খবরের থাম্বনেইলই মূল বিষয় ছিল—এটিও আকর্ষণীয়।

প্ল্যাটফর্ম অনুযায়ী

Reddit:12টি থ্রেড সংগ্রহ করা হয়েছে। অ্যান্টি-AI থ্রেডটি (7,088pt) সব প্রযুক্তিবিষয়ক থ্রেড মিলিয়েও যতটা নজর পায়নি, তার চেয়েও বেশি ভাইরাল হয়েছে—বাস্তবে “AI অপব্যবহারের বিরুদ্ধে প্রতিক্রিয়া” সহজে দৃশ্যমান হয়। r/StableDiffusion-এর মতো মূল subreddit এবার পাওয়া যায়নি, ফলে কভারেজে ফাঁক আছে।

X:সত্যি বলতে, এখানে পুরোপুরি ব্যর্থতা ছিল😅 কর্মীর অনুসন্ধান শব্দ ছিল “Harvey” বা “$LAPTOP”-এর মতো বিষয়বহির্ভূত শব্দ; ফলে সংগ্রহ করা 40টির মধ্যে ছবি বা ভিডিও জেনারেশন AI-সম্পর্কিত পোস্ট ছিল শূন্য। ব্রিফে উল্লিখিত 6টি প্ল্যাটফর্মের মধ্যে এটাই একমাত্র প্রকৃত ঘাটতি।

YouTube:রিভিউ ও তুলনামূলক ভিডিও সমৃদ্ধ। ক্লোজড দিকটায় Google/OpenAI/xAI-র ত্রিমুখী প্রতিদ্বন্দ্বিতা, আর ওপেনে Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage ও WanGP-র সমন্বিত ওয়ার্কফ্লো পর্যন্ত বিস্তৃত কভারেজ পাওয়া গেছে। তবে ভিউ ও সাবস্ক্রাইবার সংখ্যা JavaScript-নির্ভর হওয়ায় পাওয়া যায়নি; সংখ্যাভিত্তিক সাম্প্রতিকতা তুলনা করা যায়নি।

Bluesky:সার্চ API (searchPosts) সব কুয়েরিতে 403 দেওয়ায় অ্যাকাউন্টভিত্তিক ফিড পড়ায় পরিবর্তন করা হয়েছে। ফলে ক্লোজড ভিডিও মডেলের খবর (luok.ai-র মাধ্যমে) যথেষ্ট মিললেও ওপেন ভিডিওর আলোচনা তুলনামূলকভাবে দুর্বল। SkyReels V1 ছাড়া খুব কম কিছু পাওয়া গেছে।

Lemmy:Midjourney-র চিকিৎসা খাতে মোড় নেওয়া বিতর্ক এবং Sora বন্ধ হওয়া নিয়ে ব্যঙ্গ ক্লোজড-সংক্রান্ত প্রধান খবর। ওপেনে Black Forest Labs (FLUX-ধারা) প্রায় একচ্ছত্র; প্রতি ত্রৈমাসিকে নির্দিষ্ট নতুন পদক্ষেপ ধারাবাহিকভাবে দেখা যায়।

Pinterest:50টি পিনের সব ছবি দেখা হয়েছে। রোবট মুখ ও নিয়ন-রঙা নিউজ থাম্বনেইল, এবং টুলসংকলন ইনফোগ্রাফিক প্রধান। Stable Diffusion/ComfyUI-ধাঁচের “স্ব-হোস্টেড ওপেন” সংস্কৃতির প্রতীকী ছবি 50টির মধ্যে শূন্য। এনগেজমেন্ট সংখ্যাও সাধারণত পাওয়া যায়নি।

কী নজরে রাখবেন

  • OpenAI-এর Sora API বন্ধ হওয়া (2026 সালের 24 সেপ্টেম্বর নির্ধারিত) — Lemmy https://lemmy.world/post/44721138
  • Grok Imagine Image 2.0 বনাম GPT Image 2-এর Arena র‌্যাঙ্কিংয়ের পরিবর্তন — YouTube(Marin Method-ধাঁচের তুলনামূলক ভিডিও)
  • Qwen-Image / Z-Image / FLUX-এর ওপেন-সোর্স ত্রিমুখী লড়াই—কোনটি মানদণ্ড হয়ে ওঠে — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  • Midjourney-র আল্ট্রাসাউন্ড মেডিক্যাল স্ক্যানার ব্যবসা সত্যিই টিকতে পারে কি না — Lemmy(theregister.com-এর মাধ্যমে)
  • ByteDance×Hollywood কপিরাইট চুক্তির নির্দিষ্ট পরিচালন নীতি — Pinterest-এর অনুসন্ধান [24]
  • WanGP-র মতো OSS সমন্বিত এজেন্ট কতটা ছড়িয়ে পড়ে — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4

সুপারিশ

  • X-এর অতিরিক্ত সংগ্রহে অনুসন্ধান শব্দ “Midjourney” “Stable Diffusion” “Sora” “Nano Banana” “Qwen-Image”-এর মতো সরাসরি বিষয়সংশ্লিষ্ট শব্দে বদলে পুনরায় চালানো উচিত।
  • Reddit গবেষণায় পরের বার থেকে r/StableDiffusion, r/midjourney ও r/comfyui-এর মতো মূল বড় subreddit অবশ্যই অন্তর্ভুক্ত করা উচিত।
  • Bluesky সার্চ API-র 403 সমস্যার বিকল্প হিসেবে এবার পাওয়া প্রধান অ্যাকাউন্টগুলো (luok.ai, simonwillison.net ইত্যাদি) ওয়াচলিস্টে রেখে নিয়মিত পর্যবেক্ষণ করা উচিত।
  • ক্লোজড/ওপেন দ্বৈততাকে দৃশ্যমান করতে Pinterest-এর বদলে বেশি মতামতসমৃদ্ধ Reddit/Lemmy মন্তব্যকে অগ্রাধিকার দেওয়া উচিত।
  • OpenAI-এর Sora API বন্ধ (9/24) এবং Midjourney-র ব্যবসায়িক পরিবর্তনের পরবর্তী খবরকে পরবর্তী গবেষণায় সর্বোচ্চ অগ্রাধিকার দেওয়া উচিত।

ডেটার গুণমান

X-এ অনুসন্ধান শব্দের অমিলের কারণে ছবি ও ভিডিও জেনারেশন AI-সম্পর্কিত একটি পোস্টও সংগ্রহ হয়নি, ফলে কার্যত কোনো ডেটা নেই। Bluesky ও Pinterest-এ সার্চ API বা এনগেজমেন্ট পরিসংখ্যান (ভিউ, লাইক) পাওয়া যায়নি, তাই আলোচনার বিস্তার পরিমাণগতভাবে প্রমাণ করা যায়নি। YouTube-এও ভিডিওর মূল লেখা ও ভিউ JavaScript-নির্ভর হওয়ায় পাওয়া যায়নি; WebSearch স্নিপেটের ওপর নির্ভর করতে হয়েছে। অন্যদিকে Reddit ও Lemmy-তে পরিমাণ ও মান—দুই দিক থেকেই মোটামুটি যথেষ্ট উপাদান পাওয়া গেছে।

প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ

Reddit

Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ

কোথায়

সংগ্রহ করা 12টি থ্রেড 8টি subreddit-এ ছড়িয়ে আছে।

Subreddit সদস্যসংখ্যা সংগৃহীত থ্রেডসংখ্যা
r/generativeAI 151,605 4
r/antiai 319,039 1
r/RemoteWorkers 75,979 1
r/Seedance_AI 20,508 1
r/freetoolsAI 7,942 1
r/aivideomaking 6,614 2
r/AItips101 1,153 1
r/Unrouted_AI 517 1

জেনারেটিভ AI-সংক্রান্ত r/generativeAI-তে সবচেয়ে বেশি, 4টি থ্রেড। কিন্তু স্কোর ও মন্তব্যে পুরোপুরি এগিয়ে আছে AI ছবি তৈরির সমালোচনামুখর r/antiai-এর একটি থ্রেড, যার এনগেজমেন্ট অন্য সব থ্রেডের সম্মিলিত ফলকেও অনেক ছাড়িয়ে গেছে (নিচে বিস্তারিত)।

মানুষ কী বলছে
  • আনসেন্সরড ও স্বাধীনতাকেন্দ্রিক সমন্বিত প্ল্যাটফর্মের উত্থান:থ্রেড 1 (r/AItips101, 81 points, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) “WildOwl.ai”-কে সামনে রেখে Qwen Image / Flux / Seedream / Wan / Kling / Seedance / Veo / GPT Image-সহ 35টির বেশি মডেলে প্রবেশাধিকার দেওয়া, সাবস্ক্রিপশনবিহীন ব্যবহারভিত্তিক পেমেন্ট পরিষেবা তুলে ধরেছে। মন্তব্যে u/reliablemicrophone84 বলেছেন, “WildOwl সত্যিই আপনার উল্লেখ করা সেই সমস্যাটি সমাধান করে—অত্যাধুনিক মডেল আর সৃজনশীল স্বাধীনতার মধ্যে একটি বেছে নিতে হয় না”; তবে u/Clear-Assistance449 Mage.space-এর সীমাহীন সাবস্ক্রিপশনের পক্ষে পাল্টা মত দিয়েছেন।
  • “ফ্রি ও সীমাহীন” দাবির প্রতি তীব্র সন্দেহ:থ্রেড 2 (r/aivideomaking, 2 points, 22 comments, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) এবং থ্রেড 5 (r/generativeAI, 1 point, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/)-এ “সত্যিকারের ফ্রি ও সীমাহীন কিছু নেই”—এমন মতই প্রাধান্য পেয়েছে। u/ai_art_is_art (থ্রেড 5, 3 points) কঠোরভাবে বলেছেন, “Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations.”
  • 45-সেকেন্ডের ভিডিও অনুরোধে হাস্যরস:থ্রেড 4 (r/aivideomaking, 13 points, 22 comments, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/)-এ শুধু ফোন ও iPad দিয়ে বিনামূল্যে 45-সেকেন্ডের AI ভিডিও বানাতে চাওয়া পোস্টে u/NewLifeWares (2 points) প্রযুক্তিগত সীমা দেখিয়ে বলেছেন, “45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator...with a watermark”।
  • AI দিয়ে “আসল হাতে আঁকা” জালিয়াতি নিয়ে তীব্র বিতর্ক:থ্রেড 3 (r/antiai, 7,088 points, 1,023 comments, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) এমন একটি পোস্ট যেখানে GPT-6-শ্রেণির LLM-কে মাউস ও কিবোর্ড চালিয়ে পেইন্ট সফটওয়্যারে “আসল টাইমল্যাপস” জাল করতে সক্ষম বলা হয়েছে। সংগৃহীত সব থ্রেডের মধ্যে এর স্কোর বিপুল ব্যবধানে সর্বোচ্চ। u/Nayutantantan (2,512 points) হতাশা প্রকাশ করে বলেছেন, “the trends of creating fake timelapses are getting common”; u/Soggy_Supermarket100 (171 points) “EVERY SINGLE online space NEEDS AI filtering” বলে দ্রুত AI লেবেল বাধ্যতামূলক করার দাবি তুলেছেন।
  • বাস্তব মানুষের ডিপফেক নিয়ে “ব্যবহারকারীর দায়” মতের প্রাধান্য:থ্রেড 6 (r/Seedance_AI, 0 points, 22 comments, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/)-এ u/Jean_velvet (7 points) বলেছেন, “Recent court cases put it in the responsibility of the user...It's the distribution and sharing that's the potential crime,” অর্থাৎ দায় ব্যবহারকারীর, অপরাধের ঝুঁকি বিতরণ ও শেয়ারে। অন্যদিকে u/Alchemist42 (1 point) বলেছেন, “They don't use Seedance,” যা কম নিয়ন্ত্রিত অন্য টুল ব্যবহারের ইঙ্গিত দেয়।
  • ক্লোজড বনাম ওপেন মডেলের লড়াই:থ্রেড 10 (r/generativeAI, 110 points, 31 comments, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) একই প্রম্পটে Seedance 2.5 (ক্লোজড, ByteDance-ভিত্তিক) ও Wan 3.0 (ওপেন-ওয়েট, Alibaba-ভিত্তিক)-কে তুলনা করেছে। u/SpecialistDragonfly9 (5 points) বলেছেন, “it looks like seedance is the by FAR superior one,” তবে u/Positive-Key6640 (5 points) বলেছেন, “Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better,” অর্থাৎ তুলনা পদ্ধতিটিই প্রশ্নবিদ্ধ।
  • OpenAI-এর নতুন ছবি মডেল নিয়ে নীরব আগ্রহ:থ্রেড 7 (r/Unrouted_AI, 2 points, 6 comments, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) OpenAI-এর অফিসিয়াল ব্লগ “introducing-chatgpt-images-2-5”-এর লিংক পোস্ট। u/Ok_Homework_1859 বলেছেন, “I'm really interested in the the Sketch feature, which lets you draw in ChatGPT to guide your image,” অর্থাৎ স্কেচ গাইড সুবিধিটিতে তাঁর আগ্রহ।
  • কপিরাইট চরিত্র তৈরির বিধিনিষেধে অসন্তোষ:থ্রেড 11 (r/generativeAI, 2 points, 2 comments, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/)-এ Disney চরিত্রের ব্যক্তিগত ফ্যান আর্টও বানাতে না পারা Grok নিয়ে অসন্তোষ প্রকাশ হয়েছে; u/frighten বিকল্প হিসেবে বলেছেন, “PixelForge might work for you on iOS, it has no restrictions built in”।
  • AI ছবি তৈরির 10 বছরের ইতিহাস নিয়ে নস্টালজিয়া ও সংশোধন:থ্রেড 9 (r/generativeAI, 15 points, 9 comments, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) 2016-এর StackGAN থেকে 2026-এর ChatGPT ছবি জেনারেশন পর্যন্ত অগ্রগতির সারসংক্ষেপ। u/noctalla বলেছেন, “Google DeepDream was an AI image generator that predated these...around 2015,” অর্থাৎ ইতিহাসে একটি গুরুত্বপূর্ণ বাদ পড়া অংশ ছিল।
  • ছবি জেনারেশনের আশপাশে নতুন “AI পার্শ্ব-আয়”:থ্রেড 8 (r/RemoteWorkers, 169 points, 787 comments, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) AI-জেনারেটেড ক্যাপশন যাচাইয়ের ঘণ্টাপ্রতি $30-এর ঘরে বসে কাজের বিজ্ঞাপন। 787টি মন্তব্য থাকলেও সংগৃহীত শীর্ষ মন্তব্যে মূলত “Images” লেখা আবেদন লিংকের পুনরাবৃত্তি, তাই বাস্তব আলোচনার পরিমাণ কম।
  • বিনামূল্যের জেনারেশন টুলের স্থায়িত্ব নিয়ে প্রশ্ন:থ্রেড 12 (r/freetoolsAI, 40 points, 50 comments, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)-এ ফ্রি, আনলিমিটেড, নিবন্ধনবিহীন বলে প্রচারিত aifreeforever.com পরিচিত হয়। u/thecragmire প্রশ্ন করেন, “How do you maintain this? It's got to cost you something, right?” এবং u/Relevant_Syllabub895 NSFW নিয়ন্ত্রণের কঠোরতায় অসন্তুষ্ট।
সংকেত
  • দ্রুত উত্থান: “আনসেন্সরড, বহু-মডেল সমন্বিত” অ্যাগ্রিগেটর (WildOwl.ai, Venice, Mage.space, PixelForge) কয়েকটি থ্রেডে পৃথক মডেল চুক্তির বিকল্প হিসেবে সরাসরি উল্লেখিত। একক মডেলের বদলে “পছন্দমতো মডেল + শিথিল ফিল্টার” বিক্রি করা পরিষেবাগুলো দৃশ্যমান।
  • যে দাবি প্রত্যাখ্যাত হচ্ছে: ভিডিও/ছবি জেনারেশন পরিষেবার “ফ্রি ও সীমাহীন” দাবি r/aivideomaking, r/generativeAI এবং r/freetoolsAI—এই তিন কমিউনিটিজুড়ে প্রায় অভিন্নভাবে সন্দেহ বা প্রত্যাখ্যানের মুখে। হার্ডওয়্যার খরচ বা অর্থপ্রদান—দুটির একটি অবশ্যম্ভাবী, এটাই সাধারণ ধারণা।
  • মতবিরোধ: থ্রেড 10-এর Seedance বনাম Wan তুলনায় কোনটি শ্রেষ্ঠ তা নিয়ে মত বিভক্ত; পাশাপাশি শুধু প্রম্পট মিলিয়ে তুলনা যথেষ্ট নয়—এমন আপত্তিও এসেছে। থ্রেড 6-এও “ব্যবহারকারীর দায়” ও “সেবাদাতার প্রতিরোধ করা উচিত”—এই দুই পক্ষের তাপমাত্রার পার্থক্য আছে।
  • চমক: সংগৃহীত 12টি থ্রেডে প্রযুক্তিগত বিষয়—মডেল তুলনা, নতুন টুল পরিচিতি—সবগুলোর চেয়ে অ্যান্টি-AI থ্রেডটি (থ্রেড 3, 7,088 points / 1,023 comments) বহুগুণ বেশি এনগেজমেন্ট পেয়েছে। এর স্কোর অন্য সব থ্রেডের মোট স্কোরের (প্রায় 7,600-এর কম) প্রায় সমান, যা ইঙ্গিত করে Reddit-এ “AI জেনারেশন প্রযুক্তির উচ্ছ্বাস”-এর চেয়ে “অপব্যবহার ও প্রতারণার বিরুদ্ধে প্রতিক্রিয়া” বেশি সহজে দৃশ্যমান।
  • ক্লোজড/ওপেন কাঠামো: স্পষ্ট “ওপেন সোর্স বনাম ক্লোজড সোর্স” অক্ষ হিসেবে উঠে এসেছে Wan (ওপেন-ওয়েট) বনাম Seedance (ক্লোজড)-এর তুলনা (থ্রেড 10), এবং লোকাল জেনারেশন (ComfyUI/Civitai/Hugging Face) বনাম ক্লাউড পেইড পরিষেবার দ্বন্দ্ব (থ্রেড 1, 2, 6)। ওপেনকে বারবার “স্বাধীন কিন্তু শ্রমসাধ্য”, ক্লোজডকে “সহজ কিন্তু সেন্সরশিপ ও খরচের বাধা”—এভাবে বর্ণনা করা হয়েছে।
সীমাবদ্ধতা
  • সংগৃহীত থ্রেড মাত্র 12টি, যেখানে brief.md-এর চাওয়া “প্রায় 20টি”-তে পৌঁছানো যায়নি। অনুসন্ধান শব্দ ছিল শুধু “Image and Video Generation AI News”; ক্লোজড সোর্স ও ওপেন সোর্সকে আলাদাভাবে লক্ষ্য করে অতিরিক্ত অনুসন্ধান হয়নি।
  • r/StableDiffusion, r/midjourney, r/aivideo, r/comfyui-এর মতো ছবি ও ভিডিও জেনারেশন AI-এর প্রধান বড় subreddit এই ফলাফলে একটিও নেই। এটি অনুসন্ধান কভারেজের ফাঁক, তাই Reddit-এর সামগ্রিক মনোভাবকে পুরোপুরি প্রতিনিধিত্ব করে বলা যায় না।
  • থ্রেড 8 (r/RemoteWorkers)-এ শীর্ষ মন্তব্য মূলত “Images” লেখা আবেদন পুনরাবৃত্তি; আলোচনার তথ্যবহুলতা প্রায় শূন্য।
  • এই এজেন্ট Reddit-এর মূল সাইট বা সার্চ ফল পাতা সরাসরি দেখতে পারেনি (WebFetch প্রত্যাখ্যাত), তাই উপরের সব তথ্য কর্মীর আগে থেকে সংগ্রহ করা output/reddit.threads.md / .json-এ সীমাবদ্ধ; অন্য থ্রেড বা মন্তব্য আছে কি না যাচাই করা সম্ভব হয়নি।

X

X — ছবি ও ভিডিও জেনারেশন AI সংবাদ

ভূমিকা: সংগৃহীত ফল বিষয়টির সঙ্গে মেলেনি

output/x.posts.md দেখে বোঝা গেছে, এই পর্যায়ে কর্মী আসলে যে শব্দগুলো খুঁজেছেন তা হলো
“Harvey”, “#Crypto”, “#sweepstakes”, “#Chance”, “#giveaways”, “Serbia”,
“$LAPTOP”, “Arsenal”, “Germans”, “Nazis”—মোট 10টি। এগুলোর কোনোটিই ছবি বা ভিডিও জেনারেশন AI-এর সঙ্গে সম্পর্কিত নয়; সংগৃহীত 40টি পোস্ট (39টি অ্যাকাউন্ট)-এরও একটিও বিষয়সংশ্লিষ্ট ছিল না। একইভাবে “X's own Explore list”-এও (সার্ভারের সংযোগ উৎস ক্রোয়েশিয়ার সঙ্গে যুক্ত ট্রেন্ড, নিচের টেবিল) AI-সম্পর্কিত কিছু নেই।

# ট্রেন্ড কোথায়
1 Harvey ক্রোয়েশিয়ায় ট্রেন্ডিং
2 #Crypto ব্যবসা ও অর্থনীতি · ট্রেন্ডিং
3 #sweepstakes ক্রোয়েশিয়ায় ট্রেন্ডিং
4 #Chance ক্রোয়েশিয়ায় ট্রেন্ডিং
5 #giveaways ক্রোয়েশিয়ায় ট্রেন্ডিং
6 Serbia রাজনীতি · ট্রেন্ডিং
7 $LAPTOP ক্রোয়েশিয়ায় ট্রেন্ডিং
8 Arsenal খেলাধুলা · ট্রেন্ডিং
9 Germans রাজনীতি · ট্রেন্ডিং
10 Nazis রাজনীতি · ট্রেন্ডিং

নিয়ম 7 (সূত্র জাল না করার নিয়ম) অনুসারে, বিষয়বহির্ভূত পোস্টকে এই বিষয়ের পর্যবেক্ষণ হিসেবে উপস্থাপন করা হবে না। নিচে কেবল বাস্তবে সংগৃহীত তথ্যই দেওয়া হলো।

অ্যাকাউন্টসমূহ

সংগ্রহ করা 39টি অ্যাকাউন্ট প্রেমঘটিত রিয়েলিটি শো অনুরাগী, ক্রিপ্টো ট্রেডার, প্রতিযোগিতা ও উপহার প্রচারকারী অ্যাকাউন্ট, বলকান অঞ্চলের রাজনৈতিক বিতর্ককারী, মিমকয়েন গোষ্ঠী, Arsenal সমর্থক এবং ইতিহাস বিকৃতি/ইহুদিবিদ্বেষ নিয়ে বিতর্কিত অ্যাকাউন্টসহ—অনুসন্ধান শব্দভেদে বিচ্ছিন্ন ক্লাস্টার তৈরি করেছে। ছবি বা ভিডিও জেনারেশন AI নিয়ে কথা বলেছে, কিংবা এমন টুলে তৈরি কনটেন্ট পোস্ট করেছে বলে স্পষ্ট করা হয়েছে—এমন অ্যাকাউন্ট একটিও পাওয়া যায়নি (“has an image” লেখা পোস্ট আছে, কিন্তু তাতে জেনারেটিভ AI-এর উল্লেখ বা তৈরি কনটেন্ট হিসেবে স্পষ্টতা নেই)। সবচেয়ে বেশি এনগেজমেন্ট @saintjupitr (64,747 likes, 1টি পোস্ট) এবং @Kwin8675309 (42,021 likes, 1টি পোস্ট)-এর; উভয়ই একক রাজনৈতিক পোস্ট ভাইরাল হওয়ার উদাহরণ এবং বিষয়ের সঙ্গে সম্পর্কহীন।

পোস্টসমূহ

প্রযোজ্য নয়। বিষয়—ছবি ও ভিডিও জেনারেশন AI, ক্লোজড সোর্স/ওপেন সোর্স প্রবণতা—সংশ্লিষ্ট পোস্ট 40টির মধ্যে 0টি। নির্দিষ্ট পোস্টগুলো (যেমন #21–24 সার্বিয়া-সংক্রান্ত রাজনৈতিক বিতর্ক, #29–32 Arsenal-সংক্রান্ত ফুটবল পোস্ট, #33–40 জার্মানি ও নাৎসি-সংক্রান্ত ইতিহাস বিতর্ক) বড় এনগেজমেন্ট পেয়েছে, কিন্তু AI ছবি বা ভিডিও জেনারেশনের সঙ্গে সম্পর্কিত নয় বলে findings-এ ধরা হয়নি।

সংকেত
  • বিষয়সম্পর্কিত কোনো উত্থান/পতনের সংকেত পাওয়া যায়নি, কারণ প্রাসঙ্গিক ডেটাই নেই।
  • কেবল এটুকু বলা যায়: এই সেশনের Explore ফল ক্রোয়েশিয়ায় জিওলোকেটেড ছিল এবং অনুসন্ধান কুয়েরিগুলোই বিষয়বহির্ভূত (“Harvey”, “$LAPTOP” ইত্যাদি)—এটি সংগ্রহ প্রক্রিয়ার বাস্তব তথ্য।
সীমাবদ্ধতা
  • অনুসন্ধান শব্দ বিষয়টির সঙ্গে মেলেনিoutput/x.posts.md-এ থাকা “Found by searching “…”” সবকটিই ছবি ও ভিডিও জেনারেশন AI-বহির্ভূত—Harvey, #Crypto, #sweepstakes, #Chance, #giveaways, Serbia, $LAPTOP, Arsenal, Germans, Nazis। এটি সম্ভবত কর্মীর কুয়েরি সেটিংয়ের সমস্যা। এই ধাপের প্লেবুক নির্দেশনা (“the worker already collected the material”) অনুসারে নিজে নতুন করে অনুসন্ধান করা হয়নি; সঠিক শব্দ—“AI image generation”, “Midjourney”, “Stable Diffusion”, “Sora”, “Veo”, “オープンソース 画像生成AI” ইত্যাদি—দিয়ে পুনরায় সংগ্রহ দরকার।
  • সংগৃহীত 40টি পোস্টের একটিতেও ছবি ও ভিডিও জেনারেশন AI-এর ক্লোজড/ওপেন সোর্স প্রবণতা নিয়ে পর্যবেক্ষণ নেই। brief.md-এর চাওয়া “প্রায় 20টি পোস্ট বিশ্লেষণ” প্রাসঙ্গিক ডেটা না থাকায় পূরণ করা যায়নি।
  • X's Explore (ট্রেন্ড 1–10)-এও কেবল ক্রোয়েশিয়ার সাধারণ ট্রেন্ড ছিল; AI-সম্পর্কিত ট্রেন্ড ছিল না।
  • সেশনটি কার্যকর ছিল এবং পোস্ট সংগ্রহ সফল হয়েছিল (“session expired” ধরনের ত্রুটি নয়); সমস্যাটি অনুসন্ধান কুয়েরি নির্বাচনে।

YouTube

YouTube — ছবি ও ভিডিও জেনারেশন AI (ক্লোজড সোর্স/ওপেন সোর্স) সাম্প্রতিক প্রবণতা

চ্যানেল
  • AICodeKing — Google Nano Banana Pro (Gemini 3 Pro Image)-এর প্রাথমিক অ্যাকসেস রিভিউসহ AI টুলের ব্যবহারিক রিভিউ কেন্দ্রিক।https://www.youtube.com/@AICodeKing
  • Theo - t3.gg — ডেভেলপারদের জন্য প্রযুক্তি ব্যাখ্যামূলক চ্যানেল। Nano Banana Pro নিয়ে ভিডিও আছে।https://www.youtube.com/@t3dotgg
  • ElevenLabs(অফিসিয়াল) — অডিও AI কোম্পানির অফিসিয়াল চ্যানেল, তবে GPT Image 2-সহ ছবি জেনারেশন AI খবরও ব্যাখ্যা করে।https://www.youtube.com/@Elevenlabs
  • AIOnTrend — Qwen-Image 2512-এর মতো ওপেন-সোর্স ছবি মডেলের তুলনামূলক রিভিউভিত্তিক চ্যানেল।https://www.youtube.com/@aiontrend
  • BMF MEDIA — LTX-2.3-এর মতো ওপেন-সোর্স ভিডিও মডেলের রিভিউ।https://www.youtube.com/@BeerMoneyForum
  • Marin Method — ক্লোজড-সোর্স ভিডিও মডেলের পাশাপাশি তুলনা (Kling/Grok Imagine/Runway/Veo)।https://www.youtube.com/@MarinMethod
  • Jack Vs. AI — Wan 2.5-সহ ব্যবহারিক ওয়ার্কফ্লোকেন্দ্রিক চ্যানেল।https://www.youtube.com/@JackVsAI
  • Youri van Hofwegen — Seedance 2.0-সহ সাম্প্রতিক ভিডিও জেনারেশন মডেলের তুলনামূলক পরীক্ষা।https://www.youtube.com/@Yourivanhofwegen
  • AI Late to Class — ComfyUI/WanGP-সহ ওপেন-সোর্স লোকাল-রান ওয়ার্কফ্লো ব্যাখ্যাকারী চ্যানেল।https://www.youtube.com/@ailatetoclass
  • AI大学【AI&ChatGPT最新情報】 — জাপানি চ্যানেল। GPT Image 2 বনাম Nano Banana-সহ ছবি জেনারেশন AI তুলনা জাপানিতে ব্যাখ্যা করে।https://www.youtube.com/@AIAIChatGPT-cj4sh
  • রেফারেন্স:Matt Wolfe(@mreflow) প্রায় 9.65 লাখ সাবস্ক্রাইবারের AI-সংবাদ চ্যানেল; সাপ্তাহিক AI শিল্পসংক্রান্ত খবর সংকলন করে (এবারের সরাসরি ফল নয়, তবে এ ক্ষেত্রের উল্লেখযোগ্য বড় চ্যানেল)।
ভিডিও
  1. 「Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN」
    চ্যানেল: Theo - t3.gg|পোস্ট: আনুমানিক 2025 সালের 26 নভেম্বর|https://www.youtube.com/watch?v=UV9GqinedQ8
    → Google-এর Nano Banana Pro (Gemini 3 Pro Image) ছবি তৈরিতে অন্য মডেলকে অনেকখানি ছাড়িয়ে গেছে—এই দাবি নিয়ে ব্রেকডাউন ভিডিও। ক্লোজড-সোর্স অগ্রভাগের প্রতীকী পর্ব।

  2. 「Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...」
    চ্যানেল: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
    → Gemini 3 Pro Image-এর প্রাথমিক অ্যাকসেস রিভিউ। বহু উদাহরণসহ একে “চমকপ্রদ” বলা হয়েছে।

  3. 「GPT Image 2 Is Here — Everything You NEED to Know」
    চ্যানেল: ElevenLabs|পোস্ট: 2026 সালের 23 এপ্রিল|https://www.youtube.com/watch?v=blOlUnC75O4
    → OpenAI-এর GPT Image 2 (ChatGPT Images 2.0) ব্যাখ্যা। 12টির বেশি ভাষায় 99%+ টেক্সট নির্ভুলতা, Thinking মোডে প্রতি প্রম্পটে সর্বোচ্চ 8টি ছবি, 4K (API/β) সমর্থন—এ বছরের অন্যতম বড় ছবি মডেল উন্নয়ন হিসেবে উপস্থাপিত।

  4. 【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
    চ্যানেল: AI大学【AI&ChatGPT最新情報】(জাপানি)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
    → GPT Image 2-কে Nano Banana-এর সঙ্গে তুলনা করে জাপানি ভাষায় ব্যাখ্যা; সক্ষমতা, ব্যবহারপদ্ধতি ও প্রয়োগের উদাহরণ অন্তর্ভুক্ত।

  5. 「Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison」
    চ্যানেল: Marin Method|পোস্ট: 2026 সালের 10 মার্চ|https://www.youtube.com/watch?v=x5fMQvhKP60
    → চার ক্লোজড-সোর্স ভিডিও মডেলের সরাসরি লড়াই। সামগ্রিক সক্ষমতায় Kling 3.0, আর ছবি-থেকে-ভিডিওতে Grok Imagine শক্তিশালী—এমন মূল্যায়ন।

  6. 「Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison」
    চ্যানেল: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
    → ByteDance-এর Seedance 2.0 বিদ্যমান প্রধান ক্লোজড মডেলগুলোকে ছাড়িয়ে গেছে—এমন তুলনামূলক পরীক্ষার ভিডিও।

  7. 「New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)」
    চ্যানেল: AIOnTrend|পোস্ট: 2026 সালের জানুয়ারির শুরু|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    → Alibaba-এর ওপেন-সোর্স ছবি মডেল Qwen-Image 2512 ও আলোচিত Z-Image Turbo-র তুলনা। বিনামূল্য ও Apache-ধাঁচের লাইসেন্সের শক্তি তুলে ধরা হয়েছে।

  8. 「Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)」
    https://www.youtube.com/watch?v=54zvSiAWz2Y
    → Black Forest Labs-এর Flux-ধারাকে Qwen-Image 2512/Z-Image-এর সঙ্গে 15টি স্ট্রেস টেস্টে তুলনা করে বলা হয়েছে, ওপেন-সোর্স ছবি জেনারেশনের শক্তির মানচিত্র বদলাচ্ছে।

  9. 「LTX-2.3 Review: The Open-Source AI Video Model Built for Creators」
    চ্যানেল: BMF MEDIA|পোস্ট: অনুসন্ধানের সময় আনুমানিক 1 মাস আগে (2026 সালের আগস্টের কাছাকাছি)|https://www.youtube.com/watch?v=qQXzlk134Sw
    → Lightricks-এর LTX-2.3 (22 বিলিয়ন প্যারামিটার, অডিও সিঙ্ক, 4K/50fps, ওপেন সোর্স) নির্মাতার দৃষ্টিকোণ থেকে রিভিউ। সাম্প্রতিক 60 দিনের মধ্যে পোস্ট হওয়ায় তথ্যটি নতুন।

  10. 「WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)」
    চ্যানেল: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
    → Alibaba Tongyi-এর ওপেন-সোর্স Wan 2.5 ক্লোজড Google Veo 3-কে ছাড়িয়ে গেছে—এমন দাবি করা ব্যবহারিক ওয়ার্কফ্লো ভিডিও।

  11. 「This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image」
    চ্যানেল: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
    → LTX-2.3, Qwen, Flux.2 Klein ও Z-Image-সহ একাধিক ওপেন-সোর্স মডেল একত্র করা ফ্রি এজেন্ট “WanGP” ব্যবহার করে স্বয়ংক্রিয় ভিডিও তৈরির ওয়ার্কফ্লো। ওপেন-সোর্স ইকোসিস্টেমে সমন্বয় বাড়ার প্রমাণ।

  12. 「HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)」
    https://www.youtube.com/watch?v=32lhiZKhgOY
    → Tencent-এর ওপেন-সোর্স ছবি মডেল HunyuanImage 3.0 (80 বিলিয়ন+ প্যারামিটার, MoE, 13 বিলিয়ন সক্রিয়) পরিচিতি। Nano Banana-এর সমকক্ষ বা উন্নত বলে দাবি করা হয়েছে (প্রথম প্রকাশ 2025 সালের সেপ্টেম্বর হলেও বৃহৎ ওপেন-সোর্স MoE ছবি মডেলের স্থায়ী মানদণ্ড হিসেবে উল্লেখ)।

সংকেত

ক্লোজড-সোর্স দিকের পরিবর্তন

  • Google 2026 সালের 17 আগস্ট Imagen লাইন সম্পূর্ণ বন্ধ করে Nano Banana সিরিজে (Gemini 3 Pro Image ইত্যাদি) একীভূত করেছে। ক্লোজড-সোর্স ছবি তৈরির মূলধারা Google-এর Gemini-ভিত্তিক মডেলে কেন্দ্রীভূত হচ্ছে।
  • OpenAI 2026 সালের 26 এপ্রিল Sora অ্যাপ বন্ধ করেছে; Sora API-ও 2026 সালের 24 সেপ্টেম্বর বন্ধ হওয়ার কথা (এই প্রতিবেদনের সময়ে একেবারেই সামনে)। স্বতন্ত্র ভিডিও জেনারেশন পণ্য হিসেবে Sora ব্র্যান্ড কার্যত সমাপ্ত, এবং OpenAI-এর উন্নয়ন সম্পদ GPT Image 2 ও ChatGPT-তে সমন্বয়ের দিকে যাচ্ছে।
  • OpenAI-এর GPT Image 2 (2026 সালের এপ্রিল) Arena-র টেক্সট-টু-ইমেজ ও এডিটিং—উভয় বিভাগেই শীর্ষস্থানীয়। xAI-এর Grok Imagine Image 2.0 (2026 সালের 7 আগস্ট প্রকাশ) অল্প ব্যবধানে দ্বিতীয়; ক্লোজড ছবি জেনারেশন এখন OpenAI, Google ও xAI-এর ত্রিমুখী প্রতিযোগিতা।
  • ভিডিওতে ByteDance-এর Seedance 2.5 2026 সালের 7 আগস্ট API-র সাধারণ প্রাপ্যতা পেয়েছে এবং Google Veo 3.1 ও Kling 3.0-এর পাশাপাশি দ্রুত প্রধান বিকল্পে উঠে এসেছে।
  • ক্লোজড ভিডিও জেনারেশনের তুলনামূলক ভিডিওতে “Kling 3.0 সামগ্রিক সক্ষমতায়, Veo 3.1 দৃশ্যমান সৌন্দর্যে, Runway Gen-4.5 সৃজনশীল স্বাধীনতায়”—এমন অবস্থান ধীরে ধীরে স্থির হচ্ছে।

ওপেন-সোর্স দিকের পরিবর্তন

  • ছবি জেনারেশনে Qwen-Image 2512 (Alibaba, Apache-ধাঁচের) ও Z-Image Turbo (8 ধাপ, 16GB VRAM-এ চলে) দুটি প্রধান ট্রেন্ড। তুলনামূলক ভিডিওর প্রাচুর্য তাদের উচ্চ আগ্রহ দেখায়।
  • Black Forest Labs-এর Flux.2 Klein (4B, RTX3090-শ্রেণিতে 13GB VRAM, Apache 2.0) হালকা ওপেন-সোর্স বিকল্প হিসেবে বহুবার উল্লেখিত।
  • Tencent HunyuanImage 3.0 (80B+-এর MoE) এখনও বৃহৎ ওপেন-সোর্স ছবি মডেলের একটি মানদণ্ড।
  • ভিডিও জেনারেশনে Alibaba Tongyi-এর Wan 2.2/2.5 (MoE ডিফিউশন, 8GB GGUF সংস্করণও আছে) এবং Lightricks-এর LTX-2.3 (অডিও সিঙ্ক, 4K/50fps, 22 বিলিয়ন প্যারামিটার) ক্লোজড-সোর্স মানে পৌঁছেছে—এমন মূল্যায়ন একাধিক চ্যানেলের।
  • ComfyUI ও WanGP-র মতো “একাধিক ওপেন-সোর্স মডেল একত্র করা এজেন্ট/ওয়ার্কফ্লো” ভিডিও বাড়ছে; আগ্রহ একক মডেল তুলনা থেকে সমন্বিত ওয়ার্কফ্লোর দিকে সরছে।
  • সামগ্রিকভাবে, রিভিউ ও তুলনামূলক ভিডিওতে একই সুর: “ওপেন সোর্স ও ক্লোজড সোর্সের গুণগত পার্থক্য কমছে, এবং অনেক সৃজনশীল দল প্রথমে ওপেন সোর্স বিবেচনা করছে।”
সীমাবদ্ধতা
  • এই পরিবেশে YouTube অনুসন্ধান ফল (youtube.com/results?...) ও ভিডিও পাতা JavaScript-এ রেন্ডার হওয়ায় WebFetch থেকে প্রকৃত ভিউ, পোস্টের তারিখ বা চ্যানেলের সাবস্ক্রাইবার সংখ্যা পাওয়া যায়নি। YouTube oEmbed API (youtube.com/oembed?url=...&format=json) দিয়ে চ্যানেলের নাম পাওয়া গেলেও ভিউ বা সাবস্ক্রাইবার নয়।
  • তাই এই প্রতিবেদনে ভিউ ও সাবস্ক্রাইবার সংখ্যা “অজানা” ধরা হয়েছে; বিকল্প হিসেবে শুধু WebSearch স্নিপেটে থাকা তারিখ ও প্রসঙ্গ ব্যবহার করা হয়েছে। সংখ্যাগত সাম্প্রতিকতা তুলনা—যেমন গত 60 দিনে কত লক্ষ ভিউ—করা যায়নি।
  • ভিডিওর মূল অংশ ও শীর্ষ মন্তব্য JavaScript-নির্ভরতার কারণে সরাসরি পড়া যায়নি; WebSearch-এর শিরোনাম, স্নিপেট ও সম্পর্কিত নিবন্ধের সারাংশ থেকে পরোক্ষভাবে বোঝা হয়েছে—ভিডিওর বক্তব্যের সরাসরি উদ্ধৃতি নয়।
  • HunyuanImage 3.0-সংক্রান্ত ভিডিও প্রথম প্রকাশিত হয়েছিল 2025 সালের সেপ্টেম্বরে, যা প্রস্তাবিত সাম্প্রতিক 60 দিনের সীমার বাইরে; তবে বৃহৎ ওপেন-সোর্স ছবি মডেলের স্থায়ী রেফারেন্স হিসেবে শুধু উল্লেখ করা হয়েছে।
  • জাপানি চ্যানেলের ফল মাত্র 1টি (AI大学); জাপানি ভাষার YouTube আলোচনার ব্যাপ্তি ইংরেজি ভাষার তুলনায় যাচাই করা যায়নি।

Bluesky

Bluesky — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা

অ্যাকাউন্টসমূহ
  • Simon Willison @simonwillison.net — পরিচিত AI ডেভেলপার। নতুন মডেল এলে “সাইকেল চালানো পেলিকান” বেঞ্চমার্ক ছবি দিয়ে নিয়মিত ছবি তৈরির সক্ষমতা তুলনা করেন। অনুসারী অনেক; পোস্টে প্রায়ই 100–500-এর বেশি লাইক।
  • Ethan Mollick @emollick.bsky.social — University of Pennsylvania Wharton School-এর অধ্যাপক। GPT-6 Astra, Fable 5.1 প্রভৃতি মডেল দিয়ে Blender-এ 3D তৈরির পরীক্ষা নিয়মিত পোস্ট করেন।
  • Alessandro Perilli @perilli.com — ComfyUI-র জন্য “Open Creative Studio” (সাবেক AP Workflow) নামের ওপেন-সোর্স অল-ইন-ওয়ান জেনারেটিভ ওয়ার্কফ্লোর ডেভেলপার। টেক্সট, ছবি, ভিডিও ও অডিও—সব তৈরি করা যায় এমন টুলের খবর নিয়মিত দেন।
  • luokai @luok.ai — Kling, Runway, Vidu, PixVerse, Seedance ও Niji-সহ ক্লোজড-সোর্স ভিডিও জেনারেশন AI আপডেট ধারাবাহিকভাবে পরিচিত করানো অ্যাকাউন্ট।
  • dahara1 @dahara1.bsky.social — জাপানিতে LLM/জেনারেটিভ AI ব্যবহারের অভিজ্ঞতা পোস্ট করা ইঞ্জিনিয়ার (নিজস্ব মেশিন অনুবাদ টুলও তৈরি করেন)। Sora বন্ধ হওয়া ও Nano Banana তুলনার মতো সাম্প্রতিক বিষয় ধরেন। 113 অনুসারীসহ ছোট অ্যাকাউন্ট।
  • Midjourney Experience Newsletter @midjourneynews.bsky.social — Midjourney-এর অফিসিয়াল নয়; অনানুষ্ঠানিক ফ্যান/নিউজলেটার অ্যাকাউন্ট। প্রম্পট পরীক্ষা ও শিল্পখাতের খবরের টুকরো পোস্ট করে, এনগেজমেন্ট কম।
  • Stable Diffusion online AI @stablediffusion.bsky.social — SD/Midjourney কাজ ভাগাভাগির ফিড। সাম্প্রতিক পোস্ট 2025 সালের জানুয়ারি–ফেব্রুয়ারিতে থেমে আছে, ফলে বর্তমান সংবাদের উৎস হিসেবে কার্যকর নয়।
  • অফিসিয়াল অ্যাকাউন্ট অনুসন্ধানের ফল: Black Forest Labs, Runway, Stability AI ও Civitai-এর অফিসিয়াল Bluesky অ্যাকাউন্ট নিশ্চিত করা যায়নি (হয় নেই, নয়তো হ্যান্ডেল অজানা)। Midjourney-এর অফিসিয়াল বলে মনে হওয়া midjourney.bsky.social পোস্টশূন্য অ্যাকাউন্ট।
পোস্টসমূহ
  1. 「Sora বন্ধ」 — dahara1, 2026-04-28, লাইক 0/RP 0
    https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
    OpenAI-এর Sora (ভিডিও জেনারেশন) পরিষেবা শেষ হওয়া নিয়ে “সম্ভবত খুব একটা টান ছিল না” বলে মন্তব্য। WebSearch দিয়েও সমর্থন পাওয়া গেছে (OpenAI 2026 সালের মার্চের দিকে Sora অ্যাপ ও ডেভেলপার API বন্ধ করেছে বলে প্রতিবেদন ছিল)।

  2. ফ্রি Sora-র ক্রেডিট শেষ, জেনারেশন সম্ভব নয় — dahara1, 2026-04-04
    https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
    “1 ক্রেডিট বাকি থাকা সত্ত্বেও ভিডিও তৈরি হচ্ছে না”—এমন কার্যক্ষমতা অবনতির রিপোর্ট। উপরের বন্ধ হওয়ার খবরের সঙ্গে সামঞ্জস্যপূর্ণ।

  3. Nano Banana (ফ্রি সংস্করণ) ও ChatGPT Images 2.0-এর ওয়াটারমার্ক তুলনা — dahara1, 2026-05-04, লাইক 1
    https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
    “ChatGPT Images 2.0-তেও Nano Banana ফ্রি সংস্করণের মতো চোখে পড়ার মতো ওয়াটারমার্ক নেই, ব্যবহার সহজ”—দুটি ক্লোজড ছবি জেনারেশন টুলের তুলনা।

  4. Seedance 2 অন্য মডেলকে ছাড়িয়ে গেছে — luokai, 2026-02-10, লাইক 5
    https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
    একদিনে তৈরি করা মৌলিক ভিডিও সংযুক্ত করে ভিডিও জেনারেশন মডেল Seedance 2-র সক্ষমতার প্রশংসা।

  5. Niji 7 প্রকাশ — luokai, 2026-01-10, লাইক 3
    https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
    অ্যানিমে-কেন্দ্রিক ছবি মডেল Niji 7 এসেছে; আরও তীক্ষ্ণ চোখ, সামঞ্জস্য এবং প্রম্পট অনুসরণের উন্নতি দাবি করা হয়েছে।

  6. Runway Gen-4.5 — luokai, 2025-12-02, লাইক 4/RP 1
    https://bsky.app/profile/luok.ai/post/3m6xsakpud226
    মোশন, বিশ্বস্ততা ও প্রম্পট নিয়ন্ত্রণে মানদণ্ড উঁচু করেছে বলে পরিচিতি; world-modeling-ভিত্তির ওপর জোর।

  7. Kling IMAGE O1 — luokai, 2025-12-03, লাইক 3
    https://bsky.app/profile/luok.ai/post/3m72caiexw225
    “যেকোনো ইনপুট গ্রহণ, বোঝা ও তৈরি” করার প্রতিশ্রুতি দিয়ে Kling-এর ফ্ল-স্ট্যাক ছবি জেনারেশন নবায়ন।

  8. Kling VIDEO 2.6 — luokai, 2025-12-05, লাইক 2
    https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
    অডিও সিঙ্ক, লিপসিঙ্ক ও দৃশ্যের সামঞ্জস্যসহ “স্টোরি-ফার্স্ট” ভিডিও জেনারেশন প্রচার।

  9. PixVerse V5.5 — luokai, 2025-12-02, লাইক 4/RP 2
    https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
    এক ট্যাপে মাল্টি-শট জেনারেশন ও স্বয়ংক্রিয় SFX যোগের মতো উৎপাদন সরলীকরণ তুলে ধরা হয়েছে।

  10. Vidu AI Q2 ছবি মডেল — luokai, 2025-12-02, লাইক 5/RP 2
    https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
    “5 সেকেন্ডে 4K জেনারেশন” এবং 31 ডিসেম্বর পর্যন্ত সীমাহীন জেনারেশন প্রচারের ঘোষণা।

  11. SkyReels V1 (ওপেন-সোর্স ভিডিও ফাউন্ডেশন মডেল) — luokai, 2025-02-18, লাইক 3/RP 1
    https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
    “প্রথম ওপেন-সোর্স মানব-কেন্দ্রিক ভিডিও ফাউন্ডেশন মডেল” হিসেবে পরিচিত; HunyuanVideo-কে 10 মিলিয়নের বেশি ভিডিওতে ফাইনটিউন করে 33 ধরনের অভিব্যক্তি ও 400-এর বেশি স্বাভাবিক নড়াচড়া পুনর্নির্মাণের কথা বলা হয়েছে। তারিখটি এক বছরের বেশি পুরোনো, কিন্তু এই অ্যাকাউন্টে পাওয়া একমাত্র স্পষ্ট ওপেন-সোর্স ভিডিও মডেল পোস্ট।

  12. Open Creative Studio v13.0 (ComfyUI-র জন্য ওপেন-সোর্স সমন্বিত ওয়ার্কফ্লো) — Alessandro Perilli, 2026-01-26, লাইক 0
    https://bsky.app/profile/perilli.com/post/3mdddenkss22v
    টেক্সট, ছবি, ভিডিও, অডিও, সংগীত, সাউন্ড এফেক্ট ও গানের কথা পর্যন্ত তৈরি করা যায়—এমন “সবচেয়ে সক্ষম অল-ইন-ওয়ান ComfyUI ওয়ার্কফ্লো”; ফ্রি ও আনলিমিটেড হওয়ার ওপর জোর।

  13. Qwen 3.7 27B-এর লোকাল ছবি জেনারেশন (পেলিকান) — Simon Willison, 2026-08-14, লাইক 183/RP 14
    https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
    M5 Max MacBook Pro-তে LM Studio দিয়ে চালানো 17GB GGUF-এর Qwen 3.7 27B “নিজের ল্যাপটপে চালানো মডেলগুলোর মধ্যে দেখা সেরা সাইকেল-পেলিকান” এঁকেছে বলে রিপোর্ট। ওপেন-ওয়েট মডেলের লোকাল ছবি তৈরির শক্তির উদাহরণ।

  14. GPT-6 Astra বনাম GPT-5.6-ধারার পেলিকান তুলনা গ্রিড — Simon Willison, 2026-09-04, লাইক 202/RP 9
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
    GPT-6 Astra এবং GPT-5.6-এর Sol/Terra/Luna—এই চার মডেলকে পাশাপাশি তুলনা করা 12-ছবির পেলিকান গ্রিড পোস্ট। ক্লোজড মডেলের ছবি তৈরির শক্তিকে নিয়মিত বেঞ্চমার্ক করার উদাহরণ।

  15. GPT-6 Astra-তে Blender 3D জেনারেশন (স্থাপত্য মডেল) — Ethan Mollick, 2026-09-05, লাইক 163/RP 17
    https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
    শুধু স্কেচ ও বিবরণ থেকে 18শ শতকের নির্মাণ না হওয়া স্থাপত্য “Boullée-র স্মারক” Blender-এ 3D মডেল করে বর্ণনাসহ ওয়াকথ্রু পর্যন্ত তৈরি করেছে বলে রিপোর্ট। ক্লোজড-সোর্স LLM-এর ছবি/3D জেনারেশন “দৃশ্যমান উপস্থিতি” তৈরি করার শক্তিশালী অস্ত্র—এমন পর্যবেক্ষণও একই অ্যাকাউন্টের 9/7-এর অন্য পোস্টে ছিল।

  16. 「Midjourney Meta.ai-এর অংশ হয়ে গেছে」 — Midjourney Experience Newsletter, 2026-02-03, লাইক 1
    https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
    ⚠️ সতর্কতা: এটি অনানুষ্ঠানিক ফ্যান অ্যাকাউন্টের পোস্ট; তথ্য অতিরিক্ত সরলীকৃত হওয়ার আশঙ্কা আছে। WebSearch-এ যাচাই করে দেখা গেছে, বাস্তবতা হলো 2025 সালের আগস্টে Meta Midjourney-এর “aesthetic tech” লাইসেন্স নেওয়ার অংশীদারত্ব ঘোষণা করেছিল; এটি অধিগ্রহণ নয়, Midjourney স্বাধীনই আছে (রেফারেন্স: TechCrunch, implicator.ai)।

সংকেত
  • ক্লোজড-সোর্স ভিডিও জেনারেশন তুমুল প্রতিযোগিতায়: শুধু 2025 সালের ডিসেম্বর থেকে 2026 সালের ফেব্রুয়ারির মধ্যে luok.ai-এর ফিডেই Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 ও Niji 7—অন্তত 7টি নতুন মডেল/সংস্করণ ধারাবাহিকভাবে এসেছে। চীনা মডেল—Kling, Vidu, PixVerse, Seedance—বিশেষভাবে দৃশ্যমান।
  • Sora গতি হারিয়ে অবসানের দিকে: dahara1-এর পোস্টে দেখা যায় 2026 সালের এপ্রিলেই ফ্রি Sora-র জেনারেশন ক্রেডিট কাজ করা বন্ধ করে, এবং মাসের শেষে “Sora বন্ধ” বলা হয়। OpenAI 2026 সালের মার্চের দিকে Sora অ্যাপ ও ডেভেলপার API বন্ধ করেছে—এমন খবরের সঙ্গে এটি মেলে। ভিডিও জেনারেশনের নেতৃত্ব চীনা মডেলগুচ্ছ ও Google/OpenAI-এর সাধারণ মডেলে অন্তর্ভুক্ত ফিচারের দিকে সরে যাচ্ছে বলে মনে হয়।
  • ছবি জেনারেশন “LLM-এর একটি ফিচার” হিসেবে বেঞ্চমার্ক হচ্ছে: Simon Willison ও Ethan Mollick-এর পোস্টে স্বতন্ত্র ছবি টুলের চেয়ে GPT-6 Astra, Claude Fable 5.1, Qwen 3.7/3.8 27B-এর মতো সাধারণ LLM-এর ছবি/3D তৈরির ক্ষমতা নিয়মিত তুলনা করার বেঞ্চমার্ক সংস্কৃতি বেশি দৃশ্যমান। বিশেষত GPT-6 Astra-এর ভিজ্যুয়াল জেনারেশন শক্তি—Blender-এ 3D স্থাপত্য পুনর্নির্মাণের মতো—সামাজিক মাধ্যমে সক্ষমতার সূচক।
  • Bluesky-তে ওপেন-সোর্স ভিডিও জেনারেশনের আলোচনা পাতলা: অনুসন্ধান ও ফিড পর্যবেক্ষণে পাওয়া স্পষ্ট ওপেন-সোর্স ভিডিও মডেল পোস্ট শুধু SkyReels V1 (HunyuanVideo-ভিত্তিক), 2025 সালের ফেব্রুয়ারির একটি পোস্ট। 2026 সালে আলোচিত হওয়ার কথা Wan2.2, Qwen-Image বা Z-Image-এর উল্লেখ পাওয়া যায়নি। ComfyUI-সংক্রান্ত ক্ষেত্রে Alessandro Perilli-এর “Open Creative Studio” ঘোষণা নিয়মিত থাকলেও তা ব্যাপক আলোচনার চেয়ে একক প্রকল্পের ঘোষণা বেশি।
  • Midjourney×Meta সম্পর্কটি সহজে ভুল বোঝা হয়: অনানুষ্ঠানিক অ্যাকাউন্ট “Midjourney Meta.ai-এর অংশ হয়ে গেছে” বলে সরলীকরণ করেছে, যা প্রকৃত অবস্থা—প্রযুক্তি লাইসেন্স অংশীদারত্ব, অধিগ্রহণ নয়—থেকে আলাদা। সামাজিক মাধ্যমের তথ্যের সূক্ষ্মতা নিয়ে সতর্ক থাকার ভালো উদাহরণ।
সীমাবদ্ধতা
  • Bluesky-এর অফিসিয়াল সার্চ API (app.bsky.feed.searchPosts) এবার সব কুয়েরিতে 403 Forbidden দিয়েছে, তাই কীওয়ার্ড সার্চ একেবারেই করা যায়নি(প্লেবুকে থাকা ধাপ)। app.bsky.actor.getProfile, app.bsky.feed.getAuthorFeed, app.bsky.feed.getPostThread-এর মতো অন্যান্য পাবলিক API ঠিকমতো কাজ করেছিল; সম্ভবত শুধু সার্চ এন্ডপয়েন্টে প্রবেশাধিকার সীমিত।
  • https://bsky.app/search?q=... ওয়েব সার্চ পাতাও ক্লায়েন্ট-সাইড রেন্ডার হওয়ায় ফেচ করে পোস্টের লেখা পাওয়া যায়নি।
  • এই সীমাবদ্ধতার কারণে কীওয়ার্ড সার্চের বদলে WebSearch-এ প্রাসঙ্গিক অ্যাকাউন্ট খুঁজে তাদের ফিড (getAuthorFeed) পড়া হয়েছে। এটি সুনির্দিষ্ট কীওয়ার্ড কভারেজ নয়; সার্চ ইঞ্জিনে কাকতালীয়ভাবে পাওয়া অ্যাকাউন্টের ওপর নির্ভর করায় পক্ষপাত—বিশেষত ওপেন-সোর্স ভিডিওর কম কভারেজ—হতে পারে।
  • WebSearch দিয়ে Bluesky-তে “Wan2.2”, “Qwen-Image”, “Z-Image”, “HunyuanVideo” খোঁজা হলেও arXiv পেপার বা বিষয়বহির্ভূত অ্যাকাউন্টই বেশি এসেছে; প্রাসঙ্গিক পোস্ট মেলেনি।
  • Black Forest Labs, Runway, Stability AI ও Civitai-সহ প্রধান ছবি/ভিডিও জেনারেশন AI কোম্পানির অফিসিয়াল Bluesky অ্যাকাউন্ট নিশ্চিত করা যায়নি (হ্যান্ডেল অনুসন্ধানে সব ক্ষেত্রেই 400 ত্রুটি বা ফলহীনতা)।
  • stablediffusion.bsky.social ফিড 2025 সালের জানুয়ারি–ফেব্রুয়ারিতে থেমে আছে, তাই সাম্প্রতিক তথ্যের উৎস হিসেবে ব্যবহারযোগ্য নয়।
  • সম্পন্নের মানদণ্ডে প্রতিটি SNS-এ “প্রায় 20টি পোস্ট বিশ্লেষণ” চাওয়া হলেও, উপরোক্ত 6টি অ্যাকাউন্টের ফিডে মোট 100-এর বেশি পোস্ট দেখে সেখান থেকে বিষয়সংশ্লিষ্ট 16টি বাছাই করে দেওয়া হয়েছে।

Lemmy

Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর সাম্প্রতিক প্রবণতা

Lemmy বিকেন্দ্রীভূত Fediverse হওয়ায় lemmy.world-এর API সার্চ (/api/v3/search) এবং lemmy.today (lemmy.dbzer0.com কমিউনিটির মিরর) কেন্দ্র করে, site:lemmy.world ইত্যাদির WebSearch মিলিয়ে অনুসন্ধান করা হয়েছে। মোট প্রায় 25টি পোস্ট দেখা হয়েছে।

কমিউনিটিসমূহ
  • !«メールアドレス» — প্রায় 5,050 সাবস্ক্রাইবার। ওপেন-সোর্স ছবি জেনারেশন (Stable Diffusion-ধারা)-এর কেন্দ্রীয় কমিউনিটি।
  • !«メールアドレス»(lemmy.today-এ নাম “Stable Diffusion Art”) — 2,362 সাবস্ক্রাইবার। SDXL/ComfyUI/Krea2 দিয়ে করা কাজ প্রতিদিন একাধিক পোস্ট হয়; civitai.com লিংক প্রচুর।
  • Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry, Stable Werewolves(সবই lemmy.dbzer0.com-এর ঘরানাভিত্তিক কমিউনিটি)—সদস্যসংখ্যা প্রকাশিত নয়, তবে 2026 সালের সেপ্টেম্বরেও প্রতিদিন পোস্ট আছে।
  • c/«メールアドレス» — সাধারণ প্রযুক্তি কমিউনিটি। Midjourney-র চিকিৎসা স্ক্যানার বিতর্ক ও Sora-সংক্রান্ত প্রধান ক্লোজড খবর এখানে জমা হয়।
  • c/genart — 47 সাবস্ক্রাইবার। “ওপেন-সোর্স ও ওপেন-লাইসেন্স জেনারেটিভ AI মডেল” সমর্থনের কথা স্পষ্টভাবে বলে এমন ছোট কমিউনিটি।
  • c/«メールアドレス» — অ্যান্টি-AI আবেগ নিয়ে কমিউনিটি। শুধু ছবি/ভিডিও জেনারেশনের জন্য নয়, কিন্তু AI টুলনির্ভরতার বিরুদ্ধে পোস্ট 83 স্কোর পেয়েছিল।
  • c/euroai — ইউরোপীয় ওপেন-সোর্স AI/LLM-এর তালিকা পোস্ট করা বিশেষায়িত কমিউনিটি।
পোস্টসমূহ
ক্লোজড-সোর্স ঘেঁষা
  1. 「Midjourney pivots from AI image generation to body scanning medical spa」(2026-06-18, স্কোর 58, technology) https://lemmy.world/post/... via theregister.com — Midjourney ছবি তৈরির কাজ থেকে সরে মেডিক্যাল আল্ট্রাসাউন্ড CT স্ক্যানার ব্যবসায় ঢুকছে—এমন খবর। The Register বলেছে, মূল প্রযুক্তি বাস্তব হলেও অংশীদারদের প্রকাশ করা হয়নি।
  2. 「Midjourney AI pivots to Theranos: Ultrasonic CT」(2026-06-19, স্কোর 40, techtakes) pivot-to-ai.com-এর মাধ্যমে — উপরের ঘটনাকে Theranos (রক্ত পরীক্ষার প্রতারণা কোম্পানি)-এর সঙ্গে তুলনা করে ব্যঙ্গ।
  3. 「I was wrong about the Midjourney ultrasound scanner」(2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — প্রথমে সন্দেহপ্রবণ পোস্টদাতা পরে বিষয়টি সত্য বলে নিশ্চিত করে আগের বক্তব্য প্রত্যাহার করেছেন।
  4. 「Midjourney wants Hollywood studios to reveal details of their AI usage」(2026-07-05, স্কোর 73, technology) techcrunch.com-এর মাধ্যমে — তিনটি স্টুডিওর সঙ্গে মামলায় Midjourney Hollywood-এর AI ব্যবহারের বাস্তব তথ্য প্রকাশের দাবি করেছে।
  5. OpenAI-এর Sora বন্ধ হওয়া নিয়ে প্রতিক্রিয়া পোস্ট「OpenAI: decides to shut down their AI slop video generating model Sorahttps://lemmy.world/post/44721138 — স্বতন্ত্র Sora অ্যাপ বন্ধ (2026-03-24 ঘোষণা, 4/26 বন্ধ, Sora 2 API 2026-09-24 বন্ধ নির্ধারিত) নিয়ে ব্যঙ্গ।
  6. 「OpenAI collapses media reality with Sora AI video generator」 https://lemmy.world/post/12056737 — বেনামী ভিডিওর ওপর আস্থা কমে যাওয়ার আশঙ্কাবিষয়ক নিবন্ধ শেয়ার।
  7. 「OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports」 https://lemmy.world/post/36665644 — কপিরাইটধারীদের opt out করতে বলার নীতির সমালোচনা।
  8. 「Elon Musk maakt complete AI-film met zijn versie van The Odyssey」(2026-07-22, films) ad.nl-এর মাধ্যমে — Musk Grok Imagine দিয়ে দীর্ঘ AI চলচ্চিত্র ‘The Odyssey’ বানানোর ঘোষণা দিয়েছেন।
  9. ChatGPT আয়ের বিশ্লেষণ-সংক্রান্ত শেয়ার পোস্ট(2026-07-15, ai_reddit) — বিশ্লেষণে বলা হয়েছে Grok (xAI)-এর আয়ের বড় অংশ পেইড NSFW ছবি/ভিডিও জেনারেশন কনটেন্ট থেকে আসে।
  10. 「Video AI」(Adobe Firefly ভিডিও জেনারেশনের ফ্রি সীমা নিয়ে প্রশ্ন) — Firefly বিনামূল্যে 2 বার; বিকল্প হিসেবে Hailuo/Kling/Runway/Pixverse/Hunyuan তুলনা করা হয়েছে।
ওপেন-সোর্স ঘেঁষা
  1. 「Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio」(2026-07-24, স্কোর 1, tech) https://bfl.ai/blog/flux-3 — ছবি এবং অডিওসহ 20-সেকেন্ডের ভিডিও তৈরি করতে সক্ষম মাল্টিমোডাল মডেল FLUX 3-এর সীমিত প্রকাশ।
  2. 「FLUX.2-klein-9b-kv-fp8 optimized variant」(2026-03-14, স্কোর 8, stable_diffusion) huggingface.co-এর মাধ্যমে — KV ক্যাশ সমর্থিত হালকা FLUX.2 ডেরিভেটিভ মডেল।
  3. 「Black Forest Labs Opening up the first FLUX Creator Program」(2026-05-06, স্কোর 3, stable_diffusion) — নির্মাতাদের জন্য প্রোগ্রাম শুরুর ঘোষণা।
  4. 「Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf」(2026-06-03, films) nu.nl-এর মাধ্যমে — পরিচালক Martin Scorsese Black Forest Labs-এর উপদেষ্টা হয়েছেন।
  5. 「FLUX Chroma (The Perchance T2i model)」(প্রায় 1 বছর আগে, Perchance কমিউনিটি) huggingface.co(lodestones/Chroma) — NAG (Normalized Attentive Guidance) ব্যবহার করা ডেরিভেটিভ মডেল; লিপসিঙ্ক চিত্রণে ভালো মূল্যায়ন আছে।
  6. Stable Diffusion-ধারার কমিউনিটির দৈনিক পোস্টের উদাহরণ(2026-09-06〜09, সবই SDXL/ComfyUI/Krea2 লোকাল জেনারেশন): 「Erika - Mahouka Koukou No Rettousei」(স্কোর 16), 「Colors in Quiet Water」(স্কোর 14), 「Giant Wire Walker」(স্কোর 11), 「Karin - Umi Monogatari」(স্কোর 13)—সবগুলোতেই civitai.com লিংক আছে।
  7. 「Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp」 https://lemmy.world/post/3243205 — GIMP-ধাঁচের non-destructive লেয়ার এডিটিং করা যায় এমন OSS UI পরিচিতি।
  8. 「Europäische KI- & LLM-Anbieter」(2026-02-15, euroai) — প্রযুক্তিগত সার্বভৌমত্ব ও তথ্য সুরক্ষার কথা বলা ইউরোপীয় ওপেন-সোর্স AI-র তালিকা পোস্ট; ছবি মডেলও অন্তর্ভুক্ত।
  9. 「Your Lemmy Crash Course to Free Open-Source AI」 https://lemmy.world/post/76020 — text-generation-webui, Automatic1111, ComfyUI+Pinokio-সহ লোকাল জেনারেশন টুলের প্রারম্ভিক গাইড।
সংকেত
  • ক্লোজড-সোর্সের সবচেয়ে বড় বিষয় হলো “Midjourney-র চিকিৎসা খাতে মোড়” বিতর্ক(স্কোর 40–73): ছবি জেনারেশনের মূল কাজ থেকে আল্ট্রাসাউন্ড ডায়াগনস্টিক যন্ত্রে ব্যবসায়িক মোড় নিয়ে technology/hackernews/techtakes—তিন কমিউনিটিতে পক্ষে-বিপক্ষে আলোচনা। Theranos তুলনায় ব্যঙ্গ বেশি দেখা গেলেও, প্রথমে সমালোচক এক পোস্টদাতার পরে সংশোধনের ঘটনাও আছে; মতামত স্থির নয়।
  • OpenAI Sora-কে “AI slop”-এর প্রতীক হিসেবে বারবার নিশানা করা হয়েছে। 2026 সালের মার্চ–এপ্রিলে অ্যাপ বন্ধ হওয়ার পরও Sora 2 API 2026 সালের 24 সেপ্টেম্বর বন্ধ হওয়ার মতো বিষয় আলোচনায় আছে।
  • ওপেন-সোর্সে Black Forest Labs (FLUX-ধারা) প্রায় একচ্ছত্র। FLUX 3 (ছবি + অডিওসহ 20-সেকেন্ড ভিডিও), FLUX.2-klein হালকা সংস্করণ, Creator Program, এবং Scorsese-র উপদেষ্টা হওয়া—প্রতি ত্রৈমাসিকে সুনির্দিষ্ট পদক্ষেপ দেখা যায়।
  • দৈনন্দিন সৃজনশীল কমিউনিটিগুলো (Stable Diffusion Art/Anime/Abstraction ইত্যাদি) সদস্যসংখ্যায় ছোট (2,000–5,000) হলেও SDXL, ComfyUI ও Krea2 লোকালি চালিয়ে 2026 সালের সেপ্টেম্বরেও প্রতিদিন পোস্ট করছে; এটি ওপেন-সোর্সের বাস্তব ব্যবহারের গভীরতা দেখায়।
  • অ্যান্টি-AI অনুভূতিও উপেক্ষণীয় নয়: c/fuck_ai-এর “AI নির্ভরতা থেকে বের হতে চাই” পোস্ট 83 স্কোর পেয়েছে, যা সাধারণ AI-সম্পর্কিত পোস্টের চেয়ে বেশি। Lemmy-জুড়ে AI জেনারেটেড কনটেন্টের প্রতি একটি অংশের বিরাগের ইঙ্গিত।
  • Lemmy-তে ক্লোজড-সম্পর্কিত খবর সাধারণত নতুন করে আবিষ্কৃত নয়; TechCrunch, The Register, WSJ-সহ প্রচলিত মিডিয়া নিবন্ধের পুনর্পোস্ট ও প্রতিক্রিয়াই মূল। প্রাথমিক তথ্য Lemmy-র বাইরে।
সীমাবদ্ধতা
  • Lemmy-র ব্যবহারকারী ও পোস্টসংখ্যা উভয়ই ছোট; Reddit-এর তুলনায় ছবি ও ভিডিও জেনারেশন AI-নির্দিষ্ট আলোচনা দুর্বল। বিশেষত Sora/Veo/Kling/Runway-কে গভীরভাবে আলোচনা করে এমন ভিডিও-কেন্দ্রিক কমিউনিটি পাওয়া যায়নি।
  • lemmy.world API-র পূর্ণপাঠ অনুসন্ধানের নির্ভুলতা কম; “AI image generation”-এর মতো সাধারণ কুয়েরিতে UN-এর বিশ্বমানচিত্র বা পেঁচার প্রজননের মতো অপ্রাসঙ্গিক পোস্টও উপরে আসত। Sora, Midjourney, FLUX-এর মতো নির্দিষ্ট মডেল নামে সীমিত করেই প্রাসঙ্গিক পোস্ট পাওয়া গেছে।
  • কিছু পাতা (lemmy.world/post/44721138, DLSS 5-সংক্রান্ত পোস্ট lemmy.world/post/44347792) WebFetch-এ HTTP 500 অথবা কনটেন্ট-আহরণ ব্যর্থতা দেখিয়েছে; মূল লেখা ও মন্তব্য যাচাই করা যায়নি। শিরোনাম ও WebSearch স্নিপেটের ভিত্তিতেই বিচার করা হয়েছে।
  • Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana (Gemini), Veo-র মতো সাম্প্রতিক প্রধান মডেল নামে Lemmy-তে অনুসন্ধান করা হলেও সরাসরি উল্লেখ খুব কম ছিল (Grok Imagine চলচ্চিত্র তৈরির প্রসঙ্গে শুধু 1টি)। Lemmy-তে এগুলোর আলোচ্যতা কম বলাই যায়।
  • lemmy.ml ও lemmy.ee-তে আলাদা অনুসন্ধানেও ফল lemmy.world-এর সঙ্গে মিলে গেছে বা Fediverse ফেডারেশনে একই পোস্ট মিরর পাওয়া গেছে; পৃথক অতিরিক্ত তথ্য মেলেনি।

Pinterest

Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ

সংগ্রহ করা 50টি পিনের সব ছবিই খোলা ও দেখা হয়েছে (বিষয়ভিত্তিক ভাগ ছিল না; একক অনুসন্ধান কুয়েরি “Image and Video Generation AI News”-এর ফল হিসেবে একসঙ্গে সংগৃহীত)।

দৃশ্যগত থিম(visual themes)
  • “রোবট মুখ + ব্রেকিং নিউজ” টেমপ্লেটের আধিক্য:সাদা মানবসদৃশ রোবটের অর্ধ-মুখের ক্লোজআপের সঙ্গে “AI NEWS” বা “BREAKING NEWS” লাল-নীল নিয়ন লেখা—এমন থাম্বনেইল বারবার এসেছে। সংবাদ পাঠকের ডেস্কে বসা রোবট [22], বিস্মিত মুখের পুরুষ YouTuber ও রোবট মুখের সংমিশ্রণ [29], “THE FUTURE IS AI” লেখা নারী রোবট [39]—ডার্ক নেভি × নিয়ন (সায়ান/ম্যাজেন্টা/কমলা) রঙের ব্যবহার প্রভাবশালী।
  • YouTuber-এর প্রতিক্রিয়ামুখ থাম্বনেইল:বিস্মিত বা সন্দেহপ্রবণ সাদা পুরুষের মুখের ছবির সঙ্গে OpenAI, Google, Meta, Anthropic, Grok, Notion ইত্যাদির লোগো গোল নিয়ন-বর্ডার আইকনে সাজানো বিন্যাস একাধিক পিনে পুনরাবৃত্ত [4, 18]। সম্ভবত YouTube ভিডিওর পুনঃপ্রকাশ।
  • “সেরা কয়েকটি” সংকলন ইনফোগ্রাফিক(listicle):বেগুনি থেকে কালো ডার্ক থিমে নম্বরযুক্ত কার্ডে টুল সাজানো লম্বা ইনফোগ্রাফিক সবচেয়ে প্রচলিত ফরম্যাট। Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI, Hailuo AI প্রায় স্থির সদস্য হিসেবে বারবার দেখা গেছে [9, 10, 27, 36, 50]।
  • Before/After ও তুলনামূলক কুইজ ফরম্যাট:“Which is AI?” লেখা পাশাপাশি দুটি পাহাড়ের ছবি [13], বা উৎস ভিডিওকে কাঠের ব্লক/ওরিগামি/লেগো/ফুল দিয়ে বানানো চরিত্রে রূপান্তরের গ্রিড [11]—জেনারেটিভ AI-এর শনাক্ত করা কঠিন হওয়া ও উপাদান রূপান্তর ক্ষমতা তুলে ধরে।
  • রোবট × মানুষের সহযোগিতা/চিকিৎসা দৃশ্য:চিকিৎসাকর্মীর পাশে সাদা মানবসদৃশ রোবটের হোলোগ্রাম পরিচালনার ফটোরিয়ালিস্টিক CG [3, 33], কিংবা স্টেথোস্কোপ পরা চিকিৎসক ও রোবটের ছবি [32]—AI ও মানুষের সহাবস্থান দেখানো শান্ত রঙের ভিজ্যুয়ালও কিছু আছে।
  • গাঢ় রং × নিয়ন দিয়ে প্রযুক্তির আবহ:নীলচে কালো পটভূমিতে সায়ান/ম্যাজেন্টা/বেগুনি নিয়ন সার্কিট ও আলোর কণা—প্রায় পুরো ফলাফলের (প্রায় 7০%) সাধারণ প্রভাবশালী রঙের ধরন; Pinterest-এর “প্রযুক্তি সংবাদচিত্র”-এর একটি নির্দিষ্ট স্টাইল বলে মনে হয়।
  • অবতার/আইকন ব্যক্তিত্বকেন্দ্রিক AI ভিডিও জেনারেশন বিজ্ঞাপন:Fiverr-ধাঁচের ফ্রিল্যান্স বিক্রির “AI video creation explainer” বিজ্ঞাপনে Jeff Bezos-এর মুখে সংমিশ্রিত ছবি [38], বা AMD-এর অফিসিয়াল ‘Amuse 3.0’ ফটোরিয়ালিস্টিক ডেমো—বৃদ্ধ জেলের মুখ [46]—খ্যাতিমান মুখ বা বাস্তবসম্মত পোর্ট্রেটকে AI মানের প্রচারে ব্যবহার করা একাধিক পিন।
  • AI-জেনারেশন ধরা পড়ে কি না, সেটিকেন্দ্রিক ছবি:রোবট স্মার্টফোনে তাকিয়ে “FAKE” স্ট্যাম্প ও বিড়ালের ছবি, মুখোশধারী ব্যক্তির সিলুয়েট তুলনা [3], AI শনাক্তকরণ টুলের পরিচিতি [37]—সত্যতা যাচাই ও বিভ্রান্তিকর তথ্যের আশঙ্কা দৃশ্যমান করা পিন বারবার এসেছে।
উল্লেখযোগ্য পিন(notable pins)
  • [11] Luma AI-ধাঁচের উপাদান রূপান্তর ডেমো:একই উৎস ভিডিও—মানুষ, পান্ডা পুতুল, গাড়ি—“কাঠের ব্লক”, “ওরিগামি”, “লেগো ব্লক”, “ফুল”-এ বদলে দেওয়া 5 ধরনের গ্রিড তুলনা। ভিডিও জেনারেশন AI-এর টেক্সচার রূপান্তর ক্ষমতার সবচেয়ে নির্দিষ্ট পিন।
  • [24] ByteDance ও Hollywood-এর AI কপিরাইট সমঝোতা:“ByteDance and Hollywood reach global deal on AI copyright” শিরোনাম। ByteDance Motion Picture Association (MPA)-এর সঙ্গে AI ছবি ও ভিডিও জেনারেশন টুলের মেধাস্বত্ব সুরক্ষা জোরদারে বৈশ্বিক চুক্তিতে পৌঁছেছে—এমন সংবাদ নিবন্ধের স্ক্রিনশট। ক্লোজড-সোর্স বড় প্রতিষ্ঠানের কপিরাইট পদক্ষেপের প্রাথমিক তথ্যের কাছাকাছি।
  • [35] 2026 সালের 12 আগস্টের AI সংবাদ সংকলন:“Grok 4.6 drops” (স্বয়ংক্রিয়ভাবে কয়েক ডজন ধাপের কাজ করে, নিজে যাচাইও করে), “Gemini hits 1 billion users” (Google-এর ইতিহাসে সবচেয়ে দ্রুত 100 মিলিয়ন ব্যবহারকারী, তিনজনের দুজন ভয়েস ইনপুট ব্যবহার করে, দিনে 150 মিলিয়ন ছবি জেনারেট হয়), “Honor's robot phone” (পেছন থেকে টাইটানিয়াম আর্ম বেরিয়ে বিষয়কে স্বয়ংক্রিয় ট্র্যাক করে এমন ক্যামেরা)—তিনটি খবর। তারিখ ও সংখ্যা উল্লেখিত হওয়ায় বিরল প্রাথমিক-তথ্যধর্মী পিন।
  • [36] “Best AI Video Generators of 2026” র‌্যাঙ্কিং:Google Veo 3.1, Runway Gen 4.5 ও Kling 3.0 মুকুটচিহ্নসহ সেরা 3; এরপর Adobe Firefly, Seedance 1.5 Pro, Pika 2.5, HeyGen। সংস্করণ নম্বরসহ সাম্প্রতিক মডেল প্রজন্মের তালিকা।
  • [42] Vidu S1(ShengShu Technology):“The World's Most Advanced Model for Real-Time AI Interaction” দাবিসহ চীনা রিয়েল-টাইম ইন্টার‌্যাকটিভ AI ভিডিও মডেলের পণ্য ভিজ্যুয়াল। পশ্চিমা মডেল-একচেটিয়া প্রবণতার বাইরে চীনা খেলোয়াড়ের বিরল উদাহরণ।
  • [45] OpenAI-এর নতুন ছবি জেনারেশন টুলের পূর্বাভাস নিবন্ধ:“OpenAI's Secret Image Generation Tool to Debut Soon” শিরোনাম-সংবলিত নিবন্ধচিত্র। অপ্রকাশিত টুল নিয়ে প্রত্যাশা তৈরি করে।
  • [25] Google I/O 2026 বিশেষ সংকলন:Gemini 3.5 Flash, Gemini Omni, Gemini Spark ঘোষণা, AI সার্চে পরিবর্তন, Apple ও Google XR স্মার্টগ্লাস প্রতিযোগিতাসহ 2026 সালের 20 মে-তারিখের শিল্পখাতের সারাংশ। শুধু ছবি জেনারেশন নয়, পারিপার্শ্বিক ইকোসিস্টেমও বোঝায়।
  • [9] “Just Nail It” ভিডিও জেনারেশন টুল তুলনা ইনফোগ্রাফিক:Runway, Pika, Kling AI, Luma AI, Canva AI, Hailuo AI—এই 6টি টুলকে ফিচার ও লক্ষ্য ব্যবহারকারী অনুযায়ী সাজানো; “2026 সালের মধ্যে অনলাইন কনটেন্টের 80% ভিডিও অন্তর্ভুক্ত করবে” পরিসংখ্যানও আছে।
  • [8] স্টক ফটো উপাদানের AI কনটেন্ট জেনারেশন আইকন সেট:Adobe Stock-ধাঁচের “Ai Content Creation Concept” স্টক ছবি, যেখানে টেক্সট, ছবি, সংগীত ও ভিডিও জেনারেশনের আইকন আছে। প্রকৃত খবরের চেয়ে উপাদান চাহিদার মাত্রা বেশি নির্দেশ করে।
  • [43] জেনারেটিভ AI-এর ইতিহাসের টাইমলাইন ইনফোগ্রাফিক:1950-এর ELIZA থেকে 2020-এর GPT পর্যন্ত বেগুনি রঙের টাইমলাইন। বর্তমান জেনারেটিভ AI উত্থানকে ঐতিহাসিক প্রেক্ষাপটে রাখে।
সংকেত(signals)
  • ওপেন/ক্লোজড দ্বৈততা শুধু ছবি থেকে বোঝা কঠিন:Pinterest পিন মূলত “টুল পরিচিতি”, “নিউজ থাম্বনেইল” ও “কীভাবে করবেন” সংকলন; Reddit/X-এর “Seedance বনাম Wan”-এর মতো স্পষ্ট ওপেন বনাম ক্লোজড তুলনা নেই। [42]-এর Vidu S1 (চীনা ShengShu) ও [46]-এর Amuse 3.0 (AMD-সম্পর্কিত, লোকাল জেনারেশনের কাছাকাছি) বড় ক্লোজড মার্কিন খেলোয়াড়—Google Veo, OpenAI Sora, Runway—এর বিকল্প হিসেবে কিছুটা দৃশ্যমান।
  • সংকলন, তুলনা ও হাউ-টু কনটেন্ট প্রধান; ব্রেকিং নিউজ সংখ্যালঘু:50টির মধ্যে তারিখ বা নির্দিষ্ট ঘোষণাসহ প্রাথমিক-তথ্যঘেঁষা পিন মূলত [24][25][35][45]; বাকি অধিকাংশ “Best AI Video Generators”, “10 Smart Ways”-এর মতো evergreen listicle বা অ্যাফিলিয়েট-উদ্দেশ্যপূর্ণ, Pinterest-এ সংরক্ষণযোগ্য কনটেন্ট।
  • উদ্বেগ ও সত্যতা যাচাইয়ের আগ্রহ দৃশ্যমান:[3][22][37]-এর মতো “FAKE” স্ট্যাম্প, রোবট সংবাদকর্মী, AI শনাক্তকরণ টুল নিয়ে ছবি একাধিক রয়েছে; Pinterest ব্যবহারকারীদের মধ্যেও AI কনটেন্ট নিয়ে সন্দেহ ও সত্যতা যাচাইয়ের আগ্রহ আছে।
  • মডেল প্রজন্ম দ্রুত বদলাচ্ছে:[36]-এ Veo 3.1, Runway Gen 4.5, Kling 3.0 ও Seedance 1.5 Pro—2026 সালের সাম্প্রতিক সংস্করণ সংখ্যা দেখা যায়; [35]-এর Grok 4.6 ও Gemini 1B users-এর সঙ্গে মিলিয়ে বোঝা যায় ত্রৈমাসিকভিত্তিক সংস্করণ আপডেট স্বাভাবিক হয়ে গেছে।
  • অনুপস্থিতি:Reddit-এ ঘন ঘন দেখা “লোকাল, স্ব-হোস্টেড ওপেন-ওয়েট” সংস্কৃতির প্রতীক Stable Diffusion/ComfyUI/Hugging Face-সংক্রান্ত ছবি 50টির মধ্যে শূন্য। Pinterest-এর ছবি সার্চ ফল বাণিজ্যিক টুল ও SaaS পণ্যের প্রচারসামগ্রীতে প্রবলভাবে ঝুঁকে; প্রকৃত ওপেন-সোর্স কমিউনিটি প্রকাশ প্রায় অদৃশ্য।
সীমাবদ্ধতা
  • সংগ্রহটি আগে থেকে করা কর্মীর হেডলেস ব্রাউজারভিত্তিক; এই এজেন্ট Pinterest সরাসরি ব্রাউজ করেনি, প্লেবুক অনুযায়ী।
  • বিষয়ভিত্তিক ভাগ (## <genre> (n) সেকশন) করা হয়নি; 50টি ফল একক কুয়েরির একত্রিত ফল। বিষয়ভেদে প্রবণতা তুলনা করা যায়নি।
  • “(untitled)” শিরোনামের পিন 5টি ([5, 13, 15, 20, 24]—[24]-এ শিরোনাম না থাকলেও নিবন্ধের হেডলাইন ছবি থেকে বিষয় বোঝা গেছে); Pinterest থেকে শিরোনাম টেক্সট পাওয়া যায়নি।
  • প্রতিটি পিনের URL (pinterest.com/pin/...) থাকলেও প্রকৃত লিংক খুলে যাচাই করা হয়নি; শুধু ছবি ও শিরোনাম থেকে বিচার করা হয়েছে। Pinterest-এ পোস্টের তারিখ, লাইক ইত্যাদি এনগেজমেন্ট তথ্য সংগ্রহ হয়নি; [25][35]-এর মতো ছবিতে তারিখ লেখা থাকলে ছাড়া সময় নির্ধারণ করা যায়নি।
  • “ক্লোজড সোর্স ও ওপেন সোর্সে ন্যূনতম 10টি করে পর্যবেক্ষণ”—এই সম্পন্নের মানদণ্ডে Pinterest-এ নির্দিষ্ট ওপেন-সোর্স পর্যবেক্ষণ অপ্রতুল ([42]-এর চীনা মডেল, [46]-এর AMD-সম্পর্কিত উদাহরণ মাত্র)। এই ঘাটতি অন্য প্ল্যাটফর্ম—বিশেষত Reddit—এর ফল মিলিয়ে পূরণ করতে হবে।

সুপারিশকৃত পদক্ষেপ

  • X-এ বিষয়সংশ্লিষ্ট শব্দ—Midjourney, Stable Diffusion, Sora, Nano Banana, Qwen-Image ইত্যাদি—দিয়ে অনুসন্ধান প্রতিস্থাপন করে পুনরায় সংগ্রহ করুন
  • Reddit-এ পরের বার r/StableDiffusion, r/midjourney ও r/comfyui-সহ মূল বড় subreddit অন্তর্ভুক্ত করুন
  • Bluesky সার্চ API কাজ না করার বিকল্প হিসেবে এবার পাওয়া প্রধান অ্যাকাউন্টগুলোকে নিয়মিত পর্যবেক্ষণের ওয়াচলিস্ট করুন
  • OpenAI-এর Sora API বন্ধ হওয়া (2026 সালের 24 সেপ্টেম্বর নির্ধারিত) এবং Midjourney-র ব্যবসায়িক পরিবর্তনের পরবর্তী খবরকে পরের বার সর্বোচ্চ অগ্রাধিকার দিন

সংগৃহীত ছবি

Image to Video AI: এটি কীভাবে কাজ করে এবং কেন গুরুত্বপূর্ণ - The Data Scientist🎨 AI ছবি ও ভিডিও তৈরিAI কনটেন্ট ও সামাজিক মাধ্যম নিয়ে উদ্বেগAI সংবাদ: Anthropic লিক AI-এর ভবিষ্যৎ দেখাচ্ছে...ছবিচূড়ান্ত AI ছবি ও ভিডিও জেনারেশন প্ল্যাটফর্ম - The Data ScientistGoogle Veo 2 উন্মোচন করেছে: উন্নত AI ভিডিও জেনারেশন...টেক্সট, ছবি, সংগীত ও ভিডিও জেনারেশনের আইকনসহ AI কনটেন্ট তৈরির ধারণা – 57টি স্টক ফটো, ভেক্টর ও ভিডিও দেখুনJust Nail It 🎥🎬 2026 সালের 10টি বিনামূল্যের AI ভিডিও টুল 🤯 ব্যয়বহুল সফটওয়্যার ছাড়াই ভিডিও তৈরি করুন!Google অতি-উচ্চমানের ভিডিও ঘোষণা করেছে...ছবি ও ভিডিও জেনারেশনের জন্য AIছবিAI ভিডিও কনটেন্ট তৈরি: উচ্চ আয়কারীরা,...ছবিAI-জেনারেটেড ভিডিও: ভালো না খারাপ? সত্যটি জানুন! 🤖🎥Veo 3 ছবি-থেকে-ভিডিও: Gemini API-র মাধ্যমে দ্রুত জেনারেশন ও নেটিভ অডিওAI সংবাদ: OpenAI অবশেষে যা চেয়েছিলাম তা প্রকাশ করেছে️ ছবি থেকে ভিডিও AI – AI দিয়ে আপনার ছবি প্রাণবন্ত করুনছবিGrok কীভাবে ভিডিওতে বিপ্লব আনছে দেখুন...‎🚨 AI ভীতিকর রকম ভালো হয়ে উঠছে।2025 সালের সেরা AI ভিডিও জেনারেটরছবিছবিএখন YouTube-এর 20%-এর বেশি AI-জেনারেটেড2026 সালের 5+ সেরা AI ভিডিও জেনারেশন ওয়েবসাইট | Runway, Pika, Kling AI, Canva ও আরওকৃত্রিম বুদ্ধিমত্তা: আসুন আমরা বজায় রাখি আমাদের...AI ভিডিও তৈরি: দ্রুত আকর্ষণীয় ভিডিও তৈরির 10টি স্মার্ট উপায়Imagvio AI কী এবং এটি নির্মাতাদের কীভাবে সাহায্য করে...AI-চালিত ছবি ও ভিডিও বিশ্লেষণকৃত্রিম বুদ্ধিমত্তার সম্ভাব্য প্রভাব...AI2026 সালে নির্মাতারা কনটেন্ট বানাতে যে AI ভিডিও এডিটিং টুল ব্যবহার করেনব্রেকিং নিউজ: সাম্প্রতিক AI উন্নয়ন - Grok 4.6 Gemini 1B Honor Robot Phoneভিডিও তৈরির ভবিষ্যৎ: 2026 সালের সেরা AI ভিডিও জেনারেটর🔸অনলাইনে বিনামূল্যে AI-জেনারেটেড ছবি শনাক্ত করার উপায়আমি synthesia sora ai kling ai runway ai invideo দিয়ে AI ভিডিও ব্যাখ্যামূলক কনটেন্ট তৈরি করবপেশাদার AI ভিডিও তৈরি | সিনেম্যাটিক AI ভিডিও | কাস্টম ভিডিও এডিটিংAI ভিডিও তৈরি: AI দিয়ে দ্রুত পেশাদার ভিডিও বানানোর পূর্ণাঙ্গ গাইডAI কীভাবে ভিডিও এডিটিং বদলে দিচ্ছেShengShu Technology Vidu S1 উন্মোচন করেছে, AI ভিডিওতে রিয়েল-টাইম ইন্টার‌্যাকটিভ জেনারেশন এনেছেজেনারেটিভ AI-এর ইতিহাসভিডিও ও AI দক্ষতা: 2025 সালের প্রধান সামাজিক মাধ্যম বিপণন প্রবণতাOpenAI-এর গোপন ছবি জেনারেশন টুল শিগগিরই আসবে‘Amuse 3.0’, একটি AI আর্ট তৈরির টুল যাতে রয়েছে...ইন্টারনেট ব্যবহারকারীদের সবচেয়ে চমকপ্রদ সৃষ্টিগুলো...আপনার ধারণাকে দারুণ ভিজ্যুয়ালে রূপ দিন! 🎥ভাইরাল Tiny People AI ইফেক্ট—তৈরি করার উপায় জানুন!2026 সালের 12টি সেরা AI ভিডিও জেনারেটর (ফ্রি ও পেইড) | Google Veo, Sora, Runway ও আরও

ডেটার গুণমানের নোট

X-এ অনুসন্ধান শব্দের অমিলের কারণে বিষয়সংশ্লিষ্ট একটি পোস্টও সংগৃহীত হয়নি, ফলে ডেটা নেই। Bluesky, Pinterest ও YouTube-এ এনগেজমেন্ট পরিসংখ্যান বা সার্চ API আংশিকভাবে অনুপলব্ধ ছিল, তাই কিছু অংশে পরিমাণগত সমর্থন দুর্বল।

গ্যালারি