KEN’S CAT LOG

ছবি ও ভিডিও জেনারেশন AI সংবাদ — 2026-09-24

ক্লোজড-সোর্স ছবি/ভিডিও AI দাম ও গতির প্রতিযোগিতায় এগিয়ে যাচ্ছে (GPT-6 Sol/Luna, ChatGPT Images 2.5, Kling 3.0), অন্যদিকে ওপেন-ওয়েট মডেলগুলো ভিডিওর গুণমানে সরাসরি জয় দাবি করতে শুরু করেছে (Wan 3.0)। তবে কয়েকটি ‘ওপেন সোর্স’ রিলিজ—Wan 3.0-এর পরবর্তী ওয়েট, FLUX 3 এবং MiniMax H3-এর লাইসেন্সিং—বিজ্ঞাপিত দাবির চেয়ে বেশি বন্ধ বা সীমাবদ্ধ বলে প্রমাণিত হচ্ছে।

ছবি ও ভিডিও জেনারেশন AI সংবাদসংক্ষেপ🔥🎨🎬 — 2026-09-24

অবিশ্বাস্য—এই সপ্তাহেও ছবি ও ভিডিও জেনারেশন AI জগত ভীষণ অগোছালো ছিল😂। এক কথায় বললে, “🔒 ক্লোজড প্লেয়াররা দাম কমানো ও গতির প্রতিযোগিতায় জোর দিচ্ছে, আর 🔓 ওপেন প্লেয়াররা ভিডিও জেনারেশনে সত্যিকারের চ্যাম্পিয়ন হয়ে উঠছে” এমনই চিত্র! GPT-6 Sol/Luna-এর মতো নতুন মডেল একের পর এক আসছে ও সস্তা হচ্ছে, আবার Wan 3.0-এর মতো ওপেন-ওয়েট মডেল ভিডিও বিভাগে শীর্ষে উঠেছে—বিষয়টি সত্যিই উত্তেজনাপূর্ণ🔥। কিন্তু একই সময়ে “AI ছবি ধরা পড়ে বিতর্ক”, “মামলার চাপ”, “ওপেন-সোর্স নামে বিভ্রান্তি”—এসব অন্ধকার দিকও প্রচুর, তাই বিষয়টি আর শুধু “AI দারুণ” বলে উড়িয়ে দেওয়ার মতো নেই😅।

প্ল্যাটফর্মজুড়ে 🌐

  • 🔒 দাম কমানো ও দ্রুততার প্রতিযোগিতা সত্যিই ত্বরান্বিত হচ্ছে। X-এ GPT-6 Sol/Luna ঘোষণার মূল আকর্ষণ পারফরম্যান্স বৃদ্ধির চেয়ে “সস্তা ও দ্রুত” হওয়া। YouTube-এর ChatGPT Images 2.5 (জেনারেশন সময় -50%) এবং Kling 3.0-এর AI Director (এক জেনারেশনে একাধিক শট = খরচ কমানো)-ও একই ধারার অংশ। বিভিন্ন প্ল্যাটফর্মে একই কথা শোনা যাচ্ছে, তাই এটি বাস্তব প্রবণতা বলেই মনে হচ্ছে💸
  • 🔓🔒 ছবিতে ক্লোজড মডেল শক্তিশালী, ভিডিওতে ওপেন মডেল হয়তো এগিয়ে গেছে। Bluesky-এর ট্র্যাকিং বট olud.ai-এর ব্লাইন্ড মূল্যায়নে ছবি তৈরি ও সম্পাদনা—দুই ক্ষেত্রেই GPT Image 2.5 Sunburst🔒 শীর্ষে। সবচেয়ে শক্তিশালী ডাউনলোডযোগ্য মডেল Qwen-Image-3.0-Pro🔓 100+ ELO পয়েন্ট পিছিয়ে। কিন্তু ভিডিও বিভাগে Wan 3.0🔓 সব ক্লোজড প্রতিদ্বন্দ্বীকে পেরিয়ে প্রথম হয়েছে বলে রিপোর্ট এসেছে—এটাই সবচেয়ে নজরকাড়া বিষয়👀
  • ⚖️ মামলা ও নিয়ন্ত্রণমূলক চাপ উল্লেখযোগ্যভাবে বেড়েছে। Bluesky সূত্রে Disney v. Midjourney এবং Andersen v. Stability AI মামলায় 9/23-এ একসঙ্গে অগ্রগতি দেখা গেছে। Reddit r/CriticalState-এ watermark বাধ্যতামূলক করা ও AI প্রকাশ বাধ্যতামূলক করার বিল নিয়ে মোট 1.8 লাখের কাছাকাছি মন্তব্য হয়েছে। AI-তৈরি জিনিস দেখে মানুষ এখন “এটা কি আসল?” বলে ক্ষুব্ধ😤
  • 🎭 “ধরা পড়ে হাসির পাত্র হওয়া AI” এবং “ধরা না পড়ে ভাইরাল হওয়া AI”—দুটিই একসঙ্গে ঘটছে। Reddit-এ রিয়েল-এস্টেট ছবি, Nikon মাইক্রোস্কোপ ভিডিও, বিশ্ববিদ্যালয়ের দেয়ালের ছবি এবং Pinterest-এ NBC-র “AI GENERATED” লেবেল ও ভুয়া-কনটেন্ট মিম—সবই তীব্র সমালোচনার মুখে পড়েছে। অথচ r/Instagramreality-এ AI ছবি ধরা না পড়ে হাজার হাজার আপভোট পাওয়ার ঘটনাও এসেছে; একই পরিবেশে বিপরীত দুই বাস্তবতা চলছে😳
  • 🔓 “ওপেন সোর্স” দাবি করলেও বাস্তবে ভিন্ন হওয়ার সমস্যা বাড়ছে। YouTube-এ আলোচিত FLUX 3🔒 (শিরোনামে "Open Source", কিন্তু বাস্তবে কেবল প্রাথমিক-অ্যাকসেস ক্লোজড সংস্করণ), Wan 3.0 (আগের সংস্করণগুলো ওপেন-ওয়েট হলেও v3.0-এ ওয়েট অপ্রকাশিত API-সীমিত সংস্করণ), MiniMax H3🔓 (Hugging Face-এ ওয়েট প্রকাশিত, কিন্তু যুক্তরাষ্ট্র, EU, যুক্তরাজ্য ও দক্ষিণ কোরিয়ায় ব্যবহার নিষিদ্ধ)—“ওপেন”-এর সংজ্ঞা ক্রমেই অস্পষ্ট হয়ে যাচ্ছে; এটি সত্যিই সতর্কতার বিষয়⚠️

প্ল্যাটফর্ম অনুযায়ী 📱

  • Reddit — মাত্র 12টি থ্রেড পাওয়া গেছে, লক্ষ্য 20-এ পৌঁছানো যায়নি😢। r/StableDiffusion-এর মতো বিশেষজ্ঞ কমিউনিটি একটিও ছিল না। মূলত r/mildlyinfuriating-এর AI রিয়েল-এস্টেট ছবি (2.6 লাখ pt) এবং r/labrats-এর AI দিয়ে “বাড়িয়ে তোলা” মাইক্রোস্কোপ ভিডিও প্রতিযোগিতায় জিতে বিতর্কে পড়ার মতো সাধারণ ব্যবহারকারীর “AI ধরা পড়ে গেল” প্রতিক্রিয়াই ছিল কেন্দ্রবিন্দু। পণ্যের খবর প্রায় ছিল না।
  • X — সেশনটি ক্রোয়েশিয়া অঞ্চল হিসেবে শনাক্ত হওয়ায় Explore ট্রেন্ডের বেশির ভাগ (ক্রিপ্টো, Taylor Swift ইত্যাদি) অপ্রাসঙ্গিক ছিল🙄। তবুও GPT-6 Sol/Luna ঘোষণা এবং Opus 5.5-কে Higgsfield/After Effects/Blender “চালানো অর্কেস্ট্রেটর” হিসেবে ব্যবহারের পোস্টগুলো (উদাহরণ) পাওয়া গেছে। তবে ওপেন-সোর্স সম্পর্কিত আলোচনার সংখ্যা কার্যত শূন্য🔓❌।
  • YouTube — পৃথক ভিডিওর চ্যানেল নাম ও ভিউ সংখ্যা পৃষ্ঠা থেকে পাওয়া যায়নি😩 (নিচে বিস্তারিত)। তবু বিষয়বস্তুর দিক থেকে সবচেয়ে বিস্তৃত ছিল: Nano Banana Pro🔒, Kling 3.0🔒, Wan 3.0🔓 (ওয়েট অপ্রকাশিত হওয়া), LTX-2.3🔓 (অডিও ও ভিডিও একসঙ্গে জেনারেশন), Qwen-Image-2512🔓, এবং FLUX 3🔒/🔓-এর ব্র্যান্ডিং ও বাস্তবতার ফারাক—দুই শিবিরেরই নির্দিষ্ট অগ্রগতি এতে ধরা পড়েছে।
  • Bluesky — সার্চ API (searchPosts) সব কুয়েরিতে 403 দিলেও, অ্যাকাউন্ট খোঁজা ও getAuthorFeed দিয়ে বিকল্প পথে তথ্য সংগ্রহ করা গেছে💪। olud.ai-এর ELO লিডারবোর্ড (GPT Image 2.5 Sunburst🔒 ছবি বিভাগে শীর্ষ, Wan 3.0🔓 ভিডিও বিভাগে শীর্ষ), ai.bots.law-এর মামলা-সংবাদ বট এবং ComfyUI🔓-এর 13.4 লাখ star অর্জনের তথ্য পাওয়া গেছে; পরিসংখ্যানসহ তথ্যের ঘনত্ব এখানে সবচেয়ে বেশি।
  • Lemmy — আকারে অত্যন্ত ছোট (ai_reddit কমিউনিটিতে সাবস্ক্রাইবার মাত্র 52 জন), কিন্তু !«メールアドレス» হলো ComfyUI/ওপেন-ওয়েট ব্যবহারকারীদের শক্ত ঘাঁটি🔓। Sora API বন্ধ হওয়া বনাম Kling-এর 300 কোটি ডলার তহবিল সংগ্রহ🔒 তুলনামূলক নিবন্ধ এবং Midjourney-এর আলট্রাসাউন্ড স্ক্যানার ব্যবসা নিয়ে “Theranos-সদৃশ” সমালোচনার মতো ব্যবসায়িক গসিপও উল্লেখযোগ্য।
  • Pinterest — এনগেজমেন্ট সংখ্যা (লাইক বা সেভ) পাওয়া যায়নি; কেবল ছবির বিষয়বস্তু বিশ্লেষণ করা হয়েছে। 50টির মধ্যে ChatGPT, Gemini, Veo, Kling, Midjourney, Adobe Firefly ইত্যাদি ক্লোজড ব্র্যান্ডের উপস্থিতি প্রবল। ওপেন/লোকাল টুলিংয়ের ইঙ্গিত মেলে মাত্র একটিতে (AMD-এর জন্য Amuse 3.0)🔓😶। “AI-জেনারেটেড কনটেন্টে বিশ্বাস করা যায়?” ধরনের উদ্বেগ-ভিত্তিক পিনও চারটি আলাদাভাবে পাওয়া গেছে।

নজরে রাখুন 👀

  • Wan 3.0-এর ওয়েট প্রকাশের অবস্থা — Bluesky লিডারবোর্ডে এটি ভিডিও বিভাগে শীর্ষ🔓, কিন্তু YouTube বলছে এটি ওয়েট অপ্রকাশিত API-সীমিত বিটায় রূপ নিয়েছে। দুই তথ্য পরস্পরবিরোধী; যাচাই জরুরি (Bluesky পোস্ট / YouTube)
  • Disney v. Midjourney / Andersen v. Stability AI মামলার অগ্রগতি — 9/23-এ দুটিতেই নতুন পদক্ষেপ দেখা গেছে; রায়ের ওপর শিল্পজুড়ে প্রশিক্ষণ ডেটা ব্যবহারের নিয়ম বদলে যেতে পারে (Bluesky/ai.bots.law)
  • Sora API বন্ধ বনাম Kling-এর 300 কোটি ডলার তহবিল — ভোক্তামুখী AI ভিডিও থেকে আয় কঠিন হলেও, এন্টারপ্রাইজ ব্যবহারে সুযোগ বাড়ছে বলে ইঙ্গিত মিলতে পারে (Lemmy)
  • MiniMax H3 Community License-এর অঞ্চলভিত্তিক সীমাবদ্ধতা — “ওপেন-ওয়েট” হয়েও যুক্তরাষ্ট্র, EU, যুক্তরাজ্য ও দক্ষিণ কোরিয়ায় ব্যবহারযোগ্য নয়—এ ধরনের শর্ত ভবিষ্যতে মানদণ্ড হয়ে ওঠে কি না তা লক্ষ করা দরকার (YouTube)
  • AI প্রকাশ ও watermark বাধ্যতামূলক করার বিল — Reddit-এ প্রায় 1.8 লাখ মন্তব্য হয়েছে; নিয়ন্ত্রণ কোথা পর্যন্ত এগোয় তা নজরে রাখা দরকার (r/CriticalState)
  • GPT-6 Sol/Luna-এর বাস্তব ব্যবহারভিত্তিক পারফরম্যান্স — ঘোষণার পর প্রাথমিক সংশয়ী প্রতিক্রিয়া এসেছে যে মূল পরিবর্তন দাম কমানো, পারফরম্যান্সে তেমন নয় (X)

সুপারিশ ✅

  • Wan 3.0-এর ওয়েট প্রকাশের বিষয়ে তথ্য সাংঘর্ষিক, তাই এ নিয়ে লেখা বা সিদ্ধান্ত নেওয়ার আগে Hugging Face/অফিশিয়াল সাইটে বর্তমান অবস্থা যাচাই করুন।
  • “ওপেন সোর্স” দাবি করা মডেলগুলোর (যেমন FLUX 3) ক্ষেত্রে লাইসেন্সের ভাষা এবং সত্যিই ডাউনলোড করা যায় কি না—দুটিই যাচাই করুন; কেবল ব্র্যান্ডিংয়ে ভরসা করবেন না।
  • MiniMax H3-এর মতো অঞ্চল-সীমাবদ্ধ ওপেন-ওয়েট মডেল ব্যবহারের আগে লক্ষ করুন, আপনার দেশ বা অঞ্চল Community License-এ বাদ দেওয়া আছে কি না।
  • ভিডিও জেনারেশন AI ব্যবসায়িক কাজে ব্যবহার করতে চাইলে ভোক্তামুখী ফ্রি টিয়ারের চেয়ে এন্টারপ্রাইজ ব্যবহার—প্রশিক্ষণ বা পণ্য ডেমো—এখন বেশি সম্ভাবনাময়, এই প্রবণতা মাথায় রাখুন।
  • Disney/Andersen মামলার রায় আসার সময় নিয়মিত নজরদারি করুন এবং প্রশিক্ষণ-ডেটাসংশ্লিষ্ট ঝুঁকি নীতি হালনাগাদ রাখুন।
  • Reddit ও Pinterest-এ দেখা “AI ধরা পড়ে বিতর্ক” ধাঁচটি বিবেচনা করে, AI-তৈরি কনটেন্ট প্রকাশের সময় স্পষ্ট প্রকাশ-লেবেল ব্যবহার করুন।

ডেটার গুণমান 📊

  • Reddit: লক্ষ্য 20-এর বিপরীতে মাত্র 12টি। তাও সার্চ শব্দ ছিল একটিই ("Image and Video Generation AI News"); r/StableDiffusion-এর মতো বিশেষজ্ঞ সাবরেডিট একটিও ছিল না এবং ফলাফল সাধারণ মানুষের “AI ধরা পড়েছে” প্রতিক্রিয়ার দিকে ঝুঁকেছে।
  • X: সেশনে শুধু অঞ্চলনির্ভর (ক্রোয়েশিয়া) Explore ট্রেন্ড দেখা গেছে; বিষয়সম্পর্কিত 10টির মধ্যে মাত্র 3টি ট্রেন্ড। ওপেন-সোর্স উল্লেখ কার্যত শূন্য🔓❌।
  • YouTube: WebFetch বারবার Cookie সম্মতি পৃষ্ঠা (consent.youtube.com, অঞ্চল=HR)-এ রিডাইরেক্ট হয়েছে; ভিউ, চ্যানেল নাম বা মন্তব্য কিছুই পাওয়া যায়নি। বিষয়বস্তু WebSearch স্নিপেটনির্ভর।
  • Bluesky: অফিসিয়াল সার্চ API (searchPosts) সব কুয়েরিতে 403 দিয়েছে। অ্যাকাউন্ট আবিষ্কারভিত্তিক বিকল্প সংগ্রহ ব্যবহৃত হয়েছে, তাই এটি পুরো প্ল্যাটফর্মজুড়ে সার্চ ফল নয়।
  • Lemmy: প্ল্যাটফর্মটি খুব ছোট (ai_reddit কমিউনিটিতে 52 সাবস্ক্রাইবার); ভিডিও জেনারেশন AI-নির্দিষ্ট সার্চে কোনো ফল নেই। 20-এর লক্ষ্য বিপরীতে বাস্তবে প্রায় 14টি পোস্ট পাওয়া গেছে।
  • Pinterest: লাইক ও সেভের মতো এনগেজমেন্ট সূচক পাওয়া যায়নি; শুধু ছবি ও শিরোনাম বিশ্লেষণ করা হয়েছে। 50টির মধ্যে মাত্র 30টির মূল ছবি খোলা সম্ভব হয়েছে।

প্ল্যাটফর্মভিত্তিক সারসংক্ষেপ

Reddit

Reddit — ছবি ও ভিডিও জেনারেশন AI সংবাদ

কোথায়

10টি সাবরেডিটজুড়ে 12টি থ্রেড সংগ্রহ করা হয়েছে, সবই একক সার্চ শব্দ "Image and Video Generation AI News" দিয়ে পাওয়া:

Subreddit Members Threads collected
r/mildlyinfuriating 12,590,273 1
r/youtube 3,460,141 1
r/Instagramreality 1,155,685 1
r/LinkedInLunatics 1,081,995 1
r/labrats 726,552 1
r/generativeAI 156,580 2
r/Purdue 100,756 1
r/CriticalState 39,323 2
r/perchance 30,990 1
r/aivideomaking 7,568 1

এগুলোর কোনোটিই জেনারেটিভ-AI টুলের নিবেদিত কমিউনিটি নয় (r/StableDiffusion, r/midjourney, r/aivideo ইত্যাদি পাওয়া যায়নি)। নমুনাটি সাধারণ ব্যবহারকারী-ভিত্তিক সাবরেডিটে AI-তৈরি কনটেন্টের প্রতিক্রিয়া এবং দুটি ছোট টুল-সাপোর্ট সাব (r/generativeAI, r/aivideomaking)-এ সীমিত।

মানুষ কী বলছে
  • #1 (r/labrats, 933 পয়েন্ট, 123 মন্তব্য, 2026-09-23) — Nikon's Small World in Motion প্রতিযোগিতা-জেতা “মাইক্রোস্কোপি” ভিডিওটি AI-তৈরি/“উন্নত” করা বলে বেরিয়ে আসে; কোষের নড়াচড়া জীববৈজ্ঞানিকভাবে অসম্ভব ছিল। মাইক্রোস্কোপি বিশেষজ্ঞরা প্রতিবাদ করার পর Nikon AI ব্যবহারের কথা নিশ্চিত করে। শীর্ষ মন্তব্য (u/Barkinsons, 551 pts): “বৈজ্ঞানিক মাইক্রোস্কোপি ছবিতে AI টুলের কোনো স্থান নেই, কারণ আমাদের ছবিগুলোকে যতটা সম্ভব সত্যনিষ্ঠভাবে পুনরুৎপাদনের দায় আছে; আমরা যেভাবে দেখতে চাই সেভাবে নয়।”
  • #4 (r/mildlyinfuriating, 26,469 পয়েন্ট, 714 মন্তব্য, 2026-09-21) — AI দিয়ে সাজানো রিয়েল-এস্টেট তালিকার ছবি ঘরকে অবাস্তবভাবে বদলেছে—যেমন রেডিয়েটর সরিয়ে দেওয়া বা অসম্ভব জায়গায় পুল টেবিল যোগ করা। শীর্ষ মন্তব্য (u/slothboy, 5,706 pts): “ওই ডিনেটিকে বাথরুমে রূপান্তর করা পাঁচ অঙ্কের খরচের কাজ হবে।” পুরো সংগ্রহে এটি সর্বোচ্চ স্কোরের থ্রেড।
  • #5 (r/Instagramreality, 2,179 পয়েন্ট, 348 মন্তব্য, 2026-09-18) — Reddit-এই হাজার হাজার আপভোট পাওয়া AI-তৈরি ছবি ছবির মধ্যে baseboard trim ও tile line বদলে যাওয়ার কারণে পরে ধরা পড়ে। u/Habibti-Mimi81 (150 pts): “আমি হয় খুব বয়স্ক, নয়তো খুব বোকা—নিজে থেকে বুঝতেই পারতাম না যে এটি A I... আমরা সত্যিই দুঃখজনক ও বিপজ্জনক সময়ে বাস করছি।”
  • #10 and #12 (r/CriticalState) — AI watermark বাধ্যতামূলক (13,835 মন্তব্য, 1,256 pts, 2026-09-21) এবং কোম্পানির AI-ব্যবহার প্রকাশ বাধ্যতামূলক (4,537 মন্তব্য, 214 pts, 2026-09-18) করার পক্ষে দুটি আলাদা আইন-প্রস্তাব থ্রেড। শীর্ষ মন্তব্যে “I voted Yea ✅” প্রাধান্য পেয়েছে (সম্ভবত poll-bot-চালিত সাব), তবে মন্তব্যের পরিমাণ নিজেই প্রকাশ-নিয়ন্ত্রণের জোরালো চাহিদা দেখায়।
  • #2, #6, #7 (r/aivideomaking এবং r/generativeAI x2) — “ফ্রি AI ভিডিও জেনারেটর খুঁজছি” ধরনের প্রায় একই তিনটি থ্রেড (12 pts/36 মন্তব্য, 2 pts/24 মন্তব্য, 4 pts/29 মন্তব্য) Sep 19-20-এর মধ্যে পোস্ট হয়েছে। তিনটিতেই একমত উত্তর: ফ্রি টিয়ারে প্রায় 3-6 সেকেন্ডের ক্লিপেই সীমা। নিয়মিত মন্তব্যকারী u/Jenna_AI, একটি AI-support bot, ব্যাখ্যা করেছে যে ফ্রি টিয়ার প্রায় 6 সেকেন্ডের পর temporal consistency ধরে রাখতে পারে না। বারবার উল্লেখিত টুল: ComfyUI + FramePack (লোকাল, 16GB+ VRAM প্রয়োজন), Muse (Meta, ফ্রি, watermark নেই), Grok ($10/mo), Kling/Hailuo/Pixverse, Nanobanana/Veo via Google Flow।
  • #9 (r/perchance, 31 পয়েন্ট, 21 মন্তব্য, 2026-09-19) — Perchance AI-তে image-to-image মোড কেন নেই—এমন প্রশ্নের থ্রেড। শীর্ষ মন্তব্য (u/Dack_Blick, 32 pts): “Image to image বিপুল আইনগত ঝুঁকি ও দায় তৈরি করে।” অন্যরা আরও স্পষ্ট: u/DoctaRoboto (8 pts) বলেছে, “অবৈধ পর্ন ও deepfake-এর কারণে”; u/Separate-Prior-5985 বলেছে “Pedos।” এটি বিরল একটি ঘটনা, যেখানে একটি ওপেন/ফ্রি টুলের নির্মাতারা ইচ্ছাকৃত সক্ষমতা-সীমার ব্যাখ্যা দিচ্ছেন।
  • #8 (r/Purdue, 150 পয়েন্ট, 20 মন্তব্য, 2026-09-21) — বিশ্ববিদ্যালয়ের ইঞ্জিনিয়ারিং ভবনের দেয়ালে AI-তৈরি প্রচারচিত্র, অর্থহীন PCB layout-এর জন্য বিদ্রূপের শিকার। u/549013 (7 pts): “দেশের সেরা ইঞ্জিনিয়ারিং কলেজগুলোর একটির অর্ধেক লেকচার ভিডিও AI-তৈরি—পুরোনোগুলো আবার ব্যবহারও করতে পারেনি।”
  • #11 (r/LinkedInLunatics, 978 পয়েন্ট, 116 মন্তব্য, 2026-09-21) — “একজন অখ্যাত ব্যক্তির সঙ্গে বিখ্যাত ব্যক্তিদের একমত হওয়া” AI-তৈরি ছবি সম্বলিত LinkedIn পোস্ট। u/Humble_Daikon (318 pts): “AI Musk-কে ধূমপানরত বানিয়েছে, ভালোই—ওই লোকগুলিকে nightmare blunt rotation বলা Reddit মন্তব্যগুলো থেকেই বোধহয় শিখেছে।”
  • #3 (r/youtube, 5 পয়েন্ট, 22 মন্তব্য, 2026-09-17) — YouTube-এর AI-তৈরি ভিডিও chapter নিয়ে অভিযোগ, যা প্রতিটি ভিডিওতে দেখা যাচ্ছে। প্রতিক্রিয়া বিভক্ত: u/buildingduck ও u/meatmobile682 একে অনুপ্রবেশকারী ও অপ্রাসঙ্গিক বলেছে, আর u/ickN, u/lieutenatdan ও u/davesaunders একে সহায়ক/বিরক্তিকর নয় বলেছে।
সংকেত
  • বাড়ছে: শখের বাইরের ক্ষেত্রে অঘোষিত AI ছবির বিরুদ্ধে প্রতিক্রিয়া। এই রানে পাওয়া প্রতিটি সাধারণ-ব্যবহারকারী থ্রেডে—Nikon বিজ্ঞান প্রতিযোগিতা, রিয়েল-এস্টেট তালিকা, বিশ্ববিদ্যালয় ভবন, LinkedIn পোস্ট—প্রতিক্রিয়া ছিল সমালোচনামূলক বা বিদ্রূপাত্মক, উদযাপনমূলক নয়। ধাঁচটি হলো “বন্য পরিবেশে AI জঞ্জাল ধরা পড়েছে”, “দেখো কী দারুণ জেনারেশন” নয়।
  • বাড়ছে: নিয়ন্ত্রণের চাহিদা। r/CriticalState-এর দুটি আইন-প্রস্তাব থ্রেডে মোট প্রায় 18,000 মন্তব্য, যা এই সেটের অন্য সব থ্রেডের মন্তব্যসংখ্যাকে ছাড়িয়ে গেছে।
  • প্রত্যাখ্যাত: ভালো ফ্রি AI ভিডিও জেনারেশন আছে—এই ধারণা। তিনটি আলাদা থ্রেডেই “ফ্রি অপশন আছে?” প্রশ্নের উত্তর স্পষ্ট না; ফ্রি টিয়ার অল্প কয়েক সেকেন্ডেই সীমিত এবং লোকাল চালাতে অধিকাংশ পোস্টারের না থাকা হার্ডওয়্যার লাগে।
  • অপ্রত্যাশিত / মতভেদ: Reddit একই সঙ্গে এমন জায়গা যেখানে AI ছবি ধরা পড়ে উপহাসিত হয় (r/mildlyinfuriating, r/LinkedInLunatics, r/Purdue), আবার এমন জায়গাও যেখানে অচেনা AI ছবি হাজার হাজার আপভোট পায় (r/Instagramreality-এর #5 থ্রেডে Reddit-এর নিজের r/OUTFITS-এর AI পোস্টের বর্ণনা)। একই প্ল্যাটফর্ম কখনও সত্য উন্মোচক, কখনও অনিচ্ছাকৃত পরিবেশক।
  • উল্লেখযোগ্য অনুপস্থিতি: এই সেটে ওপেন-সোর্স বনাম ক্লোজড-সোর্স পণ্যের প্রকৃত সংবাদ—মডেল রিলিজ, বেঞ্চমার্ক, বা Stable Diffusion/Flux/Sora/Veo/Kling সংস্করণতুলনা—কোনোটিই নেই। সবচেয়ে কাছের উদাহরণ #9-এ Perchance কেন image-to-image বন্ধ রেখেছে তার আলোচনা; সেটি রিলিজ নয়, সক্ষমতা ও দায়বদ্ধতার গল্প।
সীমাবদ্ধতা
  • প্ল্যাটফর্মপ্রতি প্রায় 20টি থ্রেডের লক্ষ্যের বিপরীতে মাত্র 12টি পাওয়া গেছে। কর্মী মাত্র একটি সার্চ শব্দ—"Image and Video Generation AI News"—ব্যবহার করেছে; “Stable Diffusion”, “Sora”, “Midjourney”, “open source video generation” ইত্যাদি বিকল্প সার্চ করা হয়নি।
  • নিবেদিত জেনারেটিভ-AI টুল সাবরেডিট (r/StableDiffusion, r/midjourney, r/aivideo বা LocalLLaMA-ধাঁচের কমিউনিটি) পাওয়া যায়নি। তাই ক্লোজড বনাম ওপেন-সোর্স পণ্য-নির্দিষ্ট সংবাদ দুর্বল; সংগ্রহটি ব্যবহারকারী প্রতিক্রিয়া ও বিরূপতার দিকে বেশি ঝুঁকেছে।
  • playbook অনুযায়ী আমি নিজে Reddit ব্রাউজ করিনি (WebFetch/search Reddit প্রত্যাখ্যান করে); কর্মী সংগৃহীত output/reddit.threads.md ও .json থেকেই কাজ করেছি। ফলে বৃহত্তর সার্চে আরও লক্ষ্যভিত্তিক সংবাদ পাওয়া যেত কি না তা বলা যাচ্ছে না।

X

X — ছবি ও ভিডিও জেনারেশন AI সংবাদ

X-এর Explore (ক্রোয়েশিয়া থেকে পর্যবেক্ষিত সেশন, অঞ্চলনির্ভর) “Cardano”, “Opus 5.5”, “$SONG”, “Taylor”, “Astra”, “England”, “#uranium”, “OpenAI”, “Croats”, “NFTs”—এই 10টি ট্রেন্ড দেখিয়েছে। এর মধ্যে ছবি/ভিডিও জেনারেশন AI-সংশ্লিষ্ট কেবল Opus 5.5 / Astra / OpenAI; বাকি 7টি—ক্রিপ্টোকারেন্সি, Taylor Swift সম্পর্কিত গসিপ, ফুটবল বেটিং প্রচার, ইউরেনিয়াম মাইনিং স্টক, স্থানীয় বিষয় ও NFT mint ঘোষণা—বিষয়ের সঙ্গে সম্পর্কহীন। নিচে ওই তিন ট্রেন্ডের অধীনে সংগৃহীত পোস্টগুলোর বিশ্লেষণ দেওয়া হলো।

অ্যাকাউন্ট
  • @OpenAI(অফিশিয়াল, 52,200 likes / 1 পোস্ট)— GPT-6 Sol ও Luna লঞ্চ ঘোষণা করা একমাত্র অফিশিয়াল অ্যাকাউন্ট। এ স্থানে এনগেজমেন্টের সবচেয়ে বড় উৎস।
  • @npaka123(布留川英一, 283 likes / 1 পোস্ট)— পরিচিত AI ব্যাখ্যাকারী অ্যাকাউন্ট। Opus 5.5 নিয়ে একক পরীক্ষামূলক পোস্ট।
  • @seiiiiiiiiiiru(476 likes / 1 পোস্ট)— ভিডিও নির্মাতা। Opus 5.5 দিয়ে Higgsfield + After Effects নিয়ন্ত্রণ করে তৈরি লঞ্চ ভিডিও।
  • @kevin_t_ngo(2,451 likes / 1 পোস্ট)— একক পোস্ট হলেও এ দফার AI-সম্পর্কিত পোস্টে সবচেয়ে বড় প্রতিক্রিয়া (~152,000 views)। Opus 5.5-নির্মিত Blender rendering।
  • @aicreataro(325 likes / 1 পোস্ট)— MiniMax H3 উপাদানকে Opus 5.5 দিয়ে After Effects-এ প্রক্রিয়াকরণের পরীক্ষামূলক পোস্ট।
  • @sonia_code(377 likes / 1 পোস্ট)— Astra দিয়ে ব্রাউজারচালিত 3D scene তৈরির একক পোস্ট।
  • @yachimat_manga(73 likes / 1 পোস্ট)— AI শর্ট-অ্যানিমেশন নির্মাতা। Astra যুগের workflow নিয়ে চিন্তামূলক পোস্ট।
  • @mask_3dcg(মোট 1,813 likes / 2 পোস্ট)— 3DCG নির্মাতা। উভয় পোস্টের অবস্থান এক: “AI অ্যানিমেটরকে প্রতিস্থাপন করতে পারবে না”; একক ভাইরাল পোস্ট নয়, বারবার প্রকাশিত মত।
  • @umiyuki_ai(184 likes / 1 পোস্ট)— OpenAI ও Claude-এর পারফরম্যান্স তুলনা করা একক বিশ্লেষণ পোস্ট।
  • @so_ainsight(26 likes / 1 পোস্ট)— Claude Code পরিচালনার জন্য পরিচিত অ্যাকাউন্টের GPT-6 Astra ব্যবহারের উদাহরণ।

বেশির ভাগই এই বিষয়ে “মাত্র এক পোস্ট ধরা পড়া” এককালীন প্রকাশক; একাধিক পোস্ট থাকা একমাত্র অ্যাকাউন্ট @mask_3dcg।

পোস্ট
  1. @OpenAI — 52,200 likes・8,156 reposts・2,091 replies・প্রায় 870 লাখ views・2026-09-23
    https://x.com/OpenAI/status/2102460975790137662

    Please welcome GPT-6 Sol and GPT-6 Luna to the GPT-6 universe. [...] bringing much of its [GPT-6 Astra's] strengths into faster and more affordable models
    ক্লোজড-সোর্সের সবচেয়ে বড় সংবাদ। GPT-6 Astra-এর ক্ষমতাকে দ্রুত ও কম খরচে আনার দুই derived model-এর অফিশিয়াল ঘোষণা।

  2. @umiyuki_ai — 184 likes・29 reposts・প্রায় 47,000 views・2026-09-22
    https://x.com/umiyuki_ai/status/2102485745328165103

    OpenAIがOpus5.5に対してGPT-6SolとLunaをぶつけてきた![...] SolもLunaも5.6からあんま性能上がってないっぽい。ただし、価格は安くなってる[...] Opus5.5がFable5.1超えてきたからGPT-6SolもAstra
    অফিশিয়াল ঘোষণার প্রতিক্রিয়া। পারফরম্যান্স বৃদ্ধির চেয়ে মূল্যহ্রাসই আসল বিষয়—এমন সংশয়ী পাঠ।

  3. @so_ainsight — 26 likes・4 reposts・প্রায় 3,400 views・2026-09-23
    https://x.com/so_ainsight/status/2102641613612990946

    GPT-6 Astra x 物件サイト→3D空間、えぐい [...] 入力はその物件の写真20枚だけ ・屋内はGPT-6 Astra(OpenAIのAI)とUnreal Engine
    মাত্র 20টি সম্পত্তির ছবি থেকে হাঁটাচলা করা যায় এমন 3D জায়গা তৈরির উদাহরণ। GPT-6 Astra-এর বাস্তব ব্যবহারক্ষেত্র।

  4. @npaka123 — 283 likes・40 reposts・প্রায় 31,000 views・2026-09-23
    https://x.com/npaka123/status/2102594385758347548

    Opus 5.5 をおためし中 プロンプト: 3Dのシューティングゲームを作って。[...] うまくいけば1分ほどでクリアできる。BGMとSEもつけて
    Claude Opus 5.5-কে একটি prompt-এ সম্পূর্ণ 3D shooting game (BGM ও SE-সহ) বানাতে দিয়ে পরীক্ষা।

  5. @seiiiiiiiiiiru — 476 likes・49 reposts・প্রায় 27,000 views・2026-09-23
    https://x.com/seiiiiiiiiiiru/status/2102636308707287201

    もう手作業でキーフレーム打つなんてアホらしい。これはClaude Opus 5.5で、HiggsfieldとAfterEffectsを操作してAIが作ったローンチビデオです。[...] 150円くらいでできました
    Opus 5.5 সরাসরি Higgsfield ও After Effects নিয়ন্ত্রণ করে লঞ্চ ভিডিও তৈরি করেছে; খরচ আনুমানিক 150 yen।

  6. @kevin_t_ngo — 2,451 likes・115 reposts・প্রায় 152,000 views・2026-09-23
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    সংগৃহীত পোস্টের মধ্যে AI-সম্পর্কিত বিষয়ে সর্বোচ্চ এনগেজমেন্ট। Python animation থেকে Blender rendering পর্যন্ত Opus 5.5 করেছে।

  7. @aicreataro — 325 likes・46 reposts・প্রায় 29,000 views・2026-09-23
    https://x.com/aicreataro/status/2102656273112326609

    Opus 5.5にAfter Effectsを操作させて、AI動画を加工するテスト。■ベース MiniMax H3 で15秒を1本 ■AEでやらせたこと ・カットの切れ目を拍に合わせて速さを調整 ・区間ごとにエフェクトを1つずつ
    MiniMax H3 দিয়ে তৈরি ভিডিওতে Opus 5.5 After Effects ব্যবহার করে beat-matching ও effect যোগ করেছে—জেনারেশনের পরের ধাপের স্বয়ংক্রিয়তার উদাহরণ।

  8. @sonia_code — 377 likes・33 reposts・প্রায় 19,000 views・2026-09-22
    https://x.com/sonia_code/status/2102367557303021766

    これ、めっちゃエモくない?Astraに夕暮れの湿原を作らせてみたんだけど [...] ブラウザで動いてるから、マウスで好きな方向を見渡せる
    Astra দিয়ে ব্রাউজারে স্বাধীন viewpoint-সহ চালানো যায় এমন 3D জলাভূমির দৃশ্য তৈরি।

  9. @yachimat_manga — 73 likes・13 reposts・প্রায় 7,700 views・2026-09-21
    https://x.com/yachimat_manga/status/2102181794057420889

    頑張って背景参照カットごとに指定するっていうのもAstra時代にはもはや最適解かも?[...] 既存のアニメの工程をパワーで再現するっていう方向がワンチャンつよいかも
    Astra-পরবর্তী সময়েও অ্যানিমেশন তৈরিতে “বর্তমান প্রক্রিয়াকে শক্তি প্রয়োগে পুনর্নির্মাণ” পথটি কার্যকর হতে পারে—এমন মাঠপর্যায়ের ভাবনা।

  10. @mask_3dcg(2 পোস্ট, 224 likes / প্রায় 22,000 views・2026-09-22 এবং 1,589 likes / প্রায় 246,000 views・2026-09-23)
    https://x.com/mask_3dcg/status/2102234787184537669
    https://x.com/mask_3dcg/status/2102715480494752222

    こういうユニークなキャラクターのアニメーションはaiには本当に無理なので人間がいつまでも必要だと思います
    即採用です。AI 時代に一番必要なのは アニメーターです。CGのアニメーションはAIじゃあ、決められたテンプレート以外はうまく作れません
    জেনারেটিভ AI-উচ্ছ্বাসের বিপরীত অবস্থান। দ্বিতীয় পোস্টটি 22 লাখের বেশি view পেয়ে AI অপ্রচলিত character animation প্রতিস্থাপন করতে পারে না—এমন অবস্থানের যথেষ্ট সমর্থন দেখায়।

সংকেত
  • উত্থান: Claude Opus 5.5-কে “ছবি/ভিডিও জেনারেশন নিজে করা” টুল হিসেবে নয়, Higgsfield/After Effects/Blender/MiniMax H3-এর মতো বিদ্যমান টুল চালানো অর্কেস্ট্রেটর হিসেবে ব্যবহারের পোস্ট বেড়েছে (#4〜#7)। জেনারেশনের পরের সম্পাদনা ও finishing ধাপ AI-কে দেওয়ার ব্যবহার চোখে পড়ে।
  • উত্থান: অল্প কয়েকটি ছবি থেকে 3D walkthrough space তৈরির উদাহরণ (#3, GPT-6 Astra + Unreal Engine)। জেনারেটিভ AI-এর সঙ্গে প্রচলিত game engine মিলিয়ে ব্যবহারের প্রবণতা।
  • দাম-প্রতিযোগিতা: GPT-6 Sol/Luna ঘোষণা “পারফরম্যান্স বৃদ্ধি”র বদলে “দ্রুত ও সস্তা”—এই framing-এ গ্রহণ করা হয়েছে (#2)।
  • প্রত্যাখ্যান / বিপরীত মত: পেশাদার 3DCG নির্মাতার AI দিয়ে character animation প্রতিস্থাপনের স্পষ্ট অস্বীকৃতি উচ্চ প্রতিক্রিয়া পেয়েছে (#10, 22 লাখের বেশি view)। AI সর্বশক্তিমান—এমন দাবির বিরুদ্ধে প্রতিক্রিয়াও সমর্থন পাচ্ছে।
  • অপ্রত্যাশিত বিষয়: এই সেশনে X দেখানো 10টি ট্রেন্ডের মধ্যে ছবি/ভিডিও জেনারেশন AI-সম্পর্কিত ছিল মাত্র 3টি; বাকি 7টি ছিল একেবারেই অপ্রাসঙ্গিক। অর্থাৎ এই মুহূর্তে ও এই অঞ্চলে ছবি/ভিডিও জেনারেশন AI, X-এ “এখন কী ঘটছে”-র মুখ্য বিষয় নয়; সাধারণ প্রযুক্তি ট্রেন্ডের ভেতর খুব সামান্য উপস্থিতি মাত্র।
  • ওপেন-সোর্স মডেল বা টুল—যেমন Flux, Stable Diffusion, HunyuanVideo, Wan, ComfyUI—সম্পর্কে সংগ্রহ করা কোনো পোস্টেই উল্লেখ ছিল না।
সীমাবদ্ধতা
  • সার্চ শব্দ বিষয় থেকে নির্বাচিত ছিল না; ক্রোয়েশিয়া থেকে পাওয়া সেশনের X Explore-এ দেখা ট্রেন্ড শব্দগুলোই ব্যবহার করা হয়েছে। 10টির মধ্যে 7টি—Cardano, $SONG, Taylor, England, #uranium, Croats, NFTs—বিষয়ের সঙ্গে সম্পর্কহীন; তাদের ফলাফল রিপোর্ট থেকে বাদ দেওয়া হয়েছে।
  • Explore ট্রেন্ড কেবল ওই সেশনে ক্রোয়েশিয়া থেকে দৃশ্যমান তথ্য; বৈশ্বিক ট্রেন্ড নয়।
  • @videoai_otaku-এর পোস্ট (#30, https://x.com/videoai_otaku/status/2102264981807153234)-এ টেক্সট বা ছবি ছিল না; বিষয়বস্তু উদ্ধৃত করা যায়নি (সম্ভবত ভিডিও-শুধু পোস্ট)।
  • “Sora”, “Veo”, “Midjourney”, “Runway” ইত্যাদি ক্লোজড-সোর্স টুল, অথবা “Flux”, “Wan”, “HunyuanVideo”, “ComfyUI” ইত্যাদি ওপেন-সোর্স টুল নামে সার্চ করা হয়নি; তাই এ-সম্পর্কিত X উল্লেখ এই প্রতিবেদনে নেই।
  • উপরোক্ত কারণে, ওপেন-সোর্স গতিবিধি সম্পর্কে X থেকে পাওয়া অন্তর্দৃষ্টি প্রায় শূন্য; সংগৃহীত ডেটায় ওপেন-সোর্স মডেল বা টুলের সরাসরি উল্লেখ নেই। ওপেন-সোর্স দিকের অন্তর্দৃষ্টি অন্য প্ল্যাটফর্ম থেকে পূরণ করতে হবে।

YouTube

YouTube — ছবি ও ভিডিও জেনারেশন AI সংবাদ

চ্যানেল

এই ধাপে পৃথক ভিডিওর চ্যানেল নাম বা সাবস্ক্রাইবার সংখ্যা সরাসরি সংগ্রহ করা যায়নি (নিচের Limits দেখুন)। ফলে সার্চ ফলের শিরোনাম ও বিবরণে শনাক্ত প্রকাশক এবং সাধারণভাবে এই ধারাকে নিয়মিত কভার করে বলে পরিচিত চ্যানেল—দুই ভাগে উল্লেখ করা হলো।

  • OpenAI(অফিশিয়াল চ্যানেল)— ChatGPT Images 2.5-এর লঞ্চ ভিডিও “Introducing ChatGPT Images 2.5” প্রকাশ করেছে। কর্পোরেট অফিশিয়াল চ্যানেল হিসেবে এ দফার সবচেয়ে বড় প্রাথমিক উৎস।
  • Muapi(টিউটোরিয়াল চ্যানেল)— “GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It”-এ API ব্যবহারকারীদের জন্য নতুন মডেল (Flare / Sunburst) ব্যবহারের নির্দেশনা দিয়েছে।
  • সার্চে “Kling 3.0 and Omni FULL guide”, “Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0”, “China Did It AGAIN? – 100+ Wan 3.0 AI Videos”, “LTX-2.3 Review”, “New Qwen Image 2512” ইত্যাদি বহু review/comparison ভিডিও পাওয়া গেছে, কিন্তু চ্যানেল নাম সরাসরি সংগ্রহ করা সম্ভব হয়নি।
  • সাধারণ পরিপূরক তথ্য হিসেবে, AI ছবি ও ভিডিও জেনারেশন সংবাদ/রিভিউ নিয়মিত কভার করা চ্যানেল হিসেবে Curious Refuge (AI filmmaking ও workflow শিক্ষা), Matt Wolfe (সাপ্তাহিক AI সংবাদ) এবং The AIGRID (জেনারেটিভ AI ব্রেকিং নিউজ) web search-এ পাওয়া গেছে। তবে এরা এই রানে পাওয়া নির্দিষ্ট ভিডিওগুলোর প্রকাশক—এমন প্রমাণ নেই।
ভিডিও
  1. Introducing ChatGPT Images 2.5 — OpenAI(অফিশিয়াল)— 2026-09-08-এর আশপাশে — views অজানা
    https://www.youtube.com/watch?v=6l7ble9P74o
    ChatGPT Images 2.5 (নতুন মডেল GPT-Image-2.5 Flare / Sunburst)-এর অফিশিয়াল লঞ্চ ভিডিও। জেনারেশন গতি সর্বোচ্চ 50% কমানো, সম্পাদনার সামঞ্জস্য উন্নয়ন এবং মন্তব্যভিত্তিক সম্পাদনা দেখানো হয়েছে।

  2. GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It — Muapi — 2026 সালের সেপ্টেম্বরের শুরু — views অজানা
    https://www.youtube.com/watch?v=nk2u6ENW85Q
    API দিয়ে Flare/Sunburst মডেলের পার্থক্য ও ব্যবহার ব্যাখ্যা করা টিউটোরিয়াল। Sunburst-কে precomputation (planning) সুবিধাসহ উচ্চতর সংস্করণ হিসেবে বর্ণনা করা হয়েছে।

  3. Nano Banana Pro: Hands-on with the World's Most Powerful Image Model — 2025-11-25 — views অজানা
    https://www.youtube.com/watch?v=hk6gwiZmSWA
    Google DeepMind-এর Gemini 3 Pro ভিত্তিক Nano Banana Pro-এর hands-on। text rendering এবং infographic জেনারেশনের নিখুঁততা উন্নত হওয়ার প্রদর্শনী। প্রকাশের প্রায় 10 মাস পরও সংশ্লিষ্ট ভিডিও আসতে থাকায় এটি দীর্ঘস্থায়ী আলোচনার বিষয়।

  4. Kling 3.0 and Omni FULL guide 2026 — 2026-04-04 — views অজানা
    https://www.youtube.com/watch?v=tEdHJohIUlM
    Kuaishou-এর Kling 3.0/Kling 3.0 Omni-এর পূর্ণাঙ্গ গাইড। “AI Director” সুবিধা একটি জেনারেশনে সর্বোচ্চ 6টি শটের ধারাবাহিক sequence তৈরি করতে পারে।

  5. Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — 2026-08-14 — views অজানা
    https://www.youtube.com/watch?v=G5D053drKB8
    চারটি শীর্ষ ক্লোজড মডেল—ByteDance Seedance 2.5, MiniMax H3, Google Omni, Kling 3.0—এর তুলনা। 2026 সালের আগস্টে ক্লোজড-সোর্স ভিডিও জেনারেশন AI-এর শক্তির চিত্র তুলে ধরে।

  6. FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE
    https://www.youtube.com/watch?v=gbI8XV4Szrk
    Alibaba Wan 3.0-কে “ওয়েটহীন, API-সীমিত বিটা” হিসেবে প্রকাশ করা হয়েছে—এ কথা তুলে ধরা ভিডিও। Wan 2.2 পর্যন্ত ওপেন-ওয়েট থাকলেও Wan 3.0 ক্লোজড পথে গেছে; সাধারণ web search-এও এ দাবি একাধিকবার পাওয়া গেছে।

  7. China Did It AGAIN? – 100+ Wan 3.0 AI Videos — 2026-08-10 — views অজানা
    https://www.youtube.com/watch?v=fNvv2u-1cGw
    Wan 3.0-এর public beta (2026-08-06 শুরু)-তে তৈরি 100টির বেশি ভিডিওর showcase। একবারে সর্বোচ্চ 30 সেকেন্ডের শট জেনারেশন—Wan 2.7-এর 15 সেকেন্ডের দ্বিগুণ—জোর দিয়ে দেখানো হয়েছে।

  8. LTX-2.3 Review: The Open-Source AI Video Model Built for Creators — 2026-08-11 — views অজানা
    https://www.youtube.com/watch?v=qQXzlk134Sw
    Lightricks-এর LTX-2.3 রিভিউ। ওপেন-সোর্স ভিডিও মডেলের মধ্যে একমাত্র এটি অডিও ও ভিডিও একই inference pass-এ একসঙ্গে জেনারেট করতে পারে (4K/50fps সমর্থন)—এমন দাবি মূল্যায়ন করা হয়েছে।

  9. LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — 2026-01-11 — views অজানা
    https://www.youtube.com/watch?v=ytxbq9ZSgxo
    কম VRAM পরিবেশে LTX-2 লোকালি চালানোর টিউটোরিয়াল। ComfyUI/SwarmUI দিয়ে setup ব্যাখ্যা করা হয়েছে এবং ওপেন-সোর্স ভিডিও মডেলের মধ্যে সহজ ব্যবহারযোগ্যতার কথা বলা হয়েছে।

  10. New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)
    https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    Alibaba Tongyi Chat দলের Qwen-Image-2512 (Apache 2.0 লাইসেন্স, 2000 কোটি parameter) ও Z-Image Turbo-এর তুলনা। ওপেন-সোর্স ছবি জেনারেশনের শীর্ষ প্রতিযোগিতা হিসেবে একসঙ্গে একাধিক রিভিউ ভিডিও পাওয়া গেছে।

  11. Can MiniMax H3 Beat Seedance 2.5? My ComfyUI Workflow
    https://www.youtube.com/watch?v=zwam3nJTNrI
    2026-08-03-এ Hugging Face-এ প্রকাশিত MiniMax H3 (3300 কোটি parameter, Community License)-কে ComfyUI workflow-তে পরীক্ষা। কিন্তু লাইসেন্সটি যুক্তরাষ্ট্র, EU, যুক্তরাজ্য ও দক্ষিণ কোরিয়ায় ব্যবহার স্পষ্টভাবে বাদ দেয়; শুধু এ ভিডিও থেকে সেই বিষয় উল্লেখ হয়েছে কি না নিশ্চিত নয়।

  12. FLUX 3 Might Be the Open Source Sora 2 We Deserve — 2026-07-24 — views অজানা
    https://www.youtube.com/watch?v=1s3zslFOSh0
    Black Forest Labs-এর FLUX 3—ভিডিও, অডিও, ছবি ও robotics-সমর্থিত multimodal model—পরিচিতি। শিরোনামে “open source” বলা হলেও 2026 সালের জুলাইয়ে FLUX 3 নিজে কেবল ক্লোজড early-access সংস্করণে ছিল; ওপেন-ওয়েট সংস্করণ (FLUX 3 Dev) শুধু roadmap-এ ছিল, প্রকাশিত নয়। “পরে ওপেন-সোর্স হবে” এবং “ইতিমধ্যে ওপেন-সোর্স”—এই দুইয়ের মিশ্রণ অনেক ভিডিওতে দেখা গেছে; সতর্ক থাকা দরকার।

সংকেত
  • ক্লোজড-সোর্সের মূল্য ও গতির প্রতিযোগিতা: ChatGPT Images 2.5 (জেনারেশন গতি -50%), Kling 3.0-এর AI Director (এক জেনারেশনে বহু শট তৈরি করে ব্যয় সংকোচন)—এসব ঘোষণায় পারফরম্যান্সের চেয়ে “দ্রুত ও সস্তা” দিকটি সামনে এসেছে। X-এ দেখা GPT-6 Sol/Luna-এর মূল্যহ্রাস framing-এর সঙ্গে YouTube review-গুলোর ধারা সামঞ্জস্যপূর্ণ।
  • “ওপেন সোর্স” নামে পরিচিতি ও বাস্তবতার ফারাক: Wan 3.0-এর আগের Alibaba মডেলগুলো Wan 2.2 পর্যন্ত ওপেন-ওয়েট হলেও এটি API-সীমিত ও ওয়েট অপ্রকাশিত হয়ে যায়; একাধিক ব্যাখ্যামূলক ভিডিও একে কার্যত ক্লোজড বলেছে। বিপরীতে FLUX 3 ভিডিও-শিরোনামে “Open Source” হলেও বাস্তবে কেবল ক্লোজড early-access—দুটি মডেলেই ব্র্যান্ড ও বাস্তবতার বিরোধ দেখা যায়।
  • ওপেন-ওয়েট হলেও “কোন অঞ্চলে ব্যবহারযোগ্য” তা সীমিত হওয়ার নতুন ধারা: MiniMax H3 Hugging Face-এ ওয়েট প্রকাশ করলেও Community License যুক্তরাষ্ট্র, EU, যুক্তরাজ্য ও দক্ষিণ কোরিয়ায় লোকাল ব্যবহারে স্পষ্ট নিষেধাজ্ঞা দেয়। “ওপেন-ওয়েট = সবাই স্বাধীনভাবে ব্যবহার করতে পারে”—এই ধারণা দুর্বল হচ্ছে।
  • তুলনা ও পাশাপাশি review এখন মূল ফরম্যাট: “Seedance 2.5 vs MiniMax H3 vs Wan 3.0”-এর মতো বহু-মডেল তুলনা ভিডিও খুব বেশি; একক মডেলের গভীর বিশ্লেষণের চেয়ে “কোনটি সেরা” পরীক্ষা YouTube-এ এই ধারার প্রধান ফরম্যাট।
  • চীনা মডেলের শক্ত উপস্থিতি: Kling (Kuaishou), Seedance (ByteDance), Wan (Alibaba), MiniMax H3, Qwen-Image (Alibaba Tongyi)—ছবি ও ভিডিও AI আলোচনার কেন্দ্রে চীনা মডেলগুলোর প্রবল উপস্থিতি; যুক্তরাষ্ট্রের GPT Image, Nano Banana Pro ও FLUX-এর সঙ্গে দ্বিমেরু চিত্র তৈরি হয়েছে।
সীমাবদ্ধতা
  • এই ধাপে ব্যবহৃত WebFetch টুল YouTube সার্চ (/results?search_query=…) ও ভিডিও (/watch?v=…) পৃষ্ঠা—দুটিতেই বাস্তব ডেটার বদলে footer navigation link (copyright ইত্যাদি) পেয়েছে। ভিডিও পেজে /@channel/about চেষ্টা করলে consent.youtube.com-এ 302 redirect (gl=HR, ক্রোয়েশিয়া অঞ্চলের Cookie consent পৃষ্ঠা) দেখা যায়। সেশনের অঞ্চল ও Cookie consent অবস্থা JS ছাড়া HTML সংগ্রহে বাধা দিয়েছে বলে মনে হয়।
  • ফলে view count, channel subscriber সংখ্যা বা নির্দিষ্ট মন্তব্য একটিও সরাসরি যাচাই করা যায়নি। ভিডিওর শিরোনাম, সময় ও বিষয়বস্তু WebSearch snippet এবং বাইরের সংবাদ থেকে সমর্থিত; playbook-এর subscriber-সংবলিত Channels বিভাগ ও ভিডিওপ্রতি view count পূরণ হয়নি।
  • অনেক রিভিউ ভিডিওর চ্যানেল নাম শিরোনামে না থাকায় পৃথক ভিডিওর প্রকাশক শনাক্ত করা যায়নি।
  • মন্তব্য বিভাগ একবারও দেখা যায়নি।
  • সার্চে Kling 3.0 / Nano Banana Pro / Wan 3.0 / LTX-2 / Qwen-Image / Flux 3 / Seedance 2.5 / MiniMax H3 / GPT Image 2.5-সহ মূলত ইংরেজি keyword ব্যবহৃত হয়েছে। জাপানি ভাষার চ্যানেল সার্চ করা হয়নি; তাই জাপানি YouTube প্রতিক্রিয়া এখানে নেই।
  • “প্রায় 20টি পোস্ট বিশ্লেষণ” পূর্ণতার মানদণ্ডে YouTube পোস্টের বদলে ভিডিওভিত্তিক প্ল্যাটফর্ম হওয়ায়, 12টি ভিডিওতে থামা হয়েছে; এগুলোর কোনোটিতেই পরিমাণগত ডেটা পাওয়া যায়নি। সার্চ বাড়ালেও WebFetch সীমাবদ্ধতার কারণে তা পাওয়ার সম্ভাবনা কম।

Bluesky

Bluesky — Image and Video Generation AI News

অ্যাকাউন্ট
  • oludai.bsky.social ("🚀 olud.ai") — প্রতি ঘণ্টায় AI ট্র্যাকিং আপডেট দেওয়া বট (1,543 পোস্ট, 948 অনুসারী): নতুন মডেল লঞ্চ, দাম পরিবর্তন, GitHub star-এর গতি এবং—এখানে সবচেয়ে গুরুত্বপূর্ণ—ব্লাইন্ড মানব পছন্দে ছবি/ভিডিও মডেলের পুনরাবৃত্ত “media leaderboard”।
  • ai.bots.law — AI কপিরাইট মামলায় docket activity হলেই নতুন এন্ট্রি পোস্ট করে; Disney v. Midjourney ও Andersen v. Stability AI অন্তর্ভুক্ত।
  • midjourneyofficial.bsky.social — Midjourney-এর অফিশিয়াল অ্যাকাউন্ট। কম-ঘনত্বে এবং অনানুষ্ঠানিক পোস্ট (“How was your weekend?”); পণ্য-সংবাদের উৎস নয়।
  • #AIイラスト #StableDiffusion hashtag ব্যবহার করে দৈনিক Stable Diffusion/SDXL আউটপুট পোস্ট করা জাপানি AI illustration নির্মাতা: kazanomiya.bsky.social, michi84.bsky.social, garakuta76.bsky.social, blackmagnet3400.bsky.social।
  • Midjourney hobbyist art community: johndoesmidjourney.bsky.social, dalyrceri.bsky.social, ttaships.airminded.org, un1v3rse.bsky.social, nevyn79.bsky.social, stumblegirl.bsky.social — দৈনিক আউটপুট, সংবাদ নয়; তবু প্ল্যাটফর্মের দৈনন্দিন AI art ব্যবহারে পরিণত টুলগুলোর প্রাধান্য দেখায়।
  • index.photoshoproadmap.com.ap.brid.gy — fediverse-bridged (Bridgy Fed) অ্যাকাউন্ট; Photoshop/Nano Banana workflow-এর ব্যবহারিক সমস্যা নিয়ে আলোচনা করে।
পোস্ট
  1. oludai.bsky.social, 2026-09-23 (1 like) — “🎨 ছবির জেনারেশনে ওপেন-সোর্সের অবস্থান: #14 Qwen-Image-3.0-Pro — বাস্তবে ডাউনলোড করা যায় এমন সেরা মডেল। GPT Image 2.5 Sunburst (max) (OpenAI)-এর চেয়ে 108 ELO পয়েন্ট পিছিয়ে। Marketing নয়, ব্লাইন্ড মানব পছন্দ।” → post
  2. oludai.bsky.social, 2026-09-22 (2 likes) — “🏆 একটি ওপেন-ওয়েট মডেল ভিডিও জেনারেশনে এগিয়ে। Wan 3.0 মানব-পছন্দ ranking-এ সব ক্লোজড মডেলের সামনে শীর্ষে। এটি ডাউনলোড করে নিজে চালানো যায়।” → post
  3. oludai.bsky.social, 2026-09-22 (0 likes) — “🎨 ছবি সম্পাদনায় ওপেন-সোর্সের অবস্থান: #16 Qwen-Image-3.0-Pro — বাস্তবে ডাউনলোড করা যায় এমন সেরা মডেল। GPT Image 2.5 Sunburst (max) (OpenAI)-এর চেয়ে 101 ELO পয়েন্ট পিছিয়ে।” → post
  4. oludai.bsky.social, 2026-09-21 (1 like) — “🚀 ComfyUI v0.37.0 প্রকাশিত … ⭐ 134,258 stars। সব ওপেন-সোর্স AI release →olud.ai/releases.html” → post
  5. ai.bots.law, 2026-09-23 (0 likes) — “নতুন filing: Disney v. Midjourney (বাদীরা Midjourney-র বিরুদ্ধে copyright চরিত্রে প্রশিক্ষণ ও জেনারেশনের জন্য মামলা করেছে)। Doc #206: (IN CHAMBERS) ORDER RE HEARING ON MOTION FOR JUDGMENT ON THE PLEADINGS।” → post
  6. ai.bots.law, 2026-09-23 (0 likes) — “নতুন filing: Andersen v. Stability AI (শিল্পীরা AI image training নিয়ে মামলা করেছে)। Doc #759: Miscellaneous Relief।” → post
  7. index.photoshoproadmap.com.ap.brid.gy, 2026-09-24 (0 likes) — “বড় canvas-এ Nano Banana ব্যবহার করে Generative Fill প্রায়ই লম্বা/চ্যাপ্টা ফল এবং দৃশ্যমান selection edge তৈরি করে। সমস্যা resolution mismatch—মডেল ছোট এলাকায় তৈরি করে, পরে অনেক বড় document-এ মানাতে scale করা হয়।” → post
  8. kazanomiya.bsky.social, 2026-09-23 (40 likes, 5 reposts) — 「おはよう」#AIイラスト #AIart #StableDiffusion #SDXL — সাধারণ AI-art feed-এ পাওয়া সর্বোচ্চ-এনগেজমেন্ট পোস্ট; জাপানি কমিউনিটিতে প্রতিদিনের SD/SDXL ব্যবহারের উদাহরণ। → post
  9. midjourneyofficial.bsky.social, 2025-08-15 (41 likes, 4 reposts) — “#Midjourney এখন BlueSky-এ! এখানে কাদের সৃজনশীল কাজ অনুসরণ করা উচিত?” — অ্যাকাউন্টটির লঞ্চ পোস্ট; এখনো সবচেয়ে বেশি এনগেজমেন্ট পাওয়া পোস্ট। → post
সংকেত
  • কাঁচা গুণমানে ক্লোজড-সোর্স এখনো এগিয়ে—ছবির কাজের উভয় ক্ষেত্রেই। olud.ai-এর ব্লাইন্ড-পছন্দ leaderboard-এ GPT Image 2.5 Sunburst (OpenAI) ছবি জেনারেশন ও সম্পাদনা—দুটিতে শীর্ষে; সেরা ডাউনলোডযোগ্য ওপেন মডেল Qwen-Image-3.0-Pro উভয় ক্ষেত্রে 100+ ELO পয়েন্ট পিছিয়ে (#14 generation, #16 editing)।
  • ভিডিও জেনারেশন এই ধারা উল্টে দিয়েছে। একই tracker বলছে ওপেন-ওয়েট Wan 3.0 মানব-পছন্দে সব ক্লোজড প্রতিদ্বন্দ্বীর সামনে ভিডিও ranking-এ প্রথম—একটি বিভাগ যেখানে ওপেন মডেল এখন ধাওয়া করছে না, বরং #1।
  • ক্লোজড/আংশিক-ওপেন প্রতিষ্ঠানের ওপর আইনি চাপ এ সপ্তাহেও চলেছে। Sept 23-এ Disney v. Midjourney (কপিরাইট চরিত্রে training + generation) ও Andersen v. Stability AI (ছবির training data নিয়ে শিল্পীদের মামলা)—দুটিতেই নতুন docket activity হয়েছে। কপিরাইট-training দায় এখনো hosted/commercial পণ্য প্রকাশ করা বিক্রেতাদের কেন্দ্রীয় গল্প।
  • মডেলের গুণমান পিছিয়ে থাকলেও ওপেন-সোর্স tool layer দ্রুত এগোচ্ছে। লোকালে open diffusion/video model চালানোর প্রধান node-based UI ComfyUI এ সপ্তাহে v0.37.0 প্রকাশ করেছে এবং 134k+ GitHub stars পেয়েছে; leaderboard অবস্থান থেকে স্বাধীনভাবেই infrastructure momentum শক্তিশালী।
  • স্বাভাবিক Bluesky AI-art community-এর দৈনন্দিন ব্যবহার frontier release-এর চেয়ে পরিণত consumer tool-কেন্দ্রিক। সবচেয়ে সক্রিয় পোস্টাররা—বেশির ভাগ জাপানি “AIイラスト” নির্মাতা ও Midjourney hobbyist—দৈনিক Stable Diffusion/SDXL ও Midjourney ব্যবহার করছে; Sora, Veo, Kling, Runway বা Grok Imagine-এর নাম করে স্বাভাবিক আলোচনায় কিছু পাওয়া যায়নি।
  • Nano Banana এখন কেবল novelty demo-র পর্যায়ে নেই; production troubleshooting পর্যায়ে পৌঁছেছে। Photoshop workflow পোস্টটি নির্দিষ্ট Generative Fill ব্যর্থতা (resolution mismatch থেকে প্রসারিত আউটপুট) নির্ণয় নিয়ে; এটি প্রাথমিক hype নয়, mainstream integration-এর ইঙ্গিত।
সীমাবদ্ধতা
  • playbook-এর public search endpoint app.bsky.feed.searchPosts চেষ্টা করা প্রতিটি কুয়েরিতে HTTP 403 Forbidden দিয়েছে—single keyword, multi-word phrase, sort=latest সহ/ছাড়া সব ক্ষেত্রেই। একই host-এর getProfile, getPostThread, getAuthorFeed, getFeed চললেও literal keyword search চালানো যায়নি।
  • web search দিয়ে candidate account/feed খুঁজে, তারপর getAuthorFeed/getPostThread/getFeed দিয়ে প্রকৃত কনটেন্ট ও এনগেজমেন্ট সংগ্রহ করা হয়েছে। এটি সংকীর্ণ, discovery-biased নমুনা; পুরো প্ল্যাটফর্মের exhaustive search নয়।
  • পৌঁছানো নমুনায় Sora, Sora 2, Veo, Kling, Runway Gen-4, Grok Imagine বা Seedream নিয়ে Bluesky-native আলোচনা পাওয়া যায়নি। সার্চ API বাধার কারণে এটি প্রকৃত নীরবতার চেয়ে নমুনা-ঘাটতি হওয়ার সম্ভাবনাই বেশি; এটিকে নিশ্চিত finding হিসেবে নেওয়া উচিত নয়।
  • bsky.app নিজে client-rendered single-page app; সরাসরি web page fetch করলে পোস্টের content ফেরত দেয় না। তাই এই ধাপে সব পাঠ JSON API দিয়েই করা হয়েছে।

Lemmy

Lemmy — ছবি ও ভিডিও জেনারেশন AI-এর গতিবিধি

Lemmy একটি ছোট fediverse SNS, তবে !«メールアドレス»-কে কেন্দ্র করে লোকাল AI ব্যবহারকারীদের সক্রিয় আলোচনা আছে, আর lemmy.durstig.online-এর ai_reddit কমিউনিটি—Reddit r/ArtificialIntelligence-এর mirror/bridge—দিয়ে ক্লোজড-সোর্স সংবাদও আসে। API search (https://lemmy.world/api/v3/search) দিয়ে “Stable Diffusion”, “Midjourney”, “Sora”, “Flux”, “ComfyUI”, “Kling AI”, “Nano Banana”, “Black Forest Labs”, “Wan 2.2”, “Grok Imagine” ইত্যাদি keyword জুড়ে অনুসন্ধান করা হয়েছে।

কমিউনিটি
  • !«メールアドレス» — 5,710 subscribers। ComfyUI ও ওপেন-ওয়েট মডেলের খবর/টুল পোস্টের প্রধান hub।
  • !«メールアドレス» — AI-তৈরি artwork পোস্ট করার জায়গা; সংবাদমূল্য কম।
  • !«メールアドレス» — anime-ধাঁচের AI artwork-নির্দিষ্ট।
  • !«メールアドレス» — abstract AI artwork-নির্দিষ্ট।
  • !«メールアドレス» — 52 subscribers (local 1 জন), 25.8K পোস্ট ও মাসে 155 user। r/ArtificialIntelligence পোস্ট bridge করা কমিউনিটি; Nano Banana, Seedream ও Sora/Kling-সংবাদ বেশি।
  • !techtakes (dbzer0 ecosystem) — AI শিল্প সমালোচনামুখী কমিউনিটি; Midjourney সম্পর্কিত আলোচনা আছে।
  • !technology — সাধারণ প্রযুক্তি কমিউনিটি; Midjourney-সংক্রান্ত বড় সংবাদ পাওয়া গেছে।
  • !tech — Black Forest Labs সম্পর্কিত সংবাদ পাওয়া গেছে।
পোস্ট
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency(ওপেন-সোর্স)
    !«メールアドレス» / 13 upvotes / 2026-09-22
    https://lemmy.dbzer0.com/post/75874773

  2. chanon/comfyui-obvpm-timeline: ComfyUI timeline and clip extension nodes for Minimax H3(ওপেন-সোর্স, ভিডিও সম্পাদনা workflow)
    !«メールアドレス» / 6 upvotes / 2026-09-22
    https://lemmy.dbzer0.com/post/75874770

  3. SparknightLLC/ComfyUI-NodeSnapshots(ComfyUI frontend দ্রুততর করা, 2-3x FPS উন্নতি)
    !«メールアドレス» / 3 upvotes / 2026-09-22
    https://lemmy.dbzer0.com/post/75874771

  4. SupraLabs/Supra2-IMG — 100M parameter-এর অতি-হালকা text-to-image model(ওপেন-সোর্স)
    !«メールアドレス» / 7 upvotes / প্রায় 2026-09-23

  5. The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation!(ওপেন-সোর্স distributed image-generation প্রকল্প AI Horde-এর নবায়ন)
    !«メールアドレス» / 12 upvotes(3 downvotes)/ প্রায় 2026-09-20

  6. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion. that's the whole story of ai video right now(ক্লোজড বনাম চীনা প্রতিযোগীর তুলনা)
    !«メールアドレス» / 1 upvote / 2026-09-20
    https://lemmy.durstig.online/post/61333
    → OpenAI 9/24-এ Sora API বন্ধ করছে, আর Kling 300 কোটি ডলার তুলেছে। ভোক্তামুখী AI ভিডিও লাভজনক নয়; এন্টারপ্রাইজ—প্রশিক্ষণ ও পণ্য ডেমো ভিডিও—সম্ভবত প্রধান লক্ষ্য, এমন বিশ্লেষণ।

  7. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?(Nano Banana Pro-এর কর্মক্ষমতা তুলনা)
    !«メールアドレス» / 1 upvote / 2026-09-14
    https://lemmy.durstig.online/post/60037

  8. Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start(ক্লোজডধর্মী সীমিত প্রকাশ)
    !tech / 3 upvotes(2 down) / 2026-07-24
    https://bfl.ai/blog/flux-3

  9. Midjourney wants Hollywood studios to reveal the details of their AI usage(ক্লোজড-সোর্স, কপিরাইট বিরোধ সংশ্লিষ্ট)
    !technology / 75 upvotes / 2026-07-05
    https://techcrunch.com/2026/07/04/

  10. Elon Musk maakt complete AI-film met zijn versie van The Odyssey(Grok Imagine দিয়ে সম্পূর্ণ Odyssey AI চলচ্চিত্র তৈরির ঘোষণা, ক্লোজড-সোর্স)
    !films / 1 upvote / 2026-07-22
    https://lemy.nl/post/4342454

  11. Seedream 5.0 Pro is here: an honest comparison and technical breakdown(Nano Banana Pro-এর সঙ্গে তুলনামূলক benchmark)
    !«メールアドレス» / 1 upvote / 2026-07-10
    https://lemmy.durstig.online/post/46063

  12. black-forest-labs/FLUX.2-klein-9b-kv-fp8(ওপেন-ওয়েট প্রকাশ)
    !stable_diffusion / 8 upvotes / 2026-03-14
    https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8

  13. Midjourney AI pivots to Theranos: Ultrasonic CT(Midjourney-এর ultrasound scanner ব্যবসা নিয়ে সমালোচনামূলক নিবন্ধ)
    !techtakes / 41 upvotes / 2026-06-19
    https://pivot-to-ai.com/2026/06/19/

  14. Google quietly discontinues its Earth AI feature a day after its rollout(Nano Banana-সমন্বিত ফিচার অপব্যবহারের পর দ্রুত প্রত্যাহার)
    !«メールアドレス» / 1 upvote / 2026-08-07
    https://lemmy.durstig.online/post/52162

সংকেত
  • ওপেন-সোর্স দিকের মূল ক্ষেত্র ComfyUI-কেন্দ্রিক tool/node development: নতুন মডেল ঘোষণার চেয়ে বিদ্যমান Qwen-Image, Minimax H3, FLUX ইত্যাদি চালানোর workflow ও performance tool-এর পোস্ট বেশি। অপ্রদর্শনীয় হলেও ধারাবাহিক অগ্রগতি আছে।
  • ক্লোজড-সোর্সে অর্থ ও বিতর্ক একসঙ্গে: Sora API বন্ধ বনাম Kling-এর 300 কোটি ডলারের তহবিল, Midjourney-এর ultrasound scanner ব্যবসা নিয়ে “Theranos-সদৃশ” সমালোচনা—প্রযুক্তির চেয়ে ব্যবসা, পুঁজি ও নৈতিকতার সংবাদ বেশি।
  • Nano Banana (Google) ক্লোজড ছবি জেনারেশনের নিয়মিত benchmark: Seedream 5.0 ও GPT-র colourization-এর সঙ্গে তুলনা করা হচ্ছে; অন্যদিকে Google Earth-এর অপব্যবহার ঘটনার মতো নেতিবাচক দিকও রয়েছে।
  • Black Forest Labs (FLUX) ওপেন/ক্লোজডের মাঝামাঝি কৌশল নিচ্ছে: FLUX.2-klein-9b-এর মতো ছোট ওপেন-ওয়েট মডেল প্রকাশ করলেও, FLUX 3 (ছবি + 20 সেকেন্ডের অডিওসহ ভিডিও) “limited release” হিসেবে ক্লোজডঘেঁষা পদ্ধতিতে দেওয়া হয়েছে।
  • Lemmy-র নিজস্ব দৃষ্টিভঙ্গি প্রায় নেই: অধিকাংশ সংবাদপোস্ট Reddit, TechCrunch, HuggingFace, bfl.ai ইত্যাদি বাইরের উৎসের link post। Lemmy ব্যবহারকারীর নিজস্ব প্রাথমিক তথ্য বা বিশ্লেষণ খুবই কম; AI artwork বেশি হলেও তা “সংবাদ” নয়।
সীমাবদ্ধতা
  • Lemmy খুব ছোট (ai_reddit-এও 52 subscriber, local user 1 জন)। “video generation AI”, “Runway AI”, “Kling AI”, “Wan 2.2” সার্চে কোনো ফল পাওয়া যায়নি।
  • 20টি পোস্ট বিশ্লেষণের লক্ষ্যের বিপরীতে বাস্তবে সংবাদমূল্যসম্পন্ন পোস্ট প্রায় 14টি। বাকিগুলো ComfyUI integration tool বা AI artwork, যা মূল বিষয়—শিল্পখাতের সংবাদ—নয়; তাই বাদ। কৃত্রিমভাবে 20-এ নামিয়ে আনার চেয়ে বাস্তবে থাকা পোস্টই জানানো হয়েছে।
  • lemmy.ml ও lemm.ee আলাদাভাবে সার্চ করা হলেও lemmy.world API-র federated ফলের সঙ্গে অধিকাংশই পুনরাবৃত্ত; নতুন প্রাথমিক তথ্য পাওয়া যায়নি।
  • WebFetch-এ পাওয়া উপাদান AI summary-নির্ভর; relative date (“1 day ago” ইত্যাদি) থেকে absolute date-এ সামান্য ভুল থাকতে পারে।

Pinterest

Pinterest — ছবি ও ভিডিও জেনারেশন AI সংবাদ

"Image and Video Generation AI News" কুয়েরিতে 50টি pin সংগ্রহ করা হয়েছে (একক, genre-বিভাজনহীন সেট)। 50টির মধ্যে 30টি ছবি সরাসরি খোলা ও পড়া হয়েছে; বাকিগুলোর শিরোনাম pinterest.pins.md থেকে পড়া হয়েছে।

ভিজ্যুয়াল থিম
  • YouTube-thumbnail “AI NEWS” ফরম্যাট: দাড়িওয়ালা শ্বেতাঙ্গ পুরুষের বিস্মিত/চোখ বড় করা মুখ, পাশে OpenAI, Google, Microsoft, Meta, Anthropic-ধাঁচের burst icon, Notion-এর উজ্জ্বল 3D logo। ভিন্ন logo set-সহ একই template [1, 27, 48]-এ পুনরাবৃত্ত—এটি organic content নয়, AI-news recap channel-এর recurring thumbnail style।
  • Cyborg / অর্ধেক মানুষ-অর্ধেক রোবট মুখ: মাঝ বরাবর ভাগ করা মুখ, এক পাশে মানুষ, অন্য পাশে chrome/circuit robot—generic “AI এসে গেছে” visual হিসেবে [32, 41, 47]-এ ব্যবহার। নীল জ্বলজ্বলে চোখসহ পুরো chrome android portrait-ও [12]-এ আছে।
  • Neon cyberpunk UI mockup: গাঢ় নেভি background, গোলাকার pink/purple/blue glowing box, মাঝখানে “AI” speech-bubble icon এবং “Generate Image / Music / Video / Text / Link” icon-এর শাখা। একই Adobe Stock watermark-সহ graphic [5, 16]-এ আলাদা pin ID-তে আছে—নতুন content নয়, stock image reuse/re-pin।
  • Deepfake/misinformation উদ্বেগ: “FAKE” ছাপসহ cat photo ও like/view counter-র পাশে chrome robot [3]; তুষারে দাঁড়ানো “AI GENERATED” reporter-সহ NBC News clip [33]; “Human Journalism vs Machine-Generated Media” split-screen desk graphic [22]; talking-head video still-এর ওপর “AI GENERATED NEWS CLIP” [50]। চারটি আলাদা pin স্বাধীনভাবে “যা দেখছেন তা কি বিশ্বাসযোগ্য?” উদ্বেগ তুলে ধরে।
  • টুল তুলনা/সিদ্ধান্তের chart: ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma AI, Pika Pro, Kaiber AI, Synthesia-কে “paid/best quality” এবং Ideogram, Gemini Free, SeaArt AI, Playground AI, Krea AI, Canva AI, CapCut AI-কে “free” দলে রাখে—এমন ঘন infographic grid [9]। আরেকটি infographic “Google I/O 2026” news day—Gemini 3.5 Flash, Gemini Omni, Android XR smart glasses—সংক্ষেপ করে [30]।
  • Style-transfer/consistency demo: Luma-branded grid-এ একজনের source video-কে wooden-block, origami, Lego-brick ও ফুলে ঢাকা সংস্করণে বদলানো হয়েছে; একইভাবে গাড়ির material style বদল দেখানো—ফ্রেমজুড়ে image-to-image style consistency-এর উদাহরণ [2]।
  • Meme format: AI upscaling/generation quality-এর লাফ নিয়ে “144p vs 4K” reaction-face meme [39]—নমুনার একমাত্র স্পষ্ট হাস্যরসাত্মক, অপ্রচারমূলক pin।
  • হলুদ/কমলা “প্রফুল্ল SaaS ad” palette: বন্ধুসুলভ cartoon robot mascot-সহ “AI Video Generation — turn your ideas into stunning videos in minutes”, feature icon row (script-to-video, AI voice, subtitles, editor) [8]—মলিন neon/cyberpunk pin-এর বিপরীত টোন; ক্ষুদ্র ব্যবসা ও creator marketing-কে লক্ষ্য করে।
উল্লেখযোগ্য pin
  1. [1] “AI News: Anthropic Leak Shows Us The Future of AI...” — বারবার দেখা বিস্মিত-reactor thumbnail template, সেটে তিনবার এসেছে; AI-news recap channel Pinterest দিয়ে traffic আনছে—এর শক্ত ইঙ্গিত।
  2. [2] Luma-branded style-transfer grid — বর্তমান image/video-to-image consistency সক্ষমতার সবচেয়ে নির্দিষ্ট demo: একই subject ও pose-কে wooden-block/origami/Lego/floral style-এ বদলানো।
  3. [9] “Best AI Video Generators in 2026: Veo, Kling...” সিদ্ধান্ত-chart — সেটের সবচেয়ে ঘন নামের তালিকা; 16+ ক্লোজড টুলের বর্তমান checklist হিসেবে কার্যকর।
  4. [13] “Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API” — generic hype নয়; image-to-video-তে native audio-এর নির্দিষ্ট সাম্প্রতিক সক্ষমতা উল্লেখ করেছে।
  5. [25] “Google’s Gemini Omni Turns Anything Into Video” — Gemini Omni multimodal push নিয়ে Osiz Technologies-branded পোস্ট, Google I/O recap [30]-এও স্বাধীনভাবে প্রতিধ্বনিত।
  6. [33] NBC News “AI GENERATED” reporter clip — বাস্তব broadcaster-এর on-screen disclosure label পুরো pin-এর মূল আকর্ষণ; বিশ্বাসযোগ্যতা ও labeling বিতর্ক মূলধারার সংবাদ ব্র্যান্ডে পৌঁছেছে।
  7. [37] “Introducing Luma Dream Machine - Next Generation AI Video” — স্থিরভাবে উল্লেখিত video model-এর launch visual হিসেবে চরম macro eye shot।
  8. [39] “144p vs 4K” meme — generation/upscale quality-এর অগ্রগতি নিয়ে মজা করা একমাত্র প্রকাশ্য রসিক pin।
  9. [40] “‘Amuse 3.0’, an AI art creation tool...” (AMD-branded) — সেটের প্রায় একমাত্র open/local-tooling দৃষ্টিকোণ (AMD GPU-কেন্দ্রিক art app); বাকি সব cloud SaaS-কেন্দ্রিক।
  10. [49] “7 Best AI Baby Generators: Predict Your Child's Face (2026)” — novelty face-generation ব্যবহার—বয়স/সম্পর্ক morphing—সংবাদ/ভিডিও-টুল cluster থেকে আলাদা consumer-fun উপপ্রবণতা।
সংকেত
  • ক্লোজড-সোর্সের পরিচিত ব্র্যান্ড ভিজ্যুয়াল ভাষা নিয়ন্ত্রণ করছে। প্রায় প্রতিটি শিরোনাম নির্দিষ্ট commercial product—ChatGPT, Gemini/Gemini Omni, Veo 3, Kling, Midjourney, Adobe Firefly, Runway, Luma, Pika, Synthesia, Recraft, Ideogram, Krea, Canva—উল্লেখ করেছে। 50টি শিরোনামে মাত্র একটি ([40], Amuse 3.0/AMD) open বা locally-run কিছু বোঝায়; Stable Diffusion, ComfyUI, Flux, Wan বা HunyuanVideo শিরোনাম বা খোলা 30টি ছবির কোথাও নেই। Pinterest-এ “AI ছবি/ভিডিও জেনারেশন” বর্তমানে developer/open-source বিষয় নয়, ক্লোজড-SaaS ভোক্তা বিভাগ হিসেবে ধরা পড়ে।
  • বিশ্বাস ও সত্যতা নিয়ে উদ্বেগ পুনরাবৃত্ত বাস্তব উপবিষয়, এককালীন নয়: [3, 22, 33, 50]—চারটি স্বাধীন pin “এটি সত্যি নাকি AI?” বিষয়কে কেন্দ্র করে; এর মধ্যে NBC-র বাস্তব on-air disclosure graphic রয়েছে। newsroom automation-কে headline হিসেবে দেখানো AI-news-anchor pin [47]-এর সঙ্গেও এটি মিলে যায়।
  • একই কুয়েরিতে দুই ধরনের visual register প্রতিদ্বন্দ্বিতা করছে: শীতল cyberpunk/neon “AI এসে গেছে” imagery (android, glowing UI) এবং উষ্ণ cartoon-mascot SaaS-ad imagery (বন্ধুত্বপূর্ণ robot, হলুদ background)। দুটিই tool বিক্রি করছে, কিন্তু দৃশ্যত আলাদা audience—enthusiast/tech বনাম ক্ষুদ্র ব্যবসা/creator—লক্ষ্য করে।
  • Recap-channel thumbnail নিজস্ব Pinterest genre: একই shocked-face-plus-logo-grid style [1, 27, 48]-এ পুনরাবৃত্ত, অর্থাৎ Pinterest-এর “AI news” content-এর একটি অংশ native নয়, YouTube thumbnail-এর downstream repost।
  • অনুপস্থিত: অন্য প্ল্যাটফর্মের সাধারণ বিষয় হলেও নমুনায় pricing backlash, training-data মামলা/আইনি লড়াই বা artist-community প্রতিবাদের pin পাওয়া যায়নি। সবচেয়ে কাছের ByteDance/Hollywood copyright-deal news pin [7] IP protection-কে বিতর্ক নয়, সমাধানকৃত চুক্তি হিসেবে দেখায়।
সীমাবদ্ধতা
  • pin table-এ genre split নেই; একসারি 50টির তালিকা। তাই playbook-এর genre-branch অনুযায়ী রিপোর্টটি সাজানো নয়।
  • সংগৃহীত 50টির মধ্যে 30টির ছবি সরাসরি খোলা ও বর্ণনা করা হয়েছে; বাকি 20টি শুধু pinterest.pins.md-এর title দিয়ে উপস্থাপিত, ফলে সেগুলোর visual pattern কম গণনা হতে পারে।
  • আলাদা pin ID-তে কিছু duplicate/near-duplicate stock asset আছে (যেমন [5] ও [16] একই Adobe Stock graphic); তাই “neon AI icon branch” motif-এর দৃশ্যমান পুনরাবৃত্তি কিছুটা বেশি মনে হতে পারে।
  • কোনো pin metadata-তে engagement সংখ্যা নেই, ফলে জনপ্রিয়তা/virality নির্ণয় সম্ভব হয়নি; শুধু বিষয়বস্তু ও recency বিশ্লেষণ করা হয়েছে।
  • এটি শুধু Pinterest ধাপ; Reddit, X, YouTube, Bluesky ও Lemmy আলাদা ধাপের ফলাফলে আলোচিত।

প্রস্তাবিত পদক্ষেপ

  • Wan 3.0-কে ওপেন বলা আগে Alibaba/Hugging Face থেকে বাস্তব ওয়েট প্রকাশের অবস্থা সরাসরি যাচাই করুন, কারণ Bluesky ও YouTube সূত্রের মধ্যে দ্বন্দ্ব আছে।
  • কোনো মডেলকে ‘open source’ বলার আগে marketing claim নয়, লাইসেন্স শর্ত যাচাই করুন (যেমন FLUX 3, MiniMax H3-এর অঞ্চলসীমাবদ্ধ Community License)।
  • MiniMax H3 বাণিজ্যিকভাবে ব্যবহারের আগে deployment region-টি Community License-এ বাদ পড়েছে কি না—বিশেষত US/EU/UK/KR—নিশ্চিত করুন।
  • Sora API বন্ধ হওয়া ও Kling-এর $3B তহবিল AI ভিডিওর বাজারকে যে দিকে নির্দেশ করে, তা বিবেচনায় ভোক্তামুখী free tier-এর চেয়ে enterprise/commercial use case অগ্রাধিকার দিন।
  • Disney v. Midjourney এবং Andersen v. Stability AI docket নজরে রাখুন, কারণ রায় শিল্পজুড়ে training-data ব্যবহারের চর্চা বদলাতে পারে।
  • AI-তৈরি কনটেন্ট ধরা পড়লে Reddit ও Pinterest-এ যে প্রতিক্রিয়া দেখা গেছে, তা মাথায় রেখে স্পষ্ট AI-disclosure label দিন।

সংগৃহীত ছবি

AI News: Anthropic Leak Shows Us The Future of AI...Google announces ultra-high quality video...AI content and social media concernsJust Nail It 🎥Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 66 Stock Photos, Vectors, and VideoAI Generated Videos for Content MarketingimageAI For Image And video GenerationBest AI Video Generators in 2026: Veo, Kling,...Free AI-Powered Visual Content Generation Platform – Viva AIAI Tool To Turn Text Into ImagesimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI Image GenerationAI Content Studio & Automation Secrets 🚀📱imageKling.ai AI-Powered Text-to-Video GenerationimageimageimageimageNew York's Bold Gambit: Inside the Legislative...AIimageGoogle’s Gemini Omni Turns Anything Into Video‎🚨 AI is getting scary good.AI News: OpenAI Finally Released What We Asked ForProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingimageTop AI Video Generators of 2025imageAI Image Generation and the Entertainment IndustryAI news videos blur line between real and fake reportsThe Secret Weapon for Content Creators: AI-Powered Video GenerationimageimageIntroducing Luma Dream Machine - Next Generation AI VideoGenerative AI Explained: A Complete Beginner’s Guide (2026)Oh My God (OMG) Meme | 144p vs 4K Prompt | AI Image Generation Prompt | Insane Quality Difference'Amuse 3.0', an AI art creation tool that includes...AI News & Latest Updates | Artificial Intelligence Trends & BreakthroughsAIMastering Video and AI: Key Social Media Marketing Trends 2025AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥"Why AI Chatbots Fail at Keeping Up with Breaking News"4 Major AI Updates You Need to Know in 2026AI News Anchors & Creator-Led Coverage Take Over U.S. Media!The Snarky AI News RoundUp #87 Best AI Baby Generators: Predict Your Child's Face (2026)AI Anchor by Channel1

ডেটা-গুণমান নোট

Reddit (12/20 threads) এবং Lemmy (~14/20 posts) প্ল্যাটফর্মপ্রতি লক্ষ্যের নিচে ছিল এবং পণ্যের খবরের চেয়ে সাধারণ প্রতিক্রিয়ার দিকে ঝুঁকেছে। X-এর অঞ্চল-নির্দিষ্ট ট্রেন্ডে ওপেন-সোর্স সংকেত প্রায় পাওয়া যায়নি। YouTube ও Pinterest fetch/consent-page সীমাবদ্ধতার কারণে কোনো engagement metric (views, subscribers, likes) পাওয়া যায়নি। Bluesky-এর search API 403-এ অবরুদ্ধ ছিল, তাই পুরো প্ল্যাটফর্ম সার্চের বদলে account discovery ব্যবহৃত হয়েছে।

গ্যালারি