
Photo by jaka setiawan on Pexels
আজকাল কৃত্রিম বুদ্ধিমত্তা বা এআই দিয়ে অসাধারণ ছবি তৈরি করা বেশ সহজ হয়ে গেছে। তবে মিডজার্নি (Midjourney)-র মতো জনপ্রিয় সার্ভিসগুলো ব্যবহার করতে প্রতি মাসে মোটা অঙ্কের সাবস্ক্রিপশন ফি দিতে হয়। অন্যদিকে অন্যান্য অনেক টুল আপনার পিসির পারফর্ম্যান্স কমিয়ে দেয় বা ছবিতে নিজস্ব নিয়ন্ত্রণ দেয় না। এই সব সমস্যার সেরা সমাধান হলো ComfyUI। এটি সম্পূর্ণ বিনামূল্যে ব্যবহারযোগ্য একটি ওপেন-সোর্স সফটওয়্যার, যা আপনার নিজের পিসিতেই চালানো সম্ভব। যদি আপনি ডিজিটাল আর্ট, ফটো এডিটিং এবং ডিজাইন নিয়ে আগ্রহী হন, তবে ComfyUI শেখা আপনার ক্যারিয়ার ও স্কিলের জন্য একটি দারুণ ইনভেস্টমেন্ট হতে পারে। এই গাইডে আমরা নতুনদের জন্য সহজ ভাষায় ComfyUI ইনস্টলেশন থেকে শুরু করে প্রথম ছবি তৈরির পুরো প্রক্রিয়াটি বিস্তারিত আলোচনা করব।
ComfyUI হলো স্টেবল ডিফিউশন (Stable Diffusion)-এর একটি ওপেন-সোর্স নোড-ভিত্তিক জিইউআই (GUI), যা কম র্যাম ও জিপিইউ ব্যবহার করে দ্রুত এবং নিখুঁত এআই ছবি তৈরি করতে সাহায্য করে।
সাধারণত বেশিরভাগ এআই ইমেজ টুল একটি নির্ধারিত ফর্মের মতো কাজ করে—যেখানে আপনি প্রম্পট লেখেন আর এআই একটি ছবি জেনারেট করে দেয়। কিন্তু ComfyUI কাজ করে 'নোড' (Node) ও 'ওয়ার্কফ্লো' (Workflow) সিস্টেমে। অর্থাৎ, পুরো ছবি তৈরির প্রক্রিয়াটিকে ছোট ছোট বাক্সে ভাগ করে তার (wire) দিয়ে যুক্ত করা হয়। এতে করে ইমেজের প্রতিটি পিক্সেল, কালার গ্রিড এবং টেক্সচারের ওপর আপনার ১০০% নিয়ন্ত্রণ থাকে। আপনি যদি অনলাইন প্ল্যাটফর্মে কাজ করতে অভ্যস্ত হন বা আমাদের ছবি ও ডিজাইন বিভাগের অন্যান্য টিউটোরিয়াল দেখে থাকেন, তবে বুঝতে পারবেন যে লোকাল সফটওয়্যারের স্বাধীনতা সম্পূর্ণ আলাদা।
বৈশিষ্ট্য | ComfyUI | Automatic1111 | Midjourney |
|---|---|---|---|
মূল্য | সম্পূর্ণ ফ্রি | সম্পূর্ণ ফ্রি | পেইড (মাসিক ফি) |
ভিআরএএম (VRAM) দক্ষতা | অত্যন্ত দক্ষ (কম মেমোরি লাগে) | মাঝারি (বেশি ভিআরএএম লাগে) | ক্লাউডভিত্তিক (পিসি মেমোরি লাগে না) |
নিয়ন্ত্রণের সুযোগ | সর্বোচ্চ (নোড ভিত্তিক) | ভালো (অপশন ভিত্তিক) | সীমিত (শুধু প্রম্পট ভিত্তিক) |
অফলাইন ব্যবহার | হ্যাঁ | হ্যাঁ | না |
ComfyUI চালানোর জন্য ন্যূনতম ৪ জিবি এনভিডিয়া (Nvidia) জিপিইউ এবং ৮ জিবি র্যাম প্রয়োজন, তবে ভালো অভিজ্ঞতার জন্য ডেডিকেটেড ভিআরএএম থাকা বাঞ্ছনীয়।
আপনার পিসিতে যদি ভালো গ্রাফিক্স কার্ড না থাকে, তবুও হতাশ হওয়ার কিছু নেই। আপনি গুগল কোলাব (Google Colab)-এর মাধ্যমে ক্লাউডে সম্পূর্ণ ফ্রিতে ComfyUI ব্যবহার করতে পারবেন। তবে নিজের পিসিতে চালানোর জন্য নিচের স্পেসিফিকেশনগুলো মিলিয়ে নিন:
ComfyUI পোর্টেবল জিপ ফাইল ডাউনলোড করে আনজিপ করার পর একটি নির্দিষ্ট ব্যাচ ফাইলেই ক্লিক করে কোনো জটিল কোডিং ছাড়াই এটি চালু করা যায়।

অনেকেই কোডিং বা পিক্সেল সেটআপের ভয়ে লোকাল এআই টুল ইনস্টল করতে চান না। কিন্তু ComfyUI ইনস্টল করা একদমই সহজ। নিচের ধাপগুলো অনুসরণ করুন:
১. প্রথমে অফিশিয়াল ComfyUI GitHub পেজে যান।
২. পেজটি স্ক্রোল করে নিচে নামলে Direct Link to Download অংশ থেকে Windows Portable zip ফাইলটি ডাউনলোড করুন।
৩. ডাউনলোড ফাইলটি (৭-জিপ বা উইনরার দিয়ে) আপনার কম্পিউটারের যেকোনো ড্রাইভে আনজিপ (Unzip) করুন।
৪. ফোল্ডারের ভেতর ঢুকলে `run_nvidia_gpu.bat` (যদি Nvidia জিপিইউ থাকে) অথবা `run_cpu.bat` নামের ফাইল দেখতে পাবেন।
৫. `run_nvidia_gpu.bat` ফাইলে ডাবল ক্লিক করলেই আপনার লোকাল ব্রাউজারে ComfyUI ইন্টারফেসটি খুলে যাবে।
ComfyUI-তে প্রতিটি কাজ ছোট ছোট বাক্সে বা 'নোডে' বিভক্ত থাকে, যা তার দিয়ে যুক্ত হয়ে একটি সম্পূর্ণ ছবি তৈরির প্রক্রিয়া বা 'ওয়ার্কফ্লো' গঠন করে।
প্রথমবার ComfyUI খুললে অনেকগুলো নোড দেখে জটিল মনে হতে পারে। কিন্তু নতুনদের জন্য মূলত ৫টি প্রধান নোড বুঝলেই চলে:
চেকপয়েন্ট মডেল ডাউনলোড করে ফোল্ডারে রেখে প্রম্পট লিখে 'Queue Prompt' বাটনে ক্লিক করলেই ComfyUI কয়েক সেকেন্ডের মধ্যে আপনার প্রথম এআই ছবি জেনারেট করবে।

একটি চমৎকার ছবি জেনারেট করতে নিচের ধাপগুলো ধাপে ধাপে অনুসরণ করুন:
১. মডেল ডাউনলোড করুন: প্রথমে Civitai ওয়েবসাইটে গিয়ে যেকোনো একটি ভালো স্টেবল ডিফিউশন মডেল (যেমন: Realistic Vision বা DreamShaper) ডাউনলোড করুন। ডাউনলোড করা `.safetensors` ফাইলটি আপনার `ComfyUI/models/checkpoints` ফোল্ডারে রাখুন।
২. ComfyUI রিফ্রেশ করুন: ব্রাউজারে ComfyUI খুলে ডানপাশের মেকার প্যানেল থেকে Refresh বাটনে চাপ দিন, যেন নতুন মডেলটি শো করে।
৩. মডেল সিলেক্ট করুন: Load Checkpoint নোড থেকে আপনার ডাউনলোড করা মডেলটি বেছে নিন।
৪. প্রম্পট লিখুন: পজিটিভ প্রম্পট বক্সে লিখুন—`A stunning cinematic portrait of a traditional Bangladeshi artisan working in his workshop, natural lighting, highly detailed, 8k resolution` এবং নেগেটিভ প্রম্পট বক্সে লিখুন—`blurry, low quality, distorted hands, extra fingers`। টেক্সট জেনারেশন বা আইডিয়া দ্রুত পেতে আপনি ChatGPT ব্যবহার করতে পারেন।
৫. ছবি জেনারেট করুন: ডানপাশের মেনু থেকে Queue Prompt বাটনে ক্লিক করুন। কয়েক সেকেন্ডের মধ্যে প্রতিটি নোডের চারপাশ সবুজ আলোতে হাইলাইট হবে এবং Save Image নোডে আপনার কাঙ্ক্ষিত ছবি ভেসে উঠবে।
ড্র্যাগ-অ্যান্ড-ড্রপ ফিচার ব্যবহার করে অন্য কারও তৈরি ছবির নোড ওয়ার্কফ্লো সরাসরি ইম্পোর্ট করা এবং ComfyUI Manager ব্যবহার করে কাজের গতি বহুগুণ বাড়ানো সম্ভব।
নতুন হিসেবে কাজের গতি বাড়াতে নিচের তিনটি টিপস সবসময় মনে রাখবেন:
আপনি যদি গ্রাফিক্স এবং ফটো এডিটিংয়ে নিজেকে আরও দক্ষ করতে চান, তবে ডিজিটাল ভিজ্যুয়াল আর্টের মৌলিক বিষয়গুলো জানতে আমাদের সাইটের ছবি ও ডিজাইন ক্যাটাগরির অন্যান্য আর্টিকেলগুলো নিয়মিত পড়তে পারেন।
না, ComfyUI সম্পূর্ণ অফলাইনে চলে। শুধুমাত্র প্রাথমিক অবস্থায় সফটওয়্যার ও মডেল ডাউনলোডের জন্যই ইন্টারনেট প্রয়োজন হয়।
হ্যাঁ পারবেন, তবে প্রসেসর বা CPU দিয়ে ছবি জেনারেট হতে অনেক সময় লাগবে। সেক্ষেত্রে বিকল্প হিসেবে বিনামূল্যে Google Colab ব্যবহার করা সবচেয়ে বুদ্ধিমানের কাজ হবে।
হ্যাঁ, ComfyUI দিয়ে তৈরি ছবি আপনি ব্যবসায়িক বা কমার্শিয়াল কাজে ব্যবহার করতে পারবেন, তবে আপনি যে মডেলটি (Checkpoint) ব্যবহার করছেন তার লাইসেন্স শর্তাবলী মেনে চলতে হবে।

এই আর্টিকেলের বিষয়ের সাথে সরাসরি সম্পর্কিত সেরা এআই টুলস, ব্যবহারের প্রম্পটস ও ওপেন সোর্স প্রজেক্ট নিচে তুলে ধরা হলো।
মোবাইলে সহজ ভিডিও এডিটিং ও শর্ট ভিডিও
CapCut দিয়ে মোবাইলেই প্রফেশনাল ভিডিও এডিট করা যায় — সাবটাইটেল, ট্রানজিশন, ইফেক্ট সব বিনামূল্যে। AI সাবটাইটেল জেনারেশন দারুণ কাজের।
সোশ্যাল পোস্ট, থাম্বনেইল ও প্রেজেন্টেশন ডিজাইন
Canva-এর AI টুলস দিয়ে থাম্বনেইল, পোস্টার, প্রেজেন্টেশন, লোগো সহ সব ধরনের ডিজাইন সহজে বানানো যায়। ম্যাজিক রাইট, ম্যাজিক ইমেজ ফিচার আছে।
শিল্পের মতো উচ্চমানের ছবি তৈরি
টেক্সট প্রম্পট থেকে অসাধারণ মানের আর্ট ও ছবি তৈরি করে। ডিজাইনার ও ক্রিয়েটরদের কাছে জনপ্রিয়। শুধু পেইড প্ল্যান।
ওয়েবসাইটের বিক্রয় বা কনভার্সন বাড়াতে সঠিক UI/UX লেআউট এবং আকর্ষণীয় সেলস কপির ফ্রেমওয়ার্ক তৈরি করে।
ব্র্যান্ড বা ওয়েবসাইটের জন্য মানানসই কালার কোড ও ফন্ট কম্বিনেশন নির্দেশিকা তৈরির প্রম্পট।
একটি কার্যকর সোশ্যাল মিডিয়া পোস্ট ডিজাইনের জন্য বিস্তারিত ব্রিফ তৈরি করুন যা একজন ডিজাইনার ব্যবহার করতে পারবে।
AI ব্যবহার করে ছবি তৈরি ও সম্পাদনার জন্য একটি শক্তিশালী ওয়েব ইন্টারফেস।
stable-diffusion-webui একটি ওয়েব-ভিত্তিক ইন্টারফেস যা Stable Diffusion মডেল ব্যবহার করে ছবি তৈরির প্রক্রিয়াকে সহজ করে। এর মাধ্যমে টেক্সট থেকে ছবি তৈরি, বিদ্যমান ছবি থেকে নতুন ছবি বানানো (image2image) এবং ছবির মান উন্নত করা (upscaling) যায়। এটি AI আর্ট ও ডিপ লার্নিংয়ে আগ্রহী ছাত্র থেকে শুরু করে পেশাদারদের জন্য উপযোগী।
নোড-ভিত্তিক উন্নত AI ছবি তৈরি
ComfyUI দিয়ে নোড জোড়া দিয়ে জটিল ইমেজ-জেনারেশন পাইপলাইন বানানো যায় — Stable Diffusion মডেল দিয়ে নিজের নিয়ন্ত্রণে ছবি তৈরি। লোকালভাবে চলে, তাই ছবি তৈরির খরচ শূন্যের কাছে। ডিজাইনারদের জন্য রিপিটেবল ও কাস্টমাইজযোগ্য ইমেজ ওয়ার্কফ্লো বানাতে শক্তিশালী।
স্থানীয়ভাবে AI model প্রশিক্ষণ ও পরিচালনার জন্য সেরা।
unsloth একটি স্থানীয় ইউজার ইন্টারফেস (UI) যা বিভিন্ন LLM এবং diffusion model চালানো ও প্রশিক্ষণে সহায়তা করে। এটি Qwen3.8, Gemma 4, DeepSeek-V4 সহ অনেক আধুনিক AI model সমর্থন করে এবং AI-ভিত্তিক অ্যাপ্লিকেশন ডেভেলপমেন্টের প্রক্রিয়াকে সহজ করে তোলে। AI ও মেশিন লার্নিং নিয়ে কাজ করা শিক্ষার্থী থেকে শুরু করে পেশাদারদের জন্য এটি একটি কার্যকরী টুল।
৫ মিনিটের পড়া। ফ্রিল্যান্সিং ও পড়াশোনায় কাজে লাগবেই — সম্পূর্ণ ফ্রি।