একটি প্রম্পট, একটি প্রথম এবং শেষ ফ্রেম, বা ভিজ্যুয়াল এবং অডিও রেফারেন্সের একটি সম্পূর্ণ সেট থেকে সংযুক্ত ভিডিও তৈরি করুন৷ Seedance 2.5 AI ভিডিও জেনারেটর একটি প্রোডাকশন-কেন্দ্রিক ওয়ার্কফ্লোতে টেক্সট থেকে ভিডিও AI, ইমেজ থেকে ভিডিও AI, মাল্টি-শট ডিরেকশন এবং সিঙ্ক্রোনাইজ করা সাউন্ডকে একত্রিত করে।
Seedance 2.5 হল ByteDance-এর মাল্টিমোডাল ভিডিও মডেল দীর্ঘ সময়ের জন্য, আরও নিয়ন্ত্রণযোগ্য অডিওভিজ্যুয়াল তৈরি৷ এটি ভিডিও AI থেকে টেক্সট, ঐচ্ছিক প্রথম এবং শেষ ফ্রেমের সাথে ইমেজ থেকে ভিডিও AI এবং ছবি, ভিডিও ক্লিপ এবং অডিও ট্র্যাক ব্যবহার করে রেফারেন্স-লেড জেনারেশন সমর্থন করে।
একটি অনুরোধ একটি 30-সেকেন্ডের AI ভিডিও তৈরি করতে পারে যার সাথে বেশ কয়েকটি যৌক্তিকভাবে সংযুক্ত শট রয়েছে৷ এটি পুরো ক্লিপের জন্য একটি রচনাকে ধরে রাখার পরিবর্তে একটি খোলার, বিকাশ, রূপান্তর এবং অর্থ প্রদানের জন্য একটি দৃশ্য রুম দেয়।
মডেল ঘোষণা নেটিভ 4K আউটপুট হাইলাইট করে, যেখানে বর্তমানে এখানে উপলব্ধ জেনারেশন কন্ট্রোল 480p, 720p, এবং 1080p আউটপুট প্রদান করে। এই পার্থক্যটি আপনাকে বৃহত্তর Seedance 2.5 মডেল স্পেসিফিকেশন বোঝার সময় সংযুক্ত API গ্রহণ করে শুধুমাত্র সেটিংস বেছে নিতে দেয়।
একটি মাল্টিমোডাল ভিডিও জেনারেশন ব্রিফের মধ্যে 30টি ছবি, 10টি ভিডিও ক্লিপ এবং 10টি অডিও ট্র্যাক একত্রিত করুন৷ চরিত্রের পরিচয়, পণ্যের বিবরণ, ভিজ্যুয়াল স্টাইল, দৃশ্যের নকশা, ক্যামেরার ভাষা, গতি, ভয়েস বা বায়ুমণ্ডলের জন্য প্রতিটি সম্পদকে একটি স্পষ্ট ভূমিকা বরাদ্দ করুন।
এক দৌড়ে 30 সেকেন্ড পর্যন্ত তৈরি করুন এবং শটগুলির একটি ইচ্ছাকৃত ক্রম বর্ণনা করুন। দীর্ঘ সময়ের জন্য পণ্য প্রকাশ, সংক্ষিপ্ত বর্ণনামূলক আর্কস, লাইফস্টাইল দৃশ্য, ট্রেলার এবং সামাজিক বিজ্ঞাপনগুলি একটি পরিষ্কার শুরু এবং শেষ সহ সমর্থন করে।
একটি লিখিত সংক্ষিপ্ত একটি কাঠামোগত ক্রম পরিণত করুন. বিষয়, ক্রিয়া, ক্যামেরার অবস্থান, লেন্সের আচরণ, আলো, পেসিং, রূপান্তর, সংলাপ এবং শব্দ নির্দিষ্ট করুন যাতে প্রতিটি শট একই সৃজনশীল ধারণা পরিবেশন করে।
একটি প্রথম ফ্রেম অ্যানিমেট করুন বা প্রথম এবং শেষ ফ্রেম একসাথে ব্যবহার করুন যখন শুরু এবং শেষের কম্পোজিশন গুরুত্বপূর্ণ। ফ্রেম-নির্দেশিত মোডটি মাল্টিমোডাল রেফারেন্স জেনারেশন থেকে আলাদা, যার ফলে ইচ্ছাকৃত ধরনের নিয়ন্ত্রণ স্পষ্ট হয়।
কঠোর অডিওভিজ্যুয়াল সময়ের জন্য একসাথে ভিডিও এবং শব্দ তৈরি করুন। প্রম্পটগুলি দৃশ্যমান অ্যাকশনের পাশাপাশি সংলাপ, পরিবেশ, প্রভাব এবং বাদ্যযন্ত্রের অভিপ্রায় বর্ণনা করতে পারে, যখন একটি নীরব উত্স পছন্দ করা হয় তখন অডিও জেনারেশনও বন্ধ করা যেতে পারে।
পণ্যের চিত্র, প্রচারাভিযানের রেফারেন্স এবং গতির দিকনির্দেশ ব্যবহার করে পণ্যের প্রদর্শনী, জীবনযাত্রার দৃশ্য, মৌসুমী প্রচারণা, মার্কেটপ্লেস সম্পদ, এবং সামাজিক সৃজনশীলতা যেখানে স্পষ্ট বিবরণ এবং সামঞ্জস্যপূর্ণ ভিজ্যুয়াল ভাষার ব্যাপার আছে পরিকল্পনা করতে।
উত্স উপাদানের সাথে প্রজন্মের মোড মেলান, প্রতিটি রেফারেন্সকে একটি উদ্দেশ্য দিন এবং ক্রমটিকে ইচ্ছাকৃত শটগুলির একটি সিরিজ হিসাবে বর্ণনা করুন৷
প্রম্পট-অনলি কনসেপ্টের জন্য টেক্সট টু ভিডিও এআই ব্যবহার করুন, যখন প্রথম বা চূড়ান্ত কম্পোজিশন অ্যাঙ্কর করতে হবে তখন ইমেজ টু ভিডিও এআই ব্যবহার করুন, বা মাল্টিমোডাল ভিডিও জেনারেশন যখন ইমেজ, ক্লিপ এবং অডিও ফলাফলের বিভিন্ন অংশকে গাইড করবে।
বিষয়, সেটিং, অ্যাকশন, শট অর্ডার, ক্যামেরা আন্দোলন, আলো, উপকরণ, সংলাপ, পরিবেশ এবং সমাপ্তি বর্ণনা করুন। রেফারেন্স মোডে, প্রতিটি আপলোড করা সম্পদ ঠিক কী নিয়ন্ত্রণ করা উচিত তা ব্যাখ্যা করুন।
একটি 4-30 সেকেন্ড সময়কাল, সমর্থিত আকৃতির অনুপাত, 480p, 720p, বা 1080p রেজোলিউশন এবং অডিও তৈরি করতে হবে কিনা চয়ন করুন৷ প্রম্পট পরিমার্জন করার আগে ধারাবাহিকতা, পণ্যের বিবরণ, গতি, শব্দ এবং রূপান্তর পর্যালোচনা করুন।
চাক্ষুষ বিবরণের একটি দীর্ঘ তালিকার পরিবর্তে একটি শট ক্রম বর্ণনা করুন
প্রতিটি রেফারেন্স ইমেজ, ভিডিও, এবং অডিও ফাইল একটি একক স্পষ্ট উদ্দেশ্য দিন
কোন মুখ, পোশাক, পণ্য, লোগো এবং রং অবশ্যই সামঞ্জস্যপূর্ণ থাকতে হবে তা উল্লেখ করুন
প্রম্পটে আলাদা ক্যামেরার দিক, বিষয়ের গতি, আলো, সংলাপ এবং শব্দ
প্রথম এবং শেষ ফ্রেম ব্যবহার করুন যখন সঠিক ওপেনিং এবং এন্ডিং কম্পোজিশন সবচেয়ে গুরুত্বপূর্ণ
প্রকাশ করার আগে জেনারেট করা পাঠ্য, পণ্যের বিবরণ, হাত, মুখ, গতি এবং অডিও পর্যালোচনা করুন
Seedance 2.5 হল ByteDance এর মাল্টিমোডাল এআই ভিডিও মডেল যা পাঠ্য, প্রথম এবং শেষ ফ্রেম, বা চিত্র, ভিডিও এবং অডিও রেফারেন্স থেকে সংযুক্ত ভিডিও তৈরি করার জন্য। এটি ঐচ্ছিক সিঙ্ক্রোনাইজড অডিও এবং সংযুক্ত ওয়ার্কফ্লো মাধ্যমে 30 সেকেন্ড পর্যন্ত আউটপুট সমর্থন করে।
Seedance 2.5 বনাম Seedance 2.0-এর জন্য, নতুন মডেলটি ভিডিওর দৈর্ঘ্য, মাল্টিমোডাল রেফারেন্স নিয়ন্ত্রণ, প্রাক-প্রজন্ম পরিকল্পনা, সম্পাদনা নিয়ন্ত্রণ এবং মডেলের প্রকাশিত আউটপুট ক্ষমতা প্রসারিত করে। এই পরিবর্তনগুলি Seedance 2.5 কে দীর্ঘ দৃশ্য, ব্র্যান্ড সম্পদ এবং উৎপাদন-কেন্দ্রিক AI ভিডিও কর্মপ্রবাহের জন্য আরও উপযুক্ত করে তোলে।
রেফারেন্স ওয়ার্কফ্লো 30টি ছবি, 10টি ভিডিও ক্লিপ এবং 10টি অডিও ট্র্যাক গ্রহণ করে৷ রেফারেন্স ভিডিওগুলি মোট 30 সেকেন্ড পর্যন্ত হতে পারে এবং প্রতিটি সম্পদকে প্রম্পটে একটি স্পষ্ট ভূমিকা বরাদ্দ করা উচিত।
হ্যাঁ। সংযুক্ত API 4 থেকে 30 সেকেন্ডের ভিডিও সময়কাল সমর্থন করে। একটি বিশদ শট সিকোয়েন্স মডেলটিকে একটি একক দীর্ঘস্থায়ী দৃশ্যের পরিবর্তে সংযুক্ত অ্যাকশন এবং ট্রানজিশনের জন্য অতিরিক্ত সময় ব্যবহার করতে সহায়তা করে।
হ্যাঁ। ভিডিওর সাথে একসাথে অডিও তৈরি করা যায়। প্রম্পটে কথোপকথন, পরিবেশ, সাউন্ড এফেক্ট বা বাদ্যযন্ত্রের অভিপ্রায় বর্ণনা করুন বা পরবর্তী পোস্ট-প্রোডাকশনের জন্য যখন আপনার একটি নীরব ক্লিপ প্রয়োজন তখন অডিও জেনারেশন অক্ষম করুন।
Seedance 2.5 মডেল ঘোষণা নেটিভ 4K আউটপুট বর্ণনা করে। বর্তমান সংযুক্ত জেনারেটর 480p, 720p, এবং 1080p সেটিংস প্রকাশ করে, তাই এই পৃষ্ঠায় করা অনুরোধগুলির জন্য উপলব্ধ রেজোলিউশনগুলি থেকে নির্বাচন করুন৷
এটি পণ্যের প্রদর্শনী, জীবনধারার দৃশ্য, প্রচারাভিযানের ধারণা, মার্কেটপ্লেস সম্পদ এবং সামাজিক বিজ্ঞাপন সমর্থন করতে পারে। স্পষ্ট পণ্যের রেফারেন্স ব্যবহার করুন, প্রম্পটে গুরুত্বপূর্ণ জ্যামিতি এবং ব্র্যান্ডিং সংরক্ষণ করুন এবং প্রকাশের আগে সঠিক বিবরণের জন্য প্রতিটি আউটপুট পর্যালোচনা করুন।
বাণিজ্যিক ব্যবহার সক্রিয় পরিষেবা শর্তাবলী এবং ইনপুট হিসাবে ব্যবহৃত প্রতিটি প্রম্পট, ছবি, ক্লিপ, অডিও ফাইল, লোগো, ব্যক্তি এবং চরিত্রের উপর আপনার অধিকারের উপর নির্ভর করে। বিতরণের আগে সেই অধিকার এবং চূড়ান্ত আউটপুট পর্যালোচনা করুন।
ঐচ্ছিক সিঙ্ক্রোনাইজড অডিও সহ একটি সংযুক্ত AI ভিডিওতে একটি প্রম্পট, একটি ফ্রেম জোড়া, বা একটি মাল্টিমোডাল রেফারেন্স সেট করুন৷
শটগুলির পরিকল্পনা করুন, প্রতিটি রেফারেন্স একটি উদ্দেশ্য নির্ধারণ করুন, উপলব্ধ আউটপুট সেটিংস চয়ন করুন এবং আপনার প্রথম Seedance 2.5 ভিডিও তৈরি করুন৷
Seedance 2.5 দিয়ে টেক্সট-টু-ভিডিও, ইমেজ-টু-ভিডিও এবং মাল্টিমোডাল AI ভিডিও তৈরি করুন।