हे त्याने काय काढले आहे ते पाहते
व्हिडिओचे वर्णन करा. हे थंबनेलचा संच तयार करते, प्रत्येक थंबनेल दर्शक जसा पाहेल तसा उघडते, थंबनेलच्या आकारात स्पष्ट न दिसणारे थंबनेल काढून टाकते आणि तुमच्यासाठी फाईल्स ठेवते.
हे कसे काम करते
तीन पायऱ्या, आणि त्यातील एकही “कॉन्फिगर करा” नाही.
- 01
याला संक्षिप्त माहिती द्या
व्हिडिओबद्दलचे शीर्षक आणि एक वाक्य पुरेसे आहे. ब्रँडचे रंग, संदर्भ इमेज किंवा तुम्ही जुळवत असलेली शैली या सर्वांची मदत होते, आणि तुम्ही एखादी गोष्ट सोडल्यास त्याने काय गृहीत धरले ते हे सांगते.
- 02
हे तयार करते, मग पाहते
हा तो भाग आहे जो प्रॉम्टची युक्ती नाही. प्रत्येक पर्याय उघडला जातो आणि तो प्रत्यक्षात कसा दिसेल त्यानुसार पारखला जातो — लहान आकारात, ग्रिडमध्ये, इतर वीस चित्रांच्या शेजारी — आणि जे अयशस्वी ठरतात ते पुन्हा तयार केले जातात.
- 03
तुम्हाला चॅट लॉग नाही, तर फाईल्स मिळतात
प्रत्येक इमेज वर्कस्पेसमध्ये तुम्ही वाचू शकाल अशा नावासह येते, सोबतच प्रत्येक इमेज का ठेवली किंवा वगळली याबद्दलची एक संक्षिप्त नोंद असते. संच डाउनलोड करा आणि निवडा.
हे काय करू शकते
वास्तविक आकारावर वाचनीयतेचा अंदाज घ्या
थंबनेल सुमारे 320 पिक्सेल रुंद दिसते. मॉनिटरवर काम करणारा मजकूर तिथे अदृश्य होतो, आणि हे जाणून घेण्याचा एकमेव मार्ग म्हणजे पाहणे — जे हे प्रत्येक उमेदवारावर करते.
एक मालिका एकत्र ठेवा
याला तुमच्या चॅनेलचे शेवटचे तीन थंबनेल द्या आणि ते प्रत्येक भागामध्ये ओळख पुन्हा सुरू करण्याऐवजी त्या भाषेत — समान पॅलेट, समान वजन, समान मजकूर — काम करते.
फक्त काय नाही, तर का ते सांगा
प्रत्येक पर्याय महत्त्वाच्या एका वाक्यासह येतो: ते काय करत आहे, ते कोणासाठी आहे आणि त्यांनी वगळलेले दोन पर्याय का काम करू शकले नाहीत याचे कारण.
हे कसे सेट केले आहे
कार्यपद्धती, जेणेकरून साइन इन करण्यापूर्वी तुम्हाला काय मिळत आहे हे तुम्हाला माहीत असेल.
- वातावरण
- इमेज असलेला वर्कस्पेस, आणि कोणतेही टर्मिनल नाही — या एजंटचे काम निरीक्षण करणे आहे, कमांड रन करणे नाही.
- साधने
- इमेज जनरेशन, इमेज रीडिंग आणि फाईल टूल. एकूण सात.
- मॉडेल
- एक व्हिजन मॉडेल, कारण अर्धे काम चित्राचे वर्णन करण्याऐवजी त्याची पारख करणे हे असते.
- सुरुवातीच्या फाइल्स
- तुम्ही एडिट करू शकाल अशा ब्रीफवर उघडते. तयार झालेल्या इमेज images/ मध्ये येतात.
- काय राहते
- सत्रात सर्व काही राहते — परत या आणि संच तिथेच असेल.
लोक ज्या गोष्टी विचारतात
- “"तुमचा एजंट त्याने काय काढले ते शेवटी पाहू शकतो" नावाच्या भागासाठी चार पर्याय”
- “हे तीन जुळवा — येथे माझ्या चॅनेलचा शेवटचा महिना आहे”
- “तीच कल्पना, परंतु विषय मोठा करा आणि मजकूर पूर्णपणे काढून टाका”
- “या दोघांपैकी कोणते 320 पिक्सेलवर अधिक चांगले वाचले जाते, आणि का?”
हे काय करणार नाही
यातील प्रत्येक मर्यादा आम्ही प्रत्यक्षात अनुभवली आहे, हा रोडमॅपचा भाग नाही.
- हे इमेजवर विश्वासार्हपणे मजकूर टाकू शकत नाही. इमेज मॉडेल्स अजूनही अक्षरांचा आकार बिघडवतात, त्यामुळे हे शब्दांना तुम्ही सेट करण्यासाठी कलात्मक दिशा मानते, आणि तसे सांगते.
- यामध्ये कोणतेही कंपोझिटिंग टूल नाहीत — क्रॉपिंग नाही, ओव्हरले नाही, लेआउट नाही. मॉडेल जे काढते तेच तुम्हाला मिळते.
- निर्मितीसाठी क्रेडिट्स लागतात, आणि प्रत्येक निकालाचे निरीक्षण करण्यासाठी थोडे जास्त क्रेडिट्स लागतात. चारचा संच काही सेंट्सचा असतो, मोफत नाही.
- याने तुमचे अॅनालिटिक्स कधीही पाहिलेले नाही. हे थंबनेलच्या कलात्मकतेनुसार पारखते, गेल्या महिन्यात तुमच्यासाठी काय चालले यानुसार नाही.
कोणते मॉडेल हे सर्वोत्तम करते
या एजंटच्या वास्तविक रन्सवर, प्रति मॉडेल मोजलेले. जेव्हा एखादा रन स्वतःहून उत्तर तयार करतो तेव्हा तो पूर्ण झालेला मानला जातो — काहीही अयशस्वी झाले नाही, कोणालाही कशास मान्यता देण्यास सांगितले गेले नाही, आणि त्याच्या पायऱ्या संपल्या नाहीत. तीनही स्तंभ एकत्र वाचा: हार मानून वेगाने संपवणारे मॉडेल पहिल्या स्तंभावर वाईट स्कोअर करते, आणि सर्वकाही कसून पूर्ण करणारे मॉडेल दुसऱ्या स्तंभावर वाईट स्कोअर करते.
| मॉडेल | पूर्णतेचा दर | मध्यक खर्च | मध्यक वेळ | रन्स |
|---|---|---|---|---|
| gemini-3.5-flash-litegoogle | 100% | $0.017 | 94से | 4 |
- पूर्णतेचा दर
- तुम्हाला हस्तक्षेप न करता काम पूर्ण करणाऱ्या रन्स.
- मध्यक खर्च
- क्रेडिट्समध्ये, एका सामान्य रनचा खर्च किती येतो.
- मध्यक वेळ
- भिंतीवरील घड्याळ, पहिल्या संदेशापासून उत्तरापर्यंत.
प्रत्येक रांगेच्या मागील रन्सवरील मध्यक. या एजंटवर 3 रन्स झाल्यावर एक मॉडेल दिसते, आणि रन संख्या दर्शविली जाते जेणेकरून एखादा आकडा कशावर आधारित आहे याचा तुम्ही अंदाज लावू शकाल.
हे त्याने काय काढले आहे ते पाहते
हे आधीच सेट केले आहे. ते उघडा आणि काहीतरी विचारा.
काही थंबनेल तयार करा