Google-ը թողարկել է Gemini Nano Banana 2.1-ը՝ պատկերների գեներացման և խմբագրման հնարավորությամբ

Google-ը պաշտոնապես թողարկել է Gemini Nano Banana 2.1 մոդելը, որը նախատեսված է պատկերների գեներացման և խմբագրման համար և այժմ հասանելի է Gemini Enterprise Agent Platform-ում։ Մոդելը աջակցում է տեքստային և պատկերային մուտքային տվյալների համադրմանը, ինչը թույլ է տալիս օգտատերերին ստեղծել կամ փոփոխել վիզուալ բովանդակություն՝ օգտագործելով հրահանգներ և ելակետային պատկերներ։ Այն ապահովում է մինչև 4K լուծաչափ և ներառում է բովանդակության հավաստագրման գործառույթներ։ Թեև մոդելը հարմար է մարքեթինգային և արտադրանքի վիզուալիզացիայի համար, այն չի աջակցում որոշ ստանդարտ պարամետրեր, ինչպիսիք են ջերմաստիճանը (temperature) կամ seed-ը, ինչպես նաև չի աջակցում fine-tuning կամ RAG։ Գնագոյացումը հիմնված է օգտագործված թոքենների քանակի վրա՝ կախված ընտրված լուծաչափից։ Ընկերություններին խորհուրդ է տրվում նախքան արտադրական գործընթացներում ներդնելը փորձարկել մոդելի աշխատանքը և արդյունքների որակը։
This is a summary. Read the full article at the original source:
Dev.toԿապակցված
AI գործակալների հաջորդ խոչընդոտը՝ կայքերի մուտքի ապահովումը
Անհատական AI գործակալները նախատեսված են առօրյա գործերը հեշտացնելու համար, ինչպիսիք են գնումները, չվերթների ամրագրումը և այլ ծառայություններից օգտվելը:…
Mistral-ի նոր «Le Chonk» AI մոդելը մեծ է, բաց և նախատեսված գործակալների համար
Mistral AI-ն ներկայացրել է իր վերջին՝ Mistral Large 4 լեզվական մոդելը, որը ներքին անվանումով հայտնի է որպես «Le Chonk»: Այս նոր մոդելը նախատեսված է որ…
ChatGPT-ն ստեղծում է New Yorker-ի կեղծ ծաղրանկարներ՝ նկարիչների ստորագրություններով
OpenAI-ի ChatGPT-ն հայտնվել է հեղինակային իրավունքի խախտման նոր սկանդալի կենտրոնում։ Պարզվել է, որ չաթ-բոտը ստեղծում է New Yorker ամսագրի ոճով ծաղրանկ…



