Sber-ը ներկայացրել է տեքստային նկարագրությունից պատկերներ ստեղծելու մոդելի երրորդ թարմացումը՝ Կանդինսկի 2.1:
Գեներատիվ նոր մոդելը կարող է մի քանի վայրկյանում ստեղծել բարձրորակ պատկերներ՝ համաձայն բանավոր լեզվով տեքստային նկարագրության:
Այն կարող է նաև խառնել մի քանի գծագրեր, փոխել դրանք ըստ տեքստի նկարագրության, ստեղծել պատկերներ, որոնք նման են տվյալին, լրացնել նկարի բացակայող մասերը և ձևավորել պատկերներ կտավի ռեժիմում:
Մոդելը ճանաչում է հարցումները 101 լեզվով և կարող է նկարել տարբեր ոճերում:
Կանդինսկի 2.1-ի նոր տարբերակը պարունակում է 3,3 միլիարդ պարամետր՝ Կանդինսկի 2.0-ի 2 միլիարդի փոխարեն և օգտագործում է ոչ միայն կոդավորված տեքստի նկարագրություն, այլև CLIP մոդելի պատկերի հատուկ ներկայացում: Այս ձևով նեյրոնային ցանցը տեքստային տեղեկատվության հիման վրա ստեղծում է պատկերի ներկայացում և այն մատակարարում է հիմնական գեներատիվ մոդելի մուտքագրմանը:
Սբերն առաջին անգամ ներկայացրել է Կանդինսկու տեքստային նկարագրության հիման վրա պատկերներ ստեղծելու մոդելը 2022 թվականի հունիսին. դա արդեն ստեղծված ruDALL-E նեյրոնային ցանցի բարելավված տարբերակն էր:





