Всем привет, долго думал над этим постом и все-таки решил его сделать. Сегодня мы поговорим о Gemini и Google, о их минусах и плюсах. Мы разберем как ведут себя модели Gemini в коде, генерации картинок/видео и бытовых вопросах.
_______________________________________________
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
⌨️Код
Начнем с того, что недавно была проведена конференция IO, где гугл представили много нового, а точнее: Gemini 3.5 Flash, Antigravity 2, Omni, про которую я уже говорил. Новая модель 3.5 опять показала бешеные бенчмарки, ну как всегда это бывает и про нее говорили, что она “заменит клод” и у меня есть что сказать по этому поводу, а именно:
> Gemini не самостоятельный. Я делал сайт, про который расскажу чуть позже и каждое действие, которое должно было выполниться на него он спрашивал разрешение, даже если это действие просто “прочитать файл”. И да, там есть кнопки “разрешить всегда” или “разрешить только в этой папке”, но они не работают..
> Я узнавал у людей их фидбек и вот, что мне сказали: гемини хорошо сделал мне фронтенд, но то как он понимал, то что я ему объяснял - это пиз#ец. И да, гемини глупый, он может не понимать то, что ему говорят, но это решается просто доп. промптами
Ну и перейдем к самому интересному, для этого поста я сделал сайт, который был нужен для того, чтобы показать наглядное сравнение Gemini 3.5 и CLaude Sonnet 4.6 (если не ошибаюсь). Я не хочу сказать, что какая-то модель лучше, именно поэтому я не делал кардинальных правок, которые могли бы улучшить результат.
(В случае с гемини правки были сделаны, потому что текст наслаивался друг на друга и картинка просто пропала). Промпт для генерации сайта был одинаковый.
Вот что сделал гемини -https://t.me/maloymediika/140?comment=1560. Сайт получился хорошим, если его доработать будет гуд, но при этом он не понял мои правки с первого раза, даже со второго некоторые вещи так и остались неисправленными. Гемини справился с задачей где-то за 5 минут, при том что все время я сидел у компа, потому что нужно было подтверждать каждое действие. Оценка - 6/10
Вот что сделал клод - https://eclectic-babka-fdc325.netlify.app/. Как по мне, это намного лучше. Да, он не вставил картины, а обошелся просто пикчами из интернета, но это без доработок, напоминаю. Анимации мне понравились, в целом вышло гуд. Я не сидел у компа, а просто нажал 1 кнопку и оно все делалось само. Оценка 8/10
Итог по коду.
Тут нельзя не вспомнить цену, за которую сейлят гемини на год, буквально 3-5$, исходя из этого код хороший, но если мы откидываем цену, то на пятерочку. Если у вас нет денег на 20$ или 10$ на клод/гпт, то смело берите гемини, тк у вас будет доступ и к клоду, и к гемини. Если что клода хватает буквально на 8 минут.
_______________________________________________
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
🤯🤯🤯🤯🤯🤯🤯🤯
⚔️ Картинки/видео
Этот раздел является ключевым, потому что это лучшее, что есть в гемини, разберем подробнее:
Nano Banano 2 - главная генеративная модель всей экосистемы. Сейчас на рынке “картиночных” моделей есть много разных конкурентов, например тот же Gpt image 2, и она делает лучше. НО, с подпиской за 3$ нано банано становится около бесконечным инструментом и дает генерить столько, сколько ты хочешь. Да и генерит она не плохо, особенно если тебе надо подправить картинку, либо что-то изменить - мастхев. Единственный минус, даже если ты просто убрал какую-либо надпись с картинки вотермарка появится и это решается также просто, просто заходишь на pixelcut.ai и там убираешь ее.
Omni - совершенно новая видео модель Google, на самом деле это level up, по сравнению с Veo, и вот почему:
> Работает по принципу «any-to-any», то есть принимает все: фото, текст, видео референс или все сразу. Исходя из этого можно понять, что ты можешь редактировать даже те, видео которые ты только что снял и попросить например “Замени задний план на пляж”
> Не теряет внешность, то есть при создании видео Omni не будет коверкать вас или вашего персонажа
👉🏼 Пост оказался длинным, поэтому продолжение здесь 👈🏼