Я разбираю нейросеть akool.com — универсальный сервис с несколькими бесплатными инструментами в одном интерфейсе. Показываю генератор изображений по тексту и по картинке, замену лиц FaceLab, синтез речи с клонированием голоса и генерацию видео из текстового промпта. Пробую каждый инструмент вживую: генерирую фото мужчины у Lamborghini, делаю "говорящее фото" со своим голосом и создаю короткий видеоролик с эффектом от первого лица. Полезно тем, кто ищет бесплатную универсальную нейросеть для картинок и видео без установки на компьютер.
0:00–0:45 Автор представляет нейросеть akool.com: набор инструментов для генерации изображений и видео, интерфейс на русском, но промпты нужно писать на английском; бесплатно доступны генератор изображений и синтез речи. 0:45–1:31 Face swap (FaceLab) работает быстро; переход к генератору изображений — пример промпта "мужчина у Lamborghini зимой", совет генерировать по одной картинке вместо четырёх, чтобы экономить токены. 1:31–2:16 Результат генерации сразу в разрешении 4K без необходимости апскейлить; можно выбирать художественные стили для итогового изображения. 2:16–3:05 Фоторедактор image-to-image: загрузка своего фото и описание нужного результата через переводчик, настройка степени схожести с оригиналом. 3:05–3:50 Сравнение двух сгенерированных фото: сильное портретное сходство с оригиналом, но с лишними деталями, которые нейросеть добавила от себя. 3:50–4:36 Перевод видео по ссылке на другой язык и функция "говорящее фото" — загруженное фото оживает с выбранным голосом, но результат звучит неестественно, скорее подходит для мультяшных роликов. 4:36–5:23 Генератор видео из текста: доступно всего 4 токена, ролик на 5 или 10 секунд (10 секунд вдвое дороже), пример промпта "POV-эффект: еду за рулём по городу". 5:23–6:00 Готовый ролик получился примерно за 3 минуты вместо заявленных 45, скорость зависит от загрузки серверов; также можно анимировать загруженные фотографии.