Нейронавт | Нейросети в творчестве

LangSplatV2: High-dimensional 3D Language Gaussian Splatting with 450+ FPS

Модель умеет быстро обрабатывать и понимать изображения в трёхмерном пространстве, используя язык. Находит объекты на картинках и определяет их местоположение с высокой точностью.

Был похожий проект

Код

#video2mask #segmentation #gaussian

👍10🔥1

1.79K views12:16

Нейронавт | Нейросети в творчестве

Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models

Генератор картинок по тексту в 4K.
В деле замешаны SD3-2B и Flux-12B

Сайта нет, проект исследовательский

Код

#text2image

👍13

1.9K views13:16

Нейронавт | Нейросети в творчестве

😁8👍2🔥1🤯1

1.96K views18:43

Нейронавт | Нейросети в творчестве

0:36

Media is too big

VIEW IN TELEGRAM

Copart: Contextual Part Latents for 3D Generation

Очередной генератор 3D по частям

Сложные вещи разбивает на более простые части.
Учитывает как эти части связаны друг с другом, и может управлять каждой из них по отдельности.

Код

#imageto3d #3d

👍8

9.52K views06:29

Нейронавт | Нейросети в творчестве

0:57

This media is not supported in your browser

VIEW IN TELEGRAM

Небось уже слышали про робота Reachy Mini за $299 от HuggingFace, на котором можно запускать демоспейсы?

Теперь они выпускают в опенсорс проект роборуки HopeJR, которую можно напечатать на 3D принтере и собрать за $500

#robot

❤6👍2🔥2🥴2

1.73K views07:11

Нейронавт | Нейросети в творчестве

Пачка из 21 лоры под #Kontext

Реддит

#lora

❤6👍1

1.63K views07:41

Нейронавт | Нейросети в творчестве

Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models

Добавление объектов на изображение от NVIDIA
По текстовому описанию

Код
Демо

#imageediting #inpainting

❤8👍4

1.81K views08:11

Нейронавт | Нейросети в творчестве

0:59

This media is not supported in your browser

VIEW IN TELEGRAM

1:26

This media is not supported in your browser

VIEW IN TELEGRAM

CLiFT: Compressive Light-Field Tokens for Compute-Efficient and Adaptive Neural Rendering

Метод представления (и рендеринга) 3D сцен в виде сжатых токенов светового поля (CLiFT). Метод хорошо сохраняет геометрическую информацию.

На сайте есть сравнение с методами LVSM от Adobe и DepthSplat от Microsoft

Код ждем к 1 августа

#image2scene #rendering #novelview

🔥4👍1

1.73K views09:12

Нейронавт | Нейросети в творчестве

Опубликован код апскейлера UltraZoom

Код

Спасибо @p0lygon

#upscale

0:17

Нейронавт | Нейросети в творчестве

UltraZoom: Generating Gigapixel Images from Regular Photos

Апскейлер, превращает обычные фотки в картинки с высоким разрешением.

Модель берёт несколько снимков объекта — один общий и парочку крупных планов — и делает из них одно большое изображение с кучей…

❤12👍3

1.91K viewsedited 12:34

Нейронавт | Нейросети в творчестве

0:05

This media is not supported in your browser

VIEW IN TELEGRAM

1:00

This media is not supported in your browser

VIEW IN TELEGRAM

PUSA V1.0: Surpassing Wan-I2V-14B with $500 Training Cost

Новый видеогенератор, использующий особый метод управления временем в видео (vectorized timestep adaptation). Благодаря этому при генерации использует меньше данных и ресурсов по сравнению с другими моделями.

Это затюненный всего за $500 Wan-T2V-14B на 4K датасете.
Побил своего папу Wan-T2V-14B на VBench-I2V с 10 шагами инференса.

Возможности:
- создание видео из одного или нескольких изображений

- продление существующих видео

- генерация по начальному и конечному кадрам

- ну и создание видео по текстовому описанию.

Ждем кванты и дистиллы

Код
Веса

#text2video #image2video #videoediting

👍13🔥3🤔3❤1

1.91K views14:20

Нейронавт | Нейросети в творчестве

Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)

0:39

This media is not supported in your browser

VIEW IN TELEGRAM

Тут Антропик ввел Connections

Я долго читал, чем они отличаются от MCP-серверов.
Поправьте меня, если я неправ, но они позиционируют Connections как "проверенные" и "улучшенные" mcp-сервера, прошедшие модерацию Антропика.
Часть из них написаны Антропиком, часть партнерами (connect these reviewed and recommended tools from Anthropic’s trusted partners)
Ну то есть они занялись хорошим делом - модерацией всех эти тысяч MCP-коннекторов.
Есть локальные Коннекторы: Канва, Фигма, Страйп и даже Виндовс и Макось. Можно из Клода творить всякую дичь в открытых приложениях и в самой операционке.
Есть Remote Connections - для облачных сервисов: Asana, Atlassian, Paypal, Zapier
Можно написать свой и подать заявку на утверждение - модерация в действии.
Локально работает очень хорошо - Клод видит табы в браузере, разбирается с Ноушеном.
В общем, все это похоже на модерируемый и надежный магазин MCP-серверов, которые теперь встроены в Клод (локальные) или прошли проверку(удаленные).

https://claude.ai/directory

Тут подробнее: https://www.techradar.com/computing/artificial-intelligence/you-dont-have-to-explain-everything-to-claude-anymore-its-finally-in-your-apps

@cgevent

👍2❤1

1.03K views06:20

Нейронавт | Нейросети в творчестве

This media is not supported in your browser

VIEW IN TELEGRAM

ALG: Enhancing Motion Dynamics of Image-to-Video Models via Adaptive Low-Pass Guidance

Улучшение динамики движения в видео, создаваемых на основе изображений. Решает проблему излишней статичности видео путём адаптивного применения низкочастотной фильтрации на начальных этапах обработки изображения. Это позволяет сначала усилить динамику движения, а затем восстановить детали изображения, сохраняя при этом высокое качество видео.

Прикручено к
CogVideoX
Wan 2.1
HunyuanVideo
LTX-Video - ждем

Код

#image2video

🔥7👍3❤2

1.51K views07:11

About

Blog

Apps

Platform