Machinelearning

✔️

Apple продолжает терять ИИ-таланты.

Apple накрыла волна увольнений ведущих инженеров из ИИ-подразделения. Jian Zhang, возглавлявший исследования ИИ в области робототехники, перешел к Марку Цукербергу. За ним последовали еще 3 ключевых сотрудника из команды Foundation Models, которая занималась разработкой платформы Apple Intelligence. Всего, за последнее время, команда потеряла около 10 человек.

Основными причинами ухода называют как агрессивный наем со стороны конкурентов, предлагающих огромные зарплаты, так и внутренние проблемы. Низкий моральный дух в команде связывают со слабой реакцией на анонс Apple Intelligence и возможным решением компании использовать сторонние ИИ-модели вместо собственных разработок.
bloomberg.com

✔️

В NotebookLM добавили 3 новых аудиорежима.

ИИ-платформа для работы с заметками NotebookLM получила крупное обновление аудиофункций. Теперь сервис может генерировать на основе пользовательского контента аудио-дорожки в 3 новых форматах.

Режим «Brief» создает быструю двухминутную аудиосводку по ключевым идеям. В режиме «Critique» два ИИ-собеседника анализируют текст, выступая в роли редакторов. Самый необычный формат — «Debate», который имитирует спор с противоположными точками зрения для стресс-теста идей. Кроме того, добавили новые мужские и женские голоса, чтобы дать пользователям больше возможностей для персонализации.
NotebookLM в сети Х

✔️

ElevenLabs обновила модель генерации звуков.

Этот релиз - вторая версия модели SFX для генерации звуковых эффектов по текстовому описанию. В v2 повысили качество звука и частотe дискретизации до 48 кГц, а максимальная длительность увеличена с 22 до 30 секунд. Добавилась возможность бесшовно создавать зацикленные звуки, что особенно полезно для фоновых эмбиент-дорожек. Генерация доступна как через веб-интерфейс, так и по API.

Обновление затронуло и связанный инструмент SB-1 Soundboard — браузерную звуковую панель, которая теперь также поддерживает модель v2 и получила поддержку MIDI. Новые звуковые эффекты доступны в форматах MP3 и WAV на всех тарифных планах, включая бесплатный.
ElevenLabs в сети Х

✔️

Amazon запустил поиск товаров по видео в реальном времени.

Amazon представил функцию Lens Live, которая обновляет визуальный поиск в мобильном приложении. Теперь пользователям не нужно делать снимок — достаточно навести камеру на объект, и система в реальном времени начнет показывать совпадающие или похожие товары из каталога. Прямо в интерфейсе камеры можно сфокусироваться на конкретной вещи, добавить ее в корзину или список желаний. В Lens Live интегрирован ИИ-ассистент Rufus, который предлагает краткие сводки о товаре и генерирует уточняющие вопросы.

Технически решение работает на базе легковесной on-device CV-модели для распознавания объектов. Для сопоставления с базой данных Amazon применяется модель глубокого обучения с использованием Amazon OpenSearch и SageMaker. Функция уже доступна части пользователей в США на iOS.
aboutamazon.com

✔️

Microsoft создала аналоговый оптический компьютер.

Microsoft совместно с банком Barclays разработала архитектуру аналогового оптического компьютера (AOC) для решения задач оптимизации и ИИ. Согласно исследованию, опубликованному в Nature, новая система решает "проблему Фон Неймана", объединяя вычисления и память, и не нуждается в цифро-аналоговых преобразованиях.

Расчетная производительность AOC - 500 TOPS на ватт при 8-битной точности. Это делает его более чем в 100 раз энергоэффективнее топовых графических процессоров. Система построена на базе доступных компонентов: проекторы, линзы и сенсоры, а вычисления производятся за счет изменения интенсивности проходящего света.

Microsoft планирует поделиться с научным сообществом алгоритмом-решателем и цифровым двойником установки для дальнейшего изучения технологии.
news.microsoft.com

@ai_machinelearning_big_data

#news #ai #ml

Please open Telegram to view this post