15,6% WER на открытом словаре показал прототип Aleph, который восстанавливает текст по ультразвуковому видео языка при беззвучной артикуляции. Видеоэнкодер ResNet-18 2+1D сближает движения языка с представлениями Whisper, а декодер Whisper Base переводит их в текст. Система обучалась примерно на 50 часах записей, но её носимый формат ограничивают тяжёлый зонд и акустический гель. →
64 Мп и пиксель 0,7 мкм сочетаются в LYTIA 610 с RB2×2 OCL: зелёные ячейки получают отдельные микролинзы для детализации, а красные и синие объединяются под линзами 2×2 для фазового автофокуса. По внутреннему тесту Sony, разрешение выросло более чем на 20% относительно LYTIA 601 при том же шаге, а считывание ускорилось вдвое. Сенсор рассчитан на телефотомодули и поддерживает 4K при 120 кадрах/с. →