片方のイヤホンが1枚ずつ写真を撮り、2枚を合成して1枚にする——これは単なるコンセプトデザインではなく、Appleが未発表のカメラ搭載AirPodsが誤って流出した後、現時点で読み取れる実際の動作ロジックだ。
今週初め、Appleはうっかり macOS Tahoe 26.7 ベータ版にデモ映像を流出させてしまい、この長らく噂されていたイヤホンの存在が明らかになった。今ではさらに多くの詳細が、同じ初期バージョンのコードの中に隠されている:各イヤホンに独立したレンズが搭載されており、撮影された映像はVisual Intelligenceソフトウェアによって同期・統合され、1枚の完全な画像となる。レンズのスペックは驚くほどのものではなく、最大100万画素のRGB静止画のみ撮影可能だ。
頭部が絶えず動くことを考慮し、システムには対応する仕組みが設計されている:AirPods自体には複数の加速度センサーが内蔵されており、コードによれば、激しい動きや視界の遮蔽によってブレた画像は検知して破棄する仕組みになっている。一部の演算はイヤホン本体で直接完了しているようで、コード内には「peripheral inference」という記述があり、これはすべてをiPhoneやクラウドに任せるのではなく、デバイス上でリアルタイムに判読する方式であることを示している。
はっきりさせておくべき点として、このAirPodsは動画を録画せず、あくまで「定期的な写真撮影」を行うのみで、Appleはこの程度の情報量でVisual Intelligenceが目の前の状況を理解するには十分だと考えているようだ。デバイスにはアクティブモードとパッシブモードの2種類が用意されており、アクティブモード時の画質はより高い。コードによれば、各イヤホンには撮影中であることを知らせる撮影インジケーターランプが搭載されている可能性もある。






