Data zapowiedzi: 19 maja 2026 r.
Organizator / producent: Apple
Forma: zapowiedź nowych funkcji dostępności w ekosystemie Apple
Miejsce: Apple Newsroom
Język: polski i angielski
Status: funkcje zapowiedziane, mają pojawić się jeszcze w 2026 roku
Tematyka: Apple Intelligence, VoiceOver, Lupa, Accessibility Reader, generowane napisy, dostępność cyfrowa i wizualna
Wprowadzenie
Apple zapowiedziało nowe funkcje dostępności oparte o Apple Intelligence. Najważniejsze zmiany dotyczą narzędzi, z których na co dzień korzystają osoby niewidome i słabowidzące: VoiceOver, Lupa, Accessibility Reader oraz systemowe napisy generowane dla materiałów wideo bez napisów.
Największe znaczenie może mieć rozwój funkcji opisujących obraz. Apple zapowiada bardziej szczegółowe opisy obrazów w VoiceOver, możliwość zadawania pytań o to, co znajduje się w kadrze aparatu, oraz rozszerzenie podobnych możliwości w aplikacji Lupa. W praktyce oznacza to przesunięcie od prostego rozpoznawania obiektów w stronę bardziej kontekstowego asystenta wizualnego.
Nie oznacza to jeszcze, że iPhone zastąpi człowieka, orientację przestrzenną albo profesjonalne narzędzia wspomagające. Apple samo zaznacza, że z funkcji VoiceOver i Lupa nie należy korzystać w sytuacjach wysokiego ryzyka, do nawigacji ani do diagnozy lub leczenia. Zapowiedź pokazuje jednak wyraźny kierunek: sztuczna inteligencja ma coraz mocniej wchodzić w codzienne funkcje dostępności.
O jakiej zapowiedzi mowa
19 maja 2026 roku Apple opublikowało informację prasową o nowych funkcjach dostępności i aktualizacjach wspieranych przez Apple Intelligence. Firma zapowiedziała, że szczegółowe opisy i nawigacja w języku naturalnym pojawią się w takich funkcjach jak VoiceOver, Lupa, Sterowanie głosowe i Accessibility Reader.
Apple poinformowało również o generowanych na urządzeniu napisach do filmów, które nie mają przygotowanych napisów, oraz o nowych funkcjach Apple Vision Pro związanych ze sterowaniem kompatybilnymi wózkami elektrycznymi za pomocą wzroku. W kontekście osób niewidomych i słabowidzących najważniejsze są jednak zmiany w VoiceOver, Lupie i narzędziach do czytania treści.
Według Apple nowe funkcje i aktualizacje wykorzystujące Apple Intelligence mają pojawić się jeszcze w 2026 roku. Oznacza to, że na początku sierpnia 2026 roku należy traktować je przede wszystkim jako zapowiedziany kierunek rozwoju, a nie jako w pełni oceniony zestaw funkcji po dłuższym czasie używania.
VoiceOver i bardziej szczegółowe opisy obrazów
VoiceOver od lat jest podstawowym czytnikiem ekranu w systemach Apple. Jego najważniejszą rolą jest umożliwianie osobom niewidomym obsługi iPhone’a, iPada, Maca, Apple Watcha i innych urządzeń bez wzroku. Nowa zapowiedź Apple dotyczy rozszerzenia funkcji rozpoznawania i opisywania treści wizualnych.
Apple podaje, że Image Explorer w VoiceOver ma wykorzystywać Apple Intelligence do generowania bardziej szczegółowych opisów obrazów w całym systemie. Dotyczy to m.in. zdjęć, zeskanowanych rachunków, prywatnych dokumentów i innych treści wizualnych.
To ważna zmiana, ponieważ dotychczasowe automatyczne opisy obrazów często były ogólne. Potrafiły wskazać, że na zdjęciu znajduje się osoba, dokument albo jedzenie, ale nie zawsze dawały odpowiedź na pytanie, które naprawdę interesuje użytkownika. Bardziej szczegółowe opisy mogą pomóc w zrozumieniu zdjęć, dokumentów, obrazków w wiadomościach, grafik w aplikacjach i treści, które wcześniej wymagały pomocy osoby widzącej lub osobnej aplikacji.
Pytania o obraz z aparatu
Jedną z najciekawszych zapowiedzianych funkcji jest możliwość zadawania pytań o obraz widziany przez aparat. Apple opisuje to jako aktualizację Live Recognition. Użytkownik VoiceOver będzie mógł nacisnąć przycisk czynności na iPhonie, zadać pytanie o obiekt znajdujący się w wizjerze aparatu i otrzymać bardziej szczegółową odpowiedź.
Istotne jest także to, że użytkownik będzie mógł zadawać pytania uzupełniające własnymi słowami. To może być dużo bardziej użyteczne niż jednorazowy opis sceny. Osoba niewidoma nie zawsze potrzebuje pełnego opisu wszystkiego, co widzi aparat. Czasem potrzebuje odpowiedzi na konkretne pytanie: jaki to dokument, gdzie jest data, ile wynosi kwota, czy na ekranie jest przycisk, co jest napisane na etykiecie, czy obiekt jest po lewej czy po prawej stronie kadru.
Taka funkcja może zbliżyć VoiceOver do roli asystenta wizualnego, ale pod warunkiem, że będzie szybka, dokładna, dobrze zintegrowana z systemem i dostępna językowo dla użytkownika. Sama idea jest bardzo obiecująca, ponieważ łączy czytnik ekranu, aparat, rozpoznawanie obrazu i rozmowę w języku naturalnym.
Lupa z Apple Intelligence
Apple zapowiedziało również rozwój aplikacji Lupa. Lupa ma wykorzystywać Apple Intelligence do rozpoznawania i opisywania informacji wizualnych w interfejsie o wysokim kontraście, przygotowanym przede wszystkim z myślą o osobach słabowidzących.
Według Apple Lupa będzie współpracować z przyciskiem czynności, dzięki czemu użytkownik będzie mógł szybko zadawać pytania i otrzymywać odpowiedzi. Aplikacją będzie można też sterować głosowo, używając prostych poleceń, takich jak „powiększ” albo „włącz latarkę”.
Dla osób słabowidzących może to być istotne połączenie kilku funkcji: powiększenia, kontrastu, oświetlenia, rozpoznawania obrazu i odpowiedzi głosowych. W praktyce Lupa może pomagać nie tylko w powiększaniu tekstu, ale także w rozumieniu tego, na co użytkownik patrzy kamerą telefonu.
Różnica między VoiceOver a Lupą pozostaje ważna. VoiceOver jest podstawowym narzędziem dla osób obsługujących urządzenie bez wzroku. Lupa jest bardziej związana z wykorzystaniem aparatu, powiększenia i wizualnego interfejsu. Apple Intelligence może jednak sprawić, że oba narzędzia będą lepiej współpracować z rzeczywistym otoczeniem użytkownika.
Accessibility Reader i trudniejsze materiały
Apple zapowiedziało także rozwój Accessibility Reader. Jest to narzędzie do dostosowanego czytania dla osób z różnymi potrzebami, w tym osób z dysleksją i osób słabowidzących. Dzięki Apple Intelligence ma lepiej radzić sobie z bardziej złożonymi materiałami źródłowymi, np. artykułami naukowymi, tekstem w wielu kolumnach, obrazami i tabelami.
To ważne również z perspektywy edukacji i pracy. Wiele trudnych materiałów nie jest zwykłym tekstem w jednej kolumnie. Dokumenty akademickie, raporty, instrukcje, artykuły naukowe i materiały szkoleniowe często mają tabele, podpisy, grafiki, kolumny i złożony układ strony. Jeżeli Accessibility Reader będzie potrafił lepiej przekształcać takie materiały do czytelniejszej postaci, może pomóc osobom słabowidzącym i innym użytkownikom mającym trudności z odbiorem skomplikowanych dokumentów.
Apple zapowiada też streszczenia na żądanie oraz wbudowane tłumaczenie przy zachowaniu dostosowanego formatowania, czcionki i kolorów. Może to być szczególnie użyteczne w sytuacjach, gdy użytkownik chce najpierw zrozumieć ogólny sens dokumentu, a dopiero później wejść w szczegóły.
Generowane napisy do filmów bez napisów
Kolejną zapowiedzianą funkcją są napisy generowane do materiałów wideo, które nie mają przygotowanych napisów. Apple wskazuje, że napisy mają być tworzone z użyciem rozpoznawania mowy na urządzeniu i pojawiać się automatycznie w filmach bez napisów.
Funkcja ma obejmować m.in. klipy nagrane iPhone’em, materiały otrzymane od znajomych lub rodziny oraz treści przesyłane strumieniowo. Apple zapowiada obsługę na iPhonie, iPadzie, Macu, Apple TV i Apple Vision Pro.
Najbardziej oczywistymi odbiorcami są osoby głuche i słabosłyszące, ale funkcja może być przydatna także dla osób niewidomych i słabowidzących. W praktyce napisy mogą pomagać w porządkowaniu treści, wyszukiwaniu informacji, rozumieniu nagrań w hałasie, analizie materiałów edukacyjnych i pracy z filmami, które wcześniej były trudniejsze do przetworzenia.
Warto jednak pamiętać, że według przypisu Apple funkcja generowanych napisów ma być dostępna w języku angielskim w Kanadzie i Stanach Zjednoczonych. To oznacza, że jej praktyczna przydatność dla użytkowników w Polsce będzie zależeć od języka, regionu i późniejszego rozszerzania dostępności.
Co to może zmienić dla osób niewidomych
Największa zmiana polega na tym, że VoiceOver może przestać być wyłącznie narzędziem do odczytywania interfejsu i stać się bardziej aktywnym narzędziem opisywania świata wizualnego. Do tej pory użytkownik mógł korzystać z VoiceOver do obsługi telefonu, z rozpoznawania obrazów do ogólnych opisów, z aplikacji OCR do tekstu i z osobnych aplikacji do bardziej zaawansowanego opisu otoczenia. Apple próbuje przesunąć część tych możliwości bezpośrednio do systemu.
Jeżeli funkcje będą działać dobrze, użytkownik może szybciej uzyskać odpowiedzi na pytania dotyczące zdjęć, dokumentów, rachunków, obiektów przed aparatem i treści wizualnych w aplikacjach. To może zmniejszyć potrzebę przełączania się między wieloma aplikacjami i skrócić drogę od problemu do odpowiedzi.
Przykładowe zastosowania mogą obejmować:
- sprawdzenie, co znajduje się na zdjęciu,
- odczytanie lub zrozumienie rachunku,
- zadanie pytania o dokument widziany przez aparat,
- rozpoznanie elementu w otoczeniu,
- uzyskanie dodatkowych informacji o obrazie na ekranie,
- pracę z materiałami edukacyjnymi zawierającymi obrazy i tabele,
- korzystanie z filmów bez przygotowanych napisów,
- szybsze rozumienie treści wizualnych bez proszenia drugiej osoby o opis.
Czy to będzie prawdziwy asystent wizualny?
Apple Intelligence może przybliżyć VoiceOver i Lupę do roli asystenta wizualnego, ale nie należy traktować tych funkcji jako pełnego zastępstwa wzroku. Największy potencjał leży w szybkim odpowiadaniu na konkretne pytania użytkownika i w bardziej naturalnym opisie treści wizualnych.
Prawdziwy asystent wizualny powinien spełniać kilka warunków. Musi być szybki, przewidywalny, dokładny, dostępny językowo, dobrze zintegrowany z systemem i bezpieczny w codziennym użyciu. Musi też jasno komunikować niepewność, bo automatyczny opis obrazu może się mylić. W przypadku dokumentów, leków, pieniędzy, znaków, tras, ruchu ulicznego albo sytuacji ryzykownych błąd może mieć poważne skutki.
Apple wyraźnie zaznacza, że z funkcji VoiceOver i Lupa nie należy korzystać w sytuacjach, w których istnieje ryzyko obrażeń, w sytuacjach wysokiego ryzyka, do nawigacji ani do diagnozy lub leczenia. To ważne ograniczenie. Funkcje mogą wspierać samodzielność, ale nie powinny być traktowane jako narzędzie bezpieczeństwa w każdej sytuacji.
Prywatność i przetwarzanie na urządzeniu
Apple mocno podkreśla prywatność funkcji opartych o Apple Intelligence. W przypadku generowanych napisów firma wskazuje, że rozpoznawanie mowy odbywa się na urządzeniu. To istotne, ponieważ treści wideo, zdjęcia, dokumenty i obrazy z aparatu mogą zawierać dane prywatne.
Dla osób niewidomych ma to praktyczne znaczenie. Użytkownik może chcieć sprawdzić rachunek, pismo, prywatny dokument, wiadomość, zdjęcie rodzinne albo ekran aplikacji. Im więcej przetwarzania odbywa się lokalnie, tym większa szansa na zachowanie kontroli nad prywatnymi danymi.
Jednocześnie Apple Intelligence ma wymagania sprzętowe i językowe. Według strony wsparcia Apple funkcje Apple Intelligence działają na zgodnych urządzeniach, m.in. iPhonie 15 Pro, iPhonie 16 lub nowszych modelach, iPadach z czipem M1 lub nowszym, iPadzie mini z A17 Pro, komputerach Mac z układem Apple oraz Apple Vision Pro. Potrzebne są także odpowiednie wersje systemów, wolne miejsce i obsługiwany język.
Ograniczenia językowe i regionalne
Największym pytaniem dla polskich użytkowników pozostaje dostępność językowa. Apple Intelligence jest rozwijane w wielu językach, ale nie wszystkie funkcje są dostępne we wszystkich regionach i językach. Oficjalna strona Apple wskazuje, że dostępność funkcji może różnić się w zależności od platformy, języka i regionu.
Ma to znaczenie dla osób niewidomych korzystających z polskiego VoiceOvera. Sama obecność funkcji w systemie nie wystarczy, jeśli pełne działanie pytań o obraz, opisów, sterowania głosowego albo generowanych napisów będzie ograniczone do wybranych języków.
W zapowiedzi Apple pojawiają się konkretne ograniczenia: Sterowanie głosowe oparte o Apple Intelligence ma być dostępne po angielsku w Australii, Kanadzie, Stanach Zjednoczonych i Wielkiej Brytanii, a generowane napisy mają być dostępne po angielsku w Kanadzie i Stanach Zjednoczonych. Dlatego polscy użytkownicy powinni patrzeć na te funkcje z nadzieją, ale też z realistycznym podejściem do terminów i języka.
Znaczenie dla edukacji i pracy
Nowe funkcje mogą mieć duże znaczenie w edukacji i pracy. Osoby niewidome i słabowidzące często spotykają się z materiałami, które nie zostały przygotowane dostępnie: skanami, zdjęciami dokumentów, wykresami, tabelami, prezentacjami, grafikami, formularzami i filmami bez napisów.
Bardziej szczegółowe opisy obrazów, pytania o obraz z aparatu i lepsza obsługa złożonych dokumentów mogą ułatwić szybkie zrozumienie materiału. Accessibility Reader może pomóc w pracy z tekstami naukowymi i dokumentami o skomplikowanym układzie. Generowane napisy mogą zwiększyć dostępność filmów, szczególnie wtedy, gdy autor materiału nie przygotował podpisów.
Nie rozwiąże to wszystkich problemów dostępności. Materiały edukacyjne i zawodowe nadal powinny być tworzone zgodnie ze standardami dostępności. AI może pomóc użytkownikowi poradzić sobie z niedostępną treścią, ale nie powinna zwalniać instytucji, uczelni, firm i twórców z obowiązku przygotowywania dostępnych materiałów od początku.
Znaczenie dla aplikacji i usług cyfrowych
Apple zapowiada również naturalniejszą nawigację w Sterowaniu głosowym. Użytkownik będzie mógł opisywać elementy na ekranie własnymi słowami, zamiast zapamiętywać dokładne etykiety lub numery. Apple wskazuje, że może to pomagać także wtedy, gdy elementy nie są poprawnie oznaczone pod kątem dostępności.
To ważne, ale trzeba uważać na interpretację. Taka funkcja może pomóc użytkownikowi obejść część barier, ale nie zastępuje poprawnego projektowania aplikacji. Jeżeli przycisk nie ma etykiety, formularz nie ma opisu albo kolejność fokusu jest błędna, problem nadal leży po stronie twórcy aplikacji.
Dla firm i instytucji oznacza to jedno: rozwój AI w systemach operacyjnych nie zwalnia z WCAG, testów z czytnikiem ekranu i projektowania dostępnych interfejsów. Apple Intelligence może pomóc użytkownikowi w trudnej sytuacji, ale najlepszym rozwiązaniem nadal jest poprawnie przygotowana usługa cyfrowa.
Dlaczego to może być ważne z polskiej perspektywy
W Polsce wielu użytkowników niewidomych korzysta z iPhone’a jako podstawowego narzędzia codziennej samodzielności. Telefon służy do komunikacji, nawigacji, bankowości, zakupów, nauki, pracy, rozpoznawania tekstu, korzystania z aplikacji transportowych i kontaktu z urzędami.
Rozwój VoiceOvera i Lupy w stronę bardziej inteligentnego opisu obrazu może mieć realne znaczenie. Jeżeli funkcje będą dostępne językowo i sprzętowo, mogą ułatwić rozpoznawanie dokumentów, orientowanie się w treściach wizualnych, analizowanie zdjęć i korzystanie z materiałów, które dotąd wymagały dodatkowych aplikacji.
Największym ograniczeniem może być jednak dostępność języka polskiego i konkretnych funkcji w regionie. Dlatego z polskiej perspektywy warto śledzić nie tylko same zapowiedzi Apple, ale również listy obsługiwanych języków i praktyczne testy użytkowników VoiceOvera po wydaniu funkcji.
Dla kogo ten temat może być przydatny
Informacje o nowych funkcjach Apple Intelligence mogą być przydatne dla użytkowników VoiceOvera i Lupy, osób słabowidzących, nauczycieli, tyflopedagogów, specjalistów technologii wspomagających, twórców aplikacji, testerów dostępności oraz instytucji przygotowujących materiały cyfrowe.
Temat może zainteresować także uczelnie, szkoły, firmy i organizacje publiczne. Nowe funkcje Apple pokazują kierunek, w którym zmierza dostępność: coraz więcej narzędzi będzie próbowało opisywać, streszczać i interpretować treści wizualne. Nie zmienia to jednak podstawowej zasady: materiały i usługi powinny być dostępne już u źródła, a AI powinna być wsparciem, nie protezą dla źle zaprojektowanej dostępności.
Podsumowanie
Apple zapowiedziało w maju 2026 roku nowe funkcje dostępności oparte o Apple Intelligence. Najważniejsze dla osób niewidomych i słabowidzących są bardziej szczegółowe opisy obrazów w VoiceOver, możliwość zadawania pytań o obraz widziany przez aparat, rozwój Lupy, ulepszony Accessibility Reader oraz generowane napisy do filmów bez przygotowanych napisów.
Największy potencjał ma połączenie VoiceOvera, aparatu i języka naturalnego. Jeżeli użytkownik będzie mógł zapytać iPhone’a o konkretny element obrazu i otrzymać sensowną odpowiedź, telefon może stać się bardziej użytecznym asystentem wizualnym. Nie będzie to jednak narzędzie do każdej sytuacji. Apple samo ostrzega, że VoiceOver i Lupa nie powinny być używane w sytuacjach wysokiego ryzyka, do nawigacji ani do diagnozy lub leczenia.
Z perspektywy dostępności cyfrowej zapowiedź Apple jest ważna, ponieważ pokazuje nowy etap rozwoju technologii wspomagających. Czytnik ekranu przestaje być wyłącznie narzędziem odczytywania interfejsu. Coraz częściej staje się narzędziem interpretowania informacji wizualnych, dokumentów, obrazów i otoczenia.
Dla użytkowników w Polsce kluczowe będą trzy kwestie: dostępność języka polskiego, wymagania sprzętowe i rzeczywista jakość działania w codziennych sytuacjach. Zapowiedź jest obiecująca, ale pełną ocenę będzie można zrobić dopiero wtedy, gdy funkcje będą dostępne i przetestowane przez użytkowników VoiceOvera oraz Lupy w praktyce.
Źródła
- Apple, Apple prezentuje nowe funkcje ułatwień dostępu i aktualizacje oparte o możliwości Apple Intelligence:
https://www.apple.com/pl/newsroom/2026/05/apple-unveils-new-accessibility-features-and-updates-with-apple-intelligence/ - Apple, Apple unveils new accessibility features, and updates powered by Apple Intelligence:
https://www.apple.com/ie/newsroom/2026/05/apple-unveils-new-accessibility-features-and-updates-with-apple-intelligence/ - Apple Support, Jak uzyskać Apple Intelligence:
https://support.apple.com/pl-pl/121115 - Apple Support, Używanie Apple Intelligence na iPhonie:
https://support.apple.com/pl-pl/guide/iphone/-iphc28624b81/ios - Apple, Accessibility:
https://www.apple.com/accessibility/