Model o4-mini-deep-research udostępniono 26 czerwca 2025 roku razem z o3-deep-research jako tańszą połowę badawczej pary OpenAI. Wykonywał tę samą pracę — przeszukiwanie sieci, uruchamianie kodu i sięganie po materiały prywatne przez złącza MCP, a na końcu opracowanie z przypisami — po 2 dolary za milion tokenów wejścia, 50 centów za wejście z pamięci podręcznej i 8 dolarów za wyjście. To piąta część stawki większego modelu i dokładnie tyle, ile kosztował zwykły o3 po obniżce z czerwca 2025 roku.
Reszta specyfikacji odpowiadała bliźniakowi: okno kontekstu 200 000 tokenów, do 100 000 tokenów odpowiedzi, wejście tekstowe i obrazowe, wyjście tekstowe oraz granica wiedzy w czerwcu 2024 roku. Limity zapytań były na każdym szczeblu hojniejsze niż w o3-deep-research, co pasuje do przeznaczenia: wielu zadań badawczych zamiast kilku szczególnie starannych.
Oba modele wycofano 22 kwietnia 2026 roku i wyłączono razem 23 lipca 2026, w trybie trzymiesięcznego wypowiedzenia, które OpenAI stosuje do wariantów wyspecjalizowanych zamiast sześciomiesięcznego przysługującego modelom ogólnym. Zalecanym następcą jest gpt-5.6-sol.