
老叶

Feed
Feed
grok 4.6 też jest już dostępny!
Został wydany niemal jednocześnie z DeepSeek-V4-Pro-0813!
Szczerze mówiąc, gdy zobaczyłem parametry grok 4.6, byłem naprawdę podekscytowany! grok 4.5 już był jednym z moich ulubionych modeli do codziennego użytku, ponieważ jest naprawdę szybki i nie ma tylu ograniczeń, co czyni go idealnym do codziennego stosowania.
Tym razem grok 4.6 ma parametry zbliżone do dwóch czołowych flagowych modeli i jest od nich szybszy.
Grok od Lao Ma naprawdę wszedł na salony! Uważam, że naprawdę może zastąpić gemini jako nowy członek elitarnej trójki!

Oficjalne ogłoszenie! DeepSeek-V4-Pro-0813 już wkrótce!
Właśnie teraz, dokumentacja na oficjalnej stronie DeepSeek ujawniła ID modelu wersji oficjalnej DeepSeek-V4-Pro. Zgodnie z podaną datą, premiera powinna nastąpić 13 sierpnia.
Ponadto wersja oficjalna V4-Pro zaczyna wspierać Responses API, które można bezpośrednio używać na codex, bez potrzeby jakiejkolwiek konwersji.

To jest szok, OpenAI tym razem poszło na całość.
Pakiet Pro x20 właśnie został zresetowany, a ja od razu się zdziwiłem
Limit tygodniowy najwyraźniej został zmniejszony do około 1/3 poprzedniego.
To nie jest drobne cięcie, to jest cięcie w samo sedno.
W ciągu ostatnich dwóch dni dostęp do modeli OpenAI był ciągle przeciążony, często się zacinał, limitował i tworzyły się kolejki.
Teraz są dwie możliwości:
Albo konfiguracja limitów ma błąd,
Albo OpenAI naprawdę nie daje rady i zaczyna celowo ograniczać limity dla użytkowników Pro.
Jeśli to drugie, to opłacalność pakietu Pro x20 trzeba będzie przeliczyć na nowo.
Nie wiem, czy to pojedynczy przypadek.
Bracia z pakietem x20, sprawdźcie swoje limity, czy też zostały obcięte.
Niektórzy użytkownicy pytają, dlaczego nie ustawić bezpośrednio: model_provider = "OpenAI"
W ten sposób można też generować obrazy i wyszukiwać.
Wyjaśnię dlaczego: zazwyczaj pośrednicy unikają model_providers.OpenAI, głównie dlatego, że ten zdalny compact to żądanie synchroniczne, a wiele pośredników korzystających z CF ma ryzyko przekroczenia limitu 100 sekund. Jeśli korzystasz z własnego proxy i nie używasz CF, to możesz spokojnie zastosować tę metodę i nie musisz czytać dalej.
Po analizie odkryłem, że oprócz sprawdzania model_providers, jest też sprawdzany nagłówek x-openai-actor-authorization.
Dlatego według mojego rozwiązania można ominąć ten zdalny compact i jednocześnie realizować generowanie obrazów i wyszukiwanie.
Po drugie, dlaczego przeprowadziłem analizę wsteczną: zauważyłem, że desktopowa wersja codex sprawdza nagłówek openai-actor-authorization, a wersja desktopowa nie jest obecnie open source.
Sensacja! Nowa wersja klienta Codex potajemnie obniża możliwości pośredników stron trzecich.
11 lipca zauważyłem, że nowa wersja Codex nie potrafi generować obrazów i od razu opublikowałem pełne rozwiązanie.
Myślałem, że to tylko ograniczenie funkcji generowania obrazów, ale po dalszej analizie okazało się, że sprawa jest znacznie bardziej skomplikowana.
Nowa wersja Codex, gdy wykryje, że korzystasz z dostawcy strony trzeciej, bezpośrednio ogranicza dwie ważne funkcje:
1. Generowanie obrazów
2. Wyszukiwanie w sieci (Web Search)
Ograniczenie generowania obrazów jest łatwe do zauważenia.
Ale to wyłączenie wyszukiwania w sieci jest prawdziwym miejscem, gdzie model traci swoje możliwości.
Wielu może nie zdawać sobie sprawy, jak ważne jest wyszukiwanie w sieci.
Wewnętrzne bazy wiedzy dużych modeli mają datę końcową i nie wiedzą, co wydarzyło się dzisiaj, ani nie mogą samodzielnie zdobyć najnowszych dokumentów, wiadomości czy zmian technologicznych.
Dlatego dostawcy modeli dodają do nich funkcję wyszukiwania w czasie rzeczywistym, czyli Web Search.
To jest jak „oczy” modelu.
Bez Web Search model może odpowiadać tylko na podstawie starej wiedzy;
z Web Search może na bieżąco przeszukiwać internet, weryfikować fakty i czytać najnowsze dokumenty.
Ale teraz, jeśli używasz pośrednika strony trzeciej w nowej wersji Codex, nawet jeśli backend korzysta z dokładnie tego samego oryginalnego modelu, klient może po prostu zablokować funkcję Web Search.
Model się nie zmienił.
API się nie zmieniło.
Po prostu dlatego, że dostawca nie jest oficjalny, klient samodzielnie usuwa tę funkcję.
To jest prawdziwe „obniżenie inteligencji klienta”.
Dobrą wiadomością jest to, że po analizie znalazłem sposób na obejście ograniczeń i przywrócenie generowania obrazów oraz Web Search.
Szczegółowy poradnik modyfikacji opublikowałem w poprzednim tweecie:
Osoby korzystające z pośredników Codex powinny natychmiast to sprawdzić.
Myślisz, że używasz tego samego modelu, ale klient mógł go już potajemnie okaleczyć.
Możecie zobaczyć porównanie przed i po modyfikacji na załączonych obrazkach:




Spędziłem cały dzień na głębokim testowaniu GPT-5.6-sol.
Moje nastawienie przeszło mniej więcej przez trzy etapy:
Ekscytacja → Wątpliwości → Zrozumienie i akceptacja.
Na początek wyjaśnię coś, co łatwo może wprowadzać w błąd:
Najwyższy poziom rozumowania GPT-5.6-sol to w rzeczywistości xhigh, a w interfejsie użytkownika wyświetlane Max i Ultra odnoszą się bardziej do trybów pracy klienta, a nie tylko do „podkręcenia” modelu, by był mądrzejszy.
Dziś najwięcej krytyki zebrał tryb Ultra, ponieważ bardzo chętnie automatycznie uruchamia dużą liczbę podagentów.
Nawet przy niezbyt skomplikowanym zadaniu może natychmiast uruchomić mnóstwo agentów, zużywając dużo Tokenów, co wygląda efektownie, ale rzeczywiste korzyści niekoniecznie rekompensują koszty.
Na początku też miałem wątpliwości:
Czy to naprawdę pracuje, czy tylko marnuje Tokeny na pokaz?
Później zrozumiałem mechanizm, obniżyłem poziom rozumowania do High i ponownie wykonałem kilka rzeczywistych zadań — doświadczenie było znacznie lepsze.
Szybkość jest większa niż w GPT-5.5 xhigh, a zdolności i stabilność wyraźnie lepsze, a zużycie Tokenów nie jest tak przesadzone jak w Ultra.
Przynajmniej na podstawie mojego dzisiejszego doświadczenia:
GPT-5.6-sol + High to prawdopodobnie obecnie najlepsze połączenie do codziennego użytku.
Do złożonych przebudów, pełnych przeglądów projektów i dużych zadań wymagających równoległych eksploracji można rozważyć Ultra.
Do zwykłych zadań deweloperskich nie ma potrzeby od razu ustawiać najwyższego poziomu.
Ten model nie jest nieużyteczny ani nie wymaga bezmyślnego ustawiania najwyższych parametrów.
Prawdziwy problem polega na tym, że wiele osób nie rozróżnia jeszcze Max, Ultra i poziomów rozumowania, a już traktują Ultra jako domyślny tryb.
Jeśli używać go właściwie, jest zdecydowanie lepszy niż 5.5.
Jeśli używać go źle, można tylko patrzeć, jak Tokeny uciekają bez sensu.


