Skocz do zawartości

logremonte

Forumowicze
  • Postów

    637
  • Dołączył

  • Ostatnia wizyta

  • Wygrane w rankingu

    9

Ostatnia wygrana logremonte w dniu 29 Kwietnia

Użytkownicy przyznają logremonte punkty reputacji!

O logremonte

  • Urodziny 13.05.1971

Contact Methods

  • Website URL
    http://www.dodaj-strone.com.pl

Profile Information

  • Gender
    Male

Ostatnie wizyty

7679 wyświetleń profilu

Osiągnięcia logremonte

  1. Sprawa z Codexem trochę się od wczoraj wyjaśniła. OpenAI w końcu przyznało, że znaleźli kilka bugów, które potrafiły mocno przepalać limity; pętle, problemy z compaction, subagentami, ponawianiem narzędzi itd. Jak sami napisali, doszli do tego po przejrzeniu tysięcy zgłoszeń. W skrajnych przypadkach pojedynczy problem potrafił zjeść sporą część weekly. Niby to poprawili i zresetowali limity wszystkim płatnym użytkownikom, zobaczymy, czas pokaże. Więc Codexa jeszcze nie skreślam, bo zanim zaczęła się ta zawierucha działał naprawdę przyzwoicie. Rozglądam się za planem B, gdyby po tych poprawkach nadal został problem z 5h albo jakością. Dlatego porównanie z Claude/Kimi/GLM przy realnym większym projekcie nadal mnie interesuje. Przez chwilę mnie nie będzie (sprawy osobiste), więc przy okazji poczekam na rozwój sytuacji.
  2. To pewnie też mocno zależy od planu i workloadu. Ty masz $100 i skoro przy dwóch równoległych wątkach z MCP nie dobijasz do 5h, to akurat bardzo ciekawy datapoint. U mnie na Plus przy Sol Very High wygląda to zupełnie inaczej cięższe audyty i dłuższe zadania potrafią ten limit zjadać bardzo szybko, a przed wprowadzeniem limitu dało się na tym planie sensownie pracować jeszcze. Na Community jest teraz sporo podobnych raportów. Claude też chyba nie skreślałbym tak ogólnie, bardziej interesuje mnie właśnie praktyczne porównanie przy tym samym większym projekcie, bo jeden model może znajdować błędy po drugim i odwrotnie.
  3. Chyba trochę inaczej się zrozumieliśmy Codexa używam właśnie do prac programistycznych, nie jako zwykłego modelu do ogólnego reasoningu. Pisząc High / Very High miałem tu na myśli ustawiony poziom reasoning GPT-5.6 Sol podczas pracy nad kodem; testy, audyty, review, poprawki itd. I właśnie w takich zadaniach ostatnio widzę największy regres: pętle, poprawianie własnych poprawek, ogromne zużycie limitu i, co najgorsze zdarzało mu się raportować PASS, który po niezależnej weryfikacji wcale PASS-em nie był. Claude Opus 4.6 jest ciekawym punktem odniesienia, szczególnie przy większych projektach programistycznych. A może ktoś z Was pracował dłużej na Kimi albo GLM-5.3-Flash / Ox Alpha? Jak wypadają w praktyce przy większych projektach: utrzymanie kontekstu, poprawność zmian, testy, zapętlanie i ile finalnie trzeba po modelu poprawiać. Ktoś coś? Bo jeśli OpenAI nie wycofa się z tego limitu 5h, a dodatkowo Codex nadal będzie strzelał takie gafy, to prędzej czy później trzeba będzie się gdzieś przenieść. Na razie mogę spokojnie poczekać na rozwój sytuacji, bo większy projekt skończyłem dosłownie przed ponownym wprowadzeniem limitu 5h. Zostało mi tylko kilka lekkich poprawek i właśnie one pokazały skalę problemu. Coś, co wcześniej zajęłoby mi około 4 godzin, po wprowadzeniu limitu rozciągnęło się na ponad 3 dni. Dlatego kolejnego większego projektu, który już czeka w kolejce na razie nawet nie tykam w Codexie. Przy obecnej konfiguracji limitów i jakości działania chyba pół roku bym w nim dłubał Stąd też pytanie o alternatywy nie pod kątem benchmarków tylko realnej pracy nad większym projektem przez wiele godzin lub dni.
  4. Z uprawnieniami też coś zauważyłem. A jest jeszcze jedna ciekawa rzecz i warto sprawdzić: przy konfiguracji Codexa jedną z pierwszych rzeczy, które ustawiłem było wyłączenie „Pełnego dostępu”, a jakiś czas później wszedłem w ustawienia i zobaczyłem, że samo wróciło na ON. Aż zgłupiałem, bo na pewno tego nie włączałem. Nie wiem, czy to był bug po aktualizacji, migracja ustawień czy jakaś zmiana po ich stronie, ale od tamtej pory codziennie sprawdzam. Tym bardziej że ostatnio aktualizacje wpadają jedna za drugą.
  5. Od kilku dni mam wrażenie, że sytuacja mocno się pogorszyła i ciekaw jestem, czy ktoś z Was obserwuje to samo. Największy problem to dla mnie ponownie wprowadzony limit 5-godzinny. Przy dłuższej pracy z Codexem potrafi skończyć się bardzo szybko, nawet gdy duża część zadania to analiza, testy regresyjne, security audit czy zwykłe sprawdzanie kodu. I właśnie tu zaczyna się absurd: Codex jest narzędziem przeznaczonym do pracy nad większymi zadaniami i projektami, a limit potrafi przerwać pracę w połowie. Po resecie trzeba odzyskiwać kontekst, ponownie sprawdzać stan projektu i wracać do miejsca, w którym agent został zatrzymany. Przy takich ograniczeniach normalna praca z Codexem zaczyna tracić sens. Do tego mam wrażenie, że szybciej schodzi również limit tygodniowy. Ale jeszcze bardziej niepokoi mnie jakość działania. GPT-5.6 Sol przy wysokim reasoning potrafi ostatnio coraz częściej: wracać do rzeczy, które już sprawdził, poprawiać własne poprawki i wpadać w pętle, po długiej sesji tracić pierwotny cel zadania, ponownie wykonywać te same testy, zużywać ogromną część limitu na self-correction, a nawet oznaczyć coś jako PASS, mimo że po ręcznej weryfikacji okazuje się, że test albo wymaganie w rzeczywistości nie zostało spełnione. Na OpenAI Community i GitHubie pojawia się ostatnio sporo podobnych raportów dotyczących limitu 5h, compaction, długich sesji, zapętlania i bardzo dużego zużycia kontekstu. OpenAI wcześniej przyznawało już, że Sol potrafił zużywać quota szybciej niż zakładano, ale obecnej sytuacji chyba nadal oficjalnie nie wyjaśnili. Dzisiaj w krótkim odstępie weszły też kolejne aktualizacje aplikacji Codex, więc wygląda na to, że coś intensywnie przy nim zmieniają. Ktoś z Was pracuje teraz regularnie na Codexie? Też widzicie tak szybkie kończenie się 5h i pogorszenie jakości, czy u Was działa normalnie? Szczególnie ciekawi mnie GPT-5.6 Sol na High / Very High i dłuższe zadania wykonywane przez kilka godzin.
  6. Wakacyjna paczka kodów promocyjnych dla użytkowników PIO Jak zawsze proszę o unikalne opisy, nie masz przygotowanych opisów? Skorzystaj z generatora treści AI. O jakość indeksów w naszych katalogach dba SEO Health Check VIPKAT, więcej informacji: https://www.vipkat.pl/seo-health-check-unikalny-system-monitoringu-jakosci-indeksow/ Dodając wpis do katalogów stron grupy VIPKAT, zyskujesz również dodatkowy monitoring swojej strony w cenie wpisu, więcej informacji: https://www.dodaj-strone.com.pl/posts/monitoring-strony-w-ramach-systemu-seo-health-check-vipkat Wpis standard: dodaj-strone.com.pl PIO-S01 PIO-S02 PIO-S03 PIO-S04 PIO-S05 PIO-S06 PIO-S07 PIO-S08 PIO-S09 PIO-S10 top-strony.com.pl PIO-S01 PIO-S02 PIO-S03 PIO-S04 PIO-S05 PIO-S06 PIO-S07 PIO-S08 PIO-S09 PIO-S10 Zapraszam serdecznie
  7. Powiem tak, kiedyś korzystaliśmy często i mocno w trudnych czasach, zawsze ok. 95% u nas było, a jak się powtórki robiło, to wchodziło all. Teraz korzystamy z własnych rozwiązań jeśli zajdzie taka potrzeba, ale czasem coś wrzucimy i dalej ślicznie wchodzi Tylko nie ma co sprawdzać na drugi dzień, ok. 10 dni i wszystko ładnie siedzi.
  8. logremonte

    Alert RCB :)

    Żenada. Śmiem twierdzić, że nie jesteśmy przygotowani na nic. Gdyby poleciało na nas tyle co na Ukrainę (setki dronów i rakiet różnych typów) to ile z nich by zestrzelili? 5? A w razie „W” będziemy się chyba chować pod parasolami.
  9. Hehe, wiedziałem, że ktoś to wyłapie Nawiązanie zamierzone
  10. Kody promocyjne z okazji 17 lat działania katalogu Dodaj-Strone.com.pl TUTAJ. Zapraszam
×
×
  • Dodaj nową pozycję...

Powiadomienie o plikach cookie

Umieściliśmy na Twoim urządzeniu pliki cookie, aby pomóc Ci usprawnić przeglądanie strony. Możesz dostosować ustawienia plików cookie, w przeciwnym wypadku zakładamy, że wyrażasz na to zgodę. Warunki użytkowania Polityka prywatności