Najbardziej opłacalny LLM?

Najbardziej opłacalny LLM?
WC
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 138
0

Hej,

Szukam najbardziej opłacalnego modelu LLM do tworzenia aplikacji.

Po zmianach w czerwcu w GitHub Copilot próbuję ogarnąć, który plan oferuje najlepszy stosunek jakości do ceny.

Sprawdziłem Codex z GPT 5.6 Terra (tak, wiem, że Sol jest bardziej polecany do developmentu).
Korzystałem z najtańszego planu ChatGPT "Go", limit wykorzystałem już po kilku promptach.
Udało mi się jedynie wygenerować vision, roadmapę, rules, plan, architekturę + zaimplementować 3–4 zadania, po czym You've hit your usage limit.

Mam wrażenie, że trzeba wydawać masę kasy miesięcznie żeby mieć narzędzie, które pozwoli zbudować sensowny projekt.

Przykładowa apka:

  • apka/gra w Three.js/React
  • Docker setup
  • code quality tools (eslint/prettier)
  • TDD
  • CI/CD
  • architektura
  • i na koniec implementacja kolejnych tasków jeden za drugim

Próbowałem darmowych modeli w Copilocie np. Raptor Mini ale jakość jest tragiczna.
Pierwsza iteracja tworzy coś co ledwo przypomina działającą grę, każdy kolejny obieg wprowadza więcej błędów.
Mam wrażenie, że darmowe modele są po prostu zbyt słabe do tego typu pracy (pytanie w takim razie gdzie się sprawdzą?).

W pracy korzystam głównie z Claude Opus 4.8, rozważam też Fable.
One ogarniają wszystkie cięższe rzeczy, planowanie, implementacje ale są też mega drogie.

QA:

  • Z jakiego modelu/planu korzystacie na co dzień do developmentu (personal use, nie w pracy)?
  • GitHub Copilot (ze wszystkimi LLM-ami), Claude Code, Codex czy może coś innego?
  • Czy plany Business lub Enterprise są bardziej opłacalne niż plan Individual dla osoby mającej działalność gospodarczą?
  • Czy istnieje konfiguracja (np. Claude Code Opus do implementacji, Cursor do planowania, nie wiem strzelam) która pozwoli stworzyć projekty średniej/dużej wielkości?

Dzięki za jakiekolwiek wyjaśnienia/pomoc, pozdrawiam.

PaulGilbert
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 1145
2

Pewnie to się ciągle zmienia, ale prywatnie w tym tygodniu korzystam z Codexa za 100zł i w mojej ocenie przepala tokeny dosyć powoli. Albo to kwestia tego jak piszesz prompty i jak go wykorzystujesz. Osobiście najpierw opracowaliśmy plan, potem rozbiliśmy go na mniejsze zadania i takimi drobnymi zadaniami posuwamy się do przodu. Jeśli dajesz jasne polecenia czego oczekujesz i prowadzisz dosyć przejrzystą dokumentację to wydaje mi się że dosyć sporo można z niego wycisnąć. Osobiście nie porównywałem z Claude, ale brat mi mówił, że jemu szybciej przepala tokeny Claude niż Codex (GPT).

SU
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 250
2

Pytanie o który dzień tygodnia pytasz i zależy do jakich zastosowań - jeśli do pisania kodu to claude code i subskrybcia za 18dolarów - jutro może jakiś inny będzie bardziej opłacalny.

cerrato
  • Rejestracja: dni
  • Ostatnio: dni
  • Lokalizacja: Poznań
  • Postów: 9237
3

Ja aktualnie mam dwie płatne wersje:

  1. Gemini, jakiś pakiet AI. Mam za stówkę miesięcznie 5TB miejsca na dane (zdjęcia, maile, dysk google itp.) i to był główny powód zakupienia pakietu. Przy okazji dostałem Gemini pro w wersji współpracującej z Android studio (Wbudowanym chatem/agentem). Jak to działa? Ogólnie sympatycznie, ma podgląd kontekstu i struktury projektu, czasem się gubi - ale na ogół jak zwrócę uwagę to sam poprawia co zepsuł. Czy działa lepiej od wersji free? Szczerze - nie widzę róznicy, jedynie limity są znacznie większe. Wersja darmowa chodziła trochę wolniej, ponadto po jakimś czasie pracy pojawiało się info, że limit się skończył. Tutaj mam wrażenie że chodzi trochę szybciej (chociaż głównie to zależy od obciążenia serwerów), ponadto nie udało mi się zapchać podczas normalnej pracy limitów. Taka ciekawostka - czasami kilka dni nie korzystam, odpalam AS i na dzień dobry dostaję informację, że limity są zużyte (kiedy mam 300% pewności, że nie są). 2-3 razy odświeżę/spróbuję ponownie i wszystko wraca do normy
  2. Claude w wersji płatnej (ale nie Fable, tylko te niższe modele). Przez jakiś czas miałem Fable i był spoko, ale zżerał limity/tokeny jak powalony, a różnica w jakości pomiędzy nim a np. Opus'em była nieznacząca (przynajmniej w moim odczuciu). Przy czym nie mam tego spiętego z moim IDE, tylko używam wersji przeglądarkowej (zabieram się od dawna żeby ogarnąć CLI, ale jakoś zawsze coś mi wypadnie ;) )
JG
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 147
1

Ja też mam Google AI Pro i uważam że Gemini nawet pro thinking jest kiepski. Choć trzeba przyznać, że Antygravity wcale tak szybko tokenów nie pali ale co z tego, skoro rezultat marny?

Nawet sobie zrobiłem team subagentów ale to niewiele daje, z gówna bata nie ukręcisz. W moim odczuciu Gemini gorszy nawet od Claude Opus 4.6 już nie mówiąc o 5.0

KG
  • Rejestracja: dni
  • Ostatnio: dni
  • Lokalizacja: Łódź
  • Postów: 20
2

Cześć.
Dawno nie logowałem się na forum.

Jako, że przespałem hype na AI, a w pracy cisną aby cokolwiek wiedzieć w tym temacie, zacząłem więc trochę eksplorować co z czym i jak.

Na początku używałem GH Copilot ale po zmianie rozliczania na per token zrezygnowałem. Tułałem się nieco tu i tam, w końcu od 2 miesięcy testuję taki oto setup:

  • OpenCode Go (subskrypcja 10$/miesiąc)
  • Reasonix (agent/harness - nie lubię tego słowa :P)
  • Modele: DeepSeek-v4-pro/flash, po ostatniej aktualizacji tylko flash, czasami GML5.2 do planowania

Do czego tego używam? Głównie do zabawy, rzucam AI-emu jakieś nieduże tematy do implementacji w side projektach. Zaskakująco dobrze sobie radzi.
Combo Rasonix + DeepSeek ma niesamowite cachowanie tokenów. Za 10$ na miesiąc przepalam miliony tokenów a i tak nie widać dna. Pewnie nie jestem power userem co to działa na kilku subagentach, ale mi to wystarcza.

Polecam spróbować, pierwszy miesiąc Opencode Go to 5$, można sobie potestować, są tam też inne modele (głównie chińskie - a więc wiąże się to z różnymi problemami takimi jak to, że modele uczą się na naszym kodzie).

Nie bawiłem się w codexy, gpt, claudy itp. Trochę za drogie.

SL
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 1149
2

Nie ma dobrej odpowiedzi. Modele co chwile się zmieniają. Do tego drogie LLMy są dobre, bo nie trzeba je tak trzymać za rękę. To jaki model będzie najlepszy dla ciebie zależy od tego:

  • ile masz pieniędzy
  • jak cenisz swój czas
  • na ile chcesz ogarniać kod, który wypluł LLM
  • na ile jesteś w stanie poprawiać LLM jak zrobi coś źle. Jak jesteś mistrzem w pisaniu gier to będziesz w stanie dać dobre wskazówki LLMowi. Jak nie to potrzebujesz lepszej jakości
CZ
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 2795
0

Claude z grafową bazą danych wystarcza i musisz umiejętnie dobierać model do potrzeb( z reguły haiku i sonnet wystarczaja). Na przykład wczoraj potrafiłem zużyć mniej niż dolara za tokeny. Wszystko to kwesta konfiguracji. Btw myślę, że Anthropic może podnieść ceny z tego powodu.

PaulGilbert
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 1145
3

Po paru dniach zabawy z codexem (GPT) za 100zł mogę stwierdzić, że jest całkiem fajny do domowego kodowania. Wersja 5.6 luna jest ok do wykonywania zleconych tasków z kodowania, bardzo wolno przepala tokeny. Wersji sol użyłem raz gdy chciałem porozmawiać z chatem na temat rozwiązań architektury, znaleźć plusy i minusy różnych koncepcji i rzeczywiście, szybciej przepala tokeny, ale też całkiem sprawnie sobie radził. Tak więc jak dla mnie spoko do pracy nad własnym projektem po godzinach. Przy odpowiednim podejściu spokojnie wystarcza.

CZ
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 2795
1
PaulGilbert napisał(a):

Po paru dniach zabawy z codexem (GPT) za 100zł mogę stwierdzić, że jest całkiem fajny do domowego kodowania. Wersja 5.6 luna jest ok do wykonywania zleconych tasków z kodowania, bardzo wolno przepala tokeny. Wersji sol użyłem raz gdy chciałem porozmawiać z chatem na temat rozwiązań architektury, znaleźć plusy i minusy różnych koncepcji i rzeczywiście, szybciej przepala tokeny, ale też całkiem sprawnie sobie radził. Tak więc jak dla mnie spoko do pracy nad własnym projektem po godzinach. Przy odpowiednim podejściu spokojnie wystarcza.

To samo mam ostatnio z Cursorem. Cały dzień promotowania i tylko 1-5$ zużyte a Claude jak się przełączy na Opusa 1M/Fable to jak BMW. Niemniej jednak nie potrafię zrozumieć jego siły z portfelem przeciętnego człowieka. Sonnet i Haiku z porządną konfigurację wystarczają prawie, że do wszystkiego.

Ostatnio Boris Cherny (od Anthropic) się chwalił, że Claude mu pracuje już tydzień-dwa z 1000 subagentow, ale co z tego jak nikt inny tak nie może xd.

andrzejklusiewicz
  • Rejestracja: dni
  • Ostatnio: dni
  • Lokalizacja: Warszawa
  • Postów: 31
1

Też przerabiałem temat opłacalności różnych setupów pod kątem pracy z klientami. Z mojego doświadczenia największy koszt to nie sam cennik tokena, tylko ile ich ucieka na odkrywanie kontekstu projektu od nowa w każdej sesji - dobrze poukładany plik z opisem konwencji projektu (CLAUDE.md czy odpowiednik) potrafi zejść z kosztów bardziej niż zmiana na tańszy model. Prompt caching przy powtarzalnym dużym kontekście też realnie zbija koszt sesji.

Rozpisałem to szerzej (monitoring zużycia, optymalizacja kosztów, dobre praktyki na produkcji) tutaj, może się komuś przyda: https://jsystems.pl/blog/show_post/claude_na_produkcji_bezpieczenstwo_monitoring_i_optymalizacja_kosztow/

WhiteLightning
  • Rejestracja: dni
  • Ostatnio: dni
  • Postów: 3341
0

Nie wypowiem sie cenowo ale wygodnie mi sie pracuje codex+ gpt 5.6 terra. Fajnei to dziala w szczegolnosci jak sie dobrze persona zdefiniuje + kaze mu pisac i odpowiadac tresciwie, dobre skille...

Zarejestruj się i dołącz do największej społeczności programistów w Polsce.

Otrzymaj wsparcie, dziel się wiedzą i rozwijaj swoje umiejętności z najlepszymi.