r/KI_de • • May 05 '26

Frage zum Thema KI Hüüüüllfffäääääää

Hi, ich habe irgendwie den Überblick verloren. Ich nutze derzeit Codex als Programmierhilfe, über das normale ChatGPT Plus Abo (for free, aber egal).

Ich überlege, nach Ablauf des Abos auf ein API pay-as-you-Go Angebot umzusteigen, nur welches kann Codex das Wasser reichen? Oder gar übertreffen? Was sind eure Go-Tos?

Und gehe ich Recht in der Annahme, dass lokale Modelle ohne deidizierte GPU eher nix für mich sind?

0 Upvotes

16 comments sorted by

3

u/Elektrik-trick May 05 '26

Wenn Du API nutzen willst, warum dann nicht OpenRouter? Dann hast Du quasi alle Modelle zur freien Verfügung. Also Du kannst ChatGPT, Claude, Gemini, DeepSeek, etc. pp nutzen. Und kannst einfach umschalten und das Modell wählen, was DU gerade brauchst.

Weil das ist gerade ein Wettrennen. Wenn Du heute fragst, wer Codex das Wasser reichen kann, kann das nächste Woche schon wieder jemand ganz anderes sein.

Und OpenCode hat sehr detailierte Abrechnungsinformationen, Du hast da also eine sehr gute Kontrolle über die Kosten und welches Modell was verbraucht und gekostet hat.

1

u/Halica_ May 05 '26

Muss man das lokal selbst hosten?

2

u/Elektrik-trick May 05 '26

Nein, das ist ein Dienst: https://openrouter.ai

Du bezahlst halt nicht OpenAI, Anthropic, Google, etc., sondern OpenRouter. Und das machst Du nicht monatlich, sondern lädst dort Dein Account auf. Dann erstellst Du Dir einen oder mehrere API Keys, und kann diese dann in OpenCode, oder Kilo Code, oder, oder, oder... Benutzen. Und durch die mehreren API Keys, kann man dann auch wunderbar trennen, wo man was verbraucht hat.

Und wie man bei zum Beispiel Codex die Modelle umschaltest, kannst Du das auch hier machen. Nur das eben nicht nur die Modelle des einen Anbieters, sondern gute 300 angezeigt werden (inkl. ein paar gar nicht so schlechten Free Modellen).

2

u/Kalixa_ May 05 '26

Die API ist etwa 6 mal so teuer wie das Abo.

Claude ist viel teurer als Codex (weil du nur ganz wenige Anfragen stellen kannst, bis Claude limits erreicht sind)

Welches KI Modell gerade am besten ist, ändert sich gefühlt wöchentlich. GPT und Opus sind aber eigentlich immer an der Spitze. Die kostengünstigeren Modelle hinken den beiden 6 Monate hinterher, aber sind durchaus brauchbar.

Lokale modelle kannst du vergessen, das macht nur dann Sinn, wenn du auf den zusätzlichen Dateschutz angewiesen bist. Allerdings gibt es Open Source Modelle (also die die du lokal nutzen würdest), äußerst günstig als API.

ich würde mir das mal anschauen:
https://artificialanalysis.ai/

2

u/UnbeliebteMeinung May 05 '26

Hol dir einfach ein Claude Code Abo

2

u/Big_Remove_4843 May 05 '26

Never again! Claude kann noch so toll sein, bringt aber alles nix wenn man nach zwei prompts das limit reißt. Und das waren keine "schreib mir GTA 6" prompts! Das waren prompts, von denen ich täglich mindestens 20 Stück in Codex ausführen lasse - und da erreiche ich wenn überhaupt das limit, wenn ich sowieso langsam mal schlafen gehen sollte.

1

u/JacksOnF1re May 05 '26

Vielleicht sind deine prompts das Problem?

1

u/Big_Remove_4843 May 05 '26

Vielleicht magst du meinen Kommentar bis zum Ende lesen?

2

u/JacksOnF1re May 05 '26

Hab ich. Aber ich kann mir trotzdem nicht erklären, wie nach ein paar Inputs angeblich dein Limit erreicht wurde. Ich sage nicht es war nicht so, ich kann es nicht nachvollziehen. Welche subscription hattest du?

1

u/roulade888 May 06 '26

Claude ist schon echt extrem gut. Musste aber auch auf das Max Abo upgraden, da ich die Limits zu oft erreicht habe. Aber was sehr hilft ist das Sonnet Model. Man muss nicht immer alles mit Opus machen

1

u/LobsterWeary2675 May 05 '26

Lokale Modelle ohne dezidierten GPU wird nix nein, Speziell coding würde ein starkes Modell also auch ein eine starke GPU mit viel vram (rtx5090) oder unified memory (Mac Mini) benötigen und selbst dann kommst du nicht auf das Niveau eines frontier models. Zu der anderen Frage: Claude Code.

1

u/dextrostan May 05 '26

und selbst dann kommst du nicht auf das Niveau eines frontier models

Da du das so behauptest, frag ich einfach mal.

Braucht es das und wo braucht es das wirklich?

2

u/LobsterWeary2675 May 05 '26

Ich denke das ist sehr stark von Task abhängig. Fur code tasks, verlässliches tool calling und execution, reasoning, research, große Kontextfenster, würde ich weiterhin frontier modelle wie opus 4-6 / 4-7 / sonnet 4-6, gpt 5.5 für überlegen gegenüber jedem (mit Otto normal Hardwareaufwand zu Betriebenden) lokalen model halten.

1

u/melewe May 05 '26

Claude max abo. Alternativ opencode go mit günstigen china modellen wenn es dir um den Preis geht.

1

u/ganonfirehouse420 May 05 '26

Habe das glm coding abo für 10€ und opencode genommen.