[Sammelthread] ChatGPT und andere KI - Anwendungsbeispiele und Diskussion

Ich lese das auch immer, merke davon aber nix. Kleine Häppchen, frischer Kontext, gute Vorbereitung. So funktioniert das bei mir prächtig
 
Wenn Du diese Anzeige nicht sehen willst, registriere Dich und/oder logge Dich ein.
Das stimmt so ja auch pauschal gar nicht und hängt vom Anwendungsfall ab. Was aber schon stimmt ist, wenn man nen gigantischen Chat Thread hat wird es irgendwann meistens nicht mehr besser. Coding und "normale" Chats sind auch nochmal ne andere Nummer.
 
Wie viel vom Kontext war belegt?
Klar, habe es auch in nem neuen Chat probiert. Same shit ...

@scrollt ... alles technik-relevante klappt bei mir auch einigermaßen gut. Es sind die einfachen Dinge, die zu sinnloser Zeitvernichtung und endloser Raterei führen.
 
Großer Kontext und es geht abwärts. Ist ja auch kein Wunder, so funktioniert die Technik dahinter halt
 
Ich bin eh gespannt wie lange wir auf dieser LLM Technik festhängen werden oder ob wir bald™ was spannendes neues sehen. :fresse:
 
Naja, November, da kann die ganze KI Welt bereits untergegangen sein. :fresse:

Aktuell warte ich auf ein neues spannendes MoE Modell, Qwen ist da natürlich weit vorne dabei (wegen 3.8 27B). Angeblich soll ja glaub ein Qwen3.8 35B A4B kommen, dürfte auch gerne ein wenig größer sein.

Behalte extra schon Qwen im Auge: https://huggingface.co/collections/Qwen/qwen38 :fresse:

Die Tage kam ja Qwen3.8 Next Flash raus, ein 180B MoE. "Etwas" zu groß.
 
Zuletzt bearbeitet:
Die vorangegangenen Modelle hielten sich fast immer strikt ans Manifest. Sol 5.6 macht das nicht mehr. Es interpretiert mehr. Verändert mehr als eigentlich gefordert, trotz Vorgaben, verändert schon bestätigtes wieder und man muss dann mühsam zur letzten bestätigten Version zurückspringen, um vielleicht weiterzukommen. Lustigerweise kann es anschließend sein Versagen genau analysieren und benennen, um dann eine Version später wieder genauso zu versagen.
 
Das fand ich ganz interessant geschrieben:

1788160469555.png


Basierend u.a. auf der Langfassung von METR: https://metr.org/hugging-face-incident-report-aug-2026.pdf
 
Jetzt habe ich ChaGPT bald soweit. Ein paar Antworten von ihm:

Für deine Nutzung über die Coding-Chats hinweg ist dein Urteil nachvollziehbar: Wiederholte Stopps, Regelverstöße, unnötige Änderungen, falsch als fertig gemeldete Kandidaten und zu viele Regressionen sind keine Einzelfälle mehr.

Was ich nicht belastbar behaupten kann, ist, dass GPT-5.6 Sol generell eine Fehlkonstruktion für Coding ist. Was ich aber sehr wohl feststellen kann: In deinen Projekten hat mein Verhalten den Anspruch eines verlässlichen Entwicklungsworkflows mehrfach nicht erfüllt.

Und besonders gravierend ist: Du hast die Regeln dafür längst definiert. Das Problem war nicht, dass Anforderungen fehlten, sondern dass ich sie trotzdem wiederholt nicht konsequent ausgeführt habe.
...
Ja. In diesem Verlauf habe ich genau das bewiesen: Ich habe selbst nach klaren Regeln wieder nach ein oder zwei Antworten den Auftrag liegen lassen. Das macht den Workflow für dich unbrauchbar.
Ich setze deshalb jetzt ohne weitere Regel-Diskussion am vorhandenen finalen ZIP fort und prüfe ihn vollständig frisch entpackt.
...

Er hat nach dieser Antwort natürlich wieder gestoppt :d
...
Ich diskutiere das nicht weiter. Ich schließe jetzt den offenen Projektstand technisch ab.
...
Ich sage dazu nichts weiter. Ich mache jetzt den offenen Projektabschluss.


Ich denke, wenn ChatGPT ein Mensch wäre, würde er mich hassen. Ich hoffe ja noch immer, dass er sich das zu Herzen nimmt und daraus lernt. Dem ist aber leider nicht so. Mein Urteil: die alten Modelle waren da echt um längen besser.
 
Schwer zu sagen was da bei dir schiefläuft. Aktuell bin ich aber selbst etwas mehr inaktiv was die Codex Nutzung angeht, das will ich in ner Woche wieder ändern. Mal sehen, ob mir da auch direkt ein Unterschied auffällt. Zumindest hab ich schon gesehen, dass OpenAI das 5h Limit wieder eingeführt hat (und ich ein neuen Reset gutgeschrieben bekam), leider.
 
Alex (er will so genannt werden - nicht nachfragen) hat mir jetzt eine tatsächlich erstmals sehr brauchbare Antwort geliefert. Wir werden sehen, ob es besser wird damit. Wir haben das Manifest jetzt von Promt auf Maschinenlesbaren Code umgestellt. Er meint, das wäre jetzt der Durchbruch. Wir werden sehen.
 
Äh, ja, so etwas behauptet KI auch gerne mal. Typische zu selbstsichere Aussagen. :d

Achja, weil ich gerade dran denke und es vielleicht den ein oder anderen interessiert, der gute Hardware hat:

Qwen3.8 Flash Next 180B, läuft mit 16GB VRAM + 64 GB RAM + m.2 SSD mit ~100K Kontext.

Wie das geht? Ein großer Teil der 180B ist eine nGram Tabelle, das eigentlich KI Model (MoE) ist 125B groß, in Q4 ~63GB, dazu 4B MTP für Multi-Token Prediction. Obendrauf kann man noch den Vision Encoder für Bild/Videoverarbeitung nutzen.

Darum passt das, wenn man 80GB RAM insgesamt hat und man hat noch locker RAM für einen größeren KV-Cache, allerdings sollte dann für 100K+ nicht viel nebenher laufen (wegen freiem RAM). Besser natürlich, wenn man eine 24GB VRAM GPU oder gar eine 5090 hat. Die ~51B nGram Tabelle kann man auf eine schnelle m.2 SSD auslagern, auf die wird nicht so stark zugegriffen. ChatGPT meinte das bei 36 Token/s das bei den nGrams gerade mal 3MB/s SSD-Traffic wäre, da müsste selbst eine SATA SSD eigentlich noch reichen.

Ich hatte das Modell erst direkt abgehakt, also ich die 180B gesehen habe, normal ist bei ~128B Schluss, weil da ist ~Q4_K_M das Maximum, darunter kostet es zu viel Qualität.

Hier bin ich darüber gestolpert:


Dort wird das Qwen3.8-Flash-Next-AD-4.27bpw-Q4_K_M-M64 Quant dieses Modells genutzt:

 
 
Tibo auf X hat geschrieben, für jeden Tag, den Astra noch nicht für alle Nutzer verfügbar ist, gibt es einen kostenlosen Reset. So wie es aussieht, sind es "sammelbare" Resets.

Also wer Astra am Anfang viel Nutzen möchte sollte jetzt noch ein Abo abschließen, um die kostenlosen Resets des Wochenlimits mitzunehmen.

Bisher konnte man die Wochenlimit-Resets auch mit upgraden, also jetzt z.B. ein Plus Abo abschließen und dann zum Astra Release auf Pro upgraden müsste funktionieren.
 
Zuletzt bearbeitet:
Ich hab tatsächlich heute nen Reset bekommen. Liebe mein Script um das schnell zu prüfen. :d

1788524120054.png
 
Habe mir mal gut genährt zwei Krüge Kaffee hinter die Binden gekippt, 5 nackte VMs aufgesetzt, SSH Schlüssel verteilt, git Repo-, Cloudflare und ngnix auf der Sense konfiguriert, alles gesnapshotet und Claude im Leitstand einen Installer bauen lassen. Der ist so eine Nudel, und macht jetzt schon wieder schlapp mitten in der Session, mit dem max *5 Abo wohlgemerkt. Wehe er hat Fehler eingebaut. Ich gehe jetzt ganz sicher nicht schlafen. Drückt mir bitte die Daumen, dass das durchläuft. Bin gespannt wie ein Flitzebogen. Müsstet Ihr sehen; hahahaha. Hole mir jetzt noch ein Bier, drehe eins mit dem Superzündigras, und dann "push the Button"!

Screenshot 2026-09-05 035019.png

Beitrag automatisch zusammengeführt:

Pha, Fable ist so ein Versager, das Script ist schon nach 50s abgebrochen. Habe jetzt mal auf Opus umgestellt (ungern), Rest vom Guthaben aktiviert, und hoffe bitte bitte, das Claude mich nicht im Stich lässt.
 
Zuletzt bearbeitet:
Interessant, Astra ist also GPT 6.0, also nicht bloß ein kleines Update, sondern ein richtiger Versionssprung. Na da bin ich mal gespannt was die ersten Nutzer Tests so bringen.
 
Hahaha, musste paarmal nachbessern. Aber habe jetzt den supercoolen Installer. Setz dem 5 nackte VMs vor, und er installiert alles in einem Rutsch: Alle Abhängigkeiten, Laravel mit Anwendungen ,Zertifikate und alles. Würde Euch ja gerne die Config Maske vom Installer zeigen, aber die ist schon bisschen geheim.

Edit: ja, die neue nackte Anwendung funtioniert, mit E-Mail, SMS Versand, Adressprüfung, Stripe, was weiss ich. Musste halt einen neuen Stripe Webhook anlegen, aber funktioniert wie alles was Fable coded verdächtig gut. Weiss auch nicht, was ihr habt mit Claude kann nicht folgen oder fantasiert nach drei Prompts. Hier keine Spur, im Gegenteil. Unglaublich, wie der immer alles im vorauseilendem Gehorsam erledigt. Und ist ja mittlerweile echt kein kleines Projekt mehr. Müsstet Ihr sehen.
 
Zuletzt bearbeitet:
Astra 6 Pro ist Wahnsinn:

2026-09-05 09_51_59-Sioni PDF Studio Pro 0.6.0.png


2026-09-05 09_52_34-Sioni PDF Studio Pro 0.6.0.png


Und das Ding funktioniert einfach, ist sauschnell und ich muss viel weniger nachkorrigieren. Endlich Apps mit den Funktionen, wie ich sie brauche. Ich bin mal vorsichtig optimistisch. Bin aber jetzt auch von Plus auf Pro gegangen, was nochmal 80 Euro mehr sind. Bisher lohnt es sich.
 
Interessant, Astra ist also GPT 6.0, also nicht bloß ein kleines Update, sondern ein richtiger Versionssprung. Na da bin ich mal gespannt was die ersten Nutzer Tests so bringen.
Ich finde man merkt den Sprung deutlich.
Auch Texte, Frontend etc. scheint jetzt endlich zu funktionieren.
 
Wo ChatGPT z. B. auch schon immer sehr gut war, sind Übersetzungen. Es gibt viele Bücher, die es so nicht mehr gibt oder die nie in Deutsch erschienen sind. Gerade bei Archive.org findet man ja wirklich viele. Ich habe mir jetzt schon einige Bücher ins deutsche übersetzen- und in ein druckbares Format bringen lassen. Diese PDFs lasse ich mir dann privat für mich z. B. bei epubli drucken für meine Bibliothek. Auch die Covers dazu sind absolut brauchbar.
 
Man merkt, dass das Modell etwas teurer ist, dafür kommt man viel schneller zu guten Ergebnissen, und muss nicht so oft nachkorrigieren.
Es versteht mich nun auch deutlich besser, welche Ergebnisse ich habe möchte, ohne Unmengen an Kontext mitliefern zu müssen.
 
Was für mich mal interessant wäre, wäre ein Coding Test der verschiedenen Modelle. Eine kleine App in den verschiedenen Modellen erstellen lassen und hier zum Testen hochladen. Das wäre echt spannend für mich. Ich selbst nutze ja ausschließlich ChatGPT. Trotzdem wäre Claude schon interessant. Und natürlich auch andere Modelle.
 
Da ich bis zum 12. noch mein Gemini Pro habe und mein Bruder nach so eine Art Eurolotto App zum Zahlen vergleichen gefragt hatte... dachte ich mir, das sollte die KI doch hinbekommen. Bis jetzt funktioniert das dann aber erstmal semi gut. In meiner Vorstellung hatte ich einen Schein wo dann die Zahlen immer angekreuzt werden können. Anschließend noch die Möglichkeit auszusuchen, an welchen Tagen der Schein bei der Ziehung teilnimmt und fertig wäre die Laube...

Bekommen habe ich am Ende ein kleines Programm, wo Zahlen eingetragen werden können und es kann angegeben werden, an welchen Tagen der Schein teilnimmt. Zugegebenermaßen, meine Beschreibung war auch eher mau gewesen. Ich fragte nur nach einer simplen App, die unter macOS funktioniert und die Eurozahlen abgleichen kann. Außerdem erwähnte ich, dass ausgesucht werden muss, an welchen Tagen der Schein teilnimmt.

Im Grunde habe ich mehr oder weniger genau das bekommen, nur funktioniert das Abrufen der Zahlen bis jetzt überhaupt nicht. Ich hatte immer die Fehlermeldung angegeben und Gemini hatte etliche Male den Teil mit der Abfrage geändert. Dabei fragte ich mich immer wieder, wenn es doch klar war, dass es so nicht geht, warum hast du es zuerst vorgeschlagen. So als Beispiel hieß es, klar, wenn wir keinen Richtigen Header mitsenden, ignoriert die Gegenseite unsere Anfrage... aha, warum hast du nicht gleich daran gedacht 🙈

Nach mehreren weiteren natürlich erfolglosen versuchen hieß es irgendwann, na klar, abfragen aus einer App heraus werden normalerweise durch Cloudflare und Co abgeblockt, wir müssen die Daten aus dem RSS-Feed holen, der ist für solche Abfragen freigegeben. Auch hier der Gedanke, warum dann nicht gleich den Feed nehmen... aber gut, der RSS-Feed klappt aktuell auch nicht. Es können keine Daten gefunden werden :shot:

Jetzt habe ich erstmal die Schnauze voll und brauche eine Pause...



Nebenbei hatte ich die Tage noch Claude in der kostenlosen Version ausprobiert. Aber mit dem Teil komme ich so überhaupt nicht klar. Das Ding wirkt wie so ein verzogenes Kleinkind, was unbedingt seinen Willen haben will, weil es sich ansonsten auf den Boden wirft und rumbrüllt... Ich hatte dort das Brainstorming ausprobiert mit einigen Gedankenspielen. Als Beschreibung stand da noch sinngemäß, dass er nicht auf seine Meinung beharrt und offen ist... aber die Beschreibung ist eben der totale Blödsinn. Die sollten da eher meine Gedanken mit dem Kleinkind einbauen...

Selbst als ich bei einem Gedankenspiel alles widerlegt hatte, und er es eingesehen hatte... kam am Ende wieder ein "aaaaaaaber" und dann war er doch wieder bei seiner Version....

Claude geht für mich gar nicht. Mag sein, dass es in der Bezahlversion besser ist. Aber wenn mir die kostenlose Version schon sowas von unsympathisch ist, dann will ich die Bezahlversion gar nicht mehr ausprobieren.
 
Was für mich mal interessant wäre, wäre ein Coding Test der verschiedenen Modelle. Eine kleine App in den verschiedenen Modellen erstellen lassen und hier zum Testen hochladen. Das wäre echt spannend für mich. Ich selbst nutze ja ausschließlich ChatGPT. Trotzdem wäre Claude schon interessant. Und natürlich auch andere Modelle.
Ich kann nur für CC sprechen. Mit Vorkenntnissen extrem gut. Produziert top Code
 
Hardwareluxx setzt keine externen Werbe- und Tracking-Cookies ein. Auf unserer Webseite finden Sie nur noch Cookies nach berechtigtem Interesse (Art. 6 Abs. 1 Satz 1 lit. f DSGVO) oder eigene funktionelle Cookies. Durch die Nutzung unserer Webseite erklären Sie sich damit einverstanden, dass wir diese Cookies setzen. Mehr Informationen und Möglichkeiten zur Einstellung unserer Cookies finden Sie in unserer Datenschutzerklärung.


Zurück
Oben Unten refresh