Archiv Juni 2026

Supacode ist ein weiteres sehr nettes Terminal dass glaube ich cmux — Das Terminal für Multitasking für mich ersetzen kann. Es wirkt jedenfalls sehr gut auf den ersten Blick, irgendwie ausgereifter als cmux.

deepreinforce-ai/Ornith-1.0-35B · Hugging Face ist ein Modell basierend auf Qwen3.5 35B 8bit mit Post-Training für explizite Unterstützung von Coding. Es soll deutlich besser für Coding sein als andere 35B MoE Modelle und auch gegenüber Qwen 3.6 35B besser abschneiden. Erste Experimente von mir zeigen soliden Tool-Use mit wenig Fehlersituationen, das lässt schon mal hoffen. Ich könnte mir gut vorstellen das als Basismodell für einen Hermes Agent einzusetzen, zum Beispiel, einfach weil es rasend schnell ist (lokal auf meinem M5 Max MacBook Pro >80 Token pro Sekunde).

DietrichGebert/ponytail: Makes your AI agent think like the laziest senior dev in the room. The best code is the code you never wrote. - ein sehr interessantes Plugin für diverse coding agents (unter anderem Pi und OpenCode, die ich am häufigsten benutze, aber auch alle großen bekannten Agenten aus dem kommerziellen Umfeld), mit dem unnötiger Code gefunden werden kann. Es zielt direkt auf die typischen Schwächen von angentisch erstelltem Code, der oft unnötige Abstraktionen und Indirektionen und Code-Duplikate enthält, die deutlich einfacher abbildbar sind. Auch Re-Implementierungen von Sachen die schon im Standard enthalten sind oder unnötige Abhängigkeiten von externen Bibliotheken, die man leicht durch wenige Inlines und Standardfunktionen ersetzen kann.

AbarthJoe/Qwopus3.6-27B-v2-oQ8-mtp · Hugging Face ist ein sehr interessantes Modell: Qwen 3.6 27B - eines der besten dichten Modelle für Coding - mit fine-tuning basierend auf Opus Thinking Bubbles. Das Ziel ist eine gute Basis für ein Coding-Modell zu haben, dass mit relativ geringem Speicher auskommen kann. Und in dieser Version ist es die MLX konvertierte Variante mit 8bit Quantisierung und allen Gewichten für natives MTP. Auch wenn das nicht der aller schnellste Renner ist, ist es immerhin benutzbar und ziemlich gut schon bei der Analyse von Code in meinen kleinen Tests.

antirez/ds4: DeepSeek 4 Flash and PRO local inference engine for Metal, CUDA and ROCm ist ein ziemlich interessantes Projekt, mit dem Deepseek (spezielle Q2 Quants) möglichst effizient auf verschiedenen UMA Notebooks läuft. Unterstützt sind MacBook, DGX Spark und ROCm Strix Halo Rechner. Ziemlich cool, wenn das auch funktioniert - Deepseek V4 Flash ist schon ziemlich gut als Basismodell für verschiedene Zwecke, wie zum Beispiel als Main-Modell für Hermes.