LLM

Tags

Follow from the Fediverse

Follow #llm from Mastodon or any other Fediverse app and its public posts arrive in your timeline. No vutuv account needed.

@llm@tags.vutuv.de

Your address is used once, to send you to your own server's follow dialog. It is never stored here.

The most endorsed users with this tag

Posts with this tag

7 posts

Filters

Replying to @reeeen@norden.social

Nahezu ausschliesslich mittlerweile. Fähigkeit einfach das Modell+Harness den Quellcode vom Harness lesen zu lassen um herauszufinden was der Harness wirklich macht ist Gold wert.

Plugin System grandios. Feature fehlt? Feature is doof? Bau ein, bau besser.

Natürlich mit dem eingebautem Web-Interface wenn man gerade keine Lust auf die TUI hat. Client/Server fähig um lokales TUI mit entferntem Coding Server zu verbinden. Beliebig in andere Apps oder sogar shell scripts integrierbar.

Dazu natürlich das grandiose Anomaly/Opencode Go 10€/Monat Paket.

Jeden Monat das beste was es an Openweight Modellen gibt mit in der Regel mehr als großzügigen Limits, ZDR (Zero Data Retention) und regelmäßig free token Aktionen bei neuen Modellen. Ganze Woche 8h/Tag straight Ox Alpha/GLM 5.3 Flash für umsonst zur Einführung mit ZDR bekommen. Davor das gleiche als DeepSeek V4 Flash neu war. Absoluter No-Brainer.

(Link oben ist ref-Link: 1. Monat 5€ statt 10€ und 5€ für mich.)

opencode LLM openweightmodel Aiassistedcoding open source
opencode LLM openweightmodel Aiassistedcoding open source
1
From other networks 3

Interessantes Paper zum Einfluss von AGENTS.md et al. Dateien.
arxiv.org/pdf/…

Wichtiger Quote aber auch:
Limitations and Future Work Programming languages The current evaluation is focused on Python. Since this is a language that is widely represented in the training data, detailed knowledge about tooling, dependencies, and other repository specifics might be present in the models’ parametric knowledge, nullifying the effect of context files. Future work may investigate the effect of context files on more niche programming languages and toolchains that are less represented in the training data [8, 27].

Context files beyond task resolution In this work, we evaluate the impact of context files on task resolution rate. However, other aspects of coding agent performance, such as code efficiency [14] and security [10], would be interesting directions for future work. Security, specifically, was found to be sensitive to prompt changes in prior work [37].

Hervorhebung eigene.

Im Prinzip also: Spitz, nützlich und was das Modell halt nicht selbst kann reinschreiben, nicht was Captain Obvious auch schon gewusst hätte. Whowouldathought. Klingt wie bei Menschen…😆

LLM Aiassistedcoding AI research contextengineering
LLM Aiassistedcoding AI research contextengineering
From other networks 3

Spannende neue Ergebnisse von Intel was low(er) power KI-Beschleuniger angeht.

Ich finde das auch insbesondere vor dem Hintergrund der Mac/AMD395-/Nvidia DGX Serie Alternativen interessant. Schöne KPI auch: Token/W.

480GB oder selbst 160GB sollten mit ausreichend Bandbreite und Leistung schon einiges erreichen konnen.

servethehome.com/intel-crescent-island-…

Localllm LLM Aiassistedcoding Intel Hotchips2026
Localllm LLM Aiassistedcoding Intel Hotchips2026
gualdo @gualdo mastodon.uno

Cosa fa il tirannosauro qui sotto? Divora #libri distruggendoli

È il logo del dipartimento di #Amazon che fa a pezzi libri rari per alimentare gli #LLM#404 media ha dimostrato che la pratica di acquisire libri rari e distruggerli è reale e non una leggenda: è bastato inserire un #airtag in un libro per tracciarlo.

La cosa è stata definita “incarnazione del male”. Chiunque sappia cosa sia davvero un libro non può che essere d’accordo.

GT
Y=

Das ganze “digitale Souveranität” Thema wird immer gerne rumgereicht. Und für KI wirds ebenso so wichtig, wenn nicht wichtiger. Leider ist Deutschland hier auch wieder kurz vor abgehängt. Aber…

@hetzner@mastodon.hetzner.social to the rescue. Da scheint gerade die Aufbau-Phase fürs Inference-Only Hosting mit OpenWeight-Modellen zu laufen. Aktuell Qwen 3.6 und das aktuelle Qwen 3.8.

Und in dem Zusammenhang gibt’s aktuell eine kostenlose Testphase mit Free-Tokens: docs.hetzner.com/general/…

Qwen 3.8 scheint unter der Last zusammengebrochen zu sein, 3.6 reagiert.

OpenCode hat es schon als direkt verwendbaren Provider integriert.

Fragt sich ob das mit ZDR (Zero Data Retention) läuft und wie die zukünftigen Pläne für Flatrates, ZDR, andere Modelle wie DeepSeek V4 Flash und dergleichen aussehen. Sie sind an Feedback interessiert, sagt die Website.

hetzner LLM inference openweightmodels freebeer
hetzner LLM inference openweightmodels freebeer
1
From other networks 1

1 like

@lenzgr@mastodon.social liked this

Already counted in the numbers above.

OpenAI hackt Hugging, Face

KI außer Kontrolle: OpenAI-Modell hackt Hugging Face

OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).

Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.

tagworx.net/ynews.php?cid=1&nid=39027

OpenAI Hugging Face KI-Sicherheit Cyberangriff
OpenAI Hugging Face KI-Sicherheit Cyberangriff
2

“offiziell bestätigt” und dann steht da als Quelle “OpenAI” – die #LLM-Unternehmen behaupten viel, wenn es ihnen nützt. Und zu “bestätigen”, dass ein Modell so mächtig ist, dass es aus einer Sandbox ausbricht, macht den Leuten zwar Angst, aber es verbreitet auch weiter den Narrativ, dass wir bald bei #AGI angelangt seien (jakecuth.com/work/…). Und mit der Angst kann man auch wiederum gut arbeiten (“Wollt ihr, dass den Chinesen lieber die Macht über den #KI-Markt überlassen oder wollt ihr lieber uns mehr Macht geben?”).

AI LLMs OpenAI hugging-face NoAI
AI LLMs OpenAI hugging-face NoAI