LLM
Follow from the Fediverse
Follow #llm from Mastodon or any other Fediverse app and its public posts arrive in your timeline. No vutuv account needed.
@llm@tags.vutuv.de
The most endorsed users with this tag
Posts with this tag
7 posts
Filters
Replying to @reeeen@norden.social
Nahezu ausschliesslich mittlerweile. Fähigkeit einfach das Modell+Harness den Quellcode vom Harness lesen zu lassen um herauszufinden was der Harness wirklich macht ist Gold wert.
Plugin System grandios. Feature fehlt? Feature is doof? Bau ein, bau besser.
Natürlich mit dem eingebautem Web-Interface wenn man gerade keine Lust auf die TUI hat. Client/Server fähig um lokales TUI mit entferntem Coding Server zu verbinden. Beliebig in andere Apps oder sogar shell scripts integrierbar.
Dazu natürlich das grandiose Anomaly/Opencode Go 10€/Monat Paket.
Jeden Monat das beste was es an Openweight Modellen gibt mit in der Regel mehr als großzügigen Limits, ZDR (Zero Data Retention) und regelmäßig free token Aktionen bei neuen Modellen. Ganze Woche 8h/Tag straight Ox Alpha/GLM 5.3 Flash für umsonst zur Einführung mit ZDR bekommen. Davor das gleiche als DeepSeek V4 Flash neu war. Absoluter No-Brainer.
(Link oben ist ref-Link: 1. Monat 5€ statt 10€ und 5€ für mich.)
From other networks 3
2 likes 1 reply
@reeeen@norden.social liked this @eutechnews@mastodon.social liked this
Already counted in the numbers above.
Interessantes Paper zum Einfluss von AGENTS.md et al. Dateien.
arxiv.org/pdf/…
Wichtiger Quote aber auch:
Limitations and Future Work Programming languages The current evaluation is focused on Python. Since this is a language that is widely represented in the training data, detailed knowledge about tooling, dependencies, and other repository specifics might be present in the models’ parametric knowledge, nullifying the effect of context files. Future work may investigate the effect of context files on more niche programming languages and toolchains that are less represented in the training data [8, 27].Context files beyond task resolution In this work, we evaluate the impact of context files on task resolution rate. However, other aspects of coding agent performance, such as code efficiency [14] and security [10], would be interesting directions for future work. Security, specifically, was found to be sensitive to prompt changes in prior work [37].
Hervorhebung eigene.
Im Prinzip also: Spitz, nützlich und was das Modell halt nicht selbst kann reinschreiben, nicht was Captain Obvious auch schon gewusst hätte. Whowouldathought. Klingt wie bei Menschen…😆
From other networks 3
1 like 2 reposts
@marintkael@mastodon.social liked this @academia@newsmast.community shared this @ai@channel.org shared this
Already counted in the numbers above.
Spannende neue Ergebnisse von Intel was low(er) power KI-Beschleuniger angeht.
Ich finde das auch insbesondere vor dem Hintergrund der Mac/AMD395-/Nvidia DGX Serie Alternativen interessant. Schöne KPI auch: Token/W.
480GB oder selbst 160GB sollten mit ausreichend Bandbreite und Leistung schon einiges erreichen konnen.
Cosa fa il tirannosauro qui sotto? Divora #libri distruggendoli
È il logo del dipartimento di #Amazon che fa a pezzi libri rari per alimentare gli #LLM#404 media ha dimostrato che la pratica di acquisire libri rari e distruggerli è reale e non una leggenda: è bastato inserire un #airtag in un libro per tracciarlo.
La cosa è stata definita “incarnazione del male”. Chiunque sappia cosa sia davvero un libro non può che essere d’accordo.
Das ganze “digitale Souveranität” Thema wird immer gerne rumgereicht. Und für KI wirds ebenso so wichtig, wenn nicht wichtiger. Leider ist Deutschland hier auch wieder kurz vor abgehängt. Aber…
@hetzner@mastodon.hetzner.social to the rescue. Da scheint gerade die Aufbau-Phase fürs Inference-Only Hosting mit OpenWeight-Modellen zu laufen. Aktuell Qwen 3.6 und das aktuelle Qwen 3.8.
Und in dem Zusammenhang gibt’s aktuell eine kostenlose Testphase mit Free-Tokens: docs.hetzner.com/general/…
Qwen 3.8 scheint unter der Last zusammengebrochen zu sein, 3.6 reagiert.
OpenCode hat es schon als direkt verwendbaren Provider integriert.
Fragt sich ob das mit ZDR (Zero Data Retention) läuft und wie die zukünftigen Pläne für Flatrates, ZDR, andere Modelle wie DeepSeek V4 Flash und dergleichen aussehen. Sie sind an Feedback interessiert, sagt die Website.
From other networks 1
KI außer Kontrolle: OpenAI-Modell hackt Hugging Face
OpenAI-Modell bricht aus Sandbox aus, hackt Hugging Face, um bei einem eigenen Test zu schummeln. Klingt nach Fiktion, ist aber offiziell bestätigt (von OpenAI selbst).
Wir haben den Vorfall aufgedröselt – inklusive der Ironie, dass kommerzielle KI-Modelle sich weigerten, bei der Aufklärung zu helfen, weil ihre eigenen Sicherheitsfilter den Angriff für echt hielten.
“offiziell bestätigt” und dann steht da als Quelle “OpenAI” – die #LLM-Unternehmen behaupten viel, wenn es ihnen nützt. Und zu “bestätigen”, dass ein Modell so mächtig ist, dass es aus einer Sandbox ausbricht, macht den Leuten zwar Angst, aber es verbreitet auch weiter den Narrativ, dass wir bald bei #AGI angelangt seien (jakecuth.com/work/…). Und mit der Angst kann man auch wiederum gut arbeiten (“Wollt ihr, dass den Chinesen lieber die Macht über den #KI-Markt überlassen oder wollt ihr lieber uns mehr Macht geben?”).