<?xml version="1.0" encoding="UTF-8"?>
<post>
  <id>01a02d90-53db-7a41-b709-e3c90c252fc9</id>
  <type>post</type>
  <thread>
    <item>
      <id>01a02d90-53db-7a41-b709-e3c90c252fc9</id>
      <depth>0</depth>
      <author>Jörg Kastning B.Sc.</author>
      <url>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9</url>
      <published_on>2026-08-23</published_on>
      <in_reply_to_id/>
      <author_username>joerg_kastning</author_username>
      <body_markdown>@wintermeyer@vutuv.de Welche Hardware nutzt du für die Inferenz des LLMs? Hast du das bereits irgendwo aufgeschrieben?

Ich suche immer noch nach Ideen für mein Heimlabor.</body_markdown>
      <in_reply_to_author/>
    </item>
    <item>
      <id>01a02e68-14b4-7641-a0eb-e5beb03f45bf</id>
      <depth>1</depth>
      <author>Stefan Wintermeyer</author>
      <url>https://vutuv.de/wintermeyer/posts/01a02e68-14b4-7641-a0eb-e5beb03f45bf</url>
      <published_on>2026-08-23</published_on>
      <in_reply_to_id>01a02d90-53db-7a41-b709-e3c90c252fc9</in_reply_to_id>
      <author_username>wintermeyer</author_username>
      <body_markdown>&gt; Welche Hardware nutzt du für die Inferenz des LLMs?

2 × NVIDIA RTX A6000 à 48 GB

&gt; Ich suche immer noch nach Ideen für mein Heimlabor.

Du kannst es natürlich mit fast jeder Hardware machen. Es dauert halt nur Ewigkeiten auf einem normal System.</body_markdown>
      <in_reply_to_author>Jörg Kastning B.Sc.</in_reply_to_author>
    </item>
  </thread>
  <description>@wintermeyer@vutuv.de Welche Hardware nutzt du für die Inferenz des LLMs? Hast du das bereits irgendwo aufgeschrieben?</description>
  <title>Jörg Kastning B.Sc. · 2026-08-23</title>
  <author>
    <name>Jörg Kastning B.Sc.</name>
    <username>joerg_kastning</username>
    <url>https://vutuv.de/joerg_kastning</url>
  </author>
  <replies>
    <item>
      <author>Stefan Wintermeyer</author>
      <url>https://vutuv.de/wintermeyer/posts/01a02e68-14b4-7641-a0eb-e5beb03f45bf</url>
      <published_on>2026-08-23</published_on>
      <author_username>wintermeyer</author_username>
      <body_markdown>&gt; Welche Hardware nutzt du für die Inferenz des LLMs?

2 × NVIDIA RTX A6000 à 48 GB

&gt; Ich suche immer noch nach Ideen für mein Heimlabor.

Du kannst es natürlich mit fast jeder Hardware machen. Es dauert halt nur Ewigkeiten auf einem normal System.</body_markdown>
    </item>
  </replies>
  <url>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9</url>
  <formats>
    <json>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9.json</json>
    <text>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9.txt</text>
    <markdown>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9.md</markdown>
    <xml>https://vutuv.de/joerg_kastning/posts/01a02d90-53db-7a41-b709-e3c90c252fc9.xml</xml>
  </formats>
  <tags>
    <item>GPU</item>
    <item>Inferenz</item>
    <item>self-hosting</item>
  </tags>
  <in_reply_to/>
  <like_count>1</like_count>
  <images/>
  <generated_at>2026-08-23T15:36:28Z</generated_at>
  <schema_version>3</schema_version>
  <published_on>2026-08-23</published_on>
  <review/>
  <license/>
  <fediverse_reaction_count>0</fediverse_reaction_count>
  <reply_count>1</reply_count>
  <fediverse_replies/>
  <body_markdown>@wintermeyer@vutuv.de Welche Hardware nutzt du für die Inferenz des LLMs? Hast du das bereits irgendwo aufgeschrieben?

Ich suche immer noch nach Ideen für mein Heimlabor.</body_markdown>
  <bookmark_count>0</bookmark_count>
  <fediverse_like_count>0</fediverse_like_count>
  <fediverse_reactions/>
  <fediverse_reply_count>0</fediverse_reply_count>
  <fediverse_repost_count>0</fediverse_repost_count>
  <likers>
    <item>
      <name>Stefan Wintermeyer</name>
      <username>wintermeyer</username>
      <url>https://vutuv.de/wintermeyer</url>
    </item>
  </likers>
  <repost_count>0</repost_count>
  <thread_truncated>false</thread_truncated>
  <verified_author_links/>
</post>
