PCIe KI-Beschleuniger mit 384 GB RAM: 700-Billionen-LLMs lokal bei nur 240 Watt, weniger als die Hälfte des RTX PRO 6000 Blackwell
Ein taiwanesisches Unternehmen hat seine neue PCIe-KI-Beschleunigerkarte vorgestellt, die 700 Milliarden Parameter große Sprachmodelle (LLMs) lokal mit nur 240 Watt Leistungsbedarf betreiben kann und damit den Bedarf

Kurzfassung
Warum das wichtig ist
- Ein taiwanesisches Unternehmen hat seine neue PCIe-KI-Beschleunigerkarte vorgestellt, die 700 Milliarden Parameter große Sprachmodelle (LLMs) lokal mit nur 240 Watt Leistungsbedarf betreiben kann und damit den Bedarf
- Skymizer, ein in Taiwan ansässiges Unternehmen, das sich auf KI-Software und -Hardware spezialisiert hat, hat seine brandneue Lösung HTX301 angekündigt.
- Die HTX301 ist für On-Premise-KI konzipiert, bietet ein PCIe-Add-in-Card-Design und liefert KI-Leistung auf Großskalenniveau bei einem TDP unter 250 Watt.
SvyTech-Check
Redaktionelle Einordnung
Kernpunkt
Ein taiwanesisches Unternehmen hat seine neue PCIe-KI-Beschleunigerkarte vorgestellt, die 700 Milliarden Parameter große Sprachmodelle (LLMs) lokal mit nur 240 Watt Leistungsbedarf betreiben kann und damit den...
Warum relevant
Die Plattform wurde speziell für LLMs entwickelt und optimiert Leistung sowie Energieeffizienz.
Einordnung
SvyTech ordnet die Meldung aus Wccftech als Teil des Themenfelds Technologie ein und verweist auf den Originalartikel, damit Leser Fakten, Quelle und Kontext nachvollziehen koennen.
Zu den Highlights der Karte gehören: Das Unternehmen gibt an, dass der HTX301 PCIe-KI-Beschleuniger sein erster Inferenz-Chip ist, der auf der HyperThought-Plattform basiert und dessen nächste Generation LPU-IP (Logic Processing Unit Intellectual Property) integriert.
Die Plattform wurde speziell für LLMs entwickelt und optimiert Leistung sowie Energieeffizienz. Die HTX301 sieht aus wie eine Standard-PCIe-Karte und verfügt über einen einzelnen Chip, um den herum das Speichermodul angeordnet ist.
Das Unternehmen erklärt, dass jedes Board sechs HTX301-Chips enthält und trotz des Einsatzes eines älteren 28-nm-Prozesses außergewöhnliche Ergebnisse liefert, wie beispielsweise die Erzielung von 30 Tokens pro Sekunde bei lediglich 0,5 TOPS und einer Bandbreite von 100 GB/s.
Die LPU ist zudem hochgradig skalierbar
Die LPU ist zudem hochgradig skalierbar und ermöglicht dadurch verschiedene Designoptionen.
Quellenprofil
Quelle und redaktionelle Angaben
- Quelle
- Wccftech
- Canonical
- https://wccftech.com/this-pcie-ai-accelerator-card-packs-384-gb-memory-run-700b-llms-240w/
- Quell-URL
- https://wccftech.com/this-pcie-ai-accelerator-card-packs-384-gb-memory-run-700b-llms-240w/
Aehnliche Inhalte
Verwandte Themen und interne Verlinkung
Weitere Artikel aus aehnlichen Themenfeldern, damit Leser direkt im selben Kontext weiterlesen koennen.

Alarm ausgelöst durch Drohne mit Sprengstoff in Leipzig/Halle: Untersuchung wegen Sabotage am Logistikzentrum
Auf dem Flughafen Leipzig/Halle wurde eine ukrainische Antonov-An-124-Drohung mit Sprengstoff entdeckt, was zu einer zeitweiligen Sperrung der Start- und Landebahnen sowie zur Umleitung führte. Ein DHL-Frachter musste seinen Landeanflug abbrechen, da er in 400 Metern Höhe mit einem weiteren unbekannten Objekt kollidierte, bevor er sicher in Hannover landete. Der deutsche Innenminister Alexander Dobrindt klassifizierte den Vorfall als professionelles hybrides Angriffsszenario, wofür der ukrainische Botschafter Oleksii Makeiev die russische Regierung verantwortlich macht, während die Staatsanwaltschaft eine umfassende Untersuchung einleitete.
06.08.2026



