Performance Engineering für KI-Systeme: Optimierung von Modelltraining- und Inferenz-Workloads mit GPUs, CUDA und PyTorch

ANT

★★★★★ 4.6
€60,95
Format
Über diese Ausgabe
  • Durchgehend farbige Diagramme und ausgearbeitete Beispiele.
  • Für Leser, die neu in diesem Thema sind, verfasst.
  • Kapitelweise Aufgaben mit vollständigen Lösungen.
  • Verknüpfen Sie diesen Block mit einem Produkt-Metafeld, um ihn je nach Titel zu variieren.
Veröffentlichungsdatum 16. Dezember 2025
Autor Chris Fregly
€60,95

Kostenlose Lieferung bei Printausgaben.

Versand innerhalb von 1 Werktag
Auf Lager
Quantity
By placing your order you agree to purchase from Global-e as the merchant of record, subject to Global-e’s Terms and Conditions and Privacy Policy, and share your information with ANTBOOK.
Sicherer Checkout – durchgängig verschlüsselt Kostenloser Umtausch oder Rückgabe innerhalb von 30 Tagen, falls das Produkt defekt ist. Digitale Formate sofort verfügbar
Leser mochten auch

Entdecken Sie ein weiteres großartiges Werk für Ihre digitale Bibliothek.

€60,95

Beschreibung

Steigern Sie die Leistungsfähigkeit Ihres KI-Systems mit diesem umfassenden Leitfaden zur Maximierung der Effizienz auf jeder Ebene Ihrer KI-Infrastruktur. Im heutigen Zeitalter der stetig wachsenden generativen Modelle bietet "AI Systems Performance Engineering" Ingenieuren, Forschern und Entwicklern eine praktische Sammlung umsetzbarer Optimierungsstrategien. Lernen Sie, Hardware, Software und Algorithmen gemeinsam zu optimieren, um robuste, skalierbare und kostengünstige KI-Systeme zu entwickeln, die sowohl beim Training als auch bei der Inferenz hervorragende Leistungen erbringen. Dieses von Chris Fregly, einem auf Performance fokussierten Ingenieur und Produktmanager, verfasste Werk verwandelt komplexe KI-Systeme in optimierte, hochwirksame KI-Lösungen.

Im Inneren entdecken Sie Schritt-für-Schritt-Methoden zur Feinabstimmung von GPU-CUDA-Kerneln, PyTorch-basierten Algorithmen sowie Mehrmodul-Trainings- und Inferenzsystemen. Sie beherrschen außerdem die Kunst der Skalierung von GPU-Clustern für Hochleistungs-, verteilte Modelltrainingsaufgaben und Inferenzserver. Das Buch schließt mit einer über 175 Punkte umfassenden Checkliste bewährter, sofort einsetzbarer Optimierungen.

Hardware, Software und Algorithmen gemeinsam entwerfen und optimieren, um maximalen Durchsatz und Kosteneinsparungen zu erzielen. Modernste Inferenzstrategien implementieren, die Latenz reduzieren und den Durchsatz in realen Umgebungen steigern. Branchenführende Skalierbarkeitstools und -frameworks nutzen. Leistungsengpässe in komplexen KI-Pipelines profilieren, diagnostizieren und eliminieren. Full-Stack-Optimierungstechniken für eine robuste, zuverlässige Leistung von KI-Systemen integrieren.

Spezifikationen

FormatEPUB, PDF
Seiten1060
SpracheEnglisch
ISBN-13979-8341627789

Häufig gestellte Fragen

Benötige ich zum Herunterladen ein Konto?

Nein. Nach dem Kauf können Sie Ihr E-Book direkt über die Bestellbestätigung oder die Download-Seite aufrufen.

Was passiert, wenn ein Exemplar beschädigt ankommt?

Kontaktieren Sie uns, wir helfen Ihnen beim Zugriff auf die Datei oder stellen Ihnen bei Bedarf einen Ersatz-Download zur Verfügung.

Rezensionen

4.6★★★★★ 19 Bewertungen
5★84%4★11%3★3%2★1%1★1%
J Joana K. Verified
★★★★★Die Diagramme übernehmen die ErklärungDas Konzept gezeichnet zu sehen, bevor die Notation erschien, hat alles für mich verändert.
M Marcus T. Verified
★★★★★Eine Pflichtlektüre für meine KlasseDie Aufgabenblätter sind ordnungsgemäß benotet und die Lösungen sind vollständig.
Alle Rezensionen ansehen

Kunden haben auch heruntergeladen