Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel FarrĂŠ
- Autorzy:
- Merve Noyan, Andrés Marafioti, Miquel FarrĂŠ
- Wydawnictwo:
- O'Reilly Media
- Ocena:
- Stron:
- 408
- Dostępne formaty:
-
ePubMobi
Opis
książki
:
Vision Language Models. Building VLMs with Hugging Face
Vision language models (VLMs) combine computer vision and natural language processing to create powerful systems that can interpret, generate, and respond in multimodal contexts. Vision Language Models is a hands-on guide to building real-world VLMs using the most up-to-date stack of machine learning tools from Hugging Face, Meta (PyTorch), NVIDIA (Cuda), and others, written by leading researchers and practitioners Merve Noyan, Miquel Farré, Andrés Marafioti, and Orr Zohar. From image captioning and document understanding to advanced zero-shot inference and retrieval-augmented generation (RAG), this book covers the full VLM application and development lifecycle.
Designed for ML engineers, data scientists, and developers, this guide distills cutting-edge VLM research into practical techniques. Readers will learn how to prepare datasets, select the right architectures, fine-tune and deploy models, and apply them to real-world tasks across a range of industries.
- Explore core model architectures and alignment techniques
- Train and fine-tune VLMs with Hugging Face, PyTorch, and others
- Deploy models for applications like image search and captioning
- Implement advanced inference strategies, from zero-shot to agentic systems
- Build scalable VLM systems ready for production use
O'Reilly Media - inne książki
Dzięki opcji "Druk na żądanie" do sprzedaży wracają tytuły Grupy Helion, które cieszyły sie dużym zainteresowaniem, a których nakład został wyprzedany.
Dla naszych Czytelników wydrukowaliśmy dodatkową pulę egzemplarzy w technice druku cyfrowego.
Co powinieneś wiedzieć o usłudze "Druk na żądanie":
- usługa obejmuje tylko widoczną poniżej listę tytułów, którą na bieżąco aktualizujemy;
- cena książki może być wyższa od początkowej ceny detalicznej, co jest spowodowane kosztami druku cyfrowego (wyższymi niż koszty tradycyjnego druku offsetowego). Obowiązująca cena jest zawsze podawana na stronie WWW książki;
- zawartość książki wraz z dodatkami (płyta CD, DVD) odpowiada jej pierwotnemu wydaniu i jest w pełni komplementarna;
- usługa nie obejmuje książek w kolorze.
Masz pytanie o konkretny tytuł? Napisz do nas: sklep@ebookpoint.pl
Książka drukowana

Oceny i opinie klientów: Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel FarrĂŠ
(0)