ODBIERZ TWÓJ BONUS :: »

Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel Farré

(ebook) (audiobook) (audiobook) Język publikacji: angielski
Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel Farré - okladka książki

Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel Farré - okladka książki

Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel Farré - audiobook MP3

Vision Language Models. Building VLMs with Hugging Face Merve Noyan, Andrés Marafioti, Miquel Farré - audiobook CD

Autorzy:
Merve Noyan, Andrés Marafioti, Miquel Farré
Ocena:
Bądź pierwszym, który oceni tę książkę
Stron:
408
Dostępne formaty:
     ePub
     Mobi
Ebook
228,65 zł 269,00 zł (-15%)
211,65 zł najniższa cena z 30 dni

Dodaj do koszyka Dostępny natychmiast po opłaceniu zakupu lub Kup na prezent Kup 1-kliknięciem

Przenieś na półkę

Do przechowalni

Vision language models (VLMs) combine computer vision and natural language processing to create powerful systems that can interpret, generate, and respond in multimodal contexts. Vision Language Models is a hands-on guide to building real-world VLMs using the most up-to-date stack of machine learning tools from Hugging Face, Meta (PyTorch), NVIDIA (Cuda), and others, written by leading researchers and practitioners Merve Noyan, Miquel FarrĂŠ, AndrĂŠs Marafioti, and Orr Zohar. From image captioning and document understanding to advanced zero-shot inference and retrieval-augmented generation (RAG), this book covers the full VLM application and development lifecycle.

Designed for ML engineers, data scientists, and developers, this guide distills cutting-edge VLM research into practical techniques. Readers will learn how to prepare datasets, select the right architectures, fine-tune and deploy models, and apply them to real-world tasks across a range of industries.

  • Explore core model architectures and alignment techniques
  • Train and fine-tune VLMs with Hugging Face, PyTorch, and others
  • Deploy models for applications like image search and captioning
  • Implement advanced inference strategies, from zero-shot to agentic systems
  • Build scalable VLM systems ready for production use

O'Reilly Media - inne książki

Zamknij

Przenieś na półkę
Dodano produkt na półkę
Usunięto produkt z półki
Przeniesiono produkt do archiwum
Przeniesiono produkt do biblioteki
Proszę czekać...
ajax-loader

Zamknij

Wybierz metodę płatności

Ebook
228,65 zł
Dodaj do koszyka
Zamknij Pobierz aplikację mobilną Ebookpoint