- عنوان کتاب: Rearchitecting LLMs
- نویسنده: Pere Martra
- حوزه: مدل زبانی بزرگ
- سال انتشار: 2026
- تعداد صفحه: 450
- زبان اصلی: انگلیسی
- نوع فایل: pdf
- حجم فایل: 12.4 مگابایت
از خرید MEAP معماری مجدد LLM ها متشکریم. خوشحالم که در این مرحله اولیه پروژه با شما همراه هستم و مشتاقانه منتظر بازخورد شما هستم. این کتاب برای مهندسانی است که از LLM ها، چه متن باز و چه از طریق API ها، استفاده میکنند و میخواهند فراتر از تنظیم دقیق، معماریهای مدل را بهینه کنند. اگر با PyTorch آشنا هستید و در مورد اتفاقات درون یک ترانسفورماتور کنجکاو هستید، این کتاب برای شماست. ما از مفاهیمی که از قبل میدانید شروع میکنیم و شما را از طریق تکنیکهای بهینهسازی دقیق که در حال حاضر در تیمهای تحقیقاتی استفاده میشوند، راهنمایی میکنیم. اولین پروژه بهینهسازی من برای یک استارتاپ بود که زبان خشونتآمیز و تحلیل سیاسی را در اینترنت تشخیص میداد. مدل مبتنی بر DistilGPT2 آنها به خوبی کار کرد، اما تیم آنها نیاز داشت متن بیشتری را در زمان کمتری تجزیه و تحلیل کند. اعمال هرس و تقطیر دانش هفتهها طول کشید، زیرا اطلاعات در مقالات دانشگاهی پراکنده بود، بسیاری از آنها بدون کد قابل تکرار. آن بهینهسازی اولیه، دنیایی جذاب را گشود. من به طور فعال به دنبال پروژههای بهینهسازی بیشتری بودم. با پذیرش مدلهای متنباز مدرنتر توسط صنعت، چالش افزایش یافت: تکنیکهایی مانند هرس عرض در معماریهای GLU به طور ضعیفی مستندسازی شده بودند و من را مجبور کردند روشهای خودم را با ترکیب مقالاتی مانند “ShortGPT” با رویکردهای گستردهتر مانند “رویکرد Minitron” توسعه دهم. این کتاب برای حل این پراکندگی وجود دارد: یکپارچهسازی تکنیکهای دانشگاهی در یک خط لوله منسجم و کاربردی. در طول این کتاب، یاد خواهید گرفت که مدلهای عمومی را به راهحلهای بهینه برای نیازهای خاص خود تبدیل کنید. شما بر تکنیکهای هرس عمق و هرس عرض برای کاهش اندازه و افزایش سرعت، تقطیر دانش برای بازیابی دانش از دست رفته و LoRA برای تخصص دامنه تسلط خواهید یافت. شما سیستمهای بایپس توجه را پیادهسازی خواهید کرد که مدل را به صورت پویا تطبیق میدهند و هرس منصفانه را برای ساخت معماریهای عادلانهتر اعمال میکنند. بازخورد شما برای مفیدتر کردن این کتاب تا حد امکان اساسی است. هر فصل شامل یک بخش عملی با تمرینهای عملی است که برای شما طراحی شده است تا آنچه را که آموختهاید فوراً به کار ببرید. من شما را تشویق میکنم که سوالات، نتایج یا پیشنهادات خود را هم در انجمن بحث liveBook و هم در بخشهای بحث آماده شده برای این منظور در مخزن کد کتاب به اشتراک بگذارید. مشتاقانه منتظرم ببینم چطور این تکنیکهای بهینهسازی جراحی را در پروژههای خودتان به کار میبرید.
Thank you for purchasing the MEAP of Rearchitecting LLMs. I’m glad to have you on board and look forward to your feedback in this early stage of the project. This book is for engineers who use LLMs, whether open source or via APIs, and want to move beyond fine-tuning to optimize model architectures. If you have knowledge of PyTorch and curiosity about what happens inside a transformer, this book is for you. We’ll start from concepts you already know and guide you through surgical optimization techniques currently used in research teams. My first optimization project was for a startup detecting violent language and political analysis on the Internet. Their DistilGPT2-based model worked well, but their team needed to analyze more text in less time. Applying pruning and knowledge distillation took weeks, as the information was scattered across academic papers, many without reproducible code. That first optimization opened up a fascinating world. I began actively seeking more optimization projects. As the industry adopted more modern open source models, the challenge grew: techniques like width pruning in GLU architectures were poorly documented, forcing me to develop my own methods combining papers like “ShortGPT” with broader approaches like “The Minitron Approach”. This book exists to solve that fragmentation: unifying academic techniques into a coherent, practical pipeline. Throughout this book, you’ll learn to transform generic models into optimized solutions for your specific needs. You’ll master depth pruning and width pruning techniques to reduce size and increase speed, knowledge distillation to recover lost knowledge, and LoRA for domain specialization. You’ll implement attention bypass systems that adapt the model dynamically, and apply fair pruning to build more equitable architectures. Your feedback is fundamental to making this book as useful as possible. Each chapter includes a hands-on section with practical exercises designed for you to apply what you’ve learned immediately. I encourage you to share your questions, results or suggestions both in the liveBook discussion forum and in the discussion sections prepared for this purpose in the book’s code repository. I’m looking forward to seeing how you apply these surgical optimization techniques in your own projects.
این کتاب را میتوانید از لینک زیر بصورت رایگان دانلود کنید:
Download: Rearchitecting LLMs





نظرات کاربران