آ
آموزش LLM و VLM
/llm_huggingface

آموزش LLM و VLM

/aiar🔥 +20+0.7%/wk
Open in Telegram  →
2.7Ksubscribers
3.3Kavg reach
120.9%ER
0.1posts/day

charts · trends

2,690
+110(+4.26%)
Jul 2 – Jul 21 · 6

📨 Recent posts

32 total

🚀 مون‌شات از کیمی K3 رونمایی کرد شرکت چینی Moonshot AI امروز قدرتمندترین مدل پرچمدار خودش، Kimi K3، رو رسما معرفی کرد. 🔹 پنجره‌ی زمینه تا ۱ میلیون توکن 🔹 بهبود قابل‌توجه در کدنویسی، تولید سه‌بعدی و وظایف دانشی پیچیده 🔹 طبق برخی نشت‌ها و تست‌های کاربران، حدود ۲.۵ تریلیون پارامتر دارد (این رقم هنوز رسما تأیید نشده) 🔹 در برخی بنچمارک‌های کدنویسی از GPT-5.5 جلو زده این عرضه فقط ۳ ماه بعد از متن‌باز ش…

4d ago👁 2.4Kopen

پارت ۱ تو دوره‌ی LLM مکتب‌خونه با مفهوم knowledge distillation آشنا شدیم؛ ایده‌ی ساده و آشنا: یه مدل معلمِ بزرگ و گرون، یه مدل دانش‌آموزِ کوچیک‌تر رو آموزش می‌ده تا رفتارش رو تقلید کنه. اما واقعیت اینه که این روش خیلی متنوع‌تره. تو پست زیر نشون می‌ده مدل‌های…

12d ago👁 1.8Kopen

پارت ۱ تو دوره‌ی LLM مکتب‌خونه با مفهوم knowledge distillation آشنا شدیم؛ ایده‌ی ساده و آشنا: یه مدل معلمِ بزرگ و گرون، یه مدل دانش‌آموزِ کوچیک‌تر رو آموزش می‌ده تا رفتارش رو تقلید کنه. اما واقعیت اینه که این روش خیلی متنوع‌تره. تو پست زیر نشون می‌ده مدل‌های فرانتیر ۲۰۲۶ دقیقاً از چه نسخه‌هایی از distillation استفاده می‌کنن: 1️⃣ معلم بزرگ و دانش‌آموز کوچیک (روش کلاسیک): مثل Gemma 3 و DeepSeek-R1-…

12d ago👁 1.8Kopen

مدل SenseNova-Vision-7B-MoT از تیم SenseNova برخلاف VLM های معمول (مثل Qwen-VL) که فقط تصویر می‌گیرن و متن تولید می‌کنن، این مدل هم متن تولید می‌کنه هم تصویر — یعنی می‌تونه خروجی‌هایی مثل نقشه عمق، ماسک سگمنتیشن یا نقشه نقاط سه‌بعدی رو مستقیماً و بدون هد اختصاصی برای هر تسک بسازه - تشخیص اشیا، لوکالیزیشن، OCR، گراندینگ رابط کاربری، کی‌پوینت - تخمین عمق و نرمال سطح - سگمنتیشن (رفرنسی، استدلالی، تع…

12d ago👁 2.3Kopen

مدل LocateAnything از NVIDIA؛ حذف یکی از بزرگ‌ترین گلوگاه‌های مدل‌های Vision-Language مدل جدید LocateAnything انویدیا مشکل کندی مدل‌های تشخیص اشیاء رو با یه ایده ساده و هوشمندانه حل کرده: Parallel Box Decoding (PBD) . مسئله چی بود؟ مدل‌های VLM معمولاً مختصات هر باکس (x1,y1,x2,y2) رو توکن به توکن و به‌صورت متوالی تولید می‌کنن. وقتی صحنه پر از اشیاء باشه (مثلاً ۱۰۰ آبجکت)، این یعنی هزاران توکن قبل…

17d ago👁 2.4Kopen

📊 بهره‌وری توکن در Agent Arena بنچ مارک Agent Arena عملکرد ایجنت‌های هوش مصنوعی رو روی تسک‌های واقعی (نوشتن کد، ساخت اسلاید، تحقیق وب، توسعه اپ، تحلیل اسناد) با ابزارهای search، filesystem و terminal می‌سنجه. نکته کلیدی اینه که مصرف توکن بیشتر همیشه به کیفیت بهتر منجر نمی‌شه. این نمودار هر مدل را نشون می‌ده بهبود عملکرد (عمودی) در برابر میانه توکن مصرفی (افقی) — و یک خط روند کلی ترسیم می‌کنه. فاص…

21d ago👁 455open

https://github.com/huggingface/peft/blob/main/examples/mica_finetuning/README.md

21d ago👁 342open

روش MiCA جایگزین قدرتمند LoRA در Fine-tuning یه روش جدید به اسم MiCA یا (MinoCA Component Adaptation) به کتابخونه PEFT هاگینگ‌فیس اضافه شده و نتایجش چشمگیره. ایده اصلی تکنیک LoRA روی بخش‌هایی از مدل تمرکز می‌کنه که بیشترین استفاده رو دارن. MiCA برعکس عمل می‌کنه — روی فضاهای کمتر استفاده‌شده (minor singular subspace) تنظیم می‌کنه تا دانش جدید جذب بشه بدون اینکه دانش قبلی از بین بره. نتایج روی ۳ مد…

21d ago👁 985open

🖼️ Krea 2 Turbo مدل تولید تصویر اوپن‌سورس با ۱۲ میلیارد پارامتر مجپوعه Krea AI اولین مدل بومی خودش رو منتشر کرد و وزن‌ها رو هم اوپن‌سورس کرده. ✨ چرا جالبه؟ ▸ تولید تصویر ۲K در ~۲ ثانیه روی GPU معمولی ▸ فقط ۸ inference step، بدون CFG ▸ رتبه اول بین لب‌های مستقل در لیدربورد Artificial Analysis ▸ اختلاف تنها ۰.۱۴ امتیاز با GPT Image در style fidelity 🔗 لینک‌ها HuggingFace: https://huggingface.co/kre…

22d ago👁 1.6Kopen

🦅 مدل Ornith-1.0 — مدل متن‌باز با قابلیت خودبهبودی برای Agentic Coding یه خانواده مدل جدید از DeepReinforce که روی کدنویسی عاملی (Agentic Coding) تخصص داره. از نسخه 9B برای edge devices تا 397B در مقیاس frontier. 🧠 نوآوری اصلی: به‌جای اینکه scaffold کدنویسی رو انسان طراحی کنه، مدل با RL هم راه‌حل و هم scaffold رو خودش یاد می‌گیره و هر دو رو با هم بهینه می‌کنه — یعنی هر بار بهتر می‌شه. 📊 نسخه 35B…

22d ago👁 580open

🗂️ تبدیل اسناد به چانک‌های آماده برای RAG با Chunkr یه ابزار متن‌باز برای پردازش هوشمند اسناد؛ PDF، PowerPoint، Word و تصویر رو می‌گیره و خروجی ساختاریافته برای پایپ‌لاین‌های RAG و LLM تولید می‌کنه. ✅ تحلیل لایه‌بندی سند با OCR و Bounding Box ✅ خروجی HTML و Markdown ساختاریافته ✅ پردازش با مدل‌های Vision-Language ✅ Self-hosted با Docker Compose و پشتیبانی از LLMهای مختلف 🔗 مستندات: https://docs.c…

22d ago👁 1.6Kopen

فاین تیون کردن مدل‌های MoE با یه خط کد، ۳.۷ برابر سریع‌تر! اخیرا NVIDIA یه کتابخونه open-source معرفی کرده به اسم NeMo AutoModel که روی Transformers v5 هاگینگ‌فیس ساخته شده. فقط یه خط import عوض می‌شه: 🔹 تا ۳.۷ برابر throughput بالاتر 🔹 تا ۳۲٪ حافظه GPU کمتر 🔹 امکان fine-tune مدل ۵۵۰B که با Transformers خالص اصلاً در حافظه جا نمی‌شه سه تکنیک به کار برده: Expert Parallelism، DeepEP fused dispatch،…

25d ago👁 3Kopen

channel description

آموزش تخصصی LLM و Hugging face گروه مباحثه: @llm_group

channel info

Telegram ID
Indexed sinceJun 24, 2026
Last refreshedJul 20, 2026

similar channels/ai

support