معرفی یادگیری تقویتی نظارتی (SRL) گوگل: چهارچوبی نوین برای آموزش مدل‌های زبانی کوچک

توسط  10 آبان1404  بدون نظر
مقدمه با پیشرفت روزافزون فناوری‌های هوش مصنوعی، روش‌های جدیدی برای آموزش و بهبود مدل‌های زبانی معرفی می‌شوند. یکی از این روش‌ها، یادگیری تقویتی نظارتی (Supervised Reinforcement Learning یا SRL) است که به تازگی توسط یک تیم از محققان گوگل و دانشگاه UCLA رونمایی شده است. این روش به مدل‌های کوچک…

معرفی مدل‌های جدید OpenAI برای طبقه‌بندی ایمنی

توسط  09 آبان1404  بدون نظر
مقدمه با رشد سریع فناوری‌های هوش مصنوعی، ایمنی و امنیت در این حوزه به یکی از مهم‌ترین مسائل تبدیل شده است. OpenAI به تازگی پیش‌نمایش تحقیقاتی از دو مدل جدید خود برای طبقه‌بندی ایمنی با عنوان gpt-oss-safeguard را منتشر کرده است. این مدل‌ها به توسعه‌دهندگان این امکان را می‌دهد که…

ماوریک نگوین

200 فالوور

ماوریک نگوین نویسنده ای است که نقاشی می کند. او پرفروش‌ترین نویسنده «تعداد سال» است. Donec vitae tortor efficitur

برای خبرنامه روزانه مشترک شوید

لورم ایپسوم متن ساختگی با تولید سادگی نامفهوم از صنعت چاپ