• امروز : سه شنبه - ۱۲ تیر - ۱۴۰۳

اخبار ویژه

نوآوری در ارائه خدمات بیمه ای با استفاده از ظرفیتهای الکترونیک یک ضرورت است اجرای طرح استعدادیابی ورزشی کارکنان بانک ملی ایران؛ به زودی بازدید مدیرعامل بانک سپه از نمایشگاه بین المللی الکامپ نسخه جدید متابانک موسسه اعتباری ملل با خدمات متمایز امکان بیمه صندوق امانات در بانک شهر برای مشتریان فراهم شد استاندار سیستان و بلوچستان در دیدار با مدیران بانکی و معاونین استانداری از مدیر بانک صنعت و معدن این استان تقدیر کرد اداره کل حسابداری و امور سهام پست بانک ایران؛ سهامداران بانک برای دریافت سود و مطالبات، اطلاعات خود را در سامانه سجام تکمیل کنند پست بانک ایران رتبه سوم را در دهمین دوره ارزیابی کیفیت خدمات الکترونیکی دستگاه‌های اجرایی کشور کسب کرد رعایت اصول بنگاه‌داری و سودآوری مهم‌ترین اولویت بیمه رازی روز درخشان بیمه تجارت‌نو در نمایشگاه الکامپ مراسم تجلیل از برترین‌های پویش در امتداد همراهی ویژه بیمه‌های زندگی بیمه ملت برگزار شد/ یزدان‌دوست: بیمه‌های عمر، بخش بکر بازار با پتانسیل‌های فراوان است

0

رونمایی از مدل‌های زبانی فارسی همراه اول با حضور وزیر ارتباطات

  • کد خبر : 90936
  • 09 تیر 1403 - 20:13
رونمایی از مدل‌های زبانی فارسی همراه اول با حضور وزیر ارتباطات

مدل‌های زبانی فارسی توسعه یافته توسط همراه اول که با هوش مصنوعی قادر به تحلیل و یادگیری حجم زیادی از داده‌های متنی هستند، با حضور وزیر ارتباطات در الکامپ ۱۴۰۳، رونمایی شدند.

به گزارش رویداد خبر به نقل از اداره کل ارتباطات شرکت ارتباطات سیار ایران، گروه MCINext همراه اول در نخستین روز برگزاری نمایشگاه بین المللی الکامپ ۱۴۰۳، تعدادی از مدل های زبانی توسعه یافته خود شامل سیلک (با ۱٫۳میلیارد پارامتر)، آهوران (با ۸ میلیارد پارامتر) و آوا (با ۱۳ میلیارد پارامتر) را با حضور عیسی زارع پور وزیر ارتباطات و فناوری اطلاعات در سالن اختصاصی همراه اول (سالن ۳۵)، رونمایی کرد.

مدل های زبانی بزرگ (LLM)، سیستم های هوش مصنوعی هستند که با تحلیل و یادگیری از حجم زیادی از داده های متنی، قادر به تولید متن، ترجمه، پاسخ به سوالات و انجام وظایف مختلف زبانی هستند و در حال حاضر نیز با حمایت مرکز تحقیق و توسعه همراه اول توسعه یافته اند.

مدل زبانی سیلک که از پایه (from scratch) با مجموعه دادگان فارسی در این شرکت آموزش داده شده است، با وجود تعداد پارامتر نسبتا کم، قابلیت زبانی خوبی را به نمایش می گذارد که با ادامه فرآیند آموزش در آینده، از لحاظ دانش نیز بهتر خواهد شد.

مدل آهوران بر پایه مدل چند زبانه Llama3 شرکت Meta و به صورت آموزش ادامه دار (continual pretraining)  بر روی یک مجموعه دادگان فارسی توسعه داده شده است. با توجه به قابلیت های زیاد مدل پایه، ادامه آموزش، باعث تقویت تولید متن به زبان فارسی شده در حالیکه قابلیت های دیگر مدل تا حد زیادی حفظ شده است.

کاربردهای تجاری این مدل ها بسیار گسترده و نظیر تولید محتوای متنی خودکار، پشتیبانی مشتریان از طریق چت بات ها، تحلیل احساسات و نظرات کاربران در شبکه های اجتماعی و ایجاد ابزارهای کمکی برای نویسندگان و مترجمان است. این مدل ها می توانند به شرکت ها در افزایش بهره وری، کاهش هزینه ها و بهبود تجربه مشتری کمک کنند.

مدل آوا به منظور پاسخگویی از داخل یک متن داده شده (context) و بر پایه مدل aya از شرکت cohere  توسعه داده شده است.

بر خلاف دو مدل قبلی که جوابگوی سوالات کلی هستند، این مدل نیازمند ارایه اطلاعات اولیه برای پاسخگویی است (RAG) و تا حد امکان از ارائه اطلاعات استفاده شده در حین آموزش پرهیز می کند؛ استفاده اصلی این مدل در ربات های پاسخگوی خاص منظوره است.

علاوه بر آموزش این مدل ها، تلاش شده است تا به کمک روش های همترازسازی (RLHF و DPO) از تولید محتوای آسیب زا جلوگیری شود.

گروه MCINext همراه اول تلاش دارد تا در آینده نزدیک امکان استفاده عمومی از این مدل ها را نیز فراهم کند.

لینک کوتاه : http://rooydadkhabar.ir/?p=90936

ثبت دیدگاه

مجموع دیدگاهها : 0در انتظار بررسی : 0انتشار یافته : ۰
قوانین ارسال دیدگاه
  • دیدگاه های ارسال شده توسط شما، پس از تایید توسط تیم مدیریت در وب منتشر خواهد شد.
  • پیام هایی که حاوی تهمت یا افترا باشد منتشر نخواهد شد.
  • پیام هایی که به غیر از زبان فارسی یا غیر مرتبط باشد منتشر نخواهد شد.