مرکز علوم و تحقیقات کامپیوتری علوم اسلامی به سفارش سازمان فناوری اطلاعات ایران، طبق استاندارد پیکره گفتمان PENN (Pensilvania)، به تهیه پیکرههای زبانی پرداخته و به عنوان خروجی نهایی طرح، 30 هزار جمله پیکره گفتمان که علاوه بر برچسبهای گفتمانی شامل برچسبهای اجزای کلام، نحوی و معنایی نیز هست، ارائه داده است.

به گزارش سیتنا به نقل از روابط عمومی و اموربین الملل سازمان فناوری اطلاعات ایران، دادههای بزرگ به فناوریهای فوقالعادهای برای پردازش دادههای عظیم در مجموعههای بزرگ نیازمند است تا بتواند در زمانی معقول پاسخگوی نیازها و اهداف تحلیل و پردازش دادهها باشد. این دادهها نحوه کار سازمانها و افراد را تحت تأثیر قرار میدهد.
