بررسی سرقت ادبی با تورنیتین

بررسی سرقت ادبی با تورنیتین

⏱ زمان مطالعه: 8 دقیقه

سیستم تورنیتین (Turnitin) معتبرترین سامانه بین‌المللی برای شناسایی تشابهات متنی در مقالات، پایان‌نامه‌ها و تکالیف دانشگاهی است. دانشگاه‌های تراز اول و نشریات معتبر تحت پوشش الزویر، اسپرینگر و وایلی پیش از داوری علمی، متن را از فیلتر این سامانه عبور می‌دهند تا اصالت نگارش مشخص شود. فرایند ارزیابی در این سامانه برخلاف باور رایج، بررسی اخلاقیِ قصدِ نویسنده نیست؛ تورنیتین صرفاً تطابق واژگان را در مقیاسی عظیم اندازه‌گیری می‌کند و خروجی را در قالب گزارش شباهت متنی ارائه می‌دهد.

نحوه عملکرد تورنیتین در تشخیص مشابهت متنی

نحوه عملکرد تورنیتین در تشخیص مشابهت متنی

الگوریتم‌های تورنیتین با تطبیق رشته‌های متنی کار می‌کنند. هنگامی که سندی در سامانه بارگذاری می‌شود، متن به بخش‌های کوچک‌تر تجزیه شده و با سه مخزن اطلاعاتی وسیع مقایسه می‌گردد: پایگاه داده وب که شامل میلیاردها صفحه آرشیو شده و فعال اینترنتی است، مخزن مقالات چاپ‌شده با همکاری ناشران بزرگ علمی از طریق پایگاه کراس‌رف (Crossref)، و مخزن دانشجویی که تکالیف و پایان‌نامه‌های ثبت‌شده توسط سایر دانشگاه‌ها در سراسر جهان را در بر می‌گیرد.

این سامانه تفاوت بین ارجاع اصولی و کپی‌برداری را با هوشمندی کامل تشخیص نمی‌دهد. اگر نویسنده‌ای جمله‌ای را از مقاله‌ای دیگر کلمه به کلمه بازنویسی کند اما در گیومه قرار ندهد یا نقل‌قول مستقیم را به شکل استاندارد فرمت‌بندی نکرده باشد، سیستم آن را تشابه متنی شناسایی می‌کند. به همین دلیل، درصد بالای شباهت لزوماً به معنای عمل غیرقانونی یا سوءرفتار آگاهانه نیست، بلکه نقص در مهارت بازنویسی و ارجاع‌دهی را نشان می‌دهد.

مطلب مرتبط: thesis writing

فرض کنید پژوهشگری در بخش پیشینه تحقیق، تعریفی ساختاریافته از مدیریت ریسک مالی را بدون استفاده از علامت نقل قول در متن می‌آورد و تنها در انتهای بند نام نویسنده اصلی را ذکر می‌کند. تورنیتین این زنجیره ۱۸ کلمه‌ای را دقیقاً تطابق داده و آن را خطای متنی اعلام می‌کند. اشتباه معمول دانشجویان این است که تصور می‌کنند ذکر منبع در انتهای بند برای متنِ کپی‌شده کفایت می‌کند؛ در حالی که سیستم ساختار زبانی را بررسی می‌کند نه فقط حضور رفرنس را. بررسی دقیق متن قبل از تحویل، اصلاح نقل‌قول‌ها و بازنویسی ساختاری جملات، این خطاها را مرتفع می‌سازد.

تفاوت مخزن ذخیره‌سازی مقالات و خطر خودسرقت‌علمی

تفاوت مخزن ذخیره‌سازی مقالات و خطر خودسرقت‌علمی

یکی از فنی‌ترین تنظیمات سامانه تورنیتین، تعیین وضعیت مخزن سند (Repository Option) است. هنگام ارسال فایل از طریق پنل استاد یا داشبورد اختصاصی، گزینه‌ای وجود دارد که مشخص می‌کند فایل ارسالی در پایگاه داده تورنیتین ذخیره شود یا خیر. این تنظیم معمولاً دو حالت دارد: مخزن استاندارد (Standard Repository) و بدون مخزن (No Repository).

مطلب مرتبط: اکسپت فوری مقاله

اگر استادی یا فردی سند شما را در حالت «مخزن استاندارد» بارگذاری کند، محتوای پایان‌نامه یا مقاله برای همیشه در حافظه تورنیتین می‌ماند. اگر نویسنده چند روز بعد، نسخه نهایی را برای همان مجله یا دانشگاه ارسال کند، تورنیتین فایل دوم را با فایل ذخیره‌شده خودش مقایسه کرده و شباهت متن را ۱۰۰ درصد نشان می‌دهد. این وضعیت اصطلاحاً نویسنده را با بحران خودسرقت‌علمی (Self-plagiarism) مواجه می‌کند که رفع آن مستلزم مکاتبات پیچیده مدیر گروه با پشتیبانی سامانه است.

برای کنترل این خطر، هنگام استفاده از خدمات اشخاص ثالث یا پنل‌های دانشگاهی پیش از تحویل رسمی، باید صراحتاً وضعیت No Repository انتخاب شده باشد. آزمودن وضعیت ذخیره‌سازی از طریق بررسی گزارش ارسالی میسر است؛ اگر در بخش تنظیمات انتساب منبع، ارجاعی به سندی دقیقاً مشابه با نام خودتان مشاهده کردید، نشان‌دهنده ثبت قبلی در مخزن است.

تفسیر گزارش اصالت‌سنجی و شاخص‌های رنگی

تفسیر گزارش اصالت‌سنجی و شاخص‌های رنگی

خروجی سامانه یک گزارش بصری همراه با کد رنگی و یک درصد نهایی موسوم به شاخص مشابهت (Similarity Index) است. این رنگ‌ها محدوده خطر را برای داوران و استادان مشخص می‌کنند:

مطلب مرتبط: لغو تعهد آموزش رایگان با پایان نامه

کد رنگیدرصد مشابهتوضعیت از نظر استانداردهای علمی
آبی (Blue)۰ درصدبدون تطابق؛ گاهی نشان‌دهنده عدم اسکن صحیح متن است.
سبز (Green)۱ تا ۲۴ درصدمحدوده استاندارد و قابل قبول برای اغلب نشریات معتبر.
زرد (Yellow)۲۵ تا ۴۹ درصدنیازمند بازنویسی جدی و کاهش تطابق در مبانی نظری.
نارنجی (Orange)۵۰ تا ۷۴ درصداحتمال بالای رد مقاله (Reject) به دلیل کپی‌برداری گسترده.
قرمز (Red)۷۵ تا ۱۰۰ درصدسرقت علمی آشکار یا ذخیره‌سازی قبلی متن در مخزن.

مجله‌های تراز اول جهان معمولاً شاخص مشابهت زیر ۱۵ درصد را ترجیح می‌دهند، مشروط بر آنکه شباهت با یک منبع منفرد بیشتر از ۱ تا ۲ درصد نباشد. اگر مقاله شما تشابه کل ۱۵ درصدی داشته باشد اما ۱۰ درصد آن مستقیماً از یک مقاله چاپ‌شده دیگر استخراج شده باشد، ویرایشگر بدون ارسال به داوری، مقاله را به دلیل هم‌پوشانی متمرکز پس می‌فرستد.

تنظیم فیلترهای ارزیابی تأثیر بسزایی در درصد نهایی دارد. سامانه امکانی فراهم کرده تا منابع پایانی (Bibliography)، نقل‌قول‌های داخل گیومه (Quotes) و تطابق‌های جزئی زیر چند واژه (Exclude matches) از محاسبه خارج شوند. پیش از داوری متن، اعمال این فیلترها نمایی واقعی‌تر از حجم اصیل اثر پژوهشی به دست می‌دهد.

مطلب مرتبط: سفارش شبیه سازی با آباکوس

تشخیص هوش مصنوعی در تورنیتین

با پیشرفت ابزارهای تولید متن مبتنی بر مدل‌های زبانی مانند چت‌جی‌پی‌تی، تورنیتین قابلیت شناساگر متن هوش مصنوعی (AI Writing Detection) را به پلتفرم خود افزوده است. این ابزار به جای ردیابی صفحات وب موجود، ویژگی‌های آماری متن نظیر پیچیدگی واژگان (Perplexity) و تغییرپذیری طول جملات (Burstiness) را تحلیل می‌کند. ماشین‌ها جملاتی منظم، یکدست و با الگوهای پیش‌بینی‌پذیر می‌نویسند، در حالی که قلم انسان تنوع و شکست‌های ساختاری دارد.

خطاهای سیستم در این بخش موضوعی چالش‌برانگیز است؛ موارد مثبت کاذب (False Positives) زمانی رخ می‌دهد که نویسنده غیرانگلیسی‌زبان از الگوهای متنی بسیار رسمی و قالب‌های ساختاری تکراری استفاده می‌کند و سیستم متن را به اشتباه تولید هوش مصنوعی تلقی می‌نماید. چنین وضعیتی برای محققانی که بدون استفاده از این ابزارها تنها متنی رسمی تدوین کرده‌اند، مشکل‌ساز می‌شود.

مطلب مرتبط: نحوه پیدا کردن شکاف پژوهشی

اشتباه متداول این است که برخی افراد با افزودن عمدی غلط‌های نگارشی یا استفاده از ابزارهای بازنویسی خودکار سعی در دور زدن الگوریتم دارند. این کار نه تنها امتیاز هوش مصنوعی را کاهش نمی‌دهد، بلکه متن را از حالت علمی خارج می‌کند. ساختار متن باید غنی، برگرفته از داده‌های واقعی پژوهش و تحلیل‌های عمیق انسانی باشد تا امتیاز اصالت بالا برود.

اصول بازنویسی برای کاهش تشابه متنی بدون تحریف داده‌ها

کاهش علمی شاخص مشابهت به فرآیندی تخصصی تحت عنوان پارافریز (Paraphrasing) متکی است. بازنویسی اصولی صرفاً جایگزینی کلمات با مترادف‌ها نیست؛ تعویض واژگان در ساختار گرامری یکسان همچنان توسط فینگرپرینتینگ تورنیتین کشف می‌شود، زیرا توالی دستوری و نظم کلمات دست‌نخورده باقی مانده است.

  • تغییر زاویه دید جمله؛ تبدیل ساختار مجهول به معلوم یا برعکس بدون به هم ریختن مفهوم اصلی داده‌ها.
  • تجزیه جملات پیچیده و طولانی مقالات مرجع به دو یا سه جمله ساده‌تر همراه با تلفیق نظرات شخصی.
  • تجمیع ایده‌های دو یا سه مقاله متفاوت در یک بند تحلیلی، به جای نقل خط به خط یک مقاله واحد.
  • ارائه داده‌های عددی و توصیفی در قالب جدول یا نمودارهای اختصاصی، زیرا تورنیتین متون درون تصاویر را اسکن نمی‌کند.

به عنوان نمونه، اگر در مقاله‌ای آمده باشد: «حرارت شدید باعث از بین رفتن بافت زیستی سلول‌ها در کمتر از پنج دقیقه گردید»، بازنویسی غیراصولی تبدیل آن به «دمای بالا موجب تخریب بافت سلولی در کمینه‌ای نزدیک به ۵ دقیقه شد» است که همچنان توسط تورنیتین علامت‌گذاری خواهد شد. روش صحیح بازنویسی تمرکز بر مفهوم است: «بررسی‌ها نشان داد ساختار سلول توانایی مقاومت در برابر بار حرارتی وارده را در بازه‌های زمانی کوتاه از دست می‌دهد». این تغییر بنیادین الگو، خطر سرقت ادبی ناخواسته را خنثی می‌کند.

مطلب مرتبط: انجام شبیه سازی با اوپن فوم

تفاوت سامانه تورنیتین و آی‌تنتیکیت (iThenticate)

هر دو محصول متعلق به شرکت Turnitin LLC هستند، اما اهداف عملیاتی متفاوتی را دنبال می‌کنند. تورنیتین برای محیط‌های آموزشی طراحی شده و پایگاه اصلی آن تکالیف کلاسی، پایان‌نامه‌ها و مقالات دانشجویی است. در مقابل، آی‌تنتیکیت به طور اختصاصی برای ناشران حرفه‌ای، محققان پسا‌دکتری و اعضای هیئت علمی توسعه یافته است.

بانک داده‌های نشریات در آی‌تنتیکیت به طور پیش‌فرض روی عدم ذخیره‌سازی تمرکز دارد تا مقالات پژوهشگران در روند داوری پیش از چاپ در انبار داده ذخیره نشوند. با این حال، هر دو سیستم از هسته تطبیق متن و منابع غنی وب یکسانی استفاده می‌کنند. ارسال یک فایل به تورنیتین با شرط No Repository، نتیجه‌ای به شدت نزدیک به پردازش همان فایل در سامانه آی‌تنتیکیت تولید خواهد کرد.

مطلب مرتبط: رد شدن پروپوزال در گروه

پرسش‌های متداول

آیا تورنیتین زبان فارسی را پشتیبانی می‌کند؟

الگوریتم تورنیتین یونی‌کد متون فارسی را پردازش می‌کند و قادر است تطابق مقالات فارسی با وب‌سایت‌های آنلاین و مقالات نمایه شده را استخراج نماید. با این وجود، به دلیل عدم اتصال رسمی به پایگاه‌های اطلاعاتی پایان‌نامه‌های داخلی ایران، پوشش آن در اسناد فارسی به گستردگی سامانه‌های بومی نظیر همانندجو نیست، اما برای مقالات ISI کاملاً استاندارد و ملاک عمل است.

آیا دانشجویان امکان خرید اکانت شخصی مستقیم از تورنیتین را دارند؟

خیر، تورنیتین اشتراک انفرادی ارائه نمی‌دهد. لایسنس‌های این شرکت به طور اختصاصی به موسسات آموزشی، دانشگاه‌ها و ناشران واگذار می‌شود. دسترسی دانشجویان صرفاً از طریق کلاس‌هایی که توسط اساتید ایجاد می‌شود یا پنل‌های دارای مجوز پژوهشی امکان‌پذیر است.

آیا نقل‌قول‌های داخل گیومه درصد تشابه را بالا می‌برند؟

در حالت پیش‌فرض بله؛ سیستم متن درون گیومه را نیز به عنوان تطابق شناسایی می‌کند مگر اینکه در پنل کاربری استاد، فیلتر Exclude Quotes به صورت دستی فعال شده باشد. حتی با اعمال این فیلتر، استفاده افراطی از نقل‌قول مستقیم توصیه نمی‌شود و نباید بیش از پنج تا ده درصد کل مقاله را در بر بگیرد.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

فرم مشاوره و ثبت سفارش

0 / 5000