⏱ زمان مطالعه: 8 دقیقه
سیستم تورنیتین (Turnitin) معتبرترین سامانه بینالمللی برای شناسایی تشابهات متنی در مقالات، پایاننامهها و تکالیف دانشگاهی است. دانشگاههای تراز اول و نشریات معتبر تحت پوشش الزویر، اسپرینگر و وایلی پیش از داوری علمی، متن را از فیلتر این سامانه عبور میدهند تا اصالت نگارش مشخص شود. فرایند ارزیابی در این سامانه برخلاف باور رایج، بررسی اخلاقیِ قصدِ نویسنده نیست؛ تورنیتین صرفاً تطابق واژگان را در مقیاسی عظیم اندازهگیری میکند و خروجی را در قالب گزارش شباهت متنی ارائه میدهد.
نحوه عملکرد تورنیتین در تشخیص مشابهت متنی

الگوریتمهای تورنیتین با تطبیق رشتههای متنی کار میکنند. هنگامی که سندی در سامانه بارگذاری میشود، متن به بخشهای کوچکتر تجزیه شده و با سه مخزن اطلاعاتی وسیع مقایسه میگردد: پایگاه داده وب که شامل میلیاردها صفحه آرشیو شده و فعال اینترنتی است، مخزن مقالات چاپشده با همکاری ناشران بزرگ علمی از طریق پایگاه کراسرف (Crossref)، و مخزن دانشجویی که تکالیف و پایاننامههای ثبتشده توسط سایر دانشگاهها در سراسر جهان را در بر میگیرد.
این سامانه تفاوت بین ارجاع اصولی و کپیبرداری را با هوشمندی کامل تشخیص نمیدهد. اگر نویسندهای جملهای را از مقالهای دیگر کلمه به کلمه بازنویسی کند اما در گیومه قرار ندهد یا نقلقول مستقیم را به شکل استاندارد فرمتبندی نکرده باشد، سیستم آن را تشابه متنی شناسایی میکند. به همین دلیل، درصد بالای شباهت لزوماً به معنای عمل غیرقانونی یا سوءرفتار آگاهانه نیست، بلکه نقص در مهارت بازنویسی و ارجاعدهی را نشان میدهد.
مطلب مرتبط: thesis writing
فرض کنید پژوهشگری در بخش پیشینه تحقیق، تعریفی ساختاریافته از مدیریت ریسک مالی را بدون استفاده از علامت نقل قول در متن میآورد و تنها در انتهای بند نام نویسنده اصلی را ذکر میکند. تورنیتین این زنجیره ۱۸ کلمهای را دقیقاً تطابق داده و آن را خطای متنی اعلام میکند. اشتباه معمول دانشجویان این است که تصور میکنند ذکر منبع در انتهای بند برای متنِ کپیشده کفایت میکند؛ در حالی که سیستم ساختار زبانی را بررسی میکند نه فقط حضور رفرنس را. بررسی دقیق متن قبل از تحویل، اصلاح نقلقولها و بازنویسی ساختاری جملات، این خطاها را مرتفع میسازد.
تفاوت مخزن ذخیرهسازی مقالات و خطر خودسرقتعلمی

یکی از فنیترین تنظیمات سامانه تورنیتین، تعیین وضعیت مخزن سند (Repository Option) است. هنگام ارسال فایل از طریق پنل استاد یا داشبورد اختصاصی، گزینهای وجود دارد که مشخص میکند فایل ارسالی در پایگاه داده تورنیتین ذخیره شود یا خیر. این تنظیم معمولاً دو حالت دارد: مخزن استاندارد (Standard Repository) و بدون مخزن (No Repository).
مطلب مرتبط: اکسپت فوری مقاله
اگر استادی یا فردی سند شما را در حالت «مخزن استاندارد» بارگذاری کند، محتوای پایاننامه یا مقاله برای همیشه در حافظه تورنیتین میماند. اگر نویسنده چند روز بعد، نسخه نهایی را برای همان مجله یا دانشگاه ارسال کند، تورنیتین فایل دوم را با فایل ذخیرهشده خودش مقایسه کرده و شباهت متن را ۱۰۰ درصد نشان میدهد. این وضعیت اصطلاحاً نویسنده را با بحران خودسرقتعلمی (Self-plagiarism) مواجه میکند که رفع آن مستلزم مکاتبات پیچیده مدیر گروه با پشتیبانی سامانه است.
برای کنترل این خطر، هنگام استفاده از خدمات اشخاص ثالث یا پنلهای دانشگاهی پیش از تحویل رسمی، باید صراحتاً وضعیت No Repository انتخاب شده باشد. آزمودن وضعیت ذخیرهسازی از طریق بررسی گزارش ارسالی میسر است؛ اگر در بخش تنظیمات انتساب منبع، ارجاعی به سندی دقیقاً مشابه با نام خودتان مشاهده کردید، نشاندهنده ثبت قبلی در مخزن است.
تفسیر گزارش اصالتسنجی و شاخصهای رنگی

خروجی سامانه یک گزارش بصری همراه با کد رنگی و یک درصد نهایی موسوم به شاخص مشابهت (Similarity Index) است. این رنگها محدوده خطر را برای داوران و استادان مشخص میکنند:
مطلب مرتبط: لغو تعهد آموزش رایگان با پایان نامه
| کد رنگی | درصد مشابهت | وضعیت از نظر استانداردهای علمی |
|---|---|---|
| آبی (Blue) | ۰ درصد | بدون تطابق؛ گاهی نشاندهنده عدم اسکن صحیح متن است. |
| سبز (Green) | ۱ تا ۲۴ درصد | محدوده استاندارد و قابل قبول برای اغلب نشریات معتبر. |
| زرد (Yellow) | ۲۵ تا ۴۹ درصد | نیازمند بازنویسی جدی و کاهش تطابق در مبانی نظری. |
| نارنجی (Orange) | ۵۰ تا ۷۴ درصد | احتمال بالای رد مقاله (Reject) به دلیل کپیبرداری گسترده. |
| قرمز (Red) | ۷۵ تا ۱۰۰ درصد | سرقت علمی آشکار یا ذخیرهسازی قبلی متن در مخزن. |
مجلههای تراز اول جهان معمولاً شاخص مشابهت زیر ۱۵ درصد را ترجیح میدهند، مشروط بر آنکه شباهت با یک منبع منفرد بیشتر از ۱ تا ۲ درصد نباشد. اگر مقاله شما تشابه کل ۱۵ درصدی داشته باشد اما ۱۰ درصد آن مستقیماً از یک مقاله چاپشده دیگر استخراج شده باشد، ویرایشگر بدون ارسال به داوری، مقاله را به دلیل همپوشانی متمرکز پس میفرستد.
تنظیم فیلترهای ارزیابی تأثیر بسزایی در درصد نهایی دارد. سامانه امکانی فراهم کرده تا منابع پایانی (Bibliography)، نقلقولهای داخل گیومه (Quotes) و تطابقهای جزئی زیر چند واژه (Exclude matches) از محاسبه خارج شوند. پیش از داوری متن، اعمال این فیلترها نمایی واقعیتر از حجم اصیل اثر پژوهشی به دست میدهد.
مطلب مرتبط: سفارش شبیه سازی با آباکوس
تشخیص هوش مصنوعی در تورنیتین
با پیشرفت ابزارهای تولید متن مبتنی بر مدلهای زبانی مانند چتجیپیتی، تورنیتین قابلیت شناساگر متن هوش مصنوعی (AI Writing Detection) را به پلتفرم خود افزوده است. این ابزار به جای ردیابی صفحات وب موجود، ویژگیهای آماری متن نظیر پیچیدگی واژگان (Perplexity) و تغییرپذیری طول جملات (Burstiness) را تحلیل میکند. ماشینها جملاتی منظم، یکدست و با الگوهای پیشبینیپذیر مینویسند، در حالی که قلم انسان تنوع و شکستهای ساختاری دارد.
خطاهای سیستم در این بخش موضوعی چالشبرانگیز است؛ موارد مثبت کاذب (False Positives) زمانی رخ میدهد که نویسنده غیرانگلیسیزبان از الگوهای متنی بسیار رسمی و قالبهای ساختاری تکراری استفاده میکند و سیستم متن را به اشتباه تولید هوش مصنوعی تلقی مینماید. چنین وضعیتی برای محققانی که بدون استفاده از این ابزارها تنها متنی رسمی تدوین کردهاند، مشکلساز میشود.
مطلب مرتبط: نحوه پیدا کردن شکاف پژوهشی
اشتباه متداول این است که برخی افراد با افزودن عمدی غلطهای نگارشی یا استفاده از ابزارهای بازنویسی خودکار سعی در دور زدن الگوریتم دارند. این کار نه تنها امتیاز هوش مصنوعی را کاهش نمیدهد، بلکه متن را از حالت علمی خارج میکند. ساختار متن باید غنی، برگرفته از دادههای واقعی پژوهش و تحلیلهای عمیق انسانی باشد تا امتیاز اصالت بالا برود.
اصول بازنویسی برای کاهش تشابه متنی بدون تحریف دادهها
کاهش علمی شاخص مشابهت به فرآیندی تخصصی تحت عنوان پارافریز (Paraphrasing) متکی است. بازنویسی اصولی صرفاً جایگزینی کلمات با مترادفها نیست؛ تعویض واژگان در ساختار گرامری یکسان همچنان توسط فینگرپرینتینگ تورنیتین کشف میشود، زیرا توالی دستوری و نظم کلمات دستنخورده باقی مانده است.
- تغییر زاویه دید جمله؛ تبدیل ساختار مجهول به معلوم یا برعکس بدون به هم ریختن مفهوم اصلی دادهها.
- تجزیه جملات پیچیده و طولانی مقالات مرجع به دو یا سه جمله سادهتر همراه با تلفیق نظرات شخصی.
- تجمیع ایدههای دو یا سه مقاله متفاوت در یک بند تحلیلی، به جای نقل خط به خط یک مقاله واحد.
- ارائه دادههای عددی و توصیفی در قالب جدول یا نمودارهای اختصاصی، زیرا تورنیتین متون درون تصاویر را اسکن نمیکند.
به عنوان نمونه، اگر در مقالهای آمده باشد: «حرارت شدید باعث از بین رفتن بافت زیستی سلولها در کمتر از پنج دقیقه گردید»، بازنویسی غیراصولی تبدیل آن به «دمای بالا موجب تخریب بافت سلولی در کمینهای نزدیک به ۵ دقیقه شد» است که همچنان توسط تورنیتین علامتگذاری خواهد شد. روش صحیح بازنویسی تمرکز بر مفهوم است: «بررسیها نشان داد ساختار سلول توانایی مقاومت در برابر بار حرارتی وارده را در بازههای زمانی کوتاه از دست میدهد». این تغییر بنیادین الگو، خطر سرقت ادبی ناخواسته را خنثی میکند.
مطلب مرتبط: انجام شبیه سازی با اوپن فوم
تفاوت سامانه تورنیتین و آیتنتیکیت (iThenticate)
هر دو محصول متعلق به شرکت Turnitin LLC هستند، اما اهداف عملیاتی متفاوتی را دنبال میکنند. تورنیتین برای محیطهای آموزشی طراحی شده و پایگاه اصلی آن تکالیف کلاسی، پایاننامهها و مقالات دانشجویی است. در مقابل، آیتنتیکیت به طور اختصاصی برای ناشران حرفهای، محققان پسادکتری و اعضای هیئت علمی توسعه یافته است.
بانک دادههای نشریات در آیتنتیکیت به طور پیشفرض روی عدم ذخیرهسازی تمرکز دارد تا مقالات پژوهشگران در روند داوری پیش از چاپ در انبار داده ذخیره نشوند. با این حال، هر دو سیستم از هسته تطبیق متن و منابع غنی وب یکسانی استفاده میکنند. ارسال یک فایل به تورنیتین با شرط No Repository، نتیجهای به شدت نزدیک به پردازش همان فایل در سامانه آیتنتیکیت تولید خواهد کرد.
مطلب مرتبط: رد شدن پروپوزال در گروه
پرسشهای متداول
آیا تورنیتین زبان فارسی را پشتیبانی میکند؟
الگوریتم تورنیتین یونیکد متون فارسی را پردازش میکند و قادر است تطابق مقالات فارسی با وبسایتهای آنلاین و مقالات نمایه شده را استخراج نماید. با این وجود، به دلیل عدم اتصال رسمی به پایگاههای اطلاعاتی پایاننامههای داخلی ایران، پوشش آن در اسناد فارسی به گستردگی سامانههای بومی نظیر همانندجو نیست، اما برای مقالات ISI کاملاً استاندارد و ملاک عمل است.
آیا دانشجویان امکان خرید اکانت شخصی مستقیم از تورنیتین را دارند؟
خیر، تورنیتین اشتراک انفرادی ارائه نمیدهد. لایسنسهای این شرکت به طور اختصاصی به موسسات آموزشی، دانشگاهها و ناشران واگذار میشود. دسترسی دانشجویان صرفاً از طریق کلاسهایی که توسط اساتید ایجاد میشود یا پنلهای دارای مجوز پژوهشی امکانپذیر است.
آیا نقلقولهای داخل گیومه درصد تشابه را بالا میبرند؟
در حالت پیشفرض بله؛ سیستم متن درون گیومه را نیز به عنوان تطابق شناسایی میکند مگر اینکه در پنل کاربری استاد، فیلتر Exclude Quotes به صورت دستی فعال شده باشد. حتی با اعمال این فیلتر، استفاده افراطی از نقلقول مستقیم توصیه نمیشود و نباید بیش از پنج تا ده درصد کل مقاله را در بر بگیرد.


