آیا Turnitin متن ChatGPT را تشخیص میدهد؟ پاسخ صادقانه
پاسخ کوتاه این است: بله، Turnitin میتواند متن ChatGPT را تشخیص دهد، و متن ویرایشنشده هوش مصنوعی را قابلاعتمادتر از آنچه بیشتر دانشجویان انتظار دارند میگیرد. پاسخ کامل با هشدارهای مهمی درباره دقت، مثبتهای کاذب و آنچه استادان واقعاً میبینند همراه است. اینجا آنچه دادههای منتشرشده در سال ۲۰۲۶ میگویند آمده است.
پاسخ مستقیم: بله، با هشدارهای مهم
Turnitin از آوریل ۲۰۲۳ یک شاخص نگارش هوش مصنوعی را در گزارشهای شباهت خود گنجانده است، و این شاخص بهطور خاص برای شناسایی متن مدلهای زبانی بزرگ مانند ChatGPT ساخته شده است. اگر پاسخ ChatGPT را مستقیماً در یک مقاله بچسبانید و آن را ارسال کنید، احتمال بسیار بالایی هست که Turnitin بیشتر آن را علامتگذاری کند. این بخش قطعی است.
هشدارها هم به همان اندازه اهمیت دارند. این شاخص یک برآورد آماری است، نه اثبات. تنها روی ارسالهایی اجرا میشود که حداقل شرایط را داشته باشند، که در حال حاضر دستکم ۳۰۰ کلمه نثر است. روی اسناد ترکیبی انسانی و هوش مصنوعی کماعتمادتر است، در سطح جمله مشکل مستند مثبت کاذب دارد، و خود Turnitin به استادان میگوید که امتیاز هرگز نباید تنها مبنای تصمیم درباره تخلف علمی باشد. پس آیا Turnitin میتواند هوش مصنوعی را تشخیص دهد؟ بله. آیا میتواند اثبات کند که شما از آن استفاده کردهاید؟ نه، و همین شکاف است که هر پرونده واقعی در آن تعیین تکلیف میشود.
شاخص نگارش هوش مصنوعی Turnitin چگونه کار میکند
Turnitin مقاله شما را با یک پایگاهداده از خروجیهای ChatGPT مقایسه نمیکند. در عوض، سند شما را به بخشهای همپوشان چند صد کلمهای تقسیم میکند، سپس هر جمله را بر اساس اینکه از نظر آماری چقدر قابلپیشبینی است امتیاز میدهد. مدلهای زبانی با انتخاب مکرر محتملترین کلمه بعدی مینویسند، که متنی بهطور غیرعادی نرم، یکنواخت و کمغافلگیری تولید میکند. نوشته انسانی نامرتبتر است: طول جملات متغیر است، انتخاب کلمات گاهی عجیب است، و ریتم بالا و پایین میرود.
دو سیگنالی که بیشتر این کار را پیش میبرند، پریشانی (perplexity) هستند، یعنی اینکه انتخاب کلمات شما چقدر قابلپیشبینی است، و انفجاری بودن (burstiness)، یعنی اینکه ساختار جملات شما چقدر متغیر است. اگر یک بخش بهطور مداوم نرم و بهطور مداوم یکنواخت باشد، مدل جملاتش را بهعنوان احتمالاً هوش مصنوعی علامت میزند. ما سازوکار را با جزئیات بیشتری در راهنمای خود درباره نحوه کار تشخیصدهندههای هوش مصنوعی پوشش دادهایم، اما نکته کلیدی ساده است: Turnitin اثر انگشت آماری نوشته ماشینی را تشخیص میدهد، نه محتوای هیچ چتبات مشخصی را.
امتیاز درصدی واقعاً چه معنایی دارد
عددی که استادان میبینند، درصد جملات واجد شرایط در سند شماست که مدل باور دارد توسط هوش مصنوعی تولید شدهاند. امتیاز ۴۰٪ به این معنا نیست که Turnitin با ۴۰٪ اطمینان میگوید شما تقلب کردهاید. یعنی تقریباً ۴۰٪ از جملات نثر شما از نظر مدل ماشیننوشته بهنظر رسیدهاند. اینها ادعاهای بسیار متفاوتیاند، و درهم آمیختنشان رایجترین اشتباه در جلسات تخلف است.
دانستن دو نکته ارزش دارد. نخست، Turnitin امتیازهای بین ۱٪ تا ۱۹٪ را با یک ستاره نشان میدهد، چون پژوهش خودش نشان داد که امتیازهای پایین بیشتر احتمال دارد شامل مثبتهای کاذب باشند، و برخی مؤسسات گزارشها را طوری تنظیم میکنند که این بازه را کاملاً پنهان کنند. دوم، این شاخص متنی را که واجد شرایط نیست نادیده میگیرد، مانند فهرستهای نقطهای، کد، جدولها و جملات بسیار کوتاه، بنابراین درصد تنها بخشی از سند شما را توصیف میکند.
تشخیص هوش مصنوعی Turnitin چقدر دقیق است؟
ادعای منتشرشده Turnitin این است که این شاخص نگارش هوش مصنوعی را با حدود ۹۸٪ دقت شناسایی میکند، در حالی که برای مقالاتی که بیش از ۲۰٪ متنشان توسط هوش مصنوعی تولید شده، نرخ مثبت کاذب در سطح سند را زیر ۱٪ نگه میدارد. این اعداد از آزمایشهای آزمایشگاهی خود Turnitin میآیند، و یک سناریوی مشخص را توصیف میکنند: متن هوش مصنوعی عمدتاً ویرایشنشده به نثر انگلیسی.
بررسی مستقل کمتر خوشایند بوده است. اندکی پس از عرضه، Turnitin پذیرفت که مثبتهای کاذب در سطح جمله بیشتر از انتظار بودهاند، نزدیک به ۴٪ در اسنادی با ترکیبی از نوشته انسانی و هوش مصنوعی. روزنامهنگارانی که این ابزار را در سال ۲۰۲۳ آزمایش کردند دریافتند که روی مقالههای ترکیبی میلغزد، بخشهای هوش مصنوعی را از دست میدهد و بخشهای انسانی را علامتگذاری میکند. و در اوت ۲۰۲۳، دانشگاه Vanderbilt این ویژگی را علناً غیرفعال کرد، با این استدلال که خطر مثبت کاذب برای عمل کردن بر پایه آن بیش از حد بالاست. خلاصه منصفانه دقت تشخیص هوش مصنوعی Turnitin: قوی روی خروجی خالص و ویرایشنشده ChatGPT، و بهطور معناداری ضعیفتر روی هر چیزی که بین این دو قرار میگیرد.
معلم شما واقعاً چه میبیند
دانشجویان معمولاً اصلاً نمیتوانند امتیاز هوش مصنوعی را ببینند. این شاخص در نمای استاد از گزارش شباهت بهصورت یک نشان درصدی کوچک، جدا از امتیاز سرقت ادبی، ظاهر میشود. با کلیک روی آن، گزارشی باز میشود که در آن جملات علامتگذاریشده برجسته شدهاند، با یک رنگ برای متنی که تولیدشده توسط هوش مصنوعی تشخیص داده شده و رنگی دیگر برای متنی که تولیدشده توسط هوش مصنوعی و سپس بازنویسیشده با یک ابزار تشخیص داده شده است.
اینکه استادان با آن صفحه چه میکنند بسیار متفاوت است. راهنمای خود Turnitin به آنها میگوید امتیاز را بهعنوان سیگنالی برای آغاز یک گفتوگو در نظر بگیرند، نه یک حکم، و بسیاری از دانشگاهها این احتیاط را در سیاستهای خود نوشتهاند. در عمل، امتیاز ۱۵٪ روی مقالهای که در بقیه موارد قوی است اغلب نادیده گرفته میشود، در حالی که امتیاز ۸۰٪ باعث بررسی دقیقتر تاریخچه پیشنویس، ارجاعات و مقایسه مقاله با نوشتههای پیشین شما میشود. عدد پرونده را باز میکند؛ یک انسان آن را میبندد.
آیا Turnitin متن بازنویسیشده یا انسانیسازیشده را تشخیص میدهد؟
گاهی بله، و اینجا همانجایی است که مسابقه تسلیحاتی جریان دارد. در سال ۲۰۲۴ Turnitin تشخیص بازنویسی هوش مصنوعی را اضافه کرد، لایهای که برای شناسایی متنی آموزش دیده که توسط یک مدل زبانی بزرگ تولید و سپس از یک ابزار بازنویسی عبور داده شده است. بازنویسی ارزان، یعنی جایگزینی مترادفها که ساختار اصلی جمله را دستنخورده نگه میدارد، دقیقاً همان چیزی است که این لایه میگیرد، چون اسکلت آماری متن ماشینی از تغییر کلمات جان سالم به در میبرد.
بازنویسی عمیقتر داستان دیگری است. وقتی ساختار جمله، ریتم و عبارتپردازی واقعاً بازسازی شوند، اثر انگشتی که تشخیصدهنده به آن تکیه میکند محو میشود. این تفاوت میان یک عبور از فرهنگ مترادفها و انسانیسازی واقعی است، و به همین دلیل است که یک انسانیساز رایگان هوش مصنوعی جدی به جای اینکه از شما بخواهد نتایج را با ایمان بپذیرید، امتیازهای تشخیص را پیش و پس از کار به شما نشان میدهد. آزمایش متن بازنویسیشده در برابر تشخیصدهندههای واقعی تنها راه صادقانه برای دانستن این است که آیا این دگرگونی مؤثر بوده یا نه.
آیا متن هوش مصنوعیای را که خودتان ویرایش کردهاید میگیرد؟
متن هوش مصنوعی که بهسبکی ویرایش شده معمولاً باز هم علامتگذاری میشود. تغییر چند کلمه، حذف یک مقدمه، یا جابهجایی دو پاراگراف آمار سطحجملهای را که تشخیصدهنده اندازه میگیرد تغییر نمیدهد، بنابراین بیشتر سند همچنان مثل نوشته ماشینی خوانده میشود. دانشجویان مرتباً از این موضوع شگفتزده میشوند: پانزده دقیقه صیقل دادن مثل کار واقعی حس میشود، اما بهسختی امتیاز را تکان میدهد.
متنی که بهشدت بازنویسی شده بسیار سختتر گرفته میشود، و Turnitin هم همین را میگوید. مستندات آن اشاره میکند که قابلیت اعتماد روی اسنادی با نویسندگی ترکیبی افت میکند، که دقیقاً دلیل وجود ستاره امتیاز پایین است. اگر از ChatGPT برای یک طرح کلی یا یک پیشنویس خام استفاده کردهاید و سپس هر جمله را با صدای خودتان، با مثالهای خودتان و پیوندهای خودتان بازنویسی کردهاید، متن نهایی از هر معیار آماری تا حد زیادی از آن شماست. تشخیصدهنده در یافتن نثر ماشینی خوب است. اما هیچ راهی برای دیدن ایدههای زیر آن ندارد.
GPT-4، Claude، Gemini: آیا مدل مهم است؟
کمتر از آنچه امید دارید. Turnitin تشخیصدهنده خود را روی خروجی مدلهای زبانی بزرگ بهعنوان یک دسته آموزش داد، نه روی یک محصول، و هر مدل گفتوگوی بزرگی همان عادت زیربنایی را دارد: پیشبینی محتملترین کلمه بعدی. خروجی پیشفرض GPT-4o، Claude و Gemini همگی همان اثر انگشت نرم و یکنواخت را دارند، و آزمایشها بهطور مداوم نشان میدهند که Turnitin وقتی متن ویرایشنشده باشد، هر سه را با نرخ بالا علامتگذاری میکند.
دو نکته ظریف واقعیاند. مدلهای تازهتر اندکی کمتر از متن GPT-3.5 که تشخیصدهنده در اصل روی آن تنظیم شده بود قابلپیشبینیاند، بنابراین نرخ تشخیص روی مدلهای پیشرو ممکن است کمی افت کند تا زمانی که Turnitin دوباره آموزش ببیند، که این کار را مرتباً انجام میدهد. و ترفندهای دستوردهی مانند "مثل انسان بنویس" یا "انفجاری بودن اضافه کن" سبک ظاهری را بسیار کمتر از آنچه مردم فکر میکنند تغییر میدهند، چون مدل زیر آن لباس مبدل همچنان کلمات با احتمال بالا را انتخاب میکند. عوض کردن چتبات یک راهبرد فرار از تشخیص نیست.
دانشجویان واقعاً چگونه علامتگذاری میشوند
امتیاز بالای هوش مصنوعی بهتنهایی بهندرت کسی را غرق میکند. پروندههای واقعی از یک زنجیره شواهد ساخته میشوند، و این شاخص تنها نخستین حلقه است. الگویی که استادان توصیف میکنند ثابت است: درصد بالا، بهعلاوه سندی بدون تاریخچه نسخهها، بهعلاوه نوشتهای که بهطور محسوسی صیقلیتر یا عمومیتر از کارهای پیشین دانشجوست، بهعلاوه مشکلات محتوایی مانند استدلالهای مبهم یا ارجاعاتی که وجود ندارند.
مورد آخر شایسته تأکید است. منابع جعلی مخربترین شاهد در پروندههای تخلف هوش مصنوعیاند، چون با سبک نگارش قابلتوضیح نیستند. با امتیاز یک تشخیصدهنده میتوان بحث کرد؛ اما با مقالهای که به آن ارجاع داده شده اما هرگز منتشر نشده نمیتوان. اگر اصلاً از ابزارهای هوش مصنوعی استفاده میکنید، در هر ظرفیت مجازی، هر منبع را دستی راستیآزمایی کنید، پیشنویسهایتان را نگه دارید، و با صدایی بنویسید که با بقیه کارتان هماهنگ باشد. دانشجویانی که گیر میافتند تقریباً هرگز فقط با درصد گیر نمیافتند.
اگر بهناحق متهم شدید چه باید کرد
مثبتهای کاذب رخ میدهند، و Turnitin هم آن را میپذیرد. پژوهشها همچنین نشان دادهاند که تشخیصدهندههای هوش مصنوعی بهعنوان یک دسته، نویسندگان غیربومی انگلیسی را با نرخ بالاتری علامتگذاری میکنند، احتمالاً چون انگلیسیِ سنجیده و آموختهشده معمولاً یکنواختتر و قابلپیشبینیتر است، دقیقاً همان ویژگیهایی که تشخیصدهندهها آنها را ماشینگونه میخوانند. اگر مقاله خود را صادقانه نوشتهاید و علامتگذاری شدهاید، موضعی قابلدفاع دارید، پس هراسان نشوید و به چیزی که انجام ندادهاید اعتراف نکنید.
پرونده شواهد خود را پیش از جلسه بسازید. تاریخچه نسخهها از Google Docs یا Word قویترین سند شماست، چون نشان میدهد مقاله در طول ساعتها جملهبهجمله رشد کرده است. یادداشتها، طرحهای کلی، تاریخچه پژوهش در مرورگر و نوشتههای نمرهگرفته پیشین را که سبک شما را نشان میدهند اضافه کنید. بخواهید که خود گزارش را ببینید، و به هشدارهای منتشرشده خود Turnitin اشاره کنید: ستاره روی امتیازهای پایین، نرخ مثبت کاذب در سطح جمله، و بیانیه صریح شرکت مبنی بر اینکه این شاخص نباید بهعنوان تنها شاهد استفاده شود. بیشتر مؤسسات فرایند تجدیدنظر دارند. با آرامش و بهصورت مکتوب از آن استفاده کنید.
پیش از ارسال، کارتان را بررسی کنید
اینجا ناکامی عملی است: دانشجویان نمیتوانند امتیاز هوش مصنوعی Turnitin را پیش از ارسال ببینند، بنابراین نخستین باری که میفهمید مشکلی هست اغلب بدترین لحظه ممکن است. راهحل جایگزین این است که ابتدا پیشنویس خود را در برابر تشخیصدهندههای مستقل آزمایش کنید. آنها با Turnitin یکسان نیستند، اما همان سیگنالهای آماری را اندازه میگیرند، و پیشنویسی که در چند تشخیصدهنده امتیاز پاک میگیرد بسیار بعید است که شاخص را روشن کند.
این دقیقاً همان چیزی است که Humanize AI برای آن ساخته شده است. متن خود را بچسبانید، یا یک فایل PDF یا DOCX بارگذاری کنید، و پیش از آنکه چیزی را تغییر دهید یک امتیاز احتمال هوش مصنوعی زنده از دو تشخیصدهنده مستقل میگیرید، سپس یک امتیاز تازه پس از انسانیسازی، در هر یک از ۴۰ زبان، بدون ثبتنام و بدون محدودیت کلمه. اگر امتیاز شما بیشتر از انتظار بود، راهنمای ما درباره نحوه دور زدن تشخیص هوش مصنوعی Turnitin شما را در پایین آوردن صادقانه آن راهنمایی میکند، طوری که بیشتر کار را صدای خودتان انجام دهد.
پرسشهای پرتکرار
آیا Turnitin مدل ChatGPT-4o و جدیدترین مدلها را تشخیص میدهد؟
بله. Turnitin تشخیصدهنده خود را مرتباً دوباره آموزش میدهد، و خروجی ویرایشنشده GPT-4o و دیگر مدلهای کنونی با نرخ بالا علامتگذاری میشود. مدلهای تازهتر اندکی کمتر قابلپیشبینیاند، اما نه بهاندازهای که بهطور قابلاعتماد از آن عبور کنند.
اگر متن ChatGPT را بازنویسی کنم، آیا Turnitin آن را تشخیص میدهد؟
اگر بازنویسی سطحی باشد، بله. تشخیص بازنویسی هوش مصنوعی Turnitin بهطور خاص متن ماشینیای را که مترادفهایش عوض شده هدف میگیرد. بازنویسی عمیق که ساختار و ریتم جمله را بازسازی میکند، علامتگذاریاش برای این ابزار بسیار سختتر است.
چه درصدی از هوش مصنوعی در Turnitin قابلقبول است؟
هیچ آستانه جهانیای وجود ندارد؛ هر مؤسسه سیاست خود را تعیین میکند. بسیاری از استادان امتیازهای زیر ۲۰٪ را نادیده میگیرند، چون خود Turnitin آن بازه را کماعتمادتر علامت میزند، در حالی که امتیازهای بالا معمولاً به جای جریمههای خودکار، یک گفتوگو را به دنبال دارند.
آیا معلم من میتواند بدون Turnitin بفهمد که از ChatGPT استفاده کردهام؟
اغلب، بله. یک جهش ناگهانی در پرداختگی، استدلالهای عمومی، ارجاعات جعلی و ناهماهنگی سبک با کارهای پیشین شما، همگی بدون هیچ نرمافزاری قابلمشاهدهاند. مصححان باتجربه بسیاری از پروندهها را فقط با خواندن میگیرند.
آیا Turnitin متن Claude و Gemini را هم تشخیص میدهد؟
بله. این تشخیصدهنده اثر انگشت آماریای را هدف میگیرد که همه مدلهای زبانی بزرگ در آن مشترکاند، نه یک محصول مشخص. خروجی پیشفرض Claude و Gemini با نرخی قابلمقایسه با ChatGPT علامتگذاری میشود.
ابزار رایگان انسانیسازی هوش مصنوعی را امتحان کنید
متن خود را بچسبانید و امتیاز هوش مصنوعی قبل/بعد را در چند ثانیه ببینید. بدون ورود، در هر زبانی کار میکند.
انسانیسازی متن