1. 実際に何が起こったのか
トラック座長たちは、すべての論文が「実質的に人間によって書かれた」ものであることを要求しました。彼らはPangramを使用し、デフォルト設定では提出物の42.7%がAI生成率90〜100%と判定されました。その後、ウィンドウサイズを小さく調整することで、このフラグ率を12.7%に下げました。
| 結果 | 論文数 | 割合 |
|---|---|---|
| 即座にリジェクト(異議不可) | 178 | 18.4% |
| 条件付き(証拠が必要) | 123 | 12.7% |
| 承認 | 668 | 68.9% |
22件の論文は、スコアが0.5を超えていたのに著者が「AI不使用」と申告しただけでリジェクトされました。空気を読む(KY - Kuuki Yomenai)ことができないAI検出器に、学術論文の運命が委ねられたのです。
2. トラック座長自身の論文スコアは24〜69%
コミュニティはトラック座長の最近の論文をPangramでテストしました。AI確率スコアは24%から69%でした。彼ら自身が提出者であれば、リジェクトの危機に直面していたでしょう。
3. 非ネイティブ(ESL)に対するバイアスの問題
2023年のスタンフォード大学の研究によると、非ネイティブスピーカーによって書かれたTOEFLエッセイの61.22%がAI生成として誤分類されました。構造化された非ネイティブの文章は、統計的にLLMの出力と似ているためです。
4. リジェクトされた場合のアドバイス
ブラックリストはありません。 これは不正行為として記録されるものではありません。ICLRやICMLなど、他の会議に自由に再提出できます。次回からは、Gitのコミット履歴のようにすべてのドラフトを保存し、たとえ些細なAIサポートであっても正直に申告することをお勧めします。