← Field Notes

NeurIPSは「AI生成」を理由に178件の論文をデスクリジェクト。しかし、AI検出器はトラック座長の論文もフラグ付けしていた。

StrictCite Field Notes  ·  2026年9月8日
English  ·  Deutsch  ·  Русский  ·  日本語  ·  한국어
ポジションペーパートラックの査読は現在も進行中です。ここに記載されているのは、現在確認可能な事実のみです。
概要

2026年6月、NeurIPSのポジションペーパートラックは、Pangramという独自のAIテキスト検出ツールを使用して969件の提出物をスクリーニングしました。178件(トラックの18.4%)が、異議申し立ての機会を与えられずに即座にリジェクトされました。「根回し(Nemawashi)」の文化もここでは通用しません。さらに123件が、証拠を提出しなければリジェクトされるという条件付きの通知を受けました。しかし、研究者たちがトラック座長自身の最近の論文を同じ検出器にかけたところ、スコアは24%から69%という結果でした。検出器そのものがハンコ(Hanko)をもらえないレベルかもしれません。

1. 実際に何が起こったのか

トラック座長たちは、すべての論文が「実質的に人間によって書かれた」ものであることを要求しました。彼らはPangramを使用し、デフォルト設定では提出物の42.7%がAI生成率90〜100%と判定されました。その後、ウィンドウサイズを小さく調整することで、このフラグ率を12.7%に下げました。

結果 論文数 割合
即座にリジェクト(異議不可)17818.4%
条件付き(証拠が必要)12312.7%
承認66868.9%

22件の論文は、スコアが0.5を超えていたのに著者が「AI不使用」と申告しただけでリジェクトされました。空気を読む(KY - Kuuki Yomenai)ことができないAI検出器に、学術論文の運命が委ねられたのです。

2. トラック座長自身の論文スコアは24〜69%

コミュニティはトラック座長の最近の論文をPangramでテストしました。AI確率スコアは24%から69%でした。彼ら自身が提出者であれば、リジェクトの危機に直面していたでしょう。

3. 非ネイティブ(ESL)に対するバイアスの問題

2023年のスタンフォード大学の研究によると、非ネイティブスピーカーによって書かれたTOEFLエッセイの61.22%がAI生成として誤分類されました。構造化された非ネイティブの文章は、統計的にLLMの出力と似ているためです。

4. リジェクトされた場合のアドバイス

ブラックリストはありません。 これは不正行為として記録されるものではありません。ICLRやICMLなど、他の会議に自由に再提出できます。次回からは、Gitのコミット履歴のようにすべてのドラフトを保存し、たとえ些細なAIサポートであっても正直に申告することをお勧めします。

References

  1. [1] Call for Position Papers. NeurIPS 2026. neurips.cc/Conferences/2026/CallForPositionPapers
  2. [2] Rügamer, D., Lu, A. X., & Lazar, S. NeurIPS 2026 Position Paper Track: AI-Use Policy and Screening Results. Published on neurips.cc. neurips.cc/Conferences/2026/PositionPaperTrackBlog
  3. [3] Community discussion, r/MachineLearning and X (formerly Twitter), June–July 2026. Multiple independent reports of track chairs' papers scoring 24–69% on the same Pangram detector.
  4. [4] Pangram 4 Technical Report. Pangram Labs, July 2026. Vendor-reported AUROC 0.9916, FPR 0.0041%. pangram.io
  5. [5] Who Wrote This? Evaluating the Reliability of AI Detection Tools in Higher Education. (2026). Comparative study of 160 documents across commercial detectors including Pangram, GPTZero, Copyleaks and Turnitin.
  6. [6] Phantom References: Hallucinated Citations That Survive Peer Review at Top-Tier Conferences. arXiv:2607.00738. arxiv.org/abs/2607.00738
  7. [7] StrictCite Field Notes. NeurIPS Started Desk-Rejecting Papers Over References That Don't Exist. strictcite.com/blog/neurips-2026-hallucinated-citations-desk-reject
  8. [8] Liang, W., Yuksekgonul, M., Mao, Y., Wu, E., & Zou, J. (2023). GPT detectors are biased against non-native English writers. Patterns, 4(7), 100779. doi.org/10.1016/j.patter.2023.100779