{"as_of":"2026-08-08T08:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1eba4f20a95f4ce965d5d4d47e4b4817dd1908422b123cf4f49a44ec51748b6b","coverage":[{"denominator":111,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:55:15.691408Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:54:51.091578Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T23:54:56.588252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"cited_work":{"arxiv_id":"2506.11059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.11059","snapshot_observed_at":"2026-08-06T23:54:56.588252Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","venue":"cs.SE","work_id":"0a8d9e70-189d-4186-b18c-968ee59c28e2","year":2025},"citing_paper":{"arxiv_id":"2506.17323","last_updated":"2025-06-18T19:49:41Z","snapshot_observed_at":"2026-08-07T03:59:50.891767Z","submitted_at":"2025-06-18T19:49:41Z","title":"I Know Which LLM Wrote Your Code Last Summer: LLM generated Code Stylometry for Authorship Attribution","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T23:54:51.091578Z"},"links":{"cited_paper":"/paper/2506.11059","citing_paper":"/paper/2506.17323"},"observation_digest":"sha256:0c16106ba63be66fd46ba9d26373434778f5a0d3d61a67b3c119f17937bff820","observation_id":"1ed2e67d-6f24-4557-8c0c-03900d823793","resolution":{"observed_at":"2026-08-06T23:54:56.716112Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11059/citation-record","integrity":"/paper/2506.11059/integrity","json":"/paper/2506.11059/citation-record.json","paper":"/paper/2506.11059"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:54:46.476756Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.476756Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:5df9e050d0ba82eefbb5142bbfcb52497b136f545da01c30bd0c6b96fc6b8177","observation_id":"65788c0f-6182-4abf-b3a8-2ea9b74c138c","resolution":{"observed_at":"2026-08-07T13:54:46.476756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01423","last_updated":"2023-09-27T12:44:12Z","snapshot_observed_at":"2026-08-06T21:57:01.534597Z","submitted_at":"2023-09-27T12:44:12Z","title":"An Empirical Study of AI Generated Text Detection Tools","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01423","snapshot_observed_at":"2026-08-07T13:54:46.570106Z","title":"An empirical study of ai generated text detection tools.arXiv preprint arXiv:2310.01423, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.570106Z"},"links":{"cited_paper":"/paper/2310.01423","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:4a852474722d6f889ce638ccb705d88114cfd223c69739575ed878f406793920","observation_id":"75df5980-73d5-411e-8495-bbdb621b2640","resolution":{"observed_at":"2026-08-07T13:54:46.570106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.633741Z","title":"Introducing computer use, a new claude 3.5 sonnet, and claude 3.5 haiku, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.633741Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9fb801d1884a2b861279014d3e504d9d96d332c4095d02bbae831c6e8c2937cf","observation_id":"908da8b7-9eeb-4478-9439-254c9cab0d7e","resolution":{"observed_at":"2026-08-07T13:54:46.633741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.720560Z","title":"Claude 3.7 Sonnet and Claude Code, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.720560Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:87757921a2994d1b485f84a350a48d6fb8f4190f8a9991fa7cb6f47d6a406155","observation_id":"a7846d60-9b79-475a-9822-16282d44c1d2","resolution":{"observed_at":"2026-08-07T13:54:46.720560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.811473Z","title":"Is github’s copilot as bad as humans at introducing vulnerabilities in code?Empirical Software Engineering, 28(6):129, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.811473Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:c6ffe9d2e069c43d89a12fdb9b7d1f412f463579e47740fff02156c22c17b150","observation_id":"c5a100e3-a86e-4296-89d1-260fca603978","resolution":{"observed_at":"2026-08-07T13:54:46.811473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.895270Z","title":"Random forests.Machine learning, 45:5–32, 2001","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.895270Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a753b62d41526632275a9c527c5bcffea3a5766cf76443cd28f6786eab00b1a0","observation_id":"c0a0349f-1f09-4419-bb99-36ab95a46fc6","resolution":{"observed_at":"2026-08-07T13:54:46.895270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:46.976947Z","title":"Membership inference attacks from first principles","venue":null,"work_id":null,"year":1914},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:46.976947Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:9b771366cdcb4731fbf6ecaf7d072362dfa72615aa784afbd7d354988e7934ab","observation_id":"f391913e-6860-425b-8fa2-3debfa1511e7","resolution":{"observed_at":"2026-08-07T13:54:46.976947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.063202Z","title":"R package version 3.0.1.1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.063202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b9d538f59ae1fb2563952ddf20b1565f931b0b570712833799920ad70af8d6a1","observation_id":"4e3022a3-1094-44a2-af28-e5090a1fb735","resolution":{"observed_at":"2026-08-07T13:54:47.063202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.129620Z","title":"Github code clean dataset, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.129620Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0025a9b5c5e6954a2a671a05ed9dae1a02b13c38250b76ba12e9d4fd20cf8c15","observation_id":"553cb2d9-df04-4555-913c-b75ef7780dab","resolution":{"observed_at":"2026-08-07T13:54:47.129620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.200058Z","title":"Github code dataset, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.200058Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:fcc7d95f996469a2c31ead16eaaad0918495145ab4605cf32fd031eb553f1c67","observation_id":"02afa950-9b55-48b6-b04f-744abf07e8c5","resolution":{"observed_at":"2026-08-07T13:54:47.200058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.294524Z","title":"Vulnerabilities in ai code generators: Exploring targeted data poisoning attacks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.294524Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b030a5e430ca0aae1a437270c5548debd58b38e5917c664a0372f696b2a2a4dc","observation_id":"f25dda91-c58c-43df-8202-91a4e16cfd1a","resolution":{"observed_at":"2026-08-07T13:54:47.294524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.393332Z","title":"Cursor: The AI Code Editor, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.393332Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d5406ba5b3b9ee9a625f5c9ae66603596899881c2d8a69d24ec03624ae585152","observation_id":"29e82846-deea-4d38-bd2e-2d9edfe7f36b","resolution":{"observed_at":"2026-08-07T13:54:47.393332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.467782Z","title":"Plagiarism in the age of massive generative pre-trained transformers (gpt-3).Ethics in Science and Environmental Politics, 21:17–23, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.467782Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:393f51d8d5797a36b9888152477372b44c9319b05bb800208e61600a9f63e419","observation_id":"1b0a11d0-a7f0-462f-8638-6c5988df77d1","resolution":{"observed_at":"2026-08-07T13:54:47.467782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16594","last_updated":"2025-05-25T09:15:33Z","snapshot_observed_at":"2026-07-06T20:11:24.538172Z","submitted_at":"2024-12-21T11:53:49Z","title":"AIGCodeSet: A New Annotated Dataset for AI Generated Code Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16594","snapshot_observed_at":"2026-08-07T13:54:47.550790Z","title":"Aigcodeset: A new annotated dataset for ai generated code detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.550790Z"},"links":{"cited_paper":"/paper/2412.16594","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:dc4e6a50f1473d1ee94412bf9766d1d1a8ec4a40a0dea922d453c915ea370fee","observation_id":"9338dc5a-b143-4bc3-821b-57e1450a2458","resolution":{"observed_at":"2026-08-07T13:54:47.550790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07397","last_updated":"2020-10-28T03:48:28Z","snapshot_observed_at":"2026-07-06T09:28:36.954658Z","submitted_at":"2020-06-12T18:15:55Z","title":"The DeepFake Detection Challenge (DFDC) Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07397","snapshot_observed_at":"2026-08-07T13:54:47.640002Z","title":"The deepfake detection challenge (dfdc) dataset.arXiv preprint arXiv:2006.07397, 2020","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.640002Z"},"links":{"cited_paper":"/paper/2006.07397","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ef8b904f8579c210e644f0826cba007e205afacc690a531739a7d254082164be","observation_id":"d7d6f9c8-d5dd-4eab-8e0f-659fe2ae56a6","resolution":{"observed_at":"2026-08-07T13:54:47.640002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.701676Z","title":"Codep: grammatical seq2seq model for general-purpose code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.701676Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f076d689893014abcd66a2b8477986f1e9663fd13317347e2078987035fa2def","observation_id":"8d87665b-4f0b-46c3-8a0e-7128c09be92f","resolution":{"observed_at":"2026-08-07T13:54:47.701676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12869","last_updated":"2023-03-22T19:01:25Z","snapshot_observed_at":"2026-08-07T18:07:20.986908Z","submitted_at":"2023-03-22T19:01:25Z","title":"JaCoText: A Pretrained Model for Java Code-Text Generation","version":1},"cited_work":{"arxiv_id":"2303.12869","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.12869","snapshot_observed_at":"2026-08-07T13:55:17.044546Z","title":"JaCoText: A Pretrained Model for Java Code-Text Generation","venue":"cs.CL","work_id":"a2676804-c2db-4198-b8fa-8d11aba7fb33","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.773655Z"},"links":{"cited_paper":"/paper/2303.12869","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7b261cde10ec518e8dfc84a3fc81065c46908b07c03ba736571c4fc390fe10a8","observation_id":"08fb92ab-8479-4797-be7c-5184de1e9f47","resolution":{"observed_at":"2026-08-07T13:55:17.120274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:47.862883Z","title":"Out of the bleu: how should we assess quality of the code generation models?Journal of Systems and Software, 203:111741, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.862883Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:108a1414b91b258fe068d798974fa4a7d818a32bb4975fdcd5c5765e549a553d","observation_id":"cc471623-5e94-487d-a09f-a0dd57b31ff3","resolution":{"observed_at":"2026-08-07T13:54:47.862883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08155","last_updated":"2020-09-18T15:38:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-19T13:09:07Z","title":"CodeBERT: A Pre-Trained Model for Programming and Natural Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08155","snapshot_observed_at":"2026-08-07T13:54:47.920730Z","title":"Codebert: A pre-trained model for programming and natural languages.https://arxiv.org/abs/2002.08155, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:47.920730Z"},"links":{"cited_paper":"/paper/2002.08155","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:58db038a4f32f5be5190ee4e841852e915d856e01f092ef2123caa0432cafd32","observation_id":"11467041-3d7d-44fc-acf8-15269374ff63","resolution":{"observed_at":"2026-08-07T13:54:47.920730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.011427Z","title":"Introducing GitHub Copilot: your AI pair programmer, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.011427Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0a31a134e41208b0df9d8220cc1d403912f963e05c9659cb20af325831facc8c","observation_id":"21847269-8275-48a4-b353-0e7bb165121f","resolution":{"observed_at":"2026-08-07T13:54:48.011427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.070030Z","title":"What makes good in-context demonstrations for code intelligence tasks with llms? InIEEE/ACM International Conference on Automated Software Engineering (ASE), pages 761–773, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.070030Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:85ef045b85eda6f227d09755970b3881e5100a8998cf4614973201036fa95078","observation_id":"d7e6ddef-b792-4499-8ca8-05d7ac0df019","resolution":{"observed_at":"2026-08-07T13:54:48.070030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.124138Z","title":"Gltr: Statistical detection and visualization of generated text","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.124138Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d6753506aed49f112b4f5344df7251a0a1f2d091e6838fca7ad6d3965df2ed77","observation_id":"1528c165-1662-4f98-a82a-3165eaa55899","resolution":{"observed_at":"2026-08-07T13:54:48.124138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.246520Z","title":"A survey on the possibilities & impossibilities of ai-generated text detection.Transactions on Machine Learning Research (TMLR), 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.246520Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:477f1402296ee669f01d1bcd43dce2cbd6e58d13d92e7d9d75004137cc5cac8e","observation_id":"314297cd-8c44-4ef9-b4a0-4a1e554b2176","resolution":{"observed_at":"2026-08-07T13:54:48.246520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.359564Z","title":"Deepfake video detection using recurrent neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.359564Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:4154e3f67050bd5114284c7b65d72420257ace53d8577cf18ebe0f9d2b4a2cdc","observation_id":"b5aac917-e193-4767-ad10-2fbec12deecd","resolution":{"observed_at":"2026-08-07T13:54:48.359564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.449654Z","title":"Graphcodebert: Pre-training code representations with data flow","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.449654Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a7482614826609a003530c6265e19f1c16ec48c461fff6ba0e8d70867d2a0852","observation_id":"f13457b0-5431-42a2-b472-218cb58cd458","resolution":{"observed_at":"2026-08-07T13:54:48.449654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T13:54:48.545437Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.545437Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:bda770b616de9954c504d44567e8420dd83211c3462fea43e73b08967ce0dde8","observation_id":"05003157-91eb-4798-8360-04d2c36081b1","resolution":{"observed_at":"2026-08-07T13:54:48.545437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.665601Z","title":"Biscope: Ai-generated text detection by checking memorization of preceding tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.665601Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2829f92b4ec0705c1a8a705ad3af154e6a6f2ed302b84bdf1fe938f11f0c7a44","observation_id":"eb20765c-9e15-4507-8edc-b618ad05b088","resolution":{"observed_at":"2026-08-07T13:54:48.665601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.809631Z","title":"Spotting llms with binoculars: Zero-shot detection of machine-generated text","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.809631Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:43480d8632090f645314c033f5113c53074b3203e656fa9a66baf856e2b28ddc","observation_id":"c66b5304-5d20-4b43-abe3-3212d8cf7a90","resolution":{"observed_at":"2026-08-07T13:54:48.809631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:48.908202Z","title":"Denoising diffusion probabilistic models.Advances in Neural Information Processing Systems (NeurIPS), 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.908202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:fc422a488642314dc01cfb9be6c8deab1dac8baff4d42d2d325d99b2d1d2de17","observation_id":"5195c632-aa5c-4485-855a-96398f705a7d","resolution":{"observed_at":"2026-08-07T13:54:48.908202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T13:54:48.989561Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:48.989561Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f1679f92359c5e4f14cb3fc245a6974e87243732df63b826d2cef5cac3790ae0","observation_id":"83737ca2-14d0-46cf-85c5-01beb47d2d14","resolution":{"observed_at":"2026-08-07T13:54:48.989561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.120454Z","title":"Rethinking plagiarism in the era of generative ai.Journal of Intelligent Communication, 3(2):20–31, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.120454Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d02fa98314c99d78fdcd68ee8096c9a52f77b09bbe2f58650f349331a1fdeddf","observation_id":"77d0cb4e-9f09-4066-ab9d-84f237151c12","resolution":{"observed_at":"2026-08-07T13:54:49.120454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.242525Z","title":"Whodunit: Classifying code as human authored or gpt-4 generated-a case study on codechef problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.242525Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:713461709dbf878eb3fa533ec61d65df447297f9fbca35a3d0003a02fdec4e02","observation_id":"3207f12b-4c39-4ebc-951d-9d6ed0e8ceb6","resolution":{"observed_at":"2026-08-07T13:54:49.242525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.340671Z","title":"Automatic detection of generated text is easiest when humans are fooled","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.340671Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:27ad6a4c7ebf0acae1e8b1628fba76455ebde4cf23ffba73a6f92b45623e927e","observation_id":"bc477be6-3ca6-452d-a785-58be0314634a","resolution":{"observed_at":"2026-08-07T13:54:49.340671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.537272Z","title":"Swe-bench: Can language models resolve real-world github issues? InInternational Conference on Learning Representations (ICLR), 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.537272Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:89ac641a47296444f9ec4a28062b40e1ea417b6a48c2a8d471c096d09c487e4e","observation_id":"c4238f08-8892-4f25-8231-5600621c9da7","resolution":{"observed_at":"2026-08-07T13:54:49.537272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.661149Z","title":"Access the latest 2.0 experimental models in the gemini app., 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.661149Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a7e3cb847ea30fed7e6bcdc9b73cac4c5bcc909e1041526e7bb5b9046dddedc1","observation_id":"bae908c6-127e-4bda-a198-82489ae72e37","resolution":{"observed_at":"2026-08-07T13:54:49.661149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.780282Z","title":"Vulnerability handling of ai- generated code-existing solutions and open challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.780282Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:970207ea2b54091f3d68ce9cab35cfcca60a380f828a99b6d75102ece86832e2","observation_id":"605bc256-bacb-4710-8e72-c6021ee8bb78","resolution":{"observed_at":"2026-08-07T13:54:49.780282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:49.898415Z","title":"Gemini 2.0 is now available to everyone, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:49.898415Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:2ee20eff9f4bf18ab24d260634f059f340b0c775d7a02652416d13b35bc57f66","observation_id":"d508cc1b-25f4-4f13-bd1b-d3a77ffe37be","resolution":{"observed_at":"2026-08-07T13:54:49.898415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:50.058627Z","title":"Does attitude towards plagiarism predict aigiarism using chatgpt?AI and Ethics, 5(1):677–688, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.058627Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a8876e5e4d31e744789bd9670e961f71c606470aba4d86bb52fadf9eed0fe505","observation_id":"dbda737d-454c-453b-ba59-b83e84ff4e8e","resolution":{"observed_at":"2026-08-07T13:54:50.058627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:50.183926Z","title":"Will chatgpt g et you caught? rethinking of plagiarism detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.183926Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:5c40764da1649097c96b8c638e816c758dee8974c78b519e3600ad0f15c77e83","observation_id":"ef0bb54f-4125-47f8-89f4-f384d8462faf","resolution":{"observed_at":"2026-08-07T13:54:50.183926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:26.160853Z","title":"How secure is code generated by chatgpt? InIEEE international conference on systems, man, and cybernetics (SMC), pages 2445–2451","venue":null,"work_id":"63393805-f7a3-4adc-a4ee-bc2c7763ff2a","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.269865Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:26f103c804c976904f01d97cae88f6b7ad63879bbe2d45e5e34d2676147077d2","observation_id":"64ffc721-c503-4bb6-a5a5-533ecc3ba99f","resolution":{"observed_at":"2026-08-07T13:55:26.240995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:26.017519Z","title":"Paraphrasing evades detectors of ai-generated text, but retrieval is an effective defense.Advances in Neural Information Processing Systems (NeurIPS), 2023","venue":null,"work_id":"5d9858fe-6b33-4645-9a71-312a83fbe464","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.386281Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6935645ce1a3843a250f4f048b3f37ee5f61b10668718d536c69bb558281bcfe","observation_id":"03f30dd7-d73a-47ee-bd15-91d0063106e0","resolution":{"observed_at":"2026-08-07T13:55:26.074964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.859667Z","title":"Detecting fake content with relative entropy scoring","venue":null,"work_id":"c8a04bd1-fb0b-491b-8995-ef30d79b8fbd","year":2008},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.553406Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f849dc549af76f04f67ecdf2890baa315ae7a9dcee41feb15c9551cc560d4625","observation_id":"4271435f-c3b5-455a-8867-637eaf646188","resolution":{"observed_at":"2026-08-07T13:55:25.908463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.779384Z","title":"Protecting intellectual property of large language model-based code generation apis via watermarks","venue":null,"work_id":"b19546b2-022e-4354-b7ed-574adb602695","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.664897Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:e0a1d0b6b7a252016d253efb2695536ccbf3e10c93b6557d9881c99163c6bef9","observation_id":"50499960-1047-4a1f-b5a3-ade3debd7f65","resolution":{"observed_at":"2026-08-07T13:55:25.821311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T13:54:50.744812Z","title":"Deepseek-v3 technical report.arXiv preprint arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.744812Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:01af8e09cd9cb34ac85282c520402590bd8bf78a439f595b8ac43da1241cd232","observation_id":"cabc3883-4bb6-4818-80ea-24f5fff2cfc9","resolution":{"observed_at":"2026-08-07T13:54:50.744812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.612110Z","title":null,"venue":null,"work_id":"d53b2a58-2b5e-4332-b62b-5a58faad78ef","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:50.865882Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ffa5c968b64ad12b64aa7d4de97ea487e1b9906a3efacf36cbe6dda1b3294f9e","observation_id":"1da2f7b4-1105-407c-a195-1bc12dcf90ad","resolution":{"observed_at":"2026-08-07T13:55:25.697427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12644","last_updated":"2025-08-08T04:35:26Z","snapshot_observed_at":"2026-07-06T19:52:42.231424Z","submitted_at":"2024-11-19T16:54:45Z","title":"CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12644","snapshot_observed_at":"2026-08-07T13:54:51.004303Z","title":"Codex- embed: A generalist embedding model family for multiligual and multi-task code retrieval.arXiv preprint arXiv:2411.12644, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.004303Z"},"links":{"cited_paper":"/paper/2411.12644","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0caf8288ee11f043e89520c6d78ff40cae5ed03f560ae3603fa1bf7306ad684f","observation_id":"04279a04-6e3d-4f41-8e20-d41d409b3ac1","resolution":{"observed_at":"2026-08-07T13:54:51.004303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T13:54:51.120028Z","title":"Roberta: A robustly optimized bert pretraining approach.arXiv preprint arXiv:1907.11692, 2019","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.120028Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:23dfaeb71e3f4ab799c8ff546f2f78c9dbede96d69cc3ed5af43998f8f08b7be","observation_id":"2ce6caf2-b835-4f6e-80a1-10112003ecd9","resolution":{"observed_at":"2026-08-07T13:54:51.120028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.495015Z","title":"Raidar: generative ai detection via rewriting","venue":null,"work_id":"df234be3-ef58-4f56-85db-0f2e4dbce5ce","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.218996Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:e5b5b2785d8dd55fbc86935d7f403839506768c771a50cd1d0f5dd1f57f1e026","observation_id":"c6f9638a-d993-4bd4-bf4d-944c3afec798","resolution":{"observed_at":"2026-08-07T13:55:25.537792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.351230Z","title":"On the robustness of code generation techniques: An empirical study on github copilot","venue":null,"work_id":"bb9fa83a-cedd-48aa-bc0d-0223aa1fa6ba","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.348636Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:3ecbceb2fa3128429fe0377587cb414b34ce7730bb6668fe1cb801e0c1fd1597","observation_id":"db5bea98-ac35-408c-8e6a-9907e16e7a86","resolution":{"observed_at":"2026-08-07T13:55:25.415448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.215036Z","title":"Llama 3.3: Model cards & prompt formats, 2024","venue":null,"work_id":"c6defeaa-13bf-43da-b926-88839e02f098","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.489432Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ec170643c7f14d074c4d844466d493c5c1f03c22e4ee4ff2d18ed32059b68680","observation_id":"47c2b334-6ec8-4be7-84ef-3bb770d4ba7f","resolution":{"observed_at":"2026-08-07T13:55:25.275821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:25.068023Z","title":"Detectgpt: Zero-shot machine-generated text detection using probability curvature","venue":null,"work_id":"9f698e44-9669-4f3f-b2f8-f7655b0b2578","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.641080Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:078ac881ee5c880fb87882a72f350a2a61ed7ee8a4bd6f2e9bd9142d9257fef4","observation_id":"a1845f18-307f-48db-99d2-ef1065386dff","resolution":{"observed_at":"2026-08-07T13:55:25.167755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09381","last_updated":"2023-08-07T07:41:37Z","snapshot_observed_at":"2026-07-06T15:55:25.218006Z","submitted_at":"2023-07-18T16:01:15Z","title":"Is this Snippet Written by ChatGPT? An Empirical Study with a CodeBERT-Based Classifier","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09381","snapshot_observed_at":"2026-08-07T13:54:51.700600Z","title":"Is this snippet written by chatgpt? an empirical study with a codebert-based classifier.arXiv preprint arXiv:2307.09381, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.700600Z"},"links":{"cited_paper":"/paper/2307.09381","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b61f6f512152d209a6e104bdd804f36dbd46d34a78d7803d9067abdd43818104","observation_id":"369ee951-331b-4b17-a544-0fc92734f160","resolution":{"observed_at":"2026-08-07T13:54:51.700600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.900036Z","title":"Gptsniffer: A codebert-based classifier to detect source code written by chatgpt.Journal of Systems and Software, 214:112059, 2024","venue":null,"work_id":"cee8fecc-a3ef-4b76-934e-d352dd8e2f9b","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.759655Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:26885817f0beefe87d8460e6a3de6164f9fbd26a9a9b68a209c6d210179b5e73","observation_id":"e054e314-9f13-4178-bf36-13dc638c012a","resolution":{"observed_at":"2026-08-07T13:55:24.981311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.783075Z","title":"Poisoned chatgpt finds work for idle hands: Exploring developers’ coding practices with insecure suggestions from poisoned ai models","venue":null,"work_id":"e89d06ab-5baf-47ef-99da-bfef85185e8c","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.838559Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:5b3ae6d7e0ea3df7fddd790df3834d06bd002e006d2c45bae839b72ca9be5dfc","observation_id":"5607cbcf-e488-48c7-945f-c638c8485b33","resolution":{"observed_at":"2026-08-07T13:55:24.839371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:51.919051Z","title":"Introducing ChatGPT, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.919051Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7a93bf23da63d1935e6e5b7edf13830a8a5beec0fc0dad70f83940404e3a1760","observation_id":"16b5d11e-f0ca-4610-be35-b2a5a824779c","resolution":{"observed_at":"2026-08-07T13:54:51.919051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:51.992202Z","title":"Gpt-4o mini: advancing cost-efficient intelligence, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:51.992202Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:3d70a4d984e7528e270b20135f076d6c51c5de662929fc8db72dd8e21f3b7710","observation_id":"9e47c2de-2fd7-4582-a635-8af1d6a61da5","resolution":{"observed_at":"2026-08-07T13:54:51.992202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.595097Z","title":"Openai o3-mini: Pushing the frontier of cost-effective reasoning, 2025","venue":null,"work_id":"2697c1b4-fcac-4409-af98-18531fd8f504","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.043090Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6412c36472b073c417c291f1d76d442effa492acbc5fac9be71149f7ba18bed2","observation_id":"adbea689-e8b3-492f-b51e-222122821c97","resolution":{"observed_at":"2026-08-07T13:55:24.666988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13733","last_updated":"2025-07-17T15:31:25Z","snapshot_observed_at":"2026-08-07T16:56:32.661424Z","submitted_at":"2025-03-17T21:41:37Z","title":"CoDet-M4: Detecting Machine-Generated Code in Multi-Lingual, Multi-Generator and Multi-Domain Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13733","snapshot_observed_at":"2026-08-07T13:54:52.108811Z","title":"Codet-m4: Detecting machine-generated code in multi-lingual, multi-generator and multi-domain settings.arXiv preprint arXiv:2503.13733, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.108811Z"},"links":{"cited_paper":"/paper/2503.13733","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b4e96957a0a863582e04abe85dc74222dae5717c5fe751b433d051aa9d369e38","observation_id":"3f3a22e2-6ddf-4c0d-8dc1-a910825615d8","resolution":{"observed_at":"2026-08-07T13:54:52.108811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.454193Z","title":"Assessing ai detectors in identifying ai-generated code: Implications for education","venue":null,"work_id":"f64fc1fb-6753-4d25-b48f-a694e3c3b29b","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.157680Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f7655379cbab3676185463f2d941289b0dc2b11ddddfac4d4980dc1a3964ccd4","observation_id":"a74c8129-f622-4c8e-855d-711bc48a174f","resolution":{"observed_at":"2026-08-07T13:55:24.515159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.309867Z","title":"Bleu: A method for automatic evaluation of machine translation","venue":null,"work_id":"72a3629f-2183-46b8-84bd-e7500029f956","year":2002},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.221757Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:4a2ea973800016e3403507e367185f52d00cf554f15443f82045e3475c633452","observation_id":"1b147bce-2743-4336-be30-1d54c61c8701","resolution":{"observed_at":"2026-08-07T13:55:24.371342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.219658Z","title":"Asleep at the keyboard? assessing the security of github copilot’s code contributions","venue":null,"work_id":"ad87771b-ab65-4e3f-a0da-f6be4b5d942c","year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.278896Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:08e3a7ace50b15189ac53e55168ca8c902c65e2758599717945408aadde5fba8","observation_id":"68814478-2094-4fa8-9715-03362c8d9dfa","resolution":{"observed_at":"2026-08-07T13:55:24.265456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:24.109267Z","title":"Magecode: Machine- generated code detection method using large language models.IEEE Access, 2024","venue":null,"work_id":"2887fdbc-68ed-4353-b07b-3dfa6701b94c","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.343700Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:136e5aa875117053d33827482572ac3ba1043b566cf358022864ad1a94111e7d","observation_id":"b8253700-57d5-448a-87ba-54f616a19d6b","resolution":{"observed_at":"2026-08-07T13:55:24.178275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.963647Z","title":"Introducing gemini 2.0: our new ai model for the agentic era, 2024","venue":null,"work_id":"65865dc8-71b3-4e58-ae65-dac0af00d340","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.428624Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:41f614e4563ece1c640481cd8456df6bf23844bb840f67da5a3ea31b9d560c11","observation_id":"b9be9d4a-a780-403d-b1ff-d1c738eadafe","resolution":{"observed_at":"2026-08-07T13:55:24.021607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.766888Z","title":"Using tf-idf to determine word relevance in document queries","venue":null,"work_id":"38c183e7-77ab-414e-b642-9597579973d9","year":2003},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.507552Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:bc66973fe0ed5cec8d9870ea51914df4620a859b59043e27cfa84b61d3348350","observation_id":"353bcb8a-68f2-4f89-85f2-ebea9ed390cf","resolution":{"observed_at":"2026-08-07T13:55:23.877765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10297","last_updated":"2020-09-27T04:07:11Z","snapshot_observed_at":"2026-08-01T07:33:26.380394Z","submitted_at":"2020-09-22T03:10:49Z","title":"CodeBLEU: a Method for Automatic Evaluation of Code Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10297","snapshot_observed_at":"2026-08-07T13:54:52.586166Z","title":"Codebleu: a method for automatic evaluation of code synthesis.arXiv preprint arXiv:2009.10297, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.586166Z"},"links":{"cited_paper":"/paper/2009.10297","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:609531f6d2c177c48b10708b669da884cc8feb766dc29abe1007db6b095e3117","observation_id":"77607fbd-f9cc-4b54-9e84-827390f386e8","resolution":{"observed_at":"2026-08-07T13:54:52.586166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:54:52.664974Z","title":"The perceptron: a probabilistic model for information storage and organization in the brain.Psychological review, 65(6):386, 1958","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.664974Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b83222e2e36f6c901f14ce648778fd89eb89ec617f45014051a9a5838f2dcac2","observation_id":"0aea7182-b91b-4944-a0e6-0b80e6e140b3","resolution":{"observed_at":"2026-08-07T13:54:52.664974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.09179","last_updated":"2018-03-24T23:12:44Z","snapshot_observed_at":"2026-07-06T06:30:02.787977Z","submitted_at":"2018-03-24T23:12:44Z","title":"FaceForensics: A Large-scale Video Dataset for Forgery Detection in Human Faces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.09179","snapshot_observed_at":"2026-08-07T13:54:52.729191Z","title":"Faceforensics: A large-scale video dataset for forgery detection in human faces.arXiv preprint arXiv:1803.09179, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.729191Z"},"links":{"cited_paper":"/paper/1803.09179","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ef4cbf34d6ed6f7a3cbf4b3f39f47d68425d390148b279438f0aa08b28290e6f","observation_id":"01af329a-b3ef-47a6-bfcf-632bd019bb96","resolution":{"observed_at":"2026-08-07T13:54:52.729191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11156","last_updated":"2025-01-17T04:21:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-17T17:53:19Z","title":"Can AI-Generated Text be Reliably Detected?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11156","snapshot_observed_at":"2026-08-07T13:54:52.803803Z","title":"Can ai-generated text be reliably detected?arXiv preprint arXiv:2303.11156, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.803803Z"},"links":{"cited_paper":"/paper/2303.11156","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:444509f3a200bbd8fa703846b7ce87a19ece5416bb16cf980366ca6ced1e0569","observation_id":"dc0d9a15-6988-4450-9b53-7e21e5f7b7c4","resolution":{"observed_at":"2026-08-07T13:54:52.803803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.548371Z","title":"Automated detection of ai-obfuscated plagiarism in modeling assignments","venue":null,"work_id":"38e13ca3-9086-4376-8a7d-4e467cbbd9db","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.878609Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ceb94086a8dc92a4aebda07459f79546d6a9c6cd508df9ce26c13ab08bfac67f","observation_id":"2f655c91-4889-4576-9e70-790a4b834762","resolution":{"observed_at":"2026-08-07T13:55:23.647131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.399964Z","title":"Between lines of code: Unraveling the distinct patterns of machine and human programmers","venue":null,"work_id":"759d5c0b-dac0-425f-a64e-3ea27562440a","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.959556Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:b600b83ea23631c5b8e09bca9941bb5e3f05e4056dbd72569c2441ac0b3695de","observation_id":"7c3dd540-98d5-48df-8e2d-9f9244f49fba","resolution":{"observed_at":"2026-08-07T13:55:23.470078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:23.167999Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"8ed399cf-6c45-4522-8c34-701d18c2c346","year":2015},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T13:54:52.995946Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f4016a475ee5075f16c02b9626500370eaf80a76901916f389efcdfffbdcc944","observation_id":"0c1ca927-6b1f-407a-a316-2911d4455c3b","resolution":{"observed_at":"2026-08-07T13:55:23.301606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.887099Z","title":"2024 Stack Overflow Developer Survey, 2024","venue":null,"work_id":"03a66275-a5f2-419f-82b7-cb44561aabc6","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.024513Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:0da2e356b493a09ebe44993d7467ef2d7e447be89e7b29b45e08849f9ff4bcaa","observation_id":"78b2e5a4-a0c9-442b-8f13-4145bc6d8800","resolution":{"observed_at":"2026-08-07T13:55:23.023700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10877","last_updated":"2025-06-09T19:48:14Z","snapshot_observed_at":"2026-07-06T19:51:28.494860Z","submitted_at":"2024-11-16T20:06:21Z","title":"Developer Perspectives on Licensing and Copyright Issues Arising from Generative AI for Software Development","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10877","snapshot_observed_at":"2026-08-07T13:55:14.040744Z","title":"Developer perspectives on licensing and copyright issues arising from generative ai for coding.arXiv preprint arXiv:2411.10877, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.040744Z"},"links":{"cited_paper":"/paper/2411.10877","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:58720810fc783884195b95390884764cfe145c6a15f8f5f45b7007901dc8c9da","observation_id":"c3bd3099-8ece-4dc6-bf6f-a010a95a4eb1","resolution":{"observed_at":"2026-08-07T13:55:14.040744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.656536Z","title":"Plagiarism in ai empowered world","venue":null,"work_id":"0b85e3ef-46f8-45fa-9a9d-b256094871a4","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.056712Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f496a3bcb6e42c97ba81cf3fb98de8c68fc0ef2c254916839ceb76e1404ebb7e","observation_id":"3c1c00e4-1d96-44f0-bb43-aa7ee7d7cd28","resolution":{"observed_at":"2026-08-07T13:55:22.748784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.450723Z","title":"An empirical study on automatically detecting ai-generated source code: How far are we? InInternational Conference on Software Engineering (ICSE), 2025","venue":null,"work_id":"96942720-07ed-4fec-b12c-23aaad3b3207","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.076339Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a83ec25c7c57c2e17d91d0e351e38c5e1c892936bf9cf8e710a57a063710c385","observation_id":"ee171013-724e-4eb6-a7ac-0ff12e27303b","resolution":{"observed_at":"2026-08-07T13:55:22.569105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:22.190256Z","title":"Bugs in large language models generated code: An empirical study.Empirical Software Engineering, 30(3):1–48, 2025","venue":null,"work_id":"d75bf698-ea81-4f18-a77e-2d5f08c8990f","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.096731Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:90bf4e65a49aa0562a4149fde23fd4c619fbc9790192ea659526b17719d54c97","observation_id":"0fa2b0ba-a5c4-4881-8712-9fa7925527eb","resolution":{"observed_at":"2026-08-07T13:55:22.322393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.884580Z","title":"How secure is ai-generated code: a large-scale comparison of large language models.Empirical Software Engineering, 30(2):1–42, 2025","venue":null,"work_id":"8ef6304a-9bcb-4d6c-8eea-3679fad584df","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.118637Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:284ff240ad1e264dac2a1e57ecd991726da7ad1835795e1dad7dbf89fc99a4b9","observation_id":"ff6127b3-03dc-40ee-8637-e058f3d68f20","resolution":{"observed_at":"2026-08-07T13:55:22.045275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.669725Z","title":"Llms in web development: Evaluating llm-generated php code unveiling vulnerabilities and limitations","venue":null,"work_id":"f587a1eb-61da-445b-88dc-9efea98ba089","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.179810Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:81806a31c03cc502d8d54f0ba7d182b80ef648e609a7fbe31a09bf7243d493fd","observation_id":"6587dbf4-3410-4e7e-8012-c34f119d7781","resolution":{"observed_at":"2026-08-07T13:55:21.795506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.497594Z","title":"Turingbench: A benchmark environ- ment for turing test in the age of neural text generation","venue":null,"work_id":"ed375d13-7d45-4d41-8ecf-b32388480947","year":2021},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.217593Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:75bb75d1e61fee497360ac3344f7e305881ea3c10933d35199708357de290470","observation_id":"281323d5-087a-459e-a11e-f0f9bc864f63","resolution":{"observed_at":"2026-08-07T13:55:21.551090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.360438Z","title":"A critical look at ai-generate software: Coding with the new ai tools is both irresistible and dangerous.IEEE Spectrum, 60(7):34–39, 2023","venue":null,"work_id":"b23b9404-c35e-46f9-9cda-d3884e7fcbb4","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.277784Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:6c20c65c9265c234a6dc13a5cc07b09274b55e859daea354c779b7945917bd15","observation_id":"be9e6b2a-63ed-4c8d-abd5-81e52907e025","resolution":{"observed_at":"2026-08-07T13:55:21.423137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.276321Z","title":"Attention is all you need.Advances in Neural Information Processing Systems (NeurIPS), 30, 2017","venue":null,"work_id":"c9c1df85-7897-4256-856a-18fadb9a55e8","year":2017},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.310837Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ca7e892a6cf7820f9a674c00b9cedad4cd18b89166b27f010f412ff4be3c64ee","observation_id":"b88f5d05-c87f-4528-b0b1-f8c8780fe4c7","resolution":{"observed_at":"2026-08-07T13:55:21.314436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02395","last_updated":"2024-07-04T08:59:31Z","snapshot_observed_at":"2026-07-06T18:40:22.951929Z","submitted_at":"2024-07-02T16:13:21Z","title":"Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02395","snapshot_observed_at":"2026-08-07T13:55:14.361719Z","title":"Is your ai-generated code really safe? evaluating large language models on secure code generation with codeseceval.arXiv preprint arXiv:2407.02395, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.361719Z"},"links":{"cited_paper":"/paper/2407.02395","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:47ce7884749ea57d078ea88961c554d53babf50db9c897884800053d91921e2a","observation_id":"9d273f42-c329-43ba-bd73-61fc2f03955b","resolution":{"observed_at":"2026-08-07T13:55:14.361719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.175355Z","title":"Openhands: An open platform for ai software developers as generalist agents","venue":null,"work_id":"af7fbd5b-f7a3-4899-8bda-e9c4dc3c1ec6","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.456862Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:33d738a70a04d7499d1c8e3f48d70d272ba04ab93a1b7188252d5ee7066056b1","observation_id":"5a4c4378-4bcb-4f06-b2ce-31c15e7b716b","resolution":{"observed_at":"2026-08-07T13:55:21.222402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:21.063245Z","title":"Codet5+: Open code large language models for code understanding and generation","venue":null,"work_id":"ded0a691-df64-45ad-92a0-583b4d2e85e6","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.546271Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:18f2415ce4fb57b762f2248b18d76c1941490b908c14dc35bc4bbf421d6f1590","observation_id":"d7b5277a-0773-4316-95da-07206b479896","resolution":{"observed_at":"2026-08-07T13:55:21.117660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.918695Z","title":"A new era of plagiarism the danger of cheating using ai","venue":null,"work_id":"1ead372f-1588-4c2d-8961-303f53e63339","year":2022},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.634932Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:7a5b01c3fe3a8dbee5f6375d415b5a2bfe07943a874d767496a181152c89c150","observation_id":"75d1735f-1810-49cb-ab70-67083d7d1190","resolution":{"observed_at":"2026-08-07T13:55:21.003759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.811740Z","title":"Do llms know to respect copyright notice? InConference on Empirical Methods in Natural Language Processing (EMNLP), pages 20604–20619, 2024","venue":null,"work_id":"f7c226e4-7057-487c-a440-2c318cbc64f8","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.723234Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:c543664da2c0c7fe039a7576595f7a995f809964fe54db57f53a99f4234250cb","observation_id":"17920c00-40ea-4080-908b-2bac02b2510b","resolution":{"observed_at":"2026-08-07T13:55:20.853496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16525","last_updated":"2025-07-09T10:04:06Z","snapshot_observed_at":"2026-07-06T20:11:24.538172Z","submitted_at":"2024-12-21T08:02:58Z","title":"One Size Does Not Fit All: Investigating Efficacy of Perplexity in Detecting LLM-Generated Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16525","snapshot_observed_at":"2026-08-07T13:55:14.798043Z","title":"Investigating efficacy of perplexity in detecting llm-generated code.arXiv preprint arXiv:2412.16525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.798043Z"},"links":{"cited_paper":"/paper/2412.16525","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:fe3a0b68f96f1a0b9a24996fa862a762e4858d194d699d486509fde4b6a897b1","observation_id":"4dbac241-c745-401e-a5f6-e9b4a06dcd99","resolution":{"observed_at":"2026-08-07T13:55:14.798043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.02487","last_updated":"2025-02-25T08:58:05Z","snapshot_observed_at":"2026-08-04T07:57:04.344747Z","submitted_at":"2024-08-05T14:09:30Z","title":"LiCoEval: Evaluating LLMs on License Compliance in Code Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.02487","snapshot_observed_at":"2026-08-07T13:55:14.880420Z","title":"Licoeval: Evaluating llms on license compliance in code generation.arXiv preprint arXiv:2408.02487, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.880420Z"},"links":{"cited_paper":"/paper/2408.02487","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8bcb966cd184152add591172779ac3d5e57cc18e4f6cce266c19bb41460e6612","observation_id":"e1ac7c31-4310-47fd-85cb-983ba9055911","resolution":{"observed_at":"2026-08-07T13:55:14.880420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.716338Z","title":"Distin- guishing llm-generated from human-written code by contrastive learning.ACM Transactions on Software Engineering and Methodology, 34(4):1–31, 2025","venue":null,"work_id":"59b01186-9cae-4130-af92-b07d0462ff8e","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:14.956953Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:65a47d38dae1fef715c6bbd39ef5c3505b833dcd9f48e154a879901d91c8b55e","observation_id":"6e66fc8d-f6ad-4b95-b5bb-5793c48afe27","resolution":{"observed_at":"2026-08-07T13:55:20.760397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.483108Z","title":"Detecting ai-generated code assignments using perplexity of large language models","venue":null,"work_id":"b930e94a-021f-47b1-9f60-26bc4f5ed307","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.024786Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:a47d4903f3c97cc00d536046f2a2c58f33dc2aeca188afca703e001a839993d5","observation_id":"559512f9-8e72-460e-8ef4-c0308bf77398","resolution":{"observed_at":"2026-08-07T13:55:20.608036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.353645Z","title":"An {LLM-Assisted}{Easy-to-Trigger} backdoor attack on code completion models: Injecting disguised vulnerabilities against strong detection","venue":null,"work_id":"fb8bd525-0f8b-4c47-951a-15cfc3887e7d","year":2024},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.059826Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:8e969f4856e1a487296658bf8aeaeaeb7cd05d431c0a716208a7469865341963","observation_id":"1a0ffe97-c900-4d1d-a030-c9b766ecbe73","resolution":{"observed_at":"2026-08-07T13:55:20.428612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05103","last_updated":"2023-10-08T10:08:21Z","snapshot_observed_at":"2026-08-02T17:00:27.719242Z","submitted_at":"2023-10-08T10:08:21Z","title":"Zero-Shot Detection of Machine-Generated Codes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05103","snapshot_observed_at":"2026-08-07T13:55:15.071294Z","title":"Zero-shot detection of machine-generated codes.arXiv preprint arXiv:2310.05103, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.071294Z"},"links":{"cited_paper":"/paper/2310.05103","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f505e63c58951ed044313e18a672efefd62b138dab66307ff574075589d86f60","observation_id":"646f7d6b-37ce-431e-8a7a-e7e6bf2dcc18","resolution":{"observed_at":"2026-08-07T13:55:15.071294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:20.135477Z","title":"Uncovering llm-generated code: A zero-shot synthetic code detector via code rewriting","venue":null,"work_id":"264e5b11-49b8-40f6-9e73-16121bbbea1d","year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.099323Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:defa9ec70d2c566faa914f90db6c614f2790779c82ceb53517c7ca09aea1eaef","observation_id":"98df593a-6b3d-46a5-be04-6eb4eac9b636","resolution":{"observed_at":"2026-08-07T13:55:20.249361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.952490Z","title":"Codeipprompt: intellectual property infringement assessment of code language models","venue":null,"work_id":"c78bef72-b4cc-4679-b07f-bbc15cace4e3","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.206200Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:25a43aef2609292ff2a03d9801fb9c463bd8333688b486c4999cd856f4ee20db","observation_id":"6b711f23-85f8-44f8-929f-41adc1564bf7","resolution":{"observed_at":"2026-08-07T13:55:20.053757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15867","last_updated":"2025-04-22T13:09:20Z","snapshot_observed_at":"2026-08-07T16:00:14.464745Z","submitted_at":"2025-04-22T13:09:20Z","title":"Inducing Vulnerable Code Generation in LLM Coding Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15867","snapshot_observed_at":"2026-08-07T13:55:15.340847Z","title":"Inducing vulnerable code generation in llm coding assistants.arXiv preprint arXiv:2504.15867, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.340847Z"},"links":{"cited_paper":"/paper/2504.15867","citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:d9d36cf229c73423045875396f47d07056de4474ae7fdc843748113df20e0b9c","observation_id":"16b48c01-9f40-41ff-888e-384a39c9a208","resolution":{"observed_at":"2026-08-07T13:55:15.340847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:15.407231Z","title":"How well does llm generate security tests?arXiv preprint arXiv:2310.00710, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.407231Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:040f7c441be029ff55d85407bc6c018b9da452f77113c2344165dbf3e8227461","observation_id":"c76f7210-55c6-4567-aaf4-cb8d912ee442","resolution":{"observed_at":"2026-08-07T13:55:15.407231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.679102Z","title":"Genimage: A million-scale benchmark for detecting ai-generated image.Advances in Neural Information Processing Systems (NeurIPS), 36:77771–77782, 2023","venue":null,"work_id":"12a55819-84fc-4a33-8629-0c24950f773b","year":2023},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.510378Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:e4b6f2e9e2e86a24733981866ae98f8da453a29c01d56cbb6d1b1c3f8274680c","observation_id":"31be87fc-8af6-437f-815a-8d84cee8a050","resolution":{"observed_at":"2026-08-07T13:55:19.823765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.419023Z","title":"Wilddeepfake: A challenging real-world dataset for deepfake detection","venue":null,"work_id":"2ddb7889-dba1-4698-bcf5-22694c9020c8","year":2020},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.611545Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:ed39f682965bc5681453579e069efe19e818de5063656ebc6bbc21a0b1c57e11","observation_id":"fa6ba879-fa02-4f20-a6f2-f0e7caf8aec1","resolution":{"observed_at":"2026-08-07T13:55:19.529874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.148469Z","title":null,"venue":null,"work_id":"4fabb481-91f8-4dc6-b86b-7500ae44e801","year":null},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.642841Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:1c40277fd6a62cc16824ee4fa28b270dcd607bf8d604ab13e1ee9e6454aaf052","observation_id":"3b4e48ee-263b-4fa0-ba3e-0eda070ab4b1","resolution":{"observed_at":"2026-08-07T13:55:19.259887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:55:19.017402Z","title":null,"venue":null,"work_id":"e12c277a-654f-402a-bc4a-cc5a8ab845f8","year":null},"citing_paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T13:55:15.691408Z"},"links":{"citing_paper":"/paper/2506.11059"},"observation_digest":"sha256:f0c7687f0bdbda1960cb1d38c264fccf9e9f217cfbec35e58c796f9622b84096","observation_id":"83acb047-23d9-4acc-b227-7eb9507bc60f","resolution":{"observed_at":"2026-08-07T13:55:19.095212Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.11059","last_updated":"2025-05-27T03:25:12Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-07T13:47:18.646217Z","submitted_at":"2025-05-27T03:25:12Z","title":"CodeMirage: A Multi-Lingual Benchmark for Detecting AI-Generated and Paraphrased Source Code from Production-Level LLMs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":111},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 111 outbound references and 1 inbound Pith citation observation for arXiv:2506.11059."}