{"as_of":"2026-08-16T12:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3aeade76357c29aa6316dfb5c83e35469b57f9dc96c85c6a4466debe68e24484","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:31:22.554944Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.12844/citation-record","integrity":"/paper/2505.12844/integrity","json":"/paper/2505.12844/citation-record.json","paper":"/paper/2505.12844"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:31:22.194816Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.194816Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:98bfae418e3b038f498dd955abff7338e2d23d679ec343b4d54e91d6d5d64440","observation_id":"219f380e-b095-4d2e-96f0-cda95f2ac0dd","resolution":{"observed_at":"2026-08-15T20:31:22.194816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.199650Z","title":"Claude 3.7 sonnet and claude code","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.199650Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b5a5c2733b60547d3cfed25e2a2b69b0f401b5ddcdd03ab512e44ee81b7cb808","observation_id":"f0cb1279-665e-4f42-b560-ed5da4c35a39","resolution":{"observed_at":"2026-08-15T20:31:22.199650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.203484Z","title":"Unsu- pervised label noise modeling and loss correction","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.203484Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:3cabe587dda05cd10da8f5ae69db781716fab496567ae73bbb5df90ad9339efa","observation_id":"f6aa4140-1951-4391-bb95-252358ca3b22","resolution":{"observed_at":"2026-08-15T20:31:22.203484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.207626Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.207626Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:679474e7f46c4cccacb4b7496e688cac35bbbeb41f5fbdb3ffd6f735d97d5f95","observation_id":"e8de3d15-5726-432c-b946-f4a2eb952b4d","resolution":{"observed_at":"2026-08-15T20:31:22.207626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.211473Z","title":"Elo uncovered: Robustness and best practices in language model evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.211473Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:5087e5cf7b1a94d5b6f25e05289ad79626279a572ccac37ffb2d3f87ce314e0d","observation_id":"66ca1ee0-7b2c-4177-a8dd-9c4056846c94","resolution":{"observed_at":"2026-08-15T20:31:22.211473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.215515Z","title":"Lang, Sourabh V ora, Venice Erin Liong, Qiang Xu, Anush Krishnan, Yu Pan, Giancarlo Baldan, and Oscar Beijbom","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.215515Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:63df6c8919acb34fac74e354c2141a20786ecd89f447070e54b24643f3054201","observation_id":"86e88343-28a4-4c25-b705-2fbd79acf06e","resolution":{"observed_at":"2026-08-15T20:31:22.215515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.219855Z","title":"Active bias: Training more accurate neural networks by emphasizing high variance samples","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.219855Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:ade7153bd5df408febe709dff4f447600097f792791df9a48219a7c8d12c8bae","observation_id":"56bd01c0-b9d4-4903-8635-915019f99200","resolution":{"observed_at":"2026-08-15T20:31:22.219855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-16T03:32:25.570081Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-15T20:31:22.223870Z","title":"Mmdetection: Open mmlab detection toolbox and benchmark","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.223870Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:4e675c252b8a3469a29171437e2560ba12b37bb4b851ea6f4f0b522014934a73","observation_id":"125dc179-432f-4a64-a352-526aa5c2c413","resolution":{"observed_at":"2026-08-15T20:31:22.223870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.227828Z","title":"Chatbot arena: An open platform for evaluating llms by human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.227828Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:7ff38bd9cf6569d3fb315c6b6fa9b63f08dbaa2bec2f988097036f913d7272c1","observation_id":"04f9cbfa-3968-437f-849d-a4275abb6a83","resolution":{"observed_at":"2026-08-15T20:31:22.227828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.231416Z","title":"Transfuser: Imitation with transformer-based sensor fusion for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.231416Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e40e0f5c1269adcecbdd101f0a0548f3f86724828b2e6d5f741f5ecb5c0efd97","observation_id":"ba4f5cfd-4abf-482a-9eb9-c0d9ff076911","resolution":{"observed_at":"2026-08-15T20:31:22.231416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.235208Z","title":"Openscene: The largest up-to-date 3d occupancy prediction bench- mark in autonomous driving, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.235208Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:9a9156740c674deef59d553d3edf34e6f60294ec6021d2e22e5e1e440f71d79c","observation_id":"f8a13668-2977-4918-9c38-9e423f9d05bf","resolution":{"observed_at":"2026-08-15T20:31:22.235208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.239244Z","title":"Navsim: Data-driven non-reactive autonomous vehicle simulation and benchmarking","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.239244Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b16de5fb6f706f5d24a3e5c45f3b617f43b703e3f79a7cabbd3364895b3b68e8","observation_id":"5e20415d-8a78-46ad-bdf1-6a795eac94d1","resolution":{"observed_at":"2026-08-15T20:31:22.239244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.242990Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.242990Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:614e80ee51eda1f326faab9040901b1e042a9d70a27540aae6042f6b6520dc21","observation_id":"5e42ca1d-99c7-43ca-82ee-fb8410b9678a","resolution":{"observed_at":"2026-08-15T20:31:22.242990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-15T20:31:22.246754Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.246754Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b032cc357c8c1b7597f8fc6f5571c71675122153f7ffc533be51de71768b26f4","observation_id":"d61c5ce5-bec3-4899-874e-338ff3b4222a","resolution":{"observed_at":"2026-08-15T20:31:22.246754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.250750Z","title":"The proposed uscf rating system, its development, theory, and applications","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.250750Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:5ef0847607d45717f5025b9dd9928c60ecbb389be2d253a7b98ba3d647a3dcaa","observation_id":"f2704f3f-ee69-4932-935e-c7ee4463b804","resolution":{"observed_at":"2026-08-15T20:31:22.250750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.592429Z","title":"Understanding dataset difficulty with v-usable information","venue":null,"work_id":"945aeecb-fe88-4462-b0ed-8b1c711f878c","year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.254991Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:d856994a22eac7aacd263d129c9511e25bc7f42e56a597328171f4507292697f","observation_id":"d571e1da-d60d-49a8-93a5-06fccaff8a4d","resolution":{"observed_at":"2026-08-15T20:31:23.596562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.258360Z","title":"Large scale interactive motion forecasting for autonomous driving: The waymo open motion dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.258360Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:7d17b507144eca7df2b1e0166d468514acead069c958f69541c9833ae22037e4","observation_id":"47067c5c-c5b8-4399-9871-213bea386e70","resolution":{"observed_at":"2026-08-15T20:31:22.258360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.262181Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.262181Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:3cb642622c7a052943b1732081bb238712236fc66d8bb0c0b22e356ed93d87c0","observation_id":"a0f0afe8-bb94-46c1-a329-f2c189ba254f","resolution":{"observed_at":"2026-08-15T20:31:22.262181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.567044Z","title":"Glickman","venue":null,"work_id":"38f38c26-1ccf-4231-8317-55dd2ab2adc1","year":1999},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.265791Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:6361f0679947941983fbf3db5f8d9336bd45034c96bea66c811e03c3fc84622d","observation_id":"f723a872-bb9e-4367-8ddb-cc07228a2289","resolution":{"observed_at":"2026-08-15T20:31:23.570793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.554436Z","title":"Gemini 2.5: Our most intelligent ai model","venue":null,"work_id":"6dbba0e9-65a3-4538-ab9d-9773e80c38a3","year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.269179Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:c7c32a8341feb9f0fbb07a89c95b6545d29e91fa94daae0fed23d14b04b2f845","observation_id":"fa2aab54-a358-46e5-bf9c-119a21e29afd","resolution":{"observed_at":"2026-08-15T20:31:23.558442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:31:22.272655Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.272655Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:c2291400c81aeb1a209c723627b4cb34571ac69e49cb6de43f1f80b45bcde652","observation_id":"8b0c663a-b10e-4e77-be5a-069a5d47e391","resolution":{"observed_at":"2026-08-15T20:31:22.272655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:31:22.276346Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.276346Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:206b0a1200e88e606a6cea50547bb590f2d033d15b3657519619846a05b9499b","observation_id":"1c145112-8fd4-424e-96d0-f0d3384ba654","resolution":{"observed_at":"2026-08-15T20:31:22.276346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-15T20:31:22.280019Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.280019Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:854de941d1b9c2c366238db1113ac6cb5b7c7014989303d83063fdc7c2052e3c","observation_id":"4fc9456d-94b6-4436-9e89-690b483e5c3d","resolution":{"observed_at":"2026-08-15T20:31:22.280019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.542081Z","title":null,"venue":null,"work_id":"464e04eb-f327-4a17-ad0d-9b57090ffcfd","year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.283597Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:bc0a2a960b9a16f39c131ea4f44736dbb97791fb2be0d784e4b7018bab394486","observation_id":"61d43fa0-22b7-4105-981e-82beb62279bc","resolution":{"observed_at":"2026-08-15T20:31:23.546577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.529832Z","title":"Tan et al","venue":null,"work_id":"6a77a65a-ecdd-4879-a3a5-6e419c5926d8","year":2021},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.287017Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:8a46a88c926ea2aaedd838e7f94c0eb7b288e3ae4062336724052e27a29dc159","observation_id":"59399dd2-8b66-4c9f-8e23-2ae8d79a9cdb","resolution":{"observed_at":"2026-08-15T20:31:23.533823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.517812Z","title":"Co-teaching: Robust training of deep neural networks with extremely noisy labels","venue":null,"work_id":"bc7d6bad-b618-4a3b-bd98-bd525d6a9be0","year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.290648Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:33459d2861b69ae75a532236c9284286b6f1d2fcf6be47734d3beecaf40d766b","observation_id":"0ce4cdd9-55c2-4b76-98fd-961af9f2ded1","resolution":{"observed_at":"2026-08-15T20:31:23.521908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06870","last_updated":"2018-01-24T07:54:08Z","snapshot_observed_at":"2026-08-16T07:33:33.164225Z","submitted_at":"2017-03-20T17:53:38Z","title":"Mask R-CNN","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06870","snapshot_observed_at":"2026-08-15T20:31:22.294175Z","title":"Mask r-cnn","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.294175Z"},"links":{"cited_paper":"/paper/1703.06870","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:053e6800014a7096c8674f6957dec8497f4c0428f2a3205c1c916ce2873dbde9","observation_id":"404c2fb1-a86c-4a51-884d-242a00de382d","resolution":{"observed_at":"2026-08-15T20:31:22.294175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.298236Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.298236Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:4529448d554a20176e00f6af540480665c6ba3ea0e61a3b1f3207b5c5f3b6489","observation_id":"ff3496f8-2210-43bb-96e4-80b3a30e1561","resolution":{"observed_at":"2026-08-15T20:31:22.298236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T20:31:22.301916Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.301916Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:5dd5e221cab628269261d27addccfd8629070341f28ebf8970a27119a9cd2697","observation_id":"4fc71b59-042d-46b3-9910-ad8ab1abe056","resolution":{"observed_at":"2026-08-15T20:31:22.301916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.498152Z","title":"Trueskill ™: a bayesian skill rating system","venue":null,"work_id":"ec8911b5-6f8b-4fc6-a937-39638a5f4156","year":2006},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.306120Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:4cc935d90472df7b48572e5a3d16e9dd27689e7019e5d212427b56a8cb3b5cfe","observation_id":"9c35bbdb-3d25-4578-a1c7-54a3a5e16373","resolution":{"observed_at":"2026-08-15T20:31:23.502558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.486133Z","title":"Learning whodunnit: Classification of event participants in news articles","venue":null,"work_id":"7536a684-42cc-427a-bb6c-2b3ee3bbc2f7","year":2013},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.310036Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:68ff1f19e7ba368cb3d6ffdc80631b1c274b96df8939de45fde7f5f39c4295bc","observation_id":"361017f4-313f-4b11-a4d2-87859fec97ae","resolution":{"observed_at":"2026-08-15T20:31:23.489895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.313428Z","title":"Densely connected convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.313428Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:15577d1015920618880cef6cfcb8284d8d0168e7df4a2c67632f660c52779fc9","observation_id":"1e567de8-5f99-4de3-952c-1035a708b9d9","resolution":{"observed_at":"2026-08-15T20:31:22.313428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-15T20:31:22.316673Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.316673Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e3d6c5863e21dffd45d7a208863eee12241c57c829aa3da1828546cf33aaa400","observation_id":"650f6075-c6b5-4f33-b43f-2df451d0f807","resolution":{"observed_at":"2026-08-15T20:31:22.316673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T20:31:22.320510Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.320510Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:36fe3605a4e4a9901f0f9ecd7b548564c54784bcb81e97ad82b7b50b153aedbc","observation_id":"74270bef-4704-4b50-a799-d204d115f548","resolution":{"observed_at":"2026-08-15T20:31:22.320510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.07360","last_updated":"2016-11-04T21:26:08Z","snapshot_observed_at":"2026-08-14T22:09:04.541956Z","submitted_at":"2016-02-24T00:09:45Z","title":"SqueezeNet: AlexNet-level accuracy with 50x fewer parameters and <0.5MB model size","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.07360","snapshot_observed_at":"2026-08-15T20:31:22.324004Z","title":"Squeezenet: Alexnet-level accuracy with 50x fewer parameters and< 0.5 mb model size","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.324004Z"},"links":{"cited_paper":"/paper/1602.07360","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:c87f1961517c4d979ca3eafec72d828edfbfc70653a619749c9743d3d419b664","observation_id":"e4df0761-6f4c-4b1e-bf94-01a98c21a19e","resolution":{"observed_at":"2026-08-15T20:31:22.324004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-15T20:31:22.327407Z","title":"Openai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.327407Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:26095f3629a3f25a1fe388a67cbc23ac7d7ad93d40f701dc16c7501e13605d00","observation_id":"70d68257-b75b-4670-a1e1-a485c9cff832","resolution":{"observed_at":"2026-08-15T20:31:22.327407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-15T20:31:22.330934Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.330934Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:7de8635265090ccfa4efed587d92fa7fb60044076aa03402c66c9deaac4926bc","observation_id":"ed03f8c0-1bc8-4ffe-8523-04ae88fcd32f","resolution":{"observed_at":"2026-08-15T20:31:22.330934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.334511Z","title":"Ultralytics yolov8, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.334511Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b6edde4111b8ff19a7c42d4c0e5888b1edf17e13da73d6f9519a29bcdc95b910","observation_id":"f3526b71-a9cb-4eed-a33b-4c4809777da7","resolution":{"observed_at":"2026-08-15T20:31:22.334511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.337934Z","title":"Ultralytics yolo11, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.337934Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:75ae9ebc518e0348b5cf0f46bc1b1fa2c9d59b5fb71e2b21c0f51a7ebcbbfede","observation_id":"43a56c9a-2b70-4fe4-94ad-180f10e1ac6a","resolution":{"observed_at":"2026-08-15T20:31:22.337934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.341192Z","title":"ultralytics/yolov5: v3","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.341192Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:236d2aff35a6caeb08d0fc7c05ce6285eed079e16b35a876905b32fd51c20893","observation_id":"3fab85b4-02f9-4038-8532-bfcd2c5390b8","resolution":{"observed_at":"2026-08-15T20:31:22.341192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.344439Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.344439Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:7aae5bdc3003e0dc8e2f75d10f2c97beb97da4aea657aaa1f1df5541f7bc866b","observation_id":"420e2a26-e92e-47a1-a668-eef6cb65b2ad","resolution":{"observed_at":"2026-08-15T20:31:22.344439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.440766Z","title":null,"venue":null,"work_id":"6e2ee0c4-57e4-4282-b61c-0fc6e14ea833","year":2012},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.348187Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:4dcbb8f8bd43f20d3d824c4d6c51e6c1f85e8c4b08babf778715f7f73ffe2e2c","observation_id":"56ccbc19-7f21-41de-be27-d090ec751726","resolution":{"observed_at":"2026-08-15T20:31:23.444585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.02846","last_updated":"2021-09-07T03:59:22Z","snapshot_observed_at":"2026-08-13T18:16:02.359532Z","submitted_at":"2021-09-07T03:59:22Z","title":"Datasets: A Community Library for Natural Language Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.02846","snapshot_observed_at":"2026-08-15T20:31:22.351795Z","title":"Datasets: A community library for natural language processing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.351795Z"},"links":{"cited_paper":"/paper/2109.02846","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:2c3cb70216484652f1bcb6d890eccf84e2e598eb93a7985068d01493f039b01f","observation_id":"f2494901-9490-4903-b6f5-25c993a917a7","resolution":{"observed_at":"2026-08-15T20:31:22.351795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.355637Z","title":"Quanti- fying ai psychology: A psychometrics benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.355637Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:da3684254d643650595bbafff1524d13893d0fd62302cf85e31bff7bf1fa9409","observation_id":"eaef0ae8-5a34-48ee-9dee-f4f025b92555","resolution":{"observed_at":"2026-08-15T20:31:22.355637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15139","last_updated":"2025-04-10T08:48:37Z","snapshot_observed_at":"2026-08-14T04:58:40.109867Z","submitted_at":"2024-11-22T18:59:47Z","title":"DiffusionDrive: Truncated Diffusion Model for End-to-End Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15139","snapshot_observed_at":"2026-08-15T20:31:22.359332Z","title":"Diffusiondrive: Truncated diffusion model for end-to-end autonomous driving","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.359332Z"},"links":{"cited_paper":"/paper/2411.15139","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:ac6ffa615b53385a5dc74b8ac68bb67d4fdea98abdfaa00d455d25f2ffba1382","observation_id":"9bdf17d0-e0ae-4b16-b9f0-8cbb3ad62763","resolution":{"observed_at":"2026-08-15T20:31:22.359332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.428834Z","title":"Eda: Evolving and distinct anchors for multimodal motion prediction","venue":null,"work_id":"47dbb96b-5ce0-45cf-97c1-b99f18c76352","year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.362963Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:ee3197a71de16a39c2113de53cc210bb0bad27ed2bf066ba29a4313681e1edff","observation_id":"3770c346-3505-47dc-93d6-7796aefd5a55","resolution":{"observed_at":"2026-08-15T20:31:23.433031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-08-14T20:42:52.429547Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-15T20:31:22.367029Z","title":"Focal loss for dense object detection","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.367029Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:8c93f84ef6f191cf5edfa748a890771ebd219d4b8c37de969e2e63676b77bb6d","observation_id":"e4712c81-0009-4a3e-8a3e-83f3826cc27e","resolution":{"observed_at":"2026-08-15T20:31:22.367029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.370765Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.370765Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:6eefe2087062385a98d855a3d405717df6009e886b23f0c5927efab5182355ee","observation_id":"a1ff8ffb-f4af-4e60-a9bd-22021cea5981","resolution":{"observed_at":"2026-08-15T20:31:22.370765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T20:31:22.374281Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.374281Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:02e43d4899d980ab3fbb0feab1be09aeca1934db17bb03a7e95e08016b17ccf8","observation_id":"c5b16333-875f-489a-aabf-74606b52c057","resolution":{"observed_at":"2026-08-15T20:31:22.374281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.409417Z","title":"Reasoning multi-agent behavioral topology for interactive autonomous driving","venue":null,"work_id":"a6aae40a-4edc-4c01-85c0-9af123bbe411","year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.378258Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:95199327002fb351d282a6a275adadac6a141d161bfa19d0800686e7fa27c8ee","observation_id":"4c02db0d-b6c2-402a-96c8-77e597cde9fb","resolution":{"observed_at":"2026-08-15T20:31:23.413295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.381980Z","title":"Ssd: Single shot multibox detector","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.381980Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:76a8144122ccfaa71cf1e34afeb0483a6c73b53f0c7ab1b5ee7fe7da4eb98c43","observation_id":"35d0009b-9093-42be-8dc6-44b653ace8ff","resolution":{"observed_at":"2026-08-15T20:31:22.381980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.385561Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.385561Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:8472657e8e8926e5fd2b015c636cc066a89623731269ef5a67851592153d4519","observation_id":"8acf187a-249f-4070-860e-40d0085e9797","resolution":{"observed_at":"2026-08-15T20:31:22.385561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.389997Z","title":"A convnet for the 2020s","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.389997Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e11e1ded3ca4033365a0f632c4c1e5079009f4fa2fb052f74771d0e96bb257c2","observation_id":"510a553f-6f21-49cc-bde8-b9281a9c09d8","resolution":{"observed_at":"2026-08-15T20:31:22.389997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.393765Z","title":"Statistical theories of mental test scores","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.393765Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:f8edfb5581f036397dd931ae9f2f4fd5f1172349fbdea64bf9d4ed631d0cd0de","observation_id":"b7a25970-5d26-4207-aee6-6fd28ea94224","resolution":{"observed_at":"2026-08-15T20:31:22.393765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-15T20:31:22.398013Z","title":"Starcoder 2 and the stack v2: The next generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.398013Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:2d98b491e7802021f98ff272d17bff0d7c40a3fdae404c19ca0b09bb48aa24b5","observation_id":"4b3f3438-4f4e-4fbb-8926-3b923986b840","resolution":{"observed_at":"2026-08-15T20:31:22.398013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08069","last_updated":"2024-04-03T11:46:48Z","snapshot_observed_at":"2026-08-15T08:12:04.729897Z","submitted_at":"2023-04-17T08:30:02Z","title":"DETRs Beat YOLOs on Real-time Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08069","snapshot_observed_at":"2026-08-15T20:31:22.403072Z","title":"Detrs beat yolos on real-time object detection (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.403072Z"},"links":{"cited_paper":"/paper/2304.08069","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:facf49547ef29520f4484851dc96c8c3a8d1ed1badcc904052d650f017d655cd","observation_id":"185c010e-59c9-49cb-a765-e0518d1e2eed","resolution":{"observed_at":"2026-08-15T20:31:22.403072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.407122Z","title":"Shufflenet v2: Practical guidelines for efficient cnn architecture design","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.407122Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:92510a89e23bb740855eca57ec56fb3d2af6b9b3df95e657d9e21bdad20e45b7","observation_id":"68e80e4e-0ec4-4ab3-8cc7-52569bb61e77","resolution":{"observed_at":"2026-08-15T20:31:22.407122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.359433Z","title":"Item response theory in ai: Analysing machine learning classifiers at the instance level","venue":null,"work_id":"b8e87c22-bed8-4212-af1e-85b6677201f6","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.412164Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:c6ab4037257b72915f18daa563d541262125fe34c9cbc8d475792181edebe3a2","observation_id":"10a60841-6f92-4884-80aa-13ef85b807fd","resolution":{"observed_at":"2026-08-15T20:31:23.363441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.347342Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innova- tion","venue":null,"work_id":"cb2c26d3-03d7-4333-af8c-13f6ef81af29","year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.419114Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:cb7c241992f79eeecf0b5116b7c3d75602b395ece200bf8ec18460ba45cf7bd1","observation_id":"05e2123d-1811-44d4-9e53-2303c1a65651","resolution":{"observed_at":"2026-08-15T20:31:23.351138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07631","last_updated":"2022-10-14T08:26:32Z","snapshot_observed_at":"2026-08-13T14:05:17.042303Z","submitted_at":"2022-10-14T08:26:32Z","title":"Hardness of Samples Need to be Quantified for a Reliable Evaluation System: Exploring Potential Opportunities with a New Task","version":1},"cited_work":{"arxiv_id":"2210.07631","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.07631","snapshot_observed_at":"2026-08-15T20:31:22.848136Z","title":"Hardness of Samples Need to be Quantified for a Reliable Evaluation System: Exploring Potential Opportunities with a New Task","venue":"cs.CL","work_id":"13c619c1-5655-4150-b3bb-1fc7ce416316","year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.427266Z"},"links":{"cited_paper":"/paper/2210.07631","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:01dda9ecb7f0ce40c297c4a7e573194797dbad6af9e5ce16ceee8e0f843786a2","observation_id":"1b362fe1-dcb0-418b-96d7-daf94e7b2605","resolution":{"observed_at":"2026-08-15T20:31:22.853255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01786","last_updated":"2023-05-29T16:40:37Z","snapshot_observed_at":"2026-08-14T23:23:23.284660Z","submitted_at":"2022-11-03T13:19:32Z","title":"Crosslingual Generalization through Multitask Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01786","snapshot_observed_at":"2026-08-15T20:31:22.432267Z","title":"Crosslin- gual generalization through multitask finetuning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.432267Z"},"links":{"cited_paper":"/paper/2211.01786","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e9849cbab6435eab663e112c6f839824a3666671b805f29e55751d41380af0d7","observation_id":"85bbdc71-6c89-41ba-9a33-52f666049856","resolution":{"observed_at":"2026-08-15T20:31:22.432267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.336657Z","title":"Nanogpt api","venue":null,"work_id":"9be63019-eaa5-405d-afd0-7f8e7b8eada5","year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.436818Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e60ff142a7cb85c6bc311741066aa2e9d38ade31aa435fc27955eee04fbba10b","observation_id":"0992e84b-b4ed-42b8-9368-50b528df9858","resolution":{"observed_at":"2026-08-15T20:31:23.340236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.324961Z","title":"Openai api","venue":null,"work_id":"0af44c44-f763-48cc-9a46-9aa812419699","year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.441276Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:1ef7f46884f39fc54fd1c60ded2129a295fc490ede210b37db1966b81507e511","observation_id":"26f54e31-f9da-4119-be76-27941d0c54cd","resolution":{"observed_at":"2026-08-15T20:31:23.328564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-15T20:31:22.445327Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.445327Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:da771c870d84700d51485f82f1950596ec3bacc89776ff134567ccaeaf41b2f8","observation_id":"7b3dc407-6e4c-4b88-aecf-633bdd0efb3c","resolution":{"observed_at":"2026-08-15T20:31:22.445327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.313766Z","title":"Qwq: Reflect deeply on the boundaries of the unknown","venue":null,"work_id":"f09b5ef1-e6a5-4c0d-a6ec-a1ca2b46fcb4","year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.449124Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:5183aa55f037e9267a1179e21a1fa34bf09dc53e8b87ce53cb66d4a4bd8c5a0d","observation_id":"e40f5585-7b66-406c-8cfb-a7f40f44210e","resolution":{"observed_at":"2026-08-15T20:31:23.317677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.301362Z","title":"Design- ing network design spaces","venue":null,"work_id":"acec754f-961a-4c95-9742-bdcf120c9288","year":2020},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.453012Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:084a4af92c87d7d4ce50a096957a32fe9df9a3a00d6b812f58d81dada017870e","observation_id":"9b6ab5d8-4cfe-4e3d-b336-667d7bbff9e5","resolution":{"observed_at":"2026-08-15T20:31:23.305833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.02767","last_updated":"2018-04-08T22:27:57Z","snapshot_observed_at":"2026-08-15T16:54:48.034047Z","submitted_at":"2018-04-08T22:27:57Z","title":"YOLOv3: An Incremental Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.02767","snapshot_observed_at":"2026-08-15T20:31:22.456631Z","title":"Yolov3: An incremental improvement","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.456631Z"},"links":{"cited_paper":"/paper/1804.02767","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:a4e945d3580f89fd3015b10a781287c3fd9eb722f0f5806064b197d9669da161","observation_id":"2f210178-ccef-44ca-8340-f303cec45f4c","resolution":{"observed_at":"2026-08-15T20:31:22.456631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.01497","last_updated":"2016-01-06T06:30:17Z","snapshot_observed_at":"2026-08-14T22:45:50.420062Z","submitted_at":"2015-06-04T07:58:34Z","title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.01497","snapshot_observed_at":"2026-08-15T20:31:22.460344Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.460344Z"},"links":{"cited_paper":"/paper/1506.01497","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:64d7b3d380fec1a6e8f774c59e48b52eb462beb4be06abc3dbfe16d3cea13f61","observation_id":"e2ca54af-e899-4166-af10-b8ccde374ef4","resolution":{"observed_at":"2026-08-15T20:31:22.460344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.290284Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":"e1b6c907-7160-4489-ae8d-d3e97f54f9b4","year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.464163Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:5a47de5eeb333396b4cade65cdf27c8a59036100675481b7ce8c1d182f749a6d","observation_id":"54776c28-cf65-4250-be54-976fed31942a","resolution":{"observed_at":"2026-08-15T20:31:23.293931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.279356Z","title":"Learning with bad training data via iterative trimmed loss minimization","venue":null,"work_id":"49eab999-db9c-4e41-ad35-bc264c0c164e","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.467602Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:0fd669d69bc3a089fba4ca70468875a198476cd99d76d18bac0ba239c9584548","observation_id":"e7c2f2f9-7442-4571-a82a-efcff6b1ab1c","resolution":{"observed_at":"2026-08-15T20:31:23.283072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.267409Z","title":"Motion transformer with global inten- tion localization and local movement refinement","venue":null,"work_id":"d133de32-9532-4cd2-b20c-7417247429bd","year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.471081Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:a775953cbdd53c6ce3c8976fe64b13d1d6540d7426f8b7a90799f1da9fb9d487","observation_id":"91fbf034-0e90-4475-aa42-61b9fd695415","resolution":{"observed_at":"2026-08-15T20:31:23.271441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T23:20:42.336514Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-15T20:31:22.474764Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.474764Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:069fcad94589e871347b65e8ae779f0e7bcf2dca8523fe3e14b46d82e7e6883c","observation_id":"bc92e98e-a57d-4e6a-b12b-73ddde9f7540","resolution":{"observed_at":"2026-08-15T20:31:22.474764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.255909Z","title":"less is more","venue":null,"work_id":"705de9a7-6d94-40d1-a177-a920e3f58379","year":2010},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.478941Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e10fcfbf9f4c4963c6c41759730f6e0e7274c193b6378d7fb3822bb2180734e7","observation_id":"506146ab-f514-41a3-b210-d5d84c1df3f9","resolution":{"observed_at":"2026-08-15T20:31:23.259329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11696","last_updated":"2025-06-11T06:23:13Z","snapshot_observed_at":"2026-08-12T22:42:46.025873Z","submitted_at":"2024-09-18T04:32:08Z","title":"RMP-YOLO: A Robust Motion Predictor for Partially Observable Scenarios even if You Only Look Once","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11696","snapshot_observed_at":"2026-08-15T20:31:22.483130Z","title":"Rmp-yolo: A robust motion predictor for partially observable scenarios even if you only look once","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.483130Z"},"links":{"cited_paper":"/paper/2409.11696","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b1e32b0a49b917d507e08783253207b562afbee0e1ec8b721a8449a648be35ca","observation_id":"5fd0d61e-4888-4420-b9ac-0eb51d2c84cc","resolution":{"observed_at":"2026-08-15T20:31:22.483130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.244770Z","title":null,"venue":null,"work_id":"ce066ed8-3e89-4733-bd42-3d5b83926748","year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.488138Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:fd7c6d8a47359655b91010317cdc3934cc31f94d8adb140cf1176149a7747c3c","observation_id":"8c02adce-d84f-43e4-ab1c-0647989310d4","resolution":{"observed_at":"2026-08-15T20:31:23.248667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.492111Z","title":"Impact: Behavioral intention-aware multimodal trajectory prediction with adaptive context trimming","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.492111Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:b0a9188c188f85c233252a055b31e6dc0841fa25e7299613a70f649cf597a2ea","observation_id":"dda650c5-7fd0-4906-968f-674aa80e9aa6","resolution":{"observed_at":"2026-08-15T20:31:22.492111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.10795","last_updated":"2020-10-15T05:53:46Z","snapshot_observed_at":"2026-08-11T21:19:06.148202Z","submitted_at":"2020-09-22T20:19:41Z","title":"Dataset Cartography: Mapping and Diagnosing Datasets with Training Dynamics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.10795","snapshot_observed_at":"2026-08-15T20:31:22.496189Z","title":"Dataset cartography: Mapping and diagnosing datasets with training dynamics","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.496189Z"},"links":{"cited_paper":"/paper/2009.10795","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:28c509006b4dea05893a8819da8e7668dcde1d3a4f8ad26a5f460a63a8634f79","observation_id":"c5b9316b-d121-47cf-99b8-75d8f565caee","resolution":{"observed_at":"2026-08-15T20:31:22.496189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.500647Z","title":"Re- thinking the inception architecture for computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.500647Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:70e29792d353926c548234c4150f0cb7a63ae3e5ccb8428f0d77149a0262b421","observation_id":"9c0dd58f-1697-4986-aff4-64eac69a3e2d","resolution":{"observed_at":"2026-08-15T20:31:22.500647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.223865Z","title":null,"venue":null,"work_id":"2582a5b3-f6b5-46d7-b86f-4c67ee1f606b","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.504269Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:94102d3c7987566e549a6187e2f4bdd1ba053b5ad085edb8d216f88ab3e4da5c","observation_id":"98c256f7-5129-422a-aa0f-03e218d0099a","resolution":{"observed_at":"2026-08-15T20:31:23.227724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-15T20:31:22.507932Z","title":"Gemma 3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.507932Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:e970b59c5e9a15d30d155fa7a7bbbc5c8ef21d96d856b610c95f4deea934d02c","observation_id":"d4f37b32-f7e3-4d9d-b8bb-4a5a61140d9f","resolution":{"observed_at":"2026-08-15T20:31:22.507932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.211574Z","title":"Fcos: Fully convolutional one-stage object detection","venue":null,"work_id":"06f9b6b1-c150-475b-8faf-a5361edba18e","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.511999Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:9c675e7438110e4233eb1eaa1460c68d92befa06a870db560a5f5c8b24949f9a","observation_id":"0483093f-ced2-46a5-ad57-0a177742c4a7","resolution":{"observed_at":"2026-08-15T20:31:23.216108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.199134Z","title":"An empirical study of example forgetting during deep neural network learning","venue":null,"work_id":"c0119bb8-9023-482d-9c31-c56e5d591069","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.516049Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:523619a6f4e2f2a4317ad3d31693008835f2ffb57174c56c250a816c4869dc7b","observation_id":"faaf98d3-64da-4c8c-8bb7-824307017272","resolution":{"observed_at":"2026-08-15T20:31:23.203085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03073","last_updated":"2022-03-09T01:55:24Z","snapshot_observed_at":"2026-08-13T16:28:38.155783Z","submitted_at":"2022-03-07T00:02:11Z","title":"ILDAE: Instance-Level Difficulty Analysis of Evaluation Data","version":2},"cited_work":{"arxiv_id":"2203.03073","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.03073","snapshot_observed_at":"2026-08-15T20:31:22.664507Z","title":"ILDAE: Instance-Level Difficulty Analysis of Evaluation Data","venue":"cs.CL","work_id":"c771038f-b6f7-4f2b-848a-511fbb0a7a93","year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.519847Z"},"links":{"cited_paper":"/paper/2203.03073","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:aa3a19b1c59f878d8d13fe8c1ae17e9e76b0a7e1e2aab21573147ddb766f87a0","observation_id":"0f794319-ac0f-45ca-b123-77726357382b","resolution":{"observed_at":"2026-08-15T20:31:22.668717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.186871Z","title":"Grandmaster level in starcraft ii using multi-agent reinforcement learning","venue":null,"work_id":"a09a593a-6ecb-4ad1-9d3b-d9c752b35beb","year":2019},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.523669Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:fa25376fdf6fa3953d679867e07dfe2336788fb7b272791157395e0b89e29e1e","observation_id":"49841600-3125-489a-9c68-f203c541e15e","resolution":{"observed_at":"2026-08-15T20:31:23.190854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.07156","last_updated":"2018-07-05T15:50:25Z","snapshot_observed_at":"2026-08-14T19:34:38.227355Z","submitted_at":"2018-03-19T20:37:40Z","title":"State and Parameter Estimation for Natural Gas Pipeline Networks using Transient State Data","version":2},"cited_work":{"arxiv_id":"1803.07156","doi":null,"metadata_source":"pith","pith_arxiv_id":"1803.07156","snapshot_observed_at":"2026-08-15T20:31:22.645335Z","title":"State and Parameter Estimation for Natural Gas Pipeline Networks using Transient State Data","venue":"cs.SY","work_id":"69122186-f6b0-447c-bd2d-05c0a0323c88","year":2018},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.527220Z"},"links":{"cited_paper":"/paper/1803.07156","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:158a688e9689f9f84121fbff8cbeddec3db6d4513060a033164e30d5d74e667e","observation_id":"d0573762-30bc-4ec0-b29e-d64d9c4ed5de","resolution":{"observed_at":"2026-08-15T20:31:22.651547Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:23.174695Z","title":"Towards heterogeneous long-tailed learning: Benchmarking, metrics, and toolbox","venue":null,"work_id":"bd5a554e-0aa0-4438-87a1-07b783d2d488","year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.530903Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:f649afbafec7c339c94fc7c85ed72684d0510bff006249533150731ffb2c8072","observation_id":"449890c5-2e70-45ad-941f-28968f1b746d","resolution":{"observed_at":"2026-08-15T20:31:23.178805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:22.534529Z","title":"Aggregated residual transformations for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.534529Z"},"links":{"citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:3c0d18b020430b4cdfddec413975b091a76450f0bf149b6a02ca6764a73021e3","observation_id":"963a6481-e052-40c4-872d-0e3bfe12deac","resolution":{"observed_at":"2026-08-15T20:31:22.534529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T20:31:22.538031Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.538031Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:16284478edb45643662e5b2782da808caebe6aea5e92d99a6b05984d6a4aee3f","observation_id":"e75d02a0-a59c-4fcf-8e11-1db13ef7e842","resolution":{"observed_at":"2026-08-15T20:31:22.538031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03601","last_updated":"2024-08-14T04:31:32Z","snapshot_observed_at":"2026-08-14T13:53:47.225278Z","submitted_at":"2024-08-07T07:41:01Z","title":"DRAMA: An Efficient End-to-end Motion Planner for Autonomous Driving with Mamba","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03601","snapshot_observed_at":"2026-08-15T20:31:22.541425Z","title":"Drama: An efficient end-to-end motion planner for autonomous driving with mamba","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.541425Z"},"links":{"cited_paper":"/paper/2408.03601","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:1881e7ed914b4949442f37fefbc69b612fa71af3d23e897b0a7c620791aecdab","observation_id":"d59e38ff-aa35-4cc6-81c0-ea11dd86dc0c","resolution":{"observed_at":"2026-08-15T20:31:22.541425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08955","last_updated":"2020-12-30T05:05:15Z","snapshot_observed_at":"2026-08-09T00:12:39.900120Z","submitted_at":"2020-04-19T20:40:31Z","title":"ResNeSt: Split-Attention Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08955","snapshot_observed_at":"2026-08-15T20:31:22.547377Z","title":"Manmatha, Mu Li, and Alexander Smola","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.547377Z"},"links":{"cited_paper":"/paper/2004.08955","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:00d651bf0b04de967920c229de1ae1688d15d176e05ee63a349af140e4a63e5d","observation_id":"971d3587-19dd-419c-8691-f399095e92c6","resolution":{"observed_at":"2026-08-15T20:31:22.547377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03605","last_updated":"2022-07-11T10:30:29Z","snapshot_observed_at":"2026-08-07T03:38:32.486362Z","submitted_at":"2022-03-07T18:55:26Z","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03605","snapshot_observed_at":"2026-08-15T20:31:22.551267Z","title":"Dino: Detr with improved denoising anchor boxes for end-to-end object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.551267Z"},"links":{"cited_paper":"/paper/2203.03605","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:ef097b121d772cac1b9fc240e12a6d2b596d15986010e4d963f9a0ae6190aa1b","observation_id":"59a37317-f864-4d40-ad32-ac04204e8745","resolution":{"observed_at":"2026-08-15T20:31:22.551267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10512","last_updated":"2025-05-08T03:45:24Z","snapshot_observed_at":"2026-08-13T11:14:37.352302Z","submitted_at":"2023-06-18T09:54:33Z","title":"Position: AI Evaluation Should Learn from How We Test Humans","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10512","snapshot_observed_at":"2026-08-15T20:31:22.554944Z","title":"From static benchmarks to adaptive testing: Psychometrics in ai evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:22.554944Z"},"links":{"cited_paper":"/paper/2306.10512","citing_paper":"/paper/2505.12844"},"observation_digest":"sha256:c6b5c311f04744b4400eeec503926c4debca7e884bc4edf6aceeeddfdd9abf13","observation_id":"26c8dae4-9a57-402b-8180-eff2ccf79aab","resolution":{"observed_at":"2026-08-15T20:31:22.554944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12844","last_updated":"2025-05-24T05:25:10Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-16T07:34:20.019974Z","submitted_at":"2025-05-19T08:30:13Z","title":"AGI-Elo: How Far Are We From Mastering A Task?"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":66,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 0 inbound Pith citation observations for arXiv:2505.12844."}