{"as_of":"2026-08-01T15:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1df0b2d8b14421912944ac3e86eac48008490c88fe73b632cfb2ac3e0993193e","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T16:09:07.114453Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T01:54:10.297931Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-01T06:16:24.888925Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"cited_work":{"arxiv_id":"2604.11778","doi":"10.48550/arxiv.2604.11778","metadata_source":"pith","pith_arxiv_id":"2604.11778","snapshot_observed_at":"2026-08-01T06:16:24.888925Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","venue":"cs.CL","work_id":"35c34246-00d8-4855-b3b5-e06b89d952bb","year":2026},"citing_paper":{"arxiv_id":"2607.25675","last_updated":"2026-07-28T12:53:30Z","snapshot_observed_at":"2026-08-01T01:54:09.150568Z","submitted_at":"2026-07-28T12:53:30Z","title":"DecoEvo: Score-Decoupled Co-Evolution of Solver and Rubric-Generator Skills in Text Space","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T01:54:10.297931Z"},"links":{"cited_paper":"/paper/2604.11778","citing_paper":"/paper/2607.25675"},"observation_digest":"sha256:1d374c57fac5f6932196b7627e7e9fb62934b0dc5d5e495b3a229e885b9dfa77","observation_id":"3cd5a9ed-3e9b-44bb-8875-079919e4b148","resolution":{"observed_at":"2026-08-01T01:56:12.212710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.11778","snapshot_observed_at":"2026-07-31T19:49:39.646529Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28037","last_updated":"2026-07-30T11:18:47Z","snapshot_observed_at":"2026-08-01T15:03:45.871897Z","submitted_at":"2026-07-30T11:18:47Z","title":"ClawTrack: Towards Trace-Level Evaluation and Improvement of Real-World Autonomous Agents","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T19:49:39.646529Z"},"links":{"cited_paper":"/paper/2604.11778","citing_paper":"/paper/2607.28037"},"observation_digest":"sha256:b1db145aa7590faa56a36eadd010de3a4c077dbf16ed43eea40c9df67cbd5e78","observation_id":"60424a0e-76ca-48fd-aae6-0c05591112d9","resolution":{"observed_at":"2026-07-31T19:49:39.646529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.11778/citation-record","integrity":"/paper/2604.11778/integrity","json":"/paper/2604.11778/citation-record.json","paper":"/paper/2604.11778"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95da0e62-49fe-41ce-b5d4-3cad29efef94","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:ad2b9a04515ee5008a82e2e315378fb5f38332d7c92b0150bff7b75701141119","observation_id":"5f231b57-86a5-48fe-b968-864e781eff5d","resolution":{"observed_at":"2026-05-17T16:50:00.054632Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"02d49219-ca22-4d5e-975e-5a88ff4614f7","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:f79f2abc91b5ae1103c0d350dded928e9be0630fdcceee77a5e71e66e7dee4ac","observation_id":"60a60b64-f0d0-476d-9f80-f6ef5588bc30","resolution":{"observed_at":"2026-05-17T16:50:00.079054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8971f933-39d3-4d9c-aad9-e644fb62e1c8","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:bba9a2288263dce6d9310e13078e24230ea1d60f7802b30be2aa4fe140bee3e2","observation_id":"99eecef3-820c-43a4-8a56-7b8031b53d8f","resolution":{"observed_at":"2026-05-17T16:50:00.051508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"53a48645-0191-4e49-9f97-9ae62999daef","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:d9dc70e71568cd0f4717f518b75e9b2003d6433c7a268ab9504dc4db9e31a76a","observation_id":"30bbc333-6f03-4288-b29c-bfbf7e2d172a","resolution":{"observed_at":"2026-05-17T16:50:00.045333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"60fe3952-73b4-458e-9498-524b7f2e9649","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:43138645af29513b8661b180a19269f7eb5be604a8061d479e089e7f6fdfd853","observation_id":"3cc22ba3-1315-4e74-ab48-1d3db397cdba","resolution":{"observed_at":"2026-05-17T16:50:00.038911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc991216-12cf-4905-8e67-a49da2104f30","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:0cb608788e514c0a7e74d24824d7288f2e1e42c901dc9a17262ef4b89cb1c557","observation_id":"71abe3a5-efc4-4a9b-9136-6e61dd4c5832","resolution":{"observed_at":"2026-05-17T16:50:00.058078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9c7c2a06-66fc-4199-9ad3-99fde4b8e14a","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:aa5f7fd7038e034b9136a9c88253d8f60b801dd176ca8519b886bdda8c042c7e","observation_id":"26fa5e3a-8b08-436e-8a95-9af0da2adf1a","resolution":{"observed_at":"2026-05-17T16:50:00.068726Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Among them, there was one person who ordered espresso","venue":null,"work_id":"a193dc16-7c13-4d63-860c-28973df08114","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:efe8d614ae8cd16e5dba1b8440796ed800b7640e6071ede0a1638ea4f4838b16","observation_id":"b2e3c2d4-a7a8-40bf-b70d-176dc2684400","resolution":{"observed_at":"2026-05-17T16:50:00.061823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"00295f26-b927-4857-ab16-b791d2a4e62a","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:9fd49daa168f28ebf8652c764ca1c1548ce464bcc6afde55abd22fed7a73aa81","observation_id":"ff24f900-9379-4be2-a4a8-f91c7b9f9e25","resolution":{"observed_at":"2026-05-17T16:50:00.065573Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"60668c59-75e2-40b9-b488-01fc62b1cf89","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:fcb68bb3c835b137842b92a5b681c7e25a2fac23bfee23bf67e6110da81ec840","observation_id":"ae159013-4ef5-432e-82f3-ef0a49b2c5f2","resolution":{"observed_at":"2026-05-17T16:50:00.042242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"96d76b98-7e35-44d1-81f1-ac7771459158","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:f4c488d1469e7489d9a4a675faedd97716846fb8cbaff25c327db951f6dab75e","observation_id":"d69b5c4c-9671-433e-8259-7ddcccbd900e","resolution":{"observed_at":"2026-05-17T16:50:00.082248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bef2dc4-6f2f-43bc-8a3a-7c9c50496c69","year":2070},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:155eb9e805a6abd3c69d6fc1bb8cd46cb81765a7ec15bc957e360b75a2e86576","observation_id":"86a291f3-6929-4c6b-ae69-4adfeb1cbc22","resolution":{"observed_at":"2026-05-17T16:50:00.048413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb2d8069-0c30-4997-8921-31ef60cf4d1d","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:07a3becf6f3c902a2ce83e31d84ae38ed3f12da1a5c6ebedc237f4694be3c0f4","observation_id":"6fcd68d2-b7da-484a-a3f8-7a21107b98c8","resolution":{"observed_at":"2026-05-17T16:50:00.071733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38bb7d8c-f2d7-4e30-b0f0-e4fe039363a9","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:313e44ff3d283809cbe27b16e6997c53145dd957e6a8d1324186feafe3b07884","observation_id":"cee4f2b8-0995-456d-b057-891ffbd2a569","resolution":{"observed_at":"2026-05-17T16:50:00.085456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We’ve lost a friend. The murderer is likely hiding in the crowd. Please be careful","venue":null,"work_id":"72e4de83-2139-4572-938d-020650a97401","year":null},"citing_paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T16:09:07.114453Z"},"links":{"citing_paper":"/paper/2604.11778"},"observation_digest":"sha256:a9681a53a54dc4d0a5dbdbb2b998b4ed198382aab52a9b5ac1e91577eedc7b6e","observation_id":"03374e5a-4991-441e-99a2-4c4afd0f327f","resolution":{"observed_at":"2026-05-17T16:50:00.075935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.11778","last_updated":"2026-04-13T17:44:25Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:00:08.171601Z","submitted_at":"2026-04-13T17:44:25Z","title":"General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":12,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 1 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 2 inbound Pith citation observations for arXiv:2604.11778."}