{"as_of":"2026-08-12T23:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a44ad062e21c1ea44ff88121b8f43738257a98e79a98c8613d114e7eb387c50","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:09:41.633345Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02808/citation-record","integrity":"/paper/2412.02808/integrity","json":"/paper/2412.02808/citation-record.json","paper":"/paper/2412.02808"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:44.073716Z","title":"Vision-based navigation and guid- ance for agricultural autonomous vehicles and robots: A review","venue":null,"work_id":"85eb0d75-96aa-471c-b98b-4950e8ea7b8d","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.890762Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:6e4ece9b624431b45515d511e011ef446dd152852d1d0e4851898bb0fd1afd84","observation_id":"9f40f47d-517e-48ee-a829-42e75f313b35","resolution":{"observed_at":"2026-08-11T23:09:44.080832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:44.024722Z","title":"Simple online and realtime tracking","venue":null,"work_id":"bed67567-81fa-43cf-9f99-c436dffcf0a2","year":2016},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.912117Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:6d4f5c3d79787ff81a48a102b11d0f2a2332bc75c291ba18a542c212ee5ea773","observation_id":"46485d63-9443-4c4b-8b42-2fd6964a1f83","resolution":{"observed_at":"2026-08-11T23:09:44.043203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.997419Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"eacfa928-9164-48da-b2e5-a4c243e012dc","year":2020},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.919401Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:0fdcf222d7d24363c5b4cce62f6fb41784529e30892ead013afe0eabd0353b13","observation_id":"c1f33aec-3cfb-4241-b0d0-1e10087b2553","resolution":{"observed_at":"2026-08-11T23:09:44.004025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.958448Z","title":"Counterfactual critic multi- agent training for scene graph generation","venue":null,"work_id":"3c63c311-12e0-48ba-83dc-1454aadb45d0","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.938695Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:e69aceaf2bc86a151aa7e6aeff43a01ea7723072a07a737b864c7c8b532ba766","observation_id":"c948698f-3d11-48b6-bb62-7d9d47cf0e8c","resolution":{"observed_at":"2026-08-11T23:09:43.967327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.927270Z","title":"Toward general cross-modal signal reconstruction for robotic teleop- eration","venue":null,"work_id":"beee520e-8dcd-4142-8ca9-7b9e28d50337","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.944461Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:ccc549dff21f44d67f15f4c7a9752d20ae07ba76f15a2100de1cc0404b9a0551","observation_id":"f6be6771-6831-460b-942b-3fee3c19eef0","resolution":{"observed_at":"2026-08-11T23:09:43.933712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.900186Z","title":"Masked-attention mask transformer for universal image segmentation","venue":null,"work_id":"42268cba-9605-4b9a-a145-e805f8ca1983","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.962235Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:afb4628e3f2a4bdee1f127dabcc479856c49d55be9e795ead175e0eb5e4264c3","observation_id":"72f42c6b-fbf5-41a9-9810-939909317814","resolution":{"observed_at":"2026-08-11T23:09:43.909577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:40.969186Z","title":"Recovering the unbiased scene graphs from the biased ones","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.969186Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:3fb086d25c912d84d2c04fa8b252286634ee641b129325dc7c725f6e72da2db5","observation_id":"94b2215f-f170-4579-9afb-4f8c31e13805","resolution":{"observed_at":"2026-08-11T23:09:40.969186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.832573Z","title":"Nodis: Neural ordinary differential scene understanding","venue":null,"work_id":"73207005-d0fc-47d2-a0ad-f652351a0274","year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.976064Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:637b77b93abe33a10fd4707237584c2b6b6dd3a2e6f110bc0f3f1aa278f2dbae","observation_id":"39eba226-b65e-4b2d-8b53-a5137ad52084","resolution":{"observed_at":"2026-08-11T23:09:43.854321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:40.985212Z","title":"Spatial-temporal trans- former for dynamic scene graph generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.985212Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:41c12032732ca7224b5c501ba957bef58f5f34663aa70986e2171e647e417977","observation_id":"1a9eaca9-de0e-4d24-bd8d-ad16c7555960","resolution":{"observed_at":"2026-08-11T23:09:40.985212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.730828Z","title":"Meva: A large-scale multiview, multimodal video dataset for activity detection","venue":null,"work_id":"0ae5d78f-0084-41b7-a213-e2556fc61013","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:40.997934Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:f03e31742e9b07e89b7ebe0cbbb660f7b753772aa3b40ea00c2a9e9828ff0eb4","observation_id":"c07ccba5-f62c-479a-83a6-981c8ba695da","resolution":{"observed_at":"2026-08-11T23:09:43.743320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.694411Z","title":"Scaling egocentric vision: The epic- kitchens dataset","venue":null,"work_id":"200fab11-476c-46ef-a7eb-14f18db7fdb9","year":2018},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.002807Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:4ca69a6a6469da4800d0e8283d984adcc213c4bb31eeed78b09c405dc47410d6","observation_id":"4afc67cc-ffcf-4a38-8dc9-69c6c16a489d","resolution":{"observed_at":"2026-08-11T23:09:43.705835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.653063Z","title":"Gabriellav2: Towards better generalization in surveillance videos for ac- tion detection","venue":null,"work_id":"ea2d6722-ff92-4cae-a292-ec8276aceb4f","year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.009675Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:b67b39ebdc54acdf01e62846ffd7a8727b8d6087a87fab73233a37d13ea90f4a","observation_id":"4e434981-b054-46af-88f1-e2ab4b02ebc9","resolution":{"observed_at":"2026-08-11T23:09:43.664071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.598881Z","title":"Exploiting long-term de- pendencies for generating dynamic scene graphs","venue":null,"work_id":"32358c22-a917-47e2-a92b-766c1f9292f0","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.019689Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:b95e062c0bb22bd2073a52ddf74671dba7e5e21f1f1279b870dd981215d500ed","observation_id":"f7d61b2c-949d-4c2f-a682-a84d601df0a9","resolution":{"observed_at":"2026-08-11T23:09:43.609029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.567602Z","title":"Drg: Dual relation graph for human-object interaction detection","venue":null,"work_id":"64b15379-fd30-4d31-97d1-32c2da0aa49d","year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.024902Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:8b62f0462d4a0a3dcd148fa4f859b83424260f618f31a257c67e6f77d29cfe39","observation_id":"2e30cec9-b8ee-431c-be7e-712afdfdabb9","resolution":{"observed_at":"2026-08-11T23:09:43.576600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.030335Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.030335Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:5725b29c4bfc34ea493549abff949e4321368494674147250663da3fbaa9c896","observation_id":"1e9b16a7-ec6c-4aee-81df-e00d69bfbca2","resolution":{"observed_at":"2026-08-11T23:09:41.030335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.516853Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"9d7e2286-d8ee-4eb7-b552-749c408e556a","year":2016},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.042857Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:c90d8bbee4819f9a7de65ccce197117bac99aeb544238d0610c6fac6fc2cbebb","observation_id":"fa40edd0-9eb5-4391-be8f-8f9e43b24a07","resolution":{"observed_at":"2026-08-11T23:09:43.529322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.473909Z","title":"Detecting human-object interaction via fab- ricated compositional learning","venue":null,"work_id":"13fffda2-6114-4765-8b1d-bf4710782816","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.055623Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:3b61fbdc7aa7e68c0dcb3e71689d06ad2db01ae83bca6bc21fa3d5b050495877","observation_id":"ad50d2e6-0d8d-4b0c-b1bf-d13642defef2","resolution":{"observed_at":"2026-08-11T23:09:43.484970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.429515Z","title":"Discovering human-object interaction concepts via self-compositional learning","venue":null,"work_id":"8bd32909-637a-4ecc-9a4e-8bb71971e448","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.064577Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:8c55d2b6eb3ed4527380326fe229b4f6c91fa3ef6399c7715a418b766f33305f","observation_id":"ea02b483-2234-4eed-8207-9c1053bd3c2e","resolution":{"observed_at":"2026-08-11T23:09:43.446809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.409038Z","title":"Dds: Decoupled dynamic scene-graph generation network","venue":null,"work_id":"740c3704-ed0a-40e7-8b59-cfadd383ccb7","year":2025},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.076967Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:feed6d1ff090cd2919f1cb3c9df88c1ee66ce3af2c96e3f7e925938334b5d003","observation_id":"61f6cb04-070d-4bad-9859-7abd2a33f412","resolution":{"observed_at":"2026-08-11T23:09:43.414660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.347577Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"0735e1de-d705-4ac5-b0e9-235d47df779a","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.118592Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:cc988f842160f4d9222707372bf6eb43d8644a78c2684e3b4c4ab36acc378eb7","observation_id":"f0609b0a-ae6c-4e43-a9bf-7fe7f46bd28b","resolution":{"observed_at":"2026-08-11T23:09:43.355118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.308348Z","title":"Action genome: Actions as compositions of spatio- temporal scene graphs","venue":null,"work_id":"58e26c16-8b68-471b-ab77-ab7353daf282","year":2020},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.136827Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:501c1233ab36810e034ddd6b23ddca64b5492461087f252e5156c744d382fc04","observation_id":"ccd0b3c5-9c6f-4db3-938e-8394433e950b","resolution":{"observed_at":"2026-08-11T23:09:43.319224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.258373Z","title":"Detect- ing human-object relationships in videos","venue":null,"work_id":"b806777a-4e45-400c-bf8e-3d16cb525634","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.153650Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:210a1c2348559536d9d42ed106b5dab8c10d3c82489b84fdb39bda5825d57be3","observation_id":"6412021c-a734-4991-a90c-48e7ce1eceb4","resolution":{"observed_at":"2026-08-11T23:09:43.276060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.216245Z","title":"Image retrieval using scene graphs","venue":null,"work_id":"5dd79a86-9f42-4574-8e82-72359521de4f","year":2015},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.184393Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:a5065c470fa4ddad4231e3a95d96fda18894ede207e9fa211a2b87fcf18c11cd","observation_id":"926a281a-b670-4ae2-8520-831bbc620cb8","resolution":{"observed_at":"2026-08-11T23:09:43.229408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.179933Z","title":"Iterative scene graph generation","venue":null,"work_id":"219c2055-3310-4a84-b20b-eb38039becd4","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.198813Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:7e28519009752e1e679faac502f63f8c1863d0f41b909d5cc7179b99c2d3d9b3","observation_id":"dcfef432-3329-4fbe-8fe8-6dbc18eb8e8a","resolution":{"observed_at":"2026-08-11T23:09:43.193473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.129845Z","title":"Learning by tracking: Siamese cnn for robust tar- get association","venue":null,"work_id":"445caab4-fe39-4904-8e3f-241d9e844f76","year":2016},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.208774Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:2b41c36008efacdf7976c28e1c1931a9c0bccd1ddff2a4a827bb9f61cc1c0d24","observation_id":"5e16ea81-a879-4681-9ffd-08ef6732caad","resolution":{"observed_at":"2026-08-11T23:09:43.144377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.092551Z","title":"Video k-net: A simple, strong, and unified baseline for video segmentation","venue":null,"work_id":"ff00aa57-8be6-4a72-b14c-ab6f670b401f","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.214353Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:7c26188499e9fe3128a6cfd06feea2aef7e2c49b50ecf92f5ed438fe971f44af","observation_id":"066da582-3491-40e3-884c-62b1af491e19","resolution":{"observed_at":"2026-08-11T23:09:43.109666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.047430Z","title":"Dynamic scene graph generation via anticipatory pre-training","venue":null,"work_id":"c5e36d3f-8b07-40d6-9026-b16afcd17463","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.221078Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:cf467caf0594f1a76ca486540fd0de57447865063579d0ef02047a60f14725f5","observation_id":"12fc6e24-8af7-4c96-b367-86b115b0487c","resolution":{"observed_at":"2026-08-11T23:09:43.055815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.009025Z","title":"Transferable interactiveness knowledge for human-object interaction de- tection","venue":null,"work_id":"744995a8-2589-41ca-b7da-44e6cc4ba276","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.227933Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:ac4fab1b294bf4892157e6cbb09c6d70fb60666f5faeff696231532e0ec722ef","observation_id":"bfaca491-7855-4092-978e-7eeb8b975290","resolution":{"observed_at":"2026-08-11T23:09:43.025118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.240683Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.240683Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:943b2393b998f2678ae4e26d416a7d2000c556b9ef288bb07f41f869b69cb88e","observation_id":"9da5184e-a917-45d4-833e-89c9ce6e0597","resolution":{"observed_at":"2026-08-11T23:09:41.240683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12479","last_updated":"2024-01-23T04:17:42Z","snapshot_observed_at":"2026-08-02T22:47:14.606648Z","submitted_at":"2024-01-23T04:17:42Z","title":"TD^2-Net: Toward Denoising and Debiasing for Dynamic Scene Graph Generation","version":1},"cited_work":{"arxiv_id":"2401.12479","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.12479","snapshot_observed_at":"2026-08-11T23:09:41.849726Z","title":"TD^2-Net: Toward Denoising and Debiasing for Dynamic Scene Graph Generation","venue":"cs.CV","work_id":"574defbf-eece-4aa8-b193-675875c37614","year":2024},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.255615Z"},"links":{"cited_paper":"/paper/2401.12479","citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:a792a42c8f403639e762fb601692fbbd95ddd77a5d3565d69f912ed2f51dbb17","observation_id":"470a2ddc-273f-4d90-ba19-dff4a6370d2e","resolution":{"observed_at":"2026-08-11T23:09:41.860191Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.964150Z","title":null,"venue":null,"work_id":"7b4e2720-2101-4432-b23c-ca2cfd2480bd","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.276613Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:9ca1f254bfe030aba0b845e05ea76dc07e84e62ab2681d0d818b054f85625daf","observation_id":"261885c0-e7d2-4204-8b04-8102dac6b2d5","resolution":{"observed_at":"2026-08-11T23:09:42.970323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.932495Z","title":"Ampli- fying key cues for human-object-interaction detection","venue":null,"work_id":"41c52130-2bdb-4d35-8029-0fbd9c6f5101","year":2020},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.283059Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:d3ca1053f8da2ef809305e41f3c8d2e194459ed5bec81c687d98621e9fd100d6","observation_id":"bdc8d45b-f6aa-4792-9b8f-0e8814b13819","resolution":{"observed_at":"2026-08-11T23:09:42.940112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.887865Z","title":"Prior knowledge-driven dy- namic scene graph generation with causal inference","venue":null,"work_id":"7c4f3de3-11c3-4254-bfd7-f7d990167376","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.291867Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:2d1df6893f7552dac0535135d767c24b10250c7a9e804e95f2f05615654f7486","observation_id":"3c2f8fac-bf54-4922-8454-0c38eb3ffb02","resolution":{"observed_at":"2026-08-11T23:09:42.901492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.858731Z","title":"Context-aware scene graph generation with seq2seq transformers","venue":null,"work_id":"6f012661-b4ae-40e4-b3cc-3f82f94a2bc7","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.300229Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:e14e5fe02a9395218b7879f03de07d33d27ac94625029c66b799adf24541839c","observation_id":"e0f1a6e0-3a13-4ca9-b03a-14717c937d7e","resolution":{"observed_at":"2026-08-11T23:09:42.871249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.833116Z","title":"Trackformer: Multi-object track- ing with transformers","venue":null,"work_id":"6a29a658-bc6f-4a4e-956d-93ef1d9c2deb","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.313742Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:9e0be92d8475cf37250311b5eafc7cd240658bcb69b79f11311ce35356a4443f","observation_id":"c48b1e1d-6c00-4bcb-ae66-c9d009c7fdd4","resolution":{"observed_at":"2026-08-11T23:09:42.840752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.804874Z","title":"Roy- Chowdhury","venue":null,"work_id":"bc31b830-0599-4fe7-80f8-40b167fb20cf","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.322408Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:635cb4e6c7077aa4719e75a3b4f3373becf8c2b1cb74feddd83b283e6212cc55","observation_id":"2447a9ec-2e78-4a61-8a7e-98f67eaf6d3c","resolution":{"observed_at":"2026-08-11T23:09:42.814193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.767143Z","title":"Motion-aware contrastive learning for temporal panoptic scene graph gen- eration","venue":null,"work_id":"e2a01509-58d8-4d8d-b455-c02f72f64216","year":2025},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.332202Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:42061e0992f27d08255a0fe2592c1ed27b10d432bcde75b7a681d704de2dd82d","observation_id":"58291a15-aa32-4fc6-acdb-aca206e05522","resolution":{"observed_at":"2026-08-11T23:09:42.774374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.348526Z","title":"Computer vision-based hand gesture recognition for human-robot in- teraction: a review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.348526Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:b3f7cdea2b664bae1aa565d2331f8c224ceabd9d5caa6d7d2f08151e1b8193ba","observation_id":"0926515c-57de-4578-b741-c7aeb729b896","resolution":{"observed_at":"2026-08-11T23:09:41.348526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10879","last_updated":"2024-04-25T18:06:46Z","snapshot_observed_at":"2026-08-07T18:12:39.201840Z","submitted_at":"2023-10-16T23:14:56Z","title":"BLoad: Enhancing Neural Network Training with Efficient Sequential Data Handling","version":2},"cited_work":{"arxiv_id":"2310.10879","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.10879","snapshot_observed_at":"2026-08-11T23:09:41.784921Z","title":"BLoad: Enhancing Neural Network Training with Efficient Sequential Data Handling","venue":"cs.LG","work_id":"9ec3df33-1ec6-453e-9b3e-064c3effb3d6","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.360011Z"},"links":{"cited_paper":"/paper/2310.10879","citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:45aa9785f20d61b1273d2150f86576be4779287f6397c9b24cd89d8093679201","observation_id":"3007b699-7e46-4f44-9ca7-997f7cb23324","resolution":{"observed_at":"2026-08-11T23:09:41.811582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.690342Z","title":"Deep network flow for multi-object track- ing","venue":null,"work_id":"3373bde3-6521-4d9f-8d6b-61559b948a6b","year":2017},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.375369Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:cf3c0557f3f64c3203153775c9eb98d0036e574319d2023c94c99f2d75a4c6bd","observation_id":"0102f5d0-bd5c-4134-86db-1b3808709759","resolution":{"observed_at":"2026-08-11T23:09:42.702090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.652609Z","title":"Annotating objects and relations in user- generated videos","venue":null,"work_id":"59a0013a-acce-4c7d-8462-505d1fd1943c","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.383552Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:226600346d3cdccf5a0ac734039fc156e39504de08b0aba8ba18d65f5fd1d853","observation_id":"34aa9751-fa9c-43a5-8401-8b26920c73a7","resolution":{"observed_at":"2026-08-11T23:09:42.665586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.601829Z","title":"Eye tracking assisted extraction of attentionally important objects from videos","venue":null,"work_id":"f4fcf0a0-e82b-416f-b6dc-f8c960966027","year":2015},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.393063Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:dbf2adc6891d071bbe676af0cee46fcebca7d76833d10426e4ffdfcd8ad6a9db","observation_id":"f159bb3e-68bb-4ed2-ad71-1b66aae1b91b","resolution":{"observed_at":"2026-08-11T23:09:42.625830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.560722Z","title":"A simple baseline for weakly-supervised scene graph gener- ation","venue":null,"work_id":"1cbac46e-ba3a-4d4c-bfc5-135808b640a3","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.404797Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:8967c4f8f0e34b54e6888fe615726554d92f33b0d70cdb2bca6e9fafb0b1d86b","observation_id":"8d36f051-3a52-460f-aafe-b5f913bc6316","resolution":{"observed_at":"2026-08-11T23:09:42.568492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.517241Z","title":"Hollywood in homes: Crowdsourcing data collection for activity under- standing","venue":null,"work_id":"980f7b1d-02c6-4e8f-a4b3-828a9d71c857","year":2016},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.414636Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:89136929ea0f02f675c5ce0e9d29fb242e0de10d4b48e81265bfeb9fcfab7a3a","observation_id":"6620a0b5-89c5-4942-b629-5d7e85837e0b","resolution":{"observed_at":"2026-08-11T23:09:42.522957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15460","last_updated":"2021-05-04T15:58:37Z","snapshot_observed_at":"2026-07-06T10:28:58.102232Z","submitted_at":"2020-12-31T06:03:00Z","title":"TransTrack: Multiple Object Tracking with Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15460","snapshot_observed_at":"2026-08-11T23:09:41.421933Z","title":"Transtrack: Multiple object tracking with transformer","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.421933Z"},"links":{"cited_paper":"/paper/2012.15460","citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:f2878a8d899725d0b0e42ca0c8a8e9cc733e063d6ad7cd7d40d992d87ba8b89b","observation_id":"8ba40125-449c-4e1f-a536-3d12ec495f4d","resolution":{"observed_at":"2026-08-11T23:09:41.421933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.427326Z","title":"Learning to compose dynamic tree structures for visual contexts","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.427326Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:266e24d5e508a5ce6f8365da97bf301654b6015782f4b856bab610f82b6e048d","observation_id":"02c508cb-44d9-454f-819a-70ccc5eac744","resolution":{"observed_at":"2026-08-11T23:09:41.427326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.464627Z","title":"Tar- get adaptive context aggregation for video scene graph gen- eration","venue":null,"work_id":"75b81553-917c-4ba8-8a5b-4d20c25c3c39","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.433626Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:bfc241cb5534efc0544e1439941f6ead21ebf53abf18f69e4e6c8b6a8482461c","observation_id":"6876565d-d6a4-48be-8e79-171e9f5e700c","resolution":{"observed_at":"2026-08-11T23:09:42.472030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.437847Z","title":"Vsgnet: Spatial attention network for detecting human ob- ject interactions using graph convolutions","venue":null,"work_id":"706289dc-3e00-4917-b274-7500b565a345","year":2020},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.439101Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:3a96b4e0bdf804b2f222c6cbe608e72555d9b543f6c141ad9e27597ffc89d963","observation_id":"d138d14c-ebd0-419f-bd66-588e2369c197","resolution":{"observed_at":"2026-08-11T23:09:42.444245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.399536Z","title":"Pose-aware multi-level feature network for human ob- ject interaction detection","venue":null,"work_id":"db7a4f0b-fd8d-4e23-91d4-5a0ca700ff77","year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.446247Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:84a0dd8ebd2718d578a44563be4821c2334829a2972afa367267b73821aeba2e","observation_id":"c1569c7f-2c3e-4c09-9b17-ae0f41a50e6a","resolution":{"observed_at":"2026-08-11T23:09:42.408423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.357720Z","title":"Oed: Towards one-stage end-to-end dynamic scene graph genera- tion","venue":null,"work_id":"f9f084d7-bfe8-4e49-aa19-8ebcf15312d9","year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.458240Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:d389f71580b621448f027241daffe052ddf0faaf2403b5f6e883357e58912434","observation_id":"314c7d6e-66d1-4045-9ec6-c4bf12614dc4","resolution":{"observed_at":"2026-08-11T23:09:42.373778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.466039Z","title":"Learning transferable human-object interaction detector with natural language su- pervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.466039Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:d589cbd7a33dd5cb05815b51aeee095a779376df20b13096294eb4b950d3ad8d","observation_id":"e47996a6-70c3-47ed-bf96-0a8701eb0863","resolution":{"observed_at":"2026-08-11T23:09:41.466039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.293968Z","title":"Dynamic scene graph generation via temporal prior inference","venue":null,"work_id":"28ebf4cd-d390-4fe7-b0fa-20cc10e113c4","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.481394Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:15acb2624fe4ef6211e949c1bf580bfcf717893438e5c884f71c651041f1f6e0","observation_id":"ce3c3efa-bc3c-4488-9d83-61697dd0c63a","resolution":{"observed_at":"2026-08-11T23:09:42.305258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.258068Z","title":"Deep contextual attention for human- object interaction detection","venue":null,"work_id":"7101c624-f51b-4424-b67b-4d7266d2e4dd","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.502162Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:fd5b6ed6aa46ea811ee229b4d5d376977631a3d1c7313cc979dcb870aad92129","observation_id":"46142974-21cc-45cb-bdc7-2efa8ce0af5a","resolution":{"observed_at":"2026-08-11T23:09:42.275140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.219728Z","title":"Exploring context and visual pattern of relationship for scene graph generation","venue":null,"work_id":"458d2ac6-f35c-4d5d-99b7-0d7ab14c2780","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.522501Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:79e76b549e37a8371b6ce6cfbb056a45f9ae0acd6249af6e6647653c7e2d405b","observation_id":"3ede0d66-efcc-458e-b82c-8bbbb56fd84d","resolution":{"observed_at":"2026-08-11T23:09:42.229984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.159757Z","title":"Topic scene graph generation by attention distillation from caption","venue":null,"work_id":"5ac0ab8a-acf7-4fae-b536-77be06bf4edf","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.535561Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:c467cd80cbd3b651d8346721b9909b0e5b1ea5f6e2e3020cdb57a7c943ed8fcd","observation_id":"49b8fb5e-59a5-4c94-825d-9cb72ea91e15","resolution":{"observed_at":"2026-08-11T23:09:42.172322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.119710Z","title":"Do different track- ing tasks require different appearance models? Advances in Neural Information Processing Systems, 34:726–738, 2021","venue":null,"work_id":"3cd8ba65-b3be-402b-97b6-a853fb5b827e","year":2021},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.547662Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:194e0777e963f7488b854c200f4f0ebbab05e8d21d1ec64fe837be3a54ca1dde","observation_id":"c4f339c1-aebb-4f11-807c-4f93b2d32ac1","resolution":{"observed_at":"2026-08-11T23:09:42.141184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.093014Z","title":"An introduction to the kalman filter","venue":null,"work_id":"d45d8c08-7b7a-473a-9434-009119474a40","year":1995},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.557931Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:2c6a29a616461ee5bd7f4da7188d50d3dbb37f03fc436345215cb9adee03c1e5","observation_id":"3fc6c5de-0379-48ea-b39b-e5208a546282","resolution":{"observed_at":"2026-08-11T23:09:42.102293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.567731Z","title":"Simple online and realtime tracking with a deep association metric","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.567731Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:e16709a6332c12e8547ed3755a41ac31353d1fa3cc7dc5d9ab0c4424ee72345a","observation_id":"8a9b4f18-235b-4dd7-bf2b-c550553f5374","resolution":{"observed_at":"2026-08-11T23:09:41.567731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.031515Z","title":"Panoptic video scene graph generation","venue":null,"work_id":"d2f78c9a-7337-4dae-ac1e-254219008e9d","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.576355Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:5c4d0c82bca32cd032a3e47a2358ae3a0e0f9279189b1d7c395c5a6173a87106","observation_id":"3b991d5a-a59d-461b-af3c-6a148cb8cc49","resolution":{"observed_at":"2026-08-11T23:09:42.036695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:42.013359Z","title":"Motr: End-to-end multiple- object tracking with transformer","venue":null,"work_id":"c854d9b2-c40b-4d45-97e8-c46ffbeda9d3","year":2022},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.584361Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:d9b87fbaca67cb942547b23048c260941e9816b3f043a937907f966ba46aad29","observation_id":"6cac7713-0143-4e63-9184-facf1bc30148","resolution":{"observed_at":"2026-08-11T23:09:42.019362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.979083Z","title":"Graphical contrastive losses for scene graph parsing","venue":null,"work_id":"79a55b5c-7e79-423f-935f-606fb4ef747b","year":2019},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.593381Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:b7ff7c263902ec3eff1b7b27c6c563f90ad035094898ed04d14ac722002efc5f","observation_id":"215bbe8f-e29a-4b27-a449-3d02dc4d311e","resolution":{"observed_at":"2026-08-11T23:09:41.992693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.937697Z","title":"End-to-end video scene graph gener- ation with temporal propagation transformer","venue":null,"work_id":"3491241d-e2b2-4500-9bf2-378577e95a24","year":2023},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.602440Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:348b8d5a5fccadfb4c183fc863f6d95d5952a5e35c0b79e03e87edd75c84bb95","observation_id":"89bf29af-37d6-406e-8c26-8bb14ac0aed9","resolution":{"observed_at":"2026-08-11T23:09:41.948571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:41.896097Z","title":"Object track- ing using sift features and mean shift","venue":null,"work_id":"78cb8bdb-2c0d-4a1b-bd35-c699b3ed6738","year":2009},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.614537Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:0f3ee6df3e1e000535f5f02b49e3178b42d4b00be325b7d0d9ce5e0b11fe1f48","observation_id":"10f8a9c8-a178-462b-a148-76fd13e933ee","resolution":{"observed_at":"2026-08-11T23:09:41.906220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-11T23:09:41.633345Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.633345Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:20a0bfa39e77cb066cce9b78c7f02d44d73c02348d41ef6afb0cd0059871ed9a","observation_id":"f5c4380b-7cb1-4c6a-a1f6-fd0802a923cf","resolution":{"observed_at":"2026-08-11T23:09:41.633345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:09:43.373348Z","title":"1, 2, 3, 6","venue":null,"work_id":"a2464a67-9ab8-41fc-b967-e817db622ef6","year":2025},"citing_paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation","version":2},"reference_index":9680,"source":"pdf_text","source_observed_at":"2026-08-11T23:09:41.099305Z"},"links":{"citing_paper":"/paper/2412.02808"},"observation_digest":"sha256:c15fc4250b829d7bf5af6812af866db798e293b2760b105f27c787f5f126cd78","observation_id":"87335e20-a6ff-4855-848a-4ea8a996b4a5","resolution":{"observed_at":"2026-08-11T23:09:43.380836Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02808","last_updated":"2025-07-22T19:23:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T17:25:38.937184Z","submitted_at":"2024-12-03T20:19:20Z","title":"Temporally Consistent Dynamic Scene Graphs: An End-to-End Approach for Action Tracklet Generation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":11,"verified_exact":2,"verified_fuzzy":51},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2412.02808."}