{"as_of":"2026-08-17T00:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ac3f57937bab3588604ba1f905fbbb6d27ab741db64d122a03b96e9a9cac1076","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:49:18.410885Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.12791/citation-record","integrity":"/paper/2412.12791/integrity","json":"/paper/2412.12791/citation-record.json","paper":"/paper/2412.12791"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.270605Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.270605Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:d20478ac56df5e0ac75d514a82ad870db692dd3127df5ccf31c3526716a8aa1c","observation_id":"0c8fd0ee-38f8-4d38-bd97-6cf76858871c","resolution":{"observed_at":"2026-08-11T13:49:18.270605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.275152Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.275152Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:a34bfcd6d9904715ae309c48700dc1706a1f05c788fc5829aa60206af0b387ca","observation_id":"45de6bea-dafb-4f83-a8e7-ee8ef0383cde","resolution":{"observed_at":"2026-08-11T13:49:18.275152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.279224Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.279224Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:fef2916468882bfb0fe4450d4da89085493d602fcec56b799579064179967138","observation_id":"41a48afd-b79c-49b6-a3f2-c4e543305769","resolution":{"observed_at":"2026-08-11T13:49:18.279224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.800628Z","title":null,"venue":null,"work_id":"0ee710ee-f48c-4d55-b3d9-10d822e16086","year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.283386Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:97d62e31f254289075a7c09ccd7523b3c1879743d5e648b0edc370987430c852","observation_id":"a1582a86-97b2-4f57-b6ea-64f59a0c3498","resolution":{"observed_at":"2026-08-11T13:49:18.804015Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.789965Z","title":null,"venue":null,"work_id":"ac35c9fc-c8cd-45ac-b875-356f000a89dd","year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.287062Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:7530711966232e3ca821e995e7042e39cbfba59d5ea9d5ec72ca1fb9138434b1","observation_id":"3ab1c90b-e82d-421e-b120-a990c574ec48","resolution":{"observed_at":"2026-08-11T13:49:18.793414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.05092","last_updated":"2019-07-11T10:29:04Z","snapshot_observed_at":"2026-07-06T08:07:01.133763Z","submitted_at":"2019-07-11T10:29:04Z","title":"Activitynet 2019 Task 3: Exploring Contexts for Dense Captioning Events in Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.05092","snapshot_observed_at":"2026-08-11T13:49:18.290728Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.290728Z"},"links":{"cited_paper":"/paper/1907.05092","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:970fa6b14765db235465aa8bf17a01684df2535545fad4fe55d3878a5d360b70","observation_id":"d1945420-2520-488f-a1bc-85cbcb2835d2","resolution":{"observed_at":"2026-08-11T13:49:18.290728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.778785Z","title":null,"venue":null,"work_id":"44976a22-fe0f-4991-a969-c5256360ec5c","year":1987},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.294473Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:f6d5ff8c50e72880396b732947fadf82e56795d6cdfaa6b187c3cbfc981084bf","observation_id":"70be8746-b1b3-4418-b313-6759dd7b7cc7","resolution":{"observed_at":"2026-08-11T13:49:18.782533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.768338Z","title":null,"venue":null,"work_id":"6bbb1dd1-65cf-4693-900d-470a2ef2ef8c","year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.297798Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:877dba97e6139c8292eb9e670b8d9b0d27c4452067e9219ca36ef86fb654c315","observation_id":"77dfa9ac-0827-4bb5-a020-b24bdf98abb8","resolution":{"observed_at":"2026-08-11T13:49:18.771519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.758482Z","title":null,"venue":null,"work_id":"9ccd1baf-bc07-4ed4-8a88-2271d64f482b","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.301373Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:61475ec325a50569dc3fb77272d103bd8d4075b359c9c7663dd6acb3c7aea4b6","observation_id":"63ba084b-8414-4f91-8847-42f186e44100","resolution":{"observed_at":"2026-08-11T13:49:18.761602Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.304743Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.304743Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:d8e712876e458ba270844a02295715431f4fa29e6b6dfbdb46c7c21d34fc8734","observation_id":"96dda655-502a-44f8-8db4-a7856384542f","resolution":{"observed_at":"2026-08-11T13:49:18.304743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.741342Z","title":null,"venue":null,"work_id":"76394fdf-d585-4c75-9a86-a7d084ebd0f2","year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.307943Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:c14e22b248fb2b47434dc8850e6f5b604b3e04d130eed44792324cc6d19b0cc5","observation_id":"9193543e-cb6f-456e-bf4c-c962faf98920","resolution":{"observed_at":"2026-08-11T13:49:18.744623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.11760","last_updated":"2020-11-10T21:49:14Z","snapshot_observed_at":"2026-08-16T19:06:45.542680Z","submitted_at":"2020-11-10T21:49:14Z","title":"Multimodal Pretraining for Dense Video Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.11760","snapshot_observed_at":"2026-08-11T13:49:18.311365Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.311365Z"},"links":{"cited_paper":"/paper/2011.11760","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:952f3accef21ed9ed48930ecc7348504e541891d2dd896cd8467a65c07631724","observation_id":"156cc3b9-03e2-4943-9189-226d11e51bf0","resolution":{"observed_at":"2026-08-11T13:49:18.311365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.732032Z","title":null,"venue":null,"work_id":"a3729a9b-d395-4051-b6e3-2a2d71a72c74","year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.314921Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:1bedb502ee2aa1bb052e29472d5969abcd064078582bca9215cfebe9c09f913b","observation_id":"b91c38c7-fd5d-4fbb-87c8-8709e1718b93","resolution":{"observed_at":"2026-08-11T13:49:18.734950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.721837Z","title":null,"venue":null,"work_id":"8d152607-9db3-424e-a6e0-a257fca2895b","year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.318004Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:06f60c96149a3dc82d99a37fe1463556a36832cca137a96d72535234afb17642","observation_id":"4aa6ddcf-bcbe-48c8-840a-5931e6e1d3b7","resolution":{"observed_at":"2026-08-11T13:49:18.725065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.321235Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.321235Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:aea8de1f28b41f36dfa71ed20e23244d10d656254086f2cf9da6dc5e52b1b1b4","observation_id":"53d86233-f116-4ddf-bff5-81c150e528c6","resolution":{"observed_at":"2026-08-11T13:49:18.321235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-08-12T12:01:54.105712Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-11T13:49:18.324495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.324495Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:a1461030cac6c2b5eba0dc07a05ddb25ed8525471fda8fac5c927a044240cdca","observation_id":"9b3e134a-feac-41fd-bd87-369fa69284d1","resolution":{"observed_at":"2026-08-11T13:49:18.324495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.705215Z","title":null,"venue":null,"work_id":"f9472397-188e-4cef-93a1-f1c196bea182","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.328275Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:d6cd21213a2d707d4161cc9929bf922183f909ea2f256c56f06ae86eb58a2e36","observation_id":"933f64c1-e60f-42de-b9ed-335a57145202","resolution":{"observed_at":"2026-08-11T13:49:18.708755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.331804Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.331804Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:1c42708cea439b78da9e49a6dab86319f7320934c4df70f3b39fb677518f99ef","observation_id":"89a535c8-5f42-4e5f-92e4-6faadc6cad70","resolution":{"observed_at":"2026-08-11T13:49:18.331804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.688512Z","title":null,"venue":null,"work_id":"3547f504-86f5-4bed-8241-9604fa4bc9bd","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.335057Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:b6c62680d5ee2dd95ac034d5d046d188404be9e69d020b7ddeb86412c1b0b1ef","observation_id":"9a404bb1-0cf2-4edc-9367-b1ceaf929d7a","resolution":{"observed_at":"2026-08-11T13:49:18.691545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.338664Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.338664Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:3d6ffb85dedc39f525f9a08c6bf72399a1c342d6f61ed6c8707c89cee9f0f78c","observation_id":"f6411051-41d9-4a19-8f53-5409e03bd4b8","resolution":{"observed_at":"2026-08-11T13:49:18.338664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T13:49:18.341916Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.341916Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:e518e6fa43eb5a796c0e8610ee56f052eb1ef59f6f0d851c518eff32866b84c5","observation_id":"7b8d1ebf-56e8-4b30-9aea-115c6afee848","resolution":{"observed_at":"2026-08-11T13:49:18.341916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.671207Z","title":null,"venue":null,"work_id":"5962b5a7-0443-4ced-8d65-645019b76435","year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.345519Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:5a7ffed7328a56e9ba5752899ede83d32c03973d854490c7a396dca01378a9ae","observation_id":"815ce9a0-c24f-4134-a6a9-918da3b91665","resolution":{"observed_at":"2026-08-11T13:49:18.674495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.660868Z","title":null,"venue":null,"work_id":"8a136ffa-e9a8-4fff-a3a0-16363a79adf4","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.348942Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:d662ca83c7420d17049834d2fad15945cd981fd8782ef64e8d84a54fee5db5ce","observation_id":"8e4de286-47c6-47e0-8a31-e34455db19df","resolution":{"observed_at":"2026-08-11T13:49:18.664339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.352279Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.352279Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:1a79f46d4cb6efe4984e0ba6e85f1ca7ecf9af8e5c15be3b0d612922eca8682c","observation_id":"98db2c1c-ee49-45b7-a7ac-28ada89d59c4","resolution":{"observed_at":"2026-08-11T13:49:18.352279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.355613Z","title":"W.; Hallacy, C.; Ramesh, A.; Goh, G.; Agarwal, S.; Sastry, G.; Askell, A.; Mishkin, P.; Clark, J.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.355613Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:093555a4e56425e5d334445a1400142f11e7f5dd9d4ba396bf4d2a138c010d2c","observation_id":"e35f4394-7a6f-40c9-aeed-78d81427b224","resolution":{"observed_at":"2026-08-11T13:49:18.355613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.358917Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.358917Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:ca35ff04b45e52949b05a59e9315822e543faf30e71100f93ffe6d94caff5e73","observation_id":"95ffc91c-add1-41c5-9cda-2333a521a91a","resolution":{"observed_at":"2026-08-11T13:49:18.358917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.362165Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.362165Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:7f30df5dc77336e29fd3d2757985770491e177423613a5e45a6add6302468cbc","observation_id":"b42a008c-1163-47ff-8179-c445ee5ec005","resolution":{"observed_at":"2026-08-11T13:49:18.362165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.366614Z","title":"H.; Nagrani, A.; Arnab, A.; and Schmid, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.366614Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:3d2dbd5acd78c48edc5b30cb46257c4bfe0836460120fceff492997d88225251","observation_id":"5b5ba32f-5855-4693-9126-6f7bcd11ec65","resolution":{"observed_at":"2026-08-11T13:49:18.366614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.369876Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.369876Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:56c6254dbbf6a1dc0d9ef5930c56bdcd764598421916051e3eff91ae0e8d1b4f","observation_id":"554fa3ad-b4e5-41f6-a221-74754784e396","resolution":{"observed_at":"2026-08-11T13:49:18.369876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.373148Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.373148Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:166dfc6672861450d23d3e7bfac4e507705a5b97e93bd244a7187a6cb741eafd","observation_id":"0ac5acca-413c-46a0-99ab-a9fd833ccefe","resolution":{"observed_at":"2026-08-11T13:49:18.373148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.600774Z","title":null,"venue":null,"work_id":"583add67-40a0-40eb-b0b6-3fca8986dcc7","year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.376535Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:bce5d4125b1c509e90b2da3b1105d3a4e6959ed7da471647752fbc01d639b532","observation_id":"100e97db-20fe-400b-b1d4-1dd33538d257","resolution":{"observed_at":"2026-08-11T13:49:18.604325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.589906Z","title":null,"venue":null,"work_id":"6189fa8f-bfe7-4efe-87da-4d59f568562c","year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.379859Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:0b04e96a856a598a744976dcd7a0d6ea9d24a158abc63989a4081b554f2d7c44","observation_id":"56fb7b97-f042-40c5-b264-c305ad46d535","resolution":{"observed_at":"2026-08-11T13:49:18.593166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08252","last_updated":"2021-05-18T03:21:37Z","snapshot_observed_at":"2026-08-16T18:24:04.492988Z","submitted_at":"2021-05-18T03:21:37Z","title":"Weakly Supervised Dense Video Captioning via Jointly Usage of Knowledge Distillation and Cross-modal Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08252","snapshot_observed_at":"2026-08-11T13:49:18.383065Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.383065Z"},"links":{"cited_paper":"/paper/2105.08252","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:4f44ffa552ea3c3b4f19bf6ee7a7035be62b76e47666255c389c95a7e15dbb38","observation_id":"7fc004dd-da0e-4c14-acc9-bd72e5bab419","resolution":{"observed_at":"2026-08-11T13:49:18.383065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.386703Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.386703Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:acd087c8935291c30b88d32631cfd08b1a2d98389ac74259414fb4d1c5f0d7f3","observation_id":"1324f9f0-2db7-4a67-9d58-d10c5ee96221","resolution":{"observed_at":"2026-08-11T13:49:18.386703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.570803Z","title":"H.; Miech, A.; Pont-Tuset, J.; Laptev, I.; Sivic, J.; and Schmid, C","venue":null,"work_id":"43aa9870-0de8-4038-aed2-afffd6b7a859","year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.389759Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:c979e0946d958f1a8bb91a3fc54d5b7e5181234b05fec434d8f36f39dc6f3802","observation_id":"a8e422dd-524b-48c2-b007-7c835cd80b7a","resolution":{"observed_at":"2026-08-11T13:49:18.575206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.560041Z","title":null,"venue":null,"work_id":"3b496a19-458d-44c7-b343-5ab46232937e","year":2019},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.393187Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:dd7a5a584cdee170b2957a2ef9daa454283d7211a16e5e831974ce01ded02d48","observation_id":"5e5a10bb-333e-402b-9e54-1238f86df12f","resolution":{"observed_at":"2026-08-11T13:49:18.563460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.549153Z","title":null,"venue":null,"work_id":"1597ed42-ee30-4964-b598-fd8d660cbdd4","year":2024},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.396030Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:4c6c2fb3860617771b2c3354c87ff46321b6f501c99a064d69a4c8029606e2ce","observation_id":"4fb62749-79d8-4d70-8327-e9efdc397fae","resolution":{"observed_at":"2026-08-11T13:49:18.552589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.537870Z","title":null,"venue":null,"work_id":"068c00bf-c579-421b-b12b-e6456b543bdf","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.398906Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:3f400cbab0716541777d7068c971ae1d8c9846074d7f6021f3e64c477075c84f","observation_id":"9e6e5248-14db-4190-95ab-5be43305fde1","resolution":{"observed_at":"2026-08-11T13:49:18.541644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.526101Z","title":null,"venue":null,"work_id":"326e7ab3-d200-414b-987d-08c028343b28","year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.401773Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:0fd77a1a36281fff6ab12e33ba28be0823855c321f108444bf349d065f4d12be","observation_id":"78968094-e592-4241-97a3-5e46680fde8b","resolution":{"observed_at":"2026-08-11T13:49:18.530303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T13:49:18.404693Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.404693Z"},"links":{"citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:2f59266ec0090eeaef7aee5ab9185f696691db4fc14d9606efb1c685d06ca96c","observation_id":"91c197e7-b8d5-483a-a584-de6f005f69b5","resolution":{"observed_at":"2026-08-11T13:49:18.404693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-11T13:49:18.407604Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.407604Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:201c59156c2bcb6f796534e34b6331c119857fd563f026ee57ae6827cc8e9246","observation_id":"b711890a-9bcf-49c9-b859-12a14dd03214","resolution":{"observed_at":"2026-08-11T13:49:18.407604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08121","last_updated":"2022-09-16T05:44:53Z","snapshot_observed_at":"2026-08-16T17:06:25.534936Z","submitted_at":"2022-04-18T01:30:54Z","title":"End-to-end Dense Video Captioning as Sequence Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08121","snapshot_observed_at":"2026-08-11T13:49:18.410885Z","title":"V.; Wang, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T13:49:18.410885Z"},"links":{"cited_paper":"/paper/2204.08121","citing_paper":"/paper/2412.12791"},"observation_digest":"sha256:503a80ce6d86876582de5752e9f1993a820b2df6c071f02f26a0028459feff1c","observation_id":"69a472e1-5120-40cc-8d91-4a18553cd671","resolution":{"observed_at":"2026-08-11T13:49:18.410885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.12791","last_updated":"2025-01-27T10:40:20Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T01:34:55.439333Z","submitted_at":"2024-12-17T10:52:50Z","title":"Implicit Location-Caption Alignment via Complementary Masking for Weakly-Supervised Dense Video Captioning"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.12791."}