{"as_of":"2026-08-16T11:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2833ed2658c5cdaa49ea21bf75f7d55d333b60c04f42d0d92e57679518af172","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:25:41.595334Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.01189/citation-record","integrity":"/paper/1908.01189/integrity","json":"/paper/1908.01189/citation-record.json","paper":"/paper/1908.01189"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.153497Z","title":"Object referring in videos with language and human gaze","venue":null,"work_id":"c90086ac-c199-4826-a03f-1597d6d3fd6d","year":2018},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.444620Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:d0f59c0db2d3d03beba9cc78e96795221ba2f7ec4112c430983c3289b2de884e","observation_id":"6bc28e43-fc7b-4a55-87c7-59e804b22780","resolution":{"observed_at":"2026-08-14T15:25:42.165776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.121101Z","title":"Cooking up referring expressions","venue":null,"work_id":"4c88e931-c93a-41f1-9393-bea9032c2a67","year":1989},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.455749Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:f070241bbcb8665120c389c54c8965d86ea915a9367799aad43a95e29ddccd29","observation_id":"bd64195d-4d7e-45fc-8b2a-536f3a0e8d0c","resolution":{"observed_at":"2026-08-14T15:25:42.129106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.094612Z","title":"Long short-term memory","venue":null,"work_id":"df77b928-ffd5-4eca-826e-2d50204da23b","year":1997},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.465250Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:8dcd6bb13b6cb6cca152197237d12dec0a3b89a19324caadf5a0846c343498ad","observation_id":"fc22d1ed-da5d-493d-9fe0-1342a6e6b69c","resolution":{"observed_at":"2026-08-14T15:25:42.102331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.064312Z","title":"Referitgame: Referring to objects in photographs of natural scenes","venue":null,"work_id":"4fc6f6e6-9972-4271-812d-3fdc13b52f62","year":2014},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.471577Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:ab2ce4026dcd0f1738f3ba80dd5245b594a4489b36be5c48ac23761feaae49f6","observation_id":"8d35bb4d-b7eb-42a0-8f3b-54fc5463ae3c","resolution":{"observed_at":"2026-08-14T15:25:42.073878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.039156Z","title":"Video object segmentation with referring expressions","venue":null,"work_id":"85179cdb-699d-4fe8-948e-fa3988017c51","year":2018},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.479411Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:1db5a6f1d33689f6b3bbd9fb22d6cb19ff40647b00c05cb181901d62df5f64bf","observation_id":"cfd3d084-eb32-4ef1-a210-cfaeddec6907","resolution":{"observed_at":"2026-08-14T15:25:42.046311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:42.009217Z","title":"Meteor: An automatic metric for mt evaluation with high levels of correlation with human judgments","venue":null,"work_id":"ee945552-a745-412d-a4bc-ac0643314cbf","year":2007},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.486513Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:73eb215550555c5f50fb22b044351d16b108125eba188bb49b8f6e451cf1bb98","observation_id":"7f627e4a-f25b-429d-8c31-3a1bb114d2f1","resolution":{"observed_at":"2026-08-14T15:25:42.017988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.966982Z","title":"Generation and comprehension of unambiguous object descriptions","venue":null,"work_id":"064fa24c-c622-4237-a14c-997764bc52f2","year":2016},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.494139Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:2fa74f9370b3b1bf4d3040bb002195a4a2530680664216b8aacf7686dfa5dbb8","observation_id":"d9a23ae3-47a6-4e25-8d36-25dce7dccdc0","resolution":{"observed_at":"2026-08-14T15:25:41.990273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.928552Z","title":"Modeling context between objects for referring expression understanding","venue":null,"work_id":"0023efdb-0ddf-4920-9880-9a3fdfb12694","year":2016},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.500219Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:c27de03a51903e55f9810872df02fa8c481389d503fac168d64a1e9ecab4d3a7","observation_id":"5b7eabb1-bbe4-4140-b961-8bf462538d56","resolution":{"observed_at":"2026-08-14T15:25:41.935993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.899707Z","title":null,"venue":null,"work_id":"ff5f9eb3-ea74-450b-bb7d-01cef4a6b80b","year":2011},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.514696Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:d490c3bf42450257a8d0ae1cb4dce7b1236186493ed7d2efece31050e87a7b55","observation_id":"43999feb-1f56-4a2f-992e-39d366aabb14","resolution":{"observed_at":"2026-08-14T15:25:41.907838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.875045Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":"2f6c60c9-159d-4223-9d55-9de116ab5aae","year":2002},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.521409Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:5d882e81ccc2e0319e5e2dd6cbeadd467c86c9fc497aec66358c2814529354d7","observation_id":"8e92a0b9-960b-4a2b-92ee-76aa438ffbc9","resolution":{"observed_at":"2026-08-14T15:25:41.881388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.840550Z","title":"Glove: Global vectors for word representation","venue":null,"work_id":"486687fd-30b3-47a1-b245-b801605344b6","year":2014},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.529519Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:563c78d2a52a335de912d04af965df020551b53cdec8ad914bfb4fdb20d4e5a2","observation_id":"ab5ebe5e-ab62-42e7-b323-6878780ac980","resolution":{"observed_at":"2026-08-14T15:25:41.848581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.815271Z","title":"Berg, and Li Fei-Fei","venue":null,"work_id":"e38eb90f-edb3-49e5-a563-966301cfa306","year":2015},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.538237Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:751dcb6855f63db28c3396d26c89b9ae0f3afa5e29c20a14816573526e7dcf02","observation_id":"d3af70d3-631e-4dcc-b7d2-fdfe0ce34d8e","resolution":{"observed_at":"2026-08-14T15:25:41.821745Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.790880Z","title":"Very deep convolutional networks for large- scale image recognition","venue":null,"work_id":"6d2de180-53d9-4e84-bade-e70067a8ddca","year":2015},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.547291Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:dde275cdf251065a8f2e3b05e58d82f9ac1e0fb8e23e0913bc51e68649106a58","observation_id":"7baccef0-2a4f-4383-80d7-888be360fd8e","resolution":{"observed_at":"2026-08-14T15:25:41.799889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.765989Z","title":"Learning spatiotemporal features with 3d convolutional networks","venue":null,"work_id":"cecbc5f8-1af1-4430-8c2d-b3cb0b61182d","year":2015},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.555682Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:12a6be692a14e892d7e61bd7c179ccf81a7fd8afeb6b84414c9f2f9e92f0768a","observation_id":"3e05596d-eb74-4b8b-b07d-3b91ae0e700e","resolution":{"observed_at":"2026-08-14T15:25:41.774965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.720359Z","title":"The use of spatial relations in referring expression generation","venue":null,"work_id":"239a75b0-c40a-40d5-92e0-68fce9c3b819","year":2008},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.576017Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:85fc0fd48d730e12135fa349c7239dfeb40b32e974aa4b3f2844c4dfdd8ae4c3","observation_id":"c0599681-f5e8-4435-8591-dd7cab9b26e4","resolution":{"observed_at":"2026-08-14T15:25:41.728963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03885","last_updated":"2019-04-08T08:28:54Z","snapshot_observed_at":"2026-08-14T16:50:10.429815Z","submitted_at":"2019-04-08T08:28:54Z","title":"Referring to Objects in Videos using Spatio-Temporal Identifying Descriptions","version":1},"cited_work":{"arxiv_id":"1904.03885","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.03885","snapshot_observed_at":"2026-08-14T15:25:41.664145Z","title":"Referring to Objects in Videos using Spatio-Temporal Identifying Descriptions","venue":"cs.CV","work_id":"b160fa9d-0327-463d-a570-371b8f2b700d","year":2019},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.587066Z"},"links":{"cited_paper":"/paper/1904.03885","citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:ec78e9708525a5ea306da1cf83618416991acbd9735c6f20999073b5a934a6ec","observation_id":"ac874878-8784-4357-858c-2d75766558be","resolution":{"observed_at":"2026-08-14T15:25:41.674823Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:25:41.693533Z","title":"Mattnet: Modular attention network for referring expression comprehension","venue":null,"work_id":"b7919736-cb77-4add-b9aa-e58c54915810","year":2018},"citing_paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T15:25:41.595334Z"},"links":{"citing_paper":"/paper/1908.01189"},"observation_digest":"sha256:9632cd972ca0eb9d8d37d490b113e14609a02bd768cd660e5fab3a9fea58541b","observation_id":"ec74348a-7ddc-4a4e-8951-ad824464ea1f","resolution":{"observed_at":"2026-08-14T15:25:41.699590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.01189","last_updated":"2019-08-20T07:18:54Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T03:36:19.624649Z","submitted_at":"2019-08-03T15:06:14Z","title":"Searching for Ambiguous Objects in Videos using Relational Referring Expressions"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:1908.01189."}