{"as_of":"2026-08-23T19:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e117c2dada9723cdc4b155d6ca063c67d300040c00c7d36824089bf813111ad1","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T20:28:14.812358Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1907.07570/citation-record","integrity":"/paper/1907.07570/integrity","json":"/paper/1907.07570/citation-record.json","paper":"/paper/1907.07570"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-scale recognition with DAG-CNNs","venue":null,"work_id":"eaefed20-b09b-42f6-8184-eb538427bf91","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:69c5b1e38a173addc35da3275ae3094917687fd8ade97d81c1437be55eabdda4","observation_id":"0207d827-6b20-4353-81e6-1b1a5e56d892","resolution":{"observed_at":"2026-05-24T20:29:54.003249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Relay backpropagation for effective learning of deep convolutional neural networks","venue":null,"work_id":"2b42ba5e-255c-494c-8645-ba441ed3c644","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:07dbf5214ffcbcaaedba6d95a18c708c7817a12dbac6a6eb8c834f6c0cf84e65","observation_id":"4066ac51-6970-477a-be16-b2504f706e8a","resolution":{"observed_at":"2026-05-24T20:29:53.996933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Squeeze-and-excitation networks","venue":null,"work_id":"5c99d912-94ca-4cc7-89dc-e1d41aaab90f","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:d85bf0b6944d1a93ae03c828a32b09e903f225cf1dc4b82d9edd8220fb3faf0c","observation_id":"a3471ec4-3577-440d-af66-36551764b2eb","resolution":{"observed_at":"2026-05-24T20:29:53.990936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dft-based transformation invariant pooling layer for visual classiﬁcation","venue":null,"work_id":"190ec2dd-fe8c-454f-b7e1-02e305d21ee0","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:6370bc30e56aa9bb212ec70677f49c73f7eccc52093bbe869fa6bb7c249973bb","observation_id":"5e96ffcd-ffbf-4bc6-afd7-d215ca7285a0","resolution":{"observed_at":"2026-05-24T20:29:53.988345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene recognition with cnns: objects, scales and dataset bias","venue":null,"work_id":"899c73d1-a043-4a37-aa7f-2ef85e02c8c4","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:049a059e10cffd4c99fc4dd301632e25c09e9df0ec7cc5dbba27aa26cd538540","observation_id":"500472d6-6b00-48b2-bd37-a727853316fa","resolution":{"observed_at":"2026-05-24T20:29:53.981817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene recognition with objectness","venue":null,"work_id":"800fff6c-5e4f-483a-9874-aebcad700f16","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:866c06a50678a403f8968e006f524c7150e622ab2564fa3a76d712ec7480b50b","observation_id":"2b995263-b0e1-4283-b41d-55d0d61280c3","resolution":{"observed_at":"2026-05-24T20:29:53.978696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowledge guided disambiguation for large-scale scene classiﬁcation with multi-resolution cnns","venue":null,"work_id":"d5f054f6-064c-4d5c-aa25-c21d57d9f542","year":2055},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:042796e81bc7deaf5b68ca0abde95f98045fc3467264edf8eff28d0ba32d9288","observation_id":"f2597a36-fd11-49ef-afcd-61742e4b8a0b","resolution":{"observed_at":"2026-05-24T20:29:53.975326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deriving high-level scene descriptions from deep scene cnn features","venue":null,"work_id":"1c90e074-1612-4042-8d9b-7634d97969ca","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:2a3d1e30547f950e6b386153b3168c4d43fcbd83ffd4cddda9d3d17a3798f4f1","observation_id":"a40ab367-eb6d-4c81-9c72-7359cb4a618a","resolution":{"observed_at":"2026-05-24T20:29:53.972328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene recognition via object-to-scene class conversion: end-to-end training","venue":null,"work_id":"46c3c9e1-9da1-4c19-a7ed-a0437afa765e","year":2019},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:03f662726c573151fea6304f75a8c747f53a64d2a87ff59ae8e5025fe4c8ec82","observation_id":"497b119d-0830-467a-8498-afe343f4a15d","resolution":{"observed_at":"2026-05-24T20:29:53.969630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet large scale visual recognition challenge","venue":null,"work_id":"c7c71223-e6a6-43da-b9c9-e96c4248837f","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:cc3484d338d6e3e4048464d54e27d9bc2ba0412b704b32dae28c559f7ed99ead","observation_id":"82caebf3-f06c-4278-b397-52b9aa103e1c","resolution":{"observed_at":"2026-05-24T20:29:53.966595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The pascal visual object classes (voc) challenge","venue":null,"work_id":"2049415a-40a1-4fad-9567-413e1d7f8946","year":2010},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:344720897a40456ddbad4f2239cb73e369ba3e05448fc414e34bb34eab263142","observation_id":"da753a5b-5d55-4636-ad0e-feeb4907b813","resolution":{"observed_at":"2026-05-24T20:29:53.962302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"81670588-7650-41fd-b18c-741d6cade33b","year":2014},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:473b1d4919bbbaff4ad0a0bab460e0cb3b67f254f61b06e19d974aa7d4ee8ff0","observation_id":"588910b4-67a0-41fc-a761-dc9341ca7962","resolution":{"observed_at":"2026-05-24T20:29:54.072051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"From volcano to toyshop: Adaptive discrim- inative region discovery for scene recognition","venue":null,"work_id":"4e318145-b8c6-409c-9a7e-ab49f18ba6e6","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:29b8ad4e4e54e2cf15e8d2c45ea71d728182b67afcdb70ba79b05b7ad4283a78","observation_id":"6eb03f69-bc84-4806-aec2-3259a74026e4","resolution":{"observed_at":"2026-05-24T20:29:54.069129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-scale multi-feature context modeling for scene recognition in the semantic manifold","venue":null,"work_id":"5b031118-e990-4813-a831-9f741d7100cd","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:b775664fbc1d7c1b9a1ab9116b7e9e3b9515598e88978126a70efd66ce049039","observation_id":"329592de-6adf-458a-abef-aeeebeeacc86","resolution":{"observed_at":"2026-05-24T20:29:54.076601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harvesting discriminative meta objects with deep cnn features for scene classiﬁcation","venue":null,"work_id":"91ab6904-cef9-4293-8f1d-3810bdd65034","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:530326137e22be0d15e475f199c3b7c0a72646fca1d238535e90547e0b682dec","observation_id":"11ad9780-af94-41a0-b9fb-4ce528c796b9","resolution":{"observed_at":"2026-05-24T20:29:54.065820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene categorization model using deep visually sensitive features","venue":null,"work_id":"ff9c1a6d-4f97-4703-a8be-f59c5959350c","year":2019},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:75ad69c91890c588374e731a489bc93bd294247644fd54a13ffce52e3d46fbda","observation_id":"1a945951-68aa-4de0-8351-e3a2a5f1f7ae","resolution":{"observed_at":"2026-05-24T20:29:54.062927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene recognition and weakly supervised object localization with deformable part-based models","venue":null,"work_id":"a897571c-5138-4946-8f09-ad639f11d702","year":2011},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:4333cef5f75e9a67a90ad158f4f99406750dc10da4e66564336f5d7de46016f4","observation_id":"8025e5cd-6f16-470d-b37f-72f1fc337284","resolution":{"observed_at":"2026-05-24T20:29:54.059733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reconﬁgurable models for scene recognition","venue":null,"work_id":"5f39cd2b-51a5-440b-8fd4-e0f2bbe7bf1e","year":2012},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:49534871241f25e01f0ee55c1f05432273f30f121bea1d1fe13cb4bb59272aed","observation_id":"3b947c72-233c-4f89-a562-35e83d4fa982","resolution":{"observed_at":"2026-05-24T20:29:54.082611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scene categorization using deeply learned gaze shifting kernel","venue":null,"work_id":"1e699265-d024-44ad-ab85-427a8f069b52","year":2019},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:d1f8d9441936ebb56191d6e51f492b61ae0d46928a75cd8ab1050b4c71cfbd3c","observation_id":"5223942a-77f1-4182-97ce-1e1be9bfdc21","resolution":{"observed_at":"2026-05-24T20:29:54.056730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fusing object semantics and deep appearance features for scene recognition","venue":null,"work_id":"9fc0bea9-1266-469d-ab4e-0a670c0e82c1","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:324074d087e3d5c5b35a1498ab88d18cf75ed5bbc821919da429b5820aaa5526","observation_id":"932771bc-d15b-4152-ad3a-aab76ec5d97e","resolution":{"observed_at":"2026-05-24T20:29:54.079829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hybrid cnn and dictionary-based models for scene recognition and domain adaptation","venue":null,"work_id":"a80c0d03-b845-4fa2-9482-a01ad22fb49b","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:f0866051fd731fdb7dff2421825cfb773838f3d79a56f14b8b3ec1b05465eb1f","observation_id":"ef27aeb1-88e6-4d91-bb43-2d23fa8ed3ea","resolution":{"observed_at":"2026-05-24T20:29:54.053815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Weakly supervised patchnets: Describing and aggregating local patches for scene recogni- tion","venue":null,"work_id":"10e21f5c-7582-4935-8f48-0984d9951303","year":2028},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:07a344623385c40689b18b302b3d64b5c8b20a6bfbba90e31acd0f31d8b457af","observation_id":"0deaa8e9-e045-4d5f-91ee-e5a498e6d1d0","resolution":{"observed_at":"2026-05-24T20:29:54.035334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A robust indoor scene recognition method based on sparse representation","venue":null,"work_id":"3283067f-a6ff-4a39-8835-44c31065b09c","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:44b7f282fbca66f0dd785dbf63847aae968e53832cf650d2c9913451b2c05afa","observation_id":"e048f040-0bce-483e-8d9a-e6eaaa6a71bb","resolution":{"observed_at":"2026-05-24T20:29:54.051057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Support-vector networks","venue":null,"work_id":"d3d62f4a-25cd-48c9-be23-28e500071a2d","year":1995},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:f9dc09498e4b0f9121d5ae7f92ea0c0fad6229a6537d2da16a62e633a8004ef6","observation_id":"476aeec5-2e31-48a8-9fc5-306d16cee6db","resolution":{"observed_at":"2026-05-24T20:29:53.959049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"aae2f86e-1732-4525-b8dd-e6844b0fc977","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:674a0fb634107117ebb1ad86d588413ca4f02e3ded4b4ad133108e42a36c3256","observation_id":"cc640b3e-6b6d-41ef-9be2-bc0a5123079a","resolution":{"observed_at":"2026-05-24T20:29:54.048073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Densely connected convolutional networks","venue":null,"work_id":"3ec2ecfc-1fc1-4c1a-9d7c-8266075899da","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:8324edcc484e05508c30237f6532c14b1e1f5076b9d434d868ffcd975004cf4b","observation_id":"d1a0d46c-62f8-4ed8-8fa9-9a8f60f8b942","resolution":{"observed_at":"2026-05-24T20:29:53.956058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aggregated residual transformations for deep neural networks","venue":null,"work_id":"d6a89efb-65db-4813-bd52-4648dd0b8ead","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:d08e997a8271d124d76dcd5b7c4dc378aca13d3cf2d67e07ad0f8ab5a4431d13","observation_id":"8935bdc8-2659-4cb8-9e7e-d39e1af97cc7","resolution":{"observed_at":"2026-05-24T20:29:54.045445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Places: A 10 million image database for scene recognition","venue":null,"work_id":"77e83146-6b05-4583-9951-13a608de7c27","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:4bf26b8334751012082e8f29b0a8a845c728ea7c41fcbd66db7a85f7de000c09","observation_id":"78dd59b5-977b-4272-b1ca-d53de2d46c8c","resolution":{"observed_at":"2026-05-24T20:29:53.984762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning deep features for discriminative localization","venue":null,"work_id":"8689d186-9e49-4978-b29e-d53c2778ca65","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:1a40aa917bcd31345b62d2b0048ebd1a77606c76bf434a9b7b6e6d4880fc162f","observation_id":"59648724-0386-4379-9ca6-d026b85ed1dd","resolution":{"observed_at":"2026-05-24T20:29:54.042842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.11718","last_updated":"2018-11-28T18:13:02Z","snapshot_observed_at":"2026-08-14T17:51:51.994742Z","submitted_at":"2018-11-28T18:13:02Z","title":"Partial Convolution based Padding","version":1},"cited_work":{"arxiv_id":"1811.11718","doi":null,"metadata_source":"pith","pith_arxiv_id":"1811.11718","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Partial Convolution based Padding","venue":"cs.CV","work_id":"90da91c6-ac32-4e69-9d00-2000c2b39a08","year":2018},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"cited_paper":"/paper/1811.11718","citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:2fbd09d72e93ea43692bd10d3b80b435a72909bd37d4df96d18f2802fc9732d0","observation_id":"18805afc-2e73-49b9-b717-02965cfdcdf7","resolution":{"observed_at":"2026-05-24T20:29:53.104912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06905","last_updated":"2018-03-05T12:30:37Z","snapshot_observed_at":"2026-08-14T20:52:34.108757Z","submitted_at":"2017-06-21T13:49:14Z","title":"Learnable pooling with Context Gating for video classification","version":2},"cited_work":{"arxiv_id":"1706.06905","doi":null,"metadata_source":"pith","pith_arxiv_id":"1706.06905","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learnable pooling with Context Gating for video classification","venue":"cs.CV","work_id":"6eb4a485-4b91-4a8c-afee-9e30d9267ea3","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"cited_paper":"/paper/1706.06905","citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:85df681b96cbb5da0d7adcb8ae2c551e011b248c0983c05fb62c3152907b7279","observation_id":"2b60cb2e-2910-42fb-99b4-7bcb0b119d69","resolution":{"observed_at":"2026-05-24T20:29:53.120155Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":"83987c72-d867-4c90-9657-33247833825f","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:3aff84ca611818c4de7216a792e576366e6fb6942dcf9033ec7e5c35a94fa781","observation_id":"c3735b89-ca78-431e-98d2-5cd77cbd92c7","resolution":{"observed_at":"2026-05-24T20:29:54.040610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sun database: Large-scale scene recognition from abbey to zoo","venue":null,"work_id":"80d64ce9-5047-4cb6-a0f0-15df808f4b11","year":2010},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:8a4ea6f44fddb850e11e92046c857dab5fefaae8f29356f837a089456d8be661","observation_id":"858e0ef2-1ae6-4dbd-80ec-eafafc6bf1ac","resolution":{"observed_at":"2026-05-24T20:29:54.037789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recognizing indoor scenes","venue":null,"work_id":"8bba8e33-a863-407a-a885-4eb68c69638c","year":2009},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:0b2b1f03c8264de0b9a8bb3fc3e6db3ae6d0272ececb0dd3ace2deec61288d0d","observation_id":"2da896f7-dcb0-4c4d-9580-653a587258e0","resolution":{"observed_at":"2026-05-24T20:29:53.993655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning deep features for scene recognition using places database","venue":null,"work_id":"cfb3078a-d475-4d6e-b465-5457dd0ba70e","year":2014},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:cefecb1455861dc95ac039ea4862945cd8013e525f7db04196f8a60e5633208b","observation_id":"c708b332-5f53-4cbf-8e92-f27f8435c97f","resolution":{"observed_at":"2026-05-24T20:29:54.032423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Imagenet classiﬁca- tion with deep convolutional neural networks","venue":null,"work_id":"ca840a88-d2bf-4303-bd9a-d2aa20eec694","year":2012},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:c095117ffa525a7ba0596e11244eaed77768cd6e52bcbc559092811b3f23e519","observation_id":"b2599564-5148-41d8-9b12-46ed00cb19a2","resolution":{"observed_at":"2026-05-24T20:29:54.000107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":"21a3c8e1-0e18-4cbc-adf4-e0e1a8dc1859","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:e5d258b9f8b27c3790e58676cfaa103f8c97536cac31d2f0fd7f40d2dbba2850","observation_id":"2e5579da-a7fd-420d-a563-3074d53cf584","resolution":{"observed_at":"2026-05-24T20:29:54.029557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Going deeper with convolutions","venue":null,"work_id":"751e0b7e-630b-4aac-981d-ccc9e250d9dd","year":2015},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:5c08e9ef0cebd45a5ba58e4110d405a7ed2e1cce5682fc1b78712e1573237721","observation_id":"63b9b1ae-344c-4f9a-8b1c-1f778d5c1b3d","resolution":{"observed_at":"2026-05-24T20:29:54.006159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rethinking the inception architecture for computer vision","venue":null,"work_id":"4b75927a-2ec0-4a2d-9c20-c2ecd5174be2","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:adbd6d635ef1fcb321f68fffd321dc3ed1e4f3c775547ce9e379f429a6768ab2","observation_id":"2ed35bee-4f79-4fe0-ba34-a042c0f1571f","resolution":{"observed_at":"2026-05-24T20:29:54.026532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02677","last_updated":"2018-04-30T21:53:41Z","snapshot_observed_at":"2026-08-09T05:23:26.365677Z","submitted_at":"2017-06-08T16:51:53Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","version":2},"cited_work":{"arxiv_id":"1706.02677","doi":"10.48550/arxiv.1706.02677","metadata_source":"pith","pith_arxiv_id":"1706.02677","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour","venue":"cs.CV","work_id":"f3dc32a4-cf81-467b-8ff4-3b2f21d3bf1f","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"cited_paper":"/paper/1706.02677","citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:9ff05febef1d6ed0079371e6834f8a95eb93f2145ba65b18efc68af85dc1ce7a","observation_id":"34c02ca8-1ecd-4b23-bac8-5b47eb1a1074","resolution":{"observed_at":"2026-05-24T20:29:53.112168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-07-13T20:21:09.485311+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T20:21:09.485311+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training and investigating residual nets","venue":null,"work_id":"e651ba07-ea61-4c9d-966c-f07045be3908","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:6ed817270ab547bb745b53adf464d67d74500357b0b3170d24a148a8bd0481be","observation_id":"2fefe131-df0f-4156-8e24-3e31a80847d5","resolution":{"observed_at":"2026-05-24T20:29:54.023723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A survey on transfer learning","venue":null,"work_id":"581f1117-dc7c-4a09-9df1-5eac0fbe4268","year":2010},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:589ab69f4391cece315ea42047d15e4dee4fc7d4629646d0e727ce673b5e5631","observation_id":"92f2e296-bfce-4615-a08c-1d8a5f964c03","resolution":{"observed_at":"2026-05-24T20:29:54.017992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Places401 and places365 models","venue":null,"work_id":"2b718212-7aa4-4773-98ca-c4185135b844","year":2016},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:214b4cbe985356942cf956801f42c21ed990bf46bf52ae7db38e4da1aa70e97c","observation_id":"4ec518b3-4b72-4b63-99d0-6d3115676de7","resolution":{"observed_at":"2026-05-24T20:29:54.011810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yolo9000: better, faster, stronger","venue":null,"work_id":"ef95d7a4-bdaa-454a-90f3-946e821cd034","year":2017},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:81729272ae53825d365d6d19657fcc011ebe82a1944cf24765371ccd8bb0ccb6","observation_id":"f4341e63-a2f5-4325-94b1-276f55ad3e34","resolution":{"observed_at":"2026-05-24T20:29:54.009012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long short-term memory","venue":null,"work_id":"a37850a7-0c15-4df4-803b-98b4c8686fd4","year":1997},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:6caeaea19662eaa68b564cd4257759ddea6a9bf90d327654ad6ffe12cb81a696","observation_id":"c1e63578-837b-4de7-a588-0cafde598747","resolution":{"observed_at":"2026-05-24T20:29:54.014999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Object bank: A high- level image representation for scene classiﬁcation & semantic feature sparsiﬁcation","venue":null,"work_id":"9f758b27-98f1-49a9-bf26-a4f1ba2900eb","year":2010},"citing_paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-24T20:28:14.812358Z"},"links":{"citing_paper":"/paper/1907.07570"},"observation_digest":"sha256:5472cd3992b0b8c4c700209ecf4e50268b45a0423713418a3869aeafbc2e492d","observation_id":"e628ad9e-ab28-4812-a64a-bbd5d2ef35fe","resolution":{"observed_at":"2026-05-24T20:29:54.020897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1907.07570","last_updated":"2019-07-18T10:15:06Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T19:44:46.075664Z","submitted_at":"2019-07-17T15:10:24Z","title":"FOSNet: An End-to-End Trainable Deep Neural Network for Scene Recognition"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":3,"verified_fuzzy":43},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:1907.07570."}