{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/attention/papers/182","list_of":"/method/attention","method":"Attention","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":182,"pages_in_order":316,"rows_per_page":100,"rows":[18101,18200],"of":31583,"counts":{"archive_papers_tagged":31583,"with_a_code_link":13473,"where_syntology_ran_a_sample":3998,"not_listed_spam_title":0,"listed":31583,"listed_where_code_ran":3998,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3366,"every_run_a_failure_of_syntologys_instrument":632,"listed_with_a_run_with_no_instrument_failure":3366,"listed_every_run_a_failure_of_syntologys_instrument":632,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/attention","prev":"/method/attention/papers/181","next":"/method/attention/papers/183","papers":[{"paper":"/paper/bad-actor-good-advisor-exploring-the-role-of","slug":"bad-actor-good-advisor-exploring-the-role-of","title":"Bad Actor, Good Advisor: Exploring the Role of Large Language Models in Fake News Detection","date":"2023-09-21","arxiv_id":"2309.12247","n_code_links":1,"syntology":null},{"paper":null,"slug":"badtrack-a-poison-only-backdoor-attack-on","title":"BadTrack: A Poison-Only Backdoor Attack on Visual Object Tracking","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/bayestune-bayesian-sparse-deep-model-fine","slug":"bayestune-bayesian-sparse-deep-model-fine","title":"BayesTune: Bayesian Sparse Deep Model Fine-tuning","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/biot-biosignal-transformer-for-cross-data","slug":"biot-biosignal-transformer-for-cross-data","title":"BIOT: Biosignal Transformer for Cross-data Learning in the Wild","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/blockwise-parallel-transformers-for-large","slug":"blockwise-parallel-transformers-for-large","title":"Blockwise Parallel Transformers for Large Context Models","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/boolformer-symbolic-regression-of-logic","slug":"boolformer-symbolic-regression-of-logic","title":"Boolformer: Symbolic Regression of Logic Functions with Transformers","date":"2023-09-21","arxiv_id":"2309.12207","n_code_links":1,"syntology":null},{"paper":null,"slug":"can-llms-augment-low-resource-reading","title":"Can LLMs Augment Low-Resource Reading Comprehension Datasets? Opportunities and Challenges","date":"2023-09-21","arxiv_id":"2309.12426","n_code_links":0,"syntology":null},{"paper":"/paper/cheaply-estimating-inference-efficiency","slug":"cheaply-estimating-inference-efficiency","title":"Cheaply Estimating Inference Efficiency Metrics for Autoregressive Transformer Models","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/clusterfomer-clustering-as-a-universal-visual","slug":"clusterfomer-clustering-as-a-universal-visual","title":"ClusterFomer: Clustering As A Universal Visual Learner","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/code-soliloquies-for-accurate-calculations-in","slug":"code-soliloquies-for-accurate-calculations-in","title":"Code Soliloquies for Accurate Calculations in Large Language Models","date":"2023-09-21","arxiv_id":"2309.12161","n_code_links":1,"syntology":{"ran":3,"of":4,"n_ran_checked":0,"n_instrument":3,"unverified":1,"pointer_only":4,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 3 where Syntology's instrument failed) · 1 unverified","official":{"repos":["luffycodes/tutorbot-spock-phys"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":"/paper/conformal-pid-control-for-time-series","slug":"conformal-pid-control-for-time-series","title":"Conformal PID Control for Time Series Prediction","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"constraints-first-a-new-mdd-based-model-to","title":"Constraints First: A New MDD-based Model to Generate Sentences Under Constraints","date":"2023-09-21","arxiv_id":"2309.12415","n_code_links":0,"syntology":null},{"paper":"/paper/convolution-and-attention-mixer-for-synthetic","slug":"convolution-and-attention-mixer-for-synthetic","title":"Convolution and Attention Mixer for Synthetic Aperture Radar Image Change Detection","date":"2023-09-21","arxiv_id":"2309.12010","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":2,"n_instrument":1,"unverified":0,"pointer_only":3,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 2 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":{"repos":["summitgao/camixer"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":2,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/dac-detr-divide-the-attention-layers-and","slug":"dac-detr-divide-the-attention-layers-and","title":"DAC-DETR: Divide the Attention Layers and Conquer","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"deyov3-detr-with-yolo-for-real-time-object","title":"DEYOv3: DETR with YOLO for Real-time Object Detection","date":"2023-09-21","arxiv_id":"2309.11851","n_code_links":0,"syntology":null},{"paper":null,"slug":"dualtoken-vit-position-aware-efficient-vision","title":"DualToken-ViT: Position-aware Efficient Vision Transformer with Dual Token Fusion","date":"2023-09-21","arxiv_id":"2309.12424","n_code_links":0,"syntology":null},{"paper":"/paper/flsl-feature-level-self-supervised-learning","slug":"flsl-feature-level-self-supervised-learning","title":"FLSL: Feature-level Self-supervised Learning","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"fully-transformer-equipped-architecture-for","title":"Fully Transformer-Equipped Architecture for End-to-End Referring Video Object Segmentation","date":"2023-09-21","arxiv_id":"2309.11933","n_code_links":0,"syntology":null},{"paper":"/paper/geometric-transformer-with-interatomic","slug":"geometric-transformer-with-interatomic","title":"Geometric Transformer with Interatomic Positional Encoding","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/h3t-efficient-integration-of-memory","slug":"h3t-efficient-integration-of-memory","title":"H3T: Efficient Integration of Memory Optimization and Parallelism for Large-scale Transformer Training","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/implicit-differentiable-outlier-detection","slug":"implicit-differentiable-outlier-detection","title":"Implicit Differentiable Outlier Detection Enable Robust Deep Multimodal Analysis","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/lart-neural-correspondence-learning-with","slug":"lart-neural-correspondence-learning-with","title":"LART: Neural Correspondence Learning with Latent Regularization Transformer for 3D Motion Transfer","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"lepard-learning-explicit-part-discovery-for","title":"LEPARD: Learning Explicit Part Discovery for 3D Articulated Shape Reconstruction","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"llmr-real-time-prompting-of-interactive","title":"LLMR: Real-time Prompting of Interactive Worlds using Large Language Models","date":"2023-09-21","arxiv_id":"2309.12276","n_code_links":0,"syntology":null},{"paper":"/paper/lmsys-chat-1m-a-large-scale-real-world-llm","slug":"lmsys-chat-1m-a-large-scale-real-world-llm","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","date":"2023-09-21","arxiv_id":"2309.11998","n_code_links":5,"syntology":null},{"paper":"/paper/making-scalable-meta-learning-practical","slug":"making-scalable-meta-learning-practical","title":"Making Scalable Meta Learning Practical","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/marich-a-query-efficient-distributionally-1","slug":"marich-a-query-efficient-distributionally-1","title":"Marich: A Query-efficient Distributionally Equivalent Model Extraction Attack","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/metamath-bootstrap-your-own-mathematical","slug":"metamath-bootstrap-your-own-mathematical","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","date":"2023-09-21","arxiv_id":"2309.12284","n_code_links":1,"syntology":{"ran":15,"of":22,"n_ran_checked":1,"n_instrument":14,"unverified":7,"pointer_only":0,"phrase":"15 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 1 violated, 0 with no contract checked; 14 where Syntology's instrument failed) · 7 unverified","official":{"repos":["meta-math/MetaMath"],"state":"official (archive's flag): 15 ran","n_ran":15,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":7,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"mg-vit-a-multi-granularity-method-for-compact","title":"MG-ViT: A Multi-Granularity Method for Compact and Efficient Vision Transformers","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"michao-huafen-1-0-a-specialized-pre-trained","title":"MiChao-HuaFen 1.0: A Specialized Pre-trained Corpus Dataset for Domain-specific Large Models","date":"2023-09-21","arxiv_id":"2309.13079","n_code_links":0,"syntology":null},{"paper":null,"slug":"mitigating-over-smoothing-in-transformers-via","title":"Mitigating Over-smoothing in Transformers via Regularized Nonlocal Functionals","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multimodal-deep-learning-for-scientific","title":"Multimodal Deep Learning for Scientific Imaging Interpretation","date":"2023-09-21","arxiv_id":"2309.12460","n_code_links":0,"syntology":null},{"paper":"/paper/neural-data-transformer-2-multi-context","slug":"neural-data-transformer-2-multi-context","title":"Neural Data Transformer 2: Multi-context Pretraining for Neural Spiking Activity","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/on-the-relationship-between-skill-neurons-and","slug":"on-the-relationship-between-skill-neurons-and","title":"On the Relationship between Skill Neurons and Robustness in Prompt Tuning","date":"2023-09-21","arxiv_id":"2309.12263","n_code_links":1,"syntology":null},{"paper":"/paper/one-fits-all-power-general-time-series","slug":"one-fits-all-power-general-time-series","title":"One Fits All: Power General Time Series Analysis by Pretrained LM","date":"2023-09-21","arxiv_id":null,"n_code_links":2,"syntology":null},{"paper":null,"slug":"osnet-mneto-two-types-of-general","title":"OSNet & MNetO: Two Types of General Reconstruction Architectures for Linear Computed Tomography in Multi-Scenarios","date":"2023-09-21","arxiv_id":"2309.11858","n_code_links":0,"syntology":null},{"paper":"/paper/panovos-bridging-non-panoramic-and-panoramic","slug":"panovos-bridging-non-panoramic-and-panoramic","title":"PanoVOS: Bridging Non-panoramic and Panoramic Views with Transformer for Video Segmentation","date":"2023-09-21","arxiv_id":"2309.12303","n_code_links":1,"syntology":null},{"paper":null,"slug":"patch-n-pack-navit-a-vision-transformer-for-1","title":"Patch n’ Pack: NaViT, a Vision Transformer for any Aspect Ratio and Resolution","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/quantsr-accurate-low-bit-quantization-for","slug":"quantsr-accurate-low-bit-quantization-for","title":"QuantSR: Accurate Low-bit Quantization for Efficient Image Super-Resolution","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/random-access-infinite-context-length-for","slug":"random-access-infinite-context-length-for","title":"Random-Access Infinite Context Length for Transformers","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"re-exploring-the-role-of-grammar-and-word","title":"[Re] Exploring the Role of Grammar and Word Choice in Bias Toward African American English (AAE) in Hate Speech Classification","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/re-masked-autoencoders-are-small-scale-vision","slug":"re-masked-autoencoders-are-small-scale-vision","title":"[Re] Masked Autoencoders Are Small Scale Vision Learners: A Reproduction Under Resource Constraints","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"re-on-the-reproducibility-of-cartoonx","title":"[Re] On the Reproducibility of CartoonX","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"refine-a-fine-grained-medication","title":"REFINE: A Fine-Grained Medication Recommendation System Using Deep Learning and Personalized Drug Interaction Modeling","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"slhcat-mapping-wikipedia-categories-and-lists","title":"SLHCat: Mapping Wikipedia Categories and Lists to DBpedia by Leveraging Semantic, Lexical, and Hierarchical Features","date":"2023-09-21","arxiv_id":"2309.11791","n_code_links":0,"syntology":null},{"paper":null,"slug":"spatial-temporal-transformer-based-video","title":"Spatial-Temporal Transformer based Video Compression Framework","date":"2023-09-21","arxiv_id":"2309.11913","n_code_links":0,"syntology":null},{"paper":null,"slug":"spiced-news-similarity-detection-dataset-with","title":"SPICED: News Similarity Detection Dataset with Multiple Topics and Complexity Levels","date":"2023-09-21","arxiv_id":"2309.13080","n_code_links":0,"syntology":null},{"paper":null,"slug":"spring-studying-papers-and-reasoning-to-play","title":"SPRING: Studying Papers and Reasoning to play Games","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"stock-market-sentiment-classification-and","title":"Stock Market Sentiment Classification and Backtesting via Fine-tuned BERT","date":"2023-09-21","arxiv_id":"2309.11979","n_code_links":0,"syntology":null},{"paper":"/paper/tart-a-plug-and-play-transformer-module-for","slug":"tart-a-plug-and-play-transformer-module-for","title":"TART: A plug-and-play Transformer module for task-agnostic reasoning","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/the-cambridge-law-corpus-a-corpus-for-legal-1","slug":"the-cambridge-law-corpus-a-corpus-for-legal-1","title":"The Cambridge Law Corpus: A Dataset for Legal AI Research","date":"2023-09-21","arxiv_id":"2309.12269","n_code_links":0,"syntology":null},{"paper":"/paper/the-reversal-curse-llms-trained-on-a-is-b","slug":"the-reversal-curse-llms-trained-on-a-is-b","title":"The Reversal Curse: LLMs trained on \"A is B\" fail to learn \"B is A\"","date":"2023-09-21","arxiv_id":"2309.12288","n_code_links":2,"syntology":{"ran":9,"of":11,"n_ran_checked":9,"n_instrument":0,"unverified":2,"pointer_only":11,"phrase":"9 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 0 where Syntology's instrument failed) · 2 unverified","official":{"repos":["lukasberglund/reversal_curse"],"state":"official (archive's flag): 9 ran","n_ran":9,"n_constructed":0,"n_ran_no_instrument_failure":9,"n_unverified":2,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"toa-task-oriented-active-vqa","title":"TOA: Task-oriented Active VQA","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"toward-re-identifying-any-animal","title":"Toward Re-Identifying Any Animal","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-efficient-pre-trained-language-model","title":"Towards Efficient Pre-Trained Language Model via Feature Correlation Distillation","date":"2023-09-21","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/unified-3d-segmenter-as-prototypical","slug":"unified-3d-segmenter-as-prototypical","title":"Unified 3D Segmenter As Prototypical Classifiers","date":"2023-09-21","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/a-paradigm-shift-in-machine-translation","slug":"a-paradigm-shift-in-machine-translation","title":"A Paradigm Shift in Machine Translation: Boosting Translation Performance of Large Language Models","date":"2023-09-20","arxiv_id":"2309.11674","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":0,"n_instrument":3,"unverified":0,"pointer_only":0,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 3 where Syntology's instrument failed) · 0 unverified","official":{"repos":["fe1ixxu/alma"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"attentionmix-data-augmentation-method-that","title":"AttentionMix: Data augmentation method that relies on BERT attention mechanism","date":"2023-09-20","arxiv_id":"2309.11104","n_code_links":0,"syntology":null},{"paper":null,"slug":"automatic-bat-call-classification-using","title":"Automatic Bat Call Classification using Transformer Networks","date":"2023-09-20","arxiv_id":"2309.11218","n_code_links":0,"syntology":null},{"paper":"/paper/controlled-generation-with-prompt-insertion","slug":"controlled-generation-with-prompt-insertion","title":"Controlled Generation with Prompt Insertion for Natural Language Explanations in Grammatical Error Correction","date":"2023-09-20","arxiv_id":"2309.11439","n_code_links":1,"syntology":null},{"paper":"/paper/cot-bert-enhancing-unsupervised-sentence","slug":"cot-bert-enhancing-unsupervised-sentence","title":"CoT-BERT: Enhancing Unsupervised Sentence Representation through Chain-of-Thought","date":"2023-09-20","arxiv_id":"2309.11143","n_code_links":2,"syntology":null},{"paper":"/paper/design-of-chain-of-thought-in-math-problem","slug":"design-of-chain-of-thought-in-math-problem","title":"Design of Chain-of-Thought in Math Problem Solving","date":"2023-09-20","arxiv_id":"2309.11054","n_code_links":1,"syntology":null},{"paper":null,"slug":"embed-search-align-dna-sequence-alignment","title":"Embed-Search-Align: DNA Sequence Alignment using Transformer Models","date":"2023-09-20","arxiv_id":"2309.11087","n_code_links":0,"syntology":null},{"paper":null,"slug":"fictional-worlds-real-connections-developing","title":"Fictional Worlds, Real Connections: Developing Community Storytelling Social Chatbots through LLMs","date":"2023-09-20","arxiv_id":"2309.11478","n_code_links":0,"syntology":null},{"paper":"/paper/forgery-aware-adaptive-vision-transformer-for","slug":"forgery-aware-adaptive-vision-transformer-for","title":"Generalized Face Forgery Detection via Adaptive Learning for Pre-trained Vision Transformer","date":"2023-09-20","arxiv_id":"2309.11092","n_code_links":1,"syntology":null},{"paper":null,"slug":"generative-ai-in-mafia-like-game-simulation","title":"Generative AI in Mafia-like Game Simulation","date":"2023-09-20","arxiv_id":"2309.11672","n_code_links":0,"syntology":null},{"paper":null,"slug":"generative-pre-training-of-time-series-data","title":"Generative Pre-Training of Time-Series Data for Unsupervised Fault Detection in Semiconductor Manufacturing","date":"2023-09-20","arxiv_id":"2309.11427","n_code_links":0,"syntology":null},{"paper":null,"slug":"gpt-molberta-gpt-molecular-features-language","title":"GPT-MolBERTa: GPT Molecular Features Language Model for molecular property prediction","date":"2023-09-20","arxiv_id":"2310.03030","n_code_links":0,"syntology":null},{"paper":null,"slug":"is-gpt4-a-good-trader","title":"Is GPT4 a Good Trader?","date":"2023-09-20","arxiv_id":"2309.10982","n_code_links":0,"syntology":null},{"paper":null,"slug":"kosmos-2-5-a-multimodal-literate-model","title":"KOSMOS-2.5: A Multimodal Literate Model","date":"2023-09-20","arxiv_id":"2309.11419","n_code_links":0,"syntology":null},{"paper":null,"slug":"localize-retrieve-and-fuse-a-generalized","title":"Localize, Retrieve and Fuse: A Generalized Framework for Free-Form Question Answering over Tables","date":"2023-09-20","arxiv_id":"2309.11049","n_code_links":0,"syntology":null},{"paper":"/paper/multi-image-tranformer-for-multi-focus-image","slug":"multi-image-tranformer-for-multi-focus-image","title":"Multi-image Tranformer for Multi-focus Image Fusion","date":"2023-09-20","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"prat-profiling-adversarial-attacks","title":"PRAT: PRofiling Adversarial aTtacks","date":"2023-09-20","arxiv_id":"2309.11111","n_code_links":0,"syntology":null},{"paper":"/paper/rating-prediction-in-conversational-task","slug":"rating-prediction-in-conversational-task","title":"Rating Prediction in Conversational Task Assistants with Behavioral and Conversational-Flow Features","date":"2023-09-20","arxiv_id":"2309.11307","n_code_links":1,"syntology":null},{"paper":"/paper/rmt-retentive-networks-meet-vision","slug":"rmt-retentive-networks-meet-vision","title":"RMT: Retentive Networks Meet Vision Transformers","date":"2023-09-20","arxiv_id":"2309.11523","n_code_links":1,"syntology":{"ran":3,"of":3,"n_ran_checked":3,"n_instrument":0,"unverified":0,"pointer_only":3,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["qhfan/RMT"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":0,"n_ran_no_instrument_failure":3,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/safurai-001-new-qualitative-approach-for-code","slug":"safurai-001-new-qualitative-approach-for-code","title":"Safurai 001: New Qualitative Approach for Code LLM Evaluation","date":"2023-09-20","arxiv_id":"2309.11385","n_code_links":1,"syntology":null},{"paper":"/paper/sequence-to-sequence-spanish-pre-trained","slug":"sequence-to-sequence-spanish-pre-trained","title":"Sequence-to-Sequence Spanish Pre-trained Language Models","date":"2023-09-20","arxiv_id":"2309.11259","n_code_links":1,"syntology":null},{"paper":null,"slug":"skeletr-towrads-skeleton-based-action","title":"SkeleTR: Towrads Skeleton-based Action Recognition in the Wild","date":"2023-09-20","arxiv_id":"2309.11445","n_code_links":0,"syntology":null},{"paper":"/paper/the-languini-kitchen-enabling-language","slug":"the-languini-kitchen-enabling-language","title":"The Languini Kitchen: Enabling Language Modelling Research at Different Scales of Compute","date":"2023-09-20","arxiv_id":"2309.11197","n_code_links":1,"syntology":null},{"paper":"/paper/transformers-versus-lstms-for-electronic-1","slug":"transformers-versus-lstms-for-electronic-1","title":"Transformers versus LSTMs for electronic trading","date":"2023-09-20","arxiv_id":"2309.11400","n_code_links":1,"syntology":null},{"paper":null,"slug":"a-family-of-pretrained-transformer-language","title":"A Family of Pretrained Transformer Language Models for Russian","date":"2023-09-19","arxiv_id":"2309.10931","n_code_links":0,"syntology":null},{"paper":null,"slug":"an-evaluation-of-gpt-4-on-the-ethics-dataset","title":"An Evaluation of GPT-4 on the ETHICS Dataset","date":"2023-09-19","arxiv_id":"2309.10492","n_code_links":0,"syntology":null},{"paper":"/paper/audio-signal-based-danger-detection-using","slug":"audio-signal-based-danger-detection-using","title":"Audio signal based danger detection using signal processing and deep learning","date":"2023-09-19","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/baichuan-2-open-large-scale-language-models","slug":"baichuan-2-open-large-scale-language-models","title":"Baichuan 2: Open Large-scale Language Models","date":"2023-09-19","arxiv_id":"2309.10305","n_code_links":2,"syntology":null},{"paper":"/paper/cfgpt-chinese-financial-assistant-with-large","slug":"cfgpt-chinese-financial-assistant-with-large","title":"CFGPT: Chinese Financial Assistant with Large Language Model","date":"2023-09-19","arxiv_id":"2309.10654","n_code_links":1,"syntology":null},{"paper":null,"slug":"context-aware-neural-video-compression-on","title":"Context-Aware Neural Video Compression on Solar Dynamics Observatory","date":"2023-09-19","arxiv_id":"2309.10784","n_code_links":0,"syntology":null},{"paper":"/paper/exploring-self-reinforcement-for-improving","slug":"exploring-self-reinforcement-for-improving","title":"Exploring Iterative Enhancement for Improving Learnersourced Multiple-Choice Question Explanations with Large Language Models","date":"2023-09-19","arxiv_id":"2309.10444","n_code_links":1,"syntology":{"ran":1,"of":2,"n_ran_checked":1,"n_instrument":0,"unverified":1,"pointer_only":2,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 1 violated, 0 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["strong-ai-lab/explanation-generation"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"foleygen-visually-guided-audio-generation","title":"FoleyGen: Visually-Guided Audio Generation","date":"2023-09-19","arxiv_id":"2309.10537","n_code_links":0,"syntology":null},{"paper":null,"slug":"generative-ai-vs-agi-the-cognitive-strengths","title":"Generative AI vs. AGI: The Cognitive Strengths and Weaknesses of Modern LLMs","date":"2023-09-19","arxiv_id":"2309.10371","n_code_links":0,"syntology":null},{"paper":null,"slug":"interpret-vision-transformers-as-convnets","title":"Interpret Vision Transformers as ConvNets with Dynamic Convolutions","date":"2023-09-19","arxiv_id":"2309.10713","n_code_links":0,"syntology":null},{"paper":null,"slug":"language-as-the-medium-multimodal-video","title":"Language as the Medium: Multimodal Video Classification through text only","date":"2023-09-19","arxiv_id":"2309.10783","n_code_links":0,"syntology":null},{"paper":null,"slug":"learning-dynamic-mri-reconstruction-with","title":"Learning Dynamic MRI Reconstruction with Convolutional Network Assisted Reconstruction Swin Transformer","date":"2023-09-19","arxiv_id":"2309.10227","n_code_links":0,"syntology":null},{"paper":null,"slug":"leveraging-speech-ptm-text-llm-and-emotional","title":"Leveraging Speech PTM, Text LLM, and Emotional TTS for Speech Emotion Recognition","date":"2023-09-19","arxiv_id":"2309.10294","n_code_links":0,"syntology":null},{"paper":null,"slug":"linemarknet-line-landmark-detection-for-valet","title":"LineMarkNet: Line Landmark Detection for Valet Parking","date":"2023-09-19","arxiv_id":"2309.10475","n_code_links":0,"syntology":null},{"paper":"/paper/mint-evaluating-llms-in-multi-turn","slug":"mint-evaluating-llms-in-multi-turn","title":"MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback","date":"2023-09-19","arxiv_id":"2309.10691","n_code_links":1,"syntology":null},{"paper":null,"slug":"mixed-distil-bert-code-mixed-language","title":"Mixed-Distil-BERT: Code-mixed Language Modeling for Bangla, English, and Hindi","date":"2023-09-19","arxiv_id":"2309.10272","n_code_links":0,"syntology":null},{"paper":null,"slug":"policygpt-automated-analysis-of-privacy","title":"PolicyGPT: Automated Analysis of Privacy Policies with Large Language Models","date":"2023-09-19","arxiv_id":"2309.10238","n_code_links":0,"syntology":null},{"paper":null,"slug":"rigorously-assessing-natural-language","title":"Rigorously Assessing Natural Language Explanations of Neurons","date":"2023-09-19","arxiv_id":"2309.10312","n_code_links":0,"syntology":null},{"paper":"/paper/roadformer-duplex-transformer-for-rgb-normal","slug":"roadformer-duplex-transformer-for-rgb-normal","title":"RoadFormer: Duplex Transformer for RGB-Normal Semantic Road Scene Parsing","date":"2023-09-19","arxiv_id":"2309.10356","n_code_links":0,"syntology":null},{"paper":null,"slug":"writer-defined-ai-personas-for-on-demand","title":"Writer-Defined AI Personas for On-Demand Feedback Generation","date":"2023-09-19","arxiv_id":"2309.10433","n_code_links":0,"syntology":null}],"record_sha256":"d1234ed011b540b310857087fc287e523154ef7baaf8034da188a7226575307b","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}