Tian-Fantasea commited on
Commit
ee3445e
·
verified ·
1 Parent(s): 523db3d

Create testreadme.md

Browse files
Files changed (1) hide show
  1. testreadme.md +86 -0
testreadme.md ADDED
@@ -0,0 +1,86 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ **模型相关论文可查阅:**
2
+
3
+ **7B**
4
+
5
+ [Depth-Breadth Synergy in RLVR: Unlocking LLM Reasoning Gains with Adaptive Exploration](https://arxiv.org/abs/2508.13755) <br>
6
+ [TiFRe: Text-guided Video Frame Reduction for Efficient Video Multi-modal Large Language Models](https://arxiv.org/abs/2602.08861) <br>
7
+ [Searching Meta Reasoning Skeleton to Guide LLM Reasoning](https://arxiv.org/abs/2510.04116) <br>
8
+ [Post-Training Quantization of OpenPangu Models for Efficient Deployment on Atlas A2](https://arxiv.org/abs/2512.23367) <br>
9
+ [OSUM-Pangu: An Open-Source Multidimension Speech Understanding Foundation Model Built upon OpenPangu on Ascend NPUs](https://arxiv.org/abs/2603.10862) <br>
10
+ [Structured Episodic Event Memory](https://arxiv.org/abs/2601.06411) <br>
11
+ [Quasar: Quantized Self-Speculative Acceleration for Rapid Inference via Memory-Efficient Verification](https://arxiv.org/abs/2603.01399v1) <br>
12
+ [CSSBench: Evaluating the Safety of Lightweight LLMs against Chinese-Specific Adversarial Patterns](https://arxiv.org/abs/2601.00588) <br>
13
+ [Beyond Static Question Banks: Dynamic Knowledge Expansion via LLM-Automated Graph Construction and Adaptive Generation](https://arxiv.org/abs/2602.00020) <br>
14
+ [Your Models Have Thought Enough: Training Large Reasoning Models to Stop Overthinking](https://arxiv.org/abs/2509.23392v3) <br>
15
+ [EvoOpt-LLM: Evolving industrial optimization models with large language models](https://arxiv.org/abs/2602.01082) <br>
16
+ [Accelerating OpenPangu Inference on NPU via Speculative Decoding](https://arxiv.org/abs/2603.03383) <br>
17
+ [V-CAGE: Context-Aware Generation and Verification for Scalable Long-Horizon Embodied Tasks](https://arxiv.org/abs/2601.15164) <br>
18
+ [Scheduling LLM Inference with Uncertainty-Aware Output Length Predictions](https://arxiv.org/abs/2604.00499) <br>
19
+ [Differentially Private and Communication Efficient Large Language Model Split Inference via Stochastic Quantization and Soft Prompt](https://arxiv.org/abs/2602.11513) <br>
20
+ [A-IO: Adaptive Inference Orchestration for Memory-Bound NPUs](https://arxiv.org/abs/2604.09752) <br>
21
+ [Multi-source Heterogeneous Public Opinion Analysis via Collaborative Reasoning and Adaptive Fusion: A Systematically Integrated Approach](https://arxiv.org/abs/2602.15857) <br>
22
+ [Characterize LSM-tree Compaction Performance via On-Device LLM Inference](https://arxiv.org/abs/2602.12669v1) <br>
23
+ [Traceable Cross-Source RAG for Chinese Tibetan Medicine Question Answering](https://arxiv.org/abs/2602.05195) <br>
24
+ [A Comprehensive Evaluation of LLM Reasoning: From Single-Model to Multi-Agent Paradigms](https://arxiv.org/abs/2601.13243) <br>
25
+ [Structured Self-Consistency: A Multi-Task Evaluation of LLMs on VirtualHome](https://arxiv.org/abs/2602.00611) <br>
26
+ [ArkEval: Benchmarking and Evaluating Automated CodeRepair for ArkTS](https://arxiv.org/abs/2602.08866) <br>
27
+ [FMBench: Adaptive Large Language Model Output Formatting](https://arxiv.org/abs/2602.06384) <br>
28
+ [DScheLLM: Enabling Dynamic Scheduling through a Fine-Tuned Dual-System Large language Model](https://arxiv.org/abs/2601.09100) <br>
29
+ [Holmes: An Evidence-Grounded LLM Agent for Auditable DDoS Investigation in Cloud Networks](https://arxiv.org/abs/2601.14601) <br>
30
+ [Cochain: Balancing Insufficient and Excessive Collaboration in LLM Agent Workflows](https://arxiv.org/abs/2505.10936) <br>
31
+ [How Few-shot Demonstrations Affect Prompt-based Defenses Against LLM Jailbreak Attacks](https://arxiv.org/abs/2602.04294) <br>
32
+
33
+
34
+
35
+
36
+
37
+ **1B**
38
+
39
+ [Post-Training Quantization of OpenPangu Models for Efficient Deployment on Atlas A2](https://arxiv.org/abs/2512.23367) <br>
40
+ [VisionPangu: A Compact and Fine-Grained Multimodal Assistant with 1.7B Parameters](https://arxiv.org/abs/2603.04957) <br>
41
+ [Neuromem: A Granular Decomposition of the Streaming Lifecycle in External Memory for LLMs](https://arxiv.org/abs/2602.13967) <br>
42
+ [CSSBench: Evaluating the Safety of Lightweight LLMs against Chinese-Specific Adversarial Patterns](https://arxiv.org/abs/2601.00588) <br>
43
+ [A-IO: Adaptive Inference Orchestration for Memory-Bound NPUs](https://arxiv.org/abs/2604.09752) <br>
44
+ [AGZO: Activation-Guided Zeroth-Order Optimization for LLM Fine-Tuning](https://arxiv.org/abs/2601.17261) <br>
45
+ [Combining Adam and its Inverse Counterpart to Enhance Generalization of Deep Learning Optimizers](https://arxiv.org/abs/2603.07122) <br>
46
+ [Characterize LSM-tree Compaction Performance via On-Device LLM Inference](https://arxiv.org/abs/2602.12669v1) <br>
47
+ [PanguMotion: Continuous Driving Motion Forecasting with Pangu Transformers](https://arxiv.org/abs/2603.16196) <br>
48
+ [FMBench: Adaptive Large Language Model Output Formatting](https://arxiv.org/abs/2602.06384) <br>
49
+ [Cochain: Balancing Insufficient and Excessive Collaboration in LLM Agent Workflows](https://arxiv.org/abs/2505.10936) <br>
50
+ [How Few-shot Demonstrations Affect Prompt-based Defenses Against LLM Jailbreak Attacks](https://arxiv.org/abs/2602.04294) <br>
51
+ [Adaptive Confidence Gating in Multi-Agent Collaboration for Efficient and Optimized Code Generation](https://arxiv.org/abs/2601.21469) <br>
52
+
53
+
54
+
55
+ **7B-V1.1**
56
+
57
+ [SpatialText: A Pure-Text Cognitive Benchmark for Spatial Understanding in Large Language Models](https://arxiv.org/abs/2603.03002) <br>
58
+ [Efficient Reasoning with Balanced Thinking](https://arxiv.org/abs/2603.12372) <br>
59
+ [OSUM-Pangu: An Open-Source Multidimension Speech Understanding Foundation Model Built upon OpenPangu on Ascend NPUs](https://arxiv.org/abs/2603.10862) <br>
60
+ [EvoOpt-LLM: Evolving industrial optimization models with large language models](https://arxiv.org/abs/2602.01082) <br>
61
+ [Accelerating OpenPangu Inference on NPU via Speculative Decoding](https://arxiv.org/abs/2603.03383) <br>
62
+ [CAMERA: Multi-Matrix Joint Compression for MoE Models via Micro-Expert Redundancy Analysis](https://arxiv.org/abs/2508.02322) <br>
63
+ [TypePro: Boosting LLM-Based Type Inference via Inter-Procedural Slicing](https://arxiv.org/abs/2604.02702) <br>
64
+ [UniPruning: Unifying Local Metric and Global Feedback for Scalable Sparse LLMs](https://arxiv.org/abs/2510.03291) <br>
65
+ [Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression](https://arxiv.org/abs/2602.08324) <br>
66
+ [DScheLLM: Enabling Dynamic Scheduling through a Fine-Tuned Dual-System Large language Model](https://arxiv.org/abs/2601.09100) <br>
67
+ [VAR-MATH: Probing True Mathematical Reasoning in LLMS via Symbolic Multi-Instance Benchmarks](https://arxiv.org/abs/2507.12885) <br>
68
+
69
+
70
+ **1B-V1.1**
71
+
72
+ [Silent Inconsistency in Data-Parallel Full Fine-Tuning: Diagnosing Worker-Level Optimization Misalignment](https://arxiv.org/abs/2602.14462) <br>
73
+ [AdapShot: Adaptive Many-Shot In-Context Learning with Semantic-Aware KV Cache Reuse](https://arxiv.org/abs/2605.03644v1) <br>
74
+ [Probe and Skip: Self-Predictive Token Skipping for Efficient Long-Context LLM Inference](https://arxiv.org/abs/2601.13155) <br>
75
+
76
+
77
+
78
+
79
+
80
+
81
+ <details>
82
+ <summary>详细清单</summary>
83
+
84
+ [Searching Meta Reasoning Skeleton to Guide LLM Reasoning](https://arxiv.org/abs/2510.04116)
85
+
86
+ </details>