zsy814's picture
Initial EchoLoc code release
d8bfe4a verified
Raw
History Blame Contribute Delete
1.48 kB
#!/bin/bash
# --- 配置区 ---
LOG_DIR="/workspace/echoloc/Dataset/VStyle/sft/logs/"
KEEP_X=5 # 每种类型保留的数量
# --------------
cd "$LOG_DIR" || { echo "错误: 目录不存在"; exit 1; }
echo "正在清理日志(每组保留最近 $KEEP_X 个)..."
# 1. 提取所有唯一的 "前缀" 和 "后缀" 组合
# 逻辑:将 train_42018.out 拆分为 "train" 和 "out"
# 使用 sed 将 _数字. 替换为空格,方便 read 读取
ls -1 | grep -E '_[0-9]+\.[a-z0-9]+$' | sed -E 's/_([0-9]+)\.([a-z0-9]+)$/ \2/' | awk '{print $1, $2}' | sort -u | while read -r prefix ext; do
# 2. 根据前缀和后缀,匹配所有对应的文件
# 比如:ls -t train_* .out
# 注意:这里需要精准匹配结尾
# 构造匹配模式,例如 train_[0-9]*.out
pattern="${prefix}_[0-9]*.${ext}"
# 获取文件列表,按时间排序(最新在前)
files=$(ls -t $pattern 2>/dev/null)
if [ -z "$files" ]; then
continue
fi
count=$(echo "$files" | wc -l)
if [ "$count" -gt "$KEEP_X" ]; then
echo "发现组 [$prefix + .$ext]: 共 $count 个,保留 $KEEP_X 个"
# 提取需要删除的文件名
to_delete=$(echo "$files" | tail -n +$((KEEP_X + 1)))
# 执行删除
echo "$to_delete" | xargs -d '\n' -r rm --
else
echo "发现组 [$prefix + .$ext]: 共 $count 个,无需处理"
fi
done
echo "---------------------------------------"
echo "清理完成!"