将带后缀的文件大小转换为字节的最简单方法

Har*_*ikk 4 shell

标题确实说明了一切,但我目前正在使用一个带有 case 语句的简单函数将人类可读的文件大小字符串转换为以字节为单位的大小。它工作得很好,但是移植到其他代码中有点笨拙,所以我很想知道是否有任何广泛可用的命令可以替代 shell 脚本使用?

基本上我想获取诸如“100g”或“100gb”之类的字符串并将它们转换为字节。

我目前正在做以下事情:

to_bytes() {
    value=$(echo "$1" | sed 's/[^0123456789].*$//g')
    units=$(echo "$1" | sed 's/^[0123456789]*//g' | tr '[:upper:]' '[:lower:]')

    case "$units" in
        t|tb)   let 'value *= 1024 * 1024 * 1024 * 1024'    ;;
        g|gb)   let 'value *= 1024 * 1024 * 1024'   ;;
        m|mb)   let 'value *= 1024 * 1024'  ;;
        k|kb)   let 'value *= 1024' ;;
        b|'')   let 'value += 0'    ;;
        *)
                value=
                echo "Unsupported units '$units'" >&2
        ;;
    esac

    echo "$value"
}
Run Code Online (Sandbox Code Playgroud)

对于我认为对于处理文件的脚本来说相当普遍的东西,这似乎有点过分;足够普遍,以至于可能存在可以更快地执行此操作的东西。

如果没有广泛可用的解决方案(即 - 大多数 unix 和 linux 风格),那么我仍然很感激优化上述功能的任何提示,因为我想让它更小,更容易重用。

Ale*_*ore 7

见man numfmt。

# numfmt --from=iec 42 512K 10M 7G 3.5T
42
524288
10485760
7516192768
3848290697216

# numfmt --to=iec 42 524288 10485760 7516192768 3848290697216
42
512K
10M
7.0G
3.5T
Run Code Online (Sandbox Code Playgroud)


Joh*_*ica 2

这是我写的。它支持k、KB、 和KiB。(不过,它不区分 2 的幂和 10 的幂后缀,例如 1KB = 1000 字节,1KiB = 1024 字节。)

#!/bin/bash

parseSize() {(
    local SUFFIXES=('' K M G T P E Z Y)
    local MULTIPLIER=1

    shopt -s nocasematch

    for SUFFIX in "${SUFFIXES[@]}"; do
        local REGEX="^([0-9]+)(${SUFFIX}i?B?)?\$"

        if [[ $1 =~ $REGEX ]]; then
            echo $((${BASH_REMATCH[1]} * MULTIPLIER))
            return 0
        fi

        ((MULTIPLIER *= 1024))
    done

    echo "$0: invalid size \`$1'" >&2
    return 1
)}
Run Code Online (Sandbox Code Playgroud)

笔记:

  • 利用 bash 的=~正则表达式运算符,它将匹配项存储在名为 的数组中BASH_REMATCH。
  • 请注意函数体周围巧妙隐藏的括号。它们的存在是为了防止shopt -s nocasematch函数泄漏。