该XML规范列出一串Unicode字符要么是非法或"望而却步".给定一个字符串,如何从中删除所有非法字符?
我提出了以下正则表达式,但它有点满口.
illegal_xml_re = re.compile(u'[\x00-\x08\x0b-\x1f\x7f-\x84\x86-\x9f\ud800-\udfff\ufdd0-\ufddf\ufffe-\uffff]')
clean = illegal_xml_re.sub('', dirty)
Run Code Online (Sandbox Code Playgroud)
(Python 2.5不知道0xFFFF以上的Unicode字符,所以不需要过滤那些.)
我最近发现你可以通过在文件名中添加斜杠来伪造S3上的目录结构.这让我想到:对象ID是否有任何限制?我敢肯定必须有一些.长度?空字符(\ 0)?像无效的UTF-8字符之类的奥术?
我肯定必须有一些限制,但我似乎无法在文档中找到它们.
我正在使用AWS Lambda函数创建一个文件并将其保存到S3上的存储桶中,它运行正常.执行该putObject方法后,我得到一个data对象,但它只包含Etag最近添加的对象.
s3.putObject(params, function(err, data) {
// data only contains Etag
});
Run Code Online (Sandbox Code Playgroud)
我需要知道我可以在浏览器中使用的确切URL,以便客户端可以看到该文件.该文件夹已经公开,如果我从S3控制台复制链接,我可以看到该文件.
我试过使用,getSignedUrl但它返回的URL用于其他目的,我相信.
谢谢!