在 Pytorch 中执行优化时如何对变量应用界限?

Cap*_*oom 4 optimization non-convex clamp pytorch

我正在尝试使用 Pytorch 进行非凸优化,试图最大化我的目标(因此在 SGD 中最小化)。我想限制因变量 x > 0,并且 x 值的总和小于 1000。

我认为我已经以斜坡惩罚的形式正确实施了惩罚,但我正在努力解决 x 变量的边界问题。在 Pytorch 中,您可以使用设置边界clamp,但在这种情况下似乎不合适。我认为这是因为 optim 需要在幕后自由的渐变。完整的工作示例:

import torch
from torch.autograd import Variable
import numpy as np

def objective(x, a, b, c):   # Want to maximise this quantity (so minimise in SGD)
    d = 1 / (1 + torch.exp(-a * (x)))

    # Checking constraint 
    exceeded_limit = constraint(x).item()
    #print(exceeded_limit)

    obj = torch.sum(d * (b * c - x))

    # If overlimit add ramp penalty
    if  exceeded_limit < 0:
        obj = obj - (exceeded_limit * 10)
        print("Exceeded limit")

    return - obj

def constraint(x, limit = 1000): # Must be > 0
    return limit - x.sum()

N = 1000

# x is variable to optimise for 
x = Variable(torch.Tensor([1 for ii in range(N)]), requires_grad=True)
a = Variable(torch.Tensor(np.random.uniform(0,100,N)), requires_grad=True)
b = Variable(torch.Tensor(np.random.rand(N)), requires_grad=True)
c = Variable(torch.Tensor(np.random.rand(N)), requires_grad=True)

# Would like to include the clamp
# x = torch.clamp(x, min=0)

# Non-convex methodf
opt = torch.optim.SGD([x], lr=.01)

for i in range(10000):
    # Zeroing gradients
    opt.zero_grad()

    # Evaluating the objective
    obj = objective(x, a, b, c)

    # Calculate gradients
    obj.backward() 
    opt.step()
    if i%1000==0:  print("Objective: %.1f" % -obj.item())

print("\nObjective: {}".format(-obj))
print("Limit: {}".format(constraint(x).item()))

if torch.sum(x<0) > 0: print("Bounds not met")
if  constraint(x).item() < 0: print("Constraint not met")
Run Code Online (Sandbox Code Playgroud)

任何关于如何施加边界的建议将不胜感激,无论是使用钳位还是其他方式。或者一般性地建议使用 Pytorch 进行非凸优化。这是我正在处理的问题的一个更简单且按比例缩小的版本,因此如果可能的话,我试图找到一个轻量级的解决方案。我正在考虑使用一种解决方法,例如使用指数函数转换 x 变量,但随后您必须缩放函数以避免正值变得无穷大,并且我希望能够设置约束具有一定的灵活性。

194*_*onv 6

我和你遇到了同样的问题。\n我也想在 PyTorch 中的变量上应用边界。\n我通过下面的方法 3 解决了这个问题。

\n

你的例子有点复杂,但我仍在学习英语。\n所以我在下面给出一个更简单的例子。

\n

例如,有一个可训练变量v,它的界限是 (-1, 1)

\n
v = torch.tensor((0.5, \xef\xbc\x89, require_grad=True)\nv_loss = xxxx\noptimizer.zero_grad()\nv_loss.backward()\noptimizer.step()\n
Run Code Online (Sandbox Code Playgroud)\n

方式1。RuntimeError:需要 grad 的叶变量已在就地操作中使用。

\n
v.clamp_(-1, 1)             \n
Run Code Online (Sandbox Code Playgroud)\n

方式2。运行时错误:尝试再次向后浏览图形,但缓冲区已被释放。

\n
v = torch.clamp(v, -1, +1)  # equal to v = v.clamp(-1, +1)  \n
Run Code Online (Sandbox Code Playgroud)\n

方式3。不是错误。我在方法3中解决了这个问题。

\n
with torch.no_grad():\n    v[:] = v.clamp(-1, +1)  # You must use v[:]=xxx instead of v=xxx\n
Run Code Online (Sandbox Code Playgroud)\n