2026-08-13

26 篇
A Sharp Four-Layer Theorem for Integer-Occupied Slices of a Planar Disk-Slab Figure 1
2026-08-13math.OC

A Sharp Four-Layer Theorem for Integer-Occupied Slices of a Planar Disk-Slab

Xinyue Liu (Institute of Nuclear and New Energy Technology, Tsinghua University)

Institute of Nuclear and New Energy Technology, Tsinghua University

2026-08-13优化控制

本文关注固定降维方向下,平面二次凸体与整数格仿射陪集及闭 slab 相交后会占据多少个整数层的问题,这补足了一般枚举或最近平面算法未给出的层数界。核心洞察是把 Babai 点严格落在内椭圆外的分支转化为少量五层反例块,并用直径估计、最近整数不等式、对称局部化和 Bernstein 证书逐一排除。主要结果证明最多只能占据四层,且给出有理实例达到四层,说明该界是 sharp。

Adversarial Resilience of Poisson-Process Submodular Maximization over Matroids: From Robust Offline Optimization to Full-Bandit Learning Figure 1
2026-08-13cs.LG

Adversarial Resilience of Poisson-Process Submodular Maximization over Matroids: From Robust Offline Optimization to Full-Bandit Learning

Vaneet Aggarwal

2026-08-13优化算法安全鲁棒

本文关注全反馈极少的组合多臂老虎机中,带拟阵约束的子模最大化离线优化器会受到经验奖励估计误差影响的问题。核心洞察是直接证明 SGS-Poisson 在受控对抗 oracle 下的轨迹仍保留交换势漂移和近平均交换性质,而不要求噪声轨迹接近精确轨迹。结果给出非单调 1/e、单调 1-1/e 的极限近似因子,误差项为 O(kξ),并通过离线到在线归约得到一般拟阵下的全 bandit 遗憾界。

Well-posedness and passivity for a class of bilinear control systems Figure 1
2026-08-13math.AP

Well-posedness and passivity for a class of bilinear control systems

Abdelhakim Dahmani, Hannes Gernandt, René Hosfeld, Timo Reis, Tolgahan Tasci

Port-Hamiltonian Institute, Bergische Universität Wuppertal, Gaußstraße 20, 42119 Wuppertal, Germany

2026-08-13规划控制三维

针对无限维双线性控制系统中控制与状态相乘、算子可能无界而导致适定性和无源性难以统一处理的问题,本文在 Banach 空间中建立含可容许输入算子的温和/经典解存在性与连续依赖框架,并在 Hilbert 空间中构造共址输出证明温和解无源性,结果覆盖双线性薛定谔方程、Fokker–Planck 方程和区域冷热管道模型。

The Advective Fisher-Rao Geometry of Deterministic Measure Transport Figure 1
2026-08-13math.OC

The Advective Fisher-Rao Geometry of Deterministic Measure Transport

Benjamin Gess, Johannes Müller

2026-08-13优化控制

本文关注连续性方程约束下概率测度路径的匹配问题,动机来自流模型、动态最优传输和自然梯度优化。核心创新是提出 advective Fisher–Rao 度量,并从零噪声极限、大偏差二阶变分和 Benamou–Brenier 作用量 Hessian 三个角度解释其几何来源。实验显示它更直接优化概率密度拟合,而 Gauss–Newton 更偏向速度场拟合;判断受限于 PDF 文本抽取质量。

On the Convergence Rate Lower Bound of Biochemical Computational Modules Figure 1
2026-08-13math.OC

On the Convergence Rate Lower Bound of Biochemical Computational Modules

Yuzhen Fan, Chuanhou Gao, Shibo He, Jiming Chen

College of Control Science and Engineering

2026-08-13学习理论

本文关注化学反应网络作为分子计算模块时,有限运行时间导致输出浓度尚未到达稳态、误差会在系统级设计中累积的问题。核心洞察是把多输出质量作用系统的收敛速度下界统一刻画为由雅可比矩阵实部最大的特征值约束,从而无需显式求解动力学即可评估速度。主要结果给出线性与非线性情形的严格证明,并用两个数值例子展示速率常数如何影响可达到的收敛范围。

Parallel Machine Scheduling with a Singler Server and Loading-Unloading Operations Figure 1
2026-08-13math.OC

Parallel Machine Scheduling with a Singler Server and Loading-Unloading Operations

Keramat Hasani, Frank Werner

Centre for Maritime Studies, National University of Singapore, Singapore, Otto-von-Guericke Business School Magdeburg, Germany

2026-08-13优化控制

面向柔性制造、港口等多台并行设备共享单一装卸资源的场景,论文研究每个作业需由同一服务器先装载、加工后立即卸载的最小完工期问题。核心洞察是卸载操作形成精确延迟约束,不能视为装载模型的简单扩展;论文证明机器数可变时强 NP 完全,并给出 LS、LPT 启发式的最坏性能界,三机 LS 为 5/2,一般固定机器数下分别趋近 4-3/m 与 3-2/m。

Competitive Analysis of Stock-based Thresholds via Prophet Inequalities in Continuous Time Figure 1
2026-08-13math.OC

Competitive Analysis of Stock-based Thresholds via Prophet Inequalities in Continuous Time

Jiashuo Jiang

2026-08-13优化控制

本文关注连续时间、多库存在线资源分配中,完全依赖时间的动态策略虽最优但难以实施且对需求预测敏感的问题。核心洞察是用库存水平阈值策略,并通过类型覆盖对偶将无限维、非凸的竞争分析化为可计算的 Poisson 优化,进一步证明最坏到达过程具有 cutoff、late-filling 与嵌套区间结构。结果显示,少量阈值即可给出明确 prophet-inequality 保证,如 K=2 两阈值竞争比 0.6269、K=3 三阈值 0.6816,优于单静态阈值基线。

A Multiscale Primal-Dual Interior-Point Relaxation Method for Large-Scale Optimal Transport Problems Figure 1
2026-08-13math.OC

A Multiscale Primal-Dual Interior-Point Relaxation Method for Large-Scale Optimal Transport Problems

Shengyu Sun, Rui-Jin Zhang, Ruoyu Diao, Yu-Hong Dai

School of Mathematical Sciences and LPMC, Nankai University, Tianjin, China

2026-08-13优化控制

大规模最优传输的完整线性规划会产生海量变量,内存和计算成为瓶颈。本文将多尺度活跃集框架与可热启动的原始-对偶内点松弛法结合,用上一层解的支撑预测稀疏子问题,并通过约化 Schur 补系统求牛顿方向。实验显示 MSIPRM 可处理完整形式含万亿级变量的实例,并在若干基准上快于 HOT、网络单纯形及同类多尺度方法。

Model-Consistent Structured-Hankel Matrix Completion for 3D Sparse Multi-frequency Electromagnetic Source Reconstruction Figure 1
2026-08-13math-ph

Model-Consistent Structured-Hankel Matrix Completion for 3D Sparse Multi-frequency Electromagnetic Source Reconstruction

Shujaat Khan, Abdul Wahab

SDAIA-KFUPM Joint Research Center for Artificial Intelligence, King Fahd University of Petroleum and Minerals, Dhahran 31261, Saudi Arabia.

2026-08-13三维

这篇论文针对稀疏多频远场数据下三维电磁源重建的严重病态性,指出常规结构 Hankel 补全虽能补谱,却可能生成不满足 Maxwell 模型的非物理解。作者将联合低秩 Hankel 补全与逐频闭式 Maxwell 子空间投影、共轭对称和噪声感知数据一致性结合成无需训练的 MC-Hankel。实验显示其相对 ALOHA 提升 PSNR 0.65–4.22 dB、降低相对误差 7.4%–38.9%,但统计检验受五次配对试验限制。

Direct Acceleration of Stochastic Root-Finding Without Variance Reduction and Regularization Figure 1
2026-08-13math.OC

Direct Acceleration of Stochastic Root-Finding Without Variance Reduction and Regularization

TaeHo Yoon, Nicolas Loizou

2026-08-13优化控制

本文针对随机根求解中确定性加速在噪声下易误差累积的问题,指出加速形式本身会影响随机稳定性。核心创新是采用对偶锚定机制构造 S-Dual-OHM,在不依赖方差缩减、递增 batch 或双层正则化的情况下保留加速效果。结果显示,在期望 cocoercive 条件下可用固定 batch 达到 O(ε^-3) oracle 复杂度;强单调时进一步为近似 O(ε^-2),并用实验说明其较 Halpern 型方法更抗随机噪声。

Adaptive Bregman Proximal Stochastic Gradient with a Stabilized Barzilai--Borwein Step Size Figure 1
2026-08-13math.OC

Adaptive Bregman Proximal Stochastic Gradient with a Stabilized Barzilai--Borwein Step Size

Chenhan Jin, Shengze Xu, Binghui Xie, Kaiwen Zhou, Fan Jia, James Cheng, Tieyong Zeng

University of Utah, Beijing Normal-Hong Kong Baptist University, Guangzhou Nanfang College, The Chinese University of Hong Kong

2026-08-13优化算法

本文针对 Bregman 近端随机梯度在非欧几里得复合优化中步长敏感、线搜索代价高的问题,提出 Ada-BPSG:用 SAGA 表中的增量割线信息构造稳定化 BB 步长,并通过 mediant 聚合、裁剪与单调保护抑制异常曲率估计。理论上给出凸情形 O(n/K) 遍历收敛、相对二次增长下重启线性收敛及非凸近端残差 O(1/K) 界;实验显示其在逻辑回归、泊松逆问题和稀疏 NMF 中较固定步长基线更稳健,但仍依赖光滑常数和较大的 SAGA 存储。

Variational Principles and Rearrangement Inequalities for asymmetric Operators on Periodic Lattices Figure 1
2026-08-13math.AP

Variational Principles and Rearrangement Inequalities for asymmetric Operators on Periodic Lattices

Xing Liang

2026-08-13优化控制

针对非自伴周期格点差分算子缺少 Rayleigh–Ritz 型刻画、难以做势函数重排优化的问题,本文把左右正特征向量转化为正剖面与周期对数校正子,构造显式鞍点和离散通量守恒方程,得到主特征值的 min-max/max-min 变分公式;在一维指数倾斜扩散中进一步给出标量通量表示,并证明钟形循环重排可同时最大化所有倾斜主特征值。

Joint Identifiability and Conditioning in Finite-Horizon Continuous-Time Inverse LQR with Unknown Dynamics Figure 1
2026-08-13math.OC

Joint Identifiability and Conditioning in Finite-Horizon Continuous-Time Inverse LQR with Unknown Dynamics

Meiling Yu, Yuan-Hua Ni, Lei Jiang

Research Institute, China[0.3em], College of Artificial Intelligence, Nankai University

2026-08-13优化控制

针对机器人模仿与行为建模中常见的“动力学和代价都未知”难题,本文研究有限时域连续时间逆 LQR 的可辨识性。核心洞察是有限时域 Riccati 终端条件会产生时变反馈增益,其变化可作为内生激励来分离开环动力学与代价权重;论文给出三个可计算条件数指标,并据此证明真实系统矩阵和二次代价可联合恢复,提出 CR-IOC 采样重构算法及噪声下非渐近误差与一致性保证。

Data-Driven optimal control via Koopman operators and Hamilton-Jacobi-Bellman equations Figure 1
2026-08-13math.OC

Data-Driven optimal control via Koopman operators and Hamilton-Jacobi-Bellman equations

Guuyuan Chen, Gaosheng Zhu

2026-08-13规划控制

本文针对未知非线性系统中 HJB 最优控制难以从数据获得稳定性与最优性保证的问题,提出 DD-SM 方法,将 Koopman/EDMD-SSD 表示学习与稳定流形求解结合,同时估计动力学及其导数。主要结果是给出有限样本误差、流形误差随数据增加下降的证明,并建立闭环指数稳定和最优性差距界;实验仅在改造 van der Pol 振子上验证,扩展性仍待说明。

Tight Nonasymptotic Local Convergence of Sinkhorn-Knopp Figure 1
2026-08-13math.OC

Tight Nonasymptotic Local Convergence of Sinkhorn-Knopp

Wenzhi Gao, Zhaonan Qu, Yinyu Ye, Madeleine Odell

ICME, Stanford University, Columbia University, Department of Management Science and Engineering, Stanford University

2026-08-13学习理论

这篇论文关注 Sinkhorn-Knopp 在矩阵缩放中实践上快速收敛、但既有理论多停留于保守全局界或渐近局部分析的问题。核心创新是给出与 Jacobian 渐近速率匹配的非渐近局部线性收敛证明,并显式刻画问题相关常数。结果表明在连通性和固定谱隙条件下,SK 可作为双随机矩阵缩放的多项式时间算法,并据此构造加速变体,改善稠密矩阵一阶方法复杂度。

A Wolfe-Type Spectral Conjugate Gradient Method for Nonsmooth Convex Optimization Problems Figure 1
2026-08-13math.OC

A Wolfe-Type Spectral Conjugate Gradient Method for Nonsmooth Convex Optimization Problems

Jauny, Gourav Kumar

2026-08-13优化算法

针对非光滑凸优化中现有共轭梯度方法缺少谱方向与 Wolfe 曲率控制的收敛保证,论文在 Moreau-Yosida 光滑化上构造带保护谱参数和 Dai-Kou 型共轭参数的算法,并适配不精确梯度线搜索。理论上证明全局收敛,强凸时给出 R 线性速率;实验显示在基准和大规模问题上整体具竞争力,但部分实现限制仍存在。

Metric Geometry of Lebesgue, Wasserstein, and Gromov-Wasserstein Spaces: Submetries, Curvature, and Geodesics Figure 1
2026-08-13math.MG

Metric Geometry of Lebesgue, Wasserstein, and Gromov-Wasserstein Spaces: Submetries, Curvature, and Geodesics

Martin Bauer, Facundo Mémoli, Tom Needham, Mao Nishino

2026-08-13优化控制

本文面向最优传输、度量几何和几何数据分析中 Wasserstein、非线性 Lebesgue 与广义 Gromov-Wasserstein 空间分散研究的问题,提出用 submetry 链统一三者。核心洞察是可在这些无限维空间间传递测地性与 Alexandrov 曲率信息;主要结果给出 Z-GW 测地线刻画、p=1 与 1<p<∞ 的测地性判据,以及曲率界的完整分类。

Stability of Finite-Batch Particle Mean-Field Variational Inference Beyond Strong Convexity Figure 1
2026-08-13math.NA

Stability of Finite-Batch Particle Mean-Field Variational Inference Beyond Strong Convexity

Vinh Nguyen, Truong Vu

Department of Mathematics, University of California, Berkeley, CA 94704, USA, Departments of Mathematics and Computational Medicine, University of California, Los Angeles, CA 90095, USA, Applied Mathematics and Computational Research (AMCR) division, Lawrence Berkeley National Laboratory, Berkeley, CA 94720, USA

2026-08-13优化算法

本文针对有限批粒子 MFVI 在非强凸目标下缺乏稳定性保证的问题,提出用曲率缺陷量刻画偏离收缩的程度,而不是直接假设强凸。核心结果是给出非渐近 Wasserstein 稳定界,分离初始化、粒子数、批大小、步长和非凸缺陷带来的误差;在一致缺陷有界时,迭代可保持在任一 MFVI 极小点的 O(√(β/α)) 邻域内,并显式揭示精度与计算成本的权衡。

Estimating the perturbed utility route choice model with trip-level data Figure 1
2026-08-13stat.ME

Estimating the perturbed utility route choice model with trip-level data

Mogens Fosgerau, Nikolaj Nielsen, Thomas Rasmussen, Rui Yao

University of Copenhagen, Technical University of Denmark, available at https://github.com/andyYaoR/micropurc.

2026-08-13优化控制

针对既有 PURC 路径选择估计需按 OD 聚合、会丢弃小样本 OD 与个体信息的问题,本文提出面向单次出行数据的 microPURC。方法用嵌套不动点把个体层扰动效用最优化与带偏差校正的线性回归结合,在只观测实际路径而非潜在流量时仍可估计参数;理论上证明一致性和根 N 渐近正态,并用模拟与大规模真实路网数据验证可行性。

On the Swapping Capacity of a Quantum Repeater Figure 1
2026-08-13quant-ph

On the Swapping Capacity of a Quantum Repeater

Van Sy Mai, Richard J. La, Abdella Battou, Abderrahim Amlou, Cory Nunn

ECE, Univ of Maryland, College Park, MD, USA

2026-08-13优化控制

本文面向量子中继在两条异构链路间进行纠缠交换时的吞吐率与保真度权衡:动机是量子网络应用需要满足最低端到端保真度,而存储等待会带来退相干。核心做法是把保真度约束转化为中继内纠缠的最大保持时间约束,并用排队模型/CTMC近似单、多存储器吞吐率,再以保持时间为变量优化。仿真显示模型能较准确预测吞吐率,且相较不设保持时间基线可获得更高的有效端到端纠缠吞吐。

Convex-Concave Interpolation and Application of PEP to Bilinear-Coupled Saddle-Point Problem Figure 1
2026-08-13math.OC

Convex-Concave Interpolation and Application of PEP to Bilinear-Coupled Saddle-Point Problem

Valery Krivchenko, Alexander Gasnikov, Dmitry Kovalev

Moscow Institute of Physics ans Technology, Innopolis University

2026-08-13优化算法

该文面向凸-凹鞍点问题中一阶方法最坏情形性能难以精确刻画的缺口,指出 PEP 框架受限于缺少相应插值条件。核心贡献是给出非光滑凸-凹函数、双线性函数及带双线性耦合复合函数的充要插值条件,并据此构造标准 PEP 与 Lyapunov 型 PEP;结果主要是理论表述与自动生成 Lyapunov 函数程序,通用光滑情形仍留作未来工作。

Predict-then-Optimize Framework for Public Transport Line Redesign under Fluctuating Traffic Conditions Figure 1
2026-08-13math.OC

Predict-then-Optimize Framework for Public Transport Line Redesign under Fluctuating Traffic Conditions

Zihao Guo, Andrea Araldo, Faycal Touzout, Mounim El-Yacoubi

National School of State Public Works

2026-08-13优化控制

针对公交线路在拥堵等波动交通下仍按静态方案运行、反应式跳站易损害连通性的痛点,论文提出预测后优化框架,用 DCRNN 误差模型刻画预测不准,并以 NSGA-III 在旅行时间、运营成本和线路重叠度之间做多目标重设计。Mandl 与北京网络实验显示,高波动下北京平均出行时间最高降 25.8%、运营成本降 22.6%,同时保持 85% 以上线路重叠和完整 OD 连通。

Reoptimization Algorithms for Contextual Bandits with Knapsack Constraints Figure 1
2026-08-13cs.LG

Reoptimization Algorithms for Contextual Bandits with Knapsack Constraints

Zhen Xu

Management School, University of Liverpool, Liverpool, United Kingdom

2026-08-13优化算法

本文针对平台匹配、广告投放等场景中“边学习收益、边消耗有限资源”的问题,研究已知资源消耗、未知线性奖励的带背包约束上下文 bandit。核心做法是将 UCB 估计嵌入流体 LP,并反复重优化以更新容量影子价格。理论给出平均 regret 为 O((ln T)^3/T),实验也显示 Re-UCB 的损失随 T 次线性增长并优于无重优化或分离式策略。

Time-Optimal Control of One-Mode Flexible Structures: Analytical Solution and the Cost of Flexibility Figure 1
2026-08-13eess.SY

Time-Optimal Control of One-Mode Flexible Structures: Analytical Solution and the Cost of Flexibility

Manuel Keppler

2026-08-13规划控制

针对柔性结构最短时间控制长期缺少闭式时间-位移律的问题,论文把双积分器耦合单一谐振模态的四阶模型化为相平面求解,并将综合降为一次标量反演。核心结果是给出最优时间的勾股分解,量化柔性同步代价:小位移时代价按 L^{1/4} 主导,大位移渐近消失;同时证明刚度影响非单调,天然运动处柔性代价和一阶刚度敏感性为零。

Contextual Quality-Diversity Evolutionary Reinforcement Learning for HVAC Control in Tropical Commercial Buildings Figure 1
2026-08-13cs.LG

Contextual Quality-Diversity Evolutionary Reinforcement Learning for HVAC Control in Tropical Commercial Buildings

Tran Le Vu

2026-08-13强化学习规划控制

面向热带商业楼宇中冷站高能耗、湿度硬约束和工况切换使单一强化学习策略难以部署的问题,论文提出 CQD-ERL:用运行情境与行为描述符索引策略档案,并结合进化搜索、SAC 与安全屏蔽。全年回测中相对 ASHRAE G36 节能约 3.40%,与单一 SAC 的 3.67% 差异不显著,但档案覆盖完整且各精英策略均优于基线。

Basin: Efficient and Extensible Numerical Optimization in Rust Figure 1
2026-08-13cs.LG

Basin: Efficient and Extensible Numerical Optimization in Rust

Johan Larsson

Department of Mathematical Sciences, University of Copenhagen

2026-08-13优化算法

针对 Rust 数值优化生态中算法分散、约束支持不足且常依赖本地 C/Fortran 工具链的问题,Basin 提供统一 trait/Executor 接口,整合一阶、无导数、最小二乘、全局与随机等多类求解器,并把约束和终止条件纳入编译期类型检查,默认兼容 WebAssembly。文中报告其在 benchmark 中通常快于 argmin 和 nlopt、接近 gomez,且已有约 3 万次近期下载和若干下游 R/Rust 应用。

2026-08-12

29 篇
Certificate-based Synthesis of Coordinated Droop Control for Heterogeneous Radial Distribution Networks Figure 1
2026-08-12math.OC

Certificate-based Synthesis of Coordinated Droop Control for Heterogeneous Radial Distribution Networks

Georgios Pantazis, Michelle Chong

2026-08-12规划控制

针对低压径向配电网中传统最坏情形电压证书掩盖节点异质性、下游保守性累积的问题,本文将证书从事后评估扩展为控制器合成工具,保留各母线扰动、灵敏度、下垂斜率和逆变器约束,并通过虚拟协调与仿射前馈重塑电压灵敏度;经缩放变换把联合设计化为线性规划,在两个径向网络算例中得到更紧、更具空间定位能力的全时电压和无功约束保证。

Mastering Stochastic OLG Models in Continuous Time Figure 1
2026-08-12econ.GN

Mastering Stochastic OLG Models in Continuous Time

Yves Achdou, Johannes Brumm, Lukas Frank

2026-08-12优化控制

本文针对含代际异质性、个体风险与总量风险的连续时间 OLG 模型难以求解的问题,将均衡表述为作用于联合分布的 master equation,并提出有限差分神经算子:用分布的有限维表示输入神经网络,输出条件价值函数的有限差分表示,从而保留边界条件与凹性约束。实验显示该方法可在含借贷约束、社保、遗赠动机和生产率/折旧冲击的模型中达到可接受精度,并在 H200 GPU 上 24 小时内收敛。

Integrated Surgical Scheduling with Weekend Bed Occupancy Management: A Column Generation Approach Figure 1
2026-08-12math.OC

Integrated Surgical Scheduling with Weekend Bed Occupancy Management: A Column Generation Approach

Sara Cambiaghi, Saverio Basso, Davide Duma, Matteo Salani

• A sensitivity analysis of resource availability providing managerial insights., aSUPSI, Dalle Molle Institute for Artificial Intelligence (IDSIA), Via la Santa 1, Lugano, 6900, Switzerland, bDepartment of Mathematics “F. Casorati”, University of Pavia, Via Ferrata, 5, Pavia, 27100, Italy, accounting for reduced bed availability during weekends. The model is formulated as a multi-criteria, for larger instances. We further analyze the trade-offs between weekend bed availability, OR utiliza-, realistically be adjusted in the short term. Consequently, bed availability represents a hard constraint

2026-08-12优化控制

手术排程常忽视周末人手减少导致的有效床位瓶颈,本文将主手术计划、病例分配与手术排序联合建模,并把周末床位占用作为惩罚约束纳入多目标MILP;为处理大规模实例,采用列生成并将定价子问题写成资源约束最短路。实验显示,该方法在大实例上较紧凑MILP更快且解质量更高,改进型分块排程通常在灵活性与计算效率间表现最好,同时揭示增加周末床位会提升患者接入但需更多 staffing。

Gromov-Wasserstein Quantization and Clustering: Structure, Rates, and Algorithms Figure 1
2026-08-12math.OC

Gromov-Wasserstein Quantization and Clustering: Structure, Rates, and Algorithms

Florian Beier, Stephan Eckstein

Department of Mathematics, University of Tübingen, Germany

2026-08-12优化控制

为在压缩数据集、形状或神经网络等对象时保留整体关系结构,论文把传统 Wasserstein/k-means 量化推广到 Gromov-Wasserstein 量化,在带权关系空间上同时聚类点与几何结构。核心结果包括解的存在性与最优量化器刻画、欧氏情形下与 Wasserstein 量化相同的 n^{-1/d} 速率,以及可视为 GW 版 Lloyd 的条件梯度算法;实验覆盖 3D 形状量化、GW 计算加速和结构化剪枝,但多为概念验证。

DD-suite: A cross-platform package to build Decision Diagrams for optimization purposes Figure 1
2026-08-12math.OC

DD-suite: A cross-platform package to build Decision Diagrams for optimization purposes

Antonia F. Blanco, Margarita Castro, Rodrigo Toro Icarte

2026-08-12优化算法三维

针对决策图优化研究中代码常按算法或应用定制、复用和扩展困难的问题,本文提出跨平台开源工具 DD-suite,以统一建模接口在 Python 与 C++ 中构建精确、受限和松弛决策图,并集成化简、最短路界、可视化、测试和切平面示例。实验显示两种实现生成一致图,C++ 比 Python 快约 5–6 倍,且相对专用 Rust 框架 ddo 仅慢一个小常数因子。

Prescribed-performance position tracking for infinite-dimensional passive systems Figure 1
2026-08-12math.OC

Prescribed-performance position tracking for infinite-dimensional passive systems

Anthony Hastir, Timo Reis

Department of Mathematics and Namur Institute for Complex Systems (naXys), University of Namur, Rue de Bruxelles 61, 5000 Namur, Belgium

2026-08-12视觉感知

本文针对柔性梁等分布参数机械系统中“测到速度、要控位置”的跟踪问题,研究被动输出经积分后形成受控位置的无限维系统。核心在于把系统节点框架下的漏斗控制改造成递归误差反馈,并加入动态增益监督器,误差接近监控边界时自动增加阻尼增益。论文证明闭环解全局存在唯一、位置误差满足预设漏斗性能,且在额外严格耗散条件下增益只有限次增加,状态和控制输入保持全局有界,并用边界驱动 Euler-Bernoulli 梁作验证。

Threshold Structure of Optimal Policies in Restart POMDPs Figure 1
2026-08-12math.OC

Threshold Structure of Optimal Policies in Restart POMDPs

Konstantin Avrachenkov, Alexey Piunovskiy, Yi Zhang

2026-08-12优化控制

本文针对长期不可观测运行、但可通过重启获得观测与状态改善的控制系统,研究重启 POMDP 的最优策略结构。核心思路是用“上次观测状态+距重启时间”作为充分统计量,将问题化为完全观测 MDP;在成本恶化、随机单调等条件下,证明折扣、总成本及平均成本准则下均存在时间阈值型最优策略,且阈值随状态单调变化。

Robust Patrol in a Dispersed Environment Figure 1
2026-08-12math.OC

Robust Patrol in a Dispersed Environment

Edward Mellor, Kevin Glazebrook, Kyle Lin, Rob Shone

2026-08-12安全鲁棒

本文面向分散地点安防中单个巡逻者无法同时覆盖全部目标的问题,将巡逻建模为对智能攻击者的最坏情形检测时间最小化。核心洞察是:无旅行时间时最优为按检测率反比分配连续搜索努力;有旅行时间时提出简单环巡与往返扫巡两类可计算周期策略,推导检测期望并优化停留时间。数值结果显示两类策略在不同网络结构下各有优势,最优巡逻形态高度依赖距离与检测率参数。

Robust Unit Commitment in District Heating Networks: Chance-Constrained and CVaR Optimization Under Demand Uncertainty Figure 1
2026-08-12math.OC

Robust Unit Commitment in District Heating Networks: Chance-Constrained and CVaR Optimization Under Demand Uncertainty

Annika Buchholz, Janina Zittel, Thorsten Koch

Zuse Institute Berlin, Applied Optimization, Berlin, Germany

2026-08-12优化算法安全鲁棒

该文针对区域供热机组组合中热需求不确定导致的欠供与过度备用问题,将贝叶斯概率需求预测接入混合整数优化,并并列构造机会约束与CVaR两类风险模型。结果显示,机会约束几乎保持确定性MIP规模、可低成本描绘成本-可靠性边界并暴露物理可靠性上限;CVaR能刻画尾部短缺风险,但需引入场景级短缺变量,计算代价在风险偏好转换区间明显上升。

Path Integral Value Matching for Linear Quadratic Stochastic Optimal Control Figure 1
2026-08-12cs.LG

Path Integral Value Matching for Linear Quadratic Stochastic Optimal Control

Bangyan Liao, Chenglei Yu, Yuchen Yang, Chuanrui Wang, Zhisheng Song, Peidong Liu, Tailin Wu

Westlake University, School of Engineering

2026-08-12规划控制

针对LQ随机最优控制中策略法依赖长轨迹仿真、计算昂贵且高方差的问题,本文从路径积分控制出发,通过截断并边缘化路径积分推导价值函数的时间递归形式,提出PI-VM,用TD学习、经验回放和Girsanov重加权实现离策略训练。实验显示其在低维任务达到同等精度但效率提升约一个数量级,并在高维采样中缓解模式坍塌。

A Framework for Joint Affine and Diffeomorphic Image Registration Figure 1
2026-08-12math.DG

A Framework for Joint Affine and Diffeomorphic Image Registration

Anton François (CB), Rayane Mouhli (MAP5 - UMR 8145, LJLL (UMR\_7598), CaGE), Thomas Pierron (CB)

ENS Paris-Saclay, Centre Borelli, by LDDMM. Our implementation is publicly available.1

2026-08-12视觉感知

这篇论文针对医学图像配准中“先仿射、再非刚性”的串行流程易把局部形变误归为全局变换、且多次插值损伤信号的问题,提出在 LDDMM 大变形框架下联合优化仿射与微分同胚形变,并设计全仿射与分解仿射两种模型及渐进仿射增强、变分权重交接策略。在 2D 合成数据和 IXI 3D 脑 MRI 上,该方法减少串行基线的异常形变,Dice 表现优于 FLIRT+LDDMM 以及 CARL、uniGradICON。

LQR Design For Formation Flying Near Halo Orbits Exploiting Quasi-Periodic Symmetry In Toroidal Coordinates Figure 1
2026-08-12eess.SY

LQR Design For Formation Flying Near Halo Orbits Exploiting Quasi-Periodic Symmetry In Toroidal Coordinates

Joaquin G. Lopez-Cepero, Rafael Vazquez, Julio C. Sanchez

2026-08-12优化控制

面向月球门户等近月编队任务,论文针对 halo 轨道附近 CR3BP 强非线性与拟周期相对运动下 LQR 难以直接设计的问题,引入非奇异环面坐标并利用其旋转拟周期对称性,证明 Riccati 方程和最优增益只需在单个轨道周期内离线计算、在线旋转扩展。仿真显示该控制器在 CR3BP 与高保真历表模型中均可完成不变环面重构,相比脉冲基线在相近跟踪精度下降低约 40% 控制代价。

Decision-Aware Approximation of Belief Functions for Evidential Combinatorial Optimization Figure 1
2026-08-12cs.AI

Decision-Aware Approximation of Belief Functions for Evidential Combinatorial Optimization

Sohaib Afifi

2026-08-12优化算法

这篇论文针对信念函数在组合优化中焦元过多、压缩后可能改变决策的问题,主张压缩目标应从保持证据距离转向控制下游决策后悔。核心做法是提出决策感知的安全合并准则,给出一点后悔上界、标量情形精确动态规划及在线剪枝版本。实验显示该方法比基于 Jaccard/Jousselme 等表示距离的压缩更少翻转最优决策,但代价是表示距离可能更大。

Randomization and Performance Improvement for Integer Optimal Control with Total Variation Regularization Figure 1
2026-08-12math.OC

Randomization and Performance Improvement for Integer Optimal Control with Total Variation Regularization

Robert Baraldi, Paul Manns, Lars Mösezahl, Marvin Severitt

Sandia National Laboratories, New Mexico, USA, Department of Mathematics, TU Dortmund University, Dortmund, Germany

2026-08-12规划控制

面向带全变差正则的整数 PDE 最优控制,论文针对二维以上子问题难解、全域信赖域算法难扩展的问题,提出随机选择重叠子域补丁求解的信赖域框架,以替代昂贵的贪婪补丁选择,并证明迭代几乎必然收敛到平稳点。实验在图像去噪和隐身基准上比较全域、贪婪分解和随机分解及多种加速组合,给出较优实现搭配,但具体性能增益对问题规模和求解器配置的依赖仍较强。

Indefinite Stochastic Linear-Quadratic Optimal Control Problem for a Markov Regime-Switching Model Figure 1
2026-08-12math.OC

Indefinite Stochastic Linear-Quadratic Optimal Control Problem for a Markov Regime-Switching Model

Na Li, Yilin Wei, Harry Zheng

2026-08-12规划控制

本文针对马尔可夫状态切换下随机线性二次控制中权重矩阵可为负定或不定、传统正定 Riccati 方法和伪逆处理受限的问题,引入松弛补偿子来刻画良定性并统一处理无约束与非负控制约束。论文推导了相应 Hamilton 系统、开环最优控制、Riccati 方程及闭环反馈形式,并以股债配置算例和数值模拟验证框架在 regime-switching 资产调整中的适用性。

Duality and Error for Predictively Oriented Inference Figure 1
2026-08-12stat.ME

Duality and Error for Predictively Oriented Inference

Aurya Javeed, Drew P. Kouri, Teresa Portone, Rebekah White

Sandia National Laboratories

2026-08-12优化控制

针对模型错设下传统贝叶斯/广义贝叶斯仍偏向参数损失、预测分布可能不稳的问题,本文研究直接按预测分布打分的 PrO 推断。核心创新是用凸对偶把无限维后验优化化为含 n+1 个变量的有限维对偶,并给出零对偶间隙、最优性条件、KL 情形的指数形式后验及数值误差证书。主要结果还包括近似 PrO 后验的有限样本超额预测风险界,并用分类与高斯混合例子说明非可达最优、不同散度正则调度和对偶计算。

A lower bound for stepsize-based acceleration of gradient descent Figure 1
2026-08-12math.OC

A lower bound for stepsize-based acceleration of gradient descent

Jianhao Ma, Yuxin Chen

Department of Industrial Engineering, Tsinghua University. Email:, Department of Statistics and Data Science, Wharton School, University of Pennsylvania. Email:

2026-08-12优化算法学习理论

论文关注一个近期问题:普通梯度下降能否仅靠预先设计的步长表,而不引入动量,达到加速法的最优速率。作者针对任意非负、可含超长步且按固定迭代轮数预设的步长序列,构造维度至多为T+1的光滑凸优化困难实例,证明末迭代最坏情形存在Ω(T^-p)下界,其中p可取大于约1.9319的任意值,从而表明单纯调步长无法达到O(T^-2),但与已知银比例上界之间仍有明显缺口。

Submillisecond Sequential Convex Optimization for Powered Landing via Dynamics Condensation and xPIPG Figure 1
2026-08-12math.OC

Submillisecond Sequential Convex Optimization for Powered Landing via Dynamics Condensation and xPIPG

Wenbo Li, Ziqi Xu, Dai Shen, Shengping Gong

2026-08-12优化算法

面向火箭动力着陆中带变质量、自由终端时间和气动阻力的在线序列凸优化瓶颈,论文通过精确动力学凝缩消去中间状态链,并用带能量项和近端正则的强凸子问题配合固定数组 xPIPG 近似求解。结果显示单精度 C 实现在 i7 上中位 374 微秒、P99 512 微秒,100 组扰动通过物理校验;但一遍节点映射并非精确 prox,增益来源不清,结论限于其模型、硬件和校验边界。

The Game of Marginal Utilities Figure 1
2026-08-12cs.GT

The Game of Marginal Utilities

Isaac M. Sonin, Georgy Gaitsgori, Yaakov Malinovsky

2026-08-12优化控制

本文关注多个策略主体在收益递减且竞争者投资会稀释回报的项目间如何分配固定资源。核心洞察是把纳什均衡刻画为等边际效用结构,并证明项目按 a/b 排序后,各玩家只投资前缀项目且支持集嵌套。主要结果包括唯一均衡、完全活跃情形下归约为一个标量方程,以及全局线性收敛的投影算法和可认证的 Block Pandora 重构方法。

Attainment Boundaries and Escape Rates in Asymptotically Conic Optimization Figure 1
2026-08-12math.OC

Attainment Boundaries and Escape Rates in Asymptotically Conic Optimization

Vinh Nguyen

Department of Mathematics, University of California, Berkeley, CA 94720, USA

2026-08-12优化算法学习理论

本文针对非多面体锥优化中“有下界但不取到最优”的边界现象,动机是解释可行性和强对偶仍正常时原始解为何逃向无穷远。核心洞察是用共轭空间的三层集合区分余锥非负、有界性与取到性,并在渐近锥情形给出逃逸方向选择、爆炸尺度和目标值渐近律;对径向模型和椭球二阶锥规划还推导出倾斜、截断、正则化及条件数的显式速率。

Kullback-Leibler Mirror-Prox for Measure-Valued Variational Inequalities and Mean-Field Equilibria Figure 1
2026-08-12math.OC

Kullback-Leibler Mirror-Prox for Measure-Valued Variational Inequalities and Mean-Field Equilibria

Erhan Bayraktar, Ibrahim Ekren, Lu Vy, Ziqing Zhang

2026-08-12优化控制

本文针对静态平均场博弈中直接在概率测度空间求均衡的计算问题,将均衡条件写成测度值变分不等式,并用 KL 散度替代欧氏投影构造 Mirror-Prox 外梯度法,使每步成为指数重加权。主要结果是在 Lasry-Lions 单调性下给出网格离散与迭代误差共同控制的 Minty 残差和近似均衡界,强单调时进一步得到迭代收敛率及熵正则选择结果。

Continuous-Time Covariance Steering with Common Free-Final Time: Finite-Horizon Solutions and Infinite-Horizon Limits Figure 1
2026-08-12math.OC

Continuous-Time Covariance Steering with Common Free-Final Time: Finite-Horizon Solutions and Infinite-Horizon Limits

Akan Selim, Fengjiao Liu, Siddhartha Ganguly, Panagiotis Tsiotras

2026-08-12优化控制

这篇论文针对协方差 steering 中终止时间预先固定会带来保守或不可行的问题,研究连续时间随机线性系统在共同自由终止时间下的协方差控制。核心贡献是把 SDE 约束问题重写为确定性最优控制,给出自由终止时间的必要条件、有限最优时间的充分条件,并分析长时域极限、turnpike 型不变结构与 Hamiltonian 敏感性;算法上用信赖域线搜索和无限时域检测,在协方差示例、航天器机动和高斯混合 steering 中验证。

Towards Co-Designed Event-Triggered Extremum Seeking Figure 1
2026-08-12math.OC

Towards Co-Designed Event-Triggered Extremum Seeking

Roberto Luo, Pedro Henrique Silva Coutinho, Victor Hugo Pereira Rodrigues, Tiago Roux Oliveira, Miroslav Krstic

Engineering (MAE), University of California at San Diego (UCSD), USA.

2026-08-12优化控制

针对事件触发极值寻优中先定控制器再设计触发律导致保守、通信频繁的问题,本文把控制增益与触发机制联合设计,并允许利用 Hessian 多面体不确定性下的全矩阵增益来捕捉变量耦合。该 LMI 凸优化框架保证平均闭环指数收敛、给定衰减率和无 Zeno,数值结果显示全矩阵设计相比对角增益可放宽触发阈值、减少触发并获得更低目标值。

An Optimal Energy Production Problem with Energy Source Switching and Load Following Nuclear Power Plants Figure 1
2026-08-12math.OC

An Optimal Energy Production Problem with Energy Source Switching and Load Following Nuclear Power Plants

Fabio Baschetti, Alessandro Gnoatto, Athena Picarelli

Department of Economics – University of Verona

2026-08-12优化控制

针对高比例风光使剩余负荷波动加剧、核电需参与调峰的问题,本文把核电机组的增产、降产和维持出力建模为带切换成本与爬坡约束的有限时域最优切换控制,并比较封闭系统与可交易电力市场。数值结果表明,缺电惩罚、切换成本、爬坡能力和市场接入会系统性改变核电负荷跟随策略,凸显可控低碳容量在可再生能源系统中的经济价值。

A New Approach for Feedback Stabilization and its Application for Data-Driven Control of Polynomial Systems Figure 1
2026-08-12math.OC

A New Approach for Feedback Stabilization and its Application for Data-Driven Control of Polynomial Systems

Diego de S. Madeira, Joao Gabriel N. Silva, Wilkley B. Correia, Antonis Papachristodoulou

2026-08-12规划控制

面向仅有含噪实验数据、模型不精确的多项式非线性系统,论文从耗散性控制出发,把设计目标转为寻找与候选控制 Lyapunov 函数兼容的闭环动力学。其核心是给出新的状态反馈稳定充分条件,并构造两类 SOS 迭代算法,避免传统 D-K 交替设计中对 CLF 或控制律初值的依赖。数值例子显示该框架能在若干基准上生成稳定控制器,但实际增益可能主要来自 scaling / data。

Geometric optimization problems generated by plane curves Figure 1
2026-08-12math.MG

Geometric optimization problems generated by plane curves

Petar Kenderov, Oleg Mushkarov, Nikolai Nikolov

Institute of Mathematics and Informatics, Bulgarian Academy, State University of Library Studies and Information Technologies

2026-08-12优化算法

本文从平面曲线生成的线段长度极值问题出发,试图统一“过定点最短/最长截线”和“与曲线相切的最优截线”等经典几何优化情形。核心洞察是把三条曲线作协调参数化,将局部极值的一阶条件转化为几何共点条件。主要结果表明:当基准曲线曲率非零时,最优三元组对应的两条端点法线与过曲率中心且垂直于该线段的直线必共点或平行,并进一步讨论圆、切线和退化情形。

Thread Scaling of Hexaly on the TDVRPTW across Two Model Encodings. An Experimental Report: External-Function Serialization, Slice-Count Choice, and the Time-Sliced Thread Ladder Figure 1
2026-08-12math.OC

Thread Scaling of Hexaly on the TDVRPTW across Two Model Encodings. An Experimental Report: External-Function Serialization, Slice-Count Choice, and the Time-Sliced Thread Ladder

Florian Rascoussier

IMT Atlantique, Lab-STICC, CNRS, UMR 6285 (équipe DECIDE) and INSA Lyon, Inria, CITI, UR3720, 69621 Villeurbanne, France

2026-08-12优化控制

论文动机是回应 Hexaly 在 TDVRPTW 求解中是否应按多线程评估的问题,并检验单线程公平比较是否低估其性能。核心洞察是线程扩展首先受模型编码支配:Python 外部函数回调会串行化评估,而时间切片的原生编码才能利用多核。实验显示,原生编码从 1 到 16 线程通常改善解质量、降低随机种子间波动,但收益伴随旅行时间近似误差,需独立校验。

Polyhedral Outer-Approximations for MISOCP: Geometry and Cutting Planes Figure 1
2026-08-12math.OC

Polyhedral Outer-Approximations for MISOCP: Geometry and Cutting Planes

Yongzheng Dai

2026-08-12优化控制

本文针对 MISOCP 外近似中“切平面越加越多但边际价值下降、反复求解完整 MILP 成本高”的问题,给出几何层面的解释:新 SOC 支撑切若方向接近已有切,其违约和体积改进至少线性衰减。基于此提出兼顾分离深度与角度新颖性的闭式切生成策略,并用渐进整数化先强化 LP/部分整数松弛。CBLIB 与大规模 AC 机组组合实验显示,两类策略可互补降低外近似计算量。

Decomposition-Closed Sublattices as Minimizer Sets of Modular Functions over Distributive Lattices Figure 1
2026-08-12math.RA

Decomposition-Closed Sublattices as Minimizer Sets of Modular Functions over Distributive Lattices

Ahmet Alkan, Kemal Yildiz

Ahmet Alkan: Department of Economics, Sabancı University, Kemal Yildiz: Department of Economics, Bilkent University

2026-08-12优化控制

本文关注有限分配格上哪些子格可由模函数的最小化解集刻画,动机是把格论中的结构闭包条件与优化目标的零点集合对应起来。核心洞察是提出“分解闭”子格,并借助 Birkhoff 表示将问题化为连通差分偏序集上的权重构造。主要结果证明:在有限分配格中,分解闭性不仅必要而且充分;但该刻画在非分配格上会失效。

2026-08-11

58 篇
Competitive mediator games and urban CAV routing markets Figure 1
2026-08-11cs.GT

Competitive mediator games and urban CAV routing markets

Grzegorz Jamróz

2026-08-11优化控制

论文面向未来自动驾驶路由服务商竞争的城市交通市场,关注用户不仅比较通行时间也比较乘坐体验时,传统价格竞争模型难以刻画的问题。作者提出竞争性中介博弈及其均衡,作为相关均衡/粗相关均衡的推广;主要结果表明,在匿名拥堵路由博弈中,若某个以市场份额为目标的中介被所有用户弱偏好,则所有竞争性中介均衡都会退化为垄断,提示ARAD市场机制需把用户福利纳入设计。

Safe Start: Configuring Optimization Algorithms for Decision-Making under Extreme Risks Figure 1
2026-08-11math.OC

Safe Start: Configuring Optimization Algorithms for Decision-Making under Extreme Risks

Henry Lam, Wasin Meesena

2026-08-11优化算法安全鲁棒

本文面向自动驾驶、金融和AI训练等高风险决策中“平均性能好但罕见灾难不可接受”的优化问题。核心洞察是,尾部风险目标对决策变量极敏感,使常规SGD即使用自适应方差缩减也可能在步长选择上陷入收敛失败;作者提出“safe start”初始化条件,将大偏差方差缩减与有限时间误差控制连接起来,并给出采样复杂度随安全起点和方差缩减而改善的理论结果,在投资组合与鲁棒分类实验中验证稳定性。

Vehicle Platooning Figure 1
2026-08-11math.OC

Vehicle Platooning

Zhi-Long Chen, Nicholas G. Hall

2026-08-11优化控制

随着车队规模扩大,异构车辆在不同道路段中的初始排序与途中重排序会直接影响能耗和电量均衡。本文把该问题系统化为总能耗最小化与单车最大能耗最小化两类优化目标,给出复杂度分类,并分别提供多项式算法、FPTAS、带性能界的启发式及受限换位重排序算法;实验显示启发式平均距最优解在1%以内。

From Barren Plateaus to SPSA Optimization in Variational Quantum Eigensolvers Figure 1
2026-08-11quant-ph

From Barren Plateaus to SPSA Optimization in Variational Quantum Eigensolvers

Zhen Qin

2026-08-11优化算法

本文关注 VQE 中荒漠高原导致梯度随量子比特数指数衰减时,常用 SPSA 优化器在有限测量 shots 下为何会失效。核心贡献是把 SPSA 梯度估计的非渐近偏差、方差和信噪比与测量预算联系起来,并给出收敛复杂度分析。主要结果表明,梯度能量的指数衰减会直接放大到迭代次数和总测量预算的指数增长。

A Singular Control Problem for Data Center Electricity Cost Minimization Figure 1
2026-08-11math.OC

A Singular Control Problem for Data Center Electricity Cost Minimization

Rene Carmona, Xiaoyu Cui

2026-08-11规划控制

本文以数据中心在峰值电费和需求响应激励之间调节用电为动机,将负荷及其运行最大值共同纳入状态,把问题刻画为带反射边界的奇异随机控制。核心洞察是峰值费用可等价为运行最大值的终端惩罚,从而导出含 Neumann 与斜向边界条件的 HJB 方程。论文证明价值函数局部 Lipschitz、建立动态规划和粘性解存在性,并给出比较原理及数值结果展示两类激励的权衡。

ADPSO-ERLS: A Hybrid Discrete PSO with Enhanced Local Search for the Traveling Salesman Problem Figure 1
2026-08-11math.OC

ADPSO-ERLS: A Hybrid Discrete PSO with Enhanced Local Search for the Traveling Salesman Problem

Anier Soria-Lorente, Jean-Marie Vilaire, Junior Michel, Lázaro Alvarado-Barrios

Department of Quantitative Methods, Loyola University, Mobile Computing and Networking Research Laboratory (LARIM), Department of Computer and Software Engineering, Department of Engineering, Loyola University

2026-08-11强化学习

针对TSP及机器人路径规划等场景中固定计算预算下探索与局部强化难以协调的问题,论文提出ADPSO-ERLS:用个人/全局记忆驱动的离散PSO保持排列可行,并将候选受限2-opt、精英选择、触发间隔和最终扰动精修拆成可调预算。实验在TSPLIB上显示其最佳和平均代价均优于五个对照,最大规模16862城市仍保持低于6.7%的Gap,但优势主要来自这种预算化混合局部搜索,而非新的PSO机制。

Algorithmic Asymmetry in Zero-Sum Games: Unilateral Recovery of Fast Convergence Against a Slow Opponent Figure 1
2026-08-11cs.GT

Algorithmic Asymmetry in Zero-Sum Games: Unilateral Recovery of Fast Convergence Against a Slow Opponent

James P. Bailey, Soham Das

Rensselaer Polytechnic Institute, University of Tennessee

2026-08-11学习理论

这篇论文针对零和博弈中双方未必采用同一学习算法的现实情形,追问一方固定使用较慢的 vanilla GD 时,快收敛是否仍可恢复。核心做法是提出 AOGD,让 GD–AOGD 的偶数步轨迹精确模拟交替梯度下降,从而绕开仅由较慢遗憾率限制的黑盒分析。主要结果是在双线性零和博弈中,时间平均策略可达到 O(1/T) 收敛到纳什均衡,说明单侧算法设计可补偿慢对手。

Information geometric regularization for computing sensitivities of flows with shocks Figure 1
2026-08-11math.NA

Information geometric regularization for computing sensitivities of flows with shocks

Florian Schäfer

2026-08-11生成模型

针对含激波欧拉流中传感器与限制器会产生伪灵敏度、冻结处理又引入系统误差的问题,本文将信息几何正则化用于灵敏度计算:以无黏的熵压力把激波替换为平滑剖面,并推导周期边界下的前向与伴随灵敏度 PDE。数值上,基于间断 Galerkin 离散的结果显示,网格加密后 PDE 灵敏度与有限差分、自动微分结果一致。

A globally and superlinearly convergent QO-free method for nonlinear optimization on Riemannian manifolds Figure 1
2026-08-11math.OC

A globally and superlinearly convergent QO-free method for nonlinear optimization on Riemannian manifolds

Chunming Tang, Hao He, Wen Huang, Jinbao Jian, Ruyun Li

2026-08-11强化学习优化算法

针对带等式与不等式约束的黎曼流形优化中,现有RSQO/内点法可能遇到子问题不可行、Maratos效应或缺少全局与局部快速收敛统一证明的问题,论文将欧氏QO-free思想推广到流形 setting,通过共享线性算子的三组线性系统生成主方向,并用高阶校正与黎曼弧搜索保证可行下降。理论上证明全局强收敛、最终接受单位步长及超线性收敛,数值实验显示相对已有方法具竞争性。

Stochastic Multistage Constellation Reconfiguration Problem: Stochastic Dual Dynamic Integer Programming Approach Figure 1
2026-08-11math.OC

Stochastic Multistage Constellation Reconfiguration Problem: Stochastic Dual Dynamic Integer Programming Approach

Brycen D. Pearl, Hang Woon Lee

2026-08-11优化控制

面向目标位置、价值和灾害演化不确定的卫星星座观测调度,论文将多阶段星座重构扩展为随机整数规划,并用 SDDiP 处理顺序机动、可见时间窗和燃料预算耦合。随机轨道目标与飓风仿真实验显示,该方法相较其他随机求解策略获得更高质量策略,但具体计算规模与收敛代价仍需结合全文细节判断。

Decoding Gene Regulatory Networks from Single-Cell RNA Velocity Figure 1
2026-08-11math.DS

Decoding Gene Regulatory Networks from Single-Cell RNA Velocity

Lingqi Meng, Shiruo Wang

Department of Mathematics, Yanbian University, Yanbian Korean Autonomous Prefecture, Jilin 133002, China, Department of Mathematics, State University of New York at Buffalo, Buffalo, New York 14260, United States

2026-08-11优化控制

本文关注单细胞 RNA velocity 能否反推出隐藏的基因调控网络,动机在于静态测序只能给出局部动态而难以解释调控机制。核心洞察是把问题写成耦合转录-剪接动力学下的稀疏逆问题,并证明未扰动快照通常不可辨识;受控扰动满足激励条件时可恢复唯一性。方法上用积分回归避免数值微分,并给出含噪声、潜在时间和模型误差的有限样本恢复保证。

Input convex neural networks as surrogates in mathematical optimisation Figure 1
2026-08-11math.OC

Input convex neural networks as surrogates in mathematical optimisation

Yu Liu, Jan Kronqvist, Fabricio Oliveira

2026-08-11优化算法

针对将神经网络代理嵌入优化模型时,ReLU FNN 的 MIP 表达随网络规模引入大量二进制变量、松弛偏弱的问题,论文主张在目标函数近似凸或凹时使用 ICNN。核心洞察是利用输入凸结构构造上由凹包络、下由 epigraph 给出的最强连续松弛,并据此设计直接在输入变量上分支的 LP 型分支定界算法。三类案例显示 ICNN 在精度接近 FNN 的同时求解更快、规模扩展更好。

Exact boundary controllability of a singular/degenerate wave equation via singular Sturm-Liouville theory Figure 1
2026-08-11math.AP

Exact boundary controllability of a singular/degenerate wave equation via singular Sturm-Liouville theory

Marcos Lopez-Garcia

2026-08-11规划控制学习理论

针对退化/奇异波方程在奇异端点施加边界控制时,传统加权迹与形式分部积分难以刻画可控边界项的问题,论文用奇异 Sturm-Liouville 理论从自伴实现和 Lagrange 括号中导出观测/控制算子。其核心在于统一处理次临界、临界对数和 limit-point 情形,并结合 Bessel 谱分解与 Ingham 不等式证明:在参数条件满足判别式约束且 T>4/(2-α) 时,系统在分数能量空间中精确边界可控。

Linear Convergence of a Frank-Wolfe-type Method over the Spectrahedron without Strict Complementarity Figure 1
2026-08-11math.OC

Linear Convergence of a Frank-Wolfe-type Method over the Spectrahedron without Strict Complementarity

Dan Garber

2026-08-11学习理论

本文针对谱单纯形上光滑凸优化中投影代价高、传统 Frank-Wolfe 收敛慢的问题,研究仅依赖极端特征向量计算的算法。核心创新是引入确定性的 pairwise 旋转步,并用二次增长与共同最优秩的几何性质替代严格互补性分析。主要结果是在无需平滑常数、无随机化和无 burn-in 的条件下,证明全局线性收敛且速率不显含环境维度。

Distributed Optimization with Streaming Data: A Temporal Weighting Perspective Figure 1
2026-08-11eess.SP

Distributed Optimization with Streaming Data: A Temporal Weighting Perspective

Muhammad Faraz Ul Abrar, Nicolò Michelusi, Erik G. Larsson

M. Faraz Ul Abrar and N. Michelusi are with the School of Electrical, Computer and Energy, Engineering, Arizona State University. email: {mulabrar

2026-08-11优化算法

针对流式数据和多智能体通信受限下目标函数持续变化的问题,本文把全局目标建模为历史样本损失的时间加权平均,而非任意漂移过程,并统一分析 DGD 与 diffusion 的跟踪误差。核心结果表明,均匀权重可使固定点跟踪项按 O(1/t) 衰减,折扣和窗口权重通常留下由记忆长度或折扣因子决定的误差底,去中心化与数据异质性还会带来额外偏差。

Faster Algorithms for Multimarginal Optimal Transport Figure 1
2026-08-11quant-ph

Faster Algorithms for Multimarginal Optimal Transport

Brandon Augustino, Yue Sun, Atithi Acharya, Shouvanik Chakrabarti, Junhyung Lyle Kim, Shree Hari Sureshbabu, Charlie Che

2026-08-11优化控制

针对多边际最优传输在边际数增加后失去网络流结构、变量规模达 n^m 的计算瓶颈,论文把离散 MOT 转化为稀疏正 packing LP,并用秩一补全恢复精确边际,得到近线性于张量维度且 1/ε 依赖的经典耦合算法;同时给出基于对偶的量子投影次梯度估计和量子多边际 Sinkhorn,获得维度上的量子加速但精度依赖更差,并配套证明经典与量子查询下界。

On the Hautus test for exact observability of normal semigroups Figure 1
2026-08-11math.OC

On the Hautus test for exact observability of normal semigroups

Jannik Daun, Birgit Jacob

University of Wuppertal, School of

2026-08-11优化控制

本文围绕无限维系统中 Hautus 判据能否推出精确可观测性这一 Russell-Weiss 猜想展开,关键贡献是构造正常生成元且观测算子为 Hilbert-Schmidt 的反例,否定“相似于压缩半群”版本;同时证明自伴生成元情形下命题成立,并给出正常生成元、紧观测算子时预解式紧性的结构性结果。

Regret, equilibrium, and learning in games: A guided tour Figure 1
2026-08-11cs.GT

Regret, equilibrium, and learning in games: A guided tour

Panayotis Mertikopoulos

regularized learning, respectively. We pay special attention to the information available to, put into question. By contrast, owing to the widespread availability of lightweight, scalable

2026-08-11学习理论

本文面向多智能体在未知、非平稳甚至对抗环境中能否通过学习表现出“类理性”的问题,统一梳理正则化学习/FTRL、虚拟博弈与 bandit 反馈下的博弈学习。核心洞察是把单智能体遗憾最小化与多智能体均衡收敛放在同一框架中分析;主要结果包括对抗多臂 bandit 的基本遗憾界、零和博弈中的遍历均衡收敛,以及纳什均衡与正则化学习吸引点之间的稳定性联系。

A proof of Ross's conjecture for two-site moving-target search Figure 1
2026-08-11math.PR

A proof of Ross's conjecture for two-site moving-target search

Yunpeng Li

2026-08-11优化控制

本文针对两站点移动目标搜索中 Ross 阈值策略猜想尚未解决的正行列式转移情形,避开直接分析无限期值函数,转而用搜索词序列、全正矩阵和嵌套射影区间证明成本线不会反向交叉。结果给出有限期阈值最优性,并通过统一截断界推广到无折扣无限期,结合既有工作完成经典情形的全参数证明。

Entropic Partial Optimal Transport and Partial Gromov--Wasserstein Distance between Gaussian Mixtures Figure 1
2026-08-11math.OC

Entropic Partial Optimal Transport and Partial Gromov--Wasserstein Distance between Gaussian Mixtures

Toshiaki Yachimura, Xiaocheng Zou

2026-08-11三维

针对标准最优传输和 Gromov-Wasserstein 距离必须匹配全部质量、难以处理离群点和局部重叠的问题,本文把熵正则部分最优传输推进到高斯混合模型,并定义部分混合 GW 距离。核心做法是在组分层面求解带惩罚的有限问题,再通过高斯最优映射诱导连续部分传输。文中证明极小解存在唯一、大惩罚与零熵极限、度量性质和收敛结果,实验显示该框架能控制匹配质量并提升对离群结构的鲁棒性。

A New Lower Bound for Online Vertex Cover under Vertex Arrivals Figure 1
2026-08-11cs.DS

A New Lower Bound for Online Vertex Cover under Vertex Arrivals

Tianhang Lu

2026-08-11学习理论

这篇论文针对顶点到达在线 Vertex Cover 中上下界仍有差距的问题,分析为何交替到达的二分完全块会迫使算法过早累积不可撤销代价。核心创新是把 Wang-Wong 的有限交替构造推广为任意深度的单调积分递推,并用固定点分类将连续违例转化为有限、非自适应输入。主要结果是证明随机整数和分数算法在二分图上也不可能达到低于 1+√e/2≈1.8244 的竞争比。

A primal--dual interior-point method for nonsymmetric conic optimization with conjugate-free scaling Figure 1
2026-08-11math.OC

A primal--dual interior-point method for nonsymmetric conic optimization with conjugate-free scaling

Rui-Jin Zhang, Wenhao Fu, Yu-Hong Dai

School of Mathematical Sciences and LPMC, Nankai University, Tianjin, 300071, China, School of Mathematical Sciences, Suzhou University of Science and Technology, Suzhou, 215009, China, State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China, and School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing 100049, China

2026-08-11优化算法

针对非对称锥优化中共轭障碍导数难求、传统 primal-dual scaling 难以直接推广的问题,论文用 primal barrier Hessian 的单割线 BFGS 更新构造 conjugate-free scaling,并嵌入齐次自对偶预测-校正框架;理论上证明 scaling 与 Hessian 一致可控,得到 O(sqrt(nu) log(1/epsilon)) 迭代复杂度,数值上在算子透视上图锥和量子相对熵锥任务中接近专用求解器 QICS。

Plant-Wide Hierarchical Electricity-Heat Coordination for Large-Scale Cold-Region ReP2H Plants via Bidirectional Thermal Coupling Figure 1
2026-08-11math.OC

Plant-Wide Hierarchical Electricity-Heat Coordination for Large-Scale Cold-Region ReP2H Plants via Bidirectional Thermal Coupling

Yiwei Qiu (1), Baiping Zhu (1), Tao Wu (1), Shi Chen (1), Buxiang Zhou (1), Kaigui Xie (1) ((1) College of Electrical Engineering, Sichuan University)

College of Electrical Engineering, Sichuan University, Chengdu, 610065, China

2026-08-11优化控制

针对寒冷地区大规模可再生电解制氢中冷启动慢、频繁启停带来热应力和退化的问题,论文把电解槽、BoP、厂内热公用系统和建筑热负荷纳入统一热网络,并用双向换热实现预热、热备用与余热回收,上层分钟级调度配合下层秒级温控。80 MW华北案例显示全年消除冷启动,产氢增1.50%,能效和火用效率分别提升0.99和4.33个百分点,LCOH降3.22%。

GPU-Accelerated Conic Quadratic Programming with Local Linear Convergence under Strict Complementarity Figure 1
2026-08-11math.OC

GPU-Accelerated Conic Quadratic Programming with Local Linear Convergence under Strict Complementarity

Hongpei Li, Yicheng Huang, Huikang Liu, Dongdong Ge, Yinyu Ye

Northwestern University, Shanghai University of Finance and Economics, Shanghai Jiao Tong University, Stanford University

2026-08-11学习理论

面向大规模锥二次规划,现有内点法受KKT分解和多GPU扩展限制,矩阵无关一阶法又缺少原生二次目标与通用锥支持。论文提出PDHCG-CQP,用重启平均PDHG和不精确锥二次近端步直接求解,并在严格互补下证明局部线性收敛。CUDA实现支持多类锥和多GPU,实验显示在QP、QCQP、SOCP及Fisher均衡上较一阶求解器更稳健,可扩展到8块GPU和4.4e8级变量。

Decision-Focused Learning in Network Interdiction Games Figure 1
2026-08-11cs.GT

Decision-Focused Learning in Network Interdiction Games

Luca M. Hartmann, Parinaz Naghizadeh

2026-08-11优化控制

本文关注最短路网络阻断博弈中,逃避者用机器学习预测边成本后再决策时,常规决策聚焦学习是否仍可靠。核心洞察是 DFL 在无阻断训练下存在大量“决策等价”估计器,名义最短路损失为零却会被阻断者利用,甚至不如 PFL。作者提出把阻断场景纳入训练的 A-DFL,并给出随机与最坏情形两种版本;合成网格和真实交通网络实验显示其可恢复 DFL 优势,AA-DFL 在稀疏阻断时更有增益。

Closing the loop in learning with missing data Figure 1
2026-08-11eess.SY

Closing the loop in learning with missing data

Dimitrios Pylorof, Humberto E. Garcia

U.S. Department of Energy Idaho National Laboratory

2026-08-11优化控制

本文关注训练数据缺失时,常规梯度更新可能沿缺乏观测支撑的方向漂移,导致参数不稳定。核心洞察是把缺失建模为学习动力系统中的结构性可观测性/可控性损失,并用标量与方向感知的自适应增益按观测 Gramian 重塑更新。结果给出 Lyapunov 与 ISS 型有界性/收缩条件,实验显示在稀疏、多模态缺失场景下可提升更新一致性和平滑性。

Provable Parameter-Free Fixed-Point Algorithms with Linear Convergence Rates Figure 1
2026-08-11math.OC

Provable Parameter-Free Fixed-Point Algorithms with Linear Convergence Rates

Quoc Tran-Dinh, Pham Ngoc Anh, Ha Manh Tien

∗ Department of Statistics and Operations Research, The University of North Carolina at Chapel Hill, USA, † Laboratory of Applied Mathematics and Computing, Posts and Telecommunications Institute of Technology, Hanoi, Vietnam, Fire and Rescue Academy, Hanoi, Vietnam

2026-08-11学习理论

本文针对固定点算法中收缩因子难以预先知道、非扩张假设又只能给出较慢速率的问题,提出无需线搜索或收缩因子估计的 Halpern 型参数无关算法,并给出可显式验证的线性收敛界;还扩展到自适应 Halpern、Tikhonov 正则化求解共余强方程和 Nesterov 加速变体。实验显示方法能利用隐藏收缩性,在合成线性与非线性例子上优于若干既有自适应方法,但实际应用增益仍文中未充分说明。

Radial-type error bounds for semidefinite feasibility problems without strict feasibility: qualitative estimates and asymptotic tightness Figure 1
2026-08-11math.OC

Radial-type error bounds for semidefinite feasibility problems without strict feasibility: qualitative estimates and asymptotic tightness

Mitsuhiro Nishijima, Guoyin Li, Bruno F. Lourenço

2026-08-11学习理论

针对半定可行问题在 Slater 条件失效时误差界常数缺乏显式估计的问题,论文引入径向型 Hölder 误差界,使常数随参考矩阵范数由径向模函数刻画;结合面约化与 facial residual functions 给出无需约束资格的显式定性界,并分析维度增长下的渐近紧性,还将结果用于半定规划最优性系统。

A Tight Lower Bound for Smooth Nonconvex Stochastic Optimization with Bounded Gradient Noise Figure 1
2026-08-11math.OC

A Tight Lower Bound for Smooth Nonconvex Stochastic Optimization with Bounded Gradient Noise

Jikai Jin

2026-08-11优化算法学习理论

本文针对光滑非凸随机优化中“梯度噪声几乎处处有界是否能优于有界方差”这一开放问题,构造固定分布、单 fresh-sample 的难例 oracle:用随机符号向量和小偏置分散梯度信息,并以 log cosh 项避免大范数逃逸。主要结果证明任意自适应随机算法仍需 Ω(ΔL/ε²+ΔLσ²/ε⁴) 次查询,匹配标准上界。

Direct Search Methods for Online Nonconvex Optimization Under Inexact Bandit Feedback Figure 1
2026-08-11math.OC

Direct Search Methods for Online Nonconvex Optimization Under Inexact Bandit Feedback

Gaspar Robert, Gianluca Bianchin

ICTEAM Institute, Université, ICTEAM Institute, Université catholique de Louvain, WEL Research Institute

2026-08-11优化算法

面向控制、机器人等场景中目标随时间变化且只能通过带误差的函数值反馈观测的问题,论文提出两点随机直接搜索法,用接受—拒绝更新替代梯度估计。主要结果是给出常数与递减探测步长下的非渐近驻点复杂度界,显式刻画时间漂移和 oracle 误差影响,并在静态情形恢复已有零阶复杂度。

Regional factors determine the feasibility of an elimination strategy Figure 1
2026-08-11math.OC

Regional factors determine the feasibility of an elimination strategy

George Adu-Boahen, Troy Day, Michael J Plank, Amy Hurford

2026-08-11优化控制

本文关注疫情中“清零/压制”策略为何在不同地区可行性不同。作者用含输入病例、社区传播、隔离与追踪资源约束的优化控制模型,刻画旅行流量、传播率和公共卫生能力的耦合影响,并证明目标性措施应尽早以最大强度实施。结果显示,清零或压制只有在资源充足、传播率低或输入感染少时可行;旅行措施的主要价值不在直接减少少量输入病例,而在保护追踪隔离能力、防止资源耗尽后的反弹。

Horizon-Dependent Tube MPC for Spacecraft Rendezvous on Elliptical Orbits with Conditional Robust Constraint Satisfaction Figure 1
2026-08-11eess.SY

Horizon-Dependent Tube MPC for Spacecraft Rendezvous on Elliptical Orbits with Conditional Robust Constraint Satisfaction

Omer Burak Iskender

School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore

2026-08-11规划控制优化算法安全鲁棒

针对椭圆轨道交会中导航噪声、摄动和推力/质量不确定性会压缩安全走廊的问题,论文把tube MPC扩展到YA线性时变动力学,用随预测步长变化的逐元素误差界替代保守的常宽管,并给出谱半径收敛与ISS证书。Mars样本返回轨道蒙特卡洛中,平均走廊违规较名义MPC降逾一个数量级、燃料代价相近,非线性J2真值测试也保持无违规。

Simultaneous Group-Envelope Bounds for $Γ$-Robust Multiple-Choice Knapsack Problems Figure 1
2026-08-11math.OC

Simultaneous Group-Envelope Bounds for $Γ$-Robust Multiple-Choice Knapsack Problems

Zi Yuan Eric Shao

2026-08-11学习理论安全鲁棒

这篇论文针对Γ鲁棒多选背包中需反复求解不同阈值LP松弛、运行时间被区间证书拖慢的问题,利用“每组恰选一个”约束带来的基线抵消,将各组贡献压缩为两个包络并一次评估全阈值族。实验显示在匹配自适应搜索中60个实例中位数全胜,几何平均提速2.37倍;但文中也明确指出,当整数子问题或阈值消除占主导时,加速收益会减弱。

Integrated Learning and Robust Optimization Figure 1
2026-08-11math.OC

Integrated Learning and Robust Optimization

Cheng Tan, Yuchen Mao, Shuming Wang, Huan Xu

2026-08-11优化算法安全鲁棒

本文针对预测再优化和决策聚焦学习在成本预测误差下易产生不稳定决策的问题,提出将鲁棒优化同时嵌入训练损失与部署决策的 ILRO 框架,并给出 RSPO 损失、凸替代、Fisher 一致性和有限样本超额风险界。交通与投资组合实验显示其决策质量优于多种基线,尤其在样本少、高维和模型错设时更明显。

Kernel Methods for Refined Prophet Inequalities Figure 1
2026-08-11cs.GT

Kernel Methods for Refined Prophet Inequalities

Patrick Loiseau, Mathieu Molina, Vianney Perchet, Sebastian Perez-Salazar, Victor Verdugo

¶Institute for Mathematical and Computational Engineering, and Department of Industrial and Systems Engineering

2026-08-11优化控制

本文针对传统先知不等式过度依赖最坏情形的问题,指出难例主要来自最大值的罕见大幅波动,而非边际分布本身。作者以最大值相对方差作为非参数复杂度,并提出量化函数上的核方法,把单阈值收益化为线性核泛函和凸优化问题。由此给出 IID 有界方差曲线的精确刻画、固定顺序非同分布模型的闭式结果,并证明有限方差下 prophet-secretary 严格难于 IID,同时扩展到随机时域模型。

Exact Rank-Space KL Projection for Shared-Marginal Low-Rank Factors: Application to Doubly Stochastic Clustering Figure 1
2026-08-11cs.LG

Exact Rank-Space KL Projection for Shared-Marginal Low-Rank Factors: Application to Doubly Stochastic Clustering

Enliang Hu

2026-08-11优化控制

这篇论文针对双随机图聚类中显式优化 n×n 图代价高、低秩两因子又难保持精确可行的问题,提出共享边际分解与秩空间 KL 投影,把联合投影化为 r−1 维严格凸对偶,并用于保持每步精确可行的镜像下降。实验显示其在匹配聚类任务上精度有竞争力、可行性残差接近数值精度,且无需稠密学习图;但后期目标下降与聚类指标不完全一致,增益来源仍部分不清。

A Unified Maximum-Margin Framework for Data Envelopment Analysis: Theoretical Foundations and Numerical Evidence Figure 1
2026-08-11math.OC

A Unified Maximum-Margin Framework for Data Envelopment Analysis: Theoretical Foundations and Numerical Evidence

Teruki Akahoshi, Hiroki Ueda, Tomonari Kitahara

2026-08-11优化控制

本文针对经典 CCR 数据包络分析在变量多、决策单元少时大量并列有效、难以排序的问题,提出最大间隔 DEA,将类似 SVM 的间隔最大化直接并入效率评估,并保持得分在 [0,1] 内;理论上证明其在参数为零时退化为 CCR,且可转化为线性规划,合成高维实验中能给出 CCR 无法提供的唯一排序。

Max-$k$-Cut via Node Features Figure 1
2026-08-11math.OC

Max-$k$-Cut via Node Features

Avinash Bhardwaj, Hritiz Gogoi, Vishnu Narayanan

2026-08-11优化控制

本文关注带节点特征表示的 Max-k-Cut:当边权来自特征向量内积时,问题可解释为把总特征量尽量均衡地分到 k 个部分,从而连接割优化、SDP 松弛与向量平衡。核心结果是给出 Frieze-Jerrum SDP 精确性的法锥证书,并证明完美特征平衡、非负特征支配两类结构下可精确;同时分析贪心特征平衡算法,保留 1-1/k 近似保证,在支配情形恢复最优,并在秩 1 非负情形给出无需知道 OPT 的后验 gap 证书。

Halpern Iteration Achieves $\tilde{\mathcal{O}}(ε^{-1/p})$ $p$th-Order Oracle Complexity for Monotone Variational Inequalities Figure 1
2026-08-11math.OC

Halpern Iteration Achieves $\tilde{\mathcal{O}}(ε^{-1/p})$ $p$th-Order Oracle Complexity for Monotone Variational Inequalities

Lesi Chen, Xinliang Zhang, Hengyu Wang, Chengchang Liu, Yongchao Chen, Jingzhao Zhang

IIIS, Tsinghua University, College of AI, Tsinghua University, School of Mathematical Sciences, Tongji University, Department of Artificial Intelligence, Westlake University

2026-08-11优化控制

本文针对单调变分不等式中二阶及高阶方法复杂度长期低于凸优化、且既有 NPE 与极小极大专用加速仍有缺口的问题,提出大步长非精确 Halpern 迭代框架,并将 Anchored Tensor Method 作为高阶子过程嵌入其中。主要结果是在一般 MVI 上达到二阶 O~(T^-2) 与 p 阶 O~(T^-p) 收敛率,改进此前 p≥2 的已知上界,但最优性仍文中未充分说明。

Constrained Learning with Universally Learnable Concept Classes Figure 1
2026-08-11cs.LG

Constrained Learning with Universally Learnable Concept Classes

Herlock SeyedAbolfazl Rahimi, Spyridon Pougkakiotis, Dionysis Kalogerias

Yale University, King’s College London

2026-08-11优化控制

本文针对安全、资源等约束下的非凸统计学习与随机控制,指出强对偶需要可分解的大类,而泛化又要求小复杂度类。核心做法是在可分解包络中使用稠密的通用 RKHS,并让范数球随样本增长,引入 Tikhonov 复杂度与闭包-实现缺口。结果证明双经验风险最小化具备通用 PACC 可学习性:最优值可精确学习,约束可行性在缺口为零时精确成立,否则残差由该问题几何常数刻画。

PRISM: A Predictive Protocol for Permutation Optimization via Landscape Diagnostics Figure 1
2026-08-11cs.LG

PRISM: A Predictive Protocol for Permutation Optimization via Landscape Diagnostics

Blessings Mambwe

2026-08-11优化算法

这篇论文关注组件已固定但顺序未定的排列优化问题,动机是避免在编译、流水线或提示指令中盲目套用搜索算法。PRISM的核心是先用小预算诊断局部自相关和适应度-距离相关,再决定枚举、采样或进化等执行器。结果显示,搜索空间大小不能预测难度;在5040个神经排序上进化搜索反而弱于均匀采样,而六条推理指令的720种顺序可使GSM8K准确率从6.3%变到96.9%。

Output tracking: an application for irrational SISO transfer functions and a survey for MIMO systems Figure 1
2026-08-11math.OC

Output tracking: an application for irrational SISO transfer functions and a survey for MIMO systems

Lucas Davron

2026-08-11视觉感知

本文面向线性时不变系统的输出跟踪问题,关注给定输入空间下哪些输出信号可实现。核心贡献是把有限维 MIMO 系统中分散的可达输出刻画、传递函数满射性与秩条件系统整理,并改进非有理 SISO 传递函数的跟踪结果。主要结果给出稠密可达、Sobolev 输出包含关系及 L2 输出完全刻画,并应用于一类带多项式系数的热方程。

Stability of MIMO PID With Backward Differences Under Fast Sampling: An Exact Spectral Criterion Figure 1
2026-08-11math.OC

Stability of MIMO PID With Backward Differences Under Fast Sampling: An Exact Spectral Criterion

Zhaobo Liu, Yanyi Wu, Peng Zhang

Grant JCYJ20250604181037012.Z. Liu and P. Zhang are with the Institute for Advanced Study, Shenzhen University

2026-08-11优化控制

本文关注数字 PID 中常用的后向差分微分项:即使连续时间 MIMO PID 闭环良定且稳定,快速采样也未必保持稳定。核心洞察是前一输出样本作为控制器记忆会在精确提升模型中产生独立的快速特征值。主要结果给出小采样周期下的精确谱判据:除边界谱情形外,采样实现稳定当且仅当理想闭环 Hurwitz 且 CBKD 为 Schur。

Non-linear optimal stopping with Bermudan strategies: the infinite horizon case Figure 1
2026-08-11math.PR

Non-linear optimal stopping with Bermudan strategies: the infinite horizon case

Miryana Grigorova, Ohood Aldalbahi

2026-08-11优化控制

本文针对无限期限下非线性最优停止比有限期限更难处理的问题,研究停止时刻受 Bermudan 网格约束且收益可非负非可积的情形。核心在于用非线性 Snell 包络刻画价值族,并在双指标非线性评价下建立动态规划原则。主要结果包括 ε-最优停止时刻存在、首次触及收益的时刻当且仅当有限时最优,以及一类非线性超鞅的 Doob 型收敛;双指标完全情形的收敛性仍未解决。

Learning under Opponent Unawareness in Linear-Quadratic Stochastic Games Figure 1
2026-08-11math.OC

Learning under Opponent Unawareness in Linear-Quadratic Stochastic Games

Dantong Chu, Xuefeng Gao, Yufei Zhang

Dantong Chu 1 1 1 Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Hong Kong, China., Xuefeng Gao 2 2 2 Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Hong Kong, China., Yufei Zhang 3 3 3 Department of Mathematics, Imperial College London, UK.

2026-08-11优化控制

面向自动定价、交易等算法在看不见对手时的动态互动风险,本文研究非零和线性二次随机博弈中的“对手无感知”学习。核心洞察是,即使玩家只能观察公共状态和自身动作、且学到的是错设单智能体模型,异步 ε-greedy 最小二乘学习仍可几乎必然收敛到完全信息纳什均衡并给出速率;Cournot 黏性价格实验显示信息受限会降低利润和总剩余、提高集中度,公开总产量可加速收敛并缓解损失。

Optimal cost of fast boundary controls for the one-dimensional heat equation Figure 1
2026-08-11math.OC

Optimal cost of fast boundary controls for the one-dimensional heat equation

Pierre Lissy

2026-08-11规划控制学习理论

本文针对一维热方程快速边界零控制的最优代价长期只知上下界的问题,精确刻画小时间下控制能量的指数爆炸率。核心做法是把矩量问题转为整函数插值,并结合 Hardy 空间分解、Hilbert 变换约束与半拉普拉斯障碍型优化,证明最优常数为 κ*=Γ(1/4)^4/(8π^3),从而闭合既有下界与 Dardé–Ervedoza 上界之间的缺口。

A Game-Theoretic Characterization of Feedback Capability for Fully Coupled Vector-Valued Nonparametric Systems Figure 1
2026-08-11math.OC

A Game-Theoretic Characterization of Feedback Capability for Fully Coupled Vector-Valued Nonparametric Systems

Zhaobo Liu

Institute for Advanced Study, Shenzhen University

2026-08-11优化控制

本文关注未知非参数离散系统在有界扰动下何时还能被因果反馈稳定,动机是标量阈值理论无法处理全耦合向量系统。核心做法是把问题改写为响应历史逃逸博弈,并用 Borel 确定性与 Kirszbraun–Valentine 延拓连接博弈和实际闭环系统。主要结果给出严格反馈能力阈值 Γd:低于它可统一稳定,高于它任意控制律都有反例,并证明 Γd 有显式下界、随维度单调且标量情形恢复既有阈值。

Existence and computation of monomial families of near-optimal strategies for recursive games Figure 1
2026-08-11cs.GT

Existence and computation of monomial families of near-optimal strategies for recursive games

Peter Bro Miltersen

2026-08-11优化控制

本文针对递归随机博弈中“每个精度重新求策略”不便于符号表示与计算的问题,研究能统一覆盖足够小 ε 的单项式近优策略族。核心洞察是用有向森林多项式刻画吸收概率,并把有限多个单项式的渐近阶压缩为整数权重向量,避开半代数选择和 Puiseux 级数。主要结果是给出初等存在性证明,并在固定活跃状态数、理性输入下提供确定性多项式时间的精确构造算法。

Reinhardt's Maximum-Perimeter Polygon Problem at n=16, 32, and 64: Computer-Assisted Proof Candidates Figure 1
2026-08-11cs.CG

Reinhardt's Maximum-Perimeter Polygon Problem at n=16, 32, and 64: Computer-Assisted Proof Candidates

Jizhou Guo, Yitao Luo

University of Science and Technology of China, Hefei, China

2026-08-11优化控制

本文针对小直径凸多边形的 Reinhardt 最大周长问题,聚焦此前未精确解决的 16、32、64 边形情形。核心做法是将问题转到差体与符号编码,结合饱和性证明、近正则定位、精确算术穷举和 KKT 强凸性论证,给出三个唯一最大构型的计算机辅助证明候选。结果仍待独立专家审查,尚不宜视为已确立定理。

A Computable Stochastic Riccati Equations Framework for Mean--Variance Portfolio Selection with Multifactor Stochastic Volatility Model Figure 1
2026-08-11math.OC

A Computable Stochastic Riccati Equations Framework for Mean--Variance Portfolio Selection with Multifactor Stochastic Volatility Model

Zhecheng Huang, Guojiang Shao, Lei Wang, Qi Zhang

School of Mathematical Sciences Fudan University & China Pacific Insurance (Group) Co, School of Mathematical Sciences Fudan University, School of Mathematical Sciences Fudan University & State Key Laboratory of Cryptography and Digital Economy Security, Shandong University

2026-08-11优化控制

本文针对随机市场系数下连续时间均值—方差组合选择难以计算的问题,构建多因子 Heston 型随机波动模型,并将最优控制归结为随机 Riccati 方程。核心创新是用线性 BSDE 给出上下界初始化,再结合迭代 BSDE 与对数变换的 Deep BSDE/DBDP 求解以缓解奇异性和训练不稳。基于行业 ETF 的实验显示,该策略的目标财富路径更平滑,回撤和下行风险控制优于基准,但增益可能部分来自模型设定与数据选择。

Queueing Analysis and Cost Optimization in a Diagnostic--Treatment Hospital Queue with Heterogeneous Referred Patients Figure 1
2026-08-11math.OC

Queueing Analysis and Cost Optimization in a Diagnostic--Treatment Hospital Queue with Heterogeneous Referred Patients

Shobha Rani, Rohit Dehru, Raghu Nandan Sengupta

Department of Management Sciences, Indian Institute of Technology Kanpur

2026-08-11优化算法

本文针对专科医院中初诊患者需先诊断再治疗、转诊患者直接治疗且共享同一服务能力的拥堵管理问题,构建异质治疗模式下的马尔可夫相型排队模型。其核心在于将两类患者和多治疗阶段统一到 FCFS 池化队列中:两治疗情形给出生成函数解,任意治疗数用矩阵解析法求稳态,并进一步设计负载触发的最小扩容规则。结果表明,该框架可计算等待、队长和利用率等指标;成本问题可重写为严格凸优化并有唯一全局最优,PSO、SA、SCA 的数值解与凸基准一致。

Computing the Maximal Controlled Invariant Set for Neural Network Control Systems Figure 1
2026-08-11math.OC

Computing the Maximal Controlled Invariant Set for Neural Network Control Systems

Tianxiao Ye, Hang Zhang, Xiangru Xu

T. Ye, H. Zhang, and X. Xu are with the Department of Mechanical Engineering, University of Wisconsin-Madison, Madison, WI, USA. Email:

2026-08-11规划控制

这篇论文面向带神经网络残差模型的控制系统安全验证问题,目标是计算最大受控不变集以支撑约束满足和安全滤波。核心做法是用区间方法构造控制仿射包络,并利用输入空间中的超平面排列,把连续控制搜索化为有限代表点验证;在此基础上迭代生成 MCIS 的内外近似。主要结果是给出无需优化求解、可并行化的算法,并通过数值例子展示有效性,但规模化收益的具体来源仍需结合实验细节判断。

The Sharp Worst-Case Asymptotic Rate of the Barzilai--Borwein Method in $\mathbb R^d$ and Hilbert Spaces Figure 1
2026-08-11math.NA

The Sharp Worst-Case Asymptotic Rate of the Barzilai--Borwein Method in $\mathbb R^d$ and Hilbert Spaces

Shutai Yang, Ya-Xiang Yuan

2026-08-11优化控制

本文针对 Barzilai-Borwein 方法长期缺少尖锐最坏情形收敛率的问题,重新分析其带一步记忆的谱动力学。核心洞察是用成对概率分布、端点证书和谱测度刻画活跃谱区间,从而证明 BB1/BB2 在有限维、Hilbert 空间及局部非线性问题中的梯度根因子上界均为条件数给出的 (κ-1)/(κ+1),且可由匹配端点轨道达到,说明该阈值是最优而非保守估计。

Zeroth-Order Langevin Monte Carlo via SPSA under Noisy Function Measurements Figure 1
2026-08-11math.OC

Zeroth-Order Langevin Monte Carlo via SPSA under Noisy Function Measurements

Hongbo Li, James C. Spall

Hongbo Li is with the Department of Statistics and, Probability, Michigan State University, East Lansing, MI 48824, Applied Physics Laboratory and the Department of Applied, Mathematics and Statistics, Johns Hopkins University, Baltimore

2026-08-11强化学习

本文针对黑盒采样中无法获得梯度且函数评估含噪的场景,将两点 SPSA 梯度估计嵌入 Langevin Monte Carlo,以每步仅两次 noisy oracle 调用替代维度相关的有限差分。主要结果是在 Wasserstein 距离下给出非渐近收敛与递减步长收敛保证,将主导维度依赖从 O(p^4) 改进到 O(p^2),并给出 O(p/ε^2+δ^2p^3/ε^3) 的 oracle 复杂度;实验显示同预算下优于 ZO-LMC。

The Rank-Collapse Principle for Quadratic Optimization Figure 1
2026-08-11math.OC

The Rank-Collapse Principle for Quadratic Optimization

Mojtaba Soltanalian, Ahmad Mousavi

2026-08-11优化算法

本文针对低秩二次优化中“看似困难却可精确求解”的现象,提出 rank-collapse 原理:正半定低秩目标只依赖投影影子,且最优影子能由自身线性暴露并带有定量间隔。论文进一步区分这一普适几何事实与可枚举候选结构,给出散射数、投影法扇枚举、二进制/有限相位/拟阵/稀疏 PCA 后果,以及近似低秩与稳定性证书。

Universal Birkhoff Method for Computing Extremals in the Elliptic Restricted Three-Body Problem Figure 1
2026-08-11math.OC

Universal Birkhoff Method for Computing Extremals in the Elliptic Restricted Three-Body Problem

Michael J. Dixon, Isaac M. Ross

Naval Postgraduate School, Monterey, CA 93943, Commander, USN, Department of Mechanical and Aerospace Engineering

2026-08-11优化控制

针对椭圆限制三体问题中有限推力转移难以依赖动力系统初值、且最优出发/到达点不易验证的问题,论文将 Pontryagin 必要条件与通用 Birkhoff 谱算法结合,并引入与比冲无关的推进剂代理泛函。结果显示该方法可在无初始猜测辅助下生成候选极值轨,并通过 Hamiltonian 最小化和横截条件验证,得到 bang-bang 或 bang-off-bang 解。

From a Scalar Parabolic Oscillator to Topological Thermostats: Selective Feeback Control of Harmonic Flow Modes Figure 1
2026-08-11math.AP

From a Scalar Parabolic Oscillator to Topological Thermostats: Selective Feeback Control of Harmonic Flow Modes

Sandro Merino

2026-08-11生成模型规划控制

本文从标量抛物型恒温反馈出发,研究图或网络中的流状态如何被选择性控制。核心洞察是用 Hodge 分解把边流拆为割空间与谐循环空间,并以“拓扑恒温器”调节无环传输目标、阻尼环流。结果表明,一阶 Betti 数给出完整谐空间压缩所需的最小传感与执行通道数,但局部有限通道通常会产生割–谐耦合;在线路驱动摆方程中,理想控制可使谐流指数衰减且不改变被动割谱,有限实现还需额外稳定条件。

The cosine measure of a function at a point Figure 1
2026-08-11math.OC

The cosine measure of a function at a point

Warren Hare, Gabriel Jarry-Bolduc, Chayne Planiden

2026-08-11优化控制

本文针对直接搜索等无导数优化中“方向集何时必含下降方向”的判据失效问题,研究梯度为零或不可微时的情形。核心创新是定义函数在一点的余弦测度,用它刻画方向集余弦测度需达到的下界;文中证明该值可覆盖[-1,1],并给出无限方向集、非凸锥及有限最大函数的计算方法,包括ℓ1范数的闭式结果。

2026-08-10

26 篇
Wasserstein Policy Gradient for Entropy-Regularized Linear-Quadratic Control Figure 1
2026-08-10math.OC

Wasserstein Policy Gradient for Entropy-Regularized Linear-Quadratic Control

Zhaoyu Zhu, Rui Gao, Shuang Li

University of Illinois Urbana-Champaign, The University of Texas at Austin, The Chinese University of Hong Kong, Shenzhen

2026-08-10强化学习规划控制优化算法

本文针对一般 Wasserstein 策略梯度理论难以处理无界二次代价、且低熵温度下收敛界退化的问题,研究熵正则折扣 LQ 控制。核心洞察是最优策略在非受限类中仍为线性高斯,且 WPG 向量场正好切于该类,从而可精确化为反馈增益和协方差的有限维 ODE。论文证明该 ODE 全局适定,并从任意可行初始化指数收敛;收敛指数在温度趋零时保持正极限,避免了一般界中的 exp(-c/τ) 扰动因子。

A Domain-Specific Harness for End-to-End Automation of Optimization Research Figure 1
2026-08-10math.OC

A Domain-Specific Harness for End-to-End Automation of Optimization Research

Heechang Kim, Ernest K. Ryu, Shuvomoy Das Gupta

Seoul National University, Rice University

2026-08-10优化算法

论文针对优化算法研究中从数值搜索到解析证明高度依赖人工的问题,提出 AutoOPT,将 BnB-PEP 数值设计、LLM 解析发现、Lean 4 形式化验证和人工写作串成领域专用流程。主要结果是发现 lemniscate acceleration,达到梯度范数平方 O(1/N^4) 最优阶并改进常数,同时给出 ITEM-f 的解析形式和加速线性收敛证明,二者均经 Lean 机器检验。

Uncovering expert objectives in production planning via inverse optimization: An industrial case study Figure 1
2026-08-10math.OC

Uncovering expert objectives in production planning via inverse optimization: An industrial case study

Shivi Dixit, Rishabh Gupta, Adam Kelloway, John Wassick, Qi Zhang

Department of Chemical Engineering and Materials Science, University of Minnesota, Minneapolis, MN 55455, USA, Department of Chemical Engineering, Carnegie Mellon University, Pittsburgh, PA 15213, USA

2026-08-10规划控制优化算法

制造业生产计划常因真实目标函数难以量化,导致优化模型与资深计划员决策不一致。本文将固定生产顺序下的计划问题建成混合整数线性模型,并用基于次优性损失的逆优化从历史计划中学习隐含目标权重。Dow 工业案例显示,计划员最重视避免库存短缺和保持周期长度稳定,按时间和产品变化的权重还能提升预测并揭示优先级变化。

Solving Monotone Linear-Quadratic Generalized Nash Equilibrium Problems via Quadratic Programming Figure 1
2026-08-10math.OC

Solving Monotone Linear-Quadratic Generalized Nash Equilibrium Problems via Quadratic Programming

Alberto Bemporad, Tatiana Tatarenko

2026-08-10优化控制

面向博弈式MPC等需要频繁求解线性二次广义纳什均衡的控制场景,本文针对仅满足单调性而非强单调性的难点,将共享仿射约束下的v-GNE精确转化为一个由联合KKT条件导出的凸二次规划。由此可直接调用QP求解器,并给出正则化误差线性衰减、两类加速算法达到O(1/k^2)近似以及可逆情形的低维对偶QP;随机问题和MPC实验显示相较外梯度等方法有明显计算优势。

Sampling and Optimization meet Enhanced Flows Figure 1
2026-08-10math.OC

Sampling and Optimization meet Enhanced Flows

Yuan Gao, Siming He, Eitan Tadmor

Department of Mathematics, Purdue University, West Lafayette, IN, USA, Department of Mathematics, University of South Carolina, Columbia, SC, USA, Department of Mathematics and IPST, University of Maryland, College Park, MD, USA

2026-08-10生成模型优化算法

本文针对传统 Langevin 采样在多峰势能中收敛慢、归一化常数难算的问题,引入带外部漂移的增强流框架。核心洞察是用混合诱导的增强耗散加速趋近 Gibbs 测度,并通过一阶交替剪切流、二阶动力学及质量搜索机制避免直接求配分函数。文中给出收敛估计、简化数值算法和粒子系统形式,主要结果是为采样与优化构造更快的动力学采样器。

On the Optimal Laplacian Jordan Structure for Synchronizability Figure 1
2026-08-10math.OC

On the Optimal Laplacian Jordan Structure for Synchronizability

Luca Dieci, Cinzia Elia, Alessandro Pugliese

Institute of Technology and the University of Bari Aldo Moro., Corresponding author: Luca Dieci. L. Dieci is with the School of Math-, ematics, Georgia Institute of Technology, Atlanta, GA 30332, USA (e-mail:, of Mathematics, University of Bari Aldo Moro, 70125 Bari, Italy (e-mail:

2026-08-10优化控制

本文针对图结构已给定、只能调节边权的耦合动力网络,研究如何选择拉普拉斯矩阵以提升同步性。核心洞察是把主稳定函数约束、特征值归一化离散度和 Jordan 块导致的瞬态放大统一到拉普拉斯 Jordan 结构设计中。文中给出三对角情形的充要条件,并扩展到带状拉普拉斯,数值实验显示该结构可缩短瞬态并优于若干已有构造。

Metric Non-Collapse in Learned World Models for Control: Approximation Theory, Finite-Sample Geometric Guarantees, and Deterministic Planning Transfer Figure 1
2026-08-10math.OC

Metric Non-Collapse in Learned World Models for Control: Approximation Theory, Finite-Sample Geometric Guarantees, and Deterministic Planning Transfer

Alain Bensoussan, Minh-Nhat Phung, Minh-Binh Tran

Naveen Jindal School of Management, University of Texas at Dallas, Richardson, TX, 75080 USA, Department of Mathematics, Texas A&M University, College Station, TX, 77843 USA

2026-08-10强化学习规划控制学习理论

本文针对学习世界模型中“一步预测好但表示坍塌、规划失效”的问题,提出编码器局部-全局度量 hinge,用状态距离和切向监督约束潜空间不折叠。理论上证明近似经验最优可推出点态 co-Lipschitz、受控半共轭误差界,并进一步给出确定性有限时域规划的优化器迁移界;摆杆实验说明小预测残差仍可能掩盖表示坍塌。

Inverse reinforcement learning for indefinite mean-field social optimization with multiplicative noise Figure 1
2026-08-10math.OC

Inverse reinforcement learning for indefinite mean-field social optimization with multiplicative noise

Ying Cao, Xun Li, Bing-Chang Wang

School of Control Science and Engineering, Shandong University, Jinan 250061, China, Department of Applied Mathematics, The Hong Kong Polytechnic University, Hong Kong, China

2026-08-10强化学习优化算法

面向大规模随机协作系统中难以手工设定社会成本、且动力学可能未知的问题,本文研究带乘性噪声和不定权重的线性二次平均场社会优化逆强化学习。核心做法是用两阶段迭代分别处理个体与平均场动力学,并通过Riccati/Lyapunov方程差分和LMI条件处理不定性;进一步给出基于积分RL和最小二乘的模型无关版本。文中证明了收敛性、闭环稳定性,并指出恢复的成本权重并不唯一,仿真验证了算法可复现专家策略。

Establishing Boundary KKT Convergence of Mirror Descent through Reparameterization Figure 1
2026-08-10math.OC

Establishing Boundary KKT Convergence of Mirror Descent through Reparameterization

Kuangyu Ding, Kim-Chuan Toh

School of Industrial Engineering, Purdue University, Department of Mathematics and Institute of Operations, Research and Analytics, National University of Singapore, Singapore

2026-08-10学习理论

本文针对非凸镜像下降在 Legendre 核边界处梯度发散、迭代可能收敛到非 KKT 边界点的问题,提出在重参数化变量中分析,使 Hessian 度量在逼近边界时被拉平且不退化。其核心结果是在目标、核函数与可行几何满足扩展性和可定义性条件下,证明重参数化序列有限长度并收敛,从而恢复原迭代到边界 KKT 点的收敛性;适用于 Shannon、Fermi-Dirac 熵及多面体上的幂核。

Learning Suffers More Than the Policy Class Under Partial Observability: A Closed-Form Analysis Figure 1
2026-08-10cs.LG

Learning Suffers More Than the Policy Class Under Partial Observability: A Closed-Form Analysis

Idil Gözel (University College London)

Department of Physics and Astronomy, University College London, London, UK

2026-08-10强化学习

论文针对部分可观测强化学习中“策略表达不够”与“学习规则有偏”两类失败原因难以区分的问题,构造可闭式求解的线性二次 actor-critic 案例。核心洞察是,即使策略类和二次 critic 足以表示好解,critic 仍会把不可观测状态造成的波动误读为价值曲率,驱动 actor 偏离最优。结果显示最佳无记忆策略仅比全观测控制差 10.4%,但学习停在比该策略差 35% 的增益;调节 bootstrap 前瞻长度可移回最优,深度强化学习实验基本吻合。

Free-Horizon Newton Method for Nonlinear Optimal Control Figure 1
2026-08-10math.OC

Free-Horizon Newton Method for Nonlinear Optimal Control

Gyeongrok Ha, Kenji Fujimoto, Ichiro Maruta

are with Department of Aeronautics and Astronautics, Graduate, School of Engineering, Kyoto University, Kyoto, 615-8540, Japan

2026-08-10规划控制

面向航天轨迹设计中燃料消耗与飞行时间需同时权衡的问题,论文将传统固定时域的l1最优Newton方法扩展为自由时域形式,把控制序列和控制时长共同作为变量,并在每次迭代中保持l1稀疏校正结构、用KKT残差检验局部最优。数值实验中,该方法在Hohmann转移上恢复解析最优解,并在地月转移中自动确定控制时域,较SQP和内点法迭代更少、运行更快。

Certified High-Dimensional Wasserstein Robust Portfolio Optimization Figure 1
2026-08-10math.OC

Certified High-Dimensional Wasserstein Robust Portfolio Optimization

Chung-Han Hsieh, Rong Gan

Department of Quantitative Finance, National Tsing Hua University

2026-08-10优化算法安全鲁棒

本文针对高维投资组合中样本有限导致的分布估计误差,研究 Wasserstein 分布鲁棒期望效用优化的可计算化问题。核心做法是用支持超平面上界效用并对支撑子问题对偶化,将半无限问题转成带误差证书的有限规划;在一范数和多面体约束下可化为多项式规模线性规划。实验显示其能处理 476 资产月度再平衡并扩展到 1000 资产,速度较精确基准提升约 16–36 倍,价值误差低于设定容差。

Linguistic Pattern Based Optimization of Economic and Spatial Uniformity Criteria in Facility Layout Problems Figure 1
2026-08-10cs.CE

Linguistic Pattern Based Optimization of Economic and Spatial Uniformity Criteria in Facility Layout Problems

Jerzy Grobelny, Rafał Michalski

Wrocław University of Science and Technology, Centre grant no. 2019/35/B/HS4/02892: Intelligent approaches for facility layout problems in

2026-08-10优化算法

针对传统设施布局优化偏重流距成本、难以兼顾早期设计中的空间可读性问题,论文在 LP-Alinks 语言模式框架中加入归一化覆盖得分 NCS,将空间均匀性作为显式目标。324 组全因子仿真显示,对象数量和连接密度主导成本表现,而均匀性更受语言模式参数影响;相较 Drezner、MDS 和非度量 MDS,该方法通常获得更高空间均匀性,并保持有竞争力的经济成本。

Stability of Differential Stochastic Variational Inequalities with History-Dependent Responses and Transfer Learning Figure 1
2026-08-10math.OC

Stability of Differential Stochastic Variational Inequalities with History-Dependent Responses and Transfer Learning

Xiaojun Chen, Jian Guo, Xin Guo, Guan Wang

Xiaojun Chen 1 1 1 Department of Applied Mathematics, The Hong Kong Polytechnic University, Kowloon, Hong Kong, Xin Guo 2 2 2 Department of Industrial Engineering and Operations Research, University of California, Berkeley, CA, USA

2026-08-10优化控制

本文面向健康监测等闭环随机系统中状态受历史传感数据和随机均衡共同影响的问题,提出将 ODE 与历史依赖 SVI 耦合的 DSVI 框架,并分析迁移到相关随机环境时的稳定性。主要结果包括二阶段响应与状态轨迹的适定性、SAA 轨迹一致收敛、基于 Wasserstein 距离的迁移稳定界;老人健康监测实验显示复用预计算响应可将在线批处理从 86 秒降至不足 1 秒且精度接近重算基准。

Stochastic Gradient Descent with Momentum: Analysis and Synthesis via Integral Quadratic Constraints Figure 1
2026-08-10math.OC

Stochastic Gradient Descent with Momentum: Analysis and Synthesis via Integral Quadratic Constraints

Dennis Gramlich, Carsten W. Scherer, Christian Ebenbauer

Chair of Intelligent Control Systems, RWTH Aachen University, 52074 Aachen, Germany, Chair of Mathematical Systems Theory, University of Stuttgart, 70569 Stuttgart, Germany, He acknowledges the support by the Stuttgart Center for Simulation Science (SimTech).

2026-08-10优化算法

本文针对小批量随机梯度中噪声会削弱甚至破坏动量加速的问题,把随机梯度 oracle 建模为鲁棒控制中的反馈非线性,并用动态 IQC 分析其二阶统计结构。核心创新是将 Zames-Falb 乘子推广到小批量采样,给出可用半定规划验证收敛率、界定不可消噪声导致的渐近方差,并反向合成算法。实验显示,合成方法在批量增大时逼近确定性 Triple Momentum 速率,在大条件数下接近 b 次顺序 SGD 的效率,且噪声方差界优于常见动量法。

Preference-Based Estimation of Achievement Scalarising Function Parameters via Ordinal Regression Figure 1
2026-08-10math.OC

Preference-Based Estimation of Achievement Scalarising Function Parameters via Ordinal Regression

Maria Barbati, Salvatore Greco

Department of Economics, Ca’ Foscari University of Venice, Venice, Italy, Department of Economics and Business, University of Catania, Catania, Italy

2026-08-10优化控制

本文针对多目标优化中成就标量化函数的权重与参考点难以由决策者直接给定的问题,提出用序数回归从整体偏好判断中同时反推出目标权重和 aspiration/reference point。核心洞察是把偏好学习得到的参数化 ASF 直接嵌入优化流程,从而降低 elicitation 负担并引导搜索到符合偏好的 Pareto 区域;多目标背包示例展示了偏好约束如何转化为标量优化模型,但效果仍主要是教学验证。

Connecting Extreme-Point Generation and Decision Rules in Two-Stage Distributionally Robust Optimization Figure 1
2026-08-10math.OC

Connecting Extreme-Point Generation and Decision Rules in Two-Stage Distributionally Robust Optimization

Jin Qi, Chen Yang

2026-08-10优化算法安全鲁棒

本文针对两阶段分布鲁棒优化中“决策规则给出显式策略但可能不精确、分解生成法能求一阶段最优但缺少完整补救策略”的断裂,指出二阶段对偶极点可同时生成仿射价值片段和策略片段。作者提出极点生成算法:先只生成影响一阶段目标的片段,再补全不确定集上的补救价值,并据此检验常用决策规则的事后精确性;实验显示算法有效,且完整恢复二阶段价值通常需要比求一阶段最优更多的极点。

Stochastic Homogenization of Non-local Hamilton-Jacobi-Bellman equations Figure 1
2026-08-10math.AP

Stochastic Homogenization of Non-local Hamilton-Jacobi-Bellman equations

Wenjia Jing, Qi Zhang

Yau Mathematical Sciences Center, Tsinghua University, Beijing 100084 and Beijing Institute of Mathematical Sciences and Applications, Beijing 101408, P.R. China, Beijing Institute of Mathematical Sciences and Applications, Beijing 101408, P.R. China

2026-08-10优化控制

本文关注随机介质中含快速振荡 Hamiltonian 的非局部 HJB 方程均匀化,动机来自带跳跃扩散的随机最优控制。核心做法是把 Kosygina-Rezakhanlou-Varadhan 的扩散型方法推广到 Lévy 跳过程,并将非局部算子写成作用于梯度的正则积分算子散度形式以构造近似超校正子。主要结果是在凸、超线性增长 Hamiltonian 下证明解收敛到确定性有效 HJB 方程。

Online Multi-Level Aggregation with Per-Batch Maximum Delay Figure 1
2026-08-10cs.DS

Online Multi-Level Aggregation with Per-Batch Maximum Delay

Tianhang Lu, Runtian Ren, Shengcai Liu

2026-08-10优化控制

本文关注在线多层聚合中按批次最大等待时间计费的问题,动机是传统逐请求累加延迟难以刻画尾延迟和 SLA 惩罚。核心洞察是离线最优可化为连续到达块,并由动态规划给出 DP-Envelope 截止时间规则。主要结果是在根树上线性时间可多项式求离线解,在线确定性达到最优 2 竞争比,随机化达到最优 e/(e-1),并推广到单调次模服务成本系统。

The Blessing and Curse of Curvature in Higher-Order Optimization: Horospherical versus Geodesic Convexity Figure 1
2026-08-10math.OC

The Blessing and Curse of Curvature in Higher-Order Optimization: Horospherical versus Geodesic Convexity

Andi Han

2026-08-10优化算法

本文关注非正曲率流形上高阶强凸优化的复杂度,动机是解释曲率为何有时帮助、 有时阻碍加速。核心洞察是区分 horospherical 凸与 geodesic 凸:前者提供全局 horoball 信息,使双曲空间中可定位到曲率尺度并改善有效条件数;后者在曲率半径增大时存在信息论下界。主要结果给出 h-凸的欧氏最优速率及曲率增益,并证明 g-凸在增长负曲率下需约 Q_p^{1/p} 次查询。

Stationarity Floors and Vanishing Perturbations in Sharpness-Aware Minimization Figure 1
2026-08-10math.OC

Stationarity Floors and Vanishing Perturbations in Sharpness-Aware Minimization

Samir Adly, Ba Khiet Le

Laboratoire XLIM, Université de Limoges, Ton Duc Thang University, Ho Chi Minh City, Vietnam.

2026-08-10优化控制

本文关注 SAM 中扰动尺度如何影响非凸优化的驻点收敛,动机是固定半径归一化扰动可能阻止梯度趋零。核心洞察是对一族 SAMα 规则刻画不可消除的驻点下界,并用一维二次例子证明该下界可达;同时提出裁剪扰动,使靠近驻点时扰动随梯度缩小,从而恢复梯度收敛到零及 O(T^{-1/2}) 驻点复杂度。

Theoretical Foundations of Communication-Efficient, Robust, and Practical Distributed and Federated Optimization Figure 1
2026-08-10cs.LG

Theoretical Foundations of Communication-Efficient, Robust, and Practical Distributed and Federated Optimization

Grigory Malinovsky

King Abdullah University of Science and Technology, addresses the scalability and efficiency of these methods under partial participa-

2026-08-10优化算法安全鲁棒

面向联邦学习和分布式训练中的通信瓶颈、异构参与与拜占庭鲁棒性问题,论文系统化给出 ProxSkip、方差缩减、部分参与、随机重排下压缩梯度差分及梯度差分裁剪等算法框架,并扩展到低秩适配理论。主要结果是证明本地步可带来可证通信加速,在随机与异构设置下减少误差或改善收敛,且数值实验支持理论界限的尖锐性。

Wasserstein Mahalanobis Distances for Recovering Latent Geometry Figure 1
2026-08-10math.OC

Wasserstein Mahalanobis Distances for Recovering Latent Geometry

Chuxiangbo Wang, Shiying Li, Caroline Moosmüller

2026-08-10优化控制

论文针对现代数据常以概率分布或点云而非向量出现的问题,试图把局部 Mahalanobis 距离的潜在几何恢复机制推广到 Wasserstein 空间。核心做法是用最优传输位移场替代欧氏位移、用 Wasserstein 切空间上的协方差算子替代协方差矩阵,定义 Wasserstein Mahalanobis 距离。主要结果表明,对共享协方差的高斯族经光滑推前变换后,该距离可近似恢复变换后潜在均值的经典 Mahalanobis 几何,仿射情形精确成立,数值实验验证了几何恢复趋势。

Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions Figure 1
2026-08-10cs.LG

Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions

Yuepeng Yang, Yuxin Chen, Yuejie Chi

Department of Statistics and Data Science, Yale University.Department of Statistics and Data Science, the Wharton School, University of Pennsylvania.

2026-08-10强化学习安全鲁棒

针对平均奖励强化学习在转移模型不确定时缺少精确样本复杂度刻画的问题,本文研究总变差鲁棒 AMDP 的生成模型学习。核心洞察是用 σH0 区分高、低容忍度,并在名义与鲁棒折扣化 plug-in 归约间自适应选择。主要结果给出匹配上下界:高容忍度为 SA·min{H0,Hσ}/ε²,低容忍度额外出现 σHσ² 项。

Enforcing Opacity in Discrete Event Systems via Delayed Observations Figure 1
2026-08-10math.OC

Enforcing Opacity in Discrete Event Systems via Delayed Observations

Jiwei Wang, Simone Baldi, Wenwu Yu, Xiang Yin

2026-08-10优化控制

本文面向离散事件系统中秘密状态可能被外部观察者推断的问题,提出通过人为引入有限观测延迟来增强不透明性。核心创新是定义 K-延迟不透明性,并构造延迟观察器用于验证;进一步设计容器结构汇集满足该性质的可行传感器激活策略,并可按给定准则优化选择。主要结果是给出从性质判定到策略合成的统一方法,文中以示例说明流程,但未报告系统性实验。

Revenue Adequate Prices for Chance-Constrained Electricity Markets with Variable Renewable Energy Sources Figure 1
2026-08-10econ.TH

Revenue Adequate Prices for Chance-Constrained Electricity Markets with Variable Renewable Energy Sources

Xin Shi, Alberto J. Lamadrid L., Luis F. Zuluaga

Department of Economics, Lehigh University, Bethlehem, PA, USA, Department of Industrial and Systems Engineering, Lehigh University, Bethlehem

2026-08-10优化控制

可再生能源出力不确定使电力市场清算价格难以同时保证调度可行、ISO不亏损与机组成本回收。本文把两阶段市场清算写成机会约束优化,并从其确定性等价模型的最优对偶变量构造价格,证明可在期望意义下实现市场收入充足和常规/VRES机组成本回收;与随机优化定价相比,其实时价格不随具体可再生出力场景变化,算例用于对比两类方案的价格与收益分布差异。

2026-08-07

33 篇
The Benefits of an Integrated Approach for Stability-Constrained Power System Planning Figure 1
2026-08-07math.OC

The Benefits of an Integrated Approach for Stability-Constrained Power System Planning

Gereon Recht, Benedikt Jahn, Oussama Alaya, Karl-Kiên Cao, Hendrik Lens

German Aerospace Center (DLR), Institute of Networked Energy Systems, Curiestr. 4, 70563 Stuttgart, Germany, Institute for Energy Process Engineering and Dynamics in Energy Systems (IED), University of Stuttgart, Germany

2026-08-07规划控制

高比例逆变器资源削弱同步机提供的惯量与电压稳定支撑,使先扩建、后补稳定措施的规划流程可能低效。论文将惯量/RoCoF与动态电压稳定约束直接嵌入容量扩展线性规划,同时优化发电、输电、储能和稳定设备;结果显示,相比顺序规划,集成方法降低系统成本,并更偏好具备双重用途的构网型电池储能,而非大量部署STATCOM。

Fault Diagnosis and Prognosis in Partially-Observed Discrete Event Systems with Delayed Observations Figure 1
2026-08-07math.OC

Fault Diagnosis and Prognosis in Partially-Observed Discrete Event Systems with Delayed Observations

Jiwei Wang, Simone Baldi, Wenwu Yu, Xiang Yin

2026-08-07优化控制

面向离散事件系统中观测可能延迟到达的故障诊断与预测问题,论文指出传统可预测性定义直接外推会带来保守性,因此重述无延迟情形下等价的预测概念,并提出带延迟约束的K^T可诊断性与T约束可预测性。主要结果是构造延迟观测器和验证函数,用于判定上述条件;结论表明方法在理论上可处理延迟观测,但实验性验证较少。

The Tamed Subgradient Unadjusted Langevin Algorithm beyond Convexity Figure 1
2026-08-07cs.LG

The Tamed Subgradient Unadjusted Langevin Algorithm beyond Convexity

Iosif Lytras, Nikolaos Makras, Sotirios Sabanis

School of Mathematics, University of Edinburgh, UK, National Technical University of Athens, Greece, Athena/Archimedes Research Centre, Greece

2026-08-07优化算法

本文针对深度模型中常见的非光滑、梯度超线性增长与非凸性同时存在而缺少非渐近保证的问题,提出直接作用于次梯度的驯服 Langevin 算法 SG-TULA,以步长相关缩放替代固定阈值裁剪。文中给出 Wasserstein-2 采样误差 O(λ^{1/4})、迭代复杂度 O(ε^{-4}log(1/ε)) 及超额风险界,并在 GPT-2 系列预训练势能上验证假设,实验显示其坐标增强版可与 AdamW、Muon 竞争。

Localized Stabilization of Transport PDEs by Interior Flux Feedback Figure 1
2026-08-07math.OC

Localized Stabilization of Transport PDEs by Interior Flux Feedback

Constantinos Kitsos, Ian Manchester

2026-08-07优化控制

本文针对机器人物流、多智能体密度重分配等场景中的连续性方程,研究仅在局部区域施加内部通量反馈时如何稳定到目标密度。核心洞察是把反馈设计成误差方程中的局部阻尼,并用有限时间特征线阻尼条件刻画“所有相关轨迹最终经过受控区”的几何要求。主要结果是在增益足以抵消速度场压缩放大的条件下证明 L2 指数稳定,给出可检验的 Lyapunov 进入条件、ISS 扰动估计、椭圆右逆实现方式,并扩展到状态相关速度场。

Muon on the Stiefel Manifold Admits an Exact Closed-Form Update Figure 1
2026-08-07math.OC

Muon on the Stiefel Manifold Admits an Exact Closed-Form Update

Mikhail Solonko, Molozhavenko Alexander, Maxim Rakhuba

2026-08-07优化控制

针对将 Muon 优化器用于 Stiefel 流形正交约束时需反复近似求解切空间谱范数 LMO、单步开销较高的问题,论文指出该更新可等价转化为斜对称矩阵上的问题,并给出精确闭式解,由此构造 Skewon 算法。主要结果是消除迭代近似或松弛更新,并在光滑非凸情形下证明一阶收敛保证。

Column Number of Delta-modular matrices: Refined Analysis via Sauer Matrices Figure 1
2026-08-07math.CO

Column Number of Delta-modular matrices: Refined Analysis via Sauer Matrices

Elizaveta Pribiytkova, Dmitry Gribanov

2026-08-07优化控制

本文研究有界行列式整数矩阵中不同列数的极值问题,该问题关系到整数规划中 LP 松弛与最优整数解的距离界。核心做法是沿用 shifted Heller 常数框架,并引入比经典 Sauer-Shelah-Perles 引理更强的 Pajor Sandwich 定理,细化 Sauer 矩阵相关结构分析。主要结果是将 shifted Heller 常数界改进为 O(m^3),从而把 Δ-modular 矩阵列数上界由 O(m^4Δ) 降至 O(m^3Δ)。

Characteristic Sensitivity Ensembles for Inference of Hidden Dynamics from Marginal Observations Figure 1
2026-08-07math.OC

Characteristic Sensitivity Ensembles for Inference of Hidden Dynamics from Marginal Observations

Qi Wang, Gustaaf Jacobs

2026-08-07优化控制

针对只能观测边缘分布、隐变量动力学不可见而导致的反问题病态性,论文把扩散或不可逆现象提升为增广相空间中的确定性可逆 ODE,并用 Liouville 方程特征线传播粒子与参数敏感度,配合交叉 U 统计构造无偏随机梯度,避免全维密度 PDE 求解。四个线性、Gompertz、双稳态和粒子流实验显示可从边缘观测恢复隐藏参数;但方差随时间指数增长,适用时域仍受限。

On Same-Sample and Independent-Sample Stochastic Extragradient for Monotone Variational Inequalities Figure 1
2026-08-07math.OC

On Same-Sample and Independent-Sample Stochastic Extragradient for Monotone Variational Inequalities

TaeHo Yoon, Nicolas Loizou

2026-08-07优化算法

本文针对单调变分不等式中随机外梯度法理论不完整的问题,比较独立采样 I-SEG 与同样本 S-SEG 的差异。核心洞察是 S-SEG 对逐样本 Lipschitz 常数更敏感,均值 Lipschitz 与有界方差即使在紧集上也不足以保证收敛。文中进一步在可无界域上给出两类 SEG 的高概率 restricted-gap 收敛结果,并证明若干改进一般不可能;还构造例子说明 I-SEG 可用的非对称双步长几乎必然收敛保证会使 S-SEG 几乎必然发散。

New Lower Bounds for Weak Limited Augmented Zarankiewicz Numbers in the $m\times 3$ Case Figure 1
2026-08-07math.OC

New Lower Bounds for Weak Limited Augmented Zarankiewicz Numbers in the $m\times 3$ Case

Liqun Qi, Yannan Chen

Liqun Qi 1 1 1 Jiangsu Provincial Scientific Research Center of Applied Mathematics, Nanjing 211189, China., Department of Applied Mathematics, The Hong Kong Polytechnic University, Hung Hom, Kowloon, Hong Kong.

2026-08-07学习理论

本文针对弱限制增广 Zarankiewicz 数在 m×3 情形中的精确取值问题,动机是为双简单双二次型的 SOS 秩下界提供更紧的组合构造。核心做法是在弱可容许增广二部图框架下给出显式下界构造,并用规范 C4-free 基图的有限穷举搜索证明匹配上界。主要结果是确定 m=5 至 9 时 z_wL(m,3)=2m,并推出 BSR(m,3)≥2m,支持 m≥5 的一般猜想。

Distributed Fault Diagnosis in Discrete Event Systems with Transmission Delay Impairments Figure 1
2026-08-07math.OC

Distributed Fault Diagnosis in Discrete Event Systems with Transmission Delay Impairments

Jiwei Wang, Simone Baldi, Wenwu Yu, Xiang Yin

2026-08-07优化控制

面向多智能体离散事件系统中集中式监测不现实、通信又存在传输延迟的故障诊断问题,论文提出带传输效率参数的 K^T-codiagnosability,将集中式、分布式与去中心化诊断统一到同一框架,并设计 delay recorder 与诊断函数进行可验证判定。理论分析表明该方法能判断故障是否可在有限步内被协同诊断,但主要停留在形式化条件与验证层面。

Stabilizer Design for Policy Iteration in Stochastic Linear Quadratic Control: A Spectrum-Assignment Approach Figure 1
2026-08-07math.OC

Stabilizer Design for Policy Iteration in Stochastic Linear Quadratic Control: A Spectrum-Assignment Approach

Xinyu Cao, Bing-Chang Wang, Ying Cao

2026-08-07强化学习规划控制

本文针对随机线性二次控制中策略迭代依赖初始稳定器的问题,尤其是含状态与控制乘性噪声、且权重不定时传统 Hurwitz 判据失效的情形。核心做法是利用 Lyapunov 型算子谱与均方稳定性的关系,通过谱分配和累积因子从辅助稳定系统逐步逼近原系统,并进一步把无模型策略评估转化为数据驱动线性回归。主要结果是证明不定 SLQ 下 PI 保持均方稳定并单调收敛,给出模型已知与无模型两阶段算法,仿真验证了可获得稳定初始增益和最优控制。

Exact Anchoring and a Dualization-Based Matheuristic for Bi-Level Dual-Defense Network Interdiction Figure 1
2026-08-07math.OC

Exact Anchoring and a Dualization-Based Matheuristic for Bi-Level Dual-Defense Network Interdiction

Wei-Chang Yeh

Department of Industrial Engineering and Engineering Management, National Tsing Hua, University, Hsinchu 300, Taiwan, R.O.C., solution quality cannot be assessed, because exact optima are unavailable at the scales, available whenever arc lengths are linear in the defender's binary decisions

2026-08-07优化控制

本文针对BDAM网络拦截模型以往依赖元启发式、缺少最优性参照且供给路径在最短路并列时定义不稳的问题,提出下层对偶化得到的MILP精确锚点,并用威胁走廊替代单一路径、加入可行性修复。结果显示18个中小规模配置均可认证最优,多数在10秒内;MILP-DA在13个认证配置和全部18个更大配置上优于既有发表结果。

From Value Bounds to Policy-Distance and Active-Face Certificates: Same-Grid Duality for Constrained Dynamic Portfolios Figure 1
2026-08-07q-fin.MF

From Value Bounds to Policy-Distance and Active-Face Certificates: Same-Grid Duality for Constrained Dynamic Portfolios

Jeonggyu Huh

Department of Mathematics, Sungkyunkwan University, Suwon, Republic of Korea

2026-08-07强化学习学习理论

这篇论文针对约束动态投资组合中“策略值接近最优但策略本身和活跃约束不可解释”的验证问题,提出在同一仿真网格上把原始-对偶残差转化为策略距离区域和绑定面证书的方法。核心是Fenchel-互补松弛残差分解与Doob补偿,降低小残差估计方差,并结合曲率条件给出O(√G)策略半径。实验在一、二资产审计和最高50资产压力测试中覆盖外部策略误差且无误报活跃面,但高维状态依赖场景仍受对偶学习紧度限制。

Robust priority-aware coverage optimization for aerial sensor networks Figure 1
2026-08-07math.OC

Robust priority-aware coverage optimization for aerial sensor networks

Vanshika Datta, C. Nahak, J. C. Yao

Department of Mathematics, Indian Institute of Technology Kharagpur, Kharagpur, West Bengal, India, Research Center for Interneural Computing, China Medical University Hospital, China Medical University, Taichung 40402, Taiwan

2026-08-07优化算法安全鲁棒

这篇论文针对机场等空中传感监控场景中“重点区域更重要且传感器位置有误差”的问题,将区域优先级权重与鲁棒可行半径引入覆盖优化,并提出 PAROO 来选择方向传感器朝向。实验显示,在机场式仿真场景中,该方法能把覆盖资源更多投向跑道、航站楼等高优先级区域,获得高于对比方法的加权覆盖;但增益主要来自优先级建模还是鲁棒项,文中未充分说明。

Quadratic Degree Sequence Optimization and the Critical Roots of a Graph Figure 1
2026-08-07math.OC

Quadratic Degree Sequence Optimization and the Critical Roots of a Graph

Frédéric Meunier, Shmuel Onn

2026-08-07优化算法

本文从度序列优化在子图选择中的复杂性出发,聚焦二次目标函数情形,将问题化为带根参数 a 的 QDSO,并引入图的“临界根”来刻画最优子图随参数变化的结构。核心结果是证明最优值关于 a 呈凸分段仿射,临界根将实线划分为若干区间且每段对应固定最优子图,同时给出计算临界根的算法,并补充三次情形 NP-hard、凹函数可多项式求解及树上更简单算法等复杂性边界。

Optimization-Based Identification of Effective Coefficients for Wave Equations in Spatio-Temporal Metamaterials Figure 1
2026-08-07math.AP

Optimization-Based Identification of Effective Coefficients for Wave Equations in Spatio-Temporal Metamaterials

Christian Döding, Vishnu Raveendran, Barbara Verfürth

2026-08-07优化算法

针对时空超材料中微观系数未知、只能观测波传播解时难以获得宏观有效参数的问题,本文把椭圆多尺度问题中的优化识别思想推广到含时空异质系数的波方程,通过最小化经逆波算子正则化的残差来识别常数有效矩阵。主要结果是证明优化问题适定;若均匀化极限存在,识别系数收敛到均匀化系数,相应有效解在 L2 强收敛、导数弱收敛,并用数值实验展示其在非周期情形下仍可给出有意义系数。

A Damped Subspace Splitting Algorithm for Constrained Density Functional Theory Figure 1
2026-08-07math.OC

A Damped Subspace Splitting Algorithm for Constrained Density Functional Theory

Yuanming Su, Yukuan Hu, Xin Liu, Guanghui Hu

State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China and School of Mathematical Sciences, University, of Chinese Academy of Sciences, Beijing 100049, China, State Key Laboratory of Internet of Things for Smart City and Department of Mathematics, University of Macau, Macao, China, University of Macau (No. MYRG-CRG2024-00042-FST).

2026-08-07学习理论

本文针对受限密度泛函理论中 Stiefel 流形约束与非凸二次约束耦合导致可行性难保证、双层迭代收敛性弱的问题,利用旋转不变性引入子空间分裂与对齐约束,提出单循环阻尼 ADMM 算法 DASSP。理论上给出收敛保证,实验在合成与真实 CDFT 任务中显示其能更准确满足约束,并在保持鲁棒性的同时达到相当或更快效率。

Curvature Residual Geometry in Bregman Regression Figure 1
2026-08-07math.OC

Curvature Residual Geometry in Bregman Regression

Vu Khac Ky

Mathematics Department, FPT University

2026-08-07优化控制

本文关注 Bregman 回归中“生成势函数强凸但参数目标仍可能非凸”的优化落差。核心洞察是将 Hessian 写成带残差依赖权重的 Gram 矩阵,从而把局部强凸、光滑性与梯度下降线性收敛条件归结为权重界。对二次-四次势函数,文中给出精确标量凸性条件、负曲率区间及全局/局部充分条件;实验显示标量条件失效时整体 Hessian 仍可正定,且四次项增大时可收敛步长范围缩小。

Fast Gradient Algorithm with Dry-like Friction and Nonmonotone Line Search for Nonconvex Optimization Problems Figure 1
2026-08-07math.OC

Fast Gradient Algorithm with Dry-like Friction and Nonmonotone Line Search for Nonconvex Optimization Problems

Lien T. Nguyen, Andrew Eberhard, Xinghuo Yu, Chaojie Li

School of Science, RMIT University, Melbourne, VIC 3000, Australia, School of Engineering, RMIT University, Melbourne, VIC 3000, Australia, School of Electrical Engineering and Telecommunications, University of New South Wales, NSW 2033, Australia

2026-08-07优化算法

针对非凸优化中梯度下降收敛慢、惯性干摩擦方法参数受限且常只能到达近似临界点的问题,本文提出结合 dry-like friction、外推与非单调线搜索的快速梯度框架。其核心在于把干摩擦条件推广到非凸情形,并用自适应参数兼容多类已有 Hessian 阻尼算法;理论上给出子序列或全序列收敛,在 KL 条件下收敛到临界点,并扩展到弱凸非光滑问题。

An inverse mixed-integer optimization framework for learning interpretable models of expert decision making Figure 1
2026-08-07math.OC

An inverse mixed-integer optimization framework for learning interpretable models of expert decision making

Anurag Holani, Rishabh Gupta, John Wassick, Qi Zhang

Department of Chemical Engineering and Materials Science, University of Minnesota, Department of Chemical Engineering, Carnegie Mellon University, Pittsburgh, PA 15213, USA, explicitly stated. In practice, what is often available to analysts and modelers is not the internal, etary, meaning that internal objectives and operational rules are unavailable to external observers., when ample decision data are available.

2026-08-07优化算法

这篇论文针对专家决策中偏好和隐性规则难以直接获取的问题,提出逆混合整数优化框架,把命题逻辑规则转成可学习奖惩的MILP约束,并与成本参数一起从观测决策中反推。三个案例涵盖排班、生产规划和真实路径问题,结果显示同时建模感知成本与规则能降低预测误差,并给出较可解释的规则权重。

Convergence Rates for Variational Inequality Projection Neural Networks with a State-Dependent Metric Figure 1
2026-08-07math.OC

Convergence Rates for Variational Inequality Projection Neural Networks with a State-Dependent Metric

Mohammed Alshahrani

Department of Mathematics, King Fahd University of Petroleum & Minerals, Dhahran, 31261, Saudi Arabia

2026-08-07学习理论

本文动机是分析变分不等式投影神经网络在状态依赖矩阵度量下还能保留哪些适定性与收敛保证,而非证明其一定加速。核心创新是处理既非 Hessian 诱导、也非标量倍数的可变矩阵度量,并显式控制度量随状态变化带来的 Lyapunov 额外项。主要结果包括投影对参数和度量的联合正则性、更紧的 Lipschitz 常数、局部及有度量变化预算时的全局指数收敛率,同时给出周期轨道反例说明一般假设不足以保证全局收敛。

SDDmiP.jl: A Software Package with a Provably Convergent Benders Algorithm for Multi-Stage Stochastic Mixed-Integer Programming Figure 1
2026-08-07math.OC

SDDmiP.jl: A Software Package with a Provably Convergent Benders Algorithm for Multi-Stage Stochastic Mixed-Integer Programming

Akul Bansal, Simge Küçükyavuz

2026-08-07优化控制

面向多阶段随机混合整数规划中确定性等价模型难以扩展、传统 Benders/整数割对混合整数状态收敛性或强度不足的问题,论文介绍 Julia 包 SDDmiP.jl。其核心是结合 ReLU 割的可收敛 Benders 分解,并用归一化、正则化及交替割准则缓解对偶退化和高成本割调用。实验在四类问题上比较这些策略,显示性能依赖问题结构,交替使用便宜 Benders 割与紧割可降低计算负担。

A Recentered-Domain Yau-Yau Filter for Target Tracking Figure 1
2026-08-07math.OC

A Recentered-Domain Yau-Yau Filter for Target Tracking

Lei Ma, Yuzhong Hu, Xiaoming Zhang

2026-08-07视觉感知

针对 Yau–Yau 滤波在目标跟踪中需在大有限域上求解 FKE、难以兼顾精度与效率的问题,论文提出以最新状态估计为中心的局部重定域 RD-YYF,并用 PINN 生成快照、PCA 降维和残差代理实现离线-在线分离。两个几何约束跟踪实验中,其误差低于 EKF 和 PF,在线推理成本可控;消融显示收益主要来自高概率区域的重定域分辨率提升。

A Unified Framework for Iterate Convergence of Bregman Proximal Methods Figure 1
2026-08-07math.OC

A Unified Framework for Iterate Convergence of Bregman Proximal Methods

He Chen, Jiaming Fan, Anthony Man-Cho So

2026-08-07学习理论

本文针对 Bregman 近端方法在非凸目标和一般核函数下迭代点是否收敛这一长期缺口,提出以扩展 SKŁ 性质和核依赖参数化函数为核心的统一分析框架。作者证明连续次解析函数在相关条件下满足该性质,并验证 BPGM、BPPM 及连续时间 mirror flow 可收敛到驻点,从而把离散与连续 Bregman 动力学纳入同一轨迹收敛理论。

A Unified Framework for Sample Complexity of Structured Quantum State Tomography under Noisy Observations Figure 1
2026-08-07quant-ph

A Unified Framework for Sample Complexity of Structured Quantum State Tomography under Noisy Observations

Zhen Qin

2026-08-07优化控制

针对结构化量子态层析的样本复杂度理论分散且多忽略制备、测量噪声的问题,本文建立统一的非渐近分析框架,用覆盖数刻画稀疏、低秩及张量网络态等结构复杂度,并比较不同测量集合效率。主要结果是给出噪声感知最小二乘估计的迹范数恢复保证,同时证明忽略噪声会产生不随样本数消失的确定性偏差。

An Inertial Block Proximal Linearized Method with Adaptive Momentum for Nonconvex and Nonsmooth Optimization Figure 1
2026-08-07math.OC

An Inertial Block Proximal Linearized Method with Adaptive Momentum for Nonconvex and Nonsmooth Optimization

Weifeng Yang

2026-08-07优化算法

本文针对多块非凸非光滑优化中惯性 PALM 难以同时保持目标单调下降、动量参数受步长等约束且扩展到多块困难的问题,提出 IBPL+-TP:使用两个独立外推点和两阶段自适应动量,并给出目标函数单调收敛、全局收敛到临界点及速率证明;在 ℓ0 约束稀疏 NMF 与 CP 分解实验中,相比多种现有方法收敛更快、数值表现更稳。

A Passivity-Based Analysis of First-Order Momentum-Based Methods Figure 1
2026-08-07eess.SY

A Passivity-Based Analysis of First-Order Momentum-Based Methods

Sepehr Moalemi, James Richard Forbes

2026-08-07优化控制

本文针对动量一阶优化在下扇区界为0时缺少收敛判据的问题,把GD、重球和Nesterov等递推经环路变换表示为无源控制器与输出严格无源系统的反馈互联,并用弱无源定理给出显式步长与动量条件。结果证明平移梯度渐近消失;在唯一驻点且远离最优点不存在任意小梯度的附加假设下,迭代收敛到全局最小点。

A proximal subgradient method for nonconvex stochastic optimization under the Kurdyka-Łojasiewicz condition Figure 1
2026-08-07math.OC

A proximal subgradient method for nonconvex stochastic optimization under the Kurdyka-Łojasiewicz condition

Felipe Atenas, Alejandro Jofré, Pedro Pérez-Aros, David Torregrosa-Belén

2026-08-07优化算法

面向期望目标难以精确计算且损失、正则项可非光滑非凸的随机优化问题,论文提出逐步增大样本均值近似的近端随机次梯度法,并用 Armijo 线搜索在随机误差下维持近似充分下降。核心放宽了正则项弱凸性、方差有界和样本增长速率等常见假设;结果证明有界轨迹的函数值几乎处处收敛、聚点平稳,并在 KL 条件下得到整条迭代收敛及多项式速率。

A Relaxation-Based Decomposition Approach for Solving a Supported-Evacuation Problem in Wildfires Figure 1
2026-08-07math.OC

A Relaxation-Based Decomposition Approach for Solving a Supported-Evacuation Problem in Wildfires

Shahryar Moradi, Antoine Sauré, Jonathan Patrick

aTelfer School of Management, University of Ottawa, 55 Laurier Ave., Ottawa, ON, K1N 6N5, Canada, evacuees to the closest suitable medical centre. The second strategy, referred to as Shortest-Time-Window-

2026-08-07优化控制

论文聚焦野火中无法自主撤离的脆弱人群,针对医疗需求、车辆类型、避难点容量、时间窗和道路不确定性耦合带来的规划难题,构建两阶段随机优化模型,并用松弛与逻辑型 Benders 分解加速求解。实验含真实演练数据,显示该方法在避难点选址、车辆使用和撤离时间上优于三类贪心策略及直接求解。

An Exact Solution of the Two-Ball Multi-Look Search Game with Three Boxes and Heterogeneous Costs Figure 1
2026-08-07math.OC

An Exact Solution of the Two-Ball Multi-Look Search Game with Three Boxes and Heterogeneous Costs

Igor Kleiner

Department of Data Science, HIT – Holon Institute of Technology

2026-08-07优化控制

针对多目标搜索中每次观测都会改变剩余决策、异质开箱成本下既有结果只覆盖等成本或两箱情形的问题,本文完整求解三箱两球零和搜索博弈。核心洞察是将非浪费自适应策略有限化为42类计数剖面,并按成本区间选择嵌套的乘积型藏匿支持。主要结果给出由三个显式有理函数取最大得到的精确博弈值、对应最优藏匿策略,以及经有理 Bernstein 证书验证的搜索者混合策略。

Contour integral methods and model order reduction for parametric linear control systems Figure 1
2026-08-07math.OC

Contour integral methods and model order reduction for parametric linear control systems

Serkan Gugercin, Mattia Manucci

option pricing. Numerical simulations of related models are among the limited tools available for

2026-08-07规划控制

面向大规模参数化线性控制系统在给定时间点或时间窗内反复求输出的高成本问题,论文将逆拉普拉斯变换的轮廓积分求解与投影式模型降阶结合,并用贪心算法和新误差估计构造降阶空间,同时给出 Hermite 插值性质。结果显示该方法可在多类输入和低维初值子空间下,以指定精度降低跨参数评估成本,并在基准系统上优于或接近现有 MOR 方法。

The Loss Does Not See the Basis, but Adam Does Figure 1
2026-08-07cs.LG

The Loss Does Not See the Basis, but Adam Does

Devender Singh

Department of Computer Science, Memorial University of Newfoundland

2026-08-07优化控制

本文关注分解模型中 Adam 为何在相同训练损失下失去梯度下降的低秩隐式偏置。核心洞察是损失对因子基变换不敏感,但坐标式自适应优化器会读取基选择;作者用 gauge 等变性刻画哪些优化器能继承低秩机制。矩阵感知、Transformer 头和高光谱实验显示,等变方法更接近低秩真值,而 Adam/RMSProp 等会选择更高秩、泛化较差的插值解。

FlowAdam: Implicit Regularization via Geometry-Aware Soft Momentum Injection Figure 1
2026-08-07cs.LG

FlowAdam: Implicit Regularization via Geometry-Aware Soft Momentum Injection

Devender Singh, Tarun Sheel

2026-08-07生成模型

本文针对 Adam 依赖对角预条件、难以处理矩阵分解、张量分解和 GNN 中密集或旋转参数耦合的问题,提出 FlowAdam:在 EMA 检测到平台或梯度剧变时切换到带裁剪的 ODE 梯度流,并用软动量注入把 ODE 速度平滑并入 Adam 动量。实验显示其在低秩矩阵/张量恢复上降低 10–22% 留出误差,在 Jester 上约降 6%,同时在 CIFAR-10 等良性任务上接近 Adam;但完整收敛保证文中未充分说明。

2026-08-06

23 篇
On the Iterate Convergence of Bregman Projected Gradient Method Figure 1
2026-08-06math.OC

On the Iterate Convergence of Bregman Projected Gradient Method

He Chen, Anthony Man-Cho So

2026-08-06优化算法学习理论

本文针对 Shannon 熵核下 Bregman 投影梯度法迭代点是否收敛这一长期难题,指出传统 KŁ 分析难以适配其边界退化几何。核心创新是提出带尺度的 SKŁ 性质,用缩放充分下降和相对误差刻画 BPGM。主要结果证明连续次解析目标在线性约束下可保证迭代收敛,且 SKŁ 指数为 1/2 时达到线性收敛。

A Two-Stage Operating Room Allocation Framework for Reducing Surgical Waiting Lists in Public Hospitals Figure 1
2026-08-06math.OC

A Two-Stage Operating Room Allocation Framework for Reducing Surgical Waiting Lists in Public Hospitals

Jhoan Báez, Juan Hoyos, Víctor Riquelme, Michel Royer, Héctor Ramírez

2026-08-06优化控制

针对公立医院手术室容量有限、专科需求失衡导致等待名单累积的问题,论文提出两阶段框架:先用MILP分配专科手术时段,再按优先级安排患者,以保留医院既有分块流程并便于扰动下重排。基于智利儿科医院真实数据的仿真显示,该方法较集成MILP基线计算更快,专科供需更均衡,在20周场景中降低等待时间并完成更多手术。

Quantum Bayes Correlated Equilibrium and the Comparison of Quantum Information Structures in Games Figure 1
2026-08-06quant-ph

Quantum Bayes Correlated Equilibrium and the Comparison of Quantum Information Structures in Games

Furkan Sezer

2026-08-06优化控制

本文关注量子系统承载私人信息时,不完全信息博弈中如何比较信息结构。核心做法是把信息结构表示为按收益状态索引的密度算子族,并将服从约束转化为子系统算子间的 Loewner 支配,从而避免遍历连续 POVM 偏离。主要结果表明 QBCE 集合是可用半定规划计算的非空紧谱面体,能精确嵌入经典 BCE,并在量子个体充分性下给出“信息越多、均衡结果集合越小”的比较定理。

A Few Accelerated Algorithms for Convex Optimization under $(H_0,H_1)$-Smoothness Figure 1
2026-08-06math.OC

A Few Accelerated Algorithms for Convex Optimization under $(H_0,H_1)$-Smoothness

Aleksandr Lobanov

MSU AI Center, IAI MSU, HSE

2026-08-06优化算法

这篇论文针对经典全局光滑假设难以刻画训练中曲率随最优性间隙下降的问题,研究更广的(H0,H1)-smooth凸优化。核心做法是把Nesterov加速、小维松弛和分阶段重启结合,分离基线曲率与间隙相关曲率,并推广到随机坐标法。结果给出全梯度与均匀/非均匀坐标的加速复杂度保证,实验验证了加速、非均匀采样收益和近似松弛的可行性。

Primal-dual multigrid methods for nonsmooth optimization Figure 1
2026-08-06math.OC

Primal-dual multigrid methods for nonsmooth optimization

Felipe Guerra, Tuomo Valkonen

MODEMAT Research Center in Mathematical Modeling and Optimization, Quito, Ecuador and Department of Mathematics, Escuela Politécnica Nacional (EPN), Quito, Ecuador., MODEMAT and EPN and Department of Mathematics and Statistics, University of Helsinki, Finland. , \orcid 0000-0001-6683-3572

2026-08-06优化算法

面向大规模非光滑优化中原始-对偶方法计算代价高、传统前向-后向多重网格适用受限的问题,论文提出 PDMCC:用非光滑原始-对偶一致性条件连接粗细网格,并通过部分线性化线搜索把粗网格校正作为细网格下降方向。理论上保持 PDPS 的 O(1/N) 遍历收敛与 Fejér 准单调性;在 TV 正则 MRI、PET、EIT 反问题中展示了相对 PDPS 和既有多重网格的计算优势。

Multi-frequency far-field data enrichment for electromagnetic source reconstruction Figure 1
2026-08-06math-ph

Multi-frequency far-field data enrichment for electromagnetic source reconstruction

Atyab Khalifa Al-Shaqsi, Heba Mohammed Al-Subhi, Xianchao Wang, Shujaat Khan, Abdul Wahab

2026-08-06三维

本文针对稀疏多频远场测量下电磁源重建易出现非唯一性和欠采样伪影的问题,核心思路是利用紧支撑、几何稀疏源的有限创新率性质,将缺失频域数据恢复转化为低秩环绕 Hankel 矩阵补全,再用 Fourier 反演重建源分布。数值实验显示,在仅 30%–50% 样本和 10 dB 噪声下仍能稳定降低伪影,并优于标准 ℓ1 压缩感知基线。

Prescribed Performance Leader-Following Consensus with Event-Based Broadcasting Figure 1
2026-08-06eess.SY

Prescribed Performance Leader-Following Consensus with Event-Based Broadcasting

Athanasios K. Gkesoulis, Haris E. Psillakis, George C. Karras, Charalampos P. Bechlioulis

Robotics Institute, Athena Research Center, School of Electrical and Computer Engineering, National Technical University of Athens, 15780 Athens, Greece, Department of Informatics and Telecommunications, University of Thessaly, 35100 Lamia, Greece, Department of Electrical and Computer Engineering, University of Patras, 26504 Patras, Greece

2026-08-06优化控制

面向多智能体领航跟随控制中通信负担与瞬态/稳态误差约束难以兼顾的问题,论文提出基于发送端本地状态差的事件广播PPC协议,并用接收端衰减修正项处理异步采样导致的误差跳变。结果证明在领航根有向图下解存在唯一、无Zeno且信号有界,并给出随拓扑和触发阈值变化的跟随误差显式界。

On MUON optimization: From non-convergence to an error analysis with Polar Express and the Newton-Schulz polynomial from implementations Figure 1
2026-08-06math.OC

On MUON optimization: From non-convergence to an error analysis with Polar Express and the Newton-Schulz polynomial from implementations

Thang Do, Steffen Dereich, Arnulf Jentzen

School of Data Science, The Chinese University of Hong Kong, Shenzhen, Department of Probability and Statistics, Institute of Mathematics, Institute for Mathematical Stochastics, Faculty of Mathematics and Computer Science, School of Data Science and School of Artificial Intelligence, The Chinese University, Applied Mathematics: Institute for Analysis and Numerics, Faculty of Mathematics and

2026-08-06优化算法学习理论

这篇论文针对 MUON 已被用于大模型训练但理论收敛性仍不清的问题,建立了包含原始 Newton-Schulz 多项式与 Polar Express 的广义 MUON 框架。核心洞察是正交化动量并不天然保证收敛:作者一方面给出随梯度步数和 mini-batch 大小变化的误差界,另一方面证明在一类简单随机优化问题中,几乎所有 batch size 下 MUON 会不收敛到最优解。

Variable Smoothing for Weakly Convex Problems with Non-Euclidean Directions Figure 1
2026-08-06math.OC

Variable Smoothing for Weakly Convex Problems with Non-Euclidean Directions

Farid Najar (UVSQ)

DAVID Lab, UVSQ, 45 Avenue des ´Etats-Unis, Versailles, 78000

2026-08-06优化算法

这篇论文针对含非光滑、弱凸正则项的复合优化问题,动机是欧氏梯度步难以利用稀疏、低秩等结构几何。作者提出 MELMO,将 Moreau 包络平滑与线性最小化 oracle 结合,用选定范数产生非欧氏更新方向。理论上给出随步长和平滑参数变化的收敛率:平衡情形下平滑梯度与复合驻点代理均为 O(k^-1/4),部分情形可达 O(k^-1/3);实验显示在矩阵分解、去噪和矩阵恢复中有竞争力,但理论增益并不优于已有最优复杂度。

Arranging convex bodies for maximum intersection volume: the sharp efficiency of centroid alignment Figure 1
2026-08-06math.MG

Arranging convex bodies for maximum intersection volume: the sharp efficiency of centroid alignment

David Victor Feldman

2026-08-06优化算法

本文研究有限个凸体平移后最大化公共交叠体积的问题,动机是评估把各凸体质心直接对齐的“懒惰”策略最坏能有多差。核心洞察是建立中心核恒等式:质心重心化超集的交等于按1/(n+1)缩放的差体。主要结果证明该策略始终取得严格大于(2/(n+1))^n的最优体积且常数尖锐,并给出平面两凸体4/9的最优界。

Local Violation Certification for Linear Predict-Then-Optimize Pipelines Figure 1
2026-08-06cs.LG

Local Violation Certification for Linear Predict-Then-Optimize Pipelines

Ş. İlker Birbil, Wenhao Chi

Faculty of Economics and Business, University of Amsterdam, The Netherlands, Yau Mathematical Sciences Center, Tsinghua University

2026-08-06优化控制

本文关注已部署的线性 predict-then-optimize 决策管线在输入扰动下是否会触发安全、公平或合规违规,动机是稀有违规用随机场景测试代价高且难解释。核心洞察是固定已提交决策后,违规区域几何可被直接分析;在仿射预测、线性规划和高斯扰动假设下,局部违规率可闭式计算,并可精确采样违规扰动、给出特征归因。电力调度案例显示其能以远少于重复仿真的成本提供可审计风险评估。

Jointly Sparse Blind Deconvolution via Riemannian Optimization Figure 1
2026-08-06math.OC

Jointly Sparse Blind Deconvolution via Riemannian Optimization

Wenlong Wang, Baiyang Guo, Zai Yang, Shixiang Chen, Junpeng Shi

School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, China, College of Electronic Engineering, National University of Defense Technology, Hefei, China, School of Mathematical Sciences,University of Science and Technology of China, Hefei, China

2026-08-06优化算法

本文针对多通道盲反卷积中各输入共享稀疏支撑但难以被有效利用的问题,将联合稀疏结构写入球面上的黎曼优化目标,并结合负曲率搜索求解近似二阶驻点。理论上给出估计误差与通道数的非渐近关系,说明利用联合稀疏可降低成功恢复所需样本复杂度;数值实验和阵列信号处理示例支持这一结论。

A Counterexample to Fourier Alignment in Single-Neuron Modular Addition Figure 1
2026-08-06math.OC

A Counterexample to Fourier Alignment in Single-Neuron Modular Addition

Gautam Neelakantan Memana

2026-08-06优化控制

本文针对模块加法中单个 ReLU 神经元是否必然收敛到单一傅里叶频率的问题,构造反例说明这种 Fourier alignment 不是训练动力学的普遍结果。核心洞察是神经元可能在有限时间内死亡并冻结,或保持激活但只记忆单个表项;这些轨迹在正测度初始条件、Clarke 动力学及若干离散/平滑变体下仍可失败。

Incremental Aggregation on the Grassmannian for Asynchronous Eigenspace Computation Figure 1
2026-08-06math.OC

Incremental Aggregation on the Grassmannian for Asynchronous Eigenspace Computation

Xiaolu Wang, Jiang Hu, Hoi-To Wai

2026-08-06优化控制

本文针对分布式特征子空间计算中的异步与慢节点问题,提出 Grassmannian 增量聚合方法 GRASSIA,只刷新到达的分量并复用缓存梯度,用极分解更新避免陈旧切向量的并行传输。核心理论给出角度依赖的紧 PL 界与陈旧更新的盆不变性,从而证明两阶段线性收敛;PCA 实验显示其在样本效率和墙钟时间上优于若干基线。

An $α$-Potential Game Approach to $N$-Player Stochastic Linear-Quadratic Differential Games Figure 1
2026-08-06math.OC

An $α$-Potential Game Approach to $N$-Player Stochastic Linear-Quadratic Differential Games

Chenhui Hao, Jingtao Shi

2026-08-06优化控制

针对多智能体随机LQ微分博弈中纳什均衡求解困难、精确势博弈结构过强的问题,论文以α-势博弈放宽一致性要求,给出带乘性噪声闭环模型中成本线性导数的一阶、二阶概率与PDE表征,并在开环LQ框架下构造α-势函数及显式误差上界。其主要结果是把势函数最小化转化为增广状态上的有限维随机控制问题,从而得到开环α-纳什均衡,并在网络LQ例子中复现既有反馈形式。

Controllable subspaces and real-part observability for Schrödinger equations on $\mathbb T^d$ Figure 1
2026-08-06math.AP

Controllable subspaces and real-part observability for Schrödinger equations on $\mathbb T^d$

Gengsheng Wang, Ming Wang

HETAO Institute of Mathematics and Interdisciplinary Studies (Shenzhen), 518017, China, School of Mathematics and Statistics, HNP-LAMA, Central South University, Changsha, Hunan 410083, China

2026-08-06规划控制

论文关注薛定谔方程在只有实部控制输入时为何可能无法全局零控,并转向刻画仍可控的最大子空间。核心洞察是把问题放在实 Hilbert 结构下,通过带精确静态修正项的可观测不等式,证明不可控方向恰为纯虚静止模;对柱状开控制区及部分可测乘积区域给出显式可控子空间刻画。

A Linearly Convergent Projection-Free Algorithm for Smooth Convex Sets Figure 1
2026-08-06math.OC

A Linearly Convergent Projection-Free Algorithm for Smooth Convex Sets

Elad Hazan

2026-08-06强化学习优化算法

本文针对强凸光滑目标在凸集上优化时投影代价高的问题,提出在ρ-光滑凸体上用一次梯度和一个支撑切平面替代投影的投影自由方法。核心洞察是滚动球条件可将半空间松弛解以二次误差修回可行域,从而实现局部线性 oracle。主要结果是在允许平坦边界的光滑凸集上保持线性收敛,并可用约O(d)会员查询近似切平面。

Achieving First-Order Statistical Improvements in Data-Driven Optimization: From No-Free-Lunch to Amplified Decision Perturbation Figure 1
2026-08-06math.OC

Achieving First-Order Statistical Improvements in Data-Driven Optimization: From No-Free-Lunch to Amplified Decision Perturbation

Henry Lam, Tianyu Wang

2026-08-06优化算法

本文关注数据驱动优化中各类正则化、DRO、迁移学习等方法为何有时优于经验优化、何时无效的问题。核心洞察是将这些方法统一为“方向扰动”的 EO+ 框架,并证明若缺少正确且几何有效的侧信息,改进至多是二阶;若侧信息有效且扰动尺度取常数级,可获得一阶超额风险下降,并可用系统知识或 bootstrap 估计来调参放大增益。

A New Error Analysis for a Point Tracking Elliptic Distributed Optimal Control Problem with Pointwise Control Constraints Figure 1
2026-08-06math.NA

A New Error Analysis for a Point Tracking Elliptic Distributed Optimal Control Problem with Pointwise Control Constraints

Susanne C. Brenner, Li-yeng Sung

Susanne C. Brenner, Department of Mathematics and Center for, Computation and Technology, Louisiana State University, Baton Rouge, Department of Mathematics and Center for Computation and Technology, Louisiana State University, Baton Rouge, LA 70803, USA

2026-08-06视觉感知规划控制优化算法

针对点跟踪椭圆分布式最优控制在点态控制约束下误差分析分散、处理奇异伴随态较繁的问题,本文把标准有限元离散与变分离散纳入同一框架,利用伴随态在跟踪点附近的奇异结构和最优控制的局部常值性,识别两个关键误差项并给出自洽估计,主要结果是重新推出并统一了文献中最优的先验误差界。

Dynamic Dispatching for Time-Sensitive Blood Sample Collection and Delivery Figure 1
2026-08-06math.OC

Dynamic Dispatching for Time-Sensitive Blood Sample Collection and Delivery

Arash Dehghan, Aliaa Alnaggar, Mucahit Cevik, Merve Bodur

Department of Mechanical, Industrial and Mechatronics Engineering, Toronto Metropolitan University, Toronto, Ontario, Canada, School of Mathematics and Maxwell Institute for Mathematical Sciences, University of Edinburgh, Edinburgh, UK

2026-08-06优化控制

这篇论文针对血样从分散采集点到中心实验室的实时派送问题,动机是血样时效短、延误会导致重采和诊断风险。核心做法是将随机到达需求建模为 MDP,并用神经近似动态规划把车辆状态与采集点状态拆成双价值函数,再通过匹配模型选择派车和合单策略。在大多伦多区域仿真实验中,相比近视基线准时送达量提升 1–9 个百分点,收益在车队、容量、时限和路径约束更紧时更明显。

Strong error analysis for the stochastic momentum optimizer Figure 1
2026-08-06math.OC

Strong error analysis for the stochastic momentum optimizer

Davide Gallon, Arnulf Jentzen

Applied Mathematics: Institute for Analysis and Numerics, School of Data Science and School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)

2026-08-06优化控制

针对 AdamW、MUON 等大模型优化器依赖动量机制但随机情形误差刻画不足的问题,本文对 mini-batch momentum SGD 建立严格强误差分析。核心是用增广 Lyapunov 递推同时控制动量二阶矩、相关项与参数误差,给出均方距离随步长、batch size 和 one-point convexity 常数变化的收敛率,上界包含指数衰减项与 J^{-1}n^{-λ} 噪声项。

Evacuation Planning for Disaster Preparedness: An Adaptive Robust Optimization Approach Figure 1
2026-08-06math.OC

Evacuation Planning for Disaster Preparedness: An Adaptive Robust Optimization Approach

Jaehyuk Kim, Merve Bodur, Maria E. Mayorga, Osman Y. Ozaltin

2026-08-06规划控制优化算法安全鲁棒

面对灾前疏散需求规模和空间分布难以预测的问题,论文将避难所选址、路线分配、物资预置与灾后调拨放入两阶段自适应鲁棒优化框架,并用分区定界算法处理混合整数追索的复杂性。Sioux Falls 实验显示,集中式路线规划相对用户自选路线最多降低最坏未满足需求 90.6%、疏散时间 79.3%,自适应调拨在物资受限时进一步提升覆盖。

A Primal Perspective on Distributionally Robust Optimization: An Investigation on Modeling and Solution Strategies Figure 1
2026-08-06math.OC

A Primal Perspective on Distributionally Robust Optimization: An Investigation on Modeling and Solution Strategies

Yiqi Tian, Bo Zeng

Department of Industrial Engineering, University of Pittsburgh

2026-08-06优化算法安全鲁棒

本文针对单阶段分布鲁棒优化在复杂模型或模糊集下依赖对偶重构、难以扩展的问题,转向原始分布视角,提出以分布割为核心的 BiCS 分解框架。该方法统一处理标准 DRO、几乎处处 DRO、机会约束和局部信息增强模糊集;在矩与 Wasserstein 模糊集实验中,相比紧凑重构更稳健,并能求解部分重构不可用或计算困难的实例。

2026-08-05

22 篇
Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability Figure 1
2026-08-05math.OC

Simulation-Based Neural Policies for Portfolio Choice: Architecture, Training, and Interpretability

Jules Viard, Alexander Michaelides, Panos Parpas

Imperial College London, Imperial College London United Kingdom

2026-08-05优化控制

本文针对生命周期投资组合选择中网格动态规划受维度灾难限制的问题,用低维可由 DP 校验的基准来拆解神经策略的架构与训练作用。核心洞察是将策略按退休前后、进一步按日期做后向解耦,并加入经济形状约束,比单一时间条件网络更接近 Bellman 结构。结果显示完全后向训练将确定性等价损失降至约 0.127%,消费误差下降;形状约束虽福利增益相近,但能消除负边际消费倾向等局部违背经济规律的问题。

A Robust Chance Constrained Approach to Surgery Scheduling Figure 1
2026-08-05math.OC

A Robust Chance Constrained Approach to Surgery Scheduling

Marco Caserta, Antonio García Romero, Miguel Vaquero

IE University, Madrid, Spain

2026-08-05安全鲁棒

本文针对手术时长不确定导致的连锁延误和加班问题,提出将风险缓冲生成与排程优化解耦的鲁棒机会约束框架,让每台手术从离散可靠性菜单中内生选择保护水平。核心洞察是按病例异质性和日内位置分配缓冲,而非统一加比例。HLA Moncloa回测显示,相比均值基线,90分钟以上延误减少97%,95分位延误降低约620分钟,总加班减少42%。

Trajectory inference via Acceleration Matching Figure 1
2026-08-05cs.LG

Trajectory inference via Acceleration Matching

Bartolo Dazzini, Giovanni Conforti, Alain Durmus, Aram-Alexandre Pooladian

2026-08-05规划控制

本文针对多时刻无配对观测下的轨迹推断:分段运输或流匹配容易产生速度不连续,已有二阶方法又常需训练时 rollout。核心做法是把问题提升到位置-速度相空间,回归显式条件加速度场,使轨迹按构造更平滑且只用位置数据训练。实验在低维 GoM、Lotka-Volterra 与单细胞数据上显示 AM 多数指标优于 MMFM 等模拟自由基线,但对 3MSBM 的优势并不一致。

Sliding Methods for Hölder-Smooth Convex--Concave Minimax Optimization with Bilinear Coupling Figure 1
2026-08-05math.OC

Sliding Methods for Hölder-Smooth Convex--Concave Minimax Optimization with Bilinear Coupling

Nhat Trung Nguyen, Alexander Gasnikov

Innopolis University, MIRIAI, IITP

2026-08-05优化算法

本文面向带双线性耦合的凸凹极小极大问题,动机是现有一阶法往往把函数梯度与矩阵乘法统一计费,难以利用各部分光滑性差异。核心做法是将问题写成分量化变分不等式,提出递归 sliding 方法,按 f、g 与耦合算子的 Hölder 常数和指数分别调度 oracle。结果给出非强凸、部分强凸和随机情形的复杂度界,并在合成与断层成像实验中显示梯度调用可按各自光滑度分离,梯度代价高时有运行时间收益。

When Does Party Convergence Persist under Alienation-Based Abstention? Figure 1
2026-08-05econ.TH

When Does Party Convergence Persist under Alienation-Based Abstention?

Aman Ray, Srikanth Pai

Madras School of Economics, electoral center. Yet full participation is a strong idealization. Abstention is a pervasive feature

2026-08-05学习理论

本文关注选民因候选平台过远而弃权时,两党是否仍会向中间收敛;动机在于传统中位选民结论依赖充分投票或单峰分布。论文引入“向心结构”刻画竞争被拉向唯一锚点的条件,并用窗口支配统一描述一般连续分布下的纯策略均衡。主要结果表明,一般分布中均衡可不存在、非唯一且随容忍半径消失或重现,但向心结构一旦出现便在更大容忍范围内持续,并能推出办公动机与政策动机政党的均衡分类。

Error Estimates for the Iteratively Regularized Gradient Method for Ill-Posed Optimization Problems in a Hilbert Space Figure 1
2026-08-05math.NA

Error Estimates for the Iteratively Regularized Gradient Method for Ill-Posed Optimization Problems in a Hilbert Space

M. M. Kokurin

2026-08-05优化算法三维

针对Hilbert空间中一般光滑泛函的病态优化,经典梯度法即使产生极小化序列也可能不收敛,因而需要正则化。论文分析每个正则化参数只做一步梯度更新的迭代正则化梯度法,在精确与近似目标泛函两种情形下,基于源条件给出幂型误差估计和扰动停止规则;同时改进Tikhonov误差证明,并证明在不假设原泛函弱下半连续时Tikhonov泛函仍可存在全局极小点。

Adaptive Stepsizes With Certified Convergence in Distributed Gradient Tracking With Quadratic Costs Figure 1
2026-08-05math.OC

Adaptive Stepsizes With Certified Convergence in Distributed Gradient Tracking With Quadratic Costs

Yifan Wang, Luca Ballotta, Ruggero Carli, Andrea Iannelli, Xianghui Cao, Luca Schenato

2026-08-05视觉感知优化算法学习理论

这篇论文针对分布式梯度跟踪中步长常靠保守理论界或经验调参的问题,在标量二次代价场景下分析网络混合与局部曲率异质性的耦合。核心创新是用可在线估计的共识矩阵本质谱半径和曲率离散度构造收敛证书,并据此优化常数步长,进一步给出分布式自适应实现。结果显示该步长在完全图和同质曲率情形下紧致,并在数值实验中快于已有离线与在线规则。

Pursuing Optimal Stepsize in Adaptive Gradient-Based Quadratic Optimization Figure 1
2026-08-05math.OC

Pursuing Optimal Stepsize in Adaptive Gradient-Based Quadratic Optimization

Yifan Wang, Luca Ballotta, Ruggero Carli, Xianghui Cao, Luca Schenato

School of Automation, Southeast University, Nanjing, China, Department of Information Engineering, University of Padova

2026-08-05优化算法

针对梯度下降步长依赖全局 Lipschitz 常数、调参保守且代价较高的问题,论文聚焦强凸二次优化,利用最小与最大局部曲率的运行估计构造轻量级自适应步长规则。其核心洞察是可在迭代中逼近收敛率意义下的最优常数步长;理论证明该步长收敛到最优值,仿真显示在二次问题及初步逻辑分类测试中收敛速度可比或优于近期自适应方法。

A proximal difference of convex functions algorithm using Barzilai-Borwein step size with nonmonotone line search and extrapolation Figure 1
2026-08-05math.OC

A proximal difference of convex functions algorithm using Barzilai-Borwein step size with nonmonotone line search and extrapolation

Kelin Wu, Hongpeng Sun

School of Mathematics

2026-08-05优化算法

针对标准近端 DC 算法步长受全局 Lipschitz 常数限制、收敛偏慢且 BB 步长易不稳定的问题,论文提出将 BB 曲率估计与非单调线搜索解耦的 pBBDCA,并加入带重启或截断保护的外推机制,使每轮只需求解一次近端子问题;在 KL 条件下证明全局收敛和局部速率,并在 SCAD 最小二乘与图 Ginzburg-Landau 分割实验中显示相较既有 DC 方法具备更好的效率与精度。

A McKean--Vlasov semigroup and its application to a martingale representation problem Figure 1
2026-08-05math.PR

A McKean--Vlasov semigroup and its application to a martingale representation problem

Mao Fabrice Djete, Mattia Martini

2026-08-05优化控制

本文动机是把有限维热半群在鞅表示和 Feynman-Kac 公式中的一阶表征推广到带共同噪声的 McKean-Vlasov 条件律流。核心洞察是用有限粒子近似及对角/非对角切向分解,直接刻画传播泛函的 Lions 导数。主要结果给出沿一般可容许条件律流的后向表示,并在无漂移情形证明 McKean-Vlasov 热半群及其导数唯一解相应鞅表示问题。

Fast and slow mean-field games Figure 1
2026-08-05math.OC

Fast and slow mean-field games

Roxana Dumitrescu, Julian Gutierrez Pineda, Peter Tankov

Division of engineering, New York University Abu Dhabi

2026-08-05优化控制

针对带公共噪声的均场博弈因条件分布随机化、主方程高维而难以求解的问题,论文利用快慢时间尺度结构,将公共噪声限制在遍历快变量中,并通过对快过程不变测度平均,构造无公共噪声的有效均场博弈。其核心结果是从有效问题的随机控制或随机停止均衡出发,显式得到原两尺度问题的强随机ε-均衡,并用强随机平均估计量化证明纳什误差随时间尺度分离参数趋零。

Dynamic Proximal Point Method for Unconstrained Minimization Figure 1
2026-08-05math.OC

Dynamic Proximal Point Method for Unconstrained Minimization

Enrico Bertolazzi, Alberto De Marchi, Davide Stocco

2026-08-05优化控制

针对非凸或病态无约束优化中 Newton 法易受奇异、非正定 Hessian 影响而失稳的问题,论文提出动态近端点框架,用由 Hessian 行和信息构造的自适应对角 scaling 加权近端项,并按内层 Newton 线搜索表现调节正则强度。100 个基准中报告全部收敛、98 个达严格梯度标准,但相对经典信赖域或 LM 的增益来源仍可能主要来自 scaling 与参数策略。

Joint-Range Inequalities for Nonconvex QCQPs Figure 1
2026-08-05math.OC

Joint-Range Inequalities for Nonconvex QCQPs

Liding Xu, Sebastian Pokutta

‡Zuse Institute Berlin and Technische Universit¨at Berlin, Berlin, Germany. E-mail:

2026-08-05优化算法

针对非凸 QCQP 中割平面常在强度与稀疏性之间取舍的问题,论文把两条基有效不等式先投影到二维,利用二次函数联合值域的几何结构再提升回原模型。核心创新是给出非凸联合值域下投影集合凸包的闭式描述、凸情形的 SDP 表示,并提出类 MIR 的 secant mixed-joint-range 不等式。初步几何实验显示,相比投影 RLT 松弛可显著缩小面积,但通用分离与实际求解增益仍文中未充分说明。

Optimal Deterministic Oracle Complexity for Weakly Convex Optimization Figure 1
2026-08-05math.OC

Optimal Deterministic Oracle Complexity for Weakly Convex Optimization

Jiajin Li, Siyu Pan

Sauder School of Business, The University of British Columbia

2026-08-05优化算法

本文针对弱凸非光滑优化中确定性一阶方法是否能突破 ε^-4 复杂度这一问题,构造适配完整次微分 oracle 的困难实例。核心洞察是用倾斜 max-affine 块和重叠链的对角过滤控制信息传播,证明在小初始间隙下任意确定性算法需 Ω(ρG²Δ/ε⁴) 次查询,从而说明额外 ε^-2 因子来自非光滑几何本身。

Optimal Nonergodic Primal-Dual Complexity of Efficient Inexact Parameter-Free Augmented Lagrangian Methods Figure 1
2026-08-05math.OC

Optimal Nonergodic Primal-Dual Complexity of Efficient Inexact Parameter-Free Augmented Lagrangian Methods

Arnesh Sujanani, Saeed Ghadimi, Henry Wołkowicz

Department of Combinatorics and Optimization , University of Waterloo, ON, Canada, Department of Management Science and Engineering, University of

2026-08-05优化控制

本文针对线性约束凸复合优化中传统增广拉格朗日法难以同时具备可验证 KKT 停止准则、最优复杂度和免调参的问题,提出多种非精确、无近端正则的 AL 方案。核心在于用可验证的原始-对偶残差控制内外层精度,并给出非遍历收敛分析;凸情形达到 O(ε^{-1}),强凸情形达到近最优 O(ε^{-1/2}log(ε^{-1})),实验在六类问题上较 PAL 常有 5–50 倍加速。

Oracle-Based Distributionally Robust Optimization under Optimal Transport Ambiguity Sets Figure 1
2026-08-05math.OC

Oracle-Based Distributionally Robust Optimization under Optimal Transport Ambiguity Sets

Guixian Chen, Salar Fattahi, Soroosh Shafiee

University of Michigan, Cornell University

2026-08-05优化算法安全鲁棒

本文针对最优传输模糊集下 DRO 常见凸重构变量多、锥约束重、规模化困难的问题,提出不再走大规模提升重构,而将内层最坏期望精确化为标量预算分配,并嵌入 oracle 式分布最佳响应框架。主要结果是可恢复至多 N+1 支撑点的最坏分布,给出原始-对偶近似求解与稀疏最不利分布支持界,并在实验中快于现有重构求解器。

Passively Safe Convex Guidance for Cislunar Rendezvous and Proximity Operations Figure 1
2026-08-05cs.RO

Passively Safe Convex Guidance for Cislunar Rendezvous and Proximity Operations

Ian M. Down, Connor Plaks, Matthew Bolliger, Michael Caudill

2026-08-05优化算法安全鲁棒

面向月地空间NRHO中通信延迟、强非线性和不确定性下的自主交会安全需求,论文将被动安全约束、机动执行误差与导航不确定性化为纯凸SOCP问题,避免连续凸化的迭代复杂度。CAPSTONE 02高保真闭环蒙特卡洛在远月点和近月点场景验证了接近、到达与中止机动均能满足安全和对接几何约束。

Stochastic Saddle Avoidance Beyond Unit Excitation and Smoothness: A Pathwise Lyapunov-Perron Framework Figure 1
2026-08-05math.OC

Stochastic Saddle Avoidance Beyond Unit Excitation and Smoothness: A Pathwise Lyapunov-Perron Framework

Junwen Qiu, Bohao Ma, Andre Milzarek, Junyu Zhang

fixed point, the celebrated center-stable manifold argument used in deterministic analyses is not, At a strict saddle z∗, the derivative DT(z∗) has at least one unstable direction. The center-stable, ∗Industrial Systems Engineering and Management, National University of Singapore, Singapore., †School of Data Science, The Chinese University of Hong Kong, Shenzhen, China., expensive or unavailable. Stochastic algorithms therefore update the iterate using noisy or incomplete, on Hessian information, but this route is not directly available for nonsmooth objectives. In the

2026-08-05优化控制

本文针对随机优化中“单位激励”假设过强的问题:实际场景里噪声可能在驻点附近消失,或只落在低维采样子空间。论文以路径化 Lyapunov-Perron 框架替代中心稳定流形论证,给出无需 UE 的几乎必然避开严格鞍点定理,并推广到随机镜像下降/SGD、随机重排及非光滑复合目标的近端随机梯度,结合迭代收敛性可推出收敛到原目标局部极小点。

A Proof of the Forsythe Conjecture for the Two-Step Restarted Conjugate Gradient Method Figure 1
2026-08-05math.NA

A Proof of the Forsythe Conjecture for the Two-Step Restarted Conjugate Gradient Method

Matthew J. Colbrook, George Stepaniants, Alex Townsend

Department of Applied Mathematics and Theoretical Physics, University of Cambridge, Cambridge CB3 0WA, UK ()., Department of Computing and Mathematical Sciences, California Institute of Technology, Pasadena, CA 91125, USA ()., Department of Mathematics, Cornell University, Ithaca, NY 14853, USA ().

2026-08-05优化算法

这篇论文针对重启共轭梯度法中残差方向是否会形成二周期这一长期理论问题,聚焦重启长度为2的 Forsythe 猜想。作者把归一化残差转化为谱权重动力系统,结合正交二次多项式、能量单调性与极限集几何,补上此前从系数收敛到方向收敛的缺口,证明算法不终止时偶、奇残差方向分别收敛,从而给出该情形的自洽证明。

Stabilization of First-Order Partial Integro-Differential Equations with Concurrent Input and State Delays Figure 1
2026-08-05eess.SY

Stabilization of First-Order Partial Integro-Differential Equations with Concurrent Input and State Delays

Sanguan Zhong, Jie Qi

2026-08-05优化控制

针对一阶双曲PIDE中输入延迟与状态延迟同时存在、传统延迟补偿难以分开处理的问题,论文构造含Fredholm与Volterra积分项的双重反步边界控制器,并用特征线分区逐步求解四个核PIDE以保证适定性。结果证明闭环系统可实现指数及有限时间稳定,数值仿真展示了控制器对并发延迟的补偿效果。

Axiomatic shared-medium coordination for stigmergic systems Figure 1
2026-08-05cs.DC

Axiomatic shared-medium coordination for stigmergic systems

Fernando Paredes García

2026-08-05优化控制

论文针对污迹协同在不同共享介质中模型割裂、难以比较的问题,提出以“可启用响应签名”为核心的介质无关公理化框架。其洞察是把元数据细化视为商映射与响应纤维对齐问题,从而给出商充分性的充要条件、失效时的最粗修复及下界;动态上证明匹配写操作保持一步与有限串行轨迹行为,并指出依赖新鲜度的动作存在不可提升障碍,例化于元组空间和带时间戳虚拟污迹数据空间。

Navigating LLM Valley: From AdamW to Memory-Efficient and Matrix-Based Optimizers Figure 1
2026-08-05cs.LG

Navigating LLM Valley: From AdamW to Memory-Efficient and Matrix-Based Optimizers

Aditya Ranganath

\addr Center for Applied Scientific Computing, Lawrence Livermore National Laboratory

2026-08-05优化控制

这篇综述的动机是解释在LLM预训练和全参微调中,AdamW虽稳健但优化器状态、通信和吞吐成本逐渐成为瓶颈。核心洞察是按内存效率、曲率利用、符号更新、低秩/矩阵结构等维度重组优化器谱系,并强调公平调参、尺度和墙钟效率会改变结论。主要结果不是提出新算法,而是指出许多单点加速声明在更严格的大规模评测下增益来源不清,未来比较应联合考察收敛、稳定性、内存和实现复杂度。

2026-08-04

40 篇
Hidden Star-Convexity in Policy Optimization for Gain-Scheduled LQR: Extended Version Figure 1
2026-08-04math.OC

Hidden Star-Convexity in Policy Optimization for Gain-Scheduled LQR: Extended Version

Shiva Shakeri, Péter Baranyi, Mehran Mesbahi

2026-08-04强化学习优化算法

本文针对增益调度 LQR 中共享顶点增益使策略优化失去单系统全局收敛保证的问题,揭示其隐藏的星凸结构:用最优点闭环协方差替代梯度时,代价对最优调度全局星凸。作者进一步给出可由 Lyapunov 方程计算的无量纲比率,若其在子水平区域内小于 1,则梯度下降以显式线性速率收敛;该比率也能标识伪驻点,实验显示部分基准满足条件,而翼模型和构造反例会越过阈值。

Computational and Statistical Guarantees of the \textit{c}-Rectified flow Figure 1
2026-08-04stat.ML

Computational and Statistical Guarantees of the \textit{c}-Rectified flow

Leda Wang, Zhehao Xu, Qiang Liu, Harrison H. Zhou

Department of Statistics and Data Science, Yale Universitypresep=, ]e1,e2,e3, Department of Computer Science, University of Texas at Austinpresep=, ]e4

2026-08-04生成模型

本文针对 rectified flow 已用于大规模生成模型但其迭代过程是否真正收敛到最优传输缺少理论保证的问题,分析 cost-aware 的 c-rectified flow。核心洞察是普通 rectified flow 仅保边际和降成本仍可能停在非最优耦合,而加入与代价匹配的梯度投影可排除这类固定点。论文证明其在适当条件下收敛到最优传输,并给出一步收缩、指数收敛及结合 score 估计后的最优或近参数统计速率。

Timescale Separation Through the Lens of Operator Theory Figure 1
2026-08-04math.OC

Timescale Separation Through the Lens of Operator Theory

Guido Carnevale, Nicola Bastianello, Luca Schenato, Giuseppe Notarstefano, Ruggero Carli

2026-08-04学习理论

离散时间多时间尺度系统在优化、学习与控制中常见,但现有奇异摄动分析多给存在性或保守条件。本文用算子理论重写慢/快固定点迭代,给出由收缩、平均性、度量次正则和互联增益决定的显式步长上界,并证明确定性与随机情形下的线性或几乎处处收敛,反馈优化作为验证场景。

A Spectral Filtering Approach to Regret Analysis of Distributed Online Control for Linear Dynamical Systems Figure 1
2026-08-04math.OC

A Spectral Filtering Approach to Regret Analysis of Distributed Online Control for Linear Dynamical Systems

Ting-Jui Chang

T.J. Chang is with the Department of Aeronautics and Astronautics, National Cheng Kung University, Taiwan.

2026-08-04规划控制学习理论

面向成本随时间变化、扰动可对抗且只能局部通信的多智能体线性系统,论文将在线谱控制从集中式推广到分布式场景:用 Hankel 矩阵主特征向量构造谱滤波器表示控制器,并以局部替代损失上的共识式在线梯度更新参数。主要结果是在标准稳定性假设下得到相对最佳集中线性策略的次线性 regret 界,量级为 O(√T poly(log T)/γ³),并显式刻画网络规模与连通性影响。

Dynamic Traffic Allocation for Revenue Maximization on Creator Economy Platform Figure 1
2026-08-04math.OC

Dynamic Traffic Allocation for Revenue Maximization on Creator Economy Platform

Zhengli Wang, Franklin Lin Feng, Zhixi Wan

2026-08-04优化控制

本文关注创作者平台在明星创作者的即时广告收入与扶持新人成长之间的流量分配权衡。作者建立连续时间动态优化模型,将广告与粉丝付费双收入纳入同一框架,提出前瞻性“最有价值创作者优先”规则,并指出在 Bass 扩散下可能暂时偏向落后但增长潜力高的创作者。结果显示,最优策略既非赢者通吃也非简单公平,而是设置能力门槛和粉丝上限;简单启发式最高损失约 25%,基于粉丝增长动量的规则接近最优。

Discrete-Time Adaptive Control in High Dimensions: Near Dimension-Free Performance via Mirror Descent Figure 1
2026-08-04math.OC

Discrete-Time Adaptive Control in High Dimensions: Near Dimension-Free Performance via Mirror Descent

Mohammad Boveiri, Peyman Mohajerin Esfahani

Delft University of Technology, The Netherlands, University of Toronto, Canada

2026-08-04规划控制

面向高维实时自适应控制中未知参数很多但具有稀疏、低秩或随机矩阵等结构的场景,论文指出RLS和欧氏梯度更新会随环境维度恶化,改用带非欧几里得Polyak步长的镜像下降自适应律来匹配参数几何。结果证明闭环状态有界并渐近跟踪参考轨迹,遗憾界对环境维度至多呈对数依赖,仿真显示在含噪设置下也优于欧氏方案。

Solving the Dissipation Inequality not as a constitutive restriction Figure 1
2026-08-04math.OC

Solving the Dissipation Inequality not as a constitutive restriction

Maximiliano Larrain Silva, Amit Acharya

2026-08-04优化控制

本文针对连续介质模型中耗散不等式常被当作本构限制、且材料响应无法完全确定的问题,提出把第二定律作为约束方程处理:在弹塑性杆示例中引入最小修正变量和耗散变量,形成约束优化并用闭式解与凸优化序列求解。结果显示,该方法能自动修正故意违反耗散不等式的本构演化,使解全程满足非负耗散,数值解与解析解误差低于0.1%,但应用仍主要限于简化一维算例。

A proximal gradient method with adaptive backtracking for weakly smooth multiobjective optimization Figure 1
2026-08-04math.OC

A proximal gradient method with adaptive backtracking for weakly smooth multiobjective optimization

Yuki Miyazaki, Masaru Ito, Shotaro Yagishita

2026-08-04视觉感知优化算法

本文针对多目标复合优化中目标梯度仅 Hölder 连续、平滑参数未知时近端梯度法难以设步长的问题,提出带自适应回溯的无参数算法,用线搜索自动匹配弱光滑性并以可检验的 Pareto 驻点度量作为停止准则。主要结果是非凸情形达到与已有弱光滑方法同阶的复杂度,同时给出更强的驻点保证;在凸情形进一步证明了优于非凸界的新复杂度结果。

Accelerating Evolutionary Strategy via Rao-Blackwellizing Realization of Uncertain Input Figure 1
2026-08-04math.OC

Accelerating Evolutionary Strategy via Rao-Blackwellizing Realization of Uncertain Input

So Nakashima, Tetsuya J. Kobayashi

Institute of Industrial Science, The University of Tokyo, Institute of Industrial Science, The University of Tokyo, Universal Biology Institute, The University of Tokyo

2026-08-04优化控制

本文关注输入本身带随机性的优化问题,如制造公差、执行器噪声和强化学习中可观测但不可控的轨迹。核心洞察是传统进化策略只用目标值而丢弃已实现输入,PAES通过对该信息做Rao-Blackwell化降低梯度估计方差。理论上证明方差不增,并在连续优化与RL基准中显示比普通ES收敛更快。

Exact Prescribed-Time Control Based on Simple Harmonic Motion: Stability Analysis and Nonsingular Sliding Mode Stabilization Figure 1
2026-08-04math.OC

Exact Prescribed-Time Control Based on Simple Harmonic Motion: Stability Analysis and Nonsingular Sliding Mode Stabilization

Yi Ding, Bin Zhou

(Corresponding author: Bin Zhou) Yi Ding and Bin Zhou are with the Center for Control Theory and Guidance, Technology, Harbin Institute of Technology, Harbin, 150001, China. (Email:

2026-08-04规划控制

针对有限/固定时间控制中收敛时刻依赖初值、传统预设时间高增益方法易奇异的问题,论文借用简谐运动周期与振幅无关的等时性,构造新的精确预设时间控制框架和Lyapunov分析。结果显示,标量系统可对任意非零初值在指定时刻精确收敛,并进一步给出全状态无奇异、增益一致有界的滑模控制律,在扰动下对几乎所有初值保持精确收敛,仿真验证了方法有效性。

A Continuous-Time Analysis of Smoothed Matrix-Polar Spectral Gradient Flows for Muon-Type Optimization Figure 1
2026-08-04math.OC

A Continuous-Time Analysis of Smoothed Matrix-Polar Spectral Gradient Flows for Muon-Type Optimization

Jinlin Liu, Song Chen, Jiaxu Liu, Chao Xu

School, University, Song Chen is with the Department of Mathematics, National Univer-, Jiaxu Liu is with the School of Science, Huzhou Normal University, Chao Xu is with the State Key Laboratory of Industrial Control Tech-, nology, the Institute of Cyber-Systems and Control, College of Control, Science and Engineering, Zhejiang University, Hangzhou, Zhejiang, China, and also with Huzhou Institute of Zhejiang University

2026-08-04生成模型优化算法

本文动机是为 Muon 这类矩阵极分解归一化优化器建立连续时间解释,并避开极分解在低秩或小奇异值处的不光滑问题。核心做法是用平滑谱反馈替代精确 Polar 更新,保留奇异向量结构并分析其耗散性。主要结果包括谱梯度流的适定性、全局收敛与非凸/凸/PL 收敛率,动量扩展系统的 Lyapunov 收敛分析,以及一个局部下降优势判据;文中也指出全局复杂度增益并不明确,优势可能依赖梯度谱结构与 Hessian 曲率的局部配合。

Safe screening rules for portfolio optimization with linear and cardinality constraints Figure 1
2026-08-04math.OC

Safe screening rules for portfolio optimization with linear and cardinality constraints

Nanari Wada, Shunnosuke Ikeda, Yuichi Takano, Jun-ya Gotoh

University of Tsukuba, Chuo University, University of Tsukuba Tsukuba Ibaraki Japan, Chuo University Bunkyo-ku Tokyo Japan

2026-08-04优化算法安全鲁棒

针对带持仓数量约束的投资组合优化在大规模资产池中难以全局求解的问题,本文把基于透视松弛和 Fenchel 对偶的安全筛选扩展到含预算、收益等线性约束的二次目标模型,构造含线性约束乘子的资产级筛选分数,并在不排除全局最优解的前提下预先固定选择变量。S&P 500 与 Russell 2000 实验显示,在中高正则化、收益要求较宽松的困难实例上可显著缩短求解时间,部分直接求解超时的实例可达到全局最优。

Exponential mixing for Korteweg-de Vries equation with localized noise Figure 1
2026-08-04math.AP

Exponential mixing for Korteweg-de Vries equation with localized noise

Yuxuan Chen, Shengquan Xiang, Zhifei Zhang, Jia-Cheng Zhao

School of Mathematical Sciences, Peking University, 100871, Beijing, China., School of Mathematical Sciences, Shenzhen University, 518061, Shenzhen, China.

2026-08-04优化控制

本文关注弱阻尼、局部随机激励下 KdV 方程的长期统计行为,动机在于理解局部噪声、控制性质与随机色散 PDE 混合之间的关系。核心创新是把一般耦合框架与 KdV 正规形带来的非线性平滑、局部力稳定化结合,处理低正则 L2 情形和高频退化噪声。主要结果证明相应 Markov 过程存在唯一不变测度,并以指数速率收敛。

Sparse Linear Surrogates for Interpretable Budget Allocation Figure 1
2026-08-04math.OC

Sparse Linear Surrogates for Interpretable Budget Allocation

Marc Goerigk, Michael Hartisch, Sebastian Merten

Business Decisions and Data Science, University of Passau

2026-08-04优化控制

面向预算分配中自动优化决策难以被业务方理解的问题,论文将实例特征线性映射到预算份额等“元解”,并用行、列或全局稀疏约束限制规则复杂度;作者给出混合整数规划精确模型和基于现成算法的启发式。实验表明,稀疏线性替代模型可作为决策树替代方案,在可解释性、运行时间和解质量之间取得可行折中。

A noncommunicative Kalman condition for null controllability of backward stochastic parabolic systems Figure 1
2026-08-04math.OC

A noncommunicative Kalman condition for null controllability of backward stochastic parabolic systems

Mohamed Fadili

Laboratoire de Mathématiques, Modélisation et Systèmes Automatiques, École Normale Supérieure, Cadi Ayyad University

2026-08-04规划控制

本文针对随机抛物系统中鞅积分项耦合使经典 Kalman 条件失效或不完整的问题,研究局部漂移控制下的反向随机热方程零可控性。核心洞察是用由漂移矩阵和噪声耦合矩阵生成的非交换“词”秩条件刻画可控性,并通过随机 Gramian 与热半群分解连接有限维代数条件和空间局部观测。主要结果给出该条件的充要性,结合 Lebeau–Robbiano 谱方法证明零可控,失败时则存在不可观测不变子空间。

Non-KKT Accumulation in Entropic Mirror Descent Figure 1
2026-08-04math.OC

Non-KKT Accumulation in Entropic Mirror Descent

Kuangyu Ding, Kim-Chuan Toh

2026-08-04优化控制

本文针对带 Legendre 核的镜像下降在边界处是否必然收敛到 KKT 驻点这一基础问题,指出熵几何的边界退化会抹去主动约束的对偶可行性。作者构造 Shannon 熵镜像下降在正正交锥和概率单纯形上的光滑反例,使有界序列在正常步长、目标单调下降和相对光滑条件下仍积累到含非 KKT 点的边界闭曲线,说明问题来自 Bregman 几何而非步长或下降失败。

Convergence and Stability Analysis of a Generalized Proximal Point Algorithm and Its Inexact Version Figure 1
2026-08-04math.OC

Convergence and Stability Analysis of a Generalized Proximal Point Algorithm and Its Inexact Version

Ba Khiet Le, Boris S. Mordukhovich, Michel A. Thera

Analytical and Algebraic Methods in Optimization Research Group, Faculty of Mathematics and Statistics, Ton Duc Thang University, Ho Chi Minh City, Vietnam., .01-2025.61Department of Mathematics and Center for Artificial Intelligence and Data Science, Wayne State University, Detroit, MI 48202, USA.

2026-08-04学习理论

本文针对非单调包含问题中广义近端点算法的收敛保证不足,以及实际计算误差往往不消失的问题,提出“自适应强单调性”这一弱于传统强单调性的条件。核心结果是在无需核映射双射或算子对强单调的假设下,证明 GPPA 残差线性收敛,并进一步分析带一致有界、非递减误差的 IGPPA,通过正则化建立其稳定性。

Generalized Quadratic Gradient: A New Direction in Optimization via the Fusion of Positive-Definite Curvature Matrices and Gradients into A Unified Framework Figure 1
2026-08-04math.OC

Generalized Quadratic Gradient: A New Direction in Optimization via the Fusion of Positive-Definite Curvature Matrices and Gradients into A Unified Framework

John Chiang

2026-08-04优化算法

本文针对一阶方法缺乏曲率、二阶方法 Hessian 代价高的问题,提出 Generalized Quadratic Gradient,将 QG/SQG/QQG 统一为在正定曲率矩阵下最小化局部二次模型的更新框架,核心洞察是关键不在特定 Hessian 近似,而在满足驻点条件的正定几何。文中测试多种 BFGS 之外的曲率替代,但实验结论和增益来源未充分说明。

Universal Triangle Covering Curve and Polygonal Chain: Escaping Forest and Fitting Worm Figure 1
2026-08-04math.OC

Universal Triangle Covering Curve and Polygonal Chain: Escaping Forest and Fitting Worm

Zhipeng Deng

2026-08-04优化控制

本文针对三角形森林逃逸与 Moser worm 三角覆盖问题,动机是把以往主要依赖特殊几何构造的结果推广到任意三角形。核心做法是固定曲线、允许三角形平移旋转,用支撑函数约束建立等价的泛函最小化模型,并证明公式的等价性与收敛性。文中给出数值离散求解,报告了不同角度三角形下的曲线覆盖、逃逸路径及开闭折线变体结果,但实际最优性与数值增益幅度仍需结合实验细节判断。

Coordinate Optimality Reformulation for Mixed-Integer Convex Programs with Indicators Figure 1
2026-08-04math.OC

Coordinate Optimality Reformulation for Mixed-Integer Convex Programs with Indicators

Tong Xu, Salar Fattahi, Andrés Gómez, Simge Küçükyavuz

2026-08-04优化算法

针对带指示变量的混合整数凸优化中 big-M 形式松弛弱、分支定界需枚举大量无效激活模式的问题,论文提出 CORe:把单坐标激活/非激活的最优性比较转化为阈值、闭式和析取约束,在保持全局最优解的同时剪除不可能的模式。理论上给出星形、低维控制等结构下多项式节点界,实验显示在稀疏二次规划和鲁棒单指标模型中显著减少节点和求解时间,但文中也说明耦合过密时额外约束开销可能抵消收益。

A Geometric Inverse Source Problem for Stochastic Parabolic Equations Figure 1
2026-08-04math.OC

A Geometric Inverse Source Problem for Stochastic Parabolic Equations

Yunzhang Li, Qi Lü, Meizhi Qian, Yu Wang

2026-08-04优化控制

本文面向随机热传导等不确定环境下的源区定位问题,研究如何仅由部分边界通量同时识别抛物型随机方程中均值漂移源与随机扩散源的几何支撑。核心洞察是形状导数呈现双通道结构:伴随状态对应漂移界面,鞅项对应扩散界面。论文证明了唯一性、周长正则化目标的极小元存在性,并给出形状梯度重建算法,数值实验显示可区分两类源。

Rake-Compress Riccati Recursions for Parallel Scenario-Tree Model Predictive Control Figure 1
2026-08-04math.OC

Rake-Compress Riccati Recursions for Parallel Scenario-Tree Model Predictive Control

João Sousa-Pinto

2026-08-04规划控制

针对场景树MPC中传统树Riccati递推虽为线性工作量、但依赖链随树高增长而限制并行的问题,论文将rake-compress树收缩引入分支LQR/KKT求解:叶节点rake汇总到父节点, unary节点compress用条件二次值函数组合压缩路径,再反向恢复状态、控制和乘子。作者证明该过程与原KKT系统代数等价,在固定维度下每次求解保持O(N)工作与存储、O(log N) span,并用JAX实现、稠密KKT对比、加速器基准和不规则自动驾驶场景验证效果。

Symmetric Numerical Three-Dimensional Matching: Intractability and Inapproximability Figure 1
2026-08-04cs.CC

Symmetric Numerical Three-Dimensional Matching: Intractability and Inapproximability

Zhi-Long Chen (Smith School of Business, University of Maryland), Nicholas G. Hall (Fisher College of Business, The Ohio State University)

∗Smith School of Business, University of Maryland, ∗∗Fisher College of Business, The Ohio State University, labeled classes whose weight multisets are identical and one common

2026-08-04优化控制

本文研究三类物品权重多重集完全相同的对称数值三维匹配,动机是澄清这种边际对称是否会降低经典匹配难度。核心洞察是用端口、私有项、边着色和无进位混合基编码在对称实例中恢复非对称角色。结果证明 SN3DM 强 NP 完全,Max-SN3DM 无 PTAS 除非 P=NP,并通过 3-近似与 L-约化给出 APX 完全性。

Revisiting Decomposition-Invariant Conditional Gradient Methods for Polytopes Figure 1
2026-08-04math.OC

Revisiting Decomposition-Invariant Conditional Gradient Methods for Polytopes

Dan Garber

Technion - Israel Institute of Technology

2026-08-04优化算法

本文针对多面体约束凸优化中 Frank-Wolfe/条件梯度方法常受环境维度和显式顶点分解拖累的问题,重新分析 DICG 思路。核心是用分解不变的面约束线性优化与无参数步长规则,使收敛复杂度更多依赖最优面的维度而非整体维度;在 2-level 多面体给出线性收敛,在一般多面体的面二次增长条件下得到优于既有维度依赖界的迭代复杂度。

Resilient Consensus-Based Target Tracking under False Data Injection Attacks in Multi-Agent Networks Figure 1
2026-08-04eess.SY

Resilient Consensus-Based Target Tracking under False Data Injection Attacks in Multi-Agent Networks

Amir Ahmad Ghods, Mohammadreza Doostmohammadian

Faculty of Mechanical Engineering, Semnan University, Iran, agents to track moving targets in a scalable, robust, and real-time manner. However, node, and leads to poor scalability and security concerns. As a result, many researchers, ing agents. This structure improves system scalability and fault tolerance, and signifi-, reduce their scalability and make them vulnerable to both faults and intentional data cor-, resource-constrained networks and leave open the need for simpler, more scalable, and

2026-08-04视觉感知

针对多智能体目标跟踪在测量故障和虚假数据注入攻击下易被污染的问题,论文在基于共识的NCV跟踪框架中加入饱和滤波与基于创新阈值的动态检测隔离,使节点实时丢弃可疑观测。仿真显示,更高连通度和共识迭代可提升收敛与精度;在局部、协同和瞬时攻击下能识别受损节点,50%节点被协同攻击时相对基线将MSEE降低约65%。

Using Non-Lipschitz Signum-based Functions for Distributed Optimization and Machine Learning: Trade-off Between Con-vergence Rate and Optimality Gap Figure 1
2026-08-04eess.SY

Using Non-Lipschitz Signum-based Functions for Distributed Optimization and Machine Learning: Trade-off Between Con-vergence Rate and Optimality Gap

Mohammadreza Doostmohammadian, Amir Ahmad Ghods, Alireza Aghasi, Zulfiya R. Gabidullina, Hamid R. Rabiee

Faculty of Mechanical Engineering, Semnan University, Semnan, Iran, Department of Electrical Engineering and Computer Science, Oregon State University, Oregon, USA, Institute of Computational Mathematics and Information Technologies, Kazan Federal University, Russia, Computer Engineering Department, Sharif University of Technology, Tehran, Iran, erature [1-4]. Such algorithms are known to have many benefits in terms of scalability, nodes/agents, scalability (and resource utilization) by distributing the workload for large-

2026-08-04优化算法

面向分布式机器学习中线性一致性算法收敛偏慢的问题,论文考察在梯度跟踪式分布式回归中加入非 Lipschitz 的 signum 函数。核心洞察是这类项虽可加快有限/固定/预设时间收敛,但离散时间实现会产生抖振,带来稳态目标残差和最优性间隙;仿真显示速度提升需以较大最优性损失为代价。

Stable and Efficient One-Way Modelling of Convective Disturbances in Laminar Boundary Layers: OWNS-Summation Figure 1
2026-08-04math-ph

Stable and Efficient One-Way Modelling of Convective Disturbances in Laminar Boundary Layers: OWNS-Summation

Elliot J. Badcock, Shahid Mughal

Department of Mathematics, Imperial College London, South Kensington Campus, London, SW7 2AZ, United Kingdom

2026-08-04学习理论

本文面向层流边界层中对流扰动的一维下游推进计算:传统PSE受步长下限限制,OWNS-R又会随有理近似阶数增大而放大舍入误差。作者将同一谱投影近似改写为部分分式求和的OWNS-S,使各 resolvent 求解独立相加、可并行且避免乘性误差放大,并提出无需行进中做特征分解的贪心参数选择。结果显示该方法在不可压、超声速和跨声速边界层案例中保持稳定准确,尤其能连续穿越跨声速谱拓扑重组并达到PSE无法实现的流向分辨率。

Learning-Based Stochastic Optimal Control with Infinite-Horizon Probabilistic Constraints Figure 1
2026-08-04math.OC

Learning-Based Stochastic Optimal Control with Infinite-Horizon Probabilistic Constraints

Francesco Cordiano, Kanghui He, Bart De Schutter

2026-08-04规划控制优化算法

这篇论文针对无限时域随机最优控制中的联合机会约束难题:传统 MPC 或 Boole 不等式处理容易保守,且难保证闭环全路径安全概率。作者通过状态增广把问题改写为约束 MDP,并利用强对偶转成拉格朗日无约束形式,提出离线对偶上升与近似动态规划学习值函数。结果显示算法可收敛到可行且最优的确定性 Markov 策略,并在数值例子中相较在线预测控制降低计算量、提升性能;但实验规模有限,扩展性和近似误差界仍是未解决问题。

Call Window Scheduling for Freight Rail Engineers Figure 1
2026-08-04cs.CE

Call Window Scheduling for Freight Rail Engineers

Jia Guo, Jonathan F. Bard

2026-08-04优化控制

美国货运铁路长期依赖司机休息期外近似全天候待命,带来疲劳、安全与用工成本问题。本文把“可被呼叫开工的时间窗”形式化为受 HOS 法规约束的调度问题,并比较集合覆盖型整数规划与直接构造算法。两城、三城实验显示集合覆盖模型在需求覆盖指标上约为94.89%和91.09%,高于直接算法的93.96%和71.83%,同时减少延误、增加休息机会;关键敏感因素是可用司机上限。

Joint Optimization of Human Headcount and Stochastic AI Resource Capacity Figure 1
2026-08-04cs.SE

Joint Optimization of Human Headcount and Stochastic AI Resource Capacity

Marco Montes de Oca

EnFi, Inc.

2026-08-04优化算法

本文关注企业在固定预算下如何同时配置工程师人数与生成式 AI token 容量,以避免传统规划忽视 token 支出重尾波动和人工审核负担。其核心是把带认知摩擦的生产函数与机会约束随机预算前沿结合,并用 CLT 与 Cornish-Fisher 修正化简。主要结果显示,在波动外生时,token 波动上升会压缩人数、提高人均 token 强度;偏度则像纯预算损耗,但若波动随均值同比放大,结论可能反转。

Dynamic-Threshold Algorithms for the Continuous Quadratic Knapsack Problem: Reset Mechanisms and Complexity Figure 1
2026-08-04math.OC

Dynamic-Threshold Algorithms for the Continuous Quadratic Knapsack Problem: Reset Mechanisms and Complexity

Yong-Jin Liu, Peicheng Xie, Chuan Yang

2026-08-04优化控制

本文针对带加权等式约束的连续二次背包问题,动机是解释 Condat 动态阈值思想在加权情形下的重置与删除机制作用。核心贡献是提出 DTA 及无重置版 NDTA,证明终止性、正确性,并刻画重置何时不发生及最坏复杂度来源。结果显示二者虽均有二次最坏复杂度,但特定实例中 DTA 可线性而 NDTA 为二次;千万变量实验呈近线性 scaling,并快于多种基线。

Quantitative Particle Approximation for Controlled Nonlinear Filtering Figure 1
2026-08-04math.OC

Quantitative Particle Approximation for Controlled Nonlinear Filtering

Erhan Bayraktar, Ibrahim Ekren, Xihao He, Xin Zhang

3 3 Department of Mathematics, University of Southern California.

2026-08-04规划控制

本文动机是为部分观测随机控制中的非线性滤波,给出有限粒子近似在最优值函数层面的定量误差,而不只近似滤波过程本身。核心洞察是保留“全体粒子共用同一控制”的哈密顿量结构,在 Wasserstein HJB 上结合平移提升、Fourier-Wasserstein 卷积和一致粒子导数估计。主要结果是在光滑性、椭圆性和哈密顿量正则性条件下,给出随维度变化的显式收敛率。

Minimizers of one-dimensional regularization problems with linear and nonlinear total variation Figure 1
2026-08-04math.CA

Minimizers of one-dimensional regularization problems with linear and nonlinear total variation

Luca Lussardi, Marco Morandotti, Federico Stra

2026-08-04优化控制

本文从一维 ROF 型总变差正则化出发,研究何时观测数据本身就是能量最小解,以及最小解是否可含 Cantor 导数部分。核心洞察是端点处数据增长率与参数 p、γ 的阈值共同决定退化行为;线性总变差情形给出尖锐且互补的最小性/非最小性条件,并用 Cantor 阶梯给出正则性反例,非线性情形仅获部分类比结果,显示其局部截断行为带来新的障碍。

Grasp Execution Without a Planner: Configuration-Space Grasp Distance Fields with Certified Safety & Guaranteed Quality Figure 1
2026-08-04cs.RO

Grasp Execution Without a Planner: Configuration-Space Grasp Distance Fields with Certified Safety & Guaranteed Quality

Clinton Enwerem, John S. Baras, Calin Belta

The authors are with the Department of Electrical and Computer Engineering and the Institute for Systems Research (ISR), University of Maryland, College Park, MD, USA. Emails:

2026-08-04安全鲁棒

针对多指抓取执行中“先规划再跟踪”容易因物体位姿扰动失效并触发重规划的问题,本文把候选抓取集转成关节空间的平滑抓取距离场,用负梯度闭环直接趋近最近候选,并以 CBF-CLF QP 约束碰撞、工作空间和抓取质量。仿真中在固定臂和 Unitree G1 上完成 50 个物体中的 46 个抓取,成功案例保留中位 94% 合成质量裕度,QP 求解约 0.09 ms/步。

On the Iterate Convergence of AdaGrad for Generalized Smooth Convex Optimization Figure 1
2026-08-04math.OC

On the Iterate Convergence of AdaGrad for Generalized Smooth Convex Optimization

Mathieu Besançon, Tung Quoc Le

2026-08-04优化算法学习理论

该文针对 AdaGrad 在非全局光滑凸优化中是否能实现迭代点收敛这一基础问题,动机是迭代收敛比函数值或梯度范数收敛更能反映算法稳定性。核心创新是给出统一的充要条件,并将其用于 AdaNorm、AdaDiag、AdaFull:在广义 (L0,L1) 光滑下小常步长收敛,在多项式可修改光滑假设下任意学习率收敛,同时用反例说明仅有光滑性不足。

Source Reliability Weighted Observer Design for Open Client Server Networks Figure 1
2026-08-04math.OC

Source Reliability Weighted Observer Design for Open Client Server Networks

Amit Dutta, Marcos M. Vasconcelos, Olugbenga M. Anubi

2026-08-04优化控制

面向开放客户端—服务器感知网络中传感源间歇参与且身份可信性未知的问题,论文将状态估计表述为源有效性学习:用固定先验加权最小二乘作预测校正,并依据多次创新残差为每个源学习可靠性权重。仿真显示,全活跃观测器会受干扰源产生有限偏差,而该方法在有限学习期后区分有效源与干扰源,跟踪效果接近只使用真实传感源的 oracle。

Persistent Mean Tracking in Client--Server Open Networks Figure 1
2026-08-04math.OC

Persistent Mean Tracking in Client--Server Open Networks

Amit Dutta, Fat-Hy Omar Rajab, Marcos M. Vasconcelos, Olugbenga M. Anubi

2026-08-04视觉感知

针对开放式客户端-服务器网络中临时参与者会污染平均值的问题,论文将目标从全体活跃均值转为未知持久核心的活跃均值。核心做法是先用两层滑窗投票从二值活跃记录中识别持久代理,再用平滑滤波跟踪其均值;理论上给出异质伯努利参与下的有限窗口高概率分离界,并证明跟踪误差几何收缩到由漂移和增益决定的邻域,仿真用于验证效果。

Residual Centering and Error Bounds for Convex Approximation of Mixed-Integer Recourse Figure 1
2026-08-04math.OC

Residual Centering and Error Bounds for Convex Approximation of Mixed-Integer Recourse

Alban Kryeziu

Residual Centering and Error Bounds for Convex Approximation of, Faculty of Economics and Business, University of Groningen, pectation error. The central condition is coordinate slice-centering, under which integration, coordinate case is expressed through Vitali variation of the density. Exact centering, however, use commuting coordinate projectors to decompose an arbitrary residual into a centered compo-, residual error bounds, bounded variation, Vitali variation, slice-centering, max-affine fitting, Exact centered anisotropic TV∞bound, Exact centered mixed-derivative and Vitali bounds . . . . . . . . . . . . . . . . . . ., Exact centering and convex-approximation obstruction

2026-08-04优化算法学习理论

本文针对两阶段随机混合整数追索中常用凸近似的误差评估问题,指出真正影响一阶段决策的是带符号的期望残差而非逐点误差。核心洞察是用坐标切片居中刻画残差抵消机制,并在居中不可由凸性实现时引入投影分解显式计入切片均值缺陷。主要结果包括基于各向异性总变差、混合导数与 Vitali 变差的确定性误差界、尖锐常数、非光滑密度扩展,以及可审计的 max-affine 凸拟合框架。

Truncated Differentiation for Inverse Potential MFGs Figure 1
2026-08-04math.OC

Truncated Differentiation for Inverse Potential MFGs

Siting Liu, Yat Tin Chow, Samy Wu Fung

Department of Mathematics, University of California, Riverside, Riverside, CA. (, ), Department of Applied Mathematics and Statistics, Colorado School of Mines, Golden, CO.

2026-08-04优化控制

本文针对逆势均场博弈中需对大规模均衡求解器反向传播、存储和计算代价高的问题,提出只记录 PDHG 最后 r 步的 JFB 截断微分,并用度量 resolvent 视角解释其在局部固定活跃集下逼近隐式梯度。实验显示中等 r 可接近全展开恢复精度,同时显著降低内存和运行时间。

Fast Trainable Multilinear Bases for Image Compression Figure 1
2026-08-04eess.IV

Fast Trainable Multilinear Bases for Image Compression

Shiwen An, Zhongyi Ni, Huanhai Zhou, Jin-Guo Liu

Department of Information and Communication Engineering, Institute of Science Tokyo, Yokohama 226-8501, Japan, Center for Advanced Intelligence Project (AIP), RIKEN, Tokyo 103-0027, Japan, Thrust of Advanced Materials, The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, Guangdong 511453, China

2026-08-04视觉感知

针对DCT/FFT等固定变换难以适配不同图像分布、而深度自编码器参数开销过大的问题,本文把经典快速变换改写为保距张量网络,并在酉矩阵流形上训练少量参数化基,使其保持近线性计算、可逆和低参数量。实验显示,该方法在自然图像上基本追平DCT,在Quick Draw线稿上以相同重建质量约减少20%字节数,但作为离线按数据集训练的基设计工具,尚未形成完整可部署 codec。

2026-08-03

23 篇
Sign compression for Muon: SignMuon, MuonSign, and the Limits of Error Feedback Figure 1
2026-08-03math.OC

Sign compression for Muon: SignMuon, MuonSign, and the Limits of Error Feedback

Maria Smirnova, Alexey Kravatskiy

is error feedback, and for sign-after it is unavailable: applied

2026-08-03优化控制

本文面向分布式训练中 Muon 优化器通信开销过高的问题,系统考察将符号压缩放在 LMO 前、后或两侧的三种一比特方案。核心洞察是符号步和谱范数 LMO 各自可下降,但组合后不再保证下降;误差反馈只在压缩梯度侧可恢复理论收敛。实验却显示 sign-after 在 CIFAR-10、联邦训练和 nanoGPT 中最强,揭示理论最坏情形与实际表现的张力。

ArcLP: A Matlab implementation of an $\mathcal{O}(\sqrt{n}L)$ arc-search infeasible interior-point algorithm for linear programming Figure 1
2026-08-03math.OC

ArcLP: A Matlab implementation of an $\mathcal{O}(\sqrt{n}L)$ arc-search infeasible interior-point algorithm for linear programming

Yang, Yaguang

2026-08-03优化控制

线性规划求解中,常用 Mehrotra 预测校正内点法虽数值高效但缺乏收敛证明,本文动机是提供兼具理论保证和可用性的替代实现。ArcLP 将具有 O(√nL) 多项式界的弧搜索不可行内点算法落地为 Matlab 软件,并结合初始点选择、预处理、满秩化与 scaling 等策略。Netlib 基准测试显示其均找到最优解,并与 Mehrotra 方法相比具有竞争力;具体增益中算法本身与工程策略的贡献比例文中未充分说明。

Admissible Set for Linear Systems under Linear State Constraints Figure 1
2026-08-03math.OC

Admissible Set for Linear Systems under Linear State Constraints

Jean Lévine, Philipp Rumschinski, Franz Rußwurm, Stefan Streif

2026-08-03优化算法

针对线性连续时间系统在仿射状态约束下可容许初始集难以高维计算的问题,论文利用障碍理论和线性系统显式解,直接结构化采样可容许集边界,并按单个约束分别构造内多面体后求交,避免全状态网格和多约束交点处理。实验在三重积分器与高维弹簧阻尼链上展示了半空间表示的构造流程和一定可扩展性,但近似质量保证仍需进一步说明。

Convergence and Regret of the Policy Gradient for Multi-Armed Bandits in Diffusion Environment Figure 1
2026-08-03cs.LG

Convergence and Regret of the Policy Gradient for Multi-Armed Bandits in Diffusion Environment

Yanwei Jia, Du Ouyang

2026-08-03生成模型强化学习优化算法学习理论

本文关注扩散环境下多臂老虎机中策略梯度的理论行为,动机是弱信号连续时间奖励使噪声相对信号更强,传统分析较难处理。核心创新是为对应 SDE 构造新的 Lyapunov 函数,统一分析连续与离散时间、多臂情形。结果显示任意常数学习率下策略几乎必然收敛到最优臂;当学习率低于与臂数、均值差和波动率相关的阈值时,可得到有限时间 O(log T) 后悔上界。

The maximum number of Pareto eigenvalues of a real matrix of order four is 23 Figure 1
2026-08-03math.OC

The maximum number of Pareto eigenvalues of a real matrix of order four is 23

Samir Adly

2026-08-03优化控制

本文针对矩阵 Pareto 特征值数量上界长期停留在四阶情形 23 到 26 之间的问题,给出精确容量刻画。核心做法是把正正交补特征值问题转化为单纯形上的不动点计数,并结合三阶支撑型、行列式恒等式与扰动正则化排除 25 个值的可能。主要结果证明任意四阶实矩阵最多只有 23 个不同 Pareto 特征值,且显式矩阵达到该界。

Node-Wise Dynamic Optimal Control for Evolutionary Games on General Multilayer Networks Figure 1
2026-08-03math.OC

Node-Wise Dynamic Optimal Control for Evolutionary Games on General Multilayer Networks

Rio Aurachman, Giuliano Punzo

School of Industrial Engineering, Telkom University, Indonesia, School of Electrical and Electronic Engineering, University of Sheffield

2026-08-03规划控制

这篇论文针对网络演化博弈中合作易被背叛侵蚀、统一激励成本高的问题,研究一般多层网络上的动态最优激励。核心做法是用 HJB 推导解析反馈控制,把博弈交互层、策略扩散层和连续合作状态同时纳入节点级决策。结果显示最优激励不是全局奖励或惩罚,而会随节点位置和当前合作水平对不同节点同时给出奖励或惩罚,并通过数值实验验证了解析解。

Tube MPC for Bilinear Koopman Models using Robust Control Contraction Metrics Figure 1
2026-08-03math.OC

Tube MPC for Bilinear Koopman Models using Robust Control Contraction Metrics

Thomas de Jong, Mircea Lazar

2026-08-03规划控制安全鲁棒

针对数据驱动双线性 Koopman 模型在高维提升空间中难以做鲁棒 MPC、且模型失配会破坏约束与稳定性的难题,论文把离散鲁棒控制收缩度量引入管状 MPC,并用稀疏采样神经网络学习度量与反馈,结合 LPV 结构将固定调度下的预测问题凸化、将测地线计算转为二次规划。理论上给出递归可行、鲁棒约束满足和关于 Koopman 失配的 ISS 保证,并在状态相关输入增益摆系统上验证。

Physics Matters in PnP: Recovery Guarantees with the MMSE and NN Denoisers Figure 1
2026-08-03math.OC

Physics Matters in PnP: Recovery Guarantees with the MMSE and NN Denoisers

Tobias Wolf, Jalal Fadili, Jin Guo, Roy Y. He

2026-08-03优化控制

本文针对线性病态逆问题中 PnP 方法虽常用学习去噪器、但恢复保证不足且容易忽略前向物理模型的问题,分析带 MMSE 去噪器的前向-后向分裂迭代。核心洞察是去噪噪声协方差必须与观测噪声和算子耦合,不能物理无关地选取;论文在非对角及退化高斯噪声下给出点态和 Wasserstein 分布层面的恢复界,并扩展到神经网络参数化 MMSE 去噪器。

Robust mean field control: an application to optimal execution under composite uncertainty Figure 1
2026-08-03math.OC

Robust mean field control: an application to optimal execution under composite uncertainty

Huafu Liao, Shuhui Liu, Chenchen Mou, Defeng Sun

2026-08-03规划控制安全鲁棒

本文面向大额交易中价格冲击、随机过程与确定性参数同时不确定的问题,构建鲁棒均值场控制框架。核心创新是把头寸与交易速率的联合分布非线性纳入 Hamiltonian,并在测度变量 HJBI 方程中处理复合不确定性。主要结果包括验证定理、非凸非凹情形下适定性估计,以及受约束多维线性二次清算问题的显式求解。

End-to-End Fairness Optimization with Fair Decision-Focused Learning Figure 1
2026-08-03cs.LG

End-to-End Fairness Optimization with Fair Decision-Focused Learning

Yu Wang, Violet (Xinying) Chen

School of Business, Stevens Institute of Technology

2026-08-03优化算法

本文针对预测模型参与资源分配时“预测公平”和“决策公平”可能相互错位的问题,提出端到端公平优化框架 E2EFO 与公平决策聚焦学习 FDFL,将预测误差、群体误差差异和决策 regret 联合训练,并给出单预算情形的闭式决策雅可比及一般凸约束的可微优化层做法。医疗资源与合成多资源实验显示,联合考虑两类公平通常优于只做预测公平或只做公平优化。

When does admission control reduce congestion? A stochastic ordering approach Figure 1
2026-08-03math.OC

When does admission control reduce congestion? A stochastic ordering approach

Royi Jacobovic, Daniel Stiebel

2026-08-03规划控制

本文针对带状态依赖用户行为的服务系统,质疑“限制接入必然降低拥塞”的常见假设。核心洞察是将工作量过程作随机序比较,显式刻画准入控制改变系统状态后对未来到达的反馈影响。结果表明,准入控制可因吸引后续客户而反增拥塞;但当客户类型与服务需求独立时,可在初始忙期恢复工作量随机占优,从而给出其有效性的结构条件。

Extrapolation-based Direct Search for Nonsmooth Stochastic Zeroth-Order Optimization Figure 1
2026-08-03math.OC

Extrapolation-based Direct Search for Nonsmooth Stochastic Zeroth-Order Optimization

Anthony Palmieri, Francesco Rinaldi, Sara Shashaani

Edward P. Fitts Department of Industrial and System Engineering, North Carolina State University, Raleigh, NC, USA

2026-08-03优化算法

针对只能获得噪声函数值、且目标可能非光滑的零阶优化问题,本文提出 DSE:用随机轮询方向结合带外推的随机充分下降线搜索。核心在于以 Clarke/Goldstein 非光滑工具、超鞅停止时分析和球冠概率替代梯度下降论证,证明几乎必然收敛到 Clarke 驻点,并给出达到 Goldstein 驻点的期望迭代与测试点复杂度界;DFO 基准实验显示其相对 SDS、StoMADS 等方法有竞争力。

Rational Jacobi Rotations and the Complexity of Approximating Mixed Integer Quadratic Programming Figure 1
2026-08-03math.OC

Rational Jacobi Rotations and the Complexity of Approximating Mixed Integer Quadratic Programming

Alberto Del Pia

Department of Industrial and Systems Engineering & Wisconsin Institute for Discovery, University of Wisconsin-Madison, Madison, WI, USA.

2026-08-03优化控制

针对非凸混合整数二次规划在图灵机模型下难以近似的问题,论文指出复杂性关键由整数变量数和 Hessian 负特征值数共同决定。核心创新是用有理 Jacobi 旋转实现近似可分离且保持惯性的同时对角化,避免经典方法中的无理基变换。主要结果是在这两个参数固定、目标有下界时,给出关于输入规模和 1/ε 多项式时间的 ε 近似算法,并说明这些限制在 P≠NP 下基本必要。

Volume of quasi-homogeneous sublevel sets: Two linear algebra deterministic algorithms with convergence rates Figure 1
2026-08-03math.OC

Volume of quasi-homogeneous sublevel sets: Two linear algebra deterministic algorithms with convergence rates

Didier Henrion (LAAS-POP), Jean B Lasserre (TSE-R, LAAS-POP)

∗LAAS-CNRS, University of Toulouse, France and Faculty of Electrical Engineering, Czech Technical University in

2026-08-03学习理论

论文针对多项式次水平集体积计算中非凸几何与维度灾难的问题,利用准齐次结构将高维体积推到一维矩问题,并用 Chebyshev 近似与广义特征值两种线性代数算法替代 SDP。结果给出可认证上下界:Cheb 达到 O(1/r) 收敛,Gevp 达到指数收敛,且这些速率可转移到 moment-SOS 体积层级。

Robust Airfoil Design Optimization via a Bilevel Model-Based Methodology Figure 1
2026-08-03math.OC

Robust Airfoil Design Optimization via a Bilevel Model-Based Methodology

Alpaslan Kurt, Dilara Buk, Yusuf Yazicioglu, Figen Oztoprak, Onur Son, Gorkem Demir

Gebze Technical University, Industrial Engineering Department, Kocaeli, Turkey, Gebze Technical University, Aeronautical Engineering Department, Kocaeli, Turkey

2026-08-03优化算法安全鲁棒

本文面向气动外形鲁棒优化中 CFD 评估昂贵、工况不确定且鲁棒目标/约束无解析形式的问题,提出 GLORO 双层模型方法:下层用贝叶斯优化和高斯过程在不确定参数空间近似鲁棒评估,上层用设计空间局部模型做无导数优化。RAE 2822 翼型实验表明,该方法可在马赫数和攻角扰动下提升升阻比鲁棒性并减少仿真开销,但具体增益相对各模块的来源文中未充分说明。

Anisotropic Higher-Order Semiregularity of Degenerate Generalized Equations Figure 1
2026-08-03math.OC

Anisotropic Higher-Order Semiregularity of Degenerate Generalized Equations

Tomáš Roubal

Institute of Information Theory and Automation, Czech Academy of

2026-08-03优化控制

本文针对退化点上一阶导数不满秩时逆估计失效的问题,研究高阶导数如何按目标空间不同分块补足方向。核心做法是建立三角化、各向异性的高阶半正则框架,用分块尺度而非单一 Hölder 阶描述误差。主要结果给出光滑映射的固定基点覆盖与逆估计,并将其通过凸过程内逼近推广到广义方程。

Newton Method for Fixed-Support Doubly Entropic Wasserstein Barycenter Figure 1
2026-08-03math.OC

Newton Method for Fixed-Support Doubly Entropic Wasserstein Barycenter

Jianting Pan, Sirong Dai, Lei Yang, Yaomin Wang, Ji'an Li, Ming Yan

The Chinese University of Hong Kong, Shenzhen, Sun Yat-sen University

2026-08-03优化控制

针对小正则化下固定支撑 Wasserstein 重心求解中一阶 Sinkhorn/Bregman 方法迭代慢、难以高精度保持几何结构的问题,论文将双熵正则模型经半对偶改写为光滑无约束凸优化,推导显式梯度与 Hessian,并提出精确 Newton 及稀疏 Newton,通过稀疏化传输概率矩阵降低 Hessian-vector 乘法成本。理论给出 Hessian 近似界和收敛性,实验显示稀疏版本在合成与真实数据上较代表性求解器收敛更快且保持精度。

Baseball, An Extensive-Form Game-Theoretic Duel Figure 1
2026-08-03math.OC

Baseball, An Extensive-Form Game-Theoretic Duel

Sebastian E. Ferrando, Eli Kohn

Department of Mathematics, Toronto Metropolitan University, Toronto, Canada, Department of Mathematics and Statistics, McGill University, Montreal, Canada

2026-08-03优化控制

本文动机是弥补以往将投打对决拆成单次投球矩阵博弈的不足,把完整打席建模为带机会节点和不完美信息的零和扩展式博弈。核心创新在于用序列式线性规划精确求解全树均衡,并证明在状态马尔可夫假设下可对12个非终止球数做后向归纳。结果给出均衡策略、延续价值,以及衡量非最优投打选择代价的条件和到达概率加权杠杆指标。

On the Oja-Flow-Based Low-Rank Approximation of Kalman-Bucy Filters for Linear Time-Varying Systems Figure 1
2026-08-03eess.SY

On the Oja-Flow-Based Low-Rank Approximation of Kalman-Bucy Filters for Linear Time-Varying Systems

Kentaro Ohki

2026-08-03生成模型

针对高维线性时变系统中 Kalman-Bucy 滤波需反复求解 Riccati 方程的计算瓶颈,论文从 Oja 主成分流的时变子空间跟踪性质入手,指出低秩滤波不必依赖完美跟踪,而可通过调节流参数使解保持在主导子空间邻域内;在较强的光滑、有界和特征结构假设下给出理论误差界,并用数值实验验证趋势,但实际滤波精度分析仍留待未来工作。

A Policy Iteration Scheme for Semilinear Stochastic Hamilton-Jacobi-Bellman Equations with Exponential Convergence Figure 1
2026-08-03math.OC

A Policy Iteration Scheme for Semilinear Stochastic Hamilton-Jacobi-Bellman Equations with Exponential Convergence

Hasib Uddin Molla, Jinniao Qiu

Hasib Uddin Molla 2 2 2 Department of Mathematics & Statistics, University of Calgary, 2500 University Drive NW, Calgary, AB T2N 1N4, Canada. E-mail :, Jinniao Qiu 2 2 2 Department of Mathematics & Statistics, University of Calgary, 2500 University Drive NW, Calgary, AB T2N 1N4, Canada. E-mail :

2026-08-03强化学习学习理论

针对随机系数下非马尔可夫最优控制中 SHJB 方程难求解的问题,本文把半线性随机 HJB 方程通过策略改进转化为一列线性 BSPDE,类似随机版 Howard 迭代。主要结果证明迭代值函数以均方意义单调逼近真实值函数,并具有指数收敛率;数值实现与高维稳定性仍文中未充分说明。

Global and local error bounds: characterizations via directional derivatives and tangent cones Figure 1
2026-08-03math.OC

Global and local error bounds: characterizations via directional derivatives and tangent cones

Yu Han

School of Statistics and Data Science, Jiangxi University of Finance and Economics

2026-08-03学习理论

误差界用于把残差量化为到解集的距离,是优化算法收敛、稳定性和约束资格分析的基础。本文的核心洞察是用方向导数与切锥给出更几何化的刻画,并尽量摆脱凸性假设:证明全局误差界与统一下降、全局斜率正下界及若干扰动/子水平集稳定性等价;对 Lipschitz 情形给出方向导数充分条件,凸情形下亦为必要;有限维局部情形还给出最优常数 1/φ(x̄) 及失效判据。

Latent Lie-Poisson Neural Networks (LLPNNs): Discovering the motion of Lie-Poisson systems through observable data and latent dynamics Figure 1
2026-08-03cs.LG

Latent Lie-Poisson Neural Networks (LLPNNs): Discovering the motion of Lie-Poisson systems through observable data and latent dynamics

Vakhtang Putkaradze

2026-08-03优化控制

针对机器人与控制中的对称约化哈密顿系统常只能观测位姿、速度而动量/协态隐藏的问题,LLPNN用Noether不变量构造潜在轨迹,并结合Hamiltonian解码或伪Lagrangian编码与Magnus Lie群更新,保持Lie-Poisson结构。刚体、水下航行器和多车最优控制实验显示其长时预测准确、抗噪,并可用较小数据和轻量网络训练。

Adaptivity via a Parallel Architecture for Stochastic Gradient Methods Adaptivity via a Parallel Architecture for Stochastic Gradient Methods Adaptivity via a Parallel Architecture for Stochastic Gradient Methods Figure 1
2026-08-03cs.LG

Adaptivity via a Parallel Architecture for Stochastic Gradient Methods Adaptivity via a Parallel Architecture for Stochastic Gradient Methods Adaptivity via a Parallel Architecture for Stochastic Gradient Methods

Bin Fu

University of Texas Rio Grande Valley

2026-08-03优化算法

这篇论文针对静态 SGD 需要预先知道平滑常数、噪声水平等参数才能选迭代预算的问题,提出用 p 个处理器按几何序列并行试探不同 T,把静态方法包装成自适应框架。核心结果是给出近乎紧的 (p, αp) 近似保证,并证明在非凸随机优化中仍可达到 O(1/√T) 收敛;同时用二进制移位替代除法/开方,强调硬件实现潜力。

2026-07-31

24 篇
The Complexity of Kemeny Aggregation with Three Rankings Figure 1
2026-07-31cs.GT

The Complexity of Kemeny Aggregation with Three Rankings

Péter Madarasi

HUN-REN Alfréd Rényi Institute of Mathematics, Reáltanoda u. 13–15., Budapest H-1053, Hungary

2026-07-31优化控制

本文针对固定输入排名数下 Kemeny 排序聚合复杂性仍未闭合的问题,重点解决长期悬而未决的三排名情形。核心洞察是构造从 4-正则图 Max-Cut 到三条无权全排名的精细归约,即使每对候选都按 2:1 分裂仍保持困难。结果证明 Kemeny Score 为 NP 完全,相关胜者、先后关系与共识识别问题分别达到 Θ2^p 完全或 coNP 完全,并给出按 pairwise support 划分的尖锐二分分类,同时扩展到 Slater、排列中位数和 Mallows 中心排名。

Beyond Hand-Derived Inequalities: Decision Diagrams for Cut Generation in Binary Polynomial Optimization Figure 1
2026-07-31math.OC

Beyond Hand-Derived Inequalities: Decision Diagrams for Cut Generation in Binary Polynomial Optimization

Martin Cooper, Margarita Castro

2026-07-31优化算法

针对二进制多项式优化中割平面长期依赖手工识别特定超图结构的问题,论文用决策图为任意局部支撑自动分离并提升面定义割,并提出只显式表示顶点、在状态中隐式编码超边的紧凑表示。该框架还给出扩展 formulation、宽度刻画和 facet 证书;在 LABS 与 VISION 基准上,扩展/分区支撑以更少割关闭更多根节点 gap,并加速分支定界。

Eventually greedy best Egyptian underapproximations of rational numbers via optimal control Figure 1
2026-07-31math.NT

Eventually greedy best Egyptian underapproximations of rational numbers via optimal control

Vjekoslav Kovač, Quanyu Tang

University of Zagreb Faculty of Science, Department of Mathematics, Bijenička cesta 30, 10000 Zagreb, Croatia, School of Mathematical Sciences, University of Science and Technology of China, Hefei 230026, P. R. China

2026-07-31规划控制

本文针对埃及分数中“最佳下逼近是否最终由贪心选择产生”的 Erdős-Graham/Nathanson 问题,动机是理解有理数单位分数逼近的长期结构。核心做法是把静态极值问题改写为受控动力系统,借助收益函数与 Bellman 函数分析剩余量演化。主要结果证明每个正有理数在允许重复分母和要求分母互异两种情形下,都具有最终贪心的最佳埃及下逼近,并给出分母渐近增长及一个无理数构造的应用。

Exact and Approximate Solvability of Systems Involving Proximity Operators in Hilbert Spaces Figure 1
2026-07-31math.OC

Exact and Approximate Solvability of Systems Involving Proximity Operators in Hilbert Spaces

Mark Allien D. Roble

2026-07-31优化控制

本文动机是将凸可行性中的投影方程推广到更一般的邻近算子系统,以处理优化与逆问题中的多约束一致性。核心创新是提出逆邻近性质(IPP),把 IBAP 从闭线性子空间扩展到凸函数框架,并用次微分与邻近映射刻画可解性。主要结果给出精确解唯一性、近似解存在的充要条件,以及在可行性和信号恢复问题中的应用。

No-gap second-order conditions for optimization problems involving transport distances Figure 1
2026-07-31math.OC

No-gap second-order conditions for optimization problems involving transport distances

Nicolas Borchard, Christian Meyer, Gerd Wachsmuth

2026-07-31优化算法

本文针对测度空间优化中用输运距离替代 Radon 范数作正则化时二阶理论缺失的问题,研究其无间隙二阶最优性条件。核心做法是把问题嵌入 C1 空间对偶,借助输运距离的预共轭和 Kantorovich 势的假设,验证非退化条件并显式计算弱星二阶次导数。主要结果是给出与局部二次增长等价的二阶条件,证明弱星 epi 可微性,并将框架应用到测度值最优控制问题。

The optimality of an (s, S) hiring policy on a workforce planning problem with fixed recruitment costs and binomial turnover Figure 1
2026-07-31math.OC

The optimality of an (s, S) hiring policy on a workforce planning problem with fixed recruitment costs and binomial turnover

Zhen Chen, Roberto Rossi, Belen Martin-Barragan, S. Armagan Tarim

Business School, Brunel University London, Uxbridge UB8 3PH, United Kingdom, Business School, University of Edinburgh, Edinburgh EH8 9JS, United Kingdom, Institute Of Informatics, Hacettepe University, Ankara 06800, Turkey

2026-07-31强化学习规划控制

本文针对人员流失随机、招聘存在固定启动成本时企业为何应批量补员的问题,建立有限期随机动态规划。核心洞察是二项流失虽使转移概率依赖招聘后人数,但仍可通过 Binomial-K-凸性保持 Bellman 函数结构,从而证明每期最优策略为低于 s 才招至 S 的 (s,S) 规则;MILP 近似能较快计算阈值且最优性差距较小。

On Leader Selection for Strong Structural Controllability in Matrix-Weighted Networks Figure 1
2026-07-31math.OC

On Leader Selection for Strong Structural Controllability in Matrix-Weighted Networks

Lanhao Zhao

2026-07-31规划控制

针对矩阵加权多智能体网络中领导者选择仍依赖组合搜索的问题,论文把强结构可控性失效归结为维度可达性隔离与拓扑对称等价两类瓶颈,并提出先做基投影可达根识别、再用 GWLS、SBM、PEM 破除对称的两阶段框架。数值算例显示三类算法可在不同稀疏性和对称结构下选出较小领导者集,但全局最优性与复杂度权衡仍依赖拓扑条件。

Multi-Asset Utility Maximization with Jump Signals Figure 1
2026-07-31math.OC

Multi-Asset Utility Maximization with Jump Signals

Sigui Brice Dro (SU)

2026-07-31优化控制

本文面向含跳跃信号的多资产 Merton 投资问题,动机是把单资产或特定效用下的跳扩散最优投资推广到相关布朗运动、多资产和异质信号场景。核心做法是用鞅最优性原理推导带跳 BSDE,并针对指数、幂和对数效用刻画价值函数与最优策略;主要结果包括相关 BSDE 解的存在唯一性证明、异质信号到共同信号框架的化约,以及两资产高斯信号数值例显示信号越可靠期望效用越高。

Global exponential turnpike properties for optimal control of the viscous Burgers equation Figure 1
2026-07-31math.OC

Global exponential turnpike properties for optimal control of the viscous Burgers equation

Emmanuel Trélat (LJLL (UMR\_7598), CaGE), Xingwu Zeng, Can Zhang

aSorbonne Université, CNRS, Université Paris Cité, Inria, Laboratoire Jacques-Louis Lions, F-75005 Paris, bSchool of Mathematics and Statistics, Wuhan University, Wuhan 430072, China., Most of the available results concern linear problems, especially of LQ type.

2026-07-31规划控制

本文关注长时域最优控制中非线性 Burgers 方程的“turnpike”现象,即最优轨迹为何会在大部分时间贴近某个周期或稳态参考。核心洞察是把局部指数 turnpike、严格凸性与周期 Riccati 理论,同抛物耗散带来的统一吸收时间结合起来。主要结果是在周期跟踪目标足够小时,对任意初值证明全局指数收敛到唯一周期最优解;零目标时则全局收敛到原点且不要求初值小。

A Stochastic Optimization Framework for RIS-Aided Wireless Network Design Figure 1
2026-07-31eess.SP

A Stochastic Optimization Framework for RIS-Aided Wireless Network Design

Davide Gagliardi, Alessio Zappone, Domenico Ciuonzo, Marco Di Renzo

2026-07-31优化算法

面向大规模 RIS/超表面设计中散射系数优化维度高、非凸且需频繁更新的问题,本文把蒙特卡洛优化引入连续域,构造连续交叉熵与 Metropolis-Hastings 框架,并可通过松弛投影处理离散相位。其关键价值在于绕开梯度和凸化子问题,同时给出收敛与复杂度分析;在近无源 RIS 速率最大化和有源 RIS 能效最大化中,性能达到或优于确定性基线,代表场景运行时间最高约降至十分之一。

Generalization Bounds on Optimal Control for Transformer Training and Wasserstein Distributional Robustness Figure 1
2026-07-31cs.LG

Generalization Bounds on Optimal Control for Transformer Training and Wasserstein Distributional Robustness

Kağan Akman, Naci Saldi, Serdar Yüksel

Department of Mathematics, Bilkent University, 06800, Ankara, Department of Mathematics and Statistics, Queen’s University, Kingston, K7L 3N8, Ontario, Canada ()

2026-07-31规划控制学习理论安全鲁棒

本文关注 Transformer 在有限训练样本下从经验数据迁移到真实数据分布时的泛化误差,动机是 token 动态依赖整段序列经验测度,传统假设类容量分析难以刻画。核心做法是把训练表述为双重提升的测度值有限时域控制问题,并通过状态、动作和测度空间量化得到可用动态规划求解的有限 MDP。主要结果是给出显式有限样本 excess-risk 界,将量化模型界转移到原模型并计入近似误差,同时证明 Wasserstein 分布鲁棒控制下的鲁棒极小解存在且共享相同量级的泛化上界。

OptGraph: Large Language Models Enhanced Evolutionary Optimization Via Graph Retrieval-Augmented Generation Figure 1
2026-07-31math.OC

OptGraph: Large Language Models Enhanced Evolutionary Optimization Via Graph Retrieval-Augmented Generation

Xianchao Xiu, Jianhao Li, Huangyue Chen, Wanquan Liu

2026-07-31优化算法

这篇论文针对LLM自动优化建模中模式复用弱、错误修复依赖临时提示、朴素RAG检索不稳的问题,提出OptGraph:把建模模式、形式化、代码实现和纠错经验组织成异构图,并在推理中利用图邻域提供结构化上下文,结合验证反馈迭代修复和非参数更新。实验称其在基准上较最强提示式框架平均精确率提升8.9%,但增益对检索质量、验证器和任务分布的依赖仍需进一步拆解。

The Existence and Stability of Generalized Multi-Source Weber Problems Figure 1
2026-07-31math.OC

The Existence and Stability of Generalized Multi-Source Weber Problems

V. S. T. Long, N. M. Nam, T. H. Tai, C. Tammer

2026-07-31优化控制

本文针对传统多源 Weber 问题在非凸、非光滑及目标可为集合时缺少系统存在性与扰动分析的问题,以最小时间函数替代欧氏距离来统一建模广义位置优化。核心洞察是把动态集诱导的广义距离纳入多源选址框架,并用集值分析刻画解映射。主要结果包括全局与局部最优解的存在性、解集闭性/紧性/有界性条件,以及目标集扰动下目标函数、最优值函数的 Lipschitz 连续性和解映射半连续稳定性。

Branching out: Prognostics-Based Replacement Policies for Series Systems Figure 1
2026-07-31math.OC

Branching out: Prognostics-Based Replacement Policies for Series Systems

Daniel Koutas, Daniel Straub

2026-07-31优化控制

本文针对多组件串联系统中预测性维护难以兼顾成本、可解释性与小样本稳健性的问题,提出由组件级 RUL 分布驱动的一步决策树启发式策略,将各维护选项的后果概率、直接替换成本与更新奖励过程的长期成本率一起纳入决策。数值仿真显示,在2组件系统上相较优化基线最高可降低约35%的长期单位时间成本,并表现出较高计算效率和抗过拟合能力。

On the Strong Structural Controllability of Matrix-Weighted Networks Figure 1
2026-07-31eess.SY

On the Strong Structural Controllability of Matrix-Weighted Networks

Lanhao Zhao

2026-07-31规划控制

本文针对多维矩阵加权多智能体网络中强结构可控性不再适合二值判定、且奇异/非对称耦合会使传统分区与距离界过松的问题,提出基于矩阵空间基分解的分层标量网络表示,并结合广义等价分区、层特定距离分区和零空间投影选择最优基。主要结果是给出SSCS上下界更紧的夹逼定理,证明最优基几乎处处存在,并用多层WL细化实现多项式时间自动发现,同时扩展到结构可观测性与不变不可控子空间分析。

A Varifold-Based Score for Decoupling Deformations in Shape Analysis Figure 1
2026-07-31math.DG

A Varifold-Based Score for Decoupling Deformations in Shape Analysis

Rayane Mouhli (MAP5 - UMR 8145, LJLL (UMR\_7598), CaGE), Barbara Gris (LJLL (UMR\_7598), Irène Kaltenmark (MAP5 - UMR 8145)

2026-07-31优化控制

本文针对多组件形状配准中高维非结构化微分同胚容易“吸收”旋转、缩放等低维结构运动的问题,提出基于 varifold 一阶变分的 coupling score,用几何支撑上的无参数化 infinitesimal action 来衡量一种向量场作用能否被另一子空间复现。该分数被加入 LDDMM 优化作为惩罚项,实验显示可解耦变形、强制或抑制特定运动,并用于带方向先验的复杂匹配修正。

Chance-Constrained Nonlinear Covariance Control via Robust Linearization Remainder Bounds Figure 1
2026-07-31eess.SY

Chance-Constrained Nonlinear Covariance Control via Robust Linearization Remainder Bounds

Man Jun Koh, Hyochoong Bang, SooJean Han

2026-07-31规划控制学习理论安全鲁棒

本文针对非线性协方差控制中一阶线性化忽略泰勒余项、易低估状态离散并导致机会约束失效的问题,提出离散时间SCP框架,将余项建模为有界不确定块,并用基于Petersen引理的鲁棒S-LMI传播二阶矩上界。仿真中S-LMI在相近控制能量下将最大违约率从iCS的40.3%降至0.04%,界紧度约1.01倍。

Towards joint scaling laws with optimal batch size schedules Figure 1
2026-07-31cs.LG

Towards joint scaling laws with optimal batch size schedules

Jiaxiang Li, Zhiqi Bu, Shiyun Xu

2026-07-31优化控制

本文针对大模型训练中批大小通常固定、与学习率调度缺少联合刻画的问题,从随机凸优化视角建立由学习率序列和批大小序列预测损失的形式化模型,并推导给定学习率下的闭式最优批大小调度。实验覆盖 Llama3、Qwen3 MoE 和视觉语言模型,显示动态批大小在固定计算下优于静态基线,报告约 6%–15% 计算效率提升,但结论仍依赖凸优化近似对深度网络训练动态的解释力。

Structural Averaged Controllability for Linear Ensemble Systems: Multi-input Case Figure 1
2026-07-31eess.SY

Structural Averaged Controllability for Linear Ensemble Systems: Multi-input Case

Amirreza Neshaei Moghaddam, Xudong Chen, Bahman Gharesifard

Department of Electrical and Computer Engineering, University of California, Los Angeles, Department of Electrical and Systems Engineering, Washington University in St. Louis, Department of Mathematics and Statistics, Queen’s University, Canada

2026-07-31规划控制

本文面向参数不确定或大规模个体共享同一输入时,强集群可控性难以满足的问题,研究多输入线性集群系统的结构平均可控性。核心洞察是把判定归结到有向图的 core:除可达性外,core 的行饱和匹配存在性构成充要条件。论文给出完整多输入刻画,并构造新的边权赋值算法,将此前单输入结果推广到一般多输入情形。

Strategies for Milestone-driven Start-ups in Multi-activity Settings Figure 1
2026-07-31cs.LG

Strategies for Milestone-driven Start-ups in Multi-activity Settings

Zhengli Wang

instance, Slack is a team collaboration and communication tool that enables users to

2026-07-31优化控制

本文关注创业公司在里程碑融资下如何在多种有成本、风险不同的活动间切换,以提高触达目标而非失败退出的期望收益。核心洞察是用漂移/波动与漂移/成本两个充分统计量构造有效前沿,并显式刻画多控制随机控制问题的区间型最优策略。结果显示,边界距离不同会产生两类有效前沿:目标较近时随状态提高转向更高风险且更高成本效率的活动,目标较远时则转向更低风险且更高成本效率的活动,且最优策略可显著优于只选最高成本效率活动的短视策略。

Identifying common backbones of interactions underlying food webs via non-deterministic alignments Figure 1
2026-07-31q-bio.PE

Identifying common backbones of interactions underlying food webs via non-deterministic alignments

Yifan Xu, Carlos Taveras, Lydia Beaudrot, César A. Uribe

2026-07-31强化学习

气候变化会重组物种分布与捕食关系,传统食物网比对又受限于慢速的一对一匹配。本文把基于网络 motif 的物种角色相似性放入类 Gromov-Wasserstein 的非确定性最优传输框架,允许多对多角色重叠,并用 KL 近端与 Dykstra 约束求解。在撒哈拉以南 129 个哺乳动物食物网实验中,得到的共同骨架比零模型具有更高连通性和传递性,显示其可能捕捉到跨生态系统稳定的相互作用结构。

Entropy-Smooth Convex Optimization Cannot Be Accelerated Figure 1
2026-07-31math.OC

Entropy-Smooth Convex Optimization Cannot Be Accelerated

Jacob M. Aguirre, Dmitrii M. Ostrovskii

Georgia Institute of Technology, H. Milton Stewart School of Industrial and Systems Engineering (ISyE), Atlanta, USA.

2026-07-31优化算法

本文针对相对负熵光滑的单纯形凸优化,回应镜像下降能否像传统光滑凸优化那样被 Nesterov 加速的问题。核心洞察是构造非病态熵 prox 下的一阶复杂度下界,证明当维度 d=Ω(T²) 时任意一阶方法误差仍有 Ω(L/T),因此镜像下降在该类问题中至多差对数因子已基本最优,并将同类结论扩展到 von Neumann 熵的量子谱单纯形情形。

Expected Survival-Time Bounds for Robust Optimization Over Time under Isotropic Gaussian Dynamics Figure 1
2026-07-31stat.ML

Expected Survival-Time Bounds for Robust Optimization Over Time under Isotropic Gaussian Dynamics

Pavel Novoa-Hernández

2026-07-31优化算法学习理论三维安全鲁棒

这篇论文针对动态优化中频繁重部署成本高、但“已部署解还能撑多久”缺少理论刻画的问题,不提出新算法,而把 ROOT 的生存时间建模为各向同性高斯随机游走下的离散首次越界问题。核心结果是给出期望生存时间的严格下界和可计算多步上界,证明慢变环境中随 σ^{-2} 缩放、高维时趋近一次变化,并用 Monte Carlo 验证其可用于判断部署期限是否可保证或排除。

Minimal Fillings of Finite Metric Spaces and Convex Polyhedra Figure 1
2026-07-31math.MG

Minimal Fillings of Finite Metric Spaces and Convex Polyhedra

A.O. Ivanov, A.A. Tuzhilin

2026-07-31优化算法

本文面向有限度量空间最小填充这一最优连接问题,试图减少在所有二叉树填充类型上求解线性规划时的组合复杂度。核心洞察是把每个树型对应的对偶可行域视为凸多面体,并研究不同树型多面体顶点的全局几何关系。主要结果证明,所有树型的多面体顶点并集恰好构成其凸包的顶点集,从而为统一枚举极值候选和理解多巡游公式提供结构性基础。

2026-07-30

26 篇
Field Codes for Distributed Coupling Samplers and Certified Empirical Transport Figure 1
2026-07-30cs.CC

Field Codes for Distributed Coupling Samplers and Certified Empirical Transport

Hung Mai, Hai Nguyen, Luong Doan, Ngoc Vu, Khanh Nguyen, Nhung Duong, Tuan Do

B0Labs, N2TP Technology, National Economics University, Vietnam, Nanyang Technological University, Phenikaa University, Vietnam, the right communicated object whenever a field code is available, primarily as a

2026-07-30优化控制

本文从分布式经验最优传输出发,关注源样本与目标样本分属两方时如何通信才能构造耦合,而不只是估计 Wasserstein 距离。核心洞察是把低复杂度传输场作为主要通信对象,再用稀疏残差目标格计数补齐精确边缘。论文给出 field-code compiler,可得到带标量证书的精确边缘采样器,并证明带证书输出在光滑映射族上仍有通信下界;实验显示场摘要在匹配比特预算下优于计数和原型摘要。

Parameter-Free Dynamic Regret for Online Convex Optimization under Heavy-Tailed Noise Figure 1
2026-07-30cs.LG

Parameter-Free Dynamic Regret for Online Convex Optimization under Heavy-Tailed Noise

Vaneet Aggarwal

2026-07-30优化算法学习理论

论文针对非平稳在线凸优化中随机梯度呈重尾分布、传统动态遗憾分析依赖有限方差的问题,提出无需预知 Lipschitz 常数、噪声水平、尾指数或路径长度的 HT-PAder。核心做法是用重启 AdaGrad 专家覆盖不同块长,并以逐路径有效的 AdaGrad-Hedge 聚合,避免元损失矩条件。结果给出匹配下界的期望通用动态遗憾率,在有限方差情形也得到首个参数无关的极小极大保证。

Forcing and duality-corrected contracts for volatility control Figure 1
2026-07-30math.OC

Forcing and duality-corrected contracts for volatility control

Alessandro Chiusolo, Emma Hubert, Dylan Possamaï, Nizar Touzi

Department of Operations Research and Financial Engineering (ORFE), Princeton University, USA.Research partially supported by the NSF grant DMS-2307736., CEREMADE, Université Paris–Dauphine, PSL Research University, France., Department of Mathematics, ETH Zürich, Switzerland. This author gratefully acknowledges support from the SNF project MINT 205121-21981., New York University, Tandon School of Engineering, USA.

2026-07-30规划控制

本文关注连续时间委托代理中代理人同时控制漂移与波动率时,既有2BSDE最优合约依赖的对偶性假设可能失效的问题。核心洞察是用由函数ψ参数化的更一般合约族统一处理可揭示性与主人的无损限制,并给出强制型合约和对偶缺口修正合约两种构造。结果表明,即使原假设不成立,主人仍可达到可合约化波动率问题的价值,从而恢复最优激励构造。

Dynamic output-feedback stabilization of uncertain linear dynamics via digital twins Figure 1
2026-07-30math.OC

Dynamic output-feedback stabilization of uncertain linear dynamics via digital twins

Philipp A. Guth, Karl Kunisch, Sergio S. Rodrigues, Jesper Schröder

2026-07-30优化控制

本文针对含未知参数、仅有带噪部分观测的线性动力系统,试图把数字孪生从工程概念推进到可分析的输出反馈稳定框架。核心做法是让虚拟系统并行运行,用贝叶斯在线更新参数、Kalman/Riccati 增益重构状态并生成反馈控制。数值实验表明,该耦合物理-虚拟系统可同时承担观测器、参数估计器和控制器角色,在参数不确定下实现稳定化。

Normalized First-Order Methods for Convex (L0, L1)-Smooth Optimization with Inexact Gradients Figure 1
2026-07-30math.OC

Normalized First-Order Methods for Convex (L0, L1)-Smooth Optimization with Inexact Gradients

Evgeniy Kovalev, Fedor Stonyakin

2026-07-30优化算法

针对现代机器学习中梯度不满足经典 Lipschitz 光滑且精确梯度代价高的问题,本文研究凸 (L0,L1)-smooth 优化在仅能获得归一化近似梯度方向时的收敛性。核心是把 Comparison Oracle 接入归一化梯度下降和 Polyak 步长梯度法,给出允许误差上界与收敛速率,并提出无需预知梯度范数上界的自适应 Polyak 版本;实验用于验证理论趋势。

The Lie algebra generated by gradient vector fields Figure 1
2026-07-30math.DG

The Lie algebra generated by gradient vector fields

Bettina Kazandjian, Omar Mohsen, Eugenio Pozzoli

2026-07-30优化算法

本文关注紧流形上由梯度向量场及其迭代 Lie 括号能生成多大可达方向,这一问题与由梯度流组成的微分同胚控制系统有关。核心洞察是把生成性问题转化为椭圆微分算子的有限余维性质,并结合 Grabowski 关于有限余维 Lie 子代数的结构定理。主要结果证明:在任意带非退化对称双线性型的紧光滑流形上,所有光滑向量场都可由有限深度的梯度场 Lie 括号线性组合表示,进而梯度流生成的群在恒等分支微分同胚群中稠密。

Stabilizability of neural fields from thick subsets Figure 1
2026-07-30math.OC

Stabilizability of neural fields from thick subsets

Clemens Bombach, Marco Ragni

2026-07-30优化控制

针对神经工程中传感器或执行器无法任意布置的问题,本文研究控制只作用于固定厚子集时 Amari 型神经场的稳定化。核心洞察是用厚集的相对密度条件结合 Logvinenko-Sereda 不确定性原理和耗散估计,绕开该半群不具平滑性的困难。主要结果是在相互作用强度足够小等条件下,证明线性化系统开环可稳定,并进一步推出 L2 闭环反馈可稳定非线性神经场,数值实验用于估计控制成本。

Minimax adaptive control for finite sets of positive linear systems Figure 1
2026-07-30math.OC

Minimax adaptive control for finite sets of positive linear systems

Fethi Bencherki, Anders Rantzer

⋆Department of Automatic Control, Lund University, Lund, Sweden, must maintain good closed loop performance using the information currently available, while also, on nonnegative state spaces [33, 36]. Their structure can also be exploited to obtain scalable, analysis and synthesis methods, since stability and controller design is conducive to scalability [33, errors while remaining computationally tractable and scalable for large networked systems. See

2026-07-30规划控制

面向排队、流量和网络等正线性系统中模型不准且扰动可能恶意的控制问题,论文把有限候选模型下的自适应控制写成控制器与对手的 minimax 动态博弈,并用历史变量重构为标准零和博弈。其核心结果是给出 Bellman 不等式的显式解,得到无需初始稳定控制器、保持正性且具备有界 ℓ1 增益鲁棒保证的策略,并通过水库与队列网络数值例子验证。

On Mean-field Singular Stochastic Control Problems Figure 1
2026-07-30math.OC

On Mean-field Singular Stochastic Control Problems

Andrea Amato, Federico Cannerozzi, Giorgio Ferrari

2026-07-30规划控制

本文针对均值场控制中奇异控制/最优停止结构难以刻画的问题,提出将原问题转化为带奇异控制的势均值场博弈来求解的思路。在凸性条件下,证明该博弈的任一均衡可给出原均值场控制最优解,并在均值场 Monotone Follower 问题中建立存在唯一性、自由边界表征及非线性积分方程刻画。

Equilibrium for Regular-Singular Control under Mean-Variance Criterion Figure 1
2026-07-30math.OC

Equilibrium for Regular-Singular Control under Mean-Variance Criterion

Zongxia Liang, Xiaodong Luo, Jiayu Zhang

∗Department of Mathematical Sciences, and Center for Insurance and Risk Management, School of Economics and Man-

2026-07-30规划控制

本文针对均值-方差准则导致的时间不一致性,研究同时含连续调节与奇异干预的随机控制问题,动机在于既有均衡理论多限于单一控制或时间一致情形。文章提出闭环内禀博弈下的混合正则-奇异控制均衡概念,强调两类控制需同步扰动以刻画漂移和扩散中的耦合关系;并给出验证定理与必要条件。在再保险模型中,作者构造显式耦合均衡,展示正则控制依赖奇异状态、奇异自由边界随正则控制结构切换,并说明耦合参数退化时解可还原为两个单控制均衡。

Mesh-dependent iteration count growth in primal-dual active set strategies Figure 1
2026-07-30math.OC

Mesh-dependent iteration count growth in primal-dual active set strategies

Ioannis P. A. Papadopoulos, Michael Hintermüller

Mathematical Institute, University of Oxford, UK, Weierstrass Institute and Humboldt-Universität zu Berlin, Berlin, Germany

2026-07-30优化控制

本文关注 PDAS 在离散化无限维不等式约束问题中随网格加密迭代数失控的现象,动机是解释工程中常被误归因的求解瓶颈。核心洞察是把该退化与函数空间层面的 Newton 失效、对偶可行性违背及障碍问题中的逐层脱离机制联系起来。结果表明,Signorini 类问题迭代数近似线性增长,而障碍和状态约束控制问题可呈指数增长,并指出多重网格和正则化可能缓解但并非本文主线。

Optimal control problems for quasi-linear parabolic equations and their linear approximations Figure 1
2026-07-30math.OC

Optimal control problems for quasi-linear parabolic equations and their linear approximations

Xu Liu, Meisai Wang, Xu Zhang

School of Mathematics and Statistics, Northeast Normal, University, Changchun 130024, China. E-mail:, School of Mathematics and New Cornerstone Science Laboratory, Sichuan University

2026-07-30规划控制

这篇论文针对热扩散等工程模型中常用线性化替代非线性控制问题的合理性,研究准线性抛物方程最优控制与其线性二次近似之间的定量关系。核心在于把“足够小数据下可线性化”的直觉提升到最优控制层面,给出判别最优控制位于 admissible 集内部或边界的条件,并证明小初值、小目标下两类问题的最优控制和最优轨迹差异为高阶无穷小;在内部点情形还证明近似阶是尖锐的。

Adaptive Gradient-Based Methods for a Broader Class of Optimization Problems under Performative Prediction Figure 1
2026-07-30math.OC

Adaptive Gradient-Based Methods for a Broader Class of Optimization Problems under Performative Prediction

Hiroki Hamaguchi, Yuya Hikima, Hiroshi Sawada, Akiko Takeda

Graduate School of Information Science and Technology, The University of Tokyo, Department of Industrial Engineering and Economics, Institute of Science Tokyo, Communication Science Laboratories, NTT, Inc., Center for Advanced Intelligence Project, RIKEN

2026-07-30优化算法

本文针对 performative prediction 中“模型部署会反过来改变数据分布”的优化难题,指出既有梯度法常依赖高斯、一维或非退化更新等限制。核心做法是用有限差分显式估计参数诱导的分布漂移,并把该估计并入梯度更新,从而覆盖更高维、非高斯分布和更一般损失。理论上给出弱假设下的平滑性、收敛与样本复杂度保证,实验显示比 PerfGD 等方法更稳定、收敛更快。

A Primal Approach to Facial Reduction for SDP Relaxations of Combinatorial Optimization Problems Figure 1
2026-07-30math.OC

A Primal Approach to Facial Reduction for SDP Relaxations of Combinatorial Optimization Problems

Hao Hu, Mingming Xu

School of Mathematical and Statistical Sciences, Clemson University, Clemson, SC, USA

2026-07-30优化算法

本文针对组合优化中二次目标的 SDP 松弛常因不满足 Slater 条件而导致求解不稳、预处理昂贵的问题,提出利用原问题可行解进行面约简的 primal FRA。核心洞察是结构化 MBQP/QAP 往往易生成可行解,可由其暴露包含相关约简信息的低维面,减少辅助 SDP 求解。实验显示在基准集上平均约快 4 倍,并常能恢复严格可行性。

A new theorem of alternatives leading to sufficient conditions for the superiorization guarantee question of Dynamic String-Averaging in the inconsistent case Figure 1
2026-07-30math.OC

A new theorem of alternatives leading to sufficient conditions for the superiorization guarantee question of Dynamic String-Averaging in the inconsistent case

Kay Barshad, Yair Censor

Department of Mathematics, University of Haifa, Mt. Carmel

2026-07-30优化控制

本文针对 superiorization 方法在不一致约束下是否真能优于未扰动可行性算法这一理论缺口,研究 GDSA 动态串平均框架。核心创新是给出新的择一 theorem:要么扰动算法取得不高于基线的目标值,要么两条迭代轨迹距离严格递减;据此推导负梯度/次梯度扰动下的充分条件,并说明这些条件主要是理论保证,实际运行中通常难以直接验证。

A Receding Horizon Control For General Assembly Line Balancing Problems Figure 1
2026-07-30math.OC

A Receding Horizon Control For General Assembly Line Balancing Problems

Ali Mohamed Ali, Luca Tirel

2026-07-30规划控制

面向装配线在工位故障、资源变化等扰动下需反复重排的难题,论文将通用装配线平衡建模为离散动态系统,并用滚动时域控制同时决定任务分配与资源配置,内部优化为 MINLP,尽量避免依赖特定产线形状。数值实验显示该方法可在约束下重新分配任务和资源、降低完工时间,但可扩展性受求解时间影响,稳定性与递归可行性部分仍依赖额外条件。

Kinetic Optimization of Magnetic Mirror Confinement: Beyond Classical Loss-Cone Theory Figure 1
2026-07-30math.OC

Kinetic Optimization of Magnetic Mirror Confinement: Beyond Classical Loss-Cone Theory

Lukas Einkemmer, Martin Guerra, Qin Li, Leonardo Zepeda-Núñez

Department of Mathematics, Universität Innsbruck, Innsbruck, Austria, Department of Mathematics, University of Wisconsin-Madison, Madison, WI, USA

2026-07-30优化算法学习理论

针对磁镜聚变装置中粒子易从开放端逃逸、传统损失锥理论难以指导场形设计的问题,论文把磁场优化表述为受多组分漂移动力学-Poisson模型约束的优化。核心洞察是自洽电场会形成额外约束势垒,且最优磁场形态依赖等离子体组分:单电子模型偏向中心峰值结构,电子-离子耦合后则回到边界峰值的经典磁镜形态。

Model-Free Q-Learning for Infinite-Horizon Stochastic Linear Quadratic Problems with Regime Switching Figure 1
2026-07-30math.OC

Model-Free Q-Learning for Infinite-Horizon Stochastic Linear Quadratic Problems with Regime Switching

Xinyue Zhang, Na Li, Xun Li, Zuo Quan Xu

in part by the Hong Kong RGC (15203423 and 15204622), in part by the PolyU-SDU Joint Research Center on Financial Mathematics, in part by the CAS AMSS-PolyU Joint Laboratory of Applied Mathematics, in part by the Research Centre for Quantitative Finance (1-CE03), and in part by the internal grants from The Hong Kong Polytechnic University.

2026-07-30优化控制

针对带马尔可夫切换的无限时域连续时间随机 LQ 控制在真实系统中难以获得精确动力学、传统 CARE 方法依赖模型的问题,论文构造仅用在线状态轨迹数据的 on-policy 与 off-policy Q-learning,并用稳定性性质处理各模态 Riccati 变量耦合。主要结果是证明两类算法与 Lyapunov 迭代等价、闭环稳定且收敛到最优解,数值算例验证可行性。

Global Exponential Stabilization of the Kinematic Bicycle Model of a Car in Polar Coordinates Figure 1
2026-07-30eess.SY

Global Exponential Stabilization of the Kinematic Bicycle Model of a Car in Polar Coordinates

Velimir Todorovski, Kwang Hak Kim, Alessandro Astolfi, Miroslav Krstic

and Engineering Division, King Abdullah University of Science and

2026-07-30优化控制

针对低速泊车中运动学自行车模型难以用平滑静态反馈全局稳定、且既有链式变换或时变控制轨迹不自然的问题,论文将模型转到极坐标并引入按距离归一化的奇异坐标,使系统呈现 strict-feedback 结构,从而构造非标准 backstepping 控制律。主要结果是在变换坐标中实现全局指数稳定,并在极坐标输出上得到全局指数稳定,生成接近人类泊车的反馈轨迹;笛卡尔意义下仍受极坐标奇异集限制。

Scalable Dynamic Optimal Transport via Distributed Linearized ADMM Figure 1
2026-07-30math.OC

Scalable Dynamic Optimal Transport via Distributed Linearized ADMM

Hari Dahal, Rongjie Lai, Yangyang Xu

Scalable Dynamic Optimal Transport via Distributed Linearized ADMM, approach zero and no positive lower bound is available. In this regime, conventional methods may, robustness, and scalability of the proposed method in comparison with conventional approaches., ∗Department, Institute, scalable in memory and computation. To achieve this goal, we develop an exact-proximal

2026-07-30优化控制

本文针对动态最优传输在近零密度下易因目标局部曲率过大而收敛变慢甚至不稳定、且细网格时空离散带来高内存开销的问题,提出将离散模型改写为可精确求近端映射的 LADMM,并进一步按代理划分时空变量实现分布式计算。实验覆盖一维和二维场景,显示该方法相较 FISTA、ALM、G-prox 等更稳健高效,在 12 个 CPU 核上报告超过 6 倍加速。

A Lower Bound on the Sliced Wasserstein Comparison Constant for Translated Measures Figure 1
2026-07-30math.ST

A Lower Bound on the Sliced Wasserstein Comparison Constant for Translated Measures

Avery Noroozi

Department of Mathematics, Purdue University

2026-07-30学习理论

这篇论文关注切片 Wasserstein 距离虽计算更便宜、但与标准 1-Wasserstein 距离之间常数损失如何量化的问题。作者针对平移概率测度给出 W1 与 SW1 的闭式表达,指出二者比值只由维度和球面投影平均决定,并由 Gamma 函数刻画;主要结果是在该平移情形下构造 Carlier 等比较常数 cd 的显式下界,从理论上说明切片近似的效率代价。

Hardware-Aware QUBO Reformulation of Constrained Binary Optimization via the Walsh-Fourier Transform Figure 1
2026-07-30quant-ph

Hardware-Aware QUBO Reformulation of Constrained Binary Optimization via the Walsh-Fourier Transform

Loong Kuan Lee, Harsha Nagarajan, Thore Gerlach, Sascha Mücke, Ragavi Krishnamoorthy, Nico Piatkowski

2026-07-30优化算法

针对量子退火中约束二进制优化常因松弛变量、密集耦合和罚系数调参而难以嵌入的问题,论文提出用 Walsh-Fourier 加权最小二乘投影,将用户给定的约束罚函数直接压缩到硬件可实现的一次、二次耦合子空间。该方法无需辅助变量和逐约束调参,并显式适配硬件拓扑;在多维背包与真实量子退火实验中,拓扑感知版本降低了平均和最坏目标 gap,且有时优于更稠密的全二次投影。

Data-Driven Stability and Performance Analysis of Lurye Systems Figure 1
2026-07-30eess.SY

Data-Driven Stability and Performance Analysis of Lurye Systems

Sahel Vahedi Noori, Peter Seiler

2026-07-30优化控制

针对含静态无记忆非线性的离散 Lurye 系统,传统稳定性与 ℓ2 性能认证依赖名义 LTI 模型,难以直接用于只有轨迹数据的场景。论文将二次约束/IQC 型分析改写为数据驱动的凸 SDP:一种使用输入、输出、状态轨迹,另一种用子空间辨识从输入输出数据重构状态。无噪且激励充分时可恢复模型化条件,并在扇区有界非线性示例中得到与模型法相同的诱导 ℓ2 增益界。

Nonnegative Low-Rank Matrix Correction under an Orthogonality Constraint in Conservative Vlasov Simulations Figure 1
2026-07-30math.NA

Nonnegative Low-Rank Matrix Correction under an Orthogonality Constraint in Conservative Vlasov Simulations

Yue Wu, Stephen Becker, Jingmei Qiu, Xiangxiong Zhang

2026-07-30优化算法

本文针对保守低秩 Vlasov 求解中 SVD 截断会破坏分布函数非负性的问题,提出将非负修正与质量、动量、能量守恒写成带正交约束的矩阵优化。核心在于给出平方核范数近端算子的隐式奇异值阈值求解,并比较多种凸算法与显式秩约束的切空间加速交替投影。Landau 阻尼和时变求解器实验显示,各法修正质量接近,TAP 因每步只需小规模 SVD 在大网格上更省时,并能作为 positivity limiter 保持守恒量。

Symmetrized Sinkhorn-Gibbs Inference for Oscillatory Inverse Problems Figure 1
2026-07-30math.OC

Symmetrized Sinkhorn-Gibbs Inference for Oscillatory Inverse Problems

Gabriel Huerta, Mohammad Motamed

Department of Mathematics and Statistics, University of New Mexico, Albuquerque, NM 87131, USA, Sandia National Laboratories, Albuquerque, NM 87123, USA

2026-07-30优化控制

这篇论文针对振荡反问题中信号错位和 cycle-skipping 使 Gibbs 后验风险面高度非凸、影响不确定性量化的问题,提出将有符号信号归一化后同时比较其本身与取负形式的对称 Sinkhorn-Gibbs 损失。核心洞察是用互补相位的最优传输信息减少单次归一化的信息损失,并保留多维特征域结构。理论上给出光滑性、后验适定性和鲁棒性结果,数值上在地震反演基准中相比欧氏和逐道 Wasserstein 损失减少伪局部极小、提升后验精度与抗噪恢复。

Inertial Primal Dual Dynamics with Hessian-driven Damping for Smooth and Bilinearly Coupled Saddle Point Problems Figure 1
2026-07-30math.OC

Inertial Primal Dual Dynamics with Hessian-driven Damping for Smooth and Bilinearly Coupled Saddle Point Problems

Zepeng Wang, Juan Peypouquet

\orgdiv Bernoulli Institute for Mathematics, Computer Science and Artificial Intelligence, \orgname University of Groningen, \state Groningen, \country The Netherlands

2026-07-30强化学习

该文面向双线性耦合鞍点问题中惯性原始-对偶动力学易振荡、离散化不直观的问题,引入 Hessian 驱动阻尼构造两类连续时间系统,并扩展到仿射约束凸优化。主要结果是在凸-凹情形得到原始-对偶间隙 O(1/t²),强凸-强凹情形在未知强凸参数时给出 O(1/t^{α-1}),已知参数时获得加速线性收敛。

2026-07-29

37 篇
Optimization under Persistent State-Dependent Bias: Gradient-based Method and Complexity Analysis Figure 1
2026-07-29math.OC

Optimization under Persistent State-Dependent Bias: Gradient-based Method and Complexity Analysis

Zhaoxian Wu, Quan Xiao, Tayfun Gokmen, Tianyi Chen

2026-07-29优化算法

本文面向模拟物理计算中变量原位更新会受到持久、状态相关且正负不对称硬件响应影响的问题,指出直接在该动态下运行 SGD 实际会优化带惩罚的偏置目标,收敛点偏离真实最优解。作者将原问题改写为等价双层优化并提出 Residual Learning,用梯度式残差校正抵消硬件偏置;理论证明其可收敛到无偏原问题解,并用硬件条件数刻画复杂度,给出多项式依赖的上界及不可避免性的下界,数值实验验证了校正效果。

Large Language Model for Operations Research Formulation Selection in Multi-Warehouse Inventory Allocation Figure 1
2026-07-29cs.AI

Large Language Model for Operations Research Formulation Selection in Multi-Warehouse Inventory Allocation

Jintao Xu, Yingzheng Ma, Jiong Dong, Yongzhi Qi, Jianshen Zhang

2026-07-29优化控制

本文针对多仓库存分配中单一 MIP 建模难以适配不同需求集中度、库存失衡和预测波动的问题,把建模选择改为逐实例的 OR formulation selection。核心做法是让 LLM 在四类可执行 MIP 专家间路由,并用求解器事后评分构造 SFT、IPO 与 GRPO 训练信号。京东实例上,GRPO 将 HR@1 从 21.45% 提升到 50.42%,分配准确率较现有基线提高 12.57 个百分点,但少数专家场景的泛化仍有待说明。

On the boundedness of infinite products of relaxed projections: perturbations resilience and dynamic string-averaging Figure 1
2026-07-29math.OC

On the boundedness of infinite products of relaxed projections: perturbations resilience and dynamic string-averaging

Daniel Reem, Yair Censor

The Center for Mathematics and Scientific Computation (CMSC), University of Haifa, Mt. Carmel, Haifa 3498838, Israel, Department of Mathematics, University of Haifa, Mt. Carmel, Haifa 3498838, Israel

2026-07-29学习理论

本文关注投影算法中无限松弛投影乘积是否保持有界这一基础问题,动机来自将有限维仿射子空间结果推广到Hilbert空间并处理误差。核心创新是在内在正则条件下引入有界或可和扰动、半空间/超平面混合以及动态加权string-averaging。主要结果给出统一有界性与扰动韧性定理,同时构造反例说明不能直接推广到任意闭凸集。

Variance-Reduced Conditional Gradient Methods under Markovian Sampling for Nonconvex Composite Optimization Figure 1
2026-07-29math.OC

Variance-Reduced Conditional Gradient Methods under Markovian Sampling for Nonconvex Composite Optimization

Zhaojun Peng

School of Computer Science, Nanjing University of Information Science and Technology

2026-07-29优化算法

本文针对单条马尔可夫链流式样本下的非凸复合约束优化,动机是现有方差缩减多限于独立采样或无约束情形。作者提出 MC-ALFCG,将条件梯度、耦合截断多层 Monte Carlo 与梯度裁剪结合,用广义 Frank-Wolfe gap 度量收敛;证明可转化为独立采样递推并给出含混合时间的期望样本复杂度,同时说明需已知混合时间、噪声和梯度界,实验仅作受控验证。

Vertex Loci of Max-Indicator Polytopes and Vertex Retrieval in Ball Polyhedra Figure 1
2026-07-29math.OC

Vertex Loci of Max-Indicator Polytopes and Vertex Retrieval in Ball Polyhedra

Marius Costandin

2026-07-29优化控制

本文关注等半径球交构成的 ball polyhedra 中,如何在已知唯一顶点落在特定超平面上的条件下高效找回该顶点。核心洞察是 max-indicator polytopes 的顶点随参数变化沿经过原点与真实顶点的径向轨迹滑动;通过对目标点沿全一向量作对称扰动,可把目标顶点刻画为扰动多面体交集的边界公共点。主要结果是在较强几何假设下给出关于 m、n 多项式复杂度的线性规划检索算法。

Optimization with Dynamic Constraint Learning (DCL) Figure 1
2026-07-29cs.LG

Optimization with Dynamic Constraint Learning (DCL)

Ezgi Oztekin, Figen Oztoprak, S. Ilker Birbil

Department of Mathematics, Gebze Technical UniversityDepartment of Industrial Engineering, Gebze Technical UniversityAmsterdam Business School, University of Amsterdam

2026-07-29优化算法

针对约束函数未知且优化过程中无法继续查询的场景,论文指出先训练全局替代模型再优化会把精度浪费在非关键区域,并增加子问题难度。DCL的核心是在每次迭代只用邻域数据学习局部约束代理,并在数据支撑的信赖域内求步长。实验在合成问题和两个文献案例中显示,其解质量可接近或优于全局模型,同时使用更简单模型和更小子问题;但收敛性、终止准则和可行性证书仍文中未充分说明。

Analysis and Optimal Design of Equilibria in the Vlasov-Poisson System Figure 1
2026-07-29math.OC

Analysis and Optimal Design of Equilibria in the Vlasov-Poisson System

Alfio Borzì, Gennaro Infante, Giovanni Mascali, Riccardo Scida

Dipartimento di Matematica e Informatica, Università della Calabria, 87036 Arcavacata di Rende, Cosenza, Italy, Dipartimento di Matematica e Informatica, Università della Calabria, 87036 Arcavacata di Rende, Cosenza, Italy, and INFN gruppo collegato Cosenza, Italy

2026-07-29优化控制

本文面向等离子体、束流和半导体等系统中用外加电势塑造平衡粒子密度的需求,将 Vlasov-Poisson 的 Maxwellian 平衡化为带质量归一化的 Poisson-Boltzmann 状态方程。核心贡献是给出解的存在唯一性两套证明,并把谷势、二次跟踪和 KL 距离统一进最优设计框架,推导一阶最优性条件并提出投影非线性共轭梯度算法;数值实验用于验证设计策略。

Face Structure in Partial Facial Reduction of Semidefinite Relaxations of Binary Programs Figure 1
2026-07-29math.OC

Face Structure in Partial Facial Reduction of Semidefinite Relaxations of Binary Programs

Hao Hu, Mingming Xu

Hao Hu 1 1 1 School of Mathematical and Statistical Sciences, Clemson University, Clemson, USA, Mingming Xu 2 2 2 School of Mathematical and Statistical Sciences, Clemson University, Clemson, USA

2026-07-29优化控制

针对二进制优化的 SDP 松弛常因 Slater 条件失效而数值退化,全文研究用对角、DD、SDD 等廉价内近似做部分面约化能恢复什么结构。核心洞察是,SDD 终止面可由变量固定为 0/1 和变量相等分组刻画,并给出保持稀疏性的 0/1 基降维形式;同时证明 DD/SDD 在某些奇异度仅为 2 的族上仍需最多步数,且因子宽度限制会漏检稠密仿射等式。

Contextual Deconvolution for Variance-Stable Demand Sensing: Kernel-Modulated Operators in Promotional Retail Figure 1
2026-07-29cs.LG

Contextual Deconvolution for Variance-Stable Demand Sensing: Kernel-Modulated Operators in Promotional Retail

Mohammad Forouhesh

Amirkabir University of Technology, Tehran, Iran

2026-07-29优化控制

针对促销零售中追求点预测精度的模型会把短期冲击误作结构变化、放大补货波动的问题,论文提出 Contextual Deconvolution,用核调制带状算子和层级部分池化分离促销冲击与平滑基线。结果显示其显著降低方差比、安全库存和灾难性误差,但在促销尖峰上更易缺货;总库存成本仅在持有成本约超过缺货成本 20% 时下降。

Bilinear Koopman-Based Robust Model Predictive Control for Unknown Nonlinear Systems via Contraction Metrics Figure 1
2026-07-29math.OC

Bilinear Koopman-Based Robust Model Predictive Control for Unknown Nonlinear Systems via Contraction Metrics

Yuki Higuchi, Kazuhiro Sato

th lab., This work was supported by JSPS KAKENHI Grant Number 23K28369 and 26K03232.Yuki Higuchi and Kazuhiro Sato are with Graduate School of Information Science and Technology, The University of Tokyo, Tokyo, 113-8656, Japan

2026-07-29规划控制安全鲁棒

这篇论文针对未知非线性系统中 Koopman-MPC 难以同时保证建模误差鲁棒性、原约束满足与递归可行的问题,指出双线性 Koopman 多步预测会偏离提升态流形,并通过逐步回投到原状态空间构造带误差的控制仿射预测器;在此基础上结合离散鲁棒控制收缩度量与同伦管 MPC,证明真实闭环满足约束、递归可行并收敛到目标邻域,数值实验显示优于既有 Koopman-RMPC。

Conditional gradient methods on unbounded feasible regions Figure 1
2026-07-29math.OC

Conditional gradient methods on unbounded feasible regions

R. Díaz Millán, Tuan Thanh Lu, Julien Ugon

2026-07-29优化算法学习理论

这篇论文针对 Frank-Wolfe/条件梯度法通常要求可行域紧致、难以直接处理闭凸无界约束的问题,提出把线性最小化 oracle 限制在包含相应目标下水平集的紧凸子集上。核心洞察是无需改动迭代本身,只要紧限制保留原问题最优解,就能把经典收敛分析迁移到无界可行域;文中给出固定与动态限制方案、若干可构造限制、非光滑扩展,并用实验展示其行为。

A Minimal Dynamical Model for Incubation-Outbreak Transitions in Social Norm Diffusion Figure 1
2026-07-29eess.SY

A Minimal Dynamical Model for Incubation-Outbreak Transitions in Social Norm Diffusion

Run Wang, Leonardo Cianfanelli, Giacomo Como, Wenjun Mei

2026-07-29生成模型

本文关注社会规范扩散中“先沉寂、后爆发”的内生转变机制,动机是解释为何公开支持度下降后仍可能积累潜在共识。作者提出含非支持者、沉默支持者和公开倡导者的最小动力系统,将信念采纳与倡导疲劳耦合起来;主要结果是解析刻画平衡、稳定性、收敛与相变条件,并给出潜伏期估计,说明突发社会变化可由内部互动触发而非外部冲击。

Optimal Parameter Design for DIGing on Minimizing Unweighted Sum of Squares Figure 1
2026-07-29math.OC

Optimal Parameter Design for DIGing on Minimizing Unweighted Sum of Squares

Qiuchen Tian, Li Chai, Jinming Xu

College of Control Science and Engineering, Zhejiang University, Hangzhou 310027, China

2026-07-29优化控制

本文针对 DIGing 等分布式优化算法缺少可操作参数设计方法、实际收敛偏慢的问题,聚焦最简单的无权平方和目标。作者将迭代写成离散线性动力系统,并按图频率分解为解耦子系统,再用 Routh 稳定判据推导最优最坏情形收敛率及对应参数的显式公式;结果显示即便在该基础目标上 DIGing 仍收敛较慢,说明后续加速设计是必要的。

Exact discrete-adjoint optimization of trap timing and placement in a Stieltjes-time reaction-diffusion model: A Galicia case study Figure 1
2026-07-29math.OC

Exact discrete-adjoint optimization of trap timing and placement in a Stieltjes-time reaction-diffusion model: A Galicia case study

Francisco J. Fernández, Iván Area

2026-07-29生成模型优化算法

针对季节性入侵物种模型中扩散、休眠与突发转移并存、且陷阱时空布设需可微优化的问题,本文把 Stieltjes 时间反应扩散模型离散成有限元/Stieltjes-Euler 残差,并推导精确离散伴随梯度。数值验证显示梯度误差达机器精度,伴随法随陷阱数增加有约 7.5 至 30.9 倍加速;在加利西亚黄脚胡蜂案例中,两簇陷阱方案优于时间-only和参考控制,但目标仅降 0.49209%,且未校准为实际捕获效果。

A Numerical Investigation of the Rayleigh-Faber-Krahn Inequality for Polyhedral Domains Figure 1
2026-07-29math.OC

A Numerical Investigation of the Rayleigh-Faber-Krahn Inequality for Polyhedral Domains

Josué Díaz-Avalos, Antoine Laurain

2026-07-29优化控制

本文受经典 Rayleigh-Faber-Krahn 不等式从平面区域推广到三维多面体的空白驱动,研究固定面数凸多面体中最小化拉普拉斯第一 Dirichlet 特征值的问题。核心做法是用支撑超平面参数化多面体,将形状优化化为有限维约束优化,并结合拉格朗日框架与形状导数做灵敏度分析。数值结果在不同面数下恢复了柏拉图体、棱柱和十四面体等已知结构,也发现若干具有对称性的非正则候选最优形状。

Microsecond-Class Powered-Descent Optimization via Exact Condensation and Strong Convex Regularization Figure 1
2026-07-29math.OC

Microsecond-Class Powered-Descent Optimization via Exact Condensation and Strong Convex Regularization

Wenbo Li, Ziqi Xu, Dai Shen, Shengping Gong

2026-07-29优化算法

面向着陆制导中凸优化虽可解但在线变量多、缺少强凸曲率、难满足机载微秒级时延的问题,论文把燃料目标加入低权重能量正则,精确消去中间状态,并利用燃料范数与推力球的径向结构构造闭式近端算子。30节点火星算例中变量从300降至90,迭代由2744降至93,平均求解68.2微秒,燃料仅增0.033%;但测试推力集本身已凸,贡献主要是凸核心的快速实现。

Linear Programming Bounds for Fibered Sphere Packings Figure 1
2026-07-29math.MG

Linear Programming Bounds for Fibered Sphere Packings

Andrew Salmon

2026-07-29学习理论

本文动机是把高维球堆积中“分层/纤维化”结构纳入可证的线性规划上界框架,以处理带预设平移对称性的情形。核心洞察是将问题改写为ℝ^k与紧阿贝尔群上的分离配置,并建立原始/对偶最优性、函子性和互补松弛。主要结果包括重现若干≤9维最优密度情形,证明Barnes-Wall格在纤维化于E8时最优,并指出某些LP界限不足以证明Cohn-Rajagopal猜想。

Proximal Gradient Methods for Unconstrained Set Optimization Problems with Set-Valued Maps of Finite Cardinality Figure 1
2026-07-29math.OC

Proximal Gradient Methods for Unconstrained Set Optimization Problems with Set-Valued Maps of Finite Cardinality

Ravi Raushan, Debdas Ghosh, Anshika, V. Vetrivel

2026-07-29优化算法

本文针对带有限值集值映射的无约束集合优化中非光滑复合目标缺少一阶算法的问题,提出有线搜索和无线搜索两类近端梯度法。核心在于用一族向量优化问题刻画弱极小点,并据此建立驻点条件、下降方向和 Armijo 步长存在性。主要结果是在较温和假设下证明全局收敛,并给出两种方法的 O(1/√k) 复杂度,数值实验用于检验可行性。

Event-Triggered Discrete-Time Multivariable Extremum Seeking Systems Figure 1
2026-07-29math.OC

Event-Triggered Discrete-Time Multivariable Extremum Seeking Systems

Victor Hugo Pereira Rodrigues, Tiago Roux Oliveira, Miroslav Krstić, Frank Allgöwer

a Department of Electronics and Telecommunication Engineering, State University of Rio de Janeiro (UERJ), Rio de Janeiro–RJ, Brazil, University of California at San Diego (UCSD), La Jolla–CA, USA

2026-07-29优化控制

面向数字与网络化控制中通信、计算和执行受限的问题,论文研究如何在离散时间多变量极值寻优中摆脱固定周期输入更新。核心创新是用状态相关事件触发规则保留周期激励所需的梯度恢复机制,并结合离散时间平均与 Lyapunov 分析处理通道耦合和非均匀更新。结果证明轨迹可实际收敛到未知极值邻域、平均系统指数稳定,仿真显示在优化性能相近时显著减少输入更新次数。

Projection and contraction methods with double inertial steps for variational inclusion problems on Hilbert spaces Figure 1
2026-07-29math.OC

Projection and contraction methods with double inertial steps for variational inclusion problems on Hilbert spaces

Moin Uddin, Mohammed Alshahrani, Qamrul Hasan Ansari

Corresponding author. Department of Mathematics, King Fahd University of Petroleum & Minerals, Dhahran, 31261, Saudi Arabia, Department of Mathematics, King Fahd University of Petroleum & Minerals, Dhahran, 31261, Saudi Arabia

2026-07-29优化控制

本文针对变分包含中前向后向法依赖余强单调、既有投影收缩法需已知 Lipschitz 常数或惯性项会衰减的问题,提出三种双惯性投影收缩算法,将加速外推与收缩校正解耦,并用自适应步长避免预估常数。结果给出弱收敛、强单调下的强收敛与 R 线性收敛,以及无需强单调时收敛到最小范数解;数值实验覆盖分裂可行与弹性网,但实际加速增益来源仍需更多实例支撑。

Distributed Nonlinear Equality-Constrained Optimization via Feedback Linearization and Singular Perturbation Figure 1
2026-07-29math.OC

Distributed Nonlinear Equality-Constrained Optimization via Feedback Linearization and Singular Perturbation

Zihao Ren, Lei Wang, Hongye Su, Guodong Shi

Zihao Ren, Lei Wang and Hongye Su are with the College of Control Science and Engineering, Zhejiang University, P.R. China. (E-mail: zhren2000

2026-07-29优化算法

本文针对非凸目标叠加非线性等式约束时,分布式优化难以同时保证可行性、共识与快速收敛的问题,提出反馈线性化结合奇异摄动的动力学框架,将残差调节与可行流形上的优化分离,并用快速残差跟踪替代非局部代数求解。主要结果是在局部二次增长等条件下证明理想与分布式实现的局部指数收敛,离散欧拉形式也保持该性质,且时间尺度分离足够强时速率可接近理想系统。

A Foundational Perspective for Partitional Clustering on Networks Figure 1
2026-07-29math.OC

A Foundational Perspective for Partitional Clustering on Networks

Derya Ipek Eroglu, Cem Iyigun

2026-07-29优化控制

本文针对网络数据中“只划分节点而较少优化簇中心位置”的问题,将位置理论引入图上的分区聚类,统一比较硬/软分配与距离/平方距离目标下的 PMP、SSC、PDC、FCM。核心洞察是边上瓶颈点和分配瓶颈点决定目标函数形态:PMP 与 PDC 的最优中心可限制在顶点,而 SSC 与 FCM 可能在边内部取得最优解,为后续算法设计提供结构性依据。

Intercity EV Charging Readiness in Türkiye: A Countrywide Scheduling and Economic Assessment Figure 1
2026-07-29math.OC

Intercity EV Charging Readiness in Türkiye: A Countrywide Scheduling and Economic Assessment

Taner Cokyasar

Department of Engineering Technology and Industrial Distribution, Texas A&M University, College Station, TX, 77843, USA

2026-07-29优化控制

论文关注土耳其既有城际充电网络能否支撑相对燃油车有成本竞争力的电动车长途出行。作者将DAG充电调度框架用于全国路网、9641个站点和数百万合成OD行程,核心洞察是基础设施充足性高度依赖可用SoC窗口和站点插头规模。结果显示,10–100% SoC下行程可行率达100%,但20–80%下降至0.3%;电动车运营成本低23–26%、TCO低10–12%,但大规模插头配置会使含基建成本收益转负。

Reactive 3D Motion Planning for a Franka Arm via Star-World Workspace Reshaping Figure 1
2026-07-29cs.RO

Reactive 3D Motion Planning for a Franka Arm via Star-World Workspace Reshaping

Gia Dcosta, Saayuj Deshpande, Samhitha Vedire

2026-07-29强化学习规划控制三维

论文针对安全膨胀后障碍物相互重叠会破坏调制式反应规划的非重叠星形世界假设,提出在每次更新中先聚类相交障碍并重塑为星形代理,再结合DS末端控制与零空间APF避障用于Franka机械臂。PyBullet六场景中,重塑方法成功5/6,高于基线4/6,更新耗时0.68–8.70 ms,但也带来路径变长、近似平衡点和过度合并封闭通道等局限。

Integrated Eco-Driving and Powertrain Optimization for Hybrid Vehicles in Complex Urban Traffic Figure 1
2026-07-29eess.SY

Integrated Eco-Driving and Powertrain Optimization for Hybrid Vehicles in Complex Urban Traffic

Milad Hasanzadeh, Amin Kargarian, Mehdi Farasat

2026-07-29优化算法

这篇论文针对城市混合动力车生态驾驶中轨迹规划、车道决策、交规约束与能量管理常被分层处理的问题,提出统一的有限时域混合整数优化框架,同时建模跟驰、换道、信号/无信号路口和动力系统运行。仿真显示其相较规则跟随、信号感知、允许超车和仅运动学优化等基线可降低能耗,并保持安全、舒适和交通规则可行性。

Functional Subspace Projection for Detection of Coordinated Stealthy Attacks in Power Systems Figure 1
2026-07-29math.OC

Functional Subspace Projection for Detection of Coordinated Stealthy Attacks in Power Systems

Koto Omiloli, Satish Vedula, Olugbenga Moses Anubi

2026-07-29视觉感知

针对电网中协同虚假数据注入可逐时躲过传统残差检测的问题,论文将多区域攻击建模为带时间聚合和区域耦合的动态过程,并提出KEFSD:把残差轨迹嵌入RKHS,用受约束函数PCA捕捉异常时序结构。在改造IEEE 14节点系统上,相比残差2范数检测取得更好检出表现,但大规模与在线分布式适用性仍待验证。

Towards Robust Reinforcement Learning for Small-Scale Language Model Agents Figure 1
2026-07-29cs.AI

Towards Robust Reinforcement Learning for Small-Scale Language Model Agents

Md Rezwanul Haque, Md. Milon Islam, Fakhri Karray

2026-07-29强化学习安全鲁棒

本文针对70–500M小语言模型用PPO做RLHF常被认为不稳定的问题,系统定位了LoRA参数冻结、bfloat16重要性比溢出和奖励误差导致策略崩溃三类失效,并提出适配器重初始化、float32更新与奖励白化/比率保护/权重回滚机制。15组实验显示,稳定收益取决于SFT困惑度低于20且奖励信号可区分,而非单纯参数量;满足条件时偏好胜率超过SFT并接近或优于部分指令模型。

FIRMGrasp: A Friction-Informed Risk Margin for Robust Grasp Synthesis Figure 1
2026-07-29cs.RO

FIRMGrasp: A Friction-Informed Risk Margin for Robust Grasp Synthesis

Clinton Enwerem, John S. Baras, Calin Belta

The authors are with the Department of Electrical & Computer Engineering and Institute for Systems Research, University of Maryland, College Park, MD, USA. Emails:

2026-07-29安全鲁棒

这篇论文针对传统抓取质量指标只假设单一摩擦系数、难以预判低摩擦执行失败的问题,引入基于 CVaR 的摩擦风险裕度,在不利摩擦尾部评估力闭合并给出概率证书。结果显示,在 1599 个 LEAP/Allegro 抓取中,名义 Ferrari-Canny 认证的 53% 会在不利摩擦下失效;该指标对 shake/pick 成功排序更准,逆摩擦举升成功率也由 25% 提至 70%。

Derivative-free optimization approach for structured symmetric matrices with fixed eigenvalues Figure 1
2026-07-29math.OC

Derivative-free optimization approach for structured symmetric matrices with fixed eigenvalues

Carmo P. Brás, Evelin H. M. Krulikovski, Marcos Raydan

Center for Mathematics and Applications (NOVA Math) and Department of Mathematics, Department of Mathematics, Federal University of Paraná, Curitiba

2026-07-29优化算法

本文面向带固定特征值和稀疏/非零阈值约束的对称矩阵逆特征值问题,动机来自谱图、量子化学和网络等场景中需同时匹配谱与边权结构。核心做法是直接以矩阵可变条目为变量,构造需反复计算特征值的非光滑无导数优化模型,并用 GLODS 及多种启发式算法求解。数值实验显示该方法在多类小中规模结构矩阵上能找到满足谱精度与非零下界的解,并与流形优化方案形成互补。

A Tuning-Free Variational Framework for Muscle Redundancy Resolution: Torque Fiber Proximal Dynamics with Active-Set Switching and EMG-Validated Activation Prediction Figure 1
2026-07-29q-bio.QM

A Tuning-Free Variational Framework for Muscle Redundancy Resolution: Torque Fiber Proximal Dynamics with Active-Set Switching and EMG-Validated Activation Prediction

Morteza Ganji

2026-07-29优化控制

本文针对肌肉冗余中同一关节力矩可由多种激活组合产生、传统方法依赖手工代价函数且难解释拮抗肌共激活的问题,提出无调参的 Torque Fiber Proximal Dynamics:把下一时刻激活视为对上一激活在力矩纤维凸多面体上的欧氏投影,并用变分不等式、扫掠过程和 KKT 主动集切换解释共激活。三肌肘模型中,该方法较多种经典基线更能产生类似三相 EMG 的拮抗肌活动,并与10名受试者三头肌 EMG 包络达到约0.68–0.73相关,但神经系统是否实际实现该投影文中未充分说明。

Functional H_infinity Filtering for Descriptor Systems with Incrementally Quadratic Nonlinearities under Disturbances Figure 1
2026-07-29math.OC

Functional H_infinity Filtering for Descriptor Systems with Incrementally Quadratic Nonlinearities under Disturbances

Rishabh Sharma, Nutan Kumar Tomar

Department of Mathematics, Indian Institute of Technology Patna, India

2026-07-29优化控制

本文针对非线性描述系统在外部扰动下只需估计状态函数而非全状态的场景,避免传统隐式描述型 H∞ 滤波器对正则性和一致初值的依赖。核心做法是构造显式状态空间的低阶功能滤波器,并用增量二次约束统一处理 Lipschitz、单边 Lipschitz、单调等非线性。主要结果给出秩条件与 LMI 可解性判据,保证误差渐近稳定且满足给定 L2 扰动抑制性能,数值仿真用于验证。

Generative Distributionally Robust Optimization Figure 1
2026-07-29cs.LG

Generative Distributionally Robust Optimization

Ziwei Zhang, Jonathan Yu-Meng Li, Zhihao Jin

Telfer School of Management, University of Ottawa, Department of Electrical and Computer Engineering, Western University

2026-07-29生成模型优化算法安全鲁棒

本文针对生成模型用于下游优化时的模型错配风险:传统 DRO 要么可接入任意采样器但扰动不受生成结构约束,要么保留生成结构却依赖似然、score 或训练数据。GDRO 的关键是用“采样器-Sinkhorn”配对,在当前上下文上用样本估计分布距离,并把最坏情形限制在选定生成器族内。实验显示其在稀有情境库存问题中降低约 60% regret,在 SocialGAN 导航中减少约 50% 碰撞。

Amortising Trajectory Optimisation for Residual MPC via Implicit Contact Differentiation Figure 1
2026-07-29cs.RO

Amortising Trajectory Optimisation for Residual MPC via Implicit Contact Differentiation

Daniel Layeghi, Thomas Corbères, Calum Arnott, Aditya Kamireddypalli, Hashim Al-Obaidi, Steve Tonneau, Michael Mistry

2026-07-29规划控制

这篇论文针对接触丰富机器人轨迹优化中,反向传播需展开迭代接触求解器而导致显存随迭代、接触数和自由度快速增长的问题,提出基于隐函数定理的MJX接触隐式导数,并将全时域iLQR蒸馏为指导短时域残差MPC的策略。结果显示其梯度精度接近收敛AD/有限差分,显存随迭代几乎不变,在多任务上六步规划成功率较标准iLQR提升28-98个百分点。

Extremal problem of area approximation Figure 1
2026-07-29math.OC

Extremal problem of area approximation

O.O. Pokutnyi, R.R. Salimov, M.V. Stefanchuk

Ukrainian approximation school represented by A. S. Romanyuk (see [2]) and, their collaborators. However, the problem of minimizing the enclosed area be-

2026-07-29优化控制

论文从数控切割、铣削和增材制造中“用有限直线段逼近曲线并减少偏差面积”的需求出发,把插值节点选择表述为面积最小化的极值问题。核心洞察是该几何准则不同于常见范数逼近,会直接改变最优分段方式:二次抛物线情形可显式求得面积公式,并证明均匀划分给出唯一全局最小;三次函数则显示最优节点非均匀,且给出两个内部节点时的精确坐标和最小面积。

Stronger Memory-Query Tradeoffs for Convex Optimization: The Limitations of Subquadratic Memory Figure 1
2026-07-29cs.DS

Stronger Memory-Query Tradeoffs for Convex Optimization: The Limitations of Subquadratic Memory

Michael Menart, Aleksandar Nikolov, Ohad Shamir

Department of Computer Science, University of Toronto, Vector Institute

2026-07-29模仿学习优化算法

本文针对一阶 oracle 凸优化中“省内存是否必然多查询”的问题,研究高精度场景下切平面法近二次内存需求的不可避免性。核心创新是引入带提示的标记子空间博弈,刻画低内存算法难以利用高熵约束矩阵探索有效查询方向。主要结果给出随机算法 Ω~(d²/√m) 与确定性算法 Ω~(min{d^1.6,d^(8/3)/m^(2/3)}) 查询下界,并显示 m≈d² 附近存在尖锐相变。

Parallel Model-Based Derivative-Free Optimization via Rank-Two KKT Updates Figure 1
2026-07-29math.OC

Parallel Model-Based Derivative-Free Optimization via Rank-Two KKT Updates

Donghan Wu, Pengcheng Xie

2026-07-29优化算法

本文针对模型型无导数优化在并行场景中仍受主节点KKT系统重构开销限制的问题,指出最小Frobenius范数更新的KKT矩阵由平移坐标内积决定,并用坐标翻转把插值集变化转化为至多秩二扰动,从而以Sherman-Morrison-Woodbury将逆更新降至O(n^2)。实验在530个基准问题上显示早期预算表现优于QARSTA,但实际墙钟增益仍受通信开销和维度规模影响。

Warm-Start Interior-Point Methods for Online Second-Order Cone Programming Figure 1
2026-07-29cs.DS

Warm-Start Interior-Point Methods for Online Second-Order Cone Programming

Krishna Harish

2026-07-29优化控制

面向MPC等在线SOCP场景,论文关注连续轮次约束右端小幅变化时冷启动内点法重复求解的浪费。核心洞察是用中心路径局部范数敏感性界刻画解随扰动的变化,使上一轮最优解落入Newton二次收敛域,避免欧氏界在秩亏矩阵下的问题。理论上将多轮复杂度降至约O(n^2.5log(1/ε)+Tn^2loglog(1/ε)),实验在n=50、p=100上显示约30–70倍单轮加速。

2026-07-28

88 篇
Long-time Stability and Convergence of Particle Swarm Optimization Figure 1
2026-07-28math.OC

Long-time Stability and Convergence of Particle Swarm Optimization

Giacomo Borghi, Hui Huang, Dohyeon Kim

Department of Mathematics, School of Mathematical and Computer Sciences (MACS), Heriot-Watt University, Edinburgh, UK, School of Mathematics, Hunan University, Changsha, China, Department of Computing and Mathematical Sciences, Caltech, Pasadena, USA

2026-07-28优化算法学习理论

本文针对粒子群优化长期行为缺乏离散时间严格理论的问题,将停滞假设下的 Schur 稳定性分析与均场方法连接起来,研究带噪声下界、无记忆的正则化 PSO。核心在于用离散 Lyapunov 泛函、Laplace 原理和同步耦合给出可量化条件,证明均场误差几何衰减到全局极小点邻域,并给出有限粒子相对均场的 O(N^{-1/2}) 误差及最终收敛界。

Anderson acceleration of the proximal point method: the exact adaptive minimax, a spectral phase transition, and optimal safeguarding Figure 1
2026-07-28math.NA

Anderson acceleration of the proximal point method: the exact adaptive minimax, a spectral phase transition, and optimal safeguarding

Zheng Jia, Yekini Shehu, Yonghong Yao

Zheng Jia 1 1 1 School of Statistics and Data Science, Jilin University of Finance and Economics, Changchun 130117, China, Yekini Shehu 2 2 2 (Corresponding Author) School of Mathematical Sciences, Zhejiang Normal University, Jinhua 321004, China, Yonghong Yao 3 3 3 School of Mathematical Sciences, Tiangong University, Tianjin 300387, China

2026-07-28安全鲁棒

本文针对近端点法在极大单调包含中的残差加速问题,追问 Anderson 加速等自适应仿射组合究竟能带来多少改进、何时有效以及 safeguard 的代价。核心洞察是把方法化为残差多项式并构造极端谱测度,证明自适应 minimax 精确为 d0/(K+1),存在 s≈1/K 的谱相变;线性问题无需 safeguard,非线性认证 O(1/k) 需且仅需每步两次 oracle。

Latency Decoupling in Low-Feedback Multi-User Networks via Overhearing-Driven NOMA Figure 1
2026-07-28cs.IT

Latency Decoupling in Low-Feedback Multi-User Networks via Overhearing-Driven NOMA

Mohsen Abedi, Ahmed Badawy, Amr Mohamed

M. Abedi, A. Badawy, and A. Mohamed are with the Dept. Computer Engineering, Qatar University, Doha, Qatar. Email: {mohsen.abedi

2026-07-28优化控制

针对非地面网络、海量物联网等低反馈多用户场景中,弱信道用户拖慢整体完成时间的问题,论文提出 ONOMA:把 RLNC 与符号感知 NOMA 结合,利用旁听用户的 ACK 时序推断相对信道强弱,并让强用户重构弱用户符号以消除干扰。仿真与分析显示,相比 TDMA、组播、FDMA、传统 NOMA 等,完成时间在两用户场景最多降 34%,更大非对称网络最多降 50%。

Fixed-time stabilization of systems with nilpotent matrices in the presence of large unknown delays Figure 1
2026-07-28math.OC

Fixed-time stabilization of systems with nilpotent matrices in the presence of large unknown delays

Kang-Kang Zhang, Emilia Fridman, Pengfei Wang

2026-07-28优化控制

针对实际控制中未知且可能很大的输入或测量时滞会削弱预测控制、且只渐近收敛的问题,论文利用人工时滞和 act-and-wait 结构,为幂零矩阵线性系统构造有限维状态反馈。结果显示,在仅已知延迟上界时,名义系统可在固定时间归零;有扰动、小矩阵摄动和非线性项时可获得固定时间 ISS,并推广到单积分器快变测量延迟及离散时间情形。

Communication Security via Temporal Dependency Figure 1
2026-07-28math.OC

Communication Security via Temporal Dependency

Mohsen Abedi, Ahmed Badawy, Amr Mohamed

M. Abedi, A. Badawy, and A. Mohamed are with the Dept. Computer Engineering, Qatar University, Doha, Qatar. Email: {mohsen.abedi

2026-07-28优化控制

面向无基础设施、应急或高速动态无线网络中难以保证密钥与信道优势的场景,论文提出把跨时隙依赖作为安全资源:用状态链式 RLNC 将解释当前块所需同步状态嵌入前一块,使窃听者即使解码数据包也难区分真实包与 dummy 包,一次失同步会持续传播。分析给出失同步概率、持续性与重同步复杂度,并通过功率和干扰优化显示在最坏假设下可实现亚秒级窃听者失同步。

Optimum Multiple Sampling Plan Based on the Process Capability Index $C_{py}$ Under Type-II Hybrid Censoring Figure 1
2026-07-28stat.AP

Optimum Multiple Sampling Plan Based on the Process Capability Index $C_{py}$ Under Type-II Hybrid Censoring

Rajat Das, Tanmay Kayal, Yogesh Mani Tripathi, Tanmay Sen

2026-07-28优化控制

针对传统多阶段验收抽样在阶段依赖下计算复杂、且较少同时考虑过程能力与保修成本的问题,论文提出基于广义过程能力指数 Cpy 的阶段独立多重抽样计划,并结合 Type-II 混合删失和按比例保修建立成本约束优化。数值模拟与实例显示,该方案相较单阶段抽样可降低平均样本量和期望总成本,同时满足生产者与消费者风险约束。

Using Subproblem Objective Gaps in Inexact Augmented Lagrangian and ADMM Algorithms, with Applications to Stochastic Mixed Integer Programming Figure 1
2026-07-28math.OC

Using Subproblem Objective Gaps in Inexact Augmented Lagrangian and ADMM Algorithms, with Applications to Stochastic Mixed Integer Programming

Jonathan Eckstein

Department of Management Science and Information Systems, Rutgers Business School Newark and New Brunswick, Rutgers University

2026-07-28优化控制

本文面向增广拉格朗日法和 ADMM 中子问题难以精确求解的问题,研究如何仅用目标函数次优间隙来控制非精确迭代。核心洞察是通过“部分强凸性”把目标值误差转化为乘子更新误差,并修正 ADMM 的近似准则。主要结果是证明相应 ALM/ADMM 在误差平方根可求和时收敛,并据此为随机混合整数规划的拉格朗日界计算提供更灵活的 Frank-Wolfe 子问题求解框架。

Optimal Convex Optimization with Inexact Second-Order Oracles Figure 1
2026-07-28math.OC

Optimal Convex Optimization with Inexact Second-Order Oracles

Lesi Chen, Chengchang Liu, Luo Luo, John C.S. Lui, Jingzhao Zhang

IIIS, Tsinghua University, Department of Artificial Intelligence, Westlake University, School of Data Science, Fudan University, Department of Computer Science and Engineering, The Chinese University of Hong Kong

2026-07-28优化算法

针对精确 Hessian 代价高、既有非精确二阶方法在精确情形也达不到最优复杂度的问题,论文提出 AINE,将加速 Newton 外梯度推广到 δ-非精确 Hessian。其关键是避免依赖三阶非精确 oracle,并用二阶子程序实现三阶平滑情形的张量步。结果给出与下界匹配的 ISO 复杂度:L2 情形为 O((δ/ε)^{1/2}+(L2/ε)^{2/7}),L3 情形为 O((δ/ε)^{1/2}+(L3/ε)^{1/5})。

Asymptotic behavior of the first Robin eigenvalue of nonlinear operators Figure 1
2026-07-28math.AP

Asymptotic behavior of the first Robin eigenvalue of nonlinear operators

Rosa Barbato, Francesco Della Pietra, Alba Lia Masiello

2026-07-28优化控制

本文关注 Robin 边界参数趋于 0 或无穷时,非线性 p-Laplace 第一特征值如何逼近 Neumann 与 Dirichlet 极限;动机在于线性谱渐近结果难以直接迁移到非 Hilbert、退化的非线性算子。核心创新是用变分构造与边界修正给出尖锐展开,证明 β→∞ 时特征值缺口按 β^{-1/(p-1)} 衰减,主项由 Dirichlet 特征函数边界梯度积分决定,并给出 β→0 的相应精确渐近。

The Convergence and Error Analysis of Coordinate Descent Methods with Compression for Full Configuration Interaction Figure 1
2026-07-28math.NA

The Convergence and Error Analysis of Coordinate Descent Methods with Compression for Full Configuration Interaction

Yingzhou Li, Qiang Wu

School of Mathematical Sciences, Shanghai Key Laboratory for Contemporary Applied Mathematics, Fudan University and, Key Laboratory of Computational Physical Sciences, Ministry of Education (), School of Mathematical Sciences, Fudan University ()

2026-07-28学习理论

针对FCI哈密顿量维度组合爆炸、CDFCI实际需压缩以控制稀疏规模但缺乏收敛理论的问题,论文把压缩迭代分析为受限优化问题,刻画其极限点与受限特征值关系;在谱间隙和基态特征向量指数衰减等假设下,证明线性收敛,并给出压缩阈值τ导致的能量误差为O(τ²),数值实验支持该结论。

A Nonlinear CTH-Based Adaptive Cruise Controller With Safety and String Stability Guarantees Figure 1
2026-07-28math.OC

A Nonlinear CTH-Based Adaptive Cruise Controller With Safety and String Stability Guarantees

Dionysios Theodosis, Amirhossein Samii, Nikolaos Bekiaris-Liberis

2026-07-28规划控制安全鲁棒

针对自适应巡航车队中安全约束与串稳定性往往分开处理、且常依赖线性化分析的问题,论文提出基于常时距策略的非线性控制器,用速度相关增益限制车速、用饱和型非线性抑制激进加速度,并构造显式间距误差动力学。结果证明碰撞自由集合正不变、间距误差收敛,并给出非线性 Lp 串稳定充分条件,且扩展到三阶车辆模型。

Optimal Rank Selection for Nonnegative Matrix Factorization via $\ell_{2,0}$-Norm Regularization Figure 1
2026-07-28math.OC

Optimal Rank Selection for Nonnegative Matrix Factorization via $\ell_{2,0}$-Norm Regularization

Yulin He, Ran Gu

2026-07-28优化控制

本文针对 NMF 分解秩需预先指定、交叉验证代价高且启发式阈值不稳定的问题,将列 ℓ2,0 正则同时加到两个非负因子上,并用 warm-start 的 λ 路径从过估秩逐步删除冗余列;同时给出 iPALM、尺度平衡版本和 PASM,并分析 KL 收敛与秩恢复条件。实验显示在合成与基准数据上秩估计接近参考值,PASM 效率较好,但结论仍依赖所测数据与参数路径设定。

On computing Goldstein approximate second-order stationary points of structured nonsmooth nonconvex programs Figure 1
2026-07-28math.OC

On computing Goldstein approximate second-order stationary points of structured nonsmooth nonconvex programs

Jiewen Guan, Anthony Man-Cho So

2026-07-28优化算法

本文针对非光滑非凸优化中二阶驻点难以确定性计算的问题,研究随机化能否给出可实现保证。核心做法是用随机平滑把 L-光滑函数转化为 Hessian Lipschitz 的平滑目标,并证明平滑目标的近似二阶驻点可转移为原问题的 Goldstein 近似二阶驻点。主要结果是给出纯一阶随机算法,oracle 复杂度为 O~(n²/ε⁹+n³/ε⁷),并扩展到弱凸函数与双层优化场景。

On the hardness of deterministic second-order optimization of functions with Lipschitz gradients Figure 1
2026-07-28math.OC

On the hardness of deterministic second-order optimization of functions with Lipschitz gradients

Jiewen Guan, Anthony Man-Cho So

∗Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Shatin, †Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Shatin

2026-07-28优化算法

本文关注 C1,1 函数梯度虽 Lipschitz 但 Hessian 可不光滑时,二阶确定性方法能否有效找到近似二阶驻点。作者以 Goldstein 二阶次微分建立近似驻点框架,并给出 Clarke/Goldstein 二阶次微分的标量化与链式法则。主要结果证明零保持确定性算法无法在有限二阶 oracle 调用内保证成功,一般确定性算法在维度 n 下至少需超过 n-3 次调用,说明弱凸函数的确定性二阶优化本质上不可 tractable。

Optimal Control with Expectation Constraint in a Smooth Boundary Case Figure 1
2026-07-28math.OC

Optimal Control with Expectation Constraint in a Smooth Boundary Case

Bruno Bouchard (CEREMADE), Lucas Gnecco Heredia (LAMSADE), Ludovic Moreau, Kim-Anh Pham (CEREMADE)

2026-07-28规划控制优化算法学习理论

本文受资产负债管理中“在期望风险约束下最大化收益”的控制问题驱动,将期望约束通过鞅表示转化为带状态约束的随机最优控制,并抓住约束诱导边界具有吸收性的洞察,给出平滑边界上的 Dirichlet 条件。主要创新是对无界鞅控制作截断,构造具比较原理的 PDE 近似序列,并在退化情形加小噪声恢复一致椭圆性;文中证明两类近似均收敛到原问题,并用 PINN 在简化寿险 ALM 模型上展示数值可行性。

Stochastic Control of Addiction with State-Dependent Jump Relapse Figure 1
2026-07-28math.OC

Stochastic Control of Addiction with State-Dependent Jump Relapse

Dounia Aissi (ULaval), Ioana Ciotir (LMI), Dan Goreac, Juan Li

I. Ciotir is with INSA de Rouen, Normandie University, LMI (EA 3226 –, D. Goreac and J. Li are with the School of Mathematics and Statis-, tics, Shandong University Weihai, Weihai 264209, P.R. China (e-mail:

2026-07-28规划控制

本文动机是用比布朗噪声更贴近复吸事件的随机机制刻画成瘾资本演化,将 Becker–Murphy 理性成瘾模型改写为带状态依赖跳跃强度的 PDMP 控制问题。核心洞察在于把复吸风险写入非局部 HJB 项,从而区分有消费上限与无上限两类策略结构;主要结果包括有界情形下值函数唯一粘性解与 bang-bang 最优消费,无上限情形下给出线性反馈和闭式值函数。

A Homogeneous Tensor Framework for High-Order Trust-Region and Spherical Polynomial Optimization Figure 1
2026-07-28math.OC

A Homogeneous Tensor Framework for High-Order Trust-Region and Spherical Polynomial Optimization

Wenqi Zhu, Haibin Chen, Guanglu Zhou

2026-07-28优化算法

高阶信赖域/正则化方法的瓶颈在于 p≥3 时 Taylor 子问题变成难解的非凸多项式优化。本文将步长增广为齐次张量形式,把给定半径边界问题转化为球面多项式优化,并在三次情形用二次平移建立三块多线性等价,配套 PAM 闭式交替更新。理论上 Ada-HTM 在若干非退化与局部细化条件下达到 ARp 型复杂度,实验显示其在低秩、病态和尺度不良问题上更有优势。

Smooth Learning with Hard Constraints via Legendre-Regularized Policies Figure 1
2026-07-28math.OC

Smooth Learning with Hard Constraints via Legendre-Regularized Policies

Zikun Lin, Rui Chen, Yijie Wang

2026-07-28优化算法

论文针对情境优化中策略既要表达复杂上下文关系、又要严格满足可行域约束并可梯度训练的矛盾,提出用 Legendre 正则化优化器来参数化策略:模型输出潜变量,最终决策由原可行域上的正则化问题给出。作者证明该映射单值、位于相对内点、可显式求雅可比、Lipschitz 且具通用逼近能力,并在 newsvendor 与资源分配实验中优于基线。

Closed-loop solvability of infinite-horizon stochastic linear-quadratic problem for Markov regime-switching jump-diffusion system Figure 1
2026-07-28math.OC

Closed-loop solvability of infinite-horizon stochastic linear-quadratic problem for Markov regime-switching jump-diffusion system

Kai Ding, Fan Wu, Jie Xiong, Xinyue Zhang

Department of Mathematics, Southern University of Science and Technology, Shenzhen 518055, China

2026-07-28生成模型

本文面向带马尔可夫状态切换且切换时同步发生跳变的无限时域随机线性二次控制问题,动机是刻画系统在 regime 变化中可能出现的状态损失或增益。核心洞察是将跳变完全绑定到马尔可夫链转移,而非外生泊松冲击,并在不定权重下分析闭环可解性。主要结果给出由耦合代数 Riccati 方程稳定解表示的最优反馈控制,并用于终身财富跟踪投资策略。

Understanding the role and value of battery storage in renewables-rich distribution grids under uncertainty and different market paradigms Figure 1
2026-07-28eess.SY

Understanding the role and value of battery storage in renewables-rich distribution grids under uncertainty and different market paradigms

Peer Valentin Brigger, Vineet Jagadeesan Nair, Anuradha Annaswamy

Department of Mechanical Engineering, Massachusetts Institute of Technology, Department of Information Technology and Electrical Engineering, ETH Zurich, 8092 Zurich, Switzerland

2026-07-28安全鲁棒

面向高可再生能源渗透下配电网负荷增长、光伏预测误差和储能选址价值不均的问题,论文用OU过程刻画光伏不确定性,并在IEEE 123节点馈线上比较平价、电实时定价与本地电力市场。结果显示LEM通常降低客户和系统成本、消除失负荷,但低光伏渗透时可能伤害客户;储能价值强依赖位置、光伏/电池比例和是否共址,新增储能边际价值随电池规模下降。

Reverse-Time Diffusion Processes for Discrete Time Linear and Nonlinear Systems with non-Gaussian Noise Figure 1
2026-07-28eess.SY

Reverse-Time Diffusion Processes for Discrete Time Linear and Nonlinear Systems with non-Gaussian Noise

Soura Dasgupta, Brian D. O. Anderson, Raghuraman Mudumbai

2026-07-28生成模型三维

本文针对离散时间扩散模型常需先转成连续 SDE 再反向离散化的问题,直接研究非高斯初态、非高斯噪声下随机差分方程的反向过程。核心贡献是给出反向噪声独立性、白噪声性与样本路径一致的构造条件,并证明线性高斯输入情形下反向模型何时可输入仿射;主要结果显示,对高斯混合等大量非高斯状态分布,输入仿射反向扩散并不存在。

Scalable No-Stockout Charging Scheduling for Battery Swapping Under Time-of-Use Prices Figure 1
2026-07-28cs.CE

Scalable No-Stockout Charging Scheduling for Battery Swapping Under Time-of-Use Prices

Eunbin Cho, Junki Cho, Hakjin Lee, Jaehoon Sim, Junghoon Seo

Eunbin Cho is with the School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, GA 30332 USA (e-mail:

2026-07-28优化控制

面向换电站在分时电价下既降充电成本又避免缺货的调度问题,论文把单块电池身份、兼容性、返还时间和有限充电桩纳入事件级 MILP,并给出等价降维模型与价格引导的电池路径启发式。实验中启发式在各规模均保持全服务,求解中位数约0.24至8秒;商业站30天1002次换电回放中全满足服务,较即时充电降成本约50%。

LiFT-MPC: Language-in-the-Loop Feedback Tuning of Cost Previews for MPC Figure 1
2026-07-28math.OC

LiFT-MPC: Language-in-the-Loop Feedback Tuning of Cost Previews for MPC

Xinyi Yi, Ioannis Lestas

X. Yi and I. Lestas are with the Department of Engineering, University of Cambridge, Trumpington Street, Cambridge CB2 1PZ, UK.

2026-07-28规划控制

论文针对时变经济目标下 MPC 对价格等预览信号高度敏感、仅靠历史序列难以捕捉新闻和事件影响的问题,提出 LiFT-MPC:在保留数值基线预测的基础上,用语言上下文生成残差修正,并通过闭环控制性能损失进行延迟在线更新。作者给出性能与实用稳定性保证,并在澳大利亚 NSW 储能调度实验中显示,结合真实电价和新闻上下文可提升经济闭环表现,在线适应进一步带来收益。

Scale Weight Decay and Train Better Figure 1
2026-07-28cs.LG

Scale Weight Decay and Train Better

Anuj Apte

2026-07-28优化控制

论文针对大规模训练中恒定解耦权重衰减会持续压低权重范数、改变原始优化目标的问题,提出按当前学习率与峰值学习率之比缩放权重衰减。作者从 Robbins–Monro 条件出发证明其在 SGD 和 Muon 中保留无正则方法的渐近驻点性质,并解释权重范数趋稳机制;在 72–930M MoE 训练中,Muon-SW 在最大规模上以相同超参约快 30% 达到同等验证损失。

Continuous Data Assimilation for the 2D Navier-Stokes Equations from Partial Tangential Boundary Observations Figure 1
2026-07-28math.AP

Continuous Data Assimilation for the 2D Navier-Stokes Equations from Partial Tangential Boundary Observations

Gianmarco Del Sarto, Buddhika Priyasad

2026-07-28学习理论

本文针对海洋等场景中内部流场难观测的问题,研究仅用部分边界切向速度进行二维 Navier-Stokes 连续同化。核心洞察是足够强且足够细的边界反馈可为误差方程诱导强制谱隙,并与非线性能量产生估计结合。主要结果给出指数同步判据,并覆盖无外力、小外力、大黏性、正边界摩擦及含刚体切向运动的完美滑移情形。

Projected-Gradient Analysis for Open-Domain Convex Optimization under Boundary Blow-Up:Application to Controllability Scoring Figure 1
2026-07-28math.OC

Projected-Gradient Analysis for Open-Domain Convex Optimization under Boundary Blow-Up:Application to Controllability Scoring

Kazuhiro Sato

2026-07-28规划控制优化算法学习理论

针对投影梯度法在负 log-det、逆迹等开域矩阵目标上可能试探到定义域外的问题,论文给出带定义域检查的 Armijo 投影梯度安全邻域分析,证明步长有逐运行但迭代无关的正下界,并得到全序列收敛、次线性残差和受限强凸下的线性收敛;在可控性评分中进一步刻画分配可行性、唯一性及候选排除对最优分配的影响。

When Rates Are Geometric: Rate-Certificate Transfer for Contact Splittings in Optimization Figure 1
2026-07-28math.OC

When Rates Are Geometric: Rate-Certificate Transfer for Contact Splittings in Optimization

George A Kevrekidis

Department of Applied Mathematics and Statistics, Johns Hopkins University, Baltimore, MD 21218, USA

2026-07-28优化算法

本文针对连续时间优化ODE的收敛证书不能自动保证离散算法收敛这一问题,引入接触哈密顿系统中的衰减恒等式,将增广能量与保形因子作为速率证书,并证明在可检验假设下,高阶接触 splitting 可在后向误差有限时域内转移该证书。二次 heavy ball 与强凸情形验证了条件,实验显示保形因子跟踪阶数符合理论且在病态与深度学习任务上表现有竞争力。

Optimal Reward Shaping: Autonomous Car Parking Case Study Figure 1
2026-07-28cs.LG

Optimal Reward Shaping: Autonomous Car Parking Case Study

Emre Özkaya, Nicolas R. Gauger

2026-07-28强化学习

针对非完整约束下自动泊车强化学习易陷入策略停滞、过度避险等局部最优的问题,论文提出参数化奖励塑形,将覆盖门控的姿态对齐、换向正则和与最终评分一致的终止条件结合,并强调奖励参数需与 DQN 超参数联合贝叶斯优化。实验显示,共优化后相较未校准基线在泊车成功率和轨迹平滑性上明显提升。

Exact Worst-case Convergence Rates of Distributed Gradient Tracking Methods Figure 1
2026-07-28math.OC

Exact Worst-case Convergence Rates of Distributed Gradient Tracking Methods

Qiuchen Tian, Li Chai, Jinming Xu

State Key Laboratory of Industrial Control Technology, College of Control Science and Engineering, Zhejiang University, Hangzhou 310027, China

2026-07-28视觉感知优化算法学习理论

本文针对分布式梯度跟踪方法常见收敛率分析偏保守的问题,研究 DIGing 与 AugDGM 的精确最坏情形收敛率。核心做法是用特征分解把多输入多输出稳定性问题化为一组参数变化的单输入单输出系统,并给出显式公式。结果显示 AugDGM 在相同函数与通信条件下优于 DIGing,且图连通性存在 σ=1/3 的拐点,决定其能否达到集中式梯度下降的最优速率。

Existence of stable Lur'e systems for which the O'Shea-Zames-Falb stability test fails Figure 1
2026-07-28math.OC

Existence of stable Lur'e systems for which the O'Shea-Zames-Falb stability test fails

Andrey Kharitenko

2026-07-28优化控制

本文针对 Lur’e 系统中 O’Shea-Zames-Falb 稳定性判据是否也是必要条件这一长期问题,构造基于 copositive cone 的更一般 full-block multiplier 稳定性检验。作者证明有限时域 OZF 乘子存在保守性,并进一步说明一个不满足 OZF 判据的离散时间单输入互联系统仍可被新乘子认证为鲁棒稳定,从而反驳 Carrasco 的必要性猜想。

A Multi-stage Constrained Optimization Framework for Data-driven Problems Figure 1
2026-07-28cs.LG

A Multi-stage Constrained Optimization Framework for Data-driven Problems

Ye Shi

2026-07-28优化算法

这篇论文针对VAE用于数据驱动黑箱约束优化时的三类难点:潜空间采样不稳定、关键决策变量难识别、硬约束易被惩罚项弱化。核心做法是把EC-VAE特征选择、均匀化潜空间变换和约束优先滤波优化串成多阶段框架,使目标与约束先嵌入少量潜变量再搜索。实验覆盖合成任务和药物发现,报告能更稳定获得可行且接近最优的解,但相对增益的具体来源仍需更多消融支撑。

Convexity and SOS-Convexity of Sum of Separable and Biquadratic Quartic Polynomials and Optimization Figure 1
2026-07-28math.OC

Convexity and SOS-Convexity of Sum of Separable and Biquadratic Quartic Polynomials and Optimization

Shaon Naskar, Sujeet Kumar Singh

Indian Statistical Institute, Hyderabad Unit, India, 500007

2026-07-28优化算法

针对四次及以上多项式非负性与凸性判定强 NP-hard、通用 SOS/SDP 代价高的问题,论文提出可分项加双二次项的 SPBQ 四次多项式类,刻画其凸性与 SOS-凸性的边界:n×2 双二次情形二者等价,3×3 时给出凸但非 SOS-凸反例,并在无约束/约束优化中通过结构化 SDP 显著降低计算时间和内存需求。

On the Bellman equation in recursive stochastic dynamic programming with the CES aggregator Figure 1
2026-07-28math.OC

On the Bellman equation in recursive stochastic dynamic programming with the CES aggregator

Anna Jaśkiewicz, Andrzej S. Nowak

2026-07-28优化控制

本文针对递归效用在随机动态规划中难以直接应用 Bellman 方法的问题,研究 CES 聚合器与熵型确定性等价算子下的无限期 Markov 决策模型。核心在于给出适用于非加性偏好的存在唯一性论证,并将 Koopmans 方程与 Bellman 方程的解联系起来。主要结果表明,在较温和条件下 Bellman 方程有唯一解,任一平稳策略的 Koopmans 方程也唯一,从而可测最大选择子构成最优平稳策略。

New Globalized Newton-Type Methods for Nonconvex Optimization Problems Figure 1
2026-07-28math.OC

New Globalized Newton-Type Methods for Nonconvex Optimization Problems

Vo Thanh Phat, Tuyen Tran

2026-07-28优化算法

针对经典牛顿法在非凸优化中缺乏全局收敛、而常见正则化牛顿法需每步修改 Hessian 的成本问题,论文提出带线搜索的全局化牛顿框架,只在牛顿方向存在且合适时使用,并可统一若干梯度-牛顿混合方法、导出外梯度牛顿变体。主要结果是在 PLK 等较弱条件下证明全局收敛,覆盖非孤立聚点,并给出局部超线性/二次收敛及强拟凸优化情形的收敛分析。

When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation Figure 1
2026-07-28cs.LG

When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation

Mojtaba Soltanalian

\addr Department of Electrical and Computer Engineering, University of Illinois Chicago

2026-07-28学习理论

论文针对低比特网络中“能否用更深残差计算弥补数值精度”的问题,提出以低比特操作库、固定时域与执行语义为资源的理论框架。核心洞察是深度只能逼近声明库的松弛可达集,存在不可越过的结构误差下界;有限纯调度以约 O(D^-1) 收敛,元数据与算术实现会额外限制效果。结果还表明全状态回写可能冻结更新,而误差反馈可缓解;匹配一阶高精度教师通常需要线性增加深度,并可在训练前给出可行、不可行或未决认证。

Support profiles of full-capacity Pareto spectra of order three Figure 1
2026-07-28math.OC

Support profiles of full-capacity Pareto spectra of order three

Samir Adly

Laboratoire XLIM, Université de Limoges, 123 avenue Albert Thomas, 87060 Limoges CEDEX, France.

2026-07-28优化控制

本文关注三阶矩阵达到最大 Pareto 特征值数时,这些特征值究竟由哪些支撑集产生;动机是已有结果只知道容量上限为 9,缺少分布结构。核心创新是引入 assigned support profile,并用二阶容量界、富二元支撑图无三角形等限制完成分类。主要结果证明满容量三阶矩阵的支撑规模分布只能是 (1,5,3)、(2,4,3) 或 (2,5,2),并构造正则例子及对应非空开集。

KAYROS: An Anytime and Exact Open-Source Solver for Duration-Minimization Time-Dependent Vehicle Routing. A Technical Report and a Case Study in Human-AI Engineering Figure 1
2026-07-28math.OC

KAYROS: An Anytime and Exact Open-Source Solver for Duration-Minimization Time-Dependent Vehicle Routing. A Technical Report and a Case Study in Human-AI Engineering

Florian Rascoussier

openly available solver that is both anytime (streaming improving solutions from the, intensive human–AI collaboration that made this body of work feasible while keeping its, Human–AI Collaboration, AI-assisted Research, Context-Oriented Programming, ∗IMT Atlantique, Lab-STICC, CNRS, UMR 6285 (équipe DECIDE) and INSA Lyon, Inria, CITI, UR3720, Why this report also documents a collaboration . . . . . . . . . . . . . . . . . ., Packaging and availability . . . . . . . . . . . . . . . . . . . . . . . . . . . . . .

2026-07-28优化算法

面向出发时间会影响行程时长、且缺少可复现实用求解器的时间依赖车辆路径问题,KAYROS把anytime启发式与精确branch-price-and-cut统一到分段线性时间函数上,并配套公开校验证书与OSM生成的Poryos2026基准。其在MAMUT-routing上给出468个最优性证书、5项改进参考值;但未做与闭源或既有精确TD求解器的直接性能对比。

A Novel Optimization Model for Solving the Timetabling Problem at Finnish Universities Figure 1
2026-07-28math.OC

A Novel Optimization Model for Solving the Timetabling Problem at Finnish Universities

Kimmo Nurmi, Jari Kyngäs, Pauliina Halme

aSatakunta University of Applied Sciences, Pori, Finland, bEduix Ltd., Tampere, Finland, Research Director at Satakunta University of Applied Sciences, University of Turku, CEO, Chairman & Founder at CI Computational Intelligence Ltd, Specialist Researcher at Satakunta University of Applied Sciences, PhD in computer science, University of Turku, CDO & Founder at CI Computational Intelligence Ltd, Partner Director at Eduix Ltd, challenge is to balance the preferences of three key stakeholders: the university, that everything runs effortlessly and collaboratively. Its efficiency significantly, intensified, the features of the university timetabling problem have changed. This

2026-07-28优化算法

这篇论文针对芬兰高校排课从研究算法到真实落地长期脱节的问题,提出面向大学、教师和学生三方目标的 CRONOPT 优化模型,将资源利用、教师工作负荷与福祉、学生学习进度统一为约 40 个约束和优化目标,并规划与主流教务系统集成。主要结果是完成可行性研究和流程建模,给出待细化的 PEASTP 求解方向;实际部署效果和量化增益文中未充分说明。

Optimization of Kinetic--Stoichiometric Growth Bounds over Autocatalytic Subnetworks Figure 1
2026-07-28math.OC

Optimization of Kinetic--Stoichiometric Growth Bounds over Autocatalytic Subnetworks

Víctor Blanco, Gabriel González

† Institute of Mathematics (IMAG), Universidad de Granada, Spain

2026-07-28优化算法学习理论

论文针对传统最大放大因子只看化学反应子网的化学计量结构、忽略反应速率的问题,提出把动力学消耗范数纳入自催化子网选择,直接优化动力学—化学计量增长上界。其核心是将问题建成混合整数双线性模型,并利用动力学范数的有限离散取值,结合参数枚举与 Dinkelbach 型分式规划获得全局最优。实验在 Oregonator、甲醛糖反应和碳固定循环等网络中表明,最优增长上界子网可能不同于 MAF 最优子网,也揭示该上界有时准确、有时偏保守。

Output Regulation for Linear Parabolic Systems Using Finite-Dimensional Tracking-Error-Based Control Figure 1
2026-07-28math.OC

Output Regulation for Linear Parabolic Systems Using Finite-Dimensional Tracking-Error-Based Control

Bingsen Li, Emilia Fridman, George Weiss

School of Electrical & Computer Engineering, Tel Aviv University, Tel-Aviv, Israel, School of Mathematics and Statistics, Central South University, Changsha, PR China

2026-07-28视觉感知规划控制

面向反应扩散等抛物型 PDE 的输出跟踪与扰动抑制,论文关注传统 PDE 观测器难以有限维实现的问题。其核心做法是用调节方程把输出调节转化为组合系统的部分镇定,并基于模态分解设计全阶误差观测增益。主要结果给出截断可观性条件、LMI 选阶方法、增益一致有界性证明,并扩展到未知时变测量延迟场景。

Online Policy Evaluation for MDPs with Dynamic UBSR Measures Figure 1
2026-07-28cs.LG

Online Policy Evaluation for MDPs with Dynamic UBSR Measures

Weikai Wang, Erick Delage

2026-07-28强化学习数据集/基准

本文针对风险敏感强化学习中在线策略评估缺少通用动态风险度量与收敛保证的问题,提出面向动态 UBSR 的线性函数逼近 UBSR-TD,把一般损失函数嵌入 TD 误差以适配多类风险偏好,并给出几乎必然收敛条件。实验验证了理论趋势,加速变体改善收敛,易腐库存案例中相较静态、短视和风险中性基线表现更好。

Nesterov acceleration in optimizing over probability measures Figure 1
2026-07-28math.OC

Nesterov acceleration in optimizing over probability measures

Jiaqi Tang, Qin Li, Wilfrid Gangbo

Department of Statistics, University of Wisconsin–Madison, Madison, WI 53706, USA, Department of Mathematics, University of Wisconsin–Madison, Madison, WI 53706, USA, Department of Mathematics, University of California, Los Angeles, Los Angeles, CA 90095, USA

2026-07-28优化控制

本文针对概率测度空间上的优化缺少可实现加速算法这一问题,将欧氏空间的 Heavy-ball 与 Nesterov 动量思想推广到 Wasserstein/概率测度设置。核心做法是用相空间提升引入速度变量,再用 Hilbert 空间提升恢复线性结构并连接粒子实现。主要结果是给出离散时间算法及非渐近收敛保证,同时刻画迭代次数与粒子数对误差的影响。

Finite-Time Analysis of the Natural Policy Gradient in Finite-Horizon Markov Decision Processes Figure 1
2026-07-28cs.LG

Finite-Time Analysis of the Natural Policy Gradient in Finite-Horizon Markov Decision Processes

Asha Barua, Sajad Khodadadian

Grado Department of Industrial and Systems Engineering, Virginia Polytechnic Institute and State University, remain unavailable, even in the tabular setting., analogous discount-induced contraction is available in the finite-horizon setting, where policies

2026-07-28强化学习优化算法

有限时域 MDP 更贴近机器人操作等固定步长决策,但既有 NPG 理论多依赖无限时域折扣收缩。本文针对已知、随时域变化的转移核和非平稳策略,给出精确 NPG 的首个有限时间分析:常数步长在表格和线性 MDP oracle 情形达到 O(H²/t) 次线性收敛,递增步长则得到由分布错配系数控制的几何收敛,并提出仅依赖 H 的鲁棒步长日程。

Exact Reachability by Positive Vertex-Centroid Moves Figure 1
2026-07-28cs.CG

Exact Reachability by Positive Vertex-Centroid Moves

Yongjie Guan

Zhejiang University of Technology

2026-07-28优化控制

本文回应 Open Problems Project 中“能否通过顶点沿其与质心连线移动把多边形化为正多边形”的可达性问题。核心洞察是把每次移动表示为坐标矩阵上的秩一扰动,并用正参数共轭词与反函数定理建立局部精确可达,再由连通性推广到全局。主要结果表明,平面非共线标号构型当且仅当可达正 n 边形;保持简单性的情形中,唯一障碍是取向。

Learning from the Descent Direction: Adaptive Gradient Descent under One-Sided Hölder Regularity Figure 1
2026-07-28cs.LG

Learning from the Descent Direction: Adaptive Gradient Descent under One-Sided Hölder Regularity

Arzu Ahmadova, Ismail Huseynov

Weierstrass Institute for Applied Analysis and Stochastics, Technical University of Berlin, Germany

2026-07-28优化算法

这篇论文针对传统 Lipschitz/Hölder 光滑性用全梯度变化定步长、在负曲率或正交变化较大时过于保守的问题,提出只估计下降方向上正向 Hölder 曲率的自适应梯度下降,并配合充分下降保护。理论上给出非凸可微目标的最优迭代点驻点率 O(K^{-α/(1+α)});两个全批量受控分类和回归实验中,其最终损失、梯度范数等指标优于若干标量步长基线,但增益可能主要来自特定构造下的方向曲率分离。

Curvature Recycling Douglas-Rachford Splitting: Transported Quasi-Newton Models for Expensive Smooth Proximal Subproblems Figure 1
2026-07-28math.OC

Curvature Recycling Douglas-Rachford Splitting: Transported Quasi-Newton Models for Expensive Smooth Proximal Subproblems

Musa Maharramov

2026-07-28优化控制

本文针对 DRS 中反复求解昂贵光滑 proximal 子问题的问题,指出不同外层中心虽变化但 Hessian 曲率共享。作者提出 CR-DRS,将旧残差运输到新中心并复用 BFGS/SR1 拟牛顿模型,用证书测试和固定梯度步回退保证可靠性;理论上给出全局线性收敛和局部超线性近似条件,实验显示在 l1 与 TV 正则问题上显著减少昂贵梯度调用。

Feedback stopping rules in path-dependent controller-stopper games Figure 1
2026-07-28math.OC

Feedback stopping rules in path-dependent controller-stopper games

Magnus Perninge

Magnus Perninge 1 1 1 M. Perninge is with the Department of Mathematics, Mälardalen University, Västerås

2026-07-28规划控制

本文针对路径依赖控制-停止博弈中“停止方需实时观察控制”的不现实假设,研究仅依赖状态轨迹的反馈停止规则。核心是把首次接触原则扩展到该类零和博弈,并用纯概率方法处理可退化的非马尔可夫 SDE。主要结果证明反馈停止规则下的博弈值与既有非预期策略值一致,给出最优反馈停止时刻,并在非零和情形中构造其作为 ε-Nash 均衡组成部分。

H$_1$-ISS Analysis and Boundary Control Design for Coupled Linear ODEs and Hyperbolic PDEs Figure 1
2026-07-28math.OC

H$_1$-ISS Analysis and Boundary Control Design for Coupled Linear ODEs and Hyperbolic PDEs

Franthiescolly Vieira de Carvalho, Daniel Coutinho, Gustavo de Andrade, Christophe Prieur, Mohamed Maghenem

Department of Automation and Systems, Universidade Federal de Santa Catarina, Florianópolis, SC, 88040-900, Brazil., Université Grenoble Alpes, CNRS, Grenoble-INP, GIPSA-lab, F-38000, Grenoble, France.

2026-07-28规划控制学习理论

面向边界执行、传感和扰动同时存在的分布参数系统,论文关注耦合线性 ODE 与双曲 PDE 的稳定与扰动抑制问题。核心是把既有 L2 意义下的 ISS 分析推进到 H1 框架,在较弱扰动假设下给出状态 H1 范数有界性及上界,并进一步转化为 LMI 形式的稳定性检验、性能验证和边界控制器设计条件,数值例子用于展示可行性。

Structured Coordination Games on Planar Graphs: a Dual Approach Figure 1
2026-07-28cs.GT

Structured Coordination Games on Planar Graphs: a Dual Approach

John S. McAlister

Princeton University, Program in Applied and Computational Mathematics, NSF Center for Analysis and Prediction of Pandemic Expansion (APPEX)

2026-07-28优化控制

本文关注有关系结构的纯协调博弈中,非共识纳什均衡为何依赖图结构且难以解析。核心洞察是把平面图上的策略划分转到对偶图中,将均衡划分理解为割/子图目标的局部最小值,从而连接局部社区检测与全局最小割直觉。主要结果证明策略空间与对偶中无桥子图空间存在准等距对应,并在双策略情形构造可复现近视最佳响应动态的子图过程;但作者也说明该对偶化主要提供几何解释,不带来计算效率增益。

Convexifying Mean-Field Control: An Occupation-Measure and Frank-Wolfe Approach Figure 1
2026-07-28math.OC

Convexifying Mean-Field Control: An Occupation-Measure and Frank-Wolfe Approach

Di Yu, Sixiong You, Chaoying Pei

2026-07-28规划控制优化算法

面向大规模无人机/机器人群体控制,论文针对 PDE 型平均场控制高维难算、学习方法缺少保证的问题,将 MFC 提升到占用测度空间,得到带线性动力学约束的凸测度优化,并用 Frank-Wolfe 迭代把每步化为经典最优控制子问题。实验显示方法在二维上与解析和 PDE 基线一致,在含多个障碍的三维场景可扩展,十障碍实例能在普通工作站数分钟内求解。

A QUBO-Based Optimization Framework for ATM Cash Replenishment Scheduling Figure 1
2026-07-28math.OC

A QUBO-Based Optimization Framework for ATM Cash Replenishment Scheduling

Riccardo Aiolfi, Giulia Montani, Valeria Zaffaroni, Luca Toffanetti, Davide Veronelli, Francesca Cibrario, Davide Caputo, Davide Corbelletto

2026-07-28优化算法

面向ATM网络补钞中需求波动、共同服务折扣和服务中断风险交织导致的排程难题,论文将补钞决策建成QUBO,用二次项表达同址ATM联合服务收益,并以罚项吸收容量、时间窗和服务水平约束,再由GPU版MegaQUBO求解。在意大利276台ATM、2022年四个月数据上,相比阈值策略成本降低约15%–18%,平均服务水平保持在99.8%–99.9%。

Kernel-Type Fractional Extensions of Reverse Callebaut, Rogers Hölder and Cauchy Schwarz Inequalities on Time Scales Figure 1
2026-07-28math.OC

Kernel-Type Fractional Extensions of Reverse Callebaut, Rogers Hölder and Cauchy Schwarz Inequalities on Time Scales

Nimai Sarkar, Gobinda Ghosh

Department of Mathematics, School of Advanced Sciences, VIT-AP University, Inavolu, Amaravati, Andhra Pradesh 522241, India, Mathematics Division, School of Advanced Sciences and Languages, VIT Bhopal University, Kothrikalan, Sehore, Madhya Pradesh 466114, India

2026-07-28优化控制

本文针对时标动态不等式中连续、离散、量子与记忆效应难以统一处理的问题,引入带非负核的 diamond-α 分数积分算子,将反 Callebaut、Rogers-Hölder 与 Cauchy-Schwarz 不等式扩展到核加权框架。主要结果给出一组可退化为经典、连续、离散和量子情形的反向不等式,并可用于 Volterra 型和时滞动态方程的先验估计。

The Capacitated $p$-Location Problem with Territorial Coverage Constraint: Efficient Solution and Case Study Figure 1
2026-07-28math.OC

The Capacitated $p$-Location Problem with Territorial Coverage Constraint: Efficient Solution and Case Study

Felipe Albuquerque, Rosa Figueiredo, Cyrille Genre-Grandpierre

LIA - Laboratoire Informatique d’Avignon, Avignon Université

2026-07-28优化算法

针对容量化 p-选址在现实规划中偏向高需求区域、难以兼顾行政单元公平覆盖的问题,论文把地域覆盖与多尺度覆盖约束加入 C p LP,并给出强化 ILP 与 RSSV 数学启发式以缩减实例后精确求解。实验覆盖基准与法国 PACA 影院案例,显示方法在较少调参下能稳定求得高质量方案,并量化公平约束对选址分布与可达性的影响。

Generalized Fine-Tuning of Diffusion Models via Stochastic Control and FBSDEs Figure 1
2026-07-28math.OC

Generalized Fine-Tuning of Diffusion Models via Stochastic Control and FBSDEs

Zirui Wang, Lu Wang

Zhongtai Securities Institute for Financial Studies, Shandong University, Jinan 250100, China.

2026-07-28生成模型规划控制

针对扩散模型微调中既要优化终端奖励、又要约束偏离预训练分布的问题,本文把微调重新表述为随机控制:用一般运行代价定义相对路径成本,将 KL 正则和 Wasserstein 型最优传输纳入同一框架。核心结果是推导对应的全非线性 HJB 方程,并用 FBSDE 表征价值函数与最优反馈控制,证明标准条件下的存在唯一性;但论文偏理论,实验增益与实际生成质量提升文中未充分说明。

Variational Formulations for Fractional Integral and Differential Equations Figure 1
2026-07-28math.OC

Variational Formulations for Fractional Integral and Differential Equations

Delfim F. M. Torres

\ftaddress Center for Research and Development in Mathematics and Applications (CIDMA), Department of Mathematics, University of Aveiro, 3810-193, Aveiro, Portugal

2026-07-28优化控制

本文面向分数阶积分/微分方程的变分反问题:如何从给定算子方程系统构造对应泛函。核心洞察是把单侧分数阶分部积分公式解释为相对于特定对称双线性型的算子对称性。主要结果是对分数阶积分方程给出临界点与原方程解等价的变分表述;对分数阶微分方程得到较弱的必要条件,并说明其泛函与最小二乘残差只差常数。

Modulus of conically averaged mappings and its applications to angles between two subspaces Figure 1
2026-07-28math.OC

Modulus of conically averaged mappings and its applications to angles between two subspaces

Honglin Luo, Shuang Song, Xianfu Wang

2026-07-28优化控制

面向非凸优化中锥平均映射缺少统一度量的问题,本文提出锥平均性的模量,用最小锥平均常数刻画算子类别。核心洞察是将该模量与广义单调映射的单调值、共单调值联系起来,并在线性情形完整刻画锥平均矩阵,给出可计算公式;据此推导 Dixmier 与 Friedrichs 子空间角的新算法,并扩展到非线性映射及弱凸函数的近端、反射算子。

Upper and lower approximations of the second order. Exhausters of the second order Figure 1
2026-07-28math.OC

Upper and lower approximations of the second order. Exhausters of the second order

I. M. Prudnikov

2026-07-28优化控制

这篇论文面向非光滑优化中难以用经典二阶导数刻画极值条件的问题,将一阶上/下逼近与 exhauster 框架推广到二阶,定义二阶上、下逼近及二阶 upper/lower exhauster,并建立其与二阶 Frechet 次微分的关系。文中还给出 Lipschitz 函数构造一阶和二阶 exhauster 的规则,推导通过二阶 exhauster 表述的极小、极大必要与充分条件,为后续数值寻优方法提供理论条件。

Mean-field model for pollution abatement via cap and trade mechanism Figure 1
2026-07-28math.OC

Mean-field model for pollution abatement via cap and trade mechanism

Ofelia Bonesini, Giacomo Lanaro

regulatory interventions. Among the policy instruments available, emission trading systems, See the ICAP Status Report (2022), Emissions Trading Worldwide, available at icapcarbonaction.com.

2026-07-28优化控制

本文针对排放交易体系中监管者通常被视为固定规则制定者的问题,建立连续企业的均场控制模型,把许可证供给作为动态拍卖控制,并由市场清算内生决定碳价。核心创新是将企业AK生产、减排与交易响应嵌入监管者优化,刻画减排与总产出的权衡。主要结果是利用线性二次结构和共同噪声,将均衡归结为耦合FBSDE与Riccati方程,给出大规模经济中最优许可证配置的可 tractable 表征。

Modelling the Correlation Structure of Uncertain Input Parameters for Energy System Optimization Figure 1
2026-07-28math.OC

Modelling the Correlation Structure of Uncertain Input Parameters for Energy System Optimization

Klara Maggauer, Yannick Werner, Stefan Strömer, Sonja Wogrin

2026-07-28优化算法

该文针对能源系统随机优化中常把不确定输入视为相互独立、从而可能扭曲场景与决策的问题,提出以经验边际分布结合 Gaussian/Student-t copula 的流程来刻画并生成保留相关性的输入场景。奥地利2019-2025年光伏出力、日前电价和负荷数据表明三者存在明显线性与单调依赖,copula 采样能较好复现实证相关结构;但尚未建模时间依赖和高维情形,对优化结果的实际增益仍文中未充分说明。

Network analysis reveals phase transitions in agro-food nitrogen systems with contrasting feeding capacity and land requirement Figure 1
2026-07-28math.OC

Network analysis reveals phase transitions in agro-food nitrogen systems with contrasting feeding capacity and land requirement

Adrien Fauste-Gay, Jeremie Unterberger, Olivier Vidal, Lauriane Mouysset

CNRS, ISTerre, University of Grenoble Alpes, Grenoble, France

2026-07-28优化控制

针对优化或情景模型通常只给出单一农业氮配置、难以理解可行循环结构的问题,论文把GRAFS式氮代谢写成稳态连续时间网络,并用粗粒化识别主导回收环路与“相变”。在法国参数下,不同施肥、畜牧和饮食约束会切换系统形态;参考系统耕地供养能力约8.7人/公顷,严格饮食自主需约1970万公顷,单纯减化肥会推高土地需求或外部依赖。

Spectral Analysis of Heavy-Ball Q-value Iteration Figure 1
2026-07-28math.OC

Spectral Analysis of Heavy-Ball Q-value Iteration

Donghwan Lee

Department of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)

2026-07-28优化控制

本文关注带 heavy-ball 动量的 Q-value iteration 在控制任务中何时真正加速,因为贪婪策略切换使其不能用单一固定策略矩阵的特征值判断。核心做法是把递推精确改写为增广切换线性系统,并以联合谱半径刻画最坏收敛率;主要结果表明,动量可改善公共特征向量方向,但只有投影后的策略依赖动态 JSR 低于标准 QVI 基准时,才能认证全局加速。

Resilience Enhancement of Electricity-Computing Interdependency System against Contingency Figure 1
2026-07-28math.OC

Resilience Enhancement of Electricity-Computing Interdependency System against Contingency

Minqiao Zheng, Zejun Yang

(School of Mechatronic Engineering and Automation, Shanghai University, Shanghai 200444, China), *Corresponding author at: Shanghai University, Shanghai 200444, China., critical infrastructures. The data center (DC) is modeled as a facility that transforms electrical, Keywords: Resilience, data center, ECIS, interdependencies, optimal power allocation., the electrical power system, the resulting outages disrupt data centers (DCs) that provide

2026-07-28优化控制

论文针对灾后城市恢复中“只按电力负荷优先级供电”忽视算力依赖的问题,提出电力-算力-基础设施耦合的 ECIS 框架,把数据中心建模为将电力转化为算力的关键节点,并据此动态分配其供电额度。案例显示,该策略在低供电阶段避免过度保障数据中心导致其他设施失效,在中高供电阶段补足算力瓶颈,较固定优先级恢复策略提升系统韧性超过 20%。

A Resolution of the SS--RS--GD Inequalities Figure 1
2026-07-28math.OC

A Resolution of the SS--RS--GD Inequalities

Binghui Peng

2026-07-28优化控制

本文针对有限和优化中单次洗牌 SGD、随机重排 SGD 与全批量梯度下降的收敛算子范数排序问题,回应 Yun、Sra、Jadbabaie 的 COLT 开放猜想。核心洞察是将低维反例通过张量平方推进到近单位条件数矩阵,从而证明 SS-RS 不等式即使在 n=3、K=2、d=4 时也失败;同时给出一般条件下 RS-GD 不等式成立的证明,完整澄清该链式猜想的真假边界。

Transform Method for Stochastic Processing and Matching Networks Figure 1
2026-07-28math.OC

Transform Method for Stochastic Processing and Matching Networks

Sushil Mahavir Varma, Prakirt Jhunjhunwala, Daniela Hurtado-Lange, Siva Theja Maguluri

2026-07-28优化控制

面向数据中心、网约车、医疗等大规模随机服务网络的拥塞分析,论文动机是弥补流体/扩散极限方法技术门槛高且难指导有限规模系统的不足。核心洞察是直接在预极限稳态中对指数测试函数利用零漂移,得到队长分布变换的函数方程。主要结果是统一梳理该方法在状态依赖到达、放弃、马尔可夫调制、多瓶颈网络等场景中的非渐近性能界与重交通分布刻画。

The Combined Van-and-Mopeds Routing Problem with Time Windows: Formulation, Variants, and Solution Methods Figure 1
2026-07-28math.OC

The Combined Van-and-Mopeds Routing Problem with Time Windows: Formulation, Variants, and Solution Methods

Pedro Lameiras, Alexandre P. Francisco, Adriano Serrano, Cátia Vaz

2026-07-28优化控制

面向里斯本等欧洲密集城区中货车难以直达、需电动踏板车接力的末端配送场景,论文提出带时间窗的货车-踏板车联合路径问题,并给出含同步、容量和时间窗约束的 MILP、运营变体、图稀疏化预处理及 CBCR 分解启发式。实验基于里斯本和斯图加特 OSM 实例:精确模型一小时内可求到 48 客户可行解,预处理约减 12.5–25% 约束,启发式在条件有利时扩展到 80 客户。

d'Alembert's Functional Equation and a Globally Convex Free-Action Principle on Positive Paths Figure 1
2026-07-28math.OC

d'Alembert's Functional Equation and a Globally Convex Free-Action Principle on Positive Paths

Sebastian Pardo-Guerra, Jonathan Washburn

Recognition Physics Institute

2026-07-28优化算法

本文动机是追问最小作用量能否由 d’Alembert 函数方程加一个明确的步长评价假设推出,而非直接作为变分公设。核心洞察是将 cosh 型对数成本作用在对数速度上,从而得到正路径上的自由动能作用量。主要结果证明该作用量在几何插值下强凸,固定端点的唯一全局极小路径为匀对数速度路径,并给出精确的 Bregman 作用量差分解;但与牛顿或相对论力学的联系需额外结构,文中明确限定为条件性解释。

DRP-FLR: Data-Driven Assessment of Demand Response Potential for Flexible Load Regulation in Smart Grids Figure 1
2026-07-28math.OC

DRP-FLR: Data-Driven Assessment of Demand Response Potential for Flexible Load Regulation in Smart Grids

Yunhao Yao, Siyu Jing, Yang Yang, Qiang Xu, Changqi Weng, Xiang-Yang Li

2026-07-28优化控制

针对 AI 负载增长与可再生能源波动导致的电网供需失衡,DRP-FLR 将短期负荷预测、实体级用电模式聚类和需求响应潜力估计结合起来,再用 MILP 求解兼顾平衡、收益与新能源消纳的调节方案。在区域电网和校园微电网实验中,调节偏差降低 36.63%–91.87%,参与者收益平均提升 44.66%。

Diamond transports in quadratic-form and distorted optimal transport Figure 1
2026-07-28math.OC

Diamond transports in quadratic-form and distorted optimal transport

Ruodu Wang, Zhenyuan Zhang

2026-07-28优化控制

本文针对经典最优传输目标对耦合线性、因而无法唯一选出 diamond transport 的问题,转向二次型最优传输和扭曲最优传输。核心洞察是二次耦合项可在对称一维边缘下固定绝对值反单调匹配并选择均匀符号结构。主要结果证明 diamond transport 在多类距离型 QOT 成本中最优,并对混合矩形幂成本给出除边界情形外的唯一性刻画,同时说明 DOT 中 diamond-type transport 的最优性及 DOT 与 QOT 的交集。

Branch \& Price \& Cut for the Time-Dependent Vehicle Routing Problem with Time Windows (TDVRPTW) Figure 1
2026-07-28math.OC

Branch \& Price \& Cut for the Time-Dependent Vehicle Routing Problem with Time Windows (TDVRPTW)

Florian Rascoussier (IMT Atlantique - DSD, CITI, Lab-STICC, Lab-STICC\_DECIDE), Romain Billot (IMT Atlantique - DSD, Lina Fahed (IMT Atlantique - DSD, Christine Solnon (EMERAUDE, CITI)

IMT Atlantique, Lab-STICC, UMR CNRS 6285, 29238 Brest, France, the real world and the various benchmarks available [4], but it remains relatively understudied., addresses the limitations of traditional OR methods, which ignore information available from

2026-07-28优化控制

本文面向城市交通中行程时间随出发时刻变化的 TDVRPTW,动机是为带时间窗多车辆路径问题构建可解释且有质量保证的精确求解器。核心思路是在 Branch-Price-Cut/列生成框架中重做既有方法,并把 TDTSPTW 的 Anytime A*、基于动态规划的大邻域搜索及数据挖掘/机器学习用于定价与列生成引导。当前文本更像研究计划,未给出实验结果,主要结果和增益来源文中未充分说明。

Randomized Constructive Heuristics for the VRPTW: A Focus on Regret-k Figure 1
2026-07-28math.OC

Randomized Constructive Heuristics for the VRPTW: A Focus on Regret-k

Florian Rascoussier (IMT Atlantique - DSD, CITI, Lab-STICC, EMERAUDE), Romain Billot (IMT Atlantique - DSD, Lab-STICC\_DECIDE), Lina Fahed (IMT Atlantique - DSD, Lab-STICC\_DECIDE, Lab-STICC), Christine Solnon (EMERAUDE, CITI)

IMT Atlantique, Lab-STICC, UMR CNRS 6285, 29238 Brest, France, DIMACS, Rutgers University, Sept. 2021.

2026-07-28学习理论

面向带时间窗车辆路径问题,论文关注传统构造启发式在随机多启动框架中如何提升初始解多样性。核心做法是将 Regret-k 拆成“选哪个客户”和“插到哪里”两类决策,并按遗憾值概率化选择,以保留前瞻性同时引入随机性。实验在 Solomon 与 Gehring-Homberger 基准上对比 BKS 和 HGS,显示质量与计算成本存在权衡;具体数值增益文中未充分说明。

Optimality of a Threshold Policy for a Queueing System with One Fast Server and Two Identical Slow Servers Figure 1
2026-07-28math.OC

Optimality of a Threshold Policy for a Queueing System with One Fast Server and Two Identical Slow Servers

Weina Wang, Taha Ameen, Yudong Chen, Yige Hong, Josh Nichols, Matthew Zurek

Computer Science Department, Carnegie Mellon University, Department of Electrical and Computer Engineering & Coordinated Science Lab, University of Illinois, Department of Computer Sciences, University of Wisconsin-Madison

2026-07-28强化学习

本文针对“一台快服务器加两台相同慢服务器”的排队控制问题,回应两服务器阈值策略能否推广的长期开放疑问。核心洞察是用值迭代传播六类单调性、凸性和超模性不等式,特别引入固定总人数下关于慢服务器占用数的凸性,以保证双阈值有序。主要结果证明折扣成本下存在最优阈值策略,并在稳定条件下扩展到平均成本准则。

A unified approach to non-unique fixed points via modified C-class Ciric-type contractions Figure 1
2026-07-28math.OC

A unified approach to non-unique fixed points via modified C-class Ciric-type contractions

Olaoluwa Omidire, Memudu Olatinwo, Kamiludeen Tijani, Babatunde Ishola

Department of Mathematical Sciences, Osun State University, Osogbo, Nigeria., Department of Mathematics, Obafemi Awolowo University, Ile Ife.

2026-07-28优化控制

本文针对经典压缩映射常把“不动点存在”与“唯一性”绑定、难以处理多解算子的问题,提出三变量 modified C-class 函数与 altering distance 结合的 Ćirić 型收缩框架。主要结果是在轨道完备与轨道连续条件下证明 Picard 迭代收敛到不动点,无需全局 Lipschitz 或严格压缩,并给出需要唯一性时的附加判据。

Rational Minimax Approximations for Matrix-Valued Functions: Existence, Optimality and Algorithms Figure 1
2026-07-28math.OC

Rational Minimax Approximations for Matrix-Valued Functions: Existence, Optimality and Algorithms

Lei-Hong Zhang, Chenkun Zhang

Corresponding author. School of Mathematical Sciences, Soochow University, Suzhou 215006, Jiangsu, China. This work was

2026-07-28优化控制

针对系统建模、微波设计和非线性特征值问题中矩阵值函数需共享分母进行有理逼近的需求,本文把标量 minimax 理论扩展到 Frobenius 范数下的矩阵情形,给出存在性证明、矩阵版 Kolmogorov 与 Ruttan 最优性条件,并说明边界采样解在证书满足时可等价于连续域解,同时把这些条件与 m-d-Lawson 对偶算法联系起来。

A Formal Kinetic Theory for Zeroth-Order Newton Dynamics:Stein-Corrected Hessian Estimation and Curvature--Variance Trade-offs Figure 1
2026-07-28math.OC

A Formal Kinetic Theory for Zeroth-Order Newton Dynamics:Stein-Corrected Hessian Estimation and Curvature--Variance Trade-offs

Shihao Ji, Mingyu Li, Zihui Song

2026-07-28学习理论

针对黑箱优化中零阶牛顿法同时估计梯度和 Hessian 时易受曲率噪声放大的问题,论文指出常用随机方向 Hessian 估计即使在二次函数上也有偏,并用 Gaussian-Stein 校正恢复平滑目标的无偏估计;进一步将更新噪声分解为预条件梯度噪声和逆 Hessian 夹持的 Hessian 噪声,给出包含批量、平滑半径、正则化和维度的曲率-方差权衡,并用实验验证相关 scaling。

Efficient multidisciplinary design via Bayesian optimization Figure 1
2026-07-28math.OC

Efficient multidisciplinary design via Bayesian optimization

Nathalie Bartoli, Thierry Lefebvre, Rémi Lafage, Paul Saves, Youssef Diouane, Joseph Morlier

GERAD and Department of Mathematics and Industrial Engineering, Polytechnique Montréal, Montréal, QC, Canada, are typically unavailable or impractical to compute when mixed variables are involved [8, 24].

2026-07-28优化算法

面向航空等多学科设计中仿真昂贵、变量混合且约束复杂的问题,本文综述并整合SEGOMOE式贝叶斯优化:用高斯过程/混合专家、SMT混合层级核、多保真与多目标采集函数,以及UTB、EFIFE处理显式和隐藏约束。结果显示该框架在基准与无人机、涡轮机械等案例中能以更少黑箱评估逼近帕累托前沿并提升可行搜索效率,但各扩展的独立增益来源文中未充分说明。

Major-Minor LQ Mean Field Games with Erroneous Initial Information: Distributed Error Estimation and Strategy Modification Figure 1
2026-07-28math.OC

Major-Minor LQ Mean Field Games with Erroneous Initial Information: Distributed Error Estimation and Strategy Modification

Yuxin Jin, Haotian Wang, Wang Yao, Xiao Zhang

2026-07-28优化控制

这篇论文针对大规模多智能体控制中初始均场信息可能过时或错误、且真实均场不可直接观测的问题,研究带主从结构的线性二次均场博弈。核心洞察是初始误差会在线性系统中可解析地传播,因此可由局部离散观测转化为分布式最大似然估计,并在中途重构均场、切换控制律。结果给出误差传播、估计误差刻画和策略修正规则,并指出主智能体估计精度主要取决于观测从智能体数量而非身份。

Threshold-indexability of restless bandits with real interval state spaces: a performance-metric verification framework and long-run average analysis Figure 1
2026-07-28math.OC

Threshold-indexability of restless bandits with real interval state spaces: a performance-metric verification framework and long-run average analysis

José Niño-Mora

2026-07-28优化控制

针对连续实区间状态的 restless bandit 中 Whittle 指数难以证明可指标化、难以计算的问题,本文把分析从模型特定动态规划转向阈值策略的绩效度量与 PCL 恒等式。核心结果表明,在边际资源正性和边际分部积分条件下,阈值可指标化等价于 MP 指数的单调连续性,且 MP 指数即 Whittle 指数;长程平均情形通过消失折扣极限处理,并在网页抓取、噪声信道与标量 Kalman 滤波模型中恢复或缩减已有结果。

Mirror Descent Methods for Quasar Convex Optimization Problems With Non-Smooth Inequality Constraints Figure 1
2026-07-28math.OC

Mirror Descent Methods for Quasar Convex Optimization Problems With Non-Smooth Inequality Constraints

Mohammad Alkousa

Innopolis University, Russia.

2026-07-28优化算法

针对非光滑约束优化中拟星凸目标与凸不等式约束同时出现、现有研究多偏向光滑或无约束情形的问题,论文构造两组镜像下降算法,通过“可行时优化目标、不可行时修正约束”的 productive/non-productive 步切换,并给出确定性、随机及多约束改进版本。主要结果是在 Lipschitz 与 Bregman 有界假设下证明 ε 近似最优且近似可行的收敛率,迭代复杂度呈典型 O(1/ε²) 量级。

Learning to Optimize at Scale: A Benders Decomposition-TransfORmers Framework for Stochastic Combinatorial Optimization Figure 1
2026-07-28math.OC

Learning to Optimize at Scale: A Benders Decomposition-TransfORmers Framework for Stochastic Combinatorial Optimization

Seung Jin Choi, Kimiya Jozani, Josh Cooper, Esra Buyuktahtakin Toy

Department of Industrial and Systems Engineering

2026-07-28优化算法

本文针对大规模两阶段随机混合整数优化中 Benders 分解反复求解场景子问题的瓶颈,以随机容量批量生产计划为例,将预训练 TransfORmer 作为子问题近似求解器,用其预测生成可行性与最优性割,并通过滑动窗口式可扩展生成把 T=90 训练模型用于更长时域。实验显示,T=90 下平均最优性 gap 从经典 Benders 的 41.81% 降至 3.55%,耗时和迭代数也下降;T=270 可保持零不可行但 gap 升至 19.60%,说明扩展有效但长时域质量仍有损失。

Route Based Map Matching via a Structured Codebook and Token Sequence Decoding Figure 1
2026-07-28math.OC

Route Based Map Matching via a Structured Codebook and Token Sequence Decoding

Takara Sakai

2026-07-28优化控制

这篇论文针对城市高架高速中岔路密集、GPS 噪声易使逐链路匹配在早期路口出错并传播的问题,将候选路线表示为线路名、JCT/IC 名称组成的符号序列,并用预计算网格把轨迹点量化为 token,再通过 DAFSA 与 Levenshtein 自动机做模糊解码。实验在变形的东京首都高速仿真拓扑上显示,中等噪声下可恢复精确路线,重噪声下仍能识别线路/路口序列,查询速度较线性扫描提升数个数量级;但真实探针数据、HMM 对比和参数校准文中未充分说明。

A Hybrid Matheuristic Framework for the Chinese Postman Problem with Load-Dependent Costs Figure 1
2026-07-28math.OC

A Hybrid Matheuristic Framework for the Chinese Postman Problem with Load-Dependent Costs

Thieu Khang Nguyen, Thu Huong Dang, Truong-Son Hy

2026-07-28优化控制

这篇论文面向载重会改变能耗与排放成本的中国邮递员问题,动机在于传统按距离计费的弧路由模型难以刻画物流中的重量效应。作者将局部搜索与缩减 MILP 强化结合,并补充 ACO 以扩展规模;实验显示该混合 matheuristic 在基准与人工实例上通常优于既有 ILS/VNS 或直接求解,计算效率保持竞争性,但不同规模下 ACO 表现不稳定。

SDE Guided Monte Carlo Reinforcement Learning: A Stochastic Maximum Principle Approach for Robust Decision Making in Noisy Environments Figure 1
2026-07-28math.OC

SDE Guided Monte Carlo Reinforcement Learning: A Stochastic Maximum Principle Approach for Robust Decision Making in Noisy Environments

Juncai Wang

Department of Mathematics, Florida State University

2026-07-28强化学习安全鲁棒

针对蒙特卡洛强化学习在传感、动作和目标扰动下样本效率低、策略脆弱的问题,论文将随机最大值原理的定性条件转译为表格 RL 启发式:用势场奖励塑形表示漂移,用 softmax 温度表示扩散,并以平均绝对 TD 误差自适应调节探索。固定迷宫实验显示其在多类噪声下可减少失败、加快收敛,并通过消融支持势场与自适应温度的互补作用;但该映射主要是启发式而非严格离散化。

Multi-Path Routing in Decentralized Exchange Networks: Convex Allocation and an Improving-Path Certificate Figure 1
2026-07-28math.OC

Multi-Path Routing in Decentralized Exchange Networks: Convex Allocation and an Improving-Path Certificate

Ilia Zhavoronkov

2026-07-28优化算法

本文针对去中心化交易中流动性分散、路径选择与拆单会显著影响成交质量的问题,将 AMM 网络建模为带非线性交换函数的有向多重图,并把候选路径搜索与连续凸分配分离;核心创新是引入含 gas 成本的路径评分、池不重复约束、单池冲击上限,以及用 KKT 乘子做遗漏改进路径证书。以太坊 WETH-USDT 报价实验显示,其中位短缺低于 5 bps,Top-3 排名覆盖率超过 57%,但结果仍局限于报价层面和单一交易对。

Comparing Optimization Models for Radiotherapy Scheduling Figure 1
2026-07-28math.OC

Comparing Optimization Models for Radiotherapy Scheduling

C.C. Rambaldi Migliore, D. Stanicel, N. Musliu, G. Iacca, M. Roveri

2026-07-28优化算法

本文针对放疗排程中 ILP 日批量模型质量较高但耗时、耗内存的问题,将 RTSP 借鉴一维装箱视角设计 First Fit、Best Fit 贪心构造,并用模拟退火继续改进。实验在公开患者到达数据上比较 CPLEX、CP-SAT 精确模型,显示启发式及其 SA 版本在等待时间、偏好满足和机器切换等目标上接近精确解,同时显著降低运行时间和内存需求。

Low-Rank KKT Updates and a Parallel Flipping Mechanism for Model-Based Derivative-Free Optimization Figure 1
2026-07-28math.OC

Low-Rank KKT Updates and a Parallel Flipping Mechanism for Model-Based Derivative-Free Optimization

Donghan Wu, Pengcheng Xie

University of California, Berkeley.

2026-07-28优化算法

面向黑箱目标昂贵、无导数且高维时模型构建成本过高的问题,论文把最小 Frobenius 范数二次插值的 KKT 系统结构显式利用起来,提出单点替换的低秩逆更新和可并行的坐标翻转机制,以避免频繁重建线性系统。实验声称该框架能降低模型维护开销并提升并行场景效率,但具体收益与算法整体收敛关系仍需更多细节支撑。

A uniqueness result for finite-state mean field games with non-separable Hamiltonian Figure 1
2026-07-28math.OC

A uniqueness result for finite-state mean field games with non-separable Hamiltonian

Alekos Cecchin, Luca Di Persio, Nicola Fraccarolo

Department of Mathematics “T. Levi-Civita”, University of Padova, Department of Computer Science, University of Verona

2026-07-28优化控制

针对有限状态平均场博弈中转移率依赖群体分布而导致哈密顿量非可分、传统 Lasry-Lions 单调性难以直接给出唯一性的情形,本文刻画了动力学交互项对唯一性的影响。核心创新是将成本的强单调性与转移率交互项的定量界结合,给出任意时间区间上的解唯一性充分条件,并说明经典单调性条件在非可分模型中需被相应强化。

Optimal Investment with Switching Preferences Figure 1
2026-07-28math.OC

Optimal Investment with Switching Preferences

Yu-Jui Huang, Liviu Ignat, Traian A. Pirvu, Reihaneh Vafadar

Institute of Mathematics “Simion Stoilow” of the Romanian Academy, 21 Calea Grivitei Street, 010702 Bucharest, Romania., National University of Science and Technology Politehnica Bucharest, 313 Splaiul Independenţei, 060042 Bucharest, Romania.

2026-07-28优化控制

本文研究重大生活事件导致风险厌恶上升时,投资者如何在有限期 Black-Scholes 市场中调整最优组合。核心洞察是偏好切换使事前 HJB 方程依赖事后价值函数,Fenchel-Legendre 变换不再线性化,而产生全非线性抛物方程。论文通过不动点、紧性与验证论证建立经典解,并证明其凸共轭给出事前价值函数,最优策略由事前策略与事后 Merton 比例拼接而成。

A Data-Assimilation-Augmented Optimization Framework for Parameter Estimation in Dynamical Systems Figure 1
2026-07-28math.DS

A Data-Assimilation-Augmented Optimization Framework for Parameter Estimation in Dynamical Systems

Muhammad Jalil Ahmad, Animikh Biswas, Kathleen Hoffman

Department of Mathematics and Statistics, University of Maryland, Baltimore County, USA

2026-07-28优化算法

该文面向非线性动力系统中观测稀疏、含噪且初值不准时的参数估计难题,将数据同化中的 nudging 系统嵌入优化,以延迟观测误差构造代价函数,从而弱化对真实初态的依赖。作者在 Lorenz–63 上给出同步、失配稳定性和逆映射适定性分析,并结合可辨识性与 Sobol 敏感性筛选参数;实验显示在混沌/非混沌、部分观测和较高噪声下仍能较准恢复参数,且计算成本低于在线学习和 MCMC。

2026-07-27

21 篇
Fully Convergent Projection-based Methods with Momentum under Nonconvex Geometric Figure 1
2026-07-27math.OC

Fully Convergent Projection-based Methods with Momentum under Nonconvex Geometric

Matteo Lapucci, Diego Scuppa

2026-07-27优化算法

本文针对非凸几何约束下投影梯度法难以直接加入一般动量方向的问题,指出简单替换负梯度可能导致投影路径上升,并设计预投影步的曲线回溯机制来兼容动量。理论上在弱假设下可收敛到 M-稳定点,在更强回退条件下达到 B/P-稳定性;稀疏与有界秩实验显示动量带来计算收益。

Singular value soft-thresholding via the polar decomposition Figure 1
2026-07-27math.NA

Singular value soft-thresholding via the polar decomposition

Stephen Becker

2026-07-27优化控制

本文针对核范数近端梯度中常用的奇异值软阈值计算,试图避开通信开销较高的 SVD。核心洞察是把阈值函数写成符号/极分解形式,用矩阵极分解直接构造软阈值结果,并适配 Newton-Schulz/Polar Express 这类 GPU 友好迭代。实验显示在若干 Colab GPU 上约有 10 倍加速,但精度对阈值位置敏感,鲁棒性文中未充分说明,方法更适合低精度场景。

Data Driven Modeling of Nonlinear Dynamics in a Rotating Detonation Combustor via Finite Dimensional Approximations of the Koopman Operator Figure 1
2026-07-27math.OC

Data Driven Modeling of Nonlinear Dynamics in a Rotating Detonation Combustor via Finite Dimensional Approximations of the Koopman Operator

David Oexle, Tobias Breiten, Myles D. Bohon

†Institute of Fluid Mechanics and Technical Acoustics, Technische Universität Berlin, the detonation waves in the RDC at the Technical University (TU) Berlin. By introducing time-delay, Air Force Research Laboratory (AFRL) [40], which op-

2026-07-27优化控制

针对旋转爆震燃烧器中反向传播波、驻波和传感噪声使标准 DMD 难以刻画非线性动力学的问题,本文将 Koopman 有限维近似、移动参考系 DMD 与基于物理周期估计的时延嵌入 EDMD 组合成分析流程。结果显示,该方法能更准确重构驻波与反向行进波,并将主要行波结构从高速火焰亮度数据中分离出来,便于进一步分析剩余非线性相互作用。

A Small-Noise Analysis of Controlled Functional Differential Equations with Gaussian Noise Figure 1
2026-07-27math.PR

A Small-Noise Analysis of Controlled Functional Differential Equations with Gaussian Noise

David Criens, Max Nendel

University of Freiburg, Ernst-Zermelo-Str. 1, 79104 Freiburg, Germany., University of Waterloo, 200 University Ave W, N2L 3G1, Waterloo, Ontario, Canada.

2026-07-27规划控制三维

本文关注带小高斯噪声的受控泛函微分方程,动机是刻画路径依赖、长记忆扰动下风险敏感控制的极限行为。核心洞察是把随机问题转化为Cameron-Martin扰动参与的确定性零和博弈,并用抽象Wiener空间上的Boué-Dupuis表示、路径稳定性和适应有限维近似处理非Markov噪声。主要结果给出对数值函数的小噪声上下界,并在博弈有值及Fan型凸凹条件下得到完整Laplace原理。

Langevin for Nonconvex Optimization: Exact, Inexact and Zeroth-Order Figure 1
2026-07-27math.OC

Langevin for Nonconvex Optimization: Exact, Inexact and Zeroth-Order

Emanuele Naldi, Marco Rando, Lorenzo Rosasco, Silvia Villa

MaLGa - DIMA, University of Genova, Genova, IT, MaLGa - DIBRIS, University of Genova, Genova, IT

2026-07-27优化算法

本文针对非凸全局优化中 Langevin 方法常把采样误差再转成目标值误差而损失常数的问题,直接用加权 Csiszár–Kullback–Pinsker 不等式和指数矩估计把相对熵控制转为期望超额风险界。结果给出精确梯度、非精确/随机梯度及零阶有限差分 ULA 的非渐近复杂度,尤其声称首次得到零阶 ULA 的全局非凸优化函数评估界。

Homogeneous Self-Dual Embedding via Perspective Functions Figure 1
2026-07-27math.OC

Homogeneous Self-Dual Embedding via Perspective Functions

Goran Banjac

2026-07-27优化控制

针对传统 HSDE 依赖线性锥规划规范化、会引入额外变量并破坏原问题结构的问题,本文用透视函数把两个闭凸函数及其共轭的最优性与不可行性条件压缩为单个不等式嵌入。该框架可由 Douglas-Rachford 迭代求解,投影步骤可化为标量方程和近端算子;结果上包含二次锥规划既有方法,并在非光滑目标与盒约束等非锥问题小规模实验中展示有效性。

Explicit Iteration Complexity of Exact Data-Driven Inverse Optimization for Integer Linear Programs Figure 1
2026-07-27math.OC

Explicit Iteration Complexity of Exact Data-Driven Inverse Optimization for Integer Linear Programs

Akira Kitaoka

2026-07-27优化算法

这篇论文关注整数线性规划的精确数据驱动逆优化:已有一阶方法虽能在有限步内使次优性损失为零,但迭代数依赖抽象几何常数,难以按问题规模评估。作者用全酉模、Graver 基和 M-凸结构给出该常数的显式下界,从而得到达到观测数据精确一致所需迭代数的显式上界;结果表明结构化情形可为多项式量级,一般 ILP 则可能随维度指数恶化。

Finite-Time Stabilization of Linear Systems via Optimal Control Figure 1
2026-07-27math.OC

Finite-Time Stabilization of Linear Systems via Optimal Control

Weihao Weng (1), Yacine Chitour (1), Paolo Mason (1) ((1) L2S)

∗Laboratoire, where (A, B) is a controllable pair. Relying on the corresponding Brunovsky form, it

2026-07-27规划控制

面向机器人、航天等场景中线性系统需在有限时间内到达平衡点的问题,论文把有限时间镇定重新表述为无限时域最优控制:通过构造带齐次性的积分代价,从值函数正则性推出反馈律及全局 HJB 方程。主要结果包括最优解存在唯一、值函数与 HJB 解的刻画、若干已有有限时间控制律的逆最优解释,以及 q 趋于无穷时得到有界反馈并由数值仿真验证。

Non-Negative Conjugate Gradients Figure 1
2026-07-27math.OC

Non-Negative Conjugate Gradients

Thomas Schmelzer, Martin Stoll

2026-07-27优化算法

本文针对共轭梯度法无法直接处理非负约束的问题,提出在原始-对偶主动集外层中嵌入矩阵无关 CG 的非负共轭梯度算法。核心洞察是将变量进出自由集视为 LCP 主元 pivot,并用 block pivot 加 Bland fallback 把精确有限终止保证推广到残差受控的非精确 Krylov 内解。合成实验中外层最多 6 步到达植入最优解,直接自由集求解在稠密问题上明显快于 Lawson-Hanson 与内点法。

Designing Eco-Efficient Biowaste Valorisation Systems: Effects of Transport Distance and Facility Scale Figure 1
2026-07-27math.OC

Designing Eco-Efficient Biowaste Valorisation Systems: Effects of Transport Distance and Facility Scale

Christian Ottini (SayFood), Gwenola Yannou-Le Bris (SayFood), Sandra Domenek (SayFood), Felipe Buendia (SayFood)

2026-07-27优化控制

针对欧洲厨余/生物废弃物分收后“本地处理还是集中处理”的规划难题,本文把生命周期评价、技术经济模型与运输车型数据合在同一情景框架中,系统考察堆肥和厌氧消化在不同规模、0–150 km运输距离下的阈值效应。结果显示规模经济与运输负担存在非线性权衡,零距离大型堆肥综合影响最低;45种配置在成本和环境上优于本地焚烧,另有111种虽更贵但环境更优。

Learning from Downstream Prices: Robust Upstream Decisions with Revealed Pricing Optimality Figure 1
2026-07-27math.OC

Learning from Downstream Prices: Robust Upstream Decisions with Revealed Pricing Optimality

Zhiqiang Chen

2026-07-27安全鲁棒

本文针对上游企业只观察到下游零售价和销量、缺少消费者估值分布的小样本决策问题,提出把下游价格视为“最优决策信号”而非普通协变量:最优价格同时揭示需求分位点和虚拟价值条件,从而收紧局部尾部分布歧义集。作者证明最坏情形落在标量区间端点,可化为两场景鲁棒报童;仿真中少量历史记录显著提高 oracle 利润比,并大幅降低计算时间。

On the Convergence of Stochastic Low-Rank Adaptation Figure 1
2026-07-27cs.LG

On the Convergence of Stochastic Low-Rank Adaptation

Ru Wang, Chengchang Liu, John C.S. Lui

The Chinese University of Hong Kong, Westlake University

2026-07-27学习理论

这篇论文针对 LoRA 同时优化两个低秩因子时缺乏标准全局光滑性、已有收敛界过慢且随机情形理论不足的问题,重新分析因子轨迹,并设计带联合归一化动量的 LoRA-NSGDM 与方差递推校正的 LoRA-STORM。主要结果是将确定性 LoRA-GD 的复杂度从指数界改进到 O(ε^-4),并在有限方差及均方光滑条件下分别给出 O(ε^-8) 与 O(ε^-6) 的随机 oracle 收敛保证。

Strategic Inference of Adversarial Navigation Objectives for Unmanned Underwater Vehicles Figure 1
2026-07-27math.OC

Strategic Inference of Adversarial Navigation Objectives for Unmanned Underwater Vehicles

Ruimeng Hu, Xu Yang

Department of Mathematics, University of California, Santa Barbara, CA 93106, USA, Department of Statistics and Applied Probability, University of California, Santa Barbara, CA 93106, USA

2026-07-27机器人

面向对抗场景中蓝方仅凭带噪轨迹推断红方水下无人航行器目的地的问题,论文把红方建模为沿洋流场中的 Hamilton-Jacobi 时间最优路径运动,并将目的地可辨识性归结为由 Jacobi 场诱导的组合得分核。其主要结果包括连续时间似然、闭式局部 MLE、常内存多周期估计及 Cramér-Rao 效率分析;涡旋和剪切流实验表明洋流几何会直接决定哪些目的地更容易被可靠识别。

Stackelberg Games with a Robust Leader Figure 1
2026-07-27math.OC

Stackelberg Games with a Robust Leader

Juan Li, Jianfeng Zhang, Zimu Zhu

2026-07-27安全鲁棒

本文针对多跟随者 Stackelberg 博弈中“领导者无法指定跟随者选择哪个纳什均衡”的风险,提出鲁棒/悲观领导者模型,以最不利均衡和近似均衡的渐近值替代传统乐观选均衡。核心创新是把连续时间随机模型经弱形式、BSDE 表征和惩罚化转为开环零和控制问题,并用 Wasserstein 空间上的 HJB 方程刻画其值函数,从而给出一般扩散框架下鲁棒领导者问题的求解理论。

Model-based optimization of bacterial motility strategies for maximizing population yield Figure 1
2026-07-27q-bio.PE

Model-based optimization of bacterial motility strategies for maximizing population yield

Peize Yu, Sohei Tasaki

2026-07-27优化算法

本文针对封闭或营养受限环境中传统细菌运动模型忽略运动代谢成本的问题,构建含运动耗能项的PDE模型,并把总细胞数作为优化目标比较不同趋动策略。结果显示最优运动强烈依赖资源空间分布:均匀环境偏向节能或适度运动,而不可预测、远距离营养环境中,非单调的营养响应更能兼顾搜索能力与资源消耗。

On convergence of solutions to nonlocal optimal control problems with quasi-minimization constraints Figure 1
2026-07-27math.OC

On convergence of solutions to nonlocal optimal control problems with quasi-minimization constraints

Joshua M. Siktar

2026-07-27规划控制优化算法学习理论

本文针对非局部最优控制中拟凸能量约束可能无唯一极小解、从而难以证明非局部解收敛到局部 PDE 控制解的问题,将约束改为 ε-准极小化,并允许代价泛函依赖非局部分数梯度。主要结果是在该框架下证明控制问题解的存在性,并借助 Γ-收敛与恢复序列构造,得到当 s→1、δ→0 时非局部极小解向相应局部问题收敛。

Safe Stabilizing Linear Feedback: Necessary and Sufficient Conditions, Optimality, and Margins Figure 1
2026-07-27math.OC

Safe Stabilizing Linear Feedback: Necessary and Sufficient Conditions, Optimality, and Margins

Pol Mestres, Shima Sadat Mousavi, Pio Ong, Aaron D. Ames

The authors are with the Department of Mechanical and Civil, Engineering, California Institute of Technology, Pasadena, CA 91125, USA.

2026-07-27安全鲁棒

针对 CBF 安全滤波虽能满足约束却可能破坏系统稳定、且难以给出线性鲁棒裕度的问题,论文把线性系统与仿射安全约束下的 HOCBF 条件转化为对线性反馈增益的精确刻画。核心结果是给出安全增益集合非空、其中存在稳定化增益的充要条件,并进一步在该集合内用 ARE/LMI 求解 LQR 最优控制和带增益、相位裕度保证的鲁棒控制。

Smart predict-then-robustly-optimize Figure 1
2026-07-27cs.LG

Smart predict-then-robustly-optimize

Aakil Caunhye, Xuefei Lu, Belen Martin-Barragan

2026-07-27安全鲁棒

这篇论文针对 SPO 在部署时默认协变量干净、因传感误差或时滞导致预测被优化器放大的问题,提出将鲁棒优化嵌入预测到决策链路的 SPrO,并给出可求解的凸替代损失 SPrO+。理论上证明其为真实鲁棒损失的紧上界、近似误差具指数衰减且高概率 Fisher 一致;实验显示相较 SPO/SPO+ 有更好的样本外表现和训练稳定性。

A Defense of the Quadratic Model Figure 1
2026-07-27cs.LG

A Defense of the Quadratic Model

Alexandru Meterez, Pranav Ajit Nair, Depen Morwani, Cengiz Pehlevan, Sham Kakade, Alex Damian

Kempner Institute at Harvard University

2026-07-27优化控制

论文针对大模型预训练中优化理论代理模型是否真实刻画训练动态的问题,系统检验最简单的二次模型。作者在150M参数、3B token训练轨迹上对中间检查点做一阶与二阶泰勒展开,发现局部近似可预测最长约10%训练窗口;进一步解析Hessian谱与稳定性,显示谱尾有普适幂律结构,LLM训练通常处在由批大小决定的随机或确定性稳定边缘。

Equilibrium Causal Digital Twins: Validation, Transport, and Identification Limits Figure 1
2026-07-27stat.ME

Equilibrium Causal Digital Twins: Validation, Transport, and Identification Limits

Faraz Dadgostari, Neda Nazemi

Department of Mechanical & Industrial Engineering, Montana State University, Gianforte School of Computing, Montana State University

2026-07-27优化控制

本文针对带反馈系统中的数字孪生:干预响应不再是单向传播,而是均衡反事实,且跨域机制变化会使已验证模型失效。核心洞察是把验证、迁移与识别分开处理,提出均衡因果博弈条件和循环选择图。结果给出分布级验证与直接/混合迁移准则,证明有限实验一致仍不足以保证目标反事实,并在线性情形刻画所需干预与不可点识别时的查询范围。

Quasi-Monte Carlo Initialization for Meta-Reinforcement Learning Figure 1
2026-07-27cs.LG

Quasi-Monte Carlo Initialization for Meta-Reinforcement Learning

Julian G. Soltes

Regis University, Regis University Denver Colorado USA

2026-07-27强化学习

论文针对强化学习对初始权重高度敏感的问题,尝试用 Sobol、LHS、HDS 等准蒙特卡洛采样构造权重搜索空间,并通过少量基准任务的一步适应选择元先验用于零样本初始化。结果显示,在运动学相近的连续控制任务上 QMC 先验整体优于 SB3 正交初始化,其中 Sobol 增益达到显著;但在差异任务上性能下降,说明方法更像任务族内初始化偏置,跨域泛化受限。

2026-07-24

21 篇
Barzilai-Borwein Fails Superlinear Convergence on an Open Set of Quadratics for Every Dimension $n\geq 4$ Figure 1
2026-07-24math.OC

Barzilai-Borwein Fails Superlinear Convergence on an Open Set of Quadratics for Every Dimension $n\geq 4$

Dawei Li, Xiaotian Jiang, Mingyi Hong

University of Minnesota, rarely available in advance.

2026-07-24强化学习学习理论

这篇论文针对 BB1 谱梯度法在严格凸二次问题上是否“几乎处处”超线性收敛的长期疑问,构造并严格验证了一个四维投影化动力系统的吸引七周期,再通过稳定性扩展到任意 n≥4 的开集。主要结果表明,在正测度的问题与初始化族上,BB1 虽收敛但梯度、误差能量范数和目标差都存在几何下界,因此不能根超线性或 Q 超线性收敛。

Asymptotic Analysis of Empirical Dynamic Programming in Infinite-Horizon Stochastic Optimal Control Figure 1
2026-07-24math.OC

Asymptotic Analysis of Empirical Dynamic Programming in Infinite-Horizon Stochastic Optimal Control

Xin Chen, Elif Sena Isik, Johannes Milz

of the exogenous noise are available, a natural approach is to replace the expectation in, †H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Tech-

2026-07-24规划控制

面向数据驱动的无限期折扣随机最优控制,论文关注样本平均近似的动态规划值函数中采样误差如何经由固定点方程传播。核心洞察是把静态经验误差与闭环转移算子线性传播分离,建立函数型中心极限定理;在最优策略非唯一时进一步给出可能非高斯的固定点极限,并用库存控制和可再生采收示例说明方差行为。

Climate-resilient electric vehicle charging infrastructure for sustainable cities: An interpretable causal-ensemble framework for preventive maintenance and low-carbon mobility Figure 1
2026-07-24math.OC

Climate-resilient electric vehicle charging infrastructure for sustainable cities: An interpretable causal-ensemble framework for preventive maintenance and low-carbon mobility

Cande Lian (1), Wentao Zeng (1), Jiabin Wu (1), Yiming Bie (2), Wei Zhou (3) ((1) School of Management, Foshan University, Foshan, China (2) School of Transportation, Jilin University, Changchun, China (3) Department of Civil and Environmental Engineering, National University of Singapore)

a School of Management, Foshan University, Foshan 528000, China, b School of Mathematics, Foshan University, Foshan 528000, China, c School of Mechanical and Electrical Engineering and Automation, Foshan University, Foshan 528225, China, d School of Transportation, Jilin University, Changchun 130022, China, e Department of Civil and Environmental Engineering, National University of Singapore, Singapore 117576, charging network (U.S. Department of Transportation, 2022), and China's public charging posts exceeded 4.7, precipitation, and high humidity, facility availability risks becoming the weak link of the low-carbon mobility, concerns not only the health of individual devices but, more directly, the sustained availability of the charging

2026-07-24优化控制

面向气候压力下公共充电桩故障从事后维修转向预防维护的需求,论文提出 FGDSE:按物理环境、用户行为、运行情境和故障历史分组建模,并用动态门控融合浅层专家与时序深度专家,结合 SHAP 和 X-learner 给出可解释、近似因果的维护信号。13 个站点 25 个月数据上,该方法在 10 天后优于 12 个基线,30 天宏召回约 85%,并发现长期风险主导因素由故障历史转向气候压力,极端高温影响随时间增强。

Decomposing a Multi-Scale Optimization Framework for Grid-Integrated Electrolysis using Aggregate-Informed Benders Figure 1
2026-07-24math.OC

Decomposing a Multi-Scale Optimization Framework for Grid-Integrated Electrolysis using Aggregate-Informed Benders

Kiernan X. Jennings, Victor M. Zavala, Styliani Avraamidou

a University of Wisconsin-Madison, Department of Chemical and Biological Engineering, Madison, WI, USA, b Mathematics and Computer Science Division, Argonne National Laboratory, Lemont, IL, USA, rapid fluctuation of energy availability re-

2026-07-24优化算法

本文针对电解槽参与日前和实时电力市场时,多年尺度 MILP 因高频价格与寿命退化耦合而难以求解的问题,提出用聚合子问题信息强化 Benders 主问题的分解方法。其关键在于用价格聚类构造有效下界,改善早期更换决策。40 年案例中,相比传统 Benders 最优性间隙最多降低约 81%,并显示实时市场在高波动价格下更具经济性。

A free boundary problem driven by boundary distance in the coincidence set Figure 1
2026-07-24math.AP

A free boundary problem driven by boundary distance in the coincidence set

Amal Alphonse, Enrico Valdinoci

Department of Mathematics and Statistics, University of Western Australia

2026-07-24学习理论

本文动机来自带黏附接触能的双膜问题:重合区越深入自由边界,能量奖励越大。核心创新是把零相内部到边界的距离作为非局部项,并用基于局部平均的零集定义解决 Sobolev 代表元导致的适定性问题。主要结果包括证明极小解存在、建立非局部项弱下半连续性,推导正相上的 PDE、变分不等式及在非退化假设下的自由边界条件,并给出一维点态刻画。

Fokker-Planck-Kolmogorov inclusions of the mean field type Figure 1
2026-07-24math.OC

Fokker-Planck-Kolmogorov inclusions of the mean field type

Yurii Averboukh

HSE University, Moscow, Russia, Krasovskii Institute of Mathematics and Mechanics, Ural Federal University, Yekaterinburg, Russia

2026-07-24优化控制

本文面向带不连续系数或分布依赖控制约束的 McKean-Vlasov 动力学,提出均场型 Fokker-Planck-Kolmogorov 包含框架,将漂移与扩散系数视为依赖当前测度的多值选择。核心结果是在凸值、上半连续和增长条件下证明解存在性与解集紧性,并进一步给出相应最优控制问题存在最优解及值函数下半连续性。

A Gaussian smoothing-based zeroth-order method for Goldstein second-order stationarity Figure 1
2026-07-24math.OC

A Gaussian smoothing-based zeroth-order method for Goldstein second-order stationarity

Ming Lei, Ting Kei Pong, Man-Chung Yue, Liaoyuan Zeng, Hao Zhang

2026-07-24三维

本文针对零阶非凸优化中已有方法多停留在一阶驻点、且二阶复杂度通常要求 Lipschitz Hessian 的限制,提出 Goldstein 二阶 δ-次微分及相应近似二阶驻点概念。核心洞察是用高斯平滑 Hessian 的最小特征值刻画原函数广义二阶条件,并结合三次正则化与同伦式平滑参数设计零阶算法;主要结果是在 Lipschitz 可微和温和 coercivity 条件下给出找到该类近似二阶驻点的迭代复杂度保证。

Exact ensemble controllability for neural differential equations via neural interpolation Figure 1
2026-07-24math.OC

Exact ensemble controllability for neural differential equations via neural interpolation

Martin Gugat (Friedrich-Alexander-Universität Erlangen-Nürnberg (FAU), Department of Mathematics, Lehrstuhl für Dynamics, Control, Machine Learning and Numerics, Erlangen, Germany)

2026-07-24规划控制

本文从控制论解释监督学习的动机出发,研究同一组控制参数能否把多个初始状态精确送到各自目标状态的神经微分方程集成可控性。核心洞察是把动态可控问题构造成神经插值问题,并利用两层 tanh 网络形成局部化基函数,将插值化为正定线性方程组。主要结果证明在有限样本、轨迹不相交等条件下可实现精确集成可控,并给出控制参数的先验界。

Stabilization of 1D Linear Hyperbolic Balance Laws by Integral Difference Control and Application to Networks Stabilization Figure 1
2026-07-24math.OC

Stabilization of 1D Linear Hyperbolic Balance Laws by Integral Difference Control and Application to Networks Stabilization

Adam Braun (1), Jean Auriol (1), Lucas Brivadis (1) ((1) L2S)

full actuation is available at one boundary, as in [1]. How-, Laboratoire des signaux et syst`emes, 91190, Gif-sur-Yvette, France.

2026-07-24规划控制

针对交通、管网、反应器等由一维双曲平衡律描述、且常见欠驱动边界或域内控制的系统,论文提出统一的指数镇定框架。其关键是用可逆 backstepping 部分解耦,再把 PDE 镇定转化为积分差分方程层面的动态反馈设计,并通过稳定秩约简与 Corona 插值构造增益。结果证明在可镇定与鲁棒性假设下闭环指数稳定,并能处理含环网络,数值例展示了既有方法难覆盖的欠驱动环形网络。

Control Co-design of systems with parabolic PDE dynamics Figure 1
2026-07-24math.OC

Control Co-design of systems with parabolic PDE dynamics

Antika Yadav, Prasad Vilas Chanekar

2026-07-24规划控制

针对热调节、结构振动等由抛物型 PDE 描述的系统,传统先定物理参数再调控制器容易次优。论文把植物参数与 Neumann 边界反馈增益纳入统一 CCD,先给出依赖参数和增益的充分稳定条件,再经空间离散化形成可梯度求解的近似优化。数值算例显示,同时优化扩散/反应系数与控制增益可降低性能指标,但收敛性、最优性和高维扩展仍文中未充分说明。

Dynamic Cloud Service-Capacity Deployment with Costly Response Readiness Figure 1
2026-07-24math.OC

Dynamic Cloud Service-Capacity Deployment with Costly Response Readiness

Ruihan Zhou, Xiaowei Zhang, Yijie Peng

2026-07-24优化控制

面向冷启动 AI 产品上线时缺少历史负载、但需提前配置云服务能力的问题,论文将“当前部署容量”和“保留未来快速响应通道”拆成两个决策,建立含负载信念、服务容量和吸收式响应状态的有限期动态规划,并提出 CBAP 策略。实验与 BurstGPT 决策层评估显示,该方法通过减少过早扩容和不必要的就绪成本,相比基准策略降低生命周期成本。

Boundary control and periodic trajectories of semilinear Euler equations with application to hydrogen transport Figure 1
2026-07-24math.OC

Boundary control and periodic trajectories of semilinear Euler equations with application to hydrogen transport

Alexander Zuyev, Peter Benner

Max Planck Institute for Dynamics of Complex Technical Systems, Magdeburg, Germany

2026-07-24规划控制学习理论

面向氢气管道中供给与需求周期波动带来的边界控制问题,论文将等温半线性 Euler 方程经提升算子转化为 Hilbert 空间中的抽象非线性控制系统,并用 Fourier/Galerkin 表示构造周期轨迹。主要结果是给出周期解存在唯一性的条件和迭代构造方案,并在现实氢输运模型上数值验证周期运行状态。

Learning to recover: Adaptive local branching with reinforcement learning for log-truck routing and scheduling under disruptions Figure 1
2026-07-24math.OC

Learning to recover: Adaptive local branching with reinforcement learning for log-truck routing and scheduling under disruptions

Abdelhakim Abdellaoui, Issmail El Hallaoui, Loubna Benabbou, François Aubé, Mouloud Amazouz

Department of Mathematics and Industrial Engineering, Polytechnique Montréal, succ. Centre-ville, Montréal, Québec, H3C 3A7, Canada, Department of Management Science, Université du Québec à Rimouski (UQAR), Levis, QC G6V 0A6, Québec, Canada

2026-07-24强化学习

面向加拿大林业中道路封闭、车辆故障等频繁扰动导致原木卡车战术计划失效的问题,论文把恢复调度建模为带偏离半径 k 的局部 MILP 搜索,并用强化学习自适应选择 k,以生成成本与稳定性之间的帕累托方案集。实验基于工业历史周实例,显示该方法比固定网格和二分搜索用更少求解器调用得到更丰富的非支配恢复方案,并能在可接受重优化时间内找到可行计划。

Implicit Primal-Dual Guarantees in Unconstrained First-Order Minimization Figure 1
2026-07-24math.OC

Implicit Primal-Dual Guarantees in Unconstrained First-Order Minimization

Benjamin Grimmer, Alex L. Wang

2026-07-24优化控制

本文关注一阶凸优化中传统目标函数差界是否遗漏了可验证结构。核心洞察是,在仅假设初始点到最优解距离有界时,许多固定步长一阶法的已有 PEP 收敛证明会隐含给出同速率的可计算原始-对偶间隙证书。结果表明,非光滑 Lipschitz 与光滑情形下的目标差界可无损加强,并解释了动量方法中辅助序列可视为最优点估计。

Structure-Preserving Spectral Dynamic Programming on Compact Lie Groups Figure 1
2026-07-24math.OC

Structure-Preserving Spectral Dynamic Programming on Compact Lie Groups

Shanqing Liu, Yang Qi

Division of Applied Mathematics, Brown University

2026-07-24优化控制

本文面向刚体姿态、航天器和量子系统等状态位于紧致李群的最优控制,指出传统 Peter-Weyl/Galerkin 谱投影虽保持几何结构,却会破坏动态规划所需的单调性和 sup 范数非扩张性。核心做法是用 Markov 型谱滤波替代正交投影,尤其构造有限秩、保正且非扩张的 Fejér 型滤波器。文中给出 Lipschitz 数据下的收敛率,并说明在 SO(3) 上可结合正 cubature 与精确 Wigner 传输实现;实验结果与理论速率和滤波偏差预测一致。

Mean field and N-agent games for optimal relative consumption-investment with jump risk and common noise Figure 1
2026-07-24math.OC

Mean field and N-agent games for optimal relative consumption-investment with jump risk and common noise

Yiming Jiang, Fuxing Li, Yawei Wei, Zimeng Zheng

2026-07-24安全鲁棒

本文动机是刻画大量投资者在相对消费与终端财富竞争下,面对个体噪声、共同市场噪声和向下跳跃风险时的最优消费-投资行为。核心做法是在均值场极限中用随机最大值原理得到解析形式的确定性均衡,并据此回推有限 N 人博弈的近似 Nash 均衡;数值实验用于展示均衡策略及其金融含义。

A Safeguarded Projected-Gradient Framework for Complementarity-Constrained Least-Squares Problems Figure 1
2026-07-24math.OC

A Safeguarded Projected-Gradient Framework for Complementarity-Constrained Least-Squares Problems

Lianghai Xiao, Wei Zhang, Jiayi Zhong

College of Information Science and Technology

2026-07-24优化算法安全鲁棒

针对 GAVE 与 LCP 在均衡和优化模型中共享的互补约束结构,论文将二者统一为互补集上的最小二乘问题,提出带安全机制的投影梯度框架,并用问题相关代数求解作受控修正。理论上给出投影驻点零残差、全局收敛、唯一解有限恢复等条件;实验显示在基准上精度较高,但计算收益依赖问题结构。

Rule-Induced Behavior of Fuzzy Scalar Objective Functions for Reliable Multi-Criteria Decision Making Figure 1
2026-07-24math.OC

Rule-Induced Behavior of Fuzzy Scalar Objective Functions for Reliable Multi-Criteria Decision Making

Olaf Frommann

Institute for Aerospace Technology, Hochschule Bremen, University of Applied Sciences

2026-07-24优化控制

针对多指标决策中模糊规则标量化可能“看似符合偏好、实际由平台或锁定效应驱动”的问题,论文用可控双目标 Pareto 前沿和含劣化参考点的嵌入实验,剥离隶属函数位置、隐式基线规则和显式后件的影响。核心洞察是,参考跟随必须表现为低并列歧义的局部极小,而非平坦激活平台;结果显示全局隶属可稳定恢复 Pareto 折中但未必逐点改进参考,参考式三类规则在测试中能改进劣化参考并恢复 Pareto 集。

First-Order Analysis of Optimization in Uniformly Convex Metric Spaces: Directional Subderivatives and Basic Descent Figure 1
2026-07-24math.OC

First-Order Analysis of Optimization in Uniformly Convex Metric Spaces: Directional Subderivatives and Basic Descent

D. Russell Luke, Titus Pinta, Qinyu Yan

∗Institute for Numerical and Applied Mathematics, Georg-August University of G¨ottingen, ‡Institute for Numerical and Applied Mathematics, Georg-August University of G¨ottingen.

2026-07-24优化算法

这篇论文面向缺少线性结构、近端映射又不易显式计算的测地度量空间优化,试图为非凸光滑问题建立可执行的一阶下降理论。核心做法是用测地方向次导数、归一化斜率和最陡下降测地线替代传统梯度/次微分框架,并把分析放在一致凸度量空间中。主要结果给出基本下降序列的方向次导数收敛条件、在度量 Polyak-Lojasiewicz 条件下函数值与迭代点的线性收敛,以及最陡下降方向满足充分下降的存在性。

End-to-End Learning of Safe Optimal Feedback Control in High Dimensions with Control Barrier Function Layers Figure 1
2026-07-24cs.LG

End-to-End Learning of Safe Optimal Feedback Control in High Dimensions with Control Barrier Function Layers

Xingjian Li, Kelvin Kan, Deepanshu Verma, Krishna Kumar, Stanley Osher, Samy Wu Fung

2026-07-24规划控制安全鲁棒

这篇论文针对安全反馈控制中 CBF-QP 安全层难以端到端扩展到高维系统的问题,核心做法是用算子分裂求解安全投影,并用 Jacobian-Free Backpropagation 避免高维 KKT/隐式微分瓶颈,同时用 Clarke 广义雅可比给出非光滑层下的训练收敛依据。实验覆盖多智能体非线性控制,报告可扩展到约 1200 维状态和 400 维控制,并保持 CBF 硬安全约束。

Double-Scoring: Reliable Extraction of Strong Lottery Tickets Figure 1
2026-07-24cs.LG

Double-Scoring: Reliable Extraction of Strong Lottery Tickets

Bryce A. Christopherson, Jack Baretz, Darian Colgrove, Salah Dandan

Department of Mathematics & Statistics, University of North Dakota

2026-07-24优化控制

本文针对强彩票票据虽有存在性理论、但从随机冻结网络中可靠找出子网仍困难的问题,指出 edge-popup 的关键瓶颈在于需预设逐层稀疏率。作者提出 double-scoring,通过扩展分数空间并用固定密度竞争来隐式决定原网络稀疏结构。FashionMNIST MLP 实验显示其强票据提取优于固定密度 edge-popup、SNIP、GraSP 等基线,对稀疏超参数更稳定,且训练后仍具竞争力。

2026-07-23

29 篇
Lipschitzian SLLNs for random functions Figure 1
2026-07-23math.OC

Lipschitzian SLLNs for random functions

Lai Tian, Johannes O. Royset

2026-07-23优化控制

本文面向随机优化中非凸、非光滑目标的样本平均近似一致性问题,动机是现有弱平稳性结果可能因交换期望与次微分而过松。核心创新是在 Lipschitz 伪度量下建立局部 Lipschitz 随机函数的强大数定律,从函数层面控制收敛,再推出限制次微分与 Clarke 次微分的统一收敛。主要结果给出拓扑或模型论条件下的 SAA 平稳点一致性,并支持有限样本识别解。

Local minimizers in $\mathbb{R}^n$ of vector Allen-Cahn with an $(n+1)$-junction Figure 1
2026-07-23math.AP

Local minimizers in $\mathbb{R}^n$ of vector Allen-Cahn with an $(n+1)$-junction

Abhishek Adimurthi

Department of Mathematics, Indiana University

2026-07-23优化控制

本文动机是把含多相交汇的向量 Allen-Cahn 局部极小结构从低维推广到一般高维情形。核心做法是用 n-单纯形构造带 (n+1)-junction 的锥形分割,并通过带“凹痕”的球域变形与校准论证证明相应加权周长问题存在孤立的 L1 局部极小;再由 Γ-收敛推出 n+1 势阱 Allen-Cahn 能量存在收敛到该分割的局部极小序列,同时放宽了既有工作中的权重假设。

Model Risk via Signature-Induced Optimal Transport Figure 1
2026-07-23q-fin.RM

Model Risk via Signature-Induced Optimal Transport

Tomoyuki Ichiba, Qijin Shi

2026-07-23安全鲁棒

针对金融和保险中路径依赖定价、尾部事件对模型设定高度敏感的问题,论文用路径签名坐标定义最优传输歧义集,把路径分布差异拆成可解释的坐标预算。核心结果是对仿射签名收益和半空间事件给出只依赖基准模型的鲁棒期望与概率上界,并由同一有效预算导出稀疏签名代理学习流程;实验覆盖压力测试和模型错设基准,但实际增益相对既有OT-DRO方法的来源仍需看完整数值细节。

Shape optimization for thermoelasticity with temperature-dependent material parameters Figure 1
2026-07-23math.OC

Shape optimization for thermoelasticity with temperature-dependent material parameters

Marc Dambrine, Helmut Harbrecht, Viacheslav Karnaev

2026-07-23优化算法

面向发动机等高热流工况下结构设计,本文把温度随时空变化且材料参数依赖温度的热弹性问题纳入形状优化。核心在于建立弱耦合的半线性热方程与热弹性系统,证明并推导域积分型目标的形状导数,再结合有限元与水平集实现优化。数值结果覆盖体积约束下柔度最小化,以及 von Mises 应力约束下体积最小化,展示了方法可处理热-力耦合设计目标。

Decentralized Online Riemannian Optimization for Strongly Geodesically Convex Functions Figure 1
2026-07-23math.OC

Decentralized Online Riemannian Optimization for Strongly Geodesically Convex Functions

Zhanyuan Cai, Emre Sahinoglu, Shahin Shahrampour

2026-07-23优化算法

本文针对多智能体在线优化中决策变量位于黎曼流形、且强测地凸性尚未被去中心化方法利用的问题,分析衰减步长下的网络一致性误差,并处理正曲率投影与两点 bandit 平滑带来的额外项。核心结果是在全信息和两点函数值反馈下均得到 O(log T) 静态遗憾,达到强凸欧氏在线优化的最优量级。

DQAOA-GPT: AI-Accelerated Distributed Quantum Optimization for Combinatorial Problems Figure 1
2026-07-23quant-ph

DQAOA-GPT: AI-Accelerated Distributed Quantum Optimization for Combinatorial Problems

Seongmin Kim, Abhinav Rijal, Yuri Alexeev, Nora Bauer, Martin Roetteler, Mina Yoon, George Siopsis, In-Saeng Suh

2026-07-23优化算法

面向大规模组合优化中 QAOA 需反复量子线路评估与经典参数更新的瓶颈,论文提出 DQAOA-GPT:先用 DQAOA 将 HUBO 问题分解,再由 GPT 模型直接生成子问题量子线路以替代变分优化。实验在最多 100 个变量的稠密 HUBO 上显示其计算成本显著低于传统 DQAOA,解质量仍具竞争力,且子问题越大加速越明显;但验证仍偏基准规模,实际增益可能主要来自 scaling / data。

On Optimization Complexity of Second-Order Certified Unlearning Figure 1
2026-07-23cs.LG

On Optimization Complexity of Second-Order Certified Unlearning

Nikita Doikov, Anastasia Koloskova

2026-07-23优化算法

为避免删除少量训练数据时从头重训,论文从优化复杂度刻画认证机器遗忘,要求同时满足分布级遗忘保证与接近保留集最优解。核心创新是用均匀凸正则和预测误差替代量界定新旧模型距离,并提出结合 Hessian 的二阶算法与各向异性高斯机制。理论结果给出准自洽损失线性模型的快速全局收敛与认证遗忘界,覆盖 logistic 和 exponential 回归,显示二阶信息相对一阶方法的可证明优势。

Local Stability and Gaussian Smoothing of Quantized Neural Networks Figure 1
2026-07-23cs.LG

Local Stability and Gaussian Smoothing of Quantized Neural Networks

Sergey Salishev, Anton Makarov, Oleg Granichin

∗St. Petersburg State University, 199034, Saint Petersburg, Russia, a trained network. Assume that f fits the training labels, Assume also that the labels have empirical local oscillation

2026-07-23三维

面向量化神经网络在控制/估计硬件中因不连续性而难以做稳定性分析和梯度设计的问题,论文把高斯平均作为原离散模型的平滑代理,并用有界局部振荡刻画何时近似可信。核心结果是给出维度相关的局部误差界,推导 ReLU 与 sign 的闭式高斯平滑形式,并在高维二值感知机中说明量化残差经层预激活聚合可形成 CLT 高斯包络;多层潜空间机制文中未充分说明。

A Coupled Nonsmooth Dynamical System: Global Well-Posedness, Stability and Sensitivity Analysis Figure 1
2026-07-23math.OC

A Coupled Nonsmooth Dynamical System: Global Well-Posedness, Stability and Sensitivity Analysis

Shengda Zeng, Jia Chen, Vo Thanh Phat

National Center for Applied Mathematics in Chongqing, School of Mathematical Sciences, Chongqing Normal University, Department of Mathematics and Statistics, University of North Dakota, Grand Forks, North Dakota, United States.

2026-07-23三维

本文针对接触、扫掠过程和约束控制中常见的“演化方程+隐式法锥代数律”耦合难题,先把冻结代数关系变换为凸集上的变分不等式,从强伪单调性推出唯一状态到控制映射及灵敏度估计,再将系统化为单状态半线性演化方程。主要结果包括有限时域全局适定性、Hadamard 连续依赖、耗散情形下的增量指数稳定性,以及参数到解映射的连续性。

Forward-Reflected-Backward algorithm with Linesearch Figure 1
2026-07-23math.OC

Forward-Reflected-Backward algorithm with Linesearch

Fernando Muñoz García, Fernando Roldán

2026-07-23优化控制

本文面向单调包含中连续但未必 Lipschitz 的算子,动机是避免 FBF 每步两次算子评估及全局常数估计带来的保守步长。核心创新是为 FRB 设计新的线搜索,并利用历史算子值保证在仅连续情形下也能良定义与收敛,同时扩展到含 cocoercive 和 Lipschitz 算子的四算子框架。实验在鞍点问题和图像复原上显示,该方法相对线搜索 FBF 具有竞争性,并可在部分场景降低计算开销。

On the sample complexity of Fourier compressed sensing: wavelets versus shearlets Figure 1
2026-07-23math.FA

On the sample complexity of Fourier compressed sensing: wavelets versus shearlets

Giovanni S. Alberti, Alessandro Felisi, Işıl Güleken

Machine Learning Genoa Center (MaLGa), Department of Mathematics, Department of Excellence

2026-07-23强化学习

论文聚焦傅里叶压缩感知中“剪切波比小波更稀疏是否就能少采样”的问题。作者从局部相干性与冗余框架定位因子两方面分析剪切波的理论瓶颈,指出其相干性衰减慢、下框界可能极小,导致样本复杂度仍随稀疏度近似二次增长;数值相图也显示,剪切波虽用更少系数表示分片光滑图像,但所需傅里叶采样数并未相应下降。

Order-2 Tightness of Block-Sparse SOS Relaxations for One-Layer ReLU Network Verification with a Matching Input-Sharing Graph Figure 1
2026-07-23math.OC

Order-2 Tightness of Block-Sparse SOS Relaxations for One-Layer ReLU Network Verification with a Matching Input-Sharing Graph

Godai Azuma, Sunyoung Kim, Makoto Yamashita

2026-07-23优化控制

本文关注安全关键场景中一层 ReLU 网络验证的可证上界问题,动机是弄清稀疏 SOS/SDP 松弛何时不损失精度。核心洞察是用输入共享图刻画未定 ReLU 的耦合,并在匹配图下把全局问题分解为孤立点和单边块;对正则秩一边给出二单元凸包刻画与二阶局部证书。主要结果证明在匹配和正则秩一条件下,二阶块稀疏 SOS 松弛是紧的。

Accelerated Stochastic Zeroth-Order Quasar-Convex Optimization Figure 1
2026-07-23math.OC

Accelerated Stochastic Zeroth-Order Quasar-Convex Optimization

Eméric Gbaguidi, Julien Hermant

2026-07-23优化算法

本文关注在只能获得带噪函数值、无法使用梯度的场景中,如何加速光滑 quasar-convex 非凸优化;传统加速依赖一阶子空间搜索而失效。作者将 continuized Nesterov 思路改造成随机零阶算法,并加入镜像步,在无需梯度的条件下给出接近光滑凸优化的加速收敛界,复杂度仅受 quasar-convex 参数和维度因子影响,稀疏解时维度依赖可改善。

Optimal Placement of Docking Stations and Resident AUVs for Subsea Pipeline Inspection Figure 1
2026-07-23math.OC

Optimal Placement of Docking Stations and Resident AUVs for Subsea Pipeline Inspection

Gabrielė Kasparavičiūtė, Pasquale Grippa, Kjetil Skaugset, Asgeir J. Sørensen, Martin Ludvigsen

2026-07-23优化控制

面向海底管线泄漏后需快速确认、传统ROV响应慢且成本高的问题,论文把水下对接站选址与常驻AUV分配合并为两阶段MILP:先压低最坏往返检查时间,再在该上界下优化平均时间,并用离散管线点表示异常位置不确定性。在Johan Sverdrup案例中,9个候选站、33条管线的实验显示少量合理布设的SDP即可接近最优响应表现,Pareto分析进一步量化了部署成本与响应效率的取舍。

Analysis on spaces of measures Figure 1
2026-07-23math.AP

Analysis on spaces of measures

Charles Bertucci (CEREMADE)

2026-07-23优化控制

本文动机是澄清测度空间分析中多种“对测度求导”概念带来的混淆,并为平均场博弈与平均场控制中的 PDE 提供统一工具。核心洞察是区分增减质量的垂直导数与搬运质量的水平导数,并围绕凸性、次微分和最优性条件建立计算框架。主要结果包括主方程解的存在、唯一性与稳定性,以及概率测度空间上 HJB 方程黏性解和值函数正则性的刻画。

Continuous-Time Reinforcement Learning for $N$-Player Stochastic Differential Games with Exploratory Policies Figure 1
2026-07-23math.OC

Continuous-Time Reinforcement Learning for $N$-Player Stochastic Differential Games with Exploratory Policies

Jisheng Liu, Jing Zhang

School of Mathematical Sciences, Fudan University, China

2026-07-23强化学习

针对有限多智能体连续时间随机微分博弈中,传统多智能体强化学习缺少非合作、非对称场景理论基础的问题,本文把熵正则探索策略推广到N人博弈,揭示条件最优Gibbs策略能否组成纳什均衡取决于兼容性,并给出可由q函数交叉偏导检验的充要条件;在不兼容时构造近似相关均衡,给出随探索权重增大而收敛的KL与次优界,并扩展到遍历无限时域。

Beyond recency and magnitude: Learning-aware uncertainty estimation for safety stock under evolving forecast-error distributions Figure 1
2026-07-23math.OC

Beyond recency and magnitude: Learning-aware uncertainty estimation for safety stock under evolving forecast-error distributions

Luis Fernández-Palacios, Manuel Ceballos, Yolanda Muñoz-Ocaña

a Loyola University Andalusia, Department of Business Management, Campus Sevilla: Avda. de las Universidades, 2, b Loyola University Andalusia, Department of Engineering, Campus Sevilla: Avda. de las Universidades, 2, 41704 -, c Loyola University Andalusia, Department of Business Management, Campus Córdoba: Calle Escritor Aguayo, 4

2026-07-23安全鲁棒

本文针对快消品安全库存中“历史预测误差是否仍代表未来不确定性”的问题,指出单年样本不足、多年直接合并又会混入已过时的误差分布。核心创新是 LOWDII,用留一法和 Wasserstein 距离评估单个误差对经验分布的影响,区分结构性尾部风险与暂时扰动。离散事件仿真显示其在达到约 98% 服务水平的同时,相比基准平均库存降低 5.1% 至 22.6%。

Harnessing Heterogeneous Data for Conditional Optimization via Optimal Transport Figure 1
2026-07-23math.OC

Harnessing Heterogeneous Data for Conditional Optimization via Optimal Transport

Jonathan Yu-Meng Li, Qinyu Wu

2026-07-23优化算法

本文针对目标场景样本稀缺、条件事件观测更少时,如何利用有偏但相关的多源数据做条件优化的问题,提出基于最优传输的分布鲁棒框架。核心创新是用三类 OT 歧义集刻画多源一致性、加权差异和重心聚合,并给出可解重构、可行性与关系分析。实验在多店铺需求的条件选品问题上显示,该方法较简单池化或单源基线更能兼顾稳健性与信息利用。

Foundations of Machine-Checked Control Theory in Lean Figure 1
2026-07-23math.OC

Foundations of Machine-Checked Control Theory in Lean

Moritz Doll, Iman Shames

Department of Electrical and Electronic Engineering, University of Melbourne

2026-07-23规划控制学习理论

面向网络物理系统验证中控制理论形式化基础不足的问题,本文在 Lean/mathlib 中构建开源控制理论库。核心做法是用邻域滤子统一表述点/集合及连续、离散、混合系统的 Lyapunov 稳定性,并将输入输出系统建模为关系以证明无需良定性假设的小增益定理。主要结果是给出这些定理的机器检查形式化、库架构及后续扩展方向。

Contact-Persistent Full Actuation for Aerial Physical Interaction Figure 1
2026-07-23cs.RO

Contact-Persistent Full Actuation for Aerial Physical Interaction

Abhimanyu Khadga, Abhinav Sinha, Shashi Ranjan Kumar

2026-07-23优化控制

这篇论文针对全驱动无人机在持续接触中仅用分配矩阵满秩认证不足的问题,提出“接触持久全驱动”框架:把任务所需 wrench 放入受执行器约束的可行 wrench 多面体中考察,关注剩余稳定与抗扰裕度。核心结果证明该性质等价于任务 wrench 位于多面体内部,剩余权威半径就是到边界的距离,并给出带符号裕度、松弛分配和安全过滤条件;六旋翼数值实验显示,满秩仍可能无法推压,适中或自适应倾角才能保留稳定裕度。

On the Universality of Simple Trust-Region Algorithms Figure 1
2026-07-23math.OC

On the Universality of Simple Trust-Region Algorithms

Clemens Sirotenko

2026-07-23优化控制

本文针对信赖域方法在不同光滑性与凸性条件下是否需调参才能保持复杂度保证的问题,指出简单二次信赖域机制本身具有“通用”适应性。核心洞察是新的函数间隙-模型下降估计,并结合经典或改进接受比分析。结果显示,经典方法在凸情形达到 Hölder 自适应全局复杂度并保持局部 Newton 收敛;改进比值的 UniCAT 还获得非凸最优一阶复杂度,但精确子问题求解等假设限制了实践解释。

Beyond Ellipsoids: Semi-Algebraic Tightening for Chance Constraints Under Actuator Saturation Figure 1
2026-07-23math.OC

Beyond Ellipsoids: Semi-Algebraic Tightening for Chance Constraints Under Actuator Saturation

Carlo Karam, Mirko Fiacchini, Matteo Tacchi-Bénard

The authors are with Univ. Grenoble Alpes, Grenoble INP, CNRS, GIPSA-lab

2026-07-23优化算法

本文面向随机模型预测控制中无界扰动与执行器饱和并存时的机会约束收紧问题,指出传统椭球随机管因忽略饱和分段结构而偏保守。核心做法是精确利用饱和误差动力学的分段仿射形式,并用 SOS 优化构造满足漂移条件的多项式 Lyapunov 函数,得到有限时概率可达集和稳态概率最终界。数值算例显示,该半代数集合在约束收紧中比椭球界更少保守。

Data-driven feedback rectification of switched linear systems Figure 1
2026-07-23math.OC

Data-driven feedback rectification of switched linear systems

Philipp Schmitz, Hannes Gernandt, Maria C. Honecker, Karl Worthmann

University of Wuppertal, Gaußstraße 20, 42119 Wuppertal, Germany, Chair of Intelligent Control Systems, RWTH Aachen University

2026-07-23优化控制

针对切换线性系统在任意切换下仅稳定各子系统仍可能失稳、且传统反馈校正依赖精确模型的问题,本文利用离线采集的各模态输入-状态数据和 Willems 基本引理,直接刻画共同闭环特征向量基的可行条件,并给出模态依赖状态反馈公式。主要结果是可从数据构造校正后的闭环特征结构与公共二次 Lyapunov 函数,从而保证渐近稳定,并在数值例子和 Aerosonde 模型上演示。

Optimization models and algorithms for the Unit Commitment problem Figure 1
2026-07-23math.OC

Optimization models and algorithms for the Unit Commitment problem

Javal Vyas, Carl Laird, Ignacio E. Grossmann, Ricardo M. Lima, Iiro Harjunkoski, Jan Poland

a Department of Chemical Engineering, Carnegie Mellon University, Pittsburgh, PA 15213, USA, b King Abdullah University of Science and Technology, Thuwal 23955-6900, Saudi Arabia, To expand on the available models from the litera-

2026-07-23优化算法

面向电网日内反复求解机组组合时的严格时限,本文关注含传输与备用约束的日 ahead SCUC 大规模 MILP。核心做法是在 EGRET 多种紧/紧凑模型基础上引入 shrinking horizon 分解,用紧松弛改善滚动窗口中的界与分支剪枝。四个基准系统测试显示计算速度显著提升,但可再生不确定性和储能被排除,具体增益来源与最优性代价文中未充分说明。

Online Optimization of Difference-of-Convex Compositions with Smooth Mappings Figure 1
2026-07-23math.OC

Online Optimization of Difference-of-Convex Compositions with Smooth Mappings

Jingwei Ji, Jong-Shi Pang, Renyuan Xu

2026-07-23优化算法

针对在线非凸非光滑问题中外部 regret 难以刻画全局最优、且 CDCS 目标与约束会破坏常规投影/近端更新可行性的动机,论文提出基于时间平滑的近端线性算法和近端残差局部 regret。核心洞察是用带缓冲的凸线性化集合刻画非凸可行域切锥,使每步可由凸优化 oracle 求解,同时残差固定点推出一阶驻点。主要结果给出局部 regret、内层凸子问题次数界,并证明残差可上界到驻点集距离,形成可计算的近似驻性证书。

RELTA-SGLD: Relative-Growth Localized Taming for Nonconvex Stochastic-Gradient Langevin Learning Figure 1
2026-07-23stat.ML

RELTA-SGLD: Relative-Growth Localized Taming for Nonconvex Stochastic-Gradient Langevin Learning

Yiwei Zhou, Ziheng Chen

2026-07-23优化算法

针对非凸 SGLD 在随机梯度超线性增长时易失稳、而传统全局 taming 又会过度压制正常学习的问题,论文提出 RELTA-SGLD:用一步 Lyapunov 平衡中的 Q/I 相对增长决定尾部驯化强度,并通过阈值只在大范数区域启用。理论上证明多项式矩稳定及 W1、W2 一阶平稳精度,实验在 Fashion-MNIST 和四次势采样中显示较 TUSLA 更少扰动且性能更好。

Equilibrium Causal Games: Separation, Identification, and the Identifiability of Cyclic Latent States Figure 1
2026-07-23math.OC

Equilibrium Causal Games: Separation, Identification, and the Identifiability of Cyclic Latent States

Faraz Dadgostari, Neda Nazemi

Department of Mechanical & Industrial Engineering, Montana State University, Gianforte School of Computing, Montana State University

2026-07-23优化控制

本文关注电网、市场等反馈系统在未知传感观测下,干预后均衡如何变化。核心创新是提出 Equilibrium Causal Game,将博弈、循环因果模型、潜变量传感与干预代数统一,并区分源坐标旋转与潜在坐标混淆两类不可辨识。主要结果给出 ECG 分离的可靠但不完备性、后门/half-trek 识别条件,以及在线性、LiNG 和非线性传感场景下哪些结构需目标化机制干预才能恢复。

Bilinear Systems with Quadratic Outputs: $\mathcal{H}_2$ Analysis, Optimality Conditions for Model Reduction, and Algorithmic Solutions Figure 1
2026-07-23math.NA

Bilinear Systems with Quadratic Outputs: $\mathcal{H}_2$ Analysis, Optimality Conditions for Model Reduction, and Algorithmic Solutions

Heike Faßbender (1), Serkan Gugercin (2), Till Peters (1) ((1) Institute for Numerical Analysis, TU Braunschweig, (2) Department of Mathematics and Division of Computational Modeling and Data Analytics, Academy of Data Science, Virginia Tech)

‡Department of Mathematics and Division of Computational Modeling and Data Analytics, Acad-

2026-07-23优化控制

面向大规模双线性动力学且输出含二次状态量的系统,现有模型降阶缺少统一的 H2 理论支撑。论文将双线性系统与线性二次输出系统纳入同一 BQO 框架,定义 H2 内积与范数,给出输出及误差界,推导一阶最优性条件,并提出满足这些条件的迭代降阶算法;数值例子显示其相对平衡截断能高效获得高保真 reduced model。

Statistical and Numerical Convergence in Stochastic Equilibrium Figure 1
2026-07-23econ.EM

Statistical and Numerical Convergence in Stochastic Equilibrium

David Staines

2026-07-23学习理论

本文面向DSGE等随机均衡模型中数值求解缺乏严格保证、估计检验难以统一的问题,给出几何收敛率由靠近单位圆的特征根与冲击持久性共同决定的分析框架,并提出基于模拟的均衡存在性检验。主要结果表明随机稳态是任意阶扰动近似的最优邻域,特定情形下参数估计可达O(1/T)超一致;在Calvo、Taylor合约和菜单成本定价中,还得到冲击响应峰值界、内生重置概率等结构化结论。

2026-07-22

21 篇
Real-time optimal control with shallow recurrent decoder networks Figure 1
2026-07-22cs.LG

Real-time optimal control with shallow recurrent decoder networks

Matteo Tomasetto, Francesco Braghin, J. Nathan Kutz, Andrea Manzoni

† Department of Mechanical Engineering, Politecnico di Milano, Milano, Italy, ‡ MOX - Department of Mathematics, Politecnico di Milano, Milano, Italy

2026-07-22规划控制

面向高维参数化动力系统的实时闭环最优控制,传统 PDE 优化在多场景下计算代价过高。论文用 SHRED-ROM 从少量传感器历史和专家最优示例中学习控制策略,以 LSTM 编码、浅解码器和 POD 压缩直接预测分布式控制,并加入潜在层传感器预测以应对丢包或延迟。三类密度与流体控制算例显示,该方法可在新参数下实时生成有效控制,且在高传感器失效概率下仍能维持闭环性能。

Model-Agnostic Meta Learning for Differentiable MPC Figure 1
2026-07-22eess.SY

Model-Agnostic Meta Learning for Differentiable MPC

Salma Elfeki, Riccardo Zuliani, Niklas Schmid, Efe C. Balta, John Lygeros

a National Centre of Competence in Research, Automatic Control Laboratory (IfA)

2026-07-22规划控制

针对梯度式 MPC 调参在硬件闭环中代价高、且易对训练轨迹过拟合的问题,论文把 MAML 引入可微 MPC,不仅学习可快速适配的新初始控制器参数,还把在线系统辨识纳入同一优化流程以更新预测模型。球板实验证明,该方法在不同参数化轨迹跟踪任务上比从头重训更快适应,并在较少闭环迭代下保持较好性能。

A Complete Characterization of Optimal Subgradient Methods for Lipschitz Convex Minimization Figure 1
2026-07-22math.OC

A Complete Characterization of Optimal Subgradient Methods for Lipschitz Convex Minimization

Aaron Zoll, Benjamin Grimmer

2026-07-22优化算法

本文针对 Lipschitz 凸优化中固定步长次梯度法虽已知达到 minimax 最优速率、但最优方法族结构不清的问题,刻画了所有由步长矩阵参数化的最优固定步一阶方法。核心洞察是把性能估计问题的对偶证明乘子与步长矩阵对应起来,给出最优方法集合的多面体表示,并证明这些方法均可由既有构造过程导出;进一步推出不存在 anytime 最优的固定步长次梯度法。

A relaxed-inertial proximal point algorithm for strongly quasiconvex equilibrium problems on Hadamard manifolds Figure 1
2026-07-22math.OC

A relaxed-inertial proximal point algorithm for strongly quasiconvex equilibrium problems on Hadamard manifolds

Luisa Marie Després, Nicholas Pischke

2026-07-22优化算法

本文针对极小化、变分不等式等可统一表述的均衡问题,研究强拟凸双函数在 Hadamard 流形上的求解。核心创新是把带惯性项和过松弛的近端点算法从欧氏空间推广到非线性流形,并用 proof mining 给出显式且统一的收敛速率。主要结果证明迭代到解的距离快速收敛,同时削弱或去除了既有欧氏结果中的部分假设。

Active Disturbance Rejection for Boundary Control Systems Figure 1
2026-07-22math.OC

Active Disturbance Rejection for Boundary Control Systems

Jukka-Pekka Humaloja, Lassi Paunonen

Department of Electrical and Computer, Engineering, Technical University of Crete, Chania, Greece., Mathematics Research Centre, Tampere University, P.O.

2026-07-22规划控制学习理论

本文面向边界控制 PDE 在未知输入扰动和未建模输入非线性下的稳定化问题,核心洞察是利用原边界系统的逆动态从输出中渐近估计“总扰动”,再嵌入 ADRC 与 Luenberger 型观测器实现补偿。主要结果给出抽象边界控制系统闭环解的存在性、外部增量适定性,并证明扰动估计与受控状态指数收敛;方法还实例化到一维波方程和热方程。

From Operations to Elderly Care Outcomes: A Thematic Review of Industrial Engineering and Decision-Support Approaches Figure 1
2026-07-22math.OC

From Operations to Elderly Care Outcomes: A Thematic Review of Industrial Engineering and Decision-Support Approaches

Shayan Farhang Pazhooh, Fereshteh Parvaresh

Department of Industrial and Systems Engineering, Isfahan University of Technology, systems, necessitating efficient, equitable, and patient-centered care models. While Industrial Engineering

2026-07-22强化学习

面向老龄化带来的护理资源紧张与多病共管复杂性,本文综述30项工业工程/运筹与决策支持研究,指出领域正从静态确定性排班、路径优化转向动态随机、AI辅助和多层级系统建模。主要结果是现有工作在居家护理、用药优化和时间治疗上已有方法进展,但仍过度聚焦流程效率,缺少把医院到社区衔接和患者临床结局纳入同一框架的证据。

Decentralized Linearized Consensus ADMM with Efficient Quantized Communication Figure 1
2026-07-22math.OC

Decentralized Linearized Consensus ADMM with Efficient Quantized Communication

Boyu Han, Xu Du, Karl H. Johansson, Apostolos I. Rikos

Karl H. Johansson is with the Division of Decision and Control Systems, KTH Royal Institute of Technology, SE-100 44 Stockholm, Sweden.

2026-07-22优化控制

面向大规模多智能体优化中集中式计算脆弱、通信链路可能有向且带宽受限的问题,论文提出 DQLCA,将线性化/不精确 Consensus ADMM 与有限时间去中心化量化通信结合,使节点只交换量化局部信息且无需精确求解子问题。在强凸光滑假设下,方法被证明可线性收敛到最优解邻域,实验显示相较既有方法在收敛时间和通信效率上更有优势。

Industrial Application of a Multi-Disciplinary Design Optimization with Uncertainties to a Pair of Telecommunication Satellites Figure 1
2026-07-22math.OC

Industrial Application of a Multi-Disciplinary Design Optimization with Uncertainties to a Pair of Telecommunication Satellites

Olivier Sapin, Loïc Cousin, Nicolas Roussouly, Anne Gazaix, François Gallard, Matthias De Lozzo, Xavier Fosse (ADS), Nicolas Sarda (ADS), Gaspard Berthelin (ADS)

2026-07-22优化算法

针对卫星多学科设计中用固定安全裕度处理不确定性会过度保守的问题,本文把可靠性约束、多学科可行架构与PCE代理模型结合,用于双星叠置发射的推进剂预算和轨道机动寿命优化。结果显示,在保持约束高概率可行的同时,相比预设安全裕度方案将性能损失降低66%。

Graphical stability of set-valued integrals under measure perturbations Figure 1
2026-07-22math.OC

Graphical stability of set-valued integrals under measure perturbations

Tam Le (LPSM (UMR\_8001), UPCité)

ical convergence and set-valued laws of large numbers are available in several forms: laws of

2026-07-22优化控制

本文针对非光滑随机优化中用经验测度、马尔可夫采样或平滑核替代真实分布时,集合值期望是否稳定的问题,给出弱测度扰动下的统一图收敛准则。核心洞察是将联合外半连续、紧凸值与超线性一致可积包络结合,通过支撑函数控制 Aumann 积分图的 excess 距离。主要结果证明任意弱收敛测度序列都会诱导集合值积分图外稳定,并推出随机广义方程解集稳定性。

Evaluating DV/CV-QKD Architectures for SAFE Long-Term Secure Storage: A Risk Model and ILP-Based Cost Optimization Approach Figure 1
2026-07-22math.OC

Evaluating DV/CV-QKD Architectures for SAFE Long-Term Secure Storage: A Risk Model and ILP-Based Cost Optimization Approach

Alireza Tasdighi, Romain Alléaume

2026-07-22优化算法安全鲁棒

面向医疗档案、数据中心等需要数十年保密的长期存储,论文把SAFE协议下DV/CV量子密钥分发的部署问题建模为风险约束下的随机整数线性规划,联合考虑妥协概率、链路密钥率、复用和工业成本。实验显示最优架构依场景变化,混合或单一模态都会出现;引人注意的是,提高最低链路密钥率有时反而降低总成本,因为会促使网络转向更便宜的CV方案。

Online sparse observers for cyber-physical systems under sensor bias Figure 1
2026-07-22eess.SY

Online sparse observers for cyber-physical systems under sensor bias

Vito Cerone, Sophie M. Fosson, Diego Regruto, Francesco Ripa

Department of Control and Computer Engineering

2026-07-22优化控制

针对网络物理系统中少量传感器存在恒定偏置或攻击时,批处理安全状态估计有延迟、在线观测器缺少收敛保证的问题,论文从可观测性出发,指出增广系统在特定特征值条件下可能不可观,并将近端梯度、交替最小化、Bregman 与 Kaczmarz 等稀疏优化方法改造成在线观测器;数值实验比较了这些可实现算法的状态和攻击恢复表现,但实际系统增益来源仍需结合更多场景验证。

A frugal primal-dual splitting with minimal lifting over arbitrary rooted trees Figure 1
2026-07-22math.OC

A frugal primal-dual splitting with minimal lifting over arbitrary rooted trees

Feng Xue, Hui Zhang

2026-07-22优化控制

面向含多个单调算子、线性复合、余可逆项和平行和的结构化包含问题,现有节俭分裂法在适用范围、提升维度和分布式拓扑上受限。本文把原始-对偶变量组织在任意有根树上,提出每步仅调用必要 resolvent 的最小提升分裂,并用乘积 Hilbert 空间重写来证明收敛。结果给出无条件收敛、(n−1,m) 最小提升,覆盖 Douglas–Rachford 与并行 Chambolle–Pock 特例,并获得原始-对偶间隙 O(1/k) 与渐近正则 o(1/k) 速率。

How network perturbations distort agreement trajectories in LTI multi-agent systems Figure 1
2026-07-22eess.SY

How network perturbations distort agreement trajectories in LTI multi-agent systems

Gal Barkai, Irinel-Constantin Morărescu

2026-07-22优化控制

这篇论文关注多智能体系统在网络扰动下是否仍会收敛到原先设计的协同轨迹,而不只判断是否达成一致。作者提出拉普拉斯域判据来刻画扰动后决定一致流形的闭环极点,并区分保结构扰动与仅传输扰动。主要结果显示,静态一致对异构传输延迟具有特殊鲁棒性,但任意小延迟都会破坏周期同步;在正则拓扑中,均匀传输扰动还可能把系统推向全新的同步频率。

Directional Derivatives and Error Bounds of Merit Functions in Vector Optimization Figure 1
2026-07-22math.OC

Directional Derivatives and Error Bounds of Merit Functions in Vector Optimization

Yu Han

School of Statistics and Data Science, Jiangxi University of Finance and Economics

2026-07-22优化算法学习理论

本文面向向量优化中多目标偏序难以直接用于算法分析的问题,研究由有向距离构造的 merit function 如何刻画弱有效解。核心创新是把方向导数、误差界与解集几何统一起来,给出弱有效点处的显式方向导数公式和零导数锥描述,并证明十三类全局误差界条件等价;还用单位球最小方向导数的统一负性刻画全局误差界,并确定局部最优误差界常数。

Fragility of Minimum-Variance Portfolios Figure 1
2026-07-22math.OC

Fragility of Minimum-Variance Portfolios

Daniel Ovalle, Carl D. Laird, Ignacio E. Grossmann, Javier Peña

Department of Chemical Engineering, Carnegie Mellon University, Pittsburgh, PA., Tepper School of Business, Carnegie Mellon University, Pittsburgh, PA.

2026-07-22优化控制

本文针对最小方差投资组合对协方差估计误差极其敏感的问题,追问不稳定性在协方差结构中的来源。核心洞察是,在块对角相关结构下可得到长仓解的闭式形式,并揭示相关性与波动率交互产生的阈值效应会放大脆弱性;据此提出结构化收缩方法,选择性削弱不稳定耦合。模拟与实证结果显示,不同波动率 regime 下最优收缩策略不同,但所提 BDS 方法整体降低样本外方差和换手率。

Revisit escape path for infinite unit strip forest and unit broadworm Figure 1
2026-07-22math.OC

Revisit escape path for infinite unit strip forest and unit broadworm

Zhipeng Deng

2026-07-22优化控制

本文重访 Bellman 迷失森林问题中无限单位带与单位 broadworm 的经典逃逸路径,动机是摆脱既有几何推导和离散 TSPN 中大量二进制变量的计算负担。作者将覆盖约束转化为连续区间覆盖与带约束泛函最小化,并可离散为凸优化;结果给出 Zalgaller 路径的解析/优化表述,扩展若干线段情形,并证明闭合单位带逃逸路径的最优解为单位常宽曲线,最小周长为 π。

Large-Signal Stability Analysis of Optimization-Based Secondary Control for Distributed Energy Resources Figure 1
2026-07-22eess.SY

Large-Signal Stability Analysis of Optimization-Based Secondary Control for Distributed Energy Resources

Vivek Khatana, Soham Chakraborty, Murti V. Salapaka

2026-07-22规划控制优化算法

针对分布式能源二次控制中传统下垂控制难以同时恢复频率、调节电压、实现无功功率共享并满足约束的问题,本文分析了带采样优化器的非线性闭环系统,而非局部小信号模型。核心在于把功率流、滤波测量、约束优化更新和插值执行统一建模,给出电压、滤波无功功率和控制输入的可计算不变界,证明正稳态存在、稳态满足电压调节与等标幺无功共享,并建立频率动态的输入到状态实用稳定性。

A National-Scale EV Charging Scheduling Framework: Optimal Detour Routing Under Infrastructure Capacity Constraints Figure 1
2026-07-22math.OC

A National-Scale EV Charging Scheduling Framework: Optimal Detour Routing Under Infrastructure Capacity Constraints

Taner Cokyasar

Department of Engineering Technology and Industrial Distribution, Texas A&M University, College Station, TX, 77843, USA, Transportation and Power Systems Division, Argonne National Laboratory

2026-07-22优化算法

面向长途电动车出行,论文关注现有充电网络在高采用率下是否会因绕行、排队和插头容量限制削弱经济性。其核心是把单车充电规划建成DAG动态规划,并用拥堵惩罚迭代协调多车容量冲突。全国约270万条轨迹、14260座快充站实验显示,128核下约1.3小时可生成可行调度;结论指出可行性主要受站点空间覆盖而非充电功率限制,350kW场景下多数可行路径接近TCO平价。

$\texttt{codesign-mcdp}$: A Python Library for Monotone Co-Design Problems Figure 1
2026-07-22math.OC

$\texttt{codesign-mcdp}$: A Python Library for Monotone Co-Design Problems

Corentin Briat

School of Life Sciences, University of Life Sciences, Muttenz, Switzerland

2026-07-22优化控制

该文面向部件规格相互耦合、需同时权衡功能与资源的单调协同设计问题,动机是让用户在 Python 中直接建模而非切换到 DSL 或外部求解器。核心贡献是将 Censi 的 MCDP 理论工程化为可组合对象,覆盖偏序集、反链、串并联与反馈组合、Kleene 不动点求解,并扩展不确定性、在线学习和时序协同设计。主要结果是给出 codesign-mcdp 0.2.1 的完整 API 与示例手册;其贡献主要是软件实现,理论创新文中明确有限。

ALAS: Additive Learnable Alpha-Stable Kernels for Flexible Bayesian Optimization Figure 1
2026-07-22cs.LG

ALAS: Additive Learnable Alpha-Stable Kernels for Flexible Bayesian Optimization

Weibo Huang, Cheng Hua

2026-07-22优化算法

这篇论文针对贝叶斯优化中核函数平滑性假设固定、难以同时适配多尺度和尖锐变化的问题,提出可学习的 α-stable 谱核 ALAS,并用 ALAS-Sep 按维度学习尾部行为以提升高维鲁棒性。作者将谱尾、Mercer 特征值衰减与信息增益/遗憾界联系起来,实验覆盖合成与真实代理任务,显示 ALAS 适合低中维交互目标,ALAS-Sep 在近似可加高维目标上更稳。

Integro-differential equations in angular stabilization of drone motion by distributed feedback control Figure 1
2026-07-22cs.AI

Integro-differential equations in angular stabilization of drone motion by distributed feedback control

Alexander Domoshnitsky, Oleg Kupervasser, Anatoly Polonsky

2026-07-22规划控制

本文面向无人机在垂直平面内的姿态角稳定问题,动机是传统点式或有限记忆反馈难以利用长期观测信息。核心思路是把带无界记忆的积分型分布式反馈控制建模为积分-微分方程,并在指数核及其线性组合下将稳定性分析转化为有限维常微分方程系统。主要结果是给出指数稳定性的判据与示例,显示更复杂核函数可能扩大可稳定范围,但实际飞行实验与工程增益来源文中未充分说明。

2026-07-21

65 篇
Risk-sensitive exit-time control for stochastic differential equations with path-dependent coefficients Figure 1
2026-07-21math.OC

Risk-sensitive exit-time control for stochastic differential equations with path-dependent coefficients

David Criens, Fabian Fuchs

D. Criens - University of Freiburg, Ernst-Zermelo-Str. 1, 79104 Freiburg, Germany., F. Fuchs - Department of AI, Data and Decision Sciences, Luiss Guido Carli, Viale Romania 32, 00197 Roma, Italy.

2026-07-21规划控制安全鲁棒

本文关注带路径依赖系数的随机微分方程中,控制器如何在小噪声下最大化留在安全域内的风险敏感退出时间,动机来自安全与鲁棒控制分析。核心创新是把路径依赖PDE、凸期望与概率变分方法结合,处理退出时间不连续导致的传统黏性解困难。主要结果证明对数变换值函数在噪声趋零时收敛到带额外漂移控制和二次惩罚的确定性路径依赖最优控制问题,并给出含记忆SDE的可计算示例。

Sharp Asymptotics for Regularized Optimal Transport Figure 1
2026-07-21math.AP

Sharp Asymptotics for Regularized Optimal Transport

Carlos Cardoso-Perelló, Alberto González-Sanz, Marcel Nutz

2026-07-21优化控制

针对最优传输中熵正则易产生全支撑、弱正则数值不稳,而Lp正则更稀疏但小正则极限缺少统一刻画的问题,本文给出EOT与1<p<∞的Lp正则OT尖锐渐近公式。核心做法是把局部最优剖面计算与边缘约束实现分离:由对偶得到高斯或Barenblatt剖面,再用量化构造补成真实耦合;主要结果是在较弱条件下明确一阶或二阶极限常数,并连接p→1时的熵正则情形。

anyakrakusuma: A Python Library for Entropic Schrödinger Bridges on Idealized Geometries Figure 1
2026-07-21cs.MS

anyakrakusuma: A Python Library for Entropic Schrödinger Bridges on Idealized Geometries

Sandy Hardian Susanto Herho, Dasapta Erwin Irawan, Agus Wahyu Jatmiko, Sito Fossy Biosa, Candrasa Surya Dharma, Edi Riawan, Astyka Pamumpuni, Rendy Dwi Kartiko, Rusmawan Suwarman, Deny Juanda Puradimaja

2026-07-21优化控制

针对离散 Schrödinger bridge 缺少可复用、可诊断实现的问题,本文发布 anyakrakusuma,用 log-domain Sinkhorn 求解熵正则最优传输并重建点云插值,同时输出信息论与几何诊断。在四个构造二维案例中,即使 Gibbs 核大量下溢,仍达到 10^-9 边缘残差,并较准确恢复 90 度重定向;但实测点云增益文中未充分说明。

Improved Convergence Rate for Stochastic Multi-Gradient Descent: A Proof Discovered with AI Figure 1
2026-07-21math.OC

Improved Convergence Rate for Stochastic Multi-Gradient Descent: A Proof Discovered with AI

Lisha Chen

University of Rochester

2026-07-21优化算法学习理论

本文针对多目标优化中随机梯度版 MGDA 因非线性最小范数选择带来偏差、导致非凸收敛分析偏慢的问题,重新分析 vanilla SMG。核心洞察是直接利用 Pareto 驻点度量范数的 Lipschitz 连续性,而非 MGDA 方向的 1/2-Hölder 连续性。在无偏且方差有界梯度、常数步长和线性增长 batch 下,输出点的平方经验 PS 度量达到约 O(T^{-1}),优于既有 O(T^{-1/4}) 界。

Feedback Cycles in Exploratory Equilibria Figure 1
2026-07-21math.OC

Feedback Cycles in Exploratory Equilibria

Chen-Hung Wu

2026-07-21优化控制

本文关注时间不一致随机控制中,低温熵正则虽能平滑探索均衡策略,却会放大学到的奖励和动力学误差。核心洞察是这种敏感性由向后 Volterra–抛物型反馈结构决定:无环因果路径只带来 1/τ 的幂级放大,正反馈环则可产生指数增长。论文给出固定温度下均衡分支的可微性与函数值 delta 方法,并用显式扩散和仿射模型刻画从幂律到 1/log n 临界温度及离散化一致性条件。

Long-time behavior and turnpike properties of linear-quadratic graphon mean field control problems Figure 1
2026-07-21math.OC

Long-time behavior and turnpike properties of linear-quadratic graphon mean field control problems

Erhan Bayraktar, Zhongyuan Cao, Jiamin Jian

agents are indexed by labels in [0, 1], and the strength of interaction between two agents is governed, by the value of the kernel G at their respective labels., graphon structure and the associated label-indexed heterogeneous interactions. Our main result

2026-07-21规划控制

本文针对传统均场控制难以刻画非交换、异质网络交互的问题,研究线性二次 graphon 均场控制的长时间行为。核心创新是把有限时域问题与遍历问题统一到 Hilbert 空间上的 Riccati、微分和代数方程系统中,并处理 graphon 诱导算子的可解性。在稳定化与正性条件下,证明遍历解唯一、有限时域系统指数收敛,并得到最优状态—控制对的指数 turnpike 性质及时间平均值函数收敛。

Optimal Market Making in Prediction Markets Figure 1
2026-07-21q-fin.TR

Optimal Market Making in Prediction Markets

Dominik Feil, Max Nendel

University of Konstanz, Department of Mathematics and Statistics, 78457 Konstanz, Germany, University of Waterloo, Department of Statistics and Actuarial Science, Waterloo, ON N2L 3G1, Canada

2026-07-21优化控制

随着预测市场转向限价订单簿并承担二元结算风险,传统做市模型难以直接适用。本文将价格建模为由潜在信念扩散变换得到的条件概率,构造随机控制问题并求解相应 HJB 方程,刻画唯一最优买卖报价;数值实验显示,策略会随库存、信念、到期时间和风险厌恶调整,相比短视基准可显著降低下行风险,同时仅牺牲少量期望收益。

A Curvature-Aware Rank-Adaptive Distributed Augmented-Lagrangian Solver for Large-Scale SDPs Figure 1
2026-07-21math.OC

A Curvature-Aware Rank-Adaptive Distributed Augmented-Lagrangian Solver for Large-Scale SDPs

Hongpei Li, Huikang Liu, Dongdong Ge, Yinyu Ye

Northwestern University, Shanghai Jiao Tong University, Stanford University

2026-07-21优化算法

面向大规模半定规划中内点法内存/分解成本高、低秩 ALM 难以可靠选秩的问题,论文提出 CARDAL:结合秩自适应 Burer–Monteiro、负曲率修正、后验 KKT 证书,并用约束、秩、锥三轴多 GPU 分布式执行。理论上给出接近 Barvinok–Pataki 秩的全局最优性与有限精度保证;实验在 Mittelmann 及机器人、电子结构、Max-Cut 松弛上显示鲁棒性更强,四张 H100 最高约 4 倍加速。

Reflected Schrodinger Bridge Problem over Sub-Riemannian Manifold Figure 1
2026-07-21math.OC

Reflected Schrodinger Bridge Problem over Sub-Riemannian Manifold

Daniel Owusu Adu

2026-07-21优化控制

面向受限空间内欠驱动机器人群体的低能耗概率重分布,论文把反射 Schrödinger 桥推广到次黎曼流形上的退化扩散。核心洞察是普通法向反射可能不属于可控水平分布,因此构造与几何相容的内禀斜反射,并在 Hörmander 与非特征边界条件下证明转移密度光滑正且解唯一,进而给出带非对称边界条件的 PDE-Sinkhorn 求解框架。

Finding Fair Draws for Incomplete Round Robin Tournaments Figure 1
2026-07-21math.OC

Finding Fair Draws for Incomplete Round Robin Tournaments

Sten Wessel, Frits Spieksma

Department of Mathematics and Computer Science, Eindhoven University of Technology, The Netherlands

2026-07-21优化控制

针对不完全循环赛中各队对手强度不同导致排名公平性存疑的问题,论文将公平抽签形式化为对手集合平均强度带宽最小化,并刻画精确公平抽签的复杂性边界:k=2时多种约束下可多项式求解,k=3即NP完全,连通性要求在k=2也NP完全;整数规划实验显示最小带宽显著低于随机抽签且连通性损失较小。

Thermal management optimization of Battery Electric Vehicles via hierarchical NMPC with CMO-trained Neural Models Figure 1
2026-07-21math.OC

Thermal management optimization of Battery Electric Vehicles via hierarchical NMPC with CMO-trained Neural Models

Francesco Ripa, Diego Regruto, Pasquale Ceres, Christopher Strano

a F. Ripa and D. Regruto are with Department of Control and Computer Engineering, Politecnico di Torino, Italy, b P. Ceres and C. Strano are with Fiat Research Center (CRF), Stellantis N.V., Turin, Italy

2026-07-21规划控制优化算法

这篇论文针对电动车在冷热环境下因座舱空调和电池热管理耗能导致续航下降的问题,提出双层层级 NMPC:上层用速度预测做长时域执行器轨迹优化,下层做扰动修正与温度跟踪,并将 CMO 训练的紧凑 RNN 作为预测模型嵌入两层控制。基于 Stellantis 高保真仿真和 WLTC 工况,相比工业规则控制在冷热条件下节能超过 12%,且满足座舱舒适、电池温度和执行器约束。

Geometric Projection Particle Filtering under Model Uncertainty Figure 1
2026-07-21math.DS

Geometric Projection Particle Filtering under Model Uncertainty

Surya Ratna Prakash D, Soumyendu Raha

Computational and Data Sciences, Indian Institute of Science, Bengaluru.

2026-07-21安全鲁棒

本文针对航天器/自主导航中模型失配导致粒子滤波权重退化和估计不一致的问题,提出几何投影粒子滤波:在传播阶段将名义漂移投影到由观测雅可比定义的测量一致子空间,并用变换测度保持贝叶斯后验一致。论文还引入几何共态量刻画失配;月面下降实验显示在部分可观测和持续失配下有效样本数更稳定、误差有界,精度最高约提升一个数量级。

Limiting Stationarity of Regularized Gap-Function Reformulations for Bilevel Optimization with Unbounded Multipliers Figure 1
2026-07-21math.OC

Limiting Stationarity of Regularized Gap-Function Reformulations for Bilevel Optimization with Unbounded Multipliers

Xiaoning Bai, Shangzhi Zeng, Jin Zhang

2026-07-21优化算法学习理论

针对双层优化中值函数/正则化间隙函数约束退化导致乘子可能无界、传统有界乘子收敛分析失效的问题,本文证明标准正则化间隙重构的近似稳定点极限仍可达到 MPCC 的 C-稳定性,并指出其一般不能保证 M-稳定性;为此提出保持乘子-松弛互补的双参数松弛罚形式和 iG-BSPM 方法,在参数支配与约束资格条件下获得 M-稳定性收敛结论。

Decision-Centric Large Deviations for Data-Driven Capital Buffers in Ruin Models Figure 1
2026-07-21math.ST

Decision-Centric Large Deviations for Data-Driven Capital Buffers in Ruin Models

Yf Henkes, Bart P.G. van Parys, Bert Zwart

Eindhoven University of Technology, Eindhoven, The Netherlands

2026-07-21优化控制

本文针对未知风险分布下按数据设定保险资本缓冲的问题,指出当容忍破产概率与样本量同指数尺度变化时,直接 plug-in 估计调整系数会低估联合破产风险。核心洞察是把历史样本异常的大偏差代价与未来破产指数共同纳入决策,推导临界剖面 f*,证明其下半连续上界安全、低于该剖面的规则通常不安全,并给出参数与非参数包络模型中的可计算形式。

An Adjoint-Sensitivity Framework for Lost-in-the-Middle Phenomena in Causal Residual Transformers Figure 1
2026-07-21stat.ML

An Adjoint-Sensitivity Framework for Lost-in-the-Middle Phenomena in Causal Residual Transformers

Cheng Huan, Hongwei Yuan

2026-07-21优化控制

本文关注长上下文模型对开头和结尾更敏感、对中间信息利用不足的现象,尝试从因果残差 Transformer 的连续深度训练动力学解释其来源。核心创新是用伴随敏感性和 Volterra 因果注意力构造位置影响密度,并把影响分解为残差传递、非局部因果放大和局部通道。主要结果表明,离散层可收敛到连续深度流,影响密度沿全批量梯度流有精确演化式;但 U 形 Lost-in-the-Middle 只在额外能量、相关性和局部通道条件下成立,并非因果掩码或残差路径必然导致。

Monotonicity and Frank-Wolfe Dynamics in Atomic Splittable Congestion Games Figure 1
2026-07-21math.OC

Monotonicity and Frank-Wolfe Dynamics in Atomic Splittable Congestion Games

Tobias Harks

2026-07-21优化控制

针对原子可分拥塞博弈中势函数通常不可用、学习动态收敛条件不清的问题,论文从变分不等式单调性入手,给出由成本函数一、二阶导数和玩家数决定的曲率不等式,刻画保证任意博弈单调、严格单调和强单调的最大成本类;并证明同一条件也刻画欧氏正则 Frank-Wolfe 动态的局部与全局稳定性,在单纯形上还得到内点均衡的局部指数稳定。

PoLoRA: A Preconditioned Orthogonalized LoRA Optimizer Figure 1
2026-07-21cs.LG

PoLoRA: A Preconditioned Orthogonalized LoRA Optimizer

Nikhil Ghosh, Tetiana Parshakova, Robert M. Gower

Center for Computational Mathematics, Flatiron Institute

2026-07-21优化控制

这篇论文针对 LoRA 微调中 Adam 忽略低秩因子乘积结构、Muon 逐因子更新也不稳定优于 Adam 的问题,提出 PoLoRA:把约束施加在合并更新 BA 上,并结合按样本损失变化导出的曲率预条件与因子/合并更新幅度控制。实验在 1B–8B 代码和数学指令微调上显示,其达到调优 Adam 最终验证损失所需步数减少约 1.2–1.7 倍,单步开销不超过 3%,且学习率对 rank 更稳定。

Optimizing the Preconditioner: A Black-box Online-to-Nonconvex Conversion with Static Regret Minimization Oracles Figure 1
2026-07-21cs.LG

Optimizing the Preconditioner: A Black-box Online-to-Nonconvex Conversion with Static Regret Minimization Oracles

Haichen Hu, David Simchi-Levi

Center for Computational Science and Engineering, MIT, Department of Civil and Environmental Engineering, MIT, Institute for Data, Systems, and Society, MIT

2026-07-21优化算法学习理论

本文针对随机非凸优化能否黑箱归约到普通在线凸优化静态遗憾这一问题,提出将梯度预测与预条件矩阵选择分离的框架:在线学习器只选择预条件器并承受线性损失。结果表明,具备平方根静态遗憾的任意 OCO 算法即可在光滑情形恢复 O(1/√T) 收敛率,并在非光滑 Lipschitz 情形达到 Goldstein 驻点的最优 O(T^-2/7) 速率。

Concentration and Mean-Square Bounds for Contractive Stochastic Approximation: A Unified Elementary Approach Figure 1
2026-07-21cs.LG

Concentration and Mean-Square Bounds for Contractive Stochastic Approximation: A Unified Elementary Approach

Siddharth Chandak

2026-07-21学习理论

针对强化学习等场景中随机逼近常遇到的任意范数收缩、乘性噪声和迭代无界问题,论文用平均噪声与辅助迭代直接建立范数误差漂移,并以期望归纳和“好事件”概率归纳控制噪声。结果给出均方误差 O(1/k) 界,并获得乘性噪声下首个全时间次高斯尾高概率集中界。

Consumption and Investment in Incomplete Markets with Epstein-Zin Preferences in Infinite Horizon Figure 1
2026-07-21math.OC

Consumption and Investment in Incomplete Markets with Epstein-Zin Preferences in Infinite Horizon

Ho Man Tai

School of Mathematics and Statistics, The University of Sydney, Sydney, Australia

2026-07-21优化控制

本文针对无限期不完全市场中 Epstein-Zin 偏好下消费与投资问题难以锚定递归效用、且风险厌恶与跨期替代需分离建模的动机,建立了参数条件下控制问题的适定性。核心做法是通过带精心边界条件的有界域 HJB 方程解序列来刻画极限解与最优策略,并覆盖不同参数区间。主要结果包括最优消费和组合策略的验证、若干情形下的显式解,以及三类市场模型的数值实验支持。

CADMM-Prox: A Bi-level Consensus ADMM for Non-smooth Non-convex Distributed Consensus Optimization Figure 1
2026-07-21math.OC

CADMM-Prox: A Bi-level Consensus ADMM for Non-smooth Non-convex Distributed Consensus Optimization

Xu Du, Shuting Wu, Karl H. Johansson, Apostolos I. Rikos

2026-07-21优化算法

非光滑、非凸的分布式共识优化在机器学习、控制和信号处理中常见,但现有 ADMM 往往需凸性、光滑性或串行更新。本文提出 CADMM-Prox,用外层近端项构造凸替代问题,内层保留共识 ADMM 并支持 Jacobi 并行更新;在局部函数半凸等条件下证明全局收敛到广义驻点邻域,并在相位恢复实验中表现出更稳定的收敛。

Supply Chain Networks Figure 1
2026-07-21math.OC

Supply Chain Networks

Elioth Sanabria

Department of Decision and Technology Analytics, Lehigh University - College of Business

2026-07-21优化控制

本文针对复杂供应链中局部需求与产能冲击如何放大为系统性风险的问题,提出将 Newsvendor 库存决策嵌入随机流体网络的框架,并把牛鞭效应解释为路由拓扑的内生不变量,而非仅由信息滞后导致。动态部分引入 Skorokhod 反射、价格弹性和贸易重平衡;油贸实验显示霍尔木兹海峡冲击会造成日本、韩国等严重断供,并在内生市场反馈下改变欧美与主权库存耗尽路径。

From a Scalar to a Matrix Setting for the Dai--Liao Parameter Figure 1
2026-07-21math.OC

From a Scalar to a Matrix Setting for the Dai--Liao Parameter

Saman Babaie--Kafaki, Morteza Kimiaei, Zohre Aminifard

2026-07-21优化控制

针对 Dai–Liao 共轭梯度法性能高度依赖参数选择的问题,论文先用均值不等式解释既有标量自适应参数为何能改善搜索方向矩阵的奇异值分布,再将参数推广为秩一矩阵形式,得到 Matrix Dai–Liao 框架。该设置保留低存储和少量内积计算,并包含一个三项共轭梯度方向;在 482 个 CUTEst 无约束问题上,MatDL 两种参数变体分别表现出效率和鲁棒性优势。

Solving Highly Constrained Multi-Objective Decision Problems with the IMAP-IGS Preference-Guided Metaheuristic Framework Figure 1
2026-07-21math.OC

Solving Highly Constrained Multi-Objective Decision Problems with the IMAP-IGS Preference-Guided Metaheuristic Framework

L.J.K. Timp, N. Yorke-Smith, A.R.M Wolfert

Delft University of Technology

2026-07-21优化控制

论文针对强约束、多目标且多方偏好冲突的决策问题,指出传统 Pareto 搜索或标量化常把约束处理、搜索与最终偏好选择割裂。其核心是把 IMAP 偏好聚合直接嵌入进化算法适应度,并加入约束违背伪偏好和当前最优重插入机制。实验在 DAS-CMOP、带时间窗车辆路径和海上船舶调度上显示,偏好冲突时优于加权和 BRKGA 与 Pareto 型 CMOEA,偏好一致时优势明显减弱。

Norm Minimisation Problems Involving Distances to Convex Sets Figure 1
2026-07-21math.OC

Norm Minimisation Problems Involving Distances to Convex Sets

Doan Huu Hieu, Nguyen Duy Cuong

2026-07-21优化算法

这篇论文的动机是把广义费马-托里拆利问题、切比雪夫中心问题等以往分开处理的距离凸集优化问题纳入同一范数最小化框架。核心洞察是用乘积空间范数统一“求和、取最大、p范数”等目标,并在对偶空间刻画最优性。主要结果包括解集存在性与紧性条件、充要对偶最优性条件,以及由某个最优解处的对偶向量显式构造整个解集。

Uniform Exponential Stability Analysis of Impulsive Linear Time-Invariant Systems on Banach and Hilbert Spaces: Non-Coercive and Coercive Stability Conditions Figure 1
2026-07-21math.OC

Uniform Exponential Stability Analysis of Impulsive Linear Time-Invariant Systems on Banach and Hilbert Spaces: Non-Coercive and Coercive Stability Conditions

Corentin Briat, Francesco Ferrante, Christophe Prieur

Department of Engineering, University of, GIPSA-lab, Grenoble, France

2026-07-21优化控制

针对无穷维脉冲系统中时间触发跳变使传播子失去半群结构、且稳定系统未必存在强制二次Lyapunov泛函的问题,论文建立了Banach/Hilbert空间上的一致指数稳定判据。核心是脉冲版Datko引理,将积分-求和有界性转化为含连续流和离散跳变衰减的混合指数界,并给出固定、任意及多类驻留时间下非强制与强制Lyapunov充要条件,可化为算子方程、不等式或凸规划检验,且覆盖切换系统和采样时滞控制示例。

A Principal-Agent Mean-Field Game Model of Insurance with Risk Interdependence Figure 1
2026-07-21math.OC

A Principal-Agent Mean-Field Game Model of Insurance with Risk Interdependence

Asaf Cohen, Ruolan He, Mingyan Liu

Department of Mathematics, University of Michigan, Ann Arbor, MI 48109, Department of Engineering, University of Michigan, Ann Arbor, MI 48109

2026-07-21安全鲁棒

本文面向网络保险中个体防护会影响群体风险、且投保与努力不可直接控制的合同设计问题,引入异质主体的均值场博弈来替代高维多智能体博弈,并把下层参与/努力均衡嵌入保险人的 Stackelberg 优化。主要结果包括证明均值场纳什均衡存在、在小相互依赖条件下唯一,给出多重均衡下的 ε 最优合同与唯一情形下的精确均衡,并数值显示多合同菜单可提升保险人收益。

On the suitability of ratio variables in data envelopment analysis: An application to education with methodological extensions Figure 1
2026-07-21stat.ME

On the suitability of ratio variables in data envelopment analysis: An application to education with methodological extensions

Vicente J. Bolós, Víctor J. España, Rafael Benítez, Vicente Coll-Serrano

Dept. Business Mathematics, University of Valencia, Dept. Applied Economics, University of Valencia, Avda. Naranjos s/n, Valencia, 46022, Spain.

2026-07-21优化控制

论文针对DEA中平均数、比例等比率变量会破坏传统凸性假设的问题,证明在所有变量共享同一分母时,含比率变量的VRS模型可等价转化为体量变量下的CRS模型。基于该洞察,作者构建PISA/OECD教育效率评估框架,引入ESCS作为投入,并结合方向距离、ACES、机会约束与模糊DEA给出更合理的目标与稳健性分析。

Asymptotic strong Feller and weak observability inequality Figure 1
2026-07-21math.PR

Asymptotic strong Feller and weak observability inequality

Ziyu Liu, Shengquan Xiang

School of Mathematics and Physics, University of Science and Technology Beijing, 100083, Beijing, China., School of Mathematical Sciences, Peking University, 100871, Beijing, China.

2026-07-21优化控制

针对退化或空间局部噪声驱动的 SPDE 中强 Feller 性难以验证的问题,本文把随机平滑转化为确定性控制问题,证明线性情形下渐近强 Feller 正则化、弱可观测不等式与近似零可控等价,并将判据推广到半线性方程;应用于 Oseen、非自治抛物方程和抛物 Sine-Gordon 方程,得到局部有限维白噪声下的渐近正则化结果。

A Parallel Evolutionary Algorithm Framework for Graph $k$-CUT Problems Figure 1
2026-07-21math.OC

A Parallel Evolutionary Algorithm Framework for Graph $k$-CUT Problems

Sihong Shao, Chuan Yang

∗CAPT, LMAM and School of Mathematical Sciences, Peking University, Beijing 100871, China. Email:, †School of Mathematics and Statistics, Fuzhou University, Fuzhou 350108, China, and School of Mathe-

2026-07-21优化控制

许多图 k-CUT 变体目标函数相近却常被分别设计算法,迁移性有限。本文将相关问题按最大化/最小化及平衡结构归入 MaxGCP 与 MinGCP,提出统一并行进化框架 PEAF,结合结构继承交叉、分层变异与多样性选择。在 G-set、k=2–5 上,PEAF-ACMH 在九类代表问题上优于 Gurobi,并改进若干 Max-k-Cut 最优已知解,同时揭示不同割模型的平衡性差异与结构相似性。

Dynamic Pricing for a Two-Sided Data Market Platform Figure 1
2026-07-21math.OC

Dynamic Pricing for a Two-Sided Data Market Platform

Lijun Bo, Dongfang Yang, Yijie Huang

University, Kowloon, Hong Kong, China

2026-07-21优化控制

本文针对数据平台同时向隐私敏感供给方收购原始数据、向消费者销售数据产品时的连续时间定价问题,动机在于数据可复制、会贬值且价值随库存反馈变化。核心创新是把供需到达率设为依赖数据存量的点过程,将采购价与售价纳入跳扩散随机控制框架。主要结果是推导非线性积分微分 HJB 方程,证明值函数的黏性解唯一性和适当条件下的经典正则性,并用数值实验揭示倒 U 型价值函数、最优数据库存和供需侧溢出效应。

Grid-Interactive Operation of Solar-Integrated Data Centers for Coordinated Local and System-Level Decarbonization Figure 1
2026-07-21math.OC

Grid-Interactive Operation of Solar-Integrated Data Centers for Coordinated Local and System-Level Decarbonization

Mingxu Yang, Weiqi Zhang, Hui Geng, Jiaze Ma

2026-07-21优化控制

针对 AI 数据中心负荷快速增长、企业倾向配置场内光伏却可能削弱电网互动能力的问题,本文构建滚动时域优化框架,联合调度作业执行、购售电、储能与光伏利用。核心洞察是场内光伏并非单纯减碳:它能降低设施侧购电成本和总排放、提高自给率,但因与电网低碳电力时段重合,会减少数据中心吸纳低价低碳电的灵活性,暴露企业 ESG 目标与系统级脱碳之间的冲突。

Optimal Combinatorial Testing with Constraints: The Balancing Act Figure 1
2026-07-21math.OC

Optimal Combinatorial Testing with Constraints: The Balancing Act

Thiago Serra, Changkun Guan, Hunter Gehman, Sumit Dhar, Mikey Ferguson, John Hooker, Marcel Schoppers

2026-07-21优化算法

这篇论文面向带约束的组合交互测试:在二元参数中,用尽量少的测试覆盖所有可行的两两取值,以避免全配置测试爆炸。核心洞察是重新审视无约束最优覆盖阵中的列平衡性,并说明禁用某些两两组合后,平衡结构会如何被打破或仍可利用。作者给出基于整数规划的首个精确算法和更快启发式;实验显示其常能得到最优解,并相对基线具有竞争力或更优。

Faithful Decoding Figure 1
2026-07-21econ.GN

Faithful Decoding

Nisha Peng, John Stachurski, Jingni Yang, Ziyue Yang

Research School of Economics, Australian National University, School of Economics, University of Sydney

2026-07-21优化控制

本文针对高维经济均衡与优化系统计算成本高、传统降维会损失信息的问题,提出编码器-解码器式的强半共轭框架:先在低维系统中求解,再精确解码回原系统。核心结果是给出固定点一一对应、收敛与稳定性可转移的条件,并在实物期权、资产定价等例子中展示适用性,其中实物期权问题报告最高约 7 万倍加速,但适用范围相对依赖问题结构。

Robust Chance-Constrained Optimization using a Continuous Parameter Space Wasserstein-2 Ambiguity Set of Gaussian Mixtures Figure 1
2026-07-21math.OC

Robust Chance-Constrained Optimization using a Continuous Parameter Space Wasserstein-2 Ambiguity Set of Gaussian Mixtures

Shibshankar Dey, Sanjay Mehrotra

2026-07-21优化算法三维安全鲁棒

本文针对多峰、非高斯不确定性下服务水平约束难以稳健满足的问题,提出连续参数空间的高斯混合 Wasserstein-2 模糊集,将有限支撑鲁棒化推广为可内生选择均值、协方差与混合质量的 CDR,并给出强对偶、半无限重构及自适应切割算法。EV 充电站能量分配实验中,FDR 未达任一目标概率,而 CDR 在较高成本和小时级运行时间下显著提高样本外满足率。

ADMM-Based Safety-Critical Distributed NMPC for Cooperative Transportation by Quadrupedal Robots Figure 1
2026-07-21cs.RO

ADMM-Based Safety-Critical Distributed NMPC for Cooperative Transportation by Quadrupedal Robots

Ruturaj S. Sambhus, Kapi Ketan Mehta, Yicheng Zeng, Kaveh Akbari Hamed

2026-07-21机器人规划控制安全鲁棒

面向多足机器人共同搬运刚性载荷时的强耦合、避障与实时求解难题,本文将集中式安全关键 NMPC 分解为 ADMM 协调的局部子问题,同时对载荷状态和交互力一致性建模,并显式加入加速度级完整约束与 HOCBF 安全约束。仿真覆盖 2–4 台机器人,实机覆盖 2–3 台 Unitree 机器人;相比集中式 NMPC,三、四机器人场景平均 NLP 求解时间约降 9% 和 23%,载荷跟踪接近,且在扰动、载荷不确定和通信延迟下保持可用。

Real-World, Large Scale, Multi-Period Log Truck Routing and Scheduling : Application to Canadian Forestry Figure 1
2026-07-21math.OC

Real-World, Large Scale, Multi-Period Log Truck Routing and Scheduling : Application to Canadian Forestry

Abdelhakim Abdellaoui, Issmail El Hallaoui, Loubna Benabbou, François Aubé, Mouloud Amazouz

Department of Mathematics and Industrial Engineering, Polytechnique Montr´eal, succ. Centre-ville,Montr´eal, Qu´ebec, H3C 3A7, Canada, Department of Management Science, Universit´e du Qu´ebec `a Rimouski (UQAR), Levis, QC G6V 0A6, Qu´ebec, Canada, the forestry operations literature, namely the absence of an exact and scalable formulation of the forestry vehicle routing

2026-07-21强化学习

针对加拿大林业中原木运输成本高、路网季节性受限且调度仍偏人工分散的问题,本文将真实业务规则转化为时间-空间路由网络,提出覆盖装卸排队、车辆基地、产品匹配等约束的多周期 MILP,并用 Relax&Fix 与 Fix&Optimize 分解求解。基于企业历史数据,方法在可接受时间内得到近最优方案,报告了运输成本下降和温室气体排放减少,但具体增益来源不清。

Relative Entropy-Bounded Ambiguous Chance Constraints for Robust Planning in Nonlinear Systems Figure 1
2026-07-21math.OC

Relative Entropy-Bounded Ambiguous Chance Constraints for Robust Planning in Nonlinear Systems

Trevor N. Wolf, Jay W. McMahon

2026-07-21规划控制优化算法学习理论安全鲁棒

针对非线性系统中真实状态分布未知且常偏离高斯的问题,论文把机会约束风险建模为相对熵有界的分布鲁棒问题,用Donsker-Varadhan变分形式给出未知分布下的风险上界,并提出由参考协方差演化和二阶动力学截断误差确定KL半径的方法;该上界在零散度时退化为名义高斯风险,航天器随机制导算例展示了其可用于非线性协方差转向的鲁棒规划。

Structural Vibration Control of Offshore Wind Turbines Using Tuned Mass Damper Inerter in OpenFAST: Implementation, Validation, and Illustration Figure 1
2026-07-21math.OC

Structural Vibration Control of Offshore Wind Turbines Using Tuned Mass Damper Inerter in OpenFAST: Implementation, Validation, and Illustration

Hisham Tariq, Yuan Li, Flavia De Luca, Agathoklis Giaralis

Department of Civil and Environmental Engineering, Khalifa University, Abu Dhabi, United Arab Emirates, School of Electrical, Electronic and Mechanical Engineering, University of Bristol, Bristol, United Kingdom, School of Civil, Aerospace and Design Engineering, University of Bristol, Bristol, United Kingdom

2026-07-21规划控制

面向大型海上风机更柔、更易受风浪耦合振动影响且传统TMD质量和行程代价高的问题,论文将多方向TMDI方程接入OpenFAST结构控制模块,支持塔架、叶片和下部结构的任意连接并用独立模型验证。IEA-15MW算例显示,在正常发电和极端停机载荷下,TMDI以比常规TMD小至约100倍的附加质量达到相当或更好的塔顶位移、加速度抑制,并显著降低行程。

Optimal Scheduling for Remote State Estimation over Hybrid Channels Figure 1
2026-07-21math.OC

Optimal Scheduling for Remote State Estimation over Hybrid Channels

Manali Dutta, Rahul Singh, Shalabh Bhatnagar

and Shalabh Bhatnagar, Manali Dutta and Shalabh Bhatnagar are with the Department of Computer Science, and Automation, Indian Institute of Science, Bangalore 560012

2026-07-21优化控制

面向网络化控制中传感器需在低时延但易丢包链路与高可靠但有固定延迟链路间取舍的问题,论文将突发丢包建模为 Gilbert-Elliott 信道,并把调度表述为连续状态、无界代价的平均成本 MDP。核心结果是证明最优平稳策略存在,且关于估计误差呈依赖信道状态的阈值结构;在参数未知时,利用该结构的 actor-critic 算法在数值实验中接近 RVI 求得的最优策略。

Robust Control for Marked Point Processes under Transition-Rate Uncertainty Figure 1
2026-07-21math.OC

Robust Control for Marked Point Processes under Transition-Rate Uncertainty

Sascha Desmettre, Philipp C. Hornung

Institute of Financial Mathematics and Applied Number Theory, Johannes Kepler University Linz, Altenbergerstr. 69, 4040, Linz, Austira, Department of Mathematical Sciences, University of Copenhagen, Universitetsparken 5, DK-2100 Copenhagen, Denmark

2026-07-21规划控制安全鲁棒

本文针对寿险与健康险多状态模型中转移率由有限、异质数据估计而带来的模型不确定性,扩展到非马尔可夫标记点过程框架。核心创新是用路径依赖的上下界刻画可容许转移率,建立 max-min 鲁棒效用控制、鞅最优性原则,并证明一类非标准最坏情形 BSDE 的存在唯一性。主要结果包括最优/最坏准备金刻画,以及幂效用消费-保险问题的显式反馈解。

Certified-Gap Dual-Price Policies for Real-Time Truckload Bid Acceptance with Relocating, Clock-Constrained Resources Figure 1
2026-07-21cs.LG

Certified-Gap Dual-Price Policies for Real-Time Truckload Bid Acceptance with Relocating, Clock-Constrained Resources

Aswin Chandrasekaran

2026-07-21优化控制

论文针对整车运输中秒级接单决策难以同时兼顾车辆位置、司机工时和最优性证明的问题,将其建模为带重定位与时钟约束的弱耦合动态规划,并用同一拉格朗日松弛同时生成实时双价格策略和实例级最优性缺口证书。结果显示该策略无需 rollout 标签,在 FreightBidBench 上两类场景优于 rollout 训练 surrogate、一类持平,决策延迟仅 0.04–0.09 毫秒,但证书仍受松弛缺口限制。

Entropic optimal transport need not select a zero-temperature limit Figure 1
2026-07-21math.OC

Entropic optimal transport need not select a zero-temperature limit

Maja Gwozdz

2026-07-21优化控制

本文针对熵正则最优传输在温度趋零时是否必然选出唯一极限的问题,给出反例而非收敛证明。核心洞察是固定边缘约束下的 Schrödinger 投影可随尺度交替振荡,使正温度极小解只在最优面内形成连续聚点集。主要结果包括一般情形下聚点集非空、紧且连通,并构造紧致、无原子、Lipschitz 代价下不收敛的模型。

A Deep Reinforcement Learning Algorithm for the Vehicle Routing Problem with Stochastic Demands and Outsourcing Figure 1
2026-07-21math.OC

A Deep Reinforcement Learning Algorithm for the Vehicle Routing Problem with Stochastic Demands and Outsourcing

Mohsen Dastpak, Fausto Errico, Ola Jabali

2026-07-21强化学习

面向次日配送中需求不确定、需尽早决定自营或外包客户的场景,论文提出VRP-SDO并用两层框架分离外包划分与动态路径成本评估;核心是用离线训练的DQN结合GAT表示车辆和客户关系,快速近似不同承诺客户集合的随机路径成本,并在搜索中微调。实验称VRP-SD路径成本较强基线降19.6%,整体方案较无GAT版本平均节省13.7%,且分钟级给出决策。

Treasure Search Optimization Figure 1
2026-07-21math.OC

Treasure Search Optimization

A. Sharma

2026-07-21优化算法

针对非凸全局优化中群体方法难以在探索与开发间取舍的问题,论文提出 TSO:让探索者群体持续扩散搜索,单个猎手依据目标加权共识进行开发并通过跳跃触发群体重心更新。作者将其建模为含公共噪声的条件 McKean-Vlasov 跳扩散 SDE,证明适定性与稳态接近全局最小值的 1/α 误差,并在 ODE 约束优化和低维贝叶斯逆问题上给出数值验证。

Ideal Gårding polynomials Figure 1
2026-07-21math.CO

Ideal Gårding polynomials

Hao Fang, Biao Ma

Department of Mathematics, University of Iowa, Iowa City, IA 52246, School of Mathematical Sciences, East China Normal University, 500

2026-07-21优化控制

本文针对一般 Gårding 多项式虽能刻画椭圆性却不保证 Gårding 分支凸性的缺口,定义在偏导下递归保持凸性的 ideal Gårding 多项式。核心洞察是把该类放在稳定多项式与 Gårding 多项式之间,并通过单变量根序列、Pitman-Stanley 多胞形体积模型建立商凹性与 Newton-Maclaurin 型不等式。主要结果给出极化、正仿射拉回、对数凹性和局部齐次化为 Lorentzian 的等价结构刻画,并发展闭包性质与线性保持子理论。

Sub-Finslerian Interpolation Inequalities Figure 1
2026-07-21math.DG

Sub-Finslerian Interpolation Inequalities

Haowei Lin

Graduate School of Science, the University of Osaka, Osaka 560-0043, Japan

2026-07-21优化控制

本文针对次芬斯勒几何中经典曲率维数条件和标准 Brunn-Minkowski 型系数失效的问题,研究如何在存在非完整光滑结构和距离非对称性的情形下建立可用的最优传输不等式。核心做法是限制到 forward ideal 次芬斯勒流形,引入次芬斯勒 Jacobi 场、相应 Jacobian 估计与广义前后失真系数,并扩展 Brenier-McCann 型最优传输框架。主要结果是证明插值不等式,进而推出 Borell-Brascamp-Lieb、Brunn-Minkowski 等几何不等式,并在 Randers 次芬斯勒 Heisenberg 群上验证测度收缩性质。

Identity-Paired Progressive Depth Training: When Trainability Persists Beyond Expressibility Figure 1
2026-07-21quant-ph

Identity-Paired Progressive Depth Training: When Trainability Persists Beyond Expressibility

Athanasios Hadjidimoulas, Tirthak Patel, Anastasios Kyrillidis

Computer Science, Rice University, QuanTAS research cluster, Ken Kennedy Institute at Rice University

2026-07-21优化控制

这篇论文针对变分量子算法逐层加深训练中固定 CNOT 层带来的初始化冲击,提出 IP-PDT:每次扩展加入正反成对的旋转与纠缠块,使新增 CNOT 在初始化时精确抵消。核心洞察是可达集合在早期即饱和,后续深度主要提供单量子比特过参数化,但仍能改善可训练性。实验在多类 Ising 哈密顿量和最高 16 比特设置中显示,其在有限预算下常优于全深度和朴素 PDT,并降低门成本。

Benchmarking Optimization Algorithms with Quality Profiles and Test Set Profiles Figure 1
2026-07-21math.OC

Benchmarking Optimization Algorithms with Quality Profiles and Test Set Profiles

G. Fasano, C. Piermarini, M. Roma

2026-07-21优化算法数据集/基准

针对优化算法基准常偏重运行时间、难以处理求解器收敛到不同解且测试集适配性少被评估的问题,本文提出质量画像和测试集画像:前者以目标函数值比较解的精度,后者衡量测试集一致性。数值实验覆盖光滑与非光滑/无导数优化,并给出 MATLAB 绘图代码,显示这些画像可补充性能画像与数据画像,尤其适用于同时比较精确方法和启发式方法。

Tight Conic Relaxations for Rank-one Doubly Nonnegative Matrix Completion Figure 1
2026-07-21math.OC

Tight Conic Relaxations for Rank-one Doubly Nonnegative Matrix Completion

Godai Azura, Sunyoung Kim, Makoto Yamashita

Department, Institute, Department of Industrial and Systems Engineering, Aoyama Gakuin University, 5-10-1 Fuchinobe, Department of Mathematics, Ewha W. University, 52 Ewhayeodae-gil, Sudaemoon-gu, Seoul 03760, order, which limits their practical scalability.

2026-07-21优化控制

针对稀疏 QCQP 的锥松弛中提升矩阵存在未指定元素、紧性难以判定的问题,本文把 rank-one DNN 矩阵补全视为图结构补全问题。核心洞察是用稀疏模式的二部图刻画何时可补成非负秩一矩阵,并在由环和边组成的模式下证明 DNN 与 CP 对偶松弛等价;对环型模式给出局部比值界和累积差条件,说明 SDP/DNN 松弛可精确恢复秩一最优解,且加边可放宽紧性条件。

Dynamical Optimal Transport with $\mathfrak{so}(d)$-Invariance: From Theory to Computation Figure 1
2026-07-21math.OC

Dynamical Optimal Transport with $\mathfrak{so}(d)$-Invariance: From Theory to Computation

Kevine Meugang Toukam, Max von Renesse, Johannes Storn

2026-07-21学习理论

针对经典最优传输对单侧旋转、平移仍计成本的问题,本文把欧氏刚体不变性直接嵌入 Benamou-Brenier 动力学形式,通过投影掉无穷小刚体运动来刻画 Wasserstein 商空间。主要结果包括极小解存在性、与 Procrustes-Wasserstein 静态形式等价、高斯情形闭式公式,以及离散 PDHG/交替算法的局部条件子序列收敛与数值验证。

When Is Heterogeneous Distance-Decay Facility Location Tractable? A Structural Classification, Exact Methods, and a Real-World Study Figure 1
2026-07-21cs.MA

When Is Heterogeneous Distance-Decay Facility Location Tractable? A Structural Classification, Exact Methods, and a Real-World Study

Zhou He, T.C.E. Cheng, Jichang Dong

School of Economics and Management, University of Chinese Academy of Sciences, N606-3, #3 Zhongguancun Nanyitiao, Haidian District, Beijing 100190, China, Department of Logistics and Maritime Studies, The Hong Kong Polytechnic University, 11 Yuk Choi Rd, Hung Hom, Hong Kong, China

2026-07-21强化学习

本文针对连续平面设施选址中需求随距离衰减且衰减尺度异质的现实场景,统一覆盖、k-means 与 Weber 中位问题。核心洞察是给出可解性结构分类:离散目标始终单调次模,连续协作目标当且仅当衰减函数对距离凹时无陷阱,并指出截断覆盖会破坏凹性。实验上,MIP 在 n≤500 时可秒级求最优,力梯度结合大邻域搜索接近离散最优;真实配送数据表明忽略异质性最高损失 9.7% 捕获需求。

A Deep Second-Order Stochastic Residual Method for Fully Nonlinear Parabolic PDEs Figure 1
2026-07-21math.NA

A Deep Second-Order Stochastic Residual Method for Fully Nonlinear Parabolic PDEs

Zhenhua Zhao, Jihao Long

School of Mathematical Sciences, Peking University ()., Corresponding author. Institute for Advanced Algorithms Research, Shanghai

2026-07-21优化控制

高维全非线性抛物 PDE 中 Hessian 反馈使传统网格和半线性 Deep BSDE 难以稳定扩展。本文提出 D2SRM,用单个时空网络同时生成解、梯度和 Hessian,并以二阶布朗一步残差及终端惩罚联合训练;关键在于把学习目标与 Brownian occupation 空间中的 full-jet 误差联系起来。理论上在弱 Hessian 耦合等条件下证明适定性、后验误差界和总体收敛,实验在 100 维构造算例中显示步长减小时误差下降,但泛化、优化误差和定量近似率文中未覆盖。

Laplacian Spectral Shaping for Non-Uniform Scaling Formation Control of Open Multi-Agent Systems Figure 1
2026-07-21cs.MA

Laplacian Spectral Shaping for Non-Uniform Scaling Formation Control of Open Multi-Agent Systems

Tao He, Gangshan Jing

School of Automation, Chongqing University

2026-07-21规划控制

针对开放多智能体编队中节点、边和领导者变化会破坏矩阵值拉普拉斯谱性质的问题,本文把非均匀缩放编队的形状保持转化为“编队谱”维护,提出分布式权重更新协议。其关键在于用2-点连通图替代层级根结构,使任意一对智能体可重选为领导者,并覆盖加入、离开、加边、删边四类拓扑变化。理论分析和数值仿真表明,该方法能在更稀疏感知图上保持收敛所需谱条件。

Dynamic mean-variance portfolio selection with no-shorting constraints and unknown investment opportunity sets Figure 1
2026-07-21math.OC

Dynamic mean-variance portfolio selection with no-shorting constraints and unknown investment opportunity sets

Xun Li, Yutian Wang, Xun Yu Zhou

Department of Applied Mathematics, The Hong Kong Polytechnic University, Department of Industrial Engineering and Operations Research & Data Science Institute, Columbia University, New York, USA, NY 10027.

2026-07-21优化算法

本文针对连续时间均值-方差投资中机会集未知且禁止卖空时,传统模型估计不稳、约束又破坏高斯探索可解析性的矛盾。核心做法是把卖空约束施加在高斯策略的均值而非采样支持上,并构造无熵辅助探索问题;理论上证明适当方差下其最优高斯均值等于原约束问题最优策略,进而给出无需估计机会集的模型无关强化学习算法,并用数值例子验证表现。

End-to-End Supply Chain Planning in the Paper Industry Via Column Generation and Benders Decomposition Figure 1
2026-07-21math.OC

End-to-End Supply Chain Planning in the Paper Industry Via Column Generation and Benders Decomposition

Changkun Guan, Amira Hijazi, Pascal Van Hentenryck

2026-07-21规划控制

论文针对造纸业中生产排程、分切、装车运输与 MTS/MTO 多期履约长期被顺序优化的问题,指出其会放大废料、运输成本和服务损失。核心洞察是下游履约只通过按产品、客户、周期聚合的供给量依赖上游决策,据此结合列生成、动态规划定价与 Benders 分解。58 个工业实例显示,八周问题总成本较 CG-DP 降低 24.4%,四周中位求解时间由五小时以上降至一小时内。

FST.ai 2.5: Explainable and Uncertainty-Aware AI for Olympic and Para-Taekwondo Decision Support, Athlete Digital Twins, and Federation-Scale Analytics Figure 1
2026-07-21cs.AI

FST.ai 2.5: Explainable and Uncertainty-Aware AI for Olympic and Para-Taekwondo Decision Support, Athlete Digital Twins, and Federation-Scale Analytics

Keivan Shariatmadar, Ahmad Osman, Ramin Rey

2026-07-21安全鲁棒

针对跆拳道赛事数据分散、裁判与训练决策存在高不确定性的问题,论文提出 FST.ai 2.5,将运动员/赛事数字孪生、可解释指标、联邦级治理和不确定性感知分析整合到统一生态中。主要结果是展示原型部署和试点基础设施的可行性,但量化效果、对比实验与增益来源文中未充分说明。

Near-Optimal Lower Bounds for Exact Zeroth-Order Convex Optimization Figure 1
2026-07-21math.OC

Near-Optimal Lower Bounds for Exact Zeroth-Order Convex Optimization

Haihan Zhang, Chenheng Zhang, Zhiquan Qi, Zhouchen Lin

\addr School of Intelligence Science and Technology, Peking University, \addr School of Electronics Engineering and Computer Science, Peking University

2026-07-21优化算法学习理论

本文关注零阶凸优化中仅能查询精确函数值时,标量反馈相对梯度反馈是否必然带来维度代价。作者构造随机支撑函数困难族,并用后验均值能量方法处理自适应精确最大值观测,避开噪声型信息论证明。主要结果给出近最优查询下界,刻画了维度 d 与精度 epsilon 的联合依赖,在低精度匹配 d/epsilon^2、高精度饱和到约 d^2,仅差对数因子。

History-Dependent Recursive Preferences in Markov Decision Processes Figure 1
2026-07-21math.OC

History-Dependent Recursive Preferences in Markov Decision Processes

William B. Haskell

2026-07-21优化控制

本文针对物理状态虽满足马尔可夫性、但时间偏好和风险态度依赖完整历史时动态规划维度膨胀的问题,提出由偏好内生诱导的状态压缩框架。核心做法是按行为等价关系商掉不可区分历史,构造最小的偏好增强状态,并在附加条件下分离信念与口味记忆。主要结果给出递归表征、PA/SPA Bellman 递推及由选择器诱导全历史最优策略的验证。

Batteriesandthe BritishEnergy System Figure 1
2026-07-21math.OC

Batteriesandthe BritishEnergy System

Waqquas Bukhsh

2026-07-21优化控制

面对英国高比例风光并网带来的平衡成本上升与灵活性缺口,本文从系统视角梳理电池储能的演进,核心洞察是电动车电池可能成为远超集中式储能的分布式灵活资源,但价值取决于协同调度、市场机制和控制策略。文中给出英国电池已达多吉瓦规模、2050年并网电池或达31至40 GW、电动车潜在容量超过2.5 TWh,同时指出无序充电会制造新的晚高峰风险。

Bernoulli problem for the fractional $p$-Laplacian Figure 1
2026-07-21math.AP

Bernoulli problem for the fractional $p$-Laplacian

Rafael Costa, Diego Marcon

2026-07-21优化控制

本文针对分数阶 p-Laplacian 下的一相 Alt-Caffarelli/Bernoulli 自由边界问题,动机是弥补非线性非局部情形中系统正则性理论不足。核心做法是直接处理非局部尾项,结合 p-调和替换、能量差估计与 Campanato 迭代。主要结果包括极小化子存在性、非负性与弱次解性质、局部 Hölder 连续性、正集内满足齐次方程,并证明自由边界处仍具有线性分数情形的最优 r^s 增长阶。

Smoothed Two-Stage Decomposition Algorithm for Solving Large-Scale Transmission and Distribution AC-OPF Problems Figure 1
2026-07-21math.OC

Smoothed Two-Stage Decomposition Algorithm for Solving Large-Scale Transmission and Distribution AC-OPF Problems

Juan Ospina, Manuel Garcia, Xinyi Luo, Andreas Wachter, David M. Fobes, Russell Bent

2026-07-21优化控制

面向分布式能源大量接入后输配电协同 AC-OPF 规模大、非凸且配电网多相不平衡难以准确建模的问题,论文提出 StsDOpt,将输电主问题与配电子问题分解并并行求解,通过内点法 barrier 问题的平滑性质让子问题响应对主问题可微,避免线性化或凸松弛。实验在 PowerModelsITD 中扩展到约 650k 节点、22 个配电系统,相比集成式 T&D 求解减少墙钟时间并保持解精度。

Scaling Limits of Constant-Stepsize SGD at Flat Minima Figure 1
2026-07-21cs.LG

Scaling Limits of Constant-Stepsize SGD at Flat Minima

Jingyi Zhang, Cheng Mao, Debankur Mukherjee

2026-07-21优化控制

这篇论文针对常步长 SGD 在平坦极小值附近长期不收敛到点解、而是形成稳态误差分布的问题,指出强凸情形的根号步长与高斯极限并不适用。核心洞察是局部平坦指数决定稳态尺度,尾部增长决定控制远离区域的权重;在马尔可夫噪声下,作者证明小步长时不变分布唯一且几何收敛,并给出 alpha^(1/m) 缩放下收敛到非线性扩散稳态分布的结果,平坦情形通常为非高斯极限。

Greedy Minimization of the Number of Late Tasks: Implementation and Analysis Figure 1
2026-07-21cs.DS

Greedy Minimization of the Number of Late Tasks: Implementation and Analysis

Dean Matthew Menezes, C. Gregory Plaxton

University of Texas at Austin

2026-07-21优化控制

本文关注单机截止期调度中如何最大化准时任务数,动机是现有插入式 SJF 贪心虽简单但直接检测可行性代价高。核心创新是用按截止期维护的增强平衡树记录总工作量与最小前缀松弛,使每个候选任务可在最坏 O(log n) 时间插入、根部检测并回滚。结果给出整体 O(n log n) 实现,并证明该贪心具有阈值形式的字典序最优性,进一步揭示等长度任务层的嵌套拟阵、层间直和形成的层状拟阵及流/多拟阵刻画。

Local Maxima of the Entrywise $\ell_4$ Norm on the Orthogonal Group Figure 1
2026-07-21eess.SP

Local Maxima of the Entrywise $\ell_4$ Norm on the Orthogonal Group

Dian Jin

Department of Statistics and Data Science, National University of Singapore

2026-07-21优化控制

本文研究正交约束下按元素四次范数最大化的局部几何,动机是理解非凸矩阵流形上偏好稀疏集中项的优化景观。核心洞察是从平方元素形成的正交随机矩阵选取最大入口,构造显式秩二切向逃逸方向,并精确计算黎曼 Hessian。主要结果证明任意维度中只有带符号置换矩阵是局部及全局极大点,其他驻点均存在严格上升方向。

2026-07-20

24 篇
Optimal control of symmetry-breaking dynamics near criticality Figure 1
2026-07-20math.OC

Optimal control of symmetry-breaking dynamics near criticality

Pearson W. Miller

2026-07-20规划控制

本文受细胞命运选择等临界附近对称破缺过程如何被外部信号引导的动机驱动,研究 pitchfork 分岔附近的最优控制是否也具有普适正规形。核心洞察是将控制强度与离临界距离同步缩放,区分强、中、弱三种 regime;强控制退化为 LQR 近似,中弱控制得到状态-协态耦合的控制振幅方程,并在双稳生化开关模型上数值验证,进一步给出弱控制下的分岔结构和长时边界层渐近解。

Physics-enhanced reinforcement learning for real-time optimal control of dynamical systems Figure 1
2026-07-20cs.LG

Physics-enhanced reinforcement learning for real-time optimal control of dynamical systems

Matteo Tomasetto, Nicolò Botteghi, Gabriele Bruni, Andrea Manzoni

† Department of Mechanical Engineering, Politecnico di Milano, Milano, Italy, ‡ MOX - Department of Mathematics, Politecnico di Milano, Milano, Italy

2026-07-20强化学习规划控制

针对高维动力系统中传统强化学习交互样本多、探索困难且实时控制难以扩展的问题,论文提出 PEARL,将可微物理动力学、短视界自动微分策略梯度与神经网络近似的伴随未来敏感度结合。两个非定常流参数化导航任务显示,该方法较现有 RL 更省样本、性能更好,并能泛化到多场景和高维状态/动作空间。

A Globally Asymptotically Stable Planar Homogeneous Polynomial Vector Field With No Polynomial Lyapunov Function Figure 1
2026-07-20math.DS

A Globally Asymptotically Stable Planar Homogeneous Polynomial Vector Field With No Polynomial Lyapunov Function

Jun Liu, Maxwell Fitzsimmons

Program.Jun Liu and Maxwell Fitzsimmons are with the Department of Applied Mathematics, Faculty of, Mathematics, University of Waterloo, Waterloo, ON N2L 3G1, Canada (e-mail:

2026-07-20优化控制

针对齐次多项式系统稳定性是否总能由多项式 Lyapunov 函数证明这一判定性问题,论文构造了一个二维三次整数系数反例:原点全局渐近稳定,并有显式二次齐次但非多项式的 C1 Lyapunov 函数;同时用单位圆上的正三角多项式与 Fejer-Riesz 分解证明不存在齐次多项式甚至局部解析 Lyapunov 函数,从而否定相关反向猜想。

Pick-to-Learn Calibration of an MPC Policy for an Origin-to-Destination Flight Problem Figure 1
2026-07-20eess.SY

Pick-to-Learn Calibration of an MPC Policy for an Origin-to-Destination Flight Problem

Marco C. Campi, Simone Garatti

2026-07-20强化学习规划控制

本文针对不确定侧风下航迹规划中 MPC 参数难以兼顾效率与约束安全的问题,将 Pick-to-Learn 用作外层校准器,而不是把扰动直接塞入 FHOCP。方法从闭环轨迹违约案例中挑选少量关键场景来调节两个超参数,并用样本压缩理论给出泛化证书。在 400 个风场样本上仅需 2 个场景完成校准,所有样本避开低连接区,未来违约风险以 1-10^-5 置信度界定为不超过 4.8%。

Accelerated Exact Recovery from Noisy Data via Averaging and Noise-Aware Adaptive Bregman-Kaczmarz Figure 1
2026-07-20math.NA

Accelerated Exact Recovery from Noisy Data via Averaging and Noise-Aware Adaptive Bregman-Kaczmarz

Lionel Tondji, Abakar A. Mahamat, Idriss Tondji

2026-07-20优化控制

本文面向带独立零均值新鲜噪声的大规模线性逆问题,解决自适应 Bregman-Kaczmarz 块版本中“批量增大是否真正加速”的疑问。核心洞察是用块平均替代求和,并加入按行噪声水平降权的采样/加权机制,使收敛分析归约到单个半正定矩阵。理论证明批量越大保证收敛越好,最大增益由系统矩阵稳定秩控制,噪声非均匀时优于均匀权重;CT 重建实验支持这些预测。

An Improved Analysis of the Last Iterate of the SubGradient Method in the Plane Figure 1
2026-07-20math.OC

An Improved Analysis of the Last Iterate of the SubGradient Method in the Plane

Guglielmo Beretta, Tommaso Cesari, Roberto Colomboni, Andrea Paudice

Department of Computer Science, Aarhus University, Aarhus, Denmark, School of Electrical Engineering and Computer Science, University of Ottawa, Ottawa, Canada, School of Mathematics, University of Bristol, Bristol, United Kingdom

2026-07-20优化算法

本文针对次梯度法在实践中常返回“最后迭代点”、但现有高维理论存在额外对数损失的问题,研究二维凸 Lipschitz 优化中的固定步长情形。核心洞察是利用平面几何:将轨迹尾段与同一子水平集内的参考线段比较,而非只比较到单个最优点。主要结果证明当步长为 Θ(1/√n) 时,最后迭代点达到 O(1/√n) 优化误差,说明高维中的 log n 损失在二维并非必要。

Gaussian behaviors and stochastic data-driven control Figure 1
2026-07-20eess.SY

Gaussian behaviors and stochastic data-driven control

András Sasfi, Alberto Padoan, Ivan Markovsky, Florian Dörfler

A. Sasfi, and F. Dörfler are with the Department of Information Technology and

2026-07-20规划控制三维

针对确定性行为系统理论难以直接处理随机扰动、现有数据驱动预测控制常需事后鲁棒化的问题,论文提出 Gaussian behaviors,将 LTI 轨迹行为与高斯噪声结合,并用样本协方差条件化得到可识别的预测分布。在此基础上构造前馈与扰动仿射反馈的凸随机控制,以及同时覆盖偶然和有限样本认知不确定性的鲁棒上界;数值案例显示该框架可降低保守性,并解释 DeePC 正则化的乐观不确定性含义。

PriEco-DRL: Joint Optimization of Electric-Bus Eco-Driving and Transit-Priority Adaptive Signals via Deep Reinforcement Learning Figure 1
2026-07-20math.OC

PriEco-DRL: Joint Optimization of Electric-Bus Eco-Driving and Transit-Priority Adaptive Signals via Deep Reinforcement Learning

Dingshan Sun, Ang Li, Chaopeng Tan, Zicheng Su, Wanjing Ma, Marco Rinaldi

2026-07-20强化学习优化算法

面向电动公交在自适应公交优先信号下难以同时兼顾能耗、准点与舒适性的问题,PriEco-DRL将占有率加权的最大压力信号控制与DRL纵向生态驾驶耦合,并用CTDE和参数共享适配多线路局部观测。真实阿姆斯特丹走廊实验显示,其相比固定配时、感应控制和规则式协同可降低能耗且维持网络效率,主要来自减少非计划启停和更平滑调速。

A Numerically-safe Branch-Price-and-Cut Algorithm for the Length-Constrained Cycle Partition Problem Figure 1
2026-07-20math.OC

A Numerically-safe Branch-Price-and-Cut Algorithm for the Length-Constrained Cycle Partition Problem

Mohammed Ghannam, Ambros Gleixner, Gioni Mexi, Edward Lam

Zuse Institute Berlin, Germany, Monash University, Australia

2026-07-20安全鲁棒

本文针对长度约束环划分问题中紧模型松弛弱、对称性强且数值误差会影响最优性证明的瓶颈,改用基于可行环变量的集合划分模型,并设计数值安全的 branch-price-and-cut 框架:动态规划定价结合双向搜索、对称破除、剪枝与割平面管理。实验显示其 LP 界更强,显著快于既有方法,并以数值安全界关闭 14 个未解实例,规模从此前 52 点推进到 76 点。

Two-Thread Coverage MCTS for SAT and XSAT Figure 1
2026-07-20math.OC

Two-Thread Coverage MCTS for SAT and XSAT

Marcel Crasmaru

2026-07-20优化控制

针对 WalkSAT 在结构化或 XOR-heavy SAT/XSAT 公式上易陷入局部搜索的问题,本文把 MCTS 的树式探索与 WalkSAT rollout 结合,并用全真/全假双线程初始化给出到某个满足赋值不超过 n/2 翻转的覆盖保证,同时原生处理 XOR 与多处单元传播。实验显示其快速解出 SATLIB 图着色与部分 planted XOR-SAT,SAT 2025 个例由极性划分直接解决;DES 仅降至 99.9% 子句满足,仍停在平台区。

Global solutions for the sensors placement problem via weakly convex optimization Figure 1
2026-07-20math.OC

Global solutions for the sensors placement problem via weakly convex optimization

Giovanni Bruccola

a Systems Research Institute, Polish Academy of Sciences, Newelska 6, 01-447 Warsaw, Poland, b Space Research Centre, Polish Academy of Sciences, Bartycka 18A, 00-716 Warszawa, Poland

2026-07-20优化算法

本文面向无显式动力学模型时的有限传感器布置,用于从少量测点重建高维信号。核心做法是把非凸组合选址问题重写为弱凸约束投影问题,并用 Inexact/Inverse Cutting Sphere 给出 ε 全局解或最优性证书。NACA 翼型压力重建实验中,该方法相较 QDEIM 通常获得更好或相当的误差与优化指标,但计算成本较高。

Analytical and Reduced-Order Modeling of a Timoshenko Beam with Point Actuation Figure 1
2026-07-20math.OC

Analytical and Reduced-Order Modeling of a Timoshenko Beam with Point Actuation

Alexander Zuyev, Julia Kalosha

Max Planck Institute for Dynamics of Complex Technical Systems, Institute of Applied Mathematics and Mechanics, National Academy of Sciences of Ukraine

2026-07-20优化控制

面向带刚体点执行器的柔性梁在参数辨识与控制中难以直接使用无限维模型的问题,论文从 Timoshenko 梁和梁体界面条件出发,推导完整频域传递函数,并用 Loewner 矩阵插值构造降阶模型。结果通过不同传感-执行组合的 Bode 图及 H2/H∞ 误差比较,显示低阶模型能较好逼近原模型,同时揭示截止频率附近存在纯虚特征值和第二谱支。

Polynomial-Based Solutions to Targeting Problems for Onboard Applications Figure 1
2026-07-20math.OC

Polynomial-Based Solutions to Targeting Problems for Onboard Applications

Adam Evans, Alberto Fossa, Roberto Armellin, Didier Henrion, Renato Zanetti

The University of Auckland, Auckland, New Zealand., The University of Texas at Austin, Austin, TX., ∗Postdoctoral Fellow, Te P¯unaha ¯Atea – Space Institute, †Postdoctoral Fellow, Oden Institute for Computational Engineering and Sciences, ‡Professor, Te P¯unaha ¯Atea – Space Institute, ¶Associate Professor, Department of Aerospace Engineering and Engineering Mechanics

2026-07-20优化控制

面向星载自主轨迹重规划,论文针对传统 NLP 代价高、线性化在大机动和长传播下失效的问题,将瞄准与低推力站位保持通过微分代数高阶展开转为多项式优化,并用 moment-SOS 求解,同时给出二阶凸近似。实验显示其精度接近 NLP,在地月 CR3BP 等场景中显著优于线性方法,并在温和假设下提供全局最优收敛保证。

Integer quadratic obstructions to the local controllability of the Burgers equation Figure 1
2026-07-20math.OC

Integer quadratic obstructions to the local controllability of the Burgers equation

Thomas Perrin

2026-07-20规划控制

本文针对带标量分布控制的粘性 Burgers 方程,在一阶线性化已丢失某些傅里叶方向时,研究为何小时间局部零可控会失败。核心洞察是把二次展开中的漂移通过反复分部积分与迭代 Lie 括号联系起来,构造出低阶漂移全消失而第 N 阶出现的光滑控制剖面。主要结果证明任意整数负 Sobolev 阶 H^{-N} 都可量化相应二次障碍,从而否定特定高正则小控制下的 STLC。

Logic, Optimization, and Artificial Intelligence Figure 1
2026-07-20cs.AI

Logic, Optimization, and Artificial Intelligence

J. N. Hooker

2026-07-20优化算法

本文动机是应对机器学习透明性不足,重新梳理逻辑与优化在规则型 AI 中的结合。核心洞察是把逻辑推理与优化统一为投影问题,并展示概率逻辑、信念逻辑、默认逻辑、多值逻辑可由线性规划、整数规划、逻辑 Benders 分解和 BDD 后最优分析处理。主要结果偏综述和方法框架,说明现代求解器可计算推理并提供可追溯解释,但文中未充分给出系统实验增益。

Fast and Scalable Caputo Fractional Gradient Descent via Perturbation-Preserving Memory Compression Figure 1
2026-07-20math.OC

Fast and Scalable Caputo Fractional Gradient Descent via Perturbation-Preserving Memory Compression

Hwanseo Lee, Junseo Lee, Hyunju Kim

Department of Energy Engineering, Korea Institute of Energy Technology, Naju 58330, Republic of Korea

2026-07-20优化算法

这篇论文针对 Caputo 分数阶梯度下降因长历史卷积导致计算量随迭代数二次增长、难以扩展的问题,将分数阶下降方向统一写成历史梯度卷积,并提出 SOE 递推与新的 DHDC 多尺度记忆压缩。作者把压缩误差视为对理想 Caputo 算子的受控扰动,证明在强凸光滑条件下仍可保持单调下降和线性收敛;实验覆盖电池状态估计、信号重建、CIFAR-10 与 Rastrigin,显示其在降低计算和存储成本的同时保留长记忆带来的稳定性与跳出浅局部极小值能力。

Tropical Bi-Objective Pseudolinear Optimization as Parametric Mean-Payoff Games Figure 1
2026-07-20math.OC

Tropical Bi-Objective Pseudolinear Optimization as Parametric Mean-Payoff Games

Ibrahim Hassan, Abdulhadi Aminu, Lawal Muhammad

∗Mathematics Department, Kano University of Science and Technology, Wudil, Nigeria. Email: [ihas-, †Mathematics Department, Kano University of Science and Technology, Wudil, Nigeria. Email: [abdu-, to when they become available, and the scheduler wishes to minimize it. The second is the

2026-07-20优化算法

针对热带伪线性优化以往多聚焦单目标、难以刻画多目标权衡的问题,本文把带一般双边约束的双目标问题转化为含两个参数的平均收益博弈,用循环结构描述可行性、最优性与 Pareto 前沿。核心新意在于联合分母界和二维 Newton 追踪准则;结果证明可行域凸、Pareto 前沿为有限折点的凸分段线性曲线,整数数据下折点为半整数,并给出方向二分与完整前沿追踪算法及复杂度验证。

A Unified Variational Framework for Optimal Transport with Lagrangian Costs Figure 1
2026-07-20math.OC

A Unified Variational Framework for Optimal Transport with Lagrangian Costs

Hailiang Liu

Iowa State University, Mathematics Department, Ames, IA 50011

2026-07-20优化控制

为突破经典二次代价/Wasserstein-2 框架对一般动力学代价的限制,论文从最小作用量定义 Lagrangian 传输成本,并把 Monge-Kantorovich、Eulerian 连续方程、凸优化、Hamilton-Jacobi 对偶和 Hamiltonian 流统一起来。主要结果是在凸性等标准假设下证明这些表述等价,揭示由一般作用泛函诱导的传输距离具有 Wasserstein 空间上的自然 Hamilton 结构,可连接最优传输、Hamilton 动力学与最优控制。

pyoptexplain: A Python Library for Post-Optimality Analysis and Explanation of Optimization Models Figure 1
2026-07-20cs.MS

pyoptexplain: A Python Library for Post-Optimality Analysis and Explanation of Optimization Models

Hussein Fellahi

2026-07-20优化算法

论文针对优化模型求解后解释信息分散、不同建模语言和求解器诊断不一致的问题,提出 pyoptexplain:将 cvxpy、Pyomo、gurobipy、docplex、OR-Tools 等模型归一到带证书的内部表示,只在表示与后端都能支撑时报告对偶、灵敏度等信息,并用暖启动支持批量情景分析。实验显示其能保持跨前端一致报告,单情景开销接近直接求解的小常数倍。

All Games Have Equilibria Figure 1
2026-07-20econ.TH

All Games Have Equilibria

M. Ali Khan, Arthur Paul Pedersen, Maxwell B. Stinchcombe

2026-07-20优化控制

论文针对无限博弈均衡存在性长期依赖紧致性、连续性等分散条件的问题,提出以有限可加混合策略替代传统可数可加策略的统一框架。其核心洞察是放宽概率模型后,可在任意非空玩家集、行动集和有界效用下保持战略偏离意义上的纳什均衡。主要结果证明所有此类博弈均存在均衡,且均衡对应非空、紧值、上半连续;有限近似及迭代删除弱劣策略后的极限均衡也具有相同稳定性。

Proactive Inpatient Bed Requests for Emergency Department Admissions Figure 1
2026-07-20stat.AP

Proactive Inpatient Bed Requests for Emergency Department Admissions

QIan Cheng, Nilay Tanik Argon, Aniruddhan Ganesaraman, Serhan Ziya

Department of Statistics and Operations Research, University of North Carolina at Chapel Hill

2026-07-20优化控制

急诊患者入院后因床位准备滞留会加剧拥挤并影响结局,本文将床位申请从“确诊后、逐人”前移为基于当前急诊患者入院概率、处置时间和住院床位状态的周期性总量决策,并用 MDP、近似动态规划、强化学习和 newsvendor 启发式实现。基于真实大型急诊数据的仿真显示,该策略可使入院患者平均 boarding 时间下降 30–70%,全体急诊停留时间下降 6–15%,且仅带来有限备床空闲;其中 newsvendor 权衡最好,强化学习请求更平滑。

Harnessing GPU Acceleration in Large-Scale Process Optimization Figure 1
2026-07-20math.OC

Harnessing GPU Acceleration in Large-Scale Process Optimization

Boxun Huang, David Y. Shu, Michel Schanen, Mihai Anitescu, Rahul Gandhi, Sungho Shin

a Massachusetts Institute of Technology, Department of Chemical Engineering, Cambridge, MA 02139, USA, b Massachusetts Institute of Technology, MIT Energy Initiative, Cambridge, MA 02139, USA, c Mathematics and Computer Science Division, Argonne National Laboratory, Lemont, IL 60439, USA, d Shell Technology Center, Houston, TX 77082, USA, by the scalability of current nonlinear optimization work-, Scalable stochastic process optimization in process, Second, we demonstrate the scalability of this workflow, scalable platform for scenario-structured process design

2026-07-20优化算法

面向含不确定性的流程设计优化,场景数增大会使方程导向非线性规划迅速超出传统 CPU 求解能力。论文的核心做法是把重复的 MESH 约束结构通过 ExaModels 暴露给 GPU,并用 MadNLP/cuDSS 完成全流程 GPU 驻留求解,避免频繁数据搬移。在 CO2 吸收塔直径最小化案例中,5000 个场景、约 150 万变量时 GPU 用时 33.3 秒,相比单线程 JuMP/Ipopt/MA57 约 21 倍加速,但增益可能主要来自大规模场景下的并行 scaling。

Regularity-Aware Stochastic MGDA with Adaptive Conflict-Avoidant Update Direction Control Figure 1
2026-07-20cs.LG

Regularity-Aware Stochastic MGDA with Adaptive Conflict-Avoidant Update Direction Control

Chentong Huang, Lisha Chen

Dept. of Electrical and Computer Engineering, University of Rochester, Rochester, NY 14627

2026-07-20规划控制

该文针对随机多目标学习中 mini-batch 梯度噪声会放大 MGDA 冲突规避方向偏差、导致 SMG 收敛变慢的问题,分析 CA 方向映射的正则性:最坏情形仅有 1/2-Hölder 连续,但在非退化条件下可提升为 Lipschitz。基于此提出 MoRe,在梯度冲突大且子问题正则时使用 CA 更新,退化时切换固定标量化权重;理论上将非凸 Pareto 驻点收敛率由约 T^-1/4 改进到约 T^-1/2,并给出逐迭代冲突规避保证,实验主要在多任务基准上验证趋势。

On the Computational Complexity of Bilevel Integer Linear Programming Figure 1
2026-07-20math.OC

On the Computational Complexity of Bilevel Integer Linear Programming

Nagisa Sugishita, Margarida Carvalho

2026-07-20优化控制

这篇论文关注双层整数线性规划的计算复杂性,动机是一般整数变量情形的复杂度长期缺口。核心贡献是证明其决策版仍为Σ₂^p-complete,并系统刻画固定上层变量、下层变量、下层约束等结构限制下的复杂度;同时将总变量数固定时的多项式可解性推广到无需有界性假设,并给出定价变体的Σ₂^p-completeness结果。

2026-07-17

17 篇
Data Driven Block Replacement Scheduling Figure 1
2026-07-17cs.LG

Data Driven Block Replacement Scheduling

Aniruddhan Ganesaraman, VIdyadhar Kulkarni

2026-07-17优化控制

本文面向多设备维护中寿命分布未知、全量定期更换间隔难以设定的问题,将区块更换建模为带删失寿命观测的随机多臂老虎机,并利用“选择较长间隔会同时暴露较短间隔成本”的嵌套观测结构改进学习效率。结果给出LCB类算法的对数遗憾界、相关臂变体对较短次优间隔只需常数次直接试验,并用Kaplan-Meier更新分布估计实现策略一致性;MDP分析还量化了区块策略与按年龄决策的结构性成本差距。

Landscape analysis for shallow neural networks: Complete classification of critical points for cubic activation and affine target functions Figure 1
2026-07-17math.OC

Landscape analysis for shallow neural networks: Complete classification of critical points for cubic activation and affine target functions

Shokhrukh Ibragimov, Ilkhom Mukhammadiev, Diyora Salimova

Applied Mathematics: Institute for Analysis and Numerics, University of Münster, Germany, Department for Applied Mathematics, University of Freiburg

2026-07-17优化控制

这篇论文关注浅层多项式神经网络在真实平方损失下的非凸优化地形,动机是用可解析的单项式激活理解临界点如何影响训练。核心洞察是把网络宽度、激活次数与“可见且活跃”神经元的枢轴结构联系起来:任意次数下给出全局最小值存在的充要门槛,若宽度小于次数则零损失不可达且最小化序列发散;对三次激活进一步完整分类临界点,证明无局部最大值,并刻画全局最小、鞍点和非全局局部最小出现的结构条件。

Robust Optimal Control of Arbitrarily Switched Systems: A Path-Complete Framework Figure 1
2026-07-17math.OC

Robust Optimal Control of Arbitrarily Switched Systems: A Path-Complete Framework

Léa Ninite, Adrien Banse, Guillaume O. Berger, Raphaël M. Jungers

⋆ ICTEAM Institute, UCLouvain, Louvain-la-Neuve, Belgium

2026-07-17规划控制安全鲁棒

本文面向任意切换系统中最坏模式序列导致的鲁棒最优控制难题,目标是在连续状态/输入下同时获得可计算控制律和性能证书。核心做法是把路径完备图与鲁棒 Bellman 不等式结合,用图节点函数的点态 min-max 组合构造反馈策略和值函数上界。在线性二次情形下可转化为 SDP 或交替优化,并在建筑温控等实验中显示可用于直接控制及作为鲁棒 MPC 终端代价。

Heilbronn's Problem in the Unit Triangle: Certified Optimal Configurations for up to $n\le 8$ Figure 1
2026-07-17math.OC

Heilbronn's Problem in the Unit Triangle: Certified Optimal Configurations for up to $n\le 8$

Nathan Sudermann-Merx

2026-07-17优化控制

本文针对单位三角形中的 Heilbronn 点配置问题,动机是平方区域的精确结果不能直接迁移到三角域。核心洞察是证明最优解可规约为至少四点在边界上,并利用仿射对称固定部分边界点,从而构造 MIQCP 全局认证模型。结果证明了 n≤8 的全局最优性,给出 n≤7 的精确最优值,并确认 n=8 的七次代数猜想及其不可根式表达特征。

Statistical Inference for Scenario-Based Dynamic Optimization under Uncertainty Figure 1
2026-07-17math.OC

Statistical Inference for Scenario-Based Dynamic Optimization under Uncertainty

Aurya Javeed, Johannes Milz

Optimization and Uncertainty Quantification, Sandia National Laboratories, Albuquerque, NM 87185, USA, H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, Georgia 30332, USA

2026-07-17优化算法安全鲁棒

本文面向批式/半批式过程在参数不确定下的开环动态优化,关注场景平均近似得到的最优值是否可信。核心创新是用累积输入的稳定性估计建立 SAA 目标的函数型中心极限定理,进而刻画最优值误差分布。主要结果给出唯一最优解时的插件置信区间,以及无需唯一性的子采样置信区间,并在两个补料批过程案例中量化场景数带来的统计误差。

Steering Robustness into World Action Models via Mechanistic Interpretability and Optimal Control Figure 1
2026-07-17cs.RO

Steering Robustness into World Action Models via Mechanistic Interpretability and Optimal Control

Jihoon Hong, Julian Skifstad, Qiyue Dai, Alice Chan, Glen Chou

Georgia Institute of Technology

2026-07-17强化学习规划控制安全鲁棒

针对世界动作模型在相机、夹爪初始状态和视觉噪声等分布偏移下易失效的问题,论文用机制可解释性分析隐藏激活,发现鲁棒性相关特征在部分架构中呈低维线性可分,并据此提出免训练的对比方向 steering 与闭环 WA-LQR 控制。实验显示 Cosmos-Policy、DiT4DiT 可被有效 steering,而 LingBot-VA 较弱;WA-LQR 在多类扰动上优于未 steering、提示 steering 和开环基线,最高成功率提升 41%。

Finite-Dimensional Feedback Stabilization of Nonautonomous Stochastic Parabolic Equations Figure 1
2026-07-17math.OC

Finite-Dimensional Feedback Stabilization of Nonautonomous Stochastic Parabolic Equations

Behzad Azmi, Jonas von der Heydt, Sergio Rodrigues

Dep. Math., NOVA University Lisbon, Campus de Caparica

2026-07-17优化控制

针对随机抛物方程中有限维、局部执行器反馈稳定化理论不足的问题,本文用斜投影构造不依赖具体系数的显式反馈,并允许执行器支撑集总测度任意小。结果证明闭环适定,可按预设速率实现指数均方稳定;纯乘性噪声下进一步得到几乎必然稳定,加性噪声下则收敛到噪声相关残差界。

Domain Adaptation of Mismatched Proximal Denoiser for Plug-and-Play Image Reconstruction Figure 1
2026-07-17eess.IV

Domain Adaptation of Mismatched Proximal Denoiser for Plug-and-Play Image Reconstruction

Guixian Xu, Jinglai Li, Junqi Tang

\addr School of Mathematics, University of Birmingham

2026-07-17视觉感知三维

论文针对PnP-PGD在目标图像域与去噪器训练域不一致时收敛性难以解释的问题,提出“近端失配”来刻画部署去噪器与目标域近端映射的差异,并将其纳入非精确近端步骤分析,给出含平均平方失配项的O(1/K)驻点界。由此作者主张用近端匹配而非单纯MSE做少样本适配;在去模糊和4倍超分辨实验中,该策略相较MSE适配提升PSNR,严重域偏移下增益可超过10 dB。

Tamed Stochastic Gradient Hamiltonian Monte Carlo Figure 1
2026-07-17math.OC

Tamed Stochastic Gradient Hamiltonian Monte Carlo

Zhuoran Wang, Ying Zhang

online data where a uniform bound on the data stream is unavailable.

2026-07-17强化学习优化算法

本文针对超线性甚至不连续随机梯度下,标准 SGHMC 欧拉离散易失稳、现有 tamed KLMC 又依赖全梯度而成本高的问题,提出带驯化随机梯度的 tSGHMC。核心做法是在欠阻尼 Langevin/HMC 更新中加入与摩擦参数耦合的 taming 系数,以控制梯度爆炸并保留随机梯度效率;理论上给出 Wasserstein-2 非渐近误差界和期望超额风险上界,收敛阶达 1/4,并在报童、CVaR 等实验中相较 TUSLA 通常取得更低 RMSE 和超额风险。

Modular Sign Compensation for MIMO Systems with Unknown Control Direction: An Exact Nominal Recovery Approach Figure 1
2026-07-17eess.SY

Modular Sign Compensation for MIMO Systems with Unknown Control Direction: An Exact Nominal Recovery Approach

Diego Gutiérrez-Oribio, Ioannis Stefanou

2026-07-17规划控制

针对多输入多输出系统中执行器方向未知或随时间翻转会把稳定反馈变成正反馈的问题,论文提出一个外接于名义控制器的模块化符号补偿层,只切换对角符号而不改变控制幅值,并用名义 Lyapunov 衰减量驱动向量或标量调度器搜索正确符号。结果表明,在符号区间被捕获后闭环可精确恢复名义动态;飞行滚转、视觉伺服和地下储层控制算例展示了方向变化后的再稳定能力。

A Slow-Fast Stochastic Framework for Zeroth-Order Distributed Time-Varying Optimization Figure 1
2026-07-17math.OC

A Slow-Fast Stochastic Framework for Zeroth-Order Distributed Time-Varying Optimization

Wanying Li, Nan-jing Huang

Department of Mathematics, Sichuan University, Chengdu, Sichuan 610064, P.R. China

2026-07-17优化算法

面向多机器人、无人机群等连续时间多智能体场景中梯度不可得且目标随时间变化的问题,本文提出慢-快随机框架:快子系统用零阶函数值生成平滑随机梯度估计,慢子系统执行分布式优化与一致性。理论上证明快系统快速跟踪估计量,慢系统可在概率意义下实现实际固定时间一致,并对时变最优轨迹进行有界跟踪,同时给出参数、扰动和目标函数性质对误差界的影响。

What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity Figure 1
2026-07-17cs.LG

What's in a Smoothness Constant? Tighter Rates for Local SGD with Bounded Second-order Heterogeneity

Kumar Kshitij Patel, Rustem Islamov, Sebastian U Stich, Aurelien Lucchi, Eduard Gorbunov, Lingxiao Wang

Institute for Foundations of Data Science, Yale University, Department of Mathematics and Computer Science, University of Basel, CISPA Helmholtz Center for, Department of Statistics and Data Science, Department of Data Science, New Jersey Institute of Technology

2026-07-17学习理论

这篇论文关注联邦/分布式训练中通信昂贵时,Local SGD 为何能在异构数据下优于小批量 SGD。核心洞察是用二阶异质性而非全局一阶梯度差异刻画客户端差别,并通过轨迹依赖的异质性控制与自界递推分析客户端漂移。主要结果是在一般凸目标下给出改进收敛上界,证明其与新下界近乎匹配,并说明罕见高曲率客户端会影响串行 SGD 的最坏情形。

State-Dependent Metric Projection Neural Network for Variational Inequalities Figure 1
2026-07-17math.OC

State-Dependent Metric Projection Neural Network for Variational Inequalities

Mohammed Alshahrani

Department of Mathematics, King Fahd University of Petroleum & Minerals, Dhahran, 31261, Saudi Arabia

2026-07-17优化控制

针对传统投影动力系统/投影神经网络采用固定欧氏或常数度量、在各向异性或病态变分不等式中收敛慢的问题,论文提出状态依赖度量的缩放投影神经网络,把连续时间预条件嵌入投影流。其核心在于让投影几何随状态平滑变化,同时保持与原 VI 解的平衡点一一对应。文中证明了解的存在性、Lyapunov 稳定性及在更强条件下的指数收敛,并用数值实验展示瞬态轨迹被重塑但最终收敛到同一平衡点;实际加速增益大小仍依赖度量设计。

Adaptive Runge-Kutta Step Control Buys Training Loss, Not Generalization: An Honest Compute-Matched Study of RK-Adam Optimizers Figure 1
2026-07-17cs.LG

Adaptive Runge-Kutta Step Control Buys Training Loss, Not Generalization: An Honest Compute-Matched Study of RK-Adam Optimizers

Akhilesh Gogikar

2026-07-17规划控制学习理论

本文针对将优化器视为梯度流离散化后引入高阶 Runge-Kutta 的做法,强调以梯度评估次数而非迭代步数做公平比较。核心洞察是常见 RK-Adam 的自适应步长在实践中几乎失效,退化为高成本的固定步长梯度平均。实验显示,原始方法在训练损失上输给 Adam;修复控制器虽能显著降低全批训练损失,但泛化精度无提升,且便宜的一阶基线可达到相近或更好结果。

Using a MIP Solver as a PDHG-Based MIP Heuristic Figure 1
2026-07-17math.OC

Using a MIP Solver as a PDHG-Based MIP Heuristic

Edward Rothberg

2026-07-17优化算法

本文动机是利用 PDHG 在大规模 LP 松弛上快速给出低精度解的能力,加速 MIP 求可行解过程。核心洞察不是另写单一启发式,而是把现代 MIP 求解器中的默认 LP 求解环节替换为 PDHG,观察现有启发式和割平面等机制的退化与保留。实验显示该方案平均不如默认 Gurobi,但在部分 MIPLIB 与客户模型上能更快找到高质量、高精度解,扩展了质量-时间前沿。

Lyapunov Guidance: A Unified Framework for Stabilizing Generative Flows Figure 1
2026-07-17cs.LG

Lyapunov Guidance: A Unified Framework for Stabilizing Generative Flows

Jingdong Zhang, Xinze Li, Yize Jiang, Luan Yang, Minkai Xu, Junhong Liu

J. Zhang is with Department of, Mathematics and I-X, Imperial College London, London, United Kingdom. E

2026-07-17生成模型

论文针对预训练 flow matching 模型在下游任务中依赖重训、现有后训练 guidance 多为启发式且缺少稳定性保证的问题,提出 LyaGuide:把条件能量/势函数解释为 Lyapunov 函数,把 guidance 视为控制输入,并用闭式伪投影强制满足 Lyapunov 下降条件。实验覆盖合成任务、图像逆问题、强化学习规划和能量模型,报告样本质量、guidance 保真度与鲁棒性提升且额外开销较小;但文中也说明该投影一般不保持加权连续性方程,稳定性与生成分布约束同时满足仍是开放问题。

Principles of Quantum Optimization for Constrained Problems Figure 1
2026-07-17quant-ph

Principles of Quantum Optimization for Constrained Problems

Einar Gabbassov, Gurpahul Singh, Achim Kempf

Department of Applied Mathematics, University of Waterloo, Waterloo, Ontario, N2L 3G1, Canada, Institute for Quantum Computing, University of Waterloo, Waterloo, Ontario, N2L 3G1, Canada, Perimeter Institute for Theoretical Physics, Waterloo, Ontario, N2L 2Y5, Canada, Department of Physics and Astronomy, University of Waterloo, Waterloo, Ontario N2L 3G1, Canada

2026-07-17优化算法

本文针对量子优化长期偏向 QUBO、对约束结构处理粗糙的问题,提出统一的受限量子优化谱理论。核心洞察是计算变慢主要来自演化中纠缠的创建、重分配与消除,而约束的代数结构会诱发这种重构及窄谱隙。论文据此解释了约束感知动力学为何可优于惩罚项方法,并给出通过保留可行子空间结构、设计更合适 mixer 来降低运行瓶颈的原则。

2026-07-16

30 篇
An Epidemic Threshold Set for Networks Figure 1
2026-07-16cs.SI

An Epidemic Threshold Set for Networks

Hoang Phi Dung, Nguyen Hong Phuc

2026-07-16优化控制

针对传统全局流行阈值难以反映复杂网络社区异质性的问题,论文在离散时间 SIS 模型中提出社区级流行阈值集合,用于刻画不同社区的局部传播脆弱性;理论上证明任一局部阈值均不低于全局阈值,并在合成网络与 Haslemere 接触网络上通过阈值排序和感染量仿真验证该关系。

Associated gradients: connection to conservative fields and application Figure 1
2026-07-16math.OC

Associated gradients: connection to conservative fields and application

Cheik Traoré

Toulouse School of Economics, Toulouse Capitole University, Toulouse, France

2026-07-16优化算法

本文针对非光滑自动微分中链式法则与 Clarke 次微分难以刻画实际梯度的问题,研究分片光滑函数的 associated gradients。核心洞察是将这些依赖表示的梯度证明为保守场的选择,从而连接构造性微分框架与变分分析。主要结果包括建立沿 Lipschitz 曲线的链式法则、推出 Clarke 次微分相应性质,并在有界假设下证明使用该梯度的随机次梯度法子序列收敛到保守与 Clarke 临界点且函数值收敛。

Further quantitative moduli around uniform convexity Figure 1
2026-07-16math.FA

Further quantitative moduli around uniform convexity

Andrei Sipos

Research Center for Logic, Optimization and Security (LOS), Department of Computer Science, Faculty of Mathematics and Computer Science, University of Bucharest, Simion Stoilow Institute of Mathematics of the Romanian Academy

2026-07-16优化算法

本文以 proof mining 为动机,研究一致凸空间中常用性质的显式定量模量。核心做法是重写 Prüß 关于 Banach 空间一致凸性的证明,用不动点和近似化陈述替代序列与上下极限,并在 W-双曲等非线性度量空间中用纯度量论证绕开对偶与次微分工具。主要结果是给出线性与非线性一致凸情形下投影、proximal mapping 等相关量的新公式和可读出的模量。

Beyond the $d^{2.5}$-mixing bound for Dikin walks on polytopes Figure 1
2026-07-16cs.DS

Beyond the $d^{2.5}$-mixing bound for Dikin walks on polytopes

Yunbum Kook

2026-07-16学习理论

论文针对高维多面体采样中 Dikin walk 距离 conjectured d^2 混合界仍有差距的问题,试图用更贴近内点法几何的 Lee–Sidford 度量减少对约束数的依赖。核心创新是证明缩放后的 Lee–Sidford 度量具有更强的平均自协调性质,并用高阶展开、移动正交标架与 Wiener-chaos 分解控制 Metropolis 接受率。主要结果是将 warm-start 指数采样混合复杂度从此前 d^2.5 改进到 d^2.25,并通过退火框架得到更好的 cold-start 复杂度。

VSC-HVDC setpoint adjustment for maximum grid utilisation under voltage constraints Figure 1
2026-07-16eess.SY

VSC-HVDC setpoint adjustment for maximum grid utilisation under voltage constraints

Gabriel Malmer, Emil Hillberg, Olof Samuelsson

2026-07-16优化算法

面向输电容量紧张且电压稳定约束常被忽略的问题,论文研究如何在故障/电压受压状态下调节 VSC-HVDC 有功设定值。核心洞察是把换流器电流、直流电压限制表示为 P-Q 平面圆形可行域,并由局部电压与广域相角差推导闭式最优设定规则,无需全局 OPF。Nordic Test System 验证该解析最优点与最大负荷能力一致,有功下调可带来超过比例的负荷裕度提升,且对相角估计误差较稳健。

Strict Lyapunov function for the one-dimensional linear wave equation with a locally distributed damping Figure 1
2026-07-16math.AP

Strict Lyapunov function for the one-dimensional linear wave equation with a locally distributed damping

Jean-Michel Coron

2026-07-16优化控制

本文针对局部分布阻尼下一维线性波方程中传统能量函数仅半负定、难以直接给出全局衰减控制的问题,构造显式严格 Lyapunov 函数:弱解情形需在能量中加入局部项与一个非局部项,强解情形则可仅用局部项。主要结果是由该函数直接恢复指数稳定性,并为后续鲁棒性分析提供更定量的工具。

Bayesian Risk Preference Persuasion Figure 1
2026-07-16math.OC

Bayesian Risk Preference Persuasion

Shutian Liu

City University of Hong Kong

2026-07-16安全鲁棒

本文关注风险偏好并非固定、会受信息影响这一问题,试图解释如何通过信息设计引导决策者在不确定环境中的风险评估与行动。核心创新是把贝叶斯劝说与时间一致的相干风险度量结合,用后验信念分布刻画风险偏好的修正,并区分纯偏好劝说与含行动的劝说问题。主要结果给出最优信息规则存在性及发送者受益条件,并以再保险设计展示该框架何时能降低发送者期望损失。

Dynamical Vehicle Orienteering Problem for Multi-Rotor Unmanned Aerial Vehicles Figure 1
2026-07-16cs.RO

Dynamical Vehicle Orienteering Problem for Multi-Rotor Unmanned Aerial Vehicles

František Nekovář, Matej Novosad, Martin Saska, Robert Pěnička

Faculty of Electrical Engineering, Czech Technical University, Technicka 2, 166 27, Prague, Czech Republic, available dynamics. A later model-based KOP formulation (Nekovář et al., 2023) imposed velocity and

2026-07-16优化控制

本文针对传统定向越野规划忽略多旋翼无人机加速度、推力和重力约束的问题,提出动力学车辆定向越野问题 DVOP。核心创新是把奖励路径选择与时间最优 PMM 轨迹耦合,并用 LNS 求可扩展解、用结合 NLP/MILP 的 BnB 给紧上界。实验在 KOP 基准上相对既有方法最高提升 37%,并通过真实多旋翼飞行验证轨迹可执行性。

A phase transition in the exactness of the NPA hierarchy at the critical doubly-tilted CHSH functional Figure 1
2026-07-16quant-ph

A phase transition in the exactness of the NPA hierarchy at the critical doubly-tilted CHSH functional

Anton Pakhunov

2026-07-16优化控制

本文针对双倾斜 CHSH 泛函在临界线附近 NPA 层级是否需无限升高的问题,分析量子最优值与有限层松弛之间的精度失配。核心洞察是临界处量子优势呈三次离开局域界,而每个固定 NPA 层级呈二次超调,导致亚临界邻域内固定有限层无法精确;同时用有理证书证明超临界象限所有层级精确,并给出前四层非精确的精确算术证据。

No finite level of the NPA hierarchy is exact for the doubly-tilted CHSH functional near the critical tilt Figure 1
2026-07-16quant-ph

No finite level of the NPA hierarchy is exact for the doubly-tilted CHSH functional near the critical tilt

Anton Pakhunov

2026-07-16优化控制

论文针对双倾斜 CHSH 在临界倾斜附近 NPA 层级是否会在某个有限层精确收敛的问题,回应此前数值上层级需求似乎无界的疑问。核心做法是构造每一层都可精确验证的矩曲线和层级无关的符号 witness,证明有限层的 NPA 值存在二阶超调,而真实量子值只以三阶离开局域界。因此任意有限 NPA 层在临界点邻域内都不精确,非精确性来自 NPA 切锥中的非量子方向。

Load Balancing with Individually Heterogeneous Servers Figure 1
2026-07-16math.PR

Load Balancing with Individually Heterogeneous Servers

Burak Büke, Arpan Mukhopadhyay, Özge Tekin

2026-07-16优化控制

面向现代数据中心中服务器速率可在个体层面连续差异的负载均衡问题,论文突破以往有限类型异构假设,用测度值过程刻画 JSQ 策略在 Halfin-Whitt 重载下的扩散极限,并指出公平过程与路由测度决定不同并列队列打破规则的性能。主要结果包括统一极限定理、若干规则的极限刻画,以及能渐近最小化稳态总任务数和等待任务数的打破规则。

Polynomial iISS for a class of Timoshenko equations with external disturbances and infinite history memory Figure 1
2026-07-16math.OC

Polynomial iISS for a class of Timoshenko equations with external disturbances and infinite history memory

Xinyu Guo, Jun Zheng

School of Mathematics, Southwest Jiaotong University, Chengdu, China

2026-07-16优化控制

针对含外部扰动和无限历史记忆的 Timoshenko 梁方程,论文关注既有 PiISS 定义依赖图范数、难以贴合经典无限维 iISS 的问题。其核心做法是仅用状态范数重定义多项式 iISS,并通过半群、椭圆理论与 Lyapunov 泛函估计证明适定性;在 Tolksdorf 型松弛条件下得到 PiISS 充分条件,强化条件下得到 EiISS,量化扰动与记忆对稳定衰减的影响。

Lifting-Free Quadratic Sum-Of-Squares Programming Figure 1
2026-07-16math.OC

Lifting-Free Quadratic Sum-Of-Squares Programming

Gabriel F. Machado, Ross Drummond, Morgan Jones

†School, University

2026-07-16优化控制

本文针对二次 SOS 优化在系统辨识、机器学习等场景中因 Schur 补或二阶锥提升导致变量和锥维度膨胀、内点法计算与内存瓶颈的问题,提出不提升维度的正则化框架:只对 SOS 变量加范数惩罚,保留原锥结构,并把问题转为具有 Lipschitz 梯度的无约束凹对偶,可用加速一阶法求解且给出非渐近恢复保证。约束回归实验显示其相较 SCS 可快约 40%,并能处理 MOSEK 难以承受的更大实例。

The problem of finding the global minimum of a polynomial on a coordinate parallelepiped Figure 1
2026-07-16math.OC

The problem of finding the global minimum of a polynomial on a coordinate parallelepiped

V. N. Nefedov

2026-07-16优化控制

针对非凸多项式在坐标平行六面体上求全局最小值时,梯度法易陷局部最优、网格法又需困难的 Lipschitz 估计,论文用变量消去算法将问题递归分解到边界面与内部驻点条件,并化为有限个一元多项式求根问题。主要结果是给出支撑这种降维与规范化转换的引理和定理,可恢复全局最小值及极小点坐标范围,但实用性限于低维、低次数情形。

Meeting Uncertain Threats with Feedback Figure 1
2026-07-16math.OC

Meeting Uncertain Threats with Feedback

Louis L Chen, Ang Xu, Roberto Szechtman, Chiwei Yan, Vince Vanterpool

bDepartment of Industrial Engineering & Operations Research, University of California, Berkeley, California, additional effector depends on the target. Second, kill assessment is available only at the end of, can be captured by simple, scalable rules.

2026-07-16优化控制

这篇论文面向防空/导弹防御中拦截资源有限、威胁异质且只能按轮获得毁伤反馈的动态分配问题,将其建模为 MDP,并把清除时间、截止期生存概率和有效分配数统一分析。核心洞察是简单时不变策略并不弱:公平分配在同质威胁或低容量场景最优,容量随威胁数线性增长时与最优清除时间只差常数轮;面向目标的贪心策略在异质场景近最优,且 EAM 有常数因子保证。

The Value of Perfect Endpoint Forecasts for Offshore-Wind Thermal Firming Figure 1
2026-07-16math.OC

The Value of Perfect Endpoint Forecasts for Offshore-Wind Thermal Firming

Arash Khojaste, Geoffrey Pritchard, Golbon Zakeri

2026-07-16优化控制

面向海上风电并网后热备用需应对净负荷波动的问题,论文不评估完整滚动预测,而是把“当前状态加单个未来端点”的完美信息嵌入周期性 MDP,澄清端点预测信息集并不随时域嵌套。ISO-NE 算例显示,1 小时端点可降年度 firming 成本 8.07%,6 小时仅 2.28%,说明远端单点信息对一步爬坡决策较难转化为价值。

Infinite horizon stochastic optimal control with sign-changing discount factor Figure 1
2026-07-16math.OC

Infinite horizon stochastic optimal control with sign-changing discount factor

Charles Bertucci (CEREMADE), Jean-Michel Lasry (CEREMADE), Pierre-Louis Lions (CEREMADE, CdF (institution))

A Universit´e Paris-Dauphine, PSL Research University,UMR 7534, CEREMADE, 75016 Paris, France

2026-07-16规划控制

本文研究无限时域随机最优控制中折现因子随状态变号时,代价泛函可能不再良定义、传统 HJB 比较原理失效的问题。核心做法是用算子 −∆+rId 的谱性质刻画可行反馈控制集合,并把非负运行成本的结果推广到允许 g 有下界负值的情形。主要结果包括建立扩展比较原理、证明 HJB 解的存在唯一性,并将该唯一解识别为相应控制问题的值函数。

Energy decay and weak observability for some evolution systems Figure 1
2026-07-16math.OC

Energy decay and weak observability for some evolution systems

Kaïs Ammari, Faouzi Triki

Faouzi TRIKI 2 2 2 Faouzi Triki, Laboratoire Jean Kuntzmann, UMR CNRS 5224

2026-07-16优化控制

本文关注耗散演化方程解的长期稳定性:能量是否衰减以及衰减速率如何由可观测性刻画。核心洞察是在抽象 Hilbert 空间框架下,把弱可观测不等式、谱型估计与阻尼系统能量衰减联系起来,证明在相应算子假设下弱可观测性与能量衰减等价,并以阻尼波类系统作为主要应用场景。

Norm-Cone Conjugation and Fenchel-Type Duality Beyond Convexity Figure 1
2026-07-16math.OC

Norm-Cone Conjugation and Fenchel-Type Duality Beyond Convexity

Fernando García-Castaño, Miguel Ángel Melguizo-Padial

2026-07-16优化算法

针对经典 Fenchel 对偶依赖仿射下支撑、难以直接处理非凸优化的问题,本文以平移范数锥替代仿射函数,建立由斜率和中心索引的非线性共轭框架。核心洞察是把双共轭精确性从凸性转化为范数锥可支撑性,并据此给出 Fenchel–Young 型不等式、范数锥次微分及扰动对偶理论;弱对偶无需凸性,强对偶由下 Lipschitz 界和下 calmness 等度量条件保证。

Hager-Zhang Conjugate Gradient Method for Set Optimization with Set-Valued Objective Map of Finite Cardinality Figure 1
2026-07-16math.OC

Hager-Zhang Conjugate Gradient Method for Set Optimization with Set-Valued Objective Map of Finite Cardinality

Ravi Raushan, Debdas Ghosh, Zai-Yun Peng

2026-07-16优化算法

本文面向有限基数集值目标的集合优化问题,动机是将共轭梯度类方法从向量优化推广到更一般的集合序关系场景,并避免既有方法对有限生成锥或最优点正则性的依赖。核心做法是结合 Drummond-Svaiter 标量化、Wolfe 线搜索与 Hager-Zhang 参数构造下降方向;文中证明步长存在、算法适定、Zoutendijk 型条件和渐近全局收敛,并通过测试问题显示其相对 PRP、HS 变体更有效。

Learned Pairwise Deep Dual-Optimal Inequalities for Stabilizing Column Generation Figure 1
2026-07-16math.OC

Learned Pairwise Deep Dual-Optimal Inequalities for Stabilizing Column Generation

Zhengzhong Ricky You, Bo Tang, Haoran Liu, Baichuan Mo

2026-07-16优化控制

针对车辆路径等列生成问题中对偶解震荡导致收敛慢、传统深对偶最优不等式又依赖难以泛化的交换证明,本文学习客户对偶变量的成对顺序关系,并用图修复、传递约简和恢复过程控制冲突、冗余与界损失。CVRP与VRPTW实验显示,直接部署根节点列生成时间几何均值分别降89.7%和93.9%,平均界损失较小;恢复模式仍保留54.8%和83.1%加速并保证基准界。

Closing the Oracle-Complexity Gap in Derivative-Free Convex Optimization: A Near-Quadratic Lower Bound from Exact Function Values Figure 1
2026-07-16math.OC

Closing the Oracle-Complexity Gap in Derivative-Free Convex Optimization: A Near-Quadratic Lower Bound from Exact Function Values

Phillip Kerger

2026-07-16优化算法学习理论

本文关注无梯度凸优化中只可查询精确函数值时,究竟需要多少次黑盒评估这一基础问题,动机来自仿真、实验和 bandit 场景中评估成本主导的情形。核心创新是构造值查询模型下的困难函数族,证明即使无噪声、无限精度和无限内存,确定性算法仍需近二次数量级查询。主要结果是在精度 Θ(d^{-1/2}) 下给出 Ω(d^2/log d) 下界,将1996年以来 Ω(d) 与 O(d^2 log^2 d) 的差距缩至多对数因子,并推广到混合整数情形得到约 Ω(d^2·2^n) 查询下界。

State constrained convex Nash equilibrium problems coupled with linear hyperbolic PDEs Figure 1
2026-07-16math.OC

State constrained convex Nash equilibrium problems coupled with linear hyperbolic PDEs

Marcelo Bongarti, Michael Hintermüller

Weierstraß Institute for Applied, Weierstraß Institute for

2026-07-16优化算法

本文关注多主体共享物理系统中的广义纳什均衡,尤其是带状态约束且由线性双曲 PDE 耦合时,传统存在性证明受限于策略到状态映射缺乏紧性和约束映射下半连续性。核心做法是以图凸性等结构条件替代难验证的正则性假设,建立弱上半连续与图凸约束框架。主要结果给出均衡存在性和一阶最优性条件,并说明其可用于波方程、广告动力学及气体网络等模型。

Model predictive control for laser thermal processing: operator learning, closed-loop validation, and out-of-distribution analysis Figure 1
2026-07-16math.OC

Model predictive control for laser thermal processing: operator learning, closed-loop validation, and out-of-distribution analysis

Smajil Halilovic, Yuchen Zhang, Daniel M. Tartakovsky

2026-07-16规划控制

这篇论文针对激光粉床等热加工中高保真热模型难以在线用于MPC的问题,提出面向移动热源的多步DeepONet代理模型,并嵌入CasADi/IPOPT闭环控制。关键洞察是离线平均误差不足以证明控制可用性,未覆盖的路径拐角会造成严重低估;通过两类训练数据设计与13 K约束裕量,91 K拐角低估降至1.4 K,并在测试路径上实现真实上界零违背。

Optimal geometric barriers for weighted observability of heat semigroups on metric measure spaces Figure 1
2026-07-16math.AP

Optimal geometric barriers for weighted observability of heat semigroups on metric measure spaces

Vincent Boulard, Amaury Hayat, Emmanuel Trélat

2026-07-16优化控制

本文针对热方程观测/控制中小时间权重 e^{-γ/t} 是否只是 Carleman 技术产物的问题,证明其由观测集几何距离强制决定。作者在倍增度量测度空间和自伴算子框架下,用谱包、局部 Weyl 律、有限传播速度与弱 Kannai 转换建立几何屏障:若加权积分观测成立,则 γ 至少为观测集本质最大距离平方的一半,并补上无限时间常数的最优下界。

Euclidean Distance Degrees in Macaulay2 Figure 1
2026-07-16math.AG

Euclidean Distance Degrees in Macaulay2

William Huang, Jose Israel Rodriguez

2026-07-16优化控制

本文面向代数优化中最近点问题的复杂度评估,动机是让研究者能在 Macaulay2 中计算任意代数簇的欧氏距离次数。核心贡献是实现 EuclideanDistanceDegree 包,整合 minors、conormal varieties 等符号方法,以及基于 Bertini、MonodromySolver 的左核与同伦数值方法,覆盖加权、单位和泛型 ED degree。主要结果是给出统一接口和示例验证其可计算性;数值方法可能因路径失败低估结果,精度增益来源文中未充分说明。

An ALNS Heuristic for Large-Scale Line Planning with Mode Choice and Line Generation Figure 1
2026-07-16math.OC

An ALNS Heuristic for Large-Scale Line Planning with Mode Choice and Line Generation

Siv Marie Cartland Hansen, Richard Martin Lusby, Rowan Hoogervorst, Otto Anker Nielsen

Department of Technology, Management and Economics, Technical University of Denmark, Department of Strategy, Entrepreneurship and Operations, EDHEC Business School, 24, address this challenge, we propose a scalable Adaptive Large Neighborhood Search (ALNS), In this paper, we present a scalable matheuristic for line planning with demand determined, First, we develop a competitive and scalable

2026-07-16规划控制

论文针对公交线路规划中服务质量会反过来影响出行需求的问题,提出结合 ALNS、动态线路生成、乘客分配与 logit 方式选择的可扩展启发式框架。Odense 约 1800 个 OD 对实验显示,方案倾向于用更少线路提供更高频服务,平均发车间隔由约 41 分钟降至 6.8–13 分钟,公交需求份额提升至 12%–32%,但结果对乘客行为假设较敏感。

Duality Framework for Flux Constrained Flow in Porous Media: Analysis and Numerics Figure 1
2026-07-16math.NA

Duality Framework for Flux Constrained Flow in Porous Media: Analysis and Numerics

Harbir Antil, Keegan L. A. Kirk, Felipe Pérez

2026-07-16生成模型

本文针对多孔介质 Darcy 流中边界法向通量只能落在上下限之间的情形,动机来自排水、半封闭断层等有限通流能力边界。核心做法是用 Fenchel 对偶建立速度型与压力型变分框架,并把结构传递到 Raviart–Thomas/Crouzeix–Raviart 离散。主要结果包括适定性、强对偶、互补最优性条件、无通用常数的后验误差恒等式、先验收敛率及自适应数值验证。

Design of Carbon Capture Processes Under Part-load Operating Conditions Figure 1
2026-07-16math.OC

Design of Carbon Capture Processes Under Part-load Operating Conditions

David Y. Shu, Boxun Huang, Yurim Kim, Randall Field, Rahul Gandhi, Sungho Shin

a Massachusetts Institute of Technology, Department of Chemical Engineering, Cambridge, MA 02139, USA, b Massachusetts Institute of Technology, MIT Energy Initiative, Cambridge, MA 02139, USA, c Shell Technology Center, Houston, TX 77082, USA, gas power plants to supply firm power to data centers may, ther include fixed operating costs for labor, maintenance

2026-07-16优化控制

这篇论文关注燃煤电厂随负荷调节时烟气条件变化对溶剂法碳捕集设计的影响。作者用两阶段随机优化,将真实部分负荷分布转化为场景,并以数据驱动的趋近平衡模型降低吸收/解吸建模复杂度。结果显示,考虑负荷 variability 可使设备规模和总厂成本降低约6–9%,虽增加运行成本,但碳捕集总成本仍下降0.7–1.7%。

Overcoming slow Kolmogorov width decay in parametric optimal control via neural network surrogates Figure 1
2026-07-16math.OC

Overcoming slow Kolmogorov width decay in parametric optimal control via neural network surrogates

Hendrik Kleikamp, Martin Lazar, Juan Ricardo Muñoz

‡Faculty of Electrical Engineering and Applied Computing, University of Dubrovnik, ´Cira Cari´ca 4, 20 000 Dubrovnik, Croatia, §Department, ¶Faculty of Electrical Engineering and Applied Computing, University of Dubrovnik, ´Cira Cari´ca 4, 20 000 Dubrovnik, Croatia.

2026-07-16规划控制

针对参数化线性二次最优控制中全阶求解昂贵、线性降阶模型又受 Kolmogorov 宽度慢衰减限制的问题,本文把目标转为学习终端伴随态,并证明目标流形的慢宽度衰减会传递到伴随态流形。其核心做法是用 U-Net 直接从参数场预测终端伴随态,同时保留残差型后验误差估计用于认证;两个数值实验显示,相比线性 ROM 和若干非线性基线,U-Net 在更少训练样本下取得最高精度。

2026-07-15

27 篇
No Figure
2026-07-15math.OC

Online Control via Counterfactual Tracking

Yunzong Xu

University of Illinois Urbana-Champaign

2026-07-15视觉感知规划控制

本文针对在线控制长期受限于线性控制器、共享参数化和统一衰减假设的问题,提出反事实跟踪:先在已揭示历史上模拟任意因果策略的状态-输入轨迹,再聚合为移动参考并由固定稳定控制器跟踪,从而把物理遗憾分解为参考学习误差和跟踪误差。结果给出适用于一般可模拟策略类的 PAC-Bayes 遗憾界,有限 N 类达到 sqrt(T log N) 依赖,并首次覆盖无共同记忆或阶数约束的系统级响应球,且有匹配下界。

Ensemble Controlled-Flow Filtering for Implicit Data Assimilation Figure 1
2026-07-15stat.ML

Ensemble Controlled-Flow Filtering for Implicit Data Assimilation

Zhuoyuan Li, Yue Zhao, Ming Li

Institute for Functional Intelligent Materials, National University of Singapore, Singapore 117544, Singapore, School of Mathematical Sciences, Fudan University, Shanghai 200433, China

2026-07-15生成模型规划控制

本文针对传统集合滤波依赖高斯残差、可评估似然或沿路径似然梯度的问题,将数据同化分析步改写为对预测分布的能量倾斜,并用随机受控流实现该更新;无显式似然时,EnCF-LF 从模拟样本学习替代能量。理论上给出理想精确性、一步误差分解和稳定条件下误差不累积,实验显示其在非高斯、多模态、多对一和隐式观测中优于常规方法,但平滑加性高斯场景仍以 Kalman 类滤波更合适。

Strict complementarity in semidefinite programming, singularity degree, and the (dis)connection of forward and backward errors Figure 1
2026-07-15math.OC

Strict complementarity in semidefinite programming, singularity degree, and the (dis)connection of forward and backward errors

Gábor Pataki

Department of Statistics and Operations Research, University of North Carolina at Chapel Hill

2026-07-15优化控制

本文关注半定规划中严格互补失效时,求解器常用的约束残差为何不能可靠反映真实解误差。核心贡献是给出刻画严格互补缺失的正规形与生成算法,并分析奇异度等于约束数的条件。计算实验显示,在小规模 SDP 中前向误差可比后向误差大最多七个数量级,且有时二者反向相关,说明误差诊断会系统性失真。

No Figure
2026-07-15math.OC

Sharp Optimal Algorithm for Derivative-Free Stochastic Convex Optimization in One Dimension

Alexandra Carpentier, Chloé Rouyer, Alexandre Tsybakov, Arya Akhavan

Department of Statistics, University of Oxford, United Kingdom

2026-07-15优化算法

本文针对一维随机凸优化中只有带噪函数值、无梯度可用的零阶场景,解决已有算法相对1/√T下界仍多出对数因子的缺口。核心做法是提出基于几何网格的Splitting Algorithm,逐步缩小搜索区间并控制函数值范围,从而避免均匀网格带来的对数损失。结果给出高概率简单遗憾界,并在期望意义下达到最优O(1/√T),匹配已知下界。

Host-Parasitoid Dynamics and Biological Control of the Sugarcane Borer Figure 1
2026-07-15math.OC

Host-Parasitoid Dynamics and Biological Control of the Sugarcane Borer

Fredson Aguiar, M. Soledad Aronna, Roberto Guglielmi, Beatriz Laiate, Alexandre Molter

2026-07-15规划控制

针对甘蔗螟幼虫藏于茎内、化学防治效果有限的问题,本文建立同时覆盖卵期和幼虫期寄生蜂的六维宿主—寄生蜂模型,并用 Holling II 型响应刻画寄生饱和。分析显示在多组参数下害虫会超过经济损害阈值,因此比较最优控制、SDRE 反馈和脉冲释放;数值结果表明三者均能压低虫口,其中阈值触发的脉冲策略用蜂量更少,现场可操作性更强。

From Manifold Identification to Newton Acceleration on Intersections: Sparse Stiefel Optimization Figure 1
2026-07-15math.OC

From Manifold Identification to Newton Acceleration on Intersections: Sparse Stiefel Optimization

Shixiang Chen, Wen Huang

2026-07-15优化算法

针对稀疏 Stiefel 复合优化中,非光滑正则识别出的活动流形可能与 Stiefel 约束非横截、从而阻碍 Newton 加速的问题,论文从流形识别角度分析 ManPG 预测点,提出离对角扰动的 Stiefel 族与基于移动交集的 MIX 方法。其结果给出有限识别、clean-intersection 可验证条件、全局下降与 KKT 残差保证,并在相应二阶条件下证明局部超线性收敛;实验显示在压缩模态和稀疏 PCA 上效率提升且解质量保持。

No Figure
2026-07-15cs.GT

Quiz Show Games: Searching with Bimodal Hiding

Mingshi Yao, Thomas Lidbetter, Melike Baykal-Gürsoy

Department of Management Science and Information Systems, Rutgers University

2026-07-15优化控制

本文以侦察、核查和不可靠作业排序中的信息搜寻为动机,把经典 Quiz Show 排序问题改写为主持人分配奖金、选手选择顺序的零和博弈,用双模态隐藏刻画成功奖励与失败终止奖励的不确定性。主要结果是给出第一类模型的闭式均衡和值,将第二类化约到已有搜索博弈,并对第三类通过几何化的一般博弈证明部分结构性质,但完整解仍未得到。

No Figure
2026-07-15math.OC

Real and complex stability radii for a class of transport networks

Anthony Hastir, Birgit Jacob, Hannes Wagener

University of Wuppertal, School of Mathematics and Natural Sciences

2026-07-15优化控制

针对输运网络中边界受控、边界观测双曲 PDE 的稳定性鲁棒性分析,论文将原系统化为由边界矩阵决定的离散型判据,给出渐近稳定与指数稳定等价的条件,并推导实/复稳定半径的显式公式;同时借助对偶系统得到可控性与可观性的矩阵检验,结果以两个例子说明。

Learning-enabled Acceleration of Scenario-based Model Predictive Control Figure 1
2026-07-15math.OC

Learning-enabled Acceleration of Scenario-based Model Predictive Control

Trinh Tran, Binh Nguyen, Truong X. Nghiem

University of Central Florida, Orlando, FL 32816, USA.

2026-07-15规划控制

面向含负荷和可再生出力不确定性的实时场景 MPC,论文针对场景数和预测时域扩大导致在线求解过慢的问题,将 SBMPC 改写为共识 ADMM 形式,使场景与时间步上的原始更新可并行分解,并用 Moreau envelope/LEAF 学习近似局部更新以减少重复优化。微电网实验显示,相比 IPOPT 和 MadNLP 有明显运行时加速,同时保持较高解质量和闭环控制表现。

Tensor-Based Reduced-Order Modeling for Optimization-Based Inverse Problems Figure 1
2026-07-15math.NA

Tensor-Based Reduced-Order Modeling for Optimization-Based Inverse Problems

Sahidul Islam, Andreas Mang, Maxim Olshanskii

Department of Mathematics, University of Houston, Houston, TX 77204, USA ().

2026-07-15优化算法

针对参数化 PDE/ODE 反问题中高保真模型反复求解代价高、网格采样随参数维数爆炸的问题,本文把参数到观测映射直接压缩为 TT/TROM,并将低秩结构用于正则化最小二乘、降维 Gauss-Newton 组装和网格目标优化。热传导与 FitzHugh-Nagumo 实验显示,其在线成本显著低于全阶反演,且在噪声、高维和非凸初始化下更稳健;离线构造成本与网格依赖仍是主要限制。

Semismooth Newton methods for degenerate polyhedral projection Figure 1
2026-07-15math.OC

Semismooth Newton methods for degenerate polyhedral projection

Chao Ding, Fuxiaoyue Feng, Xudong Li

State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, P.R. China, School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing 100049, P.R. China, Institute of Applied Mathematics, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing, P.R. China

2026-07-15优化控制

本文针对退化多面体投影中对偶半光滑牛顿法常遇到的广义雅可比奇异问题,动机是避免靠正则化硬性修补失效的二阶步。核心洞察是利用对偶表示非唯一性,在提升的投影等价集合中选取极点代表,从几何上恢复可逆广义雅可比。论文据此给出局部超线性收敛的非精确算法和带 Wolfe 线搜索的全局化版本,并在正则化最优传输、电池调度可行性恢复等退化算例上显示鲁棒性。

A JoLT for the KV Cache: Near-Lossless KV Cache Compression via Joint Tucker and JL-Residual Allocation for LLMs Figure 1
2026-07-15cs.LG

A JoLT for the KV Cache: Near-Lossless KV Cache Compression via Joint Tucker and JL-Residual Allocation for LLMs

Rahul Krishnan, Volker Schulz

2026-07-15优化控制

长上下文推理中 KV cache 往往比模型权重更限制显存和吞吐,本文的动机是以尽量不损失质量的方式压缩缓存。核心洞察是 KV cache 的头和层轴几乎不可压,而 token 与 feature 轴冗余更大;JoLT 因此只在这两轴做部分 Tucker 分解,并用 JL 旋转低比特残差和拉格朗日分配联合决定秩与比特数。实验显示在 Mistral-7B 与 LLaMA-2-13B 上可实现约 2–3 倍近无损压缩,困惑度、GSM8K 和 RULER 基本贴近原始缓存,FlashJoLT 还带来 5–13 倍压缩时间加速。

No Figure
2026-07-15math.DG

Sard property for rank 2 polarizations in metabelian Lie groups

Enrico Le Donne, Antonio Lerario, Luca Nalon, Nicola Paddeu, Luca Rizzi

2026-07-15优化控制

围绕次黎曼几何中端点映射的 Sard 性质这一核心难题,本文研究二阶可解的 metabelian Lie 群上异常曲线集合的大小。关键做法是利用异常函数、导出子群不变性、树状等价与次解析几何来控制异常可达集的维数。主要结果证明秩 2 极化时异常集为 dim(G)-3 可整流,从而满足 Sard 性质;并对导出商余维至多 2 的情形给出 Goh 异常集同阶维数界,推出任意左不变次黎曼度量满足 minimizing Sard 性质。

Extension of the safeguarding stepsize interval in Adaptive Gradient Descent Figure 1
2026-07-15math.OC

Extension of the safeguarding stepsize interval in Adaptive Gradient Descent

Saneatsu Kagawa, Nobuo Yamashita

2026-07-15优化算法安全鲁棒

该文针对自适应梯度下降虽能在局部光滑凸优化中保证收敛、但难以利用 BB 步长加速的问题,提出可自适应给出并放宽的安全步长区间,将 BB 步长投影到该区间内以兼顾全局收敛与更激进更新。理论上证明扩展区间仍保收敛,实验比较显示与原 AdGD 相比可更频繁采用完整 BB 步长并带来收敛加速。

No Figure
2026-07-15math.OC

On the Singularity Degree of Shor Relaxations for 0-1 Programs

Hao Hu

Hao Hu 1 1 1 School of Mathematical and Statistical Sciences, Clemson University, Clemson, USA

2026-07-15优化控制

本文关注0-1二次规划的Shor半定松弛在不满足Slater条件时的面退化程度。核心洞察是约束形式决定奇异度:线性等式/不等式定义的非空二进制集合中,奇异度仅为0或1,且可由LP松弛是否含开立方内严格可行点判定,并可用LP恢复Slater条件;但允许二次等式后,作者构造出奇异度随矩阵阶数线性增长的例子。

Variable-Lattice-Density Optimization of Pin-Fin Heat Sinks under High-Reynolds-Number Flow Conditions Figure 1
2026-07-15math.OC

Variable-Lattice-Density Optimization of Pin-Fin Heat Sinks under High-Reynolds-Number Flow Conditions

Yoshikatsu Furusawa, Kunitaka Shintani, Shunsuke Hirotani, Kentaro Yaji

2026-07-15生成模型优化算法

面向高雷诺数强迫对流下针肋散热器难以在大设计空间内兼顾温度均匀性、压降与可制造性的问题,本文将变晶格密度优化扩展到周期圆柱针肋阵列:用单胞RANS识别渗透率和阻力系数,并以Darcy-Forchheimer降阶模型和双网格策略稳定优化。基准工况下温度偏差L2范数在降阶模型中由4.38 K降至1.00 K,几何解析验证由5.98 K降至1.17 K;但局部固体温差显著时热目标精度下降。

The regional control of a fractional spatio-temporal SIR model Figure 1
2026-07-15math.AP

The regional control of a fractional spatio-temporal SIR model

Sofwah Ahmad

Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, UAE

2026-07-15规划控制

论文针对疫情中全国性接种成本高、资源受限的问题,研究带分数阶空间扩散的 SIR 模型区域最优控制,把疫苗限定在选定子区域、治疗作用于感染者,并允许较一般传播项。主要贡献是证明模型全局强正解的存在唯一性、最优控制存在性及伴随系统最优性条件;数值结果表明,局部集中接种配合治疗可显著压低感染水平,但具体增益对区域选择和参数敏感。

No Figure
2026-07-15math.AP

Control and homogenization of a coupled hyperbolic system with an oscillating coefficient

Vaibhav Kumar Jena, Abu Sufian

Department of Mathematics, Indian Institute of Science, Indian Institute of Science Education and Research

2026-07-15规划控制

本文针对含快速振荡密度的耦合双曲系统,研究微结构尺度变化如何破坏边界控制下的统一可控性及其均匀化极限。核心做法是按谱的低频与高频分量分解问题,结合 Ingham-Beurling 不等式和谱间隙估计建立投影态的统一零可控,并证明边界控制在 ε→0 时弱收敛到均匀化系统的零控制;进一步说明若加入内部反馈控制,可在能量空间内实现全初值可控。

Structured Preconditioning in Affine-Invariant Geometry: Projection, Certificates, and Kronecker Separation Figure 1
2026-07-15math.OC

Structured Preconditioning in Affine-Invariant Geometry: Projection, Certificates, and Kronecker Separation

Zavier Li

Xidian University, Xi’an, China

2026-07-15优化控制

这篇论文关注结构化预条件器中“离目标矩阵最近”和“使 Hessian 相对条件数最优”是否等价的问题,尤其针对 Kronecker 正定矩阵在仿射不变几何下的情形。核心洞察是用极端谱态的张量边缘分布刻画二者何时一致,并给出可计算的边缘失配残差与下降证书。主要结果包括唯一 AIRM 投影、偏迹正规方程、误差证书、二维情形必然最优,以及 2×3 维度下的最小严格分离例子。

Revisiting Simultaneous Methods for Dynamic Optimization in the GPU Era Figure 1
2026-07-15math.OC

Revisiting Simultaneous Methods for Dynamic Optimization in the GPU Era

Joseph W. Choi, Sungho Shin

a Massachusetts Institute of Technology, Department of Chemical Engineering, Cambridge, Massachusetts, USA

2026-07-15优化算法

本文动机是重新评估 GPU 时代动态优化中序贯法与同时法的取舍:序贯法适合刚性系统但时间推进难并行,同时法可把离散 DAE 转成大规模稀疏 NLP。核心工作是构建 GPU 兼容的 ExaModelsPEtab.jl,并利用 SIMD 自动微分与 GPU 稀疏线性代数处理 PEtab 参数估计基准。结果显示同时法可靠性较弱,但在双方成功的大实例上最高比序贯基线快 5.4 倍,且规模增益在 GPU 上更明显。

Designing Hierarchical Hub-and-Spoke Drone-Based Networks for Delivering Time-Sensitive Healthcare Items Figure 1
2026-07-15math.OC

Designing Hierarchical Hub-and-Spoke Drone-Based Networks for Delivering Time-Sensitive Healthcare Items

Sayed Hamid Hosseini Dolatabadi, Tanveer Hossain Bhuiyan, Bo Zeng, J. Tyler Kennedy, Brian O Neill

Department of Mechanical, Aerospace, and Industrial Engineering, The University of Texas at San Antonio, TX, USA., Department of Industrial Engineering, University of Pittsburgh, PA, USA., Interpath Laboratory, Inc., Pendleton, OR, USA., San Antonio Fire Department, TX, USA.

2026-07-15优化控制

面向全血、疫苗等有严格释放与截止时间的医疗配送,论文将问题建模为分层枢纽—辐射式无人机网络,联合决定移动目的地分配、异构机队路径与调度,并考虑多次飞行和电池约束。作者提出含问题重构与动态割的精确算法及快速启发式;在俄勒冈真实全血案例和飞行测试数据上,分别比 Gurobi 快 31 倍和 3375 倍,多次飞行相对单次飞行降低成本 142.8%。

LQG solution for POMDP without estimating states: A minimum variance approach Figure 1
2026-07-15math.OC

LQG solution for POMDP without estimating states: A minimum variance approach

Ranjan Sarkar, Prabhat K. Mishra

2026-07-15优化控制

本文针对部分可观测、测量受噪声污染的离散 LTI 系统中传统“先估计状态再控制”的分离式 LQG 流程可能受限的问题,提出不显式估计状态的控制合成思路:先计算 LQR 增益,再利用最小方差对偶把当前控制表示为历史观测和已施加输入的线性函数,从而转化为确定性优化问题。文中给出定理推导,并通过数值实验展示该方法在该类 POMDP 控制中的可行性。

No Figure
2026-07-15math.OC

The Certification Limits of KS-Type Layer Relaxations: A Square-Root Ceiling and Its Breakdown

Guillaume Lecomte

2026-07-15优化控制

本文关注KS型分层松弛在全局优化中究竟能证明多强的尺寸界,动机来自Lennard-Jones簇直径认证的精度瓶颈。核心洞察是仅凭有效性、单层代价阈值和低能见证构型,就能推出与具体核函数和层代价形状无关的平方根上限。主要结果表明当γ>-1/2时可认证缺口至多为O(√N),端点和更低γ区间则出现线性缺口或完全失效的分段现象。

Body-fitted tracking of 2d open curves with a level set based mesh evolution method Figure 1
2026-07-15math.OC

Body-fitted tracking of 2d open curves with a level set based mesh evolution method

Charles Dapogny

2026-07-15视觉感知

针对开放曲线在大变形、端点运动和力学计算中难以兼顾鲁棒表示与贴体精度的问题,论文提出将显式网格边集合与双水平集隐式表示耦合的演化方法,在两种表示间重构以支持几何/力学量计算。实验展示其可模拟涡片卷起,并用于各向异性长度优化、增材制造激光路径优化和裂缝重建,但三维扩展与拓扑变化处理仍文中未充分说明。

Exact Solutions to a Class of Constrained Optimal Control Problems via Lossless Convexification for Digital Control Figure 1
2026-07-15math.OC

Exact Solutions to a Class of Constrained Optimal Control Problems via Lossless Convexification for Digital Control

Vaibhav Upadhyay, Siddhartha Ganguly, Debasish Chatterjee

Centre for Systems and Control, Indian Institute of Technology Bombay, India, Daniel Guggenheim School of Aerospace Engineering, Georgia Institute of Technology, Atlanta, USA

2026-07-15规划控制优化算法

这篇论文面向带环形控制幅值约束的连续时间线性最优控制问题,动机是常规离散化方法可能保留非凸性且漏检采样间约束违背。核心做法是将无损凸化与分段常值数字控制参数化结合,并把全时域路径约束表述为可精确求解的凸半无限规划。结果声称可恢复原问题精确解并保证不可数时间点约束满足,在三自由度航天器着陆案例中展示了可发现传统节点约束方法遗漏的不可行性,但代价是计算量较高,主要适合离线轨迹生成。

A Non-Commutative Voronovskaya Theorem for Quantum Neural Network Operators Figure 1
2026-07-15quant-ph

A Non-Commutative Voronovskaya Theorem for Quantum Neural Network Operators

Rômulo Damasclin Chaves dos Santos, Delvonei Alves de Andrade

Nuclear Engineering Center, Institute of Energy and Nuclear Research, São Paulo, Brazil

2026-07-15优化控制

针对量子神经网络算子虽可逼近任意量子信道、但缺少精细误差理论的问题,论文把经典 Voronovskaya 渐近展开推广到非交换量子场景。核心洞察是误差可分解为 Fréchet 导数项、Marchaud 分数阶光滑性项和纯量子对易子项,并给出 diamond 范数余项界;进一步推出量子中心极限定理、信道测地插值和 Richardson 外推框架,但数值验证主要是经典类比,量子实验支撑文中未充分说明。

2026-07-14

61 篇
Optimal Parameter-Free First-Order Methods for Convex Optimization with Unknown Growth and Smoothness Figure 1
2026-07-14math.OC

Optimal Parameter-Free First-Order Methods for Convex Optimization with Unknown Growth and Smoothness

Liwei Jiang, Ke Tang, Zhe Zhang

Edwardson School of Industrial Engineering, Purdue University

2026-07-14优化算法

这篇论文针对凸优化中常见但棘手的设定:目标函数的增长条件、光滑性类型及相关常数都未知,传统最优一阶法往往需要预先给定这些参数。作者的核心创新是用仿射 W-certificate 将 bundle 模型的几何信息转化为最优性间隙证书,并据此构造 BLW 与加速版 A-BLW。结果表明,方法在非光滑二次增长、Hölder 光滑及更一般 Hölder 增长情形下,无需目标精度和问题参数即可达到已知最优或最佳复杂度阶。

Stabilize-then-optimize: Feedback transformations as preconditioners in optimal control Figure 1
2026-07-14math.OC

Stabilize-then-optimize: Feedback transformations as preconditioners in optimal control

Till Preuster, Manuel Schaller, Anton Schiela, Martin Stoll

JUNIOR PROFESSORSHIP NUMERICAL MATHEMATICS, FACULTY OF MATHEMATICS, CHEMNITZ UNIVERSITY OF TECHNOL-, Code availability. The code for all numerical experiments presented in this work is available in the reposi-

2026-07-14规划控制

本文针对 PDE/ODE 最优控制中控制到状态算子范数过大导致凝聚梯度法和预条件共轭梯度法收敛变差的问题,提出先用状态反馈等价改写约束、再求解优化问题的思路。核心洞察是把反馈稳定化视作预条件器,构造 K 使变换后解算子范数显著降低,从而改善条件数。文中给出椭圆、抛物、双曲问题的构造方法,并用多类数值实验显示迭代次数和误差收敛均明显改善。

Sparse Robust Optimal Control in Continuous-Time: A Computationally Viable Approach Figure 1
2026-07-14math.OC

Sparse Robust Optimal Control in Continuous-Time: A Computationally Viable Approach

Siddhartha Ganguly, Ashwin Aravind, Souvik Das, Masaaki Nagahara, Debasish Chatterjee

2026-07-14规划控制安全鲁棒

这篇论文针对连续时间稀疏控制在存在过程噪声、参数不确定性和硬约束时难以同时保证鲁棒可行与可计算的问题,将有限参数化后的 L1 稀疏最优控制表述为凸半无限规划。核心创新是构造无保守性的有限约束替代问题,可精确恢复原问题最优值和优化器,并保证全时域、全扰动约束满足;数值例子和最小注意力控制场景展示了算法可行性。

Representing the Non-dominated Set of Multi-objective Network Problems by Supported Non-dominated Points Figure 1
2026-07-14cs.DM

Representing the Non-dominated Set of Multi-objective Network Problems by Supported Non-dominated Points

David Könen, Lara Löhken, Michael Stiglmayr

University of Wuppertal, School of Mathematics and Natural Sciences, Optimization Group

2026-07-14优化控制

针对多目标网络优化中完整非支配集难以生成、而实际只需少量备选解的问题,本文检验仅用 supported 非支配点表示 Pareto 集是否可靠。核心洞察是,极端 supported 点在容量网络上会随弧容量增大而失效,但全部 supported 点仍能在多种指标下保持高质量;进一步将其作为固定规模子集选择的候选集,实验显示质量接近从完整非支配集中选择,显著降低对全量生成的依赖。

Paradoxes of Game Theoretic Equilibria and Price of Anarchy Figure 1
2026-07-14cs.GT

Paradoxes of Game Theoretic Equilibria and Price of Anarchy

Georgios Piliouras, Ian Gemp, Siqi Liu, Luke Marris

2026-07-14优化控制

本文针对多智能体学习中静态均衡与无悔分析被用作性能代理的局限,指出这会丢失底层动态向量场信息。核心洞察是许多最坏情形均衡并非学习动力学会到达的稳定状态,而可能是严格鞍点、全局排斥子或由严格劣策略支撑。文中进一步证明仿射拥塞博弈中 PoA 可变为无界,CCE/PCE/SCE 仍可容纳非理性行为,无交换遗憾也可能伴随混沌与指数级低效。

Time-Lag-Aware Deep Reinforcement Learning for Flexible Job-Shop Scheduling in PPVC Module Factories Figure 1
2026-07-14cs.LG

Time-Lag-Aware Deep Reinforcement Learning for Flexible Job-Shop Scheduling in PPVC Module Factories

Ziheng Zhang, Wei Zhang

with the Singapore Institute of Technology, Singapore (e-mail:

2026-07-14强化学习

这篇论文针对PPVC模块工厂中混凝土养护、蓄水测试、油漆干燥等长时间滞后会显著改变柔性作业车间调度的问题,指出事后修补滞后不可行。作者在DANIEL强化学习调度器上加入滞后感知状态转移、奖励界和类型特征等可消融改动,并构建BCA指南驱动基准。实验显示其无求解器策略优于派工规则和遗传算法,平均距CP-SAT参考约3.8%至4%,但精确求解器仍是质量上限。

Contextual Stochastic Optimization with Decision-Dependent Uncertainty via Nonparametric Learning Figure 1
2026-07-14math.OC

Contextual Stochastic Optimization with Decision-Dependent Uncertainty via Nonparametric Learning

Huangrong Sun, Xian Yu

The Ohio State University, Columbus, OH (USA)

2026-07-14优化算法安全鲁棒

本文针对决策本身会改变不确定性分布的情境随机优化问题,动机来自定价报童和设施选址等场景中需求同时受环境特征与决策影响。核心做法是把 kNN、CART、ReLU 网络等非参数预测器嵌入经验残差式决策依赖 SAA,并给出精确 MIP 表示及面向 kNN 两阶段问题的 BD-CG 分解算法。理论上证明一致性、渐近最优性和算法有限收敛,实验显示其样本外表现优于参数基线且计算可处理性提升。

Uniform controllability for the wave equation with large potential Figure 1
2026-07-14math.AP

Uniform controllability for the wave equation with large potential

Arthur Yax (LMO)

Uniform controllability for the wave equation with large potential, Wave equation, Half-wave equations, Observability, Controllability, Semiclassical and microlocal anal-, ∗Laboratoire de Mathématiques d’Orsay, Université Paris-Saclay, CNRS, Bâtiment 307, 91405 Orsay Cedex France, email:, nonnegative function bω P C 0pM, ℝ`q, we study the controllability in time T ą 0 from ω of the wave, • We say that we have exact controllability in time T ą 0 from ω of (1.1) if for any initial conditions, • We say that we have null-controllability in time T ą 0 from ω of (1.1) if for any initial conditions, controllability of (1.1) and the exact controllability of (1.1) are equivalent., controllability of (1.1) is equivalent to establishing an observability inequality for the dual equation

2026-07-14规划控制

本文关注带大参数势能 λV 的紧致流形波方程中,控制代价如何随 λ 增长而变化这一问题。核心洞察是势能会改变传统几何控制条件,作者提出依赖 V 的 (GCC^+_V),并证明它恰好刻画 λ→∞ 时一致可观测、等价一致可控的充要条件;若条件失效,还给出观测代价爆炸率估计。

Lecture Notes: Convex Optimization Figure 1
2026-07-14math.OC

Lecture Notes: Convex Optimization

Andreas Habring

Graz University of Technology, Institute of Visual Computing

2026-07-14优化算法

这份讲义面向需要系统掌握凸优化基础与算法的读者,动机是把范数空间、凸性、次梯度等数学工具串联到可操作的优化方法中。核心洞察是用次梯度、近端算子、对偶性统一解释非光滑、约束和复合问题,并延伸到加速、ADMM、随机梯度与最优传输。主要结果是给出关键定义、收敛论证和典型算法框架;文中未充分说明新的实证增益,性质更接近课程笔记而非原创研究论文。

Any Proof of Polynomial Hirsch Must be Completely Incoherent Figure 1
2026-07-14math.CO

Any Proof of Polynomial Hirsch Must be Completely Incoherent

Alexander E. Black, Lei Xue

Department of Mathematics, Bowdoin College, Department of Mathematics, Colby College

2026-07-14优化控制

本文从多面体图上的多项式 Hirsch 问题及其与单纯形法的关系出发,考察“相干单调路径”这一由参数线性优化和 fiber polytope 理论刻画的受限路径类。核心洞察是,相干性虽能捕捉单调路径空间的拓扑,却不保证存在短路径;作者构造一族多面体和线性目标,证明每条相干单调路径都至少为指数长度,从而否定相干版本的多项式 Hirsch 期望,并强化影子单纯形法、几何横截线和参数线性优化的下界。

On the Policy Convergence of Policy Mirror Descent Methods Figure 1
2026-07-14math.OC

On the Policy Convergence of Policy Mirror Descent Methods

Wenye Li, Ke Wei

School of Data Science, Fudan University, Shanghai, China.

2026-07-14强化学习学习理论

本文针对 PMD 研究中“价值收敛不等于策略收敛”的缺口,分析有限折扣 MDP 下非正则化策略镜像下降的策略轨迹。核心洞察是将可分解镜像映射的边界可微性与收敛形态联系起来,统一覆盖 PQA、softmax NPG、Tsallis 等情形;主要结果证明任意常数步长下策略收敛到某个最优策略,并给出有限终止、渐近收敛及局部收敛率刻画。

WarpMPC: Large-Batch MPC on GPU via ADMM with Unrolled $LDL^\top$ Factorization Figure 1
2026-07-14cs.RO

WarpMPC: Large-Batch MPC on GPU via ADMM with Unrolled $LDL^\top$ Factorization

Henrik Hose, Se Hwan Jeon, Charles Khazoom, Sangbae Kim, Sebastian Trimpe

2026-07-14规划控制

面向机器人学习中需要一次性求解上万到十万级 MPC 的瓶颈,WarpMPC 利用批内问题共享时间、代价和约束稀疏结构这一洞察,在 GPU 上将 ADMM 中占主导的稀疏 LDL^T 分解与回代展开为定制内核,并配合内存布局、分段和依赖层调度优化。其在 cartpole、四旋翼和人形机器人非线性 MPC 上达到每秒 8000 至 250000 次 SQP 迭代,较基线快 3 至 25 倍,并用其生成数据训练出可在纳米四旋翼硬件上稳定控制的近似 MPC 网络。

Scenario Reduction for Two-Stage Stochastic Mixed-Integer Programs Figure 1
2026-07-14math.OC

Scenario Reduction for Two-Stage Stochastic Mixed-Integer Programs

Yannick Werner, Juan Miguel Morales, Salvador Pineda, Line Roald, Sonja Wogrin

aGraz University of Technology, Graz, Austria, bUniversity of Málaga, Málaga, Spain, cUniversity of Wisconsin-Madison, Madison, USA, small mixed-integer (Zhuang et al., 2025) programs, thereby limiting evaluation of scalability and

2026-07-14优化控制

面向两阶段随机混合整数规划中场景过多导致求解困难的问题,本文从最优质量运输视角重新比较多种场景缩减代价函数,并提出结合优化问题结构的新代价函数及带预筛选的混合算法。其关键洞察是让场景距离直接反映一阶段决策近似误差,而非仅匹配输入数据;在随机机组组合算例中,约5个场景即可接近全分布最优,大规模案例误差约0.4%,混合算法还将耗时降低约18倍。

The Lorentzian Problem on the Group $SU(2)$ Figure 1
2026-07-14math.DG

The Lorentzian Problem on the Group $SU(2)$

A.Z. Ali, Yu.L. Sachkov

2026-07-14优化控制

本文研究 SU(2) 上带洛伦兹度量约束的左不变最优控制问题,动机是刻画紧李群中类时轨迹的可达性与最优性结构。核心洞察是利用李代数生成条件、周期类时轨迹和 Pontryagin 极大值原理分析极值曲线。主要结果表明系统完全可控,但因存在可重复绕行的正长度周期轨迹,全局最长曲线不存在,并进一步推导正常极值与若干时间判别关系;判断受限于 PDF 文本抽取质量。

Copositive Characterizations of Convex Hull Pricing Figure 1
2026-07-14math.OC

Copositive Characterizations of Convex Hull Pricing

Madhusudan Ghosh, Antoine Lesage-Landry, Joshua Adam Taylor

2026-07-14优化算法

针对机组组合中的二进制约束导致统一电价难以同时清算市场并减少 uplift 的问题,本文把凸包定价与共正对偶定价放到同一价值函数框架下,提出基于联合可行域的集中式凸包价格。主要结果表明,在非退化且价值函数可微时,两类价格一致;在切换点可能不同但共享子梯度,并用 Scarf 示例验证等价性及 SDP 限制造成的定价缺口。

A Twin gradient method for unconstrained optimization Figure 1
2026-07-14math.NA

A Twin gradient method for unconstrained optimization

Anna De Magistris, Michiel E. Hochstenbach, Gerardo Toraldo

Department of Mathematics and Physics, University of Campania “Luigi Vanvitelli”, Viale Lincoln 5, 81100 Caserta, Italy, Department of Mathematics and Computer Science, Eindhoven University of Technology, PO Box 513, 5600 MB Eindhoven, The Netherlands

2026-07-14优化算法

针对传统最速下降在病态无约束优化中易之字震荡、步长选择依赖单一路径历史的问题,论文提出 Twin Gradient:并行维护两条梯度迭代轨迹,通过最小化下一步两轨迹间欧氏距离来耦合步长。分析指出收敛效果受搜索方向夹角控制,近共线会失效,因此设计 Twin-ABBmin 混合策略,在几何协作停滞时切换到 ABBmin;数值结果显示 Twin 阶段可为后续 BB 类迭代提供更有利初始状态。

First-Order Methods for Distributionally Robust Constrained Optimization Figure 1
2026-07-14math.OC

First-Order Methods for Distributionally Robust Constrained Optimization

Hubert Villuendas, Mathieu Besançon, Jérôme Malick

2026-07-14优化算法安全鲁棒

本文针对经验风险最小化在样本有限或噪声场景下易过拟合、且 Wasserstein 分布鲁棒约束优化难以数值求解的问题,提出用熵正则平滑鲁棒值函数,并以蒙特卡洛梯度估计结合随机 Frank-Wolfe 处理复杂约束。结果在二次最小生成树和交通分配中展示了相对 ERM 的鲁棒性收益,但实验规模与增益来源仍需结合更多任务验证。

Robust sensor coverage in the presence of spatial obstacles and exclusion zones Figure 1
2026-07-14math.OC

Robust sensor coverage in the presence of spatial obstacles and exclusion zones

Vanshika Datta, C. Nahak

Department of Mathematics, Indian Institute of Technology Kharagpur, Kharagpur, West Bengal, India-721302

2026-07-14安全鲁棒

针对无人/空中定向传感网络在障碍遮挡、禁入区和定位扰动下覆盖易失效的问题,论文把扇区感知、可见性裁剪、网格化覆盖与鲁棒可行半径统一建模,并依次提出网格覆盖、目标覆盖和目标休眠调度策略。仿真显示其在不同目标、障碍、不确定性和传感器失效设置下提升覆盖质量与目标监测,同时减少活跃传感器数量。

Inter-Stop Energy Prediction and Causal Driver Quantification for Dual-Source Trolleybuses via a Time-Aware Tabular Deep Learning Architecture Figure 1
2026-07-14math.OC

Inter-Stop Energy Prediction and Causal Driver Quantification for Dual-Source Trolleybuses via a Time-Aware Tabular Deep Learning Architecture

Wentao Zeng (1 and 2), Zijian Huang (3), Yiming Bie (4), Jiabin Wu (1), Jun Gong (5) ((1) School of Management, Foshan University, Foshan, China a School of Management, China (2) School of Mechanical and Electrical Engineering and Automation, China (3) School of Artificial Intelligence, South China Normal University, Guangzhou, China (4) School of Transportation, Jilin University, Changchun, China (5) Department of Civil Engineering, The University of Hong Kong, Hong Kong, China)

a School of Management, Foshan University, Foshan 528000, China, b School of Mechanical and Electrical Engineering and Automation, Foshan University, Foshan 528225, c School of Artificial Intelligence, South China Normal University, Guangzhou 510631, China, d School of Transportation, Jilin University, Changchun 130022, China, e Department of Civil Engineering, The University of Hong Kong, Hong Kong 999077, China

2026-07-14优化控制

面向双源无轨电车在接触网与电池供电间切换导致的区间能耗建模难题,论文提出将 Time2Vec 周期时间编码嵌入 TabM 表格深度网络,并结合 TPE 贝叶斯调参与 SHAP、DirectLiNGAM、T-Learner 的因果解释链。苏黎世数据实验达到 MAPE 6.52%、R² 0.982,优于十类基线;结果显示再生制动比例和平均速度是主要节能杠杆,滑行距离反而推高能耗。

Learning to control switching nonlinear systems with Koopman operator regression Figure 1
2026-07-14math.OC

Learning to control switching nonlinear systems with Koopman operator regression

Edoardo Caldarelli, Oleksii Kachaiev, Cesare Molinari, Lorenzo Rosasco

MaLGa center, DIMA, Università degli Studi di Genova, Genoa, Italy, MaLGa center, DIBRIS, Università degli Studi di Genova, Genoa, Italy

2026-07-14规划控制

针对有限动作下非线性系统难以直接做闭环最优控制的问题,论文将每个离散控制对应为一个 Koopman 算子,在 RKHS 中用非参数回归学习线性切换预测模型,并嵌入带时变阶段代价的无限时域 MPC。主要结果是给出 Koopman 近似学习率与 MPC 次优性界,含精确模型和有限数据学习模型两种情形,并用 Duffing 振子仿真验证理论趋势。

Minimizing Benchmark-Relative Drawdown Duration via Occupation Time Penalization Figure 1
2026-07-14q-fin.MF

Minimizing Benchmark-Relative Drawdown Duration via Occupation Time Penalization

Jun Sekine, Marcus Wunsch

2026-07-14数据集/基准

本文针对主动投资中只看跟踪误差幅度而忽视“跑输基准持续多久”的问题,提出以占用时间惩罚刻画相对基准回撤持续期。核心洞察是虽有运行最大值带来的路径依赖,问题仍可化为一维马尔可夫控制,并得到HJB、投影式最优反馈控制、验证定理及闭环反射扩散强解存在的几何条件。

Optimal Control of Pandemic Dynamics via Model Predictive Control: A Health-Economic Trade-off Analysis Figure 1
2026-07-14math.OC

Optimal Control of Pandemic Dynamics via Model Predictive Control: A Health-Economic Trade-off Analysis

Lokman Rachid Melhani, Lars Grune, Antonino Sferlazza, Dominique Persano Adorno, Filippo D'Ippolito, Alberto Firenze

Department of Engineering, University of Palermo, Palermo, Italy, Department of Mathematics, University of Bayreuth, Bayreuth, Germany, Department of Internal Medicine “Promise”, University of Palermo

2026-07-14规划控制

本文把疫情治理从静态预测转为反馈控制问题,动机是同时约束医疗挤兑与经济停摆。核心做法是在扩展 SEIR-V 模型上构建经济型 MPC,联合调节社交接触率与接种率,并用 turnpike 分析解释策略结构。仿真显示 35 天预测窗成本最低,最优轨迹自然呈现先强压制、再逐步开放的“锤子与舞蹈”,但权重设定下的健康—经济取舍仍需谨慎解读。

An augmented Lagrangian algorithm for constrained nonlinear least-squares Figure 1
2026-07-14math.OC

An augmented Lagrangian algorithm for constrained nonlinear least-squares

Pierre Borie, Fabian Bastin, Stéphane Dellacherie

Pierre Borie 1 1 1 Université de Montréal, Department of Computer Science and Operations Research, Montreal, QC, Canada

2026-07-14优化控制

针对带非线性等式、线性等式与边界约束的非线性最小二乘问题,论文动机是利用最小二乘 Hessian 结构同时保持约束处理效率。其核心做法是在增广拉格朗日框架下直接保留线性约束,用梯度投影近似求解子问题,并以结构化 SR1/拟牛顿方式近似增广拉格朗日 Hessian。文中证明全局收敛,并通过数值实验评估性能,但相对增益来源仍需结合具体实验设置判断。

Modular Autonomous Transit: From Vehicle Modularity to Deployment-Ready Transit Operations Figure 1
2026-07-14math.OC

Modular Autonomous Transit: From Vehicle Modularity to Deployment-Ready Transit Operations

Dongyang Xia, Shadi Sharif Azadeh

2026-07-14优化控制

这篇政策简报面向模块化自动驾驶公交从车辆概念走向可部署运营的问题,核心洞察是模块化价值不只在车辆可耦合,而在需求不确定、跨线路调度、实时重排与充电约束下的一体化优化。北京线路和子网络案例显示,站点级耦合/解耦可减少约46% MAU、降本约19%,跨线灵活运营在大实例中将需求从96个单元降至69个,全天电动运行还需联合规划快充站与车辆排班。

Weak Observability Characterization for Abstract Wave Equations Figure 1
2026-07-14math.OC

Weak Observability Characterization for Abstract Wave Equations

Nisrine Charaf, Faouzi Triki

†Laboratoire Jean Kuntzmann, UMR CNRS 5224, ‡Laboratoire Jean Kuntzmann, UMR CNRS 5224

2026-07-14优化控制

本文面向波动方程等无限维演化系统中由部分观测恢复初始态的弱可观测性问题,动机在于为病态反问题给出可检验的频域判据。核心洞察是把观测算子的谱强制性与椭圆算子A0的预解式估计联系起来,证明后者可推出演化生成元A的Hautus型谱可观测估计,并进一步保证弱可观测性;应用上给出矩形区域波方程在多种观测几何下的显式弱边界可观测估计。

The optimal rate of convergence in mean field control via recoupled shadow flows Figure 1
2026-07-14math.OC

The optimal rate of convergence in mean field control via recoupled shadow flows

Sebastian Munoz

Department of Mathematics, University of California, Los Angeles

2026-07-14生成模型规划控制学习理论

本文针对平均场控制中有限粒子值函数逼近极限值函数的 sharp 收敛率问题,动机是弥合已有上界与经验测度误差率之间的差距。核心做法是从每个 N 粒子控制构造路径级 Fokker–Planck “shadow flow”,并用最优传输反复重耦合,使其以经验测度率跟踪粒子系统。主要结果是在仅 Wasserstein-1 Lipschitz 成本下证明一致收敛率,d≥2 时达到最优,并去除半凹性假设;一维还给出合作粒子优于经验测度基准的 4/7 指数。

Last-Iterate Convergence of Single-Loop Stochastic Methods for Constrained Convex-Concave Minimax Problems Figure 1
2026-07-14math.OC

Last-Iterate Convergence of Single-Loop Stochastic Methods for Constrained Convex-Concave Minimax Problems

Taoli Zheng, Jiajin Li, Anthony Man-Cho So

2026-07-14优化算法学习理论

本文针对随机凸凹极小极大问题中末次迭代易被噪声破坏、普通 S-EG/S-OGDA 甚至在双线性情形下不收敛的问题,提出用小二次扰动将问题正则化为强凸强凹,再运行单循环的 PS-EG/PS-OGDA。核心洞察是平衡扰动带来的收缩稳定性与近似偏差,并把到扰动鞍点的距离界转化为受限原始-对偶间隙。结果给出已知时域下 O(T^-1/4) 末次迭代率,未知时域下一般约束集 O(T^-1/5),无约束 PS-EG 可达 O(T^-1/4) 梯度范数率。

Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies Figure 1
2026-07-14math.OC

Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies

Ziheng Cheng, Xin Guo, Huyên Pham, Yufei Zhang

2026-07-14规划控制

本文面向连续时间扩展平均场控制中状态与控制分布共同影响动力学和收益、传统随机核优化困难的问题,提出确定性反馈策略下的模型无关 actor-critic 框架。核心在于用状态律的推前刻画状态-动作分布,推导含 Wasserstein 优势率、局部值函数及控制分布测度导数的策略梯度,并据此构造粒子近似和时序差分学习算法。在 Cucker-Smale 共识控制和含交易拥挤的最优清算实验中,方法表现出较好的效率、稳定性和鲁棒性。

Real-Time Rulebook-Aware Nonlinear MPC for Autonomous Driving with Priority-Biased Tiered Slacks Figure 1
2026-07-14cs.RO

Real-Time Rulebook-Aware Nonlinear MPC for Autonomous Driving with Priority-Biased Tiered Slacks

Hadi Hajieghrary, Benedikt Walter, Chaitanya Shinde, Paul Schmitt, Miguel Hurtado

2026-07-14规划控制

这篇论文针对自动驾驶规划中安全、法规、舒适和效率约束冲突且需可审计的问题,提出 W-SQP:将九类驾驶规则编译为四层共享松弛的非线性 MPC,用分层惩罚偏向保留高优先级规则,并逐周期记录规则残差。其还指出闭环评测中轨迹日志耦合指标会混淆“开得好”和“像人类日志”。在 150 个 WOMD 场景中,W-SQP 在日志无关安全/法规规则上相对专家回放无系统性组级劣势,但在高分歧困难场景存在局部退化,且并非形式安全或硬实时控制器。

WSqD: A Horizon-Free Learning Rate Schedule for Large Model Training Figure 1
2026-07-14cs.LG

WSqD: A Horizon-Free Learning Rate Schedule for Large Model Training

Jianhao Ma, Yuxin Chen

University of Pennsylvania

2026-07-14优化控制

本文针对大模型训练常需事后延长训练周期、而余弦退火和 WSD 仍依赖固定 horizon 或需重调峰值学习率的问题,提出 WSqD:用带平移的反平方根基学习率替代 WSD 的恒定阶段,并保留末端线性冷却。其核心洞察是把 horizon 依赖推迟到最终冷却时机,在随机凸优化中给出最优末迭代收敛率;SlimPajama 预训练实验显示,单一峰值学习率可在多个训练长度上匹配或优于调参后的 WSD。

Stochastic Dynamic Barrier Perturbed Gradient Methods for Nonconvex Simple Bilevel Optimization Figure 1
2026-07-14math.OC

Stochastic Dynamic Barrier Perturbed Gradient Methods for Nonconvex Simple Bilevel Optimization

Mohammad Mahdi Ahmadi, Jincheng Cao, Aryan Mokhtari, Erfan Yazdandoost Hamedani

Department of Systems and Industrial Engineering, The University of Arizona, Tucson, AZ, USA.

2026-07-14优化算法

本文针对随机非凸-非凸简单双层优化中下层驻点附近对偶乘子发散、随机梯度估计不稳定的问题,提出在动态屏障梯度中加入分母扰动的 SDBPG,并用惩罚正则与方差缩减去除罕见访问假设、降低样本复杂度。主要结果是在单循环一阶框架下给出联合 εf、εg 驻点保证,SDBPG 迭代复杂度为 O(max{εf^-2,εg^-2}),并给出上、下层显式样本复杂度。

Streaming Contraction Certificates for Nonlinear Networks: Topology-Aware Data Sufficiency with Partial Observation Figure 1
2026-07-14eess.SY

Streaming Contraction Certificates for Nonlinear Networks: Topology-Aware Data Sufficiency with Partial Observation

Faegheh K. Moazeni

The author is with the Civil and Environmental Engineering Department at Lehigh University, Bethlehem, PA 18015, USA.

2026-07-14优化控制

面向电网、水网、交通等非线性网络在扰动下只能获得部分流式观测的场景,论文关注何时已有数据足以安全部署控制。其核心是用滑动窗口积分回归递推估计收缩率,并加入数据相关不确定半径形成保守证书,同时把已知拓扑作为雅可比零约束以降低样本需求。五节点仿真中证书在2.6秒、130个样本后触发,比离线批方法早17秒;拓扑约束将认证时间降约59%、扰动代价降约58%,但结果仍主要来自小规模仿真验证。

Stellar Observation Scheduling Optimization for Distributed Space Interferometry Missions Figure 1
2026-07-14astro-ph.EP

Stellar Observation Scheduling Optimization for Distributed Space Interferometry Missions

Ethan Foss, Antonio Rizza, Simone D'Amico

Ph.D. Candidate, Aeronautics and Astronautics, Stanford University., PostDoctoral Scholar, Aeronautics and Astronautics, Stanford University., Associate Professor, Aeronautics and Astronautics, Stanford University.

2026-07-14优化算法

面向低成本近地编队空间干涉仪的系外行星观测任务,论文关注如何在燃料消耗与科学收益之间做调度取舍。其核心做法是把可观测性、任务操作约束、目标科学权重和相对轨道要素简化纳入多目标动态规划,生成全局 Pareto 最优观测策略;主要结果是给出适用于分布式空间望远镜的燃料-收益权衡前沿,但具体相对既有退火调度的量化增益文中未充分说明。

Singular perturbations and hierarchical learning in two-layer neural networks Figure 1
2026-07-14cs.LG

Singular perturbations and hierarchical learning in two-layer neural networks

Cédric Gerbelot, Jean-Christophe Mourrat

2026-07-14优化控制

这篇论文针对两层神经网络中联合训练动态难以刻画的问题,研究无限宽网络在高维单指标模型上的 population gradient flow。核心创新是用奇异摄动流的定量近似框架,严格分析不同层训练速度分离下的层级学习。结果证明常数和线性分量会在预测时间尺度内、以尖锐阈值被恢复,并指出二次分量开始学习时,早期已学分量仍显著影响动力学,不能简单忽略。

Optimization on Affine-Transversal Hilbert Submanifolds: Part I -- Theoretical Foundations Figure 1
2026-07-14math.OC

Optimization on Affine-Transversal Hilbert Submanifolds: Part I -- Theoretical Foundations

Yongcun Song, Luhao Xue, Xiaoming Yuan, Hangrui Yue

2026-07-14优化算法

本文面向PDE、物理仿真等场景中“非线性几何约束叠加线性等式约束”的Hilbert空间优化问题,动机是让迭代始终严格可行。核心在于把交集视为仿射横截子流形,并构造切空间、投影、隐式回缩及投影诱导度量;主要结果是给出显式黎曼梯度形式,并为线搜索和信赖域算法建立收敛分析框架。

On the Existence of Almost Periodic Solutions with Applications to Global Entrainment Figure 1
2026-07-14math.OC

On the Existence of Almost Periodic Solutions with Applications to Global Entrainment

Iasson Karafyllis, Miroslav Krstic

*Dept. of Mathematics, National Technical University of Athens, **Dept. of Mechanical and Aerospace Eng., University of California, San Diego, La

2026-07-14优化控制

本文针对非线性动力系统在几乎周期外部激励下是否会产生同频稳定响应这一难题,指出周期情形的结论不能直接迁移。核心洞察是用解与其几乎周期时间平移比较,并在有限时间窗内累积收缩,从而保证有界全解继承激励频率。主要结果给出可验证的全局 entrainment 判据:小输入 ISS 与无输入局部指数稳定可推出对小几乎周期输入的唯一吸引响应,并应用于 Volterra-Lyapunov 稳定的 Lotka-Volterra 系统。

RED-SEGA:Resilient Decentralized Stochastic Proximal Optimization with Gradient Sketching over Time-Varying Networks Figure 1
2026-07-14math.OC

RED-SEGA:Resilient Decentralized Stochastic Proximal Optimization with Gradient Sketching over Time-Varying Networks

Jinhui Hu, Guo Chen, Huaqing Li, Liang Ran, Hexi Liang, Tao Han, Tingwen Huang

2026-07-14优化算法

本文针对拜占庭节点、时变网络和高维少样本场景下,传统随机数据采样型方差缩减方法效率低且依赖目标可分解的问题,提出以梯度 sketching 实现方差缩减的去中心化近端优化框架。方法先构造 Gossip-SEGA,再用范数惩罚近似替代普通加权平均得到 RED-SEGA,以提升抗拜占庭聚合能力。理论上给出可靠节点一致性和线性收敛的充分条件,并通过数值实验验证其在攻击存在时仍有效。

Enhancing Presolve in Mixed Integer Programming by Combining Probing and Dual Fixing Figure 1
2026-07-14math.OC

Enhancing Presolve in Mixed Integer Programming by Combining Probing and Dual Fixing

Zhao-Wei Wang, Wei-Kun Chen, Yu-Hong Dai

2026-07-14优化控制

本文面向 MIP 求解器预处理中 probing 与 dual fixing 各自有效但缺少协同机制的问题,提出将 dual fixing 嵌入 probing 以产生更多变量蕴含,并用 probing 快速识别基于可行域点表示的改进 dual fixing 条件。作者在 HiGHS 上实现并用 MIPLIB 2017 测试,结果显示该组合有潜力提升预处理效果,但具体增益规模和来源文中未充分说明。

Parameter-Free Cubic-Regularized Newton Method: Sharp Complexity and Generalized Smoothness Figure 1
2026-07-14math.OC

Parameter-Free Cubic-Regularized Newton Method: Sharp Complexity and Generalized Smoothness

Shaoying Fang, Naoki Marumo, Akiko Takeda

Graduate School of Information Science and Technology, University of Tokyo, Tokyo, Japan, RIKEN Center for Advanced Intelligence Project, Tokyo, Japan

2026-07-14优化控制

本文针对无参数二阶方法在非凸优化中需未知平滑常数、且既有复杂度对问题常数依赖不够尖锐的问题,分析一种带改进回溯规则的三次正则化 Newton 变体。核心洞察是用更弱的点态广义平滑条件控制三阶导数,并建立等价的 Taylor 型不等式。结果给出寻找二阶驻点的 oracle 复杂度界;在经典 L1=0 情形下,对精度、初始间隙和 L0 的依赖达到最优,至多差加性对数项。

Separation of Regular Co-Radiant Sets via Inner Approximating Sequences, Radial Profile Functions and Applications to Optimization Figure 1
2026-07-14math.OC

Separation of Regular Co-Radiant Sets via Inner Approximating Sequences, Radial Profile Functions and Applications to Optimization

Fernando García-Castaño, Miguel Angel Melguizo-Padial

Department of Mathematics, University of Alicante

2026-07-14优化算法

本文针对向量优化与均衡问题中近似解依赖共辐射扰动集、但既有分离理论常要求范数基这一限制,提出正则共辐射集框架。核心创新是用内逼近序列保留所需径向几何,并引入径向剖面函数刻画范数基存在性与正则性。主要结果包括更一般的非线性分离定理、无额外结构假设的近似有效性标量化,以及由分离残差导出的径向深度和度量误差界、近似径向可行性条件与精确罚原理。

Optimal class scheduling with minimum distributed vacant seats using binary linear programming Figure 1
2026-07-14math.OC

Optimal class scheduling with minimum distributed vacant seats using binary linear programming

Ohmchana Klinsod, Parin Chaipunya

Department of Mathematics, Faculty of Science, King Mongkut’s University of Technology Thonburi, all the classrooms. A case study at the Department of Mathematics, King Mongkut’s University of, computers or chemical substances for laboratories. Due to resource limitation as well as other physical, ment of courses, instructors, student groups, rooms, and time periods subject to resource, availability, metaheuristic techniques for university timetabling, including graph-based heuristics, local search, be assigned to lecture rooms, while laboratory-based subjects must be assigned to laboratory rooms

2026-07-14优化控制

针对高校排课依赖人工、教室容量利用不均的问题,本文将课程、教师、学生群组、时段和房间约束写成二元线性规划,并用平方空座惩罚鼓励空位更均衡分布,同时加入教室类型匹配、并行课程同步和学生等价类预处理。在玩具例子与 KMUTT 数学系案例中,Gurobi 求得的课表相较人工方案显著减少分散空座并提升资源利用,但具体增益来源可能主要来自数据预处理与约束建模。

Tulip-Shaped Orbits for Lunar South-Pole PNT and Direct-to-Earth Relay Missions Figure 1
2026-07-14eess.SY

Tulip-Shaped Orbits for Lunar South-Pole PNT and Direct-to-Earth Relay Missions

Darin C. Koblick, Michael Casey

2026-07-14优化控制

面向阿尔忒弥斯等任务在月球南极低仰角通信与PNT覆盖不足的问题,论文用共享6:5共振七瓣“郁金香”三体轨道星座替代多平面ELFO,并以LunaNet IOC-C的LOS、GDOP和EVA窗口逐点评估。结果显示五、六星方案均达标,六星在最差点GDOP<6日可用率75%、EVA支持18小时,且每星保持对地直视,便于单跳中继;但分析仍主要是几何层面,高保真动力学、链路和误差模型需后续验证。

Fast Data-Driven Modeling of Hydraulic Clutch Control Pressure with Latch-State Classification and Gaussian Process Regression Figure 1
2026-07-14eess.SY

Fast Data-Driven Modeling of Hydraulic Clutch Control Pressure with Latch-State Classification and Gaussian Process Regression

Yash Bagla, Jason Schneider

2026-07-14规划控制三维

针对液压离合控制中迟滞、锁止阀切换和执行器动态使物理模型难以校准的问题,论文将电流变化率作为历史相关特征,并先用分类器划分锁止状态,再在各分区训练高斯过程回归。结果显示,非线性 SVC 的分区方案在未见 ramp-rate 数据上比 Amesim 物理仿真更贴近实测压力与迟滞曲线,但增益可能主要来自代表性台架数据覆盖。

A column generation-based fixed-point heuristic for the service-aware multi-commodity flow problem Figure 1
2026-07-14math.OC

A column generation-based fixed-point heuristic for the service-aware multi-commodity flow problem

Siv Marie Cartland Hansen, Richard Martin Lusby

Technical University of Denmark

2026-07-14生成模型

论文针对容量受限网络中需求会随服务质量变化的问题,研究服务感知多商品流的集中式优化。核心做法是把弹性需求的 logit 选择模型与路由容量约束耦合为非线性规划,并提出列生成求解固定需求流、再按服务水平更新需求的固定点启发式。公共交通实例中,该方法通常在 2 秒内得到近最优解,质量接近可解基准且显著快于线性化和非线性基准。

Tracking Through Decoupling Singularities: A Singularity-Robust Homotopy-Continuation Extension of Feedback Linearization Figure 1
2026-07-14eess.SY

Tracking Through Decoupling Singularities: A Singularity-Robust Homotopy-Continuation Extension of Feedback Linearization

Alex Borisevich

2026-07-14视觉感知安全鲁棒

本文针对反馈线性化在解耦矩阵奇异处控制量发散、相对阶丢失的问题,将轨迹跟踪改写为实时弧长同伦延拓,用增广矩阵的 Moore-Penrose 最小范数解替代直接求逆,并以横截条件保证秩一奇异可穿越。理论上证明控制有界、误差为 O(1/k) 且穿越后可重新锁定;仿真在 2-DOF 机械臂、不同相对阶系统和 DC/DC 变换器中显示,相比朴素逆法可避免奇异处速度爆炸。

Second order optimality conditions for piecewise regular extremals in Optimal Control Figure 1
2026-07-14math.OC

Second order optimality conditions for piecewise regular extremals in Optimal Control

Andrei A. Agrachev, Michele Motta

2026-07-14规划控制

针对PMP只能给出一阶极值、难以判断分段正则轨线何时失去最优性的局限,本文把二阶变分写成带跳跃的Jacobi曲线框架,处理切换时刻的垂直交叉、共轭点与Maslov指标关系。主要结果是在积分型最优控制中,对由有限段正则弧拼接的极值给出弱局部最优的必要二阶条件和强局部最优的充分条件,并用一维非凸自由控制系统作详细示例。

A Direction Adaptation Evaluation Strategy for Noisy Derivative-Free Optimization Figure 1
2026-07-14math.OC

A Direction Adaptation Evaluation Strategy for Noisy Derivative-Free Optimization

Morteza Kimiaei, Mahsa Yousefi

2026-07-14优化算法数据集/基准

本文面向带噪声、无法获得梯度的连续优化,试图缓解 MAES 在噪声排序和矩阵自适应分析上的困难。核心做法是固定适应矩阵,用正负对称采样、联合排序分组、三点三角重组方向和带外推的充分下降搜索替代传统矩阵更新。论文给出非凸、凸和强凸情形的高概率复杂度界,并在 BARON 的 655 个 prince 测试问题上显示 DAES 在中小评估预算下较 MADFO 更省评估,但大预算下最终鲁棒性仍可能不及 MADFO。

Neural feedback approximation for stochastic control with degenerate diffusions: error estimates and numerical analysis Figure 1
2026-07-14math.OC

Neural feedback approximation for stochastic control with degenerate diffusions: error estimates and numerical analysis

Olivier Bokanowski, Jean-François Chassagneux, Marco Scaratti, Xavier Warin

Université Paris Cité, Laboratoire Jacques-Louis Lions, EDF Lab Paris-Saclay and FiME, Laboratoire de Finance des Marchés de l’Energie, 91120 Palaiseau, France

2026-07-14生成模型规划控制

面向中高维随机最优控制中 HJB 网格法维数灾难、退化扩散下反馈策略难求的问题,本文分析用神经网络直接参数化时间离散反馈控制并全局优化轨迹成本。核心贡献是给出平均意义下的定量误差分解,将策略逼近、轨迹局部化和训练容差分开处理,且不依赖转移密度假设,可覆盖退化扩散和确定性动力学。数值实验在径向目标、HJB 基准和储气问题上验证了时间离散、分段常值策略、网络逼近与 Monte Carlo 误差的分离。

PnP-IPA: A Provably Convergent Plug-and-Play Inexact Proximal Algorithm for Nonconvex Imaging Problems Figure 1
2026-07-14math.NA

PnP-IPA: A Provably Convergent Plug-and-Play Inexact Proximal Algorithm for Nonconvex Imaging Problems

Cristiano Parenti, Silvia Bonettini, Marco Prato

2026-07-14优化算法

这篇论文针对 Plug-and-Play 成像反问题中“深度去噪器好用但难证明收敛”的矛盾,提出 PnP-IPA:用新的分裂方式近似求解缩放隐式正则项的近端步,并以替代 merit 函数驱动 Armijo 型回溯线搜索。其理论结果是在 Kurdyka-Lojasiewicz 条件下,对非凸数据保真项给出全局收敛到驻点的保证,且不再限制正则化参数;去模糊实验覆盖 Gaussian 与 Cauchy 噪声,显示其可获得更优调参空间和稳健恢复质量。

Optimal Control of Saddle Node Bifurcations Figure 1
2026-07-14math.DS

Optimal Control of Saddle Node Bifurcations

Christopher Beekmann, Kerstin Lux-Gottschalk

2026-07-14规划控制

论文针对非自治鞍结分岔中如何以低成本控制外部扰动、避免临界转变的问题,利用分岔与速率诱导 overshoot 的联系,将原本带动力学约束的最优控制改写为无约束最小化;核心是证明鞍结正规形中临界速率唯一,从而速率函数定义良好,并给出其近似带来的闭式可行控制,在气候和神经科学启发的数值实验中与 IPOPT 解比较了代价、轨迹和计算时间。

How much Data do We Need? Sequential Data Collection for Stochastic Programming Figure 1
2026-07-14math.OC

How much Data do We Need? Sequential Data Collection for Stochastic Programming

Xin Li, Juergen Branke, Xuan Vinh Doan

University of Warwick

2026-07-14优化控制

本文关注数据驱动随机规划中“继续采样是否值得”的实际问题:更多数据能降低输入不确定性,但采集本身有成本。论文将顺序数据采集建模为贝叶斯学习下的最优停止问题,用一步前瞻的预期性能增益与单位采样成本比较来制定停止策略。新闻商数值实验显示,该类收益驱动规则可减少不必要采样,同时保持接近最优的决策表现。

Exploiting Structure with Anisotropic Consensus-Based Optimization Figure 1
2026-07-14math.OC

Exploiting Structure with Anisotropic Consensus-Based Optimization

Sabrina Bonandin, Konstantin Riedl, Sara Veneruso

2026-07-14优化算法

针对高维非凸、非光滑零阶优化中计算复杂度随环境维度爆炸的问题,本文分析各向异性共识优化如何利用加性可分结构,证明其复杂度指数项只依赖最大子问题维度而非总维度,并进一步由各低维分量的可处理性决定;数值实验显示,结构与噪声方向越对齐、分量越简单,算法成功率和样本需求越有利。

Comparing Socially-Equitable Renewable Energy Budget Allocation MDP Policies in Mature and Emerging Economies Figure 1
2026-07-14eess.SY

Comparing Socially-Equitable Renewable Energy Budget Allocation MDP Policies in Mature and Emerging Economies

Riya Kinnarkar, Mansur M. Arief, Yan Pratama Akhra, Dino Arla

2026-07-14优化控制

针对可再生能源规划常忽视低收入群体且成熟/新兴经济体政策杠杆不同的问题,论文将公平预算分配建模为 MDP,并在美国城市直接建设与印尼西爪哇激励私资两种场景比较同一组策略。结果显示滚动视野价值迭代在收益和公平性上均最好,美国可达 66% 可再生渗透并显著减少服务不足人口;而追逐市场的贪心策略在印尼会系统性遗漏低可及地区,说明激励设计需把私资引向弱势区域。

Coupled Tensor-Matrix Recovery via Proximal Alternating Linearized Minimization, with an Application to Workforce Skill and Small-Business Health Estimation Figure 1
2026-07-14math.OC

Coupled Tensor-Matrix Recovery via Proximal Alternating Linearized Minimization, with an Application to Workforce Skill and Small-Business Health Estimation

Analee Miranda

2026-07-14优化控制

本文针对稀疏、含噪观测下共享一个模式的低秩张量与矩阵联合恢复,动机是用劳动力技能与小企业健康的关联补足单侧数据稀缺。核心做法是在共享模式展开上用核范数松弛,并通过学习线性算子耦合两者,使 PALM 可用精确近端步求解。主要结果包括目标最小解存在、算法收敛到临界点、矩阵子问题采样界,以及已知耦合算子下可由张量恢复精度推回矩阵;完全联合情形仍是猜想,应用未在真实部署数据验证。

Robustly Invertible Nonlinear Dynamics and the BiLipREN: From Inversion-Based Control to Generative Trajectory Modelling Figure 1
2026-07-14eess.SY

Robustly Invertible Nonlinear Dynamics and the BiLipREN: From Inversion-Based Control to Generative Trajectory Modelling

Yurui Zhang, Ruigang Wang, Ian R. Manchester

2026-07-14生成模型规划控制安全鲁棒

针对非线性动力系统中“可逆但对扰动不稳”的控制与生成建模需求,论文把鲁棒可逆性定义为前向与逆系统均收缩且具有限增量增益,并构造 BiLipREN 使该性质内建于循环网络参数化中。实验覆盖质量弹簧系统、内外因子分解、轨迹损失学习和信号 normalizing flow,显示其可在保持显式逆的同时用于鲁棒辨识、控制优化和复杂轨迹分布生成,但部分性能取舍受 Lipschitz 参数选择影响。

Complexity of partitioned-items response problems: matchings and perfect matchings Figure 1
2026-07-14math.OC

Complexity of partitioned-items response problems: matchings and perfect matchings

Christoph Buchheim, Lowig Duer, Eva Ley, Maximilian Merkert, Komal Muluk

Department of Mathematics, TU Dortmund University, Germany, Institute for Mathematical Optimization, TU Braunschweig, Germany

2026-07-14优化控制

本文研究分区物品双层优化中的响应问题:领导者能否通过先选物品,诱导或强制跟随者包含必选项并排除禁用项。核心洞察是复杂度由必选、禁用、中性物品的组合精细决定。论文给出一般性判定结果,并在最大权匹配与最小权完美匹配上证明:即使只有一条必选或禁用边也可为 NP-hard;但对非必选边数固定参数可解,且全为必选/禁用时完美匹配情形可多项式求解,而最大权匹配仍可能困难。

Implicit Midpoint Gradient Descent: Fast and Learning rate free convergence for Zero-Sum Games Figure 1
2026-07-14cs.GT

Implicit Midpoint Gradient Descent: Fast and Learning rate free convergence for Zero-Sum Games

Gaoqi Xue, James P. Bailey

Rensselaer Polytechnic Institute

2026-07-14优化算法学习理论

针对双线性零和博弈中显式梯度法易振荡、步长受限的问题,论文从连续时间 FTRL 的哈密顿结构出发,用隐式中点离散构造 IMGD,使离散迭代更好保持能量几何。结果显示其在任意正学习率下保持有界轨道,并达到接近连续动力学的遍历收敛率,实验中优于 optimistic 与 alternating GDA。

Robust Decentralized Optimization under Node Failures via Adaptive Regularization Figure 1
2026-07-14math.OC

Robust Decentralized Optimization under Node Failures via Adaptive Regularization

Ilya Kuruzov, Anastasiia Murzina

2026-07-14优化算法安全鲁棒

这篇论文针对去中心化优化中节点永久离开会使其本地目标被遗忘、导致固定异质性偏差的问题,提出 Legacy-GT:离开节点用一次告别消息传递带梯度锚点和最优中点曲率的二次“遗产”,并校正梯度跟踪不变量。理论证明该记忆可在链式离开中无损组合,保持线性收敛,最终偏差随离开时网络误差几何下降,显著优于 drop-and-forget 的不衰减偏差;实验用于验证这些界。

An Occupation-Measure and Frank-Wolfe Framework for Heterogeneous Mean-Field Control Figure 1
2026-07-14math.OC

An Occupation-Measure and Frank-Wolfe Framework for Heterogeneous Mean-Field Control

Di Yu, Sixiong You, Chaoying Pei

2026-07-14规划控制

针对异质多群体均场控制中动力学、约束和交互结构不同而难以保持可扩展求解的问题,论文将各群体提升为占用测度上的优化变量,并给出矩阵值核的凸性条件;进一步用 Frank-Wolfe 线性化使子问题按群体分解为独立最优控制任务。UAV 协同与搜救实验显示,该框架能统一刻画对称协同、非对称让行和方向性交互,且在部分非凸设置下仍表现出单调下降,但非凸收敛保证文中未充分说明。

Threshold Dynamics and Correlated Prophet Inequalities Figure 1
2026-07-14cs.GT

Threshold Dynamics and Correlated Prophet Inequalities

José Correa, Maximilian Fichtl, Reda Jlibene, Rida Laraki, Vasilis Livanos, Kevin Schewior, Victor Verdugo

2026-07-14优化控制

本文针对先知不等式通常假设输入独立、难以刻画现实相关性的局限,研究由潜在状态变量诱导的 common-base 与 common-scale 两类相关模型。核心创新是用阈值动态的微分方程统一分析单阈值算法,并给出阈值最优性条件。主要结果显示 common-base 下随机阈值可达且最优为 0.4,确定性约为 0.381;更强分析将可达范围夹在 0.41 到 0.475,排除 1/2;common-scale 下任意算法竞争比至多 1/n。

How Much Does Correctness Cost? Budgeted Placement of Strong Correctors in a Weak Multi-Agent Swarm Figure 1
2026-07-14cs.AI

How Much Does Correctness Cost? Budgeted Placement of Strong Correctors in a Weak Multi-Agent Swarm

Igor Itkin

2026-07-14优化控制

本文关注多智能体/LLM 群体中“便宜但不可靠的节点”如何用少量昂贵校正器达成正确共识,核心是把校正器位置、成本与纠偏强度耦合为图上的预算优化问题。作者证明异质校正器下误差收益仍具次模性,给出带 1-1/e 保证的成本收益贪心算法,并推导预算-正确性前沿;关键洞察是应买少数强模型还是多个中等模型取决于成本-质量曲率,实验显示事实和数学验证更适合分散,而代码追踪任务可能相反。

2026-07-13

31 篇
Characterization of the basin of convexity for multi-snapshot spike deconvolution via variable projection Figure 1
2026-07-13stat.ML

Characterization of the basin of convexity for multi-snapshot spike deconvolution via variable projection

Meghna Kalra, Maxime Ferreira Da Costa, Kiryung Lee

2026-07-13优化算法

这篇论文面向多快照 spike 去卷积中“只估计位置、幅度可消去”的优化需求,分析变量投影后非凸目标在真值附近何时呈现良性几何。核心洞察是用 PSF 的功率谱、平滑性、采样带宽与 spike 间隔显式刻画凸性盆,并借助 Beurling-Selberg 近似控制结构矩阵条件数。主要结果包括局部强凸与梯度 Lipschitz、随机噪声下一致性、对抗噪声误差界,以及盆内初始化时梯度下降收敛保证。

Perturbed utility Markovian traffic equilibrium: theory and computation Figure 1
2026-07-13math.OC

Perturbed utility Markovian traffic equilibrium: theory and computation

Rui Yao, Kenan Zhang

2026-07-13学习理论

针对传统马尔可夫交通均衡中所有路径都被赋正流、无折扣网络加载难收敛、难处理非对称成本等问题,论文提出扰动效用马尔可夫均衡框架,用凸剩余函数生成可含零概率的策略,并以变分不等式刻画均衡;证明存在唯一性及两类全局收敛算法,实验显示在基准与合成网络上具备较好可扩展性和鲁棒性。

Large-Scale Portfolio Optimization Problem Under Cardinality Constraint With Enhanced Multi-Objective Evolutionary Algorithms Figure 1
2026-07-13cs.CE

Large-Scale Portfolio Optimization Problem Under Cardinality Constraint With Enhanced Multi-Objective Evolutionary Algorithms

Danial Ramezani, Mostafa Abouei Ardakan

2026-07-13优化算法

论文针对带基数约束的大规模投资组合优化:现实约束使均值-方差模型变为 NP-hard,传统精确法和普通进化算法在资产规模增大时效率受限。作者为多目标进化算法设计了新的解表示、交配算子与修复机制,并嵌入 NSGA-II 等框架。基于 DAX100、S&P100、Nikkei225 和 TSE 数据的实验显示,该策略在 HV、GD/IGD、分布性等指标上优于常规编码 NSGA-II,且资产数增加时优势更明显。

A novel robust mixed integer linear programming model for index tracking problem under no rebalancing: heuristic optimization approach Figure 1
2026-07-13cs.CE

A novel robust mixed integer linear programming model for index tracking problem under no rebalancing: heuristic optimization approach

Danial Ramezani, Mostafa Abouei Ardakan, Mohamadreza Dehghani Ahmadabad

2026-07-13视觉感知优化算法安全鲁棒

针对指数跟踪中资产子集选择带来的NP-hard求解难题及频繁再平衡成本,论文提出一种面向无再平衡场景的鲁棒混合整数线性规划模型,并结合遗传算法与局部分支形成GALB启发式。实验在OR-library及主要股指数据上表明,该模型和启发式在求解时间、样本内外跟踪误差与长期稳定性上优于CPLEX及既有模型,但增益来源仍可能部分来自数据设置。

A certified refinement and asymptotic analysis of the Kuznetsov-Sahinidis diameter bound for Lennard-Jones clusters Figure 1
2026-07-13math.OC

A certified refinement and asymptotic analysis of the Kuznetsov-Sahinidis diameter bound for Lennard-Jones clusters

Guillaume Lecomte

2026-07-13学习理论

本文针对 Lennard-Jones 团簇确定性全局优化中搜索盒过大的问题,重新审视 Kuznetsov-Sahinidis 的直径先验界。核心做法是用基于子集不等式和已认证小团簇能量的层内能量下界,替代过松的全配对下界,并用整数层分布与有向舍入完成证书。结果在 N≤200 的 92 个规模上将已发表直径界收紧一层,同时证明原 KS 界的渐近形式为 N-Θ(√N),但不产生新的全局最优性证书。

Graph-Regularized Low-Rank Matrix Completion by Variable Projection Figure 1
2026-07-13cs.LG

Graph-Regularized Low-Rank Matrix Completion by Variable Projection

Benoît Loucheur, P.-A. Absil, Michel Journée

2026-07-13优化控制

本文面向气象观测、推荐等场景中的缺失矩阵恢复问题,指出传统低秩补全忽略行列之间的图结构关系。核心做法是在RTRMC的Grassmann流形优化和变量投影框架中加入行、列图的Dirichlet平滑正则,形成GR-RTRMC。实验覆盖比利时、法国气象数据和MovieLens,显示其相对基线能更准确恢复缺失项,尤其在存在强空间或相似性关联时更有效。

Riemannian Multilevel Optimization with Application to Constrained Energy Minimization Problems Figure 1
2026-07-13math.OC

Riemannian Multilevel Optimization with Application to Constrained Energy Minimization Problems

Yara Elshiaty, Stefania Petra, Jonas Püschel, Tatjana Stykel, Ferdinand-Joseph Vanmaele

2026-07-13优化算法

针对带流形约束的离散能量最小化问题,传统欧氏多层优化的粗层修正难以保持可行性和下降性。论文构造一阶一致的黎曼粗模型,并配套度量兼容的向量传递算子,覆盖内蕴与外蕴情形;在Zoutendijk型分析下证明两层和多层算法全局收敛,并在Kohn–Sham、Gross–Pitaevskii和二值连续割实验中较单层黎曼优化显著降低计算时间。

A Multi-Scale Optimization Framework for Grid-Integrated Electrolysis Figure 1
2026-07-13math.OC

A Multi-Scale Optimization Framework for Grid-Integrated Electrolysis

Kiernan X. Jennings, Victor M. Zavala, Styliani Avraamidou

2026-07-13优化算法

面向高比例风光并网带来的电价波动与负荷调节需求,论文把电解槽日前市场调度、基于使用的退化累积和多年堆栈更换决策统一为MILP。2.2 MW碱性电解槽22年案例显示,多尺度协同调度可将最优堆栈寿命延长最多2年,并较恒定运行降低33%全寿命电费,同时指出仅靠市场套利实现1美元/kg氢成本目标并不现实。

Inertial forward-backward algorithm with exterior penalization and Tikhonov regularization Figure 1
2026-07-13math.OC

Inertial forward-backward algorithm with exterior penalization and Tikhonov regularization

Siqi Qu, Juan Peypouquet, Mathias Staudigl

Mannheim University, Department of Mathematics, B6 26, 68159 Mannheim, Germany, Rijksuniversiteit Groningen, Faculty of Science and Engineering, Systems, Control and Optimization — Bernoulli Institute, Groningen, The Netherlands

2026-07-13优化控制

这篇论文面向带约束变分不等式和单调包含问题中既要处理复杂可行域、又希望迭代强收敛到最小范数解的需求,提出带惯性项的前向-后向分裂算法,将外罚、可消失 Tikhonov 正则和可行域分解统一起来,可覆盖光滑、非光滑及混合罚算子。主要结果是在一般假设下证明弱遍历收敛,并借助离散 Tikhonov 中心路径在温和约束资格条件下证明迭代强收敛到最小范数解。

Deep Learning for Dynamic Programming with Recursive Utility Using First-order Conditions Figure 1
2026-07-13q-fin.CP

Deep Learning for Dynamic Programming with Recursive Utility Using First-order Conditions

Xianhua Peng, Wu Guo, Songyan Wang, Jianfei Zhu

2026-07-13优化控制

本文针对递归效用动态规划中确定性等价项难以在 Bellman 方程和一阶条件中反复评估的问题,提出 CEFOL:用独立神经网络学习状态-控制确定性等价,并联合训练价值、策略与乘子网络。其洞察是把非线性期望项从策略更新中解耦,使一阶/KKT 残差可直接处理一般约束。实验覆盖消费储蓄、稳健控制和含随机波动的 DSGE,样本外 Bellman 与最优性残差多在 10^-4 至 10^-3,且在可比情形接近 VFI 基准。

The Continuous Relaxation of Sparse PCA is NP-hard Figure 1
2026-07-13math.OC

The Continuous Relaxation of Sparse PCA is NP-hard

Linbin Li, Yong Xia

LMIB of the Ministry of Education, School of Mathematical Sciences, Beihang University, Beijing, China

2026-07-13优化控制

本文关注稀疏 PCA 中常用的 L1-L2 连续松弛:它虽被用来替代组合型 L0 约束,但其全局求解复杂性此前并不清楚。核心洞察是把最大团问题嵌入带 L1 约束与 L2 等式/不等式的二次优化,并刻画参数 R 的平凡区间。主要结果证明该连续松弛及其双不等式变体均为 NP-hard。

Convex Relaxations for the Optimization of Markov Processes Figure 1
2026-07-13math.OC

Convex Relaxations for the Optimization of Markov Processes

Hongyi Zhang, Yuehaw Khoo, Tianyun Tang

Department of Statistics, University of Chicago

2026-07-13优化算法

为缓解高维马尔可夫过程优化中完整分布不可表示的问题,本文把带端点分布和一步代价的过程优化改写为序贯耦合问题,并用局部边缘与簇矩构造凸松弛。结果给出可计算下界和中间分布低阶统计,证明动态最优传输是其特例,可从松弛解恢复 Benamou-Brenier 动力学,并在 Ising 受限过程上展示扩展性。

PCPOP.jl: A Julia package for partially commutative polynomial optimization Figure 1
2026-07-13quant-ph

PCPOP.jl: A Julia package for partially commutative polynomial optimization

Moisés Bermejo Morán, Abhishek Mishra

Department of Computer Science, School of Computing and Data, Science, The University of Hong Kong, Hong Kong, Laboratoire d’Information Quantique, Universit´e libre de Bruxelles

2026-07-13优化算法

本文面向多项式优化在量子信息问题中半定规划松弛规模迅速膨胀的瓶颈,介绍 Julia 包 PCPOP.jl。核心做法是把部分对易关系显式编码进单项式与图乘积计算,并结合 Gröbner 基、Wedderburn 对称化、Jordan 代数和精确算术来自动构造更小的松弛。论文通过 Bell、上下文性、量子网络等案例和基准展示其相对通用实现的计算优势,但具体增益在不同问题中的来源仍需结合实例判断。

On Incremental Design of Large-Scale Networks of Nondeterministic Metric Finite State Systems Figure 1
2026-07-13math.OC

On Incremental Design of Large-Scale Networks of Nondeterministic Metric Finite State Systems

Giordano Pola

2026-07-13优化控制

面向大规模互联、非确定且带度量输出的有限状态系统,集中式控制设计计算代价过高。论文提出 Network of Systems 架构及增量式局部控制器设计:在逐步扩大的子网络上求解,使各植物在给定精度内满足基于状态字母的正则语言规范。结果给出从单植物到多植物情形的构造、终止条件与复杂度分析,并用示例说明该方法可在资源受限时仍产生部分可用控制解。

A Polynomial-Time Algorithm for Coloring Perfect Graphs Based on Walk Counting Figure 1
2026-07-13cs.DS

A Polynomial-Time Algorithm for Coloring Perfect Graphs Based on Walk Counting

Amir Ali Ahmadi, Pravesh K. Kothari, Yukai Tang

Princeton University, Operations Research and Financial Engineering. Partially supported by the Princeton AI Lab Seed Grant, the Princeton SEAS Innovation Grant, and a

2026-07-13优化控制

针对完美图最优着色、最大团和最大稳定集虽可用椭球法多项式求解但缺少公认组合算法的问题,本文提出以带权边与非边的游走计数来判定给定大小团是否存在,并将着色归约到该判定;正确性由闭游走不等式证书和 Lyapunov 分析支撑,结果声称给出任意完美图上的多项式时间图论操作算法。

On feasibility problems with spectral constraints Figure 1
2026-07-13math.OC

On feasibility problems with spectral constraints

Shravan Mohan

2026-07-13优化算法

本文面向矩阵需同时满足结构约束与奇异值谱约束的可行性问题,如条件数控制、加权核范数恢复和增益整形。核心做法是利用谱转移恒等式,将谱集合投影化为一次 SVD 加小规模二次规划,并嵌入交替投影框架。实验显示该方法在多种谱约束下可快速找到可行点;收敛速度更多受结构集合几何影响,非可行情形的停滞平台也能提供有用诊断。

A general framework for nonlocal traffic flow models on networks Figure 1
2026-07-13math.OC

A general framework for nonlocal traffic flow models on networks

Alexander Keimer, Lukas Pflug, Florian Prohaska

aInstitute of Mathematics, University of Rostock, Ulmenstraße 69 Rostock, 18057, Germany, bFAU Competence Center Scientific Computing, Friedrich-Alexander-University Erlangen-Nürnberg, cChair of Applied Mathematics (Continuous Optimisation), Friedrich-Alexander-University Erlangen-Nürnberg, Although more and more real-time traffic data is becoming available through, e.g., routing apps, con-, scalable macroscopic traffic flow model for general networks and several ideas of routing algorithms., There are also many commercial toolboxes for parts of the dynamics traffic assignment problem available, these toolboxes use mostly microscopic models, which are not scalable as the computational complexity

2026-07-13生成模型

面向实时交通数据尚难转化为城市级调度收益的问题,论文提出适用于一般路网的宏观非局部交通流框架:道路用带前视效应的守恒律建模,路口用保质量缓冲区耦合,并支持多商品动态路由与时域优化。数值算例覆盖小网络和网格化大网络,显示框架可稳定比较 k 最短路、优化路由等策略;但真实数据验证仍未给出。

Polyhedral extended formulations that approximate the Gomory closure for packing problems Figure 1
2026-07-13math.OC

Polyhedral extended formulations that approximate the Gomory closure for packing problems

Friedrich Eisenbrand, Samuel Fiorini, Lars Rohwedder, Jiaye Wei

2026-07-13优化控制

针对0/1 packing问题中Gomory闭包优化本身NP-hard、既有近似依赖Lasserre/SoS半定规划的问题,本文从线性规划一阶原理出发,用局部变量邻域的整数凸包刻画来近似Gomory割。主要结果是构造多面体且多项式规模的扩展表述,对固定t和ε给出(1+ε)^t近似,并另以通信复杂度得到若干参数区间更优的准多项式表述。

Understanding Schedule-Free Methods in Nonconvex Optimization: Rate Guarantees and Escaping Saddles Figure 1
2026-07-13cs.LG

Understanding Schedule-Free Methods in Nonconvex Optimization: Rate Guarantees and Escaping Saddles

Jiseok Chae, Donghwan Kim

Natural Science Research Institute, Department of Mathematical Sciences

2026-07-13优化算法

针对 Schedule-Free 优化器在深度学习非凸目标中经验有效但理论不足的问题,论文从连续时间 ODE 出发构造 Lyapunov 分析,并扩展到标准 SF-GD/SF-SGD 离散算法。结果证明其梯度评估点达到一阶方法最优最坏情形收敛率,且经任意小一次扰动可几乎必然避开严格鞍点;同时指出实际常用平均评估序列的最坏情形可能更差。

Control Laguerre Tessellation: Semi-discrete Optimal Transport Over Control Systems Figure 1
2026-07-13math.OC

Control Laguerre Tessellation: Semi-discrete Optimal Transport Over Control Systems

Ripon C. Sarker, Abhishek Halder

2026-07-13规划控制

面向微装配、靶向递药和群体覆盖等场景,论文研究连续分布受控智能体到离散目标容量的最优分配。核心洞察是把个体最优控制代价作为半离散最优传输的地面代价,并提出控制 Laguerre 剖分;在满足 twist 条件时得到几乎处处唯一的分片常值传输映射。文中给出线性系统最小能量、最小时间两类代价下的结构结果,并用 Newton 与 Oliker-Prussner 算法展示前者更快、最小时间剖分可非凸。

On robustness, input-to-state stability and backstepping for stochastic differential equations Figure 1
2026-07-13eess.SY

On robustness, input-to-state stability and backstepping for stochastic differential equations

Robert H. Moldenhauer, Dragan Nešić, Mathieu Granzotto, Romain Postoyan, Andrew R. Teel

2026-07-13安全鲁棒

本文针对连续时间随机微分方程缺少光滑逆 Lyapunov 定理导致鲁棒性难以刻画的问题,改以已知 Lyapunov 函数为前提,给出小扰动下 GASp 保持、带状态依赖缩放的随机 ISS,以及指数稳定情形下比例扰动鲁棒和指数 ISS 结果;并将这些工具用于纯反馈随机积分器 backstepping,构造可保证闭环 GASp 的控制律。

Solving Stochastic Fixed-Point Equations with High Probability Figure 1
2026-07-13math.OC

Solving Stochastic Fixed-Point Equations with High Probability

Jelena Diakonikolas

Department of Computer Sciences, University of Wisconsin-Madison

2026-07-13优化控制

本文面向强化学习、隐式深度模型和科学计算中只能通过噪声采样访问的固定点方程,研究在原生范数下以高概率控制残差。核心创新是VR-GHAL:用按Lipschitz尺度裁剪的随机差分构造递归方差缩减估计器,使有限二阶矩噪声下仍可做鞅集中。主要结果给出anytime高概率残差界,复杂度在有界方差下达min{ε^-5,(1-γ)^-3ε^-2},更强oracle条件下提升到ε^-3或ε^-2。

Impedance-Guided Programmable Transmission of Localized Deformation in Modular Soft Metamaterials Figure 1
2026-07-13cs.CE

Impedance-Guided Programmable Transmission of Localized Deformation in Modular Soft Metamaterials

Weiyun Xu, Daewon Hong, Zhi Zhao, Rahul Dev Kundu, Xiaojia Shelly Zhang

Department of Civil and Environmental Engineering, University of Illinois Urbana-Champaign, Urbana, IL, Department of Mechanical Engineering, University of Illinois Urbana-Champaign, Urbana, IL 61801, USA., National Center for Supercomputing Applications, Urbana, IL 61801, USA., reassemblability of these soft modules can embed electric logic signals, enabling energy-efficient, scalable route toward embodied-intelligence material systems, particularly for soft-metamaterial-

2026-07-13优化控制

论文针对软模块化超材料中局部位移随级联距离快速衰减、限制软机器人和材料计算可扩展性的问题,提出将下游结构等效为准静态机械阻抗,并把装配级传输约束嵌入单元拓扑优化。结果显示,该方法较直觉设计和常规柔顺机构优化显著提高传输效率,生成两端口/四端口模块,并实现绕障位移路由、容错软抓取、机械 LED 显示和手指运动控制等功能。

Nonconvex Composite Functional Constraints via First-Order Augmented Lagrangian Methods under Local Regularity Figure 1
2026-07-13math.OC

Nonconvex Composite Functional Constraints via First-Order Augmented Lagrangian Methods under Local Regularity

Linglingzhi Zhu, Jiajin Li

2026-07-13优化算法

本文关注非凸、非光滑复合约束优化中 ALM/primal-dual 方法难以控制乘子的问题。核心洞察是先用紧化对偶域获得截断 minimax 的一阶保证,再证明足够大罚参数下候选迭代进入近可行区,并由局部锥正则性使人工截断失效,从而转化为原问题 KKT 证书。结果给出 KKT 残差收敛率:对偶正则化为 O(K^{-1/3}),额外局部结构下无正则化可达 O(K^{-1/2})。

Adaptive MPPI with Online Disturbance Covariance Estimation: Provable Stability Tightening via Spatial Smoothing Figure 1
2026-07-13eess.SY

Adaptive MPPI with Online Disturbance Covariance Estimation: Provable Stability Tightening via Spatial Smoothing

Hyung-Jin Yoon, Hunmin Kim

Department of Mechanical and Nuclear Engineering, Tennessee Technological, University, Cookeville, TN, USA. ‡ H. Kim is with the School of Engineering, Department, of Electrical and Computer Engineering, Mercer University, Macon, GA, USA.This work was supported by internal funding at Tennessee, Technological University.This paper is part of a companion series on the closed-loop

2026-07-13优化控制

本文针对 MPPI 在未知且空间变化扰动协方差下稳定性证书被固定失配项放大的问题,提出按状态网格在线估计协方差并引入按访问测度加权的空间平滑,同时联动更新采样协方差与控制惩罚。主要结果是给出估计误差的随机近似、平滑偏差与时变漂移分解,并证明在失配超过残余偏差和漂移余量时,自适应证书会在有限可计算时间后严格更紧。

Polynomial Matrices in Integer Programming With Restricted Subdeterminants Figure 1
2026-07-13math.OC

Polynomial Matrices in Integer Programming With Restricted Subdeterminants

Marcel Celaya, Stefan Kuhlmann, Robert Weismantel

2026-07-13优化控制

本文针对整数规划中“子行列式受限的约束矩阵”缺乏结构化理解的问题,转向整数系数多项式矩阵框架研究参数化矩阵。核心洞察是用固定线性多项式集合约束所有子行列式,并通过整数取值把多项式情形与普通整数矩阵联系起来。主要结果是在九个线性形式组成的特定集合上,给出多项式时间识别算法和相应整数规划的多项式时间求解结论,并说明该类矩阵可由具有特殊投影性质的双模矩阵刻画。

Parallel versions of the mesh adaptive direct search algorithm Figure 1
2026-07-13math.OC

Parallel versions of the mesh adaptive direct search algorithm

Sébastien Le Digabel, Antoine Lesage-Landry, Samuel Mendoza, Christophe Tribes

2026-07-13优化控制

本文面向耗时且评估时间不均一的约束黑箱优化,梳理 MADS 直接搜索算法在多核环境下的并行化路径。核心洞察是并行收益主要来自同时调度多个黑箱评估,而非改写黑箱本身,并比较不同并行层级与策略的适用条件。文中给出 NOMAD/MADS 实现、并行基准指标和实验建议,主要结果是总结各版本在加速、解质量与资源利用上的优势和局限。

Convergence of fictitious play for fully coupled FBSDEs in finite-player stochastic differential games Figure 1
2026-07-13math.OC

Convergence of fictitious play for fully coupled FBSDEs in finite-player stochastic differential games

Adam Andersson, Kristoffer Andersson, Per Ljung

numerical approximations are necessary. However, accurate, scalable, and practical numerical approx-, †Department of Mathematical Sciences, Chalmers University of Technology & University of Gothenburg, §Department of Electrical Engineering, Chalmers University of Technology

2026-07-13学习理论

面向有限玩家非零和随机微分博弈中高维、全耦合 Nash FBSDE 难以稳定近似的问题,本文分析 fictitious play 的收敛性,而非只处理前向解耦情形。核心贡献是在梯度有界或系数小性等条件下证明迭代误差几何收敛,并在特定结构下可达超指数收敛;线性二次银行拆借实验验证了几何速率。

The Weighted Connected p-Median Problem Figure 1
2026-07-13math.OC

The Weighted Connected p-Median Problem

Murat Elhüseyni, Burak Kocuk, Miklós Krész

aYeditepe University, Industrial Engineering, 34755, Istanbul, Turkey, bSabancı University, Industrial Engineering, 34956, Istanbul, Turkey, cInnoRenew CoE, UP IAM & UP FAMNIT, University of Primorska, 6000, Koper, Slovenia, dUniversity of Szeged, Department of Applied Informatics, 6725, Szeged, Hungary, ture. Since these formulations are poorly scalable with respect to network size, we develop, of-the-art with the p-center and p-centdian problems (convex combination of p-median and, p-center) is analogous: motivated by sensor network design the problems were studied for

2026-07-13优化控制

本文面向分布式传感网络中的 sink 节点选择,把传统 p-median 扩展为带部署费、访问费和 sink 间最小生成树连接费的加权连通版本。核心贡献是证明问题 NP-hard,并给出三种 MILP 与基于 LP rounding 的四阶段 matheuristic。实验显示 MILP 仅适合小规模实例,中大规模两小时内难以求解,而若干启发式变体可在分钟级得到高质量解。

Partially-Commutative Polynomial Optimization Figure 1
2026-07-13quant-ph

Partially-Commutative Polynomial Optimization

Abhishek Mishra, Moisés Bermejo Morán, Stefano Pironio

Laboratoire d’Information Quantique, Universit´e libre de Bruxelles, Belgium, Department of Computer Science, School of Computing and Data Science, The University of

2026-07-13优化算法

本文针对量子信息中算符只在部分变量间对易的优化问题,指出把这些关系作为普通线性约束会放大 SDP 松弛规模。核心做法是将问题形式化为部分对易多项式优化,并用部分对易幺半群的规范表示直接构造单项式基。主要结果是给出更紧凑的 SDP 层级、说明朴素替换可能导致错误松弛,并扩展讨论迹型情形的循环等价。

EHR-MPC: Inference-Time Control for Sepsis Treatment with Generative Patient Digital Twins Figure 1
2026-07-13stat.ML

EHR-MPC: Inference-Time Control for Sepsis Treatment with Generative Patient Digital Twins

Joshua Pickard, Wei Qi, Na Li, Ann Woolley, Lisa Cosimi, Roy Kishony, Deborah Hung

\addr Broad Institute of MIT and Harvard, \addr Harvard University, \addr Technion–Israel Institute of Technology, \addr Broad Institute of Harvard and MIT

2026-07-13生成模型规划控制

针对脓毒症治疗中强化学习固定策略难以随临床目标调整的问题,EHR-MPC将患者动力学学习与决策优化解耦,用生成式EHR数字孪生模拟干预下轨迹,并在推理时用MPC按目标选择治疗。其在8家ICU队列上相较RL基线取得相近的离策略表现和更好的仿真评估结果,但真实临床增益仍需进一步验证。

2026-07-10

24 篇
Finding Simple Proofs for First-Order Optimization Figure 1
2026-07-10math.OC

Finding Simple Proofs for First-Order Optimization

Daniel Berg Thomsen, Manu Upadhyaya, Baptiste Goujaud, Aymeric Dieuleveut, Adrien Taylor

Research University, Paris, France.CMAP, École

2026-07-10优化算法

这篇论文关注一阶优化中机器生成的 PEP 对偶证书虽能证明收敛界、却难以阅读和复用的问题。核心做法是把“找简单证明”建模为证书上的二阶段优化,用穷举稀疏化、加权 ℓ1 启发式和 SDP 搜索删去冗余不等式并发现中间引理。实验在梯度下降、近端法和快速梯度法上恢复了更稀疏的乘子模式与 Lyapunov 结构,显示其可作为人工整理和形式化证明前的预处理步骤。

Sharp bounds for stochastic proximal and projection estimators via radial dominance Figure 1
2026-07-10math.OC

Sharp bounds for stochastic proximal and projection estimators via radial dominance

Gonzalo Contador, Pedro Pérez-Aros, Emilio Vilches

2026-07-10学习理论

本文针对随机近端与投影估计器虽易并行、只需函数值却缺少尖锐误差常数的问题,提出径向支配比较原理,将高维指数加权测度的重心偏差化为一维参考分布的首矩控制。由此给出弱凸函数近端估计和闭凸集随机投影的非渐近误差界,改进既有√δ收敛常数并证明其渐近尖锐性,同时分析平滑性、余共轭性等结构性质。

Aclass of incrementally scattering-passive nonlinear systems Figure 1
2026-07-10math.OC

Aclass of incrementally scattering-passive nonlinear systems

Shantanu Singh, George Weiss, Marius Tucsnak

School of Electrical Eng., Tel Aviv University

2026-07-10优化控制

本文面向带边界阻尼等无界耗散的无限维控制系统,研究在线性散射无源系统中加入全空间定义的非线性最大单调阻尼后,输入输出闭环是否仍可良定。核心做法是用 Lax-Phillips 型非线性半群重写整个系统,并结合 Crandall-Pazy 定理处理多值非线性。主要结果证明该类系统存在唯一连续状态与平方可积输出,且满足增量散射无源收缩不等式。

Preconditioned primal-dual algorithms for saddle point problems: non-ergodic convergence rates Figure 1
2026-07-10math.OC

Preconditioned primal-dual algorithms for saddle point problems: non-ergodic convergence rates

Huiyuan Guo, Juan José Maulén, Juan Peypouquet

2026-07-10学习理论

本文面向凸凹鞍点问题中传统 PDHG 多依赖遍历平均、迭代本身收敛速率不足的问题,研究带预条件的原始-对偶算法。核心做法是引入反对称预条件器,并兼容光滑与非光滑分解及实现误差,从连续动力系统离散化得到算法。主要结果是给出非遍历收敛速率,并在约束最小二乘、稀疏正则和图像去噪实验中显示迭代更稳定、相对标准方法有竞争力。

Robust Dynamic Operating Envelopes in Unbalanced Three-Phase Distribution Systems Figure 1
2026-07-10eess.SY

Robust Dynamic Operating Envelopes in Unbalanced Three-Phase Distribution Systems

Wilhiam de Carvalho, Florin Capitanescu, Cyril Rasic, Jean-François Toubeau, François Vallée

Luxembourg Institute of Science and Technology, The University of Mons

2026-07-10安全鲁棒

针对不平衡三相配电网中相间耦合导致传统动态运行包络只在上下界可行、包络内部仍可能越限的问题,论文将可控负荷实际出力视为不确定量,提出覆盖整个包络范围的鲁棒 DOE:既有完整 AC 潮流的 NLP 版本,也有保持单层 LP 规模的线性版本。比利时真实数据和 IEEE 13/123 节点算例显示,LP 鲁棒法显著减少违规但仍受线性潮流误差影响,NLP 鲁棒法更保守但未出现网络约束违规。

Second order systems on Hilbert spaces with nonlinear damping Figure 1
2026-07-10math.OC

Second order systems on Hilbert spaces with nonlinear damping

Shantanu Singh, George Weiss

School of Electrical, Engineering, Tel Aviv University, Ramat Aviv 69978, Israel.

2026-07-10优化控制

本文针对带非线性、甚至多值阻尼的 Hilbert 空间二阶无限维系统,研究其在输入输出框架下的适定性问题。核心推进是允许阻尼算子仅稠密定义,从而覆盖边界阻尼和部分分布式阻尼,并用极大单调算子、Crandall-Pazy 定理与 Lax-Phillips 型半群建立系统表示。主要结果证明任意初值和 L2 输入下存在唯一广义解,且系统满足增量散射无源的能量不等式,并以 n 维波方程作示例。

Controllability and Exponential Mixing in Singular Interacting Particle Systems Figure 1
2026-07-10math.OC

Controllability and Exponential Mixing in Singular Interacting Particle Systems

Laurent Mertz, Vahagn Nersesyan, Manuel Rissel

2026-07-10规划控制

针对奇异相互作用粒子系统中控制或噪声只作用于少数粒子时,整体可控性与随机混合性难以建立的问题,本文把核的奇异性作为传播控制的机制:快速牵引一个受控粒子靠近目标粒子,诱导局部位移而近似不扰动其他粒子。由此证明全局精确可控、solid controllability 和带预设轨迹的近似可控,并在Lyapunov与适定性条件下推出退化噪声驱动系统的遍历性与指数混合,覆盖Biot–Savart、Coulomb、Riesz、Yukawa及多物种模型。

Dynamics of Gradient Descent with Large Step Size Near a Manifold of Flat Minima Figure 1
2026-07-10cs.LG

Dynamics of Gradient Descent with Large Step Size Near a Manifold of Flat Minima

Lachlan Ewen MacDonald, René Vidal

University of Pennsylvania

2026-07-10优化算法

本文针对深度学习中大步长梯度下降常违反经典稳定条件却仍能收敛的现象,扩展既有一维余维理论到任意余维最小二乘和一族平坦极小值流形。核心洞察是大步长 GD 可分解为沿解流形对 sharpness 的黎曼梯度下降、顶 Hessian 方向的翻转分岔振荡及其余方向收缩。文中给出正规形与三类收敛定理,并证明深度矩阵分解满足该框架,数值实验支持预测。

Projected incrementally scattering passive systems on closed convex sets Figure 1
2026-07-10math.OC

Projected incrementally scattering passive systems on closed convex sets

Shantanu Singh, Sébastien Fueyo, George Weiss

Department of Electrical and Computer Engineering, Technical, Inria, Grenoble INP, GIPSA-lab, Grenoble, France. 2, School of, Electrical Engineering, Tel Aviv University, Ramat Aviv, Tel Aviv

2026-07-10优化算法

本文动机是处理无源无限维系统在物理约束下运行时的适定性与能量性质,例如电流限幅或受限位移。核心洞察是将最大耗散算子投影到闭凸集的切锥后仍保持最大耗散,从而可生成收缩半群。主要结果证明受闭凸状态约束的增量散射无源系统仍保持增量散射无源,并给出柱形域 Maxwell 方程中故障限流器的应用。

ARGUS: Accelerated, Robust, General, and Unsupervised Cell Tracking Solutions Figure 1
2026-07-10cs.CV

ARGUS: Accelerated, Robust, General, and Unsupervised Cell Tracking Solutions

Noah Jaitner, Kandice Tanner, Ingolf Sack, Hossein S. Aghamiry

Department of Radiology, Charité – Universitätsmedizin Berlin, 10117 Berlin, Germany, Laboratory of Cell Biology, Center for Cancer Research, National Cancer Institute, National Institutes of Health, Bethesda, MD, USA

2026-07-10视觉感知安全鲁棒

活细胞显微序列中的噪声、形变、遮挡及分裂融合事件,使大规模细胞轨迹分析难以兼顾精度和速度。ARGUS以训练无关的两阶段框架结合自适应检测、Farneback稠密光流、线性分配和短时隙tracklet重连,用局部运动先验降低关联复杂度。CTC数据上检测准确率0.905–0.971、跟踪准确率0.897–0.964,运行时间约1分钟内,但复杂事件下的增益来源仍需更多拆解。

Sub-Infinite Horizon Stochastic Linear-Quadratic Optimal Control Problems and Delayed Backward Riccati Equations Figure 1
2026-07-10math.OC

Sub-Infinite Horizon Stochastic Linear-Quadratic Optimal Control Problems and Delayed Backward Riccati Equations

Yutao Chen, Hongwei Lou, Hanxiao Wang

School of Mathematical Sciencess

2026-07-10规划控制

本文关注“初始时刻可无限延后、但只优化未来固定窗口”的随机 LQ 控制场景,动机是弥合有限时域与无限时域反馈设计的差距。核心洞察是传统最优控制会随重新规划而时间不一致,因此转向时间一致、局部最优且时间不变的均衡策略,并由此引入带延迟项的后向 Riccati 方程。主要结果包括证明该方程解可生成均衡策略,在稳定化条件下建立可解性,说明一般不唯一且稳定化条件必要,并分析 T 趋于无穷时的收敛行为。

On the stability of proximal operators in Wasserstein spaces under different notions of convexity Figure 1
2026-07-10math.OC

On the stability of proximal operators in Wasserstein spaces under different notions of convexity

Simone Di Marino, Sara Farinelli, Emanuele Naldi

2026-07-10优化算法

本文针对 Wasserstein 空间中近端算子是否保持 Hilbert 空间式非扩张性这一开放问题,系统比较不同凸性假设的稳定性后果。核心洞察是:全凸性可保证近端映射 1-Lipschitz,但该条件受凸序单调性强烈限制;作者进一步提出 2-base generalized geodesics 凸性以恢复非扩张性,并证明一般广义测地凸情形下仅能得到弱非扩张、局部 1/2-Hölder 及靠近 Dirac 或极小点时的条件 Lipschitz 估计。

Accelerated Golden Ratio Primal--Dual Algorithm for Structured Convex Optimisation without Linesearch Figure 1
2026-07-10math.OC

Accelerated Golden Ratio Primal--Dual Algorithm for Structured Convex Optimisation without Linesearch

Santanu Soe, V. Vetrivel

2026-07-10优化算法

本文针对含局部光滑可微项的结构化凸优化,动机是避免依赖全局 Lipschitz 常数、线搜索或人为步长上界。核心洞察是自适应黄金比例原始-对偶规则本身会约束步长,因此可去掉 aEGRPDA 的步长 cap。论文证明无 cap 方法仍有遍历 O(1/N) 残差与可行性界,在强凸情形给出线性收敛,并构造两类加速变体达到遍历 O(1/N²),实验仅在泊松成像上初步验证稳健性。

Sharp Spectral Bounds for Symmetric Positive Definite Tensors via Multiple Algebraic Invariants Figure 1
2026-07-10math.OC

Sharp Spectral Bounds for Symmetric Positive Definite Tensors via Multiple Algebraic Invariants

Hemant Sharma, Snigdhashree Nayak, Ankit Singh

Department of Mathematics, Indian Institute of Information Technology, Design and Manufacturing Kancheepuram-600127, India, Department of Mathematics, Ravenshaw university, Odisha-753003, India, Department of Applied Sciences and Humanities, SVKM’s College of Engineering, Shirpur-425405, India

2026-07-10学习理论

本文针对对称正定张量 H-特征值界中既有 trace–determinant 方法依赖 AM-GM 松弛、且只利用少量谱不变量的问题,提出用精确约束优化替代松弛,并引入高阶幂和形成 K 不变量层级。核心结果是证明极值谱最多含 K 个不同取值,将问题化为低维多项式系统;实验显示三不变量界把中位相对高估从 53% 降至 6%,并改进 Lyapunov 吸引域估计。

Local Linear Convergence of the Primal-Dual Hybrid Gradient Method for Semidefinite Programming Figure 1
2026-07-10math.OC

Local Linear Convergence of the Primal-Dual Hybrid Gradient Method for Semidefinite Programming

Xin Jiang

Department of Industrial and Systems Engineering

2026-07-10优化算法学习理论

本文针对大规模半定规划中 PDHG 易获得中等精度、但高精度收敛机理不足的问题,给出局部收敛解释。核心洞察是把 PDHG 视为 KKT 包含的预条件近端点法,并用 PSD 锥的谱几何或 KKT 强正则性建立局部误差界。主要结果表明,在严格互补或原始-对偶非退化任一条件下,PDHG 最终线性收敛;若两者均失效,则可能仅次线性收敛,数值实验支持这些现象。

Expressivity and Statistical Trade-offs in Diffusion Policy Learning Figure 1
2026-07-10stat.ML

Expressivity and Statistical Trade-offs in Diffusion Policy Learning

Viet Vu, Renyuan Xu, Jiacheng Zhang, Yufei Zhang

Stanford University

2026-07-10生成模型强化学习

本文关注扩散策略在连续动作强化学习中为何更有表达力、以及有限样本下如何选择模型复杂度。核心洞察是将漂移项的 Lipschitz 预算 K 作为统一刻画量:K 增大可使策略以 1/K 量级逼近确定性最优策略,但也提高统计复杂度。论文给出匹配下界、有限样本价值差率,并说明耗散漂移类可获得更优收敛,同时用实验支持按样本量调节 K 的原则。

Size independence of consistency index for pairwise comparison matrices in analytic hierarchy process Figure 1
2026-07-10stat.ME

Size independence of consistency index for pairwise comparison matrices in analytic hierarchy process

Tsuneshi Obata, Shunsuke Shiraishi

Faculty of Science and Engineering, Otemon Gakuin University, 2-1-15 Nishiai, Ibaraki, Osaka, 567-8502 Japan, Faculty of Applied Information Science, Hiroshima Institute of Technology, 2-1-1 Miyake, Saeki-ku, Hiroshima 731-5193 Japan

2026-07-10优化控制

本文针对 AHP 成对比较矩阵中 CI/CR 阈值随矩阵规模是否可比的问题,提出用 super-PCM 与删除单项得到的 sub-PCM 关系刻画“规模无关”的平均保持性质。作者据此修正既有指标,证明其与 CI* 等价,并通过随机矩阵实验显示不同一致性指标对规模变化的响应差异,说明 sub-PCM 分析还能定位破坏一致性的比较项。

Empirical Comparison of Unified Benders Cuts for Multi-Commodity Fixed-Charge Network Design Figure 1
2026-07-10math.OC

Empirical Comparison of Unified Benders Cuts for Multi-Commodity Fixed-Charge Network Design

Eric Larsen, Jean-François Cordeau, Antonio Frangioni, Emma Frejinger

2026-07-10优化控制

针对统一 Benders 割在多商品固定费用网络设计中的效果证据分散、基线不统一的问题,本文把多类统一与传统割放到同一数学框架和标准实例集下比较,并设计异质实例上的性能评估方法。实验覆盖 50 种 Benders 方法及直接求解,结果显示静态 Brandenberg–Stursberg 割和 Hosseini–Turner l1-deepest 割较领先,但直接 branch-and-cut 整体最快,提示部分复杂统一割的增益来源并不稳固。

On the Approximation of Optimal Control in Regime-Switching Diffusions Figure 1
2026-07-10math.OC

On the Approximation of Optimal Control in Regime-Switching Diffusions

Somnath Pradhan, Dinesh Rathia

†Department of Mathematics, Indian Institute of Science Education and Research Bhopal, Bhopal, ‡Department of Mathematics, Indian Institute of Science Education and Research Bhopal, Bhopal

2026-07-10生成模型规划控制

针对状态依赖的 regime-switching 扩散控制难以直接数值求解的问题,本文从可实现策略近似入手,证明有限动作、分段常数和 Lipschitz 策略可达 ε 最优;进一步结合 Euler-Maruyama 离散化与状态量化,给出有限时域值函数 O(h^{γ/2}) 收敛和有限状态模型策略的渐近最优性。

Tree-based solution representations for quadratic bilinear systems and their consequences in model order reduction Figure 1
2026-07-10math.OC

Tree-based solution representations for quadratic bilinear systems and their consequences in model order reduction

Martin Redmann

2026-07-10优化控制

针对二次双线性系统的模型降阶缺少线性情形那样的 Gramian 解释、存在性条件和误差界,本文用满二叉树展开解的层级结构,将非线性动力学分解为耦合双线性子系统。由此给出全局解与输出界条件,定义时间有限和无限时域的可达/可观 Gramian,并推导非线性矩阵方程、核空间无损消除、平衡截断方法及先验降阶误差界。

Trustworthy Machine Learning through the Lens of Combinatorial Optimization: Survey and Research Perspectives Figure 1
2026-07-10cs.LG

Trustworthy Machine Learning through the Lens of Combinatorial Optimization: Survey and Research Perspectives

Thibaut Vidal, Julien Ferry

2026-07-10优化算法

本文针对高风险机器学习中“精度相近但可信属性差异很大”的模型选择问题,综述用组合优化刻画可解释性、鲁棒性、公平性、隐私与认证。核心洞察是把训练后审计、验证和解释也转化为可行性或优化问题,从而获得全局最优、形式证书和权衡分析;主要结果是给出跨 MIP、SAT、SMT、CP 等方法的统一框架,同时指出规模化仍是关键瓶颈。

Integrated equilibrium model for electrified logistics and power systems Figure 1
2026-07-10eess.SY

Integrated equilibrium model for electrified logistics and power systems

Rui Yao, Xuhang Liu, Anna Scaglione, Shlomo Bekhor, Kenan Zhang

2026-07-10优化控制

面向电动物流车队与电网相互影响难以用外生电价或固定负荷刻画的问题,论文构建物流运营商与电力系统运营商的耦合均衡模型:用 PU-MDP 描述电卡车路径、配送和充电决策,并与含充电需求的 DC-OPF 电价形成固定点。作者证明均衡存在,并在夏威夷网络上用 Anderson 加速求解,结果显示电卡车充电会在拥塞高峰显著改变局部边际电价,而电价反过来会抑制或转移部分区域充电需求。

A general equilibrium model for multi-passenger ridesharing systems with stable matching Figure 1
2026-07-10econ.GN

A general equilibrium model for multi-passenger ridesharing systems with stable matching

Rui Yao, Shlomo Bekhor

- Department of Civil and Environmental Engineering, Technion – Israel Institute of Technology, Haifa, Israel

2026-07-10优化控制

针对拼车系统中乘客、兼职司机、平台匹配与路网拥堵相互影响却常被割裂建模的问题,本文构建多乘客、多OD的一般均衡框架,将稳定匹配序列嵌入超网络以避免乘客换乘,并给出存在性证明与sequence-bush求解算法。数值结果显示该算法优于通用求解器;拼车行程通常更长,合理的单位价格才可能带来网络收益,低时间价值旅客更倾向参与。

A variational autoencoder approach for choice set generation and implicit perception of alternatives in choice modeling Figure 1
2026-07-10cs.AI

A variational autoencoder approach for choice set generation and implicit perception of alternatives in choice modeling

Rui Yao, Shlomo Bekhor

Department of Civil and Environmental Engineering, Technion – Israel Institute of Technology, Haifa 32000, Israel, availability/perception (IAP) of alternatives and proposes a variational autoencoder (VAE), available alternatives to them. It involves two main steps: choice set generation and modeling, ). Recently, Yao and Bekhor (2020) combine labeling method (Ben-Akiva et al., 1984)

2026-07-10优化控制

本文针对大规模选择建模中真实选择集不可观测、全量枚举不现实且传统生成规则易导致估计偏差的问题,将隐式可用/感知(IAP)并入GEV框架,并用VAE学习路线选择集生成过程,以提高已选 alternatives 被感知的概率。真实路线数据上,IAP-CNL相较MNL和常规选择集生成方法取得更好的拟合与预测表现,仿真实验也检验了系数一致性,但高IAP筛选下仍出现偏差。

2026-07-08

26 篇
GraphBU: MILP Instance Generation with Graph-Native Block Units Figure 1
2026-07-08cs.LG

GraphBU: MILP Instance Generation with Graph-Native Block Units

Xiaolei Guo, Chenyu Zhou, Jianghao Lin, Dongdong Ge

2026-07-08优化控制

针对真实 MILP 数据难获取且通用生成器容易破坏求解器依赖结构的问题,GraphBU 将实例表示为约束-变量二部图,并以“局部子问题+显式接口”的图原生块单元进行兼容替换。实验显示其图统计相似度约 0.934、可行率约 96.7%,并使下游 Predict-and-Search 指标平均提升约 8.0%,但增益来源可能部分来自生成数据规模。

Convergent realizations of Lie subalgebras Figure 1
2026-07-08math.DG

Convergent realizations of Lie subalgebras

Karine Beauchard, Jérémy Le Borgne, Frédéric Marbach

2026-07-08优化控制

这篇论文的动机是把有限余维李子代数的形式向量场实现推进到局部解析、可收敛的情形,以支撑控制仿射系统中的 Chen-Fliess 级数实现与系统等价问题。核心洞察是用嵌套李括号在商空间中的阶乘型增长估计刻画可收敛性,并证明该条件与存在收敛实现等价;同时给出 Blattner-Draisma 显式实现的收敛性及输出实现推广。

Adaptive and Neural Operator Control of Nonlinear Volterra Hyperbolic PDEs Figure 1
2026-07-08eess.SY

Adaptive and Neural Operator Control of Nonlinear Volterra Hyperbolic PDEs

Miroslav Krstic

2026-07-08规划控制

针对未知非线性 Volterra 双曲 PDE 中模型未知且反步增益需随在线估计反复求解的问题,本文把被动自适应辨识与离线训练的神经算子串联:前者在线估计截断核,后者近似从估计参数到反步核的生成映射。文中证明闭环稳定、状态与输入渐近调节,并说明神经算子误差趋小时可恢复精确核控制的吸引域。

Feature Learning for the High Dimensional Stationary Schödinger Equation with Deep Ritz Method Figure 1
2026-07-08math.OC

Feature Learning for the High Dimensional Stationary Schödinger Equation with Deep Ritz Method

Yao Yao, Yulong Lu, Gilad Lerman

School of Mathematics, University of Minnesota Twin Cities

2026-07-08优化控制

针对深度 Ritz 方法求解高维定态薛定谔方程时“网络是否真的学到低维特征”缺乏理论解释的问题,本文从有限宽模型而非 NTK 或无限宽极限出发,分析单指标与双神经元假设类的 Ritz 损失。结果表明,单指标情形下梯度下降可在对数迭代内达到近似全局最优,源项具单指标结构时最优特征与源特征对齐;双神经元情形揭示第二特征的出现依赖正则化强度,强联合惩罚可能导致特征塌缩。

Sharp Logarithmic Thresholds for Cut Schedules in an Abstract Branch-and-Cut Model Figure 1
2026-07-08math.OC

Sharp Logarithmic Thresholds for Cut Schedules in an Abstract Branch-and-Cut Model

Hongyi Jiang

Department of Systems Engineering, City University of Hong Kong

2026-07-08优化控制

本文关注 branch-and-cut 中分支与割平面如何共同证明界限这一理论问题。核心洞察是把割强度的累积量与 log k 比较,给出割是否真正改变树规模的尖锐阈值;同时用 λ⋆ 处理非对称分支。主要结果包括纯分支叶数的指数级双边界、割贡献比例的三分法,以及多项式规模当且仅当多项式个割把剩余界降到 O(log Z)。

Does Financial Trading Smooth Non-Convex Markets? Figure 1
2026-07-08math.OC

Does Financial Trading Smooth Non-Convex Markets?

Nicolas Stevens, Peter Cramton, Martial Toniotti

2026-07-08优化算法

本文关注非凸电力拍卖中均衡价格可能不存在、需依赖场外补偿的问题,核心洞察是凸性的金融虚拟交易若集中在边际附近,可平滑非凸性并改善定价。论文建立日前与实时两阶段模型,并利用PJM 2020年交易费导致虚拟交易量下降的事件检验,发现交易减少伴随补偿支付显著上升,支持金融交易降低维持出清配置所需侧支付的结论。

Gradient descent with exponentially increasing stepsizes and restarts Figure 1
2026-07-08math.OC

Gradient descent with exponentially increasing stepsizes and restarts

François Clément, Stefan Steinerberger

Department of Mathematics, University of Washington, Seattle, Department of Mathematics and Department of Applied Mathematics, University of Washington, Seattle

2026-07-08优化算法

本文试图利用指数增大步长的梯度下降在发散前快速接近极小点的现象,提出以相邻更新幅度增长作为触发条件的重启机制。核心洞察是让步长自动探测可用尺度,失稳即回到初始步长,计算成本近似普通梯度下降。理论上在非退化局部极小点附近给出二次型情形的渐近指数收敛率和重启密度,并显示对过小初始步长更不敏感;数值例子支持其在凸与非凸问题上的加速。

Optimal control problems of Stochastic Volterra integral equations under Volatility Ambiguity Figure 1
2026-07-08math.OC

Optimal control problems of Stochastic Volterra integral equations under Volatility Ambiguity

Bingru Zhao, Mingshang Hu

Zhongtai Securities Institute for Financial Studies, Shandong University

2026-07-08规划控制

本文面向具有记忆效应和波动率不确定性的随机控制问题,研究由 G-Brownian 运动驱动的随机 Volterra 积分方程。核心在于用 G-随机分析、弱收敛与 minimax 技术处理非支配概率族和不可微 G-鞅项,建立成本泛函变分、变分不等式及一般滤过下 BSVIE 对偶框架,并在凸性条件下给出随机最大值原理的必要与充分最优性条件。

Learning When to Automate: Queue Control in Human-AI Service Systems Figure 1
2026-07-08cs.LG

Learning When to Automate: Queue Control in Human-AI Service Systems

Giovanni Montanari, Marco Scarsini, Vianney Perchet

Department of Economics and Financial Markets, Luiss University, Criteo AI Lab, Paris, France

2026-07-08规划控制

这篇论文关注人机混合服务中“何时自动化”的控制问题:聊天机器人可降低人工队列压力但带来成本,过少自动化又会造成拥塞。核心洞察是将自动化资源分配与人工调度视为耦合的队列控制问题,并用 UCB-DPP 在未知成功率和服务率下边学边控。理论上给出约 O~(K√T) 后悔界并保证人工队列均率稳定,合成仿真优于若干自然基线。

Stability Annealing Selects the Implicit Bias of Smoothed Sign Descent: A Rate-Indexed Barrier Path on Separable Data Figure 1
2026-07-08cs.LG

Stability Annealing Selects the Implicit Bias of Smoothed Sign Descent: A Rate-Indexed Barrier Path on Separable Data

Xiangwu Wang, Chengwei Cao, Yicheng Song, Ran Bi, Peilin Yu

2026-07-08优化控制

本文针对自适应/符号类优化中数值稳定项会改变可分数据隐式偏置的问题,研究稳定项按累计学习率指数退火时会选择哪类分隔器。核心洞察是退火速率可转化为边际约束,平滑符号更新对应到熵镜像上升,并由 Burg 型 barrier 在该约束切片上选点。主要结果证明指数损失下归一化迭代收敛到该 barrier 最小解,给出收敛包络;实验主要验证对偶恒等式、速率路径和固定稳定项 crossover。

A Semismooth Newton Augmented Lagrangian Method for Sparse Spectral Risk Optimization Figure 1
2026-07-08math.OC

A Semismooth Newton Augmented Lagrangian Method for Sparse Spectral Risk Optimization

Rufeng Xiao, Rujun Jiang, Xudong Li, Defeng Sun

2026-07-08优化算法安全鲁棒

针对平均经验风险会低估少数高损失样本、而谱风险排序项带来非光滑和非可分难题,论文提出相对不精确近端增广拉格朗日-半光滑牛顿方法。其关键在于通过对偶重构与 Moreau 包络把子问题化为结构化对偶变量形式,并定制 PAVA 及广义雅可比计算。合成与真实数据实验显示,相比测试的 ADMM 基线运行时间更低,同时保持相近驻点残差和稀疏解。

Higher-Order Derivatives Do Not Accelerate the Computation of Fixed Points Figure 1
2026-07-08math.OC

Higher-Order Derivatives Do Not Accelerate the Computation of Fixed Points

Uijeong Jang, Ernest K. Ryu

2026-07-08优化控制

本文针对“固定点计算能否像优化那样借助高阶导数加速”的问题,指出传统仿射下界会被一次雅可比查询击穿。核心构造是平坦近零、尾部仿射的光滑收缩算子,并用抵抗 oracle 隐藏未来方向。结果证明任意有限阶导数信息都不能改善光滑收缩固定点的最坏情形误差与残差率,Picard 迭代在固定点误差上达到精确最优。

Spectral-gauge cuts for semidefinite programming Figure 1
2026-07-08math.OC

Spectral-gauge cuts for semidefinite programming

Antonio Sasaki (CMA), Sophie Demassey (CMA), Valentina Sessa (CMA)

SDPs to high accuracy [24, 5]. Their scalability, however, is limited by the dense

2026-07-08优化控制

针对半定规划中内点法扩展性受限、传统特征值割易带来主问题数值负担的问题,本文用对称 gauge 统一刻画 PSD 外逼近割,给出闭式分离 oracle,并将特征值割、核范数割、Frobenius 及稀疏/低秩变体纳入同一框架。实验显示,在二次规划和稀疏 PCA 上,LP 松弛结合特征值割或 Frobenius 割通常在界质量与计算成本间较稳健,但不存在始终占优的割模板。

No Subspace to Track: Non-Identifiability and Optimizer State in Low-Rank Training Figure 1
2026-07-08cs.LG

No Subspace to Track: Non-Identifiability and Optimizer State in Low-Rank Training

Noel Thomas

Mohamed bin Zayed University of Artificial Intelligence

2026-07-08优化控制

这篇论文针对 GaLore 等低秩优化器默认“梯度低秩子空间可被持续跟踪”的动机假设,直接测量刷新前后的子空间可识别性。核心洞察是:除少量可复现方向外,所谓旋转主要是小批量估计噪声,平均也难以恢复稳定子空间。实验显示该现象跨模型规模与架构存在;更有效的改进不是稳定基,而是在刷新时搬运 Adam 状态,LDAdam 在 1B、40k 步下优于调 β2 后的未搬运 GaLore。

On the Condition Number Upper Bound of the L-BFGS Inverse Hessian Approximation Matrix with a Two-Sided Geometric Envelope Safeguarding Mechanism Figure 1
2026-07-08math.OC

On the Condition Number Upper Bound of the L-BFGS Inverse Hessian Approximation Matrix with a Two-Sided Geometric Envelope Safeguarding Mechanism

Don Li

\addr Department of Mathematics & Statistics, Portland State University

2026-07-08学习理论安全鲁棒

本文针对非凸或病态优化中 L-BFGS 逆 Hessian 近似条件数失控、导致数值不稳和线搜索低效的问题,提出用双侧几何包络筛选曲率更新,在不改变 O(mn) 复杂度的前提下给出条件数统一上界。理论上证明保留全局收敛性质,实验显示在高维病态基准和 MNIST 自编码器上更少崩溃、方向更稳定并改善收敛。

Commutator-Driven Stability Bounds for Periodic Switching Figure 1
2026-07-08math.OC

Commutator-Driven Stability Bounds for Periodic Switching

Debanjan Mallik, Nikhil Chopra

The authors are with Institute for Systems Research, University of Maryland, College Park, MD 20742, USA.

2026-07-08学习理论

本文针对周期切换线性系统中“平均模型稳定但真实切换系统未必稳定”的问题,指出关键误差来自各模式生成元的不对易性。核心创新是给出显式算子范数分裂误差界,将主导项直接写成成对交换子范数,并嵌入 Lyapunov 收缩度量。由此得到可计算的切换周期阈值,推广到多模式循环调度,并用采样 SDP 构造随占空比变化的稳定性证书。

Distributionally Robust Optimization via Targeted Integral Probability Metrics for General Data Processes Figure 1
2026-07-08math.OC

Distributionally Robust Optimization via Targeted Integral Probability Metrics for General Data Processes

Lanran Fang, Jianqiang Cheng, Grani A. Hanasusanto, Yijie Wang

2026-07-08优化算法安全鲁棒

本文针对传统DRO先定义分布距离、再服务下游损失所造成的统计与任务错配,提出以目标化积分概率度量直接约束可行决策诱导的损失差异。该思路把鲁棒半径校准转化为标量损失集中问题,可在重尾、马尔可夫、污染和缺失数据下获得近似N^{-1/2}有限样本保证,并给出对偶形式、蒙特卡洛近似及库存和回归实验验证。

Traveling Salesman Tardiness Figure 1
2026-07-08math.OC

Traveling Salesman Tardiness

Haoyue Liu, Sheng Liu

2026-07-08优化控制

面向配送路线常因客户空间分布变化而超出服务时窗的问题,本文用鲁棒满足框架定义 TSP tardiness index,以 Wasserstein 分布偏移刻画路线目标的脆弱性,并给出可由二阶锥规划高效计算的形式。核心结果证明该指标在非边界情形下按 n√(|D|m)/τ 缩放,区别于经典 TSP 的 √n 规律,并扩展到多车辆分区;合成与真实数据实验显示其可预测加班率和加班幅度。

Stability and Dual Valuation of Contingent Claims under Rockafellian Perturbations Figure 1
2026-07-08math.OC

Stability and Dual Valuation of Contingent Claims under Rockafellian Perturbations

Wolfgang Breytmann, Julio Deride, Nicolás Hernández

2026-07-08优化控制

本文针对离散时间或有限场景下或有索赔定价对概率误差、支持扰动和异常场景高度敏感的问题,引入 Rockafellian 扰动作为稳定性分析框架。核心洞察是用乐观式问题松弛统一刻画分布、索赔及联合扰动,并通过 epi/hypo 收敛连接原始问题与对偶影子价格。主要结果给出最优值、解与对偶变量收敛条件,说明对偶间隙与完美信息价值的关系,并构造失稳反例界定适用边界。

Sphere Constraints and Harmonic Map Flow: Controllability and Reachability by Low-Mode Forcing Figure 1
2026-07-08math.OC

Sphere Constraints and Harmonic Map Flow: Controllability and Reachability by Low-Mode Forcing

Debopriya Mukherjee, Kistosil Fahim, Erika Hausenblas

CONTROLLABILITY AND REACHABILITY BY LOW-MODE FORCING, Abstract. We study the controllability and reachability of sphere-constrained evolution equa-, Sphere-constrained flows, harmonic map heat flow, controllabil-, equation and its controllability properties, making the study of geometric control and reachability, Controllability and reachability for geometric evolution equations. The controllability of, Coron and Xiang proved global controllability of the harmonic map heat flow from the circle, controllability and reachability properties for infinite-dimensional systems driven by boundary, perturbations and boundary forcing. In particular, the controllability and qualitative behavior

2026-07-08生成模型规划控制优化算法

本文关注谐波映射热流等球面约束演化方程在低维、低模态控制下的可控性问题,动机是解释有限执行模态如何影响无限维流形值动力学。核心做法是转到傅里叶变量,把系统写成无限维控制仿射形式,并用受控向量场的迭代李括号刻画非完整模态耦合。主要结果表明,低模态强迫可生成新的可允许方向,扩大可达集,并给出谐波映射热流近似可控与可达集合的条件。

Deep Reinforcement Learning for Dynamic Battery Management of Autonomous Order Pickers Figure 1
2026-07-08cs.LG

Deep Reinforcement Learning for Dynamic Battery Management of Autonomous Order Pickers

Taniya Shaji, Abhay Sobhanan, Christof Defryn

Indian Institute of Management Bangalore, Bannerghatta Road, Bengaluru 560076, Karnataka, India, University of Antwerp, Prinsstraat 13, Antwerp 2000, Belgium

2026-07-08强化学习

论文聚焦仓库自主移动机器人在随机订单到达和充电桩拥堵下的动态电池管理问题,动机是固定阈值充电规则难以协调多机器人并会牺牲吞吐。作者用基于 PPO 的多智能体强化学习同时学习何时充电、选哪个充电站、充多久,并把预期排队时间和回仓卸货决策纳入状态/动作设计。数值实验显示相对最强基线订单完成率最高提升约 6%,且减少充电相关耗时,但具体增益在多大程度来自动作空间设计、队列建模或训练规模仍需进一步拆解。

Orthogonal Dendritic Intrinsic Networks: An Architecture for Significance-Ordered, Orthogonal Latent Spaces Figure 1
2026-07-08cs.LG

Orthogonal Dendritic Intrinsic Networks: An Architecture for Significance-Ordered, Orthogonal Latent Spaces

Jeanie Schreiber, Tyrus Berry, Zeeshan Ahmed

\addr Department of Mathematical Sciences, George Mason University, \addr Sensor Science Division, Physical Measurement Laboratory

2026-07-08优化控制

论文针对深度自编码器潜空间常出现维度纠缠、无重要性排序且跨训练不稳定的问题,提出 ODIN:通过树突式解码访问机制让前 k 个潜变量逐步承担重构,并在训练目标中加入几何正交约束,使非线性潜空间接近 PCA 的正交与方差排序结构。作者给出理论动机,并在合成与真实数据上验证其可获得更可解释、可复现实验比较的结构化表征。

Input-to-State Stability Implications in Contraction Theory Figure 1
2026-07-08eess.SY

Input-to-State Stability Implications in Contraction Theory

Yu Kawano, Francesco Bullo

Graduate School of Advanced Science and Engineering, Hiroshima University, Higashi-Hiroshima 739-8527, Japan, Department of Mechanical Engineering and the Center for Control, Dynamical Systems, and Computation, University of California, Santa Barbara, USA

2026-07-08学习理论

本文面向非线性控制系统中收缩性与增量输入到状态稳定性之间的经典对应问题,动机是给出可检验的等价刻画。核心洞察是通过变分系统连接原系统的增量 ISS 型界、无穷小收缩条件与增量 Lyapunov 条件;主要结果是在仅需连续可微假设下给出必要与充分条件,并说明两者差别集中在输入 Lipschitz 常数,同时讨论对灵敏度矩阵和 Lyapunov 指数的含义。

On The Linear Convergence of Bregman Proximal Gradient Methods with Applications to Kullback--Leibler regression Figure 1
2026-07-08math.OC

On The Linear Convergence of Bregman Proximal Gradient Methods with Applications to Kullback--Leibler regression

Jonathan Chirinos-Rodríguez, Christian Daniele, Cédric Févotte, Emmanuel Soubies

University of Toulouse, Toulouse INP, CNRS, IRIT, France, MaLGa Center, DIBRIS, University of Genoa, Italy, Laboratoire J. A. Dieudonn´e, Universit´e Cˆote d’Azur, France

2026-07-08优化算法学习理论

本文针对传统近端梯度在线性收敛分析中依赖强凸性、而 KL 回归等逆问题常不满足该假设的问题,提出受限相对强凸性 RRSC,将受限强凸推广到 Bregman 几何。论文证明 BPGM 在该条件及回溯步长下可线性收敛,并指出常用 Burg 熵只在部分 KL 情形有效,平滑 Burg 熵能覆盖更广的正则化与非唯一解场景,数值实验与理论结论一致。

iSTAR: an algebraic-collapse framework for variational reduction in quantum-inspired continuous Ising solvers Figure 1
2026-07-08math.NA

iSTAR: an algebraic-collapse framework for variational reduction in quantum-inspired continuous Ising solvers

Bowen Liu, Dongmei Xiao

eBay Inc. Shanghai, China., School of Mathematical Sciences, Shanghai Jiao Tong University, Shanghai 200240, China.

2026-07-08优化算法

本文针对连续 Ising 求解器每步密集相互作用计算代价高的问题,提出 iSTAR 的冻结集变分约化框架:当后期分岔轨迹中部分自旋符号稳定后,将其精确消元并转化为未决子系统的诱导外场。论文给出四次软自旋模型的大参数恢复、弹道硬盒极限和鲁棒冻结判据,并在 G-set 上报告同种子结果不变、平均减少 64.4% 密集交互工作量。

Quadratic Programming Approach for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games Figure 1
2026-07-08cs.GT

Quadratic Programming Approach for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games

Sam Ganzfried

2026-07-08优化控制

本文针对多人不完美信息博弈中精确求纳什均衡困难、CFR/虚拟博弈无收敛保证的问题,将序列式表示下的非线性互补条件转化为二次约束可行规划,借助非凸二次优化求解。实验显示,在去除支配动作后的三人 Kuhn 扑克中,该方法约 2.5 秒得到极低偏离收益的均衡,快于 Gambit 中可成功求解的 logit QRE;但文中也承认扩展到完整游戏时可扩展性受限。

2026-07-07

69 篇
An Analytical Newsvendor Framework for Risk-Averse Energy Storage Capacity Reservation under Non-Normal Uncertainty Figure 1
2026-07-07math.OC

An Analytical Newsvendor Framework for Risk-Averse Energy Storage Capacity Reservation under Non-Normal Uncertainty

Nuerxiati Abudurexiti

2026-07-07安全鲁棒

面向储能运营商在价格尖峰、可再生误差和辅助服务调用等非正态不确定性下提前预留容量的问题,论文将该决策抽象为报童模型,并把期望利润、CVaR尾部损失和候选分布下最大后悔统一到一个可标量化的凸框架中。核心洞察是容量选择受关键分位数驱动,正态矩匹配会扭曲重尾/偏态情形下的预留量;数值实验显示正态策略最多过度预留1.337单位,而风险规避和后悔最小策略可降低尾部损失与分布错配后悔,但需牺牲期望利润。

Adaptive direct search algorithms with relaxable and quantifiable constraints Figure 1
2026-07-07math.OC

Adaptive direct search algorithms with relaxable and quantifiable constraints

Charles Audet, Théo Denorme, Youssef Diouane, Sébastien Le Digabel, Christophe Tribes

2026-07-07优化算法

针对约束黑箱优化中可量化、可放松约束会被极端屏障过早丢弃的问题,论文提出 ADS-PB,将渐进屏障引入无网格、无充分下降要求的自适应直接搜索,使不可行点的目标值和约束违背度都能参与搜索。文中给出温和假设下的收敛分析,并在解析与仿真约束测试上与 MADS-PB 等求解器比较,显示其在保留模型/启发式候选点质量时更有优势。

An augmented Lagrangian method with exact multipliers for non-separable composite $\ell_0$-$\ell_2$ regularization Figure 1
2026-07-07math.OC

An augmented Lagrangian method with exact multipliers for non-separable composite $\ell_0$-$\ell_2$ regularization

Huan Ren, Guiyun Xiao

2026-07-07优化控制

针对逆问题中ℓ0稀疏性与ℓ2平滑性并存、且线性变换导致非可分和难以求解的问题,本文提出带精确乘子的增广拉格朗日框架,分别处理满行秩与一般矩阵情形,并使子问题可闭式全局求解。理论上给出满行秩时线性收敛、一般情形聚点为KKT点;实验在合成数据、趋势滤波和图像平滑中显示较既有不精确方法更快且更准。

Multi Impulse Low Earth Orbit Maneuver Synthesis Through Thrust Measure Primer Vector Conditions and Piecewise Multiple Shooting Figure 1
2026-07-07math.OC

Multi Impulse Low Earth Orbit Maneuver Synthesis Through Thrust Measure Primer Vector Conditions and Piecewise Multiple Shooting

Pedro Kuntz Puglia, Willer Gomes dos Santos, Emilien Flayac

2026-07-07优化控制

面向低轨卫星在J2摄动和大气阻力下的省燃料脉冲机动,论文将primer vector理论以推力测度形式重新推导,并区分非保守动力学中的STM与PVTM,结合分段多重打靶求解固定时长、固定边界的多脉冲问题。数值案例显示,在Kepler、J2和J2+Drag模型中该条件可诊断并改进机动方案,降低delta-V成本,但具体最优性与工程增益幅度仍依赖所选场景。

Pathological Regimes of Closed-Loop Recommendation Systems over Social Networks Figure 1
2026-07-07eess.SY

Pathological Regimes of Closed-Loop Recommendation Systems over Social Networks

Mariano Simone, Frasca Paolo

2026-07-07优化控制

本文动机是解释社交网络推荐系统中,追求参与度的闭环反馈为何会放大极化、回音室和极端观点。核心洞察是把推荐策略建模为无限时域状态反馈最优控制,并指出目标函数权重不仅调性能,还决定问题是否适定。主要结果给出二次阶段成本正定的谱条件;条件失效时,系统可能出现不稳定自由模、有限但不可达的最优值,或仿射反馈综合失败。

Exploring polynomial models in the Search Step of Direct Multisearch Figure 1
2026-07-07math.OC

Exploring polynomial models in the Search Step of Direct Multisearch

Ana Luísa Custódio, Marta Pozzi, Everton José da Silva

2026-07-07优化控制

这篇论文关注 BoostDMS 中二次多项式代理模型“建好之后如何联合最小化”的问题,动机是搜索步直接决定昂贵函数评估点,可能显著影响多目标无导数优化效率。作者将 ε-约束、NBI 与基于 IFSD 的前沿探索策略嵌入 DMS 搜索步,并做数值比较;结果显示模型利用方式会改变性能,部分替代策略优于常用 min-max 标量化,但具体增益来源仍需结合问题规模与参数设置判断。

Mixed precision Newton's method for optimization Figure 1
2026-07-07math.OC

Mixed precision Newton's method for optimization

Nicolas Brisebarre (LIP, CNRS), Giuseppe Carrino (OCKHAM), Theo Mary (PEQUAN), Elisa Riccietti (OCKHAM)

2026-07-07优化算法

本文针对牛顿法在大规模优化中因 Hessian 构造与线性系统求解代价高、低精度又易损害收敛的问题,建立了同时刻画梯度、Hessian 相关计算和迭代更新误差的混合精度分析框架。其核心洞察是用统一扰动模型连接浮点舍入、不精确牛顿和 Gauss–Newton 近似,并给出收敛速率与可达精度界,从而指导不同步骤的精度分配;实验显示这些界能解释混合精度变体的实际行为。

Short-Horizon Sparse Model Predictive Control for Precipitation Reduction Using Numerical Weather Prediction Figure 1
2026-07-07eess.SY

Short-Horizon Sparse Model Predictive Control for Precipitation Reduction Using Numerical Weather Prediction

Yuta Tanikawa, Yuga Tomita, Toshiyuki Ohtsuka

\orgdiv Graduate School of Informatics, \orgname Kyoto University, \orgaddress \state Kyoto, \country Japan

2026-07-07规划控制

面向极端降雨减灾中真实数值天气预报模型维度高、非线性强且灵敏度计算昂贵的问题,本文将短时域MPC与有限差分灵敏度、分块扰动和稀疏凸优化结合,在每次控制时刻重算局部线性模型。暖泡基准实验显示,MPC在75%降雨上限等困难场景下能弥补开环方法的非线性误差,效果接近SHOC且计算时间低于全时域开环和SHOC。

Risk Sensitive Filtering for Singular Systems subject to Round-Robin Protocol Figure 1
2026-07-07math.OC

Risk Sensitive Filtering for Singular Systems subject to Round-Robin Protocol

Ashna Goel, Shovan Bhaumik, Nutan Kumar Tomar

Department of Mathematics, Indian Institute of Technology Patna, India, Department of Electrical Engineering, Indian Institute of Technology Patna, India

2026-07-07安全鲁棒

面向带代数约束的网络化系统,轮询通信会使量测结构周期变化,普通卡尔曼滤波又对模型误差敏感。论文将奇异系统经 Weierstrass 标准形转为轮询诱导周期系统,推导风险敏感递推滤波,并用协方差信息在线调节风险参数以保持预测协方差正定;数值实验显示其相较标准 KF 有更强鲁棒性和更低估计误差,但具体增益幅度依赖算例设置。

Rockafellian relaxation and minimum-norm slack for the Walrasian equilibrium problem Figure 1
2026-07-07math.OC

Rockafellian relaxation and minimum-norm slack for the Walrasian equilibrium problem

Julio Deride

2026-07-07优化控制

本文针对交换经济中 Walras 均衡可能不存在时,传统不动点或同伦算法只给出发散、停滞等难解释现象的问题,引入 Rockafellian 松弛:用非负松弛变量放宽市场出清并惩罚其范数,将问题化为单个正则化配置优化。主要结果证明惩罚增大时残差收敛到可行超额需求范围内的最小范数松弛,从而为“离最近可均衡经济的距离”提供可计算诊断,并在受压 Shapley–Shubik 例子中恢复解析不可行下界。

Infinite Drive: Optimal Urban Location of Dynamic Wireless Charging at Signalized Intersections Figure 1
2026-07-07math.OC

Infinite Drive: Optimal Urban Location of Dynamic Wireless Charging at Signalized Intersections

Yudai Honma, Daisuke Hasegawa, Katsuhiro Hata, Xuesong (Simon) Zhou, Michael J. Kuby, Takashi Oguchi

a) Institute of Industrial Science, The University of Tokyo, b) Center for Real Estate Innovation, The University of Tokyo, c) College of Engineering, Shibaura Institute of Technology, d) School of Sustainable Engineering and the Built Environment, Arizona State University, Tempe, AZ 85281, USA, e) School of Geographical Sciences and Urban Planning, environmental impacts depend critically on the availability of efficient, equitable, and low-carbon

2026-07-07优化控制

城市电动车依赖插电充电会带来绕行、排队和大电池资源负担,本文将动态无线充电选址细化到信号交叉口,显式建模减速、停车排队和信号概率,并用混合整数规划优化路段线圈布设。川越案例显示,基准仅电气化1.51%道路、最保守不超过2.9%,配合12 kWh电池即可支撑约600–800 km连续行程,并减少相对40 kWh电池的制造碳排。

Constrained Flow Matching via Lagrangian Dual Flows Figure 1
2026-07-07math.OC

Constrained Flow Matching via Lagrangian Dual Flows

Vince Kurtz, Alexander Davydov

DePaul University, Rice University

2026-07-07生成模型

面向机器人、规划和物理生成中推理时才出现且常为非线性的约束,论文提出 Lagrangian Dual Flows:在预训练 flow matching 的生成 ODE 中同步演化拉格朗日对偶变量,并用 slack 处理不等式约束,从而避免每步投影、伪逆或优化子问题。理论上证明约束残差以显式代数速率收敛到零;实验覆盖非线性等式/不等式和图像修复,显示比伪逆、惩罚基线约束更紧,且积分成本低于投影/优化方法。

Cooperation in Conic Programming with Applications to Control, Production, and Portfolio Figure 1
2026-07-07math.OC

Cooperation in Conic Programming with Applications to Control, Production, and Portfolio

Miguel Martínez-Antón, Justo Puerto

‡ Institute of Mathematics (IMUS), Universidad de Sevilla

2026-07-07规划控制

针对合作博弈中核心分配存在性通常需组合式验证、难以扩展到复杂优化模型的问题,本文提出“合作锥规划博弈”,用锥规划最优值定义特征函数,并利用锥对偶给出可验证的核心非空条件与由最优对偶解直接构造的收益/成本分摊规则。结果表明,该框架可统一线性、二阶锥、半正定及多类凸非线性合作模型,并覆盖多智能体控制、非线性生产、投资组合与组合优化等应用。

An open, reproducible branch-and-cut for the capacitated profitable tour problem: a component study Figure 1
2026-07-07math.OC

An open, reproducible branch-and-cut for the capacitated profitable tour problem: a component study

Simon Spoorendonk

2026-07-07优化控制

面向容量约束收益旅行问题这一车辆路径定价中的难解子问题,论文动机不是提出新算法,而是补齐可复现的开放基线。作者在 HiGHS 等全开源栈上复现 Jepsen 等人的分支割框架,并做组件消融;结果显示性能收益几乎全部来自容量类割,求解实例由 52/76 提升到 64/76、搜索树缩小十倍以上,而 comb、rounded-GLM、降价固定、界传播和 SPI 割基本无增益。

Two Black Boxes, One Solver: Encoder Probing and Decoder Attribution for Neural Multi-Attribute VRP under Hard-Mask and Recourse Decoders Figure 1
2026-07-07cs.LG

Two Black Boxes, One Solver: Encoder Probing and Decoder Attribution for Neural Multi-Attribute VRP under Hard-Mask and Recourse Decoders

Sohaib Afifi

Univ. Artois, UR 3926, Laboratoire de Génie Informatique et d’Automatique de l’Artois (LGI2A)

2026-07-07优化算法

论文针对多属性车辆路径神经求解器虽能给出较优路线却缺乏逐步解释的问题,提出同时剖析编码器表征与解码器归因的两柱式 XAI 协议。实验比较三类编码器与硬掩码、Recourse 两类解码器,发现图归纳偏置提升约束可预测性和归因 sanity,MoE 更偏分布式编码;Recourse 训练而非单纯软掩码,使模型能形成有用的不可行性表征并产生 make-feasible 反事实解释。

Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning Figure 1
2026-07-07cs.LG

Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning

Faid Keddouri, Sohaib Houhou, Aissa Boulmerka, Nadir Farhi

National School of Artificial Intelligence (ENSIA), Sidi Abdellah Campus, Algiers, Algeria

2026-07-07强化学习

论文关注LLM把人类意图动态转成多智能体强化学习奖励时,离线回放会因旧奖励标签破坏PBRS平稳性。核心洞察是危害取决于未塑形基线能力,并提出分阶段冻结与EMA平滑稳定权重。QMIX在三类环境中显示:Spread中EMA从74.4%升至86.7%、朴素动态更新崩到15.2%;LBF中塑形把近零基线解锁到约95.9%;SMAC 3m中主要保持近饱和性能。

Mathematical Model of Evolution of Non-Degenerate Replicator Systems Figure 1
2026-07-07q-bio.PE

Mathematical Model of Evolution of Non-Degenerate Replicator Systems

Alexander S. Bratus, Sergey Drozhzhin, Tatiana Yakushkina

2026-07-07优化控制

本文针对传统复制子模型默认适应度景观固定、难以描述长期进化适应的问题,提出让适应度矩阵在慢时间尺度上演化的非退化复制子系统模型。核心洞察是借助快慢分离将稳态平均适应度最大化转化为凸约束下的线性规划序列,并给出适应度变分条件。对超循环、双超循环、蚁群和 RNA 网络的分析显示,系统普遍经历适应度增长、优势物种出现与稳定化三阶段,并获得抗寄生能力;若去除非退化约束,则会走向物种逐步消失。

Approximate Feedback Linearization for a Nonlinear Hyperbolic PDE Class -- Part II: Neural Operator Figure 1
2026-07-07eess.SY

Approximate Feedback Linearization for a Nonlinear Hyperbolic PDE Class -- Part II: Neural Operator

Miroslav Krstic

2026-07-07优化控制

这篇论文针对非线性双曲 PDE 的 Volterra 反馈虽可线性化但需为每个对象求解核 PDE、在线计算嵌套积分的问题,提出直接学习“植物非线性与状态到边界控制”的截断反馈算子。核心在于证明该算子对系统系数和状态联合 Lipschitz,从而支持神经算子一致逼近;闭环在网络误差和截断误差共同存在下仍保持实用稳定,残差球随训练误差线性缩放,数值上报告约 4000 倍反馈计算加速。

Approximate Feedback Linearization for a Nonlinear Hyperbolic PDE Class -- Part I: Volterra Truncation Figure 1
2026-07-07eess.SY

Approximate Feedback Linearization for a Nonlinear Hyperbolic PDE Class -- Part I: Volterra Truncation

Miroslav Krstic

2026-07-07优化控制

本文针对非线性双曲PDE精确反馈线性化需无限Volterra级数、难以实时实现的问题,分析有限阶截断控制器。核心洞察是高阶尾项在原点附近足够小,可用小初值补偿截断误差;作者在无点态核界的情况下建立上确界范数尾项估计与闭环适定性,证明前向不变、有限时间实用稳定及class-KL渐近稳定,并给出吸引域随截断阶增大而扩张的定量关系。

Fundamental limits on state preparation for an open qubit Figure 1
2026-07-07quant-ph

Fundamental limits on state preparation for an open qubit

D.A. Abraamian, L.V. Lokutsievskiy, A.N. Pechen

Department of Mathematics and Mechanics, Lomonosov Moscow State University, Department of Differential Equations, Steklov Mathematical Institute of, Russian Academy of Sciences, Gubkina str. 8, Moscow, 119991, Russia and, Faculty of Mathematics, National Research University Higher School of Economics, Usacheva Str. 6, Moscow, 119048, Russia, Department of Mathematical Methods for Quantum Technologies, Steklov Mathematical Institute of Russian Academy of Sciences, Gubkina str. 8, Moscow, 119991, Russia, environment, establishing fundamental bounds on controllability and state-preparation fidelity for, lability: which states can be reached from a given initial, quantum systems, controllability criteria based on the, lability properties for general finite-dimensional Marko-, Further reachability and controllability, trollability and high-fidelity control of two-level quan-

2026-07-07优化控制

面向开放量子比特中耗散限制态制备保真度的问题,论文在 GKSL 主方程和相干控制框架下解析刻画 Bloch 球内可达集。核心洞察是耗散即使在任意强驱动下也会排除一块不可达区域,其边界为绕 x 轴旋转的曲面并含两个锥形奇点;作者还给出边界运动的闭式反馈控制和逼近任意边界态的构造协议,从而给出开放二能级系统可控性与态制备极限。

Exploiting Variable Implications in Presolve for Mixed Integer Programming Figure 1
2026-07-07math.OC

Exploiting Variable Implications in Presolve for Mixed Integer Programming

Wei-Kun Chen, Chang-Long Li, Zhao-Wei Wang, Yu-Hong Dai, Zi-Shuo Li, Meng Lu

2026-07-07优化控制

这篇论文针对混合整数规划预求解中变量蕴含信息利用不足的问题,提出两类方法:将同一团结构下的多个变量蕴含聚合为单个有效不等式,以及在标准线性约束传播中显式纳入变量蕴含以获得更紧界。作者证明相关界收紧仍可线性时间完成,并在 MIPLIB 2017 与 HiGHS 上报告求解时间约降 4%、搜索节点约降 6%。

Markov Information Processes Figure 1
2026-07-07math.OC

Markov Information Processes

Furkan Sezer

2026-07-07优化控制

本文关注承诺型信息设计在动态多智能体控制中的局限:代理人不仅相互博弈,其行动还会改变持久 Markov 状态。核心创新是提出 Markov Bayes 相关均衡,把静态服从约束扩展为含延续价值的动态服从条件,并证明行动推荐仍无损。主要结果包括递归化设计问题与后向算法、LQG 情形的协方差/Riccati 表征,以及当代理人学习转移模型时可获得非负信息租,且在持续激励下累计租金呈对数增长。

Deep Learning for Dynamic Programming with Recursive Utility Figure 1
2026-07-07q-fin.CP

Deep Learning for Dynamic Programming with Recursive Utility

Xianhua Peng, Wu Guo

2026-07-07优化控制

针对递归效用动态规划中确定性等价项难以在高维状态—控制空间中计算、且朴素蒙特卡洛会引入非线性偏差的问题,论文提出 Certainty Equivalent Learning,将确定性等价函数作为独立神经网络对象,与价值和策略函数联合学习。该方法不依赖网格、Euler 方程或转移函数可微性;在 LQG、稳健控制、Epstein–Zin DSGE 和多资产配置实验中,相对闭式解或 VFI 基准取得较准确的价值与策略近似,多数样例的样本外 Bellman 与最优性残差约为 1e-4 至 1e-3。

Unified convergence analysis for gradient descent optimization methods in the training of deep neural networks Figure 1
2026-07-07math.OC

Unified convergence analysis for gradient descent optimization methods in the training of deep neural networks

Shokhrukh Ibragimov, Arnulf Jentzen

Applied Mathematics: Institute for Analysis and Numerics, University of Münster, Germany, School of Data Science and School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen (CUHK-Shenzhen)

2026-07-07优化算法学习理论

深度网络训练常用 Adam 等自适应/加速梯度法,但其有界轨迹是否强收敛仍缺统一理论。本文用 Kurdyka-Łojasiewicz 不等式构造统一梯度下降框架,把 GD、Momentum、NAG、RMSprop、Adam、AMSGrad、Yogi 等纳入同一分析,证明在解析激活的全连接网络及更一般 KL 目标下,有界优化轨迹收敛到临界点并给出收敛率。

Anytime Plug-and-Play Control with Contract-Based Distributed MPC Figure 1
2026-07-07math.OC

Anytime Plug-and-Play Control with Contract-Based Distributed MPC

Sabrina Bodmer, Danilo Saccani, Melanie N. Zeilinger, Andrea Carron

2026-07-07规划控制

面向无人车、无人机等多机器人系统中通信邻居随位置变化、机器人可随时加入或离开的安全控制难题,论文提出一种基于契约的分布式 MPC:用距离邻居、预测轨迹生成的时变单元与安全包络,将碰撞约束解耦到本地优化,并给出递归可行、约束满足和避碰保证。实验在仿真与真实六到八辆自动赛车的高速八字赛道上验证了频繁拓扑变化下仍能安全避碰。

Robust Receding Horizon Games with Additive Uncertainty Figure 1
2026-07-07math.OC

Robust Receding Horizon Games with Additive Uncertainty

Dinesh Patra, Tanish Jain, Ashish R. Hota

2026-07-07安全鲁棒

面向多智能体在共享约束和有界加性扰动下各自运行MPC的场景,论文指出现有鲁棒分布式MPC多依赖合作目标或轨迹交换,难以适用于自利博弈。其核心做法是把管状约束收紧嵌入有限时域广义纳什博弈,并结合DARE终端代价、解耦正不变终端集和耦合终端资源分配,使智能体仅需广播标量收紧量。主要结果是在任意有界扰动下保证递归可行,名义状态收敛到稳态vGNE,实际状态收敛到由最小RPI集刻画的邻域。

Fast, Parallel, Query-Efficient Binary Classification Figure 1
2026-07-07math.OC

Fast, Parallel, Query-Efficient Binary Classification

Ishani Karmarkar, Liam O'Carroll, Aaron Sidford

2026-07-07优化控制

本文针对硬间隔 SVM/二分类中寻找最大间隔分离超平面的基础优化问题,动机是降低对特征矩阵的全量访问和并行深度。核心洞察是将问题化为正则化线性系统序列,并结合球加速、子空间嵌入、预条件迭代求解与样本复用,得到两种随机算法:均只需近似 O(γ^{-2/3}) 次矩阵向量查询,分别在并行深度或总工作量上改进既有方法。

A Policy Decomposition Framework for Dynamic Order Fulfillment Operations Figure 1
2026-07-07math.DS

A Policy Decomposition Framework for Dynamic Order Fulfillment Operations

Gal Neria, Michal Tzur, Marlin W. Ulmer

2026-07-07强化学习

论文针对电商、生产到单等场景中订单动态到达时“准备—配送”需实时同步的问题,指出成本和决策弹性主要集中在配送端。其核心创新是把动态履约建模为分解式 MDP,并用 DDF-VFA 将配送策略搜索与准备可行性检查分离,结合大邻域搜索和神经价值函数做前瞻评估。两类真实数据实验显示,该方法优于独立优化或无分解联合优化基线,并在约束、目标和数据变化下较稳健。

Sequential Pricing with Deadlines and Correlated Buyers Figure 1
2026-07-07math.OC

Sequential Pricing with Deadlines and Correlated Buyers

Shruti Penumatsa, Rajan Udwani

2026-07-07优化控制

本文关注房屋预售、广告瀑布流等场景中受外生截止期约束的顺序定价问题,动机在于卖家需在有限报价机会内处理买方相关估值。核心洞察是将已知期限情形按价格递减排序,转化为拟阵约束下的单调次模最大化;对随机期限则用松弛与舍入。主要结果给出相关估值已知期限的紧(1-1/e)近似,并为独立或相关估值的随机期限提供常数或Θ(1/log M)近似保证。

Finite Reliability Representations: Noise-Calibrated Belief-Space Covers for Reliable Decision-Making Figure 1
2026-07-07eess.SY

Finite Reliability Representations: Noise-Calibrated Belief-Space Covers for Reliable Decision-Making

Hyung-Jin Yoon, Hunmin Kim

Department of Mechanical and Nuclear Engineering, Tennessee Technological, University, Cookeville, TN, USA. ‡ H. Kim is with the School of Engineering, Department, of Electrical and Computer Engineering, Mercer University, Macon, GA, USA.This work was supported by internal funding at Tennessee, Technological University.

2026-07-07优化控制

本文针对部分可观测机器人决策中“信念空间该细到什么程度”缺乏物理依据的问题,提出有限可靠表示FRR:用由传感、过程和执行噪声校准的可靠单元覆盖可达信念空间,而非假设贝叶斯更新全局收缩。核心结果证明单元常值策略相对同一噪声POMDP的次优性有界,并以可靠熵刻画决策相关复杂度;数值例子显示传感噪声不必然减少单元数,执行不确定性可压缩动作差异。

Finite-Sample Closed-Loop Stability of Model Predictive Path Integral Control for Linear Time-Invariant Systems Figure 1
2026-07-07math.OC

Finite-Sample Closed-Loop Stability of Model Predictive Path Integral Control for Linear Time-Invariant Systems

Hyung-Jin Yoon, Hunmin Kim

Department of Mechanical and Nuclear Engineering, Tennessee Technological, University, Cookeville, TN, USA. ‡ H. Kim is with the School of Engineering, Department, of Electrical and Computer Engineering, Mercer University, Macon, GA, USA.This work was supported by internal funding at Tennessee, Technological University.

2026-07-07规划控制

本文针对有限采样 MPPI 在闭环执行中稳定性缺乏可计算保证的问题,抓住无约束 LTI/二次型且采用 DARE 终端代价时有限时域 MPC 首个控制等同 LQR 的结构,将 MPPI 视为 LQR 的随机扰动。文中分解出蒙特卡洛误差与温度偏差,并用 Lyapunov 扰动证明期望意义下实用指数稳定,给出依赖样本数、温度、规划时域和 LQR 裕度的显式样本阈值;结果保守但可计算。

Stochastic control with signatures via Riccati equations on the tensor algebra Figure 1
2026-07-07math.OC

Stochastic control with signatures via Riccati equations on the tensor algebra

Eduardo Abi Jaber, Elie Attal, Dimitri Sotnikov

2026-07-07规划控制

本文针对非马尔可夫、路径依赖随机控制中传统 LQ/Riccati 方法难以处理一般非线性奖励的问题,将奖励表示为时间扩展路径签名的线性泛函,并借助 Boué–Dupuis 公式把控制问题转化为签名泛函的 Laplace 变换计算。核心创新是在扩展张量代数上建立无限维 Riccati 方程,给出价值过程与最优控制的局部签名反馈展开,并用动态重定心获得全时域表示;结果覆盖签名跟踪与 Volterra 控制提升等非 LQ 示例。

A Static Mean Field Game for Optimal Renewable Energy Investment Figure 1
2026-07-07math.OC

A Static Mean Field Game for Optimal Renewable Energy Investment

Deniz Sezer, Shanukie Vithana, Sara Hastings-Simon, Souren Iwazian

2026-07-07优化控制

本文针对可再生能源选址中“风资源高但与其他站点同涨同落会压低收益”的问题,提出静态平均场博弈模型,将本地期望风能与空间协方差共同写入收益函数,并把均衡化为二次规划。基于阿尔伯塔风电与市场数据,作者比较四类土地、景观和输电约束情景,结果显示更严格限制会改变投资空间分布,并揭示监管用地目标与长期经济效率、空间多样化收益之间的权衡。

L1 Optimal Control of Continuous-Time Stochastic Positive Systems Figure 1
2026-07-07math.OC

L1 Optimal Control of Continuous-Time Stochastic Positive Systems

Alba Gurpegui, Takashi Tanaka, Anders Rantzer

2026-07-07规划控制

针对带执行约束、稀疏资源分配或最小燃料问题中比 L2 更合适的 L1 控制需求,本文把确定性正系统的线性调节器框架扩展到含乘性 Itô 高斯噪声的连续时间系统。核心洞察是,在对角噪声和 Metzler 型条件下可保持正正交不变性,并给出保正离散仿真;有限时域和折扣无限时域问题分别化为向量 ODE 与代数方程。主要结果是最优值函数和反馈策略与对应确定性问题一致,说明该类策略对乘性随机不确定性具有鲁棒性,并用投资组合例子展示动态切换收益。

Online Linear Programming for Multi-Objective Routing in LLM Serving Figure 1
2026-07-07cs.AI

Online Linear Programming for Multi-Objective Routing in LLM Serving

Zixi Chen, Yinyu Ye, Zijie Zhou

2026-07-07优化控制

这篇论文针对 LLM 服务中路由策略难以同时控制吞吐、端到端延迟、首 token 延迟和尾延迟的问题,将请求分发建模为带批大小与 KV-cache 时序约束的在线线性规划。核心做法是把多种 SLO 转成可解释的单请求奖励,并用影子价格驱动的 bid-price 控制在线决定是否接纳到某个解码 worker,同时用 warm-start 一阶更新满足毫秒级决策。作者在 Vidur 模拟器中报告其在多种 SLO 权重下优于轮询、随机和负载式启发策略,但尚未接入真实生产系统。

Course timetabling under conflict and lecturer preferences using bi-objective optimization model Figure 1
2026-07-07math.OC

Course timetabling under conflict and lecturer preferences using bi-objective optimization model

Murat Elhüseyni

Yeditepe University, Industrial Engineering, 34755, Istanbul, Turkey

2026-07-07优化算法

针对高校排课中人工调整易产生跨年级选课冲突、教师日程分散及实验课早于理论课等问题,论文将真实院系规则建成双目标 MILP,并用加权和在减少课程冲突与压缩教师工作日之间折中,同时纳入助教分配、教师休息间隔和理论—实践先后约束。在真实数据上,相比现行课表冲突下降 13.33%,教师日程紧凑度提升 26%,且完全消除理论/实践顺序违规。

Stability of input-output maps and their minimal realizations in state-linear, state-affine, LPV, and linear switched systems Figure 1
2026-07-07math.OC

Stability of input-output maps and their minimal realizations in state-linear, state-affine, LPV, and linear switched systems

Mihály Petreczky, Juan-Pablo Ortega, Florian Rossmannek, Bálint Daróczy

2026-07-07优化控制

论文关注系统辨识和学习中常被强加的稳定性假设:仅从输入输出行为何时能保证存在稳定状态空间实现。核心洞察是把有限 Hankel 秩与响应一致衰减、输入遗忘联系起来,证明对状态线性系统这等价于存在 GUES 有限维实现且衰减必为指数;并推广到状态仿射、LPV 与线性切换系统,最小实现继承相同衰减/遗忘率。

Dissipativity properties of a class of nonlinear time-delay systems via Bessel-Legendre inequalities Figure 1
2026-07-07math.OC

Dissipativity properties of a class of nonlinear time-delay systems via Bessel-Legendre inequalities

Ikram El Haskouki, Hannes Gernandt

2026-07-07优化控制

针对物理与工程系统中常见的多重时滞会破坏稳定性与能量性能的问题,本文把耗散性分析扩展到一类非线性时滞系统。核心做法是将 Lyapunov–Krasovskii 储能泛函与 Bessel–Legendre 积分不等式结合,给出更系统的时滞相关判据,并以简化泛函得到时滞无关条件;在线性情形下进一步化为可数值求解的 LMI,用于验证一般二次供给率下的耗散性和被动性。

Robust Feasible Route Construction through Collaborative Partition Optimization Figure 1
2026-07-07cs.AI

Robust Feasible Route Construction through Collaborative Partition Optimization

Oguzhan Karaahmetoglu, Hyong Kim

2026-07-07优化算法安全鲁棒

这篇论文针对大规模 CVRP 中“先聚类后路径规划”容易因固定分区导致局部车辆容量闲置、客户未服务的问题,提出 CoRC:在子问题求解过程中交换未服务客户、闲置车辆和容量信息,而非事后全局重优化。实验覆盖 AGS 与最高 20 万客户合成实例,显示其在多种分区策略下能稳定构造可行解,尤其在独立求解和重优化失败时仍可完成;但距离成本常高于部分不可行基线,质量—可行性权衡仍需进一步说明。

A Structural Interpretation of GELU and Threshold-Transmission Activations via the First-Order Loss Function Figure 1
2026-07-07cs.LG

A Structural Interpretation of GELU and Threshold-Transmission Activations via the First-Order Loss Function

Roberto Rossi

Business School, University of Edinburgh, Edinburgh, UK, transmission from loss accounting and compares GELU with the full and centred complementary

2026-07-07优化控制

本文动机是解释 GELU 的结构来源,而不只把它看作输入相关伯努利门的期望。核心洞察是将 GELU 识别为高斯互补一阶损失中的信号传输项,去掉截断矩修正后既保原点又抑制负尾,并推广为阈值传输族。小规模视觉与语言实验显示,校准或可学习宽度的均匀阈值门多数设置优于或接近 GELU、ReLU、SiLU,但文中也承认尚未证明大规模普适优势。

LLM-Guided Transportation Hub Capacity Planning with Textual Business Inputs Figure 1
2026-07-07cs.LG

LLM-Guided Transportation Hub Capacity Planning with Textual Business Inputs

Xiaoyue Liu, Zheng Dong

2026-07-07规划控制

这篇论文针对交通枢纽容量规划中传统随机优化难以吸收法规、劳动力、需求波动等文本业务信息的问题,提出由 LLM 读取自然语言情境、用结构化决策表推断容量调整,再由优化模型仅返回路由利用率反馈的迭代框架。其关键洞察是让 LLM 负责定性语义到容量方向和幅度的映射,而避免使用可能过时的成本信号。在美国东南部 13 个货运枢纽案例中,该方法相对隐藏真值的最优性差距为 2.8%,优于不使用文本输入的传统模型 11.0%。

Rapid Concurrent GPU-CPU Solvers for Scalable Unit Commitment in Large Power Grids Figure 1
2026-07-07math.OC

Rapid Concurrent GPU-CPU Solvers for Scalable Unit Commitment in Large Power Grids

Hussein Sharadga, Yuhan Du, Javad Mohammadi

2026-07-07优化算法

面向大电网机组组合在含 AC 约束和大量离散变量下求解过慢的问题,论文提出在单机上并发运行 GPU-PDHG 与 CPU-barrier 两条求解管线,先收敛者终止另一方,并配合更激进的 presolve 缩小问题规模。作者在 6049 节点、百万级变量约束的 DOE 场景上测试 45 例,报告 2.14×–5.61× 加速,最大运行时间由 42.12 分钟降至 5.77 分钟;但各部分增益中 presolve 与并发竞争的贡献拆分仍不充分。

Congestion Games with Heterogeneous Valuations: An Optimal Transport Approach Figure 1
2026-07-07cs.GT

Congestion Games with Heterogeneous Valuations: An Optimal Transport Approach

Pan-Yang Su, Negar Mehr, Shankar Sastry

2026-07-07优化控制

面向先进空中交通、电动车充电和共享服务中“偏好各异的用户共享拥堵资源”的分配问题,论文提出带多维目的地估值的非原子拥堵博弈。核心洞察是借助最优传输的 Kantorovich 对偶,把无穷维策略选择转化为估值空间上的阈值划分、对偶势和聚合流。主要结果是给出纳什均衡与社会最优的有限维表征,并说明容量约束与内生拥堵下仍可统一刻画。

Observer-Quotient Security: Composable Leakage Bounds for Hidden State Continuations Figure 1
2026-07-07cs.CR

Observer-Quotient Security: Composable Leakage Bounds for Hidden State Continuations

Faruk Alpay, Levent Sarioglu

Department of Computer Engineering, Bahçeşehir University, Istanbul, Türkiye

2026-07-07学习理论

本文关注协议或控制系统中“内部状态已变、可见 transcript 未变”的隐藏延续如何在后续交互、侧信道或观察者增强后变成可区分泄漏。核心做法是把安全性定义在观察者诱导的商空间上,构造带会话、oracle、调度器和模拟器的交互安全游戏,并给出可组合的 real/ideal 泄漏上界。主要结果包括分项混合证明、IND-CPA 含时序泄漏等实例化,以及把传感器重设计与残余泄漏下界转化为区分优势界。

On the Convergence of Adam, Revisited Figure 1
2026-07-07cs.LG

On the Convergence of Adam, Revisited

Steven Heilman, Sampad Mohanty

2026-07-07学习理论

本文针对 Adam 在在线优化中是否真正收敛这一基础问题,重新审视 Reddi 等人的反例限制。核心洞察是用三周期线性损失构造可控的负漂移,即使任意 β1、β2 取值也会把迭代推向错误端点。结果表明 projected Adam 的平均 regret 可长期远离零,并扩展到 AdamW、RMSProp、NAdam、AdaMax、Muon 及随机化序列,强调问题源于短记忆自适应分母而非特定参数区间。

Regularized Projection Algorithms for Monotone Inverse Variational Inequalities Figure 1
2026-07-07math.OC

Regularized Projection Algorithms for Monotone Inverse Variational Inequalities

Griffin Smith, Zeinab Alizadeh, Afrooz Jalilzadeh

2026-07-07优化控制

本文针对随机逆变分不等式中一般单调算子缺乏可计算收敛保证的问题,动机来自道路定价和网络均衡控制等只能观测随机响应、难以求逆的场景。核心做法是在投影迭代中结合 Tikhonov 正则化与递增批量采样,避免依赖强单调或共强制性;主要结果是在单调和 Lipschitz 条件下证明迭代有界、到解集距离几乎必然收敛,并给出期望平方残差 O(T^{-1/2}) 的非渐近复杂度界。

On disjunction convex hulls for generalized cross polytopes Figure 1
2026-07-07math.OC

On disjunction convex hulls for generalized cross polytopes

Yushan Qu, Jon Lee

2026-07-07优化算法

本文面向混合整数优化中由二进制变量管理的多面体析取建模,动机是为自然凸包给出更紧的线性不等式描述。核心创新是把研究对象扩展到与超矩形对偶的广义交叉多面体,完整刻画两集合情形下任意维度的凸包,并说明何时仅靠最优 big-M lifting 即可覆盖全部描述;对多集合情形进一步推广相关 facet 不等式,实验显示这些理论不等式能改善计算表现,但具体增益来源仍需结合实例规模理解。

Asynchronous Sensitivity-Based Distributed NMPC Figure 1
2026-07-07math.OC

Asynchronous Sensitivity-Based Distributed NMPC

Maximilian Pierer von Esch, Andres Völz, Knut Graichen

2026-07-07规划控制

面向大规模耦合系统中集中式 NMPC 难以实时求解、同步式分布优化又易受通信等待拖慢的问题,本文将异步敏感度分布式规划嵌入协同 DMPC:每个采样周期内只做固定次数、仅邻居通信的异步 SBDP 更新,并在有界信息延迟和名义 MPC 稳定条件下证明足够迭代数可保证局部指数稳定。仿真与硬件在环实验显示,在以太网和 Wi‑Fi 下执行时间可降低超过 60%,闭环性能基本保持相当。

Optimal mean-time path planning for unmanned underwater vehicles: a Hamilton-Jacobi approach Figure 1
2026-07-07math.OC

Optimal mean-time path planning for unmanned underwater vehicles: a Hamilton-Jacobi approach

Jonathan Valyou, Jeremy Brandman, Sanghyun Lee

\fnm Jeremy \sur Brandman † 0 0 footnotetext: † \dagger Work conducted while affiliated with the U.S. Naval Research Laboratory.

2026-07-07规划控制

面向海流预报存在分歧时的UUV路径规划,论文将多种带概率的海洋预报集成到风险中性的平均到达时间目标中,推导时间无关的Hamilton-Jacobi方程组,并扩展Lax-Friedrichs快速扫描法求解控制与路径。数值验证显示该方法可有效计算均值最优路径,且在不确定海流下所得路径可能明显偏离各单一预报对应的确定性最优路径。

Nested-Loop Trajectory-Informed Variational Quantum Solver for Interior-Point OPF Figure 1
2026-07-07quant-ph

Nested-Loop Trajectory-Informed Variational Quantum Solver for Interior-Point OPF

Farshad Amani, Amin Kargarian

2026-07-07规划控制优化算法

针对量子辅助内点法求解最优潮流时,每个外层迭代都要嵌套 VQLS 变分优化、导致收敛变慢的问题,论文提出用早期求解轨迹而非静态特征做双层预测:内层由 VQLS 参数前缀 warm-start 后续搜索,外层由 IPM 原始-对偶轨迹预测中心路径并恢复可行性。仿真称变分更新最多减少 95%,目标值接近经典 IPM,并给出 2-bus 真机演示;但实际量子优势与规模化收益仍可能主要受 scaling / data 影响。

Dynamic Congestion Pricing in Distribution Networks via a Convex-Analytic Bilevel Reformulation Figure 1
2026-07-07math.OC

Dynamic Congestion Pricing in Distribution Networks via a Convex-Analytic Bilevel Reformulation

Reza Rahimi Baghbadorani, Ali Nikseresht, Jehum Cho, Yashar Ghiassi-Farrokhfal

2026-07-07优化算法

面向配电网中分布式能源和灵活负荷导致的动态拥塞,论文关注如何在保留用户自主调度的同时可扩展定价。核心做法是用 Fenchel–Young 等式和凸共轭刻画下层最优性,避免 KKT 互补与大 M 混合整数化,并用 DC/SCA 处理价格响应双线性项。在 IEEE 13/34 节点算例中,拥塞分别下降约 96.89% 和 96.45%,接近集中式调度,且优于限时 KKT 基线。

Amortized low-rank approximation for hyperparameter marginalization in PDE-governed Bayesian inverse problems Figure 1
2026-07-07math.NA

Amortized low-rank approximation for hyperparameter marginalization in PDE-governed Bayesian inverse problems

Sonia Reilly, Georg Stadler

(MAP) estimations. To address these computational challenges, we introduce a scalable framework that relies on, distribution is available in closed form and can be accurately approximated even when the param-, Funding: Partially supported by the Multidisciplinary University Research Initiatives (MURI) Program Of-, Foundation (NSF) under #2411229, and by the U.S. Department of Energy, Office of Science, Office of ASCR, DOE, †Courant Institute School of Mathematics, Computing and Data Science, New York University, New York, USA

2026-07-07优化控制

本文针对 PDE 约束层次贝叶斯反问题中,超参数边缘化需反复计算大规模 log-det 比和 MAP、导致代价过高的问题。核心做法是用与超参数无关的预条件器摊销低秩精度更新近似,尤其处理先验长度尺度等非线性超参数。二维/三维平流扩散反演实验显示,3D 中 100 次边缘密度评估较直接方法加速约 30–45 倍。

Continuous Differentiability of the Value Function for Infinite-Dimensional Finite-Horizon Optimal Stopping and Related Variational Inequalities Figure 1
2026-07-07math.PR

Continuous Differentiability of the Value Function for Infinite-Dimensional Finite-Horizon Optimal Stopping and Related Variational Inequalities

Gabriele Bolli, Giorgio Ferrari

developed while Gabriele Bolli was visiting the Center for Mathematical Economics (IMW) at Bielefeld University., The dynamic programming principle suggests that, whenever sufficient regularity is available, the value function should, where L is the differential operator associated with the dynamics. Since classical differentiability is not available at the

2026-07-07优化控制

针对无限维随机演化方程中的有限时域最优停止问题,本文动机在于弥合价值函数、自由边界与变分不等式在 Hilbert 空间中缺乏经典正则性的断裂。核心做法是用点态惩罚方程构造加权类中的 mild 解,并在半群全局正则化假设下传递高阶估计。主要结果是证明该解等同于最优停止价值函数,得到局部空间 Lipschitz、连续 Fréchet 可微及梯度局部 Hölder,从而建立无限维 smooth-fit 原理。

Cash-invariant hull representation of divergence preferences Figure 1
2026-07-07q-fin.MF

Cash-invariant hull representation of divergence preferences

Aleš Černý, Johannes Ruf, Martin Schweizer

a Bayes Business School, City St George’s, University of London, b Department of Mathematics, London School of Economics and Political Science, c Department of Mathematics

2026-07-07优化控制

为便于投资组合等问题中使用超越有界收益的分歧偏好,本文研究统一加权分歧偏好的现金不变表示。核心洞察是把对抗概率测度下的散度惩罚效用,等价为状态无关期望效用的平移不变包,并在一般凸下半连续散度函数和尽可能宽的 L0 域上证明该恒等式。论文还推导完全市场最大效用、规范化表示及非单调均值—方差效用单调域等后果。

Adaptive Linear Quadratic Control of Unknown Linear Time-Varying Systems via Policy Gradient Methods Figure 1
2026-07-07math.OC

Adaptive Linear Quadratic Control of Unknown Linear Time-Varying Systems via Policy Gradient Methods

Feiran Zhao, Florian Dörfler

Department of Information Technology and Electrical Engineering, ETH Zürich, 8092 Zürich, Switzerland.

2026-07-07强化学习规划控制优化算法

面向模型参数随时间变化且未知的 LTV 系统,论文关注传统在线重解 SDP/Riccati 等控制器计算开销大、对噪声模型估计敏感的问题。核心做法是将 LQR 的策略梯度一步更新嵌入闭环反馈,并用归一化滑动窗口最小二乘从近期轨迹估计局部模型,使控制增益随数据渐进调整而非一次性重算。理论上分别给出慢变系统无需驻留时间的实际指数稳定性、分段常值系统的驻留时间收缩稳定性,以及两类系统的平均冻结时刻最优性差距界,并用数值 LTV 与非线性案例验证。

The Clarke tangent and normal cones to decomposable sets in Lebesgue spaces Figure 1
2026-07-07math.OC

The Clarke tangent and normal cones to decomposable sets in Lebesgue spaces

Petar Evgeniev

Faculty of mathematics and informatics, Sofia University

2026-07-07优化控制

本文关注最优控制和变分问题中由逐点约束定义的 Lebesgue 空间可行集,其 Clarke 切锥/法锥能否由逐点集合的切锥/法锥可测选择表示。核心洞察是结合 Castaing 表示与 Borwein–Strojwas 的弱 Bouligand 刻画,在不要求逐点可导性的情况下建立公式。主要结果证明,当 1≤p<∞ 且状态空间为可分自反 Banach 空间时取得精确等式;p=∞ 时仅得到单向包含及部分结论。

Inverse Optimal Control for Linear Quadratic Problem with Poisson Jumps: Model-Free Inverse Reinforcement Learning Approaches Figure 1
2026-07-07math.OC

Inverse Optimal Control for Linear Quadratic Problem with Poisson Jumps: Model-Free Inverse Reinforcement Learning Approaches

Wen Du, Na Li, Xun Li, Zuo Quan Xu

2026-07-07强化学习规划控制

针对含布朗扰动与泊松跳的随机线性二次系统中“专家反馈增益已知、代价函数未知且动力学难建模”的问题,论文把逆最优控制表述为模型无关逆强化学习,提出基于专家演示的逆 Q-learning 与基于初始稳定策略数据的离策略逆策略迭代,两者都无需识别系统参数或跳强度。理论上给出稳定性与收敛性条件,数值仿真显示可恢复产生同一增益的等价代价权重。

Entropy Regularization Improves Policy Robustness in Continuous-Time Reinforcement Learning Figure 1
2026-07-07math.OC

Entropy Regularization Improves Policy Robustness in Continuous-Time Reinforcement Learning

Jialun Cao, Fernando Acero, David Šiška, Yufei Zhang

2026-07-07强化学习安全鲁棒

针对连续时间强化学习中熵正则常被用于提升部署鲁棒性却缺少理论解释的问题,本文把熵正则目标与鲁棒连续时间 MDP 建立联系:奖励扰动下给出精确鲁棒解释,奖励与转移强度联合扰动下给出最坏情形性能下界,并刻画随温度增大的不确定集。排队控制和做市实验显示,中等熵正则在动力学扰动下优于贪婪与 ε-greedy 基线。

Quantitative rapid boundary stabilization via modal decomposition and its application to the Allen-Cahn equation Figure 1
2026-07-07math.AP

Quantitative rapid boundary stabilization via modal decomposition and its application to the Allen-Cahn equation

Shengquan Xiang, Yu Xiao, Can Zhang

2026-07-07学习理论

本文针对一维 Allen–Cahn 方程的边界快速镇定中“给定衰减率越大、反馈代价如何增长”这一量化问题,提出基于模态分解的显式低频反馈:用 Ackermann 公式稳定有限维不稳定模态,并与频率 Lyapunov 方法结合,得到随衰减率变化的镇定成本估计;进一步构造分段反馈,推出带显式控制代价的局部零可控性和有限时间镇定结果。

A Proximal Point Semismooth Newton Algorithm for Structural Composite Cardinality Optimization Figure 1
2026-07-07math.OC

A Proximal Point Semismooth Newton Algorithm for Structural Composite Cardinality Optimization

Penghe Zhang, Naihua Xiu, Houduo Qi

2026-07-07优化算法

本文针对结构复合基数优化中基数项与线性算子复合导致的非凸、非连续和收敛假设困难,转向更可分的平稳对偶形式,提出近端点框架并用半光滑牛顿法求解低维子问题,同时给出可实现的不精确终止准则。理论上证明全局收敛及局部线性收敛,数值实验覆盖跳稀疏信号恢复和 CT 图像复原,显示时间效率与解精度较好。

Endogenous Feedback in Size-Structured Transport Equations Figure 1
2026-07-07math.AP

Endogenous Feedback in Size-Structured Transport Equations

Jiguang Yu, Louis Shuo Wang

2026-07-07优化控制

本文针对大小结构种群/收获模型中状态输出反过来影响输运速度与死亡率的问题,避免将其简单视为半线性扰动。核心做法是冻结反馈路径,把闭环化为标量 Volterra 不动点,并由质量平衡内生给出反馈区间;进一步揭示平衡闭合斜率、线性化谱穿越与伴随秩一增益共享同一临界量。主要结果包括非负弱解唯一性、平衡唯一性与折叠阈值、基于更新方程的稳定判据及收获伴随的显式秩一公式。

From graphons to real-world networks: kinetic opinion dynamics under selective media influence Figure 1
2026-07-07math-ph

From graphons to real-world networks: kinetic opinion dynamics under selective media influence

Bertram Düring, Martina Fraia, Alessandro Licciardi

2026-07-07强化学习

本文针对传统意见动力学难以同时刻画真实社交网络结构与选择性媒体影响的问题,提出基于 graphon 的动力学模型,将 Hallin“合法争议圈”中的定向媒体作用写入模型预测控制。文中推导 Boltzmann 与 Fokker–Planck 型方程、稳态分布和指数收敛性质,并用高斯 graphon 与真实 Twitter 网络比较,显示 graphon 可在一定程度上复现实网意见演化,但描述力依赖拟合与受控人群设定。

Singularities in Multi-Objective Optimization and their Crossing during Continuation Figure 1
2026-07-07math.OC

Singularities in Multi-Objective Optimization and their Crossing during Continuation

Arjun Manoj, Michail E. Kavousanakis, Shanqing Liu, Ioannis G. Kevrekidis

Chemical & Biomolecular Engineering, Johns Hopkins University, Baltimore, MD 21218, USA, School of Chemical Engineering, National Technical University of Athens, Zografou, Athens 15780, Greece, Division of Applied Mathematics, Brown University, Providence, RI 02906, USA, Applied Mathematics and Statistics, Johns Hopkins University, Baltimore, MD 21218, USA

2026-07-07优化算法

本文针对多目标优化中延拓法一次只能追踪单个连通分支、需反复重启才能覆盖断裂 Pareto 前沿的问题,指出部分“断裂”并非目标景观本身造成,而是加权标量化参数 λ 在目标梯度共线处发散形成的参数化奇异。作者将 Pareto 临界条件写成非线性系统,用伪弧长延拓结合 λ=tanθ 等奇异重参数化和投影紧化跨越奇点,在 ZDT3 及变体上实现单次延拓恢复原本分离的 Pareto 临界分支。

Online Modeling and Sequential Convex Programming for Lunar Landing Trajectory Optimization Figure 1
2026-07-07math.OC

Online Modeling and Sequential Convex Programming for Lunar Landing Trajectory Optimization

Zhenbo Wang

Department of Mechanical and Aerospace Engineering, The University of Tennessee

2026-07-07规划控制优化算法

针对月球动力下降中名义模型难以覆盖重力异常、推力标定和质量测量误差的问题,论文将序列凸规划与在线模型辨识结合:用RLS/EMA从导航噪声中估计扰动,并作为偏置注入每次SOCP重规划而不破坏凸结构。MATLAB仿真显示,在四类扰动场景下该方法相对未校正轨迹降低着陆位置和速度误差,并更接近真实推进剂消耗。

Optimality-Informed Neural Networks for Lunar Landing Trajectory Optimization Figure 1
2026-07-07math.OC

Optimality-Informed Neural Networks for Lunar Landing Trajectory Optimization

Zhenbo Wang

Department of Mechanical and Aerospace Engineering, The University of Tennessee

2026-07-07规划控制优化算法

面向月面动力下降中在线优化迭代不确定、监督/RL又依赖大量数据且难保证最优性的问题,论文提出OINN:把PMP与HJB相关最优性条件嵌入网络,硬编码边界和横截条件,并直接代入闭式最优推力律,无需预生成最优轨迹。仿真中其在代表初值和80次蒙特卡洛上接近间接法解,残差较小,但结果仍主要停留在数值验证。

Elastically safeguarded augmented Lagrangian methods Figure 1
2026-07-07math.OC

Elastically safeguarded augmented Lagrangian methods

Ernesto G. Birgin, Alberto De Marchi, Patrick Mehlitz

2026-07-07安全鲁棒

本文针对非线性约束优化中增广拉格朗日法固定 safeguard 难以预设、对尺度不自适应且可能拖慢乘子收敛的问题,提出可弹性扩张的 safeguard:在正则极限点附近逐步失活以恢复 PHR 式对偶更新,同时在非正则情形保留全局稳健性。理论上证明近似 KKT/弱约束资格下的驻点收敛,并给出外层与内层最坏迭代复杂度;CUTEst 上与 ALGENCAN 对比显示稳定实践增益。

Physics-Informed Tensor Completion with Application to Distribution System State Estimation Figure 1
2026-07-07math.OC

Physics-Informed Tensor Completion with Application to Distribution System State Estimation

Alexander While, Anil Aswani, Chen Chen, William N. Caballero

The Ohio State University, University of California Berkeley, Air Force Institute of Technology

2026-07-07优化控制

针对配电网量测稀疏、噪声大且异构时传统加权最小二乘易失效的问题,论文将电压相量、幅值与功率注入组织为低秩张量,并用线性化潮流残差作为凸物理惩罚,形成可由全局收敛 BCG 求解的物理约束张量补全框架。作者还给出受限稳定性下的确定性误差界,说明误差受观测噪声和物理模型失配控制;IEEE 测例显示在低可观测和缺失数据场景下,相比纯数据张量补全与 WLS 更能恢复电压幅值和相角。

Earth-baseline VLBI restores the observability of a lunar surface station in joint orbit-and-clock determination Figure 1
2026-07-07eess.SP

Earth-baseline VLBI restores the observability of a lunar surface station in joint orbit-and-clock determination

Chakshu Baweja

2026-07-07优化控制

面向月球PNT从概念走向部署后的轨道—钟差联合估计问题,论文关注月面站绝对位置何时可观。核心洞察是本地测距只约束相对几何,留下六维刚体基准缺陷;地基VLBI可直接闭合该基准,且至少需三个非共线地面站。结果显示三卫星稀疏星座中VLBI把不可观位置恢复到约20.1米CRLB,六卫星场景则将界从23.2米收紧到9.7米,但网络为仿真模型,非真实跟踪验证。

Generalized Normal Constraint (GNC): A Complete Geometric Generalization of the NNC Method Figure 1
2026-07-07cs.CE

Generalized Normal Constraint (GNC): A Complete Geometric Generalization of the NNC Method

Achille Messac, Blayne Montaque

2026-07-07优化算法学习理论

针对多目标优化中 NNC、NBI 等方法因网格几何构造而漏掉部分可行 Pareto 前沿的问题,论文从归一化目标空间、乌托邦超平面、捕获多面体与投影等不变量出发,提出 GNC 作为 NNC 的几何推广。其核心结果是证明传统方法在 n 目标下捕获比例仅为 1/(n−1)!,而 GNC 在结构上可覆盖完整可 admissible Pareto 区域,并通过基准算例验证完整捕获与计算可行性。

2026-07-03

24 篇
Almost Supermartingale Extensions of Olivier's Theorem Figure 1
2026-07-03math.PR

Almost Supermartingale Extensions of Olivier's Theorem

Patrick L. Combettes, Javier I. Madariaga

North Carolina State University, Department of Mathematics

2026-07-03优化控制

本文从 Olivier 定理只能处理确定性、单调可和序列的局限出发,将其推广到带权的几乎超鞅框架。核心洞察是结合 Robbins–Siegmund 收敛定理与 Abel–Dini 型发散性质,在随机扰动和误差可和条件下推出 ξ_n=o(1/θ_n) 的几乎处处速率,并进一步用于随机近端点、随机梯度等迭代过程,给出若干新的渐近收敛率。

Sensitivity Analysis and Robust Optimal Control for Coupled Evolution Inclusions with State-Dependent Maximal Monotone Operators Figure 1
2026-07-03math.OC

Sensitivity Analysis and Robust Optimal Control for Coupled Evolution Inclusions with State-Dependent Maximal Monotone Operators

Jinsheng Du, Boris Mordukhovich, Shengda Zeng

School of Mathematical Sciences, Chongqing Normal University, Chongqing 401331, China, Wayne State University, Detroit, Michigan 48202, National Center for Applied Mathematics in Chongqing

2026-07-03规划控制安全鲁棒

针对状态会反过来改变约束的非光滑动力系统,本文把半线性演化包含与状态依赖极大单调算子耦合起来,避免传统控制中凸性和闭性失效导致的适定性缺口。核心在于用伪距离控制、紧性与Painlevé–Kuratowski连续性刻画参数化解集,并在此基础上建立Bolza优化、固定参数控制、联合设计、min–max鲁棒控制和Hurwicz折中控制的最优解存在性及值函数连续性,数值扫掠系统用于展示敏感性与鲁棒现象。

Refinement of Reliability Grid Codes in the Provision of Ancillary Services Figure 1
2026-07-03eess.SY

Refinement of Reliability Grid Codes in the Provision of Ancillary Services

Torine R. Herstad, Jalal Kazempour, Lesia Mitridati, Steven A. Gabriel

2026-07-03视觉感知

论文关注风电、电动车聚合商等随机资源参与备用服务时,固定 P90 可靠性门槛可能既保守又缺乏优化依据的问题。作者将电网可靠性规则设计成双层优化,由 TSO 内生选择可靠性阈值,并用 Weibull 尾部分布解析 reformulate 机会约束。北欧 FCR-D 案例显示,最优静态阈值低于 P90,总备用成本最高降 14.5%,小时级动态阈值再降最高 2.4%。

Invariance Entropy in the Dust Figure 1
2026-07-03math.OC

Invariance Entropy in the Dust

Senhan Yao

State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, People’s Republic of China, School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing 100049, People’s Republic of China ().

2026-07-03优化控制

本文围绕通信受限控制中“维持系统在集合内需要多少信息”这一动机,考察严格不变熵与普通不变熵的差异。核心洞察是用 Cantor 尘保存无限符号指令、收缩坐标隐藏后期失配,从而构造非扩张机制下的信息复杂性。主要结果是否定 Kawan 两个长期问题:有限严格不变熵可不同于普通不变熵,且严格不变熵对 Hausdorff 初始集扰动不具下半连续性。

Optimal insulation and concentration breaking for nonlinear Robin boundary value problems Figure 1
2026-07-03math.AP

Optimal insulation and concentration breaking for nonlinear Robin boundary value problems

Francesco Della Pietra, Francescantonio Oliva

2026-07-03学习理论

本文面向带对流换热的热绝缘优化问题,将经典薄绝缘层模型推广到由 p-Laplace 算子支配的非线性 Robin 边值情形,并允许非均匀外部温度。核心在于给出适配非线性扩散的薄层尺度并证明能量泛函的 Γ-极限,进而刻画固定总质量下的最优绝缘分布。结果表明,小质量时最优层通常不会覆盖全边界,而会发生浓度破裂;连通边界或常外温下给出充分条件,并用反例说明断开边界可导致更复杂的双相转变。

An Optimisation Framework for the Well-Conditioned Training of Physics-Informed Neural Networks Figure 1
2026-07-03cs.LG

An Optimisation Framework for the Well-Conditioned Training of Physics-Informed Neural Networks

Joseph Webb, Sadok Jerad, Coralia Cartis

aMathematical Institute, University of Oxford, Oxford, United Kingdom, Doubly-Sketched Gauss–Newton with Adaptive Ratio, a scalable second-order optimisation framework that, The code is available at https://www.github.com/wephy/physics-informed-neural-networks

2026-07-03优化控制

这篇论文针对 PINNs 难以达到传统 PDE 求解器精度的问题,指出核心瓶颈在病态优化而非表达能力。作者提出 DSGNAR,将双重随机 sketch 的 Gauss–Newton 模型与自适应正则化、步长控制结合,以改善条件数并降低二阶训练成本。在 Burgers、Poisson、Navier–Stokes 等基准上,误差相较同期方法提升数个数量级,部分双精度实验接近舍入误差,且运行时间仍具竞争力。

ART for Diffusion Sampling: Continuous-Time Control and Actor-Critic Learning Figure 1
2026-07-03cs.LG

ART for Diffusion Sampling: Continuous-Time Control and Actor-Critic Learning

Yilie Huang, Wenpin Tang, Xun Yu Zhou

2026-07-03生成模型规划控制

论文针对扩散采样中时间步网格多依赖均匀或手工日程、在固定模型评估预算下可能浪费计算的问题,将时间步分配表述为连续时间最优控制:学习采样时钟速度,使均匀钟点映射为自适应扩散时间。其 ART-RL 用高斯随机策略和 actor-critic 求解,并证明最优随机策略均值对应原 ART 解。实验显示,仅替换时间网格即可在低维、MNIST、CIFAR-10 及跨预算/数据集/管线迁移中优于 Uniform、DPM、EDM 等基线。

Lower Bounds for Anytime Acceleration of Gradient Descent Figure 1
2026-07-03math.OC

Lower Bounds for Anytime Acceleration of Gradient Descent

Chung-En Tsai, Ilyas Fatkhullin, Liang Zhang, Niao He

Department of Computer Science, ETH Zurich, ETH AI Center

2026-07-03优化算法学习理论

本文关注梯度下降在未知停止时刻的 anytime 收敛能否通过大步长继续加速这一问题。作者从二次函数和 Huber 类函数构造出对大步长数量与幅度的限制,给出任意正的非自适应步长表的下界:函数值误差不可能达到 o(n^-4/3),平方梯度范数不可能优于 o(n^-1),从而解释了 anytime 场景与预设迭代数加速之间的根本差距。

Regularized Variational and Spectral Log-Density-Ratio Estimation in the Gaussian Location Model Figure 1
2026-07-03cs.LG

Regularized Variational and Spectral Log-Density-Ratio Estimation in the Gaussian Location Model

Francis Bach (SIERRA)

PSL Research University

2026-07-03三维

本文动机是解释高维两样本中正则化对对数密度比估计的偏差—方差影响,特别比较 KL 变分估计与新近谱估计。核心创新是在高斯位置模型下给出二者的确定性渐近等价:变分端由 CGMT 化为标量熵最小化,谱端用加权 Wishart resolvent 分析。结果显示样本充足时,模型正确的变分估计风险更低;样本较少时,谱方法因基于协方差的构造方差更小而占优。

Cognitive Warfare, Hybrid Pressure, and Sovereign Resilience: An Operations Research Framework Applied to the Iranian Case (2017--2026) Figure 1
2026-07-03math.OC

Cognitive Warfare, Hybrid Pressure, and Sovereign Resilience: An Operations Research Framework Applied to the Iranian Case (2017--2026)

Rahimeh Neamatian Monemi, Shahin Gelareh, Nelson Maculan

Federal University of Rio de Janeiro, COPPE-PESC, P.O. Box 68511, Rio de Janeiro, RJ 21941-972, Brazil

2026-07-03优化控制

论文针对传统攻防优化难以刻画“持续外部压力—社会怨怼—制度韧性”连续演化的问题,提出将怨怼/韧性动力系统与会重新优化压力强度的MDP攻击者耦合的框架。核心洞察是攻击者在最高潮动员状态下会因收益结构而自我限压,而非外生假设。实验用30个随机网络、价值迭代和伊朗2017–2026案例校准,报告案例距崩溃边界约25倍,贪婪播种渗透率显著高于度中心性基线。

Decentralized Stochastic Subgradient-type Methods with Communication Compression for Nonsmooth Nonconvex Optimization Figure 1
2026-07-03math.OC

Decentralized Stochastic Subgradient-type Methods with Communication Compression for Nonsmooth Nonconvex Optimization

Siyuan Zhang, Nachuan Xiao, Xin Liu

2026-07-03优化算法

针对去中心化学习中带宽受限与目标函数非光滑、非凸甚至非 Clarke 正则的难题,论文构建了统一的随机次梯度压缩通信框架,覆盖无偏压缩与带误差补偿的收缩压缩,并用连续时间微分包含刻画一致性误差和平均迭代轨迹。主要结果是在较弱函数条件下给出全局收敛性,同时派生符号正则化和梯度跟踪动量方法;实验初步验证理论并展示通信量与精度的权衡。

Quantum-Inspired Vision: Leveraging Wave-Particle Duality for Low-Illumination Enhancement Figure 1
2026-07-03eess.IV

Quantum-Inspired Vision: Leveraging Wave-Particle Duality for Low-Illumination Enhancement

Yiquan Gao

2026-07-03视觉感知

针对低照度增强中确定性训练难以刻画光照不确定性、易受噪声和偏亮/偏暗偏置影响的问题,本文把DRU解释为“波函数—状态叠加—损失观测坍缩”的物理到AI范式,用状态概率加权样本损失。实验在ASD标准与含噪版本上显示,DRU变体在BRISQUE/NIMA上优于对应确定性模型,并对标签噪声更稳健,但论文更偏理论解释,增益来源仍部分依赖既有DRU框架。

Multi-Domain Matrix Framework for Human Resource Decision Support Figure 1
2026-07-03math.OC

Multi-Domain Matrix Framework for Human Resource Decision Support

Daehan Lee, Jaemyung Ahn, Jaewoo Kim

Department of Aerospace Engineering, Korea Advanced Institute of Science and Technology, Daejeon, Korea., Planby Technologies, Inc., Seoul, Korea.

2026-07-03优化控制

本文针对初创和小型企业在人力资源决策中难以看清人员、技能与项目依赖关系的问题,提出用多域矩阵把成员沟通、技能分布、项目参与和技能需求统一建模,并构造工作负荷、价值等可解释指标。案例显示,该框架能识别工作量失衡、关键成员过载与招聘需求,但效果主要来自结构化建模和小规模案例验证,泛化增益仍需更多实证说明。

Structured Factorization Approaches for Quantum State Tomography Figure 1
2026-07-03quant-ph

Structured Factorization Approaches for Quantum State Tomography

Zhen Qin, Joseph M. Lukens, Brian T. Kirby, Zhihui Zhu

State University, Columbus, Ohio 43210, USA.

2026-07-03优化控制

量子态层析随系统规模呈指数复杂度,现有低秩、张量网络或神经表示常难同时兼顾可扩展性与物理有效性。本文提出结构化因子分解,将密度矩阵写为 FF† 并在因子空间施加结构先验,统一支持低秩、MPO 与神经密度算子;同时给出样本复杂度分析、投影梯度与无步长 power method。实验显示该框架在多类结构态上能实现更准确、可扩展的重构。

Multi-Rate Nonlinear Model Predictive Control for Wall-Supported Bipedal Locomotion of Quadrupedal Robots Figure 1
2026-07-03cs.RO

Multi-Rate Nonlinear Model Predictive Control for Wall-Supported Bipedal Locomotion of Quadrupedal Robots

Taizoon Chunawala, Jeeseop Kim, Kaveh Akbari Hamed

2026-07-03机器人规划控制

面向狭窄走廊、灾害现场等四足机器人需直立并借墙支撑的场景,论文提出分层多速率 NMPC:高层同时优化质心、姿态、环境反力与离散落足演化,低层用带虚约束的全身 QP 跟踪全阶动力学。Unitree A1 仿真显示其在崎岖地形和外扰下更稳,高速越障成功率较 Raibert 启发式 MPC 提高 2.9 倍。

Complete Integrability for Piecewise-Smooth Distributions Figure 1
2026-07-03math.DG

Complete Integrability for Piecewise-Smooth Distributions

Jack McKee

2026-07-03优化控制

本文针对分布仅分片 C1、且跨网格面可能不连续时经典 Frobenius 可积性条件失效的问题,研究如何仍构造积分流形。核心洞察是改用 Pfaffian 消灭子表述,并结合 Clarke 广义反函数定理,给出保证连续分片 C1、双 Lipschitz 坐标存在的充分条件。主要结果是提出两类 Frobenius 推广:一类偏解析、适合分片闭一形式情形,另一类偏拓扑;这些条件并非必要。

Symbolic Discovery of Iterative Algorithms: A Continuous Latent Space Bayesian Optimization Framework Figure 1
2026-07-03math.OC

Symbolic Discovery of Iterative Algorithms: A Continuous Latent Space Bayesian Optimization Framework

Tongjia Liu, Ilias Mitrai

McKetta Department of Chemical Engineering, The University of Texas at Austin, Austin, TX 78712, US

2026-07-03优化算法

针对迭代优化算法依赖人工设计、可解释方法搜索代价高的问题,本文把更新规则表示为表达式树,并用 VAE 学习其连续潜空间,再以贝叶斯优化在该空间中搜索符号化更新函数。两个无约束优化案例显示,该方法能发现带状态相关步长等新规则,并较混合整数规划式算法发现显著降低计算开销。

Mean Field Reinforcement Learning Figure 1
2026-07-03math.OC

Mean Field Reinforcement Learning

René Carmona, Mathieu Laurière

Department of Operations Research and Financial Engineering & Program in Applied and, Shanghai Frontiers Science Center of Artificial Intelligence and Deep Learning, Institute of Mathematical Sciences at NYU Shanghai

2026-07-03强化学习

本文针对多智能体强化学习在大规模交互系统中状态—动作维度爆炸、单智能体建模又忽略群体反馈的问题,系统化构建平均场强化学习框架。核心洞察是用与总体分布耦合的代表性智能体替代有限大群体,并把概率测度、共同噪声、开闭环及随机化策略纳入动态规划与学习算法。主要结果包括严谨连接有限群体与平均场极限、中心规划与提升的平均场 MDP,分析线性二次模型的稳定性和策略梯度,并给出表格、离散化与仿真实现方案。

Flexible and Reliable Network Design for Emerging Transportation Services: Multi-stage Stochastic Programming Approach Figure 1
2026-07-03math.OC

Flexible and Reliable Network Design for Emerging Transportation Services: Multi-stage Stochastic Programming Approach

Riki Kawase, Koki Satsukawa, Toru Seo

Institute of Science Tokyo, Tohoku University, . Recent studies have focused on scalable approaches, such as Approximate Dynamic Programming and Markov

2026-07-03优化控制

面向SAV等新兴交通服务缺乏历史数据、需求和技术演化不确定的问题,论文将网络设计建模为风险厌恶多阶段随机规划,把长期投资顺序与日内运营控制联合起来,并用SDDP求解以避免场景树爆炸。曼哈顿算例显示,投资灵活性与可靠性约束可互补对冲极端情景,风险厌恶规划者会减少早期投入以保留适应性,并倾向回避运营灵活性较低的BRT类投资。

Context-Triggered Robust MPC for Temporal Logic Specifications Figure 1
2026-07-03eess.SY

Context-Triggered Robust MPC for Temporal Logic Specifications

Arash Bahari Kordabad, Satya Prakash Nayak, Sadegh Soudjani, Anne-Kathrin Schmuck

2026-07-03规划控制安全鲁棒

论文针对带有有界扰动的线性系统在上下文切换时难以同时满足安全、到达与停留类时序逻辑任务的问题,将高层逻辑规约转化为上下文触发的 cRAS 目标,并用鲁棒 MPC 与局部不变控制器构成切换架构;其关键洞察是把 MPC 值函数作为可达性证书,用鲁棒约束保证避障、用局部控制保证停留。机器人导航实验显示,该方法在静态和移动环境中比 Lyapunov 证书法获得更大的可行域,并支持在线任务重配置。

Admission and Assortment Optimization for Multi-size Automated Parcel Lockers Figure 1
2026-07-03math.OC

Admission and Assortment Optimization for Multi-size Automated Parcel Lockers

Carlos Aníbal Suárez, Antoine Deza, Tal Raviv

Department of Computing and Software, Faculty of Engineering, McMaster University, Hamilton, Ontario, Canada, School of Industrial & Intelligent Systems Engineering, Faculty of Engineering, Tel Aviv University, Israel

2026-07-03优化算法

针对多尺寸包裹柜中小件可占用大柜、却可能挤出未来大件的容量取舍,本文将准入控制建模为平均成本 MDP,并把运营策略与柜型组合设计联动分析。核心洞察是“能放就收”的 AA 策略在快速取件下可证最优,在较慢取件时也几乎无损;柜型优化则用精确枚举与交换邻域搜索结合,后者在可验证实例中均找到最优并可扩展到更大系统。

Boundary-Aware Quantization: Finite-Scale Decision Geometry of Neural Classifiers Figure 1
2026-07-03math.OC

Boundary-Aware Quantization: Finite-Scale Decision Geometry of Neural Classifiers

O.M. Kiselev

2026-07-03学习理论

本文关注量化部署中“准确率几乎不变但决策边界已改变”的风险,提出用局部 logit 间隔、边界位移、切片 Jaccard、多类交汇点和低间隔带翻转等有限尺度指标审计量化。结果显示 4/6-bit 量化可保持较高准确率却显著重构边界;基于校准集的 boundary-aware stopping 在 digits、MNIST、Fashion-MNIST 和 CIFAR-10 上降低测试翻转与边界差异。

Bilinear control of age--space structured populations Figure 1
2026-07-03math.OC

Bilinear control of age--space structured populations

Jiguang Yu, Louis Shuo Wang

2026-07-03规划控制

本文面向带年龄—空间结构、更新边界和内生监测反馈的种群系统,解决双线性系数控制导致的非线性闭环与奇异伴随分析难题。核心做法是用特征温和表示建立适定性和Fréchet可微性,并将反馈导数识别为低秩、后向Volterra扰动。主要结果给出闭环解存在唯一、反馈修正伴随的显式解析表示、最优性条件及切换函数分解。

GPU-accelerated superiorization on constrained physical problems with SupPy Figure 1
2026-07-03math.OC

GPU-accelerated superiorization on constrained physical problems with SupPy

Tobias Becher, Yair Censor, Kay Barshad, Niklas Wahl

2026-07-03优化控制

本文针对物理约束问题中约束可能不一致、软目标不必严格最优且缺少通用实现的痛点,将 superiorization 方法实现为支持 CPU/GPU 的开源 SupPy 工具箱,并在地震成像、低剂量 CT 和放疗计划中验证。结果显示,相比单纯可行性搜索,成像噪声降低、放疗体剂量下降,且在不可行约束下仍可生成临床可用方案,但运行时增益与问题规模和扰动代价密切相关。

2026-07-02

23 篇
Computationally Efficient Near-Optimal Control for Current Ripple Reduction and Optimization of Three-Phase Motors via LMIs Figure 1
2026-07-02math.OC

Computationally Efficient Near-Optimal Control for Current Ripple Reduction and Optimization of Three-Phase Motors via LMIs

Huu-Thinh Do, Trung B. Tran, Jing Sun, Ilya Kolmanovsky

Department of, and the University of Michigan’s EV Center for funding this work. H-T. Do is grateful to Prof. Uday V. Shanbhag for his instruction in approximate dynamic programming.

2026-07-02规划控制优化算法

本文针对三相永磁同步电机在离散逆变器控制下电流纹波与开关损耗难以兼顾、传统混合整数优化或值迭代计算负担大的问题,提出用二次值函数近似和迭代 Bellman 不等式构造 LMI 凸优化,离线生成近似无限时域代价,并作为一步控制的尾项。仿真显示其离线求解快于常规值迭代,在线计算量低于 FCS-MPC,同时在电流纹波和开关频率权衡上达到相近表现。

GPU-Parallel Linearization Error Bounds for Real-Time Robust Optimal Control of Nonlinear and Neural Network Dynamics Figure 1
2026-07-02eess.SY

GPU-Parallel Linearization Error Bounds for Real-Time Robust Optimal Control of Nonlinear and Neural Network Dynamics

Jeffrey Fang, Keyi Shen, Anutam Srinivasan, Glen Chou

⋆ Equal contribution. All authors are with the Georgia Institute of Technology, Atlanta, GA, USA, 30308.

2026-07-02规划控制学习理论安全鲁棒

面向机器人、无人机等在不确定非线性动力学下的实时安全控制,论文关注 LTV 近似中常被忽略或过松的线性化误差界。核心是提出可微、GPU 并行的局部误差界:解析动力学用路径 Hessian 界,神经网络动力学用验证器仿射松弛与局部 Jacobian 修正,并将其嵌入 SLS 鲁棒控制。实验显示 GPUSLS-LEO 在最高 168 维系统上可达 67Hz,生成更紧且形式可验证的可达管。

ZO-Act: Efficient Zeroth-Order Fine-Tuning via One-Shot Activation-Informed Low-Rank Subspaces Figure 1
2026-07-02cs.LG

ZO-Act: Efficient Zeroth-Order Fine-Tuning via One-Shot Activation-Informed Low-Rank Subspaces

Xun Dong, Yibo Xu, Naigang Wang, Xin Li, Penghang Yin, Zi Yang

University at Albany, SUNY, IBM T. J. Watson Research Center

2026-07-02优化控制

论文针对大模型零阶微调中全参数或随机低维扰动方差高、收敛慢的问题,提出 ZO-Act:用一次校准得到的输入激活低秩基固定每层更新子空间,只优化轻量系数矩阵,从而保留前向-only和量化权重冻结优势,并可接入 Adam 等动量优化器。理论上其降低系数空间扰动的方差项和有限差分误差,但引入可控子空间偏差;在 Llama-3-8B、OPT-13B 与 INT4 Llama-3-8B 上,相比强零阶基线在理解、问答和常识推理任务中取得一致提升。

Quantum-Informed Portfolio Selection: An End-to-End Pipeline Validated on Trapped-Ion Hardware with Real Market Data Figure 1
2026-07-02quant-ph

Quantum-Informed Portfolio Selection: An End-to-End Pipeline Validated on Trapped-Ion Hardware with Real Market Data

Romina Yalovetzky, Martin J. A. Schuetz, Zichang He, Jiayu Shen, Yue Sun, Rudy Raymond, Shauna Sahay, Kishore Perla, Ruben S. Andrist, Grant Salton, Helmut G. Katzgraber, Roger Bongiovanni, Niraj Kumar, Rob Otter

Amazon Advanced Solutions Lab, Seattle, Washington 98170, USA, AWS Center for Quantum Computing, Pasadena, CA 91125, USA

2026-07-02优化控制

本文针对金融资产相关图稠密、非局部而传统量子优化难直接扩展的问题,将组合投资选择表述为最大独立集,并把 qReduMIS 从退火场景扩展到门模型 QAOA:量子硬件不直接给最终组合,而是采样“冻结”节点以触发经典精确约简。在四个真实指数、最高225只资产上,独立 QAOA 在大实例失效,而该流程在 S&P100/Nikkei225 达到0.40/0.95成功率;73个图的模拟显示时间到解 scaling 指数约小3.2倍,增益可能主要来自 hybrid reduction 与实例结构。

Influence of Routing and Speed Limits on Optimal Solutions in Traffic Emission Modeling Figure 1
2026-07-02math.OC

Influence of Routing and Speed Limits on Optimal Solutions in Traffic Emission Modeling

Marc-André Bach, Simone Göttlich, Alena Ulke

2026-07-02优化控制

面向城市交通减排与通行效率的双重目标,论文在LWR宏观交通、排放估计和污染扩散耦合框架中,对比路径分配、限速以及二者联合控制对最优解的影响。核心洞察是限速作为全局容量调节手段,比局部路由调整更能改变拥堵与污染格局;小型路网数值实验显示,单目标和多目标下限速均带来更大减排和流量提升,联合控制最优但相对单独限速的额外增益有限。

On directional local minimality and directional optimality conditions in nonsmooth optimization Figure 1
2026-07-02math.OC

On directional local minimality and directional optimality conditions in nonsmooth optimization

Timm Baake, Patrick Mehlitz

Department of Mathematics and Computer Science

2026-07-02优化算法

本文针对非光滑优化中仅下半连续目标函数的无约束极小化,动机是传统局部极小与Fermat型条件忽略方向信息、可能过粗。核心做法是以方向局部极小为切入点,结合一阶/二阶次导数、方向极限与方向近端次微分,建立方向化的一阶和二阶必要及充分条件,并将常规局部极小转化为关于临界方向的条件。示例表明这些方向条件比非方向条件能区分更细的最优性结构。

Experiment Design for Set-membership Identification: From Prior Knowledge to Universal Inputs Figure 1
2026-07-02math.OC

Experiment Design for Set-membership Identification: From Prior Knowledge to Universal Inputs

Amir Shakouri, Henk J. van Waarde, M. Kanat Camlibel

2026-07-02优化控制

本文面向集合成员辨识中的离线实验设计问题:在有限采样、可能存在ℓ∞有界噪声且仅有一般先验知识时,如何选择输入以保证辨识精度。核心是提出“通用输入”框架,把数据信息性与先验集合直接关联,超越仅依赖持续激励和可控性先验的传统方法。结果给出无噪与有噪场景下通用输入的充要或构造条件,说明某些先验可用更少样本甚至hands-off输入达到辨识目标,并刻画噪声下精确辨识需先验集合一致离散。

Optimal control problem for reflected McKean--Vlasov stochastic differential equations with Poisson jumps Figure 1
2026-07-02math.OC

Optimal control problem for reflected McKean--Vlasov stochastic differential equations with Poisson jumps

Wenrui Lu, Kai Wang

2026-07-02规划控制

本文针对带反射约束与泊松跳的 McKean–Vlasov 随机系统,动机是处理均场相互作用、状态非负约束和突发冲击同时存在时的最优控制存在性问题。核心在于把松弛控制框架推进到 Skorokhod 路径空间,结合 Aldous 紧性准则、Skorokhod 映射连续性和随机积分稳定性完成极限传递。主要结果是在 Lipschitz 与增长条件下证明最优松弛控制存在,并在 Roxin 凸性条件下得到严格最优控制;一般情形下还证明松弛控制可由严格控制逼近。

Geometric Reduced-Attitude Tracking Under a Time-Varying Conic Constraint via Smooth Reference-Shaping Figure 1
2026-07-02math.OC

Geometric Reduced-Attitude Tracking Under a Time-Varying Conic Constraint via Smooth Reference-Shaping

Pedro Santos, Joel Reis, Paulo Oliveira, Carlos Silvestre

2026-07-02视觉感知优化算法

面向航天器指向、飞行器迎角限制等会随时间变化的锥形姿态约束问题,论文在二球面 reduced-attitude 运动学上设计几何跟踪律,并用平滑参考整形把期望方向投影到可接受区域,避免在线优化和不连续反馈。结果证明无约束跟踪具几乎全局渐近及局部指数收敛,整形后可满足软化约束并量化相对最优投影的偏差;代价是未保证硬安全不变性。

Effective dynamics of the Sinkhorn algorithm in the regime of low entropy regularization Figure 1
2026-07-02math.OC

Effective dynamics of the Sinkhorn algorithm in the regime of low entropy regularization

Guillaume Wang

Guillaume Wang 1 1 1 Courant Institute School, New York, University

2026-07-02优化控制

本文关注低熵正则下 Sinkhorn 算法表现出异常快收敛且轨迹呈分段结构的现象。核心洞察是将迭代按 t=τk 重标度,证明对偶变量收敛到显式的“cold Sinkhorn”连续时间动力学,类似单纯形法在未正则 OT 对偶上推进;该动力学有限时间到达最优解,从而给出 O(1/τ) 次迭代达到约 O(τ) 对偶次优的新保证,优于既有 O(τ^-2) 分析。

A Data-Enabled Primal-Dual Approach for Policy Learning with SDP Formulations Figure 1
2026-07-02eess.SY

A Data-Enabled Primal-Dual Approach for Policy Learning with SDP Formulations

Han Wang, Feiran Zhao, Florian Dorfler

Automatic Control Laboratory (IfA), ETH Zürich

2026-07-02强化学习

针对数据驱动控制中批量 SDP 反复求解昂贵、现有在线策略学习多局限于 LQR 的问题,论文把随闭环数据更新的控制合成表述为时变 SDP,并用原始-对偶迭代在线跟踪其解。核心在于用一次线性方程求解和 PSD 投影替代完整 SDP 求解,同时引入 Sim-to-Real Gap 与 Difference-of-Signal 解释数据噪声和变化速率对收敛的影响。理论给出局部线性跟踪和全局遍历界,数值在 LQR、H∞ 与安全探索中显示可提升控制性能。

Iterative graph lifting for automatic design of path-complete stability certificates Figure 1
2026-07-02math.OC

Iterative graph lifting for automatic design of path-complete stability certificates

Léa Ninite, Raphaël M. Jungers

stability certificates using labeled directed graphs, known as, the effectiveness and scalability of the proposed approach, out-, associates Lyapunov functions with the nodes of a labeled, ifying path-completeness of a labeled graph is PSPACE-, from the limited scalability of SMT solvers. In contrast, we, analysis to iteratively build efficient and scalable stability, the proposed approach and its improved scalability compared, ditions and upper bounds on the JSR using directed labeled, A directed labeled graph on ⟨M⟩is a pair G = (S, E), a set of labeled edges. An element (a, b, i) ∈E represents a, directed edge from a to b labeled by i, corresponding to a, Intuitively, a directed labeled graph is path-complete if

2026-07-02优化控制

针对任意切换线性系统中联合谱半径难以精确估计、De Bruijn 路径完备图随阶数指数膨胀的问题,本文从优化问题的紧约束子图出发,给出判断当前图是否已达到精确 JSR 的充分证书,并据此只对瓶颈节点做局部 lifting 分裂。实验显示,该迭代构图在挑战实例上用更小图和更短时间得到比 De Bruijn 层级更紧或相当的上界。

An semidefinite programming-based $\varepsilon$-constraint method for the bi-objective single-row facility layout problem Figure 1
2026-07-02math.OC

An semidefinite programming-based $\varepsilon$-constraint method for the bi-objective single-row facility layout problem

Christof Brandstetter, Elisabeth Gaar, Markus Sinnl

Institute of Business Analytics and Technology Transformation/JKU Business School, Johannes Kepler University Linz, Austria, Institute of Mathematics, University of Augsburg, Germany, line such that the weighted sum of the center-to-center distances of each pair of facilities is minimized., on a line, such that the sums of the p weighted center-to-center distances of each pair of facilities are

2026-07-02优化算法

本文面向单排设施布局在制造、仓储、机场等场景中存在多目标权衡的问题,提出双目标 SRFLP 的 Pareto 求解框架。核心创新是把 ε-约束法与自研 SDP 分支定界深度结合,而非黑箱调用 ILP,并利用非二分分支、树节点复用、变量固定等机制降低迭代成本。实验在 145 个实例上求得 140 个非支配集,明显超过最佳 ILP 基线的 100 个,且相对基础版本和 ILP 方法最高分别快约 180 倍和 90 倍。

Vehicle Routing Problem Meets Large Language Models: An Overview and Perspectives Figure 1
2026-07-02math.OC

Vehicle Routing Problem Meets Large Language Models: An Overview and Perspectives

Xianchao Xiu, Chong Shen, Yanjiao Zhu, Wanquan Liu

2026-07-02优化控制

面对VRP在容量、时间窗、动态需求等复合约束下难建模、难求解、难迁移的问题,本文将LLM辅助车辆路径研究梳理为“建模者、设计者、协调者”三类角色,强调其价值不在直接替代优化器,而在自然语言约束解析、建模代码生成、启发式设计与工具链调度。综述还汇总数据集与评测框架,并通过两组比较实验讨论解质量、时间成本和可扩展性;结论显示LLM适合小规模或流程辅助场景,但直接端到端求解缺乏可行性保证,稳定增益仍需更多基准证据。

L2-L2-gain bounds for quadratic output systems Figure 1
2026-07-02math.OC

L2-L2-gain bounds for quadratic output systems

Birgit Hillebrecht

2026-07-02学习理论

针对端口哈密顿系统、最优控制和随机问题中常见的线性系统二次输出,论文关注如何给出可计算的 L2-L2 增益界。核心洞察是把二次状态输出的双变量传递函数限制到频域反对角线,并用关联变换转化估计;结果给出显式界,并证明可通过 Lyapunov/Sylvester 线性矩阵方程计算,进一步扩展到含线性、双线性与吞吐项的情形。

Optimization Algorithm for Determining the Source Surface Radius Based on Parker Solar Probe in situ Measurements from Encounters 1 to 19 Figure 1
2026-07-02astro-ph.SR

Optimization Algorithm for Determining the Source Surface Radius Based on Parker Solar Probe in situ Measurements from Encounters 1 to 19

Shiouhe Wang, Fang Shen, Yi Yang, Xueshang Feng, Jiansen He

2026-07-02优化算法

为减少PFSS模型中固定源面半径对日冕开放磁通和磁场极性预测的偏差,论文把源面半径选择表述为受PSP实测径向磁场约束的优化问题,并给出适定性与最优解存在性论证。算法在PSP第1至19次近日点数据上估计半径,并用ACE交叉验证;结果显示最优半径随第25太阳周从极小期进入上升期总体增大,相比传统2.5太阳半径改善开放磁通一致性,同时保持或提升极性预测。

Regularized Model Predictive Control via Contractivity and Implicit Lur'e Analysis Figure 1
2026-07-02math.OC

Regularized Model Predictive Control via Contractivity and Implicit Lur'e Analysis

Ryotaro Shima, Anand Gokhale, Alexander Davydov, Francesco Bullo

Laboratories, Incorporated, 41-1, Yokomichi, Nagakute, Aichi, Japan (e-, while the author was at the Center for Control, Dynamical Systems, and, Anand Gokhale and Francesco Bullo are with the Center for, Alexander Davydov was with the Center for Control, Dynamical Sys-, USA. He is now with the Department of Mechanical Engineering, Rice

2026-07-02规划控制

针对MPC中软约束、稀疏化等正则项会改变隐式反馈律、使闭环稳定性难以分析的问题,论文把正则化MPC重写为隐式Lur’e系统,将正则项视作扰动算子,并用增量乘子推导收缩性的LMI判据。主要结果覆盖光滑凸、闭真凸和Lipschitz梯度三类正则器,给出可行性与良定性证书;数值例子显示可调节性能同时保留形式化收缩稳定保证。

Distributed Prediction under Heterogeneity with Unidentifiable Parameter Figure 1
2026-07-02stat.ME

Distributed Prediction under Heterogeneity with Unidentifiable Parameter

Erbo Li, Zhaojun Hu, Ting Wei, Yifan Sun, Liping Zhu

\orgdiv Center for Applied Statistics, \orgname School of Statistics, Renmin University of China, \orgdiv Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, \orgdiv Center for Applied Statistics, \orgname Institute of Statistics and Big Data, Renmin University of China

2026-07-02优化控制

本文针对分布式预测中低维结构参数不可识别、节点数据异质且通信受限的问题,提出半参数框架:用迹相似惩罚自适应追踪同质节点,并通过 invex 松弛与多步本地更新缓解投影度量带来的强非凸性。理论上给出非渐近模型无关预测误差界、两阶段 minimax 最优收敛率和通信效率保证,仿真及多中心 eICU 应用显示其在异质场景下优于现有方法。

Killing the Case for Randomization in Dynamic Assortment Optimization Figure 1
2026-07-02math.OC

Killing the Case for Randomization in Dynamic Assortment Optimization

Mikhail Fadin, Huseyin Topaloglu

2026-07-02优化算法

动态 assortment 优化常用随机抽样的库存无关策略来绕开高维动态规划,但随机性会增加绩效波动并削弱平台可解释性。本文证明可将任意此类策略去随机化为确定性货架序列,且不降低原有保证;还可在能解静态 assortment 问题时搜索原支持集外方案。局部最优确定性策略相对最佳抽样策略达到约 1/2−ε 保证,实验显示去随机化常带来实质收益。

Distributionally Robust Linear Regression With Block Lewis Weights Figure 1
2026-07-02cs.LG

Distributionally Robust Linear Regression With Block Lewis Weights

Naren Sarayu Manoj, Kumar Kshitij Patel

2026-07-02安全鲁棒

本文关注多群体线性回归中平均损失优化可能牺牲弱势分布的问题,目标是高效求解最坏群体误差最小化的分布鲁棒最小二乘。核心创新是利用 block Lewis weights 将经验 GDR 问题几何化为特定加权最小二乘,并结合加速近端方法,减少对条件数和群体数的依赖。主要结果是在约 O~(min{rank(A),m}^{1/3}ε^{-2/3}) 次块对角加权线性系统求解内得到 (1+ε) 近似,并可在平均损失与鲁棒损失之间平滑插值。

Homogenization of $\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent Figure 1
2026-07-02math.OC

Homogenization of $\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent

Fabrizzio Sabelli

a ∼N(0, K) (left) and noiseless binary logistic regression with hard labels on a mixture of Gaussians (right) with, ∥∆a∥≤δ} is convex, centered, the inner product is linear and the, sampled such that a belongs to class I and ϵ ∼N(0, η2) is independent label noise. Our main goal is not to study

2026-07-02优化算法

这篇论文关注对抗训练中 SGD 动力学为何对学习率、正则和早停高度敏感,在高维高斯混合与单指标模型下建立 ℓ2 对抗训练的确定性 ODE 等价和 adversarial homogenized SGD。核心洞察是对抗扰动可表现为自适应学习率与自适应 ℓ2 正则,并揭示常数学习率无法保证对抗最优的单调下降;线搜索劣势主要来自协方差各向异性和 ridge 参数错配。

Data Sharing and Competition in Learning-by-Deploying Industries: Insights from Robotics and Beyond Figure 1
2026-07-02cs.GT

Data Sharing and Competition in Learning-by-Deploying Industries: Insights from Robotics and Beyond

Yunjin Tong, Luca-Andrei Manea

Stanford Graduate School of Business

2026-07-02机器人

本文从机器人等“部署即学习”产业出发,研究部署数据共享如何影响技术进步、企业竞争与政策选择。其核心洞察是把早期产能视为未来学习资本,并区分数据池化与碎片化:无价格竞争时,数据池化提高福利但企业会低估外部学习收益;引入 Cournot 竞争后,共享虽提升整体产出却压低价格,私人共享激励会随需求弹性、学习曲线持续性和竞争强度变化,甚至转为负值,因此简单的数据互操作或统一补贴政策可能失准。

A Priori Integral Persistent Excitation in Conservative Polynomial ODEs with Higher-Order Interactions Figure 1
2026-07-02math.OC

A Priori Integral Persistent Excitation in Conservative Polynomial ODEs with Higher-Order Interactions

Aleksandr Semenov, Alexander Fradkov

2026-07-02优化控制

本文关注非线性动力系统参数辨识中常被当作假设的持续激励条件:在参数未知时如何预先验证。核心洞察是把保守多项式 ODE 的轨迹是否“粘”在任意仿射超平面上,转化为由 Lie 导数构成的非退化行列式与测度零奇异集问题。主要结果证明在紧不变集、绝对连续不变测度和非退化条件下,几乎所有初值的轨迹都满足仿射积分持续激励,并在三波相互作用模型上展示应用,主定理证明还给出 Lean 形式化。

2026-07-01

25 篇
Random Reshuffling Dominates Stochastic Gradient Descent Figure 1
2026-07-01math.OC

Random Reshuffling Dominates Stochastic Gradient Descent

Zijian Liu

2026-07-01优化算法

本文针对随机重排(RR)虽在实践中优于标准 SGD、但既有理论只能覆盖步长小于约 1/n 且需较多 epoch 的矛盾,重新分析光滑凸有限和优化中的收敛行为。核心创新是证明 RR 在任意合理步长(约至 1/L)下都有不劣于 SGD、且部分区间严格更优的收敛界,并给出改进的最优调参速率;特别在共同最优解情形获得较既有 RR 界好 1/n 的结果,从理论上消除了步长和 epoch 阈值限制。

Approximate Controllability of the generalized Burgers-Huxley equation in one dimension Figure 1
2026-07-01math.OC

Approximate Controllability of the generalized Burgers-Huxley equation in one dimension

Aman Patel, Mohmedmunavvar Mubarak Bapu, Mrinmay Biswas

Department of Mathematics, Indian Institute of Technology Kanpur

2026-07-01规划控制

本文面向含扩散、非线性对流与反应耦合的广义 Burgers-Huxley 方程,研究局部内部控制下的一维近似可控性。核心洞察是对 Burgers 型对流导致的非自伴线性化算子进行加权 Sturm-Liouville 化,并结合准静态变形、极点配置与 Lyapunov 估计处理谱结构。主要结果表明系统在任意给定有限时间内并非全局近似可控,但同一稳态连通分支内的两个稳态可在适当时间内被控制到任意小邻域;不同分支间可控性、零态可达性仍未解决。

Explicit Series and a Certified Hybrid Evaluator for the $\ell_p$ Proximity Operator for $0<p<1$ Figure 1
2026-07-01math.OC

Explicit Series and a Certified Hybrid Evaluator for the $\ell_p$ Proximity Operator for $0<p<1$

Lixin Shen, Jiangyu Yu

Department of Mathematics, Syracuse University

2026-07-01优化控制

针对0<p<1的非凸ℓp稀疏正则中近端算子难以稳定、快速求解的问题,论文从标量阈值结构出发,用Lagrange–Bürmann反演给出较大正根的显式一致收敛级数,并以Mellin–Barnes积分补足近阈值区域的可认证截断误差;进一步构造混合求值器并嵌入非精确近端梯度法,证明误差证书可求和时收敛到临界点,数值结果验证了精度与近阈值稳定性。

Eigenvalue optimization via a first-variation formula Figure 1
2026-07-01math.SP

Eigenvalue optimization via a first-variation formula

Denis Vinokurov

2026-07-01优化算法

针对加权 Laplace 与 Steklov 特征值优化中临界点难刻画、最优权存在性证明复杂的问题,本文从自伴算子空间计算第 k 个特征值泛函的 Clarke 次微分,得到可处理本质谱边缘情形的一阶变分公式。借此刻画最优权与调和映射结构,证明连续测度与 L1 权重优化值相同,并给出最优权存在性的简短证明,回应 Kokarev 的若干问题。

A Geometry-Adaptive Regularized Newton-Type Method for Manifold-Affine Intersection Problems Figure 1
2026-07-01math.OC

A Geometry-Adaptive Regularized Newton-Type Method for Manifold-Affine Intersection Problems

Dengyu Zheng, Shixiang Chen

School of Mathematical Sciences, Key Laboratory of the Ministry of Education, University of Science and Technology of China, Hefei, Anhui, China

2026-07-01优化控制

本文针对结构低秩逼近等流形与仿射子空间求交问题中,传统 Newton-SLRA 依赖横截性、在退化情形易失效的痛点,提出带几何自适应正则项的 RN-SLRA,并给出近似投影版本。核心洞察是用随流形残差衰减的正则化在交替投影稳健性与牛顿型高速收敛之间过渡;理论证明其在内在横截性下线性收敛,在横截性下可达 1+ρ 阶乃至二次收敛,实验显示在退化和 Hankel 例子上比 Newton-SLRA 更稳健。

A Counterexample to Ziegler's Cross-Polytope Conjecture for Simplicial 0/1-Polytopes Figure 1
2026-07-01math.CO

A Counterexample to Ziegler's Cross-Polytope Conjecture for Simplicial 0/1-Polytopes

Volker Kaibel, Sebastian Pokutta

Institute of Mathematics, Technische Universität Berlin and, Zuse Institute Berlin, Germany

2026-07-01优化控制

本文针对 Ziegler 关于极值单纯 0/1-多胞形是否必为交叉多胞形的猜想展开,动机是澄清顶点数达到 2d 上界时的结构是否唯一。核心做法是构造并精确验证一个 7 维、14 个顶点的 0/1-多胞形,其所有面满足单纯性但顶点集不关于立方体中心成对对称。结果给出该猜想的首个可能维度反例,并通过穷举分类证明 7 维下恰有 5 个非中心对称例子,而 d≤6 时猜想仍成立。

Graph Scheduling with Group Completion Times Figure 1
2026-07-01cs.DS

Graph Scheduling with Group Completion Times

Lars Rohwedder, Leander Schnaars

2026-07-01优化控制

本文研究图调度中的分组完成时间最小化,动机来自共流调度和数据迁移等网络传输场景:每步只能选择匹配边,难点在一般图的冲突约束。核心创新是把共流调度的迭代舍入推广到一般多重图,并引入一般匹配多面体的奇集不等式及边染色工具。主要结果是在 OPT 足够大时得到本质紧的 (2+ε) 近似,同时将数据迁移近似率小幅改进到 2.617,并给出一般图调度 1104/281 近似。

MINT: Dynamic-Precision CNN Inference with MSDF Digit-Serial Arithmetic on FPGA Figure 1
2026-07-01cs.AR

MINT: Dynamic-Precision CNN Inference with MSDF Digit-Serial Arithmetic on FPGA

Muhammad Usman, Malik Zohaib Nisar, Florian Aschauer, Dorit Merhof

Faculty of Informatics and Data Science, University of Regensburg, 93053 Regensburg, Germany, Department of Computer Engineering, Chosun University, Gwangju, Republic of Korea

2026-07-01优化控制

针对传统低位宽 CNN 加速器难以无额外硬件开销地按层调节精度的问题,MINT 利用 MSDF 左到右冗余有符号数运算,让卷积内积可在输出高位后提前终止,并用贪心搜索在 2% 精度损失预算内分配各层 INT2–INT7 精度。在 Zynq-7020 上,VGG-16/ResNet-18 平均降至 5.64/6.04 bit,吞吐提升 32.6%/26.0%,能效提升 82.1%/62.9%。

Dynamic Ultrasound Beamforming Using Left-to-Right Arithmetic Adders on FPGA Figure 1
2026-07-01cs.AR

Dynamic Ultrasound Beamforming Using Left-to-Right Arithmetic Adders on FPGA

Muhammad Usman, Shujaat Khan, Dorit Merhof

Faculty of Informatics and Data Science, University of Regensburg, 93053 Regensburg, Germany, Department of Computer Engineering, College of Computing and Mathematics, KFUPM

2026-07-01优化控制

本文针对便携式 FPGA 超声 DAS 波束形成中加法树占用 LUT 多、组合路径长、固定全精度计算耗能的问题,提出按最高有效位优先的左到右数字串行 LRA64 加法树,使结果可提前截断并以停钟实现运行时动态精度。作者在 Zynq XC7Z010 上用 64 通道数据评估,报告 LUT 较最小传统树少 2.5 倍、动态功耗低 23%,等面积复制下达到 67 FPS,比最佳传统方案高 80%。

Constrained Online Convex Optimization without Slater's Condition Figure 1
2026-07-01cs.LG

Constrained Online Convex Optimization without Slater's Condition

Kihyun Yu, Junehee Lee, Dabeen Lee

Seoul National University

2026-07-01优化算法

本文针对带随机约束的在线凸优化中,已有近最优遗憾与约束违反界通常依赖 Slater 条件或有界拉格朗日乘子的限制,提出一种 anytime 原始-对偶框架,在对偶更新中加入自适应正则项以稳定对偶过程,而不借助严格可行性带来的负漂移。结果显示,在凸损失下可获得 O(√T) 期望遗憾和 O(√T log T) 约束违反,并给出同阶高概率界;强凸损失下遗憾进一步降至 O(log T),框架也可扩展到对抗约束。

ILPU: Iterative Laplace-Based Phase Unwrapping via Bi-Level Optimization Figure 1
2026-07-01math.OC

ILPU: Iterative Laplace-Based Phase Unwrapping via Bi-Level Optimization

Michael Fedders, Jakob Schattenfroh, Yanglei Wu, Noah Jaitner, Tom Meyer, Jakob Jordan, Jing Guo, Ingolf Sack, Hossein S. Aghamiry

2026-07-01优化算法

MRI 相位解缠在低信噪比、组织边界和三维体数据中易产生残差扩散与整数偏移错误,影响 QSM、测温和 MRE 等后续定量。ILPU 将 DCT-Poisson 连续增量求解与质量引导的整数偏移图局部搜索组成双层优化,用自适应平滑抑制低质量区域噪声。实验显示其 2D 精度接近 SEGUE,3D 相对误差降至 2.12%,明显优于 SEGUE 和 Laplace,且每轮保持 O(N log N) 复杂度。

Exponential rate of convergence of relative value iteration algorithms for ergodic controls of diffusions Figure 1
2026-07-01math.OC

Exponential rate of convergence of relative value iteration algorithms for ergodic controls of diffusions

Sumith Reddy Anugu, Guodong Pang

‡ Department of Computational Applied Mathematics and Operations Research, George R. Brown School of Engineering and Computing, Rice University

2026-07-01生成模型规划控制学习理论

针对扩散过程遍历控制中相对值迭代虽已知收敛、但收敛速率长期未明的问题,本文把传统连续时间 PDE 型 RVI 改为逐时间窗的离散递推,并将迭代误差表示为相关 Markov 核作用下的差值;核心洞察是利用加权半范数中的收缩性,结合 Foster-Lyapunov 与小集条件,证明常规遍历成本和风险敏感遍历成本两类 RVI 在统一指数稳定假设下均具有指数收敛率。

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration Figure 1
2026-07-01math.OC

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

Wanru Chen, Jiaming Wu, Balázs Kulcsár

Architecture and Civil Engineering, Chalmers University of Technology, Gothenburg, Electrical Engineering, Chalmers University of Technology, Gothenburg, Sweden, scalability of the heuristic for larger problems. Sensitivity analyses highlight the value

2026-07-01规划控制

面向公交走廊客流波动导致的闲置运力与城市货运协同难题,本文将模块化车辆的编组、时刻、单元周转和客货需求分配统一建模,并显式考虑装卸/解编时间与随机客流机会约束。其主要洞察是用专用货运单元把货物处理从乘客上下车中剥离,同时通过中途重构提升容量适配。哥德堡算例显示,Benders 适合中小规模,启发式可扩展到大规模,且相较基准系统具备运营优势。

Direction-Magnitude Decomposition for Low-Rank Matrix Optimization: Faster Convergence and Saddle-to-saddle Dynamics Figure 1
2026-07-01math.OC

Direction-Magnitude Decomposition for Low-Rank Matrix Optimization: Faster Convergence and Saddle-to-saddle Dynamics

Yudong Wei, Liang Zhang, Bingcong Li, Niao He

2026-07-01优化算法学习理论

本文针对低秩矩阵优化中真实秩未知时,传统 Burer–Monteiro 过参数化可能拖慢收敛的问题,提出方向—幅值分解(DMD),将因子变量的方向与尺度分开优化。核心洞察是过参数化轨迹会呈现逐个学习特征对的 saddle-to-saddle 动力学,并据此给出过参数化与递归两类 DMD。理论上其误差依赖由次线性改善为对数级,条件数依赖从 κ⁴ 降至 κ²,实验覆盖矩阵分解、感知与补全。

Projection Operator Stochastic Equations for Non-Markovian Quantum Systems Under Continuous Measurement-Based Feedback Figure 1
2026-07-01quant-ph

Projection Operator Stochastic Equations for Non-Markovian Quantum Systems Under Continuous Measurement-Based Feedback

H. I. Nurdin

School of Electrical Engineering and Telecommunications, University of New South Wales, Sydney, NSW 2052.

2026-07-01优化控制

为处理连续测量反馈下环境具有记忆的开放量子系统,论文将投影算子方法从未监测或开环情形推广到基于测量记录的随机反馈。核心洞察是把主系统嵌入更大的马尔可夫系统后,非马尔可夫投影态的随机方程形式保持不变,但原先确定性项变为依赖测量历史的随机项。主要结果给出扩散型同相测量和跳跃型光子计数测量下的两类非马尔可夫SDE,并揭示其内在反馈环结构。

Augmenting airline networks using airside-to-airside buses to strengthen system resilience under disruptions Figure 1
2026-07-01math.OC

Augmenting airline networks using airside-to-airside buses to strengthen system resilience under disruptions

Micah M. Borrero, Max Z. Li

2026-07-01强化学习

针对航司枢纽—辐射网络在大规模扰动中易形成拥塞瓶颈的问题,本文提出用空侧到空侧巴士替代或补充短途区域航线,并以整数优化构建增广网络、用基于代理的仿真评估乘客延误。东北美国案例显示,在1000万美元购车预算下转换10条区域航线,可使扰动日平均乘客延误降约8%、正常日降约6%,同时降低运营成本;但扩大巴士范围和预算的边际收益递减。

Difference-of-Convex Optimization via Inexact Smoothing Descent Methods: Difference of High-Order Moreau Envelopes Figure 1
2026-07-01math.OC

Difference-of-Convex Optimization via Inexact Smoothing Descent Methods: Difference of High-Order Moreau Envelopes

Alireza Kabgani, Moslem Zamani, Masoud Ahookhosh

Department of Mathematics, University of Antwerp, Antwerp, Belgium.

2026-07-01优化算法

针对传统 DC 算法多依赖次梯度、难以形成光滑替代问题的局限,本文把 Moreau 包络推广为高阶差分包络 HOME-DC,分析其逼近、可微性及与原 DC 驻点的对应关系,并基于近似 proximal 解构造不精确一阶 oracle 与下降框架。理论上证明了非单调下降和子序列收敛,累积点为 HOME-DC 临界点;稀疏聚类实验仅作初步验证,实际增益幅度文中未充分说明。

Exponential-Family Tensor Completion via Nonconvex Dual Total-Variation Regularization Figure 1
2026-07-01stat.ME

Exponential-Family Tensor Completion via Nonconvex Dual Total-Variation Regularization

Wenfei Cao, Yang Chen, Qibin Zhao, Jinglai Li, Andrzej Cichocki

2026-07-01优化算法

针对带噪、缺失观测下的张量补全,论文关注传统总变差正则虽常用但缺少理论保证的问题;其核心是把指数族观测模型与基于变换 L1 的非凸对偶 TV 正则结合,同时刻画梯度张量的稀疏与低秩结构。文中给出恢复误差上界和极小极大下界比较,并在合成、图像、视频数据上验证有效性,但相对增益的具体来源仍可能受数据结构与参数设定影响。

Fuel-Optimal Low-Thrust Trajectory Design under High-Fidelity Dynamics: A State Transition Matrix-Based Sensitivity Approach Figure 1
2026-07-01math.OC

Fuel-Optimal Low-Thrust Trajectory Design under High-Fidelity Dynamics: A State Transition Matrix-Based Sensitivity Approach

Liqiang Hou

2026-07-01规划控制

面向高保真摄动下低推力燃料最优轨迹设计中协态方程偏导难以显式推导的问题,论文用状态转移矩阵敏感性重写协态微分方程,把复杂动力学作为黑箱纳入优化。方法在经典地火转移上与传统间接法验证等价,并进一步用于含太阳光压、太阳J2、木星三体引力和相对论修正的地火转移及多圈地金转移,展示了可处理复杂任务场景。

RoPoLL: Robust Panel of LLM Judges Figure 1
2026-07-01cs.AI

RoPoLL: Robust Panel of LLM Judges

Anish Acharya, Kris W Pan, Brian Verkhovsky

2026-07-01安全鲁棒

论文针对 LLM-as-Judge 评测中单一裁判和 PoLL 平均集成易受偏置、拒答、解析失败等拜占庭式污染影响的问题,将裁判团共识形式化为鲁棒均值估计,并用几何中位数替代算术平均。理论上证明 PoLL 在任意正污染下可产生无界偏差,RoPoLL 具备 1/2 breakdown 点;实验在 13 个开放裁判、3 个奖励模型基准和最高 50% 污染下显示,其在偏置污染和重尾攻击中稳定优于 PoLL,并可用小委员会超过更大单模型裁判。

SGD at the Edge of Stability: Stochastic Stabilization with Large Learning Rates Figure 1
2026-07-01stat.ML

SGD at the Edge of Stability: Stochastic Stabilization with Large Learning Rates

Konstantinos Emmanouilidis, Lachlan MacDonald, Salma Tarmoun, Rene Vidal

Department of CIS 1 , AMCS 2 , ESE 3 , IDEAS 4, University of Pennsylvania

2026-07-01优化控制

本文针对大步长训练中 SGD 仍能有效收敛、而现有 Edge of Stability 理论多限于确定性 GD 的缺口,研究多分类交叉熵下随机噪声与曲率振荡如何共同影响稳定性。核心创新是用随机 Lyapunov 稳定性定义 SGD 的稳定区分,并证明即使学习率很大,SGD 也会在有限步内高概率自稳定,在 EoS 与稳定阶段间切换后仍可获得 best-iterate 收敛保证;结果覆盖线性分类器和两层网络,并由实验支持大步长收益。

Optimal Design of Tubular Perfectly Conducting Objects in Electromagnetic Chirality Figure 1
2026-07-01math.OC

Optimal Design of Tubular Perfectly Conducting Objects in Electromagnetic Chirality

Tilo Arens, Roland Griesmaier, Marvin Knöller, Raphael Schurr

Tilo Arens 1 1 1 Karlsruhe Institute of Technology (KIT), Kaiserstr. 12, 76131 Karlsruhe, Germany, Knöller 2 2 2 Department of Mathematics and Statistics, University of Helsinki, Pietari Kalmin katu 5, FI-00014, Finland

2026-07-01优化控制

针对传统螺旋结构之外是否存在更强电磁手性管状散射体的问题,本文把完美导体的自由形状脊线纳入三维形状优化,严格建立形状到远场算子的可微性,并用电场积分方程、边界元与牛顿型算法优化正则化手性度量。结果表明,完美导体不存在最大电磁手性体,但优化可得到非螺旋、非直观且能激发高阶模的强手性厚管结构。

$\texttt{bucket-graph-spprc}$: an extensible C++ library for the shortest path problem with resource constraints Figure 1
2026-07-01math.OC

$\texttt{bucket-graph-spprc}$: an extensible C++ library for the shortest path problem with resource constraints

Simon Spoorendonk

2026-07-01优化算法

面向车辆路径等分支定价中反复求解且常成瓶颈的资源约束最短路问题,本文提供可复用的 C++23 头文件库 bgspprc,将桶图标号算法与编译期资源接口结合,支持多类资源无运行时分派组合,并实现双向标号、桶固定、弧消除和 SIMD 支配检查。实验在相同 LP bound 的公开实例上显示,其相对 PathWyse 的几何平均速度提升约 1.3–2.35 倍,单线程下仍有 1.3–2.3 倍优势。

Joint Chance Constrained Safe-Optimal Control Figure 1
2026-07-01math.OC

Joint Chance Constrained Safe-Optimal Control

Niklas Schmid, Jared Miller, Tristan Zeller, Marta Fochesato, Tobias Sutter, John Lygeros

N. Schmid, M. Fochesato, and J. Lygeros are with the Automatic Control Laboratory (IfA), ETH Zürich, 8092 Zürich, Switzerland

2026-07-01规划控制安全鲁棒

这篇论文针对传统联合机会约束控制会把低成本失败轨迹计入目标、从而诱导策略“故意冒险”或放弃任务的问题,提出只最小化安全轨迹成本的 safe-optimal 形式。作者将其等价改写为增广状态上的约束 MDP,可用动态规划求解,并给出连续状态网格化误差下的安全性界。二维单车 reach-avoid 实验显示,在相同安全概率要求下,该方法牺牲部分总体期望成本,但能降低成功安全轨迹的控制成本。

On the structure of optimal free Dirichlet regions in mass transportation problems Figure 1
2026-07-01math.OC

On the structure of optimal free Dirichlet regions in mass transportation problems

Lucas D. O'Brien

Department of Mathematics, Massachusetts Institute of Technology

2026-07-01优化控制

本文源于带免费运输区域的质量运输/灌溉网络问题:在给定长度预算下寻找使平均到达距离最小的连通集合。核心洞察是借助重心场与“原子”性质,推广对平均距离极小子的拓扑分析。主要结果是在更一般条件、尤其所有维度中证明早期猜想的结构描述:最优自由 Dirichlet 区域无环、只出现三叉结点且端点有限。

2026-06-30

63 篇
Optimization Dynamics Imprint Semantic Specificity in Contrastive Embedding Norms Figure 1
2026-06-30stat.ML

Optimization Dynamics Imprint Semantic Specificity in Contrastive Embedding Norms

Ziwei Su, Junyu Ren, Victor Veitch

2026-06-30优化算法

论文关注一个反直觉现象:对比学习训练和检索常用归一化余弦相似度,本应忽略 embedding 范数,但范数却与语义具体性、频率和不确定性相关。作者从优化动力学出发,将范数解释为梯度“热量”和径向漂移平衡的副产物,并给出平衡方程;实验显示该信号可在 CLIP、MiniLM 等模型中预测不确定性,并通过大范数折扣改善部分检索表现。

Convergence of Continual Learning in Homogeneous Deep Networks Figure 1
2026-06-30cs.LG

Convergence of Continual Learning in Homogeneous Deep Networks

Matan Schliserman, Gon Buzaglo, Itay Evron, Daniel Soudry

2026-06-30学习理论

本文针对连续学习中深度网络顺序微调为何会遗忘、何时会收敛的问题,研究弱正则化下的齐次深度网络。核心洞察是将连续分类刻画为对任务间非凸 margin 集的顺序投影,从而把线性模型结论推广到任意深度且全层训练的齐次网络。主要结果表明全局收敛一般不成立,遗忘可由非凸几何本身导致;但在特定正则性条件下,随机或循环任务序列可获得局部线性收敛,并进一步扩展到连续回归。

Computing the Integral R2 Indicator by Perspective Mapping and Box Decomposition Figure 1
2026-06-30cs.CG

Computing the Integral R2 Indicator by Perspective Mapping and Box Decomposition

Michael T. M. Emmerich

Faculty of Information Technology, University of Jyväskylä, Finland

2026-06-30优化控制

本文针对连续积分 R2 指标精确计算困难、有限权重采样可能漏掉细小偏好区域的问题,提出将 Tchebycheff 下包络的子图通过透视映射转化为倒数目标空间中的锚定盒并集补集。核心洞察是可复用超体积盒分解算法,只需把普通盒体积替换为带雅可比密度的闭式加权积分。主要结果给出固定维下输出敏感计算界:2、3 目标为 O(n log n),4 目标为 O(n²),并证明固定维至少 Ω(n log n)、维度作为输入时 #P-hard。

Robust McKean--Vlasov Variational Systems with Asymmetric Loss Aversion: Well-Posedness, Stability, and Propagation of Chaos for the Forward and Regularized Backward Systems Figure 1
2026-06-30math.OC

Robust McKean--Vlasov Variational Systems with Asymmetric Loss Aversion: Well-Posedness, Stability, and Propagation of Chaos for the Forward and Regularized Backward Systems

Tcheick Kayembe, Rostin Mabela, Jean-Pierre Bosonga, Eugène Mbuyi

University of Kinshasa, Kinshasa, D.R. Congo

2026-06-30三维安全鲁棒

针对多智能体/均场系统中模型不确定性、群体指标依赖和损失厌恶非光滑性同时存在时的适定性难题,本文构造鲁棒前后向 McKean–Vlasov 变分系统,用集体观测量和非对称损失厌恶的极大单调算子刻画交互与风险偏好;主要证明前向系统存在唯一与稳定性、后向正则化解的收敛及粒子近似的混沌传播,并指出双重一致估计需额外非接触条件。

Discovering the Kalman-Bucy-Koopman Filter Figure 1
2026-06-30math.OC

Discovering the Kalman-Bucy-Koopman Filter

Umesh Vaidya

Financial support from of NSF CMMI 2031573 is greatly acknowledged. The author is with the Department of Mechanical Engineering, Clemson University, Clemson SC, 29631.

2026-06-30优化控制

针对非线性系统中卡尔曼–Bucy滤波难以保留解析结构、EKF等依赖局部线性化的问题,论文将Mortensen最大似然估计的HJ值函数用Koopman主特征函数参数化,得到Koopman坐标下的Riccati型KBK滤波器。文中给出特征函数路径积分近似与误差界,并在仿真中相较EKF表现更好,还展示可在无显式线性化的数据驱动场景中使用。

Curvature-Weighted Gradient Diversity: A Noise Measure for Geometry-Adaptive SGD Schedules Figure 1
2026-06-30cs.LG

Curvature-Weighted Gradient Diversity: A Noise Measure for Geometry-Adaptive SGD Schedules

Muhammad Hamza (1), Ayush Goel (1) ((1) Indian Institute of Technology Kharagpur)

Indian Institute of Technology Kharagpur (IIT KGP)

2026-06-30优化算法

本文针对传统 mini-batch SGD 噪声分析把所有方向视为同等方差、忽略曲率差异的问题,提出曲率加权梯度多样性 CWGD,用 Hessian 逆平方根重标定批内梯度差异,并据此调制余弦学习率。在强凸二次、对角 Hessian 和各向同性噪声设定下,CWGD-Cosine 被证明可降低渐近误差地板,实验在多种条件数、批大小和噪声设置中约降低 20% 最终次优性;但文中也明确其非凸泛化尚未解决。

A note on the maximal covering location problem with customer preference ordering Figure 1
2026-06-30math.OC

A note on the maximal covering location problem with customer preference ordering

Elisabeth Gaar, Markus Sinnl

Institute of Mathematics, University of Augsburg, Augsburg, Germany, Institute of Business Analytics and Technology Transformation/JKU Business School, Johannes Kepler University Linz, Linz, Austria

2026-06-30优化控制

这篇短文针对带顾客偏好排序的最大覆盖选址问题,指出既有工作为该变体设计双层/单层MIP和启发式算法可能过度复杂。核心洞察是可将其实例直接转化为经典预算最大覆盖选址问题,并且缩小模型规模,从而复用成熟MCLP算法。实验显示该转化在精确求解中平均约22倍加速,150个设施规模下原模型超时而转化模型均可求解。

Strategic Risk Reduction: Self-Protection and Self-Insurance Figure 1
2026-06-30q-fin.RM

Strategic Risk Reduction: Self-Protection and Self-Insurance

Wing Fung Chong

2026-06-30安全鲁棒

本文关注在市场保险缺位时,风险持有者如何在降低损失概率的自我防护与降低损失幅度的自我保险之间分配资源。核心洞察是 VaR 只产生阈值型决策,最优解退化为不减险、纯防护或纯保险;而 TVaR 会耦合残余频率与损失强度,使问题即便在伯努利模型下也可能非凸。论文提出基于边际平衡等量线的几何方法,刻画边界、极端约束、相切与交叉情形,并说明置信水平和成本技术如何决定二者表现为替代或互补。

Infinite-Horizon Linear-Quadratic Difference Games with Coupled Affine Inequality Constraints: Open-Loop Generalized Nash Equilibria Figure 1
2026-06-30math.OC

Infinite-Horizon Linear-Quadratic Difference Games with Coupled Affine Inequality Constraints: Open-Loop Generalized Nash Equilibria

Partha Sarathi Mohapatra

by the information available to players [1], leading to open-loop, unavailable. In particular, necessary and sufficient conditions for the

2026-06-30优化算法

这篇论文针对多智能体动态博弈中共享资源、通信或聚合约束导致的非矩形可行域,研究带耦合仿射不等式约束的无限时域 LQ 差分博弈。核心洞察是把开环广义纳什均衡的存在性与无限时域线性互补系统的平方可和解联系起来,并在结构假设下转化为可验证的大规模 LCP。主要结果包括必要条件、附加假设下的充分条件,以及车辆编队约束示例验证。

Local-Minima-Preserving Continuous Relaxation of Ising Problems Figure 1
2026-06-30math.OC

Local-Minima-Preserving Continuous Relaxation of Ising Problems

Debraj Banerjee, Santanu Mahapatra, Kunal N. Chaudhury

2026-06-30优化控制

针对 QUBO/Ising 等组合优化在大规模场景中离散搜索难、普通连续松弛又会引入伪局部极小的问题,论文提出 MiP-CRIM,用满足条件的多项式“吸引子”构造连续松弛,并证明其局部极小与原问题 one-flip 局部极小一一对应。基于 ADAM 的求解器在自旋玻璃、MAX-CUT 和数划分基准上表现稳定,报告称较精确求解器更可扩展,并在多类实例上取得高质量解。

Value Functions of Separable Convex Integer Programs are Periodically Convex Figure 1
2026-06-30math.OC

Value Functions of Separable Convex Integer Programs are Periodically Convex

Koen Ligthart

2026-06-30优化算法

针对整数规划中离散变量使值函数失去普通凸性、从而阻碍两阶段随机整数规划等值函数重构的问题,本文证明可分凸整数规划的值函数在由约束矩阵决定的周期子格上仍具凸可扩展性。核心洞察是将一维周期凸性与扩张多面体的整数分解性质联系起来,并用 Graver 基推广到固定维情形;由此得到块结构整数规划的周期凸重构,并在局部块参数化下给出改进的 FPT 算法。

Continuous-Time Information Design for Hurricane Evacuation: Disclosure, Congestion, and Optimal Phasing under Model Uncertainty Figure 1
2026-06-30math.OC

Continuous-Time Information Design for Hurricane Evacuation: Disclosure, Congestion, and Optimal Phasing under Model Uncertainty

Furkan Sezer

2026-06-30安全鲁棒

针对飓风疏散中“信息太准导致同步拥堵、信息不足导致滞留”的两难,本文把公共预警精度与分阶段放行建模为连续时间鲁棒 Stackelberg 信息设计问题,揭示更清晰信号可能触发信息 Braess 效应,分阶段披露反而是最优信息结构。Rita 校准显示,最优调度可基本消除在途拥堵暴露、降本 89%,仅 staggered disclosure 也降本 70%。

Blow-up for weakly superlinear heat equations and blow-up controllability of the linear heat equation Figure 1
2026-06-30math.AP

Blow-up for weakly superlinear heat equations and blow-up controllability of the linear heat equation

Kévin Le Balc'h, Philippe Souplet

2026-06-30强化学习规划控制

本文关注热方程中弱超线性反应项为何会导致大范围爆破,并将这一爆破机制用于线性热方程的内部控制。核心创新是处理可空间局部化的非线性项,给出爆破集合与上下界估计,并证明存在时间连续性。主要结果表明:当增长约为 u log^p|u| 且 p∈(1,2) 时有限时爆破必为全局爆破,p=2 时至少区域爆破;进一步构造局部反馈控制,使线性热方程可在任意小时间内按预定时刻实现全局或区域爆破。

Preference-Based Reward Learning under Partial Observability with Inexact Dynamics Figure 1
2026-06-30math.OC

Preference-Based Reward Learning under Partial Observability with Inexact Dynamics

Reza Zolnouri, Semih Cayci

Department of Mathematics, RWTH Aachen University

2026-06-30强化学习

本文针对偏好奖励学习通常假设全观测的问题,研究RLHF在POMDP中需依赖不精确动力学进行信念推断时的误差传播。核心洞察是将模型失配经贝叶斯滤波稳定性、轨迹特征扰动传到Bradley–Terry估计偏差,并给出有限样本界:统计误差随反馈数下降,但存在由滤波与动力学误差决定的不可消除偏差下限。

Global $o(1/k^2)$ Merit Complexity of Regularized Newton Methods for Convex Multiobjective Optimization Figure 1
2026-06-30math.OC

Global $o(1/k^2)$ Merit Complexity of Regularized Newton Methods for Convex Multiobjective Optimization

Yuqia Wu, Yue Wang, Yaohua Hu

Yuqia Wu 1 1 1 School of Mathematical Sciences, Shenzhen University

2026-06-30优化算法

该文针对凸多目标优化中二阶方法缺少全局 merit 复杂度理论的问题,分析一种正则化 Newton 法:每步最小化带二次正则的局部二次模型 max-envelope,并用 Tanabe 型 merit 函数刻画弱 Pareto 最优性。在初始分量下水平集紧、Hessian Lipschitz 条件下,证明 merit 沿迭代达到全局渐近 o(1/k²),且构造一维双目标例子说明指数 2 在统一多项式意义下基本不可改进。

Quantum percolation based dynamic propagation connectivity for critical-area identification in transport networks Figure 1
2026-06-30quant-ph

Quantum percolation based dynamic propagation connectivity for critical-area identification in transport networks

Junxiang Xu, Chence Niu, Vinayak Dixit, Divya Jayakumar Nair, Tingting Zhang

. Research Centre for Integrated Transport Innovation (rCITI), School of Civil and Environmental Engineering, The, University of New South Wales, Kensington, UNSW Sydney, NSW, 2052, Australia, . Guangdong Basic Research Center of Excellence for Ecological Security and Green Development, Key Laboratory, for City Cluster Environmental Safety and Green Development of the Ministry of Education, School of Ecology, Environment and Resources, Guangdong University of Technology, Guangzhou, 510006, China, . Key Laboratory for Vehicle Emission Control and Simulation of Ministry of Ecology and Environment, Chinese, Research Academy of Environmental Sciences, Beijing, China, . Vehicle Emission Control Center, Chinese Research Academy of Environmental Sciences, Beijing, China, topological disconnection occurs. Link-centred and binary percolation measures identify important facilities or

2026-06-30优化控制

针对灾害中道路常以区域而非单链路退化、且拓扑断开前已发生功能损失的问题,本文将时变旅行时间转为连续传播强度,构造量子渗流式 DPC 指标评估区域削弱对全网传播覆盖的影响。在 Sioux Falls 与飓风 Irma 后佛州六个路网的 1281 个五分钟时段上,DPC 找到的关键区与链路数、介数、代数连通度和经典渗流排序明显不同,部分网络与经典渗流呈负相关,稳健性检验排名一致性为 0.84–0.96。

A Distributionally Robust Framework for Learned Reconstructions in Inverse Problems Figure 1
2026-06-30math.OC

A Distributionally Robust Framework for Learned Reconstructions in Inverse Problems

Floor van Maarschalkerwaart, Subhadip Mukherjee, Christoph Brune, Marcello Carioni

University of Twente, Enschede, the Netherlands

2026-06-30三维安全鲁棒

针对学习型逆问题重建在测试噪声或前向模型分布偏移下易失稳的问题,论文提出结构化分布鲁棒优化框架,只允许对与采集物理一致的边缘或条件分布扰动,而非粗暴扰动整个联合分布。其理论给出强对偶、有限维对偶形式和诱导 Lipschitz/Tikhonov 正则的最坏风险界;在去模糊与 CT 重建实验中,相比 MSE 和标准 DRO 表现出更好的鲁棒性、稳定性与可解释性。

When Natural Variables Are Not Enough: Teaching Integer Programming with Sudoku Figure 1
2026-06-30math.OC

When Natural Variables Are Not Enough: Teaching Integer Programming with Sudoku

Aled Williams

Department of Computer Science, University of London

2026-06-30优化控制

本文以数独教学切入整数规划建模,动机是说明“最自然”的单元格取值变量未必带来好用的线性模型。核心洞察是对比三指标二进制赋值模型与单元格整数模型:前者变量更多但约束简洁,后者需用 big-M 线性化 all-different 条件而显著复杂。主要结果是给出两类 AMPL 实现、唯一性认证模型,并展示其可扩展到 Killer Sudoku 与广义数独复杂性教学。

Fast Adaptive Tensor Methods Under Local Smoothness Figure 1
2026-06-30math.OC

Fast Adaptive Tensor Methods Under Local Smoothness

Sadok Jerad

2026-06-30优化控制

本文针对高阶优化方法常依赖全局 Lipschitz 光滑性、在多项式或指数类目标上过强的问题,提出仅需局部 p 阶张量 Lipschitz 条件的自适应正则化张量方法,并用与梯度范数相关的正则项和额外接受准则处理局部性。理论上,非凸情形达到一阶 ε 驻点的复杂度为 O(|log ε|ε^{-(p+1)/p}),凸情形优化间隙为 O(|log ε|ε^{-1/p}),与全局光滑假设下的标准张量方法仅差对数因子;实验仅在非凸回归上初步展示潜力,实际增益来源仍需更多验证。

Quantum percolation theory for dynamic propagation connectivity of transport networks Figure 1
2026-06-30quant-ph

Quantum percolation theory for dynamic propagation connectivity of transport networks

Junxiang Xu, Chence Niu, Divya Jayakumar Nair, Vinayak Dixit

. Research Centre for Integrated Transport Innovation (rCITI), School of Civil and Environmental Engineering, The, University of New South Wales, Kensington, UNSW Sydney, NSW, 2052, Australia, . Guangdong Basic Research Center of Excellence for Ecological Security and Green Development, Key Laboratory, for City Cluster Environmental Safety and Green Development of the Ministry of Education, School of Ecology, Environment and Resources, Guangdong University of Technology, Guangzhou, 510006, China

2026-06-30学习理论

针对交通网络在拓扑仍连通时已出现传播能力衰退的问题,本文将量子渗流引入韧性评估,提出动态传播连通性 DPC,并用传播算子谱与时间平均参与指数刻画功能连通。理论上证明均质扰动下 DPC 不变、异质扰动下退化,退化率受特征值间隔和扰动强度控制;基准网络实验进一步验证其与代数连通度可分离,且网络规模会放大退化。

A survey of trust-region radius update mechanisms. Part I: First-order analysis Figure 1
2026-06-30math.OC

A survey of trust-region radius update mechanisms. Part I: First-order analysis

Jérémy Rieussec, Fabian Bastin

University of Montreal, Dept. Computing Science and Operational Research

2026-06-30优化控制

本文针对信赖域方法中半径更新规则长期各自分析、缺少统一判据的问题,提炼出与梯度下界、失败收缩和成功受控扩张相关的结构条件,并用“弱/强可采纳性”比较固定因子、步长驱动、回顾式、临界性锚定和梯度缩放等机制。主要结果表明,在有界模型 Hessian 下弱可采纳性保证一阶梯度收敛,强可采纳性给出 O(ε^-2) 最坏复杂度,并可扩展到线性增长 Hessian 情形。

Low-Rank Tensor Completion using Tensor Train Decomposition via Riemannian Optimization on the Quotient Geometry Figure 1
2026-06-30math.NA

Low-Rank Tensor Completion using Tensor Train Decomposition via Riemannian Optimization on the Quotient Geometry

Zhenlong Hu, Zhongming Chen, Defeng Sun, Liping Zhang

Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China., Department of Mathematics, Hangzhou Dianzi University, Hangzhou 310018, China., Department of Applied Mathematics, The Hong Kong Polytechnic University, Hung Hom, Kowloon, Hong Kong ()., Corresponding author. Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China ().

2026-06-30优化算法

本文面向高阶张量补全中 TT 低秩表示虽省参数、但商流形方法投影与度量代价较高的问题,利用左正交 TT 核与正交群作用构造新的商几何,给出一族可容许黎曼度量及递归 polar/QR 回缩,并推导梯度下降和共轭梯度算法。其主要结果是将水平投影线性系统维度由秩平方量级降至约一半,实验重构精度与现有 TT 几何方法相当,优势更偏向计算效率而非精度提升。

Minimizing cumulative infections in SIS epidemic models over networks via an edge deletion algorithm Figure 1
2026-06-30cs.SI

Minimizing cumulative infections in SIS epidemic models over networks via an edge deletion algorithm

Phi Dung Hoang, Khanh Ly Duong

2026-06-30优化控制

本文针对网络 SIS 传播中累计感染难以直接最小化的问题,研究通过删边抑制疫情或恶意信息扩散。核心思路是在收敛到健康态的谱半径条件下,为非单调感染过程构造单调超模上界,从而把原本 NP-hard 的删边选择转化为可贪心处理的优化问题。实验在 Erdős–Rényi 随机图和 Haslemere 真实网络上显示,该算法能降低感染规模,但相对基线与增益来源文中未充分说明。

Relative Weak Convexity and Projected Subgradient Methods: Analysis and Convergence Figure 1
2026-06-30math.OC

Relative Weak Convexity and Projected Subgradient Methods: Analysis and Convergence

Morteza Rahimi, Masoud Ahookhosh

2026-06-30优化算法学习理论

针对非光滑非凸优化中传统近端类方法依赖结构、次梯度法缺少非凸收敛率的问题,本文引入相对弱凸函数,用距离生成函数刻画非凸性并建立表征、演算规则和无鞍点邻域性质;在尖锐性误差界与局部初始化条件下,证明投影次梯度算法在多种步长下收敛到全局最优,并给出几何衰减步长的线性收敛结果。

I.i.d. Prophet Inequalities with Discounted Rewards: As Hard as the Non-i.i.d. Case Figure 1
2026-06-30cs.GT

I.i.d. Prophet Inequalities with Discounted Rewards: As Hard as the Non-i.i.d. Case

Jung-hun Kim, Vianney Perchet

Criteo AI Lab

2026-06-30强化学习

本文关注在线最优停止中的先知不等式,动机是理解时间折扣这类结构化非平稳性会如何破坏 i.i.d. 场景的经典保证。核心洞察是折扣可被视为缩短“有效 horizon”,据此校准单分位阈值策略。主要结果表明,即使折扣任意弱,只要在长时域累积,竞争比也会从 1−1/e 跌至 1/2,且该壁垒不仅限于阈值策略,异质折扣和连续衰减情形也呈现类似断崖式退化。

A Restart-Free Accelerated Algorithm for Non-Convex Minimization: Continuous and Discrete Analysis Figure 1
2026-06-30math.OC

A Restart-Free Accelerated Algorithm for Non-Convex Minimization: Continuous and Discrete Analysis

Kansei Ushiyama, Shun Sato

*Department of Mathematical and Computing Science, School of Computing, Institute of Science Tokyo (former Tokyo Institute of Technology), 2-12-1, Department of Mathematical Sciences, Graduate School of Science, Tokyo, Metropolitan University, 1-1 Minami-Osawa, Hachioji-shi, 192-0397, Tokyo

2026-06-30优化算法

针对非凸光滑优化中现有加速一阶法依赖重启、导致末次迭代不可微且可能丢失动量信息的问题,论文提出以“速度控制”替代重启,并从新的时变阻尼 ODE 离散化得到两类算法。其结果是在梯度和 Hessian Lipschitz 条件下,以一阶 oracle 达到最优的 O(ε^-7/4) 复杂度;其中一类保持末次迭代可微,另一类自适应估计常数且无需预设参数,实验显示在部分基准上优于既有无参数方法。

Factorized low-rank matrix recovery problem, Schatten-$q$ quasi-norm, Error bound for critical point, Kurdyka-Łojasiewicz property, Inexact proximal alternating linearized minimization Figure 1
2026-06-30math.OC

Factorized low-rank matrix recovery problem, Schatten-$q$ quasi-norm, Error bound for critical point, Kurdyka-Łojasiewicz property, Inexact proximal alternating linearized minimization

Yongjun Chen, Defeng Sun, Liping Zhang

2026-06-30学习理论

针对低秩矩阵恢复中 Schatten-q 非凸正则虽更贴近秩但因子化后临界点误差界缺失、一般 q 的近端步难算的问题,本文分析因子化模型的临界点结构,指出该正则隐含列正交性并提出 S-critical 点判别,证明全局解属于此类且给出到真矩阵的误差界;同时设计不精确 PALM 与可计算近端准则,在 KL 条件下证明全序列收敛,并在最小二乘情形给出线性收敛条件,实验用于验证理论与算法效果。

Semi-discrete convex order and Laguerre tessellation fitting Figure 1
2026-06-30math.OC

Semi-discrete convex order and Laguerre tessellation fitting

David P. Bourne, Thomas Gallouët, Quentin Mérigot, Andrea Natale

umes from the barycenters of its cells. We establish a geometric interpretation of this, bitrary set of barycenters. We give a concrete application of this in materials science, Laguerre tessellation provided only the volumes and the barycenters of its cells?, barycenters (i.e., their centroids) and volumes (computed with respect to, the volumes and barycenters of its cells. However, the generators and weights are not, The key idea of this work is to characterize the barycenters of Laguerre cells with, grains. The 3DXRD data consists of the volumes and barycenters of the grains, but, barycenters, using stochastic optimization, where each cell in the Laguerre tessellation

2026-06-30优化算法

本文面向材料微结构重建中“只给定晶粒体积与重心,如何恢复 Laguerre 镶嵌”的问题,将可行重心集合刻画为相对于连续参考测度的半离散凸序集合,并把重建转化为到该集合的 Wasserstein 投影。主要结果包括层级 Laguerre 镶嵌的唯一性与极点/暴露点刻画、可近似恢复的充分条件,以及用于半离散投影的凸优化算法;实验展示了钢材 EBSD 图像拟合应用。

AdaGrad does not adapt to Hölder-smoothness for composite objectives Figure 1
2026-06-30math.OC

AdaGrad does not adapt to Hölder-smoothness for composite objectives

Matia Bojovic, Saverio Salzo, Massimiliano Pontil

Department of Mathematics, University of Genoa, Genoa, Italy, DIAG, Sapienza University of Rome, Rome, Italy, Department of Computer Science, University College London, London, UK

2026-06-30优化控制

本文针对复合优化中 AdaGrad 是否仍能自动适配 Hölder 平滑性这一问题,指出经典累积光滑项梯度的机制与复合最优性条件不匹配:最优点处光滑项梯度可不为零。作者构造一维确定性凸反例,证明 AdaGrad 的累积量线性增长、步长过快衰减,从而无法达到预期的 O(n^{-(1+ν)/2}) 收敛率,并提示应改用梯度映射或梯度差分累积。

Decision-Value Attribution in Predict-then-Optimize Systems Figure 1
2026-06-30cs.LG

Decision-Value Attribution in Predict-then-Optimize Systems

Konstantinos Ziliaskopoulos, Alexander Vinel, Alice E. Smith

2026-06-30优化控制

这篇论文针对预测—优化系统中“解释预测”不等于“解释决策价值”的问题,提出基于 Shapley 的 Decision-Value Attribution,将信息源、优化设计参数及其交互按下游目标价值归因,并区分模型视角的 pre-DVA 与真实结果的 post-DVA。电力储能套利和急救覆盖案例显示,传统特征重要性可能误判运营价值,DVA 能定位有用信息、设计瓶颈及二者互补关系。

A Machine-Verified Proof of a Quantum-Optimization Conjecture Figure 1
2026-06-30quant-ph

A Machine-Verified Proof of a Quantum-Optimization Conjecture

Uri Kol, Maor Ben-Shahar, Kfir Sulimany, Dirk Englund

Center of Mathematical Sciences and Applications, Harvard University, Cambridge, Massachusetts 02138, USA, MIT Center for Theoretical Physics - a Leinweber Institute, Cambridge, MA 02139, USA, Research Laboratory of Electronics, Massachusetts Institute of Technology, Cambridge, Massachusetts 02139, USA

2026-06-30优化算法

本文针对 QAOA 在“ring of disagrees”基准上的 FGG 最优近似比猜想,动机是精确定量浅层量子优化线路的表达能力。作者将问题形式化到 Lean 4,并让大模型在机器校验反馈中补全关键证明,核心洞察是利用隐藏动力学对称性把存在性问题转为显式构造。结果给出经 Lean 端到端验证的证明,确认深度 p 的最优近似比恰为 (2p+1)/(2p+2)。

Hybrid Quantum Neighborhood Selection: NISQ-Compatible Combinatorial Optimization via Stochastic Frontier Decomposition Figure 1
2026-06-30quant-ph

Hybrid Quantum Neighborhood Selection: NISQ-Compatible Combinatorial Optimization via Stochastic Frontier Decomposition

Nicolas Mendes de Araujo, Lester de Abreu Faria

ICTQ Foton — Institute of Quantum Sciences and Technologies Foton

2026-06-30优化算法

针对密集 QUBO 在 NISQ 设备上因交互项和线路深度随规模爆炸而难以直接运行的问题,论文提出 HQNS:每轮只把少量前沿变量送入浅层 QAOA 式量子子问题,其余变量冻结并并入系数,再通过随机前沿轮换逐步优化全局解。在分子多样性选择任务上,N=1000 时相对 11 次重启模拟退火保留 99.9908% 平均多样性,并报告显著降低时间、CPU 与内存;但作者也承认未证明无条件量子优势,增益可能主要来自分解与资源 scaling。

How AI settled the complexity of the oldest SGD algorithm Figure 1
2026-06-30cs.LG

How AI settled the complexity of the oldest SGD algorithm

Michał Dereziński, Xiaoyu Dong

University of Michigan, National University of Singapore

2026-06-30优化控制

本文关注一个长期理论缺口:1937 年 Kaczmarz 线性方程求解法作为最早的 SGD 实例,其不做迭代平均时的最坏情形复杂度一直未定。核心洞察是由 Gemini 与 ChatGPT 辅助发现并转化为可验证证明的函数分析连接,最终证明随机选方程的 Kaczmarz 最后迭代即可达到最优 O(1/ε) 收敛率,缩小了 SGD 理论与实践中“最后迭代”表现的差距。

The Simple Strategy-Iteration Method is Strongly Polynomial for the Turn-Based Deterministic Forward Game Figure 1
2026-06-30math.OC

The Simple Strategy-Iteration Method is Strongly Polynomial for the Turn-Based Deterministic Forward Game

Sanyou Mei, Chunlin Sun, Yinyu Ye

Visiting Scholar of Shanghai Institute for Mathematics and Interdisciplinary Sciences, Shanghai, China.

2026-06-30优化控制

本文关注回合制确定性零和博弈中强多项式算法是否存在这一开放问题,抓住“任一有向环不混合两方动作”的 forward 结构。核心洞察是该结构虽弱于无环性,却足以约束策略迭代的收敛:即使算法不识别该结构,简单策略迭代仍可在 O(n^6m^4log^4n) 次枢轴内终止;若显式利用 SCC 反向传播并分解为确定性 MDP,界可改进到 O(n^3m^2log^2n)。

Optimizer Memory Makes Shuffle Order a First-Order Source of Fine-Tuning Noise Figure 1
2026-06-30cs.LG

Optimizer Memory Makes Shuffle Order a First-Order Source of Fine-Tuning Noise

John Sweeney

2026-06-30优化控制

论文关注微调中数据 shuffle 顺序为何会显著影响结果,指出传统无记忆优化器的二阶顺序效应不足以解释 AdamW 等实际优化器的噪声。核心洞察是固定步数时钟的动量、预条件器和偏置校正会让同一梯度获得位置相关权重,使等多重集重排产生一阶学习率效应。作者用 lifted-state 展开、冻结预条件器核和确定性 replay 量化该通道,发现 AdamW 与固定动量呈显著一阶/近一阶方差斜率,SGD 仍为二阶,并给出 order-noise 误差条与 seed 预算准则。

A Posteriori Error Analysis for Decoupled Neural Approximations of Fully Coupled FBSDEs with Control Mismatch Figure 1
2026-06-30math.OC

A Posteriori Error Analysis for Decoupled Neural Approximations of Fully Coupled FBSDEs with Control Mismatch

Xichuan Zhang

Intelligent Game and Decision Lab, Beijing 100091, China

2026-06-30规划控制

针对全耦合 FBSDE 的深度求解中常为训练便利引入辅助控制、却导致前向控制与网络后向分量不一致的问题,本文把这种 control mismatch 纳入后验误差分析。核心做法是建立含漂移、扩散、生成元、终端条件和辅助控制扰动的稳定性估计,并离散化为只依赖终端缺陷、路径残差和控制错配的可计算误差界;线性二次与 Burgers 型实验显示这些指标可诊断训练一致性,错配惩罚对可复现近似有实际作用。

Fractional Stochastic Neural Networks Figure 1
2026-06-30math.OC

Fractional Stochastic Neural Networks

Yuecai Han, Jianming Xu

\addr School of Mathematics, Jilin University, Changchun 130012, Jilin, China

2026-06-30优化控制

针对布朗噪声难以刻画长记忆、粗糙或持续相关信号的问题,论文把残差网络建模为由分数布朗运动驱动的随机控制系统。核心创新是将相关增量分解为可预测项与白噪声创新,建立离散随机最大值原理、伴随递推和样本级反向传播的无偏梯度,并证明确定性参数下投影 SGD 的均方收敛。实验显示,FSNN 在长记忆恢复、不确定性量化及部分结构扰动鲁棒性上优于布朗或确定性基线,但优势依赖任务和 Hurst 指数。

Adaptive AI Delegation under Uncertainty: A Bayesian Governance Policy for Sequential Decision Authority Figure 1
2026-06-30q-fin.RM

Adaptive AI Delegation under Uncertainty: A Bayesian Governance Policy for Sequential Decision Authority

Matthew Francis Dixon

2026-06-30强化学习安全鲁棒

本文针对高风险组织场景中 AI 建议可靠性随时间变化、决策权难以静态分配的问题,将 AI 治理建模为带贝叶斯信念更新的 Governance-Aware POMDP,核心洞察是优化“授权程度”而非直接优化业务动作。实验通过合成压力测试和多种基线比较显示,该策略在脆弱、改善和高质量 AI 情形下总体治理效用更稳健,但真实部署外部有效性仍需进一步验证。

Solver-Verified Formulation Generation and Selection for Multi-Warehouse Inventory Allocation Using Large Language Models Figure 1
2026-06-30math.OC

Solver-Verified Formulation Generation and Selection for Multi-Warehouse Inventory Allocation Using Large Language Models

Jintao Xu, Yingzheng Ma, Jiong Dong, Yongzhi Qi, Jianshen Zhang, Dongyang Geng, Anni Zhang

2026-06-30优化算法

面向电商多仓补货中需求预测、库存覆盖和业务约束同时变化、且规则常以半结构化文本给出的建模难题,论文提出 ORLA:让大模型生成 Problem–Model–Code 候选优化模型,并用 MILP 求解器反馈验证、筛选和修复不可行解。其核心在于多种互补 MIP formulation 与实例级选择,而非单一模型。JD.com 29 批生产评测中,最佳单模型较现行方法提升 3.4 个百分点,完整框架提升 4.5 个百分点,26 批有增益。

An Exact Algorithm for Mixed-Integer Bilevel Stochastic Problem Figure 1
2026-06-30math.OC

An Exact Algorithm for Mixed-Integer Bilevel Stochastic Problem

Tomás Lagos, Dmytro Matsypura

University of New South Wales, The University of Sydney

2026-06-30优化控制

针对不确定性下领导者先决策、各场景中含整数变量的跟随者再响应所形成的混合整数双层随机问题,论文指出现有紧凑单层化方法难以处理其Σ₂^p-hard结构。核心做法是把确定性值函数重构与按场景分解结合,构造扩展单层模型、拉格朗日松弛和随机次梯度割平面,动态生成跟随者最优性割。结果在有界等假设下证明有限步收敛到全局最优,并在背包与燃料处理规划实验中报告可闭合大规模实例最优性间隙。

Turnpike and Sparse Optimal Control for Semiautonomous Neural ODEs Figure 1
2026-06-30math.OC

Turnpike and Sparse Optimal Control for Semiautonomous Neural ODEs

Dev Prakash Jha, Raju K. George

Department of Mathematics, Indian Institute of Space Science and Technology, Valiamala P.O., Thiruvananthapuram 695547, Kerala, India

2026-06-30规划控制

本文面向长时域训练/控制中全时变 NODE 参数随时间离散膨胀的问题,研究半自治 Neural ODE 的稀疏最优控制。核心洞察是半自治结构使对应静态问题自治化,从而可用耗散性、Pontryagin 伴随界和时间重标定证明 turnpike 行为。主要结果包括与时域长度无关的指数 turnpike、ℓ1 正则诱导的初段满幅控制与后段归零的一侧时间稀疏,以及均匀积分 turnpike;Duffing 振子和阻尼摆实验显示约 30 倍参数减少且稳定性能未损失。

Approximation and Controllability of Nonlinear Control-Affine Systems via Semiautonomous Neural Ordinary Differential Equations Figure 1
2026-06-30math.OC

Approximation and Controllability of Nonlinear Control-Affine Systems via Semiautonomous Neural Ordinary Differential Equations

Dev Prakash Jha, Raju K. George

Department of Mathematics, Indian Institute of Space Science and Technology, Valiamala P.O., Thiruvananthapuram 695547, Kerala, India

2026-06-30规划控制

针对经典 Neural ODE 因时间相关参数带来高存储与优化成本、且难以直接适配控制仿射系统的问题,论文提出 controlled SA-NODE,将漂移动力学与控制算子分别用时间无关参数的浅层网络近似。文中证明其可在紧集初值与可 admissible 控制上统一逼近轨迹,并在 Sobolev/Barron 条件下给出 O(P^-1/2+Q^-1/2) 误差率,同时保持近似可控性;摆和 Duffing 振子实验显示参数更少仍能重构轨迹与执行控制。

Modern Theory of Gradient-Based Optimization Figure 1
2026-06-30math.OC

Modern Theory of Gradient-Based Optimization

Bin Shi

Center for Mathematics and Interdisciplinary Sciences, Fudan University, Shanghai 200433, China, Shanghai Institute for Mathematics and Interdisciplinary Sciences, Shanghai 200433, China

2026-06-30优化算法学习理论

面向大规模学习中二阶方法代价高、梯度法需解释加速机制的问题,本文综述以高分辨率 ODE 与离散 Lyapunov 分析统一研究梯度优化。核心洞察是 NAG-SC 相比重球法的关键加速来源在梯度校正项,并将该框架推广到 NAG、FISTA、ADMM、PDHG 及加速变体,给出梯度范数加速、强凸线性收敛和单调性证明等结果,同时指出极小极大/鞍点问题仍待完善。

Computing Lewis weights to high precision using local relative smoothness Figure 1
2026-06-30cs.DS

Computing Lewis weights to high precision using local relative smoothness

Sander Gribling, Aaron Sidford, Chenyi Zhang

2026-06-30优化控制

本文关注矩阵行重要性度量中的ℓp-Lewis权重计算,动机来自ℓp采样、线性规划屏障、最优设计和几何问题中对高精度权重的需求。核心洞察是把问题置于原始/对偶凸优化形式下,用局部相对光滑的梯度下降及近似概念转换工具替代较专门的准牛顿分析。主要结果是在p≥4时用O(p² log(m/ε))轮杠杆分数计算得到ε估计,相比此前O(p³ log(m/ε))减少一个p因子。

Dead-Direction Conditioners: Gauge-Equivariant Preconditioning for Deep Networks Figure 1
2026-06-30cs.LG

Dead-Direction Conditioners: Gauge-Equivariant Preconditioning for Deep Networks

Tejas Pradeep Shirodkar

2026-06-30优化控制

本文针对深网损失在logit平移、归一化缩放、注意力旋转等规范对称下不变,而Adam逐坐标预条件会沿“死方向”漂移的问题,提出DDC:在对称轨道分解中重构优化器状态,使Adam/Muon更新保持规范等变并可在商空间读取奇异学习率。实验显示DDCAdam缓解语言模型过训练、ViT验证损失低于AdamW,DDCMuon在深层grokking中显著提高成功种子数。

Local well-posedness of general mean field game master equations Figure 1
2026-06-30math.PR

Local well-posedness of general mean field game master equations

Chenchen Mou, Jianfeng Zhang, Jianjun Zhou

Department of Mathematics, University of Southern California. E-mail:, College of Science, Northwest A&F University. E-mail:

2026-06-30三维

本文针对一般均值场博弈中主方程适定性难以超出标准模型的问题,提出以McKean–Vlasov前后向随机微分方程刻画均衡的统一路线;关键洞察是给出解耦场Lions导数的点态表示,并用自举递推获得高阶正则性。主要结果是在小时间区间内证明相应主方程存在唯一经典解,并覆盖扩展MFG、波动率控制和含主玩家三类模型。

An Approximate Conjugate Subgradient Algorithm with Matrix Parameter for Derivative-Free Nonsmooth Optimization Problems Figure 1
2026-06-30math.OC

An Approximate Conjugate Subgradient Algorithm with Matrix Parameter for Derivative-Free Nonsmooth Optimization Problems

Morteza Kimiaei, Saman Babaie-Kafaki, Zohre Aminifard

2026-06-30优化算法

面向高维、不可求导且非光滑目标中函数值昂贵、精度与效率难平衡的问题,本文提出无导数矩阵共轭次梯度框架:用离散梯度近似 Goldstein 次微分,求其凸包最小范数元作为驻点残差,并以矩阵记忆、阻尼、缩放和角度保护生成下降方向。理论上给出近似 Goldstein 驻点收敛保证;数值测试显示在最高精度要求下矩阵版本更可靠,但相对增益可能部分来自 safeguards 与 scaling。

Faster than Fast-LTS: Robust Regression and Outlier Detection with DC Programming Figure 1
2026-06-30math.OC

Faster than Fast-LTS: Robust Regression and Outlier Detection with DC Programming

Marah-Lisanne Thormann, Phan Tu Vuong, Alain B. Zemkoho, Tri-Dung Nguyen

School of Mathematical Sciences, University of Southampton, Kent Business School, University of Kent

2026-06-30视觉感知安全鲁棒

这篇论文针对含离群点数据中 LTS 鲁棒回归计算代价高、Fast-LTS 依赖大量随机初始化的问题,将 LTS 重写为带 capped simplex 约束的凹最小化,并用带问题特定预条件的 sBDCA 从单次初始化求解。理论上给出局部收敛与最快线性速率;实验显示在合成和真实数据上最高比 Fast-LTS 快 3.25 倍、目标值最多降低 90%,但增益可能与高维设置和预条件 scaling 密切相关。

Sharp $O(1/k)$ convergence rate for the Sinkhorn algorithm via a local analysis Figure 1
2026-06-30math.OC

Sharp $O(1/k)$ convergence rate for the Sinkhorn algorithm via a local analysis

Guillaume Wang

Guillaume Wang 1 1 1 Courant Institute School, New York, University

2026-06-30学习理论

本文针对 Sinkhorn 算法在渐近可缩放、最优支撑可能严格小于可行边集时收敛率仍有对数缺口的问题,重新从熵正则最优传输对应的二部图做局部分析,区分最优计划中有正质量与零质量的边。核心结果证明边际误差与联合相对熵均达到尖锐的 O(1/k) 收敛率,并借助既有近尖锐全局界完成从局部到全局的引导。

Second-Order Sensitivity of Efficient Solution and Marginal Maps in Parametric Vector Optimization with Set Constraints Figure 1
2026-06-30math.OC

Second-Order Sensitivity of Efficient Solution and Marginal Maps in Parametric Vector Optimization with Set Constraints

N. X. D. Bao, Tan H. Cao

Department of Applied Mathematics and Statistics, SUNY (State University of New York) Korea, Yeonsu-Gu, Incheon, Korea.

2026-06-30优化算法

这篇论文关注参数扰动下向量优化中“有效值”变化不能直接刻画“有效决策”变化的问题。核心做法是引入价值到决策误差界,将边际映射的二阶 Dini 敏感性提升为有效解映射的二阶公式,并把抽象可行映射推广到由集合约束定义的结构化系统。主要结果包括给出 H、Φ、S 的显式二阶半导数公式,覆盖多面体约束,并用投资组合与电力调度模型说明适用性。

Distributed recursive binary identification under tampering and non-persistent excitation Figure 1
2026-06-30math.OC

Distributed recursive binary identification under tampering and non-persistent excitation

Jian Guo, Ji-Feng Zhang

∗Department of Applied Mathematics, The Hong Kong Polytechnic, ∗∗School of Automation and Electrical Engineering, Zhongyuan, University of Technology, Zhengzhou 450007, China, and the State, Key Laboratory of Mathematical Sciences, Academy of Mathematics, and Systems Science, Chinese Academy of Sciences, Beijing 100190, under measurement-side tampering: each node observes a thresholded output whose label may, the CAS AMSS-PolyU Joint Laboratory in Applied Mathematics

2026-06-30优化控制

面向低功耗传感网络中一比特观测易被翻转攻击、且单节点可能缺乏持续激励的问题,论文提出基于扩散策略的分布式递归投影识别算法,将篡改概率纳入本地更新并融合邻居信息矩阵。理论上在不要求独立、平稳或高斯条件下,给出自适应预测 regret 与分布式估计误差的几乎必然上界,并证明在协同激励条件下各节点即使单独不可辨识也能一致收敛;仿真显示其优于非协作和未建模篡改的基线。

Optimal control of diffusive mean-field models for swarming particles on the sphere Figure 1
2026-06-30math.OC

Optimal control of diffusive mean-field models for swarming particles on the sphere

Jinwook Jung, Dohyun Kim

Department of Mathematics and Research Institute for Natural Sciences, Hanyang University, 222 Wangshimni-Ro, 04763 Seoul, Republic of Korea, Department of Mathematics Education and Institute of Pure and Applied Mathematics, Sungkyunkwan University, 25-2 Sungkyunkwan-Ro, 03063 Seoul, Republic of Korea

2026-06-30规划控制

本文面向球面上受几何约束的群体/机器人集群控制,研究带扩散的高维 Kuramoto 型平均场模型如何在跟踪目标密度同时限制控制能量。核心在于把微观随机粒子控制、球面 Liouville 方程与宏观平均场最优控制严格连接,并通过欧氏空间重构处理高维球面相对熵估计。主要结果包括粒子层最优控制存在、固定控制下单粒子边缘以 O(N^{-1/2}) 收敛到平均场解,以及粒子级最优控制的弱极限仍为平均场最优控制。

Balancing Shareholder Value and Financial Stability under a Reduced-Form Liquidation Model Figure 1
2026-06-30q-fin.MF

Balancing Shareholder Value and Financial Stability under a Reduced-Form Liquidation Model

Benjamin Avanzi, Bernard Wong, Jinxia Zhu

2026-06-30优化控制

本文针对传统“跌破固定阈值即清算”难以刻画现实破产与审慎监管渐进处置的问题,将企业盈余建模为分区扩散过程,并用随盈余恶化上升的清算强度描述困境区风险。在此框架下求解股东最优分红的奇异随机控制问题,证明障碍策略最优并给出价值与存续时间的可计算表达。结果表明,单独放宽清算或单独设置监管禁分红区并不稳定改善股东价值与生存期,二者组合才可能带来帕累托改进。

Lipschitz Regularity in Wasserstein Robust Stochastic Optimal Control Figure 1
2026-06-30math.OC

Lipschitz Regularity in Wasserstein Robust Stochastic Optimal Control

Shengbo Wang, Jose Blanchet

Daniel J. Epstein Department of Industrial and Systems Engineering, University of Southern California, Stanford University

2026-06-30规划控制安全鲁棒

本文关注鲁棒随机最优控制中价值函数是否足够光滑这一基础问题,因为其直接影响离散化、估计和强化学习近似误差。论文指出普通 Lipschitz 奖励与动力学并不保证 Lipschitz 价值函数,而正半径 Wasserstein 鲁棒性可通过最优传输对偶中的空间 inf-convolution 正则化 Bellman 不动点;在核扰动与噪声扰动两类模型下,证明了相应鲁棒价值函数在自然条件下局部 Lipschitz。

Reachability Guarantees for Cart-Pole Swing-Up and Stabilization Figure 1
2026-06-30eess.SY

Reachability Guarantees for Cart-Pole Swing-Up and Stabilization

Mohamed Khalid M Jaffar

*This work was not supported by any organization. The simulation scripts are available at github.com/khalid2696/cartpole_swing_analysis .

2026-06-30优化控制

这篇论文针对小车倒立摆中“能量摆起能否可靠进入局部 LQR 稳定域”的断链问题,构造带保守项抵消的能量 Lyapunov 摆起律,并用增广 Lyapunov 同时约束小车速度;再把切换区域严格嵌入 LQR 吸引域,给出从紧初始集到直立平衡的可达性保证。仿真显示约 12 秒切换、力受限且小车位移远小于解析与 LQR 区域界限。

A Fast Convergent Algorithm for Solving Non-convex Partially-Decoupled Generalized Nash Equilibrium Problems Figure 1
2026-06-30cs.MA

A Fast Convergent Algorithm for Solving Non-convex Partially-Decoupled Generalized Nash Equilibrium Problems

Bennet Outland, Vishala Arya

Bennet Outland 1 1 1 Ph.D. Student, Smead Aerospace Engineering Sciences Department, 3775 Discovery Drive, Boulder, CO, USA

2026-06-30优化算法

面向追逃、航天对抗等多智能体运动规划中非凸微分博弈难以稳定快速求解的问题,论文提出部分解耦GNEP建模与FALCON算法,将序贯凸化、增广拉格朗日和势博弈重构结合,把局部子问题转为可解的凸规划,并加入连续时间约束惩罚。理论上给出在温和假设下收敛到开环纳什均衡的保证,实验在F1竞速、狭窄走廊和航天博弈中显示较ALGAMES、DG-SQP更快且收敛率更好。

Robust Sparse Identification of Nonlinear Dynamics via Least Trimmed Squares Figure 1
2026-06-30math.OC

Robust Sparse Identification of Nonlinear Dynamics via Least Trimmed Squares

Fabio Amaral, Geovani N. Grapiglia, Cassio M. Oishi

Université catholique de Louvain, ICTEAM Institute, UCLouvain, 1348 Louvain-la-Neuve, Belgium

2026-06-30安全鲁棒

针对标准 SINDy 在含噪观测和离群点下易被有限差分导数与回归共同污染的问题,论文将鲁棒筛样与稀疏辨识解耦:先用 ILTS 迭代保留残差较小的可靠样本,再用 STLS 恢复简洁动力学方程。在 SIR、Lorenz、Lotka–Volterra 合成实验中,ILTS-SINDy 相比 STLS-SINDy 和 E-SINDy 在强污染场景更稳健,最高约 20% 离群数据下仍能保持较好识别性能。

A Relaxation and Rectification (ReCR) Framework for Systems with Linear and Complementary Constraints: Theoretical Foundation, Algorithms and Numerical Experiments Figure 1
2026-06-30math.OC

A Relaxation and Rectification (ReCR) Framework for Systems with Linear and Complementary Constraints: Theoretical Foundation, Algorithms and Numerical Experiments

Wissam AlAli, Xin Jiang, Jiming Peng

2026-06-30优化算法

针对含线性与互补约束系统求可行解本身 NP-hard、现有方法多只能保证驻点或依赖矩阵假设的问题,论文提出通用松弛理论,将可行性等价提升为线性约束下的双线性优化,并据此设计 ReCR 松弛—校正框架及多种变体。实验显示在文献 LCP 与新增中等规模 SLCC 上通常少量迭代即可找到可行解,H-ReCR 表现较稳,但实际增益部分仍可能受数据规模与实例构造影响。

A New Noise Model for Data-driven Control: Generalized Frobenius Norm Bounds Figure 1
2026-06-30math.OC

A New Noise Model for Data-driven Control: Generalized Frobenius Norm Bounds

Huayuan Huang, M. Kanat Camlibel, Henk J. van Waarde

2026-06-30规划控制学习理论

这篇论文针对直接数据驱动控制中噪声建模过保守或计算规模随实验长度增长的问题,提出广义 Frobenius 范数噪声界,以刻画噪声序列的整体能量并较 QMI 模型更贴近瞬时有界噪声。核心技术是新的向量化变量 S-lemma,使由该噪声模型诱导的不确定系统集合仍可转化为必要且充分的 LMI 条件。论文给出稳定化、H2/H∞ 控制以及可稳定性、耗散性分析的统一数据驱动判据,并通过数值例子说明保守性降低。

Comparing Scalar Objective Functions for Multi-Criteria Engineering Optimization Figure 1
2026-06-30math.OC

Comparing Scalar Objective Functions for Multi-Criteria Engineering Optimization

Olaf Frommann

Institute for Aerospace Technology, Hochschule Bremen, University of Applied Sciences

2026-06-30优化算法

这篇论文针对工程多目标优化最终仍需选出单一设计的问题,比较加权和、成就标量化、满意度函数与模糊逻辑四类标量目标在双指标归一化场景中的行为。其核心洞察是把优化器影响剥离,用凸/凹解析 Pareto 前沿诊断不同偏好建模的可达区域、选择密度、补偿性与可解释性。结果显示,加权和简单但在凹前沿上无法覆盖非支撑解;成就标量化、满意度与模糊规则能以不同机制到达内部折中点,其中模糊规则更适合表达非可分、参考依赖的工程偏好。

Pauli-Sparse regularised Counterdiabatic Shortcuts for Linear-Ramp QAOA Figure 1
2026-06-30quant-ph

Pauli-Sparse regularised Counterdiabatic Shortcuts for Linear-Ramp QAOA

Stefano Cipolla, Fabio Durastante

2026-06-30优化控制

该文针对线性斜坡 QAOA 参数少但易受小谱隙导致的非绝热跃迁影响的问题,提出用正则化绝热规范势构造 Pauli 稀疏的反绝热修正。核心做法是在 Pauli 坐标中用截断共轭梯度直接求解正则化 AGP,并用 Galerkin 重拟合和残差证书控制有限门预算。实验显示,该层在铁磁链和困难 QUBO 上提升低能子空间成功率与近似比,且不必解析指数小基态劈裂。

Rapid and robust parameter estimation for electrochemical battery models via BOLT: A batch-optimized local-to-global technique Figure 1
2026-06-30eess.SY

Rapid and robust parameter estimation for electrochemical battery models via BOLT: A batch-optimized local-to-global technique

Feng Guo, Luis D. Couto, Keivan Haghverdi, Khiem Trad, Grietus Mulder

2026-06-30安全鲁棒

本文针对电化学电池模型参数辨识耗时、易受初值影响且重复运行波动大的问题,提出 BOLT:用多样化初始化、批量并行 TRF 局部优化、JIT 加速仿真和多工况筛选,把局部求解组织成近似全局搜索。实验在 18650 NMC 电芯的分组 SPM 上显示,BOLT(32) 五工况平均电压 MAE 为 12.4±0.1 mV,单次约 9 秒,并在合成含噪数据中保持低于 0.6% 的参数相对误差。

Equilibria in Motion: Stability, Tracking, and Convergence Figure 1
2026-06-30math.DS

Equilibria in Motion: Stability, Tracking, and Convergence

Hassan Saoud

2026-06-30视觉感知学习理论

针对非自治系统中平衡不再是固定孤立点、而是随时间移动的非孤立集合这一问题,论文用局部 Hausdorff 估计定义“平衡速度”,并将其嵌入耦合耗散 Lyapunov 框架。主要结果给出相对移动平衡族的稳定性、定量跟踪界、漂移可积时的渐近跟踪与收敛速率,并证明可积平衡速度会诱导极限平衡几何,示例为时变需求下的资源分配模型。

2026-06-29

21 篇
Optimal Deployment of Electric Aircraft for Canadian Domestic Flights Figure 1
2026-06-29q-fin.MF

Optimal Deployment of Electric Aircraft for Canadian Domestic Flights

Elham Soufiani, Mehrdad Pirnia

2026-06-29优化控制

面向加拿大短途区域航空减排,论文将电动飞机采购、机场电气化、充电桩部署与航班分配纳入多期 MILP,并加入排放、电动服务占比和预算约束。Helijet 案例显示五年内可减排约 70% 以上且经济可行,但瓶颈主要在电动机队容量和运营结构而非充电设施,需优先布局高频航线并协调机队规模与排班。

Second-Order KKT Guarantees for Bregman ADMM in Nonconvex and Non-Lipschitz Optimization Figure 1
2026-06-29math.OC

Second-Order KKT Guarantees for Bregman ADMM in Nonconvex and Non-Lipschitz Optimization

Shuang Li, Zhihui Zhu, Qiuwei Li

2026-06-29优化算法

针对非凸且梯度不具全局 Lipschitz 性的线性约束优化,本文研究 Bregman ADMM 是否仍能避免收敛到严格鞍点。核心洞察是用双侧相对光滑性和 Bregman 几何重建固定点动力系统分析,证明严格鞍 KKT 点为不稳定固定点,随机初始化几乎必然避开,从而在已有一阶收敛条件下得到极限 KKT 点的二阶平稳性,并扩展到多块星形共识分布式问题。

Sharp First-Order Lower Bounds under Sublevel $α$-Polyak-Lojasiewicz Conditions Figure 1
2026-06-29math.OC

Sharp First-Order Lower Bounds under Sublevel $α$-Polyak-Lojasiewicz Conditions

Saeed Masiha, Negar Kiyavash, Patrick Thiran

EPFL School of Management of Technology, EPFL Department of Computer and Communications Sciences

2026-06-29学习理论

本文针对α-PŁ条件下非凸一阶优化的最优复杂度问题,指出全局光滑与全局α-PŁ在α<2时只会导出常数函数,因此应改用初始下水平集上的局部α-PŁ假设。核心结果是在该非平凡函数类上给出确定性与有界方差随机一阶 oracle 的尖锐 minimax 下界,并分别与梯度下降和SGD既有上界匹配,说明相关多项式收敛率不可改进。

Graphon Mean Field Game of mutual holding Figure 1
2026-06-29math.OC

Graphon Mean Field Game of mutual holding

Daorong Cui, Shuoqing Deng, Yang Xiang

2026-06-29优化控制

本文面向股权交叉持有中的风险分散与异质交互问题,将互持平均场博弈推广到由 graphon 描述的网络结构,并在标签—状态扩展空间中处理连续主体的可测性困难。核心创新是用 WOP2 度量分析正有限测度交互的连续性,从而放宽 graphon 非退化要求。主要结果包括显式刻画最优策略、证明相关 McKean–Vlasov SDE 的适定性,并建立有限主体 Nash 均衡向 graphon 极限的收敛。

A Fletcher's Augmented Lagrangian-Based Stochastic First-Order Method for Nonconvex Equality-Constrained Optimization Figure 1
2026-06-29math.OC

A Fletcher's Augmented Lagrangian-Based Stochastic First-Order Method for Nonconvex Equality-Constrained Optimization

Yawen Cui, Qiankun Shi, Xiao Wang, Xiantao Xiao

2026-06-29优化算法

针对目标与约束都只能随机一阶采样的非凸等式约束优化,论文关注现有全随机方法中约束函数评估复杂度过高的问题。核心做法是用 Fletcher 增广拉格朗日作为兼具光滑性与一定精确性的 merit function,结合分解随机搜索方向、截断 SPIDER 估计和按随机雅可比最小奇异值划分事件来控制退化扰动。主要结果是在额外二阶 Lipschitz 假设下,以期望总 oracle 复杂度 O(ε^-3) 达到随机 ε-KKT 点,并用数值实验验证效果。

Three-Body Earth-Moon Transfers with Different Departure/Arrival Orbital Altitudes: New Phenomenon and Diffusion Model-Augmented Construction Figure 1
2026-06-29math.OC

Three-Body Earth-Moon Transfers with Different Departure/Arrival Orbital Altitudes: New Phenomenon and Diffusion Model-Augmented Construction

Shuyue Fu, Wenxuan Zhang, Di Wu, Shengping Gong, Peng Shi

2026-06-29生成模型

面向地月三体转移中网格搜索收敛率低、换轨道高度需重复搜索的问题,论文在平面圆型限制三体模型下分析双脉冲转移的构造参数空间,指出飞行时间随出发相位角存在不连续分布现象,并用该结构训练扩散模型生成更好的初值。结果显示,在保持相近转移特性的同时,收敛率相对提升47.34%–56.25%,墙钟时间减少39.39%–40.52%;但增益可能主要来自数据驱动初值筛选与分布迁移。

Reservoir Zero-Coordinatewise Projected Subspace Search for Minimization Over Sparse Symmetric Sets in Machine Learning Figure 1
2026-06-29math.OC

Reservoir Zero-Coordinatewise Projected Subspace Search for Minimization Over Sparse Symmetric Sets in Machine Learning

Morteza Kimiaei, Shima Shabani, Michael Breuss

Institute for Mathematics, Brandenburg University of Technology

2026-06-29优化控制

针对稀疏学习中带基数约束的非凸优化难题,论文提出 RZCW-PSS,将坐标搜索、对称集合上的支撑交换、随机低维子空间探索与“reservoir”历史可行点注入结合,以提升支撑选择的稳定性和搜索多样性。理论上证明在相应假设下迭代点几乎必然达到零坐标方向平稳性,并在支撑稳定后具备局部线性收敛;合成实验显示其解质量和鲁棒性优于或竞争于现有稀疏搜索方法。

Dangerous Liaisons of Convex Learning and Non-Affine Aggregation Figure 1
2026-06-29cs.LG

Dangerous Liaisons of Convex Learning and Non-Affine Aggregation

Thomas Boudou, Batiste Le Bars, Nirupam Gupta, Aurélien Bellet

\addr Department of Computer Science, University of Copenhagen, Copenhagen, Danemark

2026-06-29优化算法

这篇论文关注凸学习中常见的非仿射梯度聚合,如自适应、隐私裁剪、鲁棒过滤和公平重加权,是否会破坏一阶方法依赖的单调性。核心洞察是给出一个否定性刻画:只有正仿射聚合能对任意单调输入保持单调。由此解释了非仿射规则可能导致末迭代不收敛、算法稳定性变差,并给出在受限条件下恢复单调性的方向。

Fractional quadratic obstructions to the local controllability of the Burgers equation Figure 1
2026-06-29math.OC

Fractional quadratic obstructions to the local controllability of the Burgers equation

Thomas Perrin

CONTROLLABILITY OF THE BURGERS EQUATION, We study the local controllability near zero of the Burgers equation with a scalar control, controllable and a second-order analysis is therefore required. We prove that quadratic ob-, structions to finite-time controllability can be quantified by Sobolev norms of the control with, and the first such continuous scale for finite-time local controllability. Our explicit construc-, Keywords: small-time local controllability, finite-time local controllability, Burgers equation, degenerate lin-, earization, quadratic-order controllability, scalar-input system, fractional Sobolev norms., In this article, we study the local controllability around zero of the viscous Burgers equation with, controllability which put the case µ ≡1, previously studied in [19, 16], into a broader and more, lability quantified by the H−5, local controllability established in [19] for k = 2 and k = 10 actually holds if k is even and satisfies, in which the obstruction to local controllability is quantified by the Hr(0, T)-norm of the control

2026-06-29规划控制

本文关注线性化不可控时 Burgers 方程在零附近的局部可控性障碍,动机是解释二阶效应如何阻止标量控制实现有限时间可控。核心洞察是把二次展开写成频域核,并将障碍强度与控制的负阶分数 Sobolev 范数、源项正则性及空间奇性联系起来。主要结果给出覆盖 r∈(-3/2,-1/2) 的连续分数二次障碍,统一并推广常数源项情形,同时给出有限时间持续的算术条件和较尖锐余项估计。

Discrete Event Population Updates: finding game theoretic emergent behaviour in queueing systems with simulation Figure 1
2026-06-29cs.GT

Discrete Event Population Updates: finding game theoretic emergent behaviour in queueing systems with simulation

Vincent Knight, Geraint I. Palmer-Liyu, Thomas Hutton

2026-06-29优化控制

本文针对战略排队系统常缺少闭式收益函数、难以套用演化博弈分析的问题,提出离散事件人口更新(DEPU):在一次长时离散事件仿真中随顾客离开持续估计策略适应度,并同步更新复制动态或 Moran 式有限人口。作者在多服务器 jockeying 模型和 Naor 可观测队列上验证方法,显示其能恢复已知均衡,并在无闭式模型中以相近精度比嵌套短仿真快数十倍,使参数扫描更可行。

Fast and Feasible: Permutation-based Constrained Reranking for Revenue Maximization Figure 1
2026-06-29cs.IR

Fast and Feasible: Permutation-based Constrained Reranking for Revenue Maximization

Svetlana Shirokovskikh, Anastasiia Soboleva, Ekaterina Solodneva, Aleksandr Katrutsa, Roman Loginov, Egor Samosvat

Avito & MSU, AI Center and IAI, MSU, AI Center & Avito, Avito & MSU, AI Center

2026-06-29优化控制

面向电商搜索中“提升付费推广收入但不牺牲相关性与风控”的再排序问题,论文将其建模为相对当前线上排序设约束的 ILP,并提出无需训练的 PermR:通过相邻商品交换在修复约束与提升收入间迭代近似求解。工业离线实验显示其获得约 63% 的 ILP 收入提升且满足时延与约束,5600 万查询的 14 天 A/B 测试带来约 2% 收入增益。

A primal-dual splitting algorithm for monotone inclusions with applications Figure 1
2026-06-29math.OC

A primal-dual splitting algorithm for monotone inclusions with applications

Changchi Huang, Jigen Peng, Liqian Qin, Yuchao Tang

a School of Mathematics and Information Science, Guangzhou University

2026-06-29优化控制

本文面向凸优化、变分不等式与图像恢复中常见的多算子单调包含问题,动机是避免将复杂结构粗暴提升到高维乘积空间。核心做法是提出原-对偶分裂框架,将余强制项前向计算、极大单调算子的 resolvent 后向步和线性复合项的对偶更新结合起来,每轮对各组件仅一次求解或评价。理论上证明了标准条件下弱收敛,并在一致单调等正则性下给出强收敛;图像去模糊和去噪实验显示其可用性,但相对增益的具体来源仍需结合实现细节判断。

Optimal Estimators for Heavy-Tailed Mean Estimation via Convex Analysis Figure 1
2026-06-29math.ST

Optimal Estimators for Heavy-Tailed Mean Estimation via Convex Analysis

Bart P.G. van Parys, Bert Zwart

Eindhoven University of Technology

2026-06-29优化算法

本文针对重尾分布下均值估计缺乏精确最优界的问题,研究仅知分布属于对称矩类时如何设计最优估计器。核心洞察是把固定误差半径下的最坏失败概率转化为两点 Hellinger 指数,并用凸对偶将无限维估计函数搜索化为两个乘子的优化,从而自然导出 Catoni 类夹逼型 M 估计器。主要结果给出任意可测估计器不可超越的精确大偏差率,且所构造估计器非渐近达到该率;在有界方差、有界 α 矩和慢变矩类中还恢复或证明了固定置信度下的尖锐 leading 常数。

Difference of Convex Programming in the Wasserstein Space with Applications to MMD Optimization Figure 1
2026-06-29cs.LG

Difference of Convex Programming in the Wasserstein Space with Applications to MMD Optimization

Clément Bonet, Pierre-Cyril Aubin-Frankowski, Youssef Mroueh

2026-06-29优化算法

本文针对 Wasserstein 空间中许多概率测度目标沿测地线非凸、传统梯度法难分析且不稳定的问题,将欧氏空间的 DC/CCCP 思路提升为 Wasserstein Convex-Concave Procedure。核心在于为 MMD 与 Energy Distance 构造显式 Wasserstein DC 分解,允许更一般的可微凹部,并证明迭代近似驻点及局部收敛。实验显示在 ED 和高斯核 MMD 上较 Wasserstein 梯度下降更快、更稳定,但具体增益仍依赖分解选择与内层优化设置。

A Backstepping Framework for Unconstrained Accelerated Optimization Algorithms Figure 1
2026-06-29math.OC

A Backstepping Framework for Unconstrained Accelerated Optimization Algorithms

Song Chen, Jiaxu Liu, Chao Xu

2026-06-29优化算法

本文针对加速优化算法多为事后稳定性解释、缺少系统化合成方法的问题,把无约束优化写成严格反馈控制系统,并用反步法从虚拟控制递推生成实际更新律。核心洞察是虚拟控制先选定目标流形,第二步反馈不仅稳定外层误差,还对诱导的 Bolza 问题具逆最优性;由此统一推出常参数 Nesterov 流和 PID 加速器,并给出基于约化 HJB 的最优反步原则。

Multidimensional quadratic BSDEs with weak interactions and their applications in mean-field games of controls Figure 1
2026-06-29math.OC

Multidimensional quadratic BSDEs with weak interactions and their applications in mean-field games of controls

Ulrich Horst, Emil Schmidek, Huilin Zhang

Department of Mathematics, and School of Business and Economics, Humboldt University Berlin, Research Center for Mathematics and Interdisciplinary Sciences, Frontiers Science Center for Nonlinear, Expectations (Ministry of Education), Shandong University, Department of Mathematics, Humboldt University Berlin, of the system itself grows with N, the standard estimates available for multidimensional qBSDEs are

2026-06-29规划控制

本文由带价格冲击的多主体效用最大化和不完全市场均衡问题出发,研究现有理论难以覆盖的多维二次BSDE。核心洞察是用弱交互与按维度无关的最大范数小性条件控制全局系统,而非限制整体维度邻域;据此证明解的存在唯一性与Picard稳定性,并给出有限玩家Nash、Radner均衡向均场极限收敛的定量速率。

Policy Gradient Learning for Distributionally Robust Markov Decision Processes under Wasserstein Ambiguity Figure 1
2026-06-29math.OC

Policy Gradient Learning for Distributionally Robust Markov Decision Processes under Wasserstein Ambiguity

Yadh Hafsi, Samy Mekkaoui, Huyên Pham, Kaixin Yan

2026-06-29强化学习优化算法安全鲁棒

针对名义转移模型在部署时可能失配的问题,论文研究有限时域 MDP 的 Wasserstein 分布鲁棒策略优化。核心在于不用直接微分隐式最坏转移核,而通过 Wasserstein 对偶 Bellman 递推与方向可微分析得到鲁棒策略梯度,并据此构造 actor-critic 算法;实验覆盖离散与连续基准,显示在较大不确定半径下仍可训练出更稳健的策略。

Uncertainty-aware Power System Planning via Gradient Descent Figure 1
2026-06-29math.OC

Uncertainty-aware Power System Planning via Gradient Descent

Mehrnoush Ghazanfariharandi, Robert Mieth

Industrial and Systems Engineering, Rutgers University, NJ, USA.

2026-06-29规划控制优化算法安全鲁棒

面对可再生能源预测误差和新型负荷使传统确定性电力扩容规划低估灵活性投资的问题,本文将日前与实时两阶段运行、不完全预测、储能荷电状态和机组爬坡等时序约束纳入规划,并用投影随机梯度下降、隐式微分和原始-对偶更新避免难解的 MPEC。实验表明,该方法相比假设完美可再生出力的经典模型可降低总系统成本,并满足可再生能源接入目标。

On strongly quasiconvex pseudomonotone equilibrium problems in Hadamard spaces Figure 1
2026-06-29math.OC

On strongly quasiconvex pseudomonotone equilibrium problems in Hadamard spaces

Luisa Marie Després, Nicholas Pischke

2026-06-29优化算法

本文面向非线性几何空间中的均衡问题,动机是将欧氏空间里针对伪单调、强拟凸双函数的近端点方法推广到 Hadamard 空间。核心创新在于用较初等且可量化的证明处理两类近端算法,弱化部分既有假设,并给出迭代到唯一解的显式次线性非渐近距离界;同时证明相应解的存在性,推出下半连续强拟凸函数在 Hadamard 空间上存在极小点。

Any-dimensional Positivstellensätze for symmetric functions Figure 1
2026-06-29math.AG

Any-dimensional Positivstellensätze for symmetric functions

Sebastian Debus, Robin Schabert

2026-06-29优化控制

本文针对对称函数在任意维截断下的非负性认证问题:其可行域并非半代数集,经典实代数几何工具不能直接适用。核心洞察是把幂和映射的取值与[-1,1]上离散概率测度的矩联系起来,从而刻画无限对称群轨道空间。主要结果是给出Pólya型和Reznick型任意维Positivstellensatz,证明严格一致正的对称函数经统一的p2幂乘后可获得非负单项对称函数组合或平方和证书。

Tropical Fermat--Weber Problems over Non-Finite Data and their Inverse Formulations Figure 1
2026-06-29math.CO

Tropical Fermat--Weber Problems over Non-Finite Data and their Inverse Formulations

John Sabol, Ruriko Yoshida

2026-06-29优化控制

本文面向热带射影空间中的 Fermat–Weber 位置问题,动机是传统欧氏或有限坐标设定难以处理平移不变、非对称的热带距离。核心创新是将可调不对称的 tropical ℓ1,∞ 伪范数推广到含非有限坐标数据,并从次微分最优性条件出发改造对偶最小费用流模型。主要结果给出有限最优解存在时的计算方法,并为多类逆问题建立可行性刻画和线性规划形式,同时指出其结构通常不具全酉模性。

2026-06-26

24 篇
A Verification Theorem for an Optimal Control Problem Governed by the Convective Brinkman--Forchheimer Equations Figure 1
2026-06-26math.OC

A Verification Theorem for an Optimal Control Problem Governed by the Convective Brinkman--Forchheimer Equations

Sagar Gautam, Manil T. Mohan

2026-06-26规划控制

针对多孔介质流中经典 Navier–Stokes 控制理论难以直接适用的问题,论文研究由二维和三维对流 Brinkman–Forchheimer 方程支配的最优控制。核心在于用强解理论、负阶 Sobolev 估计和更强拓扑下的连续依赖处理非线性吸收项,建立 Pontryagin 极大值原理与 HJB 验证框架。主要结果是给出最优反馈控制的严格刻画,并将验证定理扩展到二维、三维超临界区间及满足条件的临界情形。

Conjecture About Arbitrary Even-Order Convexity of $w$-Optimization of the Split CIF Figure 1
2026-06-26math.OC

Conjecture About Arbitrary Even-Order Convexity of $w$-Optimization of the Split CIF

Hao Li

2026-06-26优化算法

本文针对 Split CIF 数据融合中的 w 优化步骤展开,动机是解释其快速实现背后的凸性结构。核心洞察是将目标函数 ln det P(w) 与 tr P(w) 的二阶、四阶凸性推广为“任意偶数阶凸性”猜想,并给出特殊情形证明与导数展开。主要结果并非完整定理,而是提出一般情形仍待证明,系统数学技术尚未充分建立。

CHAMB-GA: A Containerized HPC Scalable Microservice-Based Framework for Genetic Algorithms Figure 1
2026-06-26cs.DC

CHAMB-GA: A Containerized HPC Scalable Microservice-Based Framework for Genetic Algorithms

Felix Bonhoff, Thiemo Pesch, Andrea Benigni, Alexander Mitsos, Manuel Dahmen

2026-06-26优化控制

针对嵌入长时仿真的遗传算法优化在本地、云与HPC间迁移困难、工具链耦合硬件且难扩展的问题,CHAMB-GA将遗传操作与适应度仿真拆成容器化微服务,并用RabbitMQ异步调度以兼容Kubernetes和SLURM。实验显示其调度开销很小,可近线性扩展到3500多个CPU核,并在德国电网HVDC调度中完成约6000万次AC潮流计算及两阶段GA工作流。

Optimizing Accessibility and Maximum Travel Times in Transit Networks: The Hub Covering Location Problem Figure 1
2026-06-26math.OC

Optimizing Accessibility and Maximum Travel Times in Transit Networks: The Hub Covering Location Problem

Carmen-Ana Domínguez-Bravo, Elena Fernández, Armin Lüer-Villagra

Statistics and Operations Research Department, Universidad de Cádiz, Puerto Real, Spain, Department of Engineering Sciences, Universidad Andres Bello, Talcahuano, Chile, Center for Advanced Transportation, Logistics, and Economic Competitiveness (CATLEC), Chile

2026-06-26优化控制

面向城市通勤拥堵与公共交通接入不足,论文提出 Hub Covering Location Problem,将站点覆盖半径与骨干网络最大通行时间同时纳入选址—网络设计。其核心是用节点级需求覆盖替代传统 OD 对需求,并给出两种 MILP 与两阶段 matheuristic。计算实验显示三指标/树式建模优于四指标路径式建模,启发式可分析成本、覆盖半径和时间上限对网络结构的影响。

Benign Landscape of Quadratic Programs with Orthogonality Constraints and Its Application to Heteroscedastic Probabilistic PCA Figure 1
2026-06-26math.OC

Benign Landscape of Quadratic Programs with Orthogonality Constraints and Its Application to Heteroscedastic Probabilistic PCA

Peng Wang, Po Chen, Rujun Jiang, Laura Balzano

†Department, University, ¶Department of Electrical Engineering and Computer Science, University of Michigan, Ann Arbor, USA

2026-06-26优化算法

论文针对带正交约束二次规划中一阶流形算法常能到达全局解但缺少景观解释的问题,给出临界点闭式刻画,并证明每个临界点非全局最大即为严格鞍点,从而得到全局最优的充要条件。作者进一步把异方差概率 PCA 的总体问题化为该类 QPOC,证明其良性景观和全局解附近测地强凹性,并说明大样本经验问题可高概率继承这些性质,解释重traction 类方法的局部线性收敛现象。

Numerical Approximation for Path-Dependent McKean-Vlasov Control with Non-Asymptotic Error Estimates Figure 1
2026-06-26math.OC

Numerical Approximation for Path-Dependent McKean-Vlasov Control with Non-Asymptotic Error Estimates

Olivier Bokanowski, Jean-Francois Chassagneux, Xinyu Li, Christoph Reisinger

University Paris Cité, Corresponding author.University of Oxford, Erlangen AI Hub

2026-06-26规划控制

针对依赖历史轨迹的 McKean–Vlasov 群体控制难以数值求解且缺少有限误差保证的问题,本文在开环控制下构建 Euler 离散、离散动态规划与粒子近似相结合的框架,并证明开环与历史反馈值等价,可在较小滤波上优化。主要结果给出连续到离散的 O(h^{1/4}) 误差及总体 O(h^{1/4}+M^{-γ}) 界,并以路径特征神经策略梯度在路径依赖 LQ 基准上验证可实现性。

Endogenous Reinsurance Pricing in Large Competitive Insurance Markets: Finite-Player and Mean Field Analysis Figure 1
2026-06-26q-fin.RM

Endogenous Reinsurance Pricing in Large Competitive Insurance Markets: Finite-Player and Mean Field Analysis

Ruimeng Hu, Byungdoo Kong

2026-06-26优化控制

本文针对传统再保险模型常把保费外生给定、难以刻画大规模保险人竞争的问题,建立单一再保险人作为Stackelberg领导者、异质保险人具有相对绩效关切的有限参与者与均场模型。核心洞察是固定保费下保险人的留存决策可化为标量不动点,并呈现从全转分保到部分留存再到全留存的阈值结构。由此作者将再保险人的定价化为一维紧优化,给出均衡刻画、有限市场到均场的收敛结果,并展示相对绩效会放大溢出效应且均衡可能不唯一。

Finding Stationary Points by Comparisons Figure 1
2026-06-26cs.LG

Finding Stationary Points by Comparisons

Helin Wang, Chenyi Zhang, Xiwen Tao, Yexin Zhang, Tongyang Li

School of Electronics Engineering and Computer Science, Peking University, Computer Science Department, Stanford University, Center on Frontiers of Computing Studies, School of Computer Science

2026-06-26优化控制

本文关注只能通过两点偏好比较访问目标函数时,如何在非凸优化中找到一阶驻点,动机来自偏好反馈、RLHF和无导数优化中函数值不可得的场景。核心思路是用比较查询恢复归一化 Hessian 信息,从而利用二阶光滑性而非仅随机搜索;经典算法以 Õ(n²/ε^1.5) 次查询访问到 ε-驻点,并给出量子比较 oracle 下 Õ(n/ε^1.5) 的首个对应结果。

Enabling self-supervised learned primal dual with Noise2Inverse Figure 1
2026-06-26eess.IV

Enabling self-supervised learned primal dual with Noise2Inverse

Antti Sällinen, Siiri Rautio, Santeri Kaupinmäki, Andreas Hauptmann

Research Unit of Mathematical Sciences, University of Oulu, Finland, Department of Mathematics and Information Science, Josai University, Japan, Department of Computer Science, University College London, United Kingdom

2026-06-26优化控制

本文针对低剂量、稀疏角 CT 中缺少高质量真值、监督式 Learned Primal-Dual 难以落地的问题,将 Noise2Inverse 的独立噪声假设嵌入 LPD 展开迭代网络,提出无需真值图像训练的 N2I-LPD。实验与 FBP、TV/PDHG 及同框架 U-Net 对比,显示其在模拟和实验数据上重建质量更好,但具体增益中架构与训练策略各自贡献仍需进一步拆解。

The parental parsimony problem on binary, tree-child phylogenetic networks Figure 1
2026-06-26math.OC

The parental parsimony problem on binary, tree-child phylogenetic networks

Martin Frohn

aDepartment of Advanced Computing Sciences, Maastricht University, Paul Henri Spaaklaan 1, 6229 EN Maastricht, Netherlands., extending a leaf-labelling on a phylogenetic network to determine a most parsimonious tree, but fixed leaf labels and a class of networks on which the PPS remains NP-hard, namely, vRTFnvuXxpjU8lfHmMeJGwY1MYl412dO4PZdmwlAzc6AiWltdlsoGiVDLX3RMVOnSOmqhoV36lCPQrJpRD5xCkjA94hRgq9NJhkUAevSFgMz1VxTjPKI3cEFgeDAR3i7+DUTtEA

2026-06-26优化控制

本文关注系统发育网络中叶标号扩展到最简约嵌入树的 parental parsimony score 问题,该问题在含杂交、多倍化或不完全谱系排序的模型下仍是 NP-hard。核心贡献是在二叉 tree-child 网络上给出首个常数因子近似,并设计结合整数规划松弛、ApproxPPS 上界与分支定界的精确算法。模拟实验显示近似解平均质量优于理论界,精确算法可处理中等规模实例,但大规模网络上运行时间受网状节点数影响明显。

Separation, Constraint Qualifications, and Cycling in Outer Approximation Figure 1
2026-06-26math.OC

Separation, Constraint Qualifications, and Cycling in Outer Approximation

Erik Tamm, Jan Kronqvist

Department of Mathematics, KTH Royal Institute of Technology, Lindstedtsvägen 25, 10044 Stockholm, Sweden

2026-06-26优化算法

本文针对凸混合整数非线性规划中外逼近算法的收敛假设被实践中忽视的问题,分析约束资格失效与NLP子问题近似求解如何导致同一整数解反复出现的循环。核心洞察是把分离失败、Slater条件近似违背和数值精度需求联系起来,并提出检测到循环时用扩展切平面作为回退。主要结果证明该策略在更弱约束资格假设下仍可有限收敛。

Numerical analysis of first-order mean field games under displacement monotonicity Figure 1
2026-06-26math.NA

Numerical analysis of first-order mean field games under displacement monotonicity

Alpár R. Mészáros, Yohance A. P. Osborne

†Department of Mathematical Sciences, Durham University, Stockton Road, DH1 3LE Durham, United Kingdom

2026-06-26优化控制

本文针对一阶平均场博弈中非可分 Hamiltonian、奇异初始分布和长时间区间下缺乏严格数值分析的问题,提出基于特征 Hamilton/Pontryagin 系统的粒子法,结合时间隐式 Euler 与空间采样。核心结果是证明粒子分布在 L∞(W2)、值函数梯度在 L∞(L2) 中收敛,并给出可导出采样收敛率的误差界;在额外 Lipschitz 条件下还得到值函数轨迹近似的 L∞(L1) 渐近误差界,实验覆盖不同维度、时长和初始分布。

Second-order Methods for Multiobjective Composite Optimization: Preconditioning Strategies, Subspace Variants and Inexact Solutions Figure 1
2026-06-26math.OC

Second-order Methods for Multiobjective Composite Optimization: Preconditioning Strategies, Subspace Variants and Inexact Solutions

Jian Chen, Xinmin Yang

2026-06-26优化算法

本文针对多目标复合优化中目标曲率失衡、病态平滑项导致近端梯度慢,而近端牛顿又需昂贵非欧度量近端的问题,提出预条件近端 Barzilai–Borwein 框架:用目标级 BB scaling 缓解不平衡,用公共预条件器吸收共享曲率,并通过二维子空间与共轭基避免复杂近端。文中证明非凸情形全局收敛及误差界下线性收敛,实验显示在病态 ℓ1 正则和线性约束任务上更有效。

On-Demand Service Zone Design for Energy-Constrained Spatial Queueing Systems Figure 1
2026-06-26cs.PF

On-Demand Service Zone Design for Energy-Constrained Spatial Queueing Systems

Peng Lin, Cheng Hua, Wei Qi, Kai Wang

2026-06-26优化控制

面向移动充电车、无人机等电动服务车辆,论文关注电量耗尽与补能会如何改变按需服务的空间排队与分区决策。其核心是把电池状态嵌入 hypercube 排队模型,并用 Branch-Price-and-Evaluation 求解站点选址与服务区联合设计。结果显示,显式建模能减少虚假可服务承诺;低负载适合资源池化,高负载下更紧分区更有利,且收益提升更多来自分区设计而非单纯加大电池。

Sinkhorn-Knopp balancing with generalised martingale-type constraints Figure 1
2026-06-26math.OC

Sinkhorn-Knopp balancing with generalised martingale-type constraints

Abigail Langbridge, Martin Corless, Robert Shorten

Dyson School of Design Engineering, Imperial College London, UK, School of Astronautics and Aeronautics, Purdue University, West Lafayette, Indiana, USA

2026-06-26优化算法

本文面向供需不平衡、边际约束可选择放松且运输计划还受线性/零元素约束的资源分配问题,动机来自网约车公平派单、能源市场等场景。核心创新是把熵正则最优运输推广到广义约束下,并构造可用 Bregman 投影解释的 Sinkhorn 类迭代。主要结果给出收敛性证明,算法可处理硬约束、任意线性约束和异质弹性边际,并在两个应用示例中展示可行性。

Random Walk on Bézier Curves for Global Optimization Figure 1
2026-06-26cs.NE

Random Walk on Bézier Curves for Global Optimization

Jinpeng Wang, Xingguo Xu, Yujing Sun, Jiguang Yu, Kaichen Ouyang, Yuansheng Gao

2026-06-26优化算法

针对元启发式优化中探索与开发难以协调、且常依赖自然隐喻的问题,论文提出 Bézier Walk Evolution,将搜索视为决策空间中的贝塞尔轨迹构造,用距离感知随机游走选择控制点,并随迭代自适应降低曲线阶数以从全局探索转向局部收敛。实验在 CEC2017/2022 的 41 个函数和 5 个工程约束问题上显示,其相对多种经典与 SOTA 优化器具有较好精度、可扩展性和鲁棒性,但个别复杂函数上稳定性仍有限。

Zero-Shot Size Transfer for Neural ODEs on Sparse Random Graphs: Graphon Limits and Adjoint Convergence Figure 1
2026-06-26cs.LG

Zero-Shot Size Transfer for Neural ODEs on Sparse Random Graphs: Graphon Limits and Adjoint Convergence

Mingsong Yan, Zhida Wang, Sui Tang

2026-06-26学习理论

这篇论文针对图神经微分方程在大图上训练代价高的问题,研究“在小图训练、迁移到同类大图”的零样本尺寸迁移是否有理论保证。核心做法是用 graphon 描述稀疏随机图的连续极限,并同时分析前向 GNDE 与伴随梯度系统的收敛。主要结果给出高概率轨迹收敛率约为 O((αn n)^-1/2),证明梯度一致性,并说明 Euler 离散下 DTO 与 OTD 训练渐近一致;实验在多类 graphon 上支持这些速率和迁移现象。

Comparative Analysis of Linear Battery Models for Carbon Emission Optimization in Solar Energy Systems Figure 1
2026-06-26math.OC

Comparative Analysis of Linear Battery Models for Carbon Emission Optimization in Solar Energy Systems

Anna Sacilotto, Ambrogio Maria Bernardelli, Stefano Gualandi

Department of Mathematics “F. Casorati”, University of Pavia, via Ferrata 5, 27100 Pavia, Italy

2026-06-26优化算法

面向住宅光伏-电池系统在负荷、发电和电网碳强度不确定下的低碳调度,论文比较从自消费规则到随机规划、线性反馈的多类线性电池模型。核心洞察是直接优化期望碳排的 Programmed Battery 已接近全知基准,显著优于启发式控制;更复杂反馈只带来训练集小幅增益,泛化不更好且计算成本更高。

Three-Objective Integral R2 Subset Selection: NP-Hardness and Submodular Approximation Figure 1
2026-06-26math.OC

Three-Objective Integral R2 Subset Selection: NP-Hardness and Submodular Approximation

Michael T. M. Emmerich

2026-06-26优化控制

本文关注多目标优化中从较大的 Pareto 前沿近似中选取固定数量代表点的问题,三目标连续积分 R2 指标下精确选择是否可行此前不清。核心洞察是将 Tchebycheff 下包络改进视为影子体积并建立子模性,同时用透视变换连接加权锚定盒并证明 NP-hard。结果表明三目标区别于二维:精确固定基数选择已困难,但固定理想点下贪心可获得 1−1/e 的 R2 间隙缩减保证,并给出 O(n6) 精确积分评估实现。

Maximizing Throughput in an M/G/1 Queue with Customer Abandonments Figure 1
2026-06-26math.OC

Maximizing Throughput in an M/G/1 Queue with Customer Abandonments

Runhua Wu, Hayriye Ayhan, Douglas G. Down

H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Department of Computing and Software, McMaster University

2026-06-26优化控制

本文针对含顾客放弃的单服务器排队中,服务顺序会直接影响长期吞吐率这一控制问题,研究在泊松到达、指数耐心时间下如何精确选派服务器。核心洞察是将不可均匀化的无限状态 CTMDP 直接在连续时间中分析,通过偏差函数一、二阶差分的 Poisson 方程证明最优性。主要结果表明,当服务时间为可观测阶段的 Erlang 或超指数分布时,SREPT 策略最大化长期平均吞吐率,且最优性与放弃率无关。

Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Data Figure 1
2026-06-26math.OC

Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Data

Erhan Bayraktar, Martin Hernandez, Qinxin Yan, Yuhua Zhu

2026-06-26强化学习

本文针对连续时间均场控制中“系统连续演化、数据却离散观测”的错配,指出直接离散化为 MDP 会丢失 HJB/PDE 结构并引入离散化偏差。核心做法是提出 MF-PhiBE,用一步转移数据估计未知 McKean–Vlasov 生成元中的漂移与协方差,同时保留 Wasserstein 空间上的连续时间 Bellman 结构,并结合熵正则策略梯度形成模型无关 actor-critic。理论上给出一阶一致性误差,LQR 情形达到二阶精度,实验覆盖 LQR 与群体避让任务。

Minkowski-Type Wasserstein Metrics and Barycenters for Location-Scale Mixtures with Application to Domain Adaptation Figure 1
2026-06-26math.OC

Minkowski-Type Wasserstein Metrics and Barycenters for Location-Scale Mixtures with Application to Domain Adaptation

Songyan Luo, Yunxin Zhang

2026-06-26优化控制

这篇论文针对经验最优传输在样本级匹配中计算与存储随样本数二次增长的问题,提出在可识别有限位置-尺度混合模型上定义基于广义 Minkowski 不等式的 Wasserstein 型度量与重心。核心洞察是将连续两边及多边 OT 在特定混合耦合约束下化为组件级离散传输,并给出仿射最优映射成本的刻画与若干闭式公式。VisDA-C 实验显示,在高斯混合实例化下可保持接近经验 OT 的迁移精度,同时显著降低时间和内存开销。

Input Convex Neural Network as a Surrogate in Stability-Constrained Optimization for IBR-dominated Power Systems Figure 1
2026-06-26math.OC

Input Convex Neural Network as a Surrogate in Stability-Constrained Optimization for IBR-dominated Power Systems

Wangkun Xu, Hongyang Jia, Yi Wang, Ning Zhang, Fei Teng

W. Xu and F. Teng are with the Department of EEE, Imperial College London, London, UK., H. Jia and N. Zhang are with the Department of EE, Tsinghua University, Beijing, China., Yi Wang is with the School of Electrical Engineering and Automation, Wuhan University, Wuhan, China., Supplementary material including proofs, algorithms, and codes are available at https://github.com/xuwkk/icnn_constraint_learning.

2026-06-26优化算法

针对高比例逆变器电源系统中动态稳定约束难以实时嵌入调度优化的问题,论文指出ICNN作为稳定性代理时应保持凸子水平集形式,避免不必要的Big-M二进制变量和反向不等式带来的非凸性;进一步给出ReLU-ICNN的精确LP表述、外近似与内近似算法。IEEE 14/118节点机组组合实验显示,LP子水平集表述在消除稳定违规的同时显著少于MILP耗时,而超水平集方案在大系统上精度和可行性较不稳定。

Higher-Order vs. Quadratic Binary Optimization: Which Is Better for Probability Optimization with Tensor Sampling? Figure 1
2026-06-26math.OC

Higher-Order vs. Quadratic Binary Optimization: Which Is Better for Probability Optimization with Tensor Sampling?

Hadi Salloum (1, 2, 3), Kirill Novoselov (1), Aleksandr Pochtarev (1), Yaroslav Kholodov (1, 2) ((1) Research Center of the Artificial Intelligence Institute, Innopolis, University, Russia, (2) Moscow Institute of Physics and Technology, Moscow, (3) Q Deep, Russia)

2026-06-26优化算法

本文关注张量采样做概率型二进制优化时,究竟应保留高阶 HUBO 结构还是降为 QUBO。核心洞察是:QUBO 形式更简单且求解器成熟,但高阶项降阶会引入辅助变量,放大张量采样看到的有效维度;因此在原问题含多体交互时,原生 HUBO 往往更省维度、更利于采样。实验覆盖合成多项式、RSA 分解和 Max-Cut,结果显示 HUBO 在高阶结构明显时更优,而天然二次问题中 QUBO 仍具竞争力。

2026-06-25

30 篇
Toward a Systematic Understanding and Interactive Search of Lyapunov-Style Proofs in Optimization Figure 1
2026-06-25math.OC

Toward a Systematic Understanding and Interactive Search of Lyapunov-Style Proofs in Optimization

TaeHo Yoon, Jaewook J. Suh, Edward Duc Hien Nguyen, Bicheng Ying, Shiqian Ma

2026-06-25优化算法

针对优化算法中 Lyapunov 收敛证明长期依赖人工模板、难以判断是否达到紧界的问题,本文把 PEP/SDP 得到的紧解析证明系统地转换为等价的 Lyapunov 风格证明,关键在于用线性代数识别 PEP 证书中的增量层结构。该框架在一个 Jupyter 流程中复现多类已有分析,并给出四个新的 Lyapunov 证明,其中包括强单调包含问题的精确最优 Dual-OC-Halpern 算法。

Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization Figure 1
2026-06-25cs.LG

Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization

Kamar Hibatallah Baghdadi, Kawther Guoual Belhamidi, Sara Belhadj, Aissa Boulmerka, Nadir Farhi

National School of Artificial Intelligence (ENSIA), Sidi Abdellah Campus, Algiers, Algeria

2026-06-25强化学习

面向ViT和CNN在边缘部署中参数、存储和延迟受限的问题,HiReLC把剪枝与混合精度量化建模为分层强化学习:高层用Fisher敏感度和集成投票分配全局预算,低层按块选择位宽、保留率、量化类型与粒度,并用代理模型降低评估成本。实验报告5.99–6.72倍参数存储压缩,除一个设置精度提升3.83%外,其余下降0.55–5.62%。

Variable Bound Tightening for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games Figure 1
2026-06-25cs.GT

Variable Bound Tightening for Nash Equilibrium Computation in Multiplayer Imperfect-Information Games

Sam Ganzfried

Ganzfried Research, Cornell University

2026-06-25学习理论

本文针对多人不完美信息博弈中精确求纳什均衡难以扩展的问题,指出既有基于序列式 NLCP 与 Gurobi 非凸二次求解的方法受松弛变量和乘子变量无界影响,空间分支定界松弛较弱。核心贡献是用最佳响应线性规划的强对偶性推导这些变量的有限界,从而收紧 McCormick 松弛。实验显示,在完整三人 Kuhn 扑克上,仅加入松弛变量界即可将原先 24 小时未解的问题降至约 1.16 秒求解,乘子界也有帮助但组合后反而略慢。

Dominance-Based Feasibility Inference for Packing-Constrained Pickup and Delivery Problems Figure 1
2026-06-25math.OC

Dominance-Based Feasibility Inference for Packing-Constrained Pickup and Delivery Problems

Siqiao Li, Mahnam Saeednia, Patrick Stokkink

Department of Transport and Planning, Faculty of Civil Engineering and Geosciences, Delft University of Technology, Delft, Netherlands, Department of Engineering Systems and Services, Faculty of Technology, Policy and Management, Delft University of Technology, Delft, Netherlands

2026-06-25优化控制

本文针对带二维装载约束的取送货问题中,路线搜索需反复验证装载可行性且代价高的问题,提出基于支配关系的可行性推断框架。核心在于用保序映射同时刻画几何包含与取送顺序兼容性,从已验证装载状态推断新状态可行性,并通过候选搜索与状态存取策略降低筛查开销。实验显示相较无支配基线,可行性检查时间最高减少42%,主要来自减少精确装箱过程调用。

A $\operatorname{prox}$-Based Semi-Smooth Newton Method for Convex Variational Problems Figure 1
2026-06-25math.OC

A $\operatorname{prox}$-Based Semi-Smooth Newton Method for Convex Variational Problems

Sören Bartels, Alex Kaltenbach

Department of Applied Mathematics, University of Freiburg, Hermann–Herder-Str. 10, D-79104 Freiburg, Department of Mathematical Sciences and the Center for Mathematics and Artificial Intelligence (CMAI), George Mason University, Fairfax, VA 22030, USA., Institute of Mathematics, Technical University of Berlin, Straße des 17. Juni 136, D-10623 Berlin

2026-06-25优化算法

本文针对有限元离散后的非光滑凸变分问题中最优性条件难以直接用牛顿法求解的障碍,提出以 proximity operator 重写原始-对偶条件的半光滑 Newton 框架。核心洞察是把 Fenchel 对偶下的包含关系转化为具 Newton 可微结构的非线性方程,从而统一覆盖 TV、p-Dirichlet、障碍和弹塑性扭转等模型。文中证明了离散算法的全局适定性与局部超线性收敛,并说明其在障碍类问题上退化为已有方法且保持原始-对偶不变性。

A Methodology for Integrating Life Cycle Assessment into a Multidisciplinary Design Analysis and Optimization Framework for Sustainable Launcher Development Figure 1
2026-06-25math.OC

A Methodology for Integrating Life Cycle Assessment into a Multidisciplinary Design Analysis and Optimization Framework for Sustainable Launcher Development

Alice De Oliveira, Mathieu Balesdent, Loïc Brevault, Annafederica Urbano

2026-06-25优化算法

面对发射频次上升与早期方案难以量化环境代价的问题,本文把生命周期评价作为可参数化学科嵌入运载火箭 MDAO,覆盖部件/推进剂生产、运输与轨迹相关排放。代表性一次性两级火箭的多目标优化显示,性能指标与不同环境影响类别存在权衡且类别间可能相互冲突,说明生态设计需明确目标而非只优化单一气候指标。

Generating Input Distributions for Explaining Portfolio Optimization Pipelines Figure 1
2026-06-25math.OC

Generating Input Distributions for Explaining Portfolio Optimization Pipelines

Batuhan Ataş, Nurşen Aydın, E. Mehmet Kıral, Ş. İlker Birbil

University of Amsterdam, The Netherlands, Warwick Business School, University of Warwick, United Kingdom

2026-06-25优化算法

针对组合优化中PTO、PAO等预测—优化流水线只看平均收益却难解释“何时失效或反转”的问题,本文提出predict-optimize-explain框架,把解释转化为生成宏观输入分布的变分探测任务,并用数据先验约束场景合理性。理论上给出解释分布的唯一性、稳定性和贝叶斯解释;实证在资产定价面板上比较不同训练流水线,显示该方法能定位导致收益差距反转、分散化或达到基准收益的市场状态,并映射到经济 regime 与历史月份。

Convergence analysis of the Riemannian proximal gradient method with inexact oracle Figure 1
2026-06-25math.OC

Convergence analysis of the Riemannian proximal gradient method with inexact oracle

Chao Huang, Xiyuan Xie, Anna Qi, Lihua Yang, Qian Zhang

School of Mathematical Sciences, Shenzhen University, Shenzhen 518060, China, School of Mathematics, Sun Yat-sen University, Guangzhou 510275, China, School of Mathematics and Systems Science, Guangdong Polytechnic, Normal University, Guangzhou 510665, China

2026-06-25优化算法学习理论

针对流形约束下复合非光滑非凸优化常依赖精确梯度、而实际只能获得近似梯度的问题,本文把欧氏空间的一阶不精确 oracle 推广到黎曼优化,并构造 RPG-IO 分析框架。核心结果是证明搜索方向趋零、聚点平稳及函数值收敛;在黎曼 KL 条件下进一步给出整序列收敛和显式速率,强 oracle 下还得到目标值到最优值的收敛率。

Bridging Spherical Black-Box Optimizers Figure 1
2026-06-25cs.LG

Bridging Spherical Black-Box Optimizers

Johannes Ackermann, Stefano Peluchetti

When gradient information is unavailable, black-, gradients may be unavailable or not useful for training (Metz, JA did his work while interning at Sakana AI. 1The University

2026-06-25优化控制

本文针对无梯度场景中 ES、OVI、CBO 等黑盒优化器各自独立、适用边界不清的问题,提出统一的主更新框架,指出差异主要来自适应度聚合方式与共识作用范围,并据此构造 ES-OVI、CBO-OVI 混合方法。实验覆盖标准 BBO、连续控制/机器人运动任务和受限预算模型合并,显示混合优化器可在收敛、鲁棒性或多模态搜索上超过组成算法,但超参数敏感性仍需注意。

Gradient-based inverse lithography for EUV masks via the waveguide method and a physics-informed neural operator Figure 1
2026-06-25cs.LG

Gradient-based inverse lithography for EUV masks via the waveguide method and a physics-informed neural operator

Vasiliy A. Es'kin, Egor V. Ivanov

Department of Radiophysics, University of Nizhny Novgorod

2026-06-25优化算法

这篇论文面向 EUV 反射掩模中三维衍射导致的图形失真与传统 ILT 全波仿真昂贵问题,提出把可微波导法和物理约束的 WGNO 作为端到端前向引擎,直接通过自动微分优化吸收层介电常数,并比较像素密度与傅里叶投影参数化。数值实验在 11.2 nm、TaBN/La/U 等 2D 与 3D 掩模上显示,可恢复接近目标晶圆场的二值化结构;但加速与精度增益相对严格求解的来源和泛化边界仍需更多说明。

Pontryagin-Based Solver with Smoothed Hamiltonian, Adaptive $Δt$, and PA-Bundle Refinement Figure 1
2026-06-25math.OC

Pontryagin-Based Solver with Smoothed Hamiltonian, Adaptive $Δt$, and PA-Bundle Refinement

Salim Ksous, Sebastian Lalvay Segovia, Mattias Sandberg, Erik von Schwerin, Anders Szepessy, Raúl Tempone

(CEMSE) Division, King Abdullah University of Science and, Department of, Mathematics, KTH Royal Institute of Technology, Stockholm

2026-06-25优化算法

针对带切换/非光滑控制的连续时间最优控制中,传统PMP射击法依赖可微哈密顿量、牛顿求解不稳的问题,论文提出用凹分片仿射束近似并经log-sum-exp平滑哈密顿量,结合辛Euler离散、全空间阻尼Newton和同时调节时间步、束规模、平滑参数的自适应外循环。实验在四个无状态约束基准上展示了时间细化、束增强和平滑延续的作用,但目标主要是初值价值函数近似,轨迹和控制未给出独立认证误差。

Equilibrium and Infeasibility: A new solution concept for games Figure 1
2026-06-25cs.GT

Equilibrium and Infeasibility: A new solution concept for games

Anne Reulke (LIA), Mikaël Touati, Rachid El-Azouzi (FR 3621, LIA)

Laboratoire, set of players is described by the set N and the set of strategies available to each player i ∈N by

2026-06-25优化控制

本文针对广义非合作博弈中个体约束可能为空、无共同可行策略或不存在广义纳什均衡的情形,提出以惩罚函数松弛个体约束的 ψ-penalized solution:将解定义为惩罚参数趋于无穷时一列惩罚博弈 GNE 的聚点。主要结果证明在紧凸策略集、连续凹效用和凸惩罚等条件下该解存在,并给出其与 GNE、纳什 bargaining 解的兼容性及 Divide-the-Dollar 示例。

Robust Multi-step Model Predictive Control with Feasibility Guarantees Figure 1
2026-06-25math.OC

Robust Multi-step Model Predictive Control with Feasibility Guarantees

Sebastian Steffen, Mark Cannon

2026-06-25规划控制安全鲁棒

针对多步预测器用于非线性鲁棒MPC时,不同时间生成的预测管可能不一致、从而破坏递归可行性的难题,本文提出先验可行性检查与“预测器替换”机制:在当前优化可能失效时,用历史已验证可达集构造保底轨迹,并结合可变终端视界维持约束与稳定性。结果给出递归可行和稳定性保证,并用简单数值例子展示方法可恢复标准滚动优化,而非依赖多速率控制;实际性能增益仍主要限于示例层面。

Proximity operator characterization for abstract convex functions Figure 1
2026-06-25math.OC

Proximity operator characterization for abstract convex functions

Ewa Bednarczuk, The Hung Tran

Warsaw University of Technology, 00-662 Warsaw, Koszykowa 75, PolandSystems Research Institute, PAS, 01-447 Warsaw, Newelska 6, Poland

2026-06-25优化算法

本文针对经典近端算子主要依赖凸函数与二次惩罚的限制,研究其在抽象凸性框架下的刻画。核心洞察是把近端算子视为某类子梯度的选择器,并用极小化问题给出等价条件,从而覆盖非凸但满足抽象凸、弱凸或抛物凸结构的函数。主要结果包括抽象凸近端算子的表征、对二次函数类近端算子的特例化,以及连续性与相关函数可微性之间的联系。

Convergence of the Safeguarded Augmented Lagrangian Method under the Polyak-Lojasiewicz constraint qualification for Constrained Composite Optimization Figure 1
2026-06-25math.OC

Convergence of the Safeguarded Augmented Lagrangian Method under the Polyak-Lojasiewicz constraint qualification for Constrained Composite Optimization

Christian Kanzow, Jannis Krüger

2026-06-25优化算法学习理论安全鲁棒

本文面向含光滑项与非光滑正则项的约束复合优化,研究增广拉格朗日法在较弱约束资格下的可收敛性。核心洞察是将SALM的全局收敛推广到PŁCQ/误差界条件,并证明局部Lipschitz正则对乘子有界性不可或缺;反例和稀疏投资组合实验表明,非Lipschitz正则常导致乘子失控,而Lipschitz情形表现更稳定。

Dependency-Aware Dominant Resource Fairness for Multi-Tenant Multi-Resource Systems Figure 1
2026-06-25cs.NI

Dependency-Aware Dominant Resource Fairness for Multi-Tenant Multi-Resource Systems

Braik Zeidan (Cnam, CEDRIC - ROC), Francesca Fossati (CEDRIC), Sahar Hoteit (L2S, IUF), Stefano Secci (CEDRIC - ROC)

multi-tenant systems in which demand exceeds available capacity, agement in datacenters, cloud and radio networks [2]. More, demand for resource j. The available capacities are given by, + , where cj ∈C represents the total available

2026-06-25优化控制

本文针对多租户多资源系统中资源存在非线性依赖时,传统 DRF 按固定比例分配会造成未使用资源和公平性偏差的问题,提出依赖感知的 DDRF:用租户级依赖组和活跃主导份额均衡来处理拥塞瓶颈,并保证至少一个拥塞资源饱和。基于 EC2 traces 与 vRAN 场景,DDRF 相比忽略依赖的基线最高提升有效满意度 80%、减少浪费 60%,相对功利策略 Jain 公平性提升超 15%。

Generalized convexity of spectral functions on Euclidean Jordan algebras Figure 1
2026-06-25math.OC

Generalized convexity of spectral functions on Euclidean Jordan algebras

Juyoung Jeong

Department of Mathematics, Soongsil University

2026-06-25优化算法

针对对称锥优化中常见的非凸但具广义凸性的谱函数,论文研究其性质能否通过特征值映射在欧氏 Jordan 代数与底层对称函数之间无损传递。核心创新是把既有凸性传递原则扩展到拟凸、严格/半严格拟凸、伪凸及强拟凸等情形,并证明这些性质在谱函数与对应对称函数之间双向等价,从而为半定规划等谱优化问题提供统一的广义凸性判别框架。

Equilibrium singular dividend control under ambiguity aggregation of heterogeneous discount rates Figure 1
2026-06-25math.OC

Equilibrium singular dividend control under ambiguity aggregation of heterogeneous discount rates

Yue Cao, Guohui Guan, Zongxia Liang, Xiaodong Luo

2026-06-25规划控制

本文针对股东折现率异质导致的分红决策时间不一致问题,将歧义聚合函数引入奇异分红控制,允许一次性分红并刻画时间齐次均衡分红律。核心结果是给出验证定理和均衡必要条件,证明幂型、对数型聚合下某类障碍均衡不存在,而在线性与指数聚合下存在唯一障碍均衡;数值结果显示,耐心股东比例提高会抬高分红障碍,歧义厌恶增强则降低障碍。

Formalization of Line Search Methods by Lean Figure 1
2026-06-25math.OC

Formalization of Line Search Methods by Lean

Yiyang Zhang, Kenneth W. Shum

School of Data Science, The Chinese University of Hong Kong, Shenzhen, School of Science and Engineering

2026-06-25优化控制

本文面向非线性优化中线搜索理论难以机器核验的问题,将梯度下降、下降方向、回溯步长以及 Armijo、Goldstein、Wolfe 和非单调线搜索条件形式化到 Lean 4。核心贡献是把欧氏范数、Lipschitz 梯度等关键假设从公理化改为可复用定义与显式假设,并机器证明 Zoutendijk 定理,为后续验证更复杂优化算法提供基础。

Learning Optimization Proxies for Sequential Contextual Stochastic Programs: An Order Fulfillment Application Figure 1
2026-06-25math.OC

Learning Optimization Proxies for Sequential Contextual Stochastic Programs: An Order Fulfillment Application

Tinghan Ye, Shuaicheng Tong, Changkun Guan, Beste Basciftci, Pascal Van Hentenryck

H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, GA 30332, Tippie College of Business, University of Iowa

2026-06-25优化算法

论文针对在线订单履约中情境随机规划求解太慢、难以满足峰值期亚秒级决策的问题,提出用场景嵌入的层级神经网络近似优化器,并用可行性解码器保证库存与配送约束。其关键思路是离线学习 C-SAA 求解器标签,同时加入约束惩罚和成本对齐,使部署时以一次前向传播替代逐单求解。在基于京东交易数据的仿真中,该方法较在线 C-SAA 延迟降低约 2800 倍,履约成本还低 3.3%,相对常用策略成本至少降 10.7%,迟送率约减半。

Primal-Dual Halpern-PAGE Algorithm for Constrained Stochastic Weakly Convex Optimization Figure 1
2026-06-25math.OC

Primal-Dual Halpern-PAGE Algorithm for Constrained Stochastic Weakly Convex Optimization

Lixin Tang, Xingyu Wang, Liwei Zhang

†National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Northeastern University, Key Laboratory of Data Analytics and Optimization for Smart Industry (Northeastern, ‡National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Northeastern University, Key Laboratory of Data Analytics and Optimization for Smart Industry (Northeastern Univer-, §National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Northeastern University

2026-06-25优化算法

这篇论文针对带等式与不等式期望约束的随机弱凸优化中,传统罚函数/增广拉格朗日方法依赖多重循环、调参复杂且样本复杂度难达最优的问题,提出单循环的原始-对偶 Halpern-PAGE 算法。核心在于用 Halpern 锚定稳定弱单调 KKT 轨迹,并用 PAGE 方差缩减降低随机噪声;理论上证明达到 O(ε^-3) 样本复杂度,并在多面体域与 MFCQ 条件下给出无截断 KKT 残差保证。

Deterministic Non-Smooth Safety via Dual-Algebraic Control Barrier Functions Figure 1
2026-06-25math.OC

Deterministic Non-Smooth Safety via Dual-Algebraic Control Barrier Functions

Mohammadreza Kamaldar

2026-06-25规划控制安全鲁棒

针对交叉安全约束用逐点最小值组合时产生的非光滑边界,传统 CBF 难以给出确定性 Lie 导数且实时性受限。论文用双数代数在一次前向计算中同时得到复合屏障值和方向导数,并由浮点最小值确定选择 Clarke 子梯度顶点;进一步证明 δ-活跃约束同步施加可保证前向不变性,且开销为与维度和约束数无关的固定常数因子。

Structured Spectral Step-Sizes and a Hanoi Ordering Principle for Gradient Methods Figure 1
2026-06-25math.OC

Structured Spectral Step-Sizes and a Hanoi Ordering Principle for Gradient Methods

Yijia Zhou, Ran Gu

2026-06-25优化算法

这篇论文关注梯度法中谱步长“如何构造、如何排序”缺乏统一解释的问题。作者把 Huang 类、窄 Huang 类与 Gu–Du 类等步长规则纳入同一结构框架,并提出“河内排序原则”:在执行低频方向步长前递归压制高频分量,以避免反弹放大。基于该洞察,文中设计自适应 Hanoi-like 梯度法,证明其在严格凸二次问题上全局 R 线性收敛,并在病态测试问题上优于多种谱梯度法和 L-BFGS。

Reward-Conditioned Attention: How Reward Design Shapes What Autonomous Driving Agents See Figure 1
2026-06-25cs.LG

Reward-Conditioned Attention: How Reward Design Shapes What Autonomous Driving Agents See

Mohamed Benabdelouahad, Ahmed Djalal Hacini, Nadir Farhi, Aissa Boulmerka

National School of Artificial Intelligence (ENSIA), Sidi Abdellah Campus, Algiers, Algeria.

2026-06-25强化学习

本文关注自动驾驶强化学习中“奖励函数是否会改变智能体看什么”,而非把注意力直接当解释。作者在相同架构与数据下比较三种 Perceiver/SAC 奖励配置,并提出按单场景计算注意力—风险相关、再用 Fisher z 聚合,避免跨场景池化低估关系。结果显示,导航奖励显著提高 GPS 路径注意力,TTC 连续惩罚形成更高的动态目标警戒基线,且部分场景中不同奖励会反转注意力—风险相关方向。

Sums of squares in polynomial time Figure 1
2026-06-25math.OC

Sums of squares in polynomial time

Nikolas Gärtner, Victor Magron, Frank Vallentin

N. Gärtner, Department Mathematik/Informatik, Abteilung, F. Vallentin, Department Mathematik/Informatik, Abteilung

2026-06-25优化控制

这篇论文关注多元多项式能否表示为平方和的判定在图灵位复杂度下是否可有效求解,动机是传统 Gram 矩阵/半正定规划表述虽实用但一般 SDP 的多项式时间性仍未明。核心洞察是将平方和锥的弱成员问题转化到椭球法可处理的凸优化框架,并结合球谐、矩矩阵、Loewner–John 椭球等可多项式计算的结构。主要结果证明平方和锥弱成员问题属于 P,并给出可在多项式时间内计算归一化多项式的 ε-松弛最近平方和近似的算法。

Minimization of a One Class of Maximum Functions with Applications to Some Eigenvalue Problems Figure 1
2026-06-25math.OC

Minimization of a One Class of Maximum Functions with Applications to Some Eigenvalue Problems

İpek Cafer Ismayilov, Taner Büyükköroğlu, Vakif Dzhafarov

Department of Mathematics, Faculty of Science

2026-06-25优化控制

本文针对一类可写成仿射函数族逐点最大值的凸非光滑优化问题,动机是为特征值最小化、对称稳定化和 Riccati 矩阵不等式等控制相关问题提供可计算方法。核心思路是在盒/多面体约束下逐步加入当前最大化仿射项,将每步化为线性规划,并证明由这些 LP 解生成的序列收敛到最优值;主要结果是给出极限点最优性与最小化序列收敛定理,计算量随迭代步数线性增长。

A Zeroth-Order Deep Learning Method for Fully Nonlinear Parabolic Partial Differential Equations with Unknown Coefficients Figure 1
2026-06-25cs.LG

A Zeroth-Order Deep Learning Method for Fully Nonlinear Parabolic Partial Differential Equations with Unknown Coefficients

Yanwei Jia, Du Ouyang, Huyên Pham, Xun Yu Zhou

\addr Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, \addr Department of Mathematical Sciences, Tsinghua University, \addr Department of Industrial Engineering and Operations Research &, The Data Science Institute, Columbia University

2026-06-25优化控制

针对高维、系数未知的全非线性抛物型 PDE 在连续时间强化学习等场景中难以模型化且导数难稳定获取的问题,本文用弱/强模拟器生成轨迹,并以零阶扰动 Monte Carlo 估计先表示梯度与 Hessian、再训练网络,避免依赖自动微分和显式动力学。理论上给出含离散化、近似、统计与零阶偏差的非渐近误差分解及 Sobolev 样本复杂度,实验显示在中高维问题上具竞争性。

Solving Markov Decision Processes with Future Information via MPC Figure 1
2026-06-25eess.SY

Solving Markov Decision Processes with Future Information via MPC

Shambhuraj Sawant, Akhil S Anand, Dirk Reinhardt, Sebastien Gros

2026-06-25规划控制

本文针对传统 MPC-RL 多假设决策只依赖当前物理状态、难以处理预测价格、参考轨迹等未来信息的问题,提出将未来信息显式并入 MDP 增广状态,并给出参数化 MPC 精确表示最优价值函数与策略的结构条件。作者进一步把该 MPC 作为强化学习中的结构化函数近似器,用 PPO 学习参数,并在含未来参考的点质量赛车任务中展示可行性;但实验规模较小,性能增益的普适性仍需更多验证。

A Single Stepsize Suffices for Unprojected Linear TD(0): Simultaneous Robust and Fast Rates via Polyak--Ruppert Averaging Figure 1
2026-06-25cs.LG

A Single Stepsize Suffices for Unprojected Linear TD(0): Simultaneous Robust and Fast Rates via Polyak--Ruppert Averaging

Wei-Cheng Lee, Francesco Orabona

King Abdullah University of Science and Technology (KAUST)

2026-06-25安全鲁棒

本文关注线性 TD(0) 在单条马尔可夫轨迹采样下的有限时间高概率稳定性问题,动机是现有方法常需投影或依赖未知曲率参数。核心洞察是用泊松方程分解马尔可夫噪声,并通过自约束归纳证明无投影迭代仍能一致有界。结果表明,单一步长配合 Polyak–Ruppert 平均即可同时获得曲率无关的鲁棒收敛率和曲率有利时的快速收敛率。

TurboMPC: Fast, Scalable, and Differentiable Model Predictive Control on the GPU Figure 1
2026-06-25cs.RO

TurboMPC: Fast, Scalable, and Differentiable Model Predictive Control on the GPU

Gabriel Bravo-Palacios, Jianghan Zhang, Zachary Pestrikov, Brian Plancher, Thomas Lew

2026-06-25规划控制

TurboMPC针对传统MPC难以融入GPU批量仿真、学习与可微优化流水线的问题,提出全GPU可微求解器,将SQP、ADMM、隐式微分与JAX-CUDA后端协同设计,支持隐式积分、状态/控制不等式、跨时刻代价和松弛变量。实验覆盖约束规划、类人模仿学习、带神经网络代价的强化学习及实车最短时间赛车,相比CPU和GPU可微基线最高加速15倍和58倍,并能在实车上用贝叶斯优化批量调参、维持超过8000节点长时域控制。

2026-06-24

29 篇
New Bounds for the Last Iterate of the Stochastic subGradient Method Figure 1
2026-06-24math.OC

New Bounds for the Last Iterate of the Stochastic subGradient Method

Guglielmo Beretta, Tommaso Cesari, Roberto Colomboni, Andrea Paudice

Department of Computer Science, Aarhus University, Aarhus, Denmark, School of Electrical Engineering and Computer Science, University of Ottawa, Ottawa, Canada, School of Mathematics, University of Bristol, Bristol, United Kingdom

2026-06-24优化算法学习理论

本文关注随机次梯度法在实践中常返回的“最后一次迭代”为何理论上弱于平均迭代。核心洞察是把一维凸 Lipschitz 目标下的噪声结构区分开:若加性噪声独立同分布且与状态无关,固定步长 η=Θ(1/√n) 的最后迭代可达最优 O(1/√n);但仅有有界方差时,作者构造一维反例证明误差仍可达 O(log n/√n),否定了固定维度下可普遍去掉对数因子的猜想。

A new perspective in linear Cauchy Elasticity: variational minimum principles for statics, dynamics, and heterogeneous materials Figure 1
2026-06-24math.AP

A new perspective in linear Cauchy Elasticity: variational minimum principles for statics, dynamics, and heterogeneous materials

Amit Acharya

2026-06-24优化控制

本文针对线性 Cauchy 弹性中传统变分原理难以处理初值、因果性以及无储能函数材料的问题,提出将位移、速度、应变等原变量变换到对偶场上的凸最小化框架。核心洞察是即使原弹动力学为双曲型,也可得到退化椭圆的 Euler-Lagrange 系统,并据此讨论动静态唯一性及异质、非定弹性模量材料中的适用含义。

A Concentration Inequality for the Covariance Matrix of an Arbitrary Subset of Random Vectors Figure 1
2026-06-24math.ST

A Concentration Inequality for the Covariance Matrix of an Arbitrary Subset of Random Vectors

Huikang Liu, Peng Wang, Laura Balzano

Shanghai Jiao Tong University, Shanghai, University of Macau, Macao, University of Michigan, Ann Arbor

2026-06-24优化控制

本文针对样本协方差在数据依赖选样下不再满足经典独立性假设的问题,建立任意子集随机向量协方差矩阵的谱集中界。核心洞察是直接控制被选择子集的最小/最大特征值,而非依赖粗糙并集界;结果给出高概率上下界及紧性说明,并扩展到次高斯和强混合情形,进一步用于低秩高斯混合下 K-子空间聚类,证明全局最优解的聚类误差随信噪比多项式下降。

Observer design for Lur'e systems via injection of a reconstructed nonlinear output Figure 1
2026-06-24math.OC

Observer design for Lur'e systems via injection of a reconstructed nonlinear output

Adel Malik Annabi

2026-06-24优化控制

本文针对 Lur’e 非线性系统中传统 LMI 观测器在强耦合时增益爆炸或不可行的问题,提出先用二阶滑模观测器从输出重构非线性输出,再作为第二校正通道注入 Luenberger 观测器。新 LMI 包含经典条件并削弱误差动力学中的有效耦合,在 Wilson–Cowan 网络等算例中以较低增益保持可行并降低噪声下误差,但需承担滑模重构带来的噪声敏感性。

Reachability and optimal-time certificates for quantum control Figure 1
2026-06-24quant-ph

Reachability and optimal-time certificates for quantum control

Younes Naceur, Llorenç Balada Gaggioli

LAAS-CNRS - Laboratoire d’Analyse et d’Architecture des Systèmes, Centre National de la Recherche Scientifique, Toulouse, France, Czech Technical University in Prague, Prague, Czech Republic

2026-06-24规划控制

本文针对受硬件幅度、变化率等约束下,量子最优控制只能给候选脉冲、难以证明“到不了”或“至少要多久”的问题,提出基于微分矩层级和半定松弛的可达性/最优时间证书。方法给出固定时域内终端保真度上界、达到目标保真度的时间下界,并用结构化降维提升可计算性;在纠缠态制备、单量子比特门合成和XX链激发传输中展示了对量子速度极限与脉冲质量的可认证基准。

Suboptimal and Reduced-Order MPC via Timescale Separation Figure 1
2026-06-24math.OC

Suboptimal and Reduced-Order MPC via Timescale Separation

Stefano Di Gregorio, Guido Carnevale, Giuseppe Notarstefano

Department of Electrical, Electronic and Information Engineering

2026-06-24规划控制

面向高维非线性系统中 MPC 难以实时精确求解的问题,本文把有限迭代的次优优化与忽略部分动力学的降阶模型放入统一框架,并将采样时间作为调节优化误差和模型失配的关键参数。其核心洞察是把物理系统与迭代求解器一起视为多时间尺度闭环系统;理论上证明足够快采样可保持递归可行性并实现指数稳定,且在 MuJoCo 欠驱动双连杆机械臂上做了验证。

Parallel Dynamic Programming for Conic Linear Quadratic Control Figure 1
2026-06-24math.OC

Parallel Dynamic Programming for Conic Linear Quadratic Control

Luyao Zhang, Gabriel Bravo-Palacios, Brian Plancher, Sergio Grammatico

Barnard College, Columbia University, New York, NY 10027 USA & Dartmouth College

2026-06-24规划控制

这篇论文针对长时域 MPC/轨迹优化中 LQ 子问题串行 Riccati 求解难以利用多核、且机器人摩擦/推力等锥约束带来额外开销的问题,提出在 ADMM 内层把锥 LQ 控制按时间切分为固定端点子问题,并用并行动规/Riccati 变体与共识步骤组合。四旋翼悬停和低推力轨道转移实验显示,在多核 CPU 上相对 QDLDL、ProxLQR 等可获得最高约 5 倍加速,但实际收益依赖时域长度、子问题数和负载均衡。

Bridging Identification and Second-Order Acceleration: A Fast Alternating Minimization Framework for Composite Optimization Figure 1
2026-06-24math.OC

Bridging Identification and Second-Order Acceleration: A Fast Alternating Minimization Framework for Composite Optimization

Zihao Xia, Min Tao

School of Mathematics, Nanjing University, Nanjing, 210093, China., School of Mathematics, National Key Laboratory for Novel Software Technology, Nanjing, ploiting Krylov subspace techniques, ARC achieves favorable scalability while

2026-06-24优化算法

本文针对非凸、非光滑复合优化中一阶近端法收敛慢、传统三次正则牛顿法难以直接处理高维非光滑目标的问题,提出将近端梯度识别与低维子空间三次正则牛顿更新交替融合的统一框架。其关键在于用自适应阈值动态识别活跃子空间,并在该子空间内利用二阶曲率加速;理论上在 KL 条件下证明全局收敛、无需非退化假设的有限识别,并给出达到近似二阶驻点的 O(ε−3/2) 复杂度,实验显示在合成与真实数据上更高效。

Decomposition-Based Constructive Heuristics for the Linear Ordering Problem Figure 1
2026-06-24math.OC

Decomposition-Based Constructive Heuristics for the Linear Ordering Problem

Kazutoshi Ando, Tatsuya Sugimoto, Noriyoshi Sukegawa

Shizuoka University, Hosei University

2026-06-24优化控制

针对线性排序问题中精确求解困难、传统构造启发式难以利用“组间先后”粗粒度结构的问题,论文提出统一的递归分解框架:先按强连通分量、最小割或Borda得分划分子集,小规模子问题精确求解后拼接排序。理论上给出Condorcet型性质差异;xLOLIB实验显示递归Borda平均构造质量最好,但经插入局部搜索后各方法最终差距明显缩小。

Variational convexity: new characterizations, calculus rules, and applications Figure 1
2026-06-24math.OC

Variational convexity: new characterizations, calculus rules, and applications

Radu Ioan Bot, Ziyuan Wang

Faculty of Mathematics, University of Vienna, Oskar-Morgenstern-Platz 1, 1090 Vienna, Austria.

2026-06-24优化算法

这篇论文针对非凸优化中“驻点何时可保证局部最优”的判别难题,重新刻画变分凸性:用近端包络/上图给出局部几何表征,并系统建立非线性复合、求和、近端平均等保持规则。主要结果是把变分凸性的验证从直接检查非凸函数转化为模块化演算与约束资格条件,并用于含非光滑目标、C1 不等式约束和仿射等式约束的非线性规划,推出新的局部极小充分条件。

Certified Reachable Sets for Nonlinear Reaction--Diffusion Systems Figure 1
2026-06-24math.NA

Certified Reachable Sets for Nonlinear Reaction--Diffusion Systems

Mohamed Amine Ouchdiri, Mohamed Maghenem, Saad Benjelloun, Adnane Saoud

College of Computing, University Mohammed VI Polytechnic, Benguerir, Morocco., Univ. Grenoble Alpes, CNRS, Grenoble-INP, GIPSA-lab, F-38000 Grenoble, France. 3 De Vinci Higher Education, De Vinci Research Center, Paris, France.

2026-06-24生成模型

针对带参数不确定性的非线性反应–扩散 PDE 难以直接做可达集分析的问题,论文将有限元离散、POD 降阶与 ODE 集合传播串成一条可认证流程;关键在于给出 PDE 到 FEM、FEM 到 ROM 的显式且对参数集一致的误差上界,从而把 ROM 上的可达集膨胀为原系统的保守包络。Allen–Cahn 与 logistic PDE 实验显示测试轨迹被包住,但精度与计算量受 POD 模态数和参数划分权衡限制。

Trade-off invariance for weighted scalarizations in multi-objective optimization Figure 1
2026-06-24math.OC

Trade-off invariance for weighted scalarizations in multi-objective optimization

Jona Klemenc, Alessandro Scagliotti

2026-06-24优化算法

本文动机是澄清多目标优化中加权和标量化的解是否会因不同最小化点或最小化序列而给出不同权衡。核心洞察是将正权重归一到开单纯形,并通过选取参考目标把问题转化到已有的 trade-off invariance 框架。主要结果表明,除零测度权重集合外,所有最小化解共享同一目标向量,最小化序列的极限目标也唯一;几何上即几乎每个权重至多暴露一个非支配点。

Obstacles and Singularities of Riemannian Distance Functions Figure 1
2026-06-24math.AP

Obstacles and Singularities of Riemannian Distance Functions

Paolo Albano, Piermarco Cannarsa, Carlo Sinestrari

2026-06-24优化控制

本文关注带障碍物的黎曼距离函数:在最短路径受状态约束时,障碍会如何改变测地线唯一性、割迹结构与 Hamilton–Jacobi 奇性传播。核心洞察是把障碍诱发的非光滑性刻画为最优轨迹初速度不唯一,并证明任意足够高的距离等值集都必含奇点;同时,障碍外每个奇点沿非平凡 Lipschitz 曲线传播。例子还说明边界未必出现奇点,结果基本达到 sharp。

Line Planning at Scale: Models, Methods and Insights Figure 1
2026-06-24math.OC

Line Planning at Scale: Models, Methods and Insights

Rolf van Lieshout, Bart van Rossum

Department of Industrial Engineering & Innovation Sciences, Eindhoven University of Technology, The Netherlands

2026-06-24规划控制

本文针对大规模公共交通线路规划中精确换乘建模难以求解的问题,统一比较 CGN、PTN、直接连接模型和方向扩展模型,并给出模型层级、Benders 视角及相应分解/列生成算法。972 个荷兰与瑞士铁路实例显示,经典 CGN 只适合小或易实例,大规模下常无可行解;紧凑的直接连接模型总体最优,在超过 83% 实例中给出最佳方案,说明可控近似比精确换乘建模更适合作为规模化线路规划基础。

A reverse Faber--Krahn inequality for the Robin Laplacian with negative boundary parameter: small coupling in all dimensions Figure 1
2026-06-24math.SP

A reverse Faber--Krahn inequality for the Robin Laplacian with negative boundary parameter: small coupling in all dimensions

Nunzia Gavitone, David Krejcirik, Gloria Paoli

2026-06-24学习理论

本文关注 Robin 拉普拉斯在负边界参数下的反 Faber–Krahn 问题:球是否仍在定体积域中最大化第一特征值。核心创新是将平行坐标法推广到任意维凸域,并用带 Neumann–Robin 边界的球壳径向问题作比较。主要结果证明,当负耦合足够小且阈值仅依赖体积和维数时,所有有界凸域中同体积球给出最大第一特征值。

A multi-objective perspective on block-structured integer programs with one soft coupling constraint Figure 1
2026-06-24math.OC

A multi-objective perspective on block-structured integer programs with one soft coupling constraint

Mark Lyngesen, Kathrin Klamroth, Britta Efkes, Sune Lauth Gadegaard

2026-06-24优化算法

面向带单个软耦合约束的块结构整数规划,论文的动机是避免把软约束硬化后丢失目标收益与违约程度之间的权衡。核心洞察是将耦合约束改写为第二目标,把问题转成可加分解的双目标模型,并只搜索软约束阈值附近的兴趣区域;算法用二分定位区域、用 λ-lookup 复用子问题结果,并提出由中向外枚举非支配解的方法。实验显示该思路显著减少整数规划调用次数,优于传统 dichotomic search;在大规模实例上更像带可证明界的强启发式,同时给出最优性 gap 和局部权衡信息。

Extreme-Case Distorted Utility under Moment Ambiguity Figure 1
2026-06-24math.OC

Extreme-Case Distorted Utility under Moment Ambiguity

Zehao Li, Yijie Peng, Hui Shao, Chung-Piaw Teo

2026-06-24优化控制

本文针对定价、库存、容量与合约等决策中只掌握均值方差等矩信息、却需按尾部敏感扭曲效用评估收益的内层鲁棒问题。核心创新是转到分位数域,用非光滑变分分析与保序投影处理单调约束,给出一般效用和扭曲下最坏/最好情形的一阶条件、闭式极值与极端分布,并在RVaR、GlueVaR、CVaR合约及生成式AI容量配置中展示可嵌入外层鲁棒优化。

Optimal Couplings of Levy Processes in the Class of Immersion Couplings Figure 1
2026-06-24math.PR

Optimal Couplings of Levy Processes in the Class of Immersion Couplings

Tau Shean Lim, Ray Shua Ooi

Department of Mathematics, Xiamen University Malaysia

2026-06-24优化控制

本文关注 Lévy 过程在二次代价下的最优耦合,动机是将已有只对 Feller 耦合成立的最优性推广到更大的 immersion 耦合类。核心洞察是用保持鞅性质的等价刻画重写局部最优性,并结合无限可分测度的最优传输与广义 minimax 对偶。主要结果证明有限二阶矩情形下既有最优 Lévy 耦合在 immersion 耦合中仍具局部与全局最优性。

Control Based Enhanced Regenerative Modes for Hydraulic Multi-Actuator Systems Figure 1
2026-06-24eess.SY

Control Based Enhanced Regenerative Modes for Hydraulic Multi-Actuator Systems

Bideaux Eric (AIS), Mohamed Smaoui (MIS), Tardy Grégory (AIS), Aurore Lanoix (Cerebrum)

Laboratoire Ampère, Université de Lyon, INSA Lyon, from all available degrees of freedom on an optimized

2026-06-24生成模型规划控制

面向电动化工程机械中液压传动效率低、续航和TCO受限的问题,本文提出在多执行器独立计量阀架构下在线选择各缸腔与主泵目标压力,用扰动力滑模观测器判定再生模式是否可行,并将位移跟踪与压力控制解耦以优先回收能量。仿真表明该策略能正确触发单泵线再生模式并带来能耗降低,但结果仍限于仿真,实机鲁棒性和多泵/直接再生扩展效果文中未充分说明。

Path Space Robust Bayesian Portfolio Selection Figure 1
2026-06-24q-fin.MF

Path Space Robust Bayesian Portfolio Selection

Andy Au

2026-06-24安全鲁棒

本文针对均值—方差投资中漂移难估且观测模型可能错设的问题,将贝叶斯滤波学习与路径空间相对熵鲁棒控制结合,强调同一创新布朗运动会同时污染财富与信念的“双通道”结构。核心结果是鲁棒代价的一阶项等于非鲁棒损失方差的一半,策略出现抑制大仓位的三次修正;学习反而使跟踪误差有界、鲁棒成本有限,但新结构可能主要来自 robustness penalty 的 scaling。

Distributionally Robust Joint Information and Mechanism Design for Multi-Area Power System Coordination Figure 1
2026-06-24math.OC

Distributionally Robust Joint Information and Mechanism Design for Multi-Area Power System Coordination

Furkan Sezer

2026-06-24安全鲁棒

面对极端天气下跨区电力系统因信息不透明和激励错配导致的备用保留、无序切负荷等问题,论文把公共信号设计、Groves 转移支付与分布鲁棒 Stackelberg 控制统一起来,用投影滤波刻画跳扩散环境信念,并将双层博弈化为 Isaacs 鲁棒控制问题。以 Winter Storm Uri 校准的算例显示,互济可降低约 8% 社会成本,在更强联络能力下约 30%,公开披露在自给和耦合市场中分别降低 37% 与 48% 福利成本。

Public Good Provision under Locally Private Signals Figure 1
2026-06-24econ.TH

Public Good Provision under Locally Private Signals

Behrooz Moosavi Ramezanzadeh, Jordan Awan

Department of Economics, University of Pittsburgh.

2026-06-24视觉感知

本文关注在本地差分隐私通道下,规划者只能看到被随机化的偏好信号时如何筹资并决定公共品供给。核心洞察是最优决策应基于后验价值与虚拟价值合成的个体得分,但可实施支付需另解 Fredholm 积分方程。主要结果表明,隐私会削弱偏好响应并可能造成 pooling;最大收入随估值下界呈线性、平方根或指数衰减三种规模区间,且 Laplace 与 logistic 噪声的福利排序取决于隐私校准标准。

Rationalizing collective revealed preferences with an application in fair resource allocation Figure 1
2026-06-24cs.GT

Rationalizing collective revealed preferences with an application in fair resource allocation

Chuwen Zhang, Zhiyun Guo, Zizhuo Wang, Yinyu Ye

Booth School of Business, University of Chicago, Chicago, IL 60637, USA, Antai College of Economics and Management, Shanghai Jiao Tong University, Shanghai 200240, China, School of Data Science, School of Management and Economics, The Chinese University of Hong Kong, Shenzhen 518172, Department of Management Science and Engineering, Stanford University, Stanford, CA 94305, USA, preference data can raise concerns related to privacy and regulation [EU, 2016]. In many applications, the available, Leaving aside the scalability and privacy concerns in modern economic systems, the value of individual rationality

2026-06-24优化控制

针对大规模市场中个体偏好难获取且涉及隐私、传统显示偏好又缺乏外推保证的问题,论文提出CRM:用可计算需求的“安卓”消费者构造替代市场,并通过经验风险最小化动态增添个体与重分配财富来拟合集体需求。主要结果给出不随替代市场规模恶化的泛化风险、样本复杂度与收敛保证,并展示可在未知个体效用时近似比例公平资源分配;同时指出若干安卓类别的最优选择存在NP难性。

Traveling profiles and control cost for a PDE describing the evolution of invasive species Figure 1
2026-06-24math.OC

Traveling profiles and control cost for a PDE describing the evolution of invasive species

Stefano Bianchini, Chiara Trifone

2026-06-24规划控制

本文面向入侵物种治理中如何以最小移除成本维持指定传播速度的问题,将受控反应扩散方程的行波前沿转化为相平面中的最优控制问题。核心洞察是刻画最优轨道与控制作用区域,而非依赖先前较强的单调性假设;结果证明给定速度下最优剖面存在且唯一,给出充要一阶条件,并揭示成本函数仅具有限正则性、渐近线性,且一般不凸也不次可加。

A Lorentzian Lasry-Lions regularization theorem Figure 1
2026-06-24math.OC

A Lorentzian Lasry-Lions regularization theorem

Alec Metsch

2026-06-24优化控制

本文动机是把欧氏/黎曼情形的 Lasry–Lions 正则化推广到全局双曲洛伦兹时空,以服务洛伦兹最优传输与 Hamilton–Jacobi 型问题。核心洞察是在局部半凹性和未来类时超微分条件下,前后 Lax–Oleinik 组合可获得局部 C^{1,1} 正则性。主要结果给出一般正则化定理,并证明位移插值的中间测度对在对偶 Kantorovich 形式中存在 C^{1,1}_{loc} 正则最大化对。

Constrained Variable Projection for Structured Problems Figure 1
2026-06-24math.OC

Constrained Variable Projection for Structured Problems

Emanuele Zangrando, Sara Venturini, Francesco Rinaldi, Francesco Tudisco

Gran Sasso Science Institute, L’Aquila, Italy., MOBS Lab, Northeastern University, Boston, USA., University of Padova, Padova, Italy., University of Edinburgh, Edinburgh, UK

2026-06-24优化控制

针对传统变量投影主要处理无约束可分离最小二乘、难以覆盖带稀疏性/范数/单纯形等结构约束模型的问题,论文将 VarPro 解释为折叠双层优化,在线性块由下层最小二乘精确消去后,对受凸约束的变量推导可自动微分的精确约化梯度,并嵌入 Frank-Wolfe 条件梯度法。理论上给出一阶收敛保证,实验在稀疏自编码、字典学习、盲反卷积和 few-shot 学习中显示相对联合优化可提升时间与数据效率。

Welfarist Control Design -- How to fulfill the societal mandate in multi-agent control? Figure 1
2026-06-24eess.SY

Welfarist Control Design -- How to fulfill the societal mandate in multi-agent control?

Sophie Hall, Kai Zhang, Ilia Shilov, Heinrich H. Nax, Saverio Bolognani

2026-06-24规划控制

面向道路、能源、通信等多智能体系统中的稀缺资源自动分配,论文指出现有公平控制常依赖惯例或特定指标,难以说明其社会授权。核心思路是把福利主义社会选择理论引入控制设计,用个体偏好、可比性假设和公理化社会成本函数明确刻画效率—公平权衡,并扩展到在线反馈优化、MDP与MPC。文中主要结果表明,反馈可补偿外生扰动,随机情形可重新区分事前/事后公平,预测控制可在约束和时间维度上实现可解释、可认证的动态福利目标。

Computational Framework for Bézier Distributions Figure 1
2026-06-24math.OC

Computational Framework for Bézier Distributions

Esteban Leiva, Andrés L. Medaglia, Luis F. Zuluaga

∗Department of Industrial and Systems Engineering, University of Southern California, Los Angeles, CA, USA, ‡Department, University

2026-06-24优化控制

这篇论文面向有界连续随机变量建模中贝塞尔分布表达力强但难以高效拟合、缺少现代工具的问题,将其估计转化为带单调控制点的凸受限优化,并证明该限制随阶数增加渐近无损。作者基于等距回归投影设计一阶算法,覆盖最小误差与极大似然拟合;实验显示相比传统无导数方法快约三到四个数量级,比 IPOPT 平均快三个数量级且更稳健,同时给出 bezierv Python 包和可靠最短路应用。

Hessian-augmented Supervised Learning for Hamilton-Jacobi-Bellman PDEs Figure 1
2026-06-24math.OC

Hessian-augmented Supervised Learning for Hamilton-Jacobi-Bellman PDEs

Matías Gómez-Aedo, Behzad Azmi, Yuyang Huang, Dante Kalise, Karl Kunisch

Department of Mathematics, Imperial College, Department of Mathematics and Statistics, University of Konstanz, Germany, RICAM and Institute of Mathematics and, Scientific Computing, University of Graz, Austria

2026-06-24优化控制

这篇论文针对 HJB 方程求解在高维最优控制中受维数灾难限制、反馈控制难以实时获得的问题,提出用 PMP 轨迹生成值函数、梯度与 Hessian 数据,并在稀疏多项式回归中进行二阶导数增强训练。核心洞察是每个样本的 Hessian 可提供大量额外线性约束,从而降低昂贵 TPBVP 采样需求;实验显示在多维算例中提升值函数近似和闭环控制性能,样本数相对低阶方法最多可降约一个数量级。

2026-06-23

63 篇
Open Problem: Is AdamW Effective Under Heavy-Tailed Noise? Figure 1
2026-06-23cs.LG

Open Problem: Is AdamW Effective Under Heavy-Tailed Noise?

Dingzhi Yu, Hongyi Tao, Yuanyu Wan, Luo Luo, Lijun Zhang

2026-06-23优化控制

本文针对 LLM 训练中普遍存在的重尾梯度噪声,追问 AdamW 在无有限方差假设下能否匹配 Lion、Muon 等符号优化器的收敛率。核心洞察是把问题收窄为 AdamW 二阶矩分母记忆是否会遮蔽大梯度,并给出加权度量下的正向基准与“走廊”式下界机制;主要结果不是完整证明 AdamW 有效,而是明确了匹配重尾最优率所需突破的理论障碍。

Optimal Stopping for a Diffusion with Unobserved Bernoulli Drift Figure 1
2026-06-23math.PR

Optimal Stopping for a Diffusion with Unobserved Bernoulli Drift

Georgy Gaitsgori, Ioannis Karatzas

2026-06-23生成模型

本文动机是刻画在漂移符号不可观测时,决策者如何在继续学习与尽早停止之间权衡。核心洞察是先用滤波把问题化为完全观测,再引入位移参数将一维问题提升到二维平面,通过固定初值的叶状分解求解。主要结果给出继续区间的唯一端点、半显式价值函数、自由边界单调性及相应阈值型停止规则。

Muown Implicitly Performs Angular Step-size Decay Figure 1
2026-06-23cs.LG

Muown Implicitly Performs Angular Step-size Decay

Florian Hübler, Kai Lion, Antonio Orvieto, Niao He

Department of Computer Science, ELLIS Institute Tübingen, MPI-IS, Tübingen AI Center, Germany

2026-06-23优化控制

针对 Muon/Muown 在 Transformer 预训练中虽有效但步长稳定性机制不清的问题,论文指出 Muown 的未归一化方向变量等价于在行斜流形上的黎曼方向更新,行范数增长会隐式衰减角步长。作者据此提出 AngularMuown,直接优化归一化方向并显式调度角步长;在 nanoGPT、Qwen2-0.5B 和 1.1B MoE 预训练实验中相较 AdamW、NorMuon 与 Muown 取得更快收敛,但评估仍集中于中等规模语言模型。

A modified Riemannian Levenberg-Marquardt Algorithm for robust or constraint optimization on manifolds Figure 1
2026-06-23math.OC

A modified Riemannian Levenberg-Marquardt Algorithm for robust or constraint optimization on manifolds

Mateusz Baran, Ronny Bergmann

41], where a best-fitting geodesic in the sense of least squares for time-labelled

2026-06-23优化算法安全鲁棒

面向流形上的非线性最小二乘在离群点、非高斯噪声和盒约束下易失效的问题,本文把Riemannian Levenberg–Marquardt扩展为分块鲁棒版本,推导含鲁棒函数二阶项的新替代模型,并支持算子式Jacobian与欧氏边界约束。Manopt.jl实验显示其在测地回归、Procrustes和bundle adjustment中更稳健,部分任务更快且能找到更低目标值。

Exponential stability of abstract boundary-coupled positive systems Figure 1
2026-06-23math.OC

Exponential stability of abstract boundary-coupled positive systems

Yassine El Gantouh, Mahyar Mahinzaeim

2026-06-23学习理论

针对边界耦合系统中子系统稳定性如何受耦合算子影响的问题,本文把正系统半群理论推广到 Banach 格上的抽象边界耦合框架。核心在于结合反馈理论与预解正算子扰动方法,给出可检验的边界耦合条件和谱半径判据。主要结果是证明系统解的存在唯一性、正性与正则性,并刻画指数稳定当且仅当子系统稳定且整体传递函数谱半径小于一。

The Brocard Problem: Structural Invariants, p-Adic Density, and the Generative Sieve Figure 1
2026-06-23math.NT

The Brocard Problem: Structural Invariants, p-Adic Density, and the Generative Sieve

Leandro Vieira Peixoto

2026-06-23生成模型

本文以经典 Brocard 问题 n!+1=m² 中为何只发现少数 Brown 数为动机,尝试用素数阶乘周期、模约化和 p-adic 密度重写解空间结构。核心洞察是把平方条件转化为连续 n-smooth 整数的严格分割,并提出生成式 p-adic sieve 与 LLL 松弛来替代直接搜索。文中声称证明三角数等价、复现已知解并排除 n!+3 的推广情形,但若要支持“无更多解”的结论,关键推导仍需进一步核验。

Finite difference methods for a continuous-time heterogeneous agent model with recursive utility Figure 1
2026-06-23math.OC

Finite difference methods for a continuous-time heterogeneous agent model with recursive utility

Yves Achdou, Qing Tang

2026-06-23优化控制

本文面向连续时间异质主体宏观模型中 Epstein-Zin 递归效用带来的数值求解难题,尤其是 HJB 方程对价值函数的非线性依赖和状态约束。核心洞察是按不确定性早/晚解决偏好区分算法:晚解决情形用 Howard-Newton,早解决情形构造单调不变映射并用 Howard-Tarski-Kantorovich。文中证明离散算法收敛、给出离散 HJB 解的存在性,并在晚解决情形建立连续与离散解的先验误差估计。

Toward Decarbonization of Chemical Manufacturing: Joint Optimization of Unit Commitment and Microgrid Operations Figure 1
2026-06-23math.OC

Toward Decarbonization of Chemical Manufacturing: Joint Optimization of Unit Commitment and Microgrid Operations

Saba Ghasemi Naraghi, Richard Reed, Tylee Kareck, Paritosh Ramanan, Zheyu Jiang

School of Chemical Engineering, Oklahoma State University, Stillwater, OK 74078, School of Industrial Engineering and Management, Oklahoma State University, Stillwater, OK, generators depend entirely on the availability of renewable energy sources. Together, we solved

2026-06-23优化算法

面向化工过程热电气化带来的电网协同难题,本文把乙烯蒸汽裂解微电网运行与主电网机组组合统一建模为大规模 MILP,并用 Benders 分解加暖启动两阶段求解。德州 26 座乙烯厂案例显示,30% 电气化时总体减排最高但仅 1.36%,继续提高反而推升排放和成本,说明脱碳收益受电力结构与时空调度强约束;该方法平均求解时间较直接 MILP 降低 93.5%。

Asymmetry PRISM: A CPU/GPU Portfolio Optimization Engine for Deadline-Bounded Institutional Rebalancing Figure 1
2026-06-23q-fin.CP

Asymmetry PRISM: A CPU/GPU Portfolio Optimization Engine for Deadline-Bounded Institutional Rebalancing

Debdoot Ghosh

2026-06-23优化算法学习理论

论文面向机构调仓中“多账户必须在交易窗口前完成”的硬截止问题,强调优化器不能只比目标值,还要同时可行、按时、可审计。核心做法是将 Asymmetry PRISM 作为 CPU/GPU 调仓引擎,在公开评测边界下固定硬件软件、计时通道和外部可行性检查。结果显示,CPU 在小中规模基准上快于完成的参考求解器 4.5–24.1 倍,GPU 在 10,000 标的、500 账户队列中 109.5 秒全完成且零超时;但具体算法增益来源文中未充分说明,可能主要来自 scaling / data 与系统实现。

Exact and Fast Subset Selection Algorithms for the Bi-objective Integral R2 Indicator Figure 1
2026-06-23cs.CG

Exact and Fast Subset Selection Algorithms for the Bi-objective Integral R2 Indicator

Michael T.M. Emmerich

Faculty of Information Technology, University of Jyväskylä, Finland

2026-06-23优化控制

面向多目标优化中需从大量帕累托候选点保留固定规模代表子集的问题,本文避免有限权重网格带来的离散化偏差,直接优化连续积分 R2 指标。核心洞察是将双目标 Tchebycheff 下包络面积精确分解为相邻已选点的转移项,并证明转移矩阵具 Monge 结构,从而把精确动态规划由 O(kn²) 加速到分治 O(kn log n) 及矩阵搜索 O(kn)。实验主要验证各实现与穷举结果一致并比较运行时间,收益来自算法复杂度降低。

Convergence of Gradient Descent for General Neural Network Architectures Beyond the NTK Regime Figure 1
2026-06-23cs.LG

Convergence of Gradient Descent for General Neural Network Architectures Beyond the NTK Regime

Yuqing Wang

Johns Hopkins University

2026-06-23优化算法学习理论

为解释实际深层网络中远离 NTK“惰性训练”的梯度下降行为,本文提出面向网络模块的收敛分析框架,用解析性与零测集论证建立迭代相关的 PL 型不等式,并以多项式广义光滑性和局部耗散条件控制轨迹光滑性。结果证明在较温和假设下,几乎所有初始化的 GD 会收敛到驻点邻域,覆盖预归一化 Transformer 等组合架构,并指出学习率尺度主要受深度和有效瓶颈维度影响,而非最大宽度。

A Relaxed Quadratic-Program-based Framework for Trajectory Tracking of Unicycle Robots with Singularity Avoidance Figure 1
2026-06-23cs.RO

A Relaxed Quadratic-Program-based Framework for Trajectory Tracking of Unicycle Robots with Singularity Avoidance

Hamza Tariq, Usman Ali, Adeel Akhtar

Hamza Tariq and Adeel Akhtar are with the Department of Mechanical & Industrial Engineering at the New Jersey Institute of Technology, Newark, NJ 07102, USA.

2026-06-23机器人视觉感知规划控制

针对独轮车轨迹跟踪中动态反馈线性化在零线速度处失效、难以完成停车换向的问题,论文将DFL约束松弛为带松弛变量的等式约束QP,使控制律在奇异点仍可行并保持时间不变。作者证明了反馈律局部Lipschitz连续和跟踪误差一致最终有界,并在ROS2-Gazebo的TurtleBot3仿真中展示其较经典DFL更适合含停止与反向运动的轨迹。

Approximation in Metric Sobolev Spaces: A General Framework Figure 1
2026-06-23math.FA

Approximation in Metric Sobolev Spaces: A General Framework

Massimo Fornasier, Giacomo Enrico Sodini

Massimo Fornasier: TUM School of Computation, Information, and Technlogy - Department of Mathematics, Boltzmannstrasse 3, 85748 Garching bei München (Germany), TUM Institute for Advanced Studies, Munich Data Science Institute, & Munich Center for Machine Learning, Giacomo Enrico Sodini: Institute of Analysis and Scientific Computing, TU Wien, Wiedner Haupt-

2026-06-23优化控制

本文动机是把度量测度空间上的抽象 Sobolev 分析转化为可计算的函数逼近框架,服务于无限维数据与最优传输几何中的学习问题。核心洞察是提炼出 Hilbert 型 Cheeger 能量与可计算 Lipschitz 代数这两项条件,使此前 Wasserstein 空间上的有限样本逼近方法可迁移到加权黎曼流形、Hellinger–Kantorovich 测度空间等更广类别。主要结果是在该统一框架下推广随机点值恢复、经验风险与 Tikhonov 正则化的逼近结论,但实际数值增益在文中未充分说明。

On Ulam's Segment Motion Problem Figure 1
2026-06-23math.MG

On Ulam's Segment Motion Problem

Dragomir Grozev, Nikolai Nikolov

Institute of Mathematics and Informatics, Bulgarian Academy of Sciences, Acad. G. Bonchev 8, Faculty of Information Sciences, State University of Library Studies and Information

2026-06-23优化控制

本文围绕 Ulam 提出的单位线段刚体运动最短路径问题,研究在给定初末位置时如何最小化两端点轨迹长度之和。核心洞察是把端点位移下界与方向夹角下界的取等情形转化为几何符号、共面性和线距约束。主要结果是在任意维欧氏空间中完整刻画两类下界可达条件,并给出非共面时角度下界必然增大的定量估计。

Dynamic multi-agent deep reinforcement learning-based pricing and incentivization approach in multimodal transportation networks Figure 1
2026-06-23cs.LG

Dynamic multi-agent deep reinforcement learning-based pricing and incentivization approach in multimodal transportation networks

Khadidja Kadem, Mostafa Ameli, Carlos Lima Azevedo, Mahdi Zargayouna, Latifa Oukhellou

Department of Electrical Engineering and Computer Sciences, University of California, Berkeley, Berkeley, USA, Department of Technology, Management and Economics, Technical University of Denmark, Denmark

2026-06-23视觉语言强化学习

针对共享出行需求集中、可能挤压公交并加剧空间不公平的问题,论文把多模态宏观交通仿真与双智能体深度强化学习结合:政府智能体分时空发放公交激励,服务商智能体动态调价。早高峰三小时实验显示,该机制可削弱拥堵峰值,使通勤成本降约20%、排放降约10%,并接近翻倍公交利润;但结论主要来自仿真场景,真实部署泛化仍需验证。

Sparse Feedback Implementation for Sender-Receiver Transportation Linear-Quadratic Control Figure 1
2026-06-23math.OC

Sparse Feedback Implementation for Sender-Receiver Transportation Linear-Quadratic Control

Anders Hansson

2026-06-23规划控制

面向带运输延迟的大规模网络系统,直接使用集中式 LQ 最优反馈会形成稠密增益,削弱计算与通信优势。论文的核心洞察是从无约束最优控制器本身提取稀疏右逆分解,并用图结构和偏化子空间解释稀疏性。主要结果表明,在有向树运输 LQ 问题中,可通过稀疏线性求解加稀疏输入矩阵实现同一最优控制信号,且非零模式可由图预先界定,数值例子显示在线运算量显著低于稠密反馈。

A First-Order Mean Field Control Analysis of Transformer Layers under Cross-Entropy Training Figure 1
2026-06-23math.OC

A First-Order Mean Field Control Analysis of Transformer Layers under Cross-Entropy Training

Cheng Huan, Hongwei Yuan

2026-06-23规划控制

本文动机是把残差 Transformer 的连续深度直觉转化为可量化的训练控制理论。核心洞察是将深度视为时间、层参数视为公共控制,把隐藏状态分布写成一阶输运型平均场控制问题,并把交叉熵的 softmax 残差纳入 Pontryagin 终端伴随条件。主要结果包括固定控制下有限层轨迹到连续流的 O(ε) 近似、高概率经验风险采样界、有限类与度量熵一致估计,以及关于最优值、存在性、稳定性和离散恢复的条件性结论。

Value iteration with stopping criterion: finite iterations, stability, and near-optimality guarantees Figure 1
2026-06-23math.OC

Value iteration with stopping criterion: finite iterations, stability, and near-optimality guarantees

Mathieu Granzotto, Romain Postoyan, Dragan Nešić, Lucian Buşoniu, Jamal Daafouz

2026-06-23优化控制

本文针对值迭代在实际中必须有限步停止但缺少终止、稳定性和性能保证的问题,研究确定性离散时间无限时域控制。核心是提出可参数化的广义停止准则,统一常用阈值规则并允许按状态、折扣因子和迭代次数调节。论文证明在温和可检验假设下算法有限终止,最终策略可具实用或渐近稳定性,并给出依赖停止准则的近最优误差界。

Path-following Control of a Quadrotor using Quasi-Static Transverse Feedback Linearization Figure 1
2026-06-23math.OC

Path-following Control of a Quadrotor using Quasi-Static Transverse Feedback Linearization

Mohamed Al Lawati, Adeel Akhtar

2026-06-23规划控制

针对四旋翼按几何路径而非定时轨迹飞行时的时序误差问题,论文将横向反馈线性化改为准静态形式,直接面向完整非线性动力学构造路径跟随控制器。其关键创新是不引入额外控制状态,推力由当前状态代数计算,并把解耦矩阵从4×4降为3×3;理论上证明路径流形受控不变、局部指数稳定,可同时调节切向速度和偏航,仿真验证了路径收敛与运动不变性。

Incremental Learning in Mirror Flows Figure 1
2026-06-23math.OC

Incremental Learning in Mirror Flows

Raphaël Berthier, Loucas Pillaud-Vivien

Sorbonne Université, Inria, Centre Inria de Sorbonne Université, Paris, France

2026-06-23生成模型

本文动机是解释神经网络训练中由简单到复杂的增量学习现象,并把对角线性网络中的精细分析推广到更一般的镜像流。核心洞察是边界附近初始化后,经适当重标定的轨迹收敛到以定义域指示函数为势的极限镜像流,原变量在随时间变化的假设集上最小化损失。主要结果给出该极限动力学的存在唯一性与收敛定理,并展示其可统一解释非负正交、半正定锥和概率单纯形上的增量过程。

On the gain of entrainment in stable linear control systems with a nonlinear output Figure 1
2026-06-23math.OC

On the gain of entrainment in stable linear control systems with a nonlinear output

Ram Massas, Michael Margaliot

2026-06-23规划控制

本文关注周期输入在同均值约束下是否能提升稳定线性控制系统的平均输出,这对交通、给药和生物调控等周期操作有直接意义。核心洞察是:线性动态本身不给增益,非线性输出的曲率会使周期轨道平均输出偏离平均输入对应平衡点输出。论文给出二阶刻画,证明凸/凹输出分别保证非负/非正GOE,并将其解释为平均Bregman散度;对二次输出进一步得到频域公式、符号判据及能量约束下的最优周期激励。

Towards time-variant scenario reduction for energy system optimization modeling under uncertainty Figure 1
2026-06-23math.OC

Towards time-variant scenario reduction for energy system optimization modeling under uncertainty

Yannick Werner, Juan Miguel Morales, Salvador Pineda, Sonja Wogrin

Y. Werner and S. Wogrin are with the Institute of Electricity Economics and Energy Innovation at Graz University of Technology, 8020 Graz, Austria.

2026-06-23优化算法安全鲁棒

针对长期能源系统随机规划中场景少、时间跨度长导致传统固定场景缩减效率低的问题,论文提出时间可变场景缩减:按时段重新聚合场景并赋予随时间变化的概率,再用分配问题恢复时间序列。两阶段发电扩张算例表明,该方法能在更小模型中更好保留影响投资决策的关键可再生出力及其概率;但仍属概念验证,距离度量、算法和稳定性保证文中未充分说明。

The Mortensen observer on the space of probability measures Figure 1
2026-06-23math.AP

The Mortensen observer on the space of probability measures

Martin Morange (ANANKE)

2026-06-23优化控制

本文动机是将有限维 Mortensen 最小能量观测器推广到以概率密度为状态的 Wasserstein 空间,用于部分观测下的确定性滤波。核心做法是把重构问题写成含输运动能与观测失配的变分控制问题,并在概率测度空间上刻画相应 HJB 方程。主要结果包括动态规划原理、值函数连续性、极小轨道存在性、两种黏性解表述及比较唯一性,并给出带漂移扩展和半拉格朗日近似的 Γ 收敛。

Diffusions with resetting boundaries: ergodic control and renewal optimization Figure 1
2026-06-23math.OC

Diffusions with resetting boundaries: ergodic control and renewal optimization

Sergey Nikitin

2026-06-23生成模型规划控制优化算法学习理论

本文关注边界触发重置的一维扩散过程,其动机是补足传统反射、跳跃或泊松重置模型之外的遍历控制理论空白。核心创新在于把命中边界后的随机重置写入非局部边界条件,建立对应 HJB 方程与验证定理,并利用更新结构推导遍历代价显式公式。主要结果包括最优平稳 Markov 控制的刻画、单重置单反射情形下的存在性证明、若干漂移族优化的解析解,以及无限惩罚下禁止触边极限的最优代价表征。

Sparsity-Cone SDP Relaxations and Applications to Variable Fixing for Sparse Quadratic Programs Figure 1
2026-06-23math.OC

Sparsity-Cone SDP Relaxations and Applications to Variable Fixing for Sparse Quadratic Programs

Di Hou, Thai P.D. Nguyen, Kim-Chuan Toh, Guanyi Wang

2026-06-23优化控制

针对带 ℓ0 稀疏约束且可含不定二次项的 QP,传统 SDP–RLT 松弛虽紧但需提升到 2n+1 维,计算代价高。论文提出 sparsity-cone SDP,用 n+1 维矩阵和单个稀疏锥约束等强替代 SDP–RLT,并给出高效投影、变量固定与筛选证书。实验显示其保持界质量,同时在大规模稀疏 QP/QCQP 上显著降低计算负担并支持有效预处理。

A Variable-Metric Non-monotone Line Search Method for Mixed Variational Inequalities and Equilibrium Problems Figure 1
2026-06-23math.OC

A Variable-Metric Non-monotone Line Search Method for Mixed Variational Inequalities and Equilibrium Problems

Mohammed Alshahrani

Department of Mathematics, King Fahd University of Petroleum & Minerals (KFUPM), Dhahran 31261, Saudi Arabia, Interdisciplinary Research Center (IRC) for Smart Mobility and Logistics, King Fahd University of Petroleum & Minerals (KFUPM), Dhahran 31261, Saudi Arabia

2026-06-23优化控制

针对变分不等式、混合变分不等式与均衡问题中普通投影迭代易失去收缩、收敛性难保证的问题,本文把变量度量缩放投影与改进非单调 Armijo 线搜索嵌入 gap-function 框架;关键洞察是缩放投影点恰好也是 Fukushima 正则化 gap 的极大点,使搜索方向同时具备算法步与误差证书含义。文中证明强单调 Lipschitz 情形下的全局收敛与 R 线性速率,并给出均衡问题的全局收敛和 Mastroeni gap 误差界;实验显示缩放在病态算子上更快,但相对 extragradient 的增益并不一致。

A Geometric Solution of the Schrödinger Bridge Problem on $\mathsf{SO}(2)$ via Stochastic Optimal Control Figure 1
2026-06-23math.OC

A Geometric Solution of the Schrödinger Bridge Problem on $\mathsf{SO}(2)$ via Stochastic Optimal Control

Hamza Mahmood, Adeel Akhtar

2026-06-23规划控制

针对机器人姿态、群体密度等常在李群状态空间上演化而现有 Schrödinger bridge 多依赖欧氏嵌入的问题,本文在 SO(2) 上直接构造坐标无关的随机最优控制解。核心是用 Haar 测度、热核与 Hilbert 投影度量证明 Schrödinger 系统固定点递推的存在唯一性,并得到仅利用内在几何结构的角速度控制律;仿真显示其可将圆上的概率密度从给定初态平滑引导到终态。

Interpolations: a linear algebra approach Figure 1
2026-06-23math.NA

Interpolations: a linear algebra approach

Andronick Arutyunov, Nikolay Korgin

Uzbekistan, Samarkan, Samarkand State University

2026-06-23优化控制

论文动机来自运动轨迹重构等应用中插值公式分散、数据类型与方法匹配成本高的问题。核心洞察是把函数值、导数等约束统一视为有限维函数空间对偶空间中的线性泛函,从维数匹配与对偶基构造出发处理拉格朗日、多项式/Hermite 样条和三角插值。主要结果包括存在唯一性判据、通用对偶基显式公式、三角情形的退化条件分析,以及面向异构传感器数据的插值方案。

Clipping the Price of Adaptivity at the Tail Figure 1
2026-06-23cs.LG

Clipping the Price of Adaptivity at the Tail

Itai Kreisler, Yair Carmon, Oliver Hinder

Tel Aviv University

2026-06-23优化控制

本文针对自适应随机凸优化在未知初始距离和 Lipschitz 常数时需付出高代价的问题,指出既有下界主要由罕见尾部样本驱动;其核心做法是利用模型—损失分解,在模型输出进入损失前对相对参考模型的异常预测进行截断。结果显示,该方法在计算与样本复杂度设置下分别接近或达到已知参数情形的最优误差率,仅对参数不确定性付出对数级代价。

Quantum Restricted Boltzmann Machine for Fast Unit Commitment Figure 1
2026-06-23math.OC

Quantum Restricted Boltzmann Machine for Fast Unit Commitment

Yuji Cao, Yue Chen

2026-06-23优化控制

针对含高比例可再生预测更新时机组组合需反复求解、MIQP 二进制决策导致计算和量子比特开销过高的问题,论文将 UC 重写为临界区域识别:qRBM 对“可再生输入—候选模式”做量子兼容自由能评分,再用对应仿射映射恢复调度解。案例称相同 UC 问题所需量子比特减少 223 倍、计算时间降低 99.96%,但具体增益可能主要来自模式分区与离线学习,文中对泛化边界说明有限。

Generative Robust Optimisation Figure 1
2026-06-23cs.LG

Generative Robust Optimisation

Yuhui Yin, Vassilis M. Charitopoulos

Department of Chemical Engineering, Sargent Centre for Process, Systems Engineering, UCL (University College London), Torrington Place

2026-06-23生成模型安全鲁棒

传统鲁棒优化的不确定集常被限制为盒、椭球等固定几何形状,难以覆盖真实数据中的非线性相关、偏斜和多峰结构。本文提出用生成模型解码器把校准后的潜变量集合映射为不确定集,并给出重构、分布匹配、潜空间规则性、鲁棒相关性和可计算性五项评估准则;其WAAE-GMM-RO结合ReLU解码器可嵌入MILP做精确最坏情形验证。生产计划和设施选址实验显示,该框架在表达复杂分布的同时保持校准和可求解性。

A Dual ADMM Framework for Inverse Parameter Identification in Elliptic Variational Inequalities Figure 1
2026-06-23math.OC

A Dual ADMM Framework for Inverse Parameter Identification in Elliptic Variational Inequalities

Youness Mezzan, Youssef Ouakrim, Abderrahim Zafrar

1 Department of Mathematics, Cadi Ayyad University, Faculty of Science and Technology, Marrakech, Morocco., 2 Laboratoire de Mathématiques et Applications aux Sciences de l’Ingénieur, Ecole Normale Supérieure, Université Sidi Mohamed Ben Abdellah, Fès, Maroc., 3 Department of Mathematics, Sidi Mohamed Ben Abdellah University, Faculty of Sciences Dhar El Mahraz, Fez, Morocco.

2026-06-23优化控制

本文针对由二类椭圆变分不等式约束的 Robin/摩擦系数反演问题,动机是避免传统平滑化破坏边界非光滑物理结构。核心做法是将状态方程改写为带辅助边界变量的约束最小化,用增广拉格朗日和 ADMM 分裂求解,并借 Fenchel 对偶给出非光滑项的阈值型近端处理。文中证明了系数可辨识性、近似最小化序列的存在与收敛,数值基准显示可在较低计算量下实现较准确重构。

Federated learning with heavy-tailed gradient noise and communication noise: a variance-reduction based algorithm Figure 1
2026-06-23cs.LG

Federated learning with heavy-tailed gradient noise and communication noise: a variance-reduction based algorithm

Shengchao Zhao, Yongchao Liu

School of Mathematics, China University of Mining and Technology, Xuzhou, China, School of Mathematical Sciences, Dalian University of Technology, Dalian, China

2026-06-23优化算法

本文针对联邦学习中梯度噪声与无线通信噪声同时呈重尾分布、传统有界方差假设失效的问题,提出 VRA-FedSGD:用带非线性映射的动量方差缩减抑制重尾梯度噪声,并用方差缩减聚合降低通信噪声影响,同时支持部分客户端参与。理论上给出非凸目标的均值收敛率和强凸目标的几乎必然收敛率,实验在真实数据逻辑回归上验证有效性。

Convergence Rates of Tseng's Splitting Method and Its Acceleration Schemes for Monotone Inclusion Problem with a Sum of Hölder Continuous Operators Figure 1
2026-06-23math.OC

Convergence Rates of Tseng's Splitting Method and Its Acceleration Schemes for Monotone Inclusion Problem with a Sum of Hölder Continuous Operators

Yi Zhang

2026-06-23学习理论

针对传统单调包含算法多依赖 Lipschitz 连续、难覆盖 Hölder 连续算子和算子和的情形,本文分析 Tseng 分裂法及两种加速变体在该弱条件下的收敛率。核心洞察是加速并非总优:当综合 Hölder 指数 α>1/2 时 com-EAG 与 SCEG 更快,α<1/2 时原始 Tseng 法反而更优;数值实验与理论阶数基本一致。

Adam Converges in Nonsmooth Nonconvex Optimization Figure 1
2026-06-23math.OC

Adam Converges in Nonsmooth Nonconvex Optimization

Zijian Liu

\addr Department of Technology, Operations, and Statistics, Leonard N. Stern School of Business, New York University

2026-06-23优化算法

本文针对Adam理论多局限于光滑非凸、难解释神经网络等非光滑场景的问题,分析带偏差校正且无裁剪等额外修改的原始Adam。核心是在O2NC/EO2NC思路下引入随机缩放学习率,证明其在非光滑非凸优化中达到有限时间收敛率T^{-2/13},并扩展到重尾梯度噪声;在4/3<p≤2时给出相应收敛率,且参数条件β1=β2与近期经验设置一致。

Ensemble Feedback Methods for Families of Linear Systems Figure 1
2026-06-23math.OC

Ensemble Feedback Methods for Families of Linear Systems

Michael Schönlein, Fabian Wirth

University of Passau, Germany

2026-06-23优化控制

本文面向参数化线性系统族的同时镇定问题,指出传统 ensemble feedback 只产生紧控制扰动,难以改变乘法算子的本质谱,因此在无限维表述下常无法镇定。核心做法是引入参数依赖的 multiplication feedback,并在 Hermite 指数恒定时建立参数化 Heymann 引理、极点配置与镇定定理;对非恒定情形,则在区间或圆等参数集结构假设下给出相应结果,同时刻画点态可控与一致 ensemble 可达之间的关系。

Information Design under Uncertain Utilities: Probabilistic and CVaR Approaches Figure 1
2026-06-23math.OC

Information Design under Uncertain Utilities: Probabilistic and CVaR Approaches

Furkan Sezer

Texas A&M University.

2026-06-23优化控制

本文针对信息设计中设计者无法精确认知智能体效用系数的问题,提出带校准修正项的 Cal-BCE,使激励相容在结构不确定下仍可表述;在 LQG 条件下将原本非凸问题转化为概率约束 SOCP 与 CVaR 半定规划。理论上给出可行性条件与去中心化协方差抑制结论,ETF 实验显示概率方案均值福利更高,CVaR 方案尾部保护更强,二者不存在稳定支配关系。

How to Cook a Soft-Boiled Egg Optimally: A Laplace-Transform Solution of a Two-Domain Heat Equation Figure 1
2026-06-23math.AP

How to Cook a Soft-Boiled Egg Optimally: A Laplace-Transform Solution of a Two-Domain Heat Equation

Matthew Lorig

Department of Applied Mathematics, University of Washington.

2026-06-23优化控制

本文把溏心蛋烹饪视为带不可超调约束的两区域传热最优控制问题:蛋黄需到65°C、蛋白需到85°C,且任一时刻越界都会造成不可逆过熟。核心做法是用拉普拉斯变换求解蛋黄/蛋白分层球体热方程,并结合数值反演评估分段水温策略。结果表明单次沸煮和既有周期方案难以满足约束;优化得到65°C低温预浸17.26分钟、沸煮66秒再冰浴的三阶段方案,总约20.67分钟达到双目标且全程不超调。

Optimal Macroitem Sequences in the Precedence Constrained Knapsack Problem Figure 1
2026-06-23math.OC

Optimal Macroitem Sequences in the Precedence Constrained Knapsack Problem

Valerio Dose, Fabio Furini, Marco Locatelli

2026-06-23优化控制

该文针对带容量与先序约束的背包问题,动机是理解其自然整数规划 LP 松弛在容量变化下的最优结构。核心洞察是把相互受先序关系牵连的物品合并为“宏物品”,LP 最优解可像经典分数背包一样按宏物品利润/重量比递减装入,至多一个宏物品被分数选取;同时拉格朗日断点与这些比值一致,双解可由宏物品内部可行流刻画。主要结果包括森林图上计算最优宏物品序列的 O(n²) 算法,以及入树/出树情形的 O(n log n) 算法,并给出相对参数伪流方法的实验加速证据。

Active learning-based Bayesian optimization in the realm of copper slag-blended cement systems Figure 1
2026-06-23math.OC

Active learning-based Bayesian optimization in the realm of copper slag-blended cement systems

Debadri Som, Rayna Maheshwari, Mathijs Schuurmans, Panagiotis Patrinos, Yiannis Pontikes

Department of Materials Engineering, KU Leuven, RISE Research Institutes of Sweden, Department Infrastructure and Concrete Construction, Department of Materials Science and Engineering, Indian Institute of Technology (IIT), Department of Electrical Engineering (ESAT), KU Leuven, realistic laboratory constraints, the authors optimized copper slag-limestone-Portland cement, Dataset available at Bayesian optimization iteration (t)

2026-06-23优化算法

为缩短低碳铜渣-石灰石-硅酸盐水泥配比的实验筛选周期,论文将高斯过程贝叶斯优化用于小样本主动实验设计,并把2天强度、成本和碳排放联合标量化,同时用28天强度不确定性作保守约束。结果显示,仅以10组初始实验起步,2–6轮迭代即可找到满足32.5N强度且低于500 kg CO2/吨的帕累托方案;线性核预测更准,但RBF核因不确定性刻画更适合主动学习。

PhiBE-Q-Learning: Bridging Off-Policy Reinforcement Learning and Continuous-Time Control Figure 1
2026-06-23math.OC

PhiBE-Q-Learning: Bridging Off-Policy Reinforcement Learning and Continuous-Time Control

Yuhua Zhu, Yutong Ren

2026-06-23强化学习规划控制

面向物理系统中只有离散离策略轨迹、但状态按未知 SDE 连续演化的控制问题,论文指出传统连续时间极限下的 Q 函数会退化、难以支持离策略学习。其核心是重新定义连续时间状态-动作价值函数,并结合 PhiBE 构造模型已知与模型未知的迭代 Q-learning。主要结果是在离散观测下无需显式辨识动力学,并在线性函数近似下给出收敛性与显式速率保证。

Local-to-Global Exactness of SDP Relaxations for Sparse QCQPs Figure 1
2026-06-23math.OC

Local-to-Global Exactness of SDP Relaxations for Sparse QCQPs

Masakazu Kojima, Sunyoung Kim, Naohiko Arima

Department of Industrial and Systems Engineering, Department of Mathematics, Ewha W. University, 52 Ewhayeodae-gil, Sudaemoon-gu, Seoul 03760, Korea

2026-06-23优化控制

针对稀疏非凸 QCQP 中 SDP 松弛何时精确这一基础问题,论文把全局矩阵松弛改写为基于弦图最大团的局部 SDP,并提出由局部秩一最优性拼接得到全局精确性的框架。其关键洞察是将稀疏结构本身纳入精确性证明,在团交至多一个节点的 block-clique 条件下,可组合凸局部问题、符号模式条件和少约束可分问题,得到原 QCQP SDP 松弛存在秩至多一最优解的充分条件。

Optimal Control Problem with Mixed Control and State Constraints for Cancer Chemotherapy and Treatment Optimization Figure 1
2026-06-23math.OC

Optimal Control Problem with Mixed Control and State Constraints for Cancer Chemotherapy and Treatment Optimization

David Lassounon, Aziz Belmiloudi, Mounir Haddou

2026-06-23规划控制优化算法

针对化疗剂量既要抑制肿瘤又要避免毒性的矛盾,本文将侵袭性肿瘤演化建模为非线性反应扩散方程,并把药物浓度作为控制量,引入剂量约束与随时间限制肿瘤密度的状态约束。核心贡献是证明状态方程适定性、最优解存在性与含测度项伴随方程的一阶最优性条件;肺部肿瘤数值实验显示该约束化控制可降低肿瘤负荷,但临床增益仍主要停留在模拟层面。

Nonlinear Guidance for Arrival Time and Arrival Angle Control Using Trajectory Shaping Figure 1
2026-06-23math.OC

Nonlinear Guidance for Arrival Time and Arrival Angle Control Using Trajectory Shaping

Kun Wang, Andrés Infante Adrián

Kun Wang 1 1 1 Assistant Professor, Department of Aerospace Engineering., and Andrés Infante Adrián 2 2 2 Ph.D. Student, Department of Aerospace Engineering.

2026-06-23规划控制

面向固定翼无人机需同时满足到达时间与到达角的非线性制导问题,论文用四阶多项式塑形视线角,将约束转化为两个耦合非线性积分方程,并设计解析暖启动加一维细化的两阶段求解以改善收敛。仿真显示其在强非线性场景中仍能给出可行解,轨迹接近开环最优;但结论主要来自数值算例。

Convergence Analysis of Muon-type Methods with Inexact LMO in the Degenerate Case Figure 1
2026-06-23math.OC

Convergence Analysis of Muon-type Methods with Inexact LMO in the Degenerate Case

Xun Qian, Peter Richtárik

King Abdullah University of Science and Technology, Thuwal, Saudi Arabia

2026-06-23学习理论

本文针对 Muon/Gluon 类优化器在实际用迭代算法近似求解 LMO 时的退化情形:重缩放动量的最小正奇异值可趋近于零,使既有非退化分析失效。核心创新是重新刻画不精确 LMO 的可接受误差与数值精度、求解器下界之间的关系,并在 layer-wise (L0,L1)-smooth 条件下给出一般非凸、确定性及带权重衰减的 star-convex 场景收敛率;其中还得到附加层级 PŁ 条件下的线性收敛。

Nonsmooth Obstacles and Killed Resolvents in Reflected Stochastic Control Figure 1
2026-06-23math.OC

Nonsmooth Obstacles and Killed Resolvents in Reflected Stochastic Control

Louis Shuo Wang, Jiguang Yu, Ye Liang

2026-06-23规划控制

本文针对带正常反射的二维扩散最优停止问题,动机在于非光滑 max 型收益与边界反射会使传统点态生成元和未杀死 resolvent 表示失效。核心创新是把停止增益表述为含对角奇异项的符号 Radon 测度,并证明价值函数应由进入停止集即杀死的 resolvent 表示。主要结果包括显式计算奇异测度、给出自由边界的 killed-potential 迹条件、建立候选边界验证定理,并用有限差分与蒙特卡洛数值验证其必要性。

On Fixed-Time Stability of Continuous Dynamics for Non-Monotone Variational Inequalities Figure 1
2026-06-23math.OC

On Fixed-Time Stability of Continuous Dynamics for Non-Monotone Variational Inequalities

Sina Arefizadeh, Kunal Garg, Angelia Nedić

School of Electrical and Computer Engineering, Arizona State University, School for Engineering of Matter, Transport and Energy

2026-06-23优化控制

这篇论文针对非单调变分不等式中多数方法只保证渐近或指数收敛的问题,从连续时间动力系统角度研究与初值无关的固定时间到达。核心做法是在无约束情形构造基于映射范数平方下降的动力学并改造成固定时间稳定系统,在约束情形将 Korpelevich 方法连续化并引入新的标量 scaling。主要结果是在相应光滑或非光滑 Lyapunov 条件下证明解集指数稳定与固定时间稳定,并用数值仿真验证理论行为。

Accelerated and Stable Convergence with Anchored Optimistic Method Figure 1
2026-06-23math.OC

Accelerated and Stable Convergence with Anchored Optimistic Method

Motahareh Sohrabi, Jianxin You, Simon Lacoste-Julien, Eduard Gorbunov, Gauthier Gidel

2026-06-23学习理论

本文针对单调变分不等式和极小极大优化中外梯度法每步需两次梯度、随机/在线场景稳定性不足且末迭代速率非最优的问题,提出带锚定的广义乐观方法 GOMA,将双时间尺度乐观更新与 Halpern 型锚定结合。在确定性单调 Lipschitz 算子下证明平方残差末迭代达到最优 O(1/k²),随机无界方差下单次调用变体取得 O(1/√k) 保证,并给出稳定性优势。

Reference-Free, Long-Horizon Trajectory Optimization for Aggressive Autonomous Driving in Milliseconds Figure 1
2026-06-23math.OC

Reference-Free, Long-Horizon Trajectory Optimization for Aggressive Autonomous Driving in Milliseconds

Prayag Sharma, Jonathan Y.M. Goh, Franck Djeumou

*This work was funded by Toyota Research Institute (TRI) 1 P. Sharma and F. Djeumou are with MANE Dept., Rensselaer Polytechnic Institute, Troy, NY, USA

2026-06-23规划控制优化算法

面向极限工况下自动驾驶需实时生成长时域、动力学可行轨迹的问题,本文不依赖预设参考或热启动,系统分析全车辆动力学 OCP 的求解器、积分器与初值设计。核心洞察是车辆动力学刚性使低阶 A 稳定积分器更合适,内点法性能取决于障碍参数更新和 Hessian 不定性处理,并用动态平衡生成低成本初值。实验显示 260 m 规划可低至 55 ms,高速避障漂移轨迹约 72 ms 生成并可在 BeamNG 中跟踪。

A note on the convergence guarantees of RLT-based algorithms for polynomial optimization Figure 1
2026-06-23math.OC

A note on the convergence guarantees of RLT-based algorithms for polynomial optimization

Alejandro Barros-González, Julio González-Díaz, Brais González-Rodríguez, Iria Rodríguez Acevedo

University of Vigo, CITMAga (Galician Center for Mathematical Research and Technology), 15782 Santiago de Compostela, Spain, Department of Statistics, Mathematical Analysis and Optimization and MODESTYA Research Group, University of Santiago de Compostela, 15782 Santiago de Compostela, Spain, Department of Statistics and Operational Research and SiDOR Research Group, University of Vigo

2026-06-23强化学习优化算法学习理论

本文针对RLT多项式优化算法中“低阶bound-factor约束可由最高阶约束推出”的经典结论,指出其原证明遗漏了一个必要假设。核心洞察是该细节会影响线性松弛在分支定界中的有效性,从而可能破坏全局收敛保证;作者给出修正条件,并说明连续情形通常由既有分支规则规避,但混合整数扩展中需在变量定界重合时重构约束以避免失真。

Unified Ergodic Primal-Dual Gap Rates with Unhalved Primal Stepsizes Figure 1
2026-06-23math.OC

Unified Ergodic Primal-Dual Gap Rates with Unhalved Primal Stepsizes

Sirong Dai, Ming Yan

Sirong Dai and Ming Yan 1 1 1 School of Data Science, The Chinese University of Hong Kong, Shenzhen

2026-06-23优化控制

这篇论文针对一类含光滑项、近端项和线性复合项的凸优化原始-对偶算法,解释为何既有遍历 gap 证明常把原始步长限制到收敛理论允许范围的一半。核心洞察是用 Lyapunov 下降吸收一步不等式中的正残差,从而建立 residual-to-gap 转移原理。结果是在 Condat–Vũ、PD3O、AFBA/PDDY、PAPC/PDFP2O 中获得 τ<2/L 下的 O(1/K) 遍历原始-对偶 gap 率,并用二维反例说明 4/3 乘积大步长矩形不能普遍推广。

Fusing Backdoors, Machine Learning, and Optimization for Large-Scale Parametric Mixed-Integer Programs Figure 1
2026-06-23cs.LG

Fusing Backdoors, Machine Learning, and Optimization for Large-Scale Parametric Mixed-Integer Programs

El Mehdi Er Raqabi, Pascal Van Hentenryck

Department of Operations and Decision Systems, Université Laval, Québec, Canada, H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, USA, availability, or operational constraints change over time due to unexpected events or fluctuations.

2026-06-23优化算法

针对电力、运输和供应链等场景中结构固定但参数频繁变化的大规模混合整数规划,论文提出 BIPC:先识别决定求解难度的整数变量“后门”,再用监督学习预测其取值或区间,最后在缩减问题上优化并必要时修复可行性。五个真实大规模任务显示求解时间显著下降,解质量损失有限,但具体增益在多大程度来自后门选择、学习模型或问题 scaling 仍需进一步拆解。

Extreme points and faces in the moment problem Figure 1
2026-06-23math.PR

Extreme points and faces in the moment problem

Didier Henrion, Martin Kružík, Stephan Weis

Czech Technical University in Prague, Czechia, University of Toulouse, France, § Institute of Information Theory and Automation, Czech Academy of Sciences, Prague, Czechia

2026-06-23优化控制

本文面向广义矩问题中无限维测度优化的可解性与加速需求,核心洞察是用凸集面结构刻画仿射约束下的极点:约束映射在包含该点的最小面上单射即对应极点。论文进一步证明有限矩约束下极点为具仿射独立性的有限原子测度,并将保持最优下确界的极点限制从 Radon 测度推广到包含点测度的任意凸概率测度集,同时给出多凸包络的新表示。

Finite-Horizon Portfolio Choice, Labor Supply, and Early Retirement under Borrowing Constraints Figure 1
2026-06-23math.OC

Finite-Horizon Portfolio Choice, Labor Supply, and Early Retirement under Borrowing Constraints

Gugyum Ha, Junkee Jeon, Jihoon Ok

Department of Mathematics, Sogang University, Seoul 04107, Republic of Korea., Department of Applied Mathematics, Kyung Hee University, Yongin-Si 17104, Republic of Korea.

2026-06-23强化学习优化算法

本文关注在不能以未来劳动收入举债时,个体如何同时决定消费、投资、劳动强度与提前退休。核心创新是把有限期原问题通过对偶鞅方法转化为奇异控制者与停止者的零和博弈,并用带障碍和梯度约束的抛物变分不等式刻画自由边界。主要结果证明强解唯一性、借款约束边界随时间单调,并由对偶性恢复最优退休、消费、闲暇和组合策略;数值结果显示劳动供给弹性会显著改变退休时点和资产配置。

Restart and Adaptive Acceleration in Stochastic Gradient Methods Figure 1
2026-06-23math.OC

Restart and Adaptive Acceleration in Stochastic Gradient Methods

Ali Elhishi, Chistophe Roux, Alexandre d'Aspremont

2026-06-23优化算法

本文针对非光滑、弱凸随机优化中 SGD 收敛率受限的问题,研究如何利用 Kurdyka-Łojasiewicz 不等式设计重启机制。核心洞察是重启可把 KL 指数转化为显式加速,并在无记忆 SGD 中等价于类似 Polyak 步长的阶梯式学习率。理论上给出弱凸/KL 条件下优于基线的复杂度界,并证明对未知或误设 KL 参数具有近自适应鲁棒性;实验覆盖可控玩具问题和 LLM 训练。

Physics-Informed Neural Networks for coupled stiff transport systems Figure 1
2026-06-23math.NA

Physics-Informed Neural Networks for coupled stiff transport systems

Laetitia Laguzet, Gabriel Turinici

2026-06-23优化控制

论文针对标准 PINN 在刚性、跨量级且会发生区域切换的耦合输运方程中易失稳、损失失衡和违背物理约束的问题,以 Marshak 辐射输运波为例,提出有界 ScaledSigmoid 输出、对数 MSE 边界/初值损失和全局守恒律约束。实验显示该组合能在约 30 分钟内重建冷热区与波前,并与 IMC 参考解一致;消融表明各组件缺失都会导致定性失败。

A Multi-Objective Approach to Curriculum-Based Course Timetabling with Continuity Across Semesters Figure 1
2026-06-23math.OC

A Multi-Objective Approach to Curriculum-Based Course Timetabling with Continuity Across Semesters

Florian Meier, Thomas Stidsen, Clemens Thielen, Andreas Wiese

University of Munich, Straubing, Germany., Department of Technology, Management and Economics, Technical, University of Denmark, Lyngby, Denmark., Department of Mathematics, Technical University of Munich, Munich, We study a curriculum-based university course timetabling problem in which, pus of the Technical University of Munich. The computational results reveal a, Keywords: University Course Timetabling, Mixed-Integer Programming, by universities worldwide (Ceschia et al. 2023). It leads to a university timetabling, lecturer availabilities, and structural restrictions arising from degree programs. In this, In practice, constructing university timetables is often still a labor-intensive pro-, University timetabling inherently involves multiple groups with differing and

2026-06-23优化控制

针对高校排课中教师偏好、学生冲突与跨学期稳定性难以同时权衡的问题,本文将课程表构建建模为多目标混合整数规划,分离教师与学生目标,并用扰动次数约束保持相对上一学年的时间连续性。基于 TUM Straubing 真实实例,结果显示两类目标存在稳定冲突;放宽扰动限制可同时提升双方课表质量,但超过一定阈值后收益递减。

DUET: Decentralized Bilevel Optimization without Lower-Level Strong Convexity Figure 1
2026-06-23math.OC

DUET: Decentralized Bilevel Optimization without Lower-Level Strong Convexity

Zhen Qin, Zhuqing Liu, Songtao Lu, Yingbin Liang, Jia Liu

†Department of Electrical and Computer Engineering, The Ohio State University, ‡Department of Computer Science and Engineering, University of North Texas, ◦Department of Computer Science and Engineering, The Chinese University of Hong Kong, access to a local dataset of size n. The goal is for all agents to collaboratively solve the following, data environments, thereby making collaboration critical for successful fine-tuning. This framework is, network-consensus approach (Nedic & Ozdaglar, 2009), where agents collaboratively solve a global

2026-06-23优化算法

本文针对去中心化双层优化中过度依赖下层强凸性的限制:一旦下层解不唯一,超梯度和共识更新都会失稳。作者提出单循环 DUET,用逐渐消失的二次正则化恢复下层唯一性,并结合梯度跟踪处理代理间数据异质性;理论上以近似 KKT 作为收敛度量,给出有限时间收敛率,实验用于验证该设计的有效性。

BASIL: Bayesian Application for Scientific Iteration and Learning Figure 1
2026-06-23cs.LG

BASIL: Bayesian Application for Scientific Iteration and Learning

Kelvin P. Idanwekhai, Valeriia Kaneva, Stefano Menegatti, Alexander Tropsha

Department of Chemistry, UNC Chapel Hill, Chapel Hill, NC, USA, Laboratory for Molecular Modeling (MML), UNC Chapel Hill, Chapel Hill, NC, USA, Department of Chemical and Biomolecular Engineering, NC State University, Raleigh, NC, USA

2026-06-23优化控制

许多实验和工业流程需要在样本昂贵、参数混合且研究者缺少编程经验的条件下做贝叶斯优化。BASIL的核心贡献是把代理模型、采集函数、单/多目标优化、数据管理和可解释可视化封装进跨平台桌面GUI,并支持CSV/JSON开放数据流。论文用合成多目标化学反应案例展示了迭代推荐与帕累托优化流程,但量化优于现有工具或人工设计的结果文中未充分说明。

Towards Fewer Control Laws via Continuous-Time Multiparametric Programming Figure 1
2026-06-23math.OC

Towards Fewer Control Laws via Continuous-Time Multiparametric Programming

Lida Lamakani, Efstratios N.Pistikopoulos

2026-06-23规划控制

该文针对显式多参数 MPC 在离散化后随时间网格变细导致决策变量和临界区域激增、在线查表成本上升的问题,改用连续时间 ODE 模型并以 PMP 推导控制律和初始状态相关的切换时刻,使区域划分反映真实弧结构而非采样网格。在 Newell-Lee 精馏塔案例中,连续时间方法仅产生 5 个临界区域,而两种 N=10 离散方案均为 23 个,并能更准确给出切换时间。

Reinforcement Learning for Risk-Sensitive Investment Management: a Free Energy--Entropy Duality Approach Figure 1
2026-06-23q-fin.PM

Reinforcement Learning for Risk-Sensitive Investment Management: a Free Energy--Entropy Duality Approach

Sebastien Lleo, Wolfgang Runggaldier

Sébastien Lleo 1 1 1 Finance Department and ‘AI, Data Science & Business’ AE, NEOMA Business School, France, Wolfgang Runggaldier 2 2 2 University of Padova, Italy, and Fellow, Institut Louis Bachelier, Paris, France

2026-06-23强化学习安全鲁棒

本文针对连续时间资产配置中收益、因子暴露和协方差难以精确估计的问题,将带基准的风险敏感投资管理改写为自由能—熵对偶下的 LQG 随机微分博弈,并据此设计结构化的连续时间 q-learning actor–critic。关键洞察是用解析解的二次价值函数和仿射鞍点策略约束学习器,使策略既可学习又可解释为分数 Kelly 分解。基于美国股票 ETF 数据的概念验证显示,算法能高精度恢复最优组合策略,且组合 actor 的学习信号比辅助对抗 actor 更干净。

An LLM-Explainable DRL Framework for Passenger-Directed Autonomous Driving Figure 1
2026-06-23cs.AI

An LLM-Explainable DRL Framework for Passenger-Directed Autonomous Driving

Ouided Braoui, Meriem Bouali, Nadir Farhi

2026-06-23强化学习

针对自动驾驶决策不透明、乘客难以理解车辆为何不执行指令的问题,本文将D3QN强化学习控制器与LLM解释模块结合,使车辆在fast、comfort、stop三种乘客意图间切换,并在安全规则覆盖请求时生成面向乘客的说明。仿真结果显示,系统能稳定学习、遵守交通规则并完成模式切换,但仍属概念验证,真实道路泛化与LLM实时性文中未充分说明。

GPU-accelerated semidefinite programming for causal games Figure 1
2026-06-23quant-ph

GPU-accelerated semidefinite programming for causal games

Emanuel-Cristian Boghiu, Kyrylo Simonov

Barcelona Supercomputing Center, Plaça d’Eusebi Güell, 1-3 08034, Barcelona, Spain

2026-06-23优化控制

这篇论文关注过程矩阵因果博弈中,已知 GYNI 胜率与维度无关上界之间仍有明显差距的问题,动机是判断更高局部维度是否能带来更强的无定因果序策略。作者将 see-saw 优化中的半定规划求解改造成 GPU 加速版 SCS,把主要开销的半正定锥投影移到 GPU,并保留复厄米结构,获得约 6 倍加速。实验扩展到局部维度 d=8,但未显著超过 d=5 的约 0.6218 胜率,提示需要不同策略或现有上界可能不紧。

2026-06-19

28 篇
On Second-Order Methods for Bilevel Optimization Figure 1
2026-06-19math.OC

On Second-Order Methods for Bilevel Optimization

Jiawen Bi, Jiaxiang Li, Mingyi Hong, Shuzhong Zhang

2026-06-19优化算法

本文针对非凸-强凸双层优化中二阶驻点求解缺乏确定性最优复杂度的问题,分析如何在超梯度与超 Hessian 只能近似计算时使用三次正则牛顿法。核心创新是提出单循环 SLCRN,将一次下层梯度步与一次超梯度牛顿步耦合,避免反复精解下层问题。理论上证明其以确定性的 O(ε^-1.5) 总 oracle 复杂度找到 ε-SOSP,匹配单层二阶非凸优化下界,并说明若干直观简化会破坏收敛保证。

CLUSTER: Derivative-free optimization of smooth functions with parameter-change costs Figure 1
2026-06-19math.OC

CLUSTER: Derivative-free optimization of smooth functions with parameter-change costs

Serena Landers, Sahil Pontula, Shiekh Zia Uddin, Sachin Vaidya, Marin Soljačić, Steven G. Johnson

for optimizing robot-controlled laboratory experiments, in which a robot may incur a separate mo-, on a variety of test problems (including an optics laboratory experiment) by around 50%, and greatly, outperform common competing algorithms for laboratory optimization (Bayesian optimization and, Department of Physics, Massachusetts Institute of Technology., Department of Electrical Engineering and Computer Science, Massachusetts Institute of Tech-, Nokia Bell Labs., Research Laboratory of Electronics, Massachusetts Institute of Technology., NSF Institute for Artificial Intelligence and Fundamental Interactions (IAIFI)., Department of Mathematics, Massachusetts Institute of Technology.

2026-06-19优化算法

这篇论文关注机器人实验中“测量便宜、改变参数昂贵”的局部无导数优化场景,指出传统算法按函数评估计成本会低估真实操作代价。CLUSTER在二次插值信赖域方法中利用逐簇移动产生的中间评估点,面向参数变更次数优化,并给出Conn变体的收敛保证。数值测试和激光耦合实验显示,相比原Powell/Conn类方法约减少一半收敛所需参数变更,且明显快于贝叶斯优化和Nelder–Mead。

High-Probability Last-Iterate Guarantees for Two-Point Gaussian Zeroth-Order Stochastic Gradient Descent Figure 1
2026-06-19math.OC

High-Probability Last-Iterate Guarantees for Two-Point Gaussian Zeroth-Order Stochastic Gradient Descent

Haishan Ye

Xi’an Jiaotong University

2026-06-19优化算法三维

针对黑箱/仿真优化中只能查询随机函数值、且实际常部署单次运行最后迭代点的问题,本文分析同样本双点高斯零阶 SGD。核心洞察是不用期望界经 Markov 转换,而通过加权扫描累积随机方向收缩,并用乘积鞅边界控制带符号误差。结果在强凸光滑、条件次高斯噪声及维度条件下,以至少 1−δ 概率给出最后迭代 Õ(d/T) 次优界,置信依赖仅为对数级。

Agentic AutoResearch forSpace Autonomy: An Auditable, LLM-Driven Research Agent for Aerospace Control Problems Figure 1
2026-06-19cs.RO

Agentic AutoResearch forSpace Autonomy: An Auditable, LLM-Driven Research Agent for Aerospace Control Problems

Amit Jain, Richard Linares

Amit Jain 1 1 1 Postdoctoral Associate, Department of Aeronautics and Astronautics., and Richard Linares 2 2 2 Associate Professor, Department of Aeronautics and Astronautics.

2026-06-19规划控制

航天控制中学习策略的调参和验证常受随机种子噪声影响,容易把偶然好结果当成进展。本文提出 AutoResearch,让 LLM 离线驱动实验循环,并把种子噪声测量、重播验证和逐项删减审计嵌入流程。在相对交会和避障对接任务上,经审计策略显著超过噪声水平;随机搜索表现更弱,对接任务甚至未得到可行策略。

A Single-Loop Minorized Dual Decomposition Method for Nonsmooth Multi-Stage Stochastic Programming Figure 1
2026-06-19math.OC

A Single-Loop Minorized Dual Decomposition Method for Nonsmooth Multi-Stage Stochastic Programming

Dan Luo, Hailin Sun, Lei Yang, Yang You

Key Laboratory of NSLSCS, Ministry of Education, School of Mathematical Sciences, Nanjing Normal University, Nanjing 210023, China, School of Computer Science and Engineering, Guangdong Province Key Laboratory of Computational Science, Sun Yat-sen University, Guangzhou 510275, China

2026-06-19优化控制

针对非光滑复合多阶段随机规划中阶段间约束耦合、场景内又可分解导致传统辅助变量式 ADMM 开销大的问题,论文提出单循环的 minorized dual decomposition:在每轮构造小化问题及受限 Wolfe 对偶,并用 sGS-iADMM 做一次对偶更新,从而保留阶段/场景可并行结构。作者证明三阶段及一般多阶段情形的全局收敛,并以数值实验显示其计算可行性和随结构规模扩展的表现。

Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise Figure 1
2026-06-19math.OC

Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise

Mathieu Laurière, Ariel Neufeld, Kyunghyun Park

Shanghai Center for Data Science, NYU-ECNU Institute of Mathematical Sciences, NYU Shanghai, Division of Mathematical Sciences, Nanyang Technological University

2026-06-19规划控制安全鲁棒

面向含公共噪声的大规模协同控制,论文关注真实公共噪声分布未知时均场控制解易失效的问题。核心做法是在提升到概率测度空间的 Q-learning 中引入 Wasserstein 不确定集,并结合量化投影与对偶重写,使鲁棒 Bellman 更新可计算。文中证明同步和异步算法收敛并给出有限时间迭代界,在系统性风险和流行病模型中展示了噪声错设下的鲁棒性—性能权衡。

Diagonal Hessian Approximation Based on Conjugacy Condition for Noisy Derivative-Free Optimization Problems in High Dimensions Figure 1
2026-06-19math.OC

Diagonal Hessian Approximation Based on Conjugacy Condition for Noisy Derivative-Free Optimization Problems in High Dimensions

Morteza Kimiaei, Saman Babaie--Kafaki

2026-06-19优化算法

本文针对高维含噪无导数优化中 MAES 等方法依赖噪声排序学习缩放信息、在大噪声下易失效的问题,提出用连续归一化重组位移满足共轭性条件来更新对角 Hessian 近似,避免梯度、插值模型和稠密协方差学习。实验显示其在含噪基准上与 MAES 类方法竞争,并在噪声较大时常更高效;增益可能主要来自更稳健、低成本的 scaling。

Optimizing Agricultural Drone Operations: From Launch and Recovery Siting to Tiered Routing Strategies Figure 1
2026-06-19math.OC

Optimizing Agricultural Drone Operations: From Launch and Recovery Siting to Tiered Routing Strategies

Ethan Kolby, Josh Noble, Max Z. Li

University of Michigan, Ethan Kolby 1 1 1 PhD Student, Department of Aerospace Engineering, University of Michigan, Ann Arbor, Michigan 48109.

2026-06-19优化控制

面向农业无人机喷洒中续航短、载荷有限且需现场分钟级规划的痛点,论文将问题建模为覆盖车辆路径规划,并采用“选址—聚类—分层路径”分解框架:用贪心 p-Median 快速替代 MIP 选址,再以 k-means 与局部 CoVRP 求解拼接航线。结果显示选址耗时由 97 秒以上降至 1.2 秒内,服务面积仅降约 4%;6–8 个空间簇可使路径规划提速约一个数量级且覆盖损失较小。

Beyond Averaging in John Ellipsoid Approximation: High-Accuracy Algorithms in the Leverage-Score Model Figure 1
2026-06-19math.OC

Beyond Averaging in John Ellipsoid Approximation: High-Accuracy Algorithms in the Leverage-Score Model

Xiaoyu Li, Junwei Yu, Jiaojiao Jiang, Junbin Gao, Andi Han

University of New South Wales, University of California, Berkeley, University of Sydney

2026-06-19优化控制

本文关注对称多面体 John 椭球近似中杠杆分数算法长期存在的 ε^{-1} 迭代瓶颈,动机是区分计算精度与证书方式的真实代价。核心洞察是把问题等价为 D-最优设计,并证明传统均匀平均证书本身导致 Θ(1/T) 间隙,而非 oracle 或问题固有限制。主要结果给出 last-iterate 加速算法的 O(√κ log(1/ε)) 精度依赖,并在识别最优面后用可由杠杆分数精确恢复 Hessian 的 Newton 阶段达到 O(d² log log(1/ε)) 查询;但最优面识别的无条件界仍未解决。

Optimal Coarse Correlated Equilibria in Mean Field Games: Linear Programming and No-Regret Learning Figure 1
2026-06-19math.OC

Optimal Coarse Correlated Equilibria in Mean Field Games: Linear Programming and No-Regret Learning

Luciano Campi, Federico Cannerozzi, Ioannis Tzouanas

∗ Department of Mathematics “Federigo Enriques”, University of Milan, Via Saldini 50, 20133, Milan, Italy., † Center for Mathematical Economics (IMW), Bielefeld University, Universitätsstrasse 25, 33615, Bielefeld, Germany.

2026-06-19学习理论

本文针对连续时间平均场博弈中粗相关均衡过多、需按外部准则选择的问题,提出“最优 CCE”框架。核心做法是用占用测度建立线性规划表述,把无偏离条件化为外部遗憾约束,并据此设计原始-对偶无遗憾学习算法。主要结果包括最优 LP-CCE 的存在性、与概率表述的对应关系、O(N^{-1/2}) 收敛率,以及数值例子展示其可计算性。

Optimization with inequality constraints by the embedded gradient vector field method Figure 1
2026-06-19math.OC

Optimization with inequality constraints by the embedded gradient vector field method

Petre Birtea, Ioan Casu, Dan Comanescu

Department of Mathematics, West University of Timişoara

2026-06-19优化算法

本文针对含不等式约束的非线性优化,希望用几何方式统一处理 KKT 条件与二阶判别。核心做法是引入二次松弛变量,将可行域提升为扩展空间中的约束流形,并按活跃约束分层,在每个层上用嵌入梯度向量场和 Gram 行列式直接给出乘子与限制 Hessian。主要结果是重构一阶 KKT、给出乘子符号与二阶必要/充分条件,并用双冰淇淋锥例子展示局部极小点如何由几何位置决定。

Stochastic Linear Contextual Bandits with Bounded Noise: A Set-Membership Approach Figure 1
2026-06-19stat.ML

Stochastic Linear Contextual Bandits with Bounded Noise: A Set-Membership Approach

Haonan Xu, Yingying Li

The Grainger College of Engineering, University of Illinois Urbana-Champaign

2026-06-19学习理论

本文针对线性上下文赌博机中实际奖励常有界、而传统次高斯噪声假设未利用这一信息的问题,提出将集合成员估计嵌入 OFU 的 SME-OFU。核心洞察是用有界噪声收缩多面体不确定集,并以凸几何分析其演化;在相应条件下给出实例无关的 O(d^3 log(dT/δ)) 高概率遗憾界,模拟也优于次高斯基线。

A Regularized Nikaido-Isoda Function Approach to Multi-Leader-Follower Games Figure 1
2026-06-19math.OC

A Regularized Nikaido-Isoda Function Approach to Multi-Leader-Follower Games

Atsushi Hori, Takayuki Okuno, Ellen H. Fukuda

Graduate School of Engineering, Nagoya Institute of Technology, Aichi, Japan., Faculty of Science and Technology, Seikei University, Tokyo, Japan., Graduate School of Informatics, Kyoto University, Kyoto 606–8501 , Japan.

2026-06-19优化控制

针对多领导者—跟随者博弈中传统 EPEC/KKT 或响应函数化方法依赖高阶导数、凸性或唯一响应而难扩展的问题,论文引入正则化 Nikaido–Isoda 函数,把原层级博弈近似为带罚项的可微单层纳什均衡问题。主要结果是在全局次解析性等条件下,证明该罚问题的纳什均衡与原问题的领导—跟随者均衡及变分平衡之间的对应关系。

On the Oracle Complexity of Interpolation-Based Gradient Descent Figure 1
2026-06-19cs.LG

On the Oracle Complexity of Interpolation-Based Gradient Descent

Dongmin Lee, William Lu, Anuran Makur

2026-06-19优化算法

本文针对ERM中全梯度计算需随样本数增长而代价高的问题,利用损失函数相对于数据的平滑性来降低梯度查询复杂度。核心做法是PPI-GD:将数据域分块,在等距虚拟点查询一阶oracle并构造张量积多项式插值来近似每轮全梯度。理论上,在强凸与非凸情形下,当数据维度可达O(log^0.49 n)且数据平滑性足够高时,PPI-GD保持与LPI-GD相当的复杂度,并在关键渐近区间优于GD、SGD。

Global Convergence of Gradient Descent for Score Matching in Gaussian Mixtures via Reverse Fisher Divergence Figure 1
2026-06-19cs.LG

Global Convergence of Gradient Descent for Score Matching in Gaussian Mixtures via Reverse Fisher Divergence

Alexander Tyurin

Applied AI Institute, Moscow, Russia, exact or sufficiently accurate score function is available (Chen et al., 2022

2026-06-19优化算法学习理论三维

本文针对传统前向 Fisher 散度在高斯混合 score matching 中易受初始化影响、甚至收敛到错误分布的问题,改用以学生分布取期望的反向 Fisher 散度,并用 Lyapunov 动力学解释其更稳定的优化景观。主要结果是证明梯度下降在单高斯教师下可从任意初始化全局收敛,在多高斯教师下经大球面随机初始化和目标均值分离条件,也能高概率使学生分量收敛到最近目标模态,并给出总变差收敛条件。

Semiglobal Input-Delay Tolerance Algorithm for Distributed Nonconvex Optimization of Networked Nonlinear Systems Figure 1
2026-06-19math.OC

Semiglobal Input-Delay Tolerance Algorithm for Distributed Nonconvex Optimization of Networked Nonlinear Systems

Jing-Zhe Xu, Zhi-Wei Liu, Ming-Feng Ge, Yan-Wu Wang, Dinxin He

2026-06-19优化算法

面向机器人网络、智能电网等实际系统中决策变量就是非线性节点状态且存在执行输入延迟的场景,论文指出传统分布式优化难以同时保证约束一致性、稳定调节与最优收敛。其核心是提出输入延迟容忍的半全局收敛概念,并用分层控制与ISS分析构造SIDT算法;在延迟上界与初值紧集相关的条件下,可使状态保持/回到共识约束并趋近受约束最优解,且将强凸假设放宽到P–Ł非凸情形。

Dynamic Core Allocation for Malleable Jobs with Unknown Speed-up Parameters Figure 1
2026-06-19math.OC

Dynamic Core Allocation for Malleable Jobs with Unknown Speed-up Parameters

S.A. Bodas, J.L. Dorsman, M. Mandjes, L. Ravner

2026-06-19优化控制

面向多核/GPU云计算中可动态调整并行度的作业调度,论文针对不同作业类的加速函数参数未知这一现实问题,将排队系统的最大似然估计与MDP核心分配策略迭代结合:先由状态相关离开间隔估计加速参数,再更新类间容量分配。主要结果是证明固定策略下估计量强一致,并用数值实验展示学习控制算法可逐步接近低平均响应时间策略。

Signature Methods for Optimal Market Making Figure 1
2026-06-19math.OC

Signature Methods for Optimal Market Making

Alberto Gennaro, Thibaut Mastrolia, Francesca Primavera

Alberto GENNARO 1 1 1 Department of Industrial Engineering and Operations Research, UC Berkeley, USA., Thibaut MASTROLIA 2 2 2 Department of Industrial Engineering and Operations Research, UC Berkeley, USA.

2026-06-19优化控制

本文针对传统做市模型过度依赖参数假设、而强化学习又缺少稳定收敛保证的问题,引入路径签名来表示含跳跃订单流的历史信息,将均值-方差最优做市转化为基于增强市场路径期望签名的伪线性优化,并用 Sig-REINFORCE 学习买卖报价。实验在 Poisson 与 Hawkes 到达过程下与 PPO 比较,表明该方法可处理路径依赖和自激订单流,但具体性能增益幅度与来源在片段中未充分说明。

DeQL: A Decision Query Language for Prescriptive Analytics over Relational Data Figure 1
2026-06-19cs.DB

DeQL: A Decision Query Language for Prescriptive Analytics over Relational Data

Matteo Brucato, Fjodor Kholodkov, Soren Little, Jakob Mayer, Duc Nguyen

2026-06-19优化控制

本文面向 SQL 难以直接表达“该做什么”的处方分析问题,提出 DeQL 作为关系数据上的决策查询语言。其核心是在 SQL 中加入 CREATE CANDIDATES 与 DECIDE,用关系方式声明候选项、决策变量、约束和目标,并保持问题结构供引擎选择求解方法。论文主要给出语言规范、语法、执行模型及选择、分配、调度等示例,尚非系统性实验评测,实际性能收益文中未充分说明。

Stochastic Representations of Stationary HJBI-Type Variational Inequalities with Bilateral Constraints Figure 1
2026-06-19math.OC

Stochastic Representations of Stationary HJBI-Type Variational Inequalities with Bilateral Constraints

Sheng Huang, Qingmeng Wei

Sheng Huang 2 2 2 School of Mathematics and Statistics, Northeast Normal University, Changchun 130024, P. R. China, Qingmeng Wei 3 3 3 Corresponding author. School of Mathematics and Statistics, Northeast Normal University, Changchun 130024, P. R. China

2026-06-19优化算法

针对带双侧障碍约束的平稳 HJBI 变分不等式缺乏成熟 BSDE 概率表示的问题,本文从无限时域零和随机微分博弈出发,提出增广控制空间与混合控制—停止两种互补表述。核心洞察是将上下障碍分别编码为停止符号或玩家停止决策,并证明相应价值函数与唯一有界黏性解一致。

A Unified Framework for Joint Sensor Placement and Scheduling for Intrusion Detection Figure 1
2026-06-19eess.SY

A Unified Framework for Joint Sensor Placement and Scheduling for Intrusion Detection

Jayanth Bhargav, Mahsa Ghasemi, Shreyas Sundaram

2026-06-19视觉感知

针对入侵检测中传感器“放在哪”和“朝哪看”相互耦合、且对手会利用固定盲区的问题,论文把部署建模为外层弱次模优化,把给定部署下的朝向调度建模为零和博弈,并用乘法权重近似纳什均衡值作为部署效用。理论上给出收敛与近似最优保证,仿真显示在接近最优检测性能下,相比集中式 LP 显著降低计算量。

Learning Neural Maximal Lyapunov Functions on $\mathsf{SO}(n)$ Figure 1
2026-06-19math.OC

Learning Neural Maximal Lyapunov Functions on $\mathsf{SO}(n)$

Adeel Akhtar, Matthieu Barreau

2026-06-19优化控制

本文针对旋转群 SO(n) 上动力系统难以直接套用欧氏 Lyapunov 方法、最大吸引域难估计的问题,提出基于对数映射的神经最大 Lyapunov 函数框架,并用 Zubov 型 PDE 约束学习吸引域。核心在于证明该结构的逼近能力,推导对数映射导数的可计算公式,并以级数近似加精确计算的两阶段训练降低成本。实验仅在低维非线性系统上验证可恢复最大吸引域,扩展到更高维 Lie 群的效果文中未充分说明。

Counterexample to a conjecture on the pairwise independent correlation gap using AI Figure 1
2026-06-19math.OC

Counterexample to a conjecture on the pairwise independent correlation gap using AI

Arjun Ramachandra, Karthik Natarajan

2026-06-19优化控制

本文针对“成对独立相关间隙”是否对所有非负单调子模函数均不超过 4/3 的猜想,构造了一个由 GPT5.5 Pro 辅助发现的反例。核心洞察是用五元素覆盖函数和特定边际概率,使凹闭包可达 4,同时通过线性规划对偶证书将成对独立扩展上界压到 479/160,从而得到比值 640/479>4/3,否定该猜想,并留下 n=4 情形及更高维最紧界问题。

Mean-Field Control with a Common Hidden State under Decentralized Observations Figure 1
2026-06-19math.OC

Mean-Field Control with a Common Hidden State under Decentralized Observations

Erhan Bayraktar, Ali D. Kara

E. Bayraktar is with the Department of Mathematics

2026-06-19规划控制

面向大量智能体在只能获得局部噪声观测时协同控制同一隐藏状态的难题,本文研究动作仅通过经验分布影响动力学与代价的均场团队控制。核心洞察是无限智能体极限可化为策略空间上的确定性测度值控制,并需对动作随机化但无需混合策略;进一步给出动态规划递推,证明由极限问题得到的对称策略在有限群体中近似最优,误差随智能体数按 1/√N 衰减但随策略记忆长度指数增长。

On the Limits of Biased Derivative Information for Nonconvex Stochastic Optimization Figure 1
2026-06-19math.OC

On the Limits of Biased Derivative Information for Nonconvex Stochastic Optimization

Anant Shyam, Brian Bullins

Purdue University

2026-06-19优化算法

本文关注非凸随机优化中导数估计同时含噪声与偏差时,寻找近似驻点究竟需要多少 oracle 查询。核心贡献是给出一阶偏差梯度的匹配下界,并推广到高阶导数 oracle;同时构造基于信赖域、高阶 Taylor 模型与方差缩减的算法。结果表明,一阶已有上界是紧的,在低偏差区间高阶方法可匹配下界,而常数偏差下高阶方差缩减可将复杂度由约 O(ε^-3) 改进到 O(ε^-2)。

Interactive Pareto navigation for deep multi-task learning Figure 1
2026-06-19cs.LG

Interactive Pareto navigation for deep multi-task learning

Augustina C. Amakor, Konstantin Sonntag, Sebastian Peitz

2026-06-19机器人

这篇论文针对深度多任务学习中目标增多后,完整搜索 Pareto 前沿计算昂贵、人工选择权重又难以表达真实偏好的问题,提出 Preference Pareto Exploration:把决策者偏好转化为沿 Pareto 流形的交互式导航方向,并用预测—校正框架更新折中解;为避免显式 Hessian,采用仅需矩阵向量积的 Krylov 子空间方法。实验在玩具问题和深度学习任务上展示了该方法能按偏好移动并降低探索成本,但具体相对基线收益幅度文中片段未充分说明。

A land of monotone plenty, bis repetita: from classical to weak optimal transport Figure 1
2026-06-19math.OC

A land of monotone plenty, bis repetita: from classical to weak optimal transport

Virginie Ehrlacher, Rodrigue Lelotte, Luca Nenna

Université Paris-Saclay, CNRS, Laboratoire de mathématiques d’Orsay, ParMA, Inria Saclay, 91405, Orsay, France & Institut Universitaire de France (I.U.F.)

2026-06-19优化控制

本文针对最优传输中循环单调性为何刻画最优解这一基础问题,提出从可行扰动锥上的最优性条件来重新理解:经典情形对应线性成本的零阶非负性,弱最优传输则对应成本线性化后的一阶非负性。核心创新是定义能真正退化为经典 c-循环单调性的 C-循环单调性,并在适当可测、可积与凸性假设下证明其与经典及弱最优传输计划的最优性等价。

Neural Architectures as Functional Priors in Physics-Informed Control Problems Figure 1
2026-06-19math.NA

Neural Architectures as Functional Priors in Physics-Informed Control Problems

Sonia Rubio Herranz, Fernando Carlos López Hernández, Antonio López Montes

2026-06-19规划控制

本文关注 PINN 控制中神经架构是否只是近似器,还是会偏置可行控制的选择。作者在 RLC 电路与 Duffing 振子上分离状态与控制网络,比较 MLP 与 Fourier/KAN-like 结构,发现即使方程、损失和训练设置相同,不同架构也会产生频谱、平滑性、能量分布和相空间轨迹差异;Fourier 更偏振荡,MLP 更平滑节能,提示架构选择本身是控制建模决策。

2026-06-18

22 篇
Sparse-dense flight copy-based interactive mechanism to airline integrated with cruise speed control Figure 1
2026-06-18math.OC

Sparse-dense flight copy-based interactive mechanism to airline integrated with cruise speed control

Jiajin Lin, Jianlin Jiang, Yan Gu, Yuzhen Guo, Cheng-Lung Wu

School of Information Engineering, Taizhou Vocational College of Science and Technology, School of Mathematics, Nanjing University of Aeronautics and Astronautics, School of Aviation, University of New South Wales

2026-06-18强化学习规划控制

针对航班扰动恢复中航班调整、飞机改派与旅客重分配相互耦合,而顺序处理易抬高成本的问题,本文在考虑巡航速度控制的同时提出稀疏—密集航班副本交互机制:在稀疏网络上做航班重排与飞机路径,在密集网络上做时刻微调与旅客分配,并用定制 Benders 分解、列生成及可行性证书等加速求解。真实数据实验显示该方法优于传统航班副本建模,并能在合理时间内得到高质量集成恢复方案。

Projected Stochastic Gradient Descent with Decision Dependent Distributions: Extended Version Figure 1
2026-06-18math.OC

Projected Stochastic Gradient Descent with Decision Dependent Distributions: Extended Version

Caio Kalil Lauand, Emiliano Dall'Anese

∗C. K. Lauand is with the Division of Systems Engineering, Boston University, Boston, MA, USA. E. Dall’Anese is with, the Department of Electrical and Computer Engineering and the Division of Systems Engineering, Boston University, Boston, at Boston University and by the National Science Foundation Award 2504084.

2026-06-18优化算法

面向网络化系统在线控制中模型、扰动未知且随机参数分布会随控制决策改变的问题,本文将在线反馈优化扩展到带约束的决策依赖随机优化。核心做法是跟踪“performatively stable”鞍点,并用替代对偶约束集实现投影原始-对偶SGD。主要结果给出均方跟踪误差上界,将误差分解为随机性、测量误差、时变性和替代对偶集失配四项,并在含价格响应资产的电网算例中验证。

Sequential Fair Allocation and Routing in Nonprofit Operations Figure 1
2026-06-18math.OC

Sequential Fair Allocation and Routing in Nonprofit Operations

Haiqing Gao, Seyed M.R. Iravani, Sean R. Sinclair

Department of Industrial Engineering and Management Sciences, Northwestern University, Evanston, IL 60208

2026-06-18优化控制

本文面向食物银行、救灾等非营利场景中需求逐站揭示、资源有限且路线可调的分配问题,研究公平与效率如何共同优化。核心创新是把访问顺序纳入序贯公平分配的动态规划,并比较 Ex-Post 与 Forward 两类 max-min 替代目标;理论上证明固定路线下最优分配具有阈值结构,并给出按需求变异系数递减访问的最优性条件。数值实验显示,不同公平目标改善的指标并不一致:Ex-Post 更适合一次性救援,Forward 更适合周期性配送。

Compute Efficiency and Serial Runtime Tradeoffs for Stochastic Momentum Methods Figure 1
2026-06-18cs.LG

Compute Efficiency and Serial Runtime Tradeoffs for Stochastic Momentum Methods

Depen Morwani, Alexandru Meterez, Pranav Nair, Sham Kakade

Harvard University, Kempner Institute at Harvard University

2026-06-18优化控制

针对大规模训练中“动量是否既省算力又缩短串行时间”的问题,本文在高斯线性回归中分析批大小对随机 HB 与 ASGD 的影响。核心洞察是区分计算效率与串行运行时间:HB 不提升相对 SGD 的计算效率前沿,只把保持同等效率的批大小窗口扩展到约 √κ 倍,从而更早获得确定性加速;ASGD 在快速衰减谱上小批量更省算力,但随批量增大需用效率换取更短串行时间。

Single-loop approaches to nonsmooth bilevel optimisation Figure 1
2026-06-18math.OC

Single-loop approaches to nonsmooth bilevel optimisation

Ensio Suonperä, Tuomo Valkonen

This research has been supported by the Academy of Finland grants 314701, 320022, and 345486, and the Vilho, Yrjö and, †MODEMAT Research Center in Mathematical Modeling and Optimization, Quito, Ecuador and Department of Mathe-, differentiability almost everywhere in ℝ𝑛. However, those tools are not available in our infinite

2026-06-18优化控制

针对非光滑双层优化中内层问题常为集合值约束、且反复精确求解代价高的问题,本文用 Fréchet 与 limiting 余导数建立乐观/悲观微分规则和非光滑伴随包含,弱化传统光滑性与二阶增长假设到度量次正则性,并据此构造可嵌入原始-对偶内层与伴随步的单循环算法。文中证明了收敛性,并在全变差正则化反问题上展示该框架的可用性。

Locally Stable Neural ODEs with Characterized Region of Attraction Figure 1
2026-06-18math.OC

Locally Stable Neural ODEs with Characterized Region of Attraction

Alice Harting, Karl Henrik Johansson, Sophie Tarbouriech, Matthieu Barreau

2026-06-18优化控制

针对普通 Neural ODE 从轨迹拟合稳定系统时难以继承局部稳定性、且吸引域需事后认证的问题,论文将模型向量场硬约束在联合学习的极大 Lyapunov 函数梯度场下,使其 1-子水平集精确给出模型 ROA。理论上证明可任意逼近 ROA 内指数稳定动力学,并在一定条件下无监督逼近真实吸引域;实验覆盖非凸 ROA 的非线性系统。

First-Order Methods for Solving Convex (Strongly) Concave Minimax Problems with Functional Constraints Figure 1
2026-06-18math.OC

First-Order Methods for Solving Convex (Strongly) Concave Minimax Problems with Functional Constraints

Yangyang Xu, Xinhao Ying

Department of Mathematical Sciences, Rensselaer Polytechnic Institute, Troy, NY 12180 USA

2026-06-18优化算法

本文针对带函数约束的凸—凹/强凹极小极大问题,动机是现有一阶法多依赖无约束或易投影结构,难处理公平 AUC、鲁棒投资等约束场景。核心做法是用强对偶把内层约束并入目标,并在近端增广拉格朗日框架中用含非精确梯度的加速近端梯度解子问题。结果证明可得到 ε-KKT 与原始 ε-最优解,强凹情形复杂度为 Õ(ε⁻¹),一般凹情形对偶部分升至 Õ(ε⁻³ᐟ²)。

Local Exact Controllability of Landau-Lifshitz-Gilbert Equation Figure 1
2026-06-18math.AP

Local Exact Controllability of Landau-Lifshitz-Gilbert Equation

Chunxi Jiao, Ho Man Tai

School of Mathematics and Statistics, UNSW Sydney, NSW 2052, Australia, School of Mathematics and Statistics, University of Sydney, Sydney, NSW 2006, Australia

2026-06-18规划控制

本文面向微磁学中用局部外磁场精确调控磁化方向的问题,研究二维环面上交换能 Landau–Lifshitz–Gilbert 方程的可控性。核心做法是用立体投影将球值几何方程化为拟线性抛物系统,并针对线性化伴随算子的自伴/斜自伴结构建立 Carleman 估计,再结合可观测性、L∞零可控和 Kakutani 不动点。主要结果是在初始能量足够小时,可在任意终端时间将系统精确导向邻近无控轨道终值,并在半球条件下给出半全局可控性。

Optimal Consumption and Retirement Time under Shortfall Risk Measure Figure 1
2026-06-18math.OC

Optimal Consumption and Retirement Time under Shortfall Risk Measure

Lijun Bo, Yijie Huang, Tingting Zhang

School of Mathematical Sciences, University of Science and Technology of China, Hefei, China, Department of Applied Mathematics, The Hong Kong Polytechnic University, Kowloon, Hong Kong, China, Center for Financial Engineering, Soochow University, Suzhou, China, Shortfall management costs, labor income, and leisure preference significantly influence retirement timing, to incorporate various real-world economic frictions, including stochastic labor income, transac-, the investor’s intricate trade-off between the utility increment from labor supply and the leisure

2026-06-18安全鲁棒

面向个人投资者在生命周期中既追求消费效用又需控制相对基准最大财富缺口的问题,本文把投资、消费与内生退休统一为含最优停止的随机控制模型。核心做法是引入反射辅助状态并用凸对偶将原非线性问题化为二维最优停止,从而刻画财富—基准依赖的退休边界。结果显示策略呈就业/退休两阶段结构,退休后投资更保守,短缺风险随财富呈 U 形,短缺成本、劳动收入、休闲偏好和基准强度显著改变退休时点与配置。

Riemannian Metric Preconditioning for Trajectory Tracking Figure 1
2026-06-18math.MG

Riemannian Metric Preconditioning for Trajectory Tracking

Jacob R. Goodman, Hajg Jasa

Department of Mathematical Sciences, Norwegian University of Science and Technology

2026-06-18视觉感知规划控制

面向流形和李群上机器人/刚体系统的轨迹跟踪,论文认为度量可作为闭环行为设计变量而非仅是建模选择。其核心是提出秩一“奖励度量”,降低沿给定向量场运动的代价,并推导完备性条件与 Levi-Civita 连接差分,将其作为内禀 PD 控制的预条件修正项。在 SE(3) 迷宫导航仿真中,当参考轨迹接近该向量场积分曲线时跟踪改善;但效果依赖向量场局部性质,安全保证仍未充分说明。

A Generalized Sasaki Metric on the Second-Order Tangent Bundle Figure 1
2026-06-18math.MG

A Generalized Sasaki Metric on the Second-Order Tangent Bundle

Margarida Camarinha, Jacob R. Goodman

2026-06-18优化控制

针对带执行器内部动态的机械系统难以仅用二阶模型刻画、且高阶状态空间缺少自然度量的问题,论文从基流形线性连接出发,在二阶切丛上构造连接映射并定义广义 Sasaki 度量,推导测地线与受 jet 约束变分问题,得到带张力的 Riemannian 五次曲线;在 SO(3) 刚体姿态模型中,数值结果显示相较 Riemannian 三次曲线可略降执行器相关代价且跟踪性能相近。

A Finite-Gain Stability Approach to NMPC Design: the Extended Version Figure 1
2026-06-18eess.SY

A Finite-Gain Stability Approach to NMPC Design: the Extended Version

Carlo Novara, Mattia Boggio, Lorenzo Calogero, Michele Pagone

2026-06-18规划控制

针对未知有界扰动和时变参考下传统 Lyapunov 型 NMPC 稳定性设计难以给出可操作调参准则的问题,论文以有限增益稳定性为核心,推导闭环跟踪误差界,并将其转化为离线场景化选择预测时域与代价权重的方法。仿真在自动驾驶横纵向控制、车道保持和避障任务中验证了所选配置可兼顾跟踪精度与稳定性。

Analyzing changes in optimal variables in linear programming with uncertain parameters Figure 1
2026-06-18math.OC

Analyzing changes in optimal variables in linear programming with uncertain parameters

Baptiste Istace, Guillaume Derval, Bardhyl Miftari, Quentin Louveaux

University of Liège, Montefiore Institute, Belgium, revenues, deadlines, and available resources. The solution obtained is optimal only with

2026-06-18优化控制

面对成本、需求、容量等参数不确定时,线性规划的最优目标值变化并不足以指导决策,本文转而刻画最优变量集合随单参数线性扰动的变化。作者分别分析目标系数、右端项和约束矩阵扰动,并用线性准则选择代表性最优/近最优解,揭示原始—对偶在连续性上的不对称:扰动 c 时原始选择可不连续但 ε 近最优可恢复连续,扰动 b 时性质对调;扰动 A 则更复杂,值函数可分段有理且可能不连续。

Sub-optimal control by primal-dual gradient dynamics Figure 1
2026-06-18math.OC

Sub-optimal control by primal-dual gradient dynamics

Arjan van der Schaft

∗A.J. van der Schaft is with the Bernoulli Institute for Mathematics, Computer Science, and Artificial Intelligence, Jan C. Willems Center for Systems and Control, University of

2026-06-18规划控制优化算法

本文面向降低最优控制/MPC计算负担与分析互联系统稳定性的需求,将连续时间原始-对偶梯度动力学从静态凸优化推广到线性动力学、凸代价的最优控制。核心洞察是把物理时间与算法时间共同纳入PDE,并揭示其双重端口-Hamilton结构。文中表明其平衡对应Pontryagin最优解,并用移位Hamilton量指示收敛;但尚无数值实验,子最优控制策略仍主要是研究方向。

A Theory-Guided Advanced Regulatory Control Synthesis for Cooling-Limited Exothermic Semi-Batch Reactors Figure 1
2026-06-18eess.SY

A Theory-Guided Advanced Regulatory Control Synthesis for Cooling-Limited Exothermic Semi-Batch Reactors

Chenchen Zhou, Jose Matias

2026-06-18规划控制学习理论

针对放热半批反应器在冷却能力受限时需贴近热边界以提高产率、但传统ARC架构选择和整定多依赖经验的问题,论文用有限时域最短时间最优性刻画“寻边界”运行,并将其转化为冷却需求阀位控制架构及近边界安全整定规则。在简化基准和工业聚合案例中,该ARC名义性能接近带EKF的OF-NMPC;在不利参数失配和未建模故障下保持温度越限为0%,而NMPC出现越限或批次失败。

Two-Phase Bilevel Search for the Moving-Target Traveling Salesman Problem with Moving Obstacles Figure 1
2026-06-18cs.RO

Two-Phase Bilevel Search for the Moving-Target Traveling Salesman Problem with Moving Obstacles

Allen George Philip, Anoop Bhat, Sivakumar Rathinam, Howie Choset

Mechanical Engineering, Texas A&M University, College Station, TX 77843-3123.

2026-06-18优化控制

本文面向带时间窗的移动目标巡回访问在动态障碍环境中的路径规划难题,动机是现有 MT-TSP 多忽略障碍运动而可行性本身已很难。作者提出可由通用求解器处理的 MICP,并设计两阶段双层搜索:上层在采样目标图上解 GTSP,下层用直线检测与时空图 DFS 验证避障边。实验覆盖最多 40 个目标和 40 个障碍,相比既有基线在成功率、代价和运行时间上均明显更好。

Fast primal-dual methods for convex-concave bilinear saddle point problems: continuous-time dynamics and discrete algorithms Figure 1
2026-06-18math.OC

Fast primal-dual methods for convex-concave bilinear saddle point problems: continuous-time dynamics and discrete algorithms

Xin He, Ya-Ping Fang

School of Science, Xihua University, Chengdu, China.

2026-06-18优化算法

针对一般凸–凹双线性鞍点问题中惯性加速与斜对称耦合难以同时控制、传统方法多停留在较慢或遍历收敛的瓶颈,本文从连续时间 Lyapunov 结构出发设计保结构离散化的 Nesterov 型原始–对偶算法。核心在于让连续动力系统与离散能量共同保留耦合项抵消机制,从而在无需强凸性的条件下证明轨迹/迭代收敛,并获得鞍点间隙 O(1/t²)、非临界情形下 gap 与残差的更强 little-o 渐近速率。

Fair Online Resource Allocation Figure 1
2026-06-18cs.DS

Fair Online Resource Allocation

Christopher En, Yuri Faenza, Andrea Lodi, Gonzalo Muñoz

Columbia University, IEOR Department

2026-06-18优化控制

面向难民安置、航班调度等顺序到达且容量受限的分配场景,论文关注效用最大化与“相似个体应获相似期望结果”的冲突。其核心是把批内 Lipschitz 个体公平约束纳入在线资源分配,并用对偶镜像下降同时学习影子价格与执行公平彩票分配。理论上给出离线公平代价 Ω(1/γ) 下界,并证明常数批大小下相对流体基准的 O(√T) 期望遗憾;难民数据实验显示公平约束下仍接近离线最优。

Comparing Deterministic and Stochastic Parameter Recovery Algorithms Applied to Chaotic Systems Figure 1
2026-06-18nlin.CD

Comparing Deterministic and Stochastic Parameter Recovery Algorithms Applied to Chaotic Systems

Ashley Wang, Elizabeth Carlson, Franca Hoffman

2026-06-18优化控制

针对含噪混沌系统中物理参数难以可靠恢复的问题,论文在 Lorenz ’63 与多尺度 Lorenz ’96 合成数据上系统比较 AOT 类确定性同化/参数恢复与 EnKF、PF、ETKF、EM、EnKI 等随机方法。核心洞察是,依赖动力学结构的 PWM、AV 等确定性方法在多数噪声水平下精度、稳定性和计算效率更优;随机方法对噪声变化更平滑,但未必更准。

Stability of Slow-Fast Nonlinear Dynamics: Non-Periodic Case Figure 1
2026-06-18eess.SY

Stability of Slow-Fast Nonlinear Dynamics: Non-Periodic Case

G. Q. Bao Tran, Daniel Liberzon, Hyungbo Shim

∗Coordinated Science Laboratory, University of Illinois, ∗∗ASRI, Department of Electrical and Computer Engineering, Seoul

2026-06-18优化控制

针对含慢变与快变扰动的非线性系统,已有稳定性结果多依赖快变周期性或不允许慢变量跳变,限制了切换系统等应用。本文用一般平均处理非周期快变信号,并允许慢变信号在总变差有界下不连续;在平均系统冻结慢变量时全局指数稳定、且存在共同平衡点的条件下,证明原系统半全局指数稳定,并以慢快非周期切换系统作示例。

Intermediate Bilevel Optimization: Modeling Endogenous Follower Tie-Breaking Behavior Figure 1
2026-06-18math.OC

Intermediate Bilevel Optimization: Modeling Endogenous Follower Tie-Breaking Behavior

Maria Bazotte, Margarida Carvalho, Thibaut Vidal

when available. Furthermore, experiments stress the critical need to accurately model follower tie-breaking behavior, particularly

2026-06-18优化算法

论文针对双层优化中追随者多最优解时仅用乐观/悲观打破平局过于极端的问题,将追随者响应建模为受领导者决策影响的内生随机事件。核心创新是定义内生概率测度,并通过逆变换与马尔可夫链变换把问题转为外生不确定的 T-I-BO,再用 SAA 求解。实验显示在二分测度情形下较确定性等价模型平均快 1.8 倍且解质更好,同时说明错误刻画追随者行为会导致领导者决策显著次优。

Sequential Hiring of Contingent Workers Through Learning-Based Optimization Figure 1
2026-06-18math.OC

Sequential Hiring of Contingent Workers Through Learning-Based Optimization

Chris Lee, Xiuli Chao, Izak Duenyas

Department of Industrial and Operations Engineering, University of Michigan, Ross School of Business

2026-06-18优化算法

论文关注零工/临时用工中企业需在生产率未知、替换有成本且新工人到岗存在随机延迟时持续维持固定规模团队的问题。作者将其建模为带切换成本和内生随机可用性的多臂 bandit,提出按学习周期运行的 DR-UCB,在何时换人、换谁和候选配对之间自适应权衡探索与收益。理论上给出与下界同阶的主导 regret 依赖,数值实验显示其优于若干基线策略。

2026-06-17

30 篇
Finite-Time Queue Peak Laws in Stochastic Networks: Logarithmic Scaling After Geometric Thresholds Figure 1
2026-06-17math.PR

Finite-Time Queue Peak Laws in Stochastic Networks: Logarithmic Scaling After Geometric Thresholds

Hao Liang, Cheng Tang, Yunzong Xu

University of Illinois Urbana–Champaign, state-space collapse is available, the threshold can be sharpened using local bottleneck geometry.

2026-06-17优化控制

面向云计算、推理平台和交换网络中有限时间内的队列峰值风险,论文研究非平稳且可依赖历史的到达过程下,共享服务资源如何避免短时拥塞。核心洞察是内部容量余量会改变峰值规律:MaxWeight 通过方向自归一化,使几何因素只进入进入阈值,而不进入对数增长系数。主要结果给出从初期 √T 包络到阈值后 log T 增长的两阶段上界,并以策略无关下界说明对数项和几何阈值基本不可避免。

Ergodic Deviation-Robust Equilibrium under Mirror Descent Learning in Finite Games Figure 1
2026-06-17cs.GT

Ergodic Deviation-Robust Equilibrium under Mirror Descent Learning in Finite Games

Joshua Steier

2026-06-17安全鲁棒

针对重复有限博弈中纳什均衡只给静态保证、无遗憾学习又难以选出单一乘积分布均衡的问题,论文提出相对于熵镜像下降轨迹定义的 EDRE,将近似纳什、全路径联盟偏差收益次线性界和动力学不动点选择绑定。主要证明偏差遗憾的高概率 \tilde O(√T) 界且阶紧,在精确势博弈给出存在性、Lyapunov 单调与收敛条件,并扩展到单调 polymatrix 博弈,同时说明一般计算为 PPAD-hard。

An algorithm to exactly compute minimal upper bounds in the Loewner order Figure 1
2026-06-17math.FA

An algorithm to exactly compute minimal upper bounds in the Loewner order

Adam Humeniuk, Gabriel Jarry-Bolduc, Patrick Pascua, Nejaunie Williams

Department of Mathematics and Computing, Mount Royal University, Department of Mathematics and Statistics, American University of Sharjah

2026-06-17学习理论

Loewner序下多个Hermitian矩阵通常不存在唯一最小上界,给优化、控制和量子信息中的矩阵比较带来计算困难。本文基于Stott的核空间极小性刻画,提出从任意上界出发的迭代算法,逐步下降到一个极小上界;证明算法对任意有限个n×n矩阵至多n步终止且结果精确,并给出示例与Python实现,也可通过取负计算极大下界。

Flocking and Mean-Field Analysis of Delayed Leader-Follower Cucker-Smale System Figure 1
2026-06-17math.AP

Flocking and Mean-Field Analysis of Delayed Leader-Follower Cucker-Smale System

Chiara Cicolani

2026-06-17优化控制

面向多智能体/机器人群体中通信、感知与决策存在时滞的现实问题,本文研究带领导者-跟随者结构的二阶 Cucker-Smale 集群模型。核心在于把固定时滞推广为分布式记忆核,并同时处理异质领导影响与速度-位置耦合;文中给出粒子系统渐近集群的充分条件,证明速度对齐和空间有界性,并在固定领导者及全体规模趋于无穷两种平均场极限下建立测度解的全局存在唯一性与 Wasserstein 稳定性。

PepsiCo Deploys AI-Driven Pricing and Promotion Optimization at Scale Figure 1
2026-06-17math.OC

PepsiCo Deploys AI-Driven Pricing and Promotion Optimization at Scale

Aleix Llenas, Eduardo Salazar-Treviño, Francisco Leskovar, Francesc Pons-Llopis, Federico Todeschini, Deepika Gowda, David Bofill, Laxmi Anish, Michael Cleavinger

2026-06-17优化算法

面对百事在多市场、多渠道下促销排期与基础定价难以靠人工统一优化的问题,论文介绍已部署的 PromoAI 与 PricingAI:前者将 LightGBM 促销需求预测嵌入 MILP 日历优化,后者用贝叶斯层级模型估计自/交叉价格弹性并接非线性优化。主要结果是系统能在大规模组合和可配置业务约束下生成企业级决策建议,但具体财务增益文中未充分说明。

Kalman structure and observability for transport systems Figure 1
2026-06-17math.OC

Kalman structure and observability for transport systems

Yacouba Simpore

2026-06-17优化控制

本文针对实线上常系数一阶双曲输运系统在仅部分观测/控制时的可观测性退化问题,指出即使满足 Kalman 秩条件,标准 L2 估计也会因低频间接可见分量而失效。核心洞察是按 Kalman 层级刻画频率损失:深度 k 的分量以 |ξ|^{2k} 权重被观测,从而构造适配空间。文中进一步给出全空间及有界间隙局部观测结果,并扩展到含 Jordan 块的实谱情形。

Koopman Lifting with Certified Error Bounds for Joint Inference in Nonlinear Networks Figure 1
2026-06-17math.OC

Koopman Lifting with Certified Error Bounds for Joint Inference in Nonlinear Networks

Chuansen Peng, Xiaojing Shen, Yunmin Zhu

College, University, require large labeled training datasets, which may be, unavailable in scientific or engineering settings with few

2026-06-17学习理论

面向多机器人、车队、电网等非线性网络中状态不可全观测且拓扑未知/时变的问题,论文提出 Koopman-GKFA:用节点可分字典将非线性动力学提升为近似线性系统,并以块稀疏 ADMM 联合卡尔曼滤波实现在线状态与拓扑估计。其关键在于证明提升算子的块稀疏性对应原图结构,并给出 ADMM 线性收敛与三项 MSE 误差界;实验显示在合成和真实数据上优于若干基线。

Optimizing the Principal Coefficient of Elliptic Equations using $L^p$-regularity, $p < \infty$ Figure 1
2026-06-17math.OC

Optimizing the Principal Coefficient of Elliptic Equations using $L^p$-regularity, $p < \infty$

Ala' Alalabi, Lorena Bociu, Paul Manns

Ala’ Alalabi1, Lorena Bociu1, and Paul Manns2, Department of Mathematics, NC State University, North Carolina, USA, Department of Mathematics, TU Dortmund University, Dortmund, Germany, following the seminal work of Gr¨oger [11], improved W 1,s-regularity theory for s > 2 is available

2026-06-17优化控制

本文针对椭圆型 PDE 系数识别中传统依赖 L∞ 控制到状态正则性、不利于数值算法全局收敛分析的问题,利用 Gröger 型 W^{1,s} 正则性把可微性推进到有限 q 的 Lq 范数框架。文中建立约化目标的一、二阶可微性、含 TV 半范数受限次微分与盒约束乘子的最优性条件,并证明基于 Lr 信赖域的非光滑算法收敛到一阶驻点。

A Bilevel Optimization Model for Bottom-Up Coordination of Multiple Low-Voltage Energy Communities and the Medium-Voltage Network Figure 1
2026-06-17math.OC

A Bilevel Optimization Model for Bottom-Up Coordination of Multiple Low-Voltage Energy Communities and the Medium-Voltage Network

Fernando García-Muñoz, Sebastián Dávila, Luis Rojo-González, Cristian Duran-Mateluna

aUniversity of Santiago of Chile (USACH), Faculty of Engineering, Industrial Engineering Department, Chile, bUniversity of Santiago of Chile (USACH), Faculty of Engineering, Program for the Development of Sustainable Production

2026-06-17优化算法

针对低压能源社区中光伏、储能等分布式资源增多后与中压网协调困难的问题,论文将多低压社区聚合为 Stackelberg 上层、由中压网经济调度响应,形成自下而上的双层模型,并用 KKT 精确单层化及 LDD-ADMM 并行协调以保护隐私。IEEE 33 节点与 6 个低压馈线实验中,分布式算法与精确解平均相对偏差约 1.7×10^-4,同时显示上层决策可能抬高中压侧成本。

Description of the set of admissible piecewise linear routes with n turns in the three dimensional case Figure 1
2026-06-17math.OC

Description of the set of admissible piecewise linear routes with n turns in the three dimensional case

Nefedov V.N

2026-06-17优化控制

本文面向三维空间中受转角上界和转弯次数约束的折线路径规划,动机是为离散枚举、连续近似及含路段/转弯代价的优化提供可判定可行域。核心洞察是用“球面环面”和角扇区刻画内顶点可达集合,并给出类似动态规划的逐点选择公式。主要结果证明在 nφ≤π 条件下所有可行内点的范围及任意首点的可构造性,进而显式描述全部 admissible 顶点序列,可支撑离散情形精确优化和连续情形近似求解。

Operator Learning for PDE Backstepping Control of Parabolic Equations on Time-Varying Domains Figure 1
2026-06-17math.OC

Operator Learning for PDE Backstepping Control of Parabolic Equations on Time-Varying Domains

Jinrun Yan, Kai Liu, Zhong-Jie Han

School of Mathematics and KL-AAGDM, Tianjin University, has been extensively investigated, considerably fewer results are available for PDEs defined on

2026-06-17规划控制

论文针对时变空间域上抛物型 PDE 反步控制需在线反复求解随边界变化的核方程、难以实时实现的问题,将移动边界轨迹到反步核的映射表述为算子,并通过坐标变换证明其连续依赖性,从而用 DeepONet 离线学习近似核。基于近似核构造边界反馈后,文中证明有限时间区间内闭环仍指数稳定;数值结果显示相较传统核求解器接近三数量级加速。

Symplectic Transversality and Endpoint Green Estimates for Finite-Horizon Pontryagin Systems Figure 1
2026-06-17math.OC

Symplectic Transversality and Endpoint Green Estimates for Finite-Horizon Pontryagin Systems

Pyuyi Chufeng Huang, Zikang Song, Xingshu Chen

School of Cyber Science and Engineering, Sichuan University, Chengdu, Sichuan, China ()., School of Mathematics, Sichuan University, Chengdu, Sichuan, China ()., School of Cyber Science and Engineering, Sichuan University, Chengdu, Sichuan, China (). Corresponding author.

2026-06-17优化控制

本文针对有限时域离散 Pontryagin 边值系统中线性化两端点逆随时域变长而可能失控的问题,提出以缩放稳定—不稳定边界横截性验证逆假设,并给出带端点修正的 Green 估计。结合加权压缩映射,证明局部分支的存在唯一性、Lipschitz 依赖和一阶展开均具有时域一致常数;还用辛结构与 Riccati/LQ 条件给出可检验证书,覆盖一类可稳定线性二次系统。

Information-Theoretic Meta Dynamic Programming for Signalling and Control of POMDPs Figure 1
2026-06-17cs.IT

Information-Theoretic Meta Dynamic Programming for Signalling and Control of POMDPs

Charalambos D. Charalambous, Photios A. Stavrou

2026-06-17规划控制

面向网络化控制中动作既要调节系统又要传递信息的场景,本文把 POMDP 信道上的信令—控制统一表述为在平均代价约束下最大化动作到观测的有向信息。核心创新是引入系统后验及其上的高阶分布两类信息状态,并证明其马尔可夫递推与充分统计性,从而构造概率测度空间上的“元”动态规划。主要结果给出随机策略分离结构及最优性的充要条件,并说明无信令时可退化为经典 POMDP 动态规划。

Gray-Box Optimization using Optimism in the Face of Uncertainty Figure 1
2026-06-17math.OC

Gray-Box Optimization using Optimism in the Face of Uncertainty

Katrin Baumgärtner, Léo Simpson, Moritz Diehl

Department of Microsystems Engineering, University of Freiburg, Department of Microsystems Engineering and Department of Mathematics

2026-06-17优化算法安全鲁棒

针对在线决策中纯黑箱优化忽略已知模型结构、样本效率低的问题,本文将目标写成已知损失与含未知参数的输入输出模型复合,提出利用先验可行参数集和最小二乘置信集的灰箱乐观优化方法,通过最小化目标下置信界实现探索—利用平衡。理论上给出累积遗憾分析,并在随机线性/上下文 bandit 特例中改进已有界;数值实验显示其较结构无关黑箱方法更省数据、性能更好。

Robust Bayesian Portfolio Optimization with Discrepancy-based Posterior Ambiguity Figure 1
2026-06-17math.OC

Robust Bayesian Portfolio Optimization with Discrepancy-based Posterior Ambiguity

Zongxia Liang, Yang Liu, Xingjian Ma

†School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen), Department, University

2026-06-17优化算法安全鲁棒

针对连续时间投资中资产漂移不可观测且贝叶斯后验易受先验、滤波误差和模型错设影响的问题,本文把Wasserstein、Lp等差异度量的不确定集直接加在后验估计过程上,并用反馈型歧义重构缓解动态时间不一致。由此得到修正HJBI方程,刻画价值函数与鲁棒反馈策略;在指数效用下进一步化为半线性抛物PDE,并通过验证定理证明经典解存在。

A Projection-Free Algorithm for Variational Inequalities in Hilbert Spaces with Strong Convergence Figure 1
2026-06-17math.OC

A Projection-Free Algorithm for Variational Inequalities in Hilbert Spaces with Strong Convergence

Reinier Diaz Millan

Deakin University, Waurn Ponds, Victoria, Australia

2026-06-17学习理论

针对凸约束由非光滑不等式给出时,直接投影到可行集代价高的问题,本文提出一种求解Hilbert空间中点到集极大单调变分不等式的无可行集投影算法。核心做法是用子梯度割、经Slater校正的可行Minty分离半空间和Haugazeau半空间替代对原约束集的投影。理论上证明全序列强收敛到初值在解集上的投影,并给出步长残差、可行性违反和Minty gap的最佳迭代O(N^{-1/2})估计;实验覆盖多类非光滑和大规模约束问题。

Two-Echelon Delivery Vehicle Sharing and Repositioning in Hyperconnected Urban Logistic Networks Figure 1
2026-06-17math.OC

Two-Echelon Delivery Vehicle Sharing and Repositioning in Hyperconnected Urban Logistic Networks

Xiaoyue Liu, Benoit Montreuil

aPhysical Internet Center, H.Milton Stewart School for Industrial and Systems Engineering, Georgia Institute of

2026-06-17优化控制

面向电商增长带来的城市配送拥堵、排放和车辆利用率低问题,论文将物理互联网的标准化容器、共享枢纽与两级配送结合,提出多周期整数规划,联合优化车辆服务路径、容器流和跨枢纽车辆重定位,并用分解启发式求解大规模实例。亚特兰大案例显示,相比传统单级方案,满市场份额下可降45.0% CO2-eq、16.8%总成本,重定位最多再降17.7%成本。

Low-Thrust Orbital Differential Games with Speed Constraint Enforcement Using CostWeighting Figure 1
2026-06-17eess.SY

Low-Thrust Orbital Differential Games with Speed Constraint Enforcement Using CostWeighting

Yahli Drucker, Vitaly Shaferman

2026-06-17优化算法

本文针对机动目标下低推力航天器追逃交会中非零终端速度难以约束的问题,在线性 CW 相对动力学和二次型微分博弈框架内,通过调节终端速度代价权重来强制指定终端速率,并将求解化为六阶多项式根选择以避免共轭点。仿真显示,在最优规避和非机动目标两种情形下,位置与速度误差均较小,但非机动目标下因策略假设失配误差和末端推力需求上升。

An Adaptive Algorithm for the Approximation of General Linear-Parametric Optimization Problems Figure 1
2026-06-17math.OC

An Adaptive Algorithm for the Approximation of General Linear-Parametric Optimization Problems

Levin Nemesch, Stefan Ruzika, Clemens Thielen, Alina Wittmann

2026-06-17优化算法

针对线性多参数优化中单点问题可能 NP-hard、覆盖全参数的最优解集可能指数大的困难,论文提出一个自适应算法,可在有非参数 oracle 时既求精确最优解集,也求近似解集。其关键在于放宽既有参数近似算法对非负参数依赖和正正交参数域的限制,并给出参数集变换的结构性结果;结论表明近似版可多项式运行,精确版输出多项式运行,同时指出最大化情形仅有全域非负最优值并不足以保证可近似。

Beyond IGO-Flow: Toward Convergence Analysis of IGO in Continuous Spaces Figure 1
2026-06-17math.OC

Beyond IGO-Flow: Toward Convergence Analysis of IGO in Continuous Spaces

Ryosuke Kimura, Youhei Akimoto

2026-06-17生成模型学习理论

本文针对 IGO 理论多停留在连续时间 IGO-flow、难解释有限步长实际算法的问题,分析连续空间中离散时间 IGO。核心在于用指数族期望参数下的自然梯度,覆盖多元高斯、强凸二次目标、全协方差自适应、固定学习率与分位截断权重。主要证明协方差矩阵收敛到零,并在缩放协方差条件数足够频繁有界的假设下证明均值收敛到全局最优;无条件均值收敛仍未完成。

Contextual Robust Optimization for AI Data Center Scheduling with Statistical Guarantees Figure 1
2026-06-17math.OC

Contextual Robust Optimization for AI Data Center Scheduling with Statistical Guarantees

Yijie Yang, Xi Weng, Yue Chen

Contextual Robust Optimization for AI Data Center, increasing data center electricity demand and carbon emissions, robust optimization framework for AI data center operation. The, reliable feasibility and strong computational scalability., Index Terms—AI data center, the electricity demand of data centers. In 2025, data centers, variability and intermittency of renewable sources, data centers, demand with renewable energy availability., Cost-aware and carbon-aware data center scheduling has, Y. Yang and Y. Chen are with the Department of Mechanical and, Automation Engineering, the Chinese University of Hong Kong, Hong Kong, X. Weng is with the Guanghua School of Management, Peking Univer-

2026-06-17优化算法安全鲁棒

面向AI数据中心电力需求和碳排上升、可再生能源与工作负载预测误差带来的调度风险,本文提出上下文鲁棒优化框架,区分训练与推理任务异质性,并用损失驱动模型从天气、历史等特征直接学习不确定集,再经校准给出有限样本联合机会约束可行性保证。真实负载与可再生数据实验显示,运行成本平均降低5.57%,碳排至少降低3.41%,同时保持可行性与可扩展性。

Coarse Preference Reporting in the Bottleneck Model: Approximate Strategyproofness and Efficiency Figure 1
2026-06-17math.OC

Coarse Preference Reporting in the Bottleneck Model: Approximate Strategyproofness and Efficiency

Takara Sakai, Riki Kawase

2026-06-17优化控制

本文针对瓶颈通行调度中车辆偏好到达时间私有、VCG 等精确激励机制复杂的问题,提出让车辆只在固定宽度时段中粗粒度申报的 DSO 机制,并按容量影子价格收费。核心洞察是时段宽度 Δ 同时刻画实现成本与激励偏差:在相应分布与成本条件下,最坏误报收益为 O(Δ²),容量约束绑定时效率损失也为 O(Δ²);无收费时误报动机不会随时段细化消失,说明收费主要用于诱导真实申报。

A Polyak-Ruppert Central Limit Theorem for SA-Adam with Momentum and Non-Convergent Adaptive Preconditioning Figure 1
2026-06-17math.ST

A Polyak-Ruppert Central Limit Theorem for SA-Adam with Momentum and Non-Convergent Adaptive Preconditioning

Sunyoung An, Xiaoming Huo

H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, GA 30332, USA

2026-06-17优化控制

面向流式估计中用 Adam/AdamW 做一次遍历推断的需求,论文研究 Polyak–Ruppert 平均在动量与不收敛自适应预条件下是否仍有可校准方差。核心做法是把迭代量和动量缓冲组成增广随机逼近状态,绕开传统分解退化为恒等式的问题。结果证明在局部稳定和次线性衰减动量增益下,平均迭代的极限协方差仍是 SGD 的三明治形式,且 L2 权重衰减对应岭惩罚三明治。

Transformer-Based Warm-Starting for Feasible and Optimal Terminal Approach to Tumbling Objects with Space Manipulators Figure 1
2026-06-17cs.RO

Transformer-Based Warm-Starting for Feasible and Optimal Terminal Approach to Tumbling Objects with Space Manipulators

Yuji Takubo, Maximilian Adang, Mac Schwager, Simone D'Amico

2026-06-17优化控制

面向在轨服务中空间机械臂接近翻滚目标的实时规划难题,论文指出传统非凸/SCP轨迹优化对初值敏感且受总线—机械臂耦合、安全与视锥约束拖慢。其核心做法是在两阶段SCP中只为计算瓶颈的姿态—机械臂力矩分配阶段引入因果Transformer暖启动,并比较线性与flow matching解码器。300个测试场景中,二阶段迭代最多降28%、运行时间降23%,可行性投影近乎减半耗时且避免启发式初值的高成本尾部。

Adaptive Proximal Methods for Weakly Convex Optimization with Unknown Parameter: Deterministic and Stochastic Guarantees Figure 1
2026-06-17math.OC

Adaptive Proximal Methods for Weakly Convex Optimization with Unknown Parameter: Deterministic and Stochastic Guarantees

Miaolan Xie

2026-06-17优化算法

针对弱凸非光滑非凸优化中弱凸参数ρ未知导致近端参数难以安全设定的问题,论文提出APS:每轮仅用一次候选近端调用和函数下降估计,通过接受/拒绝测试双向调节近端参数,并在分析中区分安全与非安全区间。其在确定性情形达到生成ε次梯度驻点的O(ε^-2)复杂度,在随机、带偏且重尾差分估计和弱近端oracle下,也给出Moreau包络梯度小于ε的高概率O(ε^-2)保证。

Optimal Powered Descent Guidance with Pyramid-Shaped Approach-Angle Constraints Figure 1
2026-06-17eess.SY

Optimal Powered Descent Guidance with Pyramid-Shaped Approach-Angle Constraints

Revital Frenkel, Vitaly Shaferman

Technion - Israel Institute of Technology, Haifa 3200003, Israel

2026-06-17优化算法

面向软着陆中防止撞地和避免过浅进近角的需求,论文将进近角限制直接建模为以着陆点为顶点的倒金字塔不等式路径约束,并用 Pontryagin 最小值原理解析推导二次控制能量最优制导律、切换条件和自由终端时间。结果显示约束激活会缩短最优飞行时间,控制在时间上分段线性且闭环对状态非线性;仿真中可实现近零终端位置/速度误差并始终满足平面与线约束,但代价高于无约束解。

Accelerated Convex Optimization via Hamiltonian Dynamics with Deterministic Integration Time Figure 1
2026-06-17math.OC

Accelerated Convex Optimization via Hamiltonian Dynamics with Deterministic Integration Time

Xiuyuan Wang, Vishwak Srinivasan, Qiang Fu, Siddharth Mitra, Ashia Wilson, Andre Wibisono

2026-06-17优化算法

本文针对一阶光滑凸优化中梯度流/梯度下降收敛慢、现有 Hamiltonian 优化多限于二次目标或随机积分时间的问题,提出利用 Hamiltonian 轨迹的时间平均而非终点收缩来设计算法。其 HFA 及离散化 extragradient 实现可用确定性积分时间,在凸与强凸情形达到与 Nesterov 加速法同阶的最优一阶复杂度。

A Unified Analytical Nullspace-Based Least-Squares Design of the Farrow Structure Figure 1
2026-06-17eess.SP

A Unified Analytical Nullspace-Based Least-Squares Design of the Farrow Structure

Deijany Rodriguez Linares, Håkan Johansson

The authors are with the Department of Electrical Engineering, Link¨oping, University, 58183 Link¨oping, Sweden. Email: {deijany.rodriguez.linares, nullspace basis is centered at D to ensure consistent group, centering is applied. Types I/III (even Nk, integer D) and

2026-06-17优化控制

针对 Farrow 结构可变分数延迟滤波器在施加群时延约束时会出现线性相位与一般 FIR 分支混合、传统解耦最小二乘闭式解失效的问题,本文用逐分支对称约束的零空间参数化统一建模,给出可处理任意分支类型的解析 LS 解。数值结果显示,该方法能满足全线性相位方案无法满足的群时延约束,并在达到与全一般 FIR 基线相近误差时显著减少自由参数。

On the Strong Duality in Continuous-time and Discrete-time Linear Quadratic Regulators Figure 1
2026-06-17math.OC

On the Strong Duality in Continuous-time and Discrete-time Linear Quadratic Regulators

Yuto Watanabe, Yang Zheng

. Y. Watanabe and Y. Zheng are with the Department of Elec-, trical and Computer Engineering, University of California San Diego

2026-06-17优化控制

本文针对连续与离散时间 LQR 强对偶性长期分开证明、假设差异不清的问题,提出用线性算子 Ψ 统一刻画两类非凸 LQR,并通过秩约束 SDP 及其无损松弛推导拉格朗日对偶。结果表明,在可稳定、可检测且初始协方差仅半正定的标准条件下,两类问题均零对偶间隙,并可由 SDP/KKT 构造性恢复 Riccati 方程、最优反馈增益及其唯一性条件。

Tipping the Balance: Allee Thresholds, Saddle-Node Bifurcations, and Optimal Sterile-Male Release Strategies for Anopheles Mosquitoes Figure 1
2026-06-17q-bio.PE

Tipping the Balance: Allee Thresholds, Saddle-Node Bifurcations, and Optimal Sterile-Male Release Strategies for Anopheles Mosquitoes

Abba Gumel, C. Alex Safsten

Department of Mathematics, University of Maryland, College Park, MD 20742, USA, Institute for Health Computing, University of Maryland, North Bethesda, Maryland 20852, USA, Department of Mathematics and Applied Mathematics, University of Pretoria, Pretoria 0002, South Africa

2026-06-17优化控制

针对杀虫剂抗性和室外传播削弱传统控蚊手段的问题,本文建立含性别、发育阶段和密度依赖配偶搜索的按蚊 SIT 模型,指出 Holling-II 交配项会产生可被利用的 Allee 阈值。分析表明种群在鞍结分岔下呈现存续/灭绝双稳态,足够释放绝育雄蚊可跨越分界并由配偶失败完成清除;自由时域优化中,混合释放较最佳恒定策略少约 5%、较响应式策略少约 39% 的释放量。

2026-06-16

49 篇
Optimal Bounded Thrust Powered Descent with Analytical Ground-Collision Avoidance Figure 1
2026-06-16eess.SY

Optimal Bounded Thrust Powered Descent with Analytical Ground-Collision Avoidance

Or Nataf, Vitaly Shaferman

2026-06-16学习理论

针对着陆器动力下降中推力受限会导致目标偏差甚至撞地、而数值优化方案难以实时保证安全的问题,论文用时变质量多项式近似把问题转化为有界 LQ 制导,并通过水平/垂直推力分层分配获得显式解析防撞条件与饱和切换预测。仿真在扰动初始条件网格上显示可实现无碰撞软着陆,计算量较低,适合实时实现。

Symmetric Extension Complexity of the Spanning Tree Polytope Figure 1
2026-06-16math.CO

Symmetric Extension Complexity of the Spanning Tree Polytope

Sebastian Pokutta

Institute of Mathematics, Technische Universität Berlin and, Zuse Institute Berlin, Germany, by relabeling vertices, and hence acts on PST(Kn). Many natural extended formulations respect this, vertex relabeling. Thus the question whether symmetry itself already forces a size of Ω(n3) naturally, extended formulation, with respect to the vertex-relabeling action. The above, in particular also, any improvement below n3 must however break the natural vertex-relabeling

2026-06-16优化控制

本文针对完全图生成树多面体的扩展复杂度中长期存在的 Ω(n²) 与 O(n³) 缺口,转而考察保持顶点重标号对称性的线性扩展。核心做法是借助 Braun–Pokutta 的对称扩展代数框架,构造一个六顶点带符号证书并提升到 n 顶点,证明任何对称扩展至少需 C(n,3) 个不等式;结合 Martin 对称 O(n³) 构造,得到对称扩展复杂度 Θ(n³),但普通非对称情形仍未解决。

Exploding and vanishing gradients in deep neural networks: the effect of residual connections Figure 1
2026-06-16math.OC

Exploding and vanishing gradients in deep neural networks: the effect of residual connections

Vivek S Borkar

Department of Electrical Engineering, Indian Institute of Technology Bombay

2026-06-16优化算法

本文针对深层网络训练中梯度爆炸与消失的成因,将网络层叠写成离散动力系统,把反向梯度视为随机雅可比矩阵乘积。核心创新是引入 Furstenberg–Kifer 对 Lyapunov 指数谱的精确刻画,用射影空间上的平稳测度描述各方向的指数增长率,并据此分析 ResNet 式残差连接如何改变谱结构、缓和部分方向的指数发散或衰减;但结论依赖可微、非奇异和收敛等理想化假设,对 ReLU 等常见情形仍文中未充分说明。

The Complexity of Min-Max Optimization for Quadratic Polynomials Figure 1
2026-06-16cs.CC

The Complexity of Min-Max Optimization for Quadratic Polynomials

Martino Bernasconi, Matteo Castiglioni, Andrea Celli, Alexandros Hollender

Bocconi University, University of Oxford

2026-06-16优化算法

本文追问非凸非凹 min-max 优化的困难是否已出现在最简单的二次多项式目标中,而非依赖电路或 oracle 表达能力。作者通过从 End-of-the-Line 经 LinVI、PureCircuit 构造低次数多项式 gadget,并用降次与多线性化保持稀疏性,证明在超立方体上求逆多项式精度近似驻点对多线性二次多项式仍为 PPAD-hard,且每个变量至多出现三次;进一步推出两团队零和 polymatrix 博弈近似均衡的首个 PPAD-hard 结果。

Functional Gradient Descent with Adaptive Representations Figure 1
2026-06-16math.OC

Functional Gradient Descent with Adaptive Representations

Daniel Csillag, Rodrigo Schuller, Pedro Dall'Antonia, Leonidas Guibas, Luiz Velho, Tiago Novello

Stanford University

2026-06-16优化算法

针对函数优化常以固定神经网络参数化导致非凸训练困难、而理想函数梯度下降又因无限维梯度难以实现的问题,本文提出在优化过程中自适应细化梯度表示的近似 FGD,并把相对近似误差纳入收敛分析。作者给出可计算的误差控制策略,证明光滑情形收敛到驻点、满足 PL 条件时到全局最优;在 RKHS 回归、PDE 求解和视觉任务中,相比固定表示 FGD 与神经网络基线表现出更高效率和精度。

Augmented Lagrangian Method for Mathematical Programs with Second-Order Cone Complementarity Constraints Figure 1
2026-06-16math.OC

Augmented Lagrangian Method for Mathematical Programs with Second-Order Cone Complementarity Constraints

Yan-Chao Liang, Chen-Yuan Zhu, Sheng-Jie Zhang, Gui-Hua Lin, Xide Zhu

†School of Mathematics and statistics, Henan Normal University, Xinxiang 453007, China., ‡School, University, §School, School of Management, Shanghai University

2026-06-16优化算法

针对二阶锥互补约束数学规划中标准约束资格普遍失效、传统非线性规划方法难以直接适用的问题,论文将增广拉格朗日法定制扩展到 SOCMPCC,利用其免矩阵实现和处理复杂约束的优势,建立了可行性与收敛分析:在罚参数或增广拉格朗日函数有界等条件下迭代点收敛到可行点,并在非退化等假设下达到 K-驻点;数值实验显示其在若干示例和高维问题上较平滑方法精度更好。

Novel insights into Pareto fronts in multiobjective topology optimization and a comparative study of scalarization strategies Figure 1
2026-06-16math.OC

Novel insights into Pareto fronts in multiobjective topology optimization and a comparative study of scalarization strategies

Tom De Weer, Ole Sigmund, Gabriele Eichfelder

aKU Leuven Campus Diepenbeek, Department of Mechanical Engineering, Wetenschapspark 27, Diepenbeek, 3590, Belgium, cDepartment of Civil and Mechanical Engineering, Technical University of Denmark, Kongens Lyngby, 2800, Denmark, dInstitute of Mathematics, Technische Universit¨at Ilmenau, Ilmenau, D-98684, Germany

2026-06-16优化算法

面向拓扑优化中多目标设计权衡长期依赖加权和、ε-约束等标量化且缺少系统比较的问题,本文从理论与数值两方面分析三类标量化策略,并提出关键洞察:强非凸性会使全局 Pareto 前沿由多个局部前沿拼接而成,可能非凸甚至断裂。大量双目标案例显示,Pascoletti-Serafini 标量化通常给出更均匀的前沿近似,而加权和易出现解聚集,ε-约束还会遭遇不可行参数选择。

Learning Policy from a Single Trajectory in Average-Reward Markov Decision Process Figure 1
2026-06-16cs.LG

Learning Policy from a Single Trajectory in Average-Reward Markov Decision Process

Jongmin Lee, Ernest K. Ryu, Vaneet Aggarwal

Seoul National University, Purdue University

2026-06-16强化学习规划控制

本文针对平均回报 MDP 中单条轨迹学习缺少有限样本保证的问题,放宽以往生成模型、i.i.d. 数据或遍历性假设,分析弱连通 MDP 的常返/暂态结构,并用停时与强马尔可夫性质构造无模型算法。其值函数法 SAVIC 与策略法 SCPMA 分别达到约 O(1/ε²) 和 O(1/ε⁴) 样本复杂度,SAVIC+ 还在连通 MDP 中无需预知问题常数。

Chebyshev-Exact Acceleration under Hessian Variation, I: Sine-Jacobi Method Figure 1
2026-06-16math.OC

Chebyshev-Exact Acceleration under Hessian Variation, I: Sine-Jacobi Method

Dmitry Pasechnyuk-Vilensky, Martin Takáč

Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, UAE.

2026-06-16优化控制

论文关注切比雪夫加速在 Hessian 随时间漂移时的稳定性:同一终端最小最大多项式在固定二次问题上等价,但其梯度查询的有序实现会改变漂移敏感度。核心引入时序谱核及尖锐 ℓ2 增益 AN,证明前缀精确递推的精确增益及类内最优性,并用 Jacobi 参数化终端精确实现;正弦权重在保持相同终端残差下将渐近常数降至 2.137936,小于前缀法的 2.309401,实验也显示更低随机曲率开销与重启代价。

Distributionally robust decision-making under ambiguity: case study of water environmental management Figure 1
2026-06-16math.OC

Distributionally robust decision-making under ambiguity: case study of water environmental management

Hidekazu Yoshioka, Motoh Tsujimura, Yumi Yoshioka, Ayumi Hashiguchi

a Graduate School of Advanced Science and Technology, Japan Advanced Institute of Science and, b Graduate School of Commerce, Doshisha University, Japan, c Faculty of Applied Biological Sciences, Gifu University, Japan, d Faculty of Environmental, Life, Natural Science and Technology, Okayama University, Japan, * Corresponding author: Associate Professor, Graduate School of Advanced Science and Technology, Japan Advanced Institute of Science and Technology, Asahidai 1-1, Nomi, Japan. Tel: +81-761-51-1745, Availability of data and material, Data will be available upon a reasonable request to the corresponding author.

2026-06-16安全鲁棒

针对河流流量等环境过程具有长记忆且样本不足导致模型歧义的问题,本文把混合移动平均(MMA)/supCBI 随机过程嵌入分布鲁棒随机优化,用密度扭曲和散度刻画最坏情形,并通过CVaR正则化保持严格凸和可计算。两处引水案例表明,该框架可由实测参数求得唯一最优分流策略,仿真中出现与既有非比例引水规则一致的策略形态。

Restarted Reflected Halpern Acceleration for Augmented Primal-Dual Methods Figure 1
2026-06-16math.OC

Restarted Reflected Halpern Acceleration for Augmented Primal-Dual Methods

Benqi Liu, Ju Cao, Wotao Yin, Zaiwen Wen

Beijing International Center for Mathematical Research, Peking University, Beijing, China, School of Mathematical Sciences, Peking University, Beijing, China, Alibaba US, DAMO Academy

2026-06-16优化控制

本文针对带线性约束的复合凸优化中增广拉格朗日一阶原始–对偶法难以用鞍点间隙刻画收敛的问题,统一刻画 PDHG/Chambolle–Pock 型增广度量,并将精确与线性化方案分别表示为退化近端点和预条件前后向映射,从而可直接分析 reflected Halpern 加速与重启。论文证明影子迭代收敛到 KKT 点,给出非遍历 O(1/k) 的 KKT 残差和目标间隙界,说明有限识别发生在影子序列,并在固定点 sharpness 条件下得到重启锚点线性收敛;实验用 LP/QP 展示增广与线性化效果。

Testing the max-flow min-cut property and the replication conjecture Figure 1
2026-06-16math.OC

Testing the max-flow min-cut property and the replication conjecture

Ahmad Abdi, Tamás Schwarcz

∗Department of Mathematics, London School of Economics., †Department of Mathematics

2026-06-16生成模型

论文围绕组合优化中悬而未决的复制猜想:具有 packing property 的 clutter 是否必为 MFMC。作者的关键思路是把无限权重检验压缩为有限范围,并将有界度 cuboid 的潜在反例降到有限搜索空间,再用 SAT 形式化验证。主要结果包括改进 MFMC 检验权重上界,证明极小反例维度受度数限制,并验证度至多 9 的 cuboid 及至多 10 个元素的 clutter 满足复制猜想。

Can Optimal Dispatch Models Recreate Reality? A Retrospective Analysis of Europe's 2022 Energy Crisis Using PyPSA-Eur Figure 1
2026-06-16eess.SY

Can Optimal Dispatch Models Recreate Reality? A Retrospective Analysis of Europe's 2022 Energy Crisis Using PyPSA-Eur

Lukas Karkossa, Marco Saretta, Frederik Erhard Gullach, Marta Victoria

Technical University of Denmark, 2Ramboll Denmark, 3Aarhus University, 4COWI, B. Generation capacities and availability, be fully available, demand, renewable availability, and fuel prices. This allows, prices, weather, and demand are only available for a limited

2026-06-16优化控制

为检验最优调度模型在欧洲能源危机这种燃料价格剧烈波动场景下能否复现真实电价,本文用 PyPSA-Eur 对 2020–2024 年 35 国逐小时回测,并比较静态/动态燃料与碳价、全年完美预见/两周滚动视野。核心洞察是高分辨率价格输入叠加有限预见更贴近市场,欧洲日负荷加权电价平均 SMAPE 降至 20.76%;但 2022 年模型普遍少用气、多用煤,差异可能来自政策干预、机组约束与停运未建模。

Robust Koopman MPC with Sets Updates for Time Delayed Systems Figure 1
2026-06-16math.OC

Robust Koopman MPC with Sets Updates for Time Delayed Systems

Xinglong Zhang, Xinxin Yao, Xin Xu, Keyou You, Dewen Hu

aCollege of Intelligence Science and Technology, National University of Defense Technology, Changsha 410073, China., bDepartment of Automation and BNRist, Tsinghua University, Beijing 100084, China., Koopman model in the feature space. By analyzing fundamental properties such as controllability and observability, a robust tube-based, Definition 1 (Local controllability [15]) The time delayed, system x+ = f(x,x−τ,u) is controllable in the domain X 2×

2026-06-16规划控制安全鲁棒

针对现有 Koopman MPC 依赖离线固定不确定集、在非线性时滞系统中易保守且缺少鲁棒闭环保证的问题,论文将未知时滞动力学提升为数据驱动 Koopman 线性模型,并构造 tube-MPC;进一步在线更新不确定界与 RPI 集以缩小管束。理论上证明递归可行、扰动下鲁棒约束满足和无扰动渐近收敛,两个数值例子显示自适应版本较固定集合方案保守性更低、控制性能更好。

Segregated solutions of a degenerate cross-diffusion system with drifts Figure 1
2026-06-16math.AP

Segregated solutions of a degenerate cross-diffusion system with drifts

Filippo Santambrogio, Simon Schulz

2026-06-16生成模型

本文关注带独立漂移的一维退化交叉扩散系统中物种分离界面的存在性问题,动机来自细胞排序等多群体模型在低正则、无最大值原理下的分析困难。核心做法是把总密度累积分布的伪逆作为拉格朗日变量,在 L2∩BVloc 中用最小化运动格式求解类似 p-Laplace 的方程,并借助 Minty–Browder 单调性获得强收敛。主要结果是证明全局分离弱解存在,覆盖多孔介质退化、对数熵以及 α∈(1/3,1) 的快扩散情形。

Output-Feedback Boundary Control of Reaction--Diffusion PDEs on Arbitrary Lipschitz Domains: A Target-Domain Approach Figure 1
2026-06-16math.OC

Output-Feedback Boundary Control of Reaction--Diffusion PDEs on Arbitrary Lipschitz Domains: A Target-Domain Approach

Rafael Vazquez

n-balls enlarges the available target designs. Output feedback, and eigenfunction-based feedback laws are available in great, domain itself) has been available for arbitrary domains in, domains. Extending a domain to prove controllability is a, boundary controllability can be deduced from distributed con-, trollability of an extended domain by restriction [10], [23]., available targets. Finally, we test the designs on star-shaped

2026-06-16生成模型规划控制学习理论

针对高维反应-扩散PDE在非规则、非凸或多连通区域上难以用闭式边界反馈稳定的问题,论文提出“目标域”扩展思路:把物理域嵌入球或矩形等已有设计域,用虚拟PDE和界面连续条件传递反馈/观测,而非在原几何上重解Riccati或特征问题。文中证明物理状态适定并指数稳定,给出球域Neumann显式律和输出反馈提升,并在星形、马蹄形、带孔区域数值验证。

Nonlinear kinetic Fokker-Planck equations as gradient flows of the free energy Figure 1
2026-06-16math.AP

Nonlinear kinetic Fokker-Planck equations as gradient flows of the free energy

Giovanni Brigati, Guillaume Carlier, Jean Dolbeault, Filippo Quattrocchi

ISTA, Institute of Science and Technology Austria, Am Campus 1, Klosterneuburg, 3400, Austria, CEREMADE, Centre de Recherche en Math´ematiques de la D´ecision (CNRS UMR n◦7534), PSL University, Universit´e Paris-Dauphine, Place de Lattre de Tassigny, 75775, Paris 16, France, and, PSL University, Universit´e Paris-Dauphine, Place de Lattre de Tassigny, 75775, Paris 16, France, LMO, Laboratoire de Math´ematiques d’Orsay, Facult´e des Sciences d’Orsay, Universit´e Paris-Saclay

2026-06-16生成模型优化算法

本文关注含自由输运与速度多孔介质扩散的非线性动理学 Fokker–Planck 方程,动机是为保守输运和耗散扩散耦合的演化建立严格梯度流结构。核心洞察是引入适配牛顿二阶特征线的动理最优输运差异度,使方程成为自由能最陡下降。主要结果包括证明 m∈[1,3/2] 时的自由能链式法则与最大耗散刻画,并建立二阶 JKO 隐式 Euler 格式的适定性、强紧性及极限收敛到弱解。

When do Mixed-Integer Games Admit Rational Equilibria? Figure 1
2026-06-16cs.GT

When do Mixed-Integer Games Admit Rational Equilibria?

Aloïs Duguet, Tobias Harks, Martin Schmidt, Julian Schwarz

Trier University, Department of Mathematics, University of Passau

2026-06-16优化控制

论文关注混合整数线性二次广义纳什博弈在有理输入下是否必有有理均衡,这关系到图灵模型中精确有限时间算法能否存在。核心洞察是按玩家自身二次项与对手相关约束划分四类,并给出完整分类:只有无自身二次项、无对手相关约束的玩家线性NEP在存在均衡时必有有理均衡,且有构造性算法;其余三类均可构造仅含无理均衡的实例,因而一般不存在精确有限算法。

Extended Kalman Filter-Based State Estimation for a Nine-Compartment Nonlinear Epidemic Model -- Convergence Analysis and In-Silico Benchmark Calibrated on the COVID-19 Third Wave in Italy Figure 1
2026-06-16math.OC

Extended Kalman Filter-Based State Estimation for a Nine-Compartment Nonlinear Epidemic Model -- Convergence Analysis and In-Silico Benchmark Calibrated on the COVID-19 Third Wave in Italy

Lokman Rachid Melhani, Antonino Sferlazza, Dominique Persano Adorno, Filippo D'Ippolito, Antonino Lo Burgio, Alberto Firenze

aDepartment of Engineering, University of Palermo, Viale delle Scienze, 90128 Palermo, Italy, bDepartment of Physics and Chemistry “E. Segr´e”, University of Palermo, Viale delle Scienze, 90128 Palermo, Italy, cDepartment of Internal Medicine “Promise,” University of Palermo, 90127 Palermo, Italy, gether with the dual controllability bound supplied by a positive-definite process noise covariance. The proof exploits, broader class of bilinear-drift, linear-output systems, provided the system-specific observability and controllability

2026-06-16学习理论数据集/基准

针对公共卫生监测只能直接获得住院、死亡和疫苗免疫量,难以重构九舱室疫情隐状态的问题,本文在已校准的意大利第三波 COVID-19 模型上构建 EKF。核心不在滤波递推,而在用 Lie 导数证明可观测性、验证 Reif 型均方有界收敛条件并系统设计协方差。合成基准中收敛后相对 RMSE 为 0.07%–2.72%,±30% 参数扰动下直接观测相关状态较稳健,但结果并非真实在线预测精度。

Anisotropic Template Ansätze for Robust Positive Invariance under State-Dependent Uncertainty Figure 1
2026-06-16eess.SY

Anisotropic Template Ansätze for Robust Positive Invariance under State-Dependent Uncertainty

Abdelrahman Ramadan, Melissa Greeff, Sidney Givigi

2026-06-16安全鲁棒

针对鲁棒 MPC 中用全局扰动集构造不变管过于保守、难以利用状态/输入相关不确定性的方向性变化,论文提出由 GP 协方差生成的正定矩阵场来变换固定椭球模板,并用 LMI 与有限图验证保证鲁棒正不变性,在线只需一次协方差查询和小矩阵开方。四旋翼仿真中,相比非自适应同形基线,3D 速度管体积降至约 1/195,7D 速度-控制子空间体积降至约 1/2.1×10^5。

Stability Analysis in Multi-Constraint Safety Filters for Linear Systems Figure 1
2026-06-16eess.SY

Stability Analysis in Multi-Constraint Safety Filters for Linear Systems

Shima Sadat Mousavi, Pol Mestres, Aaron D. Ames

available because the filtered closed loop reduces to a two-, Department, Institute, This research was supported by the Boeing Strategic University Initiative.

2026-06-16优化算法安全鲁棒

本文关注多约束 CBF-QP 安全滤波器虽能保证线性系统安全集前向不变、却可能破坏名义稳定性的问题。核心洞察是把闭环显式表示为按活跃约束划分的连续分段仿射系统,从几何上说明边界平衡点和不稳定方向的来源。文中给出活跃模式的最小相位稳定性判据、基于衰退锥的发散证书,并用 Lyapunov/LaSalle LMI 条件认证全局指数稳定或有界性。

Multi-Stage Stochastic Optimization and Reinforcement Learning Approaches for Dynamic Inspection of Infrastructure Systems Figure 1
2026-06-16math.OC

Multi-Stage Stochastic Optimization and Reinforcement Learning Approaches for Dynamic Inspection of Infrastructure Systems

Juan-Alberto Estrada-Garcia, Siqian Shen

show that SDDiP yields high-quality solutions but faces scalability limitations, while the learning-based approach achieves strong, scalability with competitive performance, highlighting a trade-off between optimality and tractability. Implications: This work, enabling more effective and scalable inspection planning in practice. More broadly, the framework supports risk-aware allocation

2026-06-16强化学习优化算法

面向电网、管线等基础设施的连续巡检,本文关注“巡检决策会改变未来故障分布”的内生不确定性,因而静态或两阶段路径规划不足。作者将任务分配与车辆路径建成多阶段随机整数规划,并用两层视角结合 SDDiP 与强化学习策略学习。实验显示,SDDiP 解质量较高但扩展性受限,RL 在大规模网络上更可扩展且性能接近,体现最优性与可计算性的权衡。

SILAGE: Memory-Efficient, Full-Gradient-Free Nonconvex Optimization for Nested Finite Sums Figure 1
2026-06-16cs.LG

SILAGE: Memory-Efficient, Full-Gradient-Free Nonconvex Optimization for Nested Finite Sums

Igor Sokolov, Laurent Condat, Peter Richtárik

*Center of Excellence for Generative AI, King Abdullah University of Science and Technology (KAUST), Thuwal, Saudi, • Data Silos and Pooled Data Lakes: Imagine a centralized data center where data are legally or, preprocessing—such as grouping by class labels or applying 𝑘-means to input features—the dataset, expensive and limit the scalability of these methods on very large datasets.

2026-06-16优化算法

针对大规模经验风险最小化中数据按块形成的嵌套双重有限和,现有方差缩减方法要么周期性全量梯度刷新、要么需按样本存储控制变量。SILAGE利用组结构只存每组控制变量,并且每轮最多刷新一个局部组梯度,从而避免全局全梯度计算,将内存降至O(n)。理论上给出非凸收敛分析,复杂度随组间δ1与组内δ2相似性自适应,并在若干规模与异质性情形下优于已有界,同时可退化为PAGE或SILVER。

MSC-CMA-ES: Structure-Aware Restarts for CMA-ES via Cyclic Nearest-Better Basin Discovery Figure 1
2026-06-16cs.NE

MSC-CMA-ES: Structure-Aware Restarts for CMA-ES via Cyclic Nearest-Better Basin Discovery

Dimitar Nedanovski, Svetoslav Nenov, Dimitar Pilev

Sofia University St. Kliment Ohridski, Department of Mathematics, University of Chemical Technology and Metallurgy, Department of Informatics

2026-06-16优化控制

针对 CMA-ES 在多峰问题中每次重启都均匀初始化、无法复用已评估地形信息的问题,论文提出 MSC-CMA-ES:用 Sobol 采样和 nearest-better 聚类发现吸引盆,并按盆自适应步长、种群规模与去重重启。CEC 多套件结果显示其在组合函数上显著优于 BIPOP-CMA-ES,目标覆盖达 2.7 倍;但在基础函数深目标覆盖下降,在混合函数上仍落后于差分进化方法。

Schattor: Schatten-family methods for deep learning optimization Figure 1
2026-06-16math.OC

Schattor: Schatten-family methods for deep learning optimization

Bohao Ma, Junyu Zhang, Chuan He

2026-06-16优化算法

针对深度网络参数块异质、梯度噪声大且非凸导致 SGD 与单一自适应几何难以统一分析的问题,本文提出 Schattor:用 Schatten-p 范数构造球约束与正则化两类一阶更新,使 p=2 退化为 SGD、p=∞ 对应 Muon/谱归一化,并可在中间几何间插值。主要结果是在随机矩阵优化和多块混合范数设置下,借助矩阵鞅矩界证明维度无关的驻点收敛保证;实际训练增益来源文中未充分说明。

Service-Induced Congestion in Memory-Constrained LLM Serving Figure 1
2026-06-16math.OC

Service-Induced Congestion in Memory-Constrained LLM Serving

Ruicheng Ao, Jing Dong, Gan Luo, David Simchi-Levi

2026-06-16优化控制

论文关注 LLM 在线服务中 KV cache 随生成持续增长导致的显存拥塞:请求入场时可行,服务过程却会制造未来容量压力并触发驱逐。作者建立离散时间动态模型刻画 admission、内存增长与 eviction 的耦合,指出同质长度会同步释放/占用内存,使无驱逐平衡不稳定并收敛到最坏极限环,吞吐损失可达 50%;异质且互素的解码长度可打散完成事件并稳定系统。

Modern Primal-Dual Frameworks for Prior-Free Online Resource Allocation Figure 1
2026-06-16math.OC

Modern Primal-Dual Frameworks for Prior-Free Online Resource Allocation

Rad Niazadeh, Rajan Udwani

2026-06-16优化控制

面向云计算、网约车、广告等未来需求未知且决策不可撤销的在线资源分配问题,本文将以往模型化较零散的原始-对偶分析整理为两套可复用框架:到达时求带正则的凸规划并由 KKT 构造对偶证书,以及在随机结果、可复用资源等 LP 松弛较弱场景下使用 LP-free 证书。主要结果是把匹配、AdWords、组合分配、随机奖励和 assortment 等模型纳入统一竞争比证明模板,而非提出单一新算法或实验增益。

A Conservation Law for Equilibrium Propagation and Coupled Learning Figure 1
2026-06-16math.OC

A Conservation Law for Equilibrium Propagation and Coupled Learning

Joshua A. McGinnis, Adam G. Kline, Yoichiro Mori

2026-06-16优化控制

面向物理学习中EP/CL训练依赖隐式稳态、难以分析且硬件参数易漂移的问题,论文揭示小扰动连续时间极限下可训练参数存在类似“质量”的守恒量,并给出CL、EP及统一KKT证明。在线性电路中该守恒化为电导/电阻平方范数守恒,可用于证明交叉阵列指数收敛及单输入单输出的收敛或边消失,并指出非守恒nudging会导致参数尺度漂移、触及硬件边界而训练失败。

Coercivity and Local Convergence of Physical Learning in Linear Circuits Figure 1
2026-06-16math.OC

Coercivity and Local Convergence of Physical Learning in Linear Circuits

Joshua A. McGinnis, Xinbo Li, Yoichiro Mori

Joshua A. McGinnis 1 1 1 Department of Mathematics, University of Pennsylvania, Philadelphia. Corresponding author ()., Xinbo Li 2 2 2 Department of Mathematics, University of Pennsylvania, Philadelphia., Yoichiro Mori 2 2 2 Department of Mathematics, University of Pennsylvania, Philadelphia. 3 3 3 Department of Biology, University of Pennsylvania, Philadelphia.

2026-06-16学习理论

面向物理网络用局部规则替代反向传播时缺乏收敛保证的问题,本文在线性电路中分析 EP、CL,并提出兼具约束式实现与梯度流结构的 AL。核心洞察是把可学习性归结为由电路关联结构构造的 coercivity/rank 条件;在该条件下连续与离散小扰动训练的损失指数衰减、参数收敛到解流形,同时用 kite 电路说明条件可因对称性失效,并证明这种退化对目标输出而言非泛型。

On Type Deception in Linear-Quadratic Differential Games Figure 1
2026-06-16cs.GT

On Type Deception in Linear-Quadratic Differential Games

Jesse Milzman, Dipankar Maity

The views expressed in this paper are those of the authors and do not reflect the official policy or position of the United States Government, Department of War, or its components.J. Milzman is with the DEVCOM Army Research Laboratory, Brooklyn, New York USA., D. Maity is with the Department of Electrical and Computer Engineering, University of North Carolina at Charlotte, NC, 28223, USA.

2026-06-16优化控制

本文针对传统线性二次微分博弈默认信息对称、难以刻画能力隐瞒的问题,研究一方类型私有时的零和控制博弈。核心洞察是任意事前均衡可分解为先“混同”欺骗、后完全信息揭示两阶段,并用嵌套 Riccati 方程及揭示时刻优化求解。追逃算例显示最优揭示时间常在区间内部,说明隐瞒类型能带来可量化的事前收益。

Inexact Warped Resolvent iterations Figure 1
2026-06-16math.OC

Inexact Warped Resolvent iterations

Raul T. Marcavillaca, Fernando Roldan

2026-06-16优化控制

针对近端/预解算子在大规模单调包含与原始-对偶优化中难以精确计算的问题,本文提出相对误差准则下的非精确 warped resolvent 迭代,将其解释为对动态分离半空间的松弛投影,并统一覆盖 FBF、FBHF、Chambolle–Pock、Condat–Vũ 等分裂法。理论上证明弱收敛,并通过 Haugazeau 投影得到强收敛,在度量次正则条件下给出线性收敛;数值实验涉及鞍点问题和 CT 重建,显示计算优势。

Robust Conformal CBF and CLF Controllers via Iterative Policy Updates Figure 1
2026-06-16eess.SY

Robust Conformal CBF and CLF Controllers via Iterative Policy Updates

Omid Mirzaeedodangeh, Eliot Shekhtman, Nikolai Matni, Lars Lindemann

2026-06-16强化学习规划控制安全鲁棒

本文针对将共形预测误差界直接嵌入鲁棒 CLF/CBF 后,因部署策略诱发闭环轨迹分布偏移而失去安全/稳定保证的问题,提出按 episode 迭代更新控制器的框架。核心是用对抗鲁棒共形预测结合闭环轨迹敏感性分析,给出可计算的分布偏移预算及隐式/显式误差界更新规则。论文证明了逐轮有限样本有效性、概率安全与稳定证书及算法收敛,并在倒立摆、多障碍迷宫和四旋翼案例中验证。

Dual-Network PINNs for Optimal Control: A Reproducible Benchmark on the Mass-Spring-Damper System Figure 1
2026-06-16math.OC

Dual-Network PINNs for Optimal Control: A Reproducible Benchmark on the Mass-Spring-Damper System

Abdeladhim Tahimi, Rinaldo Vieira da Silva Junior

2026-06-16规划控制数据集/基准

本文面向最优控制入门中伴随方程和两点边值问题实现门槛较高的问题,用质量-弹簧-阻尼基准把线性二次控制重写为双网络 PINN:状态网络通过构造函数精确满足边界,控制网络自由优化,损失结合物理残差与梯形积分代价。结果显示其最优代价可达经典 shooting/配点法约四位有效数字,终端约束由构造保证,但训练比 shooting 慢约两个数量级,贡献主要是可复现实验与教学清晰度而非新架构性能优势。

A universal support theorem for 1-Wasserstein optimal transport Figure 1
2026-06-16math.CA

A universal support theorem for 1-Wasserstein optimal transport

Ze-An Ng

2026-06-16优化控制

针对1-Wasserstein最优传输中传输计划虽位于Rn×Rn、支撑集先验维数可达2n的问题,论文从Kantorovich对偶出发,把最优计划支撑与1-Lipschitz势函数的“拉伸集”几何联系起来,证明任意最优计划均支撑在闭的n+1可求直集合上,因此Hausdorff维数至多为n+1,并给出该上界一般不可改进的例子。

A Feasible-Velocity Framework for Local Controllability of Nonlinear Systems with Zero-Excluding Input Constraints Figure 1
2026-06-16math.OC

A Feasible-Velocity Framework for Local Controllability of Nonlinear Systems with Zero-Excluding Input Constraints

Amal Bouazza, Mohamed Boutayed, Mustapha Oudani

Controllability of Nonlinear Systems with, Abstract— This paper studies local controllability of non-, classical small-time local controllability theory and exist-, controllability criteria to be applied. When no admissible, small-time local controllability. This obstruction does not, control, small-time local controllability., MALL-time local controllability (STLC) is a central no-, This work was supported by the University of Lorraine (UL) and the, International University of Rabat (UIR) under a joint Ph.D. program. The, Amal Bouazza and Mohamed Boutayeb are with University of Lor-, raine, CNRS, CRAN, 54000 Nancy, France and with TICLab, Inter-, national University of Rabat (UIR), 11100 Rabat, Morocco. (e-mails:

2026-06-16规划控制优化算法

针对线缆机器人等执行器输入严格为正、零输入不可用时经典小时间局部可控性理论失效的问题,论文提出“可行速度/可容许平衡集”框架,在不要求控制分布满秩的情况下分类参考状态;若存在内部平衡输入,可通过局部输入平移调用经典可达与 STLC 判据,若无平衡输入,则构造分离协向量与单调屏障,给出 STLC 的定量阻碍,并在欠驱动平面 CDPR 上数值验证该屏障。

Revisiting The PBH Test: Fast Uncontrollability Certificates via Krylov Methods Figure 1
2026-06-16math.OC

Revisiting The PBH Test: Fast Uncontrollability Certificates via Krylov Methods

Ahmad F. Taha, Mohamad H. Kazma, Abdallah A. Albustami

FAST UNCONTROLLABILITY CERTIFICATES VIA KRYLOV METHODS, are computable without forming the controllability matrix, meaning that uncontrollability can be efficiently certified., uncontrollable generalized eigenvectors, thereby providing, space methods that extract some of the uncontrollable PBH, Index Terms— Controllability, PBH test, infeasibility cer-, ONTROLLABILITY characterizes whether an input can, controllable if and only if rank [λI −A, Beyond deciding controllability, the PBH test localizes how, controllability fails by identifying the uncontrollable eigenval-, ues, making it a diagnostic tool for analysis. An uncontrollable, Scaling controllability tests to modern networked systems

2026-06-16规划控制

面向大规模网络化线性系统中 PBH 可控性检验需全局特征分解、难以扩展的问题,本文把有限时域可达性写成最小能量可行性问题,指出不可达目标会产生对偶不可行证书,且证书可分解为不可控广义左特征模态,从而无需显式构造可控矩阵。基于 Krylov 与低维约化,方法可从目标相关证书中提取阻塞模态;在千维稠密/稀疏交通网络基准上,C+E 相比 PBH 和 Gramian 更快,稀疏情形约有 17–18 倍加速。

Optimal Ground-to-Air Interception with Time-Varying Acceleration Bounds Figure 1
2026-06-16eess.SY

Optimal Ground-to-Air Interception with Time-Varying Acceleration Bounds

Or Nahum, Vitaly Shaferman

Technion, Israel Institute of Technology, Haifa, Israel, 3200003

2026-06-16学习理论

针对地空拦截中导弹随高度上升而机动过载上限下降、传统制导易饱和并造成脱靶的问题,论文将硬的时变加速度约束直接嵌入线性二次最优控制,推导零阶和一阶导弹动力学下的有界最优制导律;关键洞察是利用早期未饱和区间预判后续饱和并提前机动。非线性仿真显示其在饱和场景下较无约束和软约束方法脱靶更小、调参更少。

A Transformer-Based Mixture-of-Experts Framework for False Data Injection Attack Detection and Localization Figure 1
2026-06-16math.OC

A Transformer-Based Mixture-of-Experts Framework for False Data Injection Attack Detection and Localization

Ruslan Abdulin, Mohammad Rasoul Narimani

which limits scalability and applicability [4]. In contrast, ˚: Department of Electrical and Computer Engineering, California, data, offering greater flexibility and scalability for practical, and localization can be formulated as a multi-label classi-, fication problem with two label types: graph-level labels for, attack detection and node-level labels representing the status, of each bus. For simplicity, we use binary labels, where 0

2026-06-16视觉感知

针对智能电网虚假数据注入攻击中传统残差检测易被绕过、单一图滤波模型难适应多样攻击模式的问题,本文提出 EOTConvMoE,将拉普拉斯位置编码、扩散偏置自注意力与由 Chebyshev/ARMA 图卷积组成的密集 MoE 结合,用网格状态自适应选择滤波行为。在 IEEE 118/300 节点与 NYISO 负荷仿真数据上,检测 F1 最高 93.91%、定位 F1 最高 84.97%,优于多类基线且误报较低。

Real-time nonlinear model predictive control framework for event-triggered switching in industrial batch polymerization process Figure 1
2026-06-16math.OC

Real-time nonlinear model predictive control framework for event-triggered switching in industrial batch polymerization process

Chenchen Zhou, Zuzhen Ji, Jose Matias

bDepartment of Mechanical Engineering, Zhejiang University of Technology, Hangzhou

2026-06-16规划控制

针对批次聚合过程无稳态、强非线性且由状态触发多阶段切换,传统 PID 或显式混合整数 NMPC 难以实时部署的问题,论文将逻辑平滑切换、advanced-step 热启动、变量缩放和固定迭代预算整合为统一 NMPC,并给出平滑误差界与调参准则。工业气液聚合闭环仿真含估计器表明,相比 PID 和常规 NMPC,约束满足更好、批次时间更短;但结果仍主要限于仿真,实际受限算力与参数不确定性尚未充分验证。

Controller and Control Architecture Co-Design via Mixed-Integer System-Level Synthesis Figure 1
2026-06-16math.OC

Controller and Control Architecture Co-Design via Mixed-Integer System-Level Synthesis

Chenchen Zhou, Jose Matias

and indicator constraints zero unavailable FIR response blocks before the selected delays. For, With these synthesis tools available, the remaining question is how to choose the architecture it-

2026-06-16规划控制

面向网络化机器人/多智能体控制中传感器、执行器与通信延迟需和控制器一起设计的问题,本文把有限时域输出反馈 SLS 响应与离散架构选择耦合,形成可全局求解的混合整数凸规划,避免只限 QI 或靠稀疏正则化。车队算例显示,在 8748 个架构中仅 99 个满足 QI;同等架构成本下,选出的非 QI 架构相对最佳 QI 架构将性能损失降低 3.8 倍,并优于正则化和模板基线。

Representation Costs in Data Science: Foundations and the Quasi-Banach Spaces of Deep Neural Networks Figure 1
2026-06-16math.FA

Representation Costs in Data Science: Foundations and the Quasi-Banach Spaces of Deep Neural Networks

Greg Ongie, Rahul Parhi

Marquette University, University of California, San Diego

2026-06-16优化控制

本文针对仅用参数范数难以刻画过参数模型函数复杂度与归纳偏置的问题,提出以参数空间正则化诱导“表示成本”的统一函数空间框架。核心洞察是把核方法、wavelet/Besov 空间、浅层网络变分空间等放入同一表示定理与非参数等价视角;主要结果证明深度 L 的 ReLU 网络原生空间为 p=2/L 的可 p-范拟 Banach 空间,因而 L>2 时其偏置不能由普通范数刻画。

CVXPY 1.9: Recent Advances in Optimization Modeling Software Figure 1
2026-06-16math.OC

CVXPY 1.9: Recent Advances in Optimization Modeling Software

William Zhang, Parth Nobel, Aryaman Jeendgar, Riley Murray, Philipp Schiele, Steven Diamond

ARYAMAN JEENDGAR, Technical University of Munich and International Computer Science Institute, Germany, RILEY MURRAY, Sandia National Laboratories, USA, CVXPY began in 2013 as a Pythonic modular implementation of the modeling principles of CVX [22] in MATLAB., Aryaman Jeendgar, Technical University of Munich and International, Riley Murray, Sandia National Laboratories, Livermore

2026-06-16优化算法

面向凸优化建模中表达友好性、参数化重复求解效率与求解器接口割裂的问题,论文总结了 CVXPY 1.1 到 1.9 的系统演进:以统一 CQP 标准形重构规范化流程,引入 stacked-slices 后端、N 维表达式、显式稀疏变量、多属性变量、量子信息相关锥/原子及 DNLP 语法。结果表明其扩展了可建模问题范围并提升参数化编译效率,但具体性能增益在片段中未充分说明。

Collective Optimization on Riemannian Manifolds with Bounded Curvature Figure 1
2026-06-16math.OC

Collective Optimization on Riemannian Manifolds with Bounded Curvature

Hui Huang, Dohyun Kim, Hansol Park

Acknowledgment. The work of H. Huang was supported by the starting grant from Hunan University.

2026-06-16优化算法学习理论

针对流形约束优化中欧氏嵌入与投影会扭曲几何、且在一般流形上缺乏规范表示的问题,本文将无导数的共识优化完全内禀化,用测地距离、指数/对数映射构造粒子与均场动力学。主要结果是在有界截面曲率条件下证明粒子系统和 McKean–Vlasov 动力学的全局适定性,并给出均场方程收敛到全局最小点的条件;球面、双曲空间和 SO 群实验支持其在非凸流形优化中的有效性。

Bayesian Optimization for Learning Nonlinear MPC in Autonomous Agent Navigation Figure 1
2026-06-16cs.RO

Bayesian Optimization for Learning Nonlinear MPC in Autonomous Agent Navigation

Lorenzo Ortolani, Gabriel Voss, Gabriele Beltrami, Francesco Dorati, Tommaso Felice Banfi

2026-06-16机器人规划控制优化算法

面向未知动态环境中移动/足式机器人导航对实时避障与MPC权重调参敏感的问题,论文提出无地图滚动时域框架:由LiDAR高斯占据表示与A*生成局部轨迹,再用带平滑障碍势垒的非线性MPC跟踪,并通过TPE贝叶斯优化离线搜索11维控制参数。Gazebo与Unitree Go2实机结果显示,仿真调参可直接迁移,部署成功率最高90.0%,仿真综合指标平均提升38.9%。

A Discrete KKT Variational Characterization of the Local Minimality of the Mahler Volume in Centrally Symmetric Polytopes Figure 1
2026-06-16math.OC

A Discrete KKT Variational Characterization of the Local Minimality of the Mahler Volume in Centrally Symmetric Polytopes

Daniel Martín Jiménez Cuevas

2026-06-16优化控制

针对 Mahler 猜想中中心对称多面体局部极小性的离散刻画问题,论文绕开传统光滑扰动分析,将顶点径向参数作为优化变量,推导极体体积耦合下的 KKT 驻点条件,并用二阶变分谱分析与单纯截断比较刻画稳定性。主要结果表明 Hanner 轨道(超立方体及其对偶)在模 GL(n,R) 的径向多面体扰动层内为严格、拓扑孤立的局部极小,并给出二次定量稳定界。

PH-KAN: Port-Hamiltonian Kolmogorov-Arnold Network Figure 1
2026-06-16math.OC

PH-KAN: Port-Hamiltonian Kolmogorov-Arnold Network

Achraf El Messaoudi (UMLP, ENSMM, FEMTO-ST), Karim Cherifi (UMLP, Yann Le Gorrec (UMLP, Yongxin Wu (UMLP

when no analytical model is available. In this context, port-, model must therefore be inferred directly from available, ∗This work has been supported by the EIPHI Graduate School (contract:, trajectory data are available. Given N samples

2026-06-16优化控制

针对非线性系统辨识中黑箱模型难保物理结构、PH-MLP又难解释的问题,论文提出PH-KAN,用KAN分别参数化互连、耗散、哈密顿量和输入映射,并以构造方式满足端口哈密顿约束。在PMSM基准上,PH-KAN能较准确滚动预测,部分规模下优于结构匹配的PH-MLP,剪枝后还能显露哈密顿量的可分二次结构和J矩阵的主要状态依赖;但真实构成项未完全恢复,增益可能部分来自scaling / data。

Risk or Replace: Efficient Asymptotics for Data-Driven Maintenance Figure 1
2026-06-16math.OC

Risk or Replace: Efficient Asymptotics for Data-Driven Maintenance

Poulad Moradi, Joachim Arts, Melvin Drent, Collin Drent

Department of Industrial Engineering and Innovation Sciences, Eindhoven University of Technology, Eindhoven, the Netherlands, PO BOX 513, Department of Information Systems and Operations Management, Tilburg University, the Netherlands, PO Box 90153, 5000 LE, Luxembourg Centre for Logistics and Supply Chain Management, University of Luxembourg, Luxembourg City, Luxembourg, 6, rue Richard, The growing availability of condition monitoring data also transforms CBM strategies and allows orga-, often been necessary because degradation data were traditionally available only during downtime. However

2026-06-16安全鲁棒

针对异质设备退化参数不可观测、最优状态维修可表述为高维 POMDP 而难以求解的问题,论文提出用退化数据估计“全知 Oracle”阈值策略的 EOP 方法,并在失效阈值与成本同步放大的 scaling 下证明一致估计时 regret 收敛为零;真实与仿真实验显示其 regret 很低,且在可精确求解 POMDP 的小规模情形最优性差距可忽略。

The Regional Boundary Reconstruction Problem of the Initial State for Fractional Semilinear Systems Figure 1
2026-06-16math.OC

The Regional Boundary Reconstruction Problem of the Initial State for Fractional Semilinear Systems

Khalid Zguaid, Fatima Zahrae El Alaoui, Delfim F. M. Torres

EMA Team, LRST Laboratory, The Higher School of Education and Training, Ibnou Zohr University, TSAN Team, TSI Laboratory, Moulay Ismail University, Center for Research and Development in Mathematics and Applications (CIDMA), Department of Mathematics, University of Aveiro, theory encompasses many useful concepts, such as stability, controllability, and observability. Our primary interest

2026-06-16学习理论三维

针对半线性时间分数阶系统中仅依赖部分边界观测重构初始状态仍缺少稳健理论的问题,论文将边界子区域重构转化为适当内部子区域的区域可观测性分析。其核心是利用解析半群、Caputo 导数框架和不动点/HUM 方法,建立边界可观测与线性部分内部近似可观测之间的联系,并推出收敛到目标边界初始状态的迭代序列;数值例子用区域和点传感器验证了算法与理论一致。

2026-06-15

21 篇
Lehner's operator norm formulas, semidefinite programming, and spiked matrix models Figure 1
2026-06-15math.PR

Lehner's operator norm formulas, semidefinite programming, and spiked matrix models

Dmitriy Kunisky

Department of Applied Mathematics & Statistics, Johns Hopkins University

2026-06-15优化控制

本文关注 Lehner 算子范数/谱边公式在自由概率与随机矩阵中的可计算性:原公式需解正定矩阵上的非线性优化。核心做法是把半圆族和 Rademacher 族情形统一改写为线性半定规划,并给出原始/对偶形式、互补松弛与最优性误差估计。进一步将半圆 SDP 用于尖峰矩阵模型,重证相关高斯噪声下的 BBP 相变,并提出主特征向量涨落协方差可由对偶最优解刻画的非普适各向异性猜想及数值证据。

Optimal Hidden-Target Learning for Online Inventory Optimization on General Convex Sets Figure 1
2026-06-15cs.LG

Optimal Hidden-Target Learning for Online Inventory Optimization on General Convex Sets

Anthony Pineci, Yunzong Xu

2026-06-15优化算法

本文针对在线库存优化中“库存结转导致可行动作依赖历史”的难点,研究一般有界凸容量集合下的学习控制。核心洞察是维护隐藏目标并投影到当前可行集,同时用与投影一致的范数度量目标—执行间隙,使其化为一维队列过程。结果将一般凸集静态遗憾对共同需求概率的依赖从1/μ改进到1/√μ并给出匹配下界,还得到强凸损失的多对数遗憾和适应路径变化的动态遗憾保证,实验用合成与真实库存数据验证趋势。

Which Directions Matter? Sparse Design for Affine Robust Optimization Figure 1
2026-06-15cs.LG

Which Directions Matter? Sparse Design for Affine Robust Optimization

Pedro Chumpitaz-Flores, My Duong, Juan S. Borrero, Kaixun Hua

University of South Florida

2026-06-15优化算法安全鲁棒

论文关注鲁棒学习/优化中不确定方向字典过大、全量建模代价高的问题,提出在预算约束下选择少量关键方向来构造原子不确定集,并用支持函数覆盖目标将选择转化为单调子模优化。作者给出贪心算法的(1-1/e)近似保证、鲁棒值差证书和半径校准的样本外控制;实验显示在微预算下优于随机选择,可用少量方向逼近全模型表现。

A Statistical and Machine Learning Framework for Operational Threshold Detection and Deployable Dispatch Controller Development in Hydrogen Multi-Energy Systems Figure 1
2026-06-15cs.LG

A Statistical and Machine Learning Framework for Operational Threshold Detection and Deployable Dispatch Controller Development in Hydrogen Multi-Energy Systems

Shadi Heenatigala, Hasanika Samarasinghe

2026-06-15视觉感知规划控制

面向氢基多能源系统中电解槽何时启动、如何调度的问题,本文用一年5分钟级运行数据把统计检验与机器学习控制串联起来。核心洞察是制氢呈可再生富余驱动的阈值/二元运行:高光照才显著触发电解,太阳解释45.7%秩方差,需求有较弱抑制;随机森林揭示弱相关风电仍具重要非线性贡献,LSTM利用24小时自相关预测,强化学习用于优化氢收益调度。

Free Heavy-Tailed Lunch for Muon: A Theoretical Justification of Empirical Success Figure 1
2026-06-15math.OC

Free Heavy-Tailed Lunch for Muon: A Theoretical Justification of Empirical Success

Florian Hübler, Thomas Pethick, Suvrit Sra

Department of Computer Science, ETH Zurich, Switzerland, Department of Mathematics, Technical University of Munich, Germany, Munich Center for Machine Learning (MCML)

2026-06-15优化控制

本文针对 Muon 等非欧几里得矩阵更新优化器在 Transformer 训练中效果好但理论解释不足的问题,从重尾随机梯度的非凸优化出发,直接在原生范数几何中建模噪声。核心洞察是避开欧氏范数等价带来的维度损失,可在更强的核范数平稳性下给出 Muon 的最优样本复杂度,并证明相应下界;大语言模型实验支持该解释,同时提示其他 Schatten 几何也可能具竞争力。

Local convergence of Sussmann's infinite product for analytic vector fields Figure 1
2026-06-15math.CA

Local convergence of Sussmann's infinite product for analytic vector fields

Jérémy Le Borgne, Frédéric Marbach

2026-06-15学习理论

本文针对将 Chen 级数的 Sussmann 无限乘积从形式自由 Lie 代数推广到非线性控制系统时的收敛难题,核心洞察是不能只按括号长度估计,而需保留 Hall 基分解的组合结构来平衡系数衰减与解析 Lie 括号增长。主要结果证明:对解析控制仿射向量场,在初值和控制 L1 范数足够小时,该无限流乘积局部一致收敛并精确表示系统解。

A Generalized Plant Perspective on Linear-Convex Feedback Optimization Figure 1
2026-06-15eess.SY

A Generalized Plant Perspective on Linear-Convex Feedback Optimization

Fabian Jakob, Andrea Iannelli

Authors are with the University of Stuttgart, Institute for Systems The-

2026-06-15优化算法

针对反馈优化常依赖保守时间尺度分离、需预稳定且难兼顾瞬态性能与约束的问题,本文把 LTI 被控对象与梯度优化器统一表述为广义对象,并用 Zames–Falb 动态 IQC刻画凸代价梯度。其关键洞察是时间尺度分离只是静态乘子的特例;动态乘子可给出更紧稳定裕度,并支持 IQC 输出反馈综合。数值例子显示该框架可同时稳定不稳定对象、改善瞬态性能、纳入模型不确定性,并推广到带约束的动态投影原始-对偶控制器。

Joint Nuclear and $\ell_1$ Regularization for Logistic Matrix Regression with Applications to Brain Imaging Figure 1
2026-06-15stat.ME

Joint Nuclear and $\ell_1$ Regularization for Logistic Matrix Regression with Applications to Brain Imaging

Damian Brzyski, Aaron Cohen, Zijian Wang, Mario Dzemidzic, David A. Kareken, Jaroslaw Harezlak

2026-06-15优化控制

针对二分类标量-矩阵回归中高维矩阵预测变量难以同时保持可解释性与稳定估计的问题,本文提出 logistic SpINNEr,在逻辑损失上联合核范数与加权ℓ1惩罚,使系数矩阵兼具低秩和稀疏结构,并用 ADMM 结合 IRLS 求解。仿真实验显示其较仅用单一结构惩罚或线性 SpINNEr 更能恢复预测模式,脑影像应用中识别出与酒精使用障碍家族史相关的功能连接结构。

A simulation study on spatial exponential decay of perturbations in a two-dimensional wave equation with optimal boundary/line control Figure 1
2026-06-15math.OC

A simulation study on spatial exponential decay of perturbations in a two-dimensional wave equation with optimal boundary/line control

Benedikt Oppeneiger

Faculty of Mathematics, Chemnitz University of Technology, Germany, Optimization-based Control Group, Institute of Mathematics, Technische Universität Ilmenau, Germany.

2026-06-15规划控制学习理论

本文受一维双曲 PDE 最优控制中“局部扰动空间指数衰减”理论启发,考察二维波方程在边界/线控制下是否仍具域一致局部化。核心洞察是有限传播速度要求控制区域在空间上均匀分布;仿真比较外边界控制与规则内部线网格控制,发现只有后者在扩大方形区域上保持近似域一致的指数衰减,而纯边界控制随域增大明显退化。

Operator Calculus for Population-Based Optimization: A Mean-Field Convergence Theory Figure 1
2026-06-15math.OC

Operator Calculus for Population-Based Optimization: A Mean-Field Convergence Theory

Pekka Malo, Lauri Viitasaari, Patrik Nummi, Antti Suominen, Ankur Sinha, Olli Tahvonen

2026-06-15优化算法学习理论

针对进化策略、CBO、CMA-ES等群体/分布式优化方法收敛理论分散的问题,论文把算法统一表述为概率测度上的变异、选择、重组三类算子复合,并在小步长极限下导出保持算子分解的TRJ偏微分方程。其主要结果是给出模块化Lyapunov收敛原则:若各算子生成元的耗散估计可闭合,则均值场Lyapunov量及搜索误差指数衰减;实验仅作指数衰减的 sanity check,有限粒子界仍未展开。

A New Primal-Dual Algorithm with Convex Combination and Extrapolation for Convex-Concave Saddle Point Problems with Nonlinear Coupling Term Figure 1
2026-06-15math.OC

A New Primal-Dual Algorithm with Convex Combination and Extrapolation for Convex-Concave Saddle Point Problems with Nonlinear Coupling Term

Jialong Li, Zexian Liu, Xiaokai Chang

School of Mathematics and Statistics, Guizhou University, Guiyang 550025, P.R. China, School of Science, Lanzhou University of Technology, Lanzhou 730050, P.R. China

2026-06-15优化算法

针对带非线性耦合项的凸-凹鞍点问题中,传统原始-对偶法易受变量空间与映射空间不匹配、梯度滞后和线搜索依赖影响,论文提出 PDAce:在凸组合点处线性化 g,并将外推转移到映射空间以消除非线性残差。理论上证明无须线搜索的全局收敛与 O(1/N) 遍历速率;加速版在强凸条件下达 O(1/N²) 或线性收敛,实验在 QCQP、minimax 与指数耦合问题上显示更稳定高效。

Structured Noise Adaptation for Sequential Bayesian Filtering with Embedded Latent Transfer Operators Figure 1
2026-06-15cs.LG

Structured Noise Adaptation for Sequential Bayesian Filtering with Embedded Latent Transfer Operators

Naichang Ke, Pongpisit Thanasutives, Yoshinobu Kawahara

The University of Osaka, RIKEN Center for Advanced Intelligence Project (AIP), The University of Osaka & RIKEN Center for Advanced Intelligence Project (AIP)

2026-06-15优化控制

本文针对 ELTO-KF 在非平稳序列状态估计中使用固定过程/观测噪声协方差、易受动力学变化影响的问题,提出 ELTO-AKF:用结构化参数化保证协方差 SPD 并降低适配复杂度,将无导数优化得到的时不变噪声模型与基于残差和创新的在线噪声调整结合。实验显示其在非平稳 LiDAR 轨迹、高维 Lorenz 和 PDE 去噪任务中较 ELTO-KF 更稳健,尤其在高噪声和分段动力学变化下 MSE 明显降低。

Robustness without Wrinkles: Parallel Simulation and Robust MPC for Certified Deformable Manipulation Figure 1
2026-06-15cs.RO

Robustness without Wrinkles: Parallel Simulation and Robust MPC for Certified Deformable Manipulation

Wei-Chen Li, Jeffrey Fang, Sasanka Polisetti, Yuexi Song, Glen Chou

Georgia Institute of Technology, Atlanta, GA 30308

2026-06-15机器人规划控制安全鲁棒

针对绳索、布料等可变形物体在接触丰富场景中难以兼顾快速规划、感知/模型不确定性与安全约束的问题,本文提出 CORD-SLS:用接触平滑的 GPU 并行可微仿真提供可优化梯度,并结合基于 SLS 的输出反馈鲁棒 MPC 与保形预测校准误差界,生成高概率安全的可达管。仿真和硬件任务涵盖避障、布料折叠与展平,结果显示其在毫秒级规划下较基线提升安全性、速度和成功率。

Designing Efficient and Reachable Routes: The $k$-Step-Central Shortest Path Problem Figure 1
2026-06-15cs.DS

Designing Efficient and Reachable Routes: The $k$-Step-Central Shortest Path Problem

Johnson Phosavanh, Dmytro Matsypura

The Hong Kong Polytechnic University, The University of Sydney, demonstrate the efficiency and scalability of our algorithm on synthetic and real-world net-, centres that serve consumers. Our model can be used to select the locations of distribution cen-

2026-06-15优化控制

论文面向公交/物流等网络路线设计中“最短直达”与“覆盖可达”的冲突,提出 k-step-central shortest path:在所有最短路中选择 k 步邻域覆盖最大的路径。核心洞察是用可调 k 表示步行/接驳可达性,并证明无权图可多项式求解,给出带剪枝算法;加权情形则为 NP-hard。实验在最高 2000 节点的合成与真实路网验证可扩展性,并显示提升接驳可达性可用更短路线获得更大覆盖。

Lyapunov-Based Sample Complexity Analysis for Weakly-Coupled MDPs Figure 1
2026-06-15cs.LG

Lyapunov-Based Sample Complexity Analysis for Weakly-Coupled MDPs

Tianhao Wu, Matthew Zurek, Weina Wang, Qiaomin Xie

2026-06-15优化控制

本文针对弱耦合 MDP/Restless Bandit 在多臂共享资源下直接表格化会导致样本复杂度随臂数指数爆炸的问题,分析基于生成模型的 plug-in 学习。核心洞察是利用弱耦合结构和显式 Lyapunov 漂移替代难控的 bias function,并配合 LP 扰动分析转移经验模型误差。结果给出异质 WCMDP 首个多项式复杂度 PAC 保证,最优性差距约为 O(1/√N),同质 RB 在结构假设下可达 O(1/N^β)。

Battery Bidding under Price Uncertainty in Wholesale Electricity Markets Figure 1
2026-06-15math.OC

Battery Bidding under Price Uncertainty in Wholesale Electricity Markets

Vincent Yinjun-Wang, Madeleine Udell

2026-06-15安全鲁棒

针对批发电力市场中电池高卖价、低买价常被解读为策略性 withholding 的问题,论文建立价格接受型电池在有限价格情景下优化阶梯买卖报价曲线的模型,以 mean-CVaR 表达风险偏好,并将原 MILP 精确化为 LP。基于 CAISO 数据的分析显示,无市场力时不确定性和低电量也会推高保留电能价值;不确定性影响随 SoC 变化,风险管理会形成分层报价曲线。

A Semismooth Newton-Based Proximal Augmented Lagrangian Method for Joint Estimation of Multiple Gaussian Graphical Models with Clustered Structure Figure 1
2026-06-15math.OC

A Semismooth Newton-Based Proximal Augmented Lagrangian Method for Joint Estimation of Multiple Gaussian Graphical Models with Clustered Structure

Han Wang, Yue Liu, Yong-Jin Liu

School of Mathematics and Statistics, Fuzhou University, No.2, Center for Applied Mathematics of Fujian Province, School of, Mathematics and Statistics, Fuzhou University, No.2 Wulongjiang, tural assumptions. For instance, to handle cases where group labels are latent or

2026-06-15三维

针对多组高维数据联合估计高斯图模型时,稀疏性、跨图边值一致性与高精度求解难以兼顾的问题,论文研究带对数行列式损失和聚类稀疏正则的凸优化模型。核心在于给出解呈块对角的充要条件与筛选规则,并构造基于半光滑牛顿的近端增广拉格朗日算法,利用二阶信息求解子问题。实验在合成与真实数据上显示其较ADMM等一阶方法更快且更稳健,但具体收益仍可能受问题规模和数据设置影响。

Proof and More Variations of Bellman's Lost-in-a-forest Problem Figure 1
2026-06-15math.OC

Proof and More Variations of Bellman's Lost-in-a-forest Problem

Zhipeng Deng

2026-06-15优化控制

本文面向 Bellman“森林迷路”这一最坏情形逃逸路径最优化难题,动机是为仅在少数森林形状上有解析解的问题建立更一般的可计算框架。核心洞察是把未知起点与朝向下的边界命中约束转化为一族刚体变换边界的覆盖问题,并进一步等价为带邻域旅行商问题,文中给出等价性、存在性与离散收敛证明。主要结果还包括两条线搜索、与 Wetzel 单位弧覆盖问题的联系、闭合路径和三维扩展的公式、部分解析结论与数值结果。

Degree-Four Vector-Coordinate SoS Cannot Detect the MUB Upper Bound Figure 1
2026-06-15math.CO

Degree-Four Vector-Coordinate SoS Cannot Detect the MUB Upper Bound

Shreyhaan Sarkar

2026-06-15学习理论

本文围绕互无偏基(MUB)上界能否被四阶 Sum-of-Squares 证明检测这一问题,回应 Randomstrasse101 中维度 6、7 组基的向量坐标表述。核心洞察是用独立 Haar 随机正交基构造四阶伪期望,使向量坐标的四次等式和 2×2 半正定约束在低阶下都“看似可行”。主要结果表明,四阶向量坐标 SoS 即使在 m>d+1 时也无法反驳 MUB 存在;但若改用投影算子坐标,四阶 SoS 可恢复标准上界 m≤d+1,说明失败来自表述而非 SoS 框架本身。

Delay-dependent passivity and stability of linear port-Hamiltonian systems Figure 1
2026-06-15math.OC

Delay-dependent passivity and stability of linear port-Hamiltonian systems

Ikram El Haskouki, Hannes Gernandt

2026-06-15优化控制

针对端口哈密顿系统在加入传输、通信等常见时滞后可能失去无源性与稳定性的问题,本文把Lyapunov–Krasovskii储能泛函、Wirtinger不等式与原有能量结构结合,给出多常值时滞线性系统的时滞相关/无关LMI无源判据,并证明负反馈互联下无源性保持;结果还覆盖指数稳定性条件,并在区域供热网络与含时滞阻尼振子中验证。

Scalable Deep Unfolding of Conic Optimizers Figure 1
2026-06-15math.OC

Scalable Deep Unfolding of Conic Optimizers

Alex Oshin, Rahul Vodeb Ghosh, Evangelos A. Theodorou

Georgia Institute of Technology

2026-06-15优化控制

面向机器人中实时SCP/MPC常遇到的大规模锥优化,论文指出深度展开全量COSMO的瓶颈在于线性求解反传的二次内存和PSD投影重特征值不稳定。其核心做法是用仅依赖矩阵-向量乘的无矩阵隐式微分,以及Dalečkii–Krein型PSD反传规则,从而可学习轻量超参数策略和热启动。实验在协方差 steering、SDP/SOCP等任务上相对现有求解器最高约50倍加速,在SCP子问题中较COSMO超过30倍,但高精度与跨问题泛化仍有限。

2026-06-12

19 篇
Distribution-Agnostic Robust Trajectory Optimization via Chance-Constrained Reinforcement Learning Figure 1
2026-06-12math.OC

Distribution-Agnostic Robust Trajectory Optimization via Chance-Constrained Reinforcement Learning

Yashdeep Chaudhary, Roberto Armellin, Harry Holt, Marco Sagliano

2026-06-12强化学习规划控制优化算法安全鲁棒

针对航天轨迹规划中不确定性常呈非高斯、难以解析重写机会约束的问题,论文提出先用确定性优化生成名义轨迹,再用强化学习学习前馈修正与时变线性反馈的仿射闭环增稳框架,并以采样 rollout 的上尾分位数和协方差惩罚评估概率可行性。地火转移和火箭定点着陆实验显示,该方法在保持经验概率约束可行的同时,上尾燃料代价具竞争力,但其保证依赖仿真与有限样本估计。

Optimal Proximity Bound and Product Function Estimates in Integer Linear Programming Figure 1
2026-06-12math.OC

Optimal Proximity Bound and Product Function Estimates in Integer Linear Programming

Iskander Aliev, Gennadiy Averkov, William Jones, Timm Oertel

2026-06-12学习理论

本文关注整数线性规划中如何从线性松弛最优顶点定位最优整数解这一经典动机,核心洞察是用行格体积 Δ(A)=√det(AAᵀ) 及最大子式公因子刻画欧氏邻近性,而非依赖传统子式上界。主要结果给出 ∥x*−z*∥₂≤Δ(A)/gcd(A)−1,并证明渐近最优;同时建立乘积函数 ∏(xi+1) 的一般上界及非负矩阵、背包场景推论。

Differential Geometric Conditions for Koopman Linearizability of Control-Affine Systems Figure 1
2026-06-12math.OC

Differential Geometric Conditions for Koopman Linearizability of Control-Affine Systems

Shankar A. Deka

controllable linear system. Our examples illustrate the ease of, Shankar A. Deka is with Department of Electrical Engineering and, Automation, School of Electrical Engineering, Aalto University, Maarin-, are limited to controllable linear systems, this re-, input systems into controllable linear systems (which is, which immediately breaks the controllability assumption., Controllability of the transformed linear system is key, for the preservation of controllability under Koopman

2026-06-12规划控制

针对受控非线性系统中有限维 Koopman 线性表示何时存在这一基础问题,本文从微分几何出发,给出仅依赖漂移与控制向量场的可检验条件,包括 Lie 代数秩与交换性条件。结果表明这些条件对 Koopman 线性化是必要的,并在控制不变流形上具有充分性;若要求提升后的线性系统可控,再加一项条件可得到充要刻画,同时说明仅能线性化自治部分并不保证受控系统可 Koopman 线性化。

A Sustainable Integrated Framework for Multi-Type Urban Waste Collection and Recycling Figure 1
2026-06-12math.OC

A Sustainable Integrated Framework for Multi-Type Urban Waste Collection and Recycling

Víctor Blanco, J. Fernando Camacho-Vallejo, Yolanda Hinojosa

†Institute of Mathematics (IMAG), Universidad de Granada, Spain, facility location costs are constrained by the available investment budget.

2026-06-12优化控制

面向城市多类型垃圾回收中异质废物流、车辆容量和设施投资约束交织导致的高成本问题,论文提出 SWIFT,将中转设施与处理厂选址、两级车辆路径和重复卸载统一为一个优化模型。其核心洞察是用中间汇集点协调小车收集与大车转运,在预算内形成更紧凑的服务区域。基于麦德林场景的实验显示,该框架可生成协同的设施—路径方案,降低运输与处理运营成本并提升车辆利用率。

Towards a Control interpretation of Quantum Advantage Figure 1
2026-06-12math.OC

Towards a Control interpretation of Quantum Advantage

Dario Pighin

ator controllability problem on the special unitary group SU(N), and, we prove operator controllability by a Lie-algebraic argument and, By a controllability result, we show how the problem can be solved

2026-06-12规划控制

本文试图回答量子优势何时可由控制理论刻画:把量子计算视为双线性受控薛定谔系统上的可达/最短时间问题,并以关于问题规模的多项式最小时间界定义优势。主要结果是在超导数字平台上用李代数可控性与门串接证明 QFT 具有 O(n²) 时间上界;在中性原子平台上将 MIS/QAOA 重写为连续最优控制,给出到 MIS 子空间的可达性分析,但 MIS 的严格量子增益仍带条件性。

Coordinate-wise Polyhedral Method for Eliciting Multivariate Linear Utility and Univariate Nonlinear Utility Functions Figure 1
2026-06-12math.OC

Coordinate-wise Polyhedral Method for Eliciting Multivariate Linear Utility and Univariate Nonlinear Utility Functions

Jiaxin Wei, Jia Liu, Huifu Xu

∗School, University, ‡Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong, Hong Kong

2026-06-12优化控制

针对传统多面体偏好诱导虽经验有效但缺乏收敛保证的问题,本文提出坐标式多面体方法:先预设几何正交切割,再由线性方程构造配对查询。该方法证明多维线性效用不确定集直径线性收缩,并扩展到一维分段线性及一般单调 Lipschitz 非线性效用,给出 Kantorovich 距离收敛与近似误差界;数值实验显示线性情形接近标准方法,非线性情形收敛稳定。

A smoothing extended sequential quadratic method for difference-of-convex optimization over a convex composite inequality constraint Figure 1
2026-06-12math.OC

A smoothing extended sequential quadratic method for difference-of-convex optimization over a convex composite inequality constraint

Jiefeng Xu, Ting Kei Pong, Yongle Zhang

Department of Applied Mathematics, the Hong Kong Polytechnic, University, Hong Kong, People’s Republic of China., *School of Mathematical Sciences, Sichuan Normal University

2026-06-12优化算法

针对带凸复合不等式约束和紧凸集约束的DC优化,既有罚函数/增广拉格朗日方法常需难解子问题或预设精度与罚参数。本文将ESQM与变量光滑结合,每步仅做一次近端梯度并显式更新光滑与罚参数;在约束资格条件下证明获得(ε,ε)-KKT点的O(ε^-3)复杂度,凸情形还给出全序列收敛及Hölder增长条件下的局部速率。

Clipping Makes Distributed and Federated Asynchronous SGD Robust to Stragglers Figure 1
2026-06-12cs.LG

Clipping Makes Distributed and Federated Asynchronous SGD Robust to Stragglers

Samuel Erickson, Mikael Johansson

2026-06-12安全鲁棒

针对异步 SGD 中慢节点产生陈旧梯度、使常步长训练收敛受最大延迟拖累的问题,论文从理论上解释梯度裁剪为何能稳定异步训练:在允许重尾噪声的 sub-Weibull 梯度模型下,裁剪通过控制更新范数去除 oracle 复杂度对最大延迟的依赖。结果给出同质与异质/联邦场景下的期望收敛界,并首次为异步优化建立高概率收敛保证;实验称裁剪在多种架构和延迟设置中优于普通及延迟自适应 ASGD。

A symmetric Gauss-Seidel based alternating proximal ALM for generalized Nash Equilibrium problems in Banach spaces Figure 1
2026-06-12math.OC

A symmetric Gauss-Seidel based alternating proximal ALM for generalized Nash Equilibrium problems in Banach spaces

Defeng Sun, Hailing Wang, Wei Zhao

Funding: The work of Defeng Sun was supported in part by the Research Center for Intelligent, †Corresponding Author. Department of Applied Mathematics, The Hong Kong Polytechnic Uni-, ‡Department of Applied Mathematics, The Hong Kong Polytechnic University, Hung Hom, §Department of Mathematical Sciences, Tsinghua University, Beijing, China, Department of, Applied Mathematics, The Hong Kong Polytechnic University, Hung Hom, Kowloon, Hong Kong, available for monotone GNEPs, In contrast to the extensive theory and algorithms available for finite-dimensional

2026-06-12优化控制

针对带联合线性约束的单调广义纳什均衡在大规模、无限维或随机场景中每步需解耦合均衡子问题的计算瓶颈,论文提出基于对称 Gauss-Seidel 的交替近端增广拉格朗日法,用二次替代将玩家策略改为交替无约束二次规划更新。理论上仅需伪梯度单调且 Lipschitz 连续即证明全局收敛和速率,并在带联合状态约束的风险中性 PDE 约束 GNEP 上给出初步数值验证。

Characterization and Computation of Feedback Nash Equilibria in Scalar Discounted N-Player Linear Quadratic Games Figure 1
2026-06-12eess.SY

Characterization and Computation of Feedback Nash Equilibria in Scalar Discounted N-Player Linear Quadratic Games

Chiara Cavalagli, Alberto Bemporad, Mario Zanon

tion) at IMT School for Advanced Studies Lucca.

2026-06-12优化控制

针对折扣标量 N 玩家线性二次博弈中现有方法多只能找到单个反馈纳什均衡、且折扣可能掩盖闭环不稳定的问题,本文显式分析折扣因子,区分有限代价 FNE 与稳定 FNE,并给出稳定充分条件。作者用聚合参数化将均衡求解化为标量根搜索,提出计算全部均衡的算法;在对称情形推导闭式对称 FNE 和多重均衡条件。数值结果显示均衡数随参数显著变化,且确有有限代价但不稳定的均衡出现。

Scheduling of Star Observations under Uncertain Conditions: A Comparison of Models and Solvers Figure 1
2026-06-12math.OC

Scheduling of Star Observations under Uncertain Conditions: A Comparison of Models and Solvers

Thomas Rahab Lacroix (G-SCOP, G-SCOP\_GROG), Pierre Lemaire (G-SCOP\_GROG), Nadia Brauner (G-SCOP\_ROSP)

tical nights are available to observe J stars that have been identified as of interest by, ultimately be available (Stein et. al. 2019), abilities over the number of available nights are known (Rahab Lacroix et. al. 2025). Since

2026-06-12优化算法

论文针对地面望远镜观测受天气影响、实际可用夜晚数不确定的问题,将其建模为并行机调度下的鲁棒 min-max regret,并比较 ST、TD、AF 三类整数规划模型及 HiGHS/CPLEX。核心洞察是先高效求各可用夜晚数下的最优基准,AF 虽不便直接用于部分评估,却最适合求 OPTm。720 个真实规模实例显示 AF 显著优于 TD/ST,CPLEX 平均约快于 HiGHS 6 倍。

A Survey of Community Detection from an Operations Research Perspective: Taxonomy, Mathematical Formulations, Modularity Functions, and Benchmark Datasets Figure 1
2026-06-12math.OC

A Survey of Community Detection from an Operations Research Perspective: Taxonomy, Mathematical Formulations, Modularity Functions, and Benchmark Datasets

Miguel A. Pozo Montaño, Sebastián V Taboh

∗Department of Statistics and Operational Research & Institute of Mathematics (IMUS), University of Seville., Department of Computer Science, University of Buenos Aires - Institute of Computer, and practical challenges (e.g., scalability, resolution limits, stability). This taxonomy is not merely

2026-06-12视觉感知数据集/基准

针对社区发现研究中术语、分类标准、模块度定义和评测实践分散的问题,本文从运筹学视角将其重构为网络上的组合优化/聚类建模问题。核心贡献是提出多维分类体系,并用统一的赋值框架覆盖互斥、重叠与模糊社区,梳理模块度函数、数学规划与算法方法及常用基准数据集。文章不提出新算法或实验增益,主要结果是提供可复用的建模与比较框架,便于后续研究明确假设、评估可复现性并定位研究空缺。

Flyby Distance Pursuit for Guarding a Target with an Inferior Guard Figure 1
2026-06-12math.OC

Flyby Distance Pursuit for Guarding a Target with an Inferior Guard

Navot Israeli, Vitaly Shaferman, Oded Golan

WALES Ltd., Ramat Gan, Israel, 5252226, Technion, Israel Institute of Technology, Haifa, Israel, 3200003

2026-06-12优化控制

针对传统守卫目标微分博弈只在守卫必然可捕获时才有解、难以描述“较慢守卫拦截较快攻击者入侵目标”的问题,论文提出 Flyby Distance Pursuit:以攻击者到达目标为终止条件,并用辅助状态记录全程最小间距。作者建立非线性无推力气动模型的 TPBVP 并用配点-NLP 数值求解,发现若只要求到达目标,攻击者可通过长航时、低末速规避;加入末端速度约束后,存在相关参数区间可实现捕获,揭示末速与掠过距离的权衡。

Randomized Optimal Switching Problem and Related Mirror Descent Flow Figure 1
2026-06-12math.OC

Randomized Optimal Switching Problem and Related Mirror Descent Flow

Yuchao Dong

†School of Mathematical Sciences, Tongji University & Key Laboratory of Intelligent Comput-, ing and Applications (Tongji University), Ministry of Education, Shanghai 200092, China (yc-

2026-06-12生成模型

本文面向连续时间最优切换在多模式扩散系统中难求解、难探索的问题,将确定性切换放松为由状态依赖 CTMC 生成矩阵驱动的随机策略,并加入 KL/熵正则。核心结果是给出正则化 HJB 系统的唯一光滑解和 Gibbs 型最优切换强度,证明其以 O(λ log(1/λ)) 逼近经典值函数;同时提出对数策略空间中的镜像下降流,证明良定性、值函数单调下降及常温/退火调度下的收敛误差界。

Maximum Utility Split Method for Utility Preference Elicitation Figure 1
2026-06-12math.OC

Maximum Utility Split Method for Utility Preference Elicitation

Bo Chen, Jia Liu, Huifu Xu

School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, Department of Systems Engineering and Engineering Management, The, Chinese University of Hong Kong, Hong Kong, China., issue depending on available information. One is to use available empirical information, e.g., a

2026-06-12优化控制

针对偏好鲁棒优化中效用函数歧义集过大、传统 RUS/RRUS 缺少收敛保证且问卷成本高的问题,本文提出最大效用分割 MUS:自适应选择效用上下界差最大的确定结果,并设定彩票概率在该点将不确定区间折半。作者给出基于线性规划的区间算法和未收敛时的名义效用构造;数值实验显示其比 RUS、RRUS 和多面体方法更快缩小歧义集,并在投顾组合优化中带来更有效的偏好 elicitation。

Abstract Dynamic Programming on Partially Ordered Spaces Figure 1
2026-06-12math.OC

Abstract Dynamic Programming on Partially Ordered Spaces

Chengyuan Peng, John Stachurski, Jingni Yang

School, University

2026-06-12优化控制

本文针对抽象动态规划中“序稳定性”难以验证的问题,将偏序值空间与拓扑/度量结构结合,用全局稳定性、压缩性等更可检查条件推出最优性。核心洞察是由序结构承担 Bellman 最优性证明,由拓扑稳定性保证算法收敛。主要结果包括价值函数唯一性、最优平稳策略存在、VFI/HPI/OPI 收敛,并说明弱条件下非平稳策略不优于平稳策略;应用覆盖 MDP、结构估计、无折扣最优停止和贝叶斯序贯分析。

A Stabilized Path-Space Approach to Diffusion-Based Posterior Sampling Figure 1
2026-06-12cs.LG

A Stabilized Path-Space Approach to Diffusion-Based Posterior Sampling

Evan Scope Crafts, Umberto Villa, Saviz Mowlavi, Yanting Ma, Hassan Mansour, Wael H. Ali

Department of Biomedical Engineering, The University of Texas at Austin, Austin, TX ()., Mitsubishi Electric Research Laboratories, Cambridge, MA

2026-06-12生成模型

针对扩散先验在贝叶斯逆问题中常依赖启发式似然引导、在非线性算子和多峰后验下易产生偏差的问题,本文将后验采样表述为似然加权轨迹测度匹配,并用时间重参数化消除初值函数偏置,再以信赖域路径空间优化学习控制漂移。实验在有解析或高质量参考后验的基准上显示,其采样精度、鲁棒性和不确定性量化优于多种现有方法。

Two-Layer Linear Auto-Regressive Models Estimate Latent States Figure 1
2026-06-12cs.LG

Two-Layer Linear Auto-Regressive Models Estimate Latent States

Yahya Sattar, Sunmook Choi, Leo Maynard-Zhang, Yassir Jedra, Maryam Fazel, Sarah Dean

Imperial College London

2026-06-12优化控制

本文关注序列/机器人世界模型中“下一步预测”是否会学到真实隐状态这一理论问题。作者在部分可观测线性动力系统上提出两层线性自回归模型,证明其端到端经验风险最小化会近似卡尔曼滤波,隐藏表示与最优状态估计仅差相似变换;同时给出良性非凸景观、有限样本预测/参数误差和隐状态恢复保证,并用仿真验证。

A Communication Complexity Lower Bound for Nonuniformly Convex Consensus Optimization Figure 1
2026-06-12math.OC

A Communication Complexity Lower Bound for Nonuniformly Convex Consensus Optimization

Demyan Yarmoshik, Maxim Klimenko

2026-06-12优化算法学习理论

针对去中心化/联邦式优化中各节点函数条件数不一致时,能否仅依赖全局条件数获得通信加速的问题,本文给出反面答案。作者用谱图理论在扩展图边上嵌入随时间旋转的星形结构并保持连通谱性质,构造时间变化网络下的困难实例,证明任意算法至少需 Ω(χ𝒢√κg log(n/χ𝒢) log(1/ε)) 轮通信,说明非均匀情形无法达到均匀正则假设下的轮复杂度。

2026-06-11

34 篇
An Efficient Method for the Optimal Control of Microgrids Under Uncertainties using Local Reduction Figure 1
2026-06-11math.OC

An Efficient Method for the Optimal Control of Microgrids Under Uncertainties using Local Reduction

Edoardo Scaccia, Eric C. Kerrigan, Anna Sadowska

∗Department of Electrical and Electronic Engineering, Imperial College, ∗∗Department of Aeronautics, Imperial College London, SW7 2AZ

2026-06-11规划控制

面向可再生出力、负荷、电价和电池效率不确定下的微电网容量配置与功率调度,论文将储能/电网互斥逻辑分别建成 big-M MILP 与精确光滑 NLP,并扩展 local reduction 只生成相关场景。100,000 次蒙特卡洛显示两种 formulation 平均物理可行率均超 90%,最多仅需 10 个场景,较全枚举和大规模场景法显著降算量。

Analysis of a Distributed Optimization-Based Control Architecture for Inverter-Interfaced Virtual Power Plants Figure 1
2026-06-11eess.SY

Analysis of a Distributed Optimization-Based Control Architecture for Inverter-Interfaced Virtual Power Plants

Vivek Khatana, Soham Chakraborty, Murti V. Salapaka

2026-06-11规划控制优化算法

本文面向逆变器接口虚拟电厂的二级控制问题,动机是同时实现无功功率分担、电压/频率调节与分布式可实现性。核心在于分析一种基于一致性约束优化的补偿控制架构,将GFM电压补偿与GFL有功参考更新耦合,并用Lyapunov/耗散性推导采样控制下的有界条件。主要结果是给出前向不变子水平集和状态有界性定理;但文中缺少摘要、实验与结论,判断受限于PDF文本抽取质量。

From the Linear Quadratic Regulator (LQR) to the (Deterministic) Kalman Filter in Two Easy Steps Figure 1
2026-06-11eess.SY

From the Linear Quadratic Regulator (LQR) to the (Deterministic) Kalman Filter in Two Easy Steps

Bassam Bamieh

∗Department of Mechanical Engineering, and Center for Control, Dynamical Systems, and Computation

2026-06-11优化控制

本文针对 Kalman-Bucy 滤波的随机表述之外,说明如何从确定性最小 L2 不确定性原则理解状态估计。核心洞察是把含线性项的仿射二次估计问题用齐次坐标嵌入为扩展 LQR,并通过终端条件 LQR 的 cost-to-arrive Riccati 方程分块,直接导出动态观测器与传统 Kalman 滤波 DRE;文中主要贡献是教程式统一推导,并未给出新的实验验证。

Averaging of Random Vibrations in Mechanical Systems in the Sense of Ito, Stratonovich, and Sussmann Figure 1
2026-06-11math.OC

Averaging of Random Vibrations in Mechanical Systems in the Sense of Ito, Stratonovich, and Sussmann

Raik Suttner, Christian Ebenbauer

2026-06-11优化控制

针对机械系统中高频大幅振动控制从确定性周期输入走向随机输入时缺乏平均化理论的问题,本文将仿射联络控制系统的确定性振动平均推广到非周期随机过程。核心洞察是通过变量变换把相应 SDE 化为带随机扰动的 ODE,从而得到含控制向量场对称积的确定性平均系统;并证明 Itô、Stratonovich 与 Sussmann 解释下解一致。结果在非完整独轮车随机源寻优仿真中验证了轨迹逼近平均系统。

How Low Can You Go? Active Learning for Sparse Model Discovery in the Ultra-Low-Data Limit Figure 1
2026-06-11cs.LG

How Low Can You Go? Active Learning for Sparse Model Discovery in the Ultra-Low-Data Limit

Ana Larrañaga, Urban Fasel, Steven L. Brunton

Department of Mechanical Engineering, University of Washington, Seattle, WA 98195, United States, NSF AI Institute in Dynamic Systems, University of Washington, Seattle, WA 98195, United States, Department of Aeronautics, Imperial College London, SW7 2AZ, United Kingdom

2026-06-11优化控制

针对真实动力系统实验或高保真仿真数据昂贵、低数据下方程发现易受噪声和采样偏差影响的问题,本文将主动学习与 E-SINDy 结合,用集成模型的认知不确定性按 query-by-committee 选择最有信息量的初始条件或时空区域,并给出实用收敛准则。在 Lorenz、Burgers 和 Kuramoto–Sivashinsky 基准上,方法在不同噪声和数据预算下通常比随机采样用更少样本识别正确控制方程。

LPV Updates for Sequentially Linearized Moving Horizon Estimation of Nonlinear Systems Figure 1
2026-06-11math.OC

LPV Updates for Sequentially Linearized Moving Horizon Estimation of Nonlinear Systems

Jiaxin Ji, Jan Heiland, Dimitrios S. Karachalios, Hossam S. Abbas

only a limited number of measurements is available. Therefore, we start the state estimation

2026-06-11优化控制

针对非线性移动窗估计每个采样步需解 NLP、在线雅可比计算昂贵的问题,本文将系统嵌入 quasi-LPV 形式,用由估计状态给出的调度参数离线预结构化并在线更新 QP/KKT,提出两种 LPV-SQP-MHE 线性化策略。在双连杆机器人仿真中,相比 CasADi/IPOPT 的非线性 MHE 显著降低运行时间,同时保持相近估计精度,且少量迭代即可收敛。

Pricing mobility services under decision-dependent demand uncertainty: a carsharing case Figure 1
2026-06-11math.OC

Pricing mobility services under decision-dependent demand uncertainty: a carsharing case

Jiali Deng, Giovanni Pantuso

2026-06-11安全鲁棒

面向分时/共享汽车定价,论文指出传统把需求视为外生随机或价格的确定函数,会忽略价格改变用户采纳概率这一内生不确定性。作者将价格与预调度重定位建成决策依赖需求分布的两阶段随机规划,并为指数规模 MILP 设计专用 L-shaped 分解、闭式子问题分离、有效不等式与 cut sharing。真实车共享案例中,相比确定性价格弹性需求和外生随机需求基线,期望利润平均提升约 8.39% 和 8.53%,受控车辆分配还能提高服务率且利润损失较小。

Kernel-based identification of nonlinear port-Hamiltonian systems Figure 1
2026-06-11math.OC

Kernel-based identification of nonlinear port-Hamiltonian systems

Brayan M. Shali, Henk J. van Waarde

2026-06-11优化控制

针对非线性端口-Hamilton系统依赖物理先验、参数难以精确获得的问题,本文从输入-状态-输出数据出发做结构化辨识。核心思路是用RKHS表示Hamiltonian与输入映射,并用平方和形式处理互连/耗散的非负约束;主要结果给出表示定理,将无限维优化化为有限维非凸问题,并提出带收敛证明的求解算法,使所得模型保持被动性。

A Discrete Cumulative Distribution Transform via Optimal Transport Figure 1
2026-06-11math.ST

A Discrete Cumulative Distribution Transform via Optimal Transport

Harbir Antil, Gustavo Rohde, Aryan Saxena

Center for Mathematics and Artificial Intelligence and, Department of Mathematical Sciences, George Mason University, Fairfax VA 22030., Department of Biomedical Engineering and Electrical and, Computer Engineering University of Virginia Charlottesville, VA 22908, USA. ∗

2026-06-11优化控制

针对经验分布、直方图等离散数据中连续 CDT 需插值或密度估计的问题,本文在一维原子测度上用单调分位映射构造完全离散 CDT。核心洞察是固定参考测度可得到统一维度表示,但原子间确定性传输不能分裂质量,因此有限分辨率精确重建需满足累积质量兼容条件。文中给出前向与逆变换线性时间算法,证明参考细化下重建弱收敛,并扩展到带阈值稳定的离散 signed CDT。

A Unified Zeroth-Order Approach for Decentralized Minimax Optimization Figure 1
2026-06-11math.OC

A Unified Zeroth-Order Approach for Decentralized Minimax Optimization

Haoyuan Cai, Yike Zhao, Aleksandar Armacki, Jie Chen, Ali H. Sayed

gradient information is either unavailable or computationally, with the School of Engineering, ´Ecole Polytechnique F´ed´erale de Lau-, Jie Chen is with the School of Artificial Intelligence, Northwestern Poly-

2026-06-11优化算法

面向黑箱、隐私或大模型微调中梯度不可得且数据分散的极小极大优化,论文提出统一的去中心化零阶框架 ZOMA,将坐标/随机平滑估计、GT/ED/EXTRA 偏差校正与 STORM/PAGE/L2S 加速纳入同一分析。结果给出随机与有限和场景的统一收敛和复杂度,部分实例匹配集中式零阶查询复杂度并随节点数线性加速,同时揭示通信效率与函数查询效率、ED 与 GT、不同估计器之间的取舍。

A Riemannian Approach to Low-Rank Optimal Transport Figure 1
2026-06-11cs.LG

A Riemannian Approach to Low-Rank Optimal Transport

Pratik Jawanpuria, Bamdev Mishra

2026-06-11优化控制

本文针对低秩最优传输虽能降低经典 OT 的二次复杂度、但现有镜像下降法依赖步长和正则调参且难利用曲率的问题,将平衡/非平衡低秩正耦合建模为带 Fisher-Rao 度量的黎曼流形,推导投影、回缩和 Hessian-vector 计算,并适配 OT、GW、融合 GW 等目标。实验显示其一阶/二阶无正则求解器在多种规模上迭代更少、优于现有低秩 OT 方法;但具体收益中算法曲率利用与实现 scaling 的相对贡献文中未充分说明。

Constrained Lyapunov Stabilization based on Gauss Variational Equations: From Spacecraft Orbital Transfers to Rendezvous Figure 1
2026-06-11math.OC

Constrained Lyapunov Stabilization based on Gauss Variational Equations: From Spacecraft Orbital Transfers to Rendezvous

Ilya Kolmanovsky, Emanuele Garone, Grant Touchette

University of Michigan, 3038 Francois-Xavier Bagnoud Building, 1320 Beal Avenue, Ann Arbor, MI 48109-2140, University of Michigan, Francois-Xavier Bagnoud Building, 1320 Beal Avenue, Ann Arbor, MI 48109-2140, ∗Professor, Department of Aerospace Engineering, AIAA Associate Fellow., ‡Graduate Student, Department of Aerospace Engineering.

2026-06-11优化控制

针对传统开环轨道转移对推力误差和扰动鲁棒性不足、且交会任务还需匹配真近点角的问题,本文在基于高斯变分方程的Lyapunov反馈上加入外环半长轴指令调节,并用障碍函数、饱和与参考/收敛 governor 处理状态和控制约束及伪平衡。仿真显示,该框架可在常规推力和洛伦兹力系绳单电流驱动下完成受约束轨道转移与交会;去掉障碍和 governor 会明显违反近地点半径约束。

Masked Symmetric Nonnegative Matrix Factorization for Community Detection in Incomplete Networks Figure 1
2026-06-11math.OC

Masked Symmetric Nonnegative Matrix Factorization for Community Detection in Incomplete Networks

Anqi Liu, Ran Gu, Rui-Jin Zhang

∗School, University, †NITFID, School of Statistics and Data Science, LPMC, KLMDASR, and AAIS, Nankai University, ‡Corresponding author. School of Mathematical Sciences, Nankai University, Tianjin 300071

2026-06-11视觉感知

针对真实网络中邻接矩阵常因采样、隐私或噪声而缺失,传统 SymNMF 将未观测项置零会引入偏差的问题,本文提出 Masked SymNMF,仅在观测位置计算重构误差,并用带正则的非对称松弛降低优化难度,证明足够正则下与原对称模型等价。作者进一步给出 ANLS 框架及 MU、HALS、PGD 更新;合成与真实网络实验显示,在不同观测密度下相较插补基线有更稳健的社区检测表现。

Cooperative Switched Formation Control of Autonomous Vehicles: An Event-triggered Approach to Input Saturation and Time-delay Challenges Figure 1
2026-06-11eess.SY

Cooperative Switched Formation Control of Autonomous Vehicles: An Event-triggered Approach to Input Saturation and Time-delay Challenges

Ziming Wang, Guanxuan Jiang, Yihuai Zhang, Karl H. Johansson, Apostolos I. Rikos

2026-06-11规划控制

面向自动车队在换道、避障等二维编队中同时遭遇通信时延、执行器饱和和外部不确定性的控制难题,论文提出基于反步法、RBF 神经网络和 Lyapunov 分析的动态阈值事件触发自适应编队控制框架,引入饱和补偿、时延辅助补偿与障碍 Lyapunov 约束。理论上证明闭环信号一致最终有界并排除 Zeno 行为,仿真展示了速度变化与队形切换下的跟踪和资源节省效果。

Distributionally Robust Reinsurance under Robust Optimized Certainty Equivalent Risk Measure Figure 1
2026-06-11math.OC

Distributionally Robust Reinsurance under Robust Optimized Certainty Equivalent Risk Measure

Xinqiao Xie, Taizhong Hu, Tiantian Mao

2026-06-11安全鲁棒

针对再保险定价中损失分布难以精确获知、且风险偏好函数也可能存在误设的问题,本文把分布鲁棒优化与偏好鲁棒 OCE 结合,提出 ROCE 风险度量,统一涵盖 CVaR 与 expectile。在均值-方差不确定集下,证明最坏情形可化为三点分布,从而把无限维问题转为显式有限维规划;在 Wasserstein 球下也给出可计算重构。数值实验用于比较两类不确定集下最优免赔额设计。

The relaxation complexity of the standard simplex is logarithmic Figure 1
2026-06-11cs.DM

The relaxation complexity of the standard simplex is logarithmic

Simon Keil, Stefan Weltge

Technical University of Munich

2026-06-11优化控制

本文研究整数规划中无辅助变量线性描述的最小不等式数,聚焦离散标准单纯形的松弛复杂度这一长期存在上下界缺口的问题。核心做法是用二进制索引与高代数次数实数构造显式多面体,只需约6log d个线性不等式即可精确筛出目标整数点。结合已有下界,证明rc(Δd)=Θ(log d),并确定有限d维整数点集最小松弛复杂度的渐近阶。

On finding exact solutions of linear programs in the oracle model Figure 1
2026-06-11math.OC

On finding exact solutions of linear programs in the oracle model

Daniel Dadush, László A. Végh, Giacomo Zambelli

Hertz Chair for Algorithms and Optimization, University of Bonn, Germany, Department of Mathematics, London School of Economics and Political Science, UK

2026-06-11优化控制

针对分离预言机给出的线性规划,论文关注如何从通常只能得到近似解的框架中恢复精确原始解与对偶证书,尤其处理约束数可能指数级、可行域低维等情形。核心做法是把近似原始/对偶求解器作为黑箱,并用几何条件数δ与Burrell–Todd式证书抽取替代传统位复杂度和丢番图舍入论证。结果给出O(n²log(n/δ))次预言机调用及相应多项式算术复杂度;有理数据下成为多项式时间算法。

Accelerated Implicit GDA Schemes: Theoretical Guarantees and Application to Proximal Augmented Lagrangian Methods Figure 1
2026-06-11math.OC

Accelerated Implicit GDA Schemes: Theoretical Guarantees and Application to Proximal Augmented Lagrangian Methods

Jiaqi Liu, Bin Shi

Center for Mathematics and Interdisciplinary Sciences, Fudan University, Shanghai, Shanghai Institute for Mathematics and Interdisciplinary Sciences (SIMIS), Shanghai, Research Institute of Intelligent Complex Systems, Fudan University, Shanghai 200433, the availability of high-quality preconditioners tailored to the structure of the underlying problem.

2026-06-11优化控制

针对带线性等式约束的凸优化中,Krylov 方法依赖预条件且内存开销高、传统 ALM 外迭代收敛慢的问题,本文将近端 ALM 外迭代解释为隐式 GDA,并把步长推广到可变情形;其关键洞察是 Lyapunov 势函数需从目标差转向变分不等式度量。基于连续与二阶 ODE,论文构造可变步长隐式 GDA 和 Nesterov 型隐式 GDA,证明末迭代原始-对偶间隙/梯度范数达 o(1/k),并给出 o(1/k^{r+1}) 的加速率,数值实验用于验证理论。

Deterministic Policy Gradient for Learning Equilibrium in Time-Inconsistent Control Problems Figure 1
2026-06-11q-fin.CP

Deterministic Policy Gradient for Learning Equilibrium in Time-Inconsistent Control Problems

Xin Guo, Yijie Huang, Xiang Yu

∗Department of Industrial Engineering and Operations Research, University of California, Berkeley, USA., †Department of Applied Mathematics, The Hong Kong Polytechnic University, Kowloon, Hong Kong., ‡Department of Applied Mathematics, The Hong Kong Polytechnic University, Kowloon, Hong Kong.

2026-06-11强化学习规划控制优化算法

针对均值-方差、非指数折扣等会破坏动态规划的时间不一致连续控制问题,论文将扩展 HJB 均衡条件改写为两阶段学习:先在给定辅助函数下用确定性策略梯度求解辅助的时间一致控制,再用鞅刻画与内层不动点迭代估计辅助函数。理论上证明了较温和假设下内层迭代收敛,并在两个金融案例中显示可无模型学习确定性均衡策略。

bAdag: an adaptive block coordinate gradient method for smooth nonconvex functions Figure 1
2026-06-11math.OC

bAdag: an adaptive block coordinate gradient method for smooth nonconvex functions

Giovanni Seraghiti

2026-06-11优化算法

针对大规模光滑非凸优化中块坐标梯度法常依赖固定步长或线搜索、且函数评估昂贵的问题,本文提出 bAdag:用各块历史梯度累积量自适应确定步长,而非使用全梯度或目标函数值。其统一分析覆盖循环、均匀随机与 Gauss-Southwell 三类选块规则,在块 Lipschitz 梯度假设下给出遍历次线性收敛率,并扩展到盒约束问题;实验包含回归与鲁棒 NMF。

Last-Iterate Convergence of Optimistic Multiplicative Weight Update Figure 1
2026-06-11math.OC

Last-Iterate Convergence of Optimistic Multiplicative Weight Update

Francesco Orabona

King Abdullah University of Science and Technology (KAUST)

2026-06-11学习理论

本文针对 OMWU 在光滑凸凹鞍点问题中的全局末迭代收敛性这一长期空缺:OGDA 已知可收敛,但熵正则在单纯形边界不可微,使 OMWU 可能因靠近边界而“变慢”。作者将 Popov 式证明推广到非欧氏情形,并引入边界论证,证明任意聚点满足非活跃坐标的 KKT 不等式;在足够小常数学习率下,OMWU 渐近收敛到鞍点,且不需唯一解、严格互补、误差界或局部初始化假设。

Credit Capacity and the Propagation of Funding Shocks: Evidence from U.S. and Brazilian Financial Intermediaries Figure 1
2026-06-11econ.GN

Credit Capacity and the Propagation of Funding Shocks: Evidence from U.S. and Brazilian Financial Intermediaries

Ayush Jha, Ali Jaffri, Frank Fabozzi

Department of Economics, Texas Tech University, Lubbock, TX 79409, †College of Business, North Dakota State University, Fargo, ND 58105, ‡Carey Business School, Johns Hopkins University, Baltimore, MD 21218, terminant of lending outcomes is not simply the availability of wholesale funds but the, of funding shocks but also on the level of lending capacity available before the shock oc‐

2026-06-11优化控制

本文关注为何相似融资冲击在不同国家引发迥异信贷收缩,提出将金融中介把批发资金转化为贷款的“信贷能力”作为动态状态变量。基于2002–2025年美巴监管数据,模型恢复机构层面能力并做脉冲响应与反事实分析,发现美国基准信贷能力约为巴西3至6倍,而持久性相近;因此巴西冲击后的信贷收缩更大更久,差异主要来自初始能力而非恢复速度。

Convex Generalized Differentiation at infinity Figure 1
2026-06-11math.OC

Convex Generalized Differentiation at infinity

Nguyen Xuan Duy Bao, Nguyen Mau Nam

plicit representations than those available in the general nonsmooth framework. In addition, we develop, tional structure available in convex analysis. In particular, even for convex sets, limiting normal cones at

2026-06-11优化算法

针对无界凸优化中最优值不取到、可行集沿逃逸方向决定几何等局部微分工具失效的问题,本文在凸集与凸函数上建立“无穷远处”的广义微分框架。核心洞察是利用凸性保留切锥、法锥和次微分的凸结构,并与退化锥、极性、上图几何和 Fenchel 共轭相连,从而给出比一般非光滑理论更显式的表示与运算法则。主要结果包括多面体情形的渐近活跃约束刻画、函数无穷远次微分及方向导数公式,以及用于无界凸规划的乘子规则和基于无渐近驻点的解存在判据。

Exponential Adaptive Smoothing and Importance Sampling for Optimization of the Conditional Value-at-Risk Figure 1
2026-06-11math.OC

Exponential Adaptive Smoothing and Importance Sampling for Optimization of the Conditional Value-at-Risk

Will Asness, Brendan Keith, Boyan Lazarov, Anton Malandii, Stan Uryasev

Funding: This work was performed under the auspices of the U.S. Department of Energy by Lawrence Livermore National, Laboratory under Contract DE-AC52-07NA27344 and the LLNL-LDRD Program under Project tracking No. 25-ERD-030, and 22-ERD-009. Release number LLNL-JRNL-2020035. WA, AM, and BK were supported in part by the U.S. Department, of Energy, Office of Science Early Career Research Program under Award Number DE-SC0024335 and by the Center for, Information Geometric Mechanics and Optimization (CIGMO), a PSAAP-IV Focused Investigatory Center funded by the U.S., Department of Energy, National Nuclear Security Administration under Award Number DE-NA0004261. BK was also supported, §Department, University

2026-06-11优化算法安全鲁棒

本文针对高置信度 CVaR 优化中目标非光滑、尾部样本稀少导致随机梯度方差大的问题,提出 EASIeST:从 CVaR 对偶风险包络出发,用广义 Fermi–Dirac 熵的 Bregman 近端更新保持对偶分布在内点,并把该分布直接作为自适应重要性采样器聚焦尾部场景。文中证明凸情形收敛,并在投资组合、SVM 与拓扑优化实验中显示相对随机近似方法更高效。

Nonlocal Onsager Operators and Entropy Dissipation for Finite-State Schrödinger Bridges Figure 1
2026-06-11math.OC

Nonlocal Onsager Operators and Entropy Dissipation for Finite-State Schrödinger Bridges

Abdallah BenAbdallah, Mohsen Dlal

†Higher Institute of Computer Science and Multimedia of Sfax, University of Sfax, Sfax, Tunisia., ‡Department of Mathematics, Qassim University, ment of Mathematics, Sfax Preparatory Engineering Institute, University of Sfax, Sfax, Tunisia.

2026-06-11优化控制

本文针对有限状态 Schrödinger bridge 缺少内生几何结构的问题,从半对偶形式出发构造规范固定的对数势流,揭示其边缘演化由状态依赖的非局部 Onsager 算子支配,且该算子等于半对偶 Hessian。论文给出相应 Dirichlet 形式、强制性与熵耗散解释,证明势流全局适定、收敛到唯一 bridge,并得到终端边缘指数松弛及耦合和路径测度收敛;有限网格实验显示其对稀有状态相对误差更稳。

Epistemic fair division of independence structures Figure 1
2026-06-11math.OC

Epistemic fair division of independence structures

Marcin Anholcer, Maciej Bartkowiak, Bartłomiej Bosek, Jarosław Grytczuk

the available connections in a logistic, financial, or social network. The admissible bundle, This research was funded by the National Science Centre, Poland (grant number: 2023/51/B/HS4/00829).

2026-06-11视觉感知

本文关注在独立性结构约束下分配不可分物品的公平性,例如网络边必须分给各代理形成无环束。核心洞察是用拟阵/遗传独立系统刻画可行束,并引入 epistemic EF1 来绕开强公平难以保证的问题。主要结果证明满足 EF1 性质的独立结构中任意加性估值都存在 epistemic EF1 分配,并给出公共估值下若干拟阵二分结果及两个构造算法。

Mean field games with terminal state constraints Figure 1
2026-06-11math.OC

Mean field games with terminal state constraints

Luciano Campi, Luca Di Persio, Viktorya Vardanyan

a Department, University, City, Country, b Department, University, City, Country, c Department, University, City, Country, Luca Di Persio 2 2 2 College of Mathematics

2026-06-11优化算法

本文针对带共同噪声与个体噪声的大群体随机博弈中,终端状态必须落入闭凸集合的约束问题,研究状态—控制均参与均场交互的情形。核心做法是将原约束问题转化为辅助均场博弈,并结合随机最大值原理与条件 McKean–Vlasov 型 FBSDE 刻画均衡。主要结果包括在线性状态系数、零运行成本下证明 FBSDE 解的存在唯一性,给出 Lasry–Lions 型唯一性条件,并用于二次相对绩效投资模型。

Null-controllability for the beam equation with structural damping. Part 2: Integration by parts for fractional Laplacians and boundary control Figure 1
2026-06-11math.AP

Null-controllability for the beam equation with structural damping. Part 2: Integration by parts for fractional Laplacians and boundary control

Sergei Avdonin, Julian Edward

2026-06-11规划控制学习理论

针对非整数阶结构阻尼梁方程在非齐次边界控制下适定性与零可控性缺少工具的问题,论文建立了Neumann谱分数拉普拉斯的分部积分公式,并与Dirichlet情形统一处理弱解。基于热核表示、谱展开和矩量/双正交估计,证明一维区间上多类边界输入的适定性及有限时间零可控性。

Sharpness characterizes Hill functions Figure 1
2026-06-11math.OC

Sharpness characterizes Hill functions

Marc Stephan

Center for Systems Biology Dresden, Pfotenhauerstr. 108, 01307 Dresden, Germany, Max Planck Institute of Molecular Cell Biology and Genetics, Pfotenhauerstr. 108, 01307 Dresden, Germany, TUD Dresden University of Technology, Institute for Geometry, 01069 Dresden, Germany

2026-06-11优化控制

本文回应 Hill 函数长期作为经验拟合但缺乏普适边界证明的问题,将生物输入-输出响应的“锐度”定义为半对数尺度导数上确界,并把平衡态线性框架归约为受系数约束的有理函数。核心结果证明任意 n 次此类有理函数锐度不超过 n/4,且取等号当且仅当为 Hill 系数 n 的 Hill 函数;同时指出非平衡稳态可突破该 Hopfield barrier,意味着超出边界需能量维持。

Annealed Entropic Allocation for Ranking and Selection Figure 1
2026-06-11stat.ML

Annealed Entropic Allocation for Ranking and Selection

Xin Fei, Juergen Branke

Business School, The University of Edinburgh, Edinburgh, UK, Warwick Business School, The University of Warwick, Coventry, UK

2026-06-11优化控制

针对仿真排序与选择中预算有限且多个候选方案接近最优时,传统大偏差 maximin 目标因硬最小值导致在线分配方向频繁切换的问题,论文提出 AEA:用退火的加权 log-sum-exp 软最小聚合竞争者得分,并加入 saddlepoint 次指数修正以改善有限预算区分度。理论上证明其在退火下保持一阶大偏差最优目标、权重集中到活跃竞争者且分配映射连续;高斯和指数族实验显示在近并列场景下表现更稳健。

Quantized Stochastic Primal-Dual Methods for Distributed Optimization under Relaxed Global Geometry Figure 1
2026-06-11math.OC

Quantized Stochastic Primal-Dual Methods for Distributed Optimization under Relaxed Global Geometry

Susmit Sarkar, Abhinav Raghuvanshi, Kushal Chakrabarti, Mayank Baranwal

Indian Institute of Technology Bombay

2026-06-11优化算法

针对分布式学习/控制中通信受限且梯度带噪的问题,论文提出带随机无偏量化的随机原始-对偶方法 q-PDGD,在 RSI/PL 等较弱全局几何条件下分析量化、噪声与网络连通性的耦合影响。主要结果是:常步长可线性收缩到显式误差邻域,递减步长在 RSI 情形达到 O(1/k) 收敛,实验验证了比特数、步长和图结构的权衡。

The SOS Rank of a $5 \times 4$ Biquadratic Form via Orthogonality Figure 1
2026-06-11math.CO

The SOS Rank of a $5 \times 4$ Biquadratic Form via Orthogonality

Yannan Chen

∗School, University

2026-06-11优化控制

本文关注双二次型在固定维度下的 SOS 秩上界/下界问题,动机是刻画多项式优化等场景中平方和表示的最小复杂度。核心洞察是引入含相同 y 指标的退化 2-边,突破仅用非退化 2-边的组合构造限制,并用正交性方法处理相应交叉项。作者构造了一个显式 5×4 双二次型,给出 12 个平方的分解并证明不可少于 12 个,从而将 BSR(5,4) 的下界由 11 提升到 12。

Restless bandits with imperfect binary feedback: PCL-indexability analysis and computation Figure 1
2026-06-11cs.LG

Restless bandits with imperfect binary feedback: PCL-indexability analysis and computation

José Niño-Mora

2026-06-11优化控制

论文面向机会频谱接入等部分可观测资源分配问题,研究二元隐状态在ACK/NACK不完美反馈下的restless bandit。核心是用PCL验证框架、确定性骨架和更新分解分析阈值策略的可指标性,并给出MP/Whittle指数计算;若干阈值区间可解析证明,剩余区间文中未充分说明完全证明但提供数值证据。实验显示MP指数策略通常优于myopic、轮询和随机,平均相对myopic提升约15.5%。

The Geometry of Admissible Short Selling in Discrete-Time Stochastic Portfolio Theory Figure 1
2026-06-11math.OC

The Geometry of Admissible Short Selling in Discrete-Time Stochastic Portfolio Theory

Jilong Xu, Xiaojun Cui

a School of Mathematics, Nanjing University, Nanjing 210093, P. R. China, b School of Mathematics, Nanjing University, Nanjing 210093, P. R. China

2026-06-11学习理论

本文针对离散时间随机投资组合理论中函数生成方法长期局限于全多面体、仅做多组合的问题,研究在局部市场状态空间内允许破产安全卖空的几何条件。核心洞察是将伪套利刻画从全局凹性放宽到状态空间上的凹性,并用最大凹扩展的负值判别卖空;进一步提出重心缩放,把经典做多生成函数转化为可控长短仓策略。主要结果给出可容许伪套利的充要条件、卖空与负扩展的等价性,并在收缩组合中展示做多核心与卖空外壳的相变结构。

2026-06-10

31 篇
Algorithmic and Minimax Complexities in Kernel Bandits Figure 1
2026-06-10cs.LG

Algorithmic and Minimax Complexities in Kernel Bandits

Yunbei Xu

National University of Singapore

2026-06-10优化控制

针对核/RKHS bandit 中 GP-UCB 的实践型算法分析与 DEC/MAMS 的极小极大信息论分析长期脱节的问题,论文用统一的 MAIR 语言重写二者:将 GP-UCB 解释为依赖算法先验与实际轨迹信息量的方法,将 MAMS 解释为类级鲁棒包络优化。其主要结果包括异质半正定先验下的 GP-UCB 推广、面向核类的 MAMS 离散化扩展及 safeguarded master,并通过 hub-cloud 构造说明在过参数化模型中,类级 DEC/极小极大证书可能高估真实算法复杂度。

Data-Driven Dynamic Assortment in Online Platforms: Learning about Two Sides Figure 1
2026-06-10cs.LG

Data-Driven Dynamic Assortment in Online Platforms: Learning about Two Sides

Rahul Roy, Nur Sunar, Jayashankar M. Swaminathan

actions depend not only on customer choice and supply availability but also on mutual agreement between

2026-06-10优化控制

面向 Airbnb、Freelancer 等双边服务平台,论文指出仅学习顾客偏好不足以优化展示商家,因为交易还取决于卖家是否接受。作者首次将顾客与卖家两侧未知 MNL 偏好纳入动态 assortment,提出基于 UCB 的双向学习算法;理论上给出 O(log²(NT)) 最坏遗憾及匹配下界,证明速率最优,仿真也显示其优于改造的一侧学习基线。

The Fuel Optimizer: A Data-Driven Numerical Framework for Formulation of Aviation Turbine Fuel Figure 1
2026-06-10math.OC

The Fuel Optimizer: A Data-Driven Numerical Framework for Formulation of Aviation Turbine Fuel

Ana Larrañaga, Steven L. Brunton, Jacobo Porteiro, Dario Lopez-Pintor

Department of Mechanical Engineering, University of Washington, Seattle, WA 98195, United States, NSF AI Institute in Dynamic Systems, University of Washington, Seattle, WA 98195, United States, Sandia National Laboratories, 7011 East Ave, Livermore, 94550, CA, United States, phase mechanism was developed by Lawrence Livermore National Laboratory (LLNL), consists of 8478

2026-06-10优化控制

面向可持续航空燃料配方筛选中实验认证昂贵、燃料—排放关系难建模的问题,本文提出 Fuel Optimizer:用1D反应器仿真生成2508种合规混合燃料排放数据,训练神经网络代理模型,并嵌入遗传算法在ASTM性质、密封膨胀和组分约束下反向设计配方。结果显示优化候选在NOx-CO权衡和LTO污染物目标上优于训练库,并经反应器仿真验证,但实际发动机与实验增益仍文中未充分说明。

Learning Doubly Sparse Explicitly Conditioned Transforms Figure 1
2026-06-10cs.LG

Learning Doubly Sparse Explicitly Conditioned Transforms

Tudor Pistol

Department of Mathematics, Faculty of Mathematics and Computer Science, University of Bucharest, Academiei 14, Bucharest, 010014, Romania

2026-06-10优化控制

针对固定 DCT/DFT 等解析变换难以适配特定信号、而稠密学习变换计算代价高且需控制条件数的问题,论文提出将变换写成固定正交基与稀疏可学习因子的乘积,并显式约束条件数与范数;算法基于近端/FISTA 思路和新的闭式奇异谱投影。实验显示其在双稀疏变换学习上优于既有方法,并以更低计算量达到接近稠密模型的重构效果。

Dominance and symmetry-breaking rules for the Graph Burning Problem Figure 1
2026-06-10math.OC

Dominance and symmetry-breaking rules for the Graph Burning Problem

Nice Prado (LIMOS), Rafael Colares (LIMOS)

a graph are labeled as either unburned or burned. At the start of the process, all vertices

2026-06-10优化控制

本文针对图燃烧问题精确求解随图规模增大而难以收敛的瓶颈,将其重述为递减半径“燃烧球”覆盖问题,提出新的 ILP 模型,并利用与支配集问题的相似性设计支配规则、对称性破除、目标扰动和剪枝。实验显示,1DR 预处理平均删除约 82% 候选变量;最佳组合在可比实例上均减少 CPLEX ticks,平均降幅约 90.29%,但万级以上大图仍受内存限制。

Continuous Time Identification of Linear Systems: Extended Version Figure 1
2026-06-10math.OC

Continuous Time Identification of Linear Systems: Extended Version

Fatima J. Ghadieh, Mireille E. Broucke

Engineering, University of Toronto, Toronto, ON, Canada., order in terms of the dimension of the controllable, model that lives in its controllable subspace., state recovers the full controllable subspace of the, controllable subspace is obtained using the SVD.

2026-06-10优化控制

该文面向“类脑”系统辨识:在不依赖采样数据和神经网络建模的前提下,用连续时间计算学习低阶 SISO LTI 模型。核心洞察是用过参数化模型处理观测器阶次与未知对象阶次不匹配,并通过 Kreisselmeier 观测器、协方差/SVD 子空间估计和逐次实验算法识别模型阶次;随后用标准自适应律估计参数。主要结果给出过建模与欠建模情形下可控子空间维数与真实阶次的关系,并以示例展示阶次估计过程的有效性。

Dynamic inverse problems: Single-loop online algorithms Figure 1
2026-06-10math.OC

Dynamic inverse problems: Single-loop online algorithms

Jyrki Jauhiainen, Yassine Nabou, Tuomo Valkonen

This research has been supported by the Academy of Finland grant 345486. This research was funded in whole or in part by, ‡MODEMAT Research Center in Mathematical Modeling and Optimization, Quito, Ecuador and Department of Mathe-

2026-06-10优化控制

面向动态 EIT 等由 PDE 约束的实时反问题,作者针对“新数据到来前来不及求解正/伴随 PDE”的瓶颈,提出单循环在线算法:每帧只对状态与伴随方程做一步或少量迭代,并用动力学预测传递迭代量,将精确梯度替换为误差可求和的在线微分估计。理论上证明这些估计保持所需光滑性、可接入标准 regret 分析;动态 EIT 实验显示其可获得更稳定的实时重建。

A Stochastic Maximum Principle for Partially Observed Jump-Diffusion Systems with Counting-Process Observations Figure 1
2026-06-10math.OC

A Stochastic Maximum Principle for Partially Observed Jump-Diffusion Systems with Counting-Process Observations

Jie Xiong, Ying Yang

financial execution, queueing network control, and event-driven sensor management, the available, †Department of Mathematics and SUSTech International center for Mathematics, Southern University of Science, ‡Department of Mathematics, Southern University of Science and Technology, Shenzhen, 518055, P. R. China.

2026-06-10生成模型

面向只能通过事件到达而非连续信号观测状态的部分观测控制问题,论文研究带状态依赖计数过程观测的跳扩散系统。核心做法是引入参考测度,将观测化为单位泊松过程,并在含似然比的增广系统上推导条件哈密顿驻点形式的随机最大值原理。在线性二次金融执行例子中得到由条件均值驱动的Riccati反馈律,粒子滤波实验显示其较高斯或忽略跳跃近似有更好滤波精度,闭环成本接近全信息基准。

Gradient based Bilevel for Inverse Optimal Control, a Riemannian approach Figure 1
2026-06-10cs.RO

Gradient based Bilevel for Inverse Optimal Control, a Riemannian approach

Ahmed-Manaf Dahmani, Vincent Bonnet, David Daney, François Charpillet

2026-06-10规划控制优化算法

本文针对逆最优控制中传统双层优化需反复求解内层控制问题、投影式 PIOC 又在欧氏梯度求解下易失稳的问题,指出根源在于可行集的流形几何结构,并将满足 KKT 最优性条件的轨迹集合建模为黎曼流形。提出的 RIOC 在流形上投影观测轨迹、保持可行性;在人类手臂轨迹实验中精度与双层 IOC 相当或更好,计算时间约降为四分之一。

Bounding the Null Space: Interval-Based Uncertainty Quantification for Non-Identifiable Groundwater Models Figure 1
2026-06-10math.OC

Bounding the Null Space: Interval-Based Uncertainty Quantification for Non-Identifiable Groundwater Models

Maximilian Ramgraber, Ksenia Bestuzheva

Department of Geoscience & Engineering, Delft University of Technology, Zuse Institute Berlin

2026-06-10学习理论安全鲁棒

针对地下水模型因观测稀疏而不可辨识、采样式不确定性量化易低估可行解范围的问题,论文将不确定性表示为区间,并用基于优化的边界收紧在物理与观测约束下求保守外界。其关键洞察是 McCormick 松弛会破坏通量与水头梯度符号耦合,需加入流向或无旋约束。1D、2D 稳态及瞬态算例显示该方法能给出确定性、保守的变量范围,但扩展性仍需进一步验证。

Direct Data-Driven Approximate Optimal Control of Nonlinear Input-Affine Systems Figure 1
2026-06-10math.OC

Direct Data-Driven Approximate Optimal Control of Nonlinear Input-Affine Systems

Benita Nortmann, Thulasi Mylvaganam

∗Urban Energy Systems Laboratory, Swiss Federal Laboratories for, ∗∗Department of Aeronautics, Imperial College London, London, UK, not available and numerical solutions are computation-, tion, a National Centre of Competence in Research, funded by the

2026-06-10规划控制

本文针对未知非线性输入仿射系统的无限时域最优控制难题:传统方法需识别模型并求解 HJB/PDE,代价高。作者将直接数据驱动系统表示与“代数 P 解”框架结合,通过扩展状态浸入把稳定化和近似最优控制转化为仅依赖测量数据的代数条件,无需显式辨识动力学。结果给出动态状态反馈的局部稳定与性能保证,并在 Van der Pol 数值例中展示含噪数据下仍可获得接近模型最优控制的轨迹。

Max-Policy Iteration, Revisited Figure 1
2026-06-10cs.PL

Max-Policy Iteration, Revisited

David Monniaux (VERIMAG - IMAG, INS2I-CNRS), Helmut Seidl (TUM)

School of CIT, TU Munich, 85748 Garching, Germany

2026-06-10强化学习

本文针对抽象解释中值迭代可能不终止、加宽又会损失精度和单调性的矛盾,重审 max-policy iteration。核心洞察是在整数和浮点域中,可用保证终止的普通值迭代替代昂贵优化;在有理数仿射 max-min 系统中,以嵌套 min-policy 代替线性规划。结果显示该方法能求最小不变式,浮点实验显著快于 LP/Min 变体,并给出正确性与最优性证书。

NOVA: Symbolic Regression Discovery of Interpretable Car-Following and Lane-Change Models with Driver Heterogeneity Figure 1
2026-06-10cs.LG

NOVA: Symbolic Regression Discovery of Interpretable Car-Following and Lane-Change Models with Driver Heterogeneity

Ishak Abassi, Nassim Ali Bouazzouni, Farah Ibelaiden, Nadir Farhi

Department of Industrial Systems Engineering, National School of Artificial Intelligence (ENSIA), Algeria.

2026-06-10优化控制

论文针对传统跟驰/换道模型结构先验强、深度模型难解释的问题,提出 NOVA:用 Rust 实现的确定性符号回归在原始 NGSIM 轨迹上穷举低阶代数结构,自动发现以 tanh(Δv) 为稳健骨架的可解释加速度项,并用残差搜索关联 TTC/τ 碰撞规避线索。在 476 万观测上,其意图预测 RMSE 为 1.376 m/s²,优于重校准 SR-LLM 0.135;换道三分类在严格车辆留出下平衡准确率达 67.4%。

Accelerating SAV-based optimization via randomized low-rank Hessian approximation Figure 1
2026-06-10math.OC

Accelerating SAV-based optimization via randomized low-rank Hessian approximation

Ryo Sagawa, Daisuke Furihata, Yuto Miyatake

Department of Pure and Applied Mathematics, Graduate School of Information Science and Technology, The University of Osaka, D3 Center, The University of Osaka

2026-06-10优化算法

针对传统 SAV/RSAV 优化仅用一阶梯度、在病态 Hessian 或 PINN 训练中收敛慢的问题,论文提出 N-RSAV:用随机 Nyström 低秩 Hessian 近似构造 RSAV 线性算子,并通过特征值截断保持半正定与修正能量耗散;还用能量偏差自适应复用 Hessian。理论上给出 PL 条件下收敛保证,实验在二次问题和 PINN 上显示较常规 RSAV 明显加速。

Short-Range IAM Operations to Overcome Access Gaps Around Bologna Airport Figure 1
2026-06-10math.OC

Short-Range IAM Operations to Overcome Access Gaps Around Bologna Airport

Jean-Claude Lebègue (OPTIM), Xuhao Gui (OPTIM), Daniel Delahaye (OPTIM)

as a valuable benchmark, its scalability limitations highlighted

2026-06-10优化控制

本文针对博洛尼亚机场周边“短途航班不经济、地面接驳又耗时”的可达性缺口,将创新空中交通建模为机场间专用接驳/疏散服务。其核心是用航班时刻表生成时变需求,在IAM-only时间扩展网络上先用A*估计链路需求压力,再用动态规划调度有限机队。基于2024年OAG数据的仿真显示,多数线路较铁路显著省时,如BLQ–Il Ciocco为46分钟对237–294分钟,但佛罗伦萨等少数方向铁路仍具竞争力,效果受飞行速度和采用率影响明显。

A Nonlinear Snell Envelope Representation for Path-Dependent Controller-Stopper Games Figure 1
2026-06-10math.OC

A Nonlinear Snell Envelope Representation for Path-Dependent Controller-Stopper Games

Magnus Perninge

∗M. Perninge is with the Department of Mathematics, M¨alardalen University, V¨aster˚as, Sweden.

2026-06-10规划控制

本文关注路径依赖随机系统中的有限时域零和 controller-stopper 博弈:控制者调节扩散过程,停止者选择提前终止,关键难点是上下值是否一致及其可计算表征。核心做法是引入控制随机化,把原控制替换为由泊松点过程驱动的对偶问题,并用受约束跳跃 BSDE 构造非线性 Snell envelope。主要结果是在较弱正则与增长条件下证明博弈有值,且共同值等于该对偶最优停止/BSDE 表示。

A Mean-Field Analysis of Multi-Head Self-Attention under Cross-Entropy Training Figure 1
2026-06-10math.OC

A Mean-Field Analysis of Multi-Head Self-Attention under Cross-Entropy Training

Cheng Huan, Hongfwei Yuan

Department of Statistics and Data Science

2026-06-10优化控制

针对多头自注意力训练缺乏类似浅层网络的动力学刻画,本文把注意力头视为参数空间粒子,在交叉熵与因果掩码 QKV 结构下推导无限头平均场 Wasserstein 梯度流。主要结果包括有限头最优风险 O(N^{-1/2}) 近似、SGD 到极限 PDE 的有限时间传播混沌界,以及稳态收敛、KL 速率和 Dirac 稳态稳定/不稳定判据。

Minimum Distortion Quantization with Specified Output Distribution Figure 1
2026-06-10cs.IT

Minimum Distortion Quantization with Specified Output Distribution

Aolin Xu

information controllable, and channel or downstream task, which may also be called a labeled partition, with

2026-06-10优化控制

本文针对传统量化只最小化失真、难以控制输出索引分布的问题,研究在给定连续源分布和指定离散输出分布下的确定性标量量化。核心洞察是将量化器优化转化为单位区间分割,并用主序关系证明全局最优结构:最优量化由源 CDF、目标分布 CDF 及一个最优排列决定;在源或输出均匀时退化为简单的分位数映射。结果给出最小 MMSE 量化的闭式形式,但文中主要为理论推导,未提供实验验证。

A stochastic gradient algorithm for non-separable optimization with convergence guarantee Figure 1
2026-06-10math.OC

A stochastic gradient algorithm for non-separable optimization with convergence guarantee

Yingzhou Li, Ruofan Wu

∗School of Mathematical Sciences, Fudan University, Shanghai Key Laboratory for Contemporary Applied Math, tical settings violate strict interpolation: examples include noisy labels, explicit regularization, (e.g., weight decay), and inherently non-interpolable tasks like unsupervised clustering. In such

2026-06-10优化算法学习理论

本文针对对比学习、聚类和全局统计损失中常见的非可分目标,指出普通 mini-batch SGD 会因样本耦合产生结构性偏差。作者提出带理想批梯度 G 与缓存替代梯度 H 的 SGD 式框架,在可分情形退化为标准 SGD,并给出固定步长下的局部收敛理论:局部强凸时线性收敛,局部凸时 O(1/k) 收敛,同时量化缓存陈旧、近似误差和批大小对步长与常数的影响。

Supermodularity and Submodularity in Network Interdiction Figure 1
2026-06-10math.OC

Supermodularity and Submodularity in Network Interdiction

Bo Zhou, Ruiwei Jiang, Siqian Shen

Department of Industrial and Operations Engineering, University of Michigan, Ann Arbor, MI 48109

2026-06-10优化控制

针对网络阻断中双层整数模型难求、传统对偶化在含整数防御决策时受限的问题,本文从防御者最优值函数的次模/超模结构入手,给出最小费用流、最大流、最短路和设施选址等模型在不同攻击位置下成立的充要条件,并据此生成有效不等式;数值实验显示可获得数量级加速,但具体增益对实例结构的依赖仍需结合数据理解。

Koopman Modeling and Stabilization of Discrete-Time Nonlinear Control Systems: Bilinearity on a Reproducing Kernel Hilbert Space Figure 1
2026-06-10math.OC

Koopman Modeling and Stabilization of Discrete-Time Nonlinear Control Systems: Bilinearity on a Reproducing Kernel Hilbert Space

Jarod Morris, Xiuzhen Ye, Wentao Tang

Department of Chemical and Biomolecular Engineering, North Carolina State University, lation codes for the numerical experiments in this paper are available at this

2026-06-10规划控制

针对带输入非线性系统难以被 Koopman 提升为线性时不变模型、进而缺少可证明稳定控制器的问题,本文在离散时间框架下证明:在适当光滑与正则条件下,将状态和输入分别嵌入线性–径向核 RKHS,可得到精确双线性 Koopman 表示。进一步把稳定化转化为关于状态依赖输入概率测度的凸优化,并用离散化求解,得到基于核 SOS Lyapunov 下降条件的控制综合方法。

Constructive Versions of Ekeland's Variational Principle Figure 1
2026-06-10math.OC

Constructive Versions of Ekeland's Variational Principle

Douglas S. Bridges

2026-06-10优化控制

本文针对经典 Ekeland 变分原理在 Bishop 构造性分析中因下确界与下水平集紧性不可直接获得而失效的问题,重新刻画度量空间中函数下截集的构造性质。核心洞察是以局部紧性和连续性替代经典的完备性与下半连续性,并证明除可数多个阈值外下截集具备紧性,从而建立可计算解释兼容的构造性近似优化定理。

Baseline-Free Policy Optimization for Neural Combinatorial Optimization Figure 1
2026-06-10cs.LG

Baseline-Free Policy Optimization for Neural Combinatorial Optimization

Carlos S. Sepúlveda, Gonzalo A. Ruz

2026-06-10强化学习优化算法

论文针对神经组合优化中 REINFORCE/POMO 依赖 rollout baseline 带来的脆弱性:在较难 TSP-100 上,差基线会放大梯度噪声并导致训练崩溃。作者将 LLM 对齐中的 GRPO 引入 TSP/CVRP,通过同一实例多条采样轨迹的组内归一化优势替代外部基线。RL4CO 实验显示,GRPO 避免 REINFORCE 崩溃;在相同梯度更新下解质量距 POMO 约 2%,P3O 在 TSP 可用但 CVRP 波动更大。

A dual dynamic programming approach with dimension-free complexity for a class of convex optimization problems Figure 1
2026-06-10math.OC

A dual dynamic programming approach with dimension-free complexity for a class of convex optimization problems

Pablo Barros, Vincent Guigues, Jiaming Liang, Renato Monteiro

∗School, †School, ‡Goergen Institute for Data Science and Artificial Intelligence and Department of Computer Science, University, §School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, GA 30332.

2026-06-10优化算法

针对传统 DDP 求解带线性耦合约束的多阶段凸优化时复杂度随状态维度指数增长的问题,本文提出统一的 FDDP 框架,并用平滑与罚函数把原问题转化为强凸无约束形式。其关键在于以通用割更新涵盖多割 DDP 和仅保留两条割的 two-cut 变体,证明迭代复杂度与状态维度无关;实验比较了多割、两割及直接二次约束重构的表现。

Submodular Optimization with Applications to Decision and Control Figure 1
2026-06-10math.OC

Submodular Optimization with Applications to Decision and Control

Shamak Dutta, Bahman Gharesifard, Stephen L. Smith

ular (the log-determinant and rank of the controllability Gramian, and the log-determinant of the Kalman filter information

2026-06-10规划控制优化算法

面对传感器、执行器和多智能体任务中的指数级子集选择难题,本文将次模函数的“收益递减”结构作为统一视角,系统梳理拟阵、背包、p-system 等约束下的贪心与随机近似算法。主要结果是汇总最新近似比、硬度界及曲率/次模比带来的实例依赖保证,并辨析控制中哪些 Gramian、Kalman 指标具有或不具有次模性,为调度、路径规划和分布式控制提供可实现的算法依据。

Bidirectional SDDP with dimension-free complexity for solving strongly convex stochastic dynamic programming equations Figure 1
2026-06-10math.OC

Bidirectional SDDP with dimension-free complexity for solving strongly convex stochastic dynamic programming equations

Vincent Guigues, Pablo Barros

2026-06-10优化算法

针对多阶段随机优化中传统 SDDP 复杂度随状态维数快速增长的问题,本文提出 Bidirectional SDDP:在常规前向试探点之外,利用相邻迭代场景的前后向信息延迟生成割。核心结果是在强凸、Lipschitz 且无折扣假设下,给出获得 ε 最优策略的显式期望迭代复杂度界;该界不依赖状态空间维数,并随强凸常数增大而降低,但文中主要是理论分析,未给出实验验证。

The Dual Averaging Power-Prox Method with Application to Heavy-Tail Incremental Gradient Figure 1
2026-06-10math.OC

The Dual Averaging Power-Prox Method with Application to Heavy-Tail Incremental Gradient

Yuan Gao, Jeremy Rack, Sebastian U. Stich

2026-06-10优化算法

本文针对现代训练中常见但理论较少覆盖的“按固定顺序增量访问梯度+重尾梯度噪声”有限和复合优化问题,提出 Dual Averaging Power-Prox:用与重尾矩 q 共轭的 p 次幂近端项抑制噪声,并用对偶平均允许每步做近端更新。论文给出该设定下首个收敛分析,证明其渐近速率优于对应 i.i.d. 采样 SGD,并以数值实验作验证。

Structured Adaptive Tensor Prediction for Streaming Data Figure 1
2026-06-10cs.LG

Structured Adaptive Tensor Prediction for Streaming Data

Zhen Qin, Yang Chen

2026-06-10优化控制

面向医疗影像、地球物理等场景中的矩阵/张量流式时间序列,论文指出离线静态模型和传统自适应滤波难以处理时变高维结构数据。其核心是提出 MoM 与 ToM 自适应张量回归,并用在线 SGD 与结构化 IHT 结合稀疏、低秩等先验;理论上说明 ToM 通过跨时间堆叠可降低稳态误差、增强去噪,恢复误差依赖内在自由度而非环境维度,仿真和全球 TEC 预测验证了鲁棒性。

Branch and Price for Railway Crew Scheduling: Benchmark Instances and Computational Study Figure 1
2026-06-10math.OC

Branch and Price for Railway Crew Scheduling: Benchmark Instances and Computational Study

Bart van Rossum

Department of Industrial Engineering & Innovation Sciences, Eindhoven University of Technology, the Netherlands

2026-06-10数据集/基准

针对铁路乘务排班中精确分支定价研究不足、公开基准稀缺的问题,论文构建了含分支规则、原始启发式与降成本固定的分支定价框架,并发布75个经荷铁数据验证的实例。实验显示各规模平均最优性 gap 低于1%,主要来自原始启发式;分支和降成本固定作用有限,瓶颈在受限主问题与对偶界改进。

An algorithm for dynamical quantum optimal transport with applications to quantum chemistry Figure 1
2026-06-10math.OC

An algorithm for dynamical quantum optimal transport with applications to quantum chemistry

Genevieve Dusson, Virginie Ehrlacher, Etienne Obermeyer

Brenier [4] in 2000. The geodesics which naturally correspond to barycenters between, two measures with varying parameters have been generalized to barycenters between, that would allow the computation of barycenters between two or more density ma-

2026-06-10优化控制

针对量子最优传输中 Kantorovich 型距离未必便于生成测地线、且量子化学密度矩阵常为半正定低秩的问题,本文将 Carlen–Maas 动力学 QOT 离散化并引入 SQP、内点对数障碍与保迹端点正则化,用于计算全量子密度矩阵测地线。实验显示该方法能处理奇异/低秩矩阵,并在合适导数参数和函数演算选择下较好拟合量子化学中随核位置变化的密度矩阵曲线,同时考察了矩阵维度与时间离散的收敛行为。

A constrained symbolic regression approach for Lyapunov function discovery Figure 1
2026-06-10eess.SY

A constrained symbolic regression approach for Lyapunov function discovery

Ilias Mitrai, Wentao Tang

aMcKetta Department of Chemical Engineering, The University of Texas at Austin, Austin, TX 78712, United States, bDepartment of Chemical and Biomolecular Engineering, North Carolina State University, Raleigh, NC 27695, United States, the available data. In basis-function-like approaches that lever-, imizes the prediction error between the predicted and true label., i.e., the available data contains

2026-06-10优化控制

针对一般非线性系统 Lyapunov 函数依赖经验、神经网络结果难解释且难验证的问题,论文把候选函数表示为固定深度表达式树,将正定性和导数负定等条件写入约束式自监督符号回归,并嵌入 branch-and-bound-and-check 验证流程。多个算例中可发现如二次型的有效 Lyapunov 函数;但计算量随采样点和树规模上升,增益部分受数据与求解器策略影响。

2026-06-09

61 篇
An Agency-Transferring Model-Free Policy Enhancement Technique Figure 1
2026-06-09cs.LG

An Agency-Transferring Model-Free Policy Enhancement Technique

Anton Bolychev, Georgiy Malaniya, Sinan Ibrahim, Pavel Osinenko

Center for Engineering Systems and Sciences, Central University, Sirius University of Science and Technology

2026-06-09强化学习

针对从零训练强化学习策略成本高、调参和环境设计负担重的问题,论文利用已有但次优的功能性基线策略,通过逐步仲裁基线与可训练策略,将控制权从基线转移给学习策略,最终得到无需基线支持的网络策略。理论上给出目标到达概率下界;连续控制实验显示其回报不低于对比方法,并在训练全程保持更高目标到达率。

Limit Theory for $N$-Player $α$-Potential Games Figure 1
2026-06-09math.OC

Limit Theory for $N$-Player $α$-Potential Games

Xin Guo, Meng Wang, Yufei Zhang

2026-06-09学习理论

本文关注有限玩家 α-势博弈与势均场博弈之间的极限关系,动机是把近似 Nash 均衡求解统一到单一势函数优化框架中。核心洞察是当 α_N→0 时,归一化 N 玩家势函数的值与极小点收敛到带测度值控制的均场控制问题,并借助 Wasserstein 空间微分几何给出势函数构造。主要结果包括等价刻画经典势 MFG 条件、证明极限 MFC 目标即为 MFG 势函数,并得到含公共噪声与非可分控制交互下的混沌传播。

Mean field games with option to buy information Figure 1
2026-06-09math.OC

Mean field games with option to buy information

Bernardo D'Auria, Markus Fischer

2026-06-09优化控制

本文关注均值场博弈中个体在隐藏状态不确定下是否付费获取信息的问题,动机是刻画信息购买如何改变控制决策与群体分布。核心创新是把“买信息”建模为不终止博弈的可选择停止,并与控制—停止型均值场模型连接,推导 HJB 与 Kolmogorov 方程表征。主要结果包括强解刻画、一个可显式求解的线性二次例子,以及由极限模型构造有限 N 玩家近似 Nash 均衡。

Optimal Feedback Communication with Information Maximization and Distortion Minimization Figure 1
2026-06-09cs.IT

Optimal Feedback Communication with Information Maximization and Distortion Minimization

Aolin Xu

2026-06-09优化控制

本文面向带反馈信道中连续源的实时传输,动机是在最大化总体互信息的同时降低每一步估计误差,以服务网络化控制等需即时状态估计的场景。核心洞察是把互信息最大化作为失真最小化的正则约束:给出达到 nC 互信息的充分条件,并在输入可识别信道下证明其必要性;对具有对称性的离散信道,证明 posterior matching 对联合实现互信息最大化与 MMSE 逐步最小化是充分且近乎必要的。

Powering the Future of AI: Navigating the Trade-offs for Europe's Energy Transition and Net-Zero Goals Figure 1
2026-06-09math.OC

Powering the Future of AI: Navigating the Trade-offs for Europe's Energy Transition and Net-Zero Goals

Mohammad Hemmati, Gbemi Oluleye, Vassilis M. Charitopoulos

Department of Chemical Engineering, Sargent Centre for Process Systems Engineering, University College, Centre for Environmental Policy, Imperial College London, London SW7 1NE, UK, The rapid expansion of AI globally has led to the proliferation of energy-intensive hyperscale data centres, Capacity Expansion Planning, Data Centres., The global digital landscape is undergoing a massive structural shift, with data centres (DCs) now

2026-06-09优化控制

面对生成式 AI 和超大规模数据中心快速推高欧洲用电、可能扰乱净零路径的问题,本文构建覆盖 33 国、含 21 种 AI 增长情景的空间显式 MILP 容量扩张与小时调度模型。核心洞察是数据中心选址与系统压力不只取决于清洁电量,更受可靠容量和灵活性约束;到 2050 AI 可能新增 73–723 TWh 用电,并在 2030–2050 年造成 67–181 MtCO₂ 累计超排风险,需额外约 70–226 GW 容量,且工作负载形态会显著改变调度、成本和排放。

Complete Trajectory Tracking for Polynomial Differential Variational Inequalities: A Moment-SOS Based Structure-Aware Approach Figure 1
2026-06-09math.OC

Complete Trajectory Tracking for Polynomial Differential Variational Inequalities: A Moment-SOS Based Structure-Aware Approach

Zhang Huang, Wei Li, Jie Wang

2026-06-09视觉感知规划控制

本文面向非凸约束下微分变分不等式解不唯一、局部求解器难以稳定跟踪的问题,将多项式结构替代凸性作为分析基础。核心洞察是参数化多项式 VI 的解映射可按半代数区域有限分层,并据此设计结合 Moment-SOS 与 RK4 的结构感知 SOS-PDVIRK4,枚举多重平衡并处理切换。理论上证明几乎处处初值存在仅有限次切换的最大正则轨迹,数值上在受约束控制系统中展示相同状态不同初始控制会导致显著分岔及收敛行为。

Guaranteed Fast Implementation of the Split Covariance Intersection Filter: Nested Newton Method Thanks to the Fourth-Order Convexity of w-Optimization Figure 1
2026-06-09eess.SY

Guaranteed Fast Implementation of the Split Covariance Intersection Filter: Nested Newton Method Thanks to the Fourth-Order Convexity of w-Optimization

Hao Li

2026-06-09优化算法

针对 Split CIF 中决定融合性能与实现效率的 w 优化,本文从理论上证明以 log-det 协方差规模为目标时不仅二阶凸,而且四阶导数非负。基于这一结构,作者提出嵌套 Newton 方法,可在有界区间内给出快速且带精度估计的实现;文中主要是数学证明与算法讨论,未充分说明实验增益。

Metric-Free Riemannian Optimization Figure 1
2026-06-09math.OC

Metric-Free Riemannian Optimization

Jonas Püschel

2026-06-09优化算法

针对黎曼优化中显式计算或应用度量代价高、甚至数值不稳的问题,论文指出许多一阶组件实际只需目标微分与黎曼梯度即可构造,进而给出无度量的下降判据、线搜索、步长与共轭梯度形式,并讨论向 Finsler/Banach 流形推广;实验显示在保持效果接近传统方法的同时,可显著减少昂贵非标准度量下的计算开销。

Benchmarking Deep Time Series Models for Equity Portfolios Figure 1
2026-06-09math.OC

Benchmarking Deep Time Series Models for Equity Portfolios

Aoxin Zhang, Yuhan Cheng, Kwanting Leung

School of Mathematical Sciences, Beijing Normal University, Beijing, China, School of Management, Shandong University, Jinan, China, Peking University National School of Development, Beijing, China

2026-06-09数据集/基准

本文关注股票组合预测模型在真实部署中会被偏好、交易成本和约束重排的问题,而非只比预测分数。作者构建2018–2024年CRSP日频基准,将分位数组合、SMAA偏好不确定性、后悔惩罚的部署可接受性指数与受约束QP组合层连接。结果显示原始排名无绝对赢家,TransEnc-8的一阶可接受性最高但仅0.352;TS-RIDGE在裸分位组合更强,加入成本和约束后TransEnc-8更稳,而20bps下受约束组合净Sharpe均为负。

Consecutive Support Matching Induced Parameter Tuning Accelerates Momentum Iterative Hard Thresholding Figure 1
2026-06-09cs.IT

Consecutive Support Matching Induced Parameter Tuning Accelerates Momentum Iterative Hard Thresholding

Samrat Mukhopadhyay, Debasmita Mukherjee

is with the Department of Electronics Engineering, IIT (ISM) Dhanbad, is with the Department of Computer Science, Techno Bengal Institute of Technology

2026-06-09优化控制

本文针对动量版迭代硬阈值在稀疏信号恢复中虽快但步长、动量难调的问题,提出 CosMIHT:用连续两次支持集一致作为“已稳定”信号,再用轻量幂法估计受限 Gram 矩阵特征值并切换到重球最优参数。理论给出支持探索与锁定后的两阶段收敛及有限锁定时间界,实验显示在有噪和无噪设置下较 IHT、FLIHT、MIHT 收敛更快且恢复性能不降。

Quantization of measures in Carnot groups Figure 1
2026-06-09math.MG

Quantization of measures in Carnot groups

Marco Di Marco, Mikaela Iacobelli

ETH Zürich, Department of Mathematics, Rämistrasse 101, 8092 Zürich, Switzerland.

2026-06-09优化控制

本文针对欧氏/黎曼情形的测度量化理论难以直接迁移到 Carnot 群的问题,研究带左不变齐次距离下概率测度的最优有限点近似。核心在于用指数立方体铺砌和次黎曼版 Pierce 引理处理非欧氏局部几何与非紧支撑测度,建立以齐次维数决定指数、以 Carnot cell constant 为常数的 Zador 型误差渐近公式,并证明最优中心经验测度的弱收敛及其由绝对连续密度刻画的极限。

Second order Taylor-like topological expansion with multiple holes Figure 1
2026-06-09math.OC

Second order Taylor-like topological expansion with multiple holes

Kevin Sturm

2026-06-09优化控制

针对形状优化中多个小孔同时扰动时高阶拓扑展开缺乏统一计算框架的问题,本文从单孔展开出发构造类似二阶 Taylor 的多孔展开,引入二阶拓扑状态导数并连接复合层展开。主要结果给出含拓扑梯度与拓扑 Hessian 的通式,说明二维可按孔体积形成标准二阶结构,而三维会出现额外的分数阶/尺度项,且异点二阶项趋近同点时一般不连续。

Generalized Cancellation of Capacitor Parasitic Inductance Using a Lattice Network and Its Application to Common-Mode Noise Reduction Figure 1
2026-06-09math.OC

Generalized Cancellation of Capacitor Parasitic Inductance Using a Lattice Network and Its Application to Common-Mode Noise Reduction

Katsuya Nomura, Shuhei Chizuwa, Takashi Masuzawa

2026-06-09优化控制

面向EMC滤波中电容ESL难以彻底消除、限制高频旁路性能的问题,论文用Z矩阵等效重新推导晶格网络,指出传统上下对称电感条件只是充分条件,提出非对称晶格中满足L2²=L1aL1b即可抵消ESL,并可通过调一个电感实现;原型S参数测试显示有效ESL可由约30 nH降至低于1 nH,且共模扼流圈扩展方案在谐振区降低共模传输噪声。

Inverse Problems for Costs and Controls in LQG MFGs via Mean Field Trajectories Figure 1
2026-06-09math.OC

Inverse Problems for Costs and Controls in LQG MFGs via Mean Field Trajectories

Grégoire Lambrecht, Mathieu Laurière

Shanghai Center for Data Science, NYU-ECNU Institute of Mathematical Sciences at NYU Shanghai

2026-06-09规划控制

面向只可观测群体均值—协方差轨迹、难以直接获得智能体代价函数的场景,本文研究 LQG 平均场博弈的逆问题。核心洞察是参数到均衡轨迹映射天然非单射,因此精确恢复真实代价并非合理目标;作者证明观测初始化下控制可局部识别,但全局泛化需恢复与轨迹一致的代价结构,并给出基于半定规划的构造方法。实验显示可重建轨迹与控制,但代价参数可能偏离真值,且对导数估计和矩阵求逆较敏感。

Multilevel Stochastic Gradient Descent for Risk-Averse PDE-Constrained Optimization Figure 1
2026-06-09math.OC

Multilevel Stochastic Gradient Descent for Risk-Averse PDE-Constrained Optimization

Niklas Baumgarten, Philipp A. Guth, David Schneiderhan, Tommaso Vanzan

2026-06-09优化算法安全鲁棒

面向不确定三维 PDE 约束优化中仅按期望优化易受极端样本影响、标准 SGD 梯度方差高的问题,论文将自适应多层 Monte Carlo 梯度估计用于熵风险度量下的随机梯度下降,动态平衡离散化与采样误差,并设计并行实现。理论给出期望意义下线性收敛及接近前向 MLMC 的复杂度,三维随机椭圆扩散实验验证了收敛率、鲁棒性和高风险厌恶参数下的可扩展性。

Impact of Scaling and Rounding on Metaheuristic Performance for the Vehicle Routing Problem with Time Windows Figure 1
2026-06-09math.OC

Impact of Scaling and Rounding on Metaheuristic Performance for the Vehicle Routing Problem with Time Windows

Florian Rascoussier (IMT Atlantique - DSD, CITI, Lab-STICC\_DECIDE, EMERAUDE, Lab-STICC), Romain Billot (IMT Atlantique - DSD, Lab-STICC, Lab-STICC\_DECIDE), Lina Fahed (IMT Atlantique - DSD, Christine Solnon (EMERAUDE)

2026-06-09优化控制

该文针对VRPTW基准中欧氏距离浮点化导致的可复现性与数值一致性问题,系统研究缩放因子P及悲观、乐观、最近整数三类取整对实例可行域和目标值的影响。核心洞察是取整并非无害预处理:它会改变可行性转移、目标失真和求解器收敛,甚至造成配置排名反转。基于HGS与OR-Tools在Solomon和Homberger实例上的实验,作者给出面向可比评测的缩放取整建议。

Planning resilient hydrogen supply chains under disruption risk Figure 1
2026-06-09econ.GN

Planning resilient hydrogen supply chains under disruption risk

Silvian M. Radke, Philipp C. Verpoort, Falko Ueckerdt, Felix Müsgens

Chair of Energy Economics, Brandenburg University of Technology Cottbus–Senftenberg, Cottbus, Germany, Energy Transition Lab, Potsdam Institute for Climate Impact Research, Potsdam, Germany, Interdisciplinary Transformation University Austria, Linz, Austria

2026-06-09规划控制安全鲁棒

面向欧盟未来绿氢进口,论文指出现有基础设施规划常只按成本最优,忽视管道中断带来的供应安全风险。作者构建两阶段随机优化模型,将进口管道失效概率内生纳入2050年氢供应链投资决策,比较无风险、天真规划与风险预见规划。结果显示,忽视风险会造成约12个百分点、240亿欧元福利损失;提前布局可通过进口通道多元化和战略性超额投资显著降低短缺与价格波动。

Beyond Fixed Local Updates: An Adaptive Decentralized Quasi-Newton Method Free of Stepsize Degradation Figure 1
2026-06-09math.OC

Beyond Fixed Local Updates: An Adaptive Decentralized Quasi-Newton Method Free of Stepsize Degradation

Hao Wu, Liping Wang

School of Mathematics, Nanjing University of Aeronautics and Astronautics.

2026-06-09优化控制

针对去中心化优化中多次本地更新常被迫缩小步长、且节点算力/通信条件异构的问题,论文从 MM 视角提出 RIA 框架,并设计 AdaDQN:用共识感知终止准则自适应决定本地更新,结合 memoryless BFGS 与事件触发通信。理论证明其在光滑非凸问题上全局收敛到一阶驻点,且步长界不再随最大本地步数退化;实验显示在迭代、通信和梯度评估成本上优于若干基线。

Quantitative rapid stabilization for parabolic equations via the linear quadratic theory Figure 1
2026-06-09math.OC

Quantitative rapid stabilization for parabolic equations via the linear quadratic theory

Shengquan Xiang, Yu Xiao, Can Zhang

2026-06-09学习理论

本文关注多维非自伴抛物方程中快速镇定虽已知但镇定代价缺乏显式刻画的问题。作者用线性二次调节框架选择特殊代价泛函,并结合定量可观测不等式构造Riccati反馈,揭示定量快速镇定与定量可观测性的等价关系;主要得到任意衰减率λ下闭环解以e^{-λt}衰减且代价至多约为e^{C√λ},并推广到Navier–Stokes非平凡稳态附近及自伴情形的有限维反馈。

Particle Methods with Deep Learning for Stochastic Control under Partial Observation Figure 1
2026-06-09math.OC

Particle Methods with Deep Learning for Stochastic Control under Partial Observation

Mathieu Laurière, Xiaolu Tan, Jiefei Yang

Shanghai Center for Data Science

2026-06-09规划控制

针对部分观测随机控制中状态需由隐藏变量的条件分布表示、数值上呈无限维这一瓶颈,论文用带权粒子系统近似滤波状态,并利用粒子置换不变性设计对称神经网络,形成直接策略优化与 Deep BSDE 两类算法。理论上证明全离散 N 粒子问题在粒子数增大、步长趋零时收敛到原连续时间问题,并扩展到部分观测平均场控制;线性二次、非线性 MFC 及金融组合实验显示精度和可用性。

Families of Control-Cost-Parametrized Inverse-Optimal Universal Stabilizers Figure 1
2026-06-09eess.SY

Families of Control-Cost-Parametrized Inverse-Optimal Universal Stabilizers

Miroslav Krstic, Luke Bhan

Department of Mechanical and Aerospace Engineering, University of California San Diego, La Jolla, CA 92093-0411, USA, Department of Electrical and Computer Engineering, University of California San Diego, La Jolla, CA 92093-0411, USA, the U.S. Department of Energy (DOE) grant DE-SC0024386.

2026-06-09规划控制

针对 Sontag 通用稳定公式缺乏可调设计自由度、Curtis–Beard 参数化又难以工程调参的问题,本文用用户指定的控制代价函数 γ 来参数化一族逆最优稳定反馈,通过“代价到扩展器”算子生成控制律。核心结果证明该算子具 Lipschitz 性,可由神经算子统一近似,并在近似控制下保持半全局实际渐近稳定,同时给出状态代价二阶扰动和有限时域近最优性界。

Time-Varying Perturbations of Contractive Systems With an Application to Safe Stabilization Figure 1
2026-06-09math.OC

Time-Varying Perturbations of Contractive Systems With an Application to Safe Stabilization

Andreas Oliveira, Arya Honarpisheh, Mustafa Bozdag, Mario Sznaier

2026-06-09安全鲁棒

本文针对传统鲁棒稳定性依赖具体平衡点、难以处理时变扰动的问题,从收缩系统的轨迹间距离衰减出发,给出新的时变扰动条件:即使扰动轨迹不回到原系统,也可保持增量指数稳定;在扰动收敛到稳定或周期极限时,系统收敛到新平衡点或周期解。作者进一步构造仅在线 enforcing 安全约束的安全滤波器,使名义收缩系统避开不安全集并收敛到目标点。

Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin Figure 1
2026-06-09cs.LG

Understanding Quantization-Aware Training: Gradients at Quantized Weights Bias to the Low-Loss Basin

Hanyang Li, Jianhao Ma, Ying Cui

2026-06-09优化算法

针对低比特量化中 PTQ 快但易在 4-bit 等激进设置下失效、QAT 代价高却常能恢复精度的问题,论文提出“低损失河流—谷地—盆地”的几何解释:量化网格接近盆地宽度时,PTQ 的舍入或 Hessian 局部重构可能把权重推到高损失谷壁;STE-QAT 则在量化权重处取梯度、更新浮点潜变量,产生指向盆地内的偏置。作者形式化该失效模式并证明局部条件下有限步恢复,视觉与语言模型实验支持该机制。

Proof of Stake economy under centralized exchanges--a mean field model Figure 1
2026-06-09q-fin.MF

Proof of Stake economy under centralized exchanges--a mean field model

Wenpin Tang

Department of Industrial Engineering and Operations Research, Columbia University, S.W. Mudd Building

2026-06-09优化控制

针对中心化交易所仍主导加密现货交易、可能反向影响PoS去中心化生态的问题,论文建立连续时间均场模型,把矿工同时刻画为验证者与受价格冲击约束的交易者,并给出局部适定性和均衡交易策略的半显式固定点表征。数值结果显示,中心化交易可能提高质押参与率、降低质押分布集中度;交易成本越高质押率上升越慢,代币供给增长更快时分布更分散。

LEAF: A Learning-Enabled ADMM Framework for Accelerated Convex Optimization Figure 1
2026-06-09cs.LG

LEAF: A Learning-Enabled ADMM Framework for Accelerated Convex Optimization

Binh Nguyen, Trinh Tran, Truong X. Nghiem

2026-06-09优化算法

针对大规模参数化凸优化中传统 ADMM 逐实例求解开销高、学习优化又常缺少可行性与收敛保证的问题,LEAF 将 ICNN 学到的标量 Moreau 包络嵌入 ADMM,以较小模型替代昂贵原始更新并保留凸性/光滑性。文中给出 MEL-ADMM 与 sMEL-ADMM 的可行性和全局收敛分析,实验报告在低最优性间隙下相对先进求解器最高约 10 倍加速。

Not All Warm Starts Help: Benchmarking Primal-Dual Initializations for ACOPF Algorithms Figure 1
2026-06-09math.OC

Not All Warm Starts Help: Benchmarking Primal-Dual Initializations for ACOPF Algorithms

Babak Taheri, Daniel K. Molzahn

2026-06-09数据集/基准

本文针对 ACOPF 中热启动常被使用但变量初始化目标缺乏系统依据的问题,基于 IPOPT 在 19 个 PGLib-OPF 案例上枚举原始变量子集并拆分对偶乘子覆盖度。核心洞察是“部分热启动”常会伤害收敛与速度,完整原始-对偶重启中位提速 47.6%,而 14 种部分原始-对偶组合中 12 种中位变慢;DC 种子在计入预求解后优势不显著,学习式方法应优先预测完整原始变量。

Optimal Control and Dissipativity of Linear Hermitian Matrix-Valued Dynamical Systems Figure 1
2026-06-09math.OC

Optimal Control and Dissipativity of Linear Hermitian Matrix-Valued Dynamical Systems

Corentin Briat

2026-06-09规划控制

针对协方差、二阶矩等自然形成的 Hermitian 矩阵值状态,论文试图统一连续、离散、切换与脉冲线性系统中的控制分析。核心在于用一个成本—轨迹—对偶变量恒等式、扩展 Schur 补与内积分解,统一推出 Riccati/LMI 条件。主要结果覆盖有限与无限时域最优控制、有限时域 steering、耗散性和零和微分博弈,并给出含 dwell-time 约束的因果策略。

Some Essential Constructive Foundations for Systems and Control Figure 1
2026-06-09eess.SY

Some Essential Constructive Foundations for Systems and Control

Pavel Osinenko

Central University, 7 Gasheka St., bld. 1, Moscow, 123056, Russia, Center for Engineering Systems and Sciences, koltech, 30 Bolshoy Boulevard, bld. 1, Moscow, 121205, Russia, Sirius University of Science and Technology, 1 Olimpiyskiy Avenue, Sirius, 354340, Russia

2026-06-09规划控制

本文针对经典控制中“存在性证明”难以转化为可计算对象的问题,提出基于 Bishop 构造数学的系统与控制基础:用有理块、多重块、可表示集合、正则函数和认证积分显式记录有限证书。其核心洞察是把轨迹、选择子、概率密度、马尔可夫核和稳定性判据都组织为可逐精度近似的数据结构,并给出函数极值、微分包含、可行解、经验密度证书及线性稳定分析的构造化结果。

OptMuon: Closed-Loop Orthogonalized Momentum Methods for Stochastic Optimization with Zero-Noise Optimality Figure 1
2026-06-09math.OC

OptMuon: Closed-Loop Orthogonalized Momentum Methods for Stochastic Optimization with Zero-Noise Optimality

Ganzhao Yuan

Shenzhen University of Advanced Technology (SUAT), China, Classical SGD and momentum methods are simple and scalable, whereas adaptive methods such

2026-06-09优化算法

该文针对 Muon 类正交化动量优化器通常使用固定或开环步幅、难以随噪声与轨迹自校准的问题,提出 OptMuon:用极分解方向保持矩阵几何稳定,用带运行最大值修正的 AdaGrad-Norm 标量闭环调节步长,且不需预设光滑常数或噪声水平。理论上,OptMuon-A 与 OptMuon-I 分别在平均/个体光滑条件下达到噪声自适应收敛率,并在零噪声时自动恢复近似最优的确定性一阶速率;文中未充分说明大规模实证效果。

Explainable Optimization: A Call for Interdisciplinary Action Figure 1
2026-06-09math.OC

Explainable Optimization: A Call for Interdisciplinary Action

Nurşen Aydın, Ş. İlker Birbil, İlker Küçükparlak, Altuğ Yalçıntaş

2026-06-09优化算法

本文动机是优化模型已进入医疗、调度、救灾等高影响决策,但传统只强调可行性、最优性和求解效率,难以让相关方理解、质疑和执行结果。核心洞察是“数学透明”不等于“可解释”,解释应面向不同角色的认知、责任和行动需求。主要结果是提出可解释优化(XOpt)的跨学科研究议程与利益相关者视角;文中未充分说明实验验证或量化增益。

Parameter Tuning with Generalization Guarantees for GPU-Accelerated Linear Programming Figure 1
2026-06-09math.OC

Parameter Tuning with Generalization Guarantees for GPU-Accelerated Linear Programming

Siddharth Prasad, Dravyansh Sharma

2026-06-09学习理论

针对 GPU 加速一阶线性规划求解器 PDLP/cuPDLP 对超参数高度敏感、默认参数可能跨分布失效的问题,论文从数据驱动算法设计角度分析调参的可学习性:证明 vanilla PDHG 轨迹关于步长和 primal weight 呈分片有理结构,并将含预处理、重启、平滑权重更新的 PDLP 刻画为分片 Pfaffian 结构,从而给出线性/多项式样本复杂度的泛化保证;概念性实验显示分布相关调参可显著改善收敛,优于固定默认值。

Block coordinate descent for joint delay-energy optimization in multi-hop D2D networks Figure 1
2026-06-09math.OC

Block coordinate descent for joint delay-energy optimization in multi-hop D2D networks

Kai-Xiang Hu, Jacek Gondzio, Caixia Kou

2026-06-09优化算法

多跳 D2D 网络中,瓶颈路径时延与中继能耗相互牵制,且路由与功率、带宽分配强耦合,传统平均指标和启发式方法难以保证可靠收敛。论文将最大传输时间与总能耗统一建模,提出分块坐标下降框架:网络层用矩阵无关 Frank-Wolfe 或低秩内点法求路由,物理层用透视变换和并行对偶上升求全局最优资源分配。实验显示 LR-PDIPM 最多降低 9.14 倍能耗、能效提升一个数量级,MF-FW 可在数秒内给出近优解。

Optimal Harvesting under Stochastic Control: HJB Equation and Feynman-Kac Representation Figure 1
2026-06-09math.OC

Optimal Harvesting under Stochastic Control: HJB Equation and Feynman-Kac Representation

Paramahansa Pramanik, Fatamatuj Johora

2026-06-09规划控制

针对渔业、林业等可再生资源在环境波动下难以用确定性模型制定采收策略的问题,本文将种群增长写成随机微分方程,并并列推导 HJB 最优控制方程与 Feynman–Kac 路径期望表示。核心洞察是两种视角虽分别强调动态规划和概率轨迹平均,但可给出一致的最优采收规则;结果表明该框架能在期望折现收益与资源持续性之间形成可解释的权衡,不过实证验证与数值增益文中未充分说明。

Augmented Lagrangian methods for nonlinear semidefinite programming with complementarity constraints Figure 1
2026-06-09math.OC

Augmented Lagrangian methods for nonlinear semidefinite programming with complementarity constraints

Daiana O. Santos, Carina M. Costa, Evelin H. M. Krulikovski e Marina Geremia

Department of Actuarial Science, Paulista School of Politics, Economics and Business, Federal University of São Paulo, Osasco-SP, Brazil., Department of Mathematics, State University of Maringá, Maringá-PR, Brazil., Department of Mathematics, Federal University of Paraná, Curitiba-PR, Brazil.

2026-06-09优化算法

本文针对带互补约束的非线性半定规划中经典约束规范失效、算法收敛理论不足的问题,利用谱分解构造保局部解的紧化重写,并定义 W/C 及 AW/AC 驻点概念。基于该结构分析增广拉格朗日法,证明聚点至少满足 AW 驻点,在附加条件和 SDCMPCC-Robinson 规范下进一步达到 AC 或 C 驻点。

The Spectral Dynamics and Noise Geometry of Muon Figure 1
2026-06-09cs.LG

The Spectral Dynamics and Noise Geometry of Muon

Pierfrancesco Beneventano, Mahmoud Abdelmoneum, Tomaso Poggio

Massachusetts Institute of Technology

2026-06-09优化控制

本文试图解释 Muon 优化器为何不只是矩阵梯度归一化:其极分解更新保留奇异方向、抹平更新谱,从而形成“平谱”隐式偏置。论文在对齐假设下给出一步熵最大化解释,并在欠定回归中推导奇异值动力学与谱变平条件;矩阵感知实验区分了 Muon 与范数匹配 GD、核范数低秩解释。小型 NanoGPT 上 Muon 稳定秩和验证损失更好,但小 ViT 中 AdamW 反胜,表明收益依赖谱结构而非普适优势。

Variational Analysis of Metric Projections onto Isotone Projection Cones via Coderivatives Figure 1
2026-06-09math.OC

Variational Analysis of Metric Projections onto Isotone Projection Cones via Coderivatives

Le Van Hien

Le Van Hien 1 1 1 Faculty of Education, HaTinh University, Hatinh, Vietnam

2026-06-09优化控制

本文面向等调投影锥上的度量投影,动机是补充互补问题稳定性分析中缺少正交结构时的投影灵敏度工具。核心做法是用参考点邻域的生成系统局部刻画投影映射,将 Fréchet 与 Mordukhovich 余导数化为可计算代数公式。主要结果包括给出投影余导数显式表达、计算覆盖常数,并为相关参数非线性互补问题解映射的 Aubin 性质提供可验证充分条件。

Advancing Branch-and-Price for Graph Coloring: New Pricing Strategies and Benchmark Results Figure 1
2026-06-09math.OC

Advancing Branch-and-Price for Graph Coloring: New Pricing Strategies and Benchmark Results

Mingming Zheng, Roberto Baldacci, Fabio Furini, Qinghua Wu

c Department of Computer, Control, and Management Engineering “Antonio Ruberti”, Sapienza University of Rome, Rome 00185, Italy

2026-06-09数据集/基准

论文针对图着色精确求解中 branch-and-price 难以快速证明小最优性缺口、且 ZDD 在大规模稀疏图上枚举稳定集受限的问题,提出 BPCOL+:在根节点结合启发式与列生成求上下界,并利用替代对偶向量做最大稳定集削减,构造更紧凑的 ZDD 来加速定价。实验在 137 个 DIMACS 和 5000 个 Erdős–Rényi 实例上显示,其一小时内分别证明 96 个和 4641 个实例最优,优于现有 BP,并接近最新 SAT 求解器。

Temperature control by a state-delay nash strategy: theory and experiments Figure 1
2026-06-09math.OC

Temperature control by a state-delay nash strategy: theory and experiments

César Adair Rodríguez Castro, Manuel Alejando Jímenez Lizarraga, Jorge Manuel Ortega Martínez, Omar Jacobo Santos Sánchez

Autonomous University of the State of Hidalgo, Autonomous University of Nuevo León, Department of Electrical Engineering, Technological Institute of Morelia

2026-06-09规划控制学习理论

针对含状态时滞系统中反馈纳什策略难以解析求解的问题,本文将带广义交叉项的确定性 LQ 微分博弈扩展到时滞情形,通过构造闭环解、代价函数与 Bellman 约束推导 Riccati 型方程及显式反馈公式,并证明闭环稳定性。实验在双加热器热控原型上用 ESP32 实现,相比两台 REX-C100 上的最优 PI 控制显示更好的瞬态表现,但具体增益幅度需依赖文中实验细节判断。

Robust Optimization for Green Ammonia Production Figure 1
2026-06-09math.OC

Robust Optimization for Green Ammonia Production

Karl Zhu, Yassine Bohafid, Omar Kadir, Dimitris Bertsimas

Operations Research Center, Massachusetts Institute of Technology, Cambridge, MA, USA

2026-06-09优化算法安全鲁棒

面向可再生能源波动下绿氨装置难以满足哈伯–博施工艺最低负荷的问题,论文构建容量规划与滚动运行两层鲁棒优化框架,引入含热待机/停机的混合整数模型,并用 k-means 结合鲁棒优化生成保留低出力长时段的对抗场景。实验表明,该方法在样本外能给出可行容量方案,优于约束聚合基线;自适应鲁棒策略产量更高,但对不确定集外情形保护较弱。

Benchmarking Sequential Feedback Optimization for Wind Farm Power Maximization Figure 1
2026-06-09eess.SY

Benchmarking Sequential Feedback Optimization for Wind Farm Power Maximization

Shijie Huang, Sergio Grammatico

2026-06-09优化算法数据集/基准

针对风电场尾流耦合使低保真稳态模型难以可靠指导实时控制的问题,本文在中保真动态流模型 WFSim 上构建统一基准,比较 SFO、AMPC 与 ESC。核心洞察是将稳态功率最大化放到在线反馈优化框架中评估计算可行性与收敛质量。九机组实验显示,SFO 稳态功率最高且满足实时性,AMPC 瞬态更好但在线计算代价高,ESC 便宜但易停在局部最优。

Exact Optimization-Free Safety Filters for Control Barrier Functions Figure 1
2026-06-09eess.SY

Exact Optimization-Free Safety Filters for Control Barrier Functions

Ankit Goel

2026-06-09规划控制优化算法安全鲁棒

针对嵌入式、高频控制中每步求解 CBF 二次规划代价较高的问题,论文研究何时可用“仅修正当前被违反的仿射约束”替代优化器。核心洞察是该闭式最小范数修正并不总等于完整可行集的欧氏投影,需通过原始/对偶可行性、约束法向量相互作用及 Gram 矩阵条件来认证。主要结果给出精确性的充要判据、结构性充分条件和在线检测流程,失败时仍需回退到标准 CBF-QP。

Equivalence between time and norm optimal control problems of stochastic differential equations Figure 1
2026-06-09math.OC

Equivalence between time and norm optimal control problems of stochastic differential equations

Yanqing Wang

2026-06-09规划控制

本文针对随机微分方程中“最短时间到达目标”和“最小控制能量”两类问题缺少统一关系的空白展开研究。关键洞察是随机控制需满足适应性,确定性系统常用的时间平移技巧失效;作者转而显式构造最小范数控制,并证明最小范数函数的连续性。主要结果是在精确可控线性 SDE 假设下建立两类最优控制问题的等价关系,进一步得到单调性、连续性及最优控制唯一性等结论。

Risk-Aware Control of Systems with Quasi-Cone-Bounded Nonlinearities Figure 1
2026-06-09eess.SY

Risk-Aware Control of Systems with Quasi-Cone-Bounded Nonlinearities

Dhairya Patel, Margaret P. Chapman

The Edward S. Rogers Sr. Department of Electrical and Computer Engineering, University of Toronto, 10 King’s College Road, Toronto, Ontario, Canada M5S 3G4

2026-06-09规划控制学习理论安全鲁棒

本文针对线性风险感知控制难以扩展到非线性系统的问题,研究含乘性与加性噪声、非线性满足拟锥有界条件的随机系统。核心思路是用正半定形式刻画非线性偏离,并围绕下一步状态预测协方差构造风险指标,从而推导解析的次优状态反馈控制器,而非依赖高维动态规划。数值例子显示,该非线性结构刻画与风险项能在平均性能和不利扰动下的保守性之间取得更可调的折中。

Latent Structural Categorical Matrix Completion with Application to Quasispecies Analysis Figure 1
2026-06-09math.OC

Latent Structural Categorical Matrix Completion with Application to Quasispecies Analysis

Qian Zhang, Meixia Lin

2026-06-09优化控制

针对非序数类别数据在缺失、噪声和类别不均衡下难以用实值低秩补全处理的问题,论文提出 LCMC:用 one-hot 二进制张量保留离散结构,外层自适应估计潜在维度,内层做结构化张量分解,并加入 split-merge-refine 与数据缩减提升规模化能力。在合成和病毒准种重建数据上,方法相较已有方案取得更高恢复精度和效率。

An Iterative Computational Framework for Infinite-Horizon Mean-Field Linear-Quadratic Zero-Sum Stochastic Differential Games Figure 1
2026-06-09math.OC

An Iterative Computational Framework for Infinite-Horizon Mean-Field Linear-Quadratic Zero-Sum Stochastic Differential Games

Yiyuan Wang

2026-06-09优化控制

针对无限时域二人均值场线性二次零和随机微分博弈中,鞍点求解被强耦合广义代数 Riccati 方程阻碍的问题,论文扩展经典迭代思想,构造单调递增矩阵序列将原问题分解为可解子问题,并逐步求稳定化解。主要结果是给出收敛性证明、稳定解存在唯一性判据及一个数值示例,形成适用于多类博弈型 Riccati 方程的通用计算框架。

Conditional Random Ordered Transport Spaces Figure 1
2026-06-09cs.LG

Conditional Random Ordered Transport Spaces

Lei Luo, Jian Yang

\addr PCA Lab, Key Lab of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology

2026-06-09优化控制

论文针对 Wasserstein 距离只能衡量分布远近、无法判断质量移动是否符合证据/语义/物理顺序约束的问题,提出条件随机有序传输空间 CROTS,将随机概率测度、随机 Wasserstein 度量、硬/软有序传输偏差与条件风险统一起来。主要结果包括硬软有序传输的良定性与对偶、软到硬收敛、完备性、受约束重心/投影及稳定性定理,说明学习动力学即使在距离上收敛,仍可能存在独立的有序风险下限。

A New Level Set Formulation for Improved Dirichlet Eigenvalue Minimizers Figure 1
2026-06-09math.NA

A New Level Set Formulation for Improved Dirichlet Eigenvalue Minimizers

Atharv Thakur

2026-06-09优化控制

本文针对体积约束下 Dirichlet 特征值形状最小化中,高重特征值导致目标不可微、经典水平集需反复求根且边界精度受限的问题,提出新的水平集域表示与迭代流程,并用 p-范数正则化目标保持形状导数稳定。理论上证明 p 参数化最小化器在弱 γ 收敛意义下趋向原问题,数值结果与文献最优形状相当或有所改进。

A null controllability data assimilation for the bulk-surface heat equation with dynamic boundary conditions Figure 1
2026-06-09math.OC

A null controllability data assimilation for the bulk-surface heat equation with dynamic boundary conditions

Javier Ramírez-Ganga

2026-06-09规划控制学习理论

本文针对带 Wentzell 动态边界的体-表面热方程中仅由内部子域观测重构终端状态的问题,动机来自海洋、膜生物和热传导等场景。核心创新是将 Carleman 可观测性、Tikhonov 正则化零可控重构与体/表面 Lie 分裂离散结合,并加入无需噪声先验的自适应后处理。结果证明连续精确重构与稳定性,给出离散误差分析;二维实验显示无噪声误差约 3–6%,强噪声下仍低于约 16%。

LEGS: Laplacian-Enhanced Gaussian Splatting with a Nonlinear Weighted Loss Figure 1
2026-06-09cs.CV

LEGS: Laplacian-Enhanced Gaussian Splatting with a Nonlinear Weighted Loss

Yongfei Guo, Qizhou Huo, Xuan Sun, Yuanhao Gong

Changchun Institute of Optics, Fine Mechanics and Physics, Chinese Academy of Sciences, Changchun, China and University of Chinese Academy of Sciences, Beijing, China

2026-06-09三维

本文针对 3DGS 光度损失对平坦区与结构丰富区一视同仁、易削弱边缘和细节的问题,提出 LEGS:不改动高斯表示和渲染管线,仅在重建损失中用二阶 Laplacian 响应替代一阶梯度,并通过非线性映射生成像素权重以强化结构区域优化。在 Tanks&Temples 与 Mip-NeRF360 上,PSNR 较 3DGS 最高提升 1.68 dB、较 EGGS 最高提升 0.52 dB,并可迁移到 FastGS/FasterGS,最高再提升 1.69 dB。

Combining Reinforcement Learning with Arc-search Interior-Point Method for Path Planning Figure 1
2026-06-09math.OC

Combining Reinforcement Learning with Arc-search Interior-Point Method for Path Planning

Yaguang Yang, Qiang Le, Isaac E. Weintraub

Yaguang Yang 1 1 1 Department of Electrical and Computer Engineering Hampton University, Hampton, VA, Qiang Le 2 2 2 Department of Electrical and Computer Engineering Hampton University, Hampton, VA

2026-06-09强化学习规划控制

针对含障碍路径规划中强化学习实时但不保优、优化方法高质量但依赖初值且计算较重的矛盾,论文将 DDPG 生成的可行路径作为弧搜索内点法的初始解,并在不满足内点条件时用启发式修正。单障碍和三障碍仿真表明,该组合相较 MATLAB-IPM/SQP 可扩大可行集与最优集,提升路径质量;但实时收益主要依赖离线预计算与检索。

On Improved Statistical Accuracy of Low-Order Polynomial Chaos Approximations Figure 1
2026-06-09eess.SY

On Improved Statistical Accuracy of Low-Order Polynomial Chaos Approximations

Vedang M. Deshpande, Raktim Bhattacharya

2026-06-09优化控制

针对低阶多项式混沌截断在不确定性传播与控制分析中常导致均值、方差估计失真的问题,论文将 Galerkin 投影和最小二乘系数求解改写为带矩约束的优化,强制匹配前两阶统计矩。代数随机函数实验显示,在低阶近似下相较标准 GP/LS 可显著降低矩误差,构建更省计算的统计准确代理模型。

Data-Driven Robust Model Reference Adaptive Control with Parameter Convergence Figure 1
2026-06-09math.OC

Data-Driven Robust Model Reference Adaptive Control with Parameter Convergence

Jiwei Wang, Simone Baldi, Henk J. van Waarde

Bernoulli Institute for Mathematics, Computer Science and Artificial Intelligence, University of Groningen, The Netherlands, School of Cyber Science and Engineering, Southeast University, China, School of Mathematics, Southeast University, China

2026-06-09规划控制学习理论安全鲁棒

这篇论文针对经典 MRAC 在过程噪声下易出现参数漂移、且现有鲁棒方法常依赖持续激励的问题,提出结合在线闭环数据与历史数据的数据驱动自适应律。核心洞察是用噪声显式刻画匹配误差,并借助 KYP 引理与 QMI 给出极限闭环矩阵 Hurwitz 的充要条件;结果表明增益可指数收敛到近似匹配解,闭环信号有界,无噪声时还能在更弱数据条件下实现精确参数收敛。

Verification Framework for the Union of Control Barrier Functions Figure 1
2026-06-09math.OC

Verification Framework for the Union of Control Barrier Functions

Chuanrui Jiang, Andrew Clark

2026-06-09规划控制

针对复杂非凸安全区域难以用单个高阶或神经 CBF 高效合成与验证的问题,本文将安全集表示为多个简单 CBF 子集的并集,并为切换式 CBF-QP 控制器给出避免过约束、保证有限次切换和前向不变性的充分条件。作者进一步分析两类切换策略并用 SOS 进行可验证化;实验显示该 union-CBF 框架比高阶多项式或组合 CBF 覆盖更大的安全区域,且验证效率更好。

On the sharp linear convergence rate of the circumcentered--reflection method on subspaces Figure 1
2026-06-09math.OC

On the sharp linear convergence rate of the circumcentered--reflection method on subspaces

Yunier Bello-Cruz

Department of Mathematical, Sciences, Northern Illinois University, DeKalb, IL 60115, USA.

2026-06-09学习理论

本文聚焦两子空间交投影这一投影算法基准问题,动机是精确刻画无参数 circumcentered-reflection method 的收敛速度。核心洞察是将从 V 初始化的 CRM 限制到主角结构中,用 Kantorovich 不等式证明其等同于线搜索映射并达到最优单步无参数速率。主要结果给出尖锐线性收敛常数 ρV,严格优于既有 cF 或 cF² 界,刻画一步收敛条件,并说明过反射不能进一步加速。

Path Planning Using Deep Deterministic Policy Gradient: A Reinforcement Learning Approach Figure 1
2026-06-09cs.RO

Path Planning Using Deep Deterministic Policy Gradient: A Reinforcement Learning Approach

Qiang Le, Yaguang Yang, Isaac E. Weintraub

Qiang Le 2 2 2 Associate Professor, Department of Electrical and Computer Engineering Hampton University, Hampton, VA, Yaguang Yang 3 3 3 Research Scientist, Department of Electrical and Computer Engineering Hampton University, Hampton, VA

2026-06-09强化学习规划控制优化算法

面向含威胁/禁飞区的自主车辆路径规划,论文针对传统最优控制难以实时求解的问题,将圆形障碍建模为“no-go”区,用 DDPG 在连续状态与动作空间中学习从位置、航向到转向动作的策略;奖励结合目标吸引场、障碍排斥场和航向变化能耗惩罚,并加入智能初始航向以提升早期避障成功率。仿真含单/多障碍场景,并与伪谱最优控制比较,显示路径可行且推理显著更快,但泛化到真实系统仍文中未充分说明。

Non-Archimedean Polydisc Spaces and Applications to Optimisation Figure 1
2026-06-09math.OC

Non-Archimedean Polydisc Spaces and Applications to Optimisation

Paul Lezeau, Yiannis Fam, Anthea Monod, Yue Ren

London School of Geometry and Number Theory, UK, Department of Mathematics, Imperial College London, UK, Department of Mathematics, Durham University, UK, distance matrix (centre), and four points in Q2 realizing the distances (right).

2026-06-09优化控制

针对非阿基米德空间能自然表示层级数据、但全不连通拓扑使常规优化难以适用的问题,论文引入受 Berkovich 几何启发的 polydisc 空间,在保留树状层级结构的同时获得路径连通、测地线和凸性等优化所需几何。文中证明度量树可自然嵌入,绝对多项式函数具通用逼近性,并给出极小值存在性及 best-first、MCTS、DOO 等算法,其中 DOO 有收敛保证,另提供 Julia 实现。

Koopman meets input-output data: Data-driven output-feedback control of nonlinear systems with closed-loop guarantees Figure 1
2026-06-09eess.SY

Koopman meets input-output data: Data-driven output-feedback control of nonlinear systems with closed-loop guarantees

Robin Strässer, Julian Berberich, Manuel Schaller, Karl Worthmann, Frank Allgöwer

aUNIVERSITY OF STUTTGART, INSTITUTE FOR SYSTEMS THEORY AND AUTOMATIC CONTROL, bCHEMNITZ UNIVERSITY OF TECHNOLOGY, FACULTY OF MATHEMATICS, cTECHNISCHE UNIVERSITÄT ILMENAU, INSTITUTE OF MATHEMATICS, OPTIMIZATION-BASED, to model analytically, yet plenty of measurement data are readily available. For linear systems, data-

2026-06-09规划控制

针对非线性系统数据驱动控制常需全状态测量、难以仅凭输入输出数据给出闭环保证的问题,本文将 Koopman 算子与由输入输出轨迹构造的扩展状态结合,直接识别双线性替代模型并套用鲁棒状态反馈设计。理论上利用可观测性证明扩展状态指数稳定,从而推出原系统状态指数收敛;结果主要由数值仿真验证。

Large-time behavior and accuracy of the Mean-Field Ensemble Kalman Filter in the Linear Detectable Setting Figure 1
2026-06-09math.OC

Large-time behavior and accuracy of the Mean-Field Ensemble Kalman Filter in the Linear Detectable Setting

Franca Hoffmann, Sangmin Park, Andrew M. Stuart

F. Hoffmann, S. Park, A.M. Stuart: Department of Computing and Mathematical Sciences, California Institute of Technology, Pasadena, CA 911025, USA

2026-06-09优化控制

本文针对 EnKF 虽广泛用于状态/参数估计但相对最优贝叶斯滤波的理论性质不足这一动机,研究线性可检测情形下非高斯初值的平均场 EnKF。核心洞察是用协方差加权最优传输度量重新刻画 Bayes 更新并导出 MFEnKF,从而获得合适的稳定性度量。主要结果证明离散与连续时间中 MFEnKF 向高斯测度子空间严格指数收缩,并在连续时间给出几乎处处的大时间稳定性与相对最优滤波的渐近准确性。

Benchmarking Quantum Algorithmic Resilience for CVaR Portfolio Optimization: The Expressibility-Coherence Trade-off Figure 1
2026-06-09quant-ph

Benchmarking Quantum Algorithmic Resilience for CVaR Portfolio Optimization: The Expressibility-Coherence Trade-off

Prashik N. Somkuwar, K. Srinivasan, G. Raghavan

2026-06-09优化算法数据集/基准

面向含均值-方差与CVaR尾部风险的组合优化,论文关注NISQ量子硬件上理论算法与稀疏拓扑的落差。其创新在于用经典-量子混合代理矩阵绕开CVaR辅助量子位瓶颈,并在IBM heavy-hex映射最多16个NIFTY 50资产,比较HE-VQNN与WS-QAOA的“SWAP税”。结果显示WS-QAOA表达更精确但非局部门开销导致严重退相干,HE-VQNN更保相干却难表达密集尾部相关,揭示当前硬件在密集金融优化上的两难。

A remark on diagnosability verification Figure 1
2026-06-09cs.FL

A remark on diagnosability verification

Kuize Zhang

2026-06-09优化控制

本文针对2011年一篇关于离散事件系统去中心化可诊断性验证的论文作技术勘误,动机是澄清其算法适用条件与复杂度声明。核心洞察是基于并行组合的验证器仍依赖无死锁、无不可观测发散两项假设,且给死状态添加不可观测自环可能改变可诊断性。文中构造LFSA反例说明原算法会误判,并指出共诊断性验证为PSPACE-hard,所谓多项式时间结论不成立。

Information-Geometric Optimization on Spheres Figure 1
2026-06-09cs.NE

Information-Geometric Optimization on Spheres

Vladimir Ja\' cimović

University of Montenegro

2026-06-09优化算法

针对机器人运动、导航和深度特征中常见的球面/方向黑箱优化,论文指出现有 NES/IGO 多停留在欧氏空间。其核心是以球面上的两类概率族构造自然搜索策略:实情形对应 Poincaré 球,复情形对应 Bergman 球,并严格推导 Fisher 几何下的自然梯度。主要结果表明,广义 Kuramoto 振子群可计算这些梯度并实现相应 IGO 算法,同时揭示 Bergman 球策略与量子决策的联系;文中偏理论推导,实证增益未充分说明。

2026-06-08

14 篇
Accelerated Decentralized Stochastic Gradient Descent for Strongly Convex Optimization Figure 1
2026-06-08cs.LG

Accelerated Decentralized Stochastic Gradient Descent for Strongly Convex Optimization

Ming Sun, Kun Yuan

Center for Machine Learning Research, Peking University

2026-06-08优化算法

本文针对去中心化随机强凸优化中通信轮数受目标条件数和网络谱隙共同拖累的问题,提出 MG-ADSGD,将 Nesterov 型原始–对偶外推与多轮快速 gossip 结合,并把 gossip 深度与 mini-batch 大小绑定,使通信精度提升同时降低梯度噪声。理论上其通信复杂度达到对 κ 和 1−β 的双重平方根依赖,较既有随机方法补上同时加速的缺口。

Local optimization of weak distance between compact surfaces on special Euclidean group Figure 1
2026-06-08math.OC

Local optimization of weak distance between compact surfaces on special Euclidean group

Kazuki Koga

Department of Mathematical and Computing Science, Institute of Science Tokyo, Meguro-ku, Tokyo, Japan.

2026-06-08优化算法

面向生物、化学等场景中三维紧致曲面的配准需求,论文将曲面视为表面测度,用负阶非齐次 Sobolev 弱距离在 SE(3) 上构造局部优化目标。核心在于证明平方目标具备可微性,并把梯度计算化为少量可由 NUFFT 高效近似的 Fourier 型变换。实验在三角网格 root-finding 配准任务中显示 SR1 信赖域法可收敛,合适初值下能找回全局解,并观察到该弱距离与节点最大欧氏误差走势接近。

A Nine-Compartment Nonlinear Epidemic Model with Spline-Based Identification of Time-Varying Transmission and Vaccination Dynamics: Application to the COVID-19 Third Wave in Italy Figure 1
2026-06-08math.OC

A Nine-Compartment Nonlinear Epidemic Model with Spline-Based Identification of Time-Varying Transmission and Vaccination Dynamics: Application to the COVID-19 Third Wave in Italy

Lokman Rachid Melhani, Antonino Sferlazza, Lars Grüne, Dominique Persano Adorno, Filippo D'Ippolito, Omar Enzo Santangelo, Ivan Marchese, Antonino Lo Burgio, Alberto Firenze

Department of Engineering, University of Palermo, Department of Mathematics, University of Bayreuth, Department of Physics and Chemistry “E. Segré”, University of Palermo, Viale delle Scienze, 90128 Palermo, Italy., Department of Internal Medicine “PROMISE”, University of Palermo, 90127 Palermo, Italy.

2026-06-08优化控制

针对传统 SEIR 难以刻画变异株、超级传播、疫苗免疫衰减和住院负担的问题,本文将意大利 2021 年第三波建模为九舱室非线性系统,并用 PCHIP 控制节点把时变传播率与接种率识别转化为 14 变量 SQP 逆问题。模型在住院、死亡和接种数据上分别达到 R²=0.966、0.987、0.999,并证明稳定性、可识别性与 O(h²) 逼近误差;敏感性分析指出住院周转参数比传播率更主导峰值负担。

The Proxy Benders Decomposition Figure 1
2026-06-08math.OC

The Proxy Benders Decomposition

Changkun Guan, El Mehdi Er Raqabi, Mathieu Tanneau, Pascal Van Hentenryck

H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Atlanta, USA, Department of Operations and Decision Systems, Université Laval, Quebec, Canada

2026-06-08优化控制

本文针对经典 Benders 分解在大规模混合整数优化中反复精确求解相似子问题、易 zigzag 而收敛慢的问题,提出 Proxy-BD:用自监督的预测—投影—补全过程生成对偶可行解,从而替代子问题求解且保持割的有效性。实验在设施选址和网络设计上显示,其在近似最优质量下显著降本,最大中位加速约 161 倍、割数量减少超过 240 倍。

Explicit Convergence Regions of PID-Damped Accelerated Gradient Methods in Nonconvex Optimization Figure 1
2026-06-08math.OC

Explicit Convergence Regions of PID-Damped Accelerated Gradient Methods in Nonconvex Optimization

Ailun Jian, Xun Li, Weigang Sun, Gaohang Yu

School of Sciences, Hangzhou Dianzi University, Hangzhou, 310027, Zhejiang, China, Department of Applied Mathematics, The Hong Kong Polytechnic University, Kowloon, Hong Kong, China, School of Science, Zhejiang University of Science and Technology, Hangzhou, 310023, Zhejiang, China

2026-06-08优化算法学习理论

针对动量加速法在非凸优化中易过冲、振荡且 PID 阻尼参数难以调节的问题,本文将算法建模为三阶非线性反馈系统,借助 KYP 引理和新的系统松弛策略,显式刻画步长、动量与导数增益的三维收敛区域。结果在 Regularity Condition 下给出线性收敛保证,并指出导数增益存在由非凸曲率决定的几何上界,过大反而压缩可行步长区间,解释过阻尼停滞现象。

No-Harm Physics-Informed Inverse Learning with Residual-Calibrated Uncertainty Figure 1
2026-06-08math.NA

No-Harm Physics-Informed Inverse Learning with Residual-Calibrated Uncertainty

Ronald Katende

Department of Mathematics, Kabale University

2026-06-08安全鲁棒

针对 PDE 反问题中物理信息学习虽能给出貌似更好重建、但缺少部署时可靠性判据的问题,本文提出“无伤害”认证选择层:用数据、物理、边界/初值和优化残差校准不确定半径,只有优于基线才接受学习结果。实验显示其能接受有证据支撑的改进,拒绝偏移、幻觉或未收敛候选,并在强病态情形下更保守。

Residual-Controlled Multiplier Learning for Stochastic Constrained Decision-Making Figure 1
2026-06-08cs.LG

Residual-Controlled Multiplier Learning for Stochastic Constrained Decision-Making

Kang Liu, Jianchen Hu, Ziyu Qu

School of Future Technology, Xi’an Jiaotong University, Xi’an, 710049, China, School of Automation Science and Engineering, Xi’an Jiaotong University, Xi’an, 710049, China, School of Mathematics and, Physics, China University of Geosciences, Wuhan 430074, China

2026-06-08规划控制

论文针对随机约束决策中小批量噪声会被原始对偶更新累积、导致乘子记忆抖动或滞后的问题,提出 RCML:将投影乘子分解为用于原变量下降的有效压力和用于有限增益跟踪的压力-记忆残差,并加入滤波、坐标自适应缩放与 PI 修正。理论上给出凸仿射情形收敛和随机残差界;在优化、资源分配、公平排序等任务中提升可行性控制与乘子稳定性,同时保持相近目标性能。

A Min-Max Gradient Search Method for Constrained Simulation Optimization Figure 1
2026-06-08math.OC

A Min-Max Gradient Search Method for Constrained Simulation Optimization

Ruiyang Jin, Siyang Gao, Henry Lam

Department of Systems Engineering, City University of Hong Kong, Department of Industrial Engineering and Operations Research, Columbia University

2026-06-08优化算法

本文针对约束仿真优化中目标与约束只能由带噪仿真评估、梯度不可得而难以兼顾可行性与有限时间保证的问题,提出单循环的 Min-Max Gradient Search。方法将原始-对偶梯度下降上升与高斯平滑有限差分、公共随机数、强凹正则和动量更新结合,在惩罚约束违背的同时优化目标;理论证明以约 O(T^{-1/3}) 收敛到平稳点,并在排队系统和 2000 维问题上显示更好的可扩展性。

A Single-Loop Regularized Newton Method for Nonconvex-Strongly-Concave Minimax Optimization Figure 1
2026-06-08math.OC

A Single-Loop Regularized Newton Method for Nonconvex-Strongly-Concave Minimax Optimization

Bohao Ma, Nachuan Xiao, Junyu Zhang

School of Data Science, The Chinese University of Hong Kong (Shenzhen), Shenzhen, Guangdong, China

2026-06-08优化算法

针对非凸-强凹 minimax 中二阶方法常依赖内层最大化、导致双循环带来病态敏感和局部超线性受阻的问题,论文将原问题等价改写为正则化最小化,并以自适应三次-二次上界吸收重构 Hessian 的非 Lipschitz 项,形成单循环正则化 Newton。确定性情形保持 O(ε^-1.5) 全局复杂度并获局部超线性;随机情形结合递归方差缩减,将梯度/ Hessian 复杂度提升到 O(ε^-3)/O(ε^-2),实验显示相对双循环基线加速。

A variational formulation of the adjoint Kutta condition in potential flow Figure 1
2026-06-08math-ph

A variational formulation of the adjoint Kutta condition in potential flow

Carlos Lozano, Jorge Ponsin

2026-06-08生成模型

针对二维亚临界势流连续伴随方法中 Kutta 条件与尾迹切口处理不一致的问题,论文从变分角度重新表述环量这一全局自由度。核心做法是在后缘加入局部罚项,并由拉格朗日量对环量的驻值条件确定乘子,从而无需在变分问题中引入 wake cut。结果表明,先前解析伴随解中的后缘奇异强迫可由该构造自然导出,并据此澄清了离散伴随双一致性应对齐的连续问题。

Scalable Finite Adaptability via Polyhedral Partition and Learning Figure 1
2026-06-08math.OC

Scalable Finite Adaptability via Polyhedral Partition and Learning

Zolykha Rezaei, Ningji Wei, Eojin Han

2026-06-08优化控制

本文针对有限适应性优化中“候选决策—不确定性区域”联合分配导致的组合爆炸与可扩展性瓶颈,核心做法是显式建模不确定集的多面体划分,并用参数化划分、分片对偶化与近似-学习-并行框架解耦分区学习和区域内决策优化。理论上证明区域数增加时该类策略收敛到完全可调策略;实验在鲁棒与随机设置的最短路、资本预算、项目管理等基准上显示可处理更大实例且性能有竞争力。

Successive Convexification for Trajectory Optimization with Continuous-time Satisfaction of Signal Temporal Logic Specifications Figure 1
2026-06-08math.OC

Successive Convexification for Trajectory Optimization with Continuous-time Satisfaction of Signal Temporal Logic Specifications

Samet Uzun, Behçet Açıkmeşe

∗ William E. Boeing Department of Aeronautics & Astronautics, University of Washington, Seattle, WA, 98195

2026-06-08规划控制优化算法

针对离散网格 STL 难以保证连续时间安全、且传统鲁棒语义存在非光滑与梯度遮蔽的问题,论文将 GMSR 鲁棒度提升到 CT-STL,并通过辅助动力学嵌入时间聚合,结合多重射击、时间缩放与 prox-convex 求解轨迹优化。实验在双积分器和 6-DoF 四旋翼任务中展示了 always、eventually、until 等连续时间规格可被平滑处理并生成满足约束的轨迹。

Path-Dependent Ergodic Optimal Control and Backward Stochastic Differential Equations Figure 1
2026-06-08math.PR

Path-Dependent Ergodic Optimal Control and Backward Stochastic Differential Equations

Xuyang Lin, Mathieu Lise, Nizar Touzi

∗New York University, Tandon School of Engineering, Dept.of Financial and Risk Engineering

2026-06-08规划控制

本文针对传统遍历最优控制多限于时间齐次 Markov 状态、难以处理延迟与路径依赖成本的问题,构造时间与路径依赖的无限时域遍历 BSDE。核心洞察是最优遍历成本不再由常数 λ 表示,而由确定性函数 Λ 的渐近平均刻画。论文证明了该方程的适定性、验证定理与稳定性,并覆盖一般加权平均成本及时间周期等特例。

A Primal--Dual Penalty Algorithm and Optimal Control of the Double Integrator Figure 1
2026-06-08math.OC

A Primal--Dual Penalty Algorithm and Optimal Control of the Double Integrator

Regina S. Burachik, C. Yalçın Kaya, Xuemei Liu

∗School, University

2026-06-08规划控制

本文以双积分器最小能量控制这一经典测试问题为对象,动机是透视原始-对偶罚算法在无限维约束优化中的迭代行为。核心做法是将动力学边界条件化为积分约束,并按边界参数划分全部情形,从而解析刻画对偶函数、最优控制和最小精确罚参数。结果显示,算法轨迹的切换与约束函数区域变化对应,并比较了多种步长规则的收敛表现。

2026-06-05

19 篇
Statistically and Computationally Optimal Estimation and Inference of Common Subspaces Figure 1
2026-06-05math.ST

Statistically and Computationally Optimal Estimation and Inference of Common Subspaces

Joshua Agterberg

2026-06-05优化控制

本文面向多矩阵数据中共享低维结构的估计与不确定性量化,研究带 Wigner 噪声的对称低秩公共子空间模型。核心在于用谱平方和初始化的投影梯度下降统一刻画统计与计算极限,并按 SNR 划分弱、中、强估计、强推断区间。结果证明强估计 SNR 下达到最优 sinΘ 误差,强推断 SNR 下可构造自适应极小极大置信区间,同时揭示估计已可计算时自适应推断仍可能信息论不可行。

A q-Tsallis Safe Approximation for Chance-Constrained Programs Figure 1
2026-06-05math.NA

A q-Tsallis Safe Approximation for Chance-Constrained Programs

Sergio Assunção Monteiro, Fabricio Alves Barbosa da Silva

2026-06-05安全鲁棒

本文针对重尾不确定性下经验 CVaR 机会约束会低估尾部风险的问题,提出基于 Tsallis 几何的 q-CCP:用秩相关 escort 权重重加权最坏场景,并将可行域解释为 Tsallis 散度球。理论上证明其对 q>1 严格收紧 CVaR-CCP,给出与尾指数无关的违约比闭式公式及体积—安全权衡;实验在 Ibovespa 与 M5 库存任务中显示更低违约但需支付成本溢价。

Second order splitting dynamics for stochastic monotone inclusions with closed loop distribution Figure 1
2026-06-05math.OC

Second order splitting dynamics for stochastic monotone inclusions with closed loop distribution

Wutao Si, Hamza Ennaji, Jalal Fadili

2026-06-05优化控制

本文关注决策会反过来改变数据分布的随机优化/performative prediction,将其表述为带闭环分布的单调包含平衡问题。核心做法是构造基于分布评估前向-后向分裂算子的二阶惯性连续动力学,用 resolvent 处理非光滑正则项。主要结果是在一致单调下证明平衡点存在唯一、轨迹强收敛并给出速度衰减率;在强单调与常数 Polyak 阻尼下进一步得到全局指数收敛。

Peng's Maximum Principle for McKean-Vlasov Stochastic Differential Equations with Common Noise Figure 1
2026-06-05math.PR

Peng's Maximum Principle for McKean-Vlasov Stochastic Differential Equations with Common Noise

Johan Benedikt Spille, Wilhelm Stannat

2026-06-05优化控制

针对含公共噪声的 McKean–Vlasov 随机控制中条件分布依赖使经典最大值原理失效的问题,本文在非凸控制域下推导 Peng 型必要最优性条件。核心洞察是二阶 Lions 展开中的条件独立副本交互不再是高阶小量,需引入由条件 McKean–Vlasov BSDE 给出的第三伴随过程;三类伴随状态共同完成对二阶项的对偶化,并给出相应 BSDE 适定性结果。

Ensemble Kalman Inversion as an Inertial Interacting Particle System Figure 1
2026-06-05math.NA

Ensemble Kalman Inversion as an Inertial Interacting Particle System

Michael Herty, Pierpaolo Porretta, Giuseppe Visconti

Institute for Geometry and Applied Mathematics, RWTH Aachen University, Department of Mathematics and Applied Mathematics, University of Pretoria, Department of Mathematics, Sapienza University of Rome

2026-06-05优化控制

针对连续时间 EKI 在逆问题中易因 ensemble 协方差过早塌缩而受初始粒子强影响的问题,论文把 EKI 重写为带惯性的二阶相互作用粒子系统,引入阻尼、均值吸引和短程排斥以保留多样性。线性情形下作者分析均值与涨落动力学,给出塌缩态线性不稳定的参数条件、极限平衡的受限最优性刻画和指数衰减估计;数值实验显示在不利初始化下较一阶 EKI 更稳健。

Uniqueness and stability of Lagrange multipliers and associated qualification conditions Figure 1
2026-06-05math.OC

Uniqueness and stability of Lagrange multipliers and associated qualification conditions

Patrick Mehlitz, Gerd Wachsmuth

Marburg University, Department of Mathematics and Computer Science, Institute of Mathematics

2026-06-05优化控制

该文关注Banach空间约束优化中拉格朗日乘子的唯一性与扰动稳定性,动机是澄清孤立平静性与各类约束资格条件之间的精确关系。作者以固定原始解的受限乘子映射为核心对象,分析其一侧局部Lipschitz性质,证明孤立平静性可推出Robinson–Zowe–Kurcyusz约束资格,并在附加条件下与严格RZK条件等价;文中还用反例说明这些假设不可随意去除。

Distributionally robust shortfall risk portfolio model with moment ambiguity sets Figure 1
2026-06-05math.OC

Distributionally robust shortfall risk portfolio model with moment ambiguity sets

Yi Yang, Liu Yang, Suhan Zhong

Yi Yang, School of Mathematics and Computational Sciences, Xiangtan University, Xiangtan, Hunan, China, 411105, School of Science, Hunan City University, Yiyang, Hunan, China, 413000., Liu Yang, School of Mathematics and Computational Sciences, Hunan Research Center of the Basic Discipline Fundamental Algorithmic Theory and Novel Computational Methods, Xiangtan University, Suhan Zhong, School of Mathematical Sciences, Shanghai Jiao Tong University

2026-06-05安全鲁棒

针对传统均值方差、VaR/CVaR难以刻画重尾和极端损失,论文将短缺风险用于投资组合,并把资产收益建模为影响因子的多项式函数,在矩信息歧义集下构造分布鲁棒模型。核心是将分段线性损失情形等价转化为含非负多项式锥的线性锥优化,并用Moment-SOS松弛求解;文中证明有限/渐近收敛,给出全局最优性检验条件,并在真实股市数据上展示计算效率。

Combining diffuse and sharp interface methods in shape optimisation Figure 1
2026-06-05math.OC

Combining diffuse and sharp interface methods in shape optimisation

Philip J. Herbert, Michael Hinze, Christian Kahle

Philip J. Herbert 1 1 1 Department of Mathematics, University of Sussex, United Kingdom , Michael Hinze 2 2 2 Mathematical Institute, University of Koblenz, Germany , and Christian Kahle 2 2 footnotemark: 2

2026-06-05优化控制

针对 PDE 约束形状优化中初始拓扑未知、网格随大变形易退化的问题,论文提出先用相场法确定拓扑与近似形状,再从最优相场的零水平集构造贴合三角网格,作为锐界面 Lipschitz 形状优化的初值。数值算例显示,显式插入零水平线比简单传递相场信息能得到更好的初始网格和优化形状,并使结构优化在缺少先验拓扑时仍可运行。

Sparse Recovery via $\ell_1^2-η\ell_2^2$ Minimization Figure 1
2026-06-05math.OC

Sparse Recovery via $\ell_1^2-η\ell_2^2$ Minimization

Lang Yu, Nan-jing Huang

School of Mathematics, Sichuan University, 610064, Chengdu, P.R. China

2026-06-05优化控制

针对 WDSN 罚项 ℓ1²−ηℓ2² 在压缩感知中缺少精确恢复与 RIP 理论的问题,本文分析其非凸、非可分结构并给出 η 相关的 NSP/RIP 条件,建立稀疏与一般信号的稳定误差界;同时推导近端算子并设计全局收敛的 ADMM。实验显示其在无噪和有噪恢复中优于 iterative half variation 方法,但增益来源可能受参数与数据设置影响。

Iterative Thresholding Pursuit with Continuation for $\ell_{1-2}$-Regularized Sparse Recovery Figure 1
2026-06-05math.NA

Iterative Thresholding Pursuit with Continuation for $\ell_{1-2}$-Regularized Sparse Recovery

Junxi Wu, Zeyu Dong, Jun-Feng Yin

School of Mathematical Sciences, Tongji University, Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University, Key Laboratory of Intelligent Computing and Applications (Ministry of Education)

2026-06-05优化控制

针对ℓ1−2稀疏恢复中一阶迭代阈值法在支撑集稳定后收敛慢、且活跃系数存在收缩偏差的问题,论文提出带延续策略的ITP-C:先用ℓ1−2近端步自适应识别支撑集,再在该支撑上做受限最小二乘追踪,并用动态目标的严格下降检查抑制错误支撑带来的不稳定。理论上给出KL框架下收敛到临界点、有限支撑识别和条件oracle性质;实验在合成恢复与图像重建中显示较基线有更好恢复效果。

Convergence rate of the Halpern iterations with possibly distinct anchor and initial guess Figure 1
2026-06-05math.OC

Convergence rate of the Halpern iterations with possibly distinct anchor and initial guess

Jianing He, Qiao-Li Dong

School of Information Engineering, Tianjin University of Commerce, Tianjin 300134, China, College of Science, Civil Aviation University of China, Tianjin 300300, China

2026-06-05学习理论

本文针对既有 Halpern 迭代收敛率只覆盖锚点与初值相同的限制,研究非扩张映射不动点迭代中二者可不同的一般情形。核心洞察是将误差界从依赖初值转为依赖锚点到任一不动点的距离,并分别处理预设参数与自适应锚定参数。主要结果给出位移范数的紧收敛率估计,推广了 Lieder 及 He 等人的已有界。

On Parallel and Batch-Cutting Strategies for Norm-Minimization-Based Convex Vector Optimization Figure 1
2026-06-05math.OC

On Parallel and Batch-Cutting Strategies for Norm-Minimization-Based Convex Vector Optimization

Mohammed Alshahrani

Corresponding author. Department of Mathematics, King Fahd University of Petroleum & Minerals, Dhahran, 31261, Saudi Arabia

2026-06-05优化算法

本文针对范数最小化外逼近求解凸向量优化时,每轮需为大量顶点解独立子问题却只使用一个割平面的低效问题,提出并行评估子问题与批量加入最多 K 个支撑半空间。核心洞察是这些子问题天然可并行,且非最优顶点产生的割也可利用;理论上批量割保持原有 O(k^{2/(1-q)}) 收敛率。实验显示 8 核加速约 1.1–4.2 倍,批量割减少 62–80% 迭代,但墙钟收益受顶点增长和单顶点求解成本制约。

Cross-Epoch Adaptive Rollout Optimization for RL Post-Training Figure 1
2026-06-05cs.LG

Cross-Epoch Adaptive Rollout Optimization for RL Post-Training

Yiming Zong, Yige Wang, Jiashuo Jiang

2026-06-05强化学习优化算法

本文针对LLM强化学习后训练中每个prompt固定采样rollout造成预算浪费的问题,提出CERO跨epoch自适应分配框架:用Beta后验估计prompt成功率与奖励方差,将rollout价值建模为递减效用,并通过Fenchel对偶与在线 primal-dual 更新协调全局预算。理论上在固定效用下给出O(√K)遗憾界,数学推理实验中在多种开源模型和基准上优于GRPO;但对策略更新带来的非平稳性分析仍未充分覆盖。

Optimal experimental design for passive imaging source problems Figure 1
2026-06-05math.OC

Optimal experimental design for passive imaging source problems

Christian Aarset, Thorsten Hohage, Georg Stadler

(C04). C. A. and G. S. were partially supported by the Multidisciplinary University Research, †Institute for Numerical and Applied Mathematics, ‡Courant Institute School of Mathematics, Computing and Data Science, New York University

2026-06-05优化控制

被动成像依赖传感器相关数据,观测维度随传感器数平方增长,使声源协方差反演中的传感器布设优化代价很高。本文在贝叶斯框架下为无空间相关源构造 A-optimal 设计目标,并用两级低秩分解将 PDE 求解集中到离线阶段,在线可快速评估目标和梯度。二维 Helmholtz 数值实验显示,该方法可扩展到数百候选位置,并显著降低后验不确定性,优于随机布设。

Sharp First-Order Lower Bounds for Higher-Order Smooth Nonconvex Optimization Figure 1
2026-06-05cs.LG

Sharp First-Order Lower Bounds for Higher-Order Smooth Nonconvex Optimization

Dongruo Zhou

Department of Computer Science, Indiana University Bloomington, IN 47408, USA

2026-06-05优化算法学习理论

本文关注高阶光滑非凸优化中,仅用函数值与梯度寻找 ε-驻点的最优复杂度:已有算法在 Hessian/三阶导 Lipschitz 条件下可快于 ε^-2,但匹配下界长期缺失。作者构造 block-chain 难例,通过分块 oracle 揭示与线性读出保持高阶光滑性,证明维度无关的一阶下界:二阶光滑为 Ω(ε^-7/4),三阶光滑为 Ω(ε^-5/3),从而闭合已知上下界缺口。

Bayesian Equilibria of Heterogeneous Non-Atomic Routing Games with Private Information Figure 1
2026-06-05math.OC

Bayesian Equilibria of Heterogeneous Non-Atomic Routing Games with Private Information

Alexia Ambrogio, Leonardo Cianfanelli, Giacomo Como, Paolo Frasca

2026-06-05优化控制

针对网约车、物流车队与普通出行者共用路网且只掌握不完全交通信息的场景,本文将协调车队的系统最优路由与自私用户的 Wardrop 行为统一到异质非原子贝叶斯路由博弈中,显式建模状态不确定性和相关私有信号。核心结果是把问题转化为辅助两玩家博弈,并在有限状态与消息集、链路延迟单调等条件下证明贝叶斯均衡存在且给出唯一性条件,为后续信息设计提供可预测的均衡基础。

Should Demand Models Incorporate Competitor Prices? Oblivious Learning and Algorithmic Collusion Figure 1
2026-06-05cs.GT

Should Demand Models Incorporate Competitor Prices? Oblivious Learning and Algorithmic Collusion

Yuhang Wu, Assaf Zeevi

Columbia Business School

2026-06-05优化控制

本文关注竞争性平台定价算法在学习需求时是否应纳入竞争者价格。作者将“知情”与“忽视”建模放入含噪动态定价和迭代最小二乘框架,指出忽视竞争者会造成模型错设并迫使更强探索。主要结果表明,充分线性探索下价格收敛到竞争性纳什结果,衰减探索会产生伪均衡和短暂类合谋轨迹;混合市场中知情卖家收益更高,建模选择博弈的唯一均衡是全体知情。

Learning Implicit Feasibility Constraints for Real-World Routing and Scheduling: Application to Log Transportation Figure 1
2026-06-05math.OC

Learning Implicit Feasibility Constraints for Real-World Routing and Scheduling: Application to Log Transportation

Abdelhakim Abdellaoui, Ayoub Boufous, Issmail El Hallaoui, Loubna Benabbou, Francois Aubé, Mouloud Amazouz

2026-06-05强化学习优化算法

针对木材运输等真实车辆路径与调度中大量未写入 MILP、却导致方案被人工改动的隐式可行性规则,论文从历史执行数据学习约束:并行训练 GNN、决策树和线性模型,并线性化嵌入增强优化模型,由求解器按决策选择预测器。工业数据上,单模型已提升可执行性,堆叠方案在未见实例上以更小目标退化满足规则,并减少日常人工调整且保持可求解。

Gradient descent at the Edge of Stability: free energy model and kinetic description of the two-layer network Figure 1
2026-06-05math.OC

Gradient descent at the Edge of Stability: free energy model and kinetic description of the two-layer network

Antonin Chodron de Courcel

2026-06-05优化算法

本文关注大步长梯度下降在稳定性边缘中损失与 sharpness 持续振荡、传统梯度流失效的问题。核心创新是把平均参数轨迹与快速振荡协方差耦合建模,并提出含曲率“熵”项的有效自由能作为监控量;在宽两层网络中进一步推出描述权重及波动联合分布的平均场动力学方程。数值上,矩阵分解与 CIFAR-10 实验显示该模型能较好跟踪振荡包络和训练尖峰,但推导仍偏形式化,长期动力学与适用范围文中未充分说明。

2026-06-04

20 篇
Deep Embedded Multiplicative DMD for Algebra-Preserving Koopman Learning Figure 1
2026-06-04cs.LG

Deep Embedded Multiplicative DMD for Algebra-Preserving Koopman Learning

Kelan Gray, Finlay Brown, Nicolas Boullé, Matthew J. Colbrook

Department of Mathematics, Imperial College London, London, SW7 2AZ, UK., Department of Applied Mathematics and Theoretical Physics, University of Cam-

2026-06-04优化控制

本文针对 Koopman 学习中有限字典难以同时兼具表达性、近不变性与乘法结构的问题,提出 DeepMDMD:先用自编码器学习潜在空间,再联合优化潜在聚类,并将 Koopman 乘法规则作为硬约束。实验显示其在哈密顿、混沌和高维流体系统中比几何划分的 MDMD 使用更紧凑字典,减少谱污染,在强噪声下保持稳定预测和长期流场统计。

Convergence rates of Sum-of-Hermitian-Squares Hierarchies for the Pauli algebra Figure 1
2026-06-04quant-ph

Convergence rates of Sum-of-Hermitian-Squares Hierarchies for the Pauli algebra

Ali Almasi, Dávid Bugár, Cambyse Rouzé, Peter Brown

2026-06-04学习理论

针对 Pauli 代数上的非交换多项式优化,SOHS 层级虽常用于量子哈密顿量基态能量下界,但此前缺少精度随层级提升的定量收敛率。本文将多项式核方法扩展到非交换情形,构造与 Pauli 权重投影和 Krawtchouk 多项式相连的线性映射,给出以最小根控制的误差上界;对固定局域度 d 的 n 比特哈密顿量,证明第 r 层 SOHS 与真实基态能量的差可由算子范数、d 和 Krawtchouk 根显式界定。

Uncertainty-Aware End-to-End Co-Design of Neural Network Processors: From Training and Mapping to Fabrication Figure 1
2026-06-04cs.LG

Uncertainty-Aware End-to-End Co-Design of Neural Network Processors: From Training and Mapping to Fabrication

Yuyang Du, Yujun Huang, Gioele Zardini

School of Electrical and Electronic Engineering, Nanyang Technological, Laboratory, Institute

2026-06-04安全鲁棒

本文针对神经网络处理器设计中训练、映射、制造割裂且随机性被简化的问题,提出基于单调协同设计的端到端框架,将网络训练、芯片映射、晶圆制造和算力分配封装为可替换模块,并把成功概率的倒数 Confidence 作为与成本、时间、功耗并列的可优化资源。三个案例显示该方法能生成跨应用场景的 Pareto 前沿,支持置信度连续调节,且单模块改进可自动传导到全局解。

A model-free approach to control barrier functions for higher-order systems Figure 1
2026-06-04eess.SY

A model-free approach to control barrier functions for higher-order systems

Lukas Lanza, Johannes Köhler, Dario Dennstädt, Thomas Berger, Karl Worthmann

bDepartment of Mechanical Engineering, Imperial College London, London, UK, of such approaches commonly depends on the availability, reliance on complex models and are often scalable., available for controller design. We only assume the avail-, and its derivatives up to order r −1, i.e., ξ(t) is available

2026-06-04规划控制

针对传统控制障碍函数依赖精确动力学、且高阶相对度系统难以直接无模型化的问题,本文指出相对度一方法的朴素推广会失效,并借助漏斗控制构造向量辅助变量,将高阶约束转化为一阶 CBF 条件,从而刻画无需动力学模型和完整状态的安全输入子集;仿真在七自由度机械臂相对度二任务上验证了输出约束可被保持。

Towards Guaranteed Optimal PID Tuning for Uncertain Nonlinear Systems Figure 1
2026-06-04eess.SY

Towards Guaranteed Optimal PID Tuning for Uncertain Nonlinear Systems

Jingru Zhu, Cheng Zhao, Lei Guo

∗State Key Laboratory of Mathematical Sciences, AMSS, Chinese, Academy of Sciences, Beijing 100190, China., School of Mathematical Sciences, University of Chinese Academy of, only input-output (zeroth-order) data on the control performance is available. The tuning, Information availability: In our setting, the optimization

2026-06-04优化控制

本文针对不确定非线性 MIMO 系统中 PID 参数既要稳定又要性能最优的难题,将调参限制在已有全局稳定区域内,并把仅依赖输入输出性能数据的优化问题交给 HRS-KW 迭代算法处理。核心思路是用滞后随机搜索避免局部极小、用 Kiefer–Wolfowitz 加速局部改进;文中证明其在非凸代价下几乎必然收敛到 ε-最优 PID,同时学习全过程保持闭环稳定,仿真显示优于若干相关优化方法。

Activation Steering of Video Generation Models via Reduced-Order Linear Optimal Control Figure 1
2026-06-04cs.LG

Activation Steering of Video Generation Models via Reduced-Order Linear Optimal Control

Jihoon Hong, Alice Chan, Qiyue Dai, Julian Skifstad, Glen Chou

Georgia Institute of Technology

2026-06-04视觉感知规划控制

针对文生视频模型易生成暴力、裸露等不安全内容且现有激活 steering 容易过度干预的问题,论文将推理过程建模为动力系统,提出 LA-LQR:用对比提示构造低维概念子空间,在其中估计局部线性动态并求解闭环 LQR,以按层和时间步最小扰动地调节激活。实验显示其在概念 steering 与视频安全基准上比基线减少不安全生成,同时较好保持提示一致性和视觉质量。

Near-Optimal Decentralized Stochastic Convex Optimization over Networks Figure 1
2026-06-04math.OC

Near-Optimal Decentralized Stochastic Convex Optimization over Networks

Nitai Kluger, Amit Attia, Tomer Koren

2 2 Blavatnik School of Computer Science, Tel Aviv University, Tomer Koren 3 3 3 Blavatnik School of Computer Science, Tel Aviv University, and Google Research Tel Aviv

2026-06-04优化算法

论文关注在固定总梯度样本预算下,去中心化网络能并行使用多少节点而不损失中心化随机凸优化的统计精度。核心做法是 DDA-SGD:用一步延迟、动量补偿的查询调度,将 Nesterov 随机加速与加速 gossip 交织执行,控制节点分歧带来的偏差。结果证明在谱隙为 ρ 的网络上可支持约 √ρ·N^{3/4} 个节点,异质性仅对数影响,并给出匹配下界,说明除对数因子外近最优。

GPU-Accelerated Direct Transcription-Based Nonlinear Model Predictive Control Figure 1
2026-06-04eess.SY

GPU-Accelerated Direct Transcription-Based Nonlinear Model Predictive Control

Evelyn Gondosiswanto, Joshua L. Pulsipher

Department of Chemical Engineering, University of Waterloo, 200 University Ave W, Waterloo, ON N2L 3G1, Canada

2026-06-04规划控制

本文针对非线性 MPC 在实时反复求解转录后大规模 NLP 时的初始化与线性代数开销,提出参数化的二阶内点 GPU 框架:OCP 结构只构建一次,并复用稀疏 Cholesky 符号分解等结构相关计算。蒸馏塔和二维加热板实验显示,总 NMPC 运行时间提升超过一个数量级,GPU 单次迭代求解时间相对基线最高减少 94%。

Optimal Control of Sweeping Processes with Nonsmooth Moving Sets: A Numerical Algorithm Figure 1
2026-06-04math.OC

Optimal Control of Sweeping Processes with Nonsmooth Moving Sets: A Numerical Algorithm

Chadi Nour

2026-06-04规划控制

针对由扫掠过程约束的固定时域 Mayer 最优控制问题,现有数值法多局限于自治、较光滑或静态约束集,难以处理显式随时间变化的非光滑移动集合。论文的关键在于为移动约束集及其边界建立时间上一致的几何与分析估计,从而将指数罚函数/离散近似框架推广到非自治情形,并证明近似解收敛到原问题可行轨迹;两个光滑与非光滑例子显示数值轨迹与精确解吻合较好。

When Both Layers Learn: Training Dynamics of Representing Linear Models via ReLU Networks Figure 1
2026-06-04cs.LG

When Both Layers Learn: Training Dynamics of Representing Linear Models via ReLU Networks

Berk Tinaz, Changzhi Xie, Mahdi Soltanolkotabi

Department of Electrical and Computer Engineering, Department of Computer Science, University of Southern California, inputs are drawn i.i.d. from a Gaussian distribution and labels follow a planted linear model. This, xi and yi is given by the equation: yi = aT xi where a ∈Rd is the labeling vector. Conceptually, a is the target

2026-06-04优化控制

本文关注端到端训练为何能从数据中学到线性先验这一基础问题,以两神经元单隐层 ReLU 网络拟合高斯输入下的线性目标为模型。核心洞察是把梯度下降全过程分解为对齐、增长和局部精修三阶段,并用轨迹级控制解释其如何避开非严格鞍点。结果证明在适度小随机初始化和近最优样本复杂度下,同时训练两层也能线性收敛到全局最优,实验用于验证理论趋势。

ParetoPilot: Zero-Surrogate Offline Multi-Objective Optimization via Infer-Perturb-Guide Diffusion Figure 1
2026-06-04cs.LG

ParetoPilot: Zero-Surrogate Offline Multi-Objective Optimization via Infer-Perturb-Guide Diffusion

Ruiqing Sun, Sen Yang, Dawei Feng, Bo Ding, Yijie Wang, Huaimin Wang

2026-06-04生成模型优化算法

针对离线多目标优化中生成方法依赖外部代理模型、带来额外训练成本和外推误导的问题,ParetoPilot直接利用条件扩散模型已学到的目标先验,在反向去噪中通过IPG机制推断目标方向、正交结合收敛“引力”和多样性“斥力”,再用CFG引导生成。文中在51个任务上优于14个代理式和逆生成基线,显示更好的超体积和Pareto覆盖,同时减少数据访问需求。

A comparison principle for Wasserstein PDEs with state- and law-dependent common noise Figure 1
2026-06-04math.AP

A comparison principle for Wasserstein PDEs with state- and law-dependent common noise

Erhan Bayraktar, Ibrahim Ekren, Xihao He, Xin Zhang

2026-06-04优化控制

针对带共同噪声的 Wasserstein 空间二阶 HJB 方程,现有比较原理难以处理噪声系数同时依赖状态与分布的情形。论文引入测度依赖的非线性流,类似 Lamperti 变换,将非常规共同噪声 Hessian 化为辅助变量上的普通二阶导,并建立所需流估计。由此证明 Crandall–Ishii 型黏性解比较原理,并将受控随机滤波值函数刻画为唯一黏性解。

When Freshness Is Not Enough: Distribution-Aware Age of Information for Networked LQR Control Figure 1
2026-06-04eess.SY

When Freshness Is Not Enough: Distribution-Aware Age of Information for Networked LQR Control

Abdullah Y. Etcibasi, C. Emre Koksal, Eylem Ekici

Abdullah Y. Etcibasi, C. Emre Koksal, and Eylem Ekici are with the Department of Electrical and Computer Engineering, The Ohio State University, Columbus, OH 43210, USA.

2026-06-04规划控制

本文针对网络化 LQR 控制中常把平均 AoI 当作通信调度目标的做法,指出“信息新鲜”并不等价于闭环性能最优。作者从控制代价出发推导调度目标,证明代价依赖更新间隔分布的高阶矩, unstable 或相关扰动下还依赖指数矩;同均值 AoI 的策略可能成本差异显著。理论给出近周期调度在 i.i.d. 扰动下最优,并用 NGSIM US-101 车辆轨迹验证趋势。

A Perturbed q-Tsallis Self-Concordant Barrier for Spectrally Robust Semidefinite Programming Figure 1
2026-06-04math.OC

A Perturbed q-Tsallis Self-Concordant Barrier for Spectrally Robust Semidefinite Programming

Sergio Assuncao Monteiro, Fabricio Alves Barbosa da Silva

2026-06-04安全鲁棒

针对经典 log-det SDP 障碍函数对所有特征值同等敏感、在重尾或病态谱解中鲁棒性不足的问题,本文提出带 Tsallis 矩阵幂扰动的 q-Tsallis 障碍。核心结果是给出自协调性的精确阈值:q∈(1,2] 时对任意 η 全局成立,q>2 则全局失效但可局部控制;同时证明小特征值方向扰动敏感性按条件数衰减。实验显示重尾谱下敏感性降低 41–83%,迭代复杂度基本保持,Krylov 近似可带来约 7 倍加速。

A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks Figure 1
2026-06-04cs.LG

A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks

Tian Ding, Dawei Li, Ruoyu Sun

*Shenzhen International Center of Industrial and Applied Mathematics, Shenzhen Research In-, Shenzhen Loop Area Institute, China, ‡School of Data Science, The Chinese University of Hong Kong, Shenzhen, China, International Center of Industrial and Applied Mathematics, Shenzhen Research Institute of Big

2026-06-04优化控制

本文针对神经网络非凸训练中驻点几何尚不清楚的问题,研究两层光滑激活网络在“神经元分裂”扩宽后形成的驻点平台。核心创新是用单神经元的 inner Hessian 及分裂系数刻画平台局部曲率,给出局部极小与鞍点的分类:鞍点分裂后全为鞍点;局部极小分裂后通常产生含鞍点的平台或全鞍平台,并识别了确定鞍点区域。

PE-MHL: Physics-Encoded Modular Hybrid Layers for Scalable Learning of Complex Systems Figure 1
2026-06-04cs.LG

PE-MHL: Physics-Encoded Modular Hybrid Layers for Scalable Learning of Complex Systems

Ismail Hassaballa, Mircea Lazar

2026-06-04优化控制

面向控制中纯物理模型难刻画复杂动态、纯数据模型又缺乏泛化与可解释性的问题,本文提出 PE-MHL:以物理编码基模型为核心,逐步加入轻量子模型拟合残差,并用偏离惩罚保留既有结构;其最小二乘初始化给出训练误差单调不增与收敛保证。在静态非线性、NARX 和 Quanser Aero 2 实验中,相比同规模单体网络表现出更好的精度、泛化和训练稳定性。

Nonlocal Mean Field Schrödinger Bridge with Learned Interactions Figure 1
2026-06-04math.OC

Nonlocal Mean Field Schrödinger Bridge with Learned Interactions

Daisuke Inoue, Mathieu Laurière, Dante Kalise

†Shanghai Frontiers Science Center of Artificial Intelligence and Deep Learning, NYU-ECNU Institute of Mathemat-, ‡Department, College

2026-06-04优化控制

本文面向带非局部相互作用的均值场 Schrödinger Bridge:直接计算粒子两两核式项会随群体规模二次增长,限制拥挤导航、群体避碰等应用。作者将动力学与运行代价中的非局部项分别用神经代理学习,并嵌入前后向 FBSDE 的四阶段交替训练,使推理阶段单步复杂度降为线性;同时给出 Grönwall 型误差传播界。实验在导航和高维观点动力学中基本复现解析相互作用轨迹并缩短训练时间,但交替算法收敛性仍未证明。

A duality approach to the dense graph limit for biological transportation networks Figure 1
2026-06-04math.OC

A duality approach to the dense graph limit for biological transportation networks

Nuno J. Alves, Jan Haskovec

2026-06-04优化控制

本文针对生物运输网络稠密图极限中以往需假设边导率一致正的问题,重新用对偶变分形式定义动能项,使退化的非负可积导率核也可纳入模型,泊松方程不可解时能量取无穷。作者在代谢项诱导的自然 Lγ 拓扑下,证明半离散网络能量到连续 graphon 泛函的 Mosco/Γ 收敛,并通过正则化构造恢复序列,从而扩展了离散最小化问题到连续极限的适用范围。

Semantic Constraint Synthesis for Adaptive Trajectory Optimization via Large Language Models Figure 1
2026-06-04math.OC

Semantic Constraint Synthesis for Adaptive Trajectory Optimization via Large Language Models

Eleanor Brosius, Yuji Takubo, Daniele Gammelli, Simone D'Amico, Marco Pavone

Stanford University

2026-06-04规划控制优化算法

面向航天交会等任务中OCP约束改写依赖专家、难以随任务语义快速适配的问题,本文提出用LLM把自然语言任务要求编译为数学约束和CVXPY可执行代码,并接入凸轨迹优化求解器。实验在航天器交会场景验证,多种提示/生成策略下可较高成功率重构约束;但规模较初步,中间数学表达步骤的增益文中显示并不明显。

Pseudospectral Bounds for Transient Amplification in Coupled Gradient Descent Figure 1
2026-06-04cs.LG

Pseudospectral Bounds for Transient Amplification in Coupled Gradient Descent

Ahanaf Hasan Ariq

Ideal School and College

2026-06-04优化算法学习理论

本文针对双层优化、两时间尺度学习和 GAN 中耦合梯度下降即使谱半径稳定也会先剧烈放大的问题,指出非正规性导致的瞬态增益无法由传统谱分析解释。核心创新是用伪谱与 Kreiss 常数刻画块三角雅可比的放大边界,给出与耦合强度和稳定裕度相关的上下界、临界耦合阈值及扰动扩展,并推导随机耦合下降的有限时迭代复杂度,实验在 LQ、IQC 对比和神经网络训练中验证趋势。

2026-06-03

26 篇
Introduction to stochastic gradient methods Figure 1
2026-06-03math.OC

Introduction to stochastic gradient methods

Simon Weissmann

University of Mannheim, Institute of Mathematics, 68138 Mannheim, Germany, offered at the University of Mannheim during the spring semester of 2023 and the fall semester of

2026-06-03优化算法

本文面向机器学习训练中的大规模风险最小化问题,动机是用一阶与随机梯度方法在噪声梯度下获得可证明收敛。其核心不是提出新算法,而是系统梳理从确定性梯度下降到 SGD 的统一收敛论证,覆盖光滑、凸、强凸、PL 与非凸情形,并引入超鞅、Lyapunov 等工具。主要结果是给出期望收敛、几乎处处收敛、经典速率、下界讨论及 SAG/SAGA/SVRG 等方差缩减方法的自洽推导。

APX-Hardness of Computing Lipschitz Constants for Multi-Parametric Quadratic Programs Figure 1
2026-06-03eess.SY

APX-Hardness of Computing Lipschitz Constants for Multi-Parametric Quadratic Programs

Xingchen Li, Kunpeng Liu, Keyou You

ment of Automation, and Beijing National Research Center for Info. Sci., & Tech. (BNRist), Tsinghua University, Beijing 100084, China. (e-mail:

2026-06-03优化控制

面向 MPC 等优化控制中需评估 mpQP 解映射对状态扰动敏感性的需求,本文从复杂性理论解释为何 Lipschitz 常数难算。核心洞察是通过从 MAX-CUT、MAX-2SAT/ReLU 网络到 mpQP 的保间隙构造,证明一般情形不仅 NP-hard 还 APX-hard,且标量参数下仍成立;同时指出若约束数或决策变量数固定则可多项式求解,难度主要来自二者共同增长。

Bregman meets Lévy: Stochastic mirror descent with heavy-tailed noise in continuous and discrete time Figure 1
2026-06-03math.OC

Bregman meets Lévy: Stochastic mirror descent with heavy-tailed noise in continuous and discrete time

Pierre-Louis Cauvin, Panayotis Mertikopoulos

differential equation (SDE) driven by a centered Lévy noise process with finite p-th order, (SDE) formulation of SMD driven by a centered Lévy noise process. In contrast to existing

2026-06-03优化控制

本文关注随机镜像下降在梯度噪声重尾、甚至无穷方差时是否仍可靠,动机来自深度学习等训练中的长跳噪声。核心创新是用由中心 Lévy 过程驱动的连续时间 Lévy mirror flow 刻画 SMD 的重尾缩放极限,并发展适用于非 C2 凸函数的弱 Itô 工具。结果表明,凸情形可在约 O(ε^{-p/(p-1)}) 时间达 ε 最优,相对强凸时离散与连续算法给出约 O(ε^{-1/(p-1)}) 的匹配收敛保证。

Optimal Finite-Horizon LQR Control for Traffic Flow via Variable Speed Limits Figure 1
2026-06-03math.OC

Optimal Finite-Horizon LQR Control for Traffic Flow via Variable Speed Limits

Brian Block, Stephanie Stockar

The authors are with the Department of Mechanical and Aerospace Engi-, neering, The Ohio State University, 201 W 19th Ave, Columbus, OH 43210, limitations, particularly in maintaining controllability under

2026-06-03生成模型规划控制

针对交通拥堵需要在限定时间内缓解、而既有无限时域 LQR 难以保证收敛时间的问题,本文直接在 LWR 双曲 PDE 上设计可变限速域内控制。核心创新是推导时空变化的有限时域 LQR 反馈,将 Riccati 方程扩展为依赖时间、空间和交通状态的 PDE,并用特征线法解析求解,同时覆盖自由流与拥堵两种工况。仿真显示该控制器可实现有限时间收敛,相比无限时域方案在多场景下控制效果更好;参数敏感性分析也指出若 Q、R、S 与终止时间选择不当,限速输入可能不可行。

Analytical Evaluation of DCA Convergence Properties for Minimizing Prediction Functions of Gaussian RBF Support Vector Regression Figure 1
2026-06-03cs.LG

Analytical Evaluation of DCA Convergence Properties for Minimizing Prediction Functions of Gaussian RBF Support Vector Regression

Yohei Kakimoto, Yuto Omae, Hirotaka Takahashi

Nihon University., Tokyo City University.

2026-06-03学习理论数据集/基准三维

针对用高斯 RBF-SVR 预测函数作替代目标时非凸、常被黑箱元启发式求解且缺少收敛刻画的问题,论文利用 RBF 核 Hessian 结构构造显式 DC 分解,并闭式给出 DCA 子问题强凸与光滑常数界。六个基准函数实验显示,单一量 Cαρ 基本解释迭代次数和初值依赖,且主要由 SVR 超参数 C、γ 经两条路径决定,可在训练前粗估、训练后精确评估。

A Robust Optimization Approach to Sparse Principal Component Analysis Figure 1
2026-06-03stat.ML

A Robust Optimization Approach to Sparse Principal Component Analysis

David Vävinggren, Francis Bach, André M. H. Teixeira, Dave Zachariah, Antônio H. Ribeiro

Uppsala University, Sweden, PSL Research University / INRIA, France, Science for Life Laboratory, Sweden

2026-06-03优化算法安全鲁棒

针对高维场景下传统 PCA 载荷稠密、Sparse PCA 的 ℓ1 惩罚又难以在无监督任务中调参的问题,论文将稀疏 PCA 改写为潜空间最坏扰动下的鲁棒重构,提出 AdvPCA。其关键在于内层最大化可闭式化,分解为若干对抗线性回归更新稀疏编码器,并交替更新正交解码器;理论上给出正则路径和自适应半径选择,实验在合成与基因组数据上优于若干稀疏 PCA 基线。

Optimizing Explicit Unit-Distance Lower-Bound Certificates Figure 1
2026-06-03math.OC

Optimizing Explicit Unit-Distance Lower-Bound Certificates

Michael T.M. Emmerich

∗Faculty of Information Technology, University of Jyväskylä, Finland. ORCID: 0000-0002-7342-2090., below, disks have radius 1/2 and red segments are drawn only for pairs of centers at Euclidean distance exactly 1., and it is useful to separate three different geometric relations. If disks of radius 1/2 are centered at the points of a, planar set, then two disks are tangent precisely when their centers are at distance 1. However, the problem does not

2026-06-03学习理论

本文针对 Erdős 单位距离猜想被反例推翻后,Sawin 显式下界证书中参数尚未优化的问题,将有限参数选择形式化为非线性整数优化,并用可复现 Python 校验管线结合贪心与整数进化策略搜索素数集、重数和有理参数 R。主要结果是把已验证指数从 Sawin 的 δ≈0.01411 提升到 δ≈0.01526,支持对任意大 n 有 u(n)>n^1.0152,但仍只是证书级结果,未给出坐标实现。

A Recursive Domain- and Objective-Adaptive Frank-Wolfe Algorithm Figure 1
2026-06-03math.OC

A Recursive Domain- and Objective-Adaptive Frank-Wolfe Algorithm

Marcel Kaiser, Tobias Sutter

Department of Computer Science, University of Konstanz, Germany, Department of Economics, University of St.Gallen, Switzerland

2026-06-03优化控制

针对数据驱动优化中目标函数和可行域都需从样本逐步估计、传统 Frank-Wolfe 依赖精确模型的问题,本文提出递归自适应 Frank-Wolfe:每步在当前估计目标与估计域上调用线性 oracle,保持免投影。理论表明优化误差由估计器的集中精度控制,并在附加结构下给出更快率;两个实验含鲁棒 LQ 控制显示其接近精确模型 Frank-Wolfe 且计算更省。

Class-Based Smart Charging Control for Electric Vehicles Figure 1
2026-06-03math.OC

Class-Based Smart Charging Control for Electric Vehicles

Giuseppe C. Calafiore, Luca Ambrosino, Matteo Della Rossa, Laurent El Ghaoui

aDepartment of Electronics and Telecommunications Politecnico di Torino Corso Duca degli Abruzzi 24 10129 Torino Italy, bCollege of Engineering and Computer Science and Center of Environmental Intelligence VinUniversity Hanoi Vietnam, equipped with on-site photovoltaic (PV) generation and battery storage. To maintain scalability for large, and PV generation. To validate the framework’s scalability and robustness in its intended large-fleet regime, renewable generation. When PV production and stationary storage are available, the scheduling problem, scalability, and the integration of market signals with local energy resources remain central challenges in EV, agnostic extreme: it blindly uses available charging capacity and allocates it according to arrival priority, with, no attention to the cost of service. The approach proposed here introduces instead controllable flexibility

2026-06-03规划控制

面向大规模充电站中车辆到离站、光伏出力和电价均不确定且逐车优化难以扩展的问题,论文将电动车按剩余充电需求聚合为类别,建立离散随机动态,并用滚动时域线性规划联合决定类级充电、储能和购电;还给出一阶矩区间不确定下的鲁棒形式。900个随机场景显示,相比FIFS,服务水平仅小幅下降时单位电量成本最高降17.5%,日总成本降约10%–30%。

Distributed Optimal Resource Allocation Search: A Dynamic Event-Triggered Algorithm Figure 1
2026-06-03math.OC

Distributed Optimal Resource Allocation Search: A Dynamic Event-Triggered Algorithm

Haoze Li, Manqing Shi, Sitian Qin, Mengxin Wang

2026-06-03优化控制

面向多智能体资源分配中通信开销高、既有事件触发方法常依赖强凸性的限制,本文提出离散时间动态事件触发算法,在切换无向图下联合设计资源搜索递推与含梯度估计误差、梯度分歧残差的触发规则。该机制给出可求和误差界,并嵌入 Mirror-EXTRA 型 Lyapunov 分析,证明一般光滑凸目标收敛;强凸时进一步得到线性收敛,仿真显示通信次数低于相关方法。

A Less Conservative Sufficient Condition for PID Stabilization of Scalar Second-Order Nonlinear Uncertain Systems Figure 1
2026-06-03math.OC

A Less Conservative Sufficient Condition for PID Stabilization of Scalar Second-Order Nonlinear Uncertain Systems

Senhan Yao

Senhan Yao is with the Key Laboratory of Systems and Control, Academy, of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China, and also with the School of Mathematical Sciences, University of Chinese Academy of Sciences, Beijing 100049, China (e-mail:

2026-06-03优化控制

本文针对二阶标量非线性不确定系统中固定增益 PID 的鲁棒定点调节,动机是缩小既有 Lyapunov 充分条件与最坏线性模型必要边界之间的保守间隙。核心做法是在二次加积分 Lyapunov 函数中按有效阻尼区间两端平衡混合项惩罚,得到新的显式增益不等式。结果证明对完整导数有界不确定类可保证全局渐近稳定,且在速度导数界为正时认证的 PID 参数区域严格包含 Zhao–Guo 和 Zhang–Guo 条件,界为零时退化到必要边界。

Lean 4 Machine-Verified Proof of P = NP via the Pedigree Polytope Membership Problem Figure 1
2026-06-03cs.CC

Lean 4 Machine-Verified Proof of P = NP via the Pedigree Polytope Membership Problem

T.S. Arthanari

Department of Information Systems and Operations Management, University of Auckland, Auckland, New Zealand, (36 Lean 4 files, 2968/2968 build targets clean) is available at https://github.com/TiruArt/

2026-06-03优化控制

论文以谱系多胞体成员判定 M3P 为切入点,动机是通过多阶段插入刻画旅行商问题并推进 P vs NP。核心做法是构造递归分层网络,将成员性转化为多商品流达到最大流的问题,并借 Tardos 强多项式 LP 算法给出复杂度链;文中声称 Lean 4 形式化主证明并推出 STSP∈P、P=NP,但部分必要性与依赖定理的形式化边界仍需外部审查。

The Value Function Semi-Algebraic Set in Partially Observable Markov Decision Processes Figure 1
2026-06-03math.OC

The Value Function Semi-Algebraic Set in Partially Observable Markov Decision Processes

Ryan A. Anderson, Guido Montufar

2026-06-03优化控制

针对POMDP中部分可观测性使策略优化几何结构远比MDP复杂、传统值函数多面体直觉失效的问题,本文把无记忆随机策略下的Bellman方程视为参数化系统,先给出可行值函数的无限分段线性充要刻画,再构造有限多项式等式/不等式的半代数描述及边界行列式条件,揭示局部孤立最优和对初始分布依赖等现象。

Neural Networks Provably Learn Spectral Representations for Group Composition Figure 1
2026-06-03cs.LG

Neural Networks Provably Learn Spectral Representations for Group Composition

Jianliang He, Leda Wang, Fengzhuo Zhang, Siyu Chen, Zhuoran Yang

Department of Statistics and Data Science, Yale University, Our code is available at github.com/Y-Agent/nn-group-representation-learning.

2026-06-03优化控制

本文关注神经网络在群复合任务中为何会自发形成可解释的代数结构。核心做法是把两层网络的梯度流提升到有限群傅里叶域,证明训练等价于表示论能量上的黎曼梯度上升。主要结果显示,随机初始化下每个神经元几乎必然专化到单个不可约表示,跨层系数形成旋转秩一对齐;在阿贝尔群中还给出频谱多样化、Haar 均匀相位及指数收敛的完整刻画。

Hybrid Dynamics Modeling for a Flexible 2-DoF Robotic Arm Figure 1
2026-06-03cs.RO

Hybrid Dynamics Modeling for a Flexible 2-DoF Robotic Arm

Maciek Popik, Daniel Yang, Mahdis Bisheban

2026-06-03机器人

针对柔性连杆机械臂中刚体动力学难以覆盖的挠曲、摩擦和硬件非线性误差,论文在TUDOR开源2-DoF数据上比较运动学Ridge回归、基于公开参数的RBD,以及数据辨识RBD并用GMM/GMR学习残差的混合模型。结果显示,直接采用物理参数预测最差,正则化和最小二乘辨识更贴近实测力矩,说明增益可能主要来自数据驱动参数识别与残差建模,而非纯解析模型。

Infinite Horizon Optimal Consumption: Intertemporal Hedging under Epstein-Zin Preferences Figure 1
2026-06-03q-fin.MF

Infinite Horizon Optimal Consumption: Intertemporal Hedging under Epstein-Zin Preferences

Erhan Bayraktar, Emmet Lawless

∗University of Michigan, Department of Mathematics, Ann Arbor MI 48109, United States., †University of Michigan, Department of Mathematics, Ann Arbor MI 48109, United States.

2026-06-03优化控制

本文针对不完全市场中具有随机投资机会的无限期消费—投资问题,动机是用 Epstein-Zin 偏好分离风险厌恶与跨期替代,刻画跨期对冲行为。核心创新是把值函数表述为一个非凸变分泛函的唯一极小元,其欧拉方程对应 HJB,并避免人为边界条件。主要结果证明极小元存在、正且有界并为经典解,验证其等于值函数,给出最优消费和投资反馈形式;随机波动、Gaussian 与厚尾收益例子显示厚尾下极端状态的最优消费率更高。

Koopman operator learning for predictive control via Khatri-Rao kernel regression Figure 1
2026-06-03math.OC

Koopman operator learning for predictive control via Khatri-Rao kernel regression

Mircea Lazar

Eindhoven University of Technology

2026-06-03规划控制

面向非线性受控系统的 Koopman-MPC,传统一阶或线性/双线性输入模型易累积预测误差且难处理输入非线性。本文在广义 Koopman 的 Khatri–Rao 表示上,引入沿轨迹堆叠的多步核回归,并用结构化 SVD 分别压缩状态/输入提升空间以保留模型结构。基于随机傅里叶特征的管线在混沌 Lorenz 系统上实现了从多初值稳定不稳定平衡点,但验证仍限于单一仿真例子。

One-Shot Optimization with Additional Inequality Constraints Figure 1
2026-06-03math.OC

One-Shot Optimization with Additional Inequality Constraints

Lea Fischer, Nicolas R. Gauger, Lisa Kusch

2RPTU University Kaiserslautern-Landau, Kaiserslautern, Germany, Eindhoven University of Technology, Eindhoven, The Netherlands, l.kusch(at)tue.nl

2026-06-03优化算法

面向含应力、安全裕度等不等式约束的工程/PDE 设计优化,本文将 one-shot 同步优化从等式约束扩展到不等式场景:通过松弛变量嵌入双增广拉格朗日并解析消去,保留 ∇La=-Ms 的耦合块结构,同时用广义导数处理 active-set 非光滑切换。主要结果是给出广义 Hessian 正定与严格局部最优的显式条件,并指出可据此构造预条件器;数值增益与大规模应用仍属展望。

Disciplined Nonlinear Programming Figure 1
2026-06-03math.OC

Disciplined Nonlinear Programming

Daniel Cederberg, William Zhang, Parth Nobel, Stephen Boyd

2026-06-03优化控制

针对通用非线性规划建模常把用户表达式黑箱交给求解器、导致不可微项和初始化易使求解失败的问题,本文提出 DNLP 语法,在 DCP 思想上允许光滑非线性与非光滑凸/凹原子按单调性规则组合,并自动无损规范化为光滑 NLP。作者给出 CVXPY 扩展实现和跨路径规划、最优控制、信号、金融、能源、统计的示例,结果主要表明该重写可简化初始化并提升求解可用性,但不保证全局最优或收敛。

A Nonmonotone Gradient-Based Algorithm for Symmetric Nonnegative Matrix Factorization and Graph Clustering Figure 1
2026-06-03cs.LG

A Nonmonotone Gradient-Based Algorithm for Symmetric Nonnegative Matrix Factorization and Graph Clustering

Ryan Swart, Johannes Brust

Funding: This work was partially supported by the startup fund at Arizona State University, † School of Mathematical and Statistical Sciences, Arizona State University, Tempe, AZ

2026-06-03优化算法

针对对称非负矩阵分解中投影梯度法长期被认为收敛慢、难以用于图聚类的问题,本文将非单调投影 Barzilai-Borwein 步长改造成 SNMPBB,并通过惩罚式双变量耦合保持对称性,扩展到图拉普拉斯正则和低秩随机近似场景。文中证明各变体收敛到一阶驻点;实验显示合成数据较 SymANLS 约快 6 倍,真实聚类精度不低于 SymANLS,且在 34 个 SuiteSparse 矩阵上优于 LAI-SymPGNCG。

Mitigating Spurious Correlations with Memorization-Guided Dataset De-Biasing Figure 1
2026-06-03cs.LG

Mitigating Spurious Correlations with Memorization-Guided Dataset De-Biasing

Arda Fazla, Abolfazl Hashemi

Authors with the School of Electrical and Computer Engineering, Purdue University, West Lafayette, IN 47907, USA.

2026-06-03数据集/基准

论文关注训练集中伪相关导致 ERM 依赖背景等捷径、少数群体最差精度下降的问题。作者指出常见 coreset/样本难度分数会被更早学习的伪特征主导,因而提出两阶段累计样本损失 TCSL,分别估计核心与伪特征难度,并据此做 TCSL-CS 子集选择。实验显示,仅用约 10% 训练数据训练标准 ERM,即可在 Waterbirds 等伪相关数据集上超过多种去偏方法,提升最差群体准确率。

On the gap of quiver representations Figure 1
2026-06-03math.OC

On the gap of quiver representations

John Maar

∗Technical University Berlin.

2026-06-03优化控制

本文关注不变量理论中零锥成员判定的算法瓶颈:测地优化法的复杂度受表示的 gap 条件数控制。作者把这一条件数系统化用于 SL 作用下的箭图表示,给出矩映射与半稳定性的估计框架,证明 A 型、仿射 A 型及等维树箭图的逆 gap 仅多项式增长,从而可多项式时间判定零锥;同时构造任意维树和一般连通箭图中 gap 或 weight margin 指数级变小的反例,并扩展到 σ-半稳定性。

Adaptive Accelerated Mirror Descent in Primal and Dual Spaces Figure 1
2026-06-03math.OC

Adaptive Accelerated Mirror Descent in Primal and Dual Spaces

Zeyi Xu, Long Chen

Department of Mathematics, University of California, Irvine

2026-06-03优化控制

本文针对欧氏梯度法在病态或非欧几何问题中步长保守、加速仍依赖全局 Lipschitz 常数的问题,提出 AAMD:用镜像几何作非线性预条件,在原始—对偶镜像流中耦合加速,并以累计 Lyapunov 扰动预算替代逐步严格下降,仅在稳定性受威胁时回溯。理论上在对偶相对光滑/凸及几何兼容条件下给出加速收敛,并在有界子水平集假设下得到凸目标 O(1/k²) 率;实验显示三者结合优于只用部分结构。

Re-opening PID controller stability domain in 3D via ruled surface by D-partition Figure 1
2026-06-03math.OC

Re-opening PID controller stability domain in 3D via ruled surface by D-partition

Andrey A. Tremba

2026-06-03规划控制三维

针对稳定 PID 控制器集合在三维参数空间中难以整体表示、常被退化为二维切片的问题,本文用 D-partition 将稳定域边界重新解释为由频率参数生成的直纹曲面及少数临界平面。该视角把边界分解为连续曲面片和线段族,可自然展开为二维表示,并统一处理传递函数纯虚零点。文中还给出定位稳定 kP 区间的充分条件、线框可视化方法,以及到最近失稳 PID 的显式脆弱半径公式。

Coherent Swap Regret and Channel-Proof Learning Figure 1
2026-06-03quant-ph

Coherent Swap Regret and Channel-Proof Learning

Sohail Sarkar

2026-06-03学习理论

论文指出量子博弈中的外部遗憾只防止“替换状态”,无法排除玩家对已收到量子态施加本地 CPTP 操作获利。作者提出相干 swap regret,并用 Choi 表示上的熵镜像更新学习偏离信道、播放其不动点;关键洞察是迹保持约束带来的方差坍缩,去掉朴素分析中的 √d 因子。结果给出中等时域下全 CPTP 偏离的紧 Θ(√dT log d) 率,说明困难来自非幺正、非 unital 重写利用推荐寄存器,并推出去中心化学习可收敛到 ε 近似信道安全的可分量子相关均衡。

GLENS: Global Search via Learning from Solver Iterates with Diffusion Models Figure 1
2026-06-03cs.LG

GLENS: Global Search via Learning from Solver Iterates with Diffusion Models

Anjian Li, Bartolomeo Stellato, Ryne Beeson

2026-06-03生成模型优化算法

本文面向多峰非凸连续优化中“既要多样局部最优、又要让局部求解器快速收敛”的昂贵全局搜索问题。核心洞察是不要只学最终解,而把求解器收敛前的中间迭代当作免费数据增强;GLENS用条件扩散模型学习最优点邻域结构,并用求解器行为模型引导采样靠近局部最优。实验覆盖改造基准函数和双机器人避障导航,显示其能保持多模态解分布,同时生成更易收敛的初值。

2026-06-02

56 篇
A No-Regret Framework for Adaptive Incentive Design Figure 1
2026-06-02math.OC

A No-Regret Framework for Adaptive Incentive Design

Georgios Vasileiou, Lantian Zhang, Silun Zhang

Department of Mathematics, KTH Royal Institute of Technology, Stockholm, 10044, Sweden.

2026-06-02学习理论

面向电价、收费等场景中管理者无法直接控制策略主体且偏好未知的问题,论文提出 RAID 无遗憾自适应激励框架,把偏好估计与纳什均衡调节统一起来。其关键在于仅需递减激励的最小二乘一致估计,并用探索/利用切换激励降低信息需求;在外生和内生噪声模型下均证明参数误差达 O(t^-0.5),平方社会成本遗憾为 O(t^0.5 log t),实验验证了收敛趋势。

A novel L-shaped refinement chain cuts method for two-stage stochastic programs Figure 1
2026-06-02math.OC

A novel L-shaped refinement chain cuts method for two-stage stochastic programs

Mike Hewitt, Francesca Maggioni, Andrea Spinelli

2026-06-02优化控制

针对两阶段随机规划在场景数增大时 L-shaped 分解子问题多、割生成与主问题求解成本高的问题,本文把场景细化链嵌入 Benders/L-shaped 框架,在不同层级按场景组而非单场景求解子问题,并刻画相邻层级割的关系,统一了 single-cut 与 multi-cut。固定收费多商品网络设计的均值-风险实验显示,合适的中等粒度分组可显著缩短时间或降低 gap,但过度聚合会削弱割强度。

Benchmarking Realistic Synthetic Instances Against a Large-Scale District Heating Network: A Multi-Objective Optimization Study for Berlin Figure 1
2026-06-02math.OC

Benchmarking Realistic Synthetic Instances Against a Large-Scale District Heating Network: A Multi-Objective Optimization Study for Berlin

Annika Buchholz, Stephanie Riedmüller, Matthew Passage, Janina Zittel

Zuse Institute Berlin, Applied Optimization, Berlin, Germany

2026-06-02强化学习优化算法数据集/基准

针对区域供热优化长期依赖单一真实案例、难以复现和横向比较的问题,本文以柏林大型供热网络为参照,提出可控生成真实感合成多能源网络实例的方法,并开放 JSON 拓扑与 MPS 混合整数规划基准。实验显示合成实例在一定条件下能复现真实运行优化特征,且时间分辨率、储能、结构简化等会显著影响模型规模、运行时间和组合难度。

Relax and Follow: L0-Path Computation with L0-Bregman Relaxations Figure 1
2026-06-02math.OC

Relax and Follow: L0-Path Computation with L0-Bregman Relaxations

Mhamed Essafri, Luca Calatroni, Emmanuel Soubies

2026-06-02优化控制

论文关注ℓ0稀疏优化中正则化参数难调、完整解路径计算代价高的问题。核心做法是用保持全局极小点的ℓ0-Bregman连续精确松弛,推导局部极小点在λ0上的有效区间,并结合任意内层求解器进行双向 warm-start 树搜索。实验显示,在稀疏最小二乘、逻辑回归及Poisson回归设置中,L0PathBrex在合成与真实数据上通常优于L0Learn、L0PD等基线,但计算负担有所增加。

Investment and Operational Planning for electricity markets with massive entry of renewable energy Figure 1
2026-06-02math.OC

Investment and Operational Planning for electricity markets with massive entry of renewable energy

Nicolás Hernández-Santibáñez, Alejandro Jofré, Matías Vera

FB210005 for center of excellence from ANID-Chile, and ANID FONDECYT Iniciaci´on 11240944 from ANID (Chile)

2026-06-02规划控制

面向可再生能源大规模接入带来的发电容量随机性与电网传输约束,论文将ISO的运行调度和投资规划统一为连续时间随机控制问题。核心在于用日前调度显式消去运行控制,把规划转化为带状态约束的投资控制,并扩展指向内条件以刻画非光滑可行域。主要结果是证明价值函数为受约束HJB方程的唯一粘性解,并在三节点类智利电网仿真中比较短中长期规划下的可再生转型路径。

Retraction based regression methods on Riemannian manifolds Figure 1
2026-06-02math.OC

Retraction based regression methods on Riemannian manifolds

Estefanía Loayza-Romero, Benedikt Sibum, Kathrin Welker

University of Strathclyde, 26 Richmond St, Glasgow G1 1XQ, United Kingdom, Helmut-Schmidt-University / University of the Federal Armed Forces Hamburg

2026-06-02优化控制

针对流形值数据回归中反复计算黎曼指数映射代价高、在形状空间等场景甚至不可得的问题,本文以回缩及其诱导距离替代测地线模型,建立定义在切丛子集上的回归框架,并给出适定性条件、目标函数梯度公式及由底流形回缩构造切丛回缩的方法。在 p-范数球面上的归一化回缩实验显示最速下降可收敛到已知解,但解存在性和合适回缩选择仍留待后续分析。

Switched Event-Triggered Adaptive Control of Reaction-Diffusion PDE-ODE with Neural Operator Implementation Figure 1
2026-06-02math.OC

Switched Event-Triggered Adaptive Control of Reaction-Diffusion PDE-ODE with Neural Operator Implementation

Hongpeng Yuan, Ji Wang, Mamadou Diagne

2026-06-02生成模型规划控制

针对带未知空间反应系数和不确定 ODE 矩阵的反应扩散 PDE-ODE 串联系统,论文关注边界控制在实时实现中的通信与在线求核开销。核心做法是把自适应反步控制、切换动态事件触发和 DeepONet 核近似结合,在避免 Zeno 的同时调度时变增益。Lyapunov 分析给出闭环 L2 渐近调节及参数有界性,仿真显示开环不稳定系统可收敛,触发间隔保持为正。

Decision-calibrated prediction sets for robust power system operations Figure 1
2026-06-02math.OC

Decision-calibrated prediction sets for robust power system operations

Akylas Stratigakos, Honglin Wen, Elina Spyrou, Pierre Pinson

UCL Energy Institute, University College London, Department of Electrical Engineering, Shanghai Jiao Tong University, Department of Electrical and Electronic Engineering, Imperial College London, Dyson School of Design Engineering, Imperial College London

2026-06-02安全鲁棒

面向高可再生渗透下短时电网调度,论文指出按预测覆盖率校准鲁棒优化不确定集会过度保守。其核心是用部分输入凸神经网络学习条件多变量凸预测集形状,再按下游约束违约风险而非目标覆盖率校准集合大小。用于15分钟前备用调度时,在5节点与RTS-GMLC系统上能将约束满足率控制在目标约3个百分点内,相比覆盖率校准减少集合膨胀与运行成本。

A first-optimize-then-reduce framework for optimal control with the shifted proper orthogonal decomposition Figure 1
2026-06-02math.OC

A first-optimize-then-reduce framework for optimal control with the shifted proper orthogonal decomposition

Tobias Breiten, Shubhaditya Burela, Philipp Schulze

†Institute of Mathematics, Technische Universität Berlin, Germany

2026-06-02规划控制

针对输运主导 PDE 最优控制中传统 POD 难以用低维模型跨越 Kolmogorov 障碍、导致反复求解全阶系统代价高的问题,本文在先优化后降阶框架下先构造状态—伴随—控制最优性系统,再推导 sPOD-Galerkin 非线性降阶形式并与 POD-G 对比。数值结果显示,sPOD-G 虽带来非线性状态和伴随方程、实现更复杂,但用少一个数量级的模态即可较好捕捉全阶动力学和最优代价,后续加速仍需超降阶等策略。

Second-Order Optimality Conditions for Sparse Differentiable Optimization Problems via Limiting Second-Order Subdifferentials Figure 1
2026-06-02math.OC

Second-Order Optimality Conditions for Sparse Differentiable Optimization Problems via Limiting Second-Order Subdifferentials

Luu Thi Thu Huyen, Liguo Jiao, Nguyen Van Tuyen

2026-06-02优化算法

针对稀疏优化中基数约束非凸不连续、传统二阶条件常依赖 C² 光滑而难覆盖 C¹,¹ 模型的问题,本文引入 Mordukhovich 限制二阶次微分分析拉格朗日函数,在较弱假设下给出局部最优的二阶必要与充分条件,并扩展到含混合约束及稀疏多目标优化,得到有效解的二阶充分判据,示例用于说明适用性。

A Simple Hierarchical Causality Primer Figure 1
2026-06-02cs.MA

A Simple Hierarchical Causality Primer

Tim Gebbie

Department of Statistical Science, University of Cape Town, Rondebosch 7701, South Africa

2026-06-02优化控制

本文动机是澄清复杂多智能体系统中“自下而上涌现”与“自上而下约束”的差别,避免把宏观聚合误当成因果作用。核心洞察是区分本地交互的 agents 与承载角色/控制含义的 actors,并用因果类别、跨层聚合算子、层内转移核和离散事件时间映射来形式化层级因果。主要结果是给出一个离散的层级因果系统框架,说明宏观角色如何限制低层可 admissible 动态;文中以概念与玩具模型为主,未提供实验验证。

Adaptive Sharpness-Aware Minimization with a Polyak-type Step size: A Theory-Grounded Scheduler Figure 1
2026-06-02math.OC

Adaptive Sharpness-Aware Minimization with a Polyak-type Step size: A Theory-Grounded Scheduler

Dimitris Oikonomou, Nicolas Loizou

Mathematical Institute for Data Science (MINDS), Johns, Hopkins University, Baltimore, MD, USA 2Department of Com-, puter Science, Johns Hopkins University, Baltimore, MD, USA, Department of Applied Mathematics and Statistics, Johns, Hopkins University, Baltimore, MD, USA. Correspondence

2026-06-02学习理论

针对 SAM/USAM 虽能偏向平坦极小值但学习率高度依赖调参的问题,本文将 Polyak 型步长改造成适配 sharpness-aware 更新的自适应调度器,主要围绕 USAM 建立确定性与随机理论。在光滑强凸/凸情形给出线性收敛和 O(1/T) 速率,随机情形收敛到最优邻域;实验显示其可接近或优于精调 SAM,并显著减少学习率搜索。

Stochastic convergence of parallel asynchronous adaptive first-order methods Figure 1
2026-06-02cs.AI

Stochastic convergence of parallel asynchronous adaptive first-order methods

Serge Gratton, Philippe L. Toint

Natural Intelligence Toulouse Institute (ANITI), French ”Investing for the Future

2026-06-02学习理论

面向大模型训练中异构并行系统的锁-free异步优化需求,论文研究非凸随机目标下延迟、读写不一致与自适应步长并存时的收敛性。核心是提出一类异步自适应预条件一阶方法,覆盖 AdaGrad、Shampoo、Muon 等变体,并纳入动量与不精确归一化。理论上在合理延迟等假设下给出接近 O(1/√t) 的随机收敛率,实验表明其适用于异构大规模机器学习场景。

Accelerating Min-Max Optimization via Power-Law Stepsizes Figure 1
2026-06-02math.OC

Accelerating Min-Max Optimization via Power-Law Stepsizes

Yue Wu, Weiqiang Zheng, Yang Cai, Haipeng Luo

University of Southern California, Yale University

2026-06-02优化算法

本文关注鞍点/双仿射 min-max 问题中 EG 方法的 last-iterate 收敛瓶颈:固定步长只能达到 Θ(T^{-1/2}),而已有加速常需锚定或动量等额外机制。核心洞察是把步长设计转化为优化问题,得到近似幂律分布的确定性动态步长;同步长可提升到 O(T^{-2/3+ε}) 且证明紧性,若外推与更新采用不同步长,则进一步达到近最优 O(T^{-1+ε}),并可扩展到 OG 等方法。

An Improved Lower Bound for the Three-Dimensional Blaschke--Lebesgue Problem from Spectral and Dual Perspectives Figure 1
2026-06-02math.OC

An Improved Lower Bound for the Three-Dimensional Blaschke--Lebesgue Problem from Spectral and Dual Perspectives

Akatsuki Nishioka

Department of Mathematical and Computing Science, School of Computing, Institute of Science Tokyo, Ookayama 2-12-1, Meguro-ku

2026-06-02学习理论

本文针对三维定宽凸体最小体积的 Blaschke–Lebesgue/Meissner 猜想,试图缩小已知解析下界与 Meissner 四面体体积之间的差距。核心做法是将问题改写为支撑函数上的约束优化,结合球谐谱估计、Bochner 公式,并给出拉格朗日对偶解释。主要结果是把任意宽度 d 的三维定宽凸体体积下界提升到 4πd³/33≈0.380799d³,优于 Chakerian 的 0.364916d³,但仍未达到猜想最优值。

A Unified Variational Design of Predictive Mirror Descent in Convex Games under Stochastic Feedback Figure 1
2026-06-02math.OC

A Unified Variational Design of Predictive Mirror Descent in Convex Games under Stochastic Feedback

Yunian Pan, Tao Li, Quanyan Zhu

Department of Electrical and Computer Engineering, New York Univer-, Department of Systems Engineering, City University of Hong Kong, Hong

2026-06-02优化算法

本文针对凸博弈中镜像下降在弱稳定和随机反馈下易出现旋转、循环、末次迭代不稳的问题,提出用随机镜像微分博弈统一生成预测反馈:通过辅助记忆状态和双通道 Fenchel 代价,把预测战略项与已实现反馈校正项耦合起来。主要结果是在一般镜像几何下证明闭环纳什均衡诱导预测镜像动力学,并在局部正则、Bregman 增长和有界布朗噪声条件下给出有限时域期望界、高概率界及退出概率估计。

FlipItRight: Stable Pose-Targeted Throw-Flip Across Diverse Objects Figure 1
2026-06-02cs.RO

FlipItRight: Stable Pose-Targeted Throw-Flip Across Diverse Objects

Axel Dawne, Shinkyu Park

2026-06-02三维

针对机器人投掷多只关注落点、难以同时控制落地姿态的问题,FlipItRight将平面抛掷翻转拆成物体级释放状态规划与机器人级可执行轨迹规划,把释放位姿和速度作为中间表示,并在临近释放阶段约束末端近似恒速以减小释放时序误差。真实高自由度机械臂在4类不同形状、尺寸和质量物体的120次实验中达到90%成功率,消融显示候选筛选、构型自适应选择和近释放运动设计均有贡献。

MINTS: Minimalist Thompson Sampling Figure 1
2026-06-02math.OC

MINTS: Minimalist Thompson Sampling

Kaizheng Wang

2026-06-02优化控制

论文针对结构约束下序贯决策中完整贝叶斯先验难以建模的问题,提出只对最优位置设先验、用剖面似然消去 nuisance 参数的 MINTS 框架。该方法把 Thompson Sampling 直接作用于“谁是最优臂”的广义后验,可自然处理均值约束。理论上给出多臂老虎机近最优非渐近遗憾界,并证明在无结构情形达到 Lai–Robbins 常数、在单峰结构下自适应到由最优臂邻居决定的尖锐常数。

Minimal intersection radius for $n$ growing, non-homogeneous ellipsoids in $\mathbb{R}^d$ Figure 1
2026-06-02math.OC

Minimal intersection radius for $n$ growing, non-homogeneous ellipsoids in $\mathbb{R}^d$

Barbara Giunti, Sean Hill, Felix X.-F. Ye

2026-06-02优化控制

本文面向椭球 Čech 复形与流形覆盖检测中反复需要的公共交测试,研究不同朝向、不同增长速度的多椭球最小相交半径。核心洞察是用凸优化构造覆盖交集的证书,并将 MIR 等价表述为 SOCP 与 LP-type 问题;实现中比较 SLSQP、PGD、SOCP、Clarkson/Seidel 等算法,随机基准显示单次计算可达毫秒级,同时指出该问题一般不等同于最小包围椭球。

Inexact Proximal Point and Tseng Algorithms with Nonsummable Errors to Solve Monotone Inclusions Figure 1
2026-06-02math.OC

Inexact Proximal Point and Tseng Algorithms with Nonsummable Errors to Solve Monotone Inclusions

Ba Khiet Le, Boris S. Mordukhovich, Michel A. Thera

Analytical and Algebraic Methods in Optimization Research Group, Faculty of Mathematics and Statistics, Ton Duc Thang University, Ho Chi Minh City, Vietnam., .01-2025.61Department of Mathematics and Center for Artificial Intelligence and Data Science, Wayne State University, Detroit, MI 48202, USA.

2026-06-02优化控制

本文针对单调包含中近端点法与 Tseng 分裂法在实际计算存在有界但不可求和误差时的收敛性缺口;作者引入 Tikhonov 正则化,使相关算子具收缩性,并结合 R-连续性刻画稳定性。主要结果证明 IPPA 与 ITA 可在非消失误差下收敛到原问题的近似解,说明稳定性更多来自强单调正则项而非传统误差可求和假设。

An arc-search BFGS algorithm for unconstrained nonlinear optimization problems Figure 1
2026-06-02math.OC

An arc-search BFGS algorithm for unconstrained nonlinear optimization problems

Yaguang Yang

2026-06-02优化算法

针对经典 BFGS 在非凸无约束优化中可能失效、稳健 BFGS 虽有收敛保证但仍可提升效率的问题,论文将无约束问题置于内点法式框架,引入 arc-search 与稳健 BFGS 更新结合,使搜索过程自然满足 Wolfe 条件。作者证明了全局收敛和局部超线性收敛,并在 CUTEst 基准上与现有算法比较,显示计算效率具有优势。

Inexactly Smooth Performance Estimation and New Optimized Gradient Methods Figure 1
2026-06-02math.OC

Inexactly Smooth Performance Estimation and New Optimized Gradient Methods

Aaron Zoll, Benjamin Grimmer

2026-06-02优化算法

针对一阶优化方法常依赖特定光滑/非光滑假设、难以统一分析与设计的问题,本文提出“不精确光滑”凸函数框架,用带误差的二次上界统一刻画 L-smooth、Lipschitz、Hölder 光滑及其组合。核心贡献是建立相应函数演算、近紧的插值定理,并将其转化为凸形式的性能估计问题(PEP),从而构造出 (β,0)-Hölder 情形的精确极小极大最优方法、一般 Hölder 情形常数级最优保证方法,以及适用于任意不精确光滑问题的通用快速回溯算法。

Global Convergence of a Line-Search Filter Differential Dynamic Programming Method Figure 1
2026-06-02math.OC

Global Convergence of a Line-Search Filter Differential Dynamic Programming Method

Ming Xu, Iman Shames

School of Computer and Communication Sciences, Department of Electrical and Electronic Engineering, University of Melbourne

2026-06-02学习理论

针对带状态与控制非线性约束的离散时间最优控制,已有约束 DDP 多缺少全局收敛保证。本文将线搜索 filter 方法嵌入 FilterDDP,证明其后向递推—前向仿真生成的试探点在特定问题类中具备类似 Newton 步的性质,从而给出全局收敛分析:迭代极限点可行,且至少存在满足一阶最优性条件的极限点,并扩展到处理不等式约束的 barrier 内点框架。

A symmetry formula for the spectral fractional Laplacian, and applications to boundary controllability for plate equation with structural damping Figure 1
2026-06-02math.AP

A symmetry formula for the spectral fractional Laplacian, and applications to boundary controllability for plate equation with structural damping

Sergei Avdonin, Julian Edward

2026-06-02规划控制学习理论

针对分数阶谱拉普拉斯下结构阻尼板方程在非齐次边界控制中缺少可用分部积分公式、从而难以建立弱解与可控性的障碍,论文将矩形域上的对称公式推广到一般有界 C² 区域的 α<1/2 情形,并据此证明 Dirichlet/弯矩边界控制的适定性;进一步在矩形域 α<1、单位圆盘 α<1/2 等条件下给出边界零可控性结果,经典 α=1 情形则需更高正则性。

Non-convergence Analysis of Probabilistic Direct Search Figure 1
2026-06-02math.OC

Non-convergence Analysis of Probabilistic Direct Search

Cunxin Huang, Zaikun Zhang

∗Department of Applied Mathematics, The Hong Kong Polytechnic University, Hong Kong, China.

2026-06-02学习理论

本文关注随机无导数优化中“何时不收敛”这一少被系统研究的问题,检验 PDS 收敛理论里的类次鞅/概率下降假设是否必要。核心洞察是引入与概率下降相反的概率上升条件,并通过控制迭代点距初值的随机级数建立非收敛理论。结果表明,在凸目标下若上升概率超过阈值,PDS 以正概率不能渐近达到平稳性;典型均匀随机取向实现中,轮询方向数低于既有收敛阈值时不具全局收敛性,并给出非收敛概率下界。

Riemannian Optimization for Hadamard Products of Low-Rank Matrices Figure 1
2026-06-02cs.LG

Riemannian Optimization for Hadamard Products of Low-Rank Matrices

Pratik Jawanpuria, Ankish Chandresh, Bamdev Mishra

2026-06-02优化算法

本文针对两个低秩矩阵 Hadamard 乘积在推荐、链路预测等乘性结构建模中参数高效但对称性复杂、欧氏优化不稳的问题,将其表述为黎曼商流形优化;核心是刻画 GL 与交叉缩放不变性,并提出块对角黎曼度量与免调参 Gauss–Newton 步长的 RGD。实验显示其在最小二乘任务上接近 BCD,在 MovieLens-1M 多种秩配置下取得最低或并列最低 RMSE。

Time-Optimal Collision Avoidance Via a Greedy Polynomial Backward Sweep Figure 1
2026-06-02math.OC

Time-Optimal Collision Avoidance Via a Greedy Polynomial Backward Sweep

Zeno Pavanello, Frank De Veld, Roberto Armellin

Department of Aerospace Science and Technology (DAER), Politec-, Netherlands Aerospace Centre (NLR), Anthony Fokkerweg 2, Te Pu¯naha ¯Atea Auckland - Space Institute (TPA-SI), The Univer-, Earth-centered orbits has posed significant challenges for, lably, it can pose a threat of collision to nearby actively, RTN to Earth Centered Inertial (ECI), in which the state, [12]. B is centered on the secondary object

2026-06-02优化控制

面向低推力卫星避碰中“最晚何时必须开始机动”的运行需求,论文将传统燃料最优问题转为时间最优问题,提出从最近接时刻反向扩展的贪婪多项式后向扫描:用微分代数高效传播敏感度,把碰撞概率或错失距离写成控制节点的多项式并在线修正 TCA。大规模交会测试显示,该法相对最优控制基准仅有小幅最优性损失,运行时间适合星上实现。

A convexity criterion via the De Giorgi slope Figure 1
2026-06-02math.FA

A convexity criterion via the De Giorgi slope

Tahar Z. Boulmezaoud, Aris Daniilidis, Trí Minh Lê

2026-06-02优化算法

本文动机是将已有依赖 Hilbert 结构和二阶光滑性的凸性判据,推广到 Banach 空间中的非光滑函数。核心洞察是用 De Giorgi 度量斜率替代梯度范数,并通过最大下降曲线等工具绕开二阶动力系统证明。主要结果表明:连续且有下界的函数若某个 m≥1 下的斜率幂 s_f^m 为凸,则函数本身必为凸,同时给出光滑情形下梯度范数幂的相应判据。

A Semi-analytic Method for Rapid Coverage Analysis of a Satellite Using Piecewise Ellipse Models Figure 1
2026-06-02math.OC

A Semi-analytic Method for Rapid Coverage Analysis of a Satellite Using Piecewise Ellipse Models

Byeong-Un Jo, Jinsung Lee

Department of Aerospace System Engineering, Sejong University, Seoul, 05006, Republic of Korea, Department of Astronomy and Space Science, Kyung Hee University, Yongin-si, 17104, Republic of Korea

2026-06-02优化控制

面向长时段和大规模星座覆盖分析中数值搜索成本随时间、卫星数快速增长的问题,论文用升交点历元经度 ELAN 参数化单个交点周期可见性,并以可解析反演的分段椭圆模型近似 MELAN 边界,从而直接求入/出视时间。多轨道与目标纬度算例显示多数误差低于 0.1%,部分场景计算时间较简化向量化方法降至约 1/15000。

Relaxed Control with Entropy Regularization for Itô Stochastic Systems with Input Delay Figure 1
2026-06-02math.OC

Relaxed Control with Entropy Regularization for Itô Stochastic Systems with Input Delay

Ruixue Li, Xun Li, Zhaorong Zhang, Juanjuan Xu

2026-06-02规划控制

针对带输入时滞的 Itô 随机系统在乘性噪声下难以兼顾稳定控制与探索的问题,论文将经典无限时域随机最优控制改写为熵正则化的 relaxed control 形式。核心结果是推导出最优控制分布为高斯分布,并证明当探索权重趋近于零时,该分布收敛到经典最优 Dirac 测度;数值仿真用于验证方法有效性,但实际任务增益来源仍主要限于理论与仿真层面。

Exact-Penalty Prox-Linear Methods for Bilevel Optimization with $\ell_1$ Lower-Level Gradient Penalty Figure 1
2026-06-02math.OC

Exact-Penalty Prox-Linear Methods for Bilevel Optimization with $\ell_1$ Lower-Level Gradient Penalty

Yutong Zheng, Jiani Li, Qingna Li

2026-06-02优化算法

针对双层优化中下层解映射隐式且可能多值、难以直接处理的问题,论文用下层梯度的ℓ1范数构造精确罚单层化,并证明在正则条件和足够大罚参数下具有距离界与精确性。为求解所得非光滑问题,提出EPPL方法;在简单双层情形将子问题对偶化为盒约束二次规划并用SPG求解。最小范数最小二乘实验显示其可同时压低上下层误差,最终精度优于若干基线。

Nonsmooth High-Order Averaging Theory with Application to Extremum Seeking Optimization and Control Figure 1
2026-06-02math.OC

Nonsmooth High-Order Averaging Theory with Application to Extremum Seeking Optimization and Control

Hesham Abdelfattah, Sameh A. Eisa, Peter Stechlinski

analogous to first-order Lie bracket approximations available in the smooth literature. We provide, ∗Hesham Abdelfattah is with the Department of Aerospace Engineering and Engineering Mechanics and the Department of, †Sameh A. Eisa is with the Department of Aerospace Engineering and Engineering Mechanics, University of Cincinnati, OH, ‡Peter Stechlinski is with the Department of Mathematics and Statistics, University of Maine, ME 04469 USA (e-mail: pe-, conditions of the RHS function with respect to x. However, the available literature of nonsmooth averaging, to the best

2026-06-02规划控制优化算法学习理论

本文针对经典高阶平均理论依赖光滑向量场、难以处理非光滑优化与控制系统的问题,引入词典序微分工具,构造非光滑近恒等变换和 L-Lie bracket,给出一阶及首次非光滑二阶平均闭式公式。结果证明平均系统在误差界和稳定性上保持与光滑情形类似性质,并用于控制仿射极值寻优,在非光滑向量场或目标函数下通过仿真验证分析有效性。

When Shortages Lead to Export Restrictions: A Computational Study Figure 1
2026-06-02math.OC

When Shortages Lead to Export Restrictions: A Computational Study

Martha L. Sabogal De La Pava, Emily L. Tucker, Yongjia Song

a Industrial Engineering Department, Clemson University, Clemson, United States

2026-06-02优化控制

面向全球仿制药供应链中自然灾害、质量故障可能诱发短缺并触发出口禁令的问题,论文构建两阶段随机混合整数供应链设计模型,将出口禁令建模为由预期短缺内生触发的系统性风险,并比较三种Benders式交替割方法。肿瘤药案例显示,显式纳入常规与诱发风险能改变选址和质量投资决策;在近连续二阶段结构下,Alternating Integer L-shaped cuts计算表现最好。

Tiny Recursive Models for Solving the J2-Perturbed Lambert Problem Figure 1
2026-06-02math.OC

Tiny Recursive Models for Solving the J2-Perturbed Lambert Problem

Minduli Wijayatunga, Roberto Armellin

Department of Aerospace Engineering, University of Illinois Urbana-Champaign, Te Pūnaha Ātea – Space Institute, University of Auckland

2026-06-02优化控制

针对J₂摄动下Lambert问题中开普勒初值在多圈或强摄动转移时误差大、牛顿/同伦校正代价高且易失效的问题,论文将Tiny Recursive Models用于递归修正出发速度,把传播后的终端位置误差纳入端到端反馈,学习类似连续化的校正序列。实验显示,仅基于位置监督的细化方案最稳健,2.3M参数模型在LEO单圈/多圈和木星多圈任务上将中位终端误差从数十至数百公里降到0.027、0.31和3.9公里,木星案例再加一次牛顿迭代可达0.063公里。

Constrained Neural Parameterization for Optimization in Function Spaces Figure 1
2026-06-02math.OC

Constrained Neural Parameterization for Optimization in Function Spaces

Michael Hintermüller, Jianfeng Ning

2026-06-02优化算法

面向函数空间中的最优控制、反问题等约束优化,论文关注惩罚、投影和乘子方法在无穷维及状态约束下易调参、病态或低正则的问题。核心思路是构造像集始终落在可行集且渐近稠密的光滑神经参数化,把原约束问题转为参数空间无约束优化,并分别处理 Hilbert 空间多面体约束、点态约束和可分结构 PDE 约束。数值实验显示该方法能在不引入罚参数或拉格朗日乘子的情况下保持可行性并取得有效优化结果。

Frank-Wolfe with Moreau Envelope Smoothing for Nonsmooth Nonconvex Problems Figure 1
2026-06-02math.OC

Frank-Wolfe with Moreau Envelope Smoothing for Nonsmooth Nonconvex Problems

Antonio Silveti-Falls, Cesare Molinari, Zev Woodstock

Department of Mathematics, Università di Genova, Via Dodecaneso 35, Department of Mathematics & Statistics, James Madison University, 60

2026-06-02优化算法

针对含非光滑项与约束的非凸复合优化中 Frank-Wolfe 难以直接使用、且平滑间隙未必代表原问题驻点的问题,论文提出 FRAMES:用递减 Moreau 包络平滑非光滑项,每轮仅做一次线性最小化 oracle。核心洞察是建立平滑 Frank-Wolfe gap 与原非光滑驻点证书的转移关系,覆盖指示函数约束和 Lipschitz 弱凸正则。文中给出显式收敛率,最优调度下非光滑驻点率为 O(N^{-1/4}),并在矩阵分解和约束分裂实验中验证分析现象。

Coupled Routing and Charge Schedule Optimization of Electrified Delivery Truck Fleets: Feasibility Analyses Figure 1
2026-06-02math.OC

Coupled Routing and Charge Schedule Optimization of Electrified Delivery Truck Fleets: Feasibility Analyses

Yared Tadesse Wendimagegnehu, Beshah Ayalew, Andrej Ivanco, Habtamu Hailemichael

Yared Tadesse Wendimagegnehu and Beshah Ayalew Clemson University, Habtamu Hailemichael Clemson University, availability of fast charging at the depot. Findings indicate that at, in battery pack costs and availability of reduced electricity prices at the, assumed the availability of charging both at the depot and at customer

2026-06-02优化算法

面向城市配送重卡电动化中续航受限、购置成本高与补能安排耦合的问题,本文将路线选择和 depot 快充时长联合优化,并用动力总成仿真数据构建随速度、坡度和载重变化的能耗模型,再用自适应大邻域搜索分析大规模车队。结果显示电池容量存在成本、寿命、重量和能耗折中的最优点;在电池成本下降且 depot 电价较低时,即使较低电动化渗透率也可能具备经济可行性。

A path-following framework on fiber bundle for variational inequalities Figure 1
2026-06-02math.OC

A path-following framework on fiber bundle for variational inequalities

Hongbo Sun

Experiment codes and results are available at https://github.com/shb20tsinghua/FiberBundle_VI .

2026-06-02优化控制

为解决一般有限维变分不等式在非单调等假设下缺少全局收敛算法的问题,论文将连续紧凸域问题近似化为单纯形上的光滑 VI,并把其解空间表述为“固定点纤维丛”,用几何结构统一起点选择、路径跟踪与奇异性规避。理论上对非奇异解给出全局线性收敛,对奇异解在固定精度前保持线性下降;随机最高800维的14400个实例均求解成功,但实际优势相对经典方法的增益来源仍需更多对照说明。

Beyond Pure Sampling: Hybrid Optimization Mechanisms for Non-Convex Model Predictive Control Figure 1
2026-06-02cs.RO

Beyond Pure Sampling: Hybrid Optimization Mechanisms for Non-Convex Model Predictive Control

Yuichiro Aoyama, Minchan Jung, Akash Ratheesh, Evangelos A. Theodorou

1 affiliationmark: School of, Aerospace Engineering, Georgia Institute of Technology, Atlanta, GA, USA, 2 affiliationmark: Development Division, Komatsu Ltd., Tokyo, Japan, 3 affiliationmark: Department of Electrical and Computer Engineering, Inha University, Incheon, Republic of Korea

2026-06-02规划控制优化算法

本文针对非凸MPC在障碍密集、动力学非线性场景中易陷入局部最优的问题,分析并构建ME-DDP的混合优化机制:先用DDP利用局部梯度,再按动作价值函数逆Hessian诱导的策略采样扰动搜索,并比较单峰、多峰与Stein变体。四类机器人导航基准显示,低维任务优于多种MPPI,高维任务虽不一定最快但成功率更稳定,并通过四旋翼实机验证。

LLM-Driven Co-Evolutionary Automated Heuristic Design for Bi-Component Coupled Combinatorial Optimization Figure 1
2026-06-02cs.AI

LLM-Driven Co-Evolutionary Automated Heuristic Design for Bi-Component Coupled Combinatorial Optimization

Mingen Kuang, Xudong Deng, Xi Lin, Ye Fan, Jianyong Sun, Jialong Shi

Xi’an Jiao Tong University, Northwestern Polytechnical University

2026-06-02优化算法

针对TTP、TPP这类由路线与选择/采购等子结构强耦合的组合优化问题,单独进化启发式算子容易忽视跨组件影响。论文提出CoEvo-AHD,用LLM维护双算子种群,通过联合执行评估、成对协同评分、跨组件联合交叉和工具化环境生成可配合的启发式。实验显示其能自动发现协作算子组合,在TTP和TPP上取得与传统启发式有竞争力的解质量。

Taming the Loss Landscape of PINNs with Noisy Feynman-Kac Supervision: Operator Preconditioning and Non-Asymptotic Error Bounds Figure 1
2026-06-02stat.ML

Taming the Loss Landscape of PINNs with Noisy Feynman-Kac Supervision: Operator Preconditioning and Non-Asymptotic Error Bounds

Nathanael Tepakbong, Hanyu Hu, Chengyu Liu, Xiang Zhou

2026-06-02视觉感知学习理论

针对 PINNs 在病态 PDE 上因算子诱导损失景观条件数过大而训练缓慢或失败的问题,本文把少量点值监督视为算子级预条件,并用 Feynman–Kac 蒙特卡洛估计生成锚点形成 FK-PINN。理论上给出改进条件数的比较界、有限步梯度下降的非渐近 L2 误差界及 tanh 网络导数伪维数界;在 Poisson、Schrödinger 等问题上显示较标准 PINN 更稳定、误差更低。

Handling Control System Optimality Figure 1
2026-06-02eess.SY

Handling Control System Optimality

Hao Li

2026-06-02规划控制

本文面向控制系统在满足基本稳定性之外如何获得更优性能的问题,将“最优性处理”组织为一套面向实践的控制理论框架,核心洞察是用状态演化质量与控制输入代价共同定义控制成本,并由此串联最优控制、LQR、动态规划、随机最优控制和近似动态规划/强化学习等方法。主要结果更像系统性教材推导与概念统一,而非新的机器人实验算法;具体性能增益和实验验证文中未充分说明。

GNMR: Runtime Stability Control for Low-Precision Large Language Model Training Figure 1
2026-06-02cs.LG

GNMR: Runtime Stability Control for Low-Precision Large Language Model Training

Boao Kong, Weichen Jia, Engao Zhang, Guohong Li, Yonghan Dong, Yao Wang, Yaoyuan Wang, Yunke Peng, Kun Yuan

Peking University, 2Huawei Technologies Ltd., available in every single step, local enough to identify the risky unit, and comparable across modules.

2026-06-02规划控制

低精度大模型训练常因少数算子在短时间窗口出现梯度/数值尖峰而失稳,静态精度策略要么漏检要么开销过大。GNMR将其表述为运行时稳定性控制:用算子当前梯度范数相对历史均值及短窗∆-GNMR定位风险,并在maxO预算和锁定间隔下临时切到高保真路径。实验覆盖激活量化压力、TE低精度训练和LLaMA-2 13B微调,显示其以稀疏恢复保持接近高精度质量,但实际速度增益依赖后端实现。

Stability results for regularized least-squares problems via generalized Hessian expressions and monotone generalized equations Figure 1
2026-06-02math.OC

Stability results for regularized least-squares problems via generalized Hessian expressions and monotone generalized equations

Leo Smulansky, Tim Hoheisel, Tran T.A. Nghia

Department of Mathematics and Statistics, McGill University, Oakland University, Mathematics and Science Center

2026-06-02优化控制

针对 LASSO、低秩恢复等非光滑正则化最小二乘中数据扰动会如何影响解的问题,本文从单调广义方程出发建立隐函数型稳定性框架;关键洞察是把难计算的广义 Hessian 核,在共轭函数 C²-锥可约条件下转化为次微分的平行子空间等一阶对象。由此给出解映射局部 Lipschitz 连续、方向可微与半光滑性的判据,并覆盖多面体支撑函数正则与 PLQ 惩罚等模型。

In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise Figure 1
2026-06-02math.OC

In-Expectation Convergence of Stochastic Gradient Methods under Heavy-Tailed Noise

Zijian Liu

2026-06-02优化算法学习理论

本文针对重尾随机梯度噪声下传统 SGD/SMD 常被认为期望不收敛的问题,重新选择并分析收敛判据,提出一套无需裁剪、归一化或额外算法改动的理论框架。主要结果是在不依赖有界域等强限制条件下,证明凸优化中 SMD/ASMD、非凸优化中 SGD/SGDM 可获得期望收敛保证,从而扩展了经典一阶随机方法在重尾噪声场景中的适用范围。

Continuous Data Assimilation with Learned Surrogate Dynamics Figure 1
2026-06-02math.DS

Continuous Data Assimilation with Learned Surrogate Dynamics

Wenwen Li, Daniel Sanz-Alonso

2026-06-02优化控制

针对真实动力学未知或高分辨率仿真代价过高导致的数据同化模型误差,本文为使用学习替代动力学的连续 nudging/AOT 方法建立统一有限维理论。核心洞察是将替代模型误差与观测噪声显式转化为同步误差下界,并分别分析学习向量场与短时解映射两类 surrogate。结果证明在无噪和有噪观测下仍可指数跟踪到可控误差层,给出有限样本复杂度,并在 Lorenz-96 实验中验证趋势。

Verifiable Criteria and Properties for Interval $B_π^{R^I}$-Tensors Figure 1
2026-06-02math.OC

Verifiable Criteria and Properties for Interval $B_π^{R^I}$-Tensors

Li Ye, Yisheng Song

School of Mathematical Sciences, Chongqing Normal University

2026-06-02优化控制

针对实际模型系数常以区间而非精确值给出的情形,本文把BRπ张量推广到区间BRIπ张量,并先修正既有BRπ判别中忽略π乘积形式的缺陷。核心结果是给出两个可验证准则:基于端点不等式与显式构造π;同时证明其与区间P张量、正定区间张量和区间Z张量的关系,并讨论在多项式优化和区间张量互补问题中的适用性。

Constructive interpolation and generalization rates for neural ODEs: a control perspective Figure 1
2026-06-02math.OC

Constructive interpolation and generalization rates for neural ODEs: a control perspective

Antonio Álvarez-López, Lorenzo Liverani, Enrique Zuazua

datasets, and even satisfy a stronger property that we call simultaneous cell controllability (SCC): their, Controllability of neural ODEs, Simultaneous point controllability . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . ., Simultaneous cell controllability . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . . ., Generalization via simultaneous cell controllability, Chair for Dynamics, Control, Machine Learning, and Numerics (Alexander von Humboldt Professorship), Department of Math-, dataset of size N ⩾1, consisting of pairwise distinct inputs xi ∈X and corresponding labels yi ∈Y, The goal is to approximate the unknown relationship between inputs and labels by fitting a predictor to the, herently overparameterized. Our purpose is to exhibit a different mechanism, based on controllability of

2026-06-02规划控制学习理论

本文从控制论视角解释神经 ODE 在插值与泛化间的关系,动机是为过参数化插值模型给出可量化总体风险界。核心洞察是半自治 NODE 的显式时间依赖可实现“同时胞元可控”,把有限点精确插值提升为对输入区域的控制,从而模拟直方图和近邻等分段常数估计器。主要结果给出构造性精确插值证明与非参数泛化速率,并指出自治 NODE 虽可插值但存在结构障碍,难以达到该胞元可控性。

Exploiting weight-space symmetries for approximating curvature Figure 1
2026-06-02cs.LG

Exploiting weight-space symmetries for approximating curvature

Artem Artemev, Rui Xia, Benjamin M. Boyd, Youjing Yu, Felix Dangel, Guillaume Hennequin, Alberto Bernacchia

2026-06-02优化控制

现代深网中 Hessian 构造、存储和求逆代价过高,限制二阶优化等应用。本文抓住权重空间置换、缩放等对称性导致损失不变、梯度等变这一点,用单次梯度在群轨道上解析平均,得到结构化、可存储可求逆的曲率近似,并用群选择控制精度—成本折中。理论上该框架可恢复 Shampoo/Muon 类估计,实验在 MLP、Transformer 和小语言模型优化中验证了近似质量与可用性;但局部二阶近似误差和更强收敛保证仍文中未充分说明。

Verifying global identifiability of parametric linear ODE models is NP-hard Figure 1
2026-06-02cs.CC

Verifying global identifiability of parametric linear ODE models is NP-hard

Alexey Ovchinnikov, Pedro Soto

2026-06-02优化控制

参数化 ODE 在建模与控制中常需先确认参数能否由输入输出数据唯一恢复,但现有全局可辨识性工具常运行缓慢且复杂度缺口明显。本文从微分代数与代数复杂度角度,将线性状态、参数有理依赖的 ODE 全局/IO 可辨识性与有理映射单射性问题建立多项式归约关系,证明在实数等特征零域及有限域设置下该验证问题为 NP-hard,并给出其落在 BSS 模型 co-NP_R 中的上界。

Clustering-enhanced adaptive Benders decomposition for energy systems planning optimization Figure 1
2026-06-02math.OC

Clustering-enhanced adaptive Benders decomposition for energy systems planning optimization

Jun Wen Law, Dharik S. Mallapragada

2026-06-02规划控制优化算法

面向高分辨率能源容量扩张模型中 Benders 分解切平面积累导致主问题膨胀、子问题并行不足的问题,论文将聚类用于相似子问题的自适应分组切与代表子问题求解。结果显示,弱跨期耦合、主问题耗时占优时自适应按对偶分组显著优于固定分组和多切基线;强 CO2 上限耦合下优势减弱,多切更稳;并行资源受限且子问题占优时代表子问题策略更有效。

Generalized Model Predictive Path Integral Control as Expectation--Maximization Figure 1
2026-06-02eess.SY

Generalized Model Predictive Path Integral Control as Expectation--Maximization

Jiarui Wang, Sina Sharifi, Mahyar Fazlyab

2026-06-02规划控制

针对 MPPI 在机器人实时控制中效果突出但缺少优化论解释与收敛刻画的问题,本文将其重述为最优控制概率推断模型上的 EM 迭代,指出常见高斯 MPPI 只是广义 EM-MPPI 的特例。该视角支持非高斯/指数族探索分布,并给出似然单调增加条件、局部收敛率与高斯情形的显式全局和局部收敛结论;有限采样误差和闭环 MPC 行为仍留待后续分析。

Symmetric Hermite quadrature-based balanced truncation for learning linear dynamical systems from derivative data Figure 1
2026-06-02math.NA

Symmetric Hermite quadrature-based balanced truncation for learning linear dynamical systems from derivative data

Sean Reiter, Steffen W. R. Werner

2026-06-02优化控制

面向仅有频域输入输出数据、难以获得完整一阶模型的控制系统建模问题,论文改造 QuadBT:在传递函数采样外引入一阶导数数据,构造对称 Hermite 求积形式的平衡截断。核心收益是可使用对称求积并在数据来自 Hermitian、耗散系统时保持状态空间 Hermiticity 与渐近稳定性;实验验证了理论,也显示近似导数数据仍可用于学习稳定降阶模型。

The Brøndsted-Rockafellar theorem in geodesic spaces Figure 1
2026-06-02math.OC

The Brøndsted-Rockafellar theorem in geodesic spaces

Alberto Domínguez Corella, Alejandro Villegas-Acuña

The extension to this latter space is particularly significant, since a notion of subdifferential is available

2026-06-02优化控制

本文面向变分分析中“近似极小点如何构造为近似临界点”的问题,将经典 Brøndsted–Rockafellar 定理从 Banach/Hilbert 空间推广到一般测地度量空间。核心做法是用近端点替代线性结构中的预解算子,并以纯度量论证绕开 Carlier 不等式。主要结果包括 Ekeland 型构造定理、基于度量斜率的版本、构造性 Caristi 不动点定理、误差界与全局增长的定量关系,以及 Wasserstein 空间中的最优传输形式。

Agentic Transformers Provably Learn to Search via Reinforcement Learning Figure 1
2026-06-02cs.LG

Agentic Transformers Provably Learn to Search via Reinforcement Learning

Tong Yang, Yu Huang, Yingbin Liang, Yuejie Chi

∗Department of Electrical and Computer Engineering, Carnegie Mellon University, †Department of Statistics and Data Science, Wharton School, University of Pennsylvania, ‡Department of Electrical and Computer Engineering, The Ohio State University, §Department of Statistics and Data Science, Yale University, current node identity together with a local status label indicating whether the node is internal, a non-goal leaf

2026-06-02强化学习

论文关注隐藏交互环境中 Transformer 智能体如何通过强化学习学会树搜索这一理论缺口。作者在随机 k 叉树任务中构造两头浅层 Transformer 实现随机 DFS,并证明策略梯度配合按深度课程可从稀疏终端奖励中逐步学出“记录已试动作—检测失败并回溯”的注意力分工。主要结果是仅在深度 1、2 训练即可泛化到更深满树;在目标分布不均时,折扣回报会诱导优先搜索高概率分支的 ranked DFS。

Contraction Analysis of Time-Delay Systems Figure 1
2026-06-02eess.SY

Contraction Analysis of Time-Delay Systems

Rintaro Watanabe, Yu Kawano

2026-06-02优化控制

面向通信、物理和生物系统中普遍存在且易致不稳定的时滞动力学,论文将收缩分析推广到由泛函微分方程描述的一般非线性时滞系统。核心在于构造微分型 Lyapunov–Krasovskii 与 Razumikhin 框架,并证明微分与增量 Krasovskii 泛函存在性等价,从而保证一致增量指数稳定;还给出单时滞非线性系统的 LMI 反馈镇定设计。

2026-06-01

36 篇
A Tight Theory of Error Feedback Algorithms in Distributed Optimization Figure 1
2026-06-01cs.LG

A Tight Theory of Error Feedback Algorithms in Distributed Optimization

Daniel Berg Thomsen, Adrien Taylor, Aymeric Dieuleveut

2026-06-01优化算法学习理论

面向分布式学习中梯度压缩带来的通信瓶颈与收敛退化,本文重新分析经典 EF 与 EF21 误差反馈算法。核心在于为两类方法构造最优 Lyapunov 函数并确定最优步长,从而给出方法特定的紧致最坏情形收敛率。结果表明,在同质正则参数下速率与工作节点数无关并退化到单机最优;EF21 可处理统计异质性,而经典 EF 在局部最小点不同情况下会失败。

The Value of Temporary Control for the M/M/1 Queue Figure 1
2026-06-01math.OC

The Value of Temporary Control for the M/M/1 Queue

Odysseas Kanavetas, Camiel M.P. Koopmans, Floske M. Spieksma

After taking this option, during a single exponentially distributed period, two service rates are available, mains indefinitely available, whereas this paper considers transient and exhaustible control opportunities.

2026-06-01规划控制

针对现实中只短暂获得额外服务能力(如临时人员或限寿设备)的 M/M/1 排队系统,本文把一次性服务率控制建模为 MDP,关注其相对固定服务率带来的未来成本节省。核心创新是从长期平均控制转向“临时且可耗尽”的控制价值,并用值迭代与 M-uniform 几何再生构造折扣/非折扣情形下的 ε 近似和 ε 最优策略;同时证明最优策略结构与强 Blackwell 最优性,并通过数值实例验证方法。

A derivative-free particle method for optimization in Hilbert spaces Figure 1
2026-06-01math.OC

A derivative-free particle method for optimization in Hilbert spaces

Hui Huang, Hicham Kouhkouh

Hunan University, School of Mathematics, University of Graz, Department of Mathematics and Scientific Computing – NAWI

2026-06-01优化算法

针对变分、最优控制和 PDE 约束等问题中传统 CBO 难以直接处理的无限维搜索空间,本文将无导数共识粒子优化表述为可分 Hilbert 空间上的随机相互作用粒子系统及均场 McKean–Vlasov 动力学。核心在于用指数加权共识点保留全局搜索机制,并处理无限维 SDE 的适定性、矩估计与非光滑目标。文中证明了动力学良定、共识集中及在适当假设下长时间收敛到最小解,并给出有限粒子数值算法。

BERS: Locally Optimal Continuous Algorithm for Maritime Weather Routing with Just-in-Time Arrival Figure 1
2026-06-01cs.ET

BERS: Locally Optimal Continuous Algorithm for Maritime Weather Routing with Just-in-Time Arrival

Daniel Precioso, Francisco Suárez, Javier Jiménez de la Jara, Rafael Ballester-Ripoll, David Gómez-Ullate

aSchool of Science and Technology, IE University, Paseo de la Castellana, 259, 28046, Madrid, Spain, bDepartment of Computer Science, Higher School of Engineering, Universidad de Cádiz, Av. Universidad de Cádiz, 10, 11519, Puerto Real, to 75%. These results show that BERS provides a practical and scalable foundation for just-in-time, energy-efficient

2026-06-01优化控制

面向海运脱碳中的动态气象、避障与准时到港约束,本文提出 BERS:用 Bézier 曲线表示连续航线,先以 CMA-ES 全局搜索控制点,再用 FMS 变分法局部细化,并进行密集沿程评估。合成基准显示其同时覆盖连续性、避障、动态适应和局部最优等七项需求;在 2024 年 ERA5 两条远洋航线上,单靠航线优化较大圆航线节能 23–59%,结合翼帆最高节能 75%。

The sketched landing method for large-scale optimization under orthogonality constraints Figure 1
2026-06-01math.OC

The sketched landing method for large-scale optimization under orthogonality constraints

Florentin Goyens, Simon Mataigne, Pierre-Antoine Absil

2026-06-01优化算法

论文针对大规模 Stiefel 正交约束优化中,传统 landing 方法每步需 O(np²) 矩阵运算、可能超过随机梯度代价的问题,提出用低维随机 sketch 近似切向下降与法向可行性修正方向,支持 Gaussian 与子采样稀疏草图,并给出期望意义下的收敛保证。实验主要为中等规模初步验证:无方差缩减会在噪声水平附近停滞,SVRG 版本可恢复高精度,并在稀疏 Rayleigh 商任务上同等步长优于确定性 landing。

Squared polynomial approximation kernels for the hypercube: improved error bounds and implications for Lasserre hierarchies Figure 1
2026-06-01math.OC

Squared polynomial approximation kernels for the hypercube: improved error bounds and implications for Lasserre hierarchies

Sander Gribling, Etienne de Klerk, Juan C. Vera

2026-06-01学习理论

本文关注超立方体上非负多项式能否以低阶平方和多项式高精度逼近,从而影响 Lasserre 层级的收敛速度。作者改用 Chebyshev 系数范数并构造平方多项式核,结合截断几何级数处理有理近似,再由一维核乘积扩展到多变量。主要结果是将平方和逼近误差和相应下界层级收敛率由 O(1/r) 改进为 O(log^3 r/r^2),并给出上界层级 O(1/r^2) 的构造性证明及参数依赖。

Self-Tuning Regularization for Image Scanning Microscopy Figure 1
2026-06-01eess.IV

Self-Tuning Regularization for Image Scanning Microscopy

Sofia Agostoni, Lisa Cuneo, Christian Daniele, Giacomo Garré, Laurent Le, Alessandro Zunino, Giuseppe Vicidomini, Luca Calatroni

MaLGa Center, DIBRIS, University of Genoa

2026-06-01视觉感知

针对图像扫描显微(ISM)中 MID/s2ISM 依赖 Richardson–Lucy 迭代、需经验早停且易放大噪声的问题,论文将多帧泊松成像写成 Bayesian MAP 反问题,引入 ℓ1 与平滑 TV 显式正则,并用残差白化及面向 s2ISM 的高通谱策略自动选参。仿真与真实荧光数据表明,该方法在低光子条件下更稳定,减少伪影,同时保持超分辨与光学切片能力。

Mixed-Precision GPU Acceleration for Large-Scale Minimum Enclosing Ball Problems Figure 1
2026-06-01math.OC

Mixed-Precision GPU Acceleration for Large-Scale Minimum Enclosing Ball Problems

Ling Liang, Lei Yang

Department of Mathematics, The University of Tennessee, Knoxville, Knoxville, TN, USA, School of Computer Science and Engineering, and Guangdong Province Key Laboratory of Computational Science, Sun Yat-sen University, Guangzhou, Guangdong, China

2026-06-01优化控制

面向高维、大规模最小包围球问题,传统几何算法难以并行、通用锥规划器又受大规模约束拖累。论文将问题改写为 SOCP,并设计适合 GPU 的相对不精确近端增广拉格朗日法,利用约束可分结构做并行映射与归约;混合精度阶段先筛出近边界球再高精度求解,并用全量可行性检查补回遗漏约束。实验显示在大规模实例上较 CGAL、SCS、CLARABEL 更快,半径相对误差通常低于 1e-13。

Stepsize Hedging: an Alternative Mechanism for Accelerating Gradient Descent Figure 1
2026-06-01math.OC

Stepsize Hedging: an Alternative Mechanism for Accelerating Gradient Descent

Jason M. Altschuler, Pablo A. Parrilo

2026-06-01优化算法

本文追问梯度下降是否只能靠动量等额外动态加速,动机是经典常步长虽单步最优却多步收敛慢。核心洞察是不同步长的最坏情形不必兼容,可用非自适应的“步长对冲”在短步与长步间组合;具体提出银比例步长序列。结果显示,在光滑凸优化中迭代复杂度由 O(ε^-1) 改进到约 O(ε^-0.7864),强凸情形由 O(κ log1/ε) 改进到约 O(κ^0.7864 log1/ε)。

Wall-Clock Complexity for Zeroth-Order Optimization with Tunable Oracle Fidelity Figure 1
2026-06-01math.OC

Wall-Clock Complexity for Zeroth-Order Optimization with Tunable Oracle Fidelity

Alexandra Suvorikova, Igor Pavlov, Artem Vasin, Georgii Bychkov, Anastasia Antsiferova, Darina Dvinskikh, Alexander Gasnikov

Weierstrass Institute for Applied Analysis and Stochastics, Berlin, Germany, Moscow Independent Research Institute of Artificial Intelligence, Moscow, Russia, MSU Institute for Artificial Intelligence, Moscow, HSE University, Moscow, Russia, Trusted AI Research Center, RAS, Moscow, Russia, Innopolis University, Kazan, Russia

2026-06-01优化算法

针对黑箱/零阶优化中函数评估昂贵且精度可调的问题,论文不再只数 oracle 调用次数,而是建立按精度计费的 wall-clock 复杂度模型,将迭代数、每次查询精度和批量大小联合优化。核心洞察是多项式成本 c(δ)∝δ^-γ 才产生非平凡权衡,并用“fidelity separability”主引理把已有收敛界转成最优精度日程。结果显示噪声模型会改变最优策略:对抗噪声下加速法在 γ≥1 时可能更慢,Tsybakov 噪声下 γ 主要调节参数与过度批量化。

Social welfare optimisation under institutional reward and punishment Figure 1
2026-06-01cs.GT

Social welfare optimisation under institutional reward and punishment

Van An Nguyen, Vuong Khang Huynh, Huu Loi Bui, Hai Anh Ha, Quang Dung Le, Tan Dat Nguyen, Ngoc Ngu Nguyen, Zhao Song, Manh Hong Duong, Le Hong Trang, The Anh Han

Faculty of Computer Science and Engineering, Ho Chi Minh City University of, Vietnam National University - Ho Chi Minh City (VNU-HCM), Vietnam, School of Computing, Engineering and Digital Technologies, Teesside University, United Kingdom, School of Mathematics, University of Birmingham, Birmingham, United Kingdom

2026-06-01强化学习

针对以往制度激励只优化合作率与干预成本、可能忽视净社会收益的问题,本文把社会福利定义为群体总收益扣除奖惩支出,并在有限均匀混合群体的捐赠博弈和公共品博弈中解析奖励与惩罚机制。核心洞察是福利最优激励常不等同于最低成本或最高合作率:最优值要么为零,要么集中在闭式目标附近,并会随激励效率和选择强度出现非单调、多局部最优及相变;文中还给出高效求解算法和奖励优于惩罚的条件。

S$^3$LDBO: A Snapshot Single-Loop Algorithm for Decentralized Bilevel Optimization Figure 1
2026-06-01math.OC

S$^3$LDBO: A Snapshot Single-Loop Algorithm for Decentralized Bilevel Optimization

Chao Yin, Youran Dong, Shiqian Ma, Bofan Wang, Junfeng Yang

2026-06-01优化算法

本文面向多智能体网络中的去中心化双层优化,针对超参数优化、数据清洗和元学习里频繁计算梯度、雅可比与 Hessian 带来的本地开销,提出带快照机制的单循环 S³LDBO,使节点可间歇跳过昂贵导数评估并保持协同更新。文中给出确定性情形下遍历与高概率非遍历复杂度,并在 MNIST、Fashion-MNIST、miniImageNet 等任务上显示计算效率提升且性能保持竞争力。

Posterior and Likelihood Sensitivity in Bayesian Distributionally Robust Optimization Figure 1
2026-06-01math.OC

Posterior and Likelihood Sensitivity in Bayesian Distributionally Robust Optimization

Jun-ya Gotoh, Andrew E.B. Lim, Michael Jong Kim

2026-06-01优化算法安全鲁棒

本文面向贝叶斯决策中先验/似然设定偏差导致的分布外成本不稳问题,提出最坏后验敏感性与最坏似然敏感性来量化鲁棒性,并将贝叶斯DRO局部展开为期望成本加两类敏感性正则项。主要结果表明,参数学习可使后验敏感性随后验方差消失而下降,但不能消除似然敏感性;DRO可近似刻画性能与鲁棒性的帕累托权衡,定价实验用于说明该权衡。

Sum-of-squares certificates for symmetric polynomials on the hypercube: a counterexample to a conjecture of De Klerk and Laurent Figure 1
2026-06-01math.OC

Sum-of-squares certificates for symmetric polynomials on the hypercube: a counterexample to a conjecture of De Klerk and Laurent

Sven Polak

2026-06-01优化控制

本文针对超立方体上多项式优化中 Putinar 型误差界所依赖的 De Klerk–Laurent 修正常数猜想,研究对称多项式的 SoS 证书。核心在于把表示论对称约化适配到生成元本身不对称但集合对称的二次模,并结合稀疏化、理性舍入与有理数精确验证。主要结果构造出 n=8 时 C8≤11/1000<1/80 的证书,从而否定原猜想的最优性。

Bilevel optimization for smart irrigation control: a framework for enhancing water-use efficiency in agriculture Figure 1
2026-06-01math.OC

Bilevel optimization for smart irrigation control: a framework for enhancing water-use efficiency in agriculture

Roman Chertovskih, Nathalie Khalil, Luís Sousa

University of Porto, distribute available water equitably to minimize deviations from, pacity against the hard constraints of total water availability

2026-06-01规划控制优化算法

针对农业水资源短缺下多地块灌溉易浪费且难以兼顾全局供水约束与局部土壤需求的问题,论文将智能灌溉建模为乐观双层优化:上层动态调整各地块、各时段的土壤湿度安全阈值并分配受限水量,下层求解联合最优控制以最小化总灌溉量。JuMP/IPOPT 数值仿真显示,该框架在缺水场景可通过受控亏缺灌溉维持作物生存并提升用水效率,但实验仍偏初步。

Hybrid System Identification of Electric Freight Transition Dynamics via SINDy and Neural ODEs Figure 1
2026-06-01math.OC

Hybrid System Identification of Electric Freight Transition Dynamics via SINDy and Neural ODEs

Alessandro Carli, Maret Clement, Jonas Mårtensson, Anna Pernestål, Matthieu Barreau

2026-06-01优化控制

本文针对重型电动货运转型中“车辆采用—充电基础设施”相互制约导致系统动力学模型难以用于控制分析的问题,提出将 SINDy 的稀疏可解释方程与 Neural ODE 残差结合的灰箱辨识框架,从 Vensim 仿真中抽取连续时间解析替代模型。该方法在因果耦合约束下保留主导动力学,并用神经项补偿延迟、查表和条件逻辑等非解析成分;40 年多重 shooting 训练中归一化 RMSE 低于 4%,对未见初值仍保持较好预测精度。

Local linear convergence of gradient methods for overparameterized Gaussian mixtures Figure 1
2026-06-01cs.LG

Local linear convergence of gradient methods for overparameterized Gaussian mixtures

Jingxing Wang, Vasileios Charisopoulos, Maryam Fazel

Electrical & Computer Engineering, University of Washington, Seattle, WA, National Institute for Theory and Mathematics in Biology, Chicago, IL, Amazon, Inc.

2026-06-01优化算法学习理论三维

本文关注过参数化高斯混合学习中“全局可恢复但局部收敛慢”的矛盾:多余分量会带来奇异 Fisher 信息和扁平方向,使梯度 EM 进入次线性阶段。作者将这一慢化解释为 KL 损失的 ravine/慢增长流形结构,并设计交替短梯度步与长 Polyak 步的一阶方法。理论上,在权重匹配或小失配条件下,该方法可在局部近线性收敛到最优或接近最优解,说明慢收敛并非过参数化的必然代价。

A Unifying View of Anchoring via Operator-Side Tikhonov Regularization Figure 1
2026-06-01math.OC

A Unifying View of Anchoring via Operator-Side Tikhonov Regularization

Zihao Chen

2026-06-01优化控制

本文针对锚定迭代中锚点放置依赖具体算法、机制不透明的问题,提出在算子查询侧加入逐渐消失的 Tikhonov 正则,再原样运行 Picard、前向步、EG 或 PEG 模板。该视角统一解释 Halpern 迭代,并导出正则化前向步、Reg-EG、Reg-PEG;在单值无约束单调 Lipschitz 设置下,分别给出前向步 O(1/√k)、EG/PEG 与 Halpern O(1/k) 的末迭代残差界。

A General Recipe for Parameter-Free Nonconvex Optimization via Higher-Order Regularization Figure 1
2026-06-01math.OC

A General Recipe for Parameter-Free Nonconvex Optimization via Higher-Order Regularization

Naoki Marumo, Akiko Takeda

Graduate School of Information Science and Technology, University of Tokyo, Tokyo, Japan, RIKEN Center for Advanced Intelligence Project, Tokyo, Japan

2026-06-01优化算法

针对非凸优化中 Lipschitz 等问题参数常未知、线搜索/信赖域验收在随机场景代价高或不可靠的问题,本文提出用高于模型误差阶数的正则化指数来构造无参数模型法,使固定正则化日程也能容忍参数误设。该框架统一覆盖梯度下降、Newton、Gauss–Newton、SGD 与 PAGE,并证明在无需先验参数时达到关于精度的最优或已知最佳复杂度;若参数仅知常数因子,也可恢复相应参数依赖。

Near-Optimal Mixed Strategy for Zero-Sum Linear-Quadratic Differential Games Figure 1
2026-06-01math.OC

Near-Optimal Mixed Strategy for Zero-Sum Linear-Quadratic Differential Games

Tao Xu, Wang Xi, Jianping He

2026-06-01优化控制

面向连续时间零和线性二次微分博弈中混合策略难以解析求解的问题,论文以承诺延迟刻画随机化,并用一二阶矩匹配构造替代随机微分博弈,将无限维分布优化化为可解析的矩控制问题。核心洞察是替代博弈由广义Riccati微分方程支配,给出方差注入的动态能量分配律和双路由执行结构;理论证明状态与期望代价弱近似为O(π²),价值误差和策略次优间隙为O(π^{1/2}),并在双积分追逃实验中验证界限。

Diffusion-Robust Optimization over Graphs Figure 1
2026-06-01math.OC

Diffusion-Robust Optimization over Graphs

Liviu Aolaritei, Ricky Huang, Michael I. Jordan, Paul Grigas

Department of Electrical Engineering and Computer Sciences, UC Berkeley, USA, Department of Industrial Engineering and Operations Research, UC Berkeley, USA, Department of Statistics, UC Berkeley, USA

2026-06-01生成模型优化算法安全鲁棒

针对交通、通信、能源等网络中扰动会沿相邻边传播而非独立跳变的问题,论文提出带节点守恒约束的扩散式不确定集,用于图上的鲁棒优化。核心洞察是拓扑感知的不确定性会改变复杂性边界:最小费用流、最大流等凸网络问题仍可通过对偶保持多项式可解;最短路随传播深度出现可解到 NP 难的转变;而 TSP 中固定巡回的对抗项常可化为显式公式,鲁棒化通常不比原问题更难。

MATRO: Metric-Aware Fully Quadratic Trust Regions for Derivative-Free Optimization Figure 1
2026-06-01math.OC

MATRO: Metric-Aware Fully Quadratic Trust Regions for Derivative-Free Optimization

Wei Hu, Pengcheng Xie, Ya-Xiang Yuan, Li Zhang

LSEC, ICMSEC, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China, and University of Chinese Academy of Sciences, Beijing 100049, China, Lawrence Berkeley National Laboratory

2026-06-01优化算法

本文针对无导数信赖域方法在病态缩放或局部各向异性目标上被球形区域限制的问题,提出 MATRO:用插值二次模型的 Hessian 构造正定度量,将信赖域改为椭球,并在诱导坐标中沿用标准充分二次模型分析。理论上保持全二次插值的一阶评估复杂度 O(n²ε⁻²);实验显示其优势主要出现在 Hessian 能稳定捕捉各向异性时,但稠密特征分解带来 O(n³) 代价。

BUP-TR: Bayesian Underdetermined Projection Trust-Region Methods for Derivative-Free Optimization Figure 1
2026-06-01math.OC

BUP-TR: Bayesian Underdetermined Projection Trust-Region Methods for Derivative-Free Optimization

Wei Hu, Pengcheng Xie, Ya-Xiang Yuan, Li Zhang

LSEC, ICMSEC, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China, and University of Chinese Academy of Sciences, Beijing 100049, China, Lawrence Berkeley National Laboratory

2026-06-01优化算法

面向昂贵黑箱优化中二次插值点少于系数、模型补全任意性强的问题,BUP-TR把信赖域DFO的欠定补全改写为带先验精度矩阵的MAP投影,并用同一度量定义MAP-poisedness与修复。理论上在常规假设下获得全线性模型、全局一阶收敛和O(ε^-2)评估复杂度;NEWUOA式实现显示固定预算下优于若干基线,但增益可能主要来自先验构造与几何管理。

Distributed optimal control problems governed by poroelasticity equations Figure 1
2026-06-01math.OC

Distributed optimal control problems governed by poroelasticity equations

Arbaz Khan, Jeonghun J. Lee, Harpal Singh

Department of Mathematics, IIT Roorkee, India, Department of Mathematics, Baylor University

2026-06-01规划控制

面向多孔介质中流体压力与固体形变耦合的可控模拟需求,本文研究由 Biot 孔弹性方程约束的分布式最优控制问题,将流体源汇作为控制量。核心在于提出以位移和压力为主变量的两场对称弱形式,并在此基础上建立控制到状态框架。文中证明了新形式的适定性、最优控制的存在唯一性,给出后向欧拉全离散与控制变分离散的先验误差估计,并用数值算例验证收敛表现。

Unlearning in Diffusion Models: A Unified Framework with KL Divergence and Likelihood Constraints Figure 1
2026-06-01cs.LG

Unlearning in Diffusion Models: A Unified Framework with KL Divergence and Likelihood Constraints

Shervin Khalafi, Alejandro Ribeiro, Dongsheng Ding

2026-06-01生成模型优化算法

针对扩散模型需删除有害数据/概念又尽量保留生成能力的冲突,论文将遗忘表述为带约束的分布优化:以反向/正向 KL 和似然约束刻画与待遗忘分布的分离,并证明强对偶以得到可实现的原始—对偶算法。实验显示,相比固定加权基线,该框架在概念与数据遗忘中以更小偏离达到相近或更强遗忘,似然方案对保留概念更友好。

Bounds on Prediction Error When Using an Impulse Response/Equilibrium Model Structure Figure 1
2026-06-01eess.SY

Bounds on Prediction Error When Using an Impulse Response/Equilibrium Model Structure

Tyrone L. Vincent, Michael B. Wakin

2026-06-01学习理论

面向MPC中缺少低阶状态空间模型、且只能测量部分输出的轻度非线性系统,本文分析IREM预测结构:用冲激响应卷积刻画局部动态,用带积分的平衡变量刻画工作点变化。核心贡献是把移动窗口中过去测量拟合与未来输出预测误差联系起来,给出可直接由冲激响应和模型参数检验的可观性条件与误差增益界,尤其适合电池快充等只需少量仿真/阶跃实验的数据场景。

Convergence of Steepest Descent and Adam under Non-Uniform Smoothness Figure 1
2026-06-01cs.LG

Convergence of Steepest Descent and Adam under Non-Uniform Smoothness

Sharan Vaswani, Yifan Sun, Reza Babanezhad

University

2026-06-01学习理论

本文针对标准光滑性难以刻画机器学习损失地形的问题,研究曲率随目标值仿射变化的非均匀光滑条件,并结合梯度支配分析一阶优化。核心在于推广到诱导范数并建立函数/梯度的乘性 Lipschitz 性,从而统一证明最速下降、确定性对角 RMSProp 与 Adam 的收敛。结果显示 Sign GD 在可分逻辑回归和 softmax 策略梯度中线性收敛且快于 GD,RMSProp/Adam 在部分两层网络中可常步长线性收敛,并通过下界与 GD、AdaGrad、AMSGrad 等形成理论分离。

Exploiting Chordal Sparsity for Globally Optimal Estimation with Factor Graphs Figure 1
2026-06-01cs.RO

Exploiting Chordal Sparsity for Globally Optimal Estimation with Factor Graphs

Avinash Subramanian, Connor Holmes, Timothy D. Barfoot, Frank Dellaert, Frederike Dümbgen

Avinash Subramanian and Frank Dellaert are with the College of Computing, Georgia Institute of Technology, Atlanta, GA, USA

2026-06-01优化控制

针对机器人因子图状态估计中局部优化依赖初始化、SDP 全局松弛又难建模且计算昂贵的问题,本文把常见 GTSAM 因子图自动提升为 QCQP/SDP,并利用变量消元得到的 Bayes tree 做弦稀疏分解,将大 PSD 变量拆成 clique 级小问题。在 3D 环形 pose-graph SLAM 和 2D 链式定位中,运行时间随规模近似线性、接近局部求解器,同时无需好初始化并给出可认证全局最优。

A characterization of maximal inhomogeneous-quadratic-free sets Figure 1
2026-06-01math.OC

A characterization of maximal inhomogeneous-quadratic-free sets

Gonzalo Muñoz, Joseph Paat, Felipe Serrano

∗Department of Industrial Engineering, Universidad de Chile, Santiago, Chile (gon-, †Sauder School of Business, University of British Columbia, Vancouver BC, Canada

2026-06-01优化控制

本文面向非凸二次约束优化中的交割平面生成问题,研究能产生最强割的极大 S-free 集。核心洞察是将一般非齐次二次不等式经齐次化、对角化归约为 Qg-free 集,并用非扩张函数刻画其结构。主要结果给出全维极大 Qg-free 集的显式形式及两类范数条件下的充要判别,从而与已有齐次情形合并,完成所有极大二次-free 集的统一刻画。

Projected McKean--Vlasov Dynamics for Entropic Weak Optimal Transport Figure 1
2026-06-01math.PR

Projected McKean--Vlasov Dynamics for Entropic Weak Optimal Transport

Nathan Sauldubois, Xin Zhang

conditional law of couplings. This feature is essential in problems involving barycenter, pairs (x, y), but also by local distributional information such as barycenters, conditional

2026-06-01优化控制

本文针对弱最优传输中代价依赖条件分布、普通 Wasserstein 几何难以刻画梯度流的问题,研究熵正则弱最优传输。核心洞察是在适配 Wasserstein 空间中推导带边缘约束投影项的 McKean–Vlasov SDE,使每个 Y 位置的弱传输力经条件平均后保持边缘分布。主要结果证明该动力学弱存在且法律唯一,并在适配 Wasserstein 拓扑下收敛到唯一的熵正则弱传输最优解,同时给出粒子近似与示例。

Benchmarking Bilevel Derivative-Free Optimization Algorithms Figure 1
2026-06-01math.OC

Benchmarking Bilevel Derivative-Free Optimization Algorithms

Charles Audet, Valentin Dijon, Youssef Diouane

∗GERAD and Department of Mathematics and Industrial Engineering, Polytechnique Montr´eal., †GERAD and Department of Mathematics and Industrial Engineering, Polytechnique Montr´eal., ‡GERAD and Department of Mathematics and Industrial Engineering, Polytechnique Montr´eal., the upper-level, which are not always available.

2026-06-01优化算法数据集/基准

本文针对双层无导数优化基准中常忽略下层解可采纳性、且上下层计算代价统计不公平的问题,提出后处理“裁判”流程来剔除不可行或下层非最优的候选点,并用缩放计算 effort 汇总两层评估成本。数值实验展示该基准会改变算法比较结果,使虚假优解被过滤;具体性能增益文中未充分说明。

A Parameter-Free Restart Scheme with Only a Parallelizable $\log\log(1/ε)$ Overhead Figure 1
2026-06-01math.OC

A Parameter-Free Restart Scheme with Only a Parallelizable $\log\log(1/ε)$ Overhead

Yue Wu, Benjamin Grimmer

2026-06-01优化控制

针对凸优化中重启一阶法常依赖未知问题常数、存在预热阶段或带来对数级 oracle 开销的问题,论文提出一种参数无关的并行动态重启框架,让多个实例共享进展并用双指数精度序列调度重启。理论上在光滑与非光滑、满足增长界的多类问题中保持最优迭代复杂度,仅增加可并行化的 O(log log(1/ε)) oracle 开销,并避免非渐近 burn-in。

Exact Mixed-Integer Conic Liftings for Queueing-Based CDN Design Figure 1
2026-06-01math.OC

Exact Mixed-Integer Conic Liftings for Queueing-Based CDN Design

Víctor Blanco, Miguel Martínez-Antón

† Institute of Mathematics (IMAG), Universidad de Granada, ‡ Institute of Mathematics (IMUS), Universidad de Sevilla

2026-06-01优化控制

针对CDN设计中常用距离近似忽略排队拥塞的问题,论文把响应时间中的负载倒数、仿射比值和多流量交互转化为精确混合整数锥提升,结合McCormick包络与二阶锥统一优化服务器位置、容量和路由。实验显示拥塞感知会显著改变设计;小中规模可由现代锥求解器处理,但多需求点和多边缘服务器时SUM/EXP目标易达时限,CVaR最稳健。

DisjunctiveNet: Neural Symbolic Learning via Differentiable Convexified Optimization Layers Figure 1
2026-06-01cs.LG

DisjunctiveNet: Neural Symbolic Learning via Differentiable Convexified Optimization Layers

Shraman Pal, Can Li

2026-06-01优化算法

面向科学与工程中标注稀缺、神经网络易违反物理/安全/专家规则的问题,DisjunctiveNet 将输入相关的逻辑命题与线性不等式表示为析取约束,并用层次化凸包松弛构造成可微 LP 投影层,从而在端到端训练和推理中硬满足 MILP/QF-LRA 规则。实验在合成控制与 scRNA-seq 分类上实现完美规则满足,并在低数据场景提升预测表现;但 DNF 形式可能指数膨胀。

A Unified Framework for Gradient Aggregation in Multi-Objective Optimization Figure 1
2026-06-01cs.LG

A Unified Framework for Gradient Aggregation in Multi-Objective Optimization

Zeou Hu, Kelvin Ho, Yaoliang Yu

Cheriton School of Computer Science, University of Waterloo, Vector Institute, The Chinese University of Hong Kong

2026-06-01优化算法

针对多目标学习中各类梯度聚合规则动机分散、收敛证明割裂的问题,本文给出统一分析框架:以对齐条件刻画到 Pareto 驻点的收敛,并指出凸包内非冲突方向是关键充分条件,可通过对偶锥投影保证可行性。框架还从原始子问题视角统一 MGDA、Nash-MTL 等方法,并导出 capped MGDA,在合成、公平性与对抗联邦学习实验中验证其鲁棒性。

Cosm: Collective Switched Motion for Fast and Accurate Sparse Ising Optimization Figure 1
2026-06-01cs.CE

Cosm: Collective Switched Motion for Fast and Accurate Sparse Ising Optimization

Kenneth M. Zick, Nikhil Shukla, Alexander Marakov

Kenneth M. Zick is with the University of Southern California, Information Sciences Institute, Arlington, Virginia, USA., Nikhil Shukla is with the University of Virginia, Charlottesville, Virginia, USA.

2026-06-01优化算法

针对大规模稀疏 Ising/Max-Cut/QUBO 在自旋玻璃等场景中易陷入崎岖局部极小、传统物理启发和量子方法在稀疏图上优势有限的问题,Cosm 将二值自旋松弛为圆周相位变量,并用边着色的无冲突顺序更新与 dual window twist 相关扰动形成非梯度集体运动。实验显示其在最大 Gset 2D 自旋玻璃实例上找到并经精确求解器验证的最优解,在两个大规模有界度实例上把达标时间从数百小时降至 36–303 秒。

2026-05-29

27 篇
Proper efficiency results in vector optimisation in real linear-topological spaces based on vectorial penalisation Figure 1
2026-05-29math.OC

Proper efficiency results in vector optimisation in real linear-topological spaces based on vectorial penalisation

Paul Schmölling, Christian Günther, Christiane Tammer, Elisabeth Köbis

Department of Mathematics, Norwegian University of Science and Technology, Alfred Getz’ vei 1, Trondheim, 7034, Norway, Faculty of Natural Sciences II, Institute of Mathematics, Martin-Luther-University Halle-Wittenberg, Theodor-Lieser-Straße 5, Halle (Saale), 06120, Germany

2026-05-29优化控制

为处理逼近、最优控制和不确定优化中常见的一般线性拓扑空间约束向量优化问题,本文聚焦比弱有效更精细的 Henig 真有效解。核心做法是在锥凸性假设下引入向量罚函数,将原约束问题转化为两个无约束向量优化问题,并证明约束问题真有效解集可由这两个无约束问题的真有效解集完整刻画,同时给出罚函数的关键性质。

Accelerating Sinkhorn for Entropy-Regularized Optimal Transport Figure 1
2026-05-29math.OC

Accelerating Sinkhorn for Entropy-Regularized Optimal Transport

Zeyi Xu, Long Chen

Department of Mathematics, University of California, Irvine

2026-05-29优化控制

针对熵正则最优传输中 Sinkhorn 在小正则、高清精度下迭代慢的问题,论文从双层优化视角将行缩放视为精确内层求解、列缩放视为外层镜像下降,并据此构造保持原有缩放形式和单步 O(nm) 成本的 Acc-Sinkhorn。其在稳定性条件下证明 O(1/k²) 收敛,将未正则 OT 近似复杂度由 Sinkhorn 的 Õ(n²/ε²) 改进为 Õ(n²/ε),实验在合成、颜色迁移和词对齐上报告 10–30 倍加速;但关键步长的完整理论解释仍未充分说明。

Wasserstein Contraction of Coordinate Ascent Variational Inference Figure 1
2026-05-29stat.ML

Wasserstein Contraction of Coordinate Ascent Variational Inference

Rocco Caprio, Adrien Corenflos, Sam Power

2026-05-29优化控制

针对平均场变分推断中 CAVI 虽常用但收敛条件难验证的问题,本文从 Wasserstein 距离刻画两块坐标更新的收缩性,核心是用固定点处的传输-信息不等式与函数光滑性替代强对数凹等全局假设,并允许局部收敛、多固定点及部分非光滑空间。结果应用于高斯混合、Probit 与 Polya-Gamma Logistic 回归,给出收敛速率及高维 scaling 界。

Generalized matrix nearness problems II Figure 1
2026-05-29math.NA

Generalized matrix nearness problems II

Rongbiao Thomas Wang, Chi-Kwong Li, Lek-Heng Lim

Computational and Applied Mathematics, University of Chicago, Chicago, IL 60637, Department of Mathematics, College of William and Mary, Williamsburg, Virginia 23187

2026-05-29优化控制

本文面向带约束矩阵近似中从最小化‖A−X‖推广到‖A−BXC‖后的可解性问题,动机是避免依赖通用梯度优化。核心创新是引入仿射项、Kronecker 结构与任意 Schatten/正交不变范数,并给出若干闭式解;其余情形提出仅用数值线性代数的零阶迭代算法,证明任意初值全局收敛到最小解,但多数情况下仅有次线性收敛,同时指出秩约束广义问题不存在 Mirsky 型定理。

Quantitative semidefinite certificates for ground-state energies of Pauli Hamiltonians Figure 1
2026-05-29quant-ph

Quantitative semidefinite certificates for ground-state energies of Pauli Hamiltonians

Igor Klep, Nando Leijenhorst, Victor Magron

University of Ljubljana, Faculty of Mathematics and Physics, Jadranska 21, 1000 Ljubljana &, University of Primorska, Faculty of Mathematics, Natural Sciences and Information Technologies

2026-05-29优化控制

针对局域 Pauli 哈密顿量基态能量认证中,半定规划/SOS 层级虽有限收敛但低层精度缺少定量保证的问题,论文构造 Pauli 代数上的近再生核,并将其谱与 Krawtchouk 多项式根联系起来。结果证明偶权 k-local 情形下 NPA 下界和谱最小值上界层级误差均为 C(k)ξ/n,且一般情形可加一个辅助量子比特规约到偶权情形。

Selection Hyper-heuristics Can Automatically Adjust the Learning Period to Optimally Solve Pseudo-Boolean Problems Figure 1
2026-05-29cs.NE

Selection Hyper-heuristics Can Automatically Adjust the Learning Period to Optimally Solve Pseudo-Boolean Problems

Benjamin Doerr, Pietro S. Oliveto, John Alasdair Warwicker

Laboratoire d’Informatique (LIX), CNRS, École Polytechnique, Institut Polytechnique de Paris, Department of Computer Science and Engineering, Southern University of Science and, School of Computing & Communications, Lancaster University Leipzig, Leipzig, 04109, Germany

2026-05-29优化控制

本文针对选择型超启发式在离散优化中需手动设定学习周期τ的问题,指出单步成败信号过稀疏会使算法难以持续利用更优算子。作者提出受1/5规则启发的Adaptive Random Gradient,按一段周期内是否获得足够改进自适应放大或缩小τ。理论上证明其在LeadingOnes上以1−o(1)比例选择最优RLS邻域,并达到同算子集合下近似最优期望运行时间;实验还显示其在多种σ设置下优于最优静态τ的GRG。

A New Constraint Qualification for Continuous-Time Nonlinear Programming Based on Asymptotic KKT Conditions Figure 1
2026-05-29math.OC

A New Constraint Qualification for Continuous-Time Nonlinear Programming Based on Asymptotic KKT Conditions

Rodrigo B. Moreira, Moisés R. C. do Monte, Valeriano A. de Oliveira

2026-05-29优化算法

针对连续时间非线性规划中 AKKT 条件虽易由增广拉格朗日等数值过程产生、却可能给出非平稳候选解的问题,论文引入新的约束资格 AKKT-regularity,用以精确刻画 AKKT 何时可提升为经典 KKT。主要结果证明在该条件下局部最优解满足 KKT,并进一步说明它是保证这一性质的最弱约束资格,同时给出若干可验证的充分条件。

Mean Field Competition of Optimal Switching: The Vanishing Entropy Regularization Approach Figure 1
2026-05-29math.OC

Mean Field Competition of Optimal Switching: The Vanishing Entropy Regularization Approach

Zongxia Liang, Shu Wang, Xiang Yu

2026-05-29优化控制

本文针对排名型均场竞争中个体只能在有限努力水平间切换、纯策略均场均衡可能不存在的问题,研究带切换成本的完成时间竞争。核心做法是引入熵正则化,将切换随机化为有限状态连续时间马尔可夫链的转移率控制,并在熵消失时回到原问题。论文证明正则化均衡存在,在奖励凸性下给出唯一性和虚拟博弈逼近,并证明其收敛到原最优切换均场博弈的松弛均衡。

Open Problem: Separating Geometric and Algorithmic Compression via Cayley-Table Completion Figure 1
2026-05-29cs.LG

Open Problem: Separating Geometric and Algorithmic Compression via Cayley-Table Completion

Dongsung Huh

2026-05-29优化控制

本文针对深度学习在离散代数与精确算法规则上难以外推的问题,提出以 Cayley 表补全作为检验“算法压缩”归纳偏置的标准任务,对照矩阵补全的低秩几何压缩。核心洞察是用算子值张量分解结合 Hessian 平坦性先验,可连续地惩罚结合律违背并偏向群结构。文中给出已有全观测情形下平坦性下界及群同位达到最优的证明线索,但精确恢复样本复杂度仍是开放问题。

Local Differential Privacy via Dynamic Quantization in Distributed Online Stochastic Optimization Figure 1
2026-05-29math.OC

Local Differential Privacy via Dynamic Quantization in Distributed Online Stochastic Optimization

Zhiguo Zhang, Cheng Kui, Qian Ma, Dongrui Wu

School of Automation, Nanjing University of Science and Technology, Nanjing 210094, China, Key Laboratory of the Ministry of Education for, Image Processing and Intelligent Control, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology, Wuhan 430074, China

2026-05-29优化算法

针对分布式在线随机优化中模型/梯度交换会泄露本地流式数据的问题,论文用步长随迭代衰减的随机量化器在通信前遮蔽信息,并结合梯度跟踪与在线特征向量估计处理非平衡有向图。理论上证明在无限迭代下各智能体仍满足(0,δ_i)本地差分隐私且几乎必然精确收敛;在蘑菇、手写数字和脑机接口数据上的在线训练验证了方法有效性。

Distributed Nonlinear Model Predictive Control for District Heating Networks Figure 1
2026-05-29eess.SY

Distributed Nonlinear Model Predictive Control for District Heating Networks

Alessandro Bettoni, Giacomo Mastroddi, Marco Muttoni

2026-05-29规划控制

面向区域供热网络中集中式MPC难扩展且需集中隐私数据、去中心化MPC又缺乏全局协调的问题,论文基于图模型刻画热惯性与管道损失,提出用ADMM协调各建筑非线性MPC的分布式控制,优化建筑吸收流量并约束温度/压力。三建筑基准仿真与完全去中心化方案对比,显示分布式协作可改进网络一致性和总体控制表现,但具体量化增益文中未充分说明。

Solving mathematical programs with complementarity constraints by disjunctive regularizations Figure 1
2026-05-29math.OC

Solving mathematical programs with complementarity constraints by disjunctive regularizations

Sebastian Lämmel, Vladimir Shikhman

Department of Mathematics, Chemnitz University of Technology

2026-05-29优化算法

针对 MPCC 现有 Kanzow-Schwartz 正则化虽有较好理论收敛性、但作为 NLP 描述易退化且数值表现不稳的问题,本文改用 OR/max 约束给出等可行集的析取正则化。其关键洞察是改变函数描述而非可行域,可继承 MPCC-LICQ,并在无需二阶必要条件下保证趋向 S-驻点;还分析 C-index 的拓扑对应关系。实验显示该方法明显优于 Kanzow-Schwartz,高精度求解时也优于 Scholtes。

MoSSP: A Momentum-Based Single-Loop Stochastic Penalty Method for Nonconvex Constrained DC-Regularized Optimization Figure 1
2026-05-29math.OC

MoSSP: A Momentum-Based Single-Loop Stochastic Penalty Method for Nonconvex Constrained DC-Regularized Optimization

Luxuan Li, Chunfeng Cui, Xiao Wang

2026-05-29优化算法

面向含非凸约束和非光滑 DC 正则的随机优化,论文针对传统双层罚/子问题方法难以兼顾可行性与复杂度的问题,提出单循环动量随机罚法 MoSSP:在罚项与凸 DC 部分的 Moreau 包络上做一次随机近端梯度更新,并并行计算凹部近端。理论上给出首类该设定复杂度结果,Polyak 动量达 O(ε^-4),递归动量在均方光滑下达 O(ε^-3),实验显示算法有效。

Singularity-aware Optimization via Randomized Geometric Probing: Towards Stable Non-smooth Optimization Figure 1
2026-05-29cs.LG

Singularity-aware Optimization via Randomized Geometric Probing: Towards Stable Non-smooth Optimization

Ruoran Xu, Borong She, Xiaobo Jin, Qiufeng Wang

2026-05-29优化算法

针对 ReLU、量化等非光滑结构使 Adam 在奇异点附近出现梯度抖动、收敛和泛化受损的问题,论文提出 S-Adam:用随机方向导数方差估计 Clarke 次微分直径,形成 LGI 指标,并以几何阻尼动态缩小步长而不替换原梯度。理论上给出到 Clarke 稳定点的收敛保证;在 QAT 和小批量高噪声训练中,相比 AdamW/Prox-SGD 报告了最高约 6% 的精度提升。

Active learning strategy for excursion-set confidence regions of functional simulator outputs Figure 1
2026-05-29stat.ME

Active learning strategy for excursion-set confidence regions of functional simulator outputs

Lucas Brunel, Mathieu Balesdent, Loïc Brevault, Rodolphe Le Riche, Bruno Sudret

2026-05-29优化控制

针对昂贵仿真器在随机输入下产生整场函数输出时,难以高效估计超越集置信区域的问题,论文提出将 PCA 降维与高斯过程代理结合,并用基于 max-min 准则的主动学习选择新样本,以直接减少置信区域不确定性。方法在合成函数、高超声速飞行器压力场和可重复使用火箭返回轨迹上验证,相比空间填充等基线以更少样本获得更接近参考蒙特卡洛的置信区域,物理案例中误差进一步降低。

Linear stability analysis of the Lloyd algorithm on a circle Figure 1
2026-05-29math.DS

Linear stability analysis of the Lloyd algorithm on a circle

Silpi Saha, Sangita Jha, Mrinal Kanti Roychowdhury

2 Department of Mathematics, National Institute of Technology Rourkela, School of Mathematical and Statistical Sciences, University of Texas Rio Grande Valley, West University Drive

2026-05-29优化控制

该文关注 Lloyd 量化算法在圆周上的迭代是否总能稳定收敛这一问题,将其视为模旋转对称的离散动力系统。核心在于针对 von Mises 分布推导 Lloyd 映射在等距构型附近的显式雅可比,并利用循环/周期三对角结构分解稳定谱,识别旋转中性模与可能的翻转分岔。数值部分用稳定图、Lyapunov 谱和残差验证理论,显示若去除旋转漂移,多数参数下呈稳定收敛,但经验算法的实际增益来源仍未充分说明。

Kernel-based potential mean-field games with unbiased random Fourier $U$-statistics Figure 1
2026-05-29math.OC

Kernel-based potential mean-field games with unbiased random Fourier $U$-statistics

Yumiharu Nakano

Department of Mathematical and Computing Science, Institute of Science Tokyo

2026-05-29优化控制

面向高维潜在平均场博弈中核 MMD 交互与终端分布约束计算昂贵、样本训练缺少保证的问题,论文用无偏随机傅里叶 U 统计替代二次复杂度核估计,并以神经 SDE 漂移做 SGD 优化。结果证明样本层面几乎必然收敛及显式速率条件,实验覆盖百维 Schrödinger bridge 与异质电动车充电协调。

Global optimization of quadratic root-difference minimization under elliptic annulus constraints Figure 1
2026-05-29math.OC

Global optimization of quadratic root-difference minimization under elliptic annulus constraints

Meijia Yang, Yong Xia

2026-05-29优化算法

本文面向信赖域、广义特征值和惩罚子问题中出现的椭圆环约束二次根差最小化,目标是在保持全局保证下提升大规模求解效率。核心洞察是用 Annulus Brickman 定理揭示隐藏凸性,将原非凸问题化为二维凸问题,并证明 Frank-Wolfe 子问题解本身即可作为原问题近似解,从而免去昂贵恢复步骤。由此提出 IMGE 算法,主要依赖最小广义特征对计算,实验显示其收敛快且较 CVX 求解锥规划在大规模情形更高效。

Restarted Accelerated Primal-Dual Algorithms with Adaptive Stepsizes for Nonlinear Conic Constrained Convex Optimization Figure 1
2026-05-29math.OC

Restarted Accelerated Primal-Dual Algorithms with Adaptive Stepsizes for Nonlinear Conic Constrained Convex Optimization

Necdet Serhat Aybat, Jinxin Wang

Department of Industrial and Manufacturing Engineering, Penn State University, Department of Statistics, University of Chicago

2026-05-29优化算法

针对大规模非线性锥约束凸优化中内点法因分解成本高、且现有一阶原对偶法多依赖双线性耦合而难以处理 QCQP 等问题,论文提出带自适应步长搜索的重启加速原对偶算法 rAPDB/rAPDB-ada,结合固定或自适应重启及非单调回溯。文中在 KKT 映射度量次正则条件下证明平滑对偶间隙的二次增长和全局线性收敛,并在随机 QCQP 与核矩阵学习实验中显示 GPU 与非单调步长带来较好性能。

A Theoretical and Experimental Study of a Novel Adaptive Learning Algorithm Figure 1
2026-05-29cs.LG

A Theoretical and Experimental Study of a Novel Adaptive Learning Algorithm

Sakshi Kumari, Shyam Kumar M, Sushmitha P

2026-05-29优化控制

本文针对 Adam 可能因二阶矩非单调而不收敛、AMSGrad 又因过度保守导致学习率长期偏小的问题,提出基于“line of sight”更新的 C-Adam,在保持二阶矩非降以支撑收敛证明的同时放松历史最大值约束。文中给出在线优化 regret bound,并通过若干真实问题数值实验称其相较 Adam/AMSGrad 可获得更低遗憾和更稳定收敛,但具体增益来源仍有待更多任务拆解说明。

Distributed Non-Uniform Scaling Control of Multi-Agent Formation with Dynamic Agent Joining Figure 1
2026-05-29eess.SY

Distributed Non-Uniform Scaling Control of Multi-Agent Formation with Dynamic Agent Joining

Tao He, Gangshan Jing

2026-05-29规划控制

面向狭窄通道等约束环境中编队需按不同坐标轴非均匀缩放、且开放多智能体系统会动态扩员的问题,论文在矩阵值拉普拉斯编队框架上提出动态构造方法和分布式加入协议,使新智能体仅通过局部操作接入,同时保持拉普拉斯正半定性与零空间等谱性质。理论定理给出可行性保证,仿真验证扩员过程中编队仍能执行非均匀缩放机动。

Do Deep Networks Forget Initialization? A Forgetting-Time View of Practical Inductive Bias Figure 1
2026-05-29cs.LG

Do Deep Networks Forget Initialization? A Forgetting-Time View of Practical Inductive Bias

Mohua Das, Pierfrancesco Beneventano, Shibshankar Dey, Gareth H. McKinkey, Tomaso Poggio

Northwestern University

2026-05-29优化控制

本文关注随机初始化带来的函数先验在训练后是否仍影响最终预测器,提出“初始化记忆”来度量验证选择模型对初始化尺度的依赖。作者在 CIFAR-10 ResNet 上系统扫描优化器、批量、深度和正则,发现低学习率 SGD 即使拟合训练集仍可保留强记忆,测试精度跨尺度差 26.5 个百分点且 5000 轮不消失;Adam 类方法或较大学习率配合 L2/权重衰减会更快遗忘,说明实际归纳偏置主要由训练管线的遗忘时间尺度过滤形成。

Improving depth-resolution, in-plane contrast, and reducing non-uniformity artifacts for wide-angle DBT Figure 1
2026-05-29math.OC

Improving depth-resolution, in-plane contrast, and reducing non-uniformity artifacts for wide-angle DBT

Emil Y. Sidky, Adrian A. Sanchez, John Paul Phillips, Zheng Zhang, Dan Xia, Ingrid S. Reiser, Xiaochuan Pan

The University of Chicago, Department of Radiology MC-2026, 5841 S. Maryland Ave., Chicago, IL 60615, Washington University , Mallinckrodt Institute of Radiology, Campus

2026-05-29优化控制

宽角数字乳腺断层合成受限角采样与离散化误差影响,常出现层向分辨率不足、平面内对比度下降和低频不均匀伪影。论文在稀疏正则迭代重建的两阶段框架中,引入联合估计“背景”图像的低分辨率阶段,用其吸收导致不均匀性的低频成分。患者宽角 DBT 个例显示设计目标基本达到,但证据仍限于单病例,文中也指出需更多经验结果和任务驱动评估。

An existence result for a quantitative isoperimetric inequality in $\mathbb{R}^3$ involving the Hausdorff asymmetry Figure 1
2026-05-29math.OC

An existence result for a quantitative isoperimetric inequality in $\mathbb{R}^3$ involving the Hausdorff asymmetry

Silvio Bove, Gisella Croce, Giovanni Pisante

2026-05-29优化控制

论文针对三维定量等周不等式中以 Hausdorff 距离刻画球形偏离时,最优常数/最优形状存在性仍缺乏的问题,构造含对数修正与周长三次因子的泛函,以匹配近球局部的容量尺度并保证细长凸体序列的紧性。作者证明在固定体积凸体类中该泛函达到最小值,并给出近球退化序列的统一下界及显式长球竞争体,从而排除极小序列坍缩到球。

Manifold-based Algorithms for the Hadamard Decomposition Figure 1
2026-05-29math.OC

Manifold-based Algorithms for the Hadamard Decomposition

Nicolas Gillis, Subhayan Saha, Stefano Sicilia, Arnaud Vandaele

Department of Mathematics and Operational Research, University of Mons, Mons, Belgium. We acknowledge the support by the European Union (ERC consolidator, eLinoR, no 101085607).

2026-05-29优化控制

本文针对 Hadamard 分解在实际计算中算法较少的问题,研究如何用两个低秩矩阵的逐元素乘积更高效地压缩和逼近数据。核心洞察是将其重写为带流形约束的标准矩阵分解,并据此提出 Manopt 方法、投影块梯度和无需显式投影的流形梯度算法及初始化策略。实验显示新方法在合成、图像和真实数据上相对 TSVD 与已有方法更具竞争力,尤其适合大规模稀疏数据。

Dynamics of Stochastic Momentum with Sparse Updates in High Dimensions Figure 1
2026-05-29stat.ML

Dynamics of Stochastic Momentum with Sparse Updates in High Dimensions

Katie Everett, Elliot Paquette

McGill University & Mila

2026-05-29优化控制

本文动机是解释语言模型等场景中稀有 token、门控或 MoE 造成的稀疏梯度为何会改变动量优化。作者用稀疏最小二乘和稀有类逻辑回归建立可闭式求解的二阶矩动力学,指出相图由“动量保留时间”和“学习时间”的比值决定:慢学习时退化为 SGD,过快会失稳,二者匹配才出现重球振荡;不同稀疏度对应不同共振动量,导致全局动量在高低频参数间存在谱冲突。

Saddle Networks: Structure-Preserving Architectures for Convex-Concave Functions Figure 1
2026-05-29math.OC

Saddle Networks: Structure-Preserving Architectures for Convex-Concave Functions

Xavier Warin

EDF Lab Paris-Saclay and FiMe, Laboratoire de Finance des Marchés de l’Energie

2026-05-29优化算法

针对鲁棒学习、控制和博弈中的 min–max 模型,论文关注神经近似会破坏“对 x 凸、对 y 凹”鞍点几何的问题。核心做法是用带符号约束的凸/凹因子乘积加边际项构造 Saddle Networks,并以 ICNN/ICKAN 等凸网络实现。理论上在一维、满足混合 Monge 条件时给出一致逼近定理;实验在 1 维和 5 维光滑、非光滑及高秩测试函数上显示较高精度,但高维表达能力仍未充分刻画。

2026-05-28

30 篇
Learning Approximate Solutions to Multiparametric Generalized Nash Equilibrium Problems Figure 1
2026-05-28math.OC

Learning Approximate Solutions to Multiparametric Generalized Nash Equilibrium Problems

A. Bemporad, T. Tatarenko

2026-05-28优化控制

面向博弈型MPC等需随状态/参考量反复求解参数化广义纳什均衡的场景,论文提出离线学习均衡解映射以替代昂贵在线求解。关键做法是用Nikaido-Isoda间隙作训练损失,并以各智能体最优响应值函数代理消除双层优化,只需最佳响应数据而非完整均衡标签。作者还给出连续参数化v-GNE选择的充分条件;多类GNEP和参数规划实验显示神经网络近似可带来数个数量级加速。

Preference-Shaped Expected Hypervolume and R2 Improvement: Exact Computation and Monotonicity Figure 1
2026-05-28math.OC

Preference-Shaped Expected Hypervolume and R2 Improvement: Exact Computation and Monotonicity

Michael T.M. Emmerich

Faculty of Information Technology, University of Jyväskylä, Finland, the existing theory remains available.

2026-05-28优化控制

本文面向贝叶斯多目标优化中带偏好的采集函数设计,追问偏好变换何时仍可精确计算、保持 Pareto 兼容与单调性。核心洞察是区分 EHVI 的目标空间超体积几何与 R2 的标量化包络几何:乘积密度和锥变换可还原为普通 EHVI,而截断可能破坏方差单调性;精确积分 R2 不能一般表示为目标空间加权超体积,但可表示为 Tchebycheff shadow,从而得到离散有限和、单纯形求积及标量高斯 EI 形式的 ER2I 计算规则。

Robust Markov Decision Processes on Continuous State Spaces Figure 1
2026-05-28math.OC

Robust Markov Decision Processes on Continuous State Spaces

Mengmeng Li, Yifan Hu, Daniel Kuhn, Yan Li

Rutgers University, Texas A&M University

2026-05-28安全鲁棒

面向机器人等连续状态系统中转移模型不确定、传统鲁棒 MDP 难以存储和逐状态求解的问题,本文研究由未知生成核凸包诱导的结构化矩形混合歧义集,并用随机一阶方法做鲁棒策略评估,再嵌入近似策略迭代。主要结果是给出高概率收敛证明,策略评估与求 ε 最优策略均达到 Õ(1/ε²) 样本复杂度,并可推广到连续状态零和 Markov 博弈。

A Fresh Look at Lamarckian Evolution and the Baldwin Effect Figure 1
2026-05-28cs.NE

A Fresh Look at Lamarckian Evolution and the Baldwin Effect

Inès Benito, Johannes F. Lutzeyer, Benjamin Doerr

Laboratoire d’Informatique (LIX), CNRS, École Polytechnique, Institut

2026-05-28优化控制

本文针对达尔文式进化算法探索强、开发弱,以及拉马克/鲍德温式局部搜索增强长期缺少大规模实证与运行时理论对比的问题,统一评测四类进化机制。作者在 GraphBench 的最大独立集与最大割上实验,并扩展 DLB 基准做理论分析;结果显示局部搜索增强普遍优于达尔文式,鲍德温式在较难情形和渐近运行时上更占优,且多数 EA 可超过深度学习基线并接近专用求解器。

Adaptive Partitioning in Column Generation for Nested Paths Figure 1
2026-05-28math.OC

Adaptive Partitioning in Column Generation for Nested Paths

Bart van Rossum, Rolf van Lieshout, Alexandre Jacquillat

2026-05-28优化控制

针对车辆路径、乘务排班等嵌套路径问题中列生成定价需枚举大量非支配子路径而难以扩展的瓶颈,论文提出按全局资源消耗自适应分桶的精确定价算法,用桶代表子路径并通过乐观/悲观定价维持界、有限细化收敛。实验在多周期车辆路径上最高提速13倍、最优求解实例数增至3倍,在鲁棒铁路乘务排班上提速约3倍并获得1%内解。

Disjunctive Sum of Squares Figure 1
2026-05-28math.OC

Disjunctive Sum of Squares

Amir Ali Ahmadi, Sanjeeb Dash, Yixuan Hua, Bartolomeo Stellato

Princeton University, Operations Research and Financial Engineering., AAA was partially supported by the Sloan Fellowship, the Princeton AI Lab Seed Grant, the Princeton SEAS Innovation Grant, and a Research Gift in Mathematical Optimization., YH was partially supported by the Princeton AI Lab Seed Grant, the Princeton SEAS Innovation Grant, and the IBM PhD Fellowship., IBM TJ Watson Research Center.

2026-05-28优化控制

传统 SOS 用单个代数恒等式证明多项式非负,常需升高次数并导致 SDP 规模膨胀。本文提出“析取平方和”,用覆盖不同区域的多个低次数恒等式并行给证书;证明析取 Positivstellensatz,使每个证书次数可保持到原多项式次数,并据此构造最大 SDP 块大小固定的收敛优化层级,扩展到无优化层级、共正性与分支定界,实验覆盖多项式、共正和组合优化。

On the Solvability of Quasi-Regulator Equations in Non-smooth Output Regulation Figure 1
2026-05-28eess.SY

On the Solvability of Quasi-Regulator Equations in Non-smooth Output Regulation

Zirui Niu, Daniele Astolfi, Giordano Scarciotti

2026-05-28优化控制

针对真实系统中常见的非光滑、非周期参考与扰动信号,本文研究线性系统非光滑输出调节中拟调节方程何时可解。核心做法是将含积分项的方程改写为微分-代数方程,并揭示相对阶与前馈通道对可解性的关键影响。主要结果是在特定相对阶条件下提出“非光滑非共振条件”,给出拟调节方程可解的充要刻画。

Integrated Exploration-Aware UAV Route Optimization and Path Planning Figure 1
2026-05-28cs.RO

Integrated Exploration-Aware UAV Route Optimization and Path Planning

Jimin Choi, Grant Stagg, Cameron K. Peterson, Max Z. Li

2026-05-28规划控制优化算法

面向灾害、野火等场景中无人机续航有限且危险先验不准的问题,论文将报告目标建模为不确定ROI和连续风险信念场,联合求解ROI路由、伪节点覆盖增强、分段预算分配与B样条信息路径,并在飞行中用观测更新信念后重规划。48组仿真中,在线重规划相对离线规划平均KL降低提升15.9%,相对直线巡航提升48.6%,但仍主要验证于合成单机场景。

Implicit Regularization in Perturbed Deep Matrix Factorization: Spectral Conditions and Stability Figure 1
2026-05-28math.OC

Implicit Regularization in Perturbed Deep Matrix Factorization: Spectral Conditions and Stability

Jingzhe Wang, Hung-Hsu Chou

2026-05-28优化控制

针对深度矩阵分解中目标矩阵受噪声污染时,梯度下降的低秩隐式正则化是否仍可靠这一问题,论文从谱条件出发刻画初始化、步长与特征值间隙对低秩时间区间的共同作用,并将分析扩展到加性扰动情形。主要结果证明在有界高概率噪声下,低秩阶段会稳定保留,迭代复杂度、特征值恢复误差和区间端点偏移均可由扰动范数量化,数值实验支持这些理论界。

Model Predictive Control for Constrained Linear Positive Systems on Graphs Figure 1
2026-05-28math.OC

Model Predictive Control for Constrained Linear Positive Systems on Graphs

Roland Schurig, David Ohlin, Anders Rantzer, Emma Tegling, Rolf Findeisen

2026-05-28规划控制

针对图上正线性系统的路由、物流等问题,状态存储和边流量容量约束会破坏既有无约束闭式最优解。本文利用关联矩阵、正性和无约束最优路由结构,构造按节点缩放的可行次优反馈,并据此为无终端条件 MPC 推导可计算的稳定预测时域下界与无穷时域性能界;这些界可通过凸几何规划求解,主要结果偏理论保证而非实验验证。

Myerson Interaction Index Figure 1
2026-05-28math.OC

Myerson Interaction Index

Jorge González-Ortega, Elisenda Molina, Juan Tejada

2026-05-28优化控制

针对传统 Shapley 交互指数默认任意主体可自由合作、难以刻画网络通信约束的问题,本文把 Myerson 图限制博弈引入交互度量,定义 Myerson Interaction Index。其核心结果是给出图上交互指数框架,并用组件效率、公平性和否决伙伴一致性完成公理化刻画;同时分解“网络诱导交互”,区分拓扑约束与博弈内生协同对交互的贡献。

Birkhoff interpolation models for optimization with some available derivatives Figure 1
2026-05-28math.OC

Birkhoff interpolation models for optimization with some available derivatives

Jeffrey Larson, Matt Menickelly, Evan Toler

with some available derivatives∗, Argonne National Laboratory, Lemont, IL 60439, are available. Such situations arise naturally in scientific computing applications involving simulations, interpolation framework that permits arbitrary patterns of derivative availability and enables the con-, available derivatives to be queried at every interpolation point. We develop conditions under which the, with synthetically generated derivative-availability patterns., variables of the objective function are not readily available. In particular, we consider unconstrained problems, to compute and are hence available via an oracle. On the other hand, derivatives of f with respect to the, ∗This work was supported by the U.S. Department of Energy, Office of Science, Office of Advanced Scientific Computing, the FASTMath Institute and the StellFoundry Partnership Project under Contract No. DE-AC02-06CH11357., partition criterion is derivative availability. The practical motivation for this is many scientific optimization, ers are not readily available because they are computed through legacy software. We seek a framework where

2026-05-28优化算法

针对科学计算中部分变量可由伴随或自动微分获得导数、其余变量受遗留代码或高成本限制的优化问题,论文用 Birkhoff 插值替代传统 Hermite/纯无导数模型,允许在不同插值点选择性混合函数值与任意可用偏导。作者给出插值系统 poised 条件、全二次模型误差界,并嵌入信赖域框架维护插值集;在合成导数可用模式的 CUTEst 问题上验证其连接无导数与有导数优化的可行性。

Convergence Rate Analysis of Ratio Consensus Algorithms with Column-Allowable Matrices Figure 1
2026-05-28math.PR

Convergence Rate Analysis of Ratio Consensus Algorithms with Column-Allowable Matrices

Balázs Gerencsér, Levente Szemerédi

HUN-REN Alfréd Rényi Institute of Mathematics, Budapest, Hungary, Eötvös Loránd University, Budapest, Hungary

2026-05-28学习理论

针对异步有向网络中 push-sum/ratio consensus 在丢包、虚拟缓冲等场景下难以满足传统可允许性与序贯本原性假设的问题,本文将协议提升到增广网络上的线性随机矩阵过程,并把条件放宽为弱序贯本原性及允许辅助节点反复为零。核心结果是证明收敛速率几乎处处由前两个 Lyapunov 指数差刻画,并用 Birkhoff 收缩系数说明该谱隙非平凡,数值实验展示了丢包率和包大小对速率的影响。

Operator-Norm Transfer and Cohomological Rigidity for Quaternionic Quasi-Lie Structures with Application to Sliding Mode $β$-Exponential Stability Figure 1
2026-05-28math.OC

Operator-Norm Transfer and Cohomological Rigidity for Quaternionic Quasi-Lie Structures with Application to Sliding Mode $β$-Exponential Stability

Nassim Athmouni, Nejib Brahmia, Tarek Fajraoui, Fehmi Mabrouk

2026-05-28优化控制

面向四元数姿态动力学中左右模约定不一致、非交换不确定性使滑模增益保守的问题,论文给出共轭反同构下算子范数无损迁移,并用上同调刚性构造双线性修正以消除局部 Jacobi 缺陷;进一步证明投影缺陷满足可计算 GOSL 界,提出上同调匹配条件与迭代 LMI,使积分滑模获得 β-指数稳定性。结果主要为解析性,闭环多维仿真未给出。

Machine Learning for Exact Time Series Aggregation in Generation Expansion Planning with Energy Storage Figure 1
2026-05-28math.OC

Machine Learning for Exact Time Series Aggregation in Generation Expansion Planning with Energy Storage

Jakub Rybka, Luca Santosuosso, Thomas Klatzer, Sonja Wogrin

Institute of Electricity Economics and Energy Innovation, Research Center ENERGETIC, Graz University of Technology

2026-05-28规划控制

针对含可再生、火电与储能的发电扩容规划在长时域高时间分辨率下难以求解的问题,论文提出一种后验迭代时间序列聚合方法,用机器学习估计能量平衡约束的边际成本,并将其作为聚类特征以尽量保留全模型活跃约束,同时给出聚合与全模型的最优性间隙界。基于奥地利2024年小时数据的实验显示,该方法比仅依赖输入时序的传统TSA更准确,并相对全尺度优化实现约一个数量级的运行时间下降。

Hautus-Type Criteria for Controllability and Stabilizability of Backward-Structured Stochastic Systems Figure 1
2026-05-28math.OC

Hautus-Type Criteria for Controllability and Stabilizability of Backward-Structured Stochastic Systems

Jingrui Sun

Department of Mathematics and SUSTech International Center for Mathematics, Southern University of Science and Technology

2026-05-28规划控制

针对随机线性系统中漂移、扩散与适应性约束使经典 PBH/Hautus 判据难以直接适用的问题,本文研究后向结构 SDE 的可控与可稳定判别。核心洞察是障碍不再是左特征向量,而是 Lyapunov 型算子的半正定特征矩阵,并且需同时受谱与锥约束。文中给出精确可控、可稳定的等价 Hautus 条件,并补充有限秩、Gramian 表征和可控分解,证明精确可控蕴含可稳定。

De-risking solutions to optimization problems Figure 1
2026-05-28math.OC

De-risking solutions to optimization problems

Daniel Bienstock, Blake Sisson

Daniel Bienstock and Blake Sisson, Columbia University

2026-05-28优化算法安全鲁棒

该文针对名义优化解在物流、资源配置中常出现的高集中度/拥塞风险,提出不显式设定风险上界Λ的“去风险”框架:用影响函数Φ刻画风险,并通过带风险权重的目标与切平面/一阶式迭代探索成本—风险前沿。方法可在小幅增加名义成本时寻找显著降险的可行解,或给出不存在此类调整的证明;实验动机来自大规模物流MIP,但具体泛化增益仍取决于Φ的建模质量。

Dynamic Stabilisation of Boundary Control Systems Figure 1
2026-05-28math.OC

Dynamic Stabilisation of Boundary Control Systems

Mohamed Fkirine, Lassi Paunonen

Mathematics Research Centre, Tampere University, P.O.

2026-05-28规划控制学习理论

本文面向带边界输入的线性 PDE/无限维系统难以用传统状态空间形式处理、且双曲系统常不能指数镇定的问题,提出基于观测器的动态反馈框架,在抽象边界控制系统中利用分离原则刻画误差与状态反馈半群的稳定性。核心结果给出指数、强稳定和多项式/非一致稳定条件,并证明较强适定性假设下闭环外部适定;方法在一维、二维波方程和非均匀 SCOLE 模型上实现镇定。

Convergence of empirical subgradients for optimal transport-based objectives Figure 1
2026-05-28math.OC

Convergence of empirical subgradients for optimal transport-based objectives

Tam Le (LPSM, UPCité)

programming frameworks available for practical use [18, 31].

2026-05-28优化算法学习理论

针对训练中常用样本化最优传输损失(排序公式、切片 Wasserstein)虽易计算却因匹配带来非光滑梯度不稳定的问题,论文从变分分析角度证明经验传输目标的次微分图收敛到总体目标次微分,并推出经验临界集/次梯度法可一致逼近总体驻点;同时指出该保证依赖可微成本与光滑参数化,非光滑情形会出现伪局部极小和导数不稳定。

Online Sketched Newton-Raphson Figure 1
2026-05-28math.OC

Online Sketched Newton-Raphson

Jean-Luc Lupien, Yuen-Man Pun, Youssef Diouane, Iman Shames, Antoine Lesage-Landry

Department of Civil and Environmental Engineering, University of California, Berkeley, CA, United States of America, School of Engineering, Australian National University, ACT, Australia, Department of Mathematics and Industrial Engineering & GERAD, Polytechnique Montréal, QC, Canada, Department of Electrical and Electronic Engineering, University of Melbourne, VIC, Australia, Department of Electrical Engineering, GERAD & Mila, Polytechnique Montréal, QC, Canada

2026-05-28优化控制

这篇论文针对在线凸优化中二阶方法虽有更紧动态遗憾界、但需进行高维矩阵求逆导致实时和大规模场景成本过高的问题,提出在线草图化 Newton-Raphson(OSNR),用随机子采样草图降低求逆维度,同时保持二阶更新的理论优势。方法覆盖在线求根、无约束 OCO 与时变等式约束 OCO,并给出次线性动态遗憾;约束版本 OSNR-EC 还获得次线性累计约束违反界。数值实验在位置跟踪和 IEEE 300 节点最优潮流中显示低草图比例下仍能保持较好性能。

Stability of Quadratically Regularized Optimal Transport Figure 1
2026-05-28math.OC

Stability of Quadratically Regularized Optimal Transport

Alberto González-Sanz, Marcel Nutz

The centerpiece is an L∞-stability result for the dual potentials. Starting from an er-

2026-05-28优化控制

本文针对熵正则最优传输满支撑、难刻画稀疏结构的问题,研究二次正则最优传输在边缘分布、代价和正则参数扰动下的稳定性。核心思路是从随边缘变化的 L2 误差界出发,借助对偶势的自界提升到统一的局部 L∞-Lipschitz 控制。由此得到最优耦合在全变差和 Wasserstein 距离下的稳定性,并证明二次代价下最优支撑对边缘扰动在 Hausdorff 距离中局部 Lipschitz。

Optimal Spectral Design with Prior Information Figure 1
2026-05-28math.OC

Optimal Spectral Design with Prior Information

Anton J. Kleywegt, Johannes Milz, Mohit Singh, Weijun Xie

2026-05-28优化控制

本文面向带先验信息矩阵的最优实验设计与模型式无导数优化,研究如何在欧氏范数约束下选择采样/设计方向以改善更新后信息矩阵谱性质。核心洞察是把原本对设计矩阵非凸的谱目标,通过紧的特征值松弛转化为凸重表述,并借助 Schur–Horn 定理从谱解构造可行设计,得到简单的多项式时间算法;数值示例展示了其可计算最优谱设计,并初步显示对无导数优化采样方向选择有潜在收益。

Decentralized Parameter-Free Online Learning with Compressed Gossip Figure 1
2026-05-28cs.LG

Decentralized Parameter-Free Online Learning with Compressed Gossip

Tomas Ortega, Hamid Jafarkhani

Authors are with the Center for Pervasive Communications &, Computing and EECS Department, University of California, Irvine, u. This is the natural collaborative benchmark for a, activated agents, and the availability of random agents [22], online-learning work has studied collaborative regret under

2026-05-28优化控制

本文针对去中心化在线凸优化中学习率难以预设、邻居通信又需压缩导致一致性误差累积的问题,提出 DECO-EF,将 coin-betting 参数无关预测与带误差反馈的压缩差分 gossip 结合。其关键在于维护干净累积状态和压缩跟踪器,并把 regret 分解为集中式 coin-betting 项与通信分歧项。理论上在线性 gossip 调度下得到期望次线性、比较器自适应网络 regret,实验展示通信量与精度的权衡。

Polling Set Construction and Worst-Case Complexity for Direct Search under Polyhedral Convex Constraints Figure 1
2026-05-28math.OC

Polling Set Construction and Worst-Case Complexity for Direct Search under Polyhedral Convex Constraints

Lindon Roberts, Clément W. Royer

random directions has recently gained popularity as a scalable alternative to positive spanning, ∗School of Mathematics and Statistics & ARC Training Centre in Optimisation Technologies, Integrated, Methodologies, and Applications (OPTIMA), University of Melbourne, Parkville VIC 3010, Australia. ORCID, methods consider interpolation sets at which function values are available to construct such, B(x, α) := {y ∈Rn : ∥y −x∥≤α} to be the closed ball of radius α centered at x. Finally, the

2026-05-28优化算法

针对带多面体凸约束的无导数直接搜索,现有轮询方向理论与模型型 DFO 的几何条件脱节,且缺少复杂度保证。论文提出 Λ-positive spanning set,将轮询集质量与 Λ-poisedness 对齐,并指出需包含近似切锥外方向。作者给出无约束与凸约束下的收敛和最坏复杂度分析,以及盒约束、线性不等式约束的构造;数值实验显示加入这些额外方向可显著提升性能。

Geometric Analysis of Variational Quantum Eigensolver Figure 1
2026-05-28quant-ph

Geometric Analysis of Variational Quantum Eigensolver

Zhen Qin

2026-05-28优化算法

针对 VQE 在固定 ansatz 与自适应线路中缺乏统一理论、且受 barren plateau、初始化和测量噪声影响的问题,本文用酉群上的无 ansatz 乘积酉表述做黎曼几何分析。核心洞察是把每层酉作为独立变量,从而统一两类 VQE;结果证明单酉情形 RGD 线性收敛且临界点仅为全局最小或严格鞍点,乘积酉收敛率随深度多项式变差,并给出小角随机 Pauli 初始化和有限 shot 噪声下的收敛与自适应测量分配保证。

Global Convergence and Error Propagation in Neural Gradient Flows: A Riemannian Optimization Framework Figure 1
2026-05-28math.OC

Global Convergence and Error Propagation in Neural Gradient Flows: A Riemannian Optimization Framework

Shixin Zheng, Yiwei Wang, Haizhao Yang

\addr Department of Mathematics, University of Maryland, College Park, MD, \addr Department of Mathematics, University of California-Riverside, Riverside, CA

2026-05-28生成模型优化算法学习理论

针对高维能量最小化中传统网格离散难扩展、神经参数化又带来非凸优化的问题,论文把神经 MMS 每步改写为 Hilbert 空间增量流形上的黎曼优化,指出 Gauss–Newton 预条件流等价于该流形的梯度流。在局部非退化、内点定位等条件下证明子问题线性收敛,并给出内层误差与神经逼近误差传播界,实验显示其较一阶方法以更少迭代获得更小轨迹误差。

OptiLoop: Coordination-in-the-Loop Verification and Repair for LLM-Generated Optimization Agents Figure 1
2026-05-28math.OC

OptiLoop: Coordination-in-the-Loop Verification and Repair for LLM-Generated Optimization Agents

Yujia Xu, Zhiheng Wang, Thi Dinh

2026-05-28优化算法

针对LLM生成的本地优化代理虽能运行却可能在去中心化协同中语义错误的问题,OptiLoop主张把验证放入ADMM式协调循环:用短程交互轨迹、价格响应和残差等证据区分代码缺陷与建模缺陷并触发修复。在40个测试场景中,相比本地验证基线,目标匹配率由66.0%升至93.0%,社会匹配率由68.5%升至89.0%,平均误差显著降低。

Automated Synthesis of Lyapunov Functions for Multi-Agent Systems under Jointly Connected Topology Figure 1
2026-05-28math.OC

Automated Synthesis of Lyapunov Functions for Multi-Agent Systems under Jointly Connected Topology

Shuyuan Zhang, Lei Wang, Qing-Guo Wang

2026-05-28优化控制

针对联合连通切换拓扑下多智能体一致性验证常依赖二次 Lyapunov 函数、且其可能不存在的问题,本文将一致性条件转化为多项式 Lyapunov 函数的 SOS 半定规划合成,并同时生成分布式非线性协议中的多项式耦合函数。结果给出一阶系统的若干充分判据,并扩展到二阶一致性;数值例子表明该方法可在二次函数失效时完成验证。

Economic Nonlinear Model Predictive Control for Microgrids with Generator Up and Downtime Constraints Figure 1
2026-05-28math.OC

Economic Nonlinear Model Predictive Control for Microgrids with Generator Up and Downtime Constraints

Jürgen Gutekunst, Armin Nurkanovic, Ekaterina Kostina, Hans Georg Bock, Robert Scholz, Amer Mesanovic

Freiburg University, Freiburg, Germany, Heidelberg University, Heidelberg, Germany

2026-05-28规划控制优化算法

面向含可再生波动、储能和机组最小启停时间约束的微电网经济调度,论文指出直接用经济NMPC求解多阶段AC-OPF会形成难解的MINLP。其核心做法是以QC凸二次近似替代非线性潮流,并结合离散机组动态得到可由CPLEX求解的MIQCP;同时证明仅靠终端约束不足以保证递归可行,需加入基于周期参考轨迹的时间耦合约束。结果在周期耗散假设下给出递归可行性与稳定性证明,并在真实6节点微电网多需求场景中仿真验证。

Omni-scale Learning-based Sequential Decision Framework for Order Fulfillment of Tote-handling Robotic Systems Figure 1
2026-05-28cs.RO

Omni-scale Learning-based Sequential Decision Framework for Order Fulfillment of Tote-handling Robotic Systems

Jiaxin Liu, Peng Yang, Yuping Li, Xinyue Xie

a Institution of Data and Information, Shenzhen International Graduate School, Tsinghua University, Nanshan District, Shenzhen 518055, China

2026-05-28机器人

面向电商和柔性制造中料箱逐渐取代托盘、订单履约需跨订单—料箱—机器人联动决策的问题,论文提出 OLSF-TRS,将异构料箱搬运系统抽象为统一序贯决策,并结合结构化组合优化与多智能体强化学习。小规模实验中平均最优性差距低于 3.5%、毫秒级推理;大规模场景相较启发式减少 8–12% 料箱移动,较规则方法最高超过 30%,但具体增益在多大程度来自抽象、学习或系统规模仍需更多消融说明。

2026-05-27

26 篇
Learning to reoptimize: a GNN-aided fix-and-optimize approach and an application to the Lot Sizing problem Figure 1
2026-05-27math.OC

Learning to reoptimize: a GNN-aided fix-and-optimize approach and an application to the Lot Sizing problem

Mathieu Lerouge, Andrea Lodi, Enrico Malaguti, Michele Monaci, Filippo Focacci

bJacobs Technion-Cornell Institute, Cornell Tech and Technion-IIT, New York, USA, cancellation of a large customer demand, unavailability of a production equipment or of a major, warehouse or of labor force. These situations are hardly manageable with statistical approaches

2026-05-27优化算法数据集/基准三维

针对生产计划等MILP解在机器故障后需快速恢复、从头重解过慢而简单修复质量低的问题,论文提出GNN辅助的单轮fix-and-optimize:将实例、原解与扰动编码成图,预测哪些二进制变量值得释放重优化,其余硬固定。在大规模LSP数据集上,同等短时限内平均修复改进由基线12.33%升至19.68%,最优已知解差距由16.56%降至6.10%,但收益在全厂停机等全局扰动上较弱。

Probabilistic Smoothing with Ratio-Monotone Transforms for Global Optimization Figure 1
2026-05-27cs.LG

Probabilistic Smoothing with Ratio-Monotone Transforms for Global Optimization

Kukyoung Jang, Taehyun Cho, Junrui Zhang, Ping Xu, Kyungjae Lee

2026-05-27优化算法

本文针对高维黑盒全局优化中高斯平滑和固定放大变换对超参数敏感、只给局部保证的问题,提出 ProMoT:用对称单峰(含重尾)核与 ratio-monotone 变换统一概率平滑。其理论洞察是平滑后可保持全局最优点,并在足够放大时使驻点集中到真最优附近;留一基线进一步无偏降方差。实验在高维基准和黑盒对抗攻击上显示更稳健、性能有竞争力。

Feasibility Determination for Subjective Probability Constraints Figure 1
2026-05-27math.OC

Feasibility Determination for Subjective Probability Constraints

Taehoon Kim, Sigrun Andradottir, Seong-Hee Kim, Yuwei Zhou

Korea Military Academy, Republic of Korea Army, H. Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, Kelley School of Business, Indiana University

2026-05-27优化算法三维

针对仿真备选方案中以伯努利观测估计概率约束的可行性判定,论文指出用批均值近似正态会浪费样本。其核心是直接在伯努利数据上构造带统计保证的主观多阈值判定程序,并支持决策者顺序收紧或放宽阈值。实验显示该方法较面向正态均值约束的既有程序更省样本,能高效给出各阈值组合下的可行性结论。

Statistical and Algorithmic Foundations of Probing Quantum Systems with Compressive Measurements: A Review Figure 1
2026-05-27quant-ph

Statistical and Algorithmic Foundations of Probing Quantum Systems with Compressive Measurements: A Review

Zhen Qin, Michael B. Wakin, Zhihui Zhu

and enable scalable recovery. In this review, we provide a unified perspective on QST for structured quan-, ing sample complexity, measurement efficiency, and scalable recovery., trical Engineering and Computer Science, Department of Statistics, University of Michigan, Ann Arbor, MI 48109 USA, is with the Department of Computer Science and Engineering, the Ohio State University., central question: how can one exploit structures in physically relevant quantum states to enable scalable tomography?

2026-05-27优化控制

面对量子态层析随量子比特数指数膨胀而导致的采样、存储和计算瓶颈,本文将结构化量子态重构统一视为压缩测量下的结构化逆问题。核心洞察是把低秩、张量网络、浅层线路和神经量子态等紧凑表示,与 POVM、Pauli、随机酉/局域测量的几何嵌入性质及优化算法联系起来。主要结果是系统梳理不同测量设计的样本复杂度与可恢复条件,并给出可扩展 QST 的统计—算法基础;作为综述,文中未充分说明新的实证增益。

Polyak-Lojasiewicz Inequality for Quadratically Regularized Optimal Transport Figure 1
2026-05-27math.OC

Polyak-Lojasiewicz Inequality for Quadratically Regularized Optimal Transport

Alberto González-Sanz, Marcel Nutz, Andrés Riveros Valdevenito

2026-05-27优化算法学习理论

针对熵正则最优传输易产生满支撑耦合和指数缩放不稳定、而二次正则 QOT 又缺乏强凹性导致收敛难证的问题,本文抓住最优解邻域中正部函数在耦合支撑内部失活这一局部曲率来源,用泛函分析建立显式常数的局部误差界和 PL 不等式,并据此证明梯度上升、坐标上升及坐标梯度上升在 QOT 对偶上具有线性收敛率。

A Unified Primal-Dual Recipe for Accelerating Three-Operator Splitting Methods Figure 1
2026-05-27math.OC

A Unified Primal-Dual Recipe for Accelerating Three-Operator Splitting Methods

Abdurakhmon Sadiev, Laurent Condat, Peter Richtárik

2026-05-27强化学习优化算法学习理论

针对三函数复合凸优化中 CV、PDDY、PDTR 等分裂法通常缺乏加速率的问题,本文从原始-对偶鞍点视角重新构造算法,将 Chambolle-Pock 与 Bregman 框架结合,统一推出 ACV-I/II 与 APDTR-I/II 四个变体。其主要结果是用共同的 Lyapunov 分析给出光滑、非光滑及线性约束情形的迭代复杂度,并去除以往需某一项为零等结构性限制。

Convergence of Spectral Descent for Non-smooth Optimization Figure 1
2026-05-27cs.LG

Convergence of Spectral Descent for Non-smooth Optimization

Yixuan Yang, Yuqing He, Song Li

School of Mathematical Sciences, Zhejiang University, Hangzhou, China

2026-05-27优化算法学习理论

论文针对 Muon 类优化器虽在大模型训练中有效、但非光滑情形缺少理论解释的问题,分析其简化形式 Spectral Descent 及截断版 TSD。核心洞察是把矩阵符号下降与谱范数/Ky Fan 范数最速下降联系起来,并揭示收缩率受次梯度秩控制;加入解耦权重衰减后又与 Frank-Wolfe 动力学对应。主要结果是在凸、Lipschitz 与 sharpness 条件下证明 SD/TSD 全局线性收敛,对正则化版本给出次线性保证,并在鲁棒低秩矩阵恢复和非光滑网络实验中验证趋势。

Developing a Totally Unimodular Linear Program for Optimal Conformance Checking: When and Why It Complements A* Figure 1
2026-05-27cs.AI

Developing a Totally Unimodular Linear Program for Optimal Conformance Checking: When and Why It Complements A*

Izack Cohen

2026-05-27优化控制

针对基于对齐的一致性检查在长轨迹或偏差较多时 A* 搜索易膨胀的问题,论文将同步乘积可达图上的最优对齐重写为全酉模线性规划,利用最小费用网络流结构保证 LP 松弛存在整数最优解,从而无需整数变量和分支定界。超过 210 万实例显示两者互补:A* 适合短且高一致轨迹,URC² 在长且有偏差轨迹更快;简单选择规则较固定使用 A* 平均省时 38.6%,选择准确率 96%。

Dual Privacy Guarantees for Distributed Nash Equilibrium Seeking in Aggregative Games Figure 1
2026-05-27math.OC

Dual Privacy Guarantees for Distributed Nash Equilibrium Seeking in Aggregative Games

Qingtan Meng, Qian Ma

School of Automation, Nanjing University of Science and Technology, Nanjing, 210094, China.

2026-05-27学习理论三维

针对聚合博弈中分布式纳什均衡搜索需频繁交换决策/估计量而带来的隐私泄露,以及既有差分隐私方法在收敛精度或无限迭代隐私上退化的问题,论文引入随机事件触发与随机量化的双随机机制,并在触发条件和交互项中加入衰减因子。理论上证明算法在保持收敛到纳什均衡的同时,可在每次迭代乃至无限时域维持严格的(0,δ)-差分隐私,并通过减少触发和压缩传输提升通信效率,仿真验证了这些结论。

A Nonmonotone Descent Method for Optimization Problems Defined by Upper-$\mathcal{C}^2 $ Functions over Submanifolds Figure 1
2026-05-27math.OC

A Nonmonotone Descent Method for Optimization Problems Defined by Upper-$\mathcal{C}^2 $ Functions over Submanifolds

Christian Kanzow, Leo Lehmann

Christian Kanzow 1 1 1 University of Würzburg, Institute, Leo Lehmann 2 2 2 University of Würzburg, Institute

2026-05-27优化算法学习理论三维

针对流形上非光滑 upper-C² 目标难以直接套用光滑线搜索的问题,本文用投影次微分把欧氏空间的下降性质转移到嵌入子流形,并设计均值型非单调次梯度法。理论上证明迭代聚点的平稳性,并在 Kurdyka–Łojasiewicz 条件下给出收敛及速率结果;实验展示其可用于 DC 函数和流形聚类,但实际增益幅度仍需结合具体算例判断。

A Fixed-Time Sliding-Mode Framework for Constraint Optimization Figure 1
2026-05-27math.OC

A Fixed-Time Sliding-Mode Framework for Constraint Optimization

Baby Diana, Priyanka Singh, Shyam Kamal, Sandip Ghosh, Bijnan Bandyopadhyay

2026-05-27优化算法

针对连续时间约束优化中可行性收敛依赖初值且易受扰动破坏的问题,论文把等式约束构造成滑模面,并将拉格朗日乘子设计为等效控制与固定时间切换控制。该框架可在有界时间内到达约束流形;在流形上,非凸情形收敛到局部 KKT 点,强凸情形固定时间到达全局最优,并在 AC-OPF 与分布式估计中验证了抗匹配扰动能力。

Dynamic Output-Feedback Controller Synthesis for Dissipativity and $H_2$ Performance from Noisy Input-Output Data Figure 1
2026-05-27math.OC

Dynamic Output-Feedback Controller Synthesis for Dissipativity and $H_2$ Performance from Noisy Input-Output Data

Pietro Kristović, Andrej Jokić, Mircea Lazar

2026-05-27规划控制

针对未知离散 LTI 系统难以仅凭含噪输入输出数据合成动态输出反馈控制器的问题,本文从一般 AR 表示出发,将非最小实现投影到数据识别的可达子空间,并利用 AR 移位结构与矩阵 S-lemma 构造非保守 LMI 条件。结果给出耗散性与给定 H2 性能的控制器综合方法;含噪时需标量线搜索,无噪时退化为标准 LMI,并在数值与主动悬架例子中验证有效性。

Stochastic LQ Optimal Control with Random Coefficients and a Terminal Mean-Field Cost Figure 1
2026-05-27math.OC

Stochastic LQ Optimal Control with Random Coefficients and a Terminal Mean-Field Cost

Guojiang Shao, Zuo Quan Xu, Qi Zhang

Corresponding author. School of Mathematical Sciences, Fudan University, Shanghai 200433, China

2026-05-27规划控制

针对随机系数、多维非齐次随机 LQ 控制中终端均值场成本导致的可解性与显式策略困难,本文用拉格朗日对偶将均值约束分解,并结合线性 BSDE 分解推导最优反馈控制。结果给出两类充分可解条件;在确定性系数情形下条件弱于既有标准假设,并以多资产均值—方差组合选择数值例展示适用性。

FINOM: Fast Sinkhorn on Non-uniform Meshes Figure 1
2026-05-27math.NA

FINOM: Fast Sinkhorn on Non-uniform Meshes

Qihao Cheng, Qichen Liao, Hao Wu, Shuai Yang

Qihao Cheng 1 1 1 Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China, Qichen Liao 2 2 2 Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China, Hao Wu 3 3 3 Corresponding author. Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China, and Shuai Yang 4 4 4 Department of Mathematical Sciences, Tsinghua University, Beijing 100084, China

2026-05-27优化控制

本文针对非均匀网格上计算 Wasserstein-1 距离时 Sinkhorn 迭代需进行 O(N²) 核矩阵乘法的问题,提出 FINOM。核心洞察是用“dividing index”将核矩阵划分为两块,并证明各块具有准共线结构,从而用动态规划精确完成乘法。1D 与 2D 实验显示每次迭代复杂度降至 O(N),在保持精度的同时获得数个数量级加速。

Bilevel Optimization over Saddle Points of Zero-Sum Markov Games Figure 1
2026-05-27cs.LG

Bilevel Optimization over Saddle Points of Zero-Sum Markov Games

Zihao Zheng, Irwin King, Songtao Lu

Department of Computer Science and Engineering, The Chi-, nese University of Hong Kong 2Shun Hing Institute of Advanced, Engineering, The Chinese University of Hong Kong. Correspon-

2026-05-27优化算法

本文针对双层强化学习中下层常被简化为单策略 MDP、难以描述激励设计等多智能体竞争场景的问题,研究以上层变量驱动、下层为正则化零和 Markov 博弈鞍点的优化。核心方法 PANDA 用 Nikaido–Isoda 函数构造惩罚式一阶策略梯度,避开超梯度和二阶信息。理论上在上下层均无凸性假设下收敛到驻点,迭代复杂度约 O(ε⁻¹)、样本复杂度约 O(ε⁻³),实验优于相关基线。

Sample Complexity of Policy Gradient for Log-Growth Control Figure 1
2026-05-27eess.SY

Sample Complexity of Policy Gradient for Log-Growth Control

Qiuhua Pan, Yukai Shen, Liwei Zhang, Cailian Chen, Xinping Guan

State Key Laboratory of Submarine Geoscience, School of Automation and, Intelligent Sensing, Shanghai Jiao Tong University, Shanghai 200240, China, Key Laboratory of System Control and Information Processing, Ministry of, Shanghai Key Laboratory of Perception and Control in Industrial Network, Paris Elite Institute of Technology, Shanghai Jiao, Tong University, Shanghai 200240, China

2026-05-27强化学习规划控制优化算法

本文关注乘性噪声执行通道下,如何仅凭状态转移学习最优稳定反馈增益;关键洞察是最优点必然落在梯度奇点上,普通策略梯度方差无穷。作者利用奇点两侧反射配对抵消发散项,构造可控方差的梯度估计,并证明投影小批量 PG 在已知噪声密度时样本复杂度为 Õ(1/η),未知密度且 Cs、s≥2 时为 Õ(η^{-(2s+1)/(2s)})。

Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial Figure 1
2026-05-27eess.SY

Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial

Haoyu Li, Xiangru Zhong, Hao Cheng, Bin Hu, Huan Zhang

2026-05-27规划控制

面向神经网络控制器在自动驾驶、机器人和电力系统等安全关键场景中缺乏形式化保证的问题,本文将控制验证统一转化为计算图上的实值不等式界定,系统讲解如何用 α,β-CROWN 的线性松弛、分支定界与 GPU 并行来处理可达性、Lyapunov/Barrier 证书验证和 MPC 优化。主要结果是给出从建模、接口到可验证控制器/证书联合训练的教程框架,并展示其相较 SMT、MILP、SOS 等方法更易迁移且更具可扩展性,但具体实验增益幅度文中未充分说明。

High-Probability Guarantees for Random Zeroth-Order Gradient Descent on Smooth Functions Figure 1
2026-05-27math.OC

High-Probability Guarantees for Random Zeroth-Order Gradient Descent on Smooth Functions

Haishan Ye

et al., 2009], where gradients may be unavailable, unreliable, or too expensive to compute., ∗Xi’an Jiaotong University

2026-05-27优化算法

本文针对随机零阶优化常只给期望界、用 Markov 转换会带来过度保守置信依赖的问题,直接分析两点高斯有限差分下降,并用按方向长度归一化的步长揭示投影累积下降结构。结果给出强凸、凸和非凸光滑目标的有限步高概率复杂度,分别避免强凸情形平滑半径随√δ缩小,并获得凸目标 O(dLRε²/ε+log(1/δ)) 与非凸平均驻点 O(LΔ0(d+log(1/δ))/ε) 查询界。

A two-stage stochastic programming framework for oil and gas exploration well portfolio optimization under geological and economic uncertainty Figure 1
2026-05-27math.OC

A two-stage stochastic programming framework for oil and gas exploration well portfolio optimization under geological and economic uncertainty

Junyi Cui

School of Sciences, Southwest Petroleum University, Chengdu 610500, China, Institute for Artificial Intelligence, Southwest Petroleum University, Chengdu 610500, China, Jagiellonian University in Krakow, Faculty of Mathematics and Computer Science, 30348 Krakow, Poland

2026-05-27优化算法安全鲁棒

针对油气勘探年度井位组合在地质成败、储量和经济价值不确定下仅按期望值决策易失效的问题,论文提出带后验学习的两阶段随机多目标规划:先选初始井组,再随首阶段结果更新后续项目成功率并优化补救决策,同时权衡期望 NPV、CVaR 与储量/成功率机会约束。数值案例显示该框架能给出可解释的风险—收益前沿,支持更稳健的自适应勘探计划。

Integrating Hydrogen into Ontario's Energy Hub: A Robust, Carbon-Aware Framework for Power-Heat-Transport Figure 1
2026-05-27math.OC

Integrating Hydrogen into Ontario's Energy Hub: A Robust, Carbon-Aware Framework for Power-Heat-Transport

Hossein Mirzaee, Mostafa Mostafavi Sani, Hamed Samarghandi

University of British Columbia, Vancouver, British Columbia, Canada, V6T 1Z4, Department of Industrial Engineering, Dalhousie University, Halifax, NS, Canada, B3H 4R2, Edwards School of Business, University of Saskatchewan, Saskatoon, SK, Canada, S7N 5A7

2026-05-27强化学习规划控制优化算法三维安全鲁棒

面向电力、供热与交通协同脱碳中可再生出力和需求不确定带来的规划风险,本文将氢能子枢纽显式纳入安大略多能源中心,构建含碳税/净零约束的25年MILP,并用预算鲁棒优化权衡可靠性与成本。结果显示到2050年电解槽和储氢规模大幅扩张,鲁棒方案可保持不利情形可行,但总成本增加约6.6–9.0%,且略降低氢能利用和可再生占比。

Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback Figure 1
2026-05-27cs.LG

Online Learning on Hidden-Convex Losses via Algorithmic Equivalence: Optimal Regret, Geometric Barrier, and Bandit Feedback

Anas Barakat, Andreas Kontogiannis, Vasilis Pollatos, Ioannis Panageas, Antonios Varvitsiotis

2026-05-27优化算法学习理论

本文关注对抗式在线学习中“隐藏凸”非凸损失:原参数下非凸、经未知非线性重参数化后凸,动机是让简单 OGD 获得类似 OCO 的全局遗憾保证。核心洞察是更精细地刻画 OGD 与重参数空间 OMD 的离散时间等价,并给出 Hessian 兼容性的充要几何条件及其必要性。结果将全信息遗憾从 O(T^{2/3}) 提升到最优 O(√T),不满足兼容性时构造 Ω(T) 下界,并在单点 bandit 反馈下得到 O(T^{3/4}) 期望遗憾。

Multiperiod Groundwater Markets Figure 1
2026-05-27q-fin.TR

Multiperiod Groundwater Markets

Igor Cialenco, Michael Ludkovski

Department of Applied Mathematics, Illinois Institute of Technology, Department of Statistics and Applied Probability, University of California Santa Barbara

2026-05-27优化控制

面向加州等地地下水配额交易与“水权银行”需求,论文建立随机多期地下水市场模型,将农户用水、交易和跨期存储决策纳入非零和动态博弈,并内生求得清算价格。核心结果是证明该市场可表述为子博弈完美 Markov 纳什均衡且纯策略清算,进一步用后向递推、最佳响应和机器学习近似求解。数值实验显示补给不确定性、风险厌恶和配额机制会显著影响价格、银行行为与市场效率。

Fast Convergence of Policy Regret in Learning Stochastic Optimal Control Figure 1
2026-05-27math.OC

Fast Convergence of Policy Regret in Learning Stochastic Optimal Control

Shengbo Wang, Jose Blanchet, Peter Glynn

Daniel J. Epstein Department of Industrial and Systems Engineering, University of Southern California, Stanford University

2026-05-27强化学习规划控制学习理论

本文关注连续状态/动作随机控制中,Q 函数估计尚不精确时贪心策略为何仍能低遗憾部署的问题。核心洞察是用最优 Q 面的局部增长、弱增长状态的占比以及估计误差的动作向平滑性,替代有限动作的动作间隔来刻画决策稳定性。论文给出匹配上下界的极小极大遗憾率,并说明当动作向正则指数 q>0 时可快于 n^{-1/2},在库存控制和服务分配模型中验证了该结构条件。

Sparse symmetric generalized inverses for sparse symmetric matrices Figure 1
2026-05-27math.OC

Sparse symmetric generalized inverses for sparse symmetric matrices

Ananias Machado, Marcia Fampa, Jon Lee

University of Michigan

2026-05-27强化学习优化算法三维

针对稀疏对称矩阵的 Moore–Penrose 伪逆通常变稠密、存储和多右端最小二乘计算昂贵的问题,论文以向量 1 范数最小化促进稀疏性,给出对称广义逆的新刻画和紧凑仿射重构,并设计带闭式投影的 Douglas–Rachford 分裂算法。实验显示其生成的广义逆比伪逆稀疏得多,1 范数优于局部启发式,且可扩展到商业线性优化器难以处理的规模。

Prox-NAG-GS: A Semi-Implicit Proximal Method for Composite Optimization Figure 1
2026-05-27math.OC

Prox-NAG-GS: A Semi-Implicit Proximal Method for Composite Optimization

Sikeh Gisele Wiykiynyuy, Kelvin Asu Ekuri, Valentin Leplat

2026-05-27规划控制优化算法学习理论数据集/基准三维

针对机器学习/逆问题中光滑损失加非光滑正则的复合优化,本文将半隐式 NAG-GS 的双序列耦合保留下来,并把第二步改为近端更新,提出 Prox-NAG-GS。关键分析在于处理梯度点 x 与近端输出 v 的错位,用增广 Lyapunov 函数给出强凸线性收敛和凸情形 O(1/k) 保证;Elastic Net、Group Lasso 与稀疏 softmax 实验显示其迭代数更少、部分任务耗时更优,但随机场景主要优势在数据拟合下降,稀疏性不一定占优。

Adversarial Water-Filling: Theory, Algorithms and Foundation Model Figure 1
2026-05-27cs.IT

Adversarial Water-Filling: Theory, Algorithms and Foundation Model

Xindi Tong, Chee Wei Tan, H. Vincent Poor

Xindi Tong and Chee Wei Tan are with the College of Computing and Data Science (CCDS), Nanyang Technological University, Singapore., H.Vincent Poor is the Michael Henry Strater University Professor in Princeton University, United States

2026-05-27学习理论

面向多运营商 LEO 卫星共享频谱中的实时竞争干扰,论文将发射功率与最坏干扰建模为对抗式注水 minimax 问题,统一高斯注水与离散星座的 mercury/water-filling。其核心是用置换不变编码、约束图消息传递和全局水位潜变量学习原始-对偶搜索动力学,并给出 KKT 一致性与局部线性收敛条件;实验显示可跨规模、约束和调制零样本泛化,较迭代基线提速一个数量级以上。

2026-05-26

51 篇
Dynamic inverse problems: Online regularisation theory Figure 1
2026-05-26math.NA

Dynamic inverse problems: Online regularisation theory

Jyrki Jauhiainen, Yassine Nabou, Tuomo Valkonen

𝑏𝑘,𝛿are available. The underlying infinite time horizon operator equations take the form, all of the data will never be available. This naturally leads to the concept of an online inverse problem, where again only noisy measurements 𝑏𝛿of the exact data ˆ𝑏are available. A standard Tikhonov-type, This research has been supported by the Academy of Finland grant 345486 and the Special Research Area (SFB) “Mathematics, ‡MODEMAT Research Center in Mathematical Modeling and Optimization, Quito, Ecuador and Department of Mathe-, of the form (1.1), where only noisy measurements 𝑏𝑘,𝛿of the exact data ˆ𝑏𝑘are available. Let ˆ𝑥𝑁=

2026-05-26学习理论

面向算子、数据随时间变化且只能顺序观测的动态逆问题,本文将经典 Tikhonov 正则化收敛理论扩展到无限时间域在线求解。核心是用度量次正则性处理非光滑正则项,并显式纳入在线算法的近似误差;在温和时变假设下证明噪声、正则化和算法误差消失时,时间平均重构误差趋于零,并以动态电阻抗成像数值例子验证理论适用性。

Resonant Microstructures as Dirac-type Actuators for Acoustic Wave Control Figure 1
2026-05-26math.AP

Resonant Microstructures as Dirac-type Actuators for Acoustic Wave Control

Arpan Mukherjee, Mourad Sini

Spectral Isolation and Generic Controllability . . . . . . . . . . . . . . . . . . . . . . ., ∗MSU-BIT SMBU Joint Research Center of Applied Mathematics, Shenzhen MSU-BIT University, Shenzhen, People’s, institute, Academy, and well-posedness and controllability are typically expressed via geometric conditions (such as the, terms, and available control directions are strongly constrained (see, e.g., [22, 23]). Related finite-

2026-05-26规划控制

本文关注用极小、局部化的物理执行器实现声波方程内部控制的问题。核心洞察是把高对比亚波长气泡簇在 Minnaert 共振附近等效为 Dirac 点源,并用谱带耦合矩阵与传递算子刻画可控性。结果证明在满秩与簇级可达条件下,可对有限 Dirichlet 谱子空间进行轨迹跟踪;非共振频带执行器映射病态,而共振带上存在一致有界右逆,气泡尺寸趋零时误差为 O(ε^γ)。

Exact controllability of the stochastic Maxwell equation: theory and numerical simulation Figure 1
2026-05-26math.OC

Exact controllability of the stochastic Maxwell equation: theory and numerical simulation

Liying Sun, Xiaohan Wang, Yongyi Yu

EXACT CONTROLLABILITY OF THE STOCHASTIC MAXWELL, Abstract. This article investigates the exact controllability of three-dimensional stochastic, tions using the multiplier method, and subsequently, proves the exact controllability of the, exact controllability is destroyed when this control is removed, controllability result obtained in this paper is achieved with a minimal number of controls., stochastic Maxwell equations, exact controllability, multiplier method, numerical, The exact controllability, include boundary controllability obtained by the Hilbert uniqueness method [10] and stabilizability, arguments [9], as well as internal controllability established through multiplier techniques [24] and, counterparts, the controllability problem for stochastic Maxwell equations remains significantly, less developed. Motivated by these considerations, this paper investigates the exact controllability, The main purpose of this article is to study the exact controllability of system (1.1) and the

2026-05-26生成模型强化学习规划控制学习理论三维

针对随机介质、热噪声等使经典 Maxwell 方程确定性控制不足的问题,论文研究三维随机 Maxwell 系统的精确可控性。核心在于用乘子法建立后向随机系统可观测不等式,并通过对偶性证明前向系统可控;同时指出扩散项控制不可缺少,去掉任一内部或边界控制都会破坏可控性,因而控制数目是最小的。文中还给出 Yee 网格中心差分、时间中点格式与拉格朗日乘子结合的数值求控方法。

On the Complexity of Bilevel Independent Set Problem Figure 1
2026-05-26cs.DS

On the Complexity of Bilevel Independent Set Problem

Komal Muluk

Department of Mathematics, TU Dortmund University, Germany

2026-05-26优化控制

本文面向分层决策中领导者与跟随者分别控制互斥变量的场景,研究独立集及区间选择的双层优化复杂性。核心在于系统区分求和/瓶颈目标与乐观/悲观响应形成的八类变体,并将其放入多项式层级。结果给出从 P、NP 完全到 Σ₂^p 完全的完整分类;对双层区间选择的求和目标情形,还设计了 O(n^4 log n) 动态规划算法。

$G_2$ and the Maximally Symmetric (3, 8) Distribution with 6-Dimensional Square Figure 1
2026-05-26math.DG

$G_2$ and the Maximally Symmetric (3, 8) Distribution with 6-Dimensional Square

Nicklas Day, Boris Doubrov, Igor Zelenko

Department of Mathematics, Texas A&M University, College Station, Belarussian State University

2026-05-26优化控制

论文从 Cartan 的 \(G_2\) 对称分布出发,追问秩3、平方维数为6的括号生成分布中最大对称模型的结构。作者构造了8维流形上增长向量为(3,6,8)的左不变分布,揭示其29维无穷小对称代数为\((\mathfrak g_2\oplus\mathbb R)\ltimes W\),并证明它在相关族中达到最大对称性,同时给出非最大类猜想的反例及异常极值轨线余秩至少为2的控制论后果。

Optimal and Order-optimal Gated Priority-based Greedy Policies for Two-layer Multi-item Order Fulfillment Figure 1
2026-05-26cs.LG

Optimal and Order-optimal Gated Priority-based Greedy Policies for Two-layer Multi-item Order Fulfillment

Xi Chen, Yuze Chen, Ziyi Chen, Yuan Zhou

2026-05-26优化控制

本文针对电商两层履约网络中多品类订单连续到达、前置仓库存稀缺且未来需求未知的问题,研究如何在即时成本与保留本地库存价值之间取舍。核心创新是提出带“门控”的优先级贪心策略,在多前置仓、RDC兜底、固定成本与时变单位成本下给出可解释的在线决策规则。理论上证明其竞争比在多种成本情形下达到最优或阶最优,并通过数值实验显示优于广义短视和预测型基线。

An Anderson-accelerated stochastic extragradient method for stochastic variational inequalities Figure 1
2026-05-26math.OC

An Anderson-accelerated stochastic extragradient method for stochastic variational inequalities

Xin Qu, Wei Bian, Xiaojun Chen

2026-05-26优化算法学习理论三维

针对随机变分不等式中期望算子难以精确计算、传统随机外梯度在弱单调条件下收敛分析受限的问题,本文把 Anderson 加速嵌入随机外梯度框架,并只要求期望算子满足伪单调性而非每个采样算子。理论上证明迭代几乎必然收敛到解,残差具次线性收敛率且达到最优 oracle 复杂度,数值实验显示加速有效。

Comments and Corrections on the DP Equations of Paper "On Team Decision Problems With Nonclassical Information Structures" Figure 1
2026-05-26math.OC

Comments and Corrections on the DP Equations of Paper "On Team Decision Problems With Nonclassical Information Structures"

Charalambos D. Charalambous, Umarbek Guvercin, Seddik Djouadi

Charalambos D. Charalambous is with the Faculty of Electrical and Computer Engineering, University of Cyprus, Nicosia 1678, Cyprus

2026-05-26学习理论

该文针对延迟共享信息结构下分散式 POMDP/团队决策的 PbP 最优性分析,指出 2023 年相关论文中信息状态递推与成员级 DP 方程存在关键证明缺口。核心洞察是原有“分离策略”所依赖的信息状态并不足以支撑所声明的动态规划递推。作者据此否定相关引理和定理的有效性,并给出修正后的 PbP 动态规划方程,为后续建立更完整的非经典信息结构 DP 理论奠定基础。

The Geometry of Linear Program Compression: An Exact Characterization and Learning Algorithm Figure 1
2026-05-26math.OC

The Geometry of Linear Program Compression: An Exact Characterization and Learning Algorithm

Yuhan Ye, Omar Bennouna

2026-05-26学习理论三维

面向同一可行域、目标函数反复变化的线性规划,论文关注如何在不损失最优性的前提下降维以加速重复求解。核心洞察是压缩极限由“决策相关子空间”而非原始维度决定,并给出精确几何刻画与最小等价降维 LP。作者还提出基于历史代价样本的学习算法,在未知先验下以约 O(d*/n) 的快率恢复新实例最优解,并展示维度压缩与成功概率的可调权衡。

On the Strong Quasiconvexity of Norms and Distance Functions Figure 1
2026-05-26math.OC

On the Strong Quasiconvexity of Norms and Distance Functions

V. S. T. Long, N. M. Nam

2026-05-26优化算法学习理论

本文针对强拟凸性在一般范数与距离函数中的刻画不足,研究其与底层集合几何结构的关系。核心洞察是把函数的强拟凸性转化为凸集有界性、强凸集等几何条件:任意范数若在凸集上强拟凸则该集合必须有界;对1<p≤2的ℓp范数,有界性同时也是充分条件;并给出距离函数在欧氏球及Vial意义强凸集上的若干充分条件与反例。

Match classification in the last round of four-team round-robin tournaments Figure 1
2026-05-26econ.GN

Match classification in the last round of four-team round-robin tournaments

László Csató, András Gyimesi

University of Pécs, Faculty of Business and Economics, Pécs, Hungary

2026-05-26优化控制

针对世界杯等四队循环赛末轮常出现“无须取胜”或默契空间的问题,本文比较确定性与概率性比赛分类,并用后者刻画攻守激励差异、分解2026世界杯扩军、晋级规则和排名规则改革的影响。结果显示,两类方法在历史赛事中均有现实对应,但概率模型能细分传统“竞争性比赛”,并量化各项改革对末轮激励结构的贡献。

Cesàro means of firmly nonexpansive iterates need not converge strongly Figure 1
2026-05-26math.OC

Cesàro means of firmly nonexpansive iterates need not converge strongly

Heinz H. Bauschke, Tran Thanh Tung

Mathematics, University

2026-05-26模仿学习优化算法学习理论

本文针对优化与不动点迭代中“平均化是否能把弱收敛提升为强收敛”的问题,构造了无限维 Hilbert 空间中一族更显式的 firmly nonexpansive 反例,利用高斯核曲线与网格控制迭代范数。结果表明,即使算子有唯一不动点,Cesàro 平均仍可始终远离该点,甚至出现下极限为零而上极限为正的振荡,从而限定了非线性平均遍历定理在优化算法中的适用范围。

Specular gradient methods for nonsmooth convex optimization in Euclidean spaces: a subgradient selection strategy Figure 1
2026-05-26math.OC

Specular gradient methods for nonsmooth convex optimization in Euclidean spaces: a subgradient selection strategy

Kiyuob Jung

Department of Mathematics, Michigan State University, East Lansing, MI 48824 USA ().

2026-05-26优化算法学习理论三维

针对非光滑凸优化中子梯度选择往往计算昂贵且经典方法可能在不可微点表现不稳的问题,论文引入“镜面梯度”:由单侧方向差商的角均值构造,并证明其属于凸函数次微分。基于此设计确定性、随机与混合三类子梯度算法,在平方可和但不可和步长下给出收敛性证明;数值例子显示其可处理部分梯度下降、Adam、BFGS失效的不可微目标,但性能增益的适用范围仍需更多验证。

Sparse Recovery via $\ell_p^p/\ell_q^p$ Ratio Minimization: Theory and Algorithm Figure 1
2026-05-26math.OC

Sparse Recovery via $\ell_p^p/\ell_q^p$ Ratio Minimization: Theory and Algorithm

Lang Yu, Nan-jing Huang

School of Mathematics, Sichuan University, 610064, Chengdu, China

2026-05-26优化算法学习理论三维

针对ℓp^p/ℓq^p稀疏恢复模型虽具尺度不变性、但非凸非光滑分式结构难以统一分析的问题,本文建立覆盖精确与稳定恢复的理论框架,并提出prox-linear Dinkelbach算法。核心结果包括局部最优与零空间充分条件、ℓ1/ℓq情形的子高斯采样复杂度界,以及更宽松RIP条件和维度无关误差界;实验显示其在高动态范围信号和相干矩阵下更有效。

EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization Figure 1
2026-05-26cs.LG

EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization

Chung-Yiu Yau, Dawei Li, Athanasios Glentis, Valentyn Boreiko, Hoi-To Wai, Mingyi Hong

University of Minnesota, The Chinese University of Hong Kong

2026-05-26优化算法

论文针对深度学习中传统 Nesterov lookahead 依赖相邻迭代差分、易受随机噪声和非凸振荡影响而失稳的问题,提出用参数更新的指数滑动平均作为前瞻方向,将其解释为兼顾低通滤波与近期趋势适应性的轨迹级加速。理论上在凸问题保持类似加速收敛率;实验在 NanoGPT、Llama 预训练中结合 Adam、SOAP、Muon 等基优化器,较短/长视野 lookahead 获得更低验证困惑度。

Parallel Differentiable Reachability for Learning and Planning with Certified Neural Dynamics and Controllers Figure 1
2026-05-26cs.RO

Parallel Differentiable Reachability for Learning and Planning with Certified Neural Dynamics and Controllers

Keyi Shen, Glen Chou

2026-05-26规划控制

针对神经网络动力学/控制器在不确定性下难以在线获得形式化安全保证的问题,论文提出基于 JAX 的 DiffReach,将 Taylor-model 流管与 CROWN 线性界传播统一为可并行、可微的可达集计算,并用于认证训练和带梯度细化的采样 MPC。实验覆盖非抓取操作、真实 T-pushing、四旋翼及最高 72 维系统,显示可在在线规划中保持有界扰动下的认证可达集过近似。

A Scalable Bundle Method for Exact Reformulation of SDP in Three-Phase Power Flow Feasibility Figure 1
2026-05-26math.OC

A Scalable Bundle Method for Exact Reformulation of SDP in Three-Phase Power Flow Feasibility

Bohang Fang, Lijun Ding, Cong Chen

2026-05-26生成模型三维

面向不平衡三相配电网潮流可行性判定中 SDP 规模大、内存重的问题,论文将 BIM-SDP 向量化,并把对偶 PSD 约束改写为最大特征值精确惩罚,进而设计三割近端 bundle 求解器。实验在 IEEE 大规模算例上显示,相比 CVX/MOSEK 可达 400 倍以上加速且内存低于 1/2000;在分解 BIM-SDP 上约 2 倍加速、节省 75% 内存。

A Sequential Quadratic Programming Perspective on Optimal Control Figure 1
2026-05-26math.OC

A Sequential Quadratic Programming Perspective on Optimal Control

Abhijeet, Suman Chakravorty

Texas A& M University, College Station, TX, US.

2026-05-26规划控制

针对离散时间最优控制中 Newton、iLQR 与 DDP 的稳定性和收敛差异,论文从 SQP 视角重写这些迭代轨迹优化方法,指出每步本质是在解二次规划并可化为 LQR。核心洞察是 iLQR 不是简单丢弃 DDP 动力学 Hessian 的近似,而是更一致的 SQP 方法,因此在温和条件下给出下降方向并收敛;数值例子显示其在远离最优点时比 DDP/Newton 更可靠且计算更省。

Uncertainty Quantification in Data-Driven Inverse Optimization via Bayesian Inference Figure 1
2026-05-26math.OC

Uncertainty Quantification in Data-Driven Inverse Optimization via Bayesian Inference

Timothy C.Y. Chan, Nathan Sandholtz, Nasrin Yousefi

2026-05-26优化算法安全鲁棒

数据驱动逆优化通常只给出参数点估计,难以支撑决策者对推断可信度的校准或下游鲁棒优化。本文将观测决策的生成机制显式概率化,针对决策噪声与目标系数噪声两类来源构建分层贝叶斯模型,并用两套 MCMC 估计后验与可信区域。理论上证明在可识别条件下后验一致;线性和二次问题实验显示可信区域覆盖率接近标称水平,且随样本增多收缩。

No Figure
2026-05-26math.OC

Boosted Stochastic Frank-Wolfe for Constrained Nonconvex Optimization

Navil Nandhan, Abbas Khademi, Antonio Silveti-Falls

National University of Singapore (NUS), Singapore.

2026-05-26优化算法

针对传统 Frank-Wolfe 在约束优化中易因线性 oracle 返回极点而“之”字震荡、且 Boosted FW 既依赖线搜索或 Lipschitz 常数又缺少非凸/随机理论的问题,本文提出无需 Lipschitz 常数的新步长策略,将 boosting 扩展到随机与非精确梯度估计。理论上首次给出非凸 BFW 的 FW gap O(1/√t) 收敛,以及拟凸/凸情形 O(1/t) 收敛,并可统一覆盖 SAGA、SVRG、Heavy Ball 和零阶估计器;在稀疏逻辑回归和量子过程层析中相较普通随机 FW 获得更快 oracle 与墙钟收敛。

Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies Figure 1
2026-05-26cs.LG

Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies

Sohaib Lafifi

Univ. Artois, UR 3926, Laboratoire de Génie

2026-05-26优化算法

论文针对神经组合优化策略难以解释“为何选此动作”的问题,指出普通特征归因会被张量维度误导。其核心是用 LP 对偶乘子把梯度归因锚定到约束族,并用 CSP 认证反事实、Bonferroni-Hoeffding 给出 PAC 充分子集界。实验中 LP-Λ 在 CVRPTW/OP 上与反事实信号匹配率达 96.5%/77.2%,显著高于 proxy 梯度;FJSP 中无额外增益,符合约束秩对齐预期。

Price of Coupling in Multilevel Linear Programming Figure 1
2026-05-26math.OC

Price of Coupling in Multilevel Linear Programming

Nagisa Sugishita, Margarida Carvalho

2026-05-26优化控制

本文针对多层线性规划中耦合约束与变量无界性如何改变复杂度这一基础问题,系统刻画可行性、最优解存在性和最优值计算的复杂度。核心洞察是“去耦合”并不总能降低难度:一般 k 层可行性为 Σp_{k−1} 完全;无耦合且有界时 k≤4 可多项式求解,但 k≥5 突然升至同阶完全;最优解存在性在 k≥3 为 Δp_k 完全,最优值计算即便在简化情形也为 FΔp_k 完全。

RECTOR: Priority-Aware Rule-Based Reranking for Compliance-Aware Autonomous Driving Trajectory Selection Figure 1
2026-05-26cs.AI

RECTOR: Priority-Aware Rule-Based Reranking for Compliance-Aware Autonomous Driving Trajectory Selection

Hadi Hajieghrary, Benedikt Walter, Chaitanya Shinde, Paul Schmitt, Miguel Hurtado

2026-05-26规划控制

论文针对自动驾驶多候选轨迹常按置信度选取、易忽视安全与交规的问题,提出无需重训预测器的 RECTOR 后处理重排序:用分层规则簿和可微代理评分,并以 ε-字典序保证 Safety>Legal>Road>Comfort 的优先级。在 WOMD 开环验证集上,相同候选下 Safety+Legal 违规率由 28.58% 降至 20.42%,总违规由 40.32% 降至 32.41%;但结果仅为代理评估,非安全证明。

Anarchy in the swarm: Testing informed and uninformed diversity-enhancing mechanisms within PSO framework Figure 1
2026-05-26cs.NE

Anarchy in the swarm: Testing informed and uninformed diversity-enhancing mechanisms within PSO framework

Piotr Urbańczyk, Aleksandra Urbańczyk

2026-05-26优化控制

针对标准粒子群优化在高维多峰问题中易早熟收敛、群体多样性迅速丧失的问题,本文系统比较了利用最优/最差记忆的有信息反向、负学习、避劣机制与无信息随机扰动。实验覆盖32个基准函数和100至1000维,结果显示增益关键不在是否使用问题信息,而在多样性如何嵌入群体动力学:速度更新层面的随机扰动最稳健,直接位置扰动常破坏精细开发;保留全局最优吸引仍很重要。

Safe Trajectory Tracking of the Stefan Problem with Second-Order Moving Boundary Dynamics Figure 1
2026-05-26math.OC

Safe Trajectory Tracking of the Stefan Problem with Second-Order Moving Boundary Dynamics

Shumon Koga, Miroslav Krstic

S. Koga is with the Department, of Computer Science and Systems Engineering at Kobe University, of Mechanical and Aerospace Engineering, University of California at San Diego, La Jolla

2026-05-26视觉感知规划控制学习理论安全鲁棒

针对Stefan相变系统在移动边界轨迹跟踪中同时满足物理安全约束与稳定性证明困难的问题,本文引入二阶边界动力学刻画热惯性,用级数展开构造给定轨迹的前馈解并证明收敛,再以能量整形和PDE反步设计反馈控制。结果表明闭环满足安全约束,并对跟踪误差实现全局指数稳定,正弦轨迹仿真验证了跟踪效果。

A note on the complexity of two-stage stochastic linear optimization with small second stage Figure 1
2026-05-26math.OC

A note on the complexity of two-stage stochastic linear optimization with small second stage

Christoph Buchheim

2026-05-26优化算法

本文关注两阶段随机线性优化在“随机维度低”或“第二阶段很小”时是否仍难解,这对应许多实际低维不确定性场景。核心洞察是用扩展表述下二维多胞形面积计算与独立集计数构造归约,证明即使单一均匀随机变量、固定补救且一阶变量为1,问题仍强#P难;固定第二阶段约束同样强#P难,固定变量为弱#P难,但随机维度和约束数同时固定时可多项式求解。

An Infeasible Method with Feasibility Safeguard for Nonsmooth Composite Optimization Over Manifolds Figure 1
2026-05-26math.OC

An Infeasible Method with Feasibility Safeguard for Nonsmooth Composite Optimization Over Manifolds

Xiyua Xie, Qia Li

2026-05-26优化算法安全鲁棒

针对非光滑复合流形优化中可行迭代需频繁回缩、在大规模矩阵流形上代价较高的问题,论文提出带可行性保护的非精确近端线性化方法 FSIPL,允许迭代暂时离开流形,但通过校正步和基于罚函数的非单调回溯线搜索把不可行性限制在有界邻域内。理论上证明回溯有限终止、聚点为驻点、外迭代复杂度为 O(ε^-2),并在 KL 条件下给出全序列收敛;稀疏 PCA 和稀疏谱聚类实验显示其具有实际效率。

Global linear convergence of entropy-regularized softmax policy gradient beyond tabular MDPs Figure 1
2026-05-26cs.LG

Global linear convergence of entropy-regularized softmax policy gradient beyond tabular MDPs

Ziyue Chen, David Šiška, Lukasz Szpruch

School of Mathematics, University of Edinburgh

2026-05-26强化学习优化算法学习理论

针对软最大策略梯度的线性收敛理论长期局限于表格 MDP,本文研究连续状态/动作空间下的熵正则无限时域 MDP。核心做法是在对数线性策略与线性特征近似中,借助 Q 函数可实现性建立非均匀 PŁ 不等式,并分析 Fisher 信息矩阵或未中心化协方差退化的来源;在全仿射张成和单纯形特征两类条件下证明相关常数沿梯度流有正下界,从而得到正则化目标全局线性收敛,次优度按 O(e^{-Ct}) 衰减。

Error estimates for tamed Euler and Randomized Euler schemes for SDEs with locally Lipschitz drift with applications to non-logconcave sampling and optimization Figure 1
2026-05-26math.PR

Error estimates for tamed Euler and Randomized Euler schemes for SDEs with locally Lipschitz drift with applications to non-logconcave sampling and optimization

Iosif Lytras, Angelos Ntousis

Archimedes, Athena Research Center, Greece and National Technical University of Athens, Athens,Greece., ∗ Archimedes, Athena Research Center, Greece

2026-05-26优化算法

本文针对超线性增长、仅局部 Lipschitz 漂移下传统 ULA/Euler–Maruyama 易失稳的问题,研究非对数凹采样与优化中的离散化误差。核心是为 kTULA 构造 KL 局部误差框架,并提出驯服随机中点 tRLMC 及其总变差分析。结果给出有限时间非渐近界:kTULA 在 LSI 条件下达近似 \(\widetilde O(\varepsilon^{-1/2})\) KL 复杂度,tRLMC 获 \(\widetilde O(\varepsilon^{-1})\) TV/Wasserstein 保证,并导出非凸 excess-risk 界。

Efficient DP-SGD for LLMs with Randomized Clipping Figure 1
2026-05-26cs.LG

Efficient DP-SGD for LLMs with Randomized Clipping

Enayat Ullah, Sai Aparna Aketi, Devansh Gupta, Huanyu Zhang, Meisam Razaviyayn

University of Southern California

2026-05-26优化控制

面向长上下文 LLM 的差分隐私训练,现有 DP-SGD 的逐样本梯度裁剪在序列长度和模型宽度增大时带来近二次内存开销。论文提出 DP-SGD-RC,将梯度范数估计转化为随机迹估计,并用 Hutchinson/Hutch++ 做随机裁剪,同时给出对应隐私会计分析。Llama 3.2 1B 长上下文微调实验显示,其效用接近确定性裁剪基线,并在最大线性层上最高减少约 40% 内存、获得约 2× 计算节省。

Default Contagion, Matrix Approximation, and Control in Sparse Financial Networks Figure 1
2026-05-26math.OC

Default Contagion, Matrix Approximation, and Control in Sparse Financial Networks

Aoxin Zhang, Yingzhe Wang

2026-05-26规划控制

面向监管压力测试中“用类型暴露矩阵是否足够”的问题,本文把稀疏金融网络违约传染与其聚合矩阵近似并列建模。核心在于用多群体 McKean–Vlasov 极限、可计算的行暴露离散度/边集中度诊断和控制信息价值条件刻画近似边界。结果显示,规则混合下矩阵模型有效,但局部集中暴露会放大尾部损失并改变最优干预,需要利用节点级压力进行网络感知控制。

Time Segmented Beamforming via Dynamic Programming: Theory and Implementation Figure 1
2026-05-26eess.SP

Time Segmented Beamforming via Dynamic Programming: Theory and Implementation

Manan Mittal, Ryan M. Corey, Diego Cuji, John R. Buck, Andrew C. Singer

2026-05-26学习理论

针对动态声学场景中移动干扰会使固定窗口 Capon/MVDR 的协方差估计被“抹平”、导致置零失效的问题,论文把波束形成改写为估计与时间分段的联合优化,用动态规划寻找分段并以复杂度惩罚避免过拟合,同时给出在线近似 OSB 及对批量最优的对数级消失 regret。仿真、SwellEx-96 和分布式麦克风实验显示,OSB 相比固定窗口方法输出功率更低、干扰抑制更强。

Random-Subspace Frank--Wolfe over Strongly Convex Sets Figure 1
2026-05-26math.OC

Random-Subspace Frank--Wolfe over Strongly Convex Sets

Pierre-Louis Poirion, Sebastian Pokutta, Akiko Takeda

Center for Advanced Intelligence Project, Zuse Institute Berlin and TU Berlin, Graduate School of Information Science and Technology, The University of Tokyo, & \& Center for Advanced Intelligence Project

2026-05-26优化算法

针对曲面或稠密可行域中 Frank–Wolfe 全空间线性最小化 oracle 代价过高的问题,论文提出随机子空间 Frank–Wolfe:每步只在经过当前点的低维随机仿射截面上精确求解 LMO,并用强凸集合的几何曲率证明截面仍保留可量化下降。结果给出 O(1/k)、高概率/几乎必然保证、短步长下线性收敛及随机梯度扩展,并说明压缩 Hessian 可改善局部曲率常数。

Lifted Schrödinger Bridges for Gaussian Mixture Endpoints: Projection Gaps and Path-Space Obstructions Figure 1
2026-05-26math.OC

Lifted Schrödinger Bridges for Gaussian Mixture Endpoints: Projection Gaps and Path-Space Obstructions

Siddhartha Ganguly, George Rapakoulias, Panagiotis Tsiotras

2026-05-26三维

本文面向多峰高斯混合端点下薛定谔桥难以闭式求解的密度控制问题,提出在路径空间加入源—目标组分标签,将问题分解为成对高斯桥和有限维熵耦合,并可用 Sinkhorn 标定。核心洞察是遗忘标签后的投影虽满足原端点约束,却一般与无标签最优桥存在非负条件标签信息间隙;文中还给出投影流的后验平均 Markov 漂移、能量上界及间隙消失条件。

Subgradient Methods on Manifolds with Lower Bounded Curvature Figure 1
2026-05-26math.OC

Subgradient Methods on Manifolds with Lower Bounded Curvature

G. C. Bento, J. X. Cruz Neto, J. O. Lopes, I. D. L. Melo

Institute of Mathematics and Statistics, IME, Federal University of Goiás, Goiânia, Goiás, Brazil, Departamento de Matemática, CCN, Federal University of Piauí, Teresina, Piauí, Brazil., Departamento de Matemática, CCN, Federal University of Piauí Teresina, Piauí, Brazil.

2026-05-26优化算法学习理论

本文动机是把欧氏空间中 Shepilov 对非光滑凸优化次梯度法的收敛机制推广到曲率下界的 Hadamard 流形。核心在于利用流形凸分析与曲率比较建立相应的 Fejér 型控制,并补充紧子水平集等技术工具。主要结果表明,在解集非空和非可和递减步长下,若迭代有界、解集有界或步长平方可和,可收敛到极小点;若解集有非空内部,则有限步终止。

On the geometry of sharp minima Figure 1
2026-05-26math.OC

On the geometry of sharp minima

Alberto Domínguez Corella

2026-05-26优化控制

本文关注优化中“尖锐极小点”为何能带来扰动鲁棒性和有限步收敛,核心洞察是把线性增长条件解释为函数图像被锥体支撑、切平面可小幅滚动仍保持相切。论文证明尖锐极小与小线性倾斜下极小点不变等价,并给出基于弱上梯度/度量斜率的刻画,进一步扩展到赋范空间、度量空间及局部尖锐极小情形。

Stochastic maximum principle for optimal control of infinitely delayed systems of functional type in infinite dimensions Figure 1
2026-05-26math.OC

Stochastic maximum principle for optimal control of infinitely delayed systems of functional type in infinite dimensions

Guanwei Cheng

2026-05-26规划控制

针对金融、生物、气候等长记忆随机系统中既依赖完整历史状态又含控制延迟的问题,本文在 Hilbert 空间的衰减记忆路径空间上建立框架,引入非预见路径导数及无限窗口对偶算子,推导无限预期倒向随机演化伴随方程;据此给出随机最大值原理的必要与充分条件,并在无限延迟 LQ 问题中得到显式最优控制。

No Figure
2026-05-26math.OC

Robust Ergodic Control of Jump-Diffusion Systems under Drift and Intensity Uncertainty

Abel Azze, Bernardo D'Auria, Giorgio Ferrari

2026-05-26生成模型规划控制安全鲁棒

针对库存、现金管理等长期运行系统中连续扰动与罕见跳变均难以精确建模的问题,本文将漂移和跳强度不确定性纳入鲁棒遍历奇异控制框架,用熵惩罚刻画最坏模型,并把 HJB 化为可求解的积分微分自由边界问题。结果表明最优策略为反射带,最坏扰动呈 bang-bang 结构;数值上,不确定性会使不干预区变宽且不对称,忽略跳强度或漂移歧义会带来显著长期成本损失。

Quadratically Regularized Optimal Transport: Localization Bounds and Affine Case Analysis Figure 1
2026-05-26math.OC

Quadratically Regularized Optimal Transport: Localization Bounds and Affine Case Analysis

Long Nguyen-Chi, Nam Nguyen, Binh Nguyen

2026-05-26学习理论

论文针对熵正则 OT 耦合稠密、二次正则 QOT 虽能产生稀疏支撑但其逼近 Monge 映射的几何速度不清的问题,分析 QOT 优化解的局部化极限。核心贡献是证明支撑到 Monge 图的有向 Hausdorff 距离不可能快于 ε^{1/(d+2)} 收缩,并用目标值差控制均方偏差;在仿射 Brenier(含高斯到高斯)情形给出匹配的点态管状上界,合成实验支持该 scaling,但一般非仿射上界仍未闭合。

An Algorithm for Approximating the Metric Projection onto a Superelliptic Disk Figure 1
2026-05-26math.OC

An Algorithm for Approximating the Metric Projection onto a Superelliptic Disk

Valerian-Alin Fodor, Virgilius-Aurelian Minuta

2 Babeș-Bolyai University, Department of Mathematics

2026-05-26优化控制

本文面向超椭圆盘上的欧氏度量投影计算,动机是将难以直接处理的光滑凸体投影转化为可显式求解的多边形投影。核心做法是用径向同胚在超椭圆上取顶点,构造在 Hausdorff–Pompeiu 距离下收敛的内接多边形,并利用边、顶点法锥区域划分快速判定投影。主要结果是证明投影算子在该逼近下连续、算法收敛,并给出带绝对误差的示例;复杂度声称为对数级,但详细数值比较留待后续工作。

Orthant-Monotonic Norms and Additive D-Stability Figure 1
2026-05-26math.OC

Orthant-Monotonic Norms and Additive D-Stability

Ron Ofir, Michael Margaliot

RO is with the Department of Electrical Engineering, Yale University, CT, USA., MM is with the School of ECE, and the Sagol School of Neuroscience, Tel-Aviv University, Tel-Aviv 69978, Israel.

2026-05-26优化控制

本文针对收缩理论和加性 D-稳定性中的一个反直觉问题:给稳定系统加入非负对角阻尼并不必然保持稳定。核心洞察是把“可容许”矩阵测度与范数的正交象限单调性精确等价起来,并证明其等价于对所有非负对角矩阵满足 μ(D)=max_i d_ii。主要结果给出了保持非负对角扰动下收缩性的最大诱导矩阵测度类,从几何角度澄清了扩散诱导失稳分析中的适用条件。

Optimal drift optimizer for non-convex optimization Figure 1
2026-05-26math.OC

Optimal drift optimizer for non-convex optimization

Qin Li, Sixu Li, Eitan Tadmor, Emmanuel Trélat

Department of Mathematics, University of Wisconsin-Madison, Madison WI 53706, USA, Department of Mathematics and Institute for Physical Science & Technology, University of Maryland, College Park, USA, Laboratoire Jacques-Louis Lions, LJLL, F-75005 Paris, France

2026-05-26优化算法

本文面向非凸全局优化中“探索—控制代价”如何自动权衡的问题,将有限时域随机控制解释为一个由准则自身确定尺度的漂移优化器。核心洞察是把最优过程的条件终端分布视为近端惩罚能量上的 Gibbs 测度,由此统一得到势函数、平均梯度和重心三种漂移表达。结果显示,临近终端时该漂移退化为缩放梯度下降;低温且全局极小唯一时,即使存在非全局局部极小,终端分布仍集中到全局极小,漂移收敛为指向该点的仿射吸引场,并给出相应渐近公式与无梯度离散化建议。

Single-Chord Augmentation of Weighted Cycles for Algebraic Connectivity and Network Coherence Figure 1
2026-05-26math.OC

Single-Chord Augmentation of Weighted Cycles for Algebraic Connectivity and Network Coherence

Jiarong Deng, Liu Chang, Quanshun Yang

School of Mathematics and Statistics, Jishou University,Jishou 416000, China, College of Sciences, National University of Defense Technology,Changsha 410073, China, National Key Laboratory of Electromagnetic Energy, Naval University of Engineering, Wuhan 430033, China, East Lake Laboratory, Wuhan 430033, China

2026-05-26优化控制

面向无人机编队、循环巡逻等环形通信拓扑中共识收敛慢、噪声下稳态分歧大的问题,本文研究在加权环上添加一条弦。核心洞察是弦会把环分成两段互补电阻弧,其电阻平衡同时影响代数连通度和 Kirchhoff 指数;据此给出精确相干性更新公式,并提出 RBAPS/AW-RBAPS 近线性筛选候选弦。实验中 AW-RBAPS 仅评估约 10.1% 候选,平均超体积比达 0.9987。

An Exact Continuous Conductance Formulation of the Hamiltonian Path Problem Figure 1
2026-05-26math.OC

An Exact Continuous Conductance Formulation of the Hamiltonian Path Problem

A. Sadovsky

2026-05-26优化控制

针对哈密顿路径这一 NP 完全问题,论文动机是把离散可行性条件嵌入连续优化框架,而非提出快速求解器。其核心做法是将图视为欧姆电网络,在边上设置可调电导,并用局部单位外流与无分叉电流两类惩罚构造非凸目标。主要结果证明:若指定端点间存在哈密顿路径,则全局最小电导配置当且仅当对应一条哈密顿路径;但文中也明确说明该表述不保证多项式时间可求。

Explicit Signal-Adaptive Sequential Optimal Execution Quotes Figure 1
2026-05-26q-fin.TR

Explicit Signal-Adaptive Sequential Optimal Execution Quotes

Fenghui Yu

Delft Institute of Applied Mathematics, TU Delft, 2628 CD Delft, The Netherlands.

2026-05-26优化控制

针对大单执行中“交易速度调度”和“限价单挂报价”常被分开建模的问题,本文把库存清算、成交风险、价格冲击和信号驱动的中间价漂移统一到序贯报价控制框架中。核心创新是将四类财富/CARA效用目标的HJB方程化为三角有限维结构,从而给出显式价值函数与最优报价,并证明适定性和验证结果;数值分析显示,非零漂移信号会显著改变最优执行报价。

The petrol station game: the regional average price. A mean field analysis Figure 1
2026-05-26math.OC

The petrol station game: the regional average price. A mean field analysis

Fabio Bagagiolo, Federico Pontiroli, Ivan Romanò

2026-05-26优化控制

本文受意大利加油站需每日公示区域平均油价的制度驱动,将各站在未知次日均价下的定价行为建模为以平均价格为均场的非合作博弈。核心洞察是用竞争、顾客忠诚、调价声誉与绝对价格惩罚构造个体优化问题,并证明正则化项避免退化、使映射成为压缩映射,从而存在唯一均场均衡且迭代收敛;仿真还与特伦托省真实数据及站点聚类进行对比,但预测增益幅度文中未充分说明。

Threshold-Safe Shock Absorption in a Compartmental Voter-Flow Model:\ A Conservative Impulse-Control Benchmark Figure 1
2026-05-26math.OC

Threshold-Safe Shock Absorption in a Compartmental Voter-Flow Model:\ A Conservative Impulse-Control Benchmark

Alexander Omelchenko

Constructor University Bremen gGmbH, Campus Ring 1, 28759 Bremen

2026-05-26生成模型规划控制数据集/基准安全鲁棒

本文动机是把外部冲击如何分批吸收、避免越过选民流动模型中的结构阈值形式化。核心创新在于从局部稳定性推出阈值,并将非线性舱室动力学包络为保守的漏水库脉冲控制问题。主要结果给出单次释放暴露、完全恢复下的安全分批数与开销权衡、有限恢复的恒峰策略,以及固定时域容量边界 Δc(1+ρT)。

Riemannian Archetypal Analysis: Interpretable non-linear data analysis on deformed star distributions Figure 1
2026-05-26cs.LG

Riemannian Archetypal Analysis: Interpretable non-linear data analysis on deformed star distributions

Willem Diepeveen, Deanna Needell

Department of Mathematics, University of California, Los Angeles

2026-05-26优化控制

论文针对经典原型分析只能在线性欧氏几何中解释数据、而神经非线性版本又削弱原型与插值几何含义的问题,提出基于数据驱动拉回黎曼度量的 Riemannian Archetypal Analysis。其核心是用变形星形分布给流形映射以统计解释,并将样本投影到原型的测地凸组合流形上,通过凸松弛加非凸细化求解。合成数据和 MNIST 显示该方法能产生更有意义的测地线、去噪投影和几何感知分类,但优化仍常为次优,实际增益受当前学习与求解限制。

BoxLitE: A Faithful Knowledge Base Embedding Based on Convex Optimization Figure 1
2026-05-26cs.AI

BoxLitE: A Faithful Knowledge Base Embedding Based on Convex Optimization

Bruno F. Lourenço, Hesham Morgan, Ana Ozaki, Aleksandar Pavlović, Emanuel Sallinger

\affiliations 1 Institute of Statistical Mathematics, Japan, University of Oslo, Norway, University of Applied Sciences Campus Vienna, Austria

2026-05-26优化算法

针对知识库嵌入中虽用凸区域表示概念、训练却常落入非凸和不严谨优化的问题,BoxLitE选择DL-Lite H并将概念映射为盒状凸区域,用凸约束强制TBox、将ABox放入目标函数,同时提出基于存在概念的负采样。论文证明任意可满足DL-Lite H知识库都存在弱忠实BoxLitE嵌入,并给出凸优化求解与实验原型;实证部分主要是概念验证,性能增益幅度文中片段未充分说明。

Variational Contraction Conditions for Iterative Algorithms in Multi-Population Discrete-Time Regularized Mean-Field Games Figure 1
2026-05-26math.OC

Variational Contraction Conditions for Iterative Algorithms in Multi-Population Discrete-Time Regularized Mean-Field Games

Uğur Aydın, Tamer Başar

Authors are with the Department of Electrical and Computer Engineering, and the Coordinated Science Laboratory, University of Illinois Urbana-Champaign, Urbana, IL, 61801

2026-05-26优化控制

多群体离散时间正则化均场博弈中,群体交互会使有限时域迭代的收缩判定变成高维谱半径问题,难以直接验证。本文将迭代动力学用 Lipschitz 常数刻画,并把有限时域条件化为一维变分优化,给出与时域长度无关的显式收缩条件,进而证明有限时域均场均衡收敛到无限时域平稳及非平稳均衡的速率;同时说明仅靠多时间尺度更新不能改善这类 Lipschitz 信息下的全局收缩界。

PyCSP3-Scheduling: A Scheduling Extension for PyCSP3 Figure 1
2026-05-26cs.AI

PyCSP3-Scheduling: A Scheduling Extension for PyCSP3

Sohaib Afifi

Univ. Artois, UR 3926, Laboratoire de Génie Informatique et d’Automatique de l’Artois (LGI2A), F-62400 Béthune, France

2026-05-26优化控制

PyCSP3 缺少区间变量、序列变量和资源函数等调度抽象,导致模型需用底层整数变量和手工通道约束表达。本文提出 PyCSP3-Scheduling,以 53 个专用约束和 27 个表达式提供可选任务、强度函数、带设置时间排序等 API,并编译为标准 PyCSP3/XCSP3 以保持求解器无关。261 个配对实例中,72 个双方证明最优的目标完全一致;运行表现分化,部分族最高加速 5.8 倍,部分因分解开销和可选 noOverlap 编码退化而变慢。

2026-05-25

25 篇
Harnessing Individual Motivation for Collective Efficiency: A Mechanism-Driven Distributed Optimization Method Figure 1
2026-05-25math.OC

Harnessing Individual Motivation for Collective Efficiency: A Mechanism-Driven Distributed Optimization Method

Dongwei Xie, Xuhao Wang, Yujie Tang, Jie Song

School of Advanced Manufacturing and Robotics, Peking University, No.5 Yiheyuan Road, Haidian District, conflicts between participants’ self-interest and global performance may also impede collaborative, collaborate in a distributed fashion even though each participant’s decision is driven primarily by, that participants are willing to engage in distributed collaboration under these mechanisms., For example, in supply chain management, multiple enterprises often collaborate through joint, limited space availability, creating positional disadvantages that may force sub-optimal storage, Additionally, while distributed optimization methods enable participants to collaboratively, mechanisms to incentivize collaborative behavior. Meng et al. (2023) also pointed out that self-

2026-05-25优化算法

面向工业多主体决策中隐私受限、个体自利与全局效率冲突的问题,论文提出机制驱动的分布式优化框架。核心是 Consensus-Tracking-ADMM,同时处理目标函数耦合与约束耦合,并用影子价格和 VCG 激励使自利参与者的均衡解与协同最优一致。数值实验显示该算法较若干基线收敛更快,但两类机制收益具有任务依赖性。

Minimum Effort Control Using Variational Methods of Analytical Mechanics A New Approach For Optimal Control Figure 1
2026-05-25math.OC

Minimum Effort Control Using Variational Methods of Analytical Mechanics A New Approach For Optimal Control

Ossama Abdelkhalik, Aimar Negrete

Department of Aerospace Engineering, Iowa State University

2026-05-25规划控制

针对间接最优控制需引入协态、边值问题维度高且初值难选的问题,论文把执行器/控制力视为系统状态,在作用量中加入控制能量,用分析力学变分法同时导出运动方程与控制方程。作者给出两种构造修正拉格朗日量的方法,并通过案例展示可避免求解动态协态,还可借 Noether 定理推导最优路径守恒量;但文中主要为理论推导,实验性性能增益未充分说明。

Reachability for Low-Thrust Trajectories via Maximum Initial Mass Figure 1
2026-05-25eess.SY

Reachability for Low-Thrust Trajectories via Maximum Initial Mass

Giacomo Acciarini, Dario Izzo, Zhong Zhang

Advanced Concepts Team, European Space Agency, European Space Research and Technology Centre (ESTEC), Keplerlaan 1, 2201 AZ Noordwijk, The Netherlands

2026-05-25优化控制

低推力航天器可达集通常需在目标网格上反复求解最优控制,面对高维非线性动力学时代价高且边界病态。本文将可达性改写为固定时间与边界条件下的最大初始质量(太阳帆为强度参数)标量场,并用PMP间接法求解,再训练代理模型近似该指标;实验显示该表征较最短时间更平滑,残差网络尤其Softplus版本在精度、稳定性和复杂度间表现最好,可用于快速任务可行性评估。

Quasi-Newton and Krylov Methods for the Solution of Nonconvex Trust-Region Subproblems Figure 1
2026-05-25math.OC

Quasi-Newton and Krylov Methods for the Solution of Nonconvex Trust-Region Subproblems

Johann Bourhis, Oihan Cordelier, Jean-Pierre Dussault, Oussama Mouhtal, Dominique Orban

National Institute of Applied Sciences of Rennes, France., GERAD and Department of Mathematics and Industrial Engineering, Department of Mathematics

2026-05-25优化算法

针对截断共轭梯度在病态线性系统和非凸信赖域子问题中易受正交性丢失影响的问题,本文重新梳理 CG 与 Broyden 类拟牛顿、FOM/DIOM Krylov 方法的等价关系,并将 LBFGS、DIOM 推广为可检测非正曲率的截断信赖域求解器。实验显示,有限记忆参数是关键杠杆:LBFGS 和 DIOM 比 CG 更稳健,常以更少 Hessian-向量乘达到相近精度并降低运行时间,而低记忆 LSR1 因丢失曲率信息表现受限。

Distributionally Robust Complex Chance-Constrained Optimization Figure 1
2026-05-25math.OC

Distributionally Robust Complex Chance-Constrained Optimization

Raneem Madani (L2S), Abdel Lisser (L2S), Zeno Toffano (L2S)

Université Paris-Saclay, CNRS, CentraleSupélec, Laboratoire des Signaux, robust setting under Wasserstein ambiguity sets centered at the empirical distribu-, the mean and norm bounds of the data are available. A symmetric special case, approaches where the underlying distribution is unknown, but samples are available., are transformed into deterministic convex formulations based on the available sta-

2026-05-25优化算法安全鲁棒

面向波束形成、通信等本质上含复数幅相且存在分布不确定性的安全优化问题,本文将机会约束规划扩展到复变量场景,覆盖CES分布、矩信息/支撑集鲁棒和数据驱动估计等不确定性模型;核心是把个体机会约束化为确定性SOCP,并用Gumbel-Hougaard copula处理联合约束给出上下界近似。实验和MVDR应用显示经验违约率低于设定风险,且联合约束SOCP间隙随切点增多而缩小。

Concentration of measure-valued solutions for semilinear parabolic equations Figure 1
2026-05-25math.OC

Concentration of measure-valued solutions for semilinear parabolic equations

Charlie Lebarbé (LAAS), Émilien Flayac, Michel Fournié, Didier Henrion (LAAS), Milan Korda (LAAS)

Faculty of Electrical Engineering, Czech Technical University in Prague, Technick´a 2, 16626 Prague

2026-05-25优化控制

针对矩-SOS/占用测度方法推广到非线性 PDE 时可能出现松弛间隙、导致测度解不对应物理解的问题,论文研究标量半线性反应-扩散抛物方程。核心做法是把线性测度方程解提升为满足能量恒等式的 Young 测度型 emv 解,并加入时间导数集中的仿射约束。主要结果证明在经典弱解存在且唯一时,所有 emv 解均集中到该解上,从而该类方程的占用测度松弛无间隙。

Simulation Strategies for an Efficient Local Search to solve Stochastic Scheduling Problems Figure 1
2026-05-25math.OC

Simulation Strategies for an Efficient Local Search to solve Stochastic Scheduling Problems

Philip de Bruin, Bram Elderhorst, Marjan van den Akker, Han Hoogeveen

2026-05-25优化控制

针对随机任务时长下调度目标难以精确求期望、在模拟退火等局部搜索中逐步仿真又会显著拖慢迭代的问题,论文研究如何自适应减少每轮仿真次数。其核心是在已有 OCBA、无差异区等序优化思想之外,引入基于 t 检验的两解比较策略,用统计置信度决定是否继续采样。两个案例(随机并行机调度与电动公交车辆调度)显示,该方法能在基本保持解质量的同时降低运行时间,且相较被比较方法最有效。

A Non-Iterative Algorithm for Clearing Two-Layer Energy-Sharing Markets with Voltage Constraints Figure 1
2026-05-25math.OC

A Non-Iterative Algorithm for Clearing Two-Layer Energy-Sharing Markets with Voltage Constraints

Tonghua Liu, Yifan Su, Zhaojian Wang, Feng Liu

2026-05-25优化算法

面向大规模产消者实时能量共享,本文针对现有两层市场清算难以同时兼顾 AC 电网电压约束与计算速度的问题,利用下层市场价格耦合结构推导显式最佳响应,将均衡搜索降为一维,并把双层 MPEC 重构为单层 MISOCP。IEEE 123 节点、1.23 万产消者实验显示电压保持在限值内,最大误差低于 0.01%,求解约 0.829 秒。

Approximate controllability in small times of bilinear Schr{ö}dinger equations with magnetic drift Figure 1
2026-05-25math.AP

Approximate controllability in small times of bilinear Schr{ö}dinger equations with magnetic drift

Eugenio Pozzoli (CNRS, IRMAR)

Approximate controllability in small times of, We study the small-time approximate controllability of bilinear Schr¨odinger equa-, trollability, quantum control, We study the so-called quantum controllability problem. We think of the function, Definition 1. We say that (1) is approximately controllable if, for every ψ0, ψ1 ∈S and, We say that (1) is small-time approximately controllable if, for every ψ0, ψ1 ∈S, that equations of the form (1), with A = 0, are locally exactly controllable in Hs, Later, approximate controllability of (1) (with A = 0) has been proved to be generic, equations as (1) which are approximately controllable in large times, but not in small

2026-05-25规划控制

量子态寿命很短,论文关注带磁漂移的双线性薛定谔方程能否在任意小时间内近似操控。核心在于把既有无磁场的小时间可控性方法扩展到磁拉普拉斯漂移,通过缩放、相位与梯度流的可达性处理磁项影响。主要证明:在Rd中均匀磁场配合二次势和稠密类有界电势可小时间近似可控;在Rd或Td上,对任意C1磁势,有限个Hermite/Fourier型电势控制也可实现该性质;同时给出缺少合适电势时高斯态保持导致不可控的反例。

Output Feedback MPC with Adaptive Tubes Figure 1
2026-05-25eess.SY

Output Feedback MPC with Adaptive Tubes

Anchita Dey, Shubhendu Bhasin

2026-05-25规划控制

针对受参数不确定、加性扰动且只能测量输出的受约束 LTI 系统,论文希望降低传统鲁棒管 MPC 对全不确定集公共二次稳定反馈增益的依赖。方法用自适应观测器同时估计状态、参数和初始条件,并以集合成员识别在线收缩不确定集,使约束收紧、终端项和管形随估计更新。文中证明递归可行与鲁棒指数稳定,并给出数值例子显示不确定性改善后预测管更紧、性能随时间提升。

Linear quadratic optimal transport and interpolation inequalities Figure 1
2026-05-25math.OC

Linear quadratic optimal transport and interpolation inequalities

Luca Rizzi, Alec Jacopo Almo Schiavoni Piazza

2026-05-25优化控制

本文以次黎曼几何比较理论中的“常曲率”模型需求为动机,系统研究线性二次最优控制诱导的最优传输。核心在于突破既有 −Q≥0、代价有下界的限制,处理一般 LQ 代价;证明在 Kalman 条件与首共轭时刻前 Monge 问题适定、最优映射可由 LQ 指数映射和半凸势刻画,并给出连续性正则性、位移插值理论及熵插值不等式,说明 LQ 动力学可模拟黎曼曲率维数模型的畸变系数。

Unlocking the Informational Value of Marginal Costs for Exact Time Series Aggregation in Generation Expansion Planning Figure 1
2026-05-25math.OC

Unlocking the Informational Value of Marginal Costs for Exact Time Series Aggregation in Generation Expansion Planning

Luca Santosuosso, Sonja Wogrin

2026-05-25规划控制

针对含储能跨时约束的发电扩容规划 MILP 随时间尺度和整数变量迅速失去可解性,论文提出用全规模模型线性松弛中的边际成本估计作为后验聚类特征,近似捕捉活跃约束,从而构造面向精确时间序列聚合的降维模型。其迭代算法同时给出全规模可行解和经理论验证的聚合误差界;数值结果显示,在原模型不可解的案例中可恢复可计算性,但边际成本估计在更复杂非凸动态下的稳健性仍待说明。

Coupling optimization algorithms and monotone control systems: Suboptimal model predictive control as an operator splitting scheme Figure 1
2026-05-25math.OC

Coupling optimization algorithms and monotone control systems: Suboptimal model predictive control as an operator splitting scheme

Till Preuster, Hannes Gernandt, Manuel Schaller

SCHOOL OF MATHEMATICS AND NATURAL SCIENCES, UNIVERSITY OF WUPPERTAL, GERMANY, MAIL:

2026-05-25规划控制优化算法

针对非线性系统中实时求解 MPC 最优控制问题开销过高的问题,论文把被控对象与优化器都建模为单调动力系统,并通过结构化互联统一描述次优 MPC。核心洞察是将迭代优化步骤解释为连续闭环优化器—对象动力学的算子分裂离散化,特别是 Lie–Trotter 分裂。文中证明了耦合系统的适定性,说明极限情形可恢复静态 MPC,并将近端梯度、前向后向与 Peaceman–Rachford 等算法纳入同一框架。

RA-DCA: A Randomized Active-Set DCA for Directional Stationarity in Max-Structured DC Programs Figure 1
2026-05-25math.OC

RA-DCA: A Randomized Active-Set DCA for Directional Stationarity in Max-Structured DC Programs

Yi-Shuai Niu

Beijing Institute of Mathematical Sciences and Applications (BIMSA), Beijing, China

2026-05-25优化控制

本文针对 max-structured DC 优化中标准 DCA 可能停在非方向平稳临界点、而完整活跃顶点筛查代价高的问题,提出 RA-DCA:用随机方向投影先检测活跃顶点残差,必要时选最违背顶点,低残差时才用小型 LP 做凸组合回退。在给定正则性和随机嵌入假设下,带 safeguard 的迭代几乎必然收敛到方向平稳累积点;MATLAB 实验显示其在退化 max-affine、max-quadratic 和组合型 top-k 场景中接近全扫描,但在 QUBO 等任务中收益受多起点、DC 分解等因素影响。

End-to-End Pseudo-Measurement Learning for State Estimation under Limited Observability Figure 1
2026-05-25math.OC

End-to-End Pseudo-Measurement Learning for State Estimation under Limited Observability

J. G. De la Varga, S. Pineda, A. Stratigakos, J. M. Morales

2026-05-25优化控制

针对配电网传感器稀疏、AMI 时延高导致的状态估计不可观问题,论文将神经网络生成的伪量测与经典 WLS 估计器端到端耦合,把非线性 AC 潮流 WLS 作为隐式可微层,用最终状态估计误差反传训练伪量测生成器。在 IEEE 30/33 节点多种负荷与量测配置下,该方法较现有伪量测或预测式方案稳定降低电压、注入功率和支路潮流估计误差。

Non-normal spectral signatures of instability in neural network training dynamics Figure 1
2026-05-25cs.LG

Non-normal spectral signatures of instability in neural network training dynamics

Souvik Ghosh

Department of Physics, National Sun Yat-sen University, Kaohsiung 80424, Taiwan

2026-05-25优化控制

针对深度网络训练中损失尖峰、振荡收敛等现象难以仅由 Hessian 谱半径解释的问题,论文把 Adam 与带动量 SGD 的线性化更新视为非正规算子:Adam 的非正规性由 Hessian 与自适应预条件器的对易子控制,动量 SGD 则来自增广状态结构。作者引入伪谱与特征向量条件数 κ(V) 作为瞬态放大的预警量,实验显示谱半径难区分稳定/不稳定阶段,而 κ(V) 可拉开约一个数量级,补充传统 sharpness 判据。

Selective Ambulance Dispatch Under Contextual Travel-Time Uncertainty Figure 1
2026-05-25math.OC

Selective Ambulance Dispatch Under Contextual Travel-Time Uncertainty

Zikun Lin, Daniel Zhuoyu Long, Viet Anh Nguyen

2026-05-25安全鲁棒

面向院外心脏骤停中“尽快到达”与救护车容量受限的冲突,论文提出 IDEAL 选择性双派车:在上下文交通不确定性下,仅当备选路径相对主路径存在足够乐观时间差时派第二辆车。方法结合弱监督双层表示学习估计边旅行时间、Burg 散度刻画相关扰动,并用 DC 优化实时求解。香港历史病例与自适应仿真显示,其响应时间—资源占用权衡优于区域规则和 Google 基线。

Optimal semiconcavity with fractional modulus for Hamilton-Jacobi equations with Neumann boundary conditions Figure 1
2026-05-25math.AP

Optimal semiconcavity with fractional modulus for Hamilton-Jacobi equations with Neumann boundary conditions

Hiroyoshi Mitake, Panrui Ni

2026-05-25学习理论

本文针对带 Neumann 边界的 Hamilton–Jacobi 方程中,粘性解在全局尤其近边界处半凹性缺乏理论的问题,利用最优控制表示和 Skorokhod 反射问题的正则性分析,揭示法向反射会限制可达到的模量。主要结果是在结构假设下证明解在区域及满足 g≥0 的边界部分具有 1/2 阶分数半凹性,并通过例子说明该指数最优。

Anytime Training with Schedule-Free Spectral Optimization Figure 1
2026-05-25cs.LG

Anytime Training with Schedule-Free Spectral Optimization

Anuj Apte, Pranav Deshpande, Niraj Kumar, Shouvanik Chakrabarti, Junhyung Lyle Kim

2026-05-25优化算法

固定训练预算下的学习率 schedule 会让中途 checkpoint 表现强依赖预设 horizon,影响持续学习场景。本文把 schedule-free 框架与谱范数优化结合,提出 SF-NorMuon,并指出 fast iterate 上的 weight decay 对长程稳定性关键;在 125M/772M 语言模型、1–8× Chinchilla 训练长度上,单一超参配置优于 SF-AdamW,并基本匹配逐 horizon 调参的 AdamW。

Extremum seeking with exponential convergence via high-order Lie bracket approximations Figure 1
2026-05-25math.OC

Extremum seeking with exponential convergence via high-order Lie bracket approximations

Victoria Grushkovskaya, Sameh A. Eisa

Victoria Grushkovskaya is with the Department of Mathematics, University of Klagenfurt, 9020 Klagenfurt am Wörthersee, Austria

2026-05-25学习理论

针对传统极值寻优在高阶“平底”目标函数上只能多项式收敛、Newton 类方法又受零/弱 Hessian 困扰的问题,本文用高阶 Lie 括号构造无模型 ES 控制律,使平均运动对齐目标函数高阶导数方向,并给出任意长度迭代括号的显式激励公式。理论上证明在四次及更高阶局部形状下仍可指数收敛,仿真覆盖四、六、八次和多变量目标,并显示优于 Newton 型 ES。

Performance Bounds for Rollout Policies in Stochastic Shortest Path Problems Figure 1
2026-05-25math.OC

Performance Bounds for Rollout Policies in Stochastic Shortest Path Problems

Anders Hansson, Bo Wahlberg

2026-05-25学习理论

针对机器人导航等无折扣随机最短路中,rollout 误差缺少折扣因子约束的问题,本文指出有效“视野”由闭环到达终止态的期望 hitting time 决定。其核心创新是给出针对固定 rollout 策略的非渐近后验性能证书:若价值近似一致误差为 ε,则次优损失按约 2εE[τ] 累积;并用性能差恒等式和确定性紧例证明该因子不可避免,同时扩展到确定性等价 rollout,加入局部模型失配项。

An optimal first-order method for smooth and strongly convex composite optimization and its stationary limit Figure 1
2026-05-25math.OC

An optimal first-order method for smooth and strongly convex composite optimization and its stationary limit

Manu Upadhyaya, Daniel Berg Thomsen, Aymeric Dieuleveut, Adrien B. Taylor

Inria, D.I. ENS, CNRS, PSL Research University, Paris, France

2026-05-25优化算法

针对光滑强凸项与非光滑凸结构项并存的复合优化,论文追问 ITEM 的最优距离收敛能否在前向-后向 oracle 模型中保留。核心是提出 Prox-ITEM,并指出近端步应作用于辅助序列而非常规梯度映射点;通过简洁 Lyapunov 证明给出精确到解距离界,匹配 ITEM 速率且在 span-based 方法中极小极大最优,同时得到平稳极限 Prox-TMM 并保持 TMM 线性距离收敛率。

No Figure
2026-05-25q-bio.GN

Detecting and Correcting Sample-by-Sample Scale Distortion in RNA Sequencing Data

Christopher Thron, Farhad Jafari

Department of Science and Mathematics, Texas A&M University-Central Texas, Killeen, TX 76549, Department of Radiology, University of Minnesota, Minneapolis, MN 55455

2026-05-25优化控制

论文关注 RNA-seq 常规 TPM/FPKM 等归一化后仍残留的逐样本、表达水平相关尺度失真,这类偏差会影响基因相关性和人群差异检验。作者用局部平均在 TCGA、SU2C、GTEx 多数据集中检测偏差,并提出两种基于统计推导的非线性逆变换进行校正。实验与模拟显示,该方法可降低样本间方差、改善相关性分布,并使两群体检验的敏感性和特异性多数提升约 3–5%,但增益可能主要来自 scaling/data 校正。