OSSPettingLLMs: ICLR 2026 Multi-Agent LLM RL TrainingGitHub·high signalXBlueskyLinkedInCopy linkAT-GRPO boosts planning from 14-47% to 96-99.5%. Agent-specific LoRA adapters. First ICLR-published multi-agent RL.SourceSource pageGitHub↳ Follow the threadPolicy dependency / Stack layerCodex makes Code Mode wrappers transparent to Guardian policy and adds read-only policy to MCP tool requestsGitHubStack layerLARA claims LoRA-equal quality from residual-stream adapters that stack many behaviors per token on one frozen modelGitHub / pfekin (via r/MachineLearning, 15 comments)Stack layer / Threat patternThree new advisories land on the most-used community GitLab MCP server, including a five-way bypass of its read-only mode and project allow-listGitHub Advisory DatabasePolicy dependency / Stack layerOrdewell uses a read-only coding agent as planner, then spawns per-task agent sessions gated by a marker-based verdict engineGitHubStack layer / Contrastnanobot has 570 open pull requests against 215 issues, a 2.6:1 inversion on a seven-month-old repoGitHubStack layer / Threat patternOpenAI documents a model writing jailbreak-like instructions into its own compaction summariesOpenAI AlignmentStack layer / ContrastHierarchos-Native trains 143 Transformer architectures on Rust and Vulkan with no CUDA or PyTorchGitHub / necat101 (via r/LocalLLaMA)Policy dependency / Stack layer'Do this as quickly as possible' repeatedly got a Claude session flagged by a corporate security directorr/ClaudeAI