The Behavioral Layer
Briefings
Map
About
RSS
Dark mode
Light mode
Search
Search
Outline
Map
Explorer
the open note's neighborhood ·
Full map ↗
Tag: model-behavior
11 items with this tag.
Aug 18, 2026
OpenAI Model Spec
behavioral-contracts
model-behavior
governance
alignment
specification
Jul 28, 2026
Claude Opus 5 Pairs Its Best Alignment Audit With More Confident Errors
system-card
agentic-safety
prompt-injection
overconfidence
deployment-monitoring
model-behavior
Jul 20, 2026
GPT-5.6 Reports Increased Over-Agency in Agentic Coding
system-card
agentic-safety
over-agency
severity-scoring
model-behavior
supervision
Jul 09, 2026
Claude's Constitution
behavioral-contracts
model-behavior
alignment
specification
transparency
Jul 09, 2026
Gemini 3 Pro Model Card
system-card
model-behavior
safety
frontier-safety
evaluation
Jul 09, 2026
GPT-5 System Card
system-card
model-behavior
safety
refusals
deception
Jul 09, 2026
Alignment Faking in Large Language Models
deception
alignment
evaluation
model-behavior
training
Jul 09, 2026
Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training
deception
safety-training
backdoors
model-behavior
evaluation
Jul 09, 2026
Claude Sonnet 5 Reports Improved Agentic Safety
system-card
agentic-safety
prompt-injection
model-behavior
Jun 24, 2026
Claude Opus 4.8 System Card
system-card
model-behavior
safety
evaluation
transparency
Jun 24, 2026
Constitutional AI
behavioral-contracts
alignment
model-behavior
governance
training