ChatGPT agent System Card
ChatGPT agent System Card: OpenAI’s agentic model unites research, browser automation, and code tools with safeguards under the Preparedness Framework.
Topics: Safety Evals
Entities: Safety EvalsOpenAIChatGPT
Concept
ChatGPT agent System Card: OpenAI’s agentic model unites research, browser automation, and code tools with safeguards under the Preparedness Framework.
Topics: Safety Evals
Entities: Safety EvalsOpenAIChatGPT
Current views on information relevant for visibility into frontier AI risk.
Topics: Safety Evals
Entities: Safety Evals
Sharing our updated framework for measuring and protecting against severe harm from frontier AI capabilities.
Topics: Safety Evals
Entities: Safety Evals
We’re exploring the frontiers of AGI, prioritizing technical safety, proactive risk assessment, and collaboration with the AI community.
Topics: Safety Evals
Entities: Safety Evals
This report outlines the safety work carried out prior to releasing deep research including external red teaming, frontier risk evaluations according to our Preparedness Framework, and an overview of the mitigations we built in to address key risk areas.
Topics: Safety Evals
Entities: Safety Evals
What the EU AI Act requires in 2025–2027, how it lines up with the UK ICO's AI & Data Protection Risk Toolkit, and the exact outputs your team should ship.
Topics: Safety Evals
Entities: Safety Evals
Model Evaluation & Threat Research
Topics: Safety EvalsLLM Evaluation
Entities: Safety EvalsLLM Evaluation
This report outlines the safety work carried out for the OpenAI o3-mini model, including safety evaluations, external red teaming, and Preparedness Framework evaluations.
Topics: Safety Evals
Entities: Safety EvalsOpenAI
Why pre-deployment testing is not an adequate framework for AI risk management
Topics: Safety EvalsTesting Tools
Entities: Safety EvalsTesting Tools
This report outlines the safety work carried out prior to releasing OpenAI o1 and o1-mini, including external red teaming and frontier risk evaluations according to our Preparedness Framework.
Topics: Safety Evals
Entities: Safety EvalsOpenAI
Suggestions for expanded guidance on capability elicitation and robust model safeguards in the U.S. AI Safety Institute’s draft document “Managing Misuse Risk for Dual-Use Foundation Models” (NIST AI 800-1).
Topics: Safety Evals
Entities: Safety Evals
Comments on NIST’s draft document “AI Risk Management Framework: Generative AI Profile.”
Topics: Safety Evals
Entities: Safety Evals