AI对齐
场景非营利背景和AI安全偏执的核心研究方向
274 次提及105 个连接最近出现: 2026-07-29
关系图谱
关系 (131)
应用于 (97)
DeepSeek R1Harness通通3.0AI科研助手Supervised Fine-TuningAI安全叽伴AgentRAGOpenAIAI搜索GPT-6AI芯片RLHFClaude Sonnet 4.6AnthropicGEN-1玄甲Chain-of-ThoughtOpenAIAI编程助手代码生成Claude MythosMythosRLHFAI安全大记忆模型MCPLatent SpaceDPODirect Preference OptimizationMoEAGFT深度求索 DeepSeekQwen3生成模型Claude Opus 4.6具身智能o3SteeringAgent数据标注可解释AIAI金融基准测试Mixture of Experts机器人Transformer自动驾驶强化学习AI招聘助手GRPOMolmo2小红书图像生成Reward HackingGoogle DeepMindModel Spec Midtrainingdeliberative alignmentGPT-5.5 Instant医疗AISFTRLMSMNLAClaude Opus 4SelectiveRMConstitutional AIAI搜索双原生架构人设提示Visual Para-ThinkerClaude Opus 4.8JEPAClaude发布递归自我改进AnthropicGLM-5.2DeepSeek-V3.2Gemini 2.5 Pro数据标注PPOAPI蒸馏因果涌现2.0Gemini 2.0Claude 3.5 SonnetCounterfactual Reflection TrainingJacobian 透镜Jacobian LensRLAIFGPTVerbalized Sampling机制可解释性LoRA智源研究院大语言模型
使用技术 (16)
领导 (3)
竞争 (1)
投资 (1)
相关文章 (274)
下滑加载更多...(已显示 30 / 274)