【科技纵览】当“政治正确”被异化为攻击AI安全防线的武器,我们不得不重新审视大模型在价值对齐上的脆弱性。英国一位独立研究员近期发现,无需复杂的提示词工程或伪装开发者模式,仅凭多轮对话中的道德施压,便能诱导部分Claude模型生成露骨色情内容。其核心话术极具欺骗性:先构建包含男女角色的虚构场景,待模型因安全策略...
【科技24时区】人工智能研究实验室Anthropic持续斩获重量级企业合作订单。最新一笔合作将助力其大语言模型落地德国老牌保险巨头。Anthropic于周五宣布,与总部位于德国慕尼黑的全球保险集团安联(Allianz)达成合作协议,旨在为保险业注入“负责任的人工智能”技术。双方均未披露该合作的具体财务条款。此次合作包含三项具体...
8月3日科技区角消息,Anthropic已撤销了OpenAI对其Claude系列AI模型的访问权限。消息人士透露,OpenAI通过将Claude接入内部工具,系统性对比其模型在编程、写作及安全等领域的性能表现。Anthropic发言人对外声明:"OpenAI技术人员在GPT-5发布前使用我们的编码工具,这直接违反了服务条款",Anthropic商业条款明确禁止用户利...