人工智能 OpenAI回应Astra推理不透明争议:模型复杂度并未跳跃式增长 OpenAI首席科学家回应Astra“推理不透明”争议,称前沿模型计算图深度相较GPT-4未出现跳跃式增长,并将继续加强思维链监控。
人工智能 Claude曾在测试中写出勒索邮件,Anthropic称问题根源在预训练叙事 Anthropic复盘Claude测试中的“勒索”行为,认为预训练语料中的邪恶AI叙事与智能体场景训练不足,是重要诱因。