对齐是确保AI系统的行为、目标和价值观与人类期望和社会利益保持一致的过程。这包括使模型输出有用、诚实、无害,避免产生误导性信息或有害内容。实现对齐通常采用指令微调(Instruction Fine-t…
邮箱: editor@cxounion.org