MarcoPolo

阿里国际版o1来了,Marco-o1:聚焦开放式问题推理

自从 OpenAI 发布 o1 模型以来,业界对其的追赶不断加速。 大模型推理的一个关键挑战在于,现实世界常常提出很多开放式和创造性的问题,对于 AI 来说,这是一类很难评估的任务,因为没有「标准答案」或者易于量化的奖励。 我们能否训练一个模型,让它能够从容应对无法避免的「模糊性」,仍然生成可靠的推理结果?
  • 1