AI在线 AI在线

大语言模型(LLM)

清华与上海 AI Lab 联合打造新型过程奖励模型GenPRM,让小模型超越 GPT-4o

在人工智能领域,随着 OpenAI 的 o1和 DeepSeek 的 R1模型受到广泛关注,大语言模型(LLM)的推理能力和测试时扩展(TTS)技术引发了众多研究者的兴趣。 然而,在处理复杂推理问题时,如何准确评估模型每一步的回答质量,依然是一个亟待解决的难题。 为此,清华大学与上海 AI Lab 共同提出了生成式过程奖励模型(GenPRM),为过程监督推理提供了创新解决方案。
4/14/2025 3:01:07 PM
AI在线

MCP生态崛起,六行代码打造智能AI代理

随着人工智能技术的飞速发展,模型上下文协议(Model Context Protocol,MCP)生态正在成为连接大语言模型(LLM)与外部工具的桥梁,赋予AI前所未有的操作能力。 MCP作为由Anthropic于2024年11月推出的开源协议,旨在标准化LLM与外部数据源和工具的交互方式。 开发者们称其为“AI的USB-C接口”。
4/14/2025 10:01:22 AM
AI在线

王兴:美团已开发内部大模型LongCat 投资数十亿元GPU资源

近日,美团正式公布了其2024年第四季度及全年财务报告。 据财报显示,美团在2024年全年实现了3376亿元人民币的营收,与去年同期相比增长了22%,彰显了公司稳健且持续的增长动力。 在随后的业绩发布会上,美团首席执行官王兴详细阐述了公司对于人工智能(AI)领域的战略规划。
3/24/2025 4:00:41 PM
AI在线

AMD发布GAIA开源项目 助力本地大语言模型高效运行

近日,AMD 宣布推出一款名为 GAIA 的开源应用,旨在为用户提供一种高效、本地化的方式来运行大语言模型(LLM)。 目前,该应用已支持 Windows 平台,特别为锐龙 AI300系列处理器进行了优化,充分发挥了这些处理器在 AI 任务中的优势。 GAIA 是一个生成式 AI 应用,用户可以在个人电脑上私密地运行 LLM,确保数据隐私。
3/24/2025 9:40:00 AM
AI在线

CMU 团队推出元强化微调:提升大语言模型推理能力的新范式

在人工智能领域,大语言模型(LLM)正在不断进化,最近,卡内基梅隆大学(CMU)与 HuggingFace 的研究者们共同提出了一种名为 “元强化微调”(Meta Reinforcement Fine-Tuning,简称 MRT)的新方法。 这一方法旨在优化大语言模型在测试时的计算效率,尤其是在解决复杂推理问题时,表现尤为突出。 研究表明,现有的大语言模型在推理过程中常常消耗过多的计算资源,而 MRT 的目标是让模型在给定的计算预算内,实现更高效的答案发现。
3/13/2025 11:37:00 AM
AI在线

Firecrawl推出LLM.txt API:提供网址即可生成任意网站的LLM.txt

近日,Firecrawl 推出了一项全新的功能 ——LLMs.txt 生成器接口(Alpha 版),旨在帮助用户将任何网站的内容转化为清晰、适用于大语言模型(LLM)训练的文本文件。 用户只需提供一个网站的 URL,Firecrawl 便会对该网站及其链接页面进行抓取,生成两种格式的文本文件:llms.txt 和 llms-full.txt,便于后续的分析和训练。 该生成器的工作流程相对简单。
3/10/2025 9:48:00 AM
AI在线
  • 1