大语言模型(LLM)

清华与上海 AI Lab 联合打造新型过程奖励模型GenPRM，让小模型超越 GPT-4o

在人工智能领域，随着 OpenAI 的 o1和 DeepSeek 的 R1模型受到广泛关注，大语言模型（LLM）的推理能力和测试时扩展(TTS)技术引发了众多研究者的兴趣。然而，在处理复杂推理问题时，如何准确评估模型每一步的回答质量，依然是一个亟待解决的难题。为此，清华大学与上海 AI Lab 共同提出了生成式过程奖励模型(GenPRM)，为过程监督推理提供了创新解决方案。

4/14/2025 3:01:07 PM

AI在线

MCP生态崛起，六行代码打造智能AI代理

随着人工智能技术的飞速发展，模型上下文协议（Model Context Protocol，MCP）生态正在成为连接大语言模型(LLM)与外部工具的桥梁，赋予AI前所未有的操作能力。 MCP作为由Anthropic于2024年11月推出的开源协议，旨在标准化LLM与外部数据源和工具的交互方式。开发者们称其为“AI的USB-C接口”。

4/14/2025 10:01:22 AM

AI在线

王兴：美团已开发内部大模型LongCat 投资数十亿元GPU资源

近日，美团正式公布了其2024年第四季度及全年财务报告。据财报显示，美团在2024年全年实现了3376亿元人民币的营收，与去年同期相比增长了22%，彰显了公司稳健且持续的增长动力。在随后的业绩发布会上，美团首席执行官王兴详细阐述了公司对于人工智能（AI）领域的战略规划。

3/24/2025 4:00:41 PM

AI在线

AMD发布GAIA开源项目助力本地大语言模型高效运行

近日，AMD 宣布推出一款名为 GAIA 的开源应用，旨在为用户提供一种高效、本地化的方式来运行大语言模型（LLM）。目前，该应用已支持 Windows 平台，特别为锐龙 AI300系列处理器进行了优化，充分发挥了这些处理器在 AI 任务中的优势。 GAIA 是一个生成式 AI 应用，用户可以在个人电脑上私密地运行 LLM，确保数据隐私。

3/24/2025 9:40:00 AM

AI在线

在人工智能领域，大语言模型（LLM）正在不断进化，最近，卡内基梅隆大学(CMU)与 HuggingFace 的研究者们共同提出了一种名为 “元强化微调”(Meta Reinforcement Fine-Tuning，简称 MRT)的新方法。这一方法旨在优化大语言模型在测试时的计算效率，尤其是在解决复杂推理问题时，表现尤为突出。研究表明，现有的大语言模型在推理过程中常常消耗过多的计算资源，而 MRT 的目标是让模型在给定的计算预算内，实现更高效的答案发现。

3/13/2025 11:37:00 AM

AI在线

Firecrawl推出LLM.txt API：提供网址即可生成任意网站的LLM.txt

近日，Firecrawl 推出了一项全新的功能 ——LLMs.txt 生成器接口（Alpha 版），旨在帮助用户将任何网站的内容转化为清晰、适用于大语言模型(LLM)训练的文本文件。用户只需提供一个网站的 URL，Firecrawl 便会对该网站及其链接页面进行抓取，生成两种格式的文本文件:llms.txt 和 llms-full.txt，便于后续的分析和训练。该生成器的工作流程相对简单。

3/10/2025 9:48:00 AM

AI在线

资讯热榜

上海AI实验室开源InternVL3系列多模态大型语言模型「交交」媲美GPT-4o！上海交大推出口语对话情感大模型，首个纯学术界自研！ Haisnap横空出世，小白用户也能轻松打造AI应用 kimi开源视觉语言模型 Kimi-VL 与 Kimi-VL-Thinking，多项基准超越 GPT-4o 本地部署DeepSeek+DiFy平台构建智能体应用韩国初创公司 RLWRLD 获 1480 万美元融资，致力于机器人基础模型开发 ChatGPT重磅更新：新增图像库功能，可查看自己用GPT生成的所有图片击败DeepSeek-R1！豆包新推理模型仅用前者参数量1/3！还将开源两个基准，瞄准通用推理能力！

标签云

人工智能 OpenAI AIGC AI ChatGPT DeepSeek AI绘画数据机器人谷歌模型大模型 Midjourney 智能用户学习开源 GPT 微软 Meta AI创作图像技术论文 Stable Diffusion 马斯克 Gemini 算法蛋白质生成式芯片代码英伟达神经网络腾讯计算研究 Sora AI for Science 3D Anthropic AI设计机器学习 GPU 开发者场景华为预测伟达 Transformer 百度苹果深度学习 AI视频模态人形机器人驾驶 xAI 文本搜索字节跳动大语言模型 Copilot Claude 具身智能神器推荐 LLaMA 算力安全应用视频生成科技视觉亚马逊干货合集 2024 AGI 特斯拉 DeepMind 训练

大语言模型(LLM)

清华与上海 AI Lab 联合打造新型过程奖励模型GenPRM，让小模型超越 GPT-4o

MCP生态崛起，六行代码打造智能AI代理

王兴：美团已开发内部大模型LongCat 投资数十亿元GPU资源

AMD发布GAIA开源项目 助力本地大语言模型高效运行

CMU 团队推出元强化微调：提升大语言模型推理能力的新范式

Firecrawl推出LLM.txt API：提供网址即可生成任意网站的LLM.txt

AMD发布GAIA开源项目助力本地大语言模型高效运行