田渊栋

田渊栋团队论文火了！连续思维链优于CoT，打开LLM推理新范式

一个非常简单的更改，就能提高 LLM 推理能力。在认知科学领域，关于语言是用于思考还是用于交流的辩论一直持续。随着 LLM 和 CoT 的兴起，语言已经成为机器推理的默认媒介 —— 但它真的是最佳方法吗？

12/11/2024 8:54:00 PM

机器之心

在 AI 最火热的时候，AI 大牛田渊栋写了本小说《破晓之钟》

“在 AI 最火热的时候，我写了本小说。”这话不是别人说的，这话是 AI 大牛田渊栋说的。这个名字可能不彰显于大众媒体，但在计算机和 AI 领域，几乎是判别式一样的存在。至少在华人科学家面孔中，盘点谷歌无人车时绕不过他，盘点围棋 AI 时绕不过他，梳理巨头 Meta 的 AI 人才时也遗漏不了他。田渊栋现在是 Meta AI Research（FAIR）研究科学家总监，正在带队研究，如何让 AI 在推理和规划问题上，产生现有的大模型产生不了的能力。他是上海交大校友，在计算机系获得了本科和硕士学位，其后又进一步到了

8/23/2024 12:06:20 PM

清源

田渊栋等人新作：突破内存瓶颈，让一块4090预训练7B大模型

只用 24G 显存，消费级 GPU 就能搞定大模型了。上个月，Meta FAIR 田渊栋参与的一项研究广受好评，他们在论文《 MobileLLM: Optimizing Sub-billion Parameter Language Models for On-Device Use Cases》中开始卷 10 亿以下参数小模型，主打在移动设备上运行 LLM。3 月 6 日，田渊栋又一项研究出炉，这次，他们主攻 LLM 内存效率。除了田渊栋本人，还有来自加州理工学院、德克萨斯大学奥斯汀分校以及 CMU 的研究者。他们合

3/8/2024 2:56:00 PM

机器之心

资讯热榜

上海AI实验室开源InternVL3系列多模态大型语言模型 Haisnap横空出世，小白用户也能轻松打造AI应用「交交」媲美GPT-4o！上海交大推出口语对话情感大模型，首个纯学术界自研！ OpenAI开源超Agent:Codex CLI,五小时内破 5000 颗星 ChatGPT重磅更新：新增图像库功能，可查看自己用GPT生成的所有图片本地部署DeepSeek+DiFy平台构建智能体应用 OPPO 小布助手网页版上线，接入满血版 DeepSeek kimi开源视觉语言模型 Kimi-VL 与 Kimi-VL-Thinking，多项基准超越 GPT-4o

标签云

人工智能 OpenAI AIGC AI ChatGPT DeepSeek AI绘画数据机器人谷歌模型大模型 Midjourney 智能用户学习开源 GPT 微软 Meta AI创作图像技术论文 Stable Diffusion 马斯克 Gemini 算法蛋白质生成式芯片代码英伟达腾讯神经网络计算研究 Sora AI for Science 3D Anthropic AI设计机器学习 GPU 开发者场景华为预测伟达 Transformer 百度苹果深度学习 AI视频模态人形机器人 xAI 驾驶字节跳动文本搜索大语言模型 Claude Copilot 具身智能神器推荐 LLaMA 算力安全应用视频生成科技视觉亚马逊干货合集 2024 AGI 特斯拉训练大型语言模型