图像

还记得让马斯克一键「穿越」的利器吗？现在面向所有人开放！免费！

机器之能报道编辑：吴昕还记得一周前我们介绍过的那个文生图工具吗？对，让马斯克「穿越」，变身古风大侠的那个。也是让 Blackpink Jennie 「变胖」的那个：当时， Ideogram 官宣成立并公开了测试版 v0.1 。机器之能赶紧排队注册，试用了一下。据说，短短一周内，积累了超过 90,000 名用户，生成了超过 300 万张图像！今天， Ideogram 进一步宣布向地球上的每个人开放 Ideogram ！免费的，没有任何限制！（传送门）官方博客也第一次介绍了 Ideogram v0.1 —— 「它是

8/30/2023 6:22:00 PM

机器之能

解锁Midjourney隐藏技能：改改Prompt，四宫格就「裂变」了

我们离真正的「AI 电影」不远了？

8/21/2023 3:15:00 PM

机器之心

全面开放，无需排队，Runway视频生成工具Gen-2开启免费试用

国内外其他公司也纷纷发力，把手里的技术封装成一个个人人可用的 AIGC 产品，Runway 前几个月发布的 Gen-1、Gen-2 便是其中之一。

7/25/2023 2:28:00 PM

机器之心

苹果、俄勒冈州立提出AutoFocusFormer: 摆脱传统栅格，采用自适应下采样的图像分割

AFF 在小物体识别上向前再迈一步。

7/10/2023 2:41:00 PM

机器之心

CVPR23 Highlight | 多模态新任务、新数据集：NTU提出广义引用分割问题GRES

引用表达分割（Referring Expression Segmentation，简称引用分割或RES）是一个基础的视觉语言多模态任务。给定一张图像和一个描述该图像中某个对象的自然语言表达式，RES旨在找到该目标对象并将其分割。现有的引用分割数据集和方法通常仅支持单目标表达式，即一个表达式指代一个目标对象。而对于多目标和无目标表达式的情况，则没有考虑在内。严重限制了引用分割的实际应用。基于这个问题，来自新加坡南洋理工大学的研究者们定义了一个名为广义引用分割（Generalized Referring Expression Segmentation，GRES）的新任务，将经典的引用分割扩展到允许表达式指代任意数量的目标对象。同时，文章还构建了第一个大规模的GRES数据集gRefCOCO，其同时包含多目标、无目标和单目标表达式。

6/30/2023 4:59:00 PM

MMLab

论文插图也能自动生成了，用到了扩散模型，还被ICLR接收

如果论文中的图表不用绘制，对于研究者来说是不是一种便利呢？有人在这方面进行了探索，利用文本描述生成论文图表，结果还挺有模有样的呢！

6/26/2023 2:11:00 PM

机器之心

无人机+ AI 图像分析：里斯本大学高效检测林业害虫

林木虫害早预警

6/25/2023 6:03:00 PM

HyperAI超神经

像相机一样变焦、填充画面细节，还能自定义风格，AI作画神器Midjourney又更新了

这次，Midjourney 5.2 又给用户带来了新的惊喜！

6/24/2023 12:28:00 PM

机器之心

华盛顿大学医学院放射系助理教授朱成成实验室招收博士后、博士生、科研助理和实习生

本期将为大家介绍新华盛顿大学医学院放射系助理教授朱成成实验室招收博士后，博士生，科研助理和实习生的相关信息。

6/3/2023 12:54:00 PM

机器之心

利用 PRIMO 重构 M87 黑洞图像，普林斯顿高等研究院成功将「甜甜圈」变身「金戒指」

内容一览：2019 年，「事件视界望远镜 (Event Horizon Telescope，简称 EHT)」全球研究团队发布了人类历史上第一张黑洞照片，受限于当时的观测条件，这张黑洞图像只呈现出一个模糊不清的轮廓。近日，天体物理学期刊《The Astrophysical Journal Letters》上发布了一篇基于 PRIMO 算法重构 M87 黑洞图像的论文，该研究成果带来了更加清晰的黑洞图像。关键词：M87 黑洞 PRIMO 算法 PCA

5/31/2023 9:57:00 PM

HyperAI超神经

谷歌下场优化扩散模型，三星手机运行Stable Diffusion，12秒内出图

Speed Is All You Need：谷歌提出针对 Stable Diffusion 一些优化建议，生成图片速度快速提升。Stable Diffusion 在图像生成领域的知名度不亚于对话大模型中的 ChatGPT。其能够在几十秒内为任何给定的输入文本创建逼真图像。由于 Stable Diffusion 的参数量超过 10 亿，并且由于设备上的计算和内存资源有限，因而这种模型主要运行在云端。在没有精心设计和实施的情况下，在设备上运行这些模型可能会导致延迟增加，这是由于迭代降噪过程和内存消耗过多造成的。如何在设

4/27/2023 2:25:00 PM

机器之心

平息画师怒火：Stable Diffusion学会在绘画中直接「擦除」侵权概念

Stable Diffusion 学会了「偷天换日」的本领。

4/7/2023 8:46:00 PM

机器之心

AI知道你脑子里在想什么，还帮你画了出来，项目代码已开源

一个「所见即所思」的世界将是什么样子？

3/9/2023 9:50:00 AM

机器之心

DALL-E发明者受访：我对其两年来产生的影响感到惊讶

在 DALL-E 2、Stable Diffusion 和 Midjourney 出现之前，该领域仅有一篇论文，即《零样本文本到图像生成》（Zero-Shot Text-to-Image Generation）。

1/24/2023 1:12:00 PM

机器之心

AIGC时代已来，跨模态内容生成技术发展得怎么样了

最近一年里，AIGC 是人工智能领域里最火的词汇之一。

1/21/2023 10:39:00 AM

机器之心

PS上的开源Stable Diffusion插件来了：一键AI脑补，即装即用

网友：「它能颠覆整个行业。」

12/23/2022 2:20:00 PM

机器之心

多模态文档LayoutLM版面智能理解技术演进-纪传俊

LayoutLM经过从1.0到3.0版本的迭代，不断优化模型，可见多模态技术对于文档理解的可行性和未来巨大的潜力未读抱拳拒绝赞感谢找文档图片文件@消息更多酷应用

12/20/2022 3:28:00 PM

达观数据

把游戏AI用于疾病诊断，腾讯AI Lab一研究成果登上国际顶会

12月19日，腾讯AI Lab发布其决策智能 AI 「绝悟」的最新成果「绝悟RLogist」，将 AI 深度强化学习技术迁移到病理全片扫描图像诊断领域，在性能接近的情况下，将传统病理阅片效率提升400%。该研究相关论文被国际人工智能顶级学术会议「AAAI 2023」接收，代码已开源。「绝悟」AI 是腾讯将游戏场景与人工智能技术进行融合研究的核心探索之一，此前先后在 MOBA、RTS、3D开放世界（Minecraft）等多类型游戏中取得了业界领先的研究成果，证明了其在游戏复杂环境中较为优秀的决策智能水平。本次发布的

12/20/2022 10:56:00 AM

新闻助手

资讯热榜

企业级模型推理部署工具vllm使用指南 - 部署最新deepseek-v3-0324模型全能且实用！实战测评谷歌最新模型Gemini 2.5 Pro 大模型部署工具 Ollama 使用指南：技巧与问题解决全攻略基于 DeepSeek GRPO 的 1.5B Rust 代码生成模型训练实战 DeepSeek R1 vs OpenAI O3 vs Gemini 2 Pro—谁最适合做客服主管的AI 模态编码器|CLIP详细解读 50组多风格提示词，全面测评Midjourney V7生图效果！斯坦福2025 AI指数出炉！中美AI对决差距仅剩0.3%，DeepSeek领衔

标签云

人工智能 OpenAI AIGC AI ChatGPT DeepSeek AI绘画数据机器人谷歌模型大模型 Midjourney 智能用户学习 GPT 开源微软 Meta AI创作图像技术论文 Stable Diffusion 马斯克 Gemini 算法蛋白质生成式芯片代码英伟达神经网络腾讯计算研究 Sora AI for Science 3D AI设计 Anthropic 机器学习 GPU 开发者场景华为预测伟达 Transformer 百度深度学习模态苹果 AI视频驾驶文本搜索 xAI 人形机器人 Copilot 神器推荐 LLaMA 大语言模型具身智能字节跳动 Claude 算力安全应用视频生成科技视觉干货合集亚马逊 2024 AGI 特斯拉 DeepMind 架构