图像
还记得让马斯克一键「穿越」的利器吗?现在面向所有人开放!免费!
机器之能报道编辑:吴昕还记得一周前我们介绍过的那个文生图工具吗?对,让马斯克「穿越」,变身古风大侠的那个。也是让 Blackpink Jennie 「变胖」的那个:当时, Ideogram 官宣成立并公开了测试版 v0.1 。机器之能赶紧排队注册,试用了一下。据说,短短一周内,积累了超过 90,000 名用户,生成了超过 300 万张图像!今天, Ideogram 进一步宣布向地球上的每个人开放 Ideogram !免费的,没有任何限制!(传送门 )官方博客也第一次介绍了 Ideogram v0.1 —— 「它是
8/30/2023 6:22:00 PM
机器之能
全面开放,无需排队,Runway视频生成工具Gen-2开启免费试用
国内外其他公司也纷纷发力,把手里的技术封装成一个个人人可用的 AIGC 产品,Runway 前几个月发布的 Gen-1、Gen-2 便是其中之一。
7/25/2023 2:28:00 PM
机器之心
CVPR23 Highlight | 多模态新任务、新数据集:NTU提出广义引用分割问题GRES
引用表达分割(Referring Expression Segmentation,简称引用分割或RES)是一个基础的视觉语言多模态任务。给定一张图像和一个描述该图像中某个对象的自然语言表达式,RES旨在找到该目标对象并将其分割。现有的引用分割数据集和方法通常仅支持单目标表达式,即一个表达式指代一个目标对象。而对于多目标和无目标表达式的情况,则没有考虑在内。严重限制了引用分割的实际应用。基于这个问题,来自新加坡南洋理工大学的研究者们定义了一个名为广义引用分割(Generalized Referring Expression Segmentation,GRES)的新任务,将经典的引用分割扩展到允许表达式指代任意数量的目标对象。同时,文章还构建了第一个大规模的GRES数据集gRefCOCO,其同时包含多目标、无目标和单目标表达式。
6/30/2023 4:59:00 PM
MMLab
论文插图也能自动生成了,用到了扩散模型,还被ICLR接收
如果论文中的图表不用绘制,对于研究者来说是不是一种便利呢?有人在这方面进行了探索,利用文本描述生成论文图表,结果还挺有模有样的呢!
6/26/2023 2:11:00 PM
机器之心
像相机一样变焦、填充画面细节,还能自定义风格,AI作画神器Midjourney又更新了
这次,Midjourney 5.2 又给用户带来了新的惊喜!
6/24/2023 12:28:00 PM
机器之心
华盛顿大学医学院放射系助理教授朱成成实验室招收博士后、博士生、科研助理和实习生
本期将为大家介绍新华盛顿大学医学院放射系助理教授朱成成实验室招收博士后,博士生,科研助理和实习生的相关信息。
6/3/2023 12:54:00 PM
机器之心
利用 PRIMO 重构 M87 黑洞图像,普林斯顿高等研究院成功将「甜甜圈」变身「金戒指」
内容一览:2019 年,「事件视界望远镜 (Event Horizon Telescope,简称 EHT)」全球研究团队发布了人类历史上第一张黑洞照片,受限于当时的观测条件,这张黑洞图像只呈现出一个模糊不清的轮廓。近日,天体物理学期刊《The Astrophysical Journal Letters》上发布了一篇基于 PRIMO 算法 重构 M87 黑洞图像的论文,该研究成果带来了更加清晰的黑洞图像。
关键词:M87 黑洞 PRIMO 算法 PCA
5/31/2023 9:57:00 PM
HyperAI超神经
谷歌下场优化扩散模型,三星手机运行Stable Diffusion,12秒内出图
Speed Is All You Need:谷歌提出针对 Stable Diffusion 一些优化建议,生成图片速度快速提升。Stable Diffusion 在图像生成领域的知名度不亚于对话大模型中的 ChatGPT。其能够在几十秒内为任何给定的输入文本创建逼真图像。由于 Stable Diffusion 的参数量超过 10 亿,并且由于设备上的计算和内存资源有限,因而这种模型主要运行在云端。在没有精心设计和实施的情况下,在设备上运行这些模型可能会导致延迟增加,这是由于迭代降噪过程和内存消耗过多造成的。如何在设
4/27/2023 2:25:00 PM
机器之心
DALL-E发明者受访:我对其两年来产生的影响感到惊讶
在 DALL-E 2、Stable Diffusion 和 Midjourney 出现之前,该领域仅有一篇论文,即《零样本文本到图像生成》(Zero-Shot Text-to-Image Generation)。
1/24/2023 1:12:00 PM
机器之心
多模态文档LayoutLM版面智能理解技术演进-纪传俊
LayoutLM经过从1.0到3.0版本的迭代,不断优化模型,可见多模态技术对于文档理解的可行性和未来巨大的潜力未读抱拳拒绝赞感谢找文档图片文件@消息更多酷应用
12/20/2022 3:28:00 PM
达观数据
把游戏AI用于疾病诊断,腾讯AI Lab一研究成果登上国际顶会
12月19日,腾讯AI Lab发布其决策智能 AI 「绝悟」的最新成果「绝悟RLogist」,将 AI 深度强化学习技术迁移到病理全片扫描图像诊断领域,在性能接近的情况下,将传统病理阅片效率提升400%。该研究相关论文被国际人工智能顶级学术会议 「AAAI 2023」接收,代码已开源。「绝悟」AI 是腾讯将游戏场景与人工智能技术进行融合研究的核心探索之一,此前先后在 MOBA、RTS、3D开放世界(Minecraft)等多类型游戏中取得了业界领先的研究成果,证明了其在游戏复杂环境中较为优秀的决策智能水平。本次发布的
12/20/2022 10:56:00 AM
新闻助手
资讯热榜
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
DeepSeek
AI绘画
数据
机器人
谷歌
模型
大模型
Midjourney
智能
用户
学习
GPT
开源
微软
Meta
AI创作
图像
技术
论文
Stable Diffusion
马斯克
Gemini
算法
蛋白质
生成式
芯片
代码
英伟达
神经网络
腾讯
计算
研究
Sora
AI for Science
3D
AI设计
Anthropic
机器学习
GPU
开发者
场景
华为
预测
伟达
Transformer
百度
深度学习
模态
苹果
AI视频
驾驶
文本
搜索
xAI
人形机器人
Copilot
神器推荐
LLaMA
大语言模型
具身智能
字节跳动
Claude
算力
安全
应用
视频生成
科技
视觉
干货合集
亚马逊
2024
AGI
特斯拉
DeepMind
架构