-
Move AI推全新Move API 可轻松实现2D转3D
2月26日讯 Move AI近日推出了全新的Move API,该API可以轻松从2D视频中捕捉生成3D运动数据。用户只需使用单一相机即可捕捉人物动作,操作简单,只需上传视频文件即可完成整个过程。Move API自动将视频转换为3D人类运动数据,并提供即时预览,支持导出多种3D文件格式,包括usdz、usdc和fbx,为用户提供了广泛的应用可能性。 产品入口:https://www.move.ai/…... 魔果智讯
- 0
- 0
- 185
-
可让照片人物“开口说话”,阿里巴巴研究团队推出 AI 框架“EMO”
3月1日讯 阿里巴巴研究团队近日发布了一款名为“EMO(Emote Portrait Alive)”的 AI 框架,该框架号称可以用于“对口型”,只需要输入人物照片及音频,模型就能够让照片中的人物开口说出相关音频,支持中英韩等语言。 据悉,EMO 基于英伟达的 Audio2Video 扩散模型打造,号称使用了超过 250 小时的专业视频进行训练,从而得到了相…... 魔果智讯
- 0
- 0
- 99
-
苹果推出AI动画设计工具Keyframer 可将静态图片转为动画
2月19日讯 大型语言模型(LLMs)在动画设计领域的应用具有巨大潜力,但面临着挑战。苹果团队最近发布了一篇论文,宣布推出了一款名为Keyframer的AI动画设计工具。这款工具的功能是可以根据用户输入的提示词,将静态的2D图片转换为动画。 用户可以通过自然语言提示和直接编辑生成的输出来探索和细化动画设计。除了支持顺序提示和直接编辑外,用户还可以请求设计变体以支持比较和构思。 论文地址:https…... 魔果智讯
- 0
- 0
- 87
-
MAIA 新系统亮相:洞悉 AI 模型内在机制,审查其安全性
7月25日讯 麻省理工学院计算机科学与人工智能实验室的研究人员开发了一种名为“MAIA”的多模式自动化可解释性代理系统,该系统可以使用视觉语言模型来自动执行各种神经网络可解释性任务。 麻省理工学院(MIT)计算机科学与人工智能实验室(CSAIL)最新研发了名为 MAIA 系统,可以使用视觉语言模型来自动执行各种神经网络可解释性任务。 MAIA 的全称是 Multimodal Automated I…... 魔果智讯
- 0
- 0
- 72
-
Patronus 推出 CopyrightCatcher API,可检测 AI 模型中“版权内容”
3月9日讯 致力于开发大语言模型(LLM)评估工具的 Patronus AI 日前发布了一款名为“CopyrightCatcher”的 API,可用来检测大语言模型的输出结果中是否含有侵权内容,目前相关工具 DEMO 已经放出,感兴趣的小伙伴可以点此访问下载。 Patronus AI 表示,市面上常见的大语言模型的训练数据中经常含有受到版权保护的内容,因此这些模型很容易输出相应版权内容,…... 魔果智讯
- 0
- 0
- 136
-
Stability AI推Stable Video3D(SV3D)传图可生成3D视频
3月19日讯 Stability AI 推出了 Stable Video3D(SV3D),这是一款用于生成3D 视频的新型 gen AI 工具。SV3D 是在稳定 AI 之前的 Stable Video 技术基础上开发的,该技术使用户能够从图像或文本提示中生成短视频。SV3D 构建在Stability AI 先前的 Stable Video Diffusion 模型基础上,针对新视角合成和3D 生…... 魔果智讯
- 0
- 0
- 164
-
普林斯顿首个「开源」AI程序员进场 基于GPT-4,可自动修复bug
4月3日 消息:普林斯顿大学最近推出了一款名为SWE-agent的AI程序员,这是世界上首个开源的AI程序员,它基于GPT-4技术,能够在GitHub仓库中自动修复bug。这个智能体-计算机接口(ACI)的诞生,标志着AI在软件工程领域的应用迈出了重要一步。 SWE-agent在SWE-bench测试集上的表现令人瞩目,它成功解决了12.29%的问题,平均耗时仅为93秒,准确率与之前推出的AI程序…... 魔果智讯
- 0
- 0
- 77
-
OpenAI 扩展 ChatGPT AI 深度研究连接器,集成微软 OneDrive 和 SharePoint
5月13日讯 OpenAI 昨日(5 月 12 日)更新 ChatGPT 日志文件,宣布面向 ChatGPT Plus、Pro 和 Team 用户(EEA、瑞士和英国除外),扩展 ChatGPT AI 聊天机器人深度研究连接器,集成微软 OneDrive 和 SharePoint。 此前报道,OpenAI 推出了 ChatGPT 的首个“深度研究连接器”(deep research connect…... 魔果智讯
- 0
- 0
- 127
-
腾讯混元发布开源文生图大模型混元DiT加速库 生图时间缩短75%
6月6日讯 腾讯混元发布了针对开源文生图大模型混元 DiT 的加速库,可将推理时间缩短75%,生图时间大幅缩短。 混元 DiT 模型也已部署至 Hugging Face Diffusers 通用模型库,用户可通过三行代码调用模型,无需下载原始代码。 通过知识蒸馏和 TensorRT 高性能推理框架,实现了 DiT 模型的采样步数压缩与高效推理部署,推理时间缩短75%。 用户可基于 ComfyUI …... 魔果智讯
- 0
- 0
- 191
-
AI音乐生成工具AI Jukebox 输入提示词选择曲风即可创作音乐
4月23日讯 AI Jukebox 是一个利用人工智能技术的音乐生成工具,它通过Hugging Face平台提供服务。这个工具的设计理念在于简化音乐创作过程,使其变得更加智能化和用户友好。 主要功能特点: 本地化模型加载:用户打开AI Jukebox的网页后,系统会自动加载一个大约700MB大小的生成模型,这意味着用户不需要进行复杂的设置或安装过程。 基于提示词的音乐生成:用户可以通过输入特定的提…... 魔果智讯
- 0
- 0
- 196
-
AI视频生成工具ID-Animator:可保持角色一致生成视频动画
4月25日讯 近年来,生成具有指定身份的高保真人类视频引起了广泛关注。然而,现有技术在训练效率和身份保持之间往往难以取得平衡,要么需要繁琐的逐案微调,要么在视频生成过程中通常会丢失身份细节。研究提出了一种名为 ID-Animator 的零样本人类视频生成方法,可以在无需进一步训练的情况下执行个性化视频生成,只需单个参考面部图像即可。 ID-Animator是一种零样本个性化视频生成方法,可以根据单…... 魔果智讯
- 0
- 0
- 229
-
腾讯AI实验室开发新型智能体框架TRANSAGENTS 专用于处理超长文学内容的翻译工作
5月23日讯 腾讯AI实验室开发的"TRANSAGENTS"是一个创新的多智能体框架,专门设计用于处理超长文学内容的翻译工作。这个系统通过创建一个虚拟的翻译出版公司来模拟真实的翻译流程,其中包含多个具有不同职责和专业技能的虚拟角色。 以下是TRANSAGENTS系统的主要特点: 多智能体框架:系统由多个虚拟角色组成,每个角色扮演翻译流程中的不同角色,如高级编辑、初级编辑和翻译员…... 魔果智讯
- 0
- 0
- 90
-
阿里国际推出AI虚拟试衣工具,1分钟内搞定
5月15日讯 阿里国际旗下的 Pic Copilot 推出了一款 AI 虚拟试衣工具,帮助服饰商家省去拍摄成本。 商家需要上传一张平铺的上衣图片,并选择模特,AI 虚拟试衣功能就可以在1分钟内将商品穿在模特身上,并搭配风格匹配的下装。该功能可以根据模特姿势还原服装的形变、皱、材质等细节,并输出堪比专业棚拍的上半身和全身商品图。 除了上传上装和下装的图片,虚拟试衣功能还可以识别单件连身的服装,如潜水…... 魔果智讯
- 0
- 0
- 274
-
Adobe 推出“数据讲故事”利器 Project Slide Wow:AI 自动转换企业数据至精美 PPT
3月21日讯 Adobe 公司最新推出名为 Project Slide Wow 的全新 AI 工具,帮助企业将原始客户数据自动转化为 PowerPoint 演示文稿。 该工具目前处于预览阶段,已集成到 Adobe 的 Customer Journey Analytics(CJA)中,能够自动生成包含演讲者笔记、数据可视化和格式化布局的幻灯片。 Adobe 将其定位为营销团队、分析师和高管的理想解决…... 魔果智讯
- 0
- 0
- 104
-
Stability AI推出全面的API服务,引领图像处理新时代
3月22日讯 近日,Stability AI宣布推出一套全新的API服务,旨在提供更全面、更高效的图像处理服务。这一举措无疑将为图像处理领域带来一场革命。 详细内容:https://stability.ai/news/image-services-on-stability-ai-developer-platform 这套API服务包含以下几个主要功能: 首先,它提供了Stable Diffusio…... 魔果智讯
- 0
- 0
- 147
-
Grammarly 收购 AI 公司 Coda,将为企业推出大模型 LLM 助手 / 语法检查工具
12月20日讯 小伙伴们可能有用过 Grammarly 工具提供的“语法检测”服务,这一工具对于英文书信等场合较为友好,而根据 Grammarly 官方新闻稿,该公司现已收购一家 AI 初创公司 Coda,将涉足 AI 生产力领域。 在所有收购程序完成后,Coda 现任首席执行官 Shishir Mehrotra 将接任 Grammarly 的新首席执行官,而现任 CEO Rahul Roy-Ch…... 魔果智讯
- 0
- 0
- 123
-
OpenAI ChatGPT 推首个深度研究连接器,可 AI 洞察 GitHub 代码库
5月9日讯 科技媒体 maginative 昨日(5 月 8 日)发布博文,报道称 OpenAI 推出了 ChatGPT 的首个“深度研究连接器”(deep research connector),实现与 GitHub 的深度整合。 开发者现在可以直接将自己的 GitHub 代码库连接到 ChatGPT,AI 将深入分析代码结构、实现模式以及相关文档,快速生成详细的研究报告或技术总结。 OpenA…... 魔果智讯
- 0
- 0
- 65
-
联发科推出生成式 AI 服务平台“达哥”,支持“最强繁体中文大模型”MR BreeXe
4月9日讯 据联发科官方消息,在今日举行的生成式 AI 论坛期间,联发科生成式 AI 服务平台 MediaTek DaVinci 正式推出,亦称“联发科技达哥”,目前已有超过 40 家厂商加入其生态系统。 据悉,该工具最初为集团内部生成式 AI 工具,被广泛应用于软件开发的需求分析和规格设计、人资的自动媒合、财务的报销流程、法务的专利翻译和合约诉讼等,集团渗透率达到 96%。 同时,联发创新基地还…... 魔果智讯
- 0
- 0
- 161
-
Anthropic 开源 AI 安全分析框架 Petri,利用 Agent 代理人测试主流模型潜在不对齐风险
10月14日讯 Anthropic 于 10 月 6 日宣布开源全新的模型安全分析框架 Petri,该框架可调用自动化稽核 AI Agent,与目标模型进行多轮互动,以探索并检测模型在各种高风险情境下的潜在弱点。 Anthropic 表示,随着 AI 模型能力与应用范围持续扩张,相应模型的风险性也急剧增加,如今人工分析已无法应对 AI 模型庞大的行为组合空间。因此,该公司在过去一年内开发出“自动化…... 魔果智讯
- 0
- 0
- 62
-
Midreal AI互动小说游戏网页版本更新 更遵循指令,逻辑也更强
4月8日讯 近期,Midreal AI互动小说游戏进行了一次重要的更新,推出了全新的网页版本。这一版本的发布使得用户不再需要在Discord平台上进行操作,大大提高了用户的使用便利性。 在这次更新中,Midreal AI引入了一项新的功能——为每一句话生成对应的图片。这意味着,用户现在可以以图像的形式展示小说的每一句话,这对于制作视频小说来说是一个极大的突破。亲测效果还不错。 产品入口:https…... 魔果智讯
- 0
- 0
- 236
-
Perplexica 是 Perplexity.ai 的开源 AI 搜索引擎替代品
6月11日讯 Perplexica 是一个开源项目,旨在提供一个隐私保护的 AI 搜索引擎,作为 Perplexity AI 等专有选项的替代方案。它利用大型语言模型(LLMs)和人工智能功能,提供了一个开放的搜索解决方案。 产品入口:https://github.com/ItzCrazyKns/Perplexica Perplexica 使用 LLMs 结合机器学习算法(如相似性搜索和嵌入模型)…... 魔果智讯
- 0
- 0
- 76
-
Meta 开源 LlamaFirewall 防护工具,助力构建安全 AI 智能体
5月9日讯 Meta AI 公司最新推出 LlamaFirewall,应对 AI 智能体不断演变的威胁格局,为生产环境中的 AI 智能体提供系统级安全保护。 随着大型语言模型(LLMs)嵌入 AI 智能体并被广泛应用于高权限场景,安全隐患随之增加。这些智能体可以读取邮件、生成代码、调用 API,一旦被恶意利用,后果不堪设想。 传统的安全机制,如聊天机器人内容审核或硬编码模型限制,已无法满足具备广泛…... 魔果智讯
- 0
- 0
- 85
-
提升 1.5~20 倍吞吐量,字节豆包大模型团队与香港大学发布并开源全新 RLHF 框架
11月3日讯 字节跳动豆包大模型团队与香港大学公开联合研究成果 —— HybridFlow。 官方宣称,HybridFlow(开源项目名:veRL)是一个灵活且高效的大模型 RL 训练框架,兼容多种训练和推理框架,支持灵活的模型部署和多种 RL 算法实现。 该框架采用混合编程模型,融合单控制器(Single-Controller)的灵活性和多控制器(Multi-Controller)的高效性,可更…... 魔果智讯
- 0
- 0
- 73
-
月之暗面 Kimi 联合清华大学等开源大模型推理架构 Mooncake
11月28日讯 月之暗面 Kimi 和清华大学 MADSys 实验室 2024 年 6 月联合发布了 Kimi 底层的 Mooncake 推理系统设计方案。该系统基于以 KVCache 为中心的 PD 分离和以存换算架构,提升了推理吞吐量。 近日,为了进一步加速该技术框架的应用与推广,月之暗面 Kimi 和清华大学 MADSys 实验室联合 9#AISoft、阿里云、华为存储、面壁智能、趋境科技等…... 魔果智讯
- 0
- 0
- 182























































