-
对标GPT4o!谷歌推出AI代理Project Astra 电影《她》将成真?
5月15日 消息:在"I/O2024"大会上,谷歌DeepMind推出了一款全新的AI代理产品Project Astra,标志着谷歌在生成式AI领域的又一重大进展。 Project Astra的推出被认为是打破现实与科幻界限的创新,让人联想到电影《她》和《星际迷航》系列中的人工智能。 Project Astra的关键特点 多模态实时推理:与OpenAI的GPT4o相似,Astr…... 魔果智讯
- 0
- 0
- 134
-
Grammarly 收购 AI 公司 Coda,将为企业推出大模型 LLM 助手 / 语法检查工具
12月20日讯 小伙伴们可能有用过 Grammarly 工具提供的“语法检测”服务,这一工具对于英文书信等场合较为友好,而根据 Grammarly 官方新闻稿,该公司现已收购一家 AI 初创公司 Coda,将涉足 AI 生产力领域。 在所有收购程序完成后,Coda 现任首席执行官 Shishir Mehrotra 将接任 Grammarly 的新首席执行官,而现任 CEO Rahul Roy-Ch…... 魔果智讯
- 0
- 0
- 123
-
天桥脑科学研究院团队自研的OMNE AI大模型框架登上基准测试GAIA榜首
天桥脑科学研究院(Tianqiao and Chrissy Chen Institute,TCCI)的 AI 团队在 AI 技术领域取得了重要进展。 近期,天桥脑科学研究院自研OMNE Multiagent大模型——是一个基于长期记忆(Long Term Memory, LTM)的多智能体协作框架,每个智能体拥有相同且独立的系统结构,能够自主学习和理解完整的世界模型,从而独立理解环境。基于LTM的…... 魔果智讯
- 0
- 0
- 78
-
AI电影生成工具LTX Studio将于3月27日发布
3月25日讯 LTX Studio是一款强大的一键生成电影的工具,它能够根据用户输入的简单文字提示和创意,生成完整的剧本,并将剧本直接转化为完整视频。这款工具的功能强大,不仅可以精确指导每个场景,还能生成角色演员、调整摄像机角度等。 内测入口:https://ltx.studio/ LTX Studio将于3月27日正式发布,官方已经放出了一些功能预告。其中,换脸功能是其一大亮点,用户可以上传一张…... 魔果智讯
- 0
- 0
- 157
-
苹果发布 Pico-Banana-400K 数据集:含 40 万张图像,帮助训练 AI 图像编辑模型
10月29日讯 苹果公司发布了 Pico-Banana-400K,这是一个包含 40 万张图像的研究数据集,有趣的是,该数据集是利用谷歌的 Gemini-2.5 模型构建的。 据了解,苹果的这个研究成果名为《Pico-Banana-400K:面向文本引导图像编辑的大规模数据集》(Pico-Banana-400K: A Large-Scale Dataset for Text-Guided Imag…... 魔果智讯
- 0
- 0
- 34
-
OpenAI推出DALL·E 3识别器、媒体管理器
5月8日讯 OpenAI在官网宣布,将推出面向其文生图模型DALL·E3的内容识别器,以及一个媒体管理器。 随着ChatGPT、DALL·E3等生成式AI产品被大量应用在实际业务中,人们越来越难分辨AI和人类创建内容的区别,这个识别器可以帮助开发人员快速识别内容的真假。 目前,OpenAI已经开放了DALL·E3识别器的API,开发人员从今天开始至7月31日可申请试用。OpenAI会在8月31日之…... 魔果智讯
- 0
- 0
- 82
-
全新 ARC-AGI-2 测试登场:AI 模型得分惨淡,被人类碾压
3月25日讯 Arc Prize 基金会是一家由知名人工智能研究员弗朗索瓦・肖莱(François Chollet)共同创立的非营利组织,该基金会于本周一在其博客上宣布推出一个名为 ARC-AGI-2 的全新测试,旨在衡量领先人工智能模型的通用智能水平。这项测试的难度极高,截至目前,大多数 AI 模型都在该测试中表现不佳。 根据 Arc Prize 排行榜的数据显示,以推理能力著称的 AI 模型,…... 魔果智讯
- 0
- 0
- 168
-
OpenAI ChatGPT 推首个深度研究连接器,可 AI 洞察 GitHub 代码库
5月9日讯 科技媒体 maginative 昨日(5 月 8 日)发布博文,报道称 OpenAI 推出了 ChatGPT 的首个“深度研究连接器”(deep research connector),实现与 GitHub 的深度整合。 开发者现在可以直接将自己的 GitHub 代码库连接到 ChatGPT,AI 将深入分析代码结构、实现模式以及相关文档,快速生成详细的研究报告或技术总结。 OpenA…... 魔果智讯
- 0
- 0
- 63
-
天猫向家装家电商家提供免费AI工具:千牛上线“家作”功能
4月28日讯 在解决家装家电行业商家经营创作所面临的挑战方面,天猫近期采取了一系列创新举措。 4月26日,天猫宣布面向全平台家装家居家电商家免费开放AIGC和3D技术,推出了包括3D互动展厅、AI虚拟棚拍、AI模特以及AI扩图在内的四大功能,旨在帮助商家实现降本增效的目标。 这一举措的实施让商家们受益匪浅。商家们只需在千牛平台搜索“家作”,无需搭建复杂的摄影棚,只需上传一张普通的商品图,即可利用A…... 魔果智讯
- 0
- 0
- 160
-
Mobile-Agent-v2:让AI学会自动刷手机
6月6日讯 Mobile-Agent-v2是一个先进的AI系统,旨在通过自动化操作和视觉感知技术,实现对移动设备的全面控制。这一系统能够模拟真人的各种交互行为,如点击、滑动和输入等,从而自动化地完成一系列复杂的任务。 以下是Mobile-Agent-v2能够实现的一些关键功能示例: 搜索和购买商品:AI可以在购物应用中自动搜索特定商品,将其添加到购物车,并执行购买操作。 邮件发送:在Gmail等邮…... 魔果智讯
- 0
- 0
- 44
-
Midreal AI互动小说游戏网页版本更新 更遵循指令,逻辑也更强
4月8日讯 近期,Midreal AI互动小说游戏进行了一次重要的更新,推出了全新的网页版本。这一版本的发布使得用户不再需要在Discord平台上进行操作,大大提高了用户的使用便利性。 在这次更新中,Midreal AI引入了一项新的功能——为每一句话生成对应的图片。这意味着,用户现在可以以图像的形式展示小说的每一句话,这对于制作视频小说来说是一个极大的突破。亲测效果还不错。 产品入口:https…... 魔果智讯
- 0
- 0
- 236
-
AI“P 图”爆火出圈:“Nano Banana”一周为谷歌 Gemini 吸引千万新用户
9月5日讯 谷歌最新的 AI 实验项目“Nano Banana”突然在上周爆火,然后谷歌宣布在 Gemini 上线了 Gemini 2.5 Flash Image 集成。 昨晚,谷歌实验室副总裁 Josh Woodward 在 X 上透露,自该功能上线以来,累计已完成超 2 亿次图像编辑,带动超 1000 万新用户尝试 Gemini 应用。对于这款产品的受欢迎程度,他形容称内部“TPU 严重过载,…... 魔果智讯
- 0
- 0
- 51
-
提升 1.5~20 倍吞吐量,字节豆包大模型团队与香港大学发布并开源全新 RLHF 框架
11月3日讯 字节跳动豆包大模型团队与香港大学公开联合研究成果 —— HybridFlow。 官方宣称,HybridFlow(开源项目名:veRL)是一个灵活且高效的大模型 RL 训练框架,兼容多种训练和推理框架,支持灵活的模型部署和多种 RL 算法实现。 该框架采用混合编程模型,融合单控制器(Single-Controller)的灵活性和多控制器(Multi-Controller)的高效性,可更…... 魔果智讯
- 0
- 0
- 67
-
智能笔记应用Voicenotes 支持AI搜索语音笔记
5月13日讯 Voicenotes 是一款以录音为核心的智能笔记应用程序,它通过先进的人工智能技术,为用户提供了一个方便快捷的记录和搜索语音笔记的平台。 核心功能: 录音功能:用户可以随时随地录制自己的想法和信息。 AI 转录:录音可以自动转录为文本,利用最新的人工智能技术,确保高准确率。 查询功能:用户可以通过 AI 搜索语音笔记中的任何词汇,快速找到所需内容。 笔记管理:支持对录音及其转录文本…... 魔果智讯
- 0
- 0
- 133
-
Stability AI推出全面的API服务,引领图像处理新时代
3月22日讯 近日,Stability AI宣布推出一套全新的API服务,旨在提供更全面、更高效的图像处理服务。这一举措无疑将为图像处理领域带来一场革命。 详细内容:https://stability.ai/news/image-services-on-stability-ai-developer-platform 这套API服务包含以下几个主要功能: 首先,它提供了Stable Diffusio…... 魔果智讯
- 0
- 0
- 147
-
UI设计师福音!Creatie只要选择区域输入需求即可让AI完成UI设计
3月19日讯 Creatie.ai 是一个由设计师领导的小型团队开发的人工智能赋能的设计工具,旨在通过最先进的AI技术,帮助设计师在UI/UX设计流程的各个方面,从线框图到模型图,从情绪板到插图。这个工具的核心理念是利用AI的变革潜力来增强设计过程,而不是取代它,从而实现创作的民主化和加速流程。 体验地址:https://creatie.ai/ Creatie.ai 提供了一系列功能,包括: AI…... 魔果智讯
- 0
- 0
- 95
-
AI制作故事视频平台LTX Studio: 给出主题就能生成画面一致视频
4月18日讯 LTX Studio 是一款综合性的、由人工智能驱动的电影制作平台。你只需要写一个故事主题,然后由AI生成故事和能保持画面一致的主角(支持手动换脸),然后根据故事画出一张张分镜,每张分镜支持生成视频和编辑,导出合并就是一个完整的故事短片。 该平台具有多项功能,其中包括了对镜头角度的精准控制、将简单想法或完整剧本转化为详细视频制作、保持角色一致性和风格、以及一键生成带有特效、音乐和配音…... 魔果智讯
- 0
- 0
- 285
-
AI图案生成器Ideogram Tile:文本生成无缝重复的图案
5月24日讯 人工智能初创公司 Ideogram 以其先进的文本转图像生成功能而闻名,如今宣布其平台迎来重大升级:Ideogram Tile。这一新功能允许用户从单个文本提示中创建无缝重复的图案,为设计师、艺术家和企业开辟了无限可能。 使用 Ideogram Tile,用户只需用自然语言描述其想法,便可生成复杂的墙纸、沉浸式景观和无尽的纹理。这款 AI 驱动工具将文本提示转化为可在各种布局中平铺的…... 魔果智讯
- 0
- 0
- 133
-
Advisory与ChatGPT开发者合作推出生成式AI工具NoraGPT
2月18日讯 Advisory与ChatGPT开发者OpenAI合作,于2月16日推出了一款名为NoraGPT的生成式人工智能(AI)工具。该工具在Advisory的安全环境中得以应用,以确保员工和客户的数据保护。NoraGPT具备人类般的记忆能力,包括长期和“永久”记忆,与Advisory自身的AI解决方案相一致,并对文件管理提供支持。 Advisory首席执行官Kevin Lavin在接受路透…... 魔果智讯
- 0
- 0
- 126
-
摩尔线程开源 OpenCV-MUSA:支持绝大部分 cv::cuda 命名空间下数据结构及 API
9月20日讯 摩尔线程宣布其自研统一系统架构 MUSA 已完成与开源计算机视觉库 OpenCV 的适配,并正式发布 OpenCV-MUSA 开源项目。 OpenCV 作为计算机视觉领域最重要的开源库之一,为图像和视频处理的开发者和研究人员提供了强大且灵活的工具。OpenCV 在自动驾驶、医疗影像、安防监控、机器人视觉、增强现实和图像识别等多个领域得到广泛应用。 在现有 OpenCV 代码的基础上,…... 魔果智讯
- 0
- 0
- 95
-
AI 初创公司推出 Nous Chat 聊天机器人,底层基于 Meta Llama 3.1 打造
11月11日讯 AI 初创公司 Nous Research 近期推出了一款名为 Nous Chat 的 AI 聊天机器人,该机器人基于 Meta Llama 3.1 微调而成的“Hermes 3-70B”模型打造,号称在“模型架构、数据合成、微调和推理”方面均进行深入改进,致力于“以人为本”。 据悉,Nous Chat 机器人具备长脉络记忆、多轮对话、复杂角色扮演及自我独白等功能,目前 Nous …... 魔果智讯
- 0
- 0
- 137
-
DeepSeek 代码库开源进度 1/5:为 Hopper GPU 优化的高效 MLA 解码内核 FlashMLA
2月24日讯 DeepSeek 今日启动“开源周”,首个开源的代码库为 FlashMLA—— 针对 Hopper GPU 优化的高效 MLA 解码内核,专为处理可变长度序列而设计。据介绍,FlashMLA 的灵感来自 FlashAttention 2&3 和 cutlass 项目。 开源地址:https://github.com/deepseek-ai/FlashMLA 官方对其的介绍大意…... 魔果智讯
- 0
- 0
- 75
-
Logo Diffusion:用AI几秒钟就能快速生成4个logo
5月7日讯 Logo Diffusion是一个创新的AI平台,旨在彻底改变Logo设计的过程。它利用人工智能技术,使得任何人在几秒钟内就能轻松创建出独特且定制化的Logo标志。 官网地址:https://logodiffusion.com/ 主要功能 文本到Logo:用户只需输入文本提示,AI就能快速生成多达四个Logo设计选项。如果用户对结果不满意,可以无限次重新生成,直至找到完美匹配的Logo…... 魔果智讯
- 0
- 0
- 165
-
Meta 推 LlamaRL 强化学习框架:全异步分布设计,训练 AI 模型提速 10.7 倍
6月11日讯 科技媒体 marktechpost 昨日(6 月 10 日)发布博文,报道称 Meta 公司推出 LlamaRL 框架,采用全异步分布式设计,在 405B 参数模型上,LlamaRL 将强化学习步骤时间从 635.8 秒缩短至 59.5 秒,速度提升 10.7 倍。 注:强化学习(Reinforcement Learning,RL)通过基于反馈调整输出,让模型更贴合用户需求。随着对模…... 魔果智讯
- 0
- 0
- 67























































