-
GitHub又火了一款AI工具 DUSt3R :2张图2秒钟3D 重建
3月4日讯 一款名为 DUSt3R 的 AI 工具近日在 GitHub 上备受瞩目,其能够在短短2秒钟内通过仅有2张图片完成3D 重建,让许多网友大呼惊奇,甚至认为这比之前热门的 Sora 更加实用。这一工具在单目 / 多视图深度估计以及相对位姿估计任务上表现出色,被认为是目前最先进的技术之一。 作者团队采用了一种全新的方法,称为 DUSt3R,它不需要任何相机校准或视点姿势的先验信息,就能完成任…... 魔果智讯
- 0
- 0
- 120
-
AI电影生成工具LTX Studio将于3月27日发布
3月25日讯 LTX Studio是一款强大的一键生成电影的工具,它能够根据用户输入的简单文字提示和创意,生成完整的剧本,并将剧本直接转化为完整视频。这款工具的功能强大,不仅可以精确指导每个场景,还能生成角色演员、调整摄像机角度等。 内测入口:https://ltx.studio/ LTX Studio将于3月27日正式发布,官方已经放出了一些功能预告。其中,换脸功能是其一大亮点,用户可以上传一张…... 魔果智讯
- 0
- 0
- 157
-
Archetype AI发布可深入理解世界的基础模型Newton
4月15日讯 :Archetype AI推出的Newton是一个革命性的人工智能平台,专为理解和推理物理世界而设计。与传统的文本和图像分析AI模型不同,Newton结合了实时传感器数据和自然语言处理技术,使用户能够对周围环境提出开放式问题,并据此做出明智的决策。 Newton的核心功能和特点: 实时物理数据连接:Newton设计用于连接实时物理数据,如雷达、摄像头、加速度计等,通过全球数十亿传感器…... 魔果智讯
- 0
- 0
- 89
-
Meta 推出新的 AI 工具,帮助品牌提升广告效果
5月8日讯 Meta 近期推出了一系列新的生成式 AI 工具,旨在帮助广告商自动化和扩大广告意的多样性,这是其在 Instagram 和 Facebook 等平台上实现广告活动成功的关键。该公司还宣布将通过新的分层定价模式,扩大其 Meta Verified 订阅计划覆盖的国家范围。 Meta 的高管们坚称 “这不是我们与 AI 合作的开始,已经在进行中;我们已经做了相当长时间了。” Meta 全…... 魔果智讯
- 0
- 0
- 114
-
用 GPT-4o 将PRD 即时转换成 Figma 设计
5月29日讯 近期,一项由GPT-4o技术支持的新技术引起了行业内的关注。据悉,这项技术可以根据产品需求文档(PRD)自动生成Figma设计稿,为设计师们提供了全新的设计方式。 它能够自动生成设计稿,支持使用高质量的设计系统如Ant Design Mobile和Arco Mobile。以及能够理解并解析产品需求文档,填充本地样式、自定义图标库和文本内容。虽然在桌面网页的精细度稍低,但已经有了实现路…... 魔果智讯
- 0
- 0
- 166
-
AI 初创公司推出 Nous Chat 聊天机器人,底层基于 Meta Llama 3.1 打造
11月11日讯 AI 初创公司 Nous Research 近期推出了一款名为 Nous Chat 的 AI 聊天机器人,该机器人基于 Meta Llama 3.1 微调而成的“Hermes 3-70B”模型打造,号称在“模型架构、数据合成、微调和推理”方面均进行深入改进,致力于“以人为本”。 据悉,Nous Chat 机器人具备长脉络记忆、多轮对话、复杂角色扮演及自我独白等功能,目前 Nous …... 魔果智讯
- 0
- 0
- 137
-
苹果携手复旦大学推 StreamBridge 端侧视频大语言模型框架,AI 可实时响应视频流
5月13日讯 科技媒体 marktechpost 今天(5 月 13 日)发布博文,报道称苹果公司联合复旦大学,推出 StreamBridge 端侧视频大语言模型(Video-LLMs)框架,助力 AI 理解直播流视频。 直播流视频理解的挑战与需求 传统视频大语言模型擅长处理静态视频,但无法适应机器人技术和自动驾驶等需要实时感知的场景,在这些场景下,要求模型能快速理解直播视频流内容,并做出反应。 …... 魔果智讯
- 0
- 0
- 94
-
苹果发布 AI 框架 LaDiR:突破单一思维,并行探索多条推理路径
4月30日讯 苹果公司携手加州大学圣迭戈分校团队,在新版论文《LaDiR:潜在扩散增强 LLM 文本推理》中提出新框架,让大语言模型(LLM)在回答前并行探索多条推理路径,再用自回归方式输出提高结果质量。 援引博文介绍,该框架并非新模型,而是叠加在现有模型之上的通用框架,重点改变模型思考问题的方式。LaDiR 结合扩散(Diffusion)和自回归(Autoregression)两种主流生成范式,…... 魔果智讯
- 0
- 0
- 183
-
微软神经网络引擎 ONNX Runtime 获推 1.17 版更新,支持开发者使用浏览器训练模型
2月15日讯 据微软官方新闻稿,微软近日为旗下神经网络推理引擎“ONNX Runtime”推出了 1.17 版本,主要加入了网页端训练功能,允许开发者在浏览器中训练模型。 据介绍,微软在 ONNX Runtime 1.8 版本中,首度为引擎推出了浏览器内推理功能,该功能利用 WebGL 和 WebGPU 进行推理,允许开发者调用浏览器跨平台部署机器学习模型。 而在最新的 ONNX Runtime …... 魔果智讯
- 0
- 0
- 171
-
AIwechat-Vercel:无需服务器即可将AI功能集成到公众号中
3月11日讯 AIwechat-Vercel是一款创新的微信公众号插件,它利用Vercel的Serverless Functions提供后端服务,使得用户无需自己管理服务器,只需一个可以绑定到Vercel的域名(无需备案),即可实现将AI功能集成到微信公众号中。 项目地址:https://github.com/pwh-pwh/aiwechat-vercel 教程:https://www.bilib…... 魔果智讯
- 0
- 0
- 155
-
清华创业团队推AI影视创作工具Dream Factory :想法秒变微电影,可长达数十分钟
4月3日讯 清华创业团队和卢森堡大学博士研究员合作,开发了一款名为 “Dream Factory” 的产品,采用创新的多模型智能体协作技术。 这项技术让用户只需输入一句话,便能生成完整的剧本和视频,实现了多情节、多场景的 “微电影” 视频制作。除了引入多模型智能体协作技术,团队还使用了长短期记忆数据库、Prompt 控制因子设计等技术,保证了生成视频的稳定性和流畅性,最长可达数十分钟。 Dream…... 魔果智讯
- 0
- 0
- 400
-
GitLab 极狐发布人工智能编程助手 Duo Chat
4月22日讯 在线代码仓库托管平台 GitLab 极狐近日宣布推出其人工智能编程助手 Duo Chat。该工具可为软件工程师和非工程师提供自然语言聊天形式的指导。 Duo Chat 助手可在 GitLab 用户界面和流行的第三方 IDE 中使用,用户还可通过自定义的方式扩展聊天功能。 GitLab 表示,开发者有 75% 的时间被用于非编写任务,包括理解和改进现有代码、对代码进行维护和测试等。而&…... 魔果智讯
- 0
- 0
- 113
-
研究人员推出 xLSTM 神经网络 AI 架构:并行化处理 Token、有望迎战 Transformer
5月13日讯 研究人员 Sepp Hochreiter 和 Jürgen Schmidhuber 在 1997 年共同提出了长短期记忆(Long short-term memory,LSTM)神经网络结构,可用来解决循环神经网络(RNN)长期记忆能力不足的问题。 而最近 Sepp Hochreiter 在 arXiv 上发布论文,提出了一种名为 xLSTM(Extended LSTM)的新架构,号…... 魔果智讯
- 0
- 0
- 199
-
谷歌推创新框架AGREE 可增强大模型生成内容准确性
6月11日讯 谷歌研究院推出了一个名为AGREE的创新框架,旨在增强大型语言模型(LLM)生成内容和引用的准确性。这一框架通过检索文档中的相关段落来增强大模型生成回答的事实基础,并提供相应的引用,从而提高回答的准确性,并为用户提供验证信息真实性的途径。 核心技术: 训练阶段微调:使用基础大模型生成回答,并利用自然语言推理模型(NLI)评估段落是否支持特定声明。AGREE框架使用NLI模型从未标记的…... 魔果智讯
- 0
- 0
- 60
-
DeepSeek 开源进度 2/5:首个用于 MoE 模型训练和推理的 EP 通信库 DeepEP
2月25日讯 DeepSeek 的“开源周”活动今日已经来到第二天,今天发布的是首个开源的用于 MoE 模型训练和推理的 EP 通信库 ——DeepEP。 开源地址:https://github.com/deepseek-ai/DeepEP 官方表示其具备如下特征: 高效优化的全到全通信方式 支持节点内外通信,兼容 NVLink 和 RDMA 技术 提供高吞吐量的内核,提升训练和推理前期填充效率 …... 魔果智讯
- 0
- 0
- 150
-
中国科学院成功研发出底栖动物智能识别系统:准确率达 90% 以上,全程高度自动化
7月9日讯 据“中科院之声”公众号消息,中国科学院水生生物研究所运用人工智能图像识别技术,成功研发出底栖动物智能识别系统,实现了底栖动物全程自动化识别检测。 从官方介绍获悉,底栖动物是淡水生态系统的重要组成部分,其多样性水平能反映水环境的健康状况,是水生态监测的重要指标。 然而,基于形态学的传统鉴定方法存在诸多局限。例如,底栖动物形态复杂,鉴定时需要逐一检视目标的细微特征。这导致底栖动物鉴定难度大…... 魔果智讯
- 0
- 0
- 43
-
OpenAI推出“Meta-Prompting”,显著提升GPT-4等模型内容准确性
OpenAI、斯坦福大学的研究人员推出了一个创新大模型增强框架——Meta-ProMetating(简称“Meta”)。 Meta可增强GPT-4、PaLM和LLaMa等模型的性能,使生成的内容更加精准、安全可靠。 其技术原理也很简单明确,通过将模型复杂的任务或问题分解为更小、可管理的子任务,并将其分配给功能更强的专家模型来进行指导。 实验数据显示,Meta与GPT-4相结合后,在不同任务中的测试…... 魔果智讯
- 0
- 0
- 170
-
Stability AI推Stable Video3D(SV3D)传图可生成3D视频
3月19日讯 Stability AI 推出了 Stable Video3D(SV3D),这是一款用于生成3D 视频的新型 gen AI 工具。SV3D 是在稳定 AI 之前的 Stable Video 技术基础上开发的,该技术使用户能够从图像或文本提示中生成短视频。SV3D 构建在Stability AI 先前的 Stable Video Diffusion 模型基础上,针对新视角合成和3D 生…... 魔果智讯
- 0
- 0
- 164
-
联发科推出生成式 AI 服务平台“达哥”,支持“最强繁体中文大模型”MR BreeXe
4月9日讯 据联发科官方消息,在今日举行的生成式 AI 论坛期间,联发科生成式 AI 服务平台 MediaTek DaVinci 正式推出,亦称“联发科技达哥”,目前已有超过 40 家厂商加入其生态系统。 据悉,该工具最初为集团内部生成式 AI 工具,被广泛应用于软件开发的需求分析和规格设计、人资的自动媒合、财务的报销流程、法务的专利翻译和合约诉讼等,集团渗透率达到 96%。 同时,联发创新基地还…... 魔果智讯
- 0
- 0
- 161
-
Perplexica:开源AI驱动的问答搜索引擎
4月28日讯 Perplexica是一个开源的AI驱动搜索引擎,提供多种搜索模式,旨在为用户提供更精准、更智能的搜索体验。它受到Perplexity AI的启发,不仅能够搜索网络,还能理解并回答用户的问题。 Perplexica的核心功能包括: 本地大型语言模型(LLMs)支持: 支持使用本地部署的大型语言模型,如Llama3和Mixtral,通过Ollama进行操作。 多种搜索模式: …... 魔果智讯
- 0
- 0
- 101
-
AI 框架Ambient Diffusion:从图像中获取灵感,而非复制
5月21日讯 强大的人工智能模型有时会出现错误,包括虚构错误信息或将他人作品作为自己的。为了解决后者的问题,德克萨斯大学奥斯汀分校的研究团队开发了一种名为 "Ambient Diffusion" 的框架。该框架通过对无法辨认的图像数据进行训练,绕过了 AI 模型复制他人作品的问题。 DALL-E、Midjourney 和 Stable Diffusion 是文本到图像扩散生成的…... 魔果智讯
- 0
- 0
- 84
-
英伟达 NVLM 1.0 引领多模态 AI 变革:媲美 GPT-4o,不牺牲性能平衡文本和图像处理难题
9月21日讯 科技媒体 marktechpost 昨日(9 月 20 日)发布博文,报道了英伟达(Nvidia)最新发布的论文,介绍了多模态大语言模型系列 NVLM 1.0。 多模态大型语言模型(MLLM) 多模态大型语言模型(MLLM)所创建的 AI 系统,能够无缝解读文本和视觉数据等,弥合自然语言理解和视觉理解之间的差距,让机器能够连贯地处理从文本文档到图像等各种形式的输入。 多模态大型语言模…... 魔果智讯
- 0
- 0
- 130
-
感谢 DeepSeek:Predibase 发布全球首个端到端强化微调平台并开源,支持无服务器和端到端训练方法
3月20日讯 昨日晚间,大模型训练、开发平台 Predibase 发布了一个完全托管、无服务器、端到端的强化微调平台,也是首个端到端强化微调(RFT)平台。 Predibase 表示,DeepSeek-R1 的开源在全球 AI 领域产生了巨大影响,让很多人意识到强化学习微调对训练大模型的重要性。受此启发,他们开发了这个端到端无服务器强化微调平台。 与传统的监督式微调相比,RFT 不依赖大量的标注数…... 魔果智讯
- 0
- 0
- 124
-
腾讯混元开源首个面向世界模型的强化学习后训练框架 WorldCompass
3月10日讯 腾讯混元 3D 团队今日宣布开源业界首个面向世界模型的强化学习后训练框架 WorldCompass,这是此前发布的混元世界模型 1.5 官方强化学习扩展模块,能够让世界模型的交互更加准确,体验更好。 WorldCompass 是一个专为长时序、交互式世界模型设计的强化学习(RL)后训练框架。如果说世界模型是引擎,那么 WorldCompass 就是“指南针”,通过引入强化学习机制,直…... 魔果智讯
- 0
- 0
- 19























































