-
AI 框架Ambient Diffusion:从图像中获取灵感,而非复制
5月21日讯 强大的人工智能模型有时会出现错误,包括虚构错误信息或将他人作品作为自己的。为了解决后者的问题,德克萨斯大学奥斯汀分校的研究团队开发了一种名为 "Ambient Diffusion" 的框架。该框架通过对无法辨认的图像数据进行训练,绕过了 AI 模型复制他人作品的问题。 DALL-E、Midjourney 和 Stable Diffusion 是文本到图像扩散生成的…... 魔果智讯
- 0
- 0
- 84
-
英伟达 NVLM 1.0 引领多模态 AI 变革:媲美 GPT-4o,不牺牲性能平衡文本和图像处理难题
9月21日讯 科技媒体 marktechpost 昨日(9 月 20 日)发布博文,报道了英伟达(Nvidia)最新发布的论文,介绍了多模态大语言模型系列 NVLM 1.0。 多模态大型语言模型(MLLM) 多模态大型语言模型(MLLM)所创建的 AI 系统,能够无缝解读文本和视觉数据等,弥合自然语言理解和视觉理解之间的差距,让机器能够连贯地处理从文本文档到图像等各种形式的输入。 多模态大型语言模…... 魔果智讯
- 0
- 0
- 130
-
感谢 DeepSeek:Predibase 发布全球首个端到端强化微调平台并开源,支持无服务器和端到端训练方法
3月20日讯 昨日晚间,大模型训练、开发平台 Predibase 发布了一个完全托管、无服务器、端到端的强化微调平台,也是首个端到端强化微调(RFT)平台。 Predibase 表示,DeepSeek-R1 的开源在全球 AI 领域产生了巨大影响,让很多人意识到强化学习微调对训练大模型的重要性。受此启发,他们开发了这个端到端无服务器强化微调平台。 与传统的监督式微调相比,RFT 不依赖大量的标注数…... 魔果智讯
- 0
- 0
- 124
-
腾讯混元开源首个面向世界模型的强化学习后训练框架 WorldCompass
3月10日讯 腾讯混元 3D 团队今日宣布开源业界首个面向世界模型的强化学习后训练框架 WorldCompass,这是此前发布的混元世界模型 1.5 官方强化学习扩展模块,能够让世界模型的交互更加准确,体验更好。 WorldCompass 是一个专为长时序、交互式世界模型设计的强化学习(RL)后训练框架。如果说世界模型是引擎,那么 WorldCompass 就是“指南针”,通过引入强化学习机制,直…... 魔果智讯
- 0
- 0
- 47
-
OpenAI推出“Meta-Prompting”,显著提升GPT-4等模型内容准确性
OpenAI、斯坦福大学的研究人员推出了一个创新大模型增强框架——Meta-ProMetating(简称“Meta”)。 Meta可增强GPT-4、PaLM和LLaMa等模型的性能,使生成的内容更加精准、安全可靠。 其技术原理也很简单明确,通过将模型复杂的任务或问题分解为更小、可管理的子任务,并将其分配给功能更强的专家模型来进行指导。 实验数据显示,Meta与GPT-4相结合后,在不同任务中的测试…... 魔果智讯
- 0
- 0
- 170
-
Stability AI推Stable Video3D(SV3D)传图可生成3D视频
3月19日讯 Stability AI 推出了 Stable Video3D(SV3D),这是一款用于生成3D 视频的新型 gen AI 工具。SV3D 是在稳定 AI 之前的 Stable Video 技术基础上开发的,该技术使用户能够从图像或文本提示中生成短视频。SV3D 构建在Stability AI 先前的 Stable Video Diffusion 模型基础上,针对新视角合成和3D 生…... 魔果智讯
- 0
- 0
- 164
-
联发科推出生成式 AI 服务平台“达哥”,支持“最强繁体中文大模型”MR BreeXe
4月9日讯 据联发科官方消息,在今日举行的生成式 AI 论坛期间,联发科生成式 AI 服务平台 MediaTek DaVinci 正式推出,亦称“联发科技达哥”,目前已有超过 40 家厂商加入其生态系统。 据悉,该工具最初为集团内部生成式 AI 工具,被广泛应用于软件开发的需求分析和规格设计、人资的自动媒合、财务的报销流程、法务的专利翻译和合约诉讼等,集团渗透率达到 96%。 同时,联发创新基地还…... 魔果智讯
- 0
- 0
- 161
-
Perplexica:开源AI驱动的问答搜索引擎
4月28日讯 Perplexica是一个开源的AI驱动搜索引擎,提供多种搜索模式,旨在为用户提供更精准、更智能的搜索体验。它受到Perplexity AI的启发,不仅能够搜索网络,还能理解并回答用户的问题。 Perplexica的核心功能包括: 本地大型语言模型(LLMs)支持: 支持使用本地部署的大型语言模型,如Llama3和Mixtral,通过Ollama进行操作。 多种搜索模式: …... 魔果智讯
- 0
- 0
- 101
-
Khoj:一个开源的个人化AI助手 轻松连接本地与在线文档
5月29日讯 Khoj 是一个功能丰富、开源的个人化AI助手,旨在帮助用户管理和检索各种信息源,同时提供多种智能功能以提升工作效率。 以下是Khoj的主要特点、功能及应用场景: 主要特点 多源信息获取:能够连接本地和在线文档,包括PDF、Markdown文件、GitHub仓库和Notion文件,整合在线和本地信息。 语言支持:支持使用在线AI模型(如GPT-4)或本地模型(如Llama3),允许用…... 魔果智讯
- 0
- 0
- 197
-
百度发布文心 iRAG 文生图技术“去除 AI 味”,推出无代码开发“秒哒”工具
11月12日讯 在今日的 2024 百度世界大会上,百度创始人李彦宏发布了两项新的 AI 技术 —— 检索增强的文生图技术(iRAG)和无代码工具“秒哒”。 李彦宏表示,文心大模型最新的日均调用量已经来到 15 亿,较半年前(2 亿调用量)增长至 7.5 倍。 幻觉问题是大模型广泛应用的最大限制之一,而解决文本生成幻觉问题背后的技术就是 RAG,即检索增强。李彦宏表示,过去 24 个月对于大模型行…... 魔果智讯
- 0
- 0
- 165
-
谷歌 DeepMind 新研究强化思维链训练,让 AI 语言模型不再“纸上谈兵”
5月20日讯 科技媒体 marktechpost 昨日(5 月 19 日)发布博文,报道称谷歌 DeepMind 团队联合约翰・开普勒林茨大学 LIT AI 实验室,通过强化学习微调(RLFT)技术,提升语言模型的决策能力。 援引博文介绍,基于海量互联网数据训练的语言模型已展现出超越文本处理的决策潜力,可以通过内部知识推理,在交互环境中做出行动选择。 不过这些语言模型在决策过程存在显著缺陷:模型能…... 魔果智讯
- 0
- 0
- 99
-
隐形水印 + C2PA 元数据,OpenAI 推出双重 AI 生成图像溯源举措
5月20日讯 如今各类 AI 图像生成工具层出不穷,且功能日益强大,想要分辨一张图片是否真实变得前所未有的困难。本周二,OpenAI 推出两项新举措,助力解决这一问题。 据悉,该公司已承诺采用名为 C2PA 的开放标准,该标准会在图片元数据中留下明确标识,标注图片由人工智能生成。同时,OpenAI 还携手谷歌,接入名为 SynthID 的隐形水印。这种水印隐蔽性更强,即便不法分子试图抹除痕迹,也很…... 魔果智讯
- 0
- 0
- 170
-
AI漫画生成应用Dashtoon 小说推文制作一大利器
3月4日讯 近日,一款名为Dashtoon的AI漫画生成应用引起了业界的关注。经过实际体验,我们发现该应用的功能相当成熟,不仅能够一次性生成漫画,还为用户提供了充分的编辑和自定义空间。这一发现无疑为国内许多仍处于手工使用各种AI工具拼凑阶段的小说视频制作提供了新的启示和机会。 体验地址:https://dashtoon.com/ Dashtoon的最大亮点在于其人物一致性的处理。通过内置大量的人物…... 魔果智讯
- 0
- 0
- 258
-
新型文生视频AI——Gatekeep 可将数学物理问题转换为视频内容
3月25日讯 随着人工智能技术的不断发展,其在教育领域的应用也日益广泛。最近,一款名为Gatekeep的新型文本转视频AI引起了人们的关注。这款AI的独特之处在于,它专注于将数学和物理问题通过文本提示转化为视频内容,帮助学习者更直观地理解和掌握知识。 体验地址:https://discord.com/invite/36PTEgY892 Gatekeep的工作原理是,根据用户输入的文本提示,自动生成…... 魔果智讯
- 0
- 0
- 192
-
新版对抗AI抓取工具Glaze 2发布,保护艺术家作品免受未经授权的AI抓取
4月16日 消息:在2023年2月,芝加哥大学的一个研究团队发布了一款名为Glaze的免费软件工具,旨在利用机器学习微调用户提供的艺术作品的像素,从而改变其风格,以防止任何AI艺术生成模型对其进行抓取和训练。这项工具的目标是帮助艺术家防止AI模型模仿其艺术风格,而不会对其自身作品产生不利影响。由于艺术家的风格被意图复制,他们不仅会损失委托和基本收入,而且在网上散布的低质量合成副本还会削弱他们的品牌…... 魔果智讯
- 0
- 0
- 149
-
AI插画生成器Ilus AI:可快速生成涂鸦、扁平化插画
5月8日讯 Ilus AI是一款先进的AI插画生成器,它能够快速生成各种风格的插画,包括墨线画、涂鸦和扁平化设计等。这款工具为用户提供了一种创新的方式来创作个性化的插画,大大缩短了设计过程所需的时间。 官网:https://ilus.ai 该产品的主要优点包括: 1. 快速生成插画作品,节省时间和精力; 2. 风格一致,可以保持整体的视觉统一性; 3. 提供多种预设模型和样式选择,满足不同的创作需…... 魔果智讯
- 0
- 0
- 162
-
英国推出开源免费 AI 评估平台 Inspect,可为模型知识 / 推理能力评分
5月13日讯 英国人工智能安全研究所(AI Safety Institute)近日推出了一款名为“Inspect”的 AI 模型安全评估平台,该平台采用开源授权方式,向全球 AI 工程师免费开放,允许工程师们评估自家模型性能及安全性。 据悉,这款 Inspect 平台主要由三大主要框架组成,分别为“数据集”、“求解器(Solver)”、“评分器”,可用来评估各款 AI 模型的特定方面能力,包含模型…... 魔果智讯
- 0
- 0
- 128
-
Perplexica 是 Perplexity.ai 的开源 AI 搜索引擎替代品
6月11日讯 Perplexica 是一个开源项目,旨在提供一个隐私保护的 AI 搜索引擎,作为 Perplexity AI 等专有选项的替代方案。它利用大型语言模型(LLMs)和人工智能功能,提供了一个开放的搜索解决方案。 产品入口:https://github.com/ItzCrazyKns/Perplexica Perplexica 使用 LLMs 结合机器学习算法(如相似性搜索和嵌入模型)…... 魔果智讯
- 0
- 0
- 76
-
谷歌推出 Gemini Code Assist 个人版编程工具,免费可用
2月26日讯 当地时间 25 日,谷歌宣布推出面向个人开发者的免费版本的 Gemini Code Assist,旨在使学生、爱好者、自由职业者和初创公司更容易获得“具有最新 AI 能力”的编程助手。 谷歌产品管理高级总监 Ryan J. Salva 表示,现在任何人都可以更方便地学习、创建代码片段、调试和修改现有应用程序,无需在不同窗口之间切换以获取帮助或从不相关的来源复制粘贴信息。“虽然其他流行…... 魔果智讯
- 0
- 0
- 111
-
阿里达摩院首次开源具身智能“三大件”机器人上下文协议
8月11日讯 在上周开幕的 2025 世界机器人大会上,阿里达摩院宣布开源自研的 VLA 模型 RynnVLA-001-7B、世界理解模型 RynnEC、以及机器人上下文协议 RynnRCP,推动数据、模型和机器人的兼容适配,打通具身智能开发全流程。 具身智能领域飞速发展,但仍面临开发流程碎片化,数据、模型与机器人本体适配难等重大挑战。达摩院将 MCP(Model Context Protocol…... 魔果智讯
- 0
- 0
- 52
-
春节巨献!OpenAI首个视频生成模型Sora发布,60秒高清大作,网友已叹服
北京时间2月16日凌晨,OpenAI 正式发布了文本到视频生成模型 Sora,继 Runway、Pika、谷歌和 Meta 之后,OpenAI 终于加入视频生成领域的战争。 山姆・奥特曼的消息放出后,看到 OpenAI 工程师第一时间展示的 AI 生成视频效果,人们纷纷表示感叹:好莱坞的时代结束了? OpenAI 声称,如果给定一段简短或详细的描述或一张静态图片,Sora 就能生成类似电影的 10…... 魔果智讯
- 0
- 0
- 186
-
让 AI 模型互相教学,谷歌推出社会学习框架
3月11日讯 谷歌近日公开了一项名为“社会学习(Social Learning)”的 AI 框架,该框架允许 AI 语言模型能够通过自然语言互相学习,由于不需要直接交换敏感关键信息,因此训练出的 AI 模型更具隐私保护性。 据介绍,在这款“社会学习框架”中,“学生模型”会向多个已知特定任务解法的“教师模型”学习各种问题的解决方案,研究人员设计了“垃圾短信检测”、“解决小学数学问题”、“根据特定文字…... 魔果智讯
- 0
- 0
- 151
-
普林斯顿首个「开源」AI程序员进场 基于GPT-4,可自动修复bug
4月3日 消息:普林斯顿大学最近推出了一款名为SWE-agent的AI程序员,这是世界上首个开源的AI程序员,它基于GPT-4技术,能够在GitHub仓库中自动修复bug。这个智能体-计算机接口(ACI)的诞生,标志着AI在软件工程领域的应用迈出了重要一步。 SWE-agent在SWE-bench测试集上的表现令人瞩目,它成功解决了12.29%的问题,平均耗时仅为93秒,准确率与之前推出的AI程序…... 魔果智讯
- 0
- 0
- 77
-
虚拟人聊天系统Live2D 利用ChatGPT+对口型打造你自己的AI女友
4月23日讯 这是一个基于 Unity 开发的 Live2D 虚拟人聊天系统项目。通过 Live2D 技术,项目展现了一个动态的虚拟人形象,让二维图像在屏幕上以近乎三维的形式呈现,提供流畅的动画效果,增强用户交互体验。 虚拟人可以与用户进行实时的文本交流,利用 API 如 Azure、OpenAI 和 APISpace 支持自然语言处理和生成,使虚拟人能够理解并回应用户的聊天输入。此外,项目还集成…... 魔果智讯
- 0
- 0
- 150























































