-
浪潮源 Yuan3.0 Ultra 多模态基础大模型开源发布:万亿参数,企业级任务表现突出
3月6日讯 浪潮旗下 YuanLab.ai 团队今日开源发布源 Yuan3.0 Ultra 多模态基础大模型,这是一款面向万亿参数规模打造的旗舰模型。 Yuan3.0 Ultra 将 MoE 大模型的训练效率优化系统性引入模型结构设计之中,并围绕企业应用及智能体工具调用等方面开展了深度优化,在多模态文档理解、检索增强生成(RAG)、表格数据分析、内容摘要与工具调用等企业级任务中表现突出。 这些能力…... 魔果智讯
- 0
- 1
- 45
-
昆仑万维:天工 SkyMusic AI音乐生成大模型4月17日正式上线免费开放
4月8日 消息:「天工 SkyMusic」是一款由昆仑万维开发的 AI 音乐生成大模型,通过该应用,用户可以享受独特的音乐创作体验。即使是零基础的用户也可以利用该应用将灵感转化为动听的歌曲。 昆仑万维表示,该应用目前处于内测阶段,预计将于4月17日正式上线,届时将向全社会免费开放。通过「天工 SkyMusic」,用户可以享受音乐创作的乐趣,探索音乐风格的融合创新,表达个性与情感。 下面是使用「天工…... 魔果智讯
- 0
- 0
- 425
-
5亿个token之后,我们得出关于GPT的七条宝贵经验
ChatGPT 正确的使用姿势。 自 ChatGPT 问世以来,OpenAI 一直被认为是全球生成式大模型的领导者。2023年3月,OpenAI 官方宣布,开发者可以通过 API 将 ChatGPT 和 Whisper 模型集成到他们的应用程序和产品中。在 GPT-4发布的同时 OpenAI 也开放了其 API。 一年过去了,OpenAI 的大模型使用体验究竟如何,行业内的开发者怎么评价? 最近,…... 魔果智讯
- 0
- 0
- 94
-
vivo 自研蓝心大模型升级“自研 AI 多模态大模型”
5月13日讯 在正在举行的 vivo 影像新蓝图暨 X 系列新品发布会上,vivo 宣布自研蓝心大模型升级「自研 AI 多模态大模型」,多模态技术让大模型从最原始的视觉、声音、空间等方面接触、感知、理解世界,让大模型更全面、更聪明、更强大。 此外,vivo 看见 | 多模态大模型技术应用 ——「vivo 看见蓝心升级版」,帮助视障用户更好地“看见”世界。 去年 11 月 1 日,在 2023 vi…... 魔果智讯
- 0
- 0
- 62
-
研究称GPT-4 选股准确率高达 60%,被质疑数据污染
5月27日讯 最近,一篇芝大论文引发了业内的热议,研究发现 GPT-4在选股方面的准确率高达60%,超越了大部分人类股票分析师和专业模型。这一发现让人们开始怀疑人类股票分析师是否将面临下岗的风险。然而,一些 AI 大牛对这项研究提出了质疑,指出可能存在训练数据污染的问题,影响了结果的准确性。 研究者通过对财务报表进行分析,让 GPT-4进行预测未来收益的变化。意外的是,GPT-4在没有任何叙述上下…... 魔果智讯
- 0
- 0
- 131
-
中国杀出全球烹饪大模型
什么?烹饪也有大模型?! 没有听错,这就是国产厨电龙头老板电器最新发布——“食神”大模型。 数十亿级行业数据,数千万级知识图谱加持,据称还是全球首个。 它能为每个人提供个性化量身定制的解决方案,不仅告诉用户怎么做菜,还能调动所有设备,协助你把菜做出来。 除此之外,在整个陪伴你烹饪的过程里,它情绪价值拉满~ 烹饪前不知道吃什么,或者想吃啥不会做,它告诉你十多种做菜的方式,还顺带科普菜谱背后的人文文化…... 魔果智讯
- 0
- 0
- 97
-
30 秒让照片动起来,首个国产纯自研视频大模型 Vidu 上线
8月1日讯 首个国产纯自研视频大模型 Vidu 上线,目前向用户开放了文生视频、图生视频两大核心功能,提供 4 秒和 8 秒两种时长选择,分辨率最高为 1080P。用户无需申请,使用邮箱注册即可体验。 Vidu 官网:www.vidu.studio Vidu 模型于今年 4 月在 2024 中关村论坛首次亮相,由清华大学与生数科技联合发布,其核心技术 U-ViT 架构由团队在 2022 年 9 月…... 魔果智讯
- 0
- 0
- 280
-
全球首个,我国发布百亿级遥感解译基础模型“空天・灵眸”3.0 版
9月21日讯 综合新华社、《中国科学报》消息,在今天举行的第一节空天信息技术大会上,中国科学院空天信息创新研究院(下文简称“空天院”)宣布,该院付琨研究员团队联合鹏城实验室自主研制的、全球首个百亿参数级空天一体遥感解译基础模型 ——“空天・灵眸”3.0 版正式发布。 “空天・灵眸”3.0 版可为天临空地一体化应用提供一套行之有效的解决方案。据报道,今年 3 月起,研究团队与鹏城实验室深度合作,基于…... 魔果智讯
- 0
- 0
- 161
-
Niantic 宣布将根据《宝可梦 Go》玩家数据构建“大型地理空间模型”
11月20日讯 Niantic 宣布将基于数百万《Pokémon Go》玩家的数据来开发一个新的“大型地理空间模型”(LGM)。 该公司表示,空间智能是人工智能模型的下一个前沿领域。这种 AI 模型可以使计算机和机器人以新的方式理解和与世界互动。 当你看到一种熟悉的建筑 —— 无论是教堂、雕像还是广场 —— 都很容易想象出它从其他角度看起来是什么样子,即便你并未从其他角度看到过它。 作为人类,我们…... 魔果智讯
- 0
- 0
- 117
-
OpenAI o3 AI 模型突破推理极限背后:成本飙升,没“钞能力”用不起
12月24日讯 科技媒体 TechCrunch 昨日(12 月 23 日)发布博文,认为 OpenAI 的 o3 模型虽然在 ARC-AGI 等测试中取得了亮眼成绩,但背后的高计算成本,让其短期内很难在实际应用中普及。 o3 性能 o3 的新功能之一是可以调整推理时间,分为低、中、高三种计算级别,计算级别越高,o3 的任务执行性能越好。 而 o3 是 OpenAI 是迈向该目标的重要一步,在 AR…... 魔果智讯
- 0
- 0
- 102
-
OpenAI凌晨放王炸!GPT-5即将发布 免费无限使用
2月13日讯 北京时间今天凌晨,OpenAICEO萨姆奥尔特曼(Sam Altman)放出王炸”级别更新预告,剧透GPT-4.5和GPT-5的未来规划。 奥尔特曼表示,OpenAI将在未来几个月内推出GPT-5模型,该模型将在ChatGPT和API中整合包括o3在内的多项OpenAI技术。 值得一提的是,免费版ChatGPT能在标准智能设置下无限制使用GPT- 5进行对话,但会受到滥用阈值的限制,…... 魔果智讯
- 0
- 0
- 57
-
微软拥抱 DeepSeek,Copilot+ PC 本地运行 7B 和 14B 模型
3月4日讯 微软今日宣布,通过 Azure AI Foundry 接入 DeepSeek-R1 7B 和 14B 蒸馏模型,为 Copilot+ PC 提供本地运行 7B 和 14B 模型的能力。 早在今年 1 月,微软就宣布计划将 DeepSeek-R1 模型的 NPU 优化版本直接带到搭载高通骁龙 X 处理器的 Copilot+ PC 上。如今,这个承诺终于兑现。 从微软官方博客获悉,模型将从…... 魔果智讯
- 0
- 0
- 113
-
OpenAI 发布新一代语音模型,让 AI 智能体语音表达更自然
3月21日讯 OpenAI 昨日(3 月 20 日)发布博文,宣布推出语音转文本(speech-to-text)和文本转语音(text-to-speech)模型,提升语音处理能力,支持开发者构建更精准、可定制的语音交互系统,进一步推动人工智能语音技术的商业化应用。 在语音转文本模型上,OpenAI 主要推出了 gpt-4o-transcribe 和 gpt-4o-mini-transcribe 两…... 魔果智讯
- 0
- 0
- 105
-
谷歌 DeepMind 开发 DolphinGemma AI 模型,助力海豚“语言”研究
4月15日讯 谷歌旗下的 AI 研究实验室谷歌 DeepMind 今日宣布,成功开发出一款名为 DolphinGemma 的 AI 模型,旨在助力科学家深入研究海豚的“语言”,更好地理解海豚的沟通方式。 据了解,DolphinGemma 是基于谷歌开放的 Gemma 系列模型构建的,其训练数据来源于专注于研究大西洋斑点海豚及其行为的非营利组织 Wild Dolphin Project(WDP)。该…... 魔果智讯
- 0
- 0
- 81
-
火山引擎发布豆包 1.5・视觉深度思考模型,新增 GUI Agent 能力
5月13日讯 在今日举办的 FORCE LINK AI 创新巡展・上海站上,火山引擎发布了豆包 1.5・视觉深度思考模型(Doubao-1.5-thinking-vision-pro),该模型激活参数仅 20B,但具备强大的多模态理解和推理能力,在 60 个公开评测基准中,有 38 个达到业界最佳表现(SOTA),在视频理解、视觉推理、GUI Agent 能力等方面均处于第一梯队。 在视频理解领域…... 魔果智讯
- 0
- 0
- 448
-
法国 AI 实验室 Mistral 推出推理模型 Magistral 系列,Small 版已开源
6月11日讯 法国人工智能实验室 Mistral 周二宣布进军推理人工智能模型领域。6 月 10 日,Mistral 正式推出其首个推理模型系列 ——Magistral。该系列模型通过分步骤解决问题,旨在提升在数学、物理等学科领域的一致性和可靠性,与 OpenAI 的 o3 模型和谷歌的 Gemini 2.5 Pro 等其他推理模型类似。 Magistral 系列包含两个版本:Magistral …... 魔果智讯
- 0
- 0
- 88
-
阿里云通义千问 Qwen3-Coder 宣布开源:480B 参数、原生支持 256K 上下文,可与 Claude Sonnet4 媲美
7月23日讯 阿里云通义团队今日发布公告,宣布 Qwen3-Coder 正式开源,号称是“面向世界的智能编程引擎”。 这也是该团队迄今为止最具 Agent 能力的代码模型,在 Agentic Coding、Agentic Browser-Use 和 Foundational Coding Tasks 上均取得了开源模型的 SOTA 效果,可以与 Claude Sonnet4 媲美。 据介绍,Qwe…... 魔果智讯
- 0
- 0
- 35
-
钉钉联合通义推出 Fun-ASR 语音识别大模型,能听懂家装、畜牧等十大行业黑话
8月22日讯 钉钉、通义实验室语音团队今天宣布,联手推出新一代语音识别大模型 Fun-ASR,能听懂家装、畜牧等十大行业黑话,并支持企业专属模型定制训练。目前,Fun-ASR 已被集成进钉钉的多个功能模块,包括会议字幕与同传、智能纪要、语音助手等。 据悉,目前 Fun-ASR 已被集成进钉钉的多个功能模块,包括会议字幕与同传、智能纪要、语音助手等,旨在构建一套稳定、高效、易扩展的语音识别基座,尤其…... 魔果智讯
- 0
- 0
- 61
-
Anthropic 性价比最高 AI 模型:Haiku 4.5 登场,1/3 价格实现 Sonnet 4 同级编程能力
10月16日讯 Anthropic 官网今天(10 月 16 日)发布博文,宣布推出小型 AI 模型 Claude Haiku 4.5。官方表示该模型以极低的成本提供了接近前沿模型的强大性能,目标成为实时、低延迟任务(如聊天助手和客户服务)的理想选择。 简单介绍下 Anthropic Claude 系列模型的三种尺寸规模:Haiku(小型)、Sonnet(中型)和 Opus(大型)。较大的模型基于…... 魔果智讯
- 0
- 0
- 36
-
中国科学院大学推出国内首个“反垄断知识增强大模型”
12月2日讯 据证券时报报道,12 月 2 日,在中国科学院大学他山学科交叉创新协会主办的“他山青年创新论坛・Agent4S 产学研峰会暨第十期中国科学院大学学科交叉沙龙”活动上,中国科学院大学推出国内首个“反垄断知识增强大模型”。 据悉,该模型依托国家自然科学基金重大项目“数字经济反垄断理论与政策研究”,由中国科学院大学联合复旦大学、山东大学、北京大学、香港大学、西安交通大学等高校共同研发完成。…... 魔果智讯
- 0
- 0
- 36
-
Nano Banana Pro 新对手,智谱联合华为开源首个国产芯片训练的多模态 SOTA 模型 GLM-Image
1月14日讯 智谱今日宣布联合华为开源新一代图像生成模型 GLM-Image,模型基于昇腾 Atlas 800T A2 设备和昇思 MindSpore AI 框架完成从数据到训练的全流程,是首个在国产芯片上完成全程训练的 SOTA 多模态模型。 GLM-Image 采用自主创新的“自回归 + 扩散解码器”混合架构,实现了图像生成与语言模型的联合。 GLM-Image 核心亮点如下: 架构革新,面向…... 魔果智讯
- 0
- 0
- 18
-
微软发布 Phi-4-Reasoning-Vision-15B 开源模型,能自主决定何时思考的小型多模态 AI
3月5日讯 据微软官方开发者社区博客今日消息,微软发布了一款 Phi-4-Reasoning-Vision-15B 模型,这是一款视觉推理模型。 它结合了高分辨率视觉感知与选择性、任务感知的推理,使其成为 Phi-4 系列中首个同时实现“看得清楚”和“想得深入”的小语言模型(SLM)。 传统的视觉模型仅执行被动的感知 —— 识别图像中“有什么”。Phi-4-Reasoning-Vision-15B…... 魔果智讯
- 0
- 0
- 21
-
字节发布全双工语音大模型 Seeduplex,豆包打电话能边听边讲、交流更自然
4月9日讯 字节跳动今日宣布推出原生全双工语音大模型 Seeduplex。 据介绍,相比于上一代半双工豆包端到端语音模型,Seeduplex 基于“边听边说”的全新框架设计,交互体验的自然感、顺畅度大幅提升。 据官方介绍,Seeduplex 重点实现了以下两项突破: 精准抗干扰:模型具备持续的“倾听”能力,从而能更好地理解用户所处的声学环境,准确忽略背景噪音和无关对话。在复杂场景下,相比半双工模型…... 魔果智讯
- 0
- 0
- 28
-
OpenAI ChatGPT 默认 AI 模型升至 GPT-5.5 Instant:幻觉最高减少 52.5%、回复更简洁
5月6日讯 OpenAI 昨日(5 月 5 日)发布公告,宣布升级 ChatGPT 聊天机器人的默认模型,替换为 GPT-5.5 Instant,聚焦准确性与简洁性,在和网友交互时重点减少回复中出现“不必要的表情符号”。 在回复内容方面,GPT-5.5 Instant 模型回复的内容更加简洁,在保持实用性的前提下,进一步减少冗长格式和不必要的表情符号。 本次升级进一步改善准确性,在医疗、法律、金融…... 魔果智讯
- 0
- 0
- 185























































