学而思九章大模型(MathGPT)

学而思九章大模型(MathGPT)是好未来教育集团自主研发的全球数学领域教育人工智能模型,专为数学爱好者和科研机构设计,旨在解决数学问题和讲题。九章大模型的核心功能包括自动解...

标签:

学而思九章大模型(MathGPT)是好未来教育集团自主研发的全球数学领域教育人工智能模型,专为数学爱好者和科研机构设计,旨在解决数学问题和讲题。九章大模型的核心功能包括自动解题、复杂应用题批改、语文英语作文批改及个性化AI分步骤讲题,旨在提升学生在数学、语文和英语学科的学习体验。

学而思九章大模型(MathGPT)官网入口网址:https://www.mathgpt.com/

九章大模型的主要特点包括:

  • 开源数据集:提供中文和英文的数学竞赛问题数据集,每个数据集包含5000个项目,覆盖小学至高中数学主题。
  • 多语言支持:支持中文和英文输入,适用于全球用户。
  • 详细解答步骤:提供详尽的解题过程,帮助学生理解数学问题。
  • COT训练:支持Chain of Thought(思维链)训练,有助于学生培养逻辑思维能力。
  • 多学科应用:除了数学,还支持化学、物理、英语等学科的问题解答。

九章大模型在多个方面表现出色:

  • 在中文数据集上的正确率是GPT-4的两倍多。
  • 在英文数据集上的正确率略高于GPT-4。
  • 在MathEval数学能力测评中,九章大模型在国内外30个大模型中脱颖而出,荣登榜首。

九章大模型的应用场景广泛,已成功落地于学而思学习机等智能产品中。例如,学而思xPad2 Pro学习机搭载了九章大模型,提供数学随时问功能,能够实现对小学至初中的数学题目即问即答。此外,九章大模型还通过“小思伴学”实现语音调用,提供AI口算批改、听写等十大AI工具。

九章大模型不仅是一个强大的数学学习工具,还被应用于多个教育场景中,如智慧作业、备课助手和个性化学习手册等。其强大的生成和理解能力,能够针对性解决学生的个性化问题,帮助学生融会贯通,并向更广泛的学生普及优质教学资源。

学而思九章大模型(MathGPT)凭借其强大的数学解题和讲题能力,以及多学科、多语言的支持,已成为教育领域的重要工具,为学生和教师提供了高效、便捷的学习和教学体验。

数据统计

相关导航

IQuest Coder
IQuest Coder

IQuest Coder 是由知名量化对冲基金 Ubiquant(九坤投资)‍ 旗下的 AI 研究实验室 IQuest Lab 开发的一款开源代码生成大模型系列。凭借独特的训练方法和卓越的性能表现,迅速在 AI 编码领域崭露头角。 IQuest Coder官网入口网址:https://iquestlab.github.io/IQuest Coder开源项目地址:https://github.com/IQuestLab/IQuest-Coder-V1核心亮点与优势神秘背景的金融实力:与传统的科技公司模型不同,IQuest Coder 由金融领域的顶尖科研团队打造。这些团队擅长处理海量复杂数据,赋予了模型超强的逻辑推理和模式识别能力,特别是在算法推理和代码优化方面表现尤为突出。‍“代码流”训练范式(Code-Flow Training)‍:它采用了独特的“代码流”训练方法。这种方法并非像传统模型那样只学习静态的代码片段,而是学习代码在版本控制系统(如 Git)中随时间演变的过程。这使得模型更擅长理解代码的演进逻辑和开发者的编程思路。卓越的基准测试表现:在多个权威代码基准测试中,IQuest Coder V1 系列表现优异。例如,在 SWE-bench Verified 基准测试中,40B 版本的表现甚至超过了当时领先的 Claude Sonnet 4.5 和 GPT-4.0 级别模型。模型版本与应用场景 IQuest Coder V1 系列涵盖了多个参数规模(7B、14B、40B)和不同功能的变体,能够满足从个人开发者到企业级用户的多样化需求: Instruct(指令版)‍:主要针对通用的代码生成和指令跟随任务。它效率更高,适合日常的软件开发和代码补全。Thinking(思维版)‍:具备强化的复杂推理能力。对于涉及算法设计、复杂逻辑拆解或多步骤问题的场景表现更佳,尽管响应时间可能更长。Loop(循环版)‍:体积更小,适合在资源受限的环境下部署,或者用于需要高效循环推理的任务。技术特性 该系列模型不仅在智能上表现突出,在技术实现上也颇具特色: 原生 128K 上下文支持:能够处理极长的代码文件或对话上下文。Group Query Attention (GQA):采用分组查询注意力机制,提高推理效率。开源与可定制:IQuest Coder 采用了修改版 MIT 协议开源。用户可以通过 Hugging Face 平台获取模型权重,并在本地进行部署、微调或二次开发,支持高效的量化版本。 IQuest Coder 的推出标志着 AI 发展正在从传统科技巨头向金融领域扩散。它证明了通过创新的训练方法(如代码流训练),即使在参数规模相对较小的情况下,也能在特定任务(如软件工程)上超越许多闭源模型,成为开发者工具箱中一把锋利的新剑。

中国移动MoMA平台
中国移动MoMA平台

中国移动 MoMA(Mixture of Models and Agents,移动模型服务平台)是中国移动打造的一站式 AI 模型聚合与服务平台,定位为 AI 模型 “超级入口”,以 “一次接入、智能优选、普惠可用、安全可信” 为核心,构建开放普惠的 AI 服务新生态,推动 AI 像水、电一样 “随时可得、随处可用”。 中国移动MoMA平台官网入口网址:https://ecloud.10086.cn/portal/product/MaaS MoMA 是中国移动 “通算智” 融合战略的核心载体,针对 AI 行业模型分散、接入繁琐、成本高昂、算力利用低效等痛点而生。依托中国移动 10 亿级用户基数、全国性算力网络与政企客户资源,平台整合全栈 AI 能力,打破模型厂商壁垒,面向政务、金融、工业、医疗、教育、互联网等多行业,提供从模型调用、智能调度到安全管控、计量计费的全链路服务,大幅降低 AI 应用门槛,加速 AI 规模化落地。 核心能力与技术优势1.超级聚合:300+ 模型一站式接入 平台已汇聚超 300 款业界主流 AI 模型,覆盖文本生成、语音处理、图像识别、多模态理解、代码开发、数学推理等全品类能力。核心模型包括中国移动自研 “九天” 基座大模型,以及 DeepSeek、通义千问、豆包、Kimi、GLM、MiniMax 等头部优质模型,用户通过统一 API 网关一次接入,即可调用平台全部模型资源,无需重复对接不同厂商,彻底解决模型碎片化接入难题。 2.智能路由:三大策略自动优选模型 首创智能路由引擎技术,支持 “成本优先、效果优先、均衡优先” 三种调度策略:成本优先适配高调用量、低质量要求场景;效果优先匹配对输出精度敏感的核心业务;均衡优先兼顾成本与性能。同时具备秒级故障切换能力,当模型超时、限流或异常时,自动切换至最优备选模型,保障业务连续不中断,实现 AI 服务 “自动驾驶”。 3.Token 集约化:降本增效显著 首创 Token 集约化运营模式,基于国产算力部署自研推理引擎,结合智能缓存、上下文复用、Token 压缩等技术,实现单位 Token 成本压降约 30%、资源占用率降低 50% 以上。采用流式实时计费,端到端时延不超过 1 分钟,真正做到 “即用即付、用多少算多少”,破解传统预付费资源浪费、账单不透明痛点,中小微企业与个人开发者也能低成本使用 AI。 4.安全可信:机密计算保障数据安全 针对政务、金融等高安全需求场景,推出 **“机密模型” 服务 **,将模型部署在机密容器中,基于硬件隔离技术实现计算过程数据 “可用不可见”,全程加密防护,杜绝数据泄露风险。同时构建 Token 全生命周期管控体系,覆盖精准计量、风险管控、经营分析全流程,满足等保、分保等合规要求。 应用场景与服务价值 MoMA 覆盖全行业 AI 应用场景: 政务领域助力智能公文、政策解读、政务问答;金融领域支持风险评估、智能投顾、客服质检;工业领域适配设备故障诊断、生产优化、质量检测;医疗领域辅助医学文献分析、病历生成、远程问诊;教育领域适配智能备课、题库生成、个性化辅导。对企业而言,可缩短 AI 项目落地周期 60% 以上,降低对接与运维成本;对开发者而言,无需关注底层算力与模型适配,专注业务创新。 MoMA 不仅是 AI 模型的聚合平台,更是中国移动算力网络与 AI 融合的核心枢纽,通过技术创新与生态开放,重构 AI 服务模式,为数字经济发展提供强大智能支撑。

SadTalker
SadTalker

SadTalker 是一个开源的 AI 项目,旨在通过音频驱动的单幅图像生成逼真的说话头像视频。SadTalker 的核心功能是将一张静态的人像图片与音频结合,生成一个逼真的说话头部视频,仿佛让一张照片“会说话”。 SadTalker开源项目官网入口网址:https://github.com/OpenTalker/SadTalkerSadTalker官网入口网址:https://sadtalker.github.io/ SadTalker 的技术基础是基于 3D 运动系数的提取和 3D 面部渲染。它通过音频驱动的 3D 运动系数生成,结合 3D 面部渲染器,实现说话头部的自然运动。模型支持多种模式,如静态、参考和缩放模式,并且支持中英文、歌曲等音频输入。SadTalker 的模型结构包括 ExpNet 和 PoseVAE,分别用于生成面部表情和头部运动,确保唇部同步和自然的头部运动。 SadTalker 的使用非常便捷,用户可以通过多种方式使用。用户可以下载预训练模型,安装 Python 3.8 以上版本,运行脚本生成视频。此外,用户还可以通过 Hugging Face 或 Google Colab 在线体验 SadTalker,无需复杂的本地部署。SadTalker 提供了详细的安装教程和社区支持,用户可以通过 Discord 或 GitHub 社区获取帮助。 SadTalker 的应用场景广泛,包括虚拟助手、客服、教育内容制作、个性化信息传递等。它不仅支持商业和个人项目使用,还允许用户自由下载、修改和再分发代码,具有高度的灵活性和可扩展性。SadTalker 的开源特性使其成为 AI 动画生成领域的热门项目,吸引了大量开发者和研究者的关注。 SadTalker 是一个功能强大、开源且易于使用的 AI 工具,为用户提供了生成逼真说话头像视频的解决方案,适用于多种应用场景。

Janus-Pro
Janus-Pro

Janus-Pro 是由 DeepSeek 推出的一款创新的多模态理解和生成模型,其核心目标是通过优化训练策略、扩展数据集和模型规模,显著提升多模态理解与生成能力。Janus-Pro 是一款多模态大模型,旨在同时实现多模态理解和文本到图像生成任务。 Janus-Pro项目官网入口网址:https://github.com/deepseek-ai/JanusJanus-Pro下载:https://github.com/deepseek-ai/Janus 以下是关于办公人导航分享的 Janus-Pro 的详细解析: 1. 技术架构与创新点 解耦视觉编码:Janus-Pro 将视觉编码与生成任务分离,采用独立的视觉编码器(SigLIP-V)和自回归变换器架构,避免了传统统一模型中视觉编码器与生成任务之间的潜在冲突。统一 Transformer 架构:尽管解耦了视觉编码,但 Janus-Pro 仍保持单一的统一 Transformer 架构,简化了模型设计并提高了灵活性。多模态输入支持:支持图像、文本、音频等多种模态的数据输入,并能够处理高达 384×384 的图像分辨率。 2. 性能表现 多模态理解能力:在 MMBench 测试中,Janus-Pro-7B 达到了 79.2 分,超越了其他多模态统一模型如 MetaMorph 和 TokenFlow-XL。文本到图像生成能力:在 GenEval 测试中,Janus-Pro 达到了 80% 的准确率,在 DPG-Bench 测试中达到了 84.19 分,表现优于 DALL-E3 和 Stable Diffusion 3 中文版。图像生成质量:生成的图像细节丰富、真实感强,能够准确反映文本语义信息。 3. 训练策略与数据扩展 训练阶段优化:Janus-Pro 分为三个训练阶段,包括初始阶段的图像与特征对齐、中期阶段的高质量数据预训练以及后期的微调阶段。数据集扩展:新增了约 9000 万张图像用于多模态理解和生成任务,同时引入了约 7200 万张合成美学数据用于视觉生成。 4. 应用场景 艺术创作:通过 Janus-Pro 可以生成高质量的艺术图像,支持艺术家和设计师进行创意设计。教育与培训:可用于生成教学材料、模拟场景等,提高教学效率。文化传播:能够根据文本描述生成相关图片,帮助用户更好地理解文化背景。 5. 开源与商业化 开源许可:Janus-Pro 是一款开源模型,采用 MIT 许可协议,允许商业使用。灵活性与扩展性:模型支持多种输入模式,并可通过未来扩展纳入更多模态输入,如点云或脑电数据。 6. 行业影响 技术突破:Janus-Pro 在多模态理解和生成领域取得了显著进展,超越了 OpenAI 的 DALL-E3 和 Stable Diffusion 系列模型。市场竞争力:其性能和灵活性使其成为多模态任务的领先解决方案,吸引了全球科技巨头的关注。 7. 局限性与未来展望 分辨率限制:目前 Janus-Pro 的图像处理分辨率仍限制在 384×384,未来需要进一步提升以满足更高分辨率需求。研究方向:未来的研究重点可能包括提升分辨率、优化视觉编码技术以及探索更多模态输入的可能性。 Janus-Pro 是一款具有革命性意义的多模态模型,其通过解耦视觉编码和生成任务、优化训练策略以及扩展数据集和模型规模,在多模态理解和生成领域取得了显著突破。这一模型不仅在学术界引起了广泛关注,也在商业应用中展现了巨大的潜力。

Vimi
Vimi

Vimi是商汤科技推出的全球首个可控人物视频生成大模型,旨在通过先进的AI技术实现个性化视频创作。该模型基于商汤科技的日日新大模型,能够通过动作视频、动画、声音、文字等多种驱动元素,精准控制人物表情和肢体动作,生成与目标动作一致的视频内容。 Vimi官网入口网址:https://vimi.sensetime.com/ 功能特点 多元素驱动:Vimi 支持通过动作视频、动画、声音、文字等多种元素驱动视频生成,能够精准控制人物表情和肢体动作,同时生成合理的头发、服饰和背景。高可控性:用户可以对人物表情和肢体动作进行细致的调整和控制,确保视频内容与用户的预期高度一致。稳定长视频生成:Vimi 能够稳定生成长达分钟级别的单镜头人物类视频,突破了传统 AI 视频生成技术在视频长度上的限制。合理场景生成:Vimi 能够智能生成与人物动作匹配的背景、服饰和发型,构建完整的视频场景。光影效果支持:Vimi 可以调整视频中的光线、方向、强度和色彩,以及阴影和光影的生成,增强视频的真实感和视觉冲击力。个性化应用:Vimi 支持快速生成个性化动态表情包、虚拟角色等,满足用户在社交媒体、个人娱乐、内容创作等多样化场景下的需求。 应用场景 影视制作:Vimi 可用于电影制作、广告拍摄等,提高制作效率并降低成本。动画制作:通过控制动画师的表情和动作,快速生成逼真的动画片段。游戏开发:用于生成游戏中的角色动画,提升游戏视觉效果和互动性。虚拟偶像:生成虚拟偶像的视频内容,用于直播、演唱会等场景。教育培训:创建具有互动性和真实性的教学视频,提升学习效果。社交媒体内容:生成高质量的短视频内容,提升社交媒体影响力。 Vimi 是一款功能强大且应用广泛的 AI 视频生成工具,为视频创作和内容生成带来了革命性的变化。

暂无评论

暂无评论...