小智 AI 聊天机器人是一款开源硬件项目,旨在帮助用户入门 AI 硬件开发,并将大语言模型(LLM)应用于实体设备中。该项目由开发者“虾哥”以 MIT 许可证发布,具有低成本、高可玩性,适合 AI 硬件开发学习者使用 。项目支持 Wi-Fi 和 4G 连接,具备离线语音唤醒、流式语音对话、多语言识别(包括国语、粤语、英语、日语、韩语)、声纹识别、LLM 和 TTS 支持、短期记忆功能,以及 OLED/LCD 显示屏显示对话内容 。项目提供详细视频教程,用户可自行制作硬件和工具进行体验 。
- 小智 AI 聊天机器人官网入口网址:https://xiaozhi.me/
- 小智 AI 聊天机器人开源项目地址:https://github.com/78/xiaozhi-esp32
- 小智 AI 聊天机器人百科全书:链接
小智 AI 聊天机器人支持多种功能,包括语音唤醒(支持离线唤醒和按键唤醒)、多语言识别、流式语音对话、多模态交互方式等 。用户可以通过视频教程和固件修改进行自定义和扩展功能。此外,该项目还支持私有化服务器部署和定制模型应用。
小智 AI 聊天机器人不仅是一个开源硬件项目,还具有一定的娱乐性和实用性,例如在视频中展示其与用户互动、讲笑话、唱歌等功能。此外,该项目还支持与智能家居设备(如 Home Assistant)的集成,实现智能家居控制。
小智 AI 聊天机器人是一个集开源硬件、AI 技术、娱乐性和实用性于一体的项目,适合对 AI 硬件开发和智能设备感兴趣的用户。开发和智能设备感兴趣的用户。
数据统计
相关导航
DeepSeek实用集成(Awesome DeepSeek Integrations)是一个由DeepSeek官方维护的开源项目,旨在将DeepSeek的AI能力集成到各种流行软件和工具中,帮助开发者和用户快速接入DeepSeek的强大功能。该项目提供了一个一站式集成资源库,涵盖了多种工具、框架和解决方案,支持多语言、多平台和多场景的应用。 DeepSeek实用集成(Awesome DeepSeek Integrations)开源项目官网入口网址:https://github.com/deepseek-ai/awesome-deepseek-integrationDeepSeek实用集成(Awesome DeepSeek Integrations)中文介绍:链接 该项目不仅整理了与DeepSeek模型相关的各种应用和工具,还提供了详细的API集成方案,帮助用户将DeepSeek的AI能力无缝集成到常用应用中,如聊天工具、智能体、编码工具等。项目支持多语言和多平台,方便全球开发者使用和贡献。此外,该项目还提供了详细的文档和教程,帮助用户快速上手和使用DeepSeek的AI能力。 Awesome DeepSeek Integrations不仅是一个工具集合,更是一个强大的AI生态系统,为用户提供了无缝的AI体验,无论是日常办公还是专业开发任务,都能轻松应对。该项目的开源地址为:https://github.com/deepseek-ai/awesome-deepseek-integration 。 DeepSeek实用集成(Awesome DeepSeek Integrations)是一个功能强大、资源丰富的开源项目,旨在帮助开发者和用户快速接入DeepSeek的AI能力,推动AI技术在各领域的落地应用。
AI-Infra-Guard 是腾讯开源的高效 AI 基础设施安全评估工具,旨在发现和检测 AI 系统中的潜在安全风险。 AI-Infra-Guard官网入口网址:https://tencent.github.io/AI-Infra-Guard/AI-Infra-Guard开源项目地址:https://github.com/Tencent/AI-Infra-GuardAI-Infra-Guard中文介绍地址:链接 AI-Infra-Guard 是一个开源项目,支持多种 AI 框架的指纹识别,覆盖 28 种主流 AI 框架和 200+ 安全漏洞数据库,具备高效扫描、易用性、轻量级等特点 。用户可以通过本地扫描、指定目标或从文件读取目标等多种方式进行安全评估,还能结合 AI 分析功能进一步提升检测能力 。 核心功能 基础设施漏洞扫描:精准识别 30+ AI 框架组件,覆盖 近400个 已知 CVE 漏洞,如 Ollama、ComfyUI、vLLM 等MCP Server 安全检测:基于AI Agent驱动,检测 9 大类MCP安全风险,支持源代码/远程URL扫描大模型安全体检:快速评估Prompt安全风险,内置多个精选越狱评测集,快速获取大模型安全体检报告 该工具支持跨平台使用,资源占用低,适合企业 AI 基础设施漏洞检测、安全巡检、运维及 DevSecOps 集成等场景 。AI-Infra-Guard 的开发和应用旨在解决 AI 系统中的安全风险,如数据泄露、算力窃取等问题 。
Jellyfish 是一个由开发者 Forget-C 发起的开源项目,旨在打造一款“一站式 AI 短剧工厂”(AI Short Drama Studio)。该项目专为竖屏短剧和微短剧的创作而设计,致力于解决当前 AI 视频生成领域中最为棘手的角色与场景一致性难题,通过工业化的生产流程,实现从文学剧本到最终成片的全自动化或半自动化生成。 Jellyfish官网入口网址:https://forget-c.github.io/Jellyfish/ Jellyfish开源项目官网入口网址:https://github.com/Forget-C/Jellyfish 在传统的 AI 视频生成工作流中,创作者往往面临人物长相在不同镜头间发生“漂移”、场景风格不统一等问题。Jellyfish 的核心价值在于其“极致一致性”机制。它通过全局种子控制、统一风格设定以及完善的资产复用体系,确保角色、场景、道具甚至服装在整个剧集生产中保持高度一致。这种机制让 AI 生成的视频不再是零散的片段,而是具有连贯叙事能力的完整作品。 Jellyfish 提供了一条完整的闭环生产链路: 剧本输入与智能分镜:用户只需输入文学剧本,系统即可利用 AI 自动进行剧情提取、智能精简,并生成分镜脚本。可视化分镜编辑:提供所见即所得的分镜编辑器,支持对景别、角度、运镜方式、情绪氛围、时长以及对白配乐进行精细控制。用户甚至可以为首帧、尾帧和关键帧编写独立的提示词,实现对镜头语言的深度掌控。高级生成控制:集成了参考图跨分镜引用、ControlNet 骨骼与深度控制、智能对口型等先进技术,确保动作流畅且口型同步。后期剪辑与导出:内置时间线编辑功能,支持多轨音视频处理,用户可直接在工具内将生成的 AI 片段剪辑成完整的短剧,并一键导出成片。 适用场景 短剧/微短剧内容创作者AI 影视工作室批量生产个人创作者想低成本试水竖屏短剧教育/培训机构制作教学短视频品牌/电商制作带剧情的产品宣传短片 Jellyfish 正处于快速开发阶段,核心工作台、资产管理和分镜编辑等功能已初具规模,而完整的后期剪辑时间线和多模型供应商管理仍在持续完善中。作为一个基于 Apache-2.0 协议开源的项目,它为短剧创作者、AI 影视工作室以及希望低成本试水微短剧的个人提供了极具潜力的生产力工具,有望成为 AI 视频内容创作领域的行业标杆。
AI-Media2Doc 是一个开源项目,旨在将视频和音频内容一键转化为多种风格的文档,如小红书、公众号、知识笔记、思维导图等。该项目由开源社区维护,采用 MIT 协议授权,支持本地部署,无需登录注册,且所有任务记录保存在本地。用户可以通过 GitHub 地址(https://github.com/hanshuaikang/AI-Media2Doc )获取项目源码并进行部署和使用。 AI-Media2Doc开源项目官网入口网址:https://github.com/hanshuaikang/AI-Media2Doc AI 视频图文创作助手是一款 Web 工具, 基于 AI 大模型, 一键将视频和音频转化为各种风格的文档, 无需登录注册, 前后端本地部署,以极低的成本体验 AI 视频/音频转风格文档服务。 核心功能 完全开源:MIT 协议授权,支持本地部署。隐私保护:无需登录注册,任务记录保存在本地前端处理:采用 ffmpeg wasm 技术,无需本地安装 ffmpeg多种风格支持:支持小红书/公众号/知识笔记/思维导图/内容总结等多种文档风格支持。AI 对话:支持针对视频内容进行 AI 二次问答。支持字幕导出: 结果一键导出为字幕文件。智能截图: 基于字幕信息智能截图并插入文章, 无需视觉大模型, 实现真正的图文并茂。支持自定义 Prompt:支持在前端自定义配置 prompt。一键部署:支持 Docker 一键部署。支持设置访问密码: 后端设置访问密码之后, 前端用户需要填写该密码才可以正常使用。 AI-Media2Doc 的核心功能包括音视频处理、多种输出格式支持、AI 对话、字幕导出、智能截图插入、自定义 Prompt 等。项目支持前端 ffmpeg wasm 处理,无需本地安装 ffmpeg,也支持 Docker 一键部署。此外,该项目还支持生成思维导图,并可导出到第三方平台进行编辑和调整。 AI-Media2Doc 的目标是降低 AI 应用门槛,为自媒体博主、企业文员和学生提供高效的多媒体内容处理工具,帮助用户快速将音视频内容转化为高质量文档。该项目在多个技术社区和开源平台(如 GitHub、Python 潮流周刊等)上被提及和推荐。
MotionAgent是一款由阿里云魔搭社区(ModelScope)开发的开源AI工具,旨在通过深度学习技术将用户的创意转化为动态影像内容。其核心功能包括剧本生成、剧照生成、视频制作和背景音乐生成,适用于个人创作者、内容创作者以及电影制作团队等用户群体。 MotionAgent项目官网入口网址:https://github.com/modelscope/motionagentMotionAgent中文入口网址:https://github.com/modelscope/motionagent/blob/main/README_ZH.md 核心功能与特点 剧本生成:用户可以通过指定故事主题和背景,生成多种风格的剧本。MotionAgent支持基于LLM(如Qwen-7B-Chat)的模型,能够高效生成高质量的剧本内容。剧照生成:用户输入剧本后,MotionAgent可以自动生成相应的剧照场景图像。这一功能依赖于文本生成图片模型(如I2VGen-XL),能够将文字描述转化为视觉内容。视频生成:MotionAgent支持高分辨率视频生成,结合SDXL 1.0等模型,能够将文本或图像输入转化为流畅的动态影像。背景音乐生成:用户还可以自定义风格的背景音乐,通过音乐生成模型(如MusicGen)实现音频内容的创作。 使用流程 用户输入创意描述(如故事主题、背景和剧情要求)。MotionAgent根据输入生成剧本。通过剧照生成模块,将剧本转化为静态画面。将静态画面和补充文本描述上传至视频生成模块,生成最终视频。最后,用户可以选择自定义背景音乐,完成整个创作过程。 优势与应用场景 简化创意过程:MotionAgent通过AI技术减少了手动劳动,使用户能够快速将创意转化为高质量的动态内容。适用范围广泛:从个人创作者到专业电影制作团队,均可利用MotionAgent实现高效创作。开源与免费:作为开源项目,MotionAgent允许用户自由修改和分发代码,降低了使用门槛。 MotionAgent是一款功能强大的AI视频生成工具,通过整合多种深度学习模型,实现了从创意到动态影像的自动化转换。其开源特性、免费使用政策以及对多种硬件和环境的支持,使其成为创意工作者和电影制作团队的理想选择。
Anthropic Cookbook 是 Anthropic 官方推出的开源项目,旨在为开发者提供 Claude 大模型的代码示例、技能实战和集成案例,帮助开发者高效使用 Claude 进行 AI 应用开发。该项目提供了多种实用方法,如将 Claude 与外部工具和功能整合,增强其能力,涵盖数据分析、信息提取、图像生成、PDF 解析、JSON 格式使用等场景 。项目内容涵盖分类、RAG、摘要、多模态、工具调用等核心场景,适用于 AI 开发者、企业架构师及需要集成 Claude 能力的团队 。 Anthropic Cookbook开源项目官网入口地址:https://github.com/anthropics/anthropic-cookbook Anthropic Cookbook 提供了丰富的代码示例和详细文档,开发者可以通过安装 Python 环境、获取 Anthropic API 密钥、安装特定依赖包等方式快速上手。项目中的 Jupyter Notebook 文件提供了交互式学习体验,而脚本则适合直接集成到生产环境 。此外,项目鼓励社区贡献,通过 GitHub 平台进行协作和更新,确保内容的时效性和实用性 。 Anthropic Cookbook 是一个开源项目,旨在提供关于如何使用 Anthropic 公司开发的 AI 技术的实用指南和示例代码,帮助开发者更好地理解和应用 Anthropic 的 AI 技术 。项目包含多个章节,涵盖了从基础到高级的 AI 应用开发,包括模型训练、数据处理、API 使用等方面的内容 。 Anthropic Cookbook 项目不仅提供了代码示例,还提供了多种使用 Claude 的实践方法,帮助开发者降低 Claude 应用开发门槛,分享 prompt 设计、模型调用等技巧,助力挖掘 Claude 模型潜力 。 Anthropic Cookbook 是一个功能丰富、社区活跃、技术实用的开源项目,为开发者提供了高效使用 Claude 的资源和工具,是 AI 开发者和企业团队的重要参考。
