GitHub 雷达

10 小时前

监控正在起飞的黑马项目,和高星项目。

tensorflow/tensorflow
TensorFlow 是一个面向所有人的端到端开源机器学习平台,提供全面的工具、库和社区资源,用于构建和部署机器学习应用。 主要技术栈包括 C++ 和 Python,提供稳定的 Python 和 C++ API,并支持通过 pip 安装或 Docker 容器使用。 其亮点在于由 Google Brain 团队开发,适用于研究和生产环境,支持从研究到部署的全流程,并拥有庞大的社区和丰富的教程资源。
C++AI/机器学习200.2k
ggml-org/llama.cpp
llama.cpp 是一个用C/C++实现的大语言模型推理引擎,旨在让用户无需复杂依赖即可在本地或云端运行LLM。 主要技术栈为纯C/C++,利用ARM NEON、Metal、AVX、CUDA、Vulkan等多种底层硬件加速库和自定义量化技术(1.5至8位)来优化性能。 其亮点是支持从Apple Silicon到NVIDIA GPU的广泛硬件,并能在CPU+GPU混合模式下运行超出显存容量的大模型,适用于本地部署、隐私敏感场景和边缘计算。
C++AI/机器学习128.7k
opencv/opencv
OpenCV是一个开源的计算机视觉库,旨在为开发者提供丰富的图像和视频处理功能。主要技术栈基于C++实现,并提供了Python、Java等多种语言的接口。其亮点在于拥有超过2500种优化算法,广泛应用于人脸识别、物体检测、图像拼接等实时视觉处理场景。
C++AI/机器学习90.9k
nomic-ai/gpt4all
GPT4All 是一个开源项目,旨在让用户无需 API 调用或 GPU,就能在普通桌面和笔记本电脑上本地运行大型语言模型,并支持商业使用。其主要技术栈基于 C++ 开发,并围绕 llama.cpp 实现构建了 Python 客户端,同时支持 Vulkan 加速以在 NVIDIA 和 AMD GPU 上进行本地推理。该项目的亮点在于它提供了跨平台桌面安装程序,支持 DeepSeek R1 蒸馏模型,并具备 LocalDocs 功能,允许用户私密地本地与自己的数据对话,非常适合注重隐私、离线或资源受限的场景。
C++AI/机器学习77.4k
tesseract-ocr/tesseract
Tesseract OCR 是一个开源的 OCR 引擎,用于从图像中识别文本,提供库和命令行工具。主要技术栈是 C++,并采用基于 LSTM 神经网络的 OCR 引擎,同时兼容传统的字符模式识别引擎。亮点是支持超过 100 种语言的 Unicode 文本识别,可处理多种图像格式并输出多种格式,适用于需要将扫描文档或图片中的文字转换为可编辑文本的场景。
C++AI/机器学习76.6k
ggml-org/whisper.cpp
whisper.cpp 是一个将 OpenAI 的 Whisper 语音识别模型移植到 C/C++ 的高性能推理实现。 它主要使用纯 C/C++ 编写,无外部依赖,并利用 ARM NEON、AVX、Metal 和 Vulkan 等底层指令集和 GPU 加速。 其亮点在于跨平台支持广泛(包括 iOS、Android、WebAssembly 和树莓派),内存占用低,支持离线运行,非常适合在移动设备、嵌入式系统或边缘计算场景中集成语音识别功能。
C++AI/机器学习53.8k
facebookresearch/faiss
Faiss 是一个用于高效稠密向量相似度搜索和聚类的开源库,解决在海量向量集合中快速查找与查询向量最相似项的问题,其规模可超出内存容量。该库主要用 C++ 实现,提供完整的 Python 和 numpy 接口,并支持基于 CUDA 或 ROCm 的 GPU 加速,核心依赖仅为 BLAS。其亮点在于提供从精确搜索到多种近似算法的丰富索引结构,支持十亿级向量规模,GPU 实现性能极快,适用于推荐系统、图像检索和嵌入向量聚类等场景。
C++AI/机器学习40.9k
microsoft/BitNet
BitNet 是微软推出的 1-bit 大语言模型官方推理框架,旨在解决传统大模型在本地设备上运行时的计算和能耗瓶颈。主要技术栈基于 C++ 实现,并利用查找表方法优化内核,支持在 CPU 和 GPU 上进行快速且无损的 1.58 位模型推理。其亮点在于在 ARM 和 x86 CPU 上实现了最高 6.17 倍的推理加速和 82.2% 的能耗降低,甚至能在单 CPU 上以接近人类阅读速度运行百亿参数模型,非常适合边缘设备和本地化部署场景。
C++AI/机器学习40.3k
google-ai-edge/mediapipe
MediaPipe 是一个跨平台、可定制的机器学习解决方案库,专门用于实时和流媒体场景,帮助开发者在移动端、网页、桌面和物联网设备上轻松部署AI功能。它主要基于C++实现,并提供Python、Android和Web等平台的API接口,同时包含预训练模型和模型定制工具。其亮点在于支持端侧处理,数据无需上传服务器,保障隐私安全,适用于人脸检测、手势识别、物体追踪等实时交互应用,并可通过MediaPipe Studio在浏览器中可视化和评估模型性能。
C++AI/机器学习37.0k
BVLC/caffe
Caffe是一个由伯克利AI研究实验室开发的深度学习框架,旨在提供快速、表达力强且模块化的深度学习解决方案。它主要使用C++实现,并支持Python和MATLAB接口,核心设计强调速度和模块化,便于研究者快速构建和部署卷积神经网络等深度学习模型。该框架的亮点在于其成熟的模型动物园和丰富的预训练模型资源,特别适合计算机视觉任务,同时提供CPU、GPU及多节点分布式等多种定制版本,适用于从学术研究到工业部署的广泛场景。
C++AI/机器学习34.6k
CMU-Perceptual-Computing-Lab/openpose
OpenPose 是一个用于实时多人人体关键点检测的开源库,能够同时检测身体、手部、面部和脚部共135个关键点,解决单张图像中多人姿态估计的问题。该项目主要使用C++实现,基于CMU Panoptic Studio数据集训练,支持CUDA、OpenCL和CPU多种硬件加速方式,并兼容Linux、Windows、MacOS等主流操作系统。其核心亮点是检测速度不受图像中人数影响,保持恒定运行时间,适用于视频分析、人机交互、运动捕捉和虚拟现实等场景,同时提供3D重建、相机标定和Unity插件等扩展功能。
C++AI/机器学习34.5k

5,015 个高星项目