← 返回 github MCP (GitHub org) · 2 小时前 · mcp Model Context Protocol Python SDK v1.29.1 更新 FastMCP 设置和请求限制 译自 English → 中文 Model Context Protocol Python SDK 发布了版本 1.29.1,对 FastMCP 实现进行了几项更新。 在导入时完成 FastMCP Settings 模型。将请求体限制应用于 SSE 和 OAuth 端点。为递归工具返回类型提供以对象为根的输出模式。 重要性 1/3 可信度 2/3 MCP (GitHub org) Hugging Face 阅读原文 相关文章 github llama.cpp · 6 小时前 · 12 次浏览 llama.cpp b10610 缩短 CUDA 和 Metal 中的虚拟设备命名 llama.cpp 项目发布了 b10610 版本,其中包括对 ggml 后端中 CUDA 和 Metal 平台的虚拟设备命名进行简化的更改。 media r/LocalLLaMA · 8 小时前 · 7 次浏览 Hugging Face 探索以 130 亿美元估值出售 Hugging Face 正在探索以 130 亿美元的估值进行潜在出售。文章推测了该平台的可能买家,该平台被描述为 AI 模型的“GitHub”。 github llama.cpp · 11 小时前 · 17 次浏览 llama.cpp b10605 展平 mamba2 投影以调度 GEMM llama.cpp 项目发布了构建版本 b10605,其中包含针对 Mamba2 架构的关键优化。该更新将 Mamba2 模型的输入和输出投影展平,以调度通用矩阵乘法 (GEMM) 操作,而不是通用矩阵向量 (GEMV) 操作。 github llama.cpp · 1 天前 · 13 次浏览 llama.cpp b10603 为 GLM-4.5-Air 添加 MTP 支持 llama.cpp 项目发布了构建版本 b10603,引入了对 GLM-4.5-Air 模型的多令牌预测 (MTP) 支持。 github llama.cpp · 2 天前 · 5 次浏览 ggml 通过用行级 memcpy 替换逐元素 memcpy 来优化连接操作 ggml 库通过用行级 memcpy 操作替换逐元素内存复制,优化了其连接操作。此更改是 llama.cpp b10578 版本的一部分,其中包括各种平台特定的二进制文件和底层计算图的更新。
github llama.cpp · 6 小时前 · 12 次浏览 llama.cpp b10610 缩短 CUDA 和 Metal 中的虚拟设备命名 llama.cpp 项目发布了 b10610 版本,其中包括对 ggml 后端中 CUDA 和 Metal 平台的虚拟设备命名进行简化的更改。
media r/LocalLLaMA · 8 小时前 · 7 次浏览 Hugging Face 探索以 130 亿美元估值出售 Hugging Face 正在探索以 130 亿美元的估值进行潜在出售。文章推测了该平台的可能买家,该平台被描述为 AI 模型的“GitHub”。
github llama.cpp · 11 小时前 · 17 次浏览 llama.cpp b10605 展平 mamba2 投影以调度 GEMM llama.cpp 项目发布了构建版本 b10605,其中包含针对 Mamba2 架构的关键优化。该更新将 Mamba2 模型的输入和输出投影展平,以调度通用矩阵乘法 (GEMM) 操作,而不是通用矩阵向量 (GEMV) 操作。
github llama.cpp · 1 天前 · 13 次浏览 llama.cpp b10603 为 GLM-4.5-Air 添加 MTP 支持 llama.cpp 项目发布了构建版本 b10603,引入了对 GLM-4.5-Air 模型的多令牌预测 (MTP) 支持。
github llama.cpp · 2 天前 · 5 次浏览 ggml 通过用行级 memcpy 替换逐元素 memcpy 来优化连接操作 ggml 库通过用行级 memcpy 操作替换逐元素内存复制,优化了其连接操作。此更改是 llama.cpp b10578 版本的一部分,其中包括各种平台特定的二进制文件和底层计算图的更新。