한 사용자가 Hugging Face 토론 포럼에 게시하여 자신의 조직 이름을 변경하는 데 도움을 요청했습니다. 해당 개인은 6월 15일 DZER-Studios에서 Vexion-LM로 변경을 요청하기 위해 website@huggingface.co로 이메일을 보냈다고 밝혔습니다. 초기 요청을 보낸 후에도 사용자는 응답이 없었으며 조직 이름이 변경되지 않은 것을 관찰했다고 보고했습니다. 따라서 게시자는 플랫폼이 여전히 조직 이름 변경을 지원하는지 여부를 물었습니다. 또한 이 특정 관리 요청과 관련하여 팀에 연락하는 대체 방법에 대한 안내도 요청했습니다.
Hugging Face에서 조직 이름 변경 절차에 대해 사용자가 문의
ThoughtDAG는 로컬 LLM을 위한 명시적 그래프 컨텍스트 제어를 테스트합니다
ThoughtDAG는 대화 에지를 모델 컨텍스트를 제어하는 메커니즘으로 사용하는 오픈소스, 로컬 우선 워크스페이스입니다. 각 질문-답변 교환은 노드 역할을 하며, 선행 연결된 노드만 다음 모델 요청에 직렬화됩니다.
llama.cpp가 MXFP4 재패킹 및 채팅 템플릿과 함께 Kimi-K3 모델 지원을 추가함
llama.cpp 프로젝트는 Kimi-K3 텍스트 모델에 대한 지원을 추가했으며, 이전의 Kimi-Linear-48B에는 없었던 하이브리드 KDA(선형) + MLA(전체) 어텐션 아키텍처와 다섯 가지 특정 아키텍처 기능을 구현했습니다.
llama.cpp b10447이 yield_to_queue 스레드 모델을 재설계
llama.cpp 프로젝트는 `yield_to_queue` 스레드 모델의 재설계를 포함한 빌드 b10447을 출시했습니다. 이 변경 사항에는 워커에서 `common_speculative_process`를 실행하고 워커-메인 스레드 디자인을 교체하는 작업이 포함됩니다.
llama.cpp b10444이 MTP 어시스턴트 모델 지원을 추가하고 eagle3를 제거
llama.cpp 프로젝트는 `--models-dir` 플래그를 통해 멀티 토큰 예측(MTP) 어시스턴트 모델을 로드하는 지원을 도입한 버전 b10444을 출시했습니다. 이 업데이트에는 프리셋에서 MTP 모델에 대한 엄격한 접두사 확인이 포함되고 eagle3 드래프트 유형에 대한 지원이 제거되었습니다.
구 기반 분석을 통한 트랜스포머 출력의 기하학적 제어 공개
"Steer on a Sphere: Geometric Control of Transformer Outputs"라는 제목의 사전 인쇄물은 트랜스포머의 숨겨진 상태의 기하학을 분석하며, 이들이 차원 크기가 아닌 레이어별 RMSNorm 스케일로 정의된 구 위에 존재한다는 것을 발견했습니다. 이 반경은 DeepSeek-7B 및 Mistral-7B와 같은 아키텍처 간에 크게 다릅니다.