IBM, 네이티브 추론 기능과 Granite Speech 5.0 Turbo를 탑재한 Granite 4.2 출시
IBM은 엔터프라이즈 에이전틱 워크플로우에 특화되어 있으며 네이티브 단계별 추론 기능을 갖춘 Granite 4.2 언어 모델을 3B, 8B, 30B 파라미터 크기로 출시했습니다.
IBM은 엔터프라이즈 에이전틱 워크플로우에 특화되어 있으며 네이티브 단계별 추론 기능을 갖춘 Granite 4.2 언어 모델을 3B, 8B, 30B 파라미터 크기로 출시했습니다.
IBM은 3B, 8B, 30B 크기의 밀집 디코더 전용 추론 대형 언어 모델 패밀리인 Granite 4.2를 출시했습니다. 이 모델들은 약 15조 개의 토큰으로 처음부터 사전 훈련되었으며, 512K 토큰으로 확장된 컨텍스트 창을 특징으로 합니다.
IBM와 Confluent은 IBM의 Granite Time Series Foundation Models(TSFM)를 Confluent Cloud에 통합하여 Apache Flink 내에서 직접 실시간 예측 및 이상 감지를 가능하게 했습니다.
IBM은 약 15조 개의 토큰으로 사전 훈련되고, 단순한 지시 따르기보다는 명시적인 사고 과정(chain-of-thought) 능력을 중심으로 구축된 3B, 8B, 30B 파라미터 크기의 오픈소스 추론 언어 모델 패밀리인 Granite 4.2를 출시했습니다. 이 모델들은 디코더 전용 밀집 트랜스포머이며, 더 큰 변종에는 에이전트 RL을 포함한 다단계 강화 학습 체인을 통해 사후 훈련되었습니다.
IBM은 녹음 작업용으로 설계된 새로운 음성-텍스트 솔루션인 Granite Speech 5.0 Turbo CTC 모델을 출시했습니다.
IBM은 플래그십 30B, 미드사이즈 8B, 컴팩트 3B 변형을 특징으로 하는 오픈소스 추론 모델인 Granite 4.2 패밀리를 출시했습니다. 이 모델들은 수학, 코딩 및 복잡한 다단계 문제에서 성능을 향상시키기 위해 네이티브 사슬 사고 기능을 활용합니다.
IBM은 Granite Speech 계열에 두 개의 새로운 경량 470M 파라미터 영어 음성 인식 모델을 출시했습니다: `granite-speech-5.0-470m-turboctc`와 `granite-speech-5.0-470m-turboctc-nc`. 인코더 전용 모델은 NVIDIA H200 GPU에서 높은 정확도를 유지하면서 12,600 RTFx 이상의 전례 없는 변환 속도를 달성합니다.
llama.cpp 프로젝트는 IBM's GraniteSWAForCausalLM 및 GraniteMoeSWAForCausalLM 아키텍처를 위한 변환 인프라를 도입한 버전 b10514를 출시했습니다. 이 업데이트는 사용자가 이러한 특정 모델 유형을 llama.cpp와 함께 사용하기 위해 GGUF 형식으로 변환할 수 있도록 합니다.
브룩헤이븐 국립연구소와 Hydro-Québec 등 파트너들과 함께 IBM Research는 정상 상태 그리드 분석을 위한 오픈소스 기하학적 신경 보정 솔버인 GENCO를 공개했습니다. 이번 릴리스는 Linux Foundation Energy(LF Energy)가 호스팅하는 OpenGridFM 프로젝트의 일환이며, 신경 그리드 솔버 구축 및 벤치마킹을 촉진하기 위해 GridFM 개발 프레임워크를 포함합니다.