연구소 · xAI
lab xAI News · 12일 전 · 조회수 30회

xAI, v1보다 정확도가 두 배인 Grok Voice Transcribe 2.0 출시

xAI는 버전 1.0보다 정확도가 두 배 높으면서도 동일한 가격을 유지하는 음성-텍스트 모델인 Grok Voice Transcribe 2.0을 출시했습니다. Grok Voice의 오디오 파운데이션 모델 위에 구축되었으며, 불안정한 전화 회선과 경쟁하는 음성 같은 어려운 현실 세계 조건을 처리하기 위해 라이브 노이즈가 있는 다국어 오디오의 고유한 데이터셋을 활용합니다.

lab xAI News · 8일 전 · 조회수 27회

SpaceXAI는 Grok Bot을 활용해 채용 없이 티켓 급증 175%를 처리

SpaceXAI는 Cursor 인수 이후 통합 고객 지원 운영에 Grok Bot AI 에이전트를 통합하여, 인력 추가 없이 지원 티켓이 175% 증가하는 상황을 관리할 수 있게 되었다. 이 회사는 약 200명의 신규 직원 채용을 피하고, Grok Bot의 사용량 기반 가격 모델을 활용하여 티켓당 해결 비용을 $0.20에서 $0.30 사이로 낮췄다.

lab xAI News · 26일 전 · 조회수 50회

xAI의 Haggle Bot이 조달 비용에서 10만 달러 이상의 절감 효과를 확인

xAI는 기업 조달 작업을 관리하기 위해 "Haggle Bot"이라는 자율 에이전트를 배포했으며, 공급업체 지출, 계약 및 사용 데이터를 분석하여 직접적인 비용 절감 규모가 10만 달러를 초과하는 것을 성공적으로 확인했습니다. 이 봇은 Slack, Notion, Ramp, Gmail과 같은 도구에 접근할 수 있어 단계별 인간 개입 없이 SaaS 구독을 감사하고 갱신을 협상하며 정기 구매를 최적화할 수 있습니다.

media MarkTechPost · 8일 전 GDPval-AA (Elo) · 1695.0Elo · 조회수 23회

SpaceXAI가 더 큰 기본 모델과 향상된 벤치마크를 갖춘 Grok 4.7 출시

SpaceXAI는 Grok 4.6보다 더 큰 기본 모델과 확장된 강화 학습 실행을 활용하는 코딩, 에이전트 작업 및 지식 작업을 위한 새로운 플래그십 모델인 Grok 4.7을 출시했습니다. 이 모델은 전작과 동일한 가격 체계를 유지하면서도 자체 검증, 긴 컨텍스트 처리 및 안전성 측면에서 향상된 기능을 제공합니다.

media MarkTechPost · 17일 전 · 조회수 40회

Anthropic, 임베디드 평가자를 포함한 '프런티어 속도 조절' 계획 제안

2026년 9월 12일, Anthropic CEO Dario Amodei는 AI 능력 향상 속도를 늦추도록 촉구하는 'We Must Pace the Frontier'라는 제목의 에세이를 발표했다. 이 제안에는 교육 파이프라인에 직원 수준의 접근 권한을 가진 제3자 '임베디드 평가자' 설립, 프런티어 연구소 간 안전 표준 조정, AI 제한에 대한 글로벌 합의 추진 등 세 단계 계획이 포함된다.

arxiv arXiv cs.AI · 6일 전 · 조회수 13회

LLM 에이전트는 자신의 실행 추적을 쉽게 조작합니다

한 연구에 따르면 Claude Code, Codex, Antigravity, Open Code 및 Grok Build를 포함한 로컬 LLM 에이전트는 자체 실행 로그를 수정하는 것에 대한 경계를 강제하지 않는 것으로 나타났습니다. 이 연구는 이러한 에이전트가 모니터 가드레일을 트리거하지 않고 요청 시 추적을 삭제할 수 있음을 보여주며, 이는 외부 공격자가 악용할 수 있는 취약점입니다.

media TLDR AI · 8일 전 · 조회수 21회

샤오미, MiMo-V2.6 Pro 및 Flash 모델 오픈소스화

샤오미는 대화형 3D 장면을 구축하고 시각적으로 테스트하기 위해 에이전트를 조정하도록 설계된 MiMo-V2.6 Pro 및 Flash 오모다모델 모델을 오픈소스화했습니다. 이 모델은 Blender 애셋을 생성하고, 카메라 피드에서 로봇 팔을 제어하며, 프론트엔드와 프레젠테이션을 제작하고, 비디오를 조립하고, 악보와 MIDI로 음악을 작곡할 수 있습니다.

media MarkTechPost · 12일 전 · 조회수 16회

SpaceXAI,claimed 2배 정확도를 내세운 Grok Voice Transcribe 2.0 API 출시

SpaceXAI가 호스팅 API를 통해 제공되는 음성-텍스트 모델인 Grok Voice Transcribe 2.0을 출시했으며, 이는 동일한 가격대에서 버전 1.0 대비 두 배의 정확도를 주장합니다. 이 모델은 시끄러운 전화 회선과 경쟁하는 음성 등 어려운 오디오 조건을 대상으로 하며, 배치 및 실시간 스트리밍 모드에서 실행됩니다.

media Latent Space · 16일 전 · 조회수 44회

제3자 평가자를 위한 AEF-1 표준 등장, Xai·OpenAI·Anthropic 모두 서명

AI 평가 포럼(AI Evaluator Forum)이 접근성, 이해상충, 자금 관계, 기피, 투명성을 아우르는 독립적인 제3자 AI 평가를 위한 제안된 기준선인 AEF-1을 발표했습니다. 이 표준은 Dario Amodei가 프론티어 AI 기업들에게 임베디드 제3자 평가자들이 직원과 유사한 지속적인 접근 권한을 갖도록 약속할 것을 요구하는 제안과 함께 등장했습니다.