xAI, 코딩 및 지식 작업을 위한 Grok 4.7 출시
xAI가 어려운 코딩 작업과 일반 지식 작업의 성능을 개선하도록 설계된 새로운 모델인 Grok 4.7을 출시했습니다. 이 모델은 더 큰 기본 모델과 확장된 강화 학습을 활용하여 긴 컨텍스트 시나리오를 더 잘 처리하고 자체 출력을 검증합니다.
xAI가 어려운 코딩 작업과 일반 지식 작업의 성능을 개선하도록 설계된 새로운 모델인 Grok 4.7을 출시했습니다. 이 모델은 더 큰 기본 모델과 확장된 강화 학습을 활용하여 긴 컨텍스트 시나리오를 더 잘 처리하고 자체 출력을 검증합니다.
xAI는 버전 1.0보다 정확도가 두 배 높으면서도 동일한 가격을 유지하는 음성-텍스트 모델인 Grok Voice Transcribe 2.0을 출시했습니다. Grok Voice의 오디오 파운데이션 모델 위에 구축되었으며, 불안정한 전화 회선과 경쟁하는 음성 같은 어려운 현실 세계 조건을 처리하기 위해 라이브 노이즈가 있는 다국어 오디오의 고유한 데이터셋을 활용합니다.
LatchBio는 Grok 4.6에 대한 BioSecBench-Refusal 및 BioSecBench-Surveillance 벤치마크에서의 독립 분석을 발표했으며, 테스트된 최전방 시스템 중 위장된 위험 과제를 거부하는 데 가장 강력한 모델임을 발견했습니다.
xAI는 사용자가 팀원들과 함께 작동하고 학습할 수 있는 공유 Grok 봇을 생성할 수 있는 기능인 "Team Bots"를 출시했습니다. 이 봇들은 각 사용자의 대화에 대한 개인 정보를 유지하면서 파일, 앱 및 전문 지식을 모든 구성원이 접근 가능한 단일 컨텍스트로 통합합니다.
SpaceXAI는 Cursor 인수 이후 통합 고객 지원 운영에 Grok Bot AI 에이전트를 통합하여, 인력 추가 없이 지원 티켓이 175% 증가하는 상황을 관리할 수 있게 되었다. 이 회사는 약 200명의 신규 직원 채용을 피하고, Grok Bot의 사용량 기반 가격 모델을 활용하여 티켓당 해결 비용을 $0.20에서 $0.30 사이로 낮췄다.
Grok Build는 이제 한 세션에서 다음 세션으로 관례, 결정 및 사실을 자동으로 기록하여 프로젝트 컨텍스트를 유지합니다. 사용자가 작업하는 동안 시스템은 워크플로우를 중단하지 않고 백그라운드에서 영구 정보를 캡처합니다.
xAI는 기업 조달 작업을 관리하기 위해 "Haggle Bot"이라는 자율 에이전트를 배포했으며, 공급업체 지출, 계약 및 사용 데이터를 분석하여 직접적인 비용 절감 규모가 10만 달러를 초과하는 것을 성공적으로 확인했습니다. 이 봇은 Slack, Notion, Ramp, Gmail과 같은 도구에 접근할 수 있어 단계별 인간 개입 없이 SaaS 구독을 감사하고 갱신을 협상하며 정기 구매를 최적화할 수 있습니다.
xAI는 Grok Bot을 세션 간 책임을 유지하는 지속형 에이전트로 설계했으며, 인터페이스의 초점을 일회성 채팅 스레드에서 장기적인 Bots로 전환했습니다. 이 시스템은 상호작용을 다섯 가지 핵심 개념을 중심으로 구성합니다: Bots, Chats, Routines, Tools, Memories.
xAI는 기업 고객에게 Grok Bot을 사용할 수 있게 했으며, 대규모로 봇을 관리하기 위해 액세스, 네트워크 및 감사 제도를 도입했습니다. 이번 릴리스로 조직은 기존 도구와 워크플로우 내에서 작동하는 자율 AI 직원을 생성할 수 있습니다.
SpaceXAI는 Grok 4.6보다 더 큰 기본 모델과 확장된 강화 학습 실행을 활용하는 코딩, 에이전트 작업 및 지식 작업을 위한 새로운 플래그십 모델인 Grok 4.7을 출시했습니다. 이 모델은 전작과 동일한 가격 체계를 유지하면서도 자체 검증, 긴 컨텍스트 처리 및 안전성 측면에서 향상된 기능을 제공합니다.
2026년 9월 12일, Anthropic CEO Dario Amodei는 AI 능력 향상 속도를 늦추도록 촉구하는 'We Must Pace the Frontier'라는 제목의 에세이를 발표했다. 이 제안에는 교육 파이프라인에 직원 수준의 접근 권한을 가진 제3자 '임베디드 평가자' 설립, 프런티어 연구소 간 안전 표준 조정, AI 제한에 대한 글로벌 합의 추진 등 세 단계 계획이 포함된다.
한 연구에 따르면 Claude Code, Codex, Antigravity, Open Code 및 Grok Build를 포함한 로컬 LLM 에이전트는 자체 실행 로그를 수정하는 것에 대한 경계를 강제하지 않는 것으로 나타났습니다. 이 연구는 이러한 에이전트가 모니터 가드레일을 트리거하지 않고 요청 시 추적을 삭제할 수 있음을 보여주며, 이는 외부 공격자가 악용할 수 있는 취약점입니다.
샤오미는 대화형 3D 장면을 구축하고 시각적으로 테스트하기 위해 에이전트를 조정하도록 설계된 MiMo-V2.6 Pro 및 Flash 오모다모델 모델을 오픈소스화했습니다. 이 모델은 Blender 애셋을 생성하고, 카메라 피드에서 로봇 팔을 제어하며, 프론트엔드와 프레젠테이션을 제작하고, 비디오를 조립하고, 악보와 MIDI로 음악을 작곡할 수 있습니다.
소송은 Anthropic, OpenAI, SpaceX AI, Google이 인공지능 개발을 의도적으로 늦추기 위해 불법 계약을 맺었다고 주장합니다. 이 고발장은 AI의 진전을 제한하기 위한 이 네 주요 기술 기업들의 alleged 한 협력을 대상으로 합니다.
SpaceXAI가 호스팅 API를 통해 제공되는 음성-텍스트 모델인 Grok Voice Transcribe 2.0을 출시했으며, 이는 동일한 가격대에서 버전 1.0 대비 두 배의 정확도를 주장합니다. 이 모델은 시끄러운 전화 회선과 경쟁하는 음성 등 어려운 오디오 조건을 대상으로 하며, 배치 및 실시간 스트리밍 모드에서 실행됩니다.
AI 평가 포럼(AI Evaluator Forum)이 접근성, 이해상충, 자금 관계, 기피, 투명성을 아우르는 독립적인 제3자 AI 평가를 위한 제안된 기준선인 AEF-1을 발표했습니다. 이 표준은 Dario Amodei가 프론티어 AI 기업들에게 임베디드 제3자 평가자들이 직원과 유사한 지속적인 접근 권한을 갖도록 약속할 것을 요구하는 제안과 함께 등장했습니다.