[모델]BFL, 로봇 제어 오픈 모델 FLUX 3 Action 공개
이미지 생성 모델 FLUX로 잘 알려진 Black Forest Labs가 7B 규모의 오픈 가중치 로봇 제어 모델인 'FLUX 3 Action'을 공개했습니다. 이 모델은 카메라 화면과 로봇 상태, 텍스트 명령을 입력받아 미래 비디오 프레임과 다음 행동을 동시에 예측합니다. 로봇 벤치마크인 RoboLab-120에서 최고 수준의 성능을 기록한 것으로 전해졌습니다.
전문 읽기접기
무슨 일이야
FLUX 이미지 모델을 개발한 Black Forest Labs(BFL)가 로봇 제어를 위한 월드 액션 모델(World Action Model, WAM) 'FLUX 3 Action'을 선보였습니다.
FLUX 3 Action은 7B(70억 개) 파라미터 크기의 오픈 가중치 모델입니다. 카메라 영상 프레임과 로봇의 현재 상태, 텍스트 지시어를 종합적으로 읽어 들인 뒤, 미래의 비디오 화면과 로봇이 수행해야 할 다음 행동 묶음을 함께 예측하는 방식으로 작동합니다.
이 모델은 로봇 제어 평가 벤치마크인 RoboLab-120에서 1위(Tops RoboLab-120)를 차지했다고 알려졌습니다.
왜 중요해
이미지 생성 분야에서 강세를 보이던 BFL이 물리 세계와 상호작용하는 로봇 및 월드 액션 모델 영역으로 연구 범위를 넓혔다는 점에서 주목할 만합니다. 또한 독점 모델이 아닌 7B 오픈 가중치 형태로 공개되어, 로봇공학 및 임바디드 AI를 연구하는 개발자와 연구진이 직접 활용해 볼 수 있는 선택지가 늘어났습니다.
짚고 넘어갈 점
현재 공개된 내용 외에 라이선스 조건, 세부 훈련 데이터셋, RoboLab-120 벤치마크의 구체적인 점수 등 상세 기술 정보는 원문에 명시되지 않아 추가 발표를 확인할 필요가 있습니다.
참고: MarkTechPost
댓글 0
첫 댓글을 남겨보세요.