베이징 첸싱 지에통 테크 주식회사의 영업 사원은 매우 전문적이고 참을성 있습니다. 그들은 빨리 인용을 제공할 수 있습니다. 제품의 품질과 패키징은 또한 매우 좋습니다. 우리의 협력은 매우 매끄럽습니다.
—— 《Festfing DV》LLC
내가 긴급히 인텔 CPU와 토시바 SSD를 찾고 있었늘 때, 베이징 첸싱 지에통 기술 주식회사로부터의 샌디는 나에게 많은 도움을 주었고, 나에게 빨리 필요로 한 제품을 가져다 주었습니다. 나는 정말로 그녀를 압니다.
—— 고양이 엔
베이징 첸싱 지에통 기술 주식회사의 샌디는 내가 서버를 구입할 때 제시간에 나에게 구성 오류를 상기시킬 수 있는 매우 주의깊은 판매원을 있습니다. 엔지니어들은 또한 매우 전문적이고, 빠르게 테스팅 프로세스를 완료할 수 있습니다.
—— 스트렐킨 미하일 블라드미로비치
베이징 첸싱지에통과의 협업에 매우 만족합니다. 제품 품질이 훌륭하고, 배송도 항상 제 시간에 이루어집니다. 영업팀은 전문적이고, 인내심이 많으며, 모든 질문에 매우 친절하게 답변해 줍니다. 그들의 지원에 진심으로 감사드리며, 장기적인 파트너십을 기대합니다. 강력 추천합니다!
—— Ahmad Navid
품질: 제 공급업체와의 좋은 경험. 미크로틱 RB3011은 이미 사용되었지만 매우 좋은 상태로 모든 것이 완벽하게 작동합니다. 통신은 빠르고 원활했습니다.그리고 제 모든 걱정은 빠르게 해결되었습니다.매우 신뢰할 수 있는 공급자
—— 제란 콜레시오
제가 지금 온라인 채팅 해요
회사 뉴스
Majestic Labs는 메모리 바운드 GPU 문제를 해결하고자 합니다
스타트업 Majestic Labs는 AI 추론이 고대역폭 메모리에 의존하는 것을 제거하여 LLM KV 캐싱으로 인한 병목 현상을 해결하는 것을 목표로 합니다.
이 회사의 Prometheus 서버 설계는 값비싼 GPU를 독점적인 Ignite AI Processing Units(AIU)로 대체합니다. Ignite AIU는 데이터센터급 ARM 코어와 LLM에 최적화된 RISC-V 벡터 및 텐서 엔진을 통합한 모놀리식 하이브리드 다이입니다. 모든 AIU는 LPDDR6 DRAM 기반의 단일 공유 메모리 풀 내에서 작동합니다. 한 서버는 8~128TB의 분산 통합 메모리에 액세스하는 1~12개의 AIU를 호스팅하며, 총 대역폭은 25.6TB/s입니다.
반면, 8개의 Blackwell GPU가 장착된 NVIDIA DGX B300 AI 서버는 2.3TB의 HBM3e GPU 메모리와 최대 4TB의 DDR5 시스템 메모리, 그리고 14.4TB/s의 피크 저지연 상호 연결 대역폭만 제공합니다. Prometheus 플랫폼은 NVIDIA 장비의 GPU 메모리 용량의 50배 이상, 대역폭의 1.7배를 제공합니다.
Majestic의 공동 창립자들은 GPU-HBM 페어링이 프리미엄 고가 컴퓨팅과 심각하게 제한된 메모리 용량을 결합한다고 주장합니다. 제한은 제한된 GPU 다이 에지 연결, 짧은 인터포저 케이블 길이, 그리고 HBM을 12개 레이어 이상으로 확장하는 데 따르는 실질적인 장벽에서 발생합니다.
이들은 GPU-HBM 아키텍처를 메모리 바운드 데드 엔드라고 부릅니다. 대신, 이 회사는 최대 1미터 길이의 소형 구리 케이블로 연결된 확장 가능한 맞춤형 메모리 집적 회로(MAC)를 통해 방대한 메모리 풀에 연결된 비용 효율적인 프로세서를 제안합니다. MAC는 온보드 메모리 칩 옆에 배치되며, 각 칩렛은 여러 DRAM 다이에 공급됩니다.
서버의 통합 메모리 공간은 완전히 연속적이고 일관성을 유지합니다. AIU는 MAC에 연결된 메시 토폴로지의 공유 메모리를 통해 통신하며, MAC의 총 수는 공개되지 않았습니다.
간단한 계산으로 메모리 규모를 알 수 있습니다. 표준 2GB LPDDR6 다이는 128TB Prometheus 서버에 최대 64,000개의 개별 LPDDR6 다이가 필요하며, 이는 장치당 수십 개, 아마도 수백 개의 MAC 칩렛이 필요함을 의미합니다.
표준 40U 랙에는 최대 4개의 Prometheus 서버를 수용할 수 있으며, 각 서버에는 12개의 AIU가 장착됩니다. 전체 랙은 120kW를 소비하며 콜드 플레이트 액체 냉각을 사용합니다. Majestic은 이러한 랙 하나가 25개의 NVIDIA NVL72 Vera Rubin 랙과 동일한 고속 메모리를 훨씬 적은 전력으로 제공하여, 하이퍼스케일러급 인프라를 감당할 수 없는 기업에게 대규모 AI 워크로드를 제공한다고 주장합니다. 이 설계는 프로세서당 최대 1,000배 더 많은 메모리를 제공합니다.
메모리 병목 현상을 제거하면 초장기 컨텍스트 창을 가진 최첨단 거대 프론티어 모델을 효율적으로 호스팅할 수 있습니다. 이는 에이전트 AI, 추론, 그래프 신경망, 테이블 모델, 비디오 생성 및 신흥 AI 아키텍처를 최적화하여 랙당 100배 더 많은 사용자를 지원하고 전력 소비를 절감합니다. 고객은 훨씬 낮은 전력 및 자본 비용으로 단일 서버에서 수조 개의 매개변수 모델, 대규모 컨텍스트 창, 에이전트 시스템 및 MoE 프레임워크를 실행할 수 있습니다.
Majestic은 내년 출시 시점에 자사 하드웨어가 동등한 성능의 GPU 서버보다 10~50배 저렴할 것으로 예상하며, 전력 효율성도 뛰어날 것입니다. Prometheus 서버는 OCP 표준을 준수하며 PyTorch, vLLM 및 OpenAI의 Triton 추론 프레임워크를 네이티브로 지원하여 기존 AI 모델의 원활한 마이그레이션을 가능하게 합니다.
각주
Majestic Labs는 2023년 텔아비브에서 전 Google 및 Meta 출신의 칩 설계, 제조 및 배송 베테랑 3명(CEO Ofer Shacham, 사장 Sha Rabii, COO Masumi Reynders)에 의해 설립되었습니다. 이 회사는 텔아비브와 로스앤젤레스 사무실에 약 40명의 직원을 두고 있으며, 2025년 말 1억 달러 규모의 시리즈 A 펀딩 라운드를 확보했습니다. 이 회사는 타사 가속기 IP를 라이선스하고 Ignite AIU를 위한 맞춤형 코어를 개발합니다. Majestic은 엔터프라이즈, 프라이빗 클라우드 및 하이퍼스케일러 대상 고객으로부터 상당한 사전 주문을 보고했습니다.
베이징 첸싱 지에통 기술 유한회사 Sandy Yang/글로벌 전략 이사 WhatsApp / WeChat: +86 13426366826 이메일: yangyd@qianxingdata.com 웹사이트: www.qianxingdata.com/www.storagesserver.com 비즈니스 초점: ICT 제품 유통/시스템 통합 및 서비스/인프라 솔루션 20년 이상의 IT 유통 경험을 바탕으로 선도적인 글로벌 브랜드와 협력하여 신뢰할 수 있는 제품과 전문 서비스를 제공합니다. “기술을 사용하여 지능형 세계를 구축하십시오” 귀하의 신뢰할 수 있는 ICT 제품 서비스 제공업체!