logo
사건

VAST 데이터와 AMD는 Instinct에서 KV 캐시 오프로드로 9배 더 빠른 첫 번째 토큰 시간

인증
중국 Beijing Qianxing Jietong Technology Co., Ltd. 인증
중국 Beijing Qianxing Jietong Technology Co., Ltd. 인증
고객 검토
베이징 첸싱 지에통 테크 주식회사의 영업 사원은 매우 전문적이고 참을성 있습니다. 그들은 빨리 인용을 제공할 수 있습니다. 제품의 품질과 패키징은 또한 매우 좋습니다. 우리의 협력은 매우 매끄럽습니다.

—— 《Festfing DV》LLC

내가 긴급히 인텔 CPU와 토시바 SSD를 찾고 있었늘 때, 베이징 첸싱 지에통 기술 주식회사로부터의 샌디는 나에게 많은 도움을 주었고, 나에게 빨리 필요로 한 제품을 가져다 주었습니다. 나는 정말로 그녀를 압니다.

—— 고양이 엔

베이징 첸싱 지에통 기술 주식회사의 샌디는 내가 서버를 구입할 때 제시간에 나에게 구성 오류를 상기시킬 수 있는 매우 주의깊은 판매원을 있습니다. 엔지니어들은 또한 매우 전문적이고, 빠르게 테스팅 프로세스를 완료할 수 있습니다.

—— 스트렐킨 미하일 블라드미로비치

베이징 첸싱지에통과의 협업에 매우 만족합니다. 제품 품질이 훌륭하고, 배송도 항상 제 시간에 이루어집니다. 영업팀은 전문적이고, 인내심이 많으며, 모든 질문에 매우 친절하게 답변해 줍니다. 그들의 지원에 진심으로 감사드리며, 장기적인 파트너십을 기대합니다. 강력 추천합니다!

—— Ahmad Navid

품질: 제 공급업체와의 좋은 경험. 미크로틱 RB3011은 이미 사용되었지만 매우 좋은 상태로 모든 것이 완벽하게 작동합니다. 통신은 빠르고 원활했습니다.그리고 제 모든 걱정은 빠르게 해결되었습니다.매우 신뢰할 수 있는 공급자

—— 제란 콜레시오

제가 지금 온라인 채팅 해요

VAST 데이터와 AMD는 Instinct에서 KV 캐시 오프로드로 9배 더 빠른 첫 번째 토큰 시간

July 28, 2026
VAST 데이터 (VAST Data) 는 모델 트레이닝, 추론, 검색 증강 생성 (RAG) 을 실행하는 클라우드 및 엔터프라이즈 플랫폼을 위한 AI 인프라를 발전시키기 위해 AMD와의 파트너십을 확장했습니다.그리고 대행성 인공지능 작업 부하통합 스택은 VAST AI 운영 체제와 6 차 세대 AMD EPYC 프로세서, AMD Instinct GPU, AMD 네트워크 하드웨어 및 ROCm 소프트웨어를 통합합니다.

이 협업은 산업의 큰 변화와 일치합니다. 인공지능 인프라는 훈련만 하는 클러스터를 넘어 지속적인 컨텍스트, 높은 경쟁 추론,그리고 다중 턴 에이전트 작업 흐름현대 인공지능 배포는 효율적인 데이터 이동, 최적화된 KV 캐시 관리, 높은 GPU 활용 및 대규모 모델 및 컨텍스트 데이터 세트에 낮은 지연 접근을 우선 순위로합니다.

VAST의 분산 공유 모든 것 (DASE) 아키텍처는 이러한 현대 AI 환경의 통합 공유 데이터 계층으로 기능합니다. 파일 및 객체 저장, 데이터베이스,이벤트 스트리밍, 및 단일 글로벌 네임스페이스 아래 핵심 데이터 서비스, 동시에 다양한 동시 고객 및 응용 프로그램 작업을 실행하는 AI 클라우드에서 멀티 임대 및 워크로드 고립을 제공합니다.

AMD EPYC 9006 파워즈 다음 세대 VAST 하드웨어

VAST는 VAST AI 운영 체제의 하드웨어 기반을 이루는 6세대 CBox 및 3세대 EBox 시스템을 위해 6세대 AMD EPYC 9006 시리즈 (베니스) 프로세서를 채택하고 있다.EPYC 9006 플랫폼은 PCIe Gen6 연결을 VAST의 하드웨어 라인업에 도입합니다., 1세대 I/O 대역폭을 두 배로 늘립니다.

최신 회사 사례 VAST 데이터와 AMD는 Instinct에서 KV 캐시 오프로드로 9배 더 빠른 첫 번째 토큰 시간  0

이 업그레이드는 파일 및 객체 저장 처리량을 증가시키고 VAST 데이터베이스와 데이터 엔진이 지원하는 데이터베이스, 데이터 웨어하우스 및 이벤트 스트리밍 워크로드의 지연 시간을 감소시킵니다.향상된 I/O 대역폭은 컴퓨팅 전체에 있는 병목을 완화합니다., 네트워킹 및 NVMe 스토리지, 모델 로딩, 검색 파이프 라인, 체크 포인트 액세스 및 내성 GPU 메모리 한도를 초과하는 외부 KV 캐시 워크플로우에 혜택을 제공합니다.

AMD 및 DriveNets와 함께 3 플레이어 참조 아키텍처

VAST, AMD 및 DriveNets는 공동으로 AMD의 랙 규모 Helios AI 인프라, VAST AI OS 및 DriveNets AI Fabric 네트워킹을 결합한 통합 AI 인프라 참조 아키텍처를 구축하고 있습니다.이 프레임 워크는 인공지능 훈련에 대한 표준화된 배포 지침을 제공합니다., 추론, 강화 학습 및 KV 캐시 작업 부하공유 데이터 인프라와 고성능 네트워킹을 갖춘 인공지능 공장을 구축하는 기업을 위한 사이즈링 및 가용성 우수 사례 제공.

VAST는 또한 추론 공급업체인 TensorMesh와 EmbeddedLLM와의 생태계 관계를 확장했으며, 에이전틱 AI 사용 사례를 위한 생산 수준의 추론 아키텍처에 초점을 맞추고 있습니다.아직 공개되지 않은 구체적인 통합 및 발사 세부 사항.

높은 동류 추론을 위해 KV 캐시 오프로드 최적화

업데이트 된 협업의 핵심은 향상된 KV 캐시 오프로드이며 AMD Instinct GPU, AMD Infinity Context, ROCm 소프트웨어 및 VAST AI OS를 활용합니다.KV 캐시는 멀티 턴 상호 작용과 긴 컨텍스트 AI 워크로드를 가속화하기 위해 추론 생성 주의 상태 데이터를 저장합니다., 그러나 큰 캐시 크기는 제한된 GPU 메모리를 빠르게 소비합니다.

최신 회사 사례 VAST 데이터와 AMD는 Instinct에서 KV 캐시 오프로드로 9배 더 빠른 첫 번째 토큰 시간  1

고성능 공유 스토리지로 KV 캐시를 오프로드하거나 계층화하면 후속 추론 요청에 대한 컨텍스트 데이터를 보존하는 동시에 활성 작업에 GPU 메모리를 자유롭게합니다.AMD Instinct MI355X GPU에 대한 초기 테스트는 9배 더 빠른 첫 번째 토큰 시간 및 9배 더 빠른 토큰 시간.7배 더 높은 토큰 처리량으로 VAST가 구동되는 KV 캐시 오프로드를 통해 높은 동행성 에이전틱 AI 워크로드를 위해 하드웨어 기본 라인, 워크로드 및 스토리지 구성에 따라 성능이 달라집니다.

또한 VAST의 자동화 된 라이프 사이클 정책은 KV 캐시 데이터에 적용되며, 캐시 된 콘텐츠의 예정된 만료 및 삭제개인 또는 규제된 추론 데이터.

펜산도 폴라라 400를 통한 고속 GPU- 스토리지 인터 커넥트

아키텍처는 AMD Pensando Pollara 400 AI NIC를 배포하여 AMD Instinct GPU를 VAST 스토리지 클러스터에 연결합니다. TCP 및 RDMA를 통해 NFS를 지원합니다.NIC는 효율적인 GPU에서 스토리지 데이터 전송을 가능하게 합니다., KV 캐시 및 일반적인 추론 작업 부하를 위해 NVMe 기반 VAST 스토리지에 낮은 지연 시간을 허용합니다.

이 디자인은 컨텍스트 관리 확장 기능을 물리적인 GPU 메모리 제한에서 분리합니다.VAST는 분산 모델 관리를 위한 통합 데이터 및 실행 계층으로 플랫폼을 배치합니다., 데이터베이스, 스트리밍, 파일 자산 및 AI 컨텍스트. AI 클라우드 공급 업체에 대한 구조는 GPU 활용도와 운영 효율성을 높입니다.산업의 대량 교육 및 GPU 임대에서 지속적인 추론 및 에이전틱 AI 서비스에 전환을 지원합니다..

베이징 첸징 지에텐 기술 회사, Ltd
샌디 양/글로벌 전략 책임자
왓츠앱 / 위ቻ트: +86 13426366826
이메일: yangyd@qianxingdata.com
웹사이트: www.qianxingdata.com/www.storagesserver.com
비즈니스 초점:
ICT 제품 유통/시스템 통합 및 서비스/인프라 솔루션
20년 이상의 IT 유통 경험을 바탕으로, 우리는 신뢰할 수 있는 제품과 전문적인 서비스를 제공하기 위해 세계적인 대표 브랜드와 파트너십을 맺습니다.
지능형 세계를 만들기 위해 기술을 사용하세요
연락처 세부 사항
Beijing Qianxing Jietong Technology Co., Ltd.

담당자: Ms. Sandy Yang

전화 번호: 13426366826

회사에 직접 문의 보내기 (0 / 3000)