본문으로 건너뛰기

KJCLUB 한일 문화교류에 오신 것을 환영합니다.

삼성에 희소식

조회수 : 551
JA 0 ひょうたん 2,811,753
OEM로 구매하면 좋아^^

후지쯔는 11월 7일, 차세대 SPARC 프로세서 「SPARC64 IXfx」를 탑재해, 1 락 당 2.5 TFlops의 이론 연산 성능을 실현한 스파콘퓨타(슈퍼컴퓨터) 「PRIMEHPC FX10」를 발표했다.

동슈퍼컴퓨터는 최대 1024 락/98304노드, 6 PB의 메모리에 의해 23.2 PFlops의 이론 연산 성능을 노래하고 있다.2011년 6월의 Top500로 1위가 된 차세대 스파콘퓨타 「경」으로 이용된 프로세서 「SPARC64 VIIIfx」로 채용하고 있던 자사 45 nm프로세스로부터, SPARC64 IXfx로 TSMC(Taiwan Semiconductor Manufacturing)의 40 nm프로세스로 변경되어 1 프로세서에 16 코어를 내장.1 코어 당 1848GHz(멀티 락 모델) 혹은 1.650GHz(싱글 락 모델)로 동작해, 이론 연산 성능은 각각 236.5 GFlops, 211.2 GFlops, 전력 근처의 처리 성능은 약 2 GFlops/W를 실현하고 있다.

또, 「경」에서도 채용된 인타코네크트 「Tofu」나, 독자 미들웨어 「Technocal Computing Suite」의 컴파일러, 라이브러리 등에 더하고, 독자 기술인 「VISIMPACT」에 의해, MPI 병렬을 조합하는 하이브리드 병렬에의 이행 자동화가 가능해지고 있다.

FX10의 특징

동슈퍼컴퓨터는 최대 1024 락/98304노드, 6 PB의 메모리에 의해 23.2 PFlops의 이론 연산 성능을 노래하고 있다.2011년 6월의 Top500로 1위가 된 차세대 스파콘퓨타 「경」으로 이용된 프로세서 「SPARC64 VIIIfx」로 채용하고 있던 자사 45 nm프로세스로부터, SPARC64 IXfx로 TSMC(Taiwan Semiconductor Manufacturing)의 40 nm프로세스로 변경되어 1 프로세서에 16 코어를 내장.1 코어 당 1848GHz(멀티 락 모델) 혹은 1.650GHz(싱글 락 모델)로 동작해, 이론 연산 성능은 각각 236.5 GFlops, 211.2 GFlops, 전력 근처의 처리 성능은 약 2 GFlops/W를 실현하고 있다.

FX10의 개요.싱글 락판과 멀티 락판이 있어, 가격은 싱글 락판으로 5000만엔 정도.멀티 락 모델은 구성에 의해 가격이 달라 지지만, 자리밤과 1 PFlops로50-70억엔 정도라는 것

또, 「경」에서도 채용된 인타코네크트 「Tofu」나, 독자 미들웨어 「Technocal ComputingSuite」의 컴파일러, 라이브러리 등에 더하고, 독자 기술인 「VISIMPACT」에 의해, MPI 병렬을 조합하는 하이브리드 병렬에의 이행 자동화가 가능해지고 있다.Tofu에 대해서는 「경」에 도입한 것과 아키텍쳐적으로는 동일한 것이라는 것으로, 프로세스 쉬링크 등은 베풀어지지 않다고 한다.

SPARC64 IXfx의 개요.1 프로세서 근처의 소비 전력은 110W.싱글 락 모델이라고, 1 시스템 근처 약 20 kW정도가 된다고 한다

초병렬 슈퍼컴퓨터의 요점이 되는 Tofu 인타코네크트의 개요.이쪽은 「경」에 채용된 것 것과 같은 것이 채용되고 있는

게다가 운용면에서의 궁리로서 미들웨어외, Linux를 베이스로 초병렬 HPC 전용으로 최적화를 베푼 것 외, 10만대 규모의 계산 노드의 제어를 신속하게 실시하는 것을 의식한 계층화에 의한 디스트리뷰티드 프로세싱의 도입, 그리고 언어 처리에도 동사가 벡터기를 제공해 왔던 시대로부터 임해 온 자동 병렬화 기술을 도입한 타카나미렬화 컴파일러/자동 SIMD화 대응이나, Open MPI를 베이스로 한 Tofu 위상기하학에의 최적화등이 베풀어지고 있다.

미들웨어, 운용 관리 환경, 언어 처리등의 소프트면에서도 초병렬로의 처리에 최적화를 베푸는 궁리가 베풀어지고 있어 그러한 커뮤니티의 활성화등도 목표로 해 간다고 하는

동사에서는 국가 레벨로의 HPC 활용 프로젝트가 세계 각지에서 움직임을 보여 오고 있는 것을 배경으로, 2015년에는 HPC 서버 시장은 1조엔 규모로 성장해, 서버 시장의 것1/4을 차지하기까지 커진다고 보고 있어 HPC의 고급 지향 분야에는 이번 FX10를, 미들 레인지에는 PC클러스터 제품, 그리고 거기까지 필요로 하지 않는 레벨의 기업에는 곳간 땅두릅 서비스로서 HPC의 능력을 제공해 나가는 것으로, 시뮬레이션 활용에 의한 「 것을 만들지 않는 것 만들기」에 의한 저비용화, 단TAT화등의 지원을 실시해, 현재의2%의 쉐어를10%까지 끌어올리고 싶다고 하고 있다.

HPC 중(안)에서도 처리 성능이나 투자금액 등에 응해 고급 지향, 미들 엔드, 로앤드와 나눌 수 있다.향후의 시장 확대의 열쇠를 잡는 것은, 곳간 땅두릅에 의한 유저층의 확대와 경제활동의 진전에 의한 대규모 연산 능력에의 요구의 증대라고 하는

벌써 유럽에서는 영국 웨일즈의 산업 활성화를 목표로 하는 프로젝트 「High Performance Computing Wales (HPCWales)」의 파트너로서 지명되고 있다.동프로젝트는 유럽 시장의 연화가 생겨도, 거의 계획대로의 투자가 진행되고 있는 영국에서도 기대되고 있는 산업 활성 프로젝트이며, 후지쯔에서도 이러한 정부계 비지니스를 발판에, 그 지역, 국가 전체에의 침투를 노려 가면 하고 있어, 일본 및 유럽을 제1 스텝, 중동이나 아시아 신흥국등을 제2 스텝, 그리고 자국 기업에 의한 경쟁력 확대등의 의미도 갖게한 Exa 스케일의 슈퍼컴퓨터 개발 계획등을 진행시키는 미국이나 중국에의 진출을 최종적인 목표라고 평가한 대처를 실시해 가면 하고 있어, 벌써 세계 전개를 향해서 유럽에 HPC의 거점을 설립하기 위한 검토를 개시했다고 한다.

덧붙여 동사에서는 GPU 컴퓨팅이나 Intel의 MIC 아키텍쳐등에 대해서도, 「Intel의 Knight 시리즈는 8 SIMD, GPGPU는 16 SIMD라고 생각해, 단지 연산기를 늘리는 편이 코어를 늘리는 것보다도 확실히 늘리는 트랜지스터 카운트의 문제에서는 편해진다.그러나, 이제(벌써) 1개의 문제로서 초병렬 연산을 저소비 전력으로 실현되기 위해서는 인타코네크트를 CPU에 내장할 필요가 있다.우리는 Tofu로, 그 제 일보를 쌓아 올릴 수 있었다.우리외, 이러한 어프로치가 현재 되어있는 것은 IBM가 Blue Gene로 실현되고 있는 것만으로 있는 것을 생각하면, 우리가 제일 Exa 스케일의 실현에 가깝다고 생각한다」라고,2018-2020해무렵이 목표로 되어 있는 Exa 스케일을 20 MW정도로 실현되는데, 가장 가까운 것은 후지쯔인 것을 강조했다.

회견한 후지쯔의 테크니컬 컴퓨팅·솔루션 사업 본부 본부장 야마다 마사히코씨(왼쪽), 동집행 임원 부사장의 좌상히데유키씨(중앙), 그리고 동차세대 테크니컬 컴퓨팅 개발 본부 본부장의 추영용차씨( 오른쪽)

FX10의 시스템 보드.CPU와 ICC는 수냉.메모리는 공냉의 하이브리드 사양.수냉식으로 하는 것으로, 동작 온도를 내릴 수 있어 이것에 의해 고장율을 내릴 수 있게 되는

원문보기

三星に朗報

OEMで仕入れると良いぞ^^

富士通は11月7日、次世代SPARCプロセッサ「SPARC64 IXfx」を搭載し、1ラックあたり2.5TFlopsの理論演算性能を実現したスーパーコンピュータ(スパコン)「PRIMEHPC FX10」を発表した。

同スパコンは最大1024ラック/98304ノード、6PBのメモリにより23.2PFlopsの理論演算性能をうたっている。2011年6月のTop500で1位になった次世代スーパーコンピュータ「京」で用いられたプロセッサ「SPARC64 VIIIfx」で採用していた自社45nmプロセスから、SPARC64 IXfxでTSMC(Taiwan Semiconductor Manufacturing)の40nmプロセスへと変更され、1プロセッサに16コアを内蔵。1コアあたり1848GHz(マルチラックモデル)もしくは1.650GHz(シングルラックモデル)で動作し、理論演算性能はそれぞれ236.5GFlops、211.2GFlops、電力あたりの処理性能は約2GFlops/Wを実現している。

また、「京」でも採用されたインタコネクト「Tofu」や、独自ミドルウェア「Technocal Computing Suite」のコンパイラ、ライブラリなどに加えて、独自技術である「VISIMPACT」により、MPI並列を組み合わせるハイブリッド並列への移行自動化が可能となっている。

FX10の特長

同スパコンは最大1024ラック/98304ノード、6PBのメモリにより23.2PFlopsの理論演算性能をうたっている。2011年6月のTop500で1位になった次世代スーパーコンピュータ「京」で用いられたプロセッサ「SPARC64 VIIIfx」で採用していた自社45nmプロセスから、SPARC64 IXfxでTSMC(Taiwan Semiconductor Manufacturing)の40nmプロセスへと変更され、1プロセッサに16コアを内蔵。1コアあたり1848GHz(マルチラックモデル)もしくは1.650GHz(シングルラックモデル)で動作し、理論演算性能はそれぞれ236.5GFlops、211.2GFlops、電力あたりの処理性能は約2GFlops/Wを実現している。

FX10の概要。シングルラック版とマルチラック版があり、価格はシングルラック版で5000万円程度。マルチラックモデルは構成により価格が異なってくるが、ざっくりと1PFlopsで50-70億円程度とのこと

また、「京」でも採用されたインタコネクト「Tofu」や、独自ミドルウェア「Technocal Computing Suite」のコンパイラ、ライブラリなどに加えて、独自技術である「VISIMPACT」により、MPI並列を組み合わせるハイブリッド並列への移行自動化が可能となっている。Tofuについては「京」に導入したものとアーキテクチャ的には同一のものとのことで、プロセスシュリンクなどは施されていないという。

SPARC64 IXfxの概要。1プロセッサあたりの消費電力は110W。シングルラックモデルだと、1システムあたり約20kW程度になるという

超並列スパコンの要となるTofuインタコネクトの概要。こちらは「京」に採用されたものと同じものが採用されている

さらに、運用面での工夫として、ミドルウェアのほか、Linuxをベースに超並列HPC向けに最適化を施したほか、10万台規模の計算ノードの制御を速やかに行うことを意識した階層化による分散処理の導入、そして言語処理にも同社がベクトル機を提供してきた時代から取り組んできた自動並列化技術を取り入れた高並列化コンパイラ/自動SIMD化対応や、Open MPIをベースとしたTofuトポロジへの最適化などが施されている。

ミドルウェア、運用管理環境、言語処理などのソフト面でも超並列での処理に最適化を施す工夫が施されており、そうしたコミュニティの活性化なども目指していくとする

同社では国家レベルでのHPC活用プロジェクトが世界各地で動きを見せてきていることを背景に、2015年にはHPCサーバ市場は1兆円規模に成長し、サーバ市場の1/4を占めるまでに大きくなると見ており、HPCのハイエンド分野には今回のFX10を、ミドルレンジにはPCクラスタ製品、そしてそこまで必要としないレベルの企業にはクラウドサービスとしてHPCの能力を提供していくことで、シミュレーション活用による「ものを作らないものづくり」による低コスト化、短TAT化などの支援を行い、現在の2%のシェアを10%まで引き上げたいとしている。

HPCの中でも処理性能や投資金額などに応じてハイエンド、ミドルエンド、ローエンドと分けることができる。今後の市場拡大の鍵を握るのは、クラウドによるユーザー層の拡大と、経済活動の進展による大規模演算能力への要求の増大だという

すでに欧州では英国ウェールズの産業活性化を目指すプロジェクト「High Performance Computing Wales (HPC Wales)」のパートナーとして指名されている。同プロジェクトは欧州市場の軟化が生じても、ほぼ計画通りの投資が進められている英国でも期待されている産業活性プロジェクトであり、富士通でもこうした政府系ビジネスを足がかりに、その地域、国家全体への浸透を狙っていくとしており、日本および欧州を第1ステップ、中東やアジア新興国などを第2ステップ、そして自国企業による競争力拡大などの意味も持たせたExaスケールのスパコン開発計画などを進める米国や中国への進出を最終的な目標と位置づけた取り組みを行っていくとしており、すでに世界展開に向けて欧州にHPCの拠点を設立するための検討を開始したという。

なお、同社ではGPUコンピューティングやIntelのMICアーキテクチャなどについても、「IntelのKnightシリーズは8SIMD、GPGPUは16SIMDだと思っており、単に演算器を増やすほうがコアを増やすよりも確かに増やすトランジスタ数の問題では楽になる。しかし、もう1つの問題として、超並列演算を低消費電力で実現するためにはインタコネクトをCPUに内蔵する必要がある。我々はTofuで、その第一歩を築けた。我々のほか、こうしたアプローチが現在出来ているのはIBMがBlue Geneで実現しているだけであることを考えれば、我々が一番Exaスケールの実現に近いと思っている」と、2018-2020年ころが目標とされているExaスケールを20MW程度で実現するのに、最も近いのは富士通であることを強調した。

会見した富士通のテクニカルコンピューティング・ソリューション事業本部 本部長の山田昌彦氏(左)、同執行役員副社長の佐相秀幸氏(中央)、そして同次世代テクニカルコンピューティング開発本部 本部長の追永勇次氏(右)

FX10のシステムボード。CPUとICCは水冷。メモリは空冷のハイブリッド仕様。水冷式にすることで、動作温度を下げられ、これにより故障率を下げることができるようになる

좋아요·댓글을 남기려면 로그인해 주세요.

댓글 ( 0 )

게시물 목록

2,811,753

  1. JA 255 bluebluebluu
  2. 1 조회수 : 90
    KO 255 jap6cmwarotaZ
  3. JA 255 ドンガバ
  4. 조회수 : 80
    KO 255 theStray
  5. KO 255 jap6cmwarotaZ
  6. KO 255 propertyOfJapan
  7. 조회수 : 119
    KO 232 ysfos2
  8. KO 255 bibimbap
  9. JA 18 kanjika34
  10. KO 255 pplive112
  11. JA 255 chosobakan
  12. KO 255 Chinajapanwar
  13. 1 조회수 : 71
    KO 255 Computertop6
  14. JA 255 JAPAV57
  15. KO 255 bibimbap
  16. KO 255 propertyOfJapan
  17. KO 255 cris1717
  18. KO 255 morort
  19. JA 46 teruyo
  20. JA 255 japjapjapjaps