2019-04-24

 arcserve UDP 6.5を使った仮想化基盤の必要計算機資源の概要はベンダサイトにある程度情報があるのだが、実例が少ないので最近の案件の参考情報を。

A)サブシステム、または小規模の基幹システムを想定。
 仮想化基盤上の仮想マシンが10台以下(バックアップ対象のディスク2TB以下)であれば、概ね以下の構成で良い。この程度であれば重複排除をonで運用すれば必要ディスクも節約できる。

 バックアップ物理サーバ1台(4-6cores , 24GB Memory , 最低RAID 10 2TBx4 または RAID 5 1TB x 8程度でサーバのディスクベイに合わせて)
 RPS,BackUp Proxy,Consoleを全て稼働させる。
 バックアップジョブ起動はarcserve UDPの内蔵スケジューラを使用。 


B)中規模以上の基幹システム、または基幹システムに加えてサブシステムも統合した仮想化基盤を想定。
 仮想化基盤上の仮想マシンが30台程度(バックアップ対象のディスク10TB以上)の規模になると、システムデザインを練る必要がある。
 具体的に見てみよう。

1)BackUp Proxyは仮想化ホスト上の仮想マシンにする。

 BackUp ProxyはESXiとRPSとを仲介してバックアップ対象のディスクのデータを読み出す機能を担当する。
 NECのサイトに詳しい(他のソフトウエアだが...)が上記A)では仮想化ホスト、バックアップサーバ(RPS兼BackUp Proxy)間の転送はNBD方式になり、これはディスクの中身がLAN上に流れるので、概ね1GByte/min程度のバックアップ速度になる。

 一方、BackUp Proxyをバックアップ対象と同一の仮想化基盤上の仮想マシンとすると、バックアップ対象のvmdkがBackUp Proxyへ接続されれ(Hot Add)重複排除や圧縮処理はBackUp Proxyで処理される。この結果、小容量になったデータのみがLAN経由でバックアップサーバ(RPS)へ流れる。この構成では10GByte/min以上のバックアップ速度が得られ、バックアップ対象が大容量時は是非検討するべきである。


2)BackUp Proxyに必要な計算機資源容量

 BackUp Proxyはどの程度の仮想マシンとして構成すれば良いのか。当方の事例では8vCPU(intel Silver 4114)、16GB Memoryとかなり大きい構成が必要であった。バックアップ設定は重複排除on(32KByte ブロックサイズ)、圧縮最大、4多重(初期設定)としている。
 メモリ不足になるとバックアップがクラッシュするので余裕が必要である。




3)Consoleはバックアップ起動方式によって配置を検討する

 Consoleはスケジューラ、web interface、CLIの機能を提供する。バックアップ起動がarc serve UDPの内蔵スケジューラであれば配置はRPSと同一の物理サーバ上に搭載で良い。
 しかしながら、ジョブスケジューラで起動する場合は注意が必要である。
 多コアの物理サーバ上でRPSと同居するとジョブスケジューラの費用が嵩む。それであれば、ゲストOSライセンス費用が増えるが個別にConsoleを小さな仮想マシンとして用意した方が良い。

 Console自体はCPU負荷が少ないため、独立して仮想マシンとして配置するのであれば1-2vCPU , 6GB-8GB Memoryで十分である。これであればジョブスケジューラの費用も少なくて済む。

4)RPSに必要な計算機資源容量

 RPSは独立した物理サーバとして構成するが、CPU負荷が高いBackUp Proxyを分離すると概ね1socket 4coresの構成で十分の様だ。
 ハッシュMemoryはarcserve UDPのツール(arcserve UDPをインストールする必要がある....)で計算できるが、あくまでも「ハッシュメモリ」だけの容量計算であるので、OSやRPS自体のメモリとして+4〜8GB程度は追加しておきたい。

 大容量バックアップではブロックサイズを標準の16KByteから32KByteへ変更した方が良い。実運用に入ってデータが溜まってメモリ不足になるとRPSが読み出し専用になるので、無理をしない方が良い。代わりに圧縮を標準から最大に変更すればディスク使用量は抑えられる。

2019-04-14

 久々にkeep.ioのweb siteをチェックしたらiris keyboard rev.3が発売される様子。
 従来の情報ではコントローラのオンボード化、USB-Cのコネクタ搭載が変更点であるが、

  • Option for rotary encoder at lower left corner of left half

 という記述があるのでマウスの様なロータリーエンコーダをオプションで追加できるのであろうか。
 web siteでは基盤の全体図面が載っていないので左手側の左端、というのがどこに位置しているのかは現時点で不明。
 3台も組み立ててしまったのと、送料が高いから試すかは悩ましいところ。

2019-03-28

 arcserveを長年利用している方であれば、ジョブ登録一覧に「メークアップジョブ」が多数自動登録されているのを覚えていると思う。

 arcserveはバックアップジョブが失敗すると自動的に当該ジョブのコピーである「メークアップジョブ」が作成され、登録される。運用担当者はこのメークアップジョブを実行すれば抜けたバックアップジョブを容易に再実行できるだろう、という設計思想のようである。

 arcserveのイメージバックアップ版とも言うべきarcserve UDPも「メークアップジョブ」が自動作成されるのだが、挙動が異なる。
 arcserveではメークアップジョブが作成されホールド状態(実行待ち)となるのみで、再実行は運用担当者が手動実行となっていたが、arcserve UDPは自動的に再実行される仕様なのだ。
 無論、これは設定で変更出来るのだが、自動再実行という思想は如何なものかと思うのだが...。

2019-03-19

 Windows Serverの重複排除とWindows Searchは併用できないというのは仕様だそうです。
 Windows Server 2012R2で併用不可だったのでWindows Server 2016でも機能修正されず、Windows Server 2019でも駄目の様です。
 こんな簡単な機能追加が出来ないあたり、Microsoftは何を考えているのか。

2019-03-17

 VMware vSphere 6.7のESXiからsnmp trapを上げるようにしたのだが、あまりにも大量のinfoが上がってくるので、その対応。

esxcliで送出レベルを設定する。
設定後snmpdを再起動すると反映される。

----
Usage: esxcli system snmp set [cmd options]

Description:
  set                   This command allows the user to set up ESX SNMP agent.

Cmd options:
  -a|--authentication=
                        Set default authentication protocol. Values: none,
                        MD5, SHA1
  -c|--communities=
                        Set up to ten communities each no more than 64
                        characters. Format is: community1[,community2,...]
                        (this overwrites previous settings)
  -e|--enable=    Start or stop SNMP service. Values: [yes|no,
                        true|false, 0|1]
  -E|--engineid=   Set SNMPv3 engine id. Must be at least 10 to 32
                        hexadecimal characters. 0x or 0X is stripped if found
                        as well as colons (:)
  -y|--hwsrc=      Where to source hardware events from IPMI sensors or
                        CIM Indications. One of: indications|sensors
  -s|--largestorage=
                        Support large storage for hrStorageAllocationUnits *
                        hrStorageSize. Values: [yes|no, true|false, 0|1].
                        Control how the agent reports
                        hrStorageAllocationUnits, hrStorageSize and
                        hrStorageUsed in hrStorageTable. Setting this
                        directive to 1 to support large storage with small
                        allocation units, the agent re-calculates these values
                        so they all fit Integer32 and hrStorageAllocationUnits
                        * hrStorageSize gives real size of the storage ( Note:
                        hrStorageAllocationUnits will not be real allocation
                        units if real hrStorageSize won't fit into Integer32
                        ). Setting this directive to 0 turns off this
                        calculation and the agent reports real
                        hrStorageAllocationUnits, but it might report wrong
                        hrStorageSize for large storage because the value
                        won't fit into Integer32.
  -l|--loglevel=   System Agent syslog logging level:
                        debug|info|warning|error
  -n|--notraps=    Comma separated list of trap oids for traps not to be
                        sent by agent. Use value 'reset' to clear setting
  -p|--port=      Set UDP port to poll snmp agent on. The default is
                        udp/161. May not use ports 32768 to 40959
  -x|--privacy=    Set default privacy protocol. Values: none, AES128
  -R|--remote-users=
                        Set up to five inform user ids. Format is: user/auth-
                        proto/-|auth-hash/priv-proto/-|priv-hash/engine-
                        id[,...] Where user is 32 chars max. auth-proto is
                        none|MD5|SHA1, priv-proto is none|AES. '-' indicates
                        no hash. engine-id is hex string '0x0-9a-f' up to 32
                        chars max.
  -r|--reset            Return agent configuration to factory defaults
  -C|--syscontact= System contact string as presented in sysContact.0. Up
                        to 255 characters
  -L|--syslocation=
                        System location string as presented in sysLocation.0.
                        Up to 255 characters.
  -t|--targets=    Set up to three targets to send SNMPv1 traps to.
                        Format is: ip-or-hostname[@port]/community[,...] The
                        default port is udp/162. (this overwrites previous
                        settings)
  -u|--users=      Set up to five local users. Format is: user/-|auth-
                        hash/-|priv-hash/model[,...] Where user is 32 chars
                        max. '-' indicates no hash. Model is one of
                        (none|auth|priv).
  -i|--v3targets=  Set up to three SNMPv3 notification targets. Format
                        is: ip-or-hostname[@port]/remote-user/security-
                        level/trap|inform[,...].

2019-02-28

 古のシステム(2005年頃の構築?)移行で若干の謎を発見。

 これはOracle 10gを利用した生産管理システムだが、データベースキャラセットをJA16SJISにしている。JA16SJISTILDEではない。各国語キャラセットはAL16UTF16なので普通である。

 通常はJA16SJISTILDEだと思っていたが、どの様に違うのかといろいろ見たところ、~の扱いが異なる。

 詳しいことはOracleの資料(pdf)が詳しいので、そちらを確認頂きたいのだが、生産管理ではチルド~記号をDBへ格納することはなさそうな気がするので、この設定でも問題は無いのかもしれない。

 一方、クライアントPCはWindows7以降が使われる様になったので、この辺りを読むと何となく一部の文字で問題が出そうな気がする。最も、生産管理なので「ホッケ」の漢字は入力しないから、まあ、良いのかも...。

 最初にJA16JISTILDEを選択していないのは当時のミスっぽいが...。

2019-02-19

 US ZOHO社製品のopManagerは日本国内では日本法人であるZOHO Japanが提供している。
 この日本法人サポート品質は控えめに言って最悪である。

 この製品以外にもベンダサポートは各社受けてきたが、ここまで良くないのは珍しい。

 レスポンスは非常に悪い、

 Webからの問い合わせをすると、「2営業日以内に回答します」とあるが、これは「2営業日以内に返信はする」という意味である。翌営業日に「(WebからのQAを)受信しました」という自動応答にしか思えない返信が来る。
 そして翌々営業日に「担当者がアサインされた」程度の進捗しかない。この時には真面なサポートはされない。WebのFAQがメールに返信されている程度であり、何らかのログを取得して欲しい、という依頼は大抵ない。

 単なる操作方法の質問であれば、この程度の時期に回答がある事もあるが、それらは大抵緊急度は低いので、余り有難みはない。

 困るのはここからである。

 先ずは単なる操作ミスではないという事を、こちらが立証する必要がある。一般的なベンダではログ送付依頼が返信され、ベンダが解析「単なる操作ミスですよ」または「~の障害なので」という進行になる。
 しかしこのベンダは一味違う。ログ取得の依頼は無く「操作ミスかも知れないから各種操作を再度確認しろ!」と回答してくる事がとても多い。
 そのため、最初に「ログ等をアップロードするサイト(これはベンダが用意しているのだが、言わないとURLを発行しない)を用意しろ。そこに操作した動画を送るから、操作ミスを否定するから」という様にこちらで操作ミスを否定してやらないと、先に進まない。
 そして、やっとログ解析をしてくれる。完全に操作ミスを否定しないとログ解析をしてくれないので要注意である。

 で、ログを送付しても、当日に簡単な確認もしない。受信したという返信も寄こさない。2営業日程して、「操作記録がログに残っていなかったので再度取得を」と依頼してくる。

  この様な牛歩戦術を取るために障害の解決は概ね1-2か月必要になる。製品品質がOSSのbeta or alphaみたいなノリなので、動かないものは徹底的に動かないのである。

 この製品はUS開発なので、開発元への問い合わせであればタイムラグがあるのは仕方がない。しかしながら一般的なベンダであれば、当日に何らかの連絡や進捗のための行動をするものである。この日本法人はその様な顧客満足度のための行動はしない。

 opManagerを導入するのであれば、必ず評価をして、それが動くことを確認してから購入するべきである。カタログ記載の簡単なことが出来なくても、それを有償サポートで解決できると思ってはいけない。製品のbugであれば、解決するのに2か月は必要と思った方が良い。

自己紹介

自分の写真
東京都, Japan
憂鬱な凍死家です。こちらではmixiとは異なり固めの話題中心です。

Total Page View

Categories

Powered by Blogger.

Popular Posts

Blog Archive