IBM Power Systems : problème VIO

Les données VIOS ne sont pas collectées par l’API REST parce que le VIOS ne communique pas avec le HMC, nous l’avons constaté de nombreuses fois, voir ci-dessous.
Je commencerais par le point 4, puis par le 3 : les deux ont aidé plusieurs utilisateurs récemment.

  1. assurez-vous que ce service est démarré
    /etc/inittab:
    perfprovider:2:once:/usr/bin/startsrc -s perfprovider > /dev/null 2>&1
    
  2. IBM peut fournir un script cleanup_cmdb_with_logging.sh qui nettoie la CMDB et résout le problème

  3. Pour résoudre le problème : www-01.ibm.com/support/docview.wss?uid=isg3T1024482
    redémarrer le démon vios devrait également fonctionner www.ibm.com/support/pages/when-using-hmc-gui-you-see-message-unable-connect-database-error-occurred

  4. Il peut y avoir un problème de vio_daemon bloqué ou ne communiquant pas avec le HMC : forum.xorux.com/discussion/comment/3450#Comment_3450
    www.ibm.com/support/pages/node/629995
    Cela peut aussi tenir à la résolution des noms d’hôte des VIOS, au DNS.
    ceci peut également aider : suivez le point 2. de la note technique IBM ci-dessous pour arrêter puis démarrer le démon vio www.ibm.com/support/pages/when-using-hmc-gui-you-see-message-unable-connect-database-error-occurred

    Il devrait en principe suffire de démarrer ou de redémarrer vio_daemon sous root :
      ls -l /usr/ios/db/bin/solid*
      ps -ef | egrep "vio_daemon|solid|db"
      lssrc -ls vio_daemon  
      stopsrc -s vio_daemon
      startsrc -s vio_daemon
      sleep 10
    
      ps -ef | egrep "vio_daemon|solid|db"
      lssrc -ls vio_daemon
    
  5. www.ibm.com/support/pages/when-using-hmc-gui-you-see-message-unable-connect-database-error-occurred
    après l’exécution du script cleanup_cmdb_with_logging.sh, tout fonctionne correctement.
    cela a aidé un autre utilisateur, qui voyait sur le HMC, sous Virtual Networks, l’erreur : Error occurred while quering for SharedEthernetAdapter from VIOS ....

  6. voici ce qui a résolu notre problème interne sur notre machine P10 : une configuration DNS correcte et un redémarrage de vio-daemon
    # tail -1 /etc/hosts
    	10.x.x.x        p10-vios p10-vios.int.xorux.com
    # tail -1 /etc/netsvc.conf
    hosts=local,bind4
    # cat /etc/resolv.conf
    domain int.xorux.com
    nameserver 10.x.x.x   
    nameserver 1.1.1.1
    	--> make sure DNS is working properly, nslookup/ping 
    # stopsrc -s vio_daemon
    # startsrc -s vio_daemon
    
  7. pouvez-vous essayer la solution décrite à la fin de ce fil forum.xorux.com/discussion/comment/5744#Comment_5744

  8. Le problème venait des serveurs vio. Certaines fonctions « work with virtual networks » renvoyaient une erreur sur le HMC. La solution a consisté à forcer le vio à la résolution de noms en IPv4, comme IBM nous l’a indiqué :
    # vi /etc/netsvc.conf
    hosts=local4,bind4      <===== change ¿hosts=local,bind¿ to this
    
    Puis
    /usr/bin/stopsrc -s vio_daemon
    Wait 300 seconds or until vio_daemon has stopped.
    /usr/sbin/slibclean
    rm -rf /home/ios/CM
    /usr/bin/startsrc -s vio_daemon -a '-d 4'
    ps -ef |grep vio_chgmgt |grep -v grep |awk -F ' ' '{print $2}'
    kill -1 
    
  9. Support IBM :
    La version de VIOS que vous utilisez a un défaut de collecte des journaux, il me manque donc la copie de la CMDB, la base de données qui tourne sur le VIOS et que le HMC interroge
    Je ne vois aucune erreur nette dans les journaux, mais je ne peux pas contrôler la base pour vérifier qu’elle est correctement peuplée
    La bonne nouvelle est que nous pouvons recréer cette base sans aucun impact sur les LPAR en cours, en suivant ces étapes
    $ oem_setup_env
    # stopsrc -s vio_daemon
    # /usr/sbin/slibclean
    # rm -rf /home/ios/CM
    # rm /home/ios/logs/viod_bkps/*
    # startsrc -s vio_daemon -a '-d 3'
    # kill -1 vio_daemon's PID
    
    Attendez ensuite quelques minutes et relancez l’opération qui échouait

  10. forum.xorux.com/discussion/comment/6489#Comment_6489