• NVIDIA Tesla K20X - nie startuje, brak vCore/vMem

Правила форума:Нажмите здесь, чтобы посмотреть правила этого форума

  1. Тема должна иметь: бренд, полное обозначение компьютера и краткое описание неисправности.
  2. Сообщение темы должно содержать: маркировку материнской платы (в случае аппаратного обеспечения ремонта), расширенное описание неисправности, что было проверено/заменено/измерено + выводы и вопрос. Если вы не можете найти маркировки материнской платы, вы должны прочитать ЭТУ ТЕМУ. Если вы все еще не можете найти маркировки, удалите пожалуйста фотографии обеих сторон материнской платы - удалите сначала все пленки и модули, которые могут покрывать маркировку.
  3. Перед публикацией новой темы, вы должны прочитать все темы на форуме КУРСЫ и попытаться сделать предварительный диагноз, основанный на содержании этих курсов.
  4. Не допускаем прикреплять вложения в виде полных инструкций/схем (или ссылки для них на другие сайты), а также файлов BIOS / прошивок. Вы можете разместить только небольшую часть инструкции/схемы или дать ссылку на файл BIOS на форуме НЕПРОВЕРЕННЫЕ ФАЙЛЫ BIOS/EFI, что упростит диагностику/ремонт для автора темы. Вы не можете дать более одной полной страницы инструкции/схемы на один пост. Файл не может иметь видимых водяных знаков, «конфиденциальных» меток, адресов электронной почты и т.д.
  5. Невозможно создать тему, в которой вы описываете неисправность более чем одного компьютера. Вы должны создавать отдельные темы для каждого компьютера.
  6. Не разрешается создавать тему, в которой вы спрашиваете схемы, бордвю, фотографий материнской платы, файлы BIOS или сервис-мануалы. Если вы хотите попросить любой из этих, вы должны открыть новую тему в форуме ЗАПРОСЫ О ДОКУМЕНТАЦИЮ И BIOS/EFI.
Эта тема помечена как АРХИВНАЯ. Oтвечайте только если ваше сообщение содержит решение проблемы (Условия и Положения, c. 12.1).

#1 NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от rutki3z 6 Январь 2023, 00:14
Witajcie, trafił do mnie taki oto "wynalazek": Tesla K20X, karta ma podobne PCB do GTX Titan/GTX 780 ale z bardziej rozbudowaną sekcją vcore. Karta miała nie dokręconą śrubkę chłodzenia obok NCP4208, nie wiem czy ten układ mógł się przegrzać ale jest martwy, został wymieniony.

Karta nie startowała i nie startuje, zimny rdzeń

Kontroler vCore NCP4208 + 8x FDMF6823B

Изображение
Изображение

    5V ok
    3.3V ok
    VCORE 0,1V
    VMEM 0V

    VMEM - 39,5Ω
    VCORE - 7.1Ω
    Pary sygnałowe PCI-E mają taki sam opór
    PEX 12V - 0,14kΩ
    12V obok 8-pin ~5kΩ
    12v obok 6-pin - ~8kΩ
    5V - 1,75kΩ
    3,3V - 2,45kΩ

Przed zamianą NCP4208:
    Pin 1 (VCC3) - 0,14V + niski opór
    PWRGD - 0V
    ALERT - 0V
    EN - 3,1V

Po zamianie NCP4208 na nowy:
    Pin 1 - 3,3V
    PWRGD - 0V
    ALERT - 0V
    EN - przez ułamek sekundy stan wysoki, po czym niski

    VCore wciąż 0,1V i vMEM 0V

Sprawdzałem DrMOS-y, każdy z nich ma te same opory na Gate High, Gate Low i VSWH . Z ciekawości odpiąłem (przecięcie ścieżki na PCB) sygnał EN, i na wyjściu vcore jest już generowane ~0,6V. Oczywiście karta dalej nie startuje, a sam sygnał chyba jest kontrolowany przez GPU.

Nie wiem co dalej sprawdzić, może to zachowanie wskazuje na uszkodzony rdzeń?. Lub moja ciekawość przez odpięcie EN go zabiła. Co robić, jak żyć?

Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от Google Adsense [BOT] 6 Январь 2023, 00:14

#2 Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от xamledyD 6 Январь 2023, 17:09
Witam.
Układ NCP4208 wyposażony jest w interfejs I2C, który służy do zarządzania tym układem. Nie mam pewności, czy nowy czysty układ zadziała bez problemów w tej karcie. Jeśli masz oscyloskop, to sprawdź czy na liniach SCL i SDA układu coś się dzieje.
Pozdrawiam

#3 Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от Vogelek23 6 Январь 2023, 22:14
xamledyD писал(а):Układ NCP4208 wyposażony jest w interfejs I2C, który służy do zarządzania tym układem. Nie mam pewności, czy nowy czysty układ zadziała bez problemów w tej karcie.
Musi zadziałać, bo interfejs I2C służy jedynie do wysyłania poleceń DO sterownika NCP4208 (który jest układem Slave, a więc sam poleceń żadnych nie wysyła). Ponadto, NCP4208 nie jest wyposażony ani w CPU, ani w jakąkolwiek pamięć ROM.

rutki3z писал(а):EN - przez ułamek sekundy stan wysoki, po czym niski
Czy w ciągu tego ułamka sekundy występują jakiekolwiek impulsy na którejkolwiek z cewek tej przetwornicy (od strony sterowników)? Jaka jest rezystancja do masy na którejkolwiek z cewek?

#4 Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от rutki3z 6 Январь 2023, 23:13
Jeśli masz oscyloskop, to sprawdź czy na liniach SCL i SDA układu coś się dzieje.

Niestety nie posiadam oscyloskopu.

Czy w ciągu tego ułamka sekundy występują jakiekolwiek impulsy na którejkolwiek z cewek tej przetwornicy (od strony sterowników)?

Z odczytów na mierniku napięcie jest chwilowo wyższe niż 0,1V po czym spada do 0,1V

Jaka jest rezystancja do masy na którejkolwiek z cewek?

VCORE - 7.1Ω

Poeksperymentowałem trochę z tym NCP4208 i dla testu podłączyłem 3,3V z jego wbudowanego regulatora na nogę EN. Poskutkowało to wygenerowaniem ~0,8V na VCORE, niestety sygnał PWRGD wciąż 0V. Ścieżka z rdzenia do nogi EN była w trakcie tego "eksperymentu" odcięta, bo nie chciałem puścić tych 3,3v z kontrolera na rdzeń.

Jeśli dobrze odczytałem dokumentację tego układu i schematu od Gigabyte GTX 760 (z tym samym NCP4208), to w przypadku błędu sygnał PWRGD jest ściągany do masy przez ten właśnie kontroler. Zastanawiam się czy odpięcie kontrolera od tej linii dało by jakiś efekt, może nawet spóźnione fajerwerki. (Jak dobrze rozumiem, to właśnie 3.3v na PWRGD załącza kolejne układy zasilania)

#5 Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от rutki3z 9 Январь 2023, 17:19
Udało mi się zdobyć taką sprawną kartę i sprawdzić opory na liniach zasilania. Okazało się że karta posiada zaniżony opór od strony 12V z gniazda PCI-Express. Jako że zasilanie na linii 5V I 3.3V występowało, kolejnym podejrzanym był układ generujący zasilanie pamięci (FBVDD). MOSFET-y sprawdziłem, i wyglądają na sprawne, jednak opór na nodze od sterowania bramką umieszczonego niżej MOSFET-u low-side był w omach, kiedy na sprawnej karcie jest w kΩ. Zdemontowałem kontroler APW7088, i wszystkie inne pomiary się unormowały. Opory na dodatkowych liniach generowanych przez FBVDD są OK.

Zastanawia mnie jednak co spowodowało uszkodzenie dwóch głównych kontrolerów, gdy układy DrMOS/MOSFET wyglądają na sprawne, a napięcia zasilające zarówno je jak i kontrolery, były cały czas były OK. Niefortunne wyładowanie ESD? A może jednak częsciowo uszkodzony DrMOS lub MOSFET? Jeśli któryś z forumowiczów jest w stanie zaproponować realistyczny scenariusz dla takiego uszkodzenia, moja ciekawość była by zaspokojona :)

Podam pomiary dla sprawnej karty, gdyby ktoś chciał się zabrać za naprawę lub diagnozę podobnej konstrukcji. Uprzedzam że pomiary w poprzednich postach były wykonane na mierniku z rozładowaną baterią, i nie są dokładne.
  • VCore: 5.5Ω
  • VMem: 38Ω
  • 12V PCI-Express: 2.85kΩ
  • 8-pin PCI-E: 5.15kΩ
  • 6-pin PCI-E: 8.25kΩ
  • 5V: 1.81kΩ
  • 3.3V na nodze kości SPI: 2.45kΩ


Re: NVIDIA Tesla K20X - nie startuje, brak vCore/vMem


от Google Adsense [BOT] 9 Январь 2023, 17:19
Эта тема помечена как АРХИВНАЯ. Oтвечайте только если ваше сообщение содержит решение проблемы (Условия и Положения, c. 12.1).

Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и гости: 0

_______________________________
Все права защищены. Вы не можете копировать любой контент и элементов этого сайта без разрешения.
Все торговые марки, продукты или услуги, опубликованные на этом сайте принадлежат их законным владельцам, защищены авторским правом и используются только в информационных целях.