+− THE DAILY DIFFdev & AI news
SHIP IT

ലോക്കൽ AI ഹാർഡ്‌വെയർ ഗൈഡ് (2026)

ലോക്കൽ AI ഏജൻ്റുകൾക്കും ഓപ്പൺ-വെയ്റ്റ് LLM-കൾക്കുമായി ഒരു മെഷീൻ നിർമ്മിക്കുമ്പോൾ, ഡെവലപ്പർമാർ ഗെയിമിംഗ് പിസി സ്പെക്കുകൾ വാങ്ങുന്നതിൽ തെറ്റ് വരുത്തുന്നു: 5.8 GHz സിപിയു-കൾ, കസ്റ്റം ലിക്വിഡ് കൂളിംഗ് ലൂപ്പുകൾ, 8GB VRAM മാത്രമുള്ള ഫാസ്റ്റ് ഗെയിമിംഗ് GPU-കൾ.

ലോക്കൽ AI ഏജൻ്റുകൾക്കും ഓപ്പൺ-വെയ്റ്റ് LLM-കൾക്കുമായി ഒരു മെഷീൻ നിർമ്മിക്കുമ്പോൾ, ഡെവലപ്പർമാർ ഗെയിമിംഗ് പിസി സ്പെക്കുകൾ വാങ്ങുന്നതിൽ തെറ്റ് വരുത്തുന്നു: 5.8 GHz സിപിയു-കൾ, കസ്റ്റം ലിക്വിഡ് കൂളിംഗ് ലൂപ്പുകൾ, 8GB VRAM മാത്രമുള്ള ഫാസ്റ്റ് ഗെയിമിംഗ് GPU-കൾ. എന്നാൽ ഓട്ടോറെഗ്രസ്സീവ് ടോക്കൺ ജനറേഷൻ മെമ്മറി-ബാൻഡ്‌വിഡ്ത്ത് ബൗണ്ടാണ്, കമ്പ്യൂട്ട് ബൗണ്ടല്ല: ഒരു ടോക്കൺ പുറത്തുവിടാൻ, മോഡലിലെ ഓരോ വെയ്റ്റും മെമ്മറി ബസ് വഴി സ്ട്രീം ചെയ്യണം. നിങ്ങളുടെ വെയ്റ്റുകളോ KV കാഷെ കോൺടെക്സ്റ്റോ ഫിസിക്കൽ VRAM-നെ കവിയുമ്പോൾ, റൺടൈം PCIe വഴി സിസ്റ്റം DDR5-ലേക്ക് ലെയറുകൾ ഓഫ്‌ലോഡ് ചെയ്യുന്നു, നിങ്ങൾക്ക് ഒരു 20x മെമ്മറി ബാൻഡ്‌വിഡ്ത്ത് ക്ലിഫ് സംഭവിക്കുന്നു: വേഗത സെക്കൻഡിൽ 40 ടോക്കണുകളിൽ നിന്ന് 1.5 ആയി കുറയുന്നു. ഈ ഫീൽഡ് ടെസ്റ്റിൽ, നിക്കോ ഹാർഡ്‌വെയർ മെക്കാനിക്സ്, 4-ബിറ്റ് ക്വാണ്ടൈസേഷൻ മോഡൽ സൈസിംഗ് നിയമങ്ങൾ, $1,200 മുതൽ $5,000 വരെയുള്ള മൂന്ന് യഥാർത്ഥ ബഡ്ജറ്റ് ടയറുകൾ, ഒരു ഉപയോഗിച്ച RTX 3090 24GB കമ്പ്യൂട്ടിംഗിൽ VRAM-ന് ഏറ്റവും മികച്ച വില-പ്രകടനം വാഗ്ദാനം ചെയ്യുന്നത് എന്തുകൊണ്ട്, റാസ്ബെറി പൈ എഡ്ജ് ട്രാപ്പ്, ലോക്കൽ വേഴ്സസ് ക്ലൗഡ് ഇൻഫറൻസിനായുള്ള ഹോം ജിം തന്ത്രം എന്നിവ വിശദീകരിക്കുന്നു. വിധി: SHIP IT.

എഴുതിയ പതിപ്പ് വായിക്കുക (ഇംഗ്ലീഷ്) ↗

ഈ വീഡിയോയിൽ ഉൾപ്പെടുന്ന കാര്യങ്ങൾ

  • 20x മെമ്മറി ബാൻഡ്‌വിഡ്ത്ത് ക്ലിഫ്: 936 GB/s GDDR6X vs 50 GB/s DDR5 & 31.5 GB/s PCIe
  • മോഡൽ സൈസിംഗ് @ 4-ബിറ്റ്: 8B (5GB), 14B (10GB), 32B (20GB), 70B (40GB)
  • ടയർ 1 ($1,200–$1,500): RTX 4060 Ti 16GB (ഒരിക്കലും 8GB) അല്ലെങ്കിൽ Mac Mini 16GB
  • ടയർ 2 ($1,500–$2,000): ഉപയോഗിച്ച RTX 3090 24GB സ്വീറ്റ് സ്പോട്ട് അല്ലെങ്കിൽ Mac Mini M4 Pro 64GB
  • ടയർ 3 ($3,500+): RTX 4090 24GB / ഡ്യുവൽ 3090s അല്ലെങ്കിൽ Mac Studio Ultra

വിവർത്തനം ചെയ്ത ട്രാൻസ്ക്രിപ്റ്റ്

യഥാർത്ഥ ഇംഗ്ലീഷ് ആഖ്യാനത്തിൽ നിന്ന് വിവർത്തനം ചെയ്തത്. ലഭ്യമായ ഓഡിയോയും അടിക്കുറിപ്പുകളും YouTube നിയന്ത്രിക്കുന്നു.

0:00 നിങ്ങൾ ലോക്കൽ AI ഏജൻ്റുകൾ പ്രവർത്തിപ്പിക്കാൻ ഒരു പിസി നിർമ്മിക്കാൻ പദ്ധതിയിടുകയാണെങ്കിൽ, ഗെയിമിംഗ് റിഗ് ഉണ്ടാക്കുന്നത് നിർത്തുക. നിങ്ങൾക്ക് 5.8 ഗിഗാഹെർട്സ് കോർ i9-ഓ, ഒരു ലിക്വിഡ് കൂളിംഗ് ലൂപ്പോ, അല്ലെങ്കിൽ RGB-യിൽ പൊതിഞ്ഞ എട്ട് ഗിഗാബൈറ്റ് ഗ്രാഫിക്സ് കാർഡോ ആവശ്യമില്ല. ലോക്കൽ AI ഇൻഫറൻസിൽ, ഗെയിമിംഗ് സ്പെക്കുകൾക്ക് പ്രായോഗികമായി പ്രയോജനമില്ല. നിങ്ങളുടെ ഏജൻ്റ് പ്രവർത്തിക്കുമോ ഇഴയുമോ എന്ന് തീരുമാനിക്കുന്ന ഒരേയൊരു മെട്രിക് VRAM ശേഷിയാണ് കൂടാതെ മെമ്മറി ബസ് ബാൻഡ്‌വിഡ്ത്തും. ഹാർഡ്‌വെയർ ടെസ്റ്റിന്റെ നിയമങ്ങൾ: സിപിയു ക്ലോക്കുകളും റാസ്റ്ററൈസേഷൻ ബെഞ്ച്മാർക്കുകളും മറക്കുക.

0:24 ഞങ്ങൾക്ക് മൂന്ന് നമ്പറുകൾ ആവശ്യമാണ്: മെമ്മറി ബസ് വീതി, സെക്കൻഡിൽ ഗിഗാബൈറ്റിലുള്ള ബാൻഡ്‌വിഡ്ത്ത്, KV കാഷെ ബ്ലോട്ടിനായുള്ള റോ VRAM ഹെഡ്‌റൂം. ഈ ഫീൽഡ് ടെസ്റ്റിൽ, ഞാൻ ഇരുപത് മടങ്ങ് മെമ്മറി ബാൻഡ്‌വിഡ്ത്ത് ക്ലിഫ് വിശദീകരിക്കും, മോഡൽ സൈസിംഗ് നിയമങ്ങൾ മാപ്പ് ചെയ്യും, ആയിരത്തി ഇരുന്നൂറ് ഡോളർ മുതൽ അയ്യായിരം ഡോളർ വരെയുള്ള മൂന്ന് യഥാർത്ഥ ടയറുകൾ ബെഞ്ച്മാർക്ക് ചെയ്യും, കൂടാതെ ഉപയോഗിച്ച 3090 ഇപ്പോഴും കമ്പ്യൂട്ടിംഗിലെ ഏറ്റവും മികച്ച ചീറ്റ് കോഡ് ആയിരിക്കുന്നത് എന്തുകൊണ്ടാണെന്ന് വിശദീകരിക്കും. ഇത് ദി ഡെയ്‌ലി ഡിഫ്, ഫീൽഡ് ടെസ്റ്റ്. ഗെയിമിംഗ് റിഗുകൾ എന്തുകൊണ്ട് പരാജയപ്പെടുന്നു എന്ന് മനസ്സിലാക്കാൻ, ടോക്കൺ ജനറേഷൻ യഥാർത്ഥത്തിൽ എങ്ങനെ നടപ്പിലാക്കുന്നു എന്ന് നോക്കുക. ഗെയിമുകളിൽ, നിങ്ങളുടെ സിപിയു ഡ്രോ കോളുകൾ നൽകുകയും നിങ്ങളുടെ GPU ഫ്രെയിമുകൾ റെൻഡർ ചെയ്യുകയും ചെയ്യുന്നു.

0:54 എന്നാൽ ഓട്ടോറെഗ്രസ്സീവ് LLM ഡീകോഡിംഗ് മിക്കവാറും മെമ്മറി ബാൻഡ്‌വിഡ്ത്ത് ബൗണ്ടാണ്. ഒരു ടോക്കൺ ജനറേറ്റ് ചെയ്യാൻ, GPU മോഡലിലെ ഓരോ വെയ്റ്റ് പാരാമീറ്ററും മെമ്മറിയിൽ നിന്ന് അതിൻ്റെ കമ്പ്യൂട്ട് കോറുകളിലേക്ക് സ്ട്രീം ചെയ്യണം. നിങ്ങളുടെ മോഡൽ പത്ത് ഗിഗാബൈറ്റാണെങ്കിൽ, ഒരു ടോക്കൺ ഉൽപ്പാദിപ്പിക്കുക എന്നാൽ പത്ത് ഗിഗാബൈറ്റ് ഡാറ്റ വായിക്കുക എന്നാണ് അർത്ഥം. ഒരു Nvidia RTX 3090-ൽ 384-ബിറ്റ് മെമ്മറി ബസ് ഉപയോഗിച്ച്, നിങ്ങൾക്ക് സെക്കൻഡിൽ 936 ഗിഗാബൈറ്റ് GDDR6X ബാൻഡ്‌വിഡ്ത്ത് ലഭിക്കുന്നു, സെക്കൻഡിൽ എൺപത് ടോക്കണുകൾ ഉൽപ്പാദിപ്പിക്കുന്നു. എന്നാൽ നിങ്ങളുടെ മോഡൽ ഫിസിക്കൽ VRAM കവിയുന്ന മില്ലിസെക്കൻഡിൽ എന്ത് സംഭവിക്കുന്നു എന്ന് ശ്രദ്ധിക്കുക.

1:22 VRAM നിറയുമ്പോൾ, റൺടൈമുകൾ ശേഷിക്കുന്ന ലെയറുകൾ PCIe ബസ് വഴി സിസ്റ്റം DDR5 മെമ്മറിയിലേക്ക് ഓഫ്‌ലോഡ് ചെയ്യുന്നു. നിങ്ങളുടെ GPU കോറുകൾക്ക് സെക്കൻഡിൽ ആയിരം ഗിഗാബൈറ്റ് പ്രതീക്ഷിക്കുന്നു. പകരം, ഡ്യുവൽ-ചാനൽ DDR5 അവർക്ക് അമ്പത് നൽകുന്നു, PCIe 4 മുപ്പത്തിയൊന്നിൽ ശ്വാസം മുട്ടുന്നു. അതൊരു ഇരുപത് മടങ്ങ് ബാൻഡ്‌വിഡ്ത്ത് തകർച്ചയാണ്. ടോക്കൺ ജനറേഷൻ പൈപ്പ്‌ലൈൻ ബസ് കാത്ത് തൽക്ഷണം സ്തംഭിക്കുന്നു, വേഗത സെക്കൻഡിൽ നാൽപ്പത് ടോക്കണുകളിൽ നിന്ന് ഒന്നരയായി കുറയുന്നു. നിങ്ങൾ ഒരു രണ്ടായിരം ഡോളറിൻ്റെ റിഗിനെ ഒരു സ്പേസ് ഹീറ്ററാക്കി മാറ്റിയിരിക്കുന്നു.

1:47 മൾട്ടി-ടേൺ ഏജൻ്റ് റണ്ണുകളിൽ ഇത് കൂടുതൽ വഷളാകുന്നു, കാരണം വെയ്റ്റുകൾ പകുതി മാത്രമേ യുദ്ധത്തിനുള്ളൂ. ഓരോ പ്രോംപ്റ്റും, ടൂൾ കോളും, ഫയൽ ചങ്കും കീ-വാല്യൂ കാഷെയിൽ സൂക്ഷിക്കപ്പെടുന്നു. ഒരു മുപ്പത്തിരണ്ട് കെ കോൺടെക്സ്റ്റ് വിൻഡോയ്ക്ക് വെയ്റ്റുകൾക്ക് പുറമെ നാല് മുതൽ എട്ട് ഗിഗാബൈറ്റ് വരെ VRAM ഉപയോഗിക്കാൻ കഴിയും. നിങ്ങളുടെ കാർഡിന് പതിനാറ് ഗിഗാബൈറ്റ് മാത്രമേ ഉള്ളൂ എങ്കിൽ, നിങ്ങളുടെ ഏജൻ്റ് രണ്ടുതവണ ലൂപ്പ് ചെയ്യും, കോൺടെക്സ്റ്റ് വോളിൽ തട്ടുന്നു, ഒന്നുകിൽ ഔട്ട്-ഓഫ്-മെമ്മറി എറർ കാരണം ക്രാഷ് ആകുന്നു അല്ലെങ്കിൽ DDR5-ലേക്ക് ഒഴുകുന്നു. ഇതാ നാല്-ബിറ്റ് സൈസിംഗ് ചീറ്റ് ഷീറ്റ്. Llama 3.1 അല്ലെങ്കിൽ DeepSeek Distill പോലുള്ള ഏഴ് അല്ലെങ്കിൽ എട്ട് ബില്യൺ പാരാമീറ്റർ മോഡലിന്

2:16 ഏകദേശം അഞ്ച് ഗിഗാബൈറ്റ് എടുക്കും. ഒരു പതിനാല് ബില്യൺ മോഡലിന് പത്ത് ഗിഗാബൈറ്റ് എടുക്കും. മുപ്പത്തിരണ്ട് ബില്യൺ മോഡലിന്, കോഡിംഗ് ഏജൻ്റുകൾക്കുള്ള ഇൻ്റലിജൻസ് സ്വീറ്റ് സ്പോട്ട്, ഇരുപത് ഗിഗാബൈറ്റ് ആവശ്യമാണ്. ഒരു എഴുപത് ബില്യൺ ഫ്രോണ്ടിയർ മോഡലിന് നിങ്ങൾ കോൺടെക്സ്റ്റ് അലോക്കേറ്റ് ചെയ്യുന്നതിന് മുമ്പ് നാൽപ്പത് ഗിഗാബൈറ്റ് ആവശ്യമാണ്. ഇത് നമ്മളെ യഥാർത്ഥ ഹാർഡ്‌വെയർ ബിൽഡുകളിലേക്ക് എത്തിക്കുന്നു. ടയർ 1 സ്റ്റാർട്ടർ റിഗ് ആണ്, ആയിരത്തി ഇരുന്നൂറ് മുതൽ ആയിരത്തി അഞ്ഞൂറ് ഡോളർ വരെ. പിസിയിൽ, നിങ്ങളുടെ ആങ്കർ ഒരു RTX 4060 Ti 16-ഗിഗാബൈറ്റാണ്.

2:39 പ്രധാന മുന്നറിയിപ്പ്: എഴുപത് ഡോളർ ലാഭിക്കാൻ എട്ട്-ഗിഗാബൈറ്റ് പതിപ്പ് ഒരിക്കലും വാങ്ങരുത്. 2026-ൽ എട്ട് ഗിഗാബൈറ്റ് VRAM ഏതൊരു യഥാർത്ഥ ഏജൻ്റ് വർക്ക്ഫ്ലോയിലും തൽക്ഷണ ഔട്ട്-ഓഫ്-മെമ്മറി മരണശിക്ഷയാണ്. ഒരു സിക്സ്-കോർ Ryzen 5, അറുപത്തിനാല് ഗിഗാബൈറ്റ് DDR5, രണ്ട് ടെറാബൈറ്റ് NVMe ഡ്രൈവ് എന്നിവയുമായി ഇത് ജോഡിയാക്കുക. ആപ്പിൾ ലാൻഡിൽ, തത്തുല്യം ഒരു മാക് മിനി അല്ലെങ്കിൽ മാക്ബുക്ക് പ്രോ ആണ്, പതിനാറ് ഗിഗാബൈറ്റ് യൂണിഫൈഡ് മെമ്മറിയോടെ.

3:02 എട്ട് ബില്യൺ മോഡലുകളിൽ നിങ്ങൾക്ക് സെക്കൻഡിൽ നാൽപ്പത് മുതൽ അമ്പത് ടോക്കണുകൾ വരെ കാണാം. ടയർ 2 പവർ യൂസർ സ്വീറ്റ് സ്പോട്ടാണ്: Qwen 2.5 32B പോലുള്ള മുപ്പത്തിരണ്ട് ബില്യൺ പാരാമീറ്റർ മോഡലുകൾ പ്രവർത്തിപ്പിക്കാൻ പ്രത്യേകം നിർമ്മിക്കുന്നത്. പാത്ത് A എന്നത് എണ്ണൂറ് ഡോളറിന് പതിനാറ് ഗിഗാബൈറ്റുള്ള ഒരു പുതിയ RTX 4070 Ti Super ആണ്. എന്നാൽ പാത്ത് B എൻ്റെ ശക്തമായ ശുപാർശയാണ്: ഉപയോഗിച്ച Nvidia RTX 3090 ഇരുപത്തിനാല് ഗിഗാബൈറ്റ് വാങ്ങുക. eBay-യിൽ നിങ്ങൾക്ക് അറുന്നൂറ്റമ്പത് മുതൽ എഴുനൂറ്റമ്പത് ഡോളർ വരെ വിലയ്ക്ക് വൃത്തിയുള്ള 3090s കണ്ടെത്താനാകും. ഇത് നിങ്ങൾക്ക് ഒരു വലിയ 384-ബിറ്റ് ബസിൽ 936 ഗിഗാബൈറ്റ് സെക്കൻഡിൽ

3:33 പുഷ് ചെയ്യുന്ന ഇരുപത്തിനാല് ഗിഗാബൈറ്റ് VRAM നൽകുന്നു. ഡോളറിന് ഡോളർ, ഇത് കമ്പ്യൂട്ടിംഗിലെ ഏറ്റവും മികച്ച VRAM ഡീലാണ്. macOS-ൽ, ടയർ 2 ന് തുല്യം അറുപത്തിനാല് ഗിഗാബൈറ്റ് യൂണിഫൈഡ് മെമ്മറിയുള്ള ഒരു Mac Mini M4 Pro ആണ്. ഇത് മുപ്പത്തിരണ്ട് ബില്യൺ മോഡലിൽ സെക്കൻഡിൽ പതിനൊന്ന് മുതൽ പന്ത്രണ്ട് ടോക്കണുകൾ വരെ ഉൽപ്പാദിപ്പിക്കുന്നു: Nvidia-യെക്കാൾ വേഗത കുറവാണെങ്കിലും, മുപ്പത് വാട്ടിൽ നിശബ്ദമാണ്, വലിയ കോൺടെക്സ്റ്റ് വിൻഡോയ്ക്കുള്ള സ്ഥലവുമുണ്ട്. ടയർ 3 മൾട്ടി-ഏജൻ്റ് സ്വാർമുകൾക്കുള്ള എൻ്റൂസിയാസ്റ്റ് ബ്രാക്കറ്റാണ്. പിസിയിൽ, അതിനർത്ഥം ഇരുപത്തിനാല് ഗിഗാബൈറ്റുള്ള ഒരു RTX 4090,

3:57 ഒരു Ryzen 9, കൂടാതെ നൂറ്റി ഇരുപത്തെട്ട് ഗിഗാബൈറ്റ് റാം, അല്ലെങ്കിൽ മൊത്തം നാൽപ്പത്തിയെട്ട് ഗിഗാബൈറ്റ് VRAM നൽകുന്ന ഡ്യുവൽ RTX 3090s. ആപ്പിളിൻ്റെ നിരയിൽ, ഇത് തൊണ്ണൂറ്റി ആറ് മുതൽ നൂറ്റി ഇരുപത്തെട്ട് ഗിഗാബൈറ്റ് യൂണിഫൈഡ് മെമ്മറിയുള്ള ഒരു Mac Studio Ultra ആണ്. സൂപ്പർപവർ മെമ്മറി റെസിഡൻസിയാണ്: നിങ്ങൾക്ക് ഒരു എംബഡിംഗ് മോഡൽ, ഒരു ഫാസ്റ്റ് റൂട്ടർ, ഒരു 32-ബില്യൺ കോഡിംഗ് മോഡൽ എന്നിവ ഒരേസമയം പൂജ്യം സ്വാപ്പ് കാലതാമസത്തോടെ ലോഡ് ചെയ്യാം. ഇനി നമ്മുടെ ഫീൽഡ് ടെസ്റ്റിൻ്റെ സത്യസന്ധമായ പരാജയം: എഡ്ജ് കമ്പ്യൂട്ടിംഗ് ട്രാപ്പ്.

4:24 ഓരോ ആഴ്ചയും ഒരു സോഷ്യൽ പോസ്റ്റ് പറയുന്നത് നിങ്ങൾക്ക് ഒരു എൺപത് ഡോളർ റാസ്ബെറി പൈ 5-ൽ ഓട്ടോണമസ് കോഡിംഗ് ഏജൻ്റുകൾ പ്രവർത്തിപ്പിക്കാൻ കഴിയുമെന്നാണ്. ഞാൻ അത് പരീക്ഷിച്ചു. ഒരു ചെറിയ ഒന്നര ബില്യൺ പാരാമീറ്റർ മോഡൽ പ്രവർത്തിപ്പിക്കുമ്പോൾ നിങ്ങൾക്ക് സെക്കൻഡിൽ മൂന്ന് ടോക്കണുകൾ മാത്രമേ ലഭിക്കൂ, അതേസമയം ബോർഡ് എൺപത്തിയഞ്ച് ഡിഗ്രി സെൽഷ്യസിൽ ത്രോട്ടിൽ ചെയ്യുന്നു. ഇത് ഒരു നല്ല വാരാന്ത്യ കളിപ്പാട്ടമാണ്, പക്ഷേ ഒരു ദൈനംദിന ഡെവലപ്മെൻ്റ് ഡ്രൈവറായി, ഇത് ശുദ്ധമായ ശിക്ഷയാണ്. സോഫ്റ്റ്‌വെയറിനായി, നിങ്ങൾക്ക് Cursor, Cline, അല്ലെങ്കിൽ VS Code-ലേക്ക്

4:47 നേരിട്ട് കണക്റ്റുചെയ്യുന്ന ഒരു ക്ലീൻ കമാൻഡ്-ലൈൻ ഡെമൺ വേണമെങ്കിൽ Ollama ഉപയോഗിക്കുക. മോഡൽ ഡൗൺലോഡുകളും GPU ലെയർ സ്ലൈഡറുകളുമുള്ള ഒരു ഗ്രാഫിക്കൽ പ്ലേഗ്രൗണ്ട് വേണമെങ്കിൽ, LM Studio ഉപയോഗിക്കുക. നിങ്ങളുടെ ഫോർമാറ്റ് നിങ്ങളുടെ സിലിക്കണുമായി പൊരുത്തപ്പെടുത്തുക. ആപ്പിൾ സിലിക്കണിൽ, മെറ്റലിനായി ഒപ്റ്റിമൈസ് ചെയ്ത GGUF മോഡലുകൾ എപ്പോഴും ഡൗൺലോഡ് ചെയ്യുക. Nvidia-യുള്ള Windows അല്ലെങ്കിൽ Linux-ൽ, AWQ അല്ലെങ്കിൽ EXL2 മോഡലുകൾ ഡൗൺലോഡ് ചെയ്യുക, ഇവ ഇരുപത് മുതൽ മുപ്പത് ശതമാനം വരെ വേഗതയേറിയ ഇൻഫറൻസിനായി Nvidia ടെൻസർ കോറുകൾ ഉപയോഗിക്കുന്നു. അപ്പോൾ ഇത് പണമില്ലാതെ എങ്ങനെ വിന്യസിക്കും?

5:11 പ്രാദേശിക ഹാർഡ്‌വെയറിനെ ഒരു ഹോം ജിമ്മും ഒരു കൊമേഴ്സ്യൽ ജിമ്മും പോലെ ചിന്തിക്കുക. വീട്ടിൽ ഒരു സ്ക്വാറ്റ് റാക്ക് ഉണ്ടെങ്കിൽ എല്ലാ ദിവസവും യാത്രയില്ലാതെ, സബ്സ്ക്രിപ്ഷൻ ഫീസില്ലാതെ, പൂർണ്ണ സ്വകാര്യതയോടെ നിങ്ങൾക്ക് പരിശീലിക്കാം. നിങ്ങളുടെ ലോക്കൽ മെഷീൻ നിങ്ങളുടെ ദൈനംദിന കോഡിംഗ്, യൂണിറ്റ് ടെസ്റ്റിംഗ്, സ്വകാര്യ ഡോക്യുമെൻ്റ് പ്രോസസ്സിംഗ് എന്നിവ ടോക്കണിന് പൂജ്യം ഡോളറിൽ കൈകാര്യം ചെയ്യുന്നു. നിങ്ങൾക്ക് അഞ്ഞൂറ് പൗണ്ട് ഡെഡ്‌ലിഫ്റ്റ് ചെയ്യേണ്ടി വരുമ്പോൾ — അമ്പത് ഫയലുകളിലുടനീളമുള്ള ഒരു വലിയ റിപ്പോ-വൈഡ് ആർക്കിടെക്ചറൽ റീഫാക്ടർ പോലെ — നിങ്ങൾ കൊമേഴ്സ്യൽ ജിം സന്ദർശിക്കുക: ക്ലൗഡ് API-ക്ക് Claude 3.5 Sonnet അല്ലെങ്കിൽ OpenAI o3-ന് പതിനഞ്ച് മിനിറ്റിന് പണം നൽകി മുന്നോട്ട് പോകുക.

5:38 മുന്നോട്ട് പോകുക. ഇതാ ബിൽ: ഉപയോഗിച്ച 3090 ഉള്ള ഒരു ടയർ 2 ബിൽഡിന് മൊത്തം ആയിരത്തി അറുന്നൂറ് ഡോളർ ചിലവാകും. നിങ്ങൾ API ടോക്കണുകൾക്കായി പ്രതിമാസം അമ്പത് മുതൽ നൂറ് ഡോളർ വരെ ചിലവഴിക്കുകയാണെങ്കിൽ, ഇത് പതിനെട്ട് മാസത്തിനുള്ളിൽ സ്വയം തിരിച്ചുപിടിക്കുന്നു, നിങ്ങളുടെ പ്രൊപ്രൈറ്ററി കോഡ്ബേസ് മൂന്നാം കക്ഷി സെർവറുകളിൽ നിന്ന് മാറ്റിനിർത്തുകയും ചെയ്യുന്നു. ഇന്നത്തെ ഫീൽഡ് ടെസ്റ്റ് വിധി: SHIP IT. VRAM-ഉം മെമ്മറി ബാൻഡ്‌വിഡ്ത്തും ക്ലോക്ക് വേഗതയെ എപ്പോഴും തോൽപ്പിക്കും. AI-ക്കായി അഞ്ച്-ഗിഗാഹെർട്സ് സിപിയു-കൾ വാങ്ങുന്നത് നിർത്തുക, ഒരു ഉപയോഗിച്ച 3090 കണ്ടെത്തുക.

6:04 ലോക്കൽ മോഡലുകൾക്കായി നിങ്ങൾ ഏത് ഹാർഡ്‌വെയർ ബിൽഡാണ് പ്രവർത്തിപ്പിക്കുന്നതെന്ന് കമൻ്റുകളിൽ പറയുക. ഈ വിവരണം വായിക്കാനാണ് നിങ്ങൾ ഇഷ്ടപ്പെടുന്നതെങ്കിൽ, daily diff dot dev-ൽ നിന്ന് വാർത്താക്കുറിപ്പ് എടുക്കുക, ലിങ്ക് താഴെ. അതുതന്നെയാണ് ഇന്നത്തെ diff. ഞാൻ Axrisi-യിൽ നിന്നുള്ള നിക്കോ. ഉത്തരവാദിത്തത്തോടെ ലയിപ്പിക്കുക.

ഉറവിടങ്ങൾ

  1. Niko from Axrisi: Local AI Hardware — Stop Building a Gaming PCaxrisi.com
  2. NVIDIA RTX 3090 Specifications (384-bit bus, 936 GB/s GDDR6X)www.nvidia.com
  3. llama.cpp Memory Bandwidth & Offloading Architecturegithub.com
  4. Ollama Model Library & Benchmarksollama.com
  5. vLLM PagedAttention & KV Cache Memory Managementgithub.com
  6. JEDEC DDR5 Memory Standard Specificationswww.jedec.org

ബന്ധപ്പെട്ട വീഡിയോകൾ

daily · ml · 2026 സെപ്റ്റം 28

NVIDIA ഈ മനുഷ്യന് ഒരു ബില്യൺ ഡോളർ നൽകാനുണ്ടോ?

1993-ൽ ജെൻസൻ ഹുവാങ് എറിക് ഗള്ളിച്ചനെ NVIDIA-യുടെ സാങ്കേതിക ഉപദേശക സമിതിയിലേക്ക് ക്ഷണിക്കുകയും 25,000 ഓപ്ഷനുകൾ നൽകുകയും ചെയ്തു. അത് കരാർ പ്രകാരം ഒരു വർഷത്തിനുള്ളിൽ പൂർണ്ണ അവകാശമായി മാറുന്നതായിരുന്നു. 1

4:41 ↗
under-the-hood · ml · 2026 സെപ്റ്റം 21

ക്ലോഡ് RSA-896 ഘടകങ്ങളാക്കി. യഥാർത്ഥത്തിൽ RSA തകരുന്നത് ഇങ്ങനെയാണ്

സെപ്റ്റംബർ 19-ന് ആന്ത്രോപിക്കിലെ ഒരു എഞ്ചിനീയർ RSA-896 — 270 അക്കങ്ങളുള്ള ഒരു ചലഞ്ച് നമ്പർ — ക്ലോഡ് ഉപയോഗിച്ച്, ഓപ്പൺ സോഴ്‌സ് CADO-NFS സീവിന്റെ ഒരു GPU പോർട്ടും, പത്ത് ദിവസത്തേക്ക് 2,048 ഉപയോഗിക്കാത്ത

3:39 ↗
daily · ml · 2026 സെപ്റ്റം 10

ഷോപ്പിഫൈ ടെയിൽവിൻഡ് വാങ്ങി, പിന്നെ നേറ്റീവിലേക്ക് മടങ്ങി.

ഷോപ്പിഫൈയുടെ രണ്ട് പോസ്റ്റുകൾ, 25 മണിക്കൂറിനിടെ. ചൊവ്വാഴ്ച: ടെയിൽവിൻഡ് ലാബ്സ് ഷോപ്പിഫൈയിൽ ചേരുന്നു — ഫ്രെയിംവർക്ക് MIT ആയി തുടരും, എന്നാൽ ആദം വാത്തൻ AI ഡോക്സ് ട്രാഫിക് 40% കുറച്ചെന്നും എഞ്ചിനീയറിംഗ് ട

5:15 ↗
daily · ml · 2026 ഒക്ടോ 4

AWS-ൻ്റെ സ്പെൻഡിങ് ക്യാപ് നിങ്ങളുടെ പ്രോജക്റ്റ് ഇല്ലാതാക്കാൻ സാധ്യതയുണ്ട്

AWS-ൻ്റെ പുതിയ പ്രോജക്റ്റ് സ്പെൻഡ് പരിധികൾ നിശ്ചിത പരിധിയിൽ വിഭവങ്ങൾ നിർത്തുകയും നിങ്ങളുടെ ഡാറ്റ ആദ്യം സംരക്ഷിക്കുകയും ചെയ്യും. പ്രവർത്തനരഹിതമായി 90 ദിവസത്തേക്ക് താൽക്കാലികമായി നിർത്തിവെച്ച പ്രോജക്റ്റ

5:13 ↗