Hacker News

MDST இன்ஜின்: WebGPU/WASM உடன் உலாவியில் GGUF மாடல்களை இயக்கவும்

MDST இன்ஜின்: WebGPU/WASM உடன் உலாவியில் GGUF மாடல்களை இயக்கவும் இந்த ஆய்வு mdst-ஐ ஆராய்ந்து, அதன் முக்கியத்துவம் மற்றும் சாத்தியமான தாக்கத்தை ஆய்வு செய்கிறது. முக்கிய கருத்துக்கள் மூடப்பட்டிருக்கும் இந்த உள்ளடக்கம் ஆராய்கிறது: அடிப்படைக் கோட்பாடுகள் மற்றும் கோட்பாடுகள் ...

1 min read Via mdst.app

Mewayz Team

Editorial Team

Hacker News

MDST இன்ஜின்: WebGPU/WASM உடன் உலாவியில் GGUF மாடல்களை இயக்கவும்

MDST இன்ஜின் என்பது வளர்ந்து வரும் இயக்க நேரமாகும், இது டெவலப்பர்கள் மற்றும் வணிகங்களுக்கு GGUF-வடிவமைப்பான பெரிய மொழி மாதிரிகளை நேரடியாக உலாவியில் WebGPU மற்றும் WebAssembly (WASM) பயன்படுத்தி இயக்க உதவுகிறது, இது ஒரு பிரத்யேக சர்வர் அல்லது கிளவுட் GPU இன் தேவையை நீக்குகிறது. முழு கிளையன்ட் பக்க AI அனுமானத்தை நோக்கிய இந்த மாற்றம், இணையப் பயன்பாடுகளில் எவ்வாறு அறிவார்ந்த அம்சங்கள் வழங்கப்படுகின்றன என்பதற்கான விதிகளை மீண்டும் எழுதுகிறது, இது நவீன உலாவியைக் கொண்ட எவருக்கும் தனிப்பட்ட, குறைந்த தாமதம் AI ஐ அணுகக்கூடியதாக ஆக்குகிறது.

எம்.டி.எஸ்.டி எஞ்சின் என்றால் என்ன, அது ஏன் முக்கியமானது?

MDST இன்ஜின் என்பது ஒரு இணைய சூழலில் நேரடியாக llama.cpp போன்ற திட்டங்களால் பிரபலப்படுத்தப்பட்ட GGUF மாதிரிகளை ஏற்ற மற்றும் இயக்க வடிவமைக்கப்பட்ட உலாவி-நேட்டிவ் AI அனுமான கட்டமைப்பாகும். ஒவ்வொரு AI கோரிக்கையையும் கிளவுட் எண்ட்பாயிண்ட் மூலம் ரூட் செய்வதற்குப் பதிலாக, ஜிபியு-துரிதப்படுத்தப்பட்ட கணக்கீட்டிற்கான உலாவியின் WebGPU API மற்றும் அருகிலுள்ள CPU ஃபால்பேக் செயல்திறனுக்கான WebAssembly ஐப் பயன்படுத்தி பயனரின் சொந்த வன்பொருளில் மாதிரி அனுமானத்தை MDST செயல்படுத்துகிறது.

பல காரணங்களுக்காக இது மிகவும் முக்கியமானது. முதலில், இது சர்வர் பக்க அனுமானத்திற்கு உள்ளார்ந்த சுற்று-பயண தாமதத்தை நீக்குகிறது. இரண்டாவதாக, இது முக்கியமான பயனர் தரவை முழுமையாக சாதனத்தில் வைத்திருக்கிறது, இது நிறுவனத்திற்கும் நுகர்வோர் பயன்பாடுகளுக்கும் முக்கியமான தனியுரிமை நன்மையாகும். மூன்றாவதாக, ஒரு API அழைப்புக்கு பணம் செலுத்தும் அல்லது தங்கள் சொந்த GPU கிளஸ்டர்களை பராமரிக்கும் வணிகங்களுக்கான உள்கட்டமைப்பு செலவுகளை இது வியத்தகு முறையில் குறைக்கிறது.

"உலாவியில் AI அனுமானத்தை இயக்குவது இனி கருத்துக்கு ஆதாரமாக இருக்காது - இது ஒரு உற்பத்தி-செயல்படக்கூடிய கட்டமைப்பாகும், இது பரவலாக்கப்பட்ட பயனர் வன்பொருளுக்கான மையப்படுத்தப்பட்ட கிளவுட் செலவுகளை வர்த்தகம் செய்கிறது, AI- இயங்கும் பயன்பாடுகளின் கணக்கீட்டு சுமையை யார் தாங்குகிறார்கள் என்பதை அடிப்படையில் மாற்றுகிறது."

WebGPU மற்றும் WASM ஆகியவை உலாவியில் AI ஐ எவ்வாறு சாத்தியமாக்குகின்றன?

எம்.டி.எஸ்.டி இன்ஜினின் தொழில்நுட்ப அடிப்படைகளைப் புரிந்துகொள்வதற்கு, அது செயல்படும் இரண்டு முக்கிய உலாவிகளின் ஆதிக்கங்களைச் சுருக்கமாகப் பார்க்க வேண்டும். WebGPU என்பது WebGL இன் வாரிசு ஆகும், இது JavaScript மற்றும் WGSL ஷேடர் குறியீட்டிலிருந்து நேரடியாக குறைந்த-நிலை GPU அணுகலை வழங்குகிறது. அதன் முன்னோடியைப் போலல்லாமல், WebGPU கம்ப்யூட் ஷேடர்களை ஆதரிக்கிறது, அவை LLM அனுமானத்தில் ஆதிக்கம் செலுத்தும் மேட்ரிக்ஸ் பெருக்கல் செயல்பாடுகளின் வேலைக் குதிரைகளாகும். MDST ஆனது டென்சர் செயல்பாடுகளை GPU க்கு மிகவும் இணையான முறையில் அனுப்ப முடியும், இது உலாவி சாண்ட்பாக்ஸில் முன்பு சாத்தியமில்லாத செயல்திறனை அடையும்.

இன்ஜினின் முக்கிய இயக்க நேர தர்க்கத்திற்கான ஃபால்பேக் மற்றும் தொகுப்பு இலக்காக WebAssembly செயல்படுகிறது. WebGPU ஆதரவு இல்லாத சாதனங்களுக்கு—பழைய உலாவிகள், சில மொபைல் சூழல்கள் அல்லது ஹெட்லெஸ் சோதனை சூழல்கள்—WASM ஆனது ஒரு செயல்திறன்மிக்க, போர்ட்டபிள் எக்ஸிகியூஷன் லேயரை வழங்குகிறது, இது நிலையான ஜாவாஸ்கிரிப்டை விட அதிகமான வேகத்தில் தொகுக்கப்பட்ட C++ அல்லது ரஸ்ட் குறியீட்டை இயக்குகிறது. ஒன்றாக, WebGPU மற்றும் WASM ஆகியவை வரிசைப்படுத்தப்பட்ட செயலாக்க உத்தியை உருவாக்குகின்றன: GPU-கிடைக்கும் போது முதலில், CPU- வழியாக-WASM இல்லாதபோது.

GGUF மாடல்கள் என்றால் என்ன, அந்த வடிவம் ஏன் இந்த அணுகுமுறைக்கு மையமானது?

GGUF (GPT-ஜெனரேட்டட் யூனிஃபைட் ஃபார்மேட்) என்பது ஒரு பைனரி கோப்பு வடிவமாகும், இது மாதிரி எடைகள், டோக்கனைசர் தரவு மற்றும் மெட்டாடேட்டாவை ஒரே சிறிய கலைப்பொருளாகத் தொகுக்கிறது. llama.cpp இல் திறமையான ஏற்றுதலை ஆதரிக்கும் வகையில் முதலில் வடிவமைக்கப்பட்டது, GGUF ஆனது, 2-பிட் முதல் 8-பிட் வரையிலான பல அளவீட்டு நிலைகளை ஆதரிப்பதால், இது மாதிரி அளவு, நினைவக தடம் மற்றும் வெளியீட்டுத் தரம் ஆகியவற்றுக்கு இடையேயான வர்த்தகத்தைத் தேர்வுசெய்ய டெவலப்பர்களை அனுமதிக்கிறது என்பதால், அளவாக்கப்பட்ட திறந்த-எடை மாடல்களுக்கான நடைமுறை தரநிலையாக மாறியது.

உலாவி அடிப்படையிலான அனுமானத்திற்கு, அளவுப்படுத்தல் விருப்பமானது அல்ல - இது அவசியம். முழு துல்லியமான 7B அளவுரு மாதிரிக்கு தோராயமாக 14 ஜிபி நினைவகம் தேவைப்படுகிறது. Q4 அளவீட்டில், அதே மாதிரியானது தோராயமாக 4 GB ஆக சுருங்குகிறது, மேலும் Q2 இல் அது 2 GBக்குக் கீழே குறையும். MDST இன்ஜின் GGUFக்கான ஆதரவு என்பது, டெவலப்பர்கள் எந்த கூடுதல் மாற்றும் படியும் இல்லாமல் ஏற்கனவே அளவிடப்பட்ட மாடல்களின் பாரிய சுற்றுச்சூழல் அமைப்பை நேரடியாகப் பயன்படுத்த முடியும், இது ஒருங்கிணைப்புக்கான தடையை வியத்தகு முறையில் குறைக்கிறது.

💡 DID YOU KNOW?

Mewayz replaces 8+ business tools in one platform

CRM · Invoicing · HR · Projects · Booking · eCommerce · POS · Analytics. Free forever plan available.

Start Free →

உலாவியில் GGUF மாடல்களை இயக்கும் வணிகங்களுக்கான நிஜ உலக பயன்பாட்டு வழக்குகள் என்ன?

உலாவியில் உள்ள GGUF அனுமானத்தின் நடைமுறை பயன்பாடுகள் ஏறக்குறைய ஒவ்வொரு தொழில் துறையிலும் செங்குத்தாக பரவுகிறது. இந்த அணுகுமுறையைக் கடைப்பிடிக்கும் வணிகங்கள், முன்னர் செலவு-தடை அல்லது தனியுரிமை-கிளவுட் AI தீர்வுகளுடன் பொருந்தாத திறன்களைத் திறக்கும். முக்கிய பயன்பாட்டு நிகழ்வுகளில் பின்வருவன அடங்கும்:

  • ஆஃப்லைன் திறன் கொண்ட AI உதவியாளர்கள்: வாடிக்கையாளர் ஆதரவு சாட்பாட்கள் மற்றும் இணைய இணைப்பு இல்லாமல் முழுமையாகச் செயல்படும் உள் அறிவுத் தளங்கள், களக் குழுக்கள் மற்றும் தொலைதூரச் சூழல்களுக்கு ஏற்றவை.
  • தனிப்பட்ட ஆவண பகுப்பாய்வு: முக்கியமான ஆவணங்கள் பயனரின் சாதனத்திலிருந்து ஒருபோதும் வெளியேறக்கூடாது, இருப்பினும் AI-இயங்கும் சுருக்கம் மற்றும் பிரித்தெடுத்தல் ஆகியவற்றிலிருந்து பயனடையும் சட்ட, மருத்துவம் மற்றும் நிதிப் பணிப்பாய்வுகள்.
  • நிகழ்நேர உள்ளடக்க உருவாக்கம்: பிரத்தியேகப்படுத்தப்பட்ட நகல், தயாரிப்பு விளக்கங்கள் அல்லது சமூக ஊடக உள்ளடக்கத்தை பூஜ்ஜிய அனுமான விலையில் நேரடியாகத் தங்கள் உலாவி அடிப்படையிலான கருவிகளுக்குள் தயாரிக்கும் சந்தைப்படுத்தல் குழுக்கள்.
  • Edge-deployed coding Assistants: டெவலப்பர் உற்பத்தித்திறன் கருவிகள் வெளிப்புற API களுக்கு தனியுரிம குறியீட்டுத் தளங்களை அனுப்பாமல் குறியீடு நிறைவு மற்றும் விளக்கத்தை வழங்கும்.
  • கல்வி தளங்கள்: மாணவர் சாதனங்களில் உள்நாட்டில் இயங்கும் தகவமைப்பு பயிற்சி அமைப்புகள், குறைந்த அலைவரிசை அல்லது தரவு-கட்டுப்படுத்தப்பட்ட சூழலில் AI-உந்துதல் பின்னூட்டத்தை செயல்படுத்துகிறது.

Mwayz போன்ற இயங்குதளங்கள் MDST இன்ஜின் திறன்களை அவற்றின் சுற்றுச்சூழல் அமைப்பில் எவ்வாறு ஒருங்கிணைக்க முடியும்?

Mewayz, 138,000 க்கும் மேற்பட்ட பயனர்களால் நம்பப்படும் ஆல்-இன்-ஒன் 207-மாட்யூல் பிசினஸ் ஆப்பரேட்டிங் சிஸ்டம், மாதத்திற்கு $19 இல் தொடங்கி, MDST இன்ஜின் போன்ற உலாவியில் உள்ள AI அனுமானத் தொழில்நுட்பங்களில் இருந்து அதிகப் பலன்களைப் பெறும் தளமாகும். CRM, இ-காமர்ஸ், உள்ளடக்க மேலாண்மை, பகுப்பாய்வு, குழு ஒத்துழைப்பு மற்றும் பலவற்றை உள்ளடக்கிய தொகுதிகள் மூலம், Mewayz ஏற்கனவே ஆயிரக்கணக்கான வணிகங்களின் செயல்பாட்டு இதயத் துடிப்பை மையப்படுத்துகிறது.

Mwayz போன்ற இயங்குதளத்தில் MDST இன்ஜின் திறன்களை உட்பொதிப்பது, மூன்றாம் தரப்பு AI வழங்குநருக்கு வணிக-முக்கியமான தரவை அனுப்பாமல், தயாரிப்பு விளக்கங்களை உருவாக்குதல், கிளையன்ட் தகவல்தொடர்புகளை உருவாக்குதல், அறிக்கைகளை சுருக்கி, அல்லது தரவை பகுப்பாய்வு செய்தல் போன்ற AI-உதவி பணிப்பாய்வுகளை இயக்க பயனர்களை அனுமதிக்கும். அனுமானம் கிளையன்ட் பக்கமாக இயங்குவதால், பிளாட்ஃபார்ம் வழங்குனருக்கு ஒவ்வொரு பயனருக்கும் குறைந்தபட்ச செலவு பூஜ்ஜியமாக உள்ளது, இது குறைந்த சந்தா அடுக்குகளில் கூட AI அம்சங்களை வழங்குவது பொருளாதார ரீதியாக சாத்தியமானது. இது பிரீமியம் ப்ளான் வைத்திருப்பவர்களுக்கு முன்பதிவு செய்வதற்குப் பதிலாக, முழுப் பயனர் தளத்திலும் அறிவார்ந்த ஆட்டோமேஷனுக்கான அணுகலை ஜனநாயகப்படுத்துகிறது.

அடிக்கடி கேட்கப்படும் கேள்விகள்

உலாவியில் GGUF மாடலை இயக்க பயனர்கள் பெரிய கோப்புகளை பதிவிறக்கம் செய்ய வேண்டுமா?

ஆம், அனுமானம் தொடங்கும் முன் GGUF மாதிரிக் கோப்புகள் உலாவியில் பதிவிறக்கம் செய்யப்பட வேண்டும், ஆனால் நவீன செயலாக்கங்கள் இதை ஒரு முறை செயல்பாட்டிற்கு மாற்ற முற்போக்கான ஸ்ட்ரீமிங் மற்றும் உலாவி கேச் APIகளைப் பயன்படுத்துகின்றன. தொடக்கப் பதிவிறக்கத்திற்குப் பிறகு, மாடல் உள்நாட்டில் தற்காலிகமாகச் சேமிக்கப்பட்டு, அடுத்தடுத்த அமர்வுகள் உடனடியாக ஏற்றப்படும். சிறிய அளவு மாறுபாடுகள்-Q4 அல்லது Q2-ஐ 2-4 ஜிபிக்குள் வைத்திருக்க முடியும், இது பிராட்பேண்ட் இணைப்புகளைக் கொண்ட பயனர்களுக்கு நடைமுறையில் உள்ளது.

2026 இல் உலாவிகள் மற்றும் சாதனங்களில் WebGPU பரவலாக ஆதரிக்கப்படுகிறதா?

Chrome மற்றும் Edge இல் WebGPU நிலையான நிலையை அடைந்துள்ளது, Firefox ஆதரவுடன் 2025 மற்றும் 2026 வரை படிப்படியாக ஷிப்பிங் செய்யப்படுகிறது. மொபைலில், சாதனம் மற்றும் OS பதிப்பின் அடிப்படையில் ஆதரவு மாறுபடும், ஆனால் MDST போன்ற இன்ஜின்களில் உள்ள WASM ஃபால்பேக், GPU முடுக்கம் கிடைக்காவிட்டாலும் செயல்பாட்டைப் பாதுகாக்கிறது. அர்ப்பணிக்கப்பட்ட அல்லது ஒருங்கிணைந்த GPUகள் கொண்ட டெஸ்க்டாப் சூழல்கள் இன்று உற்பத்தி வரிசைப்படுத்தல்களுக்கான உகந்த இலக்கைக் குறிக்கின்றன.

உலாவியில் உள்ள அனுமானம் வேகத்தின் அடிப்படையில் கிளவுட் ஏபிஐ அனுமானத்துடன் எவ்வாறு ஒப்பிடப்படுகிறது?

நவீன நுகர்வோர் வன்பொருளில் சிறிய அளவிலான மாடல்களுக்கு, உலாவி அடிப்படையிலான அனுமானம் வினாடிக்கு 10-30 டோக்கன்களின் செயல்திறனை அடைய முடியும், இது பிணைய சுற்று-பயண தாமதம் இல்லாமல் நடுத்தர அடுக்கு கிளவுட் API மறுமொழி வேகத்துடன் ஒப்பிடத்தக்கது. முதல் டோக்கன் தாமதமானது, க்யூயிங் இல்லாததால், சுமையின் கீழ் உள்ள கிளவுட் எண்ட் பாயிண்ட்களை விட வேகமாக இருக்கும். பெரிய மாடல்கள் மற்றும் குறைந்த-இறுதி சாதனங்கள் இயற்கையாகவே குறைவான செயல்திறனைக் காணும், இது மாதிரித் தேர்வு மற்றும் அளவுப்படுத்தல் அளவை டெவலப்பர்களுக்குக் கிடைக்கும் முதன்மை செயல்திறன் டயல்களாக மாற்றும்.


WebGPU, WebAssembly மற்றும் GGUF மாடல் சுற்றுச்சூழல் அமைப்பு ஆகியவற்றின் ஒருங்கிணைப்பு இணைய பயன்பாடுகளுக்குள் AI திறன்கள் எவ்வாறு வழங்கப்படுகின்றன என்பதற்கான உண்மையான ஊடுருவல் புள்ளியை உருவாக்குகிறது. MDST Engine போன்ற கிளையன்ட் பக்க அனுமான கட்டமைப்பை ஒருங்கிணைக்க முன்கூட்டியே நகரும் வணிகங்கள் நீடித்த போட்டி நன்மையைப் பெறும்—குறைந்த இயக்கச் செலவுகள், வலுவான தனியுரிமை உத்தரவாதங்கள் மற்றும் AI அம்சங்கள் எங்கும், எந்த இணைப்பிலும் வேலை செய்யும்.

நீங்கள் ஒரு வணிகத்தை உருவாக்கி அல்லது அளவிடுகிறீர்கள் என்றால், இந்த வகையான முன்னோக்கிய செயல்பாட்டுத் திறனுக்காக வடிவமைக்கப்பட்ட இயங்குதளத்தை அணுக விரும்பினால், உங்கள் Mewayz பயணத்தை app.mewayz.com இல் தொடங்கவும். மாதத்திற்கு $19 முதல் 207 ஒருங்கிணைந்த தொகுதிகள் மற்றும் திட்டங்களுடன், Mewayz உங்கள் குழுவிற்கு சிறந்த முறையில் செயல்படுவதற்கான உள்கட்டமைப்பை வழங்குகிறது-இன்று மற்றும் AI திறன்கள் தொடர்ந்து உருவாகி வருகின்றன.

Try Mewayz Free

All-in-one platform for CRM, invoicing, projects, HR & more. No credit card required.

Start managing your business smarter today

Join 30,000+ businesses. Free forever plan · No credit card required.

Ready to put this into practice?

Join 30,000+ businesses using Mewayz. Free forever plan — no credit card required.

Start Free Trial →

Ready to take action?

Start your free Mewayz trial today

All-in-one business platform. No credit card required.

Start Free →

14-day free trial · No credit card · Cancel anytime