

Meta తన Segment Anything Model (SAM) ఫ్యామిలీలో కొత్త SAM Audio AI మోడల్ను పరిచయం చేసింది. ఈ మోడల్ సంక్లిష్టమైన ఆడియో మిక్స్చర్ల నుండి నిర్దిష్ట శబ్దాలను గుర్తించి, వేరుచేసి, ప్రత్యేకంగా ఫిల్టర్ చేయగలదు. SAM Audio టెక్స్ట్ ప్రాంప్ట్స్, విజువల్ సూచనలు లేదా టైం స్టాంప్స్ ఉపయోగించి ఆడియో ఎడిటింగ్ చేయగలదు, ఇది సాధారణంగా ప్రత్యేక టూల్స్ మరియు మాన్యువల్ ప్రయత్నం అవసరమయ్యే పనులను ఆటోమేటిక్గా చేస్తుంది. ఇది Meta యొక్క SAM లైసెన్స్ కింద విడుదల చేయబడింది, దీని ద్వారా పరిశోధన మరియు వాణిజ్య రెండు రకాల ఉపయోగాలు సాధ్యం.
Meta ప్రకారం, SAM Audio ఒక ఏకీకృత ఆడియో AI మోడల్, ఇది మూడు రకాల ప్రాంప్ట్స్ని అర్థం చేసుకోవచ్చు. టెక్స్ట్ ప్రాంప్ట్స్ ద్వారా యూజర్లు “బ్యాక్గ్రౌండ్ నాయిస్” లేదా “మ్యూజిక్” వంటి శబ్దాలను వర్ణించవచ్చు. విజువల్ ప్రాంప్ట్స్ ద్వారా వీడియోలో ఒక వస్తువు లేదా వ్యక్తిని క్లిక్ చేస్తే, ఆ మూలం నుండి వచ్చే శబ్దం వేరు చేయబడుతుంది. టైమ్-బేస్డ్ ప్రాంప్ట్స్ ద్వారా యూజర్లు ఆడియో టైమ్లైన్లో ఒక నిర్దిష్ట భాగాన్ని మార్క్ చేసి, ఆ శబ్దాన్ని ఎంచి వేరు చేయవచ్చు, దీనివల్ల ఖచ్చితమైన ఆడియో వేరుచేతనం సులభం మరియు వేగవంతం అవుతుంది.
SAM Audio ని Meta వెబ్సైట్, GitHub, Hugging Face ద్వారా డౌన్లోడ్ చేసుకోవచ్చు, అలాగే సెగ్మెంట్ ఎనిథింగ్ ప్లేగ్రౌండ్ ద్వారా ఆన్లైన్లో పరీక్షించవచ్చు. సాంకేతికంగా, ఇది జెనరేటివ్ సెపరేషన్ మోడల్గా పనిచేస్తూ లక్ష్య శబ్దాలను మరియు రిసిడ్యూయల్ ఆడియో స్టెమ్స్ని వేరు చేస్తుంది, దీని కోసం ఆధునిక డిఫ్యూషన్ మరియు ఆడియో ఎన్కోడింగ్ సాంకేతికతలను ఉపయోగిస్తుంది. ప్రారంభ పరీక్షల ప్రకారం, ఈ మోడల్ వేగవంతం మరియు సమర్థవంతంగా పనిచేస్తోంది, AI ఆధారిత ఆడియో ఎడిటింగ్లో శక్తివంతమైన కొత్త దృక్పథాన్ని అందిస్తుంది.

కామెంట్స్ (0)
ఇప్పటికి కామెంట్స్ లేవు
మొదటిగా కామెంట్ చేయండి!