Google తన Gemini Audio ప్లాట్ఫామ్లో భాగంగా Gemini 3.5 Transcribe అనే కొత్త ఫీచర్ను విడుదల చేసింది. ఇది ఆడియో రికార్డింగ్లను టెక్స్ట్గా మార్చే ప్రక్రియలో పెద్ద మార్పులను తీసుకువచ్చింది. గతంలో ఉన్న Chirp 3 మోడల్తో పోలిస్తే, బహుభాషా పనితీరు మరియు పదాల దోషాల రేటు విషయంలో ఇది మెరుగైన ఫలితాలను ఇస్తుందని Google పేర్కొంది.
ఈ కొత్త మోడల్ ఆడియోలోని 'ఉమ్', 'ఉహ్' వంటి అనవసరమైన పూరక పదాలను స్వయంచాలకంగా తొలగించి, వచనాన్ని చక్కగా ఫార్మాట్ చేస్తుంది. వినియోగదారులు తమకు అవసరమైన ప్రత్యేక పదజాలాన్ని మోడల్కు అందించడం ద్వారా, కష్టమైన పదాలను కూడా తప్పులు లేకుండా లిప్యంతరీకరణ (ట్రాన్స్క్రిప్షన్) చేయవచ్చు. అంతేకాకుండా, ఇది ఆడియోలోని ప్రతి పదం ఏ సమయంలో వచ్చిందో తెలిపే టైమ్స్టాంప్లను ఇవ్వడమే కాకుండా, ముందే రికార్డ్ చేసిన ఆడియోలో గరిష్టంగా ముగ్గురు వ్యక్తుల ప్రసంగాన్ని వేర్వేరుగా గుర్తించగలదు.
ప్రస్తుతం ఈ ఫీచర్ macOS లోని Gemini యాప్ వినియోగదారులకు ఆంగ్ల భాషలో అందుబాటులోకి వచ్చింది. ఆండ్రాయిడ్ ఫోన్లలోని 'రాంబ్లర్ డిక్టేషన్' ఫీచర్ ద్వారా ఎంపిక చేసిన దేశాలు మరియు భాషలలో ఇది అందుబాటులో ఉంటుంది. డెవలపర్లు AI Studio మరియు Gemini API ద్వారా దీనిని పబ్లిక్ ప్రివ్యూలో పరీక్షించవచ్చు. త్వరలోనే క్రోమ్ బ్రౌజర్లో కూడా ఈ సదుపాయాన్ని తీసుకురానున్నట్లు Google తెలిపింది.
మరోవైపు, Gemini 3.5 Live మరియు 3.5 Live Experimental అనే అదనపు మోడళ్లను కూడా విడుదల చేస్తున్నట్లు Google మొదట పేర్కొన్నప్పటికీ, ప్రచురణ సమయానికి అవి అందుబాటులోకి రాలేదు. వీటి కోసం కొత్త తేదీని కంపెనీ ఇంకా ప్రకటించలేదు. Gemini 3.5 Live సంభాషణల మధ్యలో వచ్చే అంతరాయాలను, భాషలను గుర్తించడంలో మెరుగ్గా పనిచేస్తుంది. అలాగే, Gemini 3.5 Live Experimental క్లిష్టమైన పనులను దశలవారీగా విశ్లేషించి పరిష్కరించడంలో సహాయపడుతుంది.
Google ఇంకా Gemini 3.5 Pro మోడల్ విడుదల కోసం ఎదురుచూస్తున్న వినియోగదారులకు ఈ అప్డేట్లను అందించింది. జూన్ నెలలోనే 3.5 Pro మోడల్ను విడుదల చేస్తామని గతంలో హామీ ఇచ్చినప్పటికీ, దానిపై స్పష్టత రావాల్సి ఉంది. ప్రస్తుతం అందుబాటులోకి వచ్చిన 3.5 Transcribe ఫీచర్ ద్వారా వినియోగదారులు తమ వాయిస్ రికార్డింగ్లను మాన్యువల్గా ఎడిట్ చేయాల్సిన అవసరం లేకుండా సహజంగా సవరించుకోవచ్చు.








