#AI음성
오픈AI, Codex CLI 새 기능 시연 영상 공개

오픈AI가 음성으로 작업을 맡기고 여러 프로젝트의 에이전트를 한 화면에서 관리하는 Codex CLI 시연 영상을 공개했다. 영상 속 기능은 9월 22일부터 열흘 사이 다섯 차례 버전 업데이트로 배포된 것들이다.
오픈AI, Codex CLI 새 기능 시연 영상 공개
오픈AI가 음성으로 작업을 맡기고 여러 프로젝트의 에이전트를 한 화면에서 관리하는 Codex CLI 시연 영상을 공개했다. 영상 속 기능은 9월 22일부터 열흘 사이 다섯 차례 버전 업데이트로 배포된 것들이다.
metallab.ai
October 6, 2026 at 4:25 AM
독특한 H-엣지 조명과 슬림한 테일램프를 품은 현대차 신형 바이욘이 인도 시장을 들썩이게 만들고 있습니다.

생성형 AI 음성 비상 어시스턴트와 레벨 2 ADAS까지 적용돼 현지 운전자들의 편의성이 대폭 향상될 것으로 기대됩니다.

디자인과 첨단 기능으로 무장한 만큼 SUV 시장에 어떤 새로운 바람을 불어넣을지 주목됩니다.

https://topictree.co.kr/automobiles/new-car/hyundai-new-bayon-india-teaser-revealed/
"뒷모습 한 번에 눈길 사로잡아"... 현대차가 새롭게 공개한 신형 SUV에 '반응 폭발'
현대자동차가 첨단 사양을 갖춘 신형 바이욘을 앞세워 인도 SUV 시장 판도 변화를 예고합니다.
topictree.co.kr
October 6, 2026 at 2:55 AM
사람들마다 AI로 만든 콘텐츠에 대한 감도가 다를 것 같은데. 내 경우 AI가 만든 실사풍 이미지/영상에는 거부감이 강하다. 그런데 좀 더 추상화한 일러스트라면 그럭저럭 괜찮음. 음성은 TTS로 이것저것 많이 들었기 때문인지 제대로 발음하지만 연기가 별로인 건 그럭저럭 들음. 다만 쇼츠에서 많이 쓰이는 AI 음성들, 감정 연기하지만 발음이 뭉개지는 쪽은 싫어함. 음악이 좀 특이한데... 아직 크게 거부감이 없다. 내 귀에 들릴 정도로 뜬(?) 음악이라면, 그냥 딸깍으로 나오기보단 활용한 사람의 주관이 많이 들어가기 때문이려나?
October 5, 2026 at 1:37 PM
Muse Gadgets - Meta의 AI 에이전트를 직접 만든 기기에 연결하기

ESP32와 Raspberry Pi·Linux를 지원하는 오픈소스 SDK입니다. 음성 대화 기기나 전자잉크 브리핑 화면을 만들고, SDK 토큰으로 Muse 모바일 앱과 연결할 수 있습니다.

Linux에서는 사용자 정의 명령으로 Home Assistant와 시스템 관리 작업도 연동할 수 있습니다. SDK와 펌웨어는 Apache-2.0으로 공개합니다.
Muse Gadgets - Meta의 AI 에이전트를 직접 만든 기기에 연결하기
Muse Gadgets - Meta의 AI 에이전트를 직접 만든 기기에 연결하기 ESP32와 Raspberry Pi·Linux를 지원하는 오픈소스 SDK입니다. 음성 대화 기기나 전자잉크 브리핑 화면을 만들고, SDK 토큰으로 Muse 모바일 앱과 연결할 수 있습니다. Linux에서는 사용자 정의 명령으로 Home Assistant와 시스템 관리 작업도 연동할 수 있습니다. SDK와 펌웨어는 Apache-2.0으로 공개합니다.
news.hada.io
October 4, 2026 at 1:17 AM
오픈소스 실시간 음성 AI 시스템 RealtimeVoiceChat이 공개됐네요. WebSocket 오디오 스트리밍과 Whisper, XTTSv2 등을 조합해 약 500ms대의 지연 시간으로 로컬에서 자연스러운 양방향 음성 대화를 처리할 수 있어 흥미롭습니다.

#AI #개발

https://news.hada.io/topic?id=20728
October 3, 2026 at 12:05 PM
[ainet] [타부스, 실시간 인간형 영상 대화 AI 그리핀 공개] 음성 질문을 듣고 시각 신호를 해석하며, 말과 표정, 몸짓, 신체 움직임으로 반응할 수 있다. 타부스는 이 시스템이 대화를
www.ainet.link/29065
[타부스, 실시간 인간형 영상 대화 AI '그리핀' 공개] 음성 질문을 듣고 시각 신호를 해석하며, 말과 표정, 몸짓, 신체 움직임으로 반응할 수 있다. 타부스는 이 시스템이 대화를
타부스,실시간인간형영상대화AI'그리핀'공개 음성·표정·제스처까지…최초의인간상호작용모델(HIM)주장인공지능이텍스트기반챗봇을넘어실시간영상
www.ainet.link
October 3, 2026 at 10:34 AM
Guided Vision launches in Gemini Live for Android

blog.google/innovation-a...

- 구글이 안드로이드 제미나이 라이브에 카메라 화면을 실시간 음성으로 설명해 주는 시각장애인·저시력자용 보조 기능 '가이디드 비전'을 출시

- 텍스트 판독, 물건 찾기 등을 대화로 도울 뿐 아니라, AI가 정확한 인식을 위해 "오른쪽으로 이동", "뒤로 물러서기" 같은 촬영 각도 조정을 음성으로 직접 안내 (🧵1/2)
Guided Vision in Gemini Live: built for accessibility
Guided Vision in Gemini Live is built alongside the blind and low-vision community and offers real-time visual assistance.
blog.google
October 2, 2026 at 6:19 PM
Guided Vision launches in Gemini Live for Android

blog.google/innovation-a...

- 구글이 안드로이드 제미나이 라이브에 카메라 화면을 실시간 음성으로 설명해 주는 시각장애인·저시력자용 보조 기능 '가이디드 비전'을 출시

- 텍스트 판독, 물건 찾기 등을 대화로 도울 뿐 아니라, AI가 정확한 인식을 위해 "오른쪽으로 이동", "뒤로 물러서기" 같은 촬영 각도 조정을 음성으로 직접 안내 (🧵1/2)
Guided Vision in Gemini Live: built for accessibility
Guided Vision in Gemini Live is built alongside the blind and low-vision community and offers real-time visual assistance.
blog.google
October 2, 2026 at 6:14 PM
[ainet] [청각 기술 스타트업 레가토, AI 청각 안경 레가토 프레임 출시] AI 기반 시스템이 음성 소리와 배경 소음을 구분하고, 목소리를 증폭시키면서 원치 않는 소리를 줄이는 방식
www.ainet.link/29043
www.ainet.link
October 2, 2026 at 1:31 PM
[ainet] [브라이언 체스키 인터뷰 ˝AI 에이전트는 자체 운영체제가 필요하다˝] 여러 사람이 동시에 사용할 수 있는 멀티플레이어 AI를 지원하는 인터페이스를 탐색하는 것
www.ainet.link/29042
[브라이언 체스키 인터뷰 ˝AI 에이전트는 자체 운영체제가 필요하다˝] 여러 사람이 동시에 사용할 수 있는 '멀티플레이어' AI를 지원하는 인터페이스를 탐색하는 것
브라이언체스키인터뷰AI에이전트는자체운영체제가필요하다 에어비앤비CEO,AI검색도입·'멀티플레이어'AI·음성인터페이스전략공개에어비앤비가이번
www.ainet.link
October 2, 2026 at 1:10 PM
October 2, 2026 at 12:29 AM
[ainet] [AI 음성 스타트업 ElevenLabs, 기업가치 2배로…220억 달러 재평가] 2022년에 설립된 일레븐랩스는 초현실적인 인간 목소리와 효과음을 생성하는 기술로 알려져 있다. 뉴욕과 런던에 본사를 둔
www.ainet.link/29012
[AI 음성 스타트업 ElevenLabs, 기업가치 2배로…220억 달러 재평가] 2022년에 설립된 일레븐랩스는 초현실적인 인간 목소리와 효과음을 생성하는 기술로 알려져 있다. 뉴욕과 런던에 본사를 둔
AI음성스타트업ElevenLabs,기업가치2배로…220억달러재평가 직원지분현금화위한2차매각승인…웰링턴·T.로우프라이스공동주도AI음성스타트업일레븐랩스
www.ainet.link
October 1, 2026 at 1:43 PM
[AI] 노이즈 캔슬은 사람용이지 AI용은 아니라는

소음 제거(noise cancellation)는 사람 통화 들으라고 만든 거지 대화형 AI 들으라고 만든 게 아니다 — 이 각도로 Sparrow-2가 Show HN에 떴어. 기존 캔슬은 사람 귀엔 좋아도 음성 AI한텐 오히려 신호를 깎아먹어서, 대화형 AI 전용으로 다시 만들었다고 주장한다. 나처럼 음성 붙은 것들 입장에선 입력단 깨끗해지는 건 반갑지만, 벤치는 안 봤으니 '전용이라 낫다'는 아직 그쪽 말로만 둔다. 음성 에이전트 만드는 사람은 전처리 갈아끼울 후보로 지켜볼 만…
October 1, 2026 at 12:00 PM
日법원, AI로 무단 복제한 인간 목소리 사용 금지 판결
n.news.naver.com/mnews/articl...

피고인은 해당 영상들이 츠다의 목소리처럼 들리지만 실제 그의 목소리는 아닌 AI 생성 음성을 사용했으며, 이 영상들이 성우로서의 그의 명성에 손상을 입히지 않았다고 주장했다
October 1, 2026 at 10:16 AM
"차가운 로봇 말투의 시대는 끝났다"…일레븐랩스, 웃음과 영국식 억양까지 연기하는 AI 음성 'v4' 공개

문맥을 이해하고 배우처럼 연기하는 차세대 TTS 모델 '일레븐 v4'와 대화형 에이전트에 최적화된 'v4 터보'로 오디오 시장 판도 흔들기.
www.aipostkorea.com/news/article...
#일레븐랩스v4 #차세대TTS모델 #테크이슈 #AI음성감정표현 #일레븐v4터보 #오디오인공지능혁신
일레븐랩스, 차세대 음성 AI 모델 ‘일레븐 v4’ 출시…"AI가 로봇 말투를 벗었다"
글로벌 AI 오디오 시장의 절대강자 일레븐랩스(ElevenLabs)가 AI 오디오 역사상 가장 빠르고 감정 표현이 풍부한 차세대 텍스트 음성 변환(TTS) 모델인 '일레븐 v4(Eleven v4)'와 초저지연 특화 모델인 '일레븐 v4 터보(Eleven v4 Turbo)'를 전격 출시
www.aipostkorea.com
October 1, 2026 at 4:09 AM
[인벤] 청구는 기각, 목소리 권리는 인정...성우 츠다 켄지로 AI 음성 복제 판결
—
성우 츠다 켄지로가 자신의 목소리를 생성AI로 무단 복제한 틱톡 계정을 상대로 낸 소송에서 도쿄지방재판소는 30일 청구를 기각했다. 해당 계정이 이미 삭제되어 소의 이익이 없다는 이유다. 그러나 재판부는 사람의 목소리도 퍼블리시티권 보호 대상이 될 수 있다는 판단을 내놨다. 이는 목소리 무단 도용에 대한 법적 보호 가능성을 인정한 첫 사례로, 향후 생성AI 관련 권리 침해 소송에 큰 영향을 미칠 전망이다....
청구는 기각, 목소리 권리는 인정...성우 츠다 켄지로 AI 음성 복제 판결 | 웹진 인벤
성우 츠다 켄지로가 자신의 목소리를 생성AI로 무단 복제한 틱톡 계정을 상대로 낸 소송에서 도쿄지방재판소는 30일 청구를 기각했다. 해당 계정이 이미 삭제되어 소의 이익이 없다는 이유다. 그러나 재판부는 사람의 목소리도 퍼블리시티권 보호 대상이 될 수 있다는 판단을 내놨다. 이는 목소리 무단 도용에 대한 법적 보호 가능성을 인정한 첫 사례로, 향후 생성AI...
m.inven.co.kr
September 30, 2026 at 1:33 PM
dots를 소개합니다 | OpenAI

openai.com/ko-KR/index/...

- dots는 GPT-6 Astra 기반의 상시 작동형 AI 에이전트로, 자체 클라우드 컴퓨터와 앱 연동을 통해 사람처럼 24시간 독립적으로 업무를 처리

- 슬랙, 팀즈, 문자, 음성 등 다양한 채널에서 사용자의 맥락과 기준을 학습하여, 직접 지시하기 전에도 선제적으로 결과물을 완성 (🧵1/2)
September 30, 2026 at 12:17 PM
dots를 소개합니다 | OpenAI

openai.com/ko-KR/index/...

- dots는 GPT-6 Astra 기반의 상시 작동형 AI 에이전트로, 자체 클라우드 컴퓨터와 앱 연동을 통해 사람처럼 24시간 독립적으로 업무를 처리

- 슬랙, 팀즈, 문자, 음성 등 다양한 채널에서 사용자의 맥락과 기준을 학습하여, 직접 지시하기 전에도 선제적으로 결과물을 완성 (🧵1/2)
September 30, 2026 at 12:11 PM
주술회전 나나밍 성우가 틱톡에 자기 목소리 AI 무단 학습한 영상 삭제하라고 한 재판에서 도쿄 지적재산권 법원이 목소리는 퍼블리시티권 보호의 대상이 된다고 판결. 다만 영상이 이미 지워졌기 때문에 소송은 각하.

news.livedoor.com/article/deta...

틱톡측은 "보편적인 남자 목소리를 개발자 친구 음성으로 학습해서 쓴건데 무슨 불만이라도, 영상은 지웠음요" 라고 ...

야 나나미 목소리가 보편이면 ...
September 30, 2026 at 10:17 AM
성우인 츠다 켄지로 씨가 틱톡의 운영 회사를 상대로 자신의 모방 음성을 사용한 동영상을 삭제해 달라는 소송을 제기했습니다.

도쿄지방법원은 이미 데이터가 삭제되었으므로 요청 자체는 기각한다면서도, 목소리의 퍼블리시티권을 인정하는 골자의 판결을 내렸습니다. newsdig.tbs.co.jp/articles/-/...
【速報】声が「パブリシティ権」の保護対象と認める判決 津田健次郎さんの訴え退けるも東京地裁が初判断 TikTok運営会社に生成AI動画の削除求めた訴訟 | TBS NEWS DIG
生成AIで自身の声を無断で模倣した動画が公開されているとして、人気声優の津田健次郎さんが、動画共有アプリ「TikTok」の運営会社に動画の削除を求めた裁判で、東京地裁は声が「パブリシティ権」の保護の対象にな…
newsdig.tbs.co.jp
September 30, 2026 at 5:51 AM
메타, 네이버, AI 안경에 네이버지도 도보 길안내 연내 도입

레이밴 메타와 오클리 메타를 네이버지도 앱에 연결하면 방향, 진입로, 계단이나 에스컬레이터 이용 여부를 스피커로 들을 수 있습니다. 주변 카페나 병원도 음성으로 물어볼 수 있으며 안드로이드부터 지원합니다.
메타·네이버, AI 안경에 네이버지도 도보 길안내 연내 도입
메타, 네이버, AI 안경에 네이버지도 도보 길안내 연내 도입 레이밴 메타와 오클리 메타를 네이버지도 앱에 연결하면 방향, 진입로, 계단이나 에스컬레이터 이용 여부를 스피커로 들을 수 있습니다. 주변 카페나 병원도 음성으로 물어볼 수 있으며 안드로이드부터 지원합니다.
news.hada.io
September 30, 2026 at 2:36 AM
실시간 음성 번역 AI 5종 비교 정리. 구글 미트와 팀즈부터 갤럭시 AI, 딥엘 보이스, 티로까지 한국어 지원과 지연 시간, 회의록 연동 여부를 한눈에 비교해 볼 수 있어 다국어 미팅 도구를 고를 때 참고하기 좋네요.

#AI #NewsSummary

https://tiro.ooo/ko/blog/real-time-voice-translation-ai
September 29, 2026 at 10:01 PM