
Project Astra실시간으로 세계를 볼 수, 들어볼 수, 그리고 이해할 수 있는 구글 딥마인드의 UNIVERSAL 인공지능 에이전트입니다.
개요
주요 기능
- 라이브 비디오 및 이미지 이해
- 보이스 기반 대화 인터페이스
- 영구적 의존적 기억
- 텍스트, 오디오, 및 시각 분야의 멀티 모델 논리
- 가미니 모델 패밀리와의 통합
- 智能眼鏡 및 전화에 대한 스마트 가속기 프로토콜
가격
- 모델
- Freemium
- 카테고리
- 멀티 모달 AI
- 평점
- 5.0 / 5 (4)
사용 사례
스마트폰 카메라를 통해 시각 Q&A
objects, text, 또는 scene에 포인트하고, 음성으로 질문을 하는 동안, 리얼타임, context-aware 설명을 구하는 Astra의 라이브 비디오 및 보이스 이해
스마트 글래스를 통한 무인 조수
Astra의 낮은-latency 멀티 모델 논리, 스크린에서 받아 ambient, conversational 지원
일상적인 업무를 위한 영구 기억
전체가 세션의 이전 시간에 대한 follow-up 질문, 예를 들어, 마지막으로 해당 아이템을 어디서 보았는지를 다시 사용할 수있다.
Agentic AI 연구 및 탐구
Astra를 사용하여, 가미니로 빌드하고, 리얼 타임에 의존할수있는 멀티 모델 에이전트가 어떻게, 다양한 장치에 대해 의사결정을 하고, 응답하는 지 연구/탐구
장단점
장점
- 실시간 멀티 모델 이해
- 자연적인, 낮은-latency 보이스 대화
- 구글 딥마인드 연구에 의한
- 세션 동안의 컨텍스트 및 약물 기억
- 웨어러블 및 모바일 장치에 대한設計
단점
- 일반인에게 넓게 제공되지 않음
- 데이터 처리에 대한 자세한 정보가 부족함
- 신태 연구 프로토타입임
- 장치에 따라 기능이 미미할 수 있음
대결 기록
Pantheon에서 2회 대결.
Last 2 battles
리뷰
4개 평가의 평균.
리뷰를 작성하려면 로그인하세요.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on persistent contextual memory, and context and short-term memory across a session caught me off guard. still, I'd recommend giving it a real trial.
Use it every day
Honestly didn't expect to like it this much. Voice-based conversational interface is exactly what I needed, and designed for wearables and mobile devices. but I reach for it almost every day now and it just clicks.
Years in this space
I've evaluated a lot of these over the years. What stands out here is voice-based conversational interface — handled better than most — and real-time multimodal understanding. Not broadly available to the public is my one real gripe. Worth the time if this is your use case.
Compared a few options
Evaluated this against two competitors. Where it wins: integration with Gemini model family and designed for wearables and mobile devices. Where it lags: limited details on data handling. On balance the feature set — especially prototype support for smart glasses and phones — justifies the 5 stars for our use case.
Q&A
Project Astra는 어떻게 동영상, 오디오 및 이미지를 처리할 수 있나요?
아스트라는 텍스트, 오디오, 이미지 및 실시간 동영상을 포함한 멀티모달 사고를 수행합니다. 사용자는 카메라를 가리키거나 자연스럽게 대화하도록 사용자가 받을 수 있는 콘텍스트 인식적인 응답을 받을 수 있으며, 세션이 종료된 후 최근에 보았거나 들은 내용을 다시 확인할 수 있습니다.
Asked by Grace Okafor · Mar 11, 2026
Project Astra는 어느 기기에 지원되는 지 알려주세요.
프로젝트 아스트라는 휴대폰, 스마트 글래스, 및 다른 환경 또는 착용 가능한 디바이스에 대해 프로토타입되어 있습니다. 그러나 기기의 유형에 따라 기능이 다를 수 있으므로, 완전한 디바이스 지원에 대한 최종 결과는 아직 발표되지 않았습니다.
Asked by Omar Haddad · Feb 16, 2026
Project Astra는 어떻게 이용할 수 있습니까?
Project Astra에는 제한된 Experimental prototype이며 널리 공개된 product로 사용할 수 없습니다. Google deepmind에서 public demo를 보여드렸지만 그때까지 publicly accessible details는 release가 되지 않았습니다.
Asked by Mei-Ling Wong · Jan 7, 2026
질문하기
멀티 모달 AI 대안
Algomo
멀티 모달 AI
AI
AgentFi
멀티 모달 AI
DeFi
Magentic One
멀티 모달 AI
오픈 소스 일반성 지식_MULTI AGENT 시스템複杂한 다단계 과제를 해결하고 있습니다.
Siena AI
멀티 모달 AI
자율 학습 AI 고객 SUPPORT 에이전트, 동시에 감성을 기반한 ECOMMERCE SUPPORT을 위한
Langroid
멀티 모달 AI
오픈소스 Python 프레임워크로서, 다원형 에이전트 프로그래밍 패러다임을 이용하는 LLM 애플리케이션 개발을 간편화합니다.
Auralis AI
멀티 모달 AI
AI
EmbedAI
멀티 모달 AI
자체 데이터로 ChatGPT 기술을 기반한 유사한 대화를 제공하는 사용자 지정 챗봇을 만들고 어디에나 임베드하세요.
Lumivar
멀티 모달 AI
차량 제조업 분야에 맞춰 설계된 AI 에이전트
Trending now
Reducto AI
인공지능 에이전트 개발 플랫폼
복잡한 PDF, 슬라이드 및 스프레드시트에서 구조화된 데이터를 추출할 수 있는 문서 지능 API입니다. 이들은 텍스트, 이미지, 탭 및 레이아웃 정보까지 모든 요소를 파싱 및 추출합니다.
Biology AI
교육 인공지능(EdTech AI)
정확한 과제 도움말과 전체 설명
AdCrier
마케팅 및 광고
광고 주도 답변, 클릭당 지불
Beam AI
아에 프러는조요
각 산업에서 워크플로를 최적화하기 위한 리더적인 에이전트 프로세스 자동화 플랫폼으로, 자체 학습 에이전트를 활용하여 다중 산업의 워크플로우를 개선한다.












