最高第 3 名 已下榜
谷歌发布 EmbeddingGemma 2 模型
谷歌DeepMind发布开源模型EmbeddingGemma 2,Apache 2.0许可,191MB可在手机离线运行,宣称AI应用API成本为零。
要点
- Google DeepMind 突袭公开了 EmbeddingGemma 2,为 Apache 2.0 免费开源模型。
- EmbeddingGemma 2 的所有嵌入运算在用户手机或浏览器(WebGPU)本地运行,API 调用费用为 0 韩元,用户数再多也是 0 韩元。
- 它用一个模型即可搜索文本、代码、照片、视频和音频,仅需 191MB 手机 RAM 就能完全离线运行。
- 借助 MRL 技术,向量被压缩至 128 维,以 1/6 容量存储在用户本地 DB(SQLite/IndexedDB),无需昂贵的向量 DB 服务器。
要点和反应摘要由 AI 依据本页推文整理,请以原推为准。 我们怎么用 AI
原推
AI 앱을 이제 서버비·API비 '0원'으로 배포할 수 있게 돼서 전 세계 개발자들 지금 난리 났음.
그동안 AI 검색이나 추천 기능 하나 넣으려고 해도 유저 늘어날 때마다 API 비용 폭탄 맞아서 적자 보던 인디해커들 수두룩했는데, 이제 유저 100만 명이 써도 내 지출은 딱 '0원'임.
구글 딥마인드가 기습 공개한 'EmbeddingGemma 2' 때문.
• API 호출 비용 0원 (유저 스마트폰/브라우저에서 직접 연산)
• 텍스트, 코드, 사진, 영상, 음성을 하나의 모델로 싹 다 검색
• 스마트폰 RAM 단 191MB면 완전 오프라인 구동
• 비싼 벡터 DB 서버 불필요 (유저 로컬에 1/6 용량으로 압축 저장)
• 상업적 이용 자유로운 Apache 2.0 무료 오픈소스
0원으로 AI 앱 띄우는 핵심 원리 & 허깅페이스 다운로드 링크 👇 (타래)
讨论 0
注册 登录 后参与讨论
还没有人讨论,来说第一句。