4.2 KiB
康康 · 小红书长文(Google 赛道版)
改写自原 MNN 版。核心转向:出海 / 低资源 / 多语言 / Google 技术(Gemma + Gemini)。 发布前替换:比赛官方话题、@官方账号、真机数字、demo 视频。
标题备选
- 我做了个 App:化验单看不懂?拍一下,断网也能读
- 把 Google 的 AI 塞进手机,帮你读懂外语体检报告
- Day_ | 不上传、断网也能用的健康 AI(Gemma + Gemini)
- 缺医、弱网、看不懂报告——我用端侧 AI 做了个解法
推荐主标题:Day_ | 不上传、断网也能用的健康 AI 封面副字:Gemma 端侧离线 + Gemini 读图/翻译 · 你的母语
正文主稿
很多人拿到一张化验单,第一反应是:这些箭头、缩写、参考范围,到底哪项要紧?
如果身边没有医生,或者报告还是外语的,就更难。而最常见的「拍给云端 AI」方式,又得把姓名、年龄、医院、检查结果这些最私密的信息传上去。
所以我做了「康康」——一个默认在手机本地跑、隐私优先的健康助手。目标人群不只是国内,而是弱网/缺医地区,和在国外看不懂医疗文件的人。
它现在能完成一个完整闭环:
拍一张报告 → 读出指标(数值、单位、参考范围、异常)→ 存成可检索的档案 → 看趋势 → 问它「最近哪些不正常、就诊前帮我整理重点」。
技术上我用的是 Google 的 AI,双路 hybrid:
- 端侧默认:Gemma-3n(Google 开源的手机端多模态小模型)。飞行模式也能用——这对网络不稳的地方是刚需。数据不出设备。
- 联网增强:Gemini 2.5 Flash。你主动开启后,拍报告原图直接让 Gemini 读图出结构化指标;外语报告也能 Gemini 翻译 + 用你的母语讲明白。
- 断网或额度用尽,自动回退端侧,功能不中断。
为什么是这套组合?因为低资源场景同时要「离线能用」和「读得准、能翻译」两件事:前者只有端侧小模型能给(Gemma-3n),后者需要强多模态和多语言(Gemini)。一个负责隐私与可用性,一个负责能力,正好互补。
我特别在意一点:这不是一个「会聊天的健康机器人」,而是把健康资料变成你自己的长期记忆——不用再翻相册找去年的化验单,看医生前 30 秒就能整理出重点。它不替你诊断,也不给用药建议,只负责把你已有的信息收好、读懂、讲清楚。
整个 App 是我用 AI 辅助(vibe coding)在几周内做出来的。
健康数据,应该先属于你自己——哪怕没有网络,哪怕你在异国他乡。
#比赛官方话题# #端侧AI #Gemma #Gemini #GoogleAI #本地大模型 #健康管理 #出海 #隐私保护 #iOS开发
9 宫格图片排序(Google 赛道)
| 顺序 | 图片 | 图中文字 | 作用 |
|---|---|---|---|
| 1 | 首页 + 封面大字 | 不上传、断网也能用的健康 AI | 先讲是什么 |
| 2 | 拍报告 → Gemini 读图结构化 | 拍一张,报告变档案 | 第一卖点(Gemini 核心) |
| 3 | 飞行模式 + 正在生成 | 断网也能 AI 解读 | 低资源杀手锏(Gemma 端侧) |
| 4 | 外语报告 → 母语解读 | 看不懂的外语报告,翻译+讲明白 | 出海痛点(Gemini 多语言) |
| 5 | 我的 · 云端 AI(Gemini 开关) | 隐私优先,云端可选 | hybrid + Google 产品证据 |
| 6 | 趋势页 AI 解读 | 长期变化看得懂 | 长期价值 |
| 7 | 就诊摘要 | 看医生前自动整理 | 应用价值 |
| 8 | 药盒识别 | 药盒也能入档 | 扩展场景 |
| 9 | 架构/开发图 | Gemma + Gemini + SwiftUI | 收尾,vibe coding |
封面字方案
技术向
- 主字:把 Google AI 塞进手机
- 副字:Gemma 端侧离线 + Gemini 读图翻译
- 角标:断网也能用
大众向
- 主字:化验单看不懂?拍一下
- 副字:不上传,断网也能读,还能翻译外语报告
- 角标:几周独立开发 demo
仍需补的素材(对应评审「完成度与传播」)
- Gemini 读一张报告的 10 秒录屏——最值钱的证据,务必有。
- 飞行模式 + 端侧生成。
- 外语报告 → 母语解读。
- 云端 AI 设置页(Gemini 开关)。
- 片头/转场可用 Veo / Google Flow 生成。