<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
	<channel>
		<title>视觉语言模型 on 编程心语</title>
		<link>https://www.ithome.me/tags/%E8%A7%86%E8%A7%89%E8%AF%AD%E8%A8%80%E6%A8%A1%E5%9E%8B/</link>
		<description>Recent content in 视觉语言模型 on 编程心语</description>
		<generator>Hugo</generator>
		<language>zh-CN</language>
		
		
		
		
			<lastBuildDate>Mon, 17 Aug 2026 03:04:23 +0800</lastBuildDate>
		
			<atom:link href="https://www.ithome.me/tags/%E8%A7%86%E8%A7%89%E8%AF%AD%E8%A8%80%E6%A8%A1%E5%9E%8B/index.xml" rel="self" type="application/rss+xml" />
			<item>
				<title>端侧视觉语言模型实战：用 MiniCPM-V 4.6 给 App 装上看图能力</title>
				<link>https://www.ithome.me/post/2026/08/17/edge-vlm-vision-model-guide/</link>
				<pubDate>Mon, 17 Aug 2026 08:00:00 +0800</pubDate>
				<guid>https://www.ithome.me/post/2026/08/17/edge-vlm-vision-model-guide/</guid>
				<description>&lt;h2 id=&#34;为什么要把看图能力塞进手机&#34;&gt;为什么要把看图能力塞进手机&lt;/h2&gt;&#xA;&lt;p&gt;相册问答、无障碍场景描述、离线扫描件转结构化信息、儿童教育里的看图说话……这些任务以前要发云端 API，现在可以整体搬到设备上。端侧视觉语言模型（VLM）的好处很直接：照片不出设备（隐私合规）、无网可用、单次推理成本为零、延迟稳定在几十到几百毫秒。&lt;/p&gt;</description>
			</item>
	</channel>
</rss>
