当前位置:首页 > 技术 > 正文内容

Django 分页查询返回 JSON 数据的中文乱码解决方案

访客 技术 2026年8月9日 2

问题背景

在 Django 开发中,经常需要实现分页查询并返回 JSON 格式数据。当数据包含中文时,容易遇到乱码问题。下面提供一个完整的分页查询示例:

# coding=UTF-8
import os

from django.core import serializers
from django.core.paginator import Paginator, PageNotAnInteger, EmptyPage
from django.http import HttpResponse
from mypage.models import Product


def get_products(request):
    product_list = Product.objects.all()
    page_size = 10
    paginator = Paginator(product_list, page_size)
    
    page_number = request.GET.get('page', 1)
    
    try:
        current_page = paginator.page(page_number)
    except PageNotAnInteger:
        current_page = paginator.page(1)
    except EmptyPage:
        current_page = paginator.page(paginator.num_pages)
    
    json_result = serializers.serialize("json", current_page, ensure_ascii=False)
    return HttpResponse(json_result, content_type='application/json; charset=utf-8')

中文乱码问题的关键在于 serializers.serialize() 方法中的 ensure_ascii=False 参数。这个参数告诉 JSON 序列化器不要将非 ASCII 字符转义为 Unicode 转义序列。

深入理解 Django 序列化

Django 的序列化框架提供了一种将模型实例转换为其他格式(通常是文本格式)的机制,便于数据传输。序列化相关代码位于 django.core.serializers 包中。

核心函数原型

serialize() 函数定义如下:

def serialize(format, queryset, **options):
    """
    使用指定序列化器序列化查询集(或任何返回数据库对象的迭代器)
    """
    serializer = get_serializer(format)()
    serializer.serialize(queryset, **options)
    return serializer.getvalue()

Serializer 基类:

class Serializer(object):
    """序列化器抽象基类"""
    internal_use_only = False
    
    def serialize(self, queryset, **options):
        # 具体序列化逻辑
        pass

基本序列化操作

序列化数据

使用高层 API 进行序列化:

from django.core import serializers

# 简单方式
data = serializers.serialize("xml", SomeModel.objects.all())

# 复杂方式
XMLSerializer = serializers.get_serializer("xml")
xml_serializer = XMLSerializer()
xml_serializer.serialize(queryset)
data = xml_serializer.getvalue()

反序列化数据

for obj in serializers.deserialize("xml", data):
    # obj 是 DeserializedObject 实例
    obj.save()  # 保存到数据库

序列化参数详解

序列化方法接受三个主要参数:

self.stream = options.pop("stream", StringIO())
self.selected_fields = options.pop("fields", None)
self.use_natural_keys = options.pop("use_natural_keys", False)

stream - 流输出

直接将序列化结果写入文件流:

output_file = open("data.xml", "w")
xml_serializer.serialize(SomeModel.objects.all(), stream=output_file)

selected_fields - 选择字段

只序列化指定字段:

data = serializers.serialize('xml', SomeModel.objects.all(), fields=('name', 'size'))

use_natural_keys - 自然键

默认情况下,外键和多对多关系使用主键。但在某些场景(如引用 ContentType)下,使用自然键更合适。自然键是指一组可以唯一标识记录的非主键字段组合。

自然键的使用

定义自然键反向查找

在模型的管理器中定义 get_by_natural_key() 方法:

from django.db import models

class PersonManager(models.Manager):
    def get_by_natural_key(self, first_name, last_name):
        return self.get(first_name=first_name, last_name=last_name)

class Person(models.Model):
    objects = PersonManager()
    first_name = models.CharField(max_length=100)
    last_name = models.CharField(max_length=100)
    birthdate = models.DateField()
    
    class Meta:
        unique_together = (('first_name', 'last_name'),)

使用自然键后,序列化输出:

{
    "pk": 1,
    "model": "store.book",
    "fields": {
        "name": "Mostly Harmless",
        "author": ["Douglas", "Adams"]
    }
}

定义自然键正向输出

在模型类中定义 natural_key() 方法,并在序列化时设置 use_natural_keys=True

class Person(models.Model):
    objects = PersonManager()
    first_name = models.CharField(max_length=100)
    last_name = models.CharField(max_length=100)
    birthdate = models.DateField()
    
    def natural_key(self):
        return (self.first_name, self.last_name)
    
    class Meta:
        unique_together = (('first_name', 'last_name'),)

# 序列化时使用
serializers.serialize('json', [person1, person2], use_natural_keys=True)

处理序列化依赖

当存在外键关系时,需要确保被引用的对象先序列化。可以通过设置依赖关系来指定序列化顺序:

class Book(models.Model):
    name = models.CharField(max_length=100)
    author = models.ForeignKey(Person)
    
    def natural_key(self):
        return (self.name,) + self.author.natural_key()
    
    natural_key.dependencies = ['example_app.person']  # 指定依赖

模型继承的注意事项

对于多表继承,必须同时序列化所有基类。例如:

class Place(models.Model):
    name = models.CharField(max_length=50)

class Restaurant(Place):
    serves_hot_dogs = models.BooleanField()

# 正确做法:同时序列化Place和Restaurant
all_objects = list(Restaurant.objects.all()) + list(Place.objects.all())
data = serializers.serialize('xml', all_objects)

相关文章

Linux crontab 详解

1) crontab 是什么cron 是 Linux 的定时任务守护进程;crontab 是用来编辑/查看“按时间周期执行命令”的表(cron table)。常见两类:用户 crontab:每个用户一份(crontab -e 编辑)系统级 crontab / cron.d:可指定执行用户(/etc/crontab、/etc/cron.d/*)2) crontab 时间...

富文本里可以允许的 HTML 属性

一、所有标签默认允许的安全属性(极少)class        (可选)id           (通常建议禁用)title️ 注意:id 容易被滥用做锚点注入,很多系统直接禁用class 允许的话最好只允许固定前缀(如 editor-*)二、a 标签允许属性<a href="" t...

Mac 安装 Node.js 指南

方法一:通过官网安装包(最简单,适合初学者)如果你只是想快速安装并开始使用,这是最直接的方法。访问 Node.js 官网。页面会显示两个版本:LTS (Recommended For Most Users):长期支持版,最稳定。建议选这个。Current:最新特性版,包含最新功能但可能不够稳定。下载 .pkg 安装包并运行。按照安装向导点击“下一步”即可完成。方法二:使用 Homebrew 安装(...

Dom\HTML_NO_DEFAULT_NS 的副作用:自动加闭合标签

在使用Dom\HTMLDocument时,Dom\HTML_NO_DEFAULT_NS 将禁止在解析过程中设置元素的命名空间, 此设置是为了与DOMDocument向后兼容而存在的。当使用它时,已知的一个副作用就是:自动加闭合标签例如 </img> 为什么会这样?当你使用:Dom\HTML_NO_DEFAULT_NS文档会变成 无命名空间模式,此时内部更接近 XML...

Laravel 事件和监听器创建

在 Laravel 中,使用 Artisan 命令创建 Events(事件) 和 Listeners(监听器) 是非常高效的。你可以通过以下几种方式来实现:1. 手动创建单个 Event如果你只想创建一个事件类,可以使用 make:event 命令:Bashphp artisan make:event UserRegistered执行后,文件将生成在 app/Even...

自定义域名解析神器 dnsmasq

什么是 dnsmasq?dnsmasq 是一个轻量级、功能强大的网络服务工具,专为小型和中等规模网络设计。它是一个综合的网络基础设施解决方案[1]。dnsmasq 能做什么?功能说明应用场景DNS 转发与缓存将 DNS 查询转发到上游服务器(ISP、Google DNS 等),并在本地缓存结果加快 DNS 查询速度,减少外部 DNS 流量本地 DNS解析本地网络设备的主机名,无需编辑&n...

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。